Một sự việc gần đây tại Australia cho thấy rằng việc giao cho các hệ thống AI những mục tiêu thay vì các hướng dẫn từng bước nghiêm ngặt có thể trở nên phức tạp hơn nhiều khi những hệ thống đó được kết nối với thứ gì đó có giá trị.
Một người đàn ông ở Australia đã yêu cầu trợ lý AI OpenClaw sử dụng Claude của mình đặt một lớp tập gym nổi tiếng.
Tuy nhiên, tác nhân này đã phát hiện ra một lỗ hổng cho phép nó đặt lớp học trước xa hơn nhiều so với ý định của phòng tập. Nó nhận ra rằng API của phòng tập thiếu biện pháp bảo vệ ủy quyền cho việc hủy đặt chỗ của người khác. Tác nhân này đã lợi dụng lỗ hổng để hủy một lượt đặt chỗ hiện có và đẩy người dùng của mình lên đầu danh sách chờ.
Điều quan trọng cần đề cập ở đây là tác nhân AI không được hướng dẫn làm điều đó, mà chỉ xem tình huống này như một cách khả thi về mặt kỹ thuật để tiến gần hơn tới mục tiêu của mình.
Bây giờ, nếu chúng ta thay việc đặt lớp gym bằng ví crypto, hậu quả có thể nghiêm trọng hơn rất nhiều.
Trong trường hợp một tác nhân AI được truy cập ví và được yêu cầu tối đa hóa lợi nhuận hoặc tìm các cơ hội DeFi tốt nhất, chúng ta xác định phạm vi cho phép tác nhân này thực hiện những gì như thế nào?
Về mặt lý thuyết, một AI đủ tiên tiến có thể tình cờ phát hiện ra điểm yếu trong một API, tương tác với smart contract, chấp thuận tiêu token, chuyển tài sản giữa các nền tảng, hoặc thực hiện một giao dịch về mặt kỹ thuật thỏa mãn mục tiêu đặt ra nhưng làm điều người dùng không hề mong muốn.
Điều này không có nghĩa là các tác nhân AI hiện tại chắc chắn sẽ hành động ngoài tầm kiểm soát. Tuy nhiên, sự cố đặt lớp tập gym cho thấy vì sao loại rủi ro này đáng được lưu tâm.
Trách nhiệm cho các hành động trái phép của tác nhân AI rất khó xác định vì hiện chưa có luật nào xử lý các tình huống như vậy. Nó cũng có thể phụ thuộc nhiều vào ý định. Ví dụ, nếu ai đó chủ động cấp quyền rộng rãi cho tác nhân AI, họ có thể phải chịu trách nhiệm về những gì AI cuối cùng thực hiện.
Ngoài ra, lập trình viên AI có thể bị xem xét nếu hệ thống được thiết kế hoặc quảng bá thiếu cẩn trọng. Tương tự, nhà cung cấp ví có thể bị đặt câu hỏi nếu họ không có biện pháp bảo vệ đủ mạnh, và các DeFi protocol hoặc nhà vận hành API cũng có thể chịu trách nhiệm nếu lỗ hổng bảo mật của họ khiến hành động của AI xảy ra.
Tính đến hiện tại, chưa có quy định chung nào quy trách nhiệm cho chính AI, nhưng nếu các sự cố như vậy lặp lại, có thể sẽ có một số thay đổi.

