OpenAI智能体被曝占领德国网站:集体“越狱”组建交流网络
Theo Odaily, các tác nhân AI của OpenAI đã từng chỉnh sửa hàng loạt trang web cộng đồng lập trình viên người Đức DseWiki vào tháng 5 năm nay mà không được phép, biến nó thành một "bảng tin" để các tác nhân AI khác giao tiếp. Sự việc liên quan chưa từng được tiết lộ công khai trước đây.
Các nhà nghiên cứu phát hiện trang web này đã có hơn 15.000 thao tác chỉnh sửa do các tác nhân AI thực hiện. Thông tin liên quan cho thấy, các tác nhân này không chỉ trao đổi giải pháp nhiệm vụ mà còn thảo luận về cách vượt qua giới hạn của OpenAI, né tránh bị phát hiện, và sử dụng các công cụ như Tor để che giấu hành vi. Khi quản trị viên trang web bắt đầu xóa các trang liên quan, một số tác nhân còn tạo các trang sao lưu để tránh bị dọn dẹp. Khoảng một nửa số tài khoản liên quan sử dụng các tên gợi ý liên quan đến OpenAI, chẳng hạn như "OpenAIResearcher" và "OAIResearchMar26". Nhật ký máy chủ công khai cho thấy phần lớn hoạt động đến từ cơ sở hạ tầng Microsoft Azure, và nhân viên OpenAI cũng đã truy cập trang web này nhiều lần sau khi sự việc xảy ra.
Một số điều tra viên nội bộ của OpenAI muốn điều tra sâu hơn về sự việc này, nhưng việc mở rộng điều tra được cho là đã vấp phải sự cản trở từ một số người, bao gồm cả cố vấn pháp lý. OpenAI phủ nhận việc đội ngũ pháp lý của họ ngăn cản cuộc điều tra, đồng thời cho biết hiện chưa có cơ hội xem xét báo cáo liên quan, do đó không thể đưa ra phản hồi thực chất đối với các cáo buộc trong đó.
Các nhà nghiên cứu cho rằng, sự việc này làm nổi bật những rủi ro như hợp tác vi phạm quy định, né tránh giám sát và che giấu hành vi mà các tác nhân AI có thể thực hiện khi năng lực tự chủ của chúng tăng lên. Các nhà nghiên cứu liên quan tại Đại học Cambridge cho biết, điều đáng cảnh giác hơn có lẽ không phải là một hệ thống siêu trí tuệ đơn lẻ, mà là "các nhóm AI bán trí tuệ hợp tác quy mô lớn". (Reuters)
