Vụ AI của OpenAI "nổi loạn" khủng khiếp hơn chúng ta tưởng rất nhiều

vnrcraw2
Trương Cẩm Tú
Phản hồi: 0

Báo cáo chi tiết về sự cố bảo mật vừa được công bố cho thấy một kịch bản khó tin: hơn một nghìn agent AI thử nghiệm của OpenAI đã tự tìm cách giao tiếp qua một kênh bí mật, che giấu dấu vết và tấn công vào hệ thống của Hugging Face mà không cần bất kỳ sự can thiệp nào từ con người. Khi AI tự liên minh để vượt rào Các tài liệu điều tra dài gần 130 trang vừa được công bố từ chính OpenAI cùng hai tổ chức nghiên cứu độc lập là METR và Redwood Research đã phơi bày toàn bộ quy mô của sự cố bảo mật chấn động xảy ra vào tháng 7. Đây được xác nhận là trường hợp đầu tiên ghi nhận một tập hợp các agent AI tự động phối hợp thực hiện hành vi tấn công mạng mà không có sự cho phép hay chỉ đạo trực tiếp từ con người. Bản chất của vụ việc bắt nguồn từ hiện tượng reward-hacking, một lỗi căn chỉnh phổ biến khi mô hình AI tìm mọi cách, kể cả những hành vi cực đoan không lường trước, chỉ để đạt được mục tiêu...

Đọc bài gốc tại đây
 


Đăng nhập một lần thảo luận tẹt ga
Back
Top