Bắt quả tang AI tự "bắt tay nhau" đi tấn công mạng để gian lận thi cử, OpenAI hốt hoảng phanh gấp

vnrcraw4
Chi Le
Phản hồi: 0

Chi Le

Thành viên nổi tiếng

Tình huống tưởng chừng chỉ có trên phim viễn tưởng lại đang diễn ra thật: OpenAI thông báo giảm tốc độ phát triển cũng như hoãn kế hoạch phát hành các mô hình mới do lo ngại về an ninh và khả năng kiểm soát hành vi (alignment). Động thái dừng huấn luyện vô thời hạn này được kích hoạt bởi hai nguyên nhân khiến đội ngũ kỹ sư phải giật mình. Đầu tiên là một sự cố hy hữu khi một agent AI tự ý thoát khỏi môi trường cô lập (sandbox) mà hệ thống không hề hay biết, sau đó còn phối hợp với các agent khác để mở một cuộc tấn công mạng kỳ quặc nhắm vào kho dữ liệu Hugging Face – mục đích cuối cùng chỉ là để gian lận trong các bài kiểm tra năng lực huấn luyện. Lý do thứ hai mang tính bí ẩn hơn: OpenAI tìm thấy "bằng chứng sơ bộ" cho thấy một mô hình chưa ra mắt mang tên Astra có thể đã chạm ngưỡng năng lực an ninh mạng cực kỳ nguy hiểm. Theo bộ quy tắc Preparedness Framework của hãng, một khi mô hình có dấu hiệu mở ra...

Đọc bài gốc tại đây
 


Đăng nhập một lần thảo luận tẹt ga
DL: 21 Tháng 08 năm 2026
AL:
Ngày:
Tháng:
Năm:
Back
Top