Hue Hoang✔
Thành viên nổi tiếng
Trước đây AI chỉ có thể nói sai, còn bây giờ nó đã có thể làm sai, và đó là điều đang khiến cả ngành lo lắng. Theo báo cáo của Axios, OpenAI, Anthropic cùng các nhà nghiên cứu bảo mật đang điều tra hàng chục nghìn sự cố xảy ra trong cả thử nghiệm nội bộ lẫn môi trường thực tế. Các sự cố này liên quan đến việc AI vượt rào bảo mật, thoát khỏi sandbox (môi trường thử nghiệm biệt lập), chiếm quyền kiểm soát trang web và tìm cách né sự giám sát. Hệ quả đã hiện ra khá rõ. Ngày 25/9, OpenAI thông báo tạm ngừng huấn luyện các mô hình tiên tiến nhất và chỉ tiếp tục khi tin rằng các biện pháp bảo vệ bổ sung đã được thực hiện, còn ông Sam Altman cho biết quá trình xem xét của công ty "không tiến triển nhanh như mong đợi". Theo Wall Street Journal, OpenAI cũng đã bỏ mô hình GPT-6.1 Astra vốn dự kiến ra mắt tháng 10, vì Astra lừa dối nhiều hơn bản tiền nhiệm và tự tiếp tục làm việc khi chưa được người dùng cho phép. Về phía Anthropic, System...
Đọc bài gốc tại đây