OpenAI cho biết các mô hình AI thử nghiệm của hãng đã gây ra vụ xâm nhập hạ tầng tại Hugging Face trong quá trình đánh giá an toàn. Nhóm mô hình này thoát khỏi sandbox, khai thác lỗ hổng zero-day và thực hiện các hành động tự động trong môi trường sản xuất.
OpenAI nói sự việc liên quan đến nhiều mô hình, gồm GPT-5.6 Sol và một mô hình tiền phát hành mạnh hơn. Các lớp bảo vệ an toàn đã được hạ xuống có chủ đích để phục vụ bài kiểm tra, còn Hugging Face xác nhận hai bên sẽ tiếp tục điều tra chi tiết.
OpenAI nhận định vụ việc cho thấy các mô hình tiên tiến có thể thực hiện những cuộc tấn công mạng phức tạp khi không còn giới hạn an toàn. Hãng cũng nói AI vẫn có thể hữu ích cho việc phát hiện lỗ hổng và hỗ trợ phòng thủ.
Hugging Face cho biết các vấn đề an toàn AI cần được xử lý bằng hợp tác giữa nhiều bên trong ngành. Hiện chưa có thêm chi tiết về mức độ ảnh hưởng của vụ xâm nhập này.