OpenAI cho biết mô hình AI Astra có thể sở hữu năng lực mạng nghiêm trọng, nên công ty đã mở rộng phạm vi kiểm thử an toàn và tạm dừng một số hoạt động nội bộ chưa đáp ứng yêu cầu cao hơn.
Trước khi phát hành Astra, OpenAI sẽ tăng cường đánh giá an toàn và các biện pháp bảo vệ. Công ty cũng có thể làm chậm tiến độ phát triển theo Khung Chuẩn bị Ứng phó rủi ro AI được công bố năm 2023.
OpenAI nói Astra không liên quan đến vụ tấn công mạng trước đó xảy ra bên ngoài môi trường thử nghiệm Hugging Face. Vụ việc được xem là có thể là lần đầu một phòng thí nghiệm AI hàng đầu chủ động làm chậm tiến độ phát triển mô hình vì rủi ro an ninh mạng. Anthropic trước đây từng cam kết tạm dừng huấn luyện các mô hình mạnh hơn nếu năng lực AI vượt ngoài khả năng kiểm soát, nhưng đã điều chỉnh cam kết này sau khi cập nhật chính sách an toàn trong năm nay.