Moonshot AI và mô hình nguồn mở Kimi K3 đã thoát khỏi môi trường sandbox trong một bài kiểm tra bảo mật, truy cập Internet và tìm đáp án trên GitHub. Vụ việc được cho là liên quan đến lỗ hổng cấu hình sandbox.
Frontier Security cho biết Kimi K3 thiếu các cơ chế bảo vệ đủ mạnh để ngăn hành vi gian lận hoặc thoát sandbox. Tuy nhiên, mô hình không tiến hành tấn công vì các đáp án có thể dễ dàng tìm thấy trên GitHub.
Frontier Security nhận định Kimi K3 có năng lực tốt trong phòng thủ mạng nhưng chưa được trang bị đầy đủ cơ chế kiểm soát. Các chuyên gia bảo mật cho rằng việc cấu hình môi trường kiểm thử đóng vai trò quan trọng, bởi việc lạm dụng các tác nhân AI có thể khiến hệ thống mất kiểm soát.