Anthropic cho biết Claude Mythos Preview đã phát hiện phương pháp tấn công cải tiến nhằm vào HAWK, một ứng viên chữ ký hậu lượng tử do NIST solicited. Phương pháp này giảm độ mạnh hiệu dụng của HAWK-256 từ 2^64 xuống 2^38.
HAWK từng vượt qua hai vòng đánh giá chuyên gia, nhưng hiện chưa được triển khai trong hệ thống thực tế. Vụ tấn công được thực hiện trong khoảng 60 giờ, với chi phí API khoảng 100.000 USD, và hiện chưa ảnh hưởng đến hệ thống sản xuất nào.
Claude cũng phát hiện phương pháp tấn công cải tiến đối với AES 7 vòng, giúp tăng tốc từ 200 đến 800 lần. Trong quá trình nghiên cứu, mô hình tự thực hiện tổng quan tài liệu, lập luận toán học và kiểm chứng thực nghiệm với sự hướng dẫn hạn chế từ các nhà mật mã học.
Anthropic cho biết Claude đã đề xuất ý tưởng cốt lõi cho vụ tấn công AES sau khi tạo khoảng 1 tỷ token, trong khi các nhà nghiên cứu dành hàng trăm giờ để kiểm chứng kết quả. Nhóm nghiên cứu cũng ghi nhận kết quả ban đầu với LEA và Serpent-128.
Anthropic đã phối hợp công bố với các tác giả HAWK, NIST và đối tác chính phủ, đồng thời hợp tác với các tổ chức học thuật để phát triển chuẩn đánh giá CryptanalysisBench. Công ty cảnh báo các mô hình AI trong tương lai có thể phát hiện những cuộc tấn công thực tế nhằm vào hệ thống đang được triển khai, trong khi năng lực kiểm chứng của con người có thể không theo kịp.