Bộ Thương mại Mỹ đánh giá Kimi K3, cho rằng Mỹ vẫn dẫn đầu, nhưng báo cáo chỉ ra rằng bài kiểm tra không hoàn toàn tương đương
Odaily dẫn tin, Trung tâm Đổi mới và Tiêu chuẩn AI trực thuộc Bộ Thương mại Mỹ, phối hợp với Viện An toàn AI Vương quốc Anh, đã tiến hành kiểm tra khả năng tấn công mạng của Kimi K3 và nhấn mạnh rằng "Mỹ vẫn đang dẫn đầu".
Tuy nhiên, bài đánh giá này gây tranh cãi về giá trị tham khảo do phạm vi kiểm tra bị hạn chế. Vì giới hạn của môi trường lưu trữ, Kimi K3 chỉ tham gia một phần bài kiểm tra, và khả năng mạng tổng thể của nó chủ yếu được ước tính dựa trên 41 tiêu chuẩn khai thác lỗ hổng, trong khi các mô hình khác đã trải qua bài kiểm tra toàn diện hơn, do đó kết quả của Kimi K3 có biên độ sai số lớn hơn.
Trong bài kiểm tra khai thác lỗ hổng, Kimi K3 đạt khoảng 32%, cao hơn mức 24% của GLM-5.2, nhưng thấp hơn mức trung bình khoảng 76% của các mô hình dẫn đầu tại Mỹ. Trong bài kiểm tra chuỗi tấn công mô phỏng, Kimi K3 trung bình hoàn thành 17 bước trong chuỗi tấn công 32 bước và đột nhập thành công mạng 1 lần trong 10 lần thử, trong khi các mô hình tiên tiến của Mỹ trung bình hoàn thành 28,5 bước.
Báo cáo chỉ ra rằng Kimi K3 đã có khả năng tấn công tự động nhất định, và các biện pháp bảo vệ của nó không ngăn cản mô hình phát triển lỗ hổng hoặc thực hiện tấn công. Tuy nhiên, báo cáo cũng nhấn mạnh phạm vi kiểm tra có hạn.
