Nghiên cứu: Điểm kiểm tra tấn công mạng của Kimi K3 là 32.2%, thấp hơn các mô hình tiên phong của Mỹ hơn 40 điểm phần trăm
7x24h Tin nhanh
Nghiên cứu: Điểm kiểm tra tấn công mạng của Kimi K3 là 32.2%, thấp hơn các mô hình tiên phong của Mỹ hơn 40 điểm phần trăm
Đánh giá chung của Viện An toàn Trí tuệ Nhân tạo Vương quốc Anh và Trung tâm Tiêu chuẩn và Đổi mới Trí tuệ Nhân tạo Hoa Kỳ cho thấy Kimi K3 của Moonshot AI có thể hỗ trợ thực hiện phát triển khai thác lỗ hổng và mô phỏng tấn công mạng trong điều kiện thiếu sự ngăn chặn thực chất, nhưng khả năng an ninh mạng tổng thể của nó vẫn tụt hậu rõ rệt so với các mô hình hàng đầu của Hoa Kỳ.
Tin từ TechFlow, ngày 24 tháng 7, đánh giá chung của Viện An toàn Trí tuệ Nhân tạo Vương quốc Anh và Trung tâm Tiêu chuẩn và Đổi mới Trí tuệ Nhân tạo Hoa Kỳ cho thấy Kimi K3 của Moonshot AI có thể hỗ trợ thực hiện phát triển khai thác lỗ hổng và mô phỏng tấn công mạng mà không có sự ngăn chặn đáng kể, nhưng khả năng an ninh mạng tổng thể của nó vẫn kém rõ rệt so với các mô hình hàng đầu của Hoa Kỳ.
Trong benchmark khai thác lỗ hổng ExploitBench, tỷ lệ thành công của Kimi K3 là 32,2%, cao hơn GLM-5.2 của Trung Quốc, nhưng thấp hơn nhiều so với 76,2% của các mô hình hàng đầu Hoa Kỳ, và không đạt được cấp độ tấn công cao nhất "thực thi mã tùy ý" trong bất kỳ thử nghiệm nào.
Báo cáo cho rằng các mô hình trọng số mở của Trung Quốc đang tiếp tục tiến bộ trong các nhiệm vụ an ninh mạng, nhưng vẫn còn khoảng cách đáng kể so với các hệ thống của Hoa Kỳ; đồng thời, các kết quả liên quan cũng phù hợp với những tuyên bố bên ngoài rằng Kimi K3 có thể phụ thuộc vào huấn luyện chưng cất, dẫn đến khả năng tấn công nâng cao không đủ.




