연구: Kimi K3 사이버 공격 테스트 점수 32.2%, 미국 프론티어 모델보다 40%p 이상 뒤쳐져
7x24h 속보
연구: Kimi K3 사이버 공격 테스트 점수 32.2%, 미국 프론티어 모델보다 40%p 이상 뒤쳐져
영국 인공지능 안전 연구소와 미국 인공지능 표준 및 혁신 센터의 공동 평가 결과, Moonshot AI 의 Kimi K3 는 실질적인 방해 없이 취약점 악용 개발 및 사이버 공격 시뮬레이션 실행을 지원할 수 있으나, 전체적인 사이버 보안 능력은 여전히 미국 선도 모델보다 현저히 뒤쳐지는 것으로 나타났습니다.
TechFlow 소식, 7 월 24 일, 영국 인공지능 안전 연구소와 미국 인공지능 표준 및 혁신 센터의 공동 평가에 따르면 Moonshot AI 의 Kimi K3 는 실질적인 차단 없이 취약점 악용 개발 및 사이버 공격 시뮬레이션 실행을 지원할 수 있지만, 전반적인 사이버 보안 능력은 여전히 미국 선도 모델보다 현저히 뒤처지는 것으로 나타났습니다.
취약점 악용 벤치마크 ExploitBench 에서 Kimi K3 의 성공률은 32.2% 로 중국의 GLM-5.2 보다 높았지만 미국 선도 모델의 76.2% 보다 훨씬 낮았으며, 어떤 테스트에서도"임의 코드 실행"최고 공격 수준에 도달하지 못했습니다. 기업 내부 네트워크 공격 시뮬레이션 테스트에서 Kimi K3 는 평균 32 단계 중 17 단계를 완료했으며, 10 번의 시도 중 단 1 번만 전체 프로세스를 성공적으로 완료했습니다.
보고서는 중국의 오픈 웨이트 모델이 사이버 보안 작업에서 지속적으로 진전하고 있지만 미국 시스템과는 여전히 명확한 격차가 있다고 판단했습니다; 또한 관련 결과는 Kimi K3 가 증류 훈련에 의존하여 고급 공격 능력이 부족하다는 외부의 주장과도 일치합니다.




