Svmuu 소식: 미국 상무부 산하 AI 표준 및 혁신 센터가 영국 AI 보안 연구소와 공동으로 Kimi K3의 사이버 공격 능력을 테스트했으며, “미국이 여전히 선두를 달리고 있다”고 강조했다.
다만, 이번 평가의 경우 테스트 범위가 제한적이어서 참고 가치에 대한 논란이 있다. 호스팅 환경의 제약으로 인해 Kimi K3는 일부 테스트에만 참여했으며, 전체 네트워크 능력 평가는 주로 41개의 취약점 악용 벤치마크를 기반으로 한 반면, 다른 모델들은 보다 포괄적인 테스트를 거쳤기 때문에 Kimi K3의 결과에는 더 큰 오차 범위가 존재한다.
취약점 악용 테스트에서 Kimi K3의 점수는 약 32%로, GLM-5.2의 24%보다는 높았으나 미국 선도 모델의 평균 수준인 약 76%보다는 낮았다. 모의 공격 체인 테스트에서 Kimi K3는 평균 32단계의 공격 체인 중 17단계를 완료했으며, 10회의 시도 중 1회 네트워크 침투에 성공한 반면, 미국의 선도적인 모델은 평균 28.5단계를 완료했다.
보고서는 Kimi K3가 이미 일정한 자율 공격 능력을 갖추고 있으며, 보안 장치가 모델의 취약점 개발이나 공격 실행을 차단하지 못했다고 지적했다. 다만, 보고서는 테스트 범위가 제한적이라는 점도 강조했다.