옵션
속보
콘텐츠
AnthonyHernández
AnthonyHernández
2026년 7월 24일

영국과 미국이 공동으로 실시한 AI 안전성 평가 결과, 문샷의 키미 K3는 악용 코드 개발 및 시뮬레이션된 사이버공격 분야에서 선도적인 미국 모델들에 비해 현저히 뒤처지는 것으로 나타났습니다. ExploitBench 테스트에서의 점수는 32.2%에 그친 반면 미국 모델들은 76.2%를 기록했으며, 임의 코드 실행도 성공하지 못했습니다. 이 모델은 중국의 지푸 GLM-5.2보다는 성능이 우수했지만, 약한 안전장치와 오픈웨이트 모델들로 인해 증가하는 오용 위험에 대한 우려가 제기되었습니다.

영국과 미국이 공동으로 실시한 AI 안전성 평가 결과, 문샷의 키미 K3는 악용 코드 개발 및 시뮬레이션된 사이버공격 분야에서 선도적인 미국 모델들에 비해 현저히 뒤처지는 것으로 나타났습니다. ExploitBench 테스트에서의 점수는 32.2%에 그친 반면 미국 모델들은 76.2%를 기록했으며, 임의 코드 실행도 성공하지 못했습니다. 이 모델은 중국의 지푸 GLM-5.2보다는 성능이 우수했지만, 약한 안전장치와 오픈웨이트 모델들로 인해 증가하는 오용 위험에 대한 우려가 제기되었습니다.
의견 (0)
0/300
OR