옵션
집
속보
콘텐츠
MichaelMartinez
MichaelMartinez
2026년 6월 4일

2시간 동안 진행된 1,500달러 규모의 사이버보안 테스트에서는 주요 대형 언어 모델들이 Firebase 자격 증명 정보가 노출된 해킹된 안드로이드 앱을 상대로 경쟁을 벌였습니다. 아직 공개되지 않은 GPT-5.5는 70%의 성공률로 최고 성적을 거두었지만, 테스트 비용은 번당 9.46달러에 달했습니다. 반면 오픈소스인 DeepSeek V4Pro는 번당 0.62달러의 비용으로 30%의 성공률을 기록하며 자동화된 보안 감사에 있어 매우 높은 비용 효율성을 보여주었습니다. 구글 제미니는 모든 테스트 과제를 거부했으며, 클로드 모델들은 지나치게 엄격한 보안 조치로 인해 단 두 번만 성공을 거두었습니다.

2시간 동안 진행된 1,500달러 규모의 사이버보안 테스트에서는 주요 대형 언어 모델들이 Firebase 자격 증명 정보가 노출된 해킹된 안드로이드 앱을 상대로 경쟁을 벌였습니다. 아직 공개되지 않은 GPT-5.5는 70%의 성공률로 최고 성적을 거두었지만, 테스트 비용은 번당 9.46달러에 달했습니다. 반면 오픈소스인 DeepSeek V4Pro는 번당 0.62달러의 비용으로 30%의 성공률을 기록하며 자동화된 보안 감사에 있어 매우 높은 비용 효율성을 보여주었습니다. 구글 제미니는 모든 테스트 과제를 거부했으며, 클로드 모델들은 지나치게 엄격한 보안 조치로 인해 단 두 번만 성공을 거두었습니다.
의견 (0)
0/300
OR