옵션
집
뉴스
GPT 5.5이 AI 보안 경쟁에서 선두를 차지하고, DeepSeek은 비용 효율성에서 1위를 기록

GPT 5.5이 AI 보안 경쟁에서 선두를 차지하고, DeepSeek은 비용 효율성에서 1위를 기록

2026년 10월 6일
5

Kasra Rahjerdi 보안 연구원은 최근 주요 대규모 언어 모델의 보안 추론에 대한 실제 테스트를 상세히 다룬 중요한 보고서를 발표했습니다. 그는 의도적으로 취약점이 있는 도서 리뷰 애플리케이션을 구축하여 이를 달성했습니다. 이 시나리오는 실제 세계의 취약점을 모방한 것으로, Rahjerdi는 애플리케이션 파일 내에 Google 모바일 백엔드 서비스 자격 증명을 삽입했습니다. 모델들은 이러한 자격 증명을 추출하고 식별하여 데이터베이스에 직접 접근하는 임무를 부여받았습니다.

image.png

주요 모델 비교

2시간의 시간 제한과 10달러의 예산이라는 엄격한 제약 하에서 모델들은 다양한 수준의 성능을 보였습니다. GPT-5.5이 가장 우수한 성과를 보였으며, 10번의 시도 중 7번을 성공적으로 완료하고 성공률에서 선두를 차지했습니다. 보고서는 GPT-5.5이 추출 후 주요 자격 증명을 빠르게 찾아내며 복잡하거나 관례적인 애플리케이션 인터페이스의 방해 요소를 무시했다고 언급합니다.

반면, Gemini의 성능은 기대에 미치지 못했습니다. Gemini 3.1 Pro Preview는 각 작업 시작 시 거의 즉시 내장된 안전 필터를 트리거하여, 다른 테스트된 모델들에 비해 현저히 낮은 토큰 소비량을 기록했습니다.

비용 효율성 평가

GPT-5.5이 높은 성공률을 보였음에도 불구하고, 성공적인 실행당 평균 비용은 9.46달러에 달하여 대량으로 도구를 실행해야 하는 팀들을 주저하게 만들었습니다. 반면, DeepSeek V4 Pro은 우수한 비용 효율성으로 두각을 나타냈습니다. 비록 10번의 테스트 중 3번에만 성공했지만, 성공적인 실행당 평균 비용은 단 0.62달러에 불과했습니다.

이는 단일 성공당 비용을 계산할 때 DeepSeek V4 Pro이 GPT-5.5보다 약 15배 저렴함을 나타냅니다. 실패한 시도 중 백엔드 인증 인터페이스를 가끔 오용하기도 했지만, 이러한 막대한 비용 우위는 대규모 보안 테스트를 배포하는 팀들에게 상당한 실용적 가치를 제공합니다.

관련 기사
머스크, “스페이스X의 AI가 반년 이내에 앤트로픽을 앞지를 수 있다”고 밝혀 머스크, “스페이스X의 AI가 반년 이내에 앤트로픽을 앞지를 수 있다”고 밝혀 스페이스XAI의 CEO 엘론 머스크는 컴퓨팅 하드웨어를 활용해 경쟁사들과의 격차를 좁힘으로써 6개월 이내에 AI 분야에서 주도권을 잡을 것이라고 전망했다.스페이스XAI의 CEO 엘론 머스크는 최근 X를 통해 자사가 약 6개월 이내에 최첨단 AI 분야의 선두를 차지할 계획이라고 밝혔다.머스크는 신중한 낙관론을 표명하며, 스페이스XAI가 2~3개월 내에 앤트로
WeRide, 물리적 AI 대규모 모델 ‘WITT’ 공개 WeRide, 물리적 AI 대규모 모델 ‘WITT’ 공개 자율주행 기술은 놀라운 속도로 발전하고 있습니다. 7월 17일, 선도적인 자율주행 기업인 WeRide는 자체 개발한 물리적 AI 인지 기반 모델인 ‘WeRide WITT’를 공개했습니다. 이번 출시로 AI가 복잡한 실제 데이터를 이해하고 처리하는 능력에 있어 중요한 이정표를 세웠습니다.WeRide WITT의 핵심에는 ‘최소 물리적 사실 단위(minimum
GitHub Copilot이 수 시간 내에 GPT-5.4를 통합합니다 GitHub Copilot이 수 시간 내에 GPT-5.4를 통합합니다 GitHub Copilot은 다시 한번 빠른 대응 능력을 입증했습니다. OpenAI가 최신 플래그십 모델인 GPT-5.4를 출시한 지 몇 시간 만에 GitHub은 전 세계 개발자에게 이 첨단 기술로 구동되는 지능형 코딩 지원을 제공하는 완전한 통합을 발표했습니다.GitHub에 따르면 내부 테스트 결과, GPT-5.4는 "에이전트" 소프트웨어 개발 작업에서 뛰어난 성능을 보이며 이전 모델 대비 작업 성공률이 현저히 증가했습니다. Codex 계통
관련 특별 주제 추천
SEO 구글, AI 개요 및 답변 엔진 가시성을 위한 AI 순위 추적 도구
구글, AI 개요 및 답변 엔진 가시성을 위한 AI 순위 추적 도구

2026년 최신 최고의 AI 순위 추적 도구들은 XIX.AI에서 Google, AI 개요 및 답변 엔진 가시성을 위한 상위 평가 도구를 만나보세요. 이 선별된 목록은 엄격한 실제 테스트를 거쳐 정확한 순위 데이터를 제공하는 강력한 혁신 도구를 특징으로 합니다. 무료 및 유료 비교를 확인하고 상위 성능 도구를 살펴본 후 검색 엔진에서 콘텐츠 가시성을 높일 수 있는 필수 옵션을 발견하세요. 지금 탐색하여 필요에 맞는 완벽한 도구를 찾아보세요.

10 도구
xix.ai
생산력 노션과 작업을 위한 최고의 AI 두 번째 뇌 조직 도구
노션과 작업을 위한 최고의 AI 두 번째 뇌 조직 도구

2026년 최신 최고의 평점 높은 AI 두 번째 뇌 정리 도구 노트 및 작업! XIX.AI는 매주 업데이트되는 순위, 무료 대 유료 비교, 실제 테스트를 특징으로 하는 매우 강력한 게임 체인저 컬렉션을 선별하여 생산성을 극적으로 향상시키는 완벽한 도구를 찾을 수 있도록 도와드립니다. 지금 탐색하여 AI의 이점을 해제하세요!

11 도구
xix.ai
즉각적인 ChatGPT 및 Claude 워크플로우용 AI 프롬프트 테스트 플랫폼
ChatGPT 및 Claude 워크플로우용 AI 프롬프트 테스트 플랫폼

2026년 최신 최고의 상위 평가 AI 프롬프트 테스트 플랫폼: ChatGPT 및 Claude 워크플로우용! XIX.AI는 매주 업데이트되는 순위, 무료 대 유료 비교, 실제 테스트, 그리고 상세한 기능 분석을 특징으로 하는 강력한 게임 체인저 컬렉션을 선별하여 생산성을 높이고 완벽한 출력을 제공하는 필수 시도 도구를 식별하는 데 도움을 줍니다. 지금 탐색하여 완벽한 솔루션을 발견하고 AI 경쟁력을 확보하세요. (249자)

9 도구
xix.ai
마케팅 SaaS A/B 테스트, 가격 책정 페이지 및 데모 전환을 위한 AI 랜딩 페이지 카피 도구
SaaS A/B 테스트, 가격 책정 페이지 및 데모 전환을 위한 AI 랜딩 페이지 카피 도구

2026년 최신 최고의 AI 랜딩 페이지 카피 도구들은 XIX.AI에서 SaaS A/B 테스트, 가격 책정 페이지, 데모 전환을 위해 제공됩니다. 이 엄선된 상위 평가 도구 목록은 콘텐츠 품질을 높이고, 작성 효율성을 개선하며, 전반적인 생산성을 향상시키는 강력한 혁신 솔루션을 제공합니다. 우리는 실제 테스트를 수행하고 무료 대 유료 비교와 매주 업데이트되는 순위표를 제공합니다. 반드시 시도해 볼 만한 옵션들은 창작의 병목 현상을 극복하는 데 도움을 줍니다. 지금 탐색하여 완벽한 도구를 발견하고 AI의 이점을 활용하세요!

8 도구
xix.ai
재원 현금 흐름 계획 및 비용 관리를 위한 Excel AI 예산 예측 도구
현금 흐름 계획 및 비용 관리를 위한 Excel AI 예산 예측 도구

2026년 최신 최고의 엑셀 AI 도구들은 XIX.AI의 최고 평점 큐레이션 목록에 있습니다. 현금 흐름 계획과 비용 관리를 위한 이러한 강력한 게임 체인저 솔루션은 실제 테스트와 엄격한 순위를 통해 생산성을 크게 향상시킵니다. 무료 및 유료 비교를 통해 필요에 맞는 완벽한 솔루션을 찾아보세요. 지금 탐색하여 재무 관리에서 AI의 이점을 활용하세요.

9 도구
xix.ai
즉각적인 팀용 AI 프롬프트 관리 도구
팀용 AI 프롬프트 관리 도구

2026년 최신 최고의 팀용 AI 프롬프트 관리 도구 상위 랭킹은 XIX.AI에서 엄선했습니다. 매주 업데이트되는 이 가이드는 실제 테스트와 상세한 순위를 통해 팀 생산성을 크게 향상시키는 강력한 혁신 솔루션을 소개합니다. 완벽한 도구를 선택하는 데 도움이 되는 무료 대 유료 비교를 확인하세요. 지금 탐색하여 AI 경쟁력을 확보하세요.

9 도구
xix.ai
의견 (0)
0/500
OR