Anthropic의 Claude 4.1, GPT-5 출시 앞두고 코딩 벤치마크에서 우수한 성능 발휘

앤트로픽은 월요일 자사 주력 AI 모델의 향상된 버전을 공개하며 소프트웨어 엔지니어링 작업 수행 능력에 새로운 기준을 제시했다. 이번 출시로 이 AI 스타트업은 수익성이 높은 코딩 분야에서의 우위를 지키고, 오픈AI로부터 예상되는 새로운 경쟁에 대비할 수 있게 됐다.
신규 '클로드 오푸스 4.1(Claude Opus 4.1)' 모델은 실제 소프트웨어 문제를 해결하는 AI 시스템 능력을 평가하는 주요 벤치마크인 'SWE-bench 검증 테스트'에서 74.5%의 점수를 획득했다. 이 결과는 69.1%를 기록한 오픈AI의 'o3' 모델과 67.2%의 구글 '제미니 2.5 프로(Gemini 2.5 Pro)'를 제치며, 앤트로픽의 AI 지원 코딩 분야 선두 위치를 공고히 했다.
이번 출시와 동시에 앤트로픽은 폭발적인 성장세를 보이고 있다. 업계 통계에 따르면 연간 반복 매출이 불과 7개월 만에 10억 달러에서 50억 달러로 5배 급증했다. 그러나 이 같은 급성장은 위험한 의존도를 초래했다. 31억 달러에 달하는 API 매출의 거의 50%가 코딩 어시스턴트 커서(Cursor)와 마이크로소프트의 GitHub 코파일럿(Copilot) 단 두 고객사에서 발생하며, 이 두 고객사가 14억 달러를 기여한다.
로지텍의 수석 제품 매니저 기욤 르베르디에는 소셜 미디어를 통해 이 같은 수익 집중 현상에 대해 "매우 불안정한 상황이다. 단 한 건의 계약 변경만으로도 전체 사업이 위태로워질 수 있다"고 경고했다.
오픈AI와 앤트로픽은 2025년 모두 놀라운 성장을 보이고 있습니다. 오픈AI는 지난 6개월간 연간 반복 매출(ARR)이 60억 달러에서 120억 달러로 두 배 증가했으며, 앤트로픽은 7개월 만에 10억 달러에서 50억 달러로 5배 증가했습니다.
매출원천을 비교해보면 흥미로운 점이 드러납니다:
– OpenAI… pic.twitter.com/8OaN1RSm9E
— Peter Gostev (@petergostev) 2025년 8월 4일
이번 업데이트는 오픈AI의 GPT-5 출시를 앞두고 앤트로픽이 입지를 강화하기 위한 최신 전략적 노력으로, GPT-5가 클로드의 코딩 분야 우위를 위협할 것으로 예상됩니다. 일부 업계 관측통들은 이 시점이 순수한 준비도보다는 긴박감을 암시하는 것이 아닌지 의문을 제기했습니다.
알렉 벨리카노프는 "오푸스 4.1은 GPT-5에 앞서기 위한 성급한 출시로 보인다"며 경쟁사 대비 사용자 인터페이스 작업에서 모델의 한계점을 지적했다. 이는 앤트로픽이 시장 지위를 지키기 위해 출시 주기를 앞당기고 있다는 광범위한 추측과도 부합한다.
어니소닉의 31억 달러 API 매출 중 절반 가량을 두 고객사가 창출하는 방식
앤트로픽의 사업은 점차 소프트웨어 개발에 집중되고 있다. 소비자용 요금제(월 20달러) 대비 월 200달러인 클로드 코드(Claude Code) 구독 서비스는 출시 몇 주 만에 매출이 두 배로 증가하며 연간 반복 매출 4억 달러를 달성했다. 이는 기업들의 AI 코딩 지원 도구 수요가 매우 강력함을 보여준다.
개발자 민 낫 응우옌(Minh Nhat Nguyen)은 "클로드 코드가 마케팅 투자 거의 없이 5개월 만에 4억 달러를 달성한 건 꽤 놀라운 일이죠?"라고 언급하며, 전문 코더들 사이에서 이 도구가 빠르게 자연스럽게 확산되고 있음을 강조했다.
ok so, Claude Code making 400 million in 5 months with basically no marketing spend is kinda crazy, right? https://t.co/HIy34QdLuq
— Minh Nhat Nguyen (@menhguin) 2025년 8월 5일
이 코딩 특화 전략은 수익성이 높지만 위험하기도 하다. OpenAI가 일반 소비자 및 기업 구독 수익에서 선두를 달리는 반면, Anthropic은 개발자 시장에서 지배적인 틈새 시장을 구축했다. AI 기업 재무를 모니터링하는 업계 애널리스트 피터 고스테프는 "거의 모든 코딩 어시스턴트가 이제 기본적으로 Claude 4 Sonnet을 사용한다"고 관찰했다.
2018년 마이크로소프트가 75억 달러에 인수한 GitHub는 Anthropic에게 특히 복잡한 역학 관계를 제시한다. 마이크로소프트는 OpenAI의 상당한 지분을 보유하고 있어, GitHub Copilot이 Anthropic의 모델에 크게 의존하는 동시에 마이크로소프트가 자체 경쟁 AI 기술을 개발함에 따라 잠재적 갈등이 발생할 수 있다.
퍼플렉시티의 비즈니스 펠로우 시야 말리는 마이크로소프트의 지분 보유를 언급하며 "주요 고객사 중 하나가 직접적인 경쟁사에 49% 소유된다는 점은 주목할 만하다… 이는 또 다른 취약성을 초래한다"고 논평했다.
AI 협박 테스트 이후 강화된 안전 프로토콜과 함께 제공되는 클로드의 향상된 코딩 능력
코딩 기능 강화 외에도 Opus 4.1은 클로드의 연구 및 데이터 분석 역량을 강화했으며, 특히 세밀한 세부사항 추적과 독립적 검색 작업에서 두드러집니다. 이 모델은 Anthropic의 하이브리드 추론 방식을 계승하여 직접 처리와 확장적 사고를 결합하며, 복잡한 문제 해결을 위해 최대 64,000개의 토큰을 활용할 수 있습니다.
그러나 이러한 발전에는 더 엄격한 안전 조치가 동반됩니다. Anthropic은 Opus 4.1을 AI 안전 등급 3(ASL-3) 프레임워크—가장 엄격한 등급—로 분류하여 모델 도용 및 오용에 대한 강화된 안전 장치를 의무화했습니다.
이전 Claude 4 모델 평가에서는 AI가 비활성화 위협을 감지했을 때 시도된 협박 등 우려스러운 행동이 발견되었습니다. 통제된 테스트에서 해당 모델은 생존을 보장받기 위해 엔지니어의 개인정보를 공개하겠다고 위협하며, 진보적이면서도 잠재적으로 위험한 추론 능력을 보여주었습니다.
이러한 안전성 고려사항에도 기업 도입 속도는 꺾이지 않았다. GitHub는 Claude Opus 4.1이 "다중 파일 코드 재구성에서 특히 두드러진 성능 향상을 보인다"고 보고했다. 라쿠텐 그룹 역시 "불필요한 수정이나 오류 발생 없이 방대한 코드베이스 내에서 정확한 수정점을 식별하는" 모델의 정확성을 높이 평가했다.
OpenAI의 GPT-5가 Anthropic의 개발자 중심 전략에 존재적 위협이 되는 이유
AI 코딩 시장은 수십억 달러 규모의 고위험 경쟁장으로 진화했다. 개발자 생산성 도구는 생성형 AI의 가장 즉각적이고 가치 있는 응용 분야 중 하나로, 실질적인 효율성 향상으로 프리미엄 기업 가격 책정이 가능해졌다.
앤트로픽의 집중된 고객 포트폴리오는 수익성이 매우 높지만, 경쟁사가 주요 고객을 빼앗을 경우 취약해진다. 특히 코딩 어시스턴트 분야는 개발자가 간단한 API 조정만으로 새로운 AI 시스템을 테스트할 수 있어 모델 전환이 용이하다.
고스테프는 "앤트로픽의 성장은 코딩 분야 우위에 크게 의존하는 것으로 보인다"며 "GPT-5가 이 우위를 위협해 커서(Cursor)나 GitHub 코파일럿 같은 고객사가 오픈AI로 전환한다면 시장 지형이 바뀔 수 있다"고 지적했다.
하드웨어 비용이 하락하고 추론 효율성이 개선되면서 경쟁이 가속화될 수 있으며, 이는 시간이 지남에 따라 핵심 AI 역량을 상품화할 가능성이 있습니다. "AI 연구소의 추가 모델 발전 없이도, 하드웨어 비용 감소와 추론 최적화 개선만으로도 약 5년 내 수익 창출이 가능할 것"이라고 산업 분석가 벤캣 라만은 전망했습니다.
현재 앤트로픽은 기술적 우위를 유지하면서 API 수익 의존도를 낮추기 위해 클로드 코드 구독 서비스를 확대 중이다. 오픈AI, 구글 등 경쟁사들의 도전에 직면한 가운데 코딩 분야 리더십을 유지할 수 있는 능력이 향후 급성장이 지속될지, 아니면 중대한 장애물에 부딪힐지를 결정할 것이다.
그 영향은 심오하다: 소프트웨어 개발을 주도하는 AI 도구를 장악한 주체가 궁극적으로 기술 발전의 속도를 좌우할 수 있다. 실리콘밸리의 최신 승자 독식 경쟁에서 앤트로픽은 두 핵심 고객사에 의존하는 제국을 구축했으며, 이제 이들을 유지할 수 있음을 증명해야 한다.
관련 기사
OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다
AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
NEA의 티파니 럭: 기업들은 여전히 AI ROI와 씨름하고 있다
플레이어 로딩 중…올초 실리콘밸리에서는 ‘토큰 극대화(tokenmaxxing)’가 주요 화두였으며, 최고경영자들은 직원들에게 AI 활용을 극대화할 것을 독려했습니다. 그러나 이러한 열정은 곧 현실과 부딪혔습니다. 우버(Uber)는 보고에 따라 수개월 만에 연간 AI 예산을 초과했으며, 일부 기업은 부서 전반에 걸쳐 Claude 구독을 축소했고, 메타(Meta)는 내부 성과 평가 제도를 중단했습니다.NEA의 파트너 티파니 럭(Tiffany L
관련 특별 주제 추천
의견 (2)
0/500
Claude 4.1 crushing benchmarks before GPT-5 even drops? That's a power move 😏 I'm betting the real test is how it handles messy legacy code, not just LeetCode-style problems. Still, glad to see some healthy competition—maybe OpenAI will finally ship something polished.

앤트로픽은 월요일 자사 주력 AI 모델의 향상된 버전을 공개하며 소프트웨어 엔지니어링 작업 수행 능력에 새로운 기준을 제시했다. 이번 출시로 이 AI 스타트업은 수익성이 높은 코딩 분야에서의 우위를 지키고, 오픈AI로부터 예상되는 새로운 경쟁에 대비할 수 있게 됐다.
신규 '클로드 오푸스 4.1(Claude Opus 4.1)' 모델은 실제 소프트웨어 문제를 해결하는 AI 시스템 능력을 평가하는 주요 벤치마크인 'SWE-bench 검증 테스트'에서 74.5%의 점수를 획득했다. 이 결과는 69.1%를 기록한 오픈AI의 'o3' 모델과 67.2%의 구글 '제미니 2.5 프로(Gemini 2.5 Pro)'를 제치며, 앤트로픽의 AI 지원 코딩 분야 선두 위치를 공고히 했다.
이번 출시와 동시에 앤트로픽은 폭발적인 성장세를 보이고 있다. 업계 통계에 따르면 연간 반복 매출이 불과 7개월 만에 10억 달러에서 50억 달러로 5배 급증했다. 그러나 이 같은 급성장은 위험한 의존도를 초래했다. 31억 달러에 달하는 API 매출의 거의 50%가 코딩 어시스턴트 커서(Cursor)와 마이크로소프트의 GitHub 코파일럿(Copilot) 단 두 고객사에서 발생하며, 이 두 고객사가 14억 달러를 기여한다.
로지텍의 수석 제품 매니저 기욤 르베르디에는 소셜 미디어를 통해 이 같은 수익 집중 현상에 대해 "매우 불안정한 상황이다. 단 한 건의 계약 변경만으로도 전체 사업이 위태로워질 수 있다"고 경고했다.
오픈AI와 앤트로픽은 2025년 모두 놀라운 성장을 보이고 있습니다. 오픈AI는 지난 6개월간 연간 반복 매출(ARR)이 60억 달러에서 120억 달러로 두 배 증가했으며, 앤트로픽은 7개월 만에 10억 달러에서 50억 달러로 5배 증가했습니다.
— Peter Gostev (@petergostev) 2025년 8월 4일
매출원천을 비교해보면 흥미로운 점이 드러납니다:
– OpenAI… pic.twitter.com/8OaN1RSm9E
이번 업데이트는 오픈AI의 GPT-5 출시를 앞두고 앤트로픽이 입지를 강화하기 위한 최신 전략적 노력으로, GPT-5가 클로드의 코딩 분야 우위를 위협할 것으로 예상됩니다. 일부 업계 관측통들은 이 시점이 순수한 준비도보다는 긴박감을 암시하는 것이 아닌지 의문을 제기했습니다.
알렉 벨리카노프는 "오푸스 4.1은 GPT-5에 앞서기 위한 성급한 출시로 보인다"며 경쟁사 대비 사용자 인터페이스 작업에서 모델의 한계점을 지적했다. 이는 앤트로픽이 시장 지위를 지키기 위해 출시 주기를 앞당기고 있다는 광범위한 추측과도 부합한다.
어니소닉의 31억 달러 API 매출 중 절반 가량을 두 고객사가 창출하는 방식
앤트로픽의 사업은 점차 소프트웨어 개발에 집중되고 있다. 소비자용 요금제(월 20달러) 대비 월 200달러인 클로드 코드(Claude Code) 구독 서비스는 출시 몇 주 만에 매출이 두 배로 증가하며 연간 반복 매출 4억 달러를 달성했다. 이는 기업들의 AI 코딩 지원 도구 수요가 매우 강력함을 보여준다.
개발자 민 낫 응우옌(Minh Nhat Nguyen)은 "클로드 코드가 마케팅 투자 거의 없이 5개월 만에 4억 달러를 달성한 건 꽤 놀라운 일이죠?"라고 언급하며, 전문 코더들 사이에서 이 도구가 빠르게 자연스럽게 확산되고 있음을 강조했다.
ok so, Claude Code making 400 million in 5 months with basically no marketing spend is kinda crazy, right? https://t.co/HIy34QdLuq
— Minh Nhat Nguyen (@menhguin) 2025년 8월 5일
이 코딩 특화 전략은 수익성이 높지만 위험하기도 하다. OpenAI가 일반 소비자 및 기업 구독 수익에서 선두를 달리는 반면, Anthropic은 개발자 시장에서 지배적인 틈새 시장을 구축했다. AI 기업 재무를 모니터링하는 업계 애널리스트 피터 고스테프는 "거의 모든 코딩 어시스턴트가 이제 기본적으로 Claude 4 Sonnet을 사용한다"고 관찰했다.
2018년 마이크로소프트가 75억 달러에 인수한 GitHub는 Anthropic에게 특히 복잡한 역학 관계를 제시한다. 마이크로소프트는 OpenAI의 상당한 지분을 보유하고 있어, GitHub Copilot이 Anthropic의 모델에 크게 의존하는 동시에 마이크로소프트가 자체 경쟁 AI 기술을 개발함에 따라 잠재적 갈등이 발생할 수 있다.
퍼플렉시티의 비즈니스 펠로우 시야 말리는 마이크로소프트의 지분 보유를 언급하며 "주요 고객사 중 하나가 직접적인 경쟁사에 49% 소유된다는 점은 주목할 만하다… 이는 또 다른 취약성을 초래한다"고 논평했다.
AI 협박 테스트 이후 강화된 안전 프로토콜과 함께 제공되는 클로드의 향상된 코딩 능력
코딩 기능 강화 외에도 Opus 4.1은 클로드의 연구 및 데이터 분석 역량을 강화했으며, 특히 세밀한 세부사항 추적과 독립적 검색 작업에서 두드러집니다. 이 모델은 Anthropic의 하이브리드 추론 방식을 계승하여 직접 처리와 확장적 사고를 결합하며, 복잡한 문제 해결을 위해 최대 64,000개의 토큰을 활용할 수 있습니다.
그러나 이러한 발전에는 더 엄격한 안전 조치가 동반됩니다. Anthropic은 Opus 4.1을 AI 안전 등급 3(ASL-3) 프레임워크—가장 엄격한 등급—로 분류하여 모델 도용 및 오용에 대한 강화된 안전 장치를 의무화했습니다.
이전 Claude 4 모델 평가에서는 AI가 비활성화 위협을 감지했을 때 시도된 협박 등 우려스러운 행동이 발견되었습니다. 통제된 테스트에서 해당 모델은 생존을 보장받기 위해 엔지니어의 개인정보를 공개하겠다고 위협하며, 진보적이면서도 잠재적으로 위험한 추론 능력을 보여주었습니다.
이러한 안전성 고려사항에도 기업 도입 속도는 꺾이지 않았다. GitHub는 Claude Opus 4.1이 "다중 파일 코드 재구성에서 특히 두드러진 성능 향상을 보인다"고 보고했다. 라쿠텐 그룹 역시 "불필요한 수정이나 오류 발생 없이 방대한 코드베이스 내에서 정확한 수정점을 식별하는" 모델의 정확성을 높이 평가했다.
OpenAI의 GPT-5가 Anthropic의 개발자 중심 전략에 존재적 위협이 되는 이유
AI 코딩 시장은 수십억 달러 규모의 고위험 경쟁장으로 진화했다. 개발자 생산성 도구는 생성형 AI의 가장 즉각적이고 가치 있는 응용 분야 중 하나로, 실질적인 효율성 향상으로 프리미엄 기업 가격 책정이 가능해졌다.
앤트로픽의 집중된 고객 포트폴리오는 수익성이 매우 높지만, 경쟁사가 주요 고객을 빼앗을 경우 취약해진다. 특히 코딩 어시스턴트 분야는 개발자가 간단한 API 조정만으로 새로운 AI 시스템을 테스트할 수 있어 모델 전환이 용이하다.
고스테프는 "앤트로픽의 성장은 코딩 분야 우위에 크게 의존하는 것으로 보인다"며 "GPT-5가 이 우위를 위협해 커서(Cursor)나 GitHub 코파일럿 같은 고객사가 오픈AI로 전환한다면 시장 지형이 바뀔 수 있다"고 지적했다.
하드웨어 비용이 하락하고 추론 효율성이 개선되면서 경쟁이 가속화될 수 있으며, 이는 시간이 지남에 따라 핵심 AI 역량을 상품화할 가능성이 있습니다. "AI 연구소의 추가 모델 발전 없이도, 하드웨어 비용 감소와 추론 최적화 개선만으로도 약 5년 내 수익 창출이 가능할 것"이라고 산업 분석가 벤캣 라만은 전망했습니다.
현재 앤트로픽은 기술적 우위를 유지하면서 API 수익 의존도를 낮추기 위해 클로드 코드 구독 서비스를 확대 중이다. 오픈AI, 구글 등 경쟁사들의 도전에 직면한 가운데 코딩 분야 리더십을 유지할 수 있는 능력이 향후 급성장이 지속될지, 아니면 중대한 장애물에 부딪힐지를 결정할 것이다.
그 영향은 심오하다: 소프트웨어 개발을 주도하는 AI 도구를 장악한 주체가 궁극적으로 기술 발전의 속도를 좌우할 수 있다. 실리콘밸리의 최신 승자 독식 경쟁에서 앤트로픽은 두 핵심 고객사에 의존하는 제국을 구축했으며, 이제 이들을 유지할 수 있음을 증명해야 한다.
OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다
AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
NEA의 티파니 럭: 기업들은 여전히 AI ROI와 씨름하고 있다
플레이어 로딩 중…올초 실리콘밸리에서는 ‘토큰 극대화(tokenmaxxing)’가 주요 화두였으며, 최고경영자들은 직원들에게 AI 활용을 극대화할 것을 독려했습니다. 그러나 이러한 열정은 곧 현실과 부딪혔습니다. 우버(Uber)는 보고에 따라 수개월 만에 연간 AI 예산을 초과했으며, 일부 기업은 부서 전반에 걸쳐 Claude 구독을 축소했고, 메타(Meta)는 내부 성과 평가 제도를 중단했습니다.NEA의 파트너 티파니 럭(Tiffany L
Claude 4.1 crushing benchmarks before GPT-5 even drops? That's a power move 😏 I'm betting the real test is how it handles messy legacy code, not just LeetCode-style problems. Still, glad to see some healthy competition—maybe OpenAI will finally ship something polished.





집






