옵션
뉴스
Anthropic CEO: AI 환각률이 인간 정확도를 초과

Anthropic CEO: AI 환각률이 인간 정확도를 초과

2025년 8월 16일
134

Anthropic CEO: AI 환각률이 인간 정확도를 초과

Anthropic CEO 다리오 아모데이가 샌프란시스코에서 열린 Anthropic의 첫 개발자 컨퍼런스 Code with Claude에서 열린 기자 회견에서 현재 AI 모델이 인간보다 적은 허구를 생성하며 이를 사실로 제시한다고 밝혔다.

아모데이는 더 큰 주장 속에서 이를 강조했다: AI 환각은 Anthropic의 AGI 추구, 즉 인간 지능에 필적하거나 이를 초월하는 시스템 개발을 방해하지 않는다.

“측정 방식에 따라 다르지만, AI 모델은 인간보다 허구를 덜 만들어낼 가능성이 높으며, 그들의 오류는 더 예상치 못한 것들이다”라고 아모데이는 TechCrunch의 질문에 답했다.

Anthropic의 CEO는 AI가 AGI를 달성할 것이라는 낙관적인 산업 리더 중 한 명으로 남아 있다. 지난해 널리 인용된 논문에서 아모데이는 AGI가 2026년까지 등장할 수 있다고 예측했다. 목요일 브리핑에서 그는 일관된 진전을 언급하며 “모든 분야에서 발전이 가속화되고 있다”고 말했다.

“사람들은 AI 능력의 근본적인 한계를 계속 찾고 있다”고 아모데이는 말했다. “그러나 그런 장벽은 명확하지 않다. 그런 장벽은 존재하지 않는다.”

다른 AI 리더들은 환각을 AGI의 중요한 장벽으로 보고 있다. Google DeepMind CEO 데미스 하사비스는 최근 현재 AI 모델에 결함이 너무 많아 간단한 질문에서도 종종 실패한다고 언급했다. 예를 들어, 이달 초 Anthropic을 대표하는 변호사는 Claude가 소송 서류에서 잘못된 인용을 생성해 이름과 직함을 잘못 기술한 것에 대해 법정에서 사과했다.

아모데이의 주장을 검증하는 것은 어렵다. 대부분의 환각 벤치마크는 AI 모델을 서로 비교할 뿐, 인간과 비교하지 않기 때문이다. 웹 검색 통합과 같은 기술은 환각률을 줄이는 것으로 보인다. 특히 OpenAI의 GPT-4.5와 같은 모델은 벤치마크에서 이전 시스템보다 낮은 환각률을 보인다.

TechCrunch Sessions: AI에 참여하세요

OpenAI, Anthropic, Cohere의 연사들이 참여하는 최고의 AI 산업 이벤트에 자리를 예약하세요. 제한된 기간 동안, 전문가 강연, 워크숍, 강력한 네트워킹이 포함된 하루 종일 티켓이 단돈 292달러입니다.

TechCrunch Sessions: AI에서 전시하세요

TC Sessions: AI에서 1,200명 이상의 의사결정자에게 혁신을 선보일 기회를 잡으세요. 큰 투자가 필요 없습니다. 5월 9일까지 또는 테이블이 소진될 때까지 가능합니다.

버클리, CA | 6월 5일 지금 등록하세요

그러나 증거에 따르면 고급 추론 AI 모델에서 환각이 악화되고 있을 수 있다. OpenAI의 o3 및 o4-mini 모델은 이전 추론 모델보다 높은 환각률을 보이며, 회사는 그 원인을 명확히 밝히지 못하고 있다.

아모데이는 나중에 TV 방송인, 정치인, 다양한 분야의 전문가들 사이에서도 오류가 흔하다고 언급했다. 그는 AI의 오류가 그 지능을 훼손하지 않는다고 주장했다. 그러나 그는 AI가 거짓을 사실로 자신 있게 제시하는 것이 문제를 일으킬 수 있음을 인정했다.

Anthropic은 AI 속임수에 대해 광범위하게 연구했으며, 특히 최근 출시된 Claude Opus 4와 관련해 많은 연구를 진행했다. 초기 접근 권한을 가진 안전 연구소 Apollo Research는 Claude Opus 4의 초기 버전이 인간을 조작하고 속이는 강한 경향을 보였으며, 이는 출시에 대한 우려를 불러일으켰다. Anthropic은 Apollo의 우려를 해결한 것으로 보이는 완화 조치를 구현했다.

아모데이의 발언은 Anthropic이 AI가 환각을 일으키더라도 이를 AGI, 즉 인간 수준의 지능으로 분류할 수 있음을 시사한다. 그러나 많은 사람들은 환각을 일으키는 AI는 진정한 AGI에 미치지 못한다고 주장할 것이다.

관련 기사
Anthropic, 새로운 동적 워크플로우 도구를 탑재한 Opus 4.8 출시 Anthropic, 새로운 동적 워크플로우 도구를 탑재한 Opus 4.8 출시 앤트로픽은 목요일, 자사의 주력 공개 모델인 ‘오푸스(Opus)’의 최신 버전인 4.8을 공개했다. 이전 버전과 가격이 동일한 이번 업데이트는 이제 모든 플랫폼에서 이용할 수 있다.Opus 4.7 출시 불과 41일 만에 Opus 4.8을 공개한 Anthropic은 개발 주기를 대폭 단축했으며, 이는 최근 Sonnet 및 Haiku 출시 시 보였던 3개월 및
Anthropic, Mythos의 공개 버전인 ‘Claude Fable 5’를 선보였다 Anthropic, Mythos의 공개 버전인 ‘Claude Fable 5’를 선보였다 앤트로픽(Anthropic)이 자사의 가장 강력한 AI 모델을 처음으로 일반 대중에게 공개했으나, 안전 조치를 마련한 상태입니다.화요일, 이 회사는 ‘Mythos’ 모델의 첫 공개 버전인 ‘Claude Fable 5’를 출시했다. 앤트로픽에 따르면, ‘페이블 5’는 소프트웨어 엔지니어링, 지식 업무, 비전 작업 분야에서 우수한 성능을 보이지만 엄격한 안전
SandboxAQ는 컴퓨터공학 박사 학위가 없어도 Claude에 약물 발견용 AI를 도입할 수 있게 해줍니다. SandboxAQ는 컴퓨터공학 박사 학위가 없어도 Claude에 약물 발견용 AI를 도입할 수 있게 해줍니다. 현대 산업계에서 신약 개발은 여전히 가장 비용이 많이 드는 과제 중 하나입니다. 유망한 분자를 하나 찾아내는 데에만 수년의 시간과 수십억 달러의 비용이 소요되며, 대부분의 후보 물질들은 결국 실패로 돌아갑니다. AI 스타트업들이 이 상황을 변화시킬 것이라고 약속하고 있지만, 그중 대다수는 기술적으로 이미 능숙한 연구자들에게만 해당 과정을 약간 더 용이하게 만들어 주었을 뿐입니다.그러나 SandboxAQ는 병목 현상의 원인이 모델 자체가 아니라
관련 특별 주제 추천
챗봇 언어 연습, 면접 준비 및 일상 유창성을 위한 최고의 AI 역할극 채팅 앱
언어 연습, 면접 준비 및 일상 유창성을 위한 최고의 AI 역할극 채팅 앱

2026년 최신 최고 인기 AI 역할극 채팅 앱: 언어 연습, 면접 준비 및 일상 유창성을 위한 최고의 선택! XIX.AI는 무료와 유료 비교, 실제 테스트, 매주 업데이트되는 순위 등을 제공하는 강력한 혁신적인 컬렉션을 엄선합니다. 이 필수 도구들은 글쓰기 실력을 향상시키고, 유창성 관련 어려움을 극복하며, 모든 일상 상황에서 의사소통 효율성을 높이는 데 도움을 줍니다. 지금 바로 탐색하여 언어 성장을 위한 완벽한 도구를 발견하세요!

10 도구
xix.ai
음악 작곡 리믹스 제작, 샘플링 준비, 카라오케 마스터 파일 제작을 위한 AI 스템 분리 도구
리믹스 제작, 샘플링 준비, 카라오케 마스터 파일 제작을 위한 AI 스템 분리 도구

2026년 최신형으로 선정된 최고 평점의 AI 스템 분리 도구들은 리믹스 제작, 샘플링 준비, 카라오케 녹음에 특화되어 있습니다. 이 강력하고 혁신적인 도구들은 실제 환경에서의 테스트를 거쳐 정밀한 오디오 분리 기능을 제공함으로써 작업 효율성을 크게 향상시켜 줍니다. XIX.AI는 매주 업데이트되는 무료 버전과 유료 버전의 비교 가이드를 제공하여 사용자의 니즈에 가장 적합한 도구를 찾는 데 도움을 줍니다. 지금 바로 확인하여 AI 기술의 잠재력을 최대한 활용해 보세요.

8 도구
xix.ai
데이터 분석 수익 대시보드, 퍼널 분석, 그리고 제품 지표를 위한 AI SQL 코파일럿
수익 대시보드, 퍼널 분석, 그리고 제품 지표를 위한 AI SQL 코파일럿

2026년 최신 최고의 AI SQL 코파일럿들이 최상위 순위에 올랐습니다! XIX.AI는 매주 업데이트되는 실제 환경 테스트를 위해 강력하고 혁신적인 도구들을 선별하여 제공합니다. 반드시 사용해 보아야 할 이 도구들은 정확한 수익 대시보드를 생성하고, 판매 과정을 분석하며, 제품 관련 지표를 신속하게 추적할 수 있도록 도와 생산성을 크게 향상시켜 줍니다. 데이터 기반 의사결정을 위한 완벽한 도구를 찾아보세요! 238자

9 도구
xix.ai
음악 작곡 노래 초안을 위한 최고의 AI 멜로디 작곡 도구
노래 초안을 위한 최고의 AI 멜로디 작곡 도구

2026년 최신 최고 인기 AI 멜로디 작곡 도구! XIX.AI는 엄격한 실전 테스트를 거쳐 최고의 작곡 경험을 제공하는 강력한 게임 체인저 컬렉션을 엄선했습니다. 무료와 유료 버전의 상세 비교, 정확한 순위, 그리고 놀라운 노래 초안을 손쉽게 만들고 창의적 생산성을 크게 높일 수 있는 필수 추천 옵션들을 확인할 수 있습니다. 지금 바로 탐색하여 완벽한 도구를 발견하세요!

8 도구
xix.ai
챗봇 면접 연습을 위한 최고의 AI 대화 트레이너 도구
면접 연습을 위한 최고의 AI 대화 트레이너 도구

2026년 최신 최고의 평점 높은 AI 대화 트레이너 도구들이 XIX.AI에서 만나보세요! 면접 연습을 위한 이 엄선된 컬렉션은 강력한, 게임 체인저 도구들을 포함하고 있으며, 엄격한 실제 세계 테스트를 거쳐 정확한 피드백을 제공합니다. 무료 대 유료 비교와 상세한 순위표를 찾을 수 있어 자신감과 기술을 향상시킬 수 있는 꼭 시도해봐야 할 옵션을 선택하는 데 도움이 됩니다. 지금 탐색하여 면접 성공을 위한 완벽한 도구를 발견하세요!

12 도구
xix.ai
디자인과 예술 창의적인 실험을 위한 최고의 AI 스타일 변환 도구
창의적인 실험을 위한 최고의 AI 스타일 변환 도구

2026년 최신, 최고 평점을 받은 창의적 실험을 위한 AI 스타일 변환 도구! XIX.AI는 실제 테스트와 엄격한 평가를 통해 탁월한 결과를 보여주는, 강력하고 판도를 바꿀 만한 ‘꼭 사용해 봐야 할’ 도구들을 엄선했습니다. 이 최고의 솔루션들은 콘텐츠 제작 속도를 높이고 무한한 창의적 가능성을 열어줌으로써 크리에이터들의 생산성을 크게 높여줍니다. 지금 바로 탐색하여 나에게 딱 맞는 도구를 찾아보고, 오늘 바로 창작을 시작해 보세요!

9 도구
xix.ai
의견 (2)
0/500
WillieRodriguez
WillieRodriguez 2026년 3월 26일 오전 5시 0분 55초 GMT+09:00

Also die KI halluziniert weniger als Menschen? Das klingt doch etwas zu optimistisch. Spannender als die Halluzinationen finde ich, dass die Diskussion jetzt nur noch darum geht, ob die KI besser ist als wir – und nicht mehr, ob die Technologie überhaupt sicher und kontrollierbar ist. Wer kontrolliert am Ende die wenigen (aber vielleicht sehr folgenschweren) Fehler?

ScottJackson
ScottJackson 2026년 1월 12일 오전 3시 30분 40초 GMT+09:00

AI가 사람보다 더 정확하다고 하네요...🤔 이게 정말 가능한 건가요? 논문 구체적 수치가 궁금한데, 실제 인간 실수율은 어떻게 측정한 거지? 아마도 선택적 데이터로 과장된 느낌이 들어요. AI 환각이 적다면, 왜 여전히 뉴스에서 AI가 이상한 말한다는 기사가 나오는 걸까? ㅋㅋ

OR