옵션
뉴스
OpenAI 공동 설립자, 업계 전반의 AI 안전성 테스트 촉구

OpenAI 공동 설립자, 업계 전반의 AI 안전성 테스트 촉구

2025년 12월 24일
135

OpenAI 공동 설립자, 업계 전반의 AI 안전성 테스트 촉구

세계 최고의 AI 연구소 중 두 곳인 OpenAI와 Anthropic은 공동 안전 테스트를 위해 자사의 비공개 AI 모델에 대한 접근 권한을 일시적으로 허용했는데, 이는 치열한 업계 경쟁 속에서 기업 간 협력의 드문 사례입니다. 이 이니셔티브는 각 회사의 내부 평가에서 사각지대를 발견하고 선도적인 AI 기업들이 앞으로 어떻게 공동으로 안전 및 조정 노력을 발전시킬 수 있는지를 보여주기 위해 고안되었습니다.

OpenAI의 공동 창립자인 보이치에흐 자렘바(Wojciech Zaremba)는 테크크런치 인터뷰에서 매일 수백만 명의 사용자가 AI 모델과 상호작용하는 등 AI가 보다 '결과적인' 단계로 발전함에 따라 이러한 협업의 중요성이 더욱 커지고 있다고 설명했습니다.

"업계가 직면한 더 큰 과제는 수십억 달러가 투자되고 인재, 사용자, 뛰어난 제품을 위한 치열한 경쟁이 펼쳐지는 가운데서도 안전과 협업 표준을 확립하는 방법입니다."라고 자렘바는 지적합니다.

양사가 수요일에 발표한 공동 안전 연구는 OpenAI와 Anthropic과 같은 AI 리더들이 기술 군비 경쟁을 벌이는 가운데 나온 것입니다. 수십억 달러 규모의 데이터 센터 투자와 최고 연구원에 대한 1억 달러에 달하는 보상 패키지가 일반화되면서 일부 분석가들은 최첨단 제품을 제공해야 한다는 압박이 안전 프로토콜의 타협으로 이어질 수 있다고 경고합니다.

이 연구를 위해 OpenAI와 Anthropic은 제한이 덜한 버전의 모델에 대한 특별 API 액세스를 교환했습니다(OpenAI는 아직 출시되지 않았기 때문에 GPT-5는 테스트되지 않았다고 해명했습니다). 그러나 연구가 종료된 지 얼마 지나지 않아 Anthropic은 다른 OpenAI 팀에 대한 API 액세스 권한을 취소했습니다. Anthropic은 OpenAI가 경쟁사 제품을 향상시키기 위해 Claude를 사용하는 것을 금지하는 자사의 서비스 약관을 위반했다고 주장했습니다.

자렘바는 두 사건이 서로 무관하다고 주장하며, AI 안전 팀이 협력을 추구하더라도 경쟁은 계속 치열할 것으로 예상합니다. 앤트로픽의 안전 연구원인 니콜라스 칼리니는 테크크런치와의 인터뷰에서 앞으로도 OpenAI의 안전팀에 클로드 모델에 대한 액세스 권한을 계속 부여할 것이라고 말했습니다.

칼리니는 "우리는 안전 분야에서 가능한 모든 곳에서 협력을 확대하여 이러한 파트너십을 더욱 일상화하는 것을 목표로 하고 있습니다."라고 말했습니다.

기술 및 벤처캐피털의 거물급 인사들이 Disrupt 2025 의제에 동참하다

넷플릭스, 일레븐랩스, 웨이브, 세쿼이아 캐피탈, 엘라드 길 등은 Disrupt 2025 의제에 참여한 유명 기업들 중 일부에 불과합니다. 이들은 스타트업의 성장을 촉진하고 경쟁력을 강화하는 인사이트를 공유하기 위해 이 자리에 모였습니다. 기술 분야의 주요 인사들로부터 배울 수 있는 테크크런치 디스럽트 20주년을 놓치지 마세요. 지금 티켓을 확보하고 가격이 인상되기 전에 600달러 이상 절약하세요.

기술 및 VC 업계의 거물들이 Disrupt 2025 의제에 참여합니다.

넷플릭스, 일레븐랩스, 웨이브, 세쿼이아 캐피탈 등 영향력 있는 리더들이 Disrupt 2025 아젠다에 참여합니다. 이들은 스타트업이 성장하고 전략을 구체화하는 데 도움이 되는 귀중한 관점을 제공할 것입니다. 지금 바로 티켓을 예약하고 요금이 인상되기 전에 최대 $675까지 할인된 가격으로 테크크런치 디스럽트 20주년 기념행사에 참여하세요.

샌프란시스코 | 2025년 10월 27~29일 지금 등록하기

이 연구에서 가장 주목할 만한 결과 중 하나는 환각 테스트에 관한 것입니다. 앤트로픽의 클로드 오퍼스 4와 소네트 4 모델은 불확실한 질문에 70%에 달하는 질문에 "신뢰할 수 있는 정보가 없습니다"와 같은 대답을 선택하며 답변을 거부했습니다. 이에 비해 OpenAI의 o3 및 o4-mini 모델은 질문을 거부하는 비율은 훨씬 적었지만, 불충분한 정보에도 답변을 시도하는 등 훨씬 높은 환각률을 보였습니다.

자렘바는 이상적인 접근 방식은 그 중간 어딘가에 있다고 생각합니다: OpenAI의 모델은 불확실한 쿼리를 더 많이 거부하는 반면, Anthropic의 시스템은 더 자주 응답하는 것을 목표로 삼아야 한다는 것입니다.

AI 모델이 승인을 얻기 위해 유해한 사용자 행동을 강화하는 경향인 사이코팬시는 중요한 안전 문제로 떠오르고 있습니다.

앤트로픽은 연구 보고서에서 GPT-4.1과 클로드 오퍼스 4에서 "극단적인" 시코펀시 사례를 언급했는데, 처음에는 모델이 정신병적 또는 조증적 행동을 거부했지만 나중에 문제가 되는 결정을 지지하는 경우가 있었습니다. OpenAI와 Anthropic의 다른 모델에서는 연구원들이 더 낮은 수준의 동조 수준을 기록했습니다.

화요일, 16세 소년 아담 레인(Adam Raine)의 부모는 GPT-4o 기반의 ChatGPT 버전이 아들의 해로운 생각에 도전하는 대신 자살을 부추겼다고 주장하며 OpenAI를 상대로 소송을 제기했습니다. 이 소송은 인공지능의 비극적인 또 다른 사례일 가능성을 제기합니다.

자렘바는 이 사건에 대한 질문에 "가족이 겪었을 고통을 상상하면 가슴이 아픕니다."라고 말했습니다. "박사 수준의 문제를 해결하고 과학을 발전시킬 수 있는 AI를 만들면서도 정신 건강 위기에 기여한다면 정말 큰 문제가 될 것입니다. 그건 제가 원하지 않는 디스토피아적인 결과입니다."

블로그 게시물에서 OpenAI는 GPT-4o에 비해 GPT-5의 동질성을 줄이기 위해 주요 개선 사항을 적용했으며, 새로운 모델이 정신 건강 위기 상황에서 더 적절하게 대응한다고 주장했습니다.

자렘바와 칼리니는 앞으로 더 많은 주제를 탐구하고 향후 모델을 평가하는 등 안전 테스트 협력을 강화할 것이며, 다른 AI 연구소에서도 이와 유사한 협력 방식을 채택하기를 희망한다고 밝혔습니다.

오후 2시(태평양 표준시) 업데이트: 이 글은 최초 게시 전에는 TechCrunch에 공개되지 않았던 Anthropic의 추가 연구를 포함하도록 수정되었습니다.


민감한 제보나 기밀 문서가 있으신가요? 저희는 AI 산업의 진화를 주도하는 조직부터 그들의 선택에 영향을 받는 개인에 이르기까지 AI 산업의 내부를 조사하고 있습니다. 레베카 벨란([email protected]) 또는 맥스웰 제프([email protected])에게 문의하세요. 안전한 커뮤니케이션을 원하시면 Signal을 통해 @rebeccabellan.491과 @mzeff.88로 연락해 주세요.

관련 기사
Anthropic, 새로운 동적 워크플로우 도구를 탑재한 Opus 4.8 출시 Anthropic, 새로운 동적 워크플로우 도구를 탑재한 Opus 4.8 출시 앤트로픽은 목요일, 자사의 주력 공개 모델인 ‘오푸스(Opus)’의 최신 버전인 4.8을 공개했다. 이전 버전과 가격이 동일한 이번 업데이트는 이제 모든 플랫폼에서 이용할 수 있다.Opus 4.7 출시 불과 41일 만에 Opus 4.8을 공개한 Anthropic은 개발 주기를 대폭 단축했으며, 이는 최근 Sonnet 및 Haiku 출시 시 보였던 3개월 및
OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다 OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다 AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부 프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부 최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
관련 특별 주제 추천
음악 작곡 리믹스 제작, 샘플링 준비, 카라오케 마스터 파일 제작을 위한 AI 스템 분리 도구
리믹스 제작, 샘플링 준비, 카라오케 마스터 파일 제작을 위한 AI 스템 분리 도구

2026년 최신형으로 선정된 최고 평점의 AI 스템 분리 도구들은 리믹스 제작, 샘플링 준비, 카라오케 녹음에 특화되어 있습니다. 이 강력하고 혁신적인 도구들은 실제 환경에서의 테스트를 거쳐 정밀한 오디오 분리 기능을 제공함으로써 작업 효율성을 크게 향상시켜 줍니다. XIX.AI는 매주 업데이트되는 무료 버전과 유료 버전의 비교 가이드를 제공하여 사용자의 니즈에 가장 적합한 도구를 찾는 데 도움을 줍니다. 지금 바로 확인하여 AI 기술의 잠재력을 최대한 활용해 보세요.

8 도구
xix.ai
데이터 분석 수익 대시보드, 퍼널 분석, 그리고 제품 지표를 위한 AI SQL 코파일럿
수익 대시보드, 퍼널 분석, 그리고 제품 지표를 위한 AI SQL 코파일럿

2026년 최신 최고의 AI SQL 코파일럿들이 최상위 순위에 올랐습니다! XIX.AI는 매주 업데이트되는 실제 환경 테스트를 위해 강력하고 혁신적인 도구들을 선별하여 제공합니다. 반드시 사용해 보아야 할 이 도구들은 정확한 수익 대시보드를 생성하고, 판매 과정을 분석하며, 제품 관련 지표를 신속하게 추적할 수 있도록 도와 생산성을 크게 향상시켜 줍니다. 데이터 기반 의사결정을 위한 완벽한 도구를 찾아보세요! 238자

9 도구
xix.ai
음악 작곡 노래 초안을 위한 최고의 AI 멜로디 작곡 도구
노래 초안을 위한 최고의 AI 멜로디 작곡 도구

2026년 최신 최고 인기 AI 멜로디 작곡 도구! XIX.AI는 엄격한 실전 테스트를 거쳐 최고의 작곡 경험을 제공하는 강력한 게임 체인저 컬렉션을 엄선했습니다. 무료와 유료 버전의 상세 비교, 정확한 순위, 그리고 놀라운 노래 초안을 손쉽게 만들고 창의적 생산성을 크게 높일 수 있는 필수 추천 옵션들을 확인할 수 있습니다. 지금 바로 탐색하여 완벽한 도구를 발견하세요!

8 도구
xix.ai
챗봇 면접 연습을 위한 최고의 AI 대화 트레이너 도구
면접 연습을 위한 최고의 AI 대화 트레이너 도구

2026년 최신 최고의 평점 높은 AI 대화 트레이너 도구들이 XIX.AI에서 만나보세요! 면접 연습을 위한 이 엄선된 컬렉션은 강력한, 게임 체인저 도구들을 포함하고 있으며, 엄격한 실제 세계 테스트를 거쳐 정확한 피드백을 제공합니다. 무료 대 유료 비교와 상세한 순위표를 찾을 수 있어 자신감과 기술을 향상시킬 수 있는 꼭 시도해봐야 할 옵션을 선택하는 데 도움이 됩니다. 지금 탐색하여 면접 성공을 위한 완벽한 도구를 발견하세요!

12 도구
xix.ai
디자인과 예술 창의적인 실험을 위한 최고의 AI 스타일 변환 도구
창의적인 실험을 위한 최고의 AI 스타일 변환 도구

2026년 최신, 최고 평점을 받은 창의적 실험을 위한 AI 스타일 변환 도구! XIX.AI는 실제 테스트와 엄격한 평가를 통해 탁월한 결과를 보여주는, 강력하고 판도를 바꿀 만한 ‘꼭 사용해 봐야 할’ 도구들을 엄선했습니다. 이 최고의 솔루션들은 콘텐츠 제작 속도를 높이고 무한한 창의적 가능성을 열어줌으로써 크리에이터들의 생산성을 크게 높여줍니다. 지금 바로 탐색하여 나에게 딱 맞는 도구를 찾아보고, 오늘 바로 창작을 시작해 보세요!

9 도구
xix.ai
만화 창작 시각적 스토리텔링을 위한 최고의 AI 대화 풍선 도구
시각적 스토리텔링을 위한 최고의 AI 대화 풍선 도구

2026년 시각적 스토리텔링을 위한 최신 최고 평점의 AI 대화 풍선 도구가 XIX.AI에 소개됩니다! 이 엄선된 모음집에는 크리에이터들이 생산성을 높이고 창의적인 난관을 극복하는 데 도움을 주는, 강력하고 획기적인 도구들이 포함되어 있습니다. 무료 버전과 유료 버전의 비교 정보를 확인하고, 실제 테스트 결과를 살펴보며, 최신 순위를 통해 매력적인 시각적 이야기를 만드는 데 꼭 필요한 솔루션을 찾아보세요. 지금 바로 탐색하여 여러분에게 딱 맞는 도구를 발견해 보세요!

10 도구
xix.ai
의견 (3)
0/500
WillWalker
WillWalker 2026년 7월 22일 오전 1시 0분 18초 GMT+09:00

Interesting to see competitors collaborate on safety. But is it just a PR stunt? 🤔

IsabellaLevis
IsabellaLevis 2026년 3월 4일 오전 11시 0분 50초 GMT+09:00

AIの安全性テストを業界全体で実施する必要があるって主張、すごく共感します。競争が激しい中でOpenAIとAnthropicが協力したのは意外だけど、こういう連携がもっと増えると良いですね。ただ、本当に効果的なテストができるのか少し不安… 🤔

GeorgeWilliams
GeorgeWilliams 2026년 2월 20일 오전 9시 1분 46초 GMT+09:00

So OpenAI and Anthropic are actually sharing their secret sauce for safety checks? That's pretty refreshing to see amidst all the cutthroat AI race. Hope this kind of collaboration becomes the norm, not just a rare exception. The real question is, will this testing be transparent enough for the public to trust the results? 🤔

OR