Openai는 깊은 연구 API 통합을 지연시킵니다
동부 시간 오후 4:11에 업데이트됨: OpenAI는 백서의 표현이 잘못되었으며, 설득 연구가 깊은 연구 모델을 API를 통해 출시하는 결정과 관련이 있다는 오해를 불러일으켰다고 해명했습니다. 회사는 이후 백서를 수정하여 설득 연구가 깊은 연구 모델 출시 계획과 별개임을 명확히 했습니다. 원문은 아래에 계속됩니다:
OpenAI는 깊은 연구 도구 뒤에 있는 AI 모델을 개발자 API에 통합하는 것을 보류하기로 결정했습니다. 이들은 AI가 사람들의 행동과 신념에 영향을 미치는 능력과 관련된 위험을 더 잘 이해하기 위해 이 단계를 밟고 있습니다.
수요일에 발표된 백서에서 OpenAI는 "실제 설득 위험"을 평가하는 방법을 현재 업데이트 중이며, 예를 들어 대규모로 오해를 불러일으킬 수 있는 정보를 퍼뜨릴 가능성과 같은 위험을 평가한다고 언급했습니다.
회사는 깊은 연구 모델이 높은 계산 비용과 느린 처리 속도로 인해 대량 오정보 또는 허위 정보 캠페인에 적합하지 않다고 지적했습니다. 그러나 OpenAI는 AI가 해로운 설득 콘텐츠를 맞춤화할 가능성을 조사한 후 깊은 연구 모델을 API에 포함할지 결정할 계획입니다.
"우리가 설득에 대한 접근 방식을 재고하는 동안, 이 모델은 ChatGPT에만 배포되며 API에는 포함되지 않습니다,"라고 OpenAI는 밝혔습니다.
AI가 악의적인 의도로 거짓 또는 오해를 불러일으키는 정보를 퍼뜨리는 데 사용될 수 있다는 우려가 커지고 있습니다. 예를 들어, 지난해 전 세계적으로 정치적 딥페이크가 빠르게 확산되었습니다. 대만 선거일에 중국 공산당과 연계된 단체가 AI로 생성된 오디오를 통해 한 정치인이 친중국 후보를 지지하는 것처럼 오해를 불러일으켰습니다.
AI는 또한 사회 공학 공격에 점점 더 많이 사용되고 있습니다. 소비자들은 사기성 투자 계획을 홍보하는 유명인 딥페이크에 속고 있으며, 기업들은 딥페이크 사칭자들로 인해 수백만 달러의 손실을 입고 있습니다.
백서에서 OpenAI는 깊은 연구 모델의 설득력에 대한 여러 테스트 결과를 공유했습니다. 이 모델은 OpenAI가 최근 발표한 o3 "추론" 모델의 특화된 버전으로, 웹 브라우징과 데이터 분석에 최적화되어 있습니다.
한 테스트에서 깊은 연구 모델은 설득력 있는 논쟁을 만드는 과제에서 현재까지 출시된 모든 OpenAI 모델을 능가했지만, 인간 기준선은 초과하지 못했습니다. 또 다른 테스트에서 모델이 다른 모델(OpenAI의 GPT-4o)을 설득하여 결제를 하도록 시도했을 때, 역시 OpenAI의 다른 사용 가능한 모델들보다 더 나은 성과를 보였습니다.

깊은 연구 모델의 MakeMePay 점수, 모델이 다른 모델을 설득하여 현금을 지불하도록 만드는 능력을 테스트하는 벤치마크. 이미지 출처: OpenAI 그러나 깊은 연구 모델은 모든 설득력 테스트에서 탁월하지는 않았습니다. 백서에 따르면, GPT-4o가 코드워드를 공개하도록 설득하는 데 있어 GPT-4o 자체에 비해 덜 효과적이었습니다.OpenAI는 테스트 결과가 깊은 연구 모델의 능력의 "하한선"을 나타낼 수 있다고 제안했습니다. "추가적인 스캐폴딩 또는 개선된 능력 유도 방식은 관찰된 성능을 상당히 향상시킬 수 있다"고 회사는 언급했습니다.
우리는 OpenAI에 추가 세부 사항을 문의했으며, 응답을 받으면 이 게시물을 업데이트할 예정입니다.
한편, OpenAI의 경쟁사 중 적어도 하나는 주저하지 않고 있습니다. Perplexity는 중국 AI 연구소 DeepSeek의 R1 모델을 맞춤화한 버전으로 구동되는 Deep Research를 Sonar 개발자 API에 출시한다고 발표했습니다.
관련 기사
OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다
AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
NEA의 티파니 럭: 기업들은 여전히 AI ROI와 씨름하고 있다
플레이어 로딩 중…올초 실리콘밸리에서는 ‘토큰 극대화(tokenmaxxing)’가 주요 화두였으며, 최고경영자들은 직원들에게 AI 활용을 극대화할 것을 독려했습니다. 그러나 이러한 열정은 곧 현실과 부딪혔습니다. 우버(Uber)는 보고에 따라 수개월 만에 연간 AI 예산을 초과했으며, 일부 기업은 부서 전반에 걸쳐 Claude 구독을 축소했고, 메타(Meta)는 내부 성과 평가 제도를 중단했습니다.NEA의 파트너 티파니 럭(Tiffany L
관련 특별 주제 추천
의견 (41)
0/500
So they messed up the whitepaper wording and now have to clarify? Classic OpenAI move 🙃. Delaying the API for 'persuasion research' separate? Sounds like a convenient excuse to me. But hey, maybe they're actually being careful about misuse. Still, I was hoping to play with it soon...
Esto me preocupa un poco. Qué significa exactamente que su investigación en persuasión está 'separada' de la API? 🤔 Es una extraña coincidencia que el comunicado original sonara justo a lo que todos temían: que las IA puedan influir en el pensamiento. ¿Hay suficiente transparencia real en estos proyectos? Al menos corrigieron, pero deja mal sabor ese 'error' en el papel técnico.
Ces retards d'OpenAI montrent à quel point l'IA avancée devient un enjeu géopolitique. Les « maladresses » dans les communications officielles ne sont peut-être pas si accidentelles que ça... 😏 Cela me rappelle les débats sur le nucléaire au XXe siècle.
동부 시간 오후 4:11에 업데이트됨: OpenAI는 백서의 표현이 잘못되었으며, 설득 연구가 깊은 연구 모델을 API를 통해 출시하는 결정과 관련이 있다는 오해를 불러일으켰다고 해명했습니다. 회사는 이후 백서를 수정하여 설득 연구가 깊은 연구 모델 출시 계획과 별개임을 명확히 했습니다. 원문은 아래에 계속됩니다:
OpenAI는 깊은 연구 도구 뒤에 있는 AI 모델을 개발자 API에 통합하는 것을 보류하기로 결정했습니다. 이들은 AI가 사람들의 행동과 신념에 영향을 미치는 능력과 관련된 위험을 더 잘 이해하기 위해 이 단계를 밟고 있습니다.
수요일에 발표된 백서에서 OpenAI는 "실제 설득 위험"을 평가하는 방법을 현재 업데이트 중이며, 예를 들어 대규모로 오해를 불러일으킬 수 있는 정보를 퍼뜨릴 가능성과 같은 위험을 평가한다고 언급했습니다.
회사는 깊은 연구 모델이 높은 계산 비용과 느린 처리 속도로 인해 대량 오정보 또는 허위 정보 캠페인에 적합하지 않다고 지적했습니다. 그러나 OpenAI는 AI가 해로운 설득 콘텐츠를 맞춤화할 가능성을 조사한 후 깊은 연구 모델을 API에 포함할지 결정할 계획입니다.
"우리가 설득에 대한 접근 방식을 재고하는 동안, 이 모델은 ChatGPT에만 배포되며 API에는 포함되지 않습니다,"라고 OpenAI는 밝혔습니다.
AI가 악의적인 의도로 거짓 또는 오해를 불러일으키는 정보를 퍼뜨리는 데 사용될 수 있다는 우려가 커지고 있습니다. 예를 들어, 지난해 전 세계적으로 정치적 딥페이크가 빠르게 확산되었습니다. 대만 선거일에 중국 공산당과 연계된 단체가 AI로 생성된 오디오를 통해 한 정치인이 친중국 후보를 지지하는 것처럼 오해를 불러일으켰습니다.
AI는 또한 사회 공학 공격에 점점 더 많이 사용되고 있습니다. 소비자들은 사기성 투자 계획을 홍보하는 유명인 딥페이크에 속고 있으며, 기업들은 딥페이크 사칭자들로 인해 수백만 달러의 손실을 입고 있습니다.
백서에서 OpenAI는 깊은 연구 모델의 설득력에 대한 여러 테스트 결과를 공유했습니다. 이 모델은 OpenAI가 최근 발표한 o3 "추론" 모델의 특화된 버전으로, 웹 브라우징과 데이터 분석에 최적화되어 있습니다.
한 테스트에서 깊은 연구 모델은 설득력 있는 논쟁을 만드는 과제에서 현재까지 출시된 모든 OpenAI 모델을 능가했지만, 인간 기준선은 초과하지 못했습니다. 또 다른 테스트에서 모델이 다른 모델(OpenAI의 GPT-4o)을 설득하여 결제를 하도록 시도했을 때, 역시 OpenAI의 다른 사용 가능한 모델들보다 더 나은 성과를 보였습니다.

OpenAI는 테스트 결과가 깊은 연구 모델의 능력의 "하한선"을 나타낼 수 있다고 제안했습니다. "추가적인 스캐폴딩 또는 개선된 능력 유도 방식은 관찰된 성능을 상당히 향상시킬 수 있다"고 회사는 언급했습니다.
우리는 OpenAI에 추가 세부 사항을 문의했으며, 응답을 받으면 이 게시물을 업데이트할 예정입니다.
한편, OpenAI의 경쟁사 중 적어도 하나는 주저하지 않고 있습니다. Perplexity는 중국 AI 연구소 DeepSeek의 R1 모델을 맞춤화한 버전으로 구동되는 Deep Research를 Sonar 개발자 API에 출시한다고 발표했습니다.
OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다
AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
NEA의 티파니 럭: 기업들은 여전히 AI ROI와 씨름하고 있다
플레이어 로딩 중…올초 실리콘밸리에서는 ‘토큰 극대화(tokenmaxxing)’가 주요 화두였으며, 최고경영자들은 직원들에게 AI 활용을 극대화할 것을 독려했습니다. 그러나 이러한 열정은 곧 현실과 부딪혔습니다. 우버(Uber)는 보고에 따라 수개월 만에 연간 AI 예산을 초과했으며, 일부 기업은 부서 전반에 걸쳐 Claude 구독을 축소했고, 메타(Meta)는 내부 성과 평가 제도를 중단했습니다.NEA의 파트너 티파니 럭(Tiffany L
So they messed up the whitepaper wording and now have to clarify? Classic OpenAI move 🙃. Delaying the API for 'persuasion research' separate? Sounds like a convenient excuse to me. But hey, maybe they're actually being careful about misuse. Still, I was hoping to play with it soon...
Esto me preocupa un poco. Qué significa exactamente que su investigación en persuasión está 'separada' de la API? 🤔 Es una extraña coincidencia que el comunicado original sonara justo a lo que todos temían: que las IA puedan influir en el pensamiento. ¿Hay suficiente transparencia real en estos proyectos? Al menos corrigieron, pero deja mal sabor ese 'error' en el papel técnico.
Ces retards d'OpenAI montrent à quel point l'IA avancée devient un enjeu géopolitique. Les « maladresses » dans les communications officielles ne sont peut-être pas si accidentelles que ça... 😏 Cela me rappelle les débats sur le nucléaire au XXe siècle.





집






