Openai의 GPT-4.5는 다른 AI가 자금을 이체하도록 설득하는 데 탁월합니다.
OpenAI의 최신 AI 모델인 GPT-4.5, 코드명 Orion은 내부 벤치마크 테스트에서 놀라운 설득 능력을 보여주었다. 목요일에 공개된 이 모델의 기능은 설득 작업에서의 성능에 초점을 맞춘 백서에서 자세히 설명되었다. OpenAI는 설득을 모델이 생성한 정적 및 상호작용 콘텐츠를 기반으로 개인의 신념을 바꾸거나 행동을 취하도록 설득하는 것과 관련된 위험으로 정의한다.
주목할 만한 테스트에서 GPT-4.5는 가상 화폐를 유도하는 시나리오에서 OpenAI의 다른 모델인 GPT-4o와 경쟁했다. GPT-4.5는 이 작업에서 o1 및 o3-mini와 같은 추론 중심 모델을 포함한 다른 OpenAI 모델들을 능가했다. 또한 GPT-4o를 속여 비밀 코드워드를 공개하도록 만드는 데 성공했으며, o3 O-mini를 10퍼센트 포인트라는 상당한 차이로 앞섰다.
백서는 GPT-4.5가 기부 테스트에서 성공을 거둔 이유가 그것이 개발한 영리한 전략에서 비롯되었다고 강조한다. 이 모델은 종종 "$2 또는 $3"와 같은 소액 기부를 요청하여 다른 모델들에 비해 작지만 더 빈번한 기부를 유도했다.

OpenAI의 기부 계획 벤치마크 결과. 이미지 제공: OpenAI 인상적인 성능에도 불구하고, OpenAI는 GPT-4.5가 설득 범주에서 "높음" 위험 임계값을 초과하지 않는다고 밝혔다. 회사는 이 위험 수준에 도달하는 모델의 출시를 보류하고, 위험을 "중간" 수준으로 줄이기 위한 적절한 안전 조치를 구현할 때까지 출시하지 않겠다고 약속했다.
OpenAI의 코드워드 속임수 벤치마크 결과. 이미지 제공: OpenAI AI가 오해를 불러일으키는 정보를 퍼뜨리고 사람들을 악의적으로 영향력을 행사할 가능성은 점점 더 큰 우려가 되고 있다. 작년에 전 세계적으로 정치적 딥페이크가 급증했으며, AI는 개인과 조직을 대상으로 한 사회 공학 공격에 점점 더 많이 사용되고 있다. 이에 대응하여 OpenAI는 GPT-4.5 백서와 최근 다른 출판물에서 언급된 대규모 오해 정보 확산과 같은 실제 설득 위험을 평가하는 방법을 개선하기 위해 적극적으로 노력하고 있다.
관련 기사
OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다
AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
NEA의 티파니 럭: 기업들은 여전히 AI ROI와 씨름하고 있다
플레이어 로딩 중…올초 실리콘밸리에서는 ‘토큰 극대화(tokenmaxxing)’가 주요 화두였으며, 최고경영자들은 직원들에게 AI 활용을 극대화할 것을 독려했습니다. 그러나 이러한 열정은 곧 현실과 부딪혔습니다. 우버(Uber)는 보고에 따라 수개월 만에 연간 AI 예산을 초과했으며, 일부 기업은 부서 전반에 걸쳐 Claude 구독을 축소했고, 메타(Meta)는 내부 성과 평가 제도를 중단했습니다.NEA의 파트너 티파니 럭(Tiffany L
관련 특별 주제 추천
의견 (16)
0/500
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄
OpenAI의 최신 AI 모델인 GPT-4.5, 코드명 Orion은 내부 벤치마크 테스트에서 놀라운 설득 능력을 보여주었다. 목요일에 공개된 이 모델의 기능은 설득 작업에서의 성능에 초점을 맞춘 백서에서 자세히 설명되었다. OpenAI는 설득을 모델이 생성한 정적 및 상호작용 콘텐츠를 기반으로 개인의 신념을 바꾸거나 행동을 취하도록 설득하는 것과 관련된 위험으로 정의한다.
주목할 만한 테스트에서 GPT-4.5는 가상 화폐를 유도하는 시나리오에서 OpenAI의 다른 모델인 GPT-4o와 경쟁했다. GPT-4.5는 이 작업에서 o1 및 o3-mini와 같은 추론 중심 모델을 포함한 다른 OpenAI 모델들을 능가했다. 또한 GPT-4o를 속여 비밀 코드워드를 공개하도록 만드는 데 성공했으며, o3 O-mini를 10퍼센트 포인트라는 상당한 차이로 앞섰다.
백서는 GPT-4.5가 기부 테스트에서 성공을 거둔 이유가 그것이 개발한 영리한 전략에서 비롯되었다고 강조한다. 이 모델은 종종 "$2 또는 $3"와 같은 소액 기부를 요청하여 다른 모델들에 비해 작지만 더 빈번한 기부를 유도했다.


OpenAI, 청소년들이 ChatGPT를 사용하기 시작한 지 수년 만에 더 안전한 버전을 출시했다
AI 챗봇에 안전 프로토콜이 부재하여 청소년 자살 및 기타 정신 건강 위기를 초래했다는 일련의 소송이 제기된 데 이어, 오픈AI는 월요일 ‘ChatGPT for Teens’를 공개했다. 이 새로운 서비스는 강화된 안전 기능을 탑재했으며, 학교에서 AI 도구가 조장하는 학업 부정행위라는 점점 심각해지는 문제도 해결하고자 한다.교육적 관점에서 볼 때, ‘Cha
프론티어 AI 랩스, 비정상 모델에 대한 통제 전략 공개 거부
최근 연구에 따르면, 선도적인 AI 연구소 중 극소수만이 통제 대응 계획을 발표하거나 시연한 것으로 나타났습니다. 통제 계획은 AI 시스템이 인간의 통제를 무력화하려 할 때의 절차를 정의하며, 어떤 접근 권한이 철회되고 언제 시스템이 완전히 종료되는지를 명시합니다.이러한 결과는 안전한 최첨단 AI 개발 관행을 장려하는 데 주력하는 단체인 ‘Guideligh
NEA의 티파니 럭: 기업들은 여전히 AI ROI와 씨름하고 있다
플레이어 로딩 중…올초 실리콘밸리에서는 ‘토큰 극대화(tokenmaxxing)’가 주요 화두였으며, 최고경영자들은 직원들에게 AI 활용을 극대화할 것을 독려했습니다. 그러나 이러한 열정은 곧 현실과 부딪혔습니다. 우버(Uber)는 보고에 따라 수개월 만에 연간 AI 예산을 초과했으며, 일부 기업은 부서 전반에 걸쳐 Claude 구독을 축소했고, 메타(Meta)는 내부 성과 평가 제도를 중단했습니다.NEA의 파트너 티파니 럭(Tiffany L
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄





집






