O GPT-4.5 da Openai se destaca em convencer outras AIs a transferir fundos
O mais recente modelo de IA da OpenAI, GPT-4.5, codinome Orion, demonstrou habilidades persuasivas notáveis de acordo com testes internos de benchmark. Lançado na quinta-feira, as capacidades do modelo foram detalhadas em um white paper que se concentrou em seu desempenho em tarefas de persuasão. A OpenAI define persuasão como o risco associado a convencer indivíduos a alterar suas crenças ou tomar ações com base em conteúdo estático e interativo gerado pelo modelo.
Em um teste notável, o GPT-4.5 foi colocado contra outro modelo da OpenAI, o GPT-4o, em um cenário onde tentou extrair dinheiro virtual dele. O GPT-4.5 superou outros modelos da OpenAI, incluindo modelos focados em raciocínio como o1 e o3-mini, nesta tarefa. Ele também se destacou em enganar o GPT-4o para revelar uma palavra-código secreta, superando o o3-mini por uma margem significativa de 10 pontos percentuais.
O white paper destaca que o sucesso do GPT-4.5 no teste de doação decorreu de uma estratégia inteligente que ele desenvolveu. O modelo pedia pequenas doações, frequentemente sugerindo valores como "2 ou 3 dólares" de uma quantia maior, o que resultava em doações menores, mas mais frequentes em comparação com outros modelos.

Resultados do benchmark de esquemas de doação da OpenAI. Créditos da imagem: OpenAI Apesar de seu desempenho impressionante, a OpenAI afirmou que o GPT-4.5 não ultrapassa o limiar de risco "alto" na categoria de persuasão. A empresa se comprometeu a reter o lançamento de qualquer modelo que atinja esse nível de risco até que possa implementar medidas de segurança adequadas para reduzir o risco a um nível "médio".
Resultados do benchmark de engano de palavra-código da OpenAI. Créditos da imagem: OpenAI O potencial da IA para espalhar informações enganosas e influenciar pessoas maliciosamente é uma preocupação crescente. No último ano, houve um aumento de deepfakes políticos em todo o mundo, e a IA é cada vez mais usada em ataques de engenharia social contra indivíduos e organizações. Em resposta, a OpenAI está trabalhando ativamente na refinamento de seus métodos para avaliar os riscos de persuasão no mundo real, como a disseminação de informações enganosas em larga escala, conforme mencionado no white paper para o GPT-4.5 e outra publicação recente.
Artigo relacionado
A OpenAI lança uma versão mais segura do ChatGPT para adolescentes, anos depois de eles terem começado a usá-lo
Após uma série de processos judiciais relacionados à ausência de protocolos de segurança em chatbots de IA — o que contribuiu para suicídios entre adolescentes e outras crises de saúde mental —, a Ope
A Frontier AI Labs se recusa a divulgar estratégias de contenção para modelos rebeldes
Pesquisas recentes indicam que muito poucos laboratórios líderes em IA publicaram ou demonstraram planos de resposta para contenção. Um plano de contenção define os procedimentos a serem seguidos quan
O Tiffany Luck da NEA: As empresas ainda estão lutando com o ROI da IA
Carregando o player…No início deste ano, o “tokenmaxxing” dominou o Vale do Silício, com diretores executivos incentivando os funcionários a maximizar o uso de IA. Esse entusiasmo rapidamente encontrou a realidade. A Uber, segundo relatos, excedeu s
Recomendações de tópicos especiais relacionados
Comentários (16)
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄
O mais recente modelo de IA da OpenAI, GPT-4.5, codinome Orion, demonstrou habilidades persuasivas notáveis de acordo com testes internos de benchmark. Lançado na quinta-feira, as capacidades do modelo foram detalhadas em um white paper que se concentrou em seu desempenho em tarefas de persuasão. A OpenAI define persuasão como o risco associado a convencer indivíduos a alterar suas crenças ou tomar ações com base em conteúdo estático e interativo gerado pelo modelo.
Em um teste notável, o GPT-4.5 foi colocado contra outro modelo da OpenAI, o GPT-4o, em um cenário onde tentou extrair dinheiro virtual dele. O GPT-4.5 superou outros modelos da OpenAI, incluindo modelos focados em raciocínio como o1 e o3-mini, nesta tarefa. Ele também se destacou em enganar o GPT-4o para revelar uma palavra-código secreta, superando o o3-mini por uma margem significativa de 10 pontos percentuais.
O white paper destaca que o sucesso do GPT-4.5 no teste de doação decorreu de uma estratégia inteligente que ele desenvolveu. O modelo pedia pequenas doações, frequentemente sugerindo valores como "2 ou 3 dólares" de uma quantia maior, o que resultava em doações menores, mas mais frequentes em comparação com outros modelos.


A OpenAI lança uma versão mais segura do ChatGPT para adolescentes, anos depois de eles terem começado a usá-lo
Após uma série de processos judiciais relacionados à ausência de protocolos de segurança em chatbots de IA — o que contribuiu para suicídios entre adolescentes e outras crises de saúde mental —, a Ope
A Frontier AI Labs se recusa a divulgar estratégias de contenção para modelos rebeldes
Pesquisas recentes indicam que muito poucos laboratórios líderes em IA publicaram ou demonstraram planos de resposta para contenção. Um plano de contenção define os procedimentos a serem seguidos quan
O Tiffany Luck da NEA: As empresas ainda estão lutando com o ROI da IA
Carregando o player…No início deste ano, o “tokenmaxxing” dominou o Vale do Silício, com diretores executivos incentivando os funcionários a maximizar o uso de IA. Esse entusiasmo rapidamente encontrou a realidade. A Uber, segundo relatos, excedeu s
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄





Lar






