A OpenAI enfrenta reações adversas em relação à tecnologia de gráficos de vibração

Durante sua principal transmissão ao vivo do GPT-5 na quinta-feira, a OpenAI apresentou vários gráficos que pareciam mostrar os recursos impressionantes do modelo, mas um olhar mais atento revela algumas inconsistências na visualização dos dados.
Ironicamente, em um gráfico que ilustra o desempenho do GPT-5 em "avaliações de fraude entre modelos", a escala parece estar desalinhada. Por exemplo, o gráfico no palco afirmava que o GPT-5 com "pensamento" alcançou uma taxa de fraude de 50,0%. No entanto, o modelo menor o3 da OpenAI - com 47,4% - apareceu como uma barra maior. Os dados publicados na postagem oficial do blog do GPT-5 da OpenAI, no entanto, mostram que a taxa real de engano do GPT-5 foi de 16,5%.
Essa incompatibilidade visual fez com que, no palco, a barra do GPT-5 fosse mostrada como mais alta do que a do o3, embora sua pontuação informada fosse menor. Em outra parte do mesmo gráfico, o3 e GPT-4o receberam pontuações diferentes, mas foram representados por barras de tamanho idêntico. O erro foi significativo o suficiente para que o CEO Sam Altman o reconhecesse publicamente, rotulando o incidente como uma "mega falha no gráfico" e esclarecendo que o blog continha a versão correta.
Um membro da equipe de marketing da OpenAI também se desculpou, dizendo: "Corrigimos o gráfico no blog, pessoal - desculpem pelo crime não intencional do gráfico".
Na sexta-feira, respondendo a uma pergunta de um usuário do Reddit sobre os gráficos, Altman explicou que "os números aqui eram precisos, mas nós bagunçamos os gráficos de barras durante a transmissão ao vivo. Em outro slide, erramos os números". Ele confirmou que a publicação no blog e os dados do cartão do sistema eram precisos, acrescentando que "os membros da equipe estavam trabalhando até tarde e exaustos, o que levou a erros humanos. Tudo isso acontece no último minuto para uma transmissão ao vivo".
Ainda assim, os erros representaram um aspecto infeliz para a empresa em um dia de lançamento tão importante, especialmente porque ela promove os "avanços significativos na redução de alucinações" do novo modelo.
Atualizado em 8 de agosto: Adicionado o comentário de Altman no Reddit.
Artigo relacionado
A Warner Music adquire a startup de atribuição de IA Sureel AI
A Warner Music Group (WMG) confirmou na quarta-feira que está adquirindo a Sureel AI, uma startup de atribuição por inteligência artificial. A tecnologia proprietária da Sureel gera “DNA de IA” para faixas musicais, desconstruindo-as em elementos con
A Amazon apresenta a Alexa para Compras, enquanto coloca o Rufus em segundo plano
A Amazon lançou a Alexa para Compras, integrando seu chatbot de compras Rufus com o Alexa+ em todo o aplicativo, site e dispositivos Echo Show.O assistente responde a consultas sobre produtos, compara itens, rastreia preços e oferece suporte para le
A Microsoft, o Azure e a tecnologia de IA combatem os riscos de incêndios florestais na Califórnia
A Microsoft investe na detecção de incêndios florestais com tecnologia de IA, e Juan Lavista Ferres, vice-presidente corporativo e cientista-chefe de dados, discute estratégias para mitigar os danos a
Recomendações de tópicos especiais relacionados
Comentários (0)

Durante sua principal transmissão ao vivo do GPT-5 na quinta-feira, a OpenAI apresentou vários gráficos que pareciam mostrar os recursos impressionantes do modelo, mas um olhar mais atento revela algumas inconsistências na visualização dos dados.
Ironicamente, em um gráfico que ilustra o desempenho do GPT-5 em "avaliações de fraude entre modelos", a escala parece estar desalinhada. Por exemplo, o gráfico no palco afirmava que o GPT-5 com "pensamento" alcançou uma taxa de fraude de 50,0%. No entanto, o modelo menor o3 da OpenAI - com 47,4% - apareceu como uma barra maior. Os dados publicados na postagem oficial do blog do GPT-5 da OpenAI, no entanto, mostram que a taxa real de engano do GPT-5 foi de 16,5%.
Essa incompatibilidade visual fez com que, no palco, a barra do GPT-5 fosse mostrada como mais alta do que a do o3, embora sua pontuação informada fosse menor. Em outra parte do mesmo gráfico, o3 e GPT-4o receberam pontuações diferentes, mas foram representados por barras de tamanho idêntico. O erro foi significativo o suficiente para que o CEO Sam Altman o reconhecesse publicamente, rotulando o incidente como uma "mega falha no gráfico" e esclarecendo que o blog continha a versão correta.
Um membro da equipe de marketing da OpenAI também se desculpou, dizendo: "Corrigimos o gráfico no blog, pessoal - desculpem pelo crime não intencional do gráfico".
Na sexta-feira, respondendo a uma pergunta de um usuário do Reddit sobre os gráficos, Altman explicou que "os números aqui eram precisos, mas nós bagunçamos os gráficos de barras durante a transmissão ao vivo. Em outro slide, erramos os números". Ele confirmou que a publicação no blog e os dados do cartão do sistema eram precisos, acrescentando que "os membros da equipe estavam trabalhando até tarde e exaustos, o que levou a erros humanos. Tudo isso acontece no último minuto para uma transmissão ao vivo".
Ainda assim, os erros representaram um aspecto infeliz para a empresa em um dia de lançamento tão importante, especialmente porque ela promove os "avanços significativos na redução de alucinações" do novo modelo.
Atualizado em 8 de agosto: Adicionado o comentário de Altman no Reddit.
A Warner Music adquire a startup de atribuição de IA Sureel AI
A Warner Music Group (WMG) confirmou na quarta-feira que está adquirindo a Sureel AI, uma startup de atribuição por inteligência artificial. A tecnologia proprietária da Sureel gera “DNA de IA” para faixas musicais, desconstruindo-as em elementos con
A Microsoft, o Azure e a tecnologia de IA combatem os riscos de incêndios florestais na Califórnia
A Microsoft investe na detecção de incêndios florestais com tecnologia de IA, e Juan Lavista Ferres, vice-presidente corporativo e cientista-chefe de dados, discute estratégias para mitigar os danos a





Lar






