Hogar
OpenAI se enfrenta a una reacción violenta por su tecnología de gráficos de vibración

Durante su importante retransmisión en directo de GPT-5 el jueves, OpenAI presentó varios gráficos que parecían mostrar las impresionantes capacidades del modelo, pero un examen más detallado revela algunas incoherencias en la visualización de los datos.
Irónicamente, en un gráfico que ilustra el rendimiento de GPT-5 en "pruebas de engaño entre modelos", la escala parece estar mal alineada. Por ejemplo, en el gráfico se afirmaba que GPT-5 con "pensamiento" lograba una tasa de engaño del 50,0 por ciento. Sin embargo, el modelo más pequeño de OpenAI, o3, con un 47,4%, aparecía como una barra más grande. Sin embargo, los datos publicados en la entrada del blog oficial de OpenAI sobre GPT-5 muestran que la tasa de engaño real de GPT-5 es del 16,5%.
Este desajuste visual significaba que, en el escenario, la barra de GPT-5 aparecía más alta que la de o3, a pesar de que su puntuación era más baja. En otras partes del mismo gráfico, o3 y GPT-4o recibieron puntuaciones diferentes, pero estaban representados por barras de idéntico tamaño. El error fue lo suficientemente importante como para que Sam Altman, director ejecutivo de OpenAI, lo reconociera públicamente, calificando el incidente de "gran metedura de pata", al tiempo que aclaraba que el blog contenía la versión correcta.
Un miembro del personal de marketing de OpenAI también se disculpó, declarando: "Hemos corregido el gráfico en el blog, todo el mundo, lo siento por el delito gráfico involuntario".
El viernes, en respuesta a la pregunta de un usuario de Reddit sobre los gráficos, Altman explicó que "las cifras eran exactas, pero nos equivocamos con los gráficos de barras durante la retransmisión en directo. En otra diapositiva, nos equivocamos con los números". Confirmó que la entrada del blog y los datos de la tarjeta del sistema eran exactos, y añadió que "los miembros del equipo trabajaban hasta tarde y estaban agotados, lo que dio lugar a errores humanos". Todo se junta en el último minuto para un livestream".
Aún así, los errores presentaron un aspecto desafortunado para la compañía en un día de lanzamiento tan importante, especialmente cuando promociona los "avances significativos en la reducción de alucinaciones" del nuevo modelo."
Actualizado el 8 de agosto: Añadido el comentario de Altman en Reddit.
Artículo relacionado
Warner Music adquiere la startup de atribución de IA Sureel AI
Warner Music Group (WMG) confirmó el miércoles que está adquiriendo Sureel AI, una startup de atribución de inteligencia artificial. La tecnología propietaria de Sureel genera un «ADN de IA» para las pistas musicales, descomponiéndolas en sus element
Amazon presenta Alexa para Compras mientras relega a Rufus a un segundo plano
Amazon ha lanzado Alexa para Compras, fusionando su chatbot de compras Rufus con Alexa+ en la aplicación, el sitio web y los dispositivos Echo Show.El asistente responde consultas sobre productos, compara artículos, rastrea precios y admite recordat
Microsoft, Azure y la tecnología de IA combaten los riesgos de incendios forestales en California
Microsoft invierte en la detección de incendios forestales basada en la inteligencia artificial; Juan Lavista Ferres, vicepresidente corporativo y científico jefe de datos, analiza estrategias para mi
Recomendaciones de temas especiales relacionados
comentario (0)
0/500

Durante su importante retransmisión en directo de GPT-5 el jueves, OpenAI presentó varios gráficos que parecían mostrar las impresionantes capacidades del modelo, pero un examen más detallado revela algunas incoherencias en la visualización de los datos.
Irónicamente, en un gráfico que ilustra el rendimiento de GPT-5 en "pruebas de engaño entre modelos", la escala parece estar mal alineada. Por ejemplo, en el gráfico se afirmaba que GPT-5 con "pensamiento" lograba una tasa de engaño del 50,0 por ciento. Sin embargo, el modelo más pequeño de OpenAI, o3, con un 47,4%, aparecía como una barra más grande. Sin embargo, los datos publicados en la entrada del blog oficial de OpenAI sobre GPT-5 muestran que la tasa de engaño real de GPT-5 es del 16,5%.
Este desajuste visual significaba que, en el escenario, la barra de GPT-5 aparecía más alta que la de o3, a pesar de que su puntuación era más baja. En otras partes del mismo gráfico, o3 y GPT-4o recibieron puntuaciones diferentes, pero estaban representados por barras de idéntico tamaño. El error fue lo suficientemente importante como para que Sam Altman, director ejecutivo de OpenAI, lo reconociera públicamente, calificando el incidente de "gran metedura de pata", al tiempo que aclaraba que el blog contenía la versión correcta.
Un miembro del personal de marketing de OpenAI también se disculpó, declarando: "Hemos corregido el gráfico en el blog, todo el mundo, lo siento por el delito gráfico involuntario".
El viernes, en respuesta a la pregunta de un usuario de Reddit sobre los gráficos, Altman explicó que "las cifras eran exactas, pero nos equivocamos con los gráficos de barras durante la retransmisión en directo. En otra diapositiva, nos equivocamos con los números". Confirmó que la entrada del blog y los datos de la tarjeta del sistema eran exactos, y añadió que "los miembros del equipo trabajaban hasta tarde y estaban agotados, lo que dio lugar a errores humanos". Todo se junta en el último minuto para un livestream".
Aún así, los errores presentaron un aspecto desafortunado para la compañía en un día de lanzamiento tan importante, especialmente cuando promociona los "avances significativos en la reducción de alucinaciones" del nuevo modelo."
Actualizado el 8 de agosto: Añadido el comentario de Altman en Reddit.
Warner Music adquiere la startup de atribución de IA Sureel AI
Warner Music Group (WMG) confirmó el miércoles que está adquiriendo Sureel AI, una startup de atribución de inteligencia artificial. La tecnología propietaria de Sureel genera un «ADN de IA» para las pistas musicales, descomponiéndolas en sus element
Microsoft, Azure y la tecnología de IA combaten los riesgos de incendios forestales en California
Microsoft invierte en la detección de incendios forestales basada en la inteligencia artificial; Juan Lavista Ferres, vicepresidente corporativo y científico jefe de datos, analiza estrategias para mi











