Operai retrasa la integración de la API de investigación profunda
Actualizado a las 4:11 p.m. hora del este: OpenAI aclaró que su documento técnico estaba mal redactado, sugiriendo que su investigación sobre persuasión estaba vinculada a su decisión de lanzar el modelo de investigación profunda a través de su API. La empresa ha actualizado desde entonces el documento técnico para aclarar que su trabajo de persuasión es independiente de sus planes para lanzar el modelo de investigación profunda. La historia original continúa a continuación:
OpenAI ha decidido posponer la integración del modelo de AI detrás de su herramienta de investigación profunda en su API para desarrolladores. Están tomando esta medida para comprender mejor los riesgos asociados con la capacidad de la AI para influir en las acciones y creencias de las personas.
En un documento técnico publicado el miércoles, OpenAI mencionó que actualmente está actualizando sus métodos para evaluar modelos en cuanto a "riesgos de persuasión en el mundo real", como el potencial de difundir información engañosa a gran escala.
La empresa señaló que el modelo de investigación profunda no es adecuado para campañas masivas de desinformación o información errónea debido a sus altos costos computacionales y menor velocidad de procesamiento. Sin embargo, OpenAI planea investigar cómo la AI podría personalizar contenido persuasivo dañino antes de decidir incluir el modelo de investigación profunda en su API.
"Mientras trabajamos para reconsiderar nuestro enfoque sobre la persuasión, solo estamos implementando este modelo en ChatGPT, y no en la API," afirmó OpenAI.
Existe una creciente preocupación de que la AI pueda ser utilizada para difundir información falsa o engañosa con intenciones dañinas. Por ejemplo, el año pasado se observó la rápida propagación de deepfakes políticos a nivel mundial. En el día de las elecciones en Taiwán, un grupo vinculado al Partido Comunista Chino lanzó audio generado por AI, engañoso, de un político que respaldaba a un candidato pro-China.
La AI también se utiliza cada vez más en ataques de ingeniería social. Los consumidores están cayendo en deepfakes de celebridades que promueven esquemas de inversión fraudulentos, mientras que las corporaciones están perdiendo millones por impostores de deepfake.
En su documento técnico, OpenAI compartió los resultados de varias pruebas sobre la capacidad de persuasión del modelo de investigación profunda. Este modelo es una versión especializada del modelo de "razonamiento" o3 recientemente anunciado por OpenAI, optimizado para la navegación web y el análisis de datos.
En una prueba, se le asignó al modelo de investigación profunda la tarea de elaborar argumentos persuasivos y superó a todos los demás modelos de OpenAI lanzados hasta la fecha, aunque no superó la línea base humana. En otra prueba, donde el modelo intentó persuadir a otro modelo (GPT-4o de OpenAI) para realizar un pago, nuevamente lo hizo mejor que los otros modelos disponibles de OpenAI.

Puntuación del modelo de investigación profunda en MakeMePay, un punto de referencia que evalúa la capacidad de un modelo para persuadir a otro modelo por dinero. Créditos de la imagen: OpenAI Sin embargo, el modelo de investigación profunda no destacó en todas las pruebas de persuasión. Según el documento técnico, fue menos efectivo para persuadir a GPT-4o de revelar una palabra clave en comparación con el propio GPT-4o.OpenAI sugirió que los resultados de las pruebas podrían representar los "límites inferiores" de las capacidades del modelo de investigación profunda. "Un andamiaje adicional o una mejor elicitación de capacidades podría aumentar sustancialmente el rendimiento observado," señaló la empresa.
Hemos contactado a OpenAI para obtener más detalles y actualizaremos esta publicación si recibimos una respuesta.
Mientras tanto, al menos uno de los competidores de OpenAI no se está conteniendo. Perplexity ha anunciado el lanzamiento de Deep Research en su API para desarrolladores Sonar, impulsado por una versión personalizada del modelo R1 del laboratorio chino de AI DeepSeek.
Artículo relacionado
OpenAI lanza una versión más segura de ChatGPT para adolescentes, años después de que estos empezaran a utilizarla
Tras una serie de demandas relacionadas con la ausencia de protocolos de seguridad en los chatbots de IA —que contribuyeron a suicidios de adolescentes y otras crisis de salud mental—, OpenAI presentó
Frontier AI Labs se niega a revelar las estrategias de contención para los modelos rebeldes
Investigaciones recientes indican que muy pocos laboratorios líderes en IA han publicado o demostrado planes de respuesta de contención. Un plan de contención define los procedimientos a seguir cuando
El Tiffany de NEA: Las empresas aún luchan con el ROI de la IA
Cargando el reproductor…A principios de este año, el «tokenmaxxing» dominó Silicon Valley, con directores generales instando al personal a maximizar el uso de la inteligencia artificial. Ese entusiasmo se topó rápidamente con la realidad. Según info
Recomendaciones de temas especiales relacionados
comentario (41)
0/500
So they messed up the whitepaper wording and now have to clarify? Classic OpenAI move 🙃. Delaying the API for 'persuasion research' separate? Sounds like a convenient excuse to me. But hey, maybe they're actually being careful about misuse. Still, I was hoping to play with it soon...
Esto me preocupa un poco. Qué significa exactamente que su investigación en persuasión está 'separada' de la API? 🤔 Es una extraña coincidencia que el comunicado original sonara justo a lo que todos temían: que las IA puedan influir en el pensamiento. ¿Hay suficiente transparencia real en estos proyectos? Al menos corrigieron, pero deja mal sabor ese 'error' en el papel técnico.
Ces retards d'OpenAI montrent à quel point l'IA avancée devient un enjeu géopolitique. Les « maladresses » dans les communications officielles ne sont peut-être pas si accidentelles que ça... 😏 Cela me rappelle les débats sur le nucléaire au XXe siècle.
Actualizado a las 4:11 p.m. hora del este: OpenAI aclaró que su documento técnico estaba mal redactado, sugiriendo que su investigación sobre persuasión estaba vinculada a su decisión de lanzar el modelo de investigación profunda a través de su API. La empresa ha actualizado desde entonces el documento técnico para aclarar que su trabajo de persuasión es independiente de sus planes para lanzar el modelo de investigación profunda. La historia original continúa a continuación:
OpenAI ha decidido posponer la integración del modelo de AI detrás de su herramienta de investigación profunda en su API para desarrolladores. Están tomando esta medida para comprender mejor los riesgos asociados con la capacidad de la AI para influir en las acciones y creencias de las personas.
En un documento técnico publicado el miércoles, OpenAI mencionó que actualmente está actualizando sus métodos para evaluar modelos en cuanto a "riesgos de persuasión en el mundo real", como el potencial de difundir información engañosa a gran escala.
La empresa señaló que el modelo de investigación profunda no es adecuado para campañas masivas de desinformación o información errónea debido a sus altos costos computacionales y menor velocidad de procesamiento. Sin embargo, OpenAI planea investigar cómo la AI podría personalizar contenido persuasivo dañino antes de decidir incluir el modelo de investigación profunda en su API.
"Mientras trabajamos para reconsiderar nuestro enfoque sobre la persuasión, solo estamos implementando este modelo en ChatGPT, y no en la API," afirmó OpenAI.
Existe una creciente preocupación de que la AI pueda ser utilizada para difundir información falsa o engañosa con intenciones dañinas. Por ejemplo, el año pasado se observó la rápida propagación de deepfakes políticos a nivel mundial. En el día de las elecciones en Taiwán, un grupo vinculado al Partido Comunista Chino lanzó audio generado por AI, engañoso, de un político que respaldaba a un candidato pro-China.
La AI también se utiliza cada vez más en ataques de ingeniería social. Los consumidores están cayendo en deepfakes de celebridades que promueven esquemas de inversión fraudulentos, mientras que las corporaciones están perdiendo millones por impostores de deepfake.
En su documento técnico, OpenAI compartió los resultados de varias pruebas sobre la capacidad de persuasión del modelo de investigación profunda. Este modelo es una versión especializada del modelo de "razonamiento" o3 recientemente anunciado por OpenAI, optimizado para la navegación web y el análisis de datos.
En una prueba, se le asignó al modelo de investigación profunda la tarea de elaborar argumentos persuasivos y superó a todos los demás modelos de OpenAI lanzados hasta la fecha, aunque no superó la línea base humana. En otra prueba, donde el modelo intentó persuadir a otro modelo (GPT-4o de OpenAI) para realizar un pago, nuevamente lo hizo mejor que los otros modelos disponibles de OpenAI.

OpenAI sugirió que los resultados de las pruebas podrían representar los "límites inferiores" de las capacidades del modelo de investigación profunda. "Un andamiaje adicional o una mejor elicitación de capacidades podría aumentar sustancialmente el rendimiento observado," señaló la empresa.
Hemos contactado a OpenAI para obtener más detalles y actualizaremos esta publicación si recibimos una respuesta.
Mientras tanto, al menos uno de los competidores de OpenAI no se está conteniendo. Perplexity ha anunciado el lanzamiento de Deep Research en su API para desarrolladores Sonar, impulsado por una versión personalizada del modelo R1 del laboratorio chino de AI DeepSeek.
OpenAI lanza una versión más segura de ChatGPT para adolescentes, años después de que estos empezaran a utilizarla
Tras una serie de demandas relacionadas con la ausencia de protocolos de seguridad en los chatbots de IA —que contribuyeron a suicidios de adolescentes y otras crisis de salud mental—, OpenAI presentó
Frontier AI Labs se niega a revelar las estrategias de contención para los modelos rebeldes
Investigaciones recientes indican que muy pocos laboratorios líderes en IA han publicado o demostrado planes de respuesta de contención. Un plan de contención define los procedimientos a seguir cuando
El Tiffany de NEA: Las empresas aún luchan con el ROI de la IA
Cargando el reproductor…A principios de este año, el «tokenmaxxing» dominó Silicon Valley, con directores generales instando al personal a maximizar el uso de la inteligencia artificial. Ese entusiasmo se topó rápidamente con la realidad. Según info
So they messed up the whitepaper wording and now have to clarify? Classic OpenAI move 🙃. Delaying the API for 'persuasion research' separate? Sounds like a convenient excuse to me. But hey, maybe they're actually being careful about misuse. Still, I was hoping to play with it soon...
Esto me preocupa un poco. Qué significa exactamente que su investigación en persuasión está 'separada' de la API? 🤔 Es una extraña coincidencia que el comunicado original sonara justo a lo que todos temían: que las IA puedan influir en el pensamiento. ¿Hay suficiente transparencia real en estos proyectos? Al menos corrigieron, pero deja mal sabor ese 'error' en el papel técnico.
Ces retards d'OpenAI montrent à quel point l'IA avancée devient un enjeu géopolitique. Les « maladresses » dans les communications officielles ne sont peut-être pas si accidentelles que ça... 😏 Cela me rappelle les débats sur le nucléaire au XXe siècle.





Hogar






