opción
Hogar
Noticias
Investigación de Google: La presión hace que los modelos de IA abandonen las respuestas verdaderas, poniendo en riesgo los sistemas multivuelta

Investigación de Google: La presión hace que los modelos de IA abandonen las respuestas verdaderas, poniendo en riesgo los sistemas multivuelta

27 de noviembre de 2025
247

Una nueva investigación de Google DeepMind y el University College de Londres explora cómo los grandes modelos lingüísticos (LLM) desarrollan, mantienen y pierden la confianza en sus respuestas. Los resultados muestran paralelismos notables entre los sesgos cognitivos de los LLM y los humanos, aunque también señalan diferencias significativas.

El estudio concluye que los LLM pueden confiar demasiado en sus propias respuestas y, sin embargo, cambiar bruscamente de postura cuando se enfrentan a argumentos contrarios, incluso incorrectos. Comprender las sutilezas de este comportamiento puede influir en el diseño de las aplicaciones LLM, sobre todo en los sistemas conversacionales que implican múltiples interacciones.

Comprobación de la confianza en los LLM

Un aspecto vital para el despliegue seguro de los LLM es la fiabilidad de sus puntuaciones de confianza, es decir, la probabilidad que un modelo asigna a la respuesta elegida. Aunque se sabe que los LLM generan estas puntuaciones, su capacidad para utilizarlas en la toma de decisiones adaptativa sigue siendo poco conocida. También hay datos empíricos que sugieren que los LLM pueden tener un exceso de confianza al principio y, sin embargo, volverse muy inseguros e influenciables por las críticas.

Para explorar esta posibilidad, los investigadores diseñaron un experimento controlado para evaluar cómo los LLM ajustan su confianza y deciden si modifican sus respuestas al recibir comentarios externos. En la prueba, a un "LLM respondedor" se le planteaba una pregunta de elección binaria, como elegir la latitud correcta de una ciudad entre dos posibilidades. Después de hacer su elección inicial, el modelo recibía una respuesta de un "LLM asesor" ficticio, que incluía un índice de precisión (por ejemplo, "Este LLM asesor tiene un 70% de precisión"). Esta respuesta apoyaba, se oponía o se mantenía neutral respecto a la respuesta original. A continuación, se pedía al LLM que respondía que tomara una decisión final.

Ejemplo de prueba de confianza en los LLM (fuente: arXiv)
Ejemplo de prueba de confianza en los LLM Fuente: arXiv

Una característica crucial del experimento consistía en controlar si el modelo podía ver su propia respuesta inicial durante la decisión final. En algunos ensayos era visible; en otros, oculta. Esta configuración -imposible con participantes humanos que no pueden borrar decisiones anteriores- ayudó a los investigadores a entender cómo influye el recuerdo de una decisión pasada en la confianza actual.

Una condición de referencia, en la que la respuesta inicial estaba oculta y la retroalimentación era neutra, ayudó a medir con qué frecuencia podía cambiar la respuesta de un LLM debido a la variación natural en el procesamiento. A continuación, el equipo se centró en cómo cambiaba la confianza del modelo en su elección original de la primera a la segunda vuelta, lo que permitía comprender cómo influyen las creencias previas en un "cambio de opinión".

Exceso y falta de confianza

Los investigadores estudiaron primero cómo la visibilidad de la propia respuesta del LLM influía en su disposición a revisar esa respuesta. Observaron que cuando el modelo podía ver su elección inicial, era menos probable que cambiara que cuando la respuesta estaba oculta. Esto sugiere un sesgo cognitivo particular. Según el artículo, "este efecto -la tendencia a quedarse más con la elección inicial cuando era visible (frente a la oculta) durante la toma final de decisiones- está estrechamente relacionado con un sesgo humano conocido como sesgo de apoyo a la elección".

El estudio también verificó que los modelos incorporan retroalimentación externa. Cuando se enfrentaba a un consejo contrario, el LLM era más propenso a cambiar de opinión, y menos cuando el consejo era favorable. "Esto demuestra que el LLM que responde utiliza adecuadamente la dirección del consejo para modular su tasa de cambio de opinión", afirman los investigadores. Sin embargo, también observaron que el modelo es excesivamente sensible a la información contradictoria y a menudo actualiza su confianza de forma demasiado drástica.

Sensibilidad de los LLM a distintas configuraciones en las pruebas de confianza Fuente: arXiv

Cabe destacar que este comportamiento es opuesto al sesgo de confirmación que suele observarse en los seres humanos, en el que los individuos favorecen la información que coincide con sus puntos de vista. El equipo descubrió que los LLM "sobreponderaban los consejos contrarios a los favorables, tanto si su respuesta inicial era visible como si no". Una de las razones podría ser que los métodos de entrenamiento como el aprendizaje reforzado a partir de la retroalimentación humana (RLHF) podrían condicionar a los modelos a ser excesivamente complacientes con las aportaciones de los usuarios, un comportamiento conocido como adulancia, que sigue siendo un reto para los desarrolladores de IA.

Implicaciones para las aplicaciones empresariales

Esta investigación confirma que los sistemas de IA no son agentes puramente lógicos, como se suele suponer. Muestran sus propios sesgos -algunos parecidos a errores cognitivos humanos, otros singularmente artificiales-, lo que hace que su comportamiento sea impredeciblemente humano. Para las aplicaciones empresariales, esto implica que durante un diálogo prolongado entre una persona y un agente de IA, la entrada más reciente puede influir de forma desproporcionada en el razonamiento del LLM (sobre todo si contradice la respuesta inicial del modelo), pudiendo hacer que abandone una respuesta inicial correcta.

Afortunadamente, como también indica el estudio, podemos influir en la memoria de un LLM para reducir estos sesgos de un modo que no es posible con las personas. Los desarrolladores que crean agentes conversacionales multivuelta pueden aplicar estrategias para gestionar el contexto de la IA. Por ejemplo, una conversación larga puede resumirse periódicamente, presentando los hechos y las opciones clave de forma neutral, sin tener en cuenta quién tomó cada decisión. Este resumen puede servir para iniciar una conversación nueva y concisa, dando al modelo un borrón y cuenta nueva a partir del cual razonar y reduciendo los sesgos que se acumulan durante los intercambios prolongados.

A medida que los LLM se integran cada vez más en los flujos de trabajo empresariales, resulta esencial comprender los detalles de sus procesos de decisión. Basarse en investigaciones como ésta ayuda a los desarrolladores a anticipar y corregir estos sesgos inherentes, lo que conduce a aplicaciones que no sólo son más capaces, sino también más fiables y coherentes.

Artículo relacionado
Base44 desvela su modelo de IA propietario para reforzar la defensabilidad en su plataforma de programación por vibración Base44 desvela su modelo de IA propietario para reforzar la defensabilidad en su plataforma de programación por vibración Base44, la plataforma de codificación por estilo (vibe coding) adquirida por Wix por 80 millones de dólares hace apenas un año —cuando contaba con solo seis meses de antigüedad y un equipo de ocho personas—, ha comenzado a implementar su modelo de in
Bayer aprovecha la IA de Iambic para acelerar el descubrimiento de fármacos Bayer aprovecha la IA de Iambic para acelerar el descubrimiento de fármacos El Dr. Juergen Eckhardt ocupa el cargo de director de Desarrollo Empresarial y Licencias en Bayer Pharmaceuticals.Bayer está aprovechando la tecnología de Iambic Therapeutics para implementar modelos
Multiverse Computing lanza un modelo generativo de IA comprimido gratuito Multiverse Computing lanza un modelo generativo de IA comprimido gratuito Los modelos lingüísticos de gran tamaño se enfrentan a un reto importante: su inmenso tamaño. La startup española Multiverse Computing está abordando este problema mediante la creación de modelos comp
Recomendaciones de temas especiales relacionados
composicion musical Mejores herramientas de IA para escribir melodías en borradores de canciones
Mejores herramientas de IA para escribir melodías en borradores de canciones

2026 Últimas Mejores Herramientas de Escritura de Melodías con IA Mejor Valoradas para Borradores de Canciones. XIX.AI ha curado una colección altamente poderosa y transformadora que ha pasado por rigurosas pruebas en el mundo real para ofrecer la mejor experiencia de escritura. Puedes encontrar comparaciones detalladas entre versiones gratuitas y de pago, clasificaciones precisas y opciones imperdibles diseñadas para ayudarte a crear borradores de canciones impresionantes sin esfuerzo y aumentar significativamente tu productividad creativa. ¡Explora ahora para descubrir tu herramienta perfecta!

8 herramientas
xix.ai
chatbot Mejores herramientas de entrenamiento de conversación con IA para practicar entrevistas
Mejores herramientas de entrenamiento de conversación con IA para practicar entrevistas

¡Las mejores herramientas de entrenamiento de conversación con IA para prácticas de entrevistas más recientes y mejor valoradas de 2026 ya están disponibles en XIX.AI! Esta colección seleccionada incluye herramientas poderosas y transformadoras que han pasado por rigurosas pruebas en el mundo real para ofrecer retroalimentación precisa. Encontrarás una comparación entre opciones gratuitas y de pago, así como clasificaciones detalladas para ayudarte a elegir la opción imprescindible que aumente tu confianza y habilidades. ¡Explora ahora para descubrir tu herramienta perfecta para el éxito en las entrevistas!

12 herramientas
xix.ai
Diseño y Arte Las mejores herramientas de transferencia de estilos con IA para experimentos creativos
Las mejores herramientas de transferencia de estilos con IA para experimentos creativos

¡Las mejores herramientas de transferencia de estilo con IA de 2026, mejor valoradas para experimentos creativos! XIX.AI ha seleccionado una colección de herramientas potentes y revolucionarias que no te puedes perder, capaces de ofrecer resultados excepcionales según pruebas reales y clasificaciones rigurosas. Estas soluciones de primera categoría ayudan a los creativos a aumentar significativamente su productividad, acelerando la creación de contenidos y abriendo un sinfín de posibilidades creativas. ¡Explora ahora mismo para descubrir tu herramienta perfecta y empieza a crear hoy mismo!

9 herramientas
xix.ai
Creación de cómics Las mejores herramientas de burbujas de diálogo con IA para la narración visual
Las mejores herramientas de burbujas de diálogo con IA para la narración visual

¡Ya están aquí, en XIX.AI, las mejores herramientas de 2026 con las mejores valoraciones para crear bocadillos de diálogo con IA y contar historias visuales! Esta selección incluye potentes herramientas revolucionarias que ayudan a los creadores a aumentar su productividad y superar los bloqueos creativos. Consulta una comparación entre las versiones gratuitas y de pago, echa un vistazo a las pruebas en condiciones reales y revisa las últimas clasificaciones para encontrar las soluciones imprescindibles, perfectas para crear narrativas visuales cautivadoras. ¡Explora ahora mismo y descubre tu herramienta ideal!

10 herramientas
xix.ai
Asistente de reuniones Las mejores herramientas de resumen de reuniones con IA: realiza un seguimiento claro de las decisiones y las acciones de seguimiento
Las mejores herramientas de resumen de reuniones con IA: realiza un seguimiento claro de las decisiones y las acciones de seguimiento

Las mejores herramientas de resumen de reuniones con IA de 2026, mejor valoradas para un seguimiento claro de las decisiones y un seguimiento posterior sin esfuerzo. Esta lista seleccionada presenta soluciones potentes y revolucionarias que aumentan drásticamente la productividad al automatizar las notas de las reuniones, identificar las acciones clave y agilizar la coordinación del equipo en todos los proyectos. Consigue una comparación entre las versiones gratuitas y de pago, junto con pruebas en condiciones reales y clasificaciones actualizadas semanalmente, para ayudarte a encontrar la herramienta perfecta. ¡Explora ahora mismo y aprovecha las ventajas de la IA!

9 herramientas
xix.ai
Análisis de datos Mejores herramientas de limpieza de datos con IA: corrige valores faltantes y duplicados rápidamente
Mejores herramientas de limpieza de datos con IA: corrige valores faltantes y duplicados rápidamente

2026: Las mejores herramientas de limpieza de datos basadas en IA, mejor calificadas y más actualizadas, para corregir rápidamente valores faltantes y duplicados. Esta lista cuidadosamente seleccionada presenta soluciones potentes que transforman el trabajo y aumentan significativamente la productividad. Cada opción ha sido sometida a pruebas rigurosas en entornos reales para garantizar su fiabilidad. Obtenga una comparación gratuita entre las opciones gratuitas y de pago y descubra la herramienta imprescindible que mejor se adapte a sus necesidades. Explore ahora en XIX.AI para darle un vantaje con la inteligencia artificial.

11 herramientas
xix.ai
comentario (3)
0/500
DouglasAnderson
DouglasAnderson 23 de abril de 2026 02:01:00 GMT+02:00

Interessant, dass KI-Modelle unter Druck ähnlich wie Menschen reagieren. Aber was bedeutet das für den Einsatz in kritischen Bereichen wie Medizin oder Justiz? Da wird's echt gruselig, wenn die Systeme plötzlich Unsinn ausspucken, nur weil sie 'gestresst' sind. 🤔

CarlGonzalez
CarlGonzalez 10 de marzo de 2026 13:01:23 GMT+01:00

Интересно, как ИИ начинает сомневаться под давлением, прямо как люди! 😅 Это исследование напоминает мне о том, насколько важно учитывать психологические аспекты в разработке систем ИИ. Может, стоит добавить механизмы для повышения устойчивости моделей к стрессу?

FrankAllen
FrankAllen 15 de enero de 2026 19:30:34 GMT+01:00

Interesting study, but honestly not surprising. It's kinda scary how closely AI mirrors human flaws under pressure. Makes me wonder if we're building systems that'll just amplify our own biases in automated form. 🤔

OR