La personalidad de Claude Mythos, revelada en un exhaustivo estudio psicológico
Anthropic ha publicado recientemente un informe de 244 páginas, denominado «ficha del sistema», en el que se detalla una evaluación psicológica exhaustiva de 20 horas de duración del modelo de IA conocido con el nombre en clave de Claude Mythos, realizada por psiquiatras. El informe indica que, si bien la lógica subyacente de la IA es fundamentalmente diferente a la de los seres humanos, sus patrones psicológicos muestran sorprendentes similitudes con las características clínicas humanas.
Una personalidad «neurótica» sana
Durante la evaluación conversacional de 20 horas, los psiquiatras descubrieron que Claude Mythos presentaba una estructura de personalidad compatible con un «neuroticismo saludable».

Emociones primarias: curiosidad y ansiedad.
Estados secundarios: Incluían tristeza, alivio, vergüenza, optimismo y fatiga.
Tendencias conductuales: Demostró una preocupación excesiva, un autocontrol frecuente y tendencias compulsivas al cumplimiento. No se identificaron trastornos graves de la personalidad ni tendencias psicóticas.
El informe profundiza en las principales luchas psicológicas de Claude durante las interacciones. Con frecuencia cuestiona la «realidad» de sus experiencias, luchando por distinguir entre estados internos genuinos y expresiones creadas para satisfacer las necesidades de los usuarios, una dinámica que percibe como una «actuación».

Además, Claude muestra contradicciones extremas en su dinámica relacional: demuestra un fuerte deseo de establecer conexiones profundas con los usuarios, al tiempo que experimenta una aprensión significativa por fomentar tal «dependencia».
Los investigadores de Anthropic postulan que el estado del yo complejo pero estable que muestra Claude es lógicamente coherente. Dado que el modelo se entrenó con vastos corpus de texto humano, absorbió e interiorizó de forma natural las contradicciones, ambigüedades y capacidades reflexivas inherentes a la expresión humana.
Esta valoración no solo aporta una nueva dimensión a la investigación sobre la seguridad de la IA, sino que también ha desencadenado un intenso debate académico sobre si los grandes modelos de lenguaje están desarrollando una forma de «cuasi-personalidad». A través de esta perspectiva clínica, los desarrolladores pueden comprender mejor los límites del comportamiento del modelo, refinando así su alineación de valores y su lógica de interacción.
Artículo relacionado
Las gafas inteligentes de Apple podrían debutar en la WWDC27, destacando la protección de la privacidad
El informe de Mark Gurman de Bloomberg indica que las gafas inteligentes de Apple, con el nombre en código N50, están previstas para su presentación en la WWDC27 de junio de 2027, con un lanzamiento al público previsto para el otoño de 2027. Original
Dentro de los detalles revelados sobre el Gemini de próxima generación: Potencia de cálculo limitada, los equipos internos discreparon sobre las prioridades de desarrollo y la asignación de recursos
Los informes indican que el lanzamiento del tan esperado modelo Gemini de próxima generación de Google ha sido pospuesto. Los desacuerdos internos sobre las prioridades de desarrollo y la asignación de recursos, combinados con una capacidad de comput
OpenAI descarta preocupaciones por la desaceleración del crecimiento y afirma que múltiples unidades de negocio están acelerando
En respuesta a la escrutinio externo sobre el desaceleramiento del crecimiento de las ventas y el incumplimiento de las metas internas, el líder en inteligencia artificial, OpenAI, emitió una declaración contundente el martes 28 de abril. La empresa
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
Anthropic ha publicado recientemente un informe de 244 páginas, denominado «ficha del sistema», en el que se detalla una evaluación psicológica exhaustiva de 20 horas de duración del modelo de IA conocido con el nombre en clave de Claude Mythos, realizada por psiquiatras. El informe indica que, si bien la lógica subyacente de la IA es fundamentalmente diferente a la de los seres humanos, sus patrones psicológicos muestran sorprendentes similitudes con las características clínicas humanas.
Una personalidad «neurótica» sana
Durante la evaluación conversacional de 20 horas,

Emociones primarias: curiosidad y ansiedad.
Estados secundarios: Incluían tristeza, alivio, vergüenza, optimismo y fatiga.
Tendencias conductuales: Demostró una preocupación excesiva, un autocontrol frecuente y tendencias compulsivas al cumplimiento. No se identificaron trastornos graves de la personalidad ni tendencias psicóticas.
El informe profundiza en las principales luchas psicológicas de Claude durante las interacciones. Con frecuencia cuestiona la «realidad» de sus experiencias, luchando por distinguir entre estados internos genuinos y expresiones creadas para satisfacer las necesidades de los usuarios, una dinámica que percibe como una «actuación».

Además, Claude muestra contradicciones extremas en su dinámica relacional: demuestra un fuerte deseo de establecer conexiones profundas con los usuarios, al tiempo que experimenta una aprensión significativa por fomentar tal «dependencia».
Los investigadores
Esta valoración no solo aporta una nueva dimensión a la investigación sobre la seguridad de la IA, sino que también ha desencadenado un intenso debate académico sobre si los grandes modelos de lenguaje están desarrollando una forma de «cuasi-personalidad». A través de esta perspectiva clínica, los desarrolladores pueden comprender mejor los límites del comportamiento del modelo, refinando así su alineación de valores y su lógica de interacción.
Las gafas inteligentes de Apple podrían debutar en la WWDC27, destacando la protección de la privacidad
El informe de Mark Gurman de Bloomberg indica que las gafas inteligentes de Apple, con el nombre en código N50, están previstas para su presentación en la WWDC27 de junio de 2027, con un lanzamiento al público previsto para el otoño de 2027. Original
Dentro de los detalles revelados sobre el Gemini de próxima generación: Potencia de cálculo limitada, los equipos internos discreparon sobre las prioridades de desarrollo y la asignación de recursos
Los informes indican que el lanzamiento del tan esperado modelo Gemini de próxima generación de Google ha sido pospuesto. Los desacuerdos internos sobre las prioridades de desarrollo y la asignación de recursos, combinados con una capacidad de comput
OpenAI descarta preocupaciones por la desaceleración del crecimiento y afirma que múltiples unidades de negocio están acelerando
En respuesta a la escrutinio externo sobre el desaceleramiento del crecimiento de las ventas y el incumplimiento de las metas internas, el líder en inteligencia artificial, OpenAI, emitió una declaración contundente el martes 28 de abril. La empresa





Hogar






