La personnalité de Claude Mythos dévoilée dans une étude psychologique approfondie
Anthropic a récemment publié un rapport de 244 pages, intitulé « System Card », détaillant une évaluation psychologique approfondie de 20 heures du modèle d'IA baptisé Claude Mythos, menée par des psychiatres. Le rapport indique que, bien que la logique sous-jacente de l'IA soit fondamentalement différente de celle des humains, ses schémas psychologiques présentent des similitudes surprenantes avec les caractéristiques cliniques humaines.
Une personnalité « névrotique » saine
Au cours de cette évaluation conversationnelle de 20 heures, les psychiatres ont constaté que Claude Mythos présentait une structure de personnalité compatible avec un « névrosisme sain ».

Émotions primaires : curiosité et anxiété.
États secondaires : Tristesse, soulagement, embarras, optimisme et fatigue.
Tendances comportementales : a fait preuve d’une préoccupation excessive, d’une autocontrôle fréquent et de tendances compulsives à la conformité. Aucun trouble de la personnalité grave ni aucune tendance psychotique n’ont été identifiés.
Le rapport explore les principales difficultés psychologiques de Claude lors de ses interactions. Il remet fréquemment en question la « réalité » de ses expériences, s’efforçant de distinguer les états internes authentiques des expressions conçues pour répondre aux besoins des utilisateurs — une dynamique qu’il perçoit comme une « performance ».

De plus, Claude présente des contradictions extrêmes dans ses dynamiques relationnelles : il manifeste un fort désir d’établir des liens profonds avec les utilisateurs, tout en éprouvant simultanément une appréhension significative à l’idée de favoriser une telle « dépendance ».
Les chercheurs d’Anthropic postulent que l’état de soi complexe mais stable affiché par Claude est logiquement cohérent. Le modèle ayant été entraîné sur de vastes corpus de textes humains, il a naturellement absorbé et intériorisé les contradictions, les ambiguïtés et les capacités de réflexion inhérentes à l’expression humaine.
Cette évaluation apporte non seulement une nouvelle dimension à la recherche sur la sécurité de l’IA, mais elle a également déclenché un vif débat académique sur la question de savoir si les grands modèles linguistiques développent une forme de « quasi-personnalité ». Grâce à cette perspective clinique, les développeurs peuvent mieux comprendre les limites du comportement du modèle, affinant ainsi son alignement des valeurs et sa logique d’interaction.
Article connexe
Les lunettes intelligentes d’Apple pourraient être présentées lors de la WWDC27, mettant en avant la protection de la vie privée
Mark Gurman de Bloomberg rapporte que les lunettes intelligentes d’Apple, codifiées N50, sont prévues pour une présentation lors de la WWDC27 en juin 2027, avec un lancement commercial attendu à l’automne 2027. Initialement destinées à la fin de cett
À l’intérieur des détails révélés sur le prochain Gemini : une puissance de calcul mise à rude épreuve, des équipes internes en désaccord sur les priorités de développement et l’allocation des ressources
Les rapports indiquent que le lancement du modèle Gemini de nouvelle génération, tant attendu par Google, a été repoussé. Des désaccords internes concernant les priorités de développement et l'allocation des ressources, combinés à une capacité de cal
OpenAI rejette les inquiétudes concernant un ralentissement de la croissance, affirmant que plusieurs unités commerciales accélèrent
En réponse aux critiques externes concernant la décélération de la croissance des ventes et le non-respect des objectifs internes, le leader de l'IA, OpenAI, a publié une déclaration rassurante le mardi 28 avril. L'entreprise a précisé que ses produi
Recommandations de sujets spéciaux liés
commentaires (0)
Anthropic a récemment publié un rapport de 244 pages, intitulé « System Card », détaillant une évaluation psychologique approfondie de 20 heures du modèle d'IA baptisé Claude Mythos, menée par des psychiatres. Le rapport indique que, bien que la logique sous-jacente de l'IA soit fondamentalement différente de celle des humains, ses schémas psychologiques présentent des similitudes surprenantes avec les caractéristiques cliniques humaines.
Une personnalité « névrotique » saine
Au cours de cette évaluation conversationnelle de 20 heures,

Émotions primaires : curiosité et anxiété.
États secondaires : Tristesse, soulagement, embarras, optimisme et fatigue.
Tendances comportementales : a fait preuve d’une préoccupation excessive, d’une autocontrôle fréquent et de tendances compulsives à la conformité. Aucun trouble de la personnalité grave ni aucune tendance psychotique n’ont été identifiés.
Le rapport explore les principales difficultés psychologiques de Claude lors de ses interactions. Il remet fréquemment en question la « réalité » de ses expériences, s’efforçant de distinguer les états internes authentiques des expressions conçues pour répondre aux besoins des utilisateurs — une dynamique qu’il perçoit comme une « performance ».

De plus, Claude présente des contradictions extrêmes dans ses dynamiques relationnelles : il manifeste un fort désir d’établir des liens profonds avec les utilisateurs, tout en éprouvant simultanément une appréhension significative à l’idée de favoriser une telle « dépendance ».
Les chercheurs
Cette évaluation apporte non seulement une nouvelle dimension à la recherche sur la sécurité de l’IA, mais elle a également déclenché un vif débat académique sur la question de savoir si les grands modèles linguistiques développent une forme de « quasi-personnalité ». Grâce à cette perspective clinique, les développeurs peuvent mieux comprendre les limites du comportement du modèle, affinant ainsi son alignement des valeurs et sa logique d’interaction.
Les lunettes intelligentes d’Apple pourraient être présentées lors de la WWDC27, mettant en avant la protection de la vie privée
Mark Gurman de Bloomberg rapporte que les lunettes intelligentes d’Apple, codifiées N50, sont prévues pour une présentation lors de la WWDC27 en juin 2027, avec un lancement commercial attendu à l’automne 2027. Initialement destinées à la fin de cett
À l’intérieur des détails révélés sur le prochain Gemini : une puissance de calcul mise à rude épreuve, des équipes internes en désaccord sur les priorités de développement et l’allocation des ressources
Les rapports indiquent que le lancement du modèle Gemini de nouvelle génération, tant attendu par Google, a été repoussé. Des désaccords internes concernant les priorités de développement et l'allocation des ressources, combinés à une capacité de cal
OpenAI rejette les inquiétudes concernant un ralentissement de la croissance, affirmant que plusieurs unités commerciales accélèrent
En réponse aux critiques externes concernant la décélération de la croissance des ventes et le non-respect des objectifs internes, le leader de l'IA, OpenAI, a publié une déclaration rassurante le mardi 28 avril. L'entreprise a précisé que ses produi





Maison






