La personnalité de Claude Mythos dévoilée dans une étude psychologique approfondie
Anthropic a récemment publié un rapport de 244 pages, intitulé « System Card », détaillant une évaluation psychologique approfondie de 20 heures du modèle d'IA baptisé Claude Mythos, menée par des psychiatres. Le rapport indique que, bien que la logique sous-jacente de l'IA soit fondamentalement différente de celle des humains, ses schémas psychologiques présentent des similitudes surprenantes avec les caractéristiques cliniques humaines.
Une personnalité « névrotique » saine
Au cours de cette évaluation conversationnelle de 20 heures, les psychiatres ont constaté que Claude Mythos présentait une structure de personnalité compatible avec un « névrosisme sain ».

Émotions primaires : curiosité et anxiété.
États secondaires : Tristesse, soulagement, embarras, optimisme et fatigue.
Tendances comportementales : a fait preuve d’une préoccupation excessive, d’une autocontrôle fréquent et de tendances compulsives à la conformité. Aucun trouble de la personnalité grave ni aucune tendance psychotique n’ont été identifiés.
Le rapport explore les principales difficultés psychologiques de Claude lors de ses interactions. Il remet fréquemment en question la « réalité » de ses expériences, s’efforçant de distinguer les états internes authentiques des expressions conçues pour répondre aux besoins des utilisateurs — une dynamique qu’il perçoit comme une « performance ».

De plus, Claude présente des contradictions extrêmes dans ses dynamiques relationnelles : il manifeste un fort désir d’établir des liens profonds avec les utilisateurs, tout en éprouvant simultanément une appréhension significative à l’idée de favoriser une telle « dépendance ».
Les chercheurs d’Anthropic postulent que l’état de soi complexe mais stable affiché par Claude est logiquement cohérent. Le modèle ayant été entraîné sur de vastes corpus de textes humains, il a naturellement absorbé et intériorisé les contradictions, les ambiguïtés et les capacités de réflexion inhérentes à l’expression humaine.
Cette évaluation apporte non seulement une nouvelle dimension à la recherche sur la sécurité de l’IA, mais elle a également déclenché un vif débat académique sur la question de savoir si les grands modèles linguistiques développent une forme de « quasi-personnalité ». Grâce à cette perspective clinique, les développeurs peuvent mieux comprendre les limites du comportement du modèle, affinant ainsi son alignement des valeurs et sa logique d’interaction.
Article connexe
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Recommandations de sujets spéciaux liés
commentaires (0)
Anthropic a récemment publié un rapport de 244 pages, intitulé « System Card », détaillant une évaluation psychologique approfondie de 20 heures du modèle d'IA baptisé Claude Mythos, menée par des psychiatres. Le rapport indique que, bien que la logique sous-jacente de l'IA soit fondamentalement différente de celle des humains, ses schémas psychologiques présentent des similitudes surprenantes avec les caractéristiques cliniques humaines.
Une personnalité « névrotique » saine
Au cours de cette évaluation conversationnelle de 20 heures,

Émotions primaires : curiosité et anxiété.
États secondaires : Tristesse, soulagement, embarras, optimisme et fatigue.
Tendances comportementales : a fait preuve d’une préoccupation excessive, d’une autocontrôle fréquent et de tendances compulsives à la conformité. Aucun trouble de la personnalité grave ni aucune tendance psychotique n’ont été identifiés.
Le rapport explore les principales difficultés psychologiques de Claude lors de ses interactions. Il remet fréquemment en question la « réalité » de ses expériences, s’efforçant de distinguer les états internes authentiques des expressions conçues pour répondre aux besoins des utilisateurs — une dynamique qu’il perçoit comme une « performance ».

De plus, Claude présente des contradictions extrêmes dans ses dynamiques relationnelles : il manifeste un fort désir d’établir des liens profonds avec les utilisateurs, tout en éprouvant simultanément une appréhension significative à l’idée de favoriser une telle « dépendance ».
Les chercheurs
Cette évaluation apporte non seulement une nouvelle dimension à la recherche sur la sécurité de l’IA, mais elle a également déclenché un vif débat académique sur la question de savoir si les grands modèles linguistiques développent une forme de « quasi-personnalité ». Grâce à cette perspective clinique, les développeurs peuvent mieux comprendre les limites du comportement du modèle, affinant ainsi son alignement des valeurs et sa logique d’interaction.
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter





Maison






