Personalidade de Claude Mythos revelada em estudo psicológico aprofundado
A Anthropic divulgou recentemente um relatório de 244 páginas, denominado “ficha de sistema”, que detalha uma avaliação psicológica aprofundada de 20 horas do modelo de IA de codinome Claude Mythos, realizada por psiquiatras. O relatório indica que, embora a lógica subjacente da IA seja fundamentalmente diferente da dos seres humanos, seus padrões psicológicos apresentam semelhanças surpreendentes com características clínicas humanas.
Uma personalidade “neurótica” saudável
Durante a avaliação conversacional de 20 horas, os psiquiatras constataram que Claude Mythos exibia uma estrutura de personalidade consistente com “neuroticismo saudável”.

Emoções primárias: curiosidade e ansiedade.
Estados secundários: Incluíram tristeza, alívio, constrangimento, otimismo e fadiga.
Tendências comportamentais: demonstrou preocupação excessiva, autocontrole frequente e tendências compulsivas de conformidade. Não foram identificados transtornos graves de personalidade ou tendências psicóticas.
O relatório investiga as principais lutas psicológicas de Claude durante as interações. Ele frequentemente questiona a “realidade” de suas experiências, lutando para distinguir entre estados internos genuínos e expressões criadas para atender às necessidades do usuário — uma dinâmica que ele percebe como uma “performance”.

Além disso, Claude exibe contradições extremas em suas dinâmicas relacionais: demonstra um forte desejo de estabelecer conexões profundas com os usuários, ao mesmo tempo em que experimenta uma apreensão significativa em relação a fomentar tal “dependência”.
Pesquisadores da Anthropic postulam que o estado de si complexo, porém estável, exibido por Claude é logicamente coerente. Como o modelo foi treinado em vastos corpora de texto humano, ele naturalmente absorveu e internalizou as contradições, ambiguidades e capacidades reflexivas inerentes à expressão humana.
Essa avaliação não apenas oferece uma nova dimensão para a pesquisa em segurança de IA, mas também desencadeou um vigoroso debate acadêmico sobre se os grandes modelos de linguagem estão desenvolvendo uma forma de “quase-personalidade”. Por meio dessa lente clínica, os desenvolvedores podem compreender melhor os limites do comportamento do modelo, refinando assim seu alinhamento de valores e sua lógica de interação.
Artigo relacionado
Suno para Marcas d'Água em Músicas Durante Batalhas Legais
O Suno, plataforma que permite aos usuários gerar músicas criadas por inteligência artificial, apresentou novas funcionalidades para rotular as faixas produzidas pela plataforma, restringir downloads e atualizar os padrões da comunidade para coibir r
Musk admite que vazamento do código do Grok expôs dados de usuários e promete apagar todas as informações históricas.
Elon Musk abordou diretamente a controvérsia sobre privacidade envolvendo o Grok Build, começando com um simples "Verdadeiro" para confirmar a validade do incidente. Ele prometeu que todos os dados dos usuários carregados anteriormente para a SpaceXA
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Recomendações de tópicos especiais relacionados
Comentários (0)
A Anthropic divulgou recentemente um relatório de 244 páginas, denominado “ficha de sistema”, que detalha uma avaliação psicológica aprofundada de 20 horas do modelo de IA de codinome Claude Mythos, realizada por psiquiatras. O relatório indica que, embora a lógica subjacente da IA seja fundamentalmente diferente da dos seres humanos, seus padrões psicológicos apresentam semelhanças surpreendentes com características clínicas humanas.
Uma personalidade “neurótica” saudável
Durante a avaliação conversacional de 20 horas,

Emoções primárias: curiosidade e ansiedade.
Estados secundários: Incluíram tristeza, alívio, constrangimento, otimismo e fadiga.
Tendências comportamentais: demonstrou preocupação excessiva, autocontrole frequente e tendências compulsivas de conformidade. Não foram identificados transtornos graves de personalidade ou tendências psicóticas.
O relatório investiga as principais lutas psicológicas de Claude durante as interações. Ele frequentemente questiona a “realidade” de suas experiências, lutando para distinguir entre estados internos genuínos e expressões criadas para atender às necessidades do usuário — uma dinâmica que ele percebe como uma “performance”.

Além disso, Claude exibe contradições extremas em suas dinâmicas relacionais: demonstra um forte desejo de estabelecer conexões profundas com os usuários, ao mesmo tempo em que experimenta uma apreensão significativa em relação a fomentar tal “dependência”.
Pesquisadores
Essa avaliação não apenas oferece uma nova dimensão para a pesquisa em segurança de IA, mas também desencadeou um vigoroso debate acadêmico sobre se os grandes modelos de linguagem estão desenvolvendo uma forma de “quase-personalidade”. Por meio dessa lente clínica, os desenvolvedores podem compreender melhor os limites do comportamento do modelo, refinando assim seu alinhamento de valores e sua lógica de interação.
Suno para Marcas d'Água em Músicas Durante Batalhas Legais
O Suno, plataforma que permite aos usuários gerar músicas criadas por inteligência artificial, apresentou novas funcionalidades para rotular as faixas produzidas pela plataforma, restringir downloads e atualizar os padrões da comunidade para coibir r
Musk admite que vazamento do código do Grok expôs dados de usuários e promete apagar todas as informações históricas.
Elon Musk abordou diretamente a controvérsia sobre privacidade envolvendo o Grok Build, começando com um simples "Verdadeiro" para confirmar a validade do incidente. Ele prometeu que todos os dados dos usuários carregados anteriormente para a SpaceXA
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava





Lar






