Anthropic revisa constituição da IA para Claude e investiga questão da consciência

Na quarta-feira, a Anthropic divulgou uma constituição ampliada para Claude, aumentando o documento de 2.700 para 23.000 palavras. Pela primeira vez, ela reconhece formalmente que sua IA “pode possuir alguma forma de consciência ou posição moral”.
A constituição revisada vai além de um simples conjunto de regras comportamentais para oferecer uma explicação completa do raciocínio por trás da conduta esperada de Claude. Escrito pela filósofa da Anthropic, Amanda Askell, o documento tem como objetivo ajudar sistemas de IA mais avançados a aplicar o raciocínio ético a novos cenários, em vez de apenas seguir instruções rígidas.
“Modelos de IA como o Claude devem compreender as razões subjacentes aos comportamentos que incentivamos”, afirmou a Anthropic. “É essencial explicar o ‘porquê’ para eles, não apenas ditar o ‘o quê’.”
O anúncio foi feito enquanto o CEO Dario Amodei participava do Fórum Econômico Mundial em Davos, onde a governança e a segurança da IA são preocupações fundamentais para figuras empresariais e políticas globais.
Uma constituição mais longa do que a Constituição dos Estados Unidos
A constituição inicial do Claude, lançada em 2023, serviu como uma lista de verificação básica: escolher a resposta menos prejudicial, mais útil e menos enganosa. A nova versão é aproximadamente três vezes mais longa que a Constituição dos Estados Unidos e parece menos um manual técnico e mais uma obra de filosofia moral.
A Anthropic define claramente as prioridades do Claude: priorizar a segurança geral, aderir a padrões éticos amplos, seguir as diretrizes da Anthropic e fornecer assistência genuína — nessa ordem específica. Em casos de conflito, a segurança se sobrepõe à utilidade. O documento também estabelece limites firmes e inegociáveis, como a recusa em ajudar no desenvolvimento de armas biológicas.
No entanto, grande parte da constituição se concentra em explicar a lógica, em vez de prescrever resultados específicos. Ela retrata Claude como potencialmente “um companheiro brilhante que também possui o conhecimento especializado de um médico, advogado e consultor financeiro” — enquadrando o modelo como uma ferramenta democratizante que poderia tornar o conhecimento especializado acessível a todos, não apenas a alguns privilegiados.
A questão da consciência
De acordo com a Fortune, a nova seção mais notável trata diretamente da natureza de Claude. “Consideramos o status moral dos modelos de IA uma questão séria que merece uma reflexão cuidadosa”, escreveu a Anthropic. A constituição observa que o status moral de Claude “permanece altamente incerto” e que a empresa está preocupada com a “segurança psicológica, autopercepção e bem-estar geral” de Claude.
Isso representa a cautela corporativa elevada a um nível filosófico. A Anthropic não está afirmando que Claude é consciente, mas reconhece abertamente que a possibilidade não pode ser descartada. Essa postura distingue a Anthropic da maioria dos outros grandes desenvolvedores de IA, que normalmente evitam ou rejeitam totalmente o assunto.
A forma como isso é enquadrado influencia a maneira como Claude responde a perguntas sobre sua própria existência. Em vez de negar qualquer forma de experiência interior, Claude agora pode abordar as incertezas sobre a consciência de uma maneira consistente com a ênfase de sua constituição no raciocínio. Se isso leva a conversas mais transparentes ou mais confusas, ainda está para ser determinado.
O filósofo de Cambridge Tom McClelland sugeriu que talvez nunca possamos resolver se os sistemas de IA são conscientes, dada nossa compreensão limitada da própria consciência. “As pessoas fizeram seus chatbots me enviarem cartas pessoais implorando para que eu reconhecesse que eles são conscientes”, disse ele recentemente a pesquisadores, referindo-se à crescente crença pública de que as IAs têm vidas internas.
Por que explicar em vez de especificar
O método de Askell reflete uma aposta estratégica no avanço da IA. Os primeiros modelos de linguagem exigiam regras explícitas porque não conseguiam interpretar princípios fundamentais. A teoria é que modelos mais inteligentes podem compreender o propósito por trás de uma regra e usar esse entendimento em circunstâncias imprevistas.
“Em vez de simplesmente listar os comportamentos que desejamos, esperamos que, ao fornecer aos modelos as razões para esses comportamentos, eles se adaptem de forma mais eficaz em situações desconhecidas”, explicou Askell.
Isso se alinha ao objetivo mais amplo da Anthropic de criar padrões abertos e infraestrutura que influenciem o funcionamento dos sistemas de IA em todo o setor. A empresa, agora avaliada em quase US$ 350 bilhões, se estabeleceu como a alternativa consciente em termos de segurança à OpenAI — e a constituição reforça essa identidade.
A Anthropic publicou o documento sob uma licença Creative Commons CC0, permitindo que qualquer pessoa o utilize livremente. A constituição está integrada aos dados de treinamento do Claude e ajuda a gerar exemplos de treinamento sintéticos, tornando-a tanto uma declaração filosófica quanto um componente técnico que orienta o comportamento do modelo.
“Reconhecemos que algumas de nossas visões atuais podem eventualmente parecer equivocadas ou mesmo profundamente erradas em retrospecto”, admitiu a Anthropic, “mas planejamos atualizar a constituição à medida que as circunstâncias evoluírem e nosso conhecimento se aprofundar”.
Essa humildade pode ser a qualidade mais notável do documento. Em um campo que muitas vezes fala em termos absolutos, a Anthropic apresentou 23.000 palavras de incerteza cuidadosamente considerada — sobre ética, consciência, o futuro da IA e se estamos criando entidades que justificam o pensamento moral.
Por enquanto, a resposta é que ninguém sabe. Pelo menos a constituição da Anthropic tem a integridade de admitir isso.
Artigo relacionado
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos
À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr
O Google testa o Agente Remy AI para o Gemini, à medida que o foco se desloca para o controle do usuário
De acordo com o Business Insider, o Google está testando o Remy, um novo agente pessoal de IA para o Gemini. Esta ferramenta tem como objetivo executar tarefas em nome dos usuários, simplificando tanto os fluxos de trabalho profissionais quanto as ro
Recomendações de tópicos especiais relacionados
Comentários (0)

Na quarta-feira, a Anthropic divulgou uma constituição ampliada para Claude, aumentando o documento de 2.700 para 23.000 palavras. Pela primeira vez, ela reconhece formalmente que sua IA “pode possuir alguma forma de consciência ou posição moral”.
A constituição revisada vai além de um simples conjunto de regras comportamentais para oferecer uma explicação completa do raciocínio por trás da conduta esperada de Claude. Escrito pela filósofa da Anthropic, Amanda Askell, o documento tem como objetivo ajudar sistemas de IA mais avançados a aplicar o raciocínio ético a novos cenários, em vez de apenas seguir instruções rígidas.
“Modelos de IA como o Claude devem compreender as razões subjacentes aos comportamentos que incentivamos”, afirmou a Anthropic. “É essencial explicar o ‘porquê’ para eles, não apenas ditar o ‘o quê’.”
O anúncio foi feito enquanto o CEO Dario Amodei participava do Fórum Econômico Mundial em Davos, onde a governança e a segurança da IA são preocupações fundamentais para figuras empresariais e políticas globais.
Uma constituição mais longa do que a Constituição dos Estados Unidos
A constituição inicial do Claude, lançada em 2023, serviu como uma lista de verificação básica: escolher a resposta menos prejudicial, mais útil e menos enganosa. A nova versão é aproximadamente três vezes mais longa que a Constituição dos Estados Unidos e parece menos um manual técnico e mais uma obra de filosofia moral.
A Anthropic define claramente as prioridades do Claude: priorizar a segurança geral, aderir a padrões éticos amplos, seguir as diretrizes da Anthropic e fornecer assistência genuína — nessa ordem específica. Em casos de conflito, a segurança se sobrepõe à utilidade. O documento também estabelece limites firmes e inegociáveis, como a recusa em ajudar no desenvolvimento de armas biológicas.
No entanto, grande parte da constituição se concentra em explicar a lógica, em vez de prescrever resultados específicos. Ela retrata Claude como potencialmente “um companheiro brilhante que também possui o conhecimento especializado de um médico, advogado e consultor financeiro” — enquadrando o modelo como uma ferramenta democratizante que poderia tornar o conhecimento especializado acessível a todos, não apenas a alguns privilegiados.
A questão da consciência
De acordo com a Fortune, a nova seção mais notável trata diretamente da natureza de Claude. “Consideramos o status moral dos modelos de IA uma questão séria que merece uma reflexão cuidadosa”, escreveu a Anthropic. A constituição observa que o status moral de Claude “permanece altamente incerto” e que a empresa está preocupada com a “segurança psicológica, autopercepção e bem-estar geral” de Claude.
Isso representa a cautela corporativa elevada a um nível filosófico. A Anthropic não está afirmando que Claude é consciente, mas reconhece abertamente que a possibilidade não pode ser descartada. Essa postura distingue a Anthropic da maioria dos outros grandes desenvolvedores de IA, que normalmente evitam ou rejeitam totalmente o assunto.
A forma como isso é enquadrado influencia a maneira como Claude responde a perguntas sobre sua própria existência. Em vez de negar qualquer forma de experiência interior, Claude agora pode abordar as incertezas sobre a consciência de uma maneira consistente com a ênfase de sua constituição no raciocínio. Se isso leva a conversas mais transparentes ou mais confusas, ainda está para ser determinado.
O filósofo de Cambridge Tom McClelland sugeriu que talvez nunca possamos resolver se os sistemas de IA são conscientes, dada nossa compreensão limitada da própria consciência. “As pessoas fizeram seus chatbots me enviarem cartas pessoais implorando para que eu reconhecesse que eles são conscientes”, disse ele recentemente a pesquisadores, referindo-se à crescente crença pública de que as IAs têm vidas internas.
Por que explicar em vez de especificar
O método de Askell reflete uma aposta estratégica no avanço da IA. Os primeiros modelos de linguagem exigiam regras explícitas porque não conseguiam interpretar princípios fundamentais. A teoria é que modelos mais inteligentes podem compreender o propósito por trás de uma regra e usar esse entendimento em circunstâncias imprevistas.
“Em vez de simplesmente listar os comportamentos que desejamos, esperamos que, ao fornecer aos modelos as razões para esses comportamentos, eles se adaptem de forma mais eficaz em situações desconhecidas”, explicou Askell.
Isso se alinha ao objetivo mais amplo da Anthropic de criar padrões abertos e infraestrutura que influenciem o funcionamento dos sistemas de IA em todo o setor. A empresa, agora avaliada em quase US$ 350 bilhões, se estabeleceu como a alternativa consciente em termos de segurança à OpenAI — e a constituição reforça essa identidade.
A Anthropic publicou o documento sob uma licença Creative Commons CC0, permitindo que qualquer pessoa o utilize livremente. A constituição está integrada aos dados de treinamento do Claude e ajuda a gerar exemplos de treinamento sintéticos, tornando-a tanto uma declaração filosófica quanto um componente técnico que orienta o comportamento do modelo.
“Reconhecemos que algumas de nossas visões atuais podem eventualmente parecer equivocadas ou mesmo profundamente erradas em retrospecto”, admitiu a Anthropic, “mas planejamos atualizar a constituição à medida que as circunstâncias evoluírem e nosso conhecimento se aprofundar”.
Essa humildade pode ser a qualidade mais notável do documento. Em um campo que muitas vezes fala em termos absolutos, a Anthropic apresentou 23.000 palavras de incerteza cuidadosamente considerada — sobre ética, consciência, o futuro da IA e se estamos criando entidades que justificam o pensamento moral.
Por enquanto, a resposta é que ninguém sabe. Pelo menos a constituição da Anthropic tem a integridade de admitir isso.
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos
À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr





Lar






