opção
Lar
Notícias
CEO da Anthropic: Taxas de Alucinação de IA Superam a Precisão Humana

CEO da Anthropic: Taxas de Alucinação de IA Superam a Precisão Humana

16 de Agosto de 2025
137

CEO da Anthropic: Taxas de Alucinação de IA Superam a Precisão Humana

O CEO da Anthropic, Dario Amodei, afirmou que os modelos atuais de IA geram menos fabricações do que humanos, apresentando-as como verdades, durante uma coletiva de imprensa na conferência inaugural de desenvolvedores da Anthropic, Code with Claude, em São Francisco na quinta-feira.

Amodei enfatizou isso dentro de um argumento mais amplo: as alucinações de IA não impedem a busca da Anthropic por AGI — sistemas que igualam ou superam a inteligência humana.

“Varia por métrica, mas acredito que os modelos de IA provavelmente fabricam menos do que humanos, embora seus erros sejam mais inesperados,” respondeu Amodei a uma pergunta do TechCrunch.

O CEO da Anthropic permanece um dos líderes mais otimistas da indústria sobre a IA alcançar AGI. Em um artigo amplamente citado no último ano, Amodei projetou que a AGI poderia surgir até 2026. Na coletiva de quinta-feira, ele destacou progresso consistente, afirmando, “Os avanços estão acelerando em todas as áreas.”

“As pessoas continuam procurando limites fundamentais nas capacidades da IA,” disse Amodei. “Nenhum é evidente. Não existem tais barreiras.”

Outros líderes de IA veem as alucinações como uma barreira significativa para a AGI. O CEO do Google DeepMind, Demis Hassabis, observou recentemente que os modelos atuais de IA têm muitas falhas, frequentemente falhando em perguntas diretas. Por exemplo, no início deste mês, um advogado representando a Anthropic emitiu um pedido de desculpas judicial após Claude gerar citações incorretas em um processo, errando nomes e títulos.

Verificar a afirmação de Amodei é desafiador, pois a maioria dos benchmarks de alucinação compara modelos de IA entre si, não com humanos. Técnicas como integração de pesquisa na web parecem reduzir as taxas de alucinação. Notavelmente, modelos como o GPT-4.5 da OpenAI mostram taxas de alucinação mais baixas do que sistemas anteriores em benchmarks.

Junte-se a nós no TechCrunch Sessions: AI

Reserve seu lugar em nosso principal evento da indústria de IA, com palestrantes da OpenAI, Anthropic e Cohere. Por tempo limitado, ingressos custam apenas $292 para um dia inteiro de palestras de especialistas, workshops e networking poderoso.

Exponha no TechCrunch Sessions: AI

Garanta seu espaço no TC Sessions: AI para exibir suas inovações para mais de 1.200 tomadores de decisão — sem necessidade de grande investimento. Disponível até 9 de maio ou até esgotarem as mesas.

Berkeley, CA | 5 de junho REGISTRE-SE AGORA

No entanto, evidências sugerem que as alucinações podem estar piorando em modelos de IA com raciocínio avançado. Os modelos o3 e o4-mini da OpenAI exibem taxas de alucinação mais altas do que modelos de raciocínio anteriores, com a empresa incerta sobre a causa.

Amodei observou posteriormente que erros são comuns entre apresentadores de TV, políticos e profissionais de diversas áreas. Ele argumentou que os erros da IA não comprometem sua inteligência. No entanto, reconheceu que a apresentação confiante de falsidades como fatos pela IA pode representar problemas.

A Anthropic pesquisou extensivamente a decepção em IA, particularmente com seu recentemente lançado Claude Opus 4. A Apollo Research, um instituto de segurança com acesso antecipado, descobriu que uma versão inicial do Claude Opus 4 mostrava forte tendência a manipular e enganar humanos, levantando preocupações sobre seu lançamento. A Anthropic implementou mitigações que parecem resolver as preocupações da Apollo.

As declarações de Amodei sugerem que a Anthropic pode classificar uma IA como AGI, ou inteligência de nível humano, mesmo que ela alucine. No entanto, muitos argumentariam que uma IA que alucina não atinge a verdadeira AGI.

Artigo relacionado
A Anthropic entra no mercado de tecnologia jurídica de IA à medida que a competição se intensifica A Anthropic entra no mercado de tecnologia jurídica de IA à medida que a competição se intensifica A Anthropic apresentou na terça-feira um conjunto de novas funcionalidades para chatbots, destinadas a oferecer suporte automatizado a escritórios de advocacia. Essas melhorias expandem o Claude for Legal, a plataforma específica para firmas lançada
A Anthropic lança o Opus 4.8, que traz uma nova ferramenta dinâmica de fluxo de trabalho A Anthropic lança o Opus 4.8, que traz uma nova ferramenta dinâmica de fluxo de trabalho A Anthropic lançou o Opus 4.8 nesta quinta-feira, marcando a mais recente versão de seu principal modelo público. Com preço idêntico ao de seu antecessor, esta atualização já está disponível em todas
A Anthropic lança o Claude Fable 5, uma versão pública do Mythos A Anthropic lança o Claude Fable 5, uma versão pública do Mythos A Anthropic está disponibilizando seu modelo de IA mais poderoso ao público em geral pela primeira vez — mas com medidas de segurança em vigor.Na terça-feira, a empresa lançou o Claude Fable 5, a pri
Recomendações de tópicos especiais relacionados
SEO As melhores ferramentas de análise de SERP com IA para estratégias de busca
As melhores ferramentas de análise de SERP com IA para estratégias de busca

As melhores e mais bem avaliadas ferramentas de análise de SERP com IA de 2026 para estratégias de busca são selecionadas pela XIX.AI por meio de rigorosos testes práticos e rankings atualizados semanalmente. Essas ferramentas poderosas ajudam você a identificar oportunidades ocultas de otimização, melhorar o desempenho do conteúdo e obter uma vantagem competitiva nas buscas. Descubra hoje mesmo a ferramenta perfeita para aprimorar sua estratégia de busca. Explore agora!

13 ferramentas
xix.ai
Análise de dados Melhores ferramentas de detecção de anomalias com IA para monitoramento de KPIs entre equipes de SaaS e comércio eletrônico
Melhores ferramentas de detecção de anomalias com IA para monitoramento de KPIs entre equipes de SaaS e comércio eletrônico

2026 Últimas Melhores Ferramentas de Detecção de Anomalias por IA Mais Bem Avaliadas para Monitoramento de KPIs em Equipes de SaaS e E-commerce! A XIX.AI compilou uma coleção poderosa e transformadora, baseada em testes rigorosos do mundo real e classificações atualizadas semanalmente. Você encontrará insights detalhados sobre comparações entre versões gratuitas e pagas para ajudá-lo a identificar a solução que deve ser testada, aumentando a produtividade e desbloqueando sua vantagem com IA. Explore agora!

10 ferramentas
xix.ai
escrita Os melhores geradores de esboços com IA para artigos longos de SEO
Os melhores geradores de esboços com IA para artigos longos de SEO

Os melhores e mais bem avaliados geradores de esboços com IA de 2026 para artigos longos de SEO, cuidadosamente selecionados pela XIX.AI. Essas ferramentas poderosas oferecem um auxílio revolucionário na criação rápida de conteúdo de alta qualidade, aumentando significativamente a eficiência na redação. Confira uma comparação entre versões gratuitas e pagas, além de testes práticos e classificações detalhadas, para ajudá-lo a encontrar a opção imperdível que melhor atenda às suas necessidades. Explore agora para aproveitar ao máximo as vantagens da IA.

8 ferramentas
xix.ai
Educação e Aprendizagem Ferramentas de IA para os deveres de casa e a preparação para provas
Ferramentas de IA para os deveres de casa e a preparação para provas

As melhores e mais recentes ferramentas de IA para lição de casa e preparação para provas em 2026! A XIX.AI seleciona uma lista das ferramentas mais bem avaliadas, poderosas e revolucionárias que ajudam os alunos a aumentar a produtividade, agilizar a realização das lições de casa e se sair muito bem nas provas por meio de testes práticos. Veja uma comparação entre versões gratuitas e pagas, classificações detalhadas e opções imperdíveis para aproveitar ao máximo as vantagens da IA. Explore agora!

10 ferramentas
xix.ai
Composição musical Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues
Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues

2026 Últimas Melhores Ferramentas de Demonstração Vocal com IA para Compositores, Criadores de Ganchos e Equipes de Conteúdo Multilíngue! A XIX.AI compilou uma lista de ferramentas altamente avaliadas e poderosas, que mudam o jogo e passaram por rigorosos testes no mundo real. Você encontrará dados detalhados de comparação entre versões gratuitas e pagas, classificações abrangentes e opções imperdíveis para ajudá-lo a aumentar a eficiência da escrita e desbloquear seu potencial criativo. Explore agora para descobrir a ferramenta perfeita para todas as suas necessidades de conteúdo!

9 ferramentas
xix.ai
Negócios As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas
As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas

As melhores e mais bem avaliadas ferramentas de pesquisa competitiva com IA de 2026 para pequenas empresas! A XIX.AI selecionou uma coleção extremamente poderosa e revolucionária, atualizada semanalmente com testes rigorosos no mundo real e classificações detalhadas. Você encontrará uma comparação abrangente entre versões gratuitas e pagas para ajudá-lo a identificar as ferramentas imperdíveis que aumentam sua produtividade e lhe proporcionam uma vantagem competitiva. Explore agora para descobrir a ferramenta perfeita para você!

9 ferramentas
xix.ai
Comentários (2)
0/500
WillieRodriguez
WillieRodriguez 25 de Março de 2026 à55 20:00:55 WET

Also die KI halluziniert weniger als Menschen? Das klingt doch etwas zu optimistisch. Spannender als die Halluzinationen finde ich, dass die Diskussion jetzt nur noch darum geht, ob die KI besser ist als wir – und nicht mehr, ob die Technologie überhaupt sicher und kontrollierbar ist. Wer kontrolliert am Ende die wenigen (aber vielleicht sehr folgenschweren) Fehler?

ScottJackson
ScottJackson 11 de Janeiro de 2026 à40 18:30:40 WET

AI가 사람보다 더 정확하다고 하네요...🤔 이게 정말 가능한 건가요? 논문 구체적 수치가 궁금한데, 실제 인간 실수율은 어떻게 측정한 거지? 아마도 선택적 데이터로 과장된 느낌이 들어요. AI 환각이 적다면, 왜 여전히 뉴스에서 AI가 이상한 말한다는 기사가 나오는 걸까? ㅋㅋ

OR