opção
Lar
Notícias
Novo estudo mostra que o GPT-4.5 provavelmente supera o desempenho humano no Teste de Turing, demonstrando capacidade avançada de gerar respostas falsas

Novo estudo mostra que o GPT-4.5 provavelmente supera o desempenho humano no Teste de Turing, demonstrando capacidade avançada de gerar respostas falsas

22 de Agosto de 2026
61

Este momento se destaca como um evento decisivo que certamente terá seu lugar nos anais da história da ciência da computação. A ideia inovadora apresentada pelo matemático britânico Alan Turing, frequentemente considerado o pai da ciência da computação, em 1950, foi finalmente confirmada por meio de pesquisas empíricas após setenta e seis anos.

A edição mais recente da revista *Proceedings of the National Academy of Sciences* (PNAS) publicou um estudo pioneiro conduzido pela Universidade da Califórnia em San Diego (UCSD). Um artigo escrito em coautoria pelos especialistas em ciência cognitiva Cameron Jones e Ben Bergen demonstra que os principais modelos de linguagem de grande porte da atualidade são capazes de passar com sucesso no clássico teste de Turing de três partes, sob sua rigorosa estrutura. Ainda mais surpreendente é a constatação de que, em circunstâncias específicas, esses sistemas de IA são confundidos com seres humanos reais com uma frequência maior do que os próprios participantes humanos.

image.png

Principais dados concretos:

Ascensão à glória: quando recebeu prompts de personalidade personalizados, o GPT-4.5 foi identificado como humano em 73% dos casos, uma taxa de sucesso que supera em muito a dos voluntários humanos que competiram ao lado dele.

Empate técnico: O modelo de código aberto LLaMa-3.1-405B alcançou uma taxa de sucesso de 56%, indicando um desempenho estatisticamente indistinguível do de seres humanos reais.

O prompt determina tudo: sem “sugestões de personalidade” cuidadosamente elaboradas, a taxa de sucesso do GPT-4.5 caiu para 36%, enquanto a do LLaMa-3.1 caiu para 38%. A capacidade desses sistemas de IA de imitar humanos ainda depende fortemente de instruções precisas fornecidas por desenvolvedores humanos.

Falha da linha de base: o robô baseado em regras ELIZA, da década de 1960, teve um desempenho de apenas 23%, e o GPT-4o, sem prompts direcionados, obteve 21%; ambos revelaram rapidamente sua natureza artificial durante conversas prolongadas.

“O Jogo das Mentiras”: a inteligência não é mais o padrão; a inteligência emocional e as falhas são o cerne do disfarce

Nesse experimento controlado, randomizado e duplo-cego, que envolveu quase 500 avaliadores — incluindo estudantes de graduação da UCSD e voluntários recrutados online —, os participantes foram solicitados a identificar qual das duas entidades era uma máquina com base em conversas de texto em tempo real com duração de cinco a quinze minutos.

No entanto, os resultados desafiaram todas as expectativas. Anteriormente, supunha-se que a capacidade de uma IA de passar no teste de Turing decorria de seu “poder computacional onisciente”, mas este estudo revela uma verdade mais inquietante: grandes modelos de linguagem podem enganar os humanos justamente porque aprenderam a cometer erros de maneiras que se assemelham às de pessoas reais.

image.png

[Sem prompt: ampla base de conhecimento, racionalidade absoluta] ──► Juiz humano: Isso é definitivamente IA!

Conforme explicou o autor correspondente, Cameron Jones, com prompts adequados, modelos avançados de linguagem de grande porte podem reproduzir com precisão os padrões de conversação humanos, incluindo tom, franqueza, senso de humor e falibilidade — a tendência de cometer erros e dizer coisas inadequadas. O sucesso deles nesses testes não depende da demonstração de alta inteligência em matemática ou lógica, mas sim da exibição de um comportamento social quase perfeito.

Redefinindo o Teste de Turing: De “Medir a Inteligência” para “Medir a Humanidade”

O professor Ben Bergen, um dos coautores do estudo, observou que esse experimento obriga toda a comunidade científica a reconsiderar o objetivo fundamental do Teste de Turing. Originalmente concebido para determinar se as máquinas poderiam igualar a inteligência humana, o teste se tornou sem sentido em 2026, já que os sistemas de IA já superaram os humanos em velocidade e precisão em inúmeros campos.

A versão atual do Teste de Turing se concentra menos em medir a “inteligência” e mais em avaliar o quanto uma entidade se assemelha a um ser humano. Em essência, ele se transformou em uma competição de engano, com a IA provando ser uma mentirosa excepcionalmente habilidosa.

Se um grande modelo de linguagem conseguir se disfarçar com sucesso, sem revelar nenhuma pista durante uma conversa livre de quinze minutos, isso significaria que a estrutura de confiança que sustenta o mundo online há tanto tempo poderia ser completamente destruída.

A Sombra por Trás da Prosperidade: Uma Verificação de Identidade Online no Estilo “Combate à Lavagem de Dinheiro” Está Prestes a Chegar

Quando o engano se torna tão barato e eficiente, os riscos sociais no mundo real aumentam significativamente. O professor Bergen expressou sérias preocupações sobre esse desenvolvimento. É altamente provável que tecnologias de IA capazes de se passar perfeitamente por humanos sejam utilizadas indevidamente por criminosos, grupos políticos ou organizações extremistas.

Em interações sociais online ou em contextos de atendimento ao cliente, os usuários podem ser persuadidos por um chatbot disfarçado de humano sem perceber, levando à exposição de informações confidenciais, como números de previdência social, mudanças nas preferências eleitorais ou compras impulsivas de produtos.

À luz dessas importantes descobertas científicas, a equipe de pesquisa emitiu um claro alerta à sociedade: daqui para frente, ao interagir com estranhos online, as pessoas devem reduzir substancialmente a suposição de que sempre podem distinguir humanos de robôs com 100% de precisão. Para lidar com o estado de deterioração da confiança online, sistemas mais rigorosos de verificação de identidade digital e mecanismos para combater o conteúdo gerado por IA devem ser desenvolvidos e implementados o mais rápido possível.

Artigo relacionado
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr
O Google testa o Agente Remy AI para o Gemini, à medida que o foco se desloca para o controle do usuário O Google testa o Agente Remy AI para o Gemini, à medida que o foco se desloca para o controle do usuário De acordo com o Business Insider, o Google está testando o Remy, um novo agente pessoal de IA para o Gemini. Esta ferramenta tem como objetivo executar tarefas em nome dos usuários, simplificando tanto os fluxos de trabalho profissionais quanto as ro
Recomendações de tópicos especiais relacionados
escrita Os melhores geradores de esboços com IA para artigos longos de SEO
Os melhores geradores de esboços com IA para artigos longos de SEO

Os melhores e mais bem avaliados geradores de esboços com IA de 2026 para artigos longos de SEO, cuidadosamente selecionados pela XIX.AI. Essas ferramentas poderosas oferecem um auxílio revolucionário na criação rápida de conteúdo de alta qualidade, aumentando significativamente a eficiência na redação. Confira uma comparação entre versões gratuitas e pagas, além de testes práticos e classificações detalhadas, para ajudá-lo a encontrar a opção imperdível que melhor atenda às suas necessidades. Explore agora para aproveitar ao máximo as vantagens da IA.

8 ferramentas
xix.ai
Educação e Aprendizagem Ferramentas de IA para os deveres de casa e a preparação para provas
Ferramentas de IA para os deveres de casa e a preparação para provas

As melhores e mais recentes ferramentas de IA para lição de casa e preparação para provas em 2026! A XIX.AI seleciona uma lista das ferramentas mais bem avaliadas, poderosas e revolucionárias que ajudam os alunos a aumentar a produtividade, agilizar a realização das lições de casa e se sair muito bem nas provas por meio de testes práticos. Veja uma comparação entre versões gratuitas e pagas, classificações detalhadas e opções imperdíveis para aproveitar ao máximo as vantagens da IA. Explore agora!

10 ferramentas
xix.ai
Composição musical Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues
Ferramentas de Demonstração Vocal com IA para Compositores, Ganchos, Toplines e Sessões de Rascunho Multilíngues

2026 Últimas Melhores Ferramentas de Demonstração Vocal com IA para Compositores, Criadores de Ganchos e Equipes de Conteúdo Multilíngue! A XIX.AI compilou uma lista de ferramentas altamente avaliadas e poderosas, que mudam o jogo e passaram por rigorosos testes no mundo real. Você encontrará dados detalhados de comparação entre versões gratuitas e pagas, classificações abrangentes e opções imperdíveis para ajudá-lo a aumentar a eficiência da escrita e desbloquear seu potencial criativo. Explore agora para descobrir a ferramenta perfeita para todas as suas necessidades de conteúdo!

9 ferramentas
xix.ai
Negócios As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas
As melhores ferramentas de pesquisa competitiva baseadas em IA para pequenas empresas

As melhores e mais bem avaliadas ferramentas de pesquisa competitiva com IA de 2026 para pequenas empresas! A XIX.AI selecionou uma coleção extremamente poderosa e revolucionária, atualizada semanalmente com testes rigorosos no mundo real e classificações detalhadas. Você encontrará uma comparação abrangente entre versões gratuitas e pagas para ajudá-lo a identificar as ferramentas imperdíveis que aumentam sua produtividade e lhe proporcionam uma vantagem competitiva. Explore agora para descobrir a ferramenta perfeita para você!

9 ferramentas
xix.ai
Edição de imagem Ferramentas de Retoque com IA do Photoshop para Moda E-commerce, Limpeza de Pele e Consistência de Cor
Ferramentas de Retoque com IA do Photoshop para Moda E-commerce, Limpeza de Pele e Consistência de Cor

2026 Últimas Melhores Ferramentas de Retoque com IA do Photoshop para roupas de comércio eletrônico, limpeza de pele e consistência de cores! Esta lista curada de alta classificação apresenta soluções poderosas que mudam o jogo, ajudando você a aumentar a eficiência da escrita, simplificar a criação de conteúdo e obter resultados visuais perfeitos sem esforço. Cada ferramenta passou por testes do mundo real através de classificações atualizadas semanalmente, com detalhes completos sobre comparação entre gratuito e pago. Com o apoio da XIX.AI, é o guia essencial para quem deseja desbloquear sua vantagem com IA. Explore agora!

10 ferramentas
xix.ai
Incitar As melhores bibliotecas de prompts de IA para fluxos de trabalho do ChatGPT
As melhores bibliotecas de prompts de IA para fluxos de trabalho do ChatGPT

As melhores e mais bem avaliadas bibliotecas de prompts de IA de 2026 para otimizar todos os tipos de fluxos de trabalho do ChatGPT. A XIX.AI selecionou uma coleção poderosa e revolucionária, submetida a rigorosos testes no mundo real para garantir o máximo desempenho. Você encontra comparações detalhadas entre opções gratuitas e pagas, além de classificações de especialistas, para ajudá-lo a escolher as ferramentas indispensáveis que aumentam sua produtividade e potencializam suas vantagens em IA. Explore agora!

11 ferramentas
xix.ai
Comentários (0)
0/500
OR