Lar
O xAI Grok 4.20 alcança a menor taxa de alucinações do setor e prioriza a integridade em detrimento do desempenho
Enquanto os gigantes da IA investem freneticamente recursos na busca por os melhores índices de desempenho, a xAI, de Elon Musk, adota uma abordagem diferente, concentrando-se no problema mais persistente da área: a fabricação de informações. Hoje, a xAI lançou oficialmente o Grok4.20Beta. Embora ainda fique atrás dos modelos de ponta em pontuações absolutas de inteligência, ele estabeleceu um novo recorde do setor na métrica-chave de veracidade.

De acordo com a avaliação mais recente da Artificial Analysis, o Grok4.20 obteve 48 pontos no índice de inteligência no modo de raciocínio. Embora fique atrás do “ ” e do “ ” (ambos com 57 pontos), seu desempenho em confiabilidade de fatos é particularmente impressionante:
Baixa taxa de alucinação: no teste AA Omniscience, o Grok4.20 alcançou uma “taxa de não alucinação” de 78%, estabelecendo um novo recorde.
Sabendo o que sabe: quando confrontado com perguntas que não consegue responder, o modelo não tende mais a inventar fatos falsos, mas, em vez disso, admite com mais precisão “Não sei”. Essa honestidade é crucial para ambientes rigorosos de escritório e pesquisa.
Arquitetura técnica: uma matriz de API três em um
Para atender às diversas necessidades, a xAI lançou três variantes de API:
Modo de Raciocínio: Prioriza o pensamento lógico profundo em detrimento da velocidade, o que foi fundamental para quebrar o recorde de alucinações desta vez.
Modo Padrão: Otimizado para respostas rápidas e interações rotineiras.
Modo multiagente: oferece suporte a várias instâncias de IA trabalhando juntas para lidar com tarefas complexas.
Estratégia de mercado: mais conteúdo, sem custo extra
Além de seu desempenho único, o Grok4.20 também apresenta uma estratégia comercial agressiva:
Contexto amplo: Suporta uma janela de contexto de até 2 milhões de tokens, permitindo que ele absorva um livro inteiro ou uma grande base de código de uma só vez.
Vantagem de preço: Com preço entre US$ 2 e US$ 6 por milhão de tokens, ele não só é mais barato que a versão anterior, o Grok4, como também é altamente competitivo entre os principais modelos ocidentais atuais.
O lançamento do Grok4.20 reflete a mudança estratégica da xAI — não mais obcecada pela corrida pela pontuação total rumo à IA Geral (AGI), mas visando precisamente o ponto crítico da “confiabilidade de nível empresarial”. Conforme afirmou a instituição de avaliação, se outros modelos se esforçam para se tornar “profetas oniscientes”, o Grok4.20 se esforça para se tornar “um assistente que nunca mente”.
Para usuários com exigências extremamente altas em relação à precisão dos dados, o Grok4.20 pode se tornar uma terceira opção importante, além da OpenAI e do Google.
Artigo relacionado
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos
À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr
O Google testa o Agente Remy AI para o Gemini, à medida que o foco se desloca para o controle do usuário
De acordo com o Business Insider, o Google está testando o Remy, um novo agente pessoal de IA para o Gemini. Esta ferramenta tem como objetivo executar tarefas em nome dos usuários, simplificando tanto os fluxos de trabalho profissionais quanto as ro
Recomendações de tópicos especiais relacionados
Comentários (0)
Enquanto os gigantes da IA investem freneticamente recursos na busca por os melhores índices de desempenho, a xAI, de Elon Musk, adota uma abordagem diferente, concentrando-se no problema mais persistente da área: a fabricação de informações. Hoje, a xAI lançou oficialmente o Grok4.20Beta. Embora ainda fique atrás dos modelos de ponta em pontuações absolutas de inteligência, ele estabeleceu um novo recorde do setor na métrica-chave de veracidade.

De acordo com a avaliação mais recente da Artificial Analysis, o Grok4.20 obteve 48 pontos no índice de inteligência no modo de raciocínio. Embora fique atrás do “
Baixa taxa de alucinação: no teste AA Omniscience, o Grok4.20 alcançou uma “taxa de não alucinação” de 78%, estabelecendo um novo recorde.
Sabendo o que sabe: quando confrontado com perguntas que não consegue responder, o modelo não tende mais a inventar fatos falsos, mas, em vez disso, admite com mais precisão “Não sei”. Essa honestidade é crucial para ambientes rigorosos de escritório e pesquisa.
Arquitetura técnica: uma matriz de API três em um
Para atender às diversas necessidades, a xAI lançou três variantes de API:
Modo de Raciocínio: Prioriza o pensamento lógico profundo em detrimento da velocidade, o que foi fundamental para quebrar o recorde de alucinações desta vez.
Modo Padrão: Otimizado para respostas rápidas e interações rotineiras.
Modo multiagente: oferece suporte a várias instâncias de IA trabalhando juntas para lidar com tarefas complexas.
Estratégia de mercado: mais conteúdo, sem custo extra
Além de seu desempenho único, o Grok4.20 também apresenta uma estratégia comercial agressiva:
Contexto amplo: Suporta uma janela de contexto de até 2 milhões de tokens, permitindo que ele absorva um livro inteiro ou uma grande base de código de uma só vez.
Vantagem de preço: Com preço entre US$ 2 e US$ 6 por milhão de tokens, ele não só é mais barato que a versão anterior, o Grok4, como também é altamente competitivo entre os principais modelos ocidentais atuais.
O lançamento do Grok4.20 reflete a mudança estratégica da xAI — não mais obcecada pela corrida pela pontuação total rumo à IA Geral (AGI), mas visando precisamente o ponto crítico da “confiabilidade de nível empresarial”. Conforme afirmou a instituição de avaliação, se outros modelos se esforçam para se tornar “profetas oniscientes”, o Grok4.20 se esforça para se tornar “um assistente que nunca mente”.
Para usuários com exigências extremamente altas em relação à precisão dos dados, o Grok4.20 pode se tornar uma terceira opção importante, além da OpenAI e do Google.
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos
À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr











