Maison
xAI Grok 4.20 affiche le taux d'hallucination le plus bas du secteur et privilégie l'intégrité plutôt que la performance
Alors que les géants de l'IA investissent frénétiquement des ressources pour atteindre les meilleurs scores de performance, xAI, la société d'Elon Musk, adopte une approche différente en se concentrant sur le problème le plus récurrent dans ce domaine : la fabrication d'informations. Aujourd’hui, xAI a officiellement lancé Grok4.20Beta. Bien qu’il reste encore en retrait par rapport aux modèles de premier plan en termes de scores d’intelligence absolus, il a établi un nouveau record du secteur en matière de véracité, un indicateur clé.

Selon la dernière évaluation réalisée par Artificial Analysis, Grok4.20 a obtenu un score de 48 sur l’indice d’intelligence en mode raisonnement. Bien qu’il soit en retard par rapport à et (qui ont tous deux obtenu un score de 57), ses performances en matière de fiabilité des faits sont particulièrement impressionnantes :
Faible taux d’hallucination: lors du test AA Omniscience, Grok4.20 a atteint un « taux de non-hallucination » de 78 %, établissant ainsi un nouveau record.
Savoir ce que l’on sait: face à des questions auxquelles il ne peut répondre, le modèle n’a plus tendance à inventer de fausses informations, mais admet plus précisément « Je ne sais pas ». Cette honnêteté est cruciale dans les environnements professionnels et de recherche rigoureux.
Architecture technique : une matrice API « trois-en-un »
Pour répondre à des besoins variés, xAI a lancé trois variantes d’API :
Mode « raisonnement » : privilégie la réflexion logique approfondie plutôt que la vitesse, ce qui a été déterminant pour battre le record d’hallucinations cette fois-ci.
Mode standard: optimisé pour une réponse rapide et des interactions courantes.
Mode multi-agents: prend en charge plusieurs instances d’IA travaillant ensemble pour gérer des tâches complexes.
Stratégie commerciale : plus de contenu, sans frais supplémentaires
Au-delà de ses performances exceptionnelles, Grok4.20 s'accompagne également d'une stratégie commerciale ambitieuse :
Contexte étendu: prend en charge une fenêtre de contexte pouvant atteindre 2 millions de tokens, ce qui lui permet d’assimiler d’un seul coup un livre entier ou une base de code volumineuse.
Avantage tarifaire: avec un prix compris entre 2 et 6 dollars par million de tokens, il est non seulement moins cher que la version précédente, Grok4, mais également très compétitif par rapport aux principaux modèles occidentaux actuels.
La sortie de Grok4.20 reflète le changement de stratégie de xAI : il ne s’agit plus de se focaliser sur la course au score total vers l’AGI, mais de cibler précisément le point sensible de la « fiabilité au niveau de l’entreprise ». Comme l’a déclaré l’organisme d’évaluation, si d’autres modèles s’efforcent de devenir des « prophètes omniscients », Grok4.20 s’efforce de devenir « un assistant qui ne ment jamais ».
Pour les utilisateurs ayant des exigences extrêmement élevées en matière de précision des données, Grok4.20 pourrait devenir une troisième option majeure, aux côtés d’OpenAI et de Google.
Article connexe
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Recommandations de sujets spéciaux liés
commentaires (0)
Alors que les géants de l'IA investissent frénétiquement des ressources pour atteindre les meilleurs scores de performance, xAI, la société d'Elon Musk, adopte une approche différente en se concentrant sur le problème le plus récurrent dans ce domaine : la fabrication d'informations. Aujourd’hui, xAI a officiellement lancé Grok4.20Beta. Bien qu’il reste encore en retrait par rapport aux modèles de premier plan en termes de scores d’intelligence absolus, il a établi un nouveau record du secteur en matière de véracité, un indicateur clé.

Selon la dernière évaluation réalisée par Artificial Analysis, Grok4.20 a obtenu un score de 48 sur l’indice d’intelligence en mode raisonnement. Bien qu’il soit en retard par rapport à
Faible taux d’hallucination: lors du test AA Omniscience, Grok4.20 a atteint un « taux de non-hallucination » de 78 %, établissant ainsi un nouveau record.
Savoir ce que l’on sait: face à des questions auxquelles il ne peut répondre, le modèle n’a plus tendance à inventer de fausses informations, mais admet plus précisément « Je ne sais pas ». Cette honnêteté est cruciale dans les environnements professionnels et de recherche rigoureux.
Architecture technique : une matrice API « trois-en-un »
Pour répondre à des besoins variés, xAI a lancé trois variantes d’API :
Mode « raisonnement » : privilégie la réflexion logique approfondie plutôt que la vitesse, ce qui a été déterminant pour battre le record d’hallucinations cette fois-ci.
Mode standard: optimisé pour une réponse rapide et des interactions courantes.
Mode multi-agents: prend en charge plusieurs instances d’IA travaillant ensemble pour gérer des tâches complexes.
Stratégie commerciale : plus de contenu, sans frais supplémentaires
Au-delà de ses performances exceptionnelles, Grok4.20 s'accompagne également d'une stratégie commerciale ambitieuse :
Contexte étendu: prend en charge une fenêtre de contexte pouvant atteindre 2 millions de tokens, ce qui lui permet d’assimiler d’un seul coup un livre entier ou une base de code volumineuse.
Avantage tarifaire: avec un prix compris entre 2 et 6 dollars par million de tokens, il est non seulement moins cher que la version précédente, Grok4, mais également très compétitif par rapport aux principaux modèles occidentaux actuels.
La sortie de Grok4.20 reflète le changement de stratégie de xAI : il ne s’agit plus de se focaliser sur la course au score total vers l’AGI, mais de cibler précisément le point sensible de la « fiabilité au niveau de l’entreprise ». Comme l’a déclaré l’organisme d’évaluation, si d’autres modèles s’efforcent de devenir des « prophètes omniscients », Grok4.20 s’efforce de devenir « un assistant qui ne ment jamais ».
Pour les utilisateurs ayant des exigences extrêmement élevées en matière de précision des données, Grok4.20 pourrait devenir une troisième option majeure, aux côtés d’OpenAI et de Google.
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter











