Maison
Doubao s'impose comme leader mondial en matière de performances de vision par IA, devançant les modèles de Google
Selon le dernier rapport d'évaluation publié par SuperCLUE-VLM en avril 2026, des avancées significatives ont été réalisées dans le domaine des modèles multimodaux vision-langage en chinois. Après avoir procédé à une évaluation approfondie de 17 des principaux modèles à grande échelle au monde, il est apparu que les développeurs chinois d’IA font preuve de progrès remarquables. Ces modèles excellent non seulement dans l’interprétation des contenus en chinois, mais surpassent également leurs homologues internationaux de premier plan sur tous les indicateurs d’évaluation.
ByteDance arrive en tête du classement, plusieurs modèles nationaux figurant parmi les meilleurs
Les résultats de l’évaluation montrent que le modèle Doubao-Seed-2.0-Pro-260215 de ByteDance a obtenu 90,66 points, se classant ainsi en tête du classement général. Ce score a dépassé celui de Google Gemini-3.1-Pro-Preview, qui était jusqu’alors considéré comme un concurrent de poids avec 89,35 points. De plus, d’autres modèles nationaux, tels que la série Qwen 3.5 d’Alibaba, SenseNova de SenseTime et GLM de Zhipu, ont également affiché des performances exceptionnelles, s’imposant ainsi parmi les leaders. En revanche, des modèles étrangers bien connus, tels que le GPT-5.4 d’OpenAI et le Grok de X.AI, se sont classés dans le milieu du tableau lors de cette évaluation multimodale chinoise.

Une évaluation approfondie dans trois domaines clés, preuve de compétences cognitives de base avancées
Le cadre d’évaluation était complet et couvrait trois domaines essentiels : la cognition de base, le raisonnement visuel et l’application visuelle. L’évaluation comprenait 25 scénarios différents, tels que la reconnaissance générale d’objets, l’analyse de graphiques et l’imagerie médicale. Les modèles nationaux ont obtenu des résultats particulièrement bons dans les catégories de la cognition de base et de l’analyse de données, atteignant systématiquement des scores supérieurs à 90 points, ce qui reflète un haut niveau de maturité technique et une forte adaptabilité aux contextes en langue chinoise.
Des défis persistent dans les domaines spécialisés ; le raisonnement industriel et médical est identifié comme un axe prioritaire pour l’avenir
Bien qu’ils occupent la première place au classement général, les données d’évaluation ont également mis en évidence des domaines dans lesquels les modèles nationaux doivent encore s’améliorer. Dans des tâches de raisonnement visuel hautement spécialisées, telles que l’inspection industrielle et l’imagerie médicale de haute précision, ces modèles sont à la traîne par rapport aux leaders mondiaux, certains scénarios spécifiques présentant des variations de scores considérables.
Les experts du secteur estiment que ces récents changements de classement marquent un tournant décisif pour le développement de l’IA multimodale chinoise. Les modèles nationaux à grande échelle ont désormais établi un solide avantage concurrentiel grâce à leur capacité à comprendre en profondeur et à appliquer des contenus en langue chinoise, marquant ainsi le début d’une nouvelle ère où ils peuvent rivaliser avec les géants internationaux, voire jouer un rôle de premier plan dans ce domaine.
Article connexe
Musk admet que la construction de Grok a divulgué le code utilisateur, promet d’effacer toutes les données historiques
Elon Musk a abordé directement la controverse sur la vie privée concernant Grok Build, en commençant par un simple « Vrai » pour confirmer la validité de l’incident. Il s’est engagé à ce que toutes les données utilisateur précédemment téléchargées su
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Recommandations de sujets spéciaux liés
commentaires (0)
Selon le dernier rapport d'évaluation publié par SuperCLUE-VLM en avril 2026, des avancées significatives ont été réalisées dans le domaine des modèles multimodaux vision-langage en chinois. Après avoir procédé à une évaluation approfondie de 17 des principaux modèles à grande échelle au monde, il est apparu que les développeurs chinois d’IA font preuve de progrès remarquables. Ces modèles excellent non seulement dans l’interprétation des contenus en chinois, mais surpassent également leurs homologues internationaux de premier plan sur tous les indicateurs d’évaluation.
ByteDance arrive en tête du classement, plusieurs modèles nationaux figurant parmi les meilleurs
Les résultats de l’évaluation montrent que le modèle Doubao-Seed-2.0-Pro-260215 de ByteDance a obtenu 90,66 points, se classant ainsi en tête du classement général. Ce score a dépassé celui de Google Gemini-3.1-Pro-Preview, qui était jusqu’alors considéré comme un concurrent de poids avec 89,35 points. De plus, d’autres modèles nationaux, tels que la série Qwen 3.5 d’Alibaba, SenseNova de SenseTime et GLM de Zhipu, ont également affiché des performances exceptionnelles, s’imposant ainsi parmi les leaders. En revanche, des modèles étrangers bien connus, tels que le GPT-5.4 d’OpenAI et le Grok de X.AI, se sont classés dans le milieu du tableau lors de cette évaluation multimodale chinoise.

Une évaluation approfondie dans trois domaines clés, preuve de compétences cognitives de base avancées
Le cadre d’évaluation était complet et couvrait trois domaines essentiels : la cognition de base, le raisonnement visuel et l’application visuelle. L’évaluation comprenait 25 scénarios différents, tels que la reconnaissance générale d’objets, l’analyse de graphiques et l’imagerie médicale. Les modèles nationaux ont obtenu des résultats particulièrement bons dans les catégories de la cognition de base et de l’analyse de données, atteignant systématiquement des scores supérieurs à 90 points, ce qui reflète un haut niveau de maturité technique et une forte adaptabilité aux contextes en langue chinoise.
Des défis persistent dans les domaines spécialisés ; le raisonnement industriel et médical est identifié comme un axe prioritaire pour l’avenir
Bien qu’ils occupent la première place au classement général, les données d’évaluation ont également mis en évidence des domaines dans lesquels les modèles nationaux doivent encore s’améliorer. Dans des tâches de raisonnement visuel hautement spécialisées, telles que l’inspection industrielle et l’imagerie médicale de haute précision, ces modèles sont à la traîne par rapport aux leaders mondiaux, certains scénarios spécifiques présentant des variations de scores considérables.
Les experts du secteur estiment que ces récents changements de classement marquent un tournant décisif pour le développement de l’IA multimodale chinoise. Les modèles nationaux à grande échelle ont désormais établi un solide avantage concurrentiel grâce à leur capacité à comprendre en profondeur et à appliquer des contenus en langue chinoise, marquant ainsi le début d’une nouvelle ère où ils peuvent rivaliser avec les géants internationaux, voire jouer un rôle de premier plan dans ce domaine.
Musk admet que la construction de Grok a divulgué le code utilisateur, promet d’effacer toutes les données historiques
Elon Musk a abordé directement la controverse sur la vie privée concernant Grok Build, en commençant par un simple « Vrai » pour confirmer la validité de l’incident. Il s’est engagé à ce que toutes les données utilisateur précédemment téléchargées su
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter











