Maison
Le modèle Qwen 3.5-Max d'Alibaba se hisse dans le top 5 mondial dès ses débuts fulgurants
Les grands modèles linguistiques chinois ont une nouvelle fois battu des records sur la scène internationale. Le 20 mars, la famille Qwen d'Alibaba a présenté son nouveau modèle phare, le Qwen3.5-Max-Preview. Pour ses débuts sur LM Arena, la plateforme mondiale de référence pour les grands modèles linguistiques (LLM), ce modèle a immédiatement attiré l'attention du secteur avec un score global impressionnant de 1 464 points.
Cette performance exceptionnelle a propulsé Alibaba Tongyi Qianwen à la cinquième place mondiale du classement des entreprises de LM Arena , consolidant ainsi son statut de premier fournisseur chinois de LLM. Cette étape importante signifie que les grands modèles chinois sont désormais en concurrence au cœur de la scène mondiale.

Organisée par le groupe de recherche international open source LMSYS, LM Arena est largement considérée comme l'un des benchmarks les plus fiables du secteur grâce à son mécanisme d'évaluation basé sur des « compétitions anonymes et des votes à l'aveugle ». Lors de cette évaluation, le modèle Qwen3.5-Max-Preview a démontré des capacités solides et bien équilibrées :
Raisonnement mathématique : classé cinquième au niveau mondial, démontrant des compétences avancées en raisonnement logique.
Performance globale : s'est classé sixième au niveau mondial dans la catégorie du taux de victoire absolu sans ajustements de style.
Tâches de niveau expert : classé également parmi les dix premiers au niveau mondial pour le traitement de textes complexes.

Selon Alibaba Cloud , la série Qwen3.5 a lancé huit modèles de tailles variées depuis le Nouvel An lunaire, allant de 0,8 milliard à 397 milliards de paramètres. Le modèle phare Qwen3.5-Max-Preview représente le summum de cette série. Il s'appuie sur le principe architectural « petite activation, grandes performances », offrant des capacités qui égalent ou surpassent certains modèles plus volumineux tout en conservant une efficacité opérationnelle.
Le modèle est actuellement disponible en avant-première. Alibaba Cloud a déclaré que des itérations et des optimisations continues seront effectuées en fonction des commentaires de la communauté des développeurs, comme Tongyi Qianwen
Article connexe
La trio de DeepMind derrière l'IA de poker génère désormais des rendements pour les fonds spéculatifs quantitatifs
Trois anciens chercheurs de DeepMind, qui avaient précédemment développé une IA capable de vaincre des champions humains de poker, ont orienté cette technologie vers les marchés financiers, et la stratégie génère des rendements significatifs. Leur en
Sony et Warner intentent un procès à Anthropic pour allégations de violation massive des droits d’auteur en matière d’IA
Sony et Warner Music Group ont intenté une action en justice historique contre l’entreprise d’intelligence artificielle Anthropic, l’accusant d’utilisation massive non autorisée de musique protégée par le droit d’auteur pour l’entraînement de la séri
Lancement officiel de l’agent Qwen3.8-Flash, Qwen Office entre dans l’ère d’une gestion abondante et efficace
La plateforme Qwen Office a officiellement lancé le grand modèle Qwen3.8-Flash ainsi qu’un nouveau mode standard, permettant à tous les utilisateurs d’accéder immédiatement à cette fonctionnalité. Grâce à des capacités de modèle améliorées, les utili
Recommandations de sujets spéciaux liés
commentaires (2)
Wait, another Chinese model breaking into top 5? 🚀 Qwen 3.5-Max sounds impressive, but I'm always skeptical about benchmark rankings—different test sets can flip results overnight. Still, props to Alibaba for pushing the frontier. Hope they release a detailed technical report soon so we can see the real sauce behind it. 🤔
Les grands modèles linguistiques chinois ont une nouvelle fois battu des records sur la scène internationale. Le 20 mars, la famille Qwen d'Alibaba a présenté son nouveau modèle phare, le Qwen3.5-Max-Preview. Pour ses débuts sur LM Arena, la plateforme mondiale de référence pour les grands modèles linguistiques (LLM), ce modèle a immédiatement attiré l'attention du secteur avec un score global impressionnant de 1 464 points.
Cette performance exceptionnelle a propulsé

Organisée par le groupe de recherche international open source LMSYS,
Raisonnement mathématique : classé cinquième au niveau mondial, démontrant des compétences avancées en raisonnement logique.
Performance globale : s'est classé sixième au niveau mondial dans la catégorie du taux de victoire absolu sans ajustements de style.
Tâches de niveau expert : classé également parmi les dix premiers au niveau mondial pour le traitement de textes complexes.

Selon
Le modèle est actuellement disponible en avant-première.
La trio de DeepMind derrière l'IA de poker génère désormais des rendements pour les fonds spéculatifs quantitatifs
Trois anciens chercheurs de DeepMind, qui avaient précédemment développé une IA capable de vaincre des champions humains de poker, ont orienté cette technologie vers les marchés financiers, et la stratégie génère des rendements significatifs. Leur en
Sony et Warner intentent un procès à Anthropic pour allégations de violation massive des droits d’auteur en matière d’IA
Sony et Warner Music Group ont intenté une action en justice historique contre l’entreprise d’intelligence artificielle Anthropic, l’accusant d’utilisation massive non autorisée de musique protégée par le droit d’auteur pour l’entraînement de la séri
Lancement officiel de l’agent Qwen3.8-Flash, Qwen Office entre dans l’ère d’une gestion abondante et efficace
La plateforme Qwen Office a officiellement lancé le grand modèle Qwen3.8-Flash ainsi qu’un nouveau mode standard, permettant à tous les utilisateurs d’accéder immédiatement à cette fonctionnalité. Grâce à des capacités de modèle améliorées, les utili
Wait, another Chinese model breaking into top 5? 🚀 Qwen 3.5-Max sounds impressive, but I'm always skeptical about benchmark rankings—different test sets can flip results overnight. Still, props to Alibaba for pushing the frontier. Hope they release a detailed technical report soon so we can see the real sauce behind it. 🤔











