Maison
MiniMax open-source son grand modèle M3 doté d'une architecture MSA et d'un contexte de 1 Mo, rivalisant avec les produits phares étrangers
MiniMax Xiyu Technology a dévoilé son modèle de grande envergure de nouvelle génération, le MiniMax M3, le 1er juin 2026. Il s'agit du premier modèle open source chinois à combiner une programmation de haut niveau, une fenêtre de contexte ultra-longue d'un million de caractères et des capacités multimodales natives, conçu pour rivaliser à tous les niveaux avec les principaux modèles fermés étrangers.

Pour remédier aux goulots d'étranglement liés à l'expansion du contexte dans les tâches complexes impliquant des agents, le M3 introduit une architecture d'attention clairsemée (MSA) au niveau fondamental. Par rapport aux approches conventionnelles, il offre un partitionnement KV plus précis et des optimisations au niveau des opérateurs, atteignant une vitesse de calcul quatre fois supérieure à celle des solutions open source comparables. Avec une longueur de contexte de 1 million, le coût de calcul par token chute à seulement un dixième de celui de la génération précédente. Il accélère la phase de préremplissage de plus de 9 fois et la phase de décodage de 15 fois.

Grâce à un entraînement natif sur des données entrelacées à l'échelle du trillion, l'espace sémantique de M3 atteint une intégration profonde. Il surpasse GPT-5.5 et Gemini 3.1 Pro dans des évaluations faisant autorité en génie logiciel et multimodales telles que SWE-Bench Pro. Lors de tests de tâches extrêmes, M3 fait preuve d’une planification autonome robuste à long terme : il a reproduit de manière indépendante les expériences d’un article phare de l’ICLR en moins de 12 heures, a fonctionné 24 heures d’affilée sans code de référence tout en appelant des outils près de 2 000 fois, a fait passer le taux d'utilisation du matériel de multiplication matricielle FP8 sur l'architecture Hopper de 7,6 % à 71,3 %, et a orchestré de manière autonome l'ensemble du pipeline « données-entraînement-itération » sur la plateforme ouverte PostTrainBench.
Article connexe
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Recommandations de sujets spéciaux liés
commentaires (0)

Pour remédier aux goulots d'étranglement liés à l'expansion du contexte dans les tâches complexes impliquant des agents, le M3 introduit une architecture d'attention clairsemée (MSA) au niveau fondamental. Par rapport aux approches conventionnelles, il offre un partitionnement KV plus précis et des optimisations au niveau des opérateurs, atteignant une vitesse de calcul quatre fois supérieure à celle des solutions open source comparables. Avec une longueur de contexte de 1 million, le coût de calcul par token chute à seulement un dixième de celui de la génération précédente. Il accélère la phase de préremplissage de plus de 9 fois et la phase de décodage de 15 fois.

Grâce à un entraînement natif sur des données entrelacées à l'échelle du trillion, l'espace sémantique de M3 atteint une intégration profonde. Il surpasse GPT-5.5 et Gemini 3.1 Pro dans des évaluations faisant autorité en génie logiciel et multimodales telles que SWE-Bench Pro. Lors de tests de tâches extrêmes, M3 fait preuve d’une planification autonome robuste à long terme : il a reproduit de manière indépendante les expériences d’un article phare de l’ICLR en moins de 12 heures, a fonctionné 24 heures d’affilée sans code de référence tout en appelant des outils près de 2 000 fois, a fait passer le taux d'utilisation du matériel de multiplication matricielle FP8 sur l'architecture Hopper de 7,6 % à 71,3 %, et a orchestré de manière autonome l'ensemble du pipeline « données-entraînement-itération » sur la plateforme ouverte PostTrainBench.
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter











