Hogar
MiniMax lanza en código abierto el modelo M3 Large con arquitectura MSA y 1 millón de entradas de contexto, que rivaliza con los modelos insignia extranjeros
MiniMax Xiyu Technology presentó su modelo de gran tamaño de última generación, el MiniMax M3, el 1 de junio de 2026. Se trata del primer modelo de código abierto de China que combina programación de élite, una ventana de contexto ultralarga de 1 millón de palabras y capacidades multimodales nativas, diseñado para rivalizar en todos los aspectos con los principales modelos de código cerrado extranjeros.

Para abordar los cuellos de botella de la expansión del contexto en tareas complejas de agentes, el M3 introduce una arquitectura de atención dispersa (MSA) a nivel de base. En comparación con los enfoques convencionales, ofrece una partición KV más precisa y optimizaciones a nivel de operador, alcanzando una velocidad computacional cuatro veces superior a la de soluciones de código abierto comparables. Con una longitud de contexto de 1 millón, el coste computacional por token se reduce a solo una décima parte del de la generación anterior. Acelera la etapa de prellenado más de 9 veces y la etapa de decodificación 15 veces.

A través del entrenamiento nativo de datos intercalados a escala de billones, el espacio semántico de M3 logra una profunda integración. Supera a GPT-5.5 y Gemini 3.1 Pro en evaluaciones autorizadas de ingeniería de software y multimodales como SWE-Bench Pro. En pruebas de tareas extremas, M3 demuestra una sólida planificación autónoma de hilos largos: reprodujo de forma independiente los experimentos de un artículo destacado de ICLR en 12 horas, funcionó 24 horas seguidas sin código de referencia mientras invocaba herramientas casi 2000 veces, aumentó la utilización del hardware de multiplicación de matrices FP8 en la arquitectura Hopper del 7,6 % al 71,3 %, y orquestó de forma autónoma el proceso completo de «iteración de entrenamiento de datos» en el PostTrainBench abierto.
Artículo relacionado
Cómo corregir las Core Web Vitals para mejorar el posicionamiento SEO
Simplificar los comentarios de las tarjetas de calificación con herramientas de IAIntroducciónHerramientas de IA para generar comentarios de tarjetas de calificaciónMagic SchoolAlmanac AIChat GPTUso de Magic School para generar comentarios de t
Slackbot se convierte en un agente de IA
Slackbot, el asistente automatizado integrado en la plataforma de mensajería corporativa Slack de Salesforce, está evolucionando hacia un agente de inteligencia artificial. El CTO de Salesforce, Parker Harris, prevé que alcance un estatus viral compa
ByteDance Refuerza los Incentivos de IA Central mientras Doubao Aumenta un 14.6%
ByteDance ha convocado recientemente una sesión informativa sobre la participación accionaria de DouBao para presentar nuevas políticas de incentivos para el personal involucrado en la división de DouBao. El precio de ejercicio de las acciones de Dou
Recomendaciones de temas especiales relacionados
comentario (0)
0/500

Para abordar los cuellos de botella de la expansión del contexto en tareas complejas de agentes, el M3 introduce una arquitectura de atención dispersa (MSA) a nivel de base. En comparación con los enfoques convencionales, ofrece una partición KV más precisa y optimizaciones a nivel de operador, alcanzando una velocidad computacional cuatro veces superior a la de soluciones de código abierto comparables. Con una longitud de contexto de 1 millón, el coste computacional por token se reduce a solo una décima parte del de la generación anterior. Acelera la etapa de prellenado más de 9 veces y la etapa de decodificación 15 veces.

A través del entrenamiento nativo de datos intercalados a escala de billones, el espacio semántico de M3 logra una profunda integración. Supera a GPT-5.5 y Gemini 3.1 Pro en evaluaciones autorizadas de ingeniería de software y multimodales como SWE-Bench Pro. En pruebas de tareas extremas, M3 demuestra una sólida planificación autónoma de hilos largos: reprodujo de forma independiente los experimentos de un artículo destacado de ICLR en 12 horas, funcionó 24 horas seguidas sin código de referencia mientras invocaba herramientas casi 2000 veces, aumentó la utilización del hardware de multiplicación de matrices FP8 en la arquitectura Hopper del 7,6 % al 71,3 %, y orquestó de forma autónoma el proceso completo de «iteración de entrenamiento de datos» en el PostTrainBench abierto.
Cómo corregir las Core Web Vitals para mejorar el posicionamiento SEO
Simplificar los comentarios de las tarjetas de calificación con herramientas de IAIntroducciónHerramientas de IA para generar comentarios de tarjetas de calificaciónMagic SchoolAlmanac AIChat GPTUso de Magic School para generar comentarios de t
Slackbot se convierte en un agente de IA
Slackbot, el asistente automatizado integrado en la plataforma de mensajería corporativa Slack de Salesforce, está evolucionando hacia un agente de inteligencia artificial. El CTO de Salesforce, Parker Harris, prevé que alcance un estatus viral compa
ByteDance Refuerza los Incentivos de IA Central mientras Doubao Aumenta un 14.6%
ByteDance ha convocado recientemente una sesión informativa sobre la participación accionaria de DouBao para presentar nuevas políticas de incentivos para el personal involucrado en la división de DouBao. El precio de ejercicio de las acciones de Dou











