Lar
A MiniMax disponibiliza em código aberto o modelo M3 Large com arquitetura MSA e 1 milhão de pontos de contexto, rivalizando com os principais modelos internacionais
A MiniMax Xiyu Technology apresentou seu modelo de grande porte de última geração, o MiniMax M3, em 1º de junho de 2026. Ele se destaca como o primeiro modelo de código aberto da China a combinar programação de nível de elite, uma janela de contexto ultralonga de 1 milhão de caracteres e recursos multimodais nativos, projetado para rivalizar com os principais modelos de código fechado do exterior em todos os aspectos.

Para resolver os gargalos de expansão de contexto em tarefas complexas de agentes, o M3 introduz uma arquitetura de atenção esparsa (MSA) no nível de base. Em comparação com abordagens convencionais, ele oferece um particionamento KV mais preciso e otimizações no nível do operador, alcançando quatro vezes a velocidade computacional de soluções de código aberto comparáveis. Com um comprimento de contexto de 1 milhão, o custo computacional por token cai para apenas um décimo da geração anterior. Ele acelera a fase de pré-preenchimento em mais de 9 vezes e a fase de decodificação em 15 vezes.

Por meio do treinamento nativo de dados intercalados em escala de trilhões, o espaço semântico do M3 alcança uma integração profunda. Ele supera o GPT-5.5 e o Gemini 3.1 Pro em avaliações autorizadas de engenharia de software e multimodais, como o SWE-Bench Pro. Em testes de tarefas extremas, o M3 demonstra um planejamento autônomo robusto de longa duração: ele reproduziu de forma independente os experimentos de um artigo de destaque da ICLR em 12 horas, funcionou 24 horas seguidas sem código de referência enquanto chamava ferramentas quase 2.000 vezes, aumentou a utilização do hardware de multiplicação de matrizes FP8 na arquitetura Hopper de 7,6% para 71,3% e orquestrou autonomamente todo o pipeline de “iteração de treinamento de dados” no PostTrainBench aberto.
Artigo relacionado
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos
À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr
O Google testa o Agente Remy AI para o Gemini, à medida que o foco se desloca para o controle do usuário
De acordo com o Business Insider, o Google está testando o Remy, um novo agente pessoal de IA para o Gemini. Esta ferramenta tem como objetivo executar tarefas em nome dos usuários, simplificando tanto os fluxos de trabalho profissionais quanto as ro
Recomendações de tópicos especiais relacionados
Comentários (0)

Para resolver os gargalos de expansão de contexto em tarefas complexas de agentes, o M3 introduz uma arquitetura de atenção esparsa (MSA) no nível de base. Em comparação com abordagens convencionais, ele oferece um particionamento KV mais preciso e otimizações no nível do operador, alcançando quatro vezes a velocidade computacional de soluções de código aberto comparáveis. Com um comprimento de contexto de 1 milhão, o custo computacional por token cai para apenas um décimo da geração anterior. Ele acelera a fase de pré-preenchimento em mais de 9 vezes e a fase de decodificação em 15 vezes.

Por meio do treinamento nativo de dados intercalados em escala de trilhões, o espaço semântico do M3 alcança uma integração profunda. Ele supera o GPT-5.5 e o Gemini 3.1 Pro em avaliações autorizadas de engenharia de software e multimodais, como o SWE-Bench Pro. Em testes de tarefas extremas, o M3 demonstra um planejamento autônomo robusto de longa duração: ele reproduziu de forma independente os experimentos de um artigo de destaque da ICLR em 12 horas, funcionou 24 horas seguidas sem código de referência enquanto chamava ferramentas quase 2.000 vezes, aumentou a utilização do hardware de multiplicação de matrizes FP8 na arquitetura Hopper de 7,6% para 71,3% e orquestrou autonomamente todo o pipeline de “iteração de treinamento de dados” no PostTrainBench aberto.
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos
À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr











