A série Xiaomi MiMo-V2.5 ganha redução permanente de preço, com descontos de até 99%
Em meio à crescente guerra de preços dos modelos de IA, a Xiaomi anunciou oficialmente, em 27 de maio, que seu modelo de grande porte MiMo reduziria permanentemente os preços da API da série MiMo-V2.5, ao mesmo tempo em que otimizaria o sistema de cobrança para diminuir ainda mais os custos de uso dos desenvolvedores por meio de avanços tecnológicos.

I. Reduções significativas nos preços da API — até 99% de desconto
A mudança de preço entrou em vigor globalmente às 00:00, horário de Pequim, em 27 de maio. Ela se aplica às duas versões principais, MiMo-V2.5 e MiMo-V2.5Pro, e não faz mais distinção com base no comprimento da janela de contexto, simplificando a estrutura de preços para maior transparência.
Versão do modeloPreço por acerto no cache de entradaDesconto máximoPreço de saídaDesconto máximoMiMo-V2.5Pro0,025 yuan por milhão de tokens, até 99% de desconto; saída: 6 yuans por milhão de tokens, com até 86% de desconto; MiMo-V2.5: 0,02 yuan por milhão de tokens, com até 98% de desconto; saída: 2 yuans por milhão de tokens, com até 93% de descontoII. Atualização do sistema de cobrança — Mais valor sem custo adicional
Além dos cortes diretos nos preços da API, a Xiaomi otimizou significativamente seu sistema de faturamento do Plano de Tokens:
Cota quadruplicada: sob a estrutura de preços original, a cota real de uso de tokens aumentou de 5 a 8 vezes em relação ao valor anterior.
Regras simplificadas: a introdução dos Créditos substitui os métodos complexos de faturamento anteriores, tornando o consumo de tokens e o cálculo de custos mais intuitivos para os desenvolvedores.

III. Base técnica — Como é possível continuar reduzindo os preços?
A declaração oficial da Xiaomi atribui esses profundos cortes de preço a avanços técnicos na arquitetura do sistema de inferência subjacente:
Otimização de inferência SWA: Ao aproveitar o SGLang HiCache com suporte total para SWA (Sliding Window Attention Mechanism), a transferência de dados entre a memória da GPU, a memória da CPU e o SSD foi reduzida para um sétimo do volume anterior.
Eficiência de cache aprimorada: O número de tokens armazenáveis em cache aumentou quase cinco vezes em comparação com a versão otimizada anterior, aumentando as taxas de acerto de cache e reduzindo drasticamente o custo por inferência.
Otimização da taxa de transferência do cluster: Com a introdução de estratégias de paralelismo especializado (MoE) e segmentação por comprimento de entrada, a taxa de transferência de entrada do cluster teve um salto qualitativo, mantendo alta qualidade de serviço enquanto reduz de forma constante o custo por token.
A iniciativa da Xiaomi é vista como uma resposta proativa à intensa concorrência atual na comercialização de modelos de grande porte. À medida que as barreiras de preço continuam a cair, a relação custo-benefício da série MiMo se tornará ainda mais pronunciada, acelerando a integração profunda de recursos de IA em setores verticais e fluxos de trabalho de desenvolvedores.
Artigo relacionado
Suno para Marcas d'Água em Músicas Durante Batalhas Legais
O Suno, plataforma que permite aos usuários gerar músicas criadas por inteligência artificial, apresentou novas funcionalidades para rotular as faixas produzidas pela plataforma, restringir downloads e atualizar os padrões da comunidade para coibir r
Musk admite que vazamento do código do Grok expôs dados de usuários e promete apagar todas as informações históricas.
Elon Musk abordou diretamente a controvérsia sobre privacidade envolvendo o Grok Build, começando com um simples "Verdadeiro" para confirmar a validade do incidente. Ele prometeu que todos os dados dos usuários carregados anteriormente para a SpaceXA
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Recomendações de tópicos especiais relacionados
Comentários (0)
Em meio à crescente guerra de preços dos modelos de IA, a Xiaomi anunciou oficialmente, em 27 de maio, que seu modelo de grande porte MiMo reduziria permanentemente os preços da API da série MiMo-V2.5, ao mesmo tempo em que otimizaria o sistema de cobrança para diminuir ainda mais os custos de uso dos desenvolvedores por meio de avanços tecnológicos.

I. Reduções significativas nos preços da API — até 99% de desconto
A mudança de preço entrou em vigor globalmente às 00:00, horário de Pequim, em 27 de maio. Ela se aplica às duas versões principais, MiMo-V2.5 e MiMo-V2.5Pro, e não faz mais distinção com base no comprimento da janela de contexto, simplificando a estrutura de preços para maior transparência.
Versão do modeloPreço por acerto no cache de entradaDesconto máximoPreço de saídaDesconto máximoMiMo-V2.5Pro0,025 yuan por milhão de tokens, até 99% de desconto; saída: 6 yuans por milhão de tokens, com até 86% de desconto; MiMo-V2.5: 0,02 yuan por milhão de tokens, com até 98% de desconto; saída: 2 yuans por milhão de tokens, com até 93% de descontoII. Atualização do sistema de cobrança — Mais valor sem custo adicional
Além dos cortes diretos nos preços da API, a Xiaomi otimizou significativamente seu sistema de faturamento do Plano de Tokens:
Cota quadruplicada: sob a estrutura de preços original, a cota real de uso de tokens aumentou de 5 a 8 vezes em relação ao valor anterior.
Regras simplificadas: a introdução dos Créditos substitui os métodos complexos de faturamento anteriores, tornando o consumo de tokens e o cálculo de custos mais intuitivos para os desenvolvedores.

III. Base técnica — Como é possível continuar reduzindo os preços?
A declaração oficial da Xiaomi atribui esses profundos cortes de preço a avanços técnicos na arquitetura do sistema de inferência subjacente:
Otimização de inferência SWA: Ao aproveitar o SGLang HiCache com suporte total para SWA (Sliding Window Attention Mechanism), a transferência de dados entre a memória da GPU, a memória da CPU e o SSD foi reduzida para um sétimo do volume anterior.
Eficiência de cache aprimorada: O número de tokens armazenáveis em cache aumentou quase cinco vezes em comparação com a versão otimizada anterior, aumentando as taxas de acerto de cache e reduzindo drasticamente o custo por inferência.
Otimização da taxa de transferência do cluster: Com a introdução de estratégias de paralelismo especializado (MoE) e segmentação por comprimento de entrada, a taxa de transferência de entrada do cluster teve um salto qualitativo, mantendo alta qualidade de serviço enquanto reduz de forma constante o custo por token.
A iniciativa da Xiaomi é vista como uma resposta proativa à intensa concorrência atual na comercialização de modelos de grande porte. À medida que as barreiras de preço continuam a cair, a relação custo-benefício da série MiMo se tornará ainda mais pronunciada, acelerando a integração profunda de recursos de IA em setores verticais e fluxos de trabalho de desenvolvedores.
Suno para Marcas d'Água em Músicas Durante Batalhas Legais
O Suno, plataforma que permite aos usuários gerar músicas criadas por inteligência artificial, apresentou novas funcionalidades para rotular as faixas produzidas pela plataforma, restringir downloads e atualizar os padrões da comunidade para coibir r
Musk admite que vazamento do código do Grok expôs dados de usuários e promete apagar todas as informações históricas.
Elon Musk abordou diretamente a controvérsia sobre privacidade envolvendo o Grok Build, começando com um simples "Verdadeiro" para confirmar a validade do incidente. Ele prometeu que todos os dados dos usuários carregados anteriormente para a SpaceXA
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava





Lar






