A inovação da GPU Moortech S5000 impulsiona o modelo de IA Jiutian da China Mobile
Na próxima 9ª Cúpula Digital China, o modelo de linguagem de grande porte de uso geral “Jiutian” 35B, desenvolvido pela própria China Mobile, fará sua estreia oficial ao público. Como um avanço significativo para o ecossistema de computação nacional, a Moore Threads anunciou recentemente que sua GPU emblemática e completa, a MTT S5000, concluiu a adaptação de todo o processo e a verificação de inferência para este modelo.
O cerne dessa adaptação reside na integração profunda. Aproveitando sua pilha de software proprietária MUSA e o mecanismo de inferência de alto desempenho SGLang-MUSA, a Moore Threads implementou com sucesso todo o pipeline de inferência para o modelo “Jiutian” 35B. Por meio da otimização colaborativa da estrutura de desenvolvimento MUSA C, da biblioteca de computação muDNN e da biblioteca de operadores de código aberto MATE, a MTT S5000 foi ajustada com precisão para os mecanismos de atenção específicos e os requisitos de inferência de sequências longas de modelos de grande porte. Isso garante um desempenho eficiente e estável ao processar textos extensos e lidar com solicitações de alta simultaneidade.

A placa de computação MTT S5000, que serve como base técnica para essa adaptação, demonstrou capacidades excepcionais. Construída sobre a arquitetura MUSA “Pinghu” de quarta geração, essa GPU oferece um poder de computação densa de IA de até 1.000 TFLOPS por placa. Sua configuração de hardware conta com 80 GB de VRAM de alta capacidade com largura de banda de memória de 1,6 TB/s, suportando computação de precisão total de FP8 a FP64. Além disso, uma alta largura de banda de interconexão entre placas de 784 GB/s garante excelente escalabilidade em cenários complexos de computação inteligente.
Essa colaboração não apenas valida a confiabilidade das GPUs nacionais no suporte a grandes modelos centrais de empresas estatais, mas também destaca a maturidade da Moore Threads na otimização de alto desempenho para operadoras e no desenvolvimento de ecossistemas de software. Com o lançamento oficial do modelo “Jiutian” 35B, essa combinação de “grande modelo nacional + poder de computação nacional” oferece um caso prático altamente relevante para a conquista de uma infraestrutura de computação independente e controlável.
Artigo relacionado
Como corrigir as Core Web Vitals para melhorar o ranqueamento de SEO
Simplifique os Comentários do Boletim Escolar com Ferramentas de IAIntroduçãoFerramentas de IA para Gerar Comentários do Boletim EscolarMagic SchoolAlmanac AIChat GPTUsando o Magic School para Gerar Comentários do Boletim EscolarFazendo login n
O Slackbot torna-se um Agente de IA
O Slackbot, o assistente automatizado integrado à plataforma de mensagens corporativas Slack da Salesforce, está se transformando em um agente de IA. O CTO da Salesforce, Parker Harris, prevê que ele alcance um status viral comparável ao do ChatGPT d
A ByteDance Aumenta os Incentivos de IA Principal com o Doubao Aumentando 14,6%
A ByteDance convocou recentemente uma reunião de divulgação sobre a participação acionária do DouBao para revelar novas políticas de incentivos para os funcionários envolvidos na divisão do DouBao. O preço de exercício das ações do DouBao foi elevado
Recomendações de tópicos especiais relacionados
Comentários (0)
Na próxima 9ª Cúpula Digital China, o modelo de linguagem de grande porte de uso geral “Jiutian” 35B, desenvolvido pela própria China Mobile, fará sua estreia oficial ao público. Como um avanço significativo para o ecossistema de computação nacional, a Moore Threads anunciou recentemente que sua GPU emblemática e completa, a MTT S5000, concluiu a adaptação de todo o processo e a verificação de inferência para este modelo.
O cerne dessa adaptação reside na integração profunda. Aproveitando sua pilha de software proprietária MUSA e o mecanismo de inferência de alto desempenho SGLang-MUSA, a Moore Threads implementou com sucesso todo o pipeline de inferência para o modelo “Jiutian” 35B. Por meio da otimização colaborativa da estrutura de desenvolvimento MUSA C, da biblioteca de computação muDNN e da biblioteca de operadores de código aberto MATE, a MTT S5000 foi ajustada com precisão para os mecanismos de atenção específicos e os requisitos de inferência de sequências longas de modelos de grande porte. Isso garante um desempenho eficiente e estável ao processar textos extensos e lidar com solicitações de alta simultaneidade.

A placa de computação MTT S5000, que serve como base técnica para essa adaptação, demonstrou capacidades excepcionais. Construída sobre a arquitetura MUSA “Pinghu” de quarta geração, essa GPU oferece um poder de computação densa de IA de até 1.000 TFLOPS por placa. Sua configuração de hardware conta com 80 GB de VRAM de alta capacidade com largura de banda de memória de 1,6 TB/s, suportando computação de precisão total de FP8 a FP64. Além disso, uma alta largura de banda de interconexão entre placas de 784 GB/s garante excelente escalabilidade em cenários complexos de computação inteligente.
Essa colaboração não apenas valida a confiabilidade das GPUs nacionais no suporte a grandes modelos centrais de empresas estatais, mas também destaca a maturidade da Moore Threads na otimização de alto desempenho para operadoras e no desenvolvimento de ecossistemas de software. Com o lançamento oficial do modelo “Jiutian” 35B, essa combinação de “grande modelo nacional + poder de computação nacional” oferece um caso prático altamente relevante para a conquista de uma infraestrutura de computação independente e controlável.
Como corrigir as Core Web Vitals para melhorar o ranqueamento de SEO
Simplifique os Comentários do Boletim Escolar com Ferramentas de IAIntroduçãoFerramentas de IA para Gerar Comentários do Boletim EscolarMagic SchoolAlmanac AIChat GPTUsando o Magic School para Gerar Comentários do Boletim EscolarFazendo login n
O Slackbot torna-se um Agente de IA
O Slackbot, o assistente automatizado integrado à plataforma de mensagens corporativas Slack da Salesforce, está se transformando em um agente de IA. O CTO da Salesforce, Parker Harris, prevê que ele alcance um status viral comparável ao do ChatGPT d
A ByteDance Aumenta os Incentivos de IA Principal com o Doubao Aumentando 14,6%
A ByteDance convocou recentemente uma reunião de divulgação sobre a participação acionária do DouBao para revelar novas políticas de incentivos para os funcionários envolvidos na divisão do DouBao. O preço de exercício das ações do DouBao foi elevado





Lar






