Lar
Zhipu quebra o recorde mundial de velocidade em IA com a versão de alta velocidade GLM-5.1
A renomada equipe de IA da China, Zhipu, anunciou oficialmente hoje o lançamento de uma nova API de alta velocidade GLM-5.1 para clientes empresariais selecionados. Com o nome em código “GLM-5.1-highspeed”, este modelo surpreendeu o setor desde seu lançamento, oferecendo uma velocidade de saída de 400 tokens por segundo.
Este número supera diretamente o atual padrão global de velocidade de API estabelecido pelos principais fornecedores de grandes modelos, demonstrando uma forte dominância técnica. Anteriormente, o setor de IA assumia que a velocidade e o tamanho dos modelos eram mutuamente exclusivos, com velocidades mais altas geralmente exigindo compromissos nas capacidades do modelo.
Quebrando os Padrões do Setor com Desempenho de Primeira Linha
No entanto, a versão GLM-5.1 de alta velocidade quebrou a crença há muito estabelecida de que “velocidade significa tamanho reduzido”. Pela primeira vez entre os grandes modelos nacionais, ela conseguiu levar capacidades técnicas de primeira linha e latência extremamente baixa para ambientes de produção reais.
Segundo relatos, este modelo foi desenvolvido em conjunto pela equipe GLM da Zhipu e pela equipe TileRT. Ambas as equipes realizaram otimizações profundas e abrangentes em três níveis: o mecanismo de inferência, o sistema de agendamento e a infraestrutura subjacente, abandonando os métodos tradicionais de agendamento dinâmico.
Otimização em Três Níveis Assegura uma Saída Estável
Do ponto de vista técnico, a equipe de desenvolvimento não apenas reescreveu o caminho central de inferência da arquitetura do modelo para aumentar a taxa de processamento por placa, mas também reduziu a latência em cenários de alta concorrência através de técnicas como o agendamento dinâmico em lotes. Ao mesmo tempo, otimizações colaborativas na infraestrutura garantiram que 400 TPS se tornasse uma capacidade estável e utilizável em produção.
Este modelo de alta velocidade tem amplas perspectivas de aplicação, especialmente em cenários que exigem baixa latência de resposta. Seja para programação de IA, interações vocais em tempo real ou decisões comerciais frequentes, o modelo já está disponível na plataforma MaaS da Zhipu para empresas selecionadas.
Artigo relacionado
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos
À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr
O Google testa o Agente Remy AI para o Gemini, à medida que o foco se desloca para o controle do usuário
De acordo com o Business Insider, o Google está testando o Remy, um novo agente pessoal de IA para o Gemini. Esta ferramenta tem como objetivo executar tarefas em nome dos usuários, simplificando tanto os fluxos de trabalho profissionais quanto as ro
Recomendações de tópicos especiais relacionados
Comentários (0)
A renomada equipe de IA da China, Zhipu, anunciou oficialmente hoje o lançamento de uma nova API de alta velocidade GLM-5.1 para clientes empresariais selecionados. Com o nome em código “GLM-5.1-highspeed”, este modelo surpreendeu o setor desde seu lançamento, oferecendo uma velocidade de saída de 400 tokens por segundo.
Este número supera diretamente o atual padrão global de velocidade de API estabelecido pelos principais fornecedores de grandes modelos, demonstrando uma forte dominância técnica. Anteriormente, o setor de IA assumia que a velocidade e o tamanho dos modelos eram mutuamente exclusivos, com velocidades mais altas geralmente exigindo compromissos nas capacidades do modelo.
Quebrando os Padrões do Setor com Desempenho de Primeira Linha
No entanto, a versão GLM-5.1 de alta velocidade quebrou a crença há muito estabelecida de que “velocidade significa tamanho reduzido”. Pela primeira vez entre os grandes modelos nacionais, ela conseguiu levar capacidades técnicas de primeira linha e latência extremamente baixa para ambientes de produção reais.
Segundo relatos, este modelo foi desenvolvido em conjunto pela equipe GLM da Zhipu e pela equipe TileRT. Ambas as equipes realizaram otimizações profundas e abrangentes em três níveis: o mecanismo de inferência, o sistema de agendamento e a infraestrutura subjacente, abandonando os métodos tradicionais de agendamento dinâmico.
Otimização em Três Níveis Assegura uma Saída Estável
Do ponto de vista técnico, a equipe de desenvolvimento não apenas reescreveu o caminho central de inferência da arquitetura do modelo para aumentar a taxa de processamento por placa, mas também reduziu a latência em cenários de alta concorrência através de técnicas como o agendamento dinâmico em lotes. Ao mesmo tempo, otimizações colaborativas na infraestrutura garantiram que 400 TPS se tornasse uma capacidade estável e utilizável em produção.
Este modelo de alta velocidade tem amplas perspectivas de aplicação, especialmente em cenários que exigem baixa latência de resposta. Seja para programação de IA, interações vocais em tempo real ou decisões comerciais frequentes, o modelo já está disponível na plataforma MaaS da Zhipu para empresas selecionadas.
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Startup sueca de IA Lovable Eyes tem avaliação de US$ 13,2 bilhões após rodada principal de investimentos
À medida que as ferramentas de codificação impulsionadas por IA ganham tração, a startup sueca Lovable garantiu uma grande rodada de financiamento. A empresa visa captar US$ 3 bilhões, o que poderia elevar sua avaliação para US$ 13,2 bilhões — o dobr











