Maison
Zhipu brise le record mondial de vitesse en intelligence artificielle avec la version haute vitesse GLM-5.1
L'équipe renommée en matière d'IA de Chine, Zhipu, a officiellement annoncé aujourd'hui le lancement d'une nouvelle API haute vitesse GLM-5.1 destinée à certains clients entreprises. Dénommée “GLM-5.1-highspeed”, ce modèle a stupéfié l'industrie depuis son lancement, en offrant une vitesse de sortie de 400 tokens par seconde.
Ce chiffre dépasse directement le benchmark actuel de la vitesse des API établi par les principaux fournisseurs de grands modèles, démontrant ainsi une forte domination technique. Auparavant, l'industrie de l'IA considérait que la vitesse et la taille d'un modèle étaient incompatibles, une plus grande vitesse impliquant généralement des compromis sur les capacités du modèle.
Briser les normes de l'industrie avec des performances de pointe
Cependant, la version GLM-5.1 haute vitesse a renversé l'idée répandue selon laquelle “la rapidité signifie la petite taille”. Pour la première fois chez les grands modèles nationaux, elle a réussi à intégrer des capacités techniques de pointe et une latence ultra-basse dans des environnements de production réels.
Selon les rapports, ce modèle a été développé conjointement par l'équipe GLM de Zhipu et l'équipe TileRT. Les deux équipes ont réalisé des optimisations approfondies et complètes au niveau du système, sur trois niveaux : le moteur d'inférence, le système de planification et l'infrastructure sous-jacente, en s'éloignant des méthodes de planification dynamique traditionnelles.
Trois niveaux d'optimisation pour une sortie stable
Sur le plan technique, l'équipe de développement n'a pas seulement réécrit la trajectoire centrale d'inférence du modèle afin d'améliorer la capacité de traitement par carte, mais a également réduit la latence dans les scénarios à haute concurrence grâce à des techniques telles que le lotissement dynamique. De plus, des optimisations conjointes sur l'infrastructure ont permis de rendre une vitesse de 400 TPS une capacité stable et utilisable en production.
Ce modèle haute vitesse offre de larges perspectives d'application, en particulier dans les scénarios où la latence de réponse est un critère essentiel. Que ce soit pour la programmation intelligente, l'interaction vocale en temps réel ou la prise de décisions commerciales fréquentes, ce modèle est désormais disponible sur la plateforme MaaS de Zhipu pour certains entreprises.
Article connexe
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Recommandations de sujets spéciaux liés
commentaires (0)
L'équipe renommée en matière d'IA de Chine, Zhipu, a officiellement annoncé aujourd'hui le lancement d'une nouvelle API haute vitesse GLM-5.1 destinée à certains clients entreprises. Dénommée “GLM-5.1-highspeed”, ce modèle a stupéfié l'industrie depuis son lancement, en offrant une vitesse de sortie de 400 tokens par seconde.
Ce chiffre dépasse directement le benchmark actuel de la vitesse des API établi par les principaux fournisseurs de grands modèles, démontrant ainsi une forte domination technique. Auparavant, l'industrie de l'IA considérait que la vitesse et la taille d'un modèle étaient incompatibles, une plus grande vitesse impliquant généralement des compromis sur les capacités du modèle.
Briser les normes de l'industrie avec des performances de pointe
Cependant, la version GLM-5.1 haute vitesse a renversé l'idée répandue selon laquelle “la rapidité signifie la petite taille”. Pour la première fois chez les grands modèles nationaux, elle a réussi à intégrer des capacités techniques de pointe et une latence ultra-basse dans des environnements de production réels.
Selon les rapports, ce modèle a été développé conjointement par l'équipe GLM de Zhipu et l'équipe TileRT. Les deux équipes ont réalisé des optimisations approfondies et complètes au niveau du système, sur trois niveaux : le moteur d'inférence, le système de planification et l'infrastructure sous-jacente, en s'éloignant des méthodes de planification dynamique traditionnelles.
Trois niveaux d'optimisation pour une sortie stable
Sur le plan technique, l'équipe de développement n'a pas seulement réécrit la trajectoire centrale d'inférence du modèle afin d'améliorer la capacité de traitement par carte, mais a également réduit la latence dans les scénarios à haute concurrence grâce à des techniques telles que le lotissement dynamique. De plus, des optimisations conjointes sur l'infrastructure ont permis de rendre une vitesse de 400 TPS une capacité stable et utilisable en production.
Ce modèle haute vitesse offre de larges perspectives d'application, en particulier dans les scénarios où la latence de réponse est un critère essentiel. Que ce soit pour la programmation intelligente, l'interaction vocale en temps réel ou la prise de décisions commerciales fréquentes, ce modèle est désormais disponible sur la plateforme MaaS de Zhipu pour certains entreprises.
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter











