Maison
Zhipu dévoile GLM-5.3-Flash, un modèle multimodal natif open source proposé à un prix 40 fois inférieur
Zhipu a officiellement lancé et mis en open source GLM-5.3-Flash (320B-A18B), le premier modèle multimodal natif de la série GLM-5, offrant des performances d'IA de pointe à un coût sans précédent.
Doté de capacités de pointe au niveau mondial, ce modèle a obtenu un score de 57 à l’Artificial Analysis Intelligence Index, à égalité avec Claude Opus4.8. Il fait preuve de performances globales supérieures et d’une maîtrise du codage supérieure à celles du GLM-5.2, plus volumineux. Avant sa sortie, il occupait anonymement la première place des classements d’utilisation sur OpenCode et OpenRouter sous le nom « Ox-Alpha ».

Son rapport coût-efficacité constitue un atout majeur. Vendu à seulement un dixième du prix du GLM-5.3 standard — et jusqu’à un vingtième lors de promotions à durée limitée —, le GLM-5.3-Flash coûte environ un quarantième de l’Opus4.8, ce qui réduit considérablement les obstacles à l’accès à une IA de pointe.
Sur le plan architectural, le modèle utilise un mécanisme d’attention hybride, à la fois clairsemé et linéaire, une première pour les modèles de pointe open source. Optimisé par des super-connexions à contraintes de variété, il réduit les calculs d’attention de 3,01 fois et l’utilisation du cache KV de 4,44 fois, optimisant ainsi l’équilibre entre la gestion des contextes longs et les coûts d’inférence. Son intégration visuelle native permet l’exécution indépendante du développement front-end, de la modélisation 3D et de la création de documents, ce qui lui confère une excellence dans des domaines professionnels tels que la finance et le droit.

Il est à noter que le modèle fonctionne entièrement sur des clusters de puces nationales. En s’appuyant sur un moteur d’inférence personnalisé doté d’une séparation EPD et d’optimisations avancées de la mémoire, l’équipe a triplé la vitesse d’inférence de bout en bout, égalant l’efficacité d’utilisation du matériel des GPU NVIDIA grand public et validant ainsi la puissance de calcul nationale pour l’IA à grande échelle.
GLM-5.3-Flash est entièrement open source et offre un accès via API, des démos en ligne et une intégration avec des plateformes d’agents telles que ZCode et AutoClaw. Il propose également des « cartes d’expérience » quotidiennes offrant dix mille utilisations, accessibles aux développeurs du monde entier.
Expérience en ligne
Z.ai : https://chat.z.ai
Application Zhipu Qingyan : https://chatglm.cn
Article connexe
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Comment corriger les Core Web Vitals pour de meilleurs classements SEO
Fluidifiez les commentaires de bulletin avec des outils d'IAIntroductionOutils d'IA pour générer des commentaires de bulletinMagic SchoolAlmanac AIChat GPTUtilisation de Magic School pour générer des commentaires de bulletinConnexion à Magic Sc
Recommandations de sujets spéciaux liés
commentaires (0)
Zhipu a officiellement lancé et mis en open source GLM-5.3-Flash (320B-A18B), le premier modèle multimodal natif de la série GLM-5, offrant des performances d'IA de pointe à un coût sans précédent.
Doté de capacités de pointe au niveau mondial, ce modèle a obtenu un score de 57 à l’Artificial Analysis Intelligence Index, à égalité avec Claude Opus4.8. Il fait preuve de performances globales supérieures et d’une maîtrise du codage supérieure à celles du GLM-5.2, plus volumineux. Avant sa sortie, il occupait anonymement la première place des classements d’utilisation sur OpenCode et OpenRouter sous le nom « Ox-Alpha ».

Son rapport coût-efficacité constitue un atout majeur. Vendu à seulement un dixième du prix du GLM-5.3 standard — et jusqu’à un vingtième lors de promotions à durée limitée —, le GLM-5.3-Flash coûte environ un quarantième de l’Opus4.8, ce qui réduit considérablement les obstacles à l’accès à une IA de pointe.
Sur le plan architectural, le modèle utilise un mécanisme d’attention hybride, à la fois clairsemé et linéaire, une première pour les modèles de pointe open source. Optimisé par des super-connexions à contraintes de variété, il réduit les calculs d’attention de 3,01 fois et l’utilisation du cache KV de 4,44 fois, optimisant ainsi l’équilibre entre la gestion des contextes longs et les coûts d’inférence. Son intégration visuelle native permet l’exécution indépendante du développement front-end, de la modélisation 3D et de la création de documents, ce qui lui confère une excellence dans des domaines professionnels tels que la finance et le droit.

Il est à noter que le modèle fonctionne entièrement sur des clusters de puces nationales. En s’appuyant sur un moteur d’inférence personnalisé doté d’une séparation EPD et d’optimisations avancées de la mémoire, l’équipe a triplé la vitesse d’inférence de bout en bout, égalant l’efficacité d’utilisation du matériel des GPU NVIDIA grand public et validant ainsi la puissance de calcul nationale pour l’IA à grande échelle.
GLM-5.3-Flash est entièrement open source et offre un accès via API, des démos en ligne et une intégration avec des plateformes d’agents telles que ZCode et AutoClaw. Il propose également des « cartes d’expérience » quotidiennes offrant dix mille utilisations, accessibles aux développeurs du monde entier.
Expérience en ligne
Z.ai : https://chat.z.ai
Application Zhipu Qingyan : https://chatglm.cn
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Comment corriger les Core Web Vitals pour de meilleurs classements SEO
Fluidifiez les commentaires de bulletin avec des outils d'IAIntroductionOutils d'IA pour générer des commentaires de bulletinMagic SchoolAlmanac AIChat GPTUtilisation de Magic School pour générer des commentaires de bulletinConnexion à Magic Sc











