Heim
Zhipu stellt GLM-5.3-Flash vor: ein natives multimodales Modell, das als Open Source zur Verfügung gestellt wird – zum 1/40-Teil des Preises
Zhipu hat GLM-5.3-Flash (320B-A18B), das erste native multimodale Modell der GLM-5-Serie, offiziell auf den Markt gebracht und als Open-Source-Software veröffentlicht. Es bietet hochmoderne KI-Leistung zu beispiellos niedrigen Kosten.
Das Modell verfügt über weltweit führende Fähigkeiten und erzielte im Artificial Analysis Intelligence Index 57 Punkte, was dem Ergebnis von Claude Opus4.8 entspricht. Im Vergleich zum größeren GLM-5.2 zeigt es eine überlegene Gesamtleistung und Programmierkompetenz. Bereits vor seiner Veröffentlichung führte es unter dem Namen „Ox-Alpha“ anonym die Nutzungsranglisten auf OpenCode und OpenRouter an.

Kosteneffizienz ist ein entscheidender Vorteil. Mit einem Preis von nur einem Zehntel des Standard-GLM-5.3 – und im Rahmen zeitlich begrenzter Sonderaktionen sogar nur einem Zwanzigstel – kostet das GLM-5.3-Flash etwa ein Vierzigstel von Opus4.8, was die Zugangsbarriere zu modernster KI drastisch senkt.
Architektonisch nutzt das Modell einen hybriden, aus spärlicher und linearer Aufmerksamkeit bestehenden Mechanismus – eine Premiere bei Open-Source-Frontier-Modellen. Durch „Manifold Constraint Super Connections“ erweitert, reduziert es den Rechenaufwand für die Aufmerksamkeit um das 3,01-Fache und die KV-Cache-Nutzung um das 4,44-Fache, wodurch das Gleichgewicht zwischen der Verarbeitung langer Kontexte und den Inferenzkosten optimiert wird. Seine native visuelle Integration ermöglicht die unabhängige Ausführung von Frontend-Entwicklung, 3D-Modellierung und Dokumentenerstellung und zeichnet sich besonders in professionellen Bereichen wie Finanzen und Recht aus.

Bemerkenswert ist, dass das Modell vollständig auf inländischen Chip-Clustern läuft. Durch den Einsatz einer maßgeschneiderten Inferenz-Engine mit EPD-Trennung und fortschrittlichen Speicheroptimierungen erzielte das Team eine Verdreifachung der End-to-End-Inferenzgeschwindigkeit, was der Hardware-Auslastungseffizienz gängiger NVIDIA-GPUs entspricht und die Leistungsfähigkeit der inländischen Rechenkapazitäten für groß angelegte KI unter Beweis stellt.
GLM-5.3-Flash ist vollständig als Open Source verfügbar und bietet API-Zugriff, Online-Demos sowie die Integration in Agent-Plattformen wie ZCode und AutoClaw. Zudem stehen Entwicklern weltweit tägliche „Experience Cards“ zur Verfügung, die jeweils zehntausend Nutzungen ermöglichen.
Online-Erfahrung
Z.ai: https://chat.z.ai
Zhipu Qingyan App: https://chatglm.cn
Verwandter Artikel
ByteDances Seed startet globale Campus-Werbung und bietet virtuelle Aktien, um Top-Talente für große Modelle zu gewinnen
Im wettbewerbsintensiven Umfeld der großen Sprachmodelle bleibt die Sicherung erstklassiger Talente das wichtigste strategische Asset.Am 1. April ByteDance gab die Einführung seiner globalen Campus-Rekrutierungsinitiative Seed bekannt, die Teil seine
Suno fügt Wasserzeichen in Songs ein, während Rechtsstreitigkeiten andauern
Suno, die Plattform, die es Nutzern ermöglicht, KI-generierte Musik zu erstellen, hat neue Funktionen vorgestellt, um plattformproduzierte Tracks zu kennzeichnen, Downloads einzuschränken und die Community-Richtlinien zu aktualisieren, um unbefugte K
Musk räumt ein, dass Grok-Build Benutzercode geleakt hat, verspricht aber, alle historischen Daten zu löschen
Elon Musk wandte sich direkt an die Datenschutzkontroverse um Grok Build, beginnend mit einem einfachen „True“, um die Gültigkeit des Vorfalls zu bestätigen. Er versprach, dass alle zuvor bei SpaceXAI hochgeladenen Benutzerdaten unwiderruflich gelösc
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Zhipu hat GLM-5.3-Flash (320B-A18B), das erste native multimodale Modell der GLM-5-Serie, offiziell auf den Markt gebracht und als Open-Source-Software veröffentlicht. Es bietet hochmoderne KI-Leistung zu beispiellos niedrigen Kosten.
Das Modell verfügt über weltweit führende Fähigkeiten und erzielte im Artificial Analysis Intelligence Index 57 Punkte, was dem Ergebnis von Claude Opus4.8 entspricht. Im Vergleich zum größeren GLM-5.2 zeigt es eine überlegene Gesamtleistung und Programmierkompetenz. Bereits vor seiner Veröffentlichung führte es unter dem Namen „Ox-Alpha“ anonym die Nutzungsranglisten auf OpenCode und OpenRouter an.

Kosteneffizienz ist ein entscheidender Vorteil. Mit einem Preis von nur einem Zehntel des Standard-GLM-5.3 – und im Rahmen zeitlich begrenzter Sonderaktionen sogar nur einem Zwanzigstel – kostet das GLM-5.3-Flash etwa ein Vierzigstel von Opus4.8, was die Zugangsbarriere zu modernster KI drastisch senkt.
Architektonisch nutzt das Modell einen hybriden, aus spärlicher und linearer Aufmerksamkeit bestehenden Mechanismus – eine Premiere bei Open-Source-Frontier-Modellen. Durch „Manifold Constraint Super Connections“ erweitert, reduziert es den Rechenaufwand für die Aufmerksamkeit um das 3,01-Fache und die KV-Cache-Nutzung um das 4,44-Fache, wodurch das Gleichgewicht zwischen der Verarbeitung langer Kontexte und den Inferenzkosten optimiert wird. Seine native visuelle Integration ermöglicht die unabhängige Ausführung von Frontend-Entwicklung, 3D-Modellierung und Dokumentenerstellung und zeichnet sich besonders in professionellen Bereichen wie Finanzen und Recht aus.

Bemerkenswert ist, dass das Modell vollständig auf inländischen Chip-Clustern läuft. Durch den Einsatz einer maßgeschneiderten Inferenz-Engine mit EPD-Trennung und fortschrittlichen Speicheroptimierungen erzielte das Team eine Verdreifachung der End-to-End-Inferenzgeschwindigkeit, was der Hardware-Auslastungseffizienz gängiger NVIDIA-GPUs entspricht und die Leistungsfähigkeit der inländischen Rechenkapazitäten für groß angelegte KI unter Beweis stellt.
GLM-5.3-Flash ist vollständig als Open Source verfügbar und bietet API-Zugriff, Online-Demos sowie die Integration in Agent-Plattformen wie ZCode und AutoClaw. Zudem stehen Entwicklern weltweit tägliche „Experience Cards“ zur Verfügung, die jeweils zehntausend Nutzungen ermöglichen.
Online-Erfahrung
Z.ai: https://chat.z.ai
Zhipu Qingyan App: https://chatglm.cn
ByteDances Seed startet globale Campus-Werbung und bietet virtuelle Aktien, um Top-Talente für große Modelle zu gewinnen
Im wettbewerbsintensiven Umfeld der großen Sprachmodelle bleibt die Sicherung erstklassiger Talente das wichtigste strategische Asset.Am 1. April ByteDance gab die Einführung seiner globalen Campus-Rekrutierungsinitiative Seed bekannt, die Teil seine
Suno fügt Wasserzeichen in Songs ein, während Rechtsstreitigkeiten andauern
Suno, die Plattform, die es Nutzern ermöglicht, KI-generierte Musik zu erstellen, hat neue Funktionen vorgestellt, um plattformproduzierte Tracks zu kennzeichnen, Downloads einzuschränken und die Community-Richtlinien zu aktualisieren, um unbefugte K
Musk räumt ein, dass Grok-Build Benutzercode geleakt hat, verspricht aber, alle historischen Daten zu löschen
Elon Musk wandte sich direkt an die Datenschutzkontroverse um Grok Build, beginnend mit einem einfachen „True“, um die Gültigkeit des Vorfalls zu bestätigen. Er versprach, dass alle zuvor bei SpaceXAI hochgeladenen Benutzerdaten unwiderruflich gelösc











