Heim
Zhipu bricht mit der Hochgeschwindigkeitsversion GLM-5.1 den globalen Rekord im Bereich KI-Geschwindigkeit
Das renommierte chinesische AI-Team Zhipu hat heute offiziell die Einführung einer neuen GLM-5.1 Highspeed-API für ausgewählte Unternehmenskunden angekündigt. Unter dem Codenamen „GLM-5.1-highspeed“ hat dieses Modell seit seiner Veröffentlichung die Branche in Erstaunen versetzt, da es eine Ausgabegeschwindigkeit von 400 Tokens pro Sekunde erreicht.
Diese Zahl übertrifft direkt den derzeitigen globalen API-Geschwindigkeitsstandard, der von großen Modellanbietern gesetzt wird, und zeigt damit eine starke technische Dominanz. Bisher ging die AI-Branche davon aus, dass Modellspeed und Größe sich gegenseitig ausschließen – höhere Geschwindigkeiten erforderten in der Regel Kompromisse bei den Modelfähigkeiten.
Branchenstandards durch Spitzenleistung brechen
Die GLM-5.1 Highspeed-Version hat jedoch das lang etablierte Glauben der Branche, dass „schnell gleich klein“ bedeutet, widerlegt. Erstmals bei inländischen großen Modellen gelang es, Spitzenleistungen und extrem niedrige Latenzzeiten in reale Produktionsumgebungen zu integrieren.
Berichten zufolge wurde dieses Modell gemeinsam vom GLM-Team von Zhipu und dem TileRT-Team entwickelt. Beide Teams führten umfassende Systemoptimierungen auf drei Ebenen durch: dem Inferenzsystem, dem Scheduling-System und der zugrundeliegenden Infrastruktur, wobei sie sich vom traditionellen dynamischen Scheduling entfernten.
Dreiebene Optimierung sorgt für stabile Ausgaben
Auf technischer Ebene hat das Entwicklerteam nicht nur den Kerninferenzpfad der Modellarchitektur überarbeitet, um die Durchsatzrate zu erhöhen, sondern auch durch Techniken wie dynamisches Batching die Latenzzeit in hochkonkurrenzierenden Szenarien verringert. Gleichzeitig sorgten gemeinsame Optimierungen der Infrastruktur dafür, dass eine Ausgabegeschwindigkeit von 400 TPS zu einer stabilen und nutzbaren Produktionsleistung wurde.
Dieses Hochgeschwindigkeitsmodell bietet breite Anwendungsmöglichkeiten, insbesondere in Szenarien mit strengen Anforderungen an die Reaktionszeit. Egal ob für AI-Programmierung, Echtzeit-Stimminteraktion oder häufige Geschäftsentscheidungen – das Modell ist jetzt auf der MaaS-Plattform von Zhipu für ausgewählte Unternehmen verfügbar.
Verwandter Artikel
U.S.-Aktien erreichen historischen Meilenstein, während KI- und Luft- und Raumfahrtriesen auf ihr Debüt als Billionen-Dollar-Unternehmen vorbereiten
Elon Musk, Sam Altman und Dario Amodei, drei Giganten des Technologiesektors, schreiten den Börsengängen ihrer jeweiligen Unternehmen voran. Mit SpaceX, OpenAI und Anthropic – drei Branchenriesen, die einer Bewertung von einer Billion US-Dollar nahek
Schwedisches KI-Startup Lovable Eyes: Bewertung von 13,2 Milliarden US-Dollar nach großer Finanzierungsrunde
Während KI-gestützte Coding-Tools an Popularität gewinnen, hat das schwedische Startup Lovable eine bedeutende Finanzierungsrunde abgeschlossen. Das Unternehmen strebt danach, 3 Milliarden US-Dollar einzusammeln, was seine Bewertung potenziell auf 13
Google testet den Remy AI Agent für Gemini, da der Fokus auf die Benutzerkontrolle verlagert wird
Laut Business Insider testet Google Remy, einen neuen KI-Personalagenten für Gemini. Dieses Tool soll Aufgaben im Auftrag von Nutzern ausführen und sowohl professionelle Arbeitsabläufe als auch tägliche Routinen optimieren.Derzeit wird Remy in einer
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Das renommierte chinesische AI-Team Zhipu hat heute offiziell die Einführung einer neuen GLM-5.1 Highspeed-API für ausgewählte Unternehmenskunden angekündigt. Unter dem Codenamen „GLM-5.1-highspeed“ hat dieses Modell seit seiner Veröffentlichung die Branche in Erstaunen versetzt, da es eine Ausgabegeschwindigkeit von 400 Tokens pro Sekunde erreicht.
Diese Zahl übertrifft direkt den derzeitigen globalen API-Geschwindigkeitsstandard, der von großen Modellanbietern gesetzt wird, und zeigt damit eine starke technische Dominanz. Bisher ging die AI-Branche davon aus, dass Modellspeed und Größe sich gegenseitig ausschließen – höhere Geschwindigkeiten erforderten in der Regel Kompromisse bei den Modelfähigkeiten.
Branchenstandards durch Spitzenleistung brechen
Die GLM-5.1 Highspeed-Version hat jedoch das lang etablierte Glauben der Branche, dass „schnell gleich klein“ bedeutet, widerlegt. Erstmals bei inländischen großen Modellen gelang es, Spitzenleistungen und extrem niedrige Latenzzeiten in reale Produktionsumgebungen zu integrieren.
Berichten zufolge wurde dieses Modell gemeinsam vom GLM-Team von Zhipu und dem TileRT-Team entwickelt. Beide Teams führten umfassende Systemoptimierungen auf drei Ebenen durch: dem Inferenzsystem, dem Scheduling-System und der zugrundeliegenden Infrastruktur, wobei sie sich vom traditionellen dynamischen Scheduling entfernten.
Dreiebene Optimierung sorgt für stabile Ausgaben
Auf technischer Ebene hat das Entwicklerteam nicht nur den Kerninferenzpfad der Modellarchitektur überarbeitet, um die Durchsatzrate zu erhöhen, sondern auch durch Techniken wie dynamisches Batching die Latenzzeit in hochkonkurrenzierenden Szenarien verringert. Gleichzeitig sorgten gemeinsame Optimierungen der Infrastruktur dafür, dass eine Ausgabegeschwindigkeit von 400 TPS zu einer stabilen und nutzbaren Produktionsleistung wurde.
Dieses Hochgeschwindigkeitsmodell bietet breite Anwendungsmöglichkeiten, insbesondere in Szenarien mit strengen Anforderungen an die Reaktionszeit. Egal ob für AI-Programmierung, Echtzeit-Stimminteraktion oder häufige Geschäftsentscheidungen – das Modell ist jetzt auf der MaaS-Plattform von Zhipu für ausgewählte Unternehmen verfügbar.
U.S.-Aktien erreichen historischen Meilenstein, während KI- und Luft- und Raumfahrtriesen auf ihr Debüt als Billionen-Dollar-Unternehmen vorbereiten
Elon Musk, Sam Altman und Dario Amodei, drei Giganten des Technologiesektors, schreiten den Börsengängen ihrer jeweiligen Unternehmen voran. Mit SpaceX, OpenAI und Anthropic – drei Branchenriesen, die einer Bewertung von einer Billion US-Dollar nahek
Schwedisches KI-Startup Lovable Eyes: Bewertung von 13,2 Milliarden US-Dollar nach großer Finanzierungsrunde
Während KI-gestützte Coding-Tools an Popularität gewinnen, hat das schwedische Startup Lovable eine bedeutende Finanzierungsrunde abgeschlossen. Das Unternehmen strebt danach, 3 Milliarden US-Dollar einzusammeln, was seine Bewertung potenziell auf 13











