Heim
Xunfei Xinghuo X2-Flash kommt mit verbesserter Rechenleistung und Unterstützung für 256 KB lange Texte auf den Markt
Am 29. April stellte iFLYTEK offiziell das neue Modell „Spark X2-Flash“ vor und öffnete dessen API-Schnittstelle. Damit wurde ein neuer Meilenstein in Sachen Effizienz für Anwendungen mit großen Modellen gesetzt, die auf dem heimischen Rechenleistungs-Ökosystem basieren.
Das Modell nutzt die derzeit gängige MoE-Architektur (Mixture of Experts) mit insgesamt 30 Milliarden Parametern. Sein herausragendes Merkmal ist die Unterstützung eines extrem langen Kontexts von bis zu 256K. Bemerkenswert ist, dass das Spark X2-Flash vollständig auf dem Ascend 910B-Cluster von Huawei trainiert wurde, was die Synergie von inländischer Software und Hardware für das Deep-Learning-Training demonstriert.

In Bezug auf die Kernleistung bietet das Spark X2-Flash erhebliche Verbesserungen bei den Fähigkeiten zur Agenten- und Codegenerierung. Tests von Drittanbietern zeigen, dass seine Leistung bei komplexen Aufgaben – wie der Verarbeitung tiefgreifender Forschungsberichte, der Verwaltung und dem Aufruf von Fähigkeiten sowie der Ausführung von Systemsteuerung – das Niveau von Spitzenmodellen der Branche mit Billionen von Parametern erreicht hat.
Auch in Bezug auf die Kosten, die für Entwickler von Bedeutung sind, überzeugt das Spark X2-Flash. In identischen Workflow-Tests beträgt sein Token-Verbrauch nur ein Drittel des Verbrauchs aktueller gängiger großer Modelle, was die Hürde für die Entwicklung komplexer Agentenanwendungen erheblich senkt. Beispielsweise erfasst das Modell bei der Erstellung komplexer Fähigkeiten zur Videogenerierung nicht nur schnell die Anforderungen, sondern bietet auch detaillierte Erklärungen, die von der Skill-Struktur bis hin zu den Kernfunktionen reichen.

Technisch gesehen ist das Spark X2-Flash das erste Modell, das DSA (Sparse Attention) und MTP (Multi-Token Prediction) auf heimischen Chips kombiniert. Diese Innovation löst das Problem des langsamen Trainings langer Texte auf heimischen Rechenplattformen und steigert die Trainingseffizienz im Vergleich zu Clustern ähnlicher Größe um das 4,5-Fache. Darüber hinaus verbessert das Modell bei Szenarien des agentenbasierten verstärkenden Lernens die Effizienz der Sampling-Inferenz durch kombinierte algorithmische und technische Optimierungen um mehr als das Doppelte und beseitigt so effektiv Leistungsengpässe in Szenarien mit langen Interaktionen.
Derzeit haben Anwendungen wie AstronClaw und Loomy die Integration als erste abgeschlossen. Das Modell ist zudem eng auf internationale Mainstream-Agenten-Frameworks wie OpenClaw und Claude Code abgestimmt und bietet Entwicklern weltweit eine kostengünstigere Option für inländische Rechenleistung.
Verwandter Artikel
ByteDances Seed startet globale Campus-Werbung und bietet virtuelle Aktien, um Top-Talente für große Modelle zu gewinnen
Im wettbewerbsintensiven Umfeld der großen Sprachmodelle bleibt die Sicherung erstklassiger Talente das wichtigste strategische Asset.Am 1. April ByteDance gab die Einführung seiner globalen Campus-Rekrutierungsinitiative Seed bekannt, die Teil seine
Suno fügt Wasserzeichen in Songs ein, während Rechtsstreitigkeiten andauern
Suno, die Plattform, die es Nutzern ermöglicht, KI-generierte Musik zu erstellen, hat neue Funktionen vorgestellt, um plattformproduzierte Tracks zu kennzeichnen, Downloads einzuschränken und die Community-Richtlinien zu aktualisieren, um unbefugte K
Musk räumt ein, dass Grok-Build Benutzercode geleakt hat, verspricht aber, alle historischen Daten zu löschen
Elon Musk wandte sich direkt an die Datenschutzkontroverse um Grok Build, beginnend mit einem einfachen „True“, um die Gültigkeit des Vorfalls zu bestätigen. Er versprach, dass alle zuvor bei SpaceXAI hochgeladenen Benutzerdaten unwiderruflich gelösc
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Am 29. April stellte iFLYTEK offiziell das neue Modell „Spark X2-Flash“ vor und öffnete dessen API-Schnittstelle. Damit wurde ein neuer Meilenstein in Sachen Effizienz für Anwendungen mit großen Modellen gesetzt, die auf dem heimischen Rechenleistungs-Ökosystem basieren.
Das Modell nutzt die derzeit gängige MoE-Architektur (Mixture of Experts) mit insgesamt 30 Milliarden Parametern. Sein herausragendes Merkmal ist die Unterstützung eines extrem langen Kontexts von bis zu 256K. Bemerkenswert ist, dass das Spark X2-Flash vollständig auf dem Ascend 910B-Cluster von Huawei trainiert wurde, was die Synergie von inländischer Software und Hardware für das Deep-Learning-Training demonstriert.

In Bezug auf die Kernleistung bietet das Spark X2-Flash erhebliche Verbesserungen bei den Fähigkeiten zur Agenten- und Codegenerierung. Tests von Drittanbietern zeigen, dass seine Leistung bei komplexen Aufgaben – wie der Verarbeitung tiefgreifender Forschungsberichte, der Verwaltung und dem Aufruf von Fähigkeiten sowie der Ausführung von Systemsteuerung – das Niveau von Spitzenmodellen der Branche mit Billionen von Parametern erreicht hat.
Auch in Bezug auf die Kosten, die für Entwickler von Bedeutung sind, überzeugt das Spark X2-Flash. In identischen Workflow-Tests beträgt sein Token-Verbrauch nur ein Drittel des Verbrauchs aktueller gängiger großer Modelle, was die Hürde für die Entwicklung komplexer Agentenanwendungen erheblich senkt. Beispielsweise erfasst das Modell bei der Erstellung komplexer Fähigkeiten zur Videogenerierung nicht nur schnell die Anforderungen, sondern bietet auch detaillierte Erklärungen, die von der Skill-Struktur bis hin zu den Kernfunktionen reichen.

Technisch gesehen ist das Spark X2-Flash das erste Modell, das DSA (Sparse Attention) und MTP (Multi-Token Prediction) auf heimischen Chips kombiniert. Diese Innovation löst das Problem des langsamen Trainings langer Texte auf heimischen Rechenplattformen und steigert die Trainingseffizienz im Vergleich zu Clustern ähnlicher Größe um das 4,5-Fache. Darüber hinaus verbessert das Modell bei Szenarien des agentenbasierten verstärkenden Lernens die Effizienz der Sampling-Inferenz durch kombinierte algorithmische und technische Optimierungen um mehr als das Doppelte und beseitigt so effektiv Leistungsengpässe in Szenarien mit langen Interaktionen.
Derzeit haben Anwendungen wie AstronClaw und Loomy die Integration als erste abgeschlossen. Das Modell ist zudem eng auf internationale Mainstream-Agenten-Frameworks wie OpenClaw und Claude Code abgestimmt und bietet Entwicklern weltweit eine kostengünstigere Option für inländische Rechenleistung.
ByteDances Seed startet globale Campus-Werbung und bietet virtuelle Aktien, um Top-Talente für große Modelle zu gewinnen
Im wettbewerbsintensiven Umfeld der großen Sprachmodelle bleibt die Sicherung erstklassiger Talente das wichtigste strategische Asset.Am 1. April ByteDance gab die Einführung seiner globalen Campus-Rekrutierungsinitiative Seed bekannt, die Teil seine
Suno fügt Wasserzeichen in Songs ein, während Rechtsstreitigkeiten andauern
Suno, die Plattform, die es Nutzern ermöglicht, KI-generierte Musik zu erstellen, hat neue Funktionen vorgestellt, um plattformproduzierte Tracks zu kennzeichnen, Downloads einzuschränken und die Community-Richtlinien zu aktualisieren, um unbefugte K
Musk räumt ein, dass Grok-Build Benutzercode geleakt hat, verspricht aber, alle historischen Daten zu löschen
Elon Musk wandte sich direkt an die Datenschutzkontroverse um Grok Build, beginnend mit einem einfachen „True“, um die Gültigkeit des Vorfalls zu bestätigen. Er versprach, dass alle zuvor bei SpaceXAI hochgeladenen Benutzerdaten unwiderruflich gelösc











