Heim
Cambricon stellt vollständige Modell-Tagesnull-Kompatibilität und open-source optimierten Code für DeepSeek-V4 vor

Cambricon hat die „Day0“-Integration der neuesten Open-Source-Modellserie von DeepSeek, DeepSeek-V4 , unter Nutzung des vLLM-Inferenzframeworks abgeschlossen. Diese umfassende Anpassung umfasst sowohl die Flash-Variante (285 Milliarden Parameter) als auch die Pro-Variante (1,6 Billionen Parameter) und gewährleistet sofortige Stabilität auf Cambricon-Hardware ab dem Release. Der entsprechende Integrationscode wurde offiziell auf GitHub als Open-Source veröffentlicht.
Unter Berücksichtigung der einzigartigen sparsamen Aufmerksamkeitsmechanismen und der komprimierten Architektur von DeepSeek-V4 beschleunigte Cambricon Kernkomponenten wie den Kompressor mithilfe seiner proprietären Vektorfusionsbibliothek Torch-MLU-Ops. Durch den Einsatz der hochleistungsfähigen Programmiersprache BangC entwickelte das Team optimierte Kernel für kritische Operationen wie sparsame Aufmerksamkeit und GroupGemm. Die Lösung unterstützt vollumfänglich die fünfdimensionale hybride Parallelität (TP/PP/SP/DP/EP), die Quantisierung mit niedriger Präzision sowie die Trennung von Prompt und Dekodierung (PD-Trennung) innerhalb des vLLM-Frameworks, was den Token-Durchsatz erheblich steigert, während strenge Latenzanforderungen eingehalten werden.
Auf Hardware-Ebene nutzt Cambricon die Speicherzugriffs- und Sortierungsbeschleunigungsfunktionen von MLU, um die komplexen Indexierungsstrukturen von DeepSeek-V4 zu verwalten. Durch die Ausnutzung hoher Interconnect-Bandbreite und latenzarmer Kommunikation wird dieser Ansatz den Overhead in den Phasen Prefill und Decode minimiert, wodurch die Inferenzeffizienz maximiert wird.
Branchenexperten weisen darauf hin, dass das Millionen-Token-Kontextfenster und die erstklassigen logischen Fähigkeiten von DeepSeek-V4 robuste zugrunde liegende Rechenarchitekturen erfordern. Die schnelle Day0-Anpassung durch Cambricon unterstreicht die Stärke inländischer Rechenplattformen bei der Unterstützung ultra-großer, komplexer Modelle und signalisiert, dass das inländische KI-Ökosystem ein reifes Niveau der Software-Hardware-Synergie erreicht hat, das eine leistungsfähige Grundlage für die weitverbreitete Einführung großer Modelle bietet.
Verwandter Artikel
Slackbot wird zu einem KI-Agenten
Slackbot, der automatisierte Assistent, der in Salesforce’s Unternehmens-Messaging-Plattform Slack integriert ist, entwickelt sich zu einem KI-Agenten. Salesforce-CTO Parker Harris sieht das Potenzial für eine virale Verbreitung, die mit OpenAIs Chat
ByteDance erhöht die Kern-KI-Anreize, während Doubao um 14,6 % steigt
ByteDance hat kürzlich ein Equity-Briefing für DouBao abgehalten, um neue Anreizrichtlinien für Mitarbeiter der DouBao-Sparte vorzustellen. Der Ausübungspreis für DouBao-Anteile wurde von 14,85 US-Dollar im Juni 2026 auf 17,02 US-Dollar angehoben, wa
MiniMax stellt 10x-Teamprogramm vor, um globale KI-Experten zu motivieren
MiniMax (Xiyu Technology), das General Artificial Intelligence Lab, hat offiziell „10x Team“ gestartet, eine globale Initiative zur Talentsuche und Zusammenarbeit. Dieses Programm zielt darauf ab, führende Experten aus verschiedenen Branchen zu rekru
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)

Cambricon hat die „Day0“-Integration der neuesten Open-Source-Modellserie von DeepSeek,
Unter Berücksichtigung der einzigartigen sparsamen Aufmerksamkeitsmechanismen und der komprimierten Architektur von
Auf Hardware-Ebene nutzt Cambricon die Speicherzugriffs- und Sortierungsbeschleunigungsfunktionen von MLU, um die komplexen Indexierungsstrukturen von
Branchenexperten weisen darauf hin, dass das Millionen-Token-Kontextfenster und die erstklassigen logischen Fähigkeiten von DeepSeek-V4 robuste zugrunde liegende Rechenarchitekturen erfordern. Die schnelle Day0-Anpassung durch Cambricon unterstreicht die Stärke inländischer Rechenplattformen bei der Unterstützung ultra-großer, komplexer Modelle und signalisiert, dass das inländische KI-Ökosystem ein reifes Niveau der Software-Hardware-Synergie erreicht hat, das eine leistungsfähige Grundlage für die weitverbreitete Einführung großer Modelle bietet.
Slackbot wird zu einem KI-Agenten
Slackbot, der automatisierte Assistent, der in Salesforce’s Unternehmens-Messaging-Plattform Slack integriert ist, entwickelt sich zu einem KI-Agenten. Salesforce-CTO Parker Harris sieht das Potenzial für eine virale Verbreitung, die mit OpenAIs Chat
ByteDance erhöht die Kern-KI-Anreize, während Doubao um 14,6 % steigt
ByteDance hat kürzlich ein Equity-Briefing für DouBao abgehalten, um neue Anreizrichtlinien für Mitarbeiter der DouBao-Sparte vorzustellen. Der Ausübungspreis für DouBao-Anteile wurde von 14,85 US-Dollar im Juni 2026 auf 17,02 US-Dollar angehoben, wa
MiniMax stellt 10x-Teamprogramm vor, um globale KI-Experten zu motivieren
MiniMax (Xiyu Technology), das General Artificial Intelligence Lab, hat offiziell „10x Team“ gestartet, eine globale Initiative zur Talentsuche und Zusammenarbeit. Dieses Programm zielt darauf ab, führende Experten aus verschiedenen Branchen zu rekru











