Option
Heim
Eilmeldung
Inhalt
FredScott
FredScott
20. September 2026

Qwen3.8-LiveTranslate, ein Echtzeit-Übersetzungsmodell der nächsten Generation, wurde in den Bereichen Übersetzungsqualität, Latenzzeit, Sprechererkennung und Sprachsynthese verbessert. Dank einer audio-textlich verschränkten Interleave-Architektur wird die durchschnittliche Latenzzeit von 2,8 auf 2,3 Sekunden reduziert. Zu den Kernfunktionen gehören die Echtzeit-Trennung von Sprechern, die bilingual synchronisierte Übersetzung und die Entmischung langer Kontexte. Durch ein Hybrid-MoE-Design („Thinker-Talker“) werden 60 Sprachen unterstützt, und das System übertrifft gängige Lösungen in Bezug auf Wiedergabetreue und Sprecherabtrennung. Die API ist über die Qwen-KI-Plattform verfügbar; künftige Entwicklungen konzentrieren sich auf die weitere Reduzierung der Latenzzeit und die Erweiterung der Sprachunterstützung.

Qwen3.8-LiveTranslate, ein Echtzeit-Übersetzungsmodell der nächsten Generation, wurde in den Bereichen Übersetzungsqualität, Latenzzeit, Sprechererkennung und Sprachsynthese verbessert. Dank einer audio-textlich verschränkten Interleave-Architektur wird die durchschnittliche Latenzzeit von 2,8 auf 2,3 Sekunden reduziert. Zu den Kernfunktionen gehören die Echtzeit-Trennung von Sprechern, die bilingual synchronisierte Übersetzung und die Entmischung langer Kontexte. Durch ein Hybrid-MoE-Design („Thinker-Talker“) werden 60 Sprachen unterstützt, und das System übertrifft gängige Lösungen in Bezug auf Wiedergabetreue und Sprecherabtrennung. Die API ist über die Qwen-KI-Plattform verfügbar; künftige Entwicklungen konzentrieren sich auf die weitere Reduzierung der Latenzzeit und die Erweiterung der Sprachunterstützung. Qwen3.8-LiveTranslate, ein Echtzeit-Übersetzungsmodell der nächsten Generation, wurde in den Bereichen Übersetzungsqualität, Latenzzeit, Sprechererkennung und Sprachsynthese verbessert. Dank einer audio-textlich verschränkten Interleave-Architektur wird die durchschnittliche Latenzzeit von 2,8 auf 2,3 Sekunden reduziert. Zu den Kernfunktionen gehören die Echtzeit-Trennung von Sprechern, die bilingual synchronisierte Übersetzung und die Entmischung langer Kontexte. Durch ein Hybrid-MoE-Design („Thinker-Talker“) werden 60 Sprachen unterstützt, und das System übertrifft gängige Lösungen in Bezug auf Wiedergabetreue und Sprecherabtrennung. Die API ist über die Qwen-KI-Plattform verfügbar; künftige Entwicklungen konzentrieren sich auf die weitere Reduzierung der Latenzzeit und die Erweiterung der Sprachunterstützung.
Kommentare (0)
0/300
OR