Hogar
Tongyi Lab lanza Fun-ASR1.5, capaz de traducir 30 idiomas, dialectos y poemas antiguos.

En la tecnología de reconocimiento del habla impulsada por la IA, lograr un equilibrio adecuado entre una cobertura amplia y un reconocimiento preciso ha sido durante mucho tiempo un desafío. El 20 de abril, el Tongyi Lab de Alibaba lanzó oficialmente el gran modelo de reconocimiento del habla Fun-ASR1.5. Gracias a una arquitectura unificada basada en modelos grandes, este sistema consigue avances significativos a la hora de manejar múltiples idiomas, dialectos regionales y entornos acústicos complejos.
Fun-ASR1.5 ofrece capacidades de escucha muy completas. Soporta 30 idiomas principales de todo el mundo y se adapta profundamente a siete dialectos chinos importantes, además de más de 20 acentos locales. Lo que es especialmente destacable, es que destaca en contextos culturales tradicionales: incluso es capaz de transcribir con precisión poesías antiguas recitadas con tonos variados y estructuras gramaticales únicas en tiempo real.
Ahora disponible en la plataforma Alibaba Cloud Bailian, Fun-ASR1.5 proporciona una tecnología de reconocimiento del habla eficiente a través de servicios API para industrias como la educación, los medios de comunicación, las finanzas, la tecnología y la cultura, ayudándolas a avanzar hacia un trabajo de oficina inteligente y una transformación digital.
Artículo relacionado
El lanzamiento global de la campaña de campus de Seed de ByteDance ofrece acciones virtuales para captar a los mejores talentos en modelos grandes
En el competitivo panorama de los modelos de lenguaje grandes, asegurar el talento de primer nivel sigue siendo el activo estratégico más crítico.El 1 de abril, ByteDance anunció el lanzamiento de su iniciativa global de reclutamiento de campus Seed
Suno añade marcas de agua a las canciones en medio de batallas legales
Suno, la plataforma que permite a los usuarios generar música creada por inteligencia artificial, ha presentado nuevas funciones para etiquetar las pistas producidas en la plataforma, restringir las descargas y actualizar las normas de la comunidad c
Musk admite que Grok filtró código de usuarios, promete borrar todos los datos históricos
Elon Musk abordó directamente la controversia por privacidad relacionada con Grok Build, comenzando con un simple "Verdadero" para confirmar la validez del incidente. Se comprometió a que todos los datos de usuario cargados previamente en SpaceXAI se
Recomendaciones de temas especiales relacionados
comentario (1)
0/500

En la tecnología de reconocimiento del habla impulsada por la IA, lograr un equilibrio adecuado entre una cobertura amplia y un reconocimiento preciso ha sido durante mucho tiempo un desafío. El 20 de abril, el Tongyi Lab de Alibaba lanzó oficialmente el gran modelo de reconocimiento del habla Fun-ASR1.5. Gracias a una arquitectura unificada basada en modelos grandes, este sistema consigue avances significativos a la hora de manejar múltiples idiomas, dialectos regionales y entornos acústicos complejos.
Fun-ASR1.5 ofrece capacidades de escucha muy completas. Soporta 30 idiomas principales de todo el mundo y se adapta profundamente a siete dialectos chinos importantes, además de más de 20 acentos locales. Lo que es especialmente destacable, es que destaca en contextos culturales tradicionales: incluso es capaz de transcribir con precisión poesías antiguas recitadas con tonos variados y estructuras gramaticales únicas en tiempo real.
Ahora disponible en la plataforma Alibaba Cloud Bailian, Fun-ASR1.5 proporciona una tecnología de reconocimiento del habla eficiente a través de servicios API para industrias como la educación, los medios de comunicación, las finanzas, la tecnología y la cultura, ayudándolas a avanzar hacia un trabajo de oficina inteligente y una transformación digital.
El lanzamiento global de la campaña de campus de Seed de ByteDance ofrece acciones virtuales para captar a los mejores talentos en modelos grandes
En el competitivo panorama de los modelos de lenguaje grandes, asegurar el talento de primer nivel sigue siendo el activo estratégico más crítico.El 1 de abril, ByteDance anunció el lanzamiento de su iniciativa global de reclutamiento de campus Seed
Suno añade marcas de agua a las canciones en medio de batallas legales
Suno, la plataforma que permite a los usuarios generar música creada por inteligencia artificial, ha presentado nuevas funciones para etiquetar las pistas producidas en la plataforma, restringir las descargas y actualizar las normas de la comunidad c
Musk admite que Grok filtró código de usuarios, promete borrar todos los datos históricos
Elon Musk abordó directamente la controversia por privacidad relacionada con Grok Build, comenzando con un simple "Verdadero" para confirmar la validez del incidente. Se comprometió a que todos los datos de usuario cargados previamente en SpaceXAI se











