Hogar
Tencent y Tsinghua lanzan SongGeneration 2, con una tasa de error del 8,55 %, lo que intensifica la presión sobre Suno
El panorama de la música generada por IA experimentó otro cambio significativo a principios de 2026. El 9 de marzo se presentó oficialmente el modelo base musical SongGeneration2, desarrollado conjuntamente por Tencent y el Laboratorio de Interacción Voz-Ordenador de la Universidad de Tsinghua . Este modelo no solo supuso un salto cualitativo en la arquitectura técnica, sino que también superó a los modelos de código abierto más extendidos actualmente en múltiples aspectos fundamentales, llegando incluso a rivalizar con los mejores modelos comerciales en cuanto a calidad general.

Tres avances decisivos: se acabó la música generada por IA «artificial»
Las principales ventajas de SongGeneration2 provienen de una actualización integral de su arquitectura subyacente, que aborda tres puntos débiles clave que afectaban a la música generada por IA anteriormente:
Alta musicalidad: a diferencia de la simple superposición de melodías, este modelo gestiona arreglos complejos de varias pistas con una profundidad espacial impresionante.
Alta precisión en las letras: la pronunciación poco clara y los cambios de tono «alucinados» ya son cosa del pasado. Su tasa de error de fonemas (PER) es de tan solo el 8,55 %, superando notablemente al modelo comercial líder, Suno v5 (12,4 %), y solo por detrás de MiniMax2.5 .
Gran capacidad de control: ya sea a través de descripciones de texto o indicaciones de audio, sigue las instrucciones con precisión, lo que permite una personalización profunda del estilo y la emoción.

Impulso «Dual-Core»: una colaboración de ensueño entre los modelos LLM y de difusión
Desde el punto de vista arquitectónico, SongGeneration2 emplea una innovadora arquitectura híbrida de LLM y difusión:
Composing Brain (LeLM): se encarga de la planificación de la estructura global y de los detalles vocales, resolviendo el reto de «cómo cantar».
Renderizador de alta fidelidad (difusión): sintetiza detalles acústicos extremadamente complejos bajo la guía del modelo de lenguaje.
Representación jerárquica: es el primero en adoptar el modelado paralelo de representaciones mixtas y multipista, equilibrando la estabilidad melódica con el refinamiento de la calidad del sonido.
Verdadero código abierto, fácil acceso: incluso los ordenadores normales pueden «escribir canciones»
Lo que más entusiasmó a los desarrolladores fue la notable apertura de Tencent. El modelo SongGeneration-v2-large, con 4.000 millones de parámetros, es ahora totalmente de código abierto y admite la generación multilingüe, incluyendo el chino y el inglés. Sorprendentemente, funciona a la perfección en hardware de consumo con tan solo 22 GB de VRAM, lo que permite la creación musical local y privada.
Para que los usuarios puedan probarlo de inmediato, el equipo también ha lanzado la versión SongGeneration-v2-Fast en HuggingFace, que sacrifica una mínima pérdida de calidad de audio a cambio de una generación ultrarrápida, capaz de producir una canción completa en menos de un minuto.
A juzgar por el rendimiento de SongGeneration2 , la música generada por IA ha pasado oficialmente de ser un «juguete para frikis» a entrar en el ámbito de las «aplicaciones de nivel comercial». Con la próxima publicación en código abierto de un modelo Medium compatible con 12 GB de VRAM y un marco de evaluación automatizado, la era en la que todo el mundo se convierta en «compositor» podría estar finalmente a la vuelta de la esquina.
Artículo relacionado
Suno añade marcas de agua a las canciones en medio de batallas legales
Suno, la plataforma que permite a los usuarios generar música creada por inteligencia artificial, ha presentado nuevas funciones para etiquetar las pistas producidas en la plataforma, restringir las descargas y actualizar las normas de la comunidad c
Musk admite que Grok filtró código de usuarios, promete borrar todos los datos históricos
Elon Musk abordó directamente la controversia por privacidad relacionada con Grok Build, comenzando con un simple "Verdadero" para confirmar la validez del incidente. Se comprometió a que todos los datos de usuario cargados previamente en SpaceXAI se
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
El panorama de la música generada por IA experimentó otro cambio significativo a principios de 2026. El 9 de marzo se presentó oficialmente el modelo base musical SongGeneration2, desarrollado conjuntamente por

Tres avances decisivos: se acabó la música generada por IA «artificial»
Las principales ventajas de
Alta musicalidad: a diferencia de la simple superposición de melodías, este modelo gestiona arreglos complejos de varias pistas con una profundidad espacial impresionante.
Alta precisión en las letras: la pronunciación poco clara y los cambios de tono «alucinados» ya son cosa del pasado. Su tasa de error de fonemas (PER) es de tan solo el 8,55 %, superando notablemente al modelo comercial líder,
Gran capacidad de control: ya sea a través de descripciones de texto o indicaciones de audio, sigue las instrucciones con precisión, lo que permite una personalización profunda del estilo y la emoción.

Impulso «Dual-Core»: una colaboración de ensueño entre los modelos LLM y de difusión
Desde el punto de vista arquitectónico,
Composing Brain (LeLM): se encarga de la planificación de la estructura global y de los detalles vocales, resolviendo el reto de «cómo cantar».
Renderizador de alta fidelidad (difusión): sintetiza detalles acústicos extremadamente complejos bajo la guía del modelo de lenguaje.
Representación jerárquica: es el primero en adoptar el modelado paralelo de representaciones mixtas y multipista, equilibrando la estabilidad melódica con el refinamiento de la calidad del sonido.
Verdadero código abierto, fácil acceso: incluso los ordenadores normales pueden «escribir canciones»
Lo que más entusiasmó a los desarrolladores fue la notable apertura de Tencent. El modelo SongGeneration-v2-large, con 4.000 millones de parámetros, es ahora totalmente de código abierto y admite la generación multilingüe, incluyendo el chino y el inglés. Sorprendentemente, funciona a la perfección en hardware de consumo con tan solo 22 GB de VRAM, lo que permite la creación musical local y privada.
Para que los usuarios puedan probarlo de inmediato, el equipo también ha lanzado la versión SongGeneration-v2-Fast en HuggingFace, que sacrifica una mínima pérdida de calidad de audio a cambio de una generación ultrarrápida, capaz de producir una canción completa en menos de un minuto.
A juzgar por el rendimiento de
Suno añade marcas de agua a las canciones en medio de batallas legales
Suno, la plataforma que permite a los usuarios generar música creada por inteligencia artificial, ha presentado nuevas funciones para etiquetar las pistas producidas en la plataforma, restringir las descargas y actualizar las normas de la comunidad c
Musk admite que Grok filtró código de usuarios, promete borrar todos los datos históricos
Elon Musk abordó directamente la controversia por privacidad relacionada con Grok Build, comenzando con un simple "Verdadero" para confirmar la validez del incidente. Se comprometió a que todos los datos de usuario cargados previamente en SpaceXAI se
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de











