Hogar
Google y NVIDIA publican el código fuente de DiffusionGemma, lo que multiplica por cuatro la velocidad de inferencia con una sola tarjeta
El 10 de junio de 2026, Google lanzó DiffusionGemma, un modelo de lenguaje experimental de código abierto que rompe con el paradigma autorregresivo tradicional de generar texto palabra a palabra. Es pionero en el uso de mecanismos de difusión procedentes de la IA aplicada a las imágenes en la generación de texto, partiendo de ruido aleatorio y refinándolo de forma iterativa para generar bloques de 256 tokens en paralelo en cada paso.

En cuanto al rendimiento del hardware, las profundas optimizaciones de NVIDIA permiten que el modelo funcione casi cuatro veces más rápido que los modelos tradicionales comparables en modo de un solo usuario con una sola GPU. En una GPU H100, alcanza velocidades de salida de hasta 1.000 tokens por segundo para una sola solicitud, e incluso en GPU de consumo de gama alta como la RTX 5090 puede superar los 700 tokens por segundo.
DiffusionGemma cuenta con 26 000 millones de parámetros y utiliza una arquitectura de «mezcla de expertos» (MoE), activando solo 3 800 millones de parámetros por paso. Aunque la calidad y precisión de su generación de texto quedan ligeramente por detrás de los modelos tradicionales de la serie Gemma4 en las pruebas de rendimiento estándar, su exclusiva «conciencia de bloque completo» supera la limitación de los modelos autorregresivos, que solo funcionan hacia atrás. Dado que todos los tokens pueden hacer referencia entre sí durante la generación, destaca en tareas que implican datos no lineales y estructurados, como la finalización de textos, el rellenado de código, la resolución de sudokus y el procesamiento de secuencias de aminoácidos.

Los pesos del modelo son ahora de código abierto en Hugging Face bajo la licencia Apache 2.0 y funcionan a la perfección con marcos de inferencia habituales como vLLM y MLX. Esta investigación no solo elimina las restricciones de ancho de banda de memoria en la potencia de cálculo de la GPU, sino que también abre una nueva vía técnica para futuras aplicaciones de IA en lógica compleja y generación de texto no lineal.
Artículo relacionado
MiniMax presenta el Programa de Equipo 10x para incentivar a expertos globales en IA
MiniMax (Xiyu Technology), el Laboratorio de Inteligencia Artificial General, ha lanzado oficialmente "10x Team", una iniciativa global de colaboración de talento. Este programa tiene como objetivo reclutar a los mejores expertos de diversas industri
Corea del Sur inicia la construcción del Centro Nacional de Cómputo de IA, invirtiendo 2,5 billones de wones con un objetivo para 2028
El medio surcoreano EtNews informa que la ceremonia de colocación de la primera piedra del Centro de Cómputo de IA de Corea (KOACC) se llevó a cabo el 3 de agosto en el parque de centros de datos Solar City, en Sunan, Jeollanam-do. Con una inversión
Seis gigantes tecnológicos respaldan a la Linux Foundation con 12,5 millones de dólares para abordar el ruido de las vulnerabilidades de la inteligencia artificial
Para hacer frente a la avalancha de informes de seguridad de baja calidad generados por herramientas de automatización de IA, seis grandes empresas tecnológicas—Anthropic, Amazon (AWS), GitHub, Google, Microsoft y OpenAI—han contribuido conjuntamente
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
El 10 de junio de 2026, Google lanzó DiffusionGemma, un modelo de lenguaje experimental de código abierto que rompe con el paradigma autorregresivo tradicional de generar texto palabra a palabra. Es pionero en el uso de mecanismos de difusión procedentes de la IA aplicada a las imágenes en la generación de texto, partiendo de ruido aleatorio y refinándolo de forma iterativa para generar bloques de 256 tokens en paralelo en cada paso.

En cuanto al rendimiento del hardware, las profundas optimizaciones de NVIDIA permiten que el modelo funcione casi cuatro veces más rápido que los modelos tradicionales comparables en modo de un solo usuario con una sola GPU. En una GPU H100, alcanza velocidades de salida de hasta 1.000 tokens por segundo para una sola solicitud, e incluso en GPU de consumo de gama alta como la RTX 5090 puede superar los 700 tokens por segundo.
DiffusionGemma cuenta con 26 000 millones de parámetros y utiliza una arquitectura de «mezcla de expertos» (MoE), activando solo 3 800 millones de parámetros por paso. Aunque la calidad y precisión de su generación de texto quedan ligeramente por detrás de los modelos tradicionales de la serie Gemma4 en las pruebas de rendimiento estándar, su exclusiva «conciencia de bloque completo» supera la limitación de los modelos autorregresivos, que solo funcionan hacia atrás. Dado que todos los tokens pueden hacer referencia entre sí durante la generación, destaca en tareas que implican datos no lineales y estructurados, como la finalización de textos, el rellenado de código, la resolución de sudokus y el procesamiento de secuencias de aminoácidos.

Los pesos del modelo son ahora de código abierto en Hugging Face bajo la licencia Apache 2.0 y funcionan a la perfección con marcos de inferencia habituales como vLLM y MLX. Esta investigación no solo elimina las restricciones de ancho de banda de memoria en la potencia de cálculo de la GPU, sino que también abre una nueva vía técnica para futuras aplicaciones de IA en lógica compleja y generación de texto no lineal.
MiniMax presenta el Programa de Equipo 10x para incentivar a expertos globales en IA
MiniMax (Xiyu Technology), el Laboratorio de Inteligencia Artificial General, ha lanzado oficialmente "10x Team", una iniciativa global de colaboración de talento. Este programa tiene como objetivo reclutar a los mejores expertos de diversas industri
Corea del Sur inicia la construcción del Centro Nacional de Cómputo de IA, invirtiendo 2,5 billones de wones con un objetivo para 2028
El medio surcoreano EtNews informa que la ceremonia de colocación de la primera piedra del Centro de Cómputo de IA de Corea (KOACC) se llevó a cabo el 3 de agosto en el parque de centros de datos Solar City, en Sunan, Jeollanam-do. Con una inversión
Seis gigantes tecnológicos respaldan a la Linux Foundation con 12,5 millones de dólares para abordar el ruido de las vulnerabilidades de la inteligencia artificial
Para hacer frente a la avalancha de informes de seguridad de baja calidad generados por herramientas de automatización de IA, seis grandes empresas tecnológicas—Anthropic, Amazon (AWS), GitHub, Google, Microsoft y OpenAI—han contribuido conjuntamente











