Hogar
El modelo de IA MAI-Image-2 de Microsoft se sitúa entre los tres primeros puestos en la clasificación mundial de conversión de texto a imagen
El director de IA de Microsoft, Mustafa Suleiman, ha anunciado el lanzamiento de MAI-Image-2, su modelo de generación de imágenes de segunda generación. Este nuevo modelo ha tenido un debut impresionante en la prestigiosa prueba de rendimiento LMArena, aupándose directamente al tercer puesto del ranking mundial.

En la clasificación de LMArena —a menudo denominada el «campo de pruebas definitivo» para la generación de imágenes mediante IA— MAI-Image-2 ha llamado rápidamente la atención. Ahora se sitúa justo detrás de Gemini-3.1-flash-image-preview de Google y GPT-image-1.5-high-fidelity de OpenAI. En comparación con el modelo de primera generación lanzado en octubre de 2025, que inicialmente ocupaba el noveno puesto, esta segunda versión representa un salto cualitativo fundamental en la calidad general de los resultados.

Avance técnico: resolución del problema del «texto ilegible»
MAI-Image-2 ofrece importantes mejoras visuales al tiempo que aborda un desafío persistente del sector: representar el texto con precisión en las imágenes generadas por IA.
Representación precisa del texto: El modelo muestra una mejora importante en su capacidad para manejar gráficos informativos, diapositivas de presentaciones y diagramas lógicos complejos que contienen texto, produciendo caracteres claros y legibles sin distorsiones.
Detalles ultrarrealistas: recrea con precisión la iluminación natural y las texturas realistas de la piel, y construye entornos realistas que se ajustan a las leyes de la física.
Composición cinematográfica: permite generar imágenes de ultra alta resolución con conceptos surrealistas, composiciones intrincadas y una narrativa visual expansiva.

Microsoft está poniendo rápidamente esta capacidad de primer nivel a disposición de los usuarios:
Pruébelo ahora: los usuarios pueden iniciar sesión actualmente en la plataforma MAI Playground para disfrutar de una prueba gratuita.
Amplia integración: MAI-Image-2 se está integrando progresivamente en Copilot y Bing Image Creator, lo que pronto permitirá a millones de usuarios habituales acceder a ella directamente para sus proyectos de trabajo y creativos.
Este lanzamiento consolida la posición de Microsoft en la élite de la IA multimodal. Al resolver el problema fundamental de la representación de texto, amplía significativamente la aplicación de la generación de imágenes mediante IA para casos de uso profesionales y de oficina.
Artículo relacionado
Musk admite que Grok filtró código de usuarios, promete borrar todos los datos históricos
Elon Musk abordó directamente la controversia por privacidad relacionada con Grok Build, comenzando con un simple "Verdadero" para confirmar la validez del incidente. Se comprometió a que todos los datos de usuario cargados previamente en SpaceXAI se
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de
La startup sueca de inteligencia artificial Lovable Eyes alcanza una valoración de 13.200 millones de dólares tras una importante ronda de financiación
Mientras las herramientas de codificación impulsadas por inteligencia artificial ganan terreno, la startup sueca Lovable ha asegurado una importante ronda de financiación. La empresa tiene como objetivo recaudar 3 000 millones de dólares, lo que podr
Recomendaciones de temas especiales relacionados
comentario (2)
0/500
Interesting to see Microsoft climbing the leaderboard, but I can't help feeling like these benchmark rankings are a bit like beauty contests—impressive stats don't always translate to real-world creativity. 🤔
Just read about Microsoft's MAI-Image-2 hitting top 3 on LMArena. As a hobbyist who dabbles with DALL-E and Midjourney, this direct benchmark climb is wild! 😲 Makes me wonder how this shakes up the 'Big Model' race... are we heading for a costly quality war, or will this push open-source models further behind? The compute costs alone must be staggering.
El director de IA de Microsoft, Mustafa Suleiman, ha anunciado el lanzamiento de MAI-Image-2, su modelo de generación de imágenes de segunda generación. Este nuevo modelo ha tenido un debut impresionante en la prestigiosa prueba de rendimiento LMArena, aupándose directamente al tercer puesto del ranking mundial.

En la clasificación de LMArena —a menudo denominada el «campo de pruebas definitivo» para la generación de imágenes mediante IA— MAI-Image-2 ha llamado rápidamente la atención. Ahora se sitúa justo detrás de Gemini-3.1-flash-image-preview de Google y GPT-image-1.5-high-fidelity de OpenAI. En comparación con el modelo de primera generación lanzado en octubre de 2025, que inicialmente ocupaba el noveno puesto, esta segunda versión representa un salto cualitativo fundamental en la calidad general de los resultados.

Avance técnico: resolución del problema del «texto ilegible»
MAI-Image-2 ofrece importantes mejoras visuales al tiempo que aborda un desafío persistente del sector: representar el texto con precisión en las imágenes generadas por IA.
Representación precisa del texto: El modelo muestra una mejora importante en su capacidad para manejar gráficos informativos, diapositivas de presentaciones y diagramas lógicos complejos que contienen texto, produciendo caracteres claros y legibles sin distorsiones.
Detalles ultrarrealistas: recrea con precisión la iluminación natural y las texturas realistas de la piel, y construye entornos realistas que se ajustan a las leyes de la física.
Composición cinematográfica: permite generar imágenes de ultra alta resolución con conceptos surrealistas, composiciones intrincadas y una narrativa visual expansiva.

Microsoft está poniendo rápidamente esta capacidad de primer nivel a disposición de los usuarios:
Pruébelo ahora: los usuarios pueden iniciar sesión actualmente en la plataforma MAI Playground para disfrutar de una prueba gratuita.
Amplia integración: MAI-Image-2 se está integrando progresivamente en Copilot y Bing Image Creator, lo que pronto permitirá a millones de usuarios habituales acceder a ella directamente para sus proyectos de trabajo y creativos.
Este lanzamiento consolida la posición de Microsoft en la élite de la IA multimodal. Al resolver el problema fundamental de la representación de texto, amplía significativamente la aplicación de la generación de imágenes mediante IA para casos de uso profesionales y de oficina.
Musk admite que Grok filtró código de usuarios, promete borrar todos los datos históricos
Elon Musk abordó directamente la controversia por privacidad relacionada con Grok Build, comenzando con un simple "Verdadero" para confirmar la validez del incidente. Se comprometió a que todos los datos de usuario cargados previamente en SpaceXAI se
Las acciones de EE. UU. alcanzan un hito histórico mientras gigantes de la IA y la aeroespacial se preparan para su debut de un billón de dólares
Elon Musk, Sam Altman y Dario Amodei, tres titanes del sector tecnológico, están avanzando hacia ofertas públicas iniciales para sus respectivas empresas. Con SpaceX, OpenAI y Anthropic, tres gigantes de la industria que se acercan a valoraciones de
La startup sueca de inteligencia artificial Lovable Eyes alcanza una valoración de 13.200 millones de dólares tras una importante ronda de financiación
Mientras las herramientas de codificación impulsadas por inteligencia artificial ganan terreno, la startup sueca Lovable ha asegurado una importante ronda de financiación. La empresa tiene como objetivo recaudar 3 000 millones de dólares, lo que podr
Interesting to see Microsoft climbing the leaderboard, but I can't help feeling like these benchmark rankings are a bit like beauty contests—impressive stats don't always translate to real-world creativity. 🤔
Just read about Microsoft's MAI-Image-2 hitting top 3 on LMArena. As a hobbyist who dabbles with DALL-E and Midjourney, this direct benchmark climb is wild! 😲 Makes me wonder how this shakes up the 'Big Model' race... are we heading for a costly quality war, or will this push open-source models further behind? The compute costs alone must be staggering.











