Hogar
El modelo de IA MAI-Image-2 de Microsoft se sitúa entre los tres primeros puestos en la clasificación mundial de conversión de texto a imagen
El director de IA de Microsoft, Mustafa Suleiman, ha anunciado el lanzamiento de MAI-Image-2, su modelo de generación de imágenes de segunda generación. Este nuevo modelo ha tenido un debut impresionante en la prestigiosa prueba de rendimiento LMArena, aupándose directamente al tercer puesto del ranking mundial.

En la clasificación de LMArena —a menudo denominada el «campo de pruebas definitivo» para la generación de imágenes mediante IA— MAI-Image-2 ha llamado rápidamente la atención. Ahora se sitúa justo detrás de Gemini-3.1-flash-image-preview de Google y GPT-image-1.5-high-fidelity de OpenAI. En comparación con el modelo de primera generación lanzado en octubre de 2025, que inicialmente ocupaba el noveno puesto, esta segunda versión representa un salto cualitativo fundamental en la calidad general de los resultados.

Avance técnico: resolución del problema del «texto ilegible»
MAI-Image-2 ofrece importantes mejoras visuales al tiempo que aborda un desafío persistente del sector: representar el texto con precisión en las imágenes generadas por IA.
Representación precisa del texto: El modelo muestra una mejora importante en su capacidad para manejar gráficos informativos, diapositivas de presentaciones y diagramas lógicos complejos que contienen texto, produciendo caracteres claros y legibles sin distorsiones.
Detalles ultrarrealistas: recrea con precisión la iluminación natural y las texturas realistas de la piel, y construye entornos realistas que se ajustan a las leyes de la física.
Composición cinematográfica: permite generar imágenes de ultra alta resolución con conceptos surrealistas, composiciones intrincadas y una narrativa visual expansiva.

Microsoft está poniendo rápidamente esta capacidad de primer nivel a disposición de los usuarios:
Pruébelo ahora: los usuarios pueden iniciar sesión actualmente en la plataforma MAI Playground para disfrutar de una prueba gratuita.
Amplia integración: MAI-Image-2 se está integrando progresivamente en Copilot y Bing Image Creator, lo que pronto permitirá a millones de usuarios habituales acceder a ella directamente para sus proyectos de trabajo y creativos.
Este lanzamiento consolida la posición de Microsoft en la élite de la IA multimodal. Al resolver el problema fundamental de la representación de texto, amplía significativamente la aplicación de la generación de imágenes mediante IA para casos de uso profesionales y de oficina.
Artículo relacionado
CEO de DeepMind, Hassabis: Duermo seis horas al día y generalmente me siento con energía alrededor de la 1 a. m.
Fortune ha presentado recientemente una entrevista con Demis Hassabis, director ejecutivo de Google DeepMind, en la que revela su enfoque poco convencional para el descanso y la productividad. Hassabis ha revelado que duerme muy poco, estructurando s
OpenAI y Anthropic compiten por la cuota de mercado a pesar de la caída de los ingresos
A pesar de los recientes informes que sugieren que OpenAI no ha alcanzado sus objetivos de ingresos —lo que ha generado presión sobre las acciones tecnológicas este martes—, los inversores privados en
Cumplimiento de la normativa sobre vehículos autónomos en California: una nueva era de multas, geovallas y 1 millón de millas
Guident opera un servicio de transporte de AuveTech en el sur de Florida, gestionando una ruta de cuatro millas en West Palm Beach y otra de una milla en Boca Ratón mediante su tecnología de monitoriz
Recomendaciones de temas especiales relacionados
comentario (2)
0/500
Interesting to see Microsoft climbing the leaderboard, but I can't help feeling like these benchmark rankings are a bit like beauty contests—impressive stats don't always translate to real-world creativity. 🤔
Just read about Microsoft's MAI-Image-2 hitting top 3 on LMArena. As a hobbyist who dabbles with DALL-E and Midjourney, this direct benchmark climb is wild! 😲 Makes me wonder how this shakes up the 'Big Model' race... are we heading for a costly quality war, or will this push open-source models further behind? The compute costs alone must be staggering.
El director de IA de Microsoft, Mustafa Suleiman, ha anunciado el lanzamiento de MAI-Image-2, su modelo de generación de imágenes de segunda generación. Este nuevo modelo ha tenido un debut impresionante en la prestigiosa prueba de rendimiento LMArena, aupándose directamente al tercer puesto del ranking mundial.

En la clasificación de LMArena —a menudo denominada el «campo de pruebas definitivo» para la generación de imágenes mediante IA— MAI-Image-2 ha llamado rápidamente la atención. Ahora se sitúa justo detrás de Gemini-3.1-flash-image-preview de Google y GPT-image-1.5-high-fidelity de OpenAI. En comparación con el modelo de primera generación lanzado en octubre de 2025, que inicialmente ocupaba el noveno puesto, esta segunda versión representa un salto cualitativo fundamental en la calidad general de los resultados.

Avance técnico: resolución del problema del «texto ilegible»
MAI-Image-2 ofrece importantes mejoras visuales al tiempo que aborda un desafío persistente del sector: representar el texto con precisión en las imágenes generadas por IA.
Representación precisa del texto: El modelo muestra una mejora importante en su capacidad para manejar gráficos informativos, diapositivas de presentaciones y diagramas lógicos complejos que contienen texto, produciendo caracteres claros y legibles sin distorsiones.
Detalles ultrarrealistas: recrea con precisión la iluminación natural y las texturas realistas de la piel, y construye entornos realistas que se ajustan a las leyes de la física.
Composición cinematográfica: permite generar imágenes de ultra alta resolución con conceptos surrealistas, composiciones intrincadas y una narrativa visual expansiva.

Microsoft está poniendo rápidamente esta capacidad de primer nivel a disposición de los usuarios:
Pruébelo ahora: los usuarios pueden iniciar sesión actualmente en la plataforma MAI Playground para disfrutar de una prueba gratuita.
Amplia integración: MAI-Image-2 se está integrando progresivamente en Copilot y Bing Image Creator, lo que pronto permitirá a millones de usuarios habituales acceder a ella directamente para sus proyectos de trabajo y creativos.
Este lanzamiento consolida la posición de Microsoft en la élite de la IA multimodal. Al resolver el problema fundamental de la representación de texto, amplía significativamente la aplicación de la generación de imágenes mediante IA para casos de uso profesionales y de oficina.
CEO de DeepMind, Hassabis: Duermo seis horas al día y generalmente me siento con energía alrededor de la 1 a. m.
Fortune ha presentado recientemente una entrevista con Demis Hassabis, director ejecutivo de Google DeepMind, en la que revela su enfoque poco convencional para el descanso y la productividad. Hassabis ha revelado que duerme muy poco, estructurando s
OpenAI y Anthropic compiten por la cuota de mercado a pesar de la caída de los ingresos
A pesar de los recientes informes que sugieren que OpenAI no ha alcanzado sus objetivos de ingresos —lo que ha generado presión sobre las acciones tecnológicas este martes—, los inversores privados en
Interesting to see Microsoft climbing the leaderboard, but I can't help feeling like these benchmark rankings are a bit like beauty contests—impressive stats don't always translate to real-world creativity. 🤔
Just read about Microsoft's MAI-Image-2 hitting top 3 on LMArena. As a hobbyist who dabbles with DALL-E and Midjourney, this direct benchmark climb is wild! 😲 Makes me wonder how this shakes up the 'Big Model' race... are we heading for a costly quality war, or will this push open-source models further behind? The compute costs alone must be staggering.











