Lar
O modelo de IA MAI-Image-2 da Microsoft está entre os três primeiros no ranking global de conversão de texto em imagem
O diretor de IA da Microsoft, Mustafa Suleiman, anunciou o lançamento do MAI-Image-2, seu modelo de geração de imagens de segunda geração. Esse novo modelo teve uma estreia impressionante no renomado benchmark LMArena, alcançando diretamente a terceira posição no ranking global.

No ranking da LMArena — frequentemente chamado de “o campo de provas definitivo” para geração de imagens por IA —, o MAI-Image-2 rapidamente chamou a atenção. Ele agora está logo atrás do Gemini-3.1-flash-image-preview, do Google, e do GPT-image-1.5-high-fidelity, da OpenAI. Em comparação com o modelo de primeira geração lançado em outubro de 2025, que inicialmente ocupava a nona posição, esta segunda iteração representa um salto fundamental na qualidade geral da produção.

Avanço técnico: resolvendo o problema do “texto distorcido”
O MAI-Image-2 oferece melhorias visuais significativas ao mesmo tempo em que enfrenta um desafio persistente do setor: renderizar texto com precisão em imagens geradas por IA.
Renderização precisa de texto: O modelo apresenta uma grande melhoria em sua capacidade de lidar com gráficos informativos, slides de apresentação e diagramas lógicos complexos que contêm texto, produzindo caracteres nítidos e legíveis, sem distorções.
Detalhes ultrarrealistas: recria com precisão a iluminação natural, texturas de pele realistas e constrói ambientes realistas que seguem as leis da física.
Composição cinematográfica: Ele suporta a geração de imagens de ultra-alta resolução com conceitos surreais, composições complexas e narrativa visual expansiva.

A Microsoft está disponibilizando rapidamente esse recurso de ponta para os usuários:
Experimente agora: os usuários podem atualmente fazer login na plataforma MAI Playground para uma avaliação gratuita.
Ampla integração: O MAI-Image-2 está sendo progressivamente integrado ao Copilot e ao Bing Image Creator, o que em breve permitirá que milhões de usuários comuns acessem a ferramenta diretamente para trabalhos e projetos criativos.
Este lançamento consolida a posição da Microsoft no topo do setor de IA multimodal. Ao resolver a questão central da renderização de texto, ele expande significativamente a aplicação da geração de imagens por IA para casos de uso profissionais e no ambiente de escritório.
Artigo relacionado
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri
Conformidade com a regulamentação de veículos autônomos na Califórnia: uma nova era de multas, geocercas e 1 milhão de milhas
A Guident opera um veículo de transporte da AuveTech no sul da Flórida, administrando uma rota de quatro milhas em West Palm Beach e uma rota de uma milha em Boca Raton por meio de sua tecnologia de m
Recomendações de tópicos especiais relacionados
Comentários (2)
Interesting to see Microsoft climbing the leaderboard, but I can't help feeling like these benchmark rankings are a bit like beauty contests—impressive stats don't always translate to real-world creativity. 🤔
Just read about Microsoft's MAI-Image-2 hitting top 3 on LMArena. As a hobbyist who dabbles with DALL-E and Midjourney, this direct benchmark climb is wild! 😲 Makes me wonder how this shakes up the 'Big Model' race... are we heading for a costly quality war, or will this push open-source models further behind? The compute costs alone must be staggering.
O diretor de IA da Microsoft, Mustafa Suleiman, anunciou o lançamento do MAI-Image-2, seu modelo de geração de imagens de segunda geração. Esse novo modelo teve uma estreia impressionante no renomado benchmark LMArena, alcançando diretamente a terceira posição no ranking global.

No ranking da LMArena — frequentemente chamado de “o campo de provas definitivo” para geração de imagens por IA —, o MAI-Image-2 rapidamente chamou a atenção. Ele agora está logo atrás do Gemini-3.1-flash-image-preview, do Google, e do GPT-image-1.5-high-fidelity, da OpenAI. Em comparação com o modelo de primeira geração lançado em outubro de 2025, que inicialmente ocupava a nona posição, esta segunda iteração representa um salto fundamental na qualidade geral da produção.

Avanço técnico: resolvendo o problema do “texto distorcido”
O MAI-Image-2 oferece melhorias visuais significativas ao mesmo tempo em que enfrenta um desafio persistente do setor: renderizar texto com precisão em imagens geradas por IA.
Renderização precisa de texto: O modelo apresenta uma grande melhoria em sua capacidade de lidar com gráficos informativos, slides de apresentação e diagramas lógicos complexos que contêm texto, produzindo caracteres nítidos e legíveis, sem distorções.
Detalhes ultrarrealistas: recria com precisão a iluminação natural, texturas de pele realistas e constrói ambientes realistas que seguem as leis da física.
Composição cinematográfica: Ele suporta a geração de imagens de ultra-alta resolução com conceitos surreais, composições complexas e narrativa visual expansiva.

A Microsoft está disponibilizando rapidamente esse recurso de ponta para os usuários:
Experimente agora: os usuários podem atualmente fazer login na plataforma MAI Playground para uma avaliação gratuita.
Ampla integração: O MAI-Image-2 está sendo progressivamente integrado ao Copilot e ao Bing Image Creator, o que em breve permitirá que milhões de usuários comuns acessem a ferramenta diretamente para trabalhos e projetos criativos.
Este lançamento consolida a posição da Microsoft no topo do setor de IA multimodal. Ao resolver a questão central da renderização de texto, ele expande significativamente a aplicação da geração de imagens por IA para casos de uso profissionais e no ambiente de escritório.
CEO da DeepMind, Hassabis: Durmo seis horas por dia, geralmente me sinto energético por volta da 1h
O Fortune recentemente publicou uma entrevista com Demis Hassabis, CEO da Google DeepMind, revelando sua abordagem incomum para descanso e produtividade. Hassabis revelou que dorme muito pouco, estruturando suas horas acordadas em dois blocos de trab
OpenAI e Anthropic disputam participação no mercado, apesar da queda na receita
Apesar de relatos recentes sugerirem que a OpenAI não atingiu suas metas de receita, o que gerou pressão sobre as ações do setor de tecnologia nesta terça-feira, os investidores privados em laboratóri
Interesting to see Microsoft climbing the leaderboard, but I can't help feeling like these benchmark rankings are a bit like beauty contests—impressive stats don't always translate to real-world creativity. 🤔
Just read about Microsoft's MAI-Image-2 hitting top 3 on LMArena. As a hobbyist who dabbles with DALL-E and Midjourney, this direct benchmark climb is wild! 😲 Makes me wonder how this shakes up the 'Big Model' race... are we heading for a costly quality war, or will this push open-source models further behind? The compute costs alone must be staggering.











