微軟的 MAI-Image-2 人工智慧模型在全球文字轉圖像領域中名列前三
微軟人工智慧總監穆斯塔法·蘇萊曼(Mustafa Suleiman)宣布推出第二代影像生成模型 MAI-Image-2。這款新模型在權威的 LMArena 基準測試中表現亮眼,一舉躍居全球第三名。

在常被稱為人工智慧圖像生成「終極試金石」的 LMArena 排行榜上,MAI-Image-2 迅速引起了廣泛關注。目前其排名僅次於 Google 的 Gemini-3.1-flash-image-preview 以及 OpenAI 的 GPT-image-1.5-high-fidelity。 相較於2025年10月推出的第一代模型(最初排名第九),此第二代版本在整體輸出品質上實現了根本性的飛躍。

技術突破:解決「文字混亂」問題
MAI-Image-2 在視覺表現上取得顯著提升,同時解決了業界長期面臨的挑戰:在 AI 生成的圖像中精準呈現文字。
精準文字渲染:該模型在處理資訊圖表、簡報投影片及含文字的複雜邏輯圖表方面展現重大升級,能生成清晰可讀且無損的文字。
超寫實細節:它能精準重現自然光線、逼真的肌膚紋理,並建構遵循物理定律的栩栩如生環境。
電影級構圖:支援生成具備超現實概念、精緻構圖及宏大視覺敘事的超高解析度影像。

微軟正迅速將這項頂尖功能提供給使用者:
立即體驗:使用者現可登入 MAI Playground 平台進行免費試用。
廣泛整合:MAI-Image-2 正逐步整合至 Copilot 和 Bing Image Creator,這將使數百萬一般用戶很快就能直接透過這些工具,將其應用於工作與創意專案中。
此次發布鞏固了微軟在多模態 AI 領域的頂尖地位。透過解決文字渲染的核心難題,它顯著擴展了 AI 圖像生成在專業及辦公應用場景中的應用範圍。
相關文章
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
加州自動駕駛合規:罰單、地理圍欄與 100 萬英里的新時代
Guident 在南佛羅里達州營運一輛 AuveTech 接駁車,並運用其遠端監控技術,管理西棕櫚灘的一條四英里路線以及博卡拉頓的一條一英里路線。| 圖片來源:Guident加州正重新定義無人駕駛車輛的監管格局,從科技產業的「快速行動、打破常規」心態,轉向嚴格的問責制與嚴謹的行駛里程要求。Guident 執行董事長兼執行長哈羅德·布勞恩(Harold Braun)在《機器人報告》(The Robo
相關專題推薦
評論 (2)
0/500
Interesting to see Microsoft climbing the leaderboard, but I can't help feeling like these benchmark rankings are a bit like beauty contests—impressive stats don't always translate to real-world creativity. 🤔
Just read about Microsoft's MAI-Image-2 hitting top 3 on LMArena. As a hobbyist who dabbles with DALL-E and Midjourney, this direct benchmark climb is wild! 😲 Makes me wonder how this shakes up the 'Big Model' race... are we heading for a costly quality war, or will this push open-source models further behind? The compute costs alone must be staggering.
微軟人工智慧總監穆斯塔法·蘇萊曼(Mustafa Suleiman)宣布推出第二代影像生成模型 MAI-Image-2。這款新模型在權威的 LMArena 基準測試中表現亮眼,一舉躍居全球第三名。

在常被稱為人工智慧圖像生成「終極試金石」的 LMArena 排行榜上,MAI-Image-2 迅速引起了廣泛關注。目前其排名僅次於 Google 的 Gemini-3.1-flash-image-preview 以及 OpenAI 的 GPT-image-1.5-high-fidelity。 相較於2025年10月推出的第一代模型(最初排名第九),此第二代版本在整體輸出品質上實現了根本性的飛躍。

技術突破:解決「文字混亂」問題
MAI-Image-2 在視覺表現上取得顯著提升,同時解決了業界長期面臨的挑戰:在 AI 生成的圖像中精準呈現文字。
精準文字渲染:該模型在處理資訊圖表、簡報投影片及含文字的複雜邏輯圖表方面展現重大升級,能生成清晰可讀且無損的文字。
超寫實細節:它能精準重現自然光線、逼真的肌膚紋理,並建構遵循物理定律的栩栩如生環境。
電影級構圖:支援生成具備超現實概念、精緻構圖及宏大視覺敘事的超高解析度影像。

微軟正迅速將這項頂尖功能提供給使用者:
立即體驗:使用者現可登入 MAI Playground 平台進行免費試用。
廣泛整合:MAI-Image-2 正逐步整合至 Copilot 和 Bing Image Creator,這將使數百萬一般用戶很快就能直接透過這些工具,將其應用於工作與創意專案中。
此次發布鞏固了微軟在多模態 AI 領域的頂尖地位。透過解決文字渲染的核心難題,它顯著擴展了 AI 圖像生成在專業及辦公應用場景中的應用範圍。
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
Interesting to see Microsoft climbing the leaderboard, but I can't help feeling like these benchmark rankings are a bit like beauty contests—impressive stats don't always translate to real-world creativity. 🤔
Just read about Microsoft's MAI-Image-2 hitting top 3 on LMArena. As a hobbyist who dabbles with DALL-E and Midjourney, this direct benchmark climb is wild! 😲 Makes me wonder how this shakes up the 'Big Model' race... are we heading for a costly quality war, or will this push open-source models further behind? The compute costs alone must be staggering.





首頁






