阿里巴巴推出 Wan2.7-Image,終結通用 AI 臉孔的時代
阿里官方大模型團隊今日正式推出統一的圖像生成與編輯模型「Wan2.7-Image」。該模型在人像定制、色彩控制及長文本渲染方面,相較前代產品實現了質的飛躍,旨在克服人工智慧生成視覺內容中常見的「千篇一律」問題。
該模型現已透過阿里雲百聯平台的 API 開放使用,並於萬象網站開放公測。

核心強化功能:虛擬「面部雕塑」與精準色彩控制
Wan2.7-Image 導入多項業界領先且具差異化的功能,大幅拓展創作可能性:
為每位主角打造獨特面容:具備強化版的虛擬「面部雕塑」能力。使用者可透過文字提示精準控制骨骼結構、眼型(如杏眼或鳳眼)及其他面部細節,有效消除標準化的 AI 生成面孔。
精密色彩調色盤:新增進階色彩控制功能。使用者可從參考圖片中提取色彩比例,將特定色調(例如梵谷的鮮豔黃色或畢卡索的冷冽藍色)精準複製到新作中。
3K 字元超長文本渲染:解決常見的 AI 文本生成問題,支援多達 12 種語言。該模型能渲染橫跨整張 A4 紙的複雜文本、表格或公式,並具備可直接列印的品質。
在影像編輯領域,Wan2.7-Image 首度推出「互動式編輯」功能。使用者只需精準選取區域,即可進行新增、對齊、移動,甚至執行像素級的邏輯替換——例如將冰塊替換為水果,同時完美保留場景的原始光線。

此外,該模型支援生成最多 12 張連貫的圖像集,能在不同場景中維持風格與主題特徵的高一致性,非常適合團體合照或協調的產品組合。
Ali 解釋道,Wan2.7-Image 採用了生成與理解相結合的統一架構。透過在共享潛在空間內實現語義映射,該模型不僅超越了對像素圖案的猜測,更發展出對語義的真正底層理解。
隨著其即將於 2026 年視覺創作領域問世,Wan2.7-Image 預示著 AI 圖像生成領域的轉變:從「隨機抽卡」邁向「工業級」的精密控制。這項高保真編輯能力將大幅降低專業內容創作的門檻,無論是電影分鏡腳本、電商廣告,還是社群媒體內容改造皆然。
相關文章
Meta 在使用者強烈反對後取消了 AI 照片編輯功能
Meta,這家社交媒體巨頭,再次捲入關於人工智慧與使用者隱私之間微妙平衡的公開辯論。據 TechCrunch 報道,Meta 的 Superintelligence Labs 本週早些時候推出了一款新的 AI 影象生成器 Muse Image。然而,一個備受好評的關鍵功能——允許使用者透過“@”符號標記來修改和生成來自公開 Instagram 賬戶的影象——由於缺乏適當的通知機制,立即引發了使用者以及 CAA 等機構的強烈反對。面對強烈的批評,Meta 迅速撤銷了該決定,並於週五透過部落格文章宣佈將
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
相關專題推薦
評論 (0)
0/500
阿里官方大模型團隊今日正式推出統一的圖像生成與編輯模型「Wan2.7-Image」。該模型在人像定制、色彩控制及長文本渲染方面,相較前代產品實現了質的飛躍,旨在克服人工智慧生成視覺內容中常見的「千篇一律」問題。
該模型現已透過阿里雲百聯平台的 API 開放使用,並於萬象網站開放公測。

核心強化功能:虛擬「面部雕塑」與精準色彩控制
Wan2.7-Image 導入多項業界領先且具差異化的功能,大幅拓展創作可能性:
為每位主角打造獨特面容:具備強化版的虛擬「面部雕塑」能力。使用者可透過文字提示精準控制骨骼結構、眼型(如杏眼或鳳眼)及其他面部細節,有效消除標準化的 AI 生成面孔。
精密色彩調色盤:新增進階色彩控制功能。使用者可從參考圖片中提取色彩比例,將特定色調(例如梵谷的鮮豔黃色或畢卡索的冷冽藍色)精準複製到新作中。
3K 字元超長文本渲染:解決常見的 AI 文本生成問題,支援多達 12 種語言。該模型能渲染橫跨整張 A4 紙的複雜文本、表格或公式,並具備可直接列印的品質。
在影像編輯領域,Wan2.7-Image 首度推出「互動式編輯」功能。使用者只需精準選取區域,即可進行新增、對齊、移動,甚至執行像素級的邏輯替換——例如將冰塊替換為水果,同時完美保留場景的原始光線。

此外,該模型支援生成最多 12 張連貫的圖像集,能在不同場景中維持風格與主題特徵的高一致性,非常適合團體合照或協調的產品組合。
Ali 解釋道,Wan2.7-Image 採用了生成與理解相結合的統一架構。透過在共享潛在空間內實現語義映射,該模型不僅超越了對像素圖案的猜測,更發展出對語義的真正底層理解。
隨著其即將於 2026 年視覺創作領域問世,Wan2.7-Image 預示著 AI 圖像生成領域的轉變:從「隨機抽卡」邁向「工業級」的精密控制。這項高保真編輯能力將大幅降低專業內容創作的門檻,無論是電影分鏡腳本、電商廣告,還是社群媒體內容改造皆然。
Meta 在使用者強烈反對後取消了 AI 照片編輯功能
Meta,這家社交媒體巨頭,再次捲入關於人工智慧與使用者隱私之間微妙平衡的公開辯論。據 TechCrunch 報道,Meta 的 Superintelligence Labs 本週早些時候推出了一款新的 AI 影象生成器 Muse Image。然而,一個備受好評的關鍵功能——允許使用者透過“@”符號標記來修改和生成來自公開 Instagram 賬戶的影象——由於缺乏適當的通知機制,立即引發了使用者以及 CAA 等機構的強烈反對。面對強烈的批評,Meta 迅速撤銷了該決定,並於週五透過部落格文章宣佈將
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了





首頁






