阿里巴巴的「萬2.7」AI 能生成客製化人臉並撰寫文章
今天,阿里巴巴正式推出其用於圖像生成與編輯的統一大型模型「Wan2.7-Image」。該模型不僅在視覺品質上實現了質的飛躍,更透過全面的能力升級,克服了傳統 AI 圖像生成所面臨的「千篇一律的面孔」及「提示語不匹配」等限制。
告別AI生成面孔:邁入「一人一臉」時代
Wan2.7-Image 大幅強化了虛擬角色自訂功能。使用者可從骨骼結構、眼型到細微的面部特徵進行全方位自訂,精準掌控橢圓臉、鳳眼或深邃眼窩等特定特徵。這項突破性進展擺脫了過往 AI 人像的機械式千篇一律,實現了真正的個人化表達。

「色彩調色盤」功能與「印刷級」文字渲染
在藝術表現方面,該模型現已支援「色盤」功能。使用者只需單擊一下,即可從參考圖片(例如馬蒂斯的紅色系列或梵谷的黃色系列)中提取色彩組合,並精準地應用於新創作中。 此外,Wan2.7-Image 在長文本渲染方面表現卓越,支援長達 3,000 個標記的輸入。它能穩定輸出包含複雜公式與表格的整頁 A4 內容,並在 12 種支援語言中均符合印刷級品質標準。

互動式編輯與多主題一致性
該模型具備強大的互動編輯能力,支援透過精準選取來對齊、移動或替換元素。例如,使用者可選取圖片中的字元來交換其位置,或將冰塊替換為水果,實現像素級的控制。同時,該模型支援多達 9 張圖片間的主體一致性,在生成 AI 女子團體或家具套組時,能維持統一的風格與特徵。

核心技術突破與產業應用
Wan2.7-Image 採用領先的生成與理解統一架構,在共享的潛在空間內實現語義映射。這意味著模型不再僅是猜測文字來匹配像素,而是具備基礎的語義理解能力。該模型與Wan2.7-Image-pro版本同步推出,後者提供更穩定的構圖與更精準的理解能力。

該模型目前已廣泛應用於短影片製作(一人分飾多角)、電商廣告(一張模特兒圖片多用途)、教育、研究及社交娛樂等領域。使用者可透過阿里雲白蓮平台 存取 API,或直接在萬象官網 體驗。
相關文章
Meta 在使用者強烈反對後取消了 AI 照片編輯功能
Meta,這家社交媒體巨頭,再次捲入關於人工智慧與使用者隱私之間微妙平衡的公開辯論。據 TechCrunch 報道,Meta 的 Superintelligence Labs 本週早些時候推出了一款新的 AI 影象生成器 Muse Image。然而,一個備受好評的關鍵功能——允許使用者透過“@”符號標記來修改和生成來自公開 Instagram 賬戶的影象——由於缺乏適當的通知機制,立即引發了使用者以及 CAA 等機構的強烈反對。面對強烈的批評,Meta 迅速撤銷了該決定,並於週五透過部落格文章宣佈將
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
相關專題推薦
評論 (0)
0/500
今天,阿里巴巴正式推出其用於圖像生成與編輯的統一大型模型「Wan2.7-Image」。該模型不僅在視覺品質上實現了質的飛躍,更透過全面的能力升級,克服了傳統 AI 圖像生成所面臨的「千篇一律的面孔」及「提示語不匹配」等限制。
告別AI生成面孔:邁入「一人一臉」時代
Wan2.7-Image 大幅強化了虛擬角色自訂功能。使用者可從骨骼結構、眼型到細微的面部特徵進行全方位自訂,精準掌控橢圓臉、鳳眼或深邃眼窩等特定特徵。這項突破性進展擺脫了過往 AI 人像的機械式千篇一律,實現了真正的個人化表達。

「色彩調色盤」功能與「印刷級」文字渲染
在藝術表現方面,該模型現已支援「色盤」功能。使用者只需單擊一下,即可從參考圖片(例如馬蒂斯的紅色系列或梵谷的黃色系列)中提取色彩組合,並精準地應用於新創作中。 此外,Wan2.7-Image 在長文本渲染方面表現卓越,支援長達 3,000 個標記的輸入。它能穩定輸出包含複雜公式與表格的整頁 A4 內容,並在 12 種支援語言中均符合印刷級品質標準。

互動式編輯與多主題一致性
該模型具備強大的互動編輯能力,支援透過精準選取來對齊、移動或替換元素。例如,使用者可選取圖片中的字元來交換其位置,或將冰塊替換為水果,實現像素級的控制。同時,該模型支援多達 9 張圖片間的主體一致性,在生成 AI 女子團體或家具套組時,能維持統一的風格與特徵。

核心技術突破與產業應用
Wan2.7-Image 採用領先的生成與理解統一架構,在共享的潛在空間內實現語義映射。這意味著模型不再僅是猜測文字來匹配像素,而是具備基礎的語義理解能力。該模型與Wan2.7-Image-pro版本同步推出,後者提供更穩定的構圖與更精準的理解能力。

該模型目前已廣泛應用於短影片製作(一人分飾多角)、電商廣告(一張模特兒圖片多用途)、教育、研究及社交娛樂等領域。使用者可透過
Meta 在使用者強烈反對後取消了 AI 照片編輯功能
Meta,這家社交媒體巨頭,再次捲入關於人工智慧與使用者隱私之間微妙平衡的公開辯論。據 TechCrunch 報道,Meta 的 Superintelligence Labs 本週早些時候推出了一款新的 AI 影象生成器 Muse Image。然而,一個備受好評的關鍵功能——允許使用者透過“@”符號標記來修改和生成來自公開 Instagram 賬戶的影象——由於缺乏適當的通知機制,立即引發了使用者以及 CAA 等機構的強烈反對。面對強烈的批評,Meta 迅速撤銷了該決定,並於週五透過部落格文章宣佈將
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。
Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額
儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了





首頁






