Gemini Nano Banana 加強企業影像編輯的一致性與控制規模 - 仍有改善空間
介紹 Gemini 2.5 Flash Image
Google 已推出 Gemini 2.5 Flash Image,之前在 beta 測試期間內部稱為「nanobanana」。這個先進的模式為企業提供更強大的創意靈活性,能以超越先前版本的精準控制能力快速轉換圖像。
該技術將以現有的 Gemini 2.5 Flash 框架為基礎,完全整合到 Gemini 應用程式生態系統中。此次更新大幅提升了平台的原生編輯功能,同時在修改後的圖像中保持一致的角色表達。舉例來說,使用者可以上傳寵物照片,並在不影響被攝物體可識別特徵的情況下,無縫調整背景或添加配件。
保持數位編輯的真實性
"Gemini 專家 David Sharon 和 Nicole Brichtova 解釋說:「我們了解編輯個人照片需要保持真實的肖像 - 近似值是不夠的。「我們的最新發展優先讓您所愛的人的外貌保持一致,無論他們是人類的家庭成員還是珍愛的寵物」。
此次更新直接解決了業界普遍存在的煩惱,即輕微的 AI 編輯請求會不慎扭曲重要的面部特徵或其他關鍵元素。

所有的輸出都將採用 Google 專屬的 SynthID 水印技術,免費與高階 Gemini 應用程式皆可使用。
社交媒體的熱烈討論
當科技愛好者在 LM Arena 測試中發現神秘的「nanobanana」模型在複雜的影像處理任務上表現優異時,各平台上的期待迅速升溫。風險投資家 Justine Moore 強調它能精準處理複雜的多步指令。
"Nano-banana "可讓您上傳兩張圖片,並提示將其合併。它能遵循複雜的多步指令,精確度令人印象深刻"。
當多位早期測試者證實與 Google 有聯繫時,這款機型的來歷就變得更清楚了,不過官方仍未正式證實。社交媒體上的範例展示了從專業肖像修改到環境轉換等各種功能。
產業競爭白熱化
這次推出的功能強化了與 Qwen-Image Edit 和 OpenAI 的 ChatGPT 圖像編輯 API 等競爭對手的競爭。傳統創意軟體大廠 Adobe 繼續將 Firefly 模型整合至 Photoshop 及其他創意套件。
進化的編輯功能
自 3 月推出原生影像編輯功能以來,Gemini 已擴充功能以協助企業簡化工作流程。該平台現在無需切換應用程式即可進行全面編輯 - 使用者可在單一介面上傳、修改,甚至將編輯好的影像編輯成視訊簡報。
除基本修改外,Gemini 2.5 Flash Image 還支援以下複雜技術:
- 無縫圖片混合
- 多步迭代編輯
- 影像間的風格轉換
- 上下文環境修改
相關文章
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍
Google 正以戰略性姿態重返智慧眼鏡市場。在週二舉行的 Google I/O 大會上,這家科技巨頭宣布與 Warby Parker 及 Gentle Monster 合作,推出全新系列搭載人工智慧的眼鏡產品。這些裝置由 Google 與三星共同設計,經過優化可與 Android 及 iOS 平台無縫整合,預計將於今年稍晚上市。Google 將這些裝置稱為「音訊眼鏡」,讓使用者能透過語音指令進行
相關專題推薦
評論 (1)
0/500
介紹 Gemini 2.5 Flash Image
Google 已推出 Gemini 2.5 Flash Image,之前在 beta 測試期間內部稱為「nanobanana」。這個先進的模式為企業提供更強大的創意靈活性,能以超越先前版本的精準控制能力快速轉換圖像。
該技術將以現有的 Gemini 2.5 Flash 框架為基礎,完全整合到 Gemini 應用程式生態系統中。此次更新大幅提升了平台的原生編輯功能,同時在修改後的圖像中保持一致的角色表達。舉例來說,使用者可以上傳寵物照片,並在不影響被攝物體可識別特徵的情況下,無縫調整背景或添加配件。
保持數位編輯的真實性
"Gemini 專家 David Sharon 和 Nicole Brichtova 解釋說:「我們了解編輯個人照片需要保持真實的肖像 - 近似值是不夠的。「我們的最新發展優先讓您所愛的人的外貌保持一致,無論他們是人類的家庭成員還是珍愛的寵物」。
此次更新直接解決了業界普遍存在的煩惱,即輕微的 AI 編輯請求會不慎扭曲重要的面部特徵或其他關鍵元素。

所有的輸出都將採用 Google 專屬的 SynthID 水印技術,免費與高階 Gemini 應用程式皆可使用。
社交媒體的熱烈討論
當科技愛好者在 LM Arena 測試中發現神秘的「nanobanana」模型在複雜的影像處理任務上表現優異時,各平台上的期待迅速升溫。風險投資家 Justine Moore 強調它能精準處理複雜的多步指令。
"Nano-banana "可讓您上傳兩張圖片,並提示將其合併。它能遵循複雜的多步指令,精確度令人印象深刻"。
當多位早期測試者證實與 Google 有聯繫時,這款機型的來歷就變得更清楚了,不過官方仍未正式證實。社交媒體上的範例展示了從專業肖像修改到環境轉換等各種功能。
產業競爭白熱化
這次推出的功能強化了與 Qwen-Image Edit 和 OpenAI 的 ChatGPT 圖像編輯 API 等競爭對手的競爭。傳統創意軟體大廠 Adobe 繼續將 Firefly 模型整合至 Photoshop 及其他創意套件。
進化的編輯功能
自 3 月推出原生影像編輯功能以來,Gemini 已擴充功能以協助企業簡化工作流程。該平台現在無需切換應用程式即可進行全面編輯 - 使用者可在單一介面上傳、修改,甚至將編輯好的影像編輯成視訊簡報。
除基本修改外,Gemini 2.5 Flash Image 還支援以下複雜技術:
- 無縫圖片混合
- 多步迭代編輯
- 影像間的風格轉換
- 上下文環境修改
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍
Google 正以戰略性姿態重返智慧眼鏡市場。在週二舉行的 Google I/O 大會上,這家科技巨頭宣布與 Warby Parker 及 Gentle Monster 合作,推出全新系列搭載人工智慧的眼鏡產品。這些裝置由 Google 與三星共同設計,經過優化可與 Android 及 iOS 平台無縫整合,預計將於今年稍晚上市。Google 將這些裝置稱為「音訊眼鏡」,讓使用者能透過語音指令進行





首頁






