“攪拌:AI驅動的圖像混音和可視化工具”

今天,我們很高興介紹Whisk,我們在生成式AI領域的最新嘗試,僅在美國獨家推出。與傳統需要撰寫冗長文字提示以生成圖像的方法不同,Whisk簡化了流程,讓您可以使用圖像作為提示。只需將圖像拖放到工具中即可開始創作。
使用Whisk,您可以輸入三種不同的圖像:一張作為主體,一張作為場景,另一張作為風格。這讓您可以混合搭配這些元素,創造出完全獨特的東西,無論是數位玩偶、琺瑯徽章還是貼紙。重點在於重新混搭,打造屬於您的獨特作品。
Whisk - 奇幻魚 - 生成圖像範例
Whisk - 奇趣海象 - 生成圖像範例
Whisk - 糖霜甜甜圈加彩色糖粒 - 生成琺瑯徽章範例
Whisk - 帶角的奇幻貓 - 生成圖像範例
在幕後,Whisk利用Gemini模型的強大功能,自動為您的輸入圖像生成詳細描述。這些描述隨後被輸入到Google的尖端圖像生成模型Imagen 3中。這種方法專注於捕捉主體的本質,而不是創建精確的複製品,讓您以創新的方式重新混搭主體、場景和風格。
由於Whisk專注於從您的圖像中提取少數關鍵特徵,生成的創作可能不總是符合您的初始期望。例如,生成的主體可能在身高、體重、髮型或膚色上有所不同。我們認識到這些細節對您的項目可能至關重要,有時Whisk可能無法完全達到目標。因此,我們允許您隨時查看和調整底層提示。
在我們與藝術家和創意人士的初步測試中,Whisk被描述為一種新穎的創意工具,與傳統圖像編輯器截然不同。我們設計它以促進快速的視覺探索,而非精確的像素級編輯。重點在於激發新想法,讓您篩選眾多選項,直到找到與您共鳴的作品。
如果您在美國,今天即可在labs.google/whisk體驗Whisk,並與我們分享您的想法。
Google Labs是我們探索生成式AI最新技術的遊樂場,包括Gemini、Imagen和Veo等模型。我們的目標是收集這些新產品和功能的反饋,共同塑造技術的未來。透過訂閱我們的電子報並在X、Reddit和Discord上關注Google Labs,來跟進Whisk和其他令人興奮的實驗。
相關文章
華納音樂收購AI歸因初創公司Sureel AI
華納音樂集團(WMG)於週三確認,其正在收購Sureel AI,一家專注於人工智慧歸因的初創公司。Sureel的專有技術為音樂曲目生成“AI DNA”,將其分解為各個組成部分,以追蹤人工智慧模型如何利用這些元素。透過此次收購,WMG旨在增強其監控其藝術家和詞曲創作者的作品在人工智慧生成內容中被使用或用於訓練人工智慧模型的能力。“將Sureel整合到WMG中,增強了我們的保護、控制和變現能力,確保創意社羣保留對其智慧財產權、姓名、肖像、形象和聲音的控制權,”WMG執行長Robert Kync
亞馬遜推出“Alexa for Shopping”,同時將Rufus邊緣化
亞馬遜推出了“Alexa for Shopping”,將 Rufus 購物聊天機器人 Alexa+ 整合到應用程式、網站和 Echo Show 裝置中。該助手回答產品查詢、比較商品、跟蹤價格,並支援購物提醒。它還處理計劃中的購物操作和符合條件的自動購買。據該公司稱,“Alexa for Shopping”將 Rufus 的產品專業知識與 Alexa+ 的個性化助手上下文相結合。亞馬遜表示,Rufus 在 2025 年協助了超過 3 億客戶進行產品研究、比較和購買。GeekWire 報道稱,
微軟、Azure 與 AI 技術共同對抗加州野火風險
微軟投資於人工智慧驅動的野火偵測技術,其首席副總裁暨首席數據科學家胡安·拉維斯塔·費雷斯(Juan Lavista Ferres)針對減輕環境損害的策略進行了探討。根據美國國家航空暨太空總署(NASA)指出,氣候變遷影響地球上的每個人,其表現為氣溫上升、降雨模式改變以及海平面上升。NASA 指出,有確鑿證據顯示地球正以前所未有的速度變暖,而人類活動是主要驅動因素。隨著全球氣溫上升,野火構成的威脅日
相關專題推薦
評論 (26)
0/500
So you're telling me I can finally stop writing those novel-length prompts? 😂 This is a game-changer for visual thinkers like me. The US-only launch is a bummer though—hope it goes global soon! The image-as-prompt approach could really shake up how we prototype ideas.
Интересный подход — использовать изображения вместо текстовых подсказок! Это кажется гораздо более интуитивным способом для творчества. Но вот вопрос: как сервис справляется с авторскими правами на исходные картинки? Тема всегда скользкая в AI-индустрии. Хотелось бы попробовать, но пока только для США... Ждём расширения доступности 🌍
Parece interesante la idea de usar imágenes como prompts en lugar de texto, pero me preocupa cómo esto podría afectar los derechos de autor 😬. ¿Podrían las imágenes generadas terminar siendo usadas sin permiso de los creadores originales? La herramienta suena divertida, pero las implicaciones legales podrían ser complicadas.
Finde die Idee echt erfrischend! 🎨 Endlich muss man nicht mehr ellenlange Textbeschreibungen verfassen, um coole Bilder zu generieren. Aber frage mich, wie gut das mit komplexen Konzepten klappt – kann ein Bild wirklich so präzise sein wie ein detaillierter Prompt? Hoffe, das Tool kommt bald auch nach Europa!
Enfin un outil qui comprend qu'on est tous fatigués des prompts interminables ! 😅 Whisk a l'air super intuitif, mais est-ce que ça marche aussi bien avec des photos mal cadrées ? Vivement la version européenne !

今天,我們很高興介紹Whisk,我們在生成式AI領域的最新嘗試,僅在美國獨家推出。與傳統需要撰寫冗長文字提示以生成圖像的方法不同,Whisk簡化了流程,讓您可以使用圖像作為提示。只需將圖像拖放到工具中即可開始創作。
使用Whisk,您可以輸入三種不同的圖像:一張作為主體,一張作為場景,另一張作為風格。這讓您可以混合搭配這些元素,創造出完全獨特的東西,無論是數位玩偶、琺瑯徽章還是貼紙。重點在於重新混搭,打造屬於您的獨特作品。
Whisk - 奇趣海象 - 生成圖像範例
Whisk - 糖霜甜甜圈加彩色糖粒 - 生成琺瑯徽章範例
Whisk - 帶角的奇幻貓 - 生成圖像範例
在幕後,Whisk利用Gemini模型的強大功能,自動為您的輸入圖像生成詳細描述。這些描述隨後被輸入到Google的尖端圖像生成模型Imagen 3中。這種方法專注於捕捉主體的本質,而不是創建精確的複製品,讓您以創新的方式重新混搭主體、場景和風格。
在我們與藝術家和創意人士的初步測試中,Whisk被描述為一種新穎的創意工具,與傳統圖像編輯器截然不同。我們設計它以促進快速的視覺探索,而非精確的像素級編輯。重點在於激發新想法,讓您篩選眾多選項,直到找到與您共鳴的作品。
如果您在美國,今天即可在labs.google/whisk體驗Whisk,並與我們分享您的想法。
Google Labs是我們探索生成式AI最新技術的遊樂場,包括Gemini、Imagen和Veo等模型。我們的目標是收集這些新產品和功能的反饋,共同塑造技術的未來。透過訂閱我們的電子報並在X、Reddit和Discord上關注Google Labs,來跟進Whisk和其他令人興奮的實驗。
華納音樂收購AI歸因初創公司Sureel AI
華納音樂集團(WMG)於週三確認,其正在收購Sureel AI,一家專注於人工智慧歸因的初創公司。Sureel的專有技術為音樂曲目生成“AI DNA”,將其分解為各個組成部分,以追蹤人工智慧模型如何利用這些元素。透過此次收購,WMG旨在增強其監控其藝術家和詞曲創作者的作品在人工智慧生成內容中被使用或用於訓練人工智慧模型的能力。“將Sureel整合到WMG中,增強了我們的保護、控制和變現能力,確保創意社羣保留對其智慧財產權、姓名、肖像、形象和聲音的控制權,”WMG執行長Robert Kync
微軟、Azure 與 AI 技術共同對抗加州野火風險
微軟投資於人工智慧驅動的野火偵測技術,其首席副總裁暨首席數據科學家胡安·拉維斯塔·費雷斯(Juan Lavista Ferres)針對減輕環境損害的策略進行了探討。根據美國國家航空暨太空總署(NASA)指出,氣候變遷影響地球上的每個人,其表現為氣溫上升、降雨模式改變以及海平面上升。NASA 指出,有確鑿證據顯示地球正以前所未有的速度變暖,而人類活動是主要驅動因素。隨著全球氣溫上升,野火構成的威脅日
So you're telling me I can finally stop writing those novel-length prompts? 😂 This is a game-changer for visual thinkers like me. The US-only launch is a bummer though—hope it goes global soon! The image-as-prompt approach could really shake up how we prototype ideas.
Интересный подход — использовать изображения вместо текстовых подсказок! Это кажется гораздо более интуитивным способом для творчества. Но вот вопрос: как сервис справляется с авторскими правами на исходные картинки? Тема всегда скользкая в AI-индустрии. Хотелось бы попробовать, но пока только для США... Ждём расширения доступности 🌍
Parece interesante la idea de usar imágenes como prompts en lugar de texto, pero me preocupa cómo esto podría afectar los derechos de autor 😬. ¿Podrían las imágenes generadas terminar siendo usadas sin permiso de los creadores originales? La herramienta suena divertida, pero las implicaciones legales podrían ser complicadas.
Finde die Idee echt erfrischend! 🎨 Endlich muss man nicht mehr ellenlange Textbeschreibungen verfassen, um coole Bilder zu generieren. Aber frage mich, wie gut das mit komplexen Konzepten klappt – kann ein Bild wirklich so präzise sein wie ein detaillierter Prompt? Hoffe, das Tool kommt bald auch nach Europa!
Enfin un outil qui comprend qu'on est tous fatigués des prompts interminables ! 😅 Whisk a l'air super intuitif, mais est-ce que ça marche aussi bien avec des photos mal cadrées ? Vivement la version européenne !





首頁






