Google I/O 2025 展示創作媒體的實際應用

在 I/O 2025 上,我們透過簡報和實際應用來展示生成式人工智能的能力。我們推出了令人振奮的最新視訊和影像產生模型-Veo 3 和 Imagen 4,並擴大了 Lyria 2 的使用範圍。我們還介紹了Flow,這是一款人工智能電影製作工具,可使用我們最先進的生成模型,無縫創作電影剪輯、場景和連貫敘述。
我們也將這些工具整合到旗艦年度活動中:I/O 主題演講中有 219 張幻燈片是由 AI 製作,48% 的主題演講視覺效果是使用 Imagen 製作,而 80% 的影片則以某種形式結合了 Veo 或 Imagen。以下將深入介紹我們如何運用自己的 AI 工具,包括我們的提示撰寫流程,將 I/O 2025 變得栩栩如生:
Veo 2:設計有風格的演講者標題卡
當我們的副總裁兼搜尋部主管 Elizabeth Reid 上台分享主要的搜尋更新時,螢幕上播放了一段短片,顯示 Liz 張開她的手,露出一隻精巧的橘色摺紙鶴,這隻鶴在她的手掌上方旋轉懸浮。
我們使用 AI Studio 和 Vertex AI Studio(由 Veo 2 驅動)的圖像轉視訊功能來製作這段影片和其他演講者介紹影片。我們收集了講者的頭像,以及他們的興趣和嗜好的詳細資料,並將其納入提示中。這是我們為研究科學家 Jason Baldridge 製作的標題卡提示:
這是 Veo 2 的原始輸出,以簡單的動畫增強,以及觀眾在台上看到的情況:
Imagen 4 與 Veo 3:製作電影的故事板
I/O 展映的數部電影在製作過程中都使用了 AI 工具。開場影片帶領觀眾穿越一個西部主題的小鎮,展開一段驚心動魄的旅程,之後畫面上方顯示拼有「Welcome to I/O」字樣的彩色氣球,為主題演講揭開序幕。
製作團隊採用了各種 AI 工具來製作這部影片。他們首先使用 Imagen 4 來產生影片提示的影像。他們也與 Google DeepMind 團隊合作,使用 Gemini 來精煉提示語,幫助他們找到正確的語言,達到預期的效果。這是用於第一場景的提示:
這是他們產生的結果:
接下來,團隊將這張圖片納入 Veo 3 的提示中,其中包括以下指示:
準備好圖片和精煉的提示後,他們開始使用我們最新的 Veo 3 技術製作影片(可透過 Google AI Ultra 計劃使用!)。他們也使用 Veo 3 進行即時調整 - 在檢視輸出時加入俯拍、更廣的角度以及不同的視覺效果。傳統電影製作經常需要重拍場景,而 Veo 3 則不一樣,團隊可以更快地進行迭代。不需要編碼:部分團隊成員使用 Colab 功能進行編碼剪輯,其他許多成員則依賴文字到影片的提示,以自然語言描述剪輯和要求。
以下是用來創作電影最後一幕的提示:
Lyria RealTime:與 Toro y Moi 即時演奏
在 I/O 預展期間,藝術家 Toro y Moi 在現場音樂佈景中使用 Lyria RealTime 來展示模型的最新功能。Lyria RealTime 是我們的互動式音樂產生模型,可讓您即時製作、控制和表演產生式音樂。您可以混合和變換樂器、聲音、流派等。「這將會是一場表演和實驗,」他在開始前解釋道。「我所演奏的一切都完全是即興創作--我在和電腦即興演奏,電腦也在和我即興演奏」。
在表演前的幾個星期,團隊提供 Toro y Moi 一台 Lyria RealTime 原型,讓他可以測試並改良他的提示。這有助於他在表演中發展出創意概念和提示。他創造了 16 種聲音提示,包括「混亂的康加舞者」和「音高偏移的英國叢林鼓」,並將它們指定給實體 MIDI 控制器上的旋鈕。
透過 MIDI 控制器在本機執行 Lyria RealTime,讓 Toro y Moi 可以在舞台上使用這個模型,並讓觀眾即時看到介面的運作。
表演期間,在 Toro y Moi 身後展示了一個以 Lyria RealTime API 建立並在 MIDI 控制器上執行的應用程式。觀眾可以看到應用程式中創建和控制連續音樂流的選項,以及他在鍵盤和人聲潤飾分層時所使用的提示。
您可以使用 AI Studio 中的 Lyria RealTime API 親自嘗試。
AI Studio:創造 AI 產生的 Swag
我們在 Google AI Studio (我們用來快速測試模型和實驗提示的免費介面) 中使用了幾個 Gemini 模型,設計出今年的 I/O 襯衫,上面有全新的客製化標誌。正如襯衫的標籤所描述的,創意提示是「Google I/O 標誌融化在地上、彩虹色、插圖、攝影棚燈光」。以下是我們的創作過程:
首先,團隊在 AI Studio 中選擇了 Gemini 2.5 Pro,並透過詳細的系統指令提示定義了他們的目標。
設定這些指引後,他們輸入先前提到的創意提示。Gemini 2.5 Pro 隨即會針對所需的影像輸出,產生一份需求與風格構思的清單。例如"核心形狀:三種原始圖形(整體矩形、細斜線/矩形和圓柱形)的基本幾何形狀必須仍然清晰可辨且視覺上與眾不同,即使在它們的側面使用了融化效果。不要扭曲核心結構,使其超出融化塗料的效果"。
團隊拿到這些書面指示後,便改用我們的主力機型 Gemini 2.0 Flash 與圖像產生功能,根據產生的清單製作各種圖像選項。
經過廣泛的實驗後,他們選出了幾個最後的設計 - 包括這個。
值得注意的是,團隊也嘗試繞過 Gemini 2.5 Pro 的初始提示重寫,直接在 AI Studio 中使用 Gemini 2.0 Flash。儘管他們接近了想要的結果,但使用 2.5 Pro 重寫一直能提供更好的結果與更多的創意細節。結果如何?一些非常酷的 T 恤!
準備好回顧了嗎?在此瞭解 I/O 2025 最重要的公告,並使用我們的 I/O 問答測試您的知識。
相關文章
華納音樂收購AI歸因初創公司Sureel AI
華納音樂集團(WMG)於週三確認,其正在收購Sureel AI,一家專注於人工智慧歸因的初創公司。Sureel的專有技術為音樂曲目生成“AI DNA”,將其分解為各個組成部分,以追蹤人工智慧模型如何利用這些元素。透過此次收購,WMG旨在增強其監控其藝術家和詞曲創作者的作品在人工智慧生成內容中被使用或用於訓練人工智慧模型的能力。“將Sureel整合到WMG中,增強了我們的保護、控制和變現能力,確保創意社羣保留對其智慧財產權、姓名、肖像、形象和聲音的控制權,”WMG執行長Robert Kync
亞馬遜推出“Alexa for Shopping”,同時將Rufus邊緣化
亞馬遜推出了“Alexa for Shopping”,將 Rufus 購物聊天機器人 Alexa+ 整合到應用程式、網站和 Echo Show 裝置中。該助手回答產品查詢、比較商品、跟蹤價格,並支援購物提醒。它還處理計劃中的購物操作和符合條件的自動購買。據該公司稱,“Alexa for Shopping”將 Rufus 的產品專業知識與 Alexa+ 的個性化助手上下文相結合。亞馬遜表示,Rufus 在 2025 年協助了超過 3 億客戶進行產品研究、比較和購買。GeekWire 報道稱,
微軟、Azure 與 AI 技術共同對抗加州野火風險
微軟投資於人工智慧驅動的野火偵測技術,其首席副總裁暨首席數據科學家胡安·拉維斯塔·費雷斯(Juan Lavista Ferres)針對減輕環境損害的策略進行了探討。根據美國國家航空暨太空總署(NASA)指出,氣候變遷影響地球上的每個人,其表現為氣溫上升、降雨模式改變以及海平面上升。NASA 指出,有確鑿證據顯示地球正以前所未有的速度變暖,而人類活動是主要驅動因素。隨著全球氣溫上升,野火構成的威脅日
相關專題推薦
評論 (1)
0/500
Veo 3 et Imagen 4 semblent impressionnants, mais j'espère que ces avancées en IA générative ne se contentent pas de faire des jolies images. Qu'en est-il de l'impact environnemental de l'entraînement de ces modèles? Les présentations sont cool, mais je veux aussi voir une vraie réflexion éthique derrière. 😅

在 I/O 2025 上,我們透過簡報和實際應用來展示生成式人工智能的能力。我們推出了令人振奮的最新視訊和影像產生模型-Veo 3 和 Imagen 4,並擴大了 Lyria 2 的使用範圍。我們還介紹了Flow,這是一款人工智能電影製作工具,可使用我們最先進的生成模型,無縫創作電影剪輯、場景和連貫敘述。
我們也將這些工具整合到旗艦年度活動中:I/O 主題演講中有 219 張幻燈片是由 AI 製作,48% 的主題演講視覺效果是使用 Imagen 製作,而 80% 的影片則以某種形式結合了 Veo 或 Imagen。以下將深入介紹我們如何運用自己的 AI 工具,包括我們的提示撰寫流程,將 I/O 2025 變得栩栩如生:
Veo 2:設計有風格的演講者標題卡
當我們的副總裁兼搜尋部主管 Elizabeth Reid 上台分享主要的搜尋更新時,螢幕上播放了一段短片,顯示 Liz 張開她的手,露出一隻精巧的橘色摺紙鶴,這隻鶴在她的手掌上方旋轉懸浮。
我們使用 AI Studio 和 Vertex AI Studio(由 Veo 2 驅動)的圖像轉視訊功能來製作這段影片和其他演講者介紹影片。我們收集了講者的頭像,以及他們的興趣和嗜好的詳細資料,並將其納入提示中。這是我們為研究科學家 Jason Baldridge 製作的標題卡提示:
這是 Veo 2 的原始輸出,以簡單的動畫增強,以及觀眾在台上看到的情況:
Imagen 4 與 Veo 3:製作電影的故事板
I/O 展映的數部電影在製作過程中都使用了 AI 工具。開場影片帶領觀眾穿越一個西部主題的小鎮,展開一段驚心動魄的旅程,之後畫面上方顯示拼有「Welcome to I/O」字樣的彩色氣球,為主題演講揭開序幕。
製作團隊採用了各種 AI 工具來製作這部影片。他們首先使用 Imagen 4 來產生影片提示的影像。他們也與 Google DeepMind 團隊合作,使用 Gemini 來精煉提示語,幫助他們找到正確的語言,達到預期的效果。這是用於第一場景的提示:
這是他們產生的結果:
接下來,團隊將這張圖片納入 Veo 3 的提示中,其中包括以下指示:
準備好圖片和精煉的提示後,他們開始使用我們最新的 Veo 3 技術製作影片(可透過 Google AI Ultra 計劃使用!)。他們也使用 Veo 3 進行即時調整 - 在檢視輸出時加入俯拍、更廣的角度以及不同的視覺效果。傳統電影製作經常需要重拍場景,而 Veo 3 則不一樣,團隊可以更快地進行迭代。不需要編碼:部分團隊成員使用 Colab 功能進行編碼剪輯,其他許多成員則依賴文字到影片的提示,以自然語言描述剪輯和要求。
以下是用來創作電影最後一幕的提示:
Lyria RealTime:與 Toro y Moi 即時演奏
在 I/O 預展期間,藝術家 Toro y Moi 在現場音樂佈景中使用 Lyria RealTime 來展示模型的最新功能。Lyria RealTime 是我們的互動式音樂產生模型,可讓您即時製作、控制和表演產生式音樂。您可以混合和變換樂器、聲音、流派等。「這將會是一場表演和實驗,」他在開始前解釋道。「我所演奏的一切都完全是即興創作--我在和電腦即興演奏,電腦也在和我即興演奏」。
在表演前的幾個星期,團隊提供 Toro y Moi 一台 Lyria RealTime 原型,讓他可以測試並改良他的提示。這有助於他在表演中發展出創意概念和提示。他創造了 16 種聲音提示,包括「混亂的康加舞者」和「音高偏移的英國叢林鼓」,並將它們指定給實體 MIDI 控制器上的旋鈕。
透過 MIDI 控制器在本機執行 Lyria RealTime,讓 Toro y Moi 可以在舞台上使用這個模型,並讓觀眾即時看到介面的運作。
表演期間,在 Toro y Moi 身後展示了一個以 Lyria RealTime API 建立並在 MIDI 控制器上執行的應用程式。觀眾可以看到應用程式中創建和控制連續音樂流的選項,以及他在鍵盤和人聲潤飾分層時所使用的提示。
您可以使用 AI Studio 中的 Lyria RealTime API 親自嘗試。
AI Studio:創造 AI 產生的 Swag
我們在 Google AI Studio (我們用來快速測試模型和實驗提示的免費介面) 中使用了幾個 Gemini 模型,設計出今年的 I/O 襯衫,上面有全新的客製化標誌。正如襯衫的標籤所描述的,創意提示是「Google I/O 標誌融化在地上、彩虹色、插圖、攝影棚燈光」。以下是我們的創作過程:
首先,團隊在 AI Studio 中選擇了 Gemini 2.5 Pro,並透過詳細的系統指令提示定義了他們的目標。
設定這些指引後,他們輸入先前提到的創意提示。Gemini 2.5 Pro 隨即會針對所需的影像輸出,產生一份需求與風格構思的清單。例如"核心形狀:三種原始圖形(整體矩形、細斜線/矩形和圓柱形)的基本幾何形狀必須仍然清晰可辨且視覺上與眾不同,即使在它們的側面使用了融化效果。不要扭曲核心結構,使其超出融化塗料的效果"。
團隊拿到這些書面指示後,便改用我們的主力機型 Gemini 2.0 Flash 與圖像產生功能,根據產生的清單製作各種圖像選項。
經過廣泛的實驗後,他們選出了幾個最後的設計 - 包括這個。
值得注意的是,團隊也嘗試繞過 Gemini 2.5 Pro 的初始提示重寫,直接在 AI Studio 中使用 Gemini 2.0 Flash。儘管他們接近了想要的結果,但使用 2.5 Pro 重寫一直能提供更好的結果與更多的創意細節。結果如何?一些非常酷的 T 恤!
準備好回顧了嗎?在此瞭解 I/O 2025 最重要的公告,並使用我們的 I/O 問答測試您的知識。
華納音樂收購AI歸因初創公司Sureel AI
華納音樂集團(WMG)於週三確認,其正在收購Sureel AI,一家專注於人工智慧歸因的初創公司。Sureel的專有技術為音樂曲目生成“AI DNA”,將其分解為各個組成部分,以追蹤人工智慧模型如何利用這些元素。透過此次收購,WMG旨在增強其監控其藝術家和詞曲創作者的作品在人工智慧生成內容中被使用或用於訓練人工智慧模型的能力。“將Sureel整合到WMG中,增強了我們的保護、控制和變現能力,確保創意社羣保留對其智慧財產權、姓名、肖像、形象和聲音的控制權,”WMG執行長Robert Kync
微軟、Azure 與 AI 技術共同對抗加州野火風險
微軟投資於人工智慧驅動的野火偵測技術,其首席副總裁暨首席數據科學家胡安·拉維斯塔·費雷斯(Juan Lavista Ferres)針對減輕環境損害的策略進行了探討。根據美國國家航空暨太空總署(NASA)指出,氣候變遷影響地球上的每個人,其表現為氣溫上升、降雨模式改變以及海平面上升。NASA 指出,有確鑿證據顯示地球正以前所未有的速度變暖,而人類活動是主要驅動因素。隨著全球氣溫上升,野火構成的威脅日
Veo 3 et Imagen 4 semblent impressionnants, mais j'espère que ces avancées en IA générative ne se contentent pas de faire des jolies images. Qu'en est-il de l'impact environnemental de l'entraînement de ces modèles? Les présentations sont cool, mais je veux aussi voir une vraie réflexion éthique derrière. 😅





首頁






