Google Cloud 增強 AI 媒體工具,新增音樂與視頻功能

週三,Google 發佈了其 Vertex AI 雲平台的升級,增強了多個專有媒體生成 AI 模型。
Lyria,Google 的文本轉音樂 AI,現已對部分用戶開放預覽,而 Veo 2 視頻模型則新增了進階編輯和視覺效果選項。此外,Google 推出了由其音頻處理模型 Chirp 3 驅動的語音克隆功能,供經批准的用戶使用。據 Google 表示,Imagen 3 圖像生成器的性能現已顯著提升。
這些更新在 Cloud Next 活動中宣佈,增強了 Google 在企業生成式 AI 市場的領先地位,與 Amazon 的 Bedrock 平台展開激烈競爭,後者提供相似的 AI 工具。
Google 將 Lyria 推廣為免版稅音樂庫的替代品,使用戶能夠生成從爵士鋼琴獨奏到 lo-fi 節拍等多樣風格的歌曲。
Chirp 3 支援約 35 種語言的語音合成。今年早些時候首次預覽,它驅動了即時自訂語音功能,僅需 10 秒音頻即可複製語音,現已廣泛可用。Chirp 3 還支援新的預覽工具「語音分割轉錄」,可在多人錄音中區分並標記不同講者。
為防止濫用,Google 表示,即時自訂語音功能需經過驗證流程,以確保語音使用許可的合法性。
Veo 2 現允許用戶移除視頻中的背景、標誌或物體,並延伸視頻畫面,例如將橫向畫面轉換為縱向。它還支援調整 AI 生成場景的攝影機角度和節奏,創造出如延時攝影或無人機風格的拍攝效果,並能在指定的起始和結束畫面之間進行插值。
這些 Veo 2 功能目前處於預覽階段。
Google 指出,Imagen 3 的增強功能提升了其移除物體及修復圖像缺失或損壞區域的能力。
所有由 Imagen、Veo 和 Lyria(但不包括 Chirp)生成的媒體均帶有 Google 的 SynthID 水印。Google 強調,其生成式 AI 模型包含防護措施,以防止創建有害內容。
Google 未透露其模型的訓練數據,這是一個因知識產權問題而經常引發爭議的話題。一些公司未經許可使用受版權保護的材料進行 AI 訓練,聲稱受美國公平使用保護,但創作者常在法庭上對此提出質疑。
Google 此前曾向 TechCrunch 表示,它提供模型訓練的退出選項,以及一項保障政策,以保護 Google Cloud 和 Vertex AI 用戶免受與 AI 相關的版權索賠。
相關文章
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍
Google 正以戰略性姿態重返智慧眼鏡市場。在週二舉行的 Google I/O 大會上,這家科技巨頭宣布與 Warby Parker 及 Gentle Monster 合作,推出全新系列搭載人工智慧的眼鏡產品。這些裝置由 Google 與三星共同設計,經過優化可與 Android 及 iOS 平台無縫整合,預計將於今年稍晚上市。Google 將這些裝置稱為「音訊眼鏡」,讓使用者能透過語音指令進行
相關專題推薦
評論 (6)
0/500
Ces outils de génération musicale et vidéo par IA sont fascinants, mais je m'inquiète un peu de l'impact potentiel sur les artistes... Les capacités de Lyria semblent impressionnantes, j'espère qu'il ne s'agira pas juste d'une autre technologie réservée à une élite. 🎵
Wow, Google's Vertex AI upgrades sound wild! Text-to-music with Lyria? I’m curious if it can whip up a catchy tune for my next TikTok. But, man, I hope they’re careful with copyright issues on this stuff. 😎
Wow, Google's Vertex AI upgrades sound like a game-changer for creators! Text-to-music with Lyria? That's like giving my playlists a sci-fi twist. Can't wait to see how this shakes up the content game! 🎶
Lyria sounds like a game-changer for music creation! 🎵 I’m curious if it can nail niche genres like lo-fi jazz. Google’s pushing hard against Amazon’s Bedrock, but I wonder how user-friendly this is for non-techies.
Google's new AI music and video tools sound like a game-changer! I'm stoked to see how Lyria creates tunes from just text prompts. Wonder if it can nail my favorite lo-fi vibes? 😎

週三,Google 發佈了其 Vertex AI 雲平台的升級,增強了多個專有媒體生成 AI 模型。
Lyria,Google 的文本轉音樂 AI,現已對部分用戶開放預覽,而 Veo 2 視頻模型則新增了進階編輯和視覺效果選項。此外,Google 推出了由其音頻處理模型 Chirp 3 驅動的語音克隆功能,供經批准的用戶使用。據 Google 表示,Imagen 3 圖像生成器的性能現已顯著提升。
這些更新在 Cloud Next 活動中宣佈,增強了 Google 在企業生成式 AI 市場的領先地位,與 Amazon 的 Bedrock 平台展開激烈競爭,後者提供相似的 AI 工具。
Google 將 Lyria 推廣為免版稅音樂庫的替代品,使用戶能夠生成從爵士鋼琴獨奏到 lo-fi 節拍等多樣風格的歌曲。
Chirp 3 支援約 35 種語言的語音合成。今年早些時候首次預覽,它驅動了即時自訂語音功能,僅需 10 秒音頻即可複製語音,現已廣泛可用。Chirp 3 還支援新的預覽工具「語音分割轉錄」,可在多人錄音中區分並標記不同講者。
為防止濫用,Google 表示,即時自訂語音功能需經過驗證流程,以確保語音使用許可的合法性。
Veo 2 現允許用戶移除視頻中的背景、標誌或物體,並延伸視頻畫面,例如將橫向畫面轉換為縱向。它還支援調整 AI 生成場景的攝影機角度和節奏,創造出如延時攝影或無人機風格的拍攝效果,並能在指定的起始和結束畫面之間進行插值。
這些 Veo 2 功能目前處於預覽階段。
Google 指出,Imagen 3 的增強功能提升了其移除物體及修復圖像缺失或損壞區域的能力。
所有由 Imagen、Veo 和 Lyria(但不包括 Chirp)生成的媒體均帶有 Google 的 SynthID 水印。Google 強調,其生成式 AI 模型包含防護措施,以防止創建有害內容。
Google 未透露其模型的訓練數據,這是一個因知識產權問題而經常引發爭議的話題。一些公司未經許可使用受版權保護的材料進行 AI 訓練,聲稱受美國公平使用保護,但創作者常在法庭上對此提出質疑。
Google 此前曾向 TechCrunch 表示,它提供模型訓練的退出選項,以及一項保障政策,以保護 Google Cloud 和 Vertex AI 用戶免受與 AI 相關的版權索賠。
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙
Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
Google 在 2026 年 IO 大會上首度推出以音訊為核心的智慧眼鏡,此舉與 Meta 的策略如出一轍
Google 正以戰略性姿態重返智慧眼鏡市場。在週二舉行的 Google I/O 大會上,這家科技巨頭宣布與 Warby Parker 及 Gentle Monster 合作,推出全新系列搭載人工智慧的眼鏡產品。這些裝置由 Google 與三星共同設計,經過優化可與 Android 及 iOS 平台無縫整合,預計將於今年稍晚上市。Google 將這些裝置稱為「音訊眼鏡」,讓使用者能透過語音指令進行
Ces outils de génération musicale et vidéo par IA sont fascinants, mais je m'inquiète un peu de l'impact potentiel sur les artistes... Les capacités de Lyria semblent impressionnantes, j'espère qu'il ne s'agira pas juste d'une autre technologie réservée à une élite. 🎵
Wow, Google's Vertex AI upgrades sound wild! Text-to-music with Lyria? I’m curious if it can whip up a catchy tune for my next TikTok. But, man, I hope they’re careful with copyright issues on this stuff. 😎
Wow, Google's Vertex AI upgrades sound like a game-changer for creators! Text-to-music with Lyria? That's like giving my playlists a sci-fi twist. Can't wait to see how this shakes up the content game! 🎶
Lyria sounds like a game-changer for music creation! 🎵 I’m curious if it can nail niche genres like lo-fi jazz. Google’s pushing hard against Amazon’s Bedrock, but I wonder how user-friendly this is for non-techies.
Google's new AI music and video tools sound like a game-changer! I'm stoked to see how Lyria creates tunes from just text prompts. Wonder if it can nail my favorite lo-fi vibes? 😎





首頁






