“創作者的新生成媒體工具揭曉”
過去一年,我們在改進生成媒體技術方面取得了顯著進展。我們專注於與創意社群合作,了解生成AI如何在每個階段增強創意過程。我們很高興介紹Veo,這是我們迄今最先進的視頻生成模型,以及Imagen 3,我們目前最高質量的文字到圖像模型。
我們也非常興奮地分享我們近期的一些合作夥伴關係,包括與電影製作人Donald Glover及其創意工作室Gilga的合作,以及來自藝術家Wyclef Jean、Marc Rebillet和詞曲創作者Justin Tranter的新演示錄音,這些都是在我們的Music AI Sandbox的協助下創建的。
Veo:我們最強大的視頻生成模型
Veo設計用於生成1080p分辨率的高質量視頻,適應多種電影和視覺風格,可延長至一分鐘以上。憑藉其對自然語言和視覺語義的高級理解,Veo能生成與用戶創意願景高度契合的視頻,精確捕捉較長提示中指定的語氣和細節。
此模型提供前所未有的創意控制,能理解電影術語,如「延時攝影」或「風景航拍」。Veo確保影片畫面保持一致性和連貫性,人物、動物和物體的運動在整個鏡頭中顯得逼真。
[ttpp]展示Veo高質量視頻生成能力的範例。所有視頻均由Veo生成,未經修改。[yyxx]
為了更好地了解Veo如何增強故事講述過程,我們邀請了多元化的電影製作人和創作者來試驗此模型。這些合作不僅幫助我們完善技術,還確保創作者在技術發展中擁有發言權。
以下是我們與電影製作人Donald Glover及其創意工作室Gilga合作的預覽,他們一直在為一個電影項目試驗Veo。
[ttpp]Veo建立在我們多年生成視頻模型工作的基礎上,包括Generative Query Network (GQN)、DVD-GAN、Imagen-Video、Phenaki、WALT、VideoPoet和Lumiere——結合架構、縮放法則和其他新技術,以提高質量和輸出分辨率。[yyxx]
通過Veo,我們改進了理解視頻內容、渲染高清晰度圖像和模擬現實世界物理的技術。這些進展將推動我們AI研究的進一步進展,幫助我們開發更實用的產品,提升人們互動和溝通的方式。
從今天開始,Veo在VideoFX上向部分創作者提供私人預覽。你可以加入我們的等待名單試用。未來,我們還將把Veo的一些功能整合到YouTube Shorts和其他產品中。
了解更多關於Veo功能的信息。
Imagen 3:我們最高質量的文字到圖像模型
過去一年,我們的圖像生成模型和工具在質量和逼真度方面取得了顯著改進。
Imagen 3是我們最高質量的文字到圖像模型,能生成極其細膩、逼真且栩栩如生的圖像,與我們之前的模型相比,視覺瑕疵大大減少。
[ttpp]提示:一隻光滑的狼在灰色背景前威嚴地棲息,特寫鏡頭,高分辨率照片,細節精緻,單色背景,採用超現實風格的色彩分級。
提示:水母在清澈的水中脈動的特寫,觸手飄動,背景為充滿活力的珊瑚礁,微距攝影,庫存照片,高分辨率,細節豐富,柔和光線,專業色彩分級,淺景深,銳利焦點,使用DSLR相機拍攝,採用專業攝影師風格。
提示:從上方俯瞰美麗的河谷峽谷,樹木環繞,展現其壯麗的自然美景,綠色山脈與藍色水域。照片捕捉了大自然創造的廣闊,以其創造風格呈現。
提示:使用DSLR相機搭配偏光濾鏡拍攝。土耳其卡帕多奇亞獨特岩石地貌上空漂浮的兩個熱氣球照片。氣球上的顏色和圖案與下方大地色調的景觀形成美麗對比。此照片捕捉了體驗這種冒險的感覺。
提示:一雙沾滿泥巴、破舊的登山靴,停放在岩石小徑上。一隻松鼠的頭從一隻靴子中探出,懶散地望向相機,宛如鞋中之王。兩隻靴子的鞋帶鬆散地垂落在地。背景是山地景觀。電影風格劇照,高質量DSLR照片。
提示:三位女性站在一起大笑,其中一位女性在前景略為失焦。太陽在女性身後西下,產生鏡頭光暈和溫暖光芒,突顯她們的頭髮並在背景中創造出散景效果。攝影風格為自然抓拍,捕捉朋友間真摯的連結與快樂時刻。金色時段的溫暖光線為圖像增添懷舊與親密的感覺。[yyxx]
Imagen 3更擅長理解自然語言,能理解提示背後的意圖,並融入較長提示中的細微細節。其先進的理解能力使其能掌握多種風格。
[ttpp]提示:一位短髮蓄鬍的男子對著相機微笑的照片。背景模糊,顯示淺色樹木和建築。
提示:一個人手持一隻小鳥黏土雕像,另一手用造型工具雕刻的視角。可以看到雕塑家的圍巾。他們的手覆滿黏土粉塵。微距DSLR圖像,突出質感和工藝。
提示:抽象素描:以表現力線條和能量模糊捕捉舞者在炭筆素描中的動態運動。素描於老舊羊皮紙上。
提示:大象毛編玩偶在稀樹草原上行走,專業攝影,背景模糊。
提示:穿著白裙的女孩站在無邊湖畔,手持鮮花,仰望滿是粉紅雲彩的天空。水面反射天空,營造出美麗的動漫場景。她周圍有覆蓋野花的小山丘,增添美感。動漫風格背景,紫藍色調,柔和光線,溫暖色彩,夢幻氛圍,浪漫情感。
提示:一具佈滿開花藤蔓的風化木製機械人,平靜地站在高大野花田中,一隻小藍鳥棲息在其伸出的手上。數位卡通,溫暖色彩與柔和線條。背景聳立著帶瀑布的大懸崖。[yyxx]
Imagen 3還是我們迄今最佳的文字渲染模型,克服了圖像生成模型常見的挑戰。這為創建個性化生日訊息、簡報標題幻燈片等開啟了新可能性。
[ttpp]提示:一座莊嚴圖書館入口的照片,石頭上刻有「中央圖書館」字樣。
提示:一隻用棕色紙摺成的摺紙貓頭鷹棲息在常綠樹枝上。貓頭鷹面向前方,閉著眼睛,顯得平靜。背景是模糊的綠色葉子,營造自然寧靜的環境。
提示:毛氈玩偶場景照片,描繪一個寧靜的森林空地自然場景,一個友好圓潤的大型機器人以凸版印刷風格呈現。貓頭鷹棲於機器人肩上,狐狸在其腳邊。柔和的五色調色盤與充滿光線的色調,營造和平與寧靜感,引人冥想與欣賞自然美景。
提示:太空梭起飛的像素藝術,背景為卡納維拉爾角,藍天,濃煙滾滾。「STS-1」寫於下方。
提示:由各種彩色羽毛組成的「光」字,黑色背景。
提示:黏土動畫場景。一位老年婦女的中景廣角鏡頭,她身穿飄逸服裝,站在鬱鬱蔥蔥的花園中,用橙色澆水壺澆灌植物。[yyxx]
從今天開始,Imagen 3在ImageFX上向部分創作者提供私人預覽。加入我們的等待名單試用。Imagen 3即將在Vertex AI上推出。
了解更多關於Imagen 3功能的信息。
與音樂社群的合作
隨著我們持續探索AI在藝術和音樂創作中的角色,我們正與YouTube合作,並與才華橫溢的音樂家、詞曲創作者和製作人攜手。
這些合作幫助我們發展生成音樂技術,包括Lyria,我們最先進的AI音樂生成模型。
我們一直在開發一套名為Music AI Sandbox的音樂AI工具,旨在通過讓用戶創建新的器樂部分、以創新方式轉換聲音等方式激發創意。
[ttpp]今天,我們繼續與葛萊美獎得主Wyclef Jean、葛萊美提名詞曲創作者Justin Tranter和電子音樂家Marc Rebillet進行音樂實驗,他們在自己的YouTube頻道上發布了使用我們音樂AI工具創作的新演示錄音。[yyxx]
[ttpp]來自Wyclef Jean、Justin Tranter和Marc Rebillet的首批演示現已在他們的YouTube頻道上可供聆聽。每個演示都證明了AI為音樂創作帶來的激動人心的可能性。[yyxx]
從設計到部署的責任
我們致力於不僅推動技術進步,還要以負責任的方式進行。我們正採取措施應對生成技術帶來的挑戰,幫助個人和組織以負責任的方式使用AI生成內容。
對於這些技術,我們一直與創意社群和其他外部利益相關者互動,收集見解和反饋,以改進並安全、負責任地部署我們的技術。
我們進行了安全測試,應用了過濾器,設置了護欄,並將安全團隊置於開發核心。我們的團隊還在開發像SynthID這樣的工具,可將不可見的數位水印嵌入AI生成的圖像、音頻、文字和視頻中。從今天開始,所有在VideoFX上由Veo生成的視頻都將帶有SynthID水印。
生成AI的創意潛力巨大,我們迫不及待想看到全球人們如何使用我們的新模型和工具將他們的想法變為現實。
[ttpp]



在你的收件箱中獲取更多來自Google的故事。在你的收件箱中獲取更多來自Google的故事。
電子郵件地址 你的信息將根據Google的隱私政策使用。
訂閱完成。還差一步。
檢查你的收件箱以確認訂閱。
你已訂閱我們的電子報。
你也可以使用不同的電子郵件地址訂閱。[yyxx]
相關文章
華納音樂收購AI歸因初創公司Sureel AI
華納音樂集團(WMG)於週三確認,其正在收購Sureel AI,一家專注於人工智慧歸因的初創公司。Sureel的專有技術為音樂曲目生成“AI DNA”,將其分解為各個組成部分,以追蹤人工智慧模型如何利用這些元素。透過此次收購,WMG旨在增強其監控其藝術家和詞曲創作者的作品在人工智慧生成內容中被使用或用於訓練人工智慧模型的能力。“將Sureel整合到WMG中,增強了我們的保護、控制和變現能力,確保創意社羣保留對其智慧財產權、姓名、肖像、形象和聲音的控制權,”WMG執行長Robert Kync
亞馬遜推出“Alexa for Shopping”,同時將Rufus邊緣化
亞馬遜推出了“Alexa for Shopping”,將 Rufus 購物聊天機器人 Alexa+ 整合到應用程式、網站和 Echo Show 裝置中。該助手回答產品查詢、比較商品、跟蹤價格,並支援購物提醒。它還處理計劃中的購物操作和符合條件的自動購買。據該公司稱,“Alexa for Shopping”將 Rufus 的產品專業知識與 Alexa+ 的個性化助手上下文相結合。亞馬遜表示,Rufus 在 2025 年協助了超過 3 億客戶進行產品研究、比較和購買。GeekWire 報道稱,
微軟、Azure 與 AI 技術共同對抗加州野火風險
微軟投資於人工智慧驅動的野火偵測技術,其首席副總裁暨首席數據科學家胡安·拉維斯塔·費雷斯(Juan Lavista Ferres)針對減輕環境損害的策略進行了探討。根據美國國家航空暨太空總署(NASA)指出,氣候變遷影響地球上的每個人,其表現為氣溫上升、降雨模式改變以及海平面上升。NASA 指出,有確鑿證據顯示地球正以前所未有的速度變暖,而人類活動是主要驅動因素。隨著全球氣溫上升,野火構成的威脅日
相關專題推薦
評論 (34)
0/500
このVeoってやつ、本当にすごいね!AIがここまで進化するとは思わなかった。でも、クリエイターの仕事が奪われるんじゃないかという心配もあるなぁ。個人的にはAIがツールとして使われる限り問題ないと思うけど、将来的にはどうなるんだろう?🤔
Ça a l'air prometteur, mais j'espère que ces outils ne remplaceront pas complètement la créativité humaine. L'IA devrait être un assistant, pas un artiste 🤔
Wow, Veo sounds like a game-changer for creators! I'm curious how it stacks up against other tools in terms of ease and output quality. 🤔
Veo é uma mudança de jogo para criadores de vídeo! É como ter um assistente superinteligente que te ajuda em cada etapa da produção de vídeo. A única coisa é que às vezes ele fica um pouco criativo demais, mas isso faz parte da diversão! Mal posso esperar para ver o que mais eles vão lançar! 🚀
過去一年,我們在改進生成媒體技術方面取得了顯著進展。我們專注於與創意社群合作,了解生成AI如何在每個階段增強創意過程。我們很高興介紹Veo,這是我們迄今最先進的視頻生成模型,以及Imagen 3,我們目前最高質量的文字到圖像模型。
我們也非常興奮地分享我們近期的一些合作夥伴關係,包括與電影製作人Donald Glover及其創意工作室Gilga的合作,以及來自藝術家Wyclef Jean、Marc Rebillet和詞曲創作者Justin Tranter的新演示錄音,這些都是在我們的Music AI Sandbox的協助下創建的。
Veo:我們最強大的視頻生成模型
Veo設計用於生成1080p分辨率的高質量視頻,適應多種電影和視覺風格,可延長至一分鐘以上。憑藉其對自然語言和視覺語義的高級理解,Veo能生成與用戶創意願景高度契合的視頻,精確捕捉較長提示中指定的語氣和細節。
此模型提供前所未有的創意控制,能理解電影術語,如「延時攝影」或「風景航拍」。Veo確保影片畫面保持一致性和連貫性,人物、動物和物體的運動在整個鏡頭中顯得逼真。
[ttpp]展示Veo高質量視頻生成能力的範例。所有視頻均由Veo生成,未經修改。[yyxx]
為了更好地了解Veo如何增強故事講述過程,我們邀請了多元化的電影製作人和創作者來試驗此模型。這些合作不僅幫助我們完善技術,還確保創作者在技術發展中擁有發言權。
以下是我們與電影製作人Donald Glover及其創意工作室Gilga合作的預覽,他們一直在為一個電影項目試驗Veo。
[ttpp]Veo建立在我們多年生成視頻模型工作的基礎上,包括Generative Query Network (GQN)、DVD-GAN、Imagen-Video、Phenaki、WALT、VideoPoet和Lumiere——結合架構、縮放法則和其他新技術,以提高質量和輸出分辨率。[yyxx]
通過Veo,我們改進了理解視頻內容、渲染高清晰度圖像和模擬現實世界物理的技術。這些進展將推動我們AI研究的進一步進展,幫助我們開發更實用的產品,提升人們互動和溝通的方式。
從今天開始,Veo在VideoFX上向部分創作者提供私人預覽。你可以加入我們的等待名單試用。未來,我們還將把Veo的一些功能整合到YouTube Shorts和其他產品中。
了解更多關於Veo功能的信息。
Imagen 3:我們最高質量的文字到圖像模型
過去一年,我們的圖像生成模型和工具在質量和逼真度方面取得了顯著改進。
Imagen 3是我們最高質量的文字到圖像模型,能生成極其細膩、逼真且栩栩如生的圖像,與我們之前的模型相比,視覺瑕疵大大減少。
[ttpp]提示:一隻光滑的狼在灰色背景前威嚴地棲息,特寫鏡頭,高分辨率照片,細節精緻,單色背景,採用超現實風格的色彩分級。
提示:水母在清澈的水中脈動的特寫,觸手飄動,背景為充滿活力的珊瑚礁,微距攝影,庫存照片,高分辨率,細節豐富,柔和光線,專業色彩分級,淺景深,銳利焦點,使用DSLR相機拍攝,採用專業攝影師風格。
提示:從上方俯瞰美麗的河谷峽谷,樹木環繞,展現其壯麗的自然美景,綠色山脈與藍色水域。照片捕捉了大自然創造的廣闊,以其創造風格呈現。
提示:使用DSLR相機搭配偏光濾鏡拍攝。土耳其卡帕多奇亞獨特岩石地貌上空漂浮的兩個熱氣球照片。氣球上的顏色和圖案與下方大地色調的景觀形成美麗對比。此照片捕捉了體驗這種冒險的感覺。
提示:一雙沾滿泥巴、破舊的登山靴,停放在岩石小徑上。一隻松鼠的頭從一隻靴子中探出,懶散地望向相機,宛如鞋中之王。兩隻靴子的鞋帶鬆散地垂落在地。背景是山地景觀。電影風格劇照,高質量DSLR照片。
提示:三位女性站在一起大笑,其中一位女性在前景略為失焦。太陽在女性身後西下,產生鏡頭光暈和溫暖光芒,突顯她們的頭髮並在背景中創造出散景效果。攝影風格為自然抓拍,捕捉朋友間真摯的連結與快樂時刻。金色時段的溫暖光線為圖像增添懷舊與親密的感覺。[yyxx]
Imagen 3更擅長理解自然語言,能理解提示背後的意圖,並融入較長提示中的細微細節。其先進的理解能力使其能掌握多種風格。
[ttpp]提示:一位短髮蓄鬍的男子對著相機微笑的照片。背景模糊,顯示淺色樹木和建築。
提示:一個人手持一隻小鳥黏土雕像,另一手用造型工具雕刻的視角。可以看到雕塑家的圍巾。他們的手覆滿黏土粉塵。微距DSLR圖像,突出質感和工藝。
提示:抽象素描:以表現力線條和能量模糊捕捉舞者在炭筆素描中的動態運動。素描於老舊羊皮紙上。
提示:大象毛編玩偶在稀樹草原上行走,專業攝影,背景模糊。
提示:穿著白裙的女孩站在無邊湖畔,手持鮮花,仰望滿是粉紅雲彩的天空。水面反射天空,營造出美麗的動漫場景。她周圍有覆蓋野花的小山丘,增添美感。動漫風格背景,紫藍色調,柔和光線,溫暖色彩,夢幻氛圍,浪漫情感。
提示:一具佈滿開花藤蔓的風化木製機械人,平靜地站在高大野花田中,一隻小藍鳥棲息在其伸出的手上。數位卡通,溫暖色彩與柔和線條。背景聳立著帶瀑布的大懸崖。[yyxx]
Imagen 3還是我們迄今最佳的文字渲染模型,克服了圖像生成模型常見的挑戰。這為創建個性化生日訊息、簡報標題幻燈片等開啟了新可能性。
[ttpp]提示:一座莊嚴圖書館入口的照片,石頭上刻有「中央圖書館」字樣。
提示:一隻用棕色紙摺成的摺紙貓頭鷹棲息在常綠樹枝上。貓頭鷹面向前方,閉著眼睛,顯得平靜。背景是模糊的綠色葉子,營造自然寧靜的環境。
提示:毛氈玩偶場景照片,描繪一個寧靜的森林空地自然場景,一個友好圓潤的大型機器人以凸版印刷風格呈現。貓頭鷹棲於機器人肩上,狐狸在其腳邊。柔和的五色調色盤與充滿光線的色調,營造和平與寧靜感,引人冥想與欣賞自然美景。
提示:太空梭起飛的像素藝術,背景為卡納維拉爾角,藍天,濃煙滾滾。「STS-1」寫於下方。
提示:由各種彩色羽毛組成的「光」字,黑色背景。
提示:黏土動畫場景。一位老年婦女的中景廣角鏡頭,她身穿飄逸服裝,站在鬱鬱蔥蔥的花園中,用橙色澆水壺澆灌植物。[yyxx]
從今天開始,Imagen 3在ImageFX上向部分創作者提供私人預覽。加入我們的等待名單試用。Imagen 3即將在Vertex AI上推出。
了解更多關於Imagen 3功能的信息。
與音樂社群的合作
隨著我們持續探索AI在藝術和音樂創作中的角色,我們正與YouTube合作,並與才華橫溢的音樂家、詞曲創作者和製作人攜手。
這些合作幫助我們發展生成音樂技術,包括Lyria,我們最先進的AI音樂生成模型。
我們一直在開發一套名為Music AI Sandbox的音樂AI工具,旨在通過讓用戶創建新的器樂部分、以創新方式轉換聲音等方式激發創意。
[ttpp]今天,我們繼續與葛萊美獎得主Wyclef Jean、葛萊美提名詞曲創作者Justin Tranter和電子音樂家Marc Rebillet進行音樂實驗,他們在自己的YouTube頻道上發布了使用我們音樂AI工具創作的新演示錄音。[yyxx]
[ttpp]來自Wyclef Jean、Justin Tranter和Marc Rebillet的首批演示現已在他們的YouTube頻道上可供聆聽。每個演示都證明了AI為音樂創作帶來的激動人心的可能性。[yyxx]
從設計到部署的責任
我們致力於不僅推動技術進步,還要以負責任的方式進行。我們正採取措施應對生成技術帶來的挑戰,幫助個人和組織以負責任的方式使用AI生成內容。
對於這些技術,我們一直與創意社群和其他外部利益相關者互動,收集見解和反饋,以改進並安全、負責任地部署我們的技術。
我們進行了安全測試,應用了過濾器,設置了護欄,並將安全團隊置於開發核心。我們的團隊還在開發像SynthID這樣的工具,可將不可見的數位水印嵌入AI生成的圖像、音頻、文字和視頻中。從今天開始,所有在VideoFX上由Veo生成的視頻都將帶有SynthID水印。
生成AI的創意潛力巨大,我們迫不及待想看到全球人們如何使用我們的新模型和工具將他們的想法變為現實。
[ttpp]
在你的收件箱中獲取更多來自Google的故事。在你的收件箱中獲取更多來自Google的故事。
電子郵件地址 你的信息將根據Google的隱私政策使用。
訂閱完成。還差一步。
檢查你的收件箱以確認訂閱。
你已訂閱我們的電子報。
你也可以使用不同的電子郵件地址訂閱。[yyxx]
華納音樂收購AI歸因初創公司Sureel AI
華納音樂集團(WMG)於週三確認,其正在收購Sureel AI,一家專注於人工智慧歸因的初創公司。Sureel的專有技術為音樂曲目生成“AI DNA”,將其分解為各個組成部分,以追蹤人工智慧模型如何利用這些元素。透過此次收購,WMG旨在增強其監控其藝術家和詞曲創作者的作品在人工智慧生成內容中被使用或用於訓練人工智慧模型的能力。“將Sureel整合到WMG中,增強了我們的保護、控制和變現能力,確保創意社羣保留對其智慧財產權、姓名、肖像、形象和聲音的控制權,”WMG執行長Robert Kync
微軟、Azure 與 AI 技術共同對抗加州野火風險
微軟投資於人工智慧驅動的野火偵測技術,其首席副總裁暨首席數據科學家胡安·拉維斯塔·費雷斯(Juan Lavista Ferres)針對減輕環境損害的策略進行了探討。根據美國國家航空暨太空總署(NASA)指出,氣候變遷影響地球上的每個人,其表現為氣溫上升、降雨模式改變以及海平面上升。NASA 指出,有確鑿證據顯示地球正以前所未有的速度變暖,而人類活動是主要驅動因素。隨著全球氣溫上升,野火構成的威脅日
このVeoってやつ、本当にすごいね!AIがここまで進化するとは思わなかった。でも、クリエイターの仕事が奪われるんじゃないかという心配もあるなぁ。個人的にはAIがツールとして使われる限り問題ないと思うけど、将来的にはどうなるんだろう?🤔
Ça a l'air prometteur, mais j'espère que ces outils ne remplaceront pas complètement la créativité humaine. L'IA devrait être un assistant, pas un artiste 🤔
Wow, Veo sounds like a game-changer for creators! I'm curious how it stacks up against other tools in terms of ease and output quality. 🤔
Veo é uma mudança de jogo para criadores de vídeo! É como ter um assistente superinteligente que te ajuda em cada etapa da produção de vídeo. A única coisa é que às vezes ele fica um pouco criativo demais, mas isso faz parte da diversão! Mal posso esperar para ver o que mais eles vão lançar! 🚀





首頁






