Stability AI 推出一款能生成六分鐘歌曲的音訊模型
Stable Diffusion 的開發商 Stability AI 近日推出了一系列名為 Stability Audio 3.0 的新音訊模型。據該公司表示,其旗艦模型能夠生成長度超過六分鐘的專業級音樂曲目。
在 Stability Audio 3.0 系列下,該公司推出了四款模型:小型 SFX(4.59 億參數)、小型(4.59 億參數)、中型(14 億參數)以及大型(27 億參數)。其中兩款小型模型專為裝置端音效與音樂生成設計,最大輸出長度為兩分鐘。
中型與大型模型則能生成長達 6 分 20 秒的完整樂曲,並能維持音樂結構與旋律連貫性。這比 2024 年推出的 Stable Audio 2.0 所能達成的長度多出兩倍以上。
Stability AI 將以開放權重形式釋出小型 SFX、小型及中型模型,讓任何人都能使用並修改它們。2024 年,該公司推出了 Stable Audio Open,可生成長達 47 秒的音樂。這套新模型系列相較於其開源前代產品,代表著顯著的進步。

圖片來源:StabilityAI圖片來源:Stability AI
大型模型僅可透過 API 及付費的自建伺服器服務存取。此外,年營收超過 100 萬美元的企業必須取得企業授權。
包括 Google 和 ElevenLabs 在內的眾多企業,正陸續推出音樂生成模型與工具。然而,正如 Suno 與 Udio 之間持續的法律糾紛所示,數據授權以及與音樂廠牌的合作夥伴關係,對於這些服務的長期可行性至關重要。
去年,Stability AI 已與華納音樂集團(Warner Music Group)及環球音樂集團(Universal Music Group)簽署協議,共同開發模型與音樂創作工具。該公司聲明,其最新的音訊模型均採用完全取得授權的數據進行訓練。
這家 AI 新創公司正開發一套專為專業音樂人量身打造的新產品組合,儘管尚未透露具體功能。曾任 Universal Audio 和 Fender 數位長(CDO)的 Ethan Kaplan 將加入該公司,領導 Stability 的專業音樂部門。
多家 AI 公司正透過招募音樂產業高管來提升其公信力。今年稍早,Suno 任命前 Merlin 執行長 Jeremy Sirota 為首席商務官。ElevenLabs 也從獨立音樂出版商 Kobalt 挖角 Derek Cournoyer,擔任其音樂業務的策略負責人。
相關文章
ElevenLabs 推出可在歌曲進行中切換音樂風格的 AI 技術
語音人工智慧公司ElevenLabs推出了其音樂生成模型的最新版本Music v2,該版本具備在歌曲進行到中途時切換音樂風格的功能。這款模型專為處理複雜的人聲與曲目結構而設計。距離這家初創公司首次推出音樂生成模型至今已近十個月,此次新版本終於問世。據ElevenLabs稱,該模型能夠實現從歌劇到重金屬等多種風格的快速轉換,並且在保持連貫性的同時輸出快速的說唱內容,還能將非音樂類的音效融入歌曲中。藝術家們還可以選擇歌曲中的某一段落,透過提示詞重新生成該部分內容,而無需改動歌曲的其餘部分。此外,
TIDAL 暫停 AI 音樂的商業化運作
音樂串流服務平台 TIDAL 推出了一項針對 AI 生成音樂的新政策。完全由 AI 生成的曲目將不再具備在該平台上獲利的資格。此外,TIDAL 表示將部署自動化工具,以移除冒充特定藝人或團體的 AI 生成音樂。「我們致力於保護並獎勵原創的創意,讓藝術家能夠持續與 TIDAL 訂閱用戶建立連結,並在其中拓展粉絲群體,」TIDAL 執行副總裁兼總編輯 Tony Gervino 在一份聲明中表示。 「
GRAI:這項人工智慧旨在讓音樂更具社交性,而非取代藝術家
像 Suno 和 Udio 這樣的當代 AI 音樂新創公司,提供運用人工智慧生成音樂的技術。但一家新創公司 GRAI 認為,大多數人並不希望利用 AI 從零開始創作音樂——他們更傾向於混音、與朋友分享,或是單純為了好玩而改變曲風來玩玩看。當然,藝術家是否以及在何種程度上允許他人玩轉他們的曲目,這應由他們自行決定。音樂實驗室 GRAI 目前已獲得 900 萬美元的種子輪融資,旨在賦予藝術家這項控制權
相關專題推薦
評論 (0)
0/500
Stable Diffusion 的開發商 Stability AI 近日推出了一系列名為 Stability Audio 3.0 的新音訊模型。據該公司表示,其旗艦模型能夠生成長度超過六分鐘的專業級音樂曲目。
在 Stability Audio 3.0 系列下,該公司推出了四款模型:小型 SFX(4.59 億參數)、小型(4.59 億參數)、中型(14 億參數)以及大型(27 億參數)。其中兩款小型模型專為裝置端音效與音樂生成設計,最大輸出長度為兩分鐘。
中型與大型模型則能生成長達 6 分 20 秒的完整樂曲,並能維持音樂結構與旋律連貫性。這比 2024 年推出的 Stable Audio 2.0 所能達成的長度多出兩倍以上。
Stability AI 將以開放權重形式釋出小型 SFX、小型及中型模型,讓任何人都能使用並修改它們。2024 年,該公司推出了 Stable Audio Open,可生成長達 47 秒的音樂。這套新模型系列相較於其開源前代產品,代表著顯著的進步。

圖片來源:StabilityAI圖片來源:Stability AI
大型模型僅可透過 API 及付費的自建伺服器服務存取。此外,年營收超過 100 萬美元的企業必須取得企業授權。
包括 Google 和 ElevenLabs 在內的眾多企業,正陸續推出音樂生成模型與工具。然而,正如 Suno 與 Udio 之間持續的法律糾紛所示,數據授權以及與音樂廠牌的合作夥伴關係,對於這些服務的長期可行性至關重要。
去年,Stability AI 已與華納音樂集團(Warner Music Group)及環球音樂集團(Universal Music Group)簽署協議,共同開發模型與音樂創作工具。該公司聲明,其最新的音訊模型均採用完全取得授權的數據進行訓練。
這家 AI 新創公司正開發一套專為專業音樂人量身打造的新產品組合,儘管尚未透露具體功能。曾任 Universal Audio 和 Fender 數位長(CDO)的 Ethan Kaplan 將加入該公司,領導 Stability 的專業音樂部門。
多家 AI 公司正透過招募音樂產業高管來提升其公信力。今年稍早,Suno 任命前 Merlin 執行長 Jeremy Sirota 為首席商務官。ElevenLabs 也從獨立音樂出版商 Kobalt 挖角 Derek Cournoyer,擔任其音樂業務的策略負責人。
ElevenLabs 推出可在歌曲進行中切換音樂風格的 AI 技術
語音人工智慧公司ElevenLabs推出了其音樂生成模型的最新版本Music v2,該版本具備在歌曲進行到中途時切換音樂風格的功能。這款模型專為處理複雜的人聲與曲目結構而設計。距離這家初創公司首次推出音樂生成模型至今已近十個月,此次新版本終於問世。據ElevenLabs稱,該模型能夠實現從歌劇到重金屬等多種風格的快速轉換,並且在保持連貫性的同時輸出快速的說唱內容,還能將非音樂類的音效融入歌曲中。藝術家們還可以選擇歌曲中的某一段落,透過提示詞重新生成該部分內容,而無需改動歌曲的其餘部分。此外,
TIDAL 暫停 AI 音樂的商業化運作
音樂串流服務平台 TIDAL 推出了一項針對 AI 生成音樂的新政策。完全由 AI 生成的曲目將不再具備在該平台上獲利的資格。此外,TIDAL 表示將部署自動化工具,以移除冒充特定藝人或團體的 AI 生成音樂。「我們致力於保護並獎勵原創的創意,讓藝術家能夠持續與 TIDAL 訂閱用戶建立連結,並在其中拓展粉絲群體,」TIDAL 執行副總裁兼總編輯 Tony Gervino 在一份聲明中表示。 「
GRAI:這項人工智慧旨在讓音樂更具社交性,而非取代藝術家
像 Suno 和 Udio 這樣的當代 AI 音樂新創公司,提供運用人工智慧生成音樂的技術。但一家新創公司 GRAI 認為,大多數人並不希望利用 AI 從零開始創作音樂——他們更傾向於混音、與朋友分享,或是單純為了好玩而改變曲風來玩玩看。當然,藝術家是否以及在何種程度上允許他人玩轉他們的曲目,這應由他們自行決定。音樂實驗室 GRAI 目前已獲得 900 萬美元的種子輪融資,旨在賦予藝術家這項控制權





首頁






