Stability AI 推出一款能够生成六分钟歌曲的音频模型
Stable Diffusion 的开发者 Stability AI 近日发布了一系列名为 Stability Audio 3.0 的新音频模型。据该公司介绍,其旗舰模型能够生成时长超过六分钟的专业级音乐作品。
在 Stability Audio 3.0 系列下,该公司推出了四款模型:小型 SFX(4.59 亿参数)、小型(4.59 亿参数)、中型(14 亿参数)和大型(27 亿参数)。其中两款小型模型专为设备端音效和音乐生成设计,最大输出时长为两分钟。
中型和大型模型可生成长达6分20秒的完整乐曲,并能保持音乐结构与旋律连贯性。这比2024年推出的Stable Audio 2.0所能实现的时长延长了一倍多。
Stability AI将以开放权重形式发布小型SFX、小型及中型模型,允许任何人使用和修改。2024年,该公司推出了Stable Audio Open,支持生成长达47秒的音乐。这一全新模型系列相较于其开源前代产品实现了重大飞跃。

图片来源:StabilityAI
大型模型仅可通过API及付费的自托管服务访问。此外,年收入超过100万美元的企业必须获取企业许可证。
包括谷歌和ElevenLabs在内的众多公司正陆续推出音乐生成模型和工具。然而,正如涉及Suno和Udio的持续法律纠纷所表明的,数据授权以及与音乐厂牌的合作关系,可能对这些服务的长期可行性至关重要。
去年,Stability AI 与华纳音乐集团(Warner Music Group)及环球音乐集团(Universal Music Group)签署协议,共同开发模型和音乐创作工具。该公司表示,其最新的音频模型是在完全获得授权的数据上进行训练的。
这家AI初创公司正在开发一套专为专业音乐人打造的新产品套件,尽管尚未披露具体功能。曾任环球音频(Universal Audio)和芬达(Fender)首席数字官的伊桑·卡普兰(Ethan Kaplan)已加入该公司,将领导Stability的专业音乐部门。
多家AI公司正通过招募音乐行业高管来提升自身公信力。今年早些时候,Suno任命前Merlin首席执行官杰里米·西罗塔(Jeremy Sirota)为首席商务官。ElevenLabs也从独立音乐出版商Kobalt挖来了德里克·科诺耶(Derek Cournoyer),担任其音乐业务的战略负责人。
相关文章
ElevenLabs 推出可在歌曲进行中切换音乐风格的 AI 技术
语音人工智能公司ElevenLabs推出了其音乐生成模型的最新版本Music v2,该版本具备在歌曲进行到中途时切换音乐风格的功能。这款模型专为处理复杂的人声与曲目结构而设计。距离这家初创公司首次推出音乐生成模型至今已近十个月,此次新版本终于问世。据ElevenLabs称,该模型能够实现从歌剧到重金属等多种风格的快速转换,并且在保持连贯性的同时输出快速的说唱内容,还能将非音乐类的音效融入歌曲中。艺术家们还可以选择歌曲中的某一段落,通过提示词重新生成该部分内容,而无需改动歌曲的其余部分。此外,
TIDAL暂停AI音乐的商业化运营
音乐流媒体服务商TIDAL推出了一项针对AI生成音乐的新政策。完全由AI生成的曲目将不再具备在该平台实现变现的资格。此外,TIDAL表示将部署自动化工具,以移除冒充某位艺人或乐队的AI生成音乐。“我们致力于保护和奖励真正的创造力,以便艺术家能够继续与TIDAL订阅用户建立联系,并扩大其粉丝群体,”TIDAL执行副总裁兼总编辑托尼·杰尔维诺(Tony Gervino)在一份声明中表示。 “许多订阅
GRAI:旨在让音乐更具社交性,而非取代艺术家的人工智能
如今,像 Suno 和 Udio 这样的 AI 音乐初创公司提供利用人工智能生成音乐的技术。但一家新公司 GRAI 认为,大多数人并不想使用 AI 从零开始创作音乐——他们更喜欢混音、与朋友分享,或者仅仅为了好玩而改变曲目的风格。当然,艺术家是否以及在何种程度上允许他人对自己的曲目进行创作,应由他们自己决定。音乐实验室GRAI目前已完成900万美元的种子轮融资,旨在赋予艺术家这种控制权,同时利用A
相关专题推荐
评论 (0)
0/500
Stable Diffusion 的开发者 Stability AI 近日发布了一系列名为 Stability Audio 3.0 的新音频模型。据该公司介绍,其旗舰模型能够生成时长超过六分钟的专业级音乐作品。
在 Stability Audio 3.0 系列下,该公司推出了四款模型:小型 SFX(4.59 亿参数)、小型(4.59 亿参数)、中型(14 亿参数)和大型(27 亿参数)。其中两款小型模型专为设备端音效和音乐生成设计,最大输出时长为两分钟。
中型和大型模型可生成长达6分20秒的完整乐曲,并能保持音乐结构与旋律连贯性。这比2024年推出的Stable Audio 2.0所能实现的时长延长了一倍多。
Stability AI将以开放权重形式发布小型SFX、小型及中型模型,允许任何人使用和修改。2024年,该公司推出了Stable Audio Open,支持生成长达47秒的音乐。这一全新模型系列相较于其开源前代产品实现了重大飞跃。

图片来源:StabilityAI
大型模型仅可通过API及付费的自托管服务访问。此外,年收入超过100万美元的企业必须获取企业许可证。
包括谷歌和ElevenLabs在内的众多公司正陆续推出音乐生成模型和工具。然而,正如涉及Suno和Udio的持续法律纠纷所表明的,数据授权以及与音乐厂牌的合作关系,可能对这些服务的长期可行性至关重要。
去年,Stability AI 与华纳音乐集团(Warner Music Group)及环球音乐集团(Universal Music Group)签署协议,共同开发模型和音乐创作工具。该公司表示,其最新的音频模型是在完全获得授权的数据上进行训练的。
这家AI初创公司正在开发一套专为专业音乐人打造的新产品套件,尽管尚未披露具体功能。曾任环球音频(Universal Audio)和芬达(Fender)首席数字官的伊桑·卡普兰(Ethan Kaplan)已加入该公司,将领导Stability的专业音乐部门。
多家AI公司正通过招募音乐行业高管来提升自身公信力。今年早些时候,Suno任命前Merlin首席执行官杰里米·西罗塔(Jeremy Sirota)为首席商务官。ElevenLabs也从独立音乐出版商Kobalt挖来了德里克·科诺耶(Derek Cournoyer),担任其音乐业务的战略负责人。
ElevenLabs 推出可在歌曲进行中切换音乐风格的 AI 技术
语音人工智能公司ElevenLabs推出了其音乐生成模型的最新版本Music v2,该版本具备在歌曲进行到中途时切换音乐风格的功能。这款模型专为处理复杂的人声与曲目结构而设计。距离这家初创公司首次推出音乐生成模型至今已近十个月,此次新版本终于问世。据ElevenLabs称,该模型能够实现从歌剧到重金属等多种风格的快速转换,并且在保持连贯性的同时输出快速的说唱内容,还能将非音乐类的音效融入歌曲中。艺术家们还可以选择歌曲中的某一段落,通过提示词重新生成该部分内容,而无需改动歌曲的其余部分。此外,
TIDAL暂停AI音乐的商业化运营
音乐流媒体服务商TIDAL推出了一项针对AI生成音乐的新政策。完全由AI生成的曲目将不再具备在该平台实现变现的资格。此外,TIDAL表示将部署自动化工具,以移除冒充某位艺人或乐队的AI生成音乐。“我们致力于保护和奖励真正的创造力,以便艺术家能够继续与TIDAL订阅用户建立联系,并扩大其粉丝群体,”TIDAL执行副总裁兼总编辑托尼·杰尔维诺(Tony Gervino)在一份声明中表示。 “许多订阅
GRAI:旨在让音乐更具社交性,而非取代艺术家的人工智能
如今,像 Suno 和 Udio 这样的 AI 音乐初创公司提供利用人工智能生成音乐的技术。但一家新公司 GRAI 认为,大多数人并不想使用 AI 从零开始创作音乐——他们更喜欢混音、与朋友分享,或者仅仅为了好玩而改变曲目的风格。当然,艺术家是否以及在何种程度上允许他人对自己的曲目进行创作,应由他们自己决定。音乐实验室GRAI目前已完成900万美元的种子轮融资,旨在赋予艺术家这种控制权,同时利用A





首页






