Stability AI、6分間の楽曲を生成できる音声モデルを発表
Stable Diffusionの開発元であるStability AIは、「Stability Audio 3.0」と名付けられた新しいオーディオモデルシリーズを発表した。同社によると、フラッグシップモデルは6分を超えるプロ品質の音楽トラックを生成することができるという。
Stability Audio 3.0の傘下として、同社はsmall SFX(パラメータ数4億5900万)、small(パラメータ数4億5900万)、medium(パラメータ数14億)、large(パラメータ数27億)の4つのモデルを導入しています。2つのsmallモデルは、デバイス上でのサウンドおよび音楽生成を目的として設計されており、最大出力時間は2分です。
ミディアムおよびラージモデルは、音楽的構造とメロディの一貫性を保ちつつ、最大6分20秒までの完全な楽曲を生成可能です。これは、2024年にリリースされたStable Audio 2.0で実現可能な再生時間の2倍以上となります。
Stability AIは、小型SFXモデル、小型モデル、中型モデルをオープンウェイトで公開しており、誰でもこれらを利用・修正できるようになっています。同社は2024年に、最大47秒の音楽生成を可能にする「Stable Audio Open」を導入しました。この新しいモデルファミリーは、以前のオープンソースモデルに比べて大幅な進歩を遂げています。

画像提供:StabilityAI
Largeモデルは、APIおよび有料のセルフホスティングサービスを通じてのみ利用可能です。さらに、年間売上高が100万ドルを超える企業は、エンタープライズライセンスの取得が義務付けられています。
GoogleやElevenLabsなど、多くの企業が音楽生成用のモデルやツールをリリースしています。しかし、SunoやUdioを巡る現在進行中の法的紛争が示しているように、データのライセンスや音楽レーベルとの提携は、これらのサービスの長期的な存続にとって極めて重要となる可能性があります。
昨年、Stability AIはワーナー・ミュージック・グループおよびユニバーサル・ミュージック・グループと、モデルおよび音楽制作ツールの開発に関する契約を締結しました。同社は、最新のオーディオモデルが完全にライセンスされたデータを用いて学習されていると述べています。
このAIスタートアップは、プロのミュージシャン向けに特化した新製品群を開発中だが、具体的な機能については明らかにしていない。ユニバーサル・オーディオやフェンダーで最高デジタル責任者を務めたイーサン・カプラン氏が同社に加わり、Stabilityのプロフェッショナル音楽部門を率いることになった。
複数のAI企業が、音楽業界の幹部を採用することで信頼性を高めている。今年初め、Sunoは元MerlinのCEOであるジェレミー・シロタ氏を最高商業責任者(CCO)に任命した。ElevenLabsもまた、インディーズ音楽出版社Kobalt出身のデレク・コーノイヤー氏を、音楽事業の戦略責任者として迎え入れた。
関連記事
ElevenLabs、楽曲の途中でジャンルを切り替える音楽AIを発表
音声AI企業であるElevenLabsは、楽曲生成モデルの最新バージョンであるMusic v2をリリースしました。この新バージョンでは曲の途中でジャンルを変更することが可能です。このモデルは複雑なボーカルや楽曲構成にも対応するよう設計されています。同社が初版の楽曲生成モデルを発表してから約10ヶ月後の今回のリリースとなります。ElevenLabsによると、このモデルはオペラからヘヴィメタルへ、またその逆へと切り替えたり、一貫性を失うことなく速いテンポのラップを生成したり、楽曲に非音楽的な効果音
TIDAL、AI音楽の収益化を停止
音楽ストリーミングサービス「TIDAL」は、AI生成音楽を対象とした新たな方針を導入した。AIによって完全に生成された楽曲は、今後同プラットフォーム上で収益化の対象外となる。さらにTIDALは、アーティストやグループを装ったAI生成音楽を削除するための自動化ツールを導入すると述べている。「私たちは、アーティストがTIDALの加入者とのつながりを維持し、ファン層を拡大し続けられるよう、自然な創造性
GRAI:アーティストに取って代わるのではなく、音楽をよりソーシャルなものにすることを目指したAI
SunoやUdioといった今日のAI音楽スタートアップは、人工知能を活用した音楽生成技術を提供しています。しかし、新興企業のGRAIは、ほとんどの人がAIを使って一から音楽を生成したいわけではないと考えています。むしろ、曲をリミックスしたり、友人と共有したり、単に楽しみのために曲のスタイルを変えて遊んだりすることを好むのです。もちろん、アーティストが他者に自分のトラックをいじらせるかどうか、またど
関連特集おすすめ
コメント (0)
0/500
Stable Diffusionの開発元であるStability AIは、「Stability Audio 3.0」と名付けられた新しいオーディオモデルシリーズを発表した。同社によると、フラッグシップモデルは6分を超えるプロ品質の音楽トラックを生成することができるという。
Stability Audio 3.0の傘下として、同社はsmall SFX(パラメータ数4億5900万)、small(パラメータ数4億5900万)、medium(パラメータ数14億)、large(パラメータ数27億)の4つのモデルを導入しています。2つのsmallモデルは、デバイス上でのサウンドおよび音楽生成を目的として設計されており、最大出力時間は2分です。
ミディアムおよびラージモデルは、音楽的構造とメロディの一貫性を保ちつつ、最大6分20秒までの完全な楽曲を生成可能です。これは、2024年にリリースされたStable Audio 2.0で実現可能な再生時間の2倍以上となります。
Stability AIは、小型SFXモデル、小型モデル、中型モデルをオープンウェイトで公開しており、誰でもこれらを利用・修正できるようになっています。同社は2024年に、最大47秒の音楽生成を可能にする「Stable Audio Open」を導入しました。この新しいモデルファミリーは、以前のオープンソースモデルに比べて大幅な進歩を遂げています。

画像提供:StabilityAI
Largeモデルは、APIおよび有料のセルフホスティングサービスを通じてのみ利用可能です。さらに、年間売上高が100万ドルを超える企業は、エンタープライズライセンスの取得が義務付けられています。
GoogleやElevenLabsなど、多くの企業が音楽生成用のモデルやツールをリリースしています。しかし、SunoやUdioを巡る現在進行中の法的紛争が示しているように、データのライセンスや音楽レーベルとの提携は、これらのサービスの長期的な存続にとって極めて重要となる可能性があります。
昨年、Stability AIはワーナー・ミュージック・グループおよびユニバーサル・ミュージック・グループと、モデルおよび音楽制作ツールの開発に関する契約を締結しました。同社は、最新のオーディオモデルが完全にライセンスされたデータを用いて学習されていると述べています。
このAIスタートアップは、プロのミュージシャン向けに特化した新製品群を開発中だが、具体的な機能については明らかにしていない。ユニバーサル・オーディオやフェンダーで最高デジタル責任者を務めたイーサン・カプラン氏が同社に加わり、Stabilityのプロフェッショナル音楽部門を率いることになった。
複数のAI企業が、音楽業界の幹部を採用することで信頼性を高めている。今年初め、Sunoは元MerlinのCEOであるジェレミー・シロタ氏を最高商業責任者(CCO)に任命した。ElevenLabsもまた、インディーズ音楽出版社Kobalt出身のデレク・コーノイヤー氏を、音楽事業の戦略責任者として迎え入れた。
ElevenLabs、楽曲の途中でジャンルを切り替える音楽AIを発表
音声AI企業であるElevenLabsは、楽曲生成モデルの最新バージョンであるMusic v2をリリースしました。この新バージョンでは曲の途中でジャンルを変更することが可能です。このモデルは複雑なボーカルや楽曲構成にも対応するよう設計されています。同社が初版の楽曲生成モデルを発表してから約10ヶ月後の今回のリリースとなります。ElevenLabsによると、このモデルはオペラからヘヴィメタルへ、またその逆へと切り替えたり、一貫性を失うことなく速いテンポのラップを生成したり、楽曲に非音楽的な効果音
TIDAL、AI音楽の収益化を停止
音楽ストリーミングサービス「TIDAL」は、AI生成音楽を対象とした新たな方針を導入した。AIによって完全に生成された楽曲は、今後同プラットフォーム上で収益化の対象外となる。さらにTIDALは、アーティストやグループを装ったAI生成音楽を削除するための自動化ツールを導入すると述べている。「私たちは、アーティストがTIDALの加入者とのつながりを維持し、ファン層を拡大し続けられるよう、自然な創造性
GRAI:アーティストに取って代わるのではなく、音楽をよりソーシャルなものにすることを目指したAI
SunoやUdioといった今日のAI音楽スタートアップは、人工知能を活用した音楽生成技術を提供しています。しかし、新興企業のGRAIは、ほとんどの人がAIを使って一から音楽を生成したいわけではないと考えています。むしろ、曲をリミックスしたり、友人と共有したり、単に楽しみのために曲のスタイルを変えて遊んだりすることを好むのです。もちろん、アーティストが他者に自分のトラックをいじらせるかどうか、またど





家






