Stability AI stellt ein Audiomodell vor, das sechsminütige Songs generieren kann
Stability AI, der Entwickler von Stable Diffusion, hat eine neue Serie von Audiomodellen namens Stability Audio 3.0 vorgestellt. Nach Angaben des Unternehmens ist das Flaggschiff-Modell in der Lage, Musikstücke in professioneller Qualität mit einer Länge von mehr als sechs Minuten zu erzeugen.
Unter dem Dach von Stability Audio 3.0 stellt das Unternehmen vier Modelle vor: small SFX (459 Millionen Parameter), small (459 Millionen Parameter), medium (1,4 Milliarden Parameter) und large (2,7 Milliarden Parameter). Die beiden kleinen Modelle sind für die geräteinterne Klang- und Musikgenerierung ausgelegt und haben eine maximale Ausgabelänge von zwei Minuten.
Die mittleren und großen Modelle können vollständige Kompositionen von bis zu 6 Minuten und 20 Sekunden erzeugen, wobei die musikalische Struktur und die melodische Kohärenz erhalten bleiben. Das ist mehr als doppelt so lang wie die mit Stable Audio 2.0, das 2024 auf den Markt kam, erreichbare Dauer.
Stability AI veröffentlicht die kleinen SFX-, kleinen und mittleren Modelle mit offenen Gewichten, sodass jeder sie nutzen und modifizieren kann. Im Jahr 2024 führte das Unternehmen Stable Audio Open ein, das die Musikgenerierung von bis zu 47 Sekunden ermöglichte. Diese neue Modellfamilie stellt einen bedeutenden Fortschritt gegenüber ihren Open-Source-Vorgängern dar.

Bildnachweis: StabilityAI
Das große Modell ist nur über die API und kostenpflichtige Self-Hosting-Dienste zugänglich. Darüber hinaus müssen Unternehmen mit einem Jahresumsatz von mehr als 1 Million US-Dollar eine Unternehmenslizenz erwerben.
Zahlreiche Unternehmen, darunter Google und ElevenLabs, bringen Modelle und Tools zur Musikgenerierung auf den Markt. Wie jedoch die anhaltenden Rechtsstreitigkeiten um Suno und Udio gezeigt haben, könnten Datenlizenzen und Partnerschaften mit Musiklabels für die langfristige Tragfähigkeit dieser Dienste entscheidend sein.
Im vergangenen Jahr unterzeichnete Stability AI Vereinbarungen mit der Warner Music Group und der Universal Music Group zur Entwicklung von Modellen und Tools zur Musikkomposition. Das Unternehmen gibt an, dass seine neuesten Audiomodelle auf vollständig lizenzierten Daten trainiert wurden.
Das KI-Startup entwickelt eine neue Produktreihe, die speziell auf professionelle Musiker zugeschnitten ist, hat jedoch noch keine konkreten Funktionen bekannt gegeben. Ethan Kaplan, ehemals Chief Digital Officer bei Universal Audio und Fender, tritt dem Unternehmen bei, um die professionelle Musikabteilung von Stability zu leiten.
Mehrere KI-Unternehmen stärken ihre Glaubwürdigkeit durch die Rekrutierung von Führungskräften aus der Musikbranche. Anfang dieses Jahres ernannte Suno den ehemaligen Merlin-CEO Jeremy Sirota zum Chief Commercial Officer. ElevenLabs holte zudem Derek Cournoyer vom Indie-Musikverlag Kobalt als Strategieleiter für sein Musikgeschäft an Bord.
Verwandter Artikel
ElevenLabs präsentiert eine Musik-KI, die mitten im Lied den Genrewechsel bewirkt
ElevenLabs, ein Unternehmen im Bereich KI für Stimmen, hat Music v2 veröffentlicht – die neueste Version seines Modells zur Erstellung von Musik, das es ermöglicht, mitten in einem Stück den Genrewechsel vorzunehmen. Das Modell ist darauf ausgelegt,
TIDAL stellt die Monetarisierung von KI-Musik ein
Der Musik-Streaming-Dienst TIDAL hat eine neue Richtlinie für KI-generierte Musik eingeführt. Vollständig KI-generierte Titel können auf der Plattform künftig nicht mehr monetarisiert werden. Darüber
GRAI: KI soll Musik sozialer machen, nicht Künstler ersetzen
Heutige KI-Musik-Startups wie Suno und Udio bieten Technologien an, die künstliche Intelligenz zur Musikgenerierung nutzen. Das neue Unternehmen GRAI ist jedoch der Ansicht, dass die meisten Menschen
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Stability AI, der Entwickler von Stable Diffusion, hat eine neue Serie von Audiomodellen namens Stability Audio 3.0 vorgestellt. Nach Angaben des Unternehmens ist das Flaggschiff-Modell in der Lage, Musikstücke in professioneller Qualität mit einer Länge von mehr als sechs Minuten zu erzeugen.
Unter dem Dach von Stability Audio 3.0 stellt das Unternehmen vier Modelle vor: small SFX (459 Millionen Parameter), small (459 Millionen Parameter), medium (1,4 Milliarden Parameter) und large (2,7 Milliarden Parameter). Die beiden kleinen Modelle sind für die geräteinterne Klang- und Musikgenerierung ausgelegt und haben eine maximale Ausgabelänge von zwei Minuten.
Die mittleren und großen Modelle können vollständige Kompositionen von bis zu 6 Minuten und 20 Sekunden erzeugen, wobei die musikalische Struktur und die melodische Kohärenz erhalten bleiben. Das ist mehr als doppelt so lang wie die mit Stable Audio 2.0, das 2024 auf den Markt kam, erreichbare Dauer.
Stability AI veröffentlicht die kleinen SFX-, kleinen und mittleren Modelle mit offenen Gewichten, sodass jeder sie nutzen und modifizieren kann. Im Jahr 2024 führte das Unternehmen Stable Audio Open ein, das die Musikgenerierung von bis zu 47 Sekunden ermöglichte. Diese neue Modellfamilie stellt einen bedeutenden Fortschritt gegenüber ihren Open-Source-Vorgängern dar.

Bildnachweis: StabilityAI
Das große Modell ist nur über die API und kostenpflichtige Self-Hosting-Dienste zugänglich. Darüber hinaus müssen Unternehmen mit einem Jahresumsatz von mehr als 1 Million US-Dollar eine Unternehmenslizenz erwerben.
Zahlreiche Unternehmen, darunter Google und ElevenLabs, bringen Modelle und Tools zur Musikgenerierung auf den Markt. Wie jedoch die anhaltenden Rechtsstreitigkeiten um Suno und Udio gezeigt haben, könnten Datenlizenzen und Partnerschaften mit Musiklabels für die langfristige Tragfähigkeit dieser Dienste entscheidend sein.
Im vergangenen Jahr unterzeichnete Stability AI Vereinbarungen mit der Warner Music Group und der Universal Music Group zur Entwicklung von Modellen und Tools zur Musikkomposition. Das Unternehmen gibt an, dass seine neuesten Audiomodelle auf vollständig lizenzierten Daten trainiert wurden.
Das KI-Startup entwickelt eine neue Produktreihe, die speziell auf professionelle Musiker zugeschnitten ist, hat jedoch noch keine konkreten Funktionen bekannt gegeben. Ethan Kaplan, ehemals Chief Digital Officer bei Universal Audio und Fender, tritt dem Unternehmen bei, um die professionelle Musikabteilung von Stability zu leiten.
Mehrere KI-Unternehmen stärken ihre Glaubwürdigkeit durch die Rekrutierung von Führungskräften aus der Musikbranche. Anfang dieses Jahres ernannte Suno den ehemaligen Merlin-CEO Jeremy Sirota zum Chief Commercial Officer. ElevenLabs holte zudem Derek Cournoyer vom Indie-Musikverlag Kobalt als Strategieleiter für sein Musikgeschäft an Bord.
ElevenLabs präsentiert eine Musik-KI, die mitten im Lied den Genrewechsel bewirkt
ElevenLabs, ein Unternehmen im Bereich KI für Stimmen, hat Music v2 veröffentlicht – die neueste Version seines Modells zur Erstellung von Musik, das es ermöglicht, mitten in einem Stück den Genrewechsel vorzunehmen. Das Modell ist darauf ausgelegt,
TIDAL stellt die Monetarisierung von KI-Musik ein
Der Musik-Streaming-Dienst TIDAL hat eine neue Richtlinie für KI-generierte Musik eingeführt. Vollständig KI-generierte Titel können auf der Plattform künftig nicht mehr monetarisiert werden. Darüber
GRAI: KI soll Musik sozialer machen, nicht Künstler ersetzen
Heutige KI-Musik-Startups wie Suno und Udio bieten Technologien an, die künstliche Intelligenz zur Musikgenerierung nutzen. Das neue Unternehmen GRAI ist jedoch der Ansicht, dass die meisten Menschen





Heim






