Stability AI, 6분 길이의 노래를 생성할 수 있는 오디오 모델 공개
Stable Diffusion을 개발한 Stability AI가 ‘Stability Audio 3.0’이라는 새로운 오디오 모델 시리즈를 공개했다. 회사에 따르면, 이 플래그십 모델은 6분을 넘는 길이의 전문가급 음악 트랙을 생성할 수 있다.
스태빌리티 오디오 3.0 라인업에는 소형 SFX(4억 5,900만 파라미터), 소형(4억 5,900만 파라미터), 중형(14억 파라미터), 대형(27억 파라미터) 등 총 4가지 모델이 포함됩니다. 두 가지 소형 모델은 기기 내 사운드 및 음악 생성을 위해 설계되었으며, 최대 출력 길이는 2분입니다.
미디엄 및 라지 모델은 음악적 구조와 선율적 일관성을 유지한 채 최대 6분 20초 길이의 완성된 곡을 생성할 수 있습니다. 이는 2024년에 출시된 Stable Audio 2.0이 달성할 수 있는 재생 시간의 두 배 이상입니다.
Stability AI는 소형 SFX, 소형 및 중형 모델의 가중치를 공개하여 누구나 이를 사용하고 수정할 수 있도록 합니다. 2024년, 이 회사는 최대 47초 분량의 음악 생성이 가능한 'Stable Audio Open'을 선보인 바 있습니다. 이 새로운 모델 제품군은 이전 오픈소스 모델들에 비해 상당한 발전을 보여줍니다.

이미지 출처: StabilityAI
대형 모델은 API 및 유료 자체 호스팅 서비스를 통해서만 이용할 수 있습니다. 또한, 연간 매출이 100만 달러를 초과하는 기업은 엔터프라이즈 라이선스를 취득해야 합니다.
구글(Google)과 일레븐랩스(ElevenLabs)를 비롯한 수많은 기업이 음악 생성 모델과 도구를 출시하고 있습니다. 그러나 수노(Suno)와 우디오(Udio)를 둘러싼 지속적인 법적 분쟁이 보여주듯, 데이터 라이선싱과 음반사와의 파트너십은 이러한 서비스의 장기적인 생존을 위해 결정적일 수 있습니다.
작년, Stability AI는 워너 뮤직 그룹(Warner Music Group) 및 유니버설 뮤직 그룹(Universal Music Group)과 모델 및 음악 제작 도구 개발을 위한 협약을 체결했습니다. 이 회사는 자사의 최신 오디오 모델이 완전히 라이선스가 부여된 데이터로 훈련되었다고 밝혔습니다.
이 AI 스타트업은 구체적인 기능은 공개하지 않았으나, 전문 음악가를 위해 맞춤화된 새로운 제품군을 개발 중이다. 유니버설 오디오(Universal Audio)와 펜더(Fender)의 전 최고 디지털 책임자(CDO)인 에단 카플란(Ethan Kaplan)이 스태빌리티의 전문 음악 사업부를 이끌기 위해 합류했다.
여러 AI 기업들이 음악 업계 임원들을 영입하며 신뢰도를 높이고 있다. 올해 초, 수노(Suno)는 전 멀린(Merlin) CEO 제레미 시로타를 최고상업책임자(CCO)로 임명했다. 일레븐랩스(ElevenLabs) 역시 인디 음악 퍼블리셔 코발트(Kobalt) 출신의 데릭 코르노이어를 음악 사업 전략 책임자로 영입했다.
관련 기사
ElevenLabs, 곡의 중간에 장르를 바꿔주는 음악 AI를 공개하다
음성 AI 기업인 ElevenLabs는 곡의 중간에 장르를 변경할 수 있는 최신 음악 생성 모델인 Music v2를 출시했습니다. 이 모델은 복잡한 보컬과 작곡을 처리하도록 설계되었으며, 해당 회사가 첫 번째 음악 생성 모델을 선보인 지 거의 10개월 만에 공개된 것입니다.ElevenLabs에 따르면 이 모델은 오페라에서 헤비메탈로, 또 다시 그 반대로 전환할 수 있으며, 일관성을 잃지 않으면서 빠른 템포의 랩을 제공하고 곡에 비음악적인 사운
TIDAL, AI 음악 수익화 중단
음악 스트리밍 서비스인 TIDAL이 AI로 생성된 음악을 대상으로 한 새로운 정책을 도입했습니다. 전적으로 AI로 생성된 트랙은 더 이상 해당 플랫폼에서 수익 창출이 불가능해집니다. 또한 TIDAL은 아티스트나 그룹을 사칭하는 AI 생성 음악을 제거하기 위해 자동화 도구를 도입할 것이라고 밝혔습니다.TIDAL의 부사장 겸 편집장인 토니 제르비노(Tony
GRAI: 아티스트를 대체하기 위한 것이 아니라, 음악을 더 사회적인 것으로 만들기 위한 AI
Suno나 Udio와 같은 오늘날의 AI 음악 스타트업들은 인공지능을 활용해 음악을 생성하는 기술을 제공하고 있습니다. 하지만 신생 기업인 GRAI는 대다수의 사람들이 AI를 이용해 음악을 처음부터 새로 만들고 싶어 하는 것이 아니라, 곡을 리믹스하거나 친구들과 공유하거나, 단순히 재미로 트랙의 스타일을 바꿔가며 놀고 싶어 한다고 보고 있습니다.물론, 아티
관련 특별 주제 추천
의견 (0)
0/500
Stable Diffusion을 개발한 Stability AI가 ‘Stability Audio 3.0’이라는 새로운 오디오 모델 시리즈를 공개했다. 회사에 따르면, 이 플래그십 모델은 6분을 넘는 길이의 전문가급 음악 트랙을 생성할 수 있다.
스태빌리티 오디오 3.0 라인업에는 소형 SFX(4억 5,900만 파라미터), 소형(4억 5,900만 파라미터), 중형(14억 파라미터), 대형(27억 파라미터) 등 총 4가지 모델이 포함됩니다. 두 가지 소형 모델은 기기 내 사운드 및 음악 생성을 위해 설계되었으며, 최대 출력 길이는 2분입니다.
미디엄 및 라지 모델은 음악적 구조와 선율적 일관성을 유지한 채 최대 6분 20초 길이의 완성된 곡을 생성할 수 있습니다. 이는 2024년에 출시된 Stable Audio 2.0이 달성할 수 있는 재생 시간의 두 배 이상입니다.
Stability AI는 소형 SFX, 소형 및 중형 모델의 가중치를 공개하여 누구나 이를 사용하고 수정할 수 있도록 합니다. 2024년, 이 회사는 최대 47초 분량의 음악 생성이 가능한 'Stable Audio Open'을 선보인 바 있습니다. 이 새로운 모델 제품군은 이전 오픈소스 모델들에 비해 상당한 발전을 보여줍니다.

이미지 출처: StabilityAI
대형 모델은 API 및 유료 자체 호스팅 서비스를 통해서만 이용할 수 있습니다. 또한, 연간 매출이 100만 달러를 초과하는 기업은 엔터프라이즈 라이선스를 취득해야 합니다.
구글(Google)과 일레븐랩스(ElevenLabs)를 비롯한 수많은 기업이 음악 생성 모델과 도구를 출시하고 있습니다. 그러나 수노(Suno)와 우디오(Udio)를 둘러싼 지속적인 법적 분쟁이 보여주듯, 데이터 라이선싱과 음반사와의 파트너십은 이러한 서비스의 장기적인 생존을 위해 결정적일 수 있습니다.
작년, Stability AI는 워너 뮤직 그룹(Warner Music Group) 및 유니버설 뮤직 그룹(Universal Music Group)과 모델 및 음악 제작 도구 개발을 위한 협약을 체결했습니다. 이 회사는 자사의 최신 오디오 모델이 완전히 라이선스가 부여된 데이터로 훈련되었다고 밝혔습니다.
이 AI 스타트업은 구체적인 기능은 공개하지 않았으나, 전문 음악가를 위해 맞춤화된 새로운 제품군을 개발 중이다. 유니버설 오디오(Universal Audio)와 펜더(Fender)의 전 최고 디지털 책임자(CDO)인 에단 카플란(Ethan Kaplan)이 스태빌리티의 전문 음악 사업부를 이끌기 위해 합류했다.
여러 AI 기업들이 음악 업계 임원들을 영입하며 신뢰도를 높이고 있다. 올해 초, 수노(Suno)는 전 멀린(Merlin) CEO 제레미 시로타를 최고상업책임자(CCO)로 임명했다. 일레븐랩스(ElevenLabs) 역시 인디 음악 퍼블리셔 코발트(Kobalt) 출신의 데릭 코르노이어를 음악 사업 전략 책임자로 영입했다.
ElevenLabs, 곡의 중간에 장르를 바꿔주는 음악 AI를 공개하다
음성 AI 기업인 ElevenLabs는 곡의 중간에 장르를 변경할 수 있는 최신 음악 생성 모델인 Music v2를 출시했습니다. 이 모델은 복잡한 보컬과 작곡을 처리하도록 설계되었으며, 해당 회사가 첫 번째 음악 생성 모델을 선보인 지 거의 10개월 만에 공개된 것입니다.ElevenLabs에 따르면 이 모델은 오페라에서 헤비메탈로, 또 다시 그 반대로 전환할 수 있으며, 일관성을 잃지 않으면서 빠른 템포의 랩을 제공하고 곡에 비음악적인 사운
TIDAL, AI 음악 수익화 중단
음악 스트리밍 서비스인 TIDAL이 AI로 생성된 음악을 대상으로 한 새로운 정책을 도입했습니다. 전적으로 AI로 생성된 트랙은 더 이상 해당 플랫폼에서 수익 창출이 불가능해집니다. 또한 TIDAL은 아티스트나 그룹을 사칭하는 AI 생성 음악을 제거하기 위해 자동화 도구를 도입할 것이라고 밝혔습니다.TIDAL의 부사장 겸 편집장인 토니 제르비노(Tony
GRAI: 아티스트를 대체하기 위한 것이 아니라, 음악을 더 사회적인 것으로 만들기 위한 AI
Suno나 Udio와 같은 오늘날의 AI 음악 스타트업들은 인공지능을 활용해 음악을 생성하는 기술을 제공하고 있습니다. 하지만 신생 기업인 GRAI는 대다수의 사람들이 AI를 이용해 음악을 처음부터 새로 만들고 싶어 하는 것이 아니라, 곡을 리믹스하거나 친구들과 공유하거나, 단순히 재미로 트랙의 스타일을 바꿔가며 놀고 싶어 한다고 보고 있습니다.물론, 아티





집






