옵션
집
속보
콘텐츠
TerryYoung
TerryYoung
2026년 3월 30일

마이크로소프트는 음성-텍스트 변환 및 텍스트-음성 변환을 위한 VibeVoice AI 모델을 오픈소스로 공개했습니다. 이 제품군에는 1시간 분량의 오디오를 텍스트로 변환하는 'VibeVoice-ASR-7B', 최대 90분 길이의 다중 화자 대화를 생성하는 'VibeVoice-TTS-1.5B', 그리고 300ms 지연 시간을 가진 실시간 TTS 모델이 포함되어 있습니다. MIT 라이선스로 공개된 이 모델은 온프레미스 배포를 지원하며, 음성 합성 기술의 혁신을 촉진하는 것을 목표로 합니다.

마이크로소프트는 음성-텍스트 변환 및 텍스트-음성 변환을 위한 VibeVoice AI 모델을 오픈소스로 공개했습니다. 이 제품군에는 1시간 분량의 오디오를 텍스트로 변환하는 'VibeVoice-ASR-7B', 최대 90분 길이의 다중 화자 대화를 생성하는 'VibeVoice-TTS-1.5B', 그리고 300ms 지연 시간을 가진 실시간 TTS 모델이 포함되어 있습니다. MIT 라이선스로 공개된 이 모델은 온프레미스 배포를 지원하며, 음성 합성 기술의 혁신을 촉진하는 것을 목표로 합니다.
의견 (0)
0/300
OR