Qwen은 자유 형식의 자연어 명령으로 제어할 수 있는 음성 합성 모델인 ‘Qwen-Audio-3.0-TTS’를 출시했습니다. 사용자는 기술적 매개변수를 직접 조정하는 대신, 일상적인 언어로 원하는 어조나 스타일을 설명할 수 있습니다. 두 가지 버전이 제공됩니다: 첫 패킷 지연 시간이 300ms인 실시간 상호작용용 ‘Flash’와 고품질 오디오북 및 더빙용 ‘Plus’입니다. 이를 통해 음성 합성의 진입 장벽이 낮아져 누구나 사용할 수 있는 도구가 되었습니다.





집
