옵션
속보
콘텐츠
CarlPerez
CarlPerez
2026년 9월 23일

알리바바 콴(Qwen)은 ‘Qwen-Audio-3.1’을 출시하며, 음성 인식, 합성, 실시간 상호작용, 창작 분야를 아우르는 5가지 모델을 선보였습니다. 이번 업데이트를 통해 가격이 70~95% 대폭 인하되어 음성 기술을 누구나 쉽게 이용할 수 있게 되었습니다. 주요 기능으로는 원본 전사본을 자동으로 다듬어 주는 문맥 인식 ASR(음성 인식), 30개 언어 및 16개 중국 방언 지원, 초저지연 등이 있습니다. TTS-Next 모델은 음성, 음향 효과, 주변 소음을 결합하여 일반적인 오디오 생성이 가능합니다. 실시간 상호작용 기능은 감정 인식 및 도구 통합을 지원하는 전이중 대화를 제공합니다. 이 포괄적인 제품군은 정확도, 다국어 지원, 창의적인 오디오 제작 기능을 향상시키면서 비용을 대폭 절감합니다.

알리바바 콴(Qwen)은 ‘Qwen-Audio-3.1’을 출시하며, 음성 인식, 합성, 실시간 상호작용, 창작 분야를 아우르는 5가지 모델을 선보였습니다. 이번 업데이트를 통해 가격이 70~95% 대폭 인하되어 음성 기술을 누구나 쉽게 이용할 수 있게 되었습니다. 주요 기능으로는 원본 전사본을 자동으로 다듬어 주는 문맥 인식 ASR(음성 인식), 30개 언어 및 16개 중국 방언 지원, 초저지연 등이 있습니다. TTS-Next 모델은 음성, 음향 효과, 주변 소음을 결합하여 일반적인 오디오 생성이 가능합니다. 실시간 상호작용 기능은 감정 인식 및 도구 통합을 지원하는 전이중 대화를 제공합니다. 이 포괄적인 제품군은 정확도, 다국어 지원, 창의적인 오디오 제작 기능을 향상시키면서 비용을 대폭 절감합니다. 알리바바 콴(Qwen)은 ‘Qwen-Audio-3.1’을 출시하며, 음성 인식, 합성, 실시간 상호작용, 창작 분야를 아우르는 5가지 모델을 선보였습니다. 이번 업데이트를 통해 가격이 70~95% 대폭 인하되어 음성 기술을 누구나 쉽게 이용할 수 있게 되었습니다. 주요 기능으로는 원본 전사본을 자동으로 다듬어 주는 문맥 인식 ASR(음성 인식), 30개 언어 및 16개 중국 방언 지원, 초저지연 등이 있습니다. TTS-Next 모델은 음성, 음향 효과, 주변 소음을 결합하여 일반적인 오디오 생성이 가능합니다. 실시간 상호작용 기능은 감정 인식 및 도구 통합을 지원하는 전이중 대화를 제공합니다. 이 포괄적인 제품군은 정확도, 다국어 지원, 창의적인 오디오 제작 기능을 향상시키면서 비용을 대폭 절감합니다.
의견 (0)
0/300
OR