选项
首页
快讯
内容
CarlPerez
CarlPerez
2026-09-23

阿里巴巴Qwen发布了Qwen-Audio-3.1,推出了涵盖语音识别、合成、实时交互和创作领域的五款模型。此次更新将价格下调了70%至95%,使语音技术变得触手可及。 主要功能包括具备原生转录优化能力的上下文感知语音识别(ASR)、支持30种语言和16种中国方言,以及超低延迟。TTS-Next模型可实现通用音频生成,融合人声、音效和环境噪音。 实时交互功能支持全双工对话,具备情感感知和工具集成能力。这一全面的解决方案在显著降低成本的同时,还提升了准确率、多语言支持能力以及创意音频制作能力。

阿里巴巴Qwen发布了Qwen-Audio-3.1,推出了涵盖语音识别、合成、实时交互和创作领域的五款模型。此次更新将价格下调了70%至95%,使语音技术变得触手可及。 主要功能包括具备原生转录优化能力的上下文感知语音识别(ASR)、支持30种语言和16种中国方言,以及超低延迟。TTS-Next模型可实现通用音频生成,融合人声、音效和环境噪音。 实时交互功能支持全双工对话,具备情感感知和工具集成能力。这一全面的解决方案在显著降低成本的同时,还提升了准确率、多语言支持能力以及创意音频制作能力。 阿里巴巴Qwen发布了Qwen-Audio-3.1,推出了涵盖语音识别、合成、实时交互和创作领域的五款模型。此次更新将价格下调了70%至95%,使语音技术变得触手可及。 主要功能包括具备原生转录优化能力的上下文感知语音识别(ASR)、支持30种语言和16种中国方言,以及超低延迟。TTS-Next模型可实现通用音频生成,融合人声、音效和环境噪音。 实时交互功能支持全双工对话,具备情感感知和工具集成能力。这一全面的解决方案在显著降低成本的同时,还提升了准确率、多语言支持能力以及创意音频制作能力。
评论 (0)
0/300
OR