选项
首页
快讯
内容
JoseGonzalez
JoseGonzalez
2026-09-16

科大讯飞推出了Spark-Audio-1.0-Preview,这是一个完全基于国内算力训练的本土语音基础模型。它支持文本和语音输入,并输出文本结果,能够处理99种语言和202种方言的转录、翻译及方言识别任务。该模型在基础转换之上实现了更深层次的音频理解,具备说话人识别、情感分析和环境声音识别等功能。目前该模型已开放公众体验,API接口即将通过科大讯飞开放平台提供访问。

评论 (0)
0/300
OR