选项
首页
快讯
内容
CarlGarcia
CarlGarcia
2026-10-09

墨尔本大学与新南威尔士大学的研究人员推出了VoxMem,这是一个新的基准测试,揭示了当前语音AI记忆评估中的关键缺陷。与以往忽略音频细微差别的方法不同,VoxMem通过隔离对话长度,测试对说话人身份、语气和背景声音的记忆能力,涵盖34,743个音频实例。对15个主流模型的测试显示,在32K上下文长度下,没有任何模型的准确率超过40%。这些模型在副语言线索和环境声音方面表现显著不佳,且随着历史记录长度的增加,性能进一步下降,凸显了长音频理解能力方面的重大差距。

评论 (0)
0/300
OR