首页 > 3D标签音频大模型记不住谁在说话?墨大新基准VoxMem揭穿:32K上下文下全员不及格 相关文章
音频大模型记不住谁在说话?墨大新基准VoxMem揭穿:32K上下文下全员不及格

音频大模型记不住谁在说话?墨大新基准VoxMem揭穿:32K上下文下全员不及格

墨尔本大学与新南威尔士大学联合团队推出语音AI评测基准VoxMem,检验其在长达数小时、几十轮真实对话中,能否记住说话人身份、语气和背景声。团队指出旧评测只关注转写文字,丢失声音中的身份、情绪与环境线索,无法衡量语音记忆能力,VoxMem正为填补这一空白而设。