墨尔本大学与新南威尔士大学联合团队推出语音AI评测基准VoxMem,检验其在长达数小时、几十轮真实对话中,能否记住说话人身份、语气和背景声。团队指出旧评测只关注转写文字,丢失声音中的身份、情绪与环境线索,无法衡量语音记忆能力,VoxMem正为填补这一空白而设。