音频大模型记忆能力被高估了?墨尔本大学提出VoxMem基准
VoxMem: Benchmarking Multimodal Memory in Large Audio Language Models 作者:Yang Xiao, Vidhyasaharan Sethu, Eun-Jung Holden, Ting Dang 核心发表机构:University of Melbourne、University of New South Wales 论文链接:arXiv:2609.3…
2026/10/11 1:35:55 阅读全文 →