SpotSound 问世:攻克音频大模型时序定位与幻觉难题

SpotSound 问世:攻克音频大模型时序定位与幻觉难题

近日,浙江大学、上海 AI 实验室、上海交通大学联合推出音频大模型 SpotSound,论文被 ACM MM 2026 接收,项目代码、数据集、评测基准已全部开源发布。

800_auto

现有大音频语言模型擅长音频整体理解,但很难精准定位声音事件发生的具体时间段,还容易产生时间戳幻觉,在复杂背景噪声下短时声...

点击查看剩余70%

{{collectdata}}

网友评论