论文研究普通
VGBench:诊断语音智能体的声学上下文门控能力
原始标题:Do Audio LLMs Listen Before They Act? Diagnosing Acoustic-Context Gating in Voice Agents
内容摘要
研究者推出 VGBench,一个含 1,018 条样本的诊断基准,用于评测语音智能体在闲聊、自言自语和说话人切换场景下的动作级"被称呼"判断。六个原始 Audio LLM 和三种免训练适配方案常能识别目标工具,却很少在说话人切换时抑制动作,最高静默率仅 14%。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-2e360d4552f6d9d41f84a43e