AI圈报
论文研究普通

PerturBot:用扰动训练打破视觉-语言-动作模型中的捷径先验

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:PerturBot: Breaking Shortcut Priors in Vision-Language-Action Models with Perturbative Training

内容摘要

针对视觉-语言-动作(VLA)模型依赖模态捷径(视觉、词汇或动作线索即可预测专家动作)的问题,研究者提出 PerturBot,通过任务保持的手腕视角扰动、加入决策相关描述丰富指令、并混入随机与失败轨迹片段重新标注来训练,且不改变推理过程。同时提出离线评分 GroundingFscore,用于诊断策略对模态捷径的依赖程度,与任务成功率互补,判断模型是否健康扩展。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-70e81b3efaa8c574d2a84f4c