论文研究普通
VA-Bench:通过视觉演示、主动感知与度量控制评测具身空间智能
原始标题:VABench: Measuring Embodied Spatial Intelligence through Visual Demonstrations, Active Perception, and Metric Control
内容摘要
VA-Bench 发布,用于评测 MLLM 的完整"观察-推理-行动-修正"闭环,模型仅凭 RGB 演示学习流程并主动选择相机视角、发出笛卡尔度量指令。基准含 14 个基础任务族、7 个留出几何/布局变体和五物体长程组合赛道,最佳模型三次运行宏平均任务成功率仅 53.93±3.17%。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-1e991ccdc5e0460576581b78