AI圈报
论文研究普通

MA-VLA:面向协作与组合泛化的多臂视觉-语言-动作模型

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:MA-VLA: Multi-Arm Vision-Language-Action Model for Collaboration and Compositional Generalization

内容摘要

MA-VLA提出统一的多臂协作框架,将协作行为分解为中层原子提示并分配给各机械臂,实现显式子目标指定与跨任务组合复用。其引入训练时置换机制Arm Shuffle,强制角色无关的指令跟随,支持重组为未见过的协作模式。在仿真与真实世界评估中,先前SOTA VLA模型在未见协作下大多失败,MA-VLA则持续成功,代码、模型与数据已开源。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-8b2a9c5e6ddac9dfc5685536