AI圈报
模型发布 / 更新精选

Qwen-RobotManip:对齐解锁机器人操作基础模型的规模化能力

信息来源:Qwen:Blog Retrieval(API)·
原始标题:Qwen-RobotManip: Alignment Unlocks Scale for Robotic Manipulation Foundation Models

内容摘要

Qwen-RobotManip 是通义千问基于 Qwen-VL 的视觉-语言-动作(VLA)基础模型,引入覆盖表示、运动和行为三维度的统一对齐框架。仅使用开源机器人数据集和人演示视频,构建约 38,100 小时预训练语料,涵盖 15 种机器人形态。在 LIBERO-Plus 达 91.4%,RoboTwin-C2R Hard 达 69.4%,RoboCasa365 Composite-Unseen 达 14.9%,EBench 达 45.6%,RoboTwin-IF 达 72.0%,并在 RoboChallenge Table30 v1 generalist track 夺冠。模型采用 80 维状态-动作表示、人-机器人数据合成管道(1,933 小时第一人称视频转 24,808 小时数据)及上下文策略适配。
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源Qwen:Blog Retrieval(API)
站内情报编号intel-abab186c0b5437f09f137836