AI圈报
论文研究普通

LIT:用潜在接口训练破解视觉-动作捷径,提升机器人基础模型泛化能力

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:Breaking the Vision-Action Shortcut: Latent Interface Training for Generalizable Robotics Foundation Models

内容摘要

研究者提出 Latent Interface Training(LIT),一种与框架无关的两阶段策略:先在不使用图像的情况下建立以空间目标为条件的动作先验,再通过姿态监督的潜在接口约束视觉条件路径。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-7b78ac2369509a6a4b71a7b1