AI圈报
模型发布 / 更新精选

Hugging Face 开源 450M 视觉-语言-动作模型 SmolVLA,可在消费级硬件运行

信息来源:Hugging Face:Blog(RSS)·
原始标题:SmolVLA: Efficient Vision-Language-Action Model trained on Lerobot Community Data

内容摘要

Hugging Face 发布开源、紧凑的 450M 视觉-语言-动作模型 SmolVLA,仅用 lerobot 标签下的社区开源数据预训练,在 LIBERO、Meta-World 仿真和 SO100/SO101 真实任务上超过更大 VLA 及 ACT 等基线。
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源Hugging Face:Blog(RSS)
站内情报编号intel-8795070511c3e0bd8d3739ed