模型发布 / 更新精选
Hugging Face 开源 450M 视觉-语言-动作模型 SmolVLA,可在消费级硬件运行
原始标题:SmolVLA: Efficient Vision-Language-Action Model trained on Lerobot Community Data
内容摘要
Hugging Face 发布开源、紧凑的 450M 视觉-语言-动作模型 SmolVLA,仅用 lerobot 标签下的社区开源数据预训练,在 LIBERO、Meta-World 仿真和 SO100/SO101 真实任务上超过更大 VLA 及 ACT 等基线。
内容分类AI 模型发布与更新
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源Hugging Face:Blog(RSS)
站内情报编号intel-8795070511c3e0bd8d3739ed