跳到正文
原文
Hugging Face·· 2025-06-03精选AI 评分72

Hugging Face 发布开源轻量机器人模型 SmolVLA

SmolVLA: Efficient Vision-Language-Action Model trained on Lerobot Community Data

AI 导读

Hugging Face 推出 450M 参数的开源机器人视觉-语言-动作模型 SmolVLA,可直接在消费级硬件及 CPU 上运行。该模型完全基于 LeRobot 社区开源数据集预训练,结合 SmolVLM2 与流匹配动作专家架构,并通过视觉 token 压缩和层跳过优化推理延迟。

推荐理由

该模型展示了基于轻量架构与低成本社区数据训练机器人策略的路径,显著降低了具身智能的硬件门槛。

来源:Hugging Face · huggingface.co