Hugging Face Blog·· 2025-06-03精选AI 评分62
Hugging Face 发布 SmolVLA:450M 开源视觉-语言-动作模型
SmolVLA: Efficient Vision-Language-Action Model trained on Lerobot Community Data
AI 导读
Hugging Face 发布 SmolVLA,一个 450M 参数的开源视觉-语言-动作(VLA)模型,可在 CPU、单张消费级 GPU 甚至 MacBook 上运行,仅用 lerobot 标签下社区共享数据集预训练。
推荐理由
450M 参数、消费级硬件可跑的开源 VLA,用不到 3 万条社区数据在仿真与真机上追平更大模型,并给出异步推理带来的速度差异。
来源:Hugging Face Blog · huggingface.co