跳到正文
原文
Hugging Face Blog·· 2025-06-03精选AI 评分78

Hugging Face 发布 SmolVLA 开源视觉语言动作模型

SmolVLA: Efficient Vision-Language-Action Model trained on Lerobot Community Data

AI 导读

Hugging Face 发布 SmolVLA,一款450M参数的开源视觉语言动作模型,可在消费级硬件上运行。该模型基于 LeRobot 社区数据预训练,支持异步推理,响应速度提升30%,任务吞吐量翻倍,在仿真和真实世界任务中表现优异。

推荐理由

开源450M视觉语言动作模型,利用异步推理实现30%提速,可在消费级硬件上运行。

来源:Hugging Face Blog · huggingface.co