Hugging Face Blog·· 2025-06-03精选AI 评分78
Hugging Face 发布 SmolVLA 开源视觉语言动作模型
SmolVLA: Efficient Vision-Language-Action Model trained on Lerobot Community Data
AI 导读
Hugging Face 发布 SmolVLA,一款450M参数的开源视觉语言动作模型,可在消费级硬件上运行。该模型基于 LeRobot 社区数据预训练,支持异步推理,响应速度提升30%,任务吞吐量翻倍,在仿真和真实世界任务中表现优异。
推荐理由
开源450M视觉语言动作模型,利用异步推理实现30%提速,可在消费级硬件上运行。
来源:Hugging Face Blog · huggingface.co