Hugging Face Blog·· 2024-11-26精选AI 评分75
Hugging Face 发布 SmolVLM 2B 多模态模型
SmolVLM - small yet mighty Vision Language Model
AI 导读
Hugging Face 发布 SmolVLM,一款 2B 参数、完全开源的视觉语言模型。该模型采用像素重排策略将视觉信息压缩 9 倍,在同等规模下显存占用最低且推理速度最快。提供 Base、Synthetic 和 Instruct 三个版本,支持本地部署与微调。
推荐理由
SmolVLM 通过像素重排策略大幅压缩视觉 Token,在同等规模下实现更低的显存占用和更高的推理速度。
来源:Hugging Face Blog · huggingface.co