跳到正文
原文
Hugging Face Blog·· 2024-11-26精选AI 评分75

Hugging Face 发布 SmolVLM 2B 多模态模型

SmolVLM - small yet mighty Vision Language Model

AI 导读

Hugging Face 发布 SmolVLM,一款 2B 参数、完全开源的视觉语言模型。该模型采用像素重排策略将视觉信息压缩 9 倍,在同等规模下显存占用最低且推理速度最快。提供 Base、Synthetic 和 Instruct 三个版本,支持本地部署与微调。

推荐理由

SmolVLM 通过像素重排策略大幅压缩视觉 Token,在同等规模下实现更低的显存占用和更高的推理速度。

来源:Hugging Face Blog · huggingface.co