跳到正文
原文
Hugging Face Blog·· 2025-04-11AI 评分42

Visual Salamandra:基于7B参数实现多模态理解的开源模型

Visual Salamandra: Pushing the Boundaries of Multimodal Understanding

AI 导读

Language Technologies Lab 发布 Visual Salamandra,将 Salamandra 大语言模型扩展至图像和视频理解。该 7B 参数模型集成 SigLIP 编码器,支持视觉问答、OCR 及视频处理。模型基于 Apache License, Version 2.0 开源,适用于研究及非商业用途。

来源:Hugging Face Blog · huggingface.co