跳到正文
原文
Hugging Face Blog·· 2025-07-23精选AI 评分75

TimeScope 开源长视频多模态模型评测基准

TimeScope: How Long Can Your Video Large Multimodal Model Go?

AI 导读

Hugging Face 发布 TimeScope 开源基准,通过向 1 分钟至 8 小时的长视频中插入短片段,评估模型在局部检索、信息综合和细粒度时序感知方面的能力。评测显示,尽管 Gemini 2.5-Pro 在长视频上表现优异,但多数模型在时序推理上仍面临挑战,且模型规模并非决定长视频理解能力的唯一因素。

推荐理由

通过插入视频片段评估长视频理解能力,揭示了当前模型在时序推理上的局限。

来源:Hugging Face Blog · huggingface.co