Hugging Face Blog·· 2025-07-23精选AI 评分75
TimeScope 开源长视频多模态模型评测基准
TimeScope: How Long Can Your Video Large Multimodal Model Go?
AI 导读
Hugging Face 发布 TimeScope 开源基准,通过向 1 分钟至 8 小时的长视频中插入短片段,评估模型在局部检索、信息综合和细粒度时序感知方面的能力。评测显示,尽管 Gemini 2.5-Pro 在长视频上表现优异,但多数模型在时序推理上仍面临挑战,且模型规模并非决定长视频理解能力的唯一因素。
推荐理由
通过插入视频片段评估长视频理解能力,揭示了当前模型在时序推理上的局限。
来源:Hugging Face Blog · huggingface.co