跳到正文
原文
Hugging Face Blog·· 2025-04-16AI 评分47

HELMET:全面评估长上下文语言模型

Introducing HELMET: Holistically Evaluating Long-context Language Models

AI 导读

HELMET 发布,旨在全面评估长上下文语言模型(LCLM)。该基准测试评估了 59 款模型,发现前沿 LCLM 在复杂任务上仍受限。文章提供了使用 HuggingFace 库、TGI、vLLM 及 API 运行基准的快速入门指南。

来源:Hugging Face Blog · huggingface.co