Hugging Face Blog·· 2025-04-16AI 评分47
HELMET:全面评估长上下文语言模型
Introducing HELMET: Holistically Evaluating Long-context Language Models
AI 导读
HELMET 发布,旨在全面评估长上下文语言模型(LCLM)。该基准测试评估了 59 款模型,发现前沿 LCLM 在复杂任务上仍受限。文章提供了使用 HuggingFace 库、TGI、vLLM 及 API 运行基准的快速入门指南。
来源:Hugging Face Blog · huggingface.co