跳到正文
原文
Hugging Face Blog·· 2025-08-12AI 评分27

FilBench 发布:评估 LLM 理解与生成菲律宾语的能力

🇵🇭 FilBench - Can LLMs Understand and Generate Filipino?

AI 导读

Hugging Face 发布 FilBench,系统评估 LLM 在 Tagalog、Filipino 和 Cebuano 等菲律宾语言上的表现。评测涵盖文化、NLP、阅读理解和生成四大类,结果显示 GPT-4o 表现最佳,而 SEA-LION 等区域模型在参数效率上具有优势。开源模型在成本效益上优于商业模型,但翻译任务仍是主要难点。

来源:Hugging Face Blog · huggingface.co