跳到正文
原文
Hugging Face Blog·· 2021-11-15AI 评分30

使用 🤗 Transformers 微调 XLSR-Wav2Vec2 进行低资源语音识别

Fine-Tune XLSR-Wav2Vec2 for low-resource ASR with 🤗 Transformers

AI 导读

Hugging Face 发布教程,演示如何使用 🤗 Transformers 微调 XLSR-Wav2Vec2 模型进行低资源自动语音识别。XLS-R 模型在 128 种语言、近 50 万小时音频上预训练,提供 300M 至 2B 参数版本。教程以 Common Voice 土耳其语数据集为例,展示通过连接时序分类(CTC)进行微调及词错误率评估的具体步骤。

来源:Hugging Face Blog · huggingface.co