Hugging Face Blog·· 2021-11-15AI 评分30
使用 🤗 Transformers 微调 XLSR-Wav2Vec2 进行低资源语音识别
Fine-Tune XLSR-Wav2Vec2 for low-resource ASR with 🤗 Transformers
AI 导读
Hugging Face 发布教程,演示如何使用 🤗 Transformers 微调 XLSR-Wav2Vec2 模型进行低资源自动语音识别。XLS-R 模型在 128 种语言、近 50 万小时音频上预训练,提供 300M 至 2B 参数版本。教程以 Common Voice 土耳其语数据集为例,展示通过连接时序分类(CTC)进行微调及词错误率评估的具体步骤。
来源:Hugging Face Blog · huggingface.co