Hugging Face·· 2021-11-15AI 评分57
使用 Hugging Face Transformers 微调 XLS-R 进行低资源语音识别教程
Fine-Tune XLSR-Wav2Vec2 for low-resource ASR with 🤗 Transformers
AI 导读
Hugging Face 发布了使用 Transformers 库微调 XLS-R(Wav2Vec2 跨语言后继版本)进行低资源语音识别(ASR)的完整教程。指南以 Common Voice 土耳其语数据集为例,详细介绍了音频重采样至 16kHz、构建字符词表、配置 Wav2Vec2CTCTokenizer 与 Wav2Vec2FeatureExtractor 的流程。
来源:Hugging Face · huggingface.co