wav2vec2-large-xlsr-53-russian jonatasgrosman
- 类型
- model
- 任务
- automatic-speech-recognition
- 框架
- transformers
- 下载量
- 4,032,524
- 点赞
- 76
- 访问
- public
- 文件
- 0
标签
- 语音识别
- 自动语音识别
- 语音
- 多语言
- transformers
- PyTorch
- NLP
- 微调
摘要
这是基于facebook/wav2vec2-large-xlsr-53在俄语Common Voice和CSS10数据上微调的大规模语音识别模型,用于将俄语语音转换为文本。模型在Common Voice测试集上达到13.3%的词错误率和2.88%的字符错误率,结合语言模型后可进一步降至9.57%。适用于需要俄语自动转录的各种场景,如会议记录、字幕生成和语音交互应用,可通过HuggingSound库直接调用。
README
--- language: ru license: apache-2.0 datasets: - common_voice - mozilla-foundation/common_voice_6_0 metrics: - wer - cer tags: - audio - automatic-speech-recognition - hf-asr-leaderboard - mozilla-foundation/common_voice_6_0 - robust-speech-event - ru - speech - xlsr-fine-tuning-week model-index: -…