wav2vec2-large-xlsr-53-russian jonatasgrosman

类型
model
任务
automatic-speech-recognition
框架
transformers
下载量
4,032,524
点赞
76
访问
public
文件
0

标签

  • 语音识别
  • 自动语音识别
  • 语音
  • 多语言
  • transformers
  • PyTorch
  • NLP
  • 微调

摘要

这是基于facebook/wav2vec2-large-xlsr-53在俄语Common Voice和CSS10数据上微调的大规模语音识别模型,用于将俄语语音转换为文本。模型在Common Voice测试集上达到13.3%的词错误率和2.88%的字符错误率,结合语言模型后可进一步降至9.57%。适用于需要俄语自动转录的各种场景,如会议记录、字幕生成和语音交互应用,可通过HuggingSound库直接调用。

README

--- language: ru license: apache-2.0 datasets: - common_voice - mozilla-foundation/common_voice_6_0 metrics: - wer - cer tags: - audio - automatic-speech-recognition - hf-asr-leaderboard - mozilla-foundation/common_voice_6_0 - robust-speech-event - ru - speech - xlsr-fine-tuning-week model-index: -…

查看完整页面 · 查看原文