wav2vec2-large-xlsr-53-japanese jonatasgrosman
- 类型
- model
- 任务
- automatic-speech-recognition
- 框架
- transformers
- 下载量
- 5,871,565
- 点赞
- 62
- 访问
- public
- 文件
- 0
标签
- 语音识别
- 自动语音识别
- 语音
- transformers
- NLP
- 深度学习
- PyTorch
- 多语言
摘要
该模型是在日语数据上微调的 wav2vec2-large-xlsr-53,用于将16kHz日语语音转录为文本,属于自动语音识别(CTC)任务。它在 Common Voice 6.1、CSS10 和 JSUT 数据集上训练,可直接通过 transformers 或 HuggingSound 库调用。适用于日语语音转写场景,测试 WER/CER 分别为 81.80% 和 20.16%。
README
--- language: ja datasets: - common_voice metrics: - wer - cer tags: - audio - automatic-speech-recognition - speech - xlsr-fine-tuning-week license: apache-2.0 model-index: - name: XLSR Wav2Vec2 Japanese by Jonatas Grosman results: - task: name: Speech Recognition type: automatic-speech-recognitio…