wav2vec2-large-xlsr-53-portuguese jonatasgrosman

类型
model
任务
automatic-speech-recognition
框架
transformers
下载量
5,005,961
点赞
55
访问
public
文件
0

标签

  • 语音识别
  • 自动语音识别
  • 语音
  • 音频数据处理
  • transformers
  • PyTorch
  • 微调
  • 多语言

摘要

该模型在Common Voice葡萄牙语数据集上对facebook/wav2vec2-large-xlsr-53进行微调,用于自动语音识别(ASR)。模型支持16kHz采样的语音输入,可直接输出葡语转写文本,并可选结合语言模型提升识别精度(测试WER约11.31%)。适用于葡萄牙语语音转文字、字幕生成等场景。

README

--- language: pt license: apache-2.0 datasets: - common_voice - mozilla-foundation/common_voice_6_0 metrics: - wer - cer tags: - audio - automatic-speech-recognition - hf-asr-leaderboard - mozilla-foundation/common_voice_6_0 - pt - robust-speech-event - speech - xlsr-fine-tuning-week model-index: -…

查看完整页面 · 查看原文