speaker-diarization-community-1 pyannote
- 类型
- model
- 任务
- automatic-speech-recognition
- 框架
- pyannote-audio
- 下载量
- 5,607,397
- 点赞
- 1,029
- 访问
- gated
- 文件
- 0
标签
- 说话人分离
- 语音识别
- 自动语音识别
- 音频数据处理
- 语音
- PyTorch
- 深度学习
摘要
该模型用于说话人分离(Speaker Diarization),能自动识别并标注一段音频中"谁在什么时间说话",将语音按不同说话人切分并打上标签。基于 pyannote-audio 框架,属于社区版(community)模型,适用于会议记录转写、访谈分析、多说话人语音场景下的前置处理,常与自动语音识别配合使用。