wespeaker-voxceleb-resnet34-LM pyannote
- 类型
- model
- 框架
- pyannote-audio
- 下载量
- 7,106,805
- 点赞
- 161
- 访问
- public
- 文件
- 0
标签
- 语音
- 说话人识别
- 说话人验证
- 说话人分离
- 文本嵌入
- 音频数据处理
- PyTorch
- 语音识别
摘要
该模型是 WeSpeaker 预训练说话人嵌入模型 wespeaker-voxceleb-resnet34-LM 的 pyannote.audio 封装,用于从音频中提取固定维度的说话人嵌入向量。核心能力是通过余弦距离衡量不同说话人的相似度,支持整段、片段及滑动窗口三种提取方式,可在 CPU/GPU 上运行。适用于说话人验证、说话人识别及说话人分离等下游任务。
README
--- tags: - pyannote - pyannote-audio - pyannote-audio-model - wespeaker - audio - voice - speech - speaker - speaker-recognition - speaker-verification - speaker-identification - speaker-embedding datasets: - voxceleb license: cc-by-4.0 inference: false --- Using this open-source model in producti…