wespeaker-voxceleb-resnet34-LM pyannote

类型
model
框架
pyannote-audio
下载量
7,106,805
点赞
161
访问
public
文件
0

标签

  • 语音
  • 说话人识别
  • 说话人验证
  • 说话人分离
  • 文本嵌入
  • 音频数据处理
  • PyTorch
  • 语音识别

摘要

该模型是 WeSpeaker 预训练说话人嵌入模型 wespeaker-voxceleb-resnet34-LM 的 pyannote.audio 封装,用于从音频中提取固定维度的说话人嵌入向量。核心能力是通过余弦距离衡量不同说话人的相似度,支持整段、片段及滑动窗口三种提取方式,可在 CPU/GPU 上运行。适用于说话人验证、说话人识别及说话人分离等下游任务。

README

--- tags: - pyannote - pyannote-audio - pyannote-audio-model - wespeaker - audio - voice - speech - speaker - speaker-recognition - speaker-verification - speaker-identification - speaker-embedding datasets: - voxceleb license: cc-by-4.0 inference: false --- Using this open-source model in producti…

查看完整页面 · 查看原文