speaker-diarization-3.1 pyannote
- 種別
- model
- タスク
- automatic-speech-recognition
- フレームワーク
- pyannote-audio
- ダウンロード
- 9,385,573
- いいね
- 3,071
- アクセス
- gated
- ファイル
- 0
タグ
- 音声認識
- 話者分離
- 音声処理
- 機械学習
- 推論
- pyannote
概要
音声から「誰がいつ話したか」を自動的に判別する話者ダイアライゼーション(話者分離)モデルです。音声認識の前処理として、複数話者の会議・インタビュー・ポッドキャストなどを話者ごとに分割する用途に適しています。pyannote-audio フレームワーク上で動作し、高い精度で話者の区別とタイムスタンプ付与を行います。