XTTS-v2 coqui
- 種別
- model
- タスク
- text-to-speech
- フレームワーク
- coqui
- ダウンロード
- 8,759,330
- いいね
- 3,731
- アクセス
- public
- ファイル
- 0
タグ
- 音声合成
- 音声生成
- ボイスクローン
- テキスト読み上げ
- 多言語
- 生成AI
- 深層学習
概要
XTTS-v2は、わずか6秒の音声クリップから話者の声をクローンし、多言語で音声を合成できる音声生成モデルです。17言語に対応し、感情やスタイルの転写、異言語間の声のクローン、複数話者の補間も可能です。大量の学習データを必要とせず、Coqui StudioやCoqui APIの基盤モデルとして利用されています。多言語音声合成やボイスクローン用途に適しています。
README
--- license: other license_name: coqui-public-model-license license_link: https://coqui.ai/cpml library_name: coqui pipeline_tag: text-to-speech widget: - text: "Once when I was six years old I saw a magnificent picture" --- # ⓍTTS ⓍTTSは、わずか6秒の音声クリップを使用するだけで、声を異なる言語にクローンできる音声生成モデルです。何時間にも及ぶ膨大なトレーニン…