XTTS-v2 coqui

種別
model
タスク
text-to-speech
フレームワーク
coqui
ダウンロード
8,759,330
いいね
3,731
アクセス
public
ファイル
0

タグ

  • 音声合成
  • 音声生成
  • ボイスクローン
  • テキスト読み上げ
  • 多言語
  • 生成AI
  • 深層学習

概要

XTTS-v2は、わずか6秒の音声クリップから話者の声をクローンし、多言語で音声を合成できる音声生成モデルです。17言語に対応し、感情やスタイルの転写、異言語間の声のクローン、複数話者の補間も可能です。大量の学習データを必要とせず、Coqui StudioやCoqui APIの基盤モデルとして利用されています。多言語音声合成やボイスクローン用途に適しています。

README

--- license: other license_name: coqui-public-model-license license_link: https://coqui.ai/cpml library_name: coqui pipeline_tag: text-to-speech widget: - text: "Once when I was six years old I saw a magnificent picture" --- # ⓍTTS ⓍTTSは、わずか6秒の音声クリップを使用するだけで、声を異なる言語にクローンできる音声生成モデルです。何時間にも及ぶ膨大なトレーニン…

查看完整页面 · 查看原文