XTTS-v2 coqui

类型
model
任务
text-to-speech
框架
coqui
下载量
8,759,330
点赞
3,731
访问
public
文件
0

标签

  • 语音合成
  • 音频生成
  • 语音克隆
  • 多语言
  • 语音
  • 生成式AI
  • 深度学习

摘要

XTTS-v2 是 Coqui 推出的多语言语音合成模型,只需 6 秒音频片段即可克隆说话人音色,无需大量训练数据。支持 17 种语言、跨语言语音克隆、情感与风格迁移,采样率为 24kHz。适用于语音克隆、多语言语音生成、有声内容制作及实时语音对话等场景。

README

--- license: other license_name: coqui-public-model-license license_link: https://coqui.ai/cpml library_name: coqui pipeline_tag: text-to-speech widget: - text: "Once when I was six years old I saw a magnificent picture" --- # ⓍTTS ⓍTTS 是一个语音生成模型,只需使用一个短短 6 秒的音频片段,就能将声音克隆成不同语言。无需大量跨越无数小时的训练数据。 这与为 …

查看完整页面 · 查看原文