XTTS-v2 coqui
- 类型
- model
- 任务
- text-to-speech
- 框架
- coqui
- 下载量
- 8,759,330
- 点赞
- 3,731
- 访问
- public
- 文件
- 0
标签
- 语音合成
- 音频生成
- 语音克隆
- 多语言
- 语音
- 生成式AI
- 深度学习
摘要
XTTS-v2 是 Coqui 推出的多语言语音合成模型,只需 6 秒音频片段即可克隆说话人音色,无需大量训练数据。支持 17 种语言、跨语言语音克隆、情感与风格迁移,采样率为 24kHz。适用于语音克隆、多语言语音生成、有声内容制作及实时语音对话等场景。
README
--- license: other license_name: coqui-public-model-license license_link: https://coqui.ai/cpml library_name: coqui pipeline_tag: text-to-speech widget: - text: "Once when I was six years old I saw a magnificent picture" --- # ⓍTTS ⓍTTS 是一个语音生成模型,只需使用一个短短 6 秒的音频片段,就能将声音克隆成不同语言。无需大量跨越无数小时的训练数据。 这与为 …