Kokoro-82M hexgrad

类型
model
任务
text-to-speech
下载量
12,326,093
点赞
6,697
访问
public
文件
0

标签

  • 语音合成
  • 文本生成
  • 轻量级
  • 生成式AI
  • 本地部署
  • 深度学习
  • 多语言
  • 音频生成

摘要

Kokoro-82M 是一个仅8200万参数的轻量级开源TTS(语音合成)模型,基于 StyleTTS2 架构,以极低成本提供媲美大模型的语音质量。它支持多语言多音色,训练数据均为许可/非版权音频,采用 Apache-2.0 许可,可广泛用于生产环境与个人项目。适合需要快速、低成本文本转语音的应用场景。

README

--- license: apache-2.0 language: - en base_model: - yl4579/StyleTTS2-LJSpeech pipeline_tag: text-to-speech --- **Kokoro** 是一款拥有 8200 万参数的开源权重 TTS 模型。尽管其架构轻量,它仍能提供与更大模型相媲美的质量,同时速度显著更快、成本效益更高。Kokoro 采用 Apache 许可权重,可部署于从生产环境到个人项目的任何场景。 <audio controls><source src="https://huggingface.co/hexgrad/Kokor…

查看完整页面 · 查看原文