Parler TTS-开源高质量文本转语音 (TTS) 模型

分享
24年4月15日
编辑

QBZ🇨🇳可恶のQBZ

Parler TTS是一个轻量级的开源高质量文本转语音 (TTS) 模型，可以以给定说话者的风格（性别、音调、说话风格等）生成高质量、自然流畅的语音。它是根据Dan Lyth和Simon King在Stability AI和Edinburgh University发表的论文《Natural language guidance of high-fidelity text-to-speech with synthetic annotations》的工作进行的复现，与其他TTS模型不同，Parler-TTS是一个完全开源的发布版本，所有的数据集、预处理、训练代码和权重都以宽松的许可证公开发布，感兴趣的同学可以在线体验。

文本转语音 (TTS) 模型

github:https://github.com/huggingface/parler-tts

声明：本站所有文章，如无特殊说明或标注，均为本站原创发布。任何个人或组织，在未征得本站同意时，禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益，可联系我们进行处理。

{{userData.name}}已认证

文本转语音 (TTS) 模型