一个轻量级的开源高质量文本转语音 (TTS) 模型,可以以给定说话者的风格(性别、音调、说话风格等)生成高质量、自然流畅的语音。它是根据 Dan Lyth 和 Simon King 在 Stability AI 和 Edinburgh University 发表的论文《Natural language guidance of high-fidelity text-to-speech with synthetic annotations》的工作进行的复现,与其他 TTS 模型不同,Parler-TTS 是一个完全开源的发布版本,所有的数据集、预处理、训练代码和权重都以宽松的许可证公开发布,感兴趣的同学可以在线体验。

demo地址:https://www.text-description-to-speech.com/

release地址:https://huggingface.co/parler-tts/parler_tts_mini_v0.1

GitHub地址:https://github.com/huggingface/parler-tts

历史上的今天
04月
23
    抱歉,历史上的今天作者很懒,什么都没写!
声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。