Github 开源现在最好的TTS声音克隆

  • 戳上方蓝字�?牛皮糖不吹牛*”关注我

    大家好,我是牛皮糖!F5-TTS 是一个基于流量匹配的文本到语音系统,旨在生成流畅且忠实的语音,特别适合童话故事机。它采用�?ConvNeXt V2 和扩散变换器,提升了训练和推理的速度�?

安装

你可以选择以下几种方式进行安装�?

  • pip 包:直接安装用于推断�?
1
`pip install git+https://github.com/SWivid/F5-TTS.git`
  • 局部可编辑:便于进行训练和微调�?
1
2
3
`git clone https://github.com/SWivid/F5-TTS.git
cd F5-TTS
pip install -e .`
  • Docker 使用:可以构建或�?GitHub Container Registry 拉取镜像�?

推理

支持 Gradio 应用程序�?CLI 推理,能够实现多风格和多说话人生成,并提供语音聊天功能�?

训练与评�?

你对着公众号私�?F5”就自动有下载链接了�?

并且相比于原版的UI,我们也给大家做了汉化,方便大家使用(其实是我自己看不懂英语。。。)
首先下载完,解压压缩包,得到完整目录如下�?

然后点击  一键运�?bat,终端会自动跳出�?
稍等片刻,即可看到一个链接�?

按住Ctrl 并单击进行访问,就能进到F5的界面里面了�?

点击上传参考音频,即我们想要克隆的人的音频,音频不是越长越好,一定得15秒以下才行�?


项目地址�?

https://github.com/SWivid/F5-TTS

·················END·················

推荐阅读

•�? github 95.5k Star 的项目集合地•�? 4�?16G 就能 RAGFlow Quick start 快速入门•   github 7.8k star 将小爱音箱接�?ChatGPT 和豆包,改造成你的专属语音助手。

**
**