- 戳上方蓝字�?牛皮糖不吹牛*”关注我
大家好,我是牛皮糖!F5-TTS 是一个基于流量匹配的文本到语音系统,旨在生成流畅且忠实的语音,特别适合童话故事机。它采用�?ConvNeXt V2 和扩散变换器,提升了训练和推理的速度�?
安装
你可以选择以下几种方式进行安装�?
- pip 包:直接安装用于推断�?
1 | `pip install git+https://github.com/SWivid/F5-TTS.git` |
- 局部可编辑:便于进行训练和微调�?
1 | `git clone https://github.com/SWivid/F5-TTS.git |
- Docker 使用:可以构建或�?GitHub Container Registry 拉取镜像�?
推理
支持 Gradio 应用程序�?CLI 推理,能够实现多风格和多说话人生成,并提供语音聊天功能�?
训练与评�?
你对着公众号私�?F5”就自动有下载链接了�?
并且相比于原版的UI,我们也给大家做了汉化,方便大家使用(其实是我自己看不懂英语。。。)
首先下载完,解压压缩包,得到完整目录如下�?
然后点击 一键运�?bat,终端会自动跳出�?
稍等片刻,即可看到一个链接�?
按住Ctrl 并单击进行访问,就能进到F5的界面里面了�?
点击上传参考音频,即我们想要克隆的人的音频,音频不是越长越好,一定得15秒以下才行�?
项目地址�?
https://github.com/SWivid/F5-TTS
·················END·················
推荐阅读
•�? github 95.5k Star 的项目集合地•�? 4�?16G 就能 RAGFlow Quick start 快速入门• github 7.8k star 将小爱音箱接�?ChatGPT 和豆包,改造成你的专属语音助手。
**
**