363 Star!开箱即用的增强版 ChatTTS 一键整合包
来源:互联网
时间:2026-08-23 13:42:42
此前试玩过ChatTTS语音大模型,从部署到接入Dify,整个过程还算流畅——尽管Dify那边只能展示生成的文件路径。
不过说实话,前期的准备工作确实不少:得安装各种依赖、拉取源码、折腾虚拟环境……一套流程下来,耐心差点磨平。好在开源社区总有能人站了出来,搞了一款ChatTTS本地离线整合包,名为ChatTTS-Enhanced,直接推到了Github上。说白了就是帮你解决“最后三公里”问题——明白吗?一键整合包,免去从零折腾。
这个项目现在提供Windows和MacOS两种系统的安装包,完全是傻瓜式操作:下载、运行、双击打开,增强版的ChatTTS就启动起来了。

目前整合包已迭代到V3版本,亮点还是比较明显的:
- 音质增强/降噪,直接解决ChatTTS生成中的噪音问题,自动降噪、音质干净
- 支持TXT、SRT文件批量处理,不用一个文件一个文件单独跑
- 支持长文本处理,中文英文混读都可以,还能自定义切割长度
- 支持导出SRT字幕文件,方便后期剪辑整合
- 支持调节语速、停顿、笑声、口语化程度等参数,灵活适配不同场景
- 支持导入ChatTTS Speaker音色,具体操作在帮助里都有说明
- 支持保存音色配置与选项配置,方便后续管理
那么长文本的效果到底怎么样?不妨直接听听看:

刚听到的时候会觉得有些杂音——别急,这是没开启音质增强的效果。打开音质增强之后,杂音就基本消失,干净得让人放心。
关于音色定制这块,如果想指定一个固定的音色进行生成,可以先到音色库(ModelScope音色库)里找一个听着顺眼的,然后下载对应的pt文件:

下载完成之后,在这个界面把文件上传即可。

对于靠硬算吃饭的模型来说,硬件门槛自然是绕不开的话题。V3版整合包对系统的要求如下:
- Windows:需要Win10/11,支持CPU和GPU两种模式
- MacOS:不管是M芯片还是Intel芯片,系统版本必须不低于10.13
显存方面,如果不开启音质增强,最低4G显存就够跑。而Mac版本目前只做了CPU适配——作者提到显存适配还有点小问题,还需再优化。
如果手头的配置确实比较吃力,作者还提供云端一键部署方案。除了语音整合包之外,也有一些其他有意思的整合包可以关注。
-
- 关于宇宙的好的网名有哪些
- 角色扮演 | 1
- 网名