首页 > 教程攻略 > ai资讯 >363 Star!开箱即用的增强版 ChatTTS 一键整合包

363 Star!开箱即用的增强版 ChatTTS 一键整合包

来源:互联网 时间:2026-08-23 13:42:42

此前试玩过ChatTTS语音大模型,从部署到接入Dify,整个过程还算流畅——尽管Dify那边只能展示生成的文件路径。

不过说实话,前期的准备工作确实不少:得安装各种依赖、拉取源码、折腾虚拟环境……一套流程下来,耐心差点磨平。好在开源社区总有能人站了出来,搞了一款ChatTTS本地离线整合包,名为ChatTTS-Enhanced,直接推到了Github上。说白了就是帮你解决“最后三公里”问题——明白吗?一键整合包,免去从零折腾。

Github地址:https://github.com/CCmahua/ChatTTS-Enhanced

这个项目现在提供Windows和MacOS两种系统的安装包,完全是傻瓜式操作:下载、运行、双击打开,增强版的ChatTTS就启动起来了。

363 Star!开箱即用的增强版 ChatTTS 一键整合包

目前整合包已迭代到V3版本,亮点还是比较明显的:

  • 音质增强/降噪,直接解决ChatTTS生成中的噪音问题,自动降噪、音质干净
  • 支持TXT、SRT文件批量处理,不用一个文件一个文件单独跑
  • 支持长文本处理,中文英文混读都可以,还能自定义切割长度
  • 支持导出SRT字幕文件,方便后期剪辑整合
  • 支持调节语速、停顿、笑声、口语化程度等参数,灵活适配不同场景
  • 支持导入ChatTTS Speaker音色,具体操作在帮助里都有说明
  • 支持保存音色配置与选项配置,方便后续管理

那么长文本的效果到底怎么样?不妨直接听听看:

音频示例

刚听到的时候会觉得有些杂音——别急,这是没开启音质增强的效果。打开音质增强之后,杂音就基本消失,干净得让人放心。

关于音色定制这块,如果想指定一个固定的音色进行生成,可以先到音色库(ModelScope音色库)里找一个听着顺眼的,然后下载对应的pt文件:

音色下载页面

下载完成之后,在这个界面把文件上传即可。

上传音色界面

对于靠硬算吃饭的模型来说,硬件门槛自然是绕不开的话题。V3版整合包对系统的要求如下:

  • Windows:需要Win10/11,支持CPU和GPU两种模式
  • MacOS:不管是M芯片还是Intel芯片,系统版本必须不低于10.13

显存方面,如果不开启音质增强,最低4G显存就够跑。而Mac版本目前只做了CPU适配——作者提到显存适配还有点小问题,还需再优化。

如果手头的配置确实比较吃力,作者还提供云端一键部署方案。除了语音整合包之外,也有一些其他有意思的整合包可以关注。