资讯详情

如何快速跑起免费本地文字转语音:ChatTTS-ui完整部署指南

📅 2026/9/20 15:58:56 | 华诺云谱 👁 阅读
如何快速跑起免费本地文字转语音:ChatTTS-ui完整部署指南
如何快速跑起免费本地文字转语音ChatTTS-ui完整部署指南【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui你想给短视频配音又不想按字付API费用。ChatTTS-ui本地部署就能解决在浏览器里把文字合成语音全程免费。它基于ChatTTS模型还带一个现成的API接口。音频文件存在你自己电脑上不经过任何在线服务。项目速览一个网页搞定文字转语音ChatTTS-ui是一个简单的本地网页工具。后端是 app.py 里的Flask服务前端就一个 templates/index.html。它支持中英文、数字混杂输入也提供/tts接口给程序调用。适合做配音视频的人、想集成语音功能的开发者以及要求离线隐私的用户。核心能力网页输入文字直接出wav音频中英数字混排没问题内置几个音色种子也能填数字自定义音色支持[laugh_0][break_6]这类控制符能加笑声、停顿可导入txt按行批量合成v0.5提供POST /tts的REST接口运行环境一览先看下表对号入座再动手。项目最低配置推荐配置系统Windows / macOS / Linux同左Python源码部署3.9不支持3.12及以上3.10 / 3.11计算设备普通CPU即可跑英伟达显卡显存大于4GCUDA不需要CUDA 12.8才能启用GPU加速磁盘留够下载模型的空間同左模型首次启动自动下载显存低于4G会强制走CPU能跑但慢。这是文档里写明的规则。最简部署路径Linux源码下面是Linux源码部署步骤最少、最通用。准备好Python 3.9到3.11的环境。克隆代码到空目录mkdir -p /data/chattts cd /data/chattts git clone https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui .目录里出现app.py和requirements.txt即成功。建虚拟环境并装依赖python3 -m venv venv source ./venv/bin/activate pip3 install -r requirements.txt pip3 install torch2.7.1 torchaudio2.7.1没有装完会报import错误。要GPU加速就换cu128源安装torch并装好CUDA 12.8。启动服务python3 app.py浏览器自动打开http://127.0.0.1:9966看到输入框即成功。首次启动会联网下载模型从modelscope下载时要关闭代理。其他路径一句话带过Windows用户可从Releases下预打包版解压双击app.exe容器部署用docker compose -f docker-compose.gpu.yaml up -d或cpu版macOS照README.md的Homebrew步骤走。功能实操从第一句语音到批量导出合成第一句在顶部文本框输入文字点击「立即合成声音」。预期效果页面下方出现音频播放器可播放、下载wav文件保存在static/wavs目录。切换音色「选择音色」下拉框是内置固定音色「音色值」可以填大于1的整数比如3000会按这个种子随机取一个音色并保存。预期效果每次换个种子就是新声音。注意文档提醒不同设备同一音色值声音可能有差异音调变化尤其明显。加笑声和停顿在Prompt框填[oral_2][laugh_0][break_6]。合成效果不佳时可勾选「跳过refine text」。预期效果语音里出现口语化语气、笑声和停顿。调语速和随机度语速滑杆是1到9默认5temperature默认0.3top_p默认0.7top_k默认20。预期效果语速数字越大读得越快temperature越高声音越不可预测。导入txt批量合成点「导入txt」选择文本文件按行逐条合成。预期效果文件里每一行对应一段wav一次拿整批。让局域网设备访问打开.env文件把WEB_ADDRESS改成192.168.0.10:9966这类局域网地址重启服务。预期效果同网段其他设备用IP加9966端口就能打开页面。进阶技巧固定音色0.92版本支持想要每次都是同一个声音把csv或pt格式的音色文件放进 speaker/ 目录即可。预期效果下拉框里多出你的音色选它合成声音永远一致。调用/tts接口v0.5服务跑起来后任何程序都能POST请求http://127.0.0.1:9966/tts拿到音频。下面这段代码能直接跑通一次合成import requests res requests.post(http://127.0.0.1:9966/tts, data{ text: 你好这是一次本地合成, voice: 3333, temperature: 0.3, top_p: 0.7, top_k: 20, }) print(res.json())成功时返回code:0和音频的url字段直接把url下载即可。避坑指南下载模型报proxy相关错误现象报ProxyError或proxy类错误。原因默认从modelscope下载模型modelscope只允许中国大陆IP直连不能走代理。解决关闭代理后重试。有显卡却一直用CPU现象英伟达显卡运行却走CPU合成很慢。原因显存低于4G会强制CPU或者装的是CPU版torch。解决显存大于4G并装CUDA 12.8然后卸载torch重装cu128版本见README.md「部署注意」一节。报错Missing spk_stat.pt现象启动报缺少spk_stat.pt。原因modelscope仓库的模型少了这个文件。解决从Hugging Face的ChatTTS仓库下载spk_stat.pt放到models/pzc163/chatTTS/asset文件夹内。报错Dynamo is not supported on Python 3.12现象Python 3.12启动直接报错。原因项目不支持3.12及以上版本。解决换Python 3.10重建虚拟环境。同一音色种子声音却变了现象同一个音色值这次和上次声音不一样。原因种子音色是随机采样跨设备、跨次都可能变化音调尤甚。解决要求声音稳定就用固定音色文件放进speaker目录不再依赖种子。更多报错macOS的libomp、triton报错等见 faq.md逐条都有解法。下一步ChatTTS-ui让你免费、离线地拥有文字转语音能力网页和API两条路都通了。部署遇到新报错先翻 faq.md项目问题去仓库提Issue版本变化关注Releases发布页。【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
📝

华诺云谱内容团队

资深建站顾问 · 行业研究员

10年+企业数字化服务经验,专注智能建站、SEO优化与品牌营销,持续输出建站技巧、行业洞察与营销干货,已帮助5000+企业实现数字化增长。

你可能需要的服务

订阅华诺云谱资讯周报

每周一封,精选建站技巧、SEO与营销干货,直达邮箱。已有 8,000+ 企业主订阅,助你少走弯路。