ChatTTS-UI 上手指南:5 分钟搭起本地语音合成服务与 TTS API

ChatTTS-UI 上手指南:5 分钟搭起本地语音合成服务与 TTS API ChatTTS-UI 上手指南5 分钟搭起本地语音合成服务与 TTS API【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-uiChatTTS-UI 是一个本地文字转语音方案跑在你自己电脑上浏览器打开网页输入中英文混合文本就能得到语音同一端口还暴露 REST API你的系统发一个 HTTP 请求就能合成语音。想快速搭起语音合成服务或想把 TTS 能力接进自己应用的都能按这篇从 0 走到线上。本地语音合成部署步骤Windows 预打包版快速上手 这一节帮你解决最耗时的环境准备不装 Python不管依赖。从项目 Releases 页下载压缩包解压到任意目录。双击app.exe浏览器自动打开http://127.0.0.1:9966这个页面就是语音合成界面。首次启动会自动下载约 2GB 模型优先走魔塔 ModelScope失败再换 Hugging FaceModelScope 不支持代理平时挂代理的先关掉再启动。个别安全软件会误报看到提示选择放行或改用源码部署。英伟达显卡显存大于 4G 且装了 CUDA 12.8 时自动启用 GPU 加速否则跑 CPU。想在 Linux/macOS 上跑或者要改代码源码部署和 Docker 都可以差异与适用场景见从本地到线上一节。生成第一条语音界面 3 步 一次 API 调用这一节帮你解决它到底怎么用在浏览器里产出一条音频或用代码合成一次。界面操作只需 3 步在左侧文本框输入文字。中英文、数字混排时勾选中英分词数字会按语言转成文字读法123 → 一二三 / one two three。右侧选音色内置数字音色如 2222或speaker/目录下的 csv/pt 文件在自定义音色值填大于 1 的数字可随机抽取一个音色。点击生成列表里出现音频文件直接试听、下载。要接进程序POST 一次/tts即可import requests res requests.post(http://127.0.0.1:9966/tts, data{ text: 你好这是第一条由 ChatTTS-UI 合成的语音, voice: 2222, temperature: 0.3, speed: 5 }) print(res.json()) # {code: 0, msg: ok, audio_files: [{filename, url}]}返回code: 0即成功audio_files里的url就是 wav 下载地址。TTS 参数怎么调让声音更自然这一节帮你解决声音听着发闷、不会调的问题先按场景选一组再微调。场景 → 参数组合场景temperaturetop_pspeedskip_refine听感清晰播报清单、通知0.20.860稳定波动小自然对话旁白、助手0.50.941更人味节奏活常用参数一览参数取值作用voice数字或音色文件名音色数字是种子文件名是固定音色custom_voice大于 1 的整数自定义音色种子优先于voicetemperature0.00001-1.0采样随机度越低越稳top_p0.1-0.9核采样宽度top_k1-20采样候选数speed1-9语速默认 5skip_refine0/11 跳过文本精修出音更快prompt[oral_2][laugh_0][break_6]控制符重音、笑声、停顿音色文件三句话csv 或 pt 文件放进speaker/目录界面即列出调 API 时把文件名当voice传。0.96 版内核升级后旧 pt 需转换执行python cover-pt.py输出为-covert.pt。同一音色种子在不同机器上声音可能不同同机器多次生成也可能有细微变化属正常现象。从本地到线上何时用源码部署何时用容器这一节帮你解决预打包只能自己用怎么给别人用两条路线适用场景不同。源码部署适合要改代码、接本地 GPU、固定环境的场合Python 用 3.9-3.11git clone https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui cd ChatTTS-ui python3 -m venv venv source venv/bin/activate pip3 install -r requirements.txt pip3 install torch2.7.1 torchaudio2.7.1 python3 app.py容器化适合云服务器与交付免装 Python 环境compose 一条命令起服务GPU 机器用 gpu 配置纯 CPU 机器用 cpu 配置docker compose -f docker-compose.gpu.yaml up -d两种方式启动后把.env里的WEB_ADDRESS改成机器局域网 IP如192.168.0.10:9966其他设备即可用浏览器打开页面或调 API。显存不足 4G 时会自动回退 CPU无需额外配置。TTS 常见报错速查这一节帮你解决报错了怎么办按关键字对表表里没有的去 faq.md 查全量。现象一行解法Dynamo is not supported on Python 3.12换 Python 3.103.9-3.11 均可Missing spk_stat.pt补下该文件放入models/pzc163/chatTTS/asset/Windows not yet supported for torch.compile加载参数改为compileFalse, devicecpu下载模型报 proxy 错误ModelScope 不走代理关代理重试cannot find a working triton installation.env中compiletrue改为compilefalseNormalizer pynini/WeTextProcessing报错注释ChatTTS/core.py143 行附近的文本归一化代码macOS 卡 0% 或libomp报错brew install libomp装不上 soundfile 再brew install libsndfile需要完全离线使用先联网跑一次把模型缓存下来之后启动自动用本地文件下一步接进你自己的系统走到这里你的本地服务已经在跑了。建议先写个小脚本调一次/tts确认audio_files里的url能正常下载 wav验证通过后再把业务里的文本生成环节接到这个请求上。跑稳之后把这套服务原样部署到服务器所有客户端就共用这一套语音合成能力。【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考