5分钟部署本地文字转语音:ChatTTS-ui网页界面与API完整指南

5分钟部署本地文字转语音:ChatTTS-ui网页界面与API完整指南 5分钟部署本地文字转语音ChatTTS-ui网页界面与API完整指南【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui想把文章变成播客、给视频配旁白却担心把文稿上传云端有隐私风险、按次计费又贵又离不开网络ChatTTS-ui 是一个开源的本地文字转语音工具装在自己的电脑上打开浏览器网页就能把文字合成人声同时还对外提供一个 HTTP 接口方便你的程序直接调用。这篇文章带你从零装好它、跑通第一段语音再顺带讲清楚怎么选音色、怎么避坑。️ 为什么值得在本地搞一套和常见的云端 TTS 接口放在一起对比差别其实很直观关心什么云端语音合成 API本地跑 ChatTTS-ui文稿隐私要发到第三方服务器全程在你机器上处理使用成本按字数或请求次数收费首次下载模型约 2GB后不再花钱网络要求断网即瘫痪模型下好后可离线生成接入方式注册账号、申请密钥向本机地址发一个 HTTP 请求合成质量方面ChatTTS 支持中英、数字混杂的文本语气也比较自然日常配音、旁白、有声书制作都够用。⚡ 从零开始两条安装路线路线一Windows 预打包版最省事从项目 Releases 页下载压缩包解压到任意目录双击app.exe启动首次运行会自动下载模型结束后浏览器自动打开http://127.0.0.1:9966整个过程和装普通软件一样不用配 Python 环境。个别安全软件可能误报忽略或改用源码部署即可。路线二源码部署Linux / Mac 适用需要Python 3.9~3.11四步走完git clone https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui . cd ChatTTS-ui python3 -m venv venv source venv/bin/activate pip install -r requirements.txt python3 app.py有英伟达显卡且显存大于 4G、装了 CUDA 12.8 的话会自动启用 GPU 加速显存不够则强制走 CPU功能不受影响只是速度慢一些。 生成第一段语音4 个步骤启动后浏览器会自动打开页面没打开就手动访问127.0.0.1:9966在文本框输入要合成的文字中英文、数字混排都没问题勾选中英分词后中文和英文会分开处理数字也会按对应语言读出来中文里 123 读作一二三在音色下拉框选一个音色或者在自定义音色值里直接填一个数字如 3000、9000拖动语速滑条1~9默认 5点击合成按钮等几秒即可试听并下载 wav生成的音频保存在项目static/wavs/目录下页面上可以直接下载。️ 音色怎么选常用种子2222默认、7869、6653、4099、5099都是页面上比较常用的音色编号填任意其他数字则会按该种子随机生成一个音色固定音色文件把.csv或.pt格式的音色文件丢进 speaker/ 目录刷新页面下拉框里就会出现适合认准了一个声音就一直用自定义种子在自定义音色值里填大于 1 的整数就能从种子值出发得到一个可复现的音色一个小提醒同一颗种子在不同设备上合成的音色可能不一样音调也会有波动。所以挑到顺耳的声音后建议把对应的 csv/pt 文件保存下来固定使用。 进阶玩法用特殊标签让语气更自然在提示栏prompt里可以插入几个控制标签[break_6]插入一个停顿[laugh_0]带一点笑声[oral_2]口语化程度更高[speed_1]~[speed_9]速度控制比如输入大家好 [break_2] 这是一个本地语音合成的演示 [laugh_0]读出来的节奏就会明显比平铺直叙自然。让自己的程序调用语音合成服务端地址是http://127.0.0.1:9966/ttsPOST 请求唯一必填参数是text其余voice、temperature、top_p、custom_voice 等不传就走默认值import requests res requests.post(http://127.0.0.1:9966/tts, data{text: 你好世界, voice: 3333}) print(res.json())成功时返回code: 0audio_files里带有 wav 文件的绝对路径和可下载的 URL如果加上wav1参数接口会直接返回 wav 二进制省掉一步下载。想接入 pyVideoTrans 这类字幕配音工具填上这个地址即可。 常见报错处理提示模型文件缺失如path.yaml、Missing spk_stat.pt多半是模型没下完整重新运行一次补齐或按报错路径手动把缺的文件放进对应目录下载模型时报 proxy 相关错误默认走 modelscope 渠道不能开代理临时关掉代理再跑即可端口 9966 被占用或想让局域网访问打开项目根目录的.env把WEB_ADDRESS127.0.0.1:9966改成你要的 IP 和端口即可顺带能改的还有device指定 cpu/cuda和compile开关更多报错对照项目自带的 faq.md 逐条排查第一次跑通之后你会发现文字变声音这件事可以完全掌握在自己手里文稿不出本机、不花调用费、离线也能干活。挑一个顺耳的音色把今天想读的那段文字丢进输入框试试第一段语音大概半分钟就能听到。【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考