免费获取学习方案
ARTICLE DETAIL

资讯详情

深耕编程基础知识与建站技术分享的一线实战洞察。

ChatTTS-ui 社区精选:4 组语音合成即拿即用的音色配置

ChatTTS-ui 社区精选:4 组语音合成即拿即用的音色配置 ChatTTS-ui 社区精选4 组语音合成即拿即用的音色配置【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui音色配置调了半天合出来的声音既不正式也不温柔参数也不知道该往哪拧——这是很多新手使用 ChatTTS-ui开源语音合成项目时最常卡住的地方。本文不聊原理直接给你 4 组社区精选、即拿即用的音色配置种子值加温度/Top-P/Top-K 三个采样参数照抄即可跑通适用于 0.96 及以上版本。三步上手把一组社区音色应用到项目第一步启动服务。在本地克隆仓库、装依赖、运行app.py首次启动会自动下载模型网页界面和 API 都挂在http://127.0.0.1:9966git clone https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui cd ChatTTS-ui pip install -r requirements.txt python app.py第二步按需放音色文件可选。csv 格式直接放进部署目录的speaker/文件夹即可用仓库里的 speaker/ 目录就带着多组 csv 音色如果是 0.96 及以上版本下载的 PT 文件需先在部署目录运行python cover-pt.py把seed_xxx_emb.pt转成seed_xxx_emb-covert.pt才能生效详见 cover-pt.py 头部说明。第三步API 里指定种子值和三个参数。服务跑起来后 POST 一次/tts本文的配置全部塞进这一个请求里import requests res requests.post(http://127.0.0.1:9966/tts, data{ text: 欢迎使用 ChatTTS-ui 社区音色, custom_voice: 1983, # 种子值决定基础音色 temperature: 0.1, top_p: 0.701, top_k: 20, }) print(res.json()[audio_files][0][url]) # 音频下载地址三个参数有默认值0.3 / 0.7 / 20忘了就省略只指定种子值音色也已经不同了。场景化音色配置库按用途挑音色下面四组配置对应四个高频场景每组给种子值、核心参数和一句点评附一条可直接运行的试听命令本地起服务后执行返回 JSON 里的 url 就是本次合成的音频。新闻资讯场景稳重的官方感种子 1983核心参数temperature0.1top_p0.701top_k20点评低温度把声音锁在新闻播报模式节奏平稳、几乎不带情绪漂移。curl -X POST http://127.0.0.1:9966/tts -d text早上好欢迎收听今天的新闻简报 -d custom_voice1983 -d temperature0.1 -d top_p0.701 -d top_k20小说朗读场景带情绪起伏的暖音种子 7869核心参数temperature0.3top_p0.85top_k30点评温度抬到 0.3、候选池放宽声音里会多出气口和停顿适合情感故事与长文朗读。curl -X POST http://127.0.0.1:9966/tts -d text夕阳沉到了远山背后小镇慢慢安静下来。 -d custom_voice7869 -d temperature0.3 -d top_p0.85 -d top_k30儿童故事场景温柔的讲述感种子 3333核心参数temperature0.4top_p0.65top_k15点评随机性中等、候选池收窄活泼但不跑偏适合给小朋友讲故事。curl -X POST http://127.0.0.1:9966/tts -d text小兔子快点吃完早饭巴士就要出发啦。 -d custom_voice3333 -d temperature0.4 -d top_p0.65 -d top_k15IVR 导航场景简洁明快的客服音种子 4444核心参数temperature0.2top_p0.75top_k25点评介于官方和情感之间吐字利落适合菜单导播类短文案。curl -X POST http://127.0.0.1:9966/tts -d text查询余额请按一业务咨询请按二。 -d custom_voice4444 -d temperature0.2 -d top_p0.75 -d top_k25进阶调参三个参数的参数—效果速查一句话对照temperature 是总体随机度开关——调低声音更稳更收调高会更飘、偶尔有意外惊喜top_p 和 top_k 是候选词表上的两道筛子——top_p 保留累计概率够高的词top_k 只保留前 K 个——两者共同决定声音的选择面。调参时先固定种子值一次只动一个参数试听一次就能听出差别。参数控制什么常用区间听感temperature声音整体随机度0.1 – 0.80.1 稳重官方0.3–0.4 更有情绪和温度top_p采样多样性的概率截断0.5 – 0.9调低更稳调高音色变化更多top_k候选词前 K 个的数量15 – 30调小音色更收敛调大更带纹理避坑答疑跑之前最容易被卡住的 4 个点问放了音色文件合成声音却一点没变为什么答0.96 之后PT 文件不能直接使用需先在部署目录运行python cover-pt.py转换成-covert.pt格式规则见 cover-pt.pyspeaker/目录里只保留转换后的文件即可csv 文件则不需要任何转换。问照着文章用了同一个种子值为什么音色听起来不一样答这是正常现象。官方说明中明确提到同一音色值在不同设备上合成的音色会有差异同一设备上音调也可能有轻微变化见 README.md 的音色获取一节。所以把本文配置当作起点按参数生成后以本地听感为准再微调。问我设置了 voice感觉没生效答如果你同时设置了custom_voice正整数API 会以custom_voice为准并忽略voice。想随机探索新音色时给custom_voice传一个任意正整数是常用做法。问首次启动下载模型失败报 proxy 类错误答项目默认从魔塔社区下载模型该源要求直连请先关闭代理再启动其他报错可对照 faq.md 自查。收尾把你调出的好音色贡献回社区如果这 4 组配置不够你挑或者你自己调出了一个特别满意的音色——把音色文件和参数说明按seed-{种子值}-te{温度}-tp{top_p}-tk{top_k}.wav的命名规范放进社区仓库的 speaker/ 目录并提交 PR下一个卡住的人就能直接拿走。调出一个好声音和写代码一样也是一种贡献。【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表