Skip to content

0.17 ​

关于TTS(语音合成)的Q&A ​

Q:为什么更换TTS模型?
A:官方原版Qwen3TTS模型体积很大,单模型就4GB,极限压缩打包后也要7GB。

Q:我查阅了VoxCPM2的官网,得知该模型支持CUDA,为什么本软件没有使用?
A:原版官方模型同样为4GB;经过第三方精简后的模型连同依赖合计约3.4GB,听感效果和原版基本没有差别。

Q:为什么要尽量缩减程序体积?
A:海外用户下载国内网盘资源速度较慢,因此尽量压缩安装包。
唯一的弊端就是OneDrive只能获取最新版本。

Q:Qwen3TTS和VoxCPM2这两个TTS有什么区别?
A:都差不多一样,但是Qwen3TTS使用感更好生成更快,VoxCPM2支持的语言多,但是说话会有点怪

RVC(语音转换)的Q&A ​

Q:为什么RVC仅提供DirectML版本?
A:CUDA版本仅支持NVIDIA显卡;DirectML只要设备运行Windows10/11且支持DirectX12就可以实现硬件加速,因此优先制作通用版本。如果有需要CUDA版本的用户,可以联系我,我会视情况继续维护。

软件的Q&A ​

Q:为什么删除了之前两个Beta版本?
A:旧版本仅支持CPU模式,并且软件体积庞大,因此做了删除处理。(要是你不相信,就当我单纯为了节省网盘空间)

0.15版本还会保留,这是最后一个使用Qwen3TTS官方Safetensors模型的版本。
会有部分用户不希望使用精简模型,想要原汁原味的合成效果。
但是该版本输出音色几乎等同于原版,仍然优先建议体验官方原版。硬盘存储空间不足的话可以忽略这条提示。
官方原版Safetensors模型后续将不再更新。

Q:既然想要缩小程序体积,为什么不直接让用户自行下载TTS核心?
A:开箱即用的体验才是最优的。

Q:我担心与 AI 的聊天记录和 API Key 会泄露。
A:请放心,聊天记录和 API Key 都已加密。不过,加密原理已在 GitHub 上开源,因此下载时请务必使用官方版本,切勿使用来源不明的版本。😃

Q:能不能多支持多一点linux。
A:已经最大能力支持市面上大多数人用的linux的发行版了,真的需要的话,联系那边找我,尽量有时间支持

其他问题 ​

Q:我可以在其他平台转发、发布本软件吗?
A:可以转发发布。转发时请遵守角色使用指南与使用条款 (Voiceger:Zundamon)的全部要求;禁止发布盗版链接。
转发无需向我申请授权,但发布内容里请附上本项目地址以及作者信息,最好两项同时标注。

Q:你为什么会对Voiceger进行二次修改?
A:官方原版上手简单,模型更好,但界面观感一般,也没有汉化。我看得懂英文,不代表所有用户都看得懂,因此做二次修改来弥补这些不足。

Q:你给的提示词(system prompt)可以搬运么?
A:可以,使用提示词时要遵守角色使用指南与使用条款 (Voiceger:Zundamon)的全部要求
然后标明来源就行