
GSVI 文本转语音推理插件一个角色文件夹跑出自己的配音引擎【免费下载链接】GPT-SoVITS-InferenceInference Specialization项目地址: https://gitcode.com/gh_mirrors/gp/GPT-SoVITS-Inference想让角色开口说话却被 GPT-SoVITS 的环境配置、角色切换和情绪参数劝退GSVI 文本转语音推理插件把这件事拆得没那么费劲你把角色模型文件夹放进指定目录就能在浏览器或接口里直接挑角色、挑情绪、点一下生成拿到一段成品音频。它基于 GPT-SoVITS 的fast_inference_分支打造专注推理而非训练——你拿到的是一份别人训练好的角色模型而不是从零开始训。共享一个文件夹别人的角色就能在你的界面上说话。一句话看懂GSVI 专注推理而非训练把拿到 GPT-SoVITS 训练好的角色模型后怎么快速跑起来、挑角色、接进程序这件事打包成一个插件选角色、选情绪、调语速还能直接调 API。快速上手 拿到环境Windows 直接下预打包版本解压后双击install.batLinux / macOS 先克隆仓库git clone https://gitcode.com/gh_mirrors/gp/GPT-SoVITS-Inference建一个 conda 环境再跑bash install.sh自动装依赖。放对模型预训练模型放进GPT_SoVITS/pretrained_models角色文件夹放进trained/——每个角色一个文件夹里面放.pth/.ckpt加一条参考音频.wav音频名写成参考文本。启动跑通Windows 双击3 启动GSVI.bat其他系统运行python app.py浏览器会自动打开合成界面想走接口访问http://127.0.0.1:5000/tts?text你好直接返回一段音频。更多细节见 docs/cn/README.md。它能为你做什么 角色和情绪一个下拉框切换它能让你在界面上直接选角色、选情绪不用手改参数。这意味着别人分享的一个角色文件夹你放进trained/就能用同一角色还能配不同情绪。语速、音量、格式随调随用它能调语速、控音量在 WAV / MP3 / OGG 之间切格式。所以一段素材要快一点、轻一点改个参数就行不用重新合成一整条。HTTP 接口接进你的程序它内置接口支持 GET / POST用/character_list能查到有哪些角色和情绪详见 api_doc.md。这样语音合成就能嵌进 SillyTavern、网页或小工具不止在浏览器里点着玩。流式输出边合成边返回它支持stream流式返回音频一句一句吐出来。对话类场景能少等几秒体验更顺。适合谁、用在哪儿游戏 / 互动小说开发者把角色模型放进项目NPC 台词直接合成配音省掉录制成本。内容创作者给视频、播客批量出口播同一角色不同情绪改个参数就出多版。插件作者 / 极客通过 API 把 GSVI 接进 SillyTavern 等应用让现有工具拥有自己的配音能力。注意事项 / 常见问题它只做推理不推荐训练。想训新角色请回原版 GPT-SoVITS这里没有训练流程也默认不带降噪模型。环境有讲究numba0.56.4 要求 Python 3.11官方测过的是 Python 3.9 / 3.10 加 PyTorch 组合macOS 因 GPU 训练效果差默认走 CPU。GSVI 把 GPT-SoVITS 最劝退的一环——把模型跑起来、挑角色、接接口——变成了放文件夹加点个按钮的事。找一个你信任的角色模型文件夹丢进trained/运行python app.py听听你的第一个角色开口。【免费下载链接】GPT-SoVITS-InferenceInference Specialization项目地址: https://gitcode.com/gh_mirrors/gp/GPT-SoVITS-Inference创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考