# GPT-SovitsForAb **Repository Path**: gdouage/gpt-sovits-for-ab ## Basic Information - **Project Name**: GPT-SovitsForAb - **Description**: GPT-SoVITS For AB 是基于 RVC-Boss/GPT-SoVITS 的 Windows 一键整合包,专为游戏配音与同人 TTS 打造。双击「安装.bat」自动下载依赖、按显存选参,再双击「启动.bat」打开网页向导:丢一段录音,自动完成人声分离、切片、Whisper 转写与训练,训完在推理页选角色即可出声。仓库只含源码与脚本,体积小、开箱即用。 - **Primary Language**: Unknown - **License**: Not specified - **Default Branch**: master - **Homepage**: None - **GVP Project**: No ## Statistics - **Stars**: 0 - **Forks**: 0 - **Created**: 2026-08-13 - **Last Updated**: 2026-08-13 ## Categories & Tags **Categories**: Uncategorized **Tags**: None ## README # GPT-SoVITS For AB 基于 [RVC-Boss/GPT-SoVITS](https://github.com/RVC-Boss/GPT-SoVITS) 的 Windows 一键整合包,给游戏配音 / 同人 TTS 用。仓库只含源码和脚本,**不带** Python、Torch、预训练和语音识别权重。 - 仓库体积:源码 + 向导 + 一键安装脚本(约几十到两百 MB) - 首次运行「安装.bat」自动下载:Python 3.11、Torch、ffmpeg、v2Pro 预训练、UVR、Faster Whisper large-v3,装完约占盘 **12–16 GB**,训练另建议空余 **40 GB** - 国内默认:魔搭 ModelScope(预训练 / UVR)、清华 PyPI、南大 PyTorch、hf-mirror.com(Whisper) - 自动检测显卡,选 cu128(RTX 50 系)/ cu126 / cpu(cpu 只能推理,不能训练) 本包把官方 WebUI 的 UVR、切片、ASR、1A/1B/1C、训练收成一条流水线。别人丢一段录音,自动清洗并按显存选参训练;训完只在推理页选角色出声。 --- ## 一、快速上手(两步) 1. **双击 `安装.bat`**:自动识别显卡,下载并安装全部依赖和模型。中断了再点一次,已下好的会跳过。 2. **双击 `启动.bat`**:浏览器打开 http://127.0.0.1:9876 。「一键训练」放录音、填角色名、选语言;训完到「推理」页出声。 > 训练需要 **Windows 10/11 + NVIDIA 显卡**,建议 **8GB 显存**以上(3060 / 4060 / 5060 这一档)。没有独显也能装,但训练页会拒绝。 > > 已经是干声(无人声伴奏、无明显混响)可以勾「跳过 UVR」。默认不要勾——带 BGM 的片子不分离会训出金属音。 魔搭下不动时,改用 HuggingFace 镜像: ```bat powershell -NoProfile -ExecutionPolicy Bypass -File setup\install.ps1 -Source HF-Mirror ``` 官方源(墙外): ```bat powershell -NoProfile -ExecutionPolicy Bypass -File setup\install.ps1 -Source HF ``` --- ## 二、两个入口 | 用途 | 启动 | 说明 | |---|---|---| | 安装依赖和模型 | `安装.bat` | 首次必跑;可重复,断点续传 | | 向导(训练 + 推理) | `启动.bat` | 网页,http://127.0.0.1:9876 | **不要**把官方 `engine\webui.py` 当默认入口。那是给熟悉 1A/1B/1C 的人用的高级页,本包向导已经包过流水线。 --- ## 三、训练默认(开发者可改) 引擎版本固定 **v2Pro**。参数按 `config\hardware.json` 的档位走,检测逻辑在 `app\hardware.py`。 | 档位 | 显存 | SoVITS batch / epoch | GPT batch / epoch | 能否训练 | |---|---|---|---|---| | vram8 | 约 8GB | 2 / 8,每 2 epoch 存盘 | 1 / 15,每 5 epoch 存盘 | 能 | | vram12 | 约 12GB | 4 / 8 | 2 / 15 | 能 | | vram16 | 16GB+ | 8 / 8 | 4 / 15 | 能 | | vram4 / cpu | <6GB 或无 NVIDIA | — | — | 否,只能推理 | 语料按干净人声时长再加长 epoch:3–15 分钟用上表;15–60 分钟 SoVITS 14 / GPT 20。 流水线(`app\pipeline.py`,每步写 `workspace\<角色>\state.json`,失败从断点续): 1. ffmpeg 转 44.1kHz / 16bit / stereo 2. UVR:HP5 主人声 → DeEchoDeReverb 3. 切片:阈值 -40dB,最短 3s 4. Faster Whisper large-v3 转写,丢掉空句 / 片尾感谢 5. 官方 1A 文本、1B Hubert、1B-SV、1C semantic 6. 先训 SoVITS 再训 GPT 7. 登记到 `voices\<角色>\meta.json`,默认推荐 **中档** pth + **较早** ckpt,不用最后一档(减少过拟合) 推理走官方 `GPT_SoVITS.TTS_infer_pack.TTS`,不是另写一套合成。 --- ## 四、文件位置 ``` gpt-sovitsforab\ ├─ 安装.bat / 启动.bat ├─ 使用说明.txt ├─ app\ │ ├─ wizard.py # Gradio 向导(训练 + 推理) │ ├─ pipeline.py # UVR / 切片 / Whisper / 训练 │ ├─ hardware.py # 显卡检测与档位 │ ├─ infer.py # 加载角色权重推理 │ └─ paths.py # 全部相对包根目录,不写死盘符 ├─ setup\ │ ├─ install.ps1 # 一键安装主逻辑 │ └─ downloads\ # 安装过程缓存(不进仓库) ├─ engine\ # GPT-SoVITS 引擎源码(不含权重) ├─ config\ # 安装后生成 hardware.json / ready.json ├─ input\ # 可选:把录音放这里 ├─ workspace\ # 切片、list、中间文件(不进仓库) ├─ voices\ # 训好的角色 meta.json(不进仓库) ├─ runtime\ # 安装后的 Python 3.11(不进仓库) └─ ffmpeg\ # 安装后的 ffmpeg(不进仓库) ``` **加新角色**:用向导训练即可,或把已有 `*.pth` / `*.ckpt` 配一份 `voices\<名字>\meta.json`(字段见已有角色)。重启 `启动.bat` 后下拉里会出现。 --- ## 五、镜像源 | 用途 | 默认地址 | |---|---| | Python 3.11.9 便携包 | `https://www.python.org/ftp/python/3.11.9/python-3.11.9-embed-amd64.zip` | | get-pip | `https://bootstrap.pypa.io/get-pip.py` | | ffmpeg | `https://github.com/BtbN/FFmpeg-Builds/releases/download/latest/ffmpeg-master-latest-win64-gpl.zip` | | VC++ 运行库 | `https://aka.ms/vs/17/release/vc_redist.x64.exe` | | pip 依赖 | `https://pypi.tuna.tsinghua.edu.cn/simple` | | Torch cu128 / cu126 | 南大 `https://mirrors.nju.edu.cn/pytorch/whl/cu128` 或 `.../cu126` | | 预训练 / G2PW / UVR / NLTK / OpenJTalk | 魔搭 `XXXXRT/GPT-SoVITS-Pretrained` | | Faster Whisper large-v3 | `Systran/faster-whisper-large-v3`(hf-mirror.com) | 换源参数:`setup\install.ps1 -Source ModelScope|HF-Mirror|HF`。 | `-Source` | 预训练 / UVR | Whisper | |---|---|---| | `ModelScope`(默认) | modelscope.cn | hf-mirror.com | | `HF-Mirror` | hf-mirror.com | hf-mirror.com | | `HF` | huggingface.co | huggingface.co | 压缩包缓存在 `setup\downloads\`,重装会跳过已有文件。 --- ## 六、给二次开发 - 路径一律走 `app\paths.py` 的 `pack_root()`,不要写 `D:\...`。 - 改默认 batch / epoch:改 `app\hardware.py` 的 `_train_profile()`。 - 改切片阈值、是否默认 UVR:改 `app\pipeline.py` 的 `step_slice` / `step_uvr`。 - 向导端口:`app\wizard.py` 里 `9876`。 - 引擎升级:替换 `engine\` 时保留本包的 `app\`、`setup\`、两个 bat,并回归 v2Pro 权重路径。 - **不要提交** `runtime\`、`ffmpeg\`、`workspace\`、`voices\`、`setup\downloads\`、以及 `engine` 下的 `*.pth` / `*.ckpt` / `*.bin`。 环境重建:删掉 `runtime\` 和 `config\ready.json`,再双击 `安装.bat`。 --- ## 七、常见问题 - **安装中途断了**:再双击 `安装.bat`,已下载的会跳过。 - **启动提示还没安装依赖**:先跑 `安装.bat`,成功后会写 `config\ready.json`。 - **魔搭 4.3GB 预训练失败**:用 `-Source HF-Mirror`。 - **50 系显卡 Torch 装错**:应走 cu128。看安装日志里的「Torch: cu128」;不对就删 `runtime\` 重装。 - **训练金属音 / 电音**:源音频有 BGM 或压缩严重,不要勾「跳过 UVR」,换干净人声。 - **有效句子太少**:切片后 Whisper 可用句不足 3 条,换更长、更清晰的录音。 - **显存 OOM**:8GB 不要同时开别的占显存程序;档位已经是 batch 2 / 1。 --- ## 八、许可 - 本仓库脚本与向导:随仓库分发,按你自己的项目约定使用。 - `engine\` 来自 [RVC-Boss/GPT-SoVITS](https://github.com/RVC-Boss/GPT-SoVITS),遵循其原仓库许可。 - 预训练、UVR、Whisper 权重各有上游许可,下载后请自行遵守。 - 用本包训练角色语音时,请尊重声源权利人,勿用于未授权的商业配音。