Chobits-Chi-TTS
《人形电脑天使心》(Chobits) 中 小叽 (Chi / ちぃ) 角色的 TTS(语音合成)模型,基于 GPT-SoVITS v2Pro 微调。
- 训练数据:Chobits-Chi-Voice(483 条人工复听确认的小叽语音,共 21.4 分钟,日语)
- 代码与复现流程:GitHub: chenxin199305/Chobits-Chi-TTS
⚠️ 原始动画音频的版权归其权利方所有。本模型仅供学习与研究使用,请勿用于商业用途。
文件说明
| 文件 | 说明 |
|---|---|
chi-e10.ckpt |
GPT 语义模型(149MB,e10 checkpoint,人工试听选定) |
chi_e10_s1210.pth |
SoVITS 声学模型(129MB) |
ref_audio.wav |
参考音频(ep07「秀樹は地位を拾ってくれた」,4.2s) |
ref_text.txt |
参考音频对应文本 |
推理时 GPT 模型、SoVITS 模型、参考音频三者都需要;参考音频可替换为任意 3–8 秒的小叽语音(需同步替换对应文本)。
使用方法
在 GPT-SoVITS 环境中(本项目验证版本:commit 48b1a01,Python 3.10 + torch 2.11.0+cu128):
# 命令行推理 (在 GPT-SoVITS 仓库根目录)
version=v2Pro python GPT_SoVITS/inference_cli.py \
--gpt_model chi-e10.ckpt \
--sovits_model chi_e10_s1210.pth \
--ref_audio ref_audio.wav \
--ref_text ref_text.txt --ref_language 日文 \
--target_text target_text.txt --target_language 日文 \
--output_path ./output
或启动 WebUI(python webui.py),在"1C-推理"页选择这两个权重文件即可。完整的环境搭建与训练复现步骤见 GitHub README。
训练信息
| 项目 | 配置 |
|---|---|
| 版本 | GPT-SoVITS v2Pro(全量微调) |
| 数据量 | 483 条 / 21.4 分钟(22050Hz 单声道,经 Whisper 转写清洗 + 人工复听) |
| SoVITS | batch 4 × 15 epochs,选 e10 |
| GPT | batch 4 × 15 epochs,选 e10 |
| 硬件 | RTX 4060 Laptop 8GB |
许可协议
本模型以 CC BY-NC-SA 4.0(署名-非商业性使用-相同方式共享)协议发布:
- **署名 (BY)**:使用时须注明来源。
- **非商业性使用 (NC)**:不得将本模型用于商业目的。
- **相同方式共享 (SA)**:基于本模型的衍生作品须以相同协议发布。
免责声明
- 本模型仅用于学术研究与个人学习,不构成对原作品版权的任何主张。
- 使用本模型生成的内容,不得用于侵犯原作品及相关声优(田中理惠)权益的用途。
- 若权利方提出要求,本模型将被下架。