Maizenberg Voice - RVC v2 48k
RVC v2 модель голоса Даниила Волкова, также известного как Майзенберг. Эту модель использует George для речи и песенных каверов.
Модель опубликована с прямого разрешения Даниила. Всегда явно помечайте сгенерированное аудио как результат AI-конверсии голоса. Не используйте модель для обмана, мошенничества, травли, выдачи себя за Даниила или представления сгенерированных слов как его настоящих высказываний.
Файлы
| Файл | Назначение |
|---|---|
maizenberg_rvc_v1.pth |
веса RVC v2, выбранный чекпоинт на 150 эпохах |
maizenberg_rvc_v1.index |
поисковый FAISS-индекс |
training_config.json |
архитектура и гиперпараметры обучения |
model_info.json |
длительность датасета и данные эмбеддера |
Характеристики
- Фреймворк: Applio / RVC v2
- Частота дискретизации: 48 кГц
- Pitch guidance: включён
- Эмбеддер: contentvec
- Вокодер: HiFi-GAN NSF
- Датасет: около 35 минут, один спикер
- Опубликованный чекпоинт: 150 эпох
- Исходный датасет: не публикуется
Использование в Applio
- Установите Applio: запустите
run-install.batв Windows илиrun-install.shв Linux/macOS. - Запустите
run-applio.batв Windows илиrun-applio.shв Linux/macOS. - Откройте вкладку
Inference. - Выберите
maizenberg_rvc_v1.pthкак модель иmaizenberg_rvc_v1.indexкак индекс. - Загрузите чистую сухую запись речи или изолированного вокала и начните с этих значений:
| Параметр | Значение |
|---|---|
| Pitch | 0 |
| Pitch extraction | rmvpe |
| Index rate | 0.5 |
| Protect | 0.5 |
| Embedder | contentvec |
- Запустите конверсию и проверьте разборчивость согласных. Если голос звучит
металлически, снизьте
Index rateдо0.3. МеняйтеPitchтолько если диапазон исходного голоса этого требует.
Лучше всего работает изолированный голос без музыки, реверберации, клиппинга и сильного фонового шума. Это voice conversion, а не самостоятельный TTS: модель преобразует уже существующую речь или вокал. Для TTS сначала синтезируйте речь, затем пропустите полученное аудио через RVC.
Запуск из командной строки
Команда выполняется из установленного каталога Applio:
python core.py infer \
--input_path /absolute/path/input.wav \
--output_path /absolute/path/output.wav \
--pth_path /absolute/path/maizenberg_rvc_v1.pth \
--index_path /absolute/path/maizenberg_rvc_v1.index \
--pitch 0 \
--f0_method rmvpe \
--index_rate 0.5 \
--protect 0.5 \
--embedder_model contentvec
Разрешение и ограничения
Владелец голоса прямо разрешил публичное распространение модели. Записи для обучения в комплект не входят. Публичный доступ не передаёт права на личность, имя, образ, товарные знаки и иные личные права владельца голоса. Пользователь сам отвечает за согласие, маркировку, авторские права и соблюдение применимых законов при публикации результата.
Использование регулируется лицензией
Maizenberg Responsible Voice License 1.0. Она разрешает обычный
творческий контент и его монетизацию при явной маркировке AI-голоса. Реклама,
заказная работа, голосовые сервисы и продажа модели требуют отдельного
письменного разрешения. Обман, выдача результата за настоящую запись,
мошенничество и обход голосовой авторизации запрещены.
Контрольные суммы
16cb33db73b081fbf22cb1f35d7eb9bc2152cebcea5227fa566c7fe5e281da49 maizenberg_rvc_v1.pth
d97d6076d26909fb4c4570f031fafef543308c854a97ebba35d05f4ccd100d17 maizenberg_rvc_v1.index