Maizenberg Voice - RVC v2 48k

RVC v2 модель голоса Даниила Волкова, также известного как Майзенберг. Эту модель использует George для речи и песенных каверов.

Модель опубликована с прямого разрешения Даниила. Всегда явно помечайте сгенерированное аудио как результат AI-конверсии голоса. Не используйте модель для обмана, мошенничества, травли, выдачи себя за Даниила или представления сгенерированных слов как его настоящих высказываний.

Файлы

Файл Назначение
maizenberg_rvc_v1.pth веса RVC v2, выбранный чекпоинт на 150 эпохах
maizenberg_rvc_v1.index поисковый FAISS-индекс
training_config.json архитектура и гиперпараметры обучения
model_info.json длительность датасета и данные эмбеддера

Характеристики

  • Фреймворк: Applio / RVC v2
  • Частота дискретизации: 48 кГц
  • Pitch guidance: включён
  • Эмбеддер: contentvec
  • Вокодер: HiFi-GAN NSF
  • Датасет: около 35 минут, один спикер
  • Опубликованный чекпоинт: 150 эпох
  • Исходный датасет: не публикуется

Использование в Applio

  1. Установите Applio: запустите run-install.bat в Windows или run-install.sh в Linux/macOS.
  2. Запустите run-applio.bat в Windows или run-applio.sh в Linux/macOS.
  3. Откройте вкладку Inference.
  4. Выберите maizenberg_rvc_v1.pth как модель и maizenberg_rvc_v1.index как индекс.
  5. Загрузите чистую сухую запись речи или изолированного вокала и начните с этих значений:
Параметр Значение
Pitch 0
Pitch extraction rmvpe
Index rate 0.5
Protect 0.5
Embedder contentvec
  1. Запустите конверсию и проверьте разборчивость согласных. Если голос звучит металлически, снизьте Index rate до 0.3. Меняйте Pitch только если диапазон исходного голоса этого требует.

Лучше всего работает изолированный голос без музыки, реверберации, клиппинга и сильного фонового шума. Это voice conversion, а не самостоятельный TTS: модель преобразует уже существующую речь или вокал. Для TTS сначала синтезируйте речь, затем пропустите полученное аудио через RVC.

Запуск из командной строки

Команда выполняется из установленного каталога Applio:

python core.py infer \
  --input_path /absolute/path/input.wav \
  --output_path /absolute/path/output.wav \
  --pth_path /absolute/path/maizenberg_rvc_v1.pth \
  --index_path /absolute/path/maizenberg_rvc_v1.index \
  --pitch 0 \
  --f0_method rmvpe \
  --index_rate 0.5 \
  --protect 0.5 \
  --embedder_model contentvec

Разрешение и ограничения

Владелец голоса прямо разрешил публичное распространение модели. Записи для обучения в комплект не входят. Публичный доступ не передаёт права на личность, имя, образ, товарные знаки и иные личные права владельца голоса. Пользователь сам отвечает за согласие, маркировку, авторские права и соблюдение применимых законов при публикации результата.

Использование регулируется лицензией Maizenberg Responsible Voice License 1.0. Она разрешает обычный творческий контент и его монетизацию при явной маркировке AI-голоса. Реклама, заказная работа, голосовые сервисы и продажа модели требуют отдельного письменного разрешения. Обман, выдача результата за настоящую запись, мошенничество и обход голосовой авторизации запрещены.

Контрольные суммы

16cb33db73b081fbf22cb1f35d7eb9bc2152cebcea5227fa566c7fe5e281da49  maizenberg_rvc_v1.pth
d97d6076d26909fb4c4570f031fafef543308c854a97ebba35d05f4ccd100d17  maizenberg_rvc_v1.index
Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support