Bobot model TTS — Voice Promax

Salinan pribadi dari k2-fsa/OmniVoice, disimpan di akun ini supaya layanan Voice Promax tidak bergantung pada ketersediaan repo pihak lain.

Bobot modelnya tidak diubah. Yang berubah hanya nama internal di config.json (model_type dan architectures), supaya cocok dengan paket Python voicepromax.

Atribusi

Karya asli dilisensikan Apache License 2.0, yang mengizinkan redistribusi. Lisensinya dinyatakan di metadata kartu ini (license: apache-2.0), sama seperti di repo asalnya.

Pasal 6 Apache-2.0 tidak memberi hak atas merek. Nama repo asal dicantumkan di sini semata untuk atribusi faktual sebagaimana diwajibkan Pasal 4, bukan sebagai klaim afiliasi atau dukungan.

Sitasi

@article{zhu2026omnivoice,
      title={OmniVoice: Towards Omnilingual Zero-Shot Text-to-Speech with Diffusion Language Models},
      author={Zhu, Han and Ye, Lingxuan and Kang, Wei and Yao, Zengwei and Guo, Liyong and Kuang, Fangjun and Han, Zhifeng and Zhuang, Weiji and Lin, Long and Povey, Daniel},
      journal={arXiv preprint arXiv:2604.00688},
      year={2026}
}
Downloads last month
31
Safetensors
Model size
0.6B params
Tensor type
I64
·
F32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for voiceunlimited/promax-engine

Finetuned
Qwen/Qwen3-0.6B
Finetuned
k2-fsa/OmniVoice
Finetuned
(53)
this model

Paper for voiceunlimited/promax-engine