OmniVoice: Towards Omnilingual Zero-Shot Text-to-Speech with Diffusion Language Models
Paper • 2604.00688 • Published • 17
Salinan pribadi dari k2-fsa/OmniVoice, disimpan
di akun ini supaya layanan Voice Promax tidak bergantung pada ketersediaan
repo pihak lain.
Bobot modelnya tidak diubah. Yang berubah hanya nama internal di
config.json (model_type dan architectures), supaya cocok dengan paket
Python voicepromax.
Karya asli dilisensikan Apache License 2.0, yang mengizinkan
redistribusi. Lisensinya dinyatakan di metadata kartu ini
(license: apache-2.0), sama seperti di repo asalnya.
Pasal 6 Apache-2.0 tidak memberi hak atas merek. Nama repo asal dicantumkan di sini semata untuk atribusi faktual sebagaimana diwajibkan Pasal 4, bukan sebagai klaim afiliasi atau dukungan.
@article{zhu2026omnivoice,
title={OmniVoice: Towards Omnilingual Zero-Shot Text-to-Speech with Diffusion Language Models},
author={Zhu, Han and Ye, Lingxuan and Kang, Wei and Yao, Zengwei and Guo, Liyong and Kuang, Fangjun and Han, Zhifeng and Zhuang, Weiji and Lin, Long and Povey, Daniel},
journal={arXiv preprint arXiv:2604.00688},
year={2026}
}