Werea-TSS-1.7B — Türkçe Metinden Sese (Deneysel) 🎙️🇹🇷
Werea-TSS-1.7B, Qwen3-TTS-12Hz-1.7B-Base tabanının, resmî desteklenen 10 dil arasında bulunmayan Türkçe'ye uyarlanmış deneysel fine-tune'udur. Eğitim verisi olarak tamamı sentetik, kaynağı belgelenmiş werea-tts-tr-synthetic seti kullanılmıştır (1.272 örnek, ~1,32 saat). 183M parametreli Werea-TSS modelimizin ~10 kat büyük kardeşidir.
⚠️ Beta / deneysel sürüm: Bu bir fizibilite checkpoint'idir. 3 epoch eğitimde loss 14,6 → 4,3'e düşmüştür; ancak üretim sonlandırma (EOS) davranışı henüz kararlı değildir — model uzun kuyruklu ses üretebilir. Üretimde
max_new_tokens/ süre limiti verilmesi önerilir. Resmî ses örnekleri ve değerlendirme sonuçları eklenecektir.
Eğitim
- Taban: Qwen/Qwen3-TTS-12Hz-1.7B-Base (Apache-2.0) — Qwen'in resmî
tek-konuşmacılı SFT akışı (
prepare_data.py+sft_12hz.py) - Konuşmacı:
werea(sentetik Werea ses kimliği, referans ses dahil) - Veri: 1.272 Türkçe örnek; izinsiz gerçek kişi kaydı veya ses klonlama yok
- Hiperparametreler: 3 epoch, batch 8 × grad-accum 4, lr 2e-5, bf16, A100
- Eğitim logu:
train.log
Kullanım
Model dosyaları checkpoint/ klasöründedir:
pip install qwen-tts
hf download Werea-co/Werea-TSS-1.7B --local-dir werea-tss-1.7b
import torch, soundfile as sf
from qwen_tts import Qwen3TTSModel
tts = Qwen3TTSModel.from_pretrained(
"werea-tss-1.7b/checkpoint", device_map="cuda:0", dtype=torch.bfloat16
)
wavs, sr = tts.generate_custom_voice(
text="Merhaba, Werea deneyimine hoş geldiniz.",
speaker="werea",
max_new_tokens=512, # uzunluk limiti önerilir (beta)
)
sf.write("werea.wav", wavs[0], sr)
Sınırlamalar
- Beta: uzun cümlelerde ve sayılarda telaffuz hataları, üretim sonlandırma kararsızlığı görülebilir.
- Duygu kontrolü ve referans sesle klonlama hedeflenmemiştir.
- Sentetik ses olduğu son kullanıcıya açıkça belirtilmelidir.
Lisans ve atıf
Apache-2.0. Taban model: Qwen/Qwen3-TTS-12Hz-1.7B-Base (Apache-2.0, Alibaba Qwen ekibi). Eğitim ve yayın: Werea.
Model tree for Werea-co/Werea-TSS-1.7B
Base model
Qwen/Qwen3-TTS-12Hz-1.7B-Base