Werea-TSS 183M — Türkçe Metinden Sese

Werea-TSS, Werea organizasyonu için geliştirilmiş 183,2 milyon parametreli, Türkçe öncelikli bir metinden-sese modelidir. Model, Apache-2.0 lisanslı FreyaTTS-small ağırlıklarının tam-parametreli, korumacı bir fine-tune türevidir. Çıkış 48 kHz mono sestir.

Bu depo yalnızca bir arayüz değildir: model.safetensors, Werea eğitiminde değiştirilmiş türetilmiş ağırlıkları içerir.

🎧 Werea-TSS örnek WAV dosyası

Mimari

  • Tokenizer/G2P olmadan 92 karakterlik Türkçe sözlük
  • 183,2M parametreli non-autoregressive flow-matching DiT
  • 25 Hz × 64 boyutlu AudioVAE2 latent uzayı
  • 32 adımlı Euler ODE örnekleme
  • Dondurulmuş, Apache-2.0 lisanslı VoxCPM2 AudioVAE2 decoder

Werea ses kimliği ve veri kaynağı

İzinsiz gerçek kişi kaydı veya ses klonlama verisi kullanılmadı. Eğitim metinleri Werea için özgün olarak üretildi. Öğretmen sesler, FreyaTTS-small tabanından sabit 20260814 tohumu ile sentetik üretildi ve kaynak/seed bilgisi manifestlerde tutuldu.

  • Stage-1: 960 benzersiz Türkçe cümle, yaklaşık 1,19 saat
  • Kısa-ifade denetimi: 312 ek kısa cümle
  • Ayrılmış eval: eğitim metniyle sıfır çakışmalı 20 özgün Türkçe cümle
  • Seçilen checkpoint: conservative-step75 (lr=2e-6, effective batch 8)

Değerlendirme

Ölçüm, faster-whisper-small ile Werea'nın 20 cümlelik ayrılmış eval setinde yapıldı. Bu küçük iç değerlendirme, Freya'nın yayımladığı Freya-TR-Eval sonuçlarıyla doğrudan karşılaştırılmamalıdır.

Model WER ↓ CER ↓ Geçerli ses
FreyaTTS base (aynı koşul) 27,22% 9,44% 20/20
Werea-TSS seçilen 29,11% 10,08% 20/20
Agresif Stage-2 final (reddedildi) 48,10% 17,02% 20/20

Agresif checkpoint kalite gerilemesi nedeniyle yayınlanmadı. Ayrıntılı ve makinece okunabilir ölçümler evaluation.json dosyasındadır.

Kullanım

Önce FreyaTTS kaynak deposunun gereksinimlerini kurun:

git clone https://github.com/freyavoiceai/FreyaTTS.git
cd FreyaTTS
pip install -r requirements.txt
from freyatts import FreyaTTS

tts = FreyaTTS.from_pretrained("Werea-co/Werea-TSS", device="cuda")
wav = tts.synthesize(
    "Merhaba, Werea deneyimine hoş geldiniz.",
    steps=32,
    seed=20260814,
)
tts.save_wav(wav, "werea.wav")

Depodaki freyatts/ klasörü, sabitlenmiş upstream committen alınan Apache-2.0 çıkarım kodunu da içerir; Space dağıtımı bu kopyayı kullanır.

Werea ses kimliği için seed=20260814 açıkça verilmelidir. Mevcut FreyaTTS istemcisinin varsayılan tohumu farklıdır.

Amaçlanan kullanım

Türkçe organizasyon duyuruları, erişilebilirlik seslendirmeleri, prototip sesli asistanlar ve açık araştırma. Model insan sesi taklit etmek veya bir kişinin kimliğine bürünmek amacıyla tasarlanmamıştır.

Sınırlamalar

  • Beta sürümdür; özel adlar, yabancı sözcükler ve çok uzun cümlelerde hata yapabilir.
  • Duygusal kontrol ve referans-ses ile klonlama desteklenmez.
  • Kritik duyurular yayımlanmadan önce insan tarafından dinlenmelidir.
  • Sentetik ses olduğu kullanıcılara açıkça belirtilmelidir.

Lisans ve atıf

Kod ve ağırlıklar Apache License 2.0 altındadır. Taban model FreyaTTS-small, decoder ise VoxCPM2 AudioVAE2'dir. Korunan atıflar ve değişiklik bildirimi için NOTICE ve LICENSE dosyalarına bakın.

Downloads last month
27
Safetensors
Model size
0.2B params
Tensor type
F32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for Werea-co/Werea-TSS

Finetuned
(2)
this model

Space using Werea-co/Werea-TSS 1