YAML Metadata Warning:empty or missing yaml metadata in repo card
Check out the documentation for more information.
Zaplanjsko‑svrljiški prevodilac (NLLB‑200) - Projekat
📖 Opis
Ovo je repozitorijum za projekat eksperimentalnog prevodioca između стандардног српског (srp_Cyrl) i заплањско‑сврљишког дијалекта. Osnovni model je facebook/nllb-200-distilled-600M, koji se finim podešavanjem adaptira na specifičnosti dijalekta.
⚙️ Status
Ovaj repozitorijum služi kao kontejner za razvoj projekta. Fino-tjunovani model, koji je rezultat obuke na paralelnom korpusu, dostupan je na: schebet/zaplanjsko-svrljiski-translator-fine-tuned Cilj projekta je da se kroz iteracije poboljša tačnost i očuvanje akcenatskih i fonetskih osobina dijalekta.
🗂️ Dataset
Za fino podešavanje koristi se dataset: schebet/zaplanjsko-svrljiski-parallel
- Sadrži parove reči i izraza: standardni srpski → dijalekatski oblik.
- Akcenatske oznake i fonetske varijante su uključene radi očuvanja autentičnosti.
🚀 Upotreba
Primer kako da se koristi fino-tjunovani model u Python‑u:
from transformers import AutoModelForSeq2SeqLM, AutoTokenizer
model_name = "schebet/zaplanjsko-svrljiski-translator-fine-tuned" # Učitavanje fino-tjunovanog modela
model = AutoModelForSeq2SeqLM.from_pretrained(model_name)
tokenizer = AutoTokenizer.from_pretrained(model_name)
text = "majka"
inputs = tokenizer(text, return_tensors="pt", src_lang="srp_Cyrl")
outputs = model.generate(**inputs)
print(tokenizer.decode(outputs[0], skip_special_tokens=True))
- Downloads last month
- 40