BiTremplin — NLLB fine-tune Kirundi <-> Francais

Modele de traduction Kirundi <-> Francais, fine-tune a partir de facebook/nllb-200-distilled-600M dans le cadre du projet BiTremplin (Burundian Intelligent Translation Platform for Learning and Multilingual Knowledge Accessibility).

⚠️ A savoir avant d'utiliser ce modele

NLLB-200 n'a pas de code de langue dedie au Kirundi (Burundi). Ce modele reutilise le slot kin_Latn, qui est officiellement celui du Kinyarwanda (Rwanda) dans NLLB-200 — une langue proche mais distincte. Apres ce fine-tuning, kin_Latn produit du Kirundi, pas du Kinyarwanda standard. Ne pas utiliser ce modele pour du Kinyarwanda ; utiliser le NLLB-200 de base pour cet usage.

Utilisation

from transformers import AutoModelForSeq2SeqLM, AutoTokenizer

model_name = "Expendadeur/nllb-kin-fr"
tokenizer = AutoTokenizer.from_pretrained(model_name)
model = AutoModelForSeq2SeqLM.from_pretrained(model_name)

tokenizer.src_lang = "kin_Latn"  # Kirundi (voir avertissement ci-dessus)
inputs = tokenizer("Amakuru yawe ni meza", return_tensors="pt")
generated = model.generate(
    **inputs,
    forced_bos_token_id=tokenizer.convert_tokens_to_ids("fra_Latn"),
)
print(tokenizer.batch_decode(generated, skip_special_tokens=True))

Licence

CC-BY-NC-4.0 (heritee du modele de base NLLB-200) — usage non commercial.

Downloads last month
-
Safetensors
Model size
1B params
Tensor type
F32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for Expendadeur/nllb-kin-fr

Finetuned
(343)
this model