nllb-600m-en-vimedner-ner-vi

facebook/nllb-200-distilled-600M fine-tuned for Vietnamese biomedical NER (plain text → inline tagged text) on En-ViMedNER.

Dataset details, label inventory, splits, and citation: nhuvo/En-ViMedNER.

Usage

from transformers import AutoModelForSeq2SeqLM, AutoTokenizer

repo = "nhuvo/nllb-600m-en-vimedner-ner-vi"
tok = AutoTokenizer.from_pretrained(repo, src_lang="vie_Latn")
model = AutoModelForSeq2SeqLM.from_pretrained(repo)

prefix = "recognize Vietnamese named entities: "
text = "Bệnh nhân đái tháo đường típ 2 được tuyển vào nghiên cứu."
inputs = tok(prefix + text, return_tensors="pt")
outputs = model.generate(
    **inputs,
    forced_bos_token_id=tok.convert_tokens_to_ids("vie_Latn"),
    max_new_tokens=256,
)
print(tok.batch_decode(outputs, skip_special_tokens=True)[0])

Related

Downloads last month
15
Safetensors
Model size
0.6B params
Tensor type
F32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for nhuvo/nllb-600m-en-vimedner-ner-vi

Finetuned
(370)
this model

Dataset used to train nhuvo/nllb-600m-en-vimedner-ner-vi

Collection including nhuvo/nllb-600m-en-vimedner-ner-vi