YAML Metadata Warning:empty or missing yaml metadata in repo card
Check out the documentation for more information.
Translate12M - Multilingual Translation Models
Collection of 12 LoRA fine-tuned translation models based on NLLB-200-distilled-600M.
π Models
| Direction | BLEU | Size (MB) | Path |
|---|---|---|---|
| ENβTH | 99.53 | 143.5 | eng_Latn_to_tha_Thai |
| THβEN | 99.67 | 143.5 | tha_Thai_to_eng_Latn |
| ENβJA | 98.66 | 143.5 | eng_Latn_to_jpn_Jpan |
| JAβEN | 99.55 | 143.5 | jpn_Jpan_to_eng_Latn |
| ENβHI | 99.70 | 143.5 | eng_Latn_to_hin_Deva |
| HIβEN | 99.84 | 143.5 | hin_Deva_to_eng_Latn |
| ENβRU | 99.52 | 143.5 | eng_Latn_to_rus_Cyrl |
| RUβEN | 99.38 | 143.5 | rus_Cyrl_to_eng_Latn |
| ENβMS | 99.37 | 143.5 | eng_Latn_to_zsm_Latn |
| MSβEN | 99.74 | 143.5 | zsm_Latn_to_eng_Latn |
| ENβZH | 98.62 | 143.5 | eng_Latn_to_zho_Hans |
| ZHβEN | 99.13 | 143.5 | zho_Hans_to_eng_Latn |
π Quick Start
from peft import PeftModel, PeftConfig
from transformers import AutoModelForSeq2SeqLM, AutoTokenizer
# Example: ENβTH
direction = 'eng_Latn_to_tha_Thai'
config = PeftConfig.from_pretrained('wasawat/Translate12M', subfolder=direction)
base = AutoModelForSeq2SeqLM.from_pretrained(config.base_model_name_or_path)
model = PeftModel.from_pretrained(base, 'wasawat/Translate12M', subfolder=direction)
tokenizer = AutoTokenizer.from_pretrained('wasawat/Translate12M', subfolder=direction)
# Set languages
tokenizer.src_lang = 'eng_Latn'
tokenizer.tgt_lang = 'tha_Thai'
# Translate
text = 'Hello, how are you?'
inputs = tokenizer(text, return_tensors='pt')
outputs = model.generate(**inputs, max_length=128)
translation = tokenizer.decode(outputs[0], skip_special_tokens=True)
print(translation)
π Details
- Base Model: NLLB-200-distilled-600M
- Method: LoRA fine-tuning
- LoRA Rank: 128
- LoRA Alpha: 256
- Training: ~4,250 samples per direction
- Epochs: 10
- Hardware: Tesla T4 GPU
π License
CC-BY-NC-4.0 (Creative Commons Attribution-NonCommercial 4.0)
- β Free for research/education
- β No commercial use
- β Attribution required
π€ Author
wasawat
Repository: https://huggingface.co/wasawat/Translate12M
Inference Providers NEW
This model isn't deployed by any Inference Provider. π Ask for provider support