opus-mt-tc-big-en-pt-en-pt-finetuned-20260527-234733

Este modelo é uma versão refinada (fine-tuned) do modelo Helsinki-NLP/opus-mt-tc-big-en-pt para tradução de EN para PT. O treinamento foi realizado utilizando a infraestrutura do NPAD (Supercomputador da UFRN) com Slurm.

Detalhes do Modelo

  • Tipo do Modelo: MarianMT (Seq2Seq)
  • Idioma de Origem: EN
  • Idioma de Destino: PT
  • Modelo Base: Helsinki-NLP/opus-mt-tc-big-en-pt
  • Dataset de Treinamento: opus_books (en-pt)

Métricas de Avaliação Finais

  • BLEU Score: 47.10052646392613
  • Hiperparâmetros de Treinamento:
    • Número de Épocas: 1
    • Taxa de Aprendizado: 2e-05

Como Usar (Inferência)

Você pode testar este modelo diretamente no Hugging Face Spaces ou usando a biblioteca transformers em Python:

from transformers import MarianMTModel, MarianTokenizer

model_name = "tarsssss/opus-mt-tc-big-en-pt-en-pt-finetuned-20260527-234733"
tokenizer = MarianTokenizer.from_pretrained(model_name)
model = MarianMTModel.from_pretrained(model_name)

def traduzir(texto):
    # Preparar inputs
    inputs = tokenizer(texto, return_tensors="pt", padding=True, truncation=True)
    
    # Gerar a tradução
    translated_tokens = model.generate(**inputs)
    
    # Decodificar os tokens gerados
    resultado = tokenizer.decode(translated_tokens[0], skip_special_tokens=True)
    return resultado

frase = "Welcome to the world of open-source machine learning!"
traducao = traduzir(frase)
print(f"Original: {frase}")
print(f"Tradução: {traducao}")

Agradecimentos e Infraestrutura

Agradecemos ao NPAD (Núcleo de Processamento de Alto Desempenho - UFRN) por ceder os recursos computacionais necessários para o treinamento deste modelo.

Downloads last month
6
Safetensors
Model size
0.2B params
Tensor type
F32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Dataset used to train tarsssss/opus-mt-tc-big-en-pt-en-pt-finetuned-20260527-234733

Evaluation results