GEM/xlsum
Updated • 3.21k • 5
BARThez fine-tuné (v2) pour le résumé automatique d'articles en français. Entraîné sur MLSUM-FR + XL-Sum avec des hyper-paramètres optimisés.
from transformers import AutoTokenizer, AutoModelForSeq2SeqLM
tokenizer = AutoTokenizer.from_pretrained("erichogging/barthez-finetuned-v2-synthex")
model = AutoModelForSeq2SeqLM.from_pretrained("erichogging/barthez-finetuned-v2-synthex")
text = "Votre article en français à résumer..."
inputs = tokenizer(text, return_tensors="pt", max_length=1024, truncation=True)
summary_ids = model.generate(**inputs, max_new_tokens=128, num_beams=4)
summary = tokenizer.decode(summary_ids[0], skip_special_tokens=True)
print(summary)
Ce modèle fait partie du projet Synthex — une application de résumé automatique de textes en français.
Base model
moussaKam/barthez