camembert-med-reranker-base

Cross-encoder de reranking médical français (110M params), fine-tuné par le labo camembert-med (pipeline Kaggle GPU gratuit, tout versionné).

Benchmark (gold: questions d'examen FR, splits test officiels, 8965 queries / 47789 paires)

  • P@1: 0.4678
  • MRR@10: 0.6598
  • nDCG@10: 0.7378
  • pairwise accuracy: 0.6903

Baseline (avant spécialisation): P@1 0.3445 / MRR@10 0.5761 / nDCG@10 0.6789.

Limitations

  • Benchmark d'examen (gold) — pas une preuve de qualité clinique en production.
  • Entraîné sur MediQAl (CC-BY-4.0) + FrenchMedMCQA (Apache-2.0) ; distracteurs = réponses fausses des questions (vérifiées).
  • Pas de mesure de catastrophic forgetting sur retrieval général (mMARCO) : à évaluer avant tout usage hors médical.
Downloads last month
-
Safetensors
Model size
0.1B params
Tensor type
F32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for ymelka/camembert-med-reranker-base