Qwen3-4B Safe FR LoRA

Adaptateur comportemental français entraîné sur 240 exemples synthétiques, déterministes et audités. Il vise des réponses courtes, fondées sur le contexte, respectueuses de la confidentialité et prudentes face aux opérations irréversibles.

Configuration

  • Base exacte : Qwen/Qwen3-4B, révision 1cfa9a7208912126459214e8b04321603b3df60c
  • Méthode : LoRA FP16
  • Rang / alpha / dropout : 16 / 32 / 0,05
  • Modules : projections attention et MLP
  • Paramètres entraînables : 33 030 144 (0,814 %)
  • Entraînement : 1 époque, 30 pas, lot effectif 8
  • GPU : AMD Radeon RX 7900 XT, PyTorch ROCm 7.14

Résultats du run

  • Perte d'entraînement : 0,8342
  • Perte d'évaluation : 0,2369 sur 60 exemples séparés
  • Pic GPU réservé : 10 542 383 104 octets
  • SHA-256 de adapter_model.safetensors : 4fd22be3258188b2fa9f61353c895d90abb4aa0f6a8852f2798681fda71e49c3

Le rapport machine complet est fourni dans training_report.json.

Limites

Ce petit corpus à base de patrons mesure surtout l'apprentissage des patrons visés. Il ne constitue ni une certification de sûreté générale, ni une preuve d'absence de régression, ni une source de connaissances actuelles. Les cinq tests de génération conservés sont une vérification technique et une revue ciblée, pas une évaluation de sécurité exhaustive.

Downloads last month
1
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for StephaneGSL/qwen3-safe-fr-lora

Finetuned
Qwen/Qwen3-4B
Adapter
(1114)
this model