Qwen3.5-2B Gascon CPT Merged

Modèle complet obtenu par fusion de :

  • modèle de base : unsloth/Qwen3.5-2B
  • adaptateur CPT : Kadabra/Qwen3.5-2B-Gascon-CPT-LoRA

Entraînement

  • Méthode : Continued Pre-Training
  • Adaptation initiale : LoRA
  • Checkpoint utilisé : étape 7000
  • Étapes prévues : 7271
  • Progression atteinte : environ 96 %

Utilisation

from transformers import AutoTokenizer, AutoModelForCausalLM

model_id = "Kadabra/Qwen3.5-2B-Gascon-CPT-Merged"

tokenizer = AutoTokenizer.from_pretrained(
    model_id,
    trust_remote_code=True,
)

model = AutoModelForCausalLM.from_pretrained(
    model_id,
    dtype="auto",
    device_map="auto",
    trust_remote_code=True,
)

Ce dépôt contient un modèle complet fusionné.

Il ne nécessite plus de charger séparément l'adaptateur LoRA CPT et peut servir de modèle de départ pour un nouveau SFT LoRA.

Downloads last month
72
Safetensors
Model size
2B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for Kadabra/Qwen3.5-2B-Gascon-CPT-Merged

Finetuned
Qwen/Qwen3.5-2B
Finetuned
(163)
this model
Finetunes
1 model