Gemma 3 270M Grounded Behavior — Fine-tuned V9

Modelo fine-tuned a partir de unsloth/gemma-3-270m-it com Unsloth e LoRA. Os pesos LoRA foram fundidos no modelo base e publicados em 16-bit.

Treino

  • Dataset: empgces/grounded-behavior-n1-pt
  • Épocas: 2
  • Exemplos de treino: 4440
  • Passos realizados: 1110
  • Learning rate: 0.0002
  • LoRA rank: 16
  • LoRA alpha: 32

Avaliação desta execução

  • Normalized Match: 86.00%
  • Prediction in Context: 98.00%
  • Loss final: 0.121574

GGUF

A versão GGUF está em empgces/gemma3-270m-grounded-behavior-finetuned-v9-GGUF.

Prompt

Utilize o chat template incluído no tokenizer. O treino pede respostas curtas, completas e estritamente fundamentadas no contexto fornecido.

Downloads last month
33
Safetensors
Model size
0.3B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for empgces/gemma3-270m-grounded-behavior-finetuned-v9

Finetuned
(426)
this model
Quantizations
1 model

Dataset used to train empgces/gemma3-270m-grounded-behavior-finetuned-v9