Montalte/qwen4b-code-think-localize

Unified Qwen3-4B merge artifact for directional math↔code transfer experiments.

Field Value
Base Qwen/Qwen3-4B-Base@906bfd4b4dc7f14ee4320094d8b41684abff8539
Source specialist modrill/code-think-q4b-20260908
Domain code
Mode think
Method localize

Method

localize = Plan B Localize-and-Stitch on source-only MergeBench validation.

  • sparsity (keep) target: 0.1
  • lr=1e7, epochs=10, n-shot=64, seed=42, mask-profile=plan_b
  • task=coding
  • embed / lm_head skipped in mask (body-only stitch; matches prior Plan B protocol)

Uploaded: 2026-09-11.

Downloads last month
-
Safetensors
Model size
4B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for Montalte/qwen4b-code-think-localize

Finetuned
(451)
this model