Qwen3.5-4B-saor

Modelo Qwen3.5-4B con los bloques FFN podados por magnitud (conexiones de mayor |w|) según un perfil de densidad por capa optimizado con CMA-ES (genoma CPPN como generador indirecto). Pesos activos re-empaquetados en Q4_K; adyacencia en formato GGUF disperso D16 (ffn_dag_adjacency + ffn_dag_weights).

Arquitectura base: transformer denso (33 bloques FFN [2560 → 9216]).

Métrica Valor
Divergencia KL (vs base, n_pos=4) 0.0638
Compresión D_arch (gate / modelo) 0.0965 / 0.0333
Capas esparsas 33
Método de poda Magnitud (top-|w|) + perfil CPPN

El perfil concentra la esparsidad en las capas intermedias (pico ~0.16) y deja las capas iniciales/finales casi densas. Para referencia: la poda uniforme a sp 0.10 da KL 0.108.

Ejecutar con Hayai

# 1. Compilar Hayai
cd hayai && cargo build --release

# 2. Dry-run del plan
cargo run --release -p hayai-cli -- plan --model Qwen3.5-4B-saor.gguf

# 3. Generar texto
cargo run --release -p hayai-cli -- generate \
  --model Qwen3.5-4B-saor.gguf \
  --prompt "The capital of France is" \
  --max-tokens 64 \
  --device auto

Evaluar la divergencia KL

cargo run --release --example kl_eval -- \
  --orig Qwen3.5-4B-Q4_K_M.gguf \
  --sparse Qwen3.5-4B-saor.gguf \
  --prompts calib128.txt --n-positions 4 --device auto

Archivos

  • Qwen3.5-4B-saor.gguf — el modelo disperso (~2.8 GB, Q4_K).
  • sparsities.txt — perfil de esparsidad por capa (33 floats).

Reproducibilidad

Perfil obtenido con el loop evolutivo de SAOR (via_b_evolve --batch-eval --magnitude, 12 generaciones): CMA-ES sobre un genoma CPPN que decodifica el perfil de densidad; adyacencia = top-|w| a esa densidad. Genoma (466 f32) e histórico disponibles bajo demanda.

Atribución: modelo base Qwen/Qwen3.5-4B — consulte la licencia del modelo base.

Downloads last month
-
GGUF
Model size
4B params
Architecture
qwen35
Hardware compatibility
Log In to add your hardware

We're not able to determine the quantization variants.

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for aitups/Qwen3.5-4B-saor

Finetuned
Qwen/Qwen3.5-4B
Quantized
(402)
this model

Collection including aitups/Qwen3.5-4B-saor