decider-0.8b Q4_K_M GGUF — der kleinste Decider, Android-/Edge-Kandidat

Q4_K_M-Quant von Mapika/decider-0.8b (Qwen3.5-0.8B-Base, Apache-2.0) — der kleinste Kopf der decider-Familie: ~505 MB, läuft auf Telefonen, Nano-PCs und alten GPUs.

Revision Commit-gepinnt a0a01d6f8135298f400a8c856b355793012ae971 (Stand 2026-09-25; das Repo hat keine Release-Tags — deshalb Commit statt Tag)
Quant Q4_K_M, 529.297.440 Bytes, sha256 aa40eca91f41e475b7c20a10af4247e8ae5b623f386b5c24501971909199496b
Toolchain llama.cpp Commit 9575389 + --no-mtp + bf16-Zwischenstufe (das getestete JevK5-Rezept)
⚠️ Toolchain-Warnung llama.cpp master (e351231, Sep 2026) baut kaputte qwen3_5_text-GGUFs: falsche Metadaten (block_count 33, recurrent_layers[33], Phantom-nextn) und verschobene Gewichte — Modell lädt, Output ist Müll. Pin euren Commit.
Readout-Temperatur 1.03 (Card-Standard der Familie; anders als decider-4b v2: 1.935!)
Prompt-Format Upstream-Layout: Context:\n{state}\n\nQuestion: {q}\nOptions:\n(A) …\n(B) …\nAnswer: ( — Buchstaben-Logits lesen, auf Optionen renormieren (÷ 1.03)

Rolle im JEV-Stack

Tier-0/1-Kandidat für Edge und Android: kalibrierte Wahrscheinlichkeiten in einem Forward-Pass. Gold-Set-Zahlen der großen Geschwister: decider-4b v2 (ECE 0,037 ≈ Teacher 0,033) — dieser 0.8b ist der Nächste in unserer Messpipeline.

Verifikation

Jede Entscheidung wird wie beim 4b gegen den bf16-Original-Readout geprüft, bevor sie in Produktion geht. provenance.json liegt bei (Quelle, Commit, sha256, Toolchain).

Downloads last month
46
GGUF
Model size
0.8B params
Architecture
qwen35
Hardware compatibility
Log In to add your hardware

4-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for mindchain/decider-0.8b-GGUF

Quantized
(6)
this model