AX-gemma-4-31b-MLX-AXQ-6bit-MTP

Checkpoint Tier 1 certified on df-macbookpro-m5 (2026-08-09) for Hub commit f024707acb0d. Measured size vs matched uniform baseline, quality retention ≥0.98, and conversion integrity. Tier 1 is not a speed claim: MTP acceleration is not certified. See the certificate.

AXQuant mixed-precision (AXQ) Gemma 4 target with multi-token prediction (MTP) — named like the Qwen AXQ-MTP line (…-MLX-AXQ-*-MTP).

Property Value
Product class AXQ 6bit
Target size 31B
Measured BPW ~6.00
Hub id AutomatosX/AX-gemma-4-31b-MLX-AXQ-6bit-MTP
Hub commit f024707acb0d123642a1ed21c75fc2b7b337bd1e
Engine pair gemma-4-31b-itgemma-4-31b-it-assistant
MTP layout assistant/ + ax_gemma4_assistant_mtp.json (Gemma assistant-MTP)
Certification host df-macbookpro-m5

Layout

./                          # AXQ target weights (+ vision sidecar when present)
assistant/                  # gemma4_assistant drafter
ax_gemma4_assistant_mtp.json
ax_composite_pack_manifest.json
axquant_*.json

Naming follows Qwen AXQ MTP packs: the -MTP suffix means MTP assets are in-repo.

Certification

Claim Status
Checkpoint Tier 1 (size + quality + load) Certified on df-macbookpro-m5
MTP acceleration Tier 2 Not certified (assistant-MTP is present for product completeness only)
Vision / multimodal quality Not claimed

Certificate: gemma4-31b-axq6-tier1.md

Runtime (AX Engine)

export AX_MLX_GEMMA4_ASSISTANT_MTP=1
export AX_MLX_GEMMA4_ASSISTANT_MTP_MAX_DEPTH=2
# load AutomatosX/AX-gemma-4-31b-MLX-AXQ-6bit-MTP as local snapshot root / --mlx-model-artifacts-dir

Default product text route remains direct decode unless you explicitly enable assistant-MTP.

Published / card updated: 2026-08-09.

Downloads last month
6
Safetensors
Model size
6B params
Tensor type
BF16
·
U32
·
MLX
Hardware compatibility
Log In to add your hardware

4-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for AutomatosX/AX-gemma-4-31b-MLX-AXQ-6bit-MTP

Quantized
(299)
this model