This model was quantized using oQ (oMLX v0.5.9.dev3) mixed-precision quantization. Base model is meta-models/Muse-Glimmer-30B

Downloads last month
-
Safetensors
Model size
6B params
Tensor type
F16
U32
F32
MLX
Hardware compatibility
Log In to add your hardware

4-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 馃檵 Ask for provider support

Model tree for redfox2002/Muse-Glimmer-30B-oQ4-fp16

Quantized
(66)
this model