Qwen3.8-2.4T-A95B-DFlash

6-layer DFlash speculative-decoding draft for modal-labs/Qwen3.8-2.4T-A95B-NVFP4. Training data was regenerated from that model.

Downloads last month
1,713
Safetensors
Model size
3B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for modal-labs/Qwen3.8-2.4T-A95B-DFlash

Finetuned
(1)
this model