inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp4 3B • Updated 1 day ago • 29
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp3 3B • Updated 1 day ago • 22
inference-optimization/Qwen3-8B-speculator.dflash2.v1.fullvocab.muon.dpace-preresume-epoch2 2B • Updated 3 days ago • 17
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp2 3B • Updated 4 days ago • 25
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp1 3B • Updated 4 days ago • 22
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp0 3B • Updated 4 days ago • 17
inference-optimization/Qwen3.8-Flash-Next-0.2B-A0.2B Image-Text-to-Text • 0.2B • Updated 4 days ago • 807 • 2
inference-optimization/Qwen3-8B-speculator.dspark.swa.gammatv.2048anc.muon.regencollection.selfdistill-v3-epoch2 2B • Updated 17 days ago • 59
inference-optimization/Qwen3-8B-speculator.dspark.swa.gammatv.2048anc.muon.regencollection.selfdistill-v3-epoch1 2B • Updated 17 days ago • 42
inference-optimization/Qwen3-8B-speculator.dspark.swa.gammatv.2048anc.muon.regencollection.selfdistill-v3-epoch0 2B • Updated 17 days ago • 47
inference-optimization/Qwen3-8B-speculator.dflash.swa.dpace.fullvocab.muon.1536anc.nemotron.v2v3-v8-ckpt19 2B • Updated 17 days ago • 43
inference-optimization/Nemotron-3.5-Lightning-1.4B-A0.1B-MTP Text Generation • 1B • Updated 18 days ago • 689 • 1
inference-optimization/GLM-5.3-Flash-0.1B-A0.1B Image-Text-to-Text • 84.4M • Updated 18 days ago • 1.15k • 3