inference-optimization/Llama-4-Scout-1.7B-0.4B-Instruct Image-Text-to-Text • 2B • Updated Jun 4 • 152
inference-optimization/Qwen3-VL-1.0B-A0.4B-Instruct Image-Text-to-Text • 1B • Updated Jul 17 • 145 • 1
inference-optimization/GLM-5.3-Flash-0.1B-A0.1B Image-Text-to-Text • 84.4M • Updated 17 days ago • 1.03k • 3
inference-optimization/Qwen3.8-Flash-Next-0.2B-A0.2B Image-Text-to-Text • 0.2B • Updated 3 days ago • 758 • 2
inference-optimization/Nemotron-3.5-Lightning-1.4B-A0.1B-MTP Text Generation • 1B • Updated 17 days ago • 683 • 1