inference-optimization/Qwen3-VL-1.0B-A0.4B-Instruct Image-Text-to-Text • 1B • Updated Jul 17 • 54 • 1
inference-optimization/GLM-5.3-Flash-0.1B-A0.1B Image-Text-to-Text • 84.4M • Updated about 7 hours ago • 326 • 3
inference-optimization/Qwen3.8-Flash-Next-0.2B-A0.2B Image-Text-to-Text • 0.2B • Updated about 7 hours ago • 341 • 2
inference-optimization/Nemotron-3.5-Lightning-1.4B-A0.1B-MTP Text Generation • 1B • Updated about 7 hours ago