inference-optimization/Qwen3-30B-A3B-Thinking-2507-REAP-25-nonuniform Text Generation • 23B • Updated 1 day ago • 151
inference-optimization/Qwen3-30B-A3B-Thinking-2507-REAP-25-uniform Text Generation • 23B • Updated 1 day ago • 235 • 1
inference-optimization/qwen3.8-27B-speculator.dflash2.comparisonrecipe.v2.epoch1_end 2B • Updated 1 day ago • 21
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.bs8.ckp0 3B • Updated 2 days ago • 17
inference-optimization/Qwen3.8-27B-DSpark-GPTQ-IMatrix-PerfectBlend-NVFP4-W4A4 Text Generation • 2B • Updated 2 days ago • 27
inference-optimization/Qwen3.8-27B-DSpark-GPTQ-IMatrix-Gauss-NVFP4-W4A4 Text Generation • 2B • Updated 2 days ago • 26
inference-optimization/Qwen3.8-27B-DSpark-GPTQ-PerfectBlend-NVFP4-W4A4 Text Generation • 2B • Updated 2 days ago • 22
inference-optimization/Qwen3.8-27B-DSpark-GPTQ-Gauss-NVFP4-W4A4 Text Generation • 2B • Updated 2 days ago • 24
inference-optimization/Qwen3.8-27B-DSpark-PerfectBlend-NVFP4-W4A4 Text Generation • 2B • Updated 2 days ago • 133
inference-optimization/Qwen3.8-27B-DSpark-Gauss-NVFP4-W4A4 Text Generation • 2B • Updated 2 days ago • 134
inference-optimization/Qwen3.8-27B-DSpark-PerfectBlend-FP8-W8A8 Text Generation • 2B • Updated 2 days ago • 26
inference-optimization/Qwen3.8-27B-DSpark-Gauss-FP8-W8A8 Text Generation • 2B • Updated 2 days ago • 26
inference-optimization/qwen3.8-27B-speculator.dflash2.comparisonrecipe.v2.epoch1_step107505 2B • Updated 2 days ago • 24
inference-optimization/Qwen3-8B-DFlash-GPTQ-IMatrix-PerfectBlend-NVFP4-W4A4 Text Generation • 1B • Updated 3 days ago • 24
inference-optimization/Qwen3-8B-DFlash-GPTQ-IMatrix-Gauss-NVFP4-W4A4 Text Generation • 1B • Updated 3 days ago • 22
inference-optimization/Qwen3-8B-DFlash-GPTQ-PerfectBlend-NVFP4-W4A4 Text Generation • 1B • Updated 3 days ago • 20
inference-optimization/Qwen3-8B-DFlash-GPTQ-Gauss-NVFP4-W4A4 Text Generation • 1B • Updated 3 days ago • 21
inference-optimization/qwen3.8-27B-speculator.dflash2.comparisonrecipe.epoch1_step93171 2B • Updated 5 days ago • 42
inference-optimization/Qwen3-8B-DFlash-PerfectBlend-NVFP4-W4A4 Text Generation • 1B • Updated 6 days ago • 95
inference-optimization/Qwen3-8B-DFlash-Gauss-NVFP4-W4A4 Text Generation • 1B • Updated 6 days ago • 99
inference-optimization/Qwen3-8B-DFlash-PerfectBlend-FP8-W8A8 Text Generation • 1B • Updated 6 days ago • 21