inference-optimization/Qwen3-8B-speculator.dflash.fullattn-qwen235b-instruct-bs16-ckpt2 2B • Updated 19 days ago • 35
inference-optimization/Llama-3.1-8B-Instruct-NVFP4-GPTQ-BlockSize16 5B • Updated 20 days ago • 12 • 1
inference-optimization/Qwen3-8B-speculator.dflash.fullattn-qwen235b-instruct-bs16-ckpt1 2B • Updated 20 days ago • 133
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16-muon-ckpt6 2B • Updated 21 days ago • 62
inference-optimization/dflash-DeepSeek-V4-Flash-all-swa-muon-speculators-online-500k 2B • Updated 25 days ago • 31
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16-muon-ckpt5 2B • Updated 26 days ago • 129
inference-optimization/Qwen3-8B-speculator.dflash.swa.non-qwen3-step420136 2B • Updated 28 days ago • 99
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16-muon-ckpt4 2B • Updated 28 days ago • 62
inference-optimization/Qwen3-8B-speculator.dflash.fullattn-qwen235b-instruct-bs16-ckpt0 2B • Updated 29 days ago • 143
inference-optimization/dflash-DeepSeek-V4-Flash-swa-muon-speculators-50k 2B • Updated 30 days ago • 43
inference-optimization/dflash-DeepSeek-V4-Flash-all-swa-muon-speculators-50k 2B • Updated 30 days ago • 81 • 2
inference-optimization/Qwen3.5-397B-A17B-FP8-dynamic-data-subset-speculator.dflash 2B • Updated about 1 month ago • 39
inference-optimization/Qwen3-8B-from-Qwen3-8B_regen-speculators.eagle31-fcnorm-ckpt1 1B • Updated about 1 month ago • 36