inference-optimization/Qwen3-8B-DFlash-b16-fullattn-fulldataset-rerun-clean-muon1e3-ckpt0 2B • Updated 16 days ago • 14
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16.adamw-g7-ckpt8 2B • Updated 16 days ago • 21
inference-optimization/Qwen3-8B-DFlash-b16-fullattn-fulldataset-rerun-clean-muon1e3-ckpt0-halfepoch1 2B • Updated 16 days ago • 3
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16.adamw-g7-ckpt7 2B • Updated 16 days ago • 19
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16.adamw-g7-ckpt6 2B • Updated 17 days ago • 23
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16.adamw-g7-ckpt5 2B • Updated 19 days ago • 64
inference-optimization/Qwen3-8B-speculator.dflash.fullattn-qwen235b-instruct-bs16-ckpt2 2B • Updated 25 days ago • 36
inference-optimization/Llama-3.1-8B-Instruct-NVFP4-GPTQ-BlockSize16 5B • Updated 25 days ago • 14 • 1
inference-optimization/Qwen3-8B-speculator.dflash.fullattn-qwen235b-instruct-bs16-ckpt1 2B • Updated 26 days ago • 135
inference-optimization/Qwen3-8B-speculator.dflash.swa.causal-qwen235b-instruct-bs16-muon-ckpt6 2B • Updated 26 days ago • 63
inference-optimization/dflash-DeepSeek-V4-Flash-all-swa-muon-speculators-online-500k 2B • Updated about 1 month ago • 15
inference-optimization/GLM-5.2-0.8B-A0.8B Text Generation • 0.8B • Updated about 1 month ago • 3.15k • 3