I

@inference-optimization

@inference-optimization is unclaimed. Anyone can reserve this handle. If you already control the matching Hugging Face account or organization, you can claim and verify it for the Verified creator badge.
Claim @inference-optimization β†’

Models

29 models Β· 91k downloads

inference-optimization/Llama-3.2-0.5B-Instruct
updated 119d ago
Needs a seeder β†’text-generation1.0 GB 25k
inference-optimization/Qwen3-1.6B-A0.9B
updated 129d ago
Needs a seeder β†’text-generation3.1 GB 16k
inference-optimization/Qwen3-8B-from-Qwen3-8B_regen-speculators.eagle3-qwen3arch-ckpt1
updated 112d ago
Needs a seeder β†’2.0 GB 8.1k
inference-optimization/Qwen3-8B-speculators.peagle-qwen3arch-ckpt4
updated 106d ago
Needs a seeder β†’3.2 GB 8.1k
inference-optimization/Qwen3-Coder-Next.w4a16
updated 202d ago
Needs a seeder β†’text-generation316 GB 6.7k
inference-optimization/GLM-5.2-0.8B-A0.8B
updated 90d ago
Needs a seeder β†’text-generation3.4 GB 5.7k
inference-optimization/Qwen3.8-1.0B-A0.6B
updated 49d ago
Needs a seeder β†’text-generation1.9 GB 5.0k
inference-optimization/NemotronH-0.3B-A0.3B
updated 16d ago
Needs a seeder β†’text-generation693 MB 3.4k
inference-optimization/Kimi-K3-0.40B-MXFP4
updated 12d ago
Needs a seeder β†’1.5 GB 3.2k
inference-optimization/GLM-5.3-Flash-0.1B-A0.1B
updated 30d ago
Needs a seeder β†’image-text-to-text169 MB 1.6k
inference-optimization/Kimi-K3-0.40B
updated 64d ago
Needs a seeder β†’feature-extraction1.6 GB 1.0k
inference-optimization/Qwen3.8-Flash-Next-0.2B-A0.2B
updated 16d ago
Needs a seeder β†’image-text-to-text328 MB 992
inference-optimization/Qwen3.6-8B-A1.6B
updated 21d ago
Needs a seeder β†’image-text-to-text16 GB 954
inference-optimization/GLM-5.3-0.6B-A0.4B
updated 16d ago
Needs a seeder β†’text-generation1.2 GB 757
inference-optimization/Inkling-0.6B-A0.6B
updated 72d ago
Needs a seeder β†’image-text-to-text2.6 GB 733
inference-optimization/DeepSeek-V4-Pro-0.5B-A0.37B
updated 70d ago
Needs a seeder β†’text-generation997 MB 712
inference-optimization/Phi-3.5-MoE-0.8B-A0.2B
updated 100d ago
Needs a seeder β†’text-generation1.6 GB 708
inference-optimization/Llama-4-Scout-1.7B-0.4B-Instruct
updated 118d ago
Needs a seeder β†’image-text-to-text6.9 GB 704
inference-optimization/Qwen3-VL-1.0B-A0.4B-Instruct
updated 75d ago
Needs a seeder β†’image-text-to-text2.9 GB 696
inference-optimization/Nemotron-3.5-Lightning-1.4B-A0.1B-MTP
updated 30d ago
Needs a seeder β†’text-generation4.0 GB 336
inference-optimization/Qwen3-30B-A3B-Thinking-2507-REAP-25-uniform
updated yesterday
Needs a seeder β†’text-generation47 GB 235
inference-optimization/Qwen3-30B-A3B-Thinking-2507-REAP-25-nonuniform
updated yesterday
Needs a seeder β†’text-generation47 GB 151
inference-optimization/Qwen3.8-27B-DSpark-Gauss-NVFP4-W4A4
updated 2d ago
Needs a seeder β†’text-generation2.1 GB 134
inference-optimization/Qwen3.8-27B-DSpark-PerfectBlend-NVFP4-W4A4
updated 2d ago
Needs a seeder β†’text-generation2.1 GB 133
inference-optimization/Qwen3-8B-DFlash-Gauss-NVFP4-W4A4
updated 6d ago
Needs a seeder β†’text-generation1.3 GB 99
inference-optimization/Qwen3-Coder-Next.w8a8
updated 191d ago
Needs a seeder β†’text-generation82 GB 96
inference-optimization/Qwen3-8B-DFlash-PerfectBlend-NVFP4-W4A4
updated 6d ago
Needs a seeder β†’text-generation1.3 GB 95
inference-optimization/DeepSeek-R1-Distill-Llama-8B-NVFP4
updated 47d ago
Needs a seeder β†’text-generation5.6 GB 93
inference-optimization/Qwen3-235B-A22B-Thinking-2507-quantized.w4a16
updated 133d ago
Needs a seeder β†’text-generation941 GB 46