I

@inference-optimization

@inference-optimization 尚未认领。 任何人都可以保留这个用户名。如果你已控制对应的 Hugging Face 账户或组织,可以认领并验证,获得 认证创作者 徽章。
认领 @inference-optimization →

模型

29 个模型 · 91k 次下载

inference-optimization/Llama-3.2-0.5B-Instruct
119 天前更新
需要做种者 →text-generation1.0 GB 25k
inference-optimization/Qwen3-1.6B-A0.9B
128 天前更新
需要做种者 →text-generation3.1 GB 16k
inference-optimization/Qwen3-8B-from-Qwen3-8B_regen-speculators.eagle3-qwen3arch-ckpt1
112 天前更新
需要做种者 →2.0 GB 8.1k
inference-optimization/Qwen3-8B-speculators.peagle-qwen3arch-ckpt4
106 天前更新
需要做种者 →3.2 GB 8.1k
inference-optimization/Qwen3-Coder-Next.w4a16
202 天前更新
需要做种者 →text-generation316 GB 6.7k
inference-optimization/GLM-5.2-0.8B-A0.8B
90 天前更新
需要做种者 →text-generation3.4 GB 5.7k
inference-optimization/Qwen3.8-1.0B-A0.6B
49 天前更新
需要做种者 →text-generation1.9 GB 5.0k
inference-optimization/NemotronH-0.3B-A0.3B
16 天前更新
需要做种者 →text-generation693 MB 3.4k
inference-optimization/Kimi-K3-0.40B-MXFP4
12 天前更新
需要做种者 →1.5 GB 3.2k
inference-optimization/GLM-5.3-Flash-0.1B-A0.1B
30 天前更新
需要做种者 →image-text-to-text169 MB 1.6k
inference-optimization/Kimi-K3-0.40B
64 天前更新
需要做种者 →feature-extraction1.6 GB 1.0k
inference-optimization/Qwen3.8-Flash-Next-0.2B-A0.2B
16 天前更新
需要做种者 →image-text-to-text328 MB 992
inference-optimization/Qwen3.6-8B-A1.6B
21 天前更新
需要做种者 →image-text-to-text16 GB 954
inference-optimization/GLM-5.3-0.6B-A0.4B
16 天前更新
需要做种者 →text-generation1.2 GB 757
inference-optimization/Inkling-0.6B-A0.6B
72 天前更新
需要做种者 →image-text-to-text2.6 GB 733
inference-optimization/DeepSeek-V4-Pro-0.5B-A0.37B
70 天前更新
需要做种者 →text-generation997 MB 712
inference-optimization/Phi-3.5-MoE-0.8B-A0.2B
100 天前更新
需要做种者 →text-generation1.6 GB 708
inference-optimization/Llama-4-Scout-1.7B-0.4B-Instruct
118 天前更新
需要做种者 →image-text-to-text6.9 GB 704
inference-optimization/Qwen3-VL-1.0B-A0.4B-Instruct
75 天前更新
需要做种者 →image-text-to-text2.9 GB 696
inference-optimization/Nemotron-3.5-Lightning-1.4B-A0.1B-MTP
30 天前更新
需要做种者 →text-generation4.0 GB 336
inference-optimization/Qwen3-30B-A3B-Thinking-2507-REAP-25-uniform
昨天更新
需要做种者 →text-generation47 GB 235
inference-optimization/Qwen3-30B-A3B-Thinking-2507-REAP-25-nonuniform
昨天更新
需要做种者 →text-generation47 GB 151
inference-optimization/Qwen3.8-27B-DSpark-Gauss-NVFP4-W4A4
2 天前更新
需要做种者 →text-generation2.1 GB 134
inference-optimization/Qwen3.8-27B-DSpark-PerfectBlend-NVFP4-W4A4
2 天前更新
需要做种者 →text-generation2.1 GB 133
inference-optimization/Qwen3-8B-DFlash-Gauss-NVFP4-W4A4
6 天前更新
需要做种者 →text-generation1.3 GB 99
inference-optimization/Qwen3-Coder-Next.w8a8
191 天前更新
需要做种者 →text-generation82 GB 96
inference-optimization/Qwen3-8B-DFlash-PerfectBlend-NVFP4-W4A4
6 天前更新
需要做种者 →text-generation1.3 GB 95
inference-optimization/DeepSeek-R1-Distill-Llama-8B-NVFP4
47 天前更新
需要做种者 →text-generation5.6 GB 93
inference-optimization/Qwen3-235B-A22B-Thinking-2507-quantized.w4a16
133 天前更新
需要做种者 →text-generation941 GB 46