Team Ai
30 shown

models

Open weights, fine-tunes and adapters. Every listing here comes live from the Hugging Face Hub, attributed to it, and links back to the source.

Clear all
01inference-optimization /Llama-3.2-0.5B-Instructtext-generationtransformers1 likes21k downloads4mo agoHugging Face02inference-optimization /Qwen3-1.6B-A0.9Btext-generationtransformers3 likes15k downloads5mo agoHugging Face03inference-optimization /Qwen3-Coder-Next.w4a16text-generation1 likes6.8k downloads7mo agoHugging Face04inference-optimization /GLM-5.2-0.8B-A0.8Btext-generationtransformers4 likes5.1k downloads3mo agoHugging Face05inference-optimization /Qwen3.8-1.0B-A0.6Btext-generationtransformers6 likes4.5k downloads2mo agoHugging Face06inference-optimization /NemotronH-0.3B-A0.3Btext-generationtransformers1 likes3.7k downloads23d agoHugging Face07inference-optimization /GLM-5.3-0.6B-A0.4Btext-generationtransformers1 likes929 downloads22d agoHugging Face08inference-optimization /Phi-3.5-MoE-0.8B-A0.2Btext-generationtransformers1 likes856 downloads4mo agoHugging Face09inference-optimization /DeepSeek-V4-Pro-0.5B-A0.37Btext-generationtransformers0 likes839 downloads3mo agoHugging Face10VertexAIco /Bonsai-27b-MLX-Optimizationtext-generationmlx0 likes287 downloads8d agoHugging Face11inference-optimization /Qwen3-30B-A3B-Thinking-2507-REAP-25-uniformtext-generationtransformers1 likes285 downloads7d agoHugging Face12inference-optimization /Nemotron-3.5-Lightning-1.4B-A0.1B-MTPtext-generationtransformers1 likes256 downloads1mo agoHugging Face13inference-optimization /ZAYA1-74B-preview-NVFP4text-generationtransformers0 likes234 downloads14d agoHugging Face14inference-optimization /Qwen3.8-27B-DSpark-PerfectBlend-NVFP4-W4A4text-generationspeculators0 likes182 downloads8d agoHugging Face15inference-optimization /Qwen3.8-27B-DSpark-Gauss-NVFP4-W4A4text-generationspeculators0 likes180 downloads8d agoHugging Face16inference-optimization /Qwen3-30B-A3B-Thinking-2507-REAP-25-nonuniformtext-generationtransformers0 likes166 downloads7d agoHugging Face17inference-optimization /sarvam-30b-NVFP4text-generation1 likes150 downloads7mo agoHugging Face18inference-optimization /Qwen3-8B-DFlash-Gauss-NVFP4-W4A4text-generationspeculators0 likes118 downloads12d agoHugging Face19inference-optimization /Qwen3-8B-DFlash-PerfectBlend-NVFP4-W4A4text-generationspeculators0 likes114 downloads12d agoHugging Face20inference-optimization /Qwen3-Coder-Next.w8a8text-generation0 likes90 downloads7mo agoHugging Face21inference-optimization /DeepSeek-R1-Distill-Llama-8B-NVFP4text-generationtransformers0 likes73 downloads2mo agoHugging Face22inference-optimization /Qwen3.8-27B-DSpark-GPTQ-IMatrix-PerfectBlend-NVFP4-W4A4text-generationspeculators0 likes68 downloads8d agoHugging Face23inference-optimization /Qwen3.8-27B-DSpark-FP8-DYNAMICtext-generationspeculators0 likes67 downloads8d agoHugging Face24inference-optimization /Qwen3.8-27B-DSpark-GPTQ-Gauss-NVFP4-W4A4text-generationspeculators0 likes65 downloads8d agoHugging Face25inference-optimization /Qwen3.8-27B-DSpark-GPTQ-PerfectBlend-NVFP4-W4A4text-generationspeculators0 likes64 downloads8d agoHugging Face26inference-optimization /Qwen3.8-27B-DSpark-GPTQ-IMatrix-Gauss-NVFP4-W4A4text-generationspeculators0 likes64 downloads8d agoHugging Face27inference-optimization /Qwen3.8-27B-DSpark-Gauss-FP8-W8A8text-generationspeculators0 likes62 downloads8d agoHugging Face28inference-optimization /Qwen3.8-27B-DSpark-PerfectBlend-FP8-W8A8text-generationspeculators0 likes62 downloads8d agoHugging Face29inference-optimization /Qwen3.8-27B-DSpark-FP8-BLOCKtext-generationspeculators0 likes55 downloads8d agoHugging Face30inference-optimization /Qwen3-235B-A22B-Thinking-2507-quantized.w4a16text-generationtransformers0 likes48 downloads5mo agoHugging Face

Listings come live from the Hugging Face Hub API. Team Ai does not host these files.