Model hub — Distillio
← Home
Hand-picked lab flagship models for fine-tuning (safetensors), and ready-to-run GGUF quantizations for local inference (Ollama, LM Studio, llama.cpp). Download links go to the original Hugging Face repos.
Fine-tune models (safetensors)
- Qwen/Qwen3.5-2B — transformers · qwen3_5 · image-text-to-text (2B params, 4,548,221,488, updated 2026-03-02)
- Qwen/Qwen3.5-4B — transformers · qwen3_5 · image-text-to-text (5B params, 9,319,828,096, updated 2026-03-02)
- Qwen/Qwen3-VL-8B-Instruct — transformers · qwen3_vl · image-text-to-text (9B params, 17,534,339,512, updated 2025-10-15)
- Qwen/Qwen3-4B-Instruct-2507 — transformers · qwen3 · conversational (4B params, 8,044,982,000, updated 2025-09-17)
- Qwen/Qwen3-8B — transformers · qwen3 · conversational (8B params, 16,381,516,776, updated 2025-07-26)
- Qwen/Qwen2.5-7B-Instruct — transformers · qwen2 · chat (8B params, 15,231,271,888, updated 2025-01-12)
- Qwen/Qwen2.5-Coder-7B-Instruct — transformers · qwen2 · code (8B params, 15,231,271,864, updated 2025-01-12)
- ornith-ai/Ornith-1.5-9B — transformers · qwen3_5 · image-text-to-text (10B params, 19,306,303,864, updated 2026-08-23)
- Pluto-AI-Labs/Apollo-VL-Edge-3B — qwen2_5_vl · vision (4B params, 7,509,337,112, updated 2026-08-16)
- Pluto-AI-Labs/Atlas-Frontier-Distill-3B — transformers · qwen2 · distillation (3B params, updated 2026-08-03)
- HuggingFaceTB/SmolLM3-3B — transformers · smollm3 · conversational (3B params, 6,150,235,008, updated 2025-09-10)
- ibm-granite/granite-4.2-3b — transformers · granite · granite-4.2 (4B params, 7,319,517,120, updated 2026-09-02)
- ibm-granite/granite-4.2-8b — transformers · granite · granite-4.2 (9B params, 17,583,228,032, updated 2026-09-04)
- mistralai/Ministral-3-3B-Instruct-2512 — vllm · mistral3 (4B params, 9,344,188,292, updated 2026-07-15)
- mistralai/Ministral-3-8B-Instruct-2512 — vllm · mistral3 (9B params, 20,841,288,000, updated 2026-07-15)
- mistralai/Ministral-3-14B-Instruct-2512 — vllm · mistral3 (14B params, 31,453,437,040, updated 2026-07-15)
- microsoft/Fara1.5-4B — transformers · qwen3_5 · image-text-to-text (5B params, 9,078,620,456, updated 2026-07-27)
- openai/gpt-oss-20b — transformers · gpt_oss · vllm (21B params, 27,522,617,888, updated 2025-08-26)
- XiaomiMiMo/MiMo-VL-7B-RL-2508 — transformers · qwen2_5_vl · image-text-to-text (8B params, 16,612,526,808, updated 2025-08-21)
- tencent/Hy-MT2-1.8B — transformers · hunyuan_v1_dense · translation (2B params, 4,077,072,784, updated 2026-05-26)
- tencent/Hy-MT2-7B — transformers · hunyuan_v1_dense · translation (8B params, 16,059,122,256, updated 2026-05-26)
- tencent/Hy-MT2-30B-A3B — transformers · hy_v3 · translation (30B params, 60,131,744,832, updated 2026-07-21)
- tencent/Hunyuan-A13B-Instruct — transformers · hunyuan_v1_moe · conversational (80B params, 160,803,954,720, updated 2025-08-21)
- XiaomiMiMo/MiMo-7B-RL — transformers · mimo · conversational (8B params, 15,666,870,936, updated 2025-06-05)
- XiaomiMiMo/MiMo-V2.5 — transformers · mimo_v2 · multimodal (311B params, 315,693,004,496, updated 2026-07-09)
- Qwen/Qwen3.8-27B — transformers · qwen3_5 · image-text-to-text (27B params, 55,563,006,776, updated 2026-08-14)
- meta-models/Muse-Glimmer-30B — transformers · muse_glimmer · image-text-to-text (30B params, 59,553,435,272, updated 2026-08-11)
- google/gemma-4-12B — transformers · gemma4_unified · image-text-to-text (12B params, 23,919,549,408, updated 2026-07-15)
- google/gemma-4-32B — multimodal MoE (32B params)
- Qwen/Qwen3.6-35B-A3B — transformers · qwen3_5_moe · image-text-to-text (35B params, 71,903,776,776, updated 2026-04-24)
- Qwen/Qwen3.6-27B — transformers · qwen3_5 · image-text-to-text (27B params, 55,563,006,400, updated 2026-04-24)
- Qwen/Qwen3.6-27B-FP8 — transformers · qwen3_5 · image-text-to-text (27B params, 30,866,866,928, updated 2026-04-24)
- Qwen/Qwen3.5-9B — transformers · qwen3_5 · image-text-to-text (9B params, 19,306,310,880, updated 2026-03-02)
- microsoft/phi-4 — transformers · phi3 · phi (14B params, 29,319,042,992, updated 2026-07-14)
- zai-org/GLM-4.7-Flash — transformers · glm4_moe_lite · conversational (30B params, 62,444,175,504, updated 2026-01-29)
- deepseek-ai/DeepSeek-Coder-V2-Lite-Instruct — transformers · deepseek_v2 · conversational (16B params, 31,413,626,609, updated 2024-07-03)
- meta-llama/Llama-Guard-4-12B — transformers · llama4 · image-text-to-text (12B params, 24,002,322,024, updated 2025-04-29)
- NousResearch/Hermes-4.3-36B — transformers · seed_oss · Bytedance Seed (36B params, updated 2025-12-06)
- NousResearch/Hermes-4-14B — transformers · qwen3 · Qwen-3-14B (14B params, 29,536,665,656, updated 2026-01-09)
Local GGUF models
Quantized for Ollama / LM Studio / llama.cpp, ordered by download popularity. Click a repo link to see its exact quant files on Hugging Face.
- ornith-ai/Ornith-1.5-9B-GGUF — transformers · conversational (9B params, 5,532,094 downloads, updated 2026-08-24)
- ornith-ai/Ornith-1.0-9B-GGUF — transformers · conversational (9B params, 3,443,588 downloads, updated 2026-06-25)
- unsloth/Qwen3.5-9B-GGUF — transformers · image-text-to-text · base_model:Qwen/Qwen3.5-9B (9B params, 1,580,056 downloads, updated 2026-03-02)
- unsloth/Qwen3.5-4B-GGUF — transformers · image-text-to-text · base_model:Qwen/Qwen3.5-4B (4B params, 913,362 downloads, updated 2026-03-02)
- unsloth/gemma-4-12b-it-GGUF — gemma4 · gemma (12B params, 724,164 downloads, updated 2026-07-17)
- unsloth/gemma-4-E2B-it-GGUF — gemma4 · gemma (2B params, 570,966 downloads, updated 2026-07-17)
- unsloth/Ornith-1.0-9B-GGUF — qwen3_5_moe · base_model:deepreinforce-ai/Ornith-1.0-9B (9B params, 535,857 downloads, updated 2026-07-18)
- unsloth/gemma-4-E4B-it-GGUF — gemma4 · gemma (4B params, 504,585 downloads, updated 2026-07-17)
- unsloth/Qwen3-4B-GGUF — transformers · qwen3 · qwen (4B params, 499,474 downloads, updated 2025-06-08)
- Qwen/Qwen3-4B-GGUF — base_model:Qwen/Qwen3-4B · base_model:quantized:Qwen/Qwen3-4B (4B params, 426,442 downloads, updated 2025-05-21)
- Qwen/Qwen3-8B-GGUF — base_model:Qwen/Qwen3-8B · base_model:quantized:Qwen/Qwen3-8B (8B params, 405,101 downloads, updated 2025-05-21)
- tencent/Hy-MT2-1.8B-GGUF — base_model:tencent/Hy-MT2-1.8B · base_model:quantized:tencent/Hy-MT2-1.8B (1.8B params, 374,083 downloads, updated 2026-09-08)
- bartowski/Qwen_Qwen3.5-4B-GGUF — image-text-to-text · base_model:Qwen/Qwen3.5-4B (4B params, 364,782 downloads, updated 2026-05-19)
- bartowski/Qwen_Qwen3.5-2B-GGUF — image-text-to-text · base_model:Qwen/Qwen3.5-2B (2B params, 350,588 downloads, updated 2026-05-19)
- bartowski/Qwen_Qwen3.5-0.8B-GGUF — image-text-to-text · base_model:Qwen/Qwen3.5-0.8B (0.8B params, 329,726 downloads, updated 2026-05-19)
- unsloth/Qwen3-VL-4B-Instruct-GGUF — transformers · qwen · qwen3 (4B params, 310,721 downloads, updated 2025-10-31)
- bartowski/Meta-Llama-3.1-8B-Instruct-GGUF — facebook · meta (8B params, 308,578 downloads, updated 2024-12-01)
- ibm-granite/granite-4.2-8b-GGUF — llama.cpp · language (8B params, 308,323 downloads, updated 2026-09-02)
- ibm-granite/granite-4.2-3b-GGUF — transformers · language · granite-4.2 (3B params, 290,963 downloads, updated 2026-09-02)
- Qwen/Qwen2.5-Coder-7B-Instruct-GGUF — transformers · code · codeqwen (7B params, 283,709 downloads, updated 2024-11-12)
- unsloth/Qwen3.5-2B-GGUF — transformers · image-text-to-text · base_model:Qwen/Qwen3.5-2B (2B params, 273,015 downloads, updated 2026-03-02)
- unsloth/Llama-3.2-3B-Instruct-GGUF — transformers · llama · llama-3 (3B params, 241,955 downloads, updated 2025-11-08)
- bartowski/Fara1.5-9B-GGUF — computer-use · cua (9B params, 234,257 downloads, updated 2026-07-22)
- bartowski/Fara1.5-4B-GGUF — computer-use · cua (4B params, 232,383 downloads, updated 2026-07-22)
- bartowski/tencent_UI-Mate-9B-GGUF — computer-use-agent · gui-agent (9B params, 224,717 downloads, updated 2026-08-18)
- unsloth/Qwen3.5-0.8B-GGUF — transformers · image-text-to-text · base_model:Qwen/Qwen3.5-0.8B (0.8B params, 218,716 downloads, updated 2026-03-02)
- Qwen/Qwen3-14B-GGUF — base_model:Qwen/Qwen3-14B · base_model:quantized:Qwen/Qwen3-14B (14B params, 203,265 downloads, updated 2025-05-09)
- Qwen/Qwen3-0.6B-GGUF — base_model:Qwen/Qwen3-0.6B · base_model:quantized:Qwen/Qwen3-0.6B (0.6B params, 197,570 downloads, updated 2025-05-09)
- bartowski/google_gemma-4-E2B-it-GGUF — image-text-to-text · base_model:google/gemma-4-E2B-it (2B params, 185,092 downloads, updated 2026-07-26)
- google/gemma-2b — transformers · gemma · text-generation-inference (2B params, 156,926 downloads, updated 2024-09-27)
- Qwen/Qwen3-VL-8B-Instruct-GGUF — transformers · image-text-to-text · base_model:Qwen/Qwen3-VL-8B-Instruct (8B params, 128,999 downloads, updated 2025-11-01)
- Qwen/Qwen3-VL-2B-Instruct-GGUF — transformers · image-text-to-text · base_model:Qwen/Qwen3-VL-2B-Instruct (2B params, 121,672 downloads, updated 2025-11-01)
- Qwen/Qwen2.5-Coder-1.5B-Instruct-GGUF — transformers · code · codeqwen (1.5B params, 120,877 downloads, updated 2024-11-12)
- Qwen/Qwen3-VL-4B-Instruct-GGUF — transformers · image-text-to-text · base_model:Qwen/Qwen3-VL-4B-Instruct (4B params, 120,837 downloads, updated 2025-11-01)
- bartowski/Llama-3.2-1B-Instruct-GGUF — facebook · meta (1B params, 119,269 downloads, updated 2024-10-08)
- bartowski/Llama-3.2-3B-Instruct-GGUF — facebook · meta (3B params, 110,281 downloads, updated 2024-10-08)
- Qwen/Qwen3-Embedding-0.6B-GGUF — base_model:Qwen/Qwen3-0.6B-Base · base_model:quantized:Qwen/Qwen3-0.6B-Base (0.6B params, 109,145 downloads, updated 2025-07-14)
- Qwen/Qwen2.5-Coder-14B-Instruct-GGUF — transformers · code · codeqwen (14B params, 107,622 downloads, updated 2024-11-12)
- bartowski/Qwen_Qwen3-14B-GGUF — base_model:Qwen/Qwen3-14B · base_model:quantized:Qwen/Qwen3-14B (14B params, 99,781 downloads, updated 2025-04-28)
- bartowski/Qwen_Qwen3.5-9B-GGUF — image-text-to-text · base_model:Qwen/Qwen3.5-9B (9B params, 98,611 downloads, updated 2026-05-19)