ggml-org AI Models

Tracked by OpenModelStats since Aug 23, 2026 · View on Hugging Face ↗

Tracked models
158
Downloads 30D
6.6M
Total downloads
91.3M
Total likes
2,792
Gained 7D
1.4M

Most downloaded

  1. 1Qwen3.8-27B-GGUFSep 27, 20262M
  2. 2gemma-4-E4B-it-GGUFJul 26, 2026625.5K
  3. 3models-movedOct 28, 2025502.5K
  4. 4embeddinggemma-300M-GGUFApr 29, 2026327.8K
  5. 5gemma-4-26B-A4B-it-GGUFJul 26, 2026319.1K
  6. 6gemma-3-1b-it-GGUFMar 12, 2025204.9K
  7. 7NVIDIA-Nemotron-3.5-Lightning-30B-A3B-GGUFSep 13, 2026192.9K
  8. 8gpt-oss-20b-GGUFJul 28, 2026155.5K
  9. 9gpt-oss-120b-GGUFJul 28, 2026144.4K
  10. 10Qwen3.6-35B-A3B-GGUFJul 16, 2026120.5K

Fastest growing

  1. 1gemma-4-E4B-it-GGUF+232.4K in 7D625.5K
  2. 2Qwen3.8-27B-GGUF+201.3K in 7D2M
  3. 3models-moved+155.8K in 7D502.5K
  4. 4embeddinggemma-300M-GGUF+76.1K in 7D327.8K
  5. 5gemma-4-26B-A4B-it-GGUF+74.7K in 7D319.1K
  6. 6Qwen3.5-0.8B-GGUF+60K in 7D96.6K
  7. 7gemma-3-1b-it-GGUF+45.3K in 7D204.9K
  8. 8NVIDIA-Nemotron-3.5-Lightning-30B-A3B-GGUF+44.6K in 7D192.9K
  9. 9gpt-oss-20b-GGUF+31.2K in 7D155.5K
  10. 10tinygemma3-GGUF+27.8K in 7D104.1K

Recently updated

  1. 1Muse-Glimmer-30B-GGUFOct 8, 2026285
  2. 2GLM-5.3-Flash-GGUFOct 8, 20261,935
  3. 3vocabsOct 7, 20261,900
  4. 4embeddinggemma-2-GGUFOct 6, 202612.6K
  5. 5Clef-GGUFOct 5, 202614.2K
  6. 6Clef-Flash-GGUFOct 5, 202631.1K
  7. 7Laya-GGUFOct 4, 202611.1K
  8. 8MiMo-V2.6-Pro-RL-GGUFOct 2, 20261,293
  9. 9MiMo-V2.6-Pro-MOPD-GGUFOct 2, 20261,422
  10. 10Bespoke-Nimble-9B-v3-GGUFOct 2, 202614K

All models

All tracked models published by ggml-org
ModelDL 30D7D
gemma-3-270m-it-GGUFggml-org/gemma-3-270m-it-gguf3,769+1,105
SmolVLM-Instruct-GGUFggml-org/smolvlm-instruct-gguf3,450+747
gemma-3n-E2B-it-GGUFggml-org/gemma-3n-e2b-it-gguf2,984+1,634
Qwen2.5-Coder-1.5B-Instruct-Q8_0-GGUFggml-org/qwen2.5-coder-1.5b-instruct-q8_0-gguf2,853+1,332
MiniCPM-V-4.6-GGUFggml-org/minicpm-v-4.6-gguf2,817+875
Qwen3-30B-A3B-GGUFggml-org/qwen3-30b-a3b-gguf2,674+1,217
gemma-3-270m-it-qat-GGUFggml-org/gemma-3-270m-it-qat-gguf2,642+687
Qwen2.5-Coder-14B-Instruct-Q8_0-GGUFggml-org/qwen2.5-coder-14b-instruct-q8_0-gguf2,617+349
ultravox-v0_5-llama-3_2-1b-GGUFggml-org/ultravox-v0_5-llama-3_2-1b-gguf2,611+614
Qwen3-8B-GGUFggml-org/qwen3-8b-gguf2,497+580
Laguna-XS-2.1-GGUFggml-org/laguna-xs-2.1-gguf2,455+1,410
Qwen2.5-Coder-7B-Q8_0-GGUFggml-org/qwen2.5-coder-7b-q8_0-gguf2,336+567
SmolLM2-135M-GGUFggml-org/smollm2-135m-gguf2,302+332
Qwen2.5-Coder-3B-Q8_0-GGUFggml-org/qwen2.5-coder-3b-q8_0-gguf2,262+561
jina-embeddings-v2-base-code-Q8_0-GGUFggml-org/jina-embeddings-v2-base-code-q8_0-gguf2,187+225
Qwen2.5-Coder-7B-Instruct-Q8_0-GGUFggml-org/qwen2.5-coder-7b-instruct-q8_0-gguf2,157+457
InternVL3-2B-Instruct-GGUFggml-org/internvl3-2b-instruct-gguf2,156+531
ultravox-v0_5-llama-3_1-8b-GGUFggml-org/ultravox-v0_5-llama-3_1-8b-gguf2,143+681
Nomic-Embed-Text-V2-GGUFggml-org/nomic-embed-text-v2-gguf2,139+391
gemma-3n-E4B-it-GGUFggml-org/gemma-3n-e4b-it-gguf2,131+646
granite-docling-258M-GGUFggml-org/granite-docling-258m-gguf2,099+474
gemma-3-12b-it-qat-GGUFggml-org/gemma-3-12b-it-qat-gguf2,034+539
MiMo-V2.6-Flash-MOPD-GGUFggml-org/mimo-v2.6-flash-mopd-gguf2,019—
bge-small-en-v1.5-Q8_0-GGUFggml-org/bge-small-en-v1.5-q8_0-gguf1,970+254
NVIDIA-Nemotron-3-Nano-Omni-30B-A3B-GGUFggml-org/nvidia-nemotron-3-nano-omni-30b-a3b-gguf1,923+713