RedHatAI AI Models

Tracked by OpenModelStats since Aug 23, 2026 · View on Hugging Face ↗

Tracked models
282
Downloads 30D
8.9M
Total downloads
120.9M
Total likes
2,311
Gained 7D
2.4M

Most downloaded

  1. 1Qwen3.6-35B-A3B-NVFP4Aug 13, 20261M
  2. 2NVIDIA-Nemotron-3.5-Lightning-30B-A3B-FP8Sep 17, 2026950.3K
  3. 3gemma-4-26B-A4B-it-FP8-dynamicAug 13, 2026890.2K
  4. 4Qwen3.8-27B-INT4Sep 28, 2026569.9K
  5. 5Llama-3.2-3B-Instruct-FP8-dynamicOct 9, 2024518.2K
  6. 6gemma-4-31B-it-FP8-blockAug 13, 2026433K
  7. 7Qwen3-32B-NVFP4Nov 21, 2025411.8K
  8. 8gemma-4-26B-A4B-it-NVFP4Aug 13, 2026315.2K
  9. 9gemma-3-27b-it-quantized.w4a16Jun 9, 2025293.7K
  10. 10Qwen3-Coder-Next-FP8-dynamicFeb 27, 2026288.1K

Fastest growing

  1. 1Qwen3.6-35B-A3B-NVFP4+314.9K in 7D1M
  2. 2NVIDIA-Nemotron-3.5-Lightning-30B-A3B-FP8+238.5K in 7D950.3K
  3. 3gemma-4-26B-A4B-it-FP8-dynamic+218K in 7D890.2K
  4. 4Qwen3-Coder-Next-FP8-dynamic+162.9K in 7D288.1K
  5. 5Llama-3.2-3B-Instruct-FP8-dynamic+127.5K in 7D518.2K
  6. 6gemma-4-31B-it-FP8-block+118.7K in 7D433K
  7. 7Qwen3.8-27B-INT4+117.4K in 7D569.9K
  8. 8Qwen3-32B-NVFP4+106.3K in 7D411.8K
  9. 9Llama-3.2-3B-Instruct-FP8+94.2K in 7D184.9K
  10. 10gemma-3-27b-it-quantized.w4a16+88.9K in 7D293.7K

Recently updated

  1. 1Qwen3.8-27B-MXFP4Oct 8, 2026853
  2. 2gemma-4-31B-it-speculator.dflashOct 7, 2026646
  3. 3Qwen3.5-35B-A3B-quantized.w8a8Oct 6, 2026406
  4. 4Laguna-S-2.1-NVFP4Oct 6, 2026316
  5. 5Laguna-S-2.1-FP8Oct 6, 2026193
  6. 6Qwen3.8-Flash-Next-NVFP4Oct 5, 20261,503
  7. 7wolf-defender-prompt-injectionOct 5, 202687
  8. 8DeepSeek-V4-Flash-0731-NVFP4Oct 2, 2026625
  9. 9granite-3.2-2b-instructOct 1, 2026309
  10. 10Qwen3.8-27B-NVFP4Sep 30, 202634.5K

All models

All tracked models published by RedHatAI
ModelDL 30D7D
Qwen2-1.5B-Instruct-quantized.w8a8redhatai/qwen2-1.5b-instruct-quantized.w8a81,070+0
Meta-Llama-3-8B-Instruct-FP8redhatai/meta-llama-3-8b-instruct-fp81,066+200
Qwen3.6-27B-FP8redhatai/qwen3.6-27b-fp81,041+360
Qwen3-32B-speculator.eagle3redhatai/qwen3-32b-speculator.eagle3988+182
Llama-3.3-70B-Instruct-quantized.w8a8redhatai/llama-3.3-70b-instruct-quantized.w8a8979+277
GLM-5.2-speculator.dspark-previewredhatai/glm-5.2-speculator.dspark-preview967+0
Qwen3.5-397B-A17B-FP8-dynamicredhatai/qwen3.5-397b-a17b-fp8-dynamic964+87
SmolLM3-3B-FP8-dynamicredhatai/smollm3-3b-fp8-dynamic959+181
Apertus-8B-Instruct-2509-FP8-dynamicredhatai/apertus-8b-instruct-2509-fp8-dynamic949+184
Meta-Llama-3.1-70B-Instruct-quantized.w8a8redhatai/meta-llama-3.1-70b-instruct-quantized.w8a8887+88
Qwen3-32B-FP8-dynamicredhatai/qwen3-32b-fp8-dynamic880+219
Qwen3.8-2.4T-A95B-NVFP4redhatai/qwen3.8-2.4t-a95b-nvfp4790+517
NVIDIA-Nemotron-3-Super-120B-A12B-FP8redhatai/nvidia-nemotron-3-super-120b-a12b-fp8787+97
Qwen3-1.7B-quantized.w4a16redhatai/qwen3-1.7b-quantized.w4a16752+111
Qwen3.8-2.4T-A95B-NVFP4-REAP-25redhatai/qwen3.8-2.4t-a95b-nvfp4-reap-25737+452
GLM-5.2-speculator.dsparkredhatai/glm-5.2-speculator.dspark721+176
Meta-Llama-3-70B-Instruct-FP8redhatai/meta-llama-3-70b-instruct-fp8716+120
TinyLlama-1.1B-Chat-v1.0-pruned2.4redhatai/tinyllama-1.1b-chat-v1.0-pruned2.4688+151
Devstral-Small-2507-FP8-Dynamicredhatai/devstral-small-2507-fp8-dynamic686+468
Llama-4-Scout-17B-16E-Instruct-NVFP4redhatai/llama-4-scout-17b-16e-instruct-nvfp4686+160
gemma-3-4b-it-FP8-dynamicredhatai/gemma-3-4b-it-fp8-dynamic685+75
NVIDIA-Nemotron-3-Ultra-550B-A55B-FP8-dynamicredhatai/nvidia-nemotron-3-ultra-550b-a55b-fp8-dynamic683+155
Qwen3-8B-NVFP4redhatai/qwen3-8b-nvfp4680+157
Llama-4-Maverick-17B-128E-Instruct-quantized.w4a16redhatai/llama-4-maverick-17b-128e-instruct-quantized.w4a16655+56
Meta-Llama-3.1-8B-Instruct-quantized.w8a16redhatai/meta-llama-3.1-8b-instruct-quantized.w8a16654+102