RedHatAI AI Models

Tracked by OpenModelStats since Aug 23, 2026 · View on Hugging Face ↗

Tracked models
282
Downloads 30D
8.9M
Total downloads
120.9M
Total likes
2,311
Gained 7D
2.4M

Most downloaded

  1. 1Qwen3.6-35B-A3B-NVFP4Aug 13, 20261M
  2. 2NVIDIA-Nemotron-3.5-Lightning-30B-A3B-FP8Sep 17, 2026950.3K
  3. 3gemma-4-26B-A4B-it-FP8-dynamicAug 13, 2026890.2K
  4. 4Qwen3.8-27B-INT4Sep 28, 2026569.9K
  5. 5Llama-3.2-3B-Instruct-FP8-dynamicOct 9, 2024518.2K
  6. 6gemma-4-31B-it-FP8-blockAug 13, 2026433K
  7. 7Qwen3-32B-NVFP4Nov 21, 2025411.8K
  8. 8gemma-4-26B-A4B-it-NVFP4Aug 13, 2026315.2K
  9. 9gemma-3-27b-it-quantized.w4a16Jun 9, 2025293.7K
  10. 10Qwen3-Coder-Next-FP8-dynamicFeb 27, 2026288.1K

Fastest growing

  1. 1Qwen3.6-35B-A3B-NVFP4+314.9K in 7D1M
  2. 2NVIDIA-Nemotron-3.5-Lightning-30B-A3B-FP8+238.5K in 7D950.3K
  3. 3gemma-4-26B-A4B-it-FP8-dynamic+218K in 7D890.2K
  4. 4Qwen3-Coder-Next-FP8-dynamic+162.9K in 7D288.1K
  5. 5Llama-3.2-3B-Instruct-FP8-dynamic+127.5K in 7D518.2K
  6. 6gemma-4-31B-it-FP8-block+118.7K in 7D433K
  7. 7Qwen3.8-27B-INT4+117.4K in 7D569.9K
  8. 8Qwen3-32B-NVFP4+106.3K in 7D411.8K
  9. 9Llama-3.2-3B-Instruct-FP8+94.2K in 7D184.9K
  10. 10gemma-3-27b-it-quantized.w4a16+88.9K in 7D293.7K

Recently updated

  1. 1Qwen3.8-27B-MXFP4Oct 8, 2026853
  2. 2gemma-4-31B-it-speculator.dflashOct 7, 2026646
  3. 3Qwen3.5-35B-A3B-quantized.w8a8Oct 6, 2026406
  4. 4Laguna-S-2.1-NVFP4Oct 6, 2026316
  5. 5Laguna-S-2.1-FP8Oct 6, 2026193
  6. 6Qwen3.8-Flash-Next-NVFP4Oct 5, 20261,503
  7. 7wolf-defender-prompt-injectionOct 5, 202687
  8. 8DeepSeek-V4-Flash-0731-NVFP4Oct 2, 2026625
  9. 9granite-3.2-2b-instructOct 1, 2026309
  10. 10Qwen3.8-27B-NVFP4Sep 30, 202634.5K

All models

All tracked models published by RedHatAI
ModelDL 30D7D
Mistral-Small-3.1-24B-Instruct-2503-quantized.w8a8redhatai/mistral-small-3.1-24b-instruct-2503-quantized.w8a81,417+296
Llama-3.3-70B-Instruct-speculator.eagle3redhatai/llama-3.3-70b-instruct-speculator.eagle31,404—
TinyLlama-1.1B-Chat-v1.0-marlinredhatai/tinyllama-1.1b-chat-v1.0-marlin1,391+340
Kimi-K2.6-FP8-BLOCKredhatai/kimi-k2.6-fp8-block1,387+487
Phi-4-mini-instruct-quantized.w8a8redhatai/phi-4-mini-instruct-quantized.w8a81,330+316
whisper-large-v3-quantized.w4a16redhatai/whisper-large-v3-quantized.w4a161,315+76
gemma-4-31B-it-speculator.eagle3redhatai/gemma-4-31b-it-speculator.eagle31,314+239
DeepSeek-V4-Flash-NVFP4-FP8redhatai/deepseek-v4-flash-nvfp4-fp81,302+810
Qwen3.6-35B-A3B-speculator.dsparkredhatai/qwen3.6-35b-a3b-speculator.dspark1,290+256
gpt-oss-120b-essentialredhatai/gpt-oss-120b-essential1,288+159
NVIDIA-Nemotron-Nano-9B-v2-FP8-dynamicredhatai/nvidia-nemotron-nano-9b-v2-fp8-dynamic1,276+170
nomic-embed-text-v1.5redhatai/nomic-embed-text-v1.51,273+984
Kimi-K3-NVFP4redhatai/kimi-k3-nvfp41,272+95
whisper-small-quantized.w8a8redhatai/whisper-small-quantized.w8a81,247+305
Qwen2.5-72B-Instruct-FP8-dynamicredhatai/qwen2.5-72b-instruct-fp8-dynamic1,240+409
Qwen3-14B-FP8-dynamicredhatai/qwen3-14b-fp8-dynamic1,220+0
granite-3.1-8b-instruct-quantized.w4a16redhatai/granite-3.1-8b-instruct-quantized.w4a161,219+304
phi-4-quantized.w4a16redhatai/phi-4-quantized.w4a161,190+259
Phi-3-medium-128k-instruct-quantized.w4a16redhatai/phi-3-medium-128k-instruct-quantized.w4a161,180+387
NVIDIA-Nemotron-3-Nano-30B-A3B-FP8redhatai/nvidia-nemotron-3-nano-30b-a3b-fp81,176+0
Mistral-Nemo-Instruct-2407-quantized.w4a16redhatai/mistral-nemo-instruct-2407-quantized.w4a161,174+317
Mistral-7B-Instruct-v0.3-GPTQ-4bitredhatai/mistral-7b-instruct-v0.3-gptq-4bit1,164+173
Inkling-Smallredhatai/inkling-small1,115+0
Qwen3-30B-A3B-FP8-dynamicredhatai/qwen3-30b-a3b-fp8-dynamic1,113+135
Qwen3.8-2.4T-A95B-NVFP4-REAP-50redhatai/qwen3.8-2.4t-a95b-nvfp4-reap-501,085+690