RedHatAI AI Models

Tracked by OpenModelStats since Aug 23, 2026 · View on Hugging Face ↗

Tracked models
214
Downloads 30D
11M
Total downloads
107.8M
Total likes
1,932
Gained 7D

Most downloaded

  1. 1Qwen3.6-35B-A3B-NVFP4Aug 13, 20261.6M
  2. 2gemma-4-31B-it-FP8-blockAug 13, 20261.6M
  3. 3Llama-3.2-1B-Instruct-FP8-dynamicOct 9, 2024667.7K
  4. 4gemma-4-26B-A4B-it-FP8-dynamicAug 13, 2026551.2K
  5. 5Qwen3-Coder-Next-FP8-dynamicFeb 27, 2026402K
  6. 6gemma-4-26B-A4B-it-NVFP4Aug 13, 2026391.3K
  7. 7Llama-3.2-1B-Instruct-FP8Aug 14, 2026374.2K
  8. 8Qwen2.5-1.5B-quantized.w8a8Dec 3, 2024362.5K
  9. 9gemma-3-27b-it-quantized.w4a16Jun 9, 2025345.4K
  10. 10gemma-4-12B-it-FP8-DynamicAug 13, 2026313.1K

Recently updated

  1. 1Qwen3.8-2.4T-A95B-NVFP4-REAP-25Aug 23, 2026845
  2. 2Qwen3.8-2.4T-A95B-NVFP4-REAP-50Aug 23, 20260
  3. 3Qwen3.8-2.4T-A95B-NVFP4Aug 23, 2026843
  4. 4Qwen3-4B-speculator.dsparkAug 23, 202629
  5. 5Qwen3-4B-speculator.dflash2Aug 22, 20260
  6. 6GLM-5.2-MXFP4xMXFP8Aug 22, 2026396
  7. 7GLM-5.2-NVFP4-FP8Aug 20, 202613.8K
  8. 8Kimi-K3-NVFP4Aug 20, 202616.3K
  9. 9Hy3-NVFP4-FP8Aug 20, 20262,991
  10. 10Qwen3.8-2.4T-A95B-NVFP4-FP8Aug 20, 2026238

All models

All tracked models published by RedHatAI
ModelDL 30D7D
Llama-3.2-3B-Instruct-FP8redhatai/llama-3.2-3b-instruct-fp82,002
Qwen3-30B-A3B-FP8-dynamicredhatai/qwen3-30b-a3b-fp8-dynamic1,910
NVIDIA-Nemotron-Nano-9B-v2-FP8-dynamicredhatai/nvidia-nemotron-nano-9b-v2-fp8-dynamic1,908
whisper-large-v3-quantized.w8a8redhatai/whisper-large-v3-quantized.w8a81,900
Inkling-Small-FP8-dynamicredhatai/inkling-small-fp8-dynamic1,893
NVIDIA-Nemotron-3.5-Lightning-30B-A3B-FP8redhatai/nvidia-nemotron-3.5-lightning-30b-a3b-fp81,852
Meta-Llama-3.1-70B-Instruct-FP8-dynamicredhatai/meta-llama-3.1-70b-instruct-fp8-dynamic1,846
Llama-4-Scout-17B-16E-Instruct-NVFP4redhatai/llama-4-scout-17b-16e-instruct-nvfp41,841
gemma-3-4b-it-FP8-dynamicredhatai/gemma-3-4b-it-fp8-dynamic1,839
Qwen3-14B-quantized.w4a16redhatai/qwen3-14b-quantized.w4a161,797
Llama-4-Maverick-17B-128E-Instruct-quantized.w4a16redhatai/llama-4-maverick-17b-128e-instruct-quantized.w4a161,758
Mistral-7B-Instruct-v0.3-GPTQ-4bitredhatai/mistral-7b-instruct-v0.3-gptq-4bit1,749
whisper-large-v3-quantized.w4a16redhatai/whisper-large-v3-quantized.w4a161,634
Mistral-Small-24B-Instruct-2501-quantized.w4a16redhatai/mistral-small-24b-instruct-2501-quantized.w4a161,594
Mistral-Small-3.1-24B-Instruct-2503redhatai/mistral-small-3.1-24b-instruct-25031,581
whisper-large-v3-turbo-FP8-dynamicredhatai/whisper-large-v3-turbo-fp8-dynamic1,563
Meta-Llama-3-70B-Instruct-FP8redhatai/meta-llama-3-70b-instruct-fp81,561
Llama-3.2-3B-Instruct-FP8-dynamicredhatai/llama-3.2-3b-instruct-fp8-dynamic1,556
Qwen2-0.5B-Instruct-FP8redhatai/qwen2-0.5b-instruct-fp81,555
Qwen2.5-7B-Instruct-quantized.w8a16redhatai/qwen2.5-7b-instruct-quantized.w8a161,533
Inkling-FP8-dynamicredhatai/inkling-fp8-dynamic1,527
whisper-large-v3-turbo-quantized.w8a8redhatai/whisper-large-v3-turbo-quantized.w8a81,471
Llama-3.2-3B-Instruct-quantized.w8a8redhatai/llama-3.2-3b-instruct-quantized.w8a81,458
Qwen3-Next-80B-A3B-Instruct-FP8-dynamicredhatai/qwen3-next-80b-a3b-instruct-fp8-dynamic1,454
Qwen3-235B-A22B-NVFP4redhatai/qwen3-235b-a22b-nvfp41,420