Llama-3.1-70B-Instruct-FP8

nvidia/Llama-3.1-70B-Instruct-FP8

Text Generation70.6B parameterstransformersLicense: llama3.1
Tracked by OpenModelStats since August 24, 2026View on Hugging Face ↗
Downloads 30D
126.3K
Total downloads
252.2K
Gained 7D
Gained 30D
Likes
19
Rank · tracked models
#2,163
this week
Parameters
70.6B
Last source update
Aug 22, 2025

Downloads over time

Cumulative total downloads observed by OpenModelStats

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Likes over time

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Rank among tracked models

Lower is better

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Overview

Llama-3.1-70B-Instruct-FP8 is a text generation model published by nvidia. OpenModelStats has tracked the model since Aug 24, 2026, most recently observing it 2h ago.

Published
Aug 29, 2024
Last updated
Aug 22, 2025
Library
transformers
License
llama3.1
Task
Text Generation
Parameters
70,553,706,496
Spaces
Derivative models
Velocity 7D/day
transformerssafetensorsllamatext-generationconversationalbase_model:meta-llama/Llama-3.1-70B-Instructbase_model:finetune:meta-llama/Llama-3.1-70B-Instructlicense:llama3.1text-generation-inferenceendpoints_compatibleregion:us

Model family

Based on base-model relationships reported by the source's metadata.

Similar models

Models similar to Llama-3.1-70B-Instruct-FP8
ModelDL 30D
llama-3.3-70b-instruct-awqcasperhansen771.3K
Llama-3.1-70B-Instructmeta-llama683.4K
Llama-3.3-70B-Instructmeta-llama296.7K
Meta-Llama-3.1-70B-Instruct-AWQ-INT4hugging-quants185.9K
Meta-Llama-3-70Bmeta-llama153K
llama-3-70b-instruct-awqcasperhansen124.1K