beaver-7b-v1.0-cost

PKU-Alignment/beaver-7b-v1.0-cost

Reinforcement Learning6.6B parameterssafe-rlhf
Tracked by OpenModelStats since August 24, 2026View on Hugging Face ↗
Downloads 30D
6,092
Total downloads
105.3K
Gained 7D
Gained 30D
Likes
10
Rank · tracked models
#10,101
this week
Parameters
6.6B
Last source update
Apr 20, 2024

Downloads over time

Cumulative total downloads observed by OpenModelStats

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Likes over time

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Rank among tracked models

Lower is better

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Overview

beaver-7b-v1.0-cost is a reinforcement learning model published by PKU-Alignment. OpenModelStats has tracked the model since Aug 24, 2026, most recently observing it 2h ago.

Published
Jul 10, 2023
Last updated
Apr 20, 2024
Library
safe-rlhf
License
Task
Reinforcement Learning
Parameters
6,607,351,812
Spaces
Derivative models
Velocity 7D/day
safe-rlhfsafetensorsllamareinforcement-learning-from-human-feedbackreinforcement-learningbeaversafetyai-safetydeepspeedrlhfalpacaen

Similar models

Models similar to beaver-7b-v1.0-cost
ModelDL 30D
beaver-7b-v1.0-rewardPKU-Alignment5,066
DiBO-TFBind10zpointsun685
MetaAgent-XMercury73532,858
VisualQuality-R1-7BTianheWu6,258
jatjat-project1,867
MusaCoder-27BMooreThreads590