beaver-7b-v1.0-reward

PKU-Alignment/beaver-7b-v1.0-reward

Reinforcement Learning6.6B parameterssafe-rlhf
Tracked by OpenModelStats since September 7, 2026View on Hugging Face ↗
Downloads 30D
2,697
Total downloads
103.3K
Gained 7D
+573(increase)
0.6%(up) vs baseline
Gained 30D
—
Likes
17
+0 in 7D
Rank · tracked models
#17,386
175(down 175 places)this week
Parameters
6.6B
Last source update
Apr 20, 2024
Momentum
47.0
  • beaver-7b-v1.0-reward gained 573 downloads during the last seven tracked days.

Downloads over time

Rolling recent-window downloads as reported

Likes over time

Rank among tracked models

Lower is better

Overview

beaver-7b-v1.0-reward is a reinforcement learning model published by PKU-Alignment. OpenModelStats has tracked the model since Sep 7, 2026, most recently observing it 22h ago.

Published
Jul 8, 2023
Last updated
Apr 20, 2024
Library
safe-rlhf
License
—
Task
Reinforcement Learning
Parameters
6,607,351,812
Spaces
—
Derivative models
—
Velocity 7D/day
82
safe-rlhfsafetensorsllamareinforcement-learning-from-human-feedbackreinforcement-learningbeaversafetyai-safetydeepspeedrlhfalpacaen

Similar models

PKU-Alignment/beaver-7b-v1.0-reward — Downloads, Growth & Stats | OpenModelStats