Tifa-DeepsexV2-7b-MGRPO-safetensors-GGUF

mradermacher/Tifa-DeepsexV2-7b-MGRPO-safetensors-GGUF

Reinforcement LearningtransformersLicense: apache-2.0
Tracked by OpenModelStats since August 24, 2026View on Hugging Face ↗
Downloads 30D
1,281
Total downloads
7,745
Gained 7D
Gained 30D
Likes
1
Rank · tracked models
#22,605
this week
Parameters
Last source update
Mar 2, 2025

Downloads over time

Rolling recent-window downloads as reported

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Likes over time

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Rank among tracked models

Lower is better

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Overview

Tifa-DeepsexV2-7b-MGRPO-safetensors-GGUF is a reinforcement learning model published by mradermacher. OpenModelStats has tracked the model since Aug 24, 2026, most recently observing it 3h ago.

Published
Mar 2, 2025
Last updated
Mar 2, 2025
Library
transformers
License
apache-2.0
Task
Reinforcement Learning
Parameters
Spaces
Derivative models
Velocity 7D/day
transformersggufincremental-pretrainingsftreinforcement-learningroleplaycotzhenbase_model:btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensorsbase_model:quantized:btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensorslicense:apache-2.0

Publisher

mradermacherView publisher statistics →

Derived from btaskel/Tifa-DeepsexV2-7b-MGRPO-safetensors (reported by the source; parent not yet tracked).

Similar models

Models similar to Tifa-DeepsexV2-7b-MGRPO-safetensors-GGUF
ModelDL 30D
ppo-LunarLander-v3-flipKaptainKris144.3K
joint-space-empowermentjamesheald95.1K
ppo-seals-CartPole-v0HumanCompatibleAI47.5K
ppo-Pendulum-v1HumanCompatibleAI19.1K
VisualQuality-R1-7BTianheWu6,258
KernelBench-RLVR-120b-i1-GGUFmradermacher6,122