LanguageBind_Video_merge

LanguageBind/LanguageBind_Video_merge

Zero-Shot Image ClassificationtransformersLicense: mit
Tracked by OpenModelStats since August 28, 2026View on Hugging Face ↗
Downloads 30D
3,292
Total downloads
3.3M
Gained 7D
+838(increase)
0.0%(up) vs baseline
Gained 30D
—
Likes
6
+0 in 7D
Rank · tracked models
#14,706
293(down 293 places)this week
Parameters
—
Last source update
Feb 1, 2024
Momentum
46.2
  • LanguageBind_Video_merge gained 838 downloads during the last seven tracked days.

Downloads over time

Rolling recent-window downloads as reported

Likes over time

Rank among tracked models

Lower is better

Overview

LanguageBind_Video_merge is a zero-shot image classification model published by LanguageBind. OpenModelStats has tracked the model since Aug 28, 2026, most recently observing it Sep 27, 2026.

Published
Nov 21, 2023
Last updated
Feb 1, 2024
Library
transformers
License
mit
Task
Zero-Shot Image Classification
Parameters
—
Spaces
—
Derivative models
—
Velocity 7D/day
120
transformerspytorchLanguageBindVideozero-shot-image-classificationarxiv:2310.01852license:mitendpoints_compatibleregion:us

Similar models

LanguageBind/LanguageBind_Video_merge — Downloads, Growth & Stats | OpenModelStats