LanguageBind_Video_merge

LanguageBind/LanguageBind_Video_merge

Zero-Shot Image ClassificationtransformersLicense: mit
Tracked by OpenModelStats since August 24, 2026View on Hugging Face ↗
Downloads 30D
3,203
Total downloads
3.3M
Gained 7D
+838(increase)
0.0%(up) vs baseline
Gained 30D
—
Likes
6
+0 in 7D
Rank · tracked models
#15,070
245(up 245 places)this week
Parameters
—
Last source update
Feb 1, 2024
Momentum
46.2
  • LanguageBind_Video_merge gained 838 downloads during the last seven tracked days.

Downloads over time

Cumulative total downloads observed by OpenModelStats

Likes over time

Rank among tracked models

Lower is better

Overview

LanguageBind_Video_merge is a zero-shot image classification model published by LanguageBind. OpenModelStats has tracked the model since Aug 24, 2026, most recently observing it Oct 5, 2026.

Published
Nov 21, 2023
Last updated
Feb 1, 2024
Library
transformers
License
mit
Task
Zero-Shot Image Classification
Parameters
—
Spaces
—
Derivative models
—
Velocity 7D/day
120
transformerspytorchLanguageBindVideozero-shot-image-classificationarxiv:2310.01852license:mitendpoints_compatibleregion:us

Similar models

LanguageBind/LanguageBind_Video_merge — Downloads, Growth & Stats | OpenModelStats