LanguageBind_Video_merge

LanguageBind/LanguageBind_Video_merge

Zero-Shot Image ClassificationtransformersLicense: mit
Tracked by OpenModelStats since September 8, 2026View on Hugging Face ↗
Downloads 30D
3,089
Total downloads
3.3M
Gained 7D
+838(increase)
0.0%(up) vs baseline
Gained 30D
—
Likes
6
+0 in 7D
Rank · tracked models
#15,560
41(up 41 places)this week
Parameters
—
Last source update
Feb 1, 2024
Momentum
46.2
  • LanguageBind_Video_merge gained 838 downloads during the last seven tracked days.

Downloads over time

Cumulative total downloads observed by OpenModelStats

Likes over time

Rank among tracked models

Lower is better

Overview

LanguageBind_Video_merge is a zero-shot image classification model published by LanguageBind. OpenModelStats has tracked the model since Sep 8, 2026, most recently observing it 6h ago.

Published
Nov 21, 2023
Last updated
Feb 1, 2024
Library
transformers
License
mit
Task
Zero-Shot Image Classification
Parameters
—
Spaces
—
Derivative models
—
Velocity 7D/day
120
transformerspytorchLanguageBindVideozero-shot-image-classificationarxiv:2310.01852license:mitendpoints_compatibleregion:us

Similar models

LanguageBind/LanguageBind_Video_merge — Downloads, Growth & Stats | OpenModelStats