LanguageBind_Video_FT

LanguageBind/LanguageBind_Video_FT

Zero-Shot Image ClassificationtransformersLicense: mit
Tracked by OpenModelStats since August 27, 2026View on Hugging Face ↗
Downloads 30D
5,007
Total downloads
2.6M
Gained 7D
+689(increase)
0.0%(up) vs baseline
Gained 30D
—
Likes
8
+0 in 7D
Rank · tracked models
#7,832
21(up 21 places)this week
Parameters
—
Last source update
Feb 1, 2024
Momentum
44.7
  • LanguageBind_Video_FT gained 689 downloads during the last seven tracked days.
  • It moved from #102 to #103 among tracked Zero-Shot Image Classification models this week.

Downloads over time

Daily gain between consecutive observations

Likes over time

Rank among tracked models

Lower is better

Overview

LanguageBind_Video_FT is a zero-shot image classification model published by LanguageBind. OpenModelStats has tracked the model since Aug 27, 2026, most recently observing it Sep 26, 2026.

Published
Nov 26, 2023
Last updated
Feb 1, 2024
Library
transformers
License
mit
Task
Zero-Shot Image Classification
Parameters
—
Spaces
—
Derivative models
—
Velocity 7D/day
98
transformerspytorchLanguageBindVideozero-shot-image-classificationarxiv:2310.01852license:mitendpoints_compatibleregion:us

Similar models

LanguageBind/LanguageBind_Video_FT — Downloads, Growth & Stats | OpenModelStats