VideoLLaMA2.1-7B-16F-Base

DAMO-NLP-SG/VideoLLaMA2.1-7B-16F-Base

Visual Question AnsweringtransformersLicense: apache-2.0
Tracked by OpenModelStats since August 24, 2026View on Hugging Face ↗
Downloads 30D
2,059
Total downloads
4,510
Gained 7D
Gained 30D
Likes
1
Rank · tracked models
#17,160
this week
Parameters
Last source update
Oct 21, 2024

Downloads over time

Daily gain between consecutive observations

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Likes over time

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Rank among tracked models

Lower is better

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Overview

VideoLLaMA2.1-7B-16F-Base is a visual question answering model published by DAMO-NLP-SG. OpenModelStats has tracked the model since Aug 24, 2026, most recently observing it 47 min ago.

Published
Oct 14, 2024
Last updated
Oct 21, 2024
Library
transformers
License
apache-2.0
Task
Visual Question Answering
Parameters
Spaces
Derivative models
Velocity 7D/day
transformersvideollama2_qwen2text-generationmultimodal large language modellarge video-language modelvisual-question-answeringendataset:OpenGVLab/VideoChat2-ITdataset:Lin-Chen/ShareGPT4Vdataset:liuhaotian/LLaVA-Instruct-150Karxiv:2406.07476arxiv:2306.02858

Similar models

Models similar to VideoLLaMA2.1-7B-16F-Base
ModelDL 30D
blip-vqa-baseSalesforce571.8K
vilt-b32-finetuned-vqadandelin65.4K
deplotgoogle36.3K
MiniCPM-V-2openbmb25.5K
Qwen3.5-2B-MedVLOpenMed14.5K
blip-vqa-capfilt-largeSalesforce13.5K