vit-gpt2-coco-en

ydshieh/vit-gpt2-coco-en

Image to Text239M parameterstransformers
Tracked by OpenModelStats since August 24, 2026View on Hugging Face ↗
Downloads 30D
15.2K
Total downloads
531.5K
Gained 7D
+2,446(increase)
0.5%(up) vs baseline
Gained 30D
—
Likes
39
+0 in 7D
Rank · tracked models
#6,606
30(down 30 places)this week
Parameters
239M
Last source update
Dec 2, 2025
Momentum
55.2
  • vit-gpt2-coco-en gained 2,446 downloads during the last seven tracked days.
  • It moved from #52 to #53 among tracked Image to Text models this week.

Downloads over time

Cumulative total downloads observed by OpenModelStats

Likes over time

Rank among tracked models

Lower is better

Overview

vit-gpt2-coco-en is a image to text model published by ydshieh. OpenModelStats has tracked the model since Aug 24, 2026, most recently observing it Oct 5, 2026.

Published
Mar 2, 2022
Last updated
Dec 2, 2025
Library
transformers
License
—
Task
Image to Text
Parameters
239,195,904
Spaces
—
Derivative models
—
Velocity 7D/day
349
transformerspytorchtfjaxtensorboardsafetensorsvision-encoder-decoderimage-text-to-textimage-to-textendpoints_compatibleregion:us

Similar models

Models similar to vit-gpt2-coco-en
ModelDL 30D
nougat-smallfacebook3,551
image-caption-generatorbipin91
ko-trocrddobokki1,548
Falcon-OCRtiiuae6,482
pix2struct-basegoogle21.8K
pix2struct-textcaps-basegoogle3,071
ydshieh/vit-gpt2-coco-en — Downloads, Growth & Stats | OpenModelStats