vit-gpt2-coco-en

ydshieh/vit-gpt2-coco-en

Image to Text239M parameterstransformers
Tracked by OpenModelStats since September 29, 2026View on Hugging Face ↗
Downloads 30D
15.4K
Total downloads
531.9K
Gained 7D
+2,446(increase)
0.5%(up) vs baseline
Gained 30D
—
Likes
39
+0 in 7D
Rank · tracked models
#6,646
40(down 40 places)this week
Parameters
239M
Last source update
Dec 2, 2025
Momentum
55.2
  • vit-gpt2-coco-en gained 2,446 downloads during the last seven tracked days.
  • It moved from #53 to #55 among tracked Image to Text models this week.

Downloads over time

Cumulative total downloads observed by OpenModelStats

Likes over time

Rank among tracked models

Lower is better

Overview

vit-gpt2-coco-en is a image to text model published by ydshieh. OpenModelStats has tracked the model since Sep 29, 2026, most recently observing it Oct 6, 2026.

Published
Mar 2, 2022
Last updated
Dec 2, 2025
Library
transformers
License
—
Task
Image to Text
Parameters
239,195,904
Spaces
—
Derivative models
—
Velocity 7D/day
349
transformerspytorchtfjaxtensorboardsafetensorsvision-encoder-decoderimage-text-to-textimage-to-textendpoints_compatibleregion:us

Similar models

Models similar to vit-gpt2-coco-en
ModelDL 30D
nougat-smallfacebook3,590
image-caption-generatorbipin93
ko-trocrddobokki1,643
Falcon-OCRtiiuae6,492
pix2struct-basegoogle21.9K
pix2struct-textcaps-basegoogle3,270
ydshieh/vit-gpt2-coco-en — Downloads, Growth & Stats | OpenModelStats