vit-gpt2-coco-en

ydshieh/vit-gpt2-coco-en

Image to Text239M parameterstransformers
Tracked by OpenModelStats since August 24, 2026View on Hugging Face ↗
Downloads 30D
10.7K
Total downloads
511K
Gained 7D
Gained 30D
Likes
39
Rank · tracked models
#7,710
this week
Parameters
239M
Last source update
Dec 2, 2025

Downloads over time

Daily gain between consecutive observations

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Likes over time

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Rank among tracked models

Lower is better

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Overview

vit-gpt2-coco-en is a image to text model published by ydshieh. OpenModelStats has tracked the model since Aug 24, 2026, most recently observing it 1h ago.

Published
Mar 2, 2022
Last updated
Dec 2, 2025
Library
transformers
License
Task
Image to Text
Parameters
239,195,904
Spaces
Derivative models
Velocity 7D/day
transformerspytorchtfjaxtensorboardsafetensorsvision-encoder-decoderimage-text-to-textimage-to-textendpoints_compatibleregion:us

Similar models

Models similar to vit-gpt2-coco-en
ModelDL 30D
nougat-smallfacebook27.7K
ko-trocrddobokki1,350
Falcon-OCRtiiuae3,053
pix2struct-basegoogle19.2K
pix2struct-textcaps-basegoogle2,919
TexTellerOleehyO7,169