pix2struct-docvqa-base

google/pix2struct-docvqa-base

Visual Question Answering282M parameterstransformersLicense: apache-2.0
Tracked by OpenModelStats since August 24, 2026View on Hugging Face ↗
Downloads 30D
1,045
Total downloads
698.3K
Gained 7D
Gained 30D
Likes
43
Rank · tracked models
#25,086
this week
Parameters
282M
Last source update
Dec 24, 2023

Downloads over time

Cumulative total downloads observed by OpenModelStats

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Likes over time

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Rank among tracked models

Lower is better

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Overview

pix2struct-docvqa-base is a visual question answering model published by google. OpenModelStats has tracked the model since Aug 24, 2026, most recently observing it 53 min ago.

Published
Mar 21, 2023
Last updated
Dec 24, 2023
Library
transformers
License
apache-2.0
Task
Visual Question Answering
Parameters
282,285,696
Spaces
Derivative models
Velocity 7D/day
transformerspytorchsafetensorspix2structimage-text-to-textvisual-question-answeringenfrrodemultilingualarxiv:2210.03347

Similar models

Models similar to pix2struct-docvqa-base
ModelDL 30D
deplotgoogle36.2K
pix2struct-ai2d-basegoogle1,580
blip-vqa-baseSalesforce571.6K
Aquila-VL-2B-llava-qwenBAAI634
Qwen3.5-2B-MedVLOpenMed14.5K
MiniCPM-V-2openbmb27K