Phi-3.5-vision-instruct

microsoft/Phi-3.5-vision-instruct

Image Text to Text4.1B parameterstransformersLicense: mit
Tracked by OpenModelStats since August 24, 2026View on Hugging Face ↗
Downloads 30D
876.6K
Total downloads
19.4M
Gained 7D
Gained 30D
Likes
738
Rank · tracked models
#493
this week
Parameters
4.1B
Last source update
Dec 10, 2025

Downloads over time

Rolling recent-window downloads as reported

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Likes over time

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Rank among tracked models

Lower is better

Not enough tracked history yet for a chart.

OpenModelStats began tracking this model on 2026-08-24. Charts appear as daily observations accumulate.

Overview

Phi-3.5-vision-instruct is a image text to text model published by microsoft. OpenModelStats has tracked the model since Aug 24, 2026, most recently observing it 7 min ago.

Published
Aug 16, 2024
Last updated
Dec 10, 2025
Library
transformers
License
mit
Task
Image Text to Text
Parameters
4,146,621,440
Spaces
100
Derivative models
Velocity 7D/day
transformerssafetensorsphi3_vtext-generationnlpcodevisionimage-text-to-textconversationalcustom_codemultilingualarxiv:2404.14219

Model family

Based on base-model relationships reported by the source's metadata.

Derivative models

Similar models