DeepSeek V4 Flash Vision is DeepSeek's language model. A vision-capable large language model optimized for fast multimodal reasoning with maximum effort chain-of-thought processing.
Specifications
Canonical IDdeepseek-v4-flash-vision
TypeLanguage
StatusActive
CreatorDeepSeekDeepSeek
Input ModalitiesImageText
Output ModalitiesText
Benchmarks
Intelligence Index
#29
Coding Index
#30
GPQA
#24
HLE
#51
Time to First Token
#401
SciCode
#59
LCR
#19
Output TPS
#96

Capabilities

Input2/5
Text
Image
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities0/13
Reasoning·
Adaptive Reasoning·
Function Calling·
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
DeepSeek V4.731 Flash US$0.424$1.27Available
DeepSeek V4 420 FlashAvailable
DeepSeek V4 Flash Vision Exp1.0M$0.220$0.660Available
DeepSeek V4 Flash1.3M$0.030$0.160Available
DeepSeek V4 Flash VisionCurrent
DeepSeek V4 Flash Thinking200K$0.250$1.75Available
DeepSeek V4 Flash US$0.200$0.400Available

Other Models

ModelTierReleasedContextInput / 1MOutput / 1M
DeepSeek V4 ProPro1.0M$0.660$1.98
DeepSeek V4 ProPro
DeepSeek V4 ProPro1.0M$0.435$0.870
DeepSeek V4 Pro USPro$2.40$4.80

Model IDs

deepseek-v4-flash-vision