DeepSeek V4 Flash is DeepSeek's language model with a 1.3M context window and up to 1.0M output tokens, available from 17 providers, starting at $0.03 / 1M input and $0.177 / 1M output. An efficiency-optimized Mixture-of-Experts LLM from DeepSeek with 284B total and 13B activated parameters, supporting a 1M-token context window with reasoning and tool-use capabilities.
Specifications
Canonical IDdeepseek-v4-flash
TypeLanguage
StatusDeprecating
CreatorDeepSeekDeepSeek
Providers
Context Window1.3M tokens
Max Output1.0M tokens
Input ModalitiesImagePDFText
Output ModalitiesText
Reasoning Effortsdefault
Parameters158B
HuggingFace Likes649
HuggingFace Downloads (30d)25,391
HuggingFace Downloads (all-time)25,391
Release Date · 5 months ago
Deprecation Date
Benchmarks
Intelligence Index
#47
Coding Index
#28
GPQA
#35
HLE
#44
IFBench
#201
Time to First Token
#117
SciCode
#53
LCR
#44
TerminalBench Hard
#77
TAU2
#33
Output TPS
#19

Capabilities

Input3/5
Text✓
Image✓
Audio·
Video·
PDF✓
Output1/5
Text✓
Image·
Audio·
Video·
Embedding·
Capabilities7/13
Reasoning✓
Adaptive Reasoning·
Function Calling✓
Parallel Function Calling✓
Structured Outputs✓
Native JSON Schema✓
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching✓
Assistant Prefill✓

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandardBatch
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Aihubmix
aihubmix/deepseek-v4-flash
$0.142$0.284$0.0284———
Alibaba Qwen logo
Alibaba Qwen
deepseek-v4-flash
$0.2$0.4$0.04$0.1$0.2N/A
Azure AI Foundry logo
Azure AI Foundry
azure_ai/deepseek-v4-flash
$0.19$0.51$0.028———
DeepInfra logo
DeepInfra
deepinfra/deepseek-ai/DeepSeek-V4-Flash
$0.09$0.18$0.018———
DeepSeek logo
DeepSeek
deepseek-flash
$0.3$1.20$0.006$0.15$0.6$0.003
Fireworks AI logo
Fireworks AI
fireworks_ai/deepseek-v4-flash
$0.14$0.28$0.028———
Hugging Face logo
Hugging Face
novita:deepseek/deepseek-v4-flash
$0.14$0.28N/A———
Libertai
libertai/deepseek-v4-flash
$0.25$1.75N/A———
Novita logo
Novita
novita/deepseek/deepseek-v4-flash
$0.14$0.28$0.028———
OpenRouter logo
OpenRouter
~deepseek/deepseek-flash-latest
$0.04$1.00$0.01———
OpenRouter logo
OpenRouter
~deepseek/deepseek-v4-flash-latest
$0.03$0.32$0.016———
OpenRouter logo
OpenRouter
deepseek/deepseek-v4-flash
$0.0886$0.177$0.0177———
Pinstripes
pinstripes/ps/deepseek-v4-flash
$0.1$0.2N/A———
Qwen AI Platform
qwen_ai_platform/deepseek-v4-flash
$0.2$0.4$0.04———
Qwencloud
qwencloud/deepseek-v4-flash
$0.2$0.4$0.04———
Tencent logo
Tencent
tencent/deepseek-v4-flash
$0.14$0.28$0.0028———
Tensormesh
tensormesh/deepseek-ai/DeepSeek-V4-Flash
$0.14$0.28N/A———
Vercel AI Gateway logo
Vercel AI Gateway
deepseek/deepseek-v4-flash
$0.13$0.26$0.028———
Weights & Biases logo
Weights & Biases
wandb/deepseek-ai/DeepSeek-V4-Flash
$0.14$0.28$0.07———

Cost Calculator

US Dollar ($)
Preset:

Cheapest Instances to Run It

Cloud GPU instances that can host DeepSeek V4 Flash, ranked by cheapest on-demand price. The model needs about 379 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
a3-megagpu-8gGCP8× nvidia-h100-mega-80gb640 GB$10.42/hr
a3-ultragpu-8gGCP8× nvidia-h200-141gb1128 GB$13.82/hr
g7e.24xlargeAWS4× RTX PRO Server 6000384 GB$16.57/hr
7 more instances can run DeepSeek V4 Flash
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
DeepSeek V4.731 Flash US————Available
DeepSeek V4 420 Flash————Available
DeepSeek V4.4.1 Flash————Available
DeepSeek V4.1 Flash Expires Exp1.0M$0.140$0.420Available
DeepSeek V4.1 Flash Beta1.0M——Available
DeepSeek V4 Flash Vision Exp1.0M$0.220$0.660Available
DeepSeek V4 Flash1.3M$0.030$0.177Current
DeepSeek V4 Flash Vision————Available
DeepSeek V4 Flash 731—1.0M$0.140$0.280Available
DeepSeek V4 Flash Thinking—200K$0.250$1.75Available
DeepSeek V4 Flash US————Available

Other Models

ModelTierReleasedContextInput / 1MOutput / 1M
DeepSeek V4 ProPro1.0M$0.462$1.39
DeepSeek V4 ProPro————
DeepSeek V4 ProPro1.0M$0.390$0.870
DeepSeek V4 Pro 813Pro—1.0M$1.32$3.96
DeepSeek V4 Pro USPro————

Model IDs

~deepseek/deepseek-flash-latest
~deepseek/deepseek-v4-flash-latest
accounts/fireworks/models/deepseek-v4-flash
aihubmix/deepseek-v4-flash
azure_ai/deepseek-v4-flash
dashscope/deepseek-v4-flash
deepinfra/deepseek-ai/DeepSeek-V4-Flash
deepseek-ai/DeepSeek-V4-Flash
deepseek-flash
deepseek-llm-deepseek-v4-flash
deepseek-v4-flash
deepseek-v4-flash-high
deepseek-v4-flash-non-reasoning
deepseek-v4-flash(1)
deepseek-v4-flash*
deepseek/deepseek-flash
deepseek/deepseek-v4-flash
deepseek/deepseek-v4-flash:free
fireworks_ai/accounts/fireworks/models/deepseek-v4-flash
fireworks_ai/deepseek-v4-flash
libertai/deepseek-v4-flash
nebius/deepseek-ai/DeepSeek-V4-Flash
novita/deepseek/deepseek-v4-flash
openrouter/~deepseek/deepseek-flash-latest
openrouter/~deepseek/deepseek-v4-flash-latest
openrouter/deepseek/deepseek-v4-flash
openrouter/deepseek/deepseek-v4-flash-0731:batch
openrouter/deepseek/deepseek-v4-flash-0731:free
pinstripes/ps/deepseek-v4-flash
qwen_ai_platform/deepseek-v4-flash
qwencloud/deepseek-v4-flash
tencent/deepseek-v4-flash
tensormesh/deepseek-ai/DeepSeek-V4-Flash
wandb/deepseek-ai/DeepSeek-V4-Flash