Ling 3.0 Flash VL is Inclusionai's language model with a 262K context window and up to 33K output tokens, available from 3 providers, starting at $0.06 / 1M input and $0.18 / 1M output. A vision-language MoE model built on Ling 3.0 Flash that adds native visual perception and visual agent capabilities alongside strong language skills.
Specifications
Canonical IDinclusionai-ling-3-flash-vl
TypeLanguage
StatusActive
CreatorInclusionai
Providers
Context Window262K tokens
Max Output33K tokens
Input ModalitiesImageTextVideo
Output ModalitiesText
Reasoning Effortsdefault
Parameters125B
HuggingFace Likes33
HuggingFace Downloads (30d)42
HuggingFace Downloads (all-time)42
Release Date · 15 days ago
Benchmarks
Intelligence Index
#117
Coding Index
#51
GPQA
#85
HLE
#126
Time to First Token
#461
SciCode
#96
LCR
#55
Output TPS
#63

Capabilities

Input3/5
Text✓
Image✓
Audio·
Video✓
PDF·
Output1/5
Text✓
Image·
Audio·
Video·
Embedding·
Capabilities5/13
Reasoning✓
Adaptive Reasoning·
Function Calling✓
Parallel Function Calling·
Structured Outputs✓
Native JSON Schema✓
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching✓
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Hugging Face logo
Hugging Face
novita:inclusionai/ling-3.0-flash-vl
$0.075$0.22N/A
OpenRouter logo
OpenRouter
inclusionai/ling-3.0-flash-vl
$0.06$0.18$0.012
Vercel AI Gateway logo
Vercel AI Gateway
inclusionai/ling-3.0-flash-vl
$0.075$0.22$0.015

Cost Calculator

US Dollar ($)
Preset:

Cheapest Instances to Run It

Cloud GPU instances that can host Ling 3.0 Flash VL, ranked by cheapest on-demand price. The model needs about 300 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
a3-megagpu-8gGCP8× nvidia-h100-mega-80gb640 GB$10.42/hr
a3-ultragpu-8gGCP8× nvidia-h200-141gb1128 GB$13.82/hr
Standard_NC96ads_A100_v4Azure4× NVIDIA A100320 GB$14.69/hr
7 more instances can run Ling 3.0 Flash VL
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Ling 3.0 Flash VL262K$0.060$0.180Current
Ling 3.0 Flash Sante262K——Available
InclusionAI Ling 3 Flash Fin262K$0.060$0.180Available
InclusionAI Ling 3 Flash Fast—262K$0.060$0.180Available
InclusionAI Ling 2.6 Flash262K——Deprecated
InclusionAI Ling 2 Flash————Available

Other Models

ModelTierReleasedContextInput / 1MOutput / 1M
InclusionAI Ling 3 Tiny—256K——
InclusionAI Ling 2 Mini—————
Ming Image 0.1 Design—————
Ming Image 0.1 Design Layer—————
InclusionAI Ling 1T—————

Model IDs

inclusionai-ling-3-flash-vl
inclusionai/ling-3.0-flash-vl
inclusionAI/Ling-3.0-flash-VL
inclusionai/ling-3.0-flash-vl-free
ling-3-0-flash-vl
openrouter/inclusionai/ling-3.0-flash-vl
openrouter/inclusionai/ling-3.0-flash-vl:free