Ling 3.0 Flash VL is Inclusionai's language model with a 262K context window and up to 33K output tokens, starting at $0.06 / 1M input and $0.18 / 1M output. A vision-language MoE model built on Ling 3.0 Flash that adds native visual perception and visual agent capabilities alongside strong language skills.
Specifications
Canonical IDinclusionai-ling-3-flash-vl
TypeLanguage
StatusActive
CreatorInclusionai
Providers
Context Window262K tokens
Max Output33K tokens
Input ModalitiesImageTextVideo
Output ModalitiesText
Reasoning Effortsdefault
Parameters125B
HuggingFace Likes33
HuggingFace Downloads (30d)42
HuggingFace Downloads (all-time)42
Release Date · 14 days ago
Benchmarks
Intelligence Index
#117
Coding Index
#51
GPQA
#85
HLE
#126
Time to First Token
#503
SciCode
#96
LCR
#55
Output TPS
#71

Capabilities

Input3/5
Text
Image
Audio·
Video
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities5/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs
Native JSON Schema
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandardFree
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Input
$ / 1M
Output
$ / 1M
OpenRouter logo
OpenRouter
inclusionai/ling-3.0-flash-vl
$0.06$0.18$0.012N/AN/A
OpenRouter logo
OpenRouter
inclusionai/ling-3.0-flash-vl:free
$N/A$N/A

Cost Calculator

US Dollar ($)
Preset:

Cheapest Instances to Run It

Cloud GPU instances that can host Ling 3.0 Flash VL, ranked by cheapest on-demand price. The model needs about 300 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
Standard_NC96ads_A100_v4Azure4× NVIDIA A100320 GB$14.69/hr
g7e.24xlargeAWS4× RTX PRO Server 6000384 GB$16.57/hr
p4d.24xlargeAWS8× A100320 GB$21.96/hr
7 more instances can run Ling 3.0 Flash VL
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Ling 3.0 Flash VL262K$0.060$0.180Current
Ling 3.0 Flash Sante262KAvailable
InclusionAI Ling 3 Flash Fin262K$0.060$0.180Available
InclusionAI Ling 3 Flash Fast262K$0.060$0.180Available
InclusionAI Ling 2.6 Flash262KDeprecated
InclusionAI Ling 2 FlashAvailable

Other Models

ModelTierReleasedContextInput / 1MOutput / 1M
InclusionAI Ling 3 Tiny256K
InclusionAI Ling 2 Mini
Ming Image 0.1 Design
Ming Image 0.1 Design Layer
InclusionAI Ling 1T

Model IDs

inclusionai-ling-3-flash-vl
inclusionai/ling-3.0-flash-vl
inclusionAI/Ling-3.0-flash-VL
inclusionai/ling-3.0-flash-vl-free
ling-3-0-flash-vl
openrouter/inclusionai/ling-3.0-flash-vl
openrouter/inclusionai/ling-3.0-flash-vl:free