InclusionAI Ling 3 Flash is Inclusionai's language model with a 262K context window and up to 33K output tokens, available from 2 providers, starting at $0.021 / 1M input and $0.063 / 1M output. A 124B-parameter Mixture-of-Experts LLM with ~5.1B active parameters per token, optimized for token-efficient inference with reasoning and tool-use capabilities.
Specifications
Canonical IDinclusionai-ling-3-flash
TypeLanguage
StatusActive
CreatorInclusionai
Providers
Context Window262K tokens
Max Output33K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault
Release Date · 20 days ago
Benchmarks
Intelligence Index
37.8
#58
Coding Index
50.6
#46
GPQA
0.9
#69
HLE
0.2
#79
Time to First Token
1.31s
#466
SciCode
0.4
#91
LCR
0.7
#96
Output TPS

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities3/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
OpenRouter logo
OpenRouter
inclusionai/ling-3.0-flash
$0.021$0.063$0.0042
Vercel AI Gateway logo
Vercel AI Gateway
inclusionai/ling-3.0-flash
$0.06$0.18$0.012

Cost Calculator

US Dollar ($)
Preset:

Model IDs

accounts/fireworks/models/ling-3-flash
inclusionai-ling-3-flash
inclusionai/ling-3.0-flash
inclusionAI/Ling-3.0-flash
inclusionai/ling-3.0-flash-free
inclusionai/ling-3.0-flash:free
ling-3-0-flash