InclusionAI Ling 3 Flash Fast is Inclusionai's language model with a 262K context window and up to 33K output tokens, starting at $0.06 / 1M input and $0.18 / 1M output. A high-throughput variant of the 124B-parameter Ling 3.0 Flash MoE model, optimized for token-efficient production-scale agentic inference.
Specifications
Canonical IDinclusionai-ling-3-flash-fast
TypeLanguage
StatusActive
CreatorInclusionai
Providers
Context Window262K tokens
Max Output33K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities3/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Novita logo
Novita
novita/inclusionai/ling-3.0-flash-fast
$0.06$0.18$0.012

Cost Calculator

US Dollar ($)
Preset:

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
InclusionAI Ling 3 Flash Fin262KAvailable
InclusionAI Ling 3 Flash Fast262K$0.060$0.180Current
InclusionAI Ling 2.6 Flash262KDeprecated
InclusionAI Ling 2 FlashAvailable

Other Models

ModelTierReleasedContextInput / 1MOutput / 1M
InclusionAI Ling 3 Tiny256K
InclusionAI Ling 2 Mini
InclusionAI Ling 1T

Model IDs

inclusionai-ling-3-flash-fast
inclusionai/ling-3.0-flash-fast
novita/inclusionai/ling-3.0-flash-fast