InclusionAI Ling 3 Flash Fin is Inclusionai's language model with a 262K context window and up to 236K output tokens, starting at $0.06 / 1M input and $0.18 / 1M output. A finance-specialized mixture-of-experts language model built on the Ling 3.0 Flash architecture, tuned for real-world investment and financial analysis workflows.
Specifications
Canonical IDinclusionai-ling-3-flash-fin
TypeLanguage
StatusActive
CreatorInclusionai
Providers
Context Window262K tokens
Max Output236K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault
Parameters127B
HuggingFace Likes56
HuggingFace Downloads (30d)228
HuggingFace Downloads (all-time)228
Release Date · 28 days ago
Benchmarks
Intelligence Index
#135
Coding Index
#58
HLE
#120
Time to First Token
#493
SciCode
#122
LCR
#99
Output TPS
#57

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities5/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs
Native JSON Schema
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandardFree
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Input
$ / 1M
Output
$ / 1M
OpenRouter logo
OpenRouter
inclusionai/ling-3.0-flash-fin
$0.06$0.18$0.012N/AN/A
OpenRouter logo
OpenRouter
inclusionai/ling-3.0-flash-fin:free
$N/A$N/A

Cost Calculator

US Dollar ($)
Preset:

Cheapest Instances to Run It

Cloud GPU instances that can host InclusionAI Ling 3 Flash Fin, ranked by cheapest on-demand price. The model needs about 306 GB of GPU memory at FP16 precision (estimated from its parameter count), so treat the fit as guidance rather than a guarantee.

All clouds
FP16 (full precision)
US Dollar ($)
Instance
Cloud
GPU
VRAM
Price
Cheapest region
a3-megagpu-8gGCP8× nvidia-h100-mega-80gb640 GB$10.42/hr
a3-ultragpu-8gGCP8× nvidia-h200-141gb1128 GB$13.82/hr
Standard_NC96ads_A100_v4Azure4× NVIDIA A100320 GB$14.69/hr
7 more instances can run InclusionAI Ling 3 Flash Fin
Unlock the full ranked list and FP8 / INT4 quantization with a CloudPrice subscription.

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Ling 3.0 Flash VL262K$0.060$0.180Available
Ling 3.0 Flash Sante262KAvailable
InclusionAI Ling 3 Flash Fin262K$0.060$0.180Current
InclusionAI Ling 3 Flash Fast262K$0.060$0.180Available
InclusionAI Ling 2.6 Flash262KDeprecated
InclusionAI Ling 2 FlashAvailable

Other Models

ModelTierReleasedContextInput / 1MOutput / 1M
InclusionAI Ling 3 Tiny256K
InclusionAI Ling 2 Mini
Ming Image 0.1 Design
Ming Image 0.1 Design Layer
InclusionAI Ling 1T

Model IDs

accounts/fireworks/models/ling-3-flash-fin
inclusionai-ling-3-flash-fin
inclusionai/ling-3.0-flash-fin
inclusionAI/Ling-3.0-flash-Fin
inclusionai/ling-3.0-flash-fin-free
ling-3-0-flash-fin
openrouter/inclusionai/ling-3.0-flash-fin
openrouter/inclusionai/ling-3.0-flash-fin:free