Kimi K2 Turbo is Moonshot AI (Kimi)'s language model with a 256K context window and up to 16K output tokens. A high-throughput variant of Kimi K2 delivering up to 100 tokens per second, optimized for speed-critical tool-use and conversational applications.
Specifications
Canonical IDmoonshot-kimi-k2-turbo
TypeLanguage
StatusActive
CreatorMoonshot AI (Kimi)Moonshot AI (Kimi)
Providers
Context Window256K tokens
Max Output16K tokens
Input ModalitiesText
Output ModalitiesText
Release Date · 1 year ago

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities1/13
Reasoning·
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Vercel AI Gateway logo
Vercel AI Gateway
moonshotai/kimi-k2-turbo
$1.15$8.00$0.15

Cost Calculator

US Dollar ($)
Preset:

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
Kimi K31.0M$2.83$14.13Available
Kimi K3 Batch1.0M$3.00$15.00Available
Kimi K3 Coding1.0M$0.440$1.61Available
Kimi K3 Fast1.0M$4.50$22.50Available
Kimi K3 US1.0M$3.30$16.50Available
Kimi K2.7 Code HighSpeed262K$1.90$8.00Available
Kimi K2.7 Code262K$0.680$3.21Deprecated
Kimi K2 Thinking Turbo262K$1.15$8.00Deprecated
Kimi K2 Turbo256KCurrent
Kimi K2.5 Non-ReasoningAvailable
Kimi K2 Instruct V0Available

Model IDs

moonshot-kimi-k2-turbo
moonshotai/kimi-k2-turbo