GLM-5.3 FlashX is Zhipu AI's language model with a 1.0M context window and up to 131K output tokens, available from 2 providers, starting at $0.37 / 1M input and $1.25 / 1M output. A high-speed serving variant of Z.ai's native multimodal coding LLM with 320B total parameters, 18B activated parameters, and a 1M-token context window.
Specifications
Canonical IDzhipu-glm-5-3-flash-x
TypeLanguage
StatusActive
CreatorZhipu AIZhipu AI
Providers
Context Window1.0M tokens
Max Output131K tokens
Input ModalitiesImageTextVideo
Output ModalitiesText
Reasoning Effortsdefault
Release Date · 5 days ago

Capabilities

Input3/5
Text
Image
Audio·
Video
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities4/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
OpenRouter logo
OpenRouter
z-ai/glm-5.3-flashx
$0.37$1.25$0.075
Vercel AI Gateway logo
Vercel AI Gateway
zai/glm-5.3-flashx
$0.37$1.25$0.075

Cost Calculator

US Dollar ($)
Preset:

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
GLM-5.3 FlashX1.0M$0.370$1.25Current
GLM-5.3 Flash1.3M$0.113$0.394Available
GLM-4.6V Flash128KAvailable
GLM-4.7 Flash Non-ReasoningAvailable
GLM-4.5 Flash128KAvailable

Other Models

ModelTierReleasedContextInput / 1MOutput / 1M
GLM-5.31.3M$0.840$2.64
GLM-5.3 (50% off)1.0M
GLM-5.2 Fast1.0M$2.10$6.60
GLM-5.21.0M$0.610$1.98
GLM-5V Turbo205K$0.704$3.10
GLM-5 Turbo203K$1.20$4.00
GLM-5.1 Non-Reasoning
GLM-5 Non-Reasoning
GLM-5 Code200K$1.20$5.00
GLM-5.1 CC200K$0.060$0.220

Model IDs

openrouter/z-ai/glm-5.3-flashx
z-ai/glm-5.3-flashx
zai/glm-5.3-flashx
zhipu-glm-5-3-flash-x