GLM-5.3 Flash US is Zhipu AI's language model with a 1.0M context window, starting at $0.225 / 1M input and $0.75 / 1M output. A fast, low-latency large language model in Zhipu's GLM-5 series served from a US-based regional endpoint.
Specifications
Canonical IDzhipu-glm-5-3-flash-us
TypeLanguage
StatusActive
CreatorZhipu AIZhipu AI
Providers
Context Window1.0M tokens
Input ModalitiesImage
Output ModalitiesText

Capabilities

Input1/5
Text·
Image✓
Audio·
Video·
PDF·
Output1/5
Text✓
Image·
Audio·
Video·
Embedding·
Capabilities2/13
Reasoning·
Adaptive Reasoning·
Function Calling✓
Parallel Function Calling·
Structured Outputs✓
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandardFast
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Fireworks AI logo
Fireworks AI
fireworks_ai/glm-5p3-flash-us
$0.225$0.75$0.045$0.281$0.938$0.0563

Cost Calculator

US Dollar ($)
Preset:

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
GLM-5.3 FlashX1.0M$0.370$1.25Available
GLM-5.3 Flash1.3M$0.110$0.350Available
GLM-5.3 Flash US—1.0M$0.225$0.750Current
GLM-4.6V Flash128K——Available
GLM-4.7 Flash Non-Reasoning————Available
GLM-4.5 Flash—128K——Available

Other Models

ModelTierReleasedContextInput / 1MOutput / 1M
GLM-5.3 Prime—1.0M$2.80$8.80
GLM-5.3—1.3M$0.070$3.08
GLM-5.3 (50% off)—1.0M——
GLM-5.2 Fast—1.0M$2.10$6.60
GLM-5.2—1.0M$0.171$1.98
GLM-5V Turbo—205K$0.704$3.10
GLM-5 Turbo—203K$1.20$4.00
GLM-5.1 Non-Reasoning—————
GLM-5 Non-Reasoning—————
GLM-5 Code——200K$1.20$5.00

Model IDs

fireworks_ai/accounts/fireworks/routers/glm-5p3-flash-us
fireworks_ai/glm-5p3-flash-us
zhipu-glm-5-3-flash-us