GLM-5.3 Fast is Zhipu AI's language model with a 1.0M context window, starting at $2.10 / 1M input and $6.60 / 1M output. A low-latency variant of the GLM-5 large language model optimized for rapid response generation while retaining broad language capabilities.
Specifications
Canonical IDzhipu-glm-5-3-fast
TypeLanguage
StatusActive
CreatorZhipu AIZhipu AI
Providers
Context Window1.0M tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault

Capabilities

Input1/5
Text
Image·
Audio·
Video·
PDF·
Output1/5
Text
Image·
Audio·
Video·
Embedding·
Capabilities3/13
Reasoning
Adaptive Reasoning·
Function Calling
Parallel Function Calling·
Structured Outputs
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Cache Read
$ / 1M
Fireworks AI logo
Fireworks AI
fireworks_ai/glm-5p3-fast
$2.10$6.60$0.39

Cost Calculator

US Dollar ($)
Preset:

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
GLM-5.3 FlashX1.0M$0.370$1.25Available
GLM-5.3 Flash1.3M$0.113$0.394Available
GLM-5.31.3M$0.840$2.64Available
GLM-5.3 (50% off)1.0MAvailable
GLM-5.2 Fast1.0M$2.10$6.60Available
GLM-5.21.0M$0.610$1.98Available
GLM-5V Turbo205K$0.704$3.10Available
GLM-5 Turbo203K$1.20$4.00Available
GLM-5.3 Fast1.0M$2.10$6.60Current
GLM-5.1 Non-ReasoningAvailable
GLM-5 Non-ReasoningAvailable

Model IDs

fireworks_ai/accounts/fireworks/routers/glm-5p3-fast
fireworks_ai/glm-5p3-fast
zhipu-glm-5-3-fast