GLM-4.7 Flash is Z AI's language model with a 131K context window, starting at $0.06 / 1M input and $0.4 / 1M output. Fast and efficient multilingual text generation model with a 131K token context window, optimized for dialogue, instruction-following, and multi-turn tool calling across 100+ languages.
Specifications
Canonical IDz-ai-glm-4-7-flash
TypeLanguage
StatusActive
CreatorZ AI
Providers
Context Window131K tokens
Input ModalitiesText
Output ModalitiesText
Reasoning Effortsdefault

Capabilities

Input1/5
Text✓
Image·
Audio·
Video·
PDF·
Output1/5
Text✓
Image·
Audio·
Video·
Embedding·
Capabilities2/13
Reasoning✓
Adaptive Reasoning·
Function Calling✓
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching·
Assistant Prefill·

Pricing by Provider

US Dollar ($)
Per 1M tokens
ProviderStandard
Input
$ / 1M
Output
$ / 1M
Cloudflare Workers AI logo
Cloudflare Workers AI
@cf/zai-org/glm-4.7-flash
$0.06$0.4

Cost Calculator

US Dollar ($)
Preset:

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
GLM-5.3 Prime1.0M$2.80$8.80Available
GLM-5.3 FlashX1.0M$0.370$1.25Available
GLM-5.3 Flash1.3M$0.113$0.394Available
GLM-5.31.3M$0.840$2.64Available
GLM-5.3 (50% off)1.0M——Available
GLM-5.2 Fast1.0M$2.10$6.60Available
GLM-5.21.0M$0.610$1.98Available
GLM-5V Turbo205K$0.704$3.10Available
GLM-5 Turbo203K$1.20$4.00Available
GLM-5.1 Non-Reasoning————Available
GLM-4.7 Flash—131K$0.060$0.400Current

Model IDs

@cf/zai-org/glm-4.7-flash
z-ai-glm-4-7-flash