GLM-4.6V Flash is Zhipu AI's language model with a 128K context window and up to 24K output tokens. A fast, low-latency multimodal variant of the GLM-4.6V series from Z AI, supporting vision and file inputs with a 128K context window.
Specifications
Canonical IDzhipu-glm-4-6v-flash
TypeLanguage
StatusActive
CreatorZhipu AIZhipu AI
Context Window128K tokens
Max Output24K tokens
Input ModalitiesImagePDF
Output ModalitiesText
Reasoning Effortsdefault
Release Date · 1 year ago

Capabilities

Input2/5
Text·
Image✓
Audio·
Video·
PDF✓
Output1/5
Text✓
Image·
Audio·
Video·
Embedding·
Capabilities3/13
Reasoning✓
Adaptive Reasoning·
Function Calling✓
Parallel Function Calling·
Structured Outputs·
Native JSON Schema·
Web Search·
URL Context·
Computer Use·
Code Execution·
File Search·
Prompt Caching✓
Assistant Prefill·

Versions

VersionReleasedContextInput / 1MOutput / 1MStatus
GLM-5.3 FlashX1.0M$0.370$1.25Available
GLM-5.3 Flash1.3M$0.110$0.350Available
GLM-5.3 Flash US—1.0M$0.225$0.750Available
GLM-4.6V Flash128K——Current
GLM-4.7 Flash Non-Reasoning————Available
GLM-4.5 Flash—128K——Available

Other Models

ModelTierReleasedContextInput / 1MOutput / 1M
GLM-5.3 Prime—1.0M$2.80$8.80
GLM-5.3—1.3M$0.070$3.08
GLM-5.3 (50% off)—1.0M——
GLM-5.2 Fast—1.0M$2.10$6.60
GLM-5.2—1.0M$0.171$1.98
GLM-5V Turbo—205K$0.704$3.10
GLM-5 Turbo—203K$1.20$4.00
GLM-5.1 Non-Reasoning—————
GLM-5 Non-Reasoning—————
GLM-5 Code——200K$1.20$5.00

Model IDs

zai/glm-4.6v-flash
zhipu-glm-4-6v-flash