Models/GLM-5.3-Flash

GLM-5.3-FlashActive · Cloud

Nebius AI Studio · Released Aug 2026 · MIT

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Context
1.0M
Max output
1.0M
Input
$0.15
Output
$0.50
Cached in
-
Latency
-

Capabilities

Core
Streaming
Function calling
JSON mode
Structured outputs
Multimodal
Vision
Image input
Audio
Image generation
Video
Advanced
Reasoning
Tool calling
MCP
Prompt caching
Batch API
Embeddings

Details

ReleasedAug 2026
LicenseMIT
InputText
OutputText
Throughput-
Availability99.9%

Related models