Models/glm-4.6v

glm-4.6vActive · Cloud

Novita AI · Released Dec 2025 · MIT

GLM-4.6V is a large multimodal model designed for high-fidelity visual understanding and long-context reasoning across images, documents, and mixed media. It supports up to 128K tokens, processes complex page layouts...

Context
131K
Max output
33K
Input
$0.30
Output
$0.90
Cached in
$0.06
Latency
-

Capabilities

Core
Streaming
Function calling
JSON mode
Structured outputs
Multimodal
Vision
Image input
Audio
Image generation
Video
Advanced
Reasoning
Tool calling
MCP
Prompt caching
Batch API
Embeddings

Details

ProviderNovita AI
ReleasedDec 2025
LicenseMIT
InputText
OutputText
Throughput-
Availability97.5%

Related models