Poly Logo

Polylabs

Free ToolsBlog
Z.ai
Z-AI

Z.ai: GLM 4.5V

Updated: September 2026

GLM-4.5V is a vision-language foundation model for multimodal agent applications. Built on a Mixture-of-Experts (MoE) architecture with 106B parameters and 12B activated parameters, it achieves state-of-the-art results in video understanding,...

Specifications

Context
66K
Input Modalities
Text, Image
Output Modalities
Text
Input
$0.6/M
Output
$1.8/M

Capabilities

VISIONTEXTWEBTHINKINGWRITING

Similarly Priced Models

ModelProviderContextInput PriceOutput Price
Minimax M3
MinimaxMinimax
1M$0.6/M$2.4/M
Minimax M3
MinimaxMinimax
1M$0.6/M$2.4/M
GPT Audio Mini
OpenAIOpenAI
128K$0.6/M$2.4/M
Gemini 2.5 Pro (batch)
GoogleGoogle
1M$0.625/M$5/M
Qwen3.5 397B A17B
QwenQwen
262K$0.55/M$3.5/M

Performance Metrics

Intelligence Index

01

7.6

> 14% OF MODELS

Average Response Performance

Output Speed
35.7 tok/s
Time To First Token
2.71s
Time To First Answer Token
58.75s
End To End Response Time
72.76s

DATA SOURCE: Artificial Analysis

Curious about Z.ai: GLM 4.5V?