z-ai
Z.ai: GLM 5.3 Flash
z-ai/glm-5.3-flash
For $1, you can send approximately:
~440messages
How do we get this number?
One message = ~7,000 input tokens + ~7,000 output tokens
Input cost per message7,000 x $0.07/M = $0.000525
Output cost per message7,000 x $0.25/M = $0.001750
Total cost per message$0.002275
Messages for $1439.56
Context window
1.3M
tokens
Max response
131k
tokens
Input price
$0.07
per million tokens
Output price
$0.25
per million tokens
Modalities
Input:textInput:imageInput:videoOutput:text
Description
GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...