Zhipu AI Reasoning Model text vision

GLM 5.3 Flash Pricing & Token Costs

Official API rate card for GLM 5.3 Flash provided by Zhipu AI. All token pricing is normalized per 1 Million tokens ($/1M).

Token Pricing Rates ($/1M Tokens)

Input Tokens 0.0750 per 1M tokens
Output Tokens 0.2500 per 1M tokens
Prompt Cache Read $0.0150 per 1M tokens
Prompt Cache Write $0.0750 per 1M tokens

Technical Specifications

Provider
Zhipu AI
Context Window
1,311k tokens (1,310,720)
Max Output Tokens
16k tokens (16,384)
Reasoning Architecture
Yes
Supported Modalities
text, vision

Estimated Inference Costs

Example cost calculation for standard application workloads assuming a 3:1 input-to-output token ratio.

100,000 requests (500 in / 150 out) 0.01
1,000,000 requests (1,000 in / 300 out) 0.15
← Compare GLM 5.3 Flash on Master Pricing Table