Zhipu AI Reasoning Model text

GLM 5.3 Prime Pricing & Token Costs

Official API rate card for GLM 5.3 Prime provided by Zhipu AI. All token pricing is normalized per 1 Million tokens ($/1M).

Token Pricing Rates ($/1M Tokens)

Input Tokens 2.8000 per 1M tokens
Output Tokens 8.8000 per 1M tokens
Prompt Cache Read $0.5600 per 1M tokens
Prompt Cache Write $2.8000 per 1M tokens

Technical Specifications

Provider
Zhipu AI
Context Window
1,000k tokens (1,000,000)
Max Output Tokens
131k tokens (131,072)
Reasoning Architecture
Yes
Supported Modalities
text

Estimated Inference Costs

Example cost calculation for standard application workloads assuming a 3:1 input-to-output token ratio.

100,000 requests (500 in / 150 out) 0.27
1,000,000 requests (1,000 in / 300 out) 5.44
← Compare GLM 5.3 Prime on Master Pricing Table