Compare model prices
Input, output, cached and batch prices, every route and a month of tokens, side by side.
A month of tokens
GLM 5.1$157.32
GLM 5.3 Prime$456.00
100M input and 20M output tokens, list price. Use your own numbers.
Side by side
| GLM 5.1 | GLM 5.3 Prime | |
|---|---|---|
| Input per 1M | $0.966 | $2.8 |
| Output per 1M | $3.04 | $8.8 |
| Cached input | $0.179 | $0.56 |
| Batch in / out | n/a | n/a |
| Blended (3:1) | $1.48 | $4.3 |
| Context | 205K | 1M |
| Routes | 14 | 2 |
| Released | Apr 7, 2026 | Sep 23, 2026 |
| Leadersboard score | n/a | n/a |
On the price map
Size: context window, 8K to 2MEqual blended cost (3:1) 243 models, lower left is cheaper
Every route
GLM 5.1
- StreamLakefp8, fp8$0.966 / $3.04cached $0.179
Chutesfp8, fp8+1%$0.98 / $3.08cached $0.098
DeepInfrafp4, fp4+12%$1.05 / $3.5cached $0.205
SiliconFlowfp8, fp8+23%$1.19 / $3.74cached $0.6
- AtlasCloudfp8, fp8+30%$1.26 / $3.96cached $0.234
- Phaladefault region+32%$1.21 / $4.2cached $0.6
Qwen (Alibaba)fp8, fp8+38%$1.33 / $4.18cached $0.247
Novita AIfp8, fp8+44%$1.38 / $4.4cached $0.26
- Baidufp8, fp8+45%$1.4 / $4.4cached $0.26
Friendlidefault region+45%$1.4 / $4.4cached $0.26
- GMICloudfp8, fp8+45%$1.4 / $4.4cached $0.26
Nebiusfp8, fp8+45%$1.4 / $4.4$2.15 blended
Z.aifp8, fp8+45%$1.4 / $4.4cached $0.26
Venicefp8, fp8+45%$1.4 / $4.4cached $0.26
GLM 5.3 Prime
Z.ai (list)the lab's own API$2.8 / $8.8cached $0.56
Qwen (Alibaba)default region$2.8 / $8.8cached $0.56
List prices from providers' pages on the date shown; your contract may differ. Logos via logo.dev; trademarks belong to their owners.