Skip to content

Compare model prices

Input, output, cached and batch prices, every route and a month of tokens, side by side.

GLM 4.7GLM 5.3 Prime

A month of tokens

  • GLM 4.7$75.00
  • GLM 5.3 Prime$456.00

100M input and 20M output tokens, list price. Use your own numbers.

Side by side

GLM 4.7GLM 5.3 Prime
Input per 1M$0.4$2.8
Output per 1M$1.75$8.8
Cached input$0.08$0.56
Batch in / outn/an/a
Blended (3:1)$0.738$4.3
Context205K1M
Routes72
ReleasedDec 22, 2025Sep 23, 2026
Leadersboard scoren/an/a

On the price map

Size: context window, 8K to 2MEqual blended cost (3:1) 243 models, lower left is cheaper

Every route

GLM 4.7

Way to buyIn / out per 1M
DeepInfra
fp4 · cached $0.08
$0.4 / $1.75Same as list
Venice
fp4 · cached $0.08
$0.4 / $1.93+6% vs list
AtlasCloud
fp8 · cached $0.12
$0.52 / $1.85+16% vs list
Novita AI
fp8 · cached $0.099
$0.54 / $1.98+22% vs list
Google Vertex AI
Default region
$0.6 / $2.2+36% vs list
Z.ai
fp4 · cached $0.11
$0.6 / $2.2+36% vs list
Mancer 2
fp4
$0.7 / $2.5+56% vs list

GLM 5.3 Prime

Way to buyIn / out per 1M
Z.ai API
The lab's own API · cached $0.56
$2.8 / $8.8List price
Qwen (Alibaba)
Default region · cached $0.56
$2.8 / $8.8Same as list

List prices from providers' pages on the date shown; your contract may differ. Logos via logo.dev; trademarks belong to their owners.

Weekly: LLM API list prices that changed, Thursday mornings.