Skip to content

Compare model prices

Input, output, cached and batch prices, every route and a month of tokens, side by side.

GLM 5.2GLM 5.3 Prime

A month of tokens

  • GLM 5.2$91.43
  • GLM 5.3 Prime$456.00

100M input and 20M output tokens, list price. Use your own numbers.

Side by side

GLM 5.2GLM 5.3 Prime
Input per 1M$0.561$2.8
Output per 1M$1.76$8.8
Cached input$0.104$0.56
Batch in / outn/an/a
Blended (3:1)$0.862$4.3
Context1M1M
Routes272
ReleasedJun 16, 2026Sep 23, 2026
Leadersboard scoren/an/a

On the price map

Size: context window, 8K to 2MEqual blended cost (3:1) 245 models, lower left is cheaper

Every route

GLM 5.2

Way to buyIn / out per 1M
Baidu
fp8 · cached $0.104
$0.561 / $1.76Same as list
DeepInfra
fp4 · cached $0.105
$0.563 / $1.8+1% vs list
StreamLake
fp8 · cached $0.119
$0.641 / $2.01+14% vs list
Novita AI
fp8 · cached $0.121
$0.65 / $2.04+16% vs list
Baidu
fast, fp4 · cached $0.161
$0.648 / $2.27+22% vs list
DigitalOcean
Default region · cached $0.105
$0.7 / $2.2+25% vs list
CoreWeave
fp4 · cached $0.14
$0.76 / $2.42+36% vs list
AtlasCloud
fp8 · cached $0.174
$0.938 / $2.95+67% vs list
Inceptron
fp4 · cached $0.188
$0.898 / $3.18+70% vs list
Qwen (Alibaba)
fp8 · cached $0.193
$0.966 / $3.04+72% vs list
Phala
fp8 · cached $0.22
$1.26 / $3+97% vs list
SiliconFlow
fp8 · cached $0.221
$1.19 / $3.74+112% vs list
Baseten
fp8 · cached $0.14
$1.4 / $4.4+149% vs list
Cloudflare Workers AI
Default region · cached $0.26
$1.4 / $4.4+149% vs list
Fireworks AI
Default region · cached $0.14
$1.4 / $4.4+149% vs list
Friendli
Default region · cached $0.26
$1.4 / $4.4+149% vs list
GMICloud
fp8 · cached $0.26
$1.4 / $4.4+149% vs list
Parasail
fp4 · cached $0.26
$1.4 / $4.4+149% vs list
Together AI
Default region · cached $0.26
$1.4 / $4.4+149% vs list
Venice
fp8 · cached $0.26
$1.4 / $4.4+149% vs list
Z.ai
fp8 · cached $0.26
$1.4 / $4.4+149% vs list
Wafer
Default region · cached $0.26
$1.19 / $5.3+157% vs list
Baseten
fast, fp8 · cached $0.21
$2.1 / $6.6+274% vs list
Fireworks AI
fast · cached $0.21
$2.1 / $6.6+274% vs list
Fireworks AI
fast-us · cached $0.21
$2.1 / $6.6+274% vs list
Qwen (Alibaba)
fast, fp8 · cached $0.462
$2.31 / $7.26+311% vs list
Decart
fast, fp4 · cached $0.48
$2.25 / $8+328% vs list

GLM 5.3 Prime

Way to buyIn / out per 1M
Z.ai API
The lab's own API · cached $0.56
$2.8 / $8.8List price
Qwen (Alibaba)
Default region · cached $0.56
$2.8 / $8.8Same as list

Sources: OpenRouter's public model catalog and each provider's own pricing page, read every morning at 05:00 UTC; gateway fees re-read every Monday. List prices: your contract may differ. Logos via logo.dev; trademarks belong to their owners.

Price changes by email

Thursdays, only in weeks when an LLM API list price changed.

Double opt-in. Unsubscribe any time.