Ways to buy 32
| Way to buy | Input | Output | In / out per 1M | Cached | Vs cheapest |
|---|---|---|---|---|---|
| InferenceNet fp4 · cached $0.01 | $0.045 | $0.14 | $0.045 / $0.14Cheapest | $0.01 | Cheapest |
fp4 · cached $0.015 | $0.075 | $0.25 | $0.075 / $0.25+73% vs cheapest | $0.015 | +73% vs cheapest |
| Relace Default region · cached $0.02 | $0.07 | $0.28 | $0.07 / $0.28+78% vs cheapest | $0.02 | +78% vs cheapest |
| GMICloud fp8 · cached $0.018 | $0.09 | $0.3 | $0.09 / $0.3+107% vs cheapest | $0.018 | +107% vs cheapest |
| OpenInference fp4 · cached $0.02 | $0.07 | $0.36 | $0.07 / $0.36+107% vs cheapest | $0.02 | +107% vs cheapest |
| Wafer Default region · cached $0.06 | $0.089 | $0.35 | $0.089 / $0.35+124% vs cheapest | $0.06 | +124% vs cheapest |
| Morph Default region · cached $0.02 | $0.098 | $0.343 | $0.098 / $0.343+132% vs cheapest | $0.02 | +132% vs cheapest |
| Sail Research fp8 · cached $0.029 | $0.045 | $0.6 | $0.045 / $0.6+167% vs cheapest | $0.029 | +167% vs cheapest |
| Sail Research us, fp8 · cached $0.029 | $0.045 | $0.6 | $0.045 / $0.6+167% vs cheapest | $0.029 | +167% vs cheapest |
| Decart fp4 · cached $0.025 | $0.128 | $0.425 | $0.128 / $0.425+194% vs cheapest | $0.025 | +194% vs cheapest |
| Phala fp8 · cached $0.025 | $0.128 | $0.425 | $0.128 / $0.425+194% vs cheapest | $0.025 | +194% vs cheapest |
fp8 · cached $0.026 | $0.132 | $0.44 | $0.132 / $0.44+204% vs cheapest | $0.026 | +204% vs cheapest |
| StreamLake fp8 · cached $0.028 | $0.141 | $0.47 | $0.141 / $0.47+225% vs cheapest | $0.028 | +225% vs cheapest |
| Io Net fp8 · cached $0.029 | $0.143 | $0.475 | $0.143 / $0.475+228% vs cheapest | $0.029 | +228% vs cheapest |
| AtlasCloud fp8 · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
fp8 · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
nvfp4 · cached $0.05 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.05 | +245% vs cheapest |
fp4 · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
Default region · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
Default region · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
Default region · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
| Inceptron fp8 · cached $0.07 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.07 | +245% vs cheapest |
nvfp4 · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
| Near AI fp8 · cached $0.035 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.035 | +245% vs cheapest |
fp8 · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
| Reka Default region · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
fp8 · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
Default region · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
Default region · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
fp8 · cached $0.03 | $0.15 | $0.5 | $0.15 / $0.5+245% vs cheapest | $0.03 | +245% vs cheapest |
| NextBit fp8 · cached $0.033 | $0.165 | $0.55 | $0.165 / $0.55+280% vs cheapest | $0.033 | +280% vs cheapest |
Default region · cached $0.03 | $0.3 | $1 | $0.3 / $1+591% vs cheapest | $0.03 | +591% vs cheapest |
USD per 1M tokens. Regions are separate routes.
Through a gateway
Your own numbers100M input and 20M output tokens a month: $7.30 direct.
Helicone$7.30+0%
Kong AI Gateway$7.30+0%
LiteLLM$7.30+0%
Vercel AI Gateway$7.30+0%
Cloudflare AI Gateway$7.67+5%
Requesty$7.67+5%
Eden AI$7.70+5.5%
OpenRouter$7.70+5.5%
No published token fee: Martian Gateway, Portkey, TrueFoundry AI Gateway.
Related models
| In / out per 1M | Cheapest route | ||||||
|---|---|---|---|---|---|---|---|
Z.ai · 1M | $2.8 | $8.8 | $2.8 / $8.8 | $4.3 | 1M | Lab list price | · |
Z.ai · 1M | $0.37 | $1.25 | $0.37 / $1.25 | $0.59 | 1M | Lab list price | · |
Z.ai · 1.31M | $0.561 | $1.76 | $0.561 / $1.76 | $0.862 | 1.31M | on Baidu (fp8) | · |
Z.ai · 1M | $0.561 | $1.76 | $0.561 / $1.76 | $0.862 | 1M | on Baidu (fp8) | · |
Meta · 1M | $0.1 | $0.2 | $0.1 / $0.2 | $0.125 | 1M | Lab list price | · |
Meta · 1M | $0.1 | $0.2 | $0.1 / $0.2 | $0.125 | 1M | Lab list price | · |
DeepSeek · 1.31M | $0.053 | $0.158 | $0.053 / $0.158 | $0.079 | 1.31M | on StreamLake (fp8) | · |
Qwen (Alibaba) · 1M | $0.03 | $0.13 | $0.03 / $0.13 | $0.055 | 1M | Lab list price | · |
About GLM 5.3 Flash
GLM-5.3-Flash is a native multimodal model from Z.ai.
Takes text, image, video in and returns text. First listed Sep 23, 2026. Up to 131K output tokens. Blended price $0.069 per 1M tokens at 3 input to 1 output. Model id glm-5-3-flash.
Price history
No list-price history: this model is sold by hosts rather than its lab.
Across fru.devCompany profile
Questions
How much does GLM 5.3 Flash cost?
$0.045 per million input tokens and $0.14 per million output tokens, with cached input at $0.01.
What is the context window of GLM 5.3 Flash?
1.31M tokens, with up to 131K tokens of output.
Where is GLM 5.3 Flash cheapest?
Of 32 routes tracked, InferenceNet is cheapest at $0.045 input and $0.14 output per million tokens.
Has GLM 5.3 Flash's price changed?
Yes. The output price went from $0.28 to $0.5, first seen Sep 25, 2026.
Sources: OpenRouter's public model catalog and each provider's own pricing page, read every morning at 05:00 UTC; gateway fees re-read every Monday. List prices: your contract may differ. Logos via logo.dev; trademarks belong to their owners.