Skip to content
llmprice

GLM-4.6

Updated Sep 11, 2026

glm205k context200k max outputreleased Sep 30, 2025Open weightsReasoningTool calling
Cheapest input
$0.286
Cheapest output
$1.142
Official (Z.AI)
$2.2
output per 1M tokens
Providers
27
offering this model
Spread
1.9×
max / min output

Offers

Metered per-token prices. Cheapest input and output are highlighted; marks a context-tier surcharge.

Provider1M input1M output1M cache read1M cache writeContextChanged
302.AIopenCheapest$0.286Cheapest$1.142205k
NanoGPTopen$0.35$1.4$0.175200k
ZenMux$0.35$1.54$0.07200k
Helicone$0.45$1.5205k
IO.NET$0.4$1.75$0.2$0.8200k
Kilo Gatewayopen$0.43$1.75$0.08198k
OpenRouteropen$0.43$1.75$0.08205k
Venice AIopen$0.43$1.75$0.08198k
Meganovaopen$0.45$1.9203k
Deep Infraopen$0.5$2$0.1203k
Hugging Faceopen$0.55$2.2205k
DevPass (LLM Gateway)open$0.55$2.2$0.11free205k
LLM Gatewayopen$0.55$2.2$0.11205k
NovitaAIopen$0.55$2.2$0.11205k
Abacusopen$0.6$2.2203k
Eden AIopen$0.6$2.2$0.11203k
Impossiblopen$0.6$2.2$0.11205k
LLM Gatewayopen$0.6$2.2$0.11200k
Merge Gatewayopen$0.6$2.2$0.11free200k
Ofoxopen$0.6$2.2$0.11205ktodayout +15.8%
OrcaRouteropen$0.6$2.2$0.11free205k
Vercel AI Gatewayopen$0.6$2.2$0.11200k
Z.AIopen$0.6$2.2$0.11free205k
Zhipu AIopen$0.6$2.2$0.11free205k
ModelScopefreefreefree203k
iFlowfreefreefree200k

Other glm models