Skip to content
llmprice

GLM-4.7-Flash

Updated Sep 11, 2026

glm-flash203k context203k max outputreleased Jan 19, 2026Open weightsReasoningTool calling
Cheapest input
$0.06
Cheapest output
$0.4
Official (Z.AI)
free
output per 1M tokens
Providers
22
offering this model
Spread
1.3×
max / min output

Offers

Metered per-token prices. Cheapest input and output are highlighted; marks a context-tier surcharge.

Provider1M input1M output1M cache read1M cache writeContext
Eden AIopenCheapest$0.06Cheapest$0.4$0.01203k
DevPass (LLM Gateway)open$0.06$0.4$0.01free200k
Venice AIopen$0.06$0.4$0.01128k
Cloudflare Workers AIopen$0.0605$0.4131k
Eden AIopen$0.0605$0.4131k
Kilo Gatewayopen$0.0605$0.4131k
OpenRouteropen$0.0605$0.4200k
Amazon Bedrockopen$0.07$0.4200k
Eden AIopen$0.07$0.4200k
Jiekou.AIopen$0.07$0.4200k
Merge Gatewayopen$0.07$0.4200k
NanoGPTopen$0.07$0.4$0.035200k
NovitaAIopen$0.07$0.4$0.01200k
Vercel AI Gatewayopen$0.07$0.4200k
Cortecsopen$0.08$0.478203k
Syntheticopen$0.1$0.5$0.1197k
EmpirioLabs AIfreefreefree200k
Hugging Facefreefreefree200k
Kenarifreefreefree200k
Pendrafreefreefree200k
Z.AIfreefreefreefreefree200k
ZenMuxfreefreefree200k
Zhipu AIfreefreefreefreefree200k

Other glm-flash models