Skip to content
llmprice

Qwen3 32B

Updated Sep 11, 2026

qwen131k context41k max outputreleased Apr 1, 2025Open weightsReasoningTool calling
Cheapest input
$0.08
Cheapest output
$0.25
Official (Alibaba)
$2.8
output per 1M tokens
Providers
19
offering this model
Spread
11.2×
max / min output

Offers

Metered per-token prices. Cheapest input and output are highlighted; marks a context-tier surcharge.

Provider1M input1M output1M cache read1M cache writeContext
Deep InfraopenCheapest$0.08$0.2841k
Kilo Gatewayopen$0.08$0.2841k
OpenRouteropen$0.08$0.28131k
OVHcloud AI Endpointsopen$0.09Cheapest$0.2533k
Abacusopen$0.09$0.29131k
Cortecsopen$0.089$0.31232k
Jiekou.AIopen$0.1$0.4541k
NovitaAIopen$0.1$0.4541k
Amazon Bedrockopen$0.15$0.633k
Merge Gatewayopen$0.15$0.6131k
DigitalOceanopen$0.25$0.5533k
Helicone$0.29$0.59131k
Hugging Faceopen$0.29$0.59131k
DevPass (LLM Gateway)open$0.36$0.8741k
Alibaba (China)open$0.287$1.147131k
Pioneeropen$0.9$0.9$0.9$0.9131k
Alibabaopen$0.7$2.8131k
iFlowfreefreefree128k

Other qwen models