Qwen3.8 Max
Updated Sep 11, 2026
qwen1.0M context1.0M max outputreleased Aug 3, 2026Open weightsReasoningTool calling
Official (Alibaba)
$6
output per 1M tokens
Providers
30
offering this model
Spread
1.6×
max / min output
Offers
Metered per-token prices. Cheapest input and output are highlighted; † marks a context-tier surcharge.
| Provider | 1M input | 1M output | 1M cache read | 1M cache write | Context | Changed |
|---|---|---|---|---|---|---|
| Vancine | Cheapest$1.6 | Cheapest$4.8 | $0.2 | — | 1.0M | — |
| Deep Infra | $1.65 | $4.951 | $0.206 | — | 256k | — |
| AIHubMix | $1.69 | $5.07 | $0.169 | $2.1125 | 991k | — |
| Ofox | $1.71 | $5.14 | $0.17 | $2.14 | 1.0M | todayout −14.3% |
| Alibaba (China) | $1.7774 | $5.3323 | $0.2222 | $2.2218 | 1.0M | — |
| SCX.ai | $1.815 | $5.4461 | $0.17 | $2.5 | 1.0M | — |
| CrossModel | $1.88 | $5.63 | $0.23 | $2.35 | 1.0M | — |
| Abacus | $2 | $6 | — | — | 1.0M | — |
| Alibaba | $2 | $6 | $0.25 | $2.5 | 1.0M | — |
| Cloudflare AI Gateway | $2 | $6 | $0.25 | — | 1.0M | — |
| DigitalOcean | $2 | $6 | $0.2 | — | 1.0M | — |
| Eden AI | $2 | $6 | $0.25 | $2.5 | 1.0M | — |
| EmpirioLabs AI | $2 | $6 | $2 | — | 1.0M | — |
| Fireworks AI | $2 | $6 | $0.25 | — | 262k | — |
| Charm Hyper | $2 | $6 | $0.25 | — | 1.0M | — |
| DevPass (LLM Gateway) | $2 | $6 | $0.25 | $2.5 | 1.0M | — |
| LLM Gateway | $2 | $6 | $0.25 | $2.5 | 1.0M | — |
| LLM Gateway | $2 | $6 | $0.25 | — | 1.0M | — |
| LLM Gateway | $2 | $6 | $0.25 | $2.5 | 1.0M | — |
| Merge Gateway | $2 | $6 | $0.25 | — | 1.0M | — |
| Modalopen | $2 | $6 | $0.25 | — | 1.0M | — |
| NanoGPT | $2 | $6 | $0.25 | $2.5 | 991k | — |
| Ofox | $2 | $6 | $0.25 | $2.5 | 1.0M | — |
| OpenCode Go | $2 | $6 | $0.25 | $2.5 | 1.0M | — |
| OrcaRouter | $2 | $6 | $0.25 | $2.5 | 1.0M | — |
| Requesty | $2 | $6 | $0.25 | $2.5 | 1.0M | — |
| 302.AI | $2.16 | $6.36 | — | — | 1.0M | — |
| Impossibl | $2.5 | $7.5 | — | — | 1.0M | — |
| Kenarifree | free | free | — | — | 1.0M | — |
Subscription plans (not per-token)
Billed per month, not per token — never counted as the cheapest offer.
| Provider | 1M input | 1M output | Context |
|---|---|---|---|
| Alibaba Token Planplan | free | free | 1.0M |
| Alibaba Token Plan (China)plan | free | free | 1.0M |
| ClinePassplan | $2 | $6 | 1.0M |
| SCNet Token Planplan | free | free | 1.0M |
Other qwen models
- Qwen 2.5 72B Instruct
- Qwen 2.5 Coder 32B
- Qwen 3 235B A22B
- Qwen 3 235B A22B Thinking 2507
- Qwen 3.5 35B A3B
- Qwen 3.5 397B A17B
- Qwen 3.6 27B
- Qwen 3.6 Plus
- Qwen 3.7 Max
- Qwen 3.7 Plus
- Qwen 3.8 Flash
- Qwen 3.8 Max
- Qwen 3 Coder 480B
- Qwen Coder Plus
- Qwen Flash
- Qwen Image
- Qwen Max
- Qwen-MT Plus
- Qwen-MT Turbo
- Qwen-Omni Turbo
- Qwen-Omni Turbo Realtime
- Qwen Plus
- Qwen/Qwen2.5-72B-Instruct
- Qwen/Qwen2.5-7B-Instruct
- Qwen/Qwen3-14B
- Qwen/Qwen3-235B-A22B-Thinking-2507
- Qwen/Qwen3-30B-A3B-Instruct-2507
- Qwen/Qwen3-32B
- Qwen/Qwen3.5-9B
- Qwen/Qwen3-8B
- Qwen/Qwen3-Coder-30B-A3B-Instruct
- Qwen/Qwen3-Coder-480B-A35B-Instruct
- Qwen/Qwen3-VL-235B-A22B-Instruct
- Qwen/Qwen3-VL-235B-A22B-Thinking
- Qwen/Qwen3-VL-30B-A3B-Instruct
- Qwen/Qwen3-VL-30B-A3B-Thinking
- Qwen/Qwen3-VL-32B-Instruct
- Qwen/Qwen3-VL-32B-Thinking
- Qwen/Qwen3-VL-8B-Instruct
- Qwen Turbo
- Qwen-VL Max
- Qwen-VL OCR
- Qwen-VL Plus
- Qwen2.5 14B Instruct
- Qwen2.5 32B Instruct
- Qwen2.5 72B Instruct
- Qwen2.5 7B Instruct
- Qwen2.5 Coder 32B Instruct
- Qwen2.5-Omni 7B
- Qwen2.5-VL 72B Instruct
- Qwen2.5-VL 7B Instruct
- Qwen3 14B
- Qwen3 235B-A22B
- Qwen3 235B A22B FP8
- Qwen3 235B A22B Instruct
- Qwen3 235B A22B Instruct 2507
- Qwen3 235B A22B Thinking
- Qwen3 235B A22B Thinking 2507
- Qwen3 30B A3B
- Qwen3 30B A3B Instruct 2507
- Qwen3 30B A3B Thinking 2507
- Qwen3 32B
- Qwen3.5 0.8B
- Qwen3.5 122B-A10B
- Qwen3.5 27B
- Qwen3.5 35B-A3B
- Qwen3.5 397B-A17B
- Qwen3.5 397B A17B TEE
- Qwen3.5 4B
- Qwen3.5 9B
- Qwen3.5 Flash
- Qwen3.5 Plus
- Qwen3.6 27B
- Qwen3.6 27B TEE
- Qwen3.6 35B-A3B
- Qwen3.6 Max Preview
- Qwen3.6 Plus
- Qwen3.7 Flash
- Qwen3.7 Max
- Qwen3.7 Plus
- Qwen3.8 2.4T A95B
- Qwen3.8 27B
- Qwen3.8 27B TEE
- Qwen3.8 Flash
- Qwen3.8 Flash Next
- Qwen3.8 Max 0902
- Qwen3 8B
- Qwen3-ASR Flash
- Qwen3-Coder 30B-A3B Instruct
- Qwen3 Coder 480B A35B Instruct
- Qwen3 Coder 480B A35B Instruct Turbo
- Qwen3 Coder Flash
- Qwen3 Coder Next
- Qwen3 Coder Plus
- Qwen3 Embedding 8B
- Qwen3 Max
- Qwen3 Max Thinking
- Qwen3-Next 80B-A3B
- Qwen3-Next 80B-A3B Instruct
- Qwen3 Next 80B A3B Thinking
- Qwen3-Omni Flash
- Qwen3-Omni Flash Realtime
- Qwen3 Reranker 4B
- Qwen3 VL 235B
- Qwen3-VL 235B-A22B
- Qwen3 VL 235B A22B Instruct
- Qwen3 VL 235B A22B Thinking
- Qwen3-VL 30B-A3B
- Qwen3 VL 30B A3B Instruct
- Qwen3 VL 30B A3B Thinking
- Qwen3 VL Flash
- Qwen3-VL Plus
- QwQ 32B
- QwQ Plus
- Umans Flash