Qwen3.7 Max
Updated Sep 11, 2026
qwen1.1M context500k max outputreleased May 21, 2026ReasoningTool calling
Official (Alibaba)
$7.5
output per 1M tokens
Providers
32
offering this model
Spread
3.6×
max / min output
Offers
Metered per-token prices. Cheapest input and output are highlighted; † marks a context-tier surcharge.
| Provider | 1M input | 1M output | 1M cache read | 1M cache write | Context | Changed |
|---|---|---|---|---|---|---|
| Merge Gateway | Cheapest$0.825 | Cheapest$2.4755 | $0.165 | — | 1.0M | — |
| Cloudflare AI Gateway | $1.25 | $3.75 | $0.25 | — | 1.0M | — |
| Kilo Gateway | $1.25 | $3.75 | $0.125 | $1.5625 | 1.0M | — |
| DevPass (LLM Gateway) | $1.25 | $3.75 | $0.25 | $3.125 | 1.0M | — |
| LLM Gateway | $1.25 | $3.75 | $0.25 | — | 1.0M | — |
| NovitaAI | $1.25 | $3.75 | $0.25 | $1.5625 | 1.0M | — |
| OrcaRouter | $1.25 | $3.75 | $0.25 | $1.563 | 1.0M | — |
| Pioneer | $1.25 | $3.75 | $0.25 | $1.5625 | 991k | — |
| Together AI | $1.25 | $3.75 | $0.125 | — | 1.0M | — |
| OpenRouter | $1.475 | $4.425 | $0.295 | $1.8438 | 1.0M | — |
| AIHubMix | $1.69 | $5.07 | $0.169 | $2.1125 | 991k | — |
| Ofox | $1.71 | $5.14 | $0.17 | $2.14 | 1.1M | todayout −31.5% |
| 302.AI | $1.8 | $5.3 | — | — | 1.0M | — |
| CrossModel | $1.88 | $5.63 | $0.375 | $2.35 | 1.0M | — |
| Abacus | $2.5 | $7.5 | — | — | 1.0M | — |
| Alibaba | $2.5 | $7.5 | $0.5 | $3.125 | 1.0M | — |
| Alibaba (China) | $2.5 | $7.5 | $0.5 | $3.125 | 1.0M | — |
| Deep Infra | †$2.5 | $7.5 | $0.5 | — | 256k | — |
| EmpirioLabs AI | $2.5 | $7.5 | $2.5 | — | 1.0M | — |
| GMI Cloud | $2.5 | $7.5 | $0.25 | $3.125 | 1.0M | — |
| Charm Hyper | $2.5 | $7.5 | $0.5 | — | 1.0M | — |
| Impossibl | $2.5 | $7.5 | $0.5 | — | 1.0M | — |
| LLM Gateway | $2.5 | $7.5 | $0.5 | $3.125 | 1.0M | — |
| NanoGPT | $2.5 | $7.5 | $0.5 | $3.125 | 1.0M | — |
| Ofox | $2.5 | $7.5 | $0.5 | $3.125 | 1.0M | — |
| OpenCode Go | $2.5 | $7.5 | $0.5 | $3.125 | 1.0M | — |
| Requesty | $2.5 | $7.5 | $0.25 | $3.125 | 1.0M | — |
| ZenMux | $2.5 | $7.5 | $0.5 | $3.125 | 1.0M | — |
| Modelis | $3 | $9 | — | — | 1.0M | — |
Subscription plans (not per-token)
Billed per month, not per token — never counted as the cheapest offer.
| Provider | 1M input | 1M output | Context |
|---|---|---|---|
| Alibaba Coding Planplan | $2.5 | $7.5 | 1.0M |
| Alibaba Coding Plan (China)plan | $2.5 | $7.5 | 1.0M |
| Alibaba Token Planplan | free | free | 1.0M |
| Alibaba Token Plan (China)plan | free | free | 1.0M |
| ClinePassplan | $2.5 | $7.5 | 1.0M |
Other qwen models
- Qwen 2.5 72B Instruct
- Qwen 2.5 Coder 32B
- Qwen 3 235B A22B
- Qwen 3 235B A22B Thinking 2507
- Qwen 3.5 35B A3B
- Qwen 3.5 397B A17B
- Qwen 3.6 27B
- Qwen 3.6 Plus
- Qwen 3.7 Max
- Qwen 3.7 Plus
- Qwen 3.8 Flash
- Qwen 3.8 Max
- Qwen 3 Coder 480B
- Qwen Coder Plus
- Qwen Flash
- Qwen Image
- Qwen Max
- Qwen-MT Plus
- Qwen-MT Turbo
- Qwen-Omni Turbo
- Qwen-Omni Turbo Realtime
- Qwen Plus
- Qwen/Qwen2.5-72B-Instruct
- Qwen/Qwen2.5-7B-Instruct
- Qwen/Qwen3-14B
- Qwen/Qwen3-235B-A22B-Thinking-2507
- Qwen/Qwen3-30B-A3B-Instruct-2507
- Qwen/Qwen3-32B
- Qwen/Qwen3.5-9B
- Qwen/Qwen3-8B
- Qwen/Qwen3-Coder-30B-A3B-Instruct
- Qwen/Qwen3-Coder-480B-A35B-Instruct
- Qwen/Qwen3-VL-235B-A22B-Instruct
- Qwen/Qwen3-VL-235B-A22B-Thinking
- Qwen/Qwen3-VL-30B-A3B-Instruct
- Qwen/Qwen3-VL-30B-A3B-Thinking
- Qwen/Qwen3-VL-32B-Instruct
- Qwen/Qwen3-VL-32B-Thinking
- Qwen/Qwen3-VL-8B-Instruct
- Qwen Turbo
- Qwen-VL Max
- Qwen-VL OCR
- Qwen-VL Plus
- Qwen2.5 14B Instruct
- Qwen2.5 32B Instruct
- Qwen2.5 72B Instruct
- Qwen2.5 7B Instruct
- Qwen2.5 Coder 32B Instruct
- Qwen2.5-Omni 7B
- Qwen2.5-VL 72B Instruct
- Qwen2.5-VL 7B Instruct
- Qwen3 14B
- Qwen3 235B-A22B
- Qwen3 235B A22B FP8
- Qwen3 235B A22B Instruct
- Qwen3 235B A22B Instruct 2507
- Qwen3 235B A22B Thinking
- Qwen3 235B A22B Thinking 2507
- Qwen3 30B A3B
- Qwen3 30B A3B Instruct 2507
- Qwen3 30B A3B Thinking 2507
- Qwen3 32B
- Qwen3.5 0.8B
- Qwen3.5 122B-A10B
- Qwen3.5 27B
- Qwen3.5 35B-A3B
- Qwen3.5 397B-A17B
- Qwen3.5 397B A17B TEE
- Qwen3.5 4B
- Qwen3.5 9B
- Qwen3.5 Flash
- Qwen3.5 Plus
- Qwen3.6 27B
- Qwen3.6 27B TEE
- Qwen3.6 35B-A3B
- Qwen3.6 Max Preview
- Qwen3.6 Plus
- Qwen3.7 Flash
- Qwen3.7 Plus
- Qwen3.8 2.4T A95B
- Qwen3.8 27B
- Qwen3.8 27B TEE
- Qwen3.8 Flash
- Qwen3.8 Flash Next
- Qwen3.8 Max
- Qwen3.8 Max 0902
- Qwen3 8B
- Qwen3-ASR Flash
- Qwen3-Coder 30B-A3B Instruct
- Qwen3 Coder 480B A35B Instruct
- Qwen3 Coder 480B A35B Instruct Turbo
- Qwen3 Coder Flash
- Qwen3 Coder Next
- Qwen3 Coder Plus
- Qwen3 Embedding 8B
- Qwen3 Max
- Qwen3 Max Thinking
- Qwen3-Next 80B-A3B
- Qwen3-Next 80B-A3B Instruct
- Qwen3 Next 80B A3B Thinking
- Qwen3-Omni Flash
- Qwen3-Omni Flash Realtime
- Qwen3 Reranker 4B
- Qwen3 VL 235B
- Qwen3-VL 235B-A22B
- Qwen3 VL 235B A22B Instruct
- Qwen3 VL 235B A22B Thinking
- Qwen3-VL 30B-A3B
- Qwen3 VL 30B A3B Instruct
- Qwen3 VL 30B A3B Thinking
- Qwen3 VL Flash
- Qwen3-VL Plus
- QwQ 32B
- QwQ Plus
- Umans Flash