Quick answer: Qwen3.7 Max is Alibaba's March 2026 API-only model scoring 89.6% MMLU-Pro, 80.4% SWE-Bench Verified, 41.4% HLE, and 29.6% LHTB. Proprietary API.
Where Qwen3.7 Max leads
Where it lags
Best for: SWE-Bench Verified focused coding pipelines; high-MMLU-Pro knowledge tasks; Alibaba Cloud Qwen API deployments.
Qwen3.7 Max is Alibaba's March 2026 proprietary API model — the "Max" tier of the Qwen3.7 generation, representing Alibaba's frontier offering at that release. The 80.4% SWE-Bench Verified is particularly strong for a March 2026 model.
| Field | Value |
|---|---|
| Organization | Alibaba |
| License | Proprietary (API only) |
| Release date | March 2026 |
| Modality | Text only |
Available via Alibaba Cloud Qwen API. Refer to Alibaba Cloud pricing.
| Benchmark | Score | Source | Date |
|---|---|---|---|
| MMLU-Pro | 89.6% | Benchgen evaluation | 2026-03 |
| SWE-Bench Verified | 80.4% | Benchgen evaluation | 2026-03 |
| Humanity's Last Exam | 41.4% | Benchgen evaluation | 2026-03 |
| Agents Last Exam | 31.1% | Benchgen evaluation | 2026-03 |
| LHTB | 29.6% | Benchgen evaluation | 2026-03 |
| Model | MMLU-Pro | SWE-Bench Verified | HLE | License |
|---|---|---|---|---|
| Qwen3.7 Max | 89.6% | 80.4% | 41.4% | Proprietary |
| Meta Muse Spark | — | 77.4% | 40.6% | Proprietary |
| Qwen3.6 27B | 86.2% | 77.2% | — | Apache 2.0 |
Qwen3.7 Max leads on SWE-Bench Verified (80.4% vs 77.4%) vs Muse Spark. For open-source alternative: Qwen3.6 27B (86.2% MMLU-Pro, 77.2% SWE-Bench Verified).
Specs from Alibaba's Qwen3.7 Max release (March 2026) and Benchgen evaluations. Last updated 2026-07-24.