Skip to content
Bencher

Models · Qwen (Alibaba) · Out sinceReleased 21 May 2026

Qwen3.7 Plus

Available on OpenRouterOn OpenRouterAvailable nowGenerally availableClosed (can't be downloaded)Proprietary

Qwen3.7 Plus is made by Qwen (Alibaba). We don't have enough test results yet to rank it. It's cheap to use.

List price for input <=256K; QwenCloud showed a 20%-off promo ($0.32/$1.28) on 2026-10-01.

Writing & creativity
—
Research & analysis
—
Coding
—
Price
Cheap$0.40 / $1.60
Price per 1M (blended)Blended / 1M
$0.70
MemoryContext
1M
Longest answerMax output
131K
Test resultsResults
26 (5 independent5 indep.)
Out sinceReleased
21 May 2026
Made byVendor
Qwen (Alibaba)
UnderstandsInputs
text, image, video

Scores are out of 100 for each area, compared with every model we track; “#” is its rank. Context is how much text it can read at once (1M is roughly 700,000 words). Blended price mixes the cost of what you send and what it writes back.

Using it through OpenRouter

On OpenRouter

OpenRouter is a service that gives access to many AI models in one place. This model is listed there as qwen/qwen3.7-plus.

Route it as qwen/qwen3.7-plus at $0.32 in / $1.28 out per 1M tokens, 1M context. Listed since 3 Jun 2026.

frequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Every test result

Every result

All the numbers,with where they came from.

Every result we've found for this model, with who measured it and a link to where we read it.

All raw rows (vendor and independent kept separate), with setting label, source, date, harness and notes.

All results for this model
NotesNotes
AA-LCR73.0%DefaultQwen3.7 PlusIndependent testIndependentArtificial Analysis ↗1 Oct 2026—AA-LCR accuracy, AA-run (long multi-document reasoning)
AA-Omniscience Accuracy22.5%DefaultQwen3.7 PlusIndependent testIndependentArtificial Analysis ↗1 Oct 2026—
AA-Omniscience Hallucination Rate27.7%DefaultQwen3.7 PlusIndependent testIndependentArtificial Analysis ↗1 Oct 2026—share of non-correct answers that were wrong instead of abstaining; = 1 - AA 'omniscienceNonHallucination' field (equals breakdown.hallucinationRate on the eval page)
AA-Omniscience Index1.1DefaultQwen3.7 PlusIndependent testIndependentArtificial Analysis ↗1 Oct 2026—AA-Omniscience Index (-100..100): correct minus incorrect, abstentions not penalised
DeepSWE14.2%Defaultsetting not statedMaker's own figureVendor-reportedQwen (Alibaba) ↗14 Aug 2026Claude CodeQwen3.7-Plus column in the Qwen3.8-27B model card
GPQA Diamond90.3%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
HMMT February 202692.9%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—HMMT 2026 Feb
Humanity's Last Exam34.7%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
IMO-AnswerBench86.0%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
LiveCodeBench89.6%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
MathArena Apex22.7%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
MCP Atlas73.2%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
MCPMark58.7%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
MMLU-Pro88.5%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
MMMLU89.0%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
MMMU-Pro (no tools)79.0%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
NL2Repo-Bench41.1%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
OSWorld-Verified73.3%No reasoningenable_thinking=FalseMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
SciCode51.3%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026—
SkillsBench54.3%DefaultIndependent testIndependentVals.ai ↗27 Sep 2026OpenHands±4.333 stderr; $0.137/test
SkillsBench54.9%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026OpenCode
SWE-bench Multilingual75.8%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026Internal scaffold (bash + file-edit)
SWE-Bench Pro (public, v1)57.6%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026Internal scaffold (bash + file-edit)Qwen-corrected ('refined') SWE-bench Pro
SWE-bench Verified77.7%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026Internal scaffold (bash + file-edit)
Terminal-Bench 2.070.3%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗21 May 2026Terminus 2 (Harbor)avg of 5 runs
Terminal-Bench 2.164.0%Defaultsetting not statedMaker's own figureVendor-reportedQwen (Alibaba) ↗14 Aug 2026Terminus 2Qwen3.7-Plus column in the Qwen3.8-27B model card