GPT-5.6 Terra vs
Qwen3.7 Max

Read the published evidence, route context, and missing facts before making a local decision. This page does not name a universal winner.

Models in this comparison

Provider identity and evidence state stay balanced across the pair.

Model type
Proprietary
Evidence state
Estimated evidence
Published context
1,050,000
VS
A
Model type
Proprietary
Evidence state
Supported evidence
Published context
1,000,000

Key implications

Insufficient shared-metric coverage. Each finding is tied to a published metric, price, context, or modality fact.

  1. Context window: GPT-5.6 Terra has the larger published context window (1,050,000 tokens vs 1,000,000 tokens).

Shared metric view

A radar is shown only when at least four compatible supported score metrics are published.

Comparable metric detail

  • AgenticGPT-5.6 Terra: 58.86 · Qwen3.7 Max: 38.19
  • CodingGPT-5.6 Terra: 69.29 · Qwen3.7 Max: 55.03
  • InstructionFollowingGPT-5.6 Terra: Unavailable · Qwen3.7 Max: 91
  • KnowledgeGPT-5.6 Terra: 84.2 · Qwen3.7 Max: 70.2
  • MathGPT-5.6 Terra: 97 · Qwen3.7 Max: 82.2
  • MultilingualGPT-5.6 Terra: Unavailable · Qwen3.7 Max: 100
  • MultimodalGroundedGPT-5.6 Terra: 71.4 · Qwen3.7 Max: Unavailable
  • ReasoningGPT-5.6 Terra: 78.1 · Qwen3.7 Max: 78
  • OverallGPT-5.6 Terra: 72.95 · Qwen3.7 Max: 71.79

Source metrics

Friendly metric names and published units stay visible. Missing measurements remain unavailable rather than becoming a score.

Source metric comparison
MetricUnitGPT-5.6 TerraQwen3.7 Max
Agenticscore58.8638.19
Codingscore69.2955.03
InstructionFollowingscoreUnavailable91
Knowledgescore84.270.2
Mathscore9782.2
MultilingualscoreUnavailable100
MultimodalGroundedscore71.4Unavailable
Reasoningscore78.178
Overallscore72.9571.79

Agentic

Unit
score
GPT-5.6 Terra
58.86
Qwen3.7 Max
38.19

Coding

Unit
score
GPT-5.6 Terra
69.29
Qwen3.7 Max
55.03

InstructionFollowing

Unit
score
GPT-5.6 Terra
Unavailable
Qwen3.7 Max
91

Knowledge

Unit
score
GPT-5.6 Terra
84.2
Qwen3.7 Max
70.2

Math

Unit
score
GPT-5.6 Terra
97
Qwen3.7 Max
82.2

Multilingual

Unit
score
GPT-5.6 Terra
Unavailable
Qwen3.7 Max
100

MultimodalGrounded

Unit
score
GPT-5.6 Terra
71.4
Qwen3.7 Max
Unavailable

Reasoning

Unit
score
GPT-5.6 Terra
78.1
Qwen3.7 Max
78

Overall

Unit
score
GPT-5.6 Terra
72.95
Qwen3.7 Max
71.79

Pricing and context

Verification is shown beside each selected route. Missing facts remain Not verified.

Route pricing and context comparison
FieldUnitGPT-5.6 TerraQwen3.7 Max
Input API priceUSD / 1M tokens$2.5Not verified
Cached input API priceUSD / 1M tokens$0.25Not verified
Output API priceUSD / 1M tokens$15Not verified
Route contexttokens1,050,000Not verified
Input modalitiespublished listNot verifiedNot verified
Output modalitiespublished listNot verifiedNot verified

Input API price

Unit
USD / 1M tokens
GPT-5.6 Terra
$2.5
Qwen3.7 Max
Not verified

Cached input API price

Unit
USD / 1M tokens
GPT-5.6 Terra
$0.25
Qwen3.7 Max
Not verified

Output API price

Unit
USD / 1M tokens
GPT-5.6 Terra
$15
Qwen3.7 Max
Not verified

Route context

Unit
tokens
GPT-5.6 Terra
1,050,000
Qwen3.7 Max
Not verified

Input modalities

Unit
published list
GPT-5.6 Terra
Not verified
Qwen3.7 Max
Not verified

Output modalities

Unit
published list
GPT-5.6 Terra
Not verified
Qwen3.7 Max
Not verified

Evidence provenance

Source records, route identity, timestamps, and methodology are consolidated here without declaring either model a winner.

Publication time
Aug 30, 2026, 2:15 AM UTC
Freshness
Stale — Published weekly benchmark evidence has not refreshed within 8 days.
Methodology
benchlm: benchlm_raw_composite
Model records
  • GPT-5.6 Terra — source benchlm · artifact models · model gpt-5-6-terra
  • Qwen3.7 Max — source benchlm · artifact models · model qwen3-7-max
Selected price routes
  • GPT-5.6 Terra — route benchlm:gpt-5-6-terra · source benchlm · provider openai
  • Qwen3.7 Max — Not published

Other reviewed matchups from the same published revision, ready to open without changing this result’s evidence.

Switch model pair

Choose from this result’s current and reviewed related models. Switching opens a reviewed comparison; it does not change this result’s evidence.

Step 1

Start with popular models, or search the full selectable directory.

Step 2

Start with popular models, or search the full selectable directory.