Model head-to-head模型正面对比
The 19 most asked matchups: sourced scores side by side, prices, specs, and a verdict derived from the data — never from sponsorship.
被问得最多的 19 组对决:带来源的成绩并排、价格、规格,以及从数据推导的结论——不受任何厂商赞助。
Claude Opus 5 vs GPT-5.6 Sol
83.3 92.4 · GPT-5.6 Sol leads领先
Claude Opus 5 vs Gemini 3.1 Pro Preview
83.3 86.1 · Dead heat难分伯仲
GPT-5.6 Sol vs Gemini 3.1 Pro Preview
92.4 86.1 · GPT-5.6 Sol leads领先
Claude Sonnet 5 vs GPT-5.5
80.9 82 · Dead heat难分伯仲
Grok 4.5 vs GPT-5.6 Sol
77.9 92.4 · GPT-5.6 Sol leads领先
Grok 4.5 vs Gemini 3.1 Pro Preview
77.9 86.1 · Gemini 3.1 Pro Preview leads领先
DeepSeek V4 Pro 0423 vs Qwen3.7 Max
87.4 85.2 · Dead heat难分伯仲
Kimi K3 vs GLM 5.2
85 85.4 · Dead heat难分伯仲
Kimi K3 vs DeepSeek V4 Pro 0423
85 87.4 · Dead heat难分伯仲
Qwen3.7 Max vs GLM 5.2
85.2 85.4 · Dead heat难分伯仲
MiniMax M3 vs GLM 5.2
81.8 85.4 · GLM 5.2 leads领先
DeepSeek V4 Flash 0423 vs Qwen3.7 Plus
83.5 83.4 · Dead heat难分伯仲
Qwen3.7 Flash vs DeepSeek V4 Flash 0423
82 83.5 · Dead heat难分伯仲
GPT-5.6 Terra vs Gemini 3.6 Flash
89.7 80.1 · GPT-5.6 Terra leads领先
GPT-5.6 Luna vs Gemini 3.1 Flash Lite
84.7 57 · GPT-5.6 Luna leads领先
Claude Haiku 4.5 vs GPT-5.6 Luna
55 84.7 · GPT-5.6 Luna leads领先
Llama 4 Maverick vs Qwen3.7 Plus
42.5 83.4 · Qwen3.7 Plus leads领先
Mistral Large vs Command A
49.9 50.5 · Dead heat难分伯仲
Claude Opus 5 vs Claude Opus 4.8
83.3 84.2 · Dead heat难分伯仲
Not sure which pair? Use the constraint solver →拿不定主意?用约束求解器 →