Price × independently measured capability
Compare models
Compare any two or three standard catalogue models, then keep the trade-offs and evidence in a portable decision record.
As of 2026-09-23
Compare · model decision
Choose two or three models
Inspect the differences, estimate your workload and keep the evidence. All standard catalogue models are available, including unrated ones.
Catalogue facts
2026-09-23
Public workload and requirements
These settings are included in the share link. The fixed-request scenario and private evaluation data below are excluded.
Choose your current model and a candidate, or open a published comparison below.
Keep the decision and its evidence
A portable record retains selected facts, complete tier ladders, public requirements and the publication manifest. It also embeds the full permitted public catalogue to verify the input artifact checksum. Files are larger for this reason (up to 2 MB); local storage is limited to 12 records. Team review is local to this browser; there is no hosted collaboration.
Saving is opt-in and includes private review fields. Shared comparison links never include them. Version 1 Check references remain separate and are not overwritten or guessed into this format.
Saved local decisions · 0
No version 2 decision records are stored in this browser.
Published comparisons
All published model comparisons
50 of 50 comparisons
- Claude Fable 5.1 versus Claude Opus 5
- Claude Fable 5.1 versus GPT-6 Astra
- Claude Opus 4.6 versus MiniMax M2.7
- Claude Opus 4.8 versus Claude Opus 5
- Claude Opus 4.8 versus Kimi K2.6
- Claude Opus 5 versus Claude Sonnet 5
- Claude Opus 5 versus Gemini 3.7 Flash
- Claude Opus 5 versus Gemini 3.8 Flash
- Claude Sonnet 4.6 versus gpt-oss-120b
- Claude Sonnet 5 versus Gemini 3.8 Flash
- Claude Sonnet 5 versus GPT-5.6 Sol
- Command A versus Command R+ (08-2024)
- DeepSeek V4 Flash 0423 versus Gemma 4 26B A4B
- DeepSeek V4 Flash 0423 versus Nemotron 3 Super
- DeepSeek V4 Flash 0423 versus Qwen3 30B A3B Instruct 2507
- DeepSeek V4 Pro 0813 versus DeepSeek V4.1 Flash
- DeepSeek V4.1 Flash versus Kimi K3
- Gemini 2.5 Flash Lite versus Gemini 3.5 Flash Lite
- Gemini 3.1 Pro Preview versus Gemini 3.8 Flash
- Gemini 3.7 Flash versus Gemini 3.8 Flash
- Gemini 3.7 Flash versus GPT-5.6 Sol
- Gemini 3.8 Flash versus GLM 5.3
- Gemma 3 12B versus Gemma 3 4B
- Gemma 3 12B versus Qwen3 30B A3B Instruct 2507
- Gemma 3 4B versus gpt-oss-20b
- Gemma 4 26B A4B versus Gemma 4 31B
- Gemma 4 26B A4B versus Hy3
- Gemma 4 31B versus GLM 5.3 Flash
- Gemma 4 31B versus Hy3
- Gemma 4 31B versus MiMo-V2.5-Pro
- GLM 5.3 versus GLM 5.3 Flash
- GLM 5.3 Flash versus GLM 5.3 FlashX
- GPT-5.4 Mini versus GPT-5.4 Nano
- GPT-5.6 Luna versus GPT-5.6 Terra
- GPT-5.6 Sol versus GPT-5.6 Terra
- GPT-5.6 Sol versus GPT-6 Astra
- GPT-6 Astra versus Grok 4.7
- Grok 4.6 versus Grok 4.7
- Kimi K2.6 versus Kimi K3
- Llama 4 Maverick versus Llama 4 Scout
- MiniMax M2.7 versus MiniMax M3
- MiniMax M3 versus GLM 5.3
- Ministral 3 14B 2512 versus Ministral 3 8B 2512
- Muse Spark 1.2 versus Muse Spark 1.2 Contributor
- Nova Lite 1.0 versus Nova Micro 1.0
- o3 versus o3 Pro
- Qwen3 235B A22B Instruct 2507 versus Qwen3 235B A22B Thinking 2507
- Qwen3 VL 30B A3B Instruct versus Qwen3 VL 30B A3B Thinking
- Qwen3.6 27B versus Qwen3.8 27B
- Step 3.5 Flash versus Step 3.7 Flash