La frontière de valeur
Chaque modèle, positionné selon ce qu’il coûte face à ce qu’il vaut. L’escalier, c’est la frontière : aucun modèle n’y bat les autres sur les deux axes à la fois. Tout ce qui se situe en dessous et à droite est une offre strictement moins bonne — il existe quelque chose de plus intelligent et de moins cher.
Changing the workload below moves the frontier less than you would expect: 91% of frontier models are on it under every workload (only Solar Pro 4 moves). What does change is the price — the same model swings up to 4× across these shapes. So the control is not about which models to consider. It is about what you would actually pay for them.
- 1 Ling-3.0-flashinclusionAI 37.8 $0.032/M marche la moins chère
- 2 Solar Pro 4Upstage 41.6 $0.052/M +3.8 pour 1.7× le prix
- 3 DeepSeek V4 Flash 0423DeepSeek 42.1 $0.061/M +0.5 pour 1.2× le prix
- 4 DeepSeek V4 Flash 0731DeepSeek 51.8 $0.105/M +9.7 pour 1.7× le prix
- 5 GPT-5.6 LunaOpenAI 52.3 $0.450/M +0.5 pour 4.3× le prix
- 6 Gemini 3.7 FlashGoogle 56.0 $0.750/M +3.7 pour 1.7× le prix
- 7 Muse Spark 1.2Meta 56.8 $2.00/M +0.8 pour 2.7× le prix
- 8 GLM 5.3Z.ai 59.5 $2.15/M +2.7 pour 1.1× le prix
- 9 Grok 4.6xAI 60.9 $3.00/M +1.4 pour 1.4× le prix
- 10 Claude Opus 5Anthropic 63.1 $10.00/M +2.2 pour 3.3× le prix