La frontière de valeur

Chaque modèle, positionné selon ce qu’il coûte face à ce qu’il vaut. L’escalier, c’est la frontière : aucun modèle n’y bat les autres sur les deux axes à la fois. Tout ce qui se situe en dessous et à droite est une offre strictement moins bonne — il existe quelque chose de plus intelligent et de moins cher.

Changing the workload below moves the frontier less than you would expect: 91% of frontier models are on it under every workload (only Solar Pro 4 moves). What does change is the price — the same model swings up to across these shapes. So the control is not about which models to consider. It is about what you would actually pay for them.

10 non dominés sur 106 96 offres moins bonnes
Charge de travail
Mesuré sur
$0.030$0.100$0.300$1.00$3.00$10.00102030405060$ effectif par million de tokens — échelle logcapacité Général
  1. 1 Ling-3.0-flashinclusionAI 37.8 $0.032/M marche la moins chère
  2. 2 Solar Pro 4Upstage 41.6 $0.052/M +3.8 pour 1.7× le prix
  3. 3 DeepSeek V4 Flash 0423DeepSeek 42.1 $0.061/M +0.5 pour 1.2× le prix
  4. 4 DeepSeek V4 Flash 0731DeepSeek 51.8 $0.105/M +9.7 pour 1.7× le prix
  5. 5 GPT-5.6 LunaOpenAI 52.3 $0.450/M +0.5 pour 4.3× le prix
  6. 6 Gemini 3.7 FlashGoogle 56.0 $0.750/M +3.7 pour 1.7× le prix
  7. 7 Muse Spark 1.2Meta 56.8 $2.00/M +0.8 pour 2.7× le prix
  8. 8 GLM 5.3Z.ai 59.5 $2.15/M +2.7 pour 1.1× le prix
  9. 9 Grok 4.6xAI 60.9 $3.00/M +1.4 pour 1.4× le prix
  10. 10 Claude Opus 5Anthropic 63.1 $10.00/M +2.2 pour 3.3× le prix
Markdown for LLMs