Die Effizienzgrenze

Jedes Modell, aufgetragen nach seinen Kosten gegen seine Güte. Die Treppe ist die Effizienzgrenze: Nichts schlägt diese Modelle auf beiden Achsen zugleich. Alles darunter und rechts davon ist ein schlicht schlechteres Angebot; es gibt etwas, das zugleich besser und günstiger ist.

Ein Wechsel der Nutzung unten verschiebt die Effizienzgrenze weniger, als man erwarten würde: 91% der Modelle auf der Grenze liegen unter jeder Nutzung darauf (nur Solar Pro 4 wechselt). Was sich ändert, ist der Preis; dasselbe Modell schwankt über diese Formen hinweg um bis zum 4-Fachen. Die Steuerung entscheidet also nicht, welche Modelle Sie in Betracht ziehen. Sie entscheidet, was Sie tatsächlich dafür zahlen würden.

10 von 106 nicht dominiert 96 schlechtere Angebote
Nutzung
Gemessen an
$0.030$0.100$0.300$1.00$3.00$10.00102030405060effektive $ pro Million Token, logarithmischAllgemein-Leistung
  1. 1 Ling-3.0-flashinclusionAI 37.8 $0.032/M günstigste Stufe
  2. 2 Solar Pro 4Upstage 41.6 $0.052/M +3.8 für das 1.7-Fache des Preises
  3. 3 DeepSeek V4 Flash 0423DeepSeek 42.1 $0.061/M +0.5 für das 1.2-Fache des Preises
  4. 4 DeepSeek V4 Flash 0731DeepSeek 51.8 $0.105/M +9.7 für das 1.7-Fache des Preises
  5. 5 GPT-5.6 LunaOpenAI 52.3 $0.450/M +0.5 für das 4.3-Fache des Preises
  6. 6 Gemini 3.7 FlashGoogle 56.0 $0.750/M +3.7 für das 1.7-Fache des Preises
  7. 7 Muse Spark 1.2Meta 56.8 $2.00/M +0.8 für das 2.7-Fache des Preises
  8. 8 GLM 5.3Z.ai 59.5 $2.15/M +2.7 für das 1.1-Fache des Preises
  9. 9 Grok 4.6xAI 60.9 $3.00/M +1.4 für das 1.4-Fache des Preises
  10. 10 Claude Opus 5Anthropic 63.1 $10.00/M +2.2 für das 3.3-Fache des Preises
Markdown für LLMs