수치 이해하기

가치 프런티어

모든 모델을 가격과 성능 두 축에 찍은 그래프입니다. 계단선이 프런티어입니다. 두 축 모두에서 이 모델들을 동시에 이기는 모델은 없습니다. 그 아래쪽과 오른쪽에 있는 것은 전부 무조건 손해인 선택입니다. 더 똑똑하면서 더 싼 모델이 존재합니다.

아래에서 작업 부하를 바꿔도 프런티어는 생각보다 덜 움직입니다. 프런티어 모델의 46%는 어떤 작업 부하에서도 프런티어에 있습니다(7개가 움직입니다). 정작 바뀌는 것은 가격이며, 같은 모델이 이 형태들 사이에서 최대 3.6×까지 흔들립니다. 그러니 이 조절기는 어떤 모델을 고려할지가 아니라, 그것들에 실제로 얼마를 낼지에 관한 것입니다.

작업 유형
측정 기준

일반 · 균형

Claude Opus 5.5

Anthropic

프런티어 위
일반 성능
1511.7
실효 $/M
$8.00/M

Compared with the previous price rung, Gemini 3.8 Flash: +14.7 Elo · +$5.00/M for 균형. Score differences are not task-success or capability guarantees.

Compare General scores and capabilities
$0.030$0.100$0.300$1.00$3.00$10.00$30.0010801170126013501440100만 토큰당 실효 $ — 로그 스케일일반 성능
100만 토큰당 실효 $ — 로그 스케일 · 일반 성능

프런티어 위

일반 · 균형 · 실효 $/M

  1. 1 Llama 3.1 8B Instruct Meta 1186.5 $0.025/M 최저가 단
  2. 2 gpt-oss-20b OpenAI 1287.7 $0.036/M +101.2 Elo · +$0.011/M vs previous rung
  3. 3 Gemma 3 4B Google 1290.8 $0.063/M +3.1 Elo · +$0.027/M vs previous rung
  4. 4 gpt-oss-120b OpenAI 1365.4 $0.065/M +74.6 Elo · +$0.0025/M vs previous rung
  5. 5 DeepSeek V4 Flash 0423 DeepSeek 1432.1 $0.113/M +66.7 Elo · +$0.048/M vs previous rung
  6. 6 Gemma 4 26B A4B Google 1433.9 $0.127/M +1.8 Elo · +$0.014/M vs previous rung
  7. 7 MiMo-V2.6-Flash Xiaomi 1456.4 $0.175/M +22.5 Elo · +$0.048/M vs previous rung
  8. 8 DeepSeek V4.1 Flash DeepSeek 1462.5 $0.182/M +6.1 Elo · +$0.0073/M vs previous rung
  9. 9 GLM 5.3 Flash Z.ai 1469.6 $0.238/M +7.1 Elo · +$0.055/M vs previous rung
  10. 10 MiMo-V2.6-Pro Xiaomi 1491.0 $0.540/M +21.4 Elo · +$0.303/M vs previous rung
  11. 11 Gemini 3.8 Flash Google 1497.0 $3.00/M +6.0 Elo · +$2.46/M vs previous rung
  12. 12 Claude Opus 5.5 Anthropic 1511.7 $8.00/M +14.7 Elo · +$5.00/M vs previous rung
근거와 질문