Benchmarks

Top models across a combined benchmark plus Artificial Analysis, LMArena, LiveBench, FrontierCode, Epoch AI, ARC Prize, EQ-Bench, Design Arena, and NanoGPT benchmark categories.

Combined

Equal-weight blend of Artificial Analysis Intelligence Index, LMArena Overall, LiveBench Overall, NanoGPT Usage Share. Each source is min-max normalized to 0-100 across its current leaderboard and weighted at 25%. Missing or unavailable source entries contribute 0.

Top 20 price vs performance

X-axis: $/M blended tokens

Best value frontier: No cheaper model has a better benchmark result.

1.

Claude Fable 5
Anthropic logo

by Anthropic

96.1%

Best value

2.

Claude Opus 4.8
Anthropic logo

by Anthropic

48.8%

Best value

3.

GPT 5.6 Sol
OpenAI logo

by OpenAI

48.1%

4.

Kimi K3
Moonshot logo

by Moonshot

46.4%

Best value

5.

Claude 4.7 Opus
Anthropic logo

by Anthropic

44.5%

6.

GPT 5.5
OpenAI logo

by OpenAI

42.7%

34.3%

Best value

8.

GPT 5.6 Terra
OpenAI logo

by OpenAI

34.1%

9.

GPT 5.4
OpenAI logo

by OpenAI

29.8%

10.

GPT 5
OpenAI logo

by OpenAI

29.8%

Weighted blend of latest source snapshots

NanoGPT Composite