XBench

Home = our average · lab pages = their ranks

As of 2026-08-12

Arena Text.

Their board. Their ranks.

Human preference Elo from the Arena.ai Text leaderboard.

Arena #1 is Fable 5

Open the lab’s original

Arena Text

Arena.ai Text leaderboard. Preliminary rows are labelled. No averaging.

1
Fable 5
Anthropic · closed
New Claude 5 frontier tier
1506Lab#1Lab
2
Opus 4.7
Anthropic · closed
Frontier coding/reasoning
1502Lab#3Lab
3
Spark 1.2
Meta · closed
Agent-native Meta model
1498Lab#4Lab
4
Qwen3.8 Max
Alibaba · closed
Hosted 2.4T flagship; weights promised
1491Lab#8Lab
5
3.7 Flash
Google DeepMind · closed
Latest Flash workhorse
1490Prelim#9Prelim
6
Opus 5
Anthropic · closed
Anthropic’s flagship frontier model
1489Lab#10Lab
6
Kimi K3
Moonshot AI · open
Frontier open-weight
1489Lab#12Lab
8
3.1 Pro
Google DeepMind · closed
Frontier multimodal/reasoning
1486Lab#14Lab
9
3.6 Flash
Google DeepMind · closed
Frontier-class fast reasoning
1484Lab#16Lab
10
GPT-5.5
OpenAI · closed
Frontier reasoning + agents
1482Lab#17Lab
11
Opus 4.8
Anthropic · closed
Frontier reasoning/coding
1481Lab#18Lab
12
Grok 4.20
SpaceXAI · closed
Frontier reasoning/agents
1475Lab#24Lab
13
Qwen3.7 Max
Alibaba · closed
Frontier Chinese model
1474Lab#26Lab
14
GLM-5.2
Zhipu AI · open
Frontier/open-weight coding
1471Lab#33Lab
15
Grok 4.5
SpaceXAI · closed
Frontier coding/agents
1469Lab#36Lab
16
Grok 4.6
SpaceXAI · closed
Latest Grok frontier model
1464Prelim#44Prelim
17
Sonnet 5
Anthropic · closed
Frontier general-purpose/agentic
1462Lab#45Lab
18
Grok 4.3
SpaceXAI · closed
Frontier reasoning/agents
1442Lab#78Lab

18 models on this board · # is this page’s rank