General
Coding
Agents
Math
Vision
Search
Writing
Language: English
Live data for 2026-10 (recalculated daily)
· Methodology v1
· Methodology
· History
· JSON
#
Tier
Model
fedi-index
Percentile
Value
Sources
Score decomposition
1 A GPT-5.6 Solprovisional OpenAI 1,482 ±7 100.0 +40 A ›
2 A claude-opus-4-6-searchprovisional Anthropic 1,479 ±5 97 — A ›
3 A gpt-5.5-searchprovisional OpenAI 1,468 ±5 94 — A ›
4 A Claude Opus 4.7provisional Anthropic 1,460 ±5 91 +35 A ›
5 A Claude Fable 5provisional Anthropic 1,456 ±8 88 +33 A ›
6 A ernie-5.1provisional Baidu 1,452 ±9 84 +52 A ›
7 A claude-sonnet-4-6-searchprovisional Anthropic 1,448 ±5 81 — A ›
8 B Grok 4.5provisional xAI 1,439 ±7 78 +35 A ›
9 B gemini-3.1-pro-groundingprovisional Google 1,438 ±5 75 — A ›
10 B gemini-3-pro-groundingprovisional Google 1,434 ±5 72 — A ›
11 B gpt-5.2-searchprovisional OpenAI 1,434 ±5 69 — A ›
12 B Grok 4.20 Multi-Agentprovisional xAI 1,431 ±5 66 +24 A ›
13 B Claude Opus 4.8provisional Anthropic 1,431 ±6 62 +27 A ›
14 B gpt-5.1-searchprovisional OpenAI 1,427 ±5 59 — A ›
15 B gemini-3-flash-groundingprovisional Google 1,426 ±5 56 — A ›
16 B gpt-5.4-searchprovisional OpenAI 1,425 ±5 53 — A ›
17 B claude-sonnet-5-searchprovisional Anthropic 1,421 ±7 50 — A ›
18 C Grok 4.20provisional xAI 1,417 ±6 47 +33 A ›
19 C claude-opus-4-5-searchprovisional Anthropic 1,408 ±5 44 — A ›
20 C grok-4-1-fast-searchprovisional xAI 1,399 ±5 41 — A ›
21 C grok-4-fast-searchprovisional xAI 1,399 ±4 38 — A ›
22 C Grok 4.3provisional xAI 1,393 ±5 34 +4 A ›
23 C claude-sonnet-4-5-searchprovisional Anthropic 1,387 ±5 31 — A ›
24 C claude-opus-4-1-searchprovisional Anthropic 1,377 ±5 28 — A ›
25 C o3-searchprovisional OpenAI 1,373 ±5 25 — A ›
26 D gemini-2.5-pro-groundingprovisional Google 1,371 ±4 22 — A ›
27 D grok-4-searchprovisional xAI 1,370 ±6 19 — A ›
28 D ppl-sonar-reasoning-pro-highprovisional Perplexity 1,368 ±6 16 — A ›
29 D gpt-5-searchprovisional OpenAI 1,362 ±6 12 — A ›
30 D ppl-sonar-pro-highprovisional Perplexity 1,359 ±6 9 — A ›
31 D claude-opus-4-searchprovisional Anthropic 1,356 ±5 6 — A ›
32 D diffbot-small-xlprovisional Diffbot 1,255 ±8 3 — A ›
33 D api-gpt-4o-searchprovisional OpenAI 1,239 ±11 0 — A ›
…
A Arena (human votes) ◆ Pareto frontier: nothing is both better and cheaper
fedi-index is an Elo-equivalent on a fixed scale: comparable between months within one methodology version. Tiers S–D: by percentile in the slice, and no better than the confidence interval allows (cut-offs in the methodology). This slice has one source family, so all its scores are provisional.
Methodology
Embed on your site
The table as a widget for your site: it updates by itself and keeps the attribution of the sources.
Language
English
Español
Français
Português (Brasil)
Deutsch
Italiano
繁體中文
Русский
日本語
Bahasa Indonesia
한국어
العربية
ไทย
Türkçe
Polski
Deutsch (Schweiz)
Norsk
Slovenščina
Dansk
Svenska
Nederlands
Ελληνικά
Suomi
Română
Theme
Automatic
Light
Dark
Height, px
Code
Copy code
Copied
JSON
fedi-index © fedi.software, CC BY 4.0; components keep the licences of their sources.
fedi-index © fedi.software, CC BY 4.0; components keep the licences of their sources. · Sources:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.