Generelt
Koding
Agenter
Matematikk
Syn
Søk
Skriving
Live-data for 2026-10 (beregnes daglig)
· Metodikk v1
· Metodikk
· Historikk
· JSON
#
Nivå
Modell
fedi-index
Persentil
Verdi
Kilder
Oppdeling av poengsummen
1 A GPT-5.6 Solforeløpig OpenAI 1 482 ±7 100,0 +40 A ›
2 A claude-opus-4-6-searchforeløpig Anthropic 1 479 ±5 97 — A ›
3 A gpt-5.5-searchforeløpig OpenAI 1 468 ±5 94 — A ›
4 A Claude Opus 4.7foreløpig Anthropic 1 460 ±5 91 +35 A ›
5 A Claude Fable 5foreløpig Anthropic 1 456 ±8 88 +33 A ›
6 A ernie-5.1foreløpig Baidu 1 452 ±9 84 +52 A ›
7 A claude-sonnet-4-6-searchforeløpig Anthropic 1 448 ±5 81 — A ›
8 B Grok 4.5foreløpig xAI 1 439 ±7 78 +35 A ›
9 B gemini-3.1-pro-groundingforeløpig Google 1 438 ±5 75 — A ›
10 B gemini-3-pro-groundingforeløpig Google 1 434 ±5 72 — A ›
11 B gpt-5.2-searchforeløpig OpenAI 1 434 ±5 69 — A ›
12 B Grok 4.20 Multi-Agentforeløpig xAI 1 431 ±5 66 +24 A ›
13 B Claude Opus 4.8foreløpig Anthropic 1 431 ±6 62 +27 A ›
14 B gpt-5.1-searchforeløpig OpenAI 1 427 ±5 59 — A ›
15 B gemini-3-flash-groundingforeløpig Google 1 426 ±5 56 — A ›
16 B gpt-5.4-searchforeløpig OpenAI 1 425 ±5 53 — A ›
17 B claude-sonnet-5-searchforeløpig Anthropic 1 421 ±7 50 — A ›
18 C Grok 4.20foreløpig xAI 1 417 ±6 47 +33 A ›
19 C claude-opus-4-5-searchforeløpig Anthropic 1 408 ±5 44 — A ›
20 C grok-4-1-fast-searchforeløpig xAI 1 399 ±5 41 — A ›
21 C grok-4-fast-searchforeløpig xAI 1 399 ±4 38 — A ›
22 C Grok 4.3foreløpig xAI 1 393 ±5 34 +4 A ›
23 C claude-sonnet-4-5-searchforeløpig Anthropic 1 387 ±5 31 — A ›
24 C claude-opus-4-1-searchforeløpig Anthropic 1 377 ±5 28 — A ›
25 C o3-searchforeløpig OpenAI 1 373 ±5 25 — A ›
26 D gemini-2.5-pro-groundingforeløpig Google 1 371 ±4 22 — A ›
27 D grok-4-searchforeløpig xAI 1 370 ±6 19 — A ›
28 D ppl-sonar-reasoning-pro-highforeløpig Perplexity 1 368 ±6 16 — A ›
29 D gpt-5-searchforeløpig OpenAI 1 362 ±6 12 — A ›
30 D ppl-sonar-pro-highforeløpig Perplexity 1 359 ±6 9 — A ›
31 D claude-opus-4-searchforeløpig Anthropic 1 356 ±5 6 — A ›
32 D diffbot-small-xlforeløpig Diffbot 1 255 ±8 3 — A ›
33 D api-gpt-4o-searchforeløpig OpenAI 1 239 ±11 0 — A ›
…
A Arena (menneskelige stemmer) ◆ Pareto-front: ingen er både bedre og billigere
fedi-index er en Elo-ekvivalent på en fast skala: sammenlignbar mellom måneder innenfor én metodikkversjon. Nivå S–D: etter persentil i utsnittet, og ikke bedre enn konfidensintervallet tillater (grenser i metodikken). Dette utsnittet har én kildefamilie, så alle poengsummene er foreløpige.
Metodikk
Bygg inn på nettstedet ditt
Tabellen som widget for nettstedet ditt: den oppdaterer seg selv og beholder kildehenvisningene.
Språk
English
Español
Français
Português (Brasil)
Deutsch
Italiano
繁體中文
Русский
日本語
Bahasa Indonesia
한국어
العربية
ไทย
Türkçe
Polski
Deutsch (Schweiz)
Norsk
Slovenščina
Dansk
Svenska
Nederlands
Ελληνικά
Suomi
Română
Tema
Automatisk
Lyst
Mørkt
Høyde, px
Kode
Kopier kode
Kopiert
JSON
fedi-index © fedi.software, CC BY 4.0; komponentene beholder lisensene til kildene sine.
fedi-index © fedi.software, CC BY 4.0; komponentene beholder lisensene til kildene sine. · Kilder:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.