Allmänt
Kodning
Agenter
Matematik
Bildförståelse
Sökning
Skrivande
Livedata för 2026-10 (beräknas dagligen)
· Metodik v1
· Metodik
· Historik
· JSON
#
Tier
Modell
fedi-index
Percentil
Prisvärdhet
Källor
Uppdelning av poängen
1 A GPT-5.6 Solpreliminär OpenAI 1 482 ±7 100,0 +40 A ›
2 A claude-opus-4-6-searchpreliminär Anthropic 1 479 ±5 97 — A ›
3 A gpt-5.5-searchpreliminär OpenAI 1 468 ±5 94 — A ›
4 A Claude Opus 4.7preliminär Anthropic 1 460 ±5 91 +35 A ›
5 A Claude Fable 5preliminär Anthropic 1 456 ±8 88 +33 A ›
6 A ernie-5.1preliminär Baidu 1 452 ±9 84 +52 A ›
7 A claude-sonnet-4-6-searchpreliminär Anthropic 1 448 ±5 81 — A ›
8 B Grok 4.5preliminär xAI 1 439 ±7 78 +35 A ›
9 B gemini-3.1-pro-groundingpreliminär Google 1 438 ±5 75 — A ›
10 B gemini-3-pro-groundingpreliminär Google 1 434 ±5 72 — A ›
11 B gpt-5.2-searchpreliminär OpenAI 1 434 ±5 69 — A ›
12 B Grok 4.20 Multi-Agentpreliminär xAI 1 431 ±5 66 +24 A ›
13 B Claude Opus 4.8preliminär Anthropic 1 431 ±6 62 +27 A ›
14 B gpt-5.1-searchpreliminär OpenAI 1 427 ±5 59 — A ›
15 B gemini-3-flash-groundingpreliminär Google 1 426 ±5 56 — A ›
16 B gpt-5.4-searchpreliminär OpenAI 1 425 ±5 53 — A ›
17 B claude-sonnet-5-searchpreliminär Anthropic 1 421 ±7 50 — A ›
18 C Grok 4.20preliminär xAI 1 417 ±6 47 +33 A ›
19 C claude-opus-4-5-searchpreliminär Anthropic 1 408 ±5 44 — A ›
20 C grok-4-1-fast-searchpreliminär xAI 1 399 ±5 41 — A ›
21 C grok-4-fast-searchpreliminär xAI 1 399 ±4 38 — A ›
22 C Grok 4.3preliminär xAI 1 393 ±5 34 +4 A ›
23 C claude-sonnet-4-5-searchpreliminär Anthropic 1 387 ±5 31 — A ›
24 C claude-opus-4-1-searchpreliminär Anthropic 1 377 ±5 28 — A ›
25 C o3-searchpreliminär OpenAI 1 373 ±5 25 — A ›
26 D gemini-2.5-pro-groundingpreliminär Google 1 371 ±4 22 — A ›
27 D grok-4-searchpreliminär xAI 1 370 ±6 19 — A ›
28 D ppl-sonar-reasoning-pro-highpreliminär Perplexity 1 368 ±6 16 — A ›
29 D gpt-5-searchpreliminär OpenAI 1 362 ±6 12 — A ›
30 D ppl-sonar-pro-highpreliminär Perplexity 1 359 ±6 9 — A ›
31 D claude-opus-4-searchpreliminär Anthropic 1 356 ±5 6 — A ›
32 D diffbot-small-xlpreliminär Diffbot 1 255 ±8 3 — A ›
33 D api-gpt-4o-searchpreliminär OpenAI 1 239 ±11 0 — A ›
…
A Arena (mänskliga röster) ◆ Pareto-front: ingen är både bättre och billigare
fedi-index är en Elo-ekvivalent på en fast skala: jämförbar mellan månader inom en metodikversion. Nivå S–D: efter percentil i urvalet, och inte bättre än konfidensintervallet tillåter (gränser i metodiken). Detta urval har en källfamilj, så alla dess poäng är preliminära.
Metodik
Bädda in på din webbplats
Tabellen som widget för din webbplats: den uppdateras automatiskt och behåller källhänvisningarna.
Språk
English
Español
Français
Português (Brasil)
Deutsch
Italiano
繁體中文
Русский
日本語
Bahasa Indonesia
한국어
العربية
ไทย
Türkçe
Polski
Deutsch (Schweiz)
Norsk
Slovenščina
Dansk
Svenska
Nederlands
Ελληνικά
Suomi
Română
Tema
Automatiskt
Ljust
Mörkt
Höjd, px
Kod
Kopiera kod
Kopierat
JSON
fedi-index © fedi.software, CC BY 4.0; komponenterna behåller sina källors licenser.
fedi-index © fedi.software, CC BY 4.0; komponenterna behåller sina källors licenser. · Källor:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.