Generelt
Kodning
Agenter
Matematik
Billedforståelse
Søgning
Skrivning
Live-data for 2026-10 (genberegnes dagligt)
· Metodik v1
· Metodik
· Historik
· JSON
#
Tier
Model
fedi-index
Percentil
Folk foretrækker
Løser opgaver
Værdi
Kilder
Opdeling af scoren
1 A Claude Fable 5.1foreløbig Anthropic 1.491 ±8 100,0 1.503 — +47 A ›
2 A Claude Opus 5.5foreløbig Anthropic 1.488 ±9 98 1.501 — +76◆ A ›
3 A GPT-6 Astraforeløbig OpenAI 1.481 ±10 96 1.494 — +12 A ›
4 A Claude Sonnet 5.5foreløbig Anthropic 1.479 ±13 95 1.493 — +50 A ›
5 A Claude Opus 5 Anthropic 1.475 ±6 93 1.479 1.466 +59 A τ ›
6 A GPT-6.1 Solforeløbig OpenAI 1.475 ±12 91 1.488 — +53 A ›
7 A GPT-6 Solforeløbig OpenAI 1.470 ±10 90 1.482 — +22 A ›
8 A Claude Fable 5 Anthropic 1.470 ±6 88 1.477 1.453 +33 A τ ›
9 A GPT-5.6 Sol OpenAI 1.467 ±6 86 1.469 1.464 +40 A τ ›
10 A Claude Opus 4.8 Anthropic 1.465 ±6 84 1.470 1.453 +27 A τ ›
11 A Gemini 4 Argon (High)foreløbig Google 1.462 ±8 82 1.473 — — A ›
12 A GPT-5.5 OpenAI 1.459 ±5 81 1.459 1.460 +29 A τ ›
13 B Kimi K3 Moonshot AI · Åbne vægte 1.456 ±5 79 1.459 1.449 +44 A τ ›
14 B GLM 5.2 Zhipu AI · Åbne vægte 1.454 ±5 77 1.456 1.449 +45 A τ ›
15 B Grok 4.5 xAI 1.451 ±5 75 1.446 1.465 +35 A τ ›
16 B Claude Sonnet 5foreløbig Anthropic 1.449 ±7 74 1.459 — +32 A ›
17 B DeepSeek V4.1 Flashforeløbig DeepSeek · Åbne vægte 1.449 ±2 72 1.459 — +92◆ A ›
18 B Muse Spark 1.3foreløbig Meta 1.449 ±3 70 1.458 — +74 A ›
19 B Hy4 previewforeløbig Tencent · Åbne vægte 1.448 ±3 68 1.458 — — A ›
20 B Grok 4.7foreløbig xAI 1.448 ±7 67 1.458 — +11 A ›
21 B GPT-5.4 OpenAI 1.447 ±5 65 1.445 1.453 +39 A τ ›
22 B Gemini 3.8 Flashforeløbig Google 1.444 ±4 63 1.454 — +84◆ A ›
23 B Qwen3.8 Max (0902)foreløbig Alibaba 1.442 ±3 61 1.452 — +54 A ›
24 B GLM 5.3foreløbig Zhipu AI · Åbne vægte 1.442 ±3 60 1.451 — +60 A ›
25 B GPT-6 Lunaforeløbig OpenAI 1.437 ±5 58 1.446 — +80 A ›
26 B Grok 4.6foreløbig xAI 1.437 ±4 56 1.446 — +32 A ›
27 B DeepSeek V4 Pro 0423foreløbig DeepSeek · Åbne vægte 1.435 ±7 54 1.445 — +33 A ›
28 B GPT-5.6 Terraforeløbig OpenAI 1.433 ±5 53 1.442 — +38 A ›
29 B Step 5 Previewforeløbig StepFun 1.432 ±6 51 1.442 — +32 A ›
30 C GLM 5.3 Flashforeløbig Zhipu AI · Åbne vægte 1.430 ±2 49 1.439 — +105◆ A ›
31 C Muse Spark 1.1 Meta 1.429 ±4 47 1.419 1.454 +58 A τ ›
32 C Qwen3.8 Flash Nextforeløbig Alibaba · Åbne vægte 1.428 ±3 46 1.437 — — A ›
33 C MiMo-V2.6-Flashforeløbig Xiaomi · Åbne vægte 1.428 ±6 44 1.438 — +98◆ A ›
34 C GPT-5.6 Lunaforeløbig OpenAI 1.426 ±3 42 1.435 — +80 A ›
35 C Gemini 3.7 Flashforeløbig Google 1.425 ±3 40 1.434 — +81 A ›
36 C Qwen3.8 27Bforeløbig Alibaba · Åbne vægte 1.424 ±3 39 1.433 — +46 A ›
37 C Claude Opus 4.7foreløbig Anthropic 1.422 ±13 37 — 1.454 +35 τ ›
38 C Muse Spark 1.2foreløbig Meta 1.417 ±3 35 1.426 — +62 A ›
39 C Gemini 3.1 Pro Preview Google 1.414 ±5 33 1.406 1.433 +42 A τ ›
40 C GPT-5.2foreløbig OpenAI 1.412 ±12 32 — 1.442 +12 τ ›
41 C Qwen3.7 Maxforeløbig Alibaba 1.409 ±4 30 1.417 — +39 A ›
42 C Hy3foreløbig Tencent · Åbne vægte 1.408 ±5 28 1.416 — +68 A ›
43 D Claude Opus 4.6foreløbig Anthropic 1.407 ±12 25 — 1.435 +41 τ ›
44 D Gemini 3 Flash Previewforeløbig Google 1.407 ±12 25 — 1.435 +57 τ ›
45 D Claude Sonnet 4.5foreløbig Anthropic 1.404 ±12 23 — 1.432 -2 τ ›
46 D Claude Opus 4.5foreløbig Anthropic 1.404 ±11 21 — 1.432 +2 τ ›
47 D MiniMax M3foreløbig MiniMax · Åbne vægte 1.402 ±4 19 1.410 — +50 A ›
48 D Qwen3.7 Plusforeløbig Alibaba 1.400 ±6 18 1.408 — +52 A ›
49 D MiMo-V2.5-Proforeløbig Xiaomi · Åbne vægte 1.399 ±4 16 1.407 — +80 A ›
50 D Gemini 3.6 Flashforeløbig Google 1.398 ±5 14 1.406 — +68 A ›
51 D gemini-3-proforeløbig Google 1.396 ±10 12 — 1.422 +33 τ ›
52 D Gemini 2.5 Proforeløbig Google 1.392 ±9 10 — 1.416 +5 τ ›
53 D GLM 5foreløbig Zhipu AI · Åbne vægte 1.388 ±8 7 — 1.411 +23 τ ›
54 D Qwen3.5 397B A17Bforeløbig Alibaba · Åbne vægte 1.388 ±8 7 — 1.411 +27 τ ›
55 D Inkling Smallforeløbig Thinking Machines Lab · Åbne vægte 1.386 ±6 5 1.394 — +38 A ›
56 D Inklingforeløbig Thinking Machines Lab · Åbne vægte 1.384 ±4 4 1.392 — +26 A ›
57 D Mistral Medium 3.5foreløbig Mistral AI · Åbne vægte 1.377 ±6 2 1.384 — -19 A ›
58 D Solar Pro 4foreløbig Upstage 1.362 ±8 0 1.368 — — A ›
…
A Arena (menneskelige stemmer)τ τ²-bench (agenter) ◆ Pareto-front: ingen er både bedre og billigere
fedi-index er en Elo-ækvivalent på en fast skala: sammenlignelig mellem måneder inden for én metodikversion. Niveau S–D: efter percentil i udsnittet og ikke bedre, end konfidensintervallet tillader (grænser i metodikken). »Foreløbig« — kun én kildefamilie har målt modellen her.
Metodik
Indlejr på dit website
Tabellen som widget til dit website: den opdaterer sig selv og bevarer kildehenvisningerne.
Sprog
English
Español
Français
Português (Brasil)
Deutsch
Italiano
繁體中文
Русский
日本語
Bahasa Indonesia
한국어
العربية
ไทย
Türkçe
Polski
Deutsch (Schweiz)
Norsk
Slovenščina
Dansk
Svenska
Nederlands
Ελληνικά
Suomi
Română
Tema
Automatisk
Lyst
Mørkt
Højde, px
Kode
Kopiér kode
Kopieret
JSON
fedi-index © fedi.software, CC BY 4.0; komponenterne bevarer deres kilders licenser.
fedi-index © fedi.software, CC BY 4.0; komponenterne bevarer deres kilders licenser. · Kilder:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.