Live-data for 2026-10 (beregnes daglig)
· Metodikk v1
· Metodikk
· Historikk
· JSON
#
Nivå
Modell
fedi-index
Persentil
Verdi
Kilder
Oppdeling av poengsummen
12 A GLM 5.3 Flashforeløpig Zhipu AI · Åpne vekter 1 454 ±19 92 +105◆ A ›
14 A MiMo-V2.5-Proforeløpig Xiaomi · Åpne vekter 1 451 ±12 90 +80 A ›
17 A Kimi K3foreløpig Moonshot AI · Åpne vekter 1 448 ±17 88 +44 A ›
22 A GLM 5.3foreløpig Zhipu AI · Åpne vekter 1 447 ±22 84 +60 A ›
25 A GLM 5.2foreløpig Zhipu AI · Åpne vekter 1 440 ±14 82 +45 A ›
27 A GLM 5.1foreløpig Zhipu AI · Åpne vekter 1 438 ±13 81 +36 A ›
31 B DeepSeek V4 Pro 0423foreløpig DeepSeek · Åpne vekter 1 435 ±12 78 +33 A ›
35 B Kimi K2.6foreløpig Moonshot AI · Åpne vekter 1 434 ±14 75 +44 A ›
40 B Nemotron 3 Ultraforeløpig NVIDIA · Åpne vekter 1 428 ±23 71 +33 A ›
41 B Qwen3.5 397B A17Bforeløpig Alibaba · Åpne vekter 1 427 ±11 70 +27 A ›
42 B Qwen3.8 27Bforeløpig Alibaba · Åpne vekter 1 426 ±21 69 +46 A ›
47 B GLM 4.6foreløpig Zhipu AI · Åpne vekter 1 421 ±19 66 +26 A ›
51 B Kimi K2.5foreløpig Moonshot AI · Åpne vekter 1 420 ±11 63 +36 A ›
54 B Inklingforeløpig Thinking Machines Lab · Åpne vekter 1 419 ±16 60 +27 A ›
55 B GLM 5foreløpig Zhipu AI · Åpne vekter 1 418 ±17 60 +23 A ›
60 B Hy3foreløpig Tencent · Åpne vekter 1 414 ±25 56 +68 A ›
62 B MiMo-V2.5foreløpig Xiaomi · Åpne vekter 1 413 ±13 54 +75 A ›
63 B MiniMax M3foreløpig MiniMax · Åpne vekter 1 413 ±13 54 +50 A ›
67 B Mistral Medium 3.5foreløpig Mistral AI · Åpne vekter 1 408 ±24 51 −19 A ›
69 C Qwen3.5-122B-A10Bforeløpig Alibaba · Åpne vekter 1 407 ±17 49 +14 A ›
70 C DeepSeek V4 Flash 0423foreløpig DeepSeek · Åpne vekter 1 407 ±13 48 +71 A ›
77 C Inkling Smallforeløpig Thinking Machines Lab · Åpne vekter 1 396 ±18 43 +38 A ›
80 C MiniMax M2.7foreløpig MiniMax · Åpne vekter 1 393 ±11 41 +32 A ›
81 C Step 3.5 Flashforeløpig StepFun · Åpne vekter 1 392 ±12 40 +50 A ›
82 C GLM 4.7foreløpig Zhipu AI · Åpne vekter 1 391 ±27 40 +20 A ›
83 C MiMo-V2-Flashforeløpig Xiaomi · Åpne vekter 1 391 ±25 39 +55◆ A ›
84 C GLM 4.5foreløpig Zhipu AI · Åpne vekter 1 385 ±26 38 +18 A ›
87 C Qwen3.5-35B-A3Bforeløpig Alibaba · Åpne vekter 1 382 ±18 36 +11 A ›
88 C Qwen3 30B A3B Instruct 2507foreløpig Alibaba · Åpne vekter 1 382 ±26 35 +25 A ›
90 C Qwen3.5-27Bforeløpig Alibaba · Åpne vekter 1 379 ±18 34 +14 A ›
91 C Qwen3 Next 80B A3B Instructforeløpig Alibaba · Åpne vekter 1 379 ±25 33 +32 A ›
93 C MiniMax M2.1foreløpig MiniMax · Åpne vekter 1 372 ±23 31 +18 A ›
97 C GLM 4.5 Airforeløpig Zhipu AI · Åpne vekter 1 368 ±23 28 −2 A ›
98 C Nemotron 3 Nano 30B A3Bforeløpig NVIDIA · Åpne vekter 1 364 ±25 28 +6 A ›
99 C Qwen3 Coder 480B A35Bforeløpig Alibaba · Åpne vekter 1 362 ±25 27 −22 A ›
106 D gpt-oss-120bforeløpig OpenAI · Åpne vekter 1 343 ±23 22 −2 A ›
107 D MiniMax M1foreløpig MiniMax · Åpne vekter 1 343 ±23 21 −36 A ›
109 D Trinity Large Thinkingforeløpig Arcee AI · Åpne vekter 1 342 ±17 19 −30 A ›
111 D MiniMax M2.5foreløpig MiniMax · Åpne vekter 1 341 ±15 18 +9 A ›
115 D Qwen3 30B A3Bforeløpig Alibaba · Åpne vekter 1 326 ±25 15 −29 A ›
116 D gemma-3n-e4b-itforeløpig Google · Åpne vekter 1 309 ±27 14 — A ›
123 D mixtral-8x22b-instruct-v0.1foreløpig Mistral AI · Åpne vekter 1 174 ±22 9 −236 A ›
…
A Arena (menneskelige stemmer) ◆ Pareto-front: ingen er både bedre og billigere
fedi-index er en Elo-ekvivalent på en fast skala: sammenlignbar mellom måneder innenfor én metodikkversjon. Nivå S–D: etter persentil i utsnittet, og ikke bedre enn konfidensintervallet tillater (grenser i metodikken). Dette utsnittet har én kildefamilie, så alle poengsummene er foreløpige.
Metodikk
fedi-index © fedi.software, CC BY 4.0; komponentene beholder lisensene til kildene sine. · Kilder:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.