Allmänt
Kodning
Agenter
Matematik
Bildförståelse
Sökning
Skrivande
Livedata för 2026-10 (beräknas dagligen)
· Metodik v1
· Metodik
· Historik
· JSON
#
Tier
Modell
fedi-index
Percentil
Människor föredrar
Löser uppgifter
Prisvärdhet
Källor
Uppdelning av poängen
13 B Kimi K3 Moonshot AI · Öppna vikter 1 456 ±5 79 1 459 1 449 +44 A τ ›
14 B GLM 5.2 Zhipu AI · Öppna vikter 1 454 ±5 77 1 456 1 449 +45 A τ ›
17 B DeepSeek V4.1 Flashpreliminär DeepSeek · Öppna vikter 1 449 ±2 72 1 459 — +92◆ A ›
19 B Hy4 previewpreliminär Tencent · Öppna vikter 1 448 ±3 68 1 458 — — A ›
24 B GLM 5.3preliminär Zhipu AI · Öppna vikter 1 442 ±3 60 1 451 — +60 A ›
27 B DeepSeek V4 Pro 0423preliminär DeepSeek · Öppna vikter 1 435 ±7 54 1 445 — +33 A ›
30 C GLM 5.3 Flashpreliminär Zhipu AI · Öppna vikter 1 430 ±2 49 1 439 — +105◆ A ›
32 C Qwen3.8 Flash Nextpreliminär Alibaba · Öppna vikter 1 428 ±3 46 1 437 — — A ›
33 C MiMo-V2.6-Flashpreliminär Xiaomi · Öppna vikter 1 428 ±6 44 1 438 — +98◆ A ›
36 C Qwen3.8 27Bpreliminär Alibaba · Öppna vikter 1 424 ±3 39 1 433 — +46 A ›
42 C Hy3preliminär Tencent · Öppna vikter 1 408 ±5 28 1 416 — +68 A ›
47 D MiniMax M3preliminär MiniMax · Öppna vikter 1 402 ±4 19 1 410 — +50 A ›
49 D MiMo-V2.5-Propreliminär Xiaomi · Öppna vikter 1 399 ±4 16 1 407 — +80 A ›
53 D GLM 5preliminär Zhipu AI · Öppna vikter 1 388 ±8 7 — 1 411 +23 τ ›
54 D Qwen3.5 397B A17Bpreliminär Alibaba · Öppna vikter 1 388 ±8 7 — 1 411 +27 τ ›
55 D Inkling Smallpreliminär Thinking Machines Lab · Öppna vikter 1 386 ±6 5 1 394 — +38 A ›
56 D Inklingpreliminär Thinking Machines Lab · Öppna vikter 1 384 ±4 4 1 392 — +27 A ›
57 D Mistral Medium 3.5preliminär Mistral AI · Öppna vikter 1 377 ±6 2 1 384 — −19 A ›
…
A Arena (mänskliga röster)τ τ²-bench (agenter) ◆ Pareto-front: ingen är både bättre och billigare
fedi-index är en Elo-ekvivalent på en fast skala: jämförbar mellan månader inom en metodikversion. Nivå S–D: efter percentil i urvalet, och inte bättre än konfidensintervallet tillåter (gränser i metodiken). ”Preliminär” — endast en källfamilj har mätt modellen här.
Metodik
Bädda in på din webbplats
Tabellen som widget för din webbplats: den uppdateras automatiskt och behåller källhänvisningarna.
Språk
English
Español
Français
Português (Brasil)
Deutsch
Italiano
繁體中文
Русский
日本語
Bahasa Indonesia
한국어
العربية
ไทย
Türkçe
Polski
Deutsch (Schweiz)
Norsk
Slovenščina
Dansk
Svenska
Nederlands
Ελληνικά
Suomi
Română
Tema
Automatiskt
Ljust
Mörkt
Höjd, px
Kod
Kopiera kod
Kopierat
JSON
fedi-index © fedi.software, CC BY 4.0; komponenterna behåller sina källors licenser.
fedi-index © fedi.software, CC BY 4.0; komponenterna behåller sina källors licenser. · Källor:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.