Allgemein
Code
Agenten
Mathematik
Vision
Suche
Schreiben
Live-Daten für 2026-10 (täglich neu berechnet)
· Methodik v1
· Methodik
· Verlauf
· JSON
#
Tier
Modell
fedi-index
Perzentil
Preis-Leistung
Quellen
Aufschlüsselung des Werts
14 A GLM 5.3 Flashvorläufig Zhipu AI · Offene Gewichte 1’460 ±6 88 +105◆ A ›
25 B Kimi K2.6vorläufig Moonshot AI · Offene Gewichte 1’444 ±4 79 +44 A ›
31 B Gemma 4 31Bvorläufig Google · Offene Gewichte 1’438 ±4 73 +59 A ›
35 B Qwen3.8 27Bvorläufig Alibaba · Offene Gewichte 1’433 ±6 70 +46 A ›
36 B Kimi K2.5vorläufig Moonshot AI · Offene Gewichte 1’432 ±4 69 +36 A ›
41 B Qwen3.5 397B A17Bvorläufig Alibaba · Offene Gewichte 1’428 ±3 64 +27 A ›
43 B MiMo-V2.6-Provorläufig Xiaomi · Offene Gewichte 1’425 ±9 62 +93◆ A ›
46 B Gemma 4 26B A4B vorläufig Google · Offene Gewichte 1’423 ±4 60 +54 A ›
47 B MiMo-V2.6-Flashvorläufig Xiaomi · Offene Gewichte 1’423 ±9 59 +98◆ A ›
49 B MiniMax M3vorläufig MiniMax · Offene Gewichte 1’420 ±4 57 +50 A ›
52 B MiMo-V2.5vorläufig Xiaomi · Offene Gewichte 1’415 ±4 54 +75 A ›
54 B Qwen3 VL 235B A22B Instructvorläufig Alibaba · Offene Gewichte 1’412 ±4 53 +27 A ›
55 B Qwen3.5-122B-A10Bvorläufig Alibaba · Offene Gewichte 1’410 ±4 52 +14 A ›
57 B Qwen3.5-27Bvorläufig Alibaba · Offene Gewichte 1’406 ±3 50 +14 A ›
60 C Inkling Smallvorläufig Thinking Machines Lab · Offene Gewichte 1’402 ±5 47 +38 A ›
64 C Mistral Medium 3.5vorläufig Mistral AI · Offene Gewichte 1’394 ±6 44 -19 A ›
69 C Qwen3 VL 235B A22B Thinkingvorläufig Alibaba · Offene Gewichte 1’376 ±8 39 -17 A ›
84 C GLM 4.6Vvorläufig Zhipu AI · Offene Gewichte 1’341 ±9 26 -12 A ›
88 D GLM 4.5Vvorläufig Zhipu AI · Offene Gewichte 1’329 ±8 22 -60 A ›
90 D Mistral Small 3.2vorläufig Mistral AI · Offene Gewichte 1’317 ±6 20 -14 A ›
…
A Arena (menschliche Stimmen) ◆ Pareto-Front: nichts ist zugleich besser und günstiger
Der fedi-index ist ein Elo-Äquivalent auf fester Skala: innerhalb einer Methodikversion zwischen Monaten vergleichbar. Tiers S–D: nach Perzentil im Bereich und nicht besser, als das Konfidenzintervall zulässt (Grenzwerte in der Methodik). Dieser Bereich hat nur eine Quellenfamilie, daher sind alle Werte vorläufig.
Methodik
Auf deiner Website einbetten
Die Tabelle als Widget für deine Website: aktualisiert sich selbst und behält die Quellenangaben.
Sprache
English
Español
Français
Português (Brasil)
Deutsch
Italiano
繁體中文
Русский
日本語
Bahasa Indonesia
한국어
العربية
ไทย
Türkçe
Polski
Deutsch (Schweiz)
Norsk
Slovenščina
Dansk
Svenska
Nederlands
Ελληνικά
Suomi
Română
Design
Automatisch
Hell
Dunkel
Höhe, px
Code
Code kopieren
Kopiert
JSON
fedi-index © fedi.software, CC BY 4.0; Komponenten behalten die Lizenzen ihrer Quellen.
fedi-index © fedi.software, CC BY 4.0; Komponenten behalten die Lizenzen ihrer Quellen. · Quellen:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.