Allgemein
Code
Agenten
Mathematik
Vision
Suche
Schreiben
Sprache: Deutsch
Live-Daten für 2026-10 (täglich neu berechnet)
· Methodik v1
· Methodik
· Verlauf
· JSON
#
Tier
Modell
fedi-index
Perzentil
Menschen bevorzugen
Löst Aufgaben
Preis-Leistung
Quellen
Aufschlüsselung des Werts
13 B Kimi K3 Moonshot AI · Offene Gewichte 1.456 ±5 79 1.459 1.449 +44 A τ ›
14 B GLM 5.2 Zhipu AI · Offene Gewichte 1.454 ±5 77 1.456 1.449 +45 A τ ›
17 B DeepSeek V4.1 Flashvorläufig DeepSeek · Offene Gewichte 1.449 ±2 72 1.459 — +92◆ A ›
19 B Hy4 previewvorläufig Tencent · Offene Gewichte 1.448 ±3 68 1.458 — — A ›
24 B GLM 5.3vorläufig Zhipu AI · Offene Gewichte 1.442 ±3 60 1.451 — +60 A ›
27 B DeepSeek V4 Pro 0423vorläufig DeepSeek · Offene Gewichte 1.435 ±7 54 1.445 — +33 A ›
30 C GLM 5.3 Flashvorläufig Zhipu AI · Offene Gewichte 1.430 ±2 49 1.439 — +105◆ A ›
32 C Qwen3.8 Flash Nextvorläufig Alibaba · Offene Gewichte 1.428 ±3 46 1.437 — — A ›
33 C MiMo-V2.6-Flashvorläufig Xiaomi · Offene Gewichte 1.428 ±6 44 1.438 — +98◆ A ›
36 C Qwen3.8 27Bvorläufig Alibaba · Offene Gewichte 1.424 ±3 39 1.433 — +46 A ›
42 C Hy3vorläufig Tencent · Offene Gewichte 1.408 ±5 28 1.416 — +68 A ›
47 D MiniMax M3vorläufig MiniMax · Offene Gewichte 1.402 ±4 19 1.410 — +50 A ›
49 D MiMo-V2.5-Provorläufig Xiaomi · Offene Gewichte 1.399 ±4 16 1.407 — +80 A ›
53 D GLM 5vorläufig Zhipu AI · Offene Gewichte 1.388 ±8 7 — 1.411 +23 τ ›
54 D Qwen3.5 397B A17Bvorläufig Alibaba · Offene Gewichte 1.388 ±8 7 — 1.411 +27 τ ›
55 D Inkling Smallvorläufig Thinking Machines Lab · Offene Gewichte 1.386 ±6 5 1.394 — +38 A ›
56 D Inklingvorläufig Thinking Machines Lab · Offene Gewichte 1.384 ±4 4 1.392 — +26 A ›
57 D Mistral Medium 3.5vorläufig Mistral AI · Offene Gewichte 1.377 ±6 2 1.384 — -19 A ›
…
A Arena (menschliche Stimmen)τ τ²-bench (Agenten) ◆ Pareto-Front: nichts ist zugleich besser und günstiger
Der fedi-index ist ein Elo-Äquivalent auf fester Skala: innerhalb einer Methodikversion zwischen Monaten vergleichbar. Tiers S–D: nach Perzentil im Bereich und nicht besser, als das Konfidenzintervall zulässt (Grenzwerte in der Methodik). „Vorläufig“ – nur eine Quellenfamilie hat das Modell hier gemessen.
Methodik
Auf Ihrer Website einbetten
Die Tabelle als Widget für deine Website: aktualisiert sich selbst und behält die Quellenangaben.
Sprache
English
Español
Français
Português (Brasil)
Deutsch
Italiano
繁體中文
Русский
日本語
Bahasa Indonesia
한국어
العربية
ไทย
Türkçe
Polski
Deutsch (Schweiz)
Norsk
Slovenščina
Dansk
Svenska
Nederlands
Ελληνικά
Suomi
Română
Design
Automatisch
Hell
Dunkel
Höhe, px
Code
Code kopieren
Kopiert
JSON
fedi-index © fedi.software, CC BY 4.0; Komponenten behalten die Lizenzen ihrer Quellen.
fedi-index © fedi.software, CC BY 4.0; Komponenten behalten die Lizenzen ihrer Quellen. · Quellen:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.