Zum Inhalt springen
fedi.software

GLM 5.3 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

A 1’457 ±6

Perzentil 92 · #24

Menschen bevorzugen / Löst Aufgaben

1’460 / 1’453

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

+60

$ 2.15 pro 1 Mio. Tokens, Median von 57 Anbietern · beim Hersteller $ 2.15

Auf deiner Hardware

Passt in keines der Referenz-Setups.

Aufschlüsselung des Werts

A Allgemein 1’457 [1’451–1’463] Perzentil 92 · #24 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 156 ±1.10 1’482 ±9 33.3% 2026-08-14 —
LMArena text/overall 1’471 ±2.82 1’471 ±3 16.4% 2026-10-02 max
LMArena text/hard_prompts 1’488 ±3.31 1’475 ±3 16.3% 2026-10-02 max
LMArena text/instruction_following 1’477 ±4.21 1’486 ±4 7.9% 2026-10-02 max
LMArena text/expert 1’514 ±7.23 1’488 ±6 7.3% 2026-10-02 max
LMArena text/longer_query 1’483 ±3.80 1’478 ±4 4.0% 2026-10-02 max
LMArena text/multi_turn 1’472 ±6.06 1’464 ±6 3.7% 2026-10-02 max
Epoch AI simpleqa_verified Ausreisser Alterung ×0.61 0.41 ±0.02 1’426 ±5 2.0% 2026-08-28 max
Epoch AI gpqa_diamond Alterung ×0.26 0.91 ±0.02 1’463 ±7 1.6% 2026-08-24 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Code 1’450 [1’446–1’453] Perzentil 94 · #19 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena webdev/overall 1’623 ±4.17 1’485 ±1 46.7% 2026-10-01 max
LMArena text/coding 1’497 ±4.75 1’468 ±4 43.5% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Agenten 1’442 [1’439–1’445] Perzentil 60 · #24 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena agent/overall 0.02 ±0.00 1’467 ±2 90.5% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Mathematik 1’448 [1’438–1’459] Perzentil 91 · #25 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’491 ±11 1’480 ±10 45.9% 2026-10-02 max
Epoch AI frontiermath_t1_3 Alterung ×0.86 0.69 ±0.03 1’470 ±6 33.4% 2026-08-25 max
Epoch AI frontiermath_t4 Alterung ×0.86 0.29 ±0.07 1’439 ±12 12.2% 2026-08-25 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Schreiben 1’466 [1’459–1’472] Perzentil 92 · #21 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’457 ±5.21 1’487 ±5 61.0% 2026-10-02 max
LMArena text/longer_query 1’483 ±3.80 1’478 ±4 32.5% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 繁體中文 1’454 [1’441–1’466] Perzentil 91 · #21 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’524 ±8.53 1’472 ±7 93.0% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: English 1’458 [1’450–1’465] Perzentil 94 · #17 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’482 ±3.85 1’475 ±4 93.7% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Español 1’419 [1’399–1’440] Perzentil 65 · #53 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’446 ±12 1’441 ±12 91.0% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Français 1’447 [1’425–1’469] Perzentil 84 · #22 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’494 ±13 1’473 ±12 90.5% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: 日本語 1’435 [1’412–1’458] Perzentil 81 · #25 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’445 ±17 1’461 ±13 90.1% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Sprache: Русский 1’442 [1’431–1’453] Perzentil 85 · #36 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’458 ±6.58 1’459 ±6 93.3% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GLM 5.3 1’457 A

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GLM 5.3

Daten CC BY 4.0: Link zu fedi.software beibehalten.