Zum Inhalt springen
fedi.software

GPT-5.3 Chat (latest) im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1’372 ±2

Perzentil 54 · #136 · vorläufig

Menschen bevorzugen / Löst Aufgaben

1’382 / —

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-45

$ 4.81 pro 1 Mio. Tokens, Median von 6 Anbietern · beim Hersteller $ 4.81

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1’372 [1’369–1’374] Perzentil 54 · #136 · Komponenten: 6 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/overall 1’389 ±2.15 1’389 ±2 25.8% 2026-10-02 —
LMArena text/hard_prompts 1’399 ±2.64 1’394 ±2 25.6% 2026-10-02 —
LMArena text/instruction_following 1’379 ±3.30 1’393 ±3 12.6% 2026-10-02 —
LMArena text/expert 1’397 ±5.70 1’392 ±5 12.0% 2026-10-02 —
LMArena text/longer_query 1’396 ±3.16 1’396 ±3 6.3% 2026-10-02 —
LMArena text/multi_turn 1’412 ±4.07 1’410 ±4 6.2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1’370 [1’364–1’375] Perzentil 53 · #132 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1’407 ±3.58 1’388 ±3 90.2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Mathematik 1’359 [1’348–1’370] Perzentil 48 · #133 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’389 ±6.64 1’382 ±6 87.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1’376 [1’371–1’382] Perzentil 56 · #118 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’356 ±4.42 1’384 ±4 61.5% 2026-10-02 —
LMArena text/longer_query 1’396 ±3.16 1’396 ±3 32.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1’387 [1’378–1’397] Perzentil 51 · #109 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’433 ±6.55 1’400 ±5 93.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Deutsch 1’372 [1’352–1’392] Perzentil 41 · #85 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1’384 ±13 1’388 ±11 91.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1’367 [1’361–1’372] Perzentil 53 · #130 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’390 ±2.95 1’377 ±3 93.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: Español 1’358 [1’344–1’374] Perzentil 24 · #113 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’370 ±8.96 1’371 ±8 92.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Français 1’370 [1’354–1’387] Perzentil 29 · #96 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1’398 ±9.95 1’384 ±9 92.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 한국어 1’379 [1’360–1’398] Perzentil 37 · #86 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1’348 ±14 1’395 ±10 91.6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Polski 1’388 [1’371–1’405] Perzentil 36 · #84 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’396 ±11 1’404 ±9 92.0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1’394 [1’386–1’402] Perzentil 58 · #99 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’400 ±4.92 1’407 ±4 93.6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-5.3 Chat (latest) 1’372 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-5.3 Chat (latest)

Daten CC BY 4.0: Link zu fedi.software beibehalten.