Zum Inhalt springen
fedi.software

GPT-5.3 Chat (latest) im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1.372 ±2

Perzentil 54 · #136 · vorläufig

Menschen bevorzugen / Löst Aufgaben

1.382 / —

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-45

4,81 $ pro 1 Mio. Tokens, Median von 6 Anbietern · beim Hersteller 4,81 $

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1.372 [1.369–1.374] Perzentil 54 · #136 · Komponenten: 6 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/overall 1.389 ±2,15 1.389 ±2 25,8% 2026-10-02 —
LMArena text/hard_prompts 1.399 ±2,64 1.394 ±2 25,6% 2026-10-02 —
LMArena text/instruction_following 1.379 ±3,30 1.393 ±3 12,6% 2026-10-02 —
LMArena text/expert 1.397 ±5,70 1.392 ±5 12,0% 2026-10-02 —
LMArena text/longer_query 1.396 ±3,16 1.396 ±3 6,3% 2026-10-02 —
LMArena text/multi_turn 1.412 ±4,07 1.410 ±4 6,2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1.370 [1.364–1.375] Perzentil 53 · #132 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1.407 ±3,58 1.388 ±3 90,2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Mathematik 1.359 [1.348–1.370] Perzentil 48 · #133 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1.389 ±6,64 1.382 ±6 87,1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1.376 [1.371–1.382] Perzentil 56 · #118 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1.356 ±4,42 1.384 ±4 61,5% 2026-10-02 —
LMArena text/longer_query 1.396 ±3,16 1.396 ±3 32,3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1.387 [1.378–1.397] Perzentil 51 · #109 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1.433 ±6,55 1.400 ±5 93,5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Deutsch 1.372 [1.352–1.392] Perzentil 41 · #85 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1.384 ±13 1.388 ±11 91,1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1.367 [1.361–1.372] Perzentil 53 · #130 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1.390 ±2,95 1.377 ±3 93,9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

D Sprache: Español 1.358 [1.344–1.374] Perzentil 24 · #113 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1.370 ±8,96 1.371 ±8 92,5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Français 1.370 [1.354–1.387] Perzentil 29 · #96 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1.398 ±9,95 1.384 ±9 92,1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 한국어 1.379 [1.360–1.398] Perzentil 37 · #86 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1.348 ±14 1.395 ±10 91,6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Polski 1.388 [1.371–1.405] Perzentil 36 · #84 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1.396 ±11 1.404 ±9 92,0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1.394 [1.386–1.402] Perzentil 58 · #99 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1.400 ±4,92 1.407 ±4 93,6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-5.3 Chat (latest) 1.372 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-5.3 Chat (latest)

Daten CC BY 4.0: Link zu fedi.software beibehalten.