Zum Inhalt springen
fedi.software

GPT-5.2 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

A 1.428 ±5

Perzentil 82 · #53

Menschen bevorzugen / Löst Aufgaben

1.421 / 1.438

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

+12

4,81 $ pro 1 Mio. Tokens, Median von 26 Anbietern · beim Hersteller 4,81 $

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

A Allgemein 1.428 [1.423–1.434] Perzentil 82 · #53 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 153 ±0,97 1.465 ±8 33,4% 2025-12-11 —
LMArena text/overall 1.439 ±2,04 1.439 ±2 15,8% 2026-10-02 —
LMArena text/hard_prompts 1.445 ±2,50 1.435 ±2 15,7% 2026-10-02 —
LMArena text/instruction_following 1.417 ±3,16 1.429 ±3 7,7% 2026-10-02 —
LMArena text/expert 1.445 ±4,93 1.431 ±4 7,5% 2026-10-02 high
LMArena text/longer_query 1.428 ±3,05 1.427 ±3 3,9% 2026-10-02 —
Epoch AI simpleqa_verified Alterung ×0,61 0,37 ±0,02 1.414 ±5 3,9% 2026-08-27 xhigh
LMArena text/multi_turn 1.458 ±3,96 1.452 ±4 3,8% 2026-10-02 —
Epoch AI gpqa_diamond Alterung ×0,26 0,91 ±0,02 1.465 ±8 1,4% 2025-12-13 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1.409 [1.405–1.414] Perzentil 73 · #76 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1.447 ±3,42 1.423 ±3 39,1% 2026-10-02 —
LMArena webdev/overall 1.415 ±11 1.426 ±3 38,8% 2026-10-01 —
Epoch AI swe_bench_verified Alterung ×0,37 0,74 ±0,02 1.452 ±10 13,6% 2026-02-12 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Agenten 1.412 [1.400–1.424] Perzentil 32 · #40 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
τ²-bench (Sierra) tau2/banking_knowledge Alterung ×0,76 0,32 ±0,05 1.467 ±8 79,2% 2026-05-05 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Mathematik 1.426 [1.419–1.433] Perzentil 84 · #43 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1.439 ±5,49 1.431 ±5 52,7% 2026-10-02 high
Epoch AI frontiermath_t1_3 Alterung ×0,86 0,67 ±0,03 1.467 ±6 29,3% 2026-06-11 xhigh
Epoch AI frontiermath_t4 Alterung ×0,86 0,32 ±0,07 1.443 ±12 10,6% 2026-06-11 xhigh

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Vision 1.432 [1.428–1.436] Perzentil 68 · #37 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1.268 ±3,32 1.446 ±3 63,1% 2026-10-02 —
LMArena vision/ocr 1.275 ±3,44 1.447 ±3 15,6% 2026-10-02 —
LMArena vision/diagram 1.285 ±5,11 1.450 ±4 15,0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1.415 [1.410–1.421] Perzentil 73 · #74 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1.402 ±4,28 1.430 ±4 61,5% 2026-10-02 —
LMArena text/longer_query 1.428 ±3,05 1.427 ±3 32,2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1.407 [1.398–1.416] Perzentil 62 · #86 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1.460 ±6,31 1.421 ±5 93,5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Deutsch 1.422 [1.402–1.442] Perzentil 72 · #41 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1.448 ±13 1.443 ±11 91,2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1.422 [1.417–1.428] Perzentil 75 · #70 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1.446 ±2,81 1.436 ±3 93,9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Español 1.412 [1.397–1.427] Perzentil 57 · #65 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1.433 ±9,08 1.429 ±8 92,4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Français 1.421 [1.406–1.435] Perzentil 65 · #48 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1.456 ±8,68 1.438 ±8 92,6% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 日本語 1.421 [1.400–1.441] Perzentil 72 · #36 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1.420 ±15 1.442 ±11 91,1% 2026-10-02 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 한국어 1.409 [1.391–1.427] Perzentil 62 · #53 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1.390 ±13 1.428 ±10 91,7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Polski 1.417 [1.400–1.434] Perzentil 60 · #53 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1.434 ±11 1.436 ±10 91,9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1.428 [1.420–1.435] Perzentil 78 · #51 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1.440 ±4,72 1.443 ±4 93,7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-5.2 1.428 A

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-5.2

Daten CC BY 4.0: Link zu fedi.software beibehalten.