Zum Inhalt springen
fedi.software

GPT-6 Luna im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1’419 ±7

Perzentil 79 · #62

Menschen bevorzugen / Löst Aufgaben

1’395 / 1’455

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

+80

$ 0.20 pro 1 Mio. Tokens, Median von 21 Anbietern · beim Hersteller $ 0.20

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1’419 [1’412–1’426] Perzentil 79 · #62 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 156 ±1.30 1’487 ±10 31.9% 2026-09-22 —
LMArena text/overall 1’391 ±3.33 1’392 ±3 17.0% 2026-10-02 max
LMArena text/hard_prompts 1’413 ±4.04 1’406 ±4 16.8% 2026-10-02 max
LMArena text/instruction_following 1’416 ±5.21 1’428 ±5 8.0% 2026-10-02 max
LMArena text/expert 1’450 ±8.97 1’435 ±7 7.2% 2026-10-02 max
LMArena text/longer_query 1’411 ±4.85 1’411 ±4 4.1% 2026-10-02 max
LMArena text/multi_turn 1’400 ±8.16 1’399 ±7 3.6% 2026-10-02 max
Epoch AI simpleqa_verified Ausreisser Alterung ×0.61 0.41 ±0.02 1’427 ±5 2.1% 2026-09-22 max
Epoch AI gpqa_diamond Alterung ×0.26 0.90 ±0.02 1’460 ±9 1.6% 2026-09-22 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Code 1’424 [1’421–1’427] Perzentil 80 · #55 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena webdev/overall 1’579 ±4.34 1’472 ±1 60.6% 2026-10-01 max
LMArena text/coding Ausreisser 1’444 ±6.31 1’420 ±6 26.7% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Agenten 1’437 [1’432–1’442] Perzentil 58 · #25 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena agent/overall 0.01 ±0.01 1’462 ±3 90.3% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Mathematik 1’432 [1’421–1’443] Perzentil 86 · #37 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’424 ±12 1’416 ±12 43.4% 2026-10-02 max
Epoch AI frontiermath_t1_3 Alterung ×0.86 0.79 ±0.02 1’492 ±5 35.9% 2026-09-22 max
Epoch AI frontiermath_t4 Alterung ×0.86 0.56 ±0.08 1’482 ±12 11.9% 2026-09-22 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1’386 [1’377–1’394] Perzentil 59 · #111 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’365 ±6.93 1’392 ±7 59.7% 2026-10-02 max
LMArena text/longer_query 1’411 ±4.85 1’411 ±4 33.4% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: 繁體中文 1’382 [1’367–1’398] Perzentil 49 · #114 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’429 ±11 1’397 ±9 92.3% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1’365 [1’356–1’375] Perzentil 52 · #131 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’389 ±5.01 1’377 ±5 93.4% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Español 1’392 [1’366–1’417] Perzentil 43 · #86 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1’417 ±16 1’414 ±14 89.3% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1’382 [1’368–1’395] Perzentil 51 · #116 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’388 ±8.26 1’396 ±7 92.8% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-6 Luna 1’419 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-6 Luna

Daten CC BY 4.0: Link zu fedi.software beibehalten.