Zum Inhalt springen
fedi.software

GPT-6 Astra im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

A 1’463 ±8

Perzentil 95 · #16

Menschen bevorzugen / Löst Aufgaben

1’437 / 1’514

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

+12

$ 20 pro 1 Mio. Tokens, Median von 24 Anbietern · beim Hersteller $ 20

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

A Allgemein 1’463 [1’455–1’471] Perzentil 95 · #16 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 166 ±2.07 1’568 ±16 23.7% 2026-09-03 —
LMArena text/overall 1’442 ±3.49 1’442 ±4 18.7% 2026-10-02 max
LMArena text/hard_prompts 1’463 ±4.23 1’452 ±4 18.5% 2026-10-02 max
LMArena text/instruction_following 1’455 ±5.69 1’465 ±5 8.7% 2026-10-02 max
LMArena text/expert 1’492 ±10 1’470 ±8 7.6% 2026-10-02 max
Epoch AI simpleqa_verified Alterung ×0.61 0.76 ±0.01 1’535 ±4 4.9% 2026-08-30 max
LMArena text/longer_query 1’458 ±5.12 1’455 ±5 4.5% 2026-10-02 max
LMArena text/multi_turn 1’452 ±8.60 1’446 ±8 3.9% 2026-10-02 max
Epoch AI gpqa_diamond Ausreisser Alterung ×0.26 0.96 ±0.01 1’485 ±6 1.0% 2026-08-30 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Code 1’471 [1’467–1’474] Perzentil 98 · #6 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena webdev/overall 1’788 ±5.25 1’532 ±2 60.7% 2026-10-01 max
LMArena text/coding Ausreisser 1’489 ±6.62 1’460 ±6 26.5% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Agenten 1’481 [1’472–1’491] Perzentil 96 · #3 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena agent/overall 0.12 ±0.01 1’514 ±5 89.5% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

S Mathematik 1’478 [1’468–1’488] Perzentil 98 · #6 · Komponenten: 3
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’469 ±14 1’459 ±13 37.4% 2026-10-02 max
Epoch AI frontiermath_t1_3 Alterung ×0.86 0.94 ±0.01 1’524 ±3 36.4% 2026-08-30 max
Epoch AI frontiermath_t4 Alterung ×0.86 0.98 ±0.02 1’548 ±4 17.9% 2026-08-30 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Vision 1’441 [1’434–1’448] Perzentil 75 · #29 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1’280 ±5.74 1’456 ±5 65.1% 2026-10-02 max
LMArena vision/ocr 1’292 ±6.70 1’464 ±6 15.4% 2026-10-02 max
LMArena vision/diagram 1’299 ±11 1’463 ±10 12.7% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

A Schreiben 1’434 [1’424–1’443] Perzentil 80 · #54 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’419 ±7.11 1’448 ±7 59.7% 2026-10-02 max
LMArena text/longer_query 1’458 ±5.12 1’455 ±5 33.4% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1’424 [1’408–1’440] Perzentil 75 · #56 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’487 ±11 1’443 ±9 92.2% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1’424 [1’414–1’434] Perzentil 76 · #66 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’448 ±5.10 1’439 ±5 93.4% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1’425 [1’410–1’439] Perzentil 77 · #55 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’440 ±8.83 1’443 ±8 92.6% 2026-10-02 max

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
GPT-6 Astra 1’463 A

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: GPT-6 Astra

Daten CC BY 4.0: Link zu fedi.software beibehalten.