Zum Inhalt springen
fedi.software

o3 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1.392 ±5

Perzentil 64 · #107

Menschen bevorzugen / Löst Aufgaben

1.386 / 1.400

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

-17

3,50 $ pro 1 Mio. Tokens, Median von 18 Anbietern · beim Hersteller 3,50 $

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1.392 [1.386–1.396] Perzentil 64 · #107 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 147 ±0,92 1.413 ±7 33,9% 2025-04-16 —
LMArena text/overall 1.410 ±1,84 1.410 ±2 15,7% 2026-10-02 —
LMArena text/hard_prompts 1.402 ±2,43 1.397 ±2 15,6% 2026-10-02 —
LMArena text/instruction_following 1.368 ±2,83 1.382 ±3 7,7% 2026-10-02 —
LMArena text/expert 1.403 ±5,77 1.397 ±5 7,3% 2026-10-02 —
LMArena text/longer_query 1.371 ±3,13 1.374 ±3 3,8% 2026-10-02 —
Epoch AI simpleqa_verified Alterung ×0,61 0,49 ±0,02 1.452 ±5 3,8% 2026-08-27 high
LMArena text/multi_turn 1.405 ±3,45 1.403 ±3 3,8% 2026-10-02 —
Epoch AI gpqa_diamond Alterung ×0,26 0,82 ±0,02 1.420 ±10 1,3% 2025-04-16 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1.373 [1.368–1.378] Perzentil 53 · #130 · Komponenten: 2
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1.408 ±3,16 1.388 ±3 78,7% 2026-10-02 —
Epoch AI swe_bench_verified Alterung ×0,37 0,62 ±0,02 1.393 ±11 12,8% 2026-02-12 medium

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Mathematik 1.392 [1.386–1.400] Perzentil 65 · #90 · Komponenten: 2
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1.426 ±5,10 1.418 ±5 51,0% 2026-10-02 —
Epoch AI frontiermath_t1_3 Alterung ×0,86 0,33 ±0,03 1.393 ±6 41,9% 2026-08-27 high

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Vision 1.384 [1.379–1.388] Perzentil 42 · #66 · Komponenten: 3 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena vision/overall 1.214 ±3,34 1.397 ±3 63,7% 2026-10-02 —
LMArena vision/ocr 1.218 ±4,19 1.393 ±4 15,4% 2026-10-02 —
LMArena vision/diagram 1.219 ±6,13 1.392 ±5 14,6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1.371 [1.366–1.376] Perzentil 55 · #122 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1.358 ±3,72 1.386 ±4 62,0% 2026-10-02 —
LMArena text/longer_query 1.371 ±3,13 1.374 ±3 31,8% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1.392 [1.384–1.399] Perzentil 53 · #106 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1.438 ±5,10 1.404 ±4 93,7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Deutsch 1.404 [1.391–1.417] Perzentil 61 · #57 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/german 1.420 ±8,18 1.419 ±7 92,9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1.393 [1.388–1.398] Perzentil 60 · #109 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1.416 ±2,40 1.405 ±2 94,0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Español 1.380 [1.364–1.395] Perzentil 33 · #100 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/spanish 1.395 ±9,17 1.394 ±8 92,4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Français 1.397 [1.378–1.415] Perzentil 44 · #76 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/french 1.430 ±11 1.414 ±10 91,6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 日本語 1.414 [1.401–1.426] Perzentil 65 · #46 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1.403 ±8,94 1.429 ±7 93,0% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 한국어 1.398 [1.386–1.411] Perzentil 52 · #66 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/korean 1.371 ±9,34 1.413 ±7 92,9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Polski 1.424 [1.416–1.433] Perzentil 68 · #43 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1.438 ±5,48 1.439 ±5 93,6% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1.400 [1.392–1.407] Perzentil 61 · #92 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1.407 ±4,48 1.413 ±4 93,7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
o3 1.392 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: o3

Daten CC BY 4.0: Link zu fedi.software beibehalten.