Przejdź do treści
fedi.software

o3 w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

B 1 392 ±5

Percentyl 64 · #107

Ludzie wolą / Rozwiązuje zadania

1 386 / 1 400

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

-17

3,50 USD za 1M tokenów, mediana dostawców: 18 · producent 3,50 USD

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

B Ogólny 1 392 [1 386–1 396] Percentyl 64 · #107 · składniki: 9
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 147 ±0,92 1 413 ±7 33,9% 2025-04-16 —
LMArena text/overall 1 410 ±1,84 1 410 ±2 15,7% 2026-10-02 —
LMArena text/hard_prompts 1 402 ±2,43 1 397 ±2 15,6% 2026-10-02 —
LMArena text/instruction_following 1 368 ±2,83 1 382 ±3 7,7% 2026-10-02 —
LMArena text/expert 1 403 ±5,77 1 397 ±5 7,3% 2026-10-02 —
LMArena text/longer_query 1 371 ±3,13 1 374 ±3 3,8% 2026-10-02 —
Epoch AI simpleqa_verified wygaszanie ×0,61 0,49 ±0,02 1 452 ±5 3,8% 2026-08-27 high
LMArena text/multi_turn 1 405 ±3,45 1 403 ±3 3,8% 2026-10-02 —
Epoch AI gpqa_diamond wygaszanie ×0,26 0,82 ±0,02 1 420 ±10 1,3% 2025-04-16 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Programowanie 1 373 [1 368–1 378] Percentyl 53 · #130 · składniki: 2
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/coding 1 408 ±3,16 1 388 ±3 78,7% 2026-10-02 —
Epoch AI swe_bench_verified wygaszanie ×0,37 0,62 ±0,02 1 393 ±11 12,8% 2026-02-12 medium

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Matematyka 1 392 [1 386–1 400] Percentyl 65 · #90 · składniki: 2
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 426 ±5,10 1 418 ±5 51,0% 2026-10-02 —
Epoch AI frontiermath_t1_3 wygaszanie ×0,86 0,33 ±0,03 1 393 ±6 41,9% 2026-08-27 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Obraz 1 384 [1 379–1 388] Percentyl 42 · #66 · składniki: 3 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena vision/overall 1 214 ±3,34 1 397 ±3 63,7% 2026-10-02 —
LMArena vision/ocr 1 218 ±4,19 1 393 ±4 15,4% 2026-10-02 —
LMArena vision/diagram 1 219 ±6,13 1 392 ±5 14,6% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Pisanie 1 371 [1 366–1 376] Percentyl 55 · #122 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 358 ±3,72 1 386 ±4 62,0% 2026-10-02 —
LMArena text/longer_query 1 371 ±3,13 1 374 ±3 31,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 繁體中文 1 392 [1 384–1 399] Percentyl 53 · #106 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 438 ±5,10 1 404 ±4 93,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Deutsch 1 404 [1 391–1 417] Percentyl 61 · #57 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/german 1 420 ±8,18 1 419 ±7 92,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: English 1 393 [1 388–1 398] Percentyl 60 · #109 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 416 ±2,40 1 405 ±2 94,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Español 1 380 [1 364–1 395] Percentyl 33 · #100 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 395 ±9,17 1 394 ±8 92,4% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Français 1 397 [1 378–1 415] Percentyl 44 · #76 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 430 ±11 1 414 ±10 91,6% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 日本語 1 414 [1 401–1 426] Percentyl 65 · #46 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/japanese 1 403 ±8,94 1 429 ±7 93,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 한국어 1 398 [1 386–1 411] Percentyl 52 · #66 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/korean 1 371 ±9,34 1 413 ±7 92,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Polski 1 424 [1 416–1 433] Percentyl 68 · #43 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/polish 1 438 ±5,48 1 439 ±5 93,6% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Русский 1 400 [1 392–1 407] Percentyl 61 · #92 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 407 ±4,48 1 413 ±4 93,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
o3 1 392 B

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: o3

Dane CC BY 4.0: zachowaj link do fedi.software.