o4 Mini w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
B 1 356 ±6
Percentyl 50 · #146
Ludzie wolą / Rozwiązuje zadania
1 338 / 1 382
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
-37
1,92 USD za 1M tokenów, mediana dostawców: 18 · producent 1,92 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
B Ogólny 1 356 [1 351–1 362] Percentyl 50 · #146 · składniki: 9
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
146 ±1,05 | 1 403 ±8 | 32,7% | 2025-04-16 | — |
| LMArena |
text/overall
|
1 353 ±2,02 | 1 353 ±2 | 16,0% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1 351 ±2,62 | 1 350 ±2 | 15,9% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1 321 ±3,08 | 1 338 ±3 | 7,8% | 2026-10-02 | — |
| LMArena |
text/expert
|
1 344 ±6,26 | 1 348 ±5 | 7,3% | 2026-10-02 | — |
| Epoch AI |
simpleqa_verified
wygaszanie ×0,61 |
0,20 ±0,01 | 1 359 ±4 | 4,1% | 2026-08-27 | low |
| LMArena |
text/longer_query
|
1 315 ±3,50 | 1 321 ±3 | 3,9% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1 350 ±3,68 | 1 353 ±3 | 3,9% | 2026-10-02 | — |
| Epoch AI |
gpqa_diamond
wygaszanie ×0,26 |
0,80 ±0,02 | 1 410 ±11 | 1,2% | 2025-04-16 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Programowanie 1 338 [1 333–1 344] Percentyl 39 · #171 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1 368 ±3,50 | 1 353 ±3 | 90,2% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Matematyka 1 377 [1 371–1 384] Percentyl 55 · #115 · składniki: 3
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 390 ±5,46 | 1 383 ±5 | 50,6% | 2026-10-02 | — |
| Epoch AI |
frontiermath_t1_3
wygaszanie ×0,86 |
0,36 ±0,03 | 1 399 ±6 | 27,9% | 2026-06-11 | high |
| Epoch AI |
frontiermath_t4
wygaszanie ×0,86 |
0,05 ±0,03 | 1 400 ±5 | 14,4% | 2026-06-11 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Obraz 1 366 [1 361–1 370] Percentyl 35 · #74 · składniki: 3 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 194 ±3,60 | 1 379 ±3 | 63,8% | 2026-10-02 | — |
| LMArena |
vision/ocr
|
1 197 ±4,54 | 1 372 ±4 | 15,4% | 2026-10-02 | — |
| LMArena |
vision/diagram
|
1 197 ±6,47 | 1 372 ±6 | 14,6% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Pisanie 1 313 [1 307–1 318] Percentyl 40 · #161 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 294 ±4,18 | 1 320 ±4 | 61,8% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 315 ±3,50 | 1 321 ±3 | 31,9% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: 繁體中文 1 329 [1 321–1 338] Percentyl 33 · #149 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 355 ±5,61 | 1 338 ±4 | 93,6% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: Deutsch 1 337 [1 323–1 351] Percentyl 29 · #102 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1 336 ±8,90 | 1 347 ±8 | 92,7% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: English 1 344 [1 340–1 350] Percentyl 44 · #152 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 367 ±2,58 | 1 354 ±3 | 93,9% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
D Język: Español 1 338 [1 321–1 354] Percentyl 16 · #125 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 347 ±9,93 | 1 349 ±9 | 92,1% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
D Język: Français 1 338 [1 318–1 359] Percentyl 16 · #113 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 362 ±13 | 1 352 ±12 | 90,9% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: 日本語 1 346 [1 333–1 360] Percentyl 29 · #91 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1 308 ±9,82 | 1 358 ±7 | 92,8% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: 한국어 1 357 [1 343–1 371] Percentyl 30 · #95 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1 313 ±10 | 1 369 ±8 | 92,7% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
D Język: Polski 1 361 [1 352–1 370] Percentyl 22 · #103 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 358 ±6,04 | 1 372 ±5 | 93,5% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: Русский 1 338 [1 330–1 347] Percentyl 38 · #145 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 334 ±5,02 | 1 348 ±4 | 93,6% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| o4 Mini | 1 356 B |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.