GPT-5.1 w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
A 1 426 ±4
Percentyl 82 · #55
Ludzie wolą / Rozwiązuje zadania
1 432 / 1 418
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
+18
3,44 USD za 1M tokenów, mediana dostawców: 26 · producent 3,44 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
A Ogólny 1 426 [1 422–1 430] Percentyl 82 · #55 · składniki: 9
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
150 ±0,72 | 1 435 ±6 | 35,7% | 2025-11-13 | — |
| LMArena |
text/overall
|
1 443 ±1,88 | 1 443 ±2 | 15,3% | 2026-10-02 | high |
| LMArena |
text/hard_prompts
|
1 457 ±2,45 | 1 446 ±2 | 15,2% | 2026-10-02 | high |
| LMArena |
text/instruction_following
|
1 443 ±3,20 | 1 454 ±3 | 7,5% | 2026-10-02 | high |
| LMArena |
text/expert
|
1 470 ±6,01 | 1 452 ±5 | 7,0% | 2026-10-02 | high |
| LMArena |
text/longer_query
|
1 448 ±3,22 | 1 445 ±3 | 3,7% | 2026-10-02 | high |
| Epoch AI |
simpleqa_verified
wygaszanie ×0,61 |
0,48 ±0,02 | 1 448 ±5 | 3,7% | 2026-08-27 | high |
| LMArena |
text/multi_turn
|
1 450 ±3,83 | 1 444 ±4 | 3,7% | 2026-10-02 | high |
| Epoch AI |
gpqa_diamond
wygaszanie ×0,26 |
0,88 ±0,02 | 1 447 ±9 | 1,3% | 2025-11-13 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Programowanie 1 405 [1 402–1 409] Percentyl 70 · #84 · składniki: 3
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1 395 ±5,86 | 1 420 ±2 | 39,9% | 2026-10-01 | medium |
| LMArena |
text/coding
|
1 454 ±3,51 | 1 429 ±3 | 38,7% | 2026-10-02 | high |
| Epoch AI |
swe_bench_verified
wygaszanie ×0,37 |
0,68 ±0,02 | 1 422 ±11 | 13,0% | 2026-02-18 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Matematyka 1 408 [1 398–1 418] Percentyl 76 · #62 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 446 ±5,91 | 1 438 ±6 | 87,5% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Obraz 1 415 [1 410–1 420] Percentyl 56 · #50 · składniki: 3 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 250 ±3,98 | 1 429 ±4 | 63,5% | 2026-10-02 | high |
| LMArena |
vision/ocr
|
1 255 ±4,47 | 1 428 ±4 | 15,5% | 2026-10-02 | high |
| LMArena |
vision/diagram
|
1 265 ±6,41 | 1 432 ±6 | 14,7% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Pisanie 1 437 [1 431–1 442] Percentyl 81 · #51 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 427 ±4,10 | 1 456 ±4 | 61,8% | 2026-10-02 | high |
| LMArena |
text/longer_query
|
1 448 ±3,22 | 1 445 ±3 | 32,0% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 繁體中文 1 434 [1 426–1 441] Percentyl 81 · #44 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 495 ±5,26 | 1 449 ±4 | 93,7% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Deutsch 1 417 [1 400–1 434] Percentyl 66 · #49 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1 439 ±11 | 1 436 ±10 | 91,9% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: English 1 427 [1 422–1 432] Percentyl 79 · #57 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 451 ±2,74 | 1 442 ±3 | 93,9% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Español 1 410 [1 395–1 425] Percentyl 53 · #71 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 431 ±8,85 | 1 427 ±8 | 92,5% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Français 1 415 [1 398–1 432] Percentyl 57 · #59 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 450 ±10 | 1 433 ±9 | 92,0% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 日本語 1 444 [1 425–1 463] Percentyl 87 · #18 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1 453 ±14 | 1 466 ±11 | 91,4% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: 한국어 1 418 [1 401–1 434] Percentyl 67 · #45 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1 401 ±12 | 1 436 ±9 | 92,2% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Polski 1 424 [1 411–1 438] Percentyl 68 · #42 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 440 ±8,62 | 1 442 ±7 | 92,8% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Русский 1 424 [1 417–1 431] Percentyl 76 · #58 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 435 ±4,22 | 1 439 ±4 | 93,8% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| GPT-5.1 | 1 426 A |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.