GPT-5.5 w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
S 1 466 ±6
Percentyl 96 · #13
Ludzie wolą / Rozwiązuje zadania
1 460 / 1 476
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
+29
11,25 USD za 1M tokenów, mediana dostawców: 38 · producent 11,25 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
S Ogólny 1 466 [1 460–1 472] Percentyl 96 · #13 · składniki: 9
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
159 ±1,43 | 1 510 ±11 | 28,6% | 2026-04-23 | — |
| LMArena |
text/overall
|
1 471 ±1,89 | 1 471 ±2 | 16,8% | 2026-10-02 | high |
| LMArena |
text/hard_prompts
|
1 489 ±2,22 | 1 475 ±2 | 16,8% | 2026-10-02 | high |
| LMArena |
text/instruction_following
|
1 478 ±2,70 | 1 487 ±3 | 8,3% | 2026-10-02 | high |
| LMArena |
text/expert
|
1 508 ±3,96 | 1 482 ±3 | 8,2% | 2026-10-02 | high |
| LMArena |
text/longer_query
|
1 484 ±2,56 | 1 479 ±2 | 4,2% | 2026-10-02 | high |
| Epoch AI |
simpleqa_verified
wygaszanie ×0,61 |
0,63 ±0,02 | 1 495 ±5 | 4,1% | 2026-08-27 | xhigh |
| LMArena |
text/multi_turn
|
1 476 ±3,42 | 1 468 ±3 | 4,1% | 2026-10-02 | high |
| Epoch AI |
gpqa_diamond
wygaszanie ×0,26 |
0,91 ±0,02 | 1 461 ±8 | 1,5% | 2026-05-05 | low |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Programowanie 1 435 [1 432–1 437] Percentyl 86 · #39 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1 512 ±3,03 | 1 453 ±1 | 45,8% | 2026-10-01 | xhigh-codex-harness |
| LMArena |
text/coding
|
1 494 ±2,89 | 1 465 ±3 | 44,6% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Agenci 1 459 [1 454–1 465] Percentyl 81 · #12 · składniki: 2
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
0,04 ±0,01 | 1 475 ±2 | 66,5% | 2026-10-02 | xhigh |
| τ²-bench (Sierra) |
tau2/banking_knowledge
wygaszanie ×0,76 |
0,45 ±0,05 | 1 488 ±8 | 26,3% | 2026-07-22 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
S Matematyka 1 469 [1 462–1 475] Percentyl 97 · #8 · składniki: 3
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 486 ±5,35 | 1 476 ±5 | 51,7% | 2026-10-02 | — |
| Epoch AI |
frontiermath_t1_3
wygaszanie ×0,86 |
0,85 ±0,02 | 1 506 ±5 | 30,5% | 2026-06-11 | xhigh |
| Epoch AI |
frontiermath_t4
wygaszanie ×0,86 |
0,72 ±0,07 | 1 508 ±11 | 10,5% | 2026-06-11 | xhigh |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Obraz 1 459 [1 455–1 463] Percentyl 87 · #16 · składniki: 3 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 297 ±3,01 | 1 472 ±3 | 63,0% | 2026-10-02 | — |
| LMArena |
vision/ocr
|
1 308 ±3,02 | 1 479 ±3 | 15,7% | 2026-10-02 | — |
| LMArena |
vision/diagram
|
1 326 ±4,28 | 1 486 ±4 | 15,3% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Pisanie 1 466 [1 461–1 470] Percentyl 93 · #20 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 455 ±3,33 | 1 485 ±3 | 62,1% | 2026-10-02 | high |
| LMArena |
text/longer_query
|
1 484 ±2,56 | 1 479 ±2 | 31,8% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 繁體中文 1 464 [1 456–1 471] Percentyl 96 · #10 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 535 ±4,97 | 1 481 ±4 | 93,7% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Deutsch 1 451 [1 436–1 467] Percentyl 94 · #10 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1 481 ±9,72 | 1 472 ±8 | 92,4% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: English 1 446 [1 442–1 451] Percentyl 89 · #32 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 470 ±2,44 | 1 462 ±3 | 94,0% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Español 1 443 [1 431–1 455] Percentyl 88 · #19 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 468 ±7,36 | 1 461 ±7 | 93,0% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Français 1 447 [1 436–1 459] Percentyl 85 · #21 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 486 ±7,07 | 1 466 ±6 | 93,1% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 日本語 1 477 [1 462–1 492] Percentyl 97 · #5 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1 497 ±11 | 1 499 ±8 | 92,5% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: 한국어 1 462 [1 449–1 475] Percentyl 96 · #7 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1 461 ±9,38 | 1 482 ±7 | 92,9% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Polski 1 444 [1 430–1 457] Percentyl 85 · #20 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 465 ±8,93 | 1 462 ±8 | 92,7% | 2026-10-02 | high |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Русский 1 456 [1 449–1 462] Percentyl 91 · #22 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 473 ±3,91 | 1 472 ±4 | 93,8% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| GPT-5.5 | 1 466 S |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.