Grok 4.20 (Reasoning) w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
B 1 414 ±2
Percentyl 76 · #70
Ludzie wolą / Rozwiązuje zadania
1 426 / 1 374
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
+26
1,56 USD za 1M tokenów, mediana dostawców: 13 · producent 1,56 USD
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
B Ogólny 1 414 [1 412–1 417] Percentyl 76 · #70 · składniki: 8
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1 451 ±1,87 | 1 451 ±2 | 21,0% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1 451 ±2,25 | 1 441 ±2 | 21,0% | 2026-10-02 | — |
| Epoch AI |
simpleqa_verified
wartość odstająca wygaszanie ×0,61 |
0,30 ±0,01 | 1 392 ±5 | 10,4% | 2026-08-27 | — |
| LMArena |
text/instruction_following
|
1 420 ±2,71 | 1 432 ±3 | 10,4% | 2026-10-02 | — |
| LMArena |
text/expert
|
1 440 ±4,12 | 1 427 ±3 | 10,2% | 2026-10-02 | — |
| Epoch AI |
gpqa_diamond
wygaszanie ×0,26 |
0,89 ±0,02 | 1 455 ±9 | 7,4% | 2026-07-13 | — |
| LMArena |
text/longer_query
|
1 436 ±2,62 | 1 434 ±2 | 5,2% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1 456 ±3,33 | 1 450 ±3 | 5,1% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Programowanie 1 402 [1 400–1 405] Percentyl 69 · #87 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1 374 ±3,09 | 1 414 ±1 | 45,8% | 2026-10-01 | — |
| LMArena |
text/coding
|
1 459 ±2,93 | 1 434 ±3 | 44,6% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Matematyka 1 417 [1 411–1 424] Percentyl 82 · #47 · składniki: 3
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 455 ±5,33 | 1 446 ±5 | 52,3% | 2026-10-02 | — |
| Epoch AI |
frontiermath_t1_3
wygaszanie ×0,86 |
0,45 ±0,03 | 1 418 ±6 | 28,4% | 2026-07-13 | — |
| Epoch AI |
frontiermath_t4
wygaszanie ×0,86 |
0,17 ±0,06 | 1 420 ±10 | 12,0% | 2026-07-13 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Obraz 1 425 [1 421–1 429] Percentyl 62 · #44 · składniki: 3 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 263 ±3,11 | 1 441 ±3 | 63,0% | 2026-10-02 | — |
| LMArena |
vision/ocr
|
1 266 ±3,11 | 1 439 ±3 | 15,7% | 2026-10-02 | — |
| LMArena |
vision/diagram
|
1 266 ±4,36 | 1 433 ±4 | 15,3% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Pisanie 1 437 [1 432–1 441] Percentyl 82 · #50 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 432 ±3,44 | 1 461 ±4 | 62,0% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 436 ±2,62 | 1 434 ±2 | 31,9% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: 繁體中文 1 424 [1 417–1 431] Percentyl 75 · #57 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 481 ±4,99 | 1 439 ±4 | 93,7% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Deutsch 1 420 [1 404–1 435] Percentyl 68 · #47 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1 441 ±9,76 | 1 437 ±8 | 92,4% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: English 1 433 [1 429–1 438] Percentyl 84 · #44 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 457 ±2,47 | 1 448 ±3 | 94,0% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Español 1 423 [1 410–1 435] Percentyl 70 · #46 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 444 ±7,18 | 1 439 ±7 | 93,0% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Français 1 439 [1 427–1 451] Percentyl 81 · #26 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 476 ±7,34 | 1 457 ±7 | 93,0% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: 日本語 1 418 [1 402–1 434] Percentyl 70 · #39 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1 413 ±12 | 1 436 ±9 | 92,2% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: 한국어 1 430 [1 416–1 444] Percentyl 78 · #31 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1 416 ±10 | 1 448 ±8 | 92,7% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Polski 1 433 [1 420–1 446] Percentyl 79 · #28 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 451 ±8,56 | 1 451 ±7 | 92,8% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
A Język: Русский 1 443 [1 436–1 449] Percentyl 86 · #33 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 458 ±3,91 | 1 459 ±4 | 93,8% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| Grok 4.20 (Reasoning) | 1 414 B |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.