Przejdź do treści
fedi.software

Grok 4.20 w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

A 1 425 ±8

Percentyl 81 · #56

Ludzie wolą / Rozwiązuje zadania

1 419 / 1 432

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

+33

1,77 USD za 1M tokenów, mediana dostawców: 3

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

A Ogólny 1 425 [1 417–1 433] Percentyl 81 · #56 · składniki: 7
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 152 ±1,30 1 453 ±10 38,7% 2026-02-17 —
LMArena text/overall 1 444 ±2,32 1 444 ±2 15,8% 2026-10-02 —
LMArena text/hard_prompts 1 441 ±2,78 1 432 ±2 15,8% 2026-10-02 —
LMArena text/instruction_following 1 415 ±3,55 1 427 ±3 7,7% 2026-10-02 —
LMArena text/expert 1 428 ±6,29 1 418 ±5 7,3% 2026-10-02 —
LMArena text/longer_query 1 427 ±3,45 1 426 ±3 3,9% 2026-10-02 —
LMArena text/multi_turn 1 451 ±4,77 1 445 ±4 3,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Programowanie 1 401 [1 395–1 407] Percentyl 68 · #90 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/coding 1 447 ±3,83 1 423 ±3 90,1% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Matematyka 1 396 [1 384–1 408] Percentyl 68 · #83 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 433 ±7,35 1 425 ±7 86,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Wyszukiwanie 1 417 [1 411–1 423] Percentyl 47 · #18 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena search/overall 1 189 ±3,08 1 431 ±3 93,9% 2026-08-24 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Pisanie 1 437 [1 430–1 443] Percentyl 82 · #49 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 438 ±4,92 1 467 ±5 61,1% 2026-10-02 —
LMArena text/longer_query 1 427 ±3,45 1 426 ±3 32,5% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 繁體中文 1 418 [1 407–1 429] Percentyl 71 · #66 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 475 ±7,46 1 434 ±6 93,3% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Deutsch 1 433 [1 412–1 454] Percentyl 82 · #27 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/german 1 463 ±14 1 457 ±12 90,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: English 1 427 [1 421–1 433] Percentyl 80 · #55 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 451 ±3,09 1 442 ±3 93,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Español 1 416 [1 400–1 433] Percentyl 62 · #57 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 439 ±9,94 1 434 ±9 92,1% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Français 1 418 [1 400–1 436] Percentyl 59 · #56 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 455 ±11 1 438 ±10 91,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 한국어 1 426 [1 407–1 446] Percentyl 73 · #37 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/korean 1 416 ±14 1 448 ±11 91,3% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Polski 1 415 [1 396–1 433] Percentyl 57 · #57 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/polish 1 432 ±12 1 434 ±10 91,6% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Русский 1 434 [1 425–1 443] Percentyl 81 · #45 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 448 ±5,42 1 450 ±5 93,5% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
Grok 4.20 1 425 A

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: Grok 4.20

Dane CC BY 4.0: zachowaj link do fedi.software.