Przejdź do treści
fedi.software

grok-4.1-thinking w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

B 1 400 ±2

Percentyl 68 · #95 · wstępny

Ludzie wolą / Rozwiązuje zadania

1 411 / —

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

-12

4 USD za 1M tokenów, mediana dostawców: 1

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

B Ogólny 1 400 [1 398–1 401] Percentyl 68 · #95 · składniki: 6 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/overall 1 437 ±1,61 1 437 ±2 25,6% 2026-10-02 thinking
LMArena text/hard_prompts 1 435 ±2,02 1 427 ±2 25,6% 2026-10-02 —
LMArena text/instruction_following 1 400 ±2,57 1 413 ±2 12,6% 2026-10-02 —
LMArena text/expert 1 417 ±4,45 1 409 ±4 12,2% 2026-10-02 thinking
LMArena text/longer_query 1 416 ±2,54 1 415 ±2 6,3% 2026-10-02 —
LMArena text/multi_turn 1 438 ±3,15 1 433 ±3 6,3% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Programowanie 1 380 [1 377–1 382] Percentyl 57 · #120 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena webdev/overall 1 241 ±5,65 1 376 ±2 45,6% 2026-10-01 fast-reasoning
LMArena text/coding 1 445 ±2,80 1 422 ±2 44,8% 2026-10-02 thinking

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Matematyka 1 389 [1 381–1 397] Percentyl 62 · #98 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 422 ±4,91 1 414 ±5 87,9% 2026-10-02 thinking

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Obraz 1 371 [1 367–1 376] Percentyl 38 · #70 · składniki: 3 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena vision/overall 1 201 ±3,54 1 385 ±3 63,3% 2026-10-02 fast-reasoning
LMArena vision/ocr 1 195 ±3,78 1 370 ±4 15,6% 2026-10-02 fast-reasoning
LMArena vision/diagram 1 210 ±5,59 1 384 ±5 14,9% 2026-10-02 fast-reasoning

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Pisanie 1 418 [1 413–1 422] Percentyl 73 · #72 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 411 ±3,37 1 440 ±3 62,0% 2026-10-02 —
LMArena text/longer_query 1 416 ±2,54 1 415 ±2 31,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 繁體中文 1 411 [1 405–1 418] Percentyl 67 · #74 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 464 ±4,42 1 425 ±4 93,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Deutsch 1 425 [1 411–1 439] Percentyl 74 · #38 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/german 1 446 ±9,00 1 442 ±8 92,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: English 1 423 [1 419–1 427] Percentyl 75 · #69 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 447 ±2,24 1 437 ±2 94,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Español 1 418 [1 406–1 430] Percentyl 64 · #55 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 438 ±7,27 1 434 ±7 93,0% 2026-10-02 thinking

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Français 1 414 [1 401–1 427] Percentyl 55 · #61 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 448 ±7,97 1 430 ±7 92,8% 2026-10-02 thinking

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 日本語 1 407 [1 391–1 422] Percentyl 58 · #54 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/japanese 1 396 ±11 1 424 ±8 92,4% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 한국어 1 423 [1 410–1 436] Percentyl 72 · #39 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/korean 1 407 ±9,39 1 440 ±7 92,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Polski 1 437 [1 426–1 448] Percentyl 82 · #25 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/polish 1 455 ±7,00 1 454 ±6 93,3% 2026-10-02 thinking

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Русский 1 423 [1 417–1 429] Percentyl 75 · #60 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 434 ±3,63 1 437 ±3 93,9% 2026-10-02 thinking

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
grok-4.1-thinking 1 400 B

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: grok-4.1-thinking

Dane CC BY 4.0: zachowaj link do fedi.software.