Gå til indhold
fedi.software

grok-4.1-thinking i fedi-index

Scoren i hvert udsnit, hvad den består af, værdi, lokal kørsel og historik.

fedi-index · Generelt

B 1.400 ±2

Percentil 68 · #95 · foreløbig

Folk foretrækker / Løser opgaver

1.411 / —

Menneskelige stemmer vs. benchmarks, Elo-eq

Værdi

-12

4 US$ pr. 1M tokens, median af 1 udbydere

På din hardware

Lukkede vægte: kun i skyen.

Opdeling af scoren

B Generelt 1.400 [1.398–1.401] Percentil 68 · #95 · komponenter: 6 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/overall 1.437 ±1,61 1.437 ±2 25,6% 2026-10-02 thinking
LMArena text/hard_prompts 1.435 ±2,02 1.427 ±2 25,6% 2026-10-02 —
LMArena text/instruction_following 1.400 ±2,57 1.413 ±2 12,6% 2026-10-02 —
LMArena text/expert 1.417 ±4,45 1.409 ±4 12,2% 2026-10-02 thinking
LMArena text/longer_query 1.416 ±2,54 1.415 ±2 6,3% 2026-10-02 —
LMArena text/multi_turn 1.438 ±3,15 1.433 ±3 6,3% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Kodning 1.380 [1.377–1.382] Percentil 57 · #120 · komponenter: 2 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena webdev/overall 1.241 ±5,65 1.376 ±2 45,6% 2026-10-01 fast-reasoning
LMArena text/coding 1.445 ±2,80 1.422 ±2 44,8% 2026-10-02 thinking

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Matematik 1.389 [1.381–1.397] Percentil 62 · #98 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/math 1.422 ±4,91 1.414 ±5 87,9% 2026-10-02 thinking

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

C Billedforståelse 1.371 [1.367–1.376] Percentil 38 · #70 · komponenter: 3 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena vision/overall 1.201 ±3,54 1.385 ±3 63,3% 2026-10-02 fast-reasoning
LMArena vision/ocr 1.195 ±3,78 1.370 ±4 15,6% 2026-10-02 fast-reasoning
LMArena vision/diagram 1.210 ±5,59 1.384 ±5 14,9% 2026-10-02 fast-reasoning

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Skrivning 1.418 [1.413–1.422] Percentil 73 · #72 · komponenter: 2 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/creative_writing 1.411 ±3,37 1.440 ±3 62,0% 2026-10-02 —
LMArena text/longer_query 1.416 ±2,54 1.415 ±2 31,8% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: 繁體中文 1.411 [1.405–1.418] Percentil 67 · #74 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/chinese 1.464 ±4,42 1.425 ±4 93,8% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: Deutsch 1.425 [1.411–1.439] Percentil 74 · #38 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/german 1.446 ±9,00 1.442 ±8 92,7% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: English 1.423 [1.419–1.427] Percentil 75 · #69 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/english 1.447 ±2,24 1.437 ±2 94,0% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: Español 1.418 [1.406–1.430] Percentil 64 · #55 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/spanish 1.438 ±7,27 1.434 ±7 93,0% 2026-10-02 thinking

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: Français 1.414 [1.401–1.427] Percentil 55 · #61 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/french 1.448 ±7,97 1.430 ±7 92,8% 2026-10-02 thinking

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: 日本語 1.407 [1.391–1.422] Percentil 58 · #54 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/japanese 1.396 ±11 1.424 ±8 92,4% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: 한국어 1.423 [1.410–1.436] Percentil 72 · #39 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/korean 1.407 ±9,39 1.440 ±7 92,9% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: Polski 1.437 [1.426–1.448] Percentil 82 · #25 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/polish 1.455 ±7,00 1.454 ±6 93,3% 2026-10-02 thinking

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: Русский 1.423 [1.417–1.429] Percentil 75 · #60 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/russian 1.434 ±3,63 1.437 ±3 93,9% 2026-10-02 thinking

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

Historik

fedi-index pr. måned
Det samme i en tabel
Model 2026-10
grok-4.1-thinking 1.400 B

Badge

Vis modellens fedi-index på dit website eller i en README. Badget opdaterer sig selv og linker til denne side.

fedi-index: grok-4.1-thinking

Data CC BY 4.0: behold linket til fedi.software.