Naar de inhoud
fedi.software

grok-4.1-thinking in fedi-index

De score in elke doorsnede, waaruit die bestaat, prijs-kwaliteit, lokaal draaien en geschiedenis.

fedi-index · Algemeen

B 1.400 ±2

Percentiel 68 · #95 · voorlopig

Mensen kiezen / Lost taken op

1.411 / —

Menselijke stemmen tegenover benchmarks, Elo-eq

Prijs-kwaliteit

-12

US$ 4 per 1M tokens, mediaan van 1 aanbieders

Op je eigen hardware

Gesloten gewichten: alleen in de cloud.

Opbouw van de score

B Algemeen 1.400 [1.398–1.401] Percentiel 68 · #95 · onderdelen: 6 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/overall 1.437 ±1,61 1.437 ±2 25,6% 2026-10-02 thinking
LMArena text/hard_prompts 1.435 ±2,02 1.427 ±2 25,6% 2026-10-02 —
LMArena text/instruction_following 1.400 ±2,57 1.413 ±2 12,6% 2026-10-02 —
LMArena text/expert 1.417 ±4,45 1.409 ±4 12,2% 2026-10-02 thinking
LMArena text/longer_query 1.416 ±2,54 1.415 ±2 6,3% 2026-10-02 —
LMArena text/multi_turn 1.438 ±3,15 1.433 ±3 6,3% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Coderen 1.380 [1.377–1.382] Percentiel 57 · #120 · onderdelen: 2 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena webdev/overall 1.241 ±5,65 1.376 ±2 45,6% 2026-10-01 fast-reasoning
LMArena text/coding 1.445 ±2,80 1.422 ±2 44,8% 2026-10-02 thinking

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Wiskunde 1.389 [1.381–1.397] Percentiel 62 · #98 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/math 1.422 ±4,91 1.414 ±5 87,9% 2026-10-02 thinking

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

C Beeld 1.371 [1.367–1.376] Percentiel 38 · #70 · onderdelen: 3 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena vision/overall 1.201 ±3,54 1.385 ±3 63,3% 2026-10-02 fast-reasoning
LMArena vision/ocr 1.195 ±3,78 1.370 ±4 15,6% 2026-10-02 fast-reasoning
LMArena vision/diagram 1.210 ±5,59 1.384 ±5 14,9% 2026-10-02 fast-reasoning

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Schrijven 1.418 [1.413–1.422] Percentiel 73 · #72 · onderdelen: 2 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/creative_writing 1.411 ±3,37 1.440 ±3 62,0% 2026-10-02 —
LMArena text/longer_query 1.416 ±2,54 1.415 ±2 31,8% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: 繁體中文 1.411 [1.405–1.418] Percentiel 67 · #74 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/chinese 1.464 ±4,42 1.425 ±4 93,8% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Deutsch 1.425 [1.411–1.439] Percentiel 74 · #38 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/german 1.446 ±9,00 1.442 ±8 92,7% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: English 1.423 [1.419–1.427] Percentiel 75 · #69 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/english 1.447 ±2,24 1.437 ±2 94,0% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Español 1.418 [1.406–1.430] Percentiel 64 · #55 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/spanish 1.438 ±7,27 1.434 ±7 93,0% 2026-10-02 thinking

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Français 1.414 [1.401–1.427] Percentiel 55 · #61 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/french 1.448 ±7,97 1.430 ±7 92,8% 2026-10-02 thinking

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: 日本語 1.407 [1.391–1.422] Percentiel 58 · #54 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/japanese 1.396 ±11 1.424 ±8 92,4% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: 한국어 1.423 [1.410–1.436] Percentiel 72 · #39 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/korean 1.407 ±9,39 1.440 ±7 92,9% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: Polski 1.437 [1.426–1.448] Percentiel 82 · #25 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/polish 1.455 ±7,00 1.454 ±6 93,3% 2026-10-02 thinking

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Русский 1.423 [1.417–1.429] Percentiel 75 · #60 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/russian 1.434 ±3,63 1.437 ±3 93,9% 2026-10-02 thinking

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

Geschiedenis

fedi-index per maand
Hetzelfde in een tabel
Model 2026-10
grok-4.1-thinking 1.400 B

Badge

Toon de fedi-index van het model op je site of in een README. De badge werkt zichzelf bij en linkt naar deze pagina.

fedi-index: grok-4.1-thinking

Data CC BY 4.0: behoud de link naar fedi.software.