Naar de inhoud
fedi.software

Grok 4.20 Multi-Agent in fedi-index

De score in elke doorsnede, waaruit die bestaat, prijs-kwaliteit, lokaal draaien en geschiedenis.

fedi-index · Algemeen

B 1.413 ±2

Percentiel 76 · #71 · voorlopig

Mensen kiezen / Lost taken op

1.426 / —

Menselijke stemmen tegenover benchmarks, Elo-eq

Prijs-kwaliteit

+24

US$ 1,56 per 1M tokens, mediaan van 5 aanbieders · maker US$ 1,56

Op je eigen hardware

Gesloten gewichten: alleen in de cloud.

Opbouw van de score

B Algemeen 1.413 [1.411–1.415] Percentiel 76 · #71 · onderdelen: 6 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/overall 1.450 ±1,88 1.450 ±2 25,6% 2026-10-02 —
LMArena text/hard_prompts 1.448 ±2,26 1.438 ±2 25,5% 2026-10-02 —
LMArena text/instruction_following 1.420 ±2,71 1.432 ±3 12,6% 2026-10-02 —
LMArena text/expert 1.445 ±4,10 1.432 ±3 12,4% 2026-10-02 —
LMArena text/longer_query 1.431 ±2,64 1.429 ±2 6,3% 2026-10-02 —
LMArena text/multi_turn 1.452 ±3,40 1.446 ±3 6,2% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Coderen 1.410 [1.406–1.415] Percentiel 74 · #74 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/coding 1.458 ±2,91 1.433 ±3 90,3% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Wiskunde 1.405 [1.396–1.413] Percentiel 74 · #67 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/math 1.441 ±5,36 1.433 ±5 87,7% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Beeld 1.421 [1.418–1.425] Percentiel 58 · #48 · onderdelen: 3 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena vision/overall 1.259 ±3,13 1.438 ±3 63,0% 2026-10-02 —
LMArena vision/ocr 1.261 ±3,15 1.434 ±3 15,7% 2026-10-02 —
LMArena vision/diagram 1.261 ±4,41 1.428 ±4 15,3% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Zoeken 1.431 [1.426–1.436] Percentiel 66 · #12 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena search/overall 1.204 ±2,70 1.446 ±3 93,9% 2026-08-24 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Schrijven 1.438 [1.433–1.442] Percentiel 83 · #47 · onderdelen: 2 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/creative_writing 1.436 ±3,45 1.465 ±4 62,0% 2026-10-02 —
LMArena text/longer_query 1.431 ±2,64 1.429 ±2 31,8% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: 繁體中文 1.419 [1.412–1.426] Percentiel 71 · #65 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/chinese 1.475 ±5,02 1.434 ±4 93,7% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: Deutsch 1.432 [1.417–1.448] Percentiel 80 · #29 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/german 1.457 ±9,87 1.451 ±8 92,4% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: English 1.429 [1.424–1.434] Percentiel 82 · #51 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/english 1.453 ±2,49 1.444 ±3 94,0% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Español 1.426 [1.414–1.438] Percentiel 73 · #41 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/spanish 1.448 ±7,31 1.443 ±7 93,0% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Français 1.431 [1.419–1.443] Percentiel 73 · #37 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/french 1.467 ±7,23 1.448 ±7 93,0% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: 日本語 1.412 [1.395–1.429] Percentiel 64 · #47 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/japanese 1.405 ±13 1.430 ±10 92,0% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: 한국어 1.430 [1.416–1.444] Percentiel 78 · #30 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/korean 1.417 ±9,93 1.448 ±8 92,7% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: Polski 1.436 [1.423–1.449] Percentiel 81 · #26 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/polish 1.455 ±8,30 1.454 ±7 92,9% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: Русский 1.442 [1.436–1.449] Percentiel 86 · #34 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/russian 1.457 ±3,93 1.458 ±4 93,8% 2026-10-02 —

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

Geschiedenis

fedi-index per maand
Hetzelfde in een tabel
Model 2026-10
Grok 4.20 Multi-Agent 1.413 B

Badge

Toon de fedi-index van het model op je site of in een README. De badge werkt zichzelf bij en linkt naar deze pagina.

fedi-index: Grok 4.20 Multi-Agent

Data CC BY 4.0: behoud de link naar fedi.software.