Naar de inhoud
fedi.software

GPT-5.1 in fedi-index

De score in elke doorsnede, waaruit die bestaat, prijs-kwaliteit, lokaal draaien en geschiedenis.

fedi-index · Algemeen

A 1.426 ±4

Percentiel 82 · #55

Mensen kiezen / Lost taken op

1.432 / 1.418

Menselijke stemmen tegenover benchmarks, Elo-eq

Prijs-kwaliteit

+18

US$ 3,44 per 1M tokens, mediaan van 26 aanbieders · maker US$ 3,44

Op je eigen hardware

Gesloten gewichten: alleen in de cloud.

Opbouw van de score

A Algemeen 1.426 [1.422–1.430] Percentiel 82 · #55 · onderdelen: 9
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
Epoch AI eci 150 ±0,72 1.435 ±6 35,7% 2025-11-13 —
LMArena text/overall 1.443 ±1,88 1.443 ±2 15,3% 2026-10-02 high
LMArena text/hard_prompts 1.457 ±2,45 1.446 ±2 15,2% 2026-10-02 high
LMArena text/instruction_following 1.443 ±3,20 1.454 ±3 7,5% 2026-10-02 high
LMArena text/expert 1.470 ±6,01 1.452 ±5 7,0% 2026-10-02 high
LMArena text/longer_query 1.448 ±3,22 1.445 ±3 3,7% 2026-10-02 high
Epoch AI simpleqa_verified verval ×0,61 0,48 ±0,02 1.448 ±5 3,7% 2026-08-27 high
LMArena text/multi_turn 1.450 ±3,83 1.444 ±4 3,7% 2026-10-02 high
Epoch AI gpqa_diamond verval ×0,26 0,88 ±0,02 1.447 ±9 1,4% 2025-11-13 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Coderen 1.405 [1.402–1.409] Percentiel 70 · #84 · onderdelen: 3
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena webdev/overall 1.395 ±5,86 1.420 ±2 39,9% 2026-10-01 medium
LMArena text/coding 1.454 ±3,51 1.429 ±3 38,7% 2026-10-02 high
Epoch AI swe_bench_verified verval ×0,37 0,68 ±0,02 1.422 ±11 13,0% 2026-02-18 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Wiskunde 1.408 [1.398–1.418] Percentiel 76 · #62 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/math 1.446 ±5,91 1.438 ±6 87,5% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Beeld 1.415 [1.410–1.420] Percentiel 56 · #50 · onderdelen: 3 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena vision/overall 1.250 ±3,98 1.429 ±4 63,5% 2026-10-02 high
LMArena vision/ocr 1.255 ±4,47 1.428 ±4 15,5% 2026-10-02 high
LMArena vision/diagram 1.265 ±6,41 1.432 ±6 14,7% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Schrijven 1.437 [1.431–1.442] Percentiel 81 · #51 · onderdelen: 2 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/creative_writing 1.427 ±4,10 1.456 ±4 61,8% 2026-10-02 high
LMArena text/longer_query 1.448 ±3,22 1.445 ±3 32,0% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: 繁體中文 1.434 [1.426–1.441] Percentiel 81 · #44 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/chinese 1.495 ±5,26 1.449 ±4 93,7% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Deutsch 1.417 [1.400–1.434] Percentiel 66 · #49 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/german 1.439 ±11 1.436 ±10 91,9% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: English 1.427 [1.422–1.432] Percentiel 79 · #57 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/english 1.451 ±2,74 1.442 ±3 93,9% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Español 1.410 [1.395–1.425] Percentiel 53 · #71 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/spanish 1.431 ±8,85 1.427 ±8 92,5% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Français 1.415 [1.398–1.432] Percentiel 57 · #59 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/french 1.450 ±10 1.433 ±9 92,0% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: 日本語 1.444 [1.425–1.463] Percentiel 87 · #18 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/japanese 1.453 ±14 1.466 ±11 91,4% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: 한국어 1.418 [1.401–1.434] Percentiel 67 · #45 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/korean 1.401 ±12 1.436 ±9 92,2% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Polski 1.424 [1.411–1.438] Percentiel 68 · #42 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/polish 1.440 ±8,62 1.442 ±7 92,8% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Русский 1.424 [1.417–1.431] Percentiel 76 · #58 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/russian 1.435 ±4,22 1.439 ±4 93,8% 2026-10-02 high

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

Geschiedenis

fedi-index per maand
Hetzelfde in een tabel
Model 2026-10
GPT-5.1 1.426 A

Badge

Toon de fedi-index van het model op je site of in een README. De badge werkt zichzelf bij en linkt naar deze pagina.

fedi-index: GPT-5.1

Data CC BY 4.0: behoud de link naar fedi.software.