Gå til indhold
fedi.software

GLM 5.1 i fedi-index

Scoren i hvert udsnit, hvad den består af, værdi, lokal kørsel og historik.

fedi-index · Generelt

A 1.432 ±5

Percentil 83 · #51

Folk foretrækker / Løser opgaver

1.445 / 1.415

Menneskelige stemmer vs. benchmarks, Elo-eq

Værdi

+36

2,13 US$ pr. 1M tokens, median af 42 udbydere · leverandør 2,15 US$

På din hardware

Passer ikke i referenceopsætningerne.

Opdeling af scoren

A Generelt 1.432 [1.427–1.437] Percentil 83 · #51 · komponenter: 9
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
Epoch AI eci 150 ±0,90 1.436 ±7 33,9% 2026-04-07 —
LMArena text/overall 1.461 ±1,87 1.462 ±2 15,6% 2026-10-02 —
LMArena text/hard_prompts 1.472 ±2,17 1.459 ±2 15,6% 2026-10-02 —
LMArena text/instruction_following 1.451 ±2,63 1.461 ±2 7,7% 2026-10-02 —
LMArena text/expert 1.476 ±4,14 1.457 ±3 7,5% 2026-10-02 —
LMArena text/longer_query 1.466 ±2,51 1.462 ±2 3,9% 2026-10-02 —
Epoch AI simpleqa_verified nedvægtning ×0,61 0,34 ±0,01 1.404 ±5 3,8% 2026-08-27 —
LMArena text/multi_turn 1.472 ±3,51 1.464 ±3 3,8% 2026-10-02 —
Epoch AI gpqa_diamond nedvægtning ×0,26 0,90 ±0,02 1.458 ±10 1,3% 2026-08-10 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Kodning 1.434 [1.430–1.437] Percentil 85 · #43 · komponenter: 3
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena webdev/overall 1.508 ±3,44 1.452 ±1 39,6% 2026-10-01 —
LMArena text/coding 1.486 ±2,86 1.458 ±3 38,7% 2026-10-02 —
Epoch AI swe_bench_verified nedvægtning ×0,37 0,74 ±0,02 1.454 ±10 13,4% 2026-05-15 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Matematik 1.418 [1.410–1.426] Percentil 82 · #46 · komponenter: 2
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/math 1.473 ±5,85 1.463 ±6 50,4% 2026-10-02 —
Epoch AI frontiermath_t1_3 nedvægtning ×0,86 0,37 ±0,03 1.401 ±6 42,4% 2026-08-29 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Skrivning 1.459 [1.454–1.463] Percentil 91 · #24 · komponenter: 2 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/creative_writing 1.452 ±3,37 1.482 ±3 62,0% 2026-10-02 —
LMArena text/longer_query 1.466 ±2,51 1.462 ±2 31,9% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: 繁體中文 1.448 [1.441–1.456] Percentil 88 · #27 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/chinese 1.515 ±5,06 1.465 ±4 93,7% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: Deutsch 1.437 [1.421–1.453] Percentil 85 · #23 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/german 1.464 ±10 1.457 ±9 92,2% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: English 1.452 [1.447–1.457] Percentil 91 · #26 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/english 1.476 ±2,42 1.468 ±3 94,0% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: Español 1.443 [1.431–1.456] Percentil 88 · #18 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/spanish 1.468 ±7,36 1.461 ±7 93,0% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: Français 1.438 [1.425–1.450] Percentil 81 · #27 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/french 1.475 ±7,56 1.456 ±7 93,0% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: 日本語 1.432 [1.416–1.449] Percentil 80 · #26 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/japanese 1.434 ±12 1.452 ±9 92,2% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: 한국어 1.432 [1.419–1.446] Percentil 80 · #28 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/korean 1.420 ±9,72 1.450 ±7 92,8% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: Polski 1.428 [1.414–1.442] Percentil 74 · #35 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/polish 1.445 ±9,05 1.446 ±8 92,7% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: Русский 1.439 [1.432–1.446] Percentil 84 · #38 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/russian 1.453 ±3,92 1.455 ±4 93,8% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

Historik

fedi-index pr. måned
Det samme i en tabel
Model 2026-10
GLM 5.1 1.432 A

Badge

Vis modellens fedi-index på dit website eller i en README. Badget opdaterer sig selv og linker til denne side.

fedi-index: GLM 5.1

Data CC BY 4.0: behold linket til fedi.software.