GLM 5.3 i fedi-index
Scoren i hvert udsnit, hvad den består af, værdi, lokal kørsel og historik.
fedi-index · Generelt
A 1.457 ±6
Percentil 92 · #24
Folk foretrækker / Løser opgaver
1.460 / 1.453
Menneskelige stemmer vs. benchmarks, Elo-eq
Værdi
+60
2,15 US$ pr. 1M tokens, median af 56 udbydere · leverandør 2,15 US$
På din hardware
Passer ikke i referenceopsætningerne.
Opdeling af scoren
A Generelt 1.457 [1.451–1.463] Percentil 92 · #24 · komponenter: 9
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
156 ±1,10 | 1.482 ±9 | 33,3% | 2026-08-14 | — |
| LMArena |
text/overall
|
1.471 ±2,82 | 1.471 ±3 | 16,4% | 2026-10-02 | max |
| LMArena |
text/hard_prompts
|
1.488 ±3,31 | 1.475 ±3 | 16,3% | 2026-10-02 | max |
| LMArena |
text/instruction_following
|
1.477 ±4,21 | 1.486 ±4 | 7,9% | 2026-10-02 | max |
| LMArena |
text/expert
|
1.514 ±7,23 | 1.488 ±6 | 7,3% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1.483 ±3,80 | 1.478 ±4 | 4,0% | 2026-10-02 | max |
| LMArena |
text/multi_turn
|
1.472 ±6,06 | 1.464 ±6 | 3,7% | 2026-10-02 | max |
| Epoch AI |
simpleqa_verified
afviger nedvægtning ×0,61 |
0,41 ±0,02 | 1.426 ±5 | 2,0% | 2026-08-28 | max |
| Epoch AI |
gpqa_diamond
nedvægtning ×0,26 |
0,91 ±0,02 | 1.463 ±7 | 1,6% | 2026-08-24 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
A Kodning 1.450 [1.446–1.453] Percentil 94 · #19 · komponenter: 2 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1.623 ±4,17 | 1.485 ±1 | 46,7% | 2026-10-01 | max |
| LMArena |
text/coding
|
1.497 ±4,75 | 1.468 ±4 | 43,5% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
B Agenter 1.442 [1.439–1.445] Percentil 60 · #24 · komponenter: 1 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
0,02 ±0,00 | 1.467 ±2 | 90,5% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
A Matematik 1.448 [1.438–1.459] Percentil 91 · #25 · komponenter: 3
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.491 ±11 | 1.480 ±10 | 45,9% | 2026-10-02 | max |
| Epoch AI |
frontiermath_t1_3
nedvægtning ×0,86 |
0,69 ±0,03 | 1.470 ±6 | 33,5% | 2026-08-25 | max |
| Epoch AI |
frontiermath_t4
nedvægtning ×0,86 |
0,29 ±0,07 | 1.439 ±12 | 12,2% | 2026-08-25 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
A Skrivning 1.466 [1.459–1.472] Percentil 92 · #21 · komponenter: 2 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.457 ±5,21 | 1.487 ±5 | 61,0% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1.483 ±3,80 | 1.478 ±4 | 32,5% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
A Sprog: 繁體中文 1.454 [1.441–1.466] Percentil 91 · #21 · komponenter: 1 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1.524 ±8,53 | 1.472 ±7 | 93,0% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
A Sprog: English 1.458 [1.450–1.465] Percentil 94 · #17 · komponenter: 1 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.482 ±3,85 | 1.475 ±4 | 93,7% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
B Sprog: Español 1.419 [1.399–1.440] Percentil 65 · #53 · komponenter: 1 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1.446 ±12 | 1.441 ±12 | 91,0% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
A Sprog: Français 1.447 [1.425–1.469] Percentil 84 · #22 · komponenter: 1 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1.494 ±13 | 1.473 ±12 | 90,5% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
A Sprog: 日本語 1.435 [1.412–1.458] Percentil 81 · #25 · komponenter: 1 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1.445 ±17 | 1.461 ±13 | 90,1% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
A Sprog: Русский 1.442 [1.431–1.453] Percentil 85 · #36 · komponenter: 1 foreløbig
| Kilde | Komponent | Værdi | Elo-eq | Vægt | Målt | Variant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.458 ±6,58 | 1.459 ±6 | 93,3% | 2026-10-02 | max |
Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik
Historik
Det samme i en tabel
| Model | 2026-10 |
|---|---|
| GLM 5.3 | 1.457 A |
Badge
Vis modellens fedi-index på dit website eller i en README. Badget opdaterer sig selv og linker til denne side.
Data CC BY 4.0: behold linket til fedi.software.