Ir para o conteúdo
fedi.software

GLM 5.1 no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

A 1.432 ±5

Percentil 83 · #51

Preferido por pessoas / Resolve tarefas

1.445 / 1.415

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

+36

US$ 2,14 por 1 mi de tokens, mediana de 42 provedores · fabricante US$ 2,15

No seu hardware

Não cabe nas configurações de referência.

Decomposição da pontuação

A Geral 1.432 [1.427–1.437] Percentil 83 · #51 · componentes: 9
Fonte Componente Valor Elo-eq Peso Medido em Variante
Epoch AI eci 150 ±0,90 1.436 ±7 33,9% 2026-04-07 —
LMArena text/overall 1.461 ±1,87 1.462 ±2 15,6% 2026-10-02 —
LMArena text/hard_prompts 1.472 ±2,17 1.459 ±2 15,6% 2026-10-02 —
LMArena text/instruction_following 1.451 ±2,63 1.461 ±2 7,7% 2026-10-02 —
LMArena text/expert 1.476 ±4,14 1.457 ±3 7,5% 2026-10-02 —
LMArena text/longer_query 1.466 ±2,51 1.462 ±2 3,9% 2026-10-02 —
Epoch AI simpleqa_verified defasagem ×0,61 0,34 ±0,01 1.404 ±5 3,8% 2026-08-27 —
LMArena text/multi_turn 1.472 ±3,51 1.464 ±3 3,8% 2026-10-02 —
Epoch AI gpqa_diamond defasagem ×0,26 0,90 ±0,02 1.458 ±10 1,3% 2026-08-10 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Código 1.434 [1.430–1.437] Percentil 85 · #43 · componentes: 3
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena webdev/overall 1.508 ±3,44 1.452 ±1 39,6% 2026-10-01 —
LMArena text/coding 1.486 ±2,86 1.458 ±3 38,7% 2026-10-02 —
Epoch AI swe_bench_verified defasagem ×0,37 0,74 ±0,02 1.454 ±10 13,4% 2026-05-15 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Matemática 1.418 [1.410–1.426] Percentil 82 · #46 · componentes: 2
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.473 ±5,85 1.463 ±6 50,4% 2026-10-02 —
Epoch AI frontiermath_t1_3 defasagem ×0,86 0,37 ±0,03 1.401 ±6 42,4% 2026-08-29 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Escrita 1.459 [1.454–1.463] Percentil 91 · #24 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.452 ±3,37 1.482 ±3 62,0% 2026-10-02 —
LMArena text/longer_query 1.466 ±2,51 1.462 ±2 31,9% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: 繁體中文 1.448 [1.441–1.456] Percentil 88 · #27 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.515 ±5,06 1.465 ±4 93,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: Deutsch 1.437 [1.421–1.453] Percentil 85 · #23 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/german 1.464 ±10 1.457 ±9 92,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: English 1.452 [1.447–1.457] Percentil 91 · #26 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.476 ±2,42 1.468 ±3 94,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: Español 1.443 [1.431–1.456] Percentil 88 · #18 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/spanish 1.468 ±7,36 1.461 ±7 93,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: Français 1.438 [1.425–1.450] Percentil 81 · #27 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/french 1.475 ±7,56 1.456 ±7 93,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: 日本語 1.432 [1.416–1.449] Percentil 80 · #26 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/japanese 1.434 ±12 1.452 ±9 92,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: 한국어 1.432 [1.419–1.446] Percentil 80 · #28 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/korean 1.420 ±9,72 1.450 ±7 92,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Polski 1.428 [1.414–1.442] Percentil 74 · #35 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/polish 1.445 ±9,05 1.446 ±8 92,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: Русский 1.439 [1.432–1.446] Percentil 84 · #38 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.453 ±3,92 1.455 ±4 93,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
GLM 5.1 1.432 A

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: GLM 5.1

Dados CC BY 4.0: mantenha o link para fedi.software.