Ir para o conteúdo
fedi.software

GLM 5 no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

B 1.412 ±6

Percentil 75 · #75

Preferido por pessoas / Resolve tarefas

1.428 / 1.390

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

+23

US$ 1,55 por 1 mi de tokens, mediana de 30 provedores · fabricante US$ 1,55

No seu hardware

Não cabe nas configurações de referência.

Decomposição da pontuação

B Geral 1.412 [1.406–1.418] Percentil 75 · #75 · componentes: 8
Fonte Componente Valor Elo-eq Peso Medido em Variante
Epoch AI eci 146 ±0,99 1.405 ±8 37,8% 2026-02-11 —
LMArena text/overall 1.446 ±2,16 1.446 ±2 15,7% 2026-10-02 —
LMArena text/hard_prompts 1.452 ±2,63 1.442 ±2 15,6% 2026-10-02 —
LMArena text/instruction_following 1.428 ±3,34 1.439 ±3 7,7% 2026-10-02 —
LMArena text/expert 1.455 ±5,93 1.439 ±5 7,2% 2026-10-02 —
LMArena text/longer_query 1.446 ±3,22 1.444 ±3 3,8% 2026-10-02 —
LMArena text/multi_turn 1.456 ±4,52 1.450 ±4 3,7% 2026-10-02 —
Epoch AI gpqa_diamond defasagem ×0,26 0,88 ±0,02 1.448 ±11 1,4% 2026-02-12 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Código 1.415 [1.411–1.419] Percentil 75 · #71 · componentes: 3
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena webdev/overall 1.434 ±4,15 1.431 ±1 40,0% 2026-10-01 —
LMArena text/coding 1.461 ±3,67 1.436 ±3 38,4% 2026-10-02 —
Epoch AI swe_bench_verified defasagem ×0,37 0,72 ±0,02 1.443 ±11 13,2% 2026-02-15 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Agentes 1.388 [1.380–1.396] Percentil 7 · #53 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
τ²-bench (Sierra) tau2/banking_knowledge defasagem ×0,76 0,10 ±0,03 1.430 ±5 81,4% 2026-02-27 enabled

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Matemática 1.401 [1.390–1.413] Percentil 73 · #70 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.440 ±7,19 1.431 ±7 86,9% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Escrita 1.444 [1.438–1.450] Percentil 84 · #44 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.439 ±4,56 1.468 ±5 61,4% 2026-10-02 —
LMArena text/longer_query 1.446 ±3,22 1.444 ±3 32,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: 繁體中文 1.445 [1.435–1.455] Percentil 86 · #31 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.511 ±6,88 1.462 ±6 93,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Deutsch 1.420 [1.399–1.440] Percentil 68 · #46 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/german 1.445 ±13 1.441 ±11 91,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: English 1.434 [1.429–1.440] Percentil 85 · #42 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.458 ±2,95 1.450 ±3 93,9% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Español 1.429 [1.414–1.444] Percentil 76 · #37 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/spanish 1.453 ±9,12 1.448 ±8 92,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Français 1.418 [1.401–1.436] Percentil 60 · #55 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/french 1.455 ±10 1.438 ±10 91,9% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: 한국어 1.432 [1.414–1.449] Percentil 79 · #29 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/korean 1.422 ±13 1.452 ±10 91,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Polski 1.418 [1.400–1.436] Percentil 64 · #48 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/polish 1.436 ±12 1.438 ±10 91,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Русский 1.424 [1.416–1.433] Percentil 76 · #57 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.436 ±5,07 1.439 ±5 93,6% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
GLM 5 1.412 B

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: GLM 5

Dados CC BY 4.0: mantenha o link para fedi.software.