Ir para o conteúdo
fedi.software

GLM 4.5 no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

B 1.396 ±3

Percentil 66 · #100 · provisório

Preferido por pessoas / Resolve tarefas

1.408 / —

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

+18

US$ 1 por 1 mi de tokens, mediana de 15 provedores · fabricante US$ 1

No seu hardware

  • 128 GB de memória unificada #40 · UD-IQ1_M · compressão forte · ≈10 tok/s

Decomposição da pontuação

B Geral 1.396 [1.394–1.399] Percentil 66 · #100 · componentes: 6 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/overall 1.430 ±2,51 1.430 ±2 26,2% 2026-10-02 —
LMArena text/hard_prompts 1.430 ±3,26 1.422 ±3 26,0% 2026-10-02 —
LMArena text/instruction_following 1.404 ±4,03 1.417 ±4 12,7% 2026-10-02 —
LMArena text/expert 1.432 ±8,91 1.421 ±7 10,9% 2026-10-02 —
LMArena text/longer_query 1.413 ±4,37 1.412 ±4 6,3% 2026-10-02 —
LMArena text/multi_turn 1.415 ±5,04 1.412 ±5 6,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Código 1.391 [1.384–1.398] Percentil 63 · #104 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/coding 1.434 ±4,48 1.412 ±4 90,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Matemática 1.390 [1.376–1.402] Percentil 62 · #97 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.427 ±7,98 1.419 ±8 86,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Escrita 1.405 [1.398–1.412] Percentil 66 · #91 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.395 ±5,53 1.423 ±6 61,0% 2026-10-02 —
LMArena text/longer_query 1.413 ±4,37 1.412 ±4 32,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: 繁體中文 1.410 [1.400–1.421] Percentil 65 · #78 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.465 ±7,38 1.425 ±6 93,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Deutsch 1.389 [1.369–1.409] Percentil 50 · #72 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/german 1.406 ±13 1.408 ±11 91,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: English 1.413 [1.406–1.420] Percentil 68 · #88 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.437 ±3,35 1.427 ±4 93,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Español 1.427 [1.407–1.447] Percentil 74 · #39 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/spanish 1.454 ±12 1.448 ±11 91,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Français 1.385 [1.358–1.411] Percentil 38 · #84 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/french 1.422 ±16 1.407 ±15 88,9% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: 日本語 1.420 [1.405–1.436] Percentil 71 · #38 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/japanese 1.416 ±12 1.439 ±9 92,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: 한국어 1.404 [1.387–1.421] Percentil 55 · #62 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/korean 1.382 ±12 1.421 ±9 92,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Polski 1.411 [1.399–1.422] Percentil 53 · #62 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/polish 1.422 ±7,58 1.426 ±6 93,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Русский 1.405 [1.393–1.417] Percentil 63 · #87 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.414 ±7,30 1.420 ±7 93,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
GLM 4.5 1.396 B

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: GLM 4.5

Dados CC BY 4.0: mantenha o link para fedi.software.