Ir para o conteúdo
fedi.software

GLM 5.3 Flash no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

A 1.448 ±6

Percentil 89 · #33

Preferido por pessoas / Resolve tarefas

1.459 / 1.432

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

+105◆

US$ 0,2375 por 1 mi de tokens, mediana de 58 provedores · fabricante US$ 0,2375

No seu hardware

  • 128 GB de memória unificada #34 · UD-Q2_K_XL · compressão forte · ≈20 tok/s

Decomposição da pontuação

A Geral 1.448 [1.441–1.454] Percentil 89 · #33 · componentes: 8
Fonte Componente Valor Elo-eq Peso Medido em Variante
Epoch AI eci 152 ±1,10 1.453 ±9 36,8% 2026-08-20 —
LMArena text/overall 1.470 ±2,71 1.470 ±3 15,9% 2026-10-02 —
LMArena text/hard_prompts 1.491 ±3,17 1.477 ±3 15,8% 2026-10-02 —
LMArena text/instruction_following 1.478 ±3,81 1.487 ±4 7,7% 2026-10-02 —
LMArena text/expert 1.512 ±6,29 1.486 ±5 7,3% 2026-10-02 —
LMArena text/longer_query 1.483 ±3,61 1.478 ±3 3,9% 2026-10-02 —
LMArena text/multi_turn 1.467 ±5,30 1.460 ±5 3,7% 2026-10-02 —
Epoch AI gpqa_diamond defasagem ×0,26 0,90 ±0,02 1.459 ±8 1,7% 2026-08-26 max

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Código 1.452 [1.449–1.456] Percentil 94 · #17 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena webdev/overall 1.616 ±3,85 1.482 ±1 46,4% 2026-10-01 —
LMArena text/coding 1.506 ±4,22 1.476 ±4 43,9% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Agentes 1.430 [1.428–1.432] Percentil 49 · #30 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena agent/overall -0,00 ±0,00 1.453 ±1 90,5% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Matemática 1.443 [1.434–1.452] Percentil 89 · #28 · componentes: 3
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.501 ±9,03 1.490 ±9 47,8% 2026-10-02 —
Epoch AI frontiermath_t1_3 defasagem ×0,86 0,56 ±0,03 1.442 ±6 31,1% 2026-08-27 max
Epoch AI frontiermath_t4 defasagem ×0,86 0,17 ±0,06 1.420 ±10 13,1% 2026-08-27 max

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Visão 1.460 [1.454–1.466] Percentil 88 · #14 · componentes: 3 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena vision/overall 1.301 ±4,64 1.476 ±4 64,2% 2026-10-02 —
LMArena vision/ocr 1.308 ±5,26 1.479 ±5 15,5% 2026-10-02 —
LMArena vision/diagram 1.323 ±8,61 1.484 ±8 13,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Escrita 1.455 [1.449–1.462] Percentil 90 · #29 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.441 ±4,76 1.470 ±5 61,4% 2026-10-02 —
LMArena text/longer_query 1.483 ±3,61 1.478 ±3 32,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: 繁體中文 1.457 [1.446–1.468] Percentil 93 · #17 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.528 ±7,70 1.475 ±6 93,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Deutsch 1.428 [1.404–1.451] Percentil 78 · #33 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/german 1.458 ±15 1.452 ±13 90,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: English 1.449 [1.442–1.456] Percentil 89 · #30 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.473 ±3,64 1.465 ±4 93,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: Español 1.441 [1.423–1.459] Percentil 84 · #24 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/spanish 1.469 ±11 1.462 ±10 91,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: Français 1.454 [1.435–1.472] Percentil 92 · #12 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/french 1.498 ±11 1.477 ±10 91,5% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: 日本語 1.423 [1.402–1.444] Percentil 76 · #32 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/japanese 1.425 ±16 1.445 ±12 90,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: 한국어 1.441 [1.420–1.462] Percentil 84 · #23 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/korean 1.439 ±16 1.465 ±12 90,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Polski 1.417 [1.394–1.440] Percentil 61 · #52 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/polish 1.439 ±15 1.440 ±13 90,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Idioma: Русский 1.453 [1.444–1.462] Percentil 90 · #24 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.471 ±5,59 1.470 ±5 93,5% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
GLM 5.3 Flash 1.448 A

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: GLM 5.3 Flash

Dados CC BY 4.0: mantenha o link para fedi.software.