Ir para o conteúdo
fedi.software

GPT-5 no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

B 1.404 ±6

Percentil 70 · #87

Preferido por pessoas / Resolve tarefas

1.395 / 1.417

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

-4

US$ 3,44 por 1 mi de tokens, mediana de 27 provedores · fabricante US$ 3,44

No seu hardware

Pesos fechados: apenas na nuvem.

Decomposição da pontuação

B Geral 1.404 [1.397–1.410] Percentil 70 · #87 · componentes: 9
Fonte Componente Valor Elo-eq Peso Medido em Variante
Epoch AI eci 150 1.438 ±11 29,9% 2025-08-07 —
LMArena text/overall 1.406 ±2,26 1.406 ±2 16,8% 2026-10-02 high
LMArena text/hard_prompts 1.415 ±2,93 1.409 ±3 16,7% 2026-10-02 high
LMArena text/instruction_following 1.388 ±3,62 1.402 ±3 8,2% 2026-10-02 high
LMArena text/expert 1.420 ±7,62 1.411 ±6 7,3% 2026-10-02 high
Epoch AI simpleqa_verified defasagem ×0,61 0,50 ±0,02 1.455 ±5 4,1% 2026-08-27 high
LMArena text/longer_query 1.399 ±3,83 1.400 ±4 4,1% 2026-10-02 —
LMArena text/multi_turn 1.426 ±4,24 1.423 ±4 4,0% 2026-10-02 —
Epoch AI gpqa_diamond defasagem ×0,26 0,86 ±0,02 1.441 ±10 1,4% 2025-10-29 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Código 1.406 [1.401–1.410] Percentil 70 · #83 · componentes: 3
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena webdev/overall 1.417 ±7,92 1.426 ±2 39,6% 2026-10-01 medium
LMArena text/coding 1.436 ±4,04 1.413 ±4 38,3% 2026-10-02 high
Epoch AI swe_bench_verified defasagem ×0,37 0,74 ±0,02 1.450 ±10 13,6% 2026-02-06 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Matemática 1.400 [1.392–1.408] Percentil 71 · #74 · componentes: 3
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.406 ±7,02 1.399 ±7 50,8% 2026-10-02 —
Epoch AI frontiermath_t1_3 defasagem ×0,86 0,55 ±0,03 1.441 ±6 29,7% 2026-06-10 high
Epoch AI frontiermath_t4 defasagem ×0,86 0,22 ±0,07 1.428 ±10 11,8% 2026-06-11 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Visão 1.402 [1.398–1.407] Percentil 46 · #61 · componentes: 3 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena vision/overall 1.232 ±3,59 1.413 ±3 63,9% 2026-10-02 —
LMArena vision/ocr 1.245 ±4,61 1.419 ±4 15,4% 2026-10-02 —
LMArena vision/diagram 1.252 ±6,78 1.421 ±6 14,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Escrita 1.383 [1.377–1.389] Percentil 58 · #114 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.365 ±4,87 1.393 ±5 61,4% 2026-10-02 —
LMArena text/longer_query 1.399 ±3,83 1.400 ±4 32,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: 繁體中文 1.380 [1.371–1.389] Percentil 48 · #117 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.423 ±6,34 1.392 ±5 93,5% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Deutsch 1.397 [1.380–1.415] Percentil 56 · #64 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/german 1.414 ±11 1.415 ±10 91,8% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: English 1.385 [1.380–1.391] Percentil 58 · #115 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.409 ±2,99 1.397 ±3 93,9% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Español 1.382 [1.364–1.399] Percentil 35 · #97 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/spanish 1.399 ±10 1.397 ±10 91,9% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Français 1.375 [1.351–1.399] Percentil 32 · #92 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/french 1.409 ±15 1.395 ±14 89,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: 日本語 1.415 [1.397–1.434] Percentil 66 · #44 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/japanese 1.411 ±14 1.435 ±10 91,5% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: 한국어 1.390 [1.375–1.406] Percentil 47 · #73 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/korean 1.361 ±11 1.406 ±8 92,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Polski 1.418 [1.406–1.429] Percentil 63 · #49 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/polish 1.431 ±7,44 1.434 ±6 93,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Русский 1.399 [1.388–1.409] Percentil 60 · #94 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.407 ±6,34 1.413 ±6 93,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
GPT-5 1.404 B

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: GPT-5

Dados CC BY 4.0: mantenha o link para fedi.software.