Ir para o conteúdo
fedi.software

GPT-5.3 Chat (latest) no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

B 1.372 ±2

Percentil 54 · #136 · provisório

Preferido por pessoas / Resolve tarefas

1.382 / —

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

-45

US$ 4,81 por 1 mi de tokens, mediana de 6 provedores · fabricante US$ 4,81

No seu hardware

Pesos fechados: apenas na nuvem.

Decomposição da pontuação

B Geral 1.372 [1.369–1.374] Percentil 54 · #136 · componentes: 6 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/overall 1.389 ±2,15 1.389 ±2 25,8% 2026-10-02 —
LMArena text/hard_prompts 1.399 ±2,64 1.394 ±2 25,6% 2026-10-02 —
LMArena text/instruction_following 1.379 ±3,30 1.393 ±3 12,6% 2026-10-02 —
LMArena text/expert 1.397 ±5,70 1.392 ±5 12,0% 2026-10-02 —
LMArena text/longer_query 1.396 ±3,16 1.396 ±3 6,3% 2026-10-02 —
LMArena text/multi_turn 1.412 ±4,07 1.410 ±4 6,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Código 1.370 [1.364–1.375] Percentil 53 · #132 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/coding 1.407 ±3,58 1.388 ±3 90,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Matemática 1.359 [1.348–1.370] Percentil 48 · #133 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.389 ±6,64 1.382 ±6 87,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Escrita 1.376 [1.371–1.382] Percentil 56 · #118 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.356 ±4,42 1.384 ±4 61,5% 2026-10-02 —
LMArena text/longer_query 1.396 ±3,16 1.396 ±3 32,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: 繁體中文 1.387 [1.378–1.397] Percentil 51 · #109 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.433 ±6,55 1.400 ±5 93,5% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Deutsch 1.372 [1.352–1.392] Percentil 41 · #85 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/german 1.384 ±13 1.388 ±11 91,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: English 1.367 [1.361–1.372] Percentil 53 · #130 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.390 ±2,95 1.377 ±3 93,9% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: Español 1.358 [1.344–1.374] Percentil 24 · #113 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/spanish 1.370 ±8,96 1.371 ±8 92,5% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Français 1.370 [1.354–1.387] Percentil 29 · #96 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/french 1.398 ±9,95 1.384 ±9 92,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: 한국어 1.379 [1.360–1.398] Percentil 37 · #86 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/korean 1.348 ±14 1.395 ±10 91,6% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Polski 1.388 [1.371–1.405] Percentil 36 · #84 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/polish 1.396 ±11 1.404 ±9 92,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Русский 1.394 [1.386–1.402] Percentil 58 · #99 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.400 ±4,92 1.407 ±4 93,6% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
GPT-5.3 Chat (latest) 1.372 B

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: GPT-5.3 Chat (latest)

Dados CC BY 4.0: mantenha o link para fedi.software.