Ir para o conteúdo
fedi.software

GPT-5 Mini no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

B 1.371 ±5

Percentil 53 · #137

Preferido por pessoas / Resolve tarefas

1.362 / 1.382

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

+2

US$ 0,6875 por 1 mi de tokens, mediana de 29 provedores · fabricante US$ 0,6875

No seu hardware

Pesos fechados: apenas na nuvem.

Decomposição da pontuação

B Geral 1.371 [1.366–1.376] Percentil 53 · #137 · componentes: 9
Fonte Componente Valor Elo-eq Peso Medido em Variante
Epoch AI eci 146 ±0,91 1.402 ±7 34,5% 2025-08-07 —
LMArena text/overall 1.373 ±2,33 1.373 ±2 15,8% 2026-10-02 high
LMArena text/hard_prompts 1.380 ±3,05 1.377 ±3 15,6% 2026-10-02 high
LMArena text/instruction_following 1.357 ±3,82 1.372 ±4 7,6% 2026-10-02 high
LMArena text/expert 1.377 ±8,89 1.376 ±7 6,6% 2026-10-02 high
Epoch AI simpleqa_verified defasagem ×0,61 0,22 ±0,01 1.365 ±4 4,0% 2026-08-10 high
LMArena text/longer_query 1.355 ±4,12 1.358 ±4 3,8% 2026-10-02 high
LMArena text/multi_turn 1.363 ±4,69 1.365 ±4 3,7% 2026-10-02 high
Epoch AI gpqa_diamond defasagem ×0,26 0,75 ±0,02 1.389 ±11 1,2% 2025-10-30 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Código 1.373 [1.366–1.380] Percentil 54 · #129 · componentes: 2
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/coding 1.406 ±4,24 1.386 ±4 78,1% 2026-10-02 high
Epoch AI swe_bench_verified defasagem ×0,37 0,65 ±0,02 1.405 ±11 13,2% 2026-02-01 medium

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Matemática 1.379 [1.370–1.387] Percentil 56 · #112 · componentes: 3
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.377 ±7,90 1.371 ±8 48,9% 2026-10-02 high
Epoch AI frontiermath_t1_3 defasagem ×0,86 0,47 ±0,03 1.422 ±6 29,9% 2026-06-12 high
Epoch AI frontiermath_t4 defasagem ×0,86 0,12 ±0,05 1.412 ±8 13,6% 2026-06-12 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Visão 1.371 [1.366–1.376] Percentil 38 · #71 · componentes: 3 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena vision/overall 1.202 ±3,98 1.386 ±4 64,2% 2026-10-02 high
LMArena vision/ocr 1.199 ±5,25 1.374 ±5 15,2% 2026-10-02 high
LMArena vision/diagram 1.203 ±7,53 1.377 ±7 14,2% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Escrita 1.345 [1.338–1.352] Percentil 48 · #141 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.325 ±5,24 1.352 ±5 61,2% 2026-10-02 high
LMArena text/longer_query 1.355 ±4,12 1.358 ±4 32,4% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: 繁體中文 1.353 [1.343–1.363] Percentil 40 · #135 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.387 ±7,05 1.364 ±6 93,4% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Deutsch 1.358 [1.339–1.377] Percentil 36 · #93 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/german 1.365 ±12 1.372 ±11 91,4% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: English 1.355 [1.349–1.362] Percentil 48 · #143 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.379 ±3,15 1.365 ±3 93,8% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: Español 1.345 [1.327–1.362] Percentil 19 · #121 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/spanish 1.355 ±11 1.357 ±10 91,8% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: Français 1.355 [1.331–1.380] Percentil 24 · #103 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/french 1.385 ±15 1.373 ±14 89,5% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: 日本語 1.367 [1.348–1.387] Percentil 36 · #82 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/japanese 1.341 ±15 1.383 ±11 91,2% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: 한국어 1.351 [1.334–1.368] Percentil 29 · #97 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/korean 1.307 ±12 1.364 ±10 92,0% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Polski 1.376 [1.364–1.388] Percentil 31 · #91 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/polish 1.379 ±7,89 1.389 ±7 93,0% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Русский 1.361 [1.350–1.372] Percentil 42 · #135 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.361 ±6,69 1.372 ±6 93,2% 2026-10-02 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
GPT-5 Mini 1.371 B

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: GPT-5 Mini

Dados CC BY 4.0: mantenha o link para fedi.software.