Ir para o conteúdo
fedi.software

GPT-4.1 Nano no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

C 1.279 ±9

Percentil 30 · #204

Preferido por pessoas / Resolve tarefas

1.282 / 1.273

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

-57

US$ 0,175 por 1 mi de tokens, mediana de 21 provedores · fabricante US$ 0,175

No seu hardware

Pesos fechados: apenas na nuvem.

Decomposição da pontuação

C Geral 1.279 [1.270–1.288] Percentil 30 · #204 · componentes: 9
Fonte Componente Valor Elo-eq Peso Medido em Variante
Epoch AI eci 130 ±2,23 1.277 ±18 23,2% 2025-04-14 —
LMArena text/overall 1.285 ±3,90 1.285 ±4 19,7% 2026-10-02 —
LMArena text/hard_prompts 1.286 ±6,88 1.292 ±6 17,9% 2026-10-02 —
LMArena text/instruction_following 1.267 ±6,32 1.287 ±6 9,1% 2026-10-02 —
LMArena text/expert 1.271 ±15 1.289 ±13 6,2% 2026-10-02 —
Epoch AI simpleqa_verified defasagem ×0,61 0,06 ±0,01 1.316 ±2 5,5% 2026-08-31 —
LMArena text/multi_turn 1.277 ±9,19 1.287 ±8 4,0% 2026-10-02 —
LMArena text/longer_query 1.283 ±10 1.291 ±10 3,8% 2026-10-02 —
Epoch AI gpqa_diamond defasagem ×0,26 0,49 ±0,02 1.267 ±12 1,5% 2025-04-14 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Código 1.286 [1.271–1.301] Percentil 29 · #197 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/coding 1.306 ±9,83 1.297 ±9 87,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Matemática 1.261 [1.243–1.280] Percentil 31 · #176 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.274 ±12 1.272 ±11 83,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Visão 1.256 [1.241–1.272] Percentil 18 · #93 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena vision/overall 1.063 ±9,33 1.261 ±8 92,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Escrita 1.280 [1.268–1.293] Percentil 33 · #181 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.260 ±9,29 1.286 ±10 61,3% 2026-10-02 —
LMArena text/longer_query 1.283 ±10 1.291 ±10 30,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: English 1.280 [1.271–1.290] Percentil 32 · #185 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.303 ±4,99 1.286 ±5 93,4% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Русский 1.276 [1.258–1.293] Percentil 25 · #175 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.261 ±11 1.282 ±10 92,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
GPT-4.1 Nano 1.279 C

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: GPT-4.1 Nano

Dados CC BY 4.0: mantenha o link para fedi.software.