Ir para o conteúdo
fedi.software

GPT-6 Sol no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

A 1.434 ±8

Percentil 84 · #49

Preferido por pessoas / Resolve tarefas

1.397 / 1.494

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

+22

US$ 4 por 1 mi de tokens, mediana de 22 provedores · fabricante US$ 4

No seu hardware

Pesos fechados: apenas na nuvem.

Decomposição da pontuação

A Geral 1.434 [1.426–1.441] Percentil 84 · #49 · componentes: 9
Fonte Componente Valor Elo-eq Peso Medido em Variante
Epoch AI eci 163 ±1,66 1.538 ±13 27,6% 2026-09-22 —
LMArena text/overall 1.395 ±3,54 1.395 ±4 17,5% 2026-10-02 max
LMArena text/hard_prompts 1.419 ±4,34 1.412 ±4 17,3% 2026-10-02 max
LMArena text/instruction_following 1.413 ±5,66 1.425 ±5 8,2% 2026-10-02 max
LMArena text/expert 1.439 ±9,92 1.426 ±8 7,2% 2026-10-02 max
Epoch AI simpleqa_verified defasagem ×0,61 0,61 ±0,02 1.488 ±5 4,5% 2026-09-22 max
LMArena text/longer_query 1.414 ±5,24 1.413 ±5 4,2% 2026-10-02 max
LMArena text/multi_turn 1.413 ±8,43 1.411 ±8 3,7% 2026-10-02 max
Epoch AI gpqa_diamond defasagem ×0,26 0,94 ±0,01 1.478 ±7 1,8% 2026-09-22 max

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Código 1.444 [1.440–1.448] Percentil 91 · #25 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena webdev/overall 1.689 ±5,84 1.503 ±2 60,7% 2026-10-01 max
LMArena text/coding outlier 1.448 ±6,78 1.424 ±6 26,5% 2026-10-02 max

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Agentes 1.470 [1.460–1.480] Percentil 90 · #7 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena agent/overall 0,10 ±0,01 1.502 ±6 89,3% 2026-10-02 max

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

A Matemática 1.447 [1.436–1.458] Percentil 90 · #26 · componentes: 3
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.407 ±14 1.400 ±13 38,6% 2026-10-02 max
Epoch AI frontiermath_t1_3 defasagem ×0,86 0,90 ±0,02 1.516 ±4 37,4% 2026-09-22 max
Epoch AI frontiermath_t4 defasagem ×0,86 0,90 ±0,05 1.536 ±8 15,3% 2026-09-22 max

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Escrita 1.397 [1.388–1.406] Percentil 64 · #98 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.382 ±7,40 1.410 ±8 59,4% 2026-10-02 max
LMArena text/longer_query 1.414 ±5,24 1.413 ±5 33,7% 2026-10-02 max

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: 繁體中文 1.362 [1.345–1.379] Percentil 42 · #130 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.403 ±12 1.376 ±9 92,0% 2026-10-02 max

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: English 1.374 [1.364–1.384] Percentil 55 · #123 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.398 ±5,37 1.386 ±6 93,3% 2026-10-02 max

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Español 1.361 [1.334–1.387] Percentil 26 · #111 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/spanish 1.381 ±17 1.381 ±15 88,7% 2026-10-02 max

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

B Idioma: Русский 1.399 [1.385–1.414] Percentil 60 · #93 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.409 ±8,84 1.415 ±8 92,6% 2026-10-02 max

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
GPT-6 Sol 1.434 A

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: GPT-6 Sol

Dados CC BY 4.0: mantenha o link para fedi.software.