Ir al contenido
fedi.software

GPT-6 Sol en fedi-index

La puntuación en cada categoría, de qué se compone, relación calidad-precio, ejecución local e historial.

fedi-index · General

A 1.434 ±8

Percentil 84 · #49

Preferido por personas / Resuelve tareas

1.397 / 1.494

Votos humanos frente a benchmarks, Elo-eq

Relación calidad-precio

+22

4 US$ por 1 M de tokens, mediana de 22 proveedores · fabricante 4 US$

En tu hardware

Pesos cerrados: solo en la nube.

Desglose de la puntuación

A General 1.434 [1.426–1.441] Percentil 84 · #49 · componentes: 9
Fuente Componente Valor Elo-eq Peso Medido Variante
Epoch AI eci 163 ±1,66 1.538 ±13 27,6% 2026-09-22 —
LMArena text/overall 1.395 ±3,54 1.395 ±4 17,5% 2026-10-02 max
LMArena text/hard_prompts 1.419 ±4,34 1.412 ±4 17,3% 2026-10-02 max
LMArena text/instruction_following 1.413 ±5,66 1.425 ±5 8,2% 2026-10-02 max
LMArena text/expert 1.439 ±9,92 1.426 ±8 7,2% 2026-10-02 max
Epoch AI simpleqa_verified antigüedad ×0,61 0,61 ±0,02 1.488 ±5 4,5% 2026-09-22 max
LMArena text/longer_query 1.414 ±5,24 1.413 ±5 4,2% 2026-10-02 max
LMArena text/multi_turn 1.413 ±8,43 1.411 ±8 3,7% 2026-10-02 max
Epoch AI gpqa_diamond antigüedad ×0,26 0,94 ±0,01 1.478 ±7 1,8% 2026-09-22 max

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

A Código 1.444 [1.440–1.448] Percentil 91 · #25 · componentes: 2 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena webdev/overall 1.689 ±5,84 1.503 ±2 60,7% 2026-10-01 max
LMArena text/coding atípico 1.448 ±6,78 1.424 ±6 26,5% 2026-10-02 max

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

A Agentes 1.470 [1.460–1.480] Percentil 90 · #7 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena agent/overall 0,10 ±0,01 1.502 ±6 89,3% 2026-10-02 max

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

A Matemáticas 1.447 [1.436–1.458] Percentil 90 · #26 · componentes: 3
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/math 1.407 ±14 1.400 ±13 38,7% 2026-10-02 max
Epoch AI frontiermath_t1_3 antigüedad ×0,86 0,90 ±0,02 1.516 ±4 37,4% 2026-09-22 max
Epoch AI frontiermath_t4 antigüedad ×0,86 0,90 ±0,05 1.536 ±8 15,3% 2026-09-22 max

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Escritura 1.397 [1.388–1.406] Percentil 64 · #98 · componentes: 2 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/creative_writing 1.382 ±7,40 1.410 ±8 59,4% 2026-10-02 max
LMArena text/longer_query 1.414 ±5,24 1.413 ±5 33,7% 2026-10-02 max

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

C Idioma: 繁體中文 1.362 [1.345–1.379] Percentil 42 · #130 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/chinese 1.403 ±12 1.376 ±9 92,0% 2026-10-02 max

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: English 1.374 [1.364–1.384] Percentil 55 · #123 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/english 1.398 ±5,37 1.386 ±6 93,3% 2026-10-02 max

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

C Idioma: Español 1.361 [1.334–1.387] Percentil 26 · #111 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/spanish 1.381 ±17 1.381 ±15 88,7% 2026-10-02 max

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: Русский 1.399 [1.385–1.414] Percentil 60 · #93 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/russian 1.409 ±8,84 1.415 ±8 92,6% 2026-10-02 max

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

Historial

fedi-index por mes
Lo mismo en una tabla
Modelo 2026-10
GPT-6 Sol 1.434 A

Insignia

Muestra el fedi-index del modelo en tu sitio o en un README. La insignia se actualiza sola y enlaza a esta página.

fedi-index: GPT-6 Sol

Datos CC BY 4.0: conserva el enlace a fedi.software.