Ir al contenido
fedi.software

GPT-5 en fedi-index

La puntuación en cada categoría, de qué se compone, relación calidad-precio, ejecución local e historial.

fedi-index · General

B 1.404 ±6

Percentil 70 · #87

Preferido por personas / Resuelve tareas

1.395 / 1.417

Votos humanos frente a benchmarks, Elo-eq

Relación calidad-precio

-4

3,44 US$ por 1 M de tokens, mediana de 27 proveedores · fabricante 3,44 US$

En tu hardware

Pesos cerrados: solo en la nube.

Desglose de la puntuación

B General 1.404 [1.397–1.410] Percentil 70 · #87 · componentes: 9
Fuente Componente Valor Elo-eq Peso Medido Variante
Epoch AI eci 150 1.438 ±11 29,8% 2025-08-07 —
LMArena text/overall 1.406 ±2,26 1.406 ±2 16,8% 2026-10-02 high
LMArena text/hard_prompts 1.415 ±2,93 1.409 ±3 16,7% 2026-10-02 high
LMArena text/instruction_following 1.388 ±3,62 1.402 ±3 8,2% 2026-10-02 high
LMArena text/expert 1.420 ±7,62 1.411 ±6 7,3% 2026-10-02 high
Epoch AI simpleqa_verified antigüedad ×0,61 0,50 ±0,02 1.455 ±5 4,1% 2026-08-27 high
LMArena text/longer_query 1.399 ±3,83 1.400 ±4 4,1% 2026-10-02 —
LMArena text/multi_turn 1.426 ±4,24 1.423 ±4 4,0% 2026-10-02 —
Epoch AI gpqa_diamond antigüedad ×0,26 0,86 ±0,02 1.441 ±10 1,4% 2025-10-29 high

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Código 1.406 [1.401–1.410] Percentil 70 · #83 · componentes: 3
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena webdev/overall 1.417 ±7,92 1.426 ±2 39,6% 2026-10-01 medium
LMArena text/coding 1.436 ±4,04 1.413 ±4 38,3% 2026-10-02 high
Epoch AI swe_bench_verified antigüedad ×0,37 0,74 ±0,02 1.450 ±10 13,6% 2026-02-06 high

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Matemáticas 1.400 [1.392–1.408] Percentil 71 · #74 · componentes: 3
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/math 1.406 ±7,02 1.399 ±7 50,8% 2026-10-02 —
Epoch AI frontiermath_t1_3 antigüedad ×0,86 0,55 ±0,03 1.441 ±6 29,7% 2026-06-10 high
Epoch AI frontiermath_t4 antigüedad ×0,86 0,22 ±0,07 1.428 ±10 11,8% 2026-06-11 high

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

C Visión 1.402 [1.398–1.407] Percentil 46 · #61 · componentes: 3 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena vision/overall 1.232 ±3,59 1.413 ±3 63,9% 2026-10-02 —
LMArena vision/ocr 1.245 ±4,61 1.419 ±4 15,4% 2026-10-02 —
LMArena vision/diagram 1.252 ±6,78 1.421 ±6 14,4% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Escritura 1.383 [1.377–1.389] Percentil 58 · #114 · componentes: 2 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/creative_writing 1.365 ±4,87 1.393 ±5 61,4% 2026-10-02 —
LMArena text/longer_query 1.399 ±3,83 1.400 ±4 32,2% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

C Idioma: 繁體中文 1.380 [1.371–1.389] Percentil 48 · #117 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/chinese 1.423 ±6,34 1.392 ±5 93,5% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: Deutsch 1.397 [1.380–1.415] Percentil 56 · #64 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/german 1.414 ±11 1.415 ±10 91,8% 2026-10-02 high

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: English 1.385 [1.380–1.391] Percentil 58 · #115 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/english 1.409 ±2,99 1.397 ±3 93,9% 2026-10-02 high

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

C Idioma: Español 1.382 [1.364–1.399] Percentil 35 · #97 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/spanish 1.399 ±10 1.397 ±10 91,9% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

C Idioma: Français 1.375 [1.351–1.399] Percentil 32 · #92 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/french 1.409 ±15 1.395 ±14 89,8% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: 日本語 1.415 [1.397–1.434] Percentil 66 · #44 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/japanese 1.411 ±14 1.435 ±10 91,5% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

C Idioma: 한국어 1.390 [1.375–1.406] Percentil 47 · #73 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/korean 1.361 ±11 1.406 ±8 92,4% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: Polski 1.418 [1.406–1.429] Percentil 63 · #49 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/polish 1.431 ±7,44 1.434 ±6 93,2% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: Русский 1.399 [1.388–1.409] Percentil 60 · #94 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/russian 1.407 ±6,34 1.413 ±6 93,3% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

Historial

fedi-index por mes
Lo mismo en una tabla
Modelo 2026-10
GPT-5 1.404 B

Insignia

Muestra el fedi-index del modelo en tu sitio o en un README. La insignia se actualiza sola y enlaza a esta página.

fedi-index: GPT-5

Datos CC BY 4.0: conserva el enlace a fedi.software.