Ir al contenido
fedi.software

GPT-5.2 en fedi-index

La puntuación en cada categoría, de qué se compone, relación calidad-precio, ejecución local e historial.

fedi-index · General

A 1.428 ±5

Percentil 82 · #53

Preferido por personas / Resuelve tareas

1.421 / 1.438

Votos humanos frente a benchmarks, Elo-eq

Relación calidad-precio

+12

4,81 US$ por 1 M de tokens, mediana de 26 proveedores · fabricante 4,81 US$

En tu hardware

Pesos cerrados: solo en la nube.

Desglose de la puntuación

A General 1.428 [1.423–1.434] Percentil 82 · #53 · componentes: 9
Fuente Componente Valor Elo-eq Peso Medido Variante
Epoch AI eci 153 ±0,97 1.465 ±8 33,4% 2025-12-11 —
LMArena text/overall 1.439 ±2,04 1.439 ±2 15,8% 2026-10-02 —
LMArena text/hard_prompts 1.445 ±2,50 1.435 ±2 15,7% 2026-10-02 —
LMArena text/instruction_following 1.417 ±3,16 1.429 ±3 7,7% 2026-10-02 —
LMArena text/expert 1.445 ±4,93 1.431 ±4 7,5% 2026-10-02 high
LMArena text/longer_query 1.428 ±3,05 1.427 ±3 3,9% 2026-10-02 —
Epoch AI simpleqa_verified antigüedad ×0,61 0,37 ±0,02 1.414 ±5 3,9% 2026-08-27 xhigh
LMArena text/multi_turn 1.458 ±3,96 1.452 ±4 3,8% 2026-10-02 —
Epoch AI gpqa_diamond antigüedad ×0,26 0,91 ±0,02 1.465 ±8 1,4% 2025-12-13 xhigh

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Código 1.409 [1.405–1.414] Percentil 73 · #76 · componentes: 3
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/coding 1.447 ±3,42 1.423 ±3 39,1% 2026-10-02 —
LMArena webdev/overall 1.415 ±11 1.426 ±3 38,8% 2026-10-01 —
Epoch AI swe_bench_verified antigüedad ×0,37 0,74 ±0,02 1.452 ±10 13,6% 2026-02-12 high

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

C Agentes 1.412 [1.400–1.424] Percentil 32 · #40 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
τ²-bench (Sierra) tau2/banking_knowledge antigüedad ×0,76 0,32 ±0,05 1.467 ±8 79,2% 2026-05-05 high

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

A Matemáticas 1.426 [1.419–1.433] Percentil 84 · #43 · componentes: 3
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/math 1.439 ±5,49 1.431 ±5 52,7% 2026-10-02 high
Epoch AI frontiermath_t1_3 antigüedad ×0,86 0,67 ±0,03 1.467 ±6 29,3% 2026-06-11 xhigh
Epoch AI frontiermath_t4 antigüedad ×0,86 0,32 ±0,07 1.443 ±12 10,6% 2026-06-11 xhigh

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Visión 1.432 [1.428–1.436] Percentil 68 · #37 · componentes: 3 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena vision/overall 1.268 ±3,32 1.446 ±3 63,1% 2026-10-02 —
LMArena vision/ocr 1.275 ±3,44 1.447 ±3 15,6% 2026-10-02 —
LMArena vision/diagram 1.285 ±5,11 1.450 ±4 15,0% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Escritura 1.415 [1.410–1.421] Percentil 73 · #74 · componentes: 2 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/creative_writing 1.402 ±4,28 1.430 ±4 61,5% 2026-10-02 —
LMArena text/longer_query 1.428 ±3,05 1.427 ±3 32,2% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: 繁體中文 1.407 [1.398–1.416] Percentil 62 · #86 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/chinese 1.460 ±6,31 1.421 ±5 93,5% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: Deutsch 1.422 [1.402–1.442] Percentil 72 · #41 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/german 1.448 ±13 1.443 ±11 91,2% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: English 1.422 [1.417–1.428] Percentil 75 · #70 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/english 1.446 ±2,81 1.436 ±3 93,9% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: Español 1.412 [1.397–1.427] Percentil 57 · #65 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/spanish 1.433 ±9,08 1.429 ±8 92,4% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: Français 1.421 [1.406–1.435] Percentil 65 · #48 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/french 1.456 ±8,68 1.438 ±8 92,6% 2026-10-02 high

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: 日本語 1.421 [1.400–1.441] Percentil 72 · #36 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/japanese 1.420 ±15 1.442 ±11 91,1% 2026-10-02 high

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: 한국어 1.409 [1.391–1.427] Percentil 62 · #53 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/korean 1.390 ±13 1.428 ±10 91,7% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: Polski 1.417 [1.400–1.434] Percentil 60 · #53 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/polish 1.434 ±11 1.436 ±10 91,9% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: Русский 1.428 [1.420–1.435] Percentil 78 · #51 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/russian 1.440 ±4,72 1.443 ±4 93,7% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

Historial

fedi-index por mes
Lo mismo en una tabla
Modelo 2026-10
GPT-5.2 1.428 A

Insignia

Muestra el fedi-index del modelo en tu sitio o en un README. La insignia se actualiza sola y enlaza a esta página.

fedi-index: GPT-5.2

Datos CC BY 4.0: conserva el enlace a fedi.software.