Ir al contenido
fedi.software

Grok 4.7 en fedi-index

La puntuación en cada categoría, de qué se compone, relación calidad-precio, ejecución local e historial.

fedi-index · General

B 1.416 ±6

Percentil 77 · #67

Preferido por personas / Resuelve tareas

1.393 / 1.444

Votos humanos frente a benchmarks, Elo-eq

Relación calidad-precio

+11

3 US$ por 1 M de tokens, mediana de 17 proveedores · fabricante 3 US$

En tu hardware

Pesos cerrados: solo en la nube.

Desglose de la puntuación

B General 1.416 [1.410–1.422] Percentil 77 · #67 · componentes: 9
Fuente Componente Valor Elo-eq Peso Medido Variante
Epoch AI eci 154 ±1,02 1.466 ±8 34,8% 2026-09-21 —
LMArena text/overall 1.400 ±3,96 1.400 ±4 16,0% 2026-10-02 xhigh
LMArena text/hard_prompts 1.413 ±4,98 1.406 ±4 15,7% 2026-10-02 xhigh
LMArena text/instruction_following 1.409 ±6,58 1.422 ±6 7,3% 2026-10-02 xhigh
LMArena text/expert 1.414 ±12 1.406 ±10 6,1% 2026-10-02 xhigh
Epoch AI simpleqa_verified antigüedad ×0,61 0,56 ±0,02 1.473 ±5 4,1% 2026-09-22 xhigh
LMArena text/longer_query 1.417 ±6,07 1.416 ±6 3,7% 2026-10-02 xhigh
LMArena text/multi_turn 1.396 ±9,81 1.396 ±9 3,2% 2026-10-02 xhigh
Epoch AI gpqa_diamond antigüedad ×0,26 0,93 ±0,02 1.471 ±7 1,6% 2026-09-22 xhigh

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

A Código 1.430 [1.425–1.434] Percentil 83 · #49 · componentes: 2 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena webdev/overall 1.638 ±6,00 1.489 ±2 61,7% 2026-10-01 xhigh
LMArena text/coding atípico 1.423 ±8,21 1.402 ±7 25,2% 2026-10-02 xhigh

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Agentes 1.448 [1.441–1.454] Percentil 67 · #20 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena agent/overall 0,04 ±0,01 1.475 ±4 90,0% 2026-10-02 xhigh

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Matemáticas 1.400 [1.387–1.413] Percentil 72 · #73 · componentes: 3
Fuente Componente Valor Elo-eq Peso Medido Variante
Epoch AI frontiermath_t1_3 antigüedad ×0,86 0,53 ±0,03 1.436 ±6 37,9% 2026-09-22 xhigh
LMArena text/math 1.415 ±17 1.407 ±16 36,4% 2026-10-02 xhigh
Epoch AI frontiermath_t4 antigüedad ×0,86 0,17 ±0,06 1.420 ±10 16,0% 2026-09-22 xhigh

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Escritura 1.408 [1.397–1.418] Percentil 68 · #85 · componentes: 2 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/creative_writing 1.400 ±8,24 1.428 ±8 58,9% 2026-10-02 xhigh
LMArena text/longer_query 1.417 ±6,07 1.416 ±6 33,9% 2026-10-02 xhigh

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: 繁體中文 1.402 [1.384–1.421] Percentil 58 · #94 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/chinese 1.459 ±13 1.421 ±10 91,6% 2026-10-02 xhigh

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: English 1.379 [1.368–1.391] Percentil 56 · #120 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/english 1.404 ±6,11 1.392 ±6 93,1% 2026-10-02 xhigh

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: Русский 1.393 [1.377–1.410] Percentil 58 · #100 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/russian 1.403 ±10 1.410 ±9 92,2% 2026-10-02 xhigh

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

Historial

fedi-index por mes
Lo mismo en una tabla
Modelo 2026-10
Grok 4.7 1.416 B

Insignia

Muestra el fedi-index del modelo en tu sitio o en un README. La insignia se actualiza sola y enlaza a esta página.

fedi-index: Grok 4.7

Datos CC BY 4.0: conserva el enlace a fedi.software.