Ir al contenido
fedi.software

Grok 4.20 Multi-Agent en fedi-index

La puntuación en cada categoría, de qué se compone, relación calidad-precio, ejecución local e historial.

fedi-index · General

B 1.413 ±2

Percentil 76 · #71 · provisional

Preferido por personas / Resuelve tareas

1.426 / —

Votos humanos frente a benchmarks, Elo-eq

Relación calidad-precio

+24

1,56 US$ por 1 M de tokens, mediana de 5 proveedores · fabricante 1,56 US$

En tu hardware

Pesos cerrados: solo en la nube.

Desglose de la puntuación

B General 1.413 [1.411–1.415] Percentil 76 · #71 · componentes: 6 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/overall 1.450 ±1,88 1.450 ±2 25,6% 2026-10-02 —
LMArena text/hard_prompts 1.448 ±2,26 1.438 ±2 25,5% 2026-10-02 —
LMArena text/instruction_following 1.420 ±2,71 1.432 ±3 12,6% 2026-10-02 —
LMArena text/expert 1.445 ±4,10 1.432 ±3 12,4% 2026-10-02 —
LMArena text/longer_query 1.431 ±2,64 1.429 ±2 6,3% 2026-10-02 —
LMArena text/multi_turn 1.452 ±3,40 1.446 ±3 6,2% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Código 1.410 [1.406–1.415] Percentil 74 · #74 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/coding 1.458 ±2,91 1.433 ±3 90,3% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Matemáticas 1.405 [1.396–1.413] Percentil 74 · #67 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/math 1.441 ±5,36 1.433 ±5 87,7% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Visión 1.421 [1.418–1.425] Percentil 58 · #48 · componentes: 3 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena vision/overall 1.259 ±3,13 1.438 ±3 63,0% 2026-10-02 —
LMArena vision/ocr 1.261 ±3,15 1.434 ±3 15,7% 2026-10-02 —
LMArena vision/diagram 1.261 ±4,41 1.428 ±4 15,3% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Búsqueda 1.431 [1.426–1.436] Percentil 66 · #12 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena search/overall 1.204 ±2,70 1.446 ±3 93,9% 2026-08-24 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

A Escritura 1.438 [1.433–1.442] Percentil 83 · #47 · componentes: 2 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/creative_writing 1.436 ±3,45 1.465 ±4 62,0% 2026-10-02 —
LMArena text/longer_query 1.431 ±2,64 1.429 ±2 31,8% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: 繁體中文 1.419 [1.412–1.426] Percentil 71 · #65 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/chinese 1.475 ±5,02 1.434 ±4 93,7% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

A Idioma: Deutsch 1.432 [1.417–1.448] Percentil 80 · #29 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/german 1.457 ±9,87 1.451 ±8 92,4% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

A Idioma: English 1.429 [1.424–1.434] Percentil 82 · #51 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/english 1.453 ±2,49 1.444 ±3 94,0% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: Español 1.426 [1.414–1.438] Percentil 73 · #41 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/spanish 1.448 ±7,31 1.443 ±7 93,0% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: Français 1.431 [1.419–1.443] Percentil 73 · #37 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/french 1.467 ±7,23 1.448 ±7 93,0% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: 日本語 1.412 [1.395–1.429] Percentil 64 · #47 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/japanese 1.405 ±13 1.430 ±10 92,0% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

B Idioma: 한국어 1.430 [1.416–1.444] Percentil 78 · #30 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/korean 1.417 ±9,93 1.448 ±8 92,7% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

A Idioma: Polski 1.436 [1.423–1.449] Percentil 81 · #26 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/polish 1.455 ±8,30 1.454 ±7 92,9% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

A Idioma: Русский 1.442 [1.436–1.449] Percentil 86 · #34 · componentes: 1 provisional
Fuente Componente Valor Elo-eq Peso Medido Variante
LMArena text/russian 1.457 ±3,93 1.458 ±4 93,8% 2026-10-02 —

El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología

Historial

fedi-index por mes
Lo mismo en una tabla
Modelo 2026-10
Grok 4.20 Multi-Agent 1.413 B

Insignia

Muestra el fedi-index del modelo en tu sitio o en un README. La insignia se actualiza sola y enlaza a esta página.

fedi-index: Grok 4.20 Multi-Agent

Datos CC BY 4.0: conserva el enlace a fedi.software.