starling-lm-7b-beta en fedi-index
La puntuación en cada categoría, de qué se compone, relación calidad-precio, ejecución local e historial.
fedi-index · General
D 1.142 ±4
Percentil 18 · #242 · provisional
Preferido por personas / Resuelve tareas
1.138 / —
Votos humanos frente a benchmarks, Elo-eq
Relación calidad-precio
—
En tu hardware
Pesos cerrados: solo en la nube.
Desglose de la puntuación
D General 1.142 [1.138–1.146] Percentil 18 · #242 · componentes: 6 provisional
| Fuente | Componente | Valor | Elo-eq | Peso | Medido | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1.132 ±3,72 | 1.132 ±4 | 26,7% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1.118 ±5,43 | 1.141 ±5 | 25,6% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1.096 ±5,09 | 1.125 ±5 | 12,8% | 2026-10-02 | — |
| LMArena |
text/expert
|
1.084 ±10 | 1.136 ±8 | 10,9% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1.111 ±7,64 | 1.137 ±7 | 5,8% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.104 ±7,83 | 1.124 ±7 | 5,7% | 2026-10-02 | — |
El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología
D Código 1.157 [1.147–1.167] Percentil 17 · #231 · componentes: 1 provisional
| Fuente | Componente | Valor | Elo-eq | Peso | Medido | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1.143 ±6,47 | 1.152 ±6 | 89,3% | 2026-10-02 | — |
El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología
D Matemáticas 1.138 [1.127–1.150] Percentil 15 · #218 · componentes: 1 provisional
| Fuente | Componente | Valor | Elo-eq | Peso | Medido | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.124 ±7,05 | 1.129 ±7 | 86,9% | 2026-10-02 | — |
El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología
D Escritura 1.126 [1.116–1.136] Percentil 15 · #229 · componentes: 2 provisional
| Fuente | Componente | Valor | Elo-eq | Peso | Medido | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.096 ±7,32 | 1.118 ±8 | 61,7% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.104 ±7,83 | 1.124 ±7 | 31,1% | 2026-10-02 | — |
El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología
D Idioma: 繁體中文 1.150 [1.139–1.161] Percentil 11 · #198 · componentes: 1 provisional
| Fuente | Componente | Valor | Elo-eq | Peso | Medido | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1.114 ±7,55 | 1.147 ±6 | 93,2% | 2026-10-02 | — |
El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología
D Idioma: Deutsch 1.135 [1.111–1.159] Percentil 9 · #131 · componentes: 1 provisional
| Fuente | Componente | Valor | Elo-eq | Peso | Medido | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1.081 ±16 | 1.127 ±14 | 89,8% | 2026-10-02 | — |
El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología
D Idioma: English 1.141 [1.132–1.150] Percentil 20 · #220 · componentes: 1 provisional
| Fuente | Componente | Valor | Elo-eq | Peso | Medido | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.162 ±4,51 | 1.136 ±5 | 93,6% | 2026-10-02 | — |
El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología
D Idioma: Русский 1.144 [1.131–1.158] Percentil 9 · #213 · componentes: 1 provisional
| Fuente | Componente | Valor | Elo-eq | Peso | Medido | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.103 ±8,25 | 1.140 ±7 | 92,8% | 2026-10-02 | — |
El peso es la parte del componente en la puntuación (el resto es el prior, que acerca los modelos con pocos datos a la mediana de la población). Metodología
Historial
Lo mismo en una tabla
| Modelo | 2026-10 |
|---|---|
| starling-lm-7b-beta | 1.142 D |
Insignia
Muestra el fedi-index del modelo en tu sitio o en un README. La insignia se actualiza sola y enlaza a esta página.
Datos CC BY 4.0: conserva el enlace a fedi.software.