Aller au contenu
fedi.software

internlm2_5-20b-chat dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

D 1 173 ±4

Percentile 20 · #233 · provisoire

Préféré par les humains / Résout des tâches

1 171 / —

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

—

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

D Général 1 173 [1 169–1 177] Percentile 20 · #233 · composantes : 6 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/overall 1 158 ±3,60 1 158 ±4 27,0% 2026-10-02 —
LMArena text/hard_prompts 1 158 ±5,78 1 176 ±5 25,5% 2026-10-02 —
LMArena text/instruction_following 1 135 ±5,08 1 162 ±5 13,0% 2026-10-02 —
LMArena text/expert 1 150 ±11 1 190 ±9 10,4% 2026-10-02 —
LMArena text/multi_turn 1 135 ±7,43 1 159 ±7 5,9% 2026-10-02 —
LMArena text/longer_query 1 149 ±8,30 1 166 ±8 5,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Code 1 170 [1 159–1 182] Percentile 18 · #228 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/coding 1 159 ±7,17 1 166 ±6 89,0% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Maths 1 185 [1 172–1 197] Percentile 22 · #200 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 180 ±7,53 1 182 ±7 86,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Écriture 1 156 [1 145–1 167] Percentile 19 · #217 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 123 ±8,10 1 145 ±8 61,1% 2026-10-02 —
LMArena text/longer_query 1 149 ±8,30 1 166 ±8 31,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : 繁體中文 1 214 [1 200–1 227] Percentile 17 · #185 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 199 ±9,54 1 214 ±8 92,7% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : English 1 181 [1 172–1 190] Percentile 23 · #210 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 203 ±4,71 1 180 ±5 93,5% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Русский 1 148 [1 135–1 161] Percentile 10 · #210 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 107 ±8,01 1 143 ±7 92,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
internlm2_5-20b-chat 1 173 D

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: internlm2_5-20b-chat

Données CC BY 4.0 : conservez le lien vers fedi.software.