Aller au contenu
fedi.software

openchat-3.5-0106 dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

D 1 121 ±4

Percentile 14 · #251 · provisoire

Préféré par les humains / Résout des tâches

1 116 / —

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

—

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

D Général 1 121 [1 117–1 126] Percentile 14 · #251 · composantes : 6 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/overall 1 107 ±4,03 1 107 ±4 27,3% 2026-10-02 —
LMArena text/hard_prompts 1 085 ±5,64 1 110 ±5 26,2% 2026-10-02 —
LMArena text/instruction_following 1 077 ±5,31 1 107 ±5 13,2% 2026-10-02 —
LMArena text/expert 1 052 ±12 1 110 ±10 10,4% 2026-10-02 —
LMArena text/multi_turn 1 091 ±7,65 1 118 ±7 6,0% 2026-10-02 —
LMArena text/longer_query 1 093 ±14 1 114 ±13 4,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Code 1 134 [1 123–1 145] Percentile 14 · #238 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/coding 1 113 ±7,09 1 125 ±6 89,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Maths 1 124 [1 112–1 135] Percentile 12 · #225 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 107 ±6,92 1 112 ±7 87,0% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Écriture 1 144 [1 130–1 158] Percentile 18 · #219 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 126 ±9,16 1 148 ±9 66,0% 2026-10-02 —
LMArena text/longer_query 1 093 ±14 1 114 ±13 25,5% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : 繁體中文 1 128 [1 115–1 141] Percentile 10 · #200 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 084 ±8,90 1 123 ±7 92,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : English 1 110 [1 102–1 119] Percentile 14 · #235 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 131 ±4,47 1 104 ±5 93,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
openchat-3.5-0106 1 121 D

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: openchat-3.5-0106

Données CC BY 4.0 : conservez le lien vers fedi.software.