Aller au contenu
fedi.software

vicuna-33b dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

D 1 110 ±4

Percentile 13 · #255 · provisoire

Préféré par les humains / Résout des tâches

1 103 / —

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

—

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

D Général 1 110 [1 106–1 113] Percentile 13 · #255 · composantes : 6 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/overall 1 105 ±3,12 1 105 ±3 27,4% 2026-10-02 —
LMArena text/hard_prompts 1 067 ±5,05 1 094 ±5 26,2% 2026-10-02 —
LMArena text/instruction_following 1 065 ±4,54 1 096 ±4 13,2% 2026-10-02 —
LMArena text/expert 1 029 ±14 1 091 ±11 9,2% 2026-10-02 —
LMArena text/multi_turn 1 080 ±6,58 1 109 ±6 6,2% 2026-10-02 —
LMArena text/longer_query 1 029 ±9,67 1 054 ±9 5,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Code 1 106 [1 096–1 116] Percentile 9 · #253 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/coding 1 078 ±6,43 1 094 ±6 89,3% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Maths 1 093 [1 083–1 104] Percentile 9 · #233 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 071 ±6,40 1 077 ±6 87,3% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Écriture 1 137 [1 127–1 146] Percentile 17 · #222 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 125 ±6,06 1 147 ±6 75,5% 2026-10-02 —
LMArena text/longer_query valeur aberrante 1 029 ±9,67 1 054 ±9 16,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : 繁體中文 1 093 [1 080–1 106] Percentile 5 · #211 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 036 ±8,78 1 085 ±7 92,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Deutsch 1 118 [1 094–1 140] Percentile 7 · #134 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/german 1 059 ±15 1 108 ±13 90,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : English 1 112 [1 105–1 120] Percentile 14 · #234 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 133 ±3,69 1 106 ±4 93,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Русский 1 128 [1 110–1 146] Percentile 7 · #217 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 083 ±11 1 122 ±10 91,7% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
vicuna-33b 1 110 D

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: vicuna-33b

Données CC BY 4.0 : conservez le lien vers fedi.software.