Aller au contenu
fedi.software

phi-3-medium-4k-instruct dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

D 1 149 ±3

Percentile 18 · #239 · provisoire

Préféré par les humains / Résout des tâches

1 146 / —

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

-199

0,2975 $US par million de tokens, médiane de 1 fournisseurs

Sur votre matériel

Poids fermés : cloud uniquement.

Décomposition du score

D Général 1 149 [1 146–1 152] Percentile 18 · #239 · composantes : 6 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/overall 1 138 ±2,61 1 138 ±3 26,5% 2026-10-02 —
LMArena text/hard_prompts 1 127 ±4,11 1 148 ±4 25,7% 2026-10-02 —
LMArena text/instruction_following 1 114 ±3,74 1 142 ±4 12,9% 2026-10-02 —
LMArena text/expert 1 108 ±9,08 1 156 ±7 11,0% 2026-10-02 —
LMArena text/multi_turn 1 088 ±5,58 1 116 ±5 6,1% 2026-10-02 —
LMArena text/longer_query 1 120 ±6,60 1 139 ±6 5,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Code 1 147 [1 139–1 155] Percentile 16 · #235 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/coding 1 130 ±5,19 1 141 ±5 89,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Maths 1 179 [1 170–1 188] Percentile 21 · #201 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 173 ±5,38 1 176 ±5 87,7% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Écriture 1 137 [1 129–1 145] Percentile 18 · #221 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 107 ±5,49 1 128 ±6 62,7% 2026-10-02 —
LMArena text/longer_query 1 120 ±6,60 1 139 ±6 30,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : 繁體中文 1 146 [1 136–1 156] Percentile 11 · #199 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 108 ±6,55 1 142 ±5 93,5% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Deutsch 1 149 [1 132–1 166] Percentile 10 · #129 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/german 1 101 ±11 1 144 ±9 92,0% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : English 1 148 [1 141–1 154] Percentile 20 · #219 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 169 ±3,36 1 144 ±4 93,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Español 1 126 [1 100–1 151] Percentile 4 · #143 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/spanish 1 095 ±16 1 116 ±15 89,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Français 1 130 [1 102–1 158] Percentile 4 · #129 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/french 1 109 ±18 1 120 ±16 88,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : 日本語 1 163 [1 146–1 180] Percentile 8 · #118 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/japanese 1 042 ±12 1 159 ±9 92,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : 한국어 1 105 [1 087–1 123] Percentile 3 · #132 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/korean 954 ±13 1 096 ±10 91,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Русский 1 179 [1 170–1 189] Percentile 12 · #206 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 145 ±5,83 1 178 ±5 93,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
phi-3-medium-4k-instruct 1 149 D

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: phi-3-medium-4k-instruct

Données CC BY 4.0 : conservez le lien vers fedi.software.