Aller au contenu
fedi.software

DeepSeek V3.1 dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

B 1 377 ±10

Percentile 56 · #130

Préféré par les humains / Résout des tâches

1 399 / 1 340

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

+19

0,4525 $US par million de tokens, médiane de 19 fournisseurs

Sur votre matériel

Ne tient dans aucune configuration de référence.

Décomposition du score

B Général 1 377 [1 367–1 388] Percentile 56 · #130 · composantes : 7
Source Composante Valeur Elo-eq Poids Mesuré le Variante
Epoch AI eci 140 ±1,97 1 358 ±16 32,2% 2025-08-21 —
LMArena text/overall 1 420 ±3,09 1 420 ±3 18,4% 2026-10-02 —
LMArena text/hard_prompts 1 417 ±4,40 1 410 ±4 17,9% 2026-10-02 thinking
LMArena text/instruction_following 1 400 ±5,67 1 413 ±5 8,5% 2026-10-02 thinking
LMArena text/expert 1 403 ±13 1 397 ±10 6,5% 2026-10-02 thinking
LMArena text/longer_query 1 422 ±6,11 1 421 ±6 4,2% 2026-10-02 thinking
LMArena text/multi_turn 1 408 ±7,09 1 406 ±6 4,0% 2026-10-02 thinking

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Code 1 376 [1 365–1 386] Percentile 56 · #124 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/coding 1 417 ±6,88 1 397 ±6 89,2% 2026-10-02 thinking

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Maths 1 382 [1 367–1 398] Percentile 59 · #106 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 421 ±9,38 1 413 ±9 85,5% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Écriture 1 411 [1 401–1 420] Percentile 69 · #84 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 401 ±7,54 1 430 ±8 59,8% 2026-10-02 thinking
LMArena text/longer_query 1 422 ±6,11 1 421 ±6 33,1% 2026-10-02 thinking

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : 繁體中文 1 413 [1 400–1 427] Percentile 68 · #72 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 470 ±9,27 1 430 ±7 92,8% 2026-10-02 thinking

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Deutsch 1 391 [1 368–1 414] Percentile 52 · #70 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/german 1 411 ±15 1 411 ±13 90,2% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : English 1 408 [1 399–1 416] Percentile 66 · #92 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 432 ±4,59 1 422 ±5 93,5% 2026-10-02 thinking

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : Español 1 402 [1 377–1 427] Percentile 48 · #78 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/spanish 1 429 ±15 1 425 ±14 89,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : 日本語 1 388 [1 367–1 409] Percentile 44 · #72 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/japanese 1 374 ±16 1 407 ±12 90,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : 한국어 1 370 [1 348–1 392] Percentile 36 · #88 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/korean 1 337 ±16 1 387 ±12 90,6% 2026-10-02 thinking

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : Polski 1 400 [1 386–1 415] Percentile 44 · #74 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/polish 1 411 ±9,72 1 416 ±8 92,5% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

B Langue : Русский 1 395 [1 380–1 411] Percentile 58 · #98 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 405 ±9,47 1 411 ±8 92,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
DeepSeek V3.1 1 377 B

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: DeepSeek V3.1

Données CC BY 4.0 : conservez le lien vers fedi.software.