Gå til indhold
fedi.software

DeepSeek V4 Pro 0423 i fedi-index

Scoren i hvert udsnit, hvad den består af, værdi, lokal kørsel og historik.

fedi-index · Generelt

A 1.427 ±5

Percentil 82 · #54

Folk foretrækker / Løser opgaver

1.437 / 1.415

Menneskelige stemmer vs. benchmarks, Elo-eq

Værdi

+33

1,91 US$ pr. 1M tokens, median af 49 udbydere

På din hardware

Passer ikke i referenceopsætningerne.

Opdeling af scoren

A Generelt 1.427 [1.422–1.432] Percentil 82 · #54 · komponenter: 9
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
Epoch AI eci 149 ±0,87 1.431 ±7 34,5% 2026-04-24 —
LMArena text/overall 1.451 ±1,98 1.451 ±2 15,6% 2026-10-02 —
LMArena text/hard_prompts 1.461 ±2,33 1.450 ±2 15,6% 2026-10-02 —
LMArena text/expert 1.463 ±4,29 1.446 ±4 7,5% 2026-10-02 —
LMArena text/instruction_following 1.447 ±5,25 1.458 ±5 7,2% 2026-10-02 high
Epoch AI simpleqa_verified nedvægtning ×0,61 0,47 ±0,02 1.445 ±5 3,8% 2026-08-27 max
LMArena text/multi_turn 1.467 ±3,57 1.460 ±3 3,8% 2026-10-02 —
LMArena text/longer_query 1.458 ±4,71 1.454 ±4 3,7% 2026-10-02 high
Epoch AI gpqa_diamond nedvægtning ×0,26 0,91 ±0,02 1.463 ±10 1,3% 2026-08-06 high

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Kodning 1.439 [1.434–1.444] Percentil 90 · #30 · komponenter: 3
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena webdev/overall 1.583 ±4,76 1.473 ±1 40,6% 2026-10-01 high
LMArena text/coding 1.469 ±5,79 1.443 ±5 36,6% 2026-10-02 high
Epoch AI swe_bench_verified nedvægtning ×0,37 0,78 ±0,02 1.472 ±10 14,2% 2026-06-18 max

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Agenter 1.435 [1.428–1.442] Percentil 54 · #27 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena agent/overall 0,01 ±0,01 1.461 ±4 90,0% 2026-10-02 high-0813

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Matematik 1.413 [1.407–1.420] Percentil 79 · #54 · komponenter: 3
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/math 1.455 ±6,01 1.446 ±6 49,7% 2026-10-02 high
Epoch AI frontiermath_t1_3 nedvægtning ×0,86 0,45 ±0,03 1.419 ±6 27,8% 2026-06-17 max
Epoch AI frontiermath_t4 nedvægtning ×0,86 0,02 ±0,02 1.396 ±4 15,4% 2026-06-17 max

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Skrivning 1.452 [1.446–1.457] Percentil 87 · #36 · komponenter: 2 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/creative_writing 1.446 ±3,69 1.475 ±4 62,9% 2026-10-02 —
LMArena text/longer_query 1.458 ±4,71 1.454 ±4 30,8% 2026-10-02 high

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: 繁體中文 1.427 [1.419–1.435] Percentil 76 · #54 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/chinese 1.486 ±5,57 1.442 ±4 93,6% 2026-10-02 high

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: Deutsch 1.432 [1.417–1.447] Percentil 80 · #30 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/german 1.457 ±9,86 1.451 ±8 92,4% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: English 1.436 [1.430–1.440] Percentil 86 · #39 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/english 1.459 ±2,60 1.450 ±3 93,9% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: Español 1.434 [1.421–1.447] Percentil 80 · #31 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/spanish 1.458 ±7,78 1.452 ±7 92,9% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

B Sprog: Français 1.435 [1.422–1.447] Percentil 78 · #31 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/french 1.472 ±7,44 1.452 ±7 93,0% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: 日本語 1.441 [1.425–1.458] Percentil 84 · #21 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/japanese 1.447 ±12 1.462 ±9 92,2% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: Polski 1.441 [1.427–1.455] Percentil 84 · #22 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/polish 1.462 ±9,13 1.459 ±8 92,7% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

A Sprog: Русский 1.439 [1.432–1.446] Percentil 84 · #39 · komponenter: 1 foreløbig
Kilde Komponent Værdi Elo-eq Vægt Målt Variant
LMArena text/russian 1.453 ±4,18 1.455 ±4 93,8% 2026-10-02 —

Vægt er komponentens andel af scoren (resten er priorværdien, der trækker modeller med få data mod populationens median). Metodik

Historik

fedi-index pr. måned
Det samme i en tabel
Model 2026-10
DeepSeek V4 Pro 0423 1.427 A

Badge

Vis modellens fedi-index på dit website eller i en README. Badget opdaterer sig selv og linker til denne side.

fedi-index: DeepSeek V4 Pro 0423

Data CC BY 4.0: behold linket til fedi.software.