Przejdź do treści
fedi.software

DeepSeek V3.1 Terminus w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

B 1 390 ±6

Percentyl 62 · #111 · wstępny

Ludzie wolą / Rozwiązuje zadania

1 403 / —

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

+31

0,4525 USD za 1M tokenów, mediana dostawców: 8

Na twoim sprzęcie

Nie mieści się w konfiguracjach referencyjnych.

Rozkład wyniku

B Ogólny 1 390 [1 384–1 396] Percentyl 62 · #111 · składniki: 5 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/overall 1 420 ±5,16 1 420 ±5 32,1% 2026-10-02 thinking
LMArena text/hard_prompts 1 427 ±7,34 1 419 ±7 30,1% 2026-10-02 thinking
LMArena text/instruction_following 1 406 ±10 1 419 ±10 12,6% 2026-10-02 thinking
LMArena text/longer_query 1 425 ±11 1 424 ±11 6,0% 2026-10-02 thinking
LMArena text/multi_turn 1 411 ±12 1 409 ±11 5,7% 2026-10-02 thinking

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Programowanie 1 377 [1 359–1 395] Percentyl 56 · #122 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/coding 1 426 ±12 1 404 ±11 86,5% 2026-10-02 thinking

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Pisanie 1 407 [1 390–1 424] Percentyl 67 · #88 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 404 ±14 1 432 ±14 55,2% 2026-10-02 —
LMArena text/longer_query 1 425 ±11 1 424 ±11 35,0% 2026-10-02 thinking

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: English 1 404 [1 389–1 418] Percentyl 64 · #98 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 430 ±7,80 1 420 ±8 92,5% 2026-10-02 thinking

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
DeepSeek V3.1 Terminus 1 390 B

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: DeepSeek V3.1 Terminus

Dane CC BY 4.0: zachowaj link do fedi.software.