本文へスキップ
fedi.software

fedi-indexにおけるDeepSeek V3.1 Terminus

各カテゴリのスコア、その内訳、コスパ、ローカル実行、推移。

fedi-index · 総合

B 1,390 ±6

パーセンタイル 62 · #111 · 暫定

人間の評価 / タスク解決

1,403 / —

人間の投票とベンチマーク、Elo-eq

コスパ

+31

100万トークンあたり$0.4525、8社のプロバイダーの中央値

手元のハードウェアで

参照環境のいずれにも収まりません。

スコアの内訳

B 総合 1,390 [1,384–1,396] パーセンタイル 62 · #111 · 要素数:5 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/overall 1,420 ±5.16 1,420 ±5 32.1% 2026-10-02 thinking
LMArena text/hard_prompts 1,427 ±7.34 1,419 ±7 30.1% 2026-10-02 thinking
LMArena text/instruction_following 1,406 ±10 1,419 ±10 12.6% 2026-10-02 thinking
LMArena text/longer_query 1,425 ±11 1,424 ±11 6.0% 2026-10-02 thinking
LMArena text/multi_turn 1,411 ±12 1,409 ±11 5.7% 2026-10-02 thinking

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B コーディング 1,377 [1,359–1,395] パーセンタイル 56 · #122 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/coding 1,426 ±12 1,404 ±11 86.5% 2026-10-02 thinking

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 文章作成 1,407 [1,390–1,424] パーセンタイル 67 · #88 · 要素数:2 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/creative_writing 1,404 ±14 1,432 ±14 55.2% 2026-10-02 —
LMArena text/longer_query 1,425 ±11 1,424 ±11 35.0% 2026-10-02 thinking

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:English 1,404 [1,389–1,418] パーセンタイル 64 · #98 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/english 1,430 ±7.80 1,420 ±8 92.5% 2026-10-02 thinking

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

推移

月別fedi-index
同じデータを表で表示
モデル 2026-10
DeepSeek V3.1 Terminus 1,390 B

バッジ

モデルのfedi-indexをあなたのサイトやREADMEに表示できます。バッジは自動更新され、このページにリンクします。

fedi-index: DeepSeek V3.1 Terminus

データはCC BY 4.0:fedi.softwareへのリンクを残してください。