fedi-indexにおけるDeepSeek V3.1 Terminus
各カテゴリのスコア、その内訳、コスパ、ローカル実行、推移。
fedi-index · 総合
B 1,390 ±6
パーセンタイル 62 · #111 · 暫定
人間の評価 / タスク解決
1,403 / —
人間の投票とベンチマーク、Elo-eq
コスパ
+31
100万トークンあたり$0.4525、8社のプロバイダーの中央値
手元のハードウェアで
参照環境のいずれにも収まりません。
スコアの内訳
B 総合 1,390 [1,384–1,396] パーセンタイル 62 · #111 · 要素数:5 暫定
| ソース | 要素 | 値 | Elo-eq | 重み | 測定日 | バリアント |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1,420 ±5.16 | 1,420 ±5 | 32.1% | 2026-10-02 | thinking |
| LMArena |
text/hard_prompts
|
1,427 ±7.34 | 1,419 ±7 | 30.1% | 2026-10-02 | thinking |
| LMArena |
text/instruction_following
|
1,406 ±10 | 1,419 ±10 | 12.6% | 2026-10-02 | thinking |
| LMArena |
text/longer_query
|
1,425 ±11 | 1,424 ±11 | 6.0% | 2026-10-02 | thinking |
| LMArena |
text/multi_turn
|
1,411 ±12 | 1,409 ±11 | 5.7% | 2026-10-02 | thinking |
重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法
B コーディング 1,377 [1,359–1,395] パーセンタイル 56 · #122 · 要素数:1 暫定
| ソース | 要素 | 値 | Elo-eq | 重み | 測定日 | バリアント |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1,426 ±12 | 1,404 ±11 | 86.5% | 2026-10-02 | thinking |
重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法
B 文章作成 1,407 [1,390–1,424] パーセンタイル 67 · #88 · 要素数:2 暫定
| ソース | 要素 | 値 | Elo-eq | 重み | 測定日 | バリアント |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1,404 ±14 | 1,432 ±14 | 55.2% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1,425 ±11 | 1,424 ±11 | 35.0% | 2026-10-02 | thinking |
重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法
B 言語:English 1,404 [1,389–1,418] パーセンタイル 64 · #98 · 要素数:1 暫定
| ソース | 要素 | 値 | Elo-eq | 重み | 測定日 | バリアント |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1,430 ±7.80 | 1,420 ±8 | 92.5% | 2026-10-02 | thinking |
重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法
推移
同じデータを表で表示
| モデル | 2026-10 |
|---|---|
| DeepSeek V3.1 Terminus | 1,390 B |
バッジ
モデルのfedi-indexをあなたのサイトやREADMEに表示できます。バッジは自動更新され、このページにリンクします。
データはCC BY 4.0:fedi.softwareへのリンクを残してください。