本文へスキップ
fedi.software

fedi-indexにおけるDeepSeek V3.2 Exp

各カテゴリのスコア、その内訳、コスパ、ローカル実行、推移。

fedi-index · 総合

B 1,395 ±8

パーセンタイル 65 · #102

人間の評価 / タスク解決

1,406 / 1,383

人間の投票とベンチマーク、Elo-eq

コスパ

+46

100万トークンあたり$0.305、7社のプロバイダーの中央値

手元のハードウェアで

参照環境のいずれにも収まりません。

スコアの内訳

B 総合 1,395 [1,387–1,403] パーセンタイル 65 · #102 · 要素数:7
ソース 要素 値 Elo-eq 重み 測定日 バリアント
Epoch AI eci 145 ±1.17 1,398 ±9 41.8% 2025-09-29 —
LMArena text/overall 1,425 ±3.35 1,425 ±3 15.7% 2026-10-02 thinking
LMArena text/hard_prompts 1,429 ±4.03 1,421 ±4 15.6% 2026-10-02 —
LMArena text/instruction_following 1,401 ±5.22 1,414 ±5 7.4% 2026-10-02 —
LMArena text/expert 1,420 ±14 1,411 ±12 5.1% 2026-10-02 thinking
LMArena text/longer_query 1,419 ±5.43 1,418 ±5 3.7% 2026-10-02 —
LMArena text/multi_turn 1,422 ±6.60 1,419 ±6 3.6% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B コーディング 1,379 [1,374–1,385] パーセンタイル 57 · #121 · 要素数:2 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena webdev/overall 1,272 ±6.87 1,385 ±2 47.9% 2026-10-01 —
LMArena text/coding 1,439 ±6.79 1,416 ±6 41.9% 2026-10-02 thinking

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 数学 1,381 [1,364–1,397] パーセンタイル 57 · #110 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/math 1,420 ±10 1,412 ±10 84.9% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 文章作成 1,412 [1,402–1,421] パーセンタイル 70 · #82 · 要素数:2 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/creative_writing 1,404 ±7.40 1,433 ±8 59.5% 2026-10-02 —
LMArena text/longer_query 1,419 ±5.43 1,418 ±5 33.5% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:繁體中文 1,404 [1,385–1,423] パーセンタイル 60 · #91 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/chinese 1,462 ±13 1,423 ±11 91.4% 2026-10-02 thinking

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:English 1,416 [1,407–1,426] パーセンタイル 71 · #81 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/english 1,441 ±4.85 1,431 ±5 93.5% 2026-10-02 thinking

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:Español 1,410 [1,385–1,436] パーセンタイル 53 · #70 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/spanish 1,440 ±16 1,436 ±15 89.1% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:Polski 1,415 [1,392–1,437] パーセンタイル 56 · #58 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/polish 1,435 ±15 1,437 ±12 90.4% 2026-10-02 thinking

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:Русский 1,398 [1,380–1,416] パーセンタイル 60 · #95 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/russian 1,410 ±11 1,416 ±10 91.7% 2026-10-02 thinking

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

推移

月別fedi-index
同じデータを表で表示
モデル 2026-10
DeepSeek V3.2 Exp 1,395 B

バッジ

モデルのfedi-indexをあなたのサイトやREADMEに表示できます。バッジは自動更新され、このページにリンクします。

fedi-index: DeepSeek V3.2 Exp

データはCC BY 4.0:fedi.softwareへのリンクを残してください。