跳到主要內容
fedi.software

DeepSeek V4 Pro 0423 的 fedi-index

各分項分數、組成內容、性價比、本機執行與歷史。

fedi-index · 綜合

A 1,427 ±5

百分位 82 · #54

人類偏好 / 解題能力

1,437 / 1,415

人類投票與基準測試,Elo-eq

性價比

+33

每 100 萬 token US$1.91,49 家供應商中位數

在你的硬體上

參考配置皆無法載入。

分數拆解

A 綜合 1,427 [1,422–1,432] 百分位 82 · #54 · 分項:9
來源 分項 數值 Elo-eq 權重 測量日期 變體
Epoch AI eci 149 ±0.87 1,431 ±7 34.5% 2026-04-24 —
LMArena text/overall 1,451 ±1.98 1,451 ±2 15.6% 2026-10-02 —
LMArena text/hard_prompts 1,461 ±2.33 1,450 ±2 15.6% 2026-10-02 —
LMArena text/expert 1,463 ±4.29 1,446 ±4 7.5% 2026-10-02 —
LMArena text/instruction_following 1,447 ±5.25 1,458 ±5 7.2% 2026-10-02 high
Epoch AI simpleqa_verified 衰減 ×0.61 0.47 ±0.02 1,445 ±5 3.8% 2026-08-27 max
LMArena text/multi_turn 1,467 ±3.57 1,460 ±3 3.8% 2026-10-02 —
LMArena text/longer_query 1,458 ±4.71 1,454 ±4 3.7% 2026-10-02 high
Epoch AI gpqa_diamond 衰減 ×0.26 0.91 ±0.02 1,463 ±10 1.3% 2026-08-06 high

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

A 程式設計 1,439 [1,434–1,444] 百分位 90 · #30 · 分項:3
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena webdev/overall 1,583 ±4.76 1,473 ±1 40.6% 2026-10-01 high
LMArena text/coding 1,469 ±5.79 1,443 ±5 36.6% 2026-10-02 high
Epoch AI swe_bench_verified 衰減 ×0.37 0.78 ±0.02 1,472 ±10 14.2% 2026-06-18 max

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

B 代理 1,435 [1,428–1,442] 百分位 54 · #27 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena agent/overall 0.01 ±0.01 1,461 ±4 90.0% 2026-10-02 high-0813

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

B 數學 1,413 [1,407–1,420] 百分位 79 · #54 · 分項:3
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/math 1,455 ±6.01 1,446 ±6 49.7% 2026-10-02 high
Epoch AI frontiermath_t1_3 衰減 ×0.86 0.45 ±0.03 1,419 ±6 27.8% 2026-06-17 max
Epoch AI frontiermath_t4 衰減 ×0.86 0.02 ±0.02 1,396 ±4 15.4% 2026-06-17 max

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

A 寫作 1,452 [1,446–1,457] 百分位 87 · #36 · 分項:2 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/creative_writing 1,446 ±3.69 1,475 ±4 62.9% 2026-10-02 —
LMArena text/longer_query 1,458 ±4.71 1,454 ±4 30.8% 2026-10-02 high

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

B 語言:繁體中文 1,427 [1,419–1,435] 百分位 76 · #54 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/chinese 1,486 ±5.57 1,442 ±4 93.6% 2026-10-02 high

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

B 語言:Deutsch 1,432 [1,417–1,447] 百分位 80 · #30 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/german 1,457 ±9.86 1,451 ±8 92.4% 2026-10-02 —

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

A 語言:English 1,436 [1,430–1,440] 百分位 86 · #39 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/english 1,459 ±2.60 1,450 ±3 93.9% 2026-10-02 —

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

B 語言:Español 1,434 [1,421–1,447] 百分位 80 · #31 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/spanish 1,458 ±7.78 1,452 ±7 92.9% 2026-10-02 —

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

B 語言:Français 1,435 [1,422–1,447] 百分位 78 · #31 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/french 1,472 ±7.44 1,452 ±7 93.0% 2026-10-02 —

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

A 語言:日本語 1,441 [1,425–1,458] 百分位 84 · #21 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/japanese 1,447 ±12 1,462 ±9 92.2% 2026-10-02 —

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

A 語言:Polski 1,441 [1,427–1,455] 百分位 84 · #22 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/polish 1,462 ±9.13 1,459 ±8 92.7% 2026-10-02 —

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

A 語言:Русский 1,439 [1,432–1,446] 百分位 84 · #39 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/russian 1,453 ±4.18 1,455 ±4 93.8% 2026-10-02 —

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

歷史

fedi-index 每月變化
表格檢視
模型 2026-10
DeepSeek V4 Pro 0423 1,427 A

徽章

在你的網站或 README 中顯示模型的 fedi-index。徽章會自動更新,並連結到本頁。

fedi-index: DeepSeek V4 Pro 0423

資料採 CC BY 4.0:請保留指向 fedi.software 的連結。