Claude Opus 4.6 的 fedi-index
各分項分數、組成內容、性價比、本機執行與歷史。
fedi-index · 綜合
S 1,476 ±5
百分位 98 · #6
人類偏好 / 解題能力
1,492 / 1,452
人類投票與基準測試,Elo-eq
性價比
+41
每 100 萬 token US$10,36 家供應商中位數 · 原廠 US$10
在你的硬體上
封閉權重:僅限雲端。
分數拆解
S 綜合 1,476 [1,470–1,481] 百分位 98 · #6 · 分項:9
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
155 ±1.00 | 1,479 ±8 | 32.9% | 2026-02-05 | — |
| LMArena |
text/overall
|
1,503 ±1.73 | 1,503 ±2 | 15.8% | 2026-10-02 | high |
| LMArena |
text/hard_prompts
|
1,527 ±2.11 | 1,509 ±2 | 15.8% | 2026-10-02 | high |
| LMArena |
text/instruction_following
|
1,524 ±2.62 | 1,530 ±2 | 7.8% | 2026-10-02 | high |
| LMArena |
text/expert
|
1,546 ±4.09 | 1,514 ±3 | 7.6% | 2026-10-02 | high |
| LMArena |
text/longer_query
|
1,520 ±2.49 | 1,512 ±2 | 3.9% | 2026-10-02 | high |
| LMArena |
text/multi_turn
|
1,513 ±3.22 | 1,502 ±3 | 3.9% | 2026-10-02 | high |
| Epoch AI |
simpleqa_verified
衰減 ×0.61 |
0.47 ±0.02 | 1,445 ±5 | 3.8% | 2026-08-27 | max |
| Epoch AI |
gpqa_diamond
衰減 ×0.26 |
0.91 ±0.02 | 1,461 ±8 | 1.5% | 2026-02-06 | 32k |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
S 程式設計 1,458 [1,455–1,462] 百分位 95 · #14 · 分項:3
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1,546 ±2.78 | 1,463 ±1 | 39.4% | 2026-10-01 | high |
| LMArena |
text/coding
|
1,535 ±2.79 | 1,501 ±2 | 38.5% | 2026-10-02 | high |
| Epoch AI |
swe_bench_verified
衰減 ×0.37 |
0.79 ±0.02 | 1,477 ±10 | 13.9% | 2026-02-18 | — |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
D 代理 1,407 [1,395–1,418] 百分位 25 · #43 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| τ²-bench (Sierra) |
tau2/banking_knowledge
衰減 ×0.76 |
0.27 ±0.05 | 1,459 ±8 | 79.5% | 2026-05-06 | max |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
S 數學 1,464 [1,457–1,470] 百分位 96 · #11 · 分項:3
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1,517 ±5.04 | 1,506 ±5 | 53.0% | 2026-10-02 | high |
| Epoch AI |
frontiermath_t1_3
衰減 ×0.86 |
0.66 ±0.03 | 1,464 ±6 | 28.9% | 2026-06-11 | max |
| Epoch AI |
frontiermath_t4
衰減 ×0.86 |
0.27 ±0.07 | 1,435 ±11 | 10.8% | 2026-06-11 | max |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
A 視覺 1,474 [1,470–1,478] 百分位 96 · #5 · 分項:3 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1,316 ±3.28 | 1,489 ±3 | 62.9% | 2026-10-02 | high |
| LMArena |
vision/ocr
|
1,327 ±3.20 | 1,497 ±3 | 15.7% | 2026-10-02 | — |
| LMArena |
vision/diagram
|
1,340 ±4.46 | 1,499 ±4 | 15.3% | 2026-10-02 | — |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
A 寫作 1,508 [1,504–1,513] 百分位 99 · #3 · 分項:2 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1,506 ±3.26 | 1,537 ±3 | 62.1% | 2026-10-02 | high |
| LMArena |
text/longer_query
|
1,520 ±2.49 | 1,512 ±2 | 31.8% | 2026-10-02 | high |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
A 語言:繁體中文 1,476 [1,470–1,483] 百分位 98 · #5 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1,552 ±4.60 | 1,494 ±4 | 93.8% | 2026-10-02 | high |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
A 語言:Deutsch 1,471 [1,457–1,485] 百分位 99 · #3 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1,504 ±9.03 | 1,492 ±8 | 92.6% | 2026-10-02 | high |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
A 語言:English 1,488 [1,484–1,493] 百分位 100 · #2 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1,512 ±2.32 | 1,506 ±2 | 94.0% | 2026-10-02 | high |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
A 語言:Español 1,480 [1,470–1,491] 百分位 99 · #2 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1,510 ±6.48 | 1,501 ±6 | 93.2% | 2026-10-02 | — |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
A 語言:Français 1,470 [1,458–1,482] 百分位 99 · #2 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1,513 ±7.01 | 1,490 ±6 | 93.1% | 2026-10-02 | high |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
A 語言:日本語 1,467 [1,452–1,483] 百分位 93 · #10 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1,484 ±11 | 1,489 ±8 | 92.4% | 2026-10-02 | high |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
A 語言:한국어 1,465 [1,453–1,477] 百分位 98 · #4 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1,465 ±8.74 | 1,484 ±7 | 93.0% | 2026-10-02 | — |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
A 語言:Polski 1,469 [1,457–1,482] 百分位 98 · #4 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1,497 ±7.91 | 1,489 ±7 | 93.0% | 2026-10-02 | high |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
A 語言:Русский 1,476 [1,470–1,482] 百分位 97 · #8 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1,497 ±3.64 | 1,494 ±3 | 93.9% | 2026-10-02 | high |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
歷史
表格檢視
| 模型 | 2026-10 |
|---|---|
| Claude Opus 4.6 | 1,476 S |
徽章
在你的網站或 README 中顯示模型的 fedi-index。徽章會自動更新,並連結到本頁。
資料採 CC BY 4.0:請保留指向 fedi.software 的連結。