跳到主要內容
fedi.software

GPT-6 Sol 的 fedi-index

各分項分數、組成內容、性價比、本機執行與歷史。

fedi-index · 綜合

A 1,434 ±8

百分位 84 · #49

人類偏好 / 解題能力

1,397 / 1,494

人類投票與基準測試,Elo-eq

性價比

+22

每 100 萬 token US$4,22 家供應商中位數 · 原廠 US$4

在你的硬體上

封閉權重:僅限雲端。

分數拆解

A 綜合 1,434 [1,426–1,441] 百分位 84 · #49 · 分項:9
來源 分項 數值 Elo-eq 權重 測量日期 變體
Epoch AI eci 163 ±1.66 1,538 ±13 27.6% 2026-09-22 —
LMArena text/overall 1,395 ±3.54 1,395 ±4 17.5% 2026-10-02 max
LMArena text/hard_prompts 1,419 ±4.34 1,412 ±4 17.3% 2026-10-02 max
LMArena text/instruction_following 1,413 ±5.66 1,425 ±5 8.2% 2026-10-02 max
LMArena text/expert 1,439 ±9.92 1,426 ±8 7.2% 2026-10-02 max
Epoch AI simpleqa_verified 衰減 ×0.61 0.61 ±0.02 1,488 ±5 4.5% 2026-09-22 max
LMArena text/longer_query 1,414 ±5.24 1,413 ±5 4.2% 2026-10-02 max
LMArena text/multi_turn 1,413 ±8.43 1,411 ±8 3.7% 2026-10-02 max
Epoch AI gpqa_diamond 衰減 ×0.26 0.94 ±0.01 1,478 ±7 1.8% 2026-09-22 max

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

A 程式設計 1,444 [1,440–1,448] 百分位 91 · #25 · 分項:2 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena webdev/overall 1,689 ±5.84 1,503 ±2 60.7% 2026-10-01 max
LMArena text/coding 離群值 1,448 ±6.78 1,424 ±6 26.5% 2026-10-02 max

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

A 代理 1,470 [1,460–1,480] 百分位 90 · #7 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena agent/overall 0.10 ±0.01 1,502 ±6 89.3% 2026-10-02 max

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

A 數學 1,447 [1,436–1,458] 百分位 90 · #26 · 分項:3
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/math 1,407 ±14 1,400 ±13 38.6% 2026-10-02 max
Epoch AI frontiermath_t1_3 衰減 ×0.86 0.90 ±0.02 1,516 ±4 37.4% 2026-09-22 max
Epoch AI frontiermath_t4 衰減 ×0.86 0.90 ±0.05 1,536 ±8 15.3% 2026-09-22 max

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

B 寫作 1,397 [1,388–1,406] 百分位 64 · #98 · 分項:2 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/creative_writing 1,382 ±7.40 1,410 ±8 59.4% 2026-10-02 max
LMArena text/longer_query 1,414 ±5.24 1,413 ±5 33.7% 2026-10-02 max

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

C 語言:繁體中文 1,362 [1,345–1,379] 百分位 42 · #130 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/chinese 1,403 ±12 1,376 ±9 92.0% 2026-10-02 max

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

B 語言:English 1,374 [1,364–1,384] 百分位 55 · #123 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/english 1,398 ±5.37 1,386 ±6 93.3% 2026-10-02 max

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

C 語言:Español 1,361 [1,334–1,387] 百分位 26 · #111 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/spanish 1,381 ±17 1,381 ±15 88.7% 2026-10-02 max

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

B 語言:Русский 1,399 [1,385–1,414] 百分位 60 · #93 · 分項:1 暫定
來源 分項 數值 Elo-eq 權重 測量日期 變體
LMArena text/russian 1,409 ±8.84 1,415 ±8 92.6% 2026-10-02 max

權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論

歷史

fedi-index 每月變化
表格檢視
模型 2026-10
GPT-6 Sol 1,434 A

徽章

在你的網站或 README 中顯示模型的 fedi-index。徽章會自動更新,並連結到本頁。

fedi-index: GPT-6 Sol

資料採 CC BY 4.0:請保留指向 fedi.software 的連結。