llama2-70b-steerlm-chat 的 fedi-index
各分項分數、組成內容、性價比、本機執行與歷史。
fedi-index · 綜合
D 1,105 ±8
百分位 11 · #262 · 暫定
人類偏好 / 解題能力
1,097 / —
人類投票與基準測試,Elo-eq
性價比
—
在你的硬體上
封閉權重:僅限雲端。
分數拆解
D 綜合 1,105 [1,097–1,112] 百分位 11 · #262 · 分項:4 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1,098 ±6.35 | 1,098 ±6 | 34.9% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1,047 ±10 | 1,076 ±9 | 29.6% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1,061 ±9.15 | 1,091 ±9 | 15.4% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1,058 ±14 | 1,088 ±13 | 5.9% | 2026-10-02 | — |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
D 程式設計 1,070 [1,049–1,092] 百分位 5 · #263 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1,025 ±14 | 1,047 ±13 | 84.8% | 2026-10-02 | — |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
D 數學 1,101 [1,080–1,122] 百分位 9 · #232 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1,072 ±14 | 1,078 ±13 | 82.0% | 2026-10-02 | — |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
D 寫作 1,121 [1,098–1,144] 百分位 13 · #233 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1,091 ±12 | 1,112 ±13 | 90.3% | 2026-10-02 | — |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
D 語言:English 1,100 [1,087–1,113] 百分位 12 · #240 · 分項:1 暫定
| 來源 | 分項 | 數值 | Elo-eq | 權重 | 測量日期 | 變體 |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1,120 ±6.99 | 1,092 ±7 | 92.8% | 2026-10-02 | — |
權重是該分項在分數中的占比(其餘為先驗值,會把資料少的模型拉向母體中位數)。 方法論
歷史
表格檢視
| 模型 | 2026-10 |
|---|---|
| llama2-70b-steerlm-chat | 1,105 D |
徽章
在你的網站或 README 中顯示模型的 fedi-index。徽章會自動更新,並連結到本頁。
資料採 CC BY 4.0:請保留指向 fedi.software 的連結。