本文へスキップ
fedi.software

fedi-indexにおけるchatglm-6b

各カテゴリのスコア、その内訳、コスパ、ローカル実行、推移。

fedi-index · 総合

D 969 ±8

パーセンタイル 1 · #289 · 暫定

人間の評価 / タスク解決

951 / —

人間の投票とベンチマーク、Elo-eq

コスパ

—

手元のハードウェアで

クローズドウェイト:クラウドのみ。

スコアの内訳

D 総合 969 [962–977] パーセンタイル 1 · #289 · 要素数:4 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/overall 918 ±6.24 918 ±6 35.2% 2026-10-02 —
LMArena text/hard_prompts 901 ±11 944 ±10 29.2% 2026-10-02 —
LMArena text/instruction_following 902 ±8.90 941 ±8 15.7% 2026-10-02 —
LMArena text/multi_turn 856 ±15 906 ±14 5.7% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D コーディング 989 [969–1,009] パーセンタイル 1 · #274 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/coding 919 ±13 953 ±12 85.5% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 数学 984 [964–1,004] パーセンタイル 2 · #249 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/math 926 ±13 938 ±12 82.7% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 文章作成 945 [923–967] パーセンタイル 0 · #267 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/creative_writing 900 ±12 918 ±12 90.4% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 言語:English 922 [909–935] パーセンタイル 1 · #271 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/english 938 ±6.84 900 ±7 92.8% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

推移

月別fedi-index
同じデータを表で表示
モデル 2026-10
chatglm-6b 969 D

バッジ

モデルのfedi-indexをあなたのサイトやREADMEに表示できます。バッジは自動更新され、このページにリンクします。

fedi-index: chatglm-6b

データはCC BY 4.0:fedi.softwareへのリンクを残してください。