本文へスキップ
fedi.software

fedi-indexにおけるchatglm3-6b

各カテゴリのスコア、その内訳、コスパ、ローカル実行、推移。

fedi-index · 総合

D 1,014 ±7

パーセンタイル 3 · #284 · 暫定

人間の評価 / タスク解決

1,000 / —

人間の投票とベンチマーク、Elo-eq

コスパ

—

手元のハードウェアで

クローズドウェイト:クラウドのみ。

スコアの内訳

D 総合 1,014 [1,007–1,022] パーセンタイル 3 · #284 · 要素数:4 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/overall 972 ±5.90 972 ±6 35.0% 2026-10-02 —
LMArena text/hard_prompts 953 ±10 991 ±9 29.5% 2026-10-02 —
LMArena text/instruction_following 954 ±8.97 990 ±8 15.3% 2026-10-02 —
LMArena text/multi_turn 962 ±13 1,001 ±12 6.2% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D コーディング 1,023 [1,003–1,043] パーセンタイル 3 · #270 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/coding 964 ±13 993 ±12 85.5% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 数学 1,032 [1,014–1,051] パーセンタイル 3 · #247 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/math 989 ±12 999 ±11 83.5% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 文章作成 1,009 [988–1,030] パーセンタイル 3 · #261 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/creative_writing 970 ±12 989 ±12 90.7% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 言語:English 985 [972–998] パーセンタイル 3 · #265 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/english 1,003 ±6.48 969 ±7 93.0% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

推移

月別fedi-index
同じデータを表で表示
モデル 2026-10
chatglm3-6b 1,014 D

バッジ

モデルのfedi-indexをあなたのサイトやREADMEに表示できます。バッジは自動更新され、このページにリンクします。

fedi-index: chatglm3-6b

データはCC BY 4.0:fedi.softwareへのリンクを残してください。