本文へスキップ
fedi.software

fedi-indexにおけるMercury 2

各カテゴリのスコア、その内訳、コスパ、ローカル実行、推移。

fedi-index · 総合

C 1,334 ±6

パーセンタイル 44 · #165 · 暫定

人間の評価 / タスク解決

1,344 / —

人間の投票とベンチマーク、Elo-eq

コスパ

-20

100万トークンあたり$0.375、3社のプロバイダーの中央値 · 公式 $0.375

手元のハードウェアで

クローズドウェイト:クラウドのみ。

スコアの内訳

C 総合 1,334 [1,328–1,340] パーセンタイル 44 · #165 · 要素数:5 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/overall 1,355 ±5.28 1,355 ±5 31.5% 2026-10-02 —
LMArena text/hard_prompts 1,362 ±6.78 1,360 ±6 30.3% 2026-10-02 —
LMArena text/instruction_following 1,328 ±9.76 1,345 ±9 12.8% 2026-10-02 —
LMArena text/longer_query 1,329 ±9.80 1,334 ±9 6.4% 2026-10-02 —
LMArena text/multi_turn 1,358 ±13 1,360 ±12 5.6% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

C コーディング 1,346 [1,338–1,353] パーセンタイル 42 · #163 · 要素数:2 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena webdev/overall 1,170 ±12 1,356 ±4 50.2% 2026-10-01 —
LMArena text/coding 1,391 ±10 1,373 ±9 38.7% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

C 文章作成 1,311 [1,296–1,327] パーセンタイル 40 · #162 · 要素数:2 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/creative_writing 1,288 ±13 1,314 ±13 54.9% 2026-10-02 —
LMArena text/longer_query 1,329 ±9.80 1,334 ±9 35.8% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

C 言語:English 1,353 [1,337–1,369] パーセンタイル 46 · #147 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/english 1,379 ±8.39 1,366 ±9 92.2% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

C 言語:Русский 1,308 [1,286–1,331] パーセンタイル 31 · #161 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/russian 1,303 ±14 1,320 ±12 90.4% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

推移

月別fedi-index
同じデータを表で表示
モデル 2026-10
Mercury 2 1,334 C

バッジ

モデルのfedi-indexをあなたのサイトやREADMEに表示できます。バッジは自動更新され、このページにリンクします。

fedi-index: Mercury 2

データはCC BY 4.0:fedi.softwareへのリンクを残してください。