本文へスキップ
fedi.software

fedi-indexにおけるgrok-3-preview-02-24

各カテゴリのスコア、その内訳、コスパ、ローカル実行、推移。

fedi-index · 総合

B 1,398 ±3

パーセンタイル 66 · #99 · 暫定

人間の評価 / タスク解決

1,410 / —

人間の投票とベンチマーク、Elo-eq

コスパ

-24

100万トークンあたり$6、1社のプロバイダーの中央値

手元のハードウェアで

クローズドウェイト:クラウドのみ。

スコアの内訳

B 総合 1,398 [1,395–1,400] パーセンタイル 66 · #99 · 要素数:6 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/overall 1,426 ±2.20 1,426 ±2 26.1% 2026-10-02 —
LMArena text/hard_prompts 1,433 ±3.24 1,425 ±3 25.7% 2026-10-02 —
LMArena text/instruction_following 1,409 ±3.36 1,421 ±3 12.8% 2026-10-02 —
LMArena text/expert 1,420 ±7.68 1,411 ±6 11.4% 2026-10-02 —
LMArena text/longer_query 1,439 ±4.42 1,437 ±4 6.2% 2026-10-02 —
LMArena text/multi_turn 1,424 ±4.58 1,421 ±4 6.2% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B コーディング 1,389 [1,382–1,396] パーセンタイル 62 · #107 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/coding 1,432 ±4.24 1,410 ±4 90.0% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

C 数学 1,361 [1,352–1,371] パーセンタイル 49 · #130 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/math 1,390 ±5.66 1,384 ±5 87.6% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 文章作成 1,426 [1,419–1,432] パーセンタイル 77 · #62 · 要素数:2 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/creative_writing 1,414 ±4.66 1,443 ±5 61.9% 2026-10-02 —
LMArena text/longer_query 1,439 ±4.42 1,437 ±4 31.7% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:繁體中文 1,398 [1,388–1,408] パーセンタイル 55 · #100 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/chinese 1,448 ±6.96 1,412 ±6 93.4% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:Deutsch 1,411 [1,394–1,428] パーセンタイル 65 · #51 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/german 1,431 ±11 1,429 ±10 92.0% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:English 1,414 [1,409–1,420] パーセンタイル 69 · #85 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/english 1,438 ±2.78 1,428 ±3 93.9% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

C 言語:Español 1,392 [1,367–1,417] パーセンタイル 44 · #84 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/spanish 1,417 ±15 1,414 ±14 89.4% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:Français 1,416 [1,391–1,442] パーセンタイル 58 · #57 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/french 1,460 ±16 1,442 ±14 89.3% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:日本語 1,402 [1,387–1,416] パーセンタイル 54 · #60 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/japanese 1,388 ±11 1,418 ±8 92.6% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:한국어 1,397 [1,378–1,416] パーセンタイル 51 · #67 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/korean 1,374 ±14 1,416 ±11 91.5% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:Polski 1,419 [1,407–1,431] パーセンタイル 65 · #46 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/polish 1,433 ±7.86 1,435 ±7 93.0% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

B 言語:Русский 1,407 [1,398–1,416] パーセンタイル 64 · #84 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/russian 1,416 ±5.67 1,421 ±5 93.5% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

推移

月別fedi-index
同じデータを表で表示
モデル 2026-10
grok-3-preview-02-24 1,398 B

バッジ

モデルのfedi-indexをあなたのサイトやREADMEに表示できます。バッジは自動更新され、このページにリンクします。

fedi-index: grok-3-preview-02-24

データはCC BY 4.0:fedi.softwareへのリンクを残してください。