本文へスキップ
fedi.software

fedi-indexにおけるphi-3-medium-4k-instruct

各カテゴリのスコア、その内訳、コスパ、ローカル実行、推移。

fedi-index · 総合

D 1,149 ±3

パーセンタイル 18 · #239 · 暫定

人間の評価 / タスク解決

1,146 / —

人間の投票とベンチマーク、Elo-eq

コスパ

-199

100万トークンあたり$0.2975、1社のプロバイダーの中央値

手元のハードウェアで

クローズドウェイト:クラウドのみ。

スコアの内訳

D 総合 1,149 [1,146–1,152] パーセンタイル 18 · #239 · 要素数:6 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/overall 1,138 ±2.61 1,138 ±3 26.5% 2026-10-02 —
LMArena text/hard_prompts 1,127 ±4.11 1,148 ±4 25.7% 2026-10-02 —
LMArena text/instruction_following 1,114 ±3.74 1,142 ±4 12.9% 2026-10-02 —
LMArena text/expert 1,108 ±9.08 1,156 ±7 11.0% 2026-10-02 —
LMArena text/multi_turn 1,088 ±5.58 1,116 ±5 6.1% 2026-10-02 —
LMArena text/longer_query 1,120 ±6.60 1,139 ±6 5.8% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D コーディング 1,147 [1,139–1,155] パーセンタイル 16 · #235 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/coding 1,130 ±5.19 1,141 ±5 89.8% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 数学 1,179 [1,170–1,188] パーセンタイル 21 · #201 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/math 1,173 ±5.38 1,176 ±5 87.7% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 文章作成 1,137 [1,129–1,145] パーセンタイル 18 · #221 · 要素数:2 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/creative_writing 1,107 ±5.49 1,128 ±6 62.7% 2026-10-02 —
LMArena text/longer_query 1,120 ±6.60 1,139 ±6 30.6% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 言語:繁體中文 1,146 [1,136–1,156] パーセンタイル 11 · #199 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/chinese 1,108 ±6.55 1,142 ±5 93.5% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 言語:Deutsch 1,149 [1,132–1,166] パーセンタイル 10 · #129 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/german 1,101 ±11 1,144 ±9 92.0% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 言語:English 1,148 [1,141–1,154] パーセンタイル 20 · #219 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/english 1,169 ±3.36 1,144 ±4 93.8% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 言語:Español 1,126 [1,100–1,151] パーセンタイル 4 · #143 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/spanish 1,095 ±16 1,116 ±15 89.1% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 言語:Français 1,130 [1,102–1,158] パーセンタイル 4 · #129 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/french 1,109 ±18 1,120 ±16 88.2% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 言語:日本語 1,163 [1,146–1,180] パーセンタイル 8 · #118 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/japanese 1,042 ±12 1,159 ±9 92.1% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 言語:한국어 1,105 [1,087–1,123] パーセンタイル 3 · #132 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/korean 954 ±13 1,096 ±10 91.8% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

D 言語:Русский 1,179 [1,170–1,189] パーセンタイル 12 · #206 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena text/russian 1,145 ±5.83 1,178 ±5 93.4% 2026-10-02 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

推移

月別fedi-index
同じデータを表で表示
モデル 2026-10
phi-3-medium-4k-instruct 1,149 D

バッジ

モデルのfedi-indexをあなたのサイトやREADMEに表示できます。バッジは自動更新され、このページにリンクします。

fedi-index: phi-3-medium-4k-instruct

データはCC BY 4.0:fedi.softwareへのリンクを残してください。