本文へスキップ
fedi.software

fedi-indexにおけるgpt-5.5-search

各カテゴリのスコア、その内訳、コスパ、ローカル実行、推移。

fedi-index · 総合

A 1,468 ±5

パーセンタイル 94 · #3 · 暫定

人間の評価 / タスク解決

— / —

人間の投票とベンチマーク、Elo-eq

コスパ

—

手元のハードウェアで

クローズドウェイト:クラウドのみ。

スコアの内訳

A 検索 1,468 [1,463–1,473] パーセンタイル 94 · #3 · 要素数:1 暫定
ソース 要素 値 Elo-eq 重み 測定日 バリアント
LMArena search/overall 1,242 ±2.71 1,485 ±3 93.9% 2026-08-24 —

重みはスコアに占める要素の割合です(残りは事前値で、データの少ないモデルを母集団の中央値に近づけます)。 算出方法

バッジ

モデルのfedi-indexをあなたのサイトやREADMEに表示できます。バッジは自動更新され、このページにリンクします。

fedi-index: gpt-5.5-search

データはCC BY 4.0:fedi.softwareへのリンクを残してください。