Przejdź do treści
fedi.software

ibm-granite-h-small w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

C 1 241 ±5

Percentyl 27 · #214 · wstępny

Ludzie wolą / Rozwiązuje zadania

1 243 / —

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

—

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

C Ogólny 1 241 [1 236–1 246] Percentyl 27 · #214 · składniki: 5 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/overall 1 241 ±4,33 1 241 ±4 31,2% 2026-10-02 —
LMArena text/hard_prompts 1 240 ±5,81 1 250 ±5 30,1% 2026-10-02 —
LMArena text/instruction_following 1 220 ±7,87 1 243 ±8 13,5% 2026-10-02 —
LMArena text/longer_query 1 240 ±8,75 1 251 ±8 6,5% 2026-10-02 —
LMArena text/multi_turn 1 243 ±10 1 256 ±9 6,1% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Programowanie 1 240 [1 226–1 254] Percentyl 26 · #206 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/coding 1 247 ±8,78 1 245 ±8 88,3% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Matematyka 1 240 [1 216–1 264] Percentyl 29 · #182 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 251 ±16 1 250 ±16 79,2% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Pisanie 1 238 [1 224–1 252] Percentyl 28 · #193 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 211 ±12 1 235 ±12 55,7% 2026-10-02 —
LMArena text/longer_query 1 240 ±8,75 1 251 ±8 35,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

D Język: 繁體中文 1 250 [1 227–1 273] Percentyl 23 · #171 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 251 ±17 1 255 ±13 90,1% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: English 1 244 [1 231–1 256] Percentyl 28 · #196 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 266 ±6,33 1 247 ±7 93,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

D Język: Русский 1 223 [1 199–1 246] Percentyl 18 · #193 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 198 ±15 1 225 ±13 90,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
ibm-granite-h-small 1 241 C

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: ibm-granite-h-small

Dane CC BY 4.0: zachowaj link do fedi.software.