Przejdź do treści
fedi.software

gpt-oss-120b w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

C 1 344 ±8

Percentyl 45 · #161

Ludzie wolą / Rozwiązuje zadania

1 345 / 1 341

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

-2

0,2625 USD za 1M tokenów, mediana dostawców: 52

Na twoim sprzęcie

  • GPU 12 GB #8 · MXFP4 · ≈19 tok/s
  • GPU 24 GB #12 · MXFP4 · ≈25 tok/s
  • 128 GB pamięci zunifikowanej #17 · MXFP4 · ≈44 tok/s

Rozkład wyniku

C Ogólny 1 344 [1 335–1 352] Percentyl 45 · #161 · składniki: 8
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 140 ±1,93 1 358 ±15 27,9% 2025-08-05 —
LMArena text/overall 1 365 ±2,23 1 365 ±2 18,4% 2026-10-02 —
LMArena text/hard_prompts 1 364 ±2,88 1 362 ±3 18,3% 2026-10-02 —
LMArena text/instruction_following 1 318 ±3,60 1 335 ±3 9,0% 2026-10-02 —
LMArena text/expert 1 356 ±8,15 1 358 ±7 7,9% 2026-10-02 —
LMArena text/longer_query 1 319 ±3,92 1 325 ±4 4,4% 2026-10-02 —
LMArena text/multi_turn 1 340 ±4,45 1 344 ±4 4,4% 2026-10-02 —
Epoch AI gpqa_diamond wygaszanie ×0,26 0,76 ±0,03 1 392 ±13 1,5% 2025-12-11 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Programowanie 1 348 [1 341–1 354] Percentyl 43 · #158 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/coding 1 380 ±3,95 1 364 ±4 90,1% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Matematyka 1 359 [1 347–1 370] Percentyl 48 · #134 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 388 ±7,07 1 382 ±7 86,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Pisanie 1 301 [1 295–1 308] Percentyl 38 · #166 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 274 ±4,99 1 300 ±5 61,3% 2026-10-02 —
LMArena text/longer_query 1 319 ±3,92 1 325 ±4 32,3% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: 繁體中文 1 351 [1 342–1 360] Percentyl 39 · #137 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 384 ±6,47 1 362 ±5 93,5% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Deutsch 1 349 [1 331–1 367] Percentyl 34 · #95 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/german 1 354 ±12 1 362 ±10 91,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: English 1 352 [1 346–1 357] Percentyl 46 · #148 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 375 ±3,00 1 361 ±3 93,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Español 1 372 [1 354–1 390] Percentyl 30 · #105 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 388 ±11 1 388 ±10 91,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

D Język: Français 1 343 [1 320–1 367] Percentyl 22 · #106 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 370 ±14 1 359 ±13 90,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: 日本語 1 362 [1 344–1 379] Percentyl 33 · #86 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/japanese 1 332 ±13 1 376 ±10 91,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

D Język: 한국어 1 335 [1 318–1 352] Percentyl 23 · #105 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/korean 1 283 ±12 1 346 ±9 92,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

D Język: Polski 1 357 [1 345–1 368] Percentyl 19 · #106 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/polish 1 354 ±7,40 1 368 ±6 93,2% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Русский 1 345 [1 335–1 356] Percentyl 40 · #140 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 343 ±6,40 1 355 ±6 93,3% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
gpt-oss-120b 1 344 C

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: gpt-oss-120b

Dane CC BY 4.0: zachowaj link do fedi.software.