Przejdź do treści
fedi.software

Step 5 Preview w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

B 1 419 ±6

Percentyl 79 · #63 · wstępny

Ludzie wolą / Rozwiązuje zadania

1 434 / —

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

+32

1,42 USD za 1M tokenów, mediana dostawców: 7 · producent 1,40 USD

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

B Ogólny 1 419 [1 413–1 425] Percentyl 79 · #63 · składniki: 5 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/overall 1 448 ±5,62 1 448 ±6 31,3% 2026-10-02 —
LMArena text/hard_prompts 1 468 ±6,99 1 456 ±6 30,3% 2026-10-02 —
LMArena text/instruction_following 1 442 ±9,33 1 453 ±9 13,2% 2026-10-02 —
LMArena text/longer_query 1 460 ±8,63 1 456 ±8 6,9% 2026-10-02 —
LMArena text/multi_turn 1 453 ±15 1 447 ±14 4,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Programowanie 1 437 [1 430–1 444] Percentyl 88 · #34 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena webdev/overall 1 570 ±6,52 1 470 ±2 51,9% 2026-10-01 high
LMArena text/coding 1 489 ±11 1 460 ±10 37,1% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Agenci 1 432 [1 426–1 439] Percentyl 51 · #29 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena agent/overall 0,00 ±0,01 1 458 ±4 90,1% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Obraz 1 434 [1 417–1 451] Percentyl 70 · #34 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena vision/overall 1 278 ±12 1 455 ±11 75,7% 2026-10-02 —
LMArena vision/ocr 1 297 ±15 1 468 ±14 15,2% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Pisanie 1 431 [1 416–1 446] Percentyl 79 · #56 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 422 ±12 1 451 ±13 54,7% 2026-10-02 —
LMArena text/longer_query 1 460 ±8,63 1 456 ±8 36,5% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: English 1 432 [1 414–1 450] Percentyl 84 · #45 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 461 ±9,43 1 452 ±10 91,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Русский 1 425 [1 403–1 447] Percentyl 78 · #53 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 447 ±14 1 449 ±12 90,4% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
Step 5 Preview 1 419 B

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: Step 5 Preview

Dane CC BY 4.0: zachowaj link do fedi.software.