Przejdź do treści
fedi.software

Step 3.5 Flash w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

B 1 381 ±2

Percentyl 59 · #121 · wstępny

Ludzie wolą / Rozwiązuje zadania

1 392 / —

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

+50

0,15 USD za 1M tokenów, mediana dostawców: 11 · producent 0,15 USD

Na twoim sprzęcie

  • GPU 12 GB #25 · IQ2_S · silna kompresja · ≈15 tok/s
  • GPU 24 GB #28 · Q2_K_L · silna kompresja · ≈16 tok/s
  • Mac 64 GB #19 · IQ1_M · silna kompresja · ≈45 tok/s
  • 128 GB pamięci zunifikowanej #8 · IQ4_XS · ≈17 tok/s

Rozkład wyniku

B Ogólny 1 381 [1 380–1 383] Percentyl 59 · #121 · składniki: 6 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/overall 1 403 ±1,80 1 403 ±2 25,6% 2026-10-02 —
LMArena text/hard_prompts 1 411 ±2,18 1 405 ±2 25,5% 2026-10-02 —
LMArena text/instruction_following 1 385 ±2,67 1 399 ±2 12,6% 2026-10-02 —
LMArena text/expert 1 422 ±4,31 1 412 ±4 12,3% 2026-10-02 —
LMArena text/longer_query 1 402 ±2,62 1 403 ±2 6,3% 2026-10-02 —
LMArena text/multi_turn 1 405 ±3,31 1 404 ±3 6,2% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Programowanie 1 393 [1 388–1 398] Percentyl 64 · #100 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/coding 1 436 ±2,89 1 413 ±3 90,3% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Matematyka 1 377 [1 368–1 386] Percentyl 55 · #116 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 408 ±5,21 1 401 ±5 87,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Pisanie 1 379 [1 375–1 384] Percentyl 57 · #116 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 357 ±3,43 1 385 ±4 62,0% 2026-10-02 —
LMArena text/longer_query 1 402 ±2,62 1 403 ±2 31,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 繁體中文 1 398 [1 390–1 405] Percentyl 55 · #101 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 447 ±5,13 1 411 ±4 93,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Deutsch 1 391 [1 376–1 406] Percentyl 51 · #71 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/german 1 404 ±9,58 1 406 ±8 92,5% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: English 1 394 [1 389–1 399] Percentyl 61 · #108 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 417 ±2,42 1 406 ±3 94,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Español 1 402 [1 390–1 413] Percentyl 46 · #81 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 419 ±7,09 1 416 ±7 93,1% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Français 1 392 [1 380–1 405] Percentyl 40 · #81 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 421 ±7,49 1 406 ±7 93,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: 日本語 1 376 [1 360–1 393] Percentyl 41 · #76 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/japanese 1 353 ±12 1 391 ±9 92,1% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: 한국어 1 384 [1 370–1 397] Percentyl 40 · #82 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/korean 1 351 ±9,65 1 398 ±7 92,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Polski 1 384 [1 371–1 397] Percentyl 34 · #87 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/polish 1 389 ±8,27 1 398 ±7 92,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Русский 1 382 [1 376–1 388] Percentyl 50 · #117 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 385 ±3,70 1 393 ±3 93,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
Step 3.5 Flash 1 381 B

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: Step 3.5 Flash

Dane CC BY 4.0: zachowaj link do fedi.software.