Przejdź do treści
fedi.software

GLM 5.1 w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

A 1 432 ±5

Percentyl 83 · #51

Ludzie wolą / Rozwiązuje zadania

1 445 / 1 415

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

+36

2,13 USD za 1M tokenów, mediana dostawców: 42 · producent 2,15 USD

Na twoim sprzęcie

Nie mieści się w konfiguracjach referencyjnych.

Rozkład wyniku

A Ogólny 1 432 [1 427–1 437] Percentyl 83 · #51 · składniki: 9
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 150 ±0,90 1 436 ±7 33,9% 2026-04-07 —
LMArena text/overall 1 461 ±1,87 1 462 ±2 15,6% 2026-10-02 —
LMArena text/hard_prompts 1 472 ±2,17 1 459 ±2 15,6% 2026-10-02 —
LMArena text/instruction_following 1 451 ±2,63 1 461 ±2 7,7% 2026-10-02 —
LMArena text/expert 1 476 ±4,14 1 457 ±3 7,5% 2026-10-02 —
LMArena text/longer_query 1 466 ±2,51 1 462 ±2 3,9% 2026-10-02 —
Epoch AI simpleqa_verified wygaszanie ×0,61 0,34 ±0,01 1 404 ±5 3,8% 2026-08-27 —
LMArena text/multi_turn 1 472 ±3,51 1 464 ±3 3,8% 2026-10-02 —
Epoch AI gpqa_diamond wygaszanie ×0,26 0,90 ±0,02 1 458 ±10 1,3% 2026-08-10 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Programowanie 1 434 [1 430–1 437] Percentyl 85 · #43 · składniki: 3
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena webdev/overall 1 508 ±3,44 1 452 ±1 39,6% 2026-10-01 —
LMArena text/coding 1 486 ±2,86 1 458 ±3 38,7% 2026-10-02 —
Epoch AI swe_bench_verified wygaszanie ×0,37 0,74 ±0,02 1 454 ±10 13,4% 2026-05-15 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Matematyka 1 418 [1 410–1 426] Percentyl 82 · #46 · składniki: 2
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 473 ±5,85 1 463 ±6 50,4% 2026-10-02 —
Epoch AI frontiermath_t1_3 wygaszanie ×0,86 0,37 ±0,03 1 401 ±6 42,4% 2026-08-29 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Pisanie 1 459 [1 454–1 463] Percentyl 91 · #24 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 452 ±3,37 1 482 ±3 62,0% 2026-10-02 —
LMArena text/longer_query 1 466 ±2,51 1 462 ±2 31,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: 繁體中文 1 448 [1 441–1 456] Percentyl 88 · #27 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 515 ±5,06 1 465 ±4 93,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Deutsch 1 437 [1 421–1 453] Percentyl 85 · #23 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/german 1 464 ±10 1 457 ±9 92,2% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: English 1 452 [1 447–1 457] Percentyl 91 · #26 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 476 ±2,42 1 468 ±3 94,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Español 1 443 [1 431–1 456] Percentyl 88 · #18 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 468 ±7,36 1 461 ±7 93,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Français 1 438 [1 425–1 450] Percentyl 81 · #27 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 475 ±7,56 1 456 ±7 93,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: 日本語 1 432 [1 416–1 449] Percentyl 80 · #26 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/japanese 1 434 ±12 1 452 ±9 92,2% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: 한국어 1 432 [1 419–1 446] Percentyl 80 · #28 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/korean 1 420 ±9,72 1 450 ±7 92,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Polski 1 428 [1 414–1 442] Percentyl 74 · #35 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/polish 1 445 ±9,05 1 446 ±8 92,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Русский 1 439 [1 432–1 446] Percentyl 84 · #38 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 453 ±3,92 1 455 ±4 93,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
GLM 5.1 1 432 A

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: GLM 5.1

Dane CC BY 4.0: zachowaj link do fedi.software.