Przejdź do treści
fedi.software

GPT-5.2 w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

A 1 428 ±5

Percentyl 82 · #53

Ludzie wolą / Rozwiązuje zadania

1 421 / 1 438

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

+12

4,81 USD za 1M tokenów, mediana dostawców: 26 · producent 4,81 USD

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

A Ogólny 1 428 [1 423–1 434] Percentyl 82 · #53 · składniki: 9
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 153 ±0,97 1 465 ±8 33,4% 2025-12-11 —
LMArena text/overall 1 439 ±2,04 1 439 ±2 15,8% 2026-10-02 —
LMArena text/hard_prompts 1 445 ±2,50 1 435 ±2 15,7% 2026-10-02 —
LMArena text/instruction_following 1 417 ±3,16 1 429 ±3 7,7% 2026-10-02 —
LMArena text/expert 1 445 ±4,93 1 431 ±4 7,5% 2026-10-02 high
LMArena text/longer_query 1 428 ±3,05 1 427 ±3 3,9% 2026-10-02 —
Epoch AI simpleqa_verified wygaszanie ×0,61 0,37 ±0,02 1 414 ±5 3,9% 2026-08-27 xhigh
LMArena text/multi_turn 1 458 ±3,96 1 452 ±4 3,8% 2026-10-02 —
Epoch AI gpqa_diamond wygaszanie ×0,26 0,91 ±0,02 1 465 ±8 1,4% 2025-12-13 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Programowanie 1 409 [1 405–1 414] Percentyl 73 · #76 · składniki: 3
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/coding 1 447 ±3,42 1 423 ±3 39,1% 2026-10-02 —
LMArena webdev/overall 1 415 ±11 1 426 ±3 38,8% 2026-10-01 —
Epoch AI swe_bench_verified wygaszanie ×0,37 0,74 ±0,02 1 452 ±10 13,6% 2026-02-12 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Agenci 1 412 [1 400–1 424] Percentyl 32 · #40 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
τ²-bench (Sierra) tau2/banking_knowledge wygaszanie ×0,76 0,32 ±0,05 1 467 ±8 79,2% 2026-05-05 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Matematyka 1 426 [1 419–1 433] Percentyl 84 · #43 · składniki: 3
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 439 ±5,49 1 431 ±5 52,7% 2026-10-02 high
Epoch AI frontiermath_t1_3 wygaszanie ×0,86 0,67 ±0,03 1 467 ±6 29,3% 2026-06-11 xhigh
Epoch AI frontiermath_t4 wygaszanie ×0,86 0,32 ±0,07 1 443 ±12 10,6% 2026-06-11 xhigh

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Obraz 1 432 [1 428–1 436] Percentyl 68 · #37 · składniki: 3 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena vision/overall 1 268 ±3,32 1 446 ±3 63,1% 2026-10-02 —
LMArena vision/ocr 1 275 ±3,44 1 447 ±3 15,6% 2026-10-02 —
LMArena vision/diagram 1 285 ±5,11 1 450 ±4 15,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Pisanie 1 415 [1 410–1 421] Percentyl 73 · #74 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 402 ±4,28 1 430 ±4 61,5% 2026-10-02 —
LMArena text/longer_query 1 428 ±3,05 1 427 ±3 32,2% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 繁體中文 1 407 [1 398–1 416] Percentyl 62 · #86 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 460 ±6,31 1 421 ±5 93,5% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Deutsch 1 422 [1 402–1 442] Percentyl 72 · #41 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/german 1 448 ±13 1 443 ±11 91,2% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: English 1 422 [1 417–1 428] Percentyl 75 · #70 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 446 ±2,81 1 436 ±3 93,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Español 1 412 [1 397–1 427] Percentyl 57 · #65 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 433 ±9,08 1 429 ±8 92,4% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Français 1 421 [1 406–1 435] Percentyl 65 · #48 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 456 ±8,68 1 438 ±8 92,6% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 日本語 1 421 [1 400–1 441] Percentyl 72 · #36 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/japanese 1 420 ±15 1 442 ±11 91,1% 2026-10-02 high

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 한국어 1 409 [1 391–1 427] Percentyl 62 · #53 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/korean 1 390 ±13 1 428 ±10 91,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Polski 1 417 [1 400–1 434] Percentyl 60 · #53 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/polish 1 434 ±11 1 436 ±10 91,9% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Русский 1 428 [1 420–1 435] Percentyl 78 · #51 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 440 ±4,72 1 443 ±4 93,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
GPT-5.2 1 428 A

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: GPT-5.2

Dane CC BY 4.0: zachowaj link do fedi.software.