Przejdź do treści
fedi.software

Claude Sonnet 4 w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

B 1 359 ±6

Percentyl 51 · #145

Ludzie wolą / Rozwiązuje zadania

1 359 / 1 359

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

-62

6 USD za 1M tokenów, mediana dostawców: 14

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

B Ogólny 1 359 [1 353–1 366] Percentyl 51 · #145 · składniki: 8
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 142 ±1,04 1 372 ±8 37,5% 2025-05-22 —
LMArena text/overall 1 351 ±2,30 1 351 ±2 15,9% 2026-10-02 thinking-32k
LMArena text/hard_prompts 1 372 ±2,93 1 370 ±3 15,8% 2026-10-02 thinking-32k
LMArena text/instruction_following 1 376 ±3,60 1 390 ±3 7,7% 2026-10-02 thinking-32k
LMArena text/expert 1 371 ±7,47 1 371 ±6 7,0% 2026-10-02 thinking-32k
LMArena text/longer_query 1 398 ±3,93 1 398 ±4 3,8% 2026-10-02 thinking-32k
LMArena text/multi_turn 1 376 ±4,27 1 378 ±4 3,8% 2026-10-02 thinking-32k
Epoch AI gpqa_diamond wygaszanie ×0,26 0,79 ±0,03 1 408 ±12 1,3% 2025-05-26 59k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Programowanie 1 375 [1 368–1 381] Percentyl 54 · #127 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/coding 1 414 ±4,03 1 394 ±4 90,1% 2026-10-02 thinking-32k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Matematyka 1 348 [1 337–1 358] Percentyl 46 · #138 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 375 ±6,60 1 369 ±6 87,2% 2026-10-02 thinking-32k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Obraz 1 362 [1 350–1 374] Percentyl 33 · #76 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena vision/overall 1 191 ±8,64 1 376 ±8 76,2% 2026-10-02 thinking-32k
LMArena vision/ocr 1 196 ±11 1 371 ±11 16,2% 2026-10-02 thinking-32k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Pisanie 1 370 [1 364–1 376] Percentyl 54 · #123 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 345 ±4,86 1 372 ±5 61,4% 2026-10-02 thinking-32k
LMArena text/longer_query 1 398 ±3,93 1 398 ±4 32,2% 2026-10-02 thinking-32k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: 繁體中文 1 326 [1 317–1 336] Percentyl 32 · #152 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 351 ±6,34 1 335 ±5 93,5% 2026-10-02 thinking-32k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Deutsch 1 332 [1 317–1 347] Percentyl 29 · #103 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/german 1 330 ±9,58 1 342 ±8 92,5% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: English 1 341 [1 335–1 347] Percentyl 44 · #154 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 364 ±2,97 1 350 ±3 93,9% 2026-10-02 thinking-32k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

D Język: Español 1 346 [1 327–1 364] Percentyl 20 · #119 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 357 ±11 1 359 ±10 91,7% 2026-10-02 thinking-32k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

D Język: Français 1 340 [1 318–1 361] Percentyl 17 · #112 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 364 ±13 1 353 ±12 90,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: 日本語 1 342 [1 328–1 356] Percentyl 28 · #93 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/japanese 1 301 ±10 1 353 ±8 92,7% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

D Język: 한국어 1 342 [1 328–1 357] Percentyl 24 · #104 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/korean 1 292 ±11 1 353 ±8 92,6% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

D Język: Polski 1 334 [1 325–1 343] Percentyl 13 · #114 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/polish 1 324 ±5,80 1 343 ±5 93,5% 2026-10-02 thinking-32k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Русский 1 356 [1 346–1 365] Percentyl 41 · #138 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 355 ±6,06 1 366 ±5 93,4% 2026-10-02 thinking-32k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
Claude Sonnet 4 1 359 B

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: Claude Sonnet 4

Dane CC BY 4.0: zachowaj link do fedi.software.