Przejdź do treści
fedi.software

Claude Sonnet 4.6 w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

A 1 443 ±6

Percentyl 88 · #35

Ludzie wolą / Rozwiązuje zadania

1 453 / 1 428

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

+21

6 USD za 1M tokenów, mediana dostawców: 42 · producent 6 USD

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

A Ogólny 1 443 [1 437–1 449] Percentyl 88 · #35 · składniki: 9
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 152 ±1,17 1 455 ±9 31,3% 2026-02-17 —
LMArena text/overall 1 458 ±1,79 1 458 ±2 16,2% 2026-10-02 —
LMArena text/hard_prompts 1 484 ±2,17 1 471 ±2 16,2% 2026-10-02 —
LMArena text/instruction_following 1 475 ±2,64 1 484 ±2 8,0% 2026-10-02 —
LMArena text/expert 1 500 ±3,99 1 476 ±3 7,8% 2026-10-02 —
LMArena text/longer_query 1 479 ±2,53 1 474 ±2 4,0% 2026-10-02 —
Epoch AI simpleqa_verified wygaszanie ×0,61 0,36 ±0,02 1 409 ±5 4,0% 2026-08-10 high
LMArena text/multi_turn 1 464 ±3,27 1 457 ±3 4,0% 2026-10-02 —
Epoch AI gpqa_diamond wygaszanie ×0,26 0,87 ±0,02 1 446 ±9 1,4% 2026-02-20 32k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Programowanie 1 442 [1 439–1 446] Percentyl 91 · #26 · składniki: 3
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena webdev/overall 1 521 ±2,62 1 456 ±1 39,6% 2026-10-01 —
LMArena text/coding 1 504 ±2,83 1 474 ±2 38,6% 2026-10-02 —
Epoch AI swe_bench_verified wygaszanie ×0,37 0,75 ±0,02 1 459 ±10 13,5% 2026-02-21 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Matematyka 1 423 [1 415–1 432] Percentyl 83 · #44 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 463 ±5,12 1 454 ±5 87,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Obraz 1 446 [1 442–1 450] Percentyl 80 · #23 · składniki: 3 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena vision/overall 1 283 ±3,14 1 459 ±3 62,9% 2026-10-02 —
LMArena vision/ocr 1 296 ±3,13 1 467 ±3 15,7% 2026-10-02 —
LMArena vision/diagram 1 305 ±4,33 1 468 ±4 15,3% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Pisanie 1 452 [1 447–1 456] Percentyl 86 · #37 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 435 ±3,33 1 464 ±3 62,1% 2026-10-02 —
LMArena text/longer_query 1 479 ±2,53 1 474 ±2 31,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 繁體中文 1 431 [1 424–1 438] Percentyl 78 · #49 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 491 ±4,83 1 446 ±4 93,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Deutsch 1 410 [1 396–1 424] Percentyl 63 · #54 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/german 1 428 ±9,11 1 426 ±8 92,6% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: English 1 448 [1 444–1 453] Percentyl 89 · #31 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 472 ±2,39 1 464 ±2 94,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

A Język: Español 1 440 [1 428–1 452] Percentyl 84 · #25 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 464 ±7,08 1 457 ±7 93,1% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Français 1 430 [1 418–1 442] Percentyl 72 · #39 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 465 ±7,23 1 447 ±7 93,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 日本語 1 423 [1 407–1 438] Percentyl 75 · #33 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/japanese 1 419 ±11 1 441 ±9 92,3% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 한국어 1 426 [1 413–1 440] Percentyl 74 · #36 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/korean 1 411 ±9,52 1 444 ±7 92,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Polski 1 426 [1 414–1 439] Percentyl 72 · #37 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/polish 1 442 ±8,07 1 443 ±7 93,0% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Русский 1 428 [1 422–1 434] Percentyl 79 · #50 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 440 ±3,76 1 443 ±3 93,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
Claude Sonnet 4.6 1 443 A

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: Claude Sonnet 4.6

Dane CC BY 4.0: zachowaj link do fedi.software.