Przejdź do treści
fedi.software

Claude Opus 4.1 w fedi-index

Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.

fedi-index · Ogólny

B 1 400 ±6

Percentyl 69 · #92

Ludzie wolą / Rozwiązuje zadania

1 418 / 1 375

Głosy ludzi a benchmarki, Elo-eq

Opłacalność

-61

30 USD za 1M tokenów, mediana dostawców: 20

Na twoim sprzęcie

Zamknięte wagi: tylko w chmurze.

Rozkład wyniku

B Ogólny 1 400 [1 394–1 407] Percentyl 69 · #92 · składniki: 8
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
Epoch AI eci 144 ±1,11 1 391 ±9 36,5% 2025-08-05 —
LMArena text/overall 1 419 ±1,77 1 419 ±2 16,1% 2026-10-02 thinking-16k
LMArena text/hard_prompts 1 443 ±2,32 1 433 ±2 16,0% 2026-10-02 thinking-16k
LMArena text/instruction_following 1 436 ±2,93 1 447 ±3 7,9% 2026-10-02 thinking-16k
LMArena text/expert 1 439 ±6,05 1 426 ±5 7,4% 2026-10-02 thinking-16k
LMArena text/longer_query 1 455 ±3,10 1 452 ±3 3,9% 2026-10-02 thinking-16k
LMArena text/multi_turn 1 444 ±3,49 1 439 ±3 3,9% 2026-10-02 thinking-16k
Epoch AI gpqa_diamond wygaszanie ×0,26 0,77 ±0,03 1 399 ±14 1,2% 2025-08-05 16k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Programowanie 1 417 [1 414–1 421] Percentyl 76 · #67 · składniki: 3
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena webdev/overall 1 389 ±5,46 1 418 ±2 39,6% 2026-10-01 —
LMArena text/coding 1 479 ±3,29 1 452 ±3 38,6% 2026-10-02 thinking-16k
Epoch AI swe_bench_verified wygaszanie ×0,37 0,73 ±0,02 1 449 ±10 13,4% 2026-02-11 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Matematyka 1 382 [1 376–1 388] Percentyl 58 · #107 · składniki: 3
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/math 1 431 ±5,37 1 422 ±5 49,1% 2026-10-02 thinking-16k
Epoch AI frontiermath_t1_3 wygaszanie ×0,86 0,13 ±0,02 1 348 ±4 29,2% 2026-06-11 32k
Epoch AI frontiermath_t4 wygaszanie ×0,86 0,02 ±0,02 1 396 ±4 14,8% 2026-06-11 32k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Pisanie 1 430 [1 424–1 435] Percentyl 79 · #57 · składniki: 2 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/creative_writing 1 412 ±3,91 1 441 ±4 61,9% 2026-10-02 thinking-16k
LMArena text/longer_query 1 455 ±3,10 1 452 ±3 31,9% 2026-10-02 thinking-16k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 繁體中文 1 384 [1 378–1 390] Percentyl 50 · #112 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/chinese 1 427 ±4,14 1 395 ±3 93,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Deutsch 1 397 [1 382–1 412] Percentyl 55 · #65 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/german 1 413 ±9,57 1 413 ±8 92,5% 2026-10-02 thinking-16k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: English 1 409 [1 404–1 414] Percentyl 67 · #90 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/english 1 433 ±2,44 1 422 ±3 94,0% 2026-10-02 thinking-16k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Español 1 427 [1 415–1 438] Percentyl 74 · #40 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/spanish 1 448 ±6,82 1 443 ±6 93,2% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Français 1 398 [1 380–1 416] Percentyl 46 · #73 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/french 1 432 ±11 1 416 ±10 91,8% 2026-10-02 thinking-16k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: 日本語 1 394 [1 378–1 410] Percentyl 47 · #68 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/japanese 1 378 ±12 1 410 ±9 92,3% 2026-10-02 thinking-16k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: 한국어 1 405 [1 392–1 418] Percentyl 56 · #60 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/korean 1 381 ±9,54 1 421 ±7 92,8% 2026-10-02 thinking-16k

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

C Język: Polski 1 405 [1 396–1 413] Percentyl 47 · #70 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/polish 1 413 ±5,21 1 418 ±4 93,6% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

B Język: Русский 1 412 [1 406–1 418] Percentyl 68 · #75 · składniki: 1 wstępny
Źródło Składnik Wartość Elo-eq Waga Pomiar Wariant
LMArena text/russian 1 421 ±3,64 1 426 ±3 93,8% 2026-10-02 —

Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia

Historia

fedi-index według miesięcy
To samo w tabeli
Model 2026-10
Claude Opus 4.1 1 400 B

Odznaka

Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.

fedi-index: Claude Opus 4.1

Dane CC BY 4.0: zachowaj link do fedi.software.