claude-opus-4-20250514-thinking-16k w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
B 1 374 ±6
Percentyl 55 · #132
Ludzie wolą / Rozwiązuje zadania
1 381 / 1 365
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
-86
30 USD za 1M tokenów, mediana dostawców: 9
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
B Ogólny 1 374 [1 368–1 381] Percentyl 55 · #132 · składniki: 8
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
143 ±1,08 | 1 380 ±8 | 37,2% | 2025-05-22 | — |
| LMArena |
text/overall
|
1 377 ±2,27 | 1 377 ±2 | 16,0% | 2026-10-02 | thinking-16k |
| LMArena |
text/hard_prompts
|
1 399 ±2,89 | 1 394 ±3 | 15,9% | 2026-10-02 | thinking-16k |
| LMArena |
text/instruction_following
|
1 406 ±3,52 | 1 419 ±3 | 7,8% | 2026-10-02 | thinking-16k |
| LMArena |
text/expert
|
1 384 ±7,33 | 1 381 ±6 | 7,1% | 2026-10-02 | thinking-16k |
| LMArena |
text/longer_query
|
1 422 ±3,91 | 1 421 ±4 | 3,9% | 2026-10-02 | thinking-16k |
| LMArena |
text/multi_turn
|
1 396 ±4,19 | 1 395 ±4 | 3,8% | 2026-10-02 | thinking-16k |
| Epoch AI |
gpqa_diamond
wygaszanie ×0,26 |
0,76 ±0,03 | 1 394 ±14 | 1,2% | 2025-05-22 | 16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Programowanie 1 402 [1 396–1 408] Percentyl 69 · #88 · składniki: 2
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1 442 ±4,01 | 1 418 ±4 | 77,9% | 2026-10-02 | thinking-16k |
| Epoch AI |
swe_bench_verified
wygaszanie ×0,37 |
0,71 ±0,02 | 1 436 ±11 | 13,5% | 2026-02-06 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Matematyka 1 361 [1 351–1 372] Percentyl 49 · #131 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 391 ±6,29 | 1 384 ±6 | 87,3% | 2026-10-02 | thinking-16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Obraz 1 363 [1 352–1 375] Percentyl 34 · #75 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1 192 ±8,15 | 1 377 ±7 | 76,1% | 2026-10-02 | thinking-16k |
| LMArena |
vision/ocr
|
1 197 ±10 | 1 372 ±10 | 16,5% | 2026-10-02 | thinking-16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Pisanie 1 403 [1 397–1 409] Percentyl 65 · #94 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 386 ±4,76 | 1 414 ±5 | 61,5% | 2026-10-02 | thinking-16k |
| LMArena |
text/longer_query
|
1 422 ±3,91 | 1 421 ±4 | 32,1% | 2026-10-02 | thinking-16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: 繁體中文 1 353 [1 343–1 362] Percentyl 39 · #136 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 386 ±6,31 | 1 363 ±5 | 93,5% | 2026-10-02 | thinking-16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: Deutsch 1 379 [1 363–1 395] Percentyl 45 · #80 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/german
|
1 390 ±10 | 1 394 ±9 | 92,3% | 2026-10-02 | thinking-16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: English 1 362 [1 356–1 368] Percentyl 52 · #133 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 385 ±2,94 | 1 373 ±3 | 93,9% | 2026-10-02 | thinking-16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: Español 1 373 [1 355–1 390] Percentyl 30 · #104 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/spanish
|
1 388 ±10 | 1 388 ±10 | 91,9% | 2026-10-02 | thinking-16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
D Język: Français 1 344 [1 321–1 366] Percentyl 22 · #105 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/french
|
1 369 ±14 | 1 359 ±13 | 90,4% | 2026-10-02 | thinking-16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: 日本語 1 363 [1 348–1 378] Percentyl 35 · #84 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/japanese
|
1 332 ±11 | 1 376 ±8 | 92,4% | 2026-10-02 | thinking-16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: 한국어 1 360 [1 344–1 375] Percentyl 32 · #93 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/korean
|
1 317 ±11 | 1 372 ±9 | 92,3% | 2026-10-02 | thinking-16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
D Język: Polski 1 359 [1 350–1 368] Percentyl 21 · #104 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/polish
|
1 356 ±5,57 | 1 370 ±5 | 93,6% | 2026-10-02 | thinking-16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
B Język: Русский 1 387 [1 377–1 396] Percentyl 54 · #109 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 392 ±5,88 | 1 400 ±5 | 93,4% | 2026-10-02 | thinking-16k |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| claude-opus-4-20250514-thinking-16k | 1 374 B |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.