Naar de inhoud
fedi.software

Claude Sonnet 5.5 in fedi-index

De score in elke doorsnede, waaruit die bestaat, prijs-kwaliteit, lokaal draaien en geschiedenis.

fedi-index · Algemeen

A 1.462 ±6

Percentiel 94 · #17

Mensen kiezen / Lost taken op

1.460 / 1.467

Menselijke stemmen tegenover benchmarks, Elo-eq

Prijs-kwaliteit

+50

US$ 4 per 1M tokens, mediaan van 20 aanbieders · maker US$ 4

Op je eigen hardware

Gesloten gewichten: alleen in de cloud.

Opbouw van de score

A Algemeen 1.462 [1.456–1.468] Percentiel 94 · #17 · onderdelen: 9
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/overall 1.467 ±5,31 1.467 ±5 21,8% 2026-10-02 xhigh
LMArena text/hard_prompts 1.493 ±6,67 1.478 ±6 21,1% 2026-10-02 xhigh
Epoch AI eci uitschieter 165 ±1,88 1.556 ±15 16,2% 2026-09-28 —
LMArena text/instruction_following 1.490 ±8,96 1.498 ±8 9,3% 2026-10-02 xhigh
LMArena text/expert 1.550 ±16 1.517 ±13 7,1% 2026-10-02 xhigh
LMArena text/longer_query 1.488 ±8,38 1.483 ±8 4,8% 2026-10-02 xhigh
LMArena text/multi_turn 1.463 ±14 1.456 ±13 3,6% 2026-10-02 xhigh
Epoch AI simpleqa_verified uitschieter verval ×0,61 0,46 ±0,02 1.443 ±5 2,9% 2026-09-29 max
Epoch AI gpqa_diamond verval ×0,26 0,96 ±0,01 1.484 ±6 2,4% 2026-09-29 max

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Coderen 1.478 [1.471–1.486] Percentiel 100 · #2 · onderdelen: 2 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena webdev/overall 1.786 ±9,28 1.531 ±3 51,3% 2026-10-01 xhigh
LMArena text/coding 1.519 ±11 1.487 ±10 37,6% 2026-10-02 xhigh

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Agents 1.479 [1.466–1.492] Percentiel 95 · #4 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena agent/overall 0,13 ±0,02 1.515 ±8 88,5% 2026-10-02 max

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Wiskunde 1.470 [1.463–1.477] Percentiel 98 · #7 · onderdelen: 2 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
Epoch AI frontiermath_t1_3 verval ×0,86 0,89 ±0,02 1.513 ±4 62,3% 2026-09-29 max
Epoch AI frontiermath_t4 verval ×0,86 0,80 ±0,06 1.521 ±10 23,2% 2026-09-29 max

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Beeld 1.446 [1.436–1.456] Percentiel 81 · #22 · onderdelen: 3 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena vision/overall 1.290 ±7,72 1.465 ±7 66,4% 2026-10-02 xhigh
LMArena vision/ocr 1.291 ±8,97 1.463 ±9 15,2% 2026-10-02 xhigh
LMArena vision/diagram 1.313 ±16 1.475 ±14 10,9% 2026-10-02 xhigh

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Schrijven 1.457 [1.443–1.472] Percentiel 91 · #26 · onderdelen: 2 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/creative_writing 1.450 ±12 1.480 ±12 55,2% 2026-10-02 xhigh
LMArena text/longer_query 1.488 ±8,38 1.483 ±8 36,2% 2026-10-02 xhigh

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

A Taal: English 1.458 [1.442–1.474] Percentiel 95 · #14 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/english 1.487 ±8,55 1.480 ±9 92,2% 2026-10-02 xhigh

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

B Taal: Русский 1.422 [1.399–1.444] Percentiel 74 · #62 · onderdelen: 1 voorlopig
Bron Onderdeel Waarde Elo-eq Gewicht Gemeten Variant
LMArena text/russian 1.443 ±14 1.445 ±13 90,3% 2026-10-02 xhigh

Gewicht is het aandeel van het onderdeel in de score (de rest is de prior die modellen met weinig data naar de mediaan van de populatie trekt). Methodologie

Geschiedenis

fedi-index per maand
Hetzelfde in een tabel
Model 2026-10
Claude Sonnet 5.5 1.462 A

Badge

Toon de fedi-index van het model op je site of in een README. De badge werkt zichzelf bij en linkt naar deze pagina.

fedi-index: Claude Sonnet 5.5

Data CC BY 4.0: behoud de link naar fedi.software.