Naar de inhoud
fedi.software

fedi-index: Agents

Modellen als agents: toolgebruik en taken in meerdere stappen — Arena-agentsessies en τ²-bench-runs.

Live data voor 2026-10 (dagelijks herberekend) · Methodologie v1 · Methodologie · Geschiedenis · JSON

# Tier Model fedi-index Percentiel Mensen kiezen Lost taken op Prijs-kwaliteit Bronnen Opbouw van de score
13B1.456 ±5791.4591.449 +44 Aτ›
14B1.454 ±5771.4561.449 +45 Aτ›
17B1.449 ±2721.459— +92◆ A›
19B1.448 ±3681.458— — A›
24B1.442 ±3601.451— +60 A›
27B1.435 ±7541.445— +33 A›
30C1.430 ±2491.439— +105◆ A›
32C1.428 ±3461.437— — A›
33C1.428 ±6441.438— +98◆ A›
36C1.424 ±3391.433— +46 A›
42C1.408 ±5281.416— +68 A›
47D1.402 ±4191.410— +50 A›
49D1.399 ±4161.407— +80 A›
53D1.388 ±87—1.411 +23 τ›
54D1.388 ±87—1.411 +27 τ›
55D1.386 ±651.394— +38 A›
56D1.384 ±441.392— +27 A›
57D1.377 ±621.384— -19 A›

…

AArena (menselijke stemmen)ττ²-bench (agents) ◆ Pareto-grens: niets is tegelijk beter en goedkoper

fedi-index is een Elo-equivalent op een vaste schaal: vergelijkbaar tussen maanden binnen één methodologieversie. Niveaus S–D: op percentiel in de doorsnede, en niet beter dan het betrouwbaarheidsinterval toelaat (grenzen in de methodologie). ‘Voorlopig’ — slechts één bronfamilie heeft het model hier gemeten. Methodologie

Insluiten op je site

De tabel als widget voor je site: werkt zichzelf bij en behoudt de bronvermelding.

JSON fedi-index © fedi.software, CC BY 4.0; onderdelen behouden de licenties van hun bronnen.