Ogólny
Programowanie
Agenci
Matematyka
Obraz
Wyszukiwanie
Pisanie
Język: Polski
Dane bieżące za 2026-10 (przeliczane codziennie)
· Metodologia v1
· Metodologia
· Historia
· JSON
#
Tier
Model
fedi-index
Percentyl
Ludzie wolą
Rozwiązuje zadania
Opłacalność
Źródła
Rozkład wyniku
13 B Kimi K3 Moonshot AI · Otwarte wagi 1 456 ±5 79 1 459 1 449 +44 A τ ›
14 B GLM 5.2 Zhipu AI · Otwarte wagi 1 454 ±5 77 1 456 1 449 +45 A τ ›
17 B DeepSeek V4.1 Flashwstępny DeepSeek · Otwarte wagi 1 449 ±2 72 1 459 — +92◆ A ›
19 B Hy4 previewwstępny Tencent · Otwarte wagi 1 448 ±3 68 1 458 — — A ›
24 B GLM 5.3wstępny Zhipu AI · Otwarte wagi 1 442 ±3 60 1 451 — +60 A ›
27 B DeepSeek V4 Pro 0423wstępny DeepSeek · Otwarte wagi 1 435 ±7 54 1 445 — +33 A ›
30 C GLM 5.3 Flashwstępny Zhipu AI · Otwarte wagi 1 430 ±2 49 1 439 — +105◆ A ›
32 C Qwen3.8 Flash Nextwstępny Alibaba · Otwarte wagi 1 428 ±3 46 1 437 — — A ›
33 C MiMo-V2.6-Flashwstępny Xiaomi · Otwarte wagi 1 428 ±6 44 1 438 — +98◆ A ›
36 C Qwen3.8 27Bwstępny Alibaba · Otwarte wagi 1 424 ±3 39 1 433 — +46 A ›
42 C Hy3wstępny Tencent · Otwarte wagi 1 408 ±5 28 1 416 — +68 A ›
47 D MiniMax M3wstępny MiniMax · Otwarte wagi 1 402 ±4 19 1 410 — +50 A ›
49 D MiMo-V2.5-Prowstępny Xiaomi · Otwarte wagi 1 399 ±4 16 1 407 — +80 A ›
53 D GLM 5wstępny Zhipu AI · Otwarte wagi 1 388 ±8 7 — 1 411 +23 τ ›
54 D Qwen3.5 397B A17Bwstępny Alibaba · Otwarte wagi 1 388 ±8 7 — 1 411 +27 τ ›
55 D Inkling Smallwstępny Thinking Machines Lab · Otwarte wagi 1 386 ±6 5 1 394 — +38 A ›
56 D Inklingwstępny Thinking Machines Lab · Otwarte wagi 1 384 ±4 4 1 392 — +26 A ›
57 D Mistral Medium 3.5wstępny Mistral AI · Otwarte wagi 1 377 ±6 2 1 384 — -19 A ›
…
A Arena (głosy ludzi)τ τ²-bench (agenci) ◆ Granica Pareto: nic nie jest jednocześnie lepsze i tańsze
fedi-index to ekwiwalent Elo na stałej skali: porównywalny między miesiącami w ramach jednej wersji metodologii. Poziomy S–D: według percentyla w przekroju i nie lepiej, niż pozwala przedział ufności (progi w metodologii). „Wstępny” — tylko jedna rodzina źródeł zmierzyła tu model.
Metodologia
Osadź na swojej stronie
Tabela jako widżet na twoją stronę: aktualizuje się sama i zachowuje atrybucję źródeł.
Język
English
Español
Français
Português (Brasil)
Deutsch
Italiano
繁體中文
Русский
日本語
Bahasa Indonesia
한국어
العربية
ไทย
Türkçe
Polski
Deutsch (Schweiz)
Norsk
Slovenščina
Dansk
Svenska
Nederlands
Ελληνικά
Suomi
Română
Motyw
Automatyczny
Jasny
Ciemny
Wysokość, px
Kod
Kopiuj kod
Skopiowano
JSON
fedi-index © fedi.software, CC BY 4.0; składniki zachowują licencje swoich źródeł.
fedi-index © fedi.software, CC BY 4.0; składniki zachowują licencje swoich źródeł. · Źródła:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.