Ogólny
Programowanie
Agenci
Matematyka
Obraz
Wyszukiwanie
Pisanie
Język: Polski
Dane bieżące za 2026-10 (przeliczane codziennie)
· Metodologia v1
· Metodologia
· Historia
· JSON
#
Tier
Model
fedi-index
Percentyl
Opłacalność
Źródła
Rozkład wyniku
1 A GPT-5.6 Solwstępny OpenAI 1 482 ±7 100,0 +40 A ›
2 A claude-opus-4-6-searchwstępny Anthropic 1 479 ±5 97 — A ›
3 A gpt-5.5-searchwstępny OpenAI 1 468 ±5 94 — A ›
4 A Claude Opus 4.7wstępny Anthropic 1 460 ±5 91 +35 A ›
5 A Claude Fable 5wstępny Anthropic 1 456 ±8 88 +33 A ›
6 A ernie-5.1wstępny Baidu 1 452 ±9 84 +52 A ›
7 A claude-sonnet-4-6-searchwstępny Anthropic 1 448 ±5 81 — A ›
8 B Grok 4.5wstępny xAI 1 439 ±7 78 +35 A ›
9 B gemini-3.1-pro-groundingwstępny Google 1 438 ±5 75 — A ›
10 B gemini-3-pro-groundingwstępny Google 1 434 ±5 72 — A ›
11 B gpt-5.2-searchwstępny OpenAI 1 434 ±5 69 — A ›
12 B Grok 4.20 Multi-Agentwstępny xAI 1 431 ±5 66 +24 A ›
13 B Claude Opus 4.8wstępny Anthropic 1 431 ±6 62 +27 A ›
14 B gpt-5.1-searchwstępny OpenAI 1 427 ±5 59 — A ›
15 B gemini-3-flash-groundingwstępny Google 1 426 ±5 56 — A ›
16 B gpt-5.4-searchwstępny OpenAI 1 425 ±5 53 — A ›
17 B claude-sonnet-5-searchwstępny Anthropic 1 421 ±7 50 — A ›
18 C Grok 4.20wstępny xAI 1 417 ±6 47 +33 A ›
19 C claude-opus-4-5-searchwstępny Anthropic 1 408 ±5 44 — A ›
20 C grok-4-1-fast-searchwstępny xAI 1 399 ±5 41 — A ›
21 C grok-4-fast-searchwstępny xAI 1 399 ±4 38 — A ›
22 C Grok 4.3wstępny xAI 1 393 ±5 34 +4 A ›
23 C claude-sonnet-4-5-searchwstępny Anthropic 1 387 ±5 31 — A ›
24 C claude-opus-4-1-searchwstępny Anthropic 1 377 ±5 28 — A ›
25 C o3-searchwstępny OpenAI 1 373 ±5 25 — A ›
26 D gemini-2.5-pro-groundingwstępny Google 1 371 ±4 22 — A ›
27 D grok-4-searchwstępny xAI 1 370 ±6 19 — A ›
28 D ppl-sonar-reasoning-pro-highwstępny Perplexity 1 368 ±6 16 — A ›
29 D gpt-5-searchwstępny OpenAI 1 362 ±6 12 — A ›
30 D ppl-sonar-pro-highwstępny Perplexity 1 359 ±6 9 — A ›
31 D claude-opus-4-searchwstępny Anthropic 1 356 ±5 6 — A ›
32 D diffbot-small-xlwstępny Diffbot 1 255 ±8 3 — A ›
33 D api-gpt-4o-searchwstępny OpenAI 1 239 ±11 0 — A ›
…
A Arena (głosy ludzi) ◆ Granica Pareto: nic nie jest jednocześnie lepsze i tańsze
fedi-index to ekwiwalent Elo na stałej skali: porównywalny między miesiącami w ramach jednej wersji metodologii. Poziomy S–D: według percentyla w przekroju i nie lepiej, niż pozwala przedział ufności (progi w metodologii). Ten przekrój ma jedną rodzinę źródeł, więc wszystkie jego wyniki są wstępne.
Metodologia
Osadź na swojej stronie
Tabela jako widżet na twoją stronę: aktualizuje się sama i zachowuje atrybucję źródeł.
Język
English
Español
Français
Português (Brasil)
Deutsch
Italiano
繁體中文
Русский
日本語
Bahasa Indonesia
한국어
العربية
ไทย
Türkçe
Polski
Deutsch (Schweiz)
Norsk
Slovenščina
Dansk
Svenska
Nederlands
Ελληνικά
Suomi
Română
Motyw
Automatyczny
Jasny
Ciemny
Wysokość, px
Kod
Kopiuj kod
Skopiowano
JSON
fedi-index © fedi.software, CC BY 4.0; składniki zachowują licencje swoich źródeł.
fedi-index © fedi.software, CC BY 4.0; składniki zachowują licencje swoich źródeł. · Źródła:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.