Umum
Coding
Agen
Matematika
Vision
Pencarian
Menulis
Data langsung 2026-10 (dihitung ulang setiap hari)
· Metodologi v1
· Metodologi
· Riwayat
· JSON
#
Tier
Model
fedi-index
Persentil
Nilai
Sumber
Rincian skor
1 A GPT-5.6 Solsementara OpenAI 1.482 ±7 100,0 +40 A ›
2 A claude-opus-4-6-searchsementara Anthropic 1.479 ±5 97 — A ›
3 A gpt-5.5-searchsementara OpenAI 1.468 ±5 94 — A ›
4 A Claude Opus 4.7sementara Anthropic 1.460 ±5 91 +35 A ›
5 A Claude Fable 5sementara Anthropic 1.456 ±8 88 +33 A ›
6 A ernie-5.1sementara Baidu 1.452 ±9 84 +52 A ›
7 A claude-sonnet-4-6-searchsementara Anthropic 1.448 ±5 81 — A ›
8 B Grok 4.5sementara xAI 1.439 ±7 78 +35 A ›
9 B gemini-3.1-pro-groundingsementara Google 1.438 ±5 75 — A ›
10 B gemini-3-pro-groundingsementara Google 1.434 ±5 72 — A ›
11 B gpt-5.2-searchsementara OpenAI 1.434 ±5 69 — A ›
12 B Grok 4.20 Multi-Agentsementara xAI 1.431 ±5 66 +24 A ›
13 B Claude Opus 4.8sementara Anthropic 1.431 ±6 62 +27 A ›
14 B gpt-5.1-searchsementara OpenAI 1.427 ±5 59 — A ›
15 B gemini-3-flash-groundingsementara Google 1.426 ±5 56 — A ›
16 B gpt-5.4-searchsementara OpenAI 1.425 ±5 53 — A ›
17 B claude-sonnet-5-searchsementara Anthropic 1.421 ±7 50 — A ›
18 C Grok 4.20sementara xAI 1.417 ±6 47 +33 A ›
19 C claude-opus-4-5-searchsementara Anthropic 1.408 ±5 44 — A ›
20 C grok-4-1-fast-searchsementara xAI 1.399 ±5 41 — A ›
21 C grok-4-fast-searchsementara xAI 1.399 ±4 38 — A ›
22 C Grok 4.3sementara xAI 1.393 ±5 34 +4 A ›
23 C claude-sonnet-4-5-searchsementara Anthropic 1.387 ±5 31 — A ›
24 C claude-opus-4-1-searchsementara Anthropic 1.377 ±5 28 — A ›
25 C o3-searchsementara OpenAI 1.373 ±5 25 — A ›
26 D gemini-2.5-pro-groundingsementara Google 1.371 ±4 22 — A ›
27 D grok-4-searchsementara xAI 1.370 ±6 19 — A ›
28 D ppl-sonar-reasoning-pro-highsementara Perplexity 1.368 ±6 16 — A ›
29 D gpt-5-searchsementara OpenAI 1.362 ±6 12 — A ›
30 D ppl-sonar-pro-highsementara Perplexity 1.359 ±6 9 — A ›
31 D claude-opus-4-searchsementara Anthropic 1.356 ±5 6 — A ›
32 D diffbot-small-xlsementara Diffbot 1.255 ±8 3 — A ›
33 D api-gpt-4o-searchsementara OpenAI 1.239 ±11 0 — A ›
…
A Arena (suara manusia) ◆ Frontier Pareto: tidak ada yang lebih baik sekaligus lebih murah
fedi-index adalah setara Elo pada skala tetap: dapat dibandingkan antarbulan dalam satu versi metodologi. Tier S–D: berdasarkan persentil di kategori, dan tidak lebih tinggi dari yang diizinkan interval kepercayaan (ambang batas ada di metodologi). Kategori ini hanya punya satu keluarga sumber, jadi semua skornya bersifat sementara.
Metodologi
Sematkan di situs Anda
Tabel sebagai widget untuk situs Anda: diperbarui otomatis dan tetap mencantumkan atribusi sumber.
Bahasa
English
Español
Français
Português (Brasil)
Deutsch
Italiano
繁體中文
Русский
日本語
Bahasa Indonesia
한국어
العربية
ไทย
Türkçe
Polski
Deutsch (Schweiz)
Norsk
Slovenščina
Dansk
Svenska
Nederlands
Ελληνικά
Suomi
Română
Tema
Otomatis
Terang
Gelap
Tinggi, px
Kode
Salin kode
Tersalin
JSON
fedi-index © fedi.software, CC BY 4.0; komponen tetap memakai lisensi sumbernya.
fedi-index © fedi.software, CC BY 4.0; komponen tetap memakai lisensi sumbernya. · Sumber:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.