Data langsung 2026-10 (dihitung ulang setiap hari)
· Metodologi v1
· Metodologi
· Riwayat
· JSON
#
Tier
Model
fedi-index
Persentil
Nilai
Sumber
Rincian skor
12 A GLM 5.3 Flashsementara Zhipu AI · Bobot terbuka 1.454 ±19 92 +105◆ A ›
14 A MiMo-V2.5-Prosementara Xiaomi · Bobot terbuka 1.451 ±12 90 +80 A ›
17 A Kimi K3sementara Moonshot AI · Bobot terbuka 1.448 ±17 88 +44 A ›
22 A GLM 5.3sementara Zhipu AI · Bobot terbuka 1.447 ±22 84 +60 A ›
25 A GLM 5.2sementara Zhipu AI · Bobot terbuka 1.440 ±14 82 +45 A ›
27 A GLM 5.1sementara Zhipu AI · Bobot terbuka 1.438 ±13 81 +36 A ›
31 B DeepSeek V4 Pro 0423sementara DeepSeek · Bobot terbuka 1.435 ±12 78 +33 A ›
35 B Kimi K2.6sementara Moonshot AI · Bobot terbuka 1.434 ±14 75 +44 A ›
40 B Nemotron 3 Ultrasementara NVIDIA · Bobot terbuka 1.428 ±23 71 +33 A ›
41 B Qwen3.5 397B A17Bsementara Alibaba · Bobot terbuka 1.427 ±11 70 +27 A ›
42 B Qwen3.8 27Bsementara Alibaba · Bobot terbuka 1.426 ±21 69 +46 A ›
47 B GLM 4.6sementara Zhipu AI · Bobot terbuka 1.421 ±19 66 +26 A ›
51 B Kimi K2.5sementara Moonshot AI · Bobot terbuka 1.420 ±11 63 +36 A ›
54 B Inklingsementara Thinking Machines Lab · Bobot terbuka 1.419 ±16 60 +27 A ›
55 B GLM 5sementara Zhipu AI · Bobot terbuka 1.418 ±17 60 +23 A ›
60 B Hy3sementara Tencent · Bobot terbuka 1.414 ±25 56 +68 A ›
62 B MiMo-V2.5sementara Xiaomi · Bobot terbuka 1.413 ±13 54 +75 A ›
63 B MiniMax M3sementara MiniMax · Bobot terbuka 1.413 ±13 54 +50 A ›
67 B Mistral Medium 3.5sementara Mistral AI · Bobot terbuka 1.408 ±24 51 -19 A ›
69 C Qwen3.5-122B-A10Bsementara Alibaba · Bobot terbuka 1.407 ±17 49 +14 A ›
70 C DeepSeek V4 Flash 0423sementara DeepSeek · Bobot terbuka 1.407 ±13 48 +71 A ›
77 C Inkling Smallsementara Thinking Machines Lab · Bobot terbuka 1.396 ±18 43 +38 A ›
80 C MiniMax M2.7sementara MiniMax · Bobot terbuka 1.393 ±11 41 +32 A ›
81 C Step 3.5 Flashsementara StepFun · Bobot terbuka 1.392 ±12 40 +50 A ›
82 C GLM 4.7sementara Zhipu AI · Bobot terbuka 1.391 ±27 40 +20 A ›
83 C MiMo-V2-Flashsementara Xiaomi · Bobot terbuka 1.391 ±25 39 +55◆ A ›
84 C GLM 4.5sementara Zhipu AI · Bobot terbuka 1.385 ±26 38 +18 A ›
87 C Qwen3.5-35B-A3Bsementara Alibaba · Bobot terbuka 1.382 ±18 36 +11 A ›
88 C Qwen3 30B A3B Instruct 2507sementara Alibaba · Bobot terbuka 1.382 ±26 35 +25 A ›
90 C Qwen3.5-27Bsementara Alibaba · Bobot terbuka 1.379 ±18 34 +14 A ›
91 C Qwen3 Next 80B A3B Instructsementara Alibaba · Bobot terbuka 1.379 ±25 33 +32 A ›
93 C MiniMax M2.1sementara MiniMax · Bobot terbuka 1.372 ±23 31 +18 A ›
97 C GLM 4.5 Airsementara Zhipu AI · Bobot terbuka 1.368 ±23 28 -2 A ›
98 C Nemotron 3 Nano 30B A3Bsementara NVIDIA · Bobot terbuka 1.364 ±25 28 +6 A ›
99 C Qwen3 Coder 480B A35Bsementara Alibaba · Bobot terbuka 1.362 ±25 27 -22 A ›
106 D gpt-oss-120bsementara OpenAI · Bobot terbuka 1.343 ±23 22 -2 A ›
107 D MiniMax M1sementara MiniMax · Bobot terbuka 1.343 ±23 21 -36 A ›
109 D Trinity Large Thinkingsementara Arcee AI · Bobot terbuka 1.342 ±17 19 -30 A ›
111 D MiniMax M2.5sementara MiniMax · Bobot terbuka 1.341 ±15 18 +9 A ›
115 D Qwen3 30B A3Bsementara Alibaba · Bobot terbuka 1.326 ±25 15 -29 A ›
116 D gemma-3n-e4b-itsementara Google · Bobot terbuka 1.309 ±27 14 — A ›
123 D mixtral-8x22b-instruct-v0.1sementara Mistral AI · Bobot terbuka 1.174 ±22 9 -236 A ›
…
A Arena (suara manusia) ◆ Frontier Pareto: tidak ada yang lebih baik sekaligus lebih murah
fedi-index adalah setara Elo pada skala tetap: dapat dibandingkan antarbulan dalam satu versi metodologi. Tier S–D: berdasarkan persentil di kategori, dan tidak lebih tinggi dari yang diizinkan interval kepercayaan (ambang batas ada di metodologi). Kategori ini hanya punya satu keluarga sumber, jadi semua skornya bersifat sementara.
Metodologi
fedi-index © fedi.software, CC BY 4.0; komponen tetap memakai lisensi sumbernya. · Sumber:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.