Generale
Codice
Agenti
Matematica
Visione
Ricerca
Scrittura
Dati in tempo reale di 2026-10 (ricalcolati ogni giorno)
· Metodologia v1
· Metodologia
· Storico
· JSON
#
Tier
Modello
fedi-index
Percentile
Preferito dalle persone
Risolve compiti
Qualità-prezzo
Fonti
Scomposizione del punteggio
13 B Kimi K3 Moonshot AI · Pesi aperti 1.456 ±5 79 1.459 1.449 +44 A τ ›
14 B GLM 5.2 Zhipu AI · Pesi aperti 1.454 ±5 77 1.456 1.449 +45 A τ ›
17 B DeepSeek V4.1 Flashprovvisorio DeepSeek · Pesi aperti 1.449 ±2 72 1.459 — +92◆ A ›
19 B Hy4 previewprovvisorio Tencent · Pesi aperti 1.448 ±3 68 1.458 — — A ›
24 B GLM 5.3provvisorio Zhipu AI · Pesi aperti 1.442 ±3 60 1.451 — +60 A ›
27 B DeepSeek V4 Pro 0423provvisorio DeepSeek · Pesi aperti 1.435 ±7 54 1.445 — +33 A ›
30 C GLM 5.3 Flashprovvisorio Zhipu AI · Pesi aperti 1.430 ±2 49 1.439 — +105◆ A ›
32 C Qwen3.8 Flash Nextprovvisorio Alibaba · Pesi aperti 1.428 ±3 46 1.437 — — A ›
33 C MiMo-V2.6-Flashprovvisorio Xiaomi · Pesi aperti 1.428 ±6 44 1.438 — +98◆ A ›
36 C Qwen3.8 27Bprovvisorio Alibaba · Pesi aperti 1.424 ±3 39 1.433 — +46 A ›
42 C Hy3provvisorio Tencent · Pesi aperti 1.408 ±5 28 1.416 — +68 A ›
47 D MiniMax M3provvisorio MiniMax · Pesi aperti 1.402 ±4 19 1.410 — +50 A ›
49 D MiMo-V2.5-Proprovvisorio Xiaomi · Pesi aperti 1.399 ±4 16 1.407 — +80 A ›
53 D GLM 5provvisorio Zhipu AI · Pesi aperti 1.388 ±8 7 — 1.411 +23 τ ›
54 D Qwen3.5 397B A17Bprovvisorio Alibaba · Pesi aperti 1.388 ±8 7 — 1.411 +27 τ ›
55 D Inkling Smallprovvisorio Thinking Machines Lab · Pesi aperti 1.386 ±6 5 1.394 — +38 A ›
56 D Inklingprovvisorio Thinking Machines Lab · Pesi aperti 1.384 ±4 4 1.392 — +26 A ›
57 D Mistral Medium 3.5provvisorio Mistral AI · Pesi aperti 1.377 ±6 2 1.384 — -19 A ›
…
A Arena (voti umani)τ τ²-bench (agenti) ◆ Frontiera di Pareto: nulla è insieme migliore e più economico
Il fedi-index è un equivalente Elo su scala fissa: confrontabile tra i mesi all'interno della stessa versione della metodologia. Tier S–D: in base al percentile nella categoria e non oltre quanto consente l'intervallo di confidenza (soglie nella metodologia). «Provvisorio»: solo una famiglia di fonti ha misurato il modello qui.
Metodologia
Incorpora nel tuo sito
La tabella come widget per il tuo sito: si aggiorna da sola e mantiene l'attribuzione delle fonti.
Lingua
English
Español
Français
Português (Brasil)
Deutsch
Italiano
繁體中文
Русский
日本語
Bahasa Indonesia
한국어
العربية
ไทย
Türkçe
Polski
Deutsch (Schweiz)
Norsk
Slovenščina
Dansk
Svenska
Nederlands
Ελληνικά
Suomi
Română
Tema
Automatico
Chiaro
Scuro
Altezza, px
Codice
Copia codice
Copiato
JSON
fedi-index © fedi.software, CC BY 4.0; le componenti mantengono le licenze delle rispettive fonti.
fedi-index © fedi.software, CC BY 4.0; le componenti mantengono le licenze delle rispettive fonti. · Fonti:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.