Γενικά
Προγραμματισμός
Πράκτορες
Μαθηματικά
Όραση
Αναζήτηση
Γραφή
Ζωντανά δεδομένα για 2026-10 (επανυπολογίζονται καθημερινά)
· Μεθοδολογία v1
· Μεθοδολογία
· Ιστορικό
· JSON
#
Βαθμίδα
Μοντέλο
fedi-index
Εκατοστημόριο
Προτιμούν οι άνθρωποι
Λύνει εργασίες
Σχέση τιμής-απόδοσης
Πηγές
Ανάλυση βαθμολογίας
13 B Kimi K3 Moonshot AI · Ανοιχτά βάρη 1.456 ±5 79 1.459 1.449 +44 A τ ›
14 B GLM 5.2 Zhipu AI · Ανοιχτά βάρη 1.454 ±5 77 1.456 1.449 +45 A τ ›
17 B DeepSeek V4.1 Flashπροσωρινό DeepSeek · Ανοιχτά βάρη 1.449 ±2 72 1.459 — +92◆ A ›
19 B Hy4 previewπροσωρινό Tencent · Ανοιχτά βάρη 1.448 ±3 68 1.458 — — A ›
24 B GLM 5.3προσωρινό Zhipu AI · Ανοιχτά βάρη 1.442 ±3 60 1.451 — +60 A ›
27 B DeepSeek V4 Pro 0423προσωρινό DeepSeek · Ανοιχτά βάρη 1.435 ±7 54 1.445 — +33 A ›
30 C GLM 5.3 Flashπροσωρινό Zhipu AI · Ανοιχτά βάρη 1.430 ±2 49 1.439 — +105◆ A ›
32 C Qwen3.8 Flash Nextπροσωρινό Alibaba · Ανοιχτά βάρη 1.428 ±3 46 1.437 — — A ›
33 C MiMo-V2.6-Flashπροσωρινό Xiaomi · Ανοιχτά βάρη 1.428 ±6 44 1.438 — +98◆ A ›
36 C Qwen3.8 27Bπροσωρινό Alibaba · Ανοιχτά βάρη 1.424 ±3 39 1.433 — +46 A ›
42 C Hy3προσωρινό Tencent · Ανοιχτά βάρη 1.408 ±5 28 1.416 — +68 A ›
47 D MiniMax M3προσωρινό MiniMax · Ανοιχτά βάρη 1.402 ±4 19 1.410 — +50 A ›
49 D MiMo-V2.5-Proπροσωρινό Xiaomi · Ανοιχτά βάρη 1.399 ±4 16 1.407 — +80 A ›
53 D GLM 5προσωρινό Zhipu AI · Ανοιχτά βάρη 1.388 ±8 7 — 1.411 +23 τ ›
54 D Qwen3.5 397B A17Bπροσωρινό Alibaba · Ανοιχτά βάρη 1.388 ±8 7 — 1.411 +27 τ ›
55 D Inkling Smallπροσωρινό Thinking Machines Lab · Ανοιχτά βάρη 1.386 ±6 5 1.394 — +38 A ›
56 D Inklingπροσωρινό Thinking Machines Lab · Ανοιχτά βάρη 1.384 ±4 4 1.392 — +27 A ›
57 D Mistral Medium 3.5προσωρινό Mistral AI · Ανοιχτά βάρη 1.377 ±6 2 1.384 — -19 A ›
…
A Arena (ψήφοι ανθρώπων)τ τ²-bench (πράκτορες) ◆ Μέτωπο Pareto: τίποτα δεν είναι ταυτόχρονα καλύτερο και φθηνότερο
Το fedi-index είναι ισοδύναμο Elo σε σταθερή κλίμακα: συγκρίσιμο μεταξύ μηνών εντός μίας έκδοσης μεθοδολογίας. Βαθμίδες S–D: κατά εκατοστημόριο στην ενότητα και όχι καλύτερα απ' όσο επιτρέπει το διάστημα εμπιστοσύνης (όρια στη μεθοδολογία). «Προσωρινό» — μόνο μία οικογένεια πηγών μέτρησε το μοντέλο εδώ.
Μεθοδολογία
Ενσωμάτωση στον ιστότοπό σας
Ο πίνακας ως widget για τον ιστότοπό σας: ενημερώνεται αυτόματα και διατηρεί την αναφορά των πηγών.
Γλώσσα
English
Español
Français
Português (Brasil)
Deutsch
Italiano
繁體中文
Русский
日本語
Bahasa Indonesia
한국어
العربية
ไทย
Türkçe
Polski
Deutsch (Schweiz)
Norsk
Slovenščina
Dansk
Svenska
Nederlands
Ελληνικά
Suomi
Română
Θέμα
Αυτόματο
Φωτεινό
Σκοτεινό
Ύψος, px
Κώδικας
Αντιγραφή κώδικα
Αντιγράφηκε
JSON
fedi-index © fedi.software, CC BY 4.0· οι συνιστώσες διατηρούν τις άδειες των πηγών τους.
fedi-index © fedi.software, CC BY 4.0· οι συνιστώσες διατηρούν τις άδειες των πηγών τους. · Πηγές:
LMArena (CC BY 4.0),
Epoch AI (CC BY 4.0),
τ²-bench (Sierra) (MIT),
models.dev (MIT),
LiteLLM (MIT)
Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (equated, weighted, aggregated). Not endorsed by LMArena.
Epoch AI, 'Capabilities & benchmarking'. Published online at epoch.ai. Retrieved from 'https://epoch.ai/benchmarks'. CC BY. ECI by Epoch AI; Epoch-run results only. Modified by fedi.software.
τ²-bench leaderboard, © Sierra Research, MIT License (Yao et al. 2024, arXiv:2406.12045; Barres et al. 2025, arXiv:2506.07982). Sierra-run text submissions only.
Pricing: models.dev, MIT License, © 2025 models.dev.
Pricing: LiteLLM model_prices_and_context_window.json, MIT License, © 2023 Berri AI.