Mercury 2 nel fedi-index
Il punteggio in ogni categoria, da cosa è composto, qualità-prezzo, esecuzione locale e storico.
fedi-index · Generale
C 1.334 ±6
Percentile 44 · #165 · provvisorio
Preferito dalle persone / Risolve compiti
1.344 / —
Voti umani e benchmark, Elo-eq
Qualità-prezzo
-20
0,375 USD per 1 M di token, mediana di 3 provider · produttore 0,375 USD
Sul tuo hardware
Pesi chiusi: solo cloud.
Scomposizione del punteggio
C Generale 1.334 [1.328–1.340] Percentile 44 · #165 · componenti: 5 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1.355 ±5,28 | 1.355 ±5 | 31,5% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1.362 ±6,78 | 1.360 ±6 | 30,3% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1.328 ±9,76 | 1.345 ±9 | 12,8% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.329 ±9,80 | 1.334 ±9 | 6,4% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1.358 ±13 | 1.360 ±12 | 5,6% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Codice 1.346 [1.338–1.353] Percentile 42 · #163 · componenti: 2 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1.170 ±12 | 1.356 ±4 | 50,2% | 2026-10-01 | — |
| LMArena |
text/coding
|
1.391 ±10 | 1.373 ±9 | 38,7% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Scrittura 1.311 [1.296–1.327] Percentile 40 · #162 · componenti: 2 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.288 ±13 | 1.314 ±13 | 54,9% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.329 ±9,80 | 1.334 ±9 | 35,8% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Lingua: English 1.353 [1.337–1.369] Percentile 46 · #147 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.379 ±8,39 | 1.366 ±9 | 92,2% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Lingua: Русский 1.308 [1.286–1.331] Percentile 31 · #161 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.303 ±14 | 1.320 ±12 | 90,4% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
Storico
Gli stessi dati in tabella
| Modello | 2026-10 |
|---|---|
| Mercury 2 | 1.334 C |
Badge
Mostra il fedi-index del modello sul tuo sito o in un README. Il badge si aggiorna da solo e rimanda a questa pagina.
Dati CC BY 4.0: mantieni il link a fedi.software.