llama-3.1-tulu-3-70b nel fedi-index
Il punteggio in ogni categoria, da cosa è composto, qualità-prezzo, esecuzione locale e storico.
fedi-index · Generale
C 1.241 ±6
Percentile 27 · #213 · provvisorio
Preferito dalle persone / Risolve compiti
1.244 / —
Voti umani e benchmark, Elo-eq
Qualità-prezzo
—
Sul tuo hardware
Pesi chiusi: solo cloud.
Scomposizione del punteggio
C Generale 1.241 [1.235–1.248] Percentile 27 · #213 · componenti: 5 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1.256 ±5,33 | 1.256 ±5 | 32,4% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1.220 ±9,41 | 1.232 ±8 | 27,6% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1.233 ±7,88 | 1.254 ±8 | 14,6% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1.252 ±12 | 1.264 ±11 | 6,0% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.224 ±13 | 1.236 ±12 | 5,7% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Codice 1.230 [1.212–1.248] Percentile 25 · #208 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1.235 ±12 | 1.235 ±11 | 86,4% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Matematica 1.235 [1.215–1.254] Percentile 28 · #184 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1.242 ±12 | 1.242 ±12 | 83,0% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Scrittura 1.245 [1.228–1.261] Percentile 29 · #190 · componenti: 2 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1.231 ±12 | 1.256 ±13 | 59,0% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1.224 ±13 | 1.236 ±12 | 31,4% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
C Lingua: English 1.250 [1.237–1.263] Percentile 29 · #193 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1.273 ±6,77 | 1.254 ±7 | 92,9% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
D Lingua: Русский 1.262 [1.240–1.284] Percentile 23 · #181 · componenti: 1 provvisorio
| Fonte | Componente | Valore | Elo-eq | Peso | Misurato | Variante |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1.246 ±14 | 1.268 ±12 | 90,5% | 2026-10-02 | — |
Il peso è la quota della componente nel punteggio (il resto è il prior, che avvicina i modelli con pochi dati alla mediana della popolazione). Metodologia
Storico
Gli stessi dati in tabella
| Modello | 2026-10 |
|---|---|
| llama-3.1-tulu-3-70b | 1.241 C |
Badge
Mostra il fedi-index del modello sul tuo sito o in un README. Il badge si aggiorna da solo e rimanda a questa pagina.
Dati CC BY 4.0: mantieni il link a fedi.software.