llama-3.1-tulu-3-8b w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
D 1 194 ±7
Percentyl 22 · #228 · wstępny
Ludzie wolą / Rozwiązuje zadania
1 193 / —
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
—
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
D Ogólny 1 194 [1 187–1 200] Percentyl 22 · #228 · składniki: 5 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1 193 ±5,35 | 1 193 ±5 | 32,8% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1 174 ±9,98 | 1 191 ±9 | 27,2% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1 174 ±7,87 | 1 199 ±8 | 14,8% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1 154 ±13 | 1 175 ±12 | 5,8% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 181 ±13 | 1 196 ±12 | 5,6% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
D Programowanie 1 190 [1 172–1 209] Percentyl 21 · #220 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1 183 ±12 | 1 188 ±11 | 86,2% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
D Matematyka 1 197 [1 177–1 218] Percentyl 24 · #195 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 195 ±13 | 1 196 ±12 | 82,6% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
D Pisanie 1 202 [1 185–1 219] Percentyl 23 · #206 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 182 ±13 | 1 205 ±13 | 58,9% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 181 ±13 | 1 196 ±12 | 31,4% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
D Język: English 1 193 [1 180–1 206] Percentyl 25 · #206 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 215 ±6,94 | 1 192 ±7 | 92,8% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
D Język: Русский 1 219 [1 199–1 239] Percentyl 16 · #196 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 193 ±13 | 1 221 ±11 | 91,1% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| llama-3.1-tulu-3-8b | 1 194 D |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.