llama-3.1-tulu-3-70b w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
C 1 241 ±6
Percentyl 27 · #213 · wstępny
Ludzie wolą / Rozwiązuje zadania
1 244 / —
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
—
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
C Ogólny 1 241 [1 235–1 248] Percentyl 27 · #213 · składniki: 5 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1 256 ±5,33 | 1 256 ±5 | 32,4% | 2026-10-02 | — |
| LMArena |
text/hard_prompts
|
1 220 ±9,41 | 1 232 ±8 | 27,6% | 2026-10-02 | — |
| LMArena |
text/instruction_following
|
1 233 ±7,88 | 1 254 ±8 | 14,6% | 2026-10-02 | — |
| LMArena |
text/multi_turn
|
1 252 ±12 | 1 264 ±11 | 6,0% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 224 ±13 | 1 236 ±12 | 5,7% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Programowanie 1 230 [1 212–1 248] Percentyl 25 · #208 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1 235 ±12 | 1 235 ±11 | 86,4% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Matematyka 1 235 [1 215–1 254] Percentyl 28 · #184 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 242 ±12 | 1 242 ±12 | 83,0% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Pisanie 1 245 [1 228–1 261] Percentyl 29 · #190 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 231 ±12 | 1 256 ±13 | 59,0% | 2026-10-02 | — |
| LMArena |
text/longer_query
|
1 224 ±13 | 1 236 ±12 | 31,4% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: English 1 250 [1 237–1 263] Percentyl 29 · #193 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 273 ±6,77 | 1 254 ±7 | 92,9% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
D Język: Русский 1 262 [1 240–1 284] Percentyl 23 · #181 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 246 ±14 | 1 268 ±12 | 90,5% | 2026-10-02 | — |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| llama-3.1-tulu-3-70b | 1 241 C |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.