olmo-3-32b-think w fedi-index
Wynik w każdym przekroju, z czego się składa, opłacalność, uruchomienie lokalne i historia.
fedi-index · Ogólny
C 1 287 ±5
Percentyl 32 · #199 · wstępny
Ludzie wolą / Rozwiązuje zadania
1 294 / —
Głosy ludzi a benchmarki, Elo-eq
Opłacalność
—
Na twoim sprzęcie
Zamknięte wagi: tylko w chmurze.
Rozkład wyniku
C Ogólny 1 287 [1 283–1 292] Percentyl 32 · #199 · składniki: 6 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/overall
|
1 300 ±4,21 | 1 300 ±4 | 28,2% | 2026-10-02 | think |
| LMArena |
text/hard_prompts
|
1 302 ±5,65 | 1 306 ±5 | 27,3% | 2026-10-02 | think |
| LMArena |
text/instruction_following
|
1 275 ±8,01 | 1 295 ±8 | 12,1% | 2026-10-02 | think |
| LMArena |
text/expert
|
1 272 ±18 | 1 290 ±15 | 7,7% | 2026-10-02 | think |
| LMArena |
text/longer_query
|
1 297 ±8,20 | 1 304 ±8 | 6,0% | 2026-10-02 | think |
| LMArena |
text/multi_turn
|
1 290 ±11 | 1 299 ±10 | 5,2% | 2026-10-02 | think |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Programowanie 1 296 [1 282–1 310] Percentyl 33 · #187 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/coding
|
1 319 ±9,38 | 1 309 ±8 | 88,0% | 2026-10-02 | think |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Matematyka 1 289 [1 265–1 314] Percentyl 34 · #168 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1 315 ±16 | 1 312 ±15 | 79,5% | 2026-10-02 | think |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Pisanie 1 282 [1 269–1 296] Percentyl 33 · #180 · składniki: 2 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1 255 ±11 | 1 281 ±11 | 57,4% | 2026-10-02 | think |
| LMArena |
text/longer_query
|
1 297 ±8,20 | 1 304 ±8 | 34,5% | 2026-10-02 | think |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: 繁體中文 1 285 [1 265–1 305] Percentyl 26 · #166 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1 298 ±14 | 1 293 ±11 | 91,0% | 2026-10-02 | think |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
C Język: English 1 324 [1 312–1 335] Percentyl 39 · #168 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1 347 ±6,07 | 1 332 ±6 | 93,1% | 2026-10-02 | think |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
D Język: Русский 1 270 [1 250–1 290] Percentyl 24 · #178 · składniki: 1 wstępny
| Źródło | Składnik | Wartość | Elo-eq | Waga | Pomiar | Wariant |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1 255 ±13 | 1 277 ±11 | 91,1% | 2026-10-02 | think |
Waga to udział składnika w wyniku (reszta to prior, który przyciąga modele z małą ilością danych do mediany populacji). Metodologia
Historia
To samo w tabeli
| Model | 2026-10 |
|---|---|
| olmo-3-32b-think | 1 287 C |
Odznaka
Pokaż fedi-index modelu na swojej stronie lub w README. Odznaka aktualizuje się sama i prowadzi do tej strony.
Dane CC BY 4.0: zachowaj link do fedi.software.