Ir para o conteúdo
fedi.software

gpt-oss-120b no fedi-index

A pontuação em cada categoria, do que ela é composta, custo-benefício, execução local e histórico.

fedi-index · Geral

C 1.344 ±8

Percentil 45 · #161

Preferido por pessoas / Resolve tarefas

1.345 / 1.341

Votos humanos vs. benchmarks, Elo-eq

Custo-benefício

-2

US$ 0,2625 por 1 mi de tokens, mediana de 52 provedores

No seu hardware

  • GPU 12 GB #8 · MXFP4 · ≈19 tok/s
  • GPU 24 GB #12 · MXFP4 · ≈25 tok/s
  • 128 GB de memória unificada #17 · MXFP4 · ≈44 tok/s

Decomposição da pontuação

C Geral 1.344 [1.335–1.352] Percentil 45 · #161 · componentes: 8
Fonte Componente Valor Elo-eq Peso Medido em Variante
Epoch AI eci 140 ±1,93 1.358 ±15 27,9% 2025-08-05 —
LMArena text/overall 1.365 ±2,23 1.365 ±2 18,4% 2026-10-02 —
LMArena text/hard_prompts 1.364 ±2,88 1.362 ±3 18,3% 2026-10-02 —
LMArena text/instruction_following 1.318 ±3,60 1.335 ±3 9,0% 2026-10-02 —
LMArena text/expert 1.356 ±8,15 1.358 ±7 7,9% 2026-10-02 —
LMArena text/longer_query 1.319 ±3,92 1.325 ±4 4,4% 2026-10-02 —
LMArena text/multi_turn 1.340 ±4,45 1.344 ±4 4,4% 2026-10-02 —
Epoch AI gpqa_diamond defasagem ×0,26 0,76 ±0,03 1.392 ±13 1,5% 2025-12-11 high

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Código 1.348 [1.341–1.354] Percentil 43 · #158 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/coding 1.380 ±3,95 1.364 ±4 90,1% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Matemática 1.359 [1.347–1.370] Percentil 48 · #134 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/math 1.388 ±7,07 1.382 ±7 86,9% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Escrita 1.301 [1.295–1.308] Percentil 38 · #166 · componentes: 2 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/creative_writing 1.274 ±4,99 1.300 ±5 61,3% 2026-10-02 —
LMArena text/longer_query 1.319 ±3,92 1.325 ±4 32,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: 繁體中文 1.351 [1.342–1.360] Percentil 39 · #137 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/chinese 1.384 ±6,47 1.362 ±5 93,5% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Deutsch 1.349 [1.331–1.367] Percentil 34 · #95 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/german 1.354 ±12 1.362 ±10 91,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: English 1.352 [1.346–1.357] Percentil 46 · #148 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/english 1.375 ±3,00 1.361 ±3 93,9% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Español 1.372 [1.354–1.390] Percentil 30 · #105 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/spanish 1.388 ±11 1.388 ±10 91,7% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: Français 1.343 [1.320–1.367] Percentil 22 · #106 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/french 1.370 ±14 1.359 ±13 90,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: 日本語 1.362 [1.344–1.379] Percentil 33 · #86 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/japanese 1.332 ±13 1.376 ±10 91,8% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: 한국어 1.335 [1.318–1.352] Percentil 23 · #105 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/korean 1.283 ±12 1.346 ±9 92,0% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

D Idioma: Polski 1.357 [1.345–1.368] Percentil 19 · #106 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/polish 1.354 ±7,40 1.368 ±6 93,2% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

C Idioma: Русский 1.345 [1.335–1.356] Percentil 40 · #140 · componentes: 1 provisório
Fonte Componente Valor Elo-eq Peso Medido em Variante
LMArena text/russian 1.343 ±6,40 1.355 ±6 93,3% 2026-10-02 —

O peso é a participação do componente na pontuação (o restante é o prior, que puxa modelos com poucos dados para a mediana da população). Metodologia

Histórico

fedi-index por mês
O mesmo em tabela
Modelo 2026-10
gpt-oss-120b 1.344 C

Selo

Mostre o fedi-index do modelo no seu site ou em um README. O selo se atualiza sozinho e leva a esta página.

fedi-index: gpt-oss-120b

Dados CC BY 4.0: mantenha o link para fedi.software.