Ir para o conteúdo
fedi.software

Texto

Modelos de chat classificados por votos humanos às cegas no LMArena, com o intervalo de confiança de cada nota e o preço atual por milhão de tokens.

Atualizado · Fontes: LMArena, LiteLLM, models.dev

Custo por mês
Tier Modelo Elo Entrada / saída, por 1M Por mês Contexto App Comparar
S1.451US$ 1,25 / US$ 2,50 1M
A1.450US$ 1,25 / US$ 2,50 1M
A1.448US$ 2 / US$ 6 500K
A1.444US$ 1,25 / US$ 2,50 2M
A1.437US$ 2 / US$ 10 200K
A1.428US$ 0,50 / US$ 1,50 262K
A1.427US$ 1,25 / US$ 6 500K
A1.426US$ 3 / US$ 15 131K
A1.424US$ 0,40 / US$ 2 262K
A1.421US$ 1,50 / US$ 7,50 256K
A1.411US$ 2,70 / US$ 13,50 256K
B1.400US$ 1,60 / US$ 4,80 500K
B1.397US$ 1,25 / US$ 2,50 1M
B1.370US$ 0,36 / US$ 1,22 131K
B1.369US$ 0,30 / US$ 0,50 131K
B1.338US$ 0,075 / US$ 0,20 128K
B1.305US$ 2 / US$ 10 131K
B1.281— —
B1.278US$ 0,10 / US$ 0,30 128K
C1.266US$ 2 / US$ 6 131K
C1.265US$ 0,50 / US$ 1,50 131K
C1.255US$ 2 / US$ 5 128K
C1.234US$ 0,05 / US$ 0,08 33K
C1.191US$ 0,10 / US$ 0,10 128K
C1.162US$ 0,60 / US$ 0,60 66K
C1.132US$ 0,15 / US$ 0,15 32K
D1.090US$ 0,05 / US$ 0,25 32K
D1.023US$ 0,07 / US$ 0,28 33K
Comparar ()

Os tiers são nossos: a posição de um modelo no ranking, contando só os modelos cujo intervalo de confiança inteiro fica acima dele. S — 10% do topo, A — até 30%, B — até 60%, C — até 85%, D — o restante.

Qualidade x preço nota no eixo vertical, preço combinado (3 partes de entrada : 1 de saída) no horizontal, USD por 1M de tokens
1.000 1.200 1.400 1.600 US$ 0,01 US$ 0,10 US$ 1 US$ 10 US$ 100 Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5

O que este ranking mede

Este é o ranking de modelos de chat, baseado na arena de texto do LMArena, categoria geral. Funciona assim: uma pessoa envia uma pergunta, recebe duas respostas de modelos anônimos e vota na que preferiu. Milhares desses votos viram uma nota no estilo Elo. Ou seja, a nota mostra a preferência dos usuários da arena, na maioria com perguntas em inglês; ela não mede velocidade, custo nem o desempenho em uma tarefa específica sua.

Como ler cada linha

  • Tier e nota: a barra ao lado da nota é o intervalo de confiança de 95%. Quando os intervalos de dois modelos se sobrepõem, a diferença entre eles não é estatisticamente clara — por isso vários modelos podem dividir o tier mais alto.
  • Preço: o menor preço por 1M de tokens de entrada e de saída que encontramos entre os provedores naquele dia, em USD, com a tendência dos últimos 30 dias.
  • Contexto, fabricante e “Pesos abertos”: para saber quanto texto cabe numa conversa e se o modelo pode ser baixado.
  • “Ainda sem tier”: aparece para modelos com menos de 300 votos.

Um clique na linha abre os detalhes: provedores do mais barato ao mais caro, modalidades, saída máxima, votos, posição na fonte, licença, data de lançamento e data de corte do conhecimento. Se o app do modelo estiver no nosso catálogo, aparece o botão para baixá-lo.

Filtros, custo e gráfico

Os filtros separam modelos com pesos abertos, grátis, com “Preço baixo” (preço combinado abaixo de 1 USD por 1M de tokens) e por fabricante. A calculadora “Custo por mês” estima o gasto a partir dos tokens por mês e da parcela de entrada. O gráfico “Qualidade x preço” usa o preço combinado, na proporção de 3 partes de entrada para 1 de saída. Marque a caixa de comparação em até 4 modelos para vê-los lado a lado na página de comparação.

Cuidados com o preço

O preço do provedor pode ser diferente do preço do fabricante. Descontos por cache, processamento em lote e preços regionais não aparecem na tabela. Antes de fechar um orçamento, confira a página do provedor escolhido. Para código, veja também o ranking de programação.