Ir para o conteúdo
fedi.software

Texto

Modelos de chat classificados por votos humanos às cegas no LMArena, com o intervalo de confiança de cada nota e o preço atual por milhão de tokens.

Atualizado · Fontes: LMArena, LiteLLM, models.dev

Custo por mês
Tier Modelo Elo Entrada / saída, por 1M Por mês Contexto App Comparar
S1.471US$ 1,50 / US$ 12 1M
S1.469US$ 0,75 / US$ 6 1M
S1.456US$ 2 / US$ 10 1M
A1.446US$ 1,50 / US$ 2 1M
S1.446US$ 2 / US$ 10 1M
A1.443US$ 1 / US$ 8 400K
A1.442US$ 8 / US$ 40 1M
A1.439US$ 0,25 / US$ 2 128K
A1.431US$ 0,06 / US$ 0,37 1M
A1.429US$ 4,50 / US$ 14 128K
A1.417US$ 75 / US$ 150 128K
A1.411US$ 0,375 / US$ 4 400K
A1.410US$ 1,80 / US$ 7,20 200K
A1.406US$ 1 / US$ 8 400K
B1.395US$ 1,60 / US$ 8 1M
B1.391US$ 0,08 / US$ 0,40 1M
B1.389US$ 1,75 / US$ 14 128K
B1.383US$ 1,60 / US$ 6,40 1M
B1.373US$ 0,04 / US$ 0,29 400K
B1.372US$ 0,16 / US$ 1 400K
B1.366US$ 14 / US$ 54 200K
B1.365US$ 0,032 / US$ 0,14 131K
B1.353US$ 0,99 / US$ 4 200K
B1.340US$ 0,32 / US$ 1,28 1M
B1.337US$ 0,99 / US$ 4 200K
B1.320US$ 0,04 / US$ 0,32 400K
B1.319US$ 0,99 / US$ 4 200K
B1.317US$ 1,10 / US$ 4,40 128K
B1.300US$ 5 / US$ 15 128K
B1.288US$ 0,009 / US$ 0,045Grátis 131K
B1.286US$ 0,15 / US$ 0,60 128K
B1.285US$ 0,08 / US$ 0,26 1M
B1.282US$ 2,50 / US$ 10 128K
C1.272US$ 9 / US$ 27 128K
C1.263US$ 10 / US$ 30 8K
C1.125US$ 0,45 / US$ 1,40 16K
D956— —
Comparar ()

Os tiers são nossos: a posição de um modelo no ranking, contando só os modelos cujo intervalo de confiança inteiro fica acima dele. S — 10% do topo, A — até 30%, B — até 60%, C — até 85%, D — o restante.

Qualidade x preço nota no eixo vertical, preço combinado (3 partes de entrada : 1 de saída) no horizontal, USD por 1M de tokens
1.000 1.200 1.400 1.600 US$ 0,01 US$ 0,10 US$ 1 US$ 10 US$ 100 Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5

O que este ranking mede

Este é o ranking de modelos de chat, baseado na arena de texto do LMArena, categoria geral. Funciona assim: uma pessoa envia uma pergunta, recebe duas respostas de modelos anônimos e vota na que preferiu. Milhares desses votos viram uma nota no estilo Elo. Ou seja, a nota mostra a preferência dos usuários da arena, na maioria com perguntas em inglês; ela não mede velocidade, custo nem o desempenho em uma tarefa específica sua.

Como ler cada linha

  • Tier e nota: a barra ao lado da nota é o intervalo de confiança de 95%. Quando os intervalos de dois modelos se sobrepõem, a diferença entre eles não é estatisticamente clara — por isso vários modelos podem dividir o tier mais alto.
  • Preço: o menor preço por 1M de tokens de entrada e de saída que encontramos entre os provedores naquele dia, em USD, com a tendência dos últimos 30 dias.
  • Contexto, fabricante e “Pesos abertos”: para saber quanto texto cabe numa conversa e se o modelo pode ser baixado.
  • “Ainda sem tier”: aparece para modelos com menos de 300 votos.

Um clique na linha abre os detalhes: provedores do mais barato ao mais caro, modalidades, saída máxima, votos, posição na fonte, licença, data de lançamento e data de corte do conhecimento. Se o app do modelo estiver no nosso catálogo, aparece o botão para baixá-lo.

Filtros, custo e gráfico

Os filtros separam modelos com pesos abertos, grátis, com “Preço baixo” (preço combinado abaixo de 1 USD por 1M de tokens) e por fabricante. A calculadora “Custo por mês” estima o gasto a partir dos tokens por mês e da parcela de entrada. O gráfico “Qualidade x preço” usa o preço combinado, na proporção de 3 partes de entrada para 1 de saída. Marque a caixa de comparação em até 4 modelos para vê-los lado a lado na página de comparação.

Cuidados com o preço

O preço do provedor pode ser diferente do preço do fabricante. Descontos por cache, processamento em lote e preços regionais não aparecem na tabela. Antes de fechar um orçamento, confira a página do provedor escolhido. Para código, veja também o ranking de programação.