Ir para o conteúdo
fedi.software

Programação

Modelos classificados em prompts de programação: tier, Elo com intervalo de confiança, preço por milhão de tokens e janela de contexto.

Atualizado · Fontes: LMArena, LiteLLM, models.dev

Custo por mês
Tier Modelo Elo Entrada / saída, por 1M Por mês Contexto App Comparar
C1.178US$ 0,20 / US$ 0,40 256K
Comparar ()

Os tiers são nossos: a posição de um modelo no ranking, contando só os modelos cujo intervalo de confiança inteiro fica acima dele. S — 10% do topo, A — até 30%, B — até 60%, C — até 85%, D — o restante.

Qualidade x preço nota no eixo vertical, preço combinado (3 partes de entrada : 1 de saída) no horizontal, USD por 1M de tokens
1.000 1.200 1.400 1.600 US$ 0,01 US$ 0,10 US$ 1 US$ 10 US$ 100 MiMo-V2.6-Pro Claude Opus 5.5 Claude Opus 4.6

O que é o ranking de programação?

É a categoria de programação da arena de texto do LMArena. O método é o mesmo do ranking geral: votos às cegas entre duas respostas anônimas, só que aqui entram apenas as perguntas sobre código. A nota segue o estilo Elo, com intervalo de confiança de 95%, e o tier usa a mesma regra de toda a seção.

Isso mostra qual modelo programa melhor no meu projeto?

Não exatamente. O ranking avalia respostas num chat sobre código. Isso não é a mesma coisa que rodar testes num projeto real, com dependências, histórico e regras da sua equipe. Use a nota como filtro inicial e teste os candidatos no seu próprio código. Para outros tipos de trabalho, há rankings separados:

  • construir aplicativos web inteiros a partir de um pedido: desenvolvimento web;
  • tarefas em várias etapas, com chamadas de ferramentas: agentes;
  • conversa em geral: texto.

Quais colunas importam para programar?

As colunas são as mesmas do ranking de texto: tier, Elo com intervalo, preço por 1M de tokens, contexto e tendência de preço em 30 dias. Para quem trabalha com um repositório inteiro, a janela de contexto pesa bastante, porque define quanto código o modelo consegue ler de uma vez. Compare o contexto ao lado do preço: um modelo barato com janela curta pode obrigar você a dividir o trabalho em muitas chamadas.

E os modelos sem tier?

A regra é a do ranking de texto: com menos de 300 votos, o modelo aparece como “Ainda sem tier” até juntar votos suficientes. A calculadora “Custo por mês”, o gráfico “Qualidade x preço” e a comparação de até 4 modelos funcionam aqui do mesmo jeito.

Onde entram os agentes de programação?

Ferramentas como Claude Code, Cursor ou Aider dependem do modelo que usam por trás. Depois de escolher o modelo aqui, veja as opções em agentes de programação.