Ir para o conteúdo
fedi.software

Programação

Modelos classificados em prompts de programação: tier, Elo com intervalo de confiança, preço por milhão de tokens e janela de contexto.

Atualizado · Fontes: LMArena, LiteLLM, models.dev

Custo por mês
Tier Modelo Elo Entrada / saída, por 1M Por mês Contexto App Comparar
S1.535US$ 0,40 / US$ 0,80 1M
S1.511US$ 0,10 / US$ 0,25 1M
S1.507US$ 0,0015 / US$ 0,09Grátis 1M
S1.506US$ 0,03 / US$ 0,10Grátis 1M
S1.502US$ 0,40 / US$ 0,80 1M
S1.497US$ 0,40 / US$ 1,40Grátis 1M
S1.489US$ 0,275 / US$ 1,10Grátis 262K
S1.486US$ 0,45 / US$ 2,15 200K
S1.485US$ 0,045 / US$ 0,32 262K
S1.484US$ 0,30 / US$ 1,05Grátis 1M
S1.483US$ 0,30 / US$ 1,90 262K
S1.469US$ 0,2088 / US$ 0,4176 1M
A1.469US$ 0,20 / US$ 0,90Grátis 1M
A1.469US$ 0,14 / US$ 0,28 1M
A1.468US$ 0,10 / US$ 0,10 1M
A1.464US$ 0,066 / US$ 0,26 262K
A1.464US$ 0,1644 / US$ 0,9864Grátis 262K
A1.461US$ 0,40 / US$ 1,75 205K
A1.459US$ 0,10 / US$ 0,25Grátis 262K
A1.457US$ 0,035 / US$ 0,07 1M
A1.454US$ 0,2740 / US$ 1,10 205K
A1.453US$ 0,08 / US$ 0,32Grátis 205K
A1.453US$ 0,45 / US$ 1,20 524K
A1.449US$ 0,2740 / US$ 1,10 205K
A1.446US$ 0,042 / US$ 0,22Grátis 262K
A1.445US$ 0,09 / US$ 0,55 131K
A1.443US$ 0,10 / US$ 0,30 262K
A1.440US$ 0,144 / US$ 0,574Grátis 131K
A1.439US$ 0,22 / US$ 0,33 164K
A1.438US$ 0,20 / US$ 0,88 131K
A1.436US$ 0,09 / US$ 0,30Grátis 256K
A1.436US$ 0,1126 / US$ 0,9008Grátis 262K
A1.434US$ 0,286 / US$ 1,14 131K
A1.427US$ 0,0846 / US$ 0,6768 262K
A1.426US$ 0,25 / US$ 0,70 128K
A1.425US$ 0,287 / US$ 2,87 131K
A1.421US$ 0,27 / US$ 1,10 205K
A1.417US$ 0,19 / US$ 0,71 164K
B1.416US$ 0,09 / US$ 0,30 256K
B1.412US$ 0,13 / US$ 0,50Grátis 262K
B1.410US$ 0,0564 / US$ 0,4512 262K
B1.403US$ 0,05 / US$ 0,25 262K
B1.399US$ 0,40 / US$ 1,80 256K
B1.397US$ 0,1165 / US$ 0,2911 131K
B1.392US$ 0,15 / US$ 0,65 131K
B1.390US$ 0,137 / US$ 0,411 128K
B1.383US$ 0,06 / US$ 0,40 200K
B1.380US$ 0,22 / US$ 0,88 205K
B1.380US$ 0,032 / US$ 0,14 131K
B1.378US$ 0,06 / US$ 0,25 131K
B1.378US$ 0,05 / US$ 0,20Grátis 131K
B1.371US$ 0,40 / US$ 0,40 80K
B1.370US$ 0,20 / US$ 1 205K
B1.368US$ 0,10 / US$ 0,425 164K
B1.363US$ 0,075 / US$ 0,20 128K
B1.358US$ 0,132 / US$ 1,25 1M
B1.358US$ 0,05 / US$ 0,10 131K
B1.357US$ 0,25 / US$ 0,80 262K
B1.354US$ 0,40 / US$ 0,40Grátis 131K
B1.347US$ 0,29 / US$ 0,86 64K
B1.337US$ 0,0509 / US$ 0,335 41K
B1.333US$ 0,18 / US$ 0,20 24K
B1.322US$ 0,08 / US$ 0,16Grátis 131K
B1.312US$ 0,05 / US$ 0,10 131K
B1.309US$ 0,10 / US$ 0,30 128K
B1.307US$ 0,009 / US$ 0,045Grátis 131K
B1.302US$ 0,05 / US$ 0,10Grátis 1M
B1.292US$ 0,12 / US$ 0,30 131K
B1.286US$ 0,05 / US$ 0,10 328K
B1.281US$ 0,05 / US$ 0,10Grátis 131K
B1.276US$ 0,06 / US$ 0,20Grátis 33K
C1.276US$ 0,50 / US$ 1,50 131K
C1.272US$ 0,357 / US$ 0,408Grátis 128K
C1.268US$ 0,05 / US$ 0,23Grátis 24K
C1.260US$ 0,40 / US$ 0,40Grátis 131K
C1.246US$ 0,05 / US$ 0,08 33K
C1.230US$ 0,04 / US$ 0,08Grátis 131K
C1.206US$ 0,51 / US$ 0,74 8K
C1.202US$ 0,10 / US$ 0,10 128K
C1.197US$ 0,50 / US$ 1,50 128K
C1.195US$ 0,02 / US$ 0,04Grátis 32K
C1.169US$ 0,15 / US$ 0,60 128K
C1.166US$ 0,60 / US$ 0,60 66K
C1.152US$ 0,04 / US$ 0,04 8K
C1.126US$ 0,15 / US$ 0,15 32K
C1.098US$ 0,02 / US$ 0,02Grátis 80K
D1.071US$ 0,01 / US$ 0,01Grátis 60K
Comparar ()

Os tiers são nossos: a posição de um modelo no ranking, contando só os modelos cujo intervalo de confiança inteiro fica acima dele. S — 10% do topo, A — até 30%, B — até 60%, C — até 85%, D — o restante.

Qualidade x preço nota no eixo vertical, preço combinado (3 partes de entrada : 1 de saída) no horizontal, USD por 1M de tokens
1.000 1.200 1.400 1.600 US$ 0,01 US$ 0,10 US$ 1 US$ 10 US$ 100 MiMo-V2.6-Pro Claude Opus 5.5 Claude Opus 4.6

O que é o ranking de programação?

É a categoria de programação da arena de texto do LMArena. O método é o mesmo do ranking geral: votos às cegas entre duas respostas anônimas, só que aqui entram apenas as perguntas sobre código. A nota segue o estilo Elo, com intervalo de confiança de 95%, e o tier usa a mesma regra de toda a seção.

Isso mostra qual modelo programa melhor no meu projeto?

Não exatamente. O ranking avalia respostas num chat sobre código. Isso não é a mesma coisa que rodar testes num projeto real, com dependências, histórico e regras da sua equipe. Use a nota como filtro inicial e teste os candidatos no seu próprio código. Para outros tipos de trabalho, há rankings separados:

  • construir aplicativos web inteiros a partir de um pedido: desenvolvimento web;
  • tarefas em várias etapas, com chamadas de ferramentas: agentes;
  • conversa em geral: texto.

Quais colunas importam para programar?

As colunas são as mesmas do ranking de texto: tier, Elo com intervalo, preço por 1M de tokens, contexto e tendência de preço em 30 dias. Para quem trabalha com um repositório inteiro, a janela de contexto pesa bastante, porque define quanto código o modelo consegue ler de uma vez. Compare o contexto ao lado do preço: um modelo barato com janela curta pode obrigar você a dividir o trabalho em muitas chamadas.

E os modelos sem tier?

A regra é a do ranking de texto: com menos de 300 votos, o modelo aparece como “Ainda sem tier” até juntar votos suficientes. A calculadora “Custo por mês”, o gráfico “Qualidade x preço” e a comparação de até 4 modelos funcionam aqui do mesmo jeito.

Onde entram os agentes de programação?

Ferramentas como Claude Code, Cursor ou Aider dependem do modelo que usam por trás. Depois de escolher o modelo aqui, veja as opções em agentes de programação.