Qual modelo de IA para qual tarefa — 2026
Para cada tarefa: o modelo mais forte, o melhor custo-benefício e o melhor modelo de pesos abertos — a partir de rankings com preços, atualizados diariamente.
| Tarefa | Melhor | Melhor custo-benefício | Pesos abertos |
|---|---|---|---|
| Texto | S Gemini 4 Argon (High)Google | S DeepSeek V4.1 Flash HFDeepSeek · US$ 0,0015 / US$ 0,09 | S MiMo-V2.6-Pro HFXiaomi · US$ 0,40 / US$ 0,80 |
| Programação | S Gemini 4 Argon (High)Google | S DeepSeek V4.1 Flash HFDeepSeek · US$ 0,0015 / US$ 0,09 | S MiMo-V2.6-Pro HFXiaomi · US$ 0,40 / US$ 0,80 |
| Desenvolvimento web | S Claude Opus 5.5Anthropic · US$ 4 / US$ 20 | S DeepSeek V4.1 Flash HFDeepSeek · US$ 0,0015 / US$ 0,09 | S Kimi K3 HFMoonshot AI · US$ 1 / US$ 4 |
| Agentes | S Claude Fable 5.1Anthropic · US$ 10 / US$ 50 | A DeepSeek V4.1 Flash HFDeepSeek · US$ 0,0015 / US$ 0,09 | A Kimi K3 HFMoonshot AI · US$ 1 / US$ 4 |
| Imagem | S gpt-image-2.5-sunburstOpenAI · US$ 0,0361 | A Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google · US$ 0,0336 | A qwen-image-2.1Alibaba |
| Vídeo | S gemini-omni-1.1-flashGoogle · US$ 1,50 / US$ 9 | S Grok Imagine Video 1.5xAI · US$ 0,08 | A minimax-h3MiniMax |
| Áudio | S AuroraUnknown | S Eleven Multilingual v2ElevenLabs · US$ 180 | — |
Melhor custo-benefício: o modelo mais barato das faixas superiores (S/A) no provedor mais barato. Preços por 1M de tokens (entrada / saída), salvo indicação em contrário.
Atualizado · Fontes: LMArena (CC BY 4.0), LiteLLM (MIT), models.dev (MIT), TTS Arena
Arena (LMArena) scores: Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (filtered, re-ranked, aggregated). Not endorsed by LMArena.
Speech ratings: TTS Arena V2 by TTS-AGI (crowdsourced blind votes), used with permission — keep a link to the arena. Modified by fedi.software (filtered, tiered). Not endorsed by TTS-AGI.
Incorporar no seu site
Cole este código onde o infográfico deve aparecer: ele se atualiza sozinho. Uso gratuito — mantenha o link de atribuição.
Como usar a tabela
Cada linha é uma tarefa e também um dos nossos rankings: texto, programação, desenvolvimento web, agentes, imagem e vídeo. Em vez de um único vencedor, você vê três modelos por tarefa, cada um com nível, desenvolvedor e preço.
- Ache a linha da sua tarefa e olhe a coluna da esquerda: ali está quem ocupa o topo do ranking. As notas vêm do LMArena, onde as pessoas comparam duas respostas anônimas e votam na que preferem.
- Compare com “Melhor custo-benefício”. É o modelo com preço mais barato entre os níveis S e A, pelo preço combinado no provedor mais em conta. Se nenhum modelo S ou A tiver preço, a escolha desce para o nível B.
- Veja “Pesos abertos”. É o modelo de pesos abertos (open weights) mais bem colocado no ranking, aquele que você pode baixar e rodar no seu computador.
- Clique no nome para abrir o modelo na comparação de modelos e colocá-lo ao lado dos outros dois.
Nos rankings de texto, o preço é por 1M de tokens, separado em entrada e saída. Modelos de imagem cobram por imagem, e os de vídeo, por segundo.
O que a nota não conta
Estar no topo pesa menos do que parece. Nossos níveis agrupam modelos cujos intervalos de confiança se sobrepõem, então o segundo e o terceiro colocados muitas vezes estão estatisticamente empatados com quem lidera e podem custar bem menos. Além disso, a nota mede a preferência de quem vota com os próprios prompts, não a precisão nos seus documentos ou no seu código. Trate a tabela como uma lista curta: depois abra o ranking completo e teste dois ou três candidatos numa tarefa de verdade.
Quer rodar localmente?
Comece pela coluna de pesos abertos. A memória necessária depende do tamanho do modelo e da quantização; confira em qual modelo aberto cabe no seu hardware. Como o topo muda com frequência, a tabela também guarda uma edição por ano, com as novidades e os modelos que saíram.