Welches KI-Modell für welche Aufgabe — 2026
Für jede Aufgabe: das stärkste Modell, das beste Preis-Leistungs-Verhältnis und das beste Open-Weights-Modell — aus den Ranglisten mit Preisen, täglich aktualisiert.
| Aufgabe | Beste | Bestes Preis-Leistungs-Verhältnis | Open Weights |
|---|---|---|---|
| Text | S Gemini 4 Argon (High)Google | S DeepSeek V4.1 Flash HFDeepSeek · $ 0.0015 / $ 0.09 | S MiMo-V2.6-Pro HFXiaomi · $ 0.40 / $ 0.80 |
| Programmieren | S Gemini 4 Argon (High)Google | S DeepSeek V4.1 Flash HFDeepSeek · $ 0.0015 / $ 0.09 | S MiMo-V2.6-Pro HFXiaomi · $ 0.40 / $ 0.80 |
| Webentwicklung | S Claude Opus 5.5Anthropic · $ 4 / $ 20 | S DeepSeek V4.1 Flash HFDeepSeek · $ 0.0015 / $ 0.09 | S Kimi K3 HFMoonshot AI · $ 1 / $ 4 |
| Agenten | S Claude Fable 5.1Anthropic · $ 10 / $ 50 | A DeepSeek V4.1 Flash HFDeepSeek · $ 0.0015 / $ 0.09 | A Kimi K3 HFMoonshot AI · $ 1 / $ 4 |
| Bild | S gpt-image-2.5-sunburstOpenAI · $ 0.0361 | A Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Google · $ 0.0336 | A qwen-image-2.1Alibaba |
| Video | S gemini-omni-1.1-flashGoogle · $ 1.50 / $ 9 | S Grok Imagine Video 1.5xAI · $ 0.08 | A minimax-h3MiniMax |
| Audio | S AuroraUnknown | S Eleven Multilingual v2ElevenLabs · $ 180 | — |
Bestes Preis-Leistungs-Verhältnis: das günstigste Modell der obersten Stufen (S/A) beim günstigsten Anbieter. Preise pro 1M Tokens (Eingabe / Ausgabe), sofern nicht anders angegeben.
Aktualisiert · Quellen: LMArena (CC BY 4.0), LiteLLM (MIT), models.dev (MIT), TTS Arena
Arena (LMArena) scores: Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (filtered, re-ranked, aggregated). Not endorsed by LMArena.
Speech ratings: TTS Arena V2 by TTS-AGI (crowdsourced blind votes), used with permission — keep a link to the arena. Modified by fedi.software (filtered, tiered). Not endorsed by TTS-AGI.
Auf deiner Website einbetten
Füge diesen Code dort ein, wo die Infografik erscheinen soll: Sie aktualisiert sich von selbst. Kostenlos nutzbar — lass den Quellenlink stehen.
Was zeigt eine Zeile?
Jede Zeile entspricht einer unserer Ranglisten: Text, Programmierung, Webentwicklung, Agenten sowie Bild und Video. Statt eines einzelnen Siegers stehen pro Aufgabe drei Modelle nebeneinander, jeweils mit Stufe, Anbieter und Preis. Ein Klick auf einen Namen öffnet das Modell im Modellvergleich.
Wie entstehen die drei Spalten?
- Die erste Spalte zeigt den Spitzenreiter der Rangliste, also ihren ersten Platz. Die Bewertungen kommen von LMArena, wo Menschen zwei anonyme Antworten vergleichen und abstimmen.
- «Bestes Preis-Leistungs-Verhältnis» ist das günstigste Modell mit Preis aus den Stufen S und A, gemessen am Mischpreis beim günstigsten Anbieter. Hat kein Modell dieser Stufen einen Preis, rückt Stufe B nach.
- «Open Weights» ist das am höchsten bewertete Modell mit offenen Gewichten (open weights), das Sie herunterladen und auf eigener Hardware ausführen können.
Worauf beziehen sich die Preise?
Bei Textranglisten gilt der Preis pro 1M Tokens, getrennt nach Eingabe und Ausgabe. Bildmodelle werden pro Bild abgerechnet, Videomodelle pro Sekunde.
Ist der erste Platz wirklich vorn?
Oft nur knapp. Die Stufen fassen Modelle zusammen, deren Konfidenzintervalle sich überschneiden. Der zweite und dritte Platz einer Rangliste liegen daher häufig statistisch gleichauf mit dem Spitzenreiter und können deutlich weniger kosten. Hinzu kommt, dass eine Bewertung die Vorlieben der Abstimmenden bei ihren eigenen Prompts misst, nicht die Genauigkeit bei Ihrer konkreten Aufgabe. Nehmen Sie die Grafik als Vorauswahl, öffnen Sie danach die vollständige Rangliste und testen Sie zwei oder drei Kandidaten mit echten Beispielen aus Ihrem Alltag.
Und wenn das Modell lokal laufen soll?
Dann ist die Spalte mit offenen Gewichten der Ausgangspunkt. Wie viel Speicher das Modell braucht, hängt von Grösse und Quantisierung ab; das prüfen Sie in Welches offene Modell zu Ihrer Hardware passt.
Warum gibt es Jahresausgaben?
Die Auswahl ist eine Momentaufnahme eines Tages, und die Spitze wechselt oft. Deshalb hält die Grafik eine Ausgabe pro Jahr fest: Ein vergangenes Jahr zeigt, welche Modelle damals neu waren und welche herausgefallen sind.