Wo Sie API-Zugang zu Modellen bekommen: Anzahl der Modelle, Startguthaben, Zahlungsmethoden und die niedrigsten Preise.
Aktualisiert
OpenRouter
Freemium
Ein Konto und ein API-Schlüssel für Modelle von Anthropic, OpenAI, Google und offene Modelle: OpenRouter leitet jede Anfrage an einen Anbieter weiter, der das Modell bereitstellt. Praktisch, wenn Sie Modelle ohne neue Registrierung wechseln wollen.
Die hauseigene API von Anthropic für die Claude-Modelle, abgerechnet pro Token und verwaltet in der Claude Console. Der direkte Weg für Apps und Agenten auf Basis von Claude.
Modelle
13
Ab
1,00 $ / 1M Input-Tokens
OpenAI-kompatible API
ja
Zahlung
Card, Bank transfer
OpenAI API
Kostenpflichtig
Direkter Zugang zu den GPT-Modellen sowie zu den Bild-, Sprach- und Embedding-Modellen von OpenAI, bezahlt pro Token.
Modelle
65
Ab
0,02 $ / 1M Input-Tokens
OpenAI-kompatible API
ja
Zahlung
Card
Google AI Studio
Freemium
Googles Web-Studio zum Ausprobieren von Gemini und Gemma und zum Erstellen von Gemini-API-Schlüsseln. Einige Modelle haben eine kostenlose Stufe mit Limits, bezahlt wird über Google Cloud Billing.
Modelle
46
Ab
0,10 $ / 1M Input-Tokens
Gratistarif
Gemini Flash, Flash-Lite, Gemma
OpenAI-kompatible API
ja
Zahlung
Google Cloud billing
Groq
Freemium
Offene Modelle auf Groqs eigenen LPU-Chips, erreichbar über eine OpenAI-kompatible API. Ein kostenloser Tarif mit Limits genügt, um die schnellen Antworten zu testen.
Cloud-Plattform für Modelle mit offenen Gewichten: serverlose Inferenz-API, Feintuning und GPU-Cluster für Teams, die offene Modelle in großem Umfang einsetzen.
Modelle
53
Ab
0,05 $ / 1M Input-Tokens
OpenAI-kompatible API
ja
Zahlung
Card, Bank transfer
Fireworks AI
Kostenpflichtig
Inferenz-Plattform für offene Modelle mit serverloser API, Feintuning und dedizierten Deployments für produktive Anwendungen; zum Start gibt es ein kleines Guthaben.
Modelle
17
Ab
0,05 $ / 1M Input-Tokens
Gratisguthaben
$1
OpenAI-kompatible API
ja
DeepInfra
Kostenpflichtig
Offene Modelle auf den Servern von DeepInfra, abgerechnet pro Token und über eine OpenAI-kompatible API erreichbar – eine günstige Lösung ohne eigene Server.
Modelle
101
Ab
0,02 $ / 1M Input-Tokens
OpenAI-kompatible API
ja
Zahlung
Card, Invoice
Mistral AI Studio
Freemium
Die Entwicklerplattform von Mistral AI, früher La Plateforme, mit der API für die Mistral-Modelle. Ein kostenloser Modus funktioniert ohne Zahlungskarte.
Modelle
33
Ab
0,04 $ / 1M Input-Tokens
Gratistarif
Kostenlose API-Stufe, ohne Karte
DeepSeek API
Kostenpflichtig
Die offizielle API von DeepSeek für die hauseigenen Modelle, im OpenAI-kompatiblen Format – vorhandene Client-Bibliotheken funktionieren nach Änderung der Basisadresse.
Modelle
9
Ab
0,15 $ / 1M Input-Tokens
OpenAI-kompatible API
ja
xAI API
Kostenpflichtig
Die Entwickler-API von xAI für die Grok-Modelle, für Anwendungen, die direkt auf Grok aufbauen statt über die Chat-App.
Modelle
17
Ab
1,00 $ / 1M Input-Tokens
OpenAI-kompatible API
ja
Zahlung
Card, Bank transfer, Invoice
Cerebras Inference
Kostenpflichtig
Offene Modelle auf den Wafer-Scale-Chips von Cerebras, angeboten als Inferenz-API für sehr kurze Antwortzeiten. Neue Konten erhalten ein Testguthaben.
Modelle
5
Ab
0,35 $ / 1M Input-Tokens
Gratisguthaben
$5 trial, 30 days
OpenAI-kompatible API
ja
Zahlung
Card
Cloudflare Workers AI
Freemium
Führt Modelle im GPU-Netz von Cloudflare aus, aufgerufen aus Workers oder per REST-API, mit einem täglichen Gratiskontingent in Neurons. Naheliegend für Apps, die schon auf Cloudflare laufen.
Modelle
24
Ab
0,02 $ / 1M Input-Tokens
Gratistarif
10.000 Neurons/Tag
OpenAI-kompatible API
ja
Hugging Face Inference Providers
Freemium
Ein Hugging-Face-Konto und ein Token, um Modelle aus dem Hub über Partner-Inferenzanbieter aufzurufen; ein kleines Monatsguthaben reicht für Experimente.
Modelle
69
Ab
0,05 $ / 1M Input-Tokens
Gratisguthaben
$0.10/month (PRO: $2/month)
OpenAI-kompatible API
ja
Was ein API-Anbieter ist
Wer ein Modell in eine eigene App, ein Skript oder einen Agenten einbauen will, braucht API-Zugang: einen Schlüssel, einen Preis pro Token und ein Anfragelimit. Diese Seite listet die Anbieter, die ihn verkaufen. Die einen bieten eigene Modelle an – Anthropic, OpenAI, Google, Mistral, DeepSeek, xAI. Die anderen sind Plattformen mit vielen Modellen, auch mit offenen Gewichten: OpenRouter, Together AI, Fireworks, DeepInfra, Groq, Cerebras, Cloudflare Workers AI und Hugging Face.
Was auf jeder Karte steht
die Zahl der Modelle des Anbieters, gezählt aus unseren täglichen Preisdaten;
„Ab“: der niedrigste Input-Preis pro Million Tokens unter seinen Modellen – der Einstiegspreis, nicht der Preis des stärksten Modells;
ein kostenloser Tarif oder Startguthaben, sofern vorhanden;
Zahlungsarten, nur wenn die Seite des Anbieters sie bestätigt;
ob die API OpenAI-kompatibel ist – dann lassen sich viele vorhandene Werkzeuge durch Ändern von Adresse und Schlüssel anbinden.
Jede Karte verlinkt die Preis- oder Limitseite des Anbieters und nennt das Datum unserer Prüfung.
Hersteller oder Aggregator?
Ein Aggregator wie OpenRouter bietet ein Konto und einen Schlüssel für Modelle vieler Hersteller – praktisch zum Wechseln und Vergleichen. Die API des Herstellers bekommt neue Modelle und Funktionen meist früher und gewährt mitunter Rabatte, etwa für Prompt-Caching. Viele Teams nutzen beides: das Hauptmodell direkt, Experimente über den Aggregator.
Einschränkungen
Kostenlose Tarife und Limits ändern sich oft, manchmal monatlich. Die Preise hinter „Ab“ werden täglich aus models.dev und LiteLLM aktualisiert, das letzte Wort hat aber die Seite des Anbieters. Wer ein bestimmtes Modell verkauft, sehen Sie in jeder Rangliste per Klick auf die Zeile – die Details sortieren die Anbieter vom günstigsten an.