Kostenlose LLM-API-Anbieter
Alle überwachten Plattformen auf einer Seite: Wer die meisten kostenlosen Modelle hat, wer keine Karte verlangt und welche base URL Sie in Ihrem Client eintragen.
Aktualisiert:
| Anbieter ↕ | Modelle ↕ | Bestes kostenloses Modell | Karte | Base URL | |
|---|---|---|---|---|---|
OpenRouter Modelle mit dem Suffix :free erlauben 50 Anfragen pro Tag oder 1,000 pro Tag nach einmaliger Aufladung von $10 (20 Anfragen pro Minute). |
21 | Qwen3.8 27B | Nein | https://openrouter.ai/api/v1 |
Schlüssel |
Groq Kostenloser Tarif mit modellspezifischen Limits für Anfragen und Token pro Minute und pro Tag; sehr hohe Generierungsgeschwindigkeit auf LPU-Hardware. |
4 | Qwen3.8 27B | Nein | https://api.groq.com/openai/v1 |
Schlüssel |
Google AI Studio Der kostenlose Tarif der Gemini API umfasst Flash- und Flash-Lite-Modelle mit Rate Limits; Inhalte aus dem kostenlosen Tarif können zur Verbesserung von Google-Produkten genutzt werden. |
4 | Gemini 2.0 Flash | Nein | https://generativelanguage.googleapis.com/v1beta/openai/ |
Schlüssel |
Mistral AI Der Free-Tarif enthält monatliche API-Credits für Mistral-Modelle, mit niedrigen Standard-Rate-Limits. |
4 | Mistral Nemo | — | https://api.mistral.ai/v1 |
Schlüssel |
Together AI Nur ausgewählte Modelle kosten nichts; eine allgemeine kostenlose Testphase gibt es nicht. |
98 | GLM 5.3 | — | https://api.together.xyz/v1 |
Schlüssel |
Cohere Testschlüssel erlauben 1,000 API-Aufrufe pro Monat zur Evaluierung, nicht für den Produktiveinsatz. |
4 | Command R Plus | Nein | https://api.cohere.ai/compatibility/v1 |
Schlüssel |
Cerebras Kostenlose Testphase mit täglichen Token-Limits; zur Aktivierung der API ist eine verifizierte Zahlungsmethode erforderlich. |
2 | Qwen 3.8 27B | Ja | https://api.cerebras.ai/v1 |
Schlüssel |
Cloudflare Workers AI 10,000 Neurons pro Tag sind sowohl im Workers-Free- als auch im Paid-Tarif kostenlos. |
3 | Llama 3.1 8B | — | https://api.cloudflare.com/client/v4/accounts/ACCOUNT_ID/ai/v1 |
Schlüssel |
Hugging Face Kostenlose Konten erhalten ein kleines monatliches Guthaben für Inference Providers; PRO-Konten erhalten mehr. |
3 | Llama 3.1 8B | Nein | https://router.huggingface.co/v1 |
Schlüssel |
OrcaRouter BYOK-Router ohne Token-Aufschlag; die eigenen Fusion-Modelle und ausgewählte kostenlose Routen kosten nichts. |
13 | GLM 5.3 Flash | — | https://api.orcarouter.ai/v1 |
Schlüssel |
NVIDIA Build Kostenlose serverlose Inferenz für Entwicklung und Prototyping mit Entwicklerkonto; nicht für Produktionstraffic gedacht. |
62 | GLM 5.3 | Nein | https://integrate.api.nvidia.com/v1 |
Schlüssel |
TokenRouter Kostenlose Modelle und Aktionszugänge können zeitlich begrenzt sein. |
1 | Nemotron 3 Nano Omni | — | https://api.tokenrouter.com/v1 |
Schlüssel |
Vercel AI Gateway Auch für Modelle zum Nullpreis muss eine Zahlungskarte hinterlegt sein. |
3 | Laguna S 2.1 | Ja | https://ai-gateway.vercel.sh/v1 |
Schlüssel |
Nous Portal Der Portal-Tarif für $0 enthält :free-Modelle mit Standard-Rate-Limits. |
7 | Solar Pro 4 | Nein | https://inference-api.nousresearch.com/v1 |
Schlüssel |
UnoRouter Großer Katalog an :free-Routen ohne Karte; geteilte Kapazität und Limits pro Modell. |
62 | Mimo V2.6 Pro | Nein | https://api.unorouter.com/v1 |
Schlüssel |
FAQ
Welcher kostenlose LLM-API-Anbieter ist der beste?
Das hängt von der Aufgabe ab. OpenRouter und UnoRouter bieten die meisten Modelle mit einem Schlüssel, Groq und Cerebras sind am schnellsten, Google AI Studio hat großzügige Gemini-Flash-Limits, und NVIDIA Build hostet neue offene Modelle für die Entwicklung.
Kann ich mehrere kostenlose Anbieter kombinieren?
Ja. Sie sind alle OpenAI-kompatibel, sodass Sie mit Clients wie LiteLLM, OpenCode oder Open WebUI Schlüssel wechseln und kostenlose Kontingente kombinieren können.