LLM Perks

Kostenlose LLM-API-Anbieter

Alle überwachten Plattformen auf einer Seite: Wer die meisten kostenlosen Modelle hat, wer keine Karte verlangt und welche base URL Sie in Ihrem Client eintragen.

Aktualisiert:
Anbieter ↕ Modelle ↕ Bestes kostenloses Modell Karte Base URL
OpenRouter
Modelle mit dem Suffix :free erlauben 50 Anfragen pro Tag oder 1,000 pro Tag nach einmaliger Aufladung von $10 (20 Anfragen pro Minute).
21 Qwen3.8 27B Nein https://openrouter.ai/api/v1 Schlüssel
Groq
Kostenloser Tarif mit modellspezifischen Limits für Anfragen und Token pro Minute und pro Tag; sehr hohe Generierungsgeschwindigkeit auf LPU-Hardware.
4 Qwen3.8 27B Nein https://api.groq.com/openai/v1 Schlüssel
Google AI Studio
Der kostenlose Tarif der Gemini API umfasst Flash- und Flash-Lite-Modelle mit Rate Limits; Inhalte aus dem kostenlosen Tarif können zur Verbesserung von Google-Produkten genutzt werden.
4 Gemini 2.0 Flash Nein https://generativelanguage.googleapis.com/v1beta/openai/ Schlüssel
Mistral AI
Der Free-Tarif enthält monatliche API-Credits für Mistral-Modelle, mit niedrigen Standard-Rate-Limits.
4 Mistral Nemo — https://api.mistral.ai/v1 Schlüssel
Together AI
Nur ausgewählte Modelle kosten nichts; eine allgemeine kostenlose Testphase gibt es nicht.
98 GLM 5.3 — https://api.together.xyz/v1 Schlüssel
Cohere
Testschlüssel erlauben 1,000 API-Aufrufe pro Monat zur Evaluierung, nicht für den Produktiveinsatz.
4 Command R Plus Nein https://api.cohere.ai/compatibility/v1 Schlüssel
Cerebras
Kostenlose Testphase mit täglichen Token-Limits; zur Aktivierung der API ist eine verifizierte Zahlungsmethode erforderlich.
2 Qwen 3.8 27B Ja https://api.cerebras.ai/v1 Schlüssel
Cloudflare Workers AI
10,000 Neurons pro Tag sind sowohl im Workers-Free- als auch im Paid-Tarif kostenlos.
3 Llama 3.1 8B — https://api.cloudflare.com/client/v4/accounts/ACCOUNT_ID/ai/v1 Schlüssel
Hugging Face
Kostenlose Konten erhalten ein kleines monatliches Guthaben für Inference Providers; PRO-Konten erhalten mehr.
3 Llama 3.1 8B Nein https://router.huggingface.co/v1 Schlüssel
OrcaRouter
BYOK-Router ohne Token-Aufschlag; die eigenen Fusion-Modelle und ausgewählte kostenlose Routen kosten nichts.
13 GLM 5.3 Flash — https://api.orcarouter.ai/v1 Schlüssel
NVIDIA Build
Kostenlose serverlose Inferenz für Entwicklung und Prototyping mit Entwicklerkonto; nicht für Produktionstraffic gedacht.
62 GLM 5.3 Nein https://integrate.api.nvidia.com/v1 Schlüssel
TokenRouter
Kostenlose Modelle und Aktionszugänge können zeitlich begrenzt sein.
1 Nemotron 3 Nano Omni — https://api.tokenrouter.com/v1 Schlüssel
Vercel AI Gateway
Auch für Modelle zum Nullpreis muss eine Zahlungskarte hinterlegt sein.
3 Laguna S 2.1 Ja https://ai-gateway.vercel.sh/v1 Schlüssel
Nous Portal
Der Portal-Tarif für $0 enthält :free-Modelle mit Standard-Rate-Limits.
7 Solar Pro 4 Nein https://inference-api.nousresearch.com/v1 Schlüssel
UnoRouter
Großer Katalog an :free-Routen ohne Karte; geteilte Kapazität und Limits pro Modell.
62 Mimo V2.6 Pro Nein https://api.unorouter.com/v1 Schlüssel

FAQ

Welcher kostenlose LLM-API-Anbieter ist der beste?

Das hängt von der Aufgabe ab. OpenRouter und UnoRouter bieten die meisten Modelle mit einem Schlüssel, Groq und Cerebras sind am schnellsten, Google AI Studio hat großzügige Gemini-Flash-Limits, und NVIDIA Build hostet neue offene Modelle für die Entwicklung.

Kann ich mehrere kostenlose Anbieter kombinieren?

Ja. Sie sind alle OpenAI-kompatibel, sodass Sie mit Clients wie LiteLLM, OpenCode oder Open WebUI Schlüssel wechseln und kostenlose Kontingente kombinieren können.