Die meisten KI-Coding-Tools akzeptieren jede OpenAI-kompatible API. Das bedeutet, dass Sie kostenlose Modelle — GLM 5.3, Kimi K3, DeepSeek V4, Qwen 3.8 — in Ihren Editor oder Terminal-Agenten einbinden können, statt pro Token zu bezahlen. Sie brauchen drei Dinge: eine Basis-URL, einen API-Key und eine Modell-ID. Dieser Leitfaden zeigt, wo Sie diese erhalten und wo Sie sie in sieben beliebten Tools eintragen.
Schritt 1. Key besorgen und Modell auswählen
Für die Programmierung empfehlen wir, mit einem dieser Anbieter zu beginnen — keiner davon verlangt eine Karte:
| Anbieter | Basis-URL | Beispiel-ID eines kostenlosen Modells |
|---|---|---|
| OpenRouter | https://openrouter.ai/api/v1 | z-ai/glm-5.2:free |
| NVIDIA Build | https://integrate.api.nvidia.com/v1 | z-ai/glm-5.3, moonshotai/kimi-k3 |
| UnoRouter | https://api.unorouter.com/v1 | glm-5.3:free, deepseek-v4-flash:free |
| Google AI Studio | https://generativelanguage.googleapis.com/v1beta/openai/ | Gemini-Flash-Modelle |
Modell-IDs ändern sich, kopieren Sie daher die exakte ID von der Modellkarte in unserem Katalog — zum Beispiel GLM 5.3 oder Kimi K3. Die Seite mit Coding-Modellen listet alle kostenlosen Optionen, sortiert nach Benchmarks.
Cline (VS Code, JetBrains, CLI)
- Öffnen Sie die Einstellungen von Cline und wählen Sie API Provider.
- Wählen Sie OpenRouter, fügen Sie Ihren OpenRouter-Key ein und geben Sie dann eine
:free-Modell-ID ein — oder wählen Sie OpenAI Compatible für NVIDIA Build oder UnoRouter. - Bei OpenAI Compatible tragen Sie Base URL, API Key und Model ID aus der obigen Tabelle ein.
Cline plant und bearbeitet in vielen Schritten und verbraucht daher schnell Anfragen. Das kostenlose Limit von OpenRouter liegt bei 50 Anfragen pro Tag (1.000 nach einer einmaligen Aufladung von 10 $). Das reicht für eine kurze Session, aber nicht für einen ganzen Arbeitstag. NVIDIA Build und UnoRouter sind für Experimente großzügiger.
Kilo Code
Kilo Code hat dieselbe Anbieterliste: Wählen Sie in den Anbietereinstellungen OpenRouter oder „OpenAI Compatible“ und tragen Sie Basis-URL, Key und Modell-ID ein. Die Modi Architect/Code/Debug können unterschiedliche Modelle nutzen — ein starkes kostenloses Modell für die Architektur und ein schnelleres für Änderungen funktioniert gut.
OpenCode
OpenCode hat OpenRouter bereits integriert: Führen Sie in OpenCode /connect aus (oder opencode auth login), wählen Sie OpenRouter, fügen Sie den Key ein und wählen Sie mit /models ein kostenloses Modell. Jeden anderen OpenAI-kompatiblen Anbieter fügen Sie in opencode.json hinzu:
{
"$schema": "https://opencode.ai/config.json",
"provider": {
"nvidia": {
"npm": "@ai-sdk/openai-compatible",
"name": "NVIDIA Build",
"options": {
"baseURL": "https://integrate.api.nvidia.com/v1",
"apiKey": "{env:NVIDIA_API_KEY}"
},
"models": {
"z-ai/glm-5.3": { "name": "GLM 5.3" },
"moonshotai/kimi-k3": { "name": "Kimi K3" }
}
}
}
}
OpenCode Zen bietet außerdem mehrere Modelle für begrenzte Zeit kostenlos an, etwa Nemotron 3 Ultra Free — ganz ohne zusätzlichen Key.
Continue
Fügen Sie in config.yaml ein Modell mit dem OpenAI-Provider und einer eigenen apiBase hinzu:
models:
- name: Kimi K3 (NVIDIA, free)
provider: openai
model: moonshotai/kimi-k3
apiBase: https://integrate.api.nvidia.com/v1
apiKey: ${{ secrets.NVIDIA_API_KEY }}
roles: [chat, edit]
Wählen Sie für die Autovervollständigung ein kleines, schnelles Modell — ein großes Reasoning-Modell fühlt sich bei jedem Tastendruck träge an.
Aider
Aider unterstützt OpenRouter nativ:
export OPENROUTER_API_KEY=sk-or-...
aider --model openrouter/z-ai/glm-5.2:free
Für andere Anbieter verwenden Sie --openai-api-base zusammen mit --openai-api-key und stellen dem Modellnamen openai/ voran.
Zed
Zed funktioniert im kostenlosen Personal-Plan mit eigenen Keys und lokalen Modellen. Fügen Sie in settings.json einen OpenAI-kompatiblen Anbieter hinzu und geben Sie den Key in den Einstellungen des Agent-Panels ein:
"language_models": {
"openai_compatible": {
"NVIDIA Build": {
"api_url": "https://integrate.api.nvidia.com/v1",
"available_models": [
{ "name": "z-ai/glm-5.3", "display_name": "GLM 5.3", "max_tokens": 128000 }
]
}
}
}
Cursor und VS Code + Copilot
Öffnen Sie in Cursor Settings → Models, geben Sie einen API-Key ein und aktivieren Sie Override OpenAI Base URL mit der Basis-URL des Anbieters. Ihr eigener Key gilt für den Chat; Tab-Vervollständigung und einige Agentenfunktionen nutzen weiterhin die eigenen Modelle und Planlimits von Cursor.
In VS Code mit GitHub Copilot können Sie unter Manage Models eigene Modelle hinzufügen: OpenRouter und lokale Ollama-Modelle funktionieren im Chat auch ohne kostenpflichtigen Copilot-Plan.
Tipps, die Kontingent sparen
- Rollen aufteilen. Nutzen Sie das stärkste kostenlose Modell nur für Planung und schwierige Bugs; kleine Änderungen übernimmt ein schnelles Modell.
- Zwei Anbieter konfiguriert halten. Wenn einer 429 zurückgibt, wechseln Sie zum anderen, statt zu warten.
- Kontext schlank halten. Schließen Sie
node_modules, Build-Ausgaben und Lockfiles aus — kostenlose Routen begrenzen den Kontext oft unter das Maximum des Modells. - Lokal autovervollständigen. Ein kleines Modell in Ollama oder LM Studio kostet nichts und hat kein Ratenlimit.
Weitere Tools mit Unterstützung für kostenlose Modelle finden Sie in unseren Listen IDE-Erweiterungen und Terminal-Agenten.