LLM Perks

Kostenlose LLMs in Cursor, Cline, OpenCode und VS Code nutzen

Base-URL, Schlüssel und Modell-ID – Schritt für Schritt für sieben beliebte Tools.

How-to
Kostenlose Modelle in der IDE

Die meisten KI-Coding-Tools akzeptieren jede OpenAI-kompatible API. Das bedeutet, dass Sie kostenlose Modelle — GLM 5.3, Kimi K3, DeepSeek V4, Qwen 3.8 — in Ihren Editor oder Terminal-Agenten einbinden können, statt pro Token zu bezahlen. Sie brauchen drei Dinge: eine Basis-URL, einen API-Key und eine Modell-ID. Dieser Leitfaden zeigt, wo Sie diese erhalten und wo Sie sie in sieben beliebten Tools eintragen.

Schritt 1. Key besorgen und Modell auswählen

Für die Programmierung empfehlen wir, mit einem dieser Anbieter zu beginnen — keiner davon verlangt eine Karte:

AnbieterBasis-URLBeispiel-ID eines kostenlosen Modells
OpenRouterhttps://openrouter.ai/api/v1z-ai/glm-5.2:free
NVIDIA Buildhttps://integrate.api.nvidia.com/v1z-ai/glm-5.3, moonshotai/kimi-k3
UnoRouterhttps://api.unorouter.com/v1glm-5.3:free, deepseek-v4-flash:free
Google AI Studiohttps://generativelanguage.googleapis.com/v1beta/openai/Gemini-Flash-Modelle

Modell-IDs ändern sich, kopieren Sie daher die exakte ID von der Modellkarte in unserem Katalog — zum Beispiel GLM 5.3 oder Kimi K3. Die Seite mit Coding-Modellen listet alle kostenlosen Optionen, sortiert nach Benchmarks.

⚠️
Bewahren Sie Keys in Umgebungsvariablen oder im Secret-Speicher des Tools auf, niemals in einem Repository. Kostenlose Routen können Prompts protokollieren — senden Sie daher keinen proprietären Code dorthin, ohne die Richtlinien des Anbieters geprüft zu haben.

Cline (VS Code, JetBrains, CLI)

  1. Öffnen Sie die Einstellungen von Cline und wählen Sie API Provider.
  2. Wählen Sie OpenRouter, fügen Sie Ihren OpenRouter-Key ein und geben Sie dann eine :free-Modell-ID ein — oder wählen Sie OpenAI Compatible für NVIDIA Build oder UnoRouter.
  3. Bei OpenAI Compatible tragen Sie Base URL, API Key und Model ID aus der obigen Tabelle ein.

Cline plant und bearbeitet in vielen Schritten und verbraucht daher schnell Anfragen. Das kostenlose Limit von OpenRouter liegt bei 50 Anfragen pro Tag (1.000 nach einer einmaligen Aufladung von 10 $). Das reicht für eine kurze Session, aber nicht für einen ganzen Arbeitstag. NVIDIA Build und UnoRouter sind für Experimente großzügiger.

Kilo Code

Kilo Code hat dieselbe Anbieterliste: Wählen Sie in den Anbietereinstellungen OpenRouter oder „OpenAI Compatible“ und tragen Sie Basis-URL, Key und Modell-ID ein. Die Modi Architect/Code/Debug können unterschiedliche Modelle nutzen — ein starkes kostenloses Modell für die Architektur und ein schnelleres für Änderungen funktioniert gut.

OpenCode

OpenCode hat OpenRouter bereits integriert: Führen Sie in OpenCode /connect aus (oder opencode auth login), wählen Sie OpenRouter, fügen Sie den Key ein und wählen Sie mit /models ein kostenloses Modell. Jeden anderen OpenAI-kompatiblen Anbieter fügen Sie in opencode.json hinzu:

{
  "$schema": "https://opencode.ai/config.json",
  "provider": {
    "nvidia": {
      "npm": "@ai-sdk/openai-compatible",
      "name": "NVIDIA Build",
      "options": {
        "baseURL": "https://integrate.api.nvidia.com/v1",
        "apiKey": "{env:NVIDIA_API_KEY}"
      },
      "models": {
        "z-ai/glm-5.3": { "name": "GLM 5.3" },
        "moonshotai/kimi-k3": { "name": "Kimi K3" }
      }
    }
  }
}

OpenCode Zen bietet außerdem mehrere Modelle für begrenzte Zeit kostenlos an, etwa Nemotron 3 Ultra Free — ganz ohne zusätzlichen Key.

Continue

Fügen Sie in config.yaml ein Modell mit dem OpenAI-Provider und einer eigenen apiBase hinzu:

models:
  - name: Kimi K3 (NVIDIA, free)
    provider: openai
    model: moonshotai/kimi-k3
    apiBase: https://integrate.api.nvidia.com/v1
    apiKey: ${{ secrets.NVIDIA_API_KEY }}
    roles: [chat, edit]

Wählen Sie für die Autovervollständigung ein kleines, schnelles Modell — ein großes Reasoning-Modell fühlt sich bei jedem Tastendruck träge an.

Aider

Aider unterstützt OpenRouter nativ:

export OPENROUTER_API_KEY=sk-or-...
aider --model openrouter/z-ai/glm-5.2:free

Für andere Anbieter verwenden Sie --openai-api-base zusammen mit --openai-api-key und stellen dem Modellnamen openai/ voran.

Zed

Zed funktioniert im kostenlosen Personal-Plan mit eigenen Keys und lokalen Modellen. Fügen Sie in settings.json einen OpenAI-kompatiblen Anbieter hinzu und geben Sie den Key in den Einstellungen des Agent-Panels ein:

"language_models": {
  "openai_compatible": {
    "NVIDIA Build": {
      "api_url": "https://integrate.api.nvidia.com/v1",
      "available_models": [
        { "name": "z-ai/glm-5.3", "display_name": "GLM 5.3", "max_tokens": 128000 }
      ]
    }
  }
}

Cursor und VS Code + Copilot

Öffnen Sie in Cursor Settings → Models, geben Sie einen API-Key ein und aktivieren Sie Override OpenAI Base URL mit der Basis-URL des Anbieters. Ihr eigener Key gilt für den Chat; Tab-Vervollständigung und einige Agentenfunktionen nutzen weiterhin die eigenen Modelle und Planlimits von Cursor.

In VS Code mit GitHub Copilot können Sie unter Manage Models eigene Modelle hinzufügen: OpenRouter und lokale Ollama-Modelle funktionieren im Chat auch ohne kostenpflichtigen Copilot-Plan.

Tipps, die Kontingent sparen

  • Rollen aufteilen. Nutzen Sie das stärkste kostenlose Modell nur für Planung und schwierige Bugs; kleine Änderungen übernimmt ein schnelles Modell.
  • Zwei Anbieter konfiguriert halten. Wenn einer 429 zurückgibt, wechseln Sie zum anderen, statt zu warten.
  • Kontext schlank halten. Schließen Sie node_modules, Build-Ausgaben und Lockfiles aus — kostenlose Routen begrenzen den Kontext oft unter das Maximum des Modells.
  • Lokal autovervollständigen. Ein kleines Modell in Ollama oder LM Studio kostet nichts und hat kein Ratenlimit.

Weitere Tools mit Unterstützung für kostenlose Modelle finden Sie in unseren Listen IDE-Erweiterungen und Terminal-Agenten.

LP
LLM Perks RedaktionDas Team hinter dem Index kostenloser LLM-APIs. Wir prüfen Anbieter-Limits und testen Modelle und Tools selbst.

Weiterlesen