La plupart des outils de code IA acceptent n'importe quelle API compatible OpenAI. Vous pouvez donc brancher des modèles gratuits — GLM 5.3, Kimi K3, DeepSeek V4, Qwen 3.8 — dans votre éditeur ou votre agent en terminal au lieu de payer au token. Il vous faut trois éléments : une URL de base, une clé API et un identifiant de modèle. Ce guide vous montre où les obtenir et où les saisir dans sept outils populaires.
Étape 1. Obtenir une clé et choisir un modèle
Pour le code, nous vous conseillons de commencer par l'un de ces fournisseurs — aucun n'exige de carte :
| Fournisseur | URL de base | Exemple d'identifiant de modèle gratuit |
|---|---|---|
| OpenRouter | https://openrouter.ai/api/v1 | z-ai/glm-5.2:free |
| NVIDIA Build | https://integrate.api.nvidia.com/v1 | z-ai/glm-5.3, moonshotai/kimi-k3 |
| UnoRouter | https://api.unorouter.com/v1 | glm-5.3:free, deepseek-v4-flash:free |
| Google AI Studio | https://generativelanguage.googleapis.com/v1beta/openai/ | Modèles Gemini Flash |
Les identifiants de modèles changent : copiez donc l'identifiant exact depuis la fiche du modèle dans notre catalogue — par exemple GLM 5.3 ou Kimi K3. La page des modèles pour le code liste toutes les options gratuites, classées selon les benchmarks.
Cline (VS Code, JetBrains, CLI)
- Ouvrez les paramètres de Cline et choisissez API Provider.
- Sélectionnez OpenRouter et collez votre clé OpenRouter, puis saisissez un identifiant de modèle
:free— ou sélectionnez OpenAI Compatible pour NVIDIA Build ou UnoRouter. - Pour OpenAI Compatible, renseignez Base URL, API Key et Model ID à partir du tableau ci-dessus.
Cline planifie et modifie en de nombreuses étapes, il consomme donc vite les requêtes. La limite gratuite d'OpenRouter est de 50 requêtes par jour (1 000 après une recharge unique de 10 $), ce qui suffit pour une courte session mais pas pour une journée de travail complète. NVIDIA Build et UnoRouter sont plus généreux pour expérimenter.
Kilo Code
Kilo Code propose la même liste de fournisseurs : choisissez OpenRouter ou « OpenAI Compatible » dans les paramètres du fournisseur et renseignez l'URL de base, la clé et l'identifiant du modèle. Ses modes architect/code/debug peuvent utiliser des modèles différents — un modèle gratuit puissant pour l'architecture et un plus rapide pour les modifications, cela fonctionne bien.
OpenCode
OpenCode intègre OpenRouter nativement : lancez /connect dans OpenCode (ou opencode auth login), choisissez OpenRouter, collez la clé et sélectionnez un modèle gratuit avec /models. Pour tout autre fournisseur compatible OpenAI, ajoutez-le dans opencode.json :
{
"$schema": "https://opencode.ai/config.json",
"provider": {
"nvidia": {
"npm": "@ai-sdk/openai-compatible",
"name": "NVIDIA Build",
"options": {
"baseURL": "https://integrate.api.nvidia.com/v1",
"apiKey": "{env:NVIDIA_API_KEY}"
},
"models": {
"z-ai/glm-5.3": { "name": "GLM 5.3" },
"moonshotai/kimi-k3": { "name": "Kimi K3" }
}
}
}
}
OpenCode Zen propose aussi plusieurs modèles gratuitement pour une durée limitée, comme Nemotron 3 Ultra Free — sans clé supplémentaire.
Continue
Ajoutez un modèle dans config.yaml avec le fournisseur OpenAI et une apiBase personnalisée :
models:
- name: Kimi K3 (NVIDIA, free)
provider: openai
model: moonshotai/kimi-k3
apiBase: https://integrate.api.nvidia.com/v1
apiKey: ${{ secrets.NVIDIA_API_KEY }}
roles: [chat, edit]
Pour l'autocomplétion, choisissez un modèle petit et rapide — un grand modèle de raisonnement semblera lent à chaque frappe.
Aider
Aider prend en charge OpenRouter nativement :
export OPENROUTER_API_KEY=sk-or-...
aider --model openrouter/z-ai/glm-5.2:free
Pour les autres fournisseurs, utilisez --openai-api-base avec --openai-api-key et préfixez le modèle par openai/.
Zed
Zed fonctionne avec vos propres clés et des modèles locaux dans le forfait gratuit Personal. Ajoutez un fournisseur compatible OpenAI dans settings.json et saisissez la clé dans les paramètres du panneau Agent :
"language_models": {
"openai_compatible": {
"NVIDIA Build": {
"api_url": "https://integrate.api.nvidia.com/v1",
"available_models": [
{ "name": "z-ai/glm-5.3", "display_name": "GLM 5.3", "max_tokens": 128000 }
]
}
}
}
Cursor et VS Code + Copilot
Dans Cursor, ouvrez Settings → Models, saisissez une clé API et activez Override OpenAI Base URL avec l'URL de base du fournisseur. Votre propre clé s'applique au chat ; la complétion Tab et certaines fonctions d'agent utilisent toujours les modèles de Cursor et les limites de votre forfait.
VS Code avec GitHub Copilot vous permet d'ajouter vos propres modèles via Manage Models : OpenRouter et les modèles Ollama locaux fonctionnent dans le chat, même sans forfait Copilot payant.
Astuces pour économiser votre quota
- Répartissez les rôles. Réservez le modèle gratuit le plus puissant à la planification et aux bugs difficiles ; laissez un modèle rapide gérer les petites modifications.
- Gardez deux fournisseurs configurés. Quand l'un renvoie une erreur 429, basculez sur l'autre au lieu d'attendre.
- Allégez le contexte. Excluez
node_modules, les fichiers de build et les lockfiles — les routes gratuites plafonnent souvent le contexte en dessous du maximum du modèle. - Passez en local pour l'autocomplétion. Un petit modèle dans Ollama ou LM Studio ne coûte rien et n'a aucune limite de débit.
D'autres outils compatibles avec les modèles gratuits figurent dans nos listes d'extensions d'IDE et d'agents en terminal.