La mayoría de las herramientas de programación con IA aceptan cualquier API compatible con OpenAI. Eso significa que puedes conectar modelos gratuitos — GLM 5.3, Kimi K3, DeepSeek V4, Qwen 3.8 — a tu editor o agente de terminal en lugar de pagar por token. Necesitas tres cosas: una URL base, una clave de API y un ID de modelo. Esta guía te muestra dónde conseguirlas y dónde pegarlas en siete herramientas populares.
Paso 1. Consigue una clave y elige un modelo
Para programar, te recomendamos empezar con uno de estos proveedores — ninguno pide tarjeta:
| Proveedor | URL base | Ejemplo de ID de modelo gratuito |
|---|---|---|
| OpenRouter | https://openrouter.ai/api/v1 | z-ai/glm-5.2:free |
| NVIDIA Build | https://integrate.api.nvidia.com/v1 | z-ai/glm-5.3, moonshotai/kimi-k3 |
| UnoRouter | https://api.unorouter.com/v1 | glm-5.3:free, deepseek-v4-flash:free |
| Google AI Studio | https://generativelanguage.googleapis.com/v1beta/openai/ | Modelos Gemini Flash |
Los ID de modelo cambian, así que copia el ID exacto desde la ficha del modelo en nuestro catálogo — por ejemplo, GLM 5.3 o Kimi K3. La página de modelos para programar enumera todas las opciones gratuitas ordenadas por benchmarks.
Cline (VS Code, JetBrains, CLI)
- Abre la configuración de Cline y elige API Provider.
- Selecciona OpenRouter y pega tu clave de OpenRouter; luego escribe un ID de modelo
:free— o selecciona OpenAI Compatible para NVIDIA Build o UnoRouter. - Con OpenAI Compatible, rellena Base URL, API Key y Model ID con los datos de la tabla anterior.
Cline planifica y edita en muchos pasos, así que gasta solicitudes rápidamente. El límite gratuito de OpenRouter es de 50 solicitudes al día (1.000 tras una recarga única de 10 $), suficiente para una sesión corta pero no para una jornada completa. NVIDIA Build y UnoRouter son más generosos para experimentar.
Kilo Code
Kilo Code tiene la misma lista de proveedores: elige OpenRouter u «OpenAI Compatible» en la configuración del proveedor y rellena la URL base, la clave y el ID del modelo. Sus modos architect/code/debug pueden usar modelos distintos — un modelo gratuito potente para la arquitectura y uno más rápido para las ediciones funciona bien.
OpenCode
OpenCode trae OpenRouter integrado: ejecuta /connect dentro de OpenCode (o opencode auth login), elige OpenRouter, pega la clave y selecciona un modelo gratuito con /models. Para cualquier otro proveedor compatible con OpenAI, añádelo a opencode.json:
{
"$schema": "https://opencode.ai/config.json",
"provider": {
"nvidia": {
"npm": "@ai-sdk/openai-compatible",
"name": "NVIDIA Build",
"options": {
"baseURL": "https://integrate.api.nvidia.com/v1",
"apiKey": "{env:NVIDIA_API_KEY}"
},
"models": {
"z-ai/glm-5.3": { "name": "GLM 5.3" },
"moonshotai/kimi-k3": { "name": "Kimi K3" }
}
}
}
}
OpenCode Zen también ofrece varios modelos gratis por tiempo limitado, como Nemotron 3 Ultra Free — sin necesidad de otra clave.
Continue
Añade un modelo a config.yaml con el proveedor OpenAI y un apiBase personalizado:
models:
- name: Kimi K3 (NVIDIA, free)
provider: openai
model: moonshotai/kimi-k3
apiBase: https://integrate.api.nvidia.com/v1
apiKey: ${{ secrets.NVIDIA_API_KEY }}
roles: [chat, edit]
Para el autocompletado, elige un modelo pequeño y rápido — un modelo de razonamiento grande se sentirá lento con cada pulsación de tecla.
Aider
Aider es compatible con OpenRouter de forma nativa:
export OPENROUTER_API_KEY=sk-or-...
aider --model openrouter/z-ai/glm-5.2:free
Para otros proveedores, usa --openai-api-base con --openai-api-key y añade el prefijo openai/ al modelo.
Zed
Zed funciona con tus propias claves y modelos locales en el plan gratuito Personal. Añade un proveedor compatible con OpenAI en settings.json e introduce la clave en la configuración del panel Agent:
"language_models": {
"openai_compatible": {
"NVIDIA Build": {
"api_url": "https://integrate.api.nvidia.com/v1",
"available_models": [
{ "name": "z-ai/glm-5.3", "display_name": "GLM 5.3", "max_tokens": 128000 }
]
}
}
}
Cursor y VS Code + Copilot
En Cursor, abre Settings → Models, introduce una clave de API y activa Override OpenAI Base URL con la URL base del proveedor. Tu propia clave se aplica al chat; el autocompletado con Tab y algunas funciones de agente siguen usando los modelos de Cursor y los límites de tu plan.
VS Code con GitHub Copilot te permite añadir tus propios modelos en Manage Models: OpenRouter y los modelos locales de Ollama funcionan en el chat incluso sin un plan de pago de Copilot.
Consejos para ahorrar cuota
- Reparte los roles. Usa el modelo gratuito más potente solo para planificar y para bugs difíciles; deja que un modelo rápido se encargue de las ediciones pequeñas.
- Mantén dos proveedores configurados. Cuando uno devuelva un 429, cambia al otro en lugar de esperar.
- Recorta el contexto. Excluye
node_modules, los artefactos de compilación y los lockfiles — las rutas gratuitas suelen limitar el contexto por debajo del máximo del modelo. - Autocompletado en local. Un modelo pequeño en Ollama o LM Studio no cuesta nada y no tiene límites de uso.
Encontrarás más herramientas compatibles con modelos gratuitos en nuestras listas de extensiones para IDE y agentes de terminal.