LLM Perks

Cómo usar LLM gratis en Cursor, Cline, OpenCode y VS Code

Base URL, clave e ID del modelo, paso a paso para siete herramientas populares.

How-to
Modelos gratis en tu IDE

La mayoría de las herramientas de programación con IA aceptan cualquier API compatible con OpenAI. Eso significa que puedes conectar modelos gratuitos — GLM 5.3, Kimi K3, DeepSeek V4, Qwen 3.8 — a tu editor o agente de terminal en lugar de pagar por token. Necesitas tres cosas: una URL base, una clave de API y un ID de modelo. Esta guía te muestra dónde conseguirlas y dónde pegarlas en siete herramientas populares.

Paso 1. Consigue una clave y elige un modelo

Para programar, te recomendamos empezar con uno de estos proveedores — ninguno pide tarjeta:

ProveedorURL baseEjemplo de ID de modelo gratuito
OpenRouterhttps://openrouter.ai/api/v1z-ai/glm-5.2:free
NVIDIA Buildhttps://integrate.api.nvidia.com/v1z-ai/glm-5.3, moonshotai/kimi-k3
UnoRouterhttps://api.unorouter.com/v1glm-5.3:free, deepseek-v4-flash:free
Google AI Studiohttps://generativelanguage.googleapis.com/v1beta/openai/Modelos Gemini Flash

Los ID de modelo cambian, así que copia el ID exacto desde la ficha del modelo en nuestro catálogo — por ejemplo, GLM 5.3 o Kimi K3. La página de modelos para programar enumera todas las opciones gratuitas ordenadas por benchmarks.

⚠️
Guarda las claves en variables de entorno o en el almacén de secretos de la herramienta, nunca en un repositorio. Las rutas gratuitas pueden registrar los prompts, así que no les envíes código propietario sin revisar la política del proveedor.

Cline (VS Code, JetBrains, CLI)

  1. Abre la configuración de Cline y elige API Provider.
  2. Selecciona OpenRouter y pega tu clave de OpenRouter; luego escribe un ID de modelo :free — o selecciona OpenAI Compatible para NVIDIA Build o UnoRouter.
  3. Con OpenAI Compatible, rellena Base URL, API Key y Model ID con los datos de la tabla anterior.

Cline planifica y edita en muchos pasos, así que gasta solicitudes rápidamente. El límite gratuito de OpenRouter es de 50 solicitudes al día (1.000 tras una recarga única de 10 $), suficiente para una sesión corta pero no para una jornada completa. NVIDIA Build y UnoRouter son más generosos para experimentar.

Kilo Code

Kilo Code tiene la misma lista de proveedores: elige OpenRouter u «OpenAI Compatible» en la configuración del proveedor y rellena la URL base, la clave y el ID del modelo. Sus modos architect/code/debug pueden usar modelos distintos — un modelo gratuito potente para la arquitectura y uno más rápido para las ediciones funciona bien.

OpenCode

OpenCode trae OpenRouter integrado: ejecuta /connect dentro de OpenCode (o opencode auth login), elige OpenRouter, pega la clave y selecciona un modelo gratuito con /models. Para cualquier otro proveedor compatible con OpenAI, añádelo a opencode.json:

{
  "$schema": "https://opencode.ai/config.json",
  "provider": {
    "nvidia": {
      "npm": "@ai-sdk/openai-compatible",
      "name": "NVIDIA Build",
      "options": {
        "baseURL": "https://integrate.api.nvidia.com/v1",
        "apiKey": "{env:NVIDIA_API_KEY}"
      },
      "models": {
        "z-ai/glm-5.3": { "name": "GLM 5.3" },
        "moonshotai/kimi-k3": { "name": "Kimi K3" }
      }
    }
  }
}

OpenCode Zen también ofrece varios modelos gratis por tiempo limitado, como Nemotron 3 Ultra Free — sin necesidad de otra clave.

Continue

Añade un modelo a config.yaml con el proveedor OpenAI y un apiBase personalizado:

models:
  - name: Kimi K3 (NVIDIA, free)
    provider: openai
    model: moonshotai/kimi-k3
    apiBase: https://integrate.api.nvidia.com/v1
    apiKey: ${{ secrets.NVIDIA_API_KEY }}
    roles: [chat, edit]

Para el autocompletado, elige un modelo pequeño y rápido — un modelo de razonamiento grande se sentirá lento con cada pulsación de tecla.

Aider

Aider es compatible con OpenRouter de forma nativa:

export OPENROUTER_API_KEY=sk-or-...
aider --model openrouter/z-ai/glm-5.2:free

Para otros proveedores, usa --openai-api-base con --openai-api-key y añade el prefijo openai/ al modelo.

Zed

Zed funciona con tus propias claves y modelos locales en el plan gratuito Personal. Añade un proveedor compatible con OpenAI en settings.json e introduce la clave en la configuración del panel Agent:

"language_models": {
  "openai_compatible": {
    "NVIDIA Build": {
      "api_url": "https://integrate.api.nvidia.com/v1",
      "available_models": [
        { "name": "z-ai/glm-5.3", "display_name": "GLM 5.3", "max_tokens": 128000 }
      ]
    }
  }
}

Cursor y VS Code + Copilot

En Cursor, abre Settings → Models, introduce una clave de API y activa Override OpenAI Base URL con la URL base del proveedor. Tu propia clave se aplica al chat; el autocompletado con Tab y algunas funciones de agente siguen usando los modelos de Cursor y los límites de tu plan.

VS Code con GitHub Copilot te permite añadir tus propios modelos en Manage Models: OpenRouter y los modelos locales de Ollama funcionan en el chat incluso sin un plan de pago de Copilot.

Consejos para ahorrar cuota

  • Reparte los roles. Usa el modelo gratuito más potente solo para planificar y para bugs difíciles; deja que un modelo rápido se encargue de las ediciones pequeñas.
  • Mantén dos proveedores configurados. Cuando uno devuelva un 429, cambia al otro en lugar de esperar.
  • Recorta el contexto. Excluye node_modules, los artefactos de compilación y los lockfiles — las rutas gratuitas suelen limitar el contexto por debajo del máximo del modelo.
  • Autocompletado en local. Un modelo pequeño en Ollama o LM Studio no cuesta nada y no tiene límites de uso.

Encontrarás más herramientas compatibles con modelos gratuitos en nuestras listas de extensiones para IDE y agentes de terminal.

LP
Redacción de LLM PerksEl equipo detrás del índice de APIs LLM gratuitas. Verificamos los límites de los proveedores y probamos modelos y herramientas.

Sigue leyendo