APIs de LLM gratuitas
Un catálogo en vivo de APIs de IA gratuitas para los modelos actuales de DeepSeek, Qwen, Nemotron, Mistral, Llama, Gemini y otros. Compara proveedores, ventanas de contexto y límites antes de conectar Cursor, VS Code, Cline, Open WebUI o tu propia aplicación.
Mejores modelos gratuitos ahora mismo
Selección automática según benchmarks, tamaño y número de proveedores gratuitos.
New free models this week
Todos los modelos gratuitos
Una fila por modelo; la ficha del modelo muestra todos los proveedores gratuitos, límites y ejemplos de código.
| # | Modelo ↕ | Índice AA ↕ | GPQA ↕ | Contexto ↕ | Tamaño ↕ | Gratis en ↕ | |
|---|---|---|---|---|---|---|---|
| 📌 | OpenCode GO $60 in monthly API credits for $10, covering DeepSeek, Qwen, GLM, and other models. Introductory first-month offer available. |
Abrir | |||||
| 1 | 44.8 | 92% | 1M | Muy grande | |||
| 2 | 46.3 | — | 1M | Muy grande | |||
| 3 | 43.6 | 94% | 1M | Muy grande | |||
| 4 | 41.8 | 91% | 1M | Mediano | |||
| 5 | 39.8 | 92% | 1M | Mediano | |||
| 6 | 39.5 | — | — | Muy grande | |||
| 7 | 34.3 | 91% | 1M | Muy grande | |||
| 8 | 33.7 | 91% | 262K | Mediano | |||
| 9 | 34.0 | 93% | 1M | Mediano | |||
| 10 | 33.7 | 90% | 1M | Muy grande | |||
| 11 | 33.7 | 91% | — | Mediano | |||
| 12 | 27.8 | 90% | 1M | Pequeño | |||
| 13 | 28.2 | 89% | 524K | Muy grande | |||
| 14 | 22.9 | 87% | 1M | Muy grande | |||
| 15 | 25.0 | 87% | 1M | Pequeño | |||
| 16 | 27.0 | 91% | — | Muy grande | |||
| 17 | 22.6 | — | 262K | Pequeño | |||
| 18 | 25.3 | 90% | — | Pequeño | |||
| 19 | 19.0 | 86% | 262K | Mediano | |||
| 20 | 22.2 | 84% | 1M | Pequeño | |||
| 21 | 22.2 | 86% | 203K | Muy grande | |||
| 22 | 19.1 | 78% | 1M | Muy grande | |||
| 23 | 16.7 | 79% | 262K | Mediano | |||
| 24 | 19.5 | 81% | 262K | Pequeño | |||
| 25 | 19.3 | 85% | 262K | Mediano | |||
| 26 | 18.2 | 84% | 262K | Mediano | |||
| 27 | 17.7 | 83% | 262K | Muy grande | |||
| 28 | 18.6 | 78% | 197K | Muy grande | |||
| 29 | 12.9 | 74% | 1M | Mediano | |||
| 30 | 12.8 | 80% | 262K | Muy grande | |||
| 31 | — | — | 1M | Muy grande | |||
| 32 | 10.3 | 47% | 262K | Mediano | |||
| 33 | 14.2 | 75% | 262K | Mediano | |||
| 34 |
Axon 1.8 Pro
New
|
— | — | 512K | Muy grande | ||
| 35 | — | — | 256K | Muy grande | |||
| 36 | 14.9 | 58% | 128K | Mediano | |||
| 37 | 13.7 | 81% | 262K | Pequeño | |||
| 38 | 13.4 | 77% | 262K | Muy grande | |||
| 39 | — | — | 131K | Muy grande | |||
| 40 | — | — | 131K | Muy grande | |||
| 41 | — | — | 203K | Muy grande | |||
| 42 | — | — | 203K | Muy grande | |||
| 43 | — | — | 8K | Muy grande | |||
| 44 | — | — | 131K | Muy grande | |||
| 45 |
Palmyra Creative 122B
Writer · 122B
|
— | — | — | Muy grande | ||
| 46 |
Nvidia Nemotron 3 Super
NVIDIA · 120B · 12B
RazonamientoProgramaciónUso de herramientasPesos abiertos
|
12.8 | 80% | 262K | Muy grande | ||
| 47 | 11.7 | 70% | 1M | Muy grande | |||
| 48 | 12.7 | 79% | 262K | Muy grande | |||
| 49 | 11.6 | 78% | 131K | Muy grande | |||
| 50 | 10.0 | 61% | 131K | Mediano | |||
| 51 | 9.9 | 76% | 262K | Pequeño | |||
| 52 | — | — | 131K | Mediano | |||
| 53 | 10.0 | 68% | 1M | Muy grande | |||
| 54 | — | — | 1M | Pequeño | |||
| 55 | 11.2 | 76% | — | Muy grande | |||
| 56 | — | — | 1M | Mediano | |||
| 57 | 8.9 | 62% | 1M | Mediano | |||
| 58 | 9.8 | 71% | 262K | Mediano | |||
| 59 | 9.6 | 52% | 262K | Muy grande | |||
| 60 | — | — | 262K | Pequeño | |||
| 61 | — | — | 262K | Pequeño | |||
| 62 | — | — | 128K | Mediano | |||
| 63 |
Muse Glimmer 30B
Meta · 30B
|
— | — | 131K | Mediano | ||
| 64 | 9.5 | 67% | 262K | Mediano | |||
| 65 | 8.1 | 59% | 10.5M | Muy grande | |||
| 66 | — | — | 262K | Mediano | |||
| 67 |
Holo3 35B A3B
35B · 3B
|
— | — | 262K | Mediano | ||
| 68 | — | — | 262K | Mediano | |||
| 69 | 10.0 | 67% | 131K | Muy grande | |||
| 70 | — | — | 262K | Mediano | |||
| 71 | 8.4 | 56% | 128K | Pequeño | |||
| 72 | 6.9 | 26% | 131K | Pequeño | |||
| 73 | 8.9 | 76% | 262K | Mediano | |||
| 74 | 8.8 | 67% | 262K | Pequeño | |||
| 75 | 9.5 | 59% | 131K | Mediano | |||
| 76 | 7.3 | 54% | 1M | Pequeño | |||
| 77 | — | — | 16K | Mediano | |||
| 78 | — | — | 131K | Mediano | |||
| 79 | — | — | 131K | Mediano | |||
| 80 | — | — | 131K | Mediano | |||
| 81 | — | — | 131K | Mediano | |||
| 82 | — | — | 131K | Mediano | |||
| 83 | — | — | 8K | Mediano | |||
| 84 | — | — | 131K | Mediano | |||
| 85 | — | — | 131K | Mediano | |||
| 86 | — | — | 33K | Mediano | |||
| 87 | — | — | 25K | Mediano | |||
| 88 |
Typhoon V2.5 30B A3B Instruct
30B · 3B
|
— | — | 131K | Mediano | ||
| 89 | 8.9 | 64% | 16K | Mediano | |||
| 90 | 8.9 | 58% | 131K | Pequeño | |||
| 91 | 8.9 | 76% | — | Mediano | |||
| 92 | 8.7 | 43% | 131K | Mediano | |||
| 93 | 8.6 | 66% | 41K | Mediano | |||
| 94 | 8.6 | 67% | 41K | Mediano | |||
| 95 |
Space Bunny Alpha
Stealth model · New
|
— | — | 1M | Pequeño | ||
| 96 | 5.4 | 22% | 131K | Mediano | |||
| 97 | 8.4 | 62% | 80K | Mediano | |||
| 98 | 8.4 | 54% | 128K | Muy grande | |||
| 99 | 5.8 | 38% | 256K | Mediano | |||
| 100 | 8.2 | 60% | 2K | Mediano | |||
| 101 | 6.4 | 43% | 16K | Muy grande | |||
| 102 | 6.9 | 46% | 262K | Pequeño | |||
| 103 | 7.8 | 43% | 131K | Pequeño | |||
| 104 | 7.7 | 50% | 131K | Muy grande | |||
| 105 | 7.7 | 49% | 131K | Muy grande | |||
| 106 | 7.6 | 68% | 66K | Muy grande | |||
| 107 |
Dots3-Note Preview
Dots Studio
|
— | — | 512K | Pequeño | ||
| 108 | — | — | 66K | Muy grande | |||
| 109 | 7.5 | 73% | — | Muy grande | |||
| 110 | 7.4 | 57% | 131K | Pequeño | |||
| 111 | 7.3 | 52% | 131K | Muy grande | |||
| 112 | 7.3 | 59% | 41K | Pequeño | |||
| 113 |
Mimo V2.6 Flash
New
|
— | — | 1M | Pequeño | ||
| 114 | 6.9 | 47% | 131K | Mediano | |||
| 115 | 6.7 | 42% | 131K | Mediano | |||
| 116 | 6.6 | 41% | 16K | Muy grande | |||
| 117 |
Allam 2 7B
7B
|
— | — | 4K | Pequeño | ||
| 118 | 4.8 | 29% | 66K | Pequeño | |||
| 119 | — | — | 256K | Pequeño | |||
| 120 | — | — | 16K | Muy grande | |||
| 121 |
Command R Plus
Cohere · 104B · Heredado
|
— | — | 128K | Muy grande | ||
| 122 | — | — | — | Muy grande | |||
| 123 | — | — | — | Muy grande | |||
| 124 | — | — | — | Muy grande | |||
| 125 | — | — | — | Muy grande | |||
| 126 |
Palmyra Fin 70B 32K
Writer · 70B · Heredado
|
— | — | 33K | Muy grande | ||
| 127 |
Palmyra Med 70B
Writer · 70B · Heredado
|
— | — | — | Muy grande | ||
| 128 |
Palmyra Med 70B 32K
Writer · 70B · Heredado
|
— | — | 33K | Muy grande | ||
| 129 |
Yi Large
01.AI · Heredado
|
— | — | — | Muy grande | ||
| 130 |
Axon 1.8 Flash
New
|
— | — | 512K | Pequeño | ||
| 131 | — | — | 512K | Pequeño | |||
| 132 | — | — | 256K | Pequeño | |||
| 133 |
K2 Horizon
New
|
— | — | 524K | Pequeño | ||
| 134 | — | — | 262K | Pequeño | |||
| 135 | 5.6 | 24% | 4K | Pequeño | |||
| 136 |
Sarvam M
Pesos abiertos
|
5.3 | 42% | 33K | Pequeño | ||
| 137 | 5.2 | 36% | 41K | Pequeño | |||
| 138 | 5.1 | 22% | 33K | Pequeño | |||
| 139 | 5.1 | 34% | 131K | Pequeño | |||
| 140 | — | — | 131K | Pequeño | |||
| 141 | — | — | 131K | Pequeño | |||
| 142 | — | — | 33K | Pequeño | |||
| 143 | — | — | 131K | Pequeño | |||
| 144 | — | — | 131K | Pequeño | |||
| 145 | — | — | 131K | Pequeño | |||
| 146 | — | — | 33K | Pequeño | |||
| 147 | — | — | — | Pequeño | |||
| 148 | — | — | 8K | Pequeño | |||
| 149 |
Lorellm
New
|
— | — | 16K | Pequeño | ||
| 150 | — | — | 131K | Pequeño | |||
| 151 | — | — | 6K | Pequeño | |||
| 152 | — | — | 33K | Pequeño | |||
| 153 | 4.9 | 43% | 66K | Mediano | |||
| 154 | 4.8 | 24% | 33K | Pequeño | |||
| 155 | 4.8 | 20% | 131K | Pequeño | |||
| 156 | 4.8 | 23% | 41K | Pequeño | |||
| 157 | 3.8 | 35% | — | Mediano | |||
| 158 | 7.9 | 59% | 2.1M | Muy grande | |||
| 159 | 5.0 | 18% | 33K | Pequeño | |||
| 160 | 7.1 | 46% | 1M | Mediano | |||
| 161 |
Command R
Cohere · 35B · Heredado
|
— | — | 128K | Mediano | ||
| 162 |
Command
Cohere · Heredado
|
— | — | 4K | Mediano | ||
| 163 |
Command Light
Cohere · Heredado
|
— | — | 4K | Mediano | ||
| 164 | — | — | 33K | Mediano | |||
| 165 | — | — | — | Mediano | |||
| 166 | — | — | — | Mediano | |||
| 167 | — | — | — | Mediano | |||
| 168 | — | — | — | Mediano | |||
| 169 | — | — | — | Mediano | |||
| 170 | — | — | — | Mediano | |||
| 171 | 6.9 | 47% | 16K | Muy grande | |||
| 172 |
Mistral Large 2
Mistral AI · 123B · Heredado
|
7.6 | 49% | — | Muy grande | ||
| 173 |
Grok Beta
xAI · New · Heredado
|
6.9 | 47% | 25K | Muy grande | ||
| 174 | — | — | 8K | Pequeño | |||
| 175 | 6.0 | 43% | — | Muy grande | |||
| 176 |
Mistral Large
Mistral AI · Heredado
|
5.8 | 35% | — | Muy grande | ||
| 177 | 5.3 | 33% | — | Muy grande | |||
| 178 | 5.1 | 29% | 33K | Mediano | |||
| 179 | — | — | 4K | Pequeño | |||
| 180 | — | — | 8K | Pequeño | |||
| 181 | — | — | 4K | Pequeño | |||
| 182 | — | — | — | Pequeño | |||
| 183 | — | — | — | Pequeño | |||
| 184 | — | — | — | Pequeño | |||
| 185 | — | — | — | Pequeño | |||
| 186 | — | — | — | Pequeño | |||
| 187 | — | — | — | Pequeño | |||
| 188 | — | — | — | Pequeño | |||
| 189 | — | — | — | Pequeño | |||
| 190 | — | — | 131K | Pequeño | |||
| 191 | — | — | — | Pequeño | |||
| 192 | — | — | — | Pequeño | |||
| 193 | — | — | — | Pequeño | |||
| 194 |
Zamba2 7B Instruct
Zyphra · 7B · Heredado
|
— | — | — | Pequeño | ||
| 195 | — | — | 128K | Mediano | |||
| 196 | — | — | 131K | Mediano | |||
| 197 |
Riva Translate 4B Instruct V2
NVIDIA · 4B · Traducción
|
— | — | 8K | Pequeño | ||
| 198 |
OrcaVerify Text 1.0
Orca · Moderación
|
— | — | — | Pequeño | ||
| 199 |
Riva Translate 4B Instruct
NVIDIA · 4B · Traducción
|
— | — | — | Pequeño | ||
| 200 |
Riva Translate 4B Instruct V1.1
NVIDIA · 4B · Traducción
|
— | — | — | Pequeño | ||
| 201 |
Lyria 3 Pro Preview
Google · Audio
|
— | — | 1M | — | ||
| 202 |
Lyria 3 Clip Preview
Google · Audio
|
— | — | 1M | — | ||
| 203 |
Mistral Embed
Mistral AI · Embeddings
|
— | — | 8K | — | ||
| 204 |
Nano Banana Pro (Gemini 3 Pro Image Preview)
Google · Generación de imágenes
|
— | — | 66K | — | ||
| 205 |
Nano Banana 2 (Gemini 3.1 Flash Image Preview)
Google · Generación de imágenes
|
— | — | 66K | — | ||
| 206 |
Grok Imagine Image
xAI · Generación de imágenes
|
— | — | — | — | ||
| 207 |
Kling 3.0 Turbo
Kling · Generación de video
|
— | — | — | — | ||
| 208 |
OrcaDub 1.0
OrcaDub · Audio
|
— | — | — | — | ||
| 209 |
Fusion
OrcaRouter · Enrutador automático
|
— | — | 1M | — | ||
| 210 |
Fusion Mini
OrcaRouter · Enrutador automático
|
— | — | 1M | — | ||
| 211 |
Free Models Router
OpenRouter · Enrutador automático
|
— | — | 200K | — | ||
| 212 |
Fusion Flash
OrcaRouter · Enrutador automático
|
— | — | 262K | — | ||
Benchmarks: Artificial Analysis (24 de septiembre de 2026). Un guion significa que el modelo no está en su ranking; nunca estimamos puntuaciones por nuestra cuenta.
Proveedores de API gratuitas
Estado de la última verificación, número de modelos y condiciones de acceso.
Los modelos con el sufijo :free permiten 50 solicitudes al día, o 1,000 al día tras una recarga única de $10 (20 solicitudes por minuto).
Plan gratuito con límites por modelo de solicitudes y tokens por minuto y por día; velocidad de generación muy alta en hardware LPU.
El plan gratuito de la API de Gemini cubre los modelos Flash y Flash-Lite con límites de tasa; el contenido del plan gratuito puede usarse para mejorar los productos de Google.
El plan Free incluye créditos de API mensuales para los modelos de Mistral, con límites de tasa bajos por defecto.
Solo algunos modelos seleccionados tienen precio cero; no hay una prueba gratuita general.
Las claves de prueba permiten 1,000 llamadas a la API al mes para evaluación, no para producción.
Prueba gratuita con límites diarios de tokens; se requiere un método de pago verificado para activar la API.
10,000 Neurons al día son gratis tanto en el plan Workers Free como en el Paid.
Las cuentas gratuitas reciben un pequeño crédito mensual para Inference Providers; las cuentas PRO reciben más.
Router BYOK sin recargo por token; sus propios modelos Fusion y algunas rutas gratuitas seleccionadas no cuestan nada.
Inferencia serverless gratuita para desarrollo y prototipado con una cuenta de desarrollador; no está pensada para tráfico de producción.
Los modelos gratuitos y el acceso promocional pueden tener un tiempo limitado.
Debes registrar una tarjeta de pago incluso para modelos de precio cero.
El plan Portal de $0 incluye modelos :free con límites de tasa estándar.
Gran catálogo de rutas :free sin tarjeta; capacidad compartida y límites por modelo.
Software gratuito para usar estos modelos
Agentes, IDE y ejecutores locales que se conectan a APIs gratuitas.
Agente que se automejora, aprende habilidades de la experiencia y mantiene memoria entre sesiones; funciona en la CLI, una app de escritorio, Telegram, Discord, Slack y WhatsApp.
Asistente de IA personal (antes Clawdbot/Moltbot) que se ejecuta en tu propia máquina y actúa a través de WhatsApp, Telegram, Discord, Slack, iMessage y más de 20 canales.
Agente de programación de código abierto para la terminal con TUI, app de escritorio e integración con IDE; agentes plan/build, soporte LSP y cualquier proveedor de modelos.
Agente de terminal de código abierto de Google: herramientas de código, archivos y shell, grounding con búsqueda web, servidores MCP y una gran ventana de contexto.
Créditos de IA gratuitos
Planes de API gratuitos, además de programas para startups y estudiantes.
Cuenta de Google y una clave de API de AI Studio; el contenido del plan gratuito puede usarse para mejorar los productos de Google
Cuenta de OpenRouter; se aplica a las variantes de modelos :free
Cuenta de GroqCloud
ID de organización de un Activate Provider (VC, aceleradora o business angel); antes de la Serie B
Startup financiada centrada en IA con sitio web público
Estudiante verificado mediante GitHub Education
Preguntas frecuentes
¿Existen APIs de LLM gratuitas?
Sí. A fecha de 26 de septiembre de 2026 encontramos 212 modelos con acceso gratuito por API en 15 proveedores. Son modelos con precio cero por token, un plan gratuito para desarrolladores o una cuota gratuita.
¿Qué modelo de API gratuito es el más potente ahora mismo?
Según el Artificial Analysis Intelligence Index, GLM 5.3 (44.8) lidera actualmente — es gratis en Together AI, NVIDIA Build. El ranking se actualiza con cada actualización del catálogo.
¿Necesito una tarjeta de crédito?
No siempre. Por ejemplo, estos funcionan sin tarjeta: OpenRouter, Groq, Google AI Studio, Cohere, Hugging Face, NVIDIA Build. Cerebras y Vercel AI Gateway requieren tarjeta incluso para modelos gratuitos.
¿Con qué frecuencia se actualizan los datos?
El catálogo consulta las APIs de los proveedores cada hora. Los modelos gratuitos nuevos y eliminados aparecen en la sección Nuevos modelos y en el feed RSS.
¿Puedo usar modelos gratuitos en Cursor, Cline u OpenCode?
Sí. Casi todos los proveedores de aquí son compatibles con OpenAI: configura la base URL del proveedor, tu clave y el ID del modelo que aparece en su ficha. Las apps compatibles se listan en la sección Software gratuito.