Proveedores de APIs de LLM gratuitas
Todas las plataformas monitorizadas en una página: quién tiene más modelos gratuitos, quién no pide tarjeta y qué base URL configurar en tu cliente.
Actualizado:
| Proveedor ↕ | Modelos ↕ | Mejor modelo gratuito | Tarjeta | Base URL | |
|---|---|---|---|---|---|
OpenRouter Los modelos con el sufijo :free permiten 50 solicitudes al día, o 1,000 al día tras una recarga única de $10 (20 solicitudes por minuto). |
21 | Qwen3.8 27B | No | https://openrouter.ai/api/v1 |
Clave |
Groq Plan gratuito con límites por modelo de solicitudes y tokens por minuto y por día; velocidad de generación muy alta en hardware LPU. |
4 | Qwen3.8 27B | No | https://api.groq.com/openai/v1 |
Clave |
Google AI Studio El plan gratuito de la API de Gemini cubre los modelos Flash y Flash-Lite con límites de tasa; el contenido del plan gratuito puede usarse para mejorar los productos de Google. |
4 | Gemini 2.0 Flash | No | https://generativelanguage.googleapis.com/v1beta/openai/ |
Clave |
Mistral AI El plan Free incluye créditos de API mensuales para los modelos de Mistral, con límites de tasa bajos por defecto. |
4 | Mistral Nemo | — | https://api.mistral.ai/v1 |
Clave |
Together AI Solo algunos modelos seleccionados tienen precio cero; no hay una prueba gratuita general. |
98 | GLM 5.3 | — | https://api.together.xyz/v1 |
Clave |
Cohere Las claves de prueba permiten 1,000 llamadas a la API al mes para evaluación, no para producción. |
4 | Command R Plus | No | https://api.cohere.ai/compatibility/v1 |
Clave |
Cerebras Prueba gratuita con límites diarios de tokens; se requiere un método de pago verificado para activar la API. |
2 | Qwen 3.8 27B | Sí | https://api.cerebras.ai/v1 |
Clave |
Cloudflare Workers AI 10,000 Neurons al día son gratis tanto en el plan Workers Free como en el Paid. |
3 | Llama 3.1 8B | — | https://api.cloudflare.com/client/v4/accounts/ACCOUNT_ID/ai/v1 |
Clave |
Hugging Face Las cuentas gratuitas reciben un pequeño crédito mensual para Inference Providers; las cuentas PRO reciben más. |
3 | Llama 3.1 8B | No | https://router.huggingface.co/v1 |
Clave |
OrcaRouter Router BYOK sin recargo por token; sus propios modelos Fusion y algunas rutas gratuitas seleccionadas no cuestan nada. |
13 | GLM 5.3 Flash | — | https://api.orcarouter.ai/v1 |
Clave |
NVIDIA Build Inferencia serverless gratuita para desarrollo y prototipado con una cuenta de desarrollador; no está pensada para tráfico de producción. |
62 | GLM 5.3 | No | https://integrate.api.nvidia.com/v1 |
Clave |
TokenRouter Los modelos gratuitos y el acceso promocional pueden tener un tiempo limitado. |
1 | Nemotron 3 Nano Omni | — | https://api.tokenrouter.com/v1 |
Clave |
Vercel AI Gateway Debes registrar una tarjeta de pago incluso para modelos de precio cero. |
3 | Laguna S 2.1 | Sí | https://ai-gateway.vercel.sh/v1 |
Clave |
Nous Portal El plan Portal de $0 incluye modelos :free con límites de tasa estándar. |
7 | Solar Pro 4 | No | https://inference-api.nousresearch.com/v1 |
Clave |
UnoRouter Gran catálogo de rutas :free sin tarjeta; capacidad compartida y límites por modelo. |
62 | Mimo V2.6 Pro | No | https://api.unorouter.com/v1 |
Clave |
Preguntas frecuentes
¿Qué proveedor de API de LLM gratuita es el mejor?
Depende del caso. OpenRouter y UnoRouter ofrecen más modelos con una sola clave, Groq y Cerebras son los más rápidos, Google AI Studio tiene límites generosos para Gemini Flash y NVIDIA Build aloja modelos abiertos recientes para desarrollo.
¿Puedo combinar varios proveedores gratuitos?
Sí. Todos son compatibles con OpenAI, así que clientes como LiteLLM, OpenCode u Open WebUI te permiten alternar claves y sumar cuotas gratuitas.