Modelos y APIs gratuitos en NVIDIA Build en 2026
NVIDIA Build ofrece inferencia serverless gratuita para desarrollo. Este catálogo se actualiza directamente desde la NIM Models API autenticada.

NVIDIA Build
Inferencia serverless gratuita para desarrollo y prototipado con una cuenta de desarrollador; no está pensada para tráfico de producción.
- Base URL
https://integrate.api.nvidia.com/v1- Compatibilidad
- OpenAI Chat Completions
- Tarjeta
- No requerida
- Límites
- Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar.
| # | Modelo ↕ | Índice AA ↕ | Contexto ↕ | Tamaño ↕ | Límite | |
|---|---|---|---|---|---|---|
| 1 |
GLM 5.3
z-ai/glm-5.3 |
44.8 | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 2 |
Kimi K3
moonshotai/kimi-k3 |
43.6 | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 3 |
GLM 5.3 Flash
z-ai/glm-5.3-flash |
41.8 | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 4 |
DeepSeek V4.1 Flash
deepseek-ai/deepseek-v4.1-flash |
39.5 | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 5 |
Nemotron 3 Ultra
nvidia/nemotron-3-ultra-550b-a55b |
22.9 | 1M | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 6 |
Kimi K2.6
moonshotai/kimi-k2.6 |
27.0 | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 7 |
Gemma 4 31B
google/gemma-4-31b-it |
19.0 | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 8 |
Nemotron 3.5 Lightning
nvidia/nemotron-3.5-lightning-30b-a3b |
12.9 | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 9 |
Nemotron 3 Super
nvidia/nemotron-3-super-120b-a12b |
12.8 | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 10 |
Nemotron 3 Nano Omni
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning |
10.3 | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 11 |
Palmyra Creative 122B
writer/palmyra-creative-122b |
— | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 12 |
gpt-oss-20b
openai/gpt-oss-20b |
10.0 | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 13 |
Mistral Nemo
nv-mistralai/mistral-nemo-12b-instruct |
— | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 14 |
Laguna XS 2.1
poolside/laguna-xs-2.1 |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 15 |
Mistral Nemotron
mistralai/mistral-nemotron |
— | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 16 |
Muse Glimmer 30B
meta/muse-glimmer-30b |
— | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 17 |
Nemotron 3 Nano
nvidia/nemotron-nano-3-30b-a3b |
8.9 | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 18 |
Llama 3.2 11B Vision
meta/llama-3.2-11b-vision-instruct |
5.4 | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 19 |
Llama 3.2 90B Vision
meta/llama-3.2-90b-vision-instruct |
6.4 | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 20 |
Llama 3.1 Nemotron Ultra 253B
nvidia/llama-3.1-nemotron-ultra-253b-v1 |
7.5 | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 21 |
Mixtral 8x22b
mistralai/mixtral-8x22b-v0.1 |
— | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 22 |
Gemma 3 4B
google/gemma-3-4b-it |
4.8 | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 23 |
CodeLlama 70B
meta/codellama-70b |
— | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 24 |
Llama 2 70B
meta/llama2-70b |
— | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 25 |
Llama 3 ChatQA 1.5 70B
nvidia/llama3-chatqa-1.5-70b |
— | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 26 |
Nemotron 4 340B
nvidia/nemotron-4-340b-instruct |
— | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 27 |
Palmyra Fin 70B 32K
writer/palmyra-fin-70b-32k |
— | 33K | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 28 |
Palmyra Med 70B
writer/palmyra-med-70b |
— | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 29 |
Palmyra Med 70B 32K
writer/palmyra-med-70b-32k |
— | 33K | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 30 |
Yi Large
01-ai/yi-large |
— | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 31 |
Cosmos Reason2 8B
nvidia/cosmos-reason2-8b |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 32 |
Mistral Nemo Minitron 8B 8K
nvidia/mistral-nemo-minitron-8b-8k-instruct |
— | 8K | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 33 |
Gemma 3 12B
google/gemma-3-12b-it |
3.8 | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 34 |
Mistral 7B
mistralai/mistral-7b-instruct-v0.3 |
5.0 | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 35 |
Codestral 22B
mistralai/codestral-22b-instruct-v0.1 |
— | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 36 |
Granite 34B Code
ibm/granite-34b-code-instruct |
— | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 37 |
Llama 3.1 Nemotron 51B
nvidia/llama-3.1-nemotron-51b-instruct |
— | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 38 |
Neva 22B
nvidia/neva-22b |
— | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 39 |
Phi 3.5 MoE
microsoft/phi-3.5-moe-instruct |
— | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 40 |
StarCoder2 15B
bigcode/starcoder2-15b |
— | — | Mediano | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 41 |
Llama 3.1 Nemotron 70B
nvidia/llama-3.1-nemotron-70b-instruct |
6.9 | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 42 |
Mistral Large 2
mistralai/mistral-large-2-instruct |
7.6 | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 43 |
Gemma 2B
google/gemma-2b |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 44 |
Jamba 1.5 Large
ai21labs/jamba-1.5-large-instruct |
6.0 | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 45 |
Mistral Large
mistralai/mistral-large |
5.8 | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 46 |
DBRX Instruct
databricks/dbrx-instruct |
5.3 | — | Muy grande | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 47 |
CodeGemma 1.1 7B
google/codegemma-1.1-7b |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 48 |
CodeGemma 7B
google/codegemma-7b |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 49 |
DeepSeek Coder 6 7B
deepseek-ai/deepseek-coder-6.7b-instruct |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 50 |
Fuyu 8B
adept/fuyu-8b |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 51 |
Granite 3.0 3B A800M
ibm/granite-3.0-3b-a800m-instruct |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 52 |
Granite 3.0 8B
ibm/granite-3.0-8b-instruct |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 53 |
Granite 8B Code
ibm/granite-8b-code-instruct |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 54 |
Kosmos 2
microsoft/kosmos-2 |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 55 |
Phi 3 Vision 128K
microsoft/phi-3-vision-128k-instruct |
— | 131K | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 56 |
RecurrentGemma 2B
google/recurrentgemma-2b |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 57 |
SEA-LION 7B
aisingapore/sea-lion-7b-instruct |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 58 |
Vila
nvidia/vila |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 59 |
Zamba2 7B Instruct
zyphra/zamba2-7b-instruct |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 60 |
Riva Translate 4B Instruct V2
nvidia/riva-translate-4b-instruct-v2 |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 61 |
Riva Translate 4B Instruct
nvidia/riva-translate-4b-instruct |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
| 62 |
Riva Translate 4B Instruct V1.1
nvidia/riva-translate-4b-instruct-v1.1 |
— | — | Pequeño | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | Abrir |
Benchmarks: Artificial Analysis (24 de septiembre de 2026). Un guion significa que el modelo no está en su ranking; nunca estimamos puntuaciones por nuestra cuenta.
Preguntas frecuentes
¿NVIDIA Build es gratis?
Inferencia serverless gratuita para desarrollo y prototipado con una cuenta de desarrollador; no está pensada para tráfico de producción. Actualmente hay 62 modelos gratuitos.
¿NVIDIA Build es compatible con la API de OpenAI?
Sí — usa la base URL https://integrate.api.nvidia.com/v1 con cualquier cliente o SDK compatible con OpenAI.
¿NVIDIA Build requiere tarjeta?
No, los modelos gratuitos funcionan sin tarjeta.