LLM Perks

Modelos y APIs gratuitos en NVIDIA Build en 2026

NVIDIA Build ofrece inferencia serverless gratuita para desarrollo. Este catálogo se actualiza directamente desde la NIM Models API autenticada.

62 modeloshasta 1M contextomejor: GLM 5.3Actualizado:

NVIDIA Build

En línea en la última verificación

Inferencia serverless gratuita para desarrollo y prototipado con una cuenta de desarrollador; no está pensada para tráfico de producción.

Base URL
https://integrate.api.nvidia.com/v1
Compatibilidad
OpenAI Chat Completions
Tarjeta
No requerida
Límites
Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar.
62 resultados
# Modelo ↕ Índice AA ↕ Contexto ↕ Tamaño ↕ Límite
1
GLM 5.3
z-ai/glm-5.3
44.8 — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
2
Kimi K3
moonshotai/kimi-k3
43.6 — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
3
GLM 5.3 Flash
z-ai/glm-5.3-flash
41.8 — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
4
DeepSeek V4.1 Flash
deepseek-ai/deepseek-v4.1-flash
39.5 — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
5
Nemotron 3 Ultra
nvidia/nemotron-3-ultra-550b-a55b
22.9 1M Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
6
Kimi K2.6
moonshotai/kimi-k2.6
27.0 — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
7
Gemma 4 31B
google/gemma-4-31b-it
19.0 — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
8
Nemotron 3.5 Lightning
nvidia/nemotron-3.5-lightning-30b-a3b
12.9 — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
9
Nemotron 3 Super
nvidia/nemotron-3-super-120b-a12b
12.8 — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
10
Nemotron 3 Nano Omni
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
10.3 — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
11
Palmyra Creative 122B
writer/palmyra-creative-122b
— — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
12
gpt-oss-20b
openai/gpt-oss-20b
10.0 — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
13
Mistral Nemo
nv-mistralai/mistral-nemo-12b-instruct
— — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
14
Laguna XS 2.1
poolside/laguna-xs-2.1
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
15
Mistral Nemotron
mistralai/mistral-nemotron
— — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
16
Muse Glimmer 30B
meta/muse-glimmer-30b
— — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
17
Nemotron 3 Nano
nvidia/nemotron-nano-3-30b-a3b
8.9 — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
18
Llama 3.2 11B Vision
meta/llama-3.2-11b-vision-instruct
5.4 — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
19
Llama 3.2 90B Vision
meta/llama-3.2-90b-vision-instruct
6.4 — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
20
Llama 3.1 Nemotron Ultra 253B
nvidia/llama-3.1-nemotron-ultra-253b-v1
7.5 — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
21
Mixtral 8x22b
mistralai/mixtral-8x22b-v0.1
— — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
22
Gemma 3 4B
google/gemma-3-4b-it
4.8 — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
23
CodeLlama 70B
meta/codellama-70b
— — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
24
Llama 2 70B
meta/llama2-70b
— — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
25
Llama 3 ChatQA 1.5 70B
nvidia/llama3-chatqa-1.5-70b
— — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
26
Nemotron 4 340B
nvidia/nemotron-4-340b-instruct
— — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
27
Palmyra Fin 70B 32K
writer/palmyra-fin-70b-32k
— 33K Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
28
Palmyra Med 70B
writer/palmyra-med-70b
— — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
29
Palmyra Med 70B 32K
writer/palmyra-med-70b-32k
— 33K Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
30
Yi Large
01-ai/yi-large
— — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
31
Cosmos Reason2 8B
nvidia/cosmos-reason2-8b
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
32
Mistral Nemo Minitron 8B 8K
nvidia/mistral-nemo-minitron-8b-8k-instruct
— 8K Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
33
Gemma 3 12B
google/gemma-3-12b-it
3.8 — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
34
Mistral 7B
mistralai/mistral-7b-instruct-v0.3
5.0 — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
35
Codestral 22B
mistralai/codestral-22b-instruct-v0.1
— — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
36
Granite 34B Code
ibm/granite-34b-code-instruct
— — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
37
Llama 3.1 Nemotron 51B
nvidia/llama-3.1-nemotron-51b-instruct
— — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
38
Neva 22B
nvidia/neva-22b
— — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
39
Phi 3.5 MoE
microsoft/phi-3.5-moe-instruct
— — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
40
StarCoder2 15B
bigcode/starcoder2-15b
— — Mediano Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
41
Llama 3.1 Nemotron 70B
nvidia/llama-3.1-nemotron-70b-instruct
6.9 — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
42
Mistral Large 2
mistralai/mistral-large-2-instruct
7.6 — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
43
Gemma 2B
google/gemma-2b
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
44
Jamba 1.5 Large
ai21labs/jamba-1.5-large-instruct
6.0 — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
45
Mistral Large
mistralai/mistral-large
5.8 — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
46
DBRX Instruct
databricks/dbrx-instruct
5.3 — Muy grande Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
47
CodeGemma 1.1 7B
google/codegemma-1.1-7b
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
48
CodeGemma 7B
google/codegemma-7b
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
49
DeepSeek Coder 6 7B
deepseek-ai/deepseek-coder-6.7b-instruct
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
50
Fuyu 8B
adept/fuyu-8b
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
51
Granite 3.0 3B A800M
ibm/granite-3.0-3b-a800m-instruct
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
52
Granite 3.0 8B
ibm/granite-3.0-8b-instruct
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
53
Granite 8B Code
ibm/granite-8b-code-instruct
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
54
Kosmos 2
microsoft/kosmos-2
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
55
Phi 3 Vision 128K
microsoft/phi-3-vision-128k-instruct
— 131K Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
56
RecurrentGemma 2B
google/recurrentgemma-2b
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
57
SEA-LION 7B
aisingapore/sea-lion-7b-instruct
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
58
Vila
nvidia/vila
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
59
Zamba2 7B Instruct
zyphra/zamba2-7b-instruct
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
60
Riva Translate 4B Instruct V2
nvidia/riva-translate-4b-instruct-v2
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
61
Riva Translate 4B Instruct
nvidia/riva-translate-4b-instruct
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir
62
Riva Translate 4B Instruct V1.1
nvidia/riva-translate-4b-instruct-v1.1
— — Pequeño Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. Abrir

Benchmarks: Artificial Analysis (24 de septiembre de 2026). Un guion significa que el modelo no está en su ranking; nunca estimamos puntuaciones por nuestra cuenta.

Preguntas frecuentes

¿NVIDIA Build es gratis?

Inferencia serverless gratuita para desarrollo y prototipado con una cuenta de desarrollador; no está pensada para tráfico de producción. Actualmente hay 62 modelos gratuitos.

¿NVIDIA Build es compatible con la API de OpenAI?

Sí — usa la base URL https://integrate.api.nvidia.com/v1 con cualquier cliente o SDK compatible con OpenAI.

¿NVIDIA Build requiere tarjeta?

No, los modelos gratuitos funcionan sin tarjeta.

Ver también