Llama 3.1 Nemotron Ultra 253B
Llama 3.1 Nemotron Ultra 253B es un modelo de lenguaje con 253B parámetros de NVIDIA. Actualmente es gratis en 1 proveedor con hasta — tokens de contexto. El modelo admite tool calling. Sus pesos son abiertos, así que también se puede ejecutar en local.
- Desarrollador
- NVIDIA
- Parámetros
- 253B
- Tipo
- Texto
- Licencia
- Pesos abiertos
Dónde usar Llama 3.1 Nemotron Ultra 253B gratis
Cada fila es un endpoint gratuito independiente con sus propios límites.
| Proveedor | Contexto | Límite | Tarjeta | |
|---|---|---|---|---|
NVIDIA Build nvidia/llama-3.1-nemotron-ultra-253b-v1 |
— | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | No | Abrir |
Inicio rápido
curl https://integrate.api.nvidia.com/v1/chat/completions \
-H "Authorization: Bearer $NVIDIA_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "nvidia/llama-3.1-nemotron-ultra-253b-v1",
"messages": [{"role": "user", "content": "Hello!"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://integrate.api.nvidia.com/v1",
api_key="YOUR_NVIDIA_API_KEY",
)
reply = client.chat.completions.create(
model="nvidia/llama-3.1-nemotron-ultra-253b-v1",
messages=[{"role": "user", "content": "Hello!"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://integrate.api.nvidia.com/v1",
apiKey: process.env.NVIDIA_API_KEY,
});
const reply = await client.chat.completions.create({
model: "nvidia/llama-3.1-nemotron-ultra-253b-v1",
messages: [{ role: "user", content: "Hello!" }],
});
console.log(reply.choices[0].message.content);Ejemplo para NVIDIA Build. Funciona cualquier cliente compatible con OpenAI: Cursor, Cline, OpenCode, Open WebUI.
Benchmarks
Fuente: Artificial Analysis · Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)
Modelos gratuitos similares
Preguntas frecuentes
¿Llama 3.1 Nemotron Ultra 253B es gratis?
Sí. A fecha de 26 de septiembre de 2026, Llama 3.1 Nemotron Ultra 253B es gratis en NVIDIA Build. Cada proveedor tiene sus propios límites — consulta la tabla de arriba.
¿Cómo llamo a Llama 3.1 Nemotron Ultra 253B vía API?
Usa cualquier cliente compatible con OpenAI con la base URL https://integrate.api.nvidia.com/v1, el ID de modelo nvidia/llama-3.1-nemotron-ultra-253b-v1 y una clave de NVIDIA Build.
¿Qué tan bueno es Llama 3.1 Nemotron Ultra 253B?
Artificial Analysis Intelligence Index: 7.5, GPQA Diamond: 73%. Como comparación, el modelo gratuito más potente del catálogo ahora mismo es GLM 5.3.
¿Llama 3.1 Nemotron Ultra 253B es de pesos abiertos?
Sí, los pesos están publicados — puedes descargarlo y ejecutarlo en local, por ejemplo con Ollama o LM Studio.