Llama 3.1 Nemotron 70B
Llama 3.1 Nemotron 70B es un modelo de lenguaje con 70B parámetros de NVIDIA. Actualmente es gratis en 2 proveedores con hasta 16K tokens de contexto. Sus pesos son abiertos, así que también se puede ejecutar en local.
- Desarrollador
- NVIDIA
- Parámetros
- 70B
- Contexto
- 16K tokens
- Tipo
- Texto
- Licencia
- Pesos abiertos
Dónde usar Llama 3.1 Nemotron 70B gratis
Cada fila es un endpoint gratuito independiente con sus propios límites.
| Proveedor | Contexto | Límite | Tarjeta | |
|---|---|---|---|---|
Together AI nim/nvidia/llama-3.1-nemotron-70b-instruct |
16K | Fair use (depends on server load) | — | Abrir |
NVIDIA Build nvidia/llama-3.1-nemotron-70b-instruct |
— | Inferencia serverless gratuita para desarrollo; los límites y los modelos disponibles pueden cambiar. | No | Abrir |
Inicio rápido
curl https://api.together.xyz/v1/chat/completions \
-H "Authorization: Bearer $TOGETHER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "nim/nvidia/llama-3.1-nemotron-70b-instruct",
"messages": [{"role": "user", "content": "Hello!"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.together.xyz/v1",
api_key="YOUR_TOGETHER_API_KEY",
)
reply = client.chat.completions.create(
model="nim/nvidia/llama-3.1-nemotron-70b-instruct",
messages=[{"role": "user", "content": "Hello!"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.together.xyz/v1",
apiKey: process.env.TOGETHER_API_KEY,
});
const reply = await client.chat.completions.create({
model: "nim/nvidia/llama-3.1-nemotron-70b-instruct",
messages: [{ role: "user", content: "Hello!" }],
});
console.log(reply.choices[0].message.content);Ejemplo para Together AI. Funciona cualquier cliente compatible con OpenAI: Cursor, Cline, OpenCode, Open WebUI.
Benchmarks
Fuente: Artificial Analysis · Llama 3.1 Nemotron Instruct 70B
Modelos gratuitos similares
Preguntas frecuentes
¿Llama 3.1 Nemotron 70B es gratis?
Sí. A fecha de 26 de septiembre de 2026, Llama 3.1 Nemotron 70B es gratis en Together AI, NVIDIA Build. Cada proveedor tiene sus propios límites — consulta la tabla de arriba.
¿Cuál es la ventana de contexto de Llama 3.1 Nemotron 70B?
El mayor contexto entre las rutas gratuitas es de 16.384 tokens. Algunos proveedores lo limitan más.
¿Cómo llamo a Llama 3.1 Nemotron 70B vía API?
Usa cualquier cliente compatible con OpenAI con la base URL https://api.together.xyz/v1, el ID de modelo nim/nvidia/llama-3.1-nemotron-70b-instruct y una clave de Together AI.
¿Qué tan bueno es Llama 3.1 Nemotron 70B?
Artificial Analysis Intelligence Index: 6.9, GPQA Diamond: 47%. Como comparación, el modelo gratuito más potente del catálogo ahora mismo es GLM 5.3.
¿Llama 3.1 Nemotron 70B es de pesos abiertos?
Sí, los pesos están publicados — puedes descargarlo y ejecutarlo en local, por ejemplo con Ollama o LM Studio.