Llama 3.3 Nemotron Super 49B
Llama 3.3 Nemotron Super 49B es un modelo de lenguaje con 49B parámetros de NVIDIA. Actualmente es gratis en 1 proveedor con hasta 16K tokens de contexto. El modelo admite tool calling. Sus pesos son abiertos, así que también se puede ejecutar en local.
- Desarrollador
- NVIDIA
- Parámetros
- 49B
- Contexto
- 16K tokens
- Tipo
- Texto
- Licencia
- Pesos abiertos
Dónde usar Llama 3.3 Nemotron Super 49B gratis
Cada fila es un endpoint gratuito independiente con sus propios límites.
| Proveedor | Contexto | Límite | Tarjeta | |
|---|---|---|---|---|
Together AI nim/nvidia/llama-3.3-nemotron-super-49b-v1 |
16K | Fair use (depends on server load) | — | Abrir |
Inicio rápido
curl https://api.together.xyz/v1/chat/completions \
-H "Authorization: Bearer $TOGETHER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "nim/nvidia/llama-3.3-nemotron-super-49b-v1",
"messages": [{"role": "user", "content": "Hello!"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.together.xyz/v1",
api_key="YOUR_TOGETHER_API_KEY",
)
reply = client.chat.completions.create(
model="nim/nvidia/llama-3.3-nemotron-super-49b-v1",
messages=[{"role": "user", "content": "Hello!"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.together.xyz/v1",
apiKey: process.env.TOGETHER_API_KEY,
});
const reply = await client.chat.completions.create({
model: "nim/nvidia/llama-3.3-nemotron-super-49b-v1",
messages: [{ role: "user", content: "Hello!" }],
});
console.log(reply.choices[0].message.content);Ejemplo para Together AI. Funciona cualquier cliente compatible con OpenAI: Cursor, Cline, OpenCode, Open WebUI.
Benchmarks
Fuente: Artificial Analysis · Llama 3.3 Nemotron Super 49B v1 (Reasoning)
Modelos gratuitos similares
Preguntas frecuentes
¿Llama 3.3 Nemotron Super 49B es gratis?
Sí. A fecha de 26 de septiembre de 2026, Llama 3.3 Nemotron Super 49B es gratis en Together AI. Cada proveedor tiene sus propios límites — consulta la tabla de arriba.
¿Cuál es la ventana de contexto de Llama 3.3 Nemotron Super 49B?
El mayor contexto entre las rutas gratuitas es de 16.384 tokens. Algunos proveedores lo limitan más.
¿Cómo llamo a Llama 3.3 Nemotron Super 49B vía API?
Usa cualquier cliente compatible con OpenAI con la base URL https://api.together.xyz/v1, el ID de modelo nim/nvidia/llama-3.3-nemotron-super-49b-v1 y una clave de Together AI.
¿Qué tan bueno es Llama 3.3 Nemotron Super 49B?
Artificial Analysis Intelligence Index: 8.9, GPQA Diamond: 64%. Como comparación, el modelo gratuito más potente del catálogo ahora mismo es GLM 5.3.
¿Llama 3.3 Nemotron Super 49B es de pesos abiertos?
Sí, los pesos están publicados — puedes descargarlo y ejecutarlo en local, por ejemplo con Ollama o LM Studio.