Llama 3.1 Nemotron 70B
Llama 3.1 Nemotron 70B ist ein Sprachmodell mit 70B Parametern von NVIDIA. Es ist derzeit bei 2 Anbieter kostenlos, mit bis zu 16K Token Kontext. Die Gewichte sind offen, daher läuft es auch lokal.
- Entwickler
- NVIDIA
- Parameter
- 70B
- Kontext
- 16K Token
- Typ
- Text
- Lizenz
- Offene Gewichte
Wo Sie Llama 3.1 Nemotron 70B kostenlos nutzen können
Jede Zeile ist ein eigener kostenloser Endpunkt mit eigenen Limits.
| Anbieter | Kontext | Limit | Karte | |
|---|---|---|---|---|
Together AI nim/nvidia/llama-3.1-nemotron-70b-instruct |
16K | Fair use (depends on server load) | — | Öffnen |
NVIDIA Build nvidia/llama-3.1-nemotron-70b-instruct |
— | Kostenlose serverlose Inferenz für die Entwicklung; Limits und Modellverfügbarkeit können sich ändern. | Nein | Öffnen |
Schnellstart
curl https://api.together.xyz/v1/chat/completions \
-H "Authorization: Bearer $TOGETHER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "nim/nvidia/llama-3.1-nemotron-70b-instruct",
"messages": [{"role": "user", "content": "Hello!"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.together.xyz/v1",
api_key="YOUR_TOGETHER_API_KEY",
)
reply = client.chat.completions.create(
model="nim/nvidia/llama-3.1-nemotron-70b-instruct",
messages=[{"role": "user", "content": "Hello!"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.together.xyz/v1",
apiKey: process.env.TOGETHER_API_KEY,
});
const reply = await client.chat.completions.create({
model: "nim/nvidia/llama-3.1-nemotron-70b-instruct",
messages: [{ role: "user", content: "Hello!" }],
});
console.log(reply.choices[0].message.content);Beispiel für Together AI. Jeder OpenAI-kompatible Client funktioniert: Cursor, Cline, OpenCode, Open WebUI.
Benchmarks
Quelle: Artificial Analysis · Llama 3.1 Nemotron Instruct 70B
Ähnliche kostenlose Modelle
FAQ
Ist Llama 3.1 Nemotron 70B kostenlos?
Ja. Stand 26. September 2026 ist Llama 3.1 Nemotron 70B kostenlos bei Together AI, NVIDIA Build. Jeder Anbieter hat eigene Limits — siehe Tabelle oben.
Wie groß ist das Kontextfenster von Llama 3.1 Nemotron 70B?
Der größte Kontext unter den kostenlosen Routen beträgt 16.384 Token. Manche Anbieter begrenzen ihn niedriger.
Wie rufe ich Llama 3.1 Nemotron 70B per API auf?
Nutzen Sie einen beliebigen OpenAI-kompatiblen Client mit base URL https://api.together.xyz/v1, Modell-ID nim/nvidia/llama-3.1-nemotron-70b-instruct und einem Together AI-Schlüssel.
Wie gut ist Llama 3.1 Nemotron 70B?
Artificial Analysis Intelligence Index: 6.9, GPQA Diamond: 47%. Zum Vergleich: Das derzeit stärkste kostenlose Modell im Katalog ist GLM 5.3.
Hat Llama 3.1 Nemotron 70B offene Gewichte?
Ja, die Gewichte sind veröffentlicht — Sie können es herunterladen und lokal ausführen, zum Beispiel mit Ollama oder LM Studio.