LLM Perks

Llama 3.1 405B

Aktuell kostenlos Sehr groß
Tool-NutzungOffene Gewichte

Llama 3.1 405B ist ein Sprachmodell mit 405B Parametern von Meta. Es ist derzeit bei 1 Anbieter kostenlos, mit bis zu 131K Token Kontext. Das Modell unterstützt Tool Calling. Die Gewichte sind offen, daher läuft es auch lokal.

Entwickler
Meta
Parameter
405B
Kontext
131K Token
Typ
Text
Lizenz
Offene Gewichte

Wo Sie Llama 3.1 405B kostenlos nutzen können

Jede Zeile ist ein eigener kostenloser Endpunkt mit eigenen Limits.

AnbieterKontextLimitKarte
Together AI
meta-llama/Llama-3.1-405B
131K Fair use (depends on server load) — Öffnen

Schnellstart

curl https://api.together.xyz/v1/chat/completions \
  -H "Authorization: Bearer $TOGETHER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/Llama-3.1-405B",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Beispiel für Together AI. Jeder OpenAI-kompatible Client funktioniert: Cursor, Cline, OpenCode, Open WebUI.

Benchmarks

Intelligence Index
7.3
GPQA Diamond
51.5%
Humanity's Last Exam
4.0%
Terminal-Bench Hard
6.8%
τ²-Bench
19.0%
Langer Kontext (LCR)
25.3%

Quelle: Artificial Analysis · Llama 3.1 Instruct 405B

Ähnliche kostenlose Modelle

FAQ

Ist Llama 3.1 405B kostenlos?

Ja. Stand 26. September 2026 ist Llama 3.1 405B kostenlos bei Together AI. Jeder Anbieter hat eigene Limits — siehe Tabelle oben.

Wie groß ist das Kontextfenster von Llama 3.1 405B?

Der größte Kontext unter den kostenlosen Routen beträgt 131.072 Token. Manche Anbieter begrenzen ihn niedriger.

Wie rufe ich Llama 3.1 405B per API auf?

Nutzen Sie einen beliebigen OpenAI-kompatiblen Client mit base URL https://api.together.xyz/v1, Modell-ID meta-llama/Llama-3.1-405B und einem Together AI-Schlüssel.

Wie gut ist Llama 3.1 405B?

Artificial Analysis Intelligence Index: 7.3, GPQA Diamond: 52%. Zum Vergleich: Das derzeit stärkste kostenlose Modell im Katalog ist GLM 5.3.

Hat Llama 3.1 405B offene Gewichte?

Ja, die Gewichte sind veröffentlicht — Sie können es herunterladen und lokal ausführen, zum Beispiel mit Ollama oder LM Studio.