LLM Perks

Qwen3 32B

Alibaba Cloud · Alle Qwen-Modelle
Aktuell kostenlos Mittelgroß
ReasoningTool-NutzungOffene Gewichte

Qwen3 32B ist ein Sprachmodell mit 32B Parametern von Alibaba Cloud. Es ist derzeit bei 1 Anbieter kostenlos, mit bis zu 41K Token Kontext. Das Modell unterstützt schrittweises Reasoning, unterstützt Tool Calling. Die Gewichte sind offen, daher läuft es auch lokal.

Entwickler
Alibaba Cloud
Parameter
32B
Kontext
41K Token
Typ
Text
Lizenz
Offene Gewichte

Wo Sie Qwen3 32B kostenlos nutzen können

Jede Zeile ist ein eigener kostenloser Endpunkt mit eigenen Limits.

AnbieterKontextLimitKarte
Together AI
Qwen/Qwen3-32B
41K Fair use (depends on server load) — Öffnen

Schnellstart

curl https://api.together.xyz/v1/chat/completions \
  -H "Authorization: Bearer $TOGETHER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "Qwen/Qwen3-32B",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Beispiel für Together AI. Jeder OpenAI-kompatible Client funktioniert: Cursor, Cline, OpenCode, Open WebUI.

Benchmarks

Intelligence Index
8.6
GPQA Diamond
66.8%
Humanity's Last Exam
7.4%
Terminal-Bench Hard
3.0%
τ²-Bench
29.8%
Langer Kontext (LCR)
0.0%

Quelle: Artificial Analysis · Qwen3 32B (Reasoning)

Ähnliche kostenlose Modelle

FAQ

Ist Qwen3 32B kostenlos?

Ja. Stand 26. September 2026 ist Qwen3 32B kostenlos bei Together AI. Jeder Anbieter hat eigene Limits — siehe Tabelle oben.

Wie groß ist das Kontextfenster von Qwen3 32B?

Der größte Kontext unter den kostenlosen Routen beträgt 40.960 Token. Manche Anbieter begrenzen ihn niedriger.

Wie rufe ich Qwen3 32B per API auf?

Nutzen Sie einen beliebigen OpenAI-kompatiblen Client mit base URL https://api.together.xyz/v1, Modell-ID Qwen/Qwen3-32B und einem Together AI-Schlüssel.

Wie gut ist Qwen3 32B?

Artificial Analysis Intelligence Index: 8.6, GPQA Diamond: 67%. Zum Vergleich: Das derzeit stärkste kostenlose Modell im Katalog ist GLM 5.3.

Hat Qwen3 32B offene Gewichte?

Ja, die Gewichte sind veröffentlicht — Sie können es herunterladen und lokal ausführen, zum Beispiel mit Ollama oder LM Studio.