LLM Perks

GLM 4 5v

Z.ai (Zhipu AI) · Alle GLM-Modelle
Aktuell kostenlos Sehr groß
ReasoningCodingTool-NutzungOffene Gewichte

GLM 4 5v ist ein Sprachmodell von Z.ai (Zhipu AI). Es ist derzeit bei 1 Anbieter kostenlos, mit bis zu 66K Token Kontext. Das Modell unterstützt schrittweises Reasoning, eignet sich für Coding, unterstützt Tool Calling. Die Gewichte sind offen, daher läuft es auch lokal.

Entwickler
Z.ai (Zhipu AI)
Kontext
66K Token
Typ
Text
Lizenz
Offene Gewichte

Wo Sie GLM 4 5v kostenlos nutzen können

Jede Zeile ist ein eigener kostenloser Endpunkt mit eigenen Limits.

AnbieterKontextLimitKarte
Together AI
zai-org/GLM-4.5V
66K Fair use (depends on server load) — Öffnen

Schnellstart

curl https://api.together.xyz/v1/chat/completions \
  -H "Authorization: Bearer $TOGETHER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "zai-org/GLM-4.5V",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Beispiel für Together AI. Jeder OpenAI-kompatible Client funktioniert: Cursor, Cline, OpenCode, Open WebUI.

Benchmarks

Intelligence Index
7.6
GPQA Diamond
68.4%
Humanity's Last Exam
6.3%
Terminal-Bench Hard
5.3%
τ²-Bench
22.5%
Langer Kontext (LCR)
0.0%

Quelle: Artificial Analysis · GLM-4.5V (Reasoning)

Ähnliche kostenlose Modelle

FAQ

Ist GLM 4 5v kostenlos?

Ja. Stand 26. September 2026 ist GLM 4 5v kostenlos bei Together AI. Jeder Anbieter hat eigene Limits — siehe Tabelle oben.

Wie groß ist das Kontextfenster von GLM 4 5v?

Der größte Kontext unter den kostenlosen Routen beträgt 65.536 Token. Manche Anbieter begrenzen ihn niedriger.

Wie rufe ich GLM 4 5v per API auf?

Nutzen Sie einen beliebigen OpenAI-kompatiblen Client mit base URL https://api.together.xyz/v1, Modell-ID zai-org/GLM-4.5V und einem Together AI-Schlüssel.

Wie gut ist GLM 4 5v?

Artificial Analysis Intelligence Index: 7.6, GPQA Diamond: 68%. Zum Vergleich: Das derzeit stärkste kostenlose Modell im Katalog ist GLM 5.3.

Hat GLM 4 5v offene Gewichte?

Ja, die Gewichte sind veröffentlicht — Sie können es herunterladen und lokal ausführen, zum Beispiel mit Ollama oder LM Studio.