GLM 5.3 Flash
GLM 5.3 Flash ist ein Sprachmodell von Z.ai (Zhipu AI). Es ist derzeit bei 3 Anbieter kostenlos, mit bis zu 1M Token Kontext. Das Modell unterstützt schrittweises Reasoning, eignet sich für Coding, unterstützt Tool Calling. Die Gewichte sind offen, daher läuft es auch lokal.
- Entwickler
- Z.ai (Zhipu AI)
- Kontext
- 1M Token
- Typ
- Text
- Lizenz
- Offene Gewichte
Wo Sie GLM 5.3 Flash kostenlos nutzen können
Jede Zeile ist ein eigener kostenloser Endpunkt mit eigenen Limits.
| Anbieter | Kontext | Limit | Karte | |
|---|---|---|---|---|
OrcaRouter z-ai/glm-5.3-flash-free |
— | Kostenloser Tarif | — | Öffnen |
NVIDIA Build z-ai/glm-5.3-flash |
— | Kostenlose serverlose Inferenz für die Entwicklung; Limits und Modellverfügbarkeit können sich ändern. | Nein | Öffnen |
UnoRouter glm-5.3-flash:free |
1M | Kostenlose Modelle ohne Karte nutzen geteilte Kapazität und Limits pro Modell; die Verfügbarkeit kann sich ändern. | Nein | Öffnen |
Schnellstart
curl https://api.orcarouter.ai/v1/chat/completions \
-H "Authorization: Bearer $ORCAROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "z-ai/glm-5.3-flash-free",
"messages": [{"role": "user", "content": "Hello!"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="YOUR_ORCAROUTER_API_KEY",
)
reply = client.chat.completions.create(
model="z-ai/glm-5.3-flash-free",
messages=[{"role": "user", "content": "Hello!"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.orcarouter.ai/v1",
apiKey: process.env.ORCAROUTER_API_KEY,
});
const reply = await client.chat.completions.create({
model: "z-ai/glm-5.3-flash-free",
messages: [{ role: "user", content: "Hello!" }],
});
console.log(reply.choices[0].message.content);Beispiel für OrcaRouter. Jeder OpenAI-kompatible Client funktioniert: Cursor, Cline, OpenCode, Open WebUI.
Benchmarks
Quelle: Artificial Analysis · GLM 5.3 Flash
Ähnliche kostenlose Modelle
FAQ
Ist GLM 5.3 Flash kostenlos?
Ja. Stand 26. September 2026 ist GLM 5.3 Flash kostenlos bei OrcaRouter, NVIDIA Build, UnoRouter. Jeder Anbieter hat eigene Limits — siehe Tabelle oben.
Wie groß ist das Kontextfenster von GLM 5.3 Flash?
Der größte Kontext unter den kostenlosen Routen beträgt 1.000.000 Token. Manche Anbieter begrenzen ihn niedriger.
Wie rufe ich GLM 5.3 Flash per API auf?
Nutzen Sie einen beliebigen OpenAI-kompatiblen Client mit base URL https://api.orcarouter.ai/v1, Modell-ID z-ai/glm-5.3-flash-free und einem OrcaRouter-Schlüssel.
Wie gut ist GLM 5.3 Flash?
Artificial Analysis Intelligence Index: 41.8, GPQA Diamond: 91%. Zum Vergleich: Das derzeit stärkste kostenlose Modell im Katalog ist GLM 5.3.
Hat GLM 5.3 Flash offene Gewichte?
Ja, die Gewichte sind veröffentlicht — Sie können es herunterladen und lokal ausführen, zum Beispiel mit Ollama oder LM Studio.