LLM Perks

Inkling Small

Thinking Machines Lab · Alle Inkling-Modelle
Aktuell kostenlos Klein
ReasoningLanger KontextOffene Gewichte

Inkling Small ist ein Sprachmodell von Thinking Machines Lab. Es ist derzeit bei 1 Anbieter kostenlos, mit bis zu 1M Token Kontext. Das Modell unterstützt schrittweises Reasoning. Die Gewichte sind offen, daher läuft es auch lokal.

Entwickler
Thinking Machines Lab
Kontext
1M Token
Typ
Text
Lizenz
Offene Gewichte

Wo Sie Inkling Small kostenlos nutzen können

Jede Zeile ist ein eigener kostenloser Endpunkt mit eigenen Limits.

AnbieterKontextLimitKarte
OpenRouter
thinkingmachines/inkling-small:free
1M Kostenloser Tarif Nein Öffnen

Schnellstart

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "thinkingmachines/inkling-small:free",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Beispiel für OpenRouter. Jeder OpenAI-kompatible Client funktioniert: Cursor, Cline, OpenCode, Open WebUI.

Benchmarks

Intelligence Index
27.8
GPQA Diamond
89.5%
Humanity's Last Exam
33.3%
Langer Kontext (LCR)
75.7%

Quelle: Artificial Analysis · Inkling Small

Ähnliche kostenlose Modelle

FAQ

Ist Inkling Small kostenlos?

Ja. Stand 26. September 2026 ist Inkling Small kostenlos bei OpenRouter. Jeder Anbieter hat eigene Limits — siehe Tabelle oben.

Wie groß ist das Kontextfenster von Inkling Small?

Der größte Kontext unter den kostenlosen Routen beträgt 1.048.576 Token. Manche Anbieter begrenzen ihn niedriger.

Wie rufe ich Inkling Small per API auf?

Nutzen Sie einen beliebigen OpenAI-kompatiblen Client mit base URL https://openrouter.ai/api/v1, Modell-ID thinkingmachines/inkling-small:free und einem OpenRouter-Schlüssel.

Wie gut ist Inkling Small?

Artificial Analysis Intelligence Index: 27.8, GPQA Diamond: 90%. Zum Vergleich: Das derzeit stärkste kostenlose Modell im Katalog ist GLM 5.3.

Hat Inkling Small offene Gewichte?

Ja, die Gewichte sind veröffentlicht — Sie können es herunterladen und lokal ausführen, zum Beispiel mit Ollama oder LM Studio.