LLM Perks

DeepSeek V4.1 Flash

Aktuell kostenlos Sehr groß New
ReasoningCodingTool-NutzungOffene Gewichte

DeepSeek V4.1 Flash ist ein Sprachmodell von DeepSeek. Es ist derzeit bei 1 Anbieter kostenlos, mit bis zu — Token Kontext. Das Modell unterstützt schrittweises Reasoning, eignet sich für Coding, unterstützt Tool Calling. Die Gewichte sind offen, daher läuft es auch lokal.

Entwickler
DeepSeek
Typ
Text
Lizenz
Offene Gewichte
Kostenlos seit
21. September 2026

Wo Sie DeepSeek V4.1 Flash kostenlos nutzen können

Jede Zeile ist ein eigener kostenloser Endpunkt mit eigenen Limits.

AnbieterKontextLimitKarte
NVIDIA Build
deepseek-ai/deepseek-v4.1-flash
— Kostenlose serverlose Inferenz für die Entwicklung; Limits und Modellverfügbarkeit können sich ändern. Nein Öffnen

Schnellstart

curl https://integrate.api.nvidia.com/v1/chat/completions \
  -H "Authorization: Bearer $NVIDIA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-ai/deepseek-v4.1-flash",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Beispiel für NVIDIA Build. Jeder OpenAI-kompatible Client funktioniert: Cursor, Cline, OpenCode, Open WebUI.

Benchmarks

Intelligence Index
39.5
Humanity's Last Exam
39.2%
Langer Kontext (LCR)
84.0%

Quelle: Artificial Analysis · DeepSeek V4.1 Flash (Reasoning, Max Effort)

Ähnliche kostenlose Modelle

FAQ

Ist DeepSeek V4.1 Flash kostenlos?

Ja. Stand 26. September 2026 ist DeepSeek V4.1 Flash kostenlos bei NVIDIA Build. Jeder Anbieter hat eigene Limits — siehe Tabelle oben.

Wie rufe ich DeepSeek V4.1 Flash per API auf?

Nutzen Sie einen beliebigen OpenAI-kompatiblen Client mit base URL https://integrate.api.nvidia.com/v1, Modell-ID deepseek-ai/deepseek-v4.1-flash und einem NVIDIA Build-Schlüssel.

Wie gut ist DeepSeek V4.1 Flash?

Artificial Analysis Intelligence Index: 39.5. Zum Vergleich: Das derzeit stärkste kostenlose Modell im Katalog ist GLM 5.3.

Hat DeepSeek V4.1 Flash offene Gewichte?

Ja, die Gewichte sind veröffentlicht — Sie können es herunterladen und lokal ausführen, zum Beispiel mit Ollama oder LM Studio.