LLM Perks

Gemma 2B

Google DeepMind · Alle Gemma-Modelle
Aktuell kostenlos Klein
Offene Gewichte

Gemma 2B ist ein Sprachmodell mit 2B Parametern von Google DeepMind. Es ist derzeit bei 2 Anbieter kostenlos, mit bis zu 8K Token Kontext. Die Gewichte sind offen, daher läuft es auch lokal.

Entwickler
Google DeepMind
Parameter
2B
Kontext
8K Token
Typ
Text
Lizenz
Offene Gewichte

Wo Sie Gemma 2B kostenlos nutzen können

Jede Zeile ist ein eigener kostenloser Endpunkt mit eigenen Limits.

AnbieterKontextLimitKarte
Together AI
google/gemma-2b-it
8K Fair use (depends on server load) — Öffnen
NVIDIA Build
google/gemma-2b
— Kostenlose serverlose Inferenz für die Entwicklung; Limits und Modellverfügbarkeit können sich ändern. Nein Öffnen

Schnellstart

curl https://api.together.xyz/v1/chat/completions \
  -H "Authorization: Bearer $TOGETHER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/gemma-2b-it",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Beispiel für Together AI. Jeder OpenAI-kompatible Client funktioniert: Cursor, Cline, OpenCode, Open WebUI.

Benchmarks

Dieses Modell steht noch nicht in der Rangliste von Artificial Analysis. Wir veröffentlichen keine eigenen Schätzungen.

Ähnliche kostenlose Modelle

FAQ

Ist Gemma 2B kostenlos?

Ja. Stand 26. September 2026 ist Gemma 2B kostenlos bei Together AI, NVIDIA Build. Jeder Anbieter hat eigene Limits — siehe Tabelle oben.

Wie groß ist das Kontextfenster von Gemma 2B?

Der größte Kontext unter den kostenlosen Routen beträgt 8.192 Token. Manche Anbieter begrenzen ihn niedriger.

Wie rufe ich Gemma 2B per API auf?

Nutzen Sie einen beliebigen OpenAI-kompatiblen Client mit base URL https://api.together.xyz/v1, Modell-ID google/gemma-2b-it und einem Together AI-Schlüssel.

Hat Gemma 2B offene Gewichte?

Ja, die Gewichte sind veröffentlicht — Sie können es herunterladen und lokal ausführen, zum Beispiel mit Ollama oder LM Studio.