LLM Perks

Gemma 2B

Google DeepMind · Tous les modèles Gemma
Gratuit actuellement Petit
Poids ouverts

Gemma 2B est un modèle de langage avec 2B paramètres de Google DeepMind. Il est actuellement gratuit chez 2 fournisseurs avec jusqu'à 8K tokens de contexte. Ses poids sont ouverts : il peut donc aussi s'exécuter en local.

Développeur
Google DeepMind
Paramètres
2B
Contexte
8K tokens
Type
Texte
Licence
Poids ouverts

Où utiliser Gemma 2B gratuitement

Chaque ligne est un endpoint gratuit distinct avec ses propres limites.

FournisseurContexteLimiteCarte
Together AI
google/gemma-2b-it
8K Fair use (depends on server load) — Ouvrir
NVIDIA Build
google/gemma-2b
— Inférence serverless gratuite pour le développement ; les limites et la disponibilité des modèles peuvent changer. Non Ouvrir

Démarrage rapide

curl https://api.together.xyz/v1/chat/completions \
  -H "Authorization: Bearer $TOGETHER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/gemma-2b-it",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Exemple pour Together AI. Tout client compatible OpenAI fonctionne : Cursor, Cline, OpenCode, Open WebUI.

Benchmarks

Ce modèle ne figure pas encore dans le classement d'Artificial Analysis. Nous ne publions pas nos propres estimations.

Modèles gratuits similaires

FAQ

Gemma 2B est-il gratuit ?

Oui. Au 26 septembre 2026, Gemma 2B est gratuit chez Together AI, NVIDIA Build. Chaque fournisseur a ses propres limites — voir le tableau ci-dessus.

Quelle est la fenêtre de contexte de Gemma 2B ?

Le plus grand contexte parmi les routes gratuites est de 8 192 tokens. Certains fournisseurs le plafonnent plus bas.

Comment appeler Gemma 2B via API ?

Utilisez n'importe quel client compatible OpenAI avec la base URL https://api.together.xyz/v1, l'ID de modèle google/gemma-2b-it et une clé Together AI.

Gemma 2B est-il open-weight ?

Oui, les poids sont publiés — vous pouvez le télécharger et l'exécuter en local, par exemple avec Ollama ou LM Studio.