Gemma 2B
Gemma 2B est un modèle de langage avec 2B paramètres de Google DeepMind. Il est actuellement gratuit chez 2 fournisseurs avec jusqu'à 8K tokens de contexte. Ses poids sont ouverts : il peut donc aussi s'exécuter en local.
- Développeur
- Google DeepMind
- Paramètres
- 2B
- Contexte
- 8K tokens
- Type
- Texte
- Licence
- Poids ouverts
Où utiliser Gemma 2B gratuitement
Chaque ligne est un endpoint gratuit distinct avec ses propres limites.
| Fournisseur | Contexte | Limite | Carte | |
|---|---|---|---|---|
Together AI google/gemma-2b-it |
8K | Fair use (depends on server load) | — | Ouvrir |
NVIDIA Build google/gemma-2b |
— | Inférence serverless gratuite pour le développement ; les limites et la disponibilité des modèles peuvent changer. | Non | Ouvrir |
Démarrage rapide
curl https://api.together.xyz/v1/chat/completions \
-H "Authorization: Bearer $TOGETHER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "google/gemma-2b-it",
"messages": [{"role": "user", "content": "Hello!"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.together.xyz/v1",
api_key="YOUR_TOGETHER_API_KEY",
)
reply = client.chat.completions.create(
model="google/gemma-2b-it",
messages=[{"role": "user", "content": "Hello!"}],
)
print(reply.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.together.xyz/v1",
apiKey: process.env.TOGETHER_API_KEY,
});
const reply = await client.chat.completions.create({
model: "google/gemma-2b-it",
messages: [{ role: "user", content: "Hello!" }],
});
console.log(reply.choices[0].message.content);Exemple pour Together AI. Tout client compatible OpenAI fonctionne : Cursor, Cline, OpenCode, Open WebUI.
Benchmarks
Ce modèle ne figure pas encore dans le classement d'Artificial Analysis. Nous ne publions pas nos propres estimations.
Modèles gratuits similaires
FAQ
Gemma 2B est-il gratuit ?
Oui. Au 26 septembre 2026, Gemma 2B est gratuit chez Together AI, NVIDIA Build. Chaque fournisseur a ses propres limites — voir le tableau ci-dessus.
Quelle est la fenêtre de contexte de Gemma 2B ?
Le plus grand contexte parmi les routes gratuites est de 8 192 tokens. Certains fournisseurs le plafonnent plus bas.
Comment appeler Gemma 2B via API ?
Utilisez n'importe quel client compatible OpenAI avec la base URL https://api.together.xyz/v1, l'ID de modèle google/gemma-2b-it et une clé Together AI.
Gemma 2B est-il open-weight ?
Oui, les poids sont publiés — vous pouvez le télécharger et l'exécuter en local, par exemple avec Ollama ou LM Studio.