Fournisseurs d'API LLM gratuites
Toutes les plateformes suivies sur une seule page : qui propose le plus de modèles gratuits, qui n'exige pas de carte et quelle base URL configurer dans votre client.
Mis à jour:
| Fournisseur ↕ | Modèles ↕ | Meilleur modèle gratuit | Carte | Base URL | |
|---|---|---|---|---|---|
OpenRouter Les modèles avec le suffixe :free autorisent 50 requêtes par jour, ou 1 000 par jour après une recharge unique de 10 $ (20 requêtes par minute). |
21 | Qwen3.8 27B | Non | https://openrouter.ai/api/v1 |
Clé |
Groq Offre gratuite avec des limites par modèle sur les requêtes et les tokens par minute et par jour ; vitesse de génération très élevée sur matériel LPU. |
4 | Qwen3.8 27B | Non | https://api.groq.com/openai/v1 |
Clé |
Google AI Studio L'offre gratuite de l'API Gemini couvre les modèles Flash et Flash-Lite avec des limites de débit ; les contenus de l'offre gratuite peuvent être utilisés pour améliorer les produits Google. |
4 | Gemini 2.0 Flash | Non | https://generativelanguage.googleapis.com/v1beta/openai/ |
Clé |
Mistral AI L'offre Free inclut des crédits API mensuels pour les modèles Mistral, avec des limites de débit par défaut basses. |
4 | Mistral Nemo | — | https://api.mistral.ai/v1 |
Clé |
Together AI Seuls certains modèles sont à prix nul ; il n'y a pas d'essai gratuit général. |
98 | GLM 5.3 | — | https://api.together.xyz/v1 |
Clé |
Cohere Les clés d'essai permettent 1 000 appels API par mois pour l'évaluation, pas pour la production. |
4 | Command R Plus | Non | https://api.cohere.ai/compatibility/v1 |
Clé |
Cerebras Essai gratuit avec limites quotidiennes de tokens ; un moyen de paiement vérifié est requis pour activer l'API. |
2 | Qwen 3.8 27B | Oui | https://api.cerebras.ai/v1 |
Clé |
Cloudflare Workers AI 10 000 Neurons par jour sont gratuits sur les offres Workers Free et Paid. |
3 | Llama 3.1 8B | — | https://api.cloudflare.com/client/v4/accounts/ACCOUNT_ID/ai/v1 |
Clé |
Hugging Face Les comptes gratuits reçoivent un petit crédit mensuel pour les Inference Providers ; les comptes PRO en reçoivent davantage. |
3 | Llama 3.1 8B | Non | https://router.huggingface.co/v1 |
Clé |
OrcaRouter Routeur BYOK sans marge sur les tokens ; ses propres modèles Fusion et certaines routes gratuites ne coûtent rien. |
13 | GLM 5.3 Flash | — | https://api.orcarouter.ai/v1 |
Clé |
NVIDIA Build Inférence serverless gratuite pour le développement et le prototypage avec un compte développeur ; non destinée au trafic de production. |
62 | GLM 5.3 | Non | https://integrate.api.nvidia.com/v1 |
Clé |
TokenRouter Les modèles gratuits et les accès promotionnels peuvent être limités dans le temps. |
1 | Nemotron 3 Nano Omni | — | https://api.tokenrouter.com/v1 |
Clé |
Vercel AI Gateway Une carte de paiement doit être enregistrée, même pour les modèles à prix nul. |
3 | Laguna S 2.1 | Oui | https://ai-gateway.vercel.sh/v1 |
Clé |
Nous Portal L'offre Portal à 0 $ inclut les modèles :free avec des limites de débit standard. |
7 | Solar Pro 4 | Non | https://inference-api.nousresearch.com/v1 |
Clé |
UnoRouter Large catalogue de routes :free sans carte ; capacité partagée et limites par modèle. |
62 | Mimo V2.6 Pro | Non | https://api.unorouter.com/v1 |
Clé |
FAQ
Quel fournisseur d'API LLM gratuite est le meilleur ?
Cela dépend de l'usage. OpenRouter et UnoRouter offrent le plus de modèles avec une seule clé, Groq et Cerebras sont les plus rapides, Google AI Studio propose des limites généreuses pour Gemini Flash, et NVIDIA Build héberge des modèles ouverts récents pour le développement.
Puis-je combiner plusieurs fournisseurs gratuits ?
Oui. Ils sont tous compatibles OpenAI : des clients comme LiteLLM, OpenCode ou Open WebUI vous permettent de changer de clé et de cumuler les quotas gratuits.