LLM Perks
Index en direct · mis à jour il y a 34 min

API LLM gratuites

Un catalogue en temps réel d'API d'IA gratuites pour les modèles actuels DeepSeek, Qwen, Nemotron, Mistral, Llama, Gemini et autres. Comparez les fournisseurs, les fenêtres de contexte et les limites avant de connecter Cursor, VS Code, Cline, Open WebUI ou votre propre application.

212
modèles gratuits
291
endpoints gratuits
15/15
fournisseurs en ligne
66
nouveaux en 7 jours

Meilleurs modèles gratuits du moment

Sélection automatique selon les benchmarks, la taille et le nombre de fournisseurs gratuits.

New free models this week

All new →

Tous les modèles gratuits

Une ligne par modèle ; la fiche du modèle liste tous les fournisseurs gratuits, les limites et des exemples de code.

Taille
212 trouvé(s)
# Modèle ↕ Indice AA ↕ GPQA ↕ Contexte ↕ Taille ↕ Gratuit chez ↕
📌
OpenCode GO
$60 in monthly API credits for $10, covering DeepSeek, Qwen, GLM, and other models. Introductory first-month offer available.
Ouvrir
1
GLM 5.3
Z.ai (Zhipu AI)
RaisonnementCodeAppel d'outilsPoids ouverts
44.8 92% 1M Très grand Together AI, NVIDIA Build
2
Mimo V2.6 Pro
New
Poids ouverts
46.3 — 1M Très grand UnoRouter
3
Kimi K3
Moonshot AI
VisionRaisonnementCodeAppel d'outilsPoids ouverts
43.6 94% 1M Très grand NVIDIA Build, UnoRouter
4
GLM 5.3 Flash
Z.ai (Zhipu AI)
RaisonnementCodeAppel d'outilsPoids ouverts
41.8 91% 1M Taille moyenne OrcaRouter, NVIDIA Build, UnoRouter
5
Qwen 3.8 Flash Next
Alibaba Cloud · New
RaisonnementCodeAppel d'outilsPoids ouverts
39.8 92% 1M Taille moyenne UnoRouter
6
DeepSeek V4.1 Flash
DeepSeek · New
RaisonnementCodeAppel d'outilsPoids ouverts
39.5 — — Très grand NVIDIA Build
7
DeepSeek V4 Flash
DeepSeek
RaisonnementCodeAppel d'outilsPoids ouverts
34.3 91% 1M Très grand OrcaRouter, UnoRouter
8
Qwen3.8 27B
Alibaba Cloud · 27B
RaisonnementCodeAppel d'outilsPoids ouverts
33.7 91% 262K Taille moyenne OpenRouter, Groq, UnoRouter
9
Gemini 3.6 Flash
Google
VisionRaisonnementCodeAppel d'outils
34.0 93% 1M Taille moyenne UnoRouter
10
GLM 5.2
Z.ai (Zhipu AI)
RaisonnementCodeAppel d'outilsPoids ouverts
33.7 90% 1M Très grand Together AI
11
Qwen 3.8 27B
Alibaba Cloud · 27B
Appel d'outilsPoids ouverts
33.7 91% — Taille moyenne Cerebras
12
Inkling Small
Thinking Machines Lab
RaisonnementPoids ouverts
27.8 90% 1M Petit OpenRouter
13
Solar Pro 4
Upstage
RaisonnementAppel d'outils
28.2 89% 524K Très grand Nous Portal
14
Nemotron 3 Ultra
NVIDIA · 550B · 55B
RaisonnementCodeAppel d'outilsPoids ouverts
22.9 87% 1M Très grand OpenRouter, NVIDIA Build, UnoRouter
15
Inkling
Thinking Machines Lab
RaisonnementPoids ouverts
25.0 87% 1M Petit OpenRouter
16
Kimi K2.6
Moonshot AI
RaisonnementCodeAppel d'outilsPoids ouverts
27.0 91% — Très grand NVIDIA Build
17
Ling 3.0 Flash Fin
inclusionAI (Ant Group)
Poids ouverts
22.6 — 262K Petit OpenRouter, Nous Portal, UnoRouter
18
Hy3
Tencent
Poids ouverts
25.3 90% — Petit OrcaRouter
19
Gemma 4 31B
Google DeepMind · 31B
VisionAppel d'outilsPoids ouverts
19.0 86% 262K Taille moyenne OpenRouter, Together AI, NVIDIA Build, UnoRouter
20
Gemini 3.5 Flash Lite
Google
VisionRaisonnementCode
22.2 84% 1M Petit UnoRouter
21
GLM 4.7
Z.ai (Zhipu AI)
RaisonnementCodeAppel d'outilsPoids ouverts
22.2 86% 203K Très grand Together AI
22
LongCat 2.0
Meituan
RaisonnementAppel d'outilsPoids ouverts
19.1 78% 1M Très grand Nous Portal
23
Gemma 4 26B A4B
Google DeepMind · 26B · 4B
VisionAppel d'outilsPoids ouverts
16.7 79% 262K Taille moyenne OpenRouter, Together AI, UnoRouter
24
Step 3.7 Flash
StepFun
RaisonnementPoids ouverts
19.5 81% 262K Petit Nous Portal
25
Qwen 3.5 35B
Alibaba Cloud · 35B · 3B
RaisonnementCodeAppel d'outilsPoids ouverts
19.3 85% 262K Taille moyenne Together AI
26
Qwen 3.6 35B
Alibaba Cloud · 35B · 3B
RaisonnementCodeAppel d'outilsPoids ouverts
18.2 84% 262K Taille moyenne Together AI
27
Qwen 3.5 122B
Alibaba Cloud · 122B · 10B
RaisonnementCodeAppel d'outilsPoids ouverts
17.7 83% 262K Très grand Together AI
28
MiniMax M2
MiniMax · 230B · 10B
RaisonnementCodeAppel d'outilsPoids ouverts
18.6 78% 197K Très grand Together AI
29
Nemotron 3.5 Lightning
NVIDIA · 30B · 3B
RaisonnementAppel d'outilsPoids ouverts
12.9 74% 1M Taille moyenne OpenRouter, NVIDIA Build, UnoRouter
30
Nemotron 3 Super
NVIDIA · 120B · 12B
RaisonnementCodeAppel d'outilsPoids ouverts
12.8 80% 262K Très grand OpenRouter, NVIDIA Build, UnoRouter
31
Llama 4 Maverick Instruct Fp4
Meta · 400B · 17B
VisionAppel d'outilsPoids ouverts
— — 1M Très grand Together AI
32
Nemotron 3 Nano Omni
NVIDIA · 30B · 3B
VisionRaisonnementAppel d'outilsPoids ouverts
10.3 47% 262K Taille moyenne +1OpenRouter, Together AI, NVIDIA Build, TokenRouter, UnoRouter
33
Gemma 4 12B
Google DeepMind · 12B
VisionAppel d'outilsPoids ouverts
14.2 75% 262K Taille moyenne Together AI
34 — — 512K Très grand UnoRouter
35
Mistral Large 3 675B
Mistral AI · 675B
CodeAppel d'outilsPoids ouverts
— — 256K Très grand UnoRouter
36
GLM 4.7 Flash
Z.ai (Zhipu AI) · New
RaisonnementCodeAppel d'outilsPoids ouverts
14.9 58% 128K Taille moyenne UnoRouter
37
Qwen 3.5 9B
Alibaba Cloud · 9B
RaisonnementCodePoids ouverts
13.7 81% 262K Petit Together AI
38
Qwen3 VL 235B
Alibaba Cloud · 235B · 22B
VisionRaisonnementAppel d'outilsPoids ouverts
13.4 77% 262K Très grand Together AI
39
Cogito V1 Preview Llama 70B
Meta · 70B
Appel d'outilsPoids ouverts
— — 131K Très grand Together AI
40
Meta Llama 3.1 70B
Meta · 70B
Appel d'outilsPoids ouverts
— — 131K Très grand Together AI
41
GLM 4.7 Fp4
Z.ai (Zhipu AI)
RaisonnementCodeAppel d'outilsPoids ouverts
— — 203K Très grand Together AI
42
GLM 5 Fp4
Z.ai (Zhipu AI)
RaisonnementCodeAppel d'outilsPoids ouverts
— — 203K Très grand Together AI
43
MiniMax M2.5 Fp4
MiniMax
RaisonnementCodeAppel d'outilsPoids ouverts
— — 8K Très grand Together AI
44
GLM Ocr
Z.ai (Zhipu AI)
Appel d'outilsPoids ouverts
— — 131K Très grand Together AI
45
Palmyra Creative 122B
Writer · 122B
— — — Très grand NVIDIA Build
46
Nvidia Nemotron 3 Super
NVIDIA · 120B · 12B
RaisonnementCodeAppel d'outilsPoids ouverts
12.8 80% 262K Très grand Together AI
47
MiniMax M1 80K
MiniMax
RaisonnementAppel d'outilsPoids ouverts
11.7 70% 1M Très grand Together AI
48
Qwen3 235B
Alibaba Cloud · 235B · 22B
RaisonnementCodeAppel d'outilsPoids ouverts
12.7 79% 262K Très grand Together AI
49
gpt-oss-120b
OpenAI · 117B · 5.1B
RaisonnementCodeAppel d'outilsPoids ouverts
11.6 78% 131K Très grand Groq, Cerebras
50
gpt-oss-20b
OpenAI · 21B · 3.6B
RaisonnementAppel d'outilsPoids ouverts
10.0 61% 131K Taille moyenne Groq, NVIDIA Build, UnoRouter
51
North Mini Code
Cohere
CodePoids ouverts
9.9 76% 262K Petit OpenRouter, UnoRouter
52
Mistral Nemo
Mistral AI · 12B
Appel d'outilsPoids ouverts
— — 131K Taille moyenne Mistral AI, Together AI, NVIDIA Build
53
MiniMax M1 40K
MiniMax
RaisonnementAppel d'outilsPoids ouverts
10.0 68% 1M Très grand Together AI
54
Laguna S 2.1
Poolside
RaisonnementCode
— — 1M Petit OpenRouter, Vercel AI Gateway, Nous Portal, UnoRouter
55
Qwen3 Next 80B
Alibaba Cloud · 80B · 3B
RaisonnementCodeAppel d'outilsPoids ouverts
11.2 76% — Très grand Together AI
56
GLM 5.3 Flash Search
Z.ai (Zhipu AI)
RaisonnementCodeAppel d'outilsPoids ouverts
— — 1M Taille moyenne UnoRouter
57
Gemini 2.0 Flash
Google
VisionAppel d'outils
8.9 62% 1M Taille moyenne Google AI Studio
58
Qwen3 30B
Alibaba Cloud · 30B · 3B
RaisonnementAppel d'outilsPoids ouverts
9.8 71% 262K Taille moyenne Together AI
59
Qwen3 Coder 30B
Alibaba Cloud · 30B · 3B
RaisonnementCodeAppel d'outilsPoids ouverts
9.6 52% 262K Très grand Together AI
60
Ling 3.0 Flash Sante
inclusionAI (Ant Group)
Poids ouverts
— — 262K Petit OpenRouter, Vercel AI Gateway, Nous Portal, UnoRouter
61
Laguna XS 2.1
Poolside
RaisonnementCode
— — 262K Petit OpenRouter, NVIDIA Build, Nous Portal, UnoRouter
62
Mistral Nemotron
Mistral AI · 12B
Appel d'outilsPoids ouverts
— — 128K Taille moyenne NVIDIA Build, UnoRouter
63
Muse Glimmer 30B
Meta · 30B
— — 131K Taille moyenne NVIDIA Build, UnoRouter
64
DiffusionGemma 26B
Google DeepMind · 26B · 4B
Appel d'outilsPoids ouverts
9.5 67% 262K Taille moyenne UnoRouter
65
Llama 4 Scout
Meta · 109B · 17B
VisionAppel d'outilsPoids ouverts
8.1 59% 10.5M Très grand Together AI
66 — — 262K Taille moyenne Together AI
67
Holo3 35B A3B
35B · 3B
— — 262K Taille moyenne Together AI
68 — — 262K Taille moyenne UnoRouter
69
Llama 4 Maverick
Meta · 400B · 17B
VisionAppel d'outilsPoids ouverts
10.0 67% 131K Très grand UnoRouter
70
Qwen SEA-LION V4.5 27B
Alibaba Cloud · 27B
Appel d'outilsPoids ouverts
— — 262K Taille moyenne UnoRouter
71
LFM2.5-2.6B
Liquid AI · 2.6B
Poids ouverts
8.4 56% 128K Petit OpenRouter, UnoRouter
72
Llama 3.1 8B
Meta · 8B
Poids ouverts
6.9 26% 131K Petit Together AI, Cloudflare Workers AI, Hugging Face
73
Nvidia Nemotron 3 Nano
NVIDIA · 30B · 3B
RaisonnementAppel d'outilsPoids ouverts
8.9 76% 262K Taille moyenne Together AI
74
Qwen3 4B
Alibaba Cloud · 4B
RaisonnementPoids ouverts
8.8 67% 262K Petit Together AI
75
QwQ 32B
Alibaba Cloud · 32B · New
RaisonnementAppel d'outilsPoids ouverts
9.5 59% 131K Taille moyenne UnoRouter
76
Gemini 2.0 Flash Lite
Google
Vision
7.3 54% 1M Petit Google AI Studio
77
Mixtral 8x7b Instruct V01
Mistral AI · 46.7B · 12.9B
Appel d'outilsPoids ouverts
— — 16K Taille moyenne Together AI
78
Cogito V1 Preview Qwen 32B
Alibaba Cloud · 32B
Appel d'outilsPoids ouverts
— — 131K Taille moyenne Together AI
79
Cogito V1 Preview Qwen 14B
Alibaba Cloud · 14B
Appel d'outilsPoids ouverts
— — 131K Taille moyenne Together AI
80
Qwen2.5 14B
Alibaba Cloud · 14B
Appel d'outilsPoids ouverts
— — 131K Taille moyenne Together AI
81 — — 131K Taille moyenne Together AI
82
Medgemma 27B Text
Google DeepMind · 27B
Appel d'outilsPoids ouverts
— — 131K Taille moyenne Together AI
83
DeepSeek Ocr 2
DeepSeek
Appel d'outilsPoids ouverts
— — 8K Taille moyenne Together AI
84
Gemini Robotics ER 2 Preview
Google
Appel d'outils
— — 131K Taille moyenne UnoRouter
85
GLM 4.5 Flash
Z.ai (Zhipu AI)
RaisonnementCodeAppel d'outilsPoids ouverts
— — 131K Taille moyenne UnoRouter
86
Qwen SEA-LION V4 32B
Alibaba Cloud · 32B
Appel d'outilsPoids ouverts
— — 33K Taille moyenne UnoRouter
87
Qwen3
Alibaba Cloud · New
RaisonnementAppel d'outilsPoids ouverts
— — 25K Taille moyenne UnoRouter
88 — — 131K Taille moyenne UnoRouter
89
Llama 3.3 Nemotron Super 49B
NVIDIA · 49B
Appel d'outilsPoids ouverts
8.9 64% 16K Taille moyenne Together AI
90
Gemma 4 E4b
Google DeepMind
VisionPoids ouverts
8.9 58% 131K Petit Together AI
91
Nemotron 3 Nano
NVIDIA · 30B · 3B
Appel d'outilsPoids ouverts
8.9 76% — Taille moyenne NVIDIA Build
92
Devstral Small
Mistral AI
CodeAppel d'outilsPoids ouverts
8.7 43% 131K Taille moyenne Together AI
93
Magistral Small
Mistral AI
RaisonnementAppel d'outilsPoids ouverts
8.6 66% 41K Taille moyenne Together AI
94
Qwen3 32B
Alibaba Cloud · 32B
RaisonnementAppel d'outilsPoids ouverts
8.6 67% 41K Taille moyenne Together AI
95
Space Bunny Alpha
Stealth model · New
— — 1M Petit OpenRouter, UnoRouter
96
Llama 3.2 11B Vision
Meta · 11B
VisionAppel d'outilsPoids ouverts
5.4 22% 131K Taille moyenne Together AI, NVIDIA Build, UnoRouter
97
DeepSeek R1 Distill Qwen 32B
DeepSeek · 32B · New
RaisonnementAppel d'outilsPoids ouverts
8.4 62% 80K Taille moyenne UnoRouter
98
GPT-4o
OpenAI · New
VisionAppel d'outils
8.4 54% 128K Très grand UnoRouter
99
Mistral Small
Mistral AI · 24B
Appel d'outilsPoids ouverts
5.8 38% 256K Taille moyenne Mistral AI, UnoRouter
100
Qwen3 14B
Alibaba Cloud · 14B
RaisonnementAppel d'outilsPoids ouverts
8.2 60% 2K Taille moyenne Together AI
101
Llama 3.2 90B Vision
Meta · 90B
VisionAppel d'outilsPoids ouverts
6.4 43% 16K Très grand Together AI, NVIDIA Build
102
Qwen 3.5 2B
Alibaba Cloud · 2B
RaisonnementCodePoids ouverts
6.9 46% 262K Petit Together AI
103
Gemma 4 E2b
Google DeepMind
VisionPoids ouverts
7.8 43% 131K Petit Together AI
104
Llama 3.3 70B
Meta · 70B
Appel d'outilsPoids ouverts
7.7 50% 131K Très grand Together AI
105
Qwen2.5 72B
Alibaba Cloud · 72B
Appel d'outilsPoids ouverts
7.7 49% 131K Très grand Together AI
106
GLM 4 5v
Z.ai (Zhipu AI)
RaisonnementCodeAppel d'outilsPoids ouverts
7.6 68% 66K Très grand Together AI
107
Dots3-Note Preview
Dots Studio
— — 512K Petit OpenRouter, UnoRouter
108
Mixtral 8x22b
Mistral AI · 141B · 39B · Ancienne génération
Poids ouverts
— — 66K Très grand Together AI, NVIDIA Build
109
Llama 3.1 Nemotron Ultra 253B
NVIDIA · 253B
Appel d'outilsPoids ouverts
7.5 73% — Très grand NVIDIA Build
110
Nemotron Nano 9B V2
NVIDIA · 9B
Poids ouverts
7.4 57% 131K Petit UnoRouter
111
Llama 3.1 405B
Meta · 405B
Appel d'outilsPoids ouverts
7.3 52% 131K Très grand Together AI
112
Qwen3 8B
Alibaba Cloud · 8B
RaisonnementPoids ouverts
7.3 59% 41K Petit Together AI
113 — — 1M Petit UnoRouter
114
Qwen2.5 32B
Alibaba Cloud · 32B
Appel d'outilsPoids ouverts
6.9 47% 131K Taille moyenne Together AI
115
Qwen2.5 Coder 32B
Alibaba Cloud · 32B · New
CodeAppel d'outilsPoids ouverts
6.7 42% 131K Taille moyenne UnoRouter
116
Llama 3.1 70B
Meta · 70B
Appel d'outilsPoids ouverts
6.6 41% 16K Très grand Together AI
117 — — 4K Petit Groq, UnoRouter
118
Gemma 3 4B
Google DeepMind · 4B
VisionPoids ouverts
4.8 29% 66K Petit Together AI, NVIDIA Build
119
Codestral Mamba
Mistral AI
Code
— — 256K Petit Mistral AI
120
Mixtral 8x22b Instruct V01
Mistral AI · 141B · 39B · Ancienne génération
Poids ouverts
— — 16K Très grand Together AI
121
Command R Plus
Cohere · 104B · Ancienne génération
— — 128K Très grand Cohere
122
CodeLlama 70B
Meta · 70B · Ancienne génération
CodePoids ouverts
— — — Très grand NVIDIA Build
123
Llama 2 70B
Meta · 70B · Ancienne génération
Poids ouverts
— — — Très grand NVIDIA Build
124
Llama 3 ChatQA 1.5 70B
Meta · 70B · Ancienne génération
Poids ouverts
— — — Très grand NVIDIA Build
125
Nemotron 4 340B
NVIDIA · 340B · Ancienne génération
Poids ouverts
— — — Très grand NVIDIA Build
126
Palmyra Fin 70B 32K
Writer · 70B · Ancienne génération
— — 33K Très grand NVIDIA Build
127
Palmyra Med 70B
Writer · 70B · Ancienne génération
— — — Très grand NVIDIA Build
128
Palmyra Med 70B 32K
Writer · 70B · Ancienne génération
— — 33K Très grand NVIDIA Build
129
Yi Large
01.AI · Ancienne génération
— — — Très grand NVIDIA Build
130 — — 512K Petit UnoRouter
131 — — 512K Petit UnoRouter
132
Codestral
Mistral AI
Code
— — 256K Petit UnoRouter
133
— — 524K Petit UnoRouter
134 — — 262K Petit UnoRouter
135
Molmo 7B D 0924
7B
Poids ouverts
5.6 24% 4K Petit Together AI
136
Sarvam M
Poids ouverts
5.3 42% 33K Petit Together AI
137
Qwen 3.1 7B
Alibaba Cloud · 1.7B
RaisonnementPoids ouverts
5.2 36% 41K Petit Together AI
138
Gemma 3 270M
Google DeepMind · 270M
Poids ouverts
5.1 22% 33K Petit Together AI
139
Granite 4.0 Micro
IBM · New
Poids ouverts
5.1 34% 131K Petit UnoRouter
140
DeepSeek R1 Distill Qwen 7B
DeepSeek · 7B
RaisonnementPoids ouverts
— — 131K Petit Together AI
141
Cogito V1 Preview Llama 8B
Meta · 8B
Poids ouverts
— — 131K Petit Together AI
142
Qwen2.5 3B
Alibaba Cloud · 3B
Poids ouverts
— — 33K Petit Together AI
143
Qwen2.5 1 5B
Alibaba Cloud · 1.5B
Poids ouverts
— — 131K Petit Together AI
144
Qwen2.5 7B
Alibaba Cloud · 7B
Poids ouverts
— — 131K Petit Together AI
145
Meta Llama 3.1 8B
Meta · 8B
Poids ouverts
— — 131K Petit Together AI
146 — — 33K Petit Together AI
147
Cosmos Reason2 8B
NVIDIA · 8B
VisionRaisonnement
— — — Petit NVIDIA Build
148
Mistral Nemo Minitron 8B 8K
Mistral AI · 8B
Poids ouverts
— — 8K Petit NVIDIA Build
149
Lorellm
New
— — 16K Petit UnoRouter
150
Qwen2.5 VL 7B
Alibaba Cloud · 7B
VisionPoids ouverts
— — 131K Petit UnoRouter
151
SWE 1 6 Slow
New
Code
— — 6K Petit UnoRouter
152 — — 33K Petit UnoRouter
153
Gemma 3 27B
Google DeepMind · 27B
VisionAppel d'outilsPoids ouverts
4.9 43% 66K Taille moyenne Together AI
154
Gemma 3 1B
Google DeepMind · 1B
Poids ouverts
4.8 24% 33K Petit Together AI
155
Llama 3.2 1B
Meta · 1B
Poids ouverts
4.8 20% 131K Petit Together AI
156
Qwen 3.0 6B
Alibaba Cloud · 600M
Poids ouverts
4.8 23% 41K Petit Together AI
157
Gemma 3 12B
Google DeepMind · 12B
VisionAppel d'outilsPoids ouverts
3.8 35% — Taille moyenne NVIDIA Build
158
Gemini 1.5 Pro
Google · Ancienne génération
Vision
7.9 59% 2.1M Très grand Google AI Studio
159
Mistral 7B
Mistral AI · 7B · Ancienne génération
Poids ouverts
5.0 18% 33K Petit +1Together AI, Cloudflare Workers AI, Hugging Face, NVIDIA Build, UnoRouter
160
Gemini 1.5 Flash
Google · Ancienne génération
Vision
7.1 46% 1M Taille moyenne Google AI Studio
161
Command R
Cohere · 35B · Ancienne génération
— — 128K Taille moyenne Cohere
162
Command
Cohere · Ancienne génération
— — 4K Taille moyenne Cohere
163
Command Light
Cohere · Ancienne génération
— — 4K Taille moyenne Cohere
164
Qwen1.5 14B Chat Cp
Alibaba Cloud · 14B · Ancienne génération
Poids ouverts
— — 33K Taille moyenne Cloudflare Workers AI
165
Codestral 22B
Mistral AI · 22B · Ancienne génération
Code
— — — Taille moyenne NVIDIA Build
166
Granite 34B Code
IBM · 34B · Ancienne génération
CodePoids ouverts
— — — Taille moyenne NVIDIA Build
167
Llama 3.1 Nemotron 51B
NVIDIA · 51B · Ancienne génération
Poids ouverts
— — — Taille moyenne NVIDIA Build
168
Neva 22B
NVIDIA · 22B · Ancienne génération
Vision
— — — Taille moyenne NVIDIA Build
169
Phi 3.5 MoE
Microsoft · 42B · 6.6B · Ancienne génération
Poids ouverts
— — — Taille moyenne NVIDIA Build
170
StarCoder2 15B
BigCode · 15B · Ancienne génération
Code
— — — Taille moyenne NVIDIA Build
171
Llama 3.1 Nemotron 70B
NVIDIA · 70B · Ancienne génération
Poids ouverts
6.9 47% 16K Très grand Together AI, NVIDIA Build
172
Mistral Large 2
Mistral AI · 123B · Ancienne génération
7.6 49% — Très grand NVIDIA Build
173
Grok Beta
xAI · New · Ancienne génération
6.9 47% 25K Très grand UnoRouter
174
Gemma 2B
Google DeepMind · 2B · Ancienne génération
Poids ouverts
— — 8K Petit Together AI, NVIDIA Build
175
Jamba 1.5 Large
AI21 Labs · 398B · 94B · Ancienne génération
Poids ouverts
6.0 43% — Très grand NVIDIA Build
176
Mistral Large
Mistral AI · Ancienne génération
5.8 35% — Très grand NVIDIA Build
177
DBRX Instruct
Databricks · 132B · 36B · Ancienne génération
Poids ouverts
5.3 33% — Très grand NVIDIA Build
178
Mixtral 8x7b
Mistral AI · 46.7B · 12.9B · Ancienne génération
Poids ouverts
5.1 29% 33K Taille moyenne Together AI
179
Llama 2 7B
Meta · 7B · Ancienne génération
Poids ouverts
— — 4K Petit Together AI
180
Gemma 2 9B
Google DeepMind · 9B · Ancienne génération
Poids ouverts
— — 8K Petit Together AI
181
Phi 3 Mini 4K
Microsoft · 3.8B · Ancienne génération
Poids ouverts
— — 4K Petit Hugging Face
182
CodeGemma 1.1 7B
Google DeepMind · 7B · Ancienne génération
CodePoids ouverts
— — — Petit NVIDIA Build
183
CodeGemma 7B
Google DeepMind · 7B · Ancienne génération
CodePoids ouverts
— — — Petit NVIDIA Build
184
DeepSeek Coder 6 7B
DeepSeek · 6.7B · Ancienne génération
CodePoids ouverts
— — — Petit NVIDIA Build
185
Fuyu 8B
Adept · 8B · Ancienne génération
Vision
— — — Petit NVIDIA Build
186
Granite 3.0 3B A800M
IBM · 3B · 800M · Ancienne génération
Poids ouverts
— — — Petit NVIDIA Build
187
Granite 3.0 8B
IBM · 8B · Ancienne génération
Poids ouverts
— — — Petit NVIDIA Build
188
Granite 8B Code
IBM · 8B · Ancienne génération
CodePoids ouverts
— — — Petit NVIDIA Build
189
Kosmos 2
Microsoft · Ancienne génération
Vision
— — — Petit NVIDIA Build
190
Phi 3 Vision 128K
Microsoft · 4.2B · Ancienne génération
VisionPoids ouverts
— — 131K Petit NVIDIA Build
191
RecurrentGemma 2B
Google DeepMind · 2B · Ancienne génération
Poids ouverts
— — — Petit NVIDIA Build
192
SEA-LION 7B
AI Singapore · 7B · Ancienne génération
Poids ouverts
— — — Petit NVIDIA Build
193
Vila
NVIDIA · Ancienne génération
Vision
— — — Petit NVIDIA Build
194
Zamba2 7B Instruct
Zyphra · 7B · Ancienne génération
— — — Petit NVIDIA Build
195
Nemotron 3.5 Content Safety
NVIDIA · Modération
Poids ouverts
— — 128K Taille moyenne OpenRouter
196
gpt-oss-safeguard-20b
OpenAI · 21B · 3.6B · Modération
Poids ouverts
— — 131K Taille moyenne UnoRouter
197
Riva Translate 4B Instruct V2
NVIDIA · 4B · Traduction
— — 8K Petit NVIDIA Build, UnoRouter
198
OrcaVerify Text 1.0
Orca · Modération
— — — Petit OrcaRouter
199
Riva Translate 4B Instruct
NVIDIA · 4B · Traduction
— — — Petit NVIDIA Build
200
Riva Translate 4B Instruct V1.1
NVIDIA · 4B · Traduction
— — — Petit NVIDIA Build
201
Lyria 3 Pro Preview
Google · Audio
— — 1M — OpenRouter
202
Lyria 3 Clip Preview
Google · Audio
— — 1M — OpenRouter
203
Mistral Embed
Mistral AI · Embeddings
— — 8K — Mistral AI
204
Nano Banana Pro (Gemini 3 Pro Image Preview)
Google · Génération d'images
— — 66K — OrcaRouter
205
Nano Banana 2 (Gemini 3.1 Flash Image Preview)
Google · Génération d'images
— — 66K — OrcaRouter
206
Grok Imagine Image
xAI · Génération d'images
— — — — OrcaRouter
207
Kling 3.0 Turbo
Kling · Génération de vidéos
— — — — OrcaRouter
208
OrcaDub 1.0
OrcaDub · Audio
— — — — OrcaRouter
209
Fusion
OrcaRouter · Routeur automatique
— — 1M — OrcaRouter
210
Fusion Mini
OrcaRouter · Routeur automatique
— — 1M — OrcaRouter
211
Free Models Router
OpenRouter · Routeur automatique
— — 200K — OpenRouter, OrcaRouter
212
Fusion Flash
OrcaRouter · Routeur automatique
— — 262K — OrcaRouter

Benchmarks : Artificial Analysis (24 septembre 2026). Un tiret signifie que le modèle ne figure pas dans leur classement ; nous n'estimons jamais les scores nous-mêmes.

Fournisseurs d'API gratuites

Statut de la dernière vérification, nombre de modèles et conditions d'accès.

Comparer →
OpenRouter
21 modèles

Les modèles avec le suffixe :free autorisent 50 requêtes par jour, ou 1 000 par jour après une recharge unique de 10 $ (20 requêtes par minute).

Sans carteOpenAI API
Groq
4 modèles

Offre gratuite avec des limites par modèle sur les requêtes et les tokens par minute et par jour ; vitesse de génération très élevée sur matériel LPU.

Sans carteOpenAI API
Google AI Studio
4 modèles

L'offre gratuite de l'API Gemini couvre les modèles Flash et Flash-Lite avec des limites de débit ; les contenus de l'offre gratuite peuvent être utilisés pour améliorer les produits Google.

Sans carteOpenAI API
Mistral AI
4 modèles

L'offre Free inclut des crédits API mensuels pour les modèles Mistral, avec des limites de débit par défaut basses.

OpenAI API
Together AI
98 modèles

Seuls certains modèles sont à prix nul ; il n'y a pas d'essai gratuit général.

OpenAI API
Cohere
4 modèles

Les clés d'essai permettent 1 000 appels API par mois pour l'évaluation, pas pour la production.

Sans carteOpenAI API
Cerebras
2 modèles

Essai gratuit avec limites quotidiennes de tokens ; un moyen de paiement vérifié est requis pour activer l'API.

Carte requiseOpenAI API
Cloudflare Workers AI
3 modèles

10 000 Neurons par jour sont gratuits sur les offres Workers Free et Paid.

OpenAI API
Hugging Face
3 modèles

Les comptes gratuits reçoivent un petit crédit mensuel pour les Inference Providers ; les comptes PRO en reçoivent davantage.

Sans carteOpenAI API
OrcaRouter
13 modèles

Routeur BYOK sans marge sur les tokens ; ses propres modèles Fusion et certaines routes gratuites ne coûtent rien.

OpenAI API
NVIDIA Build
62 modèles

Inférence serverless gratuite pour le développement et le prototypage avec un compte développeur ; non destinée au trafic de production.

Sans carteOpenAI API
TokenRouter
1 modèle

Les modèles gratuits et les accès promotionnels peuvent être limités dans le temps.

OpenAI API
Vercel AI Gateway
3 modèles

Une carte de paiement doit être enregistrée, même pour les modèles à prix nul.

Carte requiseOpenAI API
Nous Portal
7 modèles

L'offre Portal à 0 $ inclut les modèles :free avec des limites de débit standard.

Sans carteOpenAI API
UnoRouter
62 modèles

Large catalogue de routes :free sans carte ; capacité partagée et limites par modèle.

Sans carteOpenAI API

Logiciels gratuits pour utiliser ces modèles

Agents, IDE et exécuteurs locaux compatibles avec les API gratuites.

Les 73 →

Crédits IA gratuits

Offres API gratuites, plus programmes pour startups et étudiants.

Les 39 →

FAQ

Existe-t-il des API LLM gratuites ?

Oui. Au 26 septembre 2026, nous avons trouvé 212 modèles en accès API gratuit chez 15 fournisseurs. Il s'agit de modèles à prix nul par token, avec une offre gratuite pour développeurs ou un quota gratuit.

Quel modèle d'API gratuit est le plus performant actuellement ?

Selon l'Artificial Analysis Intelligence Index, GLM 5.3 (44.8) est actuellement en tête — il est gratuit chez Together AI, NVIDIA Build. Le classement est mis à jour à chaque actualisation du catalogue.

Ai-je besoin d'une carte bancaire ?

Pas toujours. Par exemple, ceux-ci fonctionnent sans carte : OpenRouter, Groq, Google AI Studio, Cohere, Hugging Face, NVIDIA Build. Cerebras et Vercel AI Gateway exigent une carte, même pour les modèles gratuits.

À quelle fréquence les données sont-elles mises à jour ?

Le catalogue interroge les API des fournisseurs toutes les heures. Les modèles gratuits ajoutés et supprimés apparaissent dans la section Nouveaux modèles et dans le flux RSS.

Puis-je utiliser des modèles gratuits dans Cursor, Cline ou OpenCode ?

Oui. Presque tous les fournisseurs listés ici sont compatibles OpenAI : indiquez la base URL du fournisseur, votre clé et l'ID du modèle figurant sur sa fiche. Les applications compatibles sont listées dans la section Logiciels gratuits.