LLM Perks
Live-Index · vor 34 Min. aktualisiert

Kostenlose LLM-APIs

Ein Live-Katalog kostenloser KI-APIs für aktuelle DeepSeek-, Qwen-, Nemotron-, Mistral-, Llama-, Gemini- und weitere Modelle. Vergleichen Sie Anbieter, Kontextfenster und Limits, bevor Sie Cursor, VS Code, Cline, Open WebUI oder Ihre eigene Anwendung anbinden.

212
kostenlose Modelle
291
kostenlose Endpunkte
15/15
Anbieter online
66
neu in 7 Tagen

Die aktuell besten kostenlosen Modelle

Automatisch ausgewählt nach Benchmarks, Größe und Anzahl kostenloser Anbieter.

New free models this week

All new →

Alle kostenlosen Modelle

Eine Zeile pro Modell; die Modellkarte listet alle kostenlosen Anbieter, Limits und Codebeispiele.

Größe
212 gefunden
# Modell ↕ AA Index ↕ GPQA ↕ Kontext ↕ Größe ↕ Kostenlos bei ↕
📌
OpenCode GO
$60 in monthly API credits for $10, covering DeepSeek, Qwen, GLM, and other models. Introductory first-month offer available.
Öffnen
1
GLM 5.3
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
44.8 92% 1M Sehr groß Together AI, NVIDIA Build
2
Mimo V2.6 Pro
New
Offene Gewichte
46.3 — 1M Sehr groß UnoRouter
3
Kimi K3
Moonshot AI
VisionReasoningCodingTool-NutzungOffene Gewichte
43.6 94% 1M Sehr groß NVIDIA Build, UnoRouter
4
GLM 5.3 Flash
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
41.8 91% 1M Mittelgroß OrcaRouter, NVIDIA Build, UnoRouter
5
Qwen 3.8 Flash Next
Alibaba Cloud · New
ReasoningCodingTool-NutzungOffene Gewichte
39.8 92% 1M Mittelgroß UnoRouter
6
DeepSeek V4.1 Flash
DeepSeek · New
ReasoningCodingTool-NutzungOffene Gewichte
39.5 — — Sehr groß NVIDIA Build
7
DeepSeek V4 Flash
DeepSeek
ReasoningCodingTool-NutzungOffene Gewichte
34.3 91% 1M Sehr groß OrcaRouter, UnoRouter
8
Qwen3.8 27B
Alibaba Cloud · 27B
ReasoningCodingTool-NutzungOffene Gewichte
33.7 91% 262K Mittelgroß OpenRouter, Groq, UnoRouter
9
Gemini 3.6 Flash
Google
VisionReasoningCodingTool-Nutzung
34.0 93% 1M Mittelgroß UnoRouter
10
GLM 5.2
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
33.7 90% 1M Sehr groß Together AI
11
Qwen 3.8 27B
Alibaba Cloud · 27B
Tool-NutzungOffene Gewichte
33.7 91% — Mittelgroß Cerebras
12
Inkling Small
Thinking Machines Lab
ReasoningOffene Gewichte
27.8 90% 1M Klein OpenRouter
13
Solar Pro 4
Upstage
ReasoningTool-Nutzung
28.2 89% 524K Sehr groß Nous Portal
14
Nemotron 3 Ultra
NVIDIA · 550B · 55B
ReasoningCodingTool-NutzungOffene Gewichte
22.9 87% 1M Sehr groß OpenRouter, NVIDIA Build, UnoRouter
15
Inkling
Thinking Machines Lab
ReasoningOffene Gewichte
25.0 87% 1M Klein OpenRouter
16
Kimi K2.6
Moonshot AI
ReasoningCodingTool-NutzungOffene Gewichte
27.0 91% — Sehr groß NVIDIA Build
17
Ling 3.0 Flash Fin
inclusionAI (Ant Group)
Offene Gewichte
22.6 — 262K Klein OpenRouter, Nous Portal, UnoRouter
18
Hy3
Tencent
Offene Gewichte
25.3 90% — Klein OrcaRouter
19
Gemma 4 31B
Google DeepMind · 31B
VisionTool-NutzungOffene Gewichte
19.0 86% 262K Mittelgroß OpenRouter, Together AI, NVIDIA Build, UnoRouter
20
Gemini 3.5 Flash Lite
Google
VisionReasoningCoding
22.2 84% 1M Klein UnoRouter
21
GLM 4.7
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
22.2 86% 203K Sehr groß Together AI
22
LongCat 2.0
Meituan
ReasoningTool-NutzungOffene Gewichte
19.1 78% 1M Sehr groß Nous Portal
23
Gemma 4 26B A4B
Google DeepMind · 26B · 4B
VisionTool-NutzungOffene Gewichte
16.7 79% 262K Mittelgroß OpenRouter, Together AI, UnoRouter
24
Step 3.7 Flash
StepFun
ReasoningOffene Gewichte
19.5 81% 262K Klein Nous Portal
25
Qwen 3.5 35B
Alibaba Cloud · 35B · 3B
ReasoningCodingTool-NutzungOffene Gewichte
19.3 85% 262K Mittelgroß Together AI
26
Qwen 3.6 35B
Alibaba Cloud · 35B · 3B
ReasoningCodingTool-NutzungOffene Gewichte
18.2 84% 262K Mittelgroß Together AI
27
Qwen 3.5 122B
Alibaba Cloud · 122B · 10B
ReasoningCodingTool-NutzungOffene Gewichte
17.7 83% 262K Sehr groß Together AI
28
MiniMax M2
MiniMax · 230B · 10B
ReasoningCodingTool-NutzungOffene Gewichte
18.6 78% 197K Sehr groß Together AI
29
Nemotron 3.5 Lightning
NVIDIA · 30B · 3B
ReasoningTool-NutzungOffene Gewichte
12.9 74% 1M Mittelgroß OpenRouter, NVIDIA Build, UnoRouter
30
Nemotron 3 Super
NVIDIA · 120B · 12B
ReasoningCodingTool-NutzungOffene Gewichte
12.8 80% 262K Sehr groß OpenRouter, NVIDIA Build, UnoRouter
31
Llama 4 Maverick Instruct Fp4
Meta · 400B · 17B
VisionTool-NutzungOffene Gewichte
— — 1M Sehr groß Together AI
32
Nemotron 3 Nano Omni
NVIDIA · 30B · 3B
VisionReasoningTool-NutzungOffene Gewichte
10.3 47% 262K Mittelgroß +1OpenRouter, Together AI, NVIDIA Build, TokenRouter, UnoRouter
33
Gemma 4 12B
Google DeepMind · 12B
VisionTool-NutzungOffene Gewichte
14.2 75% 262K Mittelgroß Together AI
34 — — 512K Sehr groß UnoRouter
35
Mistral Large 3 675B
Mistral AI · 675B
CodingTool-NutzungOffene Gewichte
— — 256K Sehr groß UnoRouter
36
GLM 4.7 Flash
Z.ai (Zhipu AI) · New
ReasoningCodingTool-NutzungOffene Gewichte
14.9 58% 128K Mittelgroß UnoRouter
37
Qwen 3.5 9B
Alibaba Cloud · 9B
ReasoningCodingOffene Gewichte
13.7 81% 262K Klein Together AI
38
Qwen3 VL 235B
Alibaba Cloud · 235B · 22B
VisionReasoningTool-NutzungOffene Gewichte
13.4 77% 262K Sehr groß Together AI
39
Cogito V1 Preview Llama 70B
Meta · 70B
Tool-NutzungOffene Gewichte
— — 131K Sehr groß Together AI
40
Meta Llama 3.1 70B
Meta · 70B
Tool-NutzungOffene Gewichte
— — 131K Sehr groß Together AI
41
GLM 4.7 Fp4
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
— — 203K Sehr groß Together AI
42
GLM 5 Fp4
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
— — 203K Sehr groß Together AI
43
MiniMax M2.5 Fp4
MiniMax
ReasoningCodingTool-NutzungOffene Gewichte
— — 8K Sehr groß Together AI
44
GLM Ocr
Z.ai (Zhipu AI)
Tool-NutzungOffene Gewichte
— — 131K Sehr groß Together AI
45
Palmyra Creative 122B
Writer · 122B
— — — Sehr groß NVIDIA Build
46
Nvidia Nemotron 3 Super
NVIDIA · 120B · 12B
ReasoningCodingTool-NutzungOffene Gewichte
12.8 80% 262K Sehr groß Together AI
47
MiniMax M1 80K
MiniMax
ReasoningTool-NutzungOffene Gewichte
11.7 70% 1M Sehr groß Together AI
48
Qwen3 235B
Alibaba Cloud · 235B · 22B
ReasoningCodingTool-NutzungOffene Gewichte
12.7 79% 262K Sehr groß Together AI
49
gpt-oss-120b
OpenAI · 117B · 5.1B
ReasoningCodingTool-NutzungOffene Gewichte
11.6 78% 131K Sehr groß Groq, Cerebras
50
gpt-oss-20b
OpenAI · 21B · 3.6B
ReasoningTool-NutzungOffene Gewichte
10.0 61% 131K Mittelgroß Groq, NVIDIA Build, UnoRouter
51
North Mini Code
Cohere
CodingOffene Gewichte
9.9 76% 262K Klein OpenRouter, UnoRouter
52
Mistral Nemo
Mistral AI · 12B
Tool-NutzungOffene Gewichte
— — 131K Mittelgroß Mistral AI, Together AI, NVIDIA Build
53
MiniMax M1 40K
MiniMax
ReasoningTool-NutzungOffene Gewichte
10.0 68% 1M Sehr groß Together AI
54
Laguna S 2.1
Poolside
ReasoningCoding
— — 1M Klein OpenRouter, Vercel AI Gateway, Nous Portal, UnoRouter
55
Qwen3 Next 80B
Alibaba Cloud · 80B · 3B
ReasoningCodingTool-NutzungOffene Gewichte
11.2 76% — Sehr groß Together AI
56
GLM 5.3 Flash Search
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
— — 1M Mittelgroß UnoRouter
57
Gemini 2.0 Flash
Google
VisionTool-Nutzung
8.9 62% 1M Mittelgroß Google AI Studio
58
Qwen3 30B
Alibaba Cloud · 30B · 3B
ReasoningTool-NutzungOffene Gewichte
9.8 71% 262K Mittelgroß Together AI
59
Qwen3 Coder 30B
Alibaba Cloud · 30B · 3B
ReasoningCodingTool-NutzungOffene Gewichte
9.6 52% 262K Sehr groß Together AI
60
Ling 3.0 Flash Sante
inclusionAI (Ant Group)
Offene Gewichte
— — 262K Klein OpenRouter, Vercel AI Gateway, Nous Portal, UnoRouter
61
Laguna XS 2.1
Poolside
ReasoningCoding
— — 262K Klein OpenRouter, NVIDIA Build, Nous Portal, UnoRouter
62
Mistral Nemotron
Mistral AI · 12B
Tool-NutzungOffene Gewichte
— — 128K Mittelgroß NVIDIA Build, UnoRouter
63
Muse Glimmer 30B
Meta · 30B
— — 131K Mittelgroß NVIDIA Build, UnoRouter
64
DiffusionGemma 26B
Google DeepMind · 26B · 4B
Tool-NutzungOffene Gewichte
9.5 67% 262K Mittelgroß UnoRouter
65
Llama 4 Scout
Meta · 109B · 17B
VisionTool-NutzungOffene Gewichte
8.1 59% 10.5M Sehr groß Together AI
66 — — 262K Mittelgroß Together AI
67
Holo3 35B A3B
35B · 3B
— — 262K Mittelgroß Together AI
68 — — 262K Mittelgroß UnoRouter
69
Llama 4 Maverick
Meta · 400B · 17B
VisionTool-NutzungOffene Gewichte
10.0 67% 131K Sehr groß UnoRouter
70
Qwen SEA-LION V4.5 27B
Alibaba Cloud · 27B
Tool-NutzungOffene Gewichte
— — 262K Mittelgroß UnoRouter
71
LFM2.5-2.6B
Liquid AI · 2.6B
Offene Gewichte
8.4 56% 128K Klein OpenRouter, UnoRouter
72
Llama 3.1 8B
Meta · 8B
Offene Gewichte
6.9 26% 131K Klein Together AI, Cloudflare Workers AI, Hugging Face
73
Nvidia Nemotron 3 Nano
NVIDIA · 30B · 3B
ReasoningTool-NutzungOffene Gewichte
8.9 76% 262K Mittelgroß Together AI
74
Qwen3 4B
Alibaba Cloud · 4B
ReasoningOffene Gewichte
8.8 67% 262K Klein Together AI
75
QwQ 32B
Alibaba Cloud · 32B · New
ReasoningTool-NutzungOffene Gewichte
9.5 59% 131K Mittelgroß UnoRouter
76
Gemini 2.0 Flash Lite
Google
Vision
7.3 54% 1M Klein Google AI Studio
77
Mixtral 8x7b Instruct V01
Mistral AI · 46.7B · 12.9B
Tool-NutzungOffene Gewichte
— — 16K Mittelgroß Together AI
78
Cogito V1 Preview Qwen 32B
Alibaba Cloud · 32B
Tool-NutzungOffene Gewichte
— — 131K Mittelgroß Together AI
79
Cogito V1 Preview Qwen 14B
Alibaba Cloud · 14B
Tool-NutzungOffene Gewichte
— — 131K Mittelgroß Together AI
80
Qwen2.5 14B
Alibaba Cloud · 14B
Tool-NutzungOffene Gewichte
— — 131K Mittelgroß Together AI
81
— — 131K Mittelgroß Together AI
82
Medgemma 27B Text
Google DeepMind · 27B
Tool-NutzungOffene Gewichte
— — 131K Mittelgroß Together AI
83
DeepSeek Ocr 2
DeepSeek
Tool-NutzungOffene Gewichte
— — 8K Mittelgroß Together AI
84
Gemini Robotics ER 2 Preview
Google
Tool-Nutzung
— — 131K Mittelgroß UnoRouter
85
GLM 4.5 Flash
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
— — 131K Mittelgroß UnoRouter
86
Qwen SEA-LION V4 32B
Alibaba Cloud · 32B
Tool-NutzungOffene Gewichte
— — 33K Mittelgroß UnoRouter
87
Qwen3
Alibaba Cloud · New
ReasoningTool-NutzungOffene Gewichte
— — 25K Mittelgroß UnoRouter
88 — — 131K Mittelgroß UnoRouter
89
Llama 3.3 Nemotron Super 49B
NVIDIA · 49B
Tool-NutzungOffene Gewichte
8.9 64% 16K Mittelgroß Together AI
90
Gemma 4 E4b
Google DeepMind
VisionOffene Gewichte
8.9 58% 131K Klein Together AI
91
Nemotron 3 Nano
NVIDIA · 30B · 3B
Tool-NutzungOffene Gewichte
8.9 76% — Mittelgroß NVIDIA Build
92
Devstral Small
Mistral AI
CodingTool-NutzungOffene Gewichte
8.7 43% 131K Mittelgroß Together AI
93
Magistral Small
Mistral AI
ReasoningTool-NutzungOffene Gewichte
8.6 66% 41K Mittelgroß Together AI
94
Qwen3 32B
Alibaba Cloud · 32B
ReasoningTool-NutzungOffene Gewichte
8.6 67% 41K Mittelgroß Together AI
95
Space Bunny Alpha
Stealth model · New
— — 1M Klein OpenRouter, UnoRouter
96
Llama 3.2 11B Vision
Meta · 11B
VisionTool-NutzungOffene Gewichte
5.4 22% 131K Mittelgroß Together AI, NVIDIA Build, UnoRouter
97
DeepSeek R1 Distill Qwen 32B
DeepSeek · 32B · New
ReasoningTool-NutzungOffene Gewichte
8.4 62% 80K Mittelgroß UnoRouter
98
GPT-4o
OpenAI · New
VisionTool-Nutzung
8.4 54% 128K Sehr groß UnoRouter
99
Mistral Small
Mistral AI · 24B
Tool-NutzungOffene Gewichte
5.8 38% 256K Mittelgroß Mistral AI, UnoRouter
100
Qwen3 14B
Alibaba Cloud · 14B
ReasoningTool-NutzungOffene Gewichte
8.2 60% 2K Mittelgroß Together AI
101
Llama 3.2 90B Vision
Meta · 90B
VisionTool-NutzungOffene Gewichte
6.4 43% 16K Sehr groß Together AI, NVIDIA Build
102
Qwen 3.5 2B
Alibaba Cloud · 2B
ReasoningCodingOffene Gewichte
6.9 46% 262K Klein Together AI
103
Gemma 4 E2b
Google DeepMind
VisionOffene Gewichte
7.8 43% 131K Klein Together AI
104
Llama 3.3 70B
Meta · 70B
Tool-NutzungOffene Gewichte
7.7 50% 131K Sehr groß Together AI
105
Qwen2.5 72B
Alibaba Cloud · 72B
Tool-NutzungOffene Gewichte
7.7 49% 131K Sehr groß Together AI
106
GLM 4 5v
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
7.6 68% 66K Sehr groß Together AI
107
Dots3-Note Preview
Dots Studio
— — 512K Klein OpenRouter, UnoRouter
108
Mixtral 8x22b
Mistral AI · 141B · 39B · Legacy
Offene Gewichte
— — 66K Sehr groß Together AI, NVIDIA Build
109
Llama 3.1 Nemotron Ultra 253B
NVIDIA · 253B
Tool-NutzungOffene Gewichte
7.5 73% — Sehr groß NVIDIA Build
110
Nemotron Nano 9B V2
NVIDIA · 9B
Offene Gewichte
7.4 57% 131K Klein UnoRouter
111
Llama 3.1 405B
Meta · 405B
Tool-NutzungOffene Gewichte
7.3 52% 131K Sehr groß Together AI
112
Qwen3 8B
Alibaba Cloud · 8B
ReasoningOffene Gewichte
7.3 59% 41K Klein Together AI
113 — — 1M Klein UnoRouter
114
Qwen2.5 32B
Alibaba Cloud · 32B
Tool-NutzungOffene Gewichte
6.9 47% 131K Mittelgroß Together AI
115
Qwen2.5 Coder 32B
Alibaba Cloud · 32B · New
CodingTool-NutzungOffene Gewichte
6.7 42% 131K Mittelgroß UnoRouter
116
Llama 3.1 70B
Meta · 70B
Tool-NutzungOffene Gewichte
6.6 41% 16K Sehr groß Together AI
117 — — 4K Klein Groq, UnoRouter
118
Gemma 3 4B
Google DeepMind · 4B
VisionOffene Gewichte
4.8 29% 66K Klein Together AI, NVIDIA Build
119
Codestral Mamba
Mistral AI
Coding
— — 256K Klein Mistral AI
120
Mixtral 8x22b Instruct V01
Mistral AI · 141B · 39B · Legacy
Offene Gewichte
— — 16K Sehr groß Together AI
121
Command R Plus
Cohere · 104B · Legacy
— — 128K Sehr groß Cohere
122
CodeLlama 70B
Meta · 70B · Legacy
CodingOffene Gewichte
— — — Sehr groß NVIDIA Build
123
Llama 2 70B
Meta · 70B · Legacy
Offene Gewichte
— — — Sehr groß NVIDIA Build
124
Llama 3 ChatQA 1.5 70B
Meta · 70B · Legacy
Offene Gewichte
— — — Sehr groß NVIDIA Build
125
Nemotron 4 340B
NVIDIA · 340B · Legacy
Offene Gewichte
— — — Sehr groß NVIDIA Build
126
Palmyra Fin 70B 32K
Writer · 70B · Legacy
— — 33K Sehr groß NVIDIA Build
127
Palmyra Med 70B
Writer · 70B · Legacy
— — — Sehr groß NVIDIA Build
128
Palmyra Med 70B 32K
Writer · 70B · Legacy
— — 33K Sehr groß NVIDIA Build
129
Yi Large
01.AI · Legacy
— — — Sehr groß NVIDIA Build
130 — — 512K Klein UnoRouter
131 — — 512K Klein UnoRouter
132
Codestral
Mistral AI
Coding
— — 256K Klein UnoRouter
133
— — 524K Klein UnoRouter
134 — — 262K Klein UnoRouter
135
Molmo 7B D 0924
7B
Offene Gewichte
5.6 24% 4K Klein Together AI
136
Sarvam M
Offene Gewichte
5.3 42% 33K Klein Together AI
137
Qwen 3.1 7B
Alibaba Cloud · 1.7B
ReasoningOffene Gewichte
5.2 36% 41K Klein Together AI
138
Gemma 3 270M
Google DeepMind · 270M
Offene Gewichte
5.1 22% 33K Klein Together AI
139
Granite 4.0 Micro
IBM · New
Offene Gewichte
5.1 34% 131K Klein UnoRouter
140
DeepSeek R1 Distill Qwen 7B
DeepSeek · 7B
ReasoningOffene Gewichte
— — 131K Klein Together AI
141
Cogito V1 Preview Llama 8B
Meta · 8B
Offene Gewichte
— — 131K Klein Together AI
142
Qwen2.5 3B
Alibaba Cloud · 3B
Offene Gewichte
— — 33K Klein Together AI
143
Qwen2.5 1 5B
Alibaba Cloud · 1.5B
Offene Gewichte
— — 131K Klein Together AI
144
Qwen2.5 7B
Alibaba Cloud · 7B
Offene Gewichte
— — 131K Klein Together AI
145
Meta Llama 3.1 8B
Meta · 8B
Offene Gewichte
— — 131K Klein Together AI
146 — — 33K Klein Together AI
147
Cosmos Reason2 8B
NVIDIA · 8B
VisionReasoning
— — — Klein NVIDIA Build
148
Mistral Nemo Minitron 8B 8K
Mistral AI · 8B
Offene Gewichte
— — 8K Klein NVIDIA Build
149
Lorellm
New
— — 16K Klein UnoRouter
150
Qwen2.5 VL 7B
Alibaba Cloud · 7B
VisionOffene Gewichte
— — 131K Klein UnoRouter
151
SWE 1 6 Slow
New
Coding
— — 6K Klein UnoRouter
152 — — 33K Klein UnoRouter
153
Gemma 3 27B
Google DeepMind · 27B
VisionTool-NutzungOffene Gewichte
4.9 43% 66K Mittelgroß Together AI
154
Gemma 3 1B
Google DeepMind · 1B
Offene Gewichte
4.8 24% 33K Klein Together AI
155
Llama 3.2 1B
Meta · 1B
Offene Gewichte
4.8 20% 131K Klein Together AI
156
Qwen 3.0 6B
Alibaba Cloud · 600M
Offene Gewichte
4.8 23% 41K Klein Together AI
157
Gemma 3 12B
Google DeepMind · 12B
VisionTool-NutzungOffene Gewichte
3.8 35% — Mittelgroß NVIDIA Build
158
Gemini 1.5 Pro
Google · Legacy
Vision
7.9 59% 2.1M Sehr groß Google AI Studio
159
Mistral 7B
Mistral AI · 7B · Legacy
Offene Gewichte
5.0 18% 33K Klein +1Together AI, Cloudflare Workers AI, Hugging Face, NVIDIA Build, UnoRouter
160
Gemini 1.5 Flash
Google · Legacy
Vision
7.1 46% 1M Mittelgroß Google AI Studio
161
Command R
Cohere · 35B · Legacy
— — 128K Mittelgroß Cohere
162
Command
Cohere · Legacy
— — 4K Mittelgroß Cohere
163
Command Light
Cohere · Legacy
— — 4K Mittelgroß Cohere
164
Qwen1.5 14B Chat Cp
Alibaba Cloud · 14B · Legacy
Offene Gewichte
— — 33K Mittelgroß Cloudflare Workers AI
165
Codestral 22B
Mistral AI · 22B · Legacy
Coding
— — — Mittelgroß NVIDIA Build
166
Granite 34B Code
IBM · 34B · Legacy
CodingOffene Gewichte
— — — Mittelgroß NVIDIA Build
167
Llama 3.1 Nemotron 51B
NVIDIA · 51B · Legacy
Offene Gewichte
— — — Mittelgroß NVIDIA Build
168
Neva 22B
NVIDIA · 22B · Legacy
Vision
— — — Mittelgroß NVIDIA Build
169
Phi 3.5 MoE
Microsoft · 42B · 6.6B · Legacy
Offene Gewichte
— — — Mittelgroß NVIDIA Build
170
StarCoder2 15B
BigCode · 15B · Legacy
Coding
— — — Mittelgroß NVIDIA Build
171
Llama 3.1 Nemotron 70B
NVIDIA · 70B · Legacy
Offene Gewichte
6.9 47% 16K Sehr groß Together AI, NVIDIA Build
172
Mistral Large 2
Mistral AI · 123B · Legacy
7.6 49% — Sehr groß NVIDIA Build
173
Grok Beta
xAI · New · Legacy
6.9 47% 25K Sehr groß UnoRouter
174
Gemma 2B
Google DeepMind · 2B · Legacy
Offene Gewichte
— — 8K Klein Together AI, NVIDIA Build
175
Jamba 1.5 Large
AI21 Labs · 398B · 94B · Legacy
Offene Gewichte
6.0 43% — Sehr groß NVIDIA Build
176
Mistral Large
Mistral AI · Legacy
5.8 35% — Sehr groß NVIDIA Build
177
DBRX Instruct
Databricks · 132B · 36B · Legacy
Offene Gewichte
5.3 33% — Sehr groß NVIDIA Build
178
Mixtral 8x7b
Mistral AI · 46.7B · 12.9B · Legacy
Offene Gewichte
5.1 29% 33K Mittelgroß Together AI
179
Llama 2 7B
Meta · 7B · Legacy
Offene Gewichte
— — 4K Klein Together AI
180
Gemma 2 9B
Google DeepMind · 9B · Legacy
Offene Gewichte
— — 8K Klein Together AI
181
Phi 3 Mini 4K
Microsoft · 3.8B · Legacy
Offene Gewichte
— — 4K Klein Hugging Face
182
CodeGemma 1.1 7B
Google DeepMind · 7B · Legacy
CodingOffene Gewichte
— — — Klein NVIDIA Build
183
CodeGemma 7B
Google DeepMind · 7B · Legacy
CodingOffene Gewichte
— — — Klein NVIDIA Build
184
DeepSeek Coder 6 7B
DeepSeek · 6.7B · Legacy
CodingOffene Gewichte
— — — Klein NVIDIA Build
185
Fuyu 8B
Adept · 8B · Legacy
Vision
— — — Klein NVIDIA Build
186
Granite 3.0 3B A800M
IBM · 3B · 800M · Legacy
Offene Gewichte
— — — Klein NVIDIA Build
187
Granite 3.0 8B
IBM · 8B · Legacy
Offene Gewichte
— — — Klein NVIDIA Build
188
Granite 8B Code
IBM · 8B · Legacy
CodingOffene Gewichte
— — — Klein NVIDIA Build
189
Kosmos 2
Microsoft · Legacy
Vision
— — — Klein NVIDIA Build
190
Phi 3 Vision 128K
Microsoft · 4.2B · Legacy
VisionOffene Gewichte
— — 131K Klein NVIDIA Build
191
RecurrentGemma 2B
Google DeepMind · 2B · Legacy
Offene Gewichte
— — — Klein NVIDIA Build
192
SEA-LION 7B
AI Singapore · 7B · Legacy
Offene Gewichte
— — — Klein NVIDIA Build
193
Vila
NVIDIA · Legacy
Vision
— — — Klein NVIDIA Build
194
Zamba2 7B Instruct
Zyphra · 7B · Legacy
— — — Klein NVIDIA Build
195
Nemotron 3.5 Content Safety
NVIDIA · Moderation
Offene Gewichte
— — 128K Mittelgroß OpenRouter
196
gpt-oss-safeguard-20b
OpenAI · 21B · 3.6B · Moderation
Offene Gewichte
— — 131K Mittelgroß UnoRouter
197
Riva Translate 4B Instruct V2
NVIDIA · 4B · Übersetzung
— — 8K Klein NVIDIA Build, UnoRouter
198
OrcaVerify Text 1.0
Orca · Moderation
— — — Klein OrcaRouter
199
Riva Translate 4B Instruct
NVIDIA · 4B · Übersetzung
— — — Klein NVIDIA Build
200
Riva Translate 4B Instruct V1.1
NVIDIA · 4B · Übersetzung
— — — Klein NVIDIA Build
201
Lyria 3 Pro Preview
Google · Audio
— — 1M — OpenRouter
202
Lyria 3 Clip Preview
Google · Audio
— — 1M — OpenRouter
203
Mistral Embed
Mistral AI · Embeddings
— — 8K — Mistral AI
204 — — 66K — OrcaRouter
205 — — 66K — OrcaRouter
206
Grok Imagine Image
xAI · Bildgenerierung
— — — — OrcaRouter
207
Kling 3.0 Turbo
Kling · Videogenerierung
— — — — OrcaRouter
208
OrcaDub 1.0
OrcaDub · Audio
— — — — OrcaRouter
209
Fusion
OrcaRouter · Auto-Router
— — 1M — OrcaRouter
210
Fusion Mini
OrcaRouter · Auto-Router
— — 1M — OrcaRouter
211
Free Models Router
OpenRouter · Auto-Router
— — 200K — OpenRouter, OrcaRouter
212
Fusion Flash
OrcaRouter · Auto-Router
— — 262K — OrcaRouter

Benchmarks: Artificial Analysis (24. September 2026). Ein Strich bedeutet, dass das Modell nicht in deren Rangliste steht; wir schätzen Werte nie selbst.

Kostenlose API-Anbieter

Status der letzten Prüfung, Modellanzahl und Zugangsbedingungen.

Vergleichen →
OpenRouter
21 Modelle

Modelle mit dem Suffix :free erlauben 50 Anfragen pro Tag oder 1,000 pro Tag nach einmaliger Aufladung von $10 (20 Anfragen pro Minute).

Ohne KarteOpenAI API
Groq
4 Modelle

Kostenloser Tarif mit modellspezifischen Limits für Anfragen und Token pro Minute und pro Tag; sehr hohe Generierungsgeschwindigkeit auf LPU-Hardware.

Ohne KarteOpenAI API
Google AI Studio
4 Modelle

Der kostenlose Tarif der Gemini API umfasst Flash- und Flash-Lite-Modelle mit Rate Limits; Inhalte aus dem kostenlosen Tarif können zur Verbesserung von Google-Produkten genutzt werden.

Ohne KarteOpenAI API
Mistral AI
4 Modelle

Der Free-Tarif enthält monatliche API-Credits für Mistral-Modelle, mit niedrigen Standard-Rate-Limits.

OpenAI API
Together AI
98 Modelle

Nur ausgewählte Modelle kosten nichts; eine allgemeine kostenlose Testphase gibt es nicht.

OpenAI API
Cohere
4 Modelle

Testschlüssel erlauben 1,000 API-Aufrufe pro Monat zur Evaluierung, nicht für den Produktiveinsatz.

Ohne KarteOpenAI API
Cerebras
2 Modelle

Kostenlose Testphase mit täglichen Token-Limits; zur Aktivierung der API ist eine verifizierte Zahlungsmethode erforderlich.

Karte erforderlichOpenAI API
Cloudflare Workers AI
3 Modelle

10,000 Neurons pro Tag sind sowohl im Workers-Free- als auch im Paid-Tarif kostenlos.

OpenAI API
Hugging Face
3 Modelle

Kostenlose Konten erhalten ein kleines monatliches Guthaben für Inference Providers; PRO-Konten erhalten mehr.

Ohne KarteOpenAI API
OrcaRouter
13 Modelle

BYOK-Router ohne Token-Aufschlag; die eigenen Fusion-Modelle und ausgewählte kostenlose Routen kosten nichts.

OpenAI API
NVIDIA Build
62 Modelle

Kostenlose serverlose Inferenz für Entwicklung und Prototyping mit Entwicklerkonto; nicht für Produktionstraffic gedacht.

Ohne KarteOpenAI API
TokenRouter
1 Modell

Kostenlose Modelle und Aktionszugänge können zeitlich begrenzt sein.

OpenAI API
Vercel AI Gateway
3 Modelle

Auch für Modelle zum Nullpreis muss eine Zahlungskarte hinterlegt sein.

Karte erforderlichOpenAI API
Nous Portal
7 Modelle

Der Portal-Tarif für $0 enthält :free-Modelle mit Standard-Rate-Limits.

Ohne KarteOpenAI API
UnoRouter
62 Modelle

Großer Katalog an :free-Routen ohne Karte; geteilte Kapazität und Limits pro Modell.

Ohne KarteOpenAI API

Kostenlose Software für diese Modelle

Agenten, IDEs und lokale Runner, die sich an kostenlose APIs anbinden lassen.

Alle 73 →

Kostenlose KI-Credits

Kostenlose API-Tarife plus Startup- und Studierendenprogramme.

Alle 39 →

FAQ

Gibt es kostenlose LLM-APIs?

Ja. Stand 26. September 2026 haben wir 212 Modelle mit kostenlosem API-Zugang bei 15 Anbieter gefunden. Das sind Modelle mit Token-Preisen von null, einem kostenlosen Entwicklertarif oder einem kostenlosen Kontingent.

Welches kostenlose API-Modell ist derzeit das stärkste?

Laut Artificial Analysis Intelligence Index führt derzeit GLM 5.3 (44.8) — kostenlos bei Together AI, NVIDIA Build. Das Ranking wird mit jeder Katalogaktualisierung neu berechnet.

Brauche ich eine Kreditkarte?

Nicht immer. Diese funktionieren zum Beispiel ohne Karte: OpenRouter, Groq, Google AI Studio, Cohere, Hugging Face, NVIDIA Build. Cerebras und Vercel AI Gateway verlangen auch für kostenlose Modelle eine Karte.

Wie oft werden die Daten aktualisiert?

Der Katalog fragt die Anbieter-APIs stündlich ab. Neue und entfernte kostenlose Modelle erscheinen im Bereich „Neue Modelle“ und im RSS-Feed.

Kann ich kostenlose Modelle in Cursor, Cline oder OpenCode nutzen?

Ja. Fast jeder Anbieter hier ist OpenAI-kompatibel: Tragen Sie die base URL des Anbieters, Ihren Schlüssel und die Modell-ID von der Modellkarte ein. Kompatible Apps finden Sie im Bereich „Kostenlose Software“.