LLM Perks

Kostenlose APIs für Open-Weight-Modelle

Open-Weight-Modelle, die Sie kostenlos per API aufrufen und bei Bedarf ohne Anbieterbindung auf eigener Hardware betreiben können.

125 Modelle11 Anbieterbis zu 10.5M Kontextbeste: GLM 5.3Aktualisiert:
Weiterlesen

Offene Gewichte bedeuten, dass die Parameter veröffentlicht sind, die Lizenzen unterscheiden sich aber: Llama und Gemma haben eigene Bedingungen, während DeepSeek, Qwen und gpt-oss freizügiger sind. Prüfen Sie die Lizenz vor kommerzieller Nutzung.

Größe
125 gefunden
# Modell ↕ AA Index ↕ GPQA ↕ Kontext ↕ Größe ↕ Kostenlos bei ↕
1
GLM 5.3
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
44.8 92% 1M Sehr groß Together AI, NVIDIA Build
2
Kimi K3
Moonshot AI
VisionReasoningCodingTool-NutzungOffene Gewichte
43.6 94% 1M Sehr groß NVIDIA Build, UnoRouter
3
GLM 5.3 Flash
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
41.8 91% 1M Mittelgroß OrcaRouter, NVIDIA Build, UnoRouter
4
DeepSeek V4.1 Flash
DeepSeek
ReasoningCodingTool-NutzungOffene Gewichte
39.5 — 1M Sehr groß NVIDIA Build, UnoRouter
5
Qwen3.8 27B
Alibaba Cloud · 27B
ReasoningCodingTool-NutzungOffene Gewichte
33.7 91% 262K Mittelgroß OpenRouter, Groq, Cloudflare Workers AI, UnoRouter
6
DeepSeek V4 Pro
DeepSeek
ReasoningCodingTool-NutzungOffene Gewichte
36.0 93% 1M Sehr groß UnoRouter
7
GLM 5.2
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
33.7 90% 1M Sehr groß Together AI
8
DeepSeek V4 Flash
DeepSeek
ReasoningCodingTool-NutzungOffene Gewichte
34.3 91% — Sehr groß OrcaRouter
9
Inkling Small
Thinking Machines Lab
ReasoningOffene Gewichte
27.8 90% 1M Klein OpenRouter
10
Qwen 3.6 Plus
Alibaba Cloud · New
ReasoningCodingTool-NutzungOffene Gewichte
27.0 88% 1M Sehr groß UnoRouter
11
Nemotron 3 Ultra
NVIDIA · 550B · 55B
ReasoningCodingTool-NutzungOffene Gewichte
22.9 87% 1M Sehr groß OpenRouter, NVIDIA Build, UnoRouter
12
Inkling
Thinking Machines Lab
ReasoningOffene Gewichte
25.0 87% 1M Klein OpenRouter
13
Kimi K2.6
Moonshot AI
ReasoningCodingTool-NutzungOffene Gewichte
27.0 91% — Sehr groß NVIDIA Build
14
Hy3
Tencent
Offene Gewichte
25.3 90% — Klein OrcaRouter
15
Ling 3.0 Flash Fin
inclusionAI (Ant Group)
Offene Gewichte
22.6 — 262K Klein Nous Portal
16
Gemma 4 31B
Google DeepMind · 31B
VisionTool-NutzungOffene Gewichte
19.0 86% 262K Mittelgroß OpenRouter, Together AI, NVIDIA Build
17
Gemma 4 26B A4B
Google DeepMind · 26B · 4B
VisionTool-NutzungOffene Gewichte
16.7 79% 262K Mittelgroß OpenRouter, Together AI, Cloudflare Workers AI, UnoRouter
18
GLM 4.7
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
22.2 86% 203K Sehr groß Together AI
19
LongCat 2.0
Meituan
ReasoningTool-NutzungOffene Gewichte
19.1 78% 1M Sehr groß Nous Portal
20
Step 3.7 Flash
StepFun
ReasoningOffene Gewichte
19.5 81% 262K Klein Nous Portal
21
Qwen 3.5 35B
Alibaba Cloud · 35B · 3B
ReasoningCodingTool-NutzungOffene Gewichte
19.3 85% 262K Mittelgroß Together AI
22
Qwen 3.5 122B
Alibaba Cloud · 122B · 10B
ReasoningCodingTool-NutzungOffene Gewichte
17.7 83% 262K Sehr groß Together AI, UnoRouter
23
Qwen 3.6 35B
Alibaba Cloud · 35B · 3B
ReasoningCodingTool-NutzungOffene Gewichte
18.2 84% 262K Mittelgroß Together AI
24
MiniMax M2
MiniMax · 230B · 10B
ReasoningCodingTool-NutzungOffene Gewichte
18.6 78% 197K Sehr groß Together AI
25
Nemotron 3.5 Lightning
NVIDIA · 30B · 3B
ReasoningTool-NutzungOffene Gewichte
12.9 74% 1M Mittelgroß OpenRouter, NVIDIA Build, UnoRouter
26
Nemotron 3 Super
NVIDIA · 120B · 12B
ReasoningCodingTool-NutzungOffene Gewichte
12.8 80% 262K Sehr groß OpenRouter, NVIDIA Build, UnoRouter
27
GLM 4.7 Flash
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
14.9 58% 131K Mittelgroß Cloudflare Workers AI, UnoRouter
28
Llama 4 Maverick Instruct Fp4
Meta · 400B · 17B
VisionTool-NutzungOffene Gewichte
— — 1M Sehr groß Together AI
29
LongCat 2.5 Preview
Meituan · New
ReasoningTool-NutzungOffene Gewichte
— — 1M Sehr groß Nous Portal
30
Nemotron 3 Nano Omni
NVIDIA · 30B · 3B
VisionReasoningTool-NutzungOffene Gewichte
10.3 47% 262K Mittelgroß +1OpenRouter, Together AI, NVIDIA Build, TokenRouter, UnoRouter
31
Gemma 4 12B
Google DeepMind · 12B
VisionTool-NutzungOffene Gewichte
14.2 75% 262K Mittelgroß Together AI
32
Nemotron 3 120B
NVIDIA · 120B · 12B · New
ReasoningTool-NutzungOffene Gewichte
— — 256K Sehr groß Cloudflare Workers AI
33
Mistral Large 3 675B
Mistral AI · 675B
CodingTool-NutzungOffene Gewichte
— — 256K Sehr groß UnoRouter
34
Qwen 3.5 9B
Alibaba Cloud · 9B
ReasoningCodingOffene Gewichte
13.7 81% 262K Klein Together AI
35
gpt-oss-120b
OpenAI · 117B · 5.1B
ReasoningCodingTool-NutzungOffene Gewichte
11.6 78% 131K Sehr groß Groq, Cloudflare Workers AI, UnoRouter
36
gpt-oss-20b
OpenAI · 21B · 3.6B
ReasoningTool-NutzungOffene Gewichte
10.0 61% 131K Mittelgroß Groq, Cloudflare Workers AI, NVIDIA Build, UnoRouter
37
Qwen3 VL 235B
Alibaba Cloud · 235B · 22B
VisionReasoningTool-NutzungOffene Gewichte
13.4 77% 262K Sehr groß Together AI
38
Qwen 3.5 4B
Alibaba Cloud · 4B
ReasoningCodingOffene Gewichte
13.1 77% 262K Klein UnoRouter
39
Cogito V1 Preview Llama 70B
Meta · 70B
Tool-NutzungOffene Gewichte
— — 131K Sehr groß Together AI
40
Meta Llama 3.1 70B
Meta · 70B
Tool-NutzungOffene Gewichte
— — 131K Sehr groß Together AI
41
GLM 4.7 Fp4
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
— — 203K Sehr groß Together AI
42
GLM 5 Fp4
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
— — 203K Sehr groß Together AI
43
MiniMax M2.5 Fp4
MiniMax
ReasoningCodingTool-NutzungOffene Gewichte
— — 8K Sehr groß Together AI
44
GLM Ocr
Z.ai (Zhipu AI)
Tool-NutzungOffene Gewichte
— — 131K Sehr groß Together AI
45
Llama 3.3 70B Instruct Fp8 Fast
Meta · 70B · New
Tool-NutzungOffene Gewichte
— — 24K Sehr groß Cloudflare Workers AI
46
Nvidia Nemotron 3 Super
NVIDIA · 120B · 12B
ReasoningCodingTool-NutzungOffene Gewichte
12.8 80% 262K Sehr groß Together AI
47
MiniMax M1 80K
MiniMax
ReasoningTool-NutzungOffene Gewichte
11.7 70% 1M Sehr groß Together AI
48
Qwen3 235B
Alibaba Cloud · 235B · 22B
ReasoningCodingTool-NutzungOffene Gewichte
12.7 79% 262K Sehr groß Together AI
49
Qwen3 Next 80B
Alibaba Cloud · 80B · 3B
ReasoningCodingTool-NutzungOffene Gewichte
11.2 76% 131K Sehr groß Together AI, UnoRouter
50
North Mini Code
Cohere
CodingOffene Gewichte
9.9 76% 262K Klein OpenRouter, UnoRouter
51
Qwen3 30B
Alibaba Cloud · 30B · 3B
ReasoningTool-NutzungOffene Gewichte
9.8 71% 262K Mittelgroß Together AI, Cloudflare Workers AI
52
Mistral Nemo
Mistral AI · 12B
Tool-NutzungOffene Gewichte
— — 131K Mittelgroß Mistral AI, Together AI, NVIDIA Build
53
MiniMax M1 40K
MiniMax
ReasoningTool-NutzungOffene Gewichte
10.0 68% 1M Sehr groß Together AI
54
Llama 4 Scout
Meta · 109B · 17B
VisionTool-NutzungOffene Gewichte
8.1 59% 10.5M Sehr groß Together AI, Cloudflare Workers AI
55
QwQ 32B
Alibaba Cloud · 32B
ReasoningTool-NutzungOffene Gewichte
9.5 59% 131K Mittelgroß Cloudflare Workers AI, UnoRouter
56
GLM 5.3 Flash Search
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
— — 1M Mittelgroß UnoRouter
57
Qwen3 Coder 30B
Alibaba Cloud · 30B · 3B
ReasoningCodingTool-NutzungOffene Gewichte
9.6 52% 262K Sehr groß Together AI
58
Ling 3.0 Flash Sante
inclusionAI (Ant Group)
Offene Gewichte
— — 262K Klein OpenRouter, Vercel AI Gateway, Nous Portal, UnoRouter
59
DiffusionGemma 26B
Google DeepMind · 26B · 4B
Tool-NutzungOffene Gewichte
9.5 67% 262K Mittelgroß UnoRouter
60
Llama 4 Maverick
Meta · 400B · 17B
VisionTool-NutzungOffene Gewichte
10.0 67% 131K Sehr groß UnoRouter
61
Qwen SEA-LION V4.5 27B
Alibaba Cloud · 27B
Tool-NutzungOffene Gewichte
— — 262K Mittelgroß UnoRouter
62
LFM2.5-2.6B
Liquid AI · 2.6B
Offene Gewichte
8.4 56% 128K Klein OpenRouter, UnoRouter
63
Llama 3.2 11B Vision
Meta · 11B
VisionTool-NutzungOffene Gewichte
5.4 22% 131K Mittelgroß Together AI, Cloudflare Workers AI, NVIDIA Build, UnoRouter
64
Nvidia Nemotron 3 Nano
NVIDIA · 30B · 3B
ReasoningTool-NutzungOffene Gewichte
8.9 76% 262K Mittelgroß Together AI
65
DeepSeek R1 Distill Qwen 32B
DeepSeek · 32B
ReasoningTool-NutzungOffene Gewichte
8.4 62% 80K Mittelgroß Cloudflare Workers AI, UnoRouter
66
Qwen3 4B
Alibaba Cloud · 4B
ReasoningOffene Gewichte
8.8 67% 262K Klein Together AI
67
Mixtral 8x7b Instruct V01
Mistral AI · 46.7B · 12.9B
Tool-NutzungOffene Gewichte
— — 16K Mittelgroß Together AI
68
Cogito V1 Preview Qwen 32B
Alibaba Cloud · 32B
Tool-NutzungOffene Gewichte
— — 131K Mittelgroß Together AI
69
Cogito V1 Preview Qwen 14B
Alibaba Cloud · 14B
Tool-NutzungOffene Gewichte
— — 131K Mittelgroß Together AI
70
Qwen2.5 14B
Alibaba Cloud · 14B
Tool-NutzungOffene Gewichte
— — 131K Mittelgroß Together AI
71
Medgemma 27B Text
Google DeepMind · 27B
Tool-NutzungOffene Gewichte
— — 131K Mittelgroß Together AI
72
DeepSeek Ocr 2
DeepSeek
Tool-NutzungOffene Gewichte
— — 8K Mittelgroß Together AI
73
Gemma SEA-LION V4 27B
Google DeepMind · 27B · New
Tool-NutzungOffene Gewichte
— — 128K Mittelgroß Cloudflare Workers AI
74
Mistral Small 3.1 24B
Mistral AI · 24B · New
Tool-NutzungOffene Gewichte
— — 128K Mittelgroß Cloudflare Workers AI
75
Mistral Nemotron
Mistral AI · 12B
Tool-NutzungOffene Gewichte
— — 128K Mittelgroß UnoRouter
76
Qwen SEA-LION V4 32B
Alibaba Cloud · 32B
Tool-NutzungOffene Gewichte
— — 33K Mittelgroß UnoRouter
77
Qwen3
Alibaba Cloud
ReasoningTool-NutzungOffene Gewichte
— — 25K Mittelgroß UnoRouter
78
Llama 3.3 Nemotron Super 49B
NVIDIA · 49B
Tool-NutzungOffene Gewichte
8.9 64% 16K Mittelgroß Together AI
79
Gemma 4 E4b
Google DeepMind
VisionOffene Gewichte
8.9 58% 131K Klein Together AI
80
Nemotron 3 Nano
NVIDIA · 30B · 3B
Tool-NutzungOffene Gewichte
8.9 76% — Mittelgroß NVIDIA Build
81
Devstral Small
Mistral AI
CodingTool-NutzungOffene Gewichte
8.7 43% 131K Mittelgroß Together AI
82
Magistral Small
Mistral AI
ReasoningTool-NutzungOffene Gewichte
8.6 66% 41K Mittelgroß Together AI
83
Qwen3 32B
Alibaba Cloud · 32B
ReasoningTool-NutzungOffene Gewichte
8.6 67% 41K Mittelgroß Together AI
84
Llama 3.1 8B
Meta · 8B
Offene Gewichte
6.9 26% 32K Klein Together AI, Cloudflare Workers AI
85
Mistral Small
Mistral AI · 24B
Tool-NutzungOffene Gewichte
5.8 38% 256K Mittelgroß Mistral AI, UnoRouter
86
Qwen3 14B
Alibaba Cloud · 14B
ReasoningTool-NutzungOffene Gewichte
8.2 60% 2K Mittelgroß Together AI
87
Qwen2.5 Coder 32B
Alibaba Cloud · 32B
CodingTool-NutzungOffene Gewichte
6.7 42% 131K Mittelgroß Cloudflare Workers AI, UnoRouter
88
Llama 3.2 90B Vision
Meta · 90B
VisionTool-NutzungOffene Gewichte
6.4 43% 16K Sehr groß Together AI, NVIDIA Build
89
Qwen 3.5 2B
Alibaba Cloud · 2B
ReasoningCodingOffene Gewichte
6.9 46% 262K Klein Together AI
90
Gemma 4 E2b
Google DeepMind
VisionOffene Gewichte
7.8 43% 131K Klein Together AI
91
Llama 3.3 70B
Meta · 70B
Tool-NutzungOffene Gewichte
7.7 50% 131K Sehr groß Together AI
92
Qwen2.5 72B
Alibaba Cloud · 72B
Tool-NutzungOffene Gewichte
7.7 49% 131K Sehr groß Together AI
93
GLM 4 5v
Z.ai (Zhipu AI)
ReasoningCodingTool-NutzungOffene Gewichte
7.6 68% 66K Sehr groß Together AI
94
Llama 3.1 Nemotron Ultra 253B
NVIDIA · 253B
Tool-NutzungOffene Gewichte
7.5 73% — Sehr groß NVIDIA Build
95
Nemotron Nano 12B V2 VL
NVIDIA · 12B
VisionTool-NutzungOffene Gewichte
7.5 57% 131K Mittelgroß UnoRouter
96
Nemotron Nano 9B V2
NVIDIA · 9B
Offene Gewichte
7.4 57% 131K Klein UnoRouter
97
Llama 3.1 405B
Meta · 405B
Tool-NutzungOffene Gewichte
7.3 52% 131K Sehr groß Together AI
98
Qwen3 8B
Alibaba Cloud · 8B
ReasoningOffene Gewichte
7.3 59% 41K Klein Together AI
99
Qwen2.5 32B
Alibaba Cloud · 32B
Tool-NutzungOffene Gewichte
6.9 47% 131K Mittelgroß Together AI
100
Llama 3.1 70B
Meta · 70B
Tool-NutzungOffene Gewichte
6.6 41% 16K Sehr groß Together AI
101
Gemma 3 4B
Google DeepMind · 4B
VisionOffene Gewichte
4.8 29% 66K Klein Together AI, NVIDIA Build
102
Llama 3.2 1B
Meta · 1B
Offene Gewichte
4.8 20% 131K Klein Together AI, Cloudflare Workers AI
103
Ling 3.1 Flash
inclusionAI (Ant Group) · New
Offene Gewichte
— — 262K Klein Vercel AI Gateway
104
Llama 3.2 3B
Meta · 3B · New
Offene Gewichte
5.7 26% 80K Klein Cloudflare Workers AI
105
Molmo 7B D 0924
7B
Offene Gewichte
5.6 24% 4K Klein Together AI
106
Sarvam M
Offene Gewichte
5.3 42% 33K Klein Together AI
107
Qwen 3.1 7B
Alibaba Cloud · 1.7B
ReasoningOffene Gewichte
5.2 36% 41K Klein Together AI
108
Gemma 3 270M
Google DeepMind · 270M
Offene Gewichte
5.1 22% 33K Klein Together AI
109
Granite 4.0 Micro
IBM
Offene Gewichte
5.1 34% 131K Klein UnoRouter
110
DeepSeek R1 Distill Qwen 7B
DeepSeek · 7B
ReasoningOffene Gewichte
— — 131K Klein Together AI
111
Cogito V1 Preview Llama 8B
Meta · 8B
Offene Gewichte
— — 131K Klein Together AI
112
Qwen2.5 3B
Alibaba Cloud · 3B
Offene Gewichte
— — 33K Klein Together AI
113
Qwen2.5 1 5B
Alibaba Cloud · 1.5B
Offene Gewichte
— — 131K Klein Together AI
114
Qwen2.5 7B
Alibaba Cloud · 7B
Offene Gewichte
— — 131K Klein Together AI
115
Meta Llama 3.1 8B
Meta · 8B
Offene Gewichte
— — 131K Klein Together AI
116
Granite 4.0 H Micro
IBM · New
Offene Gewichte
— — 131K Klein Cloudflare Workers AI
117
Gemma 7B
Google DeepMind · 7B · New
Offene Gewichte
— — 4K Klein Cloudflare Workers AI
118
Mistral Nemo Minitron 8B 8K
Mistral AI · 8B
Offene Gewichte
— — 8K Klein NVIDIA Build
119
Qwen2.5 VL 7B
Alibaba Cloud · 7B
VisionOffene Gewichte
— — 131K Klein UnoRouter
120
Gemma 3 27B
Google DeepMind · 27B
VisionTool-NutzungOffene Gewichte
4.9 43% 66K Mittelgroß Together AI
121
Gemma 3 1B
Google DeepMind · 1B
Offene Gewichte
4.8 24% 33K Klein Together AI
122
Qwen 3.0 6B
Alibaba Cloud · 600M
Offene Gewichte
4.8 23% 41K Klein Together AI
123
Gemma 3 12B
Google DeepMind · 12B
VisionTool-NutzungOffene Gewichte
3.8 35% — Mittelgroß NVIDIA Build
124
Nemotron 3.5 Content Safety
NVIDIA · Moderation
Offene Gewichte
— — 128K Mittelgroß OpenRouter
125
gpt-oss-safeguard-20b
OpenAI · 21B · 3.6B · Moderation
Offene Gewichte
— — 131K Mittelgroß UnoRouter

Benchmarks: Artificial Analysis (30. September 2026). Ein Strich bedeutet, dass das Modell nicht in deren Rangliste steht; wir schätzen Werte nie selbst.

FAQ

Welche open-weight-modelle sind gerade kostenlos?

125 Modelle sind gerade kostenlos. Spitzenreiter nach dem Artificial-Analysis-Index: GLM 5.3, Kimi K3, GLM 5.3 Flash, DeepSeek V4.1 Flash, Qwen3.8 27B, DeepSeek V4 Pro.

Wo kann ich GLM 5.3 kostenlos nutzen?

GLM 5.3 ist kostenlos bei Together AI, NVIDIA Build. Jeder Anbieter ist OpenAI-kompatibel — ändern Sie einfach die Base URL und den Schlüssel.

Welche Limits hat der kostenlose Zugang?

Offene Gewichte bedeuten, dass die Parameter veröffentlicht sind, die Lizenzen unterscheiden sich aber: Llama und Gemma haben eigene Bedingungen, während DeepSeek, Qwen und gpt-oss freizügiger sind. Prüfen Sie die Lizenz vor kommerzieller Nutzung.

Siehe auch