LLM Perks

Kostenlose Modelle und APIs bei Together AI 2026

Together AI bietet eine einheitliche API für offene Modelle, darunter ausgewählte Modelle mit kostenlosem Zugang.

82 Modellebis zu 10.5M Kontextbeste: GLM 5.3Aktualisiert:

Together AI

Online bei der letzten Prüfung

Nur ausgewählte Modelle kosten nichts; eine allgemeine kostenlose Testphase gibt es nicht.

Base URL
https://api.together.xyz/v1
Kompatibilität
OpenAI Chat Completions
Karte
Beim Anbieter prüfen
Limits
Fair use (depends on server load)
98 gefunden
# Modell ↕ AA Index ↕ Kontext ↕ Größe ↕ Limit
1
GLM 5.3
zai-org/GLM-5.3-FP8
44.8 1M Sehr groß Fair use (depends on server load) Öffnen
2
GLM 5.3
zai-org/GLM-5.3-FP8-Lora
44.8 1M Sehr groß Fair use (depends on server load) Öffnen
3
GLM 5.2
zai-org/GLM-5.2-FP8
33.7 1M Sehr groß Fair use (depends on server load) Öffnen
4
GLM 5.2
zai-org/GLM-5.2-FP8-Lora
33.7 1M Sehr groß Fair use (depends on server load) Öffnen
5
Gemma 4 31B
google/gemma-4-31B-it-lora
19.0 262K Mittelgroß Fair use (depends on server load) Öffnen
6
GLM 4.7
zai-org/GLM-4.7-FP8
22.2 203K Sehr groß Fair use (depends on server load) Öffnen
7
Gemma 4 26B A4B
google/gemma-4-26B-A4B-it
16.7 262K Mittelgroß Fair use (depends on server load) Öffnen
8
Qwen 3.5 35B
Qwen/Qwen3.5-35B-A3B
19.3 262K Mittelgroß Fair use (depends on server load) Öffnen
9
Qwen 3.5 35B
Qwen/Qwen3.5-35B-A3B-Lora
19.3 262K Mittelgroß Fair use (depends on server load) Öffnen
10
Qwen 3.6 35B
Qwen/Qwen3.6-35B-A3B-FP8
18.2 262K Mittelgroß Fair use (depends on server load) Öffnen
11
Qwen 3.6 35B
Qwen/Qwen3.6-35B-A3B-Lora
18.2 262K Mittelgroß Fair use (depends on server load) Öffnen
12
Qwen 3.5 122B
Qwen/Qwen3.5-122B-A10B-FP8
17.7 262K Sehr groß Fair use (depends on server load) Öffnen
13
MiniMax M2
MiniMaxAI/MiniMax-M2
18.6 197K Sehr groß Fair use (depends on server load) Öffnen
14
Llama 4 Maverick Instruct Fp4
meta-llama/Llama-4-Maverick-17B-128E-Instruct-FP4
— 1M Sehr groß Fair use (depends on server load) Öffnen
15
Nemotron 3 Nano Omni
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning-fp8
10.3 131K Mittelgroß Fair use (depends on server load) Öffnen
16
Gemma 4 12B
google/gemma-4-12B-it
14.2 262K Mittelgroß Fair use (depends on server load) Öffnen
17
Qwen 3.5 9B
Qwen/Qwen3.5-9B-FP8
13.7 262K Klein Fair use (depends on server load) Öffnen
18
Qwen3 VL 235B
Qwen/Qwen3-VL-235B-A22B-Instruct-FP8
13.4 262K Sehr groß Fair use (depends on server load) Öffnen
19
Cogito V1 Preview Llama 70B
deepcogito/cogito-v1-preview-llama-70B
— 131K Sehr groß Fair use (depends on server load) Öffnen
20
Cogito V1 Preview Llama 70B
deepcogito/cogito-v1-preview-llama-70B-Turbo
— 131K Sehr groß Fair use (depends on server load) Öffnen
21
Meta Llama 3.1 70B
meta-llama/Meta-Llama-3.1-70B
— 131K Sehr groß Fair use (depends on server load) Öffnen
22
GLM 4.7 Fp4
zai-org/GLM-4.7-fp4
— 203K Sehr groß Fair use (depends on server load) Öffnen
23
GLM 5 Fp4
zai-org/GLM-5-FP4
— 203K Sehr groß Fair use (depends on server load) Öffnen
24
MiniMax M2.5 Fp4
MiniMaxAI/MiniMax-M2.5-FP4
— 8K Sehr groß Fair use (depends on server load) Öffnen
25
GLM Ocr
zai-org/GLM-OCR
— 131K Sehr groß Fair use (depends on server load) Öffnen
26
Nvidia Nemotron 3 Super
nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8
12.8 262K Sehr groß Fair use (depends on server load) Öffnen
27
Nvidia Nemotron 3 Super
nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16
12.8 262K Sehr groß Fair use (depends on server load) Öffnen
28
MiniMax M1 80K
MiniMaxAI/MiniMax-M1-80k
11.7 1M Sehr groß Fair use (depends on server load) Öffnen
29
Qwen3 235B
Qwen/Qwen3-235B-A22B-Instruct-2507-FP8
12.7 262K Sehr groß Fair use (depends on server load) Öffnen
30
Mistral Nemo
nim/nv-mistralai/mistral-nemo-12b-instruct
— 16K Mittelgroß Fair use (depends on server load) Öffnen
31
MiniMax M1 40K
MiniMaxAI/MiniMax-M1-40k
10.0 1M Sehr groß Fair use (depends on server load) Öffnen
32
Qwen3 Next 80B
Qwen/Qwen3-Next-80B-A3B-Instruct-FP8
11.2 — Sehr groß Fair use (depends on server load) Öffnen
33
Qwen3 30B
Qwen/Qwen3-30B-A3B
9.8 41K Mittelgroß Fair use (depends on server load) Öffnen
34
Qwen3 30B
Qwen/Qwen3-30B-A3B-Instruct-2507-Lora
9.8 262K Mittelgroß Fair use (depends on server load) Öffnen
35
Qwen3 Coder 30B
Qwen/Qwen3-Coder-30B-A3B-Instruct
9.6 262K Sehr groß Fair use (depends on server load) Öffnen
36
Llama 4 Scout
meta-llama/Llama-4-Scout-17B-16E
8.1 262K Sehr groß Fair use (depends on server load) Öffnen
37
Llama 4 Scout
meta-llama/Llama-4-Scout-17B-16E-Instruct-FP8-Lora
8.1 10.5M Sehr groß Fair use (depends on server load) Öffnen
38
Ternary Bonsai 27B
Prism-ML/Ternary-Bonsai-27B
— 262K Mittelgroß Fair use (depends on server load) Öffnen
39
Holo3 35B A3B
Hcompany/Holo3-35B-A3B
— 262K Mittelgroß Fair use (depends on server load) Öffnen
40
Llama 3.1 8B
nim/meta/llama-3.1-8b-instruct
6.9 16K Klein Fair use (depends on server load) Öffnen
41
Nvidia Nemotron 3 Nano
nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16
8.9 262K Mittelgroß Fair use (depends on server load) Öffnen
42
Qwen3 4B
Qwen/Qwen3-4B-Instruct-2507
8.8 262K Klein Fair use (depends on server load) Öffnen
43
Mixtral 8x7b Instruct V01
nim/mistralai/mixtral-8x7b-instruct-v01
— 16K Mittelgroß Fair use (depends on server load) Öffnen
44
Cogito V1 Preview Qwen 32B
deepcogito/cogito-v1-preview-qwen-32B
— 131K Mittelgroß Fair use (depends on server load) Öffnen
45
Cogito V1 Preview Qwen 14B
deepcogito/cogito-v1-preview-qwen-14B
— 131K Mittelgroß Fair use (depends on server load) Öffnen
46
Qwen2.5 14B
Qwen/Qwen2.5-14B
— 131K Mittelgroß Fair use (depends on server load) Öffnen
47
Deepcoder 14B Preview
agentica-org/DeepCoder-14B-Preview
— 131K Mittelgroß Fair use (depends on server load) Öffnen
48
Medgemma 27B Text
google/medgemma-27b-text-it
— 131K Mittelgroß Fair use (depends on server load) Öffnen
49
DeepSeek Ocr 2
deepseek-ai/DeepSeek-OCR-2
— 8K Mittelgroß Fair use (depends on server load) Öffnen
50
Llama 3.3 Nemotron Super 49B
nim/nvidia/llama-3.3-nemotron-super-49b-v1
8.9 16K Mittelgroß Fair use (depends on server load) Öffnen
51
Gemma 4 E4b
google/gemma-4-E4B-it
8.9 131K Klein Fair use (depends on server load) Öffnen
52
Devstral Small
mistralai/Devstral-Small-2505
8.7 131K Mittelgroß Fair use (depends on server load) Öffnen
53
Magistral Small
mistralai/Magistral-Small-2506
8.6 41K Mittelgroß Fair use (depends on server load) Öffnen
54
Qwen3 32B
Qwen/Qwen3-32B
8.6 41K Mittelgroß Fair use (depends on server load) Öffnen
55
Llama 3.2 11B Vision
nim/meta/llama-3.2-11b-vision-instruct
5.4 16K Mittelgroß Fair use (depends on server load) Öffnen
56
Qwen3 14B
Qwen/Qwen3-14B
8.2 2K Mittelgroß Fair use (depends on server load) Öffnen
57
Llama 3.2 90B Vision
nim/meta/llama-3.2-90b-vision-instruct
6.4 16K Sehr groß Fair use (depends on server load) Öffnen
58
Qwen 3.5 2B
Qwen/Qwen3.5-2B-Lora
6.9 262K Klein Fair use (depends on server load) Öffnen
59
Gemma 4 E2b
google/gemma-4-E2B-it
7.8 131K Klein Fair use (depends on server load) Öffnen
60
Llama 3.3 70B
nim/meta/llama-3.3-70b-instruct
7.7 16K Sehr groß Fair use (depends on server load) Öffnen
61
Llama 3.3 70B
meta-llama/Llama-3.3-70B-Instruct
7.7 131K Sehr groß Fair use (depends on server load) Öffnen
62
Qwen2.5 72B
Qwen/Qwen2.5-72B
7.7 131K Sehr groß Fair use (depends on server load) Öffnen
63
Llama 3.3 70B
meta-llama/Llama-3.3-70B-Instruct-FP8-Lora
7.7 131K Sehr groß Fair use (depends on server load) Öffnen
64
GLM 4 5v
zai-org/GLM-4.5V
7.6 66K Sehr groß Fair use (depends on server load) Öffnen
65
Mixtral 8x22b
mistralai/Mixtral-8x22B-Instruct-v0.1
— 66K Sehr groß Fair use (depends on server load) Öffnen
66
Llama 3.1 405B
meta-llama/Llama-3.1-405B
7.3 131K Sehr groß Fair use (depends on server load) Öffnen
67
Qwen3 8B
Qwen/Qwen3-8B
7.3 41K Klein Fair use (depends on server load) Öffnen
68
Qwen3 8B
Qwen/Qwen3-8B-Lora
7.3 41K Klein Fair use (depends on server load) Öffnen
69
Qwen2.5 32B
Qwen/Qwen2.5-32B
6.9 131K Mittelgroß Fair use (depends on server load) Öffnen
70
Qwen2.5 32B
Qwen/Qwen2.5-32B-Instruct
6.9 33K Mittelgroß Fair use (depends on server load) Öffnen
71
Llama 3.1 70B
nim/meta/llama-3.1-70b-instruct
6.6 16K Sehr groß Fair use (depends on server load) Öffnen
72
Gemma 3 4B
google/gemma-3-4b-it
4.8 66K Klein Fair use (depends on server load) Öffnen
73
Mixtral 8x22b Instruct V01
nim/mistralai/mixtral-8x22b-instruct-v01
— 16K Sehr groß Fair use (depends on server load) Öffnen
74
Molmo 7B D 0924
allenai/Molmo-7B-D-0924
5.6 4K Klein Fair use (depends on server load) Öffnen
75
Sarvam M
sarvamai/sarvam-m
5.3 33K Klein Fair use (depends on server load) Öffnen
76
Qwen 3.1 7B
Qwen/Qwen3-1.7B
5.2 41K Klein Fair use (depends on server load) Öffnen
77
Gemma 3 270M
google/gemma-3-270m-it
5.1 33K Klein Fair use (depends on server load) Öffnen
78
Gemma 3 270M
google/gemma-3-270m-it-lora
5.1 33K Klein Fair use (depends on server load) Öffnen
79
DeepSeek R1 Distill Qwen 7B
deepseek-ai/DeepSeek-R1-Distill-Qwen-7B
— 131K Klein Fair use (depends on server load) Öffnen
80
Cogito V1 Preview Llama 8B
deepcogito/cogito-v1-preview-llama-8B
— 131K Klein Fair use (depends on server load) Öffnen
81
Qwen2.5 3B
Qwen/Qwen2.5-3B-Instruct
— 33K Klein Fair use (depends on server load) Öffnen
82
Qwen2.5 1 5B
Qwen/Qwen2.5-1.5B-Instruct
— 33K Klein Fair use (depends on server load) Öffnen
83
Qwen2.5 7B
Qwen/Qwen2.5-7B
— 131K Klein Fair use (depends on server load) Öffnen
84
Qwen2.5 1 5B
Qwen/Qwen2.5-1.5B
— 131K Klein Fair use (depends on server load) Öffnen
85
Qwen2.5 7B
Qwen/Qwen2.5-7B-Instruct
— 33K Klein Fair use (depends on server load) Öffnen
86
Meta Llama 3.1 8B
togethercomputer/meta-llama-3.1-8B-Instruct-AWQ-INT4
— 131K Klein Fair use (depends on server load) Öffnen
87
EssentialAI Rnj-1 Instruct
togethercomputer/EssentialAI-RNJ-1-Instruct
— 33K Klein Fair use (depends on server load) Öffnen
88
Gemma 3 27B
google/gemma-3-27b-it
4.9 66K Mittelgroß Fair use (depends on server load) Öffnen
89
Gemma 3 27B
google/gemma-3-27b-it-lora
4.9 — Mittelgroß Fair use (depends on server load) Öffnen
90
Gemma 3 1B
google/gemma-3-1b-it
4.8 33K Klein Fair use (depends on server load) Öffnen
91
Llama 3.2 1B
meta-llama/Llama-3.2-1B
4.8 131K Klein Fair use (depends on server load) Öffnen
92
Qwen 3.0 6B
Qwen/Qwen3-0.6B
4.8 41K Klein Fair use (depends on server load) Öffnen
93
Mistral 7B
mistralai/Mistral-7B-v0.1
5.0 33K Klein Fair use (depends on server load) Öffnen
94
Llama 3.1 Nemotron 70B
nim/nvidia/llama-3.1-nemotron-70b-instruct
6.9 16K Sehr groß Fair use (depends on server load) Öffnen
95
Gemma 2B
google/gemma-2b-it
— 8K Klein Fair use (depends on server load) Öffnen
96
Mixtral 8x7b
mistralai/Mixtral-8x7B-Instruct-v0.1-FP8-Lora
5.1 33K Mittelgroß Fair use (depends on server load) Öffnen
97
Llama 2 7B
meta-llama/Llama-2-7b-chat-hf
— 4K Klein Fair use (depends on server load) Öffnen
98
Gemma 2 9B
google/gemma-2-9b-it
— 8K Klein Fair use (depends on server load) Öffnen

Benchmarks: Artificial Analysis (24. September 2026). Ein Strich bedeutet, dass das Modell nicht in deren Rangliste steht; wir schätzen Werte nie selbst.

FAQ

Ist Together AI kostenlos?

Nur ausgewählte Modelle kosten nichts; eine allgemeine kostenlose Testphase gibt es nicht. 98 Modelle sind derzeit kostenlos.

Ist Together AI mit der OpenAI API kompatibel?

Ja — nutzen Sie die base URL https://api.together.xyz/v1 mit einem beliebigen OpenAI-kompatiblen Client oder SDK.

Verlangt Together AI eine Karte?

Das hängt vom Konto ab — prüfen Sie das Dashboard des Anbieters.

Siehe auch