LLM Perks

Llama — free API

Updated:

Open Meta Llama models with free API access, from fast compact models to powerful 70B+ variants.

Read more

The list is built from current provider API responses. The same model may appear more than once because each endpoint has its own limits, context window, and free-tier rules. Individual model pages use stable URLs and update automatically.

32 models found

Power
Model Power Provider Parameters Context Limit
1 nim/meta/llama-3.2-11b-vision-instructnim/meta/llama-3.2-11b-vision-instruct Together AI 11B 16K Fair Use (По мере нагрузки серверов) Open
2 nim/meta/llama-3.2-90b-vision-instructnim/meta/llama-3.2-90b-vision-instruct 🚀 Together AI 90B 16K Fair Use (По мере нагрузки серверов) Open
3 nim/meta/llama-3.3-70b-instructnim/meta/llama-3.3-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Open
4 nim/nvidia/llama-3.1-nemotron-70b-instructnim/nvidia/llama-3.1-nemotron-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Open
5 nim/meta/llama-3.1-8b-instructnim/meta/llama-3.1-8b-instruct Together AI 8B 16K Fair Use (По мере нагрузки серверов) Open
6 nim/meta/llama-3.1-70b-instructnim/meta/llama-3.1-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Open
7 nim/nvidia/llama-3.3-nemotron-super-49b-v1nim/nvidia/llama-3.3-nemotron-super-49b-v1 ⚖️ Together AI 49B 16K Fair Use (По мере нагрузки серверов) Open
8 meta-llama/Llama-2-7b-chat-hfmeta-llama/Llama-2-7b-chat-hf Together AI 7B 4K Fair Use (По мере нагрузки серверов) Open
9 Cogito V1 Preview Llama 8Bdeepcogito/cogito-v1-preview-llama-8B Together AI 8B 131K Fair Use (По мере нагрузки серверов) Open
10 Cogito V1 Preview Llama 70Bdeepcogito/cogito-v1-preview-llama-70B 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
11 Cogito V1 Preview Llama 70B Turbodeepcogito/cogito-v1-preview-llama-70B-Turbo 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
12 Meta Llama 3.3 70B Instructmeta-llama/Llama-3.3-70B-Instruct 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
13 Llama 3.1 70Bmeta-llama/Meta-Llama-3.1-70B 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
14 Llama 3.2 1Bmeta-llama/Llama-3.2-1B Together AI 1B 131K Fair Use (По мере нагрузки серверов) Open
15 Llama 3.1 405Bmeta-llama/Llama-3.1-405B 🚀 Together AI 405B 131K Fair Use (По мере нагрузки серверов) Open
16 Llama 4 Scout (17Bx16E)meta-llama/Llama-4-Scout-17B-16E ⚖️ Together AI 17B 262K Fair Use (По мере нагрузки серверов) Open
17 Meta Llama 3.1 8B Instruct Awq Int4togethercomputer/meta-llama-3.1-8B-Instruct-AWQ-INT4 Together AI 8B 131K Fair Use (По мере нагрузки серверов) Open
18 Llama 3.3 70B Instruct FP8 Lorameta-llama/Llama-3.3-70B-Instruct-FP8-Lora 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
19 Llama 4 Scout 17B 16E Instruct Fp8 Lorameta-llama/Llama-4-Scout-17B-16E-Instruct-FP8-Lora ⚖️ Together AI 17B 10.5M Fair Use (По мере нагрузки серверов) Open
20 Llama 4 Maverick 17B 128E Instruct Nvfp4meta-llama/Llama-4-Maverick-17B-128E-Instruct-FP4 ⚖️ Together AI 17B 1.0M Fair Use (По мере нагрузки серверов) Open
21 Llama 3.1 8B Instruct@cf/meta/llama-3.1-8b-instruct Cloudflare 8B 131K 10,000 req/day Open
22 Llama 3.1 8Bmeta-llama/Llama-3.1-8B-Instruct HuggingFace 8B 128K Fair Use (По мере нагрузки серверов) Open
23 Codellama 70bmeta/codellama-70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
24 LLAMA 3.1 Nemotron 51b Instructnvidia/llama-3.1-nemotron-51b-instruct ⚖️ NVIDIA Build 51B ? Free serverless inference for development; limits and model availability may change. Open
25 LLAMA 3.1 Nemotron 70b Instructnvidia/llama-3.1-nemotron-70b-instruct 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
26 LLAMA 3.1 Nemotron Ultra 253b V1nvidia/llama-3.1-nemotron-ultra-253b-v1 🚀 NVIDIA Build 253B ? Free serverless inference for development; limits and model availability may change. Open
27 LLAMA 3.2 11b Vision Instructmeta/llama-3.2-11b-vision-instruct NVIDIA Build 11B ? Free serverless inference for development; limits and model availability may change. Open
28 LLAMA 3.2 90b Vision Instructmeta/llama-3.2-90b-vision-instruct 🚀 NVIDIA Build 90B ? Free serverless inference for development; limits and model availability may change. Open
29 Llama2 70bmeta/llama2-70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
30 Llama3 Chatqa 1.5 70bnvidia/llama3-chatqa-1.5-70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
31 Llama 3.2 11b Visionllama-3.2-11b-vision:free UnoRouter 11B 128K No-card free models use shared capacity and per-model limits; availability can change. Open
32 Llama 4 Maverick 17b 128e Instructllama-4-maverick-17b-128e-instruct:free ⚖️ UnoRouter 17B 128K No-card free models use shared capacity and per-model limits; availability can change. Open