Free models for AI agents
Updated:
A curated list for autonomous and assisted AI agents: planning, tool use, long-context analysis, and multi-step tasks.
Read more
The list favors strong reasoning and instruct models. Also verify structured output, function calling, and free-tier reliability with the selected API provider.
114 models found
| № | Model | Power | Provider | Parameters | Context | Limit | |
|---|---|---|---|---|---|---|---|
| 1 |
|
⚖️ | OpenRouter | ? | 1.0M | Free tier | Open |
| 2 |
|
⚖️ | OpenRouter | ? | 128K | Free tier | Open |
| 3 |
|
🚀 | OpenRouter | 550B | 1.0M | Free tier | Open |
| 4 |
|
⚖️ | OpenRouter | 30B | 256K | Free tier | Open |
| 5 |
|
🚀 | OpenRouter | 120B | 262K | Free tier | Open |
| 6 |
|
⚖️ | Groq | 27B | 131K | 14,400 req/day | Open |
| 7 |
|
⚖️ | Google Gemini | ? | 1.0M | 1,500 req/day | Open |
| 8 |
|
⚖️ | Google Gemini | ? | 1.0M | 1,500 req/day | Open |
| 9 |
|
⚖️ | Google Gemini | ? | 1.0M | 1,500 req/day | Open |
| 10 |
|
🚀 | Google Gemini | ? | 2.1M | 50 req/day | Open |
| 11 |
|
⚖️ | Mistral AI | ? | 33K | 1 req/min · 500 tok/min | Open |
| 12 |
|
⚖️ | Mistral AI | ? | 131K | 1 req/min · 500 tok/min | Open |
| 13 |
|
⚖️ | Mistral AI | ? | 8K | 1 req/min · 500 tok/min | Open |
| 14 |
nim/meta/llama-3.2-90b-vision-instruct
|
🚀 | Together AI | 90B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 15 |
|
⚖️ | Together AI | ? | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 16 |
nim/meta/llama-3.3-70b-instruct
|
🚀 | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 17 |
nim/nvidia/llama-3.1-nemotron-70b-instruct
|
🚀 | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 18 |
nim/meta/llama-3.1-70b-instruct
|
🚀 | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 19 |
|
⚖️ | Together AI | 12B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 20 |
|
⚖️ | Together AI | ? | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 21 |
nim/nvidia/llama-3.3-nemotron-super-49b-v1
|
⚖️ | Together AI | 49B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 22 |
|
⚖️ | Together AI | 32B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 23 |
|
⚖️ | Together AI | 14B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 24 |
Cogito V1 Preview Llama 70B
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 25 |
Cogito V1 Preview Llama 70B Turbo
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 26 |
Meta Llama 3.3 70B Instruct
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 27 |
|
⚖️ | Together AI | 32B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 28 |
|
🚀 | Together AI | 72B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 29 |
|
⚖️ | Together AI | 14B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 30 |
Llama 3.1 70B
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 31 |
|
⚖️ | Together AI | 32B | 33K | Fair Use (По мере нагрузки серверов) | Open |
| 32 |
Llama 3.1 405B
|
🚀 | Together AI | 405B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 33 |
|
⚖️ | Together AI | ? | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 34 |
|
⚖️ | Together AI | ? | 66K | Fair Use (По мере нагрузки серверов) | Open |
| 35 |
|
⚖️ | Together AI | 14B | 2K | Fair Use (По мере нагрузки серверов) | Open |
| 36 |
|
⚖️ | Together AI | 30B | 41K | Fair Use (По мере нагрузки серверов) | Open |
| 37 |
Llama 4 Scout (17Bx16E)
|
⚖️ | Together AI | 17B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 38 |
|
⚖️ | Together AI | ? | 41K | Fair Use (По мере нагрузки серверов) | Open |
| 39 |
|
⚖️ | Together AI | 32B | 41K | Fair Use (По мере нагрузки серверов) | Open |
| 40 |
|
🚀 | Together AI | 235B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 41 |
|
⚖️ | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 42 |
|
🚀 | Together AI | 80B | ? | Fair Use (По мере нагрузки серверов) | Open |
| 43 |
|
🚀 | Together AI | 235B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 44 |
|
⚖️ | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 45 |
|
⚖️ | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 46 |
|
🚀 | Together AI | 120B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 47 |
Deepseek OCR 2
|
⚖️ | Together AI | ? | 8K | Fair Use (По мере нагрузки серверов) | Open |
| 48 |
|
🚀 | Together AI | 122B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 49 |
|
⚖️ | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 50 |
|
🚀 | Together AI | 120B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 51 |
|
⚖️ | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 52 |
|
⚖️ | Together AI | 30B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 53 |
Llama 3.3 70B Instruct FP8 Lora
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 54 |
|
⚖️ | Together AI | ? | 33K | Fair Use (По мере нагрузки серверов) | Open |
| 55 |
Llama 4 Scout 17B 16E Instruct Fp8 Lora
|
⚖️ | Together AI | 17B | 10.5M | Fair Use (По мере нагрузки серверов) | Open |
| 56 |
Llama 4 Maverick 17B 128E Instruct Nvfp4
|
⚖️ | Together AI | 17B | 1.0M | Fair Use (По мере нагрузки серверов) | Open |
| 57 |
|
⚖️ | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 58 |
|
⚖️ | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 59 |
|
⚖️ | Cerebras | 27B | ? | 14,400 req/day · 30 req/min | Open |
| 60 |
|
⚖️ | Cloudflare | 14B | 33K | 10,000 req/day | Open |
| 61 |
DeepSeek: DeepSeek V4 Flash (Free)
|
🚀 | OrcaRouter | ? | ? | Free tier | Open |
| 62 |
|
🚀 | OrcaRouter | ? | 66K | Free tier | Open |
| 63 |
|
⚖️ | OrcaRouter | ? | 66K | Free tier | Open |
| 64 | Codellama 70b | 🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 65 |
|
⚖️ | NVIDIA Build | 22B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 66 |
Deepseek V4 Flash 0731
|
🚀 | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 67 | Granite 34b Code Instruct | ⚖️ | NVIDIA Build | 34B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 68 |
|
🚀 | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 69 |
LLAMA 3.1 Nemotron 51b Instruct
|
⚖️ | NVIDIA Build | 51B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 70 |
LLAMA 3.1 Nemotron 70b Instruct
|
🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 71 |
LLAMA 3.1 Nemotron Ultra 253b V1
|
🚀 | NVIDIA Build | 253B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 72 |
LLAMA 3.2 90b Vision Instruct
|
🚀 | NVIDIA Build | 90B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 73 | Llama2 70b | 🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 74 |
|
🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 75 |
|
🚀 | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 76 |
|
🚀 | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 77 |
|
⚖️ | NVIDIA Build | 12B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 78 |
|
⚖️ | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 79 |
|
⚖️ | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 80 |
|
⚖️ | NVIDIA Build | 30B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 81 |
|
🚀 | NVIDIA Build | 120B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 82 |
|
🚀 | NVIDIA Build | 550B | 1.0M | Free serverless inference for development; limits and model availability may change. | Open |
| 83 |
|
⚖️ | NVIDIA Build | 30B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 84 |
|
🚀 | NVIDIA Build | 340B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 85 |
|
⚖️ | NVIDIA Build | 30B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 86 |
|
⚖️ | NVIDIA Build | ? | 131K | Free serverless inference for development; limits and model availability may change. | Open |
| 87 |
|
⚖️ | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 88 |
|
⚖️ | TokenRouter | 30B | ? | Free models and promotional access may be time-limited; availability is checked through the Models API. | Open |
| 89 |
Deepseek R1 Distill Llama 70b
|
🚀 | UnoRouter | 70B | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 90 |
Deepseek V4 Flash 0731
|
🚀 | UnoRouter | ? | 1.0M | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 91 |
Deepseek V4 Pro
|
🚀 | UnoRouter | ? | 1.0M | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 92 |
|
⚖️ | UnoRouter | ? | 1.0M | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 93 |
|
⚖️ | UnoRouter | ? | 1.0M | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 94 |
|
⚖️ | UnoRouter | ? | 1.0M | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 95 |
|
⚖️ | UnoRouter | ? | 1.0M | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 96 |
|
⚖️ | UnoRouter | ? | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 97 |
Llama 3.2 90b Vision
|
🚀 | UnoRouter | 90B | 128K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 98 |
Llama 4 Maverick 17b 128e Instruct
|
⚖️ | UnoRouter | 17B | 128K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 99 |
|
🚀 | UnoRouter | 675B | 256K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 100 |
|
⚖️ | UnoRouter | ? | 128K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 101 |
|
⚖️ | UnoRouter | ? | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 102 |
|
⚖️ | UnoRouter | 30B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 103 |
|
🚀 | UnoRouter | 120B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 104 |
|
🚀 | UnoRouter | 550B | 1.0M | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 105 |
|
⚖️ | UnoRouter | ? | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 106 |
|
⚖️ | UnoRouter | 30B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 107 |
|
⚖️ | UnoRouter | 12B | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 108 |
|
⚖️ | UnoRouter | 32B | 33K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 109 |
|
⚖️ | UnoRouter | 27B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 110 | Qwen3 Next 80b A3b Instruct | 🚀 | UnoRouter | 80B | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 111 | Qwen3.5 122b A10b | 🚀 | UnoRouter | 122B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 112 | Qwen3.6 35b A3b | ⚖️ | UnoRouter | 35B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 113 | Qwen3.8 27b | ⚖️ | UnoRouter | 27B | 66K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 114 | Typhoon V2.5 30b A3b Instruct | ⚖️ | UnoRouter | 30B | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
nim/meta/llama-3.2-90b-vision-instruct
Deepseek OCR 2