Free models for AI agents
Updated:
A curated list for autonomous and assisted AI agents: planning, tool use, long-context analysis, and multi-step tasks.
Read more
The list favors strong reasoning and instruct models. Also verify structured output, function calling, and free-tier reliability with the selected API provider.
95 models
🚀 39 powerful
⚖️ 56 balanced
⚡ 0 lightweight
| № | Model | Provider | Parameters | Context | Limit | Status | |
|---|---|---|---|---|---|---|---|
| 1 | ⚖️ NVIDIA: Nemotron 3.5 Content Safety (free)nvidia/nemotron-3.5-content-safety:free | OpenRouter | ? | 128K | Free tier | Online | Open |
| 2 | 🚀 NVIDIA: Nemotron 3 Ultra (free)nvidia/nemotron-3-ultra-550b-a55b:free | OpenRouter | 550B | 1.0M | Free tier | Online | Open |
| 3 | ⚖️ NVIDIA: Nemotron 3 Nano Omni (free)nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free | OpenRouter | 30B | 256K | Free tier | Online | Open |
| 4 | 🚀 NVIDIA: Nemotron 3 Super (free)nvidia/nemotron-3-super-120b-a12b:free | OpenRouter | 120B | 262K | Free tier | Online | Open |
| 5 | ⚖️ NVIDIA: Nemotron 3 Nano 30B A3B (free)nvidia/nemotron-3-nano-30b-a3b:free | OpenRouter | 30B | 256K | Free tier | Online | Open |
| 6 | ⚖️ NVIDIA: Nemotron Nano 12B 2 VL (free)nvidia/nemotron-nano-12b-v2-vl:free | OpenRouter | 12B | 128K | Free tier | Online | Open |
| 7 | 🚀 LLaMA 3.3 70B Versatilellama-3.3-70b-versatile | Groq | 70B | 131K | 1,000 req/day | Online | Open |
| 8 | ⚖️ Qwen3.6 27bqwen/qwen3.6-27b | Groq | 27B | 131K | 14,400 req/day | Online | Open |
| 9 | ⚖️ Gemini 2.0 Flashgemini-2.0-flash | Google Gemini | ? | 1.0M | 1,500 req/day | Online | Open |
| 10 | ⚖️ Gemini 2.0 Flash Litegemini-2.0-flash-lite | Google Gemini | ? | 1.0M | 1,500 req/day | Online | Open |
| 11 | ⚖️ Gemini 1.5 Flashgemini-1.5-flash | Google Gemini | ? | 1.0M | 1,500 req/day | Online | Open |
| 12 | 🚀 Gemini 1.5 Progemini-1.5-pro | Google Gemini | ? | 2.1M | 50 req/day | Online | Open |
| 13 | ⚖️ Mistral Smallmistral-small-latest | Mistral AI | ? | 33K | 1 req/min · 500 tok/min | Cached | Open |
| 14 | ⚖️ Mistral Nemoopen-mistral-nemo | Mistral AI | ? | 131K | 1 req/min · 500 tok/min | Cached | Open |
| 15 | ⚖️ Mistral Embedmistral-embed | Mistral AI | ? | 8K | 1 req/min · 500 tok/min | Cached | Open |
| 16 | 🚀 nim/meta/llama-3.2-90b-vision-instructnim/meta/llama-3.2-90b-vision-instruct | Together AI | 90B | 16K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 17 | ⚖️ nim/mistralai/mixtral-8x22b-instruct-v01nim/mistralai/mixtral-8x22b-instruct-v01 | Together AI | ? | 16K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 18 | 🚀 nim/meta/llama-3.3-70b-instructnim/meta/llama-3.3-70b-instruct | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 19 | 🚀 nim/nvidia/llama-3.1-nemotron-70b-instructnim/nvidia/llama-3.1-nemotron-70b-instruct | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 20 | 🚀 nim/meta/llama-3.1-70b-instructnim/meta/llama-3.1-70b-instruct | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 21 | ⚖️ nim/nv-mistralai/mistral-nemo-12b-instructnim/nv-mistralai/mistral-nemo-12b-instruct | Together AI | 12B | 16K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 22 | ⚖️ nim/mistralai/mixtral-8x7b-instruct-v01nim/mistralai/mixtral-8x7b-instruct-v01 | Together AI | ? | 16K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 23 | ⚖️ nim/nvidia/llama-3.3-nemotron-super-49b-v1nim/nvidia/llama-3.3-nemotron-super-49b-v1 | Together AI | 49B | 16K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 24 | ⚖️ Cogito V1 Preview Qwen 32Bdeepcogito/cogito-v1-preview-qwen-32B | Together AI | 32B | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 25 | ⚖️ Cogito V1 Preview Qwen 14Bdeepcogito/cogito-v1-preview-qwen-14B | Together AI | 14B | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 26 | 🚀 Cogito V1 Preview Llama 70Bdeepcogito/cogito-v1-preview-llama-70B | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 27 | 🚀 Cogito V1 Preview Llama 70B Turbodeepcogito/cogito-v1-preview-llama-70B-Turbo | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 28 | 🚀 Meta Llama 3.3 70B Instructmeta-llama/Llama-3.3-70B-Instruct | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 29 | ⚖️ Qwen2.5 32BQwen/Qwen2.5-32B | Together AI | 32B | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 30 | 🚀 Qwen2.5 72BQwen/Qwen2.5-72B | Together AI | 72B | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 31 | ⚖️ Qwen2.5 14BQwen/Qwen2.5-14B | Together AI | 14B | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 32 | 🚀 Llama 3.1 70Bmeta-llama/Meta-Llama-3.1-70B | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 33 | ⚖️ Qwen2.5 32B InstructQwen/Qwen2.5-32B-Instruct | Together AI | 32B | 33K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 34 | 🚀 Llama 3.1 405Bmeta-llama/Llama-3.1-405B | Together AI | 405B | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 35 | ⚖️ Devstral Small 2505mistralai/Devstral-Small-2505 | Together AI | ? | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 36 | ⚖️ Mixtral 8X22b Instruct V0.1mistralai/Mixtral-8x22B-Instruct-v0.1 | Together AI | ? | 66K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 37 | ⚖️ Qwen3 14BQwen/Qwen3-14B | Together AI | 14B | 2K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 38 | ⚖️ Qwen3 30B A3bQwen/Qwen3-30B-A3B | Together AI | 30B | 41K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 39 | ⚖️ Llama 4 Scout (17Bx16E)meta-llama/Llama-4-Scout-17B-16E | Together AI | 17B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 40 | ⚖️ Magistral Small 2506mistralai/Magistral-Small-2506 | Together AI | ? | 41K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 41 | ⚖️ Qwen3 32BQwen/Qwen3-32B | Together AI | 32B | 41K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 42 | 🚀 Qwen3 235B A22b Instruct 2507 Fp8Qwen/Qwen3-235B-A22B-Instruct-2507-FP8 | Together AI | 235B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 43 | ⚖️ Qwen3 Coder 30B A3b InstructQwen/Qwen3-Coder-30B-A3B-Instruct | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 44 | 🚀 Qwen3 Next 80B A3b Instruct Fp8Qwen/Qwen3-Next-80B-A3B-Instruct-FP8 | Together AI | 80B | 4K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 45 | 🚀 Qwen3-VL-235B-A22B-Instruct-FP8Qwen/Qwen3-VL-235B-A22B-Instruct-FP8 | Together AI | 235B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 46 | ⚖️ Nvidia Nemotron 3 Nano 30B A3b Bf16nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 47 | ⚖️ Qwen3.5 35B A3bQwen/Qwen3.5-35B-A3B | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 48 | 🚀 Nvidia Nemotron 3 Super 120B A12b Fp8nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8 | Together AI | 120B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 49 | ⚖️ Deepseek OCR 2deepseek-ai/DeepSeek-OCR-2 | Together AI | ? | 8K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 50 | 🚀 Qwen3.5 122B A10b Fp8Qwen/Qwen3.5-122B-A10B-FP8 | Together AI | 122B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 51 | ⚖️ Qwen3 30B A3B Instruct 2507 LoraQwen/Qwen3-30B-A3B-Instruct-2507-Lora | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 52 | 🚀 Nvidia Nemotron 3 Super 120B A12b Bf16nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16 | Together AI | 120B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 53 | ⚖️ Qwen3.6 35B A3b Fp8Qwen/Qwen3.6-35B-A3B-FP8 | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 54 | ⚖️ Nemotron 3 Nano Omni 30B A3b Reasoning Fp8nvidia/nemotron-3-nano-omni-30b-a3b-reasoning-fp8 | Together AI | 30B | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 55 | 🚀 Llama 3.3 70B Instruct FP8 Lorameta-llama/Llama-3.3-70B-Instruct-FP8-Lora | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 56 | ⚖️ Mixtral 8x7B Instruct V0.1 FP8 Loramistralai/Mixtral-8x7B-Instruct-v0.1-FP8-Lora | Together AI | ? | 33K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 57 | ⚖️ Llama 4 Scout 17B 16E Instruct Fp8 Lorameta-llama/Llama-4-Scout-17B-16E-Instruct-FP8-Lora | Together AI | 17B | 10.5M | Fair Use (По мере нагрузки серверов) | Online | Open |
| 58 | ⚖️ Llama 4 Maverick 17B 128E Instruct Nvfp4meta-llama/Llama-4-Maverick-17B-128E-Instruct-FP4 | Together AI | 17B | 1.0M | Fair Use (По мере нагрузки серверов) | Online | Open |
| 59 | ⚖️ Qwen3.5 35B A3B LoraQwen/Qwen3.5-35B-A3B-Lora | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 60 | ⚖️ Qwen3.6 35B A3B LoraQwen/Qwen3.6-35B-A3B-Lora | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Online | Open |
| 61 | ⚖️ Qwen 1.5 14B Chat@cf/qwen/qwen1.5-14b-chat-cp | Cloudflare | 14B | 33K | 10,000 req/day | Cached | Open |
| 62 | 🚀 Google: Nano Banana Pro (Gemini 3 Pro Image Preview)google/gemini-3-pro-image-preview | OrcaRouter | ? | 66K | Free tier | Online | Open |
| 63 | ⚖️ Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)google/gemini-3.1-flash-image-preview | OrcaRouter | ? | 66K | Free tier | Online | Open |
| 64 | 🚀 Codellama 70bmeta/codellama-70b | NVIDIA Build | 70B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 65 | ⚖️ Codestral 22b Instruct V0.1mistralai/codestral-22b-instruct-v0.1 | NVIDIA Build | 22B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 66 | 🚀 Deepseek V4 Flashdeepseek-ai/deepseek-v4-flash | NVIDIA Build | ? | 131K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 67 | 🚀 Deepseek V4 Prodeepseek-ai/deepseek-v4-pro | NVIDIA Build | ? | 131K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 68 | ⚖️ Granite 34b Code Instructibm/granite-34b-code-instruct | NVIDIA Build | 34B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 69 | 🚀 Jamba 1.5 Large Instructai21labs/jamba-1.5-large-instruct | NVIDIA Build | ? | 262K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 70 | 🚀 LLAMA 3.1 70b Instructmeta/llama-3.1-70b-instruct | NVIDIA Build | 70B | 131K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 71 | ⚖️ LLAMA 3.1 Nemotron 51b Instructnvidia/llama-3.1-nemotron-51b-instruct | NVIDIA Build | 51B | 131K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 72 | 🚀 LLAMA 3.1 Nemotron 70b Instructnvidia/llama-3.1-nemotron-70b-instruct | NVIDIA Build | 70B | 131K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 73 | 🚀 LLAMA 3.1 Nemotron Ultra 253b V1nvidia/llama-3.1-nemotron-ultra-253b-v1 | NVIDIA Build | 253B | 131K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 74 | 🚀 LLAMA 3.2 90b Vision Instructmeta/llama-3.2-90b-vision-instruct | NVIDIA Build | 90B | 131K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 75 | 🚀 LLAMA 3.3 70b Instructmeta/llama-3.3-70b-instruct | NVIDIA Build | 70B | 131K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 76 | ⚖️ LLAMA 3.3 Nemotron Super 49b V1nvidia/llama-3.3-nemotron-super-49b-v1 | NVIDIA Build | 49B | 131K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 77 | ⚖️ LLAMA 3.3 Nemotron Super 49b V1.5nvidia/llama-3.3-nemotron-super-49b-v1.5 | NVIDIA Build | 49B | 131K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 78 | 🚀 Llama2 70bmeta/llama2-70b | NVIDIA Build | 70B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 79 | 🚀 Llama3 Chatqa 1.5 70bnvidia/llama3-chatqa-1.5-70b | NVIDIA Build | 70B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 80 | 🚀 Mistral Largemistralai/mistral-large | NVIDIA Build | ? | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 81 | 🚀 Mistral Large 2 Instructmistralai/mistral-large-2-instruct | NVIDIA Build | ? | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 82 | 🚀 Mistral Medium 3.5 128bmistralai/mistral-medium-3.5-128b | NVIDIA Build | 128B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 83 | ⚖️ Mistral Nemo 12b Instructnv-mistralai/mistral-nemo-12b-instruct | NVIDIA Build | 12B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 84 | ⚖️ Mistral Nemotronmistralai/mistral-nemotron | NVIDIA Build | ? | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 85 | ⚖️ Mixtral 8x22b V0.1mistralai/mixtral-8x22b-v0.1 | NVIDIA Build | ? | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 86 | ⚖️ Nemotron 3 Nano 30b A3bnvidia/nemotron-3-nano-30b-a3b | NVIDIA Build | 30B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 87 | ⚖️ Nemotron 3 Nano Omni 30b A3b Reasoningnvidia/nemotron-3-nano-omni-30b-a3b-reasoning | NVIDIA Build | 30B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 88 | 🚀 Nemotron 3 Super 120b A12bnvidia/nemotron-3-super-120b-a12b | NVIDIA Build | 120B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 89 | 🚀 Nemotron 3 Ultra 550b A55bnvidia/nemotron-3-ultra-550b-a55b | NVIDIA Build | 550B | 1.0M | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 90 | 🚀 Nemotron 4 340b Instructnvidia/nemotron-4-340b-instruct | NVIDIA Build | 340B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 91 | ⚖️ Nemotron Nano 12b V2 VLnvidia/nemotron-nano-12b-v2-vl | NVIDIA Build | 12B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 92 | ⚖️ Nemotron Nano 3 30b A3bnvidia/nemotron-nano-3-30b-a3b | NVIDIA Build | 30B | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 93 | ⚖️ Phi 3 Vision 128k Instructmicrosoft/phi-3-vision-128k-instruct | NVIDIA Build | ? | 131K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 94 | ⚖️ Phi 3.5 Moe Instructmicrosoft/phi-3.5-moe-instruct | NVIDIA Build | ? | 33K | Free serverless inference for development; limits and model availability may change. | Online | Open |
| 95 | ⚖️ Nemotron 3 Nano Omni 30b A3b Reasoning:Freenvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free | TokenRouter | 30B | 33K | Free models and promotional access may be time-limited; availability is checked through the Models API. | Online | Open |