Free models for AI agents

Updated:

A curated list for autonomous and assisted AI agents: planning, tool use, long-context analysis, and multi-step tasks.

Read more

The list favors strong reasoning and instruct models. Also verify structured output, function calling, and free-tier reliability with the selected API provider.

95 models
🚀 39 powerful
⚖️ 56 balanced
⚡ 0 lightweight
Model Provider Parameters Context Limit Status
1 ⚖️ NVIDIA: Nemotron 3.5 Content Safety (free)nvidia/nemotron-3.5-content-safety:free OpenRouter ? 128K Free tier Online Open
2 🚀 NVIDIA: Nemotron 3 Ultra (free)nvidia/nemotron-3-ultra-550b-a55b:free OpenRouter 550B 1.0M Free tier Online Open
3 ⚖️ NVIDIA: Nemotron 3 Nano Omni (free)nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free OpenRouter 30B 256K Free tier Online Open
4 🚀 NVIDIA: Nemotron 3 Super (free)nvidia/nemotron-3-super-120b-a12b:free OpenRouter 120B 262K Free tier Online Open
5 ⚖️ NVIDIA: Nemotron 3 Nano 30B A3B (free)nvidia/nemotron-3-nano-30b-a3b:free OpenRouter 30B 256K Free tier Online Open
6 ⚖️ NVIDIA: Nemotron Nano 12B 2 VL (free)nvidia/nemotron-nano-12b-v2-vl:free OpenRouter 12B 128K Free tier Online Open
7 🚀 LLaMA 3.3 70B Versatilellama-3.3-70b-versatile Groq 70B 131K 1,000 req/day Online Open
8 ⚖️ Qwen3.6 27bqwen/qwen3.6-27b Groq 27B 131K 14,400 req/day Online Open
9 ⚖️ Gemini 2.0 Flashgemini-2.0-flash Google Gemini ? 1.0M 1,500 req/day Online Open
10 ⚖️ Gemini 2.0 Flash Litegemini-2.0-flash-lite Google Gemini ? 1.0M 1,500 req/day Online Open
11 ⚖️ Gemini 1.5 Flashgemini-1.5-flash Google Gemini ? 1.0M 1,500 req/day Online Open
12 🚀 Gemini 1.5 Progemini-1.5-pro Google Gemini ? 2.1M 50 req/day Online Open
13 ⚖️ Mistral Smallmistral-small-latest Mistral AI ? 33K 1 req/min · 500 tok/min Cached Open
14 ⚖️ Mistral Nemoopen-mistral-nemo Mistral AI ? 131K 1 req/min · 500 tok/min Cached Open
15 ⚖️ Mistral Embedmistral-embed Mistral AI ? 8K 1 req/min · 500 tok/min Cached Open
16 🚀 nim/meta/llama-3.2-90b-vision-instructnim/meta/llama-3.2-90b-vision-instruct Together AI 90B 16K Fair Use (По мере нагрузки серверов) Online Open
17 ⚖️ nim/mistralai/mixtral-8x22b-instruct-v01nim/mistralai/mixtral-8x22b-instruct-v01 Together AI ? 16K Fair Use (По мере нагрузки серверов) Online Open
18 🚀 nim/meta/llama-3.3-70b-instructnim/meta/llama-3.3-70b-instruct Together AI 70B 16K Fair Use (По мере нагрузки серверов) Online Open
19 🚀 nim/nvidia/llama-3.1-nemotron-70b-instructnim/nvidia/llama-3.1-nemotron-70b-instruct Together AI 70B 16K Fair Use (По мере нагрузки серверов) Online Open
20 🚀 nim/meta/llama-3.1-70b-instructnim/meta/llama-3.1-70b-instruct Together AI 70B 16K Fair Use (По мере нагрузки серверов) Online Open
21 ⚖️ nim/nv-mistralai/mistral-nemo-12b-instructnim/nv-mistralai/mistral-nemo-12b-instruct Together AI 12B 16K Fair Use (По мере нагрузки серверов) Online Open
22 ⚖️ nim/mistralai/mixtral-8x7b-instruct-v01nim/mistralai/mixtral-8x7b-instruct-v01 Together AI ? 16K Fair Use (По мере нагрузки серверов) Online Open
23 ⚖️ nim/nvidia/llama-3.3-nemotron-super-49b-v1nim/nvidia/llama-3.3-nemotron-super-49b-v1 Together AI 49B 16K Fair Use (По мере нагрузки серверов) Online Open
24 ⚖️ Cogito V1 Preview Qwen 32Bdeepcogito/cogito-v1-preview-qwen-32B Together AI 32B 131K Fair Use (По мере нагрузки серверов) Online Open
25 ⚖️ Cogito V1 Preview Qwen 14Bdeepcogito/cogito-v1-preview-qwen-14B Together AI 14B 131K Fair Use (По мере нагрузки серверов) Online Open
26 🚀 Cogito V1 Preview Llama 70Bdeepcogito/cogito-v1-preview-llama-70B Together AI 70B 131K Fair Use (По мере нагрузки серверов) Online Open
27 🚀 Cogito V1 Preview Llama 70B Turbodeepcogito/cogito-v1-preview-llama-70B-Turbo Together AI 70B 131K Fair Use (По мере нагрузки серверов) Online Open
28 🚀 Meta Llama 3.3 70B Instructmeta-llama/Llama-3.3-70B-Instruct Together AI 70B 131K Fair Use (По мере нагрузки серверов) Online Open
29 ⚖️ Qwen2.5 32BQwen/Qwen2.5-32B Together AI 32B 131K Fair Use (По мере нагрузки серверов) Online Open
30 🚀 Qwen2.5 72BQwen/Qwen2.5-72B Together AI 72B 131K Fair Use (По мере нагрузки серверов) Online Open
31 ⚖️ Qwen2.5 14BQwen/Qwen2.5-14B Together AI 14B 131K Fair Use (По мере нагрузки серверов) Online Open
32 🚀 Llama 3.1 70Bmeta-llama/Meta-Llama-3.1-70B Together AI 70B 131K Fair Use (По мере нагрузки серверов) Online Open
33 ⚖️ Qwen2.5 32B InstructQwen/Qwen2.5-32B-Instruct Together AI 32B 33K Fair Use (По мере нагрузки серверов) Online Open
34 🚀 Llama 3.1 405Bmeta-llama/Llama-3.1-405B Together AI 405B 131K Fair Use (По мере нагрузки серверов) Online Open
35 ⚖️ Devstral Small 2505mistralai/Devstral-Small-2505 Together AI ? 131K Fair Use (По мере нагрузки серверов) Online Open
36 ⚖️ Mixtral 8X22b Instruct V0.1mistralai/Mixtral-8x22B-Instruct-v0.1 Together AI ? 66K Fair Use (По мере нагрузки серверов) Online Open
37 ⚖️ Qwen3 14BQwen/Qwen3-14B Together AI 14B 2K Fair Use (По мере нагрузки серверов) Online Open
38 ⚖️ Qwen3 30B A3bQwen/Qwen3-30B-A3B Together AI 30B 41K Fair Use (По мере нагрузки серверов) Online Open
39 ⚖️ Llama 4 Scout (17Bx16E)meta-llama/Llama-4-Scout-17B-16E Together AI 17B 262K Fair Use (По мере нагрузки серверов) Online Open
40 ⚖️ Magistral Small 2506mistralai/Magistral-Small-2506 Together AI ? 41K Fair Use (По мере нагрузки серверов) Online Open
41 ⚖️ Qwen3 32BQwen/Qwen3-32B Together AI 32B 41K Fair Use (По мере нагрузки серверов) Online Open
42 🚀 Qwen3 235B A22b Instruct 2507 Fp8Qwen/Qwen3-235B-A22B-Instruct-2507-FP8 Together AI 235B 262K Fair Use (По мере нагрузки серверов) Online Open
43 ⚖️ Qwen3 Coder 30B A3b InstructQwen/Qwen3-Coder-30B-A3B-Instruct Together AI 30B 262K Fair Use (По мере нагрузки серверов) Online Open
44 🚀 Qwen3 Next 80B A3b Instruct Fp8Qwen/Qwen3-Next-80B-A3B-Instruct-FP8 Together AI 80B 4K Fair Use (По мере нагрузки серверов) Online Open
45 🚀 Qwen3-VL-235B-A22B-Instruct-FP8Qwen/Qwen3-VL-235B-A22B-Instruct-FP8 Together AI 235B 262K Fair Use (По мере нагрузки серверов) Online Open
46 ⚖️ Nvidia Nemotron 3 Nano 30B A3b Bf16nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 Together AI 30B 262K Fair Use (По мере нагрузки серверов) Online Open
47 ⚖️ Qwen3.5 35B A3bQwen/Qwen3.5-35B-A3B Together AI 35B 262K Fair Use (По мере нагрузки серверов) Online Open
48 🚀 Nvidia Nemotron 3 Super 120B A12b Fp8nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8 Together AI 120B 262K Fair Use (По мере нагрузки серверов) Online Open
49 ⚖️ Deepseek OCR 2deepseek-ai/DeepSeek-OCR-2 Together AI ? 8K Fair Use (По мере нагрузки серверов) Online Open
50 🚀 Qwen3.5 122B A10b Fp8Qwen/Qwen3.5-122B-A10B-FP8 Together AI 122B 262K Fair Use (По мере нагрузки серверов) Online Open
51 ⚖️ Qwen3 30B A3B Instruct 2507 LoraQwen/Qwen3-30B-A3B-Instruct-2507-Lora Together AI 30B 262K Fair Use (По мере нагрузки серверов) Online Open
52 🚀 Nvidia Nemotron 3 Super 120B A12b Bf16nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16 Together AI 120B 262K Fair Use (По мере нагрузки серверов) Online Open
53 ⚖️ Qwen3.6 35B A3b Fp8Qwen/Qwen3.6-35B-A3B-FP8 Together AI 35B 262K Fair Use (По мере нагрузки серверов) Online Open
54 ⚖️ Nemotron 3 Nano Omni 30B A3b Reasoning Fp8nvidia/nemotron-3-nano-omni-30b-a3b-reasoning-fp8 Together AI 30B 131K Fair Use (По мере нагрузки серверов) Online Open
55 🚀 Llama 3.3 70B Instruct FP8 Lorameta-llama/Llama-3.3-70B-Instruct-FP8-Lora Together AI 70B 131K Fair Use (По мере нагрузки серверов) Online Open
56 ⚖️ Mixtral 8x7B Instruct V0.1 FP8 Loramistralai/Mixtral-8x7B-Instruct-v0.1-FP8-Lora Together AI ? 33K Fair Use (По мере нагрузки серверов) Online Open
57 ⚖️ Llama 4 Scout 17B 16E Instruct Fp8 Lorameta-llama/Llama-4-Scout-17B-16E-Instruct-FP8-Lora Together AI 17B 10.5M Fair Use (По мере нагрузки серверов) Online Open
58 ⚖️ Llama 4 Maverick 17B 128E Instruct Nvfp4meta-llama/Llama-4-Maverick-17B-128E-Instruct-FP4 Together AI 17B 1.0M Fair Use (По мере нагрузки серверов) Online Open
59 ⚖️ Qwen3.5 35B A3B LoraQwen/Qwen3.5-35B-A3B-Lora Together AI 35B 262K Fair Use (По мере нагрузки серверов) Online Open
60 ⚖️ Qwen3.6 35B A3B LoraQwen/Qwen3.6-35B-A3B-Lora Together AI 35B 262K Fair Use (По мере нагрузки серверов) Online Open
61 ⚖️ Qwen 1.5 14B Chat@cf/qwen/qwen1.5-14b-chat-cp Cloudflare 14B 33K 10,000 req/day Cached Open
62 🚀 Google: Nano Banana Pro (Gemini 3 Pro Image Preview)google/gemini-3-pro-image-preview OrcaRouter ? 66K Free tier Online Open
63 ⚖️ Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)google/gemini-3.1-flash-image-preview OrcaRouter ? 66K Free tier Online Open
64 🚀 Codellama 70bmeta/codellama-70b NVIDIA Build 70B 33K Free serverless inference for development; limits and model availability may change. Online Open
65 ⚖️ Codestral 22b Instruct V0.1mistralai/codestral-22b-instruct-v0.1 NVIDIA Build 22B 33K Free serverless inference for development; limits and model availability may change. Online Open
66 🚀 Deepseek V4 Flashdeepseek-ai/deepseek-v4-flash NVIDIA Build ? 131K Free serverless inference for development; limits and model availability may change. Online Open
67 🚀 Deepseek V4 Prodeepseek-ai/deepseek-v4-pro NVIDIA Build ? 131K Free serverless inference for development; limits and model availability may change. Online Open
68 ⚖️ Granite 34b Code Instructibm/granite-34b-code-instruct NVIDIA Build 34B 33K Free serverless inference for development; limits and model availability may change. Online Open
69 🚀 Jamba 1.5 Large Instructai21labs/jamba-1.5-large-instruct NVIDIA Build ? 262K Free serverless inference for development; limits and model availability may change. Online Open
70 🚀 LLAMA 3.1 70b Instructmeta/llama-3.1-70b-instruct NVIDIA Build 70B 131K Free serverless inference for development; limits and model availability may change. Online Open
71 ⚖️ LLAMA 3.1 Nemotron 51b Instructnvidia/llama-3.1-nemotron-51b-instruct NVIDIA Build 51B 131K Free serverless inference for development; limits and model availability may change. Online Open
72 🚀 LLAMA 3.1 Nemotron 70b Instructnvidia/llama-3.1-nemotron-70b-instruct NVIDIA Build 70B 131K Free serverless inference for development; limits and model availability may change. Online Open
73 🚀 LLAMA 3.1 Nemotron Ultra 253b V1nvidia/llama-3.1-nemotron-ultra-253b-v1 NVIDIA Build 253B 131K Free serverless inference for development; limits and model availability may change. Online Open
74 🚀 LLAMA 3.2 90b Vision Instructmeta/llama-3.2-90b-vision-instruct NVIDIA Build 90B 131K Free serverless inference for development; limits and model availability may change. Online Open
75 🚀 LLAMA 3.3 70b Instructmeta/llama-3.3-70b-instruct NVIDIA Build 70B 131K Free serverless inference for development; limits and model availability may change. Online Open
76 ⚖️ LLAMA 3.3 Nemotron Super 49b V1nvidia/llama-3.3-nemotron-super-49b-v1 NVIDIA Build 49B 131K Free serverless inference for development; limits and model availability may change. Online Open
77 ⚖️ LLAMA 3.3 Nemotron Super 49b V1.5nvidia/llama-3.3-nemotron-super-49b-v1.5 NVIDIA Build 49B 131K Free serverless inference for development; limits and model availability may change. Online Open
78 🚀 Llama2 70bmeta/llama2-70b NVIDIA Build 70B 33K Free serverless inference for development; limits and model availability may change. Online Open
79 🚀 Llama3 Chatqa 1.5 70bnvidia/llama3-chatqa-1.5-70b NVIDIA Build 70B 33K Free serverless inference for development; limits and model availability may change. Online Open
80 🚀 Mistral Largemistralai/mistral-large NVIDIA Build ? 33K Free serverless inference for development; limits and model availability may change. Online Open
81 🚀 Mistral Large 2 Instructmistralai/mistral-large-2-instruct NVIDIA Build ? 33K Free serverless inference for development; limits and model availability may change. Online Open
82 🚀 Mistral Medium 3.5 128bmistralai/mistral-medium-3.5-128b NVIDIA Build 128B 33K Free serverless inference for development; limits and model availability may change. Online Open
83 ⚖️ Mistral Nemo 12b Instructnv-mistralai/mistral-nemo-12b-instruct NVIDIA Build 12B 33K Free serverless inference for development; limits and model availability may change. Online Open
84 ⚖️ Mistral Nemotronmistralai/mistral-nemotron NVIDIA Build ? 33K Free serverless inference for development; limits and model availability may change. Online Open
85 ⚖️ Mixtral 8x22b V0.1mistralai/mixtral-8x22b-v0.1 NVIDIA Build ? 33K Free serverless inference for development; limits and model availability may change. Online Open
86 ⚖️ Nemotron 3 Nano 30b A3bnvidia/nemotron-3-nano-30b-a3b NVIDIA Build 30B 33K Free serverless inference for development; limits and model availability may change. Online Open
87 ⚖️ Nemotron 3 Nano Omni 30b A3b Reasoningnvidia/nemotron-3-nano-omni-30b-a3b-reasoning NVIDIA Build 30B 33K Free serverless inference for development; limits and model availability may change. Online Open
88 🚀 Nemotron 3 Super 120b A12bnvidia/nemotron-3-super-120b-a12b NVIDIA Build 120B 33K Free serverless inference for development; limits and model availability may change. Online Open
89 🚀 Nemotron 3 Ultra 550b A55bnvidia/nemotron-3-ultra-550b-a55b NVIDIA Build 550B 1.0M Free serverless inference for development; limits and model availability may change. Online Open
90 🚀 Nemotron 4 340b Instructnvidia/nemotron-4-340b-instruct NVIDIA Build 340B 33K Free serverless inference for development; limits and model availability may change. Online Open
91 ⚖️ Nemotron Nano 12b V2 VLnvidia/nemotron-nano-12b-v2-vl NVIDIA Build 12B 33K Free serverless inference for development; limits and model availability may change. Online Open
92 ⚖️ Nemotron Nano 3 30b A3bnvidia/nemotron-nano-3-30b-a3b NVIDIA Build 30B 33K Free serverless inference for development; limits and model availability may change. Online Open
93 ⚖️ Phi 3 Vision 128k Instructmicrosoft/phi-3-vision-128k-instruct NVIDIA Build ? 131K Free serverless inference for development; limits and model availability may change. Online Open
94 ⚖️ Phi 3.5 Moe Instructmicrosoft/phi-3.5-moe-instruct NVIDIA Build ? 33K Free serverless inference for development; limits and model availability may change. Online Open
95 ⚖️ Nemotron 3 Nano Omni 30b A3b Reasoning:Freenvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free TokenRouter 30B 33K Free models and promotional access may be time-limited; availability is checked through the Models API. Online Open