Nemotron — free API

Updated:

NVIDIA Nemotron models for reasoning, coding, and AI agents, available through NVIDIA Build and compatible API aggregators.

Read more

The list is built from current provider API responses. The same model may appear more than once because each endpoint has its own limits, context window, and free-tier rules. Individual model pages use stable URLs and update automatically.

31 models
🚀 10 powerful
⚖️ 16 balanced
⚡ 5 lightweight
Model Provider Parameters Context Limit Status
1 ⚖️ NVIDIA: Nemotron 3.5 Content Safety (free)nvidia/nemotron-3.5-content-safety:free OpenRouter ? 128K Free tier Online Open
2 🚀 NVIDIA: Nemotron 3 Ultra (free)nvidia/nemotron-3-ultra-550b-a55b:free OpenRouter 550B 1.0M Free tier Online Open
3 ⚖️ NVIDIA: Nemotron 3 Nano Omni (free)nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free OpenRouter 30B 256K Free tier Online Open
4 🚀 NVIDIA: Nemotron 3 Super (free)nvidia/nemotron-3-super-120b-a12b:free OpenRouter 120B 262K Free tier Online Open
5 ⚖️ NVIDIA: Nemotron 3 Nano 30B A3B (free)nvidia/nemotron-3-nano-30b-a3b:free OpenRouter 30B 256K Free tier Online Open
6 ⚖️ NVIDIA: Nemotron Nano 12B 2 VL (free)nvidia/nemotron-nano-12b-v2-vl:free OpenRouter 12B 128K Free tier Online Open
7 NVIDIA: Nemotron Nano 9B V2 (free)nvidia/nemotron-nano-9b-v2:free OpenRouter 9B 128K Free tier Online Open
8 🚀 nim/nvidia/llama-3.1-nemotron-70b-instructnim/nvidia/llama-3.1-nemotron-70b-instruct Together AI 70B 16K Fair Use (По мере нагрузки серверов) Online Open
9 ⚖️ nim/nvidia/llama-3.3-nemotron-super-49b-v1nim/nvidia/llama-3.3-nemotron-super-49b-v1 Together AI 49B 16K Fair Use (По мере нагрузки серверов) Online Open
10 ⚖️ Nvidia Nemotron 3 Nano 30B A3b Bf16nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 Together AI 30B 262K Fair Use (По мере нагрузки серверов) Online Open
11 🚀 Nvidia Nemotron 3 Super 120B A12b Fp8nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-FP8 Together AI 120B 262K Fair Use (По мере нагрузки серверов) Online Open
12 🚀 Nvidia Nemotron 3 Super 120B A12b Bf16nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16 Together AI 120B 262K Fair Use (По мере нагрузки серверов) Online Open
13 ⚖️ Nemotron 3 Nano Omni 30B A3b Reasoning Fp8nvidia/nemotron-3-nano-omni-30b-a3b-reasoning-fp8 Together AI 30B 131K Fair Use (По мере нагрузки серверов) Online Open
14 ⚖️ LLAMA 3.1 Nemotron 51b Instructnvidia/llama-3.1-nemotron-51b-instruct NVIDIA Build 51B 131K Free serverless inference for development; limits and model availability may change. Online Open
15 🚀 LLAMA 3.1 Nemotron 70b Instructnvidia/llama-3.1-nemotron-70b-instruct NVIDIA Build 70B 131K Free serverless inference for development; limits and model availability may change. Online Open
16 LLAMA 3.1 Nemotron Nano 8b V1nvidia/llama-3.1-nemotron-nano-8b-v1 NVIDIA Build 8B 131K Free serverless inference for development; limits and model availability may change. Online Open
17 LLAMA 3.1 Nemotron Nano VL 8b V1nvidia/llama-3.1-nemotron-nano-vl-8b-v1 NVIDIA Build 8B 131K Free serverless inference for development; limits and model availability may change. Online Open
18 🚀 LLAMA 3.1 Nemotron Ultra 253b V1nvidia/llama-3.1-nemotron-ultra-253b-v1 NVIDIA Build 253B 131K Free serverless inference for development; limits and model availability may change. Online Open
19 ⚖️ LLAMA 3.3 Nemotron Super 49b V1nvidia/llama-3.3-nemotron-super-49b-v1 NVIDIA Build 49B 131K Free serverless inference for development; limits and model availability may change. Online Open
20 ⚖️ LLAMA 3.3 Nemotron Super 49b V1.5nvidia/llama-3.3-nemotron-super-49b-v1.5 NVIDIA Build 49B 131K Free serverless inference for development; limits and model availability may change. Online Open
21 ⚖️ Mistral Nemotronmistralai/mistral-nemotron NVIDIA Build ? 33K Free serverless inference for development; limits and model availability may change. Online Open
22 ⚖️ Nemotron 3 Nano 30b A3bnvidia/nemotron-3-nano-30b-a3b NVIDIA Build 30B 33K Free serverless inference for development; limits and model availability may change. Online Open
23 ⚖️ Nemotron 3 Nano Omni 30b A3b Reasoningnvidia/nemotron-3-nano-omni-30b-a3b-reasoning NVIDIA Build 30B 33K Free serverless inference for development; limits and model availability may change. Online Open
24 🚀 Nemotron 3 Super 120b A12bnvidia/nemotron-3-super-120b-a12b NVIDIA Build 120B 33K Free serverless inference for development; limits and model availability may change. Online Open
25 🚀 Nemotron 3 Ultra 550b A55bnvidia/nemotron-3-ultra-550b-a55b NVIDIA Build 550B 1.0M Free serverless inference for development; limits and model availability may change. Online Open
26 🚀 Nemotron 4 340b Instructnvidia/nemotron-4-340b-instruct NVIDIA Build 340B 33K Free serverless inference for development; limits and model availability may change. Online Open
27 Nemotron Mini 4b Instructnvidia/nemotron-mini-4b-instruct NVIDIA Build 4B 33K Free serverless inference for development; limits and model availability may change. Online Open
28 ⚖️ Nemotron Nano 12b V2 VLnvidia/nemotron-nano-12b-v2-vl NVIDIA Build 12B 33K Free serverless inference for development; limits and model availability may change. Online Open
29 ⚖️ Nemotron Nano 3 30b A3bnvidia/nemotron-nano-3-30b-a3b NVIDIA Build 30B 33K Free serverless inference for development; limits and model availability may change. Online Open
30 Nvidia Nemotron Nano 9b V2nvidia/nvidia-nemotron-nano-9b-v2 NVIDIA Build 9B 33K Free serverless inference for development; limits and model availability may change. Online Open
31 ⚖️ Nemotron 3 Nano Omni 30b A3b Reasoning:Freenvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free TokenRouter 30B 33K Free models and promotional access may be time-limited; availability is checked through the Models API. Online Open