Free Nemotron model via API
Updated:
Ultra, Super, and Nano from the Nemotron 3 and 4 line. The catalog mixes NVIDIA NIM and compatible aggregators without merging their quotas.
Read more
NVIDIA Build needs a developer account. A third-party :free route is a different key and a different cap.
30 models found
| № | Model | Power | Provider | Parameters | Context | Limit | |
|---|---|---|---|---|---|---|---|
| 1 |
|
⚖️ | OpenRouter | ? | 1.0M | Free tier | Open |
| 2 |
|
⚖️ | OpenRouter | ? | 128K | Free tier | Open |
| 3 |
|
🚀 | OpenRouter | 550B | 1.0M | Free tier | Open |
| 4 |
|
⚖️ | OpenRouter | 30B | 256K | Free tier | Open |
| 5 |
|
🚀 | OpenRouter | 120B | 262K | Free tier | Open |
| 6 |
nim/nvidia/llama-3.1-nemotron-70b-instruct
|
🚀 | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 7 |
nim/nvidia/llama-3.3-nemotron-super-49b-v1
|
⚖️ | Together AI | 49B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 8 |
|
⚖️ | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 9 |
|
🚀 | Together AI | 120B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 10 |
|
🚀 | Together AI | 120B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 11 |
|
⚖️ | Together AI | 30B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 12 |
LLAMA 3.1 Nemotron 51b Instruct
|
⚖️ | NVIDIA Build | 51B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 13 |
LLAMA 3.1 Nemotron 70b Instruct
|
🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 14 |
LLAMA 3.1 Nemotron Ultra 253b V1
|
🚀 | NVIDIA Build | 253B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 15 |
|
⚖️ | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 16 |
|
⚖️ | NVIDIA Build | 30B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 17 |
|
🚀 | NVIDIA Build | 120B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 18 |
|
🚀 | NVIDIA Build | 550B | 1.0M | Free serverless inference for development; limits and model availability may change. | Open |
| 19 |
|
⚖️ | NVIDIA Build | 30B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 20 |
|
🚀 | NVIDIA Build | 340B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 21 |
|
⚖️ | NVIDIA Build | 30B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 22 |
|
⚖️ | TokenRouter | 30B | ? | Free models and promotional access may be time-limited; availability is checked through the Models API. | Open |
| 23 |
|
⚖️ | UnoRouter | ? | 128K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 24 |
|
⚖️ | UnoRouter | 30B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 25 |
|
🚀 | UnoRouter | 120B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 26 |
|
🚀 | UnoRouter | 550B | 1.0M | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 27 |
|
⚖️ | UnoRouter | ? | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 28 |
|
⚖️ | UnoRouter | 30B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 29 |
|
⚖️ | UnoRouter | 12B | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 30 |
|
⚡ | UnoRouter | 9B | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
nim/nvidia/llama-3.1-nemotron-70b-instruct