Free AI models for AI agents
Updated:
Models with tool calling, reasoning, and long context for autonomous and assisted agents: planning, tool use, and multi-step work without paying for tokens.
Read more
The table favors strong instruct and reasoning routes. Before running an agent, confirm structured output, function calling, and how the provider refreshes its free quota.
110 models found
| № | Model | Power | Provider | Parameters | Context | Limit | |
|---|---|---|---|---|---|---|---|
| 1 |
|
⚖️ | OpenRouter | 27B | 262K | Free tier | Open |
| 2 |
|
⚖️ | OpenRouter | ? | 1.0M | Free tier | Open |
| 3 |
|
⚖️ | OpenRouter | ? | 128K | Free tier | Open |
| 4 |
|
🚀 | OpenRouter | 550B | 1.0M | Free tier | Open |
| 5 |
|
⚖️ | OpenRouter | 30B | 256K | Free tier | Open |
| 6 |
|
🚀 | OpenRouter | 120B | 262K | Free tier | Open |
| 7 |
|
⚖️ | Groq | 27B | 131K | 14,400 req/day | Open |
| 8 |
|
⚖️ | Google Gemini | ? | 1.0M | 1,500 req/day | Open |
| 9 |
|
⚖️ | Google Gemini | ? | 1.0M | 1,500 req/day | Open |
| 10 |
|
⚖️ | Google Gemini | ? | 1.0M | 1,500 req/day | Open |
| 11 |
|
🚀 | Google Gemini | ? | 2.1M | 50 req/day | Open |
| 12 |
|
⚖️ | Mistral AI | ? | 33K | 1 req/min · 500 tok/min | Open |
| 13 |
|
⚖️ | Mistral AI | ? | 131K | 1 req/min · 500 tok/min | Open |
| 14 |
|
⚖️ | Mistral AI | ? | 8K | 1 req/min · 500 tok/min | Open |
| 15 |
nim/meta/llama-3.2-90b-vision-instruct
|
🚀 | Together AI | 90B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 16 |
|
⚖️ | Together AI | ? | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 17 |
nim/meta/llama-3.3-70b-instruct
|
🚀 | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 18 |
nim/nvidia/llama-3.1-nemotron-70b-instruct
|
🚀 | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 19 |
nim/meta/llama-3.1-70b-instruct
|
🚀 | Together AI | 70B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 20 |
|
⚖️ | Together AI | 12B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 21 |
|
⚖️ | Together AI | ? | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 22 |
nim/nvidia/llama-3.3-nemotron-super-49b-v1
|
⚖️ | Together AI | 49B | 16K | Fair Use (По мере нагрузки серверов) | Open |
| 23 |
|
⚖️ | Together AI | 32B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 24 |
|
⚖️ | Together AI | 14B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 25 |
Cogito V1 Preview Llama 70B
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 26 |
Cogito V1 Preview Llama 70B Turbo
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 27 |
Meta Llama 3.3 70B Instruct
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 28 |
|
⚖️ | Together AI | 32B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 29 |
|
🚀 | Together AI | 72B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 30 |
|
⚖️ | Together AI | 14B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 31 |
Llama 3.1 70B
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 32 |
|
⚖️ | Together AI | 32B | 33K | Fair Use (По мере нагрузки серверов) | Open |
| 33 |
Llama 3.1 405B
|
🚀 | Together AI | 405B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 34 |
|
⚖️ | Together AI | ? | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 35 |
|
⚖️ | Together AI | ? | 66K | Fair Use (По мере нагрузки серверов) | Open |
| 36 |
|
⚖️ | Together AI | 14B | 2K | Fair Use (По мере нагрузки серверов) | Open |
| 37 |
|
⚖️ | Together AI | 30B | 41K | Fair Use (По мере нагрузки серверов) | Open |
| 38 |
Llama 4 Scout (17Bx16E)
|
⚖️ | Together AI | 17B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 39 |
|
⚖️ | Together AI | ? | 41K | Fair Use (По мере нагрузки серверов) | Open |
| 40 |
|
⚖️ | Together AI | 32B | 41K | Fair Use (По мере нагрузки серверов) | Open |
| 41 |
|
🚀 | Together AI | 235B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 42 |
|
⚖️ | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 43 |
|
🚀 | Together AI | 80B | ? | Fair Use (По мере нагрузки серверов) | Open |
| 44 |
|
🚀 | Together AI | 235B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 45 |
|
⚖️ | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 46 |
|
⚖️ | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 47 |
|
🚀 | Together AI | 120B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 48 |
Deepseek OCR 2
|
⚖️ | Together AI | ? | 8K | Fair Use (По мере нагрузки серверов) | Open |
| 49 |
|
🚀 | Together AI | 122B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 50 |
|
⚖️ | Together AI | 30B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 51 |
|
🚀 | Together AI | 120B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 52 |
|
⚖️ | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 53 |
|
⚖️ | Together AI | 30B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 54 |
Llama 3.3 70B Instruct FP8 Lora
|
🚀 | Together AI | 70B | 131K | Fair Use (По мере нагрузки серверов) | Open |
| 55 |
|
⚖️ | Together AI | ? | 33K | Fair Use (По мере нагрузки серверов) | Open |
| 56 |
Llama 4 Scout 17B 16E Instruct Fp8 Lora
|
⚖️ | Together AI | 17B | 10.5M | Fair Use (По мере нагрузки серверов) | Open |
| 57 |
Llama 4 Maverick 17B 128E Instruct Nvfp4
|
⚖️ | Together AI | 17B | 1.0M | Fair Use (По мере нагрузки серверов) | Open |
| 58 |
|
⚖️ | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 59 |
|
⚖️ | Together AI | 35B | 262K | Fair Use (По мере нагрузки серверов) | Open |
| 60 |
|
⚖️ | Cerebras | 27B | ? | 14,400 req/day · 30 req/min | Open |
| 61 |
|
⚖️ | Cloudflare | 14B | 33K | 10,000 req/day | Open |
| 62 |
DeepSeek: DeepSeek V4 Flash (Free)
|
🚀 | OrcaRouter | ? | ? | Free tier | Open |
| 63 |
|
🚀 | OrcaRouter | ? | 66K | Free tier | Open |
| 64 |
|
⚖️ | OrcaRouter | ? | 66K | Free tier | Open |
| 65 | Codellama 70b | 🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 66 |
|
⚖️ | NVIDIA Build | 22B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 67 |
Deepseek V4.1 Flash
|
🚀 | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 68 | Granite 34b Code Instruct | ⚖️ | NVIDIA Build | 34B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 69 |
|
🚀 | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 70 |
LLAMA 3.1 Nemotron 51b Instruct
|
⚖️ | NVIDIA Build | 51B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 71 |
LLAMA 3.1 Nemotron 70b Instruct
|
🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 72 |
LLAMA 3.1 Nemotron Ultra 253b V1
|
🚀 | NVIDIA Build | 253B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 73 |
LLAMA 3.2 90b Vision Instruct
|
🚀 | NVIDIA Build | 90B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 74 | Llama2 70b | 🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 75 |
|
🚀 | NVIDIA Build | 70B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 76 |
|
🚀 | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 77 |
|
🚀 | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 78 |
|
⚖️ | NVIDIA Build | 12B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 79 |
|
⚖️ | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 80 |
|
⚖️ | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 81 |
|
⚖️ | NVIDIA Build | 30B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 82 |
|
🚀 | NVIDIA Build | 120B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 83 |
|
🚀 | NVIDIA Build | 550B | 1.0M | Free serverless inference for development; limits and model availability may change. | Open |
| 84 |
|
⚖️ | NVIDIA Build | 30B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 85 |
|
🚀 | NVIDIA Build | 340B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 86 |
|
⚖️ | NVIDIA Build | 30B | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 87 |
|
⚖️ | NVIDIA Build | ? | 131K | Free serverless inference for development; limits and model availability may change. | Open |
| 88 |
|
⚖️ | NVIDIA Build | ? | ? | Free serverless inference for development; limits and model availability may change. | Open |
| 89 |
|
⚖️ | TokenRouter | 30B | ? | Free models and promotional access may be time-limited; availability is checked through the Models API. | Open |
| 90 |
|
⚖️ | UnoRouter | 32B | 80K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 91 |
|
⚖️ | UnoRouter | ? | 25K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 92 |
|
⚖️ | UnoRouter | ? | 1.0M | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 93 |
|
⚖️ | UnoRouter | ? | 1.0M | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 94 |
|
⚖️ | UnoRouter | ? | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 95 |
|
⚖️ | UnoRouter | ? | 128K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 96 |
|
⚖️ | UnoRouter | ? | 128K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 97 |
|
⚖️ | UnoRouter | 30B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 98 |
|
🚀 | UnoRouter | 120B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 99 |
|
🚀 | UnoRouter | 550B | 1.0M | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 100 |
|
⚖️ | UnoRouter | ? | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 101 |
|
⚖️ | UnoRouter | 30B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 102 |
|
⚖️ | UnoRouter | 12B | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 103 |
|
⚖️ | UnoRouter | 32B | 33K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 104 |
|
⚖️ | UnoRouter | 27B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 105 | Qwen2.5 Coder 32b | ⚖️ | UnoRouter | 32B | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 106 | Qwen3 | ⚖️ | UnoRouter | ? | 25K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 107 | Qwen3.5 397b A17b | 🚀 | UnoRouter | 397B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 108 | Qwen3.6 35b A3b | ⚖️ | UnoRouter | 35B | 262K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 109 | Qwen3.8 27b | ⚖️ | UnoRouter | 27B | 66K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
| 110 | Typhoon V2.5 30b A3b Instruct | ⚖️ | UnoRouter | 30B | 131K | No-card free models use shared capacity and per-model limits; availability can change. | Open |
nim/meta/llama-3.2-90b-vision-instruct
Deepseek OCR 2