LLM Perks
RU

Free Llama model via API

Updated:

Open Llama models from compact 8B to 70B+ on Groq, Together, OpenRouter, and other hosts with a free tier.

Read more

Speed and quota follow the host hardware, not the Llama name. Compare the full row.

31 models found

Power
№ ↕ Model ↕ Power ↕ Provider ↕ Parameters ↕ Context ↕ Limit ↕
1 nim/meta/llama-3.2-11b-vision-instruct ⚡ Together AI 11B 16K Fair Use (По мере нагрузки серверов) Open
2 nim/meta/llama-3.2-90b-vision-instruct 🚀 Together AI 90B 16K Fair Use (По мере нагрузки серверов) Open
3 nim/meta/llama-3.3-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Open
4 nim/nvidia/llama-3.1-nemotron-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Open
5 nim/meta/llama-3.1-8b-instruct ⚡ Together AI 8B 16K Fair Use (По мере нагрузки серверов) Open
6 nim/meta/llama-3.1-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Open
7 nim/nvidia/llama-3.3-nemotron-super-49b-v1 ⚖️ Together AI 49B 16K Fair Use (По мере нагрузки серверов) Open
8 meta-llama/Llama-2-7b-chat-hf ⚡ Together AI 7B 4K Fair Use (По мере нагрузки серверов) Open
9 Cogito V1 Preview Llama 8B ⚡ Together AI 8B 131K Fair Use (По мере нагрузки серверов) Open
10 Cogito V1 Preview Llama 70B 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
11 Cogito V1 Preview Llama 70B Turbo 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
12 Meta Llama 3.3 70B Instruct 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
13 Llama 3.1 70B 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
14 Llama 3.2 1B ⚡ Together AI 1B 131K Fair Use (По мере нагрузки серверов) Open
15 Llama 3.1 405B 🚀 Together AI 405B 131K Fair Use (По мере нагрузки серверов) Open
16 Llama 4 Scout (17Bx16E) ⚖️ Together AI 17B 262K Fair Use (По мере нагрузки серверов) Open
17 Meta Llama 3.1 8B Instruct Awq Int4 ⚡ Together AI 8B 131K Fair Use (По мере нагрузки серверов) Open
18 Llama 3.3 70B Instruct FP8 Lora 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
19 Llama 4 Scout 17B 16E Instruct Fp8 Lora ⚖️ Together AI 17B 10.5M Fair Use (По мере нагрузки серверов) Open
20 Llama 4 Maverick 17B 128E Instruct Nvfp4 ⚖️ Together AI 17B 1.0M Fair Use (По мере нагрузки серверов) Open
21 Llama 3.1 8B Instruct ⚡ Cloudflare 8B 131K 10,000 req/day Open
22 Llama 3.1 8B ⚡ HuggingFace 8B 128K Fair Use (По мере нагрузки серверов) Open
23 Codellama 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
24 LLAMA 3.1 Nemotron 51b Instruct ⚖️ NVIDIA Build 51B ? Free serverless inference for development; limits and model availability may change. Open
25 LLAMA 3.1 Nemotron 70b Instruct 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
26 LLAMA 3.1 Nemotron Ultra 253b V1 🚀 NVIDIA Build 253B ? Free serverless inference for development; limits and model availability may change. Open
27 LLAMA 3.2 11b Vision Instruct ⚡ NVIDIA Build 11B ? Free serverless inference for development; limits and model availability may change. Open
28 LLAMA 3.2 90b Vision Instruct 🚀 NVIDIA Build 90B ? Free serverless inference for development; limits and model availability may change. Open
29 Llama2 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
30 Llama3 Chatqa 1.5 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
31 Llama 3.2 11b Vision ⚡ UnoRouter 11B 128K No-card free models use shared capacity and per-model limits; availability can change. Open