LLM Perks
RU

Free LLM APIs

Updated:

A live catalog of free AI APIs for current DeepSeek, Qwen, Nemotron, Mistral, Llama, Gemini, and other models. Compare providers, context windows, and limits before connecting Cursor, VS Code, Cline, Open WebUI, or your own application.

Read more

The catalog updates automatically from aggregator and inference-platform APIs. An offer is treated as free when token prices are zero, a developer free tier exists, or a free quota is explicitly published. The same model appears in separate rows when provider terms differ.

290 models found

Power
№ ↕ Model ↕ Power ↕ Provider ↕ Parameters ↕ Context ↕ Limit ↕
📌 OpenCode GO

$60 in monthly API credits for $10, covering DeepSeek, Qwen, GLM, and other models. Introductory first-month offer available.

Open
1 Space Bunny Alpha ⚡ OpenRouter ? 1.0M Free tier Open
2 Nex AGI: Nex-N2.5-Mini (free) ⚡ OpenRouter ? 262K Free tier Open
3 Nex AGI: Nex-N2.5-Pro (free) 🚀 OpenRouter ? 262K Free tier Open
4 inclusionAI: Ling 3.0 Flash Sante (free) ⚡ OpenRouter ? 262K Free tier Open
5 inclusionAI: Ling 3.0 Flash Fin (free) ⚡ OpenRouter ? 262K Free tier Open
6 Qwen: Qwen3.8 27B (free) ⚖️ OpenRouter 27B 262K Free tier Open
7 Dots Studio: Dots3-Note Preview (free) ⚡ OpenRouter ? 512K Free tier Open
8 LiquidAI: LFM2.5-2.6B (free) ⚡ OpenRouter 2.6B 66K Free tier Open
9 NVIDIA: Nemotron 3.5 Lightning (free) ⚖️ OpenRouter ? 1.0M Free tier Open
10 Thinking Machines: Inkling Small (free) ⚡ OpenRouter ? 1.0M Free tier Open
11 Poolside: Laguna S 2.1 (free) ⚡ OpenRouter ? 262K Free tier Open
12 Thinking Machines: Inkling (free) ⚡ OpenRouter ? 1.0M Free tier Open
13 Poolside: Laguna XS 2.1 (free) ⚡ OpenRouter ? 262K Free tier Open
14 Cohere: North Mini Code (free) ⚡ OpenRouter ? 256K Free tier Open
15 Z.ai: GLM 5.2 (free) 🚀 OpenRouter ? 33K Free tier Open
16 NVIDIA: Nemotron 3.5 Content Safety (free) ⚖️ OpenRouter ? 128K Free tier Open
17 NVIDIA: Nemotron 3 Ultra (free) 🚀 OpenRouter 550B 1.0M Free tier Open
18 NVIDIA: Nemotron 3 Nano Omni (free) ⚖️ OpenRouter 30B 256K Free tier Open
19 Google: Gemma 4 26B A4B (free) ⚖️ OpenRouter 26B 262K Free tier Open
20 Google: Gemma 4 31B (free) ⚖️ OpenRouter 31B 262K Free tier Open
21 Google: Lyria 3 Pro Preview 🚀 OpenRouter ? 1.0M Free tier Open
22 Google: Lyria 3 Clip Preview ⚡ OpenRouter ? 1.0M Free tier Open
23 NVIDIA: Nemotron 3 Super (free) 🚀 OpenRouter 120B 262K Free tier Open
24 Free Models Router ⚡ OpenRouter ? 200K Free tier Open
25 GPT OSS 20B ⚖️ Groq 20B 131K 14,400 req/day Open
26 GPT OSS 120B 🚀 Groq 120B 131K 14,400 req/day Open
27 Allam 2 7B ⚡ Groq 7B 4K 14,400 req/day Open
28 Qwen3.8 27b ⚖️ Groq 27B 131K 14,400 req/day Open
29 Gemini 2.0 Flash ⚖️ Google Gemini ? 1.0M 1,500 req/day Open
30 Gemini 2.0 Flash Lite ⚖️ Google Gemini ? 1.0M 1,500 req/day Open
31 Gemini 1.5 Flash ⚖️ Google Gemini ? 1.0M 1,500 req/day Open
32 Gemini 1.5 Pro 🚀 Google Gemini ? 2.1M 50 req/day Open
33 Mistral Small ⚖️ Mistral AI ? 33K 1 req/min · 500 tok/min Open
34 Mistral Nemo ⚖️ Mistral AI ? 131K 1 req/min · 500 tok/min Open
35 Codestral Mamba ⚡ Mistral AI ? 256K 1 req/min · 500 tok/min Open
36 Mistral Embed ⚖️ Mistral AI ? 8K 1 req/min · 500 tok/min Open
37 Ternary Bonsai 27B ⚖️ Together AI 27B 262K Fair Use (По мере нагрузки серверов) Open
38 nim/meta/llama-3.2-11b-vision-instruct ⚡ Together AI 11B 16K Fair Use (По мере нагрузки серверов) Open
39 nim/meta/llama-3.2-90b-vision-instruct 🚀 Together AI 90B 16K Fair Use (По мере нагрузки серверов) Open
40 nim/mistralai/mixtral-8x22b-instruct-v01 ⚖️ Together AI ? 16K Fair Use (По мере нагрузки серверов) Open
41 nim/meta/llama-3.3-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Open
42 nim/nvidia/llama-3.1-nemotron-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Open
43 nim/meta/llama-3.1-8b-instruct ⚡ Together AI 8B 16K Fair Use (По мере нагрузки серверов) Open
44 nim/meta/llama-3.1-70b-instruct 🚀 Together AI 70B 16K Fair Use (По мере нагрузки серверов) Open
45 nim/nv-mistralai/mistral-nemo-12b-instruct ⚖️ Together AI 12B 16K Fair Use (По мере нагрузки серверов) Open
46 nim/mistralai/mixtral-8x7b-instruct-v01 ⚖️ Together AI ? 16K Fair Use (По мере нагрузки серверов) Open
47 nim/nvidia/llama-3.3-nemotron-super-49b-v1 ⚖️ Together AI 49B 16K Fair Use (По мере нагрузки серверов) Open
48 Gemma 3 27B It ⚖️ Together AI 27B 66K Fair Use (По мере нагрузки серверов) Open
49 meta-llama/Llama-2-7b-chat-hf ⚡ Together AI 7B 4K Fair Use (По мере нагрузки серверов) Open
50 DeepSeek R1 Distill Qwen 7B ⚡ Together AI 7B 131K Fair Use (По мере нагрузки серверов) Open
51 Gemma 3 1b it ⚡ Together AI 1B 33K Fair Use (По мере нагрузки серверов) Open
52 Gemma 3 4b it ⚡ Together AI 4B 66K Fair Use (По мере нагрузки серверов) Open
53 Cogito V1 Preview Llama 8B ⚡ Together AI 8B 131K Fair Use (По мере нагрузки серверов) Open
54 Cogito V1 Preview Qwen 32B ⚖️ Together AI 32B 131K Fair Use (По мере нагрузки серверов) Open
55 Cogito V1 Preview Qwen 14B ⚖️ Together AI 14B 131K Fair Use (По мере нагрузки серверов) Open
56 Cogito V1 Preview Llama 70B 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
57 Cogito V1 Preview Llama 70B Turbo 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
58 Meta Llama 3.3 70B Instruct 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
59 Qwen2.5 32B ⚖️ Together AI 32B 131K Fair Use (По мере нагрузки серверов) Open
60 Qwen2.5 72B 🚀 Together AI 72B 131K Fair Use (По мере нагрузки серверов) Open
61 Qwen2.5 3B Instruct ⚡ Together AI 3B 33K Fair Use (По мере нагрузки серверов) Open
62 Qwen2.5 1.5B Instruct ⚡ Together AI 1.5B 33K Fair Use (По мере нагрузки серверов) Open
63 Qwen2.5 14B ⚖️ Together AI 14B 131K Fair Use (По мере нагрузки серверов) Open
64 Qwen2.5 7B ⚡ Together AI 7B 131K Fair Use (По мере нагрузки серверов) Open
65 Qwen2.5 1.5B ⚡ Together AI 1.5B 131K Fair Use (По мере нагрузки серверов) Open
66 Llama 3.1 70B 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
67 Llama 3.2 1B ⚡ Together AI 1B 131K Fair Use (По мере нагрузки серверов) Open
68 Qwen2.5 7B Instruct ⚡ Together AI 7B 33K Fair Use (По мере нагрузки серверов) Open
69 Qwen2.5 32B Instruct ⚖️ Together AI 32B 33K Fair Use (По мере нагрузки серверов) Open
70 Llama 3.1 405B 🚀 Together AI 405B 131K Fair Use (По мере нагрузки серверов) Open
71 Deepcoder 14B Preview ⚖️ Together AI 14B 131K Fair Use (По мере нагрузки серверов) Open
72 Mistral 7B v0.1 ⚡ Together AI 7B 33K Fair Use (По мере нагрузки серверов) Open
73 Devstral Small 2505 ⚖️ Together AI ? 131K Fair Use (По мере нагрузки серверов) Open
74 Mixtral 8X22b Instruct V0.1 ⚖️ Together AI ? 66K Fair Use (По мере нагрузки серверов) Open
75 Molmo 7B D 0924 ⚡ Together AI 7B 4K Fair Use (По мере нагрузки серверов) Open
76 Qwen3 8B ⚡ Together AI 8B 41K Fair Use (По мере нагрузки серверов) Open
77 Qwen3 14B ⚖️ Together AI 14B 2K Fair Use (По мере нагрузки серверов) Open
78 Qwen3 0.6B ⚡ Together AI 0.6B 41K Fair Use (По мере нагрузки серверов) Open
79 Qwen3 1.7B ⚡ Together AI 1.7B 41K Fair Use (По мере нагрузки серверов) Open
80 Qwen3 30B A3b ⚖️ Together AI 30B 41K Fair Use (По мере нагрузки серверов) Open
81 Gemma 2B It ⚡ Together AI 2B 8K Fair Use (По мере нагрузки серверов) Open
82 Gemma 2 9B It ⚡ Together AI 9B 8K Fair Use (По мере нагрузки серверов) Open
83 Llama 4 Scout (17Bx16E) ⚖️ Together AI 17B 262K Fair Use (По мере нагрузки серверов) Open
84 Magistral Small 2506 ⚖️ Together AI ? 41K Fair Use (По мере нагрузки серверов) Open
85 Minimax M1 40K ⚖️ Together AI ? 1.0M Fair Use (По мере нагрузки серверов) Open
86 Minimax M1 80K ⚖️ Together AI ? 1.0M Fair Use (По мере нагрузки серверов) Open
87 Meta Llama 3.1 8B Instruct Awq Int4 ⚡ Together AI 8B 131K Fair Use (По мере нагрузки серверов) Open
88 Sarvam M ⚡ Together AI ? 33K Fair Use (По мере нагрузки серверов) Open
89 Qwen3 32B ⚖️ Together AI 32B 41K Fair Use (По мере нагрузки серверов) Open
90 Qwen3 235B A22b Instruct 2507 Fp8 🚀 Together AI 235B 262K Fair Use (По мере нагрузки серверов) Open
91 Qwen3 Coder 30B A3b Instruct ⚖️ Together AI 30B 262K Fair Use (По мере нагрузки серверов) Open
92 Qwen3 4B Instruct 2507 ⚡ Together AI 4B 262K Fair Use (По мере нагрузки серверов) Open
93 GLM 4.5V 🚀 Together AI ? 66K Fair Use (По мере нагрузки серверов) Open
94 Qwen3 Next 80B A3b Instruct Fp8 🚀 Together AI 80B ? Fair Use (По мере нагрузки серверов) Open
95 Gemma 3 270M It ⚡ Together AI ? 33K Fair Use (По мере нагрузки серверов) Open
96 Medgemma 27B Text It ⚖️ Together AI 27B 131K Fair Use (По мере нагрузки серверов) Open
97 MiniMax M2 🚀 Together AI ? 197K Fair Use (По мере нагрузки серверов) Open
98 Qwen3-VL-235B-A22B-Instruct-FP8 🚀 Together AI 235B 262K Fair Use (По мере нагрузки серверов) Open
99 EssentialAI Rnj-1 Instruct ⚡ Together AI ? 33K Fair Use (По мере нагрузки серверов) Open
100 Nvidia Nemotron 3 Nano 30B A3b Bf16 ⚖️ Together AI 30B 262K Fair Use (По мере нагрузки серверов) Open
101 GLM 4.7 FP4 🚀 Together AI ? 203K Fair Use (По мере нагрузки серверов) Open
102 GLM 5 Fp4 🚀 Together AI ? 203K Fair Use (По мере нагрузки серверов) Open
103 MiniMax M2.5 FP4 🚀 Together AI ? 8K Fair Use (По мере нагрузки серверов) Open
104 Glm 4.7 Fp8 🚀 Together AI ? 203K Fair Use (По мере нагрузки серверов) Open
105 Qwen3.5 9B Fp8 ⚡ Together AI 9B 262K Fair Use (По мере нагрузки серверов) Open
106 Qwen3.5 35B A3b ⚖️ Together AI 35B 262K Fair Use (По мере нагрузки серверов) Open
107 Nvidia Nemotron 3 Super 120B A12b Fp8 🚀 Together AI 120B 262K Fair Use (По мере нагрузки серверов) Open
108 Deepseek OCR 2 ⚖️ Together AI ? 8K Fair Use (По мере нагрузки серверов) Open
109 Qwen3.5 122B A10b Fp8 🚀 Together AI 122B 262K Fair Use (По мере нагрузки серверов) Open
110 GLM OCR 🚀 Together AI ? 131K Fair Use (По мере нагрузки серверов) Open
111 Qwen3 8B Lora ⚡ Together AI 8B 41K Fair Use (По мере нагрузки серверов) Open
112 Qwen3 30B A3B Instruct 2507 Lora ⚖️ Together AI 30B 262K Fair Use (По мере нагрузки серверов) Open
113 Holo3 35B A3b ⚖️ Together AI 35B 262K Fair Use (По мере нагрузки серверов) Open
114 Nvidia Nemotron 3 Super 120B A12b Bf16 🚀 Together AI 120B 262K Fair Use (По мере нагрузки серверов) Open
115 Gemma 4 E4B-it ⚡ Together AI ? 131K Fair Use (По мере нагрузки серверов) Open
116 Gemma 4 26B A4b It ⚖️ Together AI 26B 262K Fair Use (По мере нагрузки серверов) Open
117 Gemma 4 E2B-it ⚡ Together AI ? 131K Fair Use (По мере нагрузки серверов) Open
118 Qwen3.6 35B A3b Fp8 ⚖️ Together AI 35B 262K Fair Use (По мере нагрузки серверов) Open
119 Nemotron 3 Nano Omni 30B A3b Reasoning Fp8 ⚖️ Together AI 30B 131K Fair Use (По мере нагрузки серверов) Open
120 Llama 3.3 70B Instruct FP8 Lora 🚀 Together AI 70B 131K Fair Use (По мере нагрузки серверов) Open
121 Mixtral 8x7B Instruct V0.1 FP8 Lora ⚖️ Together AI ? 33K Fair Use (По мере нагрузки серверов) Open
122 Gemma 3 270M It Lora ⚡ Together AI ? 33K Fair Use (По мере нагрузки серверов) Open
123 Llama 4 Scout 17B 16E Instruct Fp8 Lora ⚖️ Together AI 17B 10.5M Fair Use (По мере нагрузки серверов) Open
124 Gemma 3 27B It Lora ⚖️ Together AI 27B ? Fair Use (По мере нагрузки серверов) Open
125 Gemma 4 31B It Lora ⚖️ Together AI 31B 262K Fair Use (По мере нагрузки серверов) Open
126 Llama 4 Maverick 17B 128E Instruct Nvfp4 ⚖️ Together AI 17B 1.0M Fair Use (По мере нагрузки серверов) Open
127 Qwen3.5 35B A3B Lora ⚖️ Together AI 35B 262K Fair Use (По мере нагрузки серверов) Open
128 Qwen3.5 2B Lora ⚡ Together AI 2B 262K Fair Use (По мере нагрузки серверов) Open
129 Qwen3.6 35B A3B Lora ⚖️ Together AI 35B 262K Fair Use (По мере нагрузки серверов) Open
130 Gemma 4 12B It ⚖️ Together AI 12B 262K Fair Use (По мере нагрузки серверов) Open
131 GLM 5.2 FP8 🚀 Together AI ? 1.0M Fair Use (По мере нагрузки серверов) Open
132 GLM 5.2 FP8 Lora 🚀 Together AI ? 1.0M Fair Use (По мере нагрузки серверов) Open
133 GLM 5.3 FP8 🚀 Together AI ? 1.0M Fair Use (По мере нагрузки серверов) Open
134 GLM 5.3 FP8 Lora 🚀 Together AI ? 1.0M Fair Use (По мере нагрузки серверов) Open
135 Command R+ (Large) 🚀 Cohere ? 128K 1,000 req/day · 10 req/min Open
136 Command R ⚖️ Cohere ? 128K 1,000 req/day · 10 req/min Open
137 Command ⚖️ Cohere ? 4K 1,000 req/day · 10 req/min Open
138 Command Light ⚖️ Cohere ? 4K 1,000 req/day · 10 req/min Open
139 GPT OSS 120B 🚀 Cerebras 120B 33K 14,400 req/day · 30 req/min Open
140 Qwen 3.8 27b ⚖️ Cerebras 27B ? 14,400 req/day · 30 req/min Open
141 Llama 3.1 8B Instruct ⚡ Cloudflare 8B 131K 10,000 req/day Open
142 Mistral 7B v0.3 ⚡ Cloudflare 7B 33K 10,000 req/day Open
143 Qwen 1.5 14B Chat ⚖️ Cloudflare 14B 33K 10,000 req/day Open
144 Llama 3.1 8B ⚡ HuggingFace 8B 128K Fair Use (По мере нагрузки серверов) Open
145 Mistral 7B v0.3 ⚡ HuggingFace 7B 33K Fair Use (По мере нагрузки серверов) Open
146 Phi-3 Mini ⚡ HuggingFace ? 4K Fair Use (По мере нагрузки серверов) Open
147 orcarouter/free ⚡ OrcaRouter ? ? Free tier Open
148 orcarouter/fusion ⚡ OrcaRouter ? 1.0M Free tier Open
149 orcarouter/fusion-flash ⚡ OrcaRouter ? 262K Free tier Open
150 orcarouter/fusion-mini ⚡ OrcaRouter ? 1.0M Free tier Open
151 DeepSeek: DeepSeek V4 Flash (Free) 🚀 OrcaRouter ? ? Free tier Open
152 Google: Nano Banana Pro (Gemini 3 Pro Image Preview) 🚀 OrcaRouter ? 66K Free tier Open
153 Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview) ⚖️ OrcaRouter ? 66K Free tier Open
154 grok/grok-imagine-image 🚀 OrcaRouter ? ? Free tier Open
155 Kling: Kling 3.0 Turbo ⚡ OrcaRouter ? ? Free tier Open
156 OrcaDub: OrcaDub 1.0 ⚡ OrcaRouter ? ? Free tier Open
157 Orca: OrcaVerify Text 1.0 (Free) ⚡ OrcaRouter ? ? Free tier Open
158 Tencent: Hy3 (Free) ⚡ OrcaRouter ? ? Free tier Open
159 Z.ai: GLM 5.3 Flash (Free) ⚖️ OrcaRouter ? ? Free tier Open
160 Codegemma 1.1 7b ⚡ NVIDIA Build 7B ? Free serverless inference for development; limits and model availability may change. Open
161 Codegemma 7b ⚡ NVIDIA Build 7B ? Free serverless inference for development; limits and model availability may change. Open
162 Codellama 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
163 Codestral 22b Instruct V0.1 ⚖️ NVIDIA Build 22B ? Free serverless inference for development; limits and model availability may change. Open
164 Cosmos Reason2 8b ⚡ NVIDIA Build 8B ? Free serverless inference for development; limits and model availability may change. Open
165 Dbrx Instruct ⚡ NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
166 Deepseek Coder 6.7b Instruct ⚡ NVIDIA Build 6.7B ? Free serverless inference for development; limits and model availability may change. Open
167 Deepseek V4.1 Flash 🚀 NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
168 Fuyu 8b ⚡ NVIDIA Build 8B ? Free serverless inference for development; limits and model availability may change. Open
169 Gemma 2b ⚡ NVIDIA Build 2B ? Free serverless inference for development; limits and model availability may change. Open
170 Gemma 3 12b It ⚖️ NVIDIA Build 12B ? Free serverless inference for development; limits and model availability may change. Open
171 Gemma 3 4b It ⚡ NVIDIA Build 4B ? Free serverless inference for development; limits and model availability may change. Open
172 Gemma 4 31b It ⚖️ NVIDIA Build 31B ? Free serverless inference for development; limits and model availability may change. Open
173 Glm 5.3 🚀 NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
174 Glm 5.3 Flash ⚖️ NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
175 GPT Oss 20b ⚖️ NVIDIA Build 20B ? Free serverless inference for development; limits and model availability may change. Open
176 Granite 3.0 3b A800m Instruct ⚡ NVIDIA Build 3B ? Free serverless inference for development; limits and model availability may change. Open
177 Granite 3.0 8b Instruct ⚡ NVIDIA Build 8B ? Free serverless inference for development; limits and model availability may change. Open
178 Granite 34b Code Instruct ⚖️ NVIDIA Build 34B ? Free serverless inference for development; limits and model availability may change. Open
179 Granite 8b Code Instruct ⚡ NVIDIA Build 8B ? Free serverless inference for development; limits and model availability may change. Open
180 Jamba 1.5 Large Instruct 🚀 NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
181 Kimi K2.6 🚀 NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
182 Kimi K3 ⚖️ NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
183 Kosmos 2 ⚡ NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
184 Laguna Xs 2.1 ⚡ NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
185 LLAMA 3.1 Nemotron 51b Instruct ⚖️ NVIDIA Build 51B ? Free serverless inference for development; limits and model availability may change. Open
186 LLAMA 3.1 Nemotron 70b Instruct 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
187 LLAMA 3.1 Nemotron Ultra 253b V1 🚀 NVIDIA Build 253B ? Free serverless inference for development; limits and model availability may change. Open
188 LLAMA 3.2 11b Vision Instruct ⚡ NVIDIA Build 11B ? Free serverless inference for development; limits and model availability may change. Open
189 LLAMA 3.2 90b Vision Instruct 🚀 NVIDIA Build 90B ? Free serverless inference for development; limits and model availability may change. Open
190 Llama2 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
191 Llama3 Chatqa 1.5 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
192 Mistral 7b Instruct V0.3 ⚡ NVIDIA Build 7B ? Free serverless inference for development; limits and model availability may change. Open
193 Mistral Large 🚀 NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
194 Mistral Large 2 Instruct 🚀 NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
195 Mistral Nemo 12b Instruct ⚖️ NVIDIA Build 12B ? Free serverless inference for development; limits and model availability may change. Open
196 Mistral Nemo Minitron 8b 8k Instruct ⚡ NVIDIA Build 8B 8K Free serverless inference for development; limits and model availability may change. Open
197 Mistral Nemotron ⚖️ NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
198 Mixtral 8x22b V0.1 ⚖️ NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
199 Muse Glimmer 30b ⚖️ NVIDIA Build 30B ? Free serverless inference for development; limits and model availability may change. Open
200 Nemotron 3 Nano Omni 30b A3b Reasoning ⚖️ NVIDIA Build 30B ? Free serverless inference for development; limits and model availability may change. Open
201 Nemotron 3 Super 120b A12b 🚀 NVIDIA Build 120B ? Free serverless inference for development; limits and model availability may change. Open
202 Nemotron 3 Ultra 550b A55b 🚀 NVIDIA Build 550B 1.0M Free serverless inference for development; limits and model availability may change. Open
203 Nemotron 3.5 Lightning 30b A3b ⚖️ NVIDIA Build 30B ? Free serverless inference for development; limits and model availability may change. Open
204 Nemotron 4 340b Instruct 🚀 NVIDIA Build 340B ? Free serverless inference for development; limits and model availability may change. Open
205 Nemotron Nano 3 30b A3b ⚖️ NVIDIA Build 30B ? Free serverless inference for development; limits and model availability may change. Open
206 Neva 22b ⚖️ NVIDIA Build 22B ? Free serverless inference for development; limits and model availability may change. Open
207 Palmyra Creative 122b 🚀 NVIDIA Build 122B ? Free serverless inference for development; limits and model availability may change. Open
208 Palmyra Fin 70b 32k 🚀 NVIDIA Build 70B 33K Free serverless inference for development; limits and model availability may change. Open
209 Palmyra Med 70b 🚀 NVIDIA Build 70B ? Free serverless inference for development; limits and model availability may change. Open
210 Palmyra Med 70b 32k 🚀 NVIDIA Build 70B 33K Free serverless inference for development; limits and model availability may change. Open
211 Phi 3 Vision 128k Instruct ⚖️ NVIDIA Build ? 131K Free serverless inference for development; limits and model availability may change. Open
212 Phi 3.5 Moe Instruct ⚖️ NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
213 Recurrentgemma 2b ⚡ NVIDIA Build 2B ? Free serverless inference for development; limits and model availability may change. Open
214 Riva Translate 4b Instruct ⚡ NVIDIA Build 4B ? Free serverless inference for development; limits and model availability may change. Open
215 Riva Translate 4b Instruct V1.1 ⚡ NVIDIA Build 4B ? Free serverless inference for development; limits and model availability may change. Open
216 Riva Translate 4b Instruct V2 ⚡ NVIDIA Build 4B ? Free serverless inference for development; limits and model availability may change. Open
217 Sea Lion 7b Instruct ⚡ NVIDIA Build 7B ? Free serverless inference for development; limits and model availability may change. Open
218 Starcoder2 15b ⚖️ NVIDIA Build 15B ? Free serverless inference for development; limits and model availability may change. Open
219 Vila ⚡ NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
220 Yi Large 🚀 NVIDIA Build ? ? Free serverless inference for development; limits and model availability may change. Open
221 Zamba2 7b Instruct ⚡ NVIDIA Build 7B ? Free serverless inference for development; limits and model availability may change. Open
222 Nemotron 3 Nano Omni 30b A3b Reasoning:Free ⚖️ TokenRouter 30B ? Free models and promotional access may be time-limited; availability is checked through the Models API. Open
223 Laguna S 2.1 Free ⚡ Vercel AI Gateway ? 256K A valid payment card must be on file even for zero-price models. Free promotions may change; availability is refreshed from the Models API. Open
224 Ling 3.0 Flash Fin ⚡ Vercel AI Gateway ? 256K A valid payment card must be on file even for zero-price models. Free promotions may change; availability is refreshed from the Models API. Open
225 Ling 3.0 Flash Fin (Free) ⚡ Vercel AI Gateway ? 256K A valid payment card must be on file even for zero-price models. Free promotions may change; availability is refreshed from the Models API. Open
226 Ling 3.0 Flash Sante ⚡ Vercel AI Gateway ? 256K A valid payment card must be on file even for zero-price models. Free promotions may change; availability is refreshed from the Models API. Open
227 Ling 3.0 Flash Sante (Free) ⚡ Vercel AI Gateway ? 256K A valid payment card must be on file even for zero-price models. Free promotions may change; availability is refreshed from the Models API. Open
228 Agnes 2.0 Flash ⚡ UnoRouter ? 262K No-card free models use shared capacity and per-model limits; availability can change. Open
229 Allam 2 7b ⚡ UnoRouter 7B 4K No-card free models use shared capacity and per-model limits; availability can change. Open
230 Codestral Latest ⚡ UnoRouter ? 256K No-card free models use shared capacity and per-model limits; availability can change. Open
231 Deepseek R1 Distill QWEN 32b ⚖️ UnoRouter 32B 80K No-card free models use shared capacity and per-model limits; availability can change. Open
232 Deepseek V4 Flash 🚀 UnoRouter ? 1.0M No-card free models use shared capacity and per-model limits; availability can change. Open
233 Diffusiongemma 26b A4b It ⚖️ UnoRouter 26B 262K No-card free models use shared capacity and per-model limits; availability can change. Open
234 Dots 3 Note Preview ⚡ UnoRouter ? 512K No-card free models use shared capacity and per-model limits; availability can change. Open
235 Gemini 1.5 Flash ⚖️ UnoRouter ? 25K No-card free models use shared capacity and per-model limits; availability can change. Open
236 Gemini 3.5 Flash Lite ⚖️ UnoRouter ? 1.0M No-card free models use shared capacity and per-model limits; availability can change. Open
237 Gemini 3.6 Flash ⚖️ UnoRouter ? 1.0M No-card free models use shared capacity and per-model limits; availability can change. Open
238 Gemini Flash Lite Latest ⚖️ UnoRouter ? 1.0M No-card free models use shared capacity and per-model limits; availability can change. Open
239 Gemini Robotics Er 2 Preview ⚖️ UnoRouter ? 131K No-card free models use shared capacity and per-model limits; availability can change. Open
240 Gemma 4 26b ⚖️ UnoRouter 26B 262K No-card free models use shared capacity and per-model limits; availability can change. Open
241 Gemma 4 31b It ⚖️ UnoRouter 31B 262K No-card free models use shared capacity and per-model limits; availability can change. Open
242 GLM 4.5 Flash ⚖️ UnoRouter ? 131K No-card free models use shared capacity and per-model limits; availability can change. Open
243 GLM 4.7 Flash ⚖️ UnoRouter ? 128K No-card free models use shared capacity and per-model limits; availability can change. Open
244 GLM 5.2 🚀 UnoRouter ? 1.0M No-card free models use shared capacity and per-model limits; availability can change. Open
245 GPT 4o ⚡ UnoRouter ? 128K No-card free models use shared capacity and per-model limits; availability can change. Open
246 GPT Oss 20b ⚖️ UnoRouter 20B 128K No-card free models use shared capacity and per-model limits; availability can change. Open
247 GPT Oss Safeguard 20b ⚖️ UnoRouter 20B 131K No-card free models use shared capacity and per-model limits; availability can change. Open
248 Granite 4.0 Micro ⚡ UnoRouter ? 131K No-card free models use shared capacity and per-model limits; availability can change. Open
249 Grok Beta 🚀 UnoRouter ? 25K No-card free models use shared capacity and per-model limits; availability can change. Open
250 Ising Calibration 1.5 31b ⚖️ UnoRouter 31B 262K No-card free models use shared capacity and per-model limits; availability can change. Open
251 K2 Horizon ⚡ UnoRouter ? 524K No-card free models use shared capacity and per-model limits; availability can change. Open
252 Kimi K3 ⚖️ UnoRouter ? 1.0M No-card free models use shared capacity and per-model limits; availability can change. Open
253 Laguna S 2.1 ⚡ UnoRouter ? 1.0M No-card free models use shared capacity and per-model limits; availability can change. Open
254 Laguna Xs 2.1 ⚡ UnoRouter ? 262K No-card free models use shared capacity and per-model limits; availability can change. Open
255 Leanstral 1 5 ⚡ UnoRouter ? 262K No-card free models use shared capacity and per-model limits; availability can change. Open
256 Lfm 2.5 2.6b ⚡ UnoRouter 2.6B 128K No-card free models use shared capacity and per-model limits; availability can change. Open
257 Ling 3.0 Flash Fin ⚡ UnoRouter ? 262K No-card free models use shared capacity and per-model limits; availability can change. Open
258 Ling 3.0 Flash Sante ⚡ UnoRouter ? 262K No-card free models use shared capacity and per-model limits; availability can change. Open
259 Llama 3.2 11b Vision ⚡ UnoRouter 11B 128K No-card free models use shared capacity and per-model limits; availability can change. Open
260 Mistral 7b Instruct ⚡ UnoRouter 7B 25K No-card free models use shared capacity and per-model limits; availability can change. Open
261 Mistral Nemotron ⚖️ UnoRouter ? 128K No-card free models use shared capacity and per-model limits; availability can change. Open
262 Mistral Small ⚖️ UnoRouter ? 128K No-card free models use shared capacity and per-model limits; availability can change. Open
263 Muse Glimmer 30b ⚖️ UnoRouter 30B 131K No-card free models use shared capacity and per-model limits; availability can change. Open
264 Nemotron 3 Nano Omni 30b A3b Reasoning ⚖️ UnoRouter 30B 262K No-card free models use shared capacity and per-model limits; availability can change. Open
265 Nemotron 3 Super 120b A12b 🚀 UnoRouter 120B 262K No-card free models use shared capacity and per-model limits; availability can change. Open
266 Nemotron 3 Ultra 550b A55b 🚀 UnoRouter 550B 1.0M No-card free models use shared capacity and per-model limits; availability can change. Open
267 Nemotron 3.5 Lightning ⚖️ UnoRouter ? 262K No-card free models use shared capacity and per-model limits; availability can change. Open
268 Nemotron 3.5 Lightning 30b A3b ⚖️ UnoRouter 30B 262K No-card free models use shared capacity and per-model limits; availability can change. Open
269 Nemotron Nano 12b V2 Vl ⚖️ UnoRouter 12B 131K No-card free models use shared capacity and per-model limits; availability can change. Open
270 Nemotron Nano 9b V2 ⚡ UnoRouter 9B 131K No-card free models use shared capacity and per-model limits; availability can change. Open
271 Nex N2.5 Mini ⚡ UnoRouter ? 262K No-card free models use shared capacity and per-model limits; availability can change. Open
272 Nex N2.5 Pro 🚀 UnoRouter ? 262K No-card free models use shared capacity and per-model limits; availability can change. Open
273 North Mini Code ⚡ UnoRouter ? 256K No-card free models use shared capacity and per-model limits; availability can change. Open
274 QWEN Sea Lion V4 32b It ⚖️ UnoRouter 32B 33K No-card free models use shared capacity and per-model limits; availability can change. Open
275 QWEN Sea Lion V4.5 27b It ⚖️ UnoRouter 27B 262K No-card free models use shared capacity and per-model limits; availability can change. Open
276 Qwen2.5 Coder 32b ⚖️ UnoRouter 32B 131K No-card free models use shared capacity and per-model limits; availability can change. Open
277 Qwen2.5 Vl 7b Instruct Awq ⚡ UnoRouter 7B 131K No-card free models use shared capacity and per-model limits; availability can change. Open
278 Qwen3 ⚖️ UnoRouter ? 25K No-card free models use shared capacity and per-model limits; availability can change. Open
279 Qwen3.5 397b A17b 🚀 UnoRouter 397B 262K No-card free models use shared capacity and per-model limits; availability can change. Open
280 Qwen3.5 4b ⚡ UnoRouter 4B 262K No-card free models use shared capacity and per-model limits; availability can change. Open
281 Qwen3.6 35b A3b ⚖️ UnoRouter 35B 262K No-card free models use shared capacity and per-model limits; availability can change. Open
282 Qwq 32b ⚖️ UnoRouter 32B 131K No-card free models use shared capacity and per-model limits; availability can change. Open
283 Riva Translate 4b Instruct V2 ⚡ UnoRouter 4B 8K No-card free models use shared capacity and per-model limits; availability can change. Open
284 Sensenova 6.8 Flash Lite ⚡ UnoRouter ? 262K No-card free models use shared capacity and per-model limits; availability can change. Open
285 Sonar ⚡ UnoRouter ? 128K No-card free models use shared capacity and per-model limits; availability can change. Open
286 Space Bunny Alpha ⚡ UnoRouter ? 1.0M No-card free models use shared capacity and per-model limits; availability can change. Open
287 Step 3.7 Flash ⚡ UnoRouter ? 256K No-card free models use shared capacity and per-model limits; availability can change. Open
288 Swe 1 6 Slow ⚡ UnoRouter ? 6K No-card free models use shared capacity and per-model limits; availability can change. Open
289 Typhoon V2.5 30b A3b Instruct ⚖️ UnoRouter 30B 131K No-card free models use shared capacity and per-model limits; availability can change. Open
290 Villanova 2b 2512 Preview Apnea Ft ⚡ UnoRouter 2B 33K No-card free models use shared capacity and per-model limits; availability can change. Open