freegate 0.6.6 → 0.6.7

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (3) hide show
  1. package/package.json +1 -1
  2. package/providers.json +40 -30
  3. package/server.js +21 -14
package/package.json CHANGED
@@ -1,6 +1,6 @@
1
1
  {
2
2
  "name": "freegate",
3
- "version": "0.6.6",
3
+ "version": "0.6.7",
4
4
  "description": "Free multi-provider LLM gateway with automatic failover. One OpenAI-compatible endpoint routes to 25 free models (Groq, Mistral, Gemini, NIM, OpenRouter, ZAI, Cerebras, DeepSeek). Never pay for LLMs.",
5
5
  "license": "MIT",
6
6
  "bin": {
package/providers.json CHANGED
@@ -4,7 +4,7 @@
4
4
  "model": "openai/gpt-oss-120b",
5
5
  "priority": 1,
6
6
  "dailyLimit": 1000,
7
- "keyHint": "console.groq.com \u2192 API Keys",
7
+ "keyHint": "console.groq.com API Keys",
8
8
  "envVar": "PROVIDER_GROQ_APIKEY",
9
9
  "free": true,
10
10
  "category": "general"
@@ -14,7 +14,7 @@
14
14
  "model": "qwen/qwen3.6-27b",
15
15
  "priority": 2,
16
16
  "dailyLimit": 1000,
17
- "keyHint": "console.groq.com \u2192 API Keys",
17
+ "keyHint": "console.groq.com API Keys",
18
18
  "envVar": "PROVIDER_GROQ_APIKEY",
19
19
  "free": true,
20
20
  "category": "general"
@@ -24,7 +24,7 @@
24
24
  "model": "allam-2-7b",
25
25
  "priority": 3,
26
26
  "dailyLimit": 1000,
27
- "keyHint": "console.groq.com \u2192 API Keys (allam-2-7b, \u043e\u0447\u0435\u043d\u044c \u0431\u044b\u0441\u0442\u0440\u0430\u044f 229ms)",
27
+ "keyHint": "console.groq.com API Keys (allam-2-7b, очень быстрая 229ms)",
28
28
  "envVar": "PROVIDER_GROQ_APIKEY",
29
29
  "free": true,
30
30
  "category": "general"
@@ -34,7 +34,7 @@
34
34
  "model": "groq/compound",
35
35
  "priority": 12,
36
36
  "dailyLimit": 1000,
37
- "keyHint": "console.groq.com \u2192 API Keys (compound)",
37
+ "keyHint": "console.groq.com API Keys (compound)",
38
38
  "envVar": "PROVIDER_GROQ_APIKEY",
39
39
  "free": true,
40
40
  "category": "general"
@@ -44,7 +44,7 @@
44
44
  "model": "codestral-latest",
45
45
  "priority": 3,
46
46
  "dailyLimit": 500000,
47
- "keyHint": "console.mistral.ai \u2192 API Keys",
47
+ "keyHint": "console.mistral.ai API Keys",
48
48
  "envVar": "PROVIDER_MISTRAL_APIKEY",
49
49
  "free": true,
50
50
  "category": "coding"
@@ -54,7 +54,7 @@
54
54
  "model": "mistral-small-latest",
55
55
  "priority": 4,
56
56
  "dailyLimit": 500000,
57
- "keyHint": "console.mistral.ai \u2192 API Keys",
57
+ "keyHint": "console.mistral.ai API Keys",
58
58
  "envVar": "PROVIDER_MISTRAL_APIKEY",
59
59
  "free": true,
60
60
  "category": "general"
@@ -64,7 +64,7 @@
64
64
  "model": "gemini-3.6-flash",
65
65
  "priority": 5,
66
66
  "dailyLimit": 1500,
67
- "keyHint": "aistudio.google.com \u2192 Get API key",
67
+ "keyHint": "aistudio.google.com Get API key",
68
68
  "envVar": "PROVIDER_GEMINI_APIKEY",
69
69
  "free": true,
70
70
  "category": "general"
@@ -74,7 +74,7 @@
74
74
  "model": "deepseek-ai/deepseek-v4-flash-0731",
75
75
  "priority": 6,
76
76
  "dailyLimit": 40,
77
- "keyHint": "build.nvidia.com \u2192 Get API key",
77
+ "keyHint": "build.nvidia.com Get API key",
78
78
  "envVar": "PROVIDER_NIM_APIKEY",
79
79
  "free": true,
80
80
  "category": "general"
@@ -84,7 +84,7 @@
84
84
  "model": "meta/llama-3.1-8b-instruct",
85
85
  "priority": 7,
86
86
  "dailyLimit": 40,
87
- "keyHint": "build.nvidia.com \u2192 Get API key",
87
+ "keyHint": "build.nvidia.com Get API key",
88
88
  "envVar": "PROVIDER_NIM_APIKEY",
89
89
  "free": true,
90
90
  "category": "general"
@@ -94,7 +94,7 @@
94
94
  "model": "glm-4.7-flash",
95
95
  "priority": 8,
96
96
  "dailyLimit": 1000,
97
- "keyHint": "open.bigmodel.cn \u2192 API Keys",
97
+ "keyHint": "open.bigmodel.cn API Keys",
98
98
  "envVar": "PROVIDER_ZAI_APIKEY",
99
99
  "free": true,
100
100
  "category": "general"
@@ -104,7 +104,7 @@
104
104
  "model": "cohere/north-mini-code:free",
105
105
  "priority": 17,
106
106
  "dailyLimit": 50,
107
- "keyHint": "openrouter.ai \u2192 Keys (\u043c\u0435\u0434\u043b\u0435\u043d\u043d\u044b\u0439, \u0437\u0430\u043f\u0430\u0441\u043d\u043e\u0439)",
107
+ "keyHint": "openrouter.ai Keys (медленный, запасной)",
108
108
  "envVar": "PROVIDER_OPENROUTER_APIKEY",
109
109
  "free": true,
110
110
  "category": "coding"
@@ -114,7 +114,7 @@
114
114
  "model": "z-ai/glm-5.2:free",
115
115
  "priority": 10,
116
116
  "dailyLimit": 50,
117
- "keyHint": "openrouter.ai \u2192 Keys",
117
+ "keyHint": "openrouter.ai Keys",
118
118
  "envVar": "PROVIDER_OPENROUTER_APIKEY",
119
119
  "free": true,
120
120
  "category": "general"
@@ -124,7 +124,7 @@
124
124
  "model": "nvidia/nemotron-3-ultra-550b-a55b:free",
125
125
  "priority": 11,
126
126
  "dailyLimit": 50,
127
- "keyHint": "openrouter.ai \u2192 Keys",
127
+ "keyHint": "openrouter.ai Keys",
128
128
  "envVar": "PROVIDER_OPENROUTER_APIKEY",
129
129
  "free": true,
130
130
  "category": "reasoning"
@@ -134,7 +134,7 @@
134
134
  "model": "nvidia/nemotron-3-super-120b-a12b:free",
135
135
  "priority": 12,
136
136
  "dailyLimit": 50,
137
- "keyHint": "openrouter.ai \u2192 Keys",
137
+ "keyHint": "openrouter.ai Keys",
138
138
  "envVar": "PROVIDER_OPENROUTER_APIKEY",
139
139
  "free": true,
140
140
  "category": "reasoning"
@@ -144,7 +144,7 @@
144
144
  "model": "openai/gpt-oss-20b:free",
145
145
  "priority": 13,
146
146
  "dailyLimit": 50,
147
- "keyHint": "openrouter.ai \u2192 Keys",
147
+ "keyHint": "openrouter.ai Keys",
148
148
  "envVar": "PROVIDER_OPENROUTER_APIKEY",
149
149
  "free": true,
150
150
  "category": "general"
@@ -154,7 +154,7 @@
154
154
  "model": "stealth/ox-alpha",
155
155
  "priority": 3,
156
156
  "dailyLimit": 100,
157
- "keyHint": "openrouter.ai \u2192 Keys (Ox Alpha: 1M \u043a\u043e\u043d\u0442\u0435\u043a\u0441\u0442, reasoning, \u0431\u0435\u0441\u043f\u043b\u0430\u0442\u043d\u043e)",
157
+ "keyHint": "openrouter.ai Keys (Ox Alpha: 1M контекст, reasoning, бесплатно)",
158
158
  "envVar": "PROVIDER_OPENROUTER_APIKEY",
159
159
  "free": true,
160
160
  "reasoning": true,
@@ -165,7 +165,7 @@
165
165
  "model": "nvidia/nemotron-3.5-lightning:free",
166
166
  "priority": 14,
167
167
  "dailyLimit": 100,
168
- "keyHint": "openrouter.ai \u2192 Keys (Nemotron 3.5 Lightning: 977K \u043a\u043e\u043d\u0442\u0435\u043a\u0441\u0442)",
168
+ "keyHint": "openrouter.ai Keys (Nemotron 3.5 Lightning: 977K контекст)",
169
169
  "envVar": "PROVIDER_OPENROUTER_APIKEY",
170
170
  "free": true,
171
171
  "category": "reasoning"
@@ -175,7 +175,7 @@
175
175
  "model": "poolside/laguna-s-2.1:free",
176
176
  "priority": 15,
177
177
  "dailyLimit": 100,
178
- "keyHint": "openrouter.ai \u2192 Keys (Laguna S: \u043a\u043e\u0434\u0438\u043d\u0433, 118B)",
178
+ "keyHint": "openrouter.ai Keys (Laguna S: кодинг, 118B)",
179
179
  "envVar": "PROVIDER_OPENROUTER_APIKEY",
180
180
  "free": true,
181
181
  "category": "coding"
@@ -185,7 +185,7 @@
185
185
  "model": "gemini-3.6-flash",
186
186
  "priority": 5,
187
187
  "dailyLimit": 1500,
188
- "keyHint": "aistudio.google.com \u2192 Get API key (vision: \u0440\u0430\u0431\u043e\u0442\u0430\u0435\u0442 \u0441\u043e \u0441\u043a\u0440\u0438\u043d\u0448\u043e\u0442\u0430\u043c\u0438)",
188
+ "keyHint": "aistudio.google.com Get API key (vision: работает со скриншотами)",
189
189
  "envVar": "PROVIDER_GEMINI_APIKEY",
190
190
  "free": true,
191
191
  "vision": true,
@@ -196,7 +196,7 @@
196
196
  "model": "meta/llama-3.2-11b-vision-instruct",
197
197
  "priority": 18,
198
198
  "dailyLimit": 40,
199
- "keyHint": "build.nvidia.com \u2192 Get API key (vision, \u043c\u0435\u0434\u043b\u0435\u043d\u043d\u044b\u0439, \u0437\u0430\u043f\u0430\u0441\u043d\u043e\u0439)",
199
+ "keyHint": "build.nvidia.com Get API key (vision, медленный, запасной)",
200
200
  "envVar": "PROVIDER_NIM_APIKEY",
201
201
  "free": true,
202
202
  "vision": true,
@@ -207,7 +207,7 @@
207
207
  "model": "qwen2.5:0.5b",
208
208
  "priority": 17,
209
209
  "dailyLimit": 100000,
210
- "keyHint": "\u041b\u043e\u043a\u0430\u043b\u044c\u043d\u0430\u044f \u043c\u043e\u0434\u0435\u043b\u044c. \u0423\u0441\u0442\u0430\u043d\u043e\u0432\u0438 Ollama \u0438 \u0441\u043a\u0430\u0447\u0430\u0439 \u043c\u043e\u0434\u0435\u043b\u044c: ollama pull qwen2.5:0.5b (\u0431\u0435\u0437 \u043a\u043b\u044e\u0447\u0430, \u0431\u0435\u0437\u043b\u0438\u043c\u0438\u0442, \u043f\u0440\u0438\u0432\u0430\u0442\u043d\u043e)",
210
+ "keyHint": "Локальная модель. Установи Ollama и скачай модель: ollama pull qwen2.5:0.5b (без ключа, безлимит, приватно)",
211
211
  "envVar": "",
212
212
  "free": true,
213
213
  "local": true,
@@ -218,7 +218,7 @@
218
218
  "model": "local-model",
219
219
  "priority": 18,
220
220
  "dailyLimit": 100000,
221
- "keyHint": "\u041b\u043e\u043a\u0430\u043b\u044c\u043d\u0430\u044f \u043c\u043e\u0434\u0435\u043b\u044c. \u0423\u0441\u0442\u0430\u043d\u043e\u0432\u0438 LM Studio \u0438 \u0437\u0430\u0433\u0440\u0443\u0437\u0438 \u043c\u043e\u0434\u0435\u043b\u044c (\u0431\u0435\u0437 \u043a\u043b\u044e\u0447\u0430, \u0431\u0435\u0437\u043b\u0438\u043c\u0438\u0442)",
221
+ "keyHint": "Локальная модель. Установи LM Studio и загрузи модель (без ключа, безлимит)",
222
222
  "envVar": "",
223
223
  "free": true,
224
224
  "local": true,
@@ -229,7 +229,7 @@
229
229
  "model": "gpt-oss-120b",
230
230
  "priority": 2,
231
231
  "dailyLimit": 1000,
232
- "keyHint": "cloud.cerebras.ai \u2192 API Keys (gpt-oss-120b, \u043e\u0447\u0435\u043d\u044c \u0431\u044b\u0441\u0442\u0440\u0430\u044f)",
232
+ "keyHint": "cloud.cerebras.ai API Keys (gpt-oss-120b, очень быстрая)",
233
233
  "envVar": "PROVIDER_CEREBRAS_APIKEY",
234
234
  "free": true,
235
235
  "category": "general"
@@ -239,7 +239,7 @@
239
239
  "model": "gemma-4-31b",
240
240
  "priority": 8,
241
241
  "dailyLimit": 1000,
242
- "keyHint": "cloud.cerebras.ai \u2192 API Keys (gemma-4-31b)",
242
+ "keyHint": "cloud.cerebras.ai API Keys (gemma-4-31b)",
243
243
  "envVar": "PROVIDER_CEREBRAS_APIKEY",
244
244
  "free": true,
245
245
  "category": "general"
@@ -249,7 +249,7 @@
249
249
  "model": "deepseek-v4-flash",
250
250
  "priority": 4,
251
251
  "dailyLimit": 1000,
252
- "keyHint": "platform.deepseek.com \u2192 API Keys (deepseek-v4-flash)",
252
+ "keyHint": "platform.deepseek.com API Keys (deepseek-v4-flash)",
253
253
  "envVar": "PROVIDER_DEEPSEEK_APIKEY",
254
254
  "free": true,
255
255
  "category": "general"
@@ -259,7 +259,7 @@
259
259
  "model": "deepseek-v4-flash-vision-exp",
260
260
  "priority": 14,
261
261
  "dailyLimit": 1000,
262
- "keyHint": "platform.deepseek.com \u2192 API Keys (vision)",
262
+ "keyHint": "platform.deepseek.com API Keys (vision)",
263
263
  "envVar": "PROVIDER_DEEPSEEK_APIKEY",
264
264
  "free": true,
265
265
  "vision": true,
@@ -270,7 +270,7 @@
270
270
  "model": "dots-studio/dots-3-note-preview:free",
271
271
  "priority": 19,
272
272
  "dailyLimit": 50,
273
- "keyHint": "openrouter.ai \u2192 Keys (Dots 3: 280B MoE, \u043c\u043e\u0449\u043d\u0430\u044f)",
273
+ "keyHint": "openrouter.ai Keys (Dots 3: 280B MoE, мощная)",
274
274
  "envVar": "PROVIDER_OPENROUTER_APIKEY",
275
275
  "free": true,
276
276
  "category": "reasoning"
@@ -280,7 +280,7 @@
280
280
  "model": "liquid/lfm-2.5-2.6b:free",
281
281
  "priority": 20,
282
282
  "dailyLimit": 50,
283
- "keyHint": "openrouter.ai \u2192 Keys (LFM 2.5: \u0431\u044b\u0441\u0442\u0440\u0430\u044f reasoning)",
283
+ "keyHint": "openrouter.ai Keys (LFM 2.5: быстрая reasoning)",
284
284
  "envVar": "PROVIDER_OPENROUTER_APIKEY",
285
285
  "free": true,
286
286
  "category": "reasoning"
@@ -290,9 +290,19 @@
290
290
  "model": "poolside/laguna-xs-2.1:free",
291
291
  "priority": 21,
292
292
  "dailyLimit": 50,
293
- "keyHint": "openrouter.ai \u2192 Keys (Laguna XS: \u043a\u043e\u0434\u0438\u043d\u0433)",
293
+ "keyHint": "openrouter.ai Keys (Laguna XS: кодинг)",
294
294
  "envVar": "PROVIDER_OPENROUTER_APIKEY",
295
295
  "free": true,
296
296
  "category": "coding"
297
+ },
298
+ "or-nemotron-3-nano-omni-30b-a3b-r": {
299
+ "endpoint": "https://openrouter.ai/api/v1/chat/completions",
300
+ "model": "nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free",
301
+ "priority": 20,
302
+ "dailyLimit": 50,
303
+ "keyHint": "openrouter.ai → Keys (автодобавлено, vision)",
304
+ "envVar": "PROVIDER_OPENROUTER_APIKEY",
305
+ "free": true,
306
+ "category": "vision"
297
307
  }
298
- }
308
+ }
package/server.js CHANGED
@@ -257,7 +257,10 @@ async function handleChatCompletion(req, res, body) {
257
257
  let weight = score / lat;
258
258
  // Rate-limited providers are last resort — heavy penalty
259
259
  if (h.status === 'ratelimited') weight *= 0.05;
260
- if (key === targetProviderKey) weight *= 2;
260
+ // Mapped (target) provider gets a SLIGHT preference, but the pool must
261
+ // still be able to pick faster/healthier providers for tier aliases —
262
+ // otherwise Freegate always routes tier-s to Codestral and never varies.
263
+ if (key === targetProviderKey) weight *= 1.15;
261
264
  const dailyLimit = provider.dailyLimit || 1000;
262
265
  const usedToday = getStats().providerUsage[key] || 0;
263
266
  if (usedToday >= dailyLimit * 0.9) weight *= 0.5;
@@ -279,31 +282,35 @@ async function handleChatCompletion(req, res, body) {
279
282
  }).sort((a, b) => b.weight - a.weight);
280
283
 
281
284
  const totalWeight = scored.reduce((s, p) => s + p.weight, 0);
285
+ // Weighted random: pick ONE provider as the starting candidate. The rest
286
+ // are kept as fallbacks below. (Bugfix: was assigning the whole `scored`
287
+ // list, which made the first (heaviest) provider win every time.)
282
288
  let r = Math.random() * totalWeight;
283
289
  for (const p of scored) {
284
290
  r -= p.weight;
285
- if (r <= 0) { selected = scored; break; }
291
+ if (r <= 0) { selected = [p]; break; }
286
292
  }
287
- if (selected.length === 0) selected = scored;
293
+ if (selected.length === 0) selected = [scored[0]];
288
294
  }
289
295
 
290
- const enabledProviders = selected.length > 0 ? selected.map(s => [s.key, s.provider]) :
291
- Object.entries(PROVIDERS).filter(([_, p]) => p.enabled)
296
+ // Weighted-random picked ONE provider as the primary; append the rest of the
297
+ // healthy pool (by weight) as fallbacks so a failing pick still recovers.
298
+ const restOfPool = selected.length > 0 && pool.length > 0
299
+ ? pool.map(([k, p]) => ({ key: k, provider: p })).filter(s => s.key !== selected[0].key)
300
+ .sort((a, b) => (getHealth()[b.key]?.score || 0) - (getHealth()[a.key]?.score || 0))
301
+ : [];
302
+ const enabledProviders = selected.length > 0
303
+ ? [selected[0]].concat(restOfPool).map(s => [s.key, s.provider])
304
+ : Object.entries(PROVIDERS).filter(([_, p]) => p.enabled)
292
305
  .sort((a, b) => (getHealth()[b[0]]?.score || 50) - (getHealth()[a[0]]?.score || 50));
293
306
 
294
- // The requested model's mapped provider MUST be tried first even for
295
- // tier aliases. Without this, weighted selection may route the agent to a
296
- // slow/empty-streaming provider (e.g. Nemotron-120b) instead of the fast one.
307
+ // Ensure the requested model's mapped provider is at least IN the candidate
308
+ // list (it may have been filtered out), but DON'T force it to the front
309
+ // the weighted selection above should pick the fastest/healthiest provider.
297
310
  if (MODEL_MAP[requestedModel] && PROVIDERS[targetProviderKey]) {
298
- // Ensure the target provider is in the candidate list at all
299
311
  if (!enabledProviders.some(([k]) => k === targetProviderKey)) {
300
312
  enabledProviders.unshift([targetProviderKey, PROVIDERS[targetProviderKey]]);
301
313
  }
302
- const targetIdx = enabledProviders.findIndex(([k]) => k === targetProviderKey);
303
- if (targetIdx > 0) {
304
- const [t] = enabledProviders.splice(targetIdx, 1);
305
- enabledProviders.unshift(t);
306
- }
307
314
  }
308
315
 
309
316
  if (enabledProviders.length === 0) {