freegate 0.6.6 → 0.6.7
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/package.json +1 -1
- package/providers.json +40 -30
- package/server.js +21 -14
package/package.json
CHANGED
|
@@ -1,6 +1,6 @@
|
|
|
1
1
|
{
|
|
2
2
|
"name": "freegate",
|
|
3
|
-
"version": "0.6.
|
|
3
|
+
"version": "0.6.7",
|
|
4
4
|
"description": "Free multi-provider LLM gateway with automatic failover. One OpenAI-compatible endpoint routes to 25 free models (Groq, Mistral, Gemini, NIM, OpenRouter, ZAI, Cerebras, DeepSeek). Never pay for LLMs.",
|
|
5
5
|
"license": "MIT",
|
|
6
6
|
"bin": {
|
package/providers.json
CHANGED
|
@@ -4,7 +4,7 @@
|
|
|
4
4
|
"model": "openai/gpt-oss-120b",
|
|
5
5
|
"priority": 1,
|
|
6
6
|
"dailyLimit": 1000,
|
|
7
|
-
"keyHint": "console.groq.com
|
|
7
|
+
"keyHint": "console.groq.com → API Keys",
|
|
8
8
|
"envVar": "PROVIDER_GROQ_APIKEY",
|
|
9
9
|
"free": true,
|
|
10
10
|
"category": "general"
|
|
@@ -14,7 +14,7 @@
|
|
|
14
14
|
"model": "qwen/qwen3.6-27b",
|
|
15
15
|
"priority": 2,
|
|
16
16
|
"dailyLimit": 1000,
|
|
17
|
-
"keyHint": "console.groq.com
|
|
17
|
+
"keyHint": "console.groq.com → API Keys",
|
|
18
18
|
"envVar": "PROVIDER_GROQ_APIKEY",
|
|
19
19
|
"free": true,
|
|
20
20
|
"category": "general"
|
|
@@ -24,7 +24,7 @@
|
|
|
24
24
|
"model": "allam-2-7b",
|
|
25
25
|
"priority": 3,
|
|
26
26
|
"dailyLimit": 1000,
|
|
27
|
-
"keyHint": "console.groq.com
|
|
27
|
+
"keyHint": "console.groq.com → API Keys (allam-2-7b, очень быстрая 229ms)",
|
|
28
28
|
"envVar": "PROVIDER_GROQ_APIKEY",
|
|
29
29
|
"free": true,
|
|
30
30
|
"category": "general"
|
|
@@ -34,7 +34,7 @@
|
|
|
34
34
|
"model": "groq/compound",
|
|
35
35
|
"priority": 12,
|
|
36
36
|
"dailyLimit": 1000,
|
|
37
|
-
"keyHint": "console.groq.com
|
|
37
|
+
"keyHint": "console.groq.com → API Keys (compound)",
|
|
38
38
|
"envVar": "PROVIDER_GROQ_APIKEY",
|
|
39
39
|
"free": true,
|
|
40
40
|
"category": "general"
|
|
@@ -44,7 +44,7 @@
|
|
|
44
44
|
"model": "codestral-latest",
|
|
45
45
|
"priority": 3,
|
|
46
46
|
"dailyLimit": 500000,
|
|
47
|
-
"keyHint": "console.mistral.ai
|
|
47
|
+
"keyHint": "console.mistral.ai → API Keys",
|
|
48
48
|
"envVar": "PROVIDER_MISTRAL_APIKEY",
|
|
49
49
|
"free": true,
|
|
50
50
|
"category": "coding"
|
|
@@ -54,7 +54,7 @@
|
|
|
54
54
|
"model": "mistral-small-latest",
|
|
55
55
|
"priority": 4,
|
|
56
56
|
"dailyLimit": 500000,
|
|
57
|
-
"keyHint": "console.mistral.ai
|
|
57
|
+
"keyHint": "console.mistral.ai → API Keys",
|
|
58
58
|
"envVar": "PROVIDER_MISTRAL_APIKEY",
|
|
59
59
|
"free": true,
|
|
60
60
|
"category": "general"
|
|
@@ -64,7 +64,7 @@
|
|
|
64
64
|
"model": "gemini-3.6-flash",
|
|
65
65
|
"priority": 5,
|
|
66
66
|
"dailyLimit": 1500,
|
|
67
|
-
"keyHint": "aistudio.google.com
|
|
67
|
+
"keyHint": "aistudio.google.com → Get API key",
|
|
68
68
|
"envVar": "PROVIDER_GEMINI_APIKEY",
|
|
69
69
|
"free": true,
|
|
70
70
|
"category": "general"
|
|
@@ -74,7 +74,7 @@
|
|
|
74
74
|
"model": "deepseek-ai/deepseek-v4-flash-0731",
|
|
75
75
|
"priority": 6,
|
|
76
76
|
"dailyLimit": 40,
|
|
77
|
-
"keyHint": "build.nvidia.com
|
|
77
|
+
"keyHint": "build.nvidia.com → Get API key",
|
|
78
78
|
"envVar": "PROVIDER_NIM_APIKEY",
|
|
79
79
|
"free": true,
|
|
80
80
|
"category": "general"
|
|
@@ -84,7 +84,7 @@
|
|
|
84
84
|
"model": "meta/llama-3.1-8b-instruct",
|
|
85
85
|
"priority": 7,
|
|
86
86
|
"dailyLimit": 40,
|
|
87
|
-
"keyHint": "build.nvidia.com
|
|
87
|
+
"keyHint": "build.nvidia.com → Get API key",
|
|
88
88
|
"envVar": "PROVIDER_NIM_APIKEY",
|
|
89
89
|
"free": true,
|
|
90
90
|
"category": "general"
|
|
@@ -94,7 +94,7 @@
|
|
|
94
94
|
"model": "glm-4.7-flash",
|
|
95
95
|
"priority": 8,
|
|
96
96
|
"dailyLimit": 1000,
|
|
97
|
-
"keyHint": "open.bigmodel.cn
|
|
97
|
+
"keyHint": "open.bigmodel.cn → API Keys",
|
|
98
98
|
"envVar": "PROVIDER_ZAI_APIKEY",
|
|
99
99
|
"free": true,
|
|
100
100
|
"category": "general"
|
|
@@ -104,7 +104,7 @@
|
|
|
104
104
|
"model": "cohere/north-mini-code:free",
|
|
105
105
|
"priority": 17,
|
|
106
106
|
"dailyLimit": 50,
|
|
107
|
-
"keyHint": "openrouter.ai
|
|
107
|
+
"keyHint": "openrouter.ai → Keys (медленный, запасной)",
|
|
108
108
|
"envVar": "PROVIDER_OPENROUTER_APIKEY",
|
|
109
109
|
"free": true,
|
|
110
110
|
"category": "coding"
|
|
@@ -114,7 +114,7 @@
|
|
|
114
114
|
"model": "z-ai/glm-5.2:free",
|
|
115
115
|
"priority": 10,
|
|
116
116
|
"dailyLimit": 50,
|
|
117
|
-
"keyHint": "openrouter.ai
|
|
117
|
+
"keyHint": "openrouter.ai → Keys",
|
|
118
118
|
"envVar": "PROVIDER_OPENROUTER_APIKEY",
|
|
119
119
|
"free": true,
|
|
120
120
|
"category": "general"
|
|
@@ -124,7 +124,7 @@
|
|
|
124
124
|
"model": "nvidia/nemotron-3-ultra-550b-a55b:free",
|
|
125
125
|
"priority": 11,
|
|
126
126
|
"dailyLimit": 50,
|
|
127
|
-
"keyHint": "openrouter.ai
|
|
127
|
+
"keyHint": "openrouter.ai → Keys",
|
|
128
128
|
"envVar": "PROVIDER_OPENROUTER_APIKEY",
|
|
129
129
|
"free": true,
|
|
130
130
|
"category": "reasoning"
|
|
@@ -134,7 +134,7 @@
|
|
|
134
134
|
"model": "nvidia/nemotron-3-super-120b-a12b:free",
|
|
135
135
|
"priority": 12,
|
|
136
136
|
"dailyLimit": 50,
|
|
137
|
-
"keyHint": "openrouter.ai
|
|
137
|
+
"keyHint": "openrouter.ai → Keys",
|
|
138
138
|
"envVar": "PROVIDER_OPENROUTER_APIKEY",
|
|
139
139
|
"free": true,
|
|
140
140
|
"category": "reasoning"
|
|
@@ -144,7 +144,7 @@
|
|
|
144
144
|
"model": "openai/gpt-oss-20b:free",
|
|
145
145
|
"priority": 13,
|
|
146
146
|
"dailyLimit": 50,
|
|
147
|
-
"keyHint": "openrouter.ai
|
|
147
|
+
"keyHint": "openrouter.ai → Keys",
|
|
148
148
|
"envVar": "PROVIDER_OPENROUTER_APIKEY",
|
|
149
149
|
"free": true,
|
|
150
150
|
"category": "general"
|
|
@@ -154,7 +154,7 @@
|
|
|
154
154
|
"model": "stealth/ox-alpha",
|
|
155
155
|
"priority": 3,
|
|
156
156
|
"dailyLimit": 100,
|
|
157
|
-
"keyHint": "openrouter.ai
|
|
157
|
+
"keyHint": "openrouter.ai → Keys (Ox Alpha: 1M контекст, reasoning, бесплатно)",
|
|
158
158
|
"envVar": "PROVIDER_OPENROUTER_APIKEY",
|
|
159
159
|
"free": true,
|
|
160
160
|
"reasoning": true,
|
|
@@ -165,7 +165,7 @@
|
|
|
165
165
|
"model": "nvidia/nemotron-3.5-lightning:free",
|
|
166
166
|
"priority": 14,
|
|
167
167
|
"dailyLimit": 100,
|
|
168
|
-
"keyHint": "openrouter.ai
|
|
168
|
+
"keyHint": "openrouter.ai → Keys (Nemotron 3.5 Lightning: 977K контекст)",
|
|
169
169
|
"envVar": "PROVIDER_OPENROUTER_APIKEY",
|
|
170
170
|
"free": true,
|
|
171
171
|
"category": "reasoning"
|
|
@@ -175,7 +175,7 @@
|
|
|
175
175
|
"model": "poolside/laguna-s-2.1:free",
|
|
176
176
|
"priority": 15,
|
|
177
177
|
"dailyLimit": 100,
|
|
178
|
-
"keyHint": "openrouter.ai
|
|
178
|
+
"keyHint": "openrouter.ai → Keys (Laguna S: кодинг, 118B)",
|
|
179
179
|
"envVar": "PROVIDER_OPENROUTER_APIKEY",
|
|
180
180
|
"free": true,
|
|
181
181
|
"category": "coding"
|
|
@@ -185,7 +185,7 @@
|
|
|
185
185
|
"model": "gemini-3.6-flash",
|
|
186
186
|
"priority": 5,
|
|
187
187
|
"dailyLimit": 1500,
|
|
188
|
-
"keyHint": "aistudio.google.com
|
|
188
|
+
"keyHint": "aistudio.google.com → Get API key (vision: работает со скриншотами)",
|
|
189
189
|
"envVar": "PROVIDER_GEMINI_APIKEY",
|
|
190
190
|
"free": true,
|
|
191
191
|
"vision": true,
|
|
@@ -196,7 +196,7 @@
|
|
|
196
196
|
"model": "meta/llama-3.2-11b-vision-instruct",
|
|
197
197
|
"priority": 18,
|
|
198
198
|
"dailyLimit": 40,
|
|
199
|
-
"keyHint": "build.nvidia.com
|
|
199
|
+
"keyHint": "build.nvidia.com → Get API key (vision, медленный, запасной)",
|
|
200
200
|
"envVar": "PROVIDER_NIM_APIKEY",
|
|
201
201
|
"free": true,
|
|
202
202
|
"vision": true,
|
|
@@ -207,7 +207,7 @@
|
|
|
207
207
|
"model": "qwen2.5:0.5b",
|
|
208
208
|
"priority": 17,
|
|
209
209
|
"dailyLimit": 100000,
|
|
210
|
-
"keyHint": "
|
|
210
|
+
"keyHint": "Локальная модель. Установи Ollama и скачай модель: ollama pull qwen2.5:0.5b (без ключа, безлимит, приватно)",
|
|
211
211
|
"envVar": "",
|
|
212
212
|
"free": true,
|
|
213
213
|
"local": true,
|
|
@@ -218,7 +218,7 @@
|
|
|
218
218
|
"model": "local-model",
|
|
219
219
|
"priority": 18,
|
|
220
220
|
"dailyLimit": 100000,
|
|
221
|
-
"keyHint": "
|
|
221
|
+
"keyHint": "Локальная модель. Установи LM Studio и загрузи модель (без ключа, безлимит)",
|
|
222
222
|
"envVar": "",
|
|
223
223
|
"free": true,
|
|
224
224
|
"local": true,
|
|
@@ -229,7 +229,7 @@
|
|
|
229
229
|
"model": "gpt-oss-120b",
|
|
230
230
|
"priority": 2,
|
|
231
231
|
"dailyLimit": 1000,
|
|
232
|
-
"keyHint": "cloud.cerebras.ai
|
|
232
|
+
"keyHint": "cloud.cerebras.ai → API Keys (gpt-oss-120b, очень быстрая)",
|
|
233
233
|
"envVar": "PROVIDER_CEREBRAS_APIKEY",
|
|
234
234
|
"free": true,
|
|
235
235
|
"category": "general"
|
|
@@ -239,7 +239,7 @@
|
|
|
239
239
|
"model": "gemma-4-31b",
|
|
240
240
|
"priority": 8,
|
|
241
241
|
"dailyLimit": 1000,
|
|
242
|
-
"keyHint": "cloud.cerebras.ai
|
|
242
|
+
"keyHint": "cloud.cerebras.ai → API Keys (gemma-4-31b)",
|
|
243
243
|
"envVar": "PROVIDER_CEREBRAS_APIKEY",
|
|
244
244
|
"free": true,
|
|
245
245
|
"category": "general"
|
|
@@ -249,7 +249,7 @@
|
|
|
249
249
|
"model": "deepseek-v4-flash",
|
|
250
250
|
"priority": 4,
|
|
251
251
|
"dailyLimit": 1000,
|
|
252
|
-
"keyHint": "platform.deepseek.com
|
|
252
|
+
"keyHint": "platform.deepseek.com → API Keys (deepseek-v4-flash)",
|
|
253
253
|
"envVar": "PROVIDER_DEEPSEEK_APIKEY",
|
|
254
254
|
"free": true,
|
|
255
255
|
"category": "general"
|
|
@@ -259,7 +259,7 @@
|
|
|
259
259
|
"model": "deepseek-v4-flash-vision-exp",
|
|
260
260
|
"priority": 14,
|
|
261
261
|
"dailyLimit": 1000,
|
|
262
|
-
"keyHint": "platform.deepseek.com
|
|
262
|
+
"keyHint": "platform.deepseek.com → API Keys (vision)",
|
|
263
263
|
"envVar": "PROVIDER_DEEPSEEK_APIKEY",
|
|
264
264
|
"free": true,
|
|
265
265
|
"vision": true,
|
|
@@ -270,7 +270,7 @@
|
|
|
270
270
|
"model": "dots-studio/dots-3-note-preview:free",
|
|
271
271
|
"priority": 19,
|
|
272
272
|
"dailyLimit": 50,
|
|
273
|
-
"keyHint": "openrouter.ai
|
|
273
|
+
"keyHint": "openrouter.ai → Keys (Dots 3: 280B MoE, мощная)",
|
|
274
274
|
"envVar": "PROVIDER_OPENROUTER_APIKEY",
|
|
275
275
|
"free": true,
|
|
276
276
|
"category": "reasoning"
|
|
@@ -280,7 +280,7 @@
|
|
|
280
280
|
"model": "liquid/lfm-2.5-2.6b:free",
|
|
281
281
|
"priority": 20,
|
|
282
282
|
"dailyLimit": 50,
|
|
283
|
-
"keyHint": "openrouter.ai
|
|
283
|
+
"keyHint": "openrouter.ai → Keys (LFM 2.5: быстрая reasoning)",
|
|
284
284
|
"envVar": "PROVIDER_OPENROUTER_APIKEY",
|
|
285
285
|
"free": true,
|
|
286
286
|
"category": "reasoning"
|
|
@@ -290,9 +290,19 @@
|
|
|
290
290
|
"model": "poolside/laguna-xs-2.1:free",
|
|
291
291
|
"priority": 21,
|
|
292
292
|
"dailyLimit": 50,
|
|
293
|
-
"keyHint": "openrouter.ai
|
|
293
|
+
"keyHint": "openrouter.ai → Keys (Laguna XS: кодинг)",
|
|
294
294
|
"envVar": "PROVIDER_OPENROUTER_APIKEY",
|
|
295
295
|
"free": true,
|
|
296
296
|
"category": "coding"
|
|
297
|
+
},
|
|
298
|
+
"or-nemotron-3-nano-omni-30b-a3b-r": {
|
|
299
|
+
"endpoint": "https://openrouter.ai/api/v1/chat/completions",
|
|
300
|
+
"model": "nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free",
|
|
301
|
+
"priority": 20,
|
|
302
|
+
"dailyLimit": 50,
|
|
303
|
+
"keyHint": "openrouter.ai → Keys (автодобавлено, vision)",
|
|
304
|
+
"envVar": "PROVIDER_OPENROUTER_APIKEY",
|
|
305
|
+
"free": true,
|
|
306
|
+
"category": "vision"
|
|
297
307
|
}
|
|
298
|
-
}
|
|
308
|
+
}
|
package/server.js
CHANGED
|
@@ -257,7 +257,10 @@ async function handleChatCompletion(req, res, body) {
|
|
|
257
257
|
let weight = score / lat;
|
|
258
258
|
// Rate-limited providers are last resort — heavy penalty
|
|
259
259
|
if (h.status === 'ratelimited') weight *= 0.05;
|
|
260
|
-
|
|
260
|
+
// Mapped (target) provider gets a SLIGHT preference, but the pool must
|
|
261
|
+
// still be able to pick faster/healthier providers for tier aliases —
|
|
262
|
+
// otherwise Freegate always routes tier-s to Codestral and never varies.
|
|
263
|
+
if (key === targetProviderKey) weight *= 1.15;
|
|
261
264
|
const dailyLimit = provider.dailyLimit || 1000;
|
|
262
265
|
const usedToday = getStats().providerUsage[key] || 0;
|
|
263
266
|
if (usedToday >= dailyLimit * 0.9) weight *= 0.5;
|
|
@@ -279,31 +282,35 @@ async function handleChatCompletion(req, res, body) {
|
|
|
279
282
|
}).sort((a, b) => b.weight - a.weight);
|
|
280
283
|
|
|
281
284
|
const totalWeight = scored.reduce((s, p) => s + p.weight, 0);
|
|
285
|
+
// Weighted random: pick ONE provider as the starting candidate. The rest
|
|
286
|
+
// are kept as fallbacks below. (Bugfix: was assigning the whole `scored`
|
|
287
|
+
// list, which made the first (heaviest) provider win every time.)
|
|
282
288
|
let r = Math.random() * totalWeight;
|
|
283
289
|
for (const p of scored) {
|
|
284
290
|
r -= p.weight;
|
|
285
|
-
if (r <= 0) { selected =
|
|
291
|
+
if (r <= 0) { selected = [p]; break; }
|
|
286
292
|
}
|
|
287
|
-
if (selected.length === 0) selected = scored;
|
|
293
|
+
if (selected.length === 0) selected = [scored[0]];
|
|
288
294
|
}
|
|
289
295
|
|
|
290
|
-
|
|
291
|
-
|
|
296
|
+
// Weighted-random picked ONE provider as the primary; append the rest of the
|
|
297
|
+
// healthy pool (by weight) as fallbacks so a failing pick still recovers.
|
|
298
|
+
const restOfPool = selected.length > 0 && pool.length > 0
|
|
299
|
+
? pool.map(([k, p]) => ({ key: k, provider: p })).filter(s => s.key !== selected[0].key)
|
|
300
|
+
.sort((a, b) => (getHealth()[b.key]?.score || 0) - (getHealth()[a.key]?.score || 0))
|
|
301
|
+
: [];
|
|
302
|
+
const enabledProviders = selected.length > 0
|
|
303
|
+
? [selected[0]].concat(restOfPool).map(s => [s.key, s.provider])
|
|
304
|
+
: Object.entries(PROVIDERS).filter(([_, p]) => p.enabled)
|
|
292
305
|
.sort((a, b) => (getHealth()[b[0]]?.score || 50) - (getHealth()[a[0]]?.score || 50));
|
|
293
306
|
|
|
294
|
-
//
|
|
295
|
-
//
|
|
296
|
-
//
|
|
307
|
+
// Ensure the requested model's mapped provider is at least IN the candidate
|
|
308
|
+
// list (it may have been filtered out), but DON'T force it to the front —
|
|
309
|
+
// the weighted selection above should pick the fastest/healthiest provider.
|
|
297
310
|
if (MODEL_MAP[requestedModel] && PROVIDERS[targetProviderKey]) {
|
|
298
|
-
// Ensure the target provider is in the candidate list at all
|
|
299
311
|
if (!enabledProviders.some(([k]) => k === targetProviderKey)) {
|
|
300
312
|
enabledProviders.unshift([targetProviderKey, PROVIDERS[targetProviderKey]]);
|
|
301
313
|
}
|
|
302
|
-
const targetIdx = enabledProviders.findIndex(([k]) => k === targetProviderKey);
|
|
303
|
-
if (targetIdx > 0) {
|
|
304
|
-
const [t] = enabledProviders.splice(targetIdx, 1);
|
|
305
|
-
enabledProviders.unshift(t);
|
|
306
|
-
}
|
|
307
314
|
}
|
|
308
315
|
|
|
309
316
|
if (enabledProviders.length === 0) {
|