mslxdff 0.1.158 → 0.1.160
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/bin/mslxdff.js +4 -4
- package/package.json +3 -3
- package/src/auto.js +254 -254
- package/src/bench/cline-bench.js +42 -42
- package/src/bench/probe.js +70 -70
- package/src/bench/report.js +162 -162
- package/src/bench/runner.js +77 -77
- package/src/bench/via-probe.js +124 -124
- package/src/bench/via-routes.js +87 -87
- package/src/bench/workbuddy-bench.js +54 -54
- package/src/chat/engine.js +160 -160
- package/src/chat/gateway.js +163 -163
- package/src/chat/orchestrator.js +234 -234
- package/src/chat/prompt.js +70 -70
- package/src/chat/repl.js +88 -88
- package/src/chat/terminal.js +135 -135
- package/src/chat/tools.js +306 -306
- package/src/chat-pipeline/auto-race.js +1 -1
- package/src/chat-pipeline/index.js +123 -123
- package/src/chat-pipeline/policy.js +76 -76
- package/src/chat-pipeline/serial-trial.js +210 -210
- package/src/cli/commands/group.js +249 -249
- package/src/cli/commands/model/picks.js +50 -50
- package/src/cli/commands/provider/bench-via.js +247 -247
- package/src/cli/commands/provider/bench.js +141 -141
- package/src/cli/commands/provider/index.js +124 -124
- package/src/cli/commands/provider/models.js +139 -139
- package/src/cli/commands/provider/qwenwork-login.js +119 -119
- package/src/cli/commands/stats.js +20 -5
- package/src/cli/commands/sync.js +232 -232
- package/src/cli/provider-row.js +2 -2
- package/src/cli/status.js +279 -279
- package/src/daemon.js +96 -96
- package/src/model-capabilities/enrich.js +86 -86
- package/src/model-capabilities/index.js +183 -183
- package/src/model-capabilities/parse.js +70 -70
- package/src/models.js +225 -225
- package/src/providers/cline/auth.js +228 -228
- package/src/providers/cline/chat.js +307 -307
- package/src/providers/cline.js +2 -2
- package/src/providers/keyring.js +60 -60
- package/src/providers/qoder/chat.js +183 -183
- package/src/providers/qoder/index.js +230 -230
- package/src/providers/qoder/sse.js +103 -103
- package/src/providers/qwenwork/account-store.js +133 -133
- package/src/providers/qwenwork/constants.js +67 -67
- package/src/providers/qwenwork/cosy.js +120 -120
- package/src/providers/qwenwork/crypto.js +218 -218
- package/src/providers/qwenwork/http.js +20 -20
- package/src/providers/qwenwork/index.js +327 -327
- package/src/providers/qwenwork/payload.js +142 -142
- package/src/providers/qwenwork/rsa.js +54 -54
- package/src/providers/qwenwork/sse.js +268 -268
- package/src/providers/qwenwork/stream.js +130 -130
- package/src/providers/qwenwork/upstream.js +120 -120
- package/src/providers/qwenwork.js +1 -1
- package/src/providers/registry.js +66 -66
- package/src/providers/workbuddy/chat.js +248 -248
- package/src/providers/workbuddy/reshape.js +152 -152
- package/src/providers/workbuddy.js +2 -2
- package/src/providers/zcode/chat.js +11 -10
- package/src/providers/zcode/const.js +1 -1
- package/src/providers/zcode/context-shape.js +162 -0
- package/src/providers/zcode/headers.js +38 -0
- package/src/reasoning.js +32 -32
- package/src/routes/chat/broadband-handler.js +3 -2
- package/src/routes/chat/gateway.js +46 -46
- package/src/routes/chat/hedge-handler.js +3 -0
- package/src/routes/chat/local-handler.js +2 -0
- package/src/routes/chat/peer-handler.js +2 -0
- package/src/routes/chat/relay-pipeline.js +264 -250
- package/src/routes/chat/via-route-handler.js +146 -144
- package/src/routes/hedge.js +255 -255
- package/src/routes/models-route.js +167 -167
- package/src/routes/peers.js +273 -273
- package/src/routes/stream-scan.js +86 -0
- package/src/routes/stream.js +393 -438
- package/src/runtime/bootstrap.js +45 -45
- package/src/runtime/provider-gate.js +33 -33
- package/src/runtime/providers-setup.js +165 -165
- package/src/server.js +64 -64
- package/src/state/schemas/allowlist.js +92 -92
- package/src/sync-opencode.js +280 -280
- package/src/transport/index.js +244 -244
- package/src/transport/pool.js +56 -56
- package/src/transport/retry.js +24 -24
- package/src/transport/sse.js +93 -93
- package/src/upstream-probe/display.js +52 -52
- package/src/upstream-probe/probe.js +49 -49
- package/src/upstream-probe/rotate.js +110 -110
- package/src/upstream-probe/start.js +45 -45
- package/src/upstream.js +289 -289
- package/src/usage/record.js +8 -1
- package/src/usage/report.js +39 -2
- package/docs/ARCHITECTURE.md +0 -426
- package/docs/FEATURE_TREE.md +0 -164
- package/docs/MOBILE.md +0 -82
- package/docs/adr/0001-reasoning-content-injection.md +0 -14
- package/docs/adr/0002-models-free-filter.md +0 -12
- package/docs/adr/0003-zero-state-no-auth.md +0 -10
- package/docs/adr/0004-bearer-token.md +0 -18
- package/docs/adr/0005-peer-mesh.md +0 -53
- package/docs/adr/0006-broadband-member.md +0 -103
- package/docs/adr/0007-multi-provider-prefix.md +0 -25
- package/docs/adr/0008-share-keys-to-peers.md +0 -52
- package/docs/adr/0009-chat-repl.md +0 -37
- package/docs/adr/0010-allowlist.md +0 -36
- package/docs/adr/0011-broadband-stream.md +0 -30
- package/docs/adr/0012-responses-endpoint-codex-sync.md +0 -48
- package/docs/adr/0013-node16-compat.md +0 -41
- package/docs/adr/0014-deepseek-provider.md +0 -52
- package/docs/adr/0015-upstream-probe-routing.md +0 -50
- package/docs/adr/0016-model-capabilities.md +0 -27
- package/docs/adr/0017-ai-sdk-upstream-engine.md +0 -59
- package/docs/adr/0018-zen-client-identity.md +0 -52
- package/docs/adr/0019-share-keys-always-lend.md +0 -59
- package/docs/adr/0020-zen-free-lane-agent-shape.md +0 -52
- package/docs/adr/0021-usage-report-jsonl.md +0 -47
- package/docs/adr/0022-models-capability-merge.md +0 -61
- package/docs/adr/0023-key-provider-default-direct.md +0 -58
- package/docs/adr/0024-node18-baseline.md +0 -63
- package/docs/adr/0025-workbuddy-authdir-follows-state.md +0 -71
- package/docs/adr/0026-cline-provider-id-unify.md +0 -67
- package/docs/adr/0027-codearts-provider.md +0 -48
- package/docs/adr/0028-traework-provider.md +0 -34
- package/docs/adr/0029-qoder-native-provider.md +0 -60
- package/docs/adr/0030-models-list-scoped-by-picks.md +0 -53
- package/docs/adr/0031-qoder-true-streaming.md +0 -50
- package/docs/adr/0032-generic-responses-channel.md +0 -72
- package/docs/adr/0033-cline-allowlist-auto-sync.md +0 -75
- package/docs/adr/0034-request-level-human-readable-observability.md +0 -60
- package/docs/adr/0035-sdk-channel-headers-timeout.md +0 -49
- package/docs/adr/0036-qoder-per-request-sticky-account.md +0 -82
- package/docs/adr/0037-qwenwork-independent-provider.md +0 -82
- package/docs/adr/0038-zcode-provider.md +0 -140
- package/docs/agents/domain.md +0 -51
- package/docs/agents/issue-tracker.md +0 -30
- package/docs/agents/triage-labels.md +0 -15
- package/docs/cli_help.md +0 -1391
- package/docs/cli_help_mini.md +0 -133
- package/docs/plans/bench-via-latency-2026-09-01.md +0 -215
- package/docs/plugins.md +0 -187
package/src/chat/engine.js
CHANGED
|
@@ -1,160 +1,160 @@
|
|
|
1
|
-
import { performance } from "node:perf_hooks";
|
|
2
|
-
import { estimateChars, needsCompress } from "./store.js";
|
|
3
|
-
import { CHAT_KEEP_RECENT, CHAT_MAX_TOOL_LOOPS } from "./config.js";
|
|
4
|
-
import { buildDedupKey, runTool } from "./tool-handlers.js";
|
|
5
|
-
|
|
6
|
-
// 纯引擎:无 readline/ANSI/spinner,单一 runTurn 可测
|
|
7
|
-
export function createEngine({
|
|
8
|
-
chatWithFallback,
|
|
9
|
-
summarizeHistory,
|
|
10
|
-
getToolDefs = () => [],
|
|
11
|
-
execCommand,
|
|
12
|
-
readFileTool,
|
|
13
|
-
curlTool,
|
|
14
|
-
onTrace = () => {},
|
|
15
|
-
config = {},
|
|
16
|
-
} = {}) {
|
|
17
|
-
const CWF = chatWithFallback || (async () => ({ ok: false, error: "no chat" }));
|
|
18
|
-
const SUM = summarizeHistory || (async () => null);
|
|
19
|
-
const GTOOLS = getToolDefs;
|
|
20
|
-
const EXEC = execCommand || (async () => ({ ok: false, output: "no exec" }));
|
|
21
|
-
const READ = readFileTool || (async () => ({ ok: false, output: "no read" }));
|
|
22
|
-
const CURL = curlTool || (async () => ({ ok: false, output: "no curl" }));
|
|
23
|
-
|
|
24
|
-
async function maybeCompress(messages) {
|
|
25
|
-
if (!needsCompress(messages)) return [...messages];
|
|
26
|
-
const sys = messages[0];
|
|
27
|
-
const rest = messages.slice(1);
|
|
28
|
-
if (rest.length <= CHAT_KEEP_RECENT + 2) return [...messages];
|
|
29
|
-
const t0 = performance.now();
|
|
30
|
-
const toSummarize = rest.slice(0, -CHAT_KEEP_RECENT);
|
|
31
|
-
const keep = rest.slice(-CHAT_KEEP_RECENT);
|
|
32
|
-
const chars = estimateChars(messages);
|
|
33
|
-
onTrace(`[压缩] 触发 ${chars}字 > 400000阈值 · 待压 ${toSummarize.length}条 保留 ${keep.length}条`);
|
|
34
|
-
const summary = await SUM(toSummarize);
|
|
35
|
-
const dt = Math.round(performance.now() - t0);
|
|
36
|
-
if (!summary) {
|
|
37
|
-
onTrace(`[压缩] 失败/空 · ${dt}ms → 截断`);
|
|
38
|
-
return [sys, ...keep];
|
|
39
|
-
}
|
|
40
|
-
const summaryMsg = { role: "system", content: summary };
|
|
41
|
-
const next = [sys, summaryMsg, ...keep];
|
|
42
|
-
onTrace(`[压缩] 完成 ${toSummarize.length}条→${summary.length}字 · ${dt}ms · 新总量约 ${estimateChars(next)}字`);
|
|
43
|
-
return next;
|
|
44
|
-
}
|
|
45
|
-
|
|
46
|
-
async function runTurn(userText, messages, modelOverride) {
|
|
47
|
-
const tools = GTOOLS();
|
|
48
|
-
messages.push({ role: "user", content: userText });
|
|
49
|
-
let loops = 0;
|
|
50
|
-
let lastModel = null;
|
|
51
|
-
let lastProvider = null;
|
|
52
|
-
let lastUsage = null;
|
|
53
|
-
let lastFallback = false;
|
|
54
|
-
let lastFallbackGateway = false;
|
|
55
|
-
let lastLatency = 0;
|
|
56
|
-
const t0 = performance.now();
|
|
57
|
-
const turnStart = performance.now();
|
|
58
|
-
const seenCalls = new Map();
|
|
59
|
-
let duplicateStrikes = 0;
|
|
60
|
-
let forceNoTools = false;
|
|
61
|
-
onTrace(`[turn] 开始 "${userText.slice(0, 60)}${userText.length > 60 ? "…" : ""}" · 历史 ${messages.length}条 约 ${estimateChars(messages)}字`);
|
|
62
|
-
while (loops < CHAT_MAX_TOOL_LOOPS) {
|
|
63
|
-
const tLoop = performance.now();
|
|
64
|
-
const tComp = performance.now();
|
|
65
|
-
const cur = await maybeCompress(messages);
|
|
66
|
-
const compressMs = Math.round(performance.now() - tComp);
|
|
67
|
-
if (compressMs > 50) onTrace(`[loop ${loops}] 压缩耗时 ${compressMs}ms`);
|
|
68
|
-
messages.length = 0;
|
|
69
|
-
for (const m of cur) messages.push(m);
|
|
70
|
-
const tCall = performance.now();
|
|
71
|
-
let res;
|
|
72
|
-
const activeTools = forceNoTools ? [] : tools;
|
|
73
|
-
res = await CWF({ messages, tools: activeTools, model: modelOverride || undefined });
|
|
74
|
-
if (forceNoTools && res.ok && res.message?.tool_calls?.length) {
|
|
75
|
-
onTrace(`[guard] 禁工具模式下仍收到 tool_calls,已拦截`);
|
|
76
|
-
res.message.tool_calls = [];
|
|
77
|
-
if (!res.message.content) res.message.content = "(已拦截违规工具调用,请基于已有结果直接回答)";
|
|
78
|
-
}
|
|
79
|
-
const llmMs = Math.round(performance.now() - tCall);
|
|
80
|
-
onTrace(`[loop ${loops}] LLM ${llmMs}ms${compressMs > 50 ? ` (含压缩 ${compressMs}ms)` : ""} · ${estimateChars(messages)}字上下文`);
|
|
81
|
-
lastLatency = llmMs;
|
|
82
|
-
if (!res.ok) {
|
|
83
|
-
const err = `大模型暂不可用:${res.error}`;
|
|
84
|
-
messages.push({ role: "assistant", content: err });
|
|
85
|
-
return { text: err, model: null, latency: lastLatency, usage: null, fallback: false, ok: false };
|
|
86
|
-
}
|
|
87
|
-
lastModel = res.model;
|
|
88
|
-
lastProvider = res.provider || null;
|
|
89
|
-
lastUsage = res.usage || null;
|
|
90
|
-
lastFallback = !!res.fallback;
|
|
91
|
-
lastFallbackGateway = !!res.fallbackGateway || !!res.viaGateway;
|
|
92
|
-
const msg = res.message;
|
|
93
|
-
const toolCalls = msg.tool_calls || [];
|
|
94
|
-
let fallbackCmd = null;
|
|
95
|
-
if (!toolCalls.length && msg.content) {
|
|
96
|
-
const m = String(msg.content).match(/\{[^}]*"command"\s*:\s*"([^"]+)"[^}]*\}/);
|
|
97
|
-
if (m) fallbackCmd = m[1];
|
|
98
|
-
}
|
|
99
|
-
if (!toolCalls.length && !fallbackCmd) {
|
|
100
|
-
const text = String(msg.content || "").trim() || "(空回复)";
|
|
101
|
-
messages.push({ role: "assistant", content: text });
|
|
102
|
-
const totalMs = Math.round(performance.now() - t0);
|
|
103
|
-
let note = "";
|
|
104
|
-
if (lastFallbackGateway) note = "\n[注:mimo/big-pickle 均不可用,已自动切本地网关 auto(:8989)]";
|
|
105
|
-
else if (lastFallback) note = "\n[注:mimo 不可用,已用 big-pickle]";
|
|
106
|
-
onTrace(`[turn] 完成 总计 ${totalMs}ms · LLM ${lastLatency}ms · 0 工具${lastFallbackGateway ? " · gateway-fallback" : ""}`);
|
|
107
|
-
return { text: text + note, model: lastModel, provider: lastProvider, latency: lastLatency, usage: lastUsage, fallback: lastFallback, fallbackGateway: lastFallbackGateway, ok: true, totalMs };
|
|
108
|
-
}
|
|
109
|
-
const calls = toolCalls.length ? toolCalls : [{ id: "fallback-1", function: { name: "run_command", arguments: JSON.stringify({ command: fallbackCmd }) } }];
|
|
110
|
-
messages.push({ role: "assistant", content: msg.content || "", tool_calls: calls.map((c) => ({ id: c.id, type: "function", function: c.function })) });
|
|
111
|
-
onTrace(`[tools] 本轮 ${calls.length} 个调用 ${calls.map((c) => c.function?.name).join(",")} · 顺序执行`);
|
|
112
|
-
const tTools = performance.now();
|
|
113
|
-
const toolResults = [];
|
|
114
|
-
const toolDeps = { execCommand: EXEC, readFileTool: READ, curlTool: CURL, onTrace };
|
|
115
|
-
for (const c of calls) {
|
|
116
|
-
const name = c.function?.name;
|
|
117
|
-
let args = {};
|
|
118
|
-
try { args = JSON.parse(c.function?.arguments || "{}"); } catch {}
|
|
119
|
-
const t1 = performance.now();
|
|
120
|
-
const dedupKey = buildDedupKey(name, args);
|
|
121
|
-
const seen = seenCalls.get(dedupKey);
|
|
122
|
-
if (seen) {
|
|
123
|
-
const dt = Math.round(performance.now() - t1);
|
|
124
|
-
onTrace(`[tool] ${name} 重复调用已跳过 · ${dt}ms · 之前 ${seen.count} 次`);
|
|
125
|
-
toolResults.push({
|
|
126
|
-
id: c.id,
|
|
127
|
-
content: `SKIPPED_DUP: 此工具调用在本轮已执行过 ${seen.count} 次,结果相同请直接基于已有信息回答用户,不要再重复调用。\n--- 首次结果复用 ---\n${seen.firstResult.slice(0, 6000)}`,
|
|
128
|
-
});
|
|
129
|
-
continue;
|
|
130
|
-
}
|
|
131
|
-
const result = await runTool({ name, args, userText, ...toolDeps });
|
|
132
|
-
if (!seenCalls.has(dedupKey)) seenCalls.set(dedupKey, { count: 1, firstResult: result });
|
|
133
|
-
else seenCalls.get(dedupKey).count++;
|
|
134
|
-
toolResults.push({ id: c.id, content: result });
|
|
135
|
-
}
|
|
136
|
-
for (const tr of toolResults) messages.push({ role: "tool", tool_call_id: tr.id, content: tr.content });
|
|
137
|
-
if (toolResults.some((tr) => String(tr.content).startsWith("SKIPPED_DUP"))) {
|
|
138
|
-
duplicateStrikes++;
|
|
139
|
-
forceNoTools = true;
|
|
140
|
-
messages.push({ role: "system", content: "系统提示:你已重复调用相同工具,工具侧已复用首次结果并跳过执行。你已被禁止再调用任何工具,必须立即基于以上工具结果用中文直接回答用户,0 工具调用。" });
|
|
141
|
-
onTrace(`[dup] 检测到重复调用 ${duplicateStrikes} 次,已禁用后续工具调用`);
|
|
142
|
-
if (duplicateStrikes >= 2) {
|
|
143
|
-
const seen = [...seenCalls.values()].map((v) => v.firstResult).join("\n---\n").slice(0, 6000);
|
|
144
|
-
const synth = `检测到重复调用已达 ${duplicateStrikes} 次,为避免空转,直接基于已有结果回答:\n\n${seen}`;
|
|
145
|
-
messages.push({ role: "assistant", content: synth });
|
|
146
|
-
const totalMs = Math.round(performance.now() - t0);
|
|
147
|
-
onTrace(`[turn] 提前结束(重复阈值) 总计 ${totalMs}ms`);
|
|
148
|
-
return { text: synth, model: lastModel || "local", provider: lastProvider, latency: lastLatency, usage: lastUsage, fallback: lastFallback, ok: true, totalMs };
|
|
149
|
-
}
|
|
150
|
-
}
|
|
151
|
-
const toolsMs = Math.round(performance.now() - tTools);
|
|
152
|
-
const loopMs = Math.round(performance.now() - tLoop);
|
|
153
|
-
onTrace(`[loop ${loops}] 工具 ${toolsMs}ms · 本轮总 ${loopMs}ms · 累计 ${Math.round(performance.now() - turnStart)}ms`);
|
|
154
|
-
loops++;
|
|
155
|
-
}
|
|
156
|
-
return { text: "(工具调用次数已达上限,已停止)", model: lastModel, latency: lastLatency, usage: lastUsage, fallback: lastFallback, fallbackGateway: lastFallbackGateway, ok: false };
|
|
157
|
-
}
|
|
158
|
-
|
|
159
|
-
return { runTurn, maybeCompress };
|
|
160
|
-
}
|
|
1
|
+
import { performance } from "node:perf_hooks";
|
|
2
|
+
import { estimateChars, needsCompress } from "./store.js";
|
|
3
|
+
import { CHAT_KEEP_RECENT, CHAT_MAX_TOOL_LOOPS } from "./config.js";
|
|
4
|
+
import { buildDedupKey, runTool } from "./tool-handlers.js";
|
|
5
|
+
|
|
6
|
+
// 纯引擎:无 readline/ANSI/spinner,单一 runTurn 可测
|
|
7
|
+
export function createEngine({
|
|
8
|
+
chatWithFallback,
|
|
9
|
+
summarizeHistory,
|
|
10
|
+
getToolDefs = () => [],
|
|
11
|
+
execCommand,
|
|
12
|
+
readFileTool,
|
|
13
|
+
curlTool,
|
|
14
|
+
onTrace = () => {},
|
|
15
|
+
config = {},
|
|
16
|
+
} = {}) {
|
|
17
|
+
const CWF = chatWithFallback || (async () => ({ ok: false, error: "no chat" }));
|
|
18
|
+
const SUM = summarizeHistory || (async () => null);
|
|
19
|
+
const GTOOLS = getToolDefs;
|
|
20
|
+
const EXEC = execCommand || (async () => ({ ok: false, output: "no exec" }));
|
|
21
|
+
const READ = readFileTool || (async () => ({ ok: false, output: "no read" }));
|
|
22
|
+
const CURL = curlTool || (async () => ({ ok: false, output: "no curl" }));
|
|
23
|
+
|
|
24
|
+
async function maybeCompress(messages) {
|
|
25
|
+
if (!needsCompress(messages)) return [...messages];
|
|
26
|
+
const sys = messages[0];
|
|
27
|
+
const rest = messages.slice(1);
|
|
28
|
+
if (rest.length <= CHAT_KEEP_RECENT + 2) return [...messages];
|
|
29
|
+
const t0 = performance.now();
|
|
30
|
+
const toSummarize = rest.slice(0, -CHAT_KEEP_RECENT);
|
|
31
|
+
const keep = rest.slice(-CHAT_KEEP_RECENT);
|
|
32
|
+
const chars = estimateChars(messages);
|
|
33
|
+
onTrace(`[压缩] 触发 ${chars}字 > 400000阈值 · 待压 ${toSummarize.length}条 保留 ${keep.length}条`);
|
|
34
|
+
const summary = await SUM(toSummarize);
|
|
35
|
+
const dt = Math.round(performance.now() - t0);
|
|
36
|
+
if (!summary) {
|
|
37
|
+
onTrace(`[压缩] 失败/空 · ${dt}ms → 截断`);
|
|
38
|
+
return [sys, ...keep];
|
|
39
|
+
}
|
|
40
|
+
const summaryMsg = { role: "system", content: summary };
|
|
41
|
+
const next = [sys, summaryMsg, ...keep];
|
|
42
|
+
onTrace(`[压缩] 完成 ${toSummarize.length}条→${summary.length}字 · ${dt}ms · 新总量约 ${estimateChars(next)}字`);
|
|
43
|
+
return next;
|
|
44
|
+
}
|
|
45
|
+
|
|
46
|
+
async function runTurn(userText, messages, modelOverride) {
|
|
47
|
+
const tools = GTOOLS();
|
|
48
|
+
messages.push({ role: "user", content: userText });
|
|
49
|
+
let loops = 0;
|
|
50
|
+
let lastModel = null;
|
|
51
|
+
let lastProvider = null;
|
|
52
|
+
let lastUsage = null;
|
|
53
|
+
let lastFallback = false;
|
|
54
|
+
let lastFallbackGateway = false;
|
|
55
|
+
let lastLatency = 0;
|
|
56
|
+
const t0 = performance.now();
|
|
57
|
+
const turnStart = performance.now();
|
|
58
|
+
const seenCalls = new Map();
|
|
59
|
+
let duplicateStrikes = 0;
|
|
60
|
+
let forceNoTools = false;
|
|
61
|
+
onTrace(`[turn] 开始 "${userText.slice(0, 60)}${userText.length > 60 ? "…" : ""}" · 历史 ${messages.length}条 约 ${estimateChars(messages)}字`);
|
|
62
|
+
while (loops < CHAT_MAX_TOOL_LOOPS) {
|
|
63
|
+
const tLoop = performance.now();
|
|
64
|
+
const tComp = performance.now();
|
|
65
|
+
const cur = await maybeCompress(messages);
|
|
66
|
+
const compressMs = Math.round(performance.now() - tComp);
|
|
67
|
+
if (compressMs > 50) onTrace(`[loop ${loops}] 压缩耗时 ${compressMs}ms`);
|
|
68
|
+
messages.length = 0;
|
|
69
|
+
for (const m of cur) messages.push(m);
|
|
70
|
+
const tCall = performance.now();
|
|
71
|
+
let res;
|
|
72
|
+
const activeTools = forceNoTools ? [] : tools;
|
|
73
|
+
res = await CWF({ messages, tools: activeTools, model: modelOverride || undefined });
|
|
74
|
+
if (forceNoTools && res.ok && res.message?.tool_calls?.length) {
|
|
75
|
+
onTrace(`[guard] 禁工具模式下仍收到 tool_calls,已拦截`);
|
|
76
|
+
res.message.tool_calls = [];
|
|
77
|
+
if (!res.message.content) res.message.content = "(已拦截违规工具调用,请基于已有结果直接回答)";
|
|
78
|
+
}
|
|
79
|
+
const llmMs = Math.round(performance.now() - tCall);
|
|
80
|
+
onTrace(`[loop ${loops}] LLM ${llmMs}ms${compressMs > 50 ? ` (含压缩 ${compressMs}ms)` : ""} · ${estimateChars(messages)}字上下文`);
|
|
81
|
+
lastLatency = llmMs;
|
|
82
|
+
if (!res.ok) {
|
|
83
|
+
const err = `大模型暂不可用:${res.error}`;
|
|
84
|
+
messages.push({ role: "assistant", content: err });
|
|
85
|
+
return { text: err, model: null, latency: lastLatency, usage: null, fallback: false, ok: false };
|
|
86
|
+
}
|
|
87
|
+
lastModel = res.model;
|
|
88
|
+
lastProvider = res.provider || null;
|
|
89
|
+
lastUsage = res.usage || null;
|
|
90
|
+
lastFallback = !!res.fallback;
|
|
91
|
+
lastFallbackGateway = !!res.fallbackGateway || !!res.viaGateway;
|
|
92
|
+
const msg = res.message;
|
|
93
|
+
const toolCalls = msg.tool_calls || [];
|
|
94
|
+
let fallbackCmd = null;
|
|
95
|
+
if (!toolCalls.length && msg.content) {
|
|
96
|
+
const m = String(msg.content).match(/\{[^}]*"command"\s*:\s*"([^"]+)"[^}]*\}/);
|
|
97
|
+
if (m) fallbackCmd = m[1];
|
|
98
|
+
}
|
|
99
|
+
if (!toolCalls.length && !fallbackCmd) {
|
|
100
|
+
const text = String(msg.content || "").trim() || "(空回复)";
|
|
101
|
+
messages.push({ role: "assistant", content: text });
|
|
102
|
+
const totalMs = Math.round(performance.now() - t0);
|
|
103
|
+
let note = "";
|
|
104
|
+
if (lastFallbackGateway) note = "\n[注:mimo/big-pickle 均不可用,已自动切本地网关 auto(:8989)]";
|
|
105
|
+
else if (lastFallback) note = "\n[注:mimo 不可用,已用 big-pickle]";
|
|
106
|
+
onTrace(`[turn] 完成 总计 ${totalMs}ms · LLM ${lastLatency}ms · 0 工具${lastFallbackGateway ? " · gateway-fallback" : ""}`);
|
|
107
|
+
return { text: text + note, model: lastModel, provider: lastProvider, latency: lastLatency, usage: lastUsage, fallback: lastFallback, fallbackGateway: lastFallbackGateway, ok: true, totalMs };
|
|
108
|
+
}
|
|
109
|
+
const calls = toolCalls.length ? toolCalls : [{ id: "fallback-1", function: { name: "run_command", arguments: JSON.stringify({ command: fallbackCmd }) } }];
|
|
110
|
+
messages.push({ role: "assistant", content: msg.content || "", tool_calls: calls.map((c) => ({ id: c.id, type: "function", function: c.function })) });
|
|
111
|
+
onTrace(`[tools] 本轮 ${calls.length} 个调用 ${calls.map((c) => c.function?.name).join(",")} · 顺序执行`);
|
|
112
|
+
const tTools = performance.now();
|
|
113
|
+
const toolResults = [];
|
|
114
|
+
const toolDeps = { execCommand: EXEC, readFileTool: READ, curlTool: CURL, onTrace };
|
|
115
|
+
for (const c of calls) {
|
|
116
|
+
const name = c.function?.name;
|
|
117
|
+
let args = {};
|
|
118
|
+
try { args = JSON.parse(c.function?.arguments || "{}"); } catch {}
|
|
119
|
+
const t1 = performance.now();
|
|
120
|
+
const dedupKey = buildDedupKey(name, args);
|
|
121
|
+
const seen = seenCalls.get(dedupKey);
|
|
122
|
+
if (seen) {
|
|
123
|
+
const dt = Math.round(performance.now() - t1);
|
|
124
|
+
onTrace(`[tool] ${name} 重复调用已跳过 · ${dt}ms · 之前 ${seen.count} 次`);
|
|
125
|
+
toolResults.push({
|
|
126
|
+
id: c.id,
|
|
127
|
+
content: `SKIPPED_DUP: 此工具调用在本轮已执行过 ${seen.count} 次,结果相同请直接基于已有信息回答用户,不要再重复调用。\n--- 首次结果复用 ---\n${seen.firstResult.slice(0, 6000)}`,
|
|
128
|
+
});
|
|
129
|
+
continue;
|
|
130
|
+
}
|
|
131
|
+
const result = await runTool({ name, args, userText, ...toolDeps });
|
|
132
|
+
if (!seenCalls.has(dedupKey)) seenCalls.set(dedupKey, { count: 1, firstResult: result });
|
|
133
|
+
else seenCalls.get(dedupKey).count++;
|
|
134
|
+
toolResults.push({ id: c.id, content: result });
|
|
135
|
+
}
|
|
136
|
+
for (const tr of toolResults) messages.push({ role: "tool", tool_call_id: tr.id, content: tr.content });
|
|
137
|
+
if (toolResults.some((tr) => String(tr.content).startsWith("SKIPPED_DUP"))) {
|
|
138
|
+
duplicateStrikes++;
|
|
139
|
+
forceNoTools = true;
|
|
140
|
+
messages.push({ role: "system", content: "系统提示:你已重复调用相同工具,工具侧已复用首次结果并跳过执行。你已被禁止再调用任何工具,必须立即基于以上工具结果用中文直接回答用户,0 工具调用。" });
|
|
141
|
+
onTrace(`[dup] 检测到重复调用 ${duplicateStrikes} 次,已禁用后续工具调用`);
|
|
142
|
+
if (duplicateStrikes >= 2) {
|
|
143
|
+
const seen = [...seenCalls.values()].map((v) => v.firstResult).join("\n---\n").slice(0, 6000);
|
|
144
|
+
const synth = `检测到重复调用已达 ${duplicateStrikes} 次,为避免空转,直接基于已有结果回答:\n\n${seen}`;
|
|
145
|
+
messages.push({ role: "assistant", content: synth });
|
|
146
|
+
const totalMs = Math.round(performance.now() - t0);
|
|
147
|
+
onTrace(`[turn] 提前结束(重复阈值) 总计 ${totalMs}ms`);
|
|
148
|
+
return { text: synth, model: lastModel || "local", provider: lastProvider, latency: lastLatency, usage: lastUsage, fallback: lastFallback, ok: true, totalMs };
|
|
149
|
+
}
|
|
150
|
+
}
|
|
151
|
+
const toolsMs = Math.round(performance.now() - tTools);
|
|
152
|
+
const loopMs = Math.round(performance.now() - tLoop);
|
|
153
|
+
onTrace(`[loop ${loops}] 工具 ${toolsMs}ms · 本轮总 ${loopMs}ms · 累计 ${Math.round(performance.now() - turnStart)}ms`);
|
|
154
|
+
loops++;
|
|
155
|
+
}
|
|
156
|
+
return { text: "(工具调用次数已达上限,已停止)", model: lastModel, latency: lastLatency, usage: lastUsage, fallback: lastFallback, fallbackGateway: lastFallbackGateway, ok: false };
|
|
157
|
+
}
|
|
158
|
+
|
|
159
|
+
return { runTurn, maybeCompress };
|
|
160
|
+
}
|