@modusensus/dsh-mneme 0.5.0 → 0.5.2
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/README.md +419 -397
- package/lib/api.js +516 -516
- package/lib/commands.js +64 -64
- package/lib/config.js +252 -252
- package/lib/dream.js +817 -817
- package/lib/embedding.js +154 -154
- package/lib/hot-memory.js +7 -0
- package/lib/index.js +341 -341
- package/lib/inject.js +208 -208
- package/lib/local-embedder.js +282 -282
- package/lib/reranker.js +218 -215
- package/lib/service.js +1489 -1484
- package/lib/store.js +6 -2
- package/lib/summarize.js +5 -1
- package/lib/tools.js +7 -2
- package/package.json +1 -1
- package/scripts/sync-lib.js +7 -2
- package/src/hot-memory.js +53 -46
- package/src/reranker.js +218 -215
- package/src/service.js +1489 -1484
- package/src/store.js +6 -2
- package/src/summarize.js +5 -1
- package/src/tools.js +7 -2
- package/test/hot-memory.test.js +174 -145
- package/test/provenance.test.js +103 -0
- package/test/reranker.test.js +240 -197
- package/test/service-search.test.js +199 -174
package/lib/index.js
CHANGED
|
@@ -1,341 +1,341 @@
|
|
|
1
|
-
import { createStore } from "./store.js";
|
|
2
|
-
import { createMirror, TYPE_FILE } from "./mirror.js";
|
|
3
|
-
import { createService } from "./service.js";
|
|
4
|
-
import { createTools } from "./tools.js";
|
|
5
|
-
import { createInjector } from "./inject.js";
|
|
6
|
-
import { createSummarizer } from "./summarize.js";
|
|
7
|
-
import { createDreamScheduler } from "./dream.js";
|
|
8
|
-
import { createSleepScheduler, runSleep } from "./dream/sleep.js";
|
|
9
|
-
import { createApi } from "./api.js";
|
|
10
|
-
import { createSettings } from "./settings.js";
|
|
11
|
-
import { createCommandManager } from "./commands.js";
|
|
12
|
-
import { createEmbedder } from "./embedding.js";
|
|
13
|
-
import { createEmbedderByProvider } from "./local-embedder.js";
|
|
14
|
-
import { LocalReranker } from "./reranker.js";
|
|
15
|
-
import { createVectorIndex } from "./vector-index.js";
|
|
16
|
-
import { Config } from "./config.js";
|
|
17
|
-
import { extractEntities } from "./entities/extractor.js";
|
|
18
|
-
import { mkdirSync } from "node:fs";
|
|
19
|
-
import { join } from "node:path";
|
|
20
|
-
import { homedir } from "node:os";
|
|
21
|
-
|
|
22
|
-
export const name = "dsh-mneme";
|
|
23
|
-
export const inject = ["tools", "systemPrompt", "webServer", "llm", "agentDefaultModel", "commands"];
|
|
24
|
-
export { Config };
|
|
25
|
-
|
|
26
|
-
// Arrow (not function declaration): cordis 4 treats any apply with a
|
|
27
|
-
// prototype as a class constructor (`new apply(...)`) and discards its return
|
|
28
|
-
// value, so a `function apply` disposer would never run on unload. An arrow
|
|
29
|
-
// has no prototype, is called normally, and its returned disposer is collected
|
|
30
|
-
// and run by the fiber on unload.
|
|
31
|
-
export const apply = (ctx, config) => {
|
|
32
|
-
const cfg = Config(config);
|
|
33
|
-
|
|
34
|
-
// Resolve memoryDir: expand leading "~"
|
|
35
|
-
const memoryDir = cfg.memoryDir.startsWith("~")
|
|
36
|
-
? join(homedir(), cfg.memoryDir.slice(1))
|
|
37
|
-
: cfg.memoryDir;
|
|
38
|
-
mkdirSync(memoryDir, { recursive: true });
|
|
39
|
-
|
|
40
|
-
const store = createStore(join(memoryDir, "memory.db"));
|
|
41
|
-
// Prune reflection failure rows older than 90 days on boot (best-effort, so
|
|
42
|
-
// the failure table never grows unbounded).
|
|
43
|
-
try {
|
|
44
|
-
store.deleteOldFailures(new Date(Date.now() - 90 * 86400000).toISOString());
|
|
45
|
-
} catch { /* non-fatal */ }
|
|
46
|
-
// Bug8: enforce llm_audit_logs retention on boot (config.llmAudit.retentionDays,
|
|
47
|
-
// default 90). Best-effort like the failure prune — the audit trail is
|
|
48
|
-
// bookkeeping and a failed purge must never block plugin boot.
|
|
49
|
-
try {
|
|
50
|
-
if (cfg.llmAudit?.enabled !== false) {
|
|
51
|
-
const retentionMs = Number.isInteger(cfg.llmAudit?.retentionDays) ? cfg.llmAudit.retentionDays : 90;
|
|
52
|
-
store.deleteOldLlmAudits(new Date(Date.now() - retentionMs * 86400000).toISOString());
|
|
53
|
-
}
|
|
54
|
-
} catch { /* non-fatal */ }
|
|
55
|
-
const mirror = createMirror(memoryDir);
|
|
56
|
-
const service = createService({ store, mirror, config: cfg, logger: ctx.logger });
|
|
57
|
-
|
|
58
|
-
// F-NEW-03: if the mirror sync failed last run (persisted dirty state), retry
|
|
59
|
-
// a safe re-render at boot so a stale mirror converges without needing a
|
|
60
|
-
// business write. Bounded: single attempt; on failure dirty stays for the
|
|
61
|
-
// next boot. Never throws.
|
|
62
|
-
service.recoverMirror();
|
|
63
|
-
|
|
64
|
-
// Recall-layer receipt: when searchMemories runs with recordRecall=true, the
|
|
65
|
-
// retrieval scene (query/mode/topK/threshold + candidates) is persisted to
|
|
66
|
-
// recall_runs for audit/replay — the sibling of the dream_runs judgment trail.
|
|
67
|
-
// Best-effort: a failed recall write must never break the search.
|
|
68
|
-
service.setRecallRecorder((recall) => {
|
|
69
|
-
try {
|
|
70
|
-
store.saveRecallRun({
|
|
71
|
-
query: recall.query,
|
|
72
|
-
mode: recall.mode,
|
|
73
|
-
topK: recall.topK,
|
|
74
|
-
threshold: recall.threshold ?? null,
|
|
75
|
-
candidates: recall.candidates ?? [],
|
|
76
|
-
created_at: recall.createdAt
|
|
77
|
-
});
|
|
78
|
-
} catch { /* non-fatal: recall recording is bookkeeping */ }
|
|
79
|
-
});
|
|
80
|
-
|
|
81
|
-
// User-configurable settings (profile, rules) and custom commands share the
|
|
82
|
-
// same SQLite file but live in dedicated tables, isolated from memories.
|
|
83
|
-
const settings = createSettings(store.db);
|
|
84
|
-
|
|
85
|
-
// Semantic pipeline: a local/ollama embedder when configured, otherwise the
|
|
86
|
-
// legacy OpenAI-compatible embedder (settings-driven). The vector index wraps
|
|
87
|
-
// the store's embedding column and tracks the active model fingerprint. A
|
|
88
|
-
// slow embedder init (model download) never blocks plugin boot — failures
|
|
89
|
-
// degrade to keyword search.
|
|
90
|
-
const vectorIndex = createVectorIndex({ store, logger: ctx.logger });
|
|
91
|
-
service.setVectorIndex(vectorIndex);
|
|
92
|
-
|
|
93
|
-
// Human edits in mirror files win on every sync; merge them back first.
|
|
94
|
-
// TYPE_FILE maps each memory type to its mirror filename. Read every type's
|
|
95
|
-
// edits up front: mergeHumanEdits re-renders ALL mirror files on success, so
|
|
96
|
-
// a per-type read-then-merge loop would overwrite edits in files not yet read
|
|
97
|
-
// (e.g. preferences.md merging would clobber unsynced projects.md edits).
|
|
98
|
-
const humanEdits = new Map();
|
|
99
|
-
for (const type of Object.keys(TYPE_FILE)) {
|
|
100
|
-
humanEdits.set(type, mirror.readHumanEdits(type));
|
|
101
|
-
}
|
|
102
|
-
const applyHumanEdits = () => {
|
|
103
|
-
for (const [type, edits] of humanEdits) {
|
|
104
|
-
if (edits.length) service.mergeHumanEdits(type, edits);
|
|
105
|
-
}
|
|
106
|
-
};
|
|
107
|
-
|
|
108
|
-
let embedder = null;
|
|
109
|
-
let reranker = null;
|
|
110
|
-
if (cfg.embedProvider === "openai") {
|
|
111
|
-
// vectorIndex is passed so the legacy OpenAI embedder records the producing
|
|
112
|
-
// model fingerprint after each successful embed (Bug3).
|
|
113
|
-
embedder = createEmbedder({ store, settings, logger: ctx.logger, vectorIndex });
|
|
114
|
-
service.setEmbedder(embedder);
|
|
115
|
-
// legacy OpenAI embedder is immediately usable
|
|
116
|
-
applyHumanEdits();
|
|
117
|
-
} else {
|
|
118
|
-
try {
|
|
119
|
-
embedder = createEmbedderByProvider(cfg.embedProvider, {
|
|
120
|
-
model: cfg.embedProvider === "ollama" ? cfg.ollamaModel : cfg.localEmbedModel,
|
|
121
|
-
dimension: cfg.localEmbedDimension,
|
|
122
|
-
device: cfg.localEmbedDevice,
|
|
123
|
-
batchSize: cfg.localEmbedBatchSize,
|
|
124
|
-
cacheDir: cfg.embedModelCacheDir,
|
|
125
|
-
baseUrl: cfg.ollamaBaseUrl,
|
|
126
|
-
logger: ctx.logger
|
|
127
|
-
});
|
|
128
|
-
service.setEmbedder(embedder);
|
|
129
|
-
// issue #6: wait for extractor init before applying human edits, so
|
|
130
|
-
// scheduled embeddings see a ready embedder.
|
|
131
|
-
embedder.init()
|
|
132
|
-
.then(() => applyHumanEdits())
|
|
133
|
-
.catch((error) => {
|
|
134
|
-
ctx.logger?.warn?.(`[dsh-mneme] embedder init failed, search degrades to keyword: ${String(error)}`);
|
|
135
|
-
service.setEmbedder(null);
|
|
136
|
-
applyHumanEdits();
|
|
137
|
-
});
|
|
138
|
-
} catch (error) {
|
|
139
|
-
ctx.logger?.warn?.(`[dsh-mneme] embedder unavailable, search degrades to keyword: ${String(error)}`);
|
|
140
|
-
applyHumanEdits();
|
|
141
|
-
}
|
|
142
|
-
}
|
|
143
|
-
|
|
144
|
-
// Cross-encoder rerank over recall candidates. Best-effort: a failed model
|
|
145
|
-
// load only disables reranking, never search itself. Explicit opt-in only
|
|
146
|
-
// (rerankEnabled defaults to false): constructing LocalReranker is what pulls
|
|
147
|
-
// in onnxruntime, so the default config never loads it (item ⑥).
|
|
148
|
-
if (cfg.rerankEnabled && cfg.rerankProvider === "local") {
|
|
149
|
-
try {
|
|
150
|
-
reranker = new LocalReranker({
|
|
151
|
-
model: cfg.rerankModel,
|
|
152
|
-
batchSize: cfg.rerankBatchSize,
|
|
153
|
-
maxCandidates: cfg.rerankMaxCandidates,
|
|
154
|
-
scoreThreshold: cfg.rerankScoreThreshold,
|
|
155
|
-
device: cfg.localEmbedDevice,
|
|
156
|
-
cacheDir: cfg.embedModelCacheDir,
|
|
157
|
-
logger: ctx.logger
|
|
158
|
-
});
|
|
159
|
-
service.setReranker(reranker);
|
|
160
|
-
reranker.init().catch((error) => {
|
|
161
|
-
ctx.logger?.warn?.(`[dsh-mneme] reranker init failed, rerank disabled: ${String(error)}`);
|
|
162
|
-
service.setReranker(null);
|
|
163
|
-
});
|
|
164
|
-
} catch (error) {
|
|
165
|
-
ctx.logger?.warn?.(`[dsh-mneme] reranker unavailable, rerank disabled: ${String(error)}`);
|
|
166
|
-
}
|
|
167
|
-
}
|
|
168
|
-
|
|
169
|
-
// Bug2: lazy auto-backfill of missing embeddings on boot. When the vector API
|
|
170
|
-
// is configured and rows still lack an embedding (e.g. written before vector
|
|
171
|
-
// search was enabled) AND the vector_meta fingerprint is absent or stale, the
|
|
172
|
-
// index is rebuilt in the background after a short delay. Gated on
|
|
173
|
-
// cfg.autoReindexOnBoot; rate-limited in small batches so a large backlog
|
|
174
|
-
// never floods the provider. Failures degrade silently — search stays keyword.
|
|
175
|
-
function scheduleAutoReindex() {
|
|
176
|
-
if (cfg.autoReindexOnBoot === false) return;
|
|
177
|
-
const attempt = (tries) => {
|
|
178
|
-
try {
|
|
179
|
-
if (!embedder || typeof embedder.embedSingle !== "function") return;
|
|
180
|
-
if ("ready" in embedder && embedder.ready !== true) {
|
|
181
|
-
// Local/ollama embedders init asynchronously; give them a moment
|
|
182
|
-
// before giving up on this boot (next boot retries).
|
|
183
|
-
if (tries > 0) setTimeout(() => attempt(tries - 1), 2000);
|
|
184
|
-
return;
|
|
185
|
-
}
|
|
186
|
-
if (!store.needsEmbedding(1).length) return; // nothing to backfill
|
|
187
|
-
// Model fingerprint gate: vectors already produced by the same model
|
|
188
|
-
// mean there is no drift and no rebuild needed.
|
|
189
|
-
const current = embedder.modelHash;
|
|
190
|
-
if (current && vectorIndex.modelHash?.() === current) return;
|
|
191
|
-
const BATCH = 10;
|
|
192
|
-
const MAX_TOTAL = 500; // bound boot-time work
|
|
193
|
-
(async () => {
|
|
194
|
-
let indexed = 0;
|
|
195
|
-
for (let done = 0; done < MAX_TOTAL;) {
|
|
196
|
-
const rows = store.needsEmbedding(BATCH);
|
|
197
|
-
if (!rows.length) break;
|
|
198
|
-
for (const row of rows) {
|
|
199
|
-
try {
|
|
200
|
-
const text = [row.title, row.content].filter(Boolean).join("\n");
|
|
201
|
-
const vector = await embedder.embedSingle(text);
|
|
202
|
-
if (vector?.length) {
|
|
203
|
-
store.setEmbedding(row.id, vector);
|
|
204
|
-
indexed++;
|
|
205
|
-
}
|
|
206
|
-
} catch { /* skip the bad row */ }
|
|
207
|
-
}
|
|
208
|
-
done += rows.length;
|
|
209
|
-
// Rate limit: space out batches so the provider is not hammered.
|
|
210
|
-
if (store.needsEmbedding(1).length) await new Promise((r) => setTimeout(r, 200));
|
|
211
|
-
}
|
|
212
|
-
if (indexed > 0 && current) vectorIndex.markModel?.(current, embedder.dimension);
|
|
213
|
-
ctx.logger?.info?.(`[dsh-mneme] auto-reindex backfilled ${indexed} embeddings on boot`);
|
|
214
|
-
})().catch((error) => {
|
|
215
|
-
ctx.logger?.warn?.(`[dsh-mneme] auto-reindex failed: ${String(error)}`);
|
|
216
|
-
});
|
|
217
|
-
} catch (error) {
|
|
218
|
-
ctx.logger?.warn?.(`[dsh-mneme] auto-reindex failed: ${String(error)}`);
|
|
219
|
-
}
|
|
220
|
-
};
|
|
221
|
-
setTimeout(() => attempt(5), 5000);
|
|
222
|
-
}
|
|
223
|
-
scheduleAutoReindex();
|
|
224
|
-
|
|
225
|
-
// Custom commands: register persisted commands into the DSH command registry
|
|
226
|
-
// on boot; add/remove re-register live through the API.
|
|
227
|
-
let commands = null;
|
|
228
|
-
if (ctx.commands) {
|
|
229
|
-
commands = createCommandManager({ ctx, settings, logger: ctx.logger });
|
|
230
|
-
commands.sync();
|
|
231
|
-
}
|
|
232
|
-
|
|
233
|
-
// Dream scheduler: automatic consolidation + summary runs, triggered by
|
|
234
|
-
// store growth. Writes through the service fire the dream hook, which asks
|
|
235
|
-
// the scheduler to (re)schedule a run once absolute and since-last-run
|
|
236
|
-
// thresholds are both exceeded. onRun is deferred through `dream` so the
|
|
237
|
-
// closure sees the assigned scheduler; the null guard keeps a run safe even
|
|
238
|
-
// if the hook fires before assignment or after dispose.
|
|
239
|
-
let dream = null;
|
|
240
|
-
if (cfg.autoDream) {
|
|
241
|
-
dream = createDreamScheduler({
|
|
242
|
-
thresholdCount: cfg.dreamThresholdCount,
|
|
243
|
-
thresholdChars: cfg.dreamThresholdChars,
|
|
244
|
-
delayMs: cfg.dreamDelayMs,
|
|
245
|
-
logger: ctx.logger,
|
|
246
|
-
semantic: { embedder, vectorIndex },
|
|
247
|
-
onRun: () => (dream ? dream.runDream(ctx, service, cfg) : Promise.resolve({ ok: true, skipped: true }))
|
|
248
|
-
});
|
|
249
|
-
service.setDreamHook(() => dream.maybeSchedule(service));
|
|
250
|
-
}
|
|
251
|
-
|
|
252
|
-
// Sleep scheduler (v0.4.0): idle-triggered deep maintenance. Fires when the
|
|
253
|
-
// store has been quiet for sleepIdleMinutes and re-arms on every write via
|
|
254
|
-
// noteWrite (hooked to the service's write path). Runs go through
|
|
255
|
-
// service.enqueue so they serialize with autoDream — the two never overlap.
|
|
256
|
-
// Abortable on user activity; audited into dream_runs with run_type='sleep'.
|
|
257
|
-
let sleep = null;
|
|
258
|
-
if (cfg.sleepModeEnabled) {
|
|
259
|
-
sleep = createSleepScheduler({
|
|
260
|
-
service,
|
|
261
|
-
config: cfg,
|
|
262
|
-
logger: ctx.logger,
|
|
263
|
-
onRun: (signal) => (sleep ? runSleep(ctx, service, cfg, ctx.logger, { embedder, vectorIndex }, signal) : Promise.resolve({ ok: true, skipped: true }))
|
|
264
|
-
});
|
|
265
|
-
service.setSleepHook(() => sleep.noteWrite());
|
|
266
|
-
}
|
|
267
|
-
|
|
268
|
-
// Entity gene extraction (v0.3.0): wire the extractor into the service as a
|
|
269
|
-
// hook so saveWithDedupe can fire-and-forget an extraction pass on fresh
|
|
270
|
-
// writes. The service never sees ctx.llm — index.js adapts it here into the
|
|
271
|
-
// callLLM(messages, options) => Promise<string> contract the extractor
|
|
272
|
-
// expects, reusing the same ctx.llm.stream consumption pattern as dream.js.
|
|
273
|
-
// Explicit opt-in only (entityExtractionEnabled defaults to false); any LLM
|
|
274
|
-
// failure degrades inside the extractor to { ok:false }, never a write error.
|
|
275
|
-
if (cfg.entityExtractionEnabled && ctx.llm) {
|
|
276
|
-
const streamEntityText = async (messages, options = {}) => {
|
|
277
|
-
let route = null;
|
|
278
|
-
if (options.model) {
|
|
279
|
-
route = { model: options.model };
|
|
280
|
-
} else {
|
|
281
|
-
try {
|
|
282
|
-
const sel = ctx.agentDefaultModel?.currentSelection?.();
|
|
283
|
-
if (sel?.provider && sel?.model) route = sel;
|
|
284
|
-
} catch { /* fall through to no route */ }
|
|
285
|
-
}
|
|
286
|
-
let text = "";
|
|
287
|
-
for await (const chunk of ctx.llm.stream({
|
|
288
|
-
...(route ?? {}),
|
|
289
|
-
purpose: "entity-extract",
|
|
290
|
-
maxTokens: 4096,
|
|
291
|
-
messages
|
|
292
|
-
})) {
|
|
293
|
-
if (chunk.type === "text-delta" && typeof chunk.text === "string") text += chunk.text;
|
|
294
|
-
if (chunk.type === "finish" && (chunk.reason?.kind === "error" || chunk.reason?.kind === "aborted")) return undefined;
|
|
295
|
-
}
|
|
296
|
-
return text;
|
|
297
|
-
};
|
|
298
|
-
service.setEntityExtractor((memory) =>
|
|
299
|
-
extractEntities(memory, { store, config: cfg, callLLM: streamEntityText, logger: ctx.logger })
|
|
300
|
-
.catch((err) => {
|
|
301
|
-
ctx.logger?.warn?.(`[dsh-mneme] entity extraction failed: ${String(err)}`);
|
|
302
|
-
return { ok: false, error: String(err) };
|
|
303
|
-
})
|
|
304
|
-
);
|
|
305
|
-
}
|
|
306
|
-
|
|
307
|
-
const disposers = [];
|
|
308
|
-
|
|
309
|
-
ctx.inject(["systemPrompt"], (promptCtx) => {
|
|
310
|
-
if (cfg.autoInject) disposers.push(createInjector(promptCtx, service, settings, cfg));
|
|
311
|
-
});
|
|
312
|
-
|
|
313
|
-
ctx.inject(["tools"], (toolsCtx) => {
|
|
314
|
-
disposers.push(createTools(toolsCtx, service, cfg, embedder));
|
|
315
|
-
});
|
|
316
|
-
|
|
317
|
-
const summarizer = createSummarizer(ctx, service, cfg);
|
|
318
|
-
disposers.push(summarizer.dispose);
|
|
319
|
-
|
|
320
|
-
if (ctx.webServer) {
|
|
321
|
-
const api = createApi(ctx, service, settings, commands ?? {
|
|
322
|
-
add: () => { throw new Error("commands unavailable"); },
|
|
323
|
-
remove: () => false,
|
|
324
|
-
list: () => []
|
|
325
|
-
}, embedder, { vectorIndex, reranker }, cfg.apiToken);
|
|
326
|
-
disposers.push(api.dispose);
|
|
327
|
-
}
|
|
328
|
-
|
|
329
|
-
// Async disposer: cordis awaits the returned promise on unload (runDisposable),
|
|
330
|
-
// so an in-flight dream run is allowed to finish before the SQLite store is
|
|
331
|
-
// closed — dream.dispose() resolves only after its current run settles.
|
|
332
|
-
return async () => {
|
|
333
|
-
for (const dispose of disposers) {
|
|
334
|
-
if (typeof dispose === "function") dispose();
|
|
335
|
-
}
|
|
336
|
-
commands?.dispose();
|
|
337
|
-
if (dream) await dream.dispose();
|
|
338
|
-
if (sleep) sleep.dispose();
|
|
339
|
-
store.close();
|
|
340
|
-
};
|
|
341
|
-
};
|
|
1
|
+
import { createStore } from "./store.js";
|
|
2
|
+
import { createMirror, TYPE_FILE } from "./mirror.js";
|
|
3
|
+
import { createService } from "./service.js";
|
|
4
|
+
import { createTools } from "./tools.js";
|
|
5
|
+
import { createInjector } from "./inject.js";
|
|
6
|
+
import { createSummarizer } from "./summarize.js";
|
|
7
|
+
import { createDreamScheduler } from "./dream.js";
|
|
8
|
+
import { createSleepScheduler, runSleep } from "./dream/sleep.js";
|
|
9
|
+
import { createApi } from "./api.js";
|
|
10
|
+
import { createSettings } from "./settings.js";
|
|
11
|
+
import { createCommandManager } from "./commands.js";
|
|
12
|
+
import { createEmbedder } from "./embedding.js";
|
|
13
|
+
import { createEmbedderByProvider } from "./local-embedder.js";
|
|
14
|
+
import { LocalReranker } from "./reranker.js";
|
|
15
|
+
import { createVectorIndex } from "./vector-index.js";
|
|
16
|
+
import { Config } from "./config.js";
|
|
17
|
+
import { extractEntities } from "./entities/extractor.js";
|
|
18
|
+
import { mkdirSync } from "node:fs";
|
|
19
|
+
import { join } from "node:path";
|
|
20
|
+
import { homedir } from "node:os";
|
|
21
|
+
|
|
22
|
+
export const name = "dsh-mneme";
|
|
23
|
+
export const inject = ["tools", "systemPrompt", "webServer", "llm", "agentDefaultModel", "commands"];
|
|
24
|
+
export { Config };
|
|
25
|
+
|
|
26
|
+
// Arrow (not function declaration): cordis 4 treats any apply with a
|
|
27
|
+
// prototype as a class constructor (`new apply(...)`) and discards its return
|
|
28
|
+
// value, so a `function apply` disposer would never run on unload. An arrow
|
|
29
|
+
// has no prototype, is called normally, and its returned disposer is collected
|
|
30
|
+
// and run by the fiber on unload.
|
|
31
|
+
export const apply = (ctx, config) => {
|
|
32
|
+
const cfg = Config(config);
|
|
33
|
+
|
|
34
|
+
// Resolve memoryDir: expand leading "~"
|
|
35
|
+
const memoryDir = cfg.memoryDir.startsWith("~")
|
|
36
|
+
? join(homedir(), cfg.memoryDir.slice(1))
|
|
37
|
+
: cfg.memoryDir;
|
|
38
|
+
mkdirSync(memoryDir, { recursive: true });
|
|
39
|
+
|
|
40
|
+
const store = createStore(join(memoryDir, "memory.db"));
|
|
41
|
+
// Prune reflection failure rows older than 90 days on boot (best-effort, so
|
|
42
|
+
// the failure table never grows unbounded).
|
|
43
|
+
try {
|
|
44
|
+
store.deleteOldFailures(new Date(Date.now() - 90 * 86400000).toISOString());
|
|
45
|
+
} catch { /* non-fatal */ }
|
|
46
|
+
// Bug8: enforce llm_audit_logs retention on boot (config.llmAudit.retentionDays,
|
|
47
|
+
// default 90). Best-effort like the failure prune — the audit trail is
|
|
48
|
+
// bookkeeping and a failed purge must never block plugin boot.
|
|
49
|
+
try {
|
|
50
|
+
if (cfg.llmAudit?.enabled !== false) {
|
|
51
|
+
const retentionMs = Number.isInteger(cfg.llmAudit?.retentionDays) ? cfg.llmAudit.retentionDays : 90;
|
|
52
|
+
store.deleteOldLlmAudits(new Date(Date.now() - retentionMs * 86400000).toISOString());
|
|
53
|
+
}
|
|
54
|
+
} catch { /* non-fatal */ }
|
|
55
|
+
const mirror = createMirror(memoryDir);
|
|
56
|
+
const service = createService({ store, mirror, config: cfg, logger: ctx.logger });
|
|
57
|
+
|
|
58
|
+
// F-NEW-03: if the mirror sync failed last run (persisted dirty state), retry
|
|
59
|
+
// a safe re-render at boot so a stale mirror converges without needing a
|
|
60
|
+
// business write. Bounded: single attempt; on failure dirty stays for the
|
|
61
|
+
// next boot. Never throws.
|
|
62
|
+
service.recoverMirror();
|
|
63
|
+
|
|
64
|
+
// Recall-layer receipt: when searchMemories runs with recordRecall=true, the
|
|
65
|
+
// retrieval scene (query/mode/topK/threshold + candidates) is persisted to
|
|
66
|
+
// recall_runs for audit/replay — the sibling of the dream_runs judgment trail.
|
|
67
|
+
// Best-effort: a failed recall write must never break the search.
|
|
68
|
+
service.setRecallRecorder((recall) => {
|
|
69
|
+
try {
|
|
70
|
+
store.saveRecallRun({
|
|
71
|
+
query: recall.query,
|
|
72
|
+
mode: recall.mode,
|
|
73
|
+
topK: recall.topK,
|
|
74
|
+
threshold: recall.threshold ?? null,
|
|
75
|
+
candidates: recall.candidates ?? [],
|
|
76
|
+
created_at: recall.createdAt
|
|
77
|
+
});
|
|
78
|
+
} catch { /* non-fatal: recall recording is bookkeeping */ }
|
|
79
|
+
});
|
|
80
|
+
|
|
81
|
+
// User-configurable settings (profile, rules) and custom commands share the
|
|
82
|
+
// same SQLite file but live in dedicated tables, isolated from memories.
|
|
83
|
+
const settings = createSettings(store.db);
|
|
84
|
+
|
|
85
|
+
// Semantic pipeline: a local/ollama embedder when configured, otherwise the
|
|
86
|
+
// legacy OpenAI-compatible embedder (settings-driven). The vector index wraps
|
|
87
|
+
// the store's embedding column and tracks the active model fingerprint. A
|
|
88
|
+
// slow embedder init (model download) never blocks plugin boot — failures
|
|
89
|
+
// degrade to keyword search.
|
|
90
|
+
const vectorIndex = createVectorIndex({ store, logger: ctx.logger });
|
|
91
|
+
service.setVectorIndex(vectorIndex);
|
|
92
|
+
|
|
93
|
+
// Human edits in mirror files win on every sync; merge them back first.
|
|
94
|
+
// TYPE_FILE maps each memory type to its mirror filename. Read every type's
|
|
95
|
+
// edits up front: mergeHumanEdits re-renders ALL mirror files on success, so
|
|
96
|
+
// a per-type read-then-merge loop would overwrite edits in files not yet read
|
|
97
|
+
// (e.g. preferences.md merging would clobber unsynced projects.md edits).
|
|
98
|
+
const humanEdits = new Map();
|
|
99
|
+
for (const type of Object.keys(TYPE_FILE)) {
|
|
100
|
+
humanEdits.set(type, mirror.readHumanEdits(type));
|
|
101
|
+
}
|
|
102
|
+
const applyHumanEdits = () => {
|
|
103
|
+
for (const [type, edits] of humanEdits) {
|
|
104
|
+
if (edits.length) service.mergeHumanEdits(type, edits);
|
|
105
|
+
}
|
|
106
|
+
};
|
|
107
|
+
|
|
108
|
+
let embedder = null;
|
|
109
|
+
let reranker = null;
|
|
110
|
+
if (cfg.embedProvider === "openai") {
|
|
111
|
+
// vectorIndex is passed so the legacy OpenAI embedder records the producing
|
|
112
|
+
// model fingerprint after each successful embed (Bug3).
|
|
113
|
+
embedder = createEmbedder({ store, settings, logger: ctx.logger, vectorIndex });
|
|
114
|
+
service.setEmbedder(embedder);
|
|
115
|
+
// legacy OpenAI embedder is immediately usable
|
|
116
|
+
applyHumanEdits();
|
|
117
|
+
} else {
|
|
118
|
+
try {
|
|
119
|
+
embedder = createEmbedderByProvider(cfg.embedProvider, {
|
|
120
|
+
model: cfg.embedProvider === "ollama" ? cfg.ollamaModel : cfg.localEmbedModel,
|
|
121
|
+
dimension: cfg.localEmbedDimension,
|
|
122
|
+
device: cfg.localEmbedDevice,
|
|
123
|
+
batchSize: cfg.localEmbedBatchSize,
|
|
124
|
+
cacheDir: cfg.embedModelCacheDir,
|
|
125
|
+
baseUrl: cfg.ollamaBaseUrl,
|
|
126
|
+
logger: ctx.logger
|
|
127
|
+
});
|
|
128
|
+
service.setEmbedder(embedder);
|
|
129
|
+
// issue #6: wait for extractor init before applying human edits, so
|
|
130
|
+
// scheduled embeddings see a ready embedder.
|
|
131
|
+
embedder.init()
|
|
132
|
+
.then(() => applyHumanEdits())
|
|
133
|
+
.catch((error) => {
|
|
134
|
+
ctx.logger?.warn?.(`[dsh-mneme] embedder init failed, search degrades to keyword: ${String(error)}`);
|
|
135
|
+
service.setEmbedder(null);
|
|
136
|
+
applyHumanEdits();
|
|
137
|
+
});
|
|
138
|
+
} catch (error) {
|
|
139
|
+
ctx.logger?.warn?.(`[dsh-mneme] embedder unavailable, search degrades to keyword: ${String(error)}`);
|
|
140
|
+
applyHumanEdits();
|
|
141
|
+
}
|
|
142
|
+
}
|
|
143
|
+
|
|
144
|
+
// Cross-encoder rerank over recall candidates. Best-effort: a failed model
|
|
145
|
+
// load only disables reranking, never search itself. Explicit opt-in only
|
|
146
|
+
// (rerankEnabled defaults to false): constructing LocalReranker is what pulls
|
|
147
|
+
// in onnxruntime, so the default config never loads it (item ⑥).
|
|
148
|
+
if (cfg.rerankEnabled && cfg.rerankProvider === "local") {
|
|
149
|
+
try {
|
|
150
|
+
reranker = new LocalReranker({
|
|
151
|
+
model: cfg.rerankModel,
|
|
152
|
+
batchSize: cfg.rerankBatchSize,
|
|
153
|
+
maxCandidates: cfg.rerankMaxCandidates,
|
|
154
|
+
scoreThreshold: cfg.rerankScoreThreshold,
|
|
155
|
+
device: cfg.localEmbedDevice,
|
|
156
|
+
cacheDir: cfg.embedModelCacheDir,
|
|
157
|
+
logger: ctx.logger
|
|
158
|
+
});
|
|
159
|
+
service.setReranker(reranker);
|
|
160
|
+
reranker.init().catch((error) => {
|
|
161
|
+
ctx.logger?.warn?.(`[dsh-mneme] reranker init failed, rerank disabled: ${String(error)}`);
|
|
162
|
+
service.setReranker(null);
|
|
163
|
+
});
|
|
164
|
+
} catch (error) {
|
|
165
|
+
ctx.logger?.warn?.(`[dsh-mneme] reranker unavailable, rerank disabled: ${String(error)}`);
|
|
166
|
+
}
|
|
167
|
+
}
|
|
168
|
+
|
|
169
|
+
// Bug2: lazy auto-backfill of missing embeddings on boot. When the vector API
|
|
170
|
+
// is configured and rows still lack an embedding (e.g. written before vector
|
|
171
|
+
// search was enabled) AND the vector_meta fingerprint is absent or stale, the
|
|
172
|
+
// index is rebuilt in the background after a short delay. Gated on
|
|
173
|
+
// cfg.autoReindexOnBoot; rate-limited in small batches so a large backlog
|
|
174
|
+
// never floods the provider. Failures degrade silently — search stays keyword.
|
|
175
|
+
function scheduleAutoReindex() {
|
|
176
|
+
if (cfg.autoReindexOnBoot === false) return;
|
|
177
|
+
const attempt = (tries) => {
|
|
178
|
+
try {
|
|
179
|
+
if (!embedder || typeof embedder.embedSingle !== "function") return;
|
|
180
|
+
if ("ready" in embedder && embedder.ready !== true) {
|
|
181
|
+
// Local/ollama embedders init asynchronously; give them a moment
|
|
182
|
+
// before giving up on this boot (next boot retries).
|
|
183
|
+
if (tries > 0) setTimeout(() => attempt(tries - 1), 2000);
|
|
184
|
+
return;
|
|
185
|
+
}
|
|
186
|
+
if (!store.needsEmbedding(1).length) return; // nothing to backfill
|
|
187
|
+
// Model fingerprint gate: vectors already produced by the same model
|
|
188
|
+
// mean there is no drift and no rebuild needed.
|
|
189
|
+
const current = embedder.modelHash;
|
|
190
|
+
if (current && vectorIndex.modelHash?.() === current) return;
|
|
191
|
+
const BATCH = 10;
|
|
192
|
+
const MAX_TOTAL = 500; // bound boot-time work
|
|
193
|
+
(async () => {
|
|
194
|
+
let indexed = 0;
|
|
195
|
+
for (let done = 0; done < MAX_TOTAL;) {
|
|
196
|
+
const rows = store.needsEmbedding(BATCH);
|
|
197
|
+
if (!rows.length) break;
|
|
198
|
+
for (const row of rows) {
|
|
199
|
+
try {
|
|
200
|
+
const text = [row.title, row.content].filter(Boolean).join("\n");
|
|
201
|
+
const vector = await embedder.embedSingle(text);
|
|
202
|
+
if (vector?.length) {
|
|
203
|
+
store.setEmbedding(row.id, vector);
|
|
204
|
+
indexed++;
|
|
205
|
+
}
|
|
206
|
+
} catch { /* skip the bad row */ }
|
|
207
|
+
}
|
|
208
|
+
done += rows.length;
|
|
209
|
+
// Rate limit: space out batches so the provider is not hammered.
|
|
210
|
+
if (store.needsEmbedding(1).length) await new Promise((r) => setTimeout(r, 200));
|
|
211
|
+
}
|
|
212
|
+
if (indexed > 0 && current) vectorIndex.markModel?.(current, embedder.dimension);
|
|
213
|
+
ctx.logger?.info?.(`[dsh-mneme] auto-reindex backfilled ${indexed} embeddings on boot`);
|
|
214
|
+
})().catch((error) => {
|
|
215
|
+
ctx.logger?.warn?.(`[dsh-mneme] auto-reindex failed: ${String(error)}`);
|
|
216
|
+
});
|
|
217
|
+
} catch (error) {
|
|
218
|
+
ctx.logger?.warn?.(`[dsh-mneme] auto-reindex failed: ${String(error)}`);
|
|
219
|
+
}
|
|
220
|
+
};
|
|
221
|
+
setTimeout(() => attempt(5), 5000);
|
|
222
|
+
}
|
|
223
|
+
scheduleAutoReindex();
|
|
224
|
+
|
|
225
|
+
// Custom commands: register persisted commands into the DSH command registry
|
|
226
|
+
// on boot; add/remove re-register live through the API.
|
|
227
|
+
let commands = null;
|
|
228
|
+
if (ctx.commands) {
|
|
229
|
+
commands = createCommandManager({ ctx, settings, logger: ctx.logger });
|
|
230
|
+
commands.sync();
|
|
231
|
+
}
|
|
232
|
+
|
|
233
|
+
// Dream scheduler: automatic consolidation + summary runs, triggered by
|
|
234
|
+
// store growth. Writes through the service fire the dream hook, which asks
|
|
235
|
+
// the scheduler to (re)schedule a run once absolute and since-last-run
|
|
236
|
+
// thresholds are both exceeded. onRun is deferred through `dream` so the
|
|
237
|
+
// closure sees the assigned scheduler; the null guard keeps a run safe even
|
|
238
|
+
// if the hook fires before assignment or after dispose.
|
|
239
|
+
let dream = null;
|
|
240
|
+
if (cfg.autoDream) {
|
|
241
|
+
dream = createDreamScheduler({
|
|
242
|
+
thresholdCount: cfg.dreamThresholdCount,
|
|
243
|
+
thresholdChars: cfg.dreamThresholdChars,
|
|
244
|
+
delayMs: cfg.dreamDelayMs,
|
|
245
|
+
logger: ctx.logger,
|
|
246
|
+
semantic: { embedder, vectorIndex },
|
|
247
|
+
onRun: () => (dream ? dream.runDream(ctx, service, cfg) : Promise.resolve({ ok: true, skipped: true }))
|
|
248
|
+
});
|
|
249
|
+
service.setDreamHook(() => dream.maybeSchedule(service));
|
|
250
|
+
}
|
|
251
|
+
|
|
252
|
+
// Sleep scheduler (v0.4.0): idle-triggered deep maintenance. Fires when the
|
|
253
|
+
// store has been quiet for sleepIdleMinutes and re-arms on every write via
|
|
254
|
+
// noteWrite (hooked to the service's write path). Runs go through
|
|
255
|
+
// service.enqueue so they serialize with autoDream — the two never overlap.
|
|
256
|
+
// Abortable on user activity; audited into dream_runs with run_type='sleep'.
|
|
257
|
+
let sleep = null;
|
|
258
|
+
if (cfg.sleepModeEnabled) {
|
|
259
|
+
sleep = createSleepScheduler({
|
|
260
|
+
service,
|
|
261
|
+
config: cfg,
|
|
262
|
+
logger: ctx.logger,
|
|
263
|
+
onRun: (signal) => (sleep ? runSleep(ctx, service, cfg, ctx.logger, { embedder, vectorIndex }, signal) : Promise.resolve({ ok: true, skipped: true }))
|
|
264
|
+
});
|
|
265
|
+
service.setSleepHook(() => sleep.noteWrite());
|
|
266
|
+
}
|
|
267
|
+
|
|
268
|
+
// Entity gene extraction (v0.3.0): wire the extractor into the service as a
|
|
269
|
+
// hook so saveWithDedupe can fire-and-forget an extraction pass on fresh
|
|
270
|
+
// writes. The service never sees ctx.llm — index.js adapts it here into the
|
|
271
|
+
// callLLM(messages, options) => Promise<string> contract the extractor
|
|
272
|
+
// expects, reusing the same ctx.llm.stream consumption pattern as dream.js.
|
|
273
|
+
// Explicit opt-in only (entityExtractionEnabled defaults to false); any LLM
|
|
274
|
+
// failure degrades inside the extractor to { ok:false }, never a write error.
|
|
275
|
+
if (cfg.entityExtractionEnabled && ctx.llm) {
|
|
276
|
+
const streamEntityText = async (messages, options = {}) => {
|
|
277
|
+
let route = null;
|
|
278
|
+
if (options.model) {
|
|
279
|
+
route = { model: options.model };
|
|
280
|
+
} else {
|
|
281
|
+
try {
|
|
282
|
+
const sel = ctx.agentDefaultModel?.currentSelection?.();
|
|
283
|
+
if (sel?.provider && sel?.model) route = sel;
|
|
284
|
+
} catch { /* fall through to no route */ }
|
|
285
|
+
}
|
|
286
|
+
let text = "";
|
|
287
|
+
for await (const chunk of ctx.llm.stream({
|
|
288
|
+
...(route ?? {}),
|
|
289
|
+
purpose: "entity-extract",
|
|
290
|
+
maxTokens: 4096,
|
|
291
|
+
messages
|
|
292
|
+
})) {
|
|
293
|
+
if (chunk.type === "text-delta" && typeof chunk.text === "string") text += chunk.text;
|
|
294
|
+
if (chunk.type === "finish" && (chunk.reason?.kind === "error" || chunk.reason?.kind === "aborted")) return undefined;
|
|
295
|
+
}
|
|
296
|
+
return text;
|
|
297
|
+
};
|
|
298
|
+
service.setEntityExtractor((memory) =>
|
|
299
|
+
extractEntities(memory, { store, config: cfg, callLLM: streamEntityText, logger: ctx.logger })
|
|
300
|
+
.catch((err) => {
|
|
301
|
+
ctx.logger?.warn?.(`[dsh-mneme] entity extraction failed: ${String(err)}`);
|
|
302
|
+
return { ok: false, error: String(err) };
|
|
303
|
+
})
|
|
304
|
+
);
|
|
305
|
+
}
|
|
306
|
+
|
|
307
|
+
const disposers = [];
|
|
308
|
+
|
|
309
|
+
ctx.inject(["systemPrompt"], (promptCtx) => {
|
|
310
|
+
if (cfg.autoInject) disposers.push(createInjector(promptCtx, service, settings, cfg));
|
|
311
|
+
});
|
|
312
|
+
|
|
313
|
+
ctx.inject(["tools"], (toolsCtx) => {
|
|
314
|
+
disposers.push(createTools(toolsCtx, service, cfg, embedder));
|
|
315
|
+
});
|
|
316
|
+
|
|
317
|
+
const summarizer = createSummarizer(ctx, service, cfg);
|
|
318
|
+
disposers.push(summarizer.dispose);
|
|
319
|
+
|
|
320
|
+
if (ctx.webServer) {
|
|
321
|
+
const api = createApi(ctx, service, settings, commands ?? {
|
|
322
|
+
add: () => { throw new Error("commands unavailable"); },
|
|
323
|
+
remove: () => false,
|
|
324
|
+
list: () => []
|
|
325
|
+
}, embedder, { vectorIndex, reranker }, cfg.apiToken);
|
|
326
|
+
disposers.push(api.dispose);
|
|
327
|
+
}
|
|
328
|
+
|
|
329
|
+
// Async disposer: cordis awaits the returned promise on unload (runDisposable),
|
|
330
|
+
// so an in-flight dream run is allowed to finish before the SQLite store is
|
|
331
|
+
// closed — dream.dispose() resolves only after its current run settles.
|
|
332
|
+
return async () => {
|
|
333
|
+
for (const dispose of disposers) {
|
|
334
|
+
if (typeof dispose === "function") dispose();
|
|
335
|
+
}
|
|
336
|
+
commands?.dispose();
|
|
337
|
+
if (dream) await dream.dispose();
|
|
338
|
+
if (sleep) sleep.dispose();
|
|
339
|
+
store.close();
|
|
340
|
+
};
|
|
341
|
+
};
|