@modusensus/dsh-mneme 0.6.7 → 0.6.9

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (139) hide show
  1. package/.github/workflows/test.yml +32 -0
  2. package/.release-notes-v0.6.9.md +13 -0
  3. package/CHANGELOG.md +89 -0
  4. package/LICENSE +21 -21
  5. package/README.md +219 -463
  6. package/SECURITY.md +544 -0
  7. package/docs/devlog/2026-08-14-dsh-mneme-dev-log.md +247 -0
  8. package/docs/devlog/2026-08-15-dsh-mneme-audit-stress-dev-log.md +145 -0
  9. package/docs/devlog/2026-08-15-dsh-mneme-pipeline-dev-log.md +56 -0
  10. package/docs/devlog/2026-08-15-dsh-mneme-reflection-dev-log.md +77 -0
  11. package/docs/devlog/2026-08-15-dsh-mneme-review-fixes-dev-log.md +64 -0
  12. package/docs/devlog/2026-08-15-dsh-mneme-semantic-dev-log.md +90 -0
  13. package/dsh-mneme/CHANGELOG.md +248 -0
  14. package/dsh-mneme/LICENSE +21 -0
  15. package/dsh-mneme/README.md +465 -0
  16. package/{cordis.patch.yml → dsh-mneme/cordis.patch.yml} +15 -15
  17. package/dsh-mneme/docs/AGENT_MEMORY_RESEARCH.md +183 -0
  18. package/dsh-mneme/docs/ENTITIES.md +245 -0
  19. package/dsh-mneme/docs/LOCAL_MODEL.md +141 -0
  20. package/dsh-mneme/docs/MIGRATION.md +127 -0
  21. package/dsh-mneme/docs/SEMANTIC.md +256 -0
  22. package/dsh-mneme/docs/SLEEP.md +163 -0
  23. package/{lib → dsh-mneme/lib}/api.js +783 -783
  24. package/{lib → dsh-mneme/lib}/client.js +1757 -1757
  25. package/{src → dsh-mneme/lib}/commands.js +64 -64
  26. package/{lib → dsh-mneme/lib}/config.js +298 -288
  27. package/{lib → dsh-mneme/lib}/dream/clustering.js +118 -118
  28. package/{src → dsh-mneme/lib}/dream/decisions.js +488 -439
  29. package/{lib → dsh-mneme/lib}/dream/sleep.js +561 -554
  30. package/{src → dsh-mneme/lib}/dream/tag-extractor.js +156 -156
  31. package/{lib → dsh-mneme/lib}/dream.js +958 -929
  32. package/{src → dsh-mneme/lib}/embedding.js +154 -154
  33. package/{src → dsh-mneme/lib}/entities/extractor.js +242 -242
  34. package/{src → dsh-mneme/lib}/hot-memory.js +53 -53
  35. package/{lib → dsh-mneme/lib}/index.js +361 -361
  36. package/{src → dsh-mneme/lib}/inject.js +208 -208
  37. package/{lib → dsh-mneme/lib}/local-embedder.js +282 -282
  38. package/{lib → dsh-mneme/lib}/mirror.js +170 -170
  39. package/{lib → dsh-mneme/lib}/parser/tag.js +59 -59
  40. package/{lib → dsh-mneme/lib}/parser/wiki-link.js +38 -38
  41. package/{src → dsh-mneme/lib}/quality-filter.js +123 -123
  42. package/{lib → dsh-mneme/lib}/reranker.js +218 -218
  43. package/{lib → dsh-mneme/lib}/search/adaptive.js +22 -22
  44. package/{lib → dsh-mneme/lib}/search/bm25.js +96 -96
  45. package/{src → dsh-mneme/lib}/search/tag-boost.js +61 -61
  46. package/{src → dsh-mneme/lib}/service.js +1726 -1726
  47. package/{lib → dsh-mneme/lib}/settings.js +172 -172
  48. package/{lib → dsh-mneme/lib}/store.js +2238 -2238
  49. package/{lib → dsh-mneme/lib}/summarize.js +236 -236
  50. package/{lib → dsh-mneme/lib}/tools.js +290 -290
  51. package/{lib → dsh-mneme/lib}/vector-index.js +116 -116
  52. package/dsh-mneme/package-lock.json +1936 -0
  53. package/dsh-mneme/package.json +80 -0
  54. package/{scripts → dsh-mneme/scripts}/benchmark-embed.js +201 -201
  55. package/{scripts → dsh-mneme/scripts}/benchmark-recall.js +133 -133
  56. package/{scripts → dsh-mneme/scripts}/benchmark-rerank.js +166 -166
  57. package/{scripts → dsh-mneme/scripts}/e2e-dsh.js +218 -218
  58. package/{scripts → dsh-mneme/scripts}/stress-dsh.js +255 -255
  59. package/{scripts → dsh-mneme/scripts}/sync-lib.js +52 -52
  60. package/{src → dsh-mneme/src}/api.js +783 -783
  61. package/{lib → dsh-mneme/src}/commands.js +64 -64
  62. package/{src → dsh-mneme/src}/config.js +298 -288
  63. package/{src → dsh-mneme/src}/dream/clustering.js +118 -118
  64. package/{lib → dsh-mneme/src}/dream/decisions.js +488 -439
  65. package/{src → dsh-mneme/src}/dream/sleep.js +561 -554
  66. package/{lib → dsh-mneme/src}/dream/tag-extractor.js +156 -156
  67. package/{src → dsh-mneme/src}/dream.js +958 -929
  68. package/{lib → dsh-mneme/src}/embedding.js +154 -154
  69. package/{lib → dsh-mneme/src}/entities/extractor.js +242 -242
  70. package/{lib → dsh-mneme/src}/hot-memory.js +53 -53
  71. package/{src → dsh-mneme/src}/index.js +361 -361
  72. package/{lib → dsh-mneme/src}/inject.js +208 -208
  73. package/{src → dsh-mneme/src}/local-embedder.js +282 -282
  74. package/{src → dsh-mneme/src}/mirror.js +170 -170
  75. package/{src → dsh-mneme/src}/parser/tag.js +59 -59
  76. package/{src → dsh-mneme/src}/parser/wiki-link.js +38 -38
  77. package/{lib → dsh-mneme/src}/quality-filter.js +123 -123
  78. package/{src → dsh-mneme/src}/reranker.js +218 -218
  79. package/{src → dsh-mneme/src}/search/adaptive.js +22 -22
  80. package/{src → dsh-mneme/src}/search/bm25.js +96 -96
  81. package/{lib → dsh-mneme/src}/search/tag-boost.js +61 -61
  82. package/{lib → dsh-mneme/src}/service.js +1726 -1726
  83. package/{src → dsh-mneme/src}/settings.js +172 -172
  84. package/{src → dsh-mneme/src}/store.js +2238 -2238
  85. package/{src → dsh-mneme/src}/summarize.js +236 -236
  86. package/{src → dsh-mneme/src}/tools.js +290 -290
  87. package/{src → dsh-mneme/src}/vector-index.js +116 -116
  88. package/{test → dsh-mneme/test}/api.test.js +594 -594
  89. package/{test → dsh-mneme/test}/audit.test.js +448 -448
  90. package/{test → dsh-mneme/test}/benchmark.test.js +35 -35
  91. package/{test → dsh-mneme/test}/boundary-v0625.test.js +82 -82
  92. package/{test → dsh-mneme/test}/client.test.js +368 -368
  93. package/{test → dsh-mneme/test}/clustering.test.js +100 -100
  94. package/{test → dsh-mneme/test}/commands.test.js +69 -69
  95. package/{test → dsh-mneme/test}/config.test.js +50 -50
  96. package/{test → dsh-mneme/test}/conflict-freeze.test.js +290 -290
  97. package/{test → dsh-mneme/test}/directory.test.js +134 -134
  98. package/{test → dsh-mneme/test}/dream.test.js +1060 -901
  99. package/{test → dsh-mneme/test}/entities.test.js +522 -522
  100. package/{test → dsh-mneme/test}/epistemic.test.js +298 -298
  101. package/{test → dsh-mneme/test}/fnew-0112.test.js +311 -311
  102. package/{test → dsh-mneme/test}/fnew-03.test.js +422 -422
  103. package/{test → dsh-mneme/test}/graph-api.test.js +175 -175
  104. package/{test → dsh-mneme/test}/helpers/dream-mock.js +82 -82
  105. package/{test → dsh-mneme/test}/hot-memory.test.js +174 -174
  106. package/{test → dsh-mneme/test}/inject.test.js +103 -103
  107. package/{test → dsh-mneme/test}/llm-audit.test.js +279 -279
  108. package/{test → dsh-mneme/test}/local-embedder.test.js +227 -227
  109. package/{test → dsh-mneme/test}/mirror-dirty.test.js +424 -424
  110. package/{test → dsh-mneme/test}/mirror-edit-digest.test.js +187 -187
  111. package/{test → dsh-mneme/test}/mirror-generation.test.js +499 -499
  112. package/{test → dsh-mneme/test}/mirror.test.js +249 -249
  113. package/{test → dsh-mneme/test}/normalize-decisions.test.js +120 -120
  114. package/{test → dsh-mneme/test}/peer-blockers.test.js +190 -190
  115. package/{test → dsh-mneme/test}/policy-epoch.test.js +259 -259
  116. package/{test → dsh-mneme/test}/provenance.test.js +103 -103
  117. package/{test → dsh-mneme/test}/quality-filter.test.js +118 -118
  118. package/{test → dsh-mneme/test}/reasoning-effort.test.js +199 -199
  119. package/{test → dsh-mneme/test}/recall-evals.test.js +235 -235
  120. package/{test → dsh-mneme/test}/recall-layer.test.js +315 -315
  121. package/{test → dsh-mneme/test}/receipt-chain.test.js +451 -451
  122. package/{test → dsh-mneme/test}/reflection.test.js +226 -226
  123. package/{test → dsh-mneme/test}/reranker.test.js +240 -240
  124. package/{test → dsh-mneme/test}/search-fusion.test.js +90 -90
  125. package/{test → dsh-mneme/test}/semantic.test.js +124 -124
  126. package/{test → dsh-mneme/test}/service-search.test.js +199 -199
  127. package/{test → dsh-mneme/test}/service.test.js +435 -435
  128. package/{test → dsh-mneme/test}/settings.test.js +118 -118
  129. package/{test → dsh-mneme/test}/sleep.test.js +365 -365
  130. package/{test → dsh-mneme/test}/store.test.js +436 -436
  131. package/{test → dsh-mneme/test}/stress.test.js +209 -209
  132. package/{test → dsh-mneme/test}/summarize.test.js +191 -191
  133. package/{test → dsh-mneme/test}/tag-boost.test.js +125 -125
  134. package/{test → dsh-mneme/test}/tag.test.js +312 -312
  135. package/{test → dsh-mneme/test}/tools.test.js +285 -285
  136. package/{test → dsh-mneme/test}/vector-index.test.js +221 -221
  137. package/{test → dsh-mneme/test}/wiki-link.test.js +332 -332
  138. package/package.json +18 -40
  139. package//346/250/252/345/271/205.png +0 -0
@@ -1,199 +1,199 @@
1
- import test from "node:test";
2
- import assert from "node:assert/strict";
3
- import { createStore } from "../src/store.js";
4
- import { createService } from "../src/service.js";
5
- import { createVectorIndex } from "../src/vector-index.js";
6
-
7
- // Mock embedder from the pipeline spec: every query maps to the fixed vector
8
- // [1,0,0], so vector recall surfaces any row embedded at [1,0,0] (cosine 1)
9
- // and ignores rows embedded elsewhere (cosine 0).
10
- const embedder = {
11
- embedSingle: async () => [1, 0, 0],
12
- embed: async () => [1, 0, 0],
13
- schedule: () => {}, // legacy path: scheduleEmbed uses schedule when present, so saveWithDedupe never calls embedSingle here
14
- modelHash: "mock#1",
15
- dimension: 3
16
- };
17
-
18
- // Mock reranker: scores candidates by their merge order (0,1,2,...) then sorts
19
- // descending — i.e. it reverses the incoming order. Deterministic, so tests can
20
- // assert the on/off difference precisely.
21
- const reranker = {
22
- rerank: async (q, cands) =>
23
- cands.map((c, i) => ({ id: c.id, score: i })).sort((a, b) => b.score - a.score)
24
- };
25
-
26
- // Real store + service, wired with the mock embedder and a vector index over
27
- // the same store (the service's vector path prefers vectorIndex when set).
28
- // The v0.5.0 recall fusion extras (BM25 third path, search-time semantic
29
- // dedup) are disabled per-test when the assertion targets the legacy blend
30
- // mechanics — the toy embedder pins every vector hit to the same [1,0,0],
31
- // which semantic dedup would legitimately collapse.
32
- function setup({ withEmbedder = true, config = {} } = {}) {
33
- const store = createStore(":memory:");
34
- const service = createService({ store, mirror: null, config });
35
- const vectorIndex = createVectorIndex({ store });
36
- if (withEmbedder) {
37
- service.setEmbedder(embedder);
38
- service.setVectorIndex(vectorIndex);
39
- }
40
- return { store, service, vectorIndex };
41
- }
42
-
43
- test("hybrid merges vector + keyword recalls and dedups shared memories", async () => {
44
- const { service, vectorIndex } = setup();
45
- // keyword-only hit: literal query in the title, embedding far from [1,0,0].
46
- const kw = service.saveWithDedupe({ type: "preference", title: "量子计算", content: "量子计算入门", importance: 5 });
47
- vectorIndex.saveEmbedding(kw.memory.id, [0, 1, 0]);
48
- // vector-only hit: no literal match, but embedded exactly at the query vector.
49
- const vec = service.saveWithDedupe({ type: "project", title: "猫", content: "喜欢猫" });
50
- vectorIndex.saveEmbedding(vec.memory.id, [1, 0, 0]);
51
- // both: literal match AND embedded at [1,0,0] -> must appear exactly once.
52
- const both = service.saveWithDedupe({ type: "decision", title: "量子计算笔记", content: "量子计算实践" });
53
- vectorIndex.saveEmbedding(both.memory.id, [1, 0, 0]);
54
-
55
- const rows = await service.searchMemories("量子计算", { mode: "hybrid", topK: 10 });
56
- const ids = rows.map((r) => r.id);
57
- assert.ok(ids.includes(vec.memory.id), "vector recall surfaces the semantic-only hit");
58
- assert.ok(ids.includes(kw.memory.id), "keyword recall surfaces the literal hit");
59
- assert.equal(ids.filter((id) => id === both.memory.id).length, 1, "overlap row is deduped to a single entry");
60
- assert.ok(rows.some((m) => m.id === both.memory.id && m.vector), "shared row is flagged as a vector hit");
61
- assert.equal(ids[0], vec.memory.id, "vector leads the hybrid blend");
62
- });
63
-
64
- test("hybrid blend honors configured vector/keyword weights", async () => {
65
- const { service, vectorIndex } = setup();
66
- const both = service.saveWithDedupe({ type: "preference", title: "量子计算", content: "量子计算入门" });
67
- vectorIndex.saveEmbedding(both.memory.id, [1, 0, 0]);
68
-
69
- // Title hit scores 1 * (0.5 + 3/10) = 0.8; vector cosine = 1.0.
70
- // Default weights (0.6/0.4) -> 0.6 + 0.32 = 0.92.
71
- const defaults = await service.searchMemories("量子计算", { mode: "hybrid", topK: 10 });
72
- const d = defaults.find((m) => m.id === both.memory.id);
73
- assert.ok(Math.abs(d.score - 0.92) < 1e-9, `default blend ${d.score}`);
74
-
75
- // Even 0.5/0.5 -> 0.5 + 0.4 = 0.9.
76
- const store = createStore(":memory:");
77
- const tuned = createService({ store, mirror: null, config: { hybridSearchVectorWeight: 0.5, hybridSearchKeywordWeight: 0.5 } });
78
- const vi = createVectorIndex({ store });
79
- tuned.setEmbedder(embedder);
80
- tuned.setVectorIndex(vi);
81
- const m = tuned.saveWithDedupe({ type: "preference", title: "量子计算", content: "量子计算入门" });
82
- vi.saveEmbedding(m.memory.id, [1, 0, 0]);
83
- const rows = await tuned.searchMemories("量子计算", { mode: "hybrid", topK: 10 });
84
- const t = rows.find((r) => r.id === m.memory.id);
85
- assert.ok(Math.abs(t.score - 0.9) < 1e-9, `tuned blend ${t.score}`);
86
- });
87
-
88
- test("hybrid fusion clamps blended scores into [0,1]", async () => {
89
- // Weights summing above 1 (1.0 + 1.0) push a same-memory blend over 1.0:
90
- // title hit (importance 5) = 1 * (0.5 + 0.5) = 1.0, vector cosine = 1.0 →
91
- // raw blend 1.0*1 + 1.0*1 = 2.0. The fused score must be clamped so
92
- // consumers never see a score outside [0,1].
93
- const store = createStore(":memory:");
94
- const service = createService({ store, mirror: null, config: {
95
- hybridSearchVectorWeight: 1,
96
- hybridSearchKeywordWeight: 1,
97
- adaptiveThresholdEnabled: false,
98
- searchSemanticDedup: false
99
- } });
100
- const vi = createVectorIndex({ store });
101
- service.setEmbedder(embedder);
102
- service.setVectorIndex(vi);
103
- const m = service.saveWithDedupe({ type: "preference", title: "量子计算", content: "量子计算入门", importance: 5 });
104
- vi.saveEmbedding(m.memory.id, [1, 0, 0]);
105
-
106
- const rows = await service.searchMemories("量子计算", { mode: "hybrid", topK: 10 });
107
- const hit = rows.find((r) => r.id === m.memory.id);
108
- assert.ok(hit, "blended row is recalled");
109
- assert.equal(hit.score, 1, `over-weight blend clamped to 1 (got ${hit.score})`);
110
- assert.ok(hit.score >= 0 && hit.score <= 1);
111
- });
112
-
113
- test("auto = keyword leads, vector fills the remaining slots", async () => {
114
- const { service, vectorIndex } = setup();
115
- const kw = service.saveWithDedupe({ type: "preference", title: "量子计算", content: "量子计算入门" });
116
- vectorIndex.saveEmbedding(kw.memory.id, [0, 1, 0]);
117
- const vec = service.saveWithDedupe({ type: "preference", title: "猫", content: "喜欢猫" });
118
- vectorIndex.saveEmbedding(vec.memory.id, [1, 0, 0]);
119
-
120
- const rows = await service.searchMemories("量子计算", { mode: "auto", topK: 10 });
121
- const ids = rows.map((r) => r.id);
122
- assert.ok(ids.includes(kw.memory.id), "keyword hit present");
123
- assert.ok(ids.includes(vec.memory.id), "vector fills a free slot");
124
- assert.equal(ids[0], kw.memory.id, "keyword stays first in auto mode");
125
- });
126
-
127
- test("reranker on/off: rerank reorders by score, off keeps merge order", async () => {
128
- const { service, vectorIndex } = setup();
129
- const a = service.saveWithDedupe({ type: "preference", title: "猫", content: "喜欢猫", importance: 5 });
130
- vectorIndex.saveEmbedding(a.memory.id, [0, 1, 0]);
131
- const b = service.saveWithDedupe({ type: "preference", title: "猫猫", content: "猫粮", importance: 3 });
132
- vectorIndex.saveEmbedding(b.memory.id, [0, 1, 0]);
133
-
134
- // No reranker: keyword order (importance desc) is preserved.
135
- const off = await service.searchMemories("猫", { mode: "keyword", topK: 10 });
136
- assert.equal(off[0].id, a.memory.id, "without a reranker merge order is kept");
137
-
138
- // Mock reranker installed: it reverses the merge order by score.
139
- service.setReranker(reranker);
140
- const on = await service.searchMemories("猫", { mode: "keyword", topK: 10 });
141
- assert.equal(on[0].id, b.memory.id, "rerank reorders to the highest score first");
142
- assert.equal(typeof on[0].score, "number", "reranked rows carry a score");
143
-
144
- // Clearing the reranker restores merge order.
145
- service.setReranker(null);
146
- const after = await service.searchMemories("猫", { mode: "keyword", topK: 10 });
147
- assert.equal(after[0].id, a.memory.id, "clearing the reranker restores original order");
148
- });
149
-
150
- test("keyword mode never calls the embedder", async () => {
151
- let calls = 0;
152
- const counting = { ...embedder, embedSingle: async () => { calls++; return [1, 0, 0]; } };
153
- const { service, vectorIndex } = setup();
154
- service.setEmbedder(counting);
155
- service.setVectorIndex(vectorIndex);
156
- service.saveWithDedupe({ type: "preference", title: "语言", content: "中文交流" });
157
-
158
- const rows = await service.searchMemories("中文", { mode: "keyword", topK: 10 });
159
- assert.equal(rows.length, 1);
160
- assert.equal(rows[0].title, "语言");
161
- assert.equal(calls, 0, "keyword mode must never embed the query");
162
- });
163
-
164
- test("embedder failure degrades to keyword results", async () => {
165
- const broken = { ...embedder, embedSingle: async () => { throw new Error("model unavailable"); } };
166
- const { service, vectorIndex } = setup();
167
- service.setEmbedder(broken);
168
- service.setVectorIndex(vectorIndex);
169
- service.saveWithDedupe({ type: "preference", title: "语言", content: "中文交流" });
170
-
171
- const rows = await service.searchMemories("中文", { mode: "auto", topK: 10 });
172
- assert.equal(rows.length, 1, "keyword fallback still returns matches");
173
- assert.equal(rows[0].title, "语言");
174
- assert.ok(!rows.some((m) => m.vector), "no rows claim the vector path after a failure");
175
- });
176
-
177
- test("vector mode returns semantic hits, and falls back to keyword without an embedder", async () => {
178
- const { service, vectorIndex } = setup();
179
- const hit = service.saveWithDedupe({ type: "preference", title: "猫", content: "喜欢猫" });
180
- vectorIndex.saveEmbedding(hit.memory.id, [1, 0, 0]);
181
- const rows = await service.searchMemories("猫", { mode: "vector", topK: 10 });
182
- assert.ok(rows.some((m) => m.id === hit.memory.id && m.vector), "vector-only recall surfaces the embedded hit");
183
-
184
- // No embedder/vector index: vector mode falls back to literal keyword.
185
- const bare = setup({ withEmbedder: false });
186
- const m = bare.service.saveWithDedupe({ type: "preference", title: "语言", content: "中文交流" });
187
- const fallback = await bare.service.searchMemories("中文", { mode: "vector", topK: 10 });
188
- assert.ok(fallback.some((x) => x.id === m.memory.id), "keyword fallback when vector is unavailable");
189
- });
190
-
191
- test("topK caps the merged result set", async () => {
192
- const { service, vectorIndex } = setup();
193
- for (let i = 0; i < 5; i++) {
194
- const m = service.saveWithDedupe({ type: "preference", title: `猫${i}`, content: "猫" });
195
- vectorIndex.saveEmbedding(m.memory.id, [1, 0, 0]);
196
- }
197
- const rows = await service.searchMemories("猫", { mode: "auto", topK: 3 });
198
- assert.equal(rows.length, 3, "merged list is trimmed to topK");
199
- });
1
+ import test from "node:test";
2
+ import assert from "node:assert/strict";
3
+ import { createStore } from "../src/store.js";
4
+ import { createService } from "../src/service.js";
5
+ import { createVectorIndex } from "../src/vector-index.js";
6
+
7
+ // Mock embedder from the pipeline spec: every query maps to the fixed vector
8
+ // [1,0,0], so vector recall surfaces any row embedded at [1,0,0] (cosine 1)
9
+ // and ignores rows embedded elsewhere (cosine 0).
10
+ const embedder = {
11
+ embedSingle: async () => [1, 0, 0],
12
+ embed: async () => [1, 0, 0],
13
+ schedule: () => {}, // legacy path: scheduleEmbed uses schedule when present, so saveWithDedupe never calls embedSingle here
14
+ modelHash: "mock#1",
15
+ dimension: 3
16
+ };
17
+
18
+ // Mock reranker: scores candidates by their merge order (0,1,2,...) then sorts
19
+ // descending — i.e. it reverses the incoming order. Deterministic, so tests can
20
+ // assert the on/off difference precisely.
21
+ const reranker = {
22
+ rerank: async (q, cands) =>
23
+ cands.map((c, i) => ({ id: c.id, score: i })).sort((a, b) => b.score - a.score)
24
+ };
25
+
26
+ // Real store + service, wired with the mock embedder and a vector index over
27
+ // the same store (the service's vector path prefers vectorIndex when set).
28
+ // The v0.5.0 recall fusion extras (BM25 third path, search-time semantic
29
+ // dedup) are disabled per-test when the assertion targets the legacy blend
30
+ // mechanics — the toy embedder pins every vector hit to the same [1,0,0],
31
+ // which semantic dedup would legitimately collapse.
32
+ function setup({ withEmbedder = true, config = {} } = {}) {
33
+ const store = createStore(":memory:");
34
+ const service = createService({ store, mirror: null, config });
35
+ const vectorIndex = createVectorIndex({ store });
36
+ if (withEmbedder) {
37
+ service.setEmbedder(embedder);
38
+ service.setVectorIndex(vectorIndex);
39
+ }
40
+ return { store, service, vectorIndex };
41
+ }
42
+
43
+ test("hybrid merges vector + keyword recalls and dedups shared memories", async () => {
44
+ const { service, vectorIndex } = setup();
45
+ // keyword-only hit: literal query in the title, embedding far from [1,0,0].
46
+ const kw = service.saveWithDedupe({ type: "preference", title: "量子计算", content: "量子计算入门", importance: 5 });
47
+ vectorIndex.saveEmbedding(kw.memory.id, [0, 1, 0]);
48
+ // vector-only hit: no literal match, but embedded exactly at the query vector.
49
+ const vec = service.saveWithDedupe({ type: "project", title: "猫", content: "喜欢猫" });
50
+ vectorIndex.saveEmbedding(vec.memory.id, [1, 0, 0]);
51
+ // both: literal match AND embedded at [1,0,0] -> must appear exactly once.
52
+ const both = service.saveWithDedupe({ type: "decision", title: "量子计算笔记", content: "量子计算实践" });
53
+ vectorIndex.saveEmbedding(both.memory.id, [1, 0, 0]);
54
+
55
+ const rows = await service.searchMemories("量子计算", { mode: "hybrid", topK: 10 });
56
+ const ids = rows.map((r) => r.id);
57
+ assert.ok(ids.includes(vec.memory.id), "vector recall surfaces the semantic-only hit");
58
+ assert.ok(ids.includes(kw.memory.id), "keyword recall surfaces the literal hit");
59
+ assert.equal(ids.filter((id) => id === both.memory.id).length, 1, "overlap row is deduped to a single entry");
60
+ assert.ok(rows.some((m) => m.id === both.memory.id && m.vector), "shared row is flagged as a vector hit");
61
+ assert.equal(ids[0], vec.memory.id, "vector leads the hybrid blend");
62
+ });
63
+
64
+ test("hybrid blend honors configured vector/keyword weights", async () => {
65
+ const { service, vectorIndex } = setup();
66
+ const both = service.saveWithDedupe({ type: "preference", title: "量子计算", content: "量子计算入门" });
67
+ vectorIndex.saveEmbedding(both.memory.id, [1, 0, 0]);
68
+
69
+ // Title hit scores 1 * (0.5 + 3/10) = 0.8; vector cosine = 1.0.
70
+ // Default weights (0.6/0.4) -> 0.6 + 0.32 = 0.92.
71
+ const defaults = await service.searchMemories("量子计算", { mode: "hybrid", topK: 10 });
72
+ const d = defaults.find((m) => m.id === both.memory.id);
73
+ assert.ok(Math.abs(d.score - 0.92) < 1e-9, `default blend ${d.score}`);
74
+
75
+ // Even 0.5/0.5 -> 0.5 + 0.4 = 0.9.
76
+ const store = createStore(":memory:");
77
+ const tuned = createService({ store, mirror: null, config: { hybridSearchVectorWeight: 0.5, hybridSearchKeywordWeight: 0.5 } });
78
+ const vi = createVectorIndex({ store });
79
+ tuned.setEmbedder(embedder);
80
+ tuned.setVectorIndex(vi);
81
+ const m = tuned.saveWithDedupe({ type: "preference", title: "量子计算", content: "量子计算入门" });
82
+ vi.saveEmbedding(m.memory.id, [1, 0, 0]);
83
+ const rows = await tuned.searchMemories("量子计算", { mode: "hybrid", topK: 10 });
84
+ const t = rows.find((r) => r.id === m.memory.id);
85
+ assert.ok(Math.abs(t.score - 0.9) < 1e-9, `tuned blend ${t.score}`);
86
+ });
87
+
88
+ test("hybrid fusion clamps blended scores into [0,1]", async () => {
89
+ // Weights summing above 1 (1.0 + 1.0) push a same-memory blend over 1.0:
90
+ // title hit (importance 5) = 1 * (0.5 + 0.5) = 1.0, vector cosine = 1.0 →
91
+ // raw blend 1.0*1 + 1.0*1 = 2.0. The fused score must be clamped so
92
+ // consumers never see a score outside [0,1].
93
+ const store = createStore(":memory:");
94
+ const service = createService({ store, mirror: null, config: {
95
+ hybridSearchVectorWeight: 1,
96
+ hybridSearchKeywordWeight: 1,
97
+ adaptiveThresholdEnabled: false,
98
+ searchSemanticDedup: false
99
+ } });
100
+ const vi = createVectorIndex({ store });
101
+ service.setEmbedder(embedder);
102
+ service.setVectorIndex(vi);
103
+ const m = service.saveWithDedupe({ type: "preference", title: "量子计算", content: "量子计算入门", importance: 5 });
104
+ vi.saveEmbedding(m.memory.id, [1, 0, 0]);
105
+
106
+ const rows = await service.searchMemories("量子计算", { mode: "hybrid", topK: 10 });
107
+ const hit = rows.find((r) => r.id === m.memory.id);
108
+ assert.ok(hit, "blended row is recalled");
109
+ assert.equal(hit.score, 1, `over-weight blend clamped to 1 (got ${hit.score})`);
110
+ assert.ok(hit.score >= 0 && hit.score <= 1);
111
+ });
112
+
113
+ test("auto = keyword leads, vector fills the remaining slots", async () => {
114
+ const { service, vectorIndex } = setup();
115
+ const kw = service.saveWithDedupe({ type: "preference", title: "量子计算", content: "量子计算入门" });
116
+ vectorIndex.saveEmbedding(kw.memory.id, [0, 1, 0]);
117
+ const vec = service.saveWithDedupe({ type: "preference", title: "猫", content: "喜欢猫" });
118
+ vectorIndex.saveEmbedding(vec.memory.id, [1, 0, 0]);
119
+
120
+ const rows = await service.searchMemories("量子计算", { mode: "auto", topK: 10 });
121
+ const ids = rows.map((r) => r.id);
122
+ assert.ok(ids.includes(kw.memory.id), "keyword hit present");
123
+ assert.ok(ids.includes(vec.memory.id), "vector fills a free slot");
124
+ assert.equal(ids[0], kw.memory.id, "keyword stays first in auto mode");
125
+ });
126
+
127
+ test("reranker on/off: rerank reorders by score, off keeps merge order", async () => {
128
+ const { service, vectorIndex } = setup();
129
+ const a = service.saveWithDedupe({ type: "preference", title: "猫", content: "喜欢猫", importance: 5 });
130
+ vectorIndex.saveEmbedding(a.memory.id, [0, 1, 0]);
131
+ const b = service.saveWithDedupe({ type: "preference", title: "猫猫", content: "猫粮", importance: 3 });
132
+ vectorIndex.saveEmbedding(b.memory.id, [0, 1, 0]);
133
+
134
+ // No reranker: keyword order (importance desc) is preserved.
135
+ const off = await service.searchMemories("猫", { mode: "keyword", topK: 10 });
136
+ assert.equal(off[0].id, a.memory.id, "without a reranker merge order is kept");
137
+
138
+ // Mock reranker installed: it reverses the merge order by score.
139
+ service.setReranker(reranker);
140
+ const on = await service.searchMemories("猫", { mode: "keyword", topK: 10 });
141
+ assert.equal(on[0].id, b.memory.id, "rerank reorders to the highest score first");
142
+ assert.equal(typeof on[0].score, "number", "reranked rows carry a score");
143
+
144
+ // Clearing the reranker restores merge order.
145
+ service.setReranker(null);
146
+ const after = await service.searchMemories("猫", { mode: "keyword", topK: 10 });
147
+ assert.equal(after[0].id, a.memory.id, "clearing the reranker restores original order");
148
+ });
149
+
150
+ test("keyword mode never calls the embedder", async () => {
151
+ let calls = 0;
152
+ const counting = { ...embedder, embedSingle: async () => { calls++; return [1, 0, 0]; } };
153
+ const { service, vectorIndex } = setup();
154
+ service.setEmbedder(counting);
155
+ service.setVectorIndex(vectorIndex);
156
+ service.saveWithDedupe({ type: "preference", title: "语言", content: "中文交流" });
157
+
158
+ const rows = await service.searchMemories("中文", { mode: "keyword", topK: 10 });
159
+ assert.equal(rows.length, 1);
160
+ assert.equal(rows[0].title, "语言");
161
+ assert.equal(calls, 0, "keyword mode must never embed the query");
162
+ });
163
+
164
+ test("embedder failure degrades to keyword results", async () => {
165
+ const broken = { ...embedder, embedSingle: async () => { throw new Error("model unavailable"); } };
166
+ const { service, vectorIndex } = setup();
167
+ service.setEmbedder(broken);
168
+ service.setVectorIndex(vectorIndex);
169
+ service.saveWithDedupe({ type: "preference", title: "语言", content: "中文交流" });
170
+
171
+ const rows = await service.searchMemories("中文", { mode: "auto", topK: 10 });
172
+ assert.equal(rows.length, 1, "keyword fallback still returns matches");
173
+ assert.equal(rows[0].title, "语言");
174
+ assert.ok(!rows.some((m) => m.vector), "no rows claim the vector path after a failure");
175
+ });
176
+
177
+ test("vector mode returns semantic hits, and falls back to keyword without an embedder", async () => {
178
+ const { service, vectorIndex } = setup();
179
+ const hit = service.saveWithDedupe({ type: "preference", title: "猫", content: "喜欢猫" });
180
+ vectorIndex.saveEmbedding(hit.memory.id, [1, 0, 0]);
181
+ const rows = await service.searchMemories("猫", { mode: "vector", topK: 10 });
182
+ assert.ok(rows.some((m) => m.id === hit.memory.id && m.vector), "vector-only recall surfaces the embedded hit");
183
+
184
+ // No embedder/vector index: vector mode falls back to literal keyword.
185
+ const bare = setup({ withEmbedder: false });
186
+ const m = bare.service.saveWithDedupe({ type: "preference", title: "语言", content: "中文交流" });
187
+ const fallback = await bare.service.searchMemories("中文", { mode: "vector", topK: 10 });
188
+ assert.ok(fallback.some((x) => x.id === m.memory.id), "keyword fallback when vector is unavailable");
189
+ });
190
+
191
+ test("topK caps the merged result set", async () => {
192
+ const { service, vectorIndex } = setup();
193
+ for (let i = 0; i < 5; i++) {
194
+ const m = service.saveWithDedupe({ type: "preference", title: `猫${i}`, content: "猫" });
195
+ vectorIndex.saveEmbedding(m.memory.id, [1, 0, 0]);
196
+ }
197
+ const rows = await service.searchMemories("猫", { mode: "auto", topK: 3 });
198
+ assert.equal(rows.length, 3, "merged list is trimmed to topK");
199
+ });