@modusensus/dsh-mneme 0.6.7 → 0.6.9

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (139) hide show
  1. package/.github/workflows/test.yml +32 -0
  2. package/.release-notes-v0.6.9.md +13 -0
  3. package/CHANGELOG.md +89 -0
  4. package/LICENSE +21 -21
  5. package/README.md +219 -463
  6. package/SECURITY.md +544 -0
  7. package/docs/devlog/2026-08-14-dsh-mneme-dev-log.md +247 -0
  8. package/docs/devlog/2026-08-15-dsh-mneme-audit-stress-dev-log.md +145 -0
  9. package/docs/devlog/2026-08-15-dsh-mneme-pipeline-dev-log.md +56 -0
  10. package/docs/devlog/2026-08-15-dsh-mneme-reflection-dev-log.md +77 -0
  11. package/docs/devlog/2026-08-15-dsh-mneme-review-fixes-dev-log.md +64 -0
  12. package/docs/devlog/2026-08-15-dsh-mneme-semantic-dev-log.md +90 -0
  13. package/dsh-mneme/CHANGELOG.md +248 -0
  14. package/dsh-mneme/LICENSE +21 -0
  15. package/dsh-mneme/README.md +465 -0
  16. package/{cordis.patch.yml → dsh-mneme/cordis.patch.yml} +15 -15
  17. package/dsh-mneme/docs/AGENT_MEMORY_RESEARCH.md +183 -0
  18. package/dsh-mneme/docs/ENTITIES.md +245 -0
  19. package/dsh-mneme/docs/LOCAL_MODEL.md +141 -0
  20. package/dsh-mneme/docs/MIGRATION.md +127 -0
  21. package/dsh-mneme/docs/SEMANTIC.md +256 -0
  22. package/dsh-mneme/docs/SLEEP.md +163 -0
  23. package/{lib → dsh-mneme/lib}/api.js +783 -783
  24. package/{lib → dsh-mneme/lib}/client.js +1757 -1757
  25. package/{src → dsh-mneme/lib}/commands.js +64 -64
  26. package/{lib → dsh-mneme/lib}/config.js +298 -288
  27. package/{lib → dsh-mneme/lib}/dream/clustering.js +118 -118
  28. package/{src → dsh-mneme/lib}/dream/decisions.js +488 -439
  29. package/{lib → dsh-mneme/lib}/dream/sleep.js +561 -554
  30. package/{src → dsh-mneme/lib}/dream/tag-extractor.js +156 -156
  31. package/{lib → dsh-mneme/lib}/dream.js +958 -929
  32. package/{src → dsh-mneme/lib}/embedding.js +154 -154
  33. package/{src → dsh-mneme/lib}/entities/extractor.js +242 -242
  34. package/{src → dsh-mneme/lib}/hot-memory.js +53 -53
  35. package/{lib → dsh-mneme/lib}/index.js +361 -361
  36. package/{src → dsh-mneme/lib}/inject.js +208 -208
  37. package/{lib → dsh-mneme/lib}/local-embedder.js +282 -282
  38. package/{lib → dsh-mneme/lib}/mirror.js +170 -170
  39. package/{lib → dsh-mneme/lib}/parser/tag.js +59 -59
  40. package/{lib → dsh-mneme/lib}/parser/wiki-link.js +38 -38
  41. package/{src → dsh-mneme/lib}/quality-filter.js +123 -123
  42. package/{lib → dsh-mneme/lib}/reranker.js +218 -218
  43. package/{lib → dsh-mneme/lib}/search/adaptive.js +22 -22
  44. package/{lib → dsh-mneme/lib}/search/bm25.js +96 -96
  45. package/{src → dsh-mneme/lib}/search/tag-boost.js +61 -61
  46. package/{src → dsh-mneme/lib}/service.js +1726 -1726
  47. package/{lib → dsh-mneme/lib}/settings.js +172 -172
  48. package/{lib → dsh-mneme/lib}/store.js +2238 -2238
  49. package/{lib → dsh-mneme/lib}/summarize.js +236 -236
  50. package/{lib → dsh-mneme/lib}/tools.js +290 -290
  51. package/{lib → dsh-mneme/lib}/vector-index.js +116 -116
  52. package/dsh-mneme/package-lock.json +1936 -0
  53. package/dsh-mneme/package.json +80 -0
  54. package/{scripts → dsh-mneme/scripts}/benchmark-embed.js +201 -201
  55. package/{scripts → dsh-mneme/scripts}/benchmark-recall.js +133 -133
  56. package/{scripts → dsh-mneme/scripts}/benchmark-rerank.js +166 -166
  57. package/{scripts → dsh-mneme/scripts}/e2e-dsh.js +218 -218
  58. package/{scripts → dsh-mneme/scripts}/stress-dsh.js +255 -255
  59. package/{scripts → dsh-mneme/scripts}/sync-lib.js +52 -52
  60. package/{src → dsh-mneme/src}/api.js +783 -783
  61. package/{lib → dsh-mneme/src}/commands.js +64 -64
  62. package/{src → dsh-mneme/src}/config.js +298 -288
  63. package/{src → dsh-mneme/src}/dream/clustering.js +118 -118
  64. package/{lib → dsh-mneme/src}/dream/decisions.js +488 -439
  65. package/{src → dsh-mneme/src}/dream/sleep.js +561 -554
  66. package/{lib → dsh-mneme/src}/dream/tag-extractor.js +156 -156
  67. package/{src → dsh-mneme/src}/dream.js +958 -929
  68. package/{lib → dsh-mneme/src}/embedding.js +154 -154
  69. package/{lib → dsh-mneme/src}/entities/extractor.js +242 -242
  70. package/{lib → dsh-mneme/src}/hot-memory.js +53 -53
  71. package/{src → dsh-mneme/src}/index.js +361 -361
  72. package/{lib → dsh-mneme/src}/inject.js +208 -208
  73. package/{src → dsh-mneme/src}/local-embedder.js +282 -282
  74. package/{src → dsh-mneme/src}/mirror.js +170 -170
  75. package/{src → dsh-mneme/src}/parser/tag.js +59 -59
  76. package/{src → dsh-mneme/src}/parser/wiki-link.js +38 -38
  77. package/{lib → dsh-mneme/src}/quality-filter.js +123 -123
  78. package/{src → dsh-mneme/src}/reranker.js +218 -218
  79. package/{src → dsh-mneme/src}/search/adaptive.js +22 -22
  80. package/{src → dsh-mneme/src}/search/bm25.js +96 -96
  81. package/{lib → dsh-mneme/src}/search/tag-boost.js +61 -61
  82. package/{lib → dsh-mneme/src}/service.js +1726 -1726
  83. package/{src → dsh-mneme/src}/settings.js +172 -172
  84. package/{src → dsh-mneme/src}/store.js +2238 -2238
  85. package/{src → dsh-mneme/src}/summarize.js +236 -236
  86. package/{src → dsh-mneme/src}/tools.js +290 -290
  87. package/{src → dsh-mneme/src}/vector-index.js +116 -116
  88. package/{test → dsh-mneme/test}/api.test.js +594 -594
  89. package/{test → dsh-mneme/test}/audit.test.js +448 -448
  90. package/{test → dsh-mneme/test}/benchmark.test.js +35 -35
  91. package/{test → dsh-mneme/test}/boundary-v0625.test.js +82 -82
  92. package/{test → dsh-mneme/test}/client.test.js +368 -368
  93. package/{test → dsh-mneme/test}/clustering.test.js +100 -100
  94. package/{test → dsh-mneme/test}/commands.test.js +69 -69
  95. package/{test → dsh-mneme/test}/config.test.js +50 -50
  96. package/{test → dsh-mneme/test}/conflict-freeze.test.js +290 -290
  97. package/{test → dsh-mneme/test}/directory.test.js +134 -134
  98. package/{test → dsh-mneme/test}/dream.test.js +1060 -901
  99. package/{test → dsh-mneme/test}/entities.test.js +522 -522
  100. package/{test → dsh-mneme/test}/epistemic.test.js +298 -298
  101. package/{test → dsh-mneme/test}/fnew-0112.test.js +311 -311
  102. package/{test → dsh-mneme/test}/fnew-03.test.js +422 -422
  103. package/{test → dsh-mneme/test}/graph-api.test.js +175 -175
  104. package/{test → dsh-mneme/test}/helpers/dream-mock.js +82 -82
  105. package/{test → dsh-mneme/test}/hot-memory.test.js +174 -174
  106. package/{test → dsh-mneme/test}/inject.test.js +103 -103
  107. package/{test → dsh-mneme/test}/llm-audit.test.js +279 -279
  108. package/{test → dsh-mneme/test}/local-embedder.test.js +227 -227
  109. package/{test → dsh-mneme/test}/mirror-dirty.test.js +424 -424
  110. package/{test → dsh-mneme/test}/mirror-edit-digest.test.js +187 -187
  111. package/{test → dsh-mneme/test}/mirror-generation.test.js +499 -499
  112. package/{test → dsh-mneme/test}/mirror.test.js +249 -249
  113. package/{test → dsh-mneme/test}/normalize-decisions.test.js +120 -120
  114. package/{test → dsh-mneme/test}/peer-blockers.test.js +190 -190
  115. package/{test → dsh-mneme/test}/policy-epoch.test.js +259 -259
  116. package/{test → dsh-mneme/test}/provenance.test.js +103 -103
  117. package/{test → dsh-mneme/test}/quality-filter.test.js +118 -118
  118. package/{test → dsh-mneme/test}/reasoning-effort.test.js +199 -199
  119. package/{test → dsh-mneme/test}/recall-evals.test.js +235 -235
  120. package/{test → dsh-mneme/test}/recall-layer.test.js +315 -315
  121. package/{test → dsh-mneme/test}/receipt-chain.test.js +451 -451
  122. package/{test → dsh-mneme/test}/reflection.test.js +226 -226
  123. package/{test → dsh-mneme/test}/reranker.test.js +240 -240
  124. package/{test → dsh-mneme/test}/search-fusion.test.js +90 -90
  125. package/{test → dsh-mneme/test}/semantic.test.js +124 -124
  126. package/{test → dsh-mneme/test}/service-search.test.js +199 -199
  127. package/{test → dsh-mneme/test}/service.test.js +435 -435
  128. package/{test → dsh-mneme/test}/settings.test.js +118 -118
  129. package/{test → dsh-mneme/test}/sleep.test.js +365 -365
  130. package/{test → dsh-mneme/test}/store.test.js +436 -436
  131. package/{test → dsh-mneme/test}/stress.test.js +209 -209
  132. package/{test → dsh-mneme/test}/summarize.test.js +191 -191
  133. package/{test → dsh-mneme/test}/tag-boost.test.js +125 -125
  134. package/{test → dsh-mneme/test}/tag.test.js +312 -312
  135. package/{test → dsh-mneme/test}/tools.test.js +285 -285
  136. package/{test → dsh-mneme/test}/vector-index.test.js +221 -221
  137. package/{test → dsh-mneme/test}/wiki-link.test.js +332 -332
  138. package/package.json +18 -40
  139. package//346/250/252/345/271/205.png +0 -0
@@ -1,221 +1,221 @@
1
- import test from "node:test";
2
- import assert from "node:assert/strict";
3
- import { createStore } from "../src/store.js";
4
- import { createVectorIndex } from "../src/vector-index.js";
5
-
6
- // Focused unit tests for the vector-index layer: model fingerprint (drift
7
- // detection), embedding save/search/delete, incremental rebuild, and stats.
8
- // The store is used directly (createStore(":memory:")) since vector-index is a
9
- // thin layer over the store's embedding column + vector_meta table.
10
-
11
- function setup() {
12
- const store = createStore(":memory:");
13
- const vectorIndex = createVectorIndex({ store });
14
- return { store, vectorIndex };
15
- }
16
-
17
- // Add a memory via the store and (optionally) set its embedding vector.
18
- function addMemory(store, { title, content, type = "preference", vector }) {
19
- const memory = store.save({ type, title, content, tags: [], importance: 3 });
20
- if (vector) store.setEmbedding(memory.id, vector);
21
- return memory;
22
- }
23
-
24
- // Embedder mock for rebuildIndex. The rebuild loop prefers embedSingle and
25
- // falls back to `embed` for embed-only OpenAI-compatible clients, so a mock
26
- // that provides embedSingle exercises the primary path.
27
- function rebuildEmbedder({ vector = [1, 0, 0], modelHash = "mock#rebuild", dimension = 3 } = {}) {
28
- return {
29
- embed: async (texts) => texts.map(() => vector),
30
- embedSingle: async () => vector,
31
- modelHash,
32
- dimension
33
- };
34
- }
35
-
36
- test("modelHash drift detection: markModel records and replaces the fingerprint", () => {
37
- const { vectorIndex } = setup();
38
-
39
- // No model recorded yet.
40
- assert.equal(vectorIndex.modelHash(), undefined);
41
- assert.equal(vectorIndex.dimension(), undefined);
42
-
43
- vectorIndex.markModel("model#v1", 3);
44
- assert.equal(vectorIndex.modelHash(), "model#v1");
45
- assert.equal(vectorIndex.dimension(), 3);
46
-
47
- // Switching to a different model updates the fingerprint (drift signal).
48
- vectorIndex.markModel("model#v2", 5);
49
- assert.equal(vectorIndex.modelHash(), "model#v2");
50
- assert.equal(vectorIndex.dimension(), 5);
51
- });
52
-
53
- test("saveEmbedding + search recall with cosine ordering", () => {
54
- const { store, vectorIndex } = setup();
55
- // Three memories with distinct 3-d vectors.
56
- const a = addMemory(store, { title: "猫", content: "喜欢猫", vector: [1, 0, 0] });
57
- const b = addMemory(store, { title: "狗", content: "喜欢狗", vector: [0, 1, 0] });
58
- const c = addMemory(store, { title: "虎", content: "喜欢老虎", vector: [0.5, 0.5, 0] });
59
-
60
- const hits = vectorIndex.search([1, 0, 0], { limit: 10, threshold: 0 });
61
- assert.equal(hits.length, 3, "all embedded rows participate");
62
- assert.equal(hits[0].id, a.id, "exact vector match ranks first");
63
- assert.ok(Math.abs(hits[0].score - 1) < 1e-9, "self cosine is 1");
64
-
65
- // Cosine ordering: [1,0,0] vs c = 0.5/sqrt(0.5) ≈ 0.7071 > vs b = 0.
66
- assert.equal(hits[1].id, c.id, "higher cosine ranks before orthogonal");
67
- assert.ok(Math.abs(hits[1].score - 0.5 / Math.sqrt(0.5)) < 1e-9, "c score is dot/sqrt(nb)");
68
- assert.equal(hits[2].id, b.id, "orthogonal vector ranks last");
69
- assert.ok(Math.abs(hits[2].score) < 1e-9, "orthogonal cosine is 0");
70
-
71
- // threshold filters low-similarity rows out.
72
- const filtered = vectorIndex.search([1, 0, 0], { limit: 10, threshold: 0.9 });
73
- assert.deepEqual(filtered.map((h) => h.id), [a.id], "only the 1.0 match passes threshold 0.9");
74
- });
75
-
76
- test("deleteEmbedding clears the cached vector; getEmbedding reflects it", () => {
77
- const { store, vectorIndex } = setup();
78
- const m = addMemory(store, { title: "备忘", content: "临时内容", vector: [1, 0, 0] });
79
-
80
- assert.deepEqual(vectorIndex.getEmbedding(m.id), [1, 0, 0]);
81
-
82
- vectorIndex.deleteEmbedding(m.id);
83
- assert.equal(vectorIndex.getEmbedding(m.id), undefined, "deleted embedding reads as undefined");
84
- assert.equal(vectorIndex.getStats().embeddedCount, 0, "count drops after delete");
85
-
86
- // Save again restores it.
87
- vectorIndex.saveEmbedding(m.id, [0, 0, 1]);
88
- assert.deepEqual(vectorIndex.getEmbedding(m.id), [0, 0, 1]);
89
- });
90
-
91
- test("rebuildIndex embeds only rows missing an embedding and marks the model", async () => {
92
- const { store, vectorIndex } = setup();
93
- // One memory already embedded, two missing.
94
- addMemory(store, { title: "已有向量", content: "A", vector: [0, 1, 0] });
95
- addMemory(store, { title: "缺向量1", content: "B" });
96
- addMemory(store, { title: "缺向量2", content: "C" });
97
- assert.equal(vectorIndex.getStats().embeddedCount, 1);
98
-
99
- const seen = [];
100
- const embedder = rebuildEmbedder({ vector: [1, 0, 0], modelHash: "mock#rebuild", dimension: 3 });
101
- embedder.embedSingle = async (text) => { seen.push(text); return [1, 0, 0]; };
102
-
103
- const result = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
104
- assert.equal(result.indexed, 2, "two missing embeddings written");
105
- assert.equal(result.skipped, 0);
106
- assert.equal(vectorIndex.getStats().embeddedCount, 3, "all rows embedded after rebuild");
107
- assert.equal(seen.length, 2, "embedSingle called once per missing row");
108
-
109
- // Rebuild is a no-op once everything is embedded.
110
- const again = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
111
- assert.equal(again.indexed, 0);
112
- assert.equal(again.skipped, 0);
113
-
114
- // Model fingerprint marked from the rebuild embedder.
115
- assert.equal(vectorIndex.modelHash(), "mock#rebuild");
116
- assert.equal(vectorIndex.dimension(), 3);
117
- });
118
-
119
- test("rebuildIndex handles a throwing embedder without failing the batch", async () => {
120
- const { store, vectorIndex } = setup();
121
- addMemory(store, { title: "好行", content: "A" });
122
- addMemory(store, { title: "坏行", content: "B" });
123
- addMemory(store, { title: "空行", content: "C" });
124
-
125
- let calls = 0;
126
- const embedder = rebuildEmbedder({ modelHash: "mock#throwing" });
127
- embedder.embedSingle = async () => {
128
- calls++;
129
- if (calls === 2) throw new Error("model unavailable");
130
- if (calls === 3) return []; // empty vector → not counted
131
- return [1, 0, 0];
132
- };
133
-
134
- const result = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
135
- assert.equal(result.indexed, 1, "only the successful row is indexed");
136
- assert.equal(result.skipped, 2, "thrown + empty rows count as skipped");
137
- assert.equal(vectorIndex.getStats().embeddedCount, 1);
138
- });
139
-
140
- test("rebuildIndex guard: embedder with no embed method at all is ignored", async () => {
141
- const { store, vectorIndex } = setup();
142
- addMemory(store, { title: "缺向量", content: "A" });
143
- const bare = { modelHash: "mock#bare", dimension: 3 };
144
- const result = await vectorIndex.rebuildIndex(bare, { limit: 100 });
145
- assert.deepEqual(result, { indexed: 0, skipped: 0 }, "guard returns early when neither embed nor embedSingle is available");
146
- assert.equal(vectorIndex.modelHash(), undefined, "no model marked");
147
- });
148
-
149
- test("rebuildIndex supports an embed-only OpenAI-compatible embedder (issue #10)", async () => {
150
- const { store, vectorIndex } = setup();
151
- addMemory(store, { title: "缺向量", content: "A" });
152
- const embedOnly = {
153
- embed: async (text) => [1, 0, 0], // OpenAI-compatible single-text embed
154
- modelHash: "text-embedding#abc",
155
- dimension: 3
156
- };
157
- const result = await vectorIndex.rebuildIndex(embedOnly, { limit: 100 });
158
- assert.equal(result.indexed, 1, "embed-only embedder indexes the missing row");
159
- assert.equal(result.skipped, 0);
160
- assert.equal(vectorIndex.modelHash(), "text-embedding#abc", "model fingerprint recorded");
161
- assert.equal(vectorIndex.dimension(), 3, "dimension recorded");
162
- assert.equal(vectorIndex.getStats().embeddedCount, 1, "embedding persisted");
163
- });
164
-
165
- test("rebuildIndex works with embedSingle-only embedder", async () => {
166
- const { store, vectorIndex } = setup();
167
- addMemory(store, { title: "缺向量", content: "A" });
168
- const single = { embedSingle: async () => [1, 0, 0], modelHash: "mock#single", dimension: 3 };
169
- const result = await vectorIndex.rebuildIndex(single, { limit: 100 });
170
- assert.ok(result.indexed >= 1, "embedSingle-only embedder should rebuild");
171
- assert.equal(vectorIndex.modelHash(), "mock#single", "model marked after successful rebuild");
172
- });
173
-
174
- test("getStats reports embedded/total counts and model metadata", () => {
175
- const { store, vectorIndex } = setup();
176
- addMemory(store, { title: "甲", content: "1", vector: [1, 0, 0] });
177
- addMemory(store, { title: "乙", content: "2", vector: [0, 1, 0] });
178
- addMemory(store, { title: "丙", content: "3" });
179
-
180
- let stats = vectorIndex.getStats();
181
- assert.equal(stats.embeddedCount, 2);
182
- assert.equal(stats.totalCount, 3);
183
- assert.equal(stats.modelHash, undefined);
184
- assert.equal(stats.dimension, undefined);
185
- assert.equal(stats.updatedAt, undefined);
186
-
187
- vectorIndex.markModel("model#v3", 4);
188
- stats = vectorIndex.getStats();
189
- assert.equal(stats.modelHash, "model#v3");
190
- assert.equal(stats.dimension, 4);
191
- assert.ok(typeof stats.updatedAt === "string" && stats.updatedAt.length > 0, "updatedAt set");
192
- });
193
-
194
- test("incremental update: saveEmbedding overwrites the cached vector and search reflects it", () => {
195
- const { store, vectorIndex } = setup();
196
- const a = addMemory(store, { title: "主题", content: "A", vector: [1, 0, 0] });
197
- const b = addMemory(store, { title: "对照", content: "B", vector: [0, 1, 0] });
198
-
199
- // Before overwrite: query for B's vector ranks b first.
200
- let hits = vectorIndex.search([0, 1, 0], { limit: 10, threshold: 0 });
201
- assert.equal(hits[0].id, b.id);
202
-
203
- // Overwrite a's vector so it now points at b's direction.
204
- vectorIndex.saveEmbedding(a.id, [0, 1, 0]);
205
- assert.deepEqual(vectorIndex.getEmbedding(a.id), [0, 1, 0]);
206
- assert.equal(vectorIndex.getStats().embeddedCount, 2, "overwrite does not change the count");
207
-
208
- hits = vectorIndex.search([0, 1, 0], { limit: 10, threshold: 0 });
209
- assert.equal(hits.length, 2);
210
- // Tie: identical vectors both score 1; ordering between them is stable by id — we
211
- // only assert the overwritten row now participates with a full score.
212
- const aHit = hits.find((h) => h.id === a.id);
213
- assert.ok(Math.abs(aHit.score - 1) < 1e-9, "overwritten vector scores 1 against the query");
214
- });
215
-
216
- test("search returns empty when nothing is embedded", () => {
217
- const { store, vectorIndex } = setup();
218
- addMemory(store, { title: "无向量", content: "A" });
219
- addMemory(store, { title: "也无向量", content: "B" });
220
- assert.deepEqual(vectorIndex.search([1, 0, 0], { limit: 10 }), []);
221
- });
1
+ import test from "node:test";
2
+ import assert from "node:assert/strict";
3
+ import { createStore } from "../src/store.js";
4
+ import { createVectorIndex } from "../src/vector-index.js";
5
+
6
+ // Focused unit tests for the vector-index layer: model fingerprint (drift
7
+ // detection), embedding save/search/delete, incremental rebuild, and stats.
8
+ // The store is used directly (createStore(":memory:")) since vector-index is a
9
+ // thin layer over the store's embedding column + vector_meta table.
10
+
11
+ function setup() {
12
+ const store = createStore(":memory:");
13
+ const vectorIndex = createVectorIndex({ store });
14
+ return { store, vectorIndex };
15
+ }
16
+
17
+ // Add a memory via the store and (optionally) set its embedding vector.
18
+ function addMemory(store, { title, content, type = "preference", vector }) {
19
+ const memory = store.save({ type, title, content, tags: [], importance: 3 });
20
+ if (vector) store.setEmbedding(memory.id, vector);
21
+ return memory;
22
+ }
23
+
24
+ // Embedder mock for rebuildIndex. The rebuild loop prefers embedSingle and
25
+ // falls back to `embed` for embed-only OpenAI-compatible clients, so a mock
26
+ // that provides embedSingle exercises the primary path.
27
+ function rebuildEmbedder({ vector = [1, 0, 0], modelHash = "mock#rebuild", dimension = 3 } = {}) {
28
+ return {
29
+ embed: async (texts) => texts.map(() => vector),
30
+ embedSingle: async () => vector,
31
+ modelHash,
32
+ dimension
33
+ };
34
+ }
35
+
36
+ test("modelHash drift detection: markModel records and replaces the fingerprint", () => {
37
+ const { vectorIndex } = setup();
38
+
39
+ // No model recorded yet.
40
+ assert.equal(vectorIndex.modelHash(), undefined);
41
+ assert.equal(vectorIndex.dimension(), undefined);
42
+
43
+ vectorIndex.markModel("model#v1", 3);
44
+ assert.equal(vectorIndex.modelHash(), "model#v1");
45
+ assert.equal(vectorIndex.dimension(), 3);
46
+
47
+ // Switching to a different model updates the fingerprint (drift signal).
48
+ vectorIndex.markModel("model#v2", 5);
49
+ assert.equal(vectorIndex.modelHash(), "model#v2");
50
+ assert.equal(vectorIndex.dimension(), 5);
51
+ });
52
+
53
+ test("saveEmbedding + search recall with cosine ordering", () => {
54
+ const { store, vectorIndex } = setup();
55
+ // Three memories with distinct 3-d vectors.
56
+ const a = addMemory(store, { title: "猫", content: "喜欢猫", vector: [1, 0, 0] });
57
+ const b = addMemory(store, { title: "狗", content: "喜欢狗", vector: [0, 1, 0] });
58
+ const c = addMemory(store, { title: "虎", content: "喜欢老虎", vector: [0.5, 0.5, 0] });
59
+
60
+ const hits = vectorIndex.search([1, 0, 0], { limit: 10, threshold: 0 });
61
+ assert.equal(hits.length, 3, "all embedded rows participate");
62
+ assert.equal(hits[0].id, a.id, "exact vector match ranks first");
63
+ assert.ok(Math.abs(hits[0].score - 1) < 1e-9, "self cosine is 1");
64
+
65
+ // Cosine ordering: [1,0,0] vs c = 0.5/sqrt(0.5) ≈ 0.7071 > vs b = 0.
66
+ assert.equal(hits[1].id, c.id, "higher cosine ranks before orthogonal");
67
+ assert.ok(Math.abs(hits[1].score - 0.5 / Math.sqrt(0.5)) < 1e-9, "c score is dot/sqrt(nb)");
68
+ assert.equal(hits[2].id, b.id, "orthogonal vector ranks last");
69
+ assert.ok(Math.abs(hits[2].score) < 1e-9, "orthogonal cosine is 0");
70
+
71
+ // threshold filters low-similarity rows out.
72
+ const filtered = vectorIndex.search([1, 0, 0], { limit: 10, threshold: 0.9 });
73
+ assert.deepEqual(filtered.map((h) => h.id), [a.id], "only the 1.0 match passes threshold 0.9");
74
+ });
75
+
76
+ test("deleteEmbedding clears the cached vector; getEmbedding reflects it", () => {
77
+ const { store, vectorIndex } = setup();
78
+ const m = addMemory(store, { title: "备忘", content: "临时内容", vector: [1, 0, 0] });
79
+
80
+ assert.deepEqual(vectorIndex.getEmbedding(m.id), [1, 0, 0]);
81
+
82
+ vectorIndex.deleteEmbedding(m.id);
83
+ assert.equal(vectorIndex.getEmbedding(m.id), undefined, "deleted embedding reads as undefined");
84
+ assert.equal(vectorIndex.getStats().embeddedCount, 0, "count drops after delete");
85
+
86
+ // Save again restores it.
87
+ vectorIndex.saveEmbedding(m.id, [0, 0, 1]);
88
+ assert.deepEqual(vectorIndex.getEmbedding(m.id), [0, 0, 1]);
89
+ });
90
+
91
+ test("rebuildIndex embeds only rows missing an embedding and marks the model", async () => {
92
+ const { store, vectorIndex } = setup();
93
+ // One memory already embedded, two missing.
94
+ addMemory(store, { title: "已有向量", content: "A", vector: [0, 1, 0] });
95
+ addMemory(store, { title: "缺向量1", content: "B" });
96
+ addMemory(store, { title: "缺向量2", content: "C" });
97
+ assert.equal(vectorIndex.getStats().embeddedCount, 1);
98
+
99
+ const seen = [];
100
+ const embedder = rebuildEmbedder({ vector: [1, 0, 0], modelHash: "mock#rebuild", dimension: 3 });
101
+ embedder.embedSingle = async (text) => { seen.push(text); return [1, 0, 0]; };
102
+
103
+ const result = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
104
+ assert.equal(result.indexed, 2, "two missing embeddings written");
105
+ assert.equal(result.skipped, 0);
106
+ assert.equal(vectorIndex.getStats().embeddedCount, 3, "all rows embedded after rebuild");
107
+ assert.equal(seen.length, 2, "embedSingle called once per missing row");
108
+
109
+ // Rebuild is a no-op once everything is embedded.
110
+ const again = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
111
+ assert.equal(again.indexed, 0);
112
+ assert.equal(again.skipped, 0);
113
+
114
+ // Model fingerprint marked from the rebuild embedder.
115
+ assert.equal(vectorIndex.modelHash(), "mock#rebuild");
116
+ assert.equal(vectorIndex.dimension(), 3);
117
+ });
118
+
119
+ test("rebuildIndex handles a throwing embedder without failing the batch", async () => {
120
+ const { store, vectorIndex } = setup();
121
+ addMemory(store, { title: "好行", content: "A" });
122
+ addMemory(store, { title: "坏行", content: "B" });
123
+ addMemory(store, { title: "空行", content: "C" });
124
+
125
+ let calls = 0;
126
+ const embedder = rebuildEmbedder({ modelHash: "mock#throwing" });
127
+ embedder.embedSingle = async () => {
128
+ calls++;
129
+ if (calls === 2) throw new Error("model unavailable");
130
+ if (calls === 3) return []; // empty vector → not counted
131
+ return [1, 0, 0];
132
+ };
133
+
134
+ const result = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
135
+ assert.equal(result.indexed, 1, "only the successful row is indexed");
136
+ assert.equal(result.skipped, 2, "thrown + empty rows count as skipped");
137
+ assert.equal(vectorIndex.getStats().embeddedCount, 1);
138
+ });
139
+
140
+ test("rebuildIndex guard: embedder with no embed method at all is ignored", async () => {
141
+ const { store, vectorIndex } = setup();
142
+ addMemory(store, { title: "缺向量", content: "A" });
143
+ const bare = { modelHash: "mock#bare", dimension: 3 };
144
+ const result = await vectorIndex.rebuildIndex(bare, { limit: 100 });
145
+ assert.deepEqual(result, { indexed: 0, skipped: 0 }, "guard returns early when neither embed nor embedSingle is available");
146
+ assert.equal(vectorIndex.modelHash(), undefined, "no model marked");
147
+ });
148
+
149
+ test("rebuildIndex supports an embed-only OpenAI-compatible embedder (issue #10)", async () => {
150
+ const { store, vectorIndex } = setup();
151
+ addMemory(store, { title: "缺向量", content: "A" });
152
+ const embedOnly = {
153
+ embed: async (text) => [1, 0, 0], // OpenAI-compatible single-text embed
154
+ modelHash: "text-embedding#abc",
155
+ dimension: 3
156
+ };
157
+ const result = await vectorIndex.rebuildIndex(embedOnly, { limit: 100 });
158
+ assert.equal(result.indexed, 1, "embed-only embedder indexes the missing row");
159
+ assert.equal(result.skipped, 0);
160
+ assert.equal(vectorIndex.modelHash(), "text-embedding#abc", "model fingerprint recorded");
161
+ assert.equal(vectorIndex.dimension(), 3, "dimension recorded");
162
+ assert.equal(vectorIndex.getStats().embeddedCount, 1, "embedding persisted");
163
+ });
164
+
165
+ test("rebuildIndex works with embedSingle-only embedder", async () => {
166
+ const { store, vectorIndex } = setup();
167
+ addMemory(store, { title: "缺向量", content: "A" });
168
+ const single = { embedSingle: async () => [1, 0, 0], modelHash: "mock#single", dimension: 3 };
169
+ const result = await vectorIndex.rebuildIndex(single, { limit: 100 });
170
+ assert.ok(result.indexed >= 1, "embedSingle-only embedder should rebuild");
171
+ assert.equal(vectorIndex.modelHash(), "mock#single", "model marked after successful rebuild");
172
+ });
173
+
174
+ test("getStats reports embedded/total counts and model metadata", () => {
175
+ const { store, vectorIndex } = setup();
176
+ addMemory(store, { title: "甲", content: "1", vector: [1, 0, 0] });
177
+ addMemory(store, { title: "乙", content: "2", vector: [0, 1, 0] });
178
+ addMemory(store, { title: "丙", content: "3" });
179
+
180
+ let stats = vectorIndex.getStats();
181
+ assert.equal(stats.embeddedCount, 2);
182
+ assert.equal(stats.totalCount, 3);
183
+ assert.equal(stats.modelHash, undefined);
184
+ assert.equal(stats.dimension, undefined);
185
+ assert.equal(stats.updatedAt, undefined);
186
+
187
+ vectorIndex.markModel("model#v3", 4);
188
+ stats = vectorIndex.getStats();
189
+ assert.equal(stats.modelHash, "model#v3");
190
+ assert.equal(stats.dimension, 4);
191
+ assert.ok(typeof stats.updatedAt === "string" && stats.updatedAt.length > 0, "updatedAt set");
192
+ });
193
+
194
+ test("incremental update: saveEmbedding overwrites the cached vector and search reflects it", () => {
195
+ const { store, vectorIndex } = setup();
196
+ const a = addMemory(store, { title: "主题", content: "A", vector: [1, 0, 0] });
197
+ const b = addMemory(store, { title: "对照", content: "B", vector: [0, 1, 0] });
198
+
199
+ // Before overwrite: query for B's vector ranks b first.
200
+ let hits = vectorIndex.search([0, 1, 0], { limit: 10, threshold: 0 });
201
+ assert.equal(hits[0].id, b.id);
202
+
203
+ // Overwrite a's vector so it now points at b's direction.
204
+ vectorIndex.saveEmbedding(a.id, [0, 1, 0]);
205
+ assert.deepEqual(vectorIndex.getEmbedding(a.id), [0, 1, 0]);
206
+ assert.equal(vectorIndex.getStats().embeddedCount, 2, "overwrite does not change the count");
207
+
208
+ hits = vectorIndex.search([0, 1, 0], { limit: 10, threshold: 0 });
209
+ assert.equal(hits.length, 2);
210
+ // Tie: identical vectors both score 1; ordering between them is stable by id — we
211
+ // only assert the overwritten row now participates with a full score.
212
+ const aHit = hits.find((h) => h.id === a.id);
213
+ assert.ok(Math.abs(aHit.score - 1) < 1e-9, "overwritten vector scores 1 against the query");
214
+ });
215
+
216
+ test("search returns empty when nothing is embedded", () => {
217
+ const { store, vectorIndex } = setup();
218
+ addMemory(store, { title: "无向量", content: "A" });
219
+ addMemory(store, { title: "也无向量", content: "B" });
220
+ assert.deepEqual(vectorIndex.search([1, 0, 0], { limit: 10 }), []);
221
+ });