@modusensus/dsh-mneme 0.6.8 → 0.6.10

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (117) hide show
  1. package/LICENSE +21 -21
  2. package/README.md +468 -463
  3. package/cordis.patch.yml +15 -15
  4. package/lib/api.js +783 -783
  5. package/lib/client.js +1754 -1757
  6. package/lib/commands.js +64 -64
  7. package/lib/config.js +298 -288
  8. package/lib/dream/clustering.js +118 -118
  9. package/lib/dream/decisions.js +488 -439
  10. package/lib/dream/sleep.js +561 -561
  11. package/lib/dream/tag-extractor.js +156 -156
  12. package/lib/dream.js +958 -935
  13. package/lib/embedding.js +154 -154
  14. package/lib/entities/extractor.js +242 -242
  15. package/lib/hot-memory.js +53 -53
  16. package/lib/index.js +361 -361
  17. package/lib/inject.js +208 -208
  18. package/lib/local-embedder.js +282 -282
  19. package/lib/mirror.js +170 -170
  20. package/lib/parser/tag.js +59 -59
  21. package/lib/parser/wiki-link.js +38 -38
  22. package/lib/quality-filter.js +123 -123
  23. package/lib/reranker.js +218 -218
  24. package/lib/search/adaptive.js +22 -22
  25. package/lib/search/bm25.js +96 -96
  26. package/lib/search/tag-boost.js +61 -61
  27. package/lib/service.js +1726 -1726
  28. package/lib/settings.js +172 -172
  29. package/lib/store.js +2238 -2238
  30. package/lib/summarize.js +236 -236
  31. package/lib/tools.js +290 -290
  32. package/lib/vector-index.js +116 -116
  33. package/package.json +80 -80
  34. package/scripts/benchmark-embed.js +201 -201
  35. package/scripts/benchmark-recall.js +133 -133
  36. package/scripts/benchmark-rerank.js +166 -166
  37. package/scripts/e2e-dsh.js +218 -218
  38. package/scripts/stress-dsh.js +255 -255
  39. package/scripts/sync-lib.js +52 -52
  40. package/src/api.js +783 -783
  41. package/src/commands.js +64 -64
  42. package/src/config.js +298 -288
  43. package/src/dream/clustering.js +118 -118
  44. package/src/dream/decisions.js +488 -439
  45. package/src/dream/sleep.js +561 -561
  46. package/src/dream/tag-extractor.js +156 -156
  47. package/src/dream.js +958 -935
  48. package/src/embedding.js +154 -154
  49. package/src/entities/extractor.js +242 -242
  50. package/src/hot-memory.js +53 -53
  51. package/src/index.js +361 -361
  52. package/src/inject.js +208 -208
  53. package/src/local-embedder.js +282 -282
  54. package/src/mirror.js +170 -170
  55. package/src/parser/tag.js +59 -59
  56. package/src/parser/wiki-link.js +38 -38
  57. package/src/quality-filter.js +123 -123
  58. package/src/reranker.js +218 -218
  59. package/src/search/adaptive.js +22 -22
  60. package/src/search/bm25.js +96 -96
  61. package/src/search/tag-boost.js +61 -61
  62. package/src/service.js +1726 -1726
  63. package/src/settings.js +172 -172
  64. package/src/store.js +2238 -2238
  65. package/src/summarize.js +236 -236
  66. package/src/tools.js +290 -290
  67. package/src/vector-index.js +116 -116
  68. package/test/api.test.js +594 -594
  69. package/test/audit.test.js +448 -448
  70. package/test/benchmark.test.js +35 -35
  71. package/test/boundary-v0625.test.js +82 -82
  72. package/test/client.test.js +368 -368
  73. package/test/clustering.test.js +100 -100
  74. package/test/commands.test.js +69 -69
  75. package/test/config.test.js +50 -50
  76. package/test/conflict-freeze.test.js +290 -290
  77. package/test/directory.test.js +134 -134
  78. package/test/dream.test.js +1060 -903
  79. package/test/entities.test.js +522 -522
  80. package/test/epistemic.test.js +298 -298
  81. package/test/fnew-0112.test.js +311 -311
  82. package/test/fnew-03.test.js +422 -422
  83. package/test/graph-api.test.js +175 -175
  84. package/test/helpers/dream-mock.js +82 -82
  85. package/test/hot-memory.test.js +174 -174
  86. package/test/inject.test.js +103 -103
  87. package/test/llm-audit.test.js +279 -279
  88. package/test/local-embedder.test.js +227 -227
  89. package/test/mirror-dirty.test.js +424 -424
  90. package/test/mirror-edit-digest.test.js +187 -187
  91. package/test/mirror-generation.test.js +499 -499
  92. package/test/mirror.test.js +249 -249
  93. package/test/normalize-decisions.test.js +120 -120
  94. package/test/peer-blockers.test.js +190 -190
  95. package/test/policy-epoch.test.js +259 -259
  96. package/test/provenance.test.js +103 -103
  97. package/test/quality-filter.test.js +118 -118
  98. package/test/reasoning-effort.test.js +199 -199
  99. package/test/recall-evals.test.js +235 -235
  100. package/test/recall-layer.test.js +315 -315
  101. package/test/receipt-chain.test.js +451 -451
  102. package/test/reflection.test.js +226 -226
  103. package/test/reranker.test.js +240 -240
  104. package/test/search-fusion.test.js +90 -90
  105. package/test/semantic.test.js +124 -124
  106. package/test/service-search.test.js +199 -199
  107. package/test/service.test.js +435 -435
  108. package/test/settings.test.js +118 -118
  109. package/test/sleep.test.js +365 -365
  110. package/test/store.test.js +436 -436
  111. package/test/stress.test.js +209 -209
  112. package/test/summarize.test.js +191 -191
  113. package/test/tag-boost.test.js +125 -125
  114. package/test/tag.test.js +312 -312
  115. package/test/tools.test.js +285 -285
  116. package/test/vector-index.test.js +221 -221
  117. package/test/wiki-link.test.js +332 -332
@@ -1,221 +1,221 @@
1
- import test from "node:test";
2
- import assert from "node:assert/strict";
3
- import { createStore } from "../src/store.js";
4
- import { createVectorIndex } from "../src/vector-index.js";
5
-
6
- // Focused unit tests for the vector-index layer: model fingerprint (drift
7
- // detection), embedding save/search/delete, incremental rebuild, and stats.
8
- // The store is used directly (createStore(":memory:")) since vector-index is a
9
- // thin layer over the store's embedding column + vector_meta table.
10
-
11
- function setup() {
12
- const store = createStore(":memory:");
13
- const vectorIndex = createVectorIndex({ store });
14
- return { store, vectorIndex };
15
- }
16
-
17
- // Add a memory via the store and (optionally) set its embedding vector.
18
- function addMemory(store, { title, content, type = "preference", vector }) {
19
- const memory = store.save({ type, title, content, tags: [], importance: 3 });
20
- if (vector) store.setEmbedding(memory.id, vector);
21
- return memory;
22
- }
23
-
24
- // Embedder mock for rebuildIndex. The rebuild loop prefers embedSingle and
25
- // falls back to `embed` for embed-only OpenAI-compatible clients, so a mock
26
- // that provides embedSingle exercises the primary path.
27
- function rebuildEmbedder({ vector = [1, 0, 0], modelHash = "mock#rebuild", dimension = 3 } = {}) {
28
- return {
29
- embed: async (texts) => texts.map(() => vector),
30
- embedSingle: async () => vector,
31
- modelHash,
32
- dimension
33
- };
34
- }
35
-
36
- test("modelHash drift detection: markModel records and replaces the fingerprint", () => {
37
- const { vectorIndex } = setup();
38
-
39
- // No model recorded yet.
40
- assert.equal(vectorIndex.modelHash(), undefined);
41
- assert.equal(vectorIndex.dimension(), undefined);
42
-
43
- vectorIndex.markModel("model#v1", 3);
44
- assert.equal(vectorIndex.modelHash(), "model#v1");
45
- assert.equal(vectorIndex.dimension(), 3);
46
-
47
- // Switching to a different model updates the fingerprint (drift signal).
48
- vectorIndex.markModel("model#v2", 5);
49
- assert.equal(vectorIndex.modelHash(), "model#v2");
50
- assert.equal(vectorIndex.dimension(), 5);
51
- });
52
-
53
- test("saveEmbedding + search recall with cosine ordering", () => {
54
- const { store, vectorIndex } = setup();
55
- // Three memories with distinct 3-d vectors.
56
- const a = addMemory(store, { title: "猫", content: "喜欢猫", vector: [1, 0, 0] });
57
- const b = addMemory(store, { title: "狗", content: "喜欢狗", vector: [0, 1, 0] });
58
- const c = addMemory(store, { title: "虎", content: "喜欢老虎", vector: [0.5, 0.5, 0] });
59
-
60
- const hits = vectorIndex.search([1, 0, 0], { limit: 10, threshold: 0 });
61
- assert.equal(hits.length, 3, "all embedded rows participate");
62
- assert.equal(hits[0].id, a.id, "exact vector match ranks first");
63
- assert.ok(Math.abs(hits[0].score - 1) < 1e-9, "self cosine is 1");
64
-
65
- // Cosine ordering: [1,0,0] vs c = 0.5/sqrt(0.5) ≈ 0.7071 > vs b = 0.
66
- assert.equal(hits[1].id, c.id, "higher cosine ranks before orthogonal");
67
- assert.ok(Math.abs(hits[1].score - 0.5 / Math.sqrt(0.5)) < 1e-9, "c score is dot/sqrt(nb)");
68
- assert.equal(hits[2].id, b.id, "orthogonal vector ranks last");
69
- assert.ok(Math.abs(hits[2].score) < 1e-9, "orthogonal cosine is 0");
70
-
71
- // threshold filters low-similarity rows out.
72
- const filtered = vectorIndex.search([1, 0, 0], { limit: 10, threshold: 0.9 });
73
- assert.deepEqual(filtered.map((h) => h.id), [a.id], "only the 1.0 match passes threshold 0.9");
74
- });
75
-
76
- test("deleteEmbedding clears the cached vector; getEmbedding reflects it", () => {
77
- const { store, vectorIndex } = setup();
78
- const m = addMemory(store, { title: "备忘", content: "临时内容", vector: [1, 0, 0] });
79
-
80
- assert.deepEqual(vectorIndex.getEmbedding(m.id), [1, 0, 0]);
81
-
82
- vectorIndex.deleteEmbedding(m.id);
83
- assert.equal(vectorIndex.getEmbedding(m.id), undefined, "deleted embedding reads as undefined");
84
- assert.equal(vectorIndex.getStats().embeddedCount, 0, "count drops after delete");
85
-
86
- // Save again restores it.
87
- vectorIndex.saveEmbedding(m.id, [0, 0, 1]);
88
- assert.deepEqual(vectorIndex.getEmbedding(m.id), [0, 0, 1]);
89
- });
90
-
91
- test("rebuildIndex embeds only rows missing an embedding and marks the model", async () => {
92
- const { store, vectorIndex } = setup();
93
- // One memory already embedded, two missing.
94
- addMemory(store, { title: "已有向量", content: "A", vector: [0, 1, 0] });
95
- addMemory(store, { title: "缺向量1", content: "B" });
96
- addMemory(store, { title: "缺向量2", content: "C" });
97
- assert.equal(vectorIndex.getStats().embeddedCount, 1);
98
-
99
- const seen = [];
100
- const embedder = rebuildEmbedder({ vector: [1, 0, 0], modelHash: "mock#rebuild", dimension: 3 });
101
- embedder.embedSingle = async (text) => { seen.push(text); return [1, 0, 0]; };
102
-
103
- const result = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
104
- assert.equal(result.indexed, 2, "two missing embeddings written");
105
- assert.equal(result.skipped, 0);
106
- assert.equal(vectorIndex.getStats().embeddedCount, 3, "all rows embedded after rebuild");
107
- assert.equal(seen.length, 2, "embedSingle called once per missing row");
108
-
109
- // Rebuild is a no-op once everything is embedded.
110
- const again = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
111
- assert.equal(again.indexed, 0);
112
- assert.equal(again.skipped, 0);
113
-
114
- // Model fingerprint marked from the rebuild embedder.
115
- assert.equal(vectorIndex.modelHash(), "mock#rebuild");
116
- assert.equal(vectorIndex.dimension(), 3);
117
- });
118
-
119
- test("rebuildIndex handles a throwing embedder without failing the batch", async () => {
120
- const { store, vectorIndex } = setup();
121
- addMemory(store, { title: "好行", content: "A" });
122
- addMemory(store, { title: "坏行", content: "B" });
123
- addMemory(store, { title: "空行", content: "C" });
124
-
125
- let calls = 0;
126
- const embedder = rebuildEmbedder({ modelHash: "mock#throwing" });
127
- embedder.embedSingle = async () => {
128
- calls++;
129
- if (calls === 2) throw new Error("model unavailable");
130
- if (calls === 3) return []; // empty vector → not counted
131
- return [1, 0, 0];
132
- };
133
-
134
- const result = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
135
- assert.equal(result.indexed, 1, "only the successful row is indexed");
136
- assert.equal(result.skipped, 2, "thrown + empty rows count as skipped");
137
- assert.equal(vectorIndex.getStats().embeddedCount, 1);
138
- });
139
-
140
- test("rebuildIndex guard: embedder with no embed method at all is ignored", async () => {
141
- const { store, vectorIndex } = setup();
142
- addMemory(store, { title: "缺向量", content: "A" });
143
- const bare = { modelHash: "mock#bare", dimension: 3 };
144
- const result = await vectorIndex.rebuildIndex(bare, { limit: 100 });
145
- assert.deepEqual(result, { indexed: 0, skipped: 0 }, "guard returns early when neither embed nor embedSingle is available");
146
- assert.equal(vectorIndex.modelHash(), undefined, "no model marked");
147
- });
148
-
149
- test("rebuildIndex supports an embed-only OpenAI-compatible embedder (issue #10)", async () => {
150
- const { store, vectorIndex } = setup();
151
- addMemory(store, { title: "缺向量", content: "A" });
152
- const embedOnly = {
153
- embed: async (text) => [1, 0, 0], // OpenAI-compatible single-text embed
154
- modelHash: "text-embedding#abc",
155
- dimension: 3
156
- };
157
- const result = await vectorIndex.rebuildIndex(embedOnly, { limit: 100 });
158
- assert.equal(result.indexed, 1, "embed-only embedder indexes the missing row");
159
- assert.equal(result.skipped, 0);
160
- assert.equal(vectorIndex.modelHash(), "text-embedding#abc", "model fingerprint recorded");
161
- assert.equal(vectorIndex.dimension(), 3, "dimension recorded");
162
- assert.equal(vectorIndex.getStats().embeddedCount, 1, "embedding persisted");
163
- });
164
-
165
- test("rebuildIndex works with embedSingle-only embedder", async () => {
166
- const { store, vectorIndex } = setup();
167
- addMemory(store, { title: "缺向量", content: "A" });
168
- const single = { embedSingle: async () => [1, 0, 0], modelHash: "mock#single", dimension: 3 };
169
- const result = await vectorIndex.rebuildIndex(single, { limit: 100 });
170
- assert.ok(result.indexed >= 1, "embedSingle-only embedder should rebuild");
171
- assert.equal(vectorIndex.modelHash(), "mock#single", "model marked after successful rebuild");
172
- });
173
-
174
- test("getStats reports embedded/total counts and model metadata", () => {
175
- const { store, vectorIndex } = setup();
176
- addMemory(store, { title: "甲", content: "1", vector: [1, 0, 0] });
177
- addMemory(store, { title: "乙", content: "2", vector: [0, 1, 0] });
178
- addMemory(store, { title: "丙", content: "3" });
179
-
180
- let stats = vectorIndex.getStats();
181
- assert.equal(stats.embeddedCount, 2);
182
- assert.equal(stats.totalCount, 3);
183
- assert.equal(stats.modelHash, undefined);
184
- assert.equal(stats.dimension, undefined);
185
- assert.equal(stats.updatedAt, undefined);
186
-
187
- vectorIndex.markModel("model#v3", 4);
188
- stats = vectorIndex.getStats();
189
- assert.equal(stats.modelHash, "model#v3");
190
- assert.equal(stats.dimension, 4);
191
- assert.ok(typeof stats.updatedAt === "string" && stats.updatedAt.length > 0, "updatedAt set");
192
- });
193
-
194
- test("incremental update: saveEmbedding overwrites the cached vector and search reflects it", () => {
195
- const { store, vectorIndex } = setup();
196
- const a = addMemory(store, { title: "主题", content: "A", vector: [1, 0, 0] });
197
- const b = addMemory(store, { title: "对照", content: "B", vector: [0, 1, 0] });
198
-
199
- // Before overwrite: query for B's vector ranks b first.
200
- let hits = vectorIndex.search([0, 1, 0], { limit: 10, threshold: 0 });
201
- assert.equal(hits[0].id, b.id);
202
-
203
- // Overwrite a's vector so it now points at b's direction.
204
- vectorIndex.saveEmbedding(a.id, [0, 1, 0]);
205
- assert.deepEqual(vectorIndex.getEmbedding(a.id), [0, 1, 0]);
206
- assert.equal(vectorIndex.getStats().embeddedCount, 2, "overwrite does not change the count");
207
-
208
- hits = vectorIndex.search([0, 1, 0], { limit: 10, threshold: 0 });
209
- assert.equal(hits.length, 2);
210
- // Tie: identical vectors both score 1; ordering between them is stable by id — we
211
- // only assert the overwritten row now participates with a full score.
212
- const aHit = hits.find((h) => h.id === a.id);
213
- assert.ok(Math.abs(aHit.score - 1) < 1e-9, "overwritten vector scores 1 against the query");
214
- });
215
-
216
- test("search returns empty when nothing is embedded", () => {
217
- const { store, vectorIndex } = setup();
218
- addMemory(store, { title: "无向量", content: "A" });
219
- addMemory(store, { title: "也无向量", content: "B" });
220
- assert.deepEqual(vectorIndex.search([1, 0, 0], { limit: 10 }), []);
221
- });
1
+ import test from "node:test";
2
+ import assert from "node:assert/strict";
3
+ import { createStore } from "../src/store.js";
4
+ import { createVectorIndex } from "../src/vector-index.js";
5
+
6
+ // Focused unit tests for the vector-index layer: model fingerprint (drift
7
+ // detection), embedding save/search/delete, incremental rebuild, and stats.
8
+ // The store is used directly (createStore(":memory:")) since vector-index is a
9
+ // thin layer over the store's embedding column + vector_meta table.
10
+
11
+ function setup() {
12
+ const store = createStore(":memory:");
13
+ const vectorIndex = createVectorIndex({ store });
14
+ return { store, vectorIndex };
15
+ }
16
+
17
+ // Add a memory via the store and (optionally) set its embedding vector.
18
+ function addMemory(store, { title, content, type = "preference", vector }) {
19
+ const memory = store.save({ type, title, content, tags: [], importance: 3 });
20
+ if (vector) store.setEmbedding(memory.id, vector);
21
+ return memory;
22
+ }
23
+
24
+ // Embedder mock for rebuildIndex. The rebuild loop prefers embedSingle and
25
+ // falls back to `embed` for embed-only OpenAI-compatible clients, so a mock
26
+ // that provides embedSingle exercises the primary path.
27
+ function rebuildEmbedder({ vector = [1, 0, 0], modelHash = "mock#rebuild", dimension = 3 } = {}) {
28
+ return {
29
+ embed: async (texts) => texts.map(() => vector),
30
+ embedSingle: async () => vector,
31
+ modelHash,
32
+ dimension
33
+ };
34
+ }
35
+
36
+ test("modelHash drift detection: markModel records and replaces the fingerprint", () => {
37
+ const { vectorIndex } = setup();
38
+
39
+ // No model recorded yet.
40
+ assert.equal(vectorIndex.modelHash(), undefined);
41
+ assert.equal(vectorIndex.dimension(), undefined);
42
+
43
+ vectorIndex.markModel("model#v1", 3);
44
+ assert.equal(vectorIndex.modelHash(), "model#v1");
45
+ assert.equal(vectorIndex.dimension(), 3);
46
+
47
+ // Switching to a different model updates the fingerprint (drift signal).
48
+ vectorIndex.markModel("model#v2", 5);
49
+ assert.equal(vectorIndex.modelHash(), "model#v2");
50
+ assert.equal(vectorIndex.dimension(), 5);
51
+ });
52
+
53
+ test("saveEmbedding + search recall with cosine ordering", () => {
54
+ const { store, vectorIndex } = setup();
55
+ // Three memories with distinct 3-d vectors.
56
+ const a = addMemory(store, { title: "猫", content: "喜欢猫", vector: [1, 0, 0] });
57
+ const b = addMemory(store, { title: "狗", content: "喜欢狗", vector: [0, 1, 0] });
58
+ const c = addMemory(store, { title: "虎", content: "喜欢老虎", vector: [0.5, 0.5, 0] });
59
+
60
+ const hits = vectorIndex.search([1, 0, 0], { limit: 10, threshold: 0 });
61
+ assert.equal(hits.length, 3, "all embedded rows participate");
62
+ assert.equal(hits[0].id, a.id, "exact vector match ranks first");
63
+ assert.ok(Math.abs(hits[0].score - 1) < 1e-9, "self cosine is 1");
64
+
65
+ // Cosine ordering: [1,0,0] vs c = 0.5/sqrt(0.5) ≈ 0.7071 > vs b = 0.
66
+ assert.equal(hits[1].id, c.id, "higher cosine ranks before orthogonal");
67
+ assert.ok(Math.abs(hits[1].score - 0.5 / Math.sqrt(0.5)) < 1e-9, "c score is dot/sqrt(nb)");
68
+ assert.equal(hits[2].id, b.id, "orthogonal vector ranks last");
69
+ assert.ok(Math.abs(hits[2].score) < 1e-9, "orthogonal cosine is 0");
70
+
71
+ // threshold filters low-similarity rows out.
72
+ const filtered = vectorIndex.search([1, 0, 0], { limit: 10, threshold: 0.9 });
73
+ assert.deepEqual(filtered.map((h) => h.id), [a.id], "only the 1.0 match passes threshold 0.9");
74
+ });
75
+
76
+ test("deleteEmbedding clears the cached vector; getEmbedding reflects it", () => {
77
+ const { store, vectorIndex } = setup();
78
+ const m = addMemory(store, { title: "备忘", content: "临时内容", vector: [1, 0, 0] });
79
+
80
+ assert.deepEqual(vectorIndex.getEmbedding(m.id), [1, 0, 0]);
81
+
82
+ vectorIndex.deleteEmbedding(m.id);
83
+ assert.equal(vectorIndex.getEmbedding(m.id), undefined, "deleted embedding reads as undefined");
84
+ assert.equal(vectorIndex.getStats().embeddedCount, 0, "count drops after delete");
85
+
86
+ // Save again restores it.
87
+ vectorIndex.saveEmbedding(m.id, [0, 0, 1]);
88
+ assert.deepEqual(vectorIndex.getEmbedding(m.id), [0, 0, 1]);
89
+ });
90
+
91
+ test("rebuildIndex embeds only rows missing an embedding and marks the model", async () => {
92
+ const { store, vectorIndex } = setup();
93
+ // One memory already embedded, two missing.
94
+ addMemory(store, { title: "已有向量", content: "A", vector: [0, 1, 0] });
95
+ addMemory(store, { title: "缺向量1", content: "B" });
96
+ addMemory(store, { title: "缺向量2", content: "C" });
97
+ assert.equal(vectorIndex.getStats().embeddedCount, 1);
98
+
99
+ const seen = [];
100
+ const embedder = rebuildEmbedder({ vector: [1, 0, 0], modelHash: "mock#rebuild", dimension: 3 });
101
+ embedder.embedSingle = async (text) => { seen.push(text); return [1, 0, 0]; };
102
+
103
+ const result = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
104
+ assert.equal(result.indexed, 2, "two missing embeddings written");
105
+ assert.equal(result.skipped, 0);
106
+ assert.equal(vectorIndex.getStats().embeddedCount, 3, "all rows embedded after rebuild");
107
+ assert.equal(seen.length, 2, "embedSingle called once per missing row");
108
+
109
+ // Rebuild is a no-op once everything is embedded.
110
+ const again = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
111
+ assert.equal(again.indexed, 0);
112
+ assert.equal(again.skipped, 0);
113
+
114
+ // Model fingerprint marked from the rebuild embedder.
115
+ assert.equal(vectorIndex.modelHash(), "mock#rebuild");
116
+ assert.equal(vectorIndex.dimension(), 3);
117
+ });
118
+
119
+ test("rebuildIndex handles a throwing embedder without failing the batch", async () => {
120
+ const { store, vectorIndex } = setup();
121
+ addMemory(store, { title: "好行", content: "A" });
122
+ addMemory(store, { title: "坏行", content: "B" });
123
+ addMemory(store, { title: "空行", content: "C" });
124
+
125
+ let calls = 0;
126
+ const embedder = rebuildEmbedder({ modelHash: "mock#throwing" });
127
+ embedder.embedSingle = async () => {
128
+ calls++;
129
+ if (calls === 2) throw new Error("model unavailable");
130
+ if (calls === 3) return []; // empty vector → not counted
131
+ return [1, 0, 0];
132
+ };
133
+
134
+ const result = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
135
+ assert.equal(result.indexed, 1, "only the successful row is indexed");
136
+ assert.equal(result.skipped, 2, "thrown + empty rows count as skipped");
137
+ assert.equal(vectorIndex.getStats().embeddedCount, 1);
138
+ });
139
+
140
+ test("rebuildIndex guard: embedder with no embed method at all is ignored", async () => {
141
+ const { store, vectorIndex } = setup();
142
+ addMemory(store, { title: "缺向量", content: "A" });
143
+ const bare = { modelHash: "mock#bare", dimension: 3 };
144
+ const result = await vectorIndex.rebuildIndex(bare, { limit: 100 });
145
+ assert.deepEqual(result, { indexed: 0, skipped: 0 }, "guard returns early when neither embed nor embedSingle is available");
146
+ assert.equal(vectorIndex.modelHash(), undefined, "no model marked");
147
+ });
148
+
149
+ test("rebuildIndex supports an embed-only OpenAI-compatible embedder (issue #10)", async () => {
150
+ const { store, vectorIndex } = setup();
151
+ addMemory(store, { title: "缺向量", content: "A" });
152
+ const embedOnly = {
153
+ embed: async (text) => [1, 0, 0], // OpenAI-compatible single-text embed
154
+ modelHash: "text-embedding#abc",
155
+ dimension: 3
156
+ };
157
+ const result = await vectorIndex.rebuildIndex(embedOnly, { limit: 100 });
158
+ assert.equal(result.indexed, 1, "embed-only embedder indexes the missing row");
159
+ assert.equal(result.skipped, 0);
160
+ assert.equal(vectorIndex.modelHash(), "text-embedding#abc", "model fingerprint recorded");
161
+ assert.equal(vectorIndex.dimension(), 3, "dimension recorded");
162
+ assert.equal(vectorIndex.getStats().embeddedCount, 1, "embedding persisted");
163
+ });
164
+
165
+ test("rebuildIndex works with embedSingle-only embedder", async () => {
166
+ const { store, vectorIndex } = setup();
167
+ addMemory(store, { title: "缺向量", content: "A" });
168
+ const single = { embedSingle: async () => [1, 0, 0], modelHash: "mock#single", dimension: 3 };
169
+ const result = await vectorIndex.rebuildIndex(single, { limit: 100 });
170
+ assert.ok(result.indexed >= 1, "embedSingle-only embedder should rebuild");
171
+ assert.equal(vectorIndex.modelHash(), "mock#single", "model marked after successful rebuild");
172
+ });
173
+
174
+ test("getStats reports embedded/total counts and model metadata", () => {
175
+ const { store, vectorIndex } = setup();
176
+ addMemory(store, { title: "甲", content: "1", vector: [1, 0, 0] });
177
+ addMemory(store, { title: "乙", content: "2", vector: [0, 1, 0] });
178
+ addMemory(store, { title: "丙", content: "3" });
179
+
180
+ let stats = vectorIndex.getStats();
181
+ assert.equal(stats.embeddedCount, 2);
182
+ assert.equal(stats.totalCount, 3);
183
+ assert.equal(stats.modelHash, undefined);
184
+ assert.equal(stats.dimension, undefined);
185
+ assert.equal(stats.updatedAt, undefined);
186
+
187
+ vectorIndex.markModel("model#v3", 4);
188
+ stats = vectorIndex.getStats();
189
+ assert.equal(stats.modelHash, "model#v3");
190
+ assert.equal(stats.dimension, 4);
191
+ assert.ok(typeof stats.updatedAt === "string" && stats.updatedAt.length > 0, "updatedAt set");
192
+ });
193
+
194
+ test("incremental update: saveEmbedding overwrites the cached vector and search reflects it", () => {
195
+ const { store, vectorIndex } = setup();
196
+ const a = addMemory(store, { title: "主题", content: "A", vector: [1, 0, 0] });
197
+ const b = addMemory(store, { title: "对照", content: "B", vector: [0, 1, 0] });
198
+
199
+ // Before overwrite: query for B's vector ranks b first.
200
+ let hits = vectorIndex.search([0, 1, 0], { limit: 10, threshold: 0 });
201
+ assert.equal(hits[0].id, b.id);
202
+
203
+ // Overwrite a's vector so it now points at b's direction.
204
+ vectorIndex.saveEmbedding(a.id, [0, 1, 0]);
205
+ assert.deepEqual(vectorIndex.getEmbedding(a.id), [0, 1, 0]);
206
+ assert.equal(vectorIndex.getStats().embeddedCount, 2, "overwrite does not change the count");
207
+
208
+ hits = vectorIndex.search([0, 1, 0], { limit: 10, threshold: 0 });
209
+ assert.equal(hits.length, 2);
210
+ // Tie: identical vectors both score 1; ordering between them is stable by id — we
211
+ // only assert the overwritten row now participates with a full score.
212
+ const aHit = hits.find((h) => h.id === a.id);
213
+ assert.ok(Math.abs(aHit.score - 1) < 1e-9, "overwritten vector scores 1 against the query");
214
+ });
215
+
216
+ test("search returns empty when nothing is embedded", () => {
217
+ const { store, vectorIndex } = setup();
218
+ addMemory(store, { title: "无向量", content: "A" });
219
+ addMemory(store, { title: "也无向量", content: "B" });
220
+ assert.deepEqual(vectorIndex.search([1, 0, 0], { limit: 10 }), []);
221
+ });