@modusensus/dsh-mneme 0.6.8 → 0.6.10
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/LICENSE +21 -21
- package/README.md +468 -463
- package/cordis.patch.yml +15 -15
- package/lib/api.js +783 -783
- package/lib/client.js +1754 -1757
- package/lib/commands.js +64 -64
- package/lib/config.js +298 -288
- package/lib/dream/clustering.js +118 -118
- package/lib/dream/decisions.js +488 -439
- package/lib/dream/sleep.js +561 -561
- package/lib/dream/tag-extractor.js +156 -156
- package/lib/dream.js +958 -935
- package/lib/embedding.js +154 -154
- package/lib/entities/extractor.js +242 -242
- package/lib/hot-memory.js +53 -53
- package/lib/index.js +361 -361
- package/lib/inject.js +208 -208
- package/lib/local-embedder.js +282 -282
- package/lib/mirror.js +170 -170
- package/lib/parser/tag.js +59 -59
- package/lib/parser/wiki-link.js +38 -38
- package/lib/quality-filter.js +123 -123
- package/lib/reranker.js +218 -218
- package/lib/search/adaptive.js +22 -22
- package/lib/search/bm25.js +96 -96
- package/lib/search/tag-boost.js +61 -61
- package/lib/service.js +1726 -1726
- package/lib/settings.js +172 -172
- package/lib/store.js +2238 -2238
- package/lib/summarize.js +236 -236
- package/lib/tools.js +290 -290
- package/lib/vector-index.js +116 -116
- package/package.json +80 -80
- package/scripts/benchmark-embed.js +201 -201
- package/scripts/benchmark-recall.js +133 -133
- package/scripts/benchmark-rerank.js +166 -166
- package/scripts/e2e-dsh.js +218 -218
- package/scripts/stress-dsh.js +255 -255
- package/scripts/sync-lib.js +52 -52
- package/src/api.js +783 -783
- package/src/commands.js +64 -64
- package/src/config.js +298 -288
- package/src/dream/clustering.js +118 -118
- package/src/dream/decisions.js +488 -439
- package/src/dream/sleep.js +561 -561
- package/src/dream/tag-extractor.js +156 -156
- package/src/dream.js +958 -935
- package/src/embedding.js +154 -154
- package/src/entities/extractor.js +242 -242
- package/src/hot-memory.js +53 -53
- package/src/index.js +361 -361
- package/src/inject.js +208 -208
- package/src/local-embedder.js +282 -282
- package/src/mirror.js +170 -170
- package/src/parser/tag.js +59 -59
- package/src/parser/wiki-link.js +38 -38
- package/src/quality-filter.js +123 -123
- package/src/reranker.js +218 -218
- package/src/search/adaptive.js +22 -22
- package/src/search/bm25.js +96 -96
- package/src/search/tag-boost.js +61 -61
- package/src/service.js +1726 -1726
- package/src/settings.js +172 -172
- package/src/store.js +2238 -2238
- package/src/summarize.js +236 -236
- package/src/tools.js +290 -290
- package/src/vector-index.js +116 -116
- package/test/api.test.js +594 -594
- package/test/audit.test.js +448 -448
- package/test/benchmark.test.js +35 -35
- package/test/boundary-v0625.test.js +82 -82
- package/test/client.test.js +368 -368
- package/test/clustering.test.js +100 -100
- package/test/commands.test.js +69 -69
- package/test/config.test.js +50 -50
- package/test/conflict-freeze.test.js +290 -290
- package/test/directory.test.js +134 -134
- package/test/dream.test.js +1060 -903
- package/test/entities.test.js +522 -522
- package/test/epistemic.test.js +298 -298
- package/test/fnew-0112.test.js +311 -311
- package/test/fnew-03.test.js +422 -422
- package/test/graph-api.test.js +175 -175
- package/test/helpers/dream-mock.js +82 -82
- package/test/hot-memory.test.js +174 -174
- package/test/inject.test.js +103 -103
- package/test/llm-audit.test.js +279 -279
- package/test/local-embedder.test.js +227 -227
- package/test/mirror-dirty.test.js +424 -424
- package/test/mirror-edit-digest.test.js +187 -187
- package/test/mirror-generation.test.js +499 -499
- package/test/mirror.test.js +249 -249
- package/test/normalize-decisions.test.js +120 -120
- package/test/peer-blockers.test.js +190 -190
- package/test/policy-epoch.test.js +259 -259
- package/test/provenance.test.js +103 -103
- package/test/quality-filter.test.js +118 -118
- package/test/reasoning-effort.test.js +199 -199
- package/test/recall-evals.test.js +235 -235
- package/test/recall-layer.test.js +315 -315
- package/test/receipt-chain.test.js +451 -451
- package/test/reflection.test.js +226 -226
- package/test/reranker.test.js +240 -240
- package/test/search-fusion.test.js +90 -90
- package/test/semantic.test.js +124 -124
- package/test/service-search.test.js +199 -199
- package/test/service.test.js +435 -435
- package/test/settings.test.js +118 -118
- package/test/sleep.test.js +365 -365
- package/test/store.test.js +436 -436
- package/test/stress.test.js +209 -209
- package/test/summarize.test.js +191 -191
- package/test/tag-boost.test.js +125 -125
- package/test/tag.test.js +312 -312
- package/test/tools.test.js +285 -285
- package/test/vector-index.test.js +221 -221
- package/test/wiki-link.test.js +332 -332
|
@@ -1,221 +1,221 @@
|
|
|
1
|
-
import test from "node:test";
|
|
2
|
-
import assert from "node:assert/strict";
|
|
3
|
-
import { createStore } from "../src/store.js";
|
|
4
|
-
import { createVectorIndex } from "../src/vector-index.js";
|
|
5
|
-
|
|
6
|
-
// Focused unit tests for the vector-index layer: model fingerprint (drift
|
|
7
|
-
// detection), embedding save/search/delete, incremental rebuild, and stats.
|
|
8
|
-
// The store is used directly (createStore(":memory:")) since vector-index is a
|
|
9
|
-
// thin layer over the store's embedding column + vector_meta table.
|
|
10
|
-
|
|
11
|
-
function setup() {
|
|
12
|
-
const store = createStore(":memory:");
|
|
13
|
-
const vectorIndex = createVectorIndex({ store });
|
|
14
|
-
return { store, vectorIndex };
|
|
15
|
-
}
|
|
16
|
-
|
|
17
|
-
// Add a memory via the store and (optionally) set its embedding vector.
|
|
18
|
-
function addMemory(store, { title, content, type = "preference", vector }) {
|
|
19
|
-
const memory = store.save({ type, title, content, tags: [], importance: 3 });
|
|
20
|
-
if (vector) store.setEmbedding(memory.id, vector);
|
|
21
|
-
return memory;
|
|
22
|
-
}
|
|
23
|
-
|
|
24
|
-
// Embedder mock for rebuildIndex. The rebuild loop prefers embedSingle and
|
|
25
|
-
// falls back to `embed` for embed-only OpenAI-compatible clients, so a mock
|
|
26
|
-
// that provides embedSingle exercises the primary path.
|
|
27
|
-
function rebuildEmbedder({ vector = [1, 0, 0], modelHash = "mock#rebuild", dimension = 3 } = {}) {
|
|
28
|
-
return {
|
|
29
|
-
embed: async (texts) => texts.map(() => vector),
|
|
30
|
-
embedSingle: async () => vector,
|
|
31
|
-
modelHash,
|
|
32
|
-
dimension
|
|
33
|
-
};
|
|
34
|
-
}
|
|
35
|
-
|
|
36
|
-
test("modelHash drift detection: markModel records and replaces the fingerprint", () => {
|
|
37
|
-
const { vectorIndex } = setup();
|
|
38
|
-
|
|
39
|
-
// No model recorded yet.
|
|
40
|
-
assert.equal(vectorIndex.modelHash(), undefined);
|
|
41
|
-
assert.equal(vectorIndex.dimension(), undefined);
|
|
42
|
-
|
|
43
|
-
vectorIndex.markModel("model#v1", 3);
|
|
44
|
-
assert.equal(vectorIndex.modelHash(), "model#v1");
|
|
45
|
-
assert.equal(vectorIndex.dimension(), 3);
|
|
46
|
-
|
|
47
|
-
// Switching to a different model updates the fingerprint (drift signal).
|
|
48
|
-
vectorIndex.markModel("model#v2", 5);
|
|
49
|
-
assert.equal(vectorIndex.modelHash(), "model#v2");
|
|
50
|
-
assert.equal(vectorIndex.dimension(), 5);
|
|
51
|
-
});
|
|
52
|
-
|
|
53
|
-
test("saveEmbedding + search recall with cosine ordering", () => {
|
|
54
|
-
const { store, vectorIndex } = setup();
|
|
55
|
-
// Three memories with distinct 3-d vectors.
|
|
56
|
-
const a = addMemory(store, { title: "猫", content: "喜欢猫", vector: [1, 0, 0] });
|
|
57
|
-
const b = addMemory(store, { title: "狗", content: "喜欢狗", vector: [0, 1, 0] });
|
|
58
|
-
const c = addMemory(store, { title: "虎", content: "喜欢老虎", vector: [0.5, 0.5, 0] });
|
|
59
|
-
|
|
60
|
-
const hits = vectorIndex.search([1, 0, 0], { limit: 10, threshold: 0 });
|
|
61
|
-
assert.equal(hits.length, 3, "all embedded rows participate");
|
|
62
|
-
assert.equal(hits[0].id, a.id, "exact vector match ranks first");
|
|
63
|
-
assert.ok(Math.abs(hits[0].score - 1) < 1e-9, "self cosine is 1");
|
|
64
|
-
|
|
65
|
-
// Cosine ordering: [1,0,0] vs c = 0.5/sqrt(0.5) ≈ 0.7071 > vs b = 0.
|
|
66
|
-
assert.equal(hits[1].id, c.id, "higher cosine ranks before orthogonal");
|
|
67
|
-
assert.ok(Math.abs(hits[1].score - 0.5 / Math.sqrt(0.5)) < 1e-9, "c score is dot/sqrt(nb)");
|
|
68
|
-
assert.equal(hits[2].id, b.id, "orthogonal vector ranks last");
|
|
69
|
-
assert.ok(Math.abs(hits[2].score) < 1e-9, "orthogonal cosine is 0");
|
|
70
|
-
|
|
71
|
-
// threshold filters low-similarity rows out.
|
|
72
|
-
const filtered = vectorIndex.search([1, 0, 0], { limit: 10, threshold: 0.9 });
|
|
73
|
-
assert.deepEqual(filtered.map((h) => h.id), [a.id], "only the 1.0 match passes threshold 0.9");
|
|
74
|
-
});
|
|
75
|
-
|
|
76
|
-
test("deleteEmbedding clears the cached vector; getEmbedding reflects it", () => {
|
|
77
|
-
const { store, vectorIndex } = setup();
|
|
78
|
-
const m = addMemory(store, { title: "备忘", content: "临时内容", vector: [1, 0, 0] });
|
|
79
|
-
|
|
80
|
-
assert.deepEqual(vectorIndex.getEmbedding(m.id), [1, 0, 0]);
|
|
81
|
-
|
|
82
|
-
vectorIndex.deleteEmbedding(m.id);
|
|
83
|
-
assert.equal(vectorIndex.getEmbedding(m.id), undefined, "deleted embedding reads as undefined");
|
|
84
|
-
assert.equal(vectorIndex.getStats().embeddedCount, 0, "count drops after delete");
|
|
85
|
-
|
|
86
|
-
// Save again restores it.
|
|
87
|
-
vectorIndex.saveEmbedding(m.id, [0, 0, 1]);
|
|
88
|
-
assert.deepEqual(vectorIndex.getEmbedding(m.id), [0, 0, 1]);
|
|
89
|
-
});
|
|
90
|
-
|
|
91
|
-
test("rebuildIndex embeds only rows missing an embedding and marks the model", async () => {
|
|
92
|
-
const { store, vectorIndex } = setup();
|
|
93
|
-
// One memory already embedded, two missing.
|
|
94
|
-
addMemory(store, { title: "已有向量", content: "A", vector: [0, 1, 0] });
|
|
95
|
-
addMemory(store, { title: "缺向量1", content: "B" });
|
|
96
|
-
addMemory(store, { title: "缺向量2", content: "C" });
|
|
97
|
-
assert.equal(vectorIndex.getStats().embeddedCount, 1);
|
|
98
|
-
|
|
99
|
-
const seen = [];
|
|
100
|
-
const embedder = rebuildEmbedder({ vector: [1, 0, 0], modelHash: "mock#rebuild", dimension: 3 });
|
|
101
|
-
embedder.embedSingle = async (text) => { seen.push(text); return [1, 0, 0]; };
|
|
102
|
-
|
|
103
|
-
const result = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
|
|
104
|
-
assert.equal(result.indexed, 2, "two missing embeddings written");
|
|
105
|
-
assert.equal(result.skipped, 0);
|
|
106
|
-
assert.equal(vectorIndex.getStats().embeddedCount, 3, "all rows embedded after rebuild");
|
|
107
|
-
assert.equal(seen.length, 2, "embedSingle called once per missing row");
|
|
108
|
-
|
|
109
|
-
// Rebuild is a no-op once everything is embedded.
|
|
110
|
-
const again = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
|
|
111
|
-
assert.equal(again.indexed, 0);
|
|
112
|
-
assert.equal(again.skipped, 0);
|
|
113
|
-
|
|
114
|
-
// Model fingerprint marked from the rebuild embedder.
|
|
115
|
-
assert.equal(vectorIndex.modelHash(), "mock#rebuild");
|
|
116
|
-
assert.equal(vectorIndex.dimension(), 3);
|
|
117
|
-
});
|
|
118
|
-
|
|
119
|
-
test("rebuildIndex handles a throwing embedder without failing the batch", async () => {
|
|
120
|
-
const { store, vectorIndex } = setup();
|
|
121
|
-
addMemory(store, { title: "好行", content: "A" });
|
|
122
|
-
addMemory(store, { title: "坏行", content: "B" });
|
|
123
|
-
addMemory(store, { title: "空行", content: "C" });
|
|
124
|
-
|
|
125
|
-
let calls = 0;
|
|
126
|
-
const embedder = rebuildEmbedder({ modelHash: "mock#throwing" });
|
|
127
|
-
embedder.embedSingle = async () => {
|
|
128
|
-
calls++;
|
|
129
|
-
if (calls === 2) throw new Error("model unavailable");
|
|
130
|
-
if (calls === 3) return []; // empty vector → not counted
|
|
131
|
-
return [1, 0, 0];
|
|
132
|
-
};
|
|
133
|
-
|
|
134
|
-
const result = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
|
|
135
|
-
assert.equal(result.indexed, 1, "only the successful row is indexed");
|
|
136
|
-
assert.equal(result.skipped, 2, "thrown + empty rows count as skipped");
|
|
137
|
-
assert.equal(vectorIndex.getStats().embeddedCount, 1);
|
|
138
|
-
});
|
|
139
|
-
|
|
140
|
-
test("rebuildIndex guard: embedder with no embed method at all is ignored", async () => {
|
|
141
|
-
const { store, vectorIndex } = setup();
|
|
142
|
-
addMemory(store, { title: "缺向量", content: "A" });
|
|
143
|
-
const bare = { modelHash: "mock#bare", dimension: 3 };
|
|
144
|
-
const result = await vectorIndex.rebuildIndex(bare, { limit: 100 });
|
|
145
|
-
assert.deepEqual(result, { indexed: 0, skipped: 0 }, "guard returns early when neither embed nor embedSingle is available");
|
|
146
|
-
assert.equal(vectorIndex.modelHash(), undefined, "no model marked");
|
|
147
|
-
});
|
|
148
|
-
|
|
149
|
-
test("rebuildIndex supports an embed-only OpenAI-compatible embedder (issue #10)", async () => {
|
|
150
|
-
const { store, vectorIndex } = setup();
|
|
151
|
-
addMemory(store, { title: "缺向量", content: "A" });
|
|
152
|
-
const embedOnly = {
|
|
153
|
-
embed: async (text) => [1, 0, 0], // OpenAI-compatible single-text embed
|
|
154
|
-
modelHash: "text-embedding#abc",
|
|
155
|
-
dimension: 3
|
|
156
|
-
};
|
|
157
|
-
const result = await vectorIndex.rebuildIndex(embedOnly, { limit: 100 });
|
|
158
|
-
assert.equal(result.indexed, 1, "embed-only embedder indexes the missing row");
|
|
159
|
-
assert.equal(result.skipped, 0);
|
|
160
|
-
assert.equal(vectorIndex.modelHash(), "text-embedding#abc", "model fingerprint recorded");
|
|
161
|
-
assert.equal(vectorIndex.dimension(), 3, "dimension recorded");
|
|
162
|
-
assert.equal(vectorIndex.getStats().embeddedCount, 1, "embedding persisted");
|
|
163
|
-
});
|
|
164
|
-
|
|
165
|
-
test("rebuildIndex works with embedSingle-only embedder", async () => {
|
|
166
|
-
const { store, vectorIndex } = setup();
|
|
167
|
-
addMemory(store, { title: "缺向量", content: "A" });
|
|
168
|
-
const single = { embedSingle: async () => [1, 0, 0], modelHash: "mock#single", dimension: 3 };
|
|
169
|
-
const result = await vectorIndex.rebuildIndex(single, { limit: 100 });
|
|
170
|
-
assert.ok(result.indexed >= 1, "embedSingle-only embedder should rebuild");
|
|
171
|
-
assert.equal(vectorIndex.modelHash(), "mock#single", "model marked after successful rebuild");
|
|
172
|
-
});
|
|
173
|
-
|
|
174
|
-
test("getStats reports embedded/total counts and model metadata", () => {
|
|
175
|
-
const { store, vectorIndex } = setup();
|
|
176
|
-
addMemory(store, { title: "甲", content: "1", vector: [1, 0, 0] });
|
|
177
|
-
addMemory(store, { title: "乙", content: "2", vector: [0, 1, 0] });
|
|
178
|
-
addMemory(store, { title: "丙", content: "3" });
|
|
179
|
-
|
|
180
|
-
let stats = vectorIndex.getStats();
|
|
181
|
-
assert.equal(stats.embeddedCount, 2);
|
|
182
|
-
assert.equal(stats.totalCount, 3);
|
|
183
|
-
assert.equal(stats.modelHash, undefined);
|
|
184
|
-
assert.equal(stats.dimension, undefined);
|
|
185
|
-
assert.equal(stats.updatedAt, undefined);
|
|
186
|
-
|
|
187
|
-
vectorIndex.markModel("model#v3", 4);
|
|
188
|
-
stats = vectorIndex.getStats();
|
|
189
|
-
assert.equal(stats.modelHash, "model#v3");
|
|
190
|
-
assert.equal(stats.dimension, 4);
|
|
191
|
-
assert.ok(typeof stats.updatedAt === "string" && stats.updatedAt.length > 0, "updatedAt set");
|
|
192
|
-
});
|
|
193
|
-
|
|
194
|
-
test("incremental update: saveEmbedding overwrites the cached vector and search reflects it", () => {
|
|
195
|
-
const { store, vectorIndex } = setup();
|
|
196
|
-
const a = addMemory(store, { title: "主题", content: "A", vector: [1, 0, 0] });
|
|
197
|
-
const b = addMemory(store, { title: "对照", content: "B", vector: [0, 1, 0] });
|
|
198
|
-
|
|
199
|
-
// Before overwrite: query for B's vector ranks b first.
|
|
200
|
-
let hits = vectorIndex.search([0, 1, 0], { limit: 10, threshold: 0 });
|
|
201
|
-
assert.equal(hits[0].id, b.id);
|
|
202
|
-
|
|
203
|
-
// Overwrite a's vector so it now points at b's direction.
|
|
204
|
-
vectorIndex.saveEmbedding(a.id, [0, 1, 0]);
|
|
205
|
-
assert.deepEqual(vectorIndex.getEmbedding(a.id), [0, 1, 0]);
|
|
206
|
-
assert.equal(vectorIndex.getStats().embeddedCount, 2, "overwrite does not change the count");
|
|
207
|
-
|
|
208
|
-
hits = vectorIndex.search([0, 1, 0], { limit: 10, threshold: 0 });
|
|
209
|
-
assert.equal(hits.length, 2);
|
|
210
|
-
// Tie: identical vectors both score 1; ordering between them is stable by id — we
|
|
211
|
-
// only assert the overwritten row now participates with a full score.
|
|
212
|
-
const aHit = hits.find((h) => h.id === a.id);
|
|
213
|
-
assert.ok(Math.abs(aHit.score - 1) < 1e-9, "overwritten vector scores 1 against the query");
|
|
214
|
-
});
|
|
215
|
-
|
|
216
|
-
test("search returns empty when nothing is embedded", () => {
|
|
217
|
-
const { store, vectorIndex } = setup();
|
|
218
|
-
addMemory(store, { title: "无向量", content: "A" });
|
|
219
|
-
addMemory(store, { title: "也无向量", content: "B" });
|
|
220
|
-
assert.deepEqual(vectorIndex.search([1, 0, 0], { limit: 10 }), []);
|
|
221
|
-
});
|
|
1
|
+
import test from "node:test";
|
|
2
|
+
import assert from "node:assert/strict";
|
|
3
|
+
import { createStore } from "../src/store.js";
|
|
4
|
+
import { createVectorIndex } from "../src/vector-index.js";
|
|
5
|
+
|
|
6
|
+
// Focused unit tests for the vector-index layer: model fingerprint (drift
|
|
7
|
+
// detection), embedding save/search/delete, incremental rebuild, and stats.
|
|
8
|
+
// The store is used directly (createStore(":memory:")) since vector-index is a
|
|
9
|
+
// thin layer over the store's embedding column + vector_meta table.
|
|
10
|
+
|
|
11
|
+
function setup() {
|
|
12
|
+
const store = createStore(":memory:");
|
|
13
|
+
const vectorIndex = createVectorIndex({ store });
|
|
14
|
+
return { store, vectorIndex };
|
|
15
|
+
}
|
|
16
|
+
|
|
17
|
+
// Add a memory via the store and (optionally) set its embedding vector.
|
|
18
|
+
function addMemory(store, { title, content, type = "preference", vector }) {
|
|
19
|
+
const memory = store.save({ type, title, content, tags: [], importance: 3 });
|
|
20
|
+
if (vector) store.setEmbedding(memory.id, vector);
|
|
21
|
+
return memory;
|
|
22
|
+
}
|
|
23
|
+
|
|
24
|
+
// Embedder mock for rebuildIndex. The rebuild loop prefers embedSingle and
|
|
25
|
+
// falls back to `embed` for embed-only OpenAI-compatible clients, so a mock
|
|
26
|
+
// that provides embedSingle exercises the primary path.
|
|
27
|
+
function rebuildEmbedder({ vector = [1, 0, 0], modelHash = "mock#rebuild", dimension = 3 } = {}) {
|
|
28
|
+
return {
|
|
29
|
+
embed: async (texts) => texts.map(() => vector),
|
|
30
|
+
embedSingle: async () => vector,
|
|
31
|
+
modelHash,
|
|
32
|
+
dimension
|
|
33
|
+
};
|
|
34
|
+
}
|
|
35
|
+
|
|
36
|
+
test("modelHash drift detection: markModel records and replaces the fingerprint", () => {
|
|
37
|
+
const { vectorIndex } = setup();
|
|
38
|
+
|
|
39
|
+
// No model recorded yet.
|
|
40
|
+
assert.equal(vectorIndex.modelHash(), undefined);
|
|
41
|
+
assert.equal(vectorIndex.dimension(), undefined);
|
|
42
|
+
|
|
43
|
+
vectorIndex.markModel("model#v1", 3);
|
|
44
|
+
assert.equal(vectorIndex.modelHash(), "model#v1");
|
|
45
|
+
assert.equal(vectorIndex.dimension(), 3);
|
|
46
|
+
|
|
47
|
+
// Switching to a different model updates the fingerprint (drift signal).
|
|
48
|
+
vectorIndex.markModel("model#v2", 5);
|
|
49
|
+
assert.equal(vectorIndex.modelHash(), "model#v2");
|
|
50
|
+
assert.equal(vectorIndex.dimension(), 5);
|
|
51
|
+
});
|
|
52
|
+
|
|
53
|
+
test("saveEmbedding + search recall with cosine ordering", () => {
|
|
54
|
+
const { store, vectorIndex } = setup();
|
|
55
|
+
// Three memories with distinct 3-d vectors.
|
|
56
|
+
const a = addMemory(store, { title: "猫", content: "喜欢猫", vector: [1, 0, 0] });
|
|
57
|
+
const b = addMemory(store, { title: "狗", content: "喜欢狗", vector: [0, 1, 0] });
|
|
58
|
+
const c = addMemory(store, { title: "虎", content: "喜欢老虎", vector: [0.5, 0.5, 0] });
|
|
59
|
+
|
|
60
|
+
const hits = vectorIndex.search([1, 0, 0], { limit: 10, threshold: 0 });
|
|
61
|
+
assert.equal(hits.length, 3, "all embedded rows participate");
|
|
62
|
+
assert.equal(hits[0].id, a.id, "exact vector match ranks first");
|
|
63
|
+
assert.ok(Math.abs(hits[0].score - 1) < 1e-9, "self cosine is 1");
|
|
64
|
+
|
|
65
|
+
// Cosine ordering: [1,0,0] vs c = 0.5/sqrt(0.5) ≈ 0.7071 > vs b = 0.
|
|
66
|
+
assert.equal(hits[1].id, c.id, "higher cosine ranks before orthogonal");
|
|
67
|
+
assert.ok(Math.abs(hits[1].score - 0.5 / Math.sqrt(0.5)) < 1e-9, "c score is dot/sqrt(nb)");
|
|
68
|
+
assert.equal(hits[2].id, b.id, "orthogonal vector ranks last");
|
|
69
|
+
assert.ok(Math.abs(hits[2].score) < 1e-9, "orthogonal cosine is 0");
|
|
70
|
+
|
|
71
|
+
// threshold filters low-similarity rows out.
|
|
72
|
+
const filtered = vectorIndex.search([1, 0, 0], { limit: 10, threshold: 0.9 });
|
|
73
|
+
assert.deepEqual(filtered.map((h) => h.id), [a.id], "only the 1.0 match passes threshold 0.9");
|
|
74
|
+
});
|
|
75
|
+
|
|
76
|
+
test("deleteEmbedding clears the cached vector; getEmbedding reflects it", () => {
|
|
77
|
+
const { store, vectorIndex } = setup();
|
|
78
|
+
const m = addMemory(store, { title: "备忘", content: "临时内容", vector: [1, 0, 0] });
|
|
79
|
+
|
|
80
|
+
assert.deepEqual(vectorIndex.getEmbedding(m.id), [1, 0, 0]);
|
|
81
|
+
|
|
82
|
+
vectorIndex.deleteEmbedding(m.id);
|
|
83
|
+
assert.equal(vectorIndex.getEmbedding(m.id), undefined, "deleted embedding reads as undefined");
|
|
84
|
+
assert.equal(vectorIndex.getStats().embeddedCount, 0, "count drops after delete");
|
|
85
|
+
|
|
86
|
+
// Save again restores it.
|
|
87
|
+
vectorIndex.saveEmbedding(m.id, [0, 0, 1]);
|
|
88
|
+
assert.deepEqual(vectorIndex.getEmbedding(m.id), [0, 0, 1]);
|
|
89
|
+
});
|
|
90
|
+
|
|
91
|
+
test("rebuildIndex embeds only rows missing an embedding and marks the model", async () => {
|
|
92
|
+
const { store, vectorIndex } = setup();
|
|
93
|
+
// One memory already embedded, two missing.
|
|
94
|
+
addMemory(store, { title: "已有向量", content: "A", vector: [0, 1, 0] });
|
|
95
|
+
addMemory(store, { title: "缺向量1", content: "B" });
|
|
96
|
+
addMemory(store, { title: "缺向量2", content: "C" });
|
|
97
|
+
assert.equal(vectorIndex.getStats().embeddedCount, 1);
|
|
98
|
+
|
|
99
|
+
const seen = [];
|
|
100
|
+
const embedder = rebuildEmbedder({ vector: [1, 0, 0], modelHash: "mock#rebuild", dimension: 3 });
|
|
101
|
+
embedder.embedSingle = async (text) => { seen.push(text); return [1, 0, 0]; };
|
|
102
|
+
|
|
103
|
+
const result = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
|
|
104
|
+
assert.equal(result.indexed, 2, "two missing embeddings written");
|
|
105
|
+
assert.equal(result.skipped, 0);
|
|
106
|
+
assert.equal(vectorIndex.getStats().embeddedCount, 3, "all rows embedded after rebuild");
|
|
107
|
+
assert.equal(seen.length, 2, "embedSingle called once per missing row");
|
|
108
|
+
|
|
109
|
+
// Rebuild is a no-op once everything is embedded.
|
|
110
|
+
const again = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
|
|
111
|
+
assert.equal(again.indexed, 0);
|
|
112
|
+
assert.equal(again.skipped, 0);
|
|
113
|
+
|
|
114
|
+
// Model fingerprint marked from the rebuild embedder.
|
|
115
|
+
assert.equal(vectorIndex.modelHash(), "mock#rebuild");
|
|
116
|
+
assert.equal(vectorIndex.dimension(), 3);
|
|
117
|
+
});
|
|
118
|
+
|
|
119
|
+
test("rebuildIndex handles a throwing embedder without failing the batch", async () => {
|
|
120
|
+
const { store, vectorIndex } = setup();
|
|
121
|
+
addMemory(store, { title: "好行", content: "A" });
|
|
122
|
+
addMemory(store, { title: "坏行", content: "B" });
|
|
123
|
+
addMemory(store, { title: "空行", content: "C" });
|
|
124
|
+
|
|
125
|
+
let calls = 0;
|
|
126
|
+
const embedder = rebuildEmbedder({ modelHash: "mock#throwing" });
|
|
127
|
+
embedder.embedSingle = async () => {
|
|
128
|
+
calls++;
|
|
129
|
+
if (calls === 2) throw new Error("model unavailable");
|
|
130
|
+
if (calls === 3) return []; // empty vector → not counted
|
|
131
|
+
return [1, 0, 0];
|
|
132
|
+
};
|
|
133
|
+
|
|
134
|
+
const result = await vectorIndex.rebuildIndex(embedder, { limit: 100 });
|
|
135
|
+
assert.equal(result.indexed, 1, "only the successful row is indexed");
|
|
136
|
+
assert.equal(result.skipped, 2, "thrown + empty rows count as skipped");
|
|
137
|
+
assert.equal(vectorIndex.getStats().embeddedCount, 1);
|
|
138
|
+
});
|
|
139
|
+
|
|
140
|
+
test("rebuildIndex guard: embedder with no embed method at all is ignored", async () => {
|
|
141
|
+
const { store, vectorIndex } = setup();
|
|
142
|
+
addMemory(store, { title: "缺向量", content: "A" });
|
|
143
|
+
const bare = { modelHash: "mock#bare", dimension: 3 };
|
|
144
|
+
const result = await vectorIndex.rebuildIndex(bare, { limit: 100 });
|
|
145
|
+
assert.deepEqual(result, { indexed: 0, skipped: 0 }, "guard returns early when neither embed nor embedSingle is available");
|
|
146
|
+
assert.equal(vectorIndex.modelHash(), undefined, "no model marked");
|
|
147
|
+
});
|
|
148
|
+
|
|
149
|
+
test("rebuildIndex supports an embed-only OpenAI-compatible embedder (issue #10)", async () => {
|
|
150
|
+
const { store, vectorIndex } = setup();
|
|
151
|
+
addMemory(store, { title: "缺向量", content: "A" });
|
|
152
|
+
const embedOnly = {
|
|
153
|
+
embed: async (text) => [1, 0, 0], // OpenAI-compatible single-text embed
|
|
154
|
+
modelHash: "text-embedding#abc",
|
|
155
|
+
dimension: 3
|
|
156
|
+
};
|
|
157
|
+
const result = await vectorIndex.rebuildIndex(embedOnly, { limit: 100 });
|
|
158
|
+
assert.equal(result.indexed, 1, "embed-only embedder indexes the missing row");
|
|
159
|
+
assert.equal(result.skipped, 0);
|
|
160
|
+
assert.equal(vectorIndex.modelHash(), "text-embedding#abc", "model fingerprint recorded");
|
|
161
|
+
assert.equal(vectorIndex.dimension(), 3, "dimension recorded");
|
|
162
|
+
assert.equal(vectorIndex.getStats().embeddedCount, 1, "embedding persisted");
|
|
163
|
+
});
|
|
164
|
+
|
|
165
|
+
test("rebuildIndex works with embedSingle-only embedder", async () => {
|
|
166
|
+
const { store, vectorIndex } = setup();
|
|
167
|
+
addMemory(store, { title: "缺向量", content: "A" });
|
|
168
|
+
const single = { embedSingle: async () => [1, 0, 0], modelHash: "mock#single", dimension: 3 };
|
|
169
|
+
const result = await vectorIndex.rebuildIndex(single, { limit: 100 });
|
|
170
|
+
assert.ok(result.indexed >= 1, "embedSingle-only embedder should rebuild");
|
|
171
|
+
assert.equal(vectorIndex.modelHash(), "mock#single", "model marked after successful rebuild");
|
|
172
|
+
});
|
|
173
|
+
|
|
174
|
+
test("getStats reports embedded/total counts and model metadata", () => {
|
|
175
|
+
const { store, vectorIndex } = setup();
|
|
176
|
+
addMemory(store, { title: "甲", content: "1", vector: [1, 0, 0] });
|
|
177
|
+
addMemory(store, { title: "乙", content: "2", vector: [0, 1, 0] });
|
|
178
|
+
addMemory(store, { title: "丙", content: "3" });
|
|
179
|
+
|
|
180
|
+
let stats = vectorIndex.getStats();
|
|
181
|
+
assert.equal(stats.embeddedCount, 2);
|
|
182
|
+
assert.equal(stats.totalCount, 3);
|
|
183
|
+
assert.equal(stats.modelHash, undefined);
|
|
184
|
+
assert.equal(stats.dimension, undefined);
|
|
185
|
+
assert.equal(stats.updatedAt, undefined);
|
|
186
|
+
|
|
187
|
+
vectorIndex.markModel("model#v3", 4);
|
|
188
|
+
stats = vectorIndex.getStats();
|
|
189
|
+
assert.equal(stats.modelHash, "model#v3");
|
|
190
|
+
assert.equal(stats.dimension, 4);
|
|
191
|
+
assert.ok(typeof stats.updatedAt === "string" && stats.updatedAt.length > 0, "updatedAt set");
|
|
192
|
+
});
|
|
193
|
+
|
|
194
|
+
test("incremental update: saveEmbedding overwrites the cached vector and search reflects it", () => {
|
|
195
|
+
const { store, vectorIndex } = setup();
|
|
196
|
+
const a = addMemory(store, { title: "主题", content: "A", vector: [1, 0, 0] });
|
|
197
|
+
const b = addMemory(store, { title: "对照", content: "B", vector: [0, 1, 0] });
|
|
198
|
+
|
|
199
|
+
// Before overwrite: query for B's vector ranks b first.
|
|
200
|
+
let hits = vectorIndex.search([0, 1, 0], { limit: 10, threshold: 0 });
|
|
201
|
+
assert.equal(hits[0].id, b.id);
|
|
202
|
+
|
|
203
|
+
// Overwrite a's vector so it now points at b's direction.
|
|
204
|
+
vectorIndex.saveEmbedding(a.id, [0, 1, 0]);
|
|
205
|
+
assert.deepEqual(vectorIndex.getEmbedding(a.id), [0, 1, 0]);
|
|
206
|
+
assert.equal(vectorIndex.getStats().embeddedCount, 2, "overwrite does not change the count");
|
|
207
|
+
|
|
208
|
+
hits = vectorIndex.search([0, 1, 0], { limit: 10, threshold: 0 });
|
|
209
|
+
assert.equal(hits.length, 2);
|
|
210
|
+
// Tie: identical vectors both score 1; ordering between them is stable by id — we
|
|
211
|
+
// only assert the overwritten row now participates with a full score.
|
|
212
|
+
const aHit = hits.find((h) => h.id === a.id);
|
|
213
|
+
assert.ok(Math.abs(aHit.score - 1) < 1e-9, "overwritten vector scores 1 against the query");
|
|
214
|
+
});
|
|
215
|
+
|
|
216
|
+
test("search returns empty when nothing is embedded", () => {
|
|
217
|
+
const { store, vectorIndex } = setup();
|
|
218
|
+
addMemory(store, { title: "无向量", content: "A" });
|
|
219
|
+
addMemory(store, { title: "也无向量", content: "B" });
|
|
220
|
+
assert.deepEqual(vectorIndex.search([1, 0, 0], { limit: 10 }), []);
|
|
221
|
+
});
|