@modusensus/dsh-mneme 0.6.9 → 0.6.11

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (139) hide show
  1. package/LICENSE +21 -21
  2. package/README.md +469 -219
  3. package/{dsh-mneme/cordis.patch.yml → cordis.patch.yml} +15 -15
  4. package/{dsh-mneme/src → lib}/api.js +783 -783
  5. package/{dsh-mneme/lib → lib}/client.js +1754 -1757
  6. package/{dsh-mneme/src → lib}/commands.js +64 -64
  7. package/{dsh-mneme/lib → lib}/config.js +298 -298
  8. package/{dsh-mneme/lib → lib}/dream/clustering.js +118 -118
  9. package/{dsh-mneme/lib → lib}/dream/decisions.js +488 -488
  10. package/{dsh-mneme/lib → lib}/dream/sleep.js +561 -561
  11. package/{dsh-mneme/src → lib}/dream/tag-extractor.js +156 -156
  12. package/{dsh-mneme/lib → lib}/dream.js +958 -958
  13. package/{dsh-mneme/src → lib}/embedding.js +154 -154
  14. package/{dsh-mneme/src → lib}/entities/extractor.js +242 -242
  15. package/{dsh-mneme/lib → lib}/hot-memory.js +53 -53
  16. package/{dsh-mneme/lib → lib}/index.js +361 -361
  17. package/{dsh-mneme/src → lib}/inject.js +208 -208
  18. package/{dsh-mneme/lib → lib}/local-embedder.js +282 -282
  19. package/{dsh-mneme/lib → lib}/mirror.js +170 -170
  20. package/{dsh-mneme/lib → lib}/parser/tag.js +59 -59
  21. package/{dsh-mneme/lib → lib}/parser/wiki-link.js +38 -38
  22. package/{dsh-mneme/src → lib}/quality-filter.js +123 -123
  23. package/{dsh-mneme/lib → lib}/reranker.js +218 -218
  24. package/{dsh-mneme/src → lib}/search/adaptive.js +22 -22
  25. package/{dsh-mneme/src → lib}/search/bm25.js +96 -96
  26. package/{dsh-mneme/src → lib}/search/tag-boost.js +61 -61
  27. package/{dsh-mneme/src → lib}/service.js +1726 -1726
  28. package/{dsh-mneme/lib → lib}/settings.js +172 -172
  29. package/{dsh-mneme/src → lib}/store.js +2238 -2238
  30. package/{dsh-mneme/src → lib}/summarize.js +236 -236
  31. package/{dsh-mneme/src → lib}/tools.js +452 -290
  32. package/{dsh-mneme/lib → lib}/vector-index.js +116 -116
  33. package/package.json +40 -18
  34. package/{dsh-mneme/scripts → scripts}/benchmark-embed.js +201 -201
  35. package/{dsh-mneme/scripts → scripts}/benchmark-recall.js +133 -133
  36. package/{dsh-mneme/scripts → scripts}/benchmark-rerank.js +166 -166
  37. package/{dsh-mneme/scripts → scripts}/e2e-dsh.js +218 -218
  38. package/{dsh-mneme/scripts → scripts}/stress-dsh.js +255 -255
  39. package/{dsh-mneme/scripts → scripts}/sync-lib.js +52 -52
  40. package/{dsh-mneme/lib → src}/api.js +783 -783
  41. package/{dsh-mneme/lib → src}/commands.js +64 -64
  42. package/{dsh-mneme/src → src}/config.js +298 -298
  43. package/{dsh-mneme/src → src}/dream/clustering.js +118 -118
  44. package/{dsh-mneme/src → src}/dream/decisions.js +488 -488
  45. package/{dsh-mneme/src → src}/dream/sleep.js +561 -561
  46. package/{dsh-mneme/lib → src}/dream/tag-extractor.js +156 -156
  47. package/{dsh-mneme/src → src}/dream.js +958 -958
  48. package/{dsh-mneme/lib → src}/embedding.js +154 -154
  49. package/{dsh-mneme/lib → src}/entities/extractor.js +242 -242
  50. package/{dsh-mneme/src → src}/hot-memory.js +53 -53
  51. package/{dsh-mneme/src → src}/index.js +361 -361
  52. package/{dsh-mneme/lib → src}/inject.js +208 -208
  53. package/{dsh-mneme/src → src}/local-embedder.js +282 -282
  54. package/{dsh-mneme/src → src}/mirror.js +170 -170
  55. package/{dsh-mneme/src → src}/parser/tag.js +59 -59
  56. package/{dsh-mneme/src → src}/parser/wiki-link.js +38 -38
  57. package/{dsh-mneme/lib → src}/quality-filter.js +123 -123
  58. package/{dsh-mneme/src → src}/reranker.js +218 -218
  59. package/{dsh-mneme/lib → src}/search/adaptive.js +22 -22
  60. package/{dsh-mneme/lib → src}/search/bm25.js +96 -96
  61. package/{dsh-mneme/lib → src}/search/tag-boost.js +61 -61
  62. package/{dsh-mneme/lib → src}/service.js +1726 -1726
  63. package/{dsh-mneme/src → src}/settings.js +172 -172
  64. package/{dsh-mneme/lib → src}/store.js +2238 -2238
  65. package/{dsh-mneme/lib → src}/summarize.js +236 -236
  66. package/{dsh-mneme/lib → src}/tools.js +452 -290
  67. package/{dsh-mneme/src → src}/vector-index.js +116 -116
  68. package/{dsh-mneme/test → test}/api.test.js +594 -594
  69. package/{dsh-mneme/test → test}/audit.test.js +448 -448
  70. package/{dsh-mneme/test → test}/benchmark.test.js +35 -35
  71. package/{dsh-mneme/test → test}/boundary-v0625.test.js +82 -82
  72. package/{dsh-mneme/test → test}/client.test.js +368 -368
  73. package/{dsh-mneme/test → test}/clustering.test.js +100 -100
  74. package/{dsh-mneme/test → test}/commands.test.js +69 -69
  75. package/{dsh-mneme/test → test}/config.test.js +50 -50
  76. package/{dsh-mneme/test → test}/conflict-freeze.test.js +290 -290
  77. package/{dsh-mneme/test → test}/directory.test.js +134 -134
  78. package/{dsh-mneme/test → test}/dream.test.js +1060 -1060
  79. package/{dsh-mneme/test → test}/entities.test.js +522 -522
  80. package/{dsh-mneme/test → test}/epistemic.test.js +298 -298
  81. package/{dsh-mneme/test → test}/fnew-0112.test.js +311 -311
  82. package/{dsh-mneme/test → test}/fnew-03.test.js +422 -422
  83. package/{dsh-mneme/test → test}/graph-api.test.js +175 -175
  84. package/{dsh-mneme/test → test}/helpers/dream-mock.js +82 -82
  85. package/{dsh-mneme/test → test}/hot-memory.test.js +174 -174
  86. package/{dsh-mneme/test → test}/inject.test.js +103 -103
  87. package/{dsh-mneme/test → test}/llm-audit.test.js +279 -279
  88. package/{dsh-mneme/test → test}/local-embedder.test.js +227 -227
  89. package/{dsh-mneme/test → test}/mirror-dirty.test.js +424 -424
  90. package/{dsh-mneme/test → test}/mirror-edit-digest.test.js +187 -187
  91. package/{dsh-mneme/test → test}/mirror-generation.test.js +499 -499
  92. package/{dsh-mneme/test → test}/mirror.test.js +249 -249
  93. package/{dsh-mneme/test → test}/normalize-decisions.test.js +120 -120
  94. package/{dsh-mneme/test → test}/peer-blockers.test.js +190 -190
  95. package/{dsh-mneme/test → test}/policy-epoch.test.js +259 -259
  96. package/{dsh-mneme/test → test}/provenance.test.js +103 -103
  97. package/{dsh-mneme/test → test}/quality-filter.test.js +118 -118
  98. package/{dsh-mneme/test → test}/reasoning-effort.test.js +199 -199
  99. package/{dsh-mneme/test → test}/recall-evals.test.js +235 -235
  100. package/{dsh-mneme/test → test}/recall-layer.test.js +315 -315
  101. package/{dsh-mneme/test → test}/receipt-chain.test.js +451 -451
  102. package/{dsh-mneme/test → test}/reflection.test.js +226 -226
  103. package/{dsh-mneme/test → test}/reranker.test.js +240 -240
  104. package/{dsh-mneme/test → test}/search-fusion.test.js +90 -90
  105. package/{dsh-mneme/test → test}/semantic.test.js +124 -124
  106. package/{dsh-mneme/test → test}/service-search.test.js +199 -199
  107. package/{dsh-mneme/test → test}/service.test.js +435 -435
  108. package/{dsh-mneme/test → test}/settings.test.js +118 -118
  109. package/{dsh-mneme/test → test}/sleep.test.js +365 -365
  110. package/{dsh-mneme/test → test}/store.test.js +436 -436
  111. package/{dsh-mneme/test → test}/stress.test.js +209 -209
  112. package/{dsh-mneme/test → test}/summarize.test.js +191 -191
  113. package/{dsh-mneme/test → test}/tag-boost.test.js +125 -125
  114. package/{dsh-mneme/test → test}/tag.test.js +312 -312
  115. package/{dsh-mneme/test → test}/tools.test.js +541 -285
  116. package/{dsh-mneme/test → test}/vector-index.test.js +221 -221
  117. package/{dsh-mneme/test → test}/wiki-link.test.js +332 -332
  118. package/.github/workflows/test.yml +0 -32
  119. package/.release-notes-v0.6.9.md +0 -13
  120. package/CHANGELOG.md +0 -89
  121. package/SECURITY.md +0 -544
  122. package/docs/devlog/2026-08-14-dsh-mneme-dev-log.md +0 -247
  123. package/docs/devlog/2026-08-15-dsh-mneme-audit-stress-dev-log.md +0 -145
  124. package/docs/devlog/2026-08-15-dsh-mneme-pipeline-dev-log.md +0 -56
  125. package/docs/devlog/2026-08-15-dsh-mneme-reflection-dev-log.md +0 -77
  126. package/docs/devlog/2026-08-15-dsh-mneme-review-fixes-dev-log.md +0 -64
  127. package/docs/devlog/2026-08-15-dsh-mneme-semantic-dev-log.md +0 -90
  128. package/dsh-mneme/CHANGELOG.md +0 -248
  129. package/dsh-mneme/LICENSE +0 -21
  130. package/dsh-mneme/README.md +0 -465
  131. package/dsh-mneme/docs/AGENT_MEMORY_RESEARCH.md +0 -183
  132. package/dsh-mneme/docs/ENTITIES.md +0 -245
  133. package/dsh-mneme/docs/LOCAL_MODEL.md +0 -141
  134. package/dsh-mneme/docs/MIGRATION.md +0 -127
  135. package/dsh-mneme/docs/SEMANTIC.md +0 -256
  136. package/dsh-mneme/docs/SLEEP.md +0 -163
  137. package/dsh-mneme/package-lock.json +0 -1936
  138. package/dsh-mneme/package.json +0 -80
  139. package//346/250/252/345/271/205.png +0 -0
@@ -1,201 +1,201 @@
1
- #!/usr/bin/env node
2
- // scripts/benchmark-embed.js
3
- // 嵌入吞吐量基准:测量 LocalEmbedder(ONNX) / OllamaEmbedder / OpenAIEmbedder
4
- // 的延迟与吞吐。src/local-embedder.js 可能尚在开发,这里用 await import() 动态
5
- // 加载,失败时打印友好错误而非崩溃。
6
- //
7
- // 用法:
8
- // node scripts/benchmark-embed.js # 默认 local
9
- // node scripts/benchmark-embed.js --provider local --device cpu
10
- // node scripts/benchmark-embed.js --provider ollama --model bge-m3
11
- // node scripts/benchmark-embed.js --provider openai --base-url https://api.openai.com/v1 \
12
- // --api-key sk-... --model text-embedding-3-small
13
- // node scripts/benchmark-embed.js --texts 32 --batch-size 8 --warmup 2 --iters 5
14
- // node scripts/benchmark-embed.js --help
15
- //
16
- // 环境变量(npm scripts 里可直接用):EMBED_PROVIDER / EMBED_MODEL /
17
- // EMBED_DIMENSION / EMBED_DEVICE / EMBED_BATCH_SIZE / EMBED_BASE_URL /
18
- // EMBED_API_KEY / EMBED_CACHE_DIR。命令行参数优先于环境变量。
19
-
20
- const SAMPLE_TEXTS = [
21
- "用户偏好使用中文交流,偶尔夹杂英文术语。",
22
- "项目使用 SQLite 作为主存储,Markdown 作为人工可读镜像。",
23
- "考研科目:公共管理学(631)与公共政策学(864)。",
24
- "autoDream 在后台自动去重、合并、归档记忆。",
25
- "本地模型支持 ONNX、Ollama 与 OpenAI 兼容三种后端。",
26
- "Rerank 精排可以提升语义检索的 Top-K 准确率。",
27
- "记忆库越大,向量检索的优势越明显。",
28
- "今天完成了语义引擎的架构设计文档。",
29
- ];
30
-
31
- function pad(s, n) {
32
- const str = String(s);
33
- return str.length >= n ? str : str + " ".repeat(n - str.length);
34
- }
35
-
36
- function parseArgs(argv) {
37
- const args = {
38
- provider: null, model: null, dimension: null, device: null,
39
- batchSize: null, baseUrl: null, apiKey: null, cacheDir: null,
40
- texts: 16, warmup: 1, iters: 5, help: false
41
- };
42
- const take = (key, i) => (argv[i + 1] !== undefined ? argv[i + 1] : null);
43
- for (let i = 0; i < argv.length; i++) {
44
- const a = argv[i];
45
- if (a === "--help" || a === "-h") { args.help = true; break; }
46
- if (a === "--provider") args.provider = take("provider", i++);
47
- else if (a === "--model") args.model = take("model", i++);
48
- else if (a === "--dimension") args.dimension = Number(take("dimension", i++)) || null;
49
- else if (a === "--device") args.device = take("device", i++);
50
- else if (a === "--batch-size") args.batchSize = Number(take("batch-size", i++)) || null;
51
- else if (a === "--base-url") args.baseUrl = take("base-url", i++);
52
- else if (a === "--api-key") args.apiKey = take("api-key", i++);
53
- else if (a === "--cache-dir") args.cacheDir = take("cache-dir", i++);
54
- else if (a === "--texts") args.texts = Number(take("texts", i++)) || args.texts;
55
- else if (a === "--warmup") args.warmup = Number(take("warmup", i++)) || 0;
56
- else if (a === "--iters") args.iters = Number(take("iters", i++)) || 1;
57
- else { console.error(`未知参数:${a}(用 --help 查看用法)`); process.exit(2); }
58
- }
59
- // 环境变量兜底(命令行优先)
60
- const env = process.env;
61
- args.provider = args.provider ?? env.EMBED_PROVIDER ?? "local";
62
- args.model = args.model ?? env.EMBED_MODEL ?? null;
63
- args.dimension = args.dimension ?? (env.EMBED_DIMENSION ? Number(env.EMBED_DIMENSION) : null);
64
- args.device = args.device ?? env.EMBED_DEVICE ?? "cpu";
65
- args.batchSize = args.batchSize ?? (env.EMBED_BATCH_SIZE ? Number(env.EMBED_BATCH_SIZE) : 8);
66
- args.baseUrl = args.baseUrl ?? env.EMBED_BASE_URL ?? "";
67
- args.apiKey = args.apiKey ?? env.EMBED_API_KEY ?? "";
68
- args.cacheDir = args.cacheDir ?? env.EMBED_CACHE_DIR ?? "";
69
- return args;
70
- }
71
-
72
- function usage() {
73
- console.log(`嵌入吞吐量基准(dsh-mneme)
74
-
75
- 用法:
76
- node scripts/benchmark-embed.js [选项]
77
-
78
- 选项:
79
- --provider <local|ollama|openai> 嵌入后端(默认 local,可由环境变量 EMBED_PROVIDER 覆盖)
80
- --model <name> 模型名(local=HF 模型 id;ollama=Ollama 模型名;openai=API 模型名)
81
- --dimension <n> 向量维度(不填则按后端推断)
82
- --device <cpu|wasm|gpu> ONNX 设备(仅 local 生效,默认 cpu)
83
- --batch-size <n> 分批嵌入条数(默认 8)
84
- --base-url <url> openai/ollama 端点(ollama 默认 http://localhost:11434)
85
- --api-key <key> openai 密钥
86
- --cache-dir <dir> local 模型缓存目录
87
- --texts <n> 生成样本文本条数(默认 16,从示例库循环)
88
- --warmup <n> 预热轮数(默认 1)
89
- --iters <n> 计时轮数(默认 5)
90
- -h, --help 显示帮助并退出
91
-
92
- 环境变量:EMBED_PROVIDER / EMBED_MODEL / EMBED_DIMENSION / EMBED_DEVICE /
93
- EMBED_BATCH_SIZE / EMBED_BASE_URL / EMBED_API_KEY / EMBED_CACHE_DIR
94
- (命令行参数优先)
95
- `);
96
- }
97
-
98
- function buildTexts(n) {
99
- const out = [];
100
- for (let i = 0; i < n; i++) out.push(SAMPLE_TEXTS[i % SAMPLE_TEXTS.length]);
101
- return out;
102
- }
103
-
104
- /** 安全读取维度:规避部分版本 getter 自递归的坑,取不到则回退 _dimension。 */
105
- function safeDimension(embedder, fallback) {
106
- try {
107
- const d = embedder?.dimension;
108
- return d > 0 ? d : fallback;
109
- } catch {
110
- return embedder?._dimension ?? fallback;
111
- }
112
- }
113
-
114
- async function main() {
115
- const args = parseArgs(process.argv.slice(2));
116
- if (args.help) { usage(); process.exit(0); }
117
-
118
- let mod;
119
- try {
120
- mod = await import("../src/local-embedder.js");
121
- } catch (err) {
122
- console.error("无法加载 src/local-embedder.js:");
123
- console.error(` ${err.message}`);
124
- console.error("该模块可能尚未创建。基准脚本依赖 createEmbedderByProvider(local/ollama/openai)。");
125
- process.exit(1);
126
- }
127
- const { createEmbedderByProvider } = mod;
128
- if (typeof createEmbedderByProvider !== "function") {
129
- console.error("src/local-embedder.js 未导出 createEmbedderByProvider,请先实现该模块。");
130
- process.exit(1);
131
- }
132
-
133
- // 构造后端
134
- let embedder;
135
- try {
136
- embedder = createEmbedderByProvider(args.provider, {
137
- model: args.model ?? undefined,
138
- dimension: args.dimension ?? undefined,
139
- device: args.device,
140
- batchSize: args.batchSize,
141
- baseUrl: args.baseUrl || undefined,
142
- apiKey: args.apiKey || undefined,
143
- cacheDir: args.cacheDir || undefined,
144
- logger: null
145
- });
146
- await embedder.init();
147
- } catch (err) {
148
- console.error(`初始化 ${args.provider} 后端失败:${err.message}`);
149
- console.error("请检查模型是否已下载 / Ollama 是否运行 / API 配置是否正确。");
150
- process.exit(1);
151
- }
152
-
153
- const texts = buildTexts(args.texts);
154
- const dim = safeDimension(embedder, args.dimension ?? 0);
155
- console.log("══════ dsh-mneme 嵌入基准 ══════");
156
- console.log(`后端:${args.provider} 模型:${embedder.model ?? "(默认)"} 维度:${dim || "未知"} 设备:${args.device}`);
157
- console.log(`文本:${texts.length} 条 批次:${args.batchSize} 预热:${args.warmup} 计时:${args.iters}\n`);
158
-
159
- // 预热(含首次推理/缓存填充)
160
- for (let i = 0; i < args.warmup; i++) {
161
- try { await embedder.embed(texts); } catch (err) { console.error(`预热失败:${err.message}`); process.exit(1); }
162
- }
163
-
164
- // 计时
165
- const rows = [];
166
- for (let i = 0; i < args.iters; i++) {
167
- const t0 = process.hrtime.bigint();
168
- try {
169
- const vecs = await embedder.embed(texts);
170
- if (!Array.isArray(vecs) || vecs.length !== texts.length) {
171
- console.error(`第 ${i + 1} 轮返回 ${Array.isArray(vecs) ? vecs.length : "?"} 条向量,期望 ${texts.length}。`);
172
- process.exit(1);
173
- }
174
- } catch (err) {
175
- console.error(`第 ${i + 1} 轮嵌入失败:${err.message}`);
176
- process.exit(1);
177
- }
178
- const ms = Number(process.hrtime.bigint() - t0) / 1e6;
179
- rows.push({ iter: i + 1, ms, perText: ms / texts.length, tps: (texts.length * 1000) / ms });
180
- }
181
-
182
- // 结果表
183
- console.log(`${pad("轮次", 6)}${pad("文本数", 8)}${pad("耗时(ms)", 12)}${pad("ms/条", 10)}${pad("条/秒", 12)}`);
184
- for (const r of rows) {
185
- console.log(`${pad(r.iter, 6)}${pad(texts.length, 8)}${pad(r.ms.toFixed(1), 12)}${pad(r.perText.toFixed(3), 10)}${pad(r.tps.toFixed(1), 12)}`);
186
- }
187
- const msArr = rows.map((r) => r.ms);
188
- const avg = msArr.reduce((a, b) => a + b, 0) / msArr.length;
189
- const min = Math.min(...msArr);
190
- const max = Math.max(...msArr);
191
- console.log("\n汇总(均值 / 最小 / 最大):");
192
- console.log(` 耗时 ms:${avg.toFixed(1)} / ${min.toFixed(1)} / ${max.toFixed(1)}`);
193
- console.log(` 吞吐:${(texts.length * 1000 / avg).toFixed(1)} 条/秒(平均每轮 ${texts.length} 条)`);
194
- console.log("══════ 结束 ══════");
195
- embedder.dispose?.();
196
- }
197
-
198
- main().catch((err) => {
199
- console.error(`未预期错误:${err?.stack ?? err}`);
200
- process.exit(1);
201
- });
1
+ #!/usr/bin/env node
2
+ // scripts/benchmark-embed.js
3
+ // 嵌入吞吐量基准:测量 LocalEmbedder(ONNX) / OllamaEmbedder / OpenAIEmbedder
4
+ // 的延迟与吞吐。src/local-embedder.js 可能尚在开发,这里用 await import() 动态
5
+ // 加载,失败时打印友好错误而非崩溃。
6
+ //
7
+ // 用法:
8
+ // node scripts/benchmark-embed.js # 默认 local
9
+ // node scripts/benchmark-embed.js --provider local --device cpu
10
+ // node scripts/benchmark-embed.js --provider ollama --model bge-m3
11
+ // node scripts/benchmark-embed.js --provider openai --base-url https://api.openai.com/v1 \
12
+ // --api-key sk-... --model text-embedding-3-small
13
+ // node scripts/benchmark-embed.js --texts 32 --batch-size 8 --warmup 2 --iters 5
14
+ // node scripts/benchmark-embed.js --help
15
+ //
16
+ // 环境变量(npm scripts 里可直接用):EMBED_PROVIDER / EMBED_MODEL /
17
+ // EMBED_DIMENSION / EMBED_DEVICE / EMBED_BATCH_SIZE / EMBED_BASE_URL /
18
+ // EMBED_API_KEY / EMBED_CACHE_DIR。命令行参数优先于环境变量。
19
+
20
+ const SAMPLE_TEXTS = [
21
+ "用户偏好使用中文交流,偶尔夹杂英文术语。",
22
+ "项目使用 SQLite 作为主存储,Markdown 作为人工可读镜像。",
23
+ "考研科目:公共管理学(631)与公共政策学(864)。",
24
+ "autoDream 在后台自动去重、合并、归档记忆。",
25
+ "本地模型支持 ONNX、Ollama 与 OpenAI 兼容三种后端。",
26
+ "Rerank 精排可以提升语义检索的 Top-K 准确率。",
27
+ "记忆库越大,向量检索的优势越明显。",
28
+ "今天完成了语义引擎的架构设计文档。",
29
+ ];
30
+
31
+ function pad(s, n) {
32
+ const str = String(s);
33
+ return str.length >= n ? str : str + " ".repeat(n - str.length);
34
+ }
35
+
36
+ function parseArgs(argv) {
37
+ const args = {
38
+ provider: null, model: null, dimension: null, device: null,
39
+ batchSize: null, baseUrl: null, apiKey: null, cacheDir: null,
40
+ texts: 16, warmup: 1, iters: 5, help: false
41
+ };
42
+ const take = (key, i) => (argv[i + 1] !== undefined ? argv[i + 1] : null);
43
+ for (let i = 0; i < argv.length; i++) {
44
+ const a = argv[i];
45
+ if (a === "--help" || a === "-h") { args.help = true; break; }
46
+ if (a === "--provider") args.provider = take("provider", i++);
47
+ else if (a === "--model") args.model = take("model", i++);
48
+ else if (a === "--dimension") args.dimension = Number(take("dimension", i++)) || null;
49
+ else if (a === "--device") args.device = take("device", i++);
50
+ else if (a === "--batch-size") args.batchSize = Number(take("batch-size", i++)) || null;
51
+ else if (a === "--base-url") args.baseUrl = take("base-url", i++);
52
+ else if (a === "--api-key") args.apiKey = take("api-key", i++);
53
+ else if (a === "--cache-dir") args.cacheDir = take("cache-dir", i++);
54
+ else if (a === "--texts") args.texts = Number(take("texts", i++)) || args.texts;
55
+ else if (a === "--warmup") args.warmup = Number(take("warmup", i++)) || 0;
56
+ else if (a === "--iters") args.iters = Number(take("iters", i++)) || 1;
57
+ else { console.error(`未知参数:${a}(用 --help 查看用法)`); process.exit(2); }
58
+ }
59
+ // 环境变量兜底(命令行优先)
60
+ const env = process.env;
61
+ args.provider = args.provider ?? env.EMBED_PROVIDER ?? "local";
62
+ args.model = args.model ?? env.EMBED_MODEL ?? null;
63
+ args.dimension = args.dimension ?? (env.EMBED_DIMENSION ? Number(env.EMBED_DIMENSION) : null);
64
+ args.device = args.device ?? env.EMBED_DEVICE ?? "cpu";
65
+ args.batchSize = args.batchSize ?? (env.EMBED_BATCH_SIZE ? Number(env.EMBED_BATCH_SIZE) : 8);
66
+ args.baseUrl = args.baseUrl ?? env.EMBED_BASE_URL ?? "";
67
+ args.apiKey = args.apiKey ?? env.EMBED_API_KEY ?? "";
68
+ args.cacheDir = args.cacheDir ?? env.EMBED_CACHE_DIR ?? "";
69
+ return args;
70
+ }
71
+
72
+ function usage() {
73
+ console.log(`嵌入吞吐量基准(dsh-mneme)
74
+
75
+ 用法:
76
+ node scripts/benchmark-embed.js [选项]
77
+
78
+ 选项:
79
+ --provider <local|ollama|openai> 嵌入后端(默认 local,可由环境变量 EMBED_PROVIDER 覆盖)
80
+ --model <name> 模型名(local=HF 模型 id;ollama=Ollama 模型名;openai=API 模型名)
81
+ --dimension <n> 向量维度(不填则按后端推断)
82
+ --device <cpu|wasm|gpu> ONNX 设备(仅 local 生效,默认 cpu)
83
+ --batch-size <n> 分批嵌入条数(默认 8)
84
+ --base-url <url> openai/ollama 端点(ollama 默认 http://localhost:11434)
85
+ --api-key <key> openai 密钥
86
+ --cache-dir <dir> local 模型缓存目录
87
+ --texts <n> 生成样本文本条数(默认 16,从示例库循环)
88
+ --warmup <n> 预热轮数(默认 1)
89
+ --iters <n> 计时轮数(默认 5)
90
+ -h, --help 显示帮助并退出
91
+
92
+ 环境变量:EMBED_PROVIDER / EMBED_MODEL / EMBED_DIMENSION / EMBED_DEVICE /
93
+ EMBED_BATCH_SIZE / EMBED_BASE_URL / EMBED_API_KEY / EMBED_CACHE_DIR
94
+ (命令行参数优先)
95
+ `);
96
+ }
97
+
98
+ function buildTexts(n) {
99
+ const out = [];
100
+ for (let i = 0; i < n; i++) out.push(SAMPLE_TEXTS[i % SAMPLE_TEXTS.length]);
101
+ return out;
102
+ }
103
+
104
+ /** 安全读取维度:规避部分版本 getter 自递归的坑,取不到则回退 _dimension。 */
105
+ function safeDimension(embedder, fallback) {
106
+ try {
107
+ const d = embedder?.dimension;
108
+ return d > 0 ? d : fallback;
109
+ } catch {
110
+ return embedder?._dimension ?? fallback;
111
+ }
112
+ }
113
+
114
+ async function main() {
115
+ const args = parseArgs(process.argv.slice(2));
116
+ if (args.help) { usage(); process.exit(0); }
117
+
118
+ let mod;
119
+ try {
120
+ mod = await import("../src/local-embedder.js");
121
+ } catch (err) {
122
+ console.error("无法加载 src/local-embedder.js:");
123
+ console.error(` ${err.message}`);
124
+ console.error("该模块可能尚未创建。基准脚本依赖 createEmbedderByProvider(local/ollama/openai)。");
125
+ process.exit(1);
126
+ }
127
+ const { createEmbedderByProvider } = mod;
128
+ if (typeof createEmbedderByProvider !== "function") {
129
+ console.error("src/local-embedder.js 未导出 createEmbedderByProvider,请先实现该模块。");
130
+ process.exit(1);
131
+ }
132
+
133
+ // 构造后端
134
+ let embedder;
135
+ try {
136
+ embedder = createEmbedderByProvider(args.provider, {
137
+ model: args.model ?? undefined,
138
+ dimension: args.dimension ?? undefined,
139
+ device: args.device,
140
+ batchSize: args.batchSize,
141
+ baseUrl: args.baseUrl || undefined,
142
+ apiKey: args.apiKey || undefined,
143
+ cacheDir: args.cacheDir || undefined,
144
+ logger: null
145
+ });
146
+ await embedder.init();
147
+ } catch (err) {
148
+ console.error(`初始化 ${args.provider} 后端失败:${err.message}`);
149
+ console.error("请检查模型是否已下载 / Ollama 是否运行 / API 配置是否正确。");
150
+ process.exit(1);
151
+ }
152
+
153
+ const texts = buildTexts(args.texts);
154
+ const dim = safeDimension(embedder, args.dimension ?? 0);
155
+ console.log("══════ dsh-mneme 嵌入基准 ══════");
156
+ console.log(`后端:${args.provider} 模型:${embedder.model ?? "(默认)"} 维度:${dim || "未知"} 设备:${args.device}`);
157
+ console.log(`文本:${texts.length} 条 批次:${args.batchSize} 预热:${args.warmup} 计时:${args.iters}\n`);
158
+
159
+ // 预热(含首次推理/缓存填充)
160
+ for (let i = 0; i < args.warmup; i++) {
161
+ try { await embedder.embed(texts); } catch (err) { console.error(`预热失败:${err.message}`); process.exit(1); }
162
+ }
163
+
164
+ // 计时
165
+ const rows = [];
166
+ for (let i = 0; i < args.iters; i++) {
167
+ const t0 = process.hrtime.bigint();
168
+ try {
169
+ const vecs = await embedder.embed(texts);
170
+ if (!Array.isArray(vecs) || vecs.length !== texts.length) {
171
+ console.error(`第 ${i + 1} 轮返回 ${Array.isArray(vecs) ? vecs.length : "?"} 条向量,期望 ${texts.length}。`);
172
+ process.exit(1);
173
+ }
174
+ } catch (err) {
175
+ console.error(`第 ${i + 1} 轮嵌入失败:${err.message}`);
176
+ process.exit(1);
177
+ }
178
+ const ms = Number(process.hrtime.bigint() - t0) / 1e6;
179
+ rows.push({ iter: i + 1, ms, perText: ms / texts.length, tps: (texts.length * 1000) / ms });
180
+ }
181
+
182
+ // 结果表
183
+ console.log(`${pad("轮次", 6)}${pad("文本数", 8)}${pad("耗时(ms)", 12)}${pad("ms/条", 10)}${pad("条/秒", 12)}`);
184
+ for (const r of rows) {
185
+ console.log(`${pad(r.iter, 6)}${pad(texts.length, 8)}${pad(r.ms.toFixed(1), 12)}${pad(r.perText.toFixed(3), 10)}${pad(r.tps.toFixed(1), 12)}`);
186
+ }
187
+ const msArr = rows.map((r) => r.ms);
188
+ const avg = msArr.reduce((a, b) => a + b, 0) / msArr.length;
189
+ const min = Math.min(...msArr);
190
+ const max = Math.max(...msArr);
191
+ console.log("\n汇总(均值 / 最小 / 最大):");
192
+ console.log(` 耗时 ms:${avg.toFixed(1)} / ${min.toFixed(1)} / ${max.toFixed(1)}`);
193
+ console.log(` 吞吐:${(texts.length * 1000 / avg).toFixed(1)} 条/秒(平均每轮 ${texts.length} 条)`);
194
+ console.log("══════ 结束 ══════");
195
+ embedder.dispose?.();
196
+ }
197
+
198
+ main().catch((err) => {
199
+ console.error(`未预期错误:${err?.stack ?? err}`);
200
+ process.exit(1);
201
+ });