@modusensus/dsh-mneme 0.6.6 → 0.6.8
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/LICENSE +21 -21
- package/README.md +463 -457
- package/cordis.patch.yml +15 -15
- package/lib/api.js +783 -693
- package/lib/client.js +1757 -1656
- package/lib/commands.js +64 -64
- package/lib/config.js +288 -288
- package/lib/dream/clustering.js +118 -118
- package/lib/dream/decisions.js +439 -439
- package/lib/dream/sleep.js +561 -554
- package/lib/dream/tag-extractor.js +156 -156
- package/lib/dream.js +935 -929
- package/lib/embedding.js +154 -154
- package/lib/entities/extractor.js +242 -242
- package/lib/hot-memory.js +53 -53
- package/lib/index.js +361 -361
- package/lib/inject.js +208 -208
- package/lib/local-embedder.js +282 -282
- package/lib/mirror.js +170 -170
- package/lib/parser/tag.js +59 -59
- package/lib/parser/wiki-link.js +38 -38
- package/lib/quality-filter.js +123 -123
- package/lib/reranker.js +218 -218
- package/lib/search/adaptive.js +22 -22
- package/lib/search/bm25.js +96 -96
- package/lib/search/tag-boost.js +61 -61
- package/lib/service.js +1726 -1726
- package/lib/settings.js +172 -142
- package/lib/store.js +2238 -2238
- package/lib/summarize.js +236 -236
- package/lib/tools.js +290 -290
- package/lib/vector-index.js +116 -116
- package/package.json +80 -75
- package/scripts/benchmark-embed.js +201 -201
- package/scripts/benchmark-recall.js +133 -133
- package/scripts/benchmark-rerank.js +166 -166
- package/scripts/e2e-dsh.js +218 -218
- package/scripts/stress-dsh.js +255 -255
- package/scripts/sync-lib.js +52 -52
- package/src/api.js +783 -693
- package/src/commands.js +64 -64
- package/src/config.js +288 -288
- package/src/dream/clustering.js +118 -118
- package/src/dream/decisions.js +439 -439
- package/src/dream/sleep.js +561 -554
- package/src/dream/tag-extractor.js +156 -156
- package/src/dream.js +935 -929
- package/src/embedding.js +154 -154
- package/src/entities/extractor.js +242 -242
- package/src/hot-memory.js +53 -53
- package/src/index.js +361 -361
- package/src/inject.js +208 -208
- package/src/local-embedder.js +282 -282
- package/src/mirror.js +170 -170
- package/src/parser/tag.js +59 -59
- package/src/parser/wiki-link.js +38 -38
- package/src/quality-filter.js +123 -123
- package/src/reranker.js +218 -218
- package/src/search/adaptive.js +22 -22
- package/src/search/bm25.js +96 -96
- package/src/search/tag-boost.js +61 -61
- package/src/service.js +1726 -1726
- package/src/settings.js +172 -142
- package/src/store.js +2238 -2238
- package/src/summarize.js +236 -236
- package/src/tools.js +290 -290
- package/src/vector-index.js +116 -116
- package/test/api.test.js +594 -549
- package/test/audit.test.js +448 -448
- package/test/benchmark.test.js +35 -35
- package/test/boundary-v0625.test.js +82 -82
- package/test/client.test.js +368 -368
- package/test/clustering.test.js +100 -100
- package/test/commands.test.js +69 -69
- package/test/config.test.js +50 -50
- package/test/conflict-freeze.test.js +290 -290
- package/test/directory.test.js +134 -134
- package/test/dream.test.js +903 -901
- package/test/entities.test.js +522 -522
- package/test/epistemic.test.js +298 -298
- package/test/fnew-0112.test.js +311 -311
- package/test/fnew-03.test.js +422 -422
- package/test/graph-api.test.js +175 -175
- package/test/helpers/dream-mock.js +82 -82
- package/test/hot-memory.test.js +174 -174
- package/test/inject.test.js +103 -103
- package/test/llm-audit.test.js +279 -279
- package/test/local-embedder.test.js +227 -227
- package/test/mirror-dirty.test.js +424 -424
- package/test/mirror-edit-digest.test.js +187 -187
- package/test/mirror-generation.test.js +499 -499
- package/test/mirror.test.js +249 -249
- package/test/normalize-decisions.test.js +120 -120
- package/test/peer-blockers.test.js +190 -190
- package/test/policy-epoch.test.js +259 -259
- package/test/provenance.test.js +103 -103
- package/test/quality-filter.test.js +118 -118
- package/test/reasoning-effort.test.js +199 -199
- package/test/recall-evals.test.js +235 -235
- package/test/recall-layer.test.js +315 -315
- package/test/receipt-chain.test.js +451 -451
- package/test/reflection.test.js +226 -226
- package/test/reranker.test.js +240 -240
- package/test/search-fusion.test.js +90 -90
- package/test/semantic.test.js +124 -124
- package/test/service-search.test.js +199 -199
- package/test/service.test.js +435 -435
- package/test/settings.test.js +118 -101
- package/test/sleep.test.js +365 -365
- package/test/store.test.js +436 -436
- package/test/stress.test.js +209 -209
- package/test/summarize.test.js +191 -191
- package/test/tag-boost.test.js +125 -125
- package/test/tag.test.js +312 -312
- package/test/tools.test.js +285 -285
- package/test/vector-index.test.js +221 -221
- package/test/wiki-link.test.js +332 -332
|
@@ -1,201 +1,201 @@
|
|
|
1
|
-
#!/usr/bin/env node
|
|
2
|
-
// scripts/benchmark-embed.js
|
|
3
|
-
// 嵌入吞吐量基准:测量 LocalEmbedder(ONNX) / OllamaEmbedder / OpenAIEmbedder
|
|
4
|
-
// 的延迟与吞吐。src/local-embedder.js 可能尚在开发,这里用 await import() 动态
|
|
5
|
-
// 加载,失败时打印友好错误而非崩溃。
|
|
6
|
-
//
|
|
7
|
-
// 用法:
|
|
8
|
-
// node scripts/benchmark-embed.js # 默认 local
|
|
9
|
-
// node scripts/benchmark-embed.js --provider local --device cpu
|
|
10
|
-
// node scripts/benchmark-embed.js --provider ollama --model bge-m3
|
|
11
|
-
// node scripts/benchmark-embed.js --provider openai --base-url https://api.openai.com/v1 \
|
|
12
|
-
// --api-key sk-... --model text-embedding-3-small
|
|
13
|
-
// node scripts/benchmark-embed.js --texts 32 --batch-size 8 --warmup 2 --iters 5
|
|
14
|
-
// node scripts/benchmark-embed.js --help
|
|
15
|
-
//
|
|
16
|
-
// 环境变量(npm scripts 里可直接用):EMBED_PROVIDER / EMBED_MODEL /
|
|
17
|
-
// EMBED_DIMENSION / EMBED_DEVICE / EMBED_BATCH_SIZE / EMBED_BASE_URL /
|
|
18
|
-
// EMBED_API_KEY / EMBED_CACHE_DIR。命令行参数优先于环境变量。
|
|
19
|
-
|
|
20
|
-
const SAMPLE_TEXTS = [
|
|
21
|
-
"用户偏好使用中文交流,偶尔夹杂英文术语。",
|
|
22
|
-
"项目使用 SQLite 作为主存储,Markdown 作为人工可读镜像。",
|
|
23
|
-
"考研科目:公共管理学(631)与公共政策学(864)。",
|
|
24
|
-
"autoDream 在后台自动去重、合并、归档记忆。",
|
|
25
|
-
"本地模型支持 ONNX、Ollama 与 OpenAI 兼容三种后端。",
|
|
26
|
-
"Rerank 精排可以提升语义检索的 Top-K 准确率。",
|
|
27
|
-
"记忆库越大,向量检索的优势越明显。",
|
|
28
|
-
"今天完成了语义引擎的架构设计文档。",
|
|
29
|
-
];
|
|
30
|
-
|
|
31
|
-
function pad(s, n) {
|
|
32
|
-
const str = String(s);
|
|
33
|
-
return str.length >= n ? str : str + " ".repeat(n - str.length);
|
|
34
|
-
}
|
|
35
|
-
|
|
36
|
-
function parseArgs(argv) {
|
|
37
|
-
const args = {
|
|
38
|
-
provider: null, model: null, dimension: null, device: null,
|
|
39
|
-
batchSize: null, baseUrl: null, apiKey: null, cacheDir: null,
|
|
40
|
-
texts: 16, warmup: 1, iters: 5, help: false
|
|
41
|
-
};
|
|
42
|
-
const take = (key, i) => (argv[i + 1] !== undefined ? argv[i + 1] : null);
|
|
43
|
-
for (let i = 0; i < argv.length; i++) {
|
|
44
|
-
const a = argv[i];
|
|
45
|
-
if (a === "--help" || a === "-h") { args.help = true; break; }
|
|
46
|
-
if (a === "--provider") args.provider = take("provider", i++);
|
|
47
|
-
else if (a === "--model") args.model = take("model", i++);
|
|
48
|
-
else if (a === "--dimension") args.dimension = Number(take("dimension", i++)) || null;
|
|
49
|
-
else if (a === "--device") args.device = take("device", i++);
|
|
50
|
-
else if (a === "--batch-size") args.batchSize = Number(take("batch-size", i++)) || null;
|
|
51
|
-
else if (a === "--base-url") args.baseUrl = take("base-url", i++);
|
|
52
|
-
else if (a === "--api-key") args.apiKey = take("api-key", i++);
|
|
53
|
-
else if (a === "--cache-dir") args.cacheDir = take("cache-dir", i++);
|
|
54
|
-
else if (a === "--texts") args.texts = Number(take("texts", i++)) || args.texts;
|
|
55
|
-
else if (a === "--warmup") args.warmup = Number(take("warmup", i++)) || 0;
|
|
56
|
-
else if (a === "--iters") args.iters = Number(take("iters", i++)) || 1;
|
|
57
|
-
else { console.error(`未知参数:${a}(用 --help 查看用法)`); process.exit(2); }
|
|
58
|
-
}
|
|
59
|
-
// 环境变量兜底(命令行优先)
|
|
60
|
-
const env = process.env;
|
|
61
|
-
args.provider = args.provider ?? env.EMBED_PROVIDER ?? "local";
|
|
62
|
-
args.model = args.model ?? env.EMBED_MODEL ?? null;
|
|
63
|
-
args.dimension = args.dimension ?? (env.EMBED_DIMENSION ? Number(env.EMBED_DIMENSION) : null);
|
|
64
|
-
args.device = args.device ?? env.EMBED_DEVICE ?? "cpu";
|
|
65
|
-
args.batchSize = args.batchSize ?? (env.EMBED_BATCH_SIZE ? Number(env.EMBED_BATCH_SIZE) : 8);
|
|
66
|
-
args.baseUrl = args.baseUrl ?? env.EMBED_BASE_URL ?? "";
|
|
67
|
-
args.apiKey = args.apiKey ?? env.EMBED_API_KEY ?? "";
|
|
68
|
-
args.cacheDir = args.cacheDir ?? env.EMBED_CACHE_DIR ?? "";
|
|
69
|
-
return args;
|
|
70
|
-
}
|
|
71
|
-
|
|
72
|
-
function usage() {
|
|
73
|
-
console.log(`嵌入吞吐量基准(dsh-mneme)
|
|
74
|
-
|
|
75
|
-
用法:
|
|
76
|
-
node scripts/benchmark-embed.js [选项]
|
|
77
|
-
|
|
78
|
-
选项:
|
|
79
|
-
--provider <local|ollama|openai> 嵌入后端(默认 local,可由环境变量 EMBED_PROVIDER 覆盖)
|
|
80
|
-
--model <name> 模型名(local=HF 模型 id;ollama=Ollama 模型名;openai=API 模型名)
|
|
81
|
-
--dimension <n> 向量维度(不填则按后端推断)
|
|
82
|
-
--device <cpu|wasm|gpu> ONNX 设备(仅 local 生效,默认 cpu)
|
|
83
|
-
--batch-size <n> 分批嵌入条数(默认 8)
|
|
84
|
-
--base-url <url> openai/ollama 端点(ollama 默认 http://localhost:11434)
|
|
85
|
-
--api-key <key> openai 密钥
|
|
86
|
-
--cache-dir <dir> local 模型缓存目录
|
|
87
|
-
--texts <n> 生成样本文本条数(默认 16,从示例库循环)
|
|
88
|
-
--warmup <n> 预热轮数(默认 1)
|
|
89
|
-
--iters <n> 计时轮数(默认 5)
|
|
90
|
-
-h, --help 显示帮助并退出
|
|
91
|
-
|
|
92
|
-
环境变量:EMBED_PROVIDER / EMBED_MODEL / EMBED_DIMENSION / EMBED_DEVICE /
|
|
93
|
-
EMBED_BATCH_SIZE / EMBED_BASE_URL / EMBED_API_KEY / EMBED_CACHE_DIR
|
|
94
|
-
(命令行参数优先)
|
|
95
|
-
`);
|
|
96
|
-
}
|
|
97
|
-
|
|
98
|
-
function buildTexts(n) {
|
|
99
|
-
const out = [];
|
|
100
|
-
for (let i = 0; i < n; i++) out.push(SAMPLE_TEXTS[i % SAMPLE_TEXTS.length]);
|
|
101
|
-
return out;
|
|
102
|
-
}
|
|
103
|
-
|
|
104
|
-
/** 安全读取维度:规避部分版本 getter 自递归的坑,取不到则回退 _dimension。 */
|
|
105
|
-
function safeDimension(embedder, fallback) {
|
|
106
|
-
try {
|
|
107
|
-
const d = embedder?.dimension;
|
|
108
|
-
return d > 0 ? d : fallback;
|
|
109
|
-
} catch {
|
|
110
|
-
return embedder?._dimension ?? fallback;
|
|
111
|
-
}
|
|
112
|
-
}
|
|
113
|
-
|
|
114
|
-
async function main() {
|
|
115
|
-
const args = parseArgs(process.argv.slice(2));
|
|
116
|
-
if (args.help) { usage(); process.exit(0); }
|
|
117
|
-
|
|
118
|
-
let mod;
|
|
119
|
-
try {
|
|
120
|
-
mod = await import("../src/local-embedder.js");
|
|
121
|
-
} catch (err) {
|
|
122
|
-
console.error("无法加载 src/local-embedder.js:");
|
|
123
|
-
console.error(` ${err.message}`);
|
|
124
|
-
console.error("该模块可能尚未创建。基准脚本依赖 createEmbedderByProvider(local/ollama/openai)。");
|
|
125
|
-
process.exit(1);
|
|
126
|
-
}
|
|
127
|
-
const { createEmbedderByProvider } = mod;
|
|
128
|
-
if (typeof createEmbedderByProvider !== "function") {
|
|
129
|
-
console.error("src/local-embedder.js 未导出 createEmbedderByProvider,请先实现该模块。");
|
|
130
|
-
process.exit(1);
|
|
131
|
-
}
|
|
132
|
-
|
|
133
|
-
// 构造后端
|
|
134
|
-
let embedder;
|
|
135
|
-
try {
|
|
136
|
-
embedder = createEmbedderByProvider(args.provider, {
|
|
137
|
-
model: args.model ?? undefined,
|
|
138
|
-
dimension: args.dimension ?? undefined,
|
|
139
|
-
device: args.device,
|
|
140
|
-
batchSize: args.batchSize,
|
|
141
|
-
baseUrl: args.baseUrl || undefined,
|
|
142
|
-
apiKey: args.apiKey || undefined,
|
|
143
|
-
cacheDir: args.cacheDir || undefined,
|
|
144
|
-
logger: null
|
|
145
|
-
});
|
|
146
|
-
await embedder.init();
|
|
147
|
-
} catch (err) {
|
|
148
|
-
console.error(`初始化 ${args.provider} 后端失败:${err.message}`);
|
|
149
|
-
console.error("请检查模型是否已下载 / Ollama 是否运行 / API 配置是否正确。");
|
|
150
|
-
process.exit(1);
|
|
151
|
-
}
|
|
152
|
-
|
|
153
|
-
const texts = buildTexts(args.texts);
|
|
154
|
-
const dim = safeDimension(embedder, args.dimension ?? 0);
|
|
155
|
-
console.log("══════ dsh-mneme 嵌入基准 ══════");
|
|
156
|
-
console.log(`后端:${args.provider} 模型:${embedder.model ?? "(默认)"} 维度:${dim || "未知"} 设备:${args.device}`);
|
|
157
|
-
console.log(`文本:${texts.length} 条 批次:${args.batchSize} 预热:${args.warmup} 计时:${args.iters}\n`);
|
|
158
|
-
|
|
159
|
-
// 预热(含首次推理/缓存填充)
|
|
160
|
-
for (let i = 0; i < args.warmup; i++) {
|
|
161
|
-
try { await embedder.embed(texts); } catch (err) { console.error(`预热失败:${err.message}`); process.exit(1); }
|
|
162
|
-
}
|
|
163
|
-
|
|
164
|
-
// 计时
|
|
165
|
-
const rows = [];
|
|
166
|
-
for (let i = 0; i < args.iters; i++) {
|
|
167
|
-
const t0 = process.hrtime.bigint();
|
|
168
|
-
try {
|
|
169
|
-
const vecs = await embedder.embed(texts);
|
|
170
|
-
if (!Array.isArray(vecs) || vecs.length !== texts.length) {
|
|
171
|
-
console.error(`第 ${i + 1} 轮返回 ${Array.isArray(vecs) ? vecs.length : "?"} 条向量,期望 ${texts.length}。`);
|
|
172
|
-
process.exit(1);
|
|
173
|
-
}
|
|
174
|
-
} catch (err) {
|
|
175
|
-
console.error(`第 ${i + 1} 轮嵌入失败:${err.message}`);
|
|
176
|
-
process.exit(1);
|
|
177
|
-
}
|
|
178
|
-
const ms = Number(process.hrtime.bigint() - t0) / 1e6;
|
|
179
|
-
rows.push({ iter: i + 1, ms, perText: ms / texts.length, tps: (texts.length * 1000) / ms });
|
|
180
|
-
}
|
|
181
|
-
|
|
182
|
-
// 结果表
|
|
183
|
-
console.log(`${pad("轮次", 6)}${pad("文本数", 8)}${pad("耗时(ms)", 12)}${pad("ms/条", 10)}${pad("条/秒", 12)}`);
|
|
184
|
-
for (const r of rows) {
|
|
185
|
-
console.log(`${pad(r.iter, 6)}${pad(texts.length, 8)}${pad(r.ms.toFixed(1), 12)}${pad(r.perText.toFixed(3), 10)}${pad(r.tps.toFixed(1), 12)}`);
|
|
186
|
-
}
|
|
187
|
-
const msArr = rows.map((r) => r.ms);
|
|
188
|
-
const avg = msArr.reduce((a, b) => a + b, 0) / msArr.length;
|
|
189
|
-
const min = Math.min(...msArr);
|
|
190
|
-
const max = Math.max(...msArr);
|
|
191
|
-
console.log("\n汇总(均值 / 最小 / 最大):");
|
|
192
|
-
console.log(` 耗时 ms:${avg.toFixed(1)} / ${min.toFixed(1)} / ${max.toFixed(1)}`);
|
|
193
|
-
console.log(` 吞吐:${(texts.length * 1000 / avg).toFixed(1)} 条/秒(平均每轮 ${texts.length} 条)`);
|
|
194
|
-
console.log("══════ 结束 ══════");
|
|
195
|
-
embedder.dispose?.();
|
|
196
|
-
}
|
|
197
|
-
|
|
198
|
-
main().catch((err) => {
|
|
199
|
-
console.error(`未预期错误:${err?.stack ?? err}`);
|
|
200
|
-
process.exit(1);
|
|
201
|
-
});
|
|
1
|
+
#!/usr/bin/env node
|
|
2
|
+
// scripts/benchmark-embed.js
|
|
3
|
+
// 嵌入吞吐量基准:测量 LocalEmbedder(ONNX) / OllamaEmbedder / OpenAIEmbedder
|
|
4
|
+
// 的延迟与吞吐。src/local-embedder.js 可能尚在开发,这里用 await import() 动态
|
|
5
|
+
// 加载,失败时打印友好错误而非崩溃。
|
|
6
|
+
//
|
|
7
|
+
// 用法:
|
|
8
|
+
// node scripts/benchmark-embed.js # 默认 local
|
|
9
|
+
// node scripts/benchmark-embed.js --provider local --device cpu
|
|
10
|
+
// node scripts/benchmark-embed.js --provider ollama --model bge-m3
|
|
11
|
+
// node scripts/benchmark-embed.js --provider openai --base-url https://api.openai.com/v1 \
|
|
12
|
+
// --api-key sk-... --model text-embedding-3-small
|
|
13
|
+
// node scripts/benchmark-embed.js --texts 32 --batch-size 8 --warmup 2 --iters 5
|
|
14
|
+
// node scripts/benchmark-embed.js --help
|
|
15
|
+
//
|
|
16
|
+
// 环境变量(npm scripts 里可直接用):EMBED_PROVIDER / EMBED_MODEL /
|
|
17
|
+
// EMBED_DIMENSION / EMBED_DEVICE / EMBED_BATCH_SIZE / EMBED_BASE_URL /
|
|
18
|
+
// EMBED_API_KEY / EMBED_CACHE_DIR。命令行参数优先于环境变量。
|
|
19
|
+
|
|
20
|
+
const SAMPLE_TEXTS = [
|
|
21
|
+
"用户偏好使用中文交流,偶尔夹杂英文术语。",
|
|
22
|
+
"项目使用 SQLite 作为主存储,Markdown 作为人工可读镜像。",
|
|
23
|
+
"考研科目:公共管理学(631)与公共政策学(864)。",
|
|
24
|
+
"autoDream 在后台自动去重、合并、归档记忆。",
|
|
25
|
+
"本地模型支持 ONNX、Ollama 与 OpenAI 兼容三种后端。",
|
|
26
|
+
"Rerank 精排可以提升语义检索的 Top-K 准确率。",
|
|
27
|
+
"记忆库越大,向量检索的优势越明显。",
|
|
28
|
+
"今天完成了语义引擎的架构设计文档。",
|
|
29
|
+
];
|
|
30
|
+
|
|
31
|
+
function pad(s, n) {
|
|
32
|
+
const str = String(s);
|
|
33
|
+
return str.length >= n ? str : str + " ".repeat(n - str.length);
|
|
34
|
+
}
|
|
35
|
+
|
|
36
|
+
function parseArgs(argv) {
|
|
37
|
+
const args = {
|
|
38
|
+
provider: null, model: null, dimension: null, device: null,
|
|
39
|
+
batchSize: null, baseUrl: null, apiKey: null, cacheDir: null,
|
|
40
|
+
texts: 16, warmup: 1, iters: 5, help: false
|
|
41
|
+
};
|
|
42
|
+
const take = (key, i) => (argv[i + 1] !== undefined ? argv[i + 1] : null);
|
|
43
|
+
for (let i = 0; i < argv.length; i++) {
|
|
44
|
+
const a = argv[i];
|
|
45
|
+
if (a === "--help" || a === "-h") { args.help = true; break; }
|
|
46
|
+
if (a === "--provider") args.provider = take("provider", i++);
|
|
47
|
+
else if (a === "--model") args.model = take("model", i++);
|
|
48
|
+
else if (a === "--dimension") args.dimension = Number(take("dimension", i++)) || null;
|
|
49
|
+
else if (a === "--device") args.device = take("device", i++);
|
|
50
|
+
else if (a === "--batch-size") args.batchSize = Number(take("batch-size", i++)) || null;
|
|
51
|
+
else if (a === "--base-url") args.baseUrl = take("base-url", i++);
|
|
52
|
+
else if (a === "--api-key") args.apiKey = take("api-key", i++);
|
|
53
|
+
else if (a === "--cache-dir") args.cacheDir = take("cache-dir", i++);
|
|
54
|
+
else if (a === "--texts") args.texts = Number(take("texts", i++)) || args.texts;
|
|
55
|
+
else if (a === "--warmup") args.warmup = Number(take("warmup", i++)) || 0;
|
|
56
|
+
else if (a === "--iters") args.iters = Number(take("iters", i++)) || 1;
|
|
57
|
+
else { console.error(`未知参数:${a}(用 --help 查看用法)`); process.exit(2); }
|
|
58
|
+
}
|
|
59
|
+
// 环境变量兜底(命令行优先)
|
|
60
|
+
const env = process.env;
|
|
61
|
+
args.provider = args.provider ?? env.EMBED_PROVIDER ?? "local";
|
|
62
|
+
args.model = args.model ?? env.EMBED_MODEL ?? null;
|
|
63
|
+
args.dimension = args.dimension ?? (env.EMBED_DIMENSION ? Number(env.EMBED_DIMENSION) : null);
|
|
64
|
+
args.device = args.device ?? env.EMBED_DEVICE ?? "cpu";
|
|
65
|
+
args.batchSize = args.batchSize ?? (env.EMBED_BATCH_SIZE ? Number(env.EMBED_BATCH_SIZE) : 8);
|
|
66
|
+
args.baseUrl = args.baseUrl ?? env.EMBED_BASE_URL ?? "";
|
|
67
|
+
args.apiKey = args.apiKey ?? env.EMBED_API_KEY ?? "";
|
|
68
|
+
args.cacheDir = args.cacheDir ?? env.EMBED_CACHE_DIR ?? "";
|
|
69
|
+
return args;
|
|
70
|
+
}
|
|
71
|
+
|
|
72
|
+
function usage() {
|
|
73
|
+
console.log(`嵌入吞吐量基准(dsh-mneme)
|
|
74
|
+
|
|
75
|
+
用法:
|
|
76
|
+
node scripts/benchmark-embed.js [选项]
|
|
77
|
+
|
|
78
|
+
选项:
|
|
79
|
+
--provider <local|ollama|openai> 嵌入后端(默认 local,可由环境变量 EMBED_PROVIDER 覆盖)
|
|
80
|
+
--model <name> 模型名(local=HF 模型 id;ollama=Ollama 模型名;openai=API 模型名)
|
|
81
|
+
--dimension <n> 向量维度(不填则按后端推断)
|
|
82
|
+
--device <cpu|wasm|gpu> ONNX 设备(仅 local 生效,默认 cpu)
|
|
83
|
+
--batch-size <n> 分批嵌入条数(默认 8)
|
|
84
|
+
--base-url <url> openai/ollama 端点(ollama 默认 http://localhost:11434)
|
|
85
|
+
--api-key <key> openai 密钥
|
|
86
|
+
--cache-dir <dir> local 模型缓存目录
|
|
87
|
+
--texts <n> 生成样本文本条数(默认 16,从示例库循环)
|
|
88
|
+
--warmup <n> 预热轮数(默认 1)
|
|
89
|
+
--iters <n> 计时轮数(默认 5)
|
|
90
|
+
-h, --help 显示帮助并退出
|
|
91
|
+
|
|
92
|
+
环境变量:EMBED_PROVIDER / EMBED_MODEL / EMBED_DIMENSION / EMBED_DEVICE /
|
|
93
|
+
EMBED_BATCH_SIZE / EMBED_BASE_URL / EMBED_API_KEY / EMBED_CACHE_DIR
|
|
94
|
+
(命令行参数优先)
|
|
95
|
+
`);
|
|
96
|
+
}
|
|
97
|
+
|
|
98
|
+
function buildTexts(n) {
|
|
99
|
+
const out = [];
|
|
100
|
+
for (let i = 0; i < n; i++) out.push(SAMPLE_TEXTS[i % SAMPLE_TEXTS.length]);
|
|
101
|
+
return out;
|
|
102
|
+
}
|
|
103
|
+
|
|
104
|
+
/** 安全读取维度:规避部分版本 getter 自递归的坑,取不到则回退 _dimension。 */
|
|
105
|
+
function safeDimension(embedder, fallback) {
|
|
106
|
+
try {
|
|
107
|
+
const d = embedder?.dimension;
|
|
108
|
+
return d > 0 ? d : fallback;
|
|
109
|
+
} catch {
|
|
110
|
+
return embedder?._dimension ?? fallback;
|
|
111
|
+
}
|
|
112
|
+
}
|
|
113
|
+
|
|
114
|
+
async function main() {
|
|
115
|
+
const args = parseArgs(process.argv.slice(2));
|
|
116
|
+
if (args.help) { usage(); process.exit(0); }
|
|
117
|
+
|
|
118
|
+
let mod;
|
|
119
|
+
try {
|
|
120
|
+
mod = await import("../src/local-embedder.js");
|
|
121
|
+
} catch (err) {
|
|
122
|
+
console.error("无法加载 src/local-embedder.js:");
|
|
123
|
+
console.error(` ${err.message}`);
|
|
124
|
+
console.error("该模块可能尚未创建。基准脚本依赖 createEmbedderByProvider(local/ollama/openai)。");
|
|
125
|
+
process.exit(1);
|
|
126
|
+
}
|
|
127
|
+
const { createEmbedderByProvider } = mod;
|
|
128
|
+
if (typeof createEmbedderByProvider !== "function") {
|
|
129
|
+
console.error("src/local-embedder.js 未导出 createEmbedderByProvider,请先实现该模块。");
|
|
130
|
+
process.exit(1);
|
|
131
|
+
}
|
|
132
|
+
|
|
133
|
+
// 构造后端
|
|
134
|
+
let embedder;
|
|
135
|
+
try {
|
|
136
|
+
embedder = createEmbedderByProvider(args.provider, {
|
|
137
|
+
model: args.model ?? undefined,
|
|
138
|
+
dimension: args.dimension ?? undefined,
|
|
139
|
+
device: args.device,
|
|
140
|
+
batchSize: args.batchSize,
|
|
141
|
+
baseUrl: args.baseUrl || undefined,
|
|
142
|
+
apiKey: args.apiKey || undefined,
|
|
143
|
+
cacheDir: args.cacheDir || undefined,
|
|
144
|
+
logger: null
|
|
145
|
+
});
|
|
146
|
+
await embedder.init();
|
|
147
|
+
} catch (err) {
|
|
148
|
+
console.error(`初始化 ${args.provider} 后端失败:${err.message}`);
|
|
149
|
+
console.error("请检查模型是否已下载 / Ollama 是否运行 / API 配置是否正确。");
|
|
150
|
+
process.exit(1);
|
|
151
|
+
}
|
|
152
|
+
|
|
153
|
+
const texts = buildTexts(args.texts);
|
|
154
|
+
const dim = safeDimension(embedder, args.dimension ?? 0);
|
|
155
|
+
console.log("══════ dsh-mneme 嵌入基准 ══════");
|
|
156
|
+
console.log(`后端:${args.provider} 模型:${embedder.model ?? "(默认)"} 维度:${dim || "未知"} 设备:${args.device}`);
|
|
157
|
+
console.log(`文本:${texts.length} 条 批次:${args.batchSize} 预热:${args.warmup} 计时:${args.iters}\n`);
|
|
158
|
+
|
|
159
|
+
// 预热(含首次推理/缓存填充)
|
|
160
|
+
for (let i = 0; i < args.warmup; i++) {
|
|
161
|
+
try { await embedder.embed(texts); } catch (err) { console.error(`预热失败:${err.message}`); process.exit(1); }
|
|
162
|
+
}
|
|
163
|
+
|
|
164
|
+
// 计时
|
|
165
|
+
const rows = [];
|
|
166
|
+
for (let i = 0; i < args.iters; i++) {
|
|
167
|
+
const t0 = process.hrtime.bigint();
|
|
168
|
+
try {
|
|
169
|
+
const vecs = await embedder.embed(texts);
|
|
170
|
+
if (!Array.isArray(vecs) || vecs.length !== texts.length) {
|
|
171
|
+
console.error(`第 ${i + 1} 轮返回 ${Array.isArray(vecs) ? vecs.length : "?"} 条向量,期望 ${texts.length}。`);
|
|
172
|
+
process.exit(1);
|
|
173
|
+
}
|
|
174
|
+
} catch (err) {
|
|
175
|
+
console.error(`第 ${i + 1} 轮嵌入失败:${err.message}`);
|
|
176
|
+
process.exit(1);
|
|
177
|
+
}
|
|
178
|
+
const ms = Number(process.hrtime.bigint() - t0) / 1e6;
|
|
179
|
+
rows.push({ iter: i + 1, ms, perText: ms / texts.length, tps: (texts.length * 1000) / ms });
|
|
180
|
+
}
|
|
181
|
+
|
|
182
|
+
// 结果表
|
|
183
|
+
console.log(`${pad("轮次", 6)}${pad("文本数", 8)}${pad("耗时(ms)", 12)}${pad("ms/条", 10)}${pad("条/秒", 12)}`);
|
|
184
|
+
for (const r of rows) {
|
|
185
|
+
console.log(`${pad(r.iter, 6)}${pad(texts.length, 8)}${pad(r.ms.toFixed(1), 12)}${pad(r.perText.toFixed(3), 10)}${pad(r.tps.toFixed(1), 12)}`);
|
|
186
|
+
}
|
|
187
|
+
const msArr = rows.map((r) => r.ms);
|
|
188
|
+
const avg = msArr.reduce((a, b) => a + b, 0) / msArr.length;
|
|
189
|
+
const min = Math.min(...msArr);
|
|
190
|
+
const max = Math.max(...msArr);
|
|
191
|
+
console.log("\n汇总(均值 / 最小 / 最大):");
|
|
192
|
+
console.log(` 耗时 ms:${avg.toFixed(1)} / ${min.toFixed(1)} / ${max.toFixed(1)}`);
|
|
193
|
+
console.log(` 吞吐:${(texts.length * 1000 / avg).toFixed(1)} 条/秒(平均每轮 ${texts.length} 条)`);
|
|
194
|
+
console.log("══════ 结束 ══════");
|
|
195
|
+
embedder.dispose?.();
|
|
196
|
+
}
|
|
197
|
+
|
|
198
|
+
main().catch((err) => {
|
|
199
|
+
console.error(`未预期错误:${err?.stack ?? err}`);
|
|
200
|
+
process.exit(1);
|
|
201
|
+
});
|