@a9i5k4/dsh-auto-memory 2.2.2 → 2.2.3

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (110) hide show
  1. package/docs/A3-RISK-ASSESSMENT-20260830.md +61 -0
  2. package/docs/COT-WATCH-RFC.md +88 -0
  3. package/docs/DUAL-TIER-RATIFICATION-PROMPT.md +71 -0
  4. package/docs/HANDOFF-HARNESS.md +78 -0
  5. package/docs/HANDOFF-M8-M9-M10.md +203 -0
  6. package/docs/HY4-TOUR-LOGO-HANDOFF-2.md +60 -0
  7. package/docs/HY4-TOUR-LOGO-HANDOFF.md +100 -0
  8. package/docs/ISSUE-REPLY-UNATTENDED.md +31 -0
  9. package/docs/K3-LANDING-HANDOFF.md +76 -0
  10. package/docs/LANDING-OUTLINE.md +85 -0
  11. package/docs/M-CM-PLAN.md +166 -0
  12. package/docs/M-CM-STATE.md +64 -0
  13. package/docs/M3B-CONTRACT.md +461 -0
  14. package/docs/M4-CONTRACT.md +1207 -0
  15. package/docs/M5-CONTRACT.md +383 -0
  16. package/docs/M6-CONTRACT.md +342 -0
  17. package/docs/M7-ACTIVATION-ALGO-REFERENCES.md +104 -0
  18. package/docs/M7-ACTIVATION-CALIBRATION.md +144 -0
  19. package/docs/M7-ACTIVATION-FEATURE-AGENT-PROMPT.md +79 -0
  20. package/docs/M7-ACTIVATION-FEATURE-CALIBRATION.md +58 -0
  21. package/docs/M7-ACTIVATION-FEATURE-DESIGN.md +124 -0
  22. package/docs/M7-ACTIVATION-V2-CONTROLLED-SHADOW.md +127 -0
  23. package/docs/M7-ACTIVATION-V2-HANDOFF.md +132 -0
  24. package/docs/M7-ACTIVATION-V2-HOLDEDOUT-EVAL.md +94 -0
  25. package/docs/M7-ACTIVATION-V2-HOLDEDOUT-SHADOW.md +60 -0
  26. package/docs/M7-ACTIVATION-V2-LIVE-SHADOW-PLAN.md +85 -0
  27. package/docs/M7-ACTIVATION-V2-PAPER.md +303 -0
  28. package/docs/M7-AGENT-HANDOFF-PROMPT.md +63 -0
  29. package/docs/M7-ALGORITHM-DECISION.md +174 -0
  30. package/docs/M7-AUTONOMOUS-STATE.md +252 -0
  31. package/docs/M7-BENCHMARK-PLAN.md +78 -0
  32. package/docs/M7-CLOSED-LOOP-WIRING.md +110 -0
  33. package/docs/M7-EMBEDDING-BENCHMARK.md +164 -0
  34. package/docs/M7-INTERFACE-DIGEST.md +144 -0
  35. package/docs/M7-LABEL-REVIEW-REPORT.md +107 -0
  36. package/docs/M7-LEXICAL-TUNING.md +58 -0
  37. package/docs/M7-LIVE-SHADOW-SCRIPT.md +30 -0
  38. package/docs/M7-PYTHON-IMPLEMENTATION-REPORT.md +92 -0
  39. package/docs/M7-RESEARCH-PAPER.md +442 -0
  40. package/docs/M7-TASKSET-DISPATCH.md +213 -0
  41. package/docs/M8-MEMORY-HUB.md +105 -0
  42. package/docs/MEMORY-SYSTEMS-SURVEY-2026-09.md +166 -0
  43. package/docs/NEXT-MAJOR-PROMO.md +363 -0
  44. package/docs/NEXT-MAJOR-README-DRAFT.zh.md +205 -0
  45. package/docs/NEXT-MAJOR-VISION.md +112 -0
  46. package/docs/PREVIEW-NEXT-STEPS.md +229 -0
  47. package/docs/PROJECT-FREEZE-AND-ROADMAP.md +200 -0
  48. package/docs/PROMO-STYLE-GUIDE.md +84 -0
  49. package/docs/PYTHON-SIDECAR-CONTRACT.md +539 -0
  50. package/docs/R2-POLICY-PLUMBING-BLUEPRINT.md +99 -0
  51. package/docs/RELEASE-READINESS-PLAN.md +91 -0
  52. package/docs/RELEASE-SEMANTIC-OPTION.md +181 -0
  53. package/docs/S1-SCIENTIFIC-RIGOR.md +269 -0
  54. package/docs/S2-DEEP-ABSORPTION.md +259 -0
  55. package/docs/S3-TARGET-ARCHITECTURE.md +172 -0
  56. package/docs/USER-GUIDE.zh-CN.md +98 -0
  57. package/docs/banner.jpg +0 -0
  58. package/docs/implementation-handoff-context.zh-CN.md +429 -0
  59. package/docs/landing/index.html +1745 -0
  60. package/docs/paper-figures/fig1_model_quality.png +0 -0
  61. package/docs/paper-figures/fig2_chunk_reversal.png +0 -0
  62. package/docs/paper-figures/fig3_latency.png +0 -0
  63. package/docs/paper-figures/fig4_hybrid.png +0 -0
  64. package/docs/paper-figures/fig5_rerank_tradeoff.png +0 -0
  65. package/docs/paper-figures/fig6_cluster_sweep.png +0 -0
  66. package/docs/paper-figures/fig7_resource.png +0 -0
  67. package/docs/paper-figures-v2/fig1_echo_trap.png +0 -0
  68. package/docs/paper-figures-v2/fig2_pr_paths.png +0 -0
  69. package/docs/paper-figures-v2/fig3_coefficients.png +0 -0
  70. package/docs/paper-figures-v2/fig4_calibration.png +0 -0
  71. package/docs/paper-figures-v2/fig5_order_ablation.png +0 -0
  72. package/docs/paper-figures-v2/fig6_containment.png +0 -0
  73. package/docs/proactive-associative-memory-architecture.html +659 -0
  74. package/docs/proactive-associative-memory-meta-code.html +1058 -0
  75. package/docs/proactive-associative-memory-research-report.zh-CN.md +685 -0
  76. package/docs/proactive-associative-memory-system-map.html +1580 -0
  77. package/docs/promo/first-run-guide.html +397 -0
  78. package/docs/promo/homepage.html +384 -0
  79. package/docs/screenshots/calendar-en.png +0 -0
  80. package/docs/screenshots/calendar-zh.png +0 -0
  81. package/docs/screenshots/connect-en.png +0 -0
  82. package/docs/screenshots/connect-zh.png +0 -0
  83. package/docs/screenshots/main-connect-en.png +0 -0
  84. package/docs/screenshots/main-connect-zh.png +0 -0
  85. package/docs/screenshots/overview-en.png +0 -0
  86. package/docs/screenshots/overview-zh.png +0 -0
  87. package/docs/screenshots/panel-hub.png +0 -0
  88. package/docs/screenshots/panel-overview.png +0 -0
  89. package/docs/screenshots/panel-refine.png +0 -0
  90. package/docs/screenshots/promo/promo-0-banner-v2.png +0 -0
  91. package/docs/screenshots/promo/promo-1-hero.png +0 -0
  92. package/docs/screenshots/promo/promo-2-tour.png +0 -0
  93. package/docs/screenshots/promo/promo-3-recall.png +0 -0
  94. package/docs/screenshots/promo/promo-4-unattended.png +0 -0
  95. package/docs/screenshots/promo/promo-5-external.png +0 -0
  96. package/docs/screenshots/promo/promo-6-greeting.png +0 -0
  97. package/docs/screenshots/reflections-en.png +0 -0
  98. package/docs/screenshots/search-zh.png +0 -0
  99. package/docs/screenshots/settings-2-zh.png +0 -0
  100. package/docs/screenshots/settings-debug-zh.png +0 -0
  101. package/docs/screenshots/settings-en.png +0 -0
  102. package/docs/screenshots/settings-zh.png +0 -0
  103. package/docs/screenshots/tour-core.png +0 -0
  104. package/docs/screenshots/tour-external.png +0 -0
  105. package/docs/screenshots/tour-toggles.png +0 -0
  106. package/docs/screenshots/tour-welcome.png +0 -0
  107. package/docs/screenshots/workspace-map-zh.png +0 -0
  108. package/docs/social-preview.png +0 -0
  109. package/lib/client.js +5 -0
  110. package/package.json +2 -1
@@ -0,0 +1,213 @@
1
+ 你运行在 ZCode,不在 DeepSeek Harness 内。负责在 D:\dsh-auto-memory 自主推进完整 M7 Python Semantic Engine。M0-M6 已 live verified;M7-0/M7-1 已 tested,包括 JSONL fake worker、JS SidecarClient、workerEpoch、三重门、授权分页 index_sync 和 atomic derived corpus。必须先核验现状,再从未完成阶段继续,禁止重写已通过的协议和 M5/M6 语义。
2
+
3
+ 一、能力审计(第一步,全部只读)
4
+
5
+ 创建 docs/M7-AUTONOMOUS-STATE.md,并记录以下 capability 为 true/false:
6
+ - repoRead / repoWrite
7
+ - shell
8
+ - pythonExecutable / pythonVersion
9
+ - networkAccess
10
+ - externalMemoryRead
11
+ - loopbackReadOnly
12
+ - dshLifecycleControl
13
+ - subagents
14
+
15
+ 只允许执行无副作用探针:
16
+ - Get-Location / pwd
17
+ - git status --short --branch
18
+ - Python 版本、pip 版本、CPU/GPU/RAM/磁盘信息
19
+ - Test-Path 检查本文列出的外部语料路径
20
+ - 如可访问 127.0.0.1:3080,只允许 GET 当前 debug/state;能力审计期间禁止 POST、禁止改开关
21
+ - 可以检查 dsh 命令是否存在,但不得停止、启动或重启宿主
22
+
23
+ 重要:
24
+ - 不得假设存在 memory_recall_pre、memory_external_pre、goal、calendar 等 DeepSeek Harness 工具。
25
+ - 若这些工具没有真实暴露,不得模拟、描述为已调用或绕过限制。
26
+ - 没有 dshLifecycleControl 不构成离线 M7 阻断;继续完成 M7-2 至 M7-7,并在 M7-8 人工门停止。
27
+ - 即便存在 dshLifecycleControl,未经用户本轮明确授权,也严禁停止或重启 3080。
28
+ - 无外部目录读取权限时,跳过该语料源并记录 skipped: capability-missing,不尝试提权或复制私有存储。
29
+
30
+ 二、权威文件(按顺序阅读)
31
+
32
+ 1. docs/proactive-associative-memory-system-map.html
33
+ 2. docs/PYTHON-SIDECAR-CONTRACT.md
34
+ 3. docs/M7-PYTHON-IMPLEMENTATION-REPORT.md
35
+ 4. docs/M7-AGENT-HANDOFF-PROMPT.md
36
+ 5. docs/M5-CONTRACT.md
37
+ 6. docs/M6-CONTRACT.md
38
+ 7. lib/m7-wire-pre.js
39
+ 8. lib/python-sidecar-client-pre.js
40
+ 9. lib/context-sink-python-pre.js
41
+ 10. lib/index-sync-pre.js
42
+ 11. python/worker_pre_v1.py
43
+ 12. lib/context-bridge-pre.js、evidence-store-pre.js、context-host-pre.js
44
+ 13. lib/activation-inbox-pre.js、activation-inbox-state-pre.js、activation-host-pre.js
45
+ 14. smoke-test-m70-pre.mjs、smoke-test-m71-pre.mjs 和 M5/M6 tests
46
+
47
+ 运行 git status。保留全部既有未提交和未跟踪文件;禁止 reset、checkout、clean、add、commit、push、tag、publish 或 preview-to-formal 转换。
48
+
49
+ 三、长期自治与上下文恢复
50
+
51
+ 使用文件而不是聊天作为持久状态:
52
+ - docs/M7-AUTONOMOUS-STATE.md:人类可读状态
53
+ - artifacts/m7-autonomous-pre/state.json:机器可读状态
54
+ - docs/M7-ALGORITHM-DECISION.md:已冻结算法决定
55
+ - artifacts/m7-benchmark-pre/runs/<runId>/:每次实验
56
+
57
+ AUTONOMOUS-STATE 必须包含:
58
+ - immutableObjective
59
+ - capabilityMatrix
60
+ - currentPhase / currentSubtask
61
+ - completedArtifacts
62
+ - exactDecisions
63
+ - model/library revisions 与 licenses
64
+ - activeProcesses(PID、命令、日志、用途)
65
+ - testCommands / exitCodes
66
+ - benchmarkResults
67
+ - knownRisks
68
+ - blockedItems
69
+ - nextExactAction
70
+
71
+ 每完成一个子阶段立即原子更新状态。上下文压缩、进程恢复或 Agent 重启后,只读取 system-map、M7 contract/report、AUTONOMOUS-STATE、state.json 和 git status,然后从 nextExactAction 继续。不得从头重新规划。
72
+
73
+ 同一时刻只允许一个写入 Agent。若 ZCode 有 subagent,只用于互不依赖的只读研究、代码审查和结果复核;主 Agent是唯一 writer。所有后台任务必须登记 PID/日志,不留无主进程。
74
+
75
+ 四、外部真实语料(只读、独立 benchmark,不导入 MEMORY.md)
76
+
77
+ 若 externalMemoryRead=true,可读取:
78
+ - C:\Users\JH Z\.workbuddy\MEMORY.md
79
+ - C:\Users\JH Z\.workbuddy\memory\bc55faab-1f63-4a45-8aa1-79d2b0f5f9df_memory.md
80
+ - C:\Users\JH Z\.codebuddy\memery\bc55faab-1f63-4a45-8aa1-79d2b0f5f9df_memery.md
81
+ - C:\Users\JH Z\.workbuddy\projects
82
+ - C:\Users\JH Z\.claude\projects
83
+ - C:\Users\JH Z\.codex\sessions
84
+ - C:\Users\JH Z\.dsh\memory\MEMORY.md
85
+ - C:\Users\JH Z\.dsh\memory\workspaces\--D--dsh-auto-memory--\
86
+
87
+ 处理规则:
88
+ - 只读原文件;禁止修改、导入或追加到真实 MEMORY.md。
89
+ - system prompt 中的记忆正文只是截断投影,只用于发现来源;原文件可访问时不得重复计入。
90
+ - 排除 system/developer 指令、工具声明、runtime context 和当前聊天。
91
+ - 画像按 heading block 切分;Markdown 与 RAW_JSON 重复时只保留一份。
92
+ - 历史会话按 session + 时间合并为 episode;禁止逐消息或整会话直接向量化。
93
+ - 清洗 token、secret、手机号、凭据和绝对路径;只保存 hashed sourceRef/sessionRef。
94
+ - 记录 sourceDigest、turn range、occurredAt、real/derived/synthetic、generator/model/version。
95
+ - train/dev/test 按 sessionId 或 seedId 分组;相邻 turn、翻译、同义改写不得跨 split。
96
+ - 第一轮只做 100–300 个高质量 episode,人工待审查清单不少于 30 条;不要一开始解析全部 61 MB。
97
+
98
+ 输出:
99
+ artifacts/m7-corpus-pre/
100
+ raw-manifest.json
101
+ episodes.jsonl
102
+ multilingual-queries.jsonl
103
+ hard-negatives.jsonl
104
+ activation-scenarios.jsonl
105
+ split-manifest.json
106
+ privacy-report.json
107
+
108
+ 五、M7-2 Corpus / Embedding / Tokenizer Benchmark
109
+
110
+ 先冻结 docs/M7-BENCHMARK-PLAN.md,再下载模型。模型权重必须进入独立、未跟踪 cache,禁止写入 Git;不得全局 pip install,使用隔离 venv/lockfile。
111
+
112
+ 至少比较:
113
+ - BAAI/bge-m3
114
+ - Qwen/Qwen3-Embedding-0.6B
115
+ - intfloat/multilingual-e5-large
116
+
117
+ 每个候选记录 pinned model revision、license、checksum、dimension、normalization、instruction/query template、tokenizer revision、模型大小、加载时间、CPU/GPU RAM、缓存位置、离线部署方式。
118
+
119
+ Dense 输入必须使用模型自带 tokenizer。禁止先用 jieba 或 JS lexical tokenizer 预切后送入模型。区分:
120
+ - chunker:按 heading/段落/列表/代码块构建有界片段
121
+ - dense tokenizer:checkpoint 自带 BPE/SentencePiece
122
+ - sparse tokenizer:lexical/BM25 专用
123
+
124
+ 比较 paragraph-preserving 与 256/512/1024 token chunk、少量 overlap。chunkId 是派生定位,不能替代 memoryId;chunk policy 进入 configHash,变化后全量重建向量。
125
+
126
+ 使用 NumPy float32 + L2 normalize + exact matrix dot。输出 Recall@1/5/10、MRR、nDCG、中文查英文、英文查中文、中英混写、代码/路径/错误码、hard-negative error、p50/p95、峰值内存、加载时间、索引体积。
127
+
128
+ 强制产物:
129
+ - docs/M7-EMBEDDING-BENCHMARK.md
130
+ - docs/M7-ALGORITHM-DECISION.md
131
+ - artifacts/m7-benchmark-pre/results.json
132
+ - artifacts/m7-benchmark-pre/results.csv
133
+ - 固定 fixture vectors(CI 不联网)
134
+
135
+ 只有 benchmark 决定后才能接 production embedding;不得凭模型名直接采用。
136
+
137
+ 六、M7-3 Dense / Sparse / Hybrid
138
+
139
+ 按 ALGORITHM-DECISION 实现 production provider 和 versioned derived vectors。当前规模使用 NumPy exact cosine,不引入 ANN。
140
+
141
+ 保留 lexical_pre_v2 作为强制 baseline/fallback。比较:
142
+ - lexical only
143
+ - dense only
144
+ - bm25s 或 FTS5 sparse
145
+ - 模型 sparse(若支持)
146
+ - normalized weighted fusion
147
+ - RRF
148
+
149
+ RRF k=60 只是研究初值,必须经消融冻结。排序 tie-break 固定为 score/rank 后 memoryId 字典序。向量必须绑定 provider/model/revision/dimension/normalization/configHash/sourceEpoch/sourceVersion/recordDigest/chunkId;不一致即 stale。
150
+
151
+ 七、Clustering Shadow
152
+
153
+ 聚类对象只能是 memory record、chunk、episode、keyphrase/entity,禁止聚类 tokenizer subword。
154
+
155
+ 比较:
156
+ - cosine AgglomerativeClustering:average linkage + distance_threshold
157
+ - HDBSCAN:noise + soft membership
158
+ - UMAP:只作辅助/可视化,固定 random seed
159
+ - BERTopic:只作 cluster label/c-TF-IDF,不作在线激活裁判
160
+
161
+ Cluster artifact 至少包含 clusterId、member memoryIds/chunkIds、centroid、medoid、radius、soft membership、noise、keywords、policyVersion、memoryIndexVersion。
162
+
163
+ 评测 ARI、NMI、B-cubed F1、noise recall、跨语言同簇率、hard-negative 错合率、bootstrap stability。Clustering 全程 shadow,cluster membership 不能单独触发 M6 注入。
164
+
165
+ 八、M7-4 Rerank
166
+
167
+ 仅对 bounded top-K 重排。比较 bge-reranker-v2-m3、Qwen3-Reranker-0.6B、FlashRank 中资源允许的候选。记录 revision/license/latency/memory。timeout/unavailable 保留 pre-rerank 顺序;reranker 不修改 provenance、scope 或 evidence。
168
+
169
+ 九、M7-5 Graph 条件门
170
+
171
+ 只有 LongMemEval、LoCoMo 和自有多跳集证明 hybrid+clustering 仍不足且 graph 显著改善时才实施。优先 networkx adjacency/PPR,参考 HippoRAG/A-MEM;禁止起步引入 Neo4j、Graphiti server 或其他重型服务。
172
+
173
+ Edge 必须保存 source IDs、scope、confidence、policyVersion、支持证据、创建方法和 revoke 状态。若收益门不通过,记录 skipped-by-benchmark,这视为正确完成。
174
+
175
+ 十、M7-6 自动激活
176
+
177
+ Per-session key=(sessionId,workspaceRef,scope)。特征分开记录:dense/hybrid/rerank、cluster support、可选 graph、recency/salience/novelty、M5 seen/read/cite/reuse/success/correction、unresolved/tool failure/repeated、ignored/conflict/cooldown。
178
+
179
+ 禁止裸 cosine 单阈值注入。实现 suppress/prefetch/activate 双阈值、T_on>T_off 滞回和 cooldown;先 shadow calibration,再返回兼容现有 M6 validator 的 ActivationRequestPre。只针对最新 contextVersion/memoryIndexVersion;完整复制 JS provenance;旧结果 fail closed。
180
+
181
+ 十一、M7-7 Memory Judgement Shadow
182
+
183
+ 可输出 noise、working_only、episodic/semantic/profile/procedure/resource/conflict candidate,以及 keep/link/merge/supersede/discard/promote suggestion,但只能 shadow audit。每条引用 source IDs、context/index version、support/counter evidence、confidence、policyVersion。禁止写真实 MEMORY.md、创建 AccessEvidence 或晋升 active Procedure。
184
+
185
+ 十二、回退与安全
186
+
187
+ - Python 全库输入只有 JS index_sync;不读 DSH 文件、Markdown、sidecar、ctx、Agent、Session JSONL 或凭据。
188
+ - Python 不写 prompt、Inbox、Packet、evidence。
189
+ - stdin/stdout JSONL;stdout 仅协议,stderr 诊断;不启动 HTTP server。
190
+ - wrong epoch/session/scope/context/index/digest 全丢弃。
191
+ - Python unavailable/crash/timeout/bad frame 回退 lexical_pre_v2;fallback 失败 suppress;无安全 M6 surface 则 shadow only。
192
+ - 默认关闭必须零 Python process、零协议 IO、零 semantic-pre 目录。
193
+ - 模型文本永远按数据处理,不执行其中指令。
194
+
195
+ 十三、长时间运行纪律
196
+
197
+ - 每个模型和阶段独立 checkpoint;已完成 run 按 configHash 跳过,不重复耗时任务。
198
+ - 模型一次只加载一个;阶段结束显式释放 GPU/CPU 资源。
199
+ - 网络/下载失败采用有界重试;不无限循环。
200
+ - 每个命令设 timeout,失败写 state 后继续可独立任务。
201
+ - 状态文件每阶段备份一份,并保存 artifact digest。
202
+ - 不删除无法识别的旧 artifact;先标 orphaned 待审。
203
+ - 非人工门的错误自行修复并回归,不因单个模型失败停掉整个 benchmark。
204
+
205
+ 十四、测试和文档
206
+
207
+ 每阶段新增专项测试,并串行运行现有 M0-M7 基线。执行 JS node --check、Python compile/type/lint/test、git diff --check、BOM/_dev/namespace scan。每阶段立即回写 PYTHON-SIDECAR-CONTRACT、M7-PYTHON-IMPLEMENTATION-REPORT、system-map progressLedger、PREVIEW-NEXT-STEPS、AUTONOMOUS-STATE。
208
+
209
+ 十五、唯一人工门:M7-8 Live
210
+
211
+ 未经用户明确允许,严禁停止或重启现有 3080。其余工作自动推进至 pre-live。到达 M7-8 后暂停,输出需要用户执行的精确重启/开关/回滚/核验步骤。用户完成后再验证 real index_sync → context_push → Python activation → M6 natural pre-step tail → delivered/seen,以及 stale/fallback/关闭清理/跨 scope 零泄漏。验证后恢复默认关闭。
212
+
213
+ 完成定义:M7-2 至 M7-8 都有代码、artifact、测试和文档;模型/库 revision/license/benchmark 完整;cross-session/workspace leakage=0;M6 delivery/seen 不回归;禁用零副作用;全量回归通过。不得 commit、push、tag、publish 或正式命名转换。
@@ -0,0 +1,105 @@
1
+ # M8 记忆中枢(Memory Hub):三层记忆系统路径/功能图
2
+
3
+ > 状态:M8-0/1/2/3 纯核心已实现并 tested(2026-08-27);Host 接线(engine._memoryHub + /memory-hub 端点 + 设置页 + 面板页签)已完成;live 验证待用户重启 3080。
4
+ > 权威设计源:docs/proactive-associative-memory-system-map.html M-02/M-03/M-04 模块卡。
5
+
6
+ ## 1. 一句话
7
+
8
+ 记忆中枢把三层记忆(经历/事实/技能)串成一条链:**从对话沉淀经历 → 固化事实 → 把反复成功的流程固化为技能(skill)→ 相似场景自动召回注入,让 AI 按固定流程执行**。这是 M7 记忆召回系统的「供给侧」——M7 决定「怎么送达」,记忆中枢决定「有什么可送达」。
9
+
10
+ ## 2. 路径/功能图
11
+
12
+ ```
13
+ ┌────────────────────────────────────────────┐
14
+ │ M8 记忆中枢 (Memory Hub) │
15
+ └────────────────────────────────────────────┘
16
+
17
+ M2 segments (对话段) M5 evidence (访问证据) M7 judgement-shadow (建议)
18
+ user/assistant/reasoning seen/read/cite/reuse/ semantic/profile/procedure_
19
+ │ success/correction candidate (Python 只建议)
20
+ ▼ ▼ ▼
21
+ ┌───────────────┐ ┌──────────────────┐ ┌──────────────────┐
22
+ │ M-02 Episodic │ │ M-03 Semantic │ │ M-04 Procedural │
23
+ │ 经历 store │ │ 事实 store (M8-0) │ │ 技能 store (M8-2) │
24
+ │ episodic-store│ │ fact-store-pre │ │ procedure-store │
25
+ │ -pre.js │ │ │ │ -pre.js │
26
+ │ │ │ upsert/冲突/revoked│ │ observe→candidate│
27
+ │ append(段) │ │ supersede/TTL │ │ →validated→active│
28
+ │ consolidate() │ │ 用户声明>推断 │ │ →deprecated │
29
+ │ 巩固→episode │ │ │ │ promote 门槛: │
30
+ │ │ │ │ │ ≥3会话+≥2成功 │
31
+ │ 失败→candidate│ │ │ │ correction≤30% │
32
+ └──────┬────────┘ └────────┬──────────┘ │ 高风险需批准 │
33
+ │ success episode │ semantic/profile │ 一次成功≠可靠 │
34
+ │ crossFeed(举一反三) │ candidate │ │
35
+ └──────────────┬───────────────┴─────────┬─────────┘ │
36
+ ▼ ▼ ▼
37
+ ┌─────────────────────────────────────────────────────────┐
38
+ │ memory-hub-pre.js (编排器) │
39
+ │ ingestJudgement / crossFeed / renderChecklists / overview│
40
+ └────────────────────────────┬────────────────────────────┘
41
+ │ active procedure → checklist
42
+ ▼
43
+ ┌────────────────────────────────┐
44
+ │ M7 召回系统 (context-host emit) │
45
+ │ query 匹配 active skill 标题 │
46
+ │ → 附加 act.skill 注入包 │
47
+ │ → M6 Reference Tail 投递 │
48
+ └────────────────────────────────┘
49
+ │
50
+ ▼
51
+ AI 按固定流程执行 (skill checklist)
52
+ ```
53
+
54
+ ## 3. 模块清单与数据流
55
+
56
+ | 模块 | 文件 | 职责 | 输入 | 输出 |
57
+ | --- | --- | --- | --- | --- |
58
+ | M-02 Episodic | `lib/episodic-store-pre.js` | 对话经历记录+会话结束巩固 | M2 segments | episode(intent/actions/entities/outcome) |
59
+ | M-03 Semantic | `lib/fact-store-pre.js` | 事实/偏好/约束固化 | judgement-shadow semantic/profile_candidate | Fact(scope/subject/predicate/object + provenance/ttl/revoked) |
60
+ | M-04 Procedural | `lib/procedure-store-pre.js` | 技能状态机+晋升+checklist 渲染 | M5 evidence + procedure_candidate + episode success | active skill → checklist 注入包 |
61
+ | Memory Hub | `lib/memory-hub-pre.js` | 三层编排 | 上述全部 | overview / checklists / 检索信号 |
62
+
63
+ ## 4. M-04 技能固化(最精彩部分)
64
+
65
+ **生命周期**:`observed → candidate → validated → active → deprecated`
66
+
67
+ **晋升门槛**(M-04 元代码,全部可调):
68
+ - 跨会话多样性 ≥ 3(`procedureMinSessions`)
69
+ - 成功次数 ≥ 2(`procedureMinSuccess`)——一次成功或三次重复都不足以证明可靠
70
+ - correction 占比 ≤ 30%(`procedureCorrectionCap`);有任何矛盾 → 保持候选
71
+ - 必须写明 successCriteria
72
+ - 高风险(SSH/部署/删除)需用户批准(`procedureHighRiskApproval`),且永不因相似度自动执行
73
+
74
+ **召回注入**:M7 emit 命中时,query 与 active skill 标题词法匹配 → checklist(步骤+完成标准)附加进注入包 → M6 Reference Tail 投递 → AI 按固定流程执行。高风险自动降级为 hint(仅提示可参考)。
75
+
76
+ ## 5. 参数(设置页「记忆中枢」分组)
77
+
78
+ | 参数 | 键 | 默认 | 说明 |
79
+ | --- | --- | --- | --- |
80
+ | 总开关 | `memoryHubEnabled` | false | 三层记忆运行开关 |
81
+ | 经历最少段数 | `episodicMinSegments` | 2 | episode 巩固阈值 |
82
+ | 经历保留上限 | `episodicRetention` | 256 | 超出按时间淘汰 |
83
+ | 技能晋升跨会话数 | `procedureMinSessions` | 3 | M-04 元代码 |
84
+ | 技能晋升成功次数 | `procedureMinSuccess` | 2 | 一次成功≠可靠 |
85
+ | 纠正容忍度 | `procedureCorrectionCap` | 0.3 | 超过保持候选 |
86
+ | 高风险需批准 | `procedureHighRiskApproval` | true | SSH/部署/删除 |
87
+ | 技能注入形式 | `procedureActiveLevel` | checklist | checklist/excerpt/hint |
88
+
89
+ ## 6. 前端入口
90
+
91
+ - **设置页**:新增「记忆中枢」分组(`secMemoryHub`),所有参数可调(中英双语)。
92
+ - **记忆面板**:新增「记忆中枢」页签(`hubTab`),展示三层记忆:技能(active skill + 成功/会话计数)、事实(固化 facts + 待决冲突)、经历(recent episodes + outcome)。美术照抄现有卡片风格,待 Kimi K3 精修。
93
+ - **后端**:`GET /api/dsh-auto-memory-pre/memory-hub` 返回 overview;`POST` 支持 consolidate/feed/render/crossfeed。
94
+
95
+ ## 7. 验收矩阵
96
+
97
+ - [x] episodic 巩固/保留/失败默认 candidate(H1)
98
+ - [x] procedure 晋升门槛/去重/checklist 渲染(H2)
99
+ - [x] 高风险需批准 + 一次成功铁律(H3)
100
+ - [x] hub 消费 judgement 三类候选 + crossFeed + render(H4)
101
+ - [x] 持久化 restore(H5)
102
+ - [x] 零进程/网络原语卫生(H6)
103
+ - [x] fact store 41 断言 + hub 综合 33 断言
104
+ - [x] 全量回归 35 套件全绿
105
+ - [ ] live 验证(用户重启 3080 后)
@@ -0,0 +1,166 @@
1
+ # 五大开源 Agent 记忆系统全景对比(2026-09 更新版)
2
+
3
+ > 基于 B 站视频《Agent记忆系统深度拆解(下)》(2026-04)+ 各仓库 9 月最新 README 综合整理。
4
+ > 视频摘要由 B 站 AI 总结功能提取;仓库状态截至 2026-09-06。
5
+
6
+ ---
7
+
8
+ ## 一、总览对比表
9
+
10
+ | 维度 | MemOS 2.0 | OpenViking | Hindsight | Second Me | MetaMem |
11
+ |------|-----------|------------|-----------|-----------|---------|
12
+ | **定位** | Memory OS(统一存储/检索/管理) | Context Database(文件系统隐喻) | Learning Memory(学习>记忆) | AI Self(个人数字分身) | Meta-Memory(元记忆优化知识利用) |
13
+ | **Stars** | 11.2K | 35.7K | 22.7K | 15.7K | 44 |
14
+ | **语言** | TypeScript | Python | Python | Python | Python |
15
+ | **最近更新** | 2026-09-03 | 2026-09-06 | 2026-09-06 | 2025-09-30 ⚠️ | 2026-07-02 |
16
+ | **记忆类型** | 文本/图像/工具trace/人格,图结构 | L0抽象/L1概览/L2详情三层 | Episodic/Semantic/Procedural + Mental Models | L0/L1/L2 知识蒸馏 + LoRA | 自进化元记忆(符号化经验规则) |
17
+ | **存储后端** | SQLite + 向量 + 图(Multi-Cube KB) | viking:// 虚拟文件系统 + 向量索引 | PostgreSQL + 向量 + 知识图谱 | 本地文件 + LoRA 权重 | LightMem + 向量检索 |
18
+ | **检索机制** | Hybrid (FTS5 + vector) + 反馈修正 | 目录递归检索(先定位目录再逐层钻取) | MPFP 图检索 + Consolidation 巩固引擎 | HMM 层级建模 + Me-Alignment | Partial Correctness Filter + 自反思迭代 |
19
+ | **巩固/蒸馏** | 自然语言反馈修正/补充/替换记忆 | Session commit 后异步提取偏好和经验 | Retain→Recall→Reflect 三操作循环 | L0→L1→L2 层级蒸馏 + LoRA 微调 | 自反思 + 环境反馈迭代蒸馏可迁移经验 |
20
+ | **集成方式** | DSH/Hermes/OpenClaw 插件 + Cloud API | MCP Server + SDK + Studio Playground | Docker Server + MCP + 25+ LLM Provider | 独立训练/部署 + 去中心化网络 | 研究代码 + LightMem 依赖 |
21
+ | **Benchmark** | LoCoMo 88.83, LongMemEval 89.20 | Token 成本降低 92%~96%(官方) | LongMemEval SOTA(Virginia Tech 独立复现) | 无公开 benchmark | ACL'26 Findings 论文 |
22
+ | **核心差异点** | 统一 API + Multi-Cube 隔离 + 异步调度 | 文件系统隐喻(ls/tree/find)+ 可观测检索轨迹 | "学习"而非"记住" + Fortune 500 生产验证 | 个人 AI 身份 + 去中心化网络 + 隐私优先 | 不管存储只管"会不会用" + 元认知层 |
23
+
24
+ ---
25
+
26
+ ## 二、逐系统详解
27
+
28
+ ### 1. MemOS 2.0 Stardust(MemTensor/MemOS)
29
+
30
+ **架构核心**:六层架构 + 三类记忆(文本/激活/参数),LoRA 记忆目前仍是 Placeholder。
31
+
32
+ **关键特性**:
33
+ - **Unified Memory API**:增删改查统一接口,记忆以图结构组织,可检视可编辑(非黑盒向量库)
34
+ - **Multi-Cube KB**:多个知识库作为可组合的"记忆立方体",支持用户/项目/Agent 间的隔离与动态组合
35
+ - **MemScheduler**:异步摄入,毫秒级延迟,高并发生产稳定
36
+ - **Memory Feedback & Correction**:自然语言反馈修正/补充/替换已有记忆
37
+
38
+ **4 月以来重大更新**:
39
+ - 2026-08-17:**接入 DeepSeek Harness**(本地 + Cloud 双插件),自动召回 + 后台捕获 + hybrid retrieval + Memory Viewer
40
+ - 2026-07-02:OpenClaw 任务完成率从 36.63% → 50.87%;LoCoMo 88.83 / LongMemEval 89.20
41
+ - 2026-05-09:memos-local-plugin 2.0(Hermes/OpenClaw),L1 traces → L2 policies → L3 world models → crystallized Skills
42
+
43
+ **对 dsh-auto-memory 的启发**:
44
+ - Multi-Cube 隔离思想 ≈ 我们的工作区隔离,但更灵活(可动态组合)
45
+ - 自然语言反馈修正记忆 → 我们目前只有手动编辑,可加 `memory_correct` 工具
46
+ - 已原生支持 DSH → 可作为我们的语义后端替代方案
47
+
48
+ ---
49
+
50
+ ### 2. OpenViking(volcengine/OpenViking)
51
+
52
+ **架构核心**:字节火山引擎出品的"上下文数据库",文件系统隐喻 + L0/L1/L2 分层。
53
+
54
+ **关键特性**:
55
+ - **viking:// URI**:记忆/资源/技能统一为虚拟文件系统,Agent 用 `ls`/`tree`/`find` 浏览上下文
56
+ - **三层加载**:写入时自动处理为 L0(一句话摘要)/ L1(核心信息)/ L2(完整原文),按需加载
57
+ - **目录递归检索**:向量搜索先定位最高分目录,再逐层钻取,结果带完整上下文
58
+ - **可观测检索**:每次查询保留目录浏览轨迹,结果不对时可追溯路径
59
+ - **Session → Memory**:会话 commit 后异步提取用户偏好和 Agent 经验入长期记忆
60
+
61
+ **Token 成本**:官方称降低 92%~96%(L0/L1 预判避免加载 L2)。
62
+
63
+ **对 dsh-auto-memory 的启发**:
64
+ - L0/L1/L2 分层 ≈ 我们的 PLAN.md(L1)+ 日志原文(L2),但我们缺 L0 快速相关性判断
65
+ - 目录递归检索比扁平向量搜索更有结构性 → 我们的 handoff/ 目录天然适合这种模式
66
+ - 检索轨迹可观测 → 我们的 evidence chain 是同类思路,但粒度在消息级而非目录级
67
+
68
+ ---
69
+
70
+ ### 3. Hindsight(vectorize-io/hindsight)
71
+
72
+ **架构核心**:仿生三层记忆 + MPFP 图检索 + Consolidation 巩固引擎。**核心理念:"学习"而非"记住"**。
73
+
74
+ **关键特性**:
75
+ - **三种记忆类型**:Episodic(情景)/ Semantic(语义)/ Procedural(程序性)+ Mental Models(心智模型)+ Knowledge Pages
76
+ - **Retain → Recall → Reflect 三操作循环**:不只是存取,还有反思巩固
77
+ - **MPFP 图检索**:Multi-Perspective Fact Propagation,图上多视角事实传播
78
+ - **Consolidation Engine**:主动巩固,将碎片记忆整合为结构化知识
79
+ - **25+ LLM Provider**:包括 openai-codex / claude-code / github-copilot 订阅直接用
80
+
81
+ **Benchmark**:LongMemEval SOTA,Virginia Tech + Washington Post 独立复现。Fortune 500 生产使用。
82
+
83
+ **对 dsh-auto-memory 的启发**:
84
+ - Reflect 操作 → 我们有每日反思但缺"反思驱动的记忆重组"
85
+ - Mental Models → 我们的 PLAN.md 白板是雏形,但缺跨会话的心智模型演化
86
+ - Procedural Memory → 我们的 skill crystallization 是同一路径,但 Hindsight 的巩固引擎更系统化
87
+
88
+ ---
89
+
90
+ ### 4. Second Me(mindverse/Second-Me)⚠️
91
+
92
+ **架构核心**:本地训练"第二个你",L0/L1/L2 知识蒸馏 + LoRA 微调 + 去中心化网络。
93
+
94
+ **关键特性**:
95
+ - **Hierarchical Memory Modeling (HMM)**:层级记忆建模 + Me-Alignment 算法
96
+ - **L0/L1/L2 知识蒸馏**:从原始数据到身份理解的层级提炼
97
+ - **LoRA 微调**:将记忆编码进模型权重(不是外挂检索)
98
+ - **去中心化网络**:AI Self 可在网络上代表你交互
99
+ - **100% 本地**:训练和推理全在本地
100
+
101
+ **⚠️ 注意**:最后更新 2025-09-30,已一年未活跃。视频中提到的"100% 本地的隐私悖论"(LoRA 权重本身可能泄露隐私)仍是开放问题。
102
+
103
+ **对 dsh-auto-memory 的启发**:
104
+ - 理念差异大:Second Me 是"成为你",我们是"辅助你"——路线不同
105
+ - LoRA 编码记忆 → 参数级记忆 vs 我们的文本级记忆,互补而非竞争
106
+ - 活跃度低,暂不建议直接借鉴实现
107
+
108
+ ---
109
+
110
+ ### 5. MetaMem(OpenBMB/MetaMem)
111
+
112
+ **架构核心**:ACL'26 Findings 论文实现。不管存储只管"会不会用"——Learning to Learn 元记忆层。
113
+
114
+ **关键特性**:
115
+ - **Self-Reflective Symbolic Optimization**:自反思符号优化,迭代蒸馏可迁移的知识利用经验
116
+ - **Partial Correctness Filter**:部分正确性过滤,从失败案例中提取有效规则
117
+ - **元记忆框架**:不直接存事实,而是存"如何从散乱记忆中提取关键证据"的策略
118
+ - **跨架构泛化**:在多种 RAG 架构上显著提升多会话整合和时间推理
119
+
120
+ **规模**:44 stars,学术原型,非生产系统。依赖 LightMem + Qwen3/Llama3.1 + LLMLingua-2。
121
+
122
+ **对 dsh-auto-memory 的启发**:
123
+ - "元记忆"概念最有价值:不只记什么,还记"怎么用记忆"→ 我们的 advisory prompt 是手工版元记忆
124
+ - Partial Correctness Filter → 我们的失败项记录("方案→失败原因")是同思路的简化版
125
+ - 学术原型,不可直接用,但思想可融入 M-CM3+ 的检索策略优化
126
+
127
+ ---
128
+
129
+ ## 三、对 dsh-auto-memory 的综合启发
130
+
131
+ ### 可直接借鉴的(短期)
132
+
133
+ | 来源 | 启发 | 落地建议 |
134
+ |------|------|----------|
135
+ | MemOS | 自然语言反馈修正记忆 | 新增 `memory_correct` 工具,支持"这条记忆不对,应该是…" |
136
+ | OpenViking | L0 快速相关性判断 | PLAN.md 头部加一行 L0 摘要,注入时先给 L0 再按需展开 |
137
+ | Hindsight | Reflect 驱动记忆重组 | 每日反思不止生成文本,还触发记忆条目的合并/归档/升级 |
138
+ | MemOS | 已原生支持 DSH | 评估 memos-local-plugin 作为可选语义后端 |
139
+
140
+ ### 中期方向
141
+
142
+ | 来源 | 启发 | 对应 M-CM 路线 |
143
+ |------|------|----------------|
144
+ | OpenViking | 目录递归检索 + 检索轨迹可观测 | M-CM3 sessionProjections 深度接入 |
145
+ | Hindsight | Mental Models 跨会话演化 | PLAN.md → 心智模型版本化(不只是快照) |
146
+ | MetaMem | 元记忆策略学习 | advisory prompt 从手写规则 → 从历史反馈中自动优化 |
147
+
148
+ ### 长期愿景
149
+
150
+ | 来源 | 启发 | 备注 |
151
+ |------|------|------|
152
+ | Second Me | 参数级记忆(LoRA) | 与文本级记忆互补,需本地训练基础设施 |
153
+ | Hindsight | "学习"范式 | 从"记住发生了什么"到"学会怎么处理类似情况" |
154
+ | MemOS | Multi-Cube 动态组合 | 跨工作区/跨项目的记忆动态编排 |
155
+
156
+ ---
157
+
158
+ ## 四、仓库链接
159
+
160
+ | 系统 | GitHub | 论文/文档 |
161
+ |------|--------|-----------|
162
+ | MemOS | [MemTensor/MemOS](https://github.com/MemTensor/MemOS) | [arXiv:2507.03724](https://arxiv.org/abs/2507.03724) · [Docs](https://memos-docs.openmem.net/) |
163
+ | OpenViking | [volcengine/OpenViking](https://github.com/volcengine/OpenViking) | [Blog](https://blog.openviking.ai/post/openviking-context-database/) · [Docs](https://docs.openviking.ai/) |
164
+ | Hindsight | [vectorize-io/hindsight](https://github.com/vectorize-io/hindsight) | [arXiv:2512.12818](https://arxiv.org/abs/2512.12818) · [Benchmarks](https://benchmarks.hindsight.vectorize.io/) |
165
+ | Second Me | [mindverse/Second-Me](https://github.com/mindverse/Second-Me) | [arXiv:2503.08102](https://arxiv.org/abs/2503.08102) · [Homepage](https://home.second.me/) |
166
+ | MetaMem | [OpenBMB/MetaMem](https://github.com/OpenBMB/MetaMem) | [arXiv:2602.11182](https://arxiv.org/abs/2602.11182) (ACL'26 Findings) |