@furongjun1999/dsh-memory 0.4.7 → 0.4.8

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (172) hide show
  1. package/README.md +92 -37
  2. package/codebuddy/CODEBUDDY.md +195 -185
  3. package/docs/Pi/345/217/257/345/255/246/344/271/240/344/274/230/347/202/271_/347/201/265/346/236/242/345/244/247/350/204/221/346/224/271/350/277/233/344/272/244/346/216/245_20260915.md +144 -0
  4. package/docs/README.md +111 -0
  5. package/docs/discipline/harnesses.yaml +215 -152
  6. package/docs/discipline/templates/full.md.tmpl +60 -58
  7. package/docs/eval//347/254/254/344/270/211/346/226/271/351/252/214/350/257/201/346/212/245/345/221/212_LoCoMo_/347/201/265/346/236/242_.md +127 -0
  8. package/docs/eval//347/254/254/344/270/211/346/226/271/351/252/214/350/257/201/346/212/245/345/221/212_LoCoMo_/347/201/265/346/236/242_.png +0 -0
  9. package/docs/eval//347/254/254/344/270/211/346/226/271/351/252/214/350/257/201/346/212/245/345/221/212_/347/201/265/346/236/242_vs_dejavu_/347/273/237/344/270/200/350/257/204/345/210/206_v7.md +202 -0
  10. package/docs/experiments/m4-role-probe/census.py +86 -0
  11. package/docs/experiments/m4-role-probe/probe.py +89 -0
  12. package/docs/experiments/mapped_confidence/bench_mapped_conf.py +216 -0
  13. package/docs/experiments/mapped_confidence/post_check.py +75 -0
  14. package/docs/experiments/mapped_confidence/repro_thirdparty_tol.py +83 -0
  15. package/docs/experiments/mapped_confidence/result_mapped_conf.json +215 -0
  16. package/docs/{ → hive/}/350/234/202/345/267/242/345/267/245/344/275/234/350/256/260/345/277/206_/351/241/271/347/233/256/350/256/241/345/210/222.md +14 -2
  17. package/docs/{README → mdcg/README}/350/257/246/347/273/206/347/211/210_v0.4.5.md +9 -9
  18. package/docs/{ → mdcg/}/344/270/273/344/273/243/347/220/206/345/255/220/344/273/243/347/220/206/350/256/260/345/277/206/346/236/266/346/236/204/350/256/276/350/256/241.md +1 -1
  19. package/docs/mdcg//345/212/237/350/203/275/350/260/203/347/224/250/346/230/240/345/260/204/350/241/250_v0.1.md +261 -0
  20. package/docs/{ → mdcg/}/345/215/225/345/205/203/350/207/252/346/210/221/351/224/232/347/202/271_/347/263/273/347/273/237/346/217/220/347/244/272/350/257/215/346/240/207/345/207/206_v0.3.md +1 -1
  21. package/docs/mdcg//345/255/220/344/273/243/347/220/206/351/205/215/347/275/256/346/240/207/345/207/206_v0.4.md +148 -0
  22. package/docs/{ → mdcg/}/346/272/220/347/240/201/347/272/247/346/236/266/346/236/204/345/256/241/350/256/241_GPT/346/211/271/350/257/204/345/257/271/347/205/247_v1.0.md +2 -2
  23. package/docs/{ → mdcg/}/347/201/265/346/236/242/344/270/211/345/261/202/346/213/206/345/210/206/350/247/204/345/210/222_v0.1.md +181 -181
  24. package/docs/{ → mdcg/}/347/274/272/345/217/243/345/215/225_P0/346/224/266/345/217/243_v0.1.md +2 -2
  25. package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276_G4-G8/347/274/272/345/217/243/350/243/201/345/256/232/345/215/225_v0.1.md +1 -1
  26. package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276_/347/264/242/345/274/225/344/270/216/345/267/245/347/250/213/350/247/204/350/214/203/345/214/226_/350/256/241/345/210/222_v0.1.md +4 -4
  27. package/docs/{ → mdcg/}/350/256/260/345/277/206/346/223/215/344/275/234/347/263/273/347/273/237_MdCGOS/344/270/216MCP/346/216/245/345/205/245_v0.1.md +2 -2
  28. package/docs/plans/GridWorld/346/234/200/345/260/217/351/227/255/347/216/257/350/247/204/346/240/274_v0.1.md +176 -0
  29. package/docs/{ → swarm/}/350/234/202/347/276/244/344/272/222/350/201/224_v0.1.md +3 -3
  30. package/docs/swarm//350/234/202/347/276/244/345/220/214/351/224/231/346/243/200/346/265/213/345/256/236/351/252/214/345/215/217/350/256/256_v0.1.md +242 -0
  31. package/docs/theory//345/215/225/347/272/277/347/250/213/344/270/216/346/263/250/346/204/217/345/212/233/351/233/206/344/270/255_/346/227/240/344/272/211/350/256/256/347/220/206/350/256/272/346/226/207/346/241/243_v1.0.md +129 -0
  32. package/docs/theory//345/271/266/345/217/221/345/277/205/347/204/266/346/200/247/347/220/206/350/256/272_v0.2.md +134 -0
  33. package/docs/theory//346/246/202/345/277/265/345/210/206/345/261/202/345/257/271/351/275/220/350/241/250_v0.1.md +145 -0
  34. package/docs/{ → theory/}/347/220/206/350/256/272_/346/234/272/345/210/266_/344/273/243/347/240/201_/345/256/236/351/252/214_/347/274/272/345/217/243/347/237/251/351/230/265_v0.1.md +3 -3
  35. package/docs/{ → theory/}/347/220/206/350/256/272/344/273/223/346/213/206/345/210/206/344/270/216/347/231/275/347/256/261/347/237/245/350/257/206/345/272/223/345/206/205/350/277/201_v0.1.md +1 -1
  36. package/docs/theory//350/256/244/347/237/245/344/273/243/347/220/206/344/270/216/346/224/266/346/225/233/347/273/223/346/236/204_/346/235/241/344/273/266/350/256/272/351/207/215/346/236/204_v0.1.md +221 -0
  37. package/docs/world_model//344/270/226/347/225/214/346/250/241/345/236/213_/347/245/236/347/273/217/347/275/221/347/273/234/345/272/225/345/261/202/346/236/266/346/236/204_v1.0.md +237 -0
  38. package/docs//345/255/230/347/256/227/344/270/200/344/275/223/346/236/266/346/236/204/345/255/246/344/271/240_/345/244/226/351/203/250/347/220/206/350/256/272/345/257/271/347/205/247/344/270/216/350/267/257/347/272/277/344/272/244/346/216/245_20260916.md +98 -0
  39. package/docs//345/255/230/347/256/227/344/270/200/344/275/223/347/245/236/347/273/217/347/275/221/347/273/234/346/236/266/346/236/204_/346/200/273/347/272/262/344/270/216/344/272/244/346/216/245_20260916.md +109 -0
  40. package/docs//345/267/245/344/275/234/347/272/252/345/276/213_/350/256/244/347/237/245/345/233/276/346/235/241/347/233/256_v1.1.json +34 -6
  41. package/docs//347/231/275/347/256/261/345/214/226/347/272/262/351/242/206_/344/270/211/351/241/271/347/233/256/345/255/246/344/271/240/346/200/273/346/236/266/346/236/204/344/270/216Ghidra/344/272/244/346/216/245_20260916.md +104 -0
  42. package/docs//350/256/260/345/277/206/350/257/204/345/256/241/347/263/273/347/273/237_/347/253/213/351/241/271/350/256/276/350/256/241/344/270/216/346/226/275/345/267/245/344/272/244/346/216/245_20260915.md +183 -0
  43. package/dsh/README.md +1 -1
  44. package/lib/hooks.d.ts +5 -0
  45. package/lib/hooks.js +10 -1
  46. package/lib/lib/prompt_safety.d.ts +48 -0
  47. package/lib/lib/prompt_safety.js +62 -0
  48. package/md_cg/audit.py +76 -2
  49. package/md_cg/bench_membench.py +10 -5
  50. package/md_cg/bench_progressive.py +48 -9
  51. package/md_cg/branches.py +275 -0
  52. package/md_cg/ccgc.py +884 -0
  53. package/md_cg/conformance.py +662 -0
  54. package/md_cg/consistency.py +1 -1
  55. package/md_cg/corpus.py +1 -1
  56. package/md_cg/eval_common.py +6 -5
  57. package/md_cg/forgetting.py +11 -3
  58. package/md_cg/fsutil.py +63 -1
  59. package/md_cg/identity.py +2 -2
  60. package/md_cg/insight.py +2 -2
  61. package/md_cg/lifecycle.py +262 -0
  62. package/md_cg/mcp_server.py +547 -140
  63. package/md_cg/mdcg.py +206 -18
  64. package/md_cg/mdcos.py +512 -50
  65. package/md_cg/metacognition.py +2 -2
  66. package/md_cg/mreview/__init__.py +25 -0
  67. package/md_cg/mreview/__main__.py +107 -0
  68. package/md_cg/mreview/bundle.py +170 -0
  69. package/md_cg/mreview/candidates.py +253 -0
  70. package/md_cg/mreview/govern.py +674 -0
  71. package/md_cg/mreview/locate.py +905 -0
  72. package/md_cg/mreview/pipeline.py +701 -0
  73. package/md_cg/mreview/rules/duplication.json +21 -0
  74. package/md_cg/mreview/rules/field_coverage.json +54 -0
  75. package/md_cg/mreview/rules/source_license.json +21 -0
  76. package/md_cg/mreview/rules/template_flow.json +21 -0
  77. package/md_cg/mreview/ruleset.py +238 -0
  78. package/md_cg/nodefile.py +38 -0
  79. package/md_cg/predict.py +24 -6
  80. package/md_cg/protect.py +4 -4
  81. package/md_cg/refindex.py +41 -2
  82. package/md_cg/scrub.py +5 -1
  83. package/md_cg/self_state.py +1 -1
  84. package/md_cg/semantic/en_normalizer.py +85 -25
  85. package/md_cg/sustain.py +18 -0
  86. package/md_cg/tasks.py +447 -0
  87. package/md_cg/test_action_derive.py +203 -0
  88. package/md_cg/test_audit_rotate.py +270 -0
  89. package/md_cg/test_branches.py +249 -0
  90. package/md_cg/test_ccg_perturb.py +1 -1
  91. package/md_cg/test_ccgc.py +423 -0
  92. package/md_cg/test_conformance.py +343 -0
  93. package/md_cg/test_en_pipeline.py +24 -0
  94. package/md_cg/test_health_scale.py +173 -0
  95. package/md_cg/test_identity_attribution.py +6 -0
  96. package/md_cg/test_index_durability.py +224 -0
  97. package/md_cg/test_lifecycle.py +309 -0
  98. package/md_cg/test_mr_m1.py +679 -0
  99. package/md_cg/test_mr_m2.py +587 -0
  100. package/md_cg/test_mr_m3.py +703 -0
  101. package/md_cg/test_mr_m4.py +485 -0
  102. package/md_cg/test_p1.py +1 -1
  103. package/md_cg/test_p11_consistency.py +1 -1
  104. package/md_cg/test_p12_metacognition.py +2 -2
  105. package/md_cg/test_p16_self_state.py +1 -1
  106. package/md_cg/test_p26_refindex.py +1 -1
  107. package/md_cg/test_p27_docindex.py +22 -2
  108. package/md_cg/test_p28_refcheck.py +1 -1
  109. package/md_cg/test_p29_session_ingest_export.py +1 -1
  110. package/md_cg/test_p2_mcp.py +7 -1
  111. package/md_cg/test_p38_contextualize.py +1 -1
  112. package/md_cg/test_p39_vision_evidence.py +1 -1
  113. package/md_cg/test_p40_refine_worklist.py +1 -1
  114. package/md_cg/test_p41_evolve_patrol.py +1 -1
  115. package/md_cg/test_p42_provenance.py +1 -1
  116. package/md_cg/test_p43_pooling.py +41 -13
  117. package/md_cg/test_read_clip.py +137 -0
  118. package/md_cg/test_review_conformance.py +310 -0
  119. package/md_cg/test_tasks.py +409 -0
  120. package/md_cg/test_tool_face.py +189 -0
  121. package/md_cg/test_twophase.py +286 -0
  122. package/md_cg/test_writepipe.py +210 -0
  123. package/md_cg/theory.py +1 -1
  124. package/md_cg/tokens.py +95 -5
  125. package/md_cg/tool_face.py +250 -0
  126. package/md_cg/twophase.py +221 -0
  127. package/md_cg/units.py +546 -0
  128. package/md_cg/vision_evidence.py +1 -1
  129. package/md_cg/weights.py +1 -1
  130. package/md_cg/whitebox.py +1 -1
  131. package/md_cg/whitebox_kb/data/verify_cache.json +28 -0
  132. package/md_cg/whitebox_kb/data/verify_savings.jsonl +46 -0
  133. package/md_cg/whitebox_kb/wisdom/audit_log/chain_heat.json +10 -10
  134. package/md_cg/whitebox_kb/wisdom/wisdom-book-cloud.db-shm +0 -0
  135. package/md_cg/whitebox_kb/wisdom/wisdom-book-cloud.db-wal +0 -0
  136. package/md_cg/writelimit.py +19 -3
  137. package/md_cg/writepipe.py +372 -0
  138. package/package.json +1 -1
  139. package/src/hooks.ts +10 -1
  140. package/src/lib/prompt_safety.ts +62 -0
  141. package/zcode/AGENTS.md +195 -185
  142. package/docs//345/212/237/350/203/275/350/260/203/347/224/250/346/230/240/345/260/204/350/241/250_v0.1.md +0 -221
  143. /package/docs/{AGI → eval/AGI}/344/270/203/347/273/264/350/257/204/345/210/206/346/212/245/345/221/212_md_cg_v1.0.md" +0 -0
  144. /package/docs/{AGI → eval/AGI}/344/270/203/347/273/264/350/257/204/345/210/206/346/212/245/345/221/212_md_cg_v2.0.md" +0 -0
  145. /package/docs/{ → eval/}/345/256/236/351/252/214/346/226/271/346/241/210_/345/255/246/344/271/240/351/227/255/347/216/257AB/344/270/216/346/250/252/350/257/204_v1.0.md" +0 -0
  146. /package/docs/{ → eval/}/346/250/252/350/257/204_/345/205/255/345/256/266100/351/242/230/344/270/255/350/213/261/345/217/214/346/237/245_v1.0.md" +0 -0
  147. /package/docs/{guardrail-charter.md → mdcg/guardrail-charter.md} +0 -0
  148. /package/docs/{lingshu_tutorial.html → mdcg/lingshu_tutorial.html} +0 -0
  149. /package/docs/{memory-assessment.html → mdcg/memory-assessment.html} +0 -0
  150. /package/docs/{memory_score.html → mdcg/memory_score.html} +0 -0
  151. /package/docs/{memory_score.png → mdcg/memory_score.png} +0 -0
  152. /package/docs/{release_v0.3.0.md → mdcg/release_v0.3.0.md} +0 -0
  153. /package/docs/{release_v0.4.5.md → mdcg/release_v0.4.5.md} +0 -0
  154. /package/docs/{tool_table_v0.3.0.md → mdcg/tool_table_v0.3.0.md} +0 -0
  155. /package/docs/{ → mdcg/}/344/273/244/347/211/214/344/270/216/350/247/222/350/211/262/346/235/203/350/201/214/345/210/206/347/246/273_v0.1.md" +0 -0
  156. /package/docs/{ → mdcg/}/347/201/265/346/236/24282/345/267/245/345/205/267_/345/212/237/350/203/275/346/225/264/347/220/206/344/270/216/350/277/201/347/247/273/346/230/240/345/260/204_v0.1.md" +0 -0
  157. /package/docs/{ → mdcg/}/347/201/265/346/236/242MCP/345/267/245/345/205/267/346/200/273/350/241/250_v3.4.md" +0 -0
  158. /package/docs/{ → mdcg/}/347/201/265/346/236/242_/350/207/252/346/210/221/345/261/202/345/256/232/344/271/211.md" +0 -0
  159. /package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276_MD/347/233/256/345/275/225/346/226/271/346/241/210_v0.1.md" +0 -0
  160. /package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276_/346/235/241/344/273/266/347/251/272/351/227/264/345/220/210/346/210/220/344/270/216/347/224/237/346/225/210/346/235/241/344/273/266/345/217/243/345/276/204_v0.1.md" +0 -0
  161. /package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276/344/275/234/344/270/272/350/256/260/345/277/206/346/223/215/344/275/234/347/263/273/347/273/237_/350/257/204/344/274/260/344/270/216/350/267/257/347/272/277_v0.1.md" +0 -0
  162. /package/docs/{ → plans/}/345/221/275/345/220/215/346/262/273/347/220/206_/351/241/271/347/233/256/350/256/241/345/210/222.md" +0 -0
  163. /package/docs/{ → plans/}/347/237/245/350/257/206/345/233/276/350/260/261/351/241/271/347/233/256_/344/272/244/346/216/245/346/226/207/346/241/243_20260914.md" +0 -0
  164. /package/docs/{ → swarm/}/350/234/202/347/276/244/345/244/232/346/231/272/350/203/275/344/275/223_/344/275/277/347/224/250/346/212/245/345/221/212_20260913.md" +0 -0
  165. /package/docs/{ → swarm/}/350/234/202/347/276/244/345/244/232/346/231/272/350/203/275/344/275/223_/345/212/237/350/203/275/350/257/264/346/230/216_v0.6.md" +0 -0
  166. /package/docs/{ → swarm/}/350/234/202/347/276/244/347/233/262/345/214/272/346/240/207/350/256/260_v1.0.md" +0 -0
  167. /package/docs/{ → theory/}/344/277/241/346/201/257/345/267/256/344/270/272/344/273/200/344/271/210/345/277/205/347/204/266/345/255/230/345/234/250/344/270/224/350/207/252/347/204/266/346/211/251/345/244/247.md" +0 -0
  168. /package/docs/{ → theory/}/346/231/272/350/203/275/347/232/204/345/205/254/347/220/206/345/214/226/345/237/272/347/237/263.md" +0 -0
  169. /package/docs/{ → theory/}/346/231/272/350/203/275/347/232/204/350/256/244/347/237/245/350/277/207/347/250/213.md" +0 -0
  170. /package/docs/{ → theory/}/346/231/272/350/203/275/350/256/2723.4.md" +0 -0
  171. /package/docs/{ → theory/}/347/231/275/347/256/261/346/231/272/350/203/275/346/230/257/344/273/200/344/271/210/357/274/237.md" +0 -0
  172. /package/docs/{ → theory/}/347/231/275/347/256/261/346/231/272/350/203/275/347/263/273/345/210/227/302/267/347/254/254/344/272/224/347/257/207/357/274/232/350/256/251AI/347/234/237/346/255/243/350/243/205/344/270/212/350/256/260/345/277/206.md" +0 -0
@@ -0,0 +1,587 @@
1
+ # -*- coding: utf-8 -*-
2
+ """M2 蜂巢并发自测:级 4 spec 构造/投递/收卷 + 级 5 意见落库(零直写 / 自验禁止)。
3
+
4
+ 真源:docs/记忆评审系统_立项设计与施工交接_20260915.md §5(spec/result 契约)
5
+ §7(反面清单:评审不改知识层 / 意见必过 verify 令牌 / 不确定 DEFER)。
6
+
7
+ 纪律(同 test_mr_m1.py):
8
+ · **自备数据源**——主测面 = tempfile 合成库 + 仓内 hive release 二进制;
9
+ hive 不存在即 SKIP(外部 clone 下同样全绿),不依赖真源库。
10
+ · **零 LLM**——用确定性假执行器占位 HIVE_EXEC_PY,验证的是并发/文件协议/
11
+ 解析/落库全链路,不是模型质量(模型质量属 M3 定位与 M4 治理的评测面)。
12
+ · **零直写实锤**——dry_run 批量跑后认知图指纹逐字节不变。
13
+
14
+ 覆盖:A spec 构造 B 意见解析与格式校验(100% 口径) C 落库通道与结构性拒绝
15
+ D 真蜂巢端到端(1 包 + 10 包×50 条) E 边界与负例
16
+
17
+ 运行:python -m md_cg.test_mr_m2
18
+ """
19
+ from __future__ import annotations
20
+
21
+ import hashlib
22
+ import json
23
+ import os
24
+ import subprocess
25
+ import sys
26
+ import tempfile
27
+ import time
28
+
29
+ from . import conformance as CF
30
+ from . import crosscheck as CC
31
+ from . import mdcos
32
+ from . import tokens as TK
33
+ from .mreview import bundle as BD
34
+ from .mreview import candidates as CD
35
+ from .mreview import pipeline as PL
36
+ from .mreview import ruleset as RS
37
+
38
+ PASS = FAIL = SKIP = 0
39
+ FAILS = []
40
+
41
+
42
+ def ok(cond, label):
43
+ global PASS, FAIL
44
+ if cond:
45
+ PASS += 1
46
+ else:
47
+ FAIL += 1
48
+ FAILS.append(label)
49
+ print(" FAIL %s" % label)
50
+
51
+
52
+ def skip(label):
53
+ global SKIP
54
+ SKIP += 1
55
+ print(" SKIP %s" % label)
56
+
57
+
58
+ # ---------------------------- 合成库 ----------------------------
59
+
60
+ def node(nid, layer="knowledge", **kw):
61
+ rec = {"id": nid, "layer": layer, "path": "%s/%s.md" % (layer, nid),
62
+ "content": "内容 %s" % nid, "content_hash": "hash_%s" % nid, "tags": []}
63
+ rec.update(kw)
64
+ return rec
65
+
66
+
67
+ def mkroot(root, nodes, *, access=(), write_files=True):
68
+ """合成认知图根:索引 + 闸门三日志 + 节点盘文件(M1 同构,独立实现)。"""
69
+ os.makedirs(root, exist_ok=True)
70
+ with open(os.path.join(root, "_index.json"), "w", encoding="utf-8") as f:
71
+ json.dump({"nodes": nodes}, f, ensure_ascii=False)
72
+ hp = os.path.join(root, "hippocampus")
73
+ os.makedirs(hp, exist_ok=True)
74
+ for name in ("inbox.jsonl", "decisions.jsonl"):
75
+ with open(os.path.join(hp, name), "w", encoding="utf-8") as f:
76
+ f.write("")
77
+ with open(os.path.join(root, CF.ACCESS_LOG), "w", encoding="utf-8") as f:
78
+ for r in access:
79
+ f.write(json.dumps(r, ensure_ascii=False) + "\n")
80
+ with open(os.path.join(root, CD.FORGET_LOG), "w", encoding="utf-8") as f:
81
+ f.write("")
82
+ if write_files:
83
+ for r in nodes.values():
84
+ if not r.get("path"):
85
+ continue
86
+ p = os.path.join(root, r["path"])
87
+ os.makedirs(os.path.dirname(p), exist_ok=True)
88
+ with open(p, "w", encoding="utf-8") as f:
89
+ f.write(r.get("content", ""))
90
+ return root
91
+
92
+
93
+ VOLATILE_DIRS = ("_index_log",)
94
+
95
+
96
+ def snapshot(root, *, exclude_dirs=()):
97
+ ex = set(exclude_dirs)
98
+ out = {}
99
+ for dp, dns, fns in os.walk(root):
100
+ dns[:] = [d for d in dns if d not in ex]
101
+ for fn in fns:
102
+ p = os.path.join(dp, fn)
103
+ with open(p, "rb") as f:
104
+ out[os.path.relpath(p, root)] = hashlib.md5(f.read()).hexdigest()
105
+ return out
106
+
107
+
108
+ def _diff(before, after):
109
+ ch = sorted(k for k in set(before) & set(after) if before[k] != after[k])
110
+ return "改=%s 增=%s 删=%s" % (ch[:5], sorted(set(after) - set(before))[:5],
111
+ sorted(set(before) - set(after))[:5])
112
+
113
+
114
+ # ---------------------------- 语料与包 ----------------------------
115
+
116
+ def pkg_of(n, *, kind="batch", key="g", bid="bM2", layer="knowledge", kinds=()):
117
+ """手工包(与 bundle 输出同形;M2 测的是 spec/收卷/落库,不走候选生成)。"""
118
+ ents = []
119
+ for i in range(n):
120
+ nid = "n%02d" % i
121
+ ents.append({"ref": nid, "node_id": nid, "proposal_id": None,
122
+ "origin": "assertion", "layer": layer,
123
+ "tags": ["doc:note"], "role": "knowledge-card",
124
+ "importance": 0.5, "evidence_count": 1 + (i % 3),
125
+ "verification_basis": "test" if i % 2 else "",
126
+ "lifecycle_state": "active", "content_hash": "h_%s" % nid,
127
+ "issue_kinds": list(kinds) if i % 3 == 0 else [],
128
+ "evidence": [], "excerpt": "正文摘录 %s" % nid})
129
+ return {"bundle_id": bid, "group_kind": kind, "group_key": key,
130
+ "group_sig_kind": "tmpl", "size": n, "refs": [e["ref"] for e in ents],
131
+ "entries": ents}
132
+
133
+
134
+ def asm_of(pkg, *, mech=(), llm=()):
135
+ return {"bundle_id": pkg["bundle_id"], "group_kind": pkg["group_kind"],
136
+ "group_key": pkg["group_key"], "size": pkg["size"],
137
+ "matched": [], "mechanical": list(mech), "llm": list(llm),
138
+ "mechanical_by_kind": {}, "mechanical_flagged": 0}
139
+
140
+
141
+ # ---------------------------- 假执行器 ----------------------------
142
+
143
+ #: 确定性假执行器:读 spec.json/context → 写 result.json(零 LLM,零网络)。
144
+ #: 三种模式(FAKE_MODE)全部用来打 M2 的判据,不掺模型质量。
145
+ FAKE_EXEC = r'''# -*- coding: utf-8 -*-
146
+ import json, os, sys
147
+
148
+ job = sys.argv[1]
149
+ with open(os.path.join(job, "spec.json"), encoding="utf-8") as f:
150
+ spec = json.load(f)
151
+ bundle = {}
152
+ for p in (spec.get("context_files") or []):
153
+ if str(p).endswith(".bundle.json"):
154
+ with open(p, encoding="utf-8") as f:
155
+ bundle = json.load(f)
156
+ break
157
+ ents = bundle.get("entries") or []
158
+ mode = os.environ.get("FAKE_MODE", "ok")
159
+ verdicts = []
160
+ for e in ents:
161
+ nid = e.get("node_id")
162
+ kinds = e.get("issue_kinds") or []
163
+ if mode == "bad":
164
+ verdicts.append({"node_id": nid, "verdict": "MAYBE"})
165
+ elif mode == "textform":
166
+ verdicts.append({"node_id": nid, "verdict": "DEFER",
167
+ "reason": "条件不足,无法确认"})
168
+ elif kinds:
169
+ verdicts.append({"node_id": nid, "verdict": "REJECT",
170
+ "reason": "来源许可不足(机械层已标注)",
171
+ "evidence": ",".join(kinds)})
172
+ else:
173
+ verdicts.append({"node_id": nid, "verdict": "ACCEPT",
174
+ "reason": "机械层无命中,既有基底足以确认适用"})
175
+ payload = {"verdicts": verdicts, "summary": "fake:" + mode}
176
+ if mode == "textform":
177
+ out = {"ok": True, "content": "```json\n" + json.dumps(payload) + "\n```"}
178
+ else:
179
+ out = {"ok": True, "verdicts": payload["verdicts"], "summary": payload["summary"]}
180
+ with open(os.path.join(job, "result.json"), "w", encoding="utf-8") as f:
181
+ json.dump(out, f, ensure_ascii=False)
182
+ '''
183
+
184
+
185
+ def write_fake(root):
186
+ os.makedirs(root, exist_ok=True)
187
+ p = os.path.join(root, "fake_exec.py")
188
+ with open(p, "w", encoding="utf-8") as f:
189
+ f.write(FAKE_EXEC)
190
+ return p
191
+
192
+
193
+ # 合规规则库(本测自备,与生产同形态——由部署侧经 MDCG_POLICY_FILE 配置)。
194
+ # 根因(第4条取证):audit._verify_text → _rule_check 在**无规则**时返回 DEFER
195
+ # (「无规则不能假装合规」),故规则库缺失会让**每一条**意见转审核队列而落不了盘。
196
+ # 这里不是凑空规则(空规则 == 无规则 == 仍 DEFER),而是给出真实判据:
197
+ # forbidden = 机密外泄形态(意见正文绝不应出现)
198
+ # required = 四要素必须齐(意见正文的核心结构)
199
+ POLICY = {"forbidden": [r"(?i)(password|secret|api[_-]?key)\s*[=:]"],
200
+ "required": [r"【内容】", r"【原因】", r"【位置】", r"【验证】"]}
201
+
202
+
203
+ def write_policy(root):
204
+ os.makedirs(root, exist_ok=True)
205
+ p = os.path.join(root, "policy.json")
206
+ with open(p, "w", encoding="utf-8") as f:
207
+ json.dump(POLICY, f, ensure_ascii=False)
208
+ return p
209
+
210
+
211
+ # ---------------------------- A 组:spec 构造 ----------------------------
212
+
213
+ def phase_a(tmp):
214
+ print("[A] spec 构造")
215
+ pkg = pkg_of(6, kinds=("weak_source",))
216
+ asm = asm_of(pkg, mech=[{"issue_kind": "weak_source", "ref": "n00",
217
+ "detail": "verification_basis 为空"}],
218
+ llm=[{"rule_id": "R-TEMPLATE-FLOW", "check": "template_flow_digits_only",
219
+ "question": "正文是否只有编号差异?"}])
220
+ ctx_dir = os.path.join(tmp, "ctx_a")
221
+ files = PL.dump_context(pkg, asm, ctx_dir)
222
+
223
+ ok(len(files) == 2 and all(os.path.isabs(p) for p in files),
224
+ "A1 dump_context 产两文件且为绝对路径")
225
+ ok(all(os.path.isfile(p) for p in files), "A2 context 文件已落盘")
226
+ back = {}
227
+ for p in files:
228
+ with open(p, encoding="utf-8") as f:
229
+ back[os.path.basename(p)] = json.load(f)
230
+ b1 = [v for k, v in back.items() if k.endswith(".bundle.json")][0]
231
+ r1 = [v for k, v in back.items() if k.endswith(".rules.json")][0]
232
+ ok([e["node_id"] for e in b1["entries"]] == [e["node_id"] for e in pkg["entries"]],
233
+ "A3 context 内节点清单与包一致")
234
+ ok(r1.get("mechanical_by_kind") is not None or "mechanical" in r1,
235
+ "A4 context 内含规则装配结果")
236
+
237
+ spec = PL.build_spec(pkg, asm, context_files=files)
238
+ need = {"model", "system_prompt", "user_prompt", "context_files", "timeout_s"}
239
+ ok(need <= set(spec), "A5 spec 契约字段齐备(实得 %s)" % sorted(spec))
240
+ ok(spec["context_files"] == files, "A6 spec.context_files 指向 context 文件")
241
+ ok(all(e["node_id"] in spec["user_prompt"] for e in pkg["entries"]),
242
+ "A7 user_prompt 含全部 node_id(工人不必猜)")
243
+ ok("weak_source" in spec["user_prompt"], "A8 user_prompt 含机械命中")
244
+ ok("R-TEMPLATE-FLOW" in spec["user_prompt"], "A9 user_prompt 含待检问题")
245
+ ok(spec["meta"]["bundle_id"] == pkg["bundle_id"]
246
+ and spec["meta"]["node_ids"] == [e["node_id"] for e in pkg["entries"]],
247
+ "A10 meta 归因信息与包对齐(收卷配对用)")
248
+ ok("不改写任何记忆" in spec["system_prompt"]
249
+ and "DEFER" in spec["system_prompt"],
250
+ "A11 系统提示显式声明零写纪律与不确定即 DEFER")
251
+ ok(spec["temperature"] == 0.0, "A12 默认温度 0(评审要可复现)")
252
+
253
+
254
+ # ---------------------------- B 组:解析与格式校验 ----------------------------
255
+
256
+ def phase_b(tmp):
257
+ print("[B] 意见解析与格式校验")
258
+ nids = {"n%02d" % i for i in range(4)}
259
+
260
+ direct = {"ok": True, "verdicts": [{"node_id": "n00", "verdict": "ACCEPT",
261
+ "reason": "r"}], "summary": "s"}
262
+ p1 = PL.parse_opinions(direct)
263
+ ok(p1["ok"] and p1["verdicts"][0]["node_id"] == "n00", "B1 收直写形态 verdicts")
264
+
265
+ txt = {"ok": True, "content": "前言\n```json\n%s\n```\n后记"
266
+ % json.dumps({"verdicts": [{"node_id": "n01", "verdict": "DEFER",
267
+ "reason": "r"}], "summary": "t"})}
268
+ p2 = PL.parse_opinions(txt)
269
+ ok(p2["ok"] and p2["verdicts"][0]["node_id"] == "n01",
270
+ "B2 收 content 文本形态(```json 围栏)")
271
+
272
+ p3 = PL.parse_opinions({"ok": True, "content": "模型啥也没说"})
273
+ ok(not p3["ok"] and "解析" in p3["error"], "B3 垃圾文本 → ok=False 不炸")
274
+ p4 = PL.parse_opinions({"ok": True, "error": "api 超时"})
275
+ ok(not p4["ok"] and "超时" in p4["error"], "B4 工人报错原样透出")
276
+
277
+ ok(PL.validate_opinion({"node_id": "n00", "verdict": "accept",
278
+ "reason": "r"}, nids) is None, "B5 合法意见通过(含小写归一)")
279
+ ok(PL.validate_opinion({"verdict": "ACCEPT", "reason": "r"}, nids) is not None,
280
+ "B6 缺 node_id 被拒")
281
+ ok(PL.validate_opinion({"node_id": "n00", "verdict": "MAYBE", "reason": "r"},
282
+ nids) is not None, "B7 verdict 越界被拒")
283
+ ok(PL.validate_opinion({"node_id": "n00", "verdict": "ACCEPT"}, nids) is not None,
284
+ "B8 缺 reason 被拒")
285
+ ok(PL.validate_opinion({"node_id": "n00", "verdict": "REJECT", "reason": "r"},
286
+ nids) is not None, "B9 REJECT 缺 evidence 被拒")
287
+ ok(PL.validate_opinion({"node_id": "zzz", "verdict": "ACCEPT", "reason": "r"},
288
+ nids) is not None, "B10 node_id 越出本包被拒")
289
+
290
+ good = {"node_id": "n00", "verdict": "ACCEPT", "reason": "r"}
291
+ bad = {"node_id": "n01", "verdict": "??", "reason": "r"}
292
+ v = PL.validate_opinions([good, bad, dict(good, node_id="n02")], nids)
293
+ ok(v["total"] == 3 and len(v["valid"]) == 2 and len(v["invalid"]) == 1,
294
+ "B11 混合批量 → valid/invalid 分流正确")
295
+ ok(abs(v["pass_rate"] - 2.0 / 3) < 1e-9, "B12 pass_rate 口径 = valid/total")
296
+ ok(not v["ok"], "B13 有非法即整体 ok=False(不确定即 DEFER,不静默放行)")
297
+ ok(PL.validate_opinions([], nids)["pass_rate"] == 1.0,
298
+ "B14 空集 pass_rate=1.0(分母零的显式约定)")
299
+
300
+
301
+ # ---------------------------- C 组:落库通道 ----------------------------
302
+
303
+ def _ops():
304
+ return [{"node_id": "n00", "verdict": "ACCEPT", "reason": "机械层无命中"},
305
+ {"node_id": "n01", "verdict": "REJECT", "reason": "来源许可不足",
306
+ "evidence": "verification_basis 为空且无外部佐证"},
307
+ {"node_id": "n02", "verdict": "DEFER", "reason": "条件不足,无法确认"}]
308
+
309
+
310
+ def phase_c(tmp):
311
+ print("[C] 落库通道(verify 令牌 + 结构性拒绝)")
312
+ root = mkroot(os.path.join(tmp, "cgc"), {"k1": node("k1")})
313
+ cg = mdcos.MdCGSecure(root, principal=PL.verifier_principal(actor="applier"))
314
+ pkg = pkg_of(3)
315
+
316
+ # C1-C3 自验违例:产出意见者 == 落库裁决者
317
+ before = snapshot(root, exclude_dirs=VOLATILE_DIRS)
318
+ r1 = PL.apply_opinions(cg, pkg, _ops(), reviewer="same-actor",
319
+ applier="same-actor")
320
+ ok(bool(r1.get("refused")) and r1.get("reason") == "self_verify_disallowed",
321
+ "C1 评审者==落库者 → 自验违例拒绝(实得 %s)" % r1.get("reason"))
322
+ ok(not r1.get("committed"), "C2 自验违例未落库")
323
+ ok(snapshot(root, exclude_dirs=VOLATILE_DIRS) == before,
324
+ "C3 自验违例零写入(认知图指纹不变)")
325
+
326
+ # C4-C6 正常落库(verify 令牌 → writepipe 六道闸 → contextual)
327
+ r2 = PL.apply_opinions(cg, pkg, _ops(), reviewer="mreview-worker",
328
+ applier="mreview-applier", summary="整包结论:1 拒 1 缓")
329
+ moved = (r2.get("response") or {}).get("moved_to")
330
+ ok(r2.get("committed") is True,
331
+ "C4 意见落库 committed=True(实得 committed=%s moved_to=%s detail=%s)"
332
+ % (r2.get("committed"), moved, (r2.get("detail") or "")[:120]))
333
+ ok(r2.get("layer") == PL.OPINION_LAYER == "contextual",
334
+ "C5 落层 = contextual(非知识层)")
335
+ p_node = os.path.join(root, "contextual", str(r2.get("node_id")) + ".md")
336
+ ok(os.path.isfile(p_node), "C6 意见节点已落盘(%s)" % os.path.relpath(p_node, root))
337
+ if os.path.isfile(p_node):
338
+ with open(p_node, encoding="utf-8") as f:
339
+ doc = f.read()
340
+ ok("ACCEPT 1" in doc and "REJECT 1" in doc and "DEFER 1" in doc,
341
+ "C7 正文含裁决分布(四态计数)")
342
+ ok("verification_basis 为空且无外部佐证" in doc, "C8 正文含逐条理由与证据")
343
+ ok("【内容】" in doc and "【位置】" in doc, "C9 正文含四要素")
344
+
345
+ # C10 空意见 → 零噪声不落库
346
+ r3 = PL.apply_opinions(cg, pkg, [], reviewer="w", applier="a")
347
+ ok(r3.get("ok") and r3.get("skipped") and not r3.get("committed"),
348
+ "C10 无有效意见 → skipped 不落库(零噪声)")
349
+
350
+ # C4b 合规规则库缺失 → 合规闸 DEFER → 转审核队列(诚实降级,不假装落库)
351
+ _saved = os.environ.pop("MDCG_POLICY_FILE", None)
352
+ try:
353
+ r3b = PL.apply_opinions(cg, pkg, _ops(), reviewer="w", applier="a",
354
+ node_id="mr_opinion_nopolicy")
355
+ ok(not r3b.get("committed") and r3b.get("moved_to") == "review_queue"
356
+ and r3b.get("deferred") is True,
357
+ "C4b 无规则库 → 转审核队列而非落盘(moved_to=%s deferred=%s)"
358
+ % (r3b.get("moved_to"), r3b.get("deferred")))
359
+ finally:
360
+ if _saved is not None:
361
+ os.environ["MDCG_POLICY_FILE"] = _saved
362
+
363
+ # C11 越层写入:knowledge 被库层结构性拒绝(§7 反面清单第 1 条)
364
+ r4 = PL.apply_opinions(cg, pkg, _ops(), reviewer="w", applier="a",
365
+ layer="knowledge")
366
+ ok(bool(r4.get("refused")) and r4.get("reason") == "layer_denied",
367
+ "C11 写 knowledge 层被拒(实得 refused=%s reason=%s)"
368
+ % (r4.get("refused"), r4.get("reason")))
369
+ ok(not os.path.isfile(os.path.join(root, "knowledge", str(r4.get("node_id")) + ".md")),
370
+ "C12 越层写入确未落盘")
371
+
372
+ # C13 非法条目被剔除、合法条目照落(不因个别越界全盘丢弃)
373
+ mixed = [{"node_id": "n00", "verdict": "ACCEPT", "reason": "r"},
374
+ {"node_id": "ghost", "verdict": "ACCEPT", "reason": "越包"}]
375
+ nids = {e["node_id"] for e in pkg["entries"]}
376
+ val = PL.validate_opinions(mixed, nids)
377
+ r5 = PL.apply_opinions(cg, pkg, val["valid"], reviewer="w", applier="a",
378
+ node_id="mr_opinion_mixed", invalid=val["invalid"])
379
+ ok(len(val["valid"]) == 1 and len(val["invalid"]) == 1,
380
+ "C13 越包条目被剔除(1 留 1 剔)")
381
+ ok(r5.get("committed"), "C14 剔除后合法条目照常落库")
382
+ p5 = os.path.join(root, "contextual", "mr_opinion_mixed.md")
383
+ if os.path.isfile(p5):
384
+ with open(p5, encoding="utf-8") as f:
385
+ ok("未落库条目" in f.read(), "C15 正文留痕被剔除条目(可审计)")
386
+ else:
387
+ ok(False, "C15 正文留痕被剔除条目(文件缺失)")
388
+
389
+ # C16 dry_run 不写盘
390
+ before2 = snapshot(root, exclude_dirs=VOLATILE_DIRS)
391
+ r6 = PL.apply_opinions(cg, pkg, _ops(), reviewer="w", applier="a",
392
+ dry_run=True)
393
+ ok(r6.get("dry_run") and not r6.get("committed"), "C16 dry_run 返回标记")
394
+ ok(snapshot(root, exclude_dirs=VOLATILE_DIRS) == before2, "C17 dry_run 零写入")
395
+
396
+
397
+ # ---------------------------- D 组:真蜂巢端到端 ----------------------------
398
+
399
+ def _start_serve(exe, jobs, fake, workers=2, timeout=25.0, env_extra=None):
400
+ """拉起独立 serve(独立 jobs 目录 + 假执行器,隔离生产 serve)。
401
+
402
+ env_extra:额外的 **serve 级**环境(如 FAKE_MODE)。执行器子进程继承 serve
403
+ 环境(hive 以 Command::new 启动 exec.py,未 env_clear),故 serve 级注入对
404
+ 工人可见;但也因此环境在 serve 启动时即固定——换模式须另起一个 serve。
405
+ """
406
+ env = dict(os.environ)
407
+ env["PYTHONUTF8"] = "1"
408
+ env["HIVE_EXEC_PY"] = fake
409
+ for _k, _v in (env_extra or {}).items():
410
+ env[str(_k)] = str(_v)
411
+ p = subprocess.Popen([exe, "serve", "--jobs", jobs, "--workers", str(workers)],
412
+ stdout=subprocess.PIPE, stderr=subprocess.STDOUT,
413
+ text=True, encoding="utf-8", errors="replace", env=env)
414
+ t0 = time.time()
415
+ while time.time() - t0 < timeout:
416
+ if os.path.isfile(os.path.join(jobs, "_serve.json")):
417
+ time.sleep(0.4)
418
+ return p, True
419
+ if p.poll() is not None:
420
+ return p, False
421
+ time.sleep(0.3)
422
+ return p, False
423
+
424
+
425
+ def _stop_serve(p):
426
+ try:
427
+ p.terminate()
428
+ p.wait(timeout=8)
429
+ except Exception: # noqa: BLE001
430
+ try:
431
+ p.kill()
432
+ except Exception: # noqa: BLE001
433
+ pass
434
+
435
+
436
+ def phase_d(tmp, exe):
437
+ print("[D] 真蜂巢端到端")
438
+ if not os.path.isfile(exe):
439
+ skip("hive 二进制不存在(%s)→ D 组跳过(外部 clone 同此路径)" % exe)
440
+ return
441
+ base = os.path.join(tmp, "d")
442
+ jobs = os.path.join(base, "jobs")
443
+ ctx = os.path.join(base, "ctx")
444
+ fake = write_fake(base)
445
+ os.makedirs(base, exist_ok=True)
446
+
447
+ nodes = {"n%02d" % i: node("n%02d" % i) for i in range(50)}
448
+ root = mkroot(os.path.join(base, "cg"), nodes)
449
+ cg = mdcos.MdCGSecure(root, principal=PL.verifier_principal(actor="applier"))
450
+ pkg = pkg_of(50, kinds=("weak_source",))
451
+ asm = asm_of(pkg, mech=[{"issue_kind": "weak_source", "ref": "n00",
452
+ "detail": "verification_basis 为空"}])
453
+
454
+ p, ready = _start_serve(exe, jobs, fake)
455
+ ok(ready, "D0 独立 serve 就绪(jobs=%s)" % os.path.relpath(jobs, tmp))
456
+ if not ready:
457
+ _stop_serve(p)
458
+ return
459
+ try:
460
+ # D1 单包全链路
461
+ one = PL.run_package(pkg=pkg, asm=asm, cg=cg, exe=exe, jobs_dir=jobs,
462
+ ctx_dir=ctx, reviewer="mreview-worker",
463
+ applier="mreview-applier", timeout_s=120,
464
+ interval_s=0.3)
465
+ ok(one.get("ok"), "D1 单包 run_package 全链路 ok(stage=%s bundle=%s)"
466
+ % (one.get("stage"), one.get("error") or "-"))
467
+ ok(one.get("pass_rate") == 1.0, "D2 单包意见格式校验 100%%(实得 %s)"
468
+ % one.get("pass_rate"))
469
+ ok((one.get("apply") or {}).get("committed"), "D3 单包意见落库 committed")
470
+
471
+ # D4 零直写实锤:dry_run 批量 10 包(50 条/包)→ 认知图指纹不变
472
+ pairs = [(pkg_of(50, bid="b%02d" % i, key="g%02d" % i,
473
+ kinds=("weak_source",)),
474
+ asm_of(pkg_of(50, bid="b%02d" % i, key="g%02d" % i)))
475
+ for i in range(10)]
476
+ before = snapshot(root, exclude_dirs=VOLATILE_DIRS)
477
+ rep = PL.run_batch(pairs=pairs, cg=cg, exe=exe, jobs_dir=jobs, ctx_dir=ctx,
478
+ reviewer="mreview-worker", applier="mreview-applier",
479
+ timeout_s=300, interval_s=0.3, dry_run=True)
480
+ ok(rep["jobs"] == 10 and rep["done"] == 10,
481
+ "D4 10 包并发投递全部 done(jobs=%s done=%s failed=%s)"
482
+ % (rep["jobs"], rep["done"], rep["failed"]))
483
+ ok(rep["pass_rate"] == 1.0,
484
+ "D5 10 包×50 条意见格式校验 100%%(实得 %s,invalid=%s)"
485
+ % (rep["pass_rate"], rep["invalid"]))
486
+ ok(rep["opinions"] == 500,
487
+ "D6 意见条数 == 10×50(实得 %s)" % rep["opinions"])
488
+ ok(snapshot(root, exclude_dirs=VOLATILE_DIRS) == before,
489
+ "D7 worker 零直写:dry_run 批量后认知图指纹逐字节不变")
490
+
491
+ # D8 实际落库:仅新增意见节点
492
+ _ctxdir = os.path.join(root, "contextual")
493
+ n_before = (len([f for f in os.listdir(_ctxdir) if f.endswith(".md")])
494
+ if os.path.isdir(_ctxdir) else 0)
495
+ rep2 = PL.run_batch(pairs=pairs[:3], cg=cg, exe=exe, jobs_dir=jobs,
496
+ ctx_dir=ctx, reviewer="mreview-worker",
497
+ applier="mreview-applier", timeout_s=300,
498
+ interval_s=0.3, dry_run=False)
499
+ n_after = len([f for f in os.listdir(_ctxdir) if f.endswith(".md")])
500
+ ok(rep2["committed"] == 3,
501
+ "D8 3 包实际落库 committed==3(实得 %s)" % rep2["committed"])
502
+ ok(n_after - n_before == 3,
503
+ "D9 认知图仅新增 3 个意见节点(%s→%s)" % (n_before, n_after))
504
+ ok(not os.path.isdir(os.path.join(root, "knowledge"))
505
+ or len([f for f in os.listdir(os.path.join(root, "knowledge"))]) == 50,
506
+ "D10 knowledge 层节点数不变(评审不改知识层)")
507
+
508
+ # D11 非法意见(verdict 越界)→ 全数拦截,不落库。
509
+ # 执行器模式是 **serve 级**配置(HIVE_EXEC_PY 与 FAKE_MODE 在 serve 启动
510
+ # 时固定),故反例另起一个独立 serve(独立 jobs + FAKE_MODE=bad),
511
+ # 用完即停——与主 serve 互不干扰,也不碰生产 serve。
512
+ bad_pkg = pkg_of(4, bid="bbad", key="gb")
513
+ bad_jobs = os.path.join(base, "jobs_bad")
514
+ pb, rb = _start_serve(exe, bad_jobs, fake, workers=1,
515
+ env_extra={"FAKE_MODE": "bad"})
516
+ ok(rb, "D11a 反例 serve(FAKE_MODE=bad)就绪")
517
+ if rb:
518
+ try:
519
+ rep3 = PL.run_batch(pairs=[(bad_pkg, asm_of(bad_pkg))], cg=cg,
520
+ exe=exe, jobs_dir=bad_jobs, ctx_dir=ctx,
521
+ reviewer="mreview-worker",
522
+ applier="mreview-applier", timeout_s=120,
523
+ interval_s=0.3, dry_run=False)
524
+ ok(rep3["pass_rate"] == 0.0 and rep3["committed"] == 0,
525
+ "D11 越界意见全数拦截(pass_rate=%s committed=%s)"
526
+ % (rep3["pass_rate"], rep3["committed"]))
527
+ finally:
528
+ _stop_serve(pb)
529
+ finally:
530
+ _stop_serve(p)
531
+
532
+
533
+ # ---------------------------- E 组:边界与负例 ----------------------------
534
+
535
+ def phase_e(tmp):
536
+ print("[E] 边界与负例")
537
+ ok(not PL.read_result(os.path.join(tmp, "nope"), "j1")["ok"],
538
+ "E1 read_result 对不存在 job 返回 ok=False(不炸)")
539
+ if os.path.isfile(PL.hive_exe()):
540
+ r2 = PL.poll(PL.hive_exe(), os.path.join(tmp, "nope"), timeout=20)
541
+ ok(r2.get("ok") is True and int(r2.get("count") or 0) == 0,
542
+ "E2 poll 对空 jobs 目录不炸(ok=True count=0,实得 %s)"
543
+ % {k: r2.get(k) for k in ("ok", "count")})
544
+ ok(PL.hive_exe("X:/custom/hive.exe") == "X:/custom/hive.exe",
545
+ "E3 hive_exe 显式参数优先")
546
+ ok(PL.parse_opinions({"ok": True, "verdicts": []})["ok"], "E4 空 verdicts 可解析")
547
+ ok(not PL.parse_opinions({"ok": True, "verdicts": {}})["ok"],
548
+ "E5 verdicts 非数组被拒(不静默)")
549
+ r = PL.verifier_principal()
550
+ ok("contextual" in (r.layers_allow or []) and "knowledge" not in (r.layers_allow or []),
551
+ "E6 verify 令牌层权限取自 tokens 真源(不含 knowledge)")
552
+ ok(CC.detect_self_verify([{"unit": CC.REFLECT_UNIT, "actor": "x"},
553
+ {"unit": CC.VERIFY_UNIT, "actor": "y"}]) is False,
554
+ "E7 不同执行者不判自验违例")
555
+
556
+
557
+ # ---------------------------- main ----------------------------
558
+
559
+ def main(argv=None):
560
+ exe = PL.hive_exe()
561
+ with tempfile.TemporaryDirectory(prefix="mrev_m2_") as tmp:
562
+ # 合规规则库:写路径的 audit 闸要有规则才可能 ACCEPT(无规则恒 DEFER →
563
+ # 意见只会进审核队列)。生产由私有运行时配 MDCG_POLICY_FILE,本测同样
564
+ # 显式配置——否则测不到真实落库链路,只能测到「入队」。
565
+ _saved_policy = os.environ.get("MDCG_POLICY_FILE")
566
+ os.environ["MDCG_POLICY_FILE"] = write_policy(tmp)
567
+ try:
568
+ phase_a(tmp)
569
+ phase_b(tmp)
570
+ phase_c(tmp)
571
+ phase_d(tmp, exe)
572
+ phase_e(tmp)
573
+ finally:
574
+ if _saved_policy is None:
575
+ os.environ.pop("MDCG_POLICY_FILE", None)
576
+ else:
577
+ os.environ["MDCG_POLICY_FILE"] = _saved_policy
578
+ print("\nM2 自测:%d 通过 / %d 失败 / %d 跳过" % (PASS, FAIL, SKIP))
579
+ if FAILS:
580
+ print("失败项:")
581
+ for f in FAILS:
582
+ print(" - %s" % f)
583
+ return 1 if FAIL else 0
584
+
585
+
586
+ if __name__ == "__main__":
587
+ sys.exit(main())