@tea-agent/loop-agent 0.7.5 → 0.8.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (127) hide show
  1. package/AGENTS.md +143 -142
  2. package/CHANGELOG.md +148 -164
  3. package/README.md +206 -204
  4. package/bin/agent-worker.js +22 -22
  5. package/bin/loop-agent.js +21 -21
  6. package/dist/commands/init.js +518 -488
  7. package/dist/commands/loop-benchmark.js +11 -11
  8. package/dist/commands/pi-reuse-benchmark.js +16 -16
  9. package/dist/executors/cursor-executor.js +1 -1
  10. package/dist/governance/manifest-types.js +1 -1
  11. package/dist/task/runtime.js +27 -27
  12. package/dist/worker/cli.js +3 -3
  13. package/dist/worker/observability/event-store.js +2 -1
  14. package/dist/worker/observability/read-model.js +13 -11
  15. package/dist/worker/observe/paths.js +2 -2
  16. package/dist/worker/observe/routes.js +4 -3
  17. package/dist/worker/observe/static/app.js +1479 -1480
  18. package/dist/worker/observe/static/dag-layout.d.ts +31 -31
  19. package/dist/worker/observe/static/dag-layout.js +83 -83
  20. package/dist/worker/observe/static/index.html +63 -63
  21. package/dist/worker/observe/static/styles.css +722 -722
  22. package/dist/worker/pool/run-store.js +7 -8
  23. package/dist/worker/run-task/run-task.js +11 -2
  24. package/dist/worker/runner/run-ready.js +1 -1
  25. package/dist/workflows/dag/canvas-observer.js +275 -275
  26. package/docs/README.md +80 -79
  27. package/docs/agent-dag-recovery-playbook.md +184 -184
  28. package/docs/agent-dag-runner.md +42 -42
  29. package/docs/architecture/runtime-boundaries.md +162 -162
  30. package/docs/cursor-executor-usage.md +25 -25
  31. package/docs/decisions/README.md +3 -3
  32. package/docs/design/README.md +49 -49
  33. package/docs/development-principles.md +73 -73
  34. package/docs/dynamic-workflow-dag-engine-roadmap.md +1749 -1749
  35. package/docs/exec-plans/README.md +6 -6
  36. package/docs/exec-plans/active/README.md +11 -11
  37. package/docs/exec-plans/completed/README.md +35 -34
  38. package/docs/feature-workflow.md +187 -187
  39. package/docs/harness-methodology-debugging.md +153 -153
  40. package/docs/harness-methodology-tdd.md +130 -130
  41. package/docs/harness-methodology-verification.md +27 -27
  42. package/docs/init-surface.manifest.json +245 -241
  43. package/docs/loop-agent-harness.md +63 -55
  44. package/docs/production-readiness.md +96 -96
  45. package/docs/progress/README.md +3 -3
  46. package/docs/reports/README.md +9 -9
  47. package/docs/skills/README.md +6 -6
  48. package/docs/skills/vetted-skill-registry.md +26 -26
  49. package/docs/templates/adr.md +60 -60
  50. package/docs/templates/agent-dag-authority-surface-audit.prompt.md +94 -94
  51. package/docs/templates/agent-dag-decision-envelope.schema.json +213 -213
  52. package/docs/templates/agent-dag-decision-gate-dogfood-report.md +117 -117
  53. package/docs/templates/agent-dag-decision-gate.prompt.md +246 -246
  54. package/docs/templates/agent-dag-process-supervisor.prompt.md +98 -98
  55. package/docs/templates/agent-dag-report.schema.json +454 -454
  56. package/docs/templates/agent-dag-review-verdict.prompt.md +68 -68
  57. package/docs/templates/agent-dag.base.json +195 -195
  58. package/docs/templates/agent-dag.final-verification.json +190 -190
  59. package/docs/templates/agent-dag.schema.json +316 -316
  60. package/docs/templates/agent-dag.supervised-implementation.json +500 -500
  61. package/docs/templates/exec-plan.md +64 -64
  62. package/docs/templates/feature-spec.md +53 -53
  63. package/docs/templates/harness.schema.json +218 -0
  64. package/docs/templates/hybrid-dag.json +193 -193
  65. package/docs/templates/init-evolution-review.md +33 -33
  66. package/docs/templates/interactive-ui-round2-experiment.md +66 -66
  67. package/docs/templates/product-line/AGENTS.md +8 -8
  68. package/docs/templates/product-line/README.md +9 -9
  69. package/docs/templates/product-line/acceptance.yaml +14 -14
  70. package/docs/templates/product-line/closeout.yaml +9 -9
  71. package/docs/templates/product-line/design.md +13 -13
  72. package/docs/templates/product-line/links.md +10 -10
  73. package/docs/templates/product-line/requirement.md +17 -17
  74. package/docs/templates/product-line/task-graph.yaml +15 -15
  75. package/docs/templates/product-line/task.yaml +65 -65
  76. package/docs/templates/product-line/test-plan.md +7 -7
  77. package/docs/templates/production-readiness-checklist.md +57 -57
  78. package/docs/templates/progress-log.md +17 -17
  79. package/docs/templates/project-start-checklist.md +9 -9
  80. package/docs/templates/qa-report.md +48 -48
  81. package/docs/templates/sprint-contract.md +29 -29
  82. package/docs/templates/worker-dogfood-evidence.md +52 -52
  83. package/docs/templates/worker-dogfood-setup.md +48 -48
  84. package/docs/verification-matrix.md +49 -49
  85. package/examples/decision-gate-agent-dag.json +123 -123
  86. package/examples/example-dag.json +51 -51
  87. package/examples/hybrid-loop-agent-dag.json +194 -194
  88. package/harness.json +73 -71
  89. package/package.json +68 -67
  90. package/scripts/check-product-line-docs.sh +22 -22
  91. package/scripts/check-task-pool-root.sh +32 -0
  92. package/skills/ai-engineering-context/SKILL.md +48 -48
  93. package/skills/code-review-core/SKILL.md +20 -20
  94. package/skills/codebase-scout/SKILL.md +19 -19
  95. package/skills/init-capability-evolution/SKILL.md +69 -69
  96. package/skills/loop-agent/SKILL.md +149 -149
  97. package/skills/loop-agent/references/README.md +67 -67
  98. package/skills/loop-agent/references/command-reference.md +432 -412
  99. package/skills/loop-agent/references/harness-policy.md +263 -263
  100. package/skills/loop-agent/references/hybrid-dag.md +216 -216
  101. package/skills/loop-agent/references/learned/README.md +21 -21
  102. package/skills/loop-agent/references/long-running-loop.md +59 -59
  103. package/skills/loop-agent/references/model-routing.md +36 -36
  104. package/skills/loop-agent/references/multi-worktree.md +54 -54
  105. package/skills/loop-agent/references/one-shot-runs.md +85 -85
  106. package/skills/loop-agent/references/orchestrator-and-interventions.md +169 -169
  107. package/skills/loop-agent/references/pi-prompt.md +23 -23
  108. package/skills/loop-agent/references/pi-subagent-assisted-mode.md +81 -81
  109. package/skills/loop-agent/references/post-implementation-and-patterns.md +44 -44
  110. package/skills/loop-agent/references/task-workflow.md +89 -89
  111. package/skills/loop-agent/references/verification-and-failure-handling.md +128 -128
  112. package/skills/requesting-code-review/SKILL.md +101 -101
  113. package/skills/requesting-code-review/code-reviewer.md +168 -168
  114. package/skills/systematic-debugging/CREATION-LOG.md +119 -119
  115. package/skills/systematic-debugging/SKILL.md +296 -296
  116. package/skills/systematic-debugging/condition-based-waiting-example.ts +158 -158
  117. package/skills/systematic-debugging/condition-based-waiting.md +115 -115
  118. package/skills/systematic-debugging/defense-in-depth.md +122 -122
  119. package/skills/systematic-debugging/find-polluter.sh +63 -63
  120. package/skills/systematic-debugging/root-cause-tracing.md +169 -169
  121. package/skills/systematic-debugging/test-academic.md +14 -14
  122. package/skills/systematic-debugging/test-pressure-1.md +58 -58
  123. package/skills/systematic-debugging/test-pressure-2.md +68 -68
  124. package/skills/systematic-debugging/test-pressure-3.md +69 -69
  125. package/skills/test-driven-development/SKILL.md +20 -20
  126. package/skills/verification-before-completion/SKILL.md +154 -154
  127. package/skills/webapp-testing/SKILL.md +19 -19
package/AGENTS.md CHANGED
@@ -1,142 +1,143 @@
1
- <!-- CODEGRAPH_START -->
2
- ## CodeGraph
3
-
4
- 如果仓库根目录存在 `.codegraph/`,在理解或定位代码前优先使用 CodeGraph,再考虑 rg/fd 或手动读文件。
5
- <!-- CODEGRAPH_END -->
6
-
7
- # AGENTS.md
8
-
9
- 本仓库采用“人类掌舵,智能体执行”的工程方式。目标不是一次性写完所有代码,而是在一个可持续演进、可交接、可验证的系统里做小步增量。
10
-
11
- `AGENTS.md` 是地图,不是百科。顶层只保留开工协议、会话协议与文档导航;长期知识、方法论、决策、计划、报告和模板应进入 `docs/`。
12
-
13
- ## 默认立场
14
-
15
- - 仓库是记录系统:决策、契约、计划、测试、报告优先落到仓库,而不是停留在聊天里。
16
- - 一次只推进一个清晰工作块;主会话按 Orient → Select → Contract → Implement → Verify → Handoff 治理,runtime 真实流程以 `src/workflows/` 为准。
17
- - 先验证基线,再叠加改动;如果当前基线已坏,优先定位基线问题。
18
- - 完成定义必须可验证;不能靠删测试、降标准或模糊描述制造“完成”。
19
- - 搜索先于实现;先查现有代码、文档、脚本、测试,避免重复造轮子或误判系统能力。
20
- - 在 DAG runtime 中,搜索/侦察是显式节点:标准路径是 Contract → Scout → Plan → Implement → Verify → Closeout/Handoff。
21
- - init surface、runtime 边界、command registry、skill entry 和架构 import 方向是可机器校验的治理契约;相关细节以 `docs/init-surface.manifest.json`、`docs/architecture/runtime-boundaries.md`、`src/cli/command-definitions.ts`、`skills/loop-agent/` 和 `scripts/check-*.sh` 为准,顶层 `AGENTS.md` 只指路,不重复维护事实源。
22
- - 本仓库既是 loop-agent 源项目,也是目标项目初始化体验的默认模板;任何新增命令、脚本、文档、skill、模板或发布包内容,都要判断它应由 npm 包内置提供,还是由 `loop-agent init` 投影到目标项目,避免出现“本项目能用、初始化项目缺能力”。
23
- - 委托模型写入前,必须把写入边界写成结构化 `task.json.allowedPaths` / `task.json.forbiddenPaths`,再审查生成 DAG 的 writer `writeSet`;不要只依赖 `source/执行约束.md` 的自然语言约束。
24
- - Shell 搜索优先 `rg`,按名找文件优先 `fd`;脚本确为 Bash 脚本时使用 Git Bash 或已配置的兼容 Bash,不要求 Windows 环境适配 POSIX 路径。
25
- - 用 loop-agent 迭代本仓库时,控制器必须来自已发布的 npm 安装包;首次安装或有意升级可用 `@tea-agent/loop-agent@latest`,但一次自举任务启动后不要中途升级控制器,并记录 `npm list -g @tea-agent/loop-agent --depth=0` 显示的实际版本。不要用当前工作区的 `npm link` 或 `npm run dev` 控制可能改动 CLI、DAG runtime、executor、package metadata 或 build output 的任务。
26
- - 反复出现的约束要固化为文档、脚本、检查项、测试或模板。
27
- - 禁止占位实现;除非 contract 明确约定为脚手架且标出后续闭环。
28
-
29
- ## 开始顺序
30
-
31
- 改文件前必须先完成:
32
-
33
- 1. 运行 `pwd`。
34
- 2. 阅读 `README.md`。
35
- 3. 阅读 `harness.json`。
36
- 4. 阅读 `docs/README.md`。
37
- 5. 如果存在 `CONTEXT.md`,阅读项目术语表,避免混用任务源、执行约束、契约、计划等领域概念。
38
- 6. 如果是实现类工作,继续阅读:
39
- - `docs/development-principles.md`
40
- - `docs/feature-workflow.md`
41
- - `docs/verification-matrix.md`
42
- 7. 如果任务涉及命令入口、执行流程、executor、初始化投影、skills、脚本矩阵、发布包范围或治理检查,继续阅读:
43
- - `docs/architecture/runtime-boundaries.md`
44
- - `docs/loop-agent-harness.md`
45
- 8. 如果任务涉及测试纪律、验证声明或调试,继续阅读:
46
- - `docs/harness-methodology-tdd.md`
47
- - `docs/harness-methodology-verification.md`
48
- - `docs/harness-methodology-debugging.md`
49
- 9. 查看最近提交、相关执行计划、progress/report,确认当前上下文。
50
- 10. 检查 `git status --short --branch`。
51
- 11. 运行本次任务相关的最小基线验证。
52
-
53
- ## 会话协议
54
-
55
- 1. Orient:读入口文档、相关专题、最近变更和现有实现。
56
- 2. Select:只选一个清晰工作块;避免把重构、新功能、文档迁移混在一轮里。
57
- 3. Contract:写清本轮交付物、非目标、完成标准、验证方法和失败条件。
58
- 4. Implement:做最小增量实现,同步维护必要文档、脚本和测试。
59
- 5. Verify:优先跑快速反馈,再跑必要的真实路径验证。
60
- 6. Converge Docs:检查 README、AGENTS.md、CHANGELOG.md、docs/README.md、相关治理文档、skills references、website docs、初始化模板和脚本说明是否仍与实际行为一致;只更新与本次变更相关的内容,不做顺手文档迁移。
61
- 7. Handoff:更新 progress/report/plan 中有长期价值的信息,写清风险、剩余项和下一步。
62
-
63
- 这套会话协议不是 DAG runtime 的节点序列。复杂实现默认采用 Agent DAG;具体节点拓扑、profile routing、writer 选择和 runner 行为以 `docs/feature-workflow.md` 与 `src/workflows/` 为准。主 agent 负责拆任务、写 contract、把允许/禁止路径写入结构化 task config、审查 DAG/writeSet/profile/shell verification、盯验证与 handoff。微小任务或 DAG runtime 自身修复也应优先使用 DAG,或使用 one-shot `pi-prompt` / `cursor-prompt` escape hatch 并记录边界与验证证据。
64
-
65
- ## 项目地图
66
-
67
- - `CONTEXT.md`:项目术语表,定义 loop-agent、任务源、执行约束等领域语言
68
- - `src/`:loop-agent 运行时代码
69
- - `test/`:Vitest 测试套件
70
- - `bin/loop-agent.js`:CLI 可执行入口
71
- - `skills/`:loop-agent 和 DAG 模板引用的本地 skill 指令与参考资料;`init --profile full` 还会把同一份 skills 镜像到目标项目的 `.agents/skills/`(外部 agent 兼容路径,包内仍只带 `skills/`)。初始化还会向目标项目 `.gitignore` 合并 loop-agent managed block,忽略 `.harness/tasks/*`、`.harness/dag-runs/*`、`.harness/runs/*`、`.harness/init-surface.json`、`.task-pool/`、`.worktrees/` 等运行态事实,但保留 `.harness/prompts/` 和目录占位可共享,不会整目录忽略 `.harness/`。
72
- - `.harness/`:任务、DAG、run、cache 和 live state 等运行态目录
73
- - `docs/`:治理文档、计划、报告和模板
74
- - `website/`:Docusaurus 用户文档站
75
- - `scripts/`:验证和维护脚本
76
-
77
- ## 工作规则
78
-
79
- - 每次任务只推进一个清晰、有边界的工作块。
80
- - 保留无关的用户改动,不要回退自己没有做的修改。
81
- - 优先沿用现有 helper、目录边界和局部模式,再考虑新增抽象。
82
- - 长期决策写入 `docs/`,不要只留在聊天里。
83
- - 面向使用者的新增、修改、删除或修复,应同步更新根目录 `CHANGELOG.md`;保持版本级摘要即可,不写过细技术细节。
84
- - 涉及 `loop-agent init` 或目标项目投影的改动,必须同步考虑目标项目生成物:`AGENTS.md`、`README.md`、`harness.json`、`docs/`、`scripts/`、`skills/`、`.agents/skills/`(skills 镜像)、`.harness/prompts`、`.gitignore`(loop-agent runtime managed block)和 npm 包内置 assets。
85
- - 涉及初始化能力演化时,按 `docs/init-surface.manifest.json` 与 `scripts/check-init-evolution-needed.sh` 分级处理:小改 advisory,中等 surface-check,高影响才需要模型审查;不要把所有小改动升级成重流程。
86
- - 通用脚本、skill 和模板可以复制或投影;项目相关 README、验证命令、发布/维护脚本必须基于模板和目标项目真实文件生成,不假定目标项目是 TypeScript、Node、前端、后端或工具项目。
87
- - 涉及 CLI command、skill entry、runtime boundary、import 方向或发布包范围时,同步更新对应文档、catalog/definition、治理脚本和测试,避免 README、skill referenceCLI help、npm 包内容互相漂移。
88
- - 完成相关更新后必须做文档收敛:如果 READMEAGENTS.mdCHANGELOG.mddocsskillswebsite、初始化生成模板或脚本说明不需要更新,应在交接里写明理由。
89
- - 不提交占位实现。
90
- - 没有新鲜验证证据时,不声明工作完成。
91
- - 发现新 bug、技术债或契约漂移时,写回当前 plan、progress 或 report,而不是只在对话里提一句。
92
- - 涉及 harness 流程变化时,优先把变化落到 `harness.json`、模板、脚本或治理文档,而不是只改提示词。
93
-
94
- ## 验证
95
-
96
- 用 `docs/verification-matrix.md` 选择命令。常用门禁:
97
-
98
- ```bash
99
- npm run typecheck
100
- npm test
101
- npm run build
102
- node bin/loop-agent.js --help
103
- bash scripts/check-repo.sh
104
- bash scripts/ci.sh
105
- ```
106
-
107
- Windows 上运行 `scripts/*.sh` 时使用 Git Bash 或已配置的兼容 Bash。CLI、Node 代码、模板和提示词里的实际文件路径必须兼容 macOS 与 Windows:优先使用平台原生临时目录和 `path`/`os.tmpdir()`;仅在 repo 引用、JSON/Markdown 证据引用和 glob 约定中使用 `/` 作为稳定分隔符。
108
-
109
- 文档站相关变更还需要按范围运行:
110
-
111
- ```bash
112
- npm run docs:build
113
- ```
114
-
115
- 按变更类型补充定向验证:
116
-
117
- - 初始化能力或目标项目投影:运行 `test/init-command.test.ts`,并在临时目标项目执行 `loop-agent init --profile full --merge`、`loop-agent init doctor`、`loop-agent inspect`、`loop-agent docs audit` 和目标项目 `bash scripts/check-repo.sh`。
118
- - init surface 或初始化能力演化:运行 `bash scripts/check-init-evolution-needed.sh` `bash scripts/check-init-surface.sh`;高影响或发布前按需使用 `--strict` 并参考 `skills/init-capability-evolution/` `docs/templates/init-evolution-review.md`。
119
- - runtime boundary / command registry / skill entry:运行 `bash scripts/check-architecture-boundaries.sh`、`bash scripts/check-command-registry-drift.sh`、`bash scripts/check-skill-entry.sh`,并确保 `bash scripts/check-repo.sh` 覆盖这些检查。
120
- - 发布包范围:运行 `npm run build`、`node bin/loop-agent.js --help` `npm pack --dry-run`,确认初始化所需静态资料在 package files 中。
121
-
122
- ## 交接
123
-
124
- 较大的工作结束时记录:
125
-
126
- - 改了什么
127
- - 为什么这样改
128
- - 执行过哪些验证命令以及结果
129
- - 是否影响契约、文档、测试或脚本
130
- - 剩余风险
131
- - 后续工作
132
-
133
- ## 禁止事项
134
-
135
- - 不要在未读相关文档的前提下直接大改。
136
- - 不要一次混合重构、新功能和文档大迁移而没有清晰边界。
137
- - 不要把仅存在于对话里的约束当作长期知识。
138
- - 不要在缺少验证的情况下宣称完成。
139
- - 不要假设系统没有某个能力;先搜索再判断。
140
- - 不要用 stub、假数据通路或注释承诺替代真正交付。
141
- - 不要把个人机器的绝对路径写入仓库级 `AGENTS.md`、README、模板或发布包资料;个人工具配置应留在用户级配置或本机会话上下文。
142
- - 不要只更新 loop-agent 本仓库体验而遗漏目标项目初始化体验;新增能力如果不能通过 npm 内置资料或 `loop-agent init` 到达目标项目,必须写清原因和替代入口。
1
+ <!-- CODEGRAPH_START -->
2
+ ## CodeGraph
3
+
4
+ 如果仓库根目录存在 `.codegraph/`,在理解或定位代码前优先使用 CodeGraph,再考虑 rg/fd 或手动读文件。
5
+ <!-- CODEGRAPH_END -->
6
+
7
+ # AGENTS.md
8
+
9
+ 本仓库采用“人类掌舵,智能体执行”的工程方式。目标不是一次性写完所有代码,而是在一个可持续演进、可交接、可验证的系统里做小步增量。
10
+
11
+ `AGENTS.md` 是地图,不是百科。顶层只保留开工协议、会话协议与文档导航;长期知识、方法论、决策、计划、报告和模板应进入 `docs/`。
12
+
13
+ ## 默认立场
14
+
15
+ - 仓库是记录系统:决策、契约、计划、测试、报告优先落到仓库,而不是停留在聊天里。
16
+ - 一次只推进一个清晰工作块;主会话按 Orient → Select → Contract → Implement → Verify → Handoff 治理,runtime 真实流程以 `src/workflows/` 为准。
17
+ - 先验证基线,再叠加改动;如果当前基线已坏,优先定位基线问题。
18
+ - 完成定义必须可验证;不能靠删测试、降标准或模糊描述制造“完成”。
19
+ - 搜索先于实现;先查现有代码、文档、脚本、测试,避免重复造轮子或误判系统能力。
20
+ - 在 DAG runtime 中,搜索/侦察是显式节点:标准路径是 Contract → Scout → Plan → Implement → Verify → Closeout/Handoff。
21
+ - init surface、runtime 边界、command registry、skill entry 和架构 import 方向是可机器校验的治理契约;相关细节以 `docs/init-surface.manifest.json`、`docs/architecture/runtime-boundaries.md`、`src/cli/command-definitions.ts`、`skills/loop-agent/` 和 `scripts/check-*.sh` 为准,顶层 `AGENTS.md` 只指路,不重复维护事实源。
22
+ - 本仓库既是 loop-agent 源项目,也是目标项目初始化体验的默认模板;任何新增命令、脚本、文档、skill、模板或发布包内容,都要判断它应由 npm 包内置提供,还是由 `loop-agent init` 投影到目标项目,避免出现“本项目能用、初始化项目缺能力”。
23
+ - 委托模型写入前,必须把写入边界写成结构化 `task.json.allowedPaths` / `task.json.forbiddenPaths`,再审查生成 DAG 的 writer `writeSet`;不要只依赖 `source/执行约束.md` 的自然语言约束。
24
+ - Shell 搜索优先 `rg`,按名找文件优先 `fd`;脚本确为 Bash 脚本时使用 Git Bash 或已配置的兼容 Bash,不要求 Windows 环境适配 POSIX 路径。
25
+ - 用 loop-agent 迭代本仓库时,控制器必须来自已发布的 npm 安装包;首次安装或有意升级可用 `@tea-agent/loop-agent@latest`,但一次自举任务启动后不要中途升级控制器,并记录 `npm list -g @tea-agent/loop-agent --depth=0` 显示的实际版本。不要用当前工作区的 `npm link` 或 `npm run dev` 控制可能改动 CLI、DAG runtime、executor、package metadata 或 build output 的任务。
26
+ - 反复出现的约束要固化为文档、脚本、检查项、测试或模板。
27
+ - 禁止占位实现;除非 contract 明确约定为脚手架且标出后续闭环。
28
+
29
+ ## 开始顺序
30
+
31
+ 改文件前必须先完成:
32
+
33
+ 1. 运行 `pwd`。
34
+ 2. 阅读 `README.md`。
35
+ 3. 阅读 `harness.json`。
36
+ 4. 阅读 `docs/README.md`。
37
+ 5. 如果存在 `CONTEXT.md`,阅读项目术语表,避免混用任务源、执行约束、契约、计划等领域概念。
38
+ 6. 如果是实现类工作,继续阅读:
39
+ - `docs/development-principles.md`
40
+ - `docs/feature-workflow.md`
41
+ - `docs/verification-matrix.md`
42
+ 7. 如果任务涉及命令入口、执行流程、executor、初始化投影、skills、脚本矩阵、发布包范围或治理检查,继续阅读:
43
+ - `docs/architecture/runtime-boundaries.md`
44
+ - `docs/loop-agent-harness.md`
45
+ 8. 如果任务涉及测试纪律、验证声明或调试,继续阅读:
46
+ - `docs/harness-methodology-tdd.md`
47
+ - `docs/harness-methodology-verification.md`
48
+ - `docs/harness-methodology-debugging.md`
49
+ 9. 查看最近提交、相关执行计划、progress/report,确认当前上下文。
50
+ 10. 检查 `git status --short --branch`。
51
+ 11. 运行本次任务相关的最小基线验证。
52
+
53
+ ## 会话协议
54
+
55
+ 1. Orient:读入口文档、相关专题、最近变更和现有实现。
56
+ 2. Select:只选一个清晰工作块;避免把重构、新功能、文档迁移混在一轮里。
57
+ 3. Contract:写清本轮交付物、非目标、完成标准、验证方法和失败条件。
58
+ 4. Implement:做最小增量实现,同步维护必要文档、脚本和测试。
59
+ 5. Verify:优先跑快速反馈,再跑必要的真实路径验证。
60
+ 6. Converge Docs:检查 README、AGENTS.md、CHANGELOG.md、docs/README.md、相关治理文档、skills references、website docs、初始化模板和脚本说明是否仍与实际行为一致;只更新与本次变更相关的内容,不做顺手文档迁移。
61
+ 7. Handoff:更新 progress/report/plan 中有长期价值的信息,写清风险、剩余项和下一步。
62
+
63
+ 这套会话协议不是 DAG runtime 的节点序列。复杂实现默认采用 Agent DAG;具体节点拓扑、profile routing、writer 选择和 runner 行为以 `docs/feature-workflow.md` 与 `src/workflows/` 为准。主 agent 负责拆任务、写 contract、把允许/禁止路径写入结构化 task config、审查 DAG/writeSet/profile/shell verification、盯验证与 handoff。微小任务或 DAG runtime 自身修复也应优先使用 DAG,或使用 one-shot `pi-prompt` / `cursor-prompt` escape hatch 并记录边界与验证证据。
64
+
65
+ ## 项目地图
66
+
67
+ - `CONTEXT.md`:项目术语表,定义 loop-agent、任务源、执行约束等领域语言
68
+ - `src/`:loop-agent 运行时代码
69
+ - `test/`:Vitest 测试套件
70
+ - `bin/loop-agent.js`:CLI 可执行入口
71
+ - `skills/`:loop-agent 和 DAG 模板引用的本地 skill 指令与参考资料;`init --profile full` 还会把同一份 skills 镜像到目标项目的 `.agents/skills/`(外部 agent 兼容路径,包内仍只带 `skills/`)。初始化还会向目标项目 `.gitignore` 合并 loop-agent managed block,忽略 `.harness/tasks/*`、`.harness/dag-runs/*`、`.harness/runs/*`、`.harness/init-surface.json`、`.harness/task-pool/*`、`.task-pool/`、`.worktrees/` 等运行态事实,但保留 `.harness/prompts/` 和目录占位可共享,不会整目录忽略 `.harness/`。
72
+ - `.harness/`:任务、DAG、run、cache 和 live state 等运行态目录
73
+ - `docs/`:治理文档、计划、报告和模板
74
+ - `website/`:Docusaurus 用户文档站
75
+ - `scripts/`:验证和维护脚本
76
+
77
+ ## 工作规则
78
+
79
+ - 每次任务只推进一个清晰、有边界的工作块。
80
+ - 保留无关的用户改动,不要回退自己没有做的修改。
81
+ - 优先沿用现有 helper、目录边界和局部模式,再考虑新增抽象。
82
+ - 长期决策写入 `docs/`,不要只留在聊天里。
83
+ - 面向使用者的新增、修改、删除或修复,应同步更新根目录 `CHANGELOG.md`;保持版本级摘要即可,不写过细技术细节。
84
+ - 面向用户的中文更新日志、README 和说明文档应使用自然、结果导向的表达:先说明用户能获得什么或问题如何改善,保留必要的命令和产品术语,避免逐字翻译、内部实现细节和无意义的中英混杂。
85
+ - 涉及 `loop-agent init` 或目标项目投影的改动,必须同步考虑目标项目生成物:`AGENTS.md`、`README.md`、`harness.json`、`docs/`、`scripts/`、`skills/`、`.agents/skills/`(skills 镜像)、`.harness/prompts`、`.gitignore`(loop-agent runtime managed block)和 npm 包内置 assets。
86
+ - 涉及初始化能力演化时,按 `docs/init-surface.manifest.json` `scripts/check-init-evolution-needed.sh` 分级处理:小改 advisory,中等 surface-check,高影响才需要模型审查;不要把所有小改动升级成重流程。
87
+ - 通用脚本、skill 和模板可以复制或投影;项目相关 README、验证命令、发布/维护脚本必须基于模板和目标项目真实文件生成,不假定目标项目是 TypeScriptNode、前端、后端或工具项目。
88
+ - 涉及 CLI commandskill entryruntime boundaryimport 方向或发布包范围时,同步更新对应文档、catalog/definition、治理脚本和测试,避免 READMEskill referenceCLI help、npm 包内容互相漂移。
89
+ - 完成相关更新后必须做文档收敛:如果 README、AGENTS.md、CHANGELOG.md、docs、skills、website、初始化生成模板或脚本说明不需要更新,应在交接里写明理由。
90
+ - 不提交占位实现。
91
+ - 没有新鲜验证证据时,不声明工作完成。
92
+ - 发现新 bug、技术债或契约漂移时,写回当前 plan、progress 或 report,而不是只在对话里提一句。
93
+ - 涉及 harness 流程变化时,优先把变化落到 `harness.json`、模板、脚本或治理文档,而不是只改提示词。
94
+
95
+ ## 验证
96
+
97
+ 用 `docs/verification-matrix.md` 选择命令。常用门禁:
98
+
99
+ ```bash
100
+ npm run typecheck
101
+ npm test
102
+ npm run build
103
+ node bin/loop-agent.js --help
104
+ bash scripts/check-repo.sh
105
+ bash scripts/ci.sh
106
+ ```
107
+
108
+ Windows 上运行 `scripts/*.sh` 时使用 Git Bash 或已配置的兼容 Bash。CLI、Node 代码、模板和提示词里的实际文件路径必须兼容 macOS 与 Windows:优先使用平台原生临时目录和 `path`/`os.tmpdir()`;仅在 repo 引用、JSON/Markdown 证据引用和 glob 约定中使用 `/` 作为稳定分隔符。
109
+
110
+ 文档站相关变更还需要按范围运行:
111
+
112
+ ```bash
113
+ npm run docs:build
114
+ ```
115
+
116
+ 按变更类型补充定向验证:
117
+
118
+ - 初始化能力或目标项目投影:运行 `test/init-command.test.ts`,并在临时目标项目执行 `loop-agent init --profile full --merge`、`loop-agent init doctor`、`loop-agent inspect`、`loop-agent docs audit` 和目标项目 `bash scripts/check-repo.sh`。
119
+ - init surface 或初始化能力演化:运行 `bash scripts/check-init-evolution-needed.sh` 和 `bash scripts/check-init-surface.sh`;高影响或发布前按需使用 `--strict` 并参考 `skills/init-capability-evolution/` `docs/templates/init-evolution-review.md`。
120
+ - runtime boundary / command registry / skill entry:运行 `bash scripts/check-architecture-boundaries.sh`、`bash scripts/check-command-registry-drift.sh`、`bash scripts/check-skill-entry.sh`,并确保 `bash scripts/check-repo.sh` 覆盖这些检查。
121
+ - 发布包范围:运行 `npm run build`、`node bin/loop-agent.js --help` 和 `npm pack --dry-run`,确认初始化所需静态资料在 package files 中。
122
+
123
+ ## 交接
124
+
125
+ 较大的工作结束时记录:
126
+
127
+ - 改了什么
128
+ - 为什么这样改
129
+ - 执行过哪些验证命令以及结果
130
+ - 是否影响契约、文档、测试或脚本
131
+ - 剩余风险
132
+ - 后续工作
133
+
134
+ ## 禁止事项
135
+
136
+ - 不要在未读相关文档的前提下直接大改。
137
+ - 不要一次混合重构、新功能和文档大迁移而没有清晰边界。
138
+ - 不要把仅存在于对话里的约束当作长期知识。
139
+ - 不要在缺少验证的情况下宣称完成。
140
+ - 不要假设系统没有某个能力;先搜索再判断。
141
+ - 不要用 stub、假数据通路或注释承诺替代真正交付。
142
+ - 不要把个人机器的绝对路径写入仓库级 `AGENTS.md`、README、模板或发布包资料;个人工具配置应留在用户级配置或本机会话上下文。
143
+ - 不要只更新 loop-agent 本仓库体验而遗漏目标项目初始化体验;新增能力如果不能通过 npm 内置资料或 `loop-agent init` 到达目标项目,必须写清原因和替代入口。