@tea-agent/loop-agent 0.2.1 → 0.4.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (135) hide show
  1. package/AGENTS.md +91 -87
  2. package/CHANGELOG.md +89 -52
  3. package/README.md +195 -180
  4. package/bin/agent-worker.js +22 -0
  5. package/bin/loop-agent.js +21 -21
  6. package/dist/application/dag/args.js +6 -0
  7. package/dist/application/dag/generate-task-dag.js +2 -0
  8. package/dist/application/dag/run-dag.js +3 -0
  9. package/dist/application/dag/validate-dag.js +40 -0
  10. package/dist/cli/command-definitions.js +2 -2
  11. package/dist/cli/program.js +24 -4
  12. package/dist/commands/init.js +1011 -459
  13. package/dist/commands/loop-benchmark.js +11 -11
  14. package/dist/commands/pi-reuse-benchmark.js +16 -16
  15. package/dist/executors/cursor-executor.js +1 -1
  16. package/dist/executors/dag-pi-executor.js +8 -1
  17. package/dist/task/runtime.js +27 -27
  18. package/dist/worker/cli.js +119 -0
  19. package/dist/worker/loop-agent/command-result.js +1 -0
  20. package/dist/worker/loop-agent/loop-agent-client.js +105 -0
  21. package/dist/worker/loop-agent/parse-json.js +14 -0
  22. package/dist/worker/materialize/harness-task-materializer.js +157 -0
  23. package/dist/worker/pool/failure-routing.js +98 -0
  24. package/dist/worker/pool/run-store.js +117 -0
  25. package/dist/worker/pool/types.js +1 -0
  26. package/dist/worker/preflight.js +108 -0
  27. package/dist/worker/profile-mapping.js +76 -0
  28. package/dist/worker/progress-reporter.js +81 -0
  29. package/dist/worker/report/morning-report.js +69 -0
  30. package/dist/worker/repos/repo-resolver.js +23 -0
  31. package/dist/worker/run-task/run-task.js +359 -0
  32. package/dist/worker/runner/run-ready.js +216 -0
  33. package/dist/worker/task-graph/acceptance-schema.js +25 -0
  34. package/dist/worker/task-graph/ready-queue.js +23 -0
  35. package/dist/worker/task-graph/task-graph-schema.js +28 -0
  36. package/dist/worker/task-graph/types.js +1 -0
  37. package/dist/worker/task-graph/validate.js +188 -0
  38. package/dist/worker/task-spec/complexity-mapping.js +8 -0
  39. package/dist/worker/task-spec/schema.js +116 -0
  40. package/dist/worker/task-spec/types.js +1 -0
  41. package/dist/worker/task-spec/validate.js +352 -0
  42. package/dist/workflows/dag/canvas-observer.js +275 -275
  43. package/dist/workflows/dag/dynamic-runtime/loop-until.js +2 -1
  44. package/dist/workflows/dag/dynamic-runtime/map.js +1 -0
  45. package/dist/workflows/dag/init-hybrid.js +3 -3
  46. package/dist/workflows/dag/skills.js +3 -3
  47. package/dist/workflows/dag/types.js +2 -0
  48. package/dist/workflows/dynamic/compile.js +11 -0
  49. package/dist/workflows/dynamic/spec.js +1 -0
  50. package/docs/README.md +72 -65
  51. package/docs/agent-dag-recovery-playbook.md +184 -184
  52. package/docs/agent-dag-runner.md +42 -40
  53. package/docs/architecture/runtime-boundaries.md +147 -147
  54. package/docs/cursor-executor-usage.md +25 -25
  55. package/docs/decisions/README.md +3 -3
  56. package/docs/design/README.md +36 -36
  57. package/docs/development-principles.md +73 -71
  58. package/docs/dynamic-workflow-dag-engine-roadmap.md +1749 -1749
  59. package/docs/exec-plans/README.md +6 -6
  60. package/docs/exec-plans/active/README.md +7 -10
  61. package/docs/exec-plans/completed/README.md +19 -9
  62. package/docs/feature-workflow.md +186 -186
  63. package/docs/harness-methodology-debugging.md +153 -153
  64. package/docs/harness-methodology-tdd.md +130 -130
  65. package/docs/harness-methodology-verification.md +27 -27
  66. package/docs/init-surface.manifest.json +175 -0
  67. package/docs/loop-agent-harness.md +42 -42
  68. package/docs/production-readiness.md +96 -96
  69. package/docs/progress/README.md +3 -3
  70. package/docs/reports/README.md +5 -5
  71. package/docs/skills/README.md +6 -0
  72. package/docs/skills/vetted-skill-registry.md +26 -0
  73. package/docs/templates/adr.md +60 -60
  74. package/docs/templates/agent-dag-authority-surface-audit.prompt.md +94 -94
  75. package/docs/templates/agent-dag-decision-envelope.schema.json +213 -213
  76. package/docs/templates/agent-dag-decision-gate-dogfood-report.md +117 -117
  77. package/docs/templates/agent-dag-decision-gate.prompt.md +246 -246
  78. package/docs/templates/agent-dag-process-supervisor.prompt.md +98 -98
  79. package/docs/templates/agent-dag-report.schema.json +454 -454
  80. package/docs/templates/agent-dag-review-verdict.prompt.md +68 -68
  81. package/docs/templates/agent-dag.base.json +195 -195
  82. package/docs/templates/agent-dag.final-verification.json +190 -190
  83. package/docs/templates/agent-dag.schema.json +316 -316
  84. package/docs/templates/agent-dag.supervised-implementation.json +500 -500
  85. package/docs/templates/exec-plan.md +64 -64
  86. package/docs/templates/feature-spec.md +53 -53
  87. package/docs/templates/hybrid-dag.json +193 -193
  88. package/docs/templates/init-evolution-review.md +33 -0
  89. package/docs/templates/production-readiness-checklist.md +57 -57
  90. package/docs/templates/progress-log.md +17 -17
  91. package/docs/templates/project-start-checklist.md +9 -9
  92. package/docs/templates/qa-report.md +48 -48
  93. package/docs/templates/sprint-contract.md +29 -29
  94. package/docs/verification-matrix.md +41 -41
  95. package/examples/decision-gate-agent-dag.json +123 -123
  96. package/examples/example-dag.json +51 -51
  97. package/examples/hybrid-loop-agent-dag.json +194 -194
  98. package/harness.json +94 -92
  99. package/package.json +66 -62
  100. package/skills/ai-engineering-context/SKILL.md +48 -48
  101. package/skills/code-review-core/SKILL.md +20 -0
  102. package/skills/codebase-scout/SKILL.md +19 -0
  103. package/skills/init-capability-evolution/SKILL.md +69 -0
  104. package/skills/loop-agent/SKILL.md +147 -145
  105. package/skills/loop-agent/references/README.md +67 -67
  106. package/skills/loop-agent/references/command-reference.md +403 -357
  107. package/skills/loop-agent/references/harness-policy.md +259 -258
  108. package/skills/loop-agent/references/hybrid-dag.md +216 -216
  109. package/skills/loop-agent/references/learned/README.md +21 -21
  110. package/skills/loop-agent/references/long-running-loop.md +59 -59
  111. package/skills/loop-agent/references/model-routing.md +36 -36
  112. package/skills/loop-agent/references/multi-worktree.md +54 -54
  113. package/skills/loop-agent/references/one-shot-runs.md +85 -85
  114. package/skills/loop-agent/references/orchestrator-and-interventions.md +169 -169
  115. package/skills/loop-agent/references/pi-prompt.md +23 -23
  116. package/skills/loop-agent/references/pi-subagent-assisted-mode.md +81 -81
  117. package/skills/loop-agent/references/post-implementation-and-patterns.md +44 -44
  118. package/skills/loop-agent/references/task-workflow.md +84 -84
  119. package/skills/loop-agent/references/verification-and-failure-handling.md +128 -128
  120. package/skills/requesting-code-review/SKILL.md +101 -101
  121. package/skills/requesting-code-review/code-reviewer.md +168 -168
  122. package/skills/systematic-debugging/CREATION-LOG.md +119 -119
  123. package/skills/systematic-debugging/SKILL.md +296 -296
  124. package/skills/systematic-debugging/condition-based-waiting-example.ts +158 -158
  125. package/skills/systematic-debugging/condition-based-waiting.md +115 -115
  126. package/skills/systematic-debugging/defense-in-depth.md +122 -122
  127. package/skills/systematic-debugging/find-polluter.sh +63 -63
  128. package/skills/systematic-debugging/root-cause-tracing.md +169 -169
  129. package/skills/systematic-debugging/test-academic.md +14 -14
  130. package/skills/systematic-debugging/test-pressure-1.md +58 -58
  131. package/skills/systematic-debugging/test-pressure-2.md +68 -68
  132. package/skills/systematic-debugging/test-pressure-3.md +69 -69
  133. package/skills/test-driven-development/SKILL.md +20 -0
  134. package/skills/verification-before-completion/SKILL.md +154 -154
  135. package/skills/webapp-testing/SKILL.md +19 -0
@@ -40,6 +40,9 @@ function dagRoleForNode(node) {
40
40
  function executorForAgentLikeNode(node) {
41
41
  return node.executor ?? "pi";
42
42
  }
43
+ function nodeSkillsField(node) {
44
+ return node.skills && node.skills.length > 0 ? { skills: node.skills } : {};
45
+ }
43
46
  function dagWriteFields(spec, node) {
44
47
  if (node?.writePolicy === "none") {
45
48
  return {
@@ -111,6 +114,7 @@ function compileHumanGateNode(spec, node) {
111
114
  executor: "pi",
112
115
  role: "supervisor",
113
116
  ...dagWriteFields(spec, node),
117
+ ...nodeSkillsField(node),
114
118
  decisionGate: { enabled: true, mode: "pause-on-human" },
115
119
  outputContract: node.approvalSchema
116
120
  ? `Workflow approvalSchema:\n${JSON.stringify(node.approvalSchema, null, 2)}`
@@ -172,6 +176,7 @@ function compileLoopBodyTask(spec, node) {
172
176
  dependsOn: node.dependsOn,
173
177
  executor,
174
178
  role: dagRoleForNode(node),
179
+ ...nodeSkillsField(node),
175
180
  complexity: node.type === "reduce_agent" ? "MED" : "LOW",
176
181
  subtaskPromptTemplate: buildAgentPrompt(node),
177
182
  staticResultTemplate: node.staticResultTemplate ?? node.transform?.template ?? undefined,
@@ -189,6 +194,7 @@ function compileLoopUntilNode(spec, node) {
189
194
  executor: "static",
190
195
  role: dagRoleForNode(node),
191
196
  ...dagWriteFields(spec, node),
197
+ ...nodeSkillsField(node),
192
198
  static: {
193
199
  resultMarkdown: `Dynamic loop_until barrier for ${node.id}.`,
194
200
  },
@@ -212,6 +218,7 @@ function compileAgentLikeNode(spec, node) {
212
218
  executor: "static",
213
219
  role: dagRoleForNode(node),
214
220
  ...dagWriteFields(spec, node),
221
+ ...nodeSkillsField(node),
215
222
  static: {
216
223
  resultMarkdown: node.staticResultTemplate ?? `Workflow node ${node.id} completed.`,
217
224
  },
@@ -226,6 +233,7 @@ function compileAgentLikeNode(spec, node) {
226
233
  executor: "pi",
227
234
  role: dagRoleForNode(node),
228
235
  ...dagWriteFields(spec, node),
236
+ ...nodeSkillsField(node),
229
237
  outputContract: stringifyOutputSchema(node.outputSchema),
230
238
  };
231
239
  }
@@ -258,6 +266,7 @@ function compileDynamicExpansionNode(spec, node) {
258
266
  const childTask = {
259
267
  executor: childExecutor,
260
268
  role: dagRoleForNode(node),
269
+ ...nodeSkillsField(node),
261
270
  complexity: "LOW",
262
271
  subtaskPromptTemplate: childPrompt,
263
272
  staticResultTemplate: node.staticResultTemplate,
@@ -273,6 +282,7 @@ function compileDynamicExpansionNode(spec, node) {
273
282
  writePolicy: "none",
274
283
  allowedPaths: [],
275
284
  forbiddenPaths: [],
285
+ ...nodeSkillsField(node),
276
286
  static: {
277
287
  resultMarkdown: `Dynamic ${node.type} expansion barrier for ${node.id}.`,
278
288
  },
@@ -299,6 +309,7 @@ function compileDynamicReductionNode(spec, node) {
299
309
  executor: "static",
300
310
  role: dagRoleForNode(node),
301
311
  ...dagWriteFields(spec, node),
312
+ ...nodeSkillsField(node),
302
313
  static: {
303
314
  resultMarkdown: `Dynamic reducer ${node.reducer?.type ?? "unknown"} for ${node.id}.`,
304
315
  },
@@ -46,6 +46,7 @@ export const workflowNodeSchema = z.object({
46
46
  dependsOn: z.array(z.string()).default([]),
47
47
  executor: z.enum(["pi", "static"]).optional(),
48
48
  role: z.string().optional(),
49
+ skills: z.array(z.string().min(1)).optional(),
49
50
  prompt: z.string().optional(),
50
51
  staticResultTemplate: z.string().optional(),
51
52
  writePolicy: z.enum(["none", "read-only", "exclusive"]).optional(),
package/docs/README.md CHANGED
@@ -1,65 +1,72 @@
1
- # 文档索引
2
-
3
- `docs/` 是 loop-agent 的治理根目录,包含工作流规则、方法论、验证规则、执行计划、报告、进度日志、决策记录和可复用模板。
4
-
5
- 顶层 `AGENTS.md` 是操作地图。长期知识应落在此处:决策、契约、计划、验证证据、调试笔记和可复用流程规则应记录在 `docs/` 下,而不是只留在聊天里。
6
-
7
- ## 核心文档
8
-
9
- - `development-principles.md` — 仓库开发原则
10
- - `architecture/runtime-boundaries.md` — runtime 层边界与依赖方向
11
- - `feature-workflow.md` — 有边界的功能工作流
12
- - `verification-matrix.md` — 验证命令选择
13
- - `production-readiness.md` — Production Readiness v0.1 范围、证据与 DAG hardening 标准
14
- - `loop-agent-harness.md` — runtime 与 command surface 概览
15
- - `agent-dag-runner.md` — Agent DAG runner 指南
16
- - `cursor-executor-usage.md` — Cursor executor 用法
17
- - `dynamic-workflow-dag-engine-roadmap.md` — Dynamic Workflow DAG Engine 路线图与适配分析
18
-
19
- ## 方法论
20
-
21
- - `harness-methodology-tdd.md` — 行为变更与 bug 修复的 TDD 纪律
22
- - `harness-methodology-verification.md` — 完成声明前的验证纪律
23
- - `harness-methodology-debugging.md` — 修复前的系统化调试工作流
24
-
25
- ## 产物目录
26
-
27
- - `design/README.md` — 设计草稿与实现契约
28
- - `exec-plans/active/README.md` — 进行中的执行计划
29
- - `exec-plans/completed/README.md` — 已完成的执行计划
30
- - `progress/README.md` — 进度交接日志
31
- - `reports/README.md` — 验证与审计报告
32
- - `decisions/README.md` — 架构决策
33
- - `templates/`可复用的规划、报告与 DAG 模板
34
-
35
- ## 仓库 Skills
36
-
37
- - `../skills/loop-agent/`loop-agent 自身的 skill 指令与参考资料
38
- - 每个额外 skill 在仓库根 `../skills/` 下使用独立子目录;这些本地副本由 DAG 模板引用,维护不依赖外部 agent skill 目录
39
-
40
- ## 模板
41
-
42
- - `templates/project-start-checklist.md` — 开工前检查清单
43
- - `templates/feature-spec.md`有边界的功能规格
44
- - `templates/sprint-contract.md` 实现契约与验收标准
45
- - `templates/exec-plan.md` — 非平凡工作的执行计划
46
- - `templates/progress-log.md` — 进度与交接日志
47
- - `templates/qa-report.md` — 验证与 QA 证据
48
- - `templates/production-readiness-checklist.md` — 低/中风险单仓库 DAG readiness 检查清单
49
- - `templates/adr.md` — 架构决策记录(ADR)
50
-
51
- ## 维护
52
-
53
- 文档变更后运行:
54
-
55
- ```bash
56
- bash scripts/check-repo.sh
57
- ```
58
-
59
- Windows 上通过 Git Bash 或已配置的兼容 Bash 运行脚本。实际文件操作使用平台原生路径;`/` 仅用于 repo 引用、JSON/Markdown 证据引用和 glob 约定。
60
-
61
- 完整本地门禁:
62
-
63
- ```bash
64
- bash scripts/ci.sh
65
- ```
1
+ # 文档索引
2
+
3
+ `docs/` 是 loop-agent 的治理根目录,包含工作流规则、方法论、验证规则、执行计划、报告、进度日志、决策记录和可复用模板。
4
+
5
+ 顶层 `AGENTS.md` 是操作地图。长期知识应落在此处:决策、契约、计划、验证证据、调试笔记和可复用流程规则应记录在 `docs/` 下,而不是只留在聊天里。
6
+
7
+ ## 核心文档
8
+
9
+ - `development-principles.md` — 仓库开发原则
10
+ - `architecture/runtime-boundaries.md` — runtime 层边界与依赖方向
11
+ - `feature-workflow.md` — 有边界的功能工作流
12
+ - `verification-matrix.md` — 验证命令选择
13
+ - `production-readiness.md` — Production Readiness v0.1 范围、证据与 DAG hardening 标准
14
+ - `loop-agent-harness.md` — runtime 与 command surface 概览
15
+ - `agent-dag-runner.md` — Agent DAG runner 指南
16
+ - `cursor-executor-usage.md` — Cursor executor 用法
17
+ - `dynamic-workflow-dag-engine-roadmap.md` — Dynamic Workflow DAG Engine 路线图与适配分析
18
+ - `init-surface.manifest.json` — npm 包范围、目标项目初始化投影与 `init check-update` surface 分类的机器校验契约
19
+
20
+ ## 设计思想来源
21
+
22
+ - `../website/docs/practices/` — Anthropic 长时运行 agent harness、OpenAI Codex harness engineering、腾讯端到端 Harness Engineering 与社区 agent harness 实践资料。当前仓库的“人类掌舵、智能体执行”、仓库即记录系统、小步增量、结构化 handoff 和 shell verification 纪律均受这些实践启发;权威执行规则仍以本目录治理文档、根目录 AGENTS.md、harness.json、skills 目录和脚本检查为准。
23
+
24
+ ## 方法论
25
+
26
+ - `harness-methodology-tdd.md` — 行为变更与 bug 修复的 TDD 纪律
27
+ - `harness-methodology-verification.md` — 完成声明前的验证纪律
28
+ - `harness-methodology-debugging.md` — 修复前的系统化调试工作流
29
+
30
+ ## 产物目录
31
+
32
+ - `design/README.md` — 设计草稿与实现契约
33
+ - `exec-plans/active/README.md`进行中的执行计划
34
+ - `exec-plans/completed/README.md` — 已完成的执行计划
35
+ - `progress/README.md` — 进度交接日志
36
+ - `reports/README.md` — 验证与审计报告
37
+ - `decisions/README.md`架构决策
38
+ - `skills/README.md` repo-local skill registry and vetting notes
39
+ - `templates/` — 可复用的规划、报告与 DAG 模板
40
+
41
+ ## 仓库 Skills
42
+
43
+ - `../skills/loop-agent/`loop-agent 自身的 skill 指令与参考资料
44
+ - 每个额外 skill 在仓库根 `../skills/` 下使用独立子目录;这些本地副本由 DAG 模板引用,维护不依赖外部 agent skill 目录
45
+
46
+ ## 模板
47
+
48
+ - `templates/project-start-checklist.md` — 开工前检查清单
49
+ - `templates/feature-spec.md` — 有边界的功能规格
50
+ - `templates/sprint-contract.md` — 实现契约与验收标准
51
+ - `templates/exec-plan.md` — 非平凡工作的执行计划
52
+ - `templates/progress-log.md` — 进度与交接日志
53
+ - `templates/qa-report.md` — 验证与 QA 证据
54
+ - `templates/production-readiness-checklist.md` — 低/中风险单仓库 DAG readiness 检查清单
55
+ - `templates/init-evolution-review.md` — 初始化能力演化审查报告模板
56
+ - `templates/adr.md` — 架构决策记录(ADR)
57
+
58
+ ## 维护
59
+
60
+ 文档变更后运行:
61
+
62
+ ```bash
63
+ bash scripts/check-repo.sh
64
+ ```
65
+
66
+ Windows 上通过 Git Bash 或已配置的兼容 Bash 运行脚本。实际文件操作使用平台原生路径;`/` 仅用于 repo 引用、JSON/Markdown 证据引用和 glob 约定。
67
+
68
+ 完整本地门禁:
69
+
70
+ ```bash
71
+ bash scripts/ci.sh
72
+ ```
@@ -1,184 +1,184 @@
1
- # Agent DAG Recovery Playbook(恢复手册)
2
-
3
- > **关联**:[`agent-dag-runner.md`](agent-dag-runner.md)(CLI 与 run 语义)· [`templates/agent-dag-decision-gate.prompt.md`](templates/agent-dag-decision-gate.prompt.md)(Decision Gate 消费 recovery 证据)
4
-
5
- ## 定位
6
-
7
- Agent DAG **recovery planning 是只读、派生、advisory** 的。`dag report` 与 `buildDagDecisionGateEvidence()` 从 `.harness/dag-runs/` 的 canonical facts 聚合 `normalizedFailureCategory` → `recoveryRecommendation`,供人工或 Decision Gate prompt 消费。
8
-
9
- Production Readiness v0.1 在 normalized DAG category 之上增加 product-line routing。Report 与 doctor 输出应保留 raw DAG fact 并派生,不重写已完成 facts:
10
-
11
- ```text
12
- raw_failure_category
13
- dag_normalized_failure_category
14
- product_line_failure_category
15
- recommended_follow_up
16
- ```
17
-
18
- Product-line taxonomy 定义见 `design/state-and-failure-taxonomy.md`。
19
-
20
- **非目标(本 playbook 不覆盖、runner 不实现):**
21
-
22
- - 自动 retry / resume 节点执行
23
- - 修改 `completed/` 或 `paused/` 下的历史 run facts
24
- - 把 `autoRetryEligible` 当作 runtime 触发器
25
- - 仅凭 recovery 派生字段自动 approve Decision Gate
26
-
27
- ## 快速命令
28
-
29
- ```bash
30
- cd .
31
-
32
- # 全局 runtime 健康(active/paused/completed 摘要 + healthIssues;advisoryOnly)
33
- npm run dev -- dag doctor
34
-
35
- # 单 run 生命周期(approvalFlow、hasHumanApproval、nextRecommendedAction)
36
- npm run dev -- dag status --run-id <run-id>
37
-
38
- # 聚焦最新 paused run(--paused-latest ≡ --lifecycle paused --latest)
39
- npm run dev -- dag report --paused-latest [--json|--markdown]
40
-
41
- # 默认 compact Markdown 表格
42
- npm run dev -- dag report --run-id <run-id>
43
-
44
- # 机器可读 JSON(含 primaryFailure / primaryRecovery / downstreamSkippedNodes)
45
- npm run dev -- dag report --run-id <run-id> --json
46
-
47
- # 人类交接 Recovery Plan(四段结构化 Markdown)
48
- npm run dev -- dag report --run-id <run-id> --markdown
49
-
50
- # 过滤器
51
- npm run dev -- dag report --failed-only # 仅失败/需恢复
52
- npm run dev -- dag report --latest --failed-only # 最新一条需恢复 run
53
- npm run dev -- dag report --action retry-node # 按 primaryRecovery.action 筛选
54
- npm run dev -- dag report --lifecycle paused --action resume-or-reject
55
-
56
- # Decision Gate envelope dry-run(不 resume/retry;validate 无效时 exit 1)
57
- npm run dev -- dag decision inspect --run-id <run-id> [--node-id <node-id>]
58
- npm run dev -- dag decision validate --run-id <run-id> [--node-id <node-id>]
59
- ```
60
-
61
- ### Paused run operator 路径
62
-
63
- 1. `dag report --paused-latest --json` 或 `dag doctor` — 定位最新 paused run 与 `primaryRecovery`
64
- 2. `dag status --run-id <id>` — 读 `approvalFlow`、`escalationArtifactPath`、`pendingNodes`
65
- 3. (可选)`dag decision validate --run-id <id>` — envelope preflight
66
- 4. `dag approve --run-id <id> --option <option-id>` → `dag resume --run-id <id>`;或 `dag reject --run-id <id> --reason "..."`
67
-
68
- 精确 approval 顺序见 [`agent-dag-runner.md`](agent-dag-runner.md) §Paused lifecycle。
69
-
70
- Decision Gate prompt 侧:`buildDagDecisionGateEvidence()`(`./src/core/dag-decision-evidence.ts`)从 `DagRunReportEntry` 生成 prompt-friendly 摘要,字段与 JSON report 对齐,**不**写回 run state。
71
-
72
- ## `dag report --json` schema 锁定
73
-
74
- - **Schema 文件**:`docs/templates/agent-dag-report.schema.json`
75
- - **Envelope**:`{ schemaVersion: 1, runs: DagRunReportEntry[] }`
76
- - **稳定消费字段**(Decision Gate / tooling 应依赖):`primaryFailure`、`primaryRecovery`、`downstreamSkippedNodes`、`recoveryRecommendation`、`normalizedFailureCategory`;node 级 `decisionEnvelope`、`artifacts`;paused 级 `pausedByNodeId`、`pauseReason`
77
- - **测试**:`./test/dag-report.test.ts` §`dag report JSON schema contract` 对 fixture run 做 schema 校验
78
- - **变更策略**:breaking 字段变更须 bump `schemaVersion` 并同步 schema 文件与测试
79
-
80
- ## Recovery Action 枚举
81
-
82
- | Action | 含义 | 典型触发 |
83
- |--------|------|----------|
84
- | `none` | 无需恢复 | 成功完成 |
85
- | `monitor` | 进行中,等待结束 | `PENDING` / `RUNNING` |
86
- | `retry-node` | 修复瞬态条件后可重跑节点 | timeout;executor 瞬态(network/quota/rate-limit/unavailable) |
87
- | `rerun-after-fix` | 先修根因再重跑 | auth、validation、shell-command、static-error、非瞬态 executor |
88
- | `resume-or-reject` | 人工审批后继续或拒绝 | paused + decision-envelope / human-required |
89
- | `manual-review` | 人工审查后再定路径 | write-guard、human-rejected、unknown、非 paused 的 decision-envelope |
90
- | `inspect-upstream` | 先查上游失败 | SKIPPED 下游节点 |
91
- | `unknown` | 未映射类别(不应出现在正常派生路径) | 内部兜底 |
92
-
93
- ## Product-Line Routing v0.1
94
-
95
- | Product-line category | Default follow-up |
96
- |---|---|
97
- | `SpecUnclear` | `spec-clarification` |
98
- | `ContractMismatch` | `architecture-contract-fix` |
99
- | `ProductBug` | `dev-fix` |
100
- | `TestBug` | `qa-fix-test` |
101
- | `EnvFailure` | `env-fix` 或 retry verify |
102
- | `FlakyTest` | `flaky-test-analysis` |
103
- | `RiskyChange` | `human-review` / `architecture-review` |
104
- | `DependencyFailure` | unblock dependency |
105
- | `NeedsHuman` | `human-review` |
106
- | `Unknown` | human triage |
107
-
108
- ## 类别 → 动作 → operator 指引
109
-
110
- | Normalized category | Recovery action | Operator guidance | Anti-patterns |
111
- |---------------------|-----------------|-------------------|---------------|
112
- | `success` | `none` | 归档验收;按需 review artifacts | 对成功 run 发起 retry |
113
- | `timeout` | `retry-node` | 查日志/artifacts 确认瞬态;人工重跑节点 | 未查根因就循环重试;指望 runner 自动 retry |
114
- | `executor`(network/quota/rate-limit/unavailable) | `retry-node` | 等后端/配额恢复后重跑 | 把 auth/validation 误判为瞬态 executor |
115
- | `executor`(其他 raw) | `rerun-after-fix` | 查 executor.jsonl、node result | 盲目 retry 非瞬态 backend 错误 |
116
- | `auth` | `rerun-after-fix` | 更新 API key/凭证后重跑 | 在凭证未修复时 retry |
117
- | `write-guard` | `manual-review` | 审 writeSet/writePolicy、prompt、result.summary | read-only 节点写根 `artifacts/`;扩大 writeSet 掩盖违规 |
118
- | `validation` | `rerun-after-fix` | 修 schema/output/test 后再跑 | 跳过验证直接 approve |
119
- | `shell-command` | `rerun-after-fix` | 读 stdout/stderr、修命令或 repo 状态 | 只重跑 shell 不改命令 |
120
- | `static-error` | `rerun-after-fix` | 查 static config 与 emitted markdown | 当 LLM 节点 retry |
121
- | `decision-envelope`(paused) | `resume-or-reject` | `dag approve --run-id <id> --option <option-id>` / `dag reject --run-id <id> --reason "..."` → `dag resume --run-id <id>` | 未读 envelope 就 approve;用 recovery 字段单独 auto-approve |
122
- | `decision-envelope`(非 paused) | `manual-review` | 读 decision.envelope.json / validation artifact | 绕过 Decision Gate schema |
123
- | `human-required`(paused) | `resume-or-reject` | 提供人工输入 → approve/resume | 在 escalation 未解决时 resume |
124
- | `human-required`(非 paused) | `manual-review` | 读 human-escalation artifacts | 忽略 `requiresHuman` |
125
- | `human-rejected` | `manual-review` | 修订 contract/source;**新 run** | 对同一 contract 自动 retry |
126
- | `skipped` | `inspect-upstream` | 修上游 ERROR/SKIPPED 再考虑下游 | 直接 retry SKIPPED 节点 |
127
- | `unknown` | `manual-review` | 读 state.json、executor.jsonl、node artifacts | 假设 `autoRetryEligible` 会触发执行 |
128
-
129
- ## Handoff Recovery Plan 结构
130
-
131
- `dag report --markdown` 的 **Recovery Plan** 含四段(与 JSON 稳定字段一一对应):
132
-
133
- 1. **Primary Failure** — `primaryFailure`(node 或 run scope)
134
- 2. **Recovery Action** — `primaryRecovery`(action、summary、reason、flags、commandHint)
135
- 3. **Blocked Downstream / Skipped Nodes** — `downstreamSkippedNodes`
136
- 4. **Recommended Operator Action** — 面向 operator 的步骤摘要
137
-
138
- 保存 handoff 时重定向到平台临时目录或 `docs/reports/`,不要写入 `.harness/dag-runs/`。
139
-
140
- ## Decision Gate 消费约定
141
-
142
- 1. 优先 `dag report --json` 或 `buildDagDecisionGateEvidence()` 的 **verified** 派生摘要。
143
- 2. 映射到 `decision` / `nextAction` 须保守;recovery 证据是 **advisory only, not an execution directive**。
144
- 3. `autoRetryEligible: true` 仅表示「规划上可人工重试」,**不**触发 runner。
145
- 4. paused run 的人类路径仍是 M5 CLI:`dag approve --run-id <id> --option <option-id>` / `dag reject --run-id <id> --reason "..."` / `dag resume --run-id <id>`(见 [`agent-dag-runner.md`](agent-dag-runner.md) §Decision Gate)。
146
- 5. Envelope 干跑:`dag decision inspect|validate` 重解析 run facts;`validate` 无效时 exit 1;**不**写 artifact、**不** resume。
147
-
148
- ## Active stale run recovery(advisory detection)
149
-
150
- `dag doctor` 与 `dag status` 通过 `detectDagRunHealthIssues()` 检测 lifecycle 不一致,**不** mutate run facts。
151
-
152
- | Code | 典型场景 | operator 指引 |
153
- |------|----------|------------|
154
- | `terminal-in-active` | run 已完成但 `active/<run-id>/` 残留 | 对照 `completed/` canonical facts;手动 archive 或删除 stale 目录 |
155
- | `paused-in-active` | pause 后目录未迁至 `paused/` | `dag doctor` 诊断;修复 facts 后再 approve/resume |
156
- | `lifecycle-status-mismatch` | `paused/` 下 status 非 paused | 同上 |
157
- | `missing-approval-artifact` | approve 后 artifact 缺失 | 勿 resume;re-approve 或 restore artifact |
158
- | `non-terminal-in-completed` | completed 目录 status 异常 | manual-review only |
159
- | `run-id-mismatch` / `missing-state-json` | 目录损坏或命名错误 | Inspect;勿 auto-mutate completed facts |
160
-
161
- **Deferred runtime**:无 `dag recover apply` 或自动 cleanup;未来可能增加只读 `dag recover plan`(设计占位,未实现)。
162
-
163
- ## 事实源与边界
164
-
165
- | 类型 | 位置 | 规则 |
166
- |------|------|------|
167
- | Canonical run facts | `.harness/dag-runs/{active\|paused\|completed}/<run-id>/` | **只读**;report 不写回 |
168
- | 派生 report | stdout / 重定向文件 | 可随时再生 |
169
- | 工作块摘要 | 根 `artifacts/` | 非 per-run 历史;read-only DAG 节点不得写 |
170
-
171
- ## 验证
172
-
173
- ```bash
174
- cd . && npx vitest run \
175
- test/dag-report.test.ts \
176
- test/dag-recovery-recommendation.test.ts \
177
- test/dag-decision-gate-recovery-dogfood.test.ts \
178
- test/dag-decision-evidence.test.ts \
179
- test/dag-decision-envelope.test.ts \
180
- test/dag-approve-resume.test.ts \
181
- test/cli-contract.test.ts
182
- ```
183
-
184
- 实现细节与映射逻辑:`./src/core/dag-recovery-recommendation.ts`、`dag-report.ts`、`dag-decision-evidence.ts`。
1
+ # Agent DAG Recovery Playbook(恢复手册)
2
+
3
+ > **关联**:[`agent-dag-runner.md`](agent-dag-runner.md)(CLI 与 run 语义)· [`templates/agent-dag-decision-gate.prompt.md`](templates/agent-dag-decision-gate.prompt.md)(Decision Gate 消费 recovery 证据)
4
+
5
+ ## 定位
6
+
7
+ Agent DAG **recovery planning 是只读、派生、advisory** 的。`dag report` 与 `buildDagDecisionGateEvidence()` 从 `.harness/dag-runs/` 的 canonical facts 聚合 `normalizedFailureCategory` → `recoveryRecommendation`,供人工或 Decision Gate prompt 消费。
8
+
9
+ Production Readiness v0.1 在 normalized DAG category 之上增加 product-line routing。Report 与 doctor 输出应保留 raw DAG fact 并派生,不重写已完成 facts:
10
+
11
+ ```text
12
+ raw_failure_category
13
+ dag_normalized_failure_category
14
+ product_line_failure_category
15
+ recommended_follow_up
16
+ ```
17
+
18
+ Product-line taxonomy 定义见 `design/state-and-failure-taxonomy.md`。
19
+
20
+ **非目标(本 playbook 不覆盖、runner 不实现):**
21
+
22
+ - 自动 retry / resume 节点执行
23
+ - 修改 `completed/` 或 `paused/` 下的历史 run facts
24
+ - 把 `autoRetryEligible` 当作 runtime 触发器
25
+ - 仅凭 recovery 派生字段自动 approve Decision Gate
26
+
27
+ ## 快速命令
28
+
29
+ ```bash
30
+ cd .
31
+
32
+ # 全局 runtime 健康(active/paused/completed 摘要 + healthIssues;advisoryOnly)
33
+ npm run dev -- dag doctor
34
+
35
+ # 单 run 生命周期(approvalFlow、hasHumanApproval、nextRecommendedAction)
36
+ npm run dev -- dag status --run-id <run-id>
37
+
38
+ # 聚焦最新 paused run(--paused-latest ≡ --lifecycle paused --latest)
39
+ npm run dev -- dag report --paused-latest [--json|--markdown]
40
+
41
+ # 默认 compact Markdown 表格
42
+ npm run dev -- dag report --run-id <run-id>
43
+
44
+ # 机器可读 JSON(含 primaryFailure / primaryRecovery / downstreamSkippedNodes)
45
+ npm run dev -- dag report --run-id <run-id> --json
46
+
47
+ # 人类交接 Recovery Plan(四段结构化 Markdown)
48
+ npm run dev -- dag report --run-id <run-id> --markdown
49
+
50
+ # 过滤器
51
+ npm run dev -- dag report --failed-only # 仅失败/需恢复
52
+ npm run dev -- dag report --latest --failed-only # 最新一条需恢复 run
53
+ npm run dev -- dag report --action retry-node # 按 primaryRecovery.action 筛选
54
+ npm run dev -- dag report --lifecycle paused --action resume-or-reject
55
+
56
+ # Decision Gate envelope dry-run(不 resume/retry;validate 无效时 exit 1)
57
+ npm run dev -- dag decision inspect --run-id <run-id> [--node-id <node-id>]
58
+ npm run dev -- dag decision validate --run-id <run-id> [--node-id <node-id>]
59
+ ```
60
+
61
+ ### Paused run operator 路径
62
+
63
+ 1. `dag report --paused-latest --json` 或 `dag doctor` — 定位最新 paused run 与 `primaryRecovery`
64
+ 2. `dag status --run-id <id>` — 读 `approvalFlow`、`escalationArtifactPath`、`pendingNodes`
65
+ 3. (可选)`dag decision validate --run-id <id>` — envelope preflight
66
+ 4. `dag approve --run-id <id> --option <option-id>` → `dag resume --run-id <id>`;或 `dag reject --run-id <id> --reason "..."`
67
+
68
+ 精确 approval 顺序见 [`agent-dag-runner.md`](agent-dag-runner.md) §Paused lifecycle。
69
+
70
+ Decision Gate prompt 侧:`buildDagDecisionGateEvidence()`(`./src/core/dag-decision-evidence.ts`)从 `DagRunReportEntry` 生成 prompt-friendly 摘要,字段与 JSON report 对齐,**不**写回 run state。
71
+
72
+ ## `dag report --json` schema 锁定
73
+
74
+ - **Schema 文件**:`docs/templates/agent-dag-report.schema.json`
75
+ - **Envelope**:`{ schemaVersion: 1, runs: DagRunReportEntry[] }`
76
+ - **稳定消费字段**(Decision Gate / tooling 应依赖):`primaryFailure`、`primaryRecovery`、`downstreamSkippedNodes`、`recoveryRecommendation`、`normalizedFailureCategory`;node 级 `decisionEnvelope`、`artifacts`;paused 级 `pausedByNodeId`、`pauseReason`
77
+ - **测试**:`./test/dag-report.test.ts` §`dag report JSON schema contract` 对 fixture run 做 schema 校验
78
+ - **变更策略**:breaking 字段变更须 bump `schemaVersion` 并同步 schema 文件与测试
79
+
80
+ ## Recovery Action 枚举
81
+
82
+ | Action | 含义 | 典型触发 |
83
+ |--------|------|----------|
84
+ | `none` | 无需恢复 | 成功完成 |
85
+ | `monitor` | 进行中,等待结束 | `PENDING` / `RUNNING` |
86
+ | `retry-node` | 修复瞬态条件后可重跑节点 | timeout;executor 瞬态(network/quota/rate-limit/unavailable) |
87
+ | `rerun-after-fix` | 先修根因再重跑 | auth、validation、shell-command、static-error、非瞬态 executor |
88
+ | `resume-or-reject` | 人工审批后继续或拒绝 | paused + decision-envelope / human-required |
89
+ | `manual-review` | 人工审查后再定路径 | write-guard、human-rejected、unknown、非 paused 的 decision-envelope |
90
+ | `inspect-upstream` | 先查上游失败 | SKIPPED 下游节点 |
91
+ | `unknown` | 未映射类别(不应出现在正常派生路径) | 内部兜底 |
92
+
93
+ ## Product-Line Routing v0.1
94
+
95
+ | Product-line category | Default follow-up |
96
+ |---|---|
97
+ | `SpecUnclear` | `spec-clarification` |
98
+ | `ContractMismatch` | `architecture-contract-fix` |
99
+ | `ProductBug` | `dev-fix` |
100
+ | `TestBug` | `qa-fix-test` |
101
+ | `EnvFailure` | `env-fix` 或 retry verify |
102
+ | `FlakyTest` | `flaky-test-analysis` |
103
+ | `RiskyChange` | `human-review` / `architecture-review` |
104
+ | `DependencyFailure` | unblock dependency |
105
+ | `NeedsHuman` | `human-review` |
106
+ | `Unknown` | human triage |
107
+
108
+ ## 类别 → 动作 → operator 指引
109
+
110
+ | Normalized category | Recovery action | Operator guidance | Anti-patterns |
111
+ |---------------------|-----------------|-------------------|---------------|
112
+ | `success` | `none` | 归档验收;按需 review artifacts | 对成功 run 发起 retry |
113
+ | `timeout` | `retry-node` | 查日志/artifacts 确认瞬态;人工重跑节点 | 未查根因就循环重试;指望 runner 自动 retry |
114
+ | `executor`(network/quota/rate-limit/unavailable) | `retry-node` | 等后端/配额恢复后重跑 | 把 auth/validation 误判为瞬态 executor |
115
+ | `executor`(其他 raw) | `rerun-after-fix` | 查 executor.jsonl、node result | 盲目 retry 非瞬态 backend 错误 |
116
+ | `auth` | `rerun-after-fix` | 更新 API key/凭证后重跑 | 在凭证未修复时 retry |
117
+ | `write-guard` | `manual-review` | 审 writeSet/writePolicy、prompt、result.summary | read-only 节点写根 `artifacts/`;扩大 writeSet 掩盖违规 |
118
+ | `validation` | `rerun-after-fix` | 修 schema/output/test 后再跑 | 跳过验证直接 approve |
119
+ | `shell-command` | `rerun-after-fix` | 读 stdout/stderr、修命令或 repo 状态 | 只重跑 shell 不改命令 |
120
+ | `static-error` | `rerun-after-fix` | 查 static config 与 emitted markdown | 当 LLM 节点 retry |
121
+ | `decision-envelope`(paused) | `resume-or-reject` | `dag approve --run-id <id> --option <option-id>` / `dag reject --run-id <id> --reason "..."` → `dag resume --run-id <id>` | 未读 envelope 就 approve;用 recovery 字段单独 auto-approve |
122
+ | `decision-envelope`(非 paused) | `manual-review` | 读 decision.envelope.json / validation artifact | 绕过 Decision Gate schema |
123
+ | `human-required`(paused) | `resume-or-reject` | 提供人工输入 → approve/resume | 在 escalation 未解决时 resume |
124
+ | `human-required`(非 paused) | `manual-review` | 读 human-escalation artifacts | 忽略 `requiresHuman` |
125
+ | `human-rejected` | `manual-review` | 修订 contract/source;**新 run** | 对同一 contract 自动 retry |
126
+ | `skipped` | `inspect-upstream` | 修上游 ERROR/SKIPPED 再考虑下游 | 直接 retry SKIPPED 节点 |
127
+ | `unknown` | `manual-review` | 读 state.json、executor.jsonl、node artifacts | 假设 `autoRetryEligible` 会触发执行 |
128
+
129
+ ## Handoff Recovery Plan 结构
130
+
131
+ `dag report --markdown` 的 **Recovery Plan** 含四段(与 JSON 稳定字段一一对应):
132
+
133
+ 1. **Primary Failure** — `primaryFailure`(node 或 run scope)
134
+ 2. **Recovery Action** — `primaryRecovery`(action、summary、reason、flags、commandHint)
135
+ 3. **Blocked Downstream / Skipped Nodes** — `downstreamSkippedNodes`
136
+ 4. **Recommended Operator Action** — 面向 operator 的步骤摘要
137
+
138
+ 保存 handoff 时重定向到平台临时目录或 `docs/reports/`,不要写入 `.harness/dag-runs/`。
139
+
140
+ ## Decision Gate 消费约定
141
+
142
+ 1. 优先 `dag report --json` 或 `buildDagDecisionGateEvidence()` 的 **verified** 派生摘要。
143
+ 2. 映射到 `decision` / `nextAction` 须保守;recovery 证据是 **advisory only, not an execution directive**。
144
+ 3. `autoRetryEligible: true` 仅表示「规划上可人工重试」,**不**触发 runner。
145
+ 4. paused run 的人类路径仍是 M5 CLI:`dag approve --run-id <id> --option <option-id>` / `dag reject --run-id <id> --reason "..."` / `dag resume --run-id <id>`(见 [`agent-dag-runner.md`](agent-dag-runner.md) §Decision Gate)。
146
+ 5. Envelope 干跑:`dag decision inspect|validate` 重解析 run facts;`validate` 无效时 exit 1;**不**写 artifact、**不** resume。
147
+
148
+ ## Active stale run recovery(advisory detection)
149
+
150
+ `dag doctor` 与 `dag status` 通过 `detectDagRunHealthIssues()` 检测 lifecycle 不一致,**不** mutate run facts。
151
+
152
+ | Code | 典型场景 | operator 指引 |
153
+ |------|----------|------------|
154
+ | `terminal-in-active` | run 已完成但 `active/<run-id>/` 残留 | 对照 `completed/` canonical facts;手动 archive 或删除 stale 目录 |
155
+ | `paused-in-active` | pause 后目录未迁至 `paused/` | `dag doctor` 诊断;修复 facts 后再 approve/resume |
156
+ | `lifecycle-status-mismatch` | `paused/` 下 status 非 paused | 同上 |
157
+ | `missing-approval-artifact` | approve 后 artifact 缺失 | 勿 resume;re-approve 或 restore artifact |
158
+ | `non-terminal-in-completed` | completed 目录 status 异常 | manual-review only |
159
+ | `run-id-mismatch` / `missing-state-json` | 目录损坏或命名错误 | Inspect;勿 auto-mutate completed facts |
160
+
161
+ **Deferred runtime**:无 `dag recover apply` 或自动 cleanup;未来可能增加只读 `dag recover plan`(设计占位,未实现)。
162
+
163
+ ## 事实源与边界
164
+
165
+ | 类型 | 位置 | 规则 |
166
+ |------|------|------|
167
+ | Canonical run facts | `.harness/dag-runs/{active\|paused\|completed}/<run-id>/` | **只读**;report 不写回 |
168
+ | 派生 report | stdout / 重定向文件 | 可随时再生 |
169
+ | 工作块摘要 | 根 `artifacts/` | 非 per-run 历史;read-only DAG 节点不得写 |
170
+
171
+ ## 验证
172
+
173
+ ```bash
174
+ cd . && npx vitest run \
175
+ test/dag-report.test.ts \
176
+ test/dag-recovery-recommendation.test.ts \
177
+ test/dag-decision-gate-recovery-dogfood.test.ts \
178
+ test/dag-decision-evidence.test.ts \
179
+ test/dag-decision-envelope.test.ts \
180
+ test/dag-approve-resume.test.ts \
181
+ test/cli-contract.test.ts
182
+ ```
183
+
184
+ 实现细节与映射逻辑:`./src/core/dag-recovery-recommendation.ts`、`dag-report.ts`、`dag-decision-evidence.ts`。