@tea-agent/loop-agent 0.5.0 → 0.7.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (136) hide show
  1. package/AGENTS.md +142 -142
  2. package/CHANGELOG.md +132 -98
  3. package/README.md +195 -195
  4. package/bin/agent-worker.js +22 -22
  5. package/bin/loop-agent.js +21 -21
  6. package/dist/application/dag/args.js +9 -1
  7. package/dist/application/dag/run-dag.js +16 -2
  8. package/dist/cli/command-definitions.js +22 -4
  9. package/dist/cli/help.js +3 -2
  10. package/dist/cli/program.js +7 -5
  11. package/dist/commands/import-prd.js +76 -0
  12. package/dist/commands/init.js +467 -457
  13. package/dist/commands/instructions.js +90 -58
  14. package/dist/commands/loop-benchmark.js +11 -11
  15. package/dist/commands/pi-reuse-benchmark.js +16 -16
  16. package/dist/executors/cursor-executor.js +1 -1
  17. package/dist/executors/dag-pi-executor.js +1 -0
  18. package/dist/executors/pi-sdk-executor.js +63 -1
  19. package/dist/shared/preview.js +39 -0
  20. package/dist/task/config-types.js +3 -0
  21. package/dist/task/runtime.js +27 -27
  22. package/dist/task/source-references.js +221 -0
  23. package/dist/worker/cli.js +62 -1
  24. package/dist/worker/loop-agent/loop-agent-client.js +97 -5
  25. package/dist/worker/materialize/harness-task-materializer.js +166 -5
  26. package/dist/worker/observability/event-store.js +82 -0
  27. package/dist/worker/observability/events.js +79 -0
  28. package/dist/worker/observability/progress-composite.js +33 -0
  29. package/dist/worker/observability/read-model.js +1013 -0
  30. package/dist/worker/observability/snapshot-store.js +43 -0
  31. package/dist/worker/observability/types.js +1 -0
  32. package/dist/worker/observe/paths.js +64 -0
  33. package/dist/worker/observe/routes.js +423 -0
  34. package/dist/worker/observe/server.js +61 -0
  35. package/dist/worker/observe/static/app.js +1419 -0
  36. package/dist/worker/observe/static/index.html +63 -0
  37. package/dist/worker/observe/static/styles.css +613 -0
  38. package/dist/worker/pool/failure-routing.js +41 -6
  39. package/dist/worker/pool/run-store.js +50 -0
  40. package/dist/worker/progress-reporter.js +0 -18
  41. package/dist/worker/run-task/run-task.js +327 -92
  42. package/dist/worker/runner/run-ready.js +112 -4
  43. package/dist/worker/task-spec/schema.js +2 -1
  44. package/dist/workflows/dag/canvas-observer.js +275 -275
  45. package/dist/workflows/dag/event-observer.js +132 -0
  46. package/dist/workflows/dag/init-hybrid.js +182 -21
  47. package/dist/workflows/dag/observer-compose.js +52 -0
  48. package/docs/README.md +75 -72
  49. package/docs/agent-dag-recovery-playbook.md +184 -184
  50. package/docs/agent-dag-runner.md +42 -42
  51. package/docs/architecture/runtime-boundaries.md +162 -147
  52. package/docs/cursor-executor-usage.md +25 -25
  53. package/docs/decisions/README.md +3 -3
  54. package/docs/design/README.md +49 -36
  55. package/docs/development-principles.md +73 -73
  56. package/docs/dynamic-workflow-dag-engine-roadmap.md +1749 -1749
  57. package/docs/exec-plans/README.md +6 -6
  58. package/docs/exec-plans/active/README.md +12 -7
  59. package/docs/exec-plans/completed/README.md +32 -19
  60. package/docs/feature-workflow.md +186 -186
  61. package/docs/harness-methodology-debugging.md +153 -153
  62. package/docs/harness-methodology-tdd.md +130 -130
  63. package/docs/harness-methodology-verification.md +27 -27
  64. package/docs/init-surface.manifest.json +208 -199
  65. package/docs/loop-agent-harness.md +55 -42
  66. package/docs/production-readiness.md +96 -96
  67. package/docs/progress/README.md +3 -3
  68. package/docs/reports/README.md +9 -5
  69. package/docs/skills/README.md +6 -6
  70. package/docs/skills/vetted-skill-registry.md +26 -26
  71. package/docs/templates/adr.md +60 -60
  72. package/docs/templates/agent-dag-authority-surface-audit.prompt.md +94 -94
  73. package/docs/templates/agent-dag-decision-envelope.schema.json +213 -213
  74. package/docs/templates/agent-dag-decision-gate-dogfood-report.md +117 -117
  75. package/docs/templates/agent-dag-decision-gate.prompt.md +246 -246
  76. package/docs/templates/agent-dag-process-supervisor.prompt.md +98 -98
  77. package/docs/templates/agent-dag-report.schema.json +454 -454
  78. package/docs/templates/agent-dag-review-verdict.prompt.md +68 -68
  79. package/docs/templates/agent-dag.base.json +195 -195
  80. package/docs/templates/agent-dag.final-verification.json +190 -190
  81. package/docs/templates/agent-dag.schema.json +316 -316
  82. package/docs/templates/agent-dag.supervised-implementation.json +500 -500
  83. package/docs/templates/exec-plan.md +64 -64
  84. package/docs/templates/feature-spec.md +53 -53
  85. package/docs/templates/hybrid-dag.json +193 -193
  86. package/docs/templates/init-evolution-review.md +33 -33
  87. package/docs/templates/interactive-ui-round2-experiment.md +66 -0
  88. package/docs/templates/production-readiness-checklist.md +57 -57
  89. package/docs/templates/progress-log.md +17 -17
  90. package/docs/templates/project-start-checklist.md +9 -9
  91. package/docs/templates/qa-report.md +48 -48
  92. package/docs/templates/sprint-contract.md +29 -29
  93. package/docs/templates/worker-dogfood-evidence.md +52 -0
  94. package/docs/templates/worker-dogfood-setup.md +48 -0
  95. package/docs/verification-matrix.md +41 -41
  96. package/examples/decision-gate-agent-dag.json +123 -123
  97. package/examples/example-dag.json +51 -51
  98. package/examples/hybrid-loop-agent-dag.json +194 -194
  99. package/harness.json +70 -69
  100. package/package.json +66 -66
  101. package/skills/ai-engineering-context/SKILL.md +48 -48
  102. package/skills/code-review-core/SKILL.md +20 -20
  103. package/skills/codebase-scout/SKILL.md +19 -19
  104. package/skills/init-capability-evolution/SKILL.md +69 -69
  105. package/skills/loop-agent/SKILL.md +149 -147
  106. package/skills/loop-agent/references/README.md +67 -67
  107. package/skills/loop-agent/references/command-reference.md +412 -403
  108. package/skills/loop-agent/references/harness-policy.md +263 -259
  109. package/skills/loop-agent/references/hybrid-dag.md +216 -216
  110. package/skills/loop-agent/references/learned/README.md +21 -21
  111. package/skills/loop-agent/references/long-running-loop.md +59 -59
  112. package/skills/loop-agent/references/model-routing.md +36 -36
  113. package/skills/loop-agent/references/multi-worktree.md +54 -54
  114. package/skills/loop-agent/references/one-shot-runs.md +85 -85
  115. package/skills/loop-agent/references/orchestrator-and-interventions.md +169 -169
  116. package/skills/loop-agent/references/pi-prompt.md +23 -23
  117. package/skills/loop-agent/references/pi-subagent-assisted-mode.md +81 -81
  118. package/skills/loop-agent/references/post-implementation-and-patterns.md +44 -44
  119. package/skills/loop-agent/references/task-workflow.md +89 -84
  120. package/skills/loop-agent/references/verification-and-failure-handling.md +128 -128
  121. package/skills/requesting-code-review/SKILL.md +101 -101
  122. package/skills/requesting-code-review/code-reviewer.md +168 -168
  123. package/skills/systematic-debugging/CREATION-LOG.md +119 -119
  124. package/skills/systematic-debugging/SKILL.md +296 -296
  125. package/skills/systematic-debugging/condition-based-waiting-example.ts +158 -158
  126. package/skills/systematic-debugging/condition-based-waiting.md +115 -115
  127. package/skills/systematic-debugging/defense-in-depth.md +122 -122
  128. package/skills/systematic-debugging/find-polluter.sh +63 -63
  129. package/skills/systematic-debugging/root-cause-tracing.md +169 -169
  130. package/skills/systematic-debugging/test-academic.md +14 -14
  131. package/skills/systematic-debugging/test-pressure-1.md +58 -58
  132. package/skills/systematic-debugging/test-pressure-2.md +68 -68
  133. package/skills/systematic-debugging/test-pressure-3.md +69 -69
  134. package/skills/test-driven-development/SKILL.md +20 -20
  135. package/skills/verification-before-completion/SKILL.md +154 -154
  136. package/skills/webapp-testing/SKILL.md +19 -19
@@ -1,59 +1,59 @@
1
- # Long-Running Loop 详细规则
2
-
3
- 需要跨多轮记录目标、压缩记忆、round facts 引用,或使用 `loop init|status|run|record-round|add-signal|closeout` 时使用本文。`loop` 是 experimental outer workflow state:它不替代 Agent DAG,也不等同于已移除的顺序式 `run loop`。共享 policy 摘要见 `harness-policy.md` 的 "Long-running loop policy" 一节。
4
-
5
- ## 最小入口
6
-
7
- ```bash
8
- loop-agent loop init <task-id>
9
- loop-agent loop status <task-id>
10
- loop-agent loop run <task-id> --action shell-verify --command "bash scripts/check-repo.sh"
11
- loop-agent loop run <task-id> --action pi-review
12
- loop-agent loop run <task-id> --action cursor-fix --model composer-2.5
13
- loop-agent loop run <task-id> --action dag
14
- loop-agent loop run <task-id> --action dag --execute
15
- loop-agent loop run <task-id> --auto --max-rounds 3
16
- loop-agent loop run <task-id> --auto --max-rounds 3 --allow-cursor-fix
17
- loop-agent loop add-signal <task-id> --type human_followup --message "review this boundary before closeout"
18
- loop-agent loop closeout <task-id>
19
- loop-agent loop record-round <task-id> \
20
- --action manual \
21
- --result "summary" \
22
- --lesson "what to carry forward" \
23
- --next "next bounded action" \
24
- --decision continue \
25
- --ref ".harness/runs/completed/<run-id>/result.json"
26
- ```
27
-
28
- ## 状态源与记忆规则
29
-
30
- - `loop/objective.md` 与 `loop/context.md` 是运行态投影;exec plan / task source 仍是需求状态源。
31
- - `rounds.jsonl` 只引用 canonical facts,不复制完整 executor 日志。
32
- - `context.md` 每轮重写为压缩记忆,不无限 append。
33
- - `events.jsonl` 只用于 observability,覆盖 loop_start、round_start、action_start、action_finish、context_rewrite、decision、loop_finish;不要把 events 当状态源。
34
-
35
- ## Action 规则
36
-
37
- - `loop run --action shell-verify` 是 deterministic action;命令 exit code 决定 verification result,输出摘要写入 `loop/verification/round-N.json`。
38
- - `loop run --action pi-review` 必须保持 read-only;工具 allowlist 固定为 `read,grep,find,ls`,输出必须包含 `findingSummary`、`failureCategory`、`nextHypothesis`、`recommendedAction`、`fixScope`、`rootCause`,其中 `recommendedAction` 只能是 `implement_fix|replan|pause|done`。
39
- - `loop run --action cursor-fix` 必须读取 task `allowedPaths` / `forbiddenPaths`,拒绝空 allowedPaths 或 allowed/forbidden overlap;对 `complexity=medium|large` 的任务,还必须已有 loop `dag` round 证据,或在 `task.json.dagFallbackReason` 中写明 DAG runtime fallback 原因。调用现有 Cursor bounded executor,并把 one-shot evidence 归档到 `.harness/runs/completed|failed/`。
40
- - `cursor-fix` 只表示 bounded write round 已执行;它不会把 loop 标记 complete,下一步必须进入 `shell-verify` 或 review。
41
- - `loop run --action dag` 默认是 review mode:调用 `dag run-task <task-id> --profile auto --strict-models` 生成 DAG,再用 `dag validate --strict-models --strict-governance` 校验,并记录 review packet。
42
- - `loop run --action dag --execute` 才会调用 `run-dag`,随后读取 `dag report --json` 作为 round result;paused DAG 会让 loop 进入 `paused`。
43
-
44
- ## Auto mode 与写入边界
45
-
46
- - `loop run --auto --max-rounds N` 使用 deterministic policy 选择下一轮 action;默认只会自动选择 shell-verify、pi-review、dag review 或 policy pause/block,不自动触发 Cursor 写入。
47
- - 自动 `cursor-fix` 必须显式 opt-in:`task.json.loopAutoWritePolicy="enabled"`,或 `loopAutoWritePolicy="approval-required"` 加 pending approval signal / `--allow-cursor-fix`。即使 opt-in,也必须通过 `allowedPaths`/`forbiddenPaths`/DAG evidence guard;guard 失败会 pause,不会绕过写入边界。
48
- - auto mode 遇到同类 failure streak 达阈值会 blocked,避免无限重试。
49
-
50
- ## Signals
51
-
52
- - `loop add-signal` 写入 durable `signals.jsonl`,支持 `human_followup|approval|scope_changed|review_feedback`;urgent/scope_changed 会 pause,review feedback / human follow-up 先走 read-only Pi review,approval 触发下一轮 DAG review packet。
53
- - Signals 不直接覆盖 `objective.md`;DAG decision envelope / approve / reject / resume 仍由 DAG action 机制管理,loop 只记录 refs。
54
-
55
- ## Closeout
56
-
57
- - `loop closeout` 从 loop state、objective/context、rounds 和 signals 派生 `loop/closeout.md` draft;draft 会标出 workflow path(`dag` / `explicit-fallback` / `missing-dag-evidence` / `micro-or-small`)与 fallback reason。
58
- - 非 complete 状态必须标 partial/paused/blocked,不能修改 completed facts;medium/large loop 若缺少 DAG round 且没有 `dagFallbackReason`,必须把缺失 DAG 证据列为 remaining risk。
59
- - 完成声明仍必须由 shell verification、review verdict 和 success criteria coverage 证明。
1
+ # Long-Running Loop 详细规则
2
+
3
+ 需要跨多轮记录目标、压缩记忆、round facts 引用,或使用 `loop init|status|run|record-round|add-signal|closeout` 时使用本文。`loop` 是 experimental outer workflow state:它不替代 Agent DAG,也不等同于已移除的顺序式 `run loop`。共享 policy 摘要见 `harness-policy.md` 的 "Long-running loop policy" 一节。
4
+
5
+ ## 最小入口
6
+
7
+ ```bash
8
+ loop-agent loop init <task-id>
9
+ loop-agent loop status <task-id>
10
+ loop-agent loop run <task-id> --action shell-verify --command "bash scripts/check-repo.sh"
11
+ loop-agent loop run <task-id> --action pi-review
12
+ loop-agent loop run <task-id> --action cursor-fix --model composer-2.5
13
+ loop-agent loop run <task-id> --action dag
14
+ loop-agent loop run <task-id> --action dag --execute
15
+ loop-agent loop run <task-id> --auto --max-rounds 3
16
+ loop-agent loop run <task-id> --auto --max-rounds 3 --allow-cursor-fix
17
+ loop-agent loop add-signal <task-id> --type human_followup --message "review this boundary before closeout"
18
+ loop-agent loop closeout <task-id>
19
+ loop-agent loop record-round <task-id> \
20
+ --action manual \
21
+ --result "summary" \
22
+ --lesson "what to carry forward" \
23
+ --next "next bounded action" \
24
+ --decision continue \
25
+ --ref ".harness/runs/completed/<run-id>/result.json"
26
+ ```
27
+
28
+ ## 状态源与记忆规则
29
+
30
+ - `loop/objective.md` 与 `loop/context.md` 是运行态投影;exec plan / task source 仍是需求状态源。
31
+ - `rounds.jsonl` 只引用 canonical facts,不复制完整 executor 日志。
32
+ - `context.md` 每轮重写为压缩记忆,不无限 append。
33
+ - `events.jsonl` 只用于 observability,覆盖 loop_start、round_start、action_start、action_finish、context_rewrite、decision、loop_finish;不要把 events 当状态源。
34
+
35
+ ## Action 规则
36
+
37
+ - `loop run --action shell-verify` 是 deterministic action;命令 exit code 决定 verification result,输出摘要写入 `loop/verification/round-N.json`。
38
+ - `loop run --action pi-review` 必须保持 read-only;工具 allowlist 固定为 `read,grep,find,ls`,输出必须包含 `findingSummary`、`failureCategory`、`nextHypothesis`、`recommendedAction`、`fixScope`、`rootCause`,其中 `recommendedAction` 只能是 `implement_fix|replan|pause|done`。
39
+ - `loop run --action cursor-fix` 必须读取 task `allowedPaths` / `forbiddenPaths`,拒绝空 allowedPaths 或 allowed/forbidden overlap;对 `complexity=medium|large` 的任务,还必须已有 loop `dag` round 证据,或在 `task.json.dagFallbackReason` 中写明 DAG runtime fallback 原因。调用现有 Cursor bounded executor,并把 one-shot evidence 归档到 `.harness/runs/completed|failed/`。
40
+ - `cursor-fix` 只表示 bounded write round 已执行;它不会把 loop 标记 complete,下一步必须进入 `shell-verify` 或 review。
41
+ - `loop run --action dag` 默认是 review mode:调用 `dag run-task <task-id> --profile auto --strict-models` 生成 DAG,再用 `dag validate --strict-models --strict-governance` 校验,并记录 review packet。
42
+ - `loop run --action dag --execute` 才会调用 `run-dag`,随后读取 `dag report --json` 作为 round result;paused DAG 会让 loop 进入 `paused`。
43
+
44
+ ## Auto mode 与写入边界
45
+
46
+ - `loop run --auto --max-rounds N` 使用 deterministic policy 选择下一轮 action;默认只会自动选择 shell-verify、pi-review、dag review 或 policy pause/block,不自动触发 Cursor 写入。
47
+ - 自动 `cursor-fix` 必须显式 opt-in:`task.json.loopAutoWritePolicy="enabled"`,或 `loopAutoWritePolicy="approval-required"` 加 pending approval signal / `--allow-cursor-fix`。即使 opt-in,也必须通过 `allowedPaths`/`forbiddenPaths`/DAG evidence guard;guard 失败会 pause,不会绕过写入边界。
48
+ - auto mode 遇到同类 failure streak 达阈值会 blocked,避免无限重试。
49
+
50
+ ## Signals
51
+
52
+ - `loop add-signal` 写入 durable `signals.jsonl`,支持 `human_followup|approval|scope_changed|review_feedback`;urgent/scope_changed 会 pause,review feedback / human follow-up 先走 read-only Pi review,approval 触发下一轮 DAG review packet。
53
+ - Signals 不直接覆盖 `objective.md`;DAG decision envelope / approve / reject / resume 仍由 DAG action 机制管理,loop 只记录 refs。
54
+
55
+ ## Closeout
56
+
57
+ - `loop closeout` 从 loop state、objective/context、rounds 和 signals 派生 `loop/closeout.md` draft;draft 会标出 workflow path(`dag` / `explicit-fallback` / `missing-dag-evidence` / `micro-or-small`)与 fallback reason。
58
+ - 非 complete 状态必须标 partial/paused/blocked,不能修改 completed facts;medium/large loop 若缺少 DAG round 且没有 `dagFallbackReason`,必须把缺失 DAG 证据列为 remaining risk。
59
+ - 完成声明仍必须由 shell verification、review verdict 和 success criteria coverage 证明。
@@ -1,36 +1,36 @@
1
- # 模型配置与路由
2
-
3
- 查看或修改 loop-agent model 默认值、Agent DAG `executorModels` 或 Pi model/provider 设置时使用本文。
4
-
5
- ## 模型配置
6
-
7
- 模型设置来自 repo `harness.json`。历史 `models.<step>` 只作为旧 task metadata 兼容读取;新 DAG work 不从这里路由模型。
8
-
9
- 示例模型记录:
10
-
11
- ```json
12
- {
13
- "provider": "wizard-local",
14
- "model": "gpt-5.3-codex-spark"
15
- }
16
- ```
17
-
18
- Agent DAG node 的模型来自 DAG JSON 中的 `executorModels`,并由 `dag validate --strict-models` 检查 canonical matrix 漂移。若变更模型配置,须同步更新 `harness.json`、相关测试、repo docs 与本 skill。
19
-
20
- `pi-prompt` 是独立 one-shot helper,不使用 `harness.json.models` 或 DAG `executorModels`。当前默认是 `wizard-local/glm-5.2`;高复杂度 one-shot 显式传 `--model gpt-5.5`。Agent DAG `pi` executor 的 canonical matrix 保持;读写 profile 共用同一矩阵:
21
-
22
- ```json
23
- {
24
- "LOW": "gpt-5.3-codex-spark",
25
- "MED": "glm-5.2",
26
- "HIGH": "gpt-5.5"
27
- }
28
- ```
29
-
30
- 始终信任当前 repo config,而非硬编码示例:
31
- ```bash
32
- loop-agent inspect
33
- ```
34
- 并在输出中核对 `models` 与 Agent DAG 文档中的 `executorModels` 约定。
35
-
36
- Pi SDK runtime reuse 仍为 **default-off**(`CODE_AGENT_PI_REUSE_RUNTIME` 未设/`off`/未知)。opt-in 须显式 `auto-run`;`CODE_AGENT_PI_BACKEND=cli-only` 绕过 reuse。无 live call 的确定性 M2/M3 decision 摘要用 `pi-reuse-benchmark`(见 `command-reference.md`)。
1
+ # 模型配置与路由
2
+
3
+ 查看或修改 loop-agent model 默认值、Agent DAG `executorModels` 或 Pi model/provider 设置时使用本文。
4
+
5
+ ## 模型配置
6
+
7
+ 模型设置来自 repo `harness.json`。历史 `models.<step>` 只作为旧 task metadata 兼容读取;新 DAG work 不从这里路由模型。
8
+
9
+ 示例模型记录:
10
+
11
+ ```json
12
+ {
13
+ "provider": "wizard-local",
14
+ "model": "gpt-5.3-codex-spark"
15
+ }
16
+ ```
17
+
18
+ Agent DAG node 的模型来自 DAG JSON 中的 `executorModels`,并由 `dag validate --strict-models` 检查 canonical matrix 漂移。若变更模型配置,须同步更新 `harness.json`、相关测试、repo docs 与本 skill。
19
+
20
+ `pi-prompt` 是独立 one-shot helper,不使用 `harness.json.models` 或 DAG `executorModels`。当前默认是 `wizard-local/glm-5.2`;高复杂度 one-shot 显式传 `--model gpt-5.5`。Agent DAG `pi` executor 的 canonical matrix 保持;读写 profile 共用同一矩阵:
21
+
22
+ ```json
23
+ {
24
+ "LOW": "gpt-5.3-codex-spark",
25
+ "MED": "glm-5.2",
26
+ "HIGH": "gpt-5.5"
27
+ }
28
+ ```
29
+
30
+ 始终信任当前 repo config,而非硬编码示例:
31
+ ```bash
32
+ loop-agent inspect
33
+ ```
34
+ 并在输出中核对 `models` 与 Agent DAG 文档中的 `executorModels` 约定。
35
+
36
+ Pi SDK runtime reuse 仍为 **default-off**(`CODE_AGENT_PI_REUSE_RUNTIME` 未设/`off`/未知)。opt-in 须显式 `auto-run`;`CODE_AGENT_PI_BACKEND=cli-only` 绕过 reuse。无 live call 的确定性 M2/M3 decision 摘要用 `pi-reuse-benchmark`(见 `command-reference.md`)。
@@ -1,54 +1,54 @@
1
- # Multi-Worktree 并行模式
2
-
3
- 同时驱动两个及以上独立 loop-agent task、委派到 isolated worktree、或 harvest 已完成工作时使用本文。
4
-
5
- ## Multi-Worktree 并行模式
6
-
7
- 需要**同时推进两个及以上独立 loop-agent task** 时,用 multi-worktree mode 隔离编辑与测试。
8
-
9
- > **Historical(已移除)**:`subagent list|start|attach|stop|wait|wakeup`、`dashboard` 与 `delegate --supervised` 已随 tmux 白盒 lifecycle 移除。并行观察请用各 task 的 `status`、worktree 内 `logs/`,或 Agent DAG `dag status` / `dag report`。
10
-
11
- ### 何时启用
12
-
13
- - 有 ≥ 2 个可独立推进的 task id,且希望在不同 worktree 中并发运行
14
- - 或希望主 repo 保持干净供审阅,而 leaf executor 在 worktree 内跑 `implement`/`verify`
15
- - 单一顺序 task 可跳过 — 直接 Agent DAG 或 main-session surgical patch 足够
16
-
17
- ### 核心命令
18
-
19
- ```bash
20
- loop-agent delegate <task-id> [--executor pi|cursor] [--base <branch>] [--branch <name>] [--no-symlink] [--auto-run] [--no-auto-run]
21
- loop-agent harvest <task-id> [--squash] [--no-archive] [--keep-worktree]
22
- loop-agent worktree list
23
- ```
24
-
25
- `delegate` 是一步原子操作:校验 `task.json` + `source/需求.md` + `source/执行约束.md` → 在 branch `task/<task-id>` 上创建 `git worktree .worktrees/<task-id>` → 同步 `source/` 与 `task.json` 到 worktree → 相对 symlink `./node_modules` → cursor 默认 in-process SDK direct;Pi `--auto-run` 已移除并会提示 DAG 路径。
26
-
27
- `harvest` 是对称 closeout:仅当 `task.status === "completed"` 才运行,然后 merge(默认 `--no-ff`,或 `--squash`),将 `artifacts/`、`logs/`、`.workflow_state.json` 归档回主 repo,移除 worktree + branch。
28
-
29
- ### 主窗口职责(勿与 executor 重叠)
30
-
31
- 1. delegate 前与用户 refine `需求.md` / `执行约束.md`
32
- 2. `delegate` 返回后**不要**碰 `plan` 或 `implement` — 让 worktree 内 executor 跑
33
- 3. 用 `status <task-id>` 与 worktree 内 `logs/workflow.log`、`logs/executor.jsonl` 观察进度
34
- 4. task 报告 verify-passed 后,用 `git -C .worktrees/<task-id> log -p main..` 审 diff,再跑 `harvest`
35
- 5. task 失败则**不要** harvest — 进入 worktree 排障并重跑 verify
36
-
37
- ### 生命周期概览
38
-
39
- ```
40
- delegate → executor 跑 spec/implement/verify → completed → harvest → archive + cleanup
41
- ↘ failed → worktree 内排障(不 harvest)
42
- ```
43
-
44
- ### 失败处理
45
-
46
- - `delegate` fail-fast:任何 source/conflict 错误在创建 worktree 前 abort
47
- - `harvest` 拒绝 failed/active task;merge conflict 时打印 conflict 文件(手动解决后重跑)
48
- - `worktree list` 只读;从任意窗口运行都不影响 in-flight delegate
49
-
50
- ### 与 Agent DAG 的关系
51
-
52
- Agent DAG 是默认 autonomous path;`delegate`/`harvest` 是 cursor-direct 的 worktree escape hatch。多 task 并行时,每个 task 独立 `delegate`,完成后分别 `harvest`。
53
-
54
- 详见 `docs/cursor-executor-usage.md` 与 `docs/loop-agent-harness.md`。
1
+ # Multi-Worktree 并行模式
2
+
3
+ 同时驱动两个及以上独立 loop-agent task、委派到 isolated worktree、或 harvest 已完成工作时使用本文。
4
+
5
+ ## Multi-Worktree 并行模式
6
+
7
+ 需要**同时推进两个及以上独立 loop-agent task** 时,用 multi-worktree mode 隔离编辑与测试。
8
+
9
+ > **Historical(已移除)**:`subagent list|start|attach|stop|wait|wakeup`、`dashboard` 与 `delegate --supervised` 已随 tmux 白盒 lifecycle 移除。并行观察请用各 task 的 `status`、worktree 内 `logs/`,或 Agent DAG `dag status` / `dag report`。
10
+
11
+ ### 何时启用
12
+
13
+ - 有 ≥ 2 个可独立推进的 task id,且希望在不同 worktree 中并发运行
14
+ - 或希望主 repo 保持干净供审阅,而 leaf executor 在 worktree 内跑 `implement`/`verify`
15
+ - 单一顺序 task 可跳过 — 直接 Agent DAG 或 main-session surgical patch 足够
16
+
17
+ ### 核心命令
18
+
19
+ ```bash
20
+ loop-agent delegate <task-id> [--executor pi|cursor] [--base <branch>] [--branch <name>] [--no-symlink] [--auto-run] [--no-auto-run]
21
+ loop-agent harvest <task-id> [--squash] [--no-archive] [--keep-worktree]
22
+ loop-agent worktree list
23
+ ```
24
+
25
+ `delegate` 是一步原子操作:校验 `task.json` + `source/需求.md` + `source/执行约束.md` → 在 branch `task/<task-id>` 上创建 `git worktree .worktrees/<task-id>` → 同步 `source/` 与 `task.json` 到 worktree → 相对 symlink `./node_modules` → cursor 默认 in-process SDK direct;Pi `--auto-run` 已移除并会提示 DAG 路径。
26
+
27
+ `harvest` 是对称 closeout:仅当 `task.status === "completed"` 才运行,然后 merge(默认 `--no-ff`,或 `--squash`),将 `artifacts/`、`logs/`、`.workflow_state.json` 归档回主 repo,移除 worktree + branch。
28
+
29
+ ### 主窗口职责(勿与 executor 重叠)
30
+
31
+ 1. delegate 前与用户 refine `需求.md` / `执行约束.md`
32
+ 2. `delegate` 返回后**不要**碰 `plan` 或 `implement` — 让 worktree 内 executor 跑
33
+ 3. 用 `status <task-id>` 与 worktree 内 `logs/workflow.log`、`logs/executor.jsonl` 观察进度
34
+ 4. task 报告 verify-passed 后,用 `git -C .worktrees/<task-id> log -p main..` 审 diff,再跑 `harvest`
35
+ 5. task 失败则**不要** harvest — 进入 worktree 排障并重跑 verify
36
+
37
+ ### 生命周期概览
38
+
39
+ ```
40
+ delegate → executor 跑 spec/implement/verify → completed → harvest → archive + cleanup
41
+ ↘ failed → worktree 内排障(不 harvest)
42
+ ```
43
+
44
+ ### 失败处理
45
+
46
+ - `delegate` fail-fast:任何 source/conflict 错误在创建 worktree 前 abort
47
+ - `harvest` 拒绝 failed/active task;merge conflict 时打印 conflict 文件(手动解决后重跑)
48
+ - `worktree list` 只读;从任意窗口运行都不影响 in-flight delegate
49
+
50
+ ### 与 Agent DAG 的关系
51
+
52
+ Agent DAG 是默认 autonomous path;`delegate`/`harvest` 是 cursor-direct 的 worktree escape hatch。多 task 并行时,每个 task 独立 `delegate`,完成后分别 `harvest`。
53
+
54
+ 详见 `docs/cursor-executor-usage.md` 与 `docs/loop-agent-harness.md`。
@@ -1,85 +1,85 @@
1
- # One-shot Run Evidence(`.harness/runs/`)
2
-
3
- 当你使用 `cursor-prompt`、Pi `cursor` tool、`promote-run`,或在治理检查中看到 `.harness/runs/active` warning 时,读本文。
4
-
5
- ## 目录职责
6
-
7
- `.harness/runs/` 保存一次性工具调用的运行证据。它不是 task 状态源,也不是 Agent DAG run 目录。
8
-
9
- ```text
10
- .harness/runs/active/<run-id>/ # 正在执行或异常残留的 one-shot tool run
11
- .harness/runs/completed/<run-id>/ # 成功完成的 one-shot run evidence
12
- .harness/runs/failed/<run-id>/ # 失败的 one-shot run evidence
13
- ```
14
-
15
- 每个 run directory 通常包含:
16
-
17
- ```text
18
- run.md
19
- meta.json
20
- artifacts/
21
- ```
22
-
23
- `run.md` 是人类可读摘要;`meta.json` 是机器可读 run metadata;`artifacts/` 是该次 one-shot 的交付物目录。
24
-
25
- ## 什么时候创建
26
-
27
- 会创建 `.harness/runs/` 的常见入口:
28
-
29
- - `loop-agent cursor-prompt ...`
30
- - Pi `cursor` tool / loop-agent cursor tool 的 one-shot Cursor 调用
31
- - 内部 two-phase one-shot logging:先 `createActiveCursorRun()`,再 `finalizeCursorRunLog()`
32
-
33
- 创建条件:
34
-
35
- - 调用的 `cwd` 必须是含 `.harness/` 的 harness repo。
36
- - `cursor-prompt` 会先创建 `.harness/runs/active/<run-id>/`,再把结果归档。
37
- - 成功时整个目录移动到 `.harness/runs/completed/<run-id>/`。
38
- - 失败、timeout 或 cancel 时整个目录移动到 `.harness/runs/failed/<run-id>/`。
39
-
40
- 当前 `pi-prompt` 不创建 `.harness/runs/`。它是 one-shot helper,但不维护 run evidence、task state、verification 或 handoff artifact。
41
-
42
- ## 与 task / DAG 的关系
43
-
44
- | 目录 | 含义 | 是否代表 task 完成 |
45
- |---|---|---|
46
- | `.harness/tasks/<task-id>/` | task 运行态状态源 | 是 task 状态源 |
47
- | `.harness/runs/<state>/<run-id>/` | one-shot tool run evidence | 否,只是一次执行证据 |
48
- | `.harness/dag-runs/<state>/<run-id>/` | Agent DAG run facts | 否,只是 DAG run facts |
49
-
50
- completed one-shot evidence 若要进入 task artifacts,使用:
51
-
52
- ```bash
53
- loop-agent promote-run <task-id> --run-id <run-id>
54
- loop-agent closeout task <task-id>
55
- ```
56
-
57
- `promote-run` 只读 `.harness/runs/completed/**`,生成或更新 task `artifacts/修改记录.md` / `artifacts/验证结果.md`,不修改 completed run facts。
58
-
59
- ## Active 目录清理
60
-
61
- `.harness/runs/active/` 只应存在 live one-shot run。治理检查发现 active 内容时会 warning:
62
-
63
- ```text
64
- [HARNESS RUNTIME WARNING] .harness/runs/active contains runtime entries
65
- ```
66
-
67
- 处理规则:
68
-
69
- - 如果确有 one-shot 正在执行,可以保留;必要时用 `HARNESS_ALLOW_ACTIVE_TOOL_RUNS=1` 跑治理检查。
70
- - 如果是已完成、失败或中断残留,应移动到 `completed/` / `failed/`,或在确认无价值后删除。
71
- - 如果是 `.DS_Store` 等系统垃圾文件,直接删除;它不是合法 run evidence。
72
- - 不要把 active 残留当作 task 完成证据。
73
-
74
- 严格检查可用:
75
-
76
- ```bash
77
- HARNESS_STRICT_ACTIVE_TOOL_RUNS=1 bash scripts/check-harness-runtime-clean.sh
78
- ```
79
-
80
- ## 不要做什么
81
-
82
- - 不要提交 `.harness/runs/**` 运行态内容。
83
- - 不要手动改写 `.harness/runs/completed/**` 或 `.harness/runs/failed/**` 事实。
84
- - 不要把 `.harness/runs/active/**` 当作长期记录。
85
- - 不要把 one-shot evidence 直接等同于 task artifacts;需要汇总时用 `promote-run`。
1
+ # One-shot Run Evidence(`.harness/runs/`)
2
+
3
+ 当你使用 `cursor-prompt`、Pi `cursor` tool、`promote-run`,或在治理检查中看到 `.harness/runs/active` warning 时,读本文。
4
+
5
+ ## 目录职责
6
+
7
+ `.harness/runs/` 保存一次性工具调用的运行证据。它不是 task 状态源,也不是 Agent DAG run 目录。
8
+
9
+ ```text
10
+ .harness/runs/active/<run-id>/ # 正在执行或异常残留的 one-shot tool run
11
+ .harness/runs/completed/<run-id>/ # 成功完成的 one-shot run evidence
12
+ .harness/runs/failed/<run-id>/ # 失败的 one-shot run evidence
13
+ ```
14
+
15
+ 每个 run directory 通常包含:
16
+
17
+ ```text
18
+ run.md
19
+ meta.json
20
+ artifacts/
21
+ ```
22
+
23
+ `run.md` 是人类可读摘要;`meta.json` 是机器可读 run metadata;`artifacts/` 是该次 one-shot 的交付物目录。
24
+
25
+ ## 什么时候创建
26
+
27
+ 会创建 `.harness/runs/` 的常见入口:
28
+
29
+ - `loop-agent cursor-prompt ...`
30
+ - Pi `cursor` tool / loop-agent cursor tool 的 one-shot Cursor 调用
31
+ - 内部 two-phase one-shot logging:先 `createActiveCursorRun()`,再 `finalizeCursorRunLog()`
32
+
33
+ 创建条件:
34
+
35
+ - 调用的 `cwd` 必须是含 `.harness/` 的 harness repo。
36
+ - `cursor-prompt` 会先创建 `.harness/runs/active/<run-id>/`,再把结果归档。
37
+ - 成功时整个目录移动到 `.harness/runs/completed/<run-id>/`。
38
+ - 失败、timeout 或 cancel 时整个目录移动到 `.harness/runs/failed/<run-id>/`。
39
+
40
+ 当前 `pi-prompt` 不创建 `.harness/runs/`。它是 one-shot helper,但不维护 run evidence、task state、verification 或 handoff artifact。
41
+
42
+ ## 与 task / DAG 的关系
43
+
44
+ | 目录 | 含义 | 是否代表 task 完成 |
45
+ |---|---|---|
46
+ | `.harness/tasks/<task-id>/` | task 运行态状态源 | 是 task 状态源 |
47
+ | `.harness/runs/<state>/<run-id>/` | one-shot tool run evidence | 否,只是一次执行证据 |
48
+ | `.harness/dag-runs/<state>/<run-id>/` | Agent DAG run facts | 否,只是 DAG run facts |
49
+
50
+ completed one-shot evidence 若要进入 task artifacts,使用:
51
+
52
+ ```bash
53
+ loop-agent promote-run <task-id> --run-id <run-id>
54
+ loop-agent closeout task <task-id>
55
+ ```
56
+
57
+ `promote-run` 只读 `.harness/runs/completed/**`,生成或更新 task `artifacts/修改记录.md` / `artifacts/验证结果.md`,不修改 completed run facts。
58
+
59
+ ## Active 目录清理
60
+
61
+ `.harness/runs/active/` 只应存在 live one-shot run。治理检查发现 active 内容时会 warning:
62
+
63
+ ```text
64
+ [HARNESS RUNTIME WARNING] .harness/runs/active contains runtime entries
65
+ ```
66
+
67
+ 处理规则:
68
+
69
+ - 如果确有 one-shot 正在执行,可以保留;必要时用 `HARNESS_ALLOW_ACTIVE_TOOL_RUNS=1` 跑治理检查。
70
+ - 如果是已完成、失败或中断残留,应移动到 `completed/` / `failed/`,或在确认无价值后删除。
71
+ - 如果是 `.DS_Store` 等系统垃圾文件,直接删除;它不是合法 run evidence。
72
+ - 不要把 active 残留当作 task 完成证据。
73
+
74
+ 严格检查可用:
75
+
76
+ ```bash
77
+ HARNESS_STRICT_ACTIVE_TOOL_RUNS=1 bash scripts/check-harness-runtime-clean.sh
78
+ ```
79
+
80
+ ## 不要做什么
81
+
82
+ - 不要提交 `.harness/runs/**` 运行态内容。
83
+ - 不要手动改写 `.harness/runs/completed/**` 或 `.harness/runs/failed/**` 事实。
84
+ - 不要把 `.harness/runs/active/**` 当作长期记录。
85
+ - 不要把 one-shot evidence 直接等同于 task artifacts;需要汇总时用 `promote-run`。