@tea-agent/loop-agent 0.1.0 → 0.2.1

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (143) hide show
  1. package/AGENTS.md +62 -45
  2. package/CHANGELOG.md +60 -28
  3. package/README.md +160 -124
  4. package/bin/loop-agent.js +21 -21
  5. package/dist/adapters/index.js +3 -2
  6. package/dist/adapters/loop-agent.js +44 -2
  7. package/dist/application/dag/args.js +420 -0
  8. package/dist/application/dag/generate-task-dag.js +280 -0
  9. package/dist/application/dag/report-dag.js +14 -0
  10. package/dist/application/dag/run-dag.js +106 -0
  11. package/dist/application/dag/validate-dag.js +102 -0
  12. package/dist/application/loop/run-action.js +23 -0
  13. package/dist/cli/catalog.js +2 -237
  14. package/dist/cli/command-definitions.js +571 -0
  15. package/dist/cli/index.js +2 -0
  16. package/dist/cli/program.js +65 -1
  17. package/dist/cli/router.js +13 -0
  18. package/dist/cli-governance/active-residue-check.js +38 -0
  19. package/dist/commands/dag-report.js +6 -107
  20. package/dist/commands/dag-run-task.js +8 -466
  21. package/dist/commands/dag-validate.js +7 -179
  22. package/dist/commands/examples.js +90 -0
  23. package/dist/commands/init.js +1518 -0
  24. package/dist/commands/loop.js +57 -31
  25. package/dist/commands/pi-prompt.js +2 -9
  26. package/dist/commands/run-dag.js +7 -180
  27. package/dist/executors/cursor-executor-artifacts.js +3 -4
  28. package/dist/executors/cursor-worker-client.js +13 -3
  29. package/dist/executors/dag-cursor-executor.js +2 -3
  30. package/dist/executors/dag-pi-executor.js +3 -4
  31. package/dist/executors/dag-static-executor.js +2 -5
  32. package/dist/executors/pi-defaults.js +9 -0
  33. package/dist/executors/shell-executor.js +12 -20
  34. package/dist/governance/manifest-types.js +1 -0
  35. package/dist/infrastructure/harness/active-residue-policy.js +73 -0
  36. package/dist/infrastructure/harness/artifact-store.js +72 -0
  37. package/dist/infrastructure/harness/atomic-write.js +49 -0
  38. package/dist/infrastructure/harness/completed-facts-guard.js +40 -0
  39. package/dist/infrastructure/harness/loop-action-store.js +23 -0
  40. package/dist/infrastructure/harness/loop-store.js +41 -0
  41. package/dist/infrastructure/harness/one-shot-run-store.js +94 -0
  42. package/dist/infrastructure/harness/task-store.js +77 -0
  43. package/dist/records/one-shot-runs.js +26 -61
  44. package/dist/records/promotion.js +3 -4
  45. package/dist/shared/artifacts-core.js +5 -5
  46. package/dist/shared/logger.js +9 -15
  47. package/dist/task/delegate.js +4 -4
  48. package/dist/task/runtime.js +5 -7
  49. package/dist/task/state.js +6 -20
  50. package/dist/workflows/dag/convergence/controller.js +277 -0
  51. package/dist/workflows/dag/dynamic-runtime/condition.js +48 -0
  52. package/dist/workflows/dag/dynamic-runtime/loop-until.js +156 -0
  53. package/dist/workflows/dag/dynamic-runtime/map.js +185 -0
  54. package/dist/workflows/dag/dynamic-runtime/reduction.js +72 -0
  55. package/dist/workflows/dag/dynamic-runtime/shared.js +133 -0
  56. package/dist/workflows/dag/failure-routing.js +82 -0
  57. package/dist/workflows/dag/lifecycle.js +101 -8
  58. package/dist/workflows/dag/node-execution.js +262 -0
  59. package/dist/workflows/dag/report.js +73 -1
  60. package/dist/workflows/dag/run-store.js +36 -0
  61. package/dist/workflows/dag/runner.js +82 -1341
  62. package/dist/workflows/dag/scheduler.js +84 -0
  63. package/dist/workflows/dag/upstream-artifacts.js +20 -18
  64. package/dist/workflows/loop/actions/cursor-fix.js +191 -0
  65. package/dist/workflows/loop/actions/dag-action.js +130 -0
  66. package/dist/workflows/loop/actions/pi-review.js +267 -0
  67. package/dist/workflows/loop/actions/shared.js +157 -0
  68. package/dist/workflows/loop/actions/shell-verify.js +82 -0
  69. package/dist/workflows/loop/actions/types.js +1 -0
  70. package/dist/workflows/loop/actions/workflow-action.js +255 -0
  71. package/dist/workflows/loop/actions.js +55 -1212
  72. package/dist/workflows/loop/closeout.js +5 -4
  73. package/dist/workflows/loop/context.js +2 -3
  74. package/dist/workflows/loop/events.js +3 -2
  75. package/dist/workflows/loop/policy/auto-policy.js +104 -0
  76. package/dist/workflows/loop/policy/cursor-fix-policy.js +31 -0
  77. package/dist/workflows/loop/rounds.js +3 -3
  78. package/dist/workflows/loop/signals.js +4 -7
  79. package/dist/workflows/loop/state.js +11 -11
  80. package/docs/README.md +47 -44
  81. package/docs/agent-dag-recovery-playbook.md +32 -6
  82. package/docs/agent-dag-runner.md +17 -17
  83. package/docs/architecture/runtime-boundaries.md +147 -0
  84. package/docs/cursor-executor-usage.md +5 -5
  85. package/docs/decisions/README.md +2 -2
  86. package/docs/design/README.md +24 -24
  87. package/docs/development-principles.md +50 -50
  88. package/docs/dynamic-workflow-dag-engine-roadmap.md +6 -6
  89. package/docs/exec-plans/README.md +4 -4
  90. package/docs/exec-plans/active/README.md +10 -5
  91. package/docs/exec-plans/completed/README.md +9 -5
  92. package/docs/feature-workflow.md +111 -109
  93. package/docs/harness-methodology-verification.md +18 -18
  94. package/docs/loop-agent-harness.md +36 -36
  95. package/docs/production-readiness.md +96 -0
  96. package/docs/progress/README.md +2 -2
  97. package/docs/reports/README.md +4 -2
  98. package/docs/templates/agent-dag-decision-gate-dogfood-report.md +1 -1
  99. package/docs/templates/agent-dag-process-supervisor.prompt.md +2 -2
  100. package/docs/templates/agent-dag-report.schema.json +33 -2
  101. package/docs/templates/agent-dag-review-verdict.prompt.md +1 -1
  102. package/docs/templates/agent-dag.base.json +195 -195
  103. package/docs/templates/agent-dag.final-verification.json +190 -190
  104. package/docs/templates/agent-dag.schema.json +17 -17
  105. package/docs/templates/agent-dag.supervised-implementation.json +500 -500
  106. package/docs/templates/hybrid-dag.json +193 -193
  107. package/docs/templates/production-readiness-checklist.md +57 -0
  108. package/docs/templates/progress-log.md +7 -7
  109. package/docs/templates/project-start-checklist.md +8 -8
  110. package/docs/templates/qa-report.md +17 -11
  111. package/docs/templates/sprint-contract.md +19 -19
  112. package/docs/verification-matrix.md +37 -26
  113. package/examples/example-dag.json +51 -51
  114. package/examples/hybrid-loop-agent-dag.json +194 -194
  115. package/harness.json +5 -5
  116. package/package.json +62 -61
  117. package/skills/ai-engineering-context/SKILL.md +21 -21
  118. package/skills/loop-agent/SKILL.md +56 -171
  119. package/skills/loop-agent/references/README.md +6 -2
  120. package/skills/loop-agent/references/command-reference.md +107 -65
  121. package/skills/loop-agent/references/harness-policy.md +115 -115
  122. package/skills/loop-agent/references/hybrid-dag.md +30 -30
  123. package/skills/loop-agent/references/learned/README.md +13 -13
  124. package/skills/loop-agent/references/long-running-loop.md +59 -0
  125. package/skills/loop-agent/references/model-routing.md +1 -1
  126. package/skills/loop-agent/references/orchestrator-and-interventions.md +1 -1
  127. package/skills/loop-agent/references/pi-prompt.md +9 -9
  128. package/skills/loop-agent/references/pi-subagent-assisted-mode.md +0 -2
  129. package/skills/loop-agent/references/post-implementation-and-patterns.md +7 -7
  130. package/skills/loop-agent/references/task-workflow.md +19 -19
  131. package/skills/loop-agent/references/verification-and-failure-handling.md +54 -0
  132. package/skills/requesting-code-review/SKILL.md +40 -40
  133. package/skills/requesting-code-review/code-reviewer.md +4 -4
  134. package/skills/systematic-debugging/CREATION-LOG.md +43 -43
  135. package/skills/systematic-debugging/SKILL.md +113 -113
  136. package/skills/systematic-debugging/condition-based-waiting.md +20 -20
  137. package/skills/systematic-debugging/defense-in-depth.md +27 -27
  138. package/skills/systematic-debugging/root-cause-tracing.md +38 -38
  139. package/skills/systematic-debugging/test-academic.md +6 -6
  140. package/skills/systematic-debugging/test-pressure-1.md +6 -6
  141. package/skills/systematic-debugging/test-pressure-2.md +2 -2
  142. package/skills/systematic-debugging/test-pressure-3.md +6 -6
  143. package/skills/verification-before-completion/SKILL.md +37 -37
@@ -2,52 +2,52 @@
2
2
 
3
3
  需要 loop-agent 的精确 CLI 命令、setup 命令、task lifecycle 命令、docs helper、goal 命令或 stats 时使用本文。
4
4
 
5
- ## loop-agent 入口
6
-
7
- **优先在目标 repo 目录内执行命令** — loop-agent 通过 `harness.json.project` 自动检测使用哪个 repo adapter。跨目录操作时显式加 `--repo-root <target-repo>`。
8
-
9
- 默认使用全局 CLI:
10
-
11
- ```bash
12
- loop-agent <command> ...
13
- ```
14
-
15
- 面向自举迭代和日常使用时,全局 CLI 应来自 npm 上已发布的安装包。首次安装或有意升级使用 `@latest`:
16
-
17
- ```bash
18
- npm install -g @tea-agent/loop-agent@latest
19
- npm list -g @tea-agent/loop-agent --depth=0
20
- loop-agent doctor
21
- ```
22
-
23
- 一次自举任务启动后不要中途升级控制器;记录 `npm list -g` 显示的实际版本。不要在 DAG 节点中反复用 `npx @latest` 拉取,也不要使用当前工作区的 `npm link` 或 `npm run dev` 作为控制器去修改 loop-agent 本仓库的 CLI、DAG runtime、executor、package metadata 或 build output。`npm run dev -- <command> ...` 只用于源码调试和聚焦 CLI 开发。
24
-
25
- 发布包入口加载 `dist/cli.js`;开发入口加载 `src/cli.ts`。
26
-
27
- 发布包携带静态能力资料:`skills/`、`docs/*.md`、`docs/templates/` 和 `examples/`。`docs/progress/`、`docs/reports/`、`docs/exec-plans/`、`docs/decisions/` 的任务正文属于目标仓库运行中生成的事实,不从 npm 包复制;包内只保留这些目录的 README 说明。
28
-
29
- ## 命令参考
5
+ ## loop-agent 入口
6
+
7
+ **优先在目标 repo 目录内执行命令** — loop-agent 通过 `harness.json.project` 自动检测使用哪个 repo adapter。跨目录操作时显式加 `--repo-root <target-repo>`。
8
+
9
+ 默认使用全局 CLI:
10
+
11
+ ```bash
12
+ loop-agent <command> ...
13
+ ```
14
+
15
+ 面向自举迭代和日常使用时,全局 CLI 应来自 npm 上已发布的安装包。首次安装或有意升级使用 `@latest`:
16
+
17
+ ```bash
18
+ npm install -g @tea-agent/loop-agent@latest
19
+ npm list -g @tea-agent/loop-agent --depth=0
20
+ loop-agent doctor
21
+ ```
22
+
23
+ 一次自举任务启动后不要中途升级控制器;记录 `npm list -g` 显示的实际版本。不要在 DAG 节点中反复用 `npx @latest` 拉取,也不要使用当前工作区的 `npm link` 或 `npm run dev` 作为控制器去修改 loop-agent 本仓库的 CLI、DAG runtime、executor、package metadata 或 build output。`npm run dev -- <command> ...` 只用于源码调试和聚焦 CLI 开发。
24
+
25
+ 发布包入口加载 `dist/cli.js`;开发入口加载 `src/cli.ts`。
26
+
27
+ 发布包携带静态能力资料:`skills/`、`docs/*.md`、`docs/templates/` 和 `examples/`。`docs/progress/`、`docs/reports/`、`docs/exec-plans/`、`docs/decisions/` 的任务正文属于目标仓库运行中生成的事实,不从 npm 包复制;包内只保留这些目录的 README 说明。
28
+
29
+ ## 命令参考
30
30
 
31
31
  ## 默认选择模型
32
32
 
33
33
  选择命令时按以下优先级:
34
34
 
35
- 1. **主路径 DAG**,用于常规 autonomous work:
36
- ```bash
37
- loop-agent new-task <task-id> "Task Title"
38
- loop-agent dag run-task <task-id> --profile auto --strict-models --output <temp-dir>/<task-id>-dag.json
39
- loop-agent dag validate --dag <temp-dir>/<task-id>-dag.json --strict-models --strict-governance
40
- loop-agent run-dag --dag <temp-dir>/<task-id>-dag.json --cwd <repo-root>
41
- ```
42
- `<temp-dir>` 表示平台原生临时目录;也可以省略 `--output`,再使用命令 JSON 输出里的 `outputPath`。
43
- 2. **Operator 工具**,用于 recovery、诊断与 closeout:
44
- ```bash
35
+ 1. **主路径 DAG**,用于常规 autonomous work:
36
+ ```bash
37
+ loop-agent new-task <task-id> "Task Title"
38
+ loop-agent dag run-task <task-id> --profile auto --strict-models --output <temp-dir>/<task-id>-dag.json
39
+ loop-agent dag validate --dag <temp-dir>/<task-id>-dag.json --strict-models --strict-governance
40
+ loop-agent run-dag --dag <temp-dir>/<task-id>-dag.json --cwd <repo-root>
41
+ ```
42
+ `<temp-dir>` 表示平台原生临时目录;也可以省略 `--output`,再使用命令 JSON 输出里的 `outputPath`。
43
+ 2. **Operator 工具**,用于 recovery、诊断与 closeout:
44
+ ```bash
45
45
  loop-agent dag status --run-id <run-id>
46
46
  loop-agent dag doctor
47
47
  loop-agent dag report --latest --markdown
48
48
  loop-agent dag closeout-draft --run-id <run-id>
49
49
  loop-agent dag reconcile-tasks --glob '<pattern>' --markdown
50
- loop-agent dag final-verification <task-id> --output <temp-dir>/<task-id>-final-verification-dag.json
50
+ loop-agent dag final-verification <task-id> --output <temp-dir>/<task-id>-final-verification-dag.json
51
51
  loop-agent status <task-id> --json
52
52
  loop-agent instructions task-artifacts --task <task-id> --json
53
53
  loop-agent promote-run <task-id> --run-id <run-id>
@@ -60,14 +60,15 @@ loop-agent doctor
60
60
  ```bash
61
61
  loop-agent delegate <task-id> --executor cursor
62
62
  loop-agent harvest <task-id>
63
+ loop-agent cursor-prompt --cwd <repo-root> --file /tmp/bounded-task.md
63
64
  loop-agent pi-prompt "Reply with exactly OK."
64
65
  ```
65
66
 
66
- ### Setup(首次)
67
- ```bash
68
- npm install -g @tea-agent/loop-agent@latest
69
- loop-agent --help
70
- ```
67
+ ### Setup(首次)
68
+ ```bash
69
+ npm install -g @tea-agent/loop-agent@latest
70
+ loop-agent --help
71
+ ```
71
72
 
72
73
  ### 检查 repo harness
73
74
  ```bash
@@ -141,9 +142,9 @@ loop-agent --repo-root /path/to/target-repo study init <task-id> "Title" \
141
142
  --reference-glob "codex-rs/**/goal*.rs"
142
143
 
143
144
  # 编辑 source/需求.md + source/执行约束.md,然后走 DAG 路径:
144
- loop-agent --repo-root <target-repo> dag run-task <task-id> --profile auto --strict-models --output <temp-dir>/<task-id>-dag.json
145
- loop-agent --repo-root <target-repo> dag validate --dag <temp-dir>/<task-id>-dag.json --strict-models --strict-governance
146
- loop-agent --repo-root <target-repo> run-dag --dag <temp-dir>/<task-id>-dag.json --cwd <target-repo>
145
+ loop-agent --repo-root <target-repo> dag run-task <task-id> --profile auto --strict-models --output <temp-dir>/<task-id>-dag.json
146
+ loop-agent --repo-root <target-repo> dag validate --dag <temp-dir>/<task-id>-dag.json --strict-models --strict-governance
147
+ loop-agent --repo-root <target-repo> run-dag --dag <temp-dir>/<task-id>-dag.json --cwd <target-repo>
147
148
  ```
148
149
 
149
150
  目标 repo 需有 `.harness/prompts/feature-study-analyze.md` 与 `feature-study-plan.md`(缺失时从 loop-agent 复制)。
@@ -152,6 +153,13 @@ loop-agent --repo-root <target-repo> run-dag --dag <temp-dir>/<task-id>-dag.json
152
153
 
153
154
  历史顺序式 `run analyze|plan|spec|implement|verify|retrospective|auto|loop|continue|study` 已移除。新任务不要使用这些命令,也不要在 prompt、skill 或 docs 中把它们描述为 fallback。
154
155
 
156
+ ### Reference helpers(compatibility)
157
+ ```bash
158
+ loop-agent reference index
159
+ ```
160
+
161
+ `reference` 是 compatibility / feature-study 辅助入口,用于维护或检查参考资料索引。常规实现任务不要从 `reference` 起步;按 `new-task` + DAG 路径执行。
162
+
155
163
  ### Task goal lifecycle(compatibility-only / deprecated-candidate)
156
164
  ```bash
157
165
  loop-agent goal set <task-id> "Objective text" [--token-budget <number|null>]
@@ -176,17 +184,17 @@ loop-agent goal clear <task-id>
176
184
 
177
185
  ### Agent DAG validation 与 execution
178
186
  ```bash
179
- loop-agent dag validate --dag <temp-dir>/hybrid-dag.json # 常规 validation;无 .harness/dag-runs 副作用
180
- loop-agent dag validate --dag <temp-dir>/hybrid-dag.json --strict-models # 非 canonical executorModels 时失败
181
- loop-agent dag validate --dag <temp-dir>/hybrid-dag.json --strict-governance # governance warning 时失败
182
- loop-agent dag validate --dag <temp-dir>/hybrid-dag.json --strict-governance --spine-task <task-id> # 同时消费 minimal spec spine audit
183
- loop-agent dag validate --dag docs/templates/agent-dag.supervised-implementation.json --strict-models --strict-governance # role=supervisor + write-set-gate topology
184
- cp docs/templates/agent-dag.supervised-implementation.json <temp-dir>/supervised-dag.json
185
- (npx vitest run test/dag-supervised-template.test.ts test/dag-validate.test.ts test/dag-shell-executor.test.ts --reporter=dot) # supervised template + shell.verdictGate runtime
186
- loop-agent dag validate --dag <temp-dir>/hybrid-dag.json --forbid-executor cursor # 存在 cursor node 时失败
187
- loop-agent run-dag --dag <temp-dir>/hybrid-dag.json --cwd <repo-root> # 执行 Agent DAG
188
- loop-agent run-dag --dag <temp-dir>/hybrid-dag.json --cwd <repo-root> --no-cursor # 执行前若存在 cursor node 则失败
189
- loop-agent run-dag --dag <temp-dir>/hybrid-dag.json --init-only --canvas-path <temp-dir>/hybrid-dag.canvas.tsx # 可选 derived Canvas view
187
+ loop-agent dag validate --dag <temp-dir>/hybrid-dag.json # 常规 validation;无 .harness/dag-runs 副作用
188
+ loop-agent dag validate --dag <temp-dir>/hybrid-dag.json --strict-models # 非 canonical executorModels 时失败
189
+ loop-agent dag validate --dag <temp-dir>/hybrid-dag.json --strict-governance # governance warning 时失败
190
+ loop-agent dag validate --dag <temp-dir>/hybrid-dag.json --strict-governance --spine-task <task-id> # 同时消费 minimal spec spine audit
191
+ loop-agent dag validate --dag docs/templates/agent-dag.supervised-implementation.json --strict-models --strict-governance # role=supervisor + write-set-gate topology
192
+ cp docs/templates/agent-dag.supervised-implementation.json <temp-dir>/supervised-dag.json
193
+ (npx vitest run test/dag-supervised-template.test.ts test/dag-validate.test.ts test/dag-shell-executor.test.ts --reporter=dot) # supervised template + shell.verdictGate runtime
194
+ loop-agent dag validate --dag <temp-dir>/hybrid-dag.json --forbid-executor cursor # 存在 cursor node 时失败
195
+ loop-agent run-dag --dag <temp-dir>/hybrid-dag.json --cwd <repo-root> # 执行 Agent DAG
196
+ loop-agent run-dag --dag <temp-dir>/hybrid-dag.json --cwd <repo-root> --no-cursor # 执行前若存在 cursor node 则失败
197
+ loop-agent run-dag --dag <temp-dir>/hybrid-dag.json --init-only --canvas-path <temp-dir>/hybrid-dag.canvas.tsx # 可选 derived Canvas view
190
198
  loop-agent dag init-hybrid <task-id> # 生成可审阅的 DAG draft
191
199
  loop-agent dag run-task <task-id> # generate + validate(安全默认;无 dag-runs;standard-compatible)
192
200
  loop-agent dag run-task <task-id> --profile auto # 推断 governanceProfile,经 workflowPolicy.dag.profileRouting 路由
@@ -213,9 +221,9 @@ loop-agent dag resume --run-id <run-id> # approve 后继续
213
221
  **In-flight DAG governance**:shell verify node 内用 `HARNESS_ALLOW_ACTIVE_DAG_RUNS=1 bash scripts/check-repo.sh`;run 归档到 `completed/` 后,在 DAG 外跑裸 `bash scripts/check-repo.sh`。
214
222
 
215
223
  - `dag validate` 做 schema/topology/ranks 检查;审 `warnings` 中的显式 `executorModels` drift 与 governance lint。
216
- - 手写临时 DAG spec 执行前用 `dag validate --strict-models`,model-matrix drift 应 fail fast。
224
+ - 手写临时 DAG spec 执行前用 `dag validate --strict-models`,model-matrix drift 应 fail fast。
217
225
  - read-only artifact-boundary 或 DAG 内 shell governance warning 应 fail fast 时用 `dag validate --strict-governance`。
218
- - 人工 handoff 视图用 `dag report --markdown`(summary、node timeline、failures、四段 Recovery Plan、artifacts、建议 next action)。仅 derived、advisory;需保存时重定向到平台临时目录或 `docs/reports/`。
226
+ - 人工 handoff 视图用 `dag report --markdown`(summary、node timeline、failures、四段 Recovery Plan、artifacts、建议 next action)。仅 derived、advisory;需保存时重定向到平台临时目录或 `docs/reports/`。
219
227
  - operator 聚焦最新 paused run 用 `dag report --paused-latest`(等同 `--lifecycle paused --latest`;勿与显式 `--lifecycle` 并用)。
220
228
  - 需 operator 关注的 run 用 `dag report --failed-only`、`--latest`、`--action <recovery-action>` 收窄。category→action 映射见 `docs/agent-dag-recovery-playbook.md`。
221
229
  - 只读扫描 `.harness/dag-runs/` 下所有 run 的生命周期 health issue 与建议 action 用 `dag doctor`(`advisoryOnly: true`;不 mutate facts)。
@@ -227,6 +235,18 @@ loop-agent dag resume --run-id <run-id> # approve 后继续
227
235
  - 仅当有意在 `.harness/dag-runs/active/` 下要 active run snapshot 时用 `run-dag --dry-run`。
228
236
  - task source 应从 `harness.json.workflowPolicy.dag.profileRouting` 与确定性 candidate `governanceProfile` 选 standard / review-gated / supervised template 时用 `dag run-task --profile auto`。无 `--profile` 仅用于旧 standard-compatible 输出;强制 template family 用 `--profile minimal|standard|reviewed|supervised`。
229
237
 
238
+ ### Saved Dynamic Workflow operator UX
239
+ ```bash
240
+ loop-agent workflow list
241
+ loop-agent workflow inspect <name>
242
+ loop-agent workflow save --from /tmp/<task-id>.workflow.json --name <name>
243
+ loop-agent workflow run <name-or-path> --cwd <repo-root>
244
+ loop-agent workflow diff <name> --against /tmp/<task-id>.workflow.json
245
+ loop-agent workflow replay <run-id>
246
+ ```
247
+
248
+ `workflow` 是 Dynamic Workflow 的 saved/operator surface。它读取 `WorkflowSpec`,编译为 DAG,再进入同一套 `run-dag` runtime;不会新增 executor 能力或绕过 DAG governance。真实写入任务仍应检查 compiled DAG 的 executor、writeSet、shell gates 和 completed facts 边界。
249
+
230
250
  ### Cursor worker lifecycle
231
251
  ```bash
232
252
  loop-agent cursor-worker status # enabled/running/child/entry path
@@ -259,14 +279,14 @@ loop-agent handoff coverage <task-id> [--json|--markdown]
259
279
 
260
280
  ### Pi runtime reuse benchmark / decision(无 live call)
261
281
  ```bash
262
- loop-agent pi-reuse-benchmark \
263
- --report docs/reports/<benchmark-report>.md \
264
- --json
265
-
266
- loop-agent pi-reuse-benchmark \
267
- --report docs/reports/<benchmark-report>.md \
268
- --off-executor /path/to/off/executor.jsonl \
269
- --on-executor /path/to/on/executor.jsonl \
282
+ loop-agent pi-reuse-benchmark \
283
+ --report docs/reports/<benchmark-report>.md \
284
+ --json
285
+
286
+ loop-agent pi-reuse-benchmark \
287
+ --report docs/reports/<benchmark-report>.md \
288
+ --off-executor /path/to/off/executor.jsonl \
289
+ --on-executor /path/to/on/executor.jsonl \
270
290
  --approval /path/to/approval.json \
271
291
  --markdown
272
292
  ```
@@ -281,6 +301,19 @@ loop-agent loop-benchmark --markdown --output docs/reports/2026-06-30-loop-agent
281
301
 
282
302
  生成 M0 deterministic baseline,对照 `single-repair`、`3-pass-convergence`、`3-pass-convergence+quota`。**不**跑 live Pi/Cursor call、不创建 task、不改 `convergence.enabled` 默认值。live dogfood 证据缺失时输出 `blocked` 并建议保持 opt-in。
283
303
 
304
+ ### Long-running loop outer state(experimental)
305
+ ```bash
306
+ loop-agent loop init <task-id>
307
+ loop-agent loop status <task-id>
308
+ loop-agent loop run <task-id> --action dag
309
+ loop-agent loop run <task-id> --action shell-verify --command "bash scripts/check-repo.sh"
310
+ loop-agent loop record-round <task-id> --decision continue --summary "..."
311
+ loop-agent loop add-signal <task-id> --kind note --message "..."
312
+ loop-agent loop closeout <task-id>
313
+ ```
314
+
315
+ `loop` 是 Agent DAG 之上的长程状态和 evidence layer,记录 rounds、signals、verification summaries 和 closeout draft。它不是替代 `dag run-task` / `run-dag` 的实现路径;medium/large work 仍需要 DAG evidence 或明确 fallback reason。
316
+
284
317
  ### Minimal spec spine audit
285
318
  ```bash
286
319
  loop-agent spine audit <task-id> --json
@@ -312,4 +345,13 @@ loop-agent worktree create|list|remove ...
312
345
 
313
346
  用于 worktree 隔离的 cursor-direct 执行与 merge 收口。常规 autonomous work 应优先 Agent DAG;详见 `multi-worktree.md` 与 `docs/cursor-executor-usage.md`。
314
347
 
348
+ ### One-shot Cursor sidecar(escape hatch)
349
+ ```bash
350
+ loop-agent cursor-prompt --cwd <repo-root> "Review this task without editing files."
351
+ loop-agent cursor-prompt --cwd <repo-root> --file /tmp/bounded-cursor-task.md
352
+ loop-agent cursor-prompt --cwd <repo-root> --model composer-2.5 --timeout 1800000 --file /tmp/bounded-cursor-task.md
353
+ ```
354
+
355
+ `cursor-prompt` 是 one-shot Cursor SDK helper。用于 bounded diagnosis、小修复或调试 executor;写入 prompt 必须包含 task id、objective、allowed paths、forbidden paths、verification 和 preserve-unrelated-changes 要求。需要 `CURSOR_API_KEY`。它会创建 one-shot run evidence,但 Cursor 自报成功不替代 shell verification。
356
+
315
357
  > **Historical(已移除)**:`subagent list|start|wait|wakeup|attach|stop` 与 `dashboard` 已移除,不再出现在 CLI registry。
@@ -1,15 +1,15 @@
1
1
  # Shared loop-agent Harness Policy
2
2
 
3
- This file is the canonical shared workflow policy for using `.` across repositories. Repo-local harness docs should only describe local adapters: where the runtime lives, which governance root to use, and which verification commands apply.
3
+ 本文件是跨仓库使用 `.` canonical shared workflow policyRepo-local harness docs 只应描述 local adaptersruntime 位置、governance root、适用的 verification commands
4
4
 
5
5
  ## Canonical stance
6
6
 
7
- - **Agent DAG** is the default implementation workflow for medium/large, multi-file, architecture-sensitive, public-contract, CI/script, or harness-runtime work.
8
- - The historical sequential `run analyze|plan|spec|implement|verify|auto|loop|continue` workflow has been removed. Do not present it as a fallback path.
9
- - **Long-running `loop`** is an outer state/evidence layer above Agent DAG. It records rounds, context compression, signals, and canonical refs; it must not replace DAG writeSet review, Decision Gate, or shell verification for complex work.
10
- - **Main session** orchestrates: choose one work chunk, prepare source materials, review DAG/writeSet, monitor failures, run final verification, and hand off.
11
- - **Executors** implement bounded work: Cursor writes within explicit paths, Pi performs read-only planning/review/diagnosis in DAG nodes, shell produces deterministic verification facts.
12
- - **Shell verification is the completion fact source**. LLM review or advisory output cannot replace command exit codes and archived evidence.
7
+ - **Agent DAG** medium/largemulti-filearchitecture-sensitivepublic-contractCI/script harness-runtime 工作的默认 implementation workflow。
8
+ - 历史顺序式 `run analyze|plan|spec|implement|verify|auto|loop|continue` workflow 已移除。不要将其作为 fallback path 呈现。
9
+ - **Long-running `loop`** Agent DAG 之上的 outer state/evidence layer。它记录 roundscontext compressionsignalscanonical refs;不得替代 complex work DAG writeSet reviewDecision Gate shell verification
10
+ - **Main session** 负责 orchestrate:选一个 work chunk、准备 source materialsreview DAG/writeSetmonitor failures、跑 final verificationhand off
11
+ - **Executors** 实现 bounded work:Pi DAG nodes read-only planning/review/diagnosis,并在节点声明 `toolProfile: "write"` 时做 bounded implementation/repair;Cursor 是显式启用的可选 bounded writer;shell 产出 deterministic verification facts
12
+ - **Shell verification completion fact source**。LLM review advisory output 不能替代 command exit codes archived evidence
13
13
 
14
14
  ## Command surface tiers
15
15
 
@@ -21,7 +21,7 @@ This file is the canonical shared workflow policy for using `.` across repositor
21
21
  | Escape hatch | Isolated delegation, one-shot diagnosis or bounded repair | `delegate`, `worktree`, `harvest`, `pi-prompt`, `cursor-prompt`, `cursor-worker` |
22
22
  | Experimental | Long-running outer task state | `loop init|status|run|record-round|add-signal|closeout` |
23
23
 
24
- Prompt templates, README snippets, and task instructions should present Primary + Operator first. Compatibility and escape-hatch commands remain available, but must carry their downgrade/fallback meaning.
24
+ Prompt templatesREADME snippetstask instructions 应优先呈现 Primary + OperatorCompatibility escape-hatch commands 仍可用,但须携带其 downgrade/fallback 含义。
25
25
 
26
26
  ## Entry selection decision tree
27
27
 
@@ -33,7 +33,7 @@ Is this only status, diagnosis, recovery, or closeout?
33
33
  yes -> Agent DAG.
34
34
  ```
35
35
 
36
- Use Agent DAG rather than broad one-shot execution when any of these signals apply:
36
+ 在以下任一 signal 适用时用 Agent DAG 而非 broad one-shot execution
37
37
 
38
38
  - loop-agent runtime, DAG schema, run facts, promotion/closeout, scripts/CI, public contract, or shared protocol is touched.
39
39
  - The change needs multiple files, multiple scouts, review gates, Decision Gate, repair flow, or shell gate.
@@ -43,53 +43,53 @@ Use Agent DAG rather than broad one-shot execution when any of these signals app
43
43
 
44
44
  ## Agent DAG path
45
45
 
46
- Minimum governed path:
46
+ Minimum governed path
47
47
 
48
48
  ```bash
49
49
  loop-agent new-task <task-id> "Task Title" [--repo-root <target-repo>]
50
50
  # write <target-repo>/.harness/tasks/<task-id>/source/需求.md
51
51
  # write <target-repo>/.harness/tasks/<task-id>/source/执行约束.md
52
52
 
53
- loop-agent dag run-task <task-id> \
54
- --profile auto \
55
- --strict-models \
56
- --output <temp-dir>/<task-id>-dag.json \
57
- [--repo-root <target-repo>]
58
-
59
- loop-agent dag validate \
60
- --dag <temp-dir>/<task-id>-dag.json \
61
- --strict-models \
62
- --strict-governance
63
-
64
- loop-agent run-dag \
65
- --dag <temp-dir>/<task-id>-dag.json \
66
- --cwd <target-repo>
67
- ```
68
-
69
- `loop-agent` is the preferred global CLI. For self-hosting loop-agent development, the controller must be an installed npm-published package. Use `npm install -g @tea-agent/loop-agent@latest` for first install or intentional upgrades, then treat the installed version as frozen for the current task and record `npm list -g @tea-agent/loop-agent --depth=0`. Do not repeatedly fetch `npx @latest` inside DAG nodes, and do not use the current working tree's `npm link` or `npm run dev` to control tasks that may edit CLI, DAG runtime, executors, package metadata, or build output. Use `npm run dev -- <args>` only for source debugging and focused CLI development.
70
-
71
- The npm package carries static capability assets: `skills/`, top-level governance docs, `docs/templates/`, `examples/`, `harness.json`, `AGENTS.md`, `README.md`, and `CHANGELOG.md`. Generated or historical task facts under `docs/progress/`, `docs/reports/`, `docs/exec-plans/`, and `docs/decisions/` belong to the target repository; package only their directory README files, not prior run content.
72
-
73
- For arbitrary target repositories, DAG skill instructions must not depend on loop-agent source history being copied into the target repo. Resolve configured, user, or target-local skills when present, then fall back to package-bundled `skills/` as the stable default capability set.
74
-
75
- `<temp-dir>` means the platform-native temp directory. Use native paths for actual `--output`, `--dag`, and `--cwd` values on macOS and Windows; use `/` only for stable repo refs, JSON/Markdown evidence refs, and glob conventions.
76
-
77
- Before execution, review `dag run-task` JSON / `reviewPacket`:
78
-
79
- - `profileRouting`: requested profile, selected profile/template, routing reasons.
80
- - `governanceProfile`: process, delivery, and code-change signals.
81
- - Writer nodes: `writePolicy`, `writeSet`, `allowedPaths`, `forbiddenPaths`, broad entries, forbidden overlaps.
82
- - Shell gates and verification commands.
83
- - Decision Gate mode (`record-only` vs `pause-on-human`).
84
- - Any placeholder, `**`, or repo-root writeSet that must be narrowed before execution.
85
-
86
- In-flight DAG shell checks should use the repo's active-run override when required (for example `HARNESS_ALLOW_ACTIVE_DAG_RUNS=1 bash scripts/check-repo.sh`). After the DAG is archived, run the repo check again without the in-flight override.
87
-
88
- On Windows, run Bash scripts through Git Bash or a configured compatible Bash. Do not require WSL, `/tmp`, `which`, or other POSIX filesystem assumptions in loop-agent CLI behavior.
53
+ loop-agent dag run-task <task-id> \
54
+ --profile auto \
55
+ --strict-models \
56
+ --output <temp-dir>/<task-id>-dag.json \
57
+ [--repo-root <target-repo>]
58
+
59
+ loop-agent dag validate \
60
+ --dag <temp-dir>/<task-id>-dag.json \
61
+ --strict-models \
62
+ --strict-governance
63
+
64
+ loop-agent run-dag \
65
+ --dag <temp-dir>/<task-id>-dag.json \
66
+ --cwd <target-repo>
67
+ ```
68
+
69
+ `loop-agent` is the preferred global CLI. For self-hosting loop-agent development, the controller must be an installed npm-published package. Use `npm install -g @tea-agent/loop-agent@latest` for first install or intentional upgrades, then treat the installed version as frozen for the current task and record `npm list -g @tea-agent/loop-agent --depth=0`. Do not repeatedly fetch `npx @latest` inside DAG nodes, and do not use the current working tree's `npm link` or `npm run dev` to control tasks that may edit CLI, DAG runtime, executors, package metadata, or build output. Use `npm run dev -- <args>` only for source debugging and focused CLI development.
70
+
71
+ The npm package carries static capability assets: `skills/`, top-level governance docs, `docs/templates/`, `examples/`, `harness.json`, `AGENTS.md`, `README.md`, and `CHANGELOG.md`. Generated or historical task facts under `docs/progress/`, `docs/reports/`, `docs/exec-plans/`, and `docs/decisions/` belong to the target repository; package only their directory README files, not prior run content.
72
+
73
+ For arbitrary target repositories, DAG skill instructions must not depend on loop-agent source history being copied into the target repo. Resolve configured, user, or target-local skills when present, then fall back to package-bundled `skills/` as the stable default capability set.
74
+
75
+ `<temp-dir>` means the platform-native temp directory. Use native paths for actual `--output`, `--dag`, and `--cwd` values on macOS and Windows; use `/` only for stable repo refs, JSON/Markdown evidence refs, and glob conventions.
76
+
77
+ Execution review `dag run-task` JSON / `reviewPacket`:
78
+
79
+ - `profileRouting`:requested profileselected profile/templaterouting reasons
80
+ - `governanceProfile`:processdeliverycode-change signals
81
+ - Writer nodes:`writePolicy`、`writeSet`、`allowedPaths`、`forbiddenPaths`、broad entriesforbidden overlaps
82
+ - Shell gates verification commands
83
+ - Decision Gate mode(`record-only` vs `pause-on-human`)。
84
+ - 执行前须 narrow 的 placeholder、`**` repo-root writeSet
85
+
86
+ In-flight DAG shell checks 在需要时用 repo active-run override(例如 `HARNESS_ALLOW_ACTIVE_DAG_RUNS=1 bash scripts/check-repo.sh`)。DAG archived 后,再不带 in-flight override 跑 repo check。
87
+
88
+ On Windows, run Bash scripts through Git Bash or a configured compatible Bash. Do not require WSL, `/tmp`, `which`, or other POSIX filesystem assumptions in loop-agent CLI behavior.
89
89
 
90
90
  ## Task source materials
91
91
 
92
- Every handoff-ready task has:
92
+ 每个 handoff-ready task 包含:
93
93
 
94
94
  ```text
95
95
  .harness/tasks/<task-id>/
@@ -99,25 +99,25 @@ Every handoff-ready task has:
99
99
  执行约束.md
100
100
  ```
101
101
 
102
- `需求.md` should state objective, scope, non-goals, acceptance criteria, and links to repo-local specs or plans.
102
+ `需求.md` 应陈述 objectivescopenon-goalsacceptance criteria,并链接 repo-local specs plans
103
103
 
104
- `执行约束.md` should state:
104
+ `执行约束.md` 应陈述:
105
105
 
106
106
  - allowed paths
107
107
  - forbidden paths
108
- - current dirty workspace / protected user changes, if any
109
- - architecture boundaries and invariants
108
+ - 当前 dirty workspace / protected user changes(如有)
109
+ - architecture boundaries invariants
110
110
  - expected verification commands
111
111
  - acceptance criteria / failure conditions
112
- - whether DAG fallback is allowed, and the fallback reason if already known
112
+ - 是否允许 DAG fallback,及若已知时的 fallback reason
113
113
 
114
- If source materials change after `spec`, `plan`, or DAG generation, regenerate or revalidate the plan/DAG before implementation.
114
+ `spec`、`plan` DAG generation 后 source materials 变更,implementation 前 regenerate revalidate plan/DAG
115
115
 
116
116
  ## Long-running loop policy
117
117
 
118
- `loop` is for long-running outer task memory: objective/context projection, round records, signals, derived events, verification summaries, and closeout draft. It is not a substitute for Agent DAG.
118
+ `loop` 用于 long-running outer task memoryobjective/context projectionround recordssignalsderived eventsverification summariescloseout draft。它不是 Agent DAG substitute
119
119
 
120
- Typical loop path for governed work:
120
+ Governed work 的典型 loop path
121
121
 
122
122
  ```bash
123
123
  loop-agent loop init <task-id>
@@ -130,22 +130,22 @@ loop-agent loop run <task-id> --auto --max-rounds 3 --allow-cursor-fix
130
130
  loop-agent loop closeout <task-id>
131
131
  ```
132
132
 
133
- Loop action rules:
133
+ Loop action rules
134
134
 
135
- - `shell-verify` is deterministic; exit code determines the verification record.
136
- - `pi-review` is read-only; tools are limited to `read,grep,find,ls` and output is structured advisory evidence. Its structured JSON must include `findingSummary`, `failureCategory`, `nextHypothesis`, `recommendedAction`, `fixScope`, and `rootCause`; `recommendedAction` is exactly `implement_fix|replan|pause|done`.
137
- - `cursor-fix` is bounded write; it must read task `allowedPaths` / `forbiddenPaths`, reject empty `allowedPaths`, reject allowed/forbidden overlap, preserve unrelated files, and be followed by shell verification or review.
138
- - For `task.json.complexity = medium | large`, `cursor-fix` additionally requires either:
139
- - a previous loop `dag` round, or
140
- - an explicit `task.json.dagFallbackReason` explaining why DAG could not be used.
141
- - `loop run --auto` does not write by default. Auto `cursor-fix` requires `task.json.loopAutoWritePolicy="enabled"`, or `loopAutoWritePolicy="approval-required"` plus a pending approval signal or `--allow-cursor-fix`; write guards still fail closed and pause.
142
- - `loop closeout` must report workflow path: `dag`, `explicit-fallback`, `missing-dag-evidence`, or `micro-or-small`.
143
- - Medium/large closeout without DAG evidence and without `dagFallbackReason` must list that as a remaining risk.
144
- - `record-round --decision complete` is only a loop-state candidate; completion still requires shell verification, review verdict, and success-criteria coverage.
135
+ - `shell-verify` deterministicexit code 决定 verification record
136
+ - `pi-review` read-onlytools 限于 `read,grep,find,ls`,output structured advisory evidence。Structured JSON 须含 `findingSummary`、`failureCategory`、`nextHypothesis`、`recommendedAction`、`fixScope`、`rootCause`;`recommendedAction` exactly `implement_fix|replan|pause|done`。
137
+ - `cursor-fix` bounded write;须读 task `allowedPaths` / `forbiddenPaths`,reject empty `allowedPaths`、allowed/forbidden overlappreserve unrelated files,且须 follow shell verification review
138
+ - `task.json.complexity = medium | large`,`cursor-fix` additionally 需要:
139
+ - previous loop `dag` round,或
140
+ - explicit `task.json.dagFallbackReason` 说明为何不能用 DAG
141
+ - `loop run --auto` 默认不 writeAuto `cursor-fix` 需要 `task.json.loopAutoWritePolicy="enabled"`,或 `loopAutoWritePolicy="approval-required"` pending approval signal `--allow-cursor-fix`;write guards fail closed pause
142
+ - `loop closeout` 须报告 workflow path:`dag`、`explicit-fallback`、`missing-dag-evidence` `micro-or-small`。
143
+ - DAG evidence 且无 `dagFallbackReason` medium/large closeout 须将其列为 remaining risk
144
+ - `record-round --decision complete` 仅是 loop-state candidatecompletion 仍须 shell verificationreview verdictsuccess-criteria coverage
145
145
 
146
146
  ## Supervised DAG convergence
147
147
 
148
- Supervised DAG convergence is optional and task-config driven:
148
+ Supervised DAG convergence 可选且由 task-config 驱动:
149
149
 
150
150
  ```json
151
151
  {
@@ -160,13 +160,13 @@ Supervised DAG convergence is optional and task-config driven:
160
160
 
161
161
  Rules:
162
162
 
163
- - Default remains single repair unless `convergence.enabled=true`; `HARNESS_DAG_CONVERGENCE=off` is the rollback switch.
164
- - The supervised process supervisor must emit first-line `VERDICT:` and a `REPAIR_ARTIFACT_JSON` fenced block. Repair prompts should consume artifact `failureClass`, `rootCause`, `fixScope`, and `invariant` first; raw logs are fallback evidence only when the artifact allows it.
165
- - On retryable `hard-verify-shell` failure before `maxPasses`, preserve current pass evidence under `convergence/pass-N/`, reset the process-supervisor/process-gate/repair/hard-verify segment plus blocked downstream nodes, and re-enter the existing DAG rank execution loop.
166
- - Do not retry write guards, timeout/spawn/auth failures, or human-gate failures.
167
- - Pause instead of retrying when conservative regression signals appear, such as a lower shell success count.
168
- - `dag report --json` and markdown must expose `convergence.passHistory`.
169
- - Final completion authority remains full shell verification; quota/focused commands are intermediate cost controls only.
163
+ - 默认保持 single repair,除非 `convergence.enabled=true`;`HARNESS_DAG_CONVERGENCE=off` rollback switch
164
+ - Supervised process supervisor emit 首行 `VERDICT:` `REPAIR_ARTIFACT_JSON` fenced blockRepair prompts 应先消费 artifact `failureClass`、`rootCause`、`fixScope`、`invariant`;raw logs 仅在 artifact 允许时为 fallback evidence
165
+ - `maxPasses` 前 retryable `hard-verify-shell` failure 时,preserve current pass evidence `convergence/pass-N/`,reset process-supervisor/process-gate/repair/hard-verify segment blocked downstream nodes,再进入现有 DAG rank execution loop
166
+ - 不要 retry write guardstimeout/spawn/auth failures human-gate failures
167
+ - 出现 conservative regression signals(如 lower shell success count)时 pause 而非 retry。
168
+ - `dag report --json` markdown expose `convergence.passHistory`。
169
+ - Final completion authority 仍是 full shell verificationquota/focused commands 仅为 intermediate cost controls
170
170
 
171
171
  ## Structured repair, spine audit, and curator gates
172
172
 
@@ -177,17 +177,17 @@ Rules:
177
177
 
178
178
  ## SePO-lite prompt evolution
179
179
 
180
- - Learned prompt deltas are human-gated proposals; they must be reviewed before becoming reusable guidance.
181
- - Prompt deltas are Markdown-only process guidance; they must not include shell commands, credential handling, tool permission expansion, or completion-authority bypass.
182
- - Accepted learned guidance lives under `./skill/references/learned/<repo>.md` or `default.md`.
183
- - DAG implementer prompts that already request `loop-agent` may inline at most three human-gated learned Markdown sections.
184
- - Learned guidance is advisory and never replaces writeSet governance, Decision Gate policy, or shell verification.
180
+ - Learned prompt deltas human-gated proposals;成为 reusable guidance 前须 review。
181
+ - Prompt deltas Markdown-only process guidance;不得含 shell commandscredential handlingtool permission expansion completion-authority bypass
182
+ - Accepted learned guidance 位于 `./skill/references/learned/<repo>.md` `default.md`。
183
+ - request `loop-agent` DAG implementer prompts inline 最多三个 human-gated learned Markdown sections
184
+ - Learned guidance advisory,永不替代 writeSet governanceDecision Gate policy shell verification
185
185
 
186
186
  ## Sidecar interventions
187
187
 
188
- `pi-prompt` and `cursor-prompt` are sidecar interventions, not workflow state.
188
+ `pi-prompt` `cursor-prompt` sidecar interventions,不是 workflow state
189
189
 
190
- Use `pi-prompt` for short read-only planning, log explanation, or failure diagnosis. When read-only, pass read-only tools and say not to edit files:
190
+ `pi-prompt` 做短时 read-only planninglog explanation failure diagnosis。Read-only 时传 read-only tools 并写明不 edit files
191
191
 
192
192
  ```bash
193
193
  loop-agent pi-prompt \
@@ -197,7 +197,7 @@ loop-agent pi-prompt \
197
197
  "Read the task source and diagnose the failure. Do not edit files."
198
198
  ```
199
199
 
200
- Use `cursor-prompt` for bounded multi-file diagnosis or small repair only when the prompt includes:
200
+ `cursor-prompt` bounded multi-file diagnosis small repairprompt 须含:
201
201
 
202
202
  - task id
203
203
  - exact objective
@@ -207,52 +207,52 @@ Use `cursor-prompt` for bounded multi-file diagnosis or small repair only when t
207
207
  - expected verification
208
208
  - instruction to preserve unrelated files
209
209
 
210
- Sidecar output is advisory. If it must become task evidence, promote or summarize it through loop-agent run/task artifacts; do not manually mutate completed DAG or one-shot run facts.
210
+ Sidecar output advisory。若须成为 task evidence,通过 loop-agent run/task artifacts promote summarize;completed DAG one-shot run facts 保持只读。
211
211
 
212
212
  ## Model and executor boundaries
213
213
 
214
- - Agent DAG uses DAG JSON `executorModels` plus node `executor` / `complexity`; do not infer DAG models from repo `harness.json.models`.
215
- - DAG `shell` and `static` nodes do not use models.
216
- - Historical step models under `harness.json.models.<step>` are legacy metadata, not routing for new DAG work.
217
- - `pi-prompt` / `cursor-prompt` models come from CLI flags or runtime defaults and must be selected per intervention.
218
- - Pi DAG nodes are read-only planning/review/diagnosis by default.
219
- - Cursor nodes are bounded writers and must have explicit write scope.
220
- - Shell nodes produce deterministic verification facts and gates.
214
+ - Agent DAG DAG JSON `executorModels` node `executor` / `complexity`;不要从 repo `harness.json.models` 推断 DAG models。
215
+ - DAG `shell` `static` nodes 不用 models
216
+ - `harness.json.models.<step>` historical step models legacy metadata,不是新 DAG work 的 routing。
217
+ - `pi-prompt` / `cursor-prompt` models 来自 CLI flags runtime defaults,须 per intervention 选择。
218
+ - Pi DAG nodes 默认 read-only planning/review/diagnosis;声明 `toolProfile: "write"` 时是 bounded writers,须有 explicit write scope。
219
+ - Cursor nodes 是显式启用的可选 bounded writers,须有 explicit write scope
220
+ - Shell nodes 产出 deterministic verification facts gates
221
221
 
222
222
  ## Artifacts and facts boundary
223
223
 
224
- - `.harness/tasks/<task-id>/` is task runtime state.
225
- - `.harness/tasks/<task-id>/loop/` is loop runtime projection; it does not replace task source or repo specs.
226
- - `.harness/dag-runs/{active,paused,completed}/<run-id>/` is DAG run fact storage. Completed facts are read-only.
227
- - `.harness/runs/{active,completed,failed}/<run-id>/` is one-shot Pi/Cursor evidence. Completed/failed facts are read-only.
228
- - Root `artifacts/` is legacy/current-work summary space, not a DAG read-only scratchpad and not default handoff for new DAG work.
229
- - Long-term conclusions belong in repo governance docs, progress, reports, decisions, tests, or scripts.
224
+ - `.harness/tasks/<task-id>/` task runtime state
225
+ - `.harness/tasks/<task-id>/loop/` loop runtime projection;不替代 task source repo specs
226
+ - `.harness/dag-runs/{active,paused,completed}/<run-id>/` DAG run fact storageCompleted facts read-only
227
+ - `.harness/runs/{active,completed,failed}/<run-id>/` one-shot Pi/Cursor evidenceCompleted/failed facts read-only
228
+ - Root `artifacts/` legacy/current-work summary space,不是 DAG read-only scratchpad,也不是新 DAG work default handoff
229
+ - Long-term conclusions 属于 repo governance docsprogressreportsdecisionstests scripts
230
230
 
231
- Do not submit runtime histories from `.harness/dag-runs/`, `.harness/runs/`, or `.harness/cache/` unless a task explicitly promotes a trimmed report into repo governance docs.
231
+ 除非 task 显式 promote trimmed report 到 repo governance docs,不要提交 `.harness/dag-runs/`、`.harness/runs/` `.harness/cache/` runtime histories。
232
232
 
233
233
  ## Baseline, dirty workspace, and verification
234
234
 
235
- Before complex implementation:
235
+ Complex implementation 前:
236
236
 
237
- 1. Check current directory and target repo.
238
- 2. Read repo entrypoints (`README`, `AGENTS`, `harness.json`, governance index).
239
- 3. Capture minimal baseline verification for the affected area.
240
- 4. If the workspace is dirty, choose one:
241
- - isolated worktree, or
242
- - explicit user confirmation to work in the current workspace and preserve/possibly include existing changes.
243
- 5. Record known baseline failures with enough detail to distinguish pre-existing failures from task regressions.
237
+ 1. Check current directory target repo
238
+ 2. Read repo entrypoints(`README`、`AGENTS`、`harness.json`、governance index)。
239
+ 3. Capture affected area 的 minimal baseline verification
240
+ 4. workspace dirty,选一:
241
+ - isolated worktree,或
242
+ - explicit user confirmation 在当前 workspace 工作并 preserve/possibly include existing changes
243
+ 5. Record known baseline failures,足以区分 pre-existing failures task regressions
244
244
 
245
- Verification should be selected from the target repo's verification matrix. For cross-repo documentation refactors, run checks in each affected repo.
245
+ Verification 应从 target repo verification matrix 选择。Cross-repo documentation refactors 时在 each affected repo 跑 checks。
246
246
 
247
247
  ## Handoff requirements
248
248
 
249
- Every task handoff should answer:
249
+ 每个 task handoff 应回答:
250
250
 
251
- 1. What changed and why.
252
- 2. Which workflow path was used: DAG, sidecar, or main-session surgical patch.
253
- 3. If downgraded from DAG, the explicit reason and evidence.
254
- 4. Executors used and their boundaries.
255
- 5. Verification commands run and results.
256
- 6. DAG / one-shot / loop refs, if any.
257
- 7. Remaining risks and follow-up tasks.
258
- 8. Whether new rules should be promoted to docs, tests, scripts, or shared skill references.
251
+ 1. What changed and why
252
+ 2. 用了哪条 workflow pathDAGsidecar main-session surgical patch
253
+ 3. 若从 DAG downgrade,explicit reason evidence
254
+ 4. Executors used 及其 boundaries
255
+ 5. Verification commands run results
256
+ 6. DAG / one-shot / loop refs(如有)。
257
+ 7. Remaining risks follow-up tasks
258
+ 8. 是否应将 new rules promote docstestsscripts shared skill references