@tea-agent/loop-agent 0.25.5 → 0.26.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (173) hide show
  1. package/AGENTS.md +2 -1
  2. package/CHANGELOG.md +1020 -986
  3. package/bin/loop-agent.js +21 -21
  4. package/dist/commands/cursor-prompt.js +6 -6
  5. package/dist/commands/init.js +68 -129
  6. package/dist/commands/loop-benchmark.js +11 -11
  7. package/dist/commands/pi-reuse-benchmark.js +16 -16
  8. package/dist/executors/dag-pi-executor.js +26 -20
  9. package/dist/executors/model-routing.js +34 -18
  10. package/dist/executors/shell-executor.js +1 -1
  11. package/dist/governance/manifest-types.js +33 -5
  12. package/dist/sidecars/cursor-prompt/executor.js +1 -1
  13. package/dist/task/task-demand-routing.js +3 -1
  14. package/dist/worker/console/chat/model-resolver.js +15 -3
  15. package/dist/worker/observe/static/constants.js +3 -2
  16. package/dist/worker/observe/static/copy.js +67 -67
  17. package/dist/worker/observe/static/dag-layout.d.ts +31 -31
  18. package/dist/worker/observe/static/dag-layout.js +83 -83
  19. package/dist/worker/observe/static/dag-model.js +1 -0
  20. package/dist/worker/observe/static/dom.js +220 -220
  21. package/dist/worker/observe/static/relations.js +133 -133
  22. package/dist/worker/observe/static/router.js +93 -93
  23. package/dist/worker/observe/static/run-processing.js +148 -148
  24. package/dist/worker/observe/static/styles.css +182 -42
  25. package/dist/worker/observe/static/views/batch.js +227 -227
  26. package/dist/worker/observe/static/views/dag-graph.js +172 -172
  27. package/dist/worker/observe/static/views/failures.js +143 -143
  28. package/dist/worker/observe/static/views/feature.js +492 -492
  29. package/dist/worker/observe/static/views/run.js +453 -453
  30. package/dist/worker/observe/static/views/shell.js +7 -7
  31. package/dist/worker/observe/static/views/timeline.js +163 -163
  32. package/dist/workflows/dag/backend-test-case-coverage-analysis.js +362 -45
  33. package/dist/workflows/dag/backend-test-case-manifest.js +20 -0
  34. package/dist/workflows/dag/backend-test-markdown-workflow.js +17 -0
  35. package/dist/workflows/dag/canvas-observer.js +275 -275
  36. package/dist/workflows/dag/init-hybrid.js +18 -15
  37. package/dist/workflows/dag/lifecycle.js +40 -30
  38. package/dist/workflows/dag/node-execution.js +13 -0
  39. package/dist/workflows/dag/types.js +59 -19
  40. package/docs/init-surface.manifest.json +3 -1
  41. package/docs/skills/README.md +7 -7
  42. package/docs/templates/README.md +1 -0
  43. package/docs/templates/adr.md +60 -60
  44. package/docs/templates/agent-dag-authority-surface-audit.prompt.md +94 -94
  45. package/docs/templates/agent-dag-decision-envelope.schema.json +213 -213
  46. package/docs/templates/agent-dag-decision-gate.prompt.md +246 -246
  47. package/docs/templates/agent-dag-process-supervisor.prompt.md +98 -98
  48. package/docs/templates/agent-dag-report.schema.json +473 -473
  49. package/docs/templates/agent-dag-review-verdict.prompt.md +68 -68
  50. package/docs/templates/backend-test-dag.json +9 -9
  51. package/docs/templates/backend-test-result.schema.json +99 -99
  52. package/docs/templates/feature-spec.md +53 -53
  53. package/docs/templates/frontend-design-contract.md +42 -42
  54. package/docs/templates/frontend-eval/fixtures/failures/01-type-build-error.md +17 -17
  55. package/docs/templates/frontend-eval/fixtures/failures/02-unit-component-test-fail.md +16 -16
  56. package/docs/templates/frontend-eval/fixtures/failures/03-fixture-schema-drift.md +16 -16
  57. package/docs/templates/frontend-eval/fixtures/failures/04-missing-loading-empty-error-state.md +16 -16
  58. package/docs/templates/frontend-eval/fixtures/failures/05-forbidden-write-writeset-expansion.md +16 -16
  59. package/docs/templates/frontend-eval/fixtures/failures/06-unapproved-dependency-add.md +16 -16
  60. package/docs/templates/frontend-eval/fixtures/failures/07-mock-production-on.md +21 -21
  61. package/docs/templates/frontend-eval/fixtures/functional/01-simple-component-style.md +29 -29
  62. package/docs/templates/frontend-eval/fixtures/functional/02-form-validation.md +28 -28
  63. package/docs/templates/frontend-eval/fixtures/functional/03-list-detail-page.md +28 -28
  64. package/docs/templates/frontend-eval/fixtures/functional/04-api-mock.md +29 -29
  65. package/docs/templates/frontend-eval/fixtures/functional/05-permission-auth-gated-ui.md +27 -27
  66. package/docs/templates/frontend-eval/fixtures/functional/06-ssr-server-client-boundary.md +28 -28
  67. package/docs/templates/frontend-eval/fixtures/functional/07-shared-public-component-api.md +28 -28
  68. package/docs/templates/frontend-eval/fixtures/functional/08-pure-local-no-remote.md +27 -27
  69. package/docs/templates/frontend-eval/metrics.md +138 -138
  70. package/docs/templates/frontend-eval/smoke-targets.md +53 -53
  71. package/docs/templates/frontend-task-constraints.md +35 -35
  72. package/docs/templates/frontend-task-requirement.md +70 -70
  73. package/docs/templates/harness.schema.json +29 -7
  74. package/docs/templates/init-evolution-review.md +35 -35
  75. package/docs/templates/init-managed-agents.md +137 -0
  76. package/docs/templates/interactive-ui-round2-experiment.md +66 -66
  77. package/docs/templates/knowledge-graph-bootstrap-dag.json +118 -118
  78. package/docs/templates/knowledge-sync-dag.json +178 -178
  79. package/docs/templates/knowledge-sync-draft.schema.json +71 -71
  80. package/docs/templates/product-line/closeout.yaml +9 -9
  81. package/docs/templates/product-line/design.md +13 -13
  82. package/docs/templates/product-line/links.md +10 -10
  83. package/docs/templates/product-line/requirement.md +17 -17
  84. package/docs/templates/product-line/test-plan.md +7 -7
  85. package/docs/templates/production-readiness-checklist.md +57 -57
  86. package/docs/templates/project-start-checklist.md +9 -9
  87. package/docs/templates/qa-report.md +48 -48
  88. package/docs/templates/sprint-contract.md +29 -29
  89. package/docs/templates/worker-dogfood-evidence.md +80 -80
  90. package/docs/templates/worker-dogfood-setup.md +68 -68
  91. package/harness.json +1 -2
  92. package/package.json +1 -1
  93. package/scripts/kb-bootstrap-init-skeleton.sh +0 -0
  94. package/scripts/kb-graph-incremental-prepare.mjs +386 -386
  95. package/scripts/kb-graph-materialize.mjs +105 -105
  96. package/scripts/kb-graph-promote.mjs +164 -164
  97. package/scripts/kb-query.mjs +554 -554
  98. package/skills/ai-engineering-context/SKILL.md +48 -48
  99. package/skills/analyze-product-dependencies/SKILL.md +67 -67
  100. package/skills/analyze-product-dependencies/agents/openai.yaml +4 -4
  101. package/skills/analyze-product-dependencies/references/api-documentation-schema.md +30 -30
  102. package/skills/analyze-product-dependencies/references/dependency-analysis-schema.md +28 -28
  103. package/skills/analyze-product-dependencies/references/example.md +76 -76
  104. package/skills/analyze-product-dependencies/references/forward-test-cases.md +35 -35
  105. package/skills/analyze-product-dependencies/references/input-contract.md +11 -11
  106. package/skills/analyze-product-dependencies/references/scouting-rules.md +61 -61
  107. package/skills/analyze-product-dependencies/scripts/test-validators.mjs +267 -267
  108. package/skills/analyze-product-dependencies/scripts/validate-api-documentation.mjs +101 -101
  109. package/skills/analyze-product-dependencies/scripts/validate-dependency-analysis.mjs +142 -142
  110. package/skills/analyze-product-dependencies/scripts/validate-product-requirement-input.mjs +76 -76
  111. package/skills/analyze-product-dependencies/scripts/validation-helpers.mjs +146 -146
  112. package/skills/analyze-product-requirements/SKILL.md +90 -90
  113. package/skills/analyze-product-requirements/agents/openai.yaml +4 -4
  114. package/skills/analyze-product-requirements/references/acceptance-criteria.md +91 -91
  115. package/skills/analyze-product-requirements/references/clarification-and-knowledge.md +56 -56
  116. package/skills/analyze-product-requirements/references/example.md +86 -86
  117. package/skills/analyze-product-requirements/references/forward-test-cases.md +66 -66
  118. package/skills/analyze-product-requirements/references/product-analysis-schema.md +32 -32
  119. package/skills/analyze-product-requirements/references/product-requirement-schema.md +33 -33
  120. package/skills/analyze-product-requirements/references/requirement-clarification-schema.md +35 -35
  121. package/skills/analyze-product-requirements/scripts/test-validators.mjs +193 -193
  122. package/skills/analyze-product-requirements/scripts/validate-product-analysis.mjs +69 -69
  123. package/skills/analyze-product-requirements/scripts/validate-product-requirement.mjs +97 -97
  124. package/skills/analyze-product-requirements/scripts/validate-requirement-clarification.mjs +98 -98
  125. package/skills/analyze-product-requirements/scripts/validation-helpers.mjs +156 -156
  126. package/skills/browser-tools/browser-content.js +103 -103
  127. package/skills/browser-tools/browser-cookies.js +35 -35
  128. package/skills/browser-tools/browser-eval.js +53 -53
  129. package/skills/browser-tools/browser-hn-scraper.js +108 -108
  130. package/skills/browser-tools/browser-nav.js +44 -44
  131. package/skills/browser-tools/browser-pick.js +162 -162
  132. package/skills/browser-tools/browser-screenshot.js +34 -34
  133. package/skills/browser-tools/browser-start.js +86 -86
  134. package/skills/browser-tools/package-lock.json +2556 -2556
  135. package/skills/browser-tools/package.json +19 -19
  136. package/skills/code-review-core/SKILL.md +20 -20
  137. package/skills/codebase-scout/SKILL.md +19 -19
  138. package/skills/grill-me/SKILL.md +10 -10
  139. package/skills/loop-agent/references/README.md +67 -67
  140. package/skills/loop-agent/references/command-reference.md +5 -4
  141. package/skills/loop-agent/references/docs-converge.md +126 -126
  142. package/skills/loop-agent/references/hybrid-dag.md +2 -2
  143. package/skills/loop-agent/references/learned/README.md +21 -21
  144. package/skills/loop-agent/references/long-running-loop.md +57 -57
  145. package/skills/loop-agent/references/model-routing.md +2 -0
  146. package/skills/loop-agent/references/one-shot-runs.md +85 -85
  147. package/skills/loop-agent/references/pi-prompt.md +23 -23
  148. package/skills/loop-agent/references/pi-subagent-assisted-mode.md +84 -84
  149. package/skills/playwright-cli/SKILL.md +420 -420
  150. package/skills/playwright-cli/references/element-attributes.md +23 -23
  151. package/skills/playwright-cli/references/playwright-tests.md +39 -39
  152. package/skills/playwright-cli/references/request-mocking.md +87 -87
  153. package/skills/playwright-cli/references/running-code.md +241 -241
  154. package/skills/playwright-cli/references/session-management.md +225 -225
  155. package/skills/playwright-cli/references/storage-state.md +275 -275
  156. package/skills/playwright-cli/references/test-generation.md +433 -433
  157. package/skills/playwright-cli/references/tracing.md +139 -139
  158. package/skills/playwright-cli/references/video-recording.md +143 -143
  159. package/skills/requesting-code-review/SKILL.md +101 -101
  160. package/skills/requesting-code-review/code-reviewer.md +168 -168
  161. package/skills/systematic-debugging/CREATION-LOG.md +119 -119
  162. package/skills/systematic-debugging/condition-based-waiting-example.ts +158 -158
  163. package/skills/systematic-debugging/condition-based-waiting.md +115 -115
  164. package/skills/systematic-debugging/defense-in-depth.md +122 -122
  165. package/skills/systematic-debugging/find-polluter.sh +63 -63
  166. package/skills/systematic-debugging/root-cause-tracing.md +169 -169
  167. package/skills/systematic-debugging/test-academic.md +14 -14
  168. package/skills/systematic-debugging/test-pressure-1.md +58 -58
  169. package/skills/systematic-debugging/test-pressure-2.md +68 -68
  170. package/skills/systematic-debugging/test-pressure-3.md +69 -69
  171. package/skills/using-git-worktrees/SKILL.md +215 -215
  172. package/skills/verification-before-completion/SKILL.md +154 -154
  173. package/skills/webapp-testing/SKILL.md +19 -19
@@ -1,70 +1,70 @@
1
- # 前端任务需求模板
2
-
3
- ## 用户目标
4
-
5
- TODO
6
-
7
- ## 目标页面/组件/路由
8
-
9
- TODO
10
-
11
- ## 用户流程
12
-
13
- TODO
14
-
15
- ## 必须状态
16
-
17
- ### loading
18
-
19
- TODO
20
-
21
- ### empty
22
-
23
- TODO
24
-
25
- ### error
26
-
27
- TODO
28
-
29
- ### success
30
-
31
- TODO
32
-
33
- ### disabled
34
-
35
- TODO
36
-
37
- ## 目标运行环境
38
-
39
- ### desktop
40
-
41
- TODO
42
-
43
- ### mobile
44
-
45
- TODO
46
-
47
- ### tablet
48
-
49
- TODO
50
-
51
- ## 交互要求
52
-
53
- TODO
54
-
55
- ## 接口与 Mock 输入
56
-
57
- - 接口文档/schema:TODO
58
- - endpoint、method、关键请求/响应字段:TODO
59
- - 是否允许依赖真实后端:TODO
60
- - 是否要求离线或独立行为验证:TODO
61
- - success/empty/error/permission 状态:TODO
62
- - 后端当前就绪状态与 Real Integration Gap:TODO
63
-
64
- ## 验收标准
65
-
66
- TODO
67
-
68
- ## 非目标
69
-
70
- TODO
1
+ # 前端任务需求模板
2
+
3
+ ## 用户目标
4
+
5
+ TODO
6
+
7
+ ## 目标页面/组件/路由
8
+
9
+ TODO
10
+
11
+ ## 用户流程
12
+
13
+ TODO
14
+
15
+ ## 必须状态
16
+
17
+ ### loading
18
+
19
+ TODO
20
+
21
+ ### empty
22
+
23
+ TODO
24
+
25
+ ### error
26
+
27
+ TODO
28
+
29
+ ### success
30
+
31
+ TODO
32
+
33
+ ### disabled
34
+
35
+ TODO
36
+
37
+ ## 目标运行环境
38
+
39
+ ### desktop
40
+
41
+ TODO
42
+
43
+ ### mobile
44
+
45
+ TODO
46
+
47
+ ### tablet
48
+
49
+ TODO
50
+
51
+ ## 交互要求
52
+
53
+ TODO
54
+
55
+ ## 接口与 Mock 输入
56
+
57
+ - 接口文档/schema:TODO
58
+ - endpoint、method、关键请求/响应字段:TODO
59
+ - 是否允许依赖真实后端:TODO
60
+ - 是否要求离线或独立行为验证:TODO
61
+ - success/empty/error/permission 状态:TODO
62
+ - 后端当前就绪状态与 Real Integration Gap:TODO
63
+
64
+ ## 验收标准
65
+
66
+ TODO
67
+
68
+ ## 非目标
69
+
70
+ TODO
@@ -187,10 +187,32 @@
187
187
  "enum": ["standard-dag", "review-gated-dag", "supervised-implementation"],
188
188
  "description": "某个治理 profile 选择的 DAG 生成模板。"
189
189
  },
190
+ "executorTierModel": {
191
+ "oneOf": [
192
+ { "type": "string" },
193
+ {
194
+ "type": "object",
195
+ "additionalProperties": false,
196
+ "required": ["model"],
197
+ "properties": {
198
+ "model": {
199
+ "type": "string",
200
+ "minLength": 1,
201
+ "description": "模型 id 或 provider/model 限定引用。"
202
+ },
203
+ "thinking": {
204
+ "type": "string",
205
+ "description": "可选 Pi thinking level(如 max/low)。省略时不强制覆盖 Pi 默认。"
206
+ }
207
+ }
208
+ }
209
+ ],
210
+ "description": "executor 复杂度档模型:字符串 model id,或 { model, thinking? }。字面值 default 表示不覆盖。"
211
+ },
190
212
  "executor": {
191
213
  "type": "object",
192
214
  "additionalProperties": false,
193
- "description": "executor 设置。DAG 模型选择优先读取 LOW/MED/HIGH,其次读取 defaultModel,最后回退到 loop-agent runtime 默认矩阵。字面值 default 表示不覆盖。",
215
+ "description": "executor 设置。DAG 模型选择优先读取 LOW/MED/HIGH,其次读取 defaultModel,最后回退到 loop-agent runtime 默认矩阵。字面值 default 表示不覆盖。LOW/MED/HIGH 可为字符串或 { model, thinking? } 对象。",
194
216
  "properties": {
195
217
  "description": { "type": "string" },
196
218
  "enabled": { "type": "boolean" },
@@ -200,16 +222,16 @@
200
222
  "default": "default"
201
223
  },
202
224
  "LOW": {
203
- "type": "string",
204
- "description": "LOW 复杂度 DAG task 的模型覆盖值,优先级高于 defaultModel"
225
+ "$ref": "#/$defs/executorTierModel",
226
+ "description": "LOW 复杂度 DAG task 的模型覆盖值,优先级高于 defaultModel。可为模型字符串,或 { model, thinking? } 对象。"
205
227
  },
206
228
  "MED": {
207
- "type": "string",
208
- "description": "MED 复杂度 DAG task 的模型覆盖值,优先级高于 defaultModel"
229
+ "$ref": "#/$defs/executorTierModel",
230
+ "description": "MED 复杂度 DAG task 的模型覆盖值,优先级高于 defaultModel。可为模型字符串,或 { model, thinking? } 对象。"
209
231
  },
210
232
  "HIGH": {
211
- "type": "string",
212
- "description": "HIGH 复杂度 DAG task 的模型覆盖值,优先级高于 defaultModel"
233
+ "$ref": "#/$defs/executorTierModel",
234
+ "description": "HIGH 复杂度 DAG task 的模型覆盖值,优先级高于 defaultModel。可为模型字符串,或 { model, thinking? } 对象。"
213
235
  },
214
236
  "requiresApiKey": {
215
237
  "type": "string",
@@ -1,35 +1,35 @@
1
- # Init Evolution Review
2
-
3
- Date:
4
- Base: `<full commit SHA or resolvable --base ref>`
5
- Head: `<full commit SHA for the reviewed HEAD>`
6
-
7
- `bash scripts/check-init-evolution-needed.sh --strict --base <ref>` 接受 Base 精确匹配该 `<ref>`、Head 为当前 `HEAD` 或其可解析祖先提交的报告。历史报告、`working tree` 等不可解析文字不能为其他变更范围放行严格检查。当 Head 是祖先时,`reportHead..HEAD` 区间内出现新的 `model-review` 高影响路径会使报告失效;仅 `advisory` 或 `surface-check` 的后续变化不影响已完成的高影响审查。
8
-
9
- ## Changed Surface
10
-
11
- -
12
-
13
- ## Decision
14
-
15
- Choose one:
16
-
17
- - No init impact
18
- - Surface check only
19
- - Init update required
20
-
21
- Rationale:
22
-
23
- ## Updates Made
24
-
25
- -
26
-
27
- ## Verification
28
-
29
- ```bash
30
- # commands and results
31
- ```
32
-
33
- ## Residual Risk
34
-
35
- -
1
+ # Init Evolution Review
2
+
3
+ Date:
4
+ Base: `<full commit SHA or resolvable --base ref>`
5
+ Head: `<full commit SHA for the reviewed HEAD>`
6
+
7
+ `bash scripts/check-init-evolution-needed.sh --strict --base <ref>` 接受 Base 精确匹配该 `<ref>`、Head 为当前 `HEAD` 或其可解析祖先提交的报告。历史报告、`working tree` 等不可解析文字不能为其他变更范围放行严格检查。当 Head 是祖先时,`reportHead..HEAD` 区间内出现新的 `model-review` 高影响路径会使报告失效;仅 `advisory` 或 `surface-check` 的后续变化不影响已完成的高影响审查。
8
+
9
+ ## Changed Surface
10
+
11
+ -
12
+
13
+ ## Decision
14
+
15
+ Choose one:
16
+
17
+ - No init impact
18
+ - Surface check only
19
+ - Init update required
20
+
21
+ Rationale:
22
+
23
+ ## Updates Made
24
+
25
+ -
26
+
27
+ ## Verification
28
+
29
+ ```bash
30
+ # commands and results
31
+ ```
32
+
33
+ ## Residual Risk
34
+
35
+ -
@@ -0,0 +1,137 @@
1
+ <!--
2
+ Source template for target-project AGENTS.md managed block.
3
+ Rendered by src/commands/init.ts (buildManagedAgentsBlock).
4
+
5
+ Placeholders (must keep exact spelling):
6
+ - __LOOP_AGENT_PROJECT_NAME__
7
+ - __LOOP_AGENT_GOVERNANCE_ROOT__
8
+
9
+ Markers LOOP_AGENT_INIT_START / LOOP_AGENT_INIT_END (HTML comments) are required as the sole body wrapper.
10
+ Phrase invariants: docs/architecture/agents-invariants.md (section 二).
11
+ This file is package-only: shipped in npm, NOT copied into target governance templates/.
12
+ -->
13
+ <!-- LOOP_AGENT_INIT_START -->
14
+ ## loop-agent 治理
15
+
16
+ 本仓库已初始化为 `__LOOP_AGENT_PROJECT_NAME__` 的 loop-agent harness 项目。
17
+
18
+ ### 默认立场
19
+
20
+ - 仓库是记录系统:决策、契约、计划、验证、报告和交接应进入可追踪文件。
21
+ - 一次只推进一个有边界、可验证的工作块;实现前先搜索现有代码、文档、脚本和测试。
22
+ - Shell 验证是完成依据;模型建议不能替代命令证据。
23
+ - 保留无关的用户改动,不要回退自己没有做的修改。
24
+ - 委托模型写入前,必须把写入边界写成结构化 `task.json.allowedPaths` / `task.json.forbiddenPaths`,再审查生成 DAG 的 writer `writeSet`;不要只依赖 `source/执行约束.md` 的自然语言约束。
25
+ - 本仓库对 openCode 等主会话的定位是 **Compatibility / Operator Assist**:主会话编排 CLI 与只读诊断,**不是**默认实现 agent。
26
+
27
+ ### 主会话硬约束(Compatibility / Operator Assist)
28
+
29
+ 主会话(含 openCode、Cursor Chat、其他宿主 agent)= **operator-only**;skills 与本文件是纪律文档,**不能**替代 `task.json` / DAG `writeSet` / runtime 执法。
30
+
31
+ | 类别 | 规则 |
32
+ |---|---|
33
+ | **允许** | 已发布 `loop-agent` / `agent-worker` CLI;只读 status/doctor/report/inspect/observe;准备 `source/*` 与 `task.json` 边界;human gate;shell 验证与 handoff。 |
34
+ | **禁止** | 绕过 CLI 用宿主 Edit/Write/ApplyPatch 直接改业务实现;CLI/DAG 失败后「救火改文件」;用聊天自述代替 shell 验证。 |
35
+ | **失败时** | `dag doctor` / `dag report` / `dag reconcile-run`(及适用 worker reconcile);修正任务源/`task.json`/DAG 后经 CLI 重跑。 |
36
+ | **实现写入** | 业务代码 **只** 经受治理 DAG writer(`implement-pi` / `repair-pi`)经 `dag run-task` / `run-dag`。 |
37
+
38
+ **永远不要**:`loop-agent` / `agent-worker` 失败 ⇒ 主会话直接改仓库实现。
39
+
40
+ ### 自然语言入口路由
41
+
42
+ | 用户表达 | 入口 | 执行动作 |
43
+ |---|---|---|
44
+ | loop-agent 初始化 / loop agent 初始化 / loop agent初始化 / 初始化 loop-agent | 初始化 | 完成确定性初始化闭环 |
45
+ | 初始化更新校验 / 检查初始化更新 / loop-agent 初始化更新校验 / loop agent初始化更新校验 | 更新校验 | 只读报告,不写入 |
46
+ | 初始化对齐 / 升级后对齐 / reconcile 初始化 / loop-agent 初始化对齐 | 升级对齐 | 自动应用确定性安全动作;surface 缺失、人工决策、活跃 DAG/Worker 或 Worker 状态无法确认时零写入 |
47
+ | 初始化安全更新 / 应用初始化更新 / loop-agent 初始化安全更新 / loop agent初始化安全更新 | 安全更新 | 先 check-update,再只执行确定性安全动作 |
48
+ | loop-agent 帮我完成 / 帮我实现 / 帮我修复 / 帮我开发 <需求>;使用 loop-agent 完成 <X>;按 loop-agent 流程处理 <X> | 通用需求实现 | 先建任务源与 `task.json.allowedPaths` / `forbiddenPaths`,再 `new-task` → `dag run-task` → `dag validate` → `run-dag`;主会话不得直接修改业务实现 |
49
+
50
+ **更新校验(只读)**:只读执行下面命令;**不得自动**执行 `apply-safe` 或模型合并。
51
+
52
+ ```bash
53
+ loop-agent init check-update --repo-root . --markdown
54
+ ```
55
+
56
+ **升级对齐**:`loop-agent init reconcile --repo-root .`;surface 缺失、human decisions、活跃 DAG/Worker 或 Worker 状态无法确认时必须零写入。
57
+
58
+ **安全更新**:先 check-update;surface 缺失时仅先建立 inferred baseline,再执行确定性 safe actions。不得自动处理 model merge tasks。
59
+
60
+ ```bash
61
+ loop-agent init check-update --repo-root . --markdown
62
+ loop-agent init update --repo-root . --bootstrap-surface # 仅 surface 缺失时
63
+ loop-agent init update --repo-root . --apply-safe
64
+ ```
65
+
66
+ ### 初始化闭环
67
+
68
+ 当用户要求初始化 loop-agent(“初始化 loop-agent”“loop agent 初始化”“loop agent初始化”“loop-agent 初始化”),或发现 `README.md` / `__LOOP_AGENT_GOVERNANCE_ROOT__/verification-matrix.md` 仍停留在通用初始化状态时,模型应在同一轮工作中完成初始化闭环,不要把补全文档和验证矩阵留给用户交互。
69
+
70
+ 1. 运行 `loop-agent init instructions --repo-root .`。
71
+ 2. 运行 `loop-agent init --repo-root . --profile full --merge`。
72
+ 3. 基于真实项目文件补全根 `README.md`、`__LOOP_AGENT_GOVERNANCE_ROOT__/verification-matrix.md`,必要时适配 `scripts/ci-tests.sh`。
73
+ 4. 运行 `loop-agent init doctor --repo-root .`、`loop-agent inspect`、`loop-agent docs audit` 并完成 quick verification。
74
+
75
+ 信息不足时写明尚未识别到的事实;不要留下泛化占位符。
76
+
77
+ ### 文档收敛
78
+
79
+ 完成实现和验证后,必须检查 `README.md`、`AGENTS.md`、`CHANGELOG.md`(如果目标项目维护)、治理文档、skills references、初始化模板和脚本说明是否仍与实际行为一致。只更新与本次变更相关的内容;如果决定不更新,应在交接里写明理由。
80
+
81
+ ### 开始顺序
82
+
83
+ pwd → `README.md` → `harness.json` → `__LOOP_AGENT_GOVERNANCE_ROOT__/README.md` → 实现类再读 principles/feature-workflow/verification-matrix;测试纪律读 harness-methodology-*;`git status`;最小基线验证。
84
+
85
+ ### Agent DAG 路径
86
+
87
+ ```bash
88
+ loop-agent new-task <task-id> "任务标题"
89
+ # 有原始 PRD 时(推荐):loop-agent import-prd <task-id> --file <path-to-prd.md>
90
+ # 非微小或跨会话任务(推荐):loop-agent plan create <plan-id> "<title>"
91
+ # write .harness/tasks/<task-id>/source/需求.md
92
+ # write .harness/tasks/<task-id>/source/执行约束.md
93
+ loop-agent dag run-task <task-id> --profile auto --strict-models
94
+ loop-agent dag validate --dag .harness/tasks/<task-id>/dag.json --strict-models --strict-governance
95
+ loop-agent run-dag --dag .harness/tasks/<task-id>/dag.json --cwd .
96
+ # 有 plan 时收尾:loop-agent plan complete <plan-id> --summary "..."
97
+ ```
98
+
99
+ `source/需求.md` 与 `source/执行约束.md` 必需;有原始 PRD 时优先用 `import-prd` 原样归档。`import-prd` / `plan create` 不是 `dag run-task` 的硬依赖。写入前同步 `task.json.allowedPaths` / `task.json.forbiddenPaths` 并审查 writer `writeSet`。
100
+
101
+ 凡是影响项目公共契约、执行入口、交付流水线、自动化/治理、数据模型、安全或权限模型、跨模块行为、用户可见工作流的改动,都必须在编辑实现文件前先创建任务、写好两个 source 文件、生成 DAG,并审查 DAG/writeSet。
102
+
103
+ ### 任务类型路由(taskKind)
104
+
105
+ - 用户明确提出后端测试、接口/API 测试、pytest,或语境明确为后端的自动化测试时,必须把 `.harness/tasks/<task-id>/task.json` 的 `taskKind` 设置为 `"backend-test"`,不得保留默认 `standard`。
106
+ - `backend-test` 是 `taskKind`,不是 `--profile` 的可选值;运行 `dag run-task` 时继续使用 `--profile auto`。
107
+ - 仅出现“自动化测试”且无法判断前后端时,先阅读任务源与目标项目技术栈再决定,禁止无条件路由到 `backend-test`。
108
+ - 用户提示词明确是前端实现需求(例如前端页面、UI、组件或交互开发)时,必须把 `.harness/tasks/<task-id>/task.json` 的 `taskKind` 设置为 `"frontend-implementation"`,不得保留默认 `standard`。
109
+ - `frontend-implementation` 是 `taskKind`,不是 `--profile` 的可选值;运行 `dag run-task` 时继续使用 `--profile auto`,也可按需显式选择 `minimal` / `standard` / `reviewed` / `supervised`,不要把业务模板名当作 profile。
110
+ - 前端自动化测试(浏览器/UI 自动化、Playwright、E2E)继续使用 `taskKind: "frontend-test"`,不得设置为 `frontend-implementation`。
111
+
112
+ ### 运行看板(只读)
113
+
114
+ ```bash
115
+ agent-worker console # 默认 repo=当前目录,port=8790
116
+ agent-worker console serve --repo . --port 8790 # 兼容入口,等价于上面裸入口
117
+ ```
118
+
119
+ 浏览器打开 `http://127.0.0.1:8790/`;检视面为 `http://127.0.0.1:8790/inspect/`。默认绑定本机 `127.0.0.1`;不要直接暴露到公开网络。端口被占用时不会自动更换,请用 `--port <port>` 显式指定。`agent-worker observe serve` 仅为兼容入口。
120
+
121
+ ### DAG 诊断与收口
122
+
123
+ live run 先用 `loop-agent dag status --run-id <run-id>` 看 lifecycle 与 liveness;用 `loop-agent dag report --run-id <run-id> --markdown` 读 facts;失败/paused 用 `loop-agent dag doctor --run-id <run-id> --markdown`。生命周期对齐先只读运行 `loop-agent dag reconcile-run --run-id <run-id>`;只有 runner 已停止且 operator 明确提供 `--action supersede|abandon --reason "..."` 时才允许变更。失败 run 用 `loop-agent dag closeout-draft --run-id <run-id>` 生成 failure handoff,不要写成成功 closeout。
124
+
125
+ Runner heartbeat 只证明 lease;Provider/tool/output 活动才代表 meaningful progress,不得仅凭运行时长结束节点。恢复:status/doctor/report → classify → reconcile/replan → CLI 重跑 → shell verify。**禁止**把主会话直接 Edit 业务代码当作恢复手段。
126
+
127
+ ### 运行态与验证
128
+
129
+ - `.harness/tasks/`、`.harness/dag-runs/`、`.harness/runs/` 保存运行事实;已完成事实只读。
130
+ - `.agents/skills/` 为本地 skills;缺失时可回退 npm 包内置。
131
+ - 验证命令选择:`__LOOP_AGENT_GOVERNANCE_ROOT__/verification-matrix.md`。常用:`bash scripts/check-repo.sh`、`bash scripts/ci.sh`、`loop-agent inspect`、`loop-agent doctor`、`loop-agent docs audit`。
132
+ - `scripts/ci-tests.sh` 必须反映目标项目真实工具链。Windows 脚本用 Git Bash;仓库引用用 `/`。
133
+
134
+ ### 交接
135
+
136
+ 交接写清变更、原因、验证证据、影响面、风险与下一步;长期结论进入 `__LOOP_AGENT_GOVERNANCE_ROOT__/progress`、reports、exec-plans、decisions。
137
+ <!-- LOOP_AGENT_INIT_END -->
@@ -1,66 +1,66 @@
1
- # Interactive UI Round-2 A/B/C Experiment
2
-
3
- ## Frozen inputs
4
-
5
- - Target repo / commit:
6
- - Controller version:
7
- - TaskSpec / acceptance hash:
8
- - Base DAG:
9
- - Model matrix:
10
-
11
- Prepare the fixture and three DAGs after installing a published controller that contains `interactive-ui` support:
12
-
13
- ```bash
14
- bash scripts-local/setup-drill-round2-react.sh /tmp/drill-round2-react-target
15
- npm run build
16
- node scripts-local/prepare-round2-ui-experiment.mjs \
17
- /tmp/drill-round2-react-target \
18
- features/F-2026-001/tasks/FE-001.yaml \
19
- /tmp/round2-ui-experiment \
20
- loop-agent
21
- node scripts-local/build-round2-ui-variants.mjs \
22
- /tmp/round2-ui-experiment/round2-ui-base.json \
23
- /tmp/round2-ui-experiment/variants
24
- ```
25
-
26
- Validate every generated variant with the same frozen controller before running it. Use a unique run ID for A, B, and C; do not rewrite `executorModels`.
27
-
28
- ## Variants
29
-
30
- | Variant | Writer prompt | Writer tier | Run ID | Result |
31
- | --- | --- | --- | --- | --- |
32
- | A | interactive-ui contract | MED | | |
33
- | B | default contract | HIGH | | |
34
- | C | interactive-ui contract | HIGH | | |
35
-
36
- ## Metrics
37
-
38
- | Metric | A | B | C |
39
- | --- | --- | --- | --- |
40
- | First-pass review gate pass | | | |
41
- | Framework-native `.tsx` component | | | |
42
- | Route/parent integration | | | |
43
- | DOM interaction tests | | | |
44
- | Helper-only escape | | | |
45
- | Duration | | | |
46
- | Tokens | | | |
47
-
48
- ## Required evidence per run
49
-
50
- - DAG JSON and run ID
51
- - implement/repair writer model and prompt profile
52
- - changed component path
53
- - integration path
54
- - interaction test path
55
- - DOM assertions mapped to AC-FE-001
56
- - review verdict and deterministic test output
57
- - diff boundary audit
58
-
59
- ## Decision
60
-
61
- - Production default:
62
- - Evidence:
63
- - Cost/quality trade-off:
64
- - Follow-up:
65
-
66
- Do not conclude from a single run when provider or environment failures occurred. Re-run the affected variant with the same frozen inputs and a new run ID.
1
+ # Interactive UI Round-2 A/B/C Experiment
2
+
3
+ ## Frozen inputs
4
+
5
+ - Target repo / commit:
6
+ - Controller version:
7
+ - TaskSpec / acceptance hash:
8
+ - Base DAG:
9
+ - Model matrix:
10
+
11
+ Prepare the fixture and three DAGs after installing a published controller that contains `interactive-ui` support:
12
+
13
+ ```bash
14
+ bash scripts-local/setup-drill-round2-react.sh /tmp/drill-round2-react-target
15
+ npm run build
16
+ node scripts-local/prepare-round2-ui-experiment.mjs \
17
+ /tmp/drill-round2-react-target \
18
+ features/F-2026-001/tasks/FE-001.yaml \
19
+ /tmp/round2-ui-experiment \
20
+ loop-agent
21
+ node scripts-local/build-round2-ui-variants.mjs \
22
+ /tmp/round2-ui-experiment/round2-ui-base.json \
23
+ /tmp/round2-ui-experiment/variants
24
+ ```
25
+
26
+ Validate every generated variant with the same frozen controller before running it. Use a unique run ID for A, B, and C; do not rewrite `executorModels`.
27
+
28
+ ## Variants
29
+
30
+ | Variant | Writer prompt | Writer tier | Run ID | Result |
31
+ | --- | --- | --- | --- | --- |
32
+ | A | interactive-ui contract | MED | | |
33
+ | B | default contract | HIGH | | |
34
+ | C | interactive-ui contract | HIGH | | |
35
+
36
+ ## Metrics
37
+
38
+ | Metric | A | B | C |
39
+ | --- | --- | --- | --- |
40
+ | First-pass review gate pass | | | |
41
+ | Framework-native `.tsx` component | | | |
42
+ | Route/parent integration | | | |
43
+ | DOM interaction tests | | | |
44
+ | Helper-only escape | | | |
45
+ | Duration | | | |
46
+ | Tokens | | | |
47
+
48
+ ## Required evidence per run
49
+
50
+ - DAG JSON and run ID
51
+ - implement/repair writer model and prompt profile
52
+ - changed component path
53
+ - integration path
54
+ - interaction test path
55
+ - DOM assertions mapped to AC-FE-001
56
+ - review verdict and deterministic test output
57
+ - diff boundary audit
58
+
59
+ ## Decision
60
+
61
+ - Production default:
62
+ - Evidence:
63
+ - Cost/quality trade-off:
64
+ - Follow-up:
65
+
66
+ Do not conclude from a single run when provider or environment failures occurred. Re-run the affected variant with the same frozen inputs and a new run ID.