@tea-agent/loop-agent 0.12.0 → 0.13.0-beta.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (284) hide show
  1. package/AGENTS.md +155 -153
  2. package/CHANGELOG.md +338 -265
  3. package/README.md +345 -298
  4. package/bin/agent-worker.js +22 -22
  5. package/bin/loop-agent.js +21 -21
  6. package/dist/application/dag/generate-task-dag.js +28 -28
  7. package/dist/application/evaluation/candidate-hash.js +75 -0
  8. package/dist/application/evaluation/candidate.js +52 -0
  9. package/dist/application/evaluation/replay.js +289 -0
  10. package/dist/application/evaluation/types.js +130 -0
  11. package/dist/cli/command-definitions.js +27 -7
  12. package/dist/cli/program.js +8 -4
  13. package/dist/commands/cursor-prompt.js +6 -6
  14. package/dist/commands/eval.js +235 -0
  15. package/dist/commands/init.js +544 -506
  16. package/dist/commands/knowledge.js +129 -31
  17. package/dist/commands/loop-benchmark.js +11 -11
  18. package/dist/commands/pi-reuse-benchmark.js +16 -16
  19. package/dist/executors/pi-sdk-executor.js +38 -24
  20. package/dist/executors/shell-executor.js +34 -2
  21. package/dist/executors/shell-presets.js +20 -0
  22. package/dist/executors/shell-verification.js +7 -0
  23. package/dist/governance/manifest-types.js +4 -0
  24. package/dist/infrastructure/evaluation/candidate-store.js +435 -0
  25. package/dist/infrastructure/evaluation/store.js +40 -0
  26. package/dist/sidecars/cursor-prompt/executor.js +1 -1
  27. package/dist/task/config-types.js +28 -1
  28. package/dist/task/runtime.js +27 -27
  29. package/dist/worker/cli.js +96 -1
  30. package/dist/worker/delivery/package.js +3 -3
  31. package/dist/worker/feature/decision-loader.js +37 -6
  32. package/dist/worker/feature/next-action.js +10 -2
  33. package/dist/worker/feature/ready-plan-projection.js +81 -0
  34. package/dist/worker/feature/reducer.js +2 -1
  35. package/dist/worker/feature/review.js +19 -2
  36. package/dist/worker/feature/run.js +27 -2
  37. package/dist/worker/follow-up/approve.js +5 -2
  38. package/dist/worker/follow-up/factory.js +1 -1
  39. package/dist/worker/observability/read-model.js +246 -41
  40. package/dist/worker/observe/routes.js +173 -15
  41. package/dist/worker/observe/spec-evidence.js +281 -0
  42. package/dist/worker/observe/static/api.js +46 -27
  43. package/dist/worker/observe/static/app.js +150 -150
  44. package/dist/worker/observe/static/constants.js +148 -148
  45. package/dist/worker/observe/static/copy.js +67 -67
  46. package/dist/worker/observe/static/dag-helpers.js +172 -172
  47. package/dist/worker/observe/static/dag-layout.d.ts +31 -31
  48. package/dist/worker/observe/static/dag-layout.js +83 -83
  49. package/dist/worker/observe/static/dag-model.js +72 -72
  50. package/dist/worker/observe/static/dom.js +61 -61
  51. package/dist/worker/observe/static/format-pool.js +67 -67
  52. package/dist/worker/observe/static/format.js +292 -292
  53. package/dist/worker/observe/static/index.html +308 -308
  54. package/dist/worker/observe/static/kpi.js +94 -94
  55. package/dist/worker/observe/static/relations.js +133 -128
  56. package/dist/worker/observe/static/router.js +93 -85
  57. package/dist/worker/observe/static/run-processing.js +148 -148
  58. package/dist/worker/observe/static/shell-chrome.js +68 -68
  59. package/dist/worker/observe/static/state.js +253 -253
  60. package/dist/worker/observe/static/styles.css +1902 -1890
  61. package/dist/worker/observe/static/views/batch.js +227 -226
  62. package/dist/worker/observe/static/views/dag-graph.js +172 -172
  63. package/dist/worker/observe/static/views/dag-inspector.js +607 -477
  64. package/dist/worker/observe/static/views/dag.js +362 -362
  65. package/dist/worker/observe/static/views/dashboard.js +445 -442
  66. package/dist/worker/observe/static/views/failures.js +143 -143
  67. package/dist/worker/observe/static/views/feature.js +492 -453
  68. package/dist/worker/observe/static/views/pool.js +350 -347
  69. package/dist/worker/observe/static/views/run.js +453 -453
  70. package/dist/worker/observe/static/views/session-timeline.js +205 -205
  71. package/dist/worker/observe/static/views/shell.js +7 -7
  72. package/dist/worker/observe/static/views/task.js +314 -260
  73. package/dist/worker/observe/static/views/timeline.js +163 -163
  74. package/dist/worker/pool/doctor.js +165 -0
  75. package/dist/worker/pool/migrate-state.js +303 -0
  76. package/dist/worker/pool/run-store.js +205 -17
  77. package/dist/worker/pool/types.js +17 -1
  78. package/dist/worker/pool/validation.js +100 -15
  79. package/dist/worker/report/morning-report.js +12 -2
  80. package/dist/worker/runner/run-ready.js +41 -26
  81. package/dist/worker/task-graph/ready-planner.js +136 -0
  82. package/dist/workflows/dag/backend-test-analysis-contract.js +120 -0
  83. package/dist/workflows/dag/canvas-observer.js +275 -275
  84. package/dist/workflows/dag/convergence/controller.js +16 -8
  85. package/dist/workflows/dag/dynamic-runtime/map.js +90 -2
  86. package/dist/workflows/dag/failure-routing.js +12 -1
  87. package/dist/workflows/dag/init-hybrid.js +2404 -360
  88. package/dist/workflows/dag/node-execution.js +9 -0
  89. package/dist/workflows/dag/prompt.js +9 -0
  90. package/dist/workflows/dag/report.js +35 -1
  91. package/dist/workflows/dag/runner.js +28 -2
  92. package/dist/workflows/dag/task-demand-routing.js +383 -0
  93. package/dist/workflows/dag/types.js +51 -13
  94. package/dist/workflows/dag/upstream-artifacts.js +1 -0
  95. package/dist/workflows/dag/validate.js +59 -1
  96. package/docs/README.md +106 -104
  97. package/docs/agent-dag-recovery-playbook.md +195 -184
  98. package/docs/agent-dag-runner.md +67 -67
  99. package/docs/architecture/README.md +26 -26
  100. package/docs/architecture/dag-execution.md +140 -140
  101. package/docs/architecture/evolution.md +54 -53
  102. package/docs/architecture/facts-and-state.md +71 -58
  103. package/docs/architecture/runtime-boundaries.md +191 -191
  104. package/docs/architecture/system-overview.md +93 -93
  105. package/docs/architecture/worker-and-feature.md +85 -81
  106. package/docs/cursor-prompt-sidecar.md +36 -36
  107. package/docs/decisions/README.md +18 -15
  108. package/docs/design/README.md +167 -77
  109. package/docs/development-principles.md +73 -73
  110. package/docs/exec-plans/README.md +6 -6
  111. package/docs/exec-plans/active/README.md +15 -9
  112. package/docs/exec-plans/completed/README.md +85 -73
  113. package/docs/feature-workflow.md +389 -261
  114. package/docs/harness-methodology-debugging.md +153 -153
  115. package/docs/harness-methodology-tdd.md +130 -130
  116. package/docs/harness-methodology-verification.md +27 -27
  117. package/docs/init-surface.manifest.json +289 -280
  118. package/docs/loop-agent-harness.md +142 -130
  119. package/docs/production-readiness.md +96 -96
  120. package/docs/progress/README.md +64 -54
  121. package/docs/reports/README.md +117 -94
  122. package/docs/skills/README.md +7 -7
  123. package/docs/skills/vetted-skill-registry.md +29 -27
  124. package/docs/templates/adr.md +60 -60
  125. package/docs/templates/agent-dag-authority-surface-audit.prompt.md +94 -94
  126. package/docs/templates/agent-dag-decision-envelope.schema.json +213 -213
  127. package/docs/templates/agent-dag-decision-gate-dogfood-report.md +117 -117
  128. package/docs/templates/agent-dag-decision-gate.prompt.md +246 -246
  129. package/docs/templates/agent-dag-process-supervisor.prompt.md +98 -98
  130. package/docs/templates/agent-dag-report.schema.json +473 -473
  131. package/docs/templates/agent-dag-review-verdict.prompt.md +68 -68
  132. package/docs/templates/agent-dag.base.json +190 -190
  133. package/docs/templates/agent-dag.final-verification.json +185 -185
  134. package/docs/templates/agent-dag.schema.json +411 -383
  135. package/docs/templates/agent-dag.supervised-implementation.json +501 -501
  136. package/docs/templates/backend-test-analysis.schema.json +44 -0
  137. package/docs/templates/backend-test-dag.generate-pytest.prompt.md +202 -139
  138. package/docs/templates/backend-test-dag.json +311 -276
  139. package/docs/templates/backend-test-dag.retrospect.prompt.md +125 -125
  140. package/docs/templates/backend-test-dag.review-cases.prompt.md +81 -81
  141. package/docs/templates/exec-plan.md +64 -64
  142. package/docs/templates/feature-spec.md +53 -53
  143. package/docs/templates/frontend-design-contract.md +42 -33
  144. package/docs/templates/frontend-task-constraints.md +35 -25
  145. package/docs/templates/frontend-task-requirement.md +70 -61
  146. package/docs/templates/frontend-test-dag.generate-cases.prompt.md +5 -0
  147. package/docs/templates/frontend-test-dag.json +23 -0
  148. package/docs/templates/frontend-test-dag.retrieve-context.prompt.md +3 -0
  149. package/docs/templates/frontend-test-dag.retrospect.prompt.md +3 -0
  150. package/docs/templates/frontend-test-dag.review-cases.prompt.md +3 -0
  151. package/docs/templates/frontend-test-dag.review-execution.prompt.md +3 -0
  152. package/docs/templates/harness.schema.json +221 -221
  153. package/docs/templates/hybrid-dag.json +188 -188
  154. package/docs/templates/init-evolution-review.md +35 -35
  155. package/docs/templates/interactive-ui-round2-experiment.md +66 -66
  156. package/docs/templates/knowledge-graph-bootstrap-dag.json +118 -0
  157. package/docs/templates/knowledge-sync-dag.json +178 -0
  158. package/docs/templates/knowledge-sync-draft.schema.json +71 -0
  159. package/docs/templates/product-line/AGENTS.md +8 -8
  160. package/docs/templates/product-line/README.md +9 -9
  161. package/docs/templates/product-line/acceptance.yaml +14 -14
  162. package/docs/templates/product-line/closeout.yaml +9 -9
  163. package/docs/templates/product-line/design.md +13 -13
  164. package/docs/templates/product-line/links.md +10 -10
  165. package/docs/templates/product-line/requirement.md +17 -17
  166. package/docs/templates/product-line/task-graph.yaml +15 -15
  167. package/docs/templates/product-line/task.yaml +64 -64
  168. package/docs/templates/product-line/test-plan.md +7 -7
  169. package/docs/templates/production-readiness-checklist.md +57 -57
  170. package/docs/templates/progress-log.md +17 -17
  171. package/docs/templates/project-start-checklist.md +9 -9
  172. package/docs/templates/qa-report.md +48 -48
  173. package/docs/templates/sprint-contract.md +29 -29
  174. package/docs/templates/worker-dogfood-evidence.md +80 -80
  175. package/docs/templates/worker-dogfood-setup.md +68 -68
  176. package/docs/verification-matrix.md +70 -66
  177. package/examples/decision-gate-agent-dag.json +177 -177
  178. package/examples/example-dag.json +46 -46
  179. package/examples/hybrid-loop-agent-dag.json +189 -189
  180. package/harness.json +66 -66
  181. package/package.json +88 -46
  182. package/scripts/check-product-line-docs.sh +29 -29
  183. package/scripts/check-task-pool-root.sh +32 -32
  184. package/scripts/kb-bootstrap-init-skeleton.sh +240 -0
  185. package/scripts/kb-graph-incremental-prepare.mjs +386 -0
  186. package/scripts/kb-graph-incremental-prepare.sh +5 -0
  187. package/scripts/kb-graph-materialize.mjs +105 -0
  188. package/scripts/kb-graph-materialize.sh +4 -0
  189. package/scripts/kb-graph-promote.mjs +164 -0
  190. package/scripts/kb-graph-promote.sh +4 -0
  191. package/scripts/kb-query.mjs +554 -0
  192. package/scripts/kb-query.sh +5 -0
  193. package/skills/agent-worker/SKILL.md +39 -37
  194. package/skills/agent-worker/references/agent-worker-operator.md +60 -43
  195. package/skills/ai-engineering-context/SKILL.md +48 -48
  196. package/skills/analyze-product-dependencies/SKILL.md +67 -0
  197. package/skills/analyze-product-dependencies/agents/openai.yaml +4 -0
  198. package/skills/analyze-product-dependencies/references/api-documentation-schema.md +30 -0
  199. package/skills/analyze-product-dependencies/references/dependency-analysis-schema.md +28 -0
  200. package/skills/analyze-product-dependencies/references/example.md +76 -0
  201. package/skills/analyze-product-dependencies/references/forward-test-cases.md +35 -0
  202. package/skills/analyze-product-dependencies/references/input-contract.md +11 -0
  203. package/skills/analyze-product-dependencies/references/scouting-rules.md +61 -0
  204. package/skills/analyze-product-dependencies/scripts/test-validators.mjs +267 -0
  205. package/skills/analyze-product-dependencies/scripts/validate-api-documentation.mjs +101 -0
  206. package/skills/analyze-product-dependencies/scripts/validate-dependency-analysis.mjs +142 -0
  207. package/skills/analyze-product-dependencies/scripts/validate-product-requirement-input.mjs +76 -0
  208. package/skills/analyze-product-dependencies/scripts/validation-helpers.mjs +146 -0
  209. package/skills/analyze-product-requirements/SKILL.md +90 -0
  210. package/skills/analyze-product-requirements/agents/openai.yaml +4 -0
  211. package/skills/analyze-product-requirements/references/acceptance-criteria.md +91 -0
  212. package/skills/analyze-product-requirements/references/clarification-and-knowledge.md +56 -0
  213. package/skills/analyze-product-requirements/references/example.md +86 -0
  214. package/skills/analyze-product-requirements/references/forward-test-cases.md +66 -0
  215. package/skills/analyze-product-requirements/references/product-analysis-schema.md +32 -0
  216. package/skills/analyze-product-requirements/references/product-requirement-schema.md +33 -0
  217. package/skills/analyze-product-requirements/references/requirement-clarification-schema.md +35 -0
  218. package/skills/analyze-product-requirements/scripts/test-validators.mjs +193 -0
  219. package/skills/analyze-product-requirements/scripts/validate-product-analysis.mjs +69 -0
  220. package/skills/analyze-product-requirements/scripts/validate-product-requirement.mjs +97 -0
  221. package/skills/analyze-product-requirements/scripts/validate-requirement-clarification.mjs +98 -0
  222. package/skills/analyze-product-requirements/scripts/validation-helpers.mjs +156 -0
  223. package/skills/code-review-core/SKILL.md +20 -20
  224. package/skills/codebase-scout/SKILL.md +19 -19
  225. package/skills/frontend-design-review/SKILL.md +66 -59
  226. package/skills/frontend-design-review/references/review-checklist.md +58 -37
  227. package/skills/frontend-implementation/SKILL.md +47 -51
  228. package/skills/frontend-implementation/references/code-standards.md +32 -34
  229. package/skills/frontend-implementation/references/design-spec.md +46 -46
  230. package/skills/frontend-implementation/references/node-contracts.md +76 -32
  231. package/skills/frontend-review/SKILL.md +59 -53
  232. package/skills/frontend-review/references/review-findings.md +47 -42
  233. package/skills/frontend-verification/SKILL.md +53 -40
  234. package/skills/frontend-verification/references/verification-checklist.md +68 -56
  235. package/skills/grill-me/SKILL.md +10 -10
  236. package/skills/grill-with-docs/SKILL.md +88 -88
  237. package/skills/grill-with-docs/adr-format.md +47 -47
  238. package/skills/grill-with-docs/context-format.md +60 -60
  239. package/skills/init-capability-evolution/SKILL.md +70 -70
  240. package/skills/loop-agent/SKILL.md +151 -151
  241. package/skills/loop-agent/references/README.md +67 -67
  242. package/skills/loop-agent/references/command-reference.md +505 -452
  243. package/skills/loop-agent/references/docs-converge.md +126 -126
  244. package/skills/loop-agent/references/harness-policy.md +263 -263
  245. package/skills/loop-agent/references/hybrid-dag.md +238 -233
  246. package/skills/loop-agent/references/learned/README.md +21 -21
  247. package/skills/loop-agent/references/long-running-loop.md +57 -57
  248. package/skills/loop-agent/references/model-routing.md +36 -36
  249. package/skills/loop-agent/references/multi-worktree.md +54 -54
  250. package/skills/loop-agent/references/one-shot-runs.md +85 -85
  251. package/skills/loop-agent/references/orchestrator-and-interventions.md +169 -169
  252. package/skills/loop-agent/references/pi-prompt.md +23 -23
  253. package/skills/loop-agent/references/pi-subagent-assisted-mode.md +84 -84
  254. package/skills/loop-agent/references/post-implementation-and-patterns.md +44 -44
  255. package/skills/loop-agent/references/task-workflow.md +89 -89
  256. package/skills/loop-agent/references/verification-and-failure-handling.md +139 -139
  257. package/skills/playwright-cli/SKILL.md +420 -0
  258. package/skills/playwright-cli/references/element-attributes.md +23 -0
  259. package/skills/playwright-cli/references/playwright-tests.md +39 -0
  260. package/skills/playwright-cli/references/request-mocking.md +87 -0
  261. package/skills/playwright-cli/references/running-code.md +241 -0
  262. package/skills/playwright-cli/references/session-management.md +225 -0
  263. package/skills/playwright-cli/references/storage-state.md +275 -0
  264. package/skills/playwright-cli/references/test-generation.md +433 -0
  265. package/skills/playwright-cli/references/tracing.md +139 -0
  266. package/skills/playwright-cli/references/video-recording.md +143 -0
  267. package/skills/playwright-cli-case-generator/SKILL.md +74 -0
  268. package/skills/requesting-code-review/SKILL.md +101 -101
  269. package/skills/requesting-code-review/code-reviewer.md +168 -168
  270. package/skills/systematic-debugging/CREATION-LOG.md +119 -119
  271. package/skills/systematic-debugging/SKILL.md +296 -296
  272. package/skills/systematic-debugging/condition-based-waiting-example.ts +158 -158
  273. package/skills/systematic-debugging/condition-based-waiting.md +115 -115
  274. package/skills/systematic-debugging/defense-in-depth.md +122 -122
  275. package/skills/systematic-debugging/find-polluter.sh +63 -63
  276. package/skills/systematic-debugging/root-cause-tracing.md +169 -169
  277. package/skills/systematic-debugging/test-academic.md +14 -14
  278. package/skills/systematic-debugging/test-pressure-1.md +58 -58
  279. package/skills/systematic-debugging/test-pressure-2.md +68 -68
  280. package/skills/systematic-debugging/test-pressure-3.md +69 -69
  281. package/skills/test-driven-development/SKILL.md +20 -20
  282. package/skills/using-git-worktrees/SKILL.md +215 -215
  283. package/skills/verification-before-completion/SKILL.md +154 -154
  284. package/skills/webapp-testing/SKILL.md +19 -19
@@ -1,64 +1,64 @@
1
- schema_version: 1
2
- id: BE-001
3
- feature_id: F-YYYY-NNN
4
- title: <Bounded tracer-bullet task>
5
- description: <Observable delivery>
6
- repo:
7
- name: <repository-name>
8
- path_ref: <repository-path-reference>
9
- default_branch: main
10
- type: backend-feature
11
- priority: P1
12
- risk_level: medium
13
- depends_on: []
14
- source_docs:
15
- requirement: ../requirement.md
16
- acceptance: ../acceptance.yaml
17
- design: ../design.md
18
- test_plan: ../test-plan.md
19
- acceptance_refs:
20
- - AC-FEATURE-001
21
- scope:
22
- goals:
23
- - <goal>
24
- non_goals:
25
- - <non-goal>
26
- constraints:
27
- allowed_paths:
28
- - <owned/path/**>
29
- forbidden_paths:
30
- - <protected/path/**>
31
- hard_constraints:
32
- - Do not access production secrets
33
- verify:
34
- preset: standard
35
- mode: serial
36
- commands:
37
- - id: focused-test
38
- label: Focused deterministic verification
39
- command: <project-specific verification command>
40
- required: true
41
- timeout_ms: 300000
42
- worker:
43
- execution_mode: generate-validate-run
44
- max_attempts: 1
45
- timeout_ms: 7200000
46
- require_clean_worktree: true
47
- require_human_review: true
48
- create_worktree: false
49
- loop_agent:
50
- profile_policy: mapped
51
- strict_models: true
52
- strict_governance: true
53
- max_concurrent: 1
54
- outputs:
55
- required:
56
- - dag_json
57
- - run_record
58
- - shell_verification
59
- - diff_patch
60
- - closeout_or_failure_handoff
61
- failure_policy:
62
- failed_run_promote: false
63
- generate_closeout_draft: true
64
- create_followup_task: true
1
+ schema_version: 1
2
+ id: BE-001
3
+ feature_id: F-YYYY-NNN
4
+ title: <Bounded tracer-bullet task>
5
+ description: <Observable delivery>
6
+ repo:
7
+ name: <repository-name>
8
+ path_ref: <repository-path-reference>
9
+ default_branch: main
10
+ type: backend-feature
11
+ priority: P1
12
+ risk_level: medium
13
+ depends_on: []
14
+ source_docs:
15
+ requirement: ../requirement.md
16
+ acceptance: ../acceptance.yaml
17
+ design: ../design.md
18
+ test_plan: ../test-plan.md
19
+ acceptance_refs:
20
+ - AC-FEATURE-001
21
+ scope:
22
+ goals:
23
+ - <goal>
24
+ non_goals:
25
+ - <non-goal>
26
+ constraints:
27
+ allowed_paths:
28
+ - <owned/path/**>
29
+ forbidden_paths:
30
+ - <protected/path/**>
31
+ hard_constraints:
32
+ - Do not access production secrets
33
+ verify:
34
+ preset: standard
35
+ mode: serial
36
+ commands:
37
+ - id: focused-test
38
+ label: Focused deterministic verification
39
+ command: <project-specific verification command>
40
+ required: true
41
+ timeout_ms: 300000
42
+ worker:
43
+ execution_mode: generate-validate-run
44
+ max_attempts: 1
45
+ timeout_ms: 7200000
46
+ require_clean_worktree: true
47
+ require_human_review: true
48
+ create_worktree: false
49
+ loop_agent:
50
+ profile_policy: mapped
51
+ strict_models: true
52
+ strict_governance: true
53
+ max_concurrent: 1
54
+ outputs:
55
+ required:
56
+ - dag_json
57
+ - run_record
58
+ - shell_verification
59
+ - diff_patch
60
+ - closeout_or_failure_handoff
61
+ failure_policy:
62
+ failed_run_promote: false
63
+ generate_closeout_draft: true
64
+ create_followup_task: true
@@ -1,7 +1,7 @@
1
- # Test plan — <Feature title>
2
-
3
- | Test ID | Acceptance | Level | Scenario | Deterministic command |
4
- |---|---|---|---|---|
5
- | TC-001 | AC-FEATURE-001 | integration | happy path and primary failure | `<project-specific command>` |
6
-
7
- Include negative cases, regression scope, environment assumptions, and evidence locations. Commands must match the target project's real toolchain.
1
+ # Test plan — <Feature title>
2
+
3
+ | Test ID | Acceptance | Level | Scenario | Deterministic command |
4
+ |---|---|---|---|---|
5
+ | TC-001 | AC-FEATURE-001 | integration | happy path and primary failure | `<project-specific command>` |
6
+
7
+ Include negative cases, regression scope, environment assumptions, and evidence locations. Commands must match the target project's real toolchain.
@@ -1,57 +1,57 @@
1
- # Production Readiness 检查清单
2
-
3
- 声称 Production Readiness v0.1 的低/中风险单仓库 DAG 任务使用本清单。
4
-
5
- ## 范围
6
-
7
- - [ ] 单仓库
8
- - [ ] 单任务或小范围有边界任务
9
- - [ ] 低或中风险
10
- - [ ] 无生产 secret 或生产数据库访问
11
- - [ ] 无自动 merge 或 release
12
- - [ ] 无 DAG runtime 之外的第二套 runner
13
- - [ ] 无可写 Dynamic Workflow sharded migration
14
-
15
- ## Task Contract
16
-
17
- - [ ] Task source 存在于 `.harness/tasks/<task-id>/source/`
18
- - [ ] `allowedPaths` 显式
19
- - [ ] `forbiddenPaths` 显式
20
- - [ ] `writeSet` 或预期写 scope 显式
21
- - [ ] Shell 验证命令显式
22
- - [ ] 非目标显式
23
-
24
- ## DAG 主路径
25
-
26
- - [ ] 已运行 `loop-agent new-task <task-id> "Task title"` 或 task 已存在
27
- - [ ] `loop-agent dag run-task <task-id> --profile auto --strict-models --output <dag-path>` 产出 DAG spec
28
- - [ ] `loop-agent dag validate --dag <dag-path> --strict-models --strict-governance` 通过
29
- - [ ] `loop-agent run-dag --dag <dag-path> --cwd .` 产出 run id
30
- - [ ] `loop-agent dag report --run-id <run-id> --markdown` 可读
31
- - [ ] `loop-agent dag doctor --run-id <run-id>` 能解释失败或 paused run
32
-
33
- ## 证据
34
-
35
- - [ ] 记录 DAG spec path
36
- - [ ] 记录 DAG validation 输出
37
- - [ ] 记录 run id
38
- - [ ] Shell 验证输出是新鲜的
39
- - [ ] 成功路径有 promotion 与 closeout 证据
40
- - [ ] 失败路径有 failure handoff 证据
41
-
42
- ## Failure Routing
43
-
44
- - [ ] 存在时保留 raw failure category
45
- - [ ] 失败 run 有 DAG normalized failure category
46
- - [ ] 失败 run 有 product-line failure category
47
- - [ ] 失败 run 有 recommended follow-up
48
- - [ ] 派生 category 未覆盖已完成 DAG facts
49
- - [ ] `Unknown` 已说明或为 fixture 有意接受
50
-
51
- ## 最终门禁
52
-
53
- - [ ] `npm run typecheck`
54
- - [ ] 相关定向 Vitest 文件
55
- - [ ] `bash scripts/check-repo.sh`
56
- - [ ] website/docs 变更时 `npm run docs:build`
57
- - [ ] 最终 sprint closeout 前 `bash scripts/ci.sh`
1
+ # Production Readiness 检查清单
2
+
3
+ 声称 Production Readiness v0.1 的低/中风险单仓库 DAG 任务使用本清单。
4
+
5
+ ## 范围
6
+
7
+ - [ ] 单仓库
8
+ - [ ] 单任务或小范围有边界任务
9
+ - [ ] 低或中风险
10
+ - [ ] 无生产 secret 或生产数据库访问
11
+ - [ ] 无自动 merge 或 release
12
+ - [ ] 无 DAG runtime 之外的第二套 runner
13
+ - [ ] 无可写 Dynamic Workflow sharded migration
14
+
15
+ ## Task Contract
16
+
17
+ - [ ] Task source 存在于 `.harness/tasks/<task-id>/source/`
18
+ - [ ] `allowedPaths` 显式
19
+ - [ ] `forbiddenPaths` 显式
20
+ - [ ] `writeSet` 或预期写 scope 显式
21
+ - [ ] Shell 验证命令显式
22
+ - [ ] 非目标显式
23
+
24
+ ## DAG 主路径
25
+
26
+ - [ ] 已运行 `loop-agent new-task <task-id> "Task title"` 或 task 已存在
27
+ - [ ] `loop-agent dag run-task <task-id> --profile auto --strict-models --output <dag-path>` 产出 DAG spec
28
+ - [ ] `loop-agent dag validate --dag <dag-path> --strict-models --strict-governance` 通过
29
+ - [ ] `loop-agent run-dag --dag <dag-path> --cwd .` 产出 run id
30
+ - [ ] `loop-agent dag report --run-id <run-id> --markdown` 可读
31
+ - [ ] `loop-agent dag doctor --run-id <run-id>` 能解释失败或 paused run
32
+
33
+ ## 证据
34
+
35
+ - [ ] 记录 DAG spec path
36
+ - [ ] 记录 DAG validation 输出
37
+ - [ ] 记录 run id
38
+ - [ ] Shell 验证输出是新鲜的
39
+ - [ ] 成功路径有 promotion 与 closeout 证据
40
+ - [ ] 失败路径有 failure handoff 证据
41
+
42
+ ## Failure Routing
43
+
44
+ - [ ] 存在时保留 raw failure category
45
+ - [ ] 失败 run 有 DAG normalized failure category
46
+ - [ ] 失败 run 有 product-line failure category
47
+ - [ ] 失败 run 有 recommended follow-up
48
+ - [ ] 派生 category 未覆盖已完成 DAG facts
49
+ - [ ] `Unknown` 已说明或为 fixture 有意接受
50
+
51
+ ## 最终门禁
52
+
53
+ - [ ] `npm run typecheck`
54
+ - [ ] 相关定向 Vitest 文件
55
+ - [ ] `bash scripts/check-repo.sh`
56
+ - [ ] website/docs 变更时 `npm run docs:build`
57
+ - [ ] 最终 sprint closeout 前 `bash scripts/ci.sh`
@@ -1,17 +1,17 @@
1
- # 进度日志模板
2
-
3
- ## 日期 / 会话
4
-
5
- ## 变更内容
6
-
7
- ## 已验证项
8
-
9
- ## 新发现的 Bug / 技术债 / 漂移
10
-
11
- - Bugs:
12
- - Debt:
13
- - Drift:
14
-
15
- ## 已知缺口 / 风险
16
-
17
- ## 推荐下一步
1
+ # 进度日志模板
2
+
3
+ ## 日期 / 会话
4
+
5
+ ## 变更内容
6
+
7
+ ## 已验证项
8
+
9
+ ## 新发现的 Bug / 技术债 / 漂移
10
+
11
+ - Bugs:
12
+ - Debt:
13
+ - Drift:
14
+
15
+ ## 已知缺口 / 风险
16
+
17
+ ## 推荐下一步
@@ -1,9 +1,9 @@
1
- # 项目开工检查清单
2
-
3
- - [ ] 确认 `pwd`
4
- - [ ] 阅读 `README.md`、`harness.json`,以及 `harness.json.governanceRoot` 指向的 `README.md`
5
- - [ ] 检查 `git status --short --branch`
6
- - [ ] 确定单一工作块
7
- - [ ] 从治理根目录下的 `verification-matrix.md` 选择验证命令
8
- - [ ] 保留无关用户变更
9
- - [ ] 非平凡工作时记录 handoff 证据
1
+ # 项目开工检查清单
2
+
3
+ - [ ] 确认 `pwd`
4
+ - [ ] 阅读 `README.md`、`harness.json`,以及 `harness.json.governanceRoot` 指向的 `README.md`
5
+ - [ ] 检查 `git status --short --branch`
6
+ - [ ] 确定单一工作块
7
+ - [ ] 从治理根目录下的 `verification-matrix.md` 选择验证命令
8
+ - [ ] 保留无关用户变更
9
+ - [ ] 非平凡工作时记录 handoff 证据
@@ -1,48 +1,48 @@
1
- # QA 报告模板
2
-
3
- ## 日期 / 会话
4
-
5
- ## 测试范围
6
-
7
- ## 相关 Contract / Plan
8
-
9
- ## 测试方法
10
-
11
- - 自动化测试:
12
- - 构建 / 类型检查:
13
- - Smoke / 手工路径:
14
- - 其他证据:
15
-
16
- ## Smoke / 手工检查
17
-
18
- - CLI smoke:
19
- - DAG smoke:
20
- - Loop workflow smoke:
21
- - Executor smoke:
22
- - 结果:pass / blocked / fail
23
-
24
- ## 通过标准
25
-
26
- ## 发现项
27
-
28
- | ID | Severity | Finding | Evidence | Suggested Fix |
29
- |----|----------|---------|----------|---------------|
30
-
31
- ## Failure Routing
32
-
33
- | Run / Scenario | Raw Failure | DAG Normalized Category | Product-line Category | Recommended Follow-up | Evidence |
34
- |---|---|---|---|---|---|
35
- | | | | | | |
36
-
37
- ## 新发现的 Bug / 漂移
38
-
39
- - 新发现 bug:
40
- - 发现的契约漂移:
41
- - 发现的文档/测试不一致:
42
-
43
- ## 最终结论
44
-
45
- - 结论:pass / partial / fail
46
- - 结论依据:
47
-
48
- ## 后续项
1
+ # QA 报告模板
2
+
3
+ ## 日期 / 会话
4
+
5
+ ## 测试范围
6
+
7
+ ## 相关 Contract / Plan
8
+
9
+ ## 测试方法
10
+
11
+ - 自动化测试:
12
+ - 构建 / 类型检查:
13
+ - Smoke / 手工路径:
14
+ - 其他证据:
15
+
16
+ ## Smoke / 手工检查
17
+
18
+ - CLI smoke:
19
+ - DAG smoke:
20
+ - Loop workflow smoke:
21
+ - Executor smoke:
22
+ - 结果:pass / blocked / fail
23
+
24
+ ## 通过标准
25
+
26
+ ## 发现项
27
+
28
+ | ID | Severity | Finding | Evidence | Suggested Fix |
29
+ |----|----------|---------|----------|---------------|
30
+
31
+ ## Failure Routing
32
+
33
+ | Run / Scenario | Raw Failure | DAG Normalized Category | Product-line Category | Recommended Follow-up | Evidence |
34
+ |---|---|---|---|---|---|
35
+ | | | | | | |
36
+
37
+ ## 新发现的 Bug / 漂移
38
+
39
+ - 新发现 bug:
40
+ - 发现的契约漂移:
41
+ - 发现的文档/测试不一致:
42
+
43
+ ## 最终结论
44
+
45
+ - 结论:pass / partial / fail
46
+ - 结论依据:
47
+
48
+ ## 后续项
@@ -1,29 +1,29 @@
1
- # Sprint Contract
2
-
3
- ## 目标(Objective)
4
-
5
- 描述有边界的工作块。
6
-
7
- ## 交付物(Deliverables)
8
-
9
- -
10
-
11
- ## 非目标(Non-goals)
12
-
13
- -
14
-
15
- ## 验证(Verification)
16
-
17
- ```bash
18
- bash scripts/check-repo.sh
19
- npm run typecheck
20
- npm test
21
- ```
22
-
23
- Windows 上通过 Git Bash 或已配置的兼容 Bash 运行脚本。实际文件操作用平台原生路径。
24
-
25
- ## 失败条件(Failure Conditions)
26
-
27
- - 必需验证无法运行或失败
28
- - 工作需要超出本 contract 的范围
29
- - 实现改动了无关文件
1
+ # Sprint Contract
2
+
3
+ ## 目标(Objective)
4
+
5
+ 描述有边界的工作块。
6
+
7
+ ## 交付物(Deliverables)
8
+
9
+ -
10
+
11
+ ## 非目标(Non-goals)
12
+
13
+ -
14
+
15
+ ## 验证(Verification)
16
+
17
+ ```bash
18
+ bash scripts/check-repo.sh
19
+ npm run typecheck
20
+ npm test
21
+ ```
22
+
23
+ Windows 上通过 Git Bash 或已配置的兼容 Bash 运行脚本。实际文件操作用平台原生路径。
24
+
25
+ ## 失败条件(Failure Conditions)
26
+
27
+ - 必需验证无法运行或失败
28
+ - 工作需要超出本 contract 的范围
29
+ - 实现改动了无关文件
@@ -1,80 +1,80 @@
1
- # Worker Dogfood Evidence
2
-
3
- ## Sample identity
4
-
5
- | Field | Value |
6
- |---|---|
7
- | Date | |
8
- | Feature / Task | |
9
- | Target repo | disposable path or sanitized reference |
10
- | Controller package/version | |
11
- | Agent-worker package/version (same npm install) | |
12
- | Controller requested entry / real entry | sanitized reference; keep machine-local absolute value in runtime evidence |
13
- | Controller launch command / args prefix | sanitized reference |
14
- | Controller binary SHA-256 | |
15
- | Controller package fingerprint | `sha256:<hex>` |
16
- | Expected controller version / fingerprint | n/a / exact values |
17
- | Provider/model / override | |
18
- | Batch ID | |
19
- | Worker run ID | |
20
- | Retry of worker run ID | n/a / |
21
- | Candidate commit / tarball SHA-256 | n/a / |
22
-
23
- ## Baseline
24
-
25
- - Baseline commit and `git status`:
26
- - Existing failing behavior or missing capability:
27
- - Preflight (`loop-agent --version`, `inspect`, `docs audit`, `check-repo`):
28
-
29
- ## Run evidence
30
-
31
- | Artifact | Path / link | Result |
32
- |---|---|---|
33
- | TaskSpec / source-doc copies | | |
34
- | DAG spec | | |
35
- | DAG report JSON / Markdown | | |
36
- | DAG skill snapshot ref / SHA-256 / mode | | |
37
- | shell verification | | |
38
- | diff | | |
39
- | closeout or Failure Handoff | | |
40
- | morning report | | |
41
- | Observe snapshot / events | | |
42
- | Controller identity in Worker / Task Pool / batch / Feature evidence | | |
43
-
44
- ## Candidate takeover evidence (if applicable)
45
-
46
- | Field | Value / result |
47
- |---|---|
48
- | Candidate isolated slot containment | |
49
- | `loop-agent` entry / binary SHA-256 / reported version | |
50
- | `agent-worker` entry / binary SHA-256 / reported version | |
51
- | Shared package fingerprint | |
52
- | Full init / doctor / inspect / docs audit / target check-repo | |
53
- | `agent-worker` skill and `.agents/skills` mirror hashes | |
54
- | Feature validation / `feature run --dry-run` | |
55
- | DAG executors | expected: `static`, `shell` only |
56
- | PATH trap invocations | expected: none |
57
- | Pi/model executor observed | expected: false; derive from actual DAG nodes |
58
- | Feature dry-run executed tasks | expected: empty |
59
- | Canary verdict / evidence path | |
60
-
61
- Do not use a deterministic canary result as proof that live Pi/model/provider execution succeeded. Record run-owned skill snapshot evidence and any explicitly authorized live run separately.
62
-
63
- ## Acceptance and QA coverage
64
-
65
- | Acceptance | Test case(s) | Test file / verification | Result |
66
- |---|---|---|---|
67
- | | | | |
68
-
69
- ## Failure / retry (if applicable)
70
-
71
- | Raw failure | Product-line category | Recommended follow-up | Root cause evidence | Retry result |
72
- |---|---|---|---|---|
73
- | | | | | |
74
-
75
- ## Conclusion
76
-
77
- - Verdict: pass / fail / blocked
78
- - Review notes:
79
- - Follow-up task(s):
80
- - Evidence limitations (for example deterministic-only, no Pi executor/live takeover):
1
+ # Worker Dogfood Evidence
2
+
3
+ ## Sample identity
4
+
5
+ | Field | Value |
6
+ |---|---|
7
+ | Date | |
8
+ | Feature / Task | |
9
+ | Target repo | disposable path or sanitized reference |
10
+ | Controller package/version | |
11
+ | Agent-worker package/version (same npm install) | |
12
+ | Controller requested entry / real entry | sanitized reference; keep machine-local absolute value in runtime evidence |
13
+ | Controller launch command / args prefix | sanitized reference |
14
+ | Controller binary SHA-256 | |
15
+ | Controller package fingerprint | `sha256:<hex>` |
16
+ | Expected controller version / fingerprint | n/a / exact values |
17
+ | Provider/model / override | |
18
+ | Batch ID | |
19
+ | Worker run ID | |
20
+ | Retry of worker run ID | n/a / |
21
+ | Candidate commit / tarball SHA-256 | n/a / |
22
+
23
+ ## Baseline
24
+
25
+ - Baseline commit and `git status`:
26
+ - Existing failing behavior or missing capability:
27
+ - Preflight (`loop-agent --version`, `inspect`, `docs audit`, `check-repo`):
28
+
29
+ ## Run evidence
30
+
31
+ | Artifact | Path / link | Result |
32
+ |---|---|---|
33
+ | TaskSpec / source-doc copies | | |
34
+ | DAG spec | | |
35
+ | DAG report JSON / Markdown | | |
36
+ | DAG skill snapshot ref / SHA-256 / mode | | |
37
+ | shell verification | | |
38
+ | diff | | |
39
+ | closeout or Failure Handoff | | |
40
+ | morning report | | |
41
+ | Observe snapshot / events | | |
42
+ | Controller identity in Worker / Task Pool / batch / Feature evidence | | |
43
+
44
+ ## Candidate takeover evidence (if applicable)
45
+
46
+ | Field | Value / result |
47
+ |---|---|
48
+ | Candidate isolated slot containment | |
49
+ | `loop-agent` entry / binary SHA-256 / reported version | |
50
+ | `agent-worker` entry / binary SHA-256 / reported version | |
51
+ | Shared package fingerprint | |
52
+ | Full init / doctor / inspect / docs audit / target check-repo | |
53
+ | `agent-worker` skill and `.agents/skills` mirror hashes | |
54
+ | Feature validation / `feature run --dry-run` | |
55
+ | DAG executors | expected: `static`, `shell` only |
56
+ | PATH trap invocations | expected: none |
57
+ | Pi/model executor observed | expected: false; derive from actual DAG nodes |
58
+ | Feature dry-run executed tasks | expected: empty |
59
+ | Canary verdict / evidence path | |
60
+
61
+ Do not use a deterministic canary result as proof that live Pi/model/provider execution succeeded. Record run-owned skill snapshot evidence and any explicitly authorized live run separately.
62
+
63
+ ## Acceptance and QA coverage
64
+
65
+ | Acceptance | Test case(s) | Test file / verification | Result |
66
+ |---|---|---|---|
67
+ | | | | |
68
+
69
+ ## Failure / retry (if applicable)
70
+
71
+ | Raw failure | Product-line category | Recommended follow-up | Root cause evidence | Retry result |
72
+ |---|---|---|---|---|
73
+ | | | | | |
74
+
75
+ ## Conclusion
76
+
77
+ - Verdict: pass / fail / blocked
78
+ - Review notes:
79
+ - Follow-up task(s):
80
+ - Evidence limitations (for example deterministic-only, no Pi executor/live takeover):