@tea-agent/loop-agent 0.12.0 → 0.13.0-beta.0
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/AGENTS.md +155 -153
- package/CHANGELOG.md +338 -265
- package/README.md +345 -298
- package/bin/agent-worker.js +22 -22
- package/bin/loop-agent.js +21 -21
- package/dist/application/dag/generate-task-dag.js +28 -28
- package/dist/application/evaluation/candidate-hash.js +75 -0
- package/dist/application/evaluation/candidate.js +52 -0
- package/dist/application/evaluation/replay.js +289 -0
- package/dist/application/evaluation/types.js +130 -0
- package/dist/cli/command-definitions.js +27 -7
- package/dist/cli/program.js +8 -4
- package/dist/commands/cursor-prompt.js +6 -6
- package/dist/commands/eval.js +235 -0
- package/dist/commands/init.js +544 -506
- package/dist/commands/knowledge.js +129 -31
- package/dist/commands/loop-benchmark.js +11 -11
- package/dist/commands/pi-reuse-benchmark.js +16 -16
- package/dist/executors/pi-sdk-executor.js +38 -24
- package/dist/executors/shell-executor.js +34 -2
- package/dist/executors/shell-presets.js +20 -0
- package/dist/executors/shell-verification.js +7 -0
- package/dist/governance/manifest-types.js +4 -0
- package/dist/infrastructure/evaluation/candidate-store.js +435 -0
- package/dist/infrastructure/evaluation/store.js +40 -0
- package/dist/sidecars/cursor-prompt/executor.js +1 -1
- package/dist/task/config-types.js +28 -1
- package/dist/task/runtime.js +27 -27
- package/dist/worker/cli.js +96 -1
- package/dist/worker/delivery/package.js +3 -3
- package/dist/worker/feature/decision-loader.js +37 -6
- package/dist/worker/feature/next-action.js +10 -2
- package/dist/worker/feature/ready-plan-projection.js +81 -0
- package/dist/worker/feature/reducer.js +2 -1
- package/dist/worker/feature/review.js +19 -2
- package/dist/worker/feature/run.js +27 -2
- package/dist/worker/follow-up/approve.js +5 -2
- package/dist/worker/follow-up/factory.js +1 -1
- package/dist/worker/observability/read-model.js +246 -41
- package/dist/worker/observe/routes.js +173 -15
- package/dist/worker/observe/spec-evidence.js +281 -0
- package/dist/worker/observe/static/api.js +46 -27
- package/dist/worker/observe/static/app.js +150 -150
- package/dist/worker/observe/static/constants.js +148 -148
- package/dist/worker/observe/static/copy.js +67 -67
- package/dist/worker/observe/static/dag-helpers.js +172 -172
- package/dist/worker/observe/static/dag-layout.d.ts +31 -31
- package/dist/worker/observe/static/dag-layout.js +83 -83
- package/dist/worker/observe/static/dag-model.js +72 -72
- package/dist/worker/observe/static/dom.js +61 -61
- package/dist/worker/observe/static/format-pool.js +67 -67
- package/dist/worker/observe/static/format.js +292 -292
- package/dist/worker/observe/static/index.html +308 -308
- package/dist/worker/observe/static/kpi.js +94 -94
- package/dist/worker/observe/static/relations.js +133 -128
- package/dist/worker/observe/static/router.js +93 -85
- package/dist/worker/observe/static/run-processing.js +148 -148
- package/dist/worker/observe/static/shell-chrome.js +68 -68
- package/dist/worker/observe/static/state.js +253 -253
- package/dist/worker/observe/static/styles.css +1902 -1890
- package/dist/worker/observe/static/views/batch.js +227 -226
- package/dist/worker/observe/static/views/dag-graph.js +172 -172
- package/dist/worker/observe/static/views/dag-inspector.js +607 -477
- package/dist/worker/observe/static/views/dag.js +362 -362
- package/dist/worker/observe/static/views/dashboard.js +445 -442
- package/dist/worker/observe/static/views/failures.js +143 -143
- package/dist/worker/observe/static/views/feature.js +492 -453
- package/dist/worker/observe/static/views/pool.js +350 -347
- package/dist/worker/observe/static/views/run.js +453 -453
- package/dist/worker/observe/static/views/session-timeline.js +205 -205
- package/dist/worker/observe/static/views/shell.js +7 -7
- package/dist/worker/observe/static/views/task.js +314 -260
- package/dist/worker/observe/static/views/timeline.js +163 -163
- package/dist/worker/pool/doctor.js +165 -0
- package/dist/worker/pool/migrate-state.js +303 -0
- package/dist/worker/pool/run-store.js +205 -17
- package/dist/worker/pool/types.js +17 -1
- package/dist/worker/pool/validation.js +100 -15
- package/dist/worker/report/morning-report.js +12 -2
- package/dist/worker/runner/run-ready.js +41 -26
- package/dist/worker/task-graph/ready-planner.js +136 -0
- package/dist/workflows/dag/backend-test-analysis-contract.js +120 -0
- package/dist/workflows/dag/canvas-observer.js +275 -275
- package/dist/workflows/dag/convergence/controller.js +16 -8
- package/dist/workflows/dag/dynamic-runtime/map.js +90 -2
- package/dist/workflows/dag/failure-routing.js +12 -1
- package/dist/workflows/dag/init-hybrid.js +2404 -360
- package/dist/workflows/dag/node-execution.js +9 -0
- package/dist/workflows/dag/prompt.js +9 -0
- package/dist/workflows/dag/report.js +35 -1
- package/dist/workflows/dag/runner.js +28 -2
- package/dist/workflows/dag/task-demand-routing.js +383 -0
- package/dist/workflows/dag/types.js +51 -13
- package/dist/workflows/dag/upstream-artifacts.js +1 -0
- package/dist/workflows/dag/validate.js +59 -1
- package/docs/README.md +106 -104
- package/docs/agent-dag-recovery-playbook.md +195 -184
- package/docs/agent-dag-runner.md +67 -67
- package/docs/architecture/README.md +26 -26
- package/docs/architecture/dag-execution.md +140 -140
- package/docs/architecture/evolution.md +54 -53
- package/docs/architecture/facts-and-state.md +71 -58
- package/docs/architecture/runtime-boundaries.md +191 -191
- package/docs/architecture/system-overview.md +93 -93
- package/docs/architecture/worker-and-feature.md +85 -81
- package/docs/cursor-prompt-sidecar.md +36 -36
- package/docs/decisions/README.md +18 -15
- package/docs/design/README.md +167 -77
- package/docs/development-principles.md +73 -73
- package/docs/exec-plans/README.md +6 -6
- package/docs/exec-plans/active/README.md +15 -9
- package/docs/exec-plans/completed/README.md +85 -73
- package/docs/feature-workflow.md +389 -261
- package/docs/harness-methodology-debugging.md +153 -153
- package/docs/harness-methodology-tdd.md +130 -130
- package/docs/harness-methodology-verification.md +27 -27
- package/docs/init-surface.manifest.json +289 -280
- package/docs/loop-agent-harness.md +142 -130
- package/docs/production-readiness.md +96 -96
- package/docs/progress/README.md +64 -54
- package/docs/reports/README.md +117 -94
- package/docs/skills/README.md +7 -7
- package/docs/skills/vetted-skill-registry.md +29 -27
- package/docs/templates/adr.md +60 -60
- package/docs/templates/agent-dag-authority-surface-audit.prompt.md +94 -94
- package/docs/templates/agent-dag-decision-envelope.schema.json +213 -213
- package/docs/templates/agent-dag-decision-gate-dogfood-report.md +117 -117
- package/docs/templates/agent-dag-decision-gate.prompt.md +246 -246
- package/docs/templates/agent-dag-process-supervisor.prompt.md +98 -98
- package/docs/templates/agent-dag-report.schema.json +473 -473
- package/docs/templates/agent-dag-review-verdict.prompt.md +68 -68
- package/docs/templates/agent-dag.base.json +190 -190
- package/docs/templates/agent-dag.final-verification.json +185 -185
- package/docs/templates/agent-dag.schema.json +411 -383
- package/docs/templates/agent-dag.supervised-implementation.json +501 -501
- package/docs/templates/backend-test-analysis.schema.json +44 -0
- package/docs/templates/backend-test-dag.generate-pytest.prompt.md +202 -139
- package/docs/templates/backend-test-dag.json +311 -276
- package/docs/templates/backend-test-dag.retrospect.prompt.md +125 -125
- package/docs/templates/backend-test-dag.review-cases.prompt.md +81 -81
- package/docs/templates/exec-plan.md +64 -64
- package/docs/templates/feature-spec.md +53 -53
- package/docs/templates/frontend-design-contract.md +42 -33
- package/docs/templates/frontend-task-constraints.md +35 -25
- package/docs/templates/frontend-task-requirement.md +70 -61
- package/docs/templates/frontend-test-dag.generate-cases.prompt.md +5 -0
- package/docs/templates/frontend-test-dag.json +23 -0
- package/docs/templates/frontend-test-dag.retrieve-context.prompt.md +3 -0
- package/docs/templates/frontend-test-dag.retrospect.prompt.md +3 -0
- package/docs/templates/frontend-test-dag.review-cases.prompt.md +3 -0
- package/docs/templates/frontend-test-dag.review-execution.prompt.md +3 -0
- package/docs/templates/harness.schema.json +221 -221
- package/docs/templates/hybrid-dag.json +188 -188
- package/docs/templates/init-evolution-review.md +35 -35
- package/docs/templates/interactive-ui-round2-experiment.md +66 -66
- package/docs/templates/knowledge-graph-bootstrap-dag.json +118 -0
- package/docs/templates/knowledge-sync-dag.json +178 -0
- package/docs/templates/knowledge-sync-draft.schema.json +71 -0
- package/docs/templates/product-line/AGENTS.md +8 -8
- package/docs/templates/product-line/README.md +9 -9
- package/docs/templates/product-line/acceptance.yaml +14 -14
- package/docs/templates/product-line/closeout.yaml +9 -9
- package/docs/templates/product-line/design.md +13 -13
- package/docs/templates/product-line/links.md +10 -10
- package/docs/templates/product-line/requirement.md +17 -17
- package/docs/templates/product-line/task-graph.yaml +15 -15
- package/docs/templates/product-line/task.yaml +64 -64
- package/docs/templates/product-line/test-plan.md +7 -7
- package/docs/templates/production-readiness-checklist.md +57 -57
- package/docs/templates/progress-log.md +17 -17
- package/docs/templates/project-start-checklist.md +9 -9
- package/docs/templates/qa-report.md +48 -48
- package/docs/templates/sprint-contract.md +29 -29
- package/docs/templates/worker-dogfood-evidence.md +80 -80
- package/docs/templates/worker-dogfood-setup.md +68 -68
- package/docs/verification-matrix.md +70 -66
- package/examples/decision-gate-agent-dag.json +177 -177
- package/examples/example-dag.json +46 -46
- package/examples/hybrid-loop-agent-dag.json +189 -189
- package/harness.json +66 -66
- package/package.json +88 -46
- package/scripts/check-product-line-docs.sh +29 -29
- package/scripts/check-task-pool-root.sh +32 -32
- package/scripts/kb-bootstrap-init-skeleton.sh +240 -0
- package/scripts/kb-graph-incremental-prepare.mjs +386 -0
- package/scripts/kb-graph-incremental-prepare.sh +5 -0
- package/scripts/kb-graph-materialize.mjs +105 -0
- package/scripts/kb-graph-materialize.sh +4 -0
- package/scripts/kb-graph-promote.mjs +164 -0
- package/scripts/kb-graph-promote.sh +4 -0
- package/scripts/kb-query.mjs +554 -0
- package/scripts/kb-query.sh +5 -0
- package/skills/agent-worker/SKILL.md +39 -37
- package/skills/agent-worker/references/agent-worker-operator.md +60 -43
- package/skills/ai-engineering-context/SKILL.md +48 -48
- package/skills/analyze-product-dependencies/SKILL.md +67 -0
- package/skills/analyze-product-dependencies/agents/openai.yaml +4 -0
- package/skills/analyze-product-dependencies/references/api-documentation-schema.md +30 -0
- package/skills/analyze-product-dependencies/references/dependency-analysis-schema.md +28 -0
- package/skills/analyze-product-dependencies/references/example.md +76 -0
- package/skills/analyze-product-dependencies/references/forward-test-cases.md +35 -0
- package/skills/analyze-product-dependencies/references/input-contract.md +11 -0
- package/skills/analyze-product-dependencies/references/scouting-rules.md +61 -0
- package/skills/analyze-product-dependencies/scripts/test-validators.mjs +267 -0
- package/skills/analyze-product-dependencies/scripts/validate-api-documentation.mjs +101 -0
- package/skills/analyze-product-dependencies/scripts/validate-dependency-analysis.mjs +142 -0
- package/skills/analyze-product-dependencies/scripts/validate-product-requirement-input.mjs +76 -0
- package/skills/analyze-product-dependencies/scripts/validation-helpers.mjs +146 -0
- package/skills/analyze-product-requirements/SKILL.md +90 -0
- package/skills/analyze-product-requirements/agents/openai.yaml +4 -0
- package/skills/analyze-product-requirements/references/acceptance-criteria.md +91 -0
- package/skills/analyze-product-requirements/references/clarification-and-knowledge.md +56 -0
- package/skills/analyze-product-requirements/references/example.md +86 -0
- package/skills/analyze-product-requirements/references/forward-test-cases.md +66 -0
- package/skills/analyze-product-requirements/references/product-analysis-schema.md +32 -0
- package/skills/analyze-product-requirements/references/product-requirement-schema.md +33 -0
- package/skills/analyze-product-requirements/references/requirement-clarification-schema.md +35 -0
- package/skills/analyze-product-requirements/scripts/test-validators.mjs +193 -0
- package/skills/analyze-product-requirements/scripts/validate-product-analysis.mjs +69 -0
- package/skills/analyze-product-requirements/scripts/validate-product-requirement.mjs +97 -0
- package/skills/analyze-product-requirements/scripts/validate-requirement-clarification.mjs +98 -0
- package/skills/analyze-product-requirements/scripts/validation-helpers.mjs +156 -0
- package/skills/code-review-core/SKILL.md +20 -20
- package/skills/codebase-scout/SKILL.md +19 -19
- package/skills/frontend-design-review/SKILL.md +66 -59
- package/skills/frontend-design-review/references/review-checklist.md +58 -37
- package/skills/frontend-implementation/SKILL.md +47 -51
- package/skills/frontend-implementation/references/code-standards.md +32 -34
- package/skills/frontend-implementation/references/design-spec.md +46 -46
- package/skills/frontend-implementation/references/node-contracts.md +76 -32
- package/skills/frontend-review/SKILL.md +59 -53
- package/skills/frontend-review/references/review-findings.md +47 -42
- package/skills/frontend-verification/SKILL.md +53 -40
- package/skills/frontend-verification/references/verification-checklist.md +68 -56
- package/skills/grill-me/SKILL.md +10 -10
- package/skills/grill-with-docs/SKILL.md +88 -88
- package/skills/grill-with-docs/adr-format.md +47 -47
- package/skills/grill-with-docs/context-format.md +60 -60
- package/skills/init-capability-evolution/SKILL.md +70 -70
- package/skills/loop-agent/SKILL.md +151 -151
- package/skills/loop-agent/references/README.md +67 -67
- package/skills/loop-agent/references/command-reference.md +505 -452
- package/skills/loop-agent/references/docs-converge.md +126 -126
- package/skills/loop-agent/references/harness-policy.md +263 -263
- package/skills/loop-agent/references/hybrid-dag.md +238 -233
- package/skills/loop-agent/references/learned/README.md +21 -21
- package/skills/loop-agent/references/long-running-loop.md +57 -57
- package/skills/loop-agent/references/model-routing.md +36 -36
- package/skills/loop-agent/references/multi-worktree.md +54 -54
- package/skills/loop-agent/references/one-shot-runs.md +85 -85
- package/skills/loop-agent/references/orchestrator-and-interventions.md +169 -169
- package/skills/loop-agent/references/pi-prompt.md +23 -23
- package/skills/loop-agent/references/pi-subagent-assisted-mode.md +84 -84
- package/skills/loop-agent/references/post-implementation-and-patterns.md +44 -44
- package/skills/loop-agent/references/task-workflow.md +89 -89
- package/skills/loop-agent/references/verification-and-failure-handling.md +139 -139
- package/skills/playwright-cli/SKILL.md +420 -0
- package/skills/playwright-cli/references/element-attributes.md +23 -0
- package/skills/playwright-cli/references/playwright-tests.md +39 -0
- package/skills/playwright-cli/references/request-mocking.md +87 -0
- package/skills/playwright-cli/references/running-code.md +241 -0
- package/skills/playwright-cli/references/session-management.md +225 -0
- package/skills/playwright-cli/references/storage-state.md +275 -0
- package/skills/playwright-cli/references/test-generation.md +433 -0
- package/skills/playwright-cli/references/tracing.md +139 -0
- package/skills/playwright-cli/references/video-recording.md +143 -0
- package/skills/playwright-cli-case-generator/SKILL.md +74 -0
- package/skills/requesting-code-review/SKILL.md +101 -101
- package/skills/requesting-code-review/code-reviewer.md +168 -168
- package/skills/systematic-debugging/CREATION-LOG.md +119 -119
- package/skills/systematic-debugging/SKILL.md +296 -296
- package/skills/systematic-debugging/condition-based-waiting-example.ts +158 -158
- package/skills/systematic-debugging/condition-based-waiting.md +115 -115
- package/skills/systematic-debugging/defense-in-depth.md +122 -122
- package/skills/systematic-debugging/find-polluter.sh +63 -63
- package/skills/systematic-debugging/root-cause-tracing.md +169 -169
- package/skills/systematic-debugging/test-academic.md +14 -14
- package/skills/systematic-debugging/test-pressure-1.md +58 -58
- package/skills/systematic-debugging/test-pressure-2.md +68 -68
- package/skills/systematic-debugging/test-pressure-3.md +69 -69
- package/skills/test-driven-development/SKILL.md +20 -20
- package/skills/using-git-worktrees/SKILL.md +215 -215
- package/skills/verification-before-completion/SKILL.md +154 -154
- package/skills/webapp-testing/SKILL.md +19 -19
|
@@ -1,140 +1,140 @@
|
|
|
1
|
-
# Agent DAG 执行架构
|
|
2
|
-
|
|
3
|
-
本页说明 Agent DAG 的主调用链、rank 调度、executor、run-owned skill snapshot、decision gate 与 pause/completed 生命周期。命令面与 `test/cli-contract.test.ts` 一致;符号归属以 `src/` 为准。完整 import 边界与 governance hook 见 `runtime-boundaries.md`。
|
|
4
|
-
|
|
5
|
-
## 主调用链
|
|
6
|
-
|
|
7
|
-
### 生成 + 校验 + 执行(`dag run-task`)
|
|
8
|
-
|
|
9
|
-
```text
|
|
10
|
-
src/commands/dag-run-task.ts runDagRunTask
|
|
11
|
-
→ src/application/dag/generate-task-dag.ts generateTaskDagUseCase
|
|
12
|
-
└─ src/workflows/dag/init-hybrid.ts initHybridDagFromTask (生成 DagSpec)
|
|
13
|
-
└─ src/application/dag/validate-dag.ts validateDagUseCase (候选 + 最终校验)
|
|
14
|
-
└─ assertSafeForExecution (执行前安全检查)
|
|
15
|
-
└─ src/application/dag/run-dag.ts runDagUseCase (执行)
|
|
16
|
-
```
|
|
17
|
-
|
|
18
|
-
`generateTaskDagUseCase` 内部先 `initHybridDagFromTask` 生成 `DagSpec`,再调用 `validateDagUseCase` 做候选与最终两次校验,随后 `assertSafeForExecution` 确认 DAG 可安全执行,最后委托 `runDagUseCase` 执行。`runDagRunTask` 还 `export` 了 `assertSafeForExecution` 供命令层复用。
|
|
19
|
-
|
|
20
|
-
### 直接执行既有 DAG(`run-dag`)
|
|
21
|
-
|
|
22
|
-
```text
|
|
23
|
-
src/commands/run-dag.ts
|
|
24
|
-
→ src/application/dag/run-dag.ts runDagUseCase
|
|
25
|
-
→ src/workflows/dag/runner.ts runDag
|
|
26
|
-
```
|
|
27
|
-
|
|
28
|
-
`run-dag` 是 top-level 命令,**不**在 `dag` 子树下(与 `dag run-task` 区分)。`runDagUseCase` 是 application 层 typed use-case,`runDag` 是 workflow runtime 核心。
|
|
29
|
-
|
|
30
|
-
### 校验
|
|
31
|
-
|
|
32
|
-
```text
|
|
33
|
-
src/commands/dag-validate.ts runDagValidate
|
|
34
|
-
→ src/application/dag/validate-dag.ts validateDagUseCase
|
|
35
|
-
```
|
|
36
|
-
|
|
37
|
-
### runtime contract preflight 与 repair writer 解析
|
|
38
|
-
|
|
39
|
-
- `src/workflows/dag/runtime-contract.ts` `assertRuntimeContractCompatible` 依据 controller capabilities(`DAG_CONTROLLER_CAPABILITIES`:`agentRuntime="pi-only"`、`repairWriterProtocol="explicit-node-v1"`)校验 DagSpec v3 必需的 `runtimeContract`。v3 让旧 controller 在解析阶段拒绝;新 controller 的 `validateDagUseCase`、`runDagUseCase`、`runDag` 与 resume 还会校验 capability 和可选最低版本,不兼容在任何节点执行前 fail-fast。legacy v1/v2 DagSpec 可读但没有 v3 握手。
|
|
40
|
-
- `src/workflows/dag/repair-artifact.ts` `resolveRepairTaskForGate` 解析 `shell.repairArtifactGate`:优先显式 `repairNodeId`,否则推导唯一的下游受治理 Pi writer(`repairWriterContractIssues` 校验 executor/toolProfile/writePolicy/path 契约)。`validate.ts` 与 `node-execution.ts` 复用同一 resolver,runtime 不再按节点名硬编码。
|
|
41
|
-
- `src/workflows/dag/controller-identity.ts` 在 run 创建前要求 controller identity 可解析,再由 `captureControllerIdentity` 冻结到 `<runDir>/controller-identity.json`;`verifyControllerIdentityForResume` 在 resume 前重新校验并对漂移、篡改或 legacy-unpinned run fail closed。
|
|
42
|
-
|
|
43
|
-
## rank 调度
|
|
44
|
-
|
|
45
|
-
拓扑排序与按 rank 执行的符号归属(校准版,勿笼统归到 `runner.ts`):
|
|
46
|
-
|
|
47
|
-
| 职责 | 源码入口 | 说明 |
|
|
48
|
-
| --- | --- | --- |
|
|
49
|
-
| 拓扑排序 | `src/workflows/dag/topo.ts` `topoSortToRanks` | Kahn 算法,返回 `string[][]` ranks 并检测环 |
|
|
50
|
-
| 单次 rank 执行 | `src/workflows/dag/scheduler.ts` `executeDagRanksOnce` | rank 间遍历、节点执行编排 |
|
|
51
|
-
| run 主循环 | `src/workflows/dag/runner.ts` `runDag` / `executeDagCheckpoint` | 调用 scheduler + persistence + convergence |
|
|
52
|
-
|
|
53
|
-
`scheduler.ts` `executeDagRanksOnce` 内每个 rank:
|
|
54
|
-
|
|
55
|
-
1. `pauseGateRunnable`(满足 `isPauseOnHumanDecisionGate` 的节点,来自 `decision-envelope.ts`)**串行**先跑;任一节点触发 pause 即停止后续。
|
|
56
|
-
2. `regularRunnable` 经 `mapConcurrent` 并发执行,`maxConcurrent` 默认 **4**(`runner.ts` `Math.max(1, opts.maxConcurrent ?? 4)`)。
|
|
57
|
-
3. `rankWriterNodeIds`(`executor === "pi"` && `toolProfile === "write"` && `writePolicy === "exclusive"`)注入同 rank 的不相交 writeSet 上下文(`createExecuteNodeForRank`)。
|
|
58
|
-
4. 依赖未就绪的节点标 `SKIPPED`。
|
|
59
|
-
|
|
60
|
-
`mapConcurrent` 来自 `src/shared/concurrency.ts`(或等价 shared 工具)。
|
|
61
|
-
|
|
62
|
-
## executor(Pi-only 受治理 runtime)
|
|
63
|
-
|
|
64
|
-
- 注册表:`src/workflows/dag/executor-registry.ts`
|
|
65
|
-
`DEFAULT_DAG_EXECUTOR_REGISTRY = { pi, shell, static }`。
|
|
66
|
-
- schema:`src/workflows/dag/types.ts`
|
|
67
|
-
`dagNodeExecutorSchema = z.enum(["pi","shell","static"])`;DagNodeExecutor 默认 `"pi"`(`executor: dagNodeExecutorSchema.default("pi")`)。
|
|
68
|
-
- `executor: "cursor"` 在 schema refine 阶段抛 `CURSOR_DAG_EXECUTOR_REMOVED_ERROR`(Pi-only = ADR 0001)。
|
|
69
|
-
- Pi handler 先 `requireModel(input)` 校验已解析 model,再委托 `executeDagPiNode`(`src/executors/dag-pi-executor.ts`)。
|
|
70
|
-
- shell handler = `executeDagShellNode`(`src/executors/shell-executor.ts`);static handler = `executeDagStaticNode`(`src/executors/dag-static-executor.ts`)。
|
|
71
|
-
|
|
72
|
-
Executor 不得依赖 commands 或 CLI formatting;Cursor 不在受治理路径(`runtime-boundaries.md` §Executors)。
|
|
73
|
-
|
|
74
|
-
## run-owned skill snapshot
|
|
75
|
-
|
|
76
|
-
每个新 DAG run 在首个节点执行前冻结本次注入 prompt 的 skill 集合,保证 live skill 后续被修改/删除/补建不会影响当前 run:
|
|
77
|
-
|
|
78
|
-
| 步骤 | 源码入口 |
|
|
79
|
-
| --- | --- |
|
|
80
|
-
| 首节点前创建 | `runDag` 调 `createSkillSnapshot({ mode: "run-start" })`(`src/workflows/dag/skill-snapshot.ts`) |
|
|
81
|
-
| 写入产物 | `writeSkillSnapshot(runDir, snapshot)` → `<runDir>/.runtime/skill-snapshot.json`(常量 `SKILL_SNAPSHOT_REL_PATH = ".runtime/skill-snapshot.json"`) |
|
|
82
|
-
| state 只存相对引用 | `state.skillSnapshotRef` = `{ schemaVersion, path: ".runtime/skill-snapshot.json", sha256, createdAt, mode }`,**不**存绝对路径 |
|
|
83
|
-
| resume 续用 | `prepareSkillSnapshotForContinuation`(resume 路径,`src/workflows/dag/runner.ts` `resumeDagRun`) |
|
|
84
|
-
| 完整性校验 | 普通节点、dynamic child、approve/resume 都执行 integrity gate,ref/artifact/profile/binding 不一致即 fail closed,不回退实时解析 |
|
|
85
|
-
| legacy 兼容 | 旧 run 只在 ref 与 artifact 都不存在时可标 `legacy-resume-backfill` 并冻结剩余节点 |
|
|
86
|
-
|
|
87
|
-
snapshot 与 controller identity 是两个不同冻结层,详见 `runtime-boundaries.md` §版本化自举边界。
|
|
88
|
-
|
|
89
|
-
## decision gate 与 pause
|
|
90
|
-
|
|
91
|
-
- `isPauseOnHumanDecisionGate`(`src/workflows/dag/decision-envelope.ts`):`task.decisionGate?.mode === "pause-on-human"` 且 decision gate 启用时,该节点在 rank 内**串行先跑**。
|
|
92
|
-
- `shouldPauseOnHumanEscalation`(`decision-envelope.ts`,在 `src/workflows/dag/node-execution.ts` 调用):decision envelope 判定需人工升级时,写 `human-escalation.json`(与 `human-escalation.md`)并触发 pause。
|
|
93
|
-
- pause 时 `state.pausedByNodeId` + `pauseReason` + `humanDecisionNodeId` 被写入;`human-escalation.json` 落在 `<runDir>/<nodeId>/`。
|
|
94
|
-
|
|
95
|
-
decision envelope 中的 **model verdict**(`decision` / `riskLevel` 等解析自文本)是 `advisoryOnly: true` 派生视图,**不**是完成权威(`facts-and-state.md`)。
|
|
96
|
-
|
|
97
|
-
## 生命周期:active / paused / completed
|
|
98
|
-
|
|
99
|
-
`src/workflows/dag/lifecycle.ts` 定义三个目录:
|
|
100
|
-
|
|
101
|
-
| 目录 | 写入规则 |
|
|
102
|
-
| --- | --- |
|
|
103
|
-
| `.harness/dag-runs/active/<runId>/` | run 进行中 |
|
|
104
|
-
| `.harness/dag-runs/paused/<runId>/` | 触发 pause;resume 需 `human-approval.json` |
|
|
105
|
-
| `.harness/dag-runs/completed/<runId>/` | 终态;除 runner 终态写外只读(`completed-facts-guard.ts`) |
|
|
106
|
-
|
|
107
|
-
扫描顺序:`DAG_LIFECYCLE_SCAN_ORDER = ["paused", "active", "completed"]`(locate/status 等按此顺序解析 runId)。
|
|
108
|
-
|
|
109
|
-
关键规则:
|
|
110
|
-
|
|
111
|
-
- **pause → approve → resume**:`dag approve` 在 paused run 写 `human-approval.json`,将状态改回 `running` 并把目录迁回 `active/`;随后 `resumeDagRun`(`runner.ts`)要求 active lifecycle + approval artifact,并用 `prepareSkillSnapshotForContinuation` 复用 run-owned snapshot。
|
|
112
|
-
- **completed 写入**:只有 runner 在终态 `persistState({ allowCompletedFactsWrite: true })`(`runner.ts`)才能写 completed 目录;该 flag 经 `completed-facts-guard.ts` 校验。
|
|
113
|
-
- **显式 recovery mutation**:`dag reconcile-run`(`src/commands/dag-reconcile-run.ts`,命令层)默认仅检查;只有给出 `--action supersede|abandon` + reason,且 liveness 证明 runner 已停止时,才在原 lifecycle 写 reconciliation/state 并迁移到 `completed/`。它不是修改既有 completed history 的通用入口。Observe / status / doctor 始终只读。
|
|
114
|
-
- **status 枚举**:`DagRunState.status`;`TERMINAL_RUN_STATUSES` 判终态;`isTerminalDagRunStatus` 工具函数。
|
|
115
|
-
|
|
116
|
-
## convergence(可选、supervised)
|
|
117
|
-
|
|
118
|
-
- 控制器:`src/workflows/dag/convergence/controller.ts` `runConvergencePassController`,在 runner rank 间被调用。
|
|
119
|
-
- 特性默认 **off**(`task/config-types.ts` `convergence` 默认 `{ enabled: false }`)。
|
|
120
|
-
- 启用后按 `maxPasses`(默认 3)做多轮 repair,回归时可 `pauseOnRegression`。
|
|
121
|
-
- 产物落在 `<runDir>/convergence/pass-<n>/`。
|
|
122
|
-
|
|
123
|
-
## 完成权威 = shell verification
|
|
124
|
-
|
|
125
|
-
完成声明的权威是 shell command 的新鲜 exit code 与归档输出。验证命令执行在 `src/executors/shell-executor.ts`,环境与 preset helper 在 `src/executors/shell-verification.ts`;DAG authoring 写入的 `task.shell.verifyEvidence` 元数据由 `src/workflows/dag/node-execution.ts` 复制到 `node.verifyEvidence`。model verdict、Observe 或报告都不能替代这些 shell facts。
|
|
126
|
-
|
|
127
|
-
## Dynamic Workflow
|
|
128
|
-
|
|
129
|
-
Dynamic Workflow 是 DAG runtime 上方的逻辑编排/编译层,**不**重写 runner:
|
|
130
|
-
|
|
131
|
-
```text
|
|
132
|
-
WorkflowSpec (src/workflows/dynamic/spec.ts workflowSpecSchema)
|
|
133
|
-
→ validate (src/workflows/dynamic/validate.ts)
|
|
134
|
-
→ compile (src/workflows/dynamic/compile.ts compileWorkflowToDag) → DagSpec
|
|
135
|
-
→ 同一 run-dag 执行
|
|
136
|
-
```
|
|
137
|
-
|
|
138
|
-
- 动态语义:`map_agent` / `verify_agent` / `reduce_agent` / `condition` / `loop_until` / `human_gate` / `command` / `artifact_transform`。
|
|
139
|
-
- agent-like 节点 executor 仅 `pi` | `static`(schema 已不含 `cursor`)。
|
|
140
|
-
- 未完全兑现的 runtime limits 强执法、更广 profile、Loop 原生 `workflow` action 深度编排等仍是**设计输入**,见 `docs/design/dynamic-workflow-dag-engine-roadmap.md`(带 2026-07-14 校准条)。
|
|
1
|
+
# Agent DAG 执行架构
|
|
2
|
+
|
|
3
|
+
本页说明 Agent DAG 的主调用链、rank 调度、executor、run-owned skill snapshot、decision gate 与 pause/completed 生命周期。命令面与 `test/cli-contract.test.ts` 一致;符号归属以 `src/` 为准。完整 import 边界与 governance hook 见 `runtime-boundaries.md`。
|
|
4
|
+
|
|
5
|
+
## 主调用链
|
|
6
|
+
|
|
7
|
+
### 生成 + 校验 + 执行(`dag run-task`)
|
|
8
|
+
|
|
9
|
+
```text
|
|
10
|
+
src/commands/dag-run-task.ts runDagRunTask
|
|
11
|
+
→ src/application/dag/generate-task-dag.ts generateTaskDagUseCase
|
|
12
|
+
└─ src/workflows/dag/init-hybrid.ts initHybridDagFromTask (生成 DagSpec)
|
|
13
|
+
└─ src/application/dag/validate-dag.ts validateDagUseCase (候选 + 最终校验)
|
|
14
|
+
└─ assertSafeForExecution (执行前安全检查)
|
|
15
|
+
└─ src/application/dag/run-dag.ts runDagUseCase (执行)
|
|
16
|
+
```
|
|
17
|
+
|
|
18
|
+
`generateTaskDagUseCase` 内部先 `initHybridDagFromTask` 生成 `DagSpec`,再调用 `validateDagUseCase` 做候选与最终两次校验,随后 `assertSafeForExecution` 确认 DAG 可安全执行,最后委托 `runDagUseCase` 执行。`runDagRunTask` 还 `export` 了 `assertSafeForExecution` 供命令层复用。
|
|
19
|
+
|
|
20
|
+
### 直接执行既有 DAG(`run-dag`)
|
|
21
|
+
|
|
22
|
+
```text
|
|
23
|
+
src/commands/run-dag.ts
|
|
24
|
+
→ src/application/dag/run-dag.ts runDagUseCase
|
|
25
|
+
→ src/workflows/dag/runner.ts runDag
|
|
26
|
+
```
|
|
27
|
+
|
|
28
|
+
`run-dag` 是 top-level 命令,**不**在 `dag` 子树下(与 `dag run-task` 区分)。`runDagUseCase` 是 application 层 typed use-case,`runDag` 是 workflow runtime 核心。
|
|
29
|
+
|
|
30
|
+
### 校验
|
|
31
|
+
|
|
32
|
+
```text
|
|
33
|
+
src/commands/dag-validate.ts runDagValidate
|
|
34
|
+
→ src/application/dag/validate-dag.ts validateDagUseCase
|
|
35
|
+
```
|
|
36
|
+
|
|
37
|
+
### runtime contract preflight 与 repair writer 解析
|
|
38
|
+
|
|
39
|
+
- `src/workflows/dag/runtime-contract.ts` `assertRuntimeContractCompatible` 依据 controller capabilities(`DAG_CONTROLLER_CAPABILITIES`:`agentRuntime="pi-only"`、`repairWriterProtocol="explicit-node-v1"`)校验 DagSpec v3 必需的 `runtimeContract`。v3 让旧 controller 在解析阶段拒绝;新 controller 的 `validateDagUseCase`、`runDagUseCase`、`runDag` 与 resume 还会校验 capability 和可选最低版本,不兼容在任何节点执行前 fail-fast。legacy v1/v2 DagSpec 可读但没有 v3 握手。
|
|
40
|
+
- `src/workflows/dag/repair-artifact.ts` `resolveRepairTaskForGate` 解析 `shell.repairArtifactGate`:优先显式 `repairNodeId`,否则推导唯一的下游受治理 Pi writer(`repairWriterContractIssues` 校验 executor/toolProfile/writePolicy/path 契约)。`validate.ts` 与 `node-execution.ts` 复用同一 resolver,runtime 不再按节点名硬编码。
|
|
41
|
+
- `src/workflows/dag/controller-identity.ts` 在 run 创建前要求 controller identity 可解析,再由 `captureControllerIdentity` 冻结到 `<runDir>/controller-identity.json`;`verifyControllerIdentityForResume` 在 resume 前重新校验并对漂移、篡改或 legacy-unpinned run fail closed。
|
|
42
|
+
|
|
43
|
+
## rank 调度
|
|
44
|
+
|
|
45
|
+
拓扑排序与按 rank 执行的符号归属(校准版,勿笼统归到 `runner.ts`):
|
|
46
|
+
|
|
47
|
+
| 职责 | 源码入口 | 说明 |
|
|
48
|
+
| --- | --- | --- |
|
|
49
|
+
| 拓扑排序 | `src/workflows/dag/topo.ts` `topoSortToRanks` | Kahn 算法,返回 `string[][]` ranks 并检测环 |
|
|
50
|
+
| 单次 rank 执行 | `src/workflows/dag/scheduler.ts` `executeDagRanksOnce` | rank 间遍历、节点执行编排 |
|
|
51
|
+
| run 主循环 | `src/workflows/dag/runner.ts` `runDag` / `executeDagCheckpoint` | 调用 scheduler + persistence + convergence |
|
|
52
|
+
|
|
53
|
+
`scheduler.ts` `executeDagRanksOnce` 内每个 rank:
|
|
54
|
+
|
|
55
|
+
1. `pauseGateRunnable`(满足 `isPauseOnHumanDecisionGate` 的节点,来自 `decision-envelope.ts`)**串行**先跑;任一节点触发 pause 即停止后续。
|
|
56
|
+
2. `regularRunnable` 经 `mapConcurrent` 并发执行,`maxConcurrent` 默认 **4**(`runner.ts` `Math.max(1, opts.maxConcurrent ?? 4)`)。
|
|
57
|
+
3. `rankWriterNodeIds`(`executor === "pi"` && `toolProfile === "write"` && `writePolicy === "exclusive"`)注入同 rank 的不相交 writeSet 上下文(`createExecuteNodeForRank`)。
|
|
58
|
+
4. 依赖未就绪的节点标 `SKIPPED`。
|
|
59
|
+
|
|
60
|
+
`mapConcurrent` 来自 `src/shared/concurrency.ts`(或等价 shared 工具)。
|
|
61
|
+
|
|
62
|
+
## executor(Pi-only 受治理 runtime)
|
|
63
|
+
|
|
64
|
+
- 注册表:`src/workflows/dag/executor-registry.ts`
|
|
65
|
+
`DEFAULT_DAG_EXECUTOR_REGISTRY = { pi, shell, static }`。
|
|
66
|
+
- schema:`src/workflows/dag/types.ts`
|
|
67
|
+
`dagNodeExecutorSchema = z.enum(["pi","shell","static"])`;DagNodeExecutor 默认 `"pi"`(`executor: dagNodeExecutorSchema.default("pi")`)。
|
|
68
|
+
- `executor: "cursor"` 在 schema refine 阶段抛 `CURSOR_DAG_EXECUTOR_REMOVED_ERROR`(Pi-only = ADR 0001)。
|
|
69
|
+
- Pi handler 先 `requireModel(input)` 校验已解析 model,再委托 `executeDagPiNode`(`src/executors/dag-pi-executor.ts`)。
|
|
70
|
+
- shell handler = `executeDagShellNode`(`src/executors/shell-executor.ts`);static handler = `executeDagStaticNode`(`src/executors/dag-static-executor.ts`)。
|
|
71
|
+
|
|
72
|
+
Executor 不得依赖 commands 或 CLI formatting;Cursor 不在受治理路径(`runtime-boundaries.md` §Executors)。
|
|
73
|
+
|
|
74
|
+
## run-owned skill snapshot
|
|
75
|
+
|
|
76
|
+
每个新 DAG run 在首个节点执行前冻结本次注入 prompt 的 skill 集合,保证 live skill 后续被修改/删除/补建不会影响当前 run:
|
|
77
|
+
|
|
78
|
+
| 步骤 | 源码入口 |
|
|
79
|
+
| --- | --- |
|
|
80
|
+
| 首节点前创建 | `runDag` 调 `createSkillSnapshot({ mode: "run-start" })`(`src/workflows/dag/skill-snapshot.ts`) |
|
|
81
|
+
| 写入产物 | `writeSkillSnapshot(runDir, snapshot)` → `<runDir>/.runtime/skill-snapshot.json`(常量 `SKILL_SNAPSHOT_REL_PATH = ".runtime/skill-snapshot.json"`) |
|
|
82
|
+
| state 只存相对引用 | `state.skillSnapshotRef` = `{ schemaVersion, path: ".runtime/skill-snapshot.json", sha256, createdAt, mode }`,**不**存绝对路径 |
|
|
83
|
+
| resume 续用 | `prepareSkillSnapshotForContinuation`(resume 路径,`src/workflows/dag/runner.ts` `resumeDagRun`) |
|
|
84
|
+
| 完整性校验 | 普通节点、dynamic child、approve/resume 都执行 integrity gate,ref/artifact/profile/binding 不一致即 fail closed,不回退实时解析 |
|
|
85
|
+
| legacy 兼容 | 旧 run 只在 ref 与 artifact 都不存在时可标 `legacy-resume-backfill` 并冻结剩余节点 |
|
|
86
|
+
|
|
87
|
+
snapshot 与 controller identity 是两个不同冻结层,详见 `runtime-boundaries.md` §版本化自举边界。
|
|
88
|
+
|
|
89
|
+
## decision gate 与 pause
|
|
90
|
+
|
|
91
|
+
- `isPauseOnHumanDecisionGate`(`src/workflows/dag/decision-envelope.ts`):`task.decisionGate?.mode === "pause-on-human"` 且 decision gate 启用时,该节点在 rank 内**串行先跑**。
|
|
92
|
+
- `shouldPauseOnHumanEscalation`(`decision-envelope.ts`,在 `src/workflows/dag/node-execution.ts` 调用):decision envelope 判定需人工升级时,写 `human-escalation.json`(与 `human-escalation.md`)并触发 pause。
|
|
93
|
+
- pause 时 `state.pausedByNodeId` + `pauseReason` + `humanDecisionNodeId` 被写入;`human-escalation.json` 落在 `<runDir>/<nodeId>/`。
|
|
94
|
+
|
|
95
|
+
decision envelope 中的 **model verdict**(`decision` / `riskLevel` 等解析自文本)是 `advisoryOnly: true` 派生视图,**不**是完成权威(`facts-and-state.md`)。
|
|
96
|
+
|
|
97
|
+
## 生命周期:active / paused / completed
|
|
98
|
+
|
|
99
|
+
`src/workflows/dag/lifecycle.ts` 定义三个目录:
|
|
100
|
+
|
|
101
|
+
| 目录 | 写入规则 |
|
|
102
|
+
| --- | --- |
|
|
103
|
+
| `.harness/dag-runs/active/<runId>/` | run 进行中 |
|
|
104
|
+
| `.harness/dag-runs/paused/<runId>/` | 触发 pause;resume 需 `human-approval.json` |
|
|
105
|
+
| `.harness/dag-runs/completed/<runId>/` | 终态;除 runner 终态写外只读(`completed-facts-guard.ts`) |
|
|
106
|
+
|
|
107
|
+
扫描顺序:`DAG_LIFECYCLE_SCAN_ORDER = ["paused", "active", "completed"]`(locate/status 等按此顺序解析 runId)。
|
|
108
|
+
|
|
109
|
+
关键规则:
|
|
110
|
+
|
|
111
|
+
- **pause → approve → resume**:`dag approve` 在 paused run 写 `human-approval.json`,将状态改回 `running` 并把目录迁回 `active/`;随后 `resumeDagRun`(`runner.ts`)要求 active lifecycle + approval artifact,并用 `prepareSkillSnapshotForContinuation` 复用 run-owned snapshot。
|
|
112
|
+
- **completed 写入**:只有 runner 在终态 `persistState({ allowCompletedFactsWrite: true })`(`runner.ts`)才能写 completed 目录;该 flag 经 `completed-facts-guard.ts` 校验。
|
|
113
|
+
- **显式 recovery mutation**:`dag reconcile-run`(`src/commands/dag-reconcile-run.ts`,命令层)默认仅检查;只有给出 `--action supersede|abandon` + reason,且 liveness 证明 runner 已停止时,才在原 lifecycle 写 reconciliation/state 并迁移到 `completed/`。它不是修改既有 completed history 的通用入口。Observe / status / doctor 始终只读。
|
|
114
|
+
- **status 枚举**:`DagRunState.status`;`TERMINAL_RUN_STATUSES` 判终态;`isTerminalDagRunStatus` 工具函数。
|
|
115
|
+
|
|
116
|
+
## convergence(可选、supervised)
|
|
117
|
+
|
|
118
|
+
- 控制器:`src/workflows/dag/convergence/controller.ts` `runConvergencePassController`,在 runner rank 间被调用。
|
|
119
|
+
- 特性默认 **off**(`task/config-types.ts` `convergence` 默认 `{ enabled: false }`)。
|
|
120
|
+
- 启用后按 `maxPasses`(默认 3)做多轮 repair,回归时可 `pauseOnRegression`。
|
|
121
|
+
- 产物落在 `<runDir>/convergence/pass-<n>/`。
|
|
122
|
+
|
|
123
|
+
## 完成权威 = shell verification
|
|
124
|
+
|
|
125
|
+
完成声明的权威是 shell command 的新鲜 exit code 与归档输出。验证命令执行在 `src/executors/shell-executor.ts`,环境与 preset helper 在 `src/executors/shell-verification.ts`;DAG authoring 写入的 `task.shell.verifyEvidence` 元数据由 `src/workflows/dag/node-execution.ts` 复制到 `node.verifyEvidence`。model verdict、Observe 或报告都不能替代这些 shell facts。
|
|
126
|
+
|
|
127
|
+
## Dynamic Workflow
|
|
128
|
+
|
|
129
|
+
Dynamic Workflow 是 DAG runtime 上方的逻辑编排/编译层,**不**重写 runner:
|
|
130
|
+
|
|
131
|
+
```text
|
|
132
|
+
WorkflowSpec (src/workflows/dynamic/spec.ts workflowSpecSchema)
|
|
133
|
+
→ validate (src/workflows/dynamic/validate.ts)
|
|
134
|
+
→ compile (src/workflows/dynamic/compile.ts compileWorkflowToDag) → DagSpec
|
|
135
|
+
→ 同一 run-dag 执行
|
|
136
|
+
```
|
|
137
|
+
|
|
138
|
+
- 动态语义:`map_agent` / `verify_agent` / `reduce_agent` / `condition` / `loop_until` / `human_gate` / `command` / `artifact_transform`。
|
|
139
|
+
- agent-like 节点 executor 仅 `pi` | `static`(schema 已不含 `cursor`)。
|
|
140
|
+
- 未完全兑现的 runtime limits 强执法、更广 profile、Loop 原生 `workflow` action 深度编排等仍是**设计输入**,见 `docs/design/dynamic-workflow-dag-engine-roadmap.md`(带 2026-07-14 校准条)。
|
|
@@ -1,53 +1,54 @@
|
|
|
1
|
-
# 架构演进:当前 vs 未来
|
|
2
|
-
|
|
3
|
-
本页区分 loop-agent **当前已实现**的架构能力与**未来规划**。当前事实以代码、发布 CLI、已完成计划为准;未来能力一律标「规划 / 未实现 / 前瞻」。权威源:`CHANGELOG.md`、`docs/reports/current-capability-summary.md`、ADR 0001–
|
|
4
|
-
|
|
5
|
-
## 当前已实现(0.11.0)
|
|
6
|
-
|
|
7
|
-
| 域 | 现状 | 权威入口 |
|
|
8
|
-
| --- | --- | --- |
|
|
9
|
-
| 受治理 Agent runtime | **Pi-only**;`cursor-prompt` 仅显式 one-shot sidecar | ADR 0001、`CHANGELOG.md [0.10.0]` |
|
|
10
|
-
| Agent DAG 主链 | `dag run-task` → generate → validate → `run-dag`;report/doctor/reconcile-run | `dag-execution.md`、`test/cli-contract.test.ts` |
|
|
11
|
-
| Dynamic Workflow | `WorkflowSpec` → validate → compile → 同一 `run-dag`;agent-like 节点仅 `pi\|static` | `src/workflows/dynamic/{spec,validate,compile}.ts`、`website/docs/guides/dynamic-workflow.md` |
|
|
12
|
-
| 版本化自举 | controller identity + run-owned skill snapshot + deterministic canary | `docs/reports/2026-07-13-versioned-self-hosting-bootstrap.md` |
|
|
13
|
-
| Feature 交付(M2) | review/run/approve-followup/delivery/closeout/verify-final | `docs/reports/2026-07-12-m2-completion-audit.md` |
|
|
14
|
-
| Task Pool | 唯一根 `.harness/task-pool
|
|
15
|
-
|
|
|
16
|
-
|
|
|
17
|
-
|
|
|
18
|
-
|
|
|
19
|
-
|
|
20
|
-
|
|
21
|
-
|
|
22
|
-
|
|
23
|
-
-
|
|
24
|
-
-
|
|
25
|
-
|
|
26
|
-
|
|
27
|
-
|
|
28
|
-
|
|
29
|
-
|
|
30
|
-
|
|
31
|
-
|
|
|
32
|
-
|
|
|
33
|
-
|
|
|
34
|
-
|
|
|
35
|
-
|
|
|
36
|
-
|
|
|
37
|
-
|
|
|
38
|
-
|
|
|
39
|
-
|
|
|
40
|
-
|
|
41
|
-
|
|
42
|
-
|
|
43
|
-
|
|
44
|
-
|
|
45
|
-
|
|
46
|
-
-
|
|
47
|
-
-
|
|
48
|
-
|
|
49
|
-
|
|
50
|
-
|
|
51
|
-
|
|
52
|
-
-
|
|
53
|
-
-
|
|
1
|
+
# 架构演进:当前 vs 未来
|
|
2
|
+
|
|
3
|
+
本页区分 loop-agent **当前已实现**的架构能力与**未来规划**。当前事实以代码、发布 CLI、已完成计划为准;未来能力一律标「规划 / 未实现 / 前瞻」。权威源:`CHANGELOG.md`、`docs/reports/current-capability-summary.md`、ADR 0001–0004、`docs/exec-plans/completed/` 与 active identity plan 的 progress。
|
|
4
|
+
|
|
5
|
+
## 当前已实现(0.11.0)
|
|
6
|
+
|
|
7
|
+
| 域 | 现状 | 权威入口 |
|
|
8
|
+
| --- | --- | --- |
|
|
9
|
+
| 受治理 Agent runtime | **Pi-only**;`cursor-prompt` 仅显式 one-shot sidecar | ADR 0001、`CHANGELOG.md [0.10.0]` |
|
|
10
|
+
| Agent DAG 主链 | `dag run-task` → generate → validate → `run-dag`;report/doctor/reconcile-run | `dag-execution.md`、`test/cli-contract.test.ts` |
|
|
11
|
+
| Dynamic Workflow | `WorkflowSpec` → validate → compile → 同一 `run-dag`;agent-like 节点仅 `pi\|static` | `src/workflows/dynamic/{spec,validate,compile}.ts`、`website/docs/guides/dynamic-workflow.md` |
|
|
12
|
+
| 版本化自举 | controller identity + run-owned skill snapshot + deterministic canary | `docs/reports/2026-07-13-versioned-self-hosting-bootstrap.md` |
|
|
13
|
+
| Feature 交付(M2) | review/run/approve-followup/delivery/closeout/verify-final | `docs/reports/2026-07-12-m2-completion-audit.md` |
|
|
14
|
+
| Task Pool | 唯一根 `.harness/task-pool/`;**feature-scoped** state v2(`TaskPoolTaskRef`) | ADR 0002、ADR 0004 |
|
|
15
|
+
| 本地多 Feature 运营 | 同仓库多 Feature 可共用 Task ID;Ready / retry / Delivery / Observe 按 Feature 隔离 | ADR 0004、`docs/progress/2026-07-15-task-pool-v2-feature-scoped-task-identity.md` |
|
|
16
|
+
| Observe | 本地只读暖白运营控制台 R1–R5(derived);canonical Task route 为 feature-scoped | `website/docs/guides/observe-ui.md`、`CHANGELOG.md [0.11.0]`、ADR 0004 |
|
|
17
|
+
| DagSpec / repair | v3 + `runtimeContract`;显式 `repairNodeId` | `CHANGELOG.md [0.11.0]`、`dag-execution.md` |
|
|
18
|
+
| 文档双树 | `website/docs/` 用法 vs `docs/` 治理;docs-converge | ADR 0003 |
|
|
19
|
+
| 文档治理 | `docs/architecture/` 主题文档(本目录)+ package 可达 | 本目录 README |
|
|
20
|
+
|
|
21
|
+
### 受治理 runtime 的边界(已实现、不变式)
|
|
22
|
+
|
|
23
|
+
- DAG writer 固定 `implement-pi` / `repair-pi`;`executor: "cursor"`、`implement-cursor` / `repair-cursor`、Cursor worker、`cursor-fix` 已从受治理路径移除。
|
|
24
|
+
- 完成权威 = shell verification;model verdict / Observe / 报告是 derived/advisory。
|
|
25
|
+
- Worker 通过已发布 `loop-agent` 子进程执行,不 in-process import runtime kernel(governance 机器校验)。
|
|
26
|
+
|
|
27
|
+
## 未来规划(第 3–6 月,**未实现**)
|
|
28
|
+
|
|
29
|
+
以下能力来自 `docs/design/六个月规划.md` 与 `docs/design/dynamic-workflow-dag-engine-roadmap.md`(六个月规划页首 2026-07-15 / 0.11.0 校准;未交付 phase 为**设计输入**,不是已实现证明)。它们**当前不存在于代码或 CLI**:
|
|
30
|
+
|
|
31
|
+
| 未来方向 | 状态 | 规划来源 |
|
|
32
|
+
| --- | --- | --- |
|
|
33
|
+
| 远程 PR / CI | 规划 / 未实现 | `docs/design/六个月规划.md`(第 3 个月起) |
|
|
34
|
+
| 线上 / 云 Worker | 规划 / 未实现 | 同上 |
|
|
35
|
+
| 云 Task Pool / SQL / Orchestrator | 规划 / 未实现 | 同上(第 2 月原始设计已调整为本地 Feature 闭环) |
|
|
36
|
+
| 多仓库平台 | 规划 / 未实现 | 同上 |
|
|
37
|
+
| 组织级服务 | 规划 / 未实现 | 同上 |
|
|
38
|
+
| Web Console(远端) | 规划 / 未实现 | 同上 |
|
|
39
|
+
| Dynamic Workflow runtime limits 强执法、更广 profile | 设计输入 | `docs/design/dynamic-workflow-dag-engine-roadmap.md`(未勾选 phase) |
|
|
40
|
+
| Loop 与 Dynamic Workflow 更深的双向集成、稳定化与自动恢复 | 设计输入 | 同上;当前已有基础 `workflow` action,不应误写为完全缺失 |
|
|
41
|
+
|
|
42
|
+
> 注意:`docs/design/dynamic-workflow-dag-engine-roadmap.md` 是 2026-07-04 历史叙述;文中凡把 Cursor 写成受治理 executor 或 `loop` 的 `cursor-fix` 动作,均为**历史叙述**,现状以 Pi-only + 显式 `cursor-prompt` sidecar 为准。
|
|
43
|
+
|
|
44
|
+
## 已收敛为 archive / 历史基线(非未来)
|
|
45
|
+
|
|
46
|
+
- 第 1–2 月规划已收敛为 archive/reports 指针,不在本文展开:`docs/design/archive/2026-07-12-第二月规划.md`。
|
|
47
|
+
- `docs/reports/2026-07-02-repository-analysis.md` 自 2026-07-14 起冻结为**历史基线快照**,不再滚动追加 Unreleased 能力。
|
|
48
|
+
- 活能力短摘要在 `docs/reports/current-capability-summary.md`。
|
|
49
|
+
|
|
50
|
+
## 文档本体的演进边界
|
|
51
|
+
|
|
52
|
+
- 本目录新增文档随发布包发布(`package.json` `files` + manifest `packageRequired` 显式条目),但 **不**投影到目标项目 init surface(AC-7);目标项目 init 仍只投影语言无关的 `runtime-boundaries.md`。
|
|
53
|
+
- `runtime-boundaries.md` 是边界真源;本目录其他文档交叉引用,不复制其 import 方向表 / governance-hook 表 / 版本化自举边界表。
|
|
54
|
+
- 未来如有能力落地,应先改 `src/`/CLI/ADR/completed plan,再回写本目录的「已实现」表。
|
|
@@ -1,58 +1,71 @@
|
|
|
1
|
-
# 事实与状态
|
|
2
|
-
|
|
3
|
-
本页说明 `.harness/` 各根目录、canonical facts、derived read models 与不可变规则,并逐条标出 canonical|derived 与 writable|read-only。完成权威是 shell verification(ADR 0001);model verdict、Observe、报告都是 derived 或 advisory 视图。
|
|
4
|
-
|
|
5
|
-
## 六类运行态对象
|
|
6
|
-
|
|
7
|
-
| 对象 | 物理根 | 源码入口 | 性质 |
|
|
8
|
-
| --- | --- | --- | --- |
|
|
9
|
-
| Task | `.harness/tasks/<taskId>/` | `src/task/runtime.ts` `getTaskDir` | canonical,可写 |
|
|
10
|
-
| DAG run | `.harness/dag-runs/{active,paused,completed}/<runId>/` | `src/workflows/dag/lifecycle.ts` `DAG_RUNS_DIR` | canonical,active/paused 可写;completed 受 guard |
|
|
11
|
-
| one-shot run | `.harness/runs/{active,completed,failed}/<slug>/` | `src/infrastructure/harness/one-shot-run-store.ts`(逻辑封装见 `src/records/one-shot-runs.ts`) | canonical;active 可写,completed/failed 为终态事实 |
|
|
12
|
-
| Loop | `.harness/tasks/<taskId>/loop/` | `src/workflows/loop/**` | canonical,**不是独立根**,是 task 之上的多轮状态机 |
|
|
13
|
-
| Task Pool | `.harness/task-pool
|
|
14
|
-
| Observe snapshot | Worker 内存/HTTP 派生视图 | `src/worker/observability/read-model.ts` `buildGlobalSnapshot` | **derived**,advisory |
|
|
15
|
-
|
|
16
|
-
### 区分要点
|
|
17
|
-
|
|
18
|
-
- **Task vs DAG run**:Task 是用户意图的源(`source/`、需求、执行约束、artifacts);DAG run 是一次执行实例,`<runId>/` 下落 spec、state、节点 artifacts、skill snapshot、controller identity(`controller-identity.json`,冻结执行 controller 的 package version/binary 哈希/portable fingerprint,state 记录相对 ref 与内容哈希,resume 时重新校验、漂移 fail closed)、decision envelope、convergence。
|
|
19
|
-
- **DAG run vs one-shot run**:DAG run 在 `.harness/dag-runs/`,有三态 lifecycle;one-shot run(当前主要由 `cursor-prompt` 及显式 one-shot evidence 路径产生)在 `.harness/runs/`,三态为 `active|completed|failed`。`pi-prompt` 当前不创建该目录下的 run evidence。两者是不同根、不同 schema。
|
|
20
|
-
- **Loop 不是顶层根**:Loop 状态在 `.harness/tasks/<taskId>/loop/`,是 task 之上的多轮状态机(round、signal、context、failureStreak、closeout)。
|
|
21
|
-
- **Task Pool 是 Worker 专用可选根**:只有使用 `agent-worker` 产品线时才存在;唯一根 `.harness/task-pool/`。
|
|
22
|
-
- **
|
|
23
|
-
|
|
24
|
-
|
|
25
|
-
|
|
26
|
-
|
|
27
|
-
|
|
28
|
-
|
|
29
|
-
|
|
30
|
-
|
|
31
|
-
|
|
32
|
-
|
|
33
|
-
|
|
34
|
-
|
|
35
|
-
|
|
36
|
-
|
|
37
|
-
|
|
38
|
-
|
|
39
|
-
-
|
|
40
|
-
|
|
41
|
-
|
|
42
|
-
|
|
43
|
-
|
|
44
|
-
|
|
45
|
-
|
|
46
|
-
|
|
47
|
-
|
|
48
|
-
|
|
49
|
-
|
|
50
|
-
|
|
51
|
-
|
|
52
|
-
|
|
53
|
-
|
|
54
|
-
|
|
55
|
-
|
|
56
|
-
|
|
57
|
-
|
|
58
|
-
|
|
1
|
+
# 事实与状态
|
|
2
|
+
|
|
3
|
+
本页说明 `.harness/` 各根目录、canonical facts、derived read models 与不可变规则,并逐条标出 canonical|derived 与 writable|read-only。完成权威是 shell verification(ADR 0001);model verdict、Observe、报告都是 derived 或 advisory 视图。
|
|
4
|
+
|
|
5
|
+
## 六类运行态对象
|
|
6
|
+
|
|
7
|
+
| 对象 | 物理根 | 源码入口 | 性质 |
|
|
8
|
+
| --- | --- | --- | --- |
|
|
9
|
+
| Task | `.harness/tasks/<taskId>/` | `src/task/runtime.ts` `getTaskDir` | canonical,可写 |
|
|
10
|
+
| DAG run | `.harness/dag-runs/{active,paused,completed}/<runId>/` | `src/workflows/dag/lifecycle.ts` `DAG_RUNS_DIR` | canonical,active/paused 可写;completed 受 guard |
|
|
11
|
+
| one-shot run | `.harness/runs/{active,completed,failed}/<slug>/` | `src/infrastructure/harness/one-shot-run-store.ts`(逻辑封装见 `src/records/one-shot-runs.ts`) | canonical;active 可写,completed/failed 为终态事实 |
|
|
12
|
+
| Loop | `.harness/tasks/<taskId>/loop/` | `src/workflows/loop/**` | canonical,**不是独立根**,是 task 之上的多轮状态机 |
|
|
13
|
+
| Task Pool | `.harness/task-pool/`(唯一根;state v2 见下) | `src/worker/pool/run-store.ts` `TASK_POOL_RELATIVE_ROOT`(ADR 0002 / 0004) | canonical,可写(Worker 专用,可选) |
|
|
14
|
+
| Observe snapshot | Worker 内存/HTTP 派生视图 | `src/worker/observability/read-model.ts` `buildGlobalSnapshot` | **derived**,advisory |
|
|
15
|
+
|
|
16
|
+
### 区分要点
|
|
17
|
+
|
|
18
|
+
- **Task vs DAG run**:Task 是用户意图的源(`source/`、需求、执行约束、artifacts);DAG run 是一次执行实例,`<runId>/` 下落 spec、state、节点 artifacts、skill snapshot、controller identity(`controller-identity.json`,冻结执行 controller 的 package version/binary 哈希/portable fingerprint,state 记录相对 ref 与内容哈希,resume 时重新校验、漂移 fail closed)、decision envelope、convergence。
|
|
19
|
+
- **DAG run vs one-shot run**:DAG run 在 `.harness/dag-runs/`,有三态 lifecycle;one-shot run(当前主要由 `cursor-prompt` 及显式 one-shot evidence 路径产生)在 `.harness/runs/`,三态为 `active|completed|failed`。`pi-prompt` 当前不创建该目录下的 run evidence。两者是不同根、不同 schema。
|
|
20
|
+
- **Loop 不是顶层根**:Loop 状态在 `.harness/tasks/<taskId>/loop/`,是 task 之上的多轮状态机(round、signal、context、failureStreak、closeout)。
|
|
21
|
+
- **Task Pool 是 Worker 专用可选根**:只有使用 `agent-worker` 产品线时才存在;唯一根 `.harness/task-pool/`。
|
|
22
|
+
- **Task Pool state identity(ADR 0004)**:canonical 键为 `{ featureId, taskId }`(`TaskPoolTaskRef`),不是裸 `taskId`。
|
|
23
|
+
- **Observe snapshot 不是事实源**:`buildGlobalSnapshot` 投影失败返回安全错误摘要而非全零健康,不改变执行成败。
|
|
24
|
+
|
|
25
|
+
### Task Pool state 布局与迁移
|
|
26
|
+
|
|
27
|
+
| 路径 / 对象 | 性质 | 说明 |
|
|
28
|
+
| --- | --- | --- |
|
|
29
|
+
| `.harness/task-pool/states/<featureId>/<taskId>.json` | canonical 可写 | schema v2;路径解码 identity 必须与文件内容一致 |
|
|
30
|
+
| `.harness/task-pool/states/<taskId>.json`(扁平 v1) | legacy | 不得静默猜 Feature;存在时 v2 写入 fail-closed |
|
|
31
|
+
| `.harness/task-pool/runs.jsonl` / `events.jsonl` | canonical append-only | migration 不改写 JSONL;`workerRunId` 仍是执行历史键 |
|
|
32
|
+
| `agent-worker pool doctor` | 只读诊断 | inventory + mapping 证据;exit 0 可有 findings |
|
|
33
|
+
| `agent-worker pool migrate-state` | 显式迁移 | 默认 dry-run;`--apply --owner --reason` 才写入;失败全回滚 |
|
|
34
|
+
|
|
35
|
+
`readFeatureTaskPoolStates` / `listTaskPoolStates` 是 v2 列表入口;deprecated `readAllTaskPoolStates` 仅扫描 legacy 扁平 state,不合并 v2。
|
|
36
|
+
|
|
37
|
+
## canonical(可写)
|
|
38
|
+
|
|
39
|
+
- `.harness/tasks/<taskId>/` — `getTaskDir`。
|
|
40
|
+
- `.harness/dag-runs/{active,paused}/<runId>/` — run 进行中 / 暂停。
|
|
41
|
+
- `.harness/runs/active/<slug>/` — one-shot 运行中;完成或失败后通过 store 迁移到终态目录。
|
|
42
|
+
- `.harness/tasks/<taskId>/loop/` — Loop 状态机。
|
|
43
|
+
- `.harness/task-pool/` — Worker Task Pool(可选)。
|
|
44
|
+
|
|
45
|
+
`.harness/prompts/` 与 `.harness/init-surface.json` 属于初始化投影/控制资料,不是一次执行的 canonical run fact,需与上面的任务和 run 对象区分。
|
|
46
|
+
|
|
47
|
+
## canonical(只读 / 不可变)
|
|
48
|
+
|
|
49
|
+
- `.harness/dag-runs/completed/<runId>/` — 除 runner 终态 `persistState({ allowCompletedFactsWrite: true })` 与显式 `dag reconcile-run`(`--action supersede|abandon` + reason,runner 已证明停止)外只读。
|
|
50
|
+
- `.harness/runs/completed/<slug>/` 与 `.harness/runs/failed/<slug>/` — one-shot 终态事实;公共写接口只对 active run 开放,完成/失败通过 store 迁移。
|
|
51
|
+
- `completed-facts-guard.ts`(`src/infrastructure/harness/`)是 completed 路径 enforcement 入口:`assertHarnessWriteAllowed(targetPath, { repoRoot, allowCompletedFactsWrite? })`。
|
|
52
|
+
- promotion(completed → task artifacts 回填)由 `src/records/promotion.ts` 经 `loadCompletedDagEvidence` 读 completed state 后写 task artifacts。
|
|
53
|
+
|
|
54
|
+
## derived / advisory(不可作完成权威)
|
|
55
|
+
|
|
56
|
+
| 视图 | 来源 | 为何不可作权威 |
|
|
57
|
+
| --- | --- | --- |
|
|
58
|
+
| Observe snapshot / 首页 KPI | `buildGlobalSnapshot` 投影 `.harness/` + Task Pool | derived;投影失败安全降级 |
|
|
59
|
+
| decision envelope 的 model verdict | `decision` / `riskLevel` 解析自文本 | `advisoryOnly: true`(`decision-envelope.ts` / `decision-evidence.ts` / `lifecycle.ts`) |
|
|
60
|
+
| canvas / event observer | `notifyRunObserver` / `notifyNodeObserver` | try/catch 吞;明确派生视图,不 affect canonical 执行 |
|
|
61
|
+
| DAG report / doctor | `src/application/dag/report-dag.ts` + `src/workflows/dag/report.ts`;doctor 在 `src/workflows/dag/lifecycle.ts` | 只读总结,operator 决策辅助 |
|
|
62
|
+
| knowledge-curator proposal | `src/workflows/dag/knowledge-curator.ts` | advisory process guidance,不改 accepted learned skill |
|
|
63
|
+
| morning report / metrics | `src/worker/report/**` | derived 统计,含分母/样本量/缺失说明 |
|
|
64
|
+
|
|
65
|
+
## 完成权威
|
|
66
|
+
|
|
67
|
+
完成权威 = shell command 的 exit code 与归档 stdout/stderr。执行入口是 `src/executors/shell-executor.ts`,环境/preset helper 在 `src/executors/shell-verification.ts`;`node.verifyEvidence` 保存 DAG authoring 提供的验证阶段、命令来源与标签等元数据。model verdict、Observe、报告都不构成完成判定。
|
|
68
|
+
|
|
69
|
+
## init 投影的 `.harness` 入口
|
|
70
|
+
|
|
71
|
+
`init --profile full` 在目标项目创建 `.harness/tasks`(directory)、`.harness/dag-runs/active`(directory)、`.harness/prompts/analyze.md`(generated)、`.harness/init-surface.json`(state)。这些是 init surface,不在 `packageExcluded`/`initExcluded` 范围;详见 `docs/init-surface.manifest.json`。
|