@tea-agent/loop-agent 0.39.0-beta.1 → 0.39.0-beta.10

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (331) hide show
  1. package/AGENTS.md +4 -1
  2. package/CHANGELOG.md +248 -95
  3. package/README.md +9 -5
  4. package/bin/loop-agent.js +7 -3
  5. package/dist/application/task-lifecycle/advance.js +12 -0
  6. package/dist/application/task-lifecycle/recommendations.js +13 -2
  7. package/dist/build-stamp.json +3 -3
  8. package/dist/cli/command-definitions.js +23 -5
  9. package/dist/cli/program.js +21 -2
  10. package/dist/cli/update/notifier.js +2 -2
  11. package/dist/cli/update/runtime-activity.js +1 -29
  12. package/dist/cli.js +2 -1
  13. package/dist/commands/client-recovery.js +3 -0
  14. package/dist/commands/dag-follow-up.js +138 -0
  15. package/dist/commands/dag-rerun.js +55 -1
  16. package/dist/commands/init-model-catalog.js +464 -0
  17. package/dist/commands/init-upgrade.js +265 -97
  18. package/dist/commands/init.js +455 -28
  19. package/dist/commands/inspect-next.js +8 -0
  20. package/dist/commands/task-advance.js +19 -0
  21. package/dist/executors/dag-pi-executor.js +2306 -61
  22. package/dist/executors/pi-executor.js +7 -0
  23. package/dist/executors/pi-extension-resolver.js +233 -0
  24. package/dist/executors/pi-playwright-cli-tool.js +74 -28
  25. package/dist/executors/pi-read-budget-policy.js +239 -0
  26. package/dist/executors/pi-sdk-executor.js +180 -33
  27. package/dist/executors/shell-executor.js +1249 -224
  28. package/dist/executors/shell-write-guard.js +14 -0
  29. package/dist/executors/workspace-write-snapshot.js +68 -0
  30. package/dist/infrastructure/harness/atomic-write.js +23 -0
  31. package/dist/shared/dag-failure-category.js +150 -0
  32. package/dist/shared/dag-prompt-override.js +27 -0
  33. package/dist/shared/openspec-spec.js +70 -4
  34. package/dist/shared/operator/capabilities.js +39 -0
  35. package/dist/shared/playwright-cli-command-policy.js +15 -0
  36. package/dist/shared/update/console-notifier.js +100 -0
  37. package/dist/{cli → shared}/update/npm-client.js +70 -15
  38. package/dist/{cli → shared}/update/state.js +41 -13
  39. package/dist/task/config-types.js +50 -5
  40. package/dist/task/contract/apply.js +11 -1
  41. package/dist/task/contract/constants.js +2 -0
  42. package/dist/task/contract/hash.js +3 -0
  43. package/dist/task/contract/observe.js +25 -4
  44. package/dist/task/contract/paths.js +2 -1
  45. package/dist/task/contract/project.js +18 -1
  46. package/dist/task/contract/schema.js +4 -1
  47. package/dist/task/contract/transaction.js +12 -0
  48. package/dist/task/frontend-project-capability.js +199 -18
  49. package/dist/task/source-prepare/completeness.js +188 -0
  50. package/dist/task/source-prepare/fragment-inventory.js +477 -0
  51. package/dist/task/source-prepare/index.js +3 -0
  52. package/dist/task/source-prepare/ledger-reconciliation.js +127 -0
  53. package/dist/task/source-prepare/ledger-review.js +214 -0
  54. package/dist/task/source-prepare/ledger.js +545 -0
  55. package/dist/task/source-prepare/parse-intent.js +24 -4
  56. package/dist/task/source-prepare/prepare.js +298 -1
  57. package/dist/task/source-prepare/semantic-intake.js +25 -5
  58. package/dist/task/source-prepare/source-fidelity-pi.js +384 -0
  59. package/dist/task/source-prepare/types.js +22 -0
  60. package/dist/task/source-references.js +22 -1
  61. package/dist/worker/cli.js +18 -2
  62. package/dist/worker/console/chat/chat-event-store.js +62 -4
  63. package/dist/worker/console/chat/context-panel.js +7 -0
  64. package/dist/worker/console/chat/deferred-turn.js +12 -0
  65. package/dist/worker/console/chat/operation-card.js +8 -1
  66. package/dist/worker/console/chat/pi-console-config.js +81 -10
  67. package/dist/worker/console/chat/pi-runtime.js +264 -16
  68. package/dist/worker/console/chat/provider-error.js +98 -0
  69. package/dist/worker/console/chat/routes.js +298 -32
  70. package/dist/worker/console/chat/session-stats.js +179 -0
  71. package/dist/worker/console/chat/session-store.js +93 -63
  72. package/dist/worker/console/chat/todos.js +115 -0
  73. package/dist/worker/console/chat/tool-preview.js +42 -0
  74. package/dist/worker/console/chat/turn-process.js +20 -55
  75. package/dist/worker/console/chat/user-questions.js +266 -0
  76. package/dist/worker/console/chat/workspace-landing.js +14 -0
  77. package/dist/worker/console/console-handoff.js +82 -0
  78. package/dist/worker/console/console-update-and-init.js +115 -0
  79. package/dist/worker/console/console-update-runtime.js +84 -0
  80. package/dist/worker/console/dag-execution-receipt.js +33 -0
  81. package/dist/worker/console/draft-store.js +49 -0
  82. package/dist/worker/console/frontend-human-decision-adapter.js +19 -0
  83. package/dist/worker/console/frontend-split-operation-adapter.js +20 -0
  84. package/dist/worker/console/index.js +3 -0
  85. package/dist/worker/console/inspect-split.js +18 -0
  86. package/dist/worker/console/native-directory-picker.js +13 -0
  87. package/dist/worker/console/operation-run-facts.js +19 -3
  88. package/dist/worker/console/operation-store.js +227 -7
  89. package/dist/worker/console/operator-actions.js +388 -0
  90. package/dist/worker/console/operator-surface-health.js +1 -0
  91. package/dist/worker/console/operator-user-error.js +2 -2
  92. package/dist/worker/console/prd-intake-bridge.js +13 -0
  93. package/dist/worker/console/routes.js +355 -3
  94. package/dist/worker/console/security.js +67 -13
  95. package/dist/worker/console/server.js +609 -164
  96. package/dist/worker/console/static/assets/{abnfDiagram-N423BO3Z-C4kVYweA.js → abnfDiagram-N423BO3Z-BAsjg7ew.js} +1 -1
  97. package/dist/worker/console/static/assets/{arc-Bj2M8iO5.js → arc-CyIlrwZw.js} +1 -1
  98. package/dist/worker/console/static/assets/{architectureDiagram-T3A2C74G-CLlXe4-6.js → architectureDiagram-T3A2C74G-Bo4tobhH.js} +1 -1
  99. package/dist/worker/console/static/assets/{blockDiagram-VBNYF7ZC-psEp5xH0.js → blockDiagram-VBNYF7ZC-Dfpow9gu.js} +1 -1
  100. package/dist/worker/console/static/assets/{c4Diagram-5PPSVZJV-DeKcOCGJ.js → c4Diagram-5PPSVZJV-DPmzG_B4.js} +1 -1
  101. package/dist/worker/console/static/assets/channel-DSrJAn0-.js +1 -0
  102. package/dist/worker/console/static/assets/{chunk-2GRJ4B5K-K0C744p1.js → chunk-2GRJ4B5K-pKQpB1UW.js} +1 -1
  103. package/dist/worker/console/static/assets/{chunk-2Q5K7J3B-xbNw4J9-.js → chunk-2Q5K7J3B-5n9YYquZ.js} +1 -1
  104. package/dist/worker/console/static/assets/{chunk-5RXB4S5H-DjLaSDUO.js → chunk-5RXB4S5H-DP3CtA2a.js} +1 -1
  105. package/dist/worker/console/static/assets/{chunk-5VM5RSS4-CtiPlKel.js → chunk-5VM5RSS4-DYxMJPUy.js} +1 -1
  106. package/dist/worker/console/static/assets/{chunk-6Q2QTUOP-DZtolir7.js → chunk-6Q2QTUOP-CS3D50Io.js} +1 -1
  107. package/dist/worker/console/static/assets/{chunk-GF5L2VYU-CPcdNeew.js → chunk-GF5L2VYU-gSdDfo5_.js} +1 -1
  108. package/dist/worker/console/static/assets/{chunk-JWPE2WC7-NgHc6V37.js → chunk-JWPE2WC7-A48q0ZNt.js} +1 -1
  109. package/dist/worker/console/static/assets/{chunk-KBJHAD2P-DQ_T-hg8.js → chunk-KBJHAD2P-ow8Mm3DY.js} +1 -1
  110. package/dist/worker/console/static/assets/{chunk-RYQCIY6F-DgLsxcVP.js → chunk-RYQCIY6F-CMKfLWYE.js} +1 -1
  111. package/dist/worker/console/static/assets/{chunk-XXDRQBXY-UrVoM9z1.js → chunk-XXDRQBXY-BiTBdQPX.js} +1 -1
  112. package/dist/worker/console/static/assets/classDiagram-JCYQIIEL-DeMmPl0_.js +1 -0
  113. package/dist/worker/console/static/assets/classDiagram-v2-OCEON4UE-DeMmPl0_.js +1 -0
  114. package/dist/worker/console/static/assets/{cose-bilkent-JH36ORCC-CLkYvTb3.js → cose-bilkent-JH36ORCC-Cm7exRz_.js} +1 -1
  115. package/dist/worker/console/static/assets/{cynefin-VYW2F7L2-BwT_xKrE.js → cynefin-VYW2F7L2-D9O5qGOu.js} +1 -1
  116. package/dist/worker/console/static/assets/{cynefinDiagram-MW4NZA55-Bi9tuzif.js → cynefinDiagram-MW4NZA55-CkvQnako.js} +1 -1
  117. package/dist/worker/console/static/assets/{dagre-VZM6K2ZE-BCIqkWBV.js → dagre-VZM6K2ZE-B1rzp7CB.js} +1 -1
  118. package/dist/worker/console/static/assets/{diagram-7IWD3JNH-Dip6l9_Z.js → diagram-7IWD3JNH-BP07Ipcc.js} +1 -1
  119. package/dist/worker/console/static/assets/{diagram-B4RE2ZJO-B-xkh_wK.js → diagram-B4RE2ZJO-BlPzweQb.js} +1 -1
  120. package/dist/worker/console/static/assets/{diagram-LBJQPF4R-DZO0kTt_.js → diagram-LBJQPF4R-CxPa7n0S.js} +1 -1
  121. package/dist/worker/console/static/assets/{diagram-Q27KOJAE-D6ZplNbZ.js → diagram-Q27KOJAE-CMTZs53A.js} +1 -1
  122. package/dist/worker/console/static/assets/{diagram-UB23O5K3-BPekbhoS.js → diagram-UB23O5K3-CxG_X52r.js} +1 -1
  123. package/dist/worker/console/static/assets/{ebnfDiagram-BXEA7PRR-BtmaJpK5.js → ebnfDiagram-BXEA7PRR-D8axtJM0.js} +1 -1
  124. package/dist/worker/console/static/assets/{erDiagram-JOGREHBK-6DS0Xc44.js → erDiagram-JOGREHBK-DIsGzn7b.js} +1 -1
  125. package/dist/worker/console/static/assets/{flowDiagram-UKHOOZJN-CihnROSm.js → flowDiagram-UKHOOZJN-CU9zkDG0.js} +1 -1
  126. package/dist/worker/console/static/assets/{ganttDiagram-PKOTCBZU-CZC4zOE2.js → ganttDiagram-PKOTCBZU-DCjTmz5P.js} +1 -1
  127. package/dist/worker/console/static/assets/{gitGraphDiagram-DS77QQ5N-Dq1fhzGN.js → gitGraphDiagram-DS77QQ5N-BksdmFzg.js} +1 -1
  128. package/dist/worker/console/static/assets/index-B-O5ChYq.css +1 -0
  129. package/dist/worker/console/static/assets/index-CfnY8AQx.js +407 -0
  130. package/dist/worker/console/static/assets/{infoDiagram-6WML65LV-DlSl4BGx.js → infoDiagram-6WML65LV-CGzzzJtL.js} +1 -1
  131. package/dist/worker/console/static/assets/{ishikawaDiagram-WSZJBQD7-snnzFl_U.js → ishikawaDiagram-WSZJBQD7-BdseB80N.js} +1 -1
  132. package/dist/worker/console/static/assets/{journeyDiagram-NVQOT4AX-BDE7qpMx.js → journeyDiagram-NVQOT4AX-DM9gsgha.js} +1 -1
  133. package/dist/worker/console/static/assets/{kanban-definition-27J2QSJJ-CD2Ci04G.js → kanban-definition-27J2QSJJ-3q-_9R2b.js} +1 -1
  134. package/dist/worker/console/static/assets/{linear-DdnapKIH.js → linear-B8N-Mxsd.js} +1 -1
  135. package/dist/worker/console/static/assets/{mermaid.core-BVjAT9b8.js → mermaid.core-EPIHUUsu.js} +5 -5
  136. package/dist/worker/console/static/assets/{mindmap-definition-FAOFIHXS-D0yJk-zA.js → mindmap-definition-FAOFIHXS-CxwO12aa.js} +1 -1
  137. package/dist/worker/console/static/assets/{pegDiagram-VL7TDLO6-BVo9tFP-.js → pegDiagram-VL7TDLO6-bPqbVX6Y.js} +1 -1
  138. package/dist/worker/console/static/assets/{pieDiagram-7S7Q4E2Y-DnOV-mZ_.js → pieDiagram-7S7Q4E2Y-KzqIvzeX.js} +1 -1
  139. package/dist/worker/console/static/assets/{quadrantDiagram-CIZ2JOQS-CzUJo58i.js → quadrantDiagram-CIZ2JOQS-CyofpWiV.js} +1 -1
  140. package/dist/worker/console/static/assets/{railroadDiagram-AXF67PYL-Bvikrolh.js → railroadDiagram-AXF67PYL-cTWJvLTP.js} +1 -1
  141. package/dist/worker/console/static/assets/{requirementDiagram-LRYGKXZP-DtaSVCap.js → requirementDiagram-LRYGKXZP-BK--q27B.js} +1 -1
  142. package/dist/worker/console/static/assets/{sankeyDiagram-W5VNT64P-C2c9A0wW.js → sankeyDiagram-W5VNT64P-C0SDOHXK.js} +1 -1
  143. package/dist/worker/console/static/assets/{sequenceDiagram-SI44F4Z6-DmXJcU7r.js → sequenceDiagram-SI44F4Z6-Cong6YIo.js} +1 -1
  144. package/dist/worker/console/static/assets/{sizeCapture-X5ZJPWSS-B4GUFW92.js → sizeCapture-X5ZJPWSS-DUVkgZx8.js} +1 -1
  145. package/dist/worker/console/static/assets/{stateDiagram-OKZ733FA-Dsad2MXf.js → stateDiagram-OKZ733FA-C7XgxuZg.js} +1 -1
  146. package/dist/worker/console/static/assets/stateDiagram-v2-UEYNNEHI-Dzbnd5oX.js +1 -0
  147. package/dist/worker/console/static/assets/{swimlanes-SLNWSIFB-DGq48Fbi.js → swimlanes-SLNWSIFB-D9Ayvwcy.js} +2 -2
  148. package/dist/worker/console/static/assets/swimlanesDiagram-ULZ7WXOC-BY0hHk6G.js +8 -0
  149. package/dist/worker/console/static/assets/{timeline-definition-Z64GVDOM-CSSi6OFf.js → timeline-definition-Z64GVDOM-Byb000cH.js} +1 -1
  150. package/dist/worker/console/static/assets/{vennDiagram-T6HMQDX7-BqyzPrWv.js → vennDiagram-T6HMQDX7-DMLegPt4.js} +1 -1
  151. package/dist/worker/console/static/assets/{wardleyDiagram-T6FBY63Y-DlznVb6S.js → wardleyDiagram-T6FBY63Y-ChMMeOsP.js} +1 -1
  152. package/dist/worker/console/static/assets/{xychartDiagram-ELKLHX3M-CfBcgJ_K.js → xychartDiagram-ELKLHX3M-bEMEPisW.js} +1 -1
  153. package/dist/worker/console/static/index.html +2 -2
  154. package/dist/worker/console/static-src/active-run-badge.js +17 -0
  155. package/dist/worker/console/static-src/app/console-types.js +68 -4
  156. package/dist/worker/console/static-src/app/useConsoleShell.js +30 -12
  157. package/dist/worker/console/static-src/app/useOperatorActions.js +41 -6
  158. package/dist/worker/console/static-src/app/useRecoveryConsole.js +45 -10
  159. package/dist/worker/console/static-src/app/useRunProgress.js +47 -0
  160. package/dist/worker/console/static-src/app/useTaskWizard.js +74 -2
  161. package/dist/worker/console/static-src/night/useNightBoard.js +8 -5
  162. package/dist/worker/console/static-src/operator-chat/cards/failure-category-advice.js +25 -0
  163. package/dist/worker/console/static-src/operator-chat/chat-sse-events.js +140 -8
  164. package/dist/worker/console/static-src/operator-chat/details-dag-actions.js +122 -0
  165. package/dist/worker/console/static-src/operator-chat/input-history.js +76 -0
  166. package/dist/worker/console/static-src/operator-chat/mutation-gate.js +1 -1
  167. package/dist/worker/console/static-src/operator-chat/refs.js +3 -0
  168. package/dist/worker/console/static-src/operator-chat/runtime-selection-labels.js +27 -0
  169. package/dist/worker/console/static-src/operator-chat/turn-submission.js +16 -3
  170. package/dist/worker/console/static-src/operator-chat/useChatSessions.js +168 -72
  171. package/dist/worker/console/static-src/operator-chat/useChatStream.js +102 -21
  172. package/dist/worker/console/static-src/operator-chat/useChatThread.js +184 -4
  173. package/dist/worker/console/static-src/operator-chat/useComposer.js +32 -0
  174. package/dist/worker/console/static-src/operator-chat/useRepoBrowser.js +63 -9
  175. package/dist/worker/console/static-src/operator-chat/useWorkspaceBrowserGate.js +4 -0
  176. package/dist/worker/console/static-src/operator-chat/workspace-layout-mode.js +3 -3
  177. package/dist/worker/console/static-src/pages/tasks/run-id-resolution.js +79 -0
  178. package/dist/worker/console/static-src/pages/tasks/run-ownership-verify.js +23 -0
  179. package/dist/worker/console/static-src/pages/tasks/run-panel-progress.js +110 -0
  180. package/dist/worker/console/static-src/shell/useWorkspaces.js +299 -0
  181. package/dist/worker/console/static-src/shell/workspace-route.js +337 -0
  182. package/dist/worker/console/workspace-context.js +344 -0
  183. package/dist/worker/console/workspace-registry.js +214 -0
  184. package/dist/worker/loop-agent/loop-agent-client.js +7 -3
  185. package/dist/worker/materialize/frontend-split-task-materializer.js +72 -0
  186. package/dist/worker/materialize/harness-task-lineage.js +5 -2
  187. package/dist/worker/observability/init-runtime-activity.js +26 -0
  188. package/dist/worker/observability/read-model.js +22 -0
  189. package/dist/worker/observe/node-input.js +160 -3
  190. package/dist/worker/observe/node-process.js +377 -0
  191. package/dist/worker/observe/routes.js +224 -3
  192. package/dist/worker/observe/server.js +4 -0
  193. package/dist/worker/observe/shell-handler-keys.js +34 -0
  194. package/dist/worker/observe/static/api.js +90 -4
  195. package/dist/worker/observe/static/app.js +18 -70
  196. package/dist/worker/observe/static/constants.js +8 -1
  197. package/dist/worker/observe/static/dag-history-labels.js +4 -0
  198. package/dist/worker/observe/static/dag-node-purpose.d.ts +6 -0
  199. package/dist/worker/observe/static/dag-node-purpose.js +208 -0
  200. package/dist/worker/observe/static/format.js +60 -0
  201. package/dist/worker/observe/static/index.html +6 -1
  202. package/dist/worker/observe/static/inspect-workspace.js +307 -0
  203. package/dist/worker/observe/static/markdown-render.js +20 -1
  204. package/dist/worker/observe/static/operator-chrome.css +145 -20
  205. package/dist/worker/observe/static/operator-chrome.d.ts +20 -3
  206. package/dist/worker/observe/static/operator-chrome.js +330 -96
  207. package/dist/worker/observe/static/prompt-restart-candidates.d.ts +18 -0
  208. package/dist/worker/observe/static/prompt-restart-candidates.js +36 -0
  209. package/dist/worker/observe/static/router.d.ts +46 -0
  210. package/dist/worker/observe/static/router.js +25 -1
  211. package/dist/worker/observe/static/state.d.ts +50 -0
  212. package/dist/worker/observe/static/state.js +184 -1
  213. package/dist/worker/observe/static/styles.css +395 -0
  214. package/dist/worker/observe/static/views/dag-graph.js +4 -2
  215. package/dist/worker/observe/static/views/dag-inspector.js +1067 -9
  216. package/dist/worker/observe/static/views/dag.d.ts +13 -0
  217. package/dist/worker/observe/static/views/dag.js +14 -5
  218. package/dist/worker/observe/static/views/dashboard.js +6 -4
  219. package/dist/worker/observe/static/views/failures.js +5 -2
  220. package/dist/worker/observe/static/views/night.js +2 -2
  221. package/dist/worker/observe/static/views/pool.js +1 -0
  222. package/dist/worker/observe/static/views/run.js +3 -1
  223. package/dist/worker/observe/static/views/session-timeline.js +78 -9
  224. package/dist/worker/observe/static/views/task.js +56 -1
  225. package/dist/workflows/dag/backend-test-case-coverage-analysis.js +49 -3
  226. package/dist/workflows/dag/backend-test-markdown-workflow.js +176 -1
  227. package/dist/workflows/dag/backend-test-pytest-collection.js +98 -14
  228. package/dist/workflows/dag/backend-test-writer-completeness.js +10 -5
  229. package/dist/workflows/dag/contract-output-registry.js +15 -0
  230. package/dist/workflows/dag/contract-validator-registrations.js +1 -2
  231. package/dist/workflows/dag/dynamic-runtime/loop-until.js +1 -1
  232. package/dist/workflows/dag/dynamic-runtime/map.js +1 -1
  233. package/dist/workflows/dag/failure-category.js +7 -116
  234. package/dist/workflows/dag/frontend-closeout.js +221 -0
  235. package/dist/workflows/dag/frontend-design-policy.js +400 -0
  236. package/dist/workflows/dag/frontend-human-decision.js +182 -0
  237. package/dist/workflows/dag/frontend-implementation-contract.js +538 -166
  238. package/dist/workflows/dag/frontend-plan-render.js +24 -0
  239. package/dist/workflows/dag/frontend-prewrite-gate.js +388 -392
  240. package/dist/workflows/dag/frontend-provider-capability-matrix.js +159 -0
  241. package/dist/workflows/dag/frontend-recovery-capsule.js +455 -0
  242. package/dist/workflows/dag/frontend-recovery-controller.js +202 -0
  243. package/dist/workflows/dag/frontend-recovery-lineage.js +178 -0
  244. package/dist/workflows/dag/frontend-recovery-plan.js +17 -10
  245. package/dist/workflows/dag/frontend-recovery-run.js +33 -20
  246. package/dist/workflows/dag/frontend-repair.js +7 -424
  247. package/dist/workflows/dag/frontend-review-context.js +288 -14
  248. package/dist/workflows/dag/frontend-review-findings.js +270 -0
  249. package/dist/workflows/dag/frontend-risk.js +15 -2
  250. package/dist/workflows/dag/frontend-shadow-dual-write.js +814 -0
  251. package/dist/workflows/dag/frontend-shape-capsule-store.js +191 -0
  252. package/dist/workflows/dag/frontend-shape-facts.js +409 -0
  253. package/dist/workflows/dag/frontend-shape.js +427 -0
  254. package/dist/workflows/dag/frontend-source-fidelity-ledger.js +108 -0
  255. package/dist/workflows/dag/frontend-split-application-service.js +203 -0
  256. package/dist/workflows/dag/frontend-split-orchestrator.js +899 -0
  257. package/dist/workflows/dag/frontend-test-case-checklist.js +30 -4
  258. package/dist/workflows/dag/frontend-test-case-manifest.js +11 -4
  259. package/dist/workflows/dag/frontend-test-case-quality.js +11 -16
  260. package/dist/workflows/dag/frontend-test-environment-probe.js +230 -0
  261. package/dist/workflows/dag/frontend-test-html-report.js +3 -1
  262. package/dist/workflows/dag/frontend-test-l5-report.js +3 -1
  263. package/dist/workflows/dag/frontend-test-layout.js +159 -0
  264. package/dist/workflows/dag/frontend-test-markdown.js +61 -0
  265. package/dist/workflows/dag/frontend-test-result-contract.js +188 -42
  266. package/dist/workflows/dag/frontend-test-standard-scenarios.js +70 -0
  267. package/dist/workflows/dag/frontend-typed-event-store.js +452 -0
  268. package/dist/workflows/dag/frontend-typed-event-transaction.js +180 -0
  269. package/dist/workflows/dag/frontend-verification-trace.js +52 -17
  270. package/dist/workflows/dag/frontend-worktree-diff.js +250 -17
  271. package/dist/workflows/dag/frontend-writer-admission.js +272 -0
  272. package/dist/workflows/dag/frontend-writer-status.js +244 -0
  273. package/dist/workflows/dag/init-hybrid.js +984 -613
  274. package/dist/workflows/dag/interrupt-request.js +10 -3
  275. package/dist/workflows/dag/lifecycle.js +3 -3
  276. package/dist/workflows/dag/node-execution.js +468 -58
  277. package/dist/workflows/dag/prompt.js +44 -19
  278. package/dist/workflows/dag/recovery-lease.js +80 -0
  279. package/dist/workflows/dag/report.js +37 -1
  280. package/dist/workflows/dag/rerun-feedback.js +124 -1
  281. package/dist/workflows/dag/rerun-plan.js +144 -5
  282. package/dist/workflows/dag/rerun-run.js +81 -6
  283. package/dist/workflows/dag/rerun-task.js +29 -0
  284. package/dist/workflows/dag/retry-policy.js +318 -8
  285. package/dist/workflows/dag/runner.js +429 -122
  286. package/dist/workflows/dag/scheduler.js +114 -16
  287. package/dist/workflows/dag/structured-output-repair.js +712 -0
  288. package/dist/workflows/dag/types.js +321 -31
  289. package/dist/workflows/dag/upstream-artifacts.js +0 -4
  290. package/dist/workflows/dag/validate.js +92 -32
  291. package/docs/README.md +2 -0
  292. package/docs/architecture/evolution.md +45 -0
  293. package/docs/init-surface.manifest.json +9 -0
  294. package/docs/operations/README.md +1 -1
  295. package/docs/operations/local-development-environment.md +21 -0
  296. package/docs/templates/README.md +2 -1
  297. package/docs/templates/agent-dag-report.schema.json +8 -2
  298. package/docs/templates/agent-dag.schema.json +45 -1
  299. package/docs/templates/frontend-implementation-contract.schema.json +684 -24
  300. package/docs/templates/frontend-test-case-checklist.md +2 -2
  301. package/docs/templates/frontend-test-dag.json +8 -10
  302. package/docs/templates/frontend-test-dag.retrieve-context.prompt.md +1 -1
  303. package/docs/templates/init-managed-agents.md +13 -3
  304. package/docs/templates/spec-registry.schema.json +45 -0
  305. package/harness.json +3 -3
  306. package/package.json +7 -1
  307. package/scripts/next-info.mjs +356 -0
  308. package/scripts/next-publish-gate.mjs +238 -0
  309. package/scripts/release-source-binding.mjs +251 -0
  310. package/skills/codebase-scout/SKILL.md +1 -1
  311. package/skills/fe-test-ui-scout/SKILL.md +65 -0
  312. package/skills/fe-test-ui-scout/references/ledger-schema.md +62 -0
  313. package/skills/fe-test-ui-scout/references/recon-protocol.md +54 -0
  314. package/skills/frontend-bounded-implement/SKILL.md +8 -14
  315. package/skills/frontend-design-review/SKILL.md +20 -41
  316. package/skills/frontend-implementation/SKILL.md +3 -4
  317. package/skills/frontend-implementation/references/design-spec.md +15 -10
  318. package/skills/frontend-implementation/references/node-contracts.md +23 -13
  319. package/skills/frontend-review/SKILL.md +22 -14
  320. package/skills/frontend-review/references/review-findings.md +6 -7
  321. package/skills/loop-agent/references/command-reference.md +12 -4
  322. package/skills/loop-agent/references/hybrid-dag.md +8 -1
  323. package/skills/playwright-cli/SKILL.md +23 -1
  324. package/skills/playwright-cli-case-generator/SKILL.md +29 -8
  325. package/dist/worker/console/static/assets/channel-CPF4N7pf.js +0 -1
  326. package/dist/worker/console/static/assets/classDiagram-JCYQIIEL-C2DwA_Y1.js +0 -1
  327. package/dist/worker/console/static/assets/classDiagram-v2-OCEON4UE-C2DwA_Y1.js +0 -1
  328. package/dist/worker/console/static/assets/index-DTZOKgAn.js +0 -404
  329. package/dist/worker/console/static/assets/index-Ya5FE7cD.css +0 -1
  330. package/dist/worker/console/static/assets/stateDiagram-v2-UEYNNEHI-B8FB_cNk.js +0 -1
  331. package/dist/worker/console/static/assets/swimlanesDiagram-ULZ7WXOC-CrZYaWfx.js +0 -8
@@ -1,16 +1,23 @@
1
1
  import path from "node:path";
2
- import { createHash } from "node:crypto";
2
+ import { createHash, randomUUID } from "node:crypto";
3
3
  import { readFile } from "node:fs/promises";
4
4
  import { writeDagNodeJsonArtifact, writeTextArtifactFile, } from "../infrastructure/harness/artifact-store.js";
5
- import { executePiStep, } from "./pi-executor.js";
5
+ import { writeJsonAtomic } from "../infrastructure/harness/atomic-write.js";
6
+ import { mapContractBlockedOwner } from "../workflows/dag/frontend-human-decision.js";
7
+ import { routeFrontendProviderCapability } from "../workflows/dag/frontend-provider-capability-matrix.js";
8
+ import { executePiStep, resolvePiBackend, } from "./pi-executor.js";
9
+ import { resolveDagPiExtensions, } from "./pi-extension-resolver.js";
6
10
  import { buildPiWriterToolPolicyContext, createPiWriterCustomTools, } from "./pi-writer-tool-policy.js";
11
+ import { createPiReadBudgetCustomTools, } from "./pi-read-budget-policy.js";
7
12
  import { cleanupPlaywrightCliDefaultSession, createPlaywrightCliTool, PI_COMMAND_CAPABILITY_REGISTRY, resolveCaseIdFromWriteSet, resolveEvidenceDirFromWriteSet, } from "./pi-playwright-cli-tool.js";
8
13
  import { dagCommandPolicyAllows, resolveDagCommandPolicy, } from "../workflows/dag/types.js";
9
14
  import { redactPromptForLog, truncateOutput, } from "../shared/output-truncation.js";
10
15
  import { GitStatusUnavailableError, pathsChangedDuringRun, readGitStatusPorcelain, recoverRootNulArtifact, snapshotGitStatusPathFingerprints, snapshotGitStatusPorcelain, validateShellWriteGuard, } from "./shell-write-guard.js";
11
- import { isWriterEmptyDiffRetryCandidate, isWriterTransportRetryCandidate, INCOMPLETE_WRITE_SET_RETRY_CATEGORY, WRITER_CLEAN_TIMEOUT_RETRY_CATEGORY, WRITER_EMPTY_DIFF_RETRY_CATEGORY, } from "../workflows/dag/retry-policy.js";
16
+ import { captureWorkspaceWriteSnapshot, diffWorkspaceWriteSnapshots, } from "./workspace-write-snapshot.js";
17
+ import { isTargetTemplateTransientRetryNode, isWriterEmptyDiffRetryCandidate, isWriterTransportRetryCandidate, INCOMPLETE_WRITE_SET_RETRY_CATEGORY, WRITER_CLEAN_TIMEOUT_RETRY_CATEGORY, WRITER_EMPTY_DIFF_RETRY_CATEGORY, } from "../workflows/dag/retry-policy.js";
12
18
  import { assessBackendTestMdPlanCompleteness, assessBackendTestMdWriterCompleteness, assessBackendTestPytestPlanCompleteness, assessBackendTestPytestWriterCompleteness, assessBackendTestShardChildCompleteness, backendTestWriterProgressRoleForTask, classifyBackendTestWriterCompletenessFailure, isBackendTestCompletenessRetryCandidate, isBackendTestMdPlanTask, isBackendTestPytestPlanTask, isBackendTestShardChildTask, writeBackendTestWriterProgressArtifacts, } from "../workflows/dag/backend-test-writer-completeness.js";
13
19
  import { resolveBackendTestLayout } from "../workflows/dag/backend-test-layout.js";
20
+ import { frontendTestLayoutFromSpec, } from "../workflows/dag/frontend-test-layout.js";
14
21
  import { redactSecrets, truncateUtf8Preview } from "../shared/preview.js";
15
22
  /**
16
23
  * Writer classification for a length-stopped thinking-only attempt: the model
@@ -21,6 +28,15 @@ import { redactSecrets, truncateUtf8Preview } from "../shared/preview.js";
21
28
  * recoverable partial-write-set (incomplete-write-set) upgrade.
22
29
  */
23
30
  export const WRITER_THINKING_EXHAUSTED_CATEGORY = "writer-thinking-exhausted";
31
+ /**
32
+ * The writer session burned an excessive token budget (a read-edit-test loop
33
+ * that never converged) and still failed. Distinct from empty-output so the
34
+ * report shows the real cause and recovery recommends a fresh compacted run.
35
+ * Not auto-retried by default; operators may rerun after a model switch.
36
+ */
37
+ export const WRITER_BUDGET_EXHAUSTED_CATEGORY = "writer-budget-exhausted";
38
+ /** Token ceiling for a single writer node before it is judged budget-exhausted. */
39
+ export const WRITER_TOKEN_BUDGET = 2_000_000;
24
40
  function readWriterThinkingExhaustionEvidence(result) {
25
41
  const wider = result;
26
42
  return {
@@ -163,6 +179,14 @@ function resolvePiExecutorStep(persona) {
163
179
  function isDagPiWriteTask(task) {
164
180
  return task.executor === "pi" && task.toolProfile === "write";
165
181
  }
182
+ /**
183
+ * M4: `frontend-implement-pi` derives its status from mechanical facts instead
184
+ * of the IMPLEMENTATION_OUTCOME first line. Everything else (backend/README/
185
+ * module writers + frontend-repair-pi) keeps the legacy protocol face.
186
+ */
187
+ export function isFrontendFactsWriter(task) {
188
+ return task.writerOutcomePolicy?.type === "frontend-facts-v1";
189
+ }
166
190
  /** Map DAG `piStep` / `role` to a safe workflow step for read-only Pi or bounded write. */
167
191
  export function resolveDagPiStepName(task) {
168
192
  if (isDagPiWriteTask(task)) {
@@ -174,35 +198,1648 @@ export function resolveDagPiStepName(task) {
174
198
  if (task.role) {
175
199
  return PI_WRITE_ROLE_TO_STEP[task.role];
176
200
  }
177
- return "implement";
201
+ return "implement";
202
+ }
203
+ return resolvePiExecutorStep(resolveDagPiPersona(task));
204
+ }
205
+ /** A+B: `frontend-contract-pi` incremental record tools (origin=contract). */
206
+ export const FRONTEND_CONTRACT_RECORD_TOOL_NAMES = [
207
+ "record_requirement",
208
+ "record_constraint",
209
+ "record_evidence_expectation",
210
+ "record_handoff_intent",
211
+ "record_open_question",
212
+ "record_split_proposal",
213
+ ];
214
+ export const FRONTEND_CONTRACT_TERMINAL_TOOL_NAMES = [
215
+ "finalize_contract",
216
+ ];
217
+ /** A+B: `frontend-scout-pi` incremental evidence tools (origin=scout). */
218
+ export const FRONTEND_SCOUT_EVIDENCE_TOOL_NAMES = [
219
+ "record_target_surface",
220
+ "record_design_evidence",
221
+ ];
222
+ /** A+B: `frontend-plan-pi` incremental record tools (origin=plan). */
223
+ export const FRONTEND_PLAN_RECORD_TOOL_NAMES = [
224
+ "record_route_selection",
225
+ "record_component_choice",
226
+ "record_state_flow",
227
+ "record_data_flow",
228
+ "record_mock_api",
229
+ "record_design_deviation",
230
+ "record_dependency",
231
+ "record_plan_requirement",
232
+ "record_plan_verification_target",
233
+ "record_plan_evidence_gap",
234
+ ];
235
+ export const FRONTEND_PLAN_TERMINAL_TOOL_NAMES = ["finalize_plan"];
236
+ export const FRONTEND_PLAN_ADOPT_TOOL_NAMES = ["adopt_staged_fact"];
237
+ /** M5: `frontend-review-pi` emits its authoritative terminal verdict through
238
+ * committed typed tools instead of the legacy JSON verdict parse. */
239
+ export function isFrontendReviewTypedTerminalNode(task) {
240
+ return task.id === "frontend-review-pi";
241
+ }
242
+ /** M8: `frontend-design-review-pi` emits its authoritative terminal verdict
243
+ * through committed typed tools (`approve_design` / `request_design_changes`)
244
+ * instead of the legacy first-line `VERDICT: pass|request-revision` text. */
245
+ export function isFrontendDesignTypedTerminalNode(task) {
246
+ return task.id === "frontend-design-review-pi";
247
+ }
248
+ /** A+B: `frontend-contract-pi` submits its contract through incremental typed
249
+ * tools + the `finalize_contract` terminal (origin=contract). */
250
+ export function isFrontendContractTypedNode(task) {
251
+ return task.id === "frontend-contract-pi";
252
+ }
253
+ /** A+B: `frontend-scout-pi` submits target-surface/design-evidence through
254
+ * incremental evidence tools (origin=scout). */
255
+ export function isFrontendScoutEvidenceNode(task) {
256
+ return task.id === "frontend-scout-pi";
257
+ }
258
+ /** A+B: `frontend-plan-pi` records its decision ledger through seven
259
+ * incremental `record_*` tools and closes with `finalize_plan`. */
260
+ export function isFrontendPlanLedgerNode(task) {
261
+ return task.id === "frontend-plan-pi";
262
+ }
263
+ export function resolveDagPiToolNames(task) {
264
+ if (isFrontendReviewTypedTerminalNode(task)) {
265
+ return [
266
+ ...DAG_PI_READONLY_TOOLS,
267
+ "approve_review",
268
+ "request_review_changes",
269
+ ];
270
+ }
271
+ if (isFrontendDesignTypedTerminalNode(task)) {
272
+ return [
273
+ ...DAG_PI_READONLY_TOOLS,
274
+ "approve_design",
275
+ "request_design_changes",
276
+ ];
277
+ }
278
+ if (isFrontendContractTypedNode(task)) {
279
+ return [
280
+ ...DAG_PI_READONLY_TOOLS,
281
+ ...FRONTEND_CONTRACT_RECORD_TOOL_NAMES,
282
+ ...FRONTEND_CONTRACT_TERMINAL_TOOL_NAMES,
283
+ ];
284
+ }
285
+ if (isFrontendScoutEvidenceNode(task)) {
286
+ return [...DAG_PI_READONLY_TOOLS, ...FRONTEND_SCOUT_EVIDENCE_TOOL_NAMES];
287
+ }
288
+ if (isFrontendPlanLedgerNode(task)) {
289
+ return [
290
+ // Plan consumes typed contract/scout facts. It may inspect an explicitly
291
+ // named file, but repository-wide search belongs to the scout node.
292
+ "read",
293
+ ...FRONTEND_PLAN_RECORD_TOOL_NAMES,
294
+ ...FRONTEND_PLAN_TERMINAL_TOOL_NAMES,
295
+ ...FRONTEND_PLAN_ADOPT_TOOL_NAMES,
296
+ ];
297
+ }
298
+ if (!isDagPiWriteTask(task))
299
+ return [...DAG_PI_READONLY_TOOLS];
300
+ const tools = [...DAG_PI_WRITE_TOOLS];
301
+ // Pi SDK activates custom tools only when they are in this explicit list.
302
+ // Command capabilities (playwright_cli) stay capability-gated; read-only nodes never get command tools.
303
+ if (dagCommandPolicyAllows(task.commandPolicy, "playwright-cli")) {
304
+ tools.push("playwright_cli");
305
+ }
306
+ return tools;
307
+ }
308
+ export const FRONTEND_REVIEW_TERMINAL_TOOL_NAMES = new Set([
309
+ "approve_review",
310
+ "request_review_changes",
311
+ ]);
312
+ /**
313
+ * Fail-closed scanner for the two committed review terminal tools. Mirrors
314
+ * M4's `countWriteToolEventsFromSessionEvents` pattern: an unparseable line
315
+ * never counts as a terminal fact, so a corrupt/empty log cannot inflate the
316
+ * typed verdict.
317
+ */
318
+ export function scanReviewTerminalKindsFromSessionEvents(content) {
319
+ const kinds = [];
320
+ for (const line of content.split("\n")) {
321
+ const trimmed = line.trim();
322
+ if (!trimmed)
323
+ continue;
324
+ let event;
325
+ try {
326
+ event = JSON.parse(trimmed);
327
+ }
328
+ catch {
329
+ continue;
330
+ }
331
+ if (event !== null &&
332
+ typeof event === "object" &&
333
+ event.type === "tool_execution_start" &&
334
+ typeof event.toolName === "string" &&
335
+ FRONTEND_REVIEW_TERMINAL_TOOL_NAMES.has(event.toolName)) {
336
+ kinds.push(event.toolName);
337
+ }
338
+ }
339
+ return kinds;
340
+ }
341
+ /** Read-only discovery tool budget for frontend-plan-pi. Exceeding it means
342
+ * the plan re-read upstream outputs/sources instead of trusting typed facts,
343
+ * which blows up the context window (400 request-too-large). */
344
+ const PLAN_READ_TOOL_BUDGET = 40;
345
+ const READ_ONLY_TOOL_NAMES = new Set(["read", "grep", "ls", "find"]);
346
+ function readEventPath(event) {
347
+ const candidates = [event.path, event.readPath, event.input];
348
+ for (const value of candidates) {
349
+ if (typeof value === "string")
350
+ return value;
351
+ if (value && typeof value === "object") {
352
+ const nested = value;
353
+ for (const key of ["path", "readPath", "file"]) {
354
+ if (typeof nested[key] === "string")
355
+ return nested[key];
356
+ }
357
+ }
358
+ }
359
+ return undefined;
360
+ }
361
+ function eventTimestamp(event) {
362
+ for (const key of ["timestamp", "timestampMs", "ts", "createdAt"]) {
363
+ const value = event[key];
364
+ if (typeof value === "number" && Number.isFinite(value))
365
+ return value < 10_000_000_000 ? value * 1000 : value;
366
+ if (typeof value === "string") {
367
+ const parsed = Date.parse(value);
368
+ if (Number.isFinite(parsed))
369
+ return parsed;
370
+ }
371
+ }
372
+ return undefined;
373
+ }
374
+ function eventBytes(event, line) {
375
+ const result = event.result ?? event.toolResult ?? event.output;
376
+ if (typeof result === "string")
377
+ return Buffer.byteLength(result);
378
+ if (result !== undefined)
379
+ return Buffer.byteLength(JSON.stringify(result));
380
+ return Buffer.byteLength(line);
381
+ }
382
+ export async function detectNodeReadBudget(input) {
383
+ if (!input.budget)
384
+ return [];
385
+ const sessionEventsPath = path.join(input.runDir, input.nodeId, "session-events.jsonl");
386
+ let content;
387
+ try {
388
+ content = await readFile(sessionEventsPath, "utf8");
389
+ }
390
+ catch {
391
+ return [];
392
+ }
393
+ const stats = { files: new Set(), bytes: 0, tools: 0 };
394
+ let firstTs;
395
+ let lastTs;
396
+ for (const line of content.split("\n")) {
397
+ if (!line.trim())
398
+ continue;
399
+ try {
400
+ const event = JSON.parse(line);
401
+ if (event.type !== "tool_execution_start" || typeof event.toolName !== "string" || !READ_ONLY_TOOL_NAMES.has(event.toolName))
402
+ continue;
403
+ stats.tools++;
404
+ const readPath = readEventPath(event);
405
+ if (readPath)
406
+ stats.files.add(readPath);
407
+ stats.bytes += eventBytes(event, line);
408
+ const ts = eventTimestamp(event);
409
+ if (ts !== undefined) {
410
+ firstTs ??= ts;
411
+ lastTs = ts;
412
+ }
413
+ }
414
+ catch { /* ignore malformed telemetry */ }
415
+ }
416
+ if (firstTs !== undefined && lastTs !== undefined)
417
+ stats.elapsedMs = Math.max(0, lastTs - firstTs);
418
+ const issues = [];
419
+ if (stats.files.size > input.budget.maxFiles)
420
+ issues.push(`frontend ${input.nodeId} read budget exceeded: ${stats.files.size} files (budget ${input.budget.maxFiles})`);
421
+ if (stats.bytes > input.budget.maxBytes)
422
+ issues.push(`frontend ${input.nodeId} read budget exceeded: ${stats.bytes} bytes (budget ${input.budget.maxBytes})`);
423
+ if (input.budget.maxMs !== undefined &&
424
+ stats.elapsedMs !== undefined &&
425
+ stats.elapsedMs > input.budget.maxMs)
426
+ issues.push(`frontend ${input.nodeId} read budget exceeded: ${stats.elapsedMs}ms (budget ${input.budget.maxMs}ms)`);
427
+ return issues;
428
+ }
429
+ /** Deterministic read-burst guard for frontend-plan-pi: count read-only
430
+ * discovery tool calls (read/grep/ls/find) from the session log. Over budget →
431
+ * read-burst, retried with a reduced-reading instruction. Pure scan; a
432
+ * successful plan under budget is never blocked. */
433
+ export async function detectPlanReadBurst(input) {
434
+ const sessionEventsPath = path.join(input.runDir, input.nodeId, "session-events.jsonl");
435
+ let count = 0;
436
+ try {
437
+ const content = await readFile(sessionEventsPath, "utf8");
438
+ for (const line of content.split("\n")) {
439
+ if (!line.trim())
440
+ continue;
441
+ try {
442
+ const event = JSON.parse(line);
443
+ if (event.type === "tool_execution_start" &&
444
+ typeof event.toolName === "string" &&
445
+ (event.toolName === "read" ||
446
+ event.toolName === "grep" ||
447
+ event.toolName === "ls" ||
448
+ event.toolName === "find")) {
449
+ count += 1;
450
+ }
451
+ }
452
+ catch {
453
+ // skip unparseable line
454
+ }
455
+ }
456
+ }
457
+ catch {
458
+ // Missing/unreadable session log → no burst detection
459
+ return [];
460
+ }
461
+ if (count > PLAN_READ_TOOL_BUDGET) {
462
+ return [
463
+ `frontend plan read-burst: ${count} read-only tool calls (budget ${PLAN_READ_TOOL_BUDGET}). Trust the upstream contract/scout typed facts; do not re-read contract/scout outputs or source files already captured. Minimize discovery reads, commit record_* facts directly, then finalize_plan.`,
464
+ ];
465
+ }
466
+ return [];
467
+ }
468
+ export const FRONTEND_DESIGN_TERMINAL_TOOL_NAMES = new Set([
469
+ "approve_design",
470
+ "request_design_changes",
471
+ ]);
472
+ /**
473
+ * Fail-closed scanner for the two committed design terminal tools. Mirrors the
474
+ * review scanner: an unparseable line never counts as a terminal fact, so a
475
+ * corrupt/empty log cannot inflate the typed verdict.
476
+ */
477
+ export function scanDesignTerminalKindsFromSessionEvents(content) {
478
+ const kinds = [];
479
+ for (const line of content.split("\n")) {
480
+ const trimmed = line.trim();
481
+ if (!trimmed)
482
+ continue;
483
+ let event;
484
+ try {
485
+ event = JSON.parse(trimmed);
486
+ }
487
+ catch {
488
+ continue;
489
+ }
490
+ if (event !== null &&
491
+ typeof event === "object" &&
492
+ event.type === "tool_execution_start" &&
493
+ typeof event.toolName === "string" &&
494
+ FRONTEND_DESIGN_TERMINAL_TOOL_NAMES.has(event.toolName)) {
495
+ kinds.push(event.toolName);
496
+ }
497
+ }
498
+ return kinds;
499
+ }
500
+ /**
501
+ * M5: build the two committed typed review terminal tools (approve_review /
502
+ * request_review_changes). Each tool validates its parameters with the review
503
+ * fact zod schemas, stages + adopts a terminal fact into the typed event
504
+ * store, and returns a structured receipt. Terminal conflicts (a second
505
+ * terminal commit) are caught inside execute and returned as an error receipt
506
+ * rather than crashing the node.
507
+ */
508
+ export async function createFrontendReviewTerminalTools(input) {
509
+ const [{ Type }, { defineTool }] = await Promise.all([
510
+ import("typebox"),
511
+ import("@earendil-works/pi-coding-agent"),
512
+ ]);
513
+ const { approveReviewFactSchema, readCommittedEvents, requestReviewChangesFactSchema, writeTypedEventStoreJsonl, } = await import("../workflows/dag/frontend-typed-event-store.js");
514
+ const { adoptTypedEventFact, stageTypedEventFact } = await import("../workflows/dag/frontend-typed-event-transaction.js");
515
+ const store = input.store;
516
+ const attemptId = input.attemptId;
517
+ const findingSchema = Type.Object({
518
+ severity: Type.String({
519
+ description: "Critical | Important | Minor | Info",
520
+ }),
521
+ file: Type.Optional(Type.String({})),
522
+ line: Type.Optional(Type.Number({})),
523
+ issue: Type.String({}),
524
+ requiredChange: Type.Optional(Type.String({})),
525
+ }, { additionalProperties: false });
526
+ const approveParameters = Type.Object({
527
+ findings: Type.Array(findingSchema, {
528
+ description: "Optional informational findings (Minor/Info only; no Critical/Important on approval)",
529
+ }),
530
+ }, { additionalProperties: false });
531
+ const requestParameters = Type.Object({
532
+ issueCategory: Type.Enum({
533
+ "implementation-mismatch": "implementation-mismatch",
534
+ "approved-design-defect": "approved-design-defect",
535
+ "target-surface-defect": "target-surface-defect",
536
+ "contract-requirement-gap": "contract-requirement-gap",
537
+ "unknown": "unknown",
538
+ }, { description: "Typed issue category (five-value enum)" }),
539
+ evidenceRefs: Type.Array(Type.String({}), {
540
+ description: "Evidence refs (paths or artifact ids); at least one",
541
+ }),
542
+ findings: Type.Array(findingSchema, {
543
+ description: "At least one finding",
544
+ }),
545
+ }, { additionalProperties: false });
546
+ async function adoptReviewFact(kind, fact) {
547
+ const requestId = randomUUID();
548
+ try {
549
+ const parsed = kind === "approve_review"
550
+ ? approveReviewFactSchema.parse(fact)
551
+ : requestReviewChangesFactSchema.parse(fact);
552
+ const staged = stageTypedEventFact({
553
+ store,
554
+ requestId,
555
+ attemptId,
556
+ fact: parsed,
557
+ });
558
+ const adopted = await adoptTypedEventFact({
559
+ store,
560
+ requestId,
561
+ attemptId,
562
+ fact: parsed,
563
+ eventId: staged.eventId,
564
+ expectedRevision: store.revision,
565
+ });
566
+ return {
567
+ content: [
568
+ {
569
+ type: "text",
570
+ text: JSON.stringify({
571
+ ok: true,
572
+ kind,
573
+ eventId: adopted.eventId,
574
+ revision: adopted.revision,
575
+ }),
576
+ },
577
+ ],
578
+ details: {
579
+ ok: true,
580
+ kind,
581
+ eventId: adopted.eventId,
582
+ revision: adopted.revision,
583
+ },
584
+ };
585
+ }
586
+ catch (error) {
587
+ const code = error?.code;
588
+ const message = error instanceof Error ? error.message : String(error);
589
+ return {
590
+ content: [
591
+ {
592
+ type: "text",
593
+ text: JSON.stringify({ ok: false, kind, code, error: message }),
594
+ },
595
+ ],
596
+ details: { ok: false, kind, code, error: message },
597
+ };
598
+ }
599
+ }
600
+ const approveReviewTool = defineTool({
601
+ name: "approve_review",
602
+ label: "approve_review",
603
+ description: "Commit the authoritative approve_review terminal fact. Use only when the implementation passes review with no Critical/Important findings.",
604
+ promptSnippet: "Commit the authoritative approve_review terminal verdict (no Critical/Important findings).",
605
+ parameters: approveParameters,
606
+ async execute(_toolCallId, params) {
607
+ return adoptReviewFact("approve_review", {
608
+ kind: "approve_review",
609
+ verdict: "approve_review",
610
+ findings: params?.findings ?? [],
611
+ });
612
+ },
613
+ });
614
+ const requestReviewChangesTool = defineTool({
615
+ name: "request_review_changes",
616
+ label: "request_review_changes",
617
+ description: "Commit the authoritative request_review_changes terminal fact. Requires a typed issueCategory, at least one evidenceRef, and non-empty findings.",
618
+ promptSnippet: "Commit the authoritative request_review_changes terminal verdict (issueCategory + evidenceRefs + findings required).",
619
+ parameters: requestParameters,
620
+ async execute(_toolCallId, params) {
621
+ return adoptReviewFact("request_review_changes", {
622
+ kind: "request_review_changes",
623
+ verdict: "request_review_changes",
624
+ issueCategory: params?.issueCategory,
625
+ evidenceRefs: params?.evidenceRefs,
626
+ findings: params?.findings,
627
+ });
628
+ },
629
+ });
630
+ return {
631
+ customTools: [approveReviewTool, requestReviewChangesTool],
632
+ flush: async () => {
633
+ const committed = readCommittedEvents(store, attemptId);
634
+ await writeTypedEventStoreJsonl(path.join(input.runDir, input.nodeId, "review-typed-facts.jsonl"), committed);
635
+ },
636
+ };
637
+ }
638
+ /**
639
+ * M8: build the two committed typed design terminal tools (approve_design /
640
+ * request_design_changes). Each tool validates its parameters with the design
641
+ * fact zod schemas, stages + adopts a terminal fact into the typed event
642
+ * store, and returns a structured receipt. Terminal conflicts are caught
643
+ * inside execute and returned as an error receipt rather than crashing the
644
+ * node.
645
+ */
646
+ export async function createFrontendDesignTerminalTools(input) {
647
+ const [{ Type }, { defineTool }] = await Promise.all([
648
+ import("typebox"),
649
+ import("@earendil-works/pi-coding-agent"),
650
+ ]);
651
+ const { approveDesignFactSchema, readCommittedEvents, requestDesignChangesFactSchema, writeTypedEventStoreJsonl, } = await import("../workflows/dag/frontend-typed-event-store.js");
652
+ const { adoptTypedEventFact, stageTypedEventFact } = await import("../workflows/dag/frontend-typed-event-transaction.js");
653
+ const store = input.store;
654
+ const attemptId = input.attemptId;
655
+ const findingSchema = Type.Object({
656
+ severity: Type.String({
657
+ description: "Critical | Important | Minor | Info",
658
+ }),
659
+ file: Type.Optional(Type.String({})),
660
+ line: Type.Optional(Type.Number({})),
661
+ issue: Type.String({}),
662
+ requiredChange: Type.Optional(Type.String({})),
663
+ }, { additionalProperties: false });
664
+ const approveParameters = Type.Object({
665
+ findings: Type.Array(findingSchema, {
666
+ description: "Optional informational findings (Minor/Info only; no Critical/Important on approval)",
667
+ }),
668
+ }, { additionalProperties: false });
669
+ const requestParameters = Type.Object({
670
+ issueCategory: Type.Enum({
671
+ "implementation-mismatch": "implementation-mismatch",
672
+ "approved-design-defect": "approved-design-defect",
673
+ "target-surface-defect": "target-surface-defect",
674
+ "contract-requirement-gap": "contract-requirement-gap",
675
+ "unknown": "unknown",
676
+ }, { description: "Typed issue category (five-value enum)" }),
677
+ evidenceRefs: Type.Array(Type.String({}), {
678
+ description: "Evidence refs (paths or artifact ids); at least one",
679
+ }),
680
+ findings: Type.Array(findingSchema, {
681
+ description: "At least one finding",
682
+ }),
683
+ }, { additionalProperties: false });
684
+ async function adoptDesignFact(kind, fact) {
685
+ const requestId = randomUUID();
686
+ try {
687
+ const parsed = kind === "approve_design"
688
+ ? approveDesignFactSchema.parse(fact)
689
+ : requestDesignChangesFactSchema.parse(fact);
690
+ const staged = stageTypedEventFact({
691
+ store,
692
+ requestId,
693
+ attemptId,
694
+ fact: parsed,
695
+ });
696
+ const adopted = await adoptTypedEventFact({
697
+ store,
698
+ requestId,
699
+ attemptId,
700
+ fact: parsed,
701
+ eventId: staged.eventId,
702
+ expectedRevision: store.revision,
703
+ });
704
+ return {
705
+ content: [
706
+ {
707
+ type: "text",
708
+ text: JSON.stringify({
709
+ ok: true,
710
+ kind,
711
+ eventId: adopted.eventId,
712
+ revision: adopted.revision,
713
+ }),
714
+ },
715
+ ],
716
+ details: {
717
+ ok: true,
718
+ kind,
719
+ eventId: adopted.eventId,
720
+ revision: adopted.revision,
721
+ },
722
+ };
723
+ }
724
+ catch (error) {
725
+ const code = error?.code;
726
+ const message = error instanceof Error ? error.message : String(error);
727
+ return {
728
+ content: [
729
+ {
730
+ type: "text",
731
+ text: JSON.stringify({ ok: false, kind, code, error: message }),
732
+ },
733
+ ],
734
+ details: { ok: false, kind, code, error: message },
735
+ };
736
+ }
737
+ }
738
+ const approveDesignTool = defineTool({
739
+ name: "approve_design",
740
+ label: "approve_design",
741
+ description: "Commit the authoritative approve_design terminal fact. Use only when the plan passes design review with no Critical/Important findings.",
742
+ promptSnippet: "Commit the authoritative approve_design terminal verdict (no Critical/Important findings).",
743
+ parameters: approveParameters,
744
+ async execute(_toolCallId, params) {
745
+ return adoptDesignFact("approve_design", {
746
+ kind: "approve_design",
747
+ verdict: "approve_design",
748
+ findings: params?.findings ?? [],
749
+ });
750
+ },
751
+ });
752
+ const requestDesignChangesTool = defineTool({
753
+ name: "request_design_changes",
754
+ label: "request_design_changes",
755
+ description: "Commit the authoritative request_design_changes terminal fact. Requires a typed issueCategory, at least one evidenceRef, and non-empty findings.",
756
+ promptSnippet: "Commit the authoritative request_design_changes terminal verdict (issueCategory + evidenceRefs + findings required).",
757
+ parameters: requestParameters,
758
+ async execute(_toolCallId, params) {
759
+ return adoptDesignFact("request_design_changes", {
760
+ kind: "request_design_changes",
761
+ verdict: "request_design_changes",
762
+ issueCategory: params?.issueCategory,
763
+ evidenceRefs: params?.evidenceRefs,
764
+ findings: params?.findings,
765
+ });
766
+ },
767
+ });
768
+ return {
769
+ customTools: [approveDesignTool, requestDesignChangesTool],
770
+ flush: async () => {
771
+ const committed = readCommittedEvents(store, attemptId);
772
+ await writeTypedEventStoreJsonl(path.join(input.runDir, input.nodeId, "design-typed-facts.jsonl"), committed);
773
+ },
774
+ };
775
+ }
776
+ /**
777
+ * Source fidelity ledger (AC-005/AC-006): load the contract node's committed
778
+ * requirement facts and build a requirement-id → provenance map. The contract
779
+ * node declared sourceFragmentIds/sourceRefs from the ledger's
780
+ * requirement→fragment mapping; the plan inherits them by id so the compiled
781
+ * canonical contract carries authoritative provenance without the plan
782
+ * re-deriving (or fabricating) it. Best-effort: missing/unreadable contract
783
+ * ledger yields an empty map and the plan compiles as before (the design
784
+ * policy shell will then fail closed on missing provenance).
785
+ */
786
+ async function loadContractRequirementInheritance(runDir) {
787
+ const { readTypedEventStoreFromJsonl } = await import("../workflows/dag/frontend-typed-event-store.js");
788
+ let records;
789
+ try {
790
+ records = await readTypedEventStoreFromJsonl(path.join(runDir, "frontend-contract-pi", "contract-typed-facts.jsonl"));
791
+ }
792
+ catch {
793
+ return new Map();
794
+ }
795
+ const byId = new Map();
796
+ for (const record of records) {
797
+ const fact = record.fact;
798
+ if (!fact || typeof fact !== "object")
799
+ continue;
800
+ const recordFact = fact;
801
+ if (recordFact.origin !== "contract" ||
802
+ recordFact.kind !== "requirement") {
803
+ continue;
804
+ }
805
+ // Contract requirement facts carry id/sourceFragmentIds/sourceRefs on
806
+ // the fact itself (origin=contract, kind=requirement, id, text, ...),
807
+ // not inside an `entry` wrapper.
808
+ const id = typeof recordFact.id === "string" ? recordFact.id : "";
809
+ if (!id)
810
+ continue;
811
+ const sourceFragmentIds = Array.isArray(recordFact.sourceFragmentIds)
812
+ ? recordFact.sourceFragmentIds.filter((value) => typeof value === "string")
813
+ : undefined;
814
+ const sourceRefs = Array.isArray(recordFact.sourceRefs)
815
+ ? recordFact.sourceRefs.filter((value) => typeof value === "string")
816
+ : undefined;
817
+ if (sourceFragmentIds || sourceRefs) {
818
+ byId.set(id, {
819
+ ...(sourceFragmentIds ? { sourceFragmentIds } : {}),
820
+ ...(sourceRefs ? { sourceRefs } : {}),
821
+ });
822
+ }
823
+ }
824
+ return byId;
825
+ }
826
+ /**
827
+ * A+B: `frontend-plan-pi` now records its decision ledger through seven
828
+ * incremental `record_*` tools (origin=plan) and closes with exactly one
829
+ * `finalize_plan` terminal. A later attempt may explicitly adopt a quarantined
830
+ * fact via `adopt_staged_fact`. Flush writes `plan-typed-facts.jsonl` for the
831
+ * node validator / compile authority.
832
+ */
833
+ export async function createFrontendPlanLedgerTools(input) {
834
+ const [{ Type }, { defineTool }] = await Promise.all([
835
+ import("typebox"),
836
+ import("@earendil-works/pi-coding-agent"),
837
+ ]);
838
+ const { readCommittedEvents, writeTypedEventStoreJsonl } = await import("../workflows/dag/frontend-typed-event-store.js");
839
+ const { adoptStagedFact, adoptTypedEventFact, stageTypedEventFact } = await import("../workflows/dag/frontend-typed-event-transaction.js");
840
+ const { assemblePlanPatchFromCommittedFacts } = await import("../workflows/dag/frontend-shadow-dual-write.js");
841
+ const store = input.store;
842
+ const attemptId = input.attemptId;
843
+ const stringArray = Type.Array(Type.String({}));
844
+ const optionalString = Type.Optional(Type.String({}));
845
+ const optionalStringArray = Type.Optional(stringArray);
846
+ const requirementSchema = Type.Object({
847
+ id: Type.String({}),
848
+ expectedOutcome: Type.Optional(Type.String({
849
+ description: "Optional. When omitted, the runtime derives it from the contract requirement. Prefer omitting it to keep this tool call small.",
850
+ })),
851
+ implementationTargets: stringArray,
852
+ verificationTargetIds: stringArray,
853
+ evidenceGap: Type.Optional(Type.Object({
854
+ requirementId: optionalString,
855
+ description: Type.String({}),
856
+ blocking: Type.Boolean(),
857
+ }, { additionalProperties: false })),
858
+ }, { additionalProperties: false });
859
+ const uiStateSchema = Type.Object({
860
+ name: Type.String({}),
861
+ applicable: Type.Boolean(),
862
+ expectedBehavior: optionalString,
863
+ implementationTargets: optionalStringArray,
864
+ verificationTargetIds: optionalStringArray,
865
+ notApplicableReason: optionalString,
866
+ reason: Type.Optional(Type.String({})),
867
+ }, { additionalProperties: false });
868
+ const interactionSchema = Type.Object({
869
+ name: optionalString,
870
+ id: Type.Optional(Type.String({})),
871
+ trigger: Type.String({}),
872
+ expectedBehavior: Type.String({}),
873
+ implementationTargets: stringArray,
874
+ verificationTargetIds: stringArray,
875
+ }, { additionalProperties: false });
876
+ const mockEndpointSchema = Type.Object({
877
+ method: Type.String({
878
+ description: "GET | POST | PUT | PATCH | DELETE | HEAD | OPTIONS",
879
+ }),
880
+ path: Type.String({}),
881
+ fixture: optionalString,
882
+ consumer: optionalString,
883
+ }, { additionalProperties: false });
884
+ const mockApiSchema = Type.Object({
885
+ strategy: Type.String({
886
+ description: "native | browser-intercept | request-adapter | not-needed",
887
+ }),
888
+ activation: Type.String({}),
889
+ endpoints: Type.Array(mockEndpointSchema),
890
+ }, { additionalProperties: false });
891
+ const designEvidenceSchema = Type.Object({
892
+ source: Type.String({}),
893
+ paths: stringArray,
894
+ conflicts: stringArray,
895
+ }, { additionalProperties: false });
896
+ const verificationTargetSchema = Type.Object({
897
+ id: Type.String({}),
898
+ type: Type.String({
899
+ description: "static | unit | component | integration | mock",
900
+ }),
901
+ commandLabel: Type.String({}),
902
+ file: Type.String({}),
903
+ symbol: Type.Optional(Type.String({
904
+ description: "Optional. Real exported identifier or describe/it title in the target file. Omit it to keep the call small — the trace gate then only verifies the file exists and the command ran. Forbidden for type=static (runtime strips it).",
905
+ })),
906
+ requirementIds: stringArray,
907
+ uiStates: Type.Optional(Type.Array(Type.String({}), {
908
+ description: "Optional only at this tool boundary. An omitted value is deterministically recorded as []. Pass an explicit array for new calls.",
909
+ })),
910
+ }, { additionalProperties: false });
911
+ const evidenceGapSchema = Type.Object({
912
+ requirementId: optionalString,
913
+ description: Type.String({}),
914
+ blocking: Type.Boolean(),
915
+ }, { additionalProperties: false });
916
+ const uiComponentChoiceSchema = Type.Object({
917
+ purpose: Type.String({}),
918
+ component: Type.String({}),
919
+ decision: Type.String({
920
+ description: "specified | reuse-existing | new",
921
+ }),
922
+ specReference: Type.Optional(Type.Object({
923
+ path: Type.String({}),
924
+ section: Type.String({}),
925
+ line: Type.Optional(Type.Number({})),
926
+ }, { additionalProperties: false })),
927
+ rationale: Type.String({}),
928
+ }, { additionalProperties: false });
929
+ const stringList = (value) => Array.isArray(value)
930
+ ? value.filter((item) => typeof item === "string")
931
+ : [];
932
+ const nonEmptyString = (value) => typeof value === "string" && value.trim().length > 0
933
+ ? value.trim()
934
+ : undefined;
935
+ const planToolReceipt = (details) => ({
936
+ content: [
937
+ {
938
+ type: "text",
939
+ text: JSON.stringify(details),
940
+ },
941
+ ],
942
+ details,
943
+ });
944
+ async function adoptPlanFact(kind, requestId, fact) {
945
+ // A+B (AC-005): a provider-capability fact kind reaching the plan ledger
946
+ // is out of route — it belongs to the shadow provider capability channel,
947
+ // not the plan decision ledger. Route it through the frozen seven-kind
948
+ // matrix and fail closed to `unsupported-provider-capability` instead of
949
+ // silently widening the plan catalog.
950
+ const capabilityRoute = routeFrontendProviderCapability({ factKind: kind });
951
+ if (capabilityRoute.ok) {
952
+ return {
953
+ ok: false,
954
+ kind,
955
+ code: "unsupported-provider-capability",
956
+ error: `plan ledger cannot adopt provider capability fact kind: ${kind}`,
957
+ };
958
+ }
959
+ try {
960
+ const staged = stageTypedEventFact({
961
+ store,
962
+ requestId,
963
+ attemptId,
964
+ fact: fact,
965
+ });
966
+ const committed = await adoptTypedEventFact({
967
+ store,
968
+ requestId,
969
+ attemptId,
970
+ fact: fact,
971
+ eventId: staged.eventId,
972
+ expectedRevision: store.revision,
973
+ });
974
+ return {
975
+ ok: true,
976
+ kind,
977
+ eventId: committed.eventId,
978
+ revision: committed.revision,
979
+ error: "",
980
+ };
981
+ }
982
+ catch (error) {
983
+ return {
984
+ ok: false,
985
+ kind,
986
+ code: error?.code,
987
+ error: error instanceof Error ? error.message : String(error),
988
+ };
989
+ }
990
+ }
991
+ const recordRouteSelectionTool = defineTool({
992
+ name: "record_route_selection",
993
+ label: "record_route_selection",
994
+ description: "Record the route selection needed by this plan. Repository target surface and file ownership belong to Scout/runtime.",
995
+ promptSnippet: "Record the selected routes.",
996
+ parameters: Type.Object({ routes: stringArray }, { additionalProperties: false }),
997
+ async execute(_toolCallId, params) {
998
+ const routes = stringList(params?.routes);
999
+ const result = await adoptPlanFact("target-surface", `${attemptId}:record_route_selection:${randomUUID()}`, { kind: "target-surface", origin: "plan", routes });
1000
+ return planToolReceipt(result);
1001
+ },
1002
+ });
1003
+ const recordComponentChoiceTool = defineTool({
1004
+ name: "record_component_choice",
1005
+ label: "record_component_choice",
1006
+ description: "Record ONE component choice (origin=plan component-choice fact). Declare every UI purpose's component selection. A component the task source/PRD mandates adding (not present in the repo) MUST be decision=new with a specReference pointing at the PRD section that defines it; decision=reuse-existing is only for components that already exist in the repo (e.g. reusing ActiveRunBadge's styling convention). Omit rationale for reuse-existing; it is optional. Call once per component — one tool call per message. Optionally include stylingStrategy (set it once, on the first call).",
1007
+ promptSnippet: "Record one component choice (one tool call per message).",
1008
+ parameters: Type.Object({
1009
+ choice: uiComponentChoiceSchema,
1010
+ stylingStrategy: optionalString,
1011
+ }, { additionalProperties: false }),
1012
+ async execute(_toolCallId, params) {
1013
+ const rawChoice = params?.choice;
1014
+ if (!isRecordObject(rawChoice)) {
1015
+ return planToolReceipt({
1016
+ ok: false,
1017
+ kind: "component-choice",
1018
+ error: "record_component_choice requires a non-empty choice object",
1019
+ });
1020
+ }
1021
+ const choice = rawChoice;
1022
+ const components = typeof choice.component === "string" ? [choice.component] : [];
1023
+ const result = await adoptPlanFact("component-choice", `${attemptId}:record_component_choice:${randomUUID()}`, {
1024
+ kind: "component-choice",
1025
+ origin: "plan",
1026
+ components,
1027
+ uiComponentChoices: [choice],
1028
+ ...(params?.stylingStrategy
1029
+ ? { stylingStrategy: params.stylingStrategy }
1030
+ : {}),
1031
+ });
1032
+ return planToolReceipt(result);
1033
+ },
1034
+ });
1035
+ const recordStateFlowTool = defineTool({
1036
+ name: "record_state_flow",
1037
+ label: "record_state_flow",
1038
+ description: "Record UI states and interactions as an origin=plan state-flow fact.",
1039
+ promptSnippet: "Record the plan state-flow fact.",
1040
+ parameters: Type.Object({
1041
+ uiStates: Type.Array(uiStateSchema),
1042
+ interactions: Type.Array(interactionSchema),
1043
+ }, { additionalProperties: false }),
1044
+ async execute(_toolCallId, params) {
1045
+ const rawUiStates = Array.isArray(params?.uiStates)
1046
+ ? params.uiStates
1047
+ : [];
1048
+ const rawInteractions = Array.isArray(params?.interactions)
1049
+ ? params.interactions
1050
+ : [];
1051
+ const uiStates = [];
1052
+ for (const rawState of rawUiStates) {
1053
+ if (!isRecordObject(rawState)) {
1054
+ return planToolReceipt({
1055
+ ok: false,
1056
+ kind: "state-flow",
1057
+ error: "record_state_flow uiStates entries must be objects",
1058
+ });
1059
+ }
1060
+ const { reason, notApplicableReason, ...state } = rawState;
1061
+ const canonicalReason = nonEmptyString(notApplicableReason);
1062
+ const aliasReason = nonEmptyString(reason);
1063
+ if (canonicalReason !== undefined &&
1064
+ aliasReason !== undefined &&
1065
+ canonicalReason !== aliasReason) {
1066
+ return planToolReceipt({
1067
+ ok: false,
1068
+ kind: "state-flow",
1069
+ error: "record_state_flow uiState has conflicting reason and notApplicableReason values",
1070
+ });
1071
+ }
1072
+ const resolvedReason = canonicalReason ?? aliasReason;
1073
+ if (state.applicable === false && !resolvedReason) {
1074
+ return planToolReceipt({
1075
+ ok: false,
1076
+ kind: "state-flow",
1077
+ error: "record_state_flow requires non-empty notApplicableReason when uiState.applicable is false",
1078
+ });
1079
+ }
1080
+ uiStates.push({
1081
+ ...state,
1082
+ ...(resolvedReason
1083
+ ? { notApplicableReason: resolvedReason }
1084
+ : {}),
1085
+ });
1086
+ }
1087
+ const interactions = [];
1088
+ for (const rawInteraction of rawInteractions) {
1089
+ if (!isRecordObject(rawInteraction)) {
1090
+ return planToolReceipt({
1091
+ ok: false,
1092
+ kind: "state-flow",
1093
+ error: "record_state_flow interactions entries must be objects",
1094
+ });
1095
+ }
1096
+ const { id, name, ...interaction } = rawInteraction;
1097
+ const canonicalName = nonEmptyString(name);
1098
+ const aliasName = nonEmptyString(id);
1099
+ if (canonicalName !== undefined &&
1100
+ aliasName !== undefined &&
1101
+ canonicalName !== aliasName) {
1102
+ return planToolReceipt({
1103
+ ok: false,
1104
+ kind: "state-flow",
1105
+ error: "record_state_flow interaction has conflicting id and name values",
1106
+ });
1107
+ }
1108
+ const resolvedName = canonicalName ?? aliasName;
1109
+ if (!resolvedName) {
1110
+ return planToolReceipt({
1111
+ ok: false,
1112
+ kind: "state-flow",
1113
+ error: "record_state_flow requires non-empty interaction.name (id is accepted only as a legacy alias)",
1114
+ });
1115
+ }
1116
+ interactions.push({ ...interaction, name: resolvedName });
1117
+ }
1118
+ const states = uiStates
1119
+ .map((state) => (typeof state?.name === "string" ? state.name : ""))
1120
+ .filter(Boolean);
1121
+ const result = await adoptPlanFact("state-flow", `${attemptId}:record_state_flow:${randomUUID()}`, {
1122
+ kind: "state-flow",
1123
+ origin: "plan",
1124
+ states,
1125
+ uiStates,
1126
+ interactions,
1127
+ });
1128
+ return planToolReceipt(result);
1129
+ },
1130
+ });
1131
+ const recordDataFlowTool = defineTool({
1132
+ name: "record_data_flow",
1133
+ label: "record_data_flow",
1134
+ description: "Record interaction/endpoint data flow as an origin=plan data-flow fact.",
1135
+ promptSnippet: "Record the plan data-flow fact.",
1136
+ parameters: Type.Object({ interactions: stringArray, endpoints: stringArray }, { additionalProperties: false }),
1137
+ async execute(_toolCallId, params) {
1138
+ const result = await adoptPlanFact("data-flow", `${attemptId}:record_data_flow:${randomUUID()}`, {
1139
+ kind: "data-flow",
1140
+ origin: "plan",
1141
+ interactions: stringList(params?.interactions),
1142
+ endpoints: stringList(params?.endpoints),
1143
+ });
1144
+ return planToolReceipt(result);
1145
+ },
1146
+ });
1147
+ const recordMockApiTool = defineTool({
1148
+ name: "record_mock_api",
1149
+ label: "record_mock_api",
1150
+ description: "Record the Mock/API strategy as an origin=plan mock-api fact.",
1151
+ promptSnippet: "Record the plan mock-api fact.",
1152
+ parameters: Type.Object({ mockApi: mockApiSchema }, { additionalProperties: false }),
1153
+ async execute(_toolCallId, params) {
1154
+ const mockApi = params?.mockApi ?? {
1155
+ strategy: "not-needed",
1156
+ activation: "",
1157
+ endpoints: [],
1158
+ };
1159
+ const endpoints = stringList((Array.isArray(mockApi?.endpoints) ? mockApi.endpoints : []).map((endpoint) => `${typeof endpoint?.method === "string" ? endpoint.method : ""} ${typeof endpoint?.path === "string" ? endpoint.path : ""}`.trim()));
1160
+ const result = await adoptPlanFact("mock-api", `${attemptId}:record_mock_api:${randomUUID()}`, {
1161
+ kind: "mock-api",
1162
+ origin: "plan",
1163
+ strategy: typeof mockApi?.strategy === "string" ? mockApi.strategy : "",
1164
+ endpoints,
1165
+ mockApi,
1166
+ });
1167
+ return planToolReceipt(result);
1168
+ },
1169
+ });
1170
+ const recordDesignDeviationTool = defineTool({
1171
+ name: "record_design_deviation",
1172
+ label: "record_design_deviation",
1173
+ description: "Record design evidence conflicts as an origin=plan design-deviation fact.",
1174
+ promptSnippet: "Record the plan design-deviation fact.",
1175
+ parameters: Type.Object({ designEvidence: designEvidenceSchema }, { additionalProperties: false }),
1176
+ async execute(_toolCallId, params) {
1177
+ const conflicts = stringList(params?.designEvidence?.conflicts);
1178
+ const result = await adoptPlanFact("design-deviation", `${attemptId}:record_design_deviation:${randomUUID()}`, { kind: "design-deviation", origin: "plan", conflicts });
1179
+ return planToolReceipt(result);
1180
+ },
1181
+ });
1182
+ const recordDependencyTool = defineTool({
1183
+ name: "record_dependency",
1184
+ label: "record_dependency",
1185
+ description: "Record the dependency policy as an origin=plan dependency fact.",
1186
+ promptSnippet: "Record the plan dependency fact.",
1187
+ parameters: Type.Object({ policy: Type.String({}) }, { additionalProperties: false }),
1188
+ async execute(_toolCallId, params) {
1189
+ const result = await adoptPlanFact("dependency", `${attemptId}:record_dependency:${randomUUID()}`, {
1190
+ kind: "dependency",
1191
+ origin: "plan",
1192
+ policy: typeof params?.policy === "string" ? params.policy : "",
1193
+ });
1194
+ return planToolReceipt(result);
1195
+ },
1196
+ });
1197
+ // Incremental plan payload records (one entry per call) so requirements,
1198
+ // verification targets, evidence gaps, and implementation steps never have
1199
+ // to be emitted as one large array inside a single finalize_plan call —
1200
+ // they aggregate from the ledger in commit order. Mirrors the contract
1201
+ // node's record_requirement pattern to stay within any model output budget.
1202
+ const recordPlanRequirementTool = defineTool({
1203
+ name: "record_plan_requirement",
1204
+ label: "record_plan_requirement",
1205
+ description: "Commit one plan requirement entry (origin=plan plan-requirement fact). Call once per requirement; entry carries id, implementationTargets, verificationTargetIds, and optional expectedOutcome (omit it — the runtime derives the outcome text from the contract requirement). Each requirement id must be recorded EXACTLY once — re-recording the same id is rejected as a duplicate and would compile a duplicated requirements[] entry. IMPORTANT: call this tool exactly ONE time per assistant message — never batch multiple record_* calls together in one message; emit one call, wait for its result, then call the next.",
1206
+ promptSnippet: "Commit one plan requirement entry (one tool call per message).",
1207
+ parameters: Type.Object({
1208
+ entry: requirementSchema,
1209
+ }, { additionalProperties: false }),
1210
+ async execute(_toolCallId, params) {
1211
+ const rawEntry = params?.entry;
1212
+ if (!isRecordObject(rawEntry)) {
1213
+ return planToolReceipt({
1214
+ ok: false,
1215
+ kind: "plan-requirement",
1216
+ error: "record_plan_requirement requires a non-empty entry object",
1217
+ });
1218
+ }
1219
+ const entry = rawEntry;
1220
+ // A requirement id is a canonical identity: recording it twice would
1221
+ // compile a duplicate requirements[] entry and fail design review.
1222
+ // Reject duplicates at the tool boundary so the model can fix them
1223
+ // in-node instead of burning the attempt on a later validation error.
1224
+ const id = typeof entry.id === "string" ? entry.id : "";
1225
+ if (id) {
1226
+ const existing = readCommittedEvents(store, attemptId).find((event) => {
1227
+ const fact = event.fact;
1228
+ if (!fact || fact.kind !== "plan-requirement")
1229
+ return false;
1230
+ const entryFact = fact.entry;
1231
+ return (typeof entryFact?.id === "string" &&
1232
+ entryFact.id === id);
1233
+ });
1234
+ if (existing) {
1235
+ return planToolReceipt({
1236
+ ok: false,
1237
+ kind: "plan-requirement",
1238
+ error: `record_plan_requirement duplicate: requirement ${id} is already recorded; do not record the same requirement id twice`,
1239
+ });
1240
+ }
1241
+ }
1242
+ const result = await adoptPlanFact("plan-requirement", `${attemptId}:record_plan_requirement:${randomUUID()}`, { kind: "plan-requirement", origin: "plan", entry });
1243
+ return planToolReceipt(result);
1244
+ },
1245
+ });
1246
+ const recordPlanVerificationTargetTool = defineTool({
1247
+ name: "record_plan_verification_target",
1248
+ label: "record_plan_verification_target",
1249
+ description: "Commit one plan verification target entry (origin=plan plan-verification-target fact). Call once per target; entry carries id, type, commandLabel, file, requirementIds, uiStates, and optional symbol (omit it — the trace gate verifies the file and command, not a symbol). IMPORTANT: call this tool exactly ONE time per assistant message — never batch multiple record_* calls together in one message; emit one call, wait for its result, then call the next.",
1250
+ promptSnippet: "Commit one plan verification target entry (one tool call per message).",
1251
+ parameters: Type.Object({
1252
+ entry: verificationTargetSchema,
1253
+ }, { additionalProperties: false }),
1254
+ async execute(_toolCallId, params) {
1255
+ const rawEntry = params?.entry;
1256
+ if (!isRecordObject(rawEntry)) {
1257
+ return planToolReceipt({
1258
+ ok: false,
1259
+ kind: "plan-verification-target",
1260
+ error: "record_plan_verification_target requires a non-empty entry object",
1261
+ });
1262
+ }
1263
+ // uiStates: [] means this verification target is intentionally not
1264
+ // bound to a named UI state. Keep that canonical representation even
1265
+ // when a model omits the optional tool-boundary field.
1266
+ const entry = {
1267
+ ...rawEntry,
1268
+ uiStates: stringList(rawEntry.uiStates),
1269
+ };
1270
+ const result = await adoptPlanFact("plan-verification-target", `${attemptId}:record_plan_verification_target:${randomUUID()}`, { kind: "plan-verification-target", origin: "plan", entry });
1271
+ return planToolReceipt(result);
1272
+ },
1273
+ });
1274
+ const recordPlanEvidenceGapTool = defineTool({
1275
+ name: "record_plan_evidence_gap",
1276
+ label: "record_plan_evidence_gap",
1277
+ description: "Commit one plan evidence gap entry (origin=plan plan-evidence-gap fact). Call once per gap; entry carries requirementId, description, blocking. IMPORTANT: call this tool exactly ONE time per assistant message — never batch multiple record_* calls together in one message; emit one call, wait for its result, then call the next.",
1278
+ promptSnippet: "Commit one plan evidence gap entry (one tool call per message).",
1279
+ parameters: Type.Object({
1280
+ entry: evidenceGapSchema,
1281
+ }, { additionalProperties: false }),
1282
+ async execute(_toolCallId, params) {
1283
+ const rawEntry = params?.entry;
1284
+ if (!isRecordObject(rawEntry)) {
1285
+ return planToolReceipt({
1286
+ ok: false,
1287
+ kind: "plan-evidence-gap",
1288
+ error: "record_plan_evidence_gap requires a non-empty entry object",
1289
+ });
1290
+ }
1291
+ const entry = rawEntry;
1292
+ const result = await adoptPlanFact("plan-evidence-gap", `${attemptId}:record_plan_evidence_gap:${randomUUID()}`, { kind: "plan-evidence-gap", origin: "plan", entry });
1293
+ return planToolReceipt(result);
1294
+ },
1295
+ });
1296
+ const finalizePlanTool = defineTool({
1297
+ name: "finalize_plan",
1298
+ label: "finalize_plan",
1299
+ description: "Commit the finalize_plan terminal. Requirements, verification targets, and evidence gaps (optional) were already committed incrementally through record_plan_requirement / record_plan_verification_target / record_plan_evidence_gap; finalize_plan assembles them from the ledger together with these optional remaining fields, publishes the canonical editable patch on a target-surface fact, and commits the terminal. Call exactly once.",
1300
+ promptSnippet: "Commit the finalize_plan terminal (ledger fields + optional residualRisks / realIntegrationGap).",
1301
+ parameters: Type.Object({
1302
+ residualRisks: optionalStringArray,
1303
+ realIntegrationGap: optionalString,
1304
+ }, { additionalProperties: false }),
1305
+ async execute(_toolCallId, params) {
1306
+ try {
1307
+ const committed = readCommittedEvents(store, attemptId);
1308
+ // Source fidelity ledger (AC-005/AC-006): inherit the contract
1309
+ // node's declared requirement→fragment provenance so the compiled
1310
+ // canonical contract carries sourceFragmentIds/sourceRefs even
1311
+ // when the plan did not re-declare them. The contract node is the
1312
+ // sole synthesis point; the plan inherits by requirement id.
1313
+ const contractInheritance = await loadContractRequirementInheritance(input.runDir);
1314
+ const fragment = assemblePlanPatchFromCommittedFacts(committed, contractInheritance) ?? {};
1315
+ const patch = {
1316
+ ...fragment,
1317
+ ...(params?.residualRisks
1318
+ ? { residualRisks: params.residualRisks }
1319
+ : {}),
1320
+ ...(params?.realIntegrationGap
1321
+ ? { realIntegrationGap: params.realIntegrationGap }
1322
+ : {}),
1323
+ };
1324
+ const patchResult = await adoptPlanFact("target-surface", `${attemptId}:finalize_plan:patch:${randomUUID()}`, { kind: "target-surface", origin: "plan", patch });
1325
+ if (!patchResult.ok) {
1326
+ return planToolReceipt({
1327
+ ok: false,
1328
+ kind: "finalize_plan",
1329
+ error: patchResult.error,
1330
+ code: patchResult.code,
1331
+ });
1332
+ }
1333
+ const terminal = await adoptPlanFact("finalize_plan", `${attemptId}:finalize_plan:terminal:${randomUUID()}`, { kind: "finalize_plan", origin: "plan", patch });
1334
+ return planToolReceipt(terminal);
1335
+ }
1336
+ catch (error) {
1337
+ return planToolReceipt({
1338
+ ok: false,
1339
+ kind: "finalize_plan",
1340
+ error: error instanceof Error ? error.message : String(error),
1341
+ });
1342
+ }
1343
+ },
1344
+ });
1345
+ const adoptStagedFactTool = defineTool({
1346
+ name: "adopt_staged_fact",
1347
+ label: "adopt_staged_fact",
1348
+ description: "Explicitly adopt a quarantined fact from a prior attempt into the committed ledger (idempotent by requestId).",
1349
+ promptSnippet: "Adopt a quarantined fact into the committed ledger.",
1350
+ parameters: Type.Object({
1351
+ requestId: Type.String({}),
1352
+ eventId: Type.String({}),
1353
+ expectedRevision: Type.Number({}),
1354
+ }, { additionalProperties: false }),
1355
+ async execute(_toolCallId, params) {
1356
+ try {
1357
+ const adopted = await adoptStagedFact({
1358
+ store,
1359
+ requestId: typeof params?.requestId === "string" ? params.requestId : "",
1360
+ attemptId,
1361
+ eventId: typeof params?.eventId === "string" ? params.eventId : "",
1362
+ expectedRevision: typeof params?.expectedRevision === "number"
1363
+ ? params.expectedRevision
1364
+ : store.revision,
1365
+ });
1366
+ return planToolReceipt({
1367
+ ok: true,
1368
+ kind: "adopt_staged_fact",
1369
+ eventId: adopted.eventId,
1370
+ revision: adopted.revision,
1371
+ error: "",
1372
+ });
1373
+ }
1374
+ catch (error) {
1375
+ return planToolReceipt({
1376
+ ok: false,
1377
+ kind: "adopt_staged_fact",
1378
+ error: error instanceof Error ? error.message : String(error),
1379
+ code: error?.code,
1380
+ });
1381
+ }
1382
+ },
1383
+ });
1384
+ return {
1385
+ customTools: [
1386
+ recordRouteSelectionTool,
1387
+ recordComponentChoiceTool,
1388
+ recordStateFlowTool,
1389
+ recordDataFlowTool,
1390
+ recordMockApiTool,
1391
+ recordDesignDeviationTool,
1392
+ recordDependencyTool,
1393
+ recordPlanRequirementTool,
1394
+ recordPlanVerificationTargetTool,
1395
+ recordPlanEvidenceGapTool,
1396
+ adoptStagedFactTool,
1397
+ finalizePlanTool,
1398
+ ],
1399
+ flush: async () => {
1400
+ const committed = readCommittedEvents(store, attemptId);
1401
+ await writeTypedEventStoreJsonl(path.join(input.runDir, input.nodeId, "plan-typed-facts.jsonl"), committed);
1402
+ },
1403
+ };
1404
+ }
1405
+ function isRecordObject(value) {
1406
+ return typeof value === "object" && value !== null && !Array.isArray(value);
1407
+ }
1408
+ /** A contract fact is source-mapped when it carries a non-empty `sourceSpan`
1409
+ * (object or string), a non-empty `sourceRefs` array, or a non-empty `source`
1410
+ * string. Anything else is an unmapped source segment (AC-001). */
1411
+ function contractFactSourceSpan(fact) {
1412
+ if (isRecordObject(fact.sourceSpan) || typeof fact.sourceSpan === "string") {
1413
+ return fact.sourceSpan;
1414
+ }
1415
+ if (Array.isArray(fact.sourceRefs) && fact.sourceRefs.length > 0) {
1416
+ return fact.sourceRefs;
1417
+ }
1418
+ if (typeof fact.source === "string" && fact.source.trim().length > 0) {
1419
+ return fact.source;
1420
+ }
1421
+ return undefined;
1422
+ }
1423
+ /**
1424
+ * A+B (AC-001): deterministically assemble the read-only `frontend-task-contract-vNext`
1425
+ * audit artifact from committed contract facts. It never rewrites the original
1426
+ * task source: unmapped requirement/constraint segments are listed explicitly
1427
+ * so Plan/Implement/Review keep binding to the raw source, not the model's
1428
+ * summarized contract. The blocked disposition is projected through the frozen
1429
+ * `mapContractBlockedOwner` mapping (AC-002).
1430
+ */
1431
+ export function buildFrontendTaskContractVNext(records) {
1432
+ const facts = records
1433
+ .filter((record) => record.phase === "committed")
1434
+ .map((record) => record.fact)
1435
+ .filter(isRecordObject);
1436
+ const finalized = facts.find((fact) => fact.kind === "contract-finalized");
1437
+ const disposition = typeof finalized?.disposition === "string" ? finalized.disposition : null;
1438
+ const blockingOwner = typeof finalized?.blockingOwner === "string"
1439
+ ? finalized.blockingOwner
1440
+ : null;
1441
+ const projected = mapContractBlockedOwner({
1442
+ disposition: disposition ?? "",
1443
+ blockingOwner: blockingOwner ?? undefined,
1444
+ });
1445
+ const byKind = (kind) => facts.filter((fact) => fact.kind === kind);
1446
+ const requirements = byKind("requirement");
1447
+ const unmappedSourceSegments = requirements
1448
+ .filter((fact) => contractFactSourceSpan(fact) === undefined)
1449
+ .map((fact) => ({
1450
+ kind: "requirement",
1451
+ id: typeof fact.id === "string"
1452
+ ? fact.id
1453
+ : typeof fact.text === "string"
1454
+ ? fact.text
1455
+ : undefined,
1456
+ }))
1457
+ .filter((segment) => segment.id !== undefined);
1458
+ return {
1459
+ schemaVersion: 1,
1460
+ schemaId: "frontend-task-contract-vNext",
1461
+ disposition,
1462
+ blockingOwner,
1463
+ blockedOwner: projected === "not-blocked" ? null : projected,
1464
+ requirements,
1465
+ constraints: byKind("constraint"),
1466
+ evidenceExpectations: byKind("evidence-expectation"),
1467
+ handoffIntents: byKind("handoff-intent"),
1468
+ openQuestions: byKind("open-question"),
1469
+ splitProposals: byKind("split-proposal"),
1470
+ unmappedSourceSegments,
1471
+ };
1472
+ }
1473
+ /**
1474
+ * A+B: `frontend-contract-pi` incremental contract tools. Six `record_*` tools
1475
+ * commit origin=contract facts and `finalize_contract` commits the terminal
1476
+ * disposition (ready | ready-with-assumptions | blocked + blockingOwner).
1477
+ */
1478
+ export async function createFrontendContractTools(input) {
1479
+ const [{ Type }, { defineTool }] = await Promise.all([
1480
+ import("typebox"),
1481
+ import("@earendil-works/pi-coding-agent"),
1482
+ ]);
1483
+ const { readCommittedEvents, writeTypedEventStoreJsonl } = await import("../workflows/dag/frontend-typed-event-store.js");
1484
+ const { adoptTypedEventFact, stageTypedEventFact } = await import("../workflows/dag/frontend-typed-event-transaction.js");
1485
+ const store = input.store;
1486
+ const attemptId = input.attemptId;
1487
+ const receipt = (details) => ({
1488
+ content: [{ type: "text", text: JSON.stringify(details) }],
1489
+ details,
1490
+ });
1491
+ async function adoptContractFact(kind, fact) {
1492
+ try {
1493
+ const requestId = `${attemptId}:${kind}:${randomUUID()}`;
1494
+ const staged = stageTypedEventFact({
1495
+ store,
1496
+ requestId,
1497
+ attemptId,
1498
+ fact: fact,
1499
+ });
1500
+ const committed = await adoptTypedEventFact({
1501
+ store,
1502
+ requestId,
1503
+ attemptId,
1504
+ fact: fact,
1505
+ eventId: staged.eventId,
1506
+ expectedRevision: store.revision,
1507
+ });
1508
+ return {
1509
+ ok: true,
1510
+ kind,
1511
+ eventId: committed.eventId,
1512
+ revision: committed.revision,
1513
+ error: "",
1514
+ };
1515
+ }
1516
+ catch (error) {
1517
+ return {
1518
+ ok: false,
1519
+ kind,
1520
+ code: error?.code,
1521
+ error: error instanceof Error ? error.message : String(error),
1522
+ };
1523
+ }
1524
+ }
1525
+ const recordKinds = {
1526
+ record_requirement: "requirement",
1527
+ record_constraint: "constraint",
1528
+ record_evidence_expectation: "evidence-expectation",
1529
+ record_handoff_intent: "handoff-intent",
1530
+ record_open_question: "open-question",
1531
+ record_split_proposal: "split-proposal",
1532
+ };
1533
+ const recordTools = Object.entries(recordKinds).map(([name, kind]) => defineTool({
1534
+ name,
1535
+ label: name,
1536
+ description: `Commit an origin=contract ${kind} fact.`,
1537
+ promptSnippet: `Commit an origin=contract ${kind} fact.`,
1538
+ parameters: Type.Object({}, { additionalProperties: true }),
1539
+ async execute(_toolCallId, params) {
1540
+ const result = await adoptContractFact(kind, {
1541
+ kind,
1542
+ origin: "contract",
1543
+ ...(params ?? {}),
1544
+ });
1545
+ return receipt(result);
1546
+ },
1547
+ }));
1548
+ // OpenSpec selection committed as individual typed facts (one path per
1549
+ // call) so a large candidate set never exceeds a single model output
1550
+ // budget: each tool call carries exactly one {path, disposition,
1551
+ // rationale} row and the ledger accumulates them across calls. Only
1552
+ // positive classifications (required | relevant) are legal; unmentioned
1553
+ // candidates default to irrelevant at the prewrite gate.
1554
+ const recordOpenspecSelectionTool = defineTool({
1555
+ name: "record_openspec_selection",
1556
+ label: "record_openspec_selection",
1557
+ description: "Commit one OpenSpec candidate classification (origin=contract openspec-selection fact). Call once per path you actually use or consult: required (must be read and cited) or relevant (informs planning). Never call it for irrelevant candidates — unmentioned candidates default to irrelevant. You may call it many times; one row per call.",
1558
+ promptSnippet: "Commit one OpenSpec candidate classification (required | relevant); one path per call; skip irrelevant candidates.",
1559
+ parameters: Type.Object({
1560
+ path: Type.String({
1561
+ description: "Repo-relative candidate spec path, e.g. openspec/project-specs/ui/ucp-components-md/AdvancedSearch.md",
1562
+ }),
1563
+ disposition: Type.Enum({
1564
+ required: "required",
1565
+ relevant: "relevant",
1566
+ }),
1567
+ rationale: Type.String({}),
1568
+ }, { additionalProperties: false }),
1569
+ async execute(_toolCallId, params) {
1570
+ const path = typeof params?.path === "string" ? params.path : "";
1571
+ const disposition = params?.disposition;
1572
+ const rationale = typeof params?.rationale === "string" ? params.rationale : "";
1573
+ if (!path || !disposition || !rationale.trim()) {
1574
+ return receipt({
1575
+ ok: false,
1576
+ kind: "openspec-selection",
1577
+ error: "record_openspec_selection requires non-empty path, disposition (required|relevant), and rationale",
1578
+ });
1579
+ }
1580
+ const result = await adoptContractFact("openspec-selection", {
1581
+ kind: "openspec-selection",
1582
+ origin: "contract",
1583
+ path,
1584
+ disposition,
1585
+ rationale,
1586
+ });
1587
+ return receipt(result);
1588
+ },
1589
+ });
1590
+ const finalizeContractTool = defineTool({
1591
+ name: "finalize_contract",
1592
+ label: "finalize_contract",
1593
+ description: "Commit the contract-finalized terminal fact with a disposition of ready | ready-with-assumptions | blocked (blocked requires blockingOwner). Call exactly once.",
1594
+ promptSnippet: "Commit the contract-finalized terminal (disposition + optional blockingOwner).",
1595
+ parameters: Type.Object({
1596
+ disposition: Type.Enum({
1597
+ ready: "ready",
1598
+ "ready-with-assumptions": "ready-with-assumptions",
1599
+ blocked: "blocked",
1600
+ }),
1601
+ blockingOwner: Type.Optional(Type.Enum({
1602
+ "blocked-human": "blocked-human",
1603
+ "blocked-external": "blocked-external",
1604
+ })),
1605
+ assumptions: Type.Optional(Type.Array(Type.String({}))),
1606
+ summary: Type.Optional(Type.String({})),
1607
+ }, { additionalProperties: false }),
1608
+ async execute(_toolCallId, params) {
1609
+ const disposition = params?.disposition;
1610
+ const blockingOwner = params?.blockingOwner;
1611
+ if (disposition === "blocked" && !blockingOwner) {
1612
+ return receipt({
1613
+ ok: false,
1614
+ kind: "finalize_contract",
1615
+ error: "blocked disposition requires blockingOwner (blocked-human | blocked-external)",
1616
+ });
1617
+ }
1618
+ const blockedOwner = mapContractBlockedOwner({
1619
+ disposition: disposition ?? "",
1620
+ blockingOwner,
1621
+ });
1622
+ const result = await adoptContractFact("contract-finalized", {
1623
+ kind: "contract-finalized",
1624
+ origin: "contract",
1625
+ disposition,
1626
+ ...(blockingOwner ? { blockingOwner } : {}),
1627
+ ...(blockedOwner !== "not-blocked" ? { blockedOwner } : {}),
1628
+ ...(Array.isArray(params?.assumptions)
1629
+ ? { assumptions: params.assumptions }
1630
+ : {}),
1631
+ ...(typeof params?.summary === "string"
1632
+ ? { summary: params.summary }
1633
+ : {}),
1634
+ });
1635
+ return receipt(result);
1636
+ },
1637
+ });
1638
+ return {
1639
+ customTools: [
1640
+ ...recordTools,
1641
+ recordOpenspecSelectionTool,
1642
+ finalizeContractTool,
1643
+ ],
1644
+ flush: async () => {
1645
+ const committed = readCommittedEvents(store, attemptId);
1646
+ await writeTypedEventStoreJsonl(path.join(input.runDir, input.nodeId, "contract-typed-facts.jsonl"), committed);
1647
+ await writeJsonAtomic(path.join(input.runDir, input.nodeId, "frontend-task-contract-vNext.json"), buildFrontendTaskContractVNext(committed));
1648
+ },
1649
+ };
1650
+ }
1651
+ /**
1652
+ * A+B: `frontend-scout-pi` incremental evidence tools (origin=scout). Runtime
1653
+ * enriches committed target-surface / design-evidence facts with hash/section/
1654
+ * freshness from real read events; the tool itself never trusts model self-report.
1655
+ */
1656
+ export async function createFrontendScoutEvidenceTools(input) {
1657
+ const [{ Type }, { defineTool }] = await Promise.all([
1658
+ import("typebox"),
1659
+ import("@earendil-works/pi-coding-agent"),
1660
+ ]);
1661
+ const { readCommittedEvents, writeTypedEventStoreJsonl } = await import("../workflows/dag/frontend-typed-event-store.js");
1662
+ const { adoptTypedEventFact, stageTypedEventFact } = await import("../workflows/dag/frontend-typed-event-transaction.js");
1663
+ const store = input.store;
1664
+ const attemptId = input.attemptId;
1665
+ const stringArray = Type.Array(Type.String({}));
1666
+ const optionalString = Type.Optional(Type.String({}));
1667
+ const scoutCompleteness = Type.Union([
1668
+ Type.Literal("complete"),
1669
+ Type.Literal("blocked"),
1670
+ ]);
1671
+ const receipt = (details) => ({
1672
+ content: [{ type: "text", text: JSON.stringify(details) }],
1673
+ details,
1674
+ });
1675
+ // A+B (AC-003): runtime enriches declared scout paths with hash/freshness
1676
+ // from the real filesystem. The model's self-reported path list is never
1677
+ // trusted for content identity; a missing file fails closed to fresh=false
1678
+ // with a zero hash instead of inventing content.
1679
+ const enrichScoutPathEvidence = async (paths) => {
1680
+ if (!input.workspaceRoot)
1681
+ return [];
1682
+ const workspaceRoot = path.resolve(input.workspaceRoot);
1683
+ const evidence = [];
1684
+ for (const relative of new Set(paths)) {
1685
+ const absolute = path.resolve(workspaceRoot, relative);
1686
+ if (absolute !== workspaceRoot &&
1687
+ !absolute.startsWith(`${workspaceRoot}${path.sep}`)) {
1688
+ evidence.push({ path: relative, sha256: "0".repeat(64), fresh: false });
1689
+ continue;
1690
+ }
1691
+ try {
1692
+ const bytes = await readFile(absolute);
1693
+ evidence.push({
1694
+ path: relative,
1695
+ sha256: createHash("sha256").update(bytes).digest("hex"),
1696
+ fresh: true,
1697
+ });
1698
+ }
1699
+ catch {
1700
+ evidence.push({ path: relative, sha256: "0".repeat(64), fresh: false });
1701
+ }
1702
+ }
1703
+ return evidence;
1704
+ };
1705
+ async function adoptScoutFact(kind, fact) {
1706
+ try {
1707
+ const requestId = `${attemptId}:${kind}:${randomUUID()}`;
1708
+ const staged = stageTypedEventFact({
1709
+ store,
1710
+ requestId,
1711
+ attemptId,
1712
+ fact: fact,
1713
+ });
1714
+ const committed = await adoptTypedEventFact({
1715
+ store,
1716
+ requestId,
1717
+ attemptId,
1718
+ fact: fact,
1719
+ eventId: staged.eventId,
1720
+ expectedRevision: store.revision,
1721
+ });
1722
+ return {
1723
+ ok: true,
1724
+ kind,
1725
+ eventId: committed.eventId,
1726
+ revision: committed.revision,
1727
+ error: "",
1728
+ };
1729
+ }
1730
+ catch (error) {
1731
+ return {
1732
+ ok: false,
1733
+ kind,
1734
+ code: error?.code,
1735
+ error: error instanceof Error ? error.message : String(error),
1736
+ };
1737
+ }
178
1738
  }
179
- return resolvePiExecutorStep(resolveDagPiPersona(task));
1739
+ const recordTargetSurfaceTool = defineTool({
1740
+ name: "record_target_surface",
1741
+ label: "record_target_surface",
1742
+ description: "Commit an origin=scout target-surface fact with complete/blocked discovery status. A complete surface needs a proven target path and no unresolved paths; blocked surfaces name the unresolved paths instead of guessing.",
1743
+ promptSnippet: "Commit an origin=scout target-surface fact.",
1744
+ parameters: Type.Object({
1745
+ completeness: scoutCompleteness,
1746
+ entrypoint: optionalString,
1747
+ routeOrMount: optionalString,
1748
+ implementationPaths: stringArray,
1749
+ testPaths: stringArray,
1750
+ dataSource: optionalString,
1751
+ allowedPathConflicts: stringArray,
1752
+ unresolvedPaths: stringArray,
1753
+ }, { additionalProperties: false }),
1754
+ async execute(_toolCallId, params) {
1755
+ const implementationPaths = params?.implementationPaths ?? [];
1756
+ const testPaths = params?.testPaths ?? [];
1757
+ const pathEvidence = await enrichScoutPathEvidence([
1758
+ ...(params?.entrypoint ? [params.entrypoint] : []),
1759
+ ...implementationPaths,
1760
+ ...testPaths,
1761
+ ]);
1762
+ const result = await adoptScoutFact("target-surface", {
1763
+ kind: "target-surface",
1764
+ origin: "scout",
1765
+ completeness: params?.completeness ?? "blocked",
1766
+ entrypoint: params?.entrypoint ?? "",
1767
+ routeOrMount: params?.routeOrMount ?? "",
1768
+ implementationPaths,
1769
+ testPaths,
1770
+ dataSource: params?.dataSource ?? "",
1771
+ allowedPathConflicts: params?.allowedPathConflicts ?? [],
1772
+ unresolvedPaths: params?.unresolvedPaths ?? [],
1773
+ ...(pathEvidence.length > 0 ? { pathEvidence } : {}),
1774
+ });
1775
+ return receipt(result);
1776
+ },
1777
+ });
1778
+ const recordDesignEvidenceTool = defineTool({
1779
+ name: "record_design_evidence",
1780
+ label: "record_design_evidence",
1781
+ description: "Commit an origin=scout design-evidence fact (source, paths, conflicts).",
1782
+ promptSnippet: "Commit an origin=scout design-evidence fact.",
1783
+ parameters: Type.Object({ source: Type.String({}), paths: stringArray, conflicts: stringArray }, { additionalProperties: false }),
1784
+ async execute(_toolCallId, params) {
1785
+ const paths = params?.paths ?? [];
1786
+ const pathEvidence = await enrichScoutPathEvidence(paths);
1787
+ const result = await adoptScoutFact("design-evidence", {
1788
+ kind: "design-evidence",
1789
+ origin: "scout",
1790
+ source: params?.source ?? "",
1791
+ paths,
1792
+ conflicts: params?.conflicts ?? [],
1793
+ ...(pathEvidence.length > 0 ? { pathEvidence } : {}),
1794
+ });
1795
+ return receipt(result);
1796
+ },
1797
+ });
1798
+ return {
1799
+ customTools: [recordTargetSurfaceTool, recordDesignEvidenceTool],
1800
+ flush: async () => {
1801
+ const committed = readCommittedEvents(store, attemptId);
1802
+ await writeTypedEventStoreJsonl(path.join(input.runDir, input.nodeId, "scout-typed-facts.jsonl"), committed);
1803
+ },
1804
+ };
180
1805
  }
181
- export function resolveDagPiToolNames(task) {
182
- if (!isDagPiWriteTask(task))
183
- return [...DAG_PI_READONLY_TOOLS];
184
- const tools = [...DAG_PI_WRITE_TOOLS];
185
- // Pi SDK activates custom tools only when they are in this explicit list.
186
- // Command capabilities (playwright_cli) stay capability-gated; read-only nodes never get command tools.
187
- if (dagCommandPolicyAllows(task.commandPolicy, "playwright-cli")) {
188
- tools.push("playwright_cli");
189
- }
190
- return tools;
1806
+ async function resolveFrontendPlanReadAccess(input) {
1807
+ const { readCommittedOriginFacts, scoutConfirmedReadPaths } = await import("../workflows/dag/frontend-shadow-dual-write.js");
1808
+ const scoutFacts = await readCommittedOriginFacts(input.runDir, "frontend-scout-pi", "scout-typed-facts.jsonl");
1809
+ const workspaceRoot = path.resolve(input.cwd);
1810
+ const allowedReadPaths = scoutConfirmedReadPaths(scoutFacts)
1811
+ .map((relativePath) => path.resolve(workspaceRoot, relativePath))
1812
+ .filter((absolutePath) => absolutePath === workspaceRoot ||
1813
+ absolutePath.startsWith(`${workspaceRoot}${path.sep}`));
1814
+ return {
1815
+ allowedReadPaths,
1816
+ // Upstream artifacts are runner-owned evidence, not repository discovery.
1817
+ allowedReadRoots: [
1818
+ path.join(input.runDir, "frontend-contract-pi"),
1819
+ path.join(input.runDir, "frontend-scout-pi"),
1820
+ ],
1821
+ };
191
1822
  }
192
1823
  export function buildDagPiUserMessage(task, persona, step) {
193
1824
  const role = task.role ?? "unspecified";
194
1825
  const writePolicy = task.writePolicy ?? "read-only (default)";
195
1826
  if (isDagPiWriteTask(task)) {
196
- const outcomeInstruction = task.writerOutcomePolicy
1827
+ const outcomeInstruction = isFrontendFactsWriter(task)
197
1828
  ? [
198
- "The first non-empty response line must be exactly IMPLEMENTATION_OUTCOME: changed, IMPLEMENTATION_OUTCOME: already-satisfied, or IMPLEMENTATION_OUTCOME: blocked. The runner measures your diff mechanically from git status snapshots taken before and after this node: code pasted into the response text is NOT an implementation and yields an empty diff. Use changed only after actually calling write/edit tools that persist files to disk; use already-satisfied only when the contract is already met and no file changed; use blocked when implementation cannot proceed. Claiming changed without a persisted diff fails this node as invalid-output.",
199
- task.writerOutcomePolicy.requireChangedFiles
200
- ? "This generation node requires a non-empty bounded diff; already-satisfied cannot complete it successfully."
201
- : undefined,
1829
+ "Your implementation status is derived by the executor from mechanical facts (persisted write-tool events, run delta, write guard, requirement coverage, focused-check failures) — never from an IMPLEMENTATION_OUTCOME first line. Do not emit an IMPLEMENTATION_OUTCOME first line. Make real write/edit tool calls that persist files to disk: a response-only change is an empty diff that fails this node. If the contract is already satisfied, prove it with concrete target/verification evidence; a bare self-report cannot authorize an empty implementation.",
202
1830
  ]
203
1831
  .filter((value) => Boolean(value))
204
1832
  .join(" ")
205
- : undefined;
1833
+ : task.writerOutcomePolicy
1834
+ ? [
1835
+ "The first non-empty response line must be exactly IMPLEMENTATION_OUTCOME: changed, IMPLEMENTATION_OUTCOME: already-satisfied, or IMPLEMENTATION_OUTCOME: blocked. The runner measures your diff mechanically from git status snapshots taken before and after this node: code pasted into the response text is NOT an implementation and yields an empty diff. Use changed only after actually calling write/edit tools that persist files to disk; use already-satisfied only when the contract is already met and no file changed; use blocked when implementation cannot proceed. Claiming changed without a persisted diff fails this node as invalid-output.",
1836
+ task.writerOutcomePolicy.requireChangedFiles
1837
+ ? "This generation node requires a non-empty bounded diff; already-satisfied cannot complete it successfully."
1838
+ : undefined,
1839
+ ]
1840
+ .filter((value) => Boolean(value))
1841
+ .join(" ")
1842
+ : undefined;
206
1843
  return [
207
1844
  `You are executing hybrid DAG node "${task.id}" (role=${role}, piStep=${step}, writePolicy=${writePolicy}).`,
208
1845
  "The system prompt contains the full DAG envelope: objective, constraints, upstream context, and task.",
@@ -327,6 +1964,36 @@ export async function writePiExecutorArtifacts(artifactsDir, input) {
327
1964
  await writeTextArtifactFile(summaryPath, buildPiResultSummaryMarkdown(input));
328
1965
  return { promptPath, summaryPath };
329
1966
  }
1967
+ /**
1968
+ * Run-owned per-node Pi extension facts (plan 2026-08-21): requested ids,
1969
+ * resolved packages (with absolute entry paths), and degraded/missing ids.
1970
+ * Written only for nodes that declare `piExtensions`; never into the repo-level
1971
+ * DAG template. Best-effort: artifact failures never fail the node.
1972
+ */
1973
+ async function writePiExtensionsArtifact(nodeArtifactsDir, requested, resolved, missing) {
1974
+ try {
1975
+ const runDir = path.dirname(nodeArtifactsDir);
1976
+ const nodeId = path.basename(nodeArtifactsDir);
1977
+ await writeDagNodeJsonArtifact(runDir, nodeId, "pi-extensions.json", {
1978
+ schemaVersion: 1,
1979
+ requested: [...requested],
1980
+ resolved: resolved.map((entry) => ({
1981
+ id: entry.id,
1982
+ packageName: entry.packageName,
1983
+ version: entry.version,
1984
+ path: entry.entryPaths.join(", "),
1985
+ })),
1986
+ missing: missing.map((entry) => ({
1987
+ id: entry.id,
1988
+ reason: entry.reason,
1989
+ ...(entry.detail ? { detail: entry.detail } : {}),
1990
+ })),
1991
+ });
1992
+ }
1993
+ catch {
1994
+ // best-effort run fact; node execution continues
1995
+ }
1996
+ }
330
1997
  async function resolveValidatedFrontendBaseUrlFromContext(workspaceRoot, runDir) {
331
1998
  try {
332
1999
  const capability = JSON.parse(await readFile(path.join(runDir, "preflight-frontend-browser-tool-shell", "frontend-browser-capability.json"), "utf8"));
@@ -383,6 +2050,145 @@ const DEFAULT_DAG_PI_WRITE_GUARD_DEPENDENCIES = {
383
2050
  readGitStatusPorcelain,
384
2051
  recoverRootNulArtifact,
385
2052
  };
2053
+ /**
2054
+ * M5 shadow pass for `frontend-review-pi`: extract the committed typed terminal
2055
+ * facts from session events, parse the legacy JSON verdict from the response
2056
+ * text, compare them (audit-only), and persist the audit artifact. Missing
2057
+ * typed terminal facts fail the node closed (AC-001); a shadow mismatch never
2058
+ * blocks the node.
2059
+ */
2060
+ async function runFrontendReviewTerminalShadow(input) {
2061
+ // A provider/executor failure (in particular context-overflow) is already
2062
+ // authoritative. Do not rewrite it to review-terminal-missing merely
2063
+ // because no terminal tool could be submitted after the failed call.
2064
+ if (!input.mapped.ok)
2065
+ return input.mapped;
2066
+ const { compareTypedReviewToLegacyJsonVerdict } = await import("../workflows/dag/frontend-review-context.js");
2067
+ const { parseJsonReviewVerdict } = await import("../workflows/dag/output-protocol.js");
2068
+ const sessionEventsPath = path.join(input.meta.runDir, input.task.id, "session-events.jsonl");
2069
+ let typedKinds = [];
2070
+ try {
2071
+ const content = await readFile(sessionEventsPath, "utf8");
2072
+ typedKinds = scanReviewTerminalKindsFromSessionEvents(content);
2073
+ }
2074
+ catch {
2075
+ // Missing/unreadable session log → fail-closed at zero terminal facts.
2076
+ typedKinds = [];
2077
+ }
2078
+ let legacyVerdict;
2079
+ try {
2080
+ const parsed = parseJsonReviewVerdict(input.mapped.assistantText ?? input.mapped.stdout);
2081
+ if (parsed.ok)
2082
+ legacyVerdict = parsed.verdict;
2083
+ }
2084
+ catch {
2085
+ legacyVerdict = undefined;
2086
+ }
2087
+ let comparison;
2088
+ try {
2089
+ comparison = compareTypedReviewToLegacyJsonVerdict({
2090
+ typedKinds,
2091
+ legacyVerdict,
2092
+ });
2093
+ }
2094
+ catch (error) {
2095
+ comparison = {
2096
+ typedVerdict: undefined,
2097
+ legacyVerdict: undefined,
2098
+ match: false,
2099
+ reason: `typed review equivalence comparison crashed: ${error instanceof Error ? error.message : String(error)}`,
2100
+ };
2101
+ }
2102
+ // Audit-only flush + artifact. Neither blocks the node.
2103
+ try {
2104
+ await input.tools?.flush?.();
2105
+ }
2106
+ catch {
2107
+ // best-effort
2108
+ }
2109
+ try {
2110
+ await writeDagNodeJsonArtifact(input.meta.runDir, input.task.id, "fact-review-status.json", {
2111
+ schemaVersion: 1,
2112
+ nodeId: input.task.id,
2113
+ typedKinds,
2114
+ legacyVerdict,
2115
+ comparison,
2116
+ });
2117
+ }
2118
+ catch {
2119
+ // best-effort audit artifact
2120
+ }
2121
+ if (typedKinds.length === 0) {
2122
+ return {
2123
+ ...input.mapped,
2124
+ ok: false,
2125
+ failureCategory: "review-terminal-missing",
2126
+ stderr: [
2127
+ input.mapped.stderr,
2128
+ "frontend review typed terminal fact missing: no approve_review/request_review_changes tool call was committed",
2129
+ ]
2130
+ .filter(Boolean)
2131
+ .join("\n\n"),
2132
+ };
2133
+ }
2134
+ return input.mapped;
2135
+ }
2136
+ /**
2137
+ * M8 shadow pass for `frontend-design-review-pi`: extract the committed typed
2138
+ * design terminal facts from session events, flush them, and persist the audit
2139
+ * artifact. The design review's legacy output was a first-line
2140
+ * `VERDICT: pass|request-revision` text protocol (not a JSON verdict), so
2141
+ * there is no JSON equivalence comparison here. Missing typed terminal facts
2142
+ * fail the node closed; writer admission later reads the committed
2143
+ * `design-typed-facts.jsonl` as the only authoritative verdict.
2144
+ */
2145
+ async function runFrontendDesignTerminalShadow(input) {
2146
+ // See the review counterpart above: a failed provider call cannot be
2147
+ // diagnosed as an omitted terminal tool call.
2148
+ if (!input.mapped.ok)
2149
+ return input.mapped;
2150
+ const sessionEventsPath = path.join(input.meta.runDir, input.task.id, "session-events.jsonl");
2151
+ let typedKinds = [];
2152
+ try {
2153
+ const content = await readFile(sessionEventsPath, "utf8");
2154
+ typedKinds = scanDesignTerminalKindsFromSessionEvents(content);
2155
+ }
2156
+ catch {
2157
+ // Missing/unreadable session log → fail-closed at zero terminal facts.
2158
+ typedKinds = [];
2159
+ }
2160
+ // Audit-only flush + artifact. Neither blocks the node.
2161
+ try {
2162
+ await input.tools?.flush?.();
2163
+ }
2164
+ catch {
2165
+ // best-effort
2166
+ }
2167
+ try {
2168
+ await writeDagNodeJsonArtifact(input.meta.runDir, input.task.id, "fact-design-status.json", {
2169
+ schemaVersion: 1,
2170
+ nodeId: input.task.id,
2171
+ typedKinds,
2172
+ });
2173
+ }
2174
+ catch {
2175
+ // best-effort audit artifact
2176
+ }
2177
+ if (typedKinds.length === 0) {
2178
+ return {
2179
+ ...input.mapped,
2180
+ ok: false,
2181
+ failureCategory: "design-terminal-missing",
2182
+ stderr: [
2183
+ input.mapped.stderr,
2184
+ "frontend design typed terminal fact missing: no approve_design/request_design_changes tool call was committed",
2185
+ ]
2186
+ .filter(Boolean)
2187
+ .join("\n\n"),
2188
+ };
2189
+ }
2190
+ return input.mapped;
2191
+ }
386
2192
  export async function executeDagPiNode(input, meta, piStepFn = executePiStep, writeGuardDependencies = DEFAULT_DAG_PI_WRITE_GUARD_DEPENDENCIES) {
387
2193
  const started = Date.now();
388
2194
  const persona = resolveDagPiPersona(input.task);
@@ -414,9 +2220,28 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
414
2220
  };
415
2221
  }
416
2222
  let beforeStatus;
2223
+ let beforeWorkspaceSnapshot;
417
2224
  let beforePathFingerprints;
418
- /** tools-only: keep SDK path sandbox; skip git baseline + post-diff write-guard hard fail. */
419
- const skipGitWriteGuard = isWriteTask && input.task.writeGuardPolicy === "tools-only";
2225
+ /** tools-only and filesystem-only keep the tool sandbox but skip Git baseline. */
2226
+ const filesystemOnly = isWriteTask && meta.spec.backendTestWorkspaceControl === "filesystem-only";
2227
+ const skipGitWriteGuard = isWriteTask && (input.task.writeGuardPolicy === "tools-only" || filesystemOnly);
2228
+ if (isWriteTask && filesystemOnly) {
2229
+ try {
2230
+ beforeWorkspaceSnapshot = await captureWorkspaceWriteSnapshot({
2231
+ rootCwd: input.cwd,
2232
+ paths: input.task.writeSet ?? input.task.allowedPaths,
2233
+ });
2234
+ }
2235
+ catch (error) {
2236
+ return {
2237
+ ok: false,
2238
+ stdout: "",
2239
+ stderr: `workspace filesystem baseline unavailable before Pi execution: ${error instanceof Error ? error.message : String(error)}`,
2240
+ failureCategory: "write-guard",
2241
+ durationMs: Date.now() - started,
2242
+ };
2243
+ }
2244
+ }
420
2245
  if (isWriteTask && !skipGitWriteGuard) {
421
2246
  try {
422
2247
  beforeStatus = await writeGuardDependencies.readGitStatusPorcelain(input.cwd, { phase: "pi-writer-before" });
@@ -453,6 +2278,12 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
453
2278
  }
454
2279
  : undefined;
455
2280
  let writerToolPolicy;
2281
+ let reviewTerminalTools;
2282
+ let designTerminalTools;
2283
+ let planLedgerTools;
2284
+ let contractTools;
2285
+ let scoutEvidenceTools;
2286
+ let readBudgetTools;
456
2287
  const commandPolicy = resolveDagCommandPolicy(input.task.commandPolicy);
457
2288
  const allowsPlaywrightCli = dagCommandPolicyAllows(input.task.commandPolicy, "playwright-cli");
458
2289
  let playwrightToolContext;
@@ -481,10 +2312,11 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
481
2312
  throw new Error(`unknown command capability: ${capability}`);
482
2313
  }
483
2314
  if (capability === "playwright-cli") {
484
- const caseId = resolveCaseIdFromWriteSet(input.task.writeSet) ??
2315
+ const layout = frontendTestLayoutFromSpec(meta.spec);
2316
+ const caseId = resolveCaseIdFromWriteSet(input.task.writeSet, layout) ??
485
2317
  input.task.id;
486
- const evidenceDir = resolveEvidenceDirFromWriteSet(input.task.writeSet) ??
487
- `testcase/frontend/evidence/${caseId}`;
2318
+ const evidenceDir = resolveEvidenceDirFromWriteSet(input.task.writeSet, layout) ??
2319
+ `${layout.evidenceDir}/${caseId}`;
488
2320
  playwrightToolContext = {
489
2321
  repoRoot: input.cwd,
490
2322
  runDir: meta.runDir,
@@ -492,7 +2324,8 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
492
2324
  caseId,
493
2325
  evidenceDir,
494
2326
  baseUrl: await resolveValidatedFrontendBaseUrlFromContext(input.cwd, meta.runDir),
495
- inputRoot: "testcase/frontend/fixtures",
2327
+ inputRoot: layout.fixturesDir,
2328
+ layout,
496
2329
  };
497
2330
  // Cleanup must be confirmed before a new case; otherwise default-session
498
2331
  // isolation is unknown and no Pi invocation is permitted.
@@ -521,6 +2354,165 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
521
2354
  };
522
2355
  }
523
2356
  }
2357
+ if (isFrontendReviewTypedTerminalNode(input.task)) {
2358
+ try {
2359
+ const { createTypedEventStore } = await import("../workflows/dag/frontend-typed-event-store.js");
2360
+ const store = createTypedEventStore();
2361
+ reviewTerminalTools = await createFrontendReviewTerminalTools({
2362
+ attemptId: `${meta.runId}:${input.task.id}`,
2363
+ store,
2364
+ runDir: meta.runDir,
2365
+ nodeId: input.task.id,
2366
+ });
2367
+ writerToolPolicy = {
2368
+ requireSdk: true,
2369
+ customTools: reviewTerminalTools.customTools,
2370
+ };
2371
+ }
2372
+ catch (error) {
2373
+ return {
2374
+ ok: false,
2375
+ stdout: "",
2376
+ stderr: `pi review terminal tool policy unavailable before Pi execution: ${error instanceof Error ? error.message : String(error)}`,
2377
+ failureCategory: "tool-policy",
2378
+ durationMs: Date.now() - started,
2379
+ };
2380
+ }
2381
+ }
2382
+ if (isFrontendDesignTypedTerminalNode(input.task)) {
2383
+ try {
2384
+ const { createTypedEventStore } = await import("../workflows/dag/frontend-typed-event-store.js");
2385
+ const store = createTypedEventStore();
2386
+ designTerminalTools = await createFrontendDesignTerminalTools({
2387
+ attemptId: `${meta.runId}:${input.task.id}`,
2388
+ store,
2389
+ runDir: meta.runDir,
2390
+ nodeId: input.task.id,
2391
+ });
2392
+ writerToolPolicy = {
2393
+ requireSdk: true,
2394
+ customTools: designTerminalTools.customTools,
2395
+ };
2396
+ }
2397
+ catch (error) {
2398
+ return {
2399
+ ok: false,
2400
+ stdout: "",
2401
+ stderr: `pi design terminal tool policy unavailable before Pi execution: ${error instanceof Error ? error.message : String(error)}`,
2402
+ failureCategory: "tool-policy",
2403
+ durationMs: Date.now() - started,
2404
+ };
2405
+ }
2406
+ }
2407
+ if (isFrontendContractTypedNode(input.task)) {
2408
+ try {
2409
+ const { createTypedEventStore } = await import("../workflows/dag/frontend-typed-event-store.js");
2410
+ const store = createTypedEventStore();
2411
+ contractTools = await createFrontendContractTools({
2412
+ attemptId: `${meta.runId}:${input.task.id}`,
2413
+ store,
2414
+ runDir: meta.runDir,
2415
+ nodeId: input.task.id,
2416
+ });
2417
+ writerToolPolicy = {
2418
+ requireSdk: true,
2419
+ customTools: contractTools.customTools,
2420
+ };
2421
+ }
2422
+ catch (error) {
2423
+ return {
2424
+ ok: false,
2425
+ stdout: "",
2426
+ stderr: `pi contract tool policy unavailable before Pi execution: ${error instanceof Error ? error.message : String(error)}`,
2427
+ failureCategory: "tool-policy",
2428
+ durationMs: Date.now() - started,
2429
+ };
2430
+ }
2431
+ }
2432
+ if (isFrontendScoutEvidenceNode(input.task)) {
2433
+ try {
2434
+ const { createTypedEventStore } = await import("../workflows/dag/frontend-typed-event-store.js");
2435
+ const store = createTypedEventStore();
2436
+ scoutEvidenceTools = await createFrontendScoutEvidenceTools({
2437
+ attemptId: `${meta.runId}:${input.task.id}`,
2438
+ store,
2439
+ runDir: meta.runDir,
2440
+ nodeId: input.task.id,
2441
+ workspaceRoot: input.cwd,
2442
+ });
2443
+ writerToolPolicy = {
2444
+ requireSdk: true,
2445
+ customTools: scoutEvidenceTools.customTools,
2446
+ };
2447
+ }
2448
+ catch (error) {
2449
+ return {
2450
+ ok: false,
2451
+ stdout: "",
2452
+ stderr: `pi scout evidence tool policy unavailable before Pi execution: ${error instanceof Error ? error.message : String(error)}`,
2453
+ failureCategory: "tool-policy",
2454
+ durationMs: Date.now() - started,
2455
+ };
2456
+ }
2457
+ }
2458
+ if (isFrontendPlanLedgerNode(input.task)) {
2459
+ try {
2460
+ const { createTypedEventStore } = await import("../workflows/dag/frontend-typed-event-store.js");
2461
+ const store = createTypedEventStore();
2462
+ planLedgerTools = await createFrontendPlanLedgerTools({
2463
+ attemptId: `${meta.runId}:${input.task.id}`,
2464
+ store,
2465
+ runDir: meta.runDir,
2466
+ nodeId: input.task.id,
2467
+ skeleton: input.task.structuredContractOutput?.skeleton,
2468
+ });
2469
+ writerToolPolicy = {
2470
+ requireSdk: true,
2471
+ customTools: planLedgerTools.customTools,
2472
+ };
2473
+ }
2474
+ catch (error) {
2475
+ return {
2476
+ ok: false,
2477
+ stdout: "",
2478
+ stderr: `pi plan ledger tool policy unavailable before Pi execution: ${error instanceof Error ? error.message : String(error)}`,
2479
+ failureCategory: "tool-policy",
2480
+ durationMs: Date.now() - started,
2481
+ };
2482
+ }
2483
+ }
2484
+ if (input.task.readBudget) {
2485
+ try {
2486
+ readBudgetTools = await createPiReadBudgetCustomTools({
2487
+ repoRoot: input.cwd,
2488
+ budget: input.task.readBudget,
2489
+ ...(isFrontendPlanLedgerNode(input.task)
2490
+ ? {
2491
+ readAccess: await resolveFrontendPlanReadAccess({
2492
+ cwd: input.cwd,
2493
+ runDir: meta.runDir,
2494
+ }),
2495
+ }
2496
+ : {}),
2497
+ });
2498
+ writerToolPolicy = {
2499
+ requireSdk: true,
2500
+ customTools: [
2501
+ ...(writerToolPolicy?.customTools ?? []),
2502
+ ...readBudgetTools.customTools,
2503
+ ],
2504
+ };
2505
+ }
2506
+ catch (error) {
2507
+ return {
2508
+ ok: false,
2509
+ stdout: "",
2510
+ stderr: `pi read budget policy unavailable before Pi execution: ${error instanceof Error ? error.message : String(error)}`,
2511
+ failureCategory: "tool-policy",
2512
+ durationMs: Date.now() - started,
2513
+ };
2514
+ }
2515
+ }
524
2516
  let result;
525
2517
  try {
526
2518
  // Phase 5 (P1-9): capture the writeSet baseline BEFORE the writer provider
@@ -529,8 +2521,7 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
529
2521
  // hard fail (no baseline → no rollback → no recovery). Dynamic import avoids
530
2522
  // an executor ↔ scheduler static cycle.
531
2523
  if (isWriteTask &&
532
- (input.task.id === "frontend-implement-pi" ||
533
- input.task.id === "frontend-repair-pi") &&
2524
+ input.task.id === "frontend-implement-pi" &&
534
2525
  (input.task.writeSet?.length ?? 0) > 0) {
535
2526
  try {
536
2527
  const { captureFrontendWriterAttemptIntent } = await import("../workflows/dag/frontend-writer-recovery.js");
@@ -550,6 +2541,29 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
550
2541
  };
551
2542
  }
552
2543
  }
2544
+ // Plan 2026-08-21 D4/D6: resolve the node's explicit Pi extension
2545
+ // allowlist against the settings inventory. Degrade on missing packages —
2546
+ // never fail the node — and persist requested/resolved/missing facts.
2547
+ const piExtensionsResolution = input.task.piExtensions
2548
+ ? resolveDagPiExtensions({
2549
+ repoRoot: input.cwd,
2550
+ ids: input.task.piExtensions,
2551
+ })
2552
+ : undefined;
2553
+ if (piExtensionsResolution) {
2554
+ const piBackend = resolvePiBackend();
2555
+ const cliDegraded = piBackend === "cli-only";
2556
+ await writePiExtensionsArtifact(path.join(meta.runDir, input.task.id), input.task.piExtensions, cliDegraded ? [] : piExtensionsResolution.resolved, cliDegraded
2557
+ ? input.task.piExtensions.map((id) => ({
2558
+ id,
2559
+ reason: "not-installed",
2560
+ detail: "cli backend does not load pi extensions (sdk-only v1)",
2561
+ }))
2562
+ : piExtensionsResolution.missing);
2563
+ }
2564
+ const piExtensionPaths = piExtensionsResolution && resolvePiBackend() !== "cli-only"
2565
+ ? piExtensionsResolution.resolved.flatMap((entry) => entry.entryPaths)
2566
+ : undefined;
553
2567
  result = await piStepFn({
554
2568
  attachedFiles: [],
555
2569
  modelConfig: resolveDagPiModelConfig(input.model, input.thinking ? { thinking: input.thinking } : undefined),
@@ -564,6 +2578,9 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
564
2578
  stallTimeoutMs: input.stallTimeoutMs,
565
2579
  abortGraceMs: input.abortGraceMs,
566
2580
  ...(writerToolPolicy ? { writerToolPolicy } : {}),
2581
+ ...(piExtensionPaths && piExtensionPaths.length > 0
2582
+ ? { piExtensionPaths }
2583
+ : {}),
567
2584
  onActivity: bridgeActivity
568
2585
  ? (activity) => {
569
2586
  if (activity.kind === "lease" ||
@@ -608,9 +2625,125 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
608
2625
  persona,
609
2626
  step,
610
2627
  });
611
- const mapped = mapPiResultToDagNodeResult(result, input.task.writerOutcomePolicy
612
- ? WRITER_OUTCOME_PROTOCOL_LINE
613
- : input.task.firstProtocolLine);
2628
+ const mapped = mapPiResultToDagNodeResult(result, isFrontendFactsWriter(input.task)
2629
+ ? undefined
2630
+ : input.task.writerOutcomePolicy
2631
+ ? WRITER_OUTCOME_PROTOCOL_LINE
2632
+ : input.task.firstProtocolLine);
2633
+ // A node-specific budget is enforced for every frontend reader that opts in,
2634
+ // including design/final review. Earlier code only checked contract, scout,
2635
+ // and plan nodes, leaving the two largest review sessions unbounded.
2636
+ // A soft-limit node has already stopped repository access in its SDK tool
2637
+ // guard. Session events still include the rejected tool attempt, so using
2638
+ // those telemetry events as a second budget gate would wrongly turn a
2639
+ // successful plan into read-burst.
2640
+ const readBudgetIssues = input.task.readBudget?.onExhaustion === "return-guidance"
2641
+ ? []
2642
+ : [
2643
+ ...(readBudgetTools?.issues() ?? []),
2644
+ ...(await detectNodeReadBudget({
2645
+ runDir: meta.runDir,
2646
+ nodeId: input.task.id,
2647
+ budget: input.task.readBudget,
2648
+ })),
2649
+ ];
2650
+ if (readBudgetIssues.length > 0) {
2651
+ // Read-budget telemetry is diagnostic only when the provider/executor has
2652
+ // already failed. In particular, keep context-overflow so node-execution
2653
+ // selects its compact retry envelope instead of treating the attempt as a
2654
+ // generic read-burst retry.
2655
+ if (!mapped.ok) {
2656
+ return {
2657
+ ...mapped,
2658
+ stderr: [mapped.stderr, ...readBudgetIssues]
2659
+ .filter(Boolean)
2660
+ .join("\n\n"),
2661
+ };
2662
+ }
2663
+ return {
2664
+ ...mapped,
2665
+ ok: false,
2666
+ failureCategory: "read-burst",
2667
+ stderr: [mapped.stderr, ...readBudgetIssues].filter(Boolean).join("\n\n"),
2668
+ };
2669
+ }
2670
+ if (isFrontendReviewTypedTerminalNode(input.task)) {
2671
+ return await runFrontendReviewTerminalShadow({
2672
+ task: input.task,
2673
+ meta,
2674
+ mapped,
2675
+ tools: reviewTerminalTools,
2676
+ });
2677
+ }
2678
+ if (isFrontendDesignTypedTerminalNode(input.task)) {
2679
+ return await runFrontendDesignTerminalShadow({
2680
+ task: input.task,
2681
+ meta,
2682
+ mapped,
2683
+ tools: designTerminalTools,
2684
+ });
2685
+ }
2686
+ if (isFrontendContractTypedNode(input.task)) {
2687
+ try {
2688
+ await contractTools?.flush?.();
2689
+ }
2690
+ catch {
2691
+ // best-effort flush
2692
+ }
2693
+ }
2694
+ if (isFrontendScoutEvidenceNode(input.task)) {
2695
+ try {
2696
+ await scoutEvidenceTools?.flush?.();
2697
+ }
2698
+ catch {
2699
+ // best-effort flush
2700
+ }
2701
+ if (mapped.ok) {
2702
+ const { checkCommittedOriginFacts, readCommittedOriginFacts } = await import("../workflows/dag/frontend-shadow-dual-write.js");
2703
+ const scoutFacts = await readCommittedOriginFacts(meta.runDir, input.task.id, "scout-typed-facts.jsonl");
2704
+ const completeness = checkCommittedOriginFacts({
2705
+ records: scoutFacts,
2706
+ origin: "scout",
2707
+ });
2708
+ if (!completeness.ok) {
2709
+ return {
2710
+ ...mapped,
2711
+ ok: false,
2712
+ failureCategory: "invalid-output",
2713
+ stderr: [mapped.stderr, completeness.reason]
2714
+ .filter(Boolean)
2715
+ .join("\n\n"),
2716
+ };
2717
+ }
2718
+ }
2719
+ }
2720
+ if (isFrontendPlanLedgerNode(input.task)) {
2721
+ try {
2722
+ await planLedgerTools?.flush?.();
2723
+ }
2724
+ catch {
2725
+ // best-effort flush; missing ledger still fails at the node validator
2726
+ }
2727
+ // Read-burst guard: a plan that burned dozens of read/grep/ls/find
2728
+ // calls (re-reading upstream outputs and source files it should trust
2729
+ // from typed facts) blows up the context window and eventually fails
2730
+ // with 400 request-too-large. Detect it deterministically from the
2731
+ // session log and retry with a reduced-reading instruction.
2732
+ const readBurstIssues = input.task.readBudget?.onExhaustion === "return-guidance"
2733
+ ? []
2734
+ : await detectPlanReadBurst({
2735
+ runDir: meta.runDir,
2736
+ nodeId: input.task.id,
2737
+ });
2738
+ if (readBurstIssues.length > 0) {
2739
+ return {
2740
+ ...mapped,
2741
+ ok: false,
2742
+ failureCategory: "read-burst",
2743
+ stderr: [mapped.stderr, ...readBurstIssues].filter(Boolean).join("\n\n"),
2744
+ };
2745
+ }
2746
+ }
614
2747
  if (!isWriteTask) {
615
2748
  return mapped;
616
2749
  }
@@ -618,6 +2751,27 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
618
2751
  let writeGuardViolations = [];
619
2752
  let changeManifestAfterStatus;
620
2753
  let changeManifestChangedFiles;
2754
+ let afterWorkspaceSnapshot;
2755
+ if (filesystemOnly && beforeWorkspaceSnapshot) {
2756
+ try {
2757
+ afterWorkspaceSnapshot = await captureWorkspaceWriteSnapshot({
2758
+ rootCwd: input.cwd,
2759
+ paths: input.task.writeSet ?? input.task.allowedPaths,
2760
+ });
2761
+ changeManifestChangedFiles = diffWorkspaceWriteSnapshots(beforeWorkspaceSnapshot, afterWorkspaceSnapshot);
2762
+ const guard = validateShellWriteGuardFromDiff({
2763
+ changedFiles: changeManifestChangedFiles,
2764
+ task: input.task,
2765
+ concurrentSiblingWriteSets: meta.concurrentSiblingWriteSets,
2766
+ });
2767
+ writeGuardOk = guard.ok;
2768
+ writeGuardViolations = guard.violations;
2769
+ }
2770
+ catch (error) {
2771
+ writeGuardOk = false;
2772
+ writeGuardViolations = [`workspace snapshot unavailable: ${error instanceof Error ? error.message : String(error)}`];
2773
+ }
2774
+ }
621
2775
  if (beforeStatus !== undefined) {
622
2776
  let recoveryEvidence;
623
2777
  let removalPendingRecheck;
@@ -723,8 +2877,7 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
723
2877
  changeManifestChangedFiles = changedFiles;
724
2878
  // Phase 5: record the attempt changed paths/hashes into the rollback
725
2879
  // intent so a transient partial write can be CAS-restored.
726
- if ((input.task.id === "frontend-implement-pi" ||
727
- input.task.id === "frontend-repair-pi") &&
2880
+ if (input.task.id === "frontend-implement-pi" &&
728
2881
  (input.task.writeSet?.length ?? 0) > 0) {
729
2882
  try {
730
2883
  const { recordFrontendWriterAttempt } = await import("../workflows/dag/frontend-writer-recovery.js");
@@ -774,8 +2927,65 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
774
2927
  }
775
2928
  }
776
2929
  let writerOutcomeViolation;
2930
+ let factDerivedStatus;
777
2931
  if (mapped.ok && input.task.writerOutcomePolicy) {
778
- if (changeManifestChangedFiles === undefined) {
2932
+ if (isFrontendFactsWriter(input.task)) {
2933
+ // AC-001/AC-003: facts-derived status. The first line is never read;
2934
+ // the legacy validator still runs for the shadow comparison only.
2935
+ try {
2936
+ const { collectFrontendWriterFacts, deriveFrontendWriterStatus, computeFailureFingerprint, compareFactStatusToLegacyOutcome, } = await import("../workflows/dag/frontend-writer-status.js");
2937
+ const facts = await collectFrontendWriterFacts({
2938
+ sessionEventsPath: path.join(meta.runDir, input.task.id, "session-events.jsonl"),
2939
+ changedFiles: changeManifestChangedFiles ?? [],
2940
+ writeGuard: { ok: writeGuardOk, violations: writeGuardViolations },
2941
+ requirementTargets: [],
2942
+ coveredRequirementIds: [],
2943
+ focusedCheckFailures: [],
2944
+ tokensUsed: result.tokensUsed,
2945
+ wallTimeMs: Date.now() - started,
2946
+ rounds: 1,
2947
+ writeAttempts: attempt,
2948
+ firstLineText: mapped.assistantText,
2949
+ });
2950
+ const derived = deriveFrontendWriterStatus(facts);
2951
+ factDerivedStatus = derived.status;
2952
+ const legacyValidation = validateWriterImplementationOutcome(mapped.assistantText || mapped.stdout, changeManifestChangedFiles ?? [], {
2953
+ requireChangedFiles: false,
2954
+ allowMissingChangedOutcomeWhenDiffPresent: false,
2955
+ });
2956
+ const legacyOutcome = legacyValidation.ok
2957
+ ? legacyValidation.outcome
2958
+ : legacyValidation.reason.includes("blocked")
2959
+ ? "blocked"
2960
+ : "missing";
2961
+ await writeDagNodeJsonArtifact(meta.runDir, input.task.id, "fact-implementation-status.json", {
2962
+ schemaVersion: 1,
2963
+ nodeId: input.task.id,
2964
+ status: derived.status,
2965
+ reason: derived.reason,
2966
+ changedFiles: facts.changedFiles,
2967
+ writeToolEvents: facts.writeToolEvents,
2968
+ writeGuardOk: facts.writeGuardOk,
2969
+ writeGuardViolations: facts.writeGuardViolations,
2970
+ focusedCheckFailures: facts.focusedCheckFailures,
2971
+ alreadySatisfiedEvidence: facts.alreadySatisfiedEvidence,
2972
+ tokensUsed: facts.tokensUsed,
2973
+ wallTimeMs: facts.wallTimeMs,
2974
+ rounds: facts.rounds,
2975
+ writeAttempts: facts.writeAttempts,
2976
+ failureFingerprint: computeFailureFingerprint(facts),
2977
+ shadow: compareFactStatusToLegacyOutcome(derived.status, legacyOutcome),
2978
+ });
2979
+ if (derived.status !== "changed" &&
2980
+ derived.status !== "already-satisfied") {
2981
+ writerOutcomeViolation = `fact-derived status ${derived.status}: ${derived.reason}`;
2982
+ }
2983
+ }
2984
+ catch (error) {
2985
+ writerOutcomeViolation = `frontend facts derivation failed: ${error instanceof Error ? error.message : String(error)}`;
2986
+ }
2987
+ }
2988
+ else if (changeManifestChangedFiles === undefined) {
779
2989
  writerOutcomeViolation =
780
2990
  "writer outcome validation failed: actual diff is unavailable";
781
2991
  }
@@ -790,7 +3000,7 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
790
3000
  }
791
3001
  }
792
3002
  if (writeGuardOk &&
793
- beforeStatus !== undefined &&
3003
+ (beforeStatus !== undefined || beforeWorkspaceSnapshot !== undefined) &&
794
3004
  changeManifestChangedFiles !== undefined) {
795
3005
  await persistWriterChangeManifest({
796
3006
  runDir: meta.runDir,
@@ -800,8 +3010,8 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
800
3010
  approvalSourceNodeId: input.task.resolvedFinalWriteSetApproval?.approvalSourceNodeId,
801
3011
  approvalDigest: input.task.resolvedFinalWriteSetApproval?.approvalDigest,
802
3012
  changedFiles: changeManifestChangedFiles,
803
- beforeStatus,
804
- afterStatus: changeManifestAfterStatus ?? "",
3013
+ beforeStatus: beforeStatus ?? JSON.stringify(beforeWorkspaceSnapshot),
3014
+ afterStatus: changeManifestAfterStatus ?? JSON.stringify(afterWorkspaceSnapshot),
805
3015
  });
806
3016
  }
807
3017
  let completenessFailure;
@@ -885,31 +3095,48 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
885
3095
  if (meta.writeGuardAttribution === "best-effort") {
886
3096
  stderrParts.push("write guard note: concurrent rank writers use best-effort per-node attribution; keep same-rank writeSet entries disjoint");
887
3097
  }
888
- // Pure provider stall/timeout with zero workspace side effects is eligible
889
- // for a single writer transport retry (implement-pi flake resilience).
890
- // Partial writes, tool calls, or write-guard failures keep raw `timeout`.
891
- const writerCleanTimeout = !mapped.ok &&
892
- mapped.failureCategory === "timeout" &&
893
- writeGuardOk &&
3098
+ const rawFailureCategory = mapped.failureCategory;
3099
+ const writeToolCallCount = readWriterThinkingExhaustionEvidence(result).writeToolCallCount;
3100
+ const zeroSideEffects = writeGuardOk &&
894
3101
  !completenessFailure &&
895
3102
  !writerThinkingExhausted &&
896
- isWriterTransportRetryCandidate(input.task) &&
3103
+ !writerOutcomeViolation &&
897
3104
  changeManifestChangedFiles !== undefined &&
898
3105
  changeManifestChangedFiles.length === 0 &&
899
- readWriterThinkingExhaustionEvidence(result).writeToolCallCount === 0;
3106
+ writeToolCallCount === 0;
3107
+ // Budget-exhausted: the provider session consumed an extreme amount of
3108
+ // tokens (e.g. an unresolved read-edit-test loop) and still failed. Only
3109
+ // applies on a non-ok writer result; a successful write is never re-labeled.
3110
+ const writerBudgetExhausted = !mapped.ok &&
3111
+ typeof mapped.tokensUsed === "number" &&
3112
+ mapped.tokensUsed > WRITER_TOKEN_BUDGET;
3113
+ const targetCleanTransport = !mapped.ok &&
3114
+ isTargetTemplateTransientRetryNode(input.task) &&
3115
+ rawFailureCategory !== undefined &&
3116
+ ["timeout", "network", "rate-limit", "unavailable"].includes(rawFailureCategory) &&
3117
+ zeroSideEffects;
3118
+ const frontendCleanTimeout = !mapped.ok &&
3119
+ rawFailureCategory === "timeout" &&
3120
+ isWriterTransportRetryCandidate(input.task) &&
3121
+ !isTargetTemplateTransientRetryNode(input.task) &&
3122
+ zeroSideEffects;
3123
+ const writerCleanTimeout = targetCleanTransport || frontendCleanTimeout;
900
3124
  return {
901
3125
  ...mapped,
902
3126
  ok: false,
903
3127
  stderr: stderrParts.filter(Boolean).join("\n\n"),
3128
+ ...(rawFailureCategory ? { rawFailureCategory } : {}),
904
3129
  failureCategory: mapped.ok
905
3130
  ? writeGuardOk
906
3131
  ? completenessFailure
907
3132
  ? completenessFailure.failureCategory
908
- : changeManifestChangedFiles?.length === 0 &&
909
- isWriterEmptyDiffRetryCandidate(input.task) &&
910
- isChangedWriterImplementationOutcome(mapped.assistantText || mapped.stdout)
3133
+ : factDerivedStatus === "empty-diff"
911
3134
  ? WRITER_EMPTY_DIFF_RETRY_CATEGORY
912
- : "invalid-output"
3135
+ : changeManifestChangedFiles?.length === 0 &&
3136
+ isWriterEmptyDiffRetryCandidate(input.task) &&
3137
+ isChangedWriterImplementationOutcome(mapped.assistantText || mapped.stdout)
3138
+ ? WRITER_EMPTY_DIFF_RETRY_CATEGORY
3139
+ : "invalid-output"
913
3140
  : "write-guard"
914
3141
  : // When the attempt already failed with a writer-style category
915
3142
  // (empty-output / invalid-output / writer-empty-diff) but the workspace
@@ -926,17 +3153,35 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
926
3153
  mapped.failureCategory === "invalid-output" ||
927
3154
  mapped.failureCategory === WRITER_EMPTY_DIFF_RETRY_CATEGORY)
928
3155
  ? INCOMPLETE_WRITE_SET_RETRY_CATEGORY
929
- : // writer-thinking-exhausted: a length-stopped thinking-only attempt with
930
- // zero write tool calls and zero attributed diff is terminal and
931
- // non-retryable; recommend a model switch + fresh run. Only applies on
932
- // the empty-output base category so provider/transport failures keep
933
- // their original category, and only when the completeness gate did not
934
- // upgrade to incomplete-write-set above.
935
- writerThinkingExhausted
936
- ? WRITER_THINKING_EXHAUSTED_CATEGORY
937
- : writerCleanTimeout
938
- ? WRITER_CLEAN_TIMEOUT_RETRY_CATEGORY
939
- : mapped.failureCategory,
3156
+ : // partial-success-with-context-overflow: the writer hit a context
3157
+ // overflow on its final provider call but had already persisted
3158
+ // real file changes (change-manifest non-empty). Classify it
3159
+ // distinctly so the report shows "code largely done, verification
3160
+ // incomplete" instead of a misleading empty-output / spec issue,
3161
+ // and recovery can rerun from verify/implement with a compacted
3162
+ // session rather than asking the operator for spec clarification.
3163
+ rawFailureCategory === "context-overflow" &&
3164
+ (changeManifestChangedFiles?.length ?? 0) > 0
3165
+ ? "partial-success-with-context-overflow"
3166
+ : // writer-thinking-exhausted: a length-stopped thinking-only attempt with
3167
+ // zero write tool calls and zero attributed diff is terminal and
3168
+ // non-retryable; recommend a model switch + fresh run. Only applies on
3169
+ // the empty-output base category so provider/transport failures keep
3170
+ // their original category, and only when the completeness gate did not
3171
+ // upgrade to incomplete-write-set above.
3172
+ writerThinkingExhausted
3173
+ ? WRITER_THINKING_EXHAUSTED_CATEGORY
3174
+ : writerCleanTimeout
3175
+ ? WRITER_CLEAN_TIMEOUT_RETRY_CATEGORY
3176
+ : // writer-budget-exhausted: the provider session consumed an
3177
+ // excessive amount of tokens (a read-edit-test loop that never
3178
+ // converged) and still failed. Classify distinctly so the
3179
+ // report says the run burned its budget instead of a generic
3180
+ // empty-output, and recovery recommends a fresh compacted
3181
+ // run rather than spec-clarification.
3182
+ writerBudgetExhausted
3183
+ ? WRITER_BUDGET_EXHAUSTED_CATEGORY
3184
+ : mapped.failureCategory,
940
3185
  durationMs: mapped.durationMs || Date.now() - started,
941
3186
  };
942
3187
  }