@tea-agent/loop-agent 0.39.0-beta.5 → 0.39.0-beta.6

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (114) hide show
  1. package/CHANGELOG.md +5 -0
  2. package/dist/build-stamp.json +3 -3
  3. package/dist/executors/dag-pi-executor.js +94 -25
  4. package/dist/executors/pi-playwright-cli-tool.js +23 -16
  5. package/dist/executors/shell-executor.js +25 -8
  6. package/dist/shared/dag-failure-category.js +138 -0
  7. package/dist/task/config-types.js +6 -0
  8. package/dist/task/source-references.js +22 -1
  9. package/dist/worker/console/chat/operation-card.js +8 -1
  10. package/dist/worker/console/chat/routes.js +5 -3
  11. package/dist/worker/console/inspect-split.js +18 -0
  12. package/dist/worker/console/operation-run-facts.js +19 -3
  13. package/dist/worker/console/static/assets/{abnfDiagram-N423BO3Z-zsNyvGaH.js → abnfDiagram-N423BO3Z-CfDSkLtp.js} +1 -1
  14. package/dist/worker/console/static/assets/{arc-BDjZ5kE1.js → arc-BlefM6I5.js} +1 -1
  15. package/dist/worker/console/static/assets/{architectureDiagram-T3A2C74G-BkgaujnN.js → architectureDiagram-T3A2C74G-C4tHfzHn.js} +1 -1
  16. package/dist/worker/console/static/assets/{blockDiagram-VBNYF7ZC-CqxOJi0j.js → blockDiagram-VBNYF7ZC-G-G77Rh1.js} +1 -1
  17. package/dist/worker/console/static/assets/{c4Diagram-5PPSVZJV-C2JHLdRi.js → c4Diagram-5PPSVZJV-DWgxmY72.js} +1 -1
  18. package/dist/worker/console/static/assets/channel-DsdX3ZUX.js +1 -0
  19. package/dist/worker/console/static/assets/{chunk-2GRJ4B5K-DF_YSvOS.js → chunk-2GRJ4B5K-CJQcfbCY.js} +1 -1
  20. package/dist/worker/console/static/assets/{chunk-2Q5K7J3B-D3Ort5Vo.js → chunk-2Q5K7J3B-vUPviH9y.js} +1 -1
  21. package/dist/worker/console/static/assets/{chunk-5RXB4S5H-XfAfZeUC.js → chunk-5RXB4S5H-DzRXSTeh.js} +1 -1
  22. package/dist/worker/console/static/assets/{chunk-5VM5RSS4-SLBibhf5.js → chunk-5VM5RSS4-CWfgqm07.js} +1 -1
  23. package/dist/worker/console/static/assets/{chunk-6Q2QTUOP-Dz29Ye_f.js → chunk-6Q2QTUOP-BtTDauXA.js} +1 -1
  24. package/dist/worker/console/static/assets/{chunk-GF5L2VYU-DB2G4H8V.js → chunk-GF5L2VYU-Bc-NNt84.js} +1 -1
  25. package/dist/worker/console/static/assets/{chunk-JWPE2WC7-CIoGkxdu.js → chunk-JWPE2WC7-B_f-emL4.js} +1 -1
  26. package/dist/worker/console/static/assets/{chunk-KBJHAD2P-CG78FGkn.js → chunk-KBJHAD2P-DV-jgJ66.js} +1 -1
  27. package/dist/worker/console/static/assets/{chunk-RYQCIY6F-ZDHAvXPd.js → chunk-RYQCIY6F-DMqzn4RZ.js} +1 -1
  28. package/dist/worker/console/static/assets/{chunk-XXDRQBXY-BKkkC4VA.js → chunk-XXDRQBXY-CVNtlAm4.js} +1 -1
  29. package/dist/worker/console/static/assets/classDiagram-JCYQIIEL-CrvCyJ-8.js +1 -0
  30. package/dist/worker/console/static/assets/classDiagram-v2-OCEON4UE-CrvCyJ-8.js +1 -0
  31. package/dist/worker/console/static/assets/{cose-bilkent-JH36ORCC-SposUZsO.js → cose-bilkent-JH36ORCC-BBZBhVTd.js} +1 -1
  32. package/dist/worker/console/static/assets/{cynefin-VYW2F7L2-BSCtQpD7.js → cynefin-VYW2F7L2-DbMU2PZ2.js} +1 -1
  33. package/dist/worker/console/static/assets/{cynefinDiagram-MW4NZA55-DgFHrw9l.js → cynefinDiagram-MW4NZA55-Dj0v8rjc.js} +1 -1
  34. package/dist/worker/console/static/assets/{dagre-VZM6K2ZE-BVBasYbj.js → dagre-VZM6K2ZE-BW8R4WvJ.js} +1 -1
  35. package/dist/worker/console/static/assets/{diagram-7IWD3JNH-6r_4rN_c.js → diagram-7IWD3JNH-DEgWz3ld.js} +1 -1
  36. package/dist/worker/console/static/assets/{diagram-B4RE2ZJO-JmuaB41P.js → diagram-B4RE2ZJO-BAA01rlR.js} +1 -1
  37. package/dist/worker/console/static/assets/{diagram-LBJQPF4R-xXvAY3sk.js → diagram-LBJQPF4R-Cau6qqpW.js} +1 -1
  38. package/dist/worker/console/static/assets/{diagram-Q27KOJAE-D2B3lY2o.js → diagram-Q27KOJAE-8HiPsLos.js} +1 -1
  39. package/dist/worker/console/static/assets/{diagram-UB23O5K3-tK54tMEX.js → diagram-UB23O5K3-CmkXuTYL.js} +1 -1
  40. package/dist/worker/console/static/assets/{ebnfDiagram-BXEA7PRR-CNtELzV-.js → ebnfDiagram-BXEA7PRR-DCV_0seW.js} +1 -1
  41. package/dist/worker/console/static/assets/{erDiagram-JOGREHBK-C1xKMKcW.js → erDiagram-JOGREHBK-gckfWESj.js} +1 -1
  42. package/dist/worker/console/static/assets/{flowDiagram-UKHOOZJN-CZ7dlPMz.js → flowDiagram-UKHOOZJN-D2mT2BUu.js} +1 -1
  43. package/dist/worker/console/static/assets/{ganttDiagram-PKOTCBZU-BqGb42Xe.js → ganttDiagram-PKOTCBZU-B_HR5qEw.js} +1 -1
  44. package/dist/worker/console/static/assets/{gitGraphDiagram-DS77QQ5N-D_BlXEtt.js → gitGraphDiagram-DS77QQ5N-BUw4fpSa.js} +1 -1
  45. package/dist/worker/console/static/assets/{index-D5zGX6fG.js → index-DPbsruV5.js} +81 -79
  46. package/dist/worker/console/static/assets/index-DwOGauxU.css +1 -0
  47. package/dist/worker/console/static/assets/{infoDiagram-6WML65LV-Vce2vmIe.js → infoDiagram-6WML65LV-BSRAqEj0.js} +1 -1
  48. package/dist/worker/console/static/assets/{ishikawaDiagram-WSZJBQD7-DDwVBAvI.js → ishikawaDiagram-WSZJBQD7-CLxE8hUp.js} +1 -1
  49. package/dist/worker/console/static/assets/{journeyDiagram-NVQOT4AX-y_Ew-wv4.js → journeyDiagram-NVQOT4AX-juFzVXIj.js} +1 -1
  50. package/dist/worker/console/static/assets/{kanban-definition-27J2QSJJ-CjXJFp1K.js → kanban-definition-27J2QSJJ-CwLHVhOU.js} +1 -1
  51. package/dist/worker/console/static/assets/{linear-1itMst1Q.js → linear-9LfUyPAs.js} +1 -1
  52. package/dist/worker/console/static/assets/{mermaid.core-C-D3ZRUa.js → mermaid.core-TPPHfQbe.js} +5 -5
  53. package/dist/worker/console/static/assets/{mindmap-definition-FAOFIHXS-BiYywmZc.js → mindmap-definition-FAOFIHXS-Dn_Z9RxF.js} +1 -1
  54. package/dist/worker/console/static/assets/{pegDiagram-VL7TDLO6-l2fydNWA.js → pegDiagram-VL7TDLO6-CiEMKTgm.js} +1 -1
  55. package/dist/worker/console/static/assets/{pieDiagram-7S7Q4E2Y-Dz0hNbYW.js → pieDiagram-7S7Q4E2Y-JASaGxjZ.js} +1 -1
  56. package/dist/worker/console/static/assets/{quadrantDiagram-CIZ2JOQS-BujI_mLZ.js → quadrantDiagram-CIZ2JOQS-ChmH0ply.js} +1 -1
  57. package/dist/worker/console/static/assets/{railroadDiagram-AXF67PYL-pWe84beb.js → railroadDiagram-AXF67PYL-CtyM-HGQ.js} +1 -1
  58. package/dist/worker/console/static/assets/{requirementDiagram-LRYGKXZP-ByYu2frg.js → requirementDiagram-LRYGKXZP-BN9y_Bvs.js} +1 -1
  59. package/dist/worker/console/static/assets/{sankeyDiagram-W5VNT64P-CoPnilFP.js → sankeyDiagram-W5VNT64P-IyS0GQ1-.js} +1 -1
  60. package/dist/worker/console/static/assets/{sequenceDiagram-SI44F4Z6-1Md2LnS0.js → sequenceDiagram-SI44F4Z6-DjxGXurN.js} +1 -1
  61. package/dist/worker/console/static/assets/{sizeCapture-X5ZJPWSS-DqqqAoSH.js → sizeCapture-X5ZJPWSS-Cr3Z0S8y.js} +1 -1
  62. package/dist/worker/console/static/assets/{stateDiagram-OKZ733FA-C4sGkf--.js → stateDiagram-OKZ733FA-BjJFC6pW.js} +1 -1
  63. package/dist/worker/console/static/assets/stateDiagram-v2-UEYNNEHI-Bq44O9Nt.js +1 -0
  64. package/dist/worker/console/static/assets/{swimlanes-SLNWSIFB-ByxJrUzW.js → swimlanes-SLNWSIFB-DeMUJQiW.js} +2 -2
  65. package/dist/worker/console/static/assets/swimlanesDiagram-ULZ7WXOC-BT4tWyW3.js +8 -0
  66. package/dist/worker/console/static/assets/{timeline-definition-Z64GVDOM-D8MLgM0O.js → timeline-definition-Z64GVDOM-Bc2Rv2Oo.js} +1 -1
  67. package/dist/worker/console/static/assets/{vennDiagram-T6HMQDX7-DnBis-wZ.js → vennDiagram-T6HMQDX7-CDhRUeqG.js} +1 -1
  68. package/dist/worker/console/static/assets/{wardleyDiagram-T6FBY63Y-uuyYT7UO.js → wardleyDiagram-T6FBY63Y-DaN_z3Xy.js} +1 -1
  69. package/dist/worker/console/static/assets/{xychartDiagram-ELKLHX3M-BjgabhwK.js → xychartDiagram-ELKLHX3M-C1vTLBDG.js} +1 -1
  70. package/dist/worker/console/static/index.html +2 -2
  71. package/dist/worker/console/static-src/app/useRecoveryConsole.js +38 -2
  72. package/dist/worker/console/static-src/app/useRunProgress.js +46 -0
  73. package/dist/worker/console/static-src/operator-chat/cards/failure-category-advice.js +25 -0
  74. package/dist/worker/console/static-src/operator-chat/input-history.js +76 -0
  75. package/dist/worker/console/static-src/operator-chat/turn-submission.js +13 -1
  76. package/dist/worker/console/static-src/operator-chat/useChatStream.js +29 -9
  77. package/dist/worker/console/static-src/operator-chat/useComposer.js +32 -0
  78. package/dist/worker/console/static-src/pages/tasks/run-id-resolution.js +79 -0
  79. package/dist/worker/console/static-src/pages/tasks/run-ownership-verify.js +23 -0
  80. package/dist/worker/console/static-src/pages/tasks/run-panel-progress.js +110 -0
  81. package/dist/worker/materialize/harness-task-lineage.js +5 -2
  82. package/dist/worker/observability/read-model.js +22 -0
  83. package/dist/workflows/dag/dynamic-runtime/loop-until.js +1 -1
  84. package/dist/workflows/dag/dynamic-runtime/map.js +1 -1
  85. package/dist/workflows/dag/failure-category.js +7 -128
  86. package/dist/workflows/dag/frontend-design-policy.js +12 -7
  87. package/dist/workflows/dag/frontend-implementation-contract.js +4 -1
  88. package/dist/workflows/dag/frontend-shadow-dual-write.js +24 -10
  89. package/dist/workflows/dag/frontend-test-case-checklist.js +4 -2
  90. package/dist/workflows/dag/frontend-test-case-manifest.js +6 -4
  91. package/dist/workflows/dag/frontend-test-case-quality.js +6 -3
  92. package/dist/workflows/dag/frontend-test-environment-probe.js +10 -7
  93. package/dist/workflows/dag/frontend-test-html-report.js +3 -1
  94. package/dist/workflows/dag/frontend-test-l5-report.js +3 -1
  95. package/dist/workflows/dag/frontend-test-layout.js +159 -0
  96. package/dist/workflows/dag/frontend-test-result-contract.js +28 -14
  97. package/dist/workflows/dag/frontend-test-standard-scenarios.js +3 -1
  98. package/dist/workflows/dag/init-hybrid.js +59 -14
  99. package/dist/workflows/dag/node-execution.js +11 -1
  100. package/dist/workflows/dag/retry-policy.js +10 -0
  101. package/dist/workflows/dag/types.js +12 -0
  102. package/dist/workflows/dag/validate.js +23 -19
  103. package/docs/templates/frontend-test-case-checklist.md +2 -2
  104. package/package.json +1 -1
  105. package/skills/fe-test-ui-scout/SKILL.md +4 -4
  106. package/skills/fe-test-ui-scout/references/ledger-schema.md +1 -1
  107. package/skills/playwright-cli/SKILL.md +1 -1
  108. package/skills/playwright-cli-case-generator/SKILL.md +10 -8
  109. package/dist/worker/console/static/assets/channel-BuqaGKAT.js +0 -1
  110. package/dist/worker/console/static/assets/classDiagram-JCYQIIEL-DNdSHjH9.js +0 -1
  111. package/dist/worker/console/static/assets/classDiagram-v2-OCEON4UE-DNdSHjH9.js +0 -1
  112. package/dist/worker/console/static/assets/index-DBbhESQ_.css +0 -1
  113. package/dist/worker/console/static/assets/stateDiagram-v2-UEYNNEHI-B8rmop_9.js +0 -1
  114. package/dist/worker/console/static/assets/swimlanesDiagram-ULZ7WXOC-B0ky-kBM.js +0 -8
package/CHANGELOG.md CHANGED
@@ -6,6 +6,10 @@
6
6
 
7
7
  ### 重点更新
8
8
 
9
+ - 修复 Console 四处评审缺陷(合并前收口):① 向导「运行」进度块接通——`runDag` 只返回 operationId,原实现读的 `recovery.dagRunId` 在向导路径永远为空;现在确认页先快照基线 run、进入运行页后轮询 `observeLink`,以 (taskId, operationId) 任一变化为失效信号(operationId 覆盖「重新运行」按钮——它不改变向导步骤;taskId 覆盖运行步骤中手动改任务 ID 的场景,失效时基线一并重置,避免沿用上一任务的 run):新派发/切任务会清掉旧选中 run 并重新解析,**只接受与当前任务基线不同的新 run**;从 Recovery 带回的共享选中 run 先做归属校验——`GET /api/dag-runs/:id` 详情响应新增 `taskId` 投影(源自 run.json 的 `taskContractBinding`→`sourceBinding`→Hybrid 标题,与 observeLink/candidates 同一绑定真源,不受候选列表 limit 截断影响;404 视为失效选中、无绑定视为不可判定),非本任务的 run 不展示;校验全程由 effect 生命周期栅栏保护——任务/运行/选中在异步校验期间变化时,旧响应直接丢弃、不会改写新状态;校验暂不可用时按有界退避(2s→30s,约 2 分钟)自动重试而非被动等待状态变化,重试计划为纯函数并有行为测试;**展示层另有闸门**——进度面板与运行操作只消费「本解析器已采纳/已验证」的 run(组件 state),未验证期间(校验中、重试中、give-up 后)进度面板保持空缺,不会即时或永久显示其他任务的 DAG;「打开检视」「侧栏预览」两个入口同样双重门禁(按钮无已验证 run 即禁用 + 处理器复核 verifiedRunId),共享的 openInspectSplit 解析器不再能带出未验证的外来 run。解析决策本身抽取为纯状态机 `pages/tasks/run-id-resolution.ts`(首跑/重跑/切任务/外来选中/基线门控五类迁移),Effects 只做薄适配,主流程「确认页基线快照 → runDag 派发 → observeLink 轮询 → 新 run 采纳」有完整行为测试。基线快照为三态(成功/权威无运行/暂不可查),**查询失败不会被当成「没有历史运行」**——快照重试期间基线保持未知、探测轮询等待,不会把旧运行误判为新运行;新 run 创建失败或注册较慢时进度面板宁可空缺也不把上一次已终止的 DAG 当作当前运行(轮询上限 5 分钟后安静停止)。② 失败建议数据契约修正——旅程卡原先把原始 run 级 `failureCategory` 直接查归一化建议表(`missing-api-key`/`nonzero-exit` 等永远查不中,节点分类又在安全投影中被丢弃);现在纯分类核心下沉 `src/shared/dag-failure-category.ts`(console↔workflows 双向共享叶,不破坏 console 禁止 import workflows 的边界测试),服务端投影把 run 级与节点级分类都归一化输出(success/skipped 不出),卡片按「失败节点分类优先、run 级兜底」取值,失败卡始终有可操作建议。③ Recovery interrupt 资格轮询在运行中档位同步刷新 run 状态——原先状态只在选中时读一次,运行中的 run 结束后仍永久保持 4 秒快轮询;现在 4 秒档附带轻量 `GET /api/dag-runs/:id` 刷新 `effectiveStatus`,终态后自动退到 30 秒。④ Inspect 紧凑检视一次瞬时刷新失败不再永久显示错误——成功刷新回合会清除上一轮 error 横幅。
10
+ - Operator Chat 输入框两项交互增强:① **↑/↓ 历史输入召回**——每次发送的文本进入输入历史(连续重复折叠、上限 100 条),光标在首行按 ↑ 逐条向旧回溯、按 ↓ 向新前进,越过最新一条时恢复回溯前**未发送的草稿**(草稿不会被历史浏览冲掉);多行文本中部的方向键仍是普通光标移动,IME 组词与 @文件/命令面板打开时不抢占。② **运行中排队下一轮指令**——当前回合运行中 Enter 不再被吞掉,消息作为「排队消息」绑定当前 Turn(服务端 `PUT deferred-turn` 从仅限 stopping 放开为 running/stopping,错误码 `TURN_NOT_STOPPING`→`TURN_NOT_ACTIVE`),当前回合结束(正常完成或停止)后自动发送;排队条提供「立即发送」(停止当前回复并立即发出)、「编辑」(移回输入框改写后再排)、「删除」三种操作,运行中输入框右侧提供排队发送按钮(与停止按钮并列);排队条单行展示(状态 + 省略号预览 + 操作按钮一行),输入框默认一行高(自动增高上限 280px 不变)。
11
+ - 向导「运行」面板结构化与预期管理(A2/C9):新增实时运行进度块——节点完成计数与百分比进度条(含 progressbar 无障碍语义)、当前运行节点名称与已运行时长、失败节点与错误摘要,数据来自 `/api/dag-runs/:id` 每 5 秒轮询并在终态自动停止;`effectiveStatus=running-suspected-stall` 时显示橙色「疑似停滞」提示条(建议打开检视查看节点活动或到恢复页协作中止/诊断),把 20–40 分钟长跑的「日志噪音等待」变为有阶段感、可判断的等待。原始 SSE 事件日志默认折叠为「原始事件日志(最近 80 条)」,需要排查时再展开。
12
+ - Console 前端三项体验优化(P0/P2):① Recovery 页 DAG 紧凑检视侧栏(InspectSplitPanel)从一次性快照改为实时刷新——运行中每 5 秒自动拉取节点/事件并新增「进行中/已结束」刷新状态行,到达终态(finished/failed/partial_failed/superseded/abandoned)自动停止轮询,刷新轮不清空既有内容避免闪烁;② Chat 任务旅程卡失败态新增按归一化 failureCategory 的可操作「建议」行(validation/executor/write-guard/timeout/auth/human-required/human-rejected/shell-command/static-error/decision-envelope/unknown 各映射到具体下一步:从失败节点重跑、修正契约后重新生成、跳「模型与认证」页等),不再只报「原因分类为 X」;③ Recovery 页 interrupt 资格轮询退避:选中 run 已终态(含 interrupted)时从 4 秒降到 30 秒,运行中保持 4 秒。
9
13
  - Console「设置」页新增「模型配置(models.json)」区块:以弹框形式增/改/删 Pi 的模型条目,支持 6 个定义字段(id、name、contextWindow、maxTokens、input、reasoning)。新增时 Provider 用下拉选择、其余字段自动补默认值;编辑时 Provider 只读且仅在原位置就地替换,只改表单内字段、不覆盖配置里页面未展示的其它字段(如 cost/compat);不读写 API key(凭据走 Pi CLI)。编辑已存在的模型不再被移到最后。
10
14
  - 前端风险分级细分 manifest 触及语义:`allowedPaths` 含 `package.json`/lockfile 或需求文本提到 package.json 不再单独触发 `new-dependency` high-risk(改一行 script、调构建参数的任务不再被顶到强制全门禁并误标高风险),只有任务文本同时出现安装语言(npm install / yarn add / pnpm add / 新增依赖等)才升级;仅路径触及时记 `new-dependency:manifest-path-without-install-language` 拒绝信号,审计可溯。
11
15
  - 前端验证 fallback 生成期诚实化:真实项目无可读取的 `package.json` scripts 且未探测到本地 tsc 时,不再注入必然失败的 `npm run typecheck` / `npm run build` / `npm test`(纯静态 / vanilla JS 站点原会在 verify 阶段假失败),改为执行显式 no-op 标记命令(`No frontend verification command configured`,进入冻结命令集可被 contract 引用,trace 如实记录 not-run),并写生成期 advisory 提示用 `--verify` 或执行约束显式声明验证命令后重新生成 DAG。无 repoRoot 的单测 fixture 保留历史 generic fallback。**标记不构成验证证据(fail-closed)**:verification trace 将绑定标记的 target 判为失败、只含标记的 static 证据判为 unavailable,repair 分类归为 non-repairable `contract`,verify 节点以 `frontend verification unavailable` 硬失败阻断 review/closeout——无真实验证命令的 run 无法走完绿灯链。
@@ -31,6 +35,7 @@
31
35
  ### 新增
32
36
 
33
37
  - Operator Chat 时间线左缘新增「用户消息锚点栏」:每个用户输入一枚横向小条(12×3px 微圆角),紧凑等距排列并在时间线高度内垂直居中;条数超出栏高时相邻锚点自动聚合为稍宽的聚合条(悬停展开「N 条聚合输入」逐条列表,时间 + 单行预览,逐条点击定位)。悬停时小条向对话一侧平滑伸长(12→18px)并变橙,浮窗右侧弹出(白底圆角,正文最多 3 行、超出省略号,附序号与时间);单击平滑滚动定位到对应消息(精确停靠在视口顶部偏移 8px);覆盖视口顶部的锚点保持高亮。空会话自动隐藏;历史分页/流式更新/窗口缩放时自动重算(rAF 节流)。
38
+ - frontend-test 产物根可配置:`task.json.frontendTest.testRoot` 缺省仍为 `testcase/frontend`,省略时生成的 DAG 路径与历史默认根一致;自定义根(如 `qa/frontend-test`)在编译期冻结并驱动 writer、gate、playwright 围栏与 `allowedPaths`。`.harness/**` 等隐藏/治理树在生成期拒绝。
34
39
  - 实验能力「编辑失败节点提示词后从节点重跑」(默认关闭):内部开关 `HARNESS_DAG_RERUN_PROMPT_OVERRIDE=1` 启用后,`dag rerun` 支持 `--prompt-override <nodeId>@<file>`(全文替换)与 `--prompt-override-append <nodeId>@<file>`(追加指令:保留冻结原提示词,末尾追加 `<operator_addendum>` 块)。仅限 ERROR 且位于 reset closure 内的节点;mode + base/最终 prompt sha256 计入 planHash(execute 漂移即 `PLAN_DRIFT`),父 run spec 冻结、provenance(含 mode)落 `continuation.promptOverrides`。Console 新增 `dagPromptOverrideConfig` 开关探测 action,`dagRerunPlan`/`dagRerun` 接受 `promptOverrides`(`{nodeId, prompt, mode?}`);Inspect DAG 节点 inspector 新增「提示词重启」tab——默认「追加指令」模式(只读底稿 + 追加编辑器),可切换「全文替换(高级)」,预检通过展示执行估算,提交后续跑并跳转新 run,全程不离开图页;开关开启时 `/inspect` 只注入 **scoped** 变体凭据(独立 cookie + `__INSPECT_MUTATION_TOKEN__`,与 Console 通用 token 互不可重放),mutations 路由对 inspect 凭据仅放行 `dagRerunPlan`/`dagRerun`(其余 action 403 `ACTION_NOT_IN_INSPECT_SCOPE`),Inspect 不获得通用写能力;开关关闭时不注入任何 token、tab 不出现,检视面保持严格只读。
35
40
  - 观察面 DAG Inspector 节点详情适配 Pi 扩展:执行器输入摘要展示节点声明的 `piExtensions` 短 id;新增「Pi 扩展运行事实」展示 `pi-extensions.json` 的 resolved(包名@版本)与 missing 降级原因(缺包降级不再静默);产物未生成/损坏时降级提示不阻断接口,绝对路径不外泄。
36
41
  - 后端实现 DAG(standard / review-gated / supervised)的 Pi 节点支持按桶显式加载本机 Pi 导航扩展:读侧节点(除 closeout)加载 `pi-codegraph` + `pi-lens`,写侧节点只加载 `pi-codegraph`(pi-lens 的 `ast_grep_replace` 可绕过 writeSet,不加载);前端/测试模板与省略字段节点保持扩展全关。扩展发现始终关闭,只经白名单解析 `~/.pi/agent` 与项目 `.pi` settings 的已装包(缺包降级不失败,产物 `pi-extensions.json` 记录 requested/resolved/missing);session 后 pin 工具面剔 builtin 同名、deny 面与写工具,writer 的 `edit`/`write` 仍为 policy-wrapped;`.codegraph/**` index 同步不再计入 write-guard 越界。
@@ -1,6 +1,6 @@
1
1
  {
2
2
  "schemaVersion": 1,
3
- "version": "0.39.0-beta.5",
4
- "gitSha": "0981b80311d973603a870fd80693331cb5e48335",
5
- "builtAt": "2026-08-23T11:38:56.113Z"
3
+ "version": "0.39.0-beta.6",
4
+ "gitSha": "740f411873839c25833d8d41d0ee74d0285f7082",
5
+ "builtAt": "2026-08-23T14:01:39.565Z"
6
6
  }
@@ -15,6 +15,7 @@ import { GitStatusUnavailableError, pathsChangedDuringRun, readGitStatusPorcelai
15
15
  import { isTargetTemplateTransientRetryNode, isWriterEmptyDiffRetryCandidate, isWriterTransportRetryCandidate, INCOMPLETE_WRITE_SET_RETRY_CATEGORY, WRITER_CLEAN_TIMEOUT_RETRY_CATEGORY, WRITER_EMPTY_DIFF_RETRY_CATEGORY, } from "../workflows/dag/retry-policy.js";
16
16
  import { assessBackendTestMdPlanCompleteness, assessBackendTestMdWriterCompleteness, assessBackendTestPytestPlanCompleteness, assessBackendTestPytestWriterCompleteness, assessBackendTestShardChildCompleteness, backendTestWriterProgressRoleForTask, classifyBackendTestWriterCompletenessFailure, isBackendTestCompletenessRetryCandidate, isBackendTestMdPlanTask, isBackendTestPytestPlanTask, isBackendTestShardChildTask, writeBackendTestWriterProgressArtifacts, } from "../workflows/dag/backend-test-writer-completeness.js";
17
17
  import { resolveBackendTestLayout } from "../workflows/dag/backend-test-layout.js";
18
+ import { frontendTestLayoutFromSpec, } from "../workflows/dag/frontend-test-layout.js";
18
19
  import { redactSecrets, truncateUtf8Preview } from "../shared/preview.js";
19
20
  /**
20
21
  * Writer classification for a length-stopped thinking-only attempt: the model
@@ -324,6 +325,49 @@ export function scanReviewTerminalKindsFromSessionEvents(content) {
324
325
  }
325
326
  return kinds;
326
327
  }
328
+ /** Read-only discovery tool budget for frontend-plan-pi. Exceeding it means
329
+ * the plan re-read upstream outputs/sources instead of trusting typed facts,
330
+ * which blows up the context window (400 request-too-large). */
331
+ const PLAN_READ_TOOL_BUDGET = 40;
332
+ /** Deterministic read-burst guard for frontend-plan-pi: count read-only
333
+ * discovery tool calls (read/grep/ls/find) from the session log. Over budget →
334
+ * read-burst, retried with a reduced-reading instruction. Pure scan; a
335
+ * successful plan under budget is never blocked. */
336
+ export async function detectPlanReadBurst(input) {
337
+ const sessionEventsPath = path.join(input.runDir, input.nodeId, "session-events.jsonl");
338
+ let count = 0;
339
+ try {
340
+ const content = await readFile(sessionEventsPath, "utf8");
341
+ for (const line of content.split("\n")) {
342
+ if (!line.trim())
343
+ continue;
344
+ try {
345
+ const event = JSON.parse(line);
346
+ if (event.type === "tool_execution_start" &&
347
+ typeof event.toolName === "string" &&
348
+ (event.toolName === "read" ||
349
+ event.toolName === "grep" ||
350
+ event.toolName === "ls" ||
351
+ event.toolName === "find")) {
352
+ count += 1;
353
+ }
354
+ }
355
+ catch {
356
+ // skip unparseable line
357
+ }
358
+ }
359
+ }
360
+ catch {
361
+ // Missing/unreadable session log → no burst detection
362
+ return [];
363
+ }
364
+ if (count > PLAN_READ_TOOL_BUDGET) {
365
+ return [
366
+ `frontend plan read-burst: ${count} read-only tool calls (budget ${PLAN_READ_TOOL_BUDGET}). Trust the upstream contract/scout typed facts; do not re-read contract/scout outputs or source files already captured. Minimize discovery reads, commit record_* facts directly, then finalize_plan.`,
367
+ ];
368
+ }
369
+ return [];
370
+ }
327
371
  export const FRONTEND_DESIGN_TERMINAL_TOOL_NAMES = new Set([
328
372
  "approve_design",
329
373
  "request_design_changes",
@@ -654,7 +698,9 @@ export async function createFrontendPlanLedgerTools(input) {
654
698
  const optionalStringArray = Type.Optional(stringArray);
655
699
  const requirementSchema = Type.Object({
656
700
  id: Type.String({}),
657
- expectedOutcome: Type.String({}),
701
+ expectedOutcome: Type.Optional(Type.String({
702
+ description: "Optional. When omitted, the runtime derives it from the contract requirement. Prefer omitting it to keep this tool call small.",
703
+ })),
658
704
  implementationTargets: stringArray,
659
705
  verificationTargetIds: stringArray,
660
706
  evidenceGap: Type.Optional(Type.Object({
@@ -706,7 +752,7 @@ export async function createFrontendPlanLedgerTools(input) {
706
752
  commandLabel: Type.String({}),
707
753
  file: Type.String({}),
708
754
  symbol: Type.Optional(Type.String({
709
- description: "Real exported identifier or describe/it title in the target file. Forbidden for type=static (runtime strips it); required for non-static targets.",
755
+ description: "Optional. Real exported identifier or describe/it title in the target file. Omit it to keep the call small — the trace gate then only verifies the file exists and the command ran. Forbidden for type=static (runtime strips it).",
710
756
  })),
711
757
  requirementIds: stringArray,
712
758
  uiStates: stringArray,
@@ -795,9 +841,9 @@ export async function createFrontendPlanLedgerTools(input) {
795
841
  const recordTargetSurfaceTool = defineTool({
796
842
  name: "record_target_surface",
797
843
  label: "record_target_surface",
798
- description: "Record the plan target surface (routes + files) as an origin=plan target-surface fact.",
799
- promptSnippet: "Record the plan target surface fact.",
800
- parameters: Type.Object({ targets: Type.Optional(targetsSchema), files: stringArray }, { additionalProperties: false }),
844
+ description: "Record the plan target surface (routes only) as an origin=plan target-surface fact. files are owned by the runtime skeleton / scout — omit them.",
845
+ promptSnippet: "Record the plan target surface (routes) fact.",
846
+ parameters: Type.Object({ targets: Type.Optional(targetsSchema), files: optionalStringArray }, { additionalProperties: false }),
801
847
  async execute(_toolCallId, params) {
802
848
  const routes = stringList(params?.targets?.routes);
803
849
  const files = stringList(params?.files);
@@ -808,24 +854,28 @@ export async function createFrontendPlanLedgerTools(input) {
808
854
  const recordComponentChoiceTool = defineTool({
809
855
  name: "record_component_choice",
810
856
  label: "record_component_choice",
811
- description: "Record component choices and styling strategy as an origin=plan component-choice fact.",
812
- promptSnippet: "Record the plan component-choice fact.",
857
+ description: "Record ONE component choice (origin=plan component-choice fact). Only declare components you add or replace; reuse of existing components needs no entry. Omit rationale for reuse-existing; it is optional. Call once per component — one tool call per message. Optionally include stylingStrategy (set it once, on the first call).",
858
+ promptSnippet: "Record one component choice (one tool call per message).",
813
859
  parameters: Type.Object({
814
- uiComponentChoices: Type.Optional(Type.Array(uiComponentChoiceSchema)),
860
+ choice: uiComponentChoiceSchema,
815
861
  stylingStrategy: optionalString,
816
862
  }, { additionalProperties: false }),
817
863
  async execute(_toolCallId, params) {
818
- const uiComponentChoices = Array.isArray(params?.uiComponentChoices)
819
- ? params.uiComponentChoices
820
- : [];
821
- const components = uiComponentChoices
822
- .map((choice) => typeof choice?.component === "string" ? choice.component : "")
823
- .filter(Boolean);
864
+ const rawChoice = params?.choice;
865
+ if (!isRecordObject(rawChoice)) {
866
+ return planToolReceipt({
867
+ ok: false,
868
+ kind: "component-choice",
869
+ error: "record_component_choice requires a non-empty choice object",
870
+ });
871
+ }
872
+ const choice = rawChoice;
873
+ const components = typeof choice.component === "string" ? [choice.component] : [];
824
874
  const result = await adoptPlanFact("component-choice", `${attemptId}:record_component_choice:${randomUUID()}`, {
825
875
  kind: "component-choice",
826
876
  origin: "plan",
827
877
  components,
828
- uiComponentChoices,
878
+ uiComponentChoices: [choice],
829
879
  ...(params?.stylingStrategy
830
880
  ? { stylingStrategy: params.stylingStrategy }
831
881
  : {}),
@@ -934,8 +984,8 @@ export async function createFrontendPlanLedgerTools(input) {
934
984
  const recordPlanRequirementTool = defineTool({
935
985
  name: "record_plan_requirement",
936
986
  label: "record_plan_requirement",
937
- description: "Commit one plan requirement entry (origin=plan plan-requirement fact). Call once per requirement; each entry carries id, expectedOutcome, implementationTargets, verificationTargetIds, and optional evidenceGap.",
938
- promptSnippet: "Commit one plan requirement entry.",
987
+ description: "Commit one plan requirement entry (origin=plan plan-requirement fact). Call once per requirement; entry carries id, implementationTargets, verificationTargetIds, and optional expectedOutcome (omit it — the runtime derives the outcome text from the contract requirement). IMPORTANT: call this tool exactly ONE time per assistant message — never batch multiple record_* calls together in one message; emit one call, wait for its result, then call the next.",
988
+ promptSnippet: "Commit one plan requirement entry (one tool call per message).",
939
989
  parameters: Type.Object({
940
990
  entry: requirementSchema,
941
991
  }, { additionalProperties: false }),
@@ -956,8 +1006,8 @@ export async function createFrontendPlanLedgerTools(input) {
956
1006
  const recordPlanVerificationTargetTool = defineTool({
957
1007
  name: "record_plan_verification_target",
958
1008
  label: "record_plan_verification_target",
959
- description: "Commit one plan verification target entry (origin=plan plan-verification-target fact). Call once per target; entry carries id, type, commandLabel, file, symbol, requirementIds, uiStates.",
960
- promptSnippet: "Commit one plan verification target entry.",
1009
+ description: "Commit one plan verification target entry (origin=plan plan-verification-target fact). Call once per target; entry carries id, type, commandLabel, file, requirementIds, uiStates, and optional symbol (omit it — the trace gate verifies the file and command, not a symbol). IMPORTANT: call this tool exactly ONE time per assistant message — never batch multiple record_* calls together in one message; emit one call, wait for its result, then call the next.",
1010
+ promptSnippet: "Commit one plan verification target entry (one tool call per message).",
961
1011
  parameters: Type.Object({
962
1012
  entry: verificationTargetSchema,
963
1013
  }, { additionalProperties: false }),
@@ -978,8 +1028,8 @@ export async function createFrontendPlanLedgerTools(input) {
978
1028
  const recordPlanEvidenceGapTool = defineTool({
979
1029
  name: "record_plan_evidence_gap",
980
1030
  label: "record_plan_evidence_gap",
981
- description: "Commit one plan evidence gap entry (origin=plan plan-evidence-gap fact). Call once per gap; entry carries requirementId, description, blocking.",
982
- promptSnippet: "Commit one plan evidence gap entry.",
1031
+ description: "Commit one plan evidence gap entry (origin=plan plan-evidence-gap fact). Call once per gap; entry carries requirementId, description, blocking. IMPORTANT: call this tool exactly ONE time per assistant message — never batch multiple record_* calls together in one message; emit one call, wait for its result, then call the next.",
1032
+ promptSnippet: "Commit one plan evidence gap entry (one tool call per message).",
983
1033
  parameters: Type.Object({
984
1034
  entry: evidenceGapSchema,
985
1035
  }, { additionalProperties: false }),
@@ -1949,10 +1999,11 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
1949
1999
  throw new Error(`unknown command capability: ${capability}`);
1950
2000
  }
1951
2001
  if (capability === "playwright-cli") {
1952
- const caseId = resolveCaseIdFromWriteSet(input.task.writeSet) ??
2002
+ const layout = frontendTestLayoutFromSpec(meta.spec);
2003
+ const caseId = resolveCaseIdFromWriteSet(input.task.writeSet, layout) ??
1953
2004
  input.task.id;
1954
- const evidenceDir = resolveEvidenceDirFromWriteSet(input.task.writeSet) ??
1955
- `testcase/frontend/evidence/${caseId}`;
2005
+ const evidenceDir = resolveEvidenceDirFromWriteSet(input.task.writeSet, layout) ??
2006
+ `${layout.evidenceDir}/${caseId}`;
1956
2007
  playwrightToolContext = {
1957
2008
  repoRoot: input.cwd,
1958
2009
  runDir: meta.runDir,
@@ -1960,7 +2011,8 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
1960
2011
  caseId,
1961
2012
  evidenceDir,
1962
2013
  baseUrl: await resolveValidatedFrontendBaseUrlFromContext(input.cwd, meta.runDir),
1963
- inputRoot: "testcase/frontend/fixtures",
2014
+ inputRoot: layout.fixturesDir,
2015
+ layout,
1964
2016
  };
1965
2017
  // Cleanup must be confirmed before a new case; otherwise default-session
1966
2018
  // isolation is unknown and no Pi invocation is permitted.
@@ -2272,6 +2324,23 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
2272
2324
  catch {
2273
2325
  // best-effort flush; missing ledger still fails at the node validator
2274
2326
  }
2327
+ // Read-burst guard: a plan that burned dozens of read/grep/ls/find
2328
+ // calls (re-reading upstream outputs and source files it should trust
2329
+ // from typed facts) blows up the context window and eventually fails
2330
+ // with 400 request-too-large. Detect it deterministically from the
2331
+ // session log and retry with a reduced-reading instruction.
2332
+ const readBurstIssues = await detectPlanReadBurst({
2333
+ runDir: meta.runDir,
2334
+ nodeId: input.task.id,
2335
+ });
2336
+ if (readBurstIssues.length > 0) {
2337
+ return {
2338
+ ...mapped,
2339
+ ok: false,
2340
+ failureCategory: "read-burst",
2341
+ stderr: [mapped.stderr, ...readBurstIssues].filter(Boolean).join("\n\n"),
2342
+ };
2343
+ }
2275
2344
  }
2276
2345
  if (!isWriteTask) {
2277
2346
  return mapped;
@@ -5,6 +5,7 @@ import path from "node:path";
5
5
  import { processTreeSpawnOptions, terminateProcessTree, } from "./process-tree.js";
6
6
  import { resolvePlaywrightCliLauncher } from "./playwright-cli-launcher.js";
7
7
  import { PLAYWRIGHT_CLI_ALLOWED_COMMANDS, isPlaywrightCliCommand, parsePlaywrightCliFindMatchCount, } from "../shared/playwright-cli-command-policy.js";
8
+ import { defaultFrontendTestLayout, escapeRegexLiteral, } from "../workflows/dag/frontend-test-layout.js";
8
9
  export { PLAYWRIGHT_CLI_ALLOWED_COMMANDS, isPlaywrightCliCommand, };
9
10
  /** Logical capability name only; execution always uses the verified JS launcher. */
10
11
  export const PLAYWRIGHT_CLI_EXECUTABLE = "playwright-cli";
@@ -267,7 +268,8 @@ function validateOpenArgs(args, baseUrl) {
267
268
  }
268
269
  function resolveEvidenceRelative(rawPath, ctx) {
269
270
  const evidenceDir = normalizePosix(ctx.evidenceDir).replace(/\/$/, "");
270
- const evidencePrefix = `testcase/frontend/evidence/${ctx.caseId}`;
271
+ const layout = ctx.layout ?? defaultFrontendTestLayout();
272
+ const evidencePrefix = `${layout.evidenceDir}/${ctx.caseId}`;
271
273
  if (!(evidenceDir === evidencePrefix ||
272
274
  evidenceDir.startsWith(`${evidencePrefix}/`))) {
273
275
  throw new PlaywrightCliPolicyError("evidence-dir-invalid", `evidenceDir must be under ${evidencePrefix}`);
@@ -291,7 +293,7 @@ function resolveEvidenceRelative(rawPath, ctx) {
291
293
  if (candidate.startsWith(`${evidenceDir}/`) || candidate === evidenceDir) {
292
294
  return candidate;
293
295
  }
294
- if (candidate.startsWith("testcase/frontend/evidence/") &&
296
+ if (candidate.startsWith(`${layout.evidenceDir}/`) &&
295
297
  !candidate.startsWith(`${evidencePrefix}/`)) {
296
298
  throw new PlaywrightCliPolicyError("path-cross-case", "output path escapes current case evidenceDir");
297
299
  }
@@ -472,11 +474,12 @@ function assertInputPathAllowed(rawPath, ctx) {
472
474
  if (!isSafeRelativePosix(candidate)) {
473
475
  throw new PlaywrightCliPolicyError("input-path-unsafe", `unsafe input path: ${rawPath}`);
474
476
  }
477
+ const layout = ctx.layout ?? defaultFrontendTestLayout();
475
478
  const allowedPrefixes = [
476
- `testcase/frontend/evidence/${ctx.caseId}/`,
477
- "testcase/frontend/cases/",
478
- "testcase/frontend/rag/",
479
- "testcase/frontend/fixtures/",
479
+ `${layout.evidenceDir}/${ctx.caseId}/`,
480
+ `${layout.casesDir}/`,
481
+ `${layout.ragDir}/`,
482
+ `${layout.fixturesDir}/`,
480
483
  ];
481
484
  if (!allowedPrefixes.some((prefix) => candidate === prefix.slice(0, -1) || candidate.startsWith(prefix)) &&
482
485
  !candidate.startsWith(normalizePosix(ctx.evidenceDir) + "/")) {
@@ -629,8 +632,8 @@ async function validatePlaywrightCliOutputPath(command, args, ctx) {
629
632
  if (!outputFilename)
630
633
  return;
631
634
  const repoRoot = path.resolve(ctx.repoRoot);
632
- const caseEvidenceRoot = path.resolve(repoRoot, "testcase", "frontend", "evidence", ctx.caseId);
633
- const evidenceDir = path.resolve(repoRoot, ctx.evidenceDir);
635
+ const caseEvidenceRoot = path.resolve(repoRoot, ctx.evidenceDir);
636
+ const evidenceDir = caseEvidenceRoot;
634
637
  const target = path.resolve(repoRoot, outputFilename);
635
638
  if (!pathIsContained(repoRoot, caseEvidenceRoot) ||
636
639
  !pathIsContained(caseEvidenceRoot, evidenceDir) ||
@@ -1024,22 +1027,26 @@ export async function createPlaywrightCliTool(ctx) {
1024
1027
  export const PI_COMMAND_CAPABILITY_REGISTRY = {
1025
1028
  "playwright-cli": createPlaywrightCliTool,
1026
1029
  };
1027
- export function resolveCaseIdFromWriteSet(writeSet) {
1030
+ export function resolveCaseIdFromWriteSet(writeSet, layout = defaultFrontendTestLayout()) {
1031
+ const prefix = layout.evidenceDir.replace(/\/$/, "");
1032
+ const escaped = escapeRegexLiteral(prefix);
1033
+ const exact = new RegExp(`^${escaped}/([^/]+)(?:/\\*\\*)?$`);
1034
+ const nested = new RegExp(`^${escaped}/([^/]+)/`);
1028
1035
  for (const entry of writeSet ?? []) {
1029
1036
  const normalized = normalizePosix(entry);
1030
- const match = normalized.match(/^testcase\/frontend\/evidence\/([^/]+)(?:\/\*\*)?$/);
1037
+ const match = normalized.match(exact);
1031
1038
  if (match?.[1] && match[1] !== "**" && match[1] !== "*") {
1032
1039
  return match[1];
1033
1040
  }
1034
- const nested = normalized.match(/^testcase\/frontend\/evidence\/([^/]+)\//);
1035
- if (nested?.[1])
1036
- return nested[1];
1041
+ const nestedMatch = normalized.match(nested);
1042
+ if (nestedMatch?.[1])
1043
+ return nestedMatch[1];
1037
1044
  }
1038
1045
  return undefined;
1039
1046
  }
1040
- export function resolveEvidenceDirFromWriteSet(writeSet) {
1041
- const caseId = resolveCaseIdFromWriteSet(writeSet);
1047
+ export function resolveEvidenceDirFromWriteSet(writeSet, layout = defaultFrontendTestLayout()) {
1048
+ const caseId = resolveCaseIdFromWriteSet(writeSet, layout);
1042
1049
  if (!caseId)
1043
1050
  return undefined;
1044
- return `testcase/frontend/evidence/${caseId}`;
1051
+ return `${layout.evidenceDir}/${caseId}`;
1045
1052
  }
@@ -39,6 +39,7 @@ import { materializeFrontendLintAssessment, materializeFrontendLintBaseline, } f
39
39
  import { formatTraceabilityGateStdout, materializeBackendTestCaseManifest, runBackendTestTraceabilityGate, } from "../workflows/dag/backend-test-case-manifest.js";
40
40
  import { materializeBackendTestExecutionContract } from "../workflows/dag/backend-test-execution-contract.js";
41
41
  import { resolveBackendTestLayout } from "../workflows/dag/backend-test-layout.js";
42
+ import { frontendTestLayoutFromSpec, } from "../workflows/dag/frontend-test-layout.js";
42
43
  import { backendTestGapDocSchema, ingestBackendTestGap, } from "../workflows/dag/backend-test-gap-fill.js";
43
44
  import { analyzeBackendTestCaseCoverage, analyzeBackendTestMarkdownPytestCorrespondence, materializeBackendTestCaseManifestFromFacts, } from "../workflows/dag/backend-test-case-coverage-analysis.js";
44
45
  import { materializeBackendTestResultFromPytestHtml, materializeBackendTestResultFromRunDir, parsePytestHtmlReport, } from "../workflows/dag/backend-test-result-contract.js";
@@ -2800,10 +2801,12 @@ async function executeFrontendCloseout(input, meta) {
2800
2801
  async function executeFrontendTestCaseChecklist(input, meta) {
2801
2802
  const started = Date.now();
2802
2803
  try {
2804
+ const layout = frontendTestLayoutFromSpec(meta.spec);
2803
2805
  const declaredAcIds = (meta.spec.sourceBinding?.requirementIds ?? []).filter((id) => /^AC(?:-[A-Z0-9]+)+$/i.test(id));
2804
2806
  const result = await validateFrontendCaseChecklist({
2805
2807
  workspaceRoot: input.cwd,
2806
2808
  declaredAcIds,
2809
+ layout,
2807
2810
  });
2808
2811
  if (result.issues.length) {
2809
2812
  return {
@@ -2838,6 +2841,7 @@ async function executeFrontendTestL5Report(input, meta) {
2838
2841
  const output = await renderFrontendTestL5Report({
2839
2842
  workspaceRoot: input.cwd,
2840
2843
  runDir: meta.runDir,
2844
+ layout: frontendTestLayoutFromSpec(meta.spec),
2841
2845
  });
2842
2846
  return {
2843
2847
  ok: true,
@@ -2863,6 +2867,7 @@ async function executeFrontendTestHtmlReport(input, meta) {
2863
2867
  const output = await renderFrontendTestHtmlReport({
2864
2868
  workspaceRoot: input.cwd,
2865
2869
  runDir: meta.runDir,
2870
+ layout: frontendTestLayoutFromSpec(meta.spec),
2866
2871
  });
2867
2872
  return {
2868
2873
  ok: true,
@@ -2882,11 +2887,12 @@ async function executeFrontendTestHtmlReport(input, meta) {
2882
2887
  };
2883
2888
  }
2884
2889
  }
2885
- async function executeFrontendTestStandardScenarios(input) {
2890
+ async function executeFrontendTestStandardScenarios(input, meta) {
2886
2891
  const started = Date.now();
2887
2892
  try {
2888
2893
  const result = await copyFrontendTestStandardScenarios({
2889
2894
  workspaceRoot: input.cwd,
2895
+ layout: frontendTestLayoutFromSpec(meta.spec),
2890
2896
  });
2891
2897
  return {
2892
2898
  ok: true,
@@ -2906,10 +2912,11 @@ async function executeFrontendTestStandardScenarios(input) {
2906
2912
  };
2907
2913
  }
2908
2914
  }
2909
- async function executeFrontendTestEnvironmentProbe(input) {
2915
+ async function executeFrontendTestEnvironmentProbe(input, meta) {
2910
2916
  const started = Date.now();
2911
2917
  const result = await probeFrontendTestEnvironment({
2912
2918
  workspaceRoot: input.cwd,
2919
+ layout: frontendTestLayoutFromSpec(meta.spec),
2913
2920
  });
2914
2921
  if (result.ok) {
2915
2922
  return {
@@ -2928,11 +2935,12 @@ async function executeFrontendTestEnvironmentProbe(input) {
2928
2935
  durationMs: Date.now() - started,
2929
2936
  };
2930
2937
  }
2931
- async function executeFrontendTestEvidenceValidation(input) {
2938
+ async function executeFrontendTestEvidenceValidation(input, meta) {
2932
2939
  const started = Date.now();
2933
2940
  try {
2934
2941
  const result = await validateFrontendCaseEvidence({
2935
2942
  workspaceRoot: input.cwd,
2943
+ layout: frontendTestLayoutFromSpec(meta.spec),
2936
2944
  });
2937
2945
  const output = `frontend case evidence validation cases=${result.cases} findings=${result.issues.length}${result.issues.length ? ` issues=${JSON.stringify(result.issues)}` : ""}`;
2938
2946
  if (result.hardFail) {
@@ -2971,6 +2979,7 @@ async function executeFrontendTestCaseManifest(input, meta) {
2971
2979
  const checklist = await validateFrontendCaseChecklist({
2972
2980
  workspaceRoot: input.cwd,
2973
2981
  declaredAcIds,
2982
+ layout: frontendTestLayoutFromSpec(meta.spec),
2974
2983
  });
2975
2984
  if (checklist.issues.length) {
2976
2985
  return {
@@ -2985,6 +2994,7 @@ async function executeFrontendTestCaseManifest(input, meta) {
2985
2994
  workspaceRoot: input.cwd,
2986
2995
  maxCases: gate.maxCases,
2987
2996
  declaredAcIds,
2997
+ layout: frontendTestLayoutFromSpec(meta.spec),
2988
2998
  });
2989
2999
  return {
2990
3000
  ok: true,
@@ -3023,6 +3033,7 @@ async function executeFrontendTestResultFinalize(input, meta) {
3023
3033
  try {
3024
3034
  const evidence = await validateFrontendCaseEvidence({
3025
3035
  workspaceRoot: input.cwd,
3036
+ layout: frontendTestLayoutFromSpec(meta.spec),
3026
3037
  });
3027
3038
  advisoryStdout = `frontend case evidence validation cases=${evidence.cases} findings=${evidence.issues.length}${evidence.issues.length ? ` issues=${JSON.stringify(evidence.issues)}` : ""}`;
3028
3039
  // Advisory findings must not block materialize; only hardFail (path escape) does.
@@ -3041,6 +3052,7 @@ async function executeFrontendTestResultFinalize(input, meta) {
3041
3052
  artifactName: "frontend-test-result.json",
3042
3053
  outputDir: "contracts",
3043
3054
  sourceBinding: meta.spec.sourceBinding,
3055
+ layout: frontendTestLayoutFromSpec(meta.spec),
3044
3056
  });
3045
3057
  return {
3046
3058
  ok: true,
@@ -3079,12 +3091,14 @@ async function executeFrontendTestReports(input, meta) {
3079
3091
  const l5 = await renderFrontendTestL5Report({
3080
3092
  workspaceRoot: input.cwd,
3081
3093
  runDir: meta.runDir,
3094
+ layout: frontendTestLayoutFromSpec(meta.spec),
3082
3095
  });
3083
3096
  lines.push(`Frontend L-5 report: ${l5.htmlPath}\nMarkdown: ${l5.markdownPath}\nStatus: ${l5.metrics.status}`);
3084
3097
  }
3085
3098
  const report = await renderFrontendTestHtmlReport({
3086
3099
  workspaceRoot: input.cwd,
3087
3100
  runDir: meta.runDir,
3101
+ layout: frontendTestLayoutFromSpec(meta.spec),
3088
3102
  });
3089
3103
  lines.push(`Frontend test report: ${report.htmlPath}\nMarkdown: ${report.markdownPath}\nOutcome: ${report.outcome}\nCases: ${report.caseCount}`);
3090
3104
  return {
@@ -3214,10 +3228,10 @@ async function executeDagShellNodeInner(input, meta) {
3214
3228
  }
3215
3229
  }
3216
3230
  if (shell?.frontendTestStandardScenarios) {
3217
- return executeFrontendTestStandardScenarios(input);
3231
+ return executeFrontendTestStandardScenarios(input, meta);
3218
3232
  }
3219
3233
  if (shell?.frontendTestEnvironmentProbe) {
3220
- return executeFrontendTestEnvironmentProbe(input);
3234
+ return executeFrontendTestEnvironmentProbe(input, meta);
3221
3235
  }
3222
3236
  if (shell?.frontendBrowserToolPreflight) {
3223
3237
  const started = Date.now();
@@ -3273,14 +3287,16 @@ async function executeDagShellNodeInner(input, meta) {
3273
3287
  label: "Pi SDK custom-tool 能力",
3274
3288
  ok: true,
3275
3289
  });
3290
+ const layout = frontendTestLayoutFromSpec(meta.spec);
3276
3291
  const toolProbe = await createPlaywrightCliTool({
3277
3292
  repoRoot: input.cwd,
3278
3293
  runDir: meta.runDir,
3279
3294
  nodeId: input.task.id,
3280
3295
  caseId: "frontend-browser-preflight",
3281
- evidenceDir: "testcase/frontend/evidence/frontend-browser-preflight",
3296
+ evidenceDir: `${layout.evidenceDir}/frontend-browser-preflight`,
3282
3297
  baseUrl: "http://localhost:5173/",
3283
- inputRoot: "testcase/frontend/fixtures",
3298
+ inputRoot: layout.fixturesDir,
3299
+ layout,
3284
3300
  });
3285
3301
  if (toolProbe.name !== "playwright_cli") {
3286
3302
  steps.push({
@@ -3431,7 +3447,7 @@ async function executeDagShellNodeInner(input, meta) {
3431
3447
  return executeFrontendTestCaseManifest(input, meta);
3432
3448
  }
3433
3449
  if (shell?.frontendTestEvidenceValidation) {
3434
- return executeFrontendTestEvidenceValidation(input);
3450
+ return executeFrontendTestEvidenceValidation(input, meta);
3435
3451
  }
3436
3452
  if (shell?.frontendTestResultFinalize) {
3437
3453
  return executeFrontendTestResultFinalize(input, meta);
@@ -3538,6 +3554,7 @@ async function executeDagShellNodeInner(input, meta) {
3538
3554
  artifactName: gate.artifactName,
3539
3555
  outputDir: gate.outputDir,
3540
3556
  sourceBinding: meta.spec.sourceBinding,
3557
+ layout: frontendTestLayoutFromSpec(meta.spec),
3541
3558
  });
3542
3559
  break;
3543
3560
  default: