@tea-agent/loop-agent 0.39.0-beta.4 → 0.39.0-beta.6
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/CHANGELOG.md +5 -0
- package/dist/build-stamp.json +3 -3
- package/dist/executors/dag-pi-executor.js +167 -31
- package/dist/executors/pi-playwright-cli-tool.js +23 -16
- package/dist/executors/shell-executor.js +25 -8
- package/dist/shared/dag-failure-category.js +138 -0
- package/dist/task/config-types.js +6 -0
- package/dist/task/source-references.js +22 -1
- package/dist/worker/console/chat/operation-card.js +8 -1
- package/dist/worker/console/chat/routes.js +5 -3
- package/dist/worker/console/inspect-split.js +18 -0
- package/dist/worker/console/operation-run-facts.js +19 -3
- package/dist/worker/console/static/assets/{abnfDiagram-N423BO3Z-zsNyvGaH.js → abnfDiagram-N423BO3Z-CfDSkLtp.js} +1 -1
- package/dist/worker/console/static/assets/{arc-BDjZ5kE1.js → arc-BlefM6I5.js} +1 -1
- package/dist/worker/console/static/assets/{architectureDiagram-T3A2C74G-BkgaujnN.js → architectureDiagram-T3A2C74G-C4tHfzHn.js} +1 -1
- package/dist/worker/console/static/assets/{blockDiagram-VBNYF7ZC-CqxOJi0j.js → blockDiagram-VBNYF7ZC-G-G77Rh1.js} +1 -1
- package/dist/worker/console/static/assets/{c4Diagram-5PPSVZJV-C2JHLdRi.js → c4Diagram-5PPSVZJV-DWgxmY72.js} +1 -1
- package/dist/worker/console/static/assets/channel-DsdX3ZUX.js +1 -0
- package/dist/worker/console/static/assets/{chunk-2GRJ4B5K-DF_YSvOS.js → chunk-2GRJ4B5K-CJQcfbCY.js} +1 -1
- package/dist/worker/console/static/assets/{chunk-2Q5K7J3B-D3Ort5Vo.js → chunk-2Q5K7J3B-vUPviH9y.js} +1 -1
- package/dist/worker/console/static/assets/{chunk-5RXB4S5H-XfAfZeUC.js → chunk-5RXB4S5H-DzRXSTeh.js} +1 -1
- package/dist/worker/console/static/assets/{chunk-5VM5RSS4-SLBibhf5.js → chunk-5VM5RSS4-CWfgqm07.js} +1 -1
- package/dist/worker/console/static/assets/{chunk-6Q2QTUOP-Dz29Ye_f.js → chunk-6Q2QTUOP-BtTDauXA.js} +1 -1
- package/dist/worker/console/static/assets/{chunk-GF5L2VYU-DB2G4H8V.js → chunk-GF5L2VYU-Bc-NNt84.js} +1 -1
- package/dist/worker/console/static/assets/{chunk-JWPE2WC7-CIoGkxdu.js → chunk-JWPE2WC7-B_f-emL4.js} +1 -1
- package/dist/worker/console/static/assets/{chunk-KBJHAD2P-CG78FGkn.js → chunk-KBJHAD2P-DV-jgJ66.js} +1 -1
- package/dist/worker/console/static/assets/{chunk-RYQCIY6F-ZDHAvXPd.js → chunk-RYQCIY6F-DMqzn4RZ.js} +1 -1
- package/dist/worker/console/static/assets/{chunk-XXDRQBXY-BKkkC4VA.js → chunk-XXDRQBXY-CVNtlAm4.js} +1 -1
- package/dist/worker/console/static/assets/classDiagram-JCYQIIEL-CrvCyJ-8.js +1 -0
- package/dist/worker/console/static/assets/classDiagram-v2-OCEON4UE-CrvCyJ-8.js +1 -0
- package/dist/worker/console/static/assets/{cose-bilkent-JH36ORCC-SposUZsO.js → cose-bilkent-JH36ORCC-BBZBhVTd.js} +1 -1
- package/dist/worker/console/static/assets/{cynefin-VYW2F7L2-BSCtQpD7.js → cynefin-VYW2F7L2-DbMU2PZ2.js} +1 -1
- package/dist/worker/console/static/assets/{cynefinDiagram-MW4NZA55-DgFHrw9l.js → cynefinDiagram-MW4NZA55-Dj0v8rjc.js} +1 -1
- package/dist/worker/console/static/assets/{dagre-VZM6K2ZE-BVBasYbj.js → dagre-VZM6K2ZE-BW8R4WvJ.js} +1 -1
- package/dist/worker/console/static/assets/{diagram-7IWD3JNH-6r_4rN_c.js → diagram-7IWD3JNH-DEgWz3ld.js} +1 -1
- package/dist/worker/console/static/assets/{diagram-B4RE2ZJO-JmuaB41P.js → diagram-B4RE2ZJO-BAA01rlR.js} +1 -1
- package/dist/worker/console/static/assets/{diagram-LBJQPF4R-xXvAY3sk.js → diagram-LBJQPF4R-Cau6qqpW.js} +1 -1
- package/dist/worker/console/static/assets/{diagram-Q27KOJAE-D2B3lY2o.js → diagram-Q27KOJAE-8HiPsLos.js} +1 -1
- package/dist/worker/console/static/assets/{diagram-UB23O5K3-tK54tMEX.js → diagram-UB23O5K3-CmkXuTYL.js} +1 -1
- package/dist/worker/console/static/assets/{ebnfDiagram-BXEA7PRR-CNtELzV-.js → ebnfDiagram-BXEA7PRR-DCV_0seW.js} +1 -1
- package/dist/worker/console/static/assets/{erDiagram-JOGREHBK-C1xKMKcW.js → erDiagram-JOGREHBK-gckfWESj.js} +1 -1
- package/dist/worker/console/static/assets/{flowDiagram-UKHOOZJN-CZ7dlPMz.js → flowDiagram-UKHOOZJN-D2mT2BUu.js} +1 -1
- package/dist/worker/console/static/assets/{ganttDiagram-PKOTCBZU-BqGb42Xe.js → ganttDiagram-PKOTCBZU-B_HR5qEw.js} +1 -1
- package/dist/worker/console/static/assets/{gitGraphDiagram-DS77QQ5N-D_BlXEtt.js → gitGraphDiagram-DS77QQ5N-BUw4fpSa.js} +1 -1
- package/dist/worker/console/static/assets/{index-D5zGX6fG.js → index-DPbsruV5.js} +81 -79
- package/dist/worker/console/static/assets/index-DwOGauxU.css +1 -0
- package/dist/worker/console/static/assets/{infoDiagram-6WML65LV-Vce2vmIe.js → infoDiagram-6WML65LV-BSRAqEj0.js} +1 -1
- package/dist/worker/console/static/assets/{ishikawaDiagram-WSZJBQD7-DDwVBAvI.js → ishikawaDiagram-WSZJBQD7-CLxE8hUp.js} +1 -1
- package/dist/worker/console/static/assets/{journeyDiagram-NVQOT4AX-y_Ew-wv4.js → journeyDiagram-NVQOT4AX-juFzVXIj.js} +1 -1
- package/dist/worker/console/static/assets/{kanban-definition-27J2QSJJ-CjXJFp1K.js → kanban-definition-27J2QSJJ-CwLHVhOU.js} +1 -1
- package/dist/worker/console/static/assets/{linear-1itMst1Q.js → linear-9LfUyPAs.js} +1 -1
- package/dist/worker/console/static/assets/{mermaid.core-C-D3ZRUa.js → mermaid.core-TPPHfQbe.js} +5 -5
- package/dist/worker/console/static/assets/{mindmap-definition-FAOFIHXS-BiYywmZc.js → mindmap-definition-FAOFIHXS-Dn_Z9RxF.js} +1 -1
- package/dist/worker/console/static/assets/{pegDiagram-VL7TDLO6-l2fydNWA.js → pegDiagram-VL7TDLO6-CiEMKTgm.js} +1 -1
- package/dist/worker/console/static/assets/{pieDiagram-7S7Q4E2Y-Dz0hNbYW.js → pieDiagram-7S7Q4E2Y-JASaGxjZ.js} +1 -1
- package/dist/worker/console/static/assets/{quadrantDiagram-CIZ2JOQS-BujI_mLZ.js → quadrantDiagram-CIZ2JOQS-ChmH0ply.js} +1 -1
- package/dist/worker/console/static/assets/{railroadDiagram-AXF67PYL-pWe84beb.js → railroadDiagram-AXF67PYL-CtyM-HGQ.js} +1 -1
- package/dist/worker/console/static/assets/{requirementDiagram-LRYGKXZP-ByYu2frg.js → requirementDiagram-LRYGKXZP-BN9y_Bvs.js} +1 -1
- package/dist/worker/console/static/assets/{sankeyDiagram-W5VNT64P-CoPnilFP.js → sankeyDiagram-W5VNT64P-IyS0GQ1-.js} +1 -1
- package/dist/worker/console/static/assets/{sequenceDiagram-SI44F4Z6-1Md2LnS0.js → sequenceDiagram-SI44F4Z6-DjxGXurN.js} +1 -1
- package/dist/worker/console/static/assets/{sizeCapture-X5ZJPWSS-DqqqAoSH.js → sizeCapture-X5ZJPWSS-Cr3Z0S8y.js} +1 -1
- package/dist/worker/console/static/assets/{stateDiagram-OKZ733FA-C4sGkf--.js → stateDiagram-OKZ733FA-BjJFC6pW.js} +1 -1
- package/dist/worker/console/static/assets/stateDiagram-v2-UEYNNEHI-Bq44O9Nt.js +1 -0
- package/dist/worker/console/static/assets/{swimlanes-SLNWSIFB-ByxJrUzW.js → swimlanes-SLNWSIFB-DeMUJQiW.js} +2 -2
- package/dist/worker/console/static/assets/swimlanesDiagram-ULZ7WXOC-BT4tWyW3.js +8 -0
- package/dist/worker/console/static/assets/{timeline-definition-Z64GVDOM-D8MLgM0O.js → timeline-definition-Z64GVDOM-Bc2Rv2Oo.js} +1 -1
- package/dist/worker/console/static/assets/{vennDiagram-T6HMQDX7-DnBis-wZ.js → vennDiagram-T6HMQDX7-CDhRUeqG.js} +1 -1
- package/dist/worker/console/static/assets/{wardleyDiagram-T6FBY63Y-uuyYT7UO.js → wardleyDiagram-T6FBY63Y-DaN_z3Xy.js} +1 -1
- package/dist/worker/console/static/assets/{xychartDiagram-ELKLHX3M-BjgabhwK.js → xychartDiagram-ELKLHX3M-C1vTLBDG.js} +1 -1
- package/dist/worker/console/static/index.html +2 -2
- package/dist/worker/console/static-src/app/useRecoveryConsole.js +38 -2
- package/dist/worker/console/static-src/app/useRunProgress.js +46 -0
- package/dist/worker/console/static-src/operator-chat/cards/failure-category-advice.js +25 -0
- package/dist/worker/console/static-src/operator-chat/input-history.js +76 -0
- package/dist/worker/console/static-src/operator-chat/turn-submission.js +13 -1
- package/dist/worker/console/static-src/operator-chat/useChatStream.js +29 -9
- package/dist/worker/console/static-src/operator-chat/useComposer.js +32 -0
- package/dist/worker/console/static-src/pages/tasks/run-id-resolution.js +79 -0
- package/dist/worker/console/static-src/pages/tasks/run-ownership-verify.js +23 -0
- package/dist/worker/console/static-src/pages/tasks/run-panel-progress.js +110 -0
- package/dist/worker/materialize/harness-task-lineage.js +5 -2
- package/dist/worker/observability/read-model.js +22 -0
- package/dist/workflows/dag/dynamic-runtime/loop-until.js +1 -1
- package/dist/workflows/dag/dynamic-runtime/map.js +1 -1
- package/dist/workflows/dag/failure-category.js +7 -128
- package/dist/workflows/dag/frontend-design-policy.js +12 -7
- package/dist/workflows/dag/frontend-implementation-contract.js +10 -5
- package/dist/workflows/dag/frontend-plan-render.js +0 -3
- package/dist/workflows/dag/frontend-shadow-dual-write.js +51 -10
- package/dist/workflows/dag/frontend-test-case-checklist.js +4 -2
- package/dist/workflows/dag/frontend-test-case-manifest.js +6 -4
- package/dist/workflows/dag/frontend-test-case-quality.js +6 -3
- package/dist/workflows/dag/frontend-test-environment-probe.js +10 -7
- package/dist/workflows/dag/frontend-test-html-report.js +3 -1
- package/dist/workflows/dag/frontend-test-l5-report.js +3 -1
- package/dist/workflows/dag/frontend-test-layout.js +159 -0
- package/dist/workflows/dag/frontend-test-result-contract.js +28 -14
- package/dist/workflows/dag/frontend-test-standard-scenarios.js +3 -1
- package/dist/workflows/dag/frontend-typed-event-store.js +13 -0
- package/dist/workflows/dag/init-hybrid.js +66 -19
- package/dist/workflows/dag/node-execution.js +21 -1
- package/dist/workflows/dag/retry-policy.js +32 -0
- package/dist/workflows/dag/types.js +12 -0
- package/dist/workflows/dag/validate.js +23 -19
- package/docs/templates/frontend-test-case-checklist.md +2 -2
- package/package.json +1 -1
- package/skills/fe-test-ui-scout/SKILL.md +4 -4
- package/skills/fe-test-ui-scout/references/ledger-schema.md +1 -1
- package/skills/playwright-cli/SKILL.md +1 -1
- package/skills/playwright-cli-case-generator/SKILL.md +10 -8
- package/dist/worker/console/static/assets/channel-BuqaGKAT.js +0 -1
- package/dist/worker/console/static/assets/classDiagram-JCYQIIEL-DNdSHjH9.js +0 -1
- package/dist/worker/console/static/assets/classDiagram-v2-OCEON4UE-DNdSHjH9.js +0 -1
- package/dist/worker/console/static/assets/index-DBbhESQ_.css +0 -1
- package/dist/worker/console/static/assets/stateDiagram-v2-UEYNNEHI-B8rmop_9.js +0 -1
- package/dist/worker/console/static/assets/swimlanesDiagram-ULZ7WXOC-B0ky-kBM.js +0 -8
package/CHANGELOG.md
CHANGED
|
@@ -6,6 +6,10 @@
|
|
|
6
6
|
|
|
7
7
|
### 重点更新
|
|
8
8
|
|
|
9
|
+
- 修复 Console 四处评审缺陷(合并前收口):① 向导「运行」进度块接通——`runDag` 只返回 operationId,原实现读的 `recovery.dagRunId` 在向导路径永远为空;现在确认页先快照基线 run、进入运行页后轮询 `observeLink`,以 (taskId, operationId) 任一变化为失效信号(operationId 覆盖「重新运行」按钮——它不改变向导步骤;taskId 覆盖运行步骤中手动改任务 ID 的场景,失效时基线一并重置,避免沿用上一任务的 run):新派发/切任务会清掉旧选中 run 并重新解析,**只接受与当前任务基线不同的新 run**;从 Recovery 带回的共享选中 run 先做归属校验——`GET /api/dag-runs/:id` 详情响应新增 `taskId` 投影(源自 run.json 的 `taskContractBinding`→`sourceBinding`→Hybrid 标题,与 observeLink/candidates 同一绑定真源,不受候选列表 limit 截断影响;404 视为失效选中、无绑定视为不可判定),非本任务的 run 不展示;校验全程由 effect 生命周期栅栏保护——任务/运行/选中在异步校验期间变化时,旧响应直接丢弃、不会改写新状态;校验暂不可用时按有界退避(2s→30s,约 2 分钟)自动重试而非被动等待状态变化,重试计划为纯函数并有行为测试;**展示层另有闸门**——进度面板与运行操作只消费「本解析器已采纳/已验证」的 run(组件 state),未验证期间(校验中、重试中、give-up 后)进度面板保持空缺,不会即时或永久显示其他任务的 DAG;「打开检视」「侧栏预览」两个入口同样双重门禁(按钮无已验证 run 即禁用 + 处理器复核 verifiedRunId),共享的 openInspectSplit 解析器不再能带出未验证的外来 run。解析决策本身抽取为纯状态机 `pages/tasks/run-id-resolution.ts`(首跑/重跑/切任务/外来选中/基线门控五类迁移),Effects 只做薄适配,主流程「确认页基线快照 → runDag 派发 → observeLink 轮询 → 新 run 采纳」有完整行为测试。基线快照为三态(成功/权威无运行/暂不可查),**查询失败不会被当成「没有历史运行」**——快照重试期间基线保持未知、探测轮询等待,不会把旧运行误判为新运行;新 run 创建失败或注册较慢时进度面板宁可空缺也不把上一次已终止的 DAG 当作当前运行(轮询上限 5 分钟后安静停止)。② 失败建议数据契约修正——旅程卡原先把原始 run 级 `failureCategory` 直接查归一化建议表(`missing-api-key`/`nonzero-exit` 等永远查不中,节点分类又在安全投影中被丢弃);现在纯分类核心下沉 `src/shared/dag-failure-category.ts`(console↔workflows 双向共享叶,不破坏 console 禁止 import workflows 的边界测试),服务端投影把 run 级与节点级分类都归一化输出(success/skipped 不出),卡片按「失败节点分类优先、run 级兜底」取值,失败卡始终有可操作建议。③ Recovery interrupt 资格轮询在运行中档位同步刷新 run 状态——原先状态只在选中时读一次,运行中的 run 结束后仍永久保持 4 秒快轮询;现在 4 秒档附带轻量 `GET /api/dag-runs/:id` 刷新 `effectiveStatus`,终态后自动退到 30 秒。④ Inspect 紧凑检视一次瞬时刷新失败不再永久显示错误——成功刷新回合会清除上一轮 error 横幅。
|
|
10
|
+
- Operator Chat 输入框两项交互增强:① **↑/↓ 历史输入召回**——每次发送的文本进入输入历史(连续重复折叠、上限 100 条),光标在首行按 ↑ 逐条向旧回溯、按 ↓ 向新前进,越过最新一条时恢复回溯前**未发送的草稿**(草稿不会被历史浏览冲掉);多行文本中部的方向键仍是普通光标移动,IME 组词与 @文件/命令面板打开时不抢占。② **运行中排队下一轮指令**——当前回合运行中 Enter 不再被吞掉,消息作为「排队消息」绑定当前 Turn(服务端 `PUT deferred-turn` 从仅限 stopping 放开为 running/stopping,错误码 `TURN_NOT_STOPPING`→`TURN_NOT_ACTIVE`),当前回合结束(正常完成或停止)后自动发送;排队条提供「立即发送」(停止当前回复并立即发出)、「编辑」(移回输入框改写后再排)、「删除」三种操作,运行中输入框右侧提供排队发送按钮(与停止按钮并列);排队条单行展示(状态 + 省略号预览 + 操作按钮一行),输入框默认一行高(自动增高上限 280px 不变)。
|
|
11
|
+
- 向导「运行」面板结构化与预期管理(A2/C9):新增实时运行进度块——节点完成计数与百分比进度条(含 progressbar 无障碍语义)、当前运行节点名称与已运行时长、失败节点与错误摘要,数据来自 `/api/dag-runs/:id` 每 5 秒轮询并在终态自动停止;`effectiveStatus=running-suspected-stall` 时显示橙色「疑似停滞」提示条(建议打开检视查看节点活动或到恢复页协作中止/诊断),把 20–40 分钟长跑的「日志噪音等待」变为有阶段感、可判断的等待。原始 SSE 事件日志默认折叠为「原始事件日志(最近 80 条)」,需要排查时再展开。
|
|
12
|
+
- Console 前端三项体验优化(P0/P2):① Recovery 页 DAG 紧凑检视侧栏(InspectSplitPanel)从一次性快照改为实时刷新——运行中每 5 秒自动拉取节点/事件并新增「进行中/已结束」刷新状态行,到达终态(finished/failed/partial_failed/superseded/abandoned)自动停止轮询,刷新轮不清空既有内容避免闪烁;② Chat 任务旅程卡失败态新增按归一化 failureCategory 的可操作「建议」行(validation/executor/write-guard/timeout/auth/human-required/human-rejected/shell-command/static-error/decision-envelope/unknown 各映射到具体下一步:从失败节点重跑、修正契约后重新生成、跳「模型与认证」页等),不再只报「原因分类为 X」;③ Recovery 页 interrupt 资格轮询退避:选中 run 已终态(含 interrupted)时从 4 秒降到 30 秒,运行中保持 4 秒。
|
|
9
13
|
- Console「设置」页新增「模型配置(models.json)」区块:以弹框形式增/改/删 Pi 的模型条目,支持 6 个定义字段(id、name、contextWindow、maxTokens、input、reasoning)。新增时 Provider 用下拉选择、其余字段自动补默认值;编辑时 Provider 只读且仅在原位置就地替换,只改表单内字段、不覆盖配置里页面未展示的其它字段(如 cost/compat);不读写 API key(凭据走 Pi CLI)。编辑已存在的模型不再被移到最后。
|
|
10
14
|
- 前端风险分级细分 manifest 触及语义:`allowedPaths` 含 `package.json`/lockfile 或需求文本提到 package.json 不再单独触发 `new-dependency` high-risk(改一行 script、调构建参数的任务不再被顶到强制全门禁并误标高风险),只有任务文本同时出现安装语言(npm install / yarn add / pnpm add / 新增依赖等)才升级;仅路径触及时记 `new-dependency:manifest-path-without-install-language` 拒绝信号,审计可溯。
|
|
11
15
|
- 前端验证 fallback 生成期诚实化:真实项目无可读取的 `package.json` scripts 且未探测到本地 tsc 时,不再注入必然失败的 `npm run typecheck` / `npm run build` / `npm test`(纯静态 / vanilla JS 站点原会在 verify 阶段假失败),改为执行显式 no-op 标记命令(`No frontend verification command configured`,进入冻结命令集可被 contract 引用,trace 如实记录 not-run),并写生成期 advisory 提示用 `--verify` 或执行约束显式声明验证命令后重新生成 DAG。无 repoRoot 的单测 fixture 保留历史 generic fallback。**标记不构成验证证据(fail-closed)**:verification trace 将绑定标记的 target 判为失败、只含标记的 static 证据判为 unavailable,repair 分类归为 non-repairable `contract`,verify 节点以 `frontend verification unavailable` 硬失败阻断 review/closeout——无真实验证命令的 run 无法走完绿灯链。
|
|
@@ -31,6 +35,7 @@
|
|
|
31
35
|
### 新增
|
|
32
36
|
|
|
33
37
|
- Operator Chat 时间线左缘新增「用户消息锚点栏」:每个用户输入一枚横向小条(12×3px 微圆角),紧凑等距排列并在时间线高度内垂直居中;条数超出栏高时相邻锚点自动聚合为稍宽的聚合条(悬停展开「N 条聚合输入」逐条列表,时间 + 单行预览,逐条点击定位)。悬停时小条向对话一侧平滑伸长(12→18px)并变橙,浮窗右侧弹出(白底圆角,正文最多 3 行、超出省略号,附序号与时间);单击平滑滚动定位到对应消息(精确停靠在视口顶部偏移 8px);覆盖视口顶部的锚点保持高亮。空会话自动隐藏;历史分页/流式更新/窗口缩放时自动重算(rAF 节流)。
|
|
38
|
+
- frontend-test 产物根可配置:`task.json.frontendTest.testRoot` 缺省仍为 `testcase/frontend`,省略时生成的 DAG 路径与历史默认根一致;自定义根(如 `qa/frontend-test`)在编译期冻结并驱动 writer、gate、playwright 围栏与 `allowedPaths`。`.harness/**` 等隐藏/治理树在生成期拒绝。
|
|
34
39
|
- 实验能力「编辑失败节点提示词后从节点重跑」(默认关闭):内部开关 `HARNESS_DAG_RERUN_PROMPT_OVERRIDE=1` 启用后,`dag rerun` 支持 `--prompt-override <nodeId>@<file>`(全文替换)与 `--prompt-override-append <nodeId>@<file>`(追加指令:保留冻结原提示词,末尾追加 `<operator_addendum>` 块)。仅限 ERROR 且位于 reset closure 内的节点;mode + base/最终 prompt sha256 计入 planHash(execute 漂移即 `PLAN_DRIFT`),父 run spec 冻结、provenance(含 mode)落 `continuation.promptOverrides`。Console 新增 `dagPromptOverrideConfig` 开关探测 action,`dagRerunPlan`/`dagRerun` 接受 `promptOverrides`(`{nodeId, prompt, mode?}`);Inspect DAG 节点 inspector 新增「提示词重启」tab——默认「追加指令」模式(只读底稿 + 追加编辑器),可切换「全文替换(高级)」,预检通过展示执行估算,提交后续跑并跳转新 run,全程不离开图页;开关开启时 `/inspect` 只注入 **scoped** 变体凭据(独立 cookie + `__INSPECT_MUTATION_TOKEN__`,与 Console 通用 token 互不可重放),mutations 路由对 inspect 凭据仅放行 `dagRerunPlan`/`dagRerun`(其余 action 403 `ACTION_NOT_IN_INSPECT_SCOPE`),Inspect 不获得通用写能力;开关关闭时不注入任何 token、tab 不出现,检视面保持严格只读。
|
|
35
40
|
- 观察面 DAG Inspector 节点详情适配 Pi 扩展:执行器输入摘要展示节点声明的 `piExtensions` 短 id;新增「Pi 扩展运行事实」展示 `pi-extensions.json` 的 resolved(包名@版本)与 missing 降级原因(缺包降级不再静默);产物未生成/损坏时降级提示不阻断接口,绝对路径不外泄。
|
|
36
41
|
- 后端实现 DAG(standard / review-gated / supervised)的 Pi 节点支持按桶显式加载本机 Pi 导航扩展:读侧节点(除 closeout)加载 `pi-codegraph` + `pi-lens`,写侧节点只加载 `pi-codegraph`(pi-lens 的 `ast_grep_replace` 可绕过 writeSet,不加载);前端/测试模板与省略字段节点保持扩展全关。扩展发现始终关闭,只经白名单解析 `~/.pi/agent` 与项目 `.pi` settings 的已装包(缺包降级不失败,产物 `pi-extensions.json` 记录 requested/resolved/missing);session 后 pin 工具面剔 builtin 同名、deny 面与写工具,writer 的 `edit`/`write` 仍为 policy-wrapped;`.codegraph/**` index 同步不再计入 write-guard 越界。
|
package/dist/build-stamp.json
CHANGED
|
@@ -1,6 +1,6 @@
|
|
|
1
1
|
{
|
|
2
2
|
"schemaVersion": 1,
|
|
3
|
-
"version": "0.39.0-beta.
|
|
4
|
-
"gitSha": "
|
|
5
|
-
"builtAt": "2026-08-
|
|
3
|
+
"version": "0.39.0-beta.6",
|
|
4
|
+
"gitSha": "740f411873839c25833d8d41d0ee74d0285f7082",
|
|
5
|
+
"builtAt": "2026-08-23T14:01:39.565Z"
|
|
6
6
|
}
|
|
@@ -15,6 +15,7 @@ import { GitStatusUnavailableError, pathsChangedDuringRun, readGitStatusPorcelai
|
|
|
15
15
|
import { isTargetTemplateTransientRetryNode, isWriterEmptyDiffRetryCandidate, isWriterTransportRetryCandidate, INCOMPLETE_WRITE_SET_RETRY_CATEGORY, WRITER_CLEAN_TIMEOUT_RETRY_CATEGORY, WRITER_EMPTY_DIFF_RETRY_CATEGORY, } from "../workflows/dag/retry-policy.js";
|
|
16
16
|
import { assessBackendTestMdPlanCompleteness, assessBackendTestMdWriterCompleteness, assessBackendTestPytestPlanCompleteness, assessBackendTestPytestWriterCompleteness, assessBackendTestShardChildCompleteness, backendTestWriterProgressRoleForTask, classifyBackendTestWriterCompletenessFailure, isBackendTestCompletenessRetryCandidate, isBackendTestMdPlanTask, isBackendTestPytestPlanTask, isBackendTestShardChildTask, writeBackendTestWriterProgressArtifacts, } from "../workflows/dag/backend-test-writer-completeness.js";
|
|
17
17
|
import { resolveBackendTestLayout } from "../workflows/dag/backend-test-layout.js";
|
|
18
|
+
import { frontendTestLayoutFromSpec, } from "../workflows/dag/frontend-test-layout.js";
|
|
18
19
|
import { redactSecrets, truncateUtf8Preview } from "../shared/preview.js";
|
|
19
20
|
/**
|
|
20
21
|
* Writer classification for a length-stopped thinking-only attempt: the model
|
|
@@ -216,6 +217,9 @@ export const FRONTEND_PLAN_RECORD_TOOL_NAMES = [
|
|
|
216
217
|
"record_mock_api",
|
|
217
218
|
"record_design_deviation",
|
|
218
219
|
"record_dependency",
|
|
220
|
+
"record_plan_requirement",
|
|
221
|
+
"record_plan_verification_target",
|
|
222
|
+
"record_plan_evidence_gap",
|
|
219
223
|
];
|
|
220
224
|
export const FRONTEND_PLAN_TERMINAL_TOOL_NAMES = ["finalize_plan"];
|
|
221
225
|
export const FRONTEND_PLAN_ADOPT_TOOL_NAMES = ["adopt_staged_fact"];
|
|
@@ -321,6 +325,49 @@ export function scanReviewTerminalKindsFromSessionEvents(content) {
|
|
|
321
325
|
}
|
|
322
326
|
return kinds;
|
|
323
327
|
}
|
|
328
|
+
/** Read-only discovery tool budget for frontend-plan-pi. Exceeding it means
|
|
329
|
+
* the plan re-read upstream outputs/sources instead of trusting typed facts,
|
|
330
|
+
* which blows up the context window (400 request-too-large). */
|
|
331
|
+
const PLAN_READ_TOOL_BUDGET = 40;
|
|
332
|
+
/** Deterministic read-burst guard for frontend-plan-pi: count read-only
|
|
333
|
+
* discovery tool calls (read/grep/ls/find) from the session log. Over budget →
|
|
334
|
+
* read-burst, retried with a reduced-reading instruction. Pure scan; a
|
|
335
|
+
* successful plan under budget is never blocked. */
|
|
336
|
+
export async function detectPlanReadBurst(input) {
|
|
337
|
+
const sessionEventsPath = path.join(input.runDir, input.nodeId, "session-events.jsonl");
|
|
338
|
+
let count = 0;
|
|
339
|
+
try {
|
|
340
|
+
const content = await readFile(sessionEventsPath, "utf8");
|
|
341
|
+
for (const line of content.split("\n")) {
|
|
342
|
+
if (!line.trim())
|
|
343
|
+
continue;
|
|
344
|
+
try {
|
|
345
|
+
const event = JSON.parse(line);
|
|
346
|
+
if (event.type === "tool_execution_start" &&
|
|
347
|
+
typeof event.toolName === "string" &&
|
|
348
|
+
(event.toolName === "read" ||
|
|
349
|
+
event.toolName === "grep" ||
|
|
350
|
+
event.toolName === "ls" ||
|
|
351
|
+
event.toolName === "find")) {
|
|
352
|
+
count += 1;
|
|
353
|
+
}
|
|
354
|
+
}
|
|
355
|
+
catch {
|
|
356
|
+
// skip unparseable line
|
|
357
|
+
}
|
|
358
|
+
}
|
|
359
|
+
}
|
|
360
|
+
catch {
|
|
361
|
+
// Missing/unreadable session log → no burst detection
|
|
362
|
+
return [];
|
|
363
|
+
}
|
|
364
|
+
if (count > PLAN_READ_TOOL_BUDGET) {
|
|
365
|
+
return [
|
|
366
|
+
`frontend plan read-burst: ${count} read-only tool calls (budget ${PLAN_READ_TOOL_BUDGET}). Trust the upstream contract/scout typed facts; do not re-read contract/scout outputs or source files already captured. Minimize discovery reads, commit record_* facts directly, then finalize_plan.`,
|
|
367
|
+
];
|
|
368
|
+
}
|
|
369
|
+
return [];
|
|
370
|
+
}
|
|
324
371
|
export const FRONTEND_DESIGN_TERMINAL_TOOL_NAMES = new Set([
|
|
325
372
|
"approve_design",
|
|
326
373
|
"request_design_changes",
|
|
@@ -651,7 +698,9 @@ export async function createFrontendPlanLedgerTools(input) {
|
|
|
651
698
|
const optionalStringArray = Type.Optional(stringArray);
|
|
652
699
|
const requirementSchema = Type.Object({
|
|
653
700
|
id: Type.String({}),
|
|
654
|
-
expectedOutcome: Type.String({
|
|
701
|
+
expectedOutcome: Type.Optional(Type.String({
|
|
702
|
+
description: "Optional. When omitted, the runtime derives it from the contract requirement. Prefer omitting it to keep this tool call small.",
|
|
703
|
+
})),
|
|
655
704
|
implementationTargets: stringArray,
|
|
656
705
|
verificationTargetIds: stringArray,
|
|
657
706
|
evidenceGap: Type.Optional(Type.Object({
|
|
@@ -703,7 +752,7 @@ export async function createFrontendPlanLedgerTools(input) {
|
|
|
703
752
|
commandLabel: Type.String({}),
|
|
704
753
|
file: Type.String({}),
|
|
705
754
|
symbol: Type.Optional(Type.String({
|
|
706
|
-
description: "Real exported identifier or describe/it title in the target file. Forbidden for type=static (runtime strips it)
|
|
755
|
+
description: "Optional. Real exported identifier or describe/it title in the target file. Omit it to keep the call small — the trace gate then only verifies the file exists and the command ran. Forbidden for type=static (runtime strips it).",
|
|
707
756
|
})),
|
|
708
757
|
requirementIds: stringArray,
|
|
709
758
|
uiStates: stringArray,
|
|
@@ -792,9 +841,9 @@ export async function createFrontendPlanLedgerTools(input) {
|
|
|
792
841
|
const recordTargetSurfaceTool = defineTool({
|
|
793
842
|
name: "record_target_surface",
|
|
794
843
|
label: "record_target_surface",
|
|
795
|
-
description: "Record the plan target surface (routes
|
|
796
|
-
promptSnippet: "Record the plan target surface fact.",
|
|
797
|
-
parameters: Type.Object({ targets: Type.Optional(targetsSchema), files:
|
|
844
|
+
description: "Record the plan target surface (routes only) as an origin=plan target-surface fact. files are owned by the runtime skeleton / scout — omit them.",
|
|
845
|
+
promptSnippet: "Record the plan target surface (routes) fact.",
|
|
846
|
+
parameters: Type.Object({ targets: Type.Optional(targetsSchema), files: optionalStringArray }, { additionalProperties: false }),
|
|
798
847
|
async execute(_toolCallId, params) {
|
|
799
848
|
const routes = stringList(params?.targets?.routes);
|
|
800
849
|
const files = stringList(params?.files);
|
|
@@ -805,24 +854,28 @@ export async function createFrontendPlanLedgerTools(input) {
|
|
|
805
854
|
const recordComponentChoiceTool = defineTool({
|
|
806
855
|
name: "record_component_choice",
|
|
807
856
|
label: "record_component_choice",
|
|
808
|
-
description: "Record component
|
|
809
|
-
promptSnippet: "Record
|
|
857
|
+
description: "Record ONE component choice (origin=plan component-choice fact). Only declare components you add or replace; reuse of existing components needs no entry. Omit rationale for reuse-existing; it is optional. Call once per component — one tool call per message. Optionally include stylingStrategy (set it once, on the first call).",
|
|
858
|
+
promptSnippet: "Record one component choice (one tool call per message).",
|
|
810
859
|
parameters: Type.Object({
|
|
811
|
-
|
|
860
|
+
choice: uiComponentChoiceSchema,
|
|
812
861
|
stylingStrategy: optionalString,
|
|
813
862
|
}, { additionalProperties: false }),
|
|
814
863
|
async execute(_toolCallId, params) {
|
|
815
|
-
const
|
|
816
|
-
|
|
817
|
-
|
|
818
|
-
|
|
819
|
-
|
|
820
|
-
|
|
864
|
+
const rawChoice = params?.choice;
|
|
865
|
+
if (!isRecordObject(rawChoice)) {
|
|
866
|
+
return planToolReceipt({
|
|
867
|
+
ok: false,
|
|
868
|
+
kind: "component-choice",
|
|
869
|
+
error: "record_component_choice requires a non-empty choice object",
|
|
870
|
+
});
|
|
871
|
+
}
|
|
872
|
+
const choice = rawChoice;
|
|
873
|
+
const components = typeof choice.component === "string" ? [choice.component] : [];
|
|
821
874
|
const result = await adoptPlanFact("component-choice", `${attemptId}:record_component_choice:${randomUUID()}`, {
|
|
822
875
|
kind: "component-choice",
|
|
823
876
|
origin: "plan",
|
|
824
877
|
components,
|
|
825
|
-
uiComponentChoices,
|
|
878
|
+
uiComponentChoices: [choice],
|
|
826
879
|
...(params?.stylingStrategy
|
|
827
880
|
? { stylingStrategy: params.stylingStrategy }
|
|
828
881
|
: {}),
|
|
@@ -923,16 +976,83 @@ export async function createFrontendPlanLedgerTools(input) {
|
|
|
923
976
|
return planToolReceipt(result);
|
|
924
977
|
},
|
|
925
978
|
});
|
|
979
|
+
// Incremental plan payload records (one entry per call) so requirements,
|
|
980
|
+
// verification targets, evidence gaps, and implementation steps never have
|
|
981
|
+
// to be emitted as one large array inside a single finalize_plan call —
|
|
982
|
+
// they aggregate from the ledger in commit order. Mirrors the contract
|
|
983
|
+
// node's record_requirement pattern to stay within any model output budget.
|
|
984
|
+
const recordPlanRequirementTool = defineTool({
|
|
985
|
+
name: "record_plan_requirement",
|
|
986
|
+
label: "record_plan_requirement",
|
|
987
|
+
description: "Commit one plan requirement entry (origin=plan plan-requirement fact). Call once per requirement; entry carries id, implementationTargets, verificationTargetIds, and optional expectedOutcome (omit it — the runtime derives the outcome text from the contract requirement). IMPORTANT: call this tool exactly ONE time per assistant message — never batch multiple record_* calls together in one message; emit one call, wait for its result, then call the next.",
|
|
988
|
+
promptSnippet: "Commit one plan requirement entry (one tool call per message).",
|
|
989
|
+
parameters: Type.Object({
|
|
990
|
+
entry: requirementSchema,
|
|
991
|
+
}, { additionalProperties: false }),
|
|
992
|
+
async execute(_toolCallId, params) {
|
|
993
|
+
const rawEntry = params?.entry;
|
|
994
|
+
if (!isRecordObject(rawEntry)) {
|
|
995
|
+
return planToolReceipt({
|
|
996
|
+
ok: false,
|
|
997
|
+
kind: "plan-requirement",
|
|
998
|
+
error: "record_plan_requirement requires a non-empty entry object",
|
|
999
|
+
});
|
|
1000
|
+
}
|
|
1001
|
+
const entry = rawEntry;
|
|
1002
|
+
const result = await adoptPlanFact("plan-requirement", `${attemptId}:record_plan_requirement:${randomUUID()}`, { kind: "plan-requirement", origin: "plan", entry });
|
|
1003
|
+
return planToolReceipt(result);
|
|
1004
|
+
},
|
|
1005
|
+
});
|
|
1006
|
+
const recordPlanVerificationTargetTool = defineTool({
|
|
1007
|
+
name: "record_plan_verification_target",
|
|
1008
|
+
label: "record_plan_verification_target",
|
|
1009
|
+
description: "Commit one plan verification target entry (origin=plan plan-verification-target fact). Call once per target; entry carries id, type, commandLabel, file, requirementIds, uiStates, and optional symbol (omit it — the trace gate verifies the file and command, not a symbol). IMPORTANT: call this tool exactly ONE time per assistant message — never batch multiple record_* calls together in one message; emit one call, wait for its result, then call the next.",
|
|
1010
|
+
promptSnippet: "Commit one plan verification target entry (one tool call per message).",
|
|
1011
|
+
parameters: Type.Object({
|
|
1012
|
+
entry: verificationTargetSchema,
|
|
1013
|
+
}, { additionalProperties: false }),
|
|
1014
|
+
async execute(_toolCallId, params) {
|
|
1015
|
+
const rawEntry = params?.entry;
|
|
1016
|
+
if (!isRecordObject(rawEntry)) {
|
|
1017
|
+
return planToolReceipt({
|
|
1018
|
+
ok: false,
|
|
1019
|
+
kind: "plan-verification-target",
|
|
1020
|
+
error: "record_plan_verification_target requires a non-empty entry object",
|
|
1021
|
+
});
|
|
1022
|
+
}
|
|
1023
|
+
const entry = rawEntry;
|
|
1024
|
+
const result = await adoptPlanFact("plan-verification-target", `${attemptId}:record_plan_verification_target:${randomUUID()}`, { kind: "plan-verification-target", origin: "plan", entry });
|
|
1025
|
+
return planToolReceipt(result);
|
|
1026
|
+
},
|
|
1027
|
+
});
|
|
1028
|
+
const recordPlanEvidenceGapTool = defineTool({
|
|
1029
|
+
name: "record_plan_evidence_gap",
|
|
1030
|
+
label: "record_plan_evidence_gap",
|
|
1031
|
+
description: "Commit one plan evidence gap entry (origin=plan plan-evidence-gap fact). Call once per gap; entry carries requirementId, description, blocking. IMPORTANT: call this tool exactly ONE time per assistant message — never batch multiple record_* calls together in one message; emit one call, wait for its result, then call the next.",
|
|
1032
|
+
promptSnippet: "Commit one plan evidence gap entry (one tool call per message).",
|
|
1033
|
+
parameters: Type.Object({
|
|
1034
|
+
entry: evidenceGapSchema,
|
|
1035
|
+
}, { additionalProperties: false }),
|
|
1036
|
+
async execute(_toolCallId, params) {
|
|
1037
|
+
const rawEntry = params?.entry;
|
|
1038
|
+
if (!isRecordObject(rawEntry)) {
|
|
1039
|
+
return planToolReceipt({
|
|
1040
|
+
ok: false,
|
|
1041
|
+
kind: "plan-evidence-gap",
|
|
1042
|
+
error: "record_plan_evidence_gap requires a non-empty entry object",
|
|
1043
|
+
});
|
|
1044
|
+
}
|
|
1045
|
+
const entry = rawEntry;
|
|
1046
|
+
const result = await adoptPlanFact("plan-evidence-gap", `${attemptId}:record_plan_evidence_gap:${randomUUID()}`, { kind: "plan-evidence-gap", origin: "plan", entry });
|
|
1047
|
+
return planToolReceipt(result);
|
|
1048
|
+
},
|
|
1049
|
+
});
|
|
926
1050
|
const finalizePlanTool = defineTool({
|
|
927
1051
|
name: "finalize_plan",
|
|
928
1052
|
label: "finalize_plan",
|
|
929
|
-
description: "
|
|
930
|
-
promptSnippet: "
|
|
1053
|
+
description: "Commit the finalize_plan terminal. Requirements, verification targets, and evidence gaps (optional) were already committed incrementally through record_plan_requirement / record_plan_verification_target / record_plan_evidence_gap; finalize_plan assembles them from the ledger together with these optional remaining fields, publishes the canonical editable patch on a target-surface fact, and commits the terminal. Call exactly once.",
|
|
1054
|
+
promptSnippet: "Commit the finalize_plan terminal (ledger fields + optional residualRisks / realIntegrationGap).",
|
|
931
1055
|
parameters: Type.Object({
|
|
932
|
-
requirements: Type.Array(requirementSchema),
|
|
933
|
-
verificationTargets: Type.Array(verificationTargetSchema),
|
|
934
|
-
evidenceGaps: Type.Array(evidenceGapSchema),
|
|
935
|
-
implementationSteps: optionalStringArray,
|
|
936
1056
|
residualRisks: optionalStringArray,
|
|
937
1057
|
realIntegrationGap: optionalString,
|
|
938
1058
|
}, { additionalProperties: false }),
|
|
@@ -942,12 +1062,6 @@ export async function createFrontendPlanLedgerTools(input) {
|
|
|
942
1062
|
const fragment = assemblePlanPatchFromCommittedFacts(committed) ?? {};
|
|
943
1063
|
const patch = {
|
|
944
1064
|
...fragment,
|
|
945
|
-
requirements: params?.requirements ?? [],
|
|
946
|
-
verificationTargets: params?.verificationTargets ?? [],
|
|
947
|
-
evidenceGaps: params?.evidenceGaps ?? [],
|
|
948
|
-
...(params?.implementationSteps
|
|
949
|
-
? { implementationSteps: params.implementationSteps }
|
|
950
|
-
: {}),
|
|
951
1065
|
...(params?.residualRisks
|
|
952
1066
|
? { residualRisks: params.residualRisks }
|
|
953
1067
|
: {}),
|
|
@@ -1024,6 +1138,9 @@ export async function createFrontendPlanLedgerTools(input) {
|
|
|
1024
1138
|
recordMockApiTool,
|
|
1025
1139
|
recordDesignDeviationTool,
|
|
1026
1140
|
recordDependencyTool,
|
|
1141
|
+
recordPlanRequirementTool,
|
|
1142
|
+
recordPlanVerificationTargetTool,
|
|
1143
|
+
recordPlanEvidenceGapTool,
|
|
1027
1144
|
adoptStagedFactTool,
|
|
1028
1145
|
finalizePlanTool,
|
|
1029
1146
|
],
|
|
@@ -1882,10 +1999,11 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
|
|
|
1882
1999
|
throw new Error(`unknown command capability: ${capability}`);
|
|
1883
2000
|
}
|
|
1884
2001
|
if (capability === "playwright-cli") {
|
|
1885
|
-
const
|
|
2002
|
+
const layout = frontendTestLayoutFromSpec(meta.spec);
|
|
2003
|
+
const caseId = resolveCaseIdFromWriteSet(input.task.writeSet, layout) ??
|
|
1886
2004
|
input.task.id;
|
|
1887
|
-
const evidenceDir = resolveEvidenceDirFromWriteSet(input.task.writeSet) ??
|
|
1888
|
-
|
|
2005
|
+
const evidenceDir = resolveEvidenceDirFromWriteSet(input.task.writeSet, layout) ??
|
|
2006
|
+
`${layout.evidenceDir}/${caseId}`;
|
|
1889
2007
|
playwrightToolContext = {
|
|
1890
2008
|
repoRoot: input.cwd,
|
|
1891
2009
|
runDir: meta.runDir,
|
|
@@ -1893,7 +2011,8 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
|
|
|
1893
2011
|
caseId,
|
|
1894
2012
|
evidenceDir,
|
|
1895
2013
|
baseUrl: await resolveValidatedFrontendBaseUrlFromContext(input.cwd, meta.runDir),
|
|
1896
|
-
inputRoot:
|
|
2014
|
+
inputRoot: layout.fixturesDir,
|
|
2015
|
+
layout,
|
|
1897
2016
|
};
|
|
1898
2017
|
// Cleanup must be confirmed before a new case; otherwise default-session
|
|
1899
2018
|
// isolation is unknown and no Pi invocation is permitted.
|
|
@@ -2205,6 +2324,23 @@ export async function executeDagPiNode(input, meta, piStepFn = executePiStep, wr
|
|
|
2205
2324
|
catch {
|
|
2206
2325
|
// best-effort flush; missing ledger still fails at the node validator
|
|
2207
2326
|
}
|
|
2327
|
+
// Read-burst guard: a plan that burned dozens of read/grep/ls/find
|
|
2328
|
+
// calls (re-reading upstream outputs and source files it should trust
|
|
2329
|
+
// from typed facts) blows up the context window and eventually fails
|
|
2330
|
+
// with 400 request-too-large. Detect it deterministically from the
|
|
2331
|
+
// session log and retry with a reduced-reading instruction.
|
|
2332
|
+
const readBurstIssues = await detectPlanReadBurst({
|
|
2333
|
+
runDir: meta.runDir,
|
|
2334
|
+
nodeId: input.task.id,
|
|
2335
|
+
});
|
|
2336
|
+
if (readBurstIssues.length > 0) {
|
|
2337
|
+
return {
|
|
2338
|
+
...mapped,
|
|
2339
|
+
ok: false,
|
|
2340
|
+
failureCategory: "read-burst",
|
|
2341
|
+
stderr: [mapped.stderr, ...readBurstIssues].filter(Boolean).join("\n\n"),
|
|
2342
|
+
};
|
|
2343
|
+
}
|
|
2208
2344
|
}
|
|
2209
2345
|
if (!isWriteTask) {
|
|
2210
2346
|
return mapped;
|
|
@@ -5,6 +5,7 @@ import path from "node:path";
|
|
|
5
5
|
import { processTreeSpawnOptions, terminateProcessTree, } from "./process-tree.js";
|
|
6
6
|
import { resolvePlaywrightCliLauncher } from "./playwright-cli-launcher.js";
|
|
7
7
|
import { PLAYWRIGHT_CLI_ALLOWED_COMMANDS, isPlaywrightCliCommand, parsePlaywrightCliFindMatchCount, } from "../shared/playwright-cli-command-policy.js";
|
|
8
|
+
import { defaultFrontendTestLayout, escapeRegexLiteral, } from "../workflows/dag/frontend-test-layout.js";
|
|
8
9
|
export { PLAYWRIGHT_CLI_ALLOWED_COMMANDS, isPlaywrightCliCommand, };
|
|
9
10
|
/** Logical capability name only; execution always uses the verified JS launcher. */
|
|
10
11
|
export const PLAYWRIGHT_CLI_EXECUTABLE = "playwright-cli";
|
|
@@ -267,7 +268,8 @@ function validateOpenArgs(args, baseUrl) {
|
|
|
267
268
|
}
|
|
268
269
|
function resolveEvidenceRelative(rawPath, ctx) {
|
|
269
270
|
const evidenceDir = normalizePosix(ctx.evidenceDir).replace(/\/$/, "");
|
|
270
|
-
const
|
|
271
|
+
const layout = ctx.layout ?? defaultFrontendTestLayout();
|
|
272
|
+
const evidencePrefix = `${layout.evidenceDir}/${ctx.caseId}`;
|
|
271
273
|
if (!(evidenceDir === evidencePrefix ||
|
|
272
274
|
evidenceDir.startsWith(`${evidencePrefix}/`))) {
|
|
273
275
|
throw new PlaywrightCliPolicyError("evidence-dir-invalid", `evidenceDir must be under ${evidencePrefix}`);
|
|
@@ -291,7 +293,7 @@ function resolveEvidenceRelative(rawPath, ctx) {
|
|
|
291
293
|
if (candidate.startsWith(`${evidenceDir}/`) || candidate === evidenceDir) {
|
|
292
294
|
return candidate;
|
|
293
295
|
}
|
|
294
|
-
if (candidate.startsWith(
|
|
296
|
+
if (candidate.startsWith(`${layout.evidenceDir}/`) &&
|
|
295
297
|
!candidate.startsWith(`${evidencePrefix}/`)) {
|
|
296
298
|
throw new PlaywrightCliPolicyError("path-cross-case", "output path escapes current case evidenceDir");
|
|
297
299
|
}
|
|
@@ -472,11 +474,12 @@ function assertInputPathAllowed(rawPath, ctx) {
|
|
|
472
474
|
if (!isSafeRelativePosix(candidate)) {
|
|
473
475
|
throw new PlaywrightCliPolicyError("input-path-unsafe", `unsafe input path: ${rawPath}`);
|
|
474
476
|
}
|
|
477
|
+
const layout = ctx.layout ?? defaultFrontendTestLayout();
|
|
475
478
|
const allowedPrefixes = [
|
|
476
|
-
|
|
477
|
-
|
|
478
|
-
|
|
479
|
-
|
|
479
|
+
`${layout.evidenceDir}/${ctx.caseId}/`,
|
|
480
|
+
`${layout.casesDir}/`,
|
|
481
|
+
`${layout.ragDir}/`,
|
|
482
|
+
`${layout.fixturesDir}/`,
|
|
480
483
|
];
|
|
481
484
|
if (!allowedPrefixes.some((prefix) => candidate === prefix.slice(0, -1) || candidate.startsWith(prefix)) &&
|
|
482
485
|
!candidate.startsWith(normalizePosix(ctx.evidenceDir) + "/")) {
|
|
@@ -629,8 +632,8 @@ async function validatePlaywrightCliOutputPath(command, args, ctx) {
|
|
|
629
632
|
if (!outputFilename)
|
|
630
633
|
return;
|
|
631
634
|
const repoRoot = path.resolve(ctx.repoRoot);
|
|
632
|
-
const caseEvidenceRoot = path.resolve(repoRoot,
|
|
633
|
-
const evidenceDir =
|
|
635
|
+
const caseEvidenceRoot = path.resolve(repoRoot, ctx.evidenceDir);
|
|
636
|
+
const evidenceDir = caseEvidenceRoot;
|
|
634
637
|
const target = path.resolve(repoRoot, outputFilename);
|
|
635
638
|
if (!pathIsContained(repoRoot, caseEvidenceRoot) ||
|
|
636
639
|
!pathIsContained(caseEvidenceRoot, evidenceDir) ||
|
|
@@ -1024,22 +1027,26 @@ export async function createPlaywrightCliTool(ctx) {
|
|
|
1024
1027
|
export const PI_COMMAND_CAPABILITY_REGISTRY = {
|
|
1025
1028
|
"playwright-cli": createPlaywrightCliTool,
|
|
1026
1029
|
};
|
|
1027
|
-
export function resolveCaseIdFromWriteSet(writeSet) {
|
|
1030
|
+
export function resolveCaseIdFromWriteSet(writeSet, layout = defaultFrontendTestLayout()) {
|
|
1031
|
+
const prefix = layout.evidenceDir.replace(/\/$/, "");
|
|
1032
|
+
const escaped = escapeRegexLiteral(prefix);
|
|
1033
|
+
const exact = new RegExp(`^${escaped}/([^/]+)(?:/\\*\\*)?$`);
|
|
1034
|
+
const nested = new RegExp(`^${escaped}/([^/]+)/`);
|
|
1028
1035
|
for (const entry of writeSet ?? []) {
|
|
1029
1036
|
const normalized = normalizePosix(entry);
|
|
1030
|
-
const match = normalized.match(
|
|
1037
|
+
const match = normalized.match(exact);
|
|
1031
1038
|
if (match?.[1] && match[1] !== "**" && match[1] !== "*") {
|
|
1032
1039
|
return match[1];
|
|
1033
1040
|
}
|
|
1034
|
-
const
|
|
1035
|
-
if (
|
|
1036
|
-
return
|
|
1041
|
+
const nestedMatch = normalized.match(nested);
|
|
1042
|
+
if (nestedMatch?.[1])
|
|
1043
|
+
return nestedMatch[1];
|
|
1037
1044
|
}
|
|
1038
1045
|
return undefined;
|
|
1039
1046
|
}
|
|
1040
|
-
export function resolveEvidenceDirFromWriteSet(writeSet) {
|
|
1041
|
-
const caseId = resolveCaseIdFromWriteSet(writeSet);
|
|
1047
|
+
export function resolveEvidenceDirFromWriteSet(writeSet, layout = defaultFrontendTestLayout()) {
|
|
1048
|
+
const caseId = resolveCaseIdFromWriteSet(writeSet, layout);
|
|
1042
1049
|
if (!caseId)
|
|
1043
1050
|
return undefined;
|
|
1044
|
-
return
|
|
1051
|
+
return `${layout.evidenceDir}/${caseId}`;
|
|
1045
1052
|
}
|
|
@@ -39,6 +39,7 @@ import { materializeFrontendLintAssessment, materializeFrontendLintBaseline, } f
|
|
|
39
39
|
import { formatTraceabilityGateStdout, materializeBackendTestCaseManifest, runBackendTestTraceabilityGate, } from "../workflows/dag/backend-test-case-manifest.js";
|
|
40
40
|
import { materializeBackendTestExecutionContract } from "../workflows/dag/backend-test-execution-contract.js";
|
|
41
41
|
import { resolveBackendTestLayout } from "../workflows/dag/backend-test-layout.js";
|
|
42
|
+
import { frontendTestLayoutFromSpec, } from "../workflows/dag/frontend-test-layout.js";
|
|
42
43
|
import { backendTestGapDocSchema, ingestBackendTestGap, } from "../workflows/dag/backend-test-gap-fill.js";
|
|
43
44
|
import { analyzeBackendTestCaseCoverage, analyzeBackendTestMarkdownPytestCorrespondence, materializeBackendTestCaseManifestFromFacts, } from "../workflows/dag/backend-test-case-coverage-analysis.js";
|
|
44
45
|
import { materializeBackendTestResultFromPytestHtml, materializeBackendTestResultFromRunDir, parsePytestHtmlReport, } from "../workflows/dag/backend-test-result-contract.js";
|
|
@@ -2800,10 +2801,12 @@ async function executeFrontendCloseout(input, meta) {
|
|
|
2800
2801
|
async function executeFrontendTestCaseChecklist(input, meta) {
|
|
2801
2802
|
const started = Date.now();
|
|
2802
2803
|
try {
|
|
2804
|
+
const layout = frontendTestLayoutFromSpec(meta.spec);
|
|
2803
2805
|
const declaredAcIds = (meta.spec.sourceBinding?.requirementIds ?? []).filter((id) => /^AC(?:-[A-Z0-9]+)+$/i.test(id));
|
|
2804
2806
|
const result = await validateFrontendCaseChecklist({
|
|
2805
2807
|
workspaceRoot: input.cwd,
|
|
2806
2808
|
declaredAcIds,
|
|
2809
|
+
layout,
|
|
2807
2810
|
});
|
|
2808
2811
|
if (result.issues.length) {
|
|
2809
2812
|
return {
|
|
@@ -2838,6 +2841,7 @@ async function executeFrontendTestL5Report(input, meta) {
|
|
|
2838
2841
|
const output = await renderFrontendTestL5Report({
|
|
2839
2842
|
workspaceRoot: input.cwd,
|
|
2840
2843
|
runDir: meta.runDir,
|
|
2844
|
+
layout: frontendTestLayoutFromSpec(meta.spec),
|
|
2841
2845
|
});
|
|
2842
2846
|
return {
|
|
2843
2847
|
ok: true,
|
|
@@ -2863,6 +2867,7 @@ async function executeFrontendTestHtmlReport(input, meta) {
|
|
|
2863
2867
|
const output = await renderFrontendTestHtmlReport({
|
|
2864
2868
|
workspaceRoot: input.cwd,
|
|
2865
2869
|
runDir: meta.runDir,
|
|
2870
|
+
layout: frontendTestLayoutFromSpec(meta.spec),
|
|
2866
2871
|
});
|
|
2867
2872
|
return {
|
|
2868
2873
|
ok: true,
|
|
@@ -2882,11 +2887,12 @@ async function executeFrontendTestHtmlReport(input, meta) {
|
|
|
2882
2887
|
};
|
|
2883
2888
|
}
|
|
2884
2889
|
}
|
|
2885
|
-
async function executeFrontendTestStandardScenarios(input) {
|
|
2890
|
+
async function executeFrontendTestStandardScenarios(input, meta) {
|
|
2886
2891
|
const started = Date.now();
|
|
2887
2892
|
try {
|
|
2888
2893
|
const result = await copyFrontendTestStandardScenarios({
|
|
2889
2894
|
workspaceRoot: input.cwd,
|
|
2895
|
+
layout: frontendTestLayoutFromSpec(meta.spec),
|
|
2890
2896
|
});
|
|
2891
2897
|
return {
|
|
2892
2898
|
ok: true,
|
|
@@ -2906,10 +2912,11 @@ async function executeFrontendTestStandardScenarios(input) {
|
|
|
2906
2912
|
};
|
|
2907
2913
|
}
|
|
2908
2914
|
}
|
|
2909
|
-
async function executeFrontendTestEnvironmentProbe(input) {
|
|
2915
|
+
async function executeFrontendTestEnvironmentProbe(input, meta) {
|
|
2910
2916
|
const started = Date.now();
|
|
2911
2917
|
const result = await probeFrontendTestEnvironment({
|
|
2912
2918
|
workspaceRoot: input.cwd,
|
|
2919
|
+
layout: frontendTestLayoutFromSpec(meta.spec),
|
|
2913
2920
|
});
|
|
2914
2921
|
if (result.ok) {
|
|
2915
2922
|
return {
|
|
@@ -2928,11 +2935,12 @@ async function executeFrontendTestEnvironmentProbe(input) {
|
|
|
2928
2935
|
durationMs: Date.now() - started,
|
|
2929
2936
|
};
|
|
2930
2937
|
}
|
|
2931
|
-
async function executeFrontendTestEvidenceValidation(input) {
|
|
2938
|
+
async function executeFrontendTestEvidenceValidation(input, meta) {
|
|
2932
2939
|
const started = Date.now();
|
|
2933
2940
|
try {
|
|
2934
2941
|
const result = await validateFrontendCaseEvidence({
|
|
2935
2942
|
workspaceRoot: input.cwd,
|
|
2943
|
+
layout: frontendTestLayoutFromSpec(meta.spec),
|
|
2936
2944
|
});
|
|
2937
2945
|
const output = `frontend case evidence validation cases=${result.cases} findings=${result.issues.length}${result.issues.length ? ` issues=${JSON.stringify(result.issues)}` : ""}`;
|
|
2938
2946
|
if (result.hardFail) {
|
|
@@ -2971,6 +2979,7 @@ async function executeFrontendTestCaseManifest(input, meta) {
|
|
|
2971
2979
|
const checklist = await validateFrontendCaseChecklist({
|
|
2972
2980
|
workspaceRoot: input.cwd,
|
|
2973
2981
|
declaredAcIds,
|
|
2982
|
+
layout: frontendTestLayoutFromSpec(meta.spec),
|
|
2974
2983
|
});
|
|
2975
2984
|
if (checklist.issues.length) {
|
|
2976
2985
|
return {
|
|
@@ -2985,6 +2994,7 @@ async function executeFrontendTestCaseManifest(input, meta) {
|
|
|
2985
2994
|
workspaceRoot: input.cwd,
|
|
2986
2995
|
maxCases: gate.maxCases,
|
|
2987
2996
|
declaredAcIds,
|
|
2997
|
+
layout: frontendTestLayoutFromSpec(meta.spec),
|
|
2988
2998
|
});
|
|
2989
2999
|
return {
|
|
2990
3000
|
ok: true,
|
|
@@ -3023,6 +3033,7 @@ async function executeFrontendTestResultFinalize(input, meta) {
|
|
|
3023
3033
|
try {
|
|
3024
3034
|
const evidence = await validateFrontendCaseEvidence({
|
|
3025
3035
|
workspaceRoot: input.cwd,
|
|
3036
|
+
layout: frontendTestLayoutFromSpec(meta.spec),
|
|
3026
3037
|
});
|
|
3027
3038
|
advisoryStdout = `frontend case evidence validation cases=${evidence.cases} findings=${evidence.issues.length}${evidence.issues.length ? ` issues=${JSON.stringify(evidence.issues)}` : ""}`;
|
|
3028
3039
|
// Advisory findings must not block materialize; only hardFail (path escape) does.
|
|
@@ -3041,6 +3052,7 @@ async function executeFrontendTestResultFinalize(input, meta) {
|
|
|
3041
3052
|
artifactName: "frontend-test-result.json",
|
|
3042
3053
|
outputDir: "contracts",
|
|
3043
3054
|
sourceBinding: meta.spec.sourceBinding,
|
|
3055
|
+
layout: frontendTestLayoutFromSpec(meta.spec),
|
|
3044
3056
|
});
|
|
3045
3057
|
return {
|
|
3046
3058
|
ok: true,
|
|
@@ -3079,12 +3091,14 @@ async function executeFrontendTestReports(input, meta) {
|
|
|
3079
3091
|
const l5 = await renderFrontendTestL5Report({
|
|
3080
3092
|
workspaceRoot: input.cwd,
|
|
3081
3093
|
runDir: meta.runDir,
|
|
3094
|
+
layout: frontendTestLayoutFromSpec(meta.spec),
|
|
3082
3095
|
});
|
|
3083
3096
|
lines.push(`Frontend L-5 report: ${l5.htmlPath}\nMarkdown: ${l5.markdownPath}\nStatus: ${l5.metrics.status}`);
|
|
3084
3097
|
}
|
|
3085
3098
|
const report = await renderFrontendTestHtmlReport({
|
|
3086
3099
|
workspaceRoot: input.cwd,
|
|
3087
3100
|
runDir: meta.runDir,
|
|
3101
|
+
layout: frontendTestLayoutFromSpec(meta.spec),
|
|
3088
3102
|
});
|
|
3089
3103
|
lines.push(`Frontend test report: ${report.htmlPath}\nMarkdown: ${report.markdownPath}\nOutcome: ${report.outcome}\nCases: ${report.caseCount}`);
|
|
3090
3104
|
return {
|
|
@@ -3214,10 +3228,10 @@ async function executeDagShellNodeInner(input, meta) {
|
|
|
3214
3228
|
}
|
|
3215
3229
|
}
|
|
3216
3230
|
if (shell?.frontendTestStandardScenarios) {
|
|
3217
|
-
return executeFrontendTestStandardScenarios(input);
|
|
3231
|
+
return executeFrontendTestStandardScenarios(input, meta);
|
|
3218
3232
|
}
|
|
3219
3233
|
if (shell?.frontendTestEnvironmentProbe) {
|
|
3220
|
-
return executeFrontendTestEnvironmentProbe(input);
|
|
3234
|
+
return executeFrontendTestEnvironmentProbe(input, meta);
|
|
3221
3235
|
}
|
|
3222
3236
|
if (shell?.frontendBrowserToolPreflight) {
|
|
3223
3237
|
const started = Date.now();
|
|
@@ -3273,14 +3287,16 @@ async function executeDagShellNodeInner(input, meta) {
|
|
|
3273
3287
|
label: "Pi SDK custom-tool 能力",
|
|
3274
3288
|
ok: true,
|
|
3275
3289
|
});
|
|
3290
|
+
const layout = frontendTestLayoutFromSpec(meta.spec);
|
|
3276
3291
|
const toolProbe = await createPlaywrightCliTool({
|
|
3277
3292
|
repoRoot: input.cwd,
|
|
3278
3293
|
runDir: meta.runDir,
|
|
3279
3294
|
nodeId: input.task.id,
|
|
3280
3295
|
caseId: "frontend-browser-preflight",
|
|
3281
|
-
evidenceDir:
|
|
3296
|
+
evidenceDir: `${layout.evidenceDir}/frontend-browser-preflight`,
|
|
3282
3297
|
baseUrl: "http://localhost:5173/",
|
|
3283
|
-
inputRoot:
|
|
3298
|
+
inputRoot: layout.fixturesDir,
|
|
3299
|
+
layout,
|
|
3284
3300
|
});
|
|
3285
3301
|
if (toolProbe.name !== "playwright_cli") {
|
|
3286
3302
|
steps.push({
|
|
@@ -3431,7 +3447,7 @@ async function executeDagShellNodeInner(input, meta) {
|
|
|
3431
3447
|
return executeFrontendTestCaseManifest(input, meta);
|
|
3432
3448
|
}
|
|
3433
3449
|
if (shell?.frontendTestEvidenceValidation) {
|
|
3434
|
-
return executeFrontendTestEvidenceValidation(input);
|
|
3450
|
+
return executeFrontendTestEvidenceValidation(input, meta);
|
|
3435
3451
|
}
|
|
3436
3452
|
if (shell?.frontendTestResultFinalize) {
|
|
3437
3453
|
return executeFrontendTestResultFinalize(input, meta);
|
|
@@ -3538,6 +3554,7 @@ async function executeDagShellNodeInner(input, meta) {
|
|
|
3538
3554
|
artifactName: gate.artifactName,
|
|
3539
3555
|
outputDir: gate.outputDir,
|
|
3540
3556
|
sourceBinding: meta.spec.sourceBinding,
|
|
3557
|
+
layout: frontendTestLayoutFromSpec(meta.spec),
|
|
3541
3558
|
});
|
|
3542
3559
|
break;
|
|
3543
3560
|
default:
|