@tangle-network/agent-eval 0.93.0 → 0.95.0
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/CHANGELOG.md +15 -0
- package/README.md +44 -30
- package/dist/action-policy.d.ts +24 -0
- package/dist/action-policy.d.ts.map +1 -0
- package/dist/action-policy.test.d.ts +2 -0
- package/dist/action-policy.test.d.ts.map +1 -0
- package/dist/active-learning.d.ts +41 -0
- package/dist/active-learning.d.ts.map +1 -0
- package/dist/adapters/http.d.ts +15 -21
- package/dist/adapters/http.d.ts.map +1 -0
- package/dist/adapters/http.js.map +1 -1
- package/dist/adapters/langchain.d.ts +7 -13
- package/dist/adapters/langchain.d.ts.map +1 -0
- package/dist/adapters/otel.d.ts +13 -24
- package/dist/adapters/otel.d.ts.map +1 -0
- package/dist/agent-profile-cell.d.ts +101 -0
- package/dist/agent-profile-cell.d.ts.map +1 -0
- package/dist/agent-profile.d.ts +27 -0
- package/dist/agent-profile.d.ts.map +1 -0
- package/dist/agent-profile.test.d.ts +2 -0
- package/dist/agent-profile.test.d.ts.map +1 -0
- package/dist/analyst/adapters.d.ts +62 -0
- package/dist/analyst/adapters.d.ts.map +1 -0
- package/dist/analyst/analyst.test.d.ts +2 -0
- package/dist/analyst/analyst.test.d.ts.map +1 -0
- package/dist/analyst/ax-service.d.ts +27 -0
- package/dist/analyst/ax-service.d.ts.map +1 -0
- package/dist/analyst/behavioral-analyst.d.ts +28 -0
- package/dist/analyst/behavioral-analyst.d.ts.map +1 -0
- package/dist/analyst/chat-client.d.ts +91 -0
- package/dist/analyst/chat-client.d.ts.map +1 -0
- package/dist/analyst/default-registry.d.ts +27 -0
- package/dist/analyst/default-registry.d.ts.map +1 -0
- package/dist/analyst/default-registry.test.d.ts +2 -0
- package/dist/analyst/default-registry.test.d.ts.map +1 -0
- package/dist/analyst/finding-signature.d.ts +48 -0
- package/dist/analyst/finding-signature.d.ts.map +1 -0
- package/dist/analyst/finding-subject.d.ts +146 -0
- package/dist/analyst/finding-subject.d.ts.map +1 -0
- package/dist/analyst/finding-subject.test.d.ts +2 -0
- package/dist/analyst/finding-subject.test.d.ts.map +1 -0
- package/dist/analyst/findings-store.d.ts +75 -0
- package/dist/analyst/findings-store.d.ts.map +1 -0
- package/dist/analyst/index.d.ts +28 -256
- package/dist/analyst/index.d.ts.map +1 -0
- package/dist/analyst/index.js +6 -66
- package/dist/analyst/index.js.map +1 -1
- package/dist/{kind-factory-5b7xXXOr.d.ts → analyst/kind-factory.d.ts} +11 -63
- package/dist/analyst/kind-factory.d.ts.map +1 -0
- package/dist/analyst/kinds/failure-mode.d.ts +19 -0
- package/dist/analyst/kinds/failure-mode.d.ts.map +1 -0
- package/dist/analyst/kinds/improvement.d.ts +23 -0
- package/dist/analyst/kinds/improvement.d.ts.map +1 -0
- package/dist/analyst/kinds/index.d.ts +22 -0
- package/dist/analyst/kinds/index.d.ts.map +1 -0
- package/dist/analyst/kinds/kinds.test.d.ts +2 -0
- package/dist/analyst/kinds/kinds.test.d.ts.map +1 -0
- package/dist/analyst/kinds/knowledge-gap.d.ts +28 -0
- package/dist/analyst/kinds/knowledge-gap.d.ts.map +1 -0
- package/dist/analyst/kinds/knowledge-poisoning.d.ts +22 -0
- package/dist/analyst/kinds/knowledge-poisoning.d.ts.map +1 -0
- package/dist/analyst/kinds/skill-usage.d.ts +84 -0
- package/dist/analyst/kinds/skill-usage.d.ts.map +1 -0
- package/dist/analyst/kinds/skill-usage.test.d.ts +2 -0
- package/dist/analyst/kinds/skill-usage.test.d.ts.map +1 -0
- package/dist/analyst/parse-tolerant.d.ts +26 -0
- package/dist/analyst/parse-tolerant.d.ts.map +1 -0
- package/dist/analyst/parse-tolerant.test.d.ts +2 -0
- package/dist/analyst/parse-tolerant.test.d.ts.map +1 -0
- package/dist/analyst/registry.budget.test.d.ts +2 -0
- package/dist/analyst/registry.budget.test.d.ts.map +1 -0
- package/dist/{default-registry-zoGHUQEH.d.ts → analyst/registry.d.ts} +8 -37
- package/dist/analyst/registry.d.ts.map +1 -0
- package/dist/analyst/steer-firewall.d.ts +35 -0
- package/dist/analyst/steer-firewall.d.ts.map +1 -0
- package/dist/analyst/steer-firewall.test.d.ts +2 -0
- package/dist/analyst/steer-firewall.test.d.ts.map +1 -0
- package/dist/analyst/structure-findings.d.ts +37 -0
- package/dist/analyst/structure-findings.d.ts.map +1 -0
- package/dist/analyst/structure-findings.test.d.ts +2 -0
- package/dist/analyst/structure-findings.test.d.ts.map +1 -0
- package/dist/analyst/tool-groups.d.ts +34 -0
- package/dist/analyst/tool-groups.d.ts.map +1 -0
- package/dist/{types-2VVIL04s.d.ts → analyst/types.d.ts} +19 -112
- package/dist/analyst/types.d.ts.map +1 -0
- package/dist/anti-slop.d.ts +59 -0
- package/dist/anti-slop.d.ts.map +1 -0
- package/dist/artifact-validator.d.ts +74 -0
- package/dist/artifact-validator.d.ts.map +1 -0
- package/dist/attestation.d.ts +63 -0
- package/dist/attestation.d.ts.map +1 -0
- package/dist/attestation.test.d.ts +2 -0
- package/dist/attestation.test.d.ts.map +1 -0
- package/dist/authenticity/index.d.ts +15 -16
- package/dist/authenticity/index.d.ts.map +1 -0
- package/dist/authenticity/index.test.d.ts +2 -0
- package/dist/authenticity/index.test.d.ts.map +1 -0
- package/dist/auto-pr.d.ts +120 -0
- package/dist/auto-pr.d.ts.map +1 -0
- package/dist/{baseline-DE36-Np7.d.ts → baseline.d.ts} +8 -44
- package/dist/baseline.d.ts.map +1 -0
- package/dist/behavior-dsl.d.ts +73 -0
- package/dist/behavior-dsl.d.ts.map +1 -0
- package/dist/belief-state/calibration.d.ts +10 -0
- package/dist/belief-state/calibration.d.ts.map +1 -0
- package/dist/belief-state/calibration.test.d.ts +2 -0
- package/dist/belief-state/calibration.test.d.ts.map +1 -0
- package/dist/belief-state/code-agent-corpus.d.ts +66 -0
- package/dist/belief-state/code-agent-corpus.d.ts.map +1 -0
- package/dist/belief-state/code-agent-corpus.test.d.ts +2 -0
- package/dist/belief-state/code-agent-corpus.test.d.ts.map +1 -0
- package/dist/belief-state/code-agent-evidence.d.ts +22 -0
- package/dist/belief-state/code-agent-evidence.d.ts.map +1 -0
- package/dist/belief-state/code-agent-evidence.test.d.ts +2 -0
- package/dist/belief-state/code-agent-evidence.test.d.ts.map +1 -0
- package/dist/belief-state/extract.d.ts +7 -0
- package/dist/belief-state/extract.d.ts.map +1 -0
- package/dist/belief-state/extract.test.d.ts +2 -0
- package/dist/belief-state/extract.test.d.ts.map +1 -0
- package/dist/belief-state/index.d.ts +14 -604
- package/dist/belief-state/index.d.ts.map +1 -0
- package/dist/belief-state/index.js +1 -1
- package/dist/belief-state/ope.d.ts +17 -0
- package/dist/belief-state/ope.d.ts.map +1 -0
- package/dist/belief-state/ope.test.d.ts +2 -0
- package/dist/belief-state/ope.test.d.ts.map +1 -0
- package/dist/belief-state/phase0-measurement.d.ts +55 -0
- package/dist/belief-state/phase0-measurement.d.ts.map +1 -0
- package/dist/belief-state/report.d.ts +17 -0
- package/dist/belief-state/report.d.ts.map +1 -0
- package/dist/belief-state/report.test.d.ts +2 -0
- package/dist/belief-state/report.test.d.ts.map +1 -0
- package/dist/belief-state/research-evidence.d.ts +23 -0
- package/dist/belief-state/research-evidence.d.ts.map +1 -0
- package/dist/belief-state/research-evidence.test.d.ts +2 -0
- package/dist/belief-state/research-evidence.test.d.ts.map +1 -0
- package/dist/belief-state/runtime-benchmark-corpus.d.ts +32 -0
- package/dist/belief-state/runtime-benchmark-corpus.d.ts.map +1 -0
- package/dist/belief-state/runtime-hooks.d.ts +87 -0
- package/dist/belief-state/runtime-hooks.d.ts.map +1 -0
- package/dist/belief-state/runtime-hooks.test.d.ts +2 -0
- package/dist/belief-state/runtime-hooks.test.d.ts.map +1 -0
- package/dist/belief-state/selective.d.ts +15 -0
- package/dist/belief-state/selective.d.ts.map +1 -0
- package/dist/belief-state/selective.test.d.ts +2 -0
- package/dist/belief-state/selective.test.d.ts.map +1 -0
- package/dist/belief-state/shadow-probe.d.ts +80 -0
- package/dist/belief-state/shadow-probe.d.ts.map +1 -0
- package/dist/belief-state/shadow-probe.test.d.ts +2 -0
- package/dist/belief-state/shadow-probe.test.d.ts.map +1 -0
- package/dist/belief-state/types.d.ts +195 -0
- package/dist/belief-state/types.d.ts.map +1 -0
- package/dist/belief-state/types.test.d.ts +2 -0
- package/dist/belief-state/types.test.d.ts.map +1 -0
- package/dist/benchmark.d.ts +14 -0
- package/dist/benchmark.d.ts.map +1 -0
- package/dist/benchmarks/index.d.ts +23 -4
- package/dist/benchmarks/index.d.ts.map +1 -0
- package/dist/benchmarks/routing/dataset.d.ts +34 -0
- package/dist/benchmarks/routing/dataset.d.ts.map +1 -0
- package/dist/benchmarks/routing/index.d.ts +34 -0
- package/dist/benchmarks/routing/index.d.ts.map +1 -0
- package/dist/benchmarks/types.d.ts +49 -0
- package/dist/benchmarks/types.d.ts.map +1 -0
- package/dist/bisector.d.ts +81 -0
- package/dist/bisector.d.ts.map +1 -0
- package/dist/budget-guard.d.ts +31 -0
- package/dist/budget-guard.d.ts.map +1 -0
- package/dist/builder-eval/builder-session.d.ts +111 -0
- package/dist/builder-eval/builder-session.d.ts.map +1 -0
- package/dist/builder-eval/correlation.d.ts +32 -0
- package/dist/builder-eval/correlation.d.ts.map +1 -0
- package/dist/builder-eval/index.d.ts +5 -250
- package/dist/builder-eval/index.d.ts.map +1 -0
- package/dist/builder-eval/index.js +2 -2
- package/dist/builder-eval/project-registry.d.ts +51 -0
- package/dist/builder-eval/project-registry.d.ts.map +1 -0
- package/dist/builder-eval/three-layer-eval.d.ts +55 -0
- package/dist/builder-eval/three-layer-eval.d.ts.map +1 -0
- package/dist/campaign/analyst-surface.d.ts +108 -0
- package/dist/campaign/analyst-surface.d.ts.map +1 -0
- package/dist/campaign/analyst-surface.test.d.ts +2 -0
- package/dist/campaign/analyst-surface.test.d.ts.map +1 -0
- package/dist/campaign/auto-pr.d.ts +46 -0
- package/dist/campaign/auto-pr.d.ts.map +1 -0
- package/dist/campaign/distillation/agreement-judge.d.ts +69 -0
- package/dist/campaign/distillation/agreement-judge.d.ts.map +1 -0
- package/dist/campaign/distillation/cli.d.ts +35 -0
- package/dist/campaign/distillation/cli.d.ts.map +1 -0
- package/dist/campaign/distillation/distillation.test.d.ts +2 -0
- package/dist/campaign/distillation/distillation.test.d.ts.map +1 -0
- package/dist/campaign/distillation/gold-scenarios.d.ts +54 -0
- package/dist/campaign/distillation/gold-scenarios.d.ts.map +1 -0
- package/dist/campaign/distillation/run-distillation.d.ts +119 -0
- package/dist/campaign/distillation/run-distillation.d.ts.map +1 -0
- package/dist/campaign/gates/compose.d.ts +12 -0
- package/dist/campaign/gates/compose.d.ts.map +1 -0
- package/dist/campaign/gates/default-production-gate.d.ts +58 -0
- package/dist/campaign/gates/default-production-gate.d.ts.map +1 -0
- package/dist/campaign/gates/heldout-gate.d.ts +12 -0
- package/dist/campaign/gates/heldout-gate.d.ts.map +1 -0
- package/dist/campaign/gates/promotion-policy.d.ts +125 -0
- package/dist/campaign/gates/promotion-policy.d.ts.map +1 -0
- package/dist/campaign/gates/promotion-policy.test.d.ts +2 -0
- package/dist/campaign/gates/promotion-policy.test.d.ts.map +1 -0
- package/dist/campaign/gates/sequential.d.ts +146 -0
- package/dist/campaign/gates/sequential.d.ts.map +1 -0
- package/dist/campaign/gates/sequential.test.d.ts +2 -0
- package/dist/campaign/gates/sequential.test.d.ts.map +1 -0
- package/dist/campaign/gates/statistical-heldout.d.ts +99 -0
- package/dist/campaign/gates/statistical-heldout.d.ts.map +1 -0
- package/dist/campaign/gates/statistical-heldout.test.d.ts +2 -0
- package/dist/campaign/gates/statistical-heldout.test.d.ts.map +1 -0
- package/dist/campaign/index.d.ts +38 -1341
- package/dist/campaign/index.d.ts.map +1 -0
- package/dist/campaign/index.js +1865 -1318
- package/dist/campaign/index.js.map +1 -1
- package/dist/campaign/labeled-store/fs-adapter.d.ts +59 -0
- package/dist/campaign/labeled-store/fs-adapter.d.ts.map +1 -0
- package/dist/campaign/presets/compare-proposers.d.ts +146 -0
- package/dist/campaign/presets/compare-proposers.d.ts.map +1 -0
- package/dist/campaign/presets/playback.d.ts +120 -0
- package/dist/campaign/presets/playback.d.ts.map +1 -0
- package/dist/campaign/presets/playback.test.d.ts +2 -0
- package/dist/campaign/presets/playback.test.d.ts.map +1 -0
- package/dist/campaign/presets/run-eval.d.ts +14 -0
- package/dist/campaign/presets/run-eval.d.ts.map +1 -0
- package/dist/campaign/presets/run-improvement-loop.d.ts +63 -0
- package/dist/campaign/presets/run-improvement-loop.d.ts.map +1 -0
- package/dist/campaign/presets/run-improvement-loop.test.d.ts +2 -0
- package/dist/campaign/presets/run-improvement-loop.test.d.ts.map +1 -0
- package/dist/campaign/presets/run-optimization.d.ts +92 -0
- package/dist/campaign/presets/run-optimization.d.ts.map +1 -0
- package/dist/campaign/presets/run-profile-matrix.d.ts +151 -0
- package/dist/campaign/presets/run-profile-matrix.d.ts.map +1 -0
- package/dist/campaign/presets/run-skill-opt.d.ts +96 -0
- package/dist/campaign/presets/run-skill-opt.d.ts.map +1 -0
- package/dist/campaign/proposers/_findings-text.d.ts +22 -0
- package/dist/campaign/proposers/_findings-text.d.ts.map +1 -0
- package/dist/campaign/proposers/ace.d.ts +33 -0
- package/dist/campaign/proposers/ace.d.ts.map +1 -0
- package/dist/campaign/proposers/ace.test.d.ts +2 -0
- package/dist/campaign/proposers/ace.test.d.ts.map +1 -0
- package/dist/campaign/proposers/analysis-edit.d.ts +32 -0
- package/dist/campaign/proposers/analysis-edit.d.ts.map +1 -0
- package/dist/campaign/proposers/evolutionary.d.ts +20 -0
- package/dist/campaign/proposers/evolutionary.d.ts.map +1 -0
- package/dist/campaign/proposers/fapo.d.ts +120 -0
- package/dist/campaign/proposers/fapo.d.ts.map +1 -0
- package/dist/campaign/proposers/gepa.d.ts +86 -0
- package/dist/campaign/proposers/gepa.d.ts.map +1 -0
- package/dist/campaign/proposers/halo.d.ts +44 -0
- package/dist/campaign/proposers/halo.d.ts.map +1 -0
- package/dist/campaign/proposers/halo.test.d.ts +2 -0
- package/dist/campaign/proposers/halo.test.d.ts.map +1 -0
- package/dist/campaign/proposers/memory.d.ts +47 -0
- package/dist/campaign/proposers/memory.d.ts.map +1 -0
- package/dist/campaign/proposers/memory.test.d.ts +2 -0
- package/dist/campaign/proposers/memory.test.d.ts.map +1 -0
- package/dist/campaign/proposers/skill-opt.d.ts +88 -0
- package/dist/campaign/proposers/skill-opt.d.ts.map +1 -0
- package/dist/campaign/proposers/trace-analyst.d.ts +48 -0
- package/dist/campaign/proposers/trace-analyst.d.ts.map +1 -0
- package/dist/campaign/proposers/trace-analyst.test.d.ts +2 -0
- package/dist/campaign/proposers/trace-analyst.test.d.ts.map +1 -0
- package/dist/campaign/provenance.d.ts +185 -0
- package/dist/campaign/provenance.d.ts.map +1 -0
- package/dist/campaign/run-campaign.d.ts +90 -0
- package/dist/campaign/run-campaign.d.ts.map +1 -0
- package/dist/campaign/score-utils.d.ts +26 -0
- package/dist/campaign/score-utils.d.ts.map +1 -0
- package/dist/campaign/skill-patch.d.ts +62 -0
- package/dist/campaign/skill-patch.d.ts.map +1 -0
- package/dist/campaign/storage.d.ts +38 -0
- package/dist/campaign/storage.d.ts.map +1 -0
- package/dist/{types-BU-7W85F.d.ts → campaign/types.d.ts} +98 -99
- package/dist/campaign/types.d.ts.map +1 -0
- package/dist/campaign/worktree/index.d.ts +53 -0
- package/dist/campaign/worktree/index.d.ts.map +1 -0
- package/dist/canary.d.ts +101 -0
- package/dist/canary.d.ts.map +1 -0
- package/dist/causal-attribution.d.ts +45 -0
- package/dist/causal-attribution.d.ts.map +1 -0
- package/dist/{chunk-TWS7AZEY.js → chunk-2T4EZACH.js} +2 -2
- package/dist/chunk-2T4EZACH.js.map +1 -0
- package/dist/{chunk-LMZQ2Z4U.js → chunk-56GC6VYO.js} +126 -1
- package/dist/chunk-56GC6VYO.js.map +1 -0
- package/dist/{chunk-QG2OVF2D.js → chunk-77T4STFI.js} +154 -112
- package/dist/chunk-77T4STFI.js.map +1 -0
- package/dist/{chunk-ZFIBGEOL.js → chunk-7QTQKIDD.js} +179 -178
- package/dist/chunk-7QTQKIDD.js.map +1 -0
- package/dist/{chunk-UMMZHCPB.js → chunk-AQ5WQAIV.js} +26 -9
- package/dist/chunk-AQ5WQAIV.js.map +1 -0
- package/dist/{chunk-CVVHBFGN.js → chunk-CWNP4DV4.js} +53 -5
- package/dist/chunk-CWNP4DV4.js.map +1 -0
- package/dist/{chunk-QS3RBQPI.js → chunk-D5KBVULY.js} +2 -2
- package/dist/chunk-DJWX3GVS.js +81 -0
- package/dist/chunk-DJWX3GVS.js.map +1 -0
- package/dist/{chunk-S6OZEZQK.js → chunk-HMA63UEO.js} +37 -9
- package/dist/{chunk-S6OZEZQK.js.map → chunk-HMA63UEO.js.map} +1 -1
- package/dist/{chunk-UHMJT4T7.js → chunk-IZCEK2HR.js} +2 -2
- package/dist/{chunk-6SOJM3VR.js → chunk-KKWJD5E6.js} +21 -21
- package/dist/chunk-KKWJD5E6.js.map +1 -0
- package/dist/{chunk-KWRRMR3J.js → chunk-LO6IOIJ2.js} +10 -10
- package/dist/chunk-LO6IOIJ2.js.map +1 -0
- package/dist/{chunk-L3JOU6XM.js → chunk-NACM5RS7.js} +3 -3
- package/dist/{chunk-E4GH6USR.js → chunk-NZEQVRH5.js} +2 -2
- package/dist/chunk-NZEQVRH5.js.map +1 -0
- package/dist/{chunk-XY4DDNEG.js → chunk-PSWWQXHF.js} +14 -89
- package/dist/chunk-PSWWQXHF.js.map +1 -0
- package/dist/{chunk-4FBZZIYD.js → chunk-QTMYW64F.js} +2 -2
- package/dist/{chunk-D3V5B42D.js → chunk-S4SYLDFX.js} +7 -4
- package/dist/chunk-S4SYLDFX.js.map +1 -0
- package/dist/{chunk-47X6LRCE.js → chunk-UFSG7ACU.js} +10 -7
- package/dist/chunk-UFSG7ACU.js.map +1 -0
- package/dist/{chunk-CY6U5S3X.js → chunk-URWVKRCS.js} +2 -2
- package/dist/{chunk-GSH6QNNS.js → chunk-X74V6ESX.js} +102 -79
- package/dist/chunk-X74V6ESX.js.map +1 -0
- package/dist/{chunk-QAY5UIJO.js → chunk-YBIGNSCZ.js} +178 -59
- package/dist/chunk-YBIGNSCZ.js.map +1 -0
- package/dist/{chunk-Y47J2LJ3.js → chunk-Z6L6YSU6.js} +5 -5
- package/dist/{chunk-T375SUOZ.js → chunk-ZOPLCJSY.js} +86 -31
- package/dist/chunk-ZOPLCJSY.js.map +1 -0
- package/dist/ci-gate.d.ts +44 -0
- package/dist/ci-gate.d.ts.map +1 -0
- package/dist/cli.d.ts +2 -0
- package/dist/cli.d.ts.map +1 -0
- package/dist/cli.js +2 -2
- package/dist/client.d.ts +77 -0
- package/dist/client.d.ts.map +1 -0
- package/dist/client.test.d.ts +2 -0
- package/dist/client.test.d.ts.map +1 -0
- package/dist/command-runner.d.ts +74 -0
- package/dist/command-runner.d.ts.map +1 -0
- package/dist/command-runner.test.d.ts +2 -0
- package/dist/command-runner.test.d.ts.map +1 -0
- package/dist/completion-verifier.d.ts +147 -0
- package/dist/completion-verifier.d.ts.map +1 -0
- package/dist/completion-verifier.test.d.ts +9 -0
- package/dist/completion-verifier.test.d.ts.map +1 -0
- package/dist/concurrency.d.ts +23 -0
- package/dist/concurrency.d.ts.map +1 -0
- package/dist/contamination-guard.d.ts +81 -0
- package/dist/contamination-guard.d.ts.map +1 -0
- package/dist/{analyze-runs-DwCEkpO_.d.ts → contract/analyze-runs.d.ts} +9 -10
- package/dist/contract/analyze-runs.d.ts.map +1 -0
- package/dist/contract/define-agent-eval.d.ts +52 -0
- package/dist/contract/define-agent-eval.d.ts.map +1 -0
- package/dist/contract/diff.d.ts +114 -0
- package/dist/contract/diff.d.ts.map +1 -0
- package/dist/contract/index.d.ts +106 -640
- package/dist/contract/index.d.ts.map +1 -0
- package/dist/contract/index.js +131 -21
- package/dist/contract/index.js.map +1 -1
- package/dist/{insight-report-BBwvOh6x.d.ts → contract/insight-report.d.ts} +16 -19
- package/dist/contract/insight-report.d.ts.map +1 -0
- package/dist/contract/insight-types-fwd.d.ts +7 -0
- package/dist/contract/insight-types-fwd.d.ts.map +1 -0
- package/dist/contract/intake/agent-trace.d.ts +97 -0
- package/dist/contract/intake/agent-trace.d.ts.map +1 -0
- package/dist/{code-agent-session-BO8nCnv3.d.ts → contract/intake/code-agent-session.d.ts} +15 -17
- package/dist/contract/intake/code-agent-session.d.ts.map +1 -0
- package/dist/contract/intake/feedback-table.d.ts +87 -0
- package/dist/contract/intake/feedback-table.d.ts.map +1 -0
- package/dist/contract/intake/index.d.ts +22 -0
- package/dist/contract/intake/index.d.ts.map +1 -0
- package/dist/contract/intake/otel-spans.d.ts +33 -0
- package/dist/contract/intake/otel-spans.d.ts.map +1 -0
- package/dist/contract/self-improve.d.ts +284 -0
- package/dist/contract/self-improve.d.ts.map +1 -0
- package/dist/{control-runtime-DuFBYg7A.d.ts → control-runtime.d.ts} +23 -26
- package/dist/control-runtime.d.ts.map +1 -0
- package/dist/control-runtime.test.d.ts +2 -0
- package/dist/control-runtime.test.d.ts.map +1 -0
- package/dist/control.d.ts +11 -9
- package/dist/control.d.ts.map +1 -0
- package/dist/control.js +2 -2
- package/dist/convergence.d.ts +29 -0
- package/dist/convergence.d.ts.map +1 -0
- package/dist/{cost-ledger-DuSqlw5B.d.ts → cost-ledger.d.ts} +10 -11
- package/dist/cost-ledger.d.ts.map +1 -0
- package/dist/cost-ledger.test.d.ts +2 -0
- package/dist/cost-ledger.test.d.ts.map +1 -0
- package/dist/cost-report.d.ts +43 -0
- package/dist/cost-report.d.ts.map +1 -0
- package/dist/cost-report.test.d.ts +2 -0
- package/dist/cost-report.test.d.ts.map +1 -0
- package/dist/cost-tracker.d.ts +76 -0
- package/dist/cost-tracker.d.ts.map +1 -0
- package/dist/{counterfactual-Dwibr5IW.d.ts → counterfactual.d.ts} +12 -13
- package/dist/counterfactual.d.ts.map +1 -0
- package/dist/cross-trace-diff.d.ts +56 -0
- package/dist/cross-trace-diff.d.ts.map +1 -0
- package/dist/{dataset-BbGkaN2I.d.ts → dataset.d.ts} +11 -14
- package/dist/dataset.d.ts.map +1 -0
- package/dist/deploy-gate-layer.d.ts +125 -0
- package/dist/deploy-gate-layer.d.ts.map +1 -0
- package/dist/deploy-gate-layer.test.d.ts +2 -0
- package/dist/deploy-gate-layer.test.d.ts.map +1 -0
- package/dist/description-length-gate.d.ts +119 -0
- package/dist/description-length-gate.d.ts.map +1 -0
- package/dist/detectors/edge.test.d.ts +2 -0
- package/dist/detectors/edge.test.d.ts.map +1 -0
- package/dist/detectors/index.d.ts +81 -0
- package/dist/detectors/index.d.ts.map +1 -0
- package/dist/detectors/index.test.d.ts +2 -0
- package/dist/detectors/index.test.d.ts.map +1 -0
- package/dist/diagnose/causal-sweep.d.ts +100 -0
- package/dist/diagnose/causal-sweep.d.ts.map +1 -0
- package/dist/diagnose/index.d.ts +36 -0
- package/dist/diagnose/index.d.ts.map +1 -0
- package/dist/diagnose/remediation.d.ts +68 -0
- package/dist/diagnose/remediation.d.ts.map +1 -0
- package/dist/diagnose/repair.d.ts +77 -0
- package/dist/diagnose/repair.d.ts.map +1 -0
- package/dist/diagnose.d.ts +1 -251
- package/dist/diagnose.js +2 -2
- package/dist/discover-personas.d.ts +35 -0
- package/dist/discover-personas.d.ts.map +1 -0
- package/dist/driver.d.ts +95 -0
- package/dist/driver.d.ts.map +1 -0
- package/dist/driver.test.d.ts +8 -0
- package/dist/driver.test.d.ts.map +1 -0
- package/dist/dual-agent-bench.d.ts +81 -0
- package/dist/dual-agent-bench.d.ts.map +1 -0
- package/dist/error-count-extractor.d.ts +47 -0
- package/dist/error-count-extractor.d.ts.map +1 -0
- package/dist/error-count-extractor.test.d.ts +2 -0
- package/dist/error-count-extractor.test.d.ts.map +1 -0
- package/dist/{errors-CzMUYo7b.d.ts → errors.d.ts} +10 -11
- package/dist/errors.d.ts.map +1 -0
- package/dist/{researcher-DE6Gpnb4.d.ts → eval-campaign.d.ts} +34 -156
- package/dist/eval-campaign.d.ts.map +1 -0
- package/dist/eval-campaign.test.d.ts +2 -0
- package/dist/eval-campaign.test.d.ts.map +1 -0
- package/dist/eval-tools.d.ts +55 -0
- package/dist/eval-tools.d.ts.map +1 -0
- package/dist/eval-trace-store.d.ts +107 -0
- package/dist/eval-trace-store.d.ts.map +1 -0
- package/dist/eval-trace-store.test.d.ts +2 -0
- package/dist/eval-trace-store.test.d.ts.map +1 -0
- package/dist/executor.d.ts +38 -0
- package/dist/executor.d.ts.map +1 -0
- package/dist/executor.test.d.ts +10 -0
- package/dist/executor.test.d.ts.map +1 -0
- package/dist/experiment-tracker.d.ts +178 -0
- package/dist/experiment-tracker.d.ts.map +1 -0
- package/dist/experiment-tracker.test.d.ts +2 -0
- package/dist/experiment-tracker.test.d.ts.map +1 -0
- package/dist/failure-taxonomy.d.ts +38 -0
- package/dist/failure-taxonomy.d.ts.map +1 -0
- package/dist/{feedback-trajectory-D9OVLrg9.d.ts → feedback-trajectory.d.ts} +36 -38
- package/dist/feedback-trajectory.d.ts.map +1 -0
- package/dist/feedback-trajectory.test.d.ts +2 -0
- package/dist/feedback-trajectory.test.d.ts.map +1 -0
- package/dist/flow-layer.d.ts +90 -0
- package/dist/flow-layer.d.ts.map +1 -0
- package/dist/flow-layer.test.d.ts +2 -0
- package/dist/flow-layer.test.d.ts.map +1 -0
- package/dist/fuzz/capsule.d.ts +46 -0
- package/dist/fuzz/capsule.d.ts.map +1 -0
- package/dist/fuzz/cube.d.ts +36 -0
- package/dist/fuzz/cube.d.ts.map +1 -0
- package/dist/fuzz/explorer-cost.test.d.ts +2 -0
- package/dist/fuzz/explorer-cost.test.d.ts.map +1 -0
- package/dist/fuzz/explorer.d.ts +64 -0
- package/dist/fuzz/explorer.d.ts.map +1 -0
- package/dist/fuzz/fuzz-agent.d.ts +16 -0
- package/dist/fuzz/fuzz-agent.d.ts.map +1 -0
- package/dist/fuzz/fuzz-agent.test.d.ts +2 -0
- package/dist/fuzz/fuzz-agent.test.d.ts.map +1 -0
- package/dist/fuzz/gates.d.ts +33 -0
- package/dist/fuzz/gates.d.ts.map +1 -0
- package/dist/fuzz/index.d.ts +26 -0
- package/dist/fuzz/index.d.ts.map +1 -0
- package/dist/fuzz/policies.d.ts +28 -0
- package/dist/fuzz/policies.d.ts.map +1 -0
- package/dist/fuzz/tools.d.ts +20 -0
- package/dist/fuzz/tools.d.ts.map +1 -0
- package/dist/fuzz/types.d.ts +307 -0
- package/dist/fuzz/types.d.ts.map +1 -0
- package/dist/fuzz.d.ts +1 -547
- package/dist/golden-matcher.d.ts +71 -0
- package/dist/golden-matcher.d.ts.map +1 -0
- package/dist/governance/eu-ai-act.d.ts +37 -0
- package/dist/governance/eu-ai-act.d.ts.map +1 -0
- package/dist/governance/index.d.ts +5 -135
- package/dist/governance/index.d.ts.map +1 -0
- package/dist/governance/nist-ai-rmf.d.ts +15 -0
- package/dist/governance/nist-ai-rmf.d.ts.map +1 -0
- package/dist/governance/soc2.d.ts +12 -0
- package/dist/governance/soc2.d.ts.map +1 -0
- package/dist/governance/types.d.ts +66 -0
- package/dist/governance/types.d.ts.map +1 -0
- package/dist/harness-optimizer.d.ts +82 -0
- package/dist/harness-optimizer.d.ts.map +1 -0
- package/dist/held-out-gate.d.ts +135 -0
- package/dist/held-out-gate.d.ts.map +1 -0
- package/dist/hosted/client.d.ts +73 -0
- package/dist/hosted/client.d.ts.map +1 -0
- package/dist/hosted/from-env.test.d.ts +8 -0
- package/dist/hosted/from-env.test.d.ts.map +1 -0
- package/dist/hosted/index.d.ts +10 -238
- package/dist/hosted/index.d.ts.map +1 -0
- package/dist/hosted/types.d.ts +159 -0
- package/dist/hosted/types.d.ts.map +1 -0
- package/dist/index.d.ts +277 -5643
- package/dist/index.d.ts.map +1 -0
- package/dist/index.js +317 -108
- package/dist/index.js.map +1 -1
- package/dist/integrity/backend-integrity.d.ts +71 -0
- package/dist/integrity/backend-integrity.d.ts.map +1 -0
- package/dist/integrity/preflight.d.ts +72 -0
- package/dist/integrity/preflight.d.ts.map +1 -0
- package/dist/integrity/preflight.test.d.ts +2 -0
- package/dist/integrity/preflight.test.d.ts.map +1 -0
- package/dist/integrity/single-backend.d.ts +67 -0
- package/dist/integrity/single-backend.d.ts.map +1 -0
- package/dist/intent-match-judge.d.ts +69 -0
- package/dist/intent-match-judge.d.ts.map +1 -0
- package/dist/intent-match-judge.test.d.ts +2 -0
- package/dist/intent-match-judge.test.d.ts.map +1 -0
- package/dist/{judge-calibration-0p2QcWNE.d.ts → judge-calibration.d.ts} +16 -17
- package/dist/judge-calibration.d.ts.map +1 -0
- package/dist/judge-ensemble.d.ts +66 -0
- package/dist/judge-ensemble.d.ts.map +1 -0
- package/dist/judge-ensemble.test.d.ts +8 -0
- package/dist/judge-ensemble.test.d.ts.map +1 -0
- package/dist/judge-families.d.ts +38 -0
- package/dist/judge-families.d.ts.map +1 -0
- package/dist/judge-panel.d.ts +65 -0
- package/dist/judge-panel.d.ts.map +1 -0
- package/dist/judge-retry.d.ts +70 -0
- package/dist/judge-retry.d.ts.map +1 -0
- package/dist/judge-runner.d.ts +36 -0
- package/dist/judge-runner.d.ts.map +1 -0
- package/dist/judge-runner.test.d.ts +2 -0
- package/dist/judge-runner.test.d.ts.map +1 -0
- package/dist/judges.d.ts +74 -0
- package/dist/judges.d.ts.map +1 -0
- package/dist/keyword-coverage-judge.d.ts +89 -0
- package/dist/keyword-coverage-judge.d.ts.map +1 -0
- package/dist/keyword-coverage-judge.test.d.ts +2 -0
- package/dist/keyword-coverage-judge.test.d.ts.map +1 -0
- package/dist/knowledge/index.d.ts +3 -103
- package/dist/knowledge/index.d.ts.map +1 -0
- package/dist/knowledge/readiness.d.ts +26 -0
- package/dist/knowledge/readiness.d.ts.map +1 -0
- package/dist/knowledge/types.d.ts +75 -0
- package/dist/knowledge/types.d.ts.map +1 -0
- package/dist/live-proof.d.ts +62 -0
- package/dist/live-proof.d.ts.map +1 -0
- package/dist/{llm-client-BeEcAokY.d.ts → llm-client.d.ts} +52 -23
- package/dist/llm-client.d.ts.map +1 -0
- package/dist/llm-client.test.d.ts +2 -0
- package/dist/llm-client.test.d.ts.map +1 -0
- package/dist/locked-jsonl-appender.d.ts +19 -0
- package/dist/locked-jsonl-appender.d.ts.map +1 -0
- package/dist/matrix/aggregation.d.ts +16 -0
- package/dist/matrix/aggregation.d.ts.map +1 -0
- package/dist/matrix/index.d.ts +12 -30
- package/dist/matrix/index.d.ts.map +1 -0
- package/dist/matrix/runner.d.ts +15 -0
- package/dist/matrix/runner.d.ts.map +1 -0
- package/dist/{types-mn5Aqk7x.d.ts → matrix/types.d.ts} +11 -15
- package/dist/matrix/types.d.ts.map +1 -0
- package/dist/meta-eval/calibration.d.ts +47 -0
- package/dist/meta-eval/calibration.d.ts.map +1 -0
- package/dist/meta-eval/correlation-study.d.ts +53 -0
- package/dist/meta-eval/correlation-study.d.ts.map +1 -0
- package/dist/meta-eval/index.d.ts +6 -181
- package/dist/meta-eval/index.d.ts.map +1 -0
- package/dist/meta-eval/index.js +1 -1
- package/dist/{outcome-store-rnXLEqSn.d.ts → meta-eval/outcome-store.d.ts} +7 -8
- package/dist/meta-eval/outcome-store.d.ts.map +1 -0
- package/dist/{rubric-predictive-validity-Cy_W-hWZ.d.ts → meta-eval/rubric-predictive-validity.d.ts} +8 -11
- package/dist/meta-eval/rubric-predictive-validity.d.ts.map +1 -0
- package/dist/meta-eval/sentinel.d.ts +169 -0
- package/dist/meta-eval/sentinel.d.ts.map +1 -0
- package/dist/metrics.d.ts +63 -0
- package/dist/metrics.d.ts.map +1 -0
- package/dist/model-seats.d.ts +71 -0
- package/dist/model-seats.d.ts.map +1 -0
- package/dist/model-seats.test.d.ts +2 -0
- package/dist/model-seats.test.d.ts.map +1 -0
- package/dist/muffled-gate-scanner.d.ts +102 -0
- package/dist/muffled-gate-scanner.d.ts.map +1 -0
- package/dist/{multi-layer-verifier-DUZXrPDA.d.ts → multi-layer-verifier.d.ts} +12 -15
- package/dist/multi-layer-verifier.d.ts.map +1 -0
- package/dist/multi-layer-verifier.test.d.ts +2 -0
- package/dist/multi-layer-verifier.test.d.ts.map +1 -0
- package/dist/multi-toolchain-layer.d.ts +80 -0
- package/dist/multi-toolchain-layer.d.ts.map +1 -0
- package/dist/multi-toolchain-layer.test.d.ts +2 -0
- package/dist/multi-toolchain-layer.test.d.ts.map +1 -0
- package/dist/multishot/default-tools.d.ts +34 -0
- package/dist/multishot/default-tools.d.ts.map +1 -0
- package/dist/multishot/index.d.ts +7 -290
- package/dist/multishot/index.d.ts.map +1 -0
- package/dist/multishot/index.js.map +1 -1
- package/dist/multishot/judges.d.ts +32 -0
- package/dist/multishot/judges.d.ts.map +1 -0
- package/dist/multishot/matrix.d.ts +107 -0
- package/dist/multishot/matrix.d.ts.map +1 -0
- package/dist/multishot/multishot.d.ts +23 -0
- package/dist/multishot/multishot.d.ts.map +1 -0
- package/dist/multishot/router.d.ts +37 -0
- package/dist/multishot/router.d.ts.map +1 -0
- package/dist/multishot/types.d.ts +60 -0
- package/dist/multishot/types.d.ts.map +1 -0
- package/dist/observability.d.ts +71 -0
- package/dist/observability.d.ts.map +1 -0
- package/dist/openapi.json +1 -1
- package/dist/oracle.d.ts +55 -0
- package/dist/oracle.d.ts.map +1 -0
- package/dist/orthogonality.d.ts +35 -0
- package/dist/orthogonality.d.ts.map +1 -0
- package/dist/otel-pipeline.d.ts +31 -0
- package/dist/otel-pipeline.d.ts.map +1 -0
- package/dist/paraphrase.d.ts +107 -0
- package/dist/paraphrase.d.ts.map +1 -0
- package/dist/{pareto-E-pembql.d.ts → pareto.d.ts} +9 -10
- package/dist/pareto.d.ts.map +1 -0
- package/dist/partition-held-out.d.ts +70 -0
- package/dist/partition-held-out.d.ts.map +1 -0
- package/dist/partition-held-out.test.d.ts +2 -0
- package/dist/partition-held-out.test.d.ts.map +1 -0
- package/dist/perf/index.d.ts +13 -119
- package/dist/perf/index.d.ts.map +1 -0
- package/dist/perf/integrity.d.ts +30 -0
- package/dist/perf/integrity.d.ts.map +1 -0
- package/dist/perf/journey.d.ts +45 -0
- package/dist/perf/journey.d.ts.map +1 -0
- package/dist/perf/ratchet.d.ts +47 -0
- package/dist/perf/ratchet.d.ts.map +1 -0
- package/dist/pipelines/budget-breach.d.ts +31 -0
- package/dist/pipelines/budget-breach.d.ts.map +1 -0
- package/dist/pipelines/budget-breach.test.d.ts +2 -0
- package/dist/pipelines/budget-breach.test.d.ts.map +1 -0
- package/dist/pipelines/failure-cluster.d.ts +38 -0
- package/dist/pipelines/failure-cluster.d.ts.map +1 -0
- package/dist/pipelines/failure-cluster.test.d.ts +2 -0
- package/dist/pipelines/failure-cluster.test.d.ts.map +1 -0
- package/dist/pipelines/first-divergence.d.ts +26 -0
- package/dist/pipelines/first-divergence.d.ts.map +1 -0
- package/dist/pipelines/first-divergence.test.d.ts +2 -0
- package/dist/pipelines/first-divergence.test.d.ts.map +1 -0
- package/dist/pipelines/index.d.ts +8 -173
- package/dist/pipelines/index.d.ts.map +1 -0
- package/dist/pipelines/index.js +40 -15
- package/dist/pipelines/index.js.map +1 -1
- package/dist/pipelines/judge-agreement.d.ts +26 -0
- package/dist/pipelines/judge-agreement.d.ts.map +1 -0
- package/dist/pipelines/judge-agreement.test.d.ts +2 -0
- package/dist/pipelines/judge-agreement.test.d.ts.map +1 -0
- package/dist/pipelines/regression.d.ts +23 -0
- package/dist/pipelines/regression.d.ts.map +1 -0
- package/dist/pipelines/regression.test.d.ts +2 -0
- package/dist/pipelines/regression.test.d.ts.map +1 -0
- package/dist/pipelines/stuck-loop.d.ts +32 -0
- package/dist/pipelines/stuck-loop.d.ts.map +1 -0
- package/dist/pipelines/stuck-loop.test.d.ts +2 -0
- package/dist/pipelines/stuck-loop.test.d.ts.map +1 -0
- package/dist/pipelines/tool-waste.d.ts +34 -0
- package/dist/pipelines/tool-waste.d.ts.map +1 -0
- package/dist/pipelines/tool-waste.test.d.ts +2 -0
- package/dist/pipelines/tool-waste.test.d.ts.map +1 -0
- package/dist/playbook.d.ts +16 -0
- package/dist/playbook.d.ts.map +1 -0
- package/dist/pr-review-benchmark.d.ts +88 -0
- package/dist/pr-review-benchmark.d.ts.map +1 -0
- package/dist/pr-review-benchmark.test.d.ts +2 -0
- package/dist/pr-review-benchmark.test.d.ts.map +1 -0
- package/dist/pre-registration.d.ts +125 -0
- package/dist/pre-registration.d.ts.map +1 -0
- package/dist/prm/builtin-rubrics.d.ts +33 -0
- package/dist/prm/builtin-rubrics.d.ts.map +1 -0
- package/dist/prm/index.d.ts +5 -100
- package/dist/prm/index.d.ts.map +1 -0
- package/dist/prm/index.js +55 -12
- package/dist/prm/index.js.map +1 -1
- package/dist/prm/inference.d.ts +29 -0
- package/dist/prm/inference.d.ts.map +1 -0
- package/dist/prm/inference.test.d.ts +2 -0
- package/dist/prm/inference.test.d.ts.map +1 -0
- package/dist/{rubric-BOfxn4ja.d.ts → prm/rubric.d.ts} +10 -13
- package/dist/prm/rubric.d.ts.map +1 -0
- package/dist/prm/training-export.d.ts +38 -0
- package/dist/prm/training-export.d.ts.map +1 -0
- package/dist/produced-state.d.ts +63 -0
- package/dist/produced-state.d.ts.map +1 -0
- package/dist/produced-state.test.d.ts +8 -0
- package/dist/produced-state.test.d.ts.map +1 -0
- package/dist/profile/baselines.d.ts +37 -0
- package/dist/profile/baselines.d.ts.map +1 -0
- package/dist/profile/index.d.ts +105 -0
- package/dist/profile/index.d.ts.map +1 -0
- package/dist/promotion-gate.d.ts +93 -0
- package/dist/promotion-gate.d.ts.map +1 -0
- package/dist/prompt-registry.d.ts +41 -0
- package/dist/prompt-registry.d.ts.map +1 -0
- package/dist/propose-review-control.d.ts +49 -0
- package/dist/propose-review-control.d.ts.map +1 -0
- package/dist/propose-review-control.test.d.ts +2 -0
- package/dist/propose-review-control.test.d.ts.map +1 -0
- package/dist/propose-review.d.ts +155 -0
- package/dist/propose-review.d.ts.map +1 -0
- package/dist/{red-team-BXHil6c8.d.ts → red-team.d.ts} +14 -16
- package/dist/red-team.d.ts.map +1 -0
- package/dist/reference-replay-steering.d.ts +11 -0
- package/dist/reference-replay-steering.d.ts.map +1 -0
- package/dist/reference-replay.d.ts +176 -0
- package/dist/reference-replay.d.ts.map +1 -0
- package/dist/reflective-mutation.d.ts +79 -0
- package/dist/reflective-mutation.d.ts.map +1 -0
- package/dist/registry.d.ts +31 -0
- package/dist/registry.d.ts.map +1 -0
- package/dist/release-confidence.d.ts +128 -0
- package/dist/release-confidence.d.ts.map +1 -0
- package/dist/release-report.d.ts +11 -0
- package/dist/release-report.d.ts.map +1 -0
- package/dist/replay.d.ts +120 -0
- package/dist/replay.d.ts.map +1 -0
- package/dist/reporter.d.ts +14 -0
- package/dist/reporter.d.ts.map +1 -0
- package/dist/reporting.d.ts +15 -15
- package/dist/reporting.d.ts.map +1 -0
- package/dist/reporting.js +3 -3
- package/dist/researcher.d.ts +140 -0
- package/dist/researcher.d.ts.map +1 -0
- package/dist/reviewer.d.ts +118 -0
- package/dist/reviewer.d.ts.map +1 -0
- package/dist/reviewer.test.d.ts +2 -0
- package/dist/reviewer.test.d.ts.map +1 -0
- package/dist/reward-model-export.d.ts +60 -0
- package/dist/reward-model-export.d.ts.map +1 -0
- package/dist/rl/active-curriculum.d.ts +110 -0
- package/dist/rl/active-curriculum.d.ts.map +1 -0
- package/dist/rl/adaptation-eval.d.ts +109 -0
- package/dist/rl/adaptation-eval.d.ts.map +1 -0
- package/dist/{adversarial-DIVcDoI_.d.ts → rl/adversarial.d.ts} +6 -7
- package/dist/rl/adversarial.d.ts.map +1 -0
- package/dist/rl/compute-curves.d.ts +127 -0
- package/dist/rl/compute-curves.d.ts.map +1 -0
- package/dist/rl/contamination.d.ts +117 -0
- package/dist/rl/contamination.d.ts.map +1 -0
- package/dist/rl/corpus.d.ts +55 -0
- package/dist/rl/corpus.d.ts.map +1 -0
- package/dist/rl/corpus.test.d.ts +2 -0
- package/dist/rl/corpus.test.d.ts.map +1 -0
- package/dist/rl/dataset.d.ts +102 -0
- package/dist/rl/dataset.d.ts.map +1 -0
- package/dist/rl/dataset.test.d.ts +2 -0
- package/dist/rl/dataset.test.d.ts.map +1 -0
- package/dist/rl/exporters.d.ts +141 -0
- package/dist/rl/exporters.d.ts.map +1 -0
- package/dist/rl/index.d.ts +49 -0
- package/dist/rl/index.d.ts.map +1 -0
- package/dist/{off-policy-DiwuKKg7.d.ts → rl/off-policy.d.ts} +8 -9
- package/dist/rl/off-policy.d.ts.map +1 -0
- package/dist/rl/predictive-validity-researcher.d.ts +69 -0
- package/dist/rl/predictive-validity-researcher.d.ts.map +1 -0
- package/dist/rl/preferences.d.ts +141 -0
- package/dist/rl/preferences.d.ts.map +1 -0
- package/dist/rl/process-reward.d.ts +122 -0
- package/dist/rl/process-reward.d.ts.map +1 -0
- package/dist/rl/reward-hacking.d.ts +104 -0
- package/dist/rl/reward-hacking.d.ts.map +1 -0
- package/dist/rl/rl-campaign.d.ts +85 -0
- package/dist/rl/rl-campaign.d.ts.map +1 -0
- package/dist/rl/run-record-adapters.d.ts +56 -0
- package/dist/rl/run-record-adapters.d.ts.map +1 -0
- package/dist/rl/sim-fidelity.d.ts +166 -0
- package/dist/rl/sim-fidelity.d.ts.map +1 -0
- package/dist/rl/sim-fidelity.test.d.ts +2 -0
- package/dist/rl/sim-fidelity.test.d.ts.map +1 -0
- package/dist/rl/tournament.d.ts +115 -0
- package/dist/rl/tournament.d.ts.map +1 -0
- package/dist/rl/verifiable-reward.d.ts +124 -0
- package/dist/rl/verifiable-reward.d.ts.map +1 -0
- package/dist/rl.d.ts +1 -1192
- package/dist/rl.js +615 -615
- package/dist/rl.js.map +1 -1
- package/dist/{run-campaign-RDGAM5KJ.js → run-campaign-WXY7KI67.js} +3 -3
- package/dist/run-critic.d.ts +23 -0
- package/dist/run-critic.d.ts.map +1 -0
- package/dist/run-evidence.d.ts +32 -0
- package/dist/run-evidence.d.ts.map +1 -0
- package/dist/{run-record-e7vj1uZQ.d.ts → run-record.d.ts} +16 -122
- package/dist/run-record.d.ts.map +1 -0
- package/dist/run-record.test.d.ts +2 -0
- package/dist/run-record.test.d.ts.map +1 -0
- package/dist/run-score.d.ts +31 -0
- package/dist/run-score.d.ts.map +1 -0
- package/dist/runtime-trajectory.d.ts +47 -0
- package/dist/runtime-trajectory.d.ts.map +1 -0
- package/dist/{test-graded-scenario-BdVaPyHT.d.ts → sandbox-harness.d.ts} +34 -60
- package/dist/sandbox-harness.d.ts.map +1 -0
- package/dist/sandbox-harness.test.d.ts +2 -0
- package/dist/sandbox-harness.test.d.ts.map +1 -0
- package/dist/sandbox-pool.d.ts +74 -0
- package/dist/sandbox-pool.d.ts.map +1 -0
- package/dist/sandbox-pool.test.d.ts +2 -0
- package/dist/sandbox-pool.test.d.ts.map +1 -0
- package/dist/scorecard.d.ts +133 -0
- package/dist/scorecard.d.ts.map +1 -0
- package/dist/scorecard.test.d.ts +2 -0
- package/dist/scorecard.test.d.ts.map +1 -0
- package/dist/self-play.d.ts +69 -0
- package/dist/self-play.d.ts.map +1 -0
- package/dist/semantic-concept-judge.d.ts +135 -0
- package/dist/semantic-concept-judge.d.ts.map +1 -0
- package/dist/semantic-concept-judge.test.d.ts +2 -0
- package/dist/semantic-concept-judge.test.d.ts.map +1 -0
- package/dist/{sequential-5iSVfzl2.d.ts → sequential.d.ts} +9 -10
- package/dist/sequential.d.ts.map +1 -0
- package/dist/{series-convergence-D5OWMBg6.d.ts → series-convergence.d.ts} +4 -5
- package/dist/series-convergence.d.ts.map +1 -0
- package/dist/slo.d.ts +48 -0
- package/dist/slo.d.ts.map +1 -0
- package/dist/state-continuity.d.ts +47 -0
- package/dist/state-continuity.d.ts.map +1 -0
- package/dist/{statistics-C7PozGrZ.d.ts → statistics.d.ts} +152 -39
- package/dist/statistics.d.ts.map +1 -0
- package/dist/statistics.test.d.ts +2 -0
- package/dist/statistics.test.d.ts.map +1 -0
- package/dist/steering-optimizer.d.ts +58 -0
- package/dist/steering-optimizer.d.ts.map +1 -0
- package/dist/steering.d.ts +24 -0
- package/dist/steering.d.ts.map +1 -0
- package/dist/storyboard/code-edit.d.ts +64 -0
- package/dist/storyboard/code-edit.d.ts.map +1 -0
- package/dist/storyboard/code-edit.test.d.ts +2 -0
- package/dist/storyboard/code-edit.test.d.ts.map +1 -0
- package/dist/storyboard/index.d.ts +16 -81
- package/dist/storyboard/index.d.ts.map +1 -0
- package/dist/storyboard/index.test.d.ts +2 -0
- package/dist/storyboard/index.test.d.ts.map +1 -0
- package/dist/{summary-report-DGmUucwQ.d.ts → summary-report.d.ts} +23 -160
- package/dist/summary-report.d.ts.map +1 -0
- package/dist/telemetry/client.d.ts +35 -0
- package/dist/telemetry/client.d.ts.map +1 -0
- package/dist/telemetry/index.d.ts +17 -35
- package/dist/telemetry/index.d.ts.map +1 -0
- package/dist/telemetry/schema.d.ts +61 -0
- package/dist/telemetry/schema.d.ts.map +1 -0
- package/dist/telemetry/sink-fetch.d.ts +39 -0
- package/dist/telemetry/sink-fetch.d.ts.map +1 -0
- package/dist/telemetry/{file.d.ts → sink-file.d.ts} +5 -7
- package/dist/telemetry/sink-file.d.ts.map +1 -0
- package/dist/test-graded-scenario.d.ts +42 -0
- package/dist/test-graded-scenario.d.ts.map +1 -0
- package/dist/testing.d.ts +5 -0
- package/dist/testing.d.ts.map +1 -0
- package/dist/testing.js +8 -0
- package/dist/testing.js.map +1 -0
- package/dist/tool-use-metrics.d.ts +35 -0
- package/dist/tool-use-metrics.d.ts.map +1 -0
- package/dist/trace/capture-fetch.d.ts +48 -0
- package/dist/trace/capture-fetch.d.ts.map +1 -0
- package/dist/trace/capture-fetch.test.d.ts +2 -0
- package/dist/trace/capture-fetch.test.d.ts.map +1 -0
- package/dist/{emitter-DEZwY14K.d.ts → trace/emitter.d.ts} +9 -12
- package/dist/trace/emitter.d.ts.map +1 -0
- package/dist/trace/extract-usage.d.ts +46 -0
- package/dist/trace/extract-usage.d.ts.map +1 -0
- package/dist/trace/extract-usage.test.d.ts +2 -0
- package/dist/trace/extract-usage.test.d.ts.map +1 -0
- package/dist/trace/index.d.ts +15 -0
- package/dist/trace/index.d.ts.map +1 -0
- package/dist/{integrity-VJ9A7aST.d.ts → trace/integrity.d.ts} +11 -14
- package/dist/trace/integrity.d.ts.map +1 -0
- package/dist/trace/otel-bridge.d.ts +29 -0
- package/dist/trace/otel-bridge.d.ts.map +1 -0
- package/dist/trace/otel-export.d.ts +52 -0
- package/dist/trace/otel-export.d.ts.map +1 -0
- package/dist/trace/otel.d.ts +57 -0
- package/dist/trace/otel.d.ts.map +1 -0
- package/dist/trace/otlp-attributes.d.ts +17 -0
- package/dist/trace/otlp-attributes.d.ts.map +1 -0
- package/dist/trace/query.d.ts +29 -0
- package/dist/trace/query.d.ts.map +1 -0
- package/dist/trace/query.test.d.ts +2 -0
- package/dist/trace/query.test.d.ts.map +1 -0
- package/dist/{raw-provider-sink-C46HDghv.d.ts → trace/raw-provider-sink.d.ts} +13 -14
- package/dist/trace/raw-provider-sink.d.ts.map +1 -0
- package/dist/{redact-B40YG2M_.d.ts → trace/redact.d.ts} +7 -8
- package/dist/trace/redact.d.ts.map +1 -0
- package/dist/{schema-m0gsnbt3.d.ts → trace/schema.d.ts} +29 -30
- package/dist/trace/schema.d.ts.map +1 -0
- package/dist/trace/store-to-otlp.d.ts +72 -0
- package/dist/trace/store-to-otlp.d.ts.map +1 -0
- package/dist/trace/store-to-otlp.test.d.ts +2 -0
- package/dist/trace/store-to-otlp.test.d.ts.map +1 -0
- package/dist/{store-CKUAgsJz.d.ts → trace/store.d.ts} +37 -13
- package/dist/trace/store.d.ts.map +1 -0
- package/dist/trace/store.test.d.ts +2 -0
- package/dist/trace/store.test.d.ts.map +1 -0
- package/dist/{analyst-C8HHvfJp.d.ts → trace-analyst/analyst.d.ts} +12 -14
- package/dist/trace-analyst/analyst.d.ts.map +1 -0
- package/dist/trace-analyst/analyst.test.d.ts +2 -0
- package/dist/trace-analyst/analyst.test.d.ts.map +1 -0
- package/dist/trace-analyst/behavioral-metrics.d.ts +40 -0
- package/dist/trace-analyst/behavioral-metrics.d.ts.map +1 -0
- package/dist/trace-analyst/behavioral-metrics.test.d.ts +2 -0
- package/dist/trace-analyst/behavioral-metrics.test.d.ts.map +1 -0
- package/dist/trace-analyst/hook.d.ts +55 -0
- package/dist/trace-analyst/hook.d.ts.map +1 -0
- package/dist/trace-analyst/index.d.ts +18 -0
- package/dist/trace-analyst/index.d.ts.map +1 -0
- package/dist/trace-analyst/insights.d.ts +71 -0
- package/dist/trace-analyst/insights.d.ts.map +1 -0
- package/dist/trace-analyst/insights.test.d.ts +2 -0
- package/dist/trace-analyst/insights.test.d.ts.map +1 -0
- package/dist/trace-analyst/otlp-flatten.d.ts +42 -0
- package/dist/trace-analyst/otlp-flatten.d.ts.map +1 -0
- package/dist/trace-analyst/otlp-span.d.ts +85 -0
- package/dist/trace-analyst/otlp-span.d.ts.map +1 -0
- package/dist/trace-analyst/otlp-span.test.d.ts +2 -0
- package/dist/trace-analyst/otlp-span.test.d.ts.map +1 -0
- package/dist/trace-analyst/otlp-to-run-records.d.ts +115 -0
- package/dist/trace-analyst/otlp-to-run-records.d.ts.map +1 -0
- package/dist/trace-analyst/otlp-to-run-records.test.d.ts +2 -0
- package/dist/trace-analyst/otlp-to-run-records.test.d.ts.map +1 -0
- package/dist/trace-analyst/otlp-to-run-records.timestamps.test.d.ts +2 -0
- package/dist/trace-analyst/otlp-to-run-records.timestamps.test.d.ts.map +1 -0
- package/dist/trace-analyst/prompts.d.ts +6 -0
- package/dist/trace-analyst/prompts.d.ts.map +1 -0
- package/dist/trace-analyst/store-otlp.d.ts +126 -0
- package/dist/trace-analyst/store-otlp.d.ts.map +1 -0
- package/dist/trace-analyst/store-otlp.test.d.ts +8 -0
- package/dist/trace-analyst/store-otlp.test.d.ts.map +1 -0
- package/dist/trace-analyst/store-otlp.timestamps.test.d.ts +2 -0
- package/dist/trace-analyst/store-otlp.timestamps.test.d.ts.map +1 -0
- package/dist/trace-analyst/store.d.ts +63 -0
- package/dist/trace-analyst/store.d.ts.map +1 -0
- package/dist/trace-analyst/tools.d.ts +44 -0
- package/dist/trace-analyst/tools.d.ts.map +1 -0
- package/dist/trace-analyst/tools.test.d.ts +10 -0
- package/dist/trace-analyst/tools.test.d.ts.map +1 -0
- package/dist/{store-C1YxJDEK.d.ts → trace-analyst/types.d.ts} +18 -74
- package/dist/trace-analyst/types.d.ts.map +1 -0
- package/dist/trace-contracts.d.ts +180 -0
- package/dist/trace-contracts.d.ts.map +1 -0
- package/dist/traced-analyst.d.ts +26 -0
- package/dist/traced-analyst.d.ts.map +1 -0
- package/dist/traced-judges.d.ts +27 -0
- package/dist/traced-judges.d.ts.map +1 -0
- package/dist/traces.d.ts +4 -947
- package/dist/traces.d.ts.map +1 -0
- package/dist/traces.js +42 -12
- package/dist/{trajectory-GEdXJCL5.d.ts → trajectory.d.ts} +8 -9
- package/dist/trajectory.d.ts.map +1 -0
- package/dist/{types-Croy5h7V.d.ts → types.d.ts} +33 -33
- package/dist/types.d.ts.map +1 -0
- package/dist/ui-finding.d.ts +104 -0
- package/dist/ui-finding.d.ts.map +1 -0
- package/dist/verdict-cache.d.ts +78 -0
- package/dist/verdict-cache.d.ts.map +1 -0
- package/dist/verdict-cache.test.d.ts +2 -0
- package/dist/verdict-cache.test.d.ts.map +1 -0
- package/dist/{verdict-C9MlYujm.d.ts → verdict.d.ts} +2 -3
- package/dist/verdict.d.ts.map +1 -0
- package/dist/visual-diff.d.ts +32 -0
- package/dist/visual-diff.d.ts.map +1 -0
- package/dist/wire/handlers.d.ts +54 -0
- package/dist/wire/handlers.d.ts.map +1 -0
- package/dist/wire/index.d.ts +13 -570
- package/dist/wire/index.d.ts.map +1 -0
- package/dist/wire/index.js +2 -2
- package/dist/wire/openapi.d.ts +3 -0
- package/dist/wire/openapi.d.ts.map +1 -0
- package/dist/wire/rpc.d.ts +21 -0
- package/dist/wire/rpc.d.ts.map +1 -0
- package/dist/wire/rubrics.d.ts +34 -0
- package/dist/wire/rubrics.d.ts.map +1 -0
- package/dist/wire/schemas.d.ts +410 -0
- package/dist/wire/schemas.d.ts.map +1 -0
- package/dist/wire/server.d.ts +60 -0
- package/dist/wire/server.d.ts.map +1 -0
- package/dist/workflow/event-schema.d.ts +5 -0
- package/dist/workflow/event-schema.d.ts.map +1 -0
- package/dist/workflow/feedback-pack.d.ts +99 -0
- package/dist/workflow/feedback-pack.d.ts.map +1 -0
- package/dist/workflow/index.d.ts +22 -495
- package/dist/workflow/index.d.ts.map +1 -0
- package/dist/workflow/index.js +2 -2
- package/dist/workflow/intelligence-export.d.ts +62 -0
- package/dist/workflow/intelligence-export.d.ts.map +1 -0
- package/dist/workflow/partner-report.d.ts +49 -0
- package/dist/workflow/partner-report.d.ts.map +1 -0
- package/dist/workflow/phase-graph.d.ts +43 -0
- package/dist/workflow/phase-graph.d.ts.map +1 -0
- package/dist/workflow/promotion-gate.d.ts +61 -0
- package/dist/workflow/promotion-gate.d.ts.map +1 -0
- package/dist/workflow/run-record.d.ts +12 -0
- package/dist/workflow/run-record.d.ts.map +1 -0
- package/dist/workflow/runtime-adapter.d.ts +20 -0
- package/dist/workflow/runtime-adapter.d.ts.map +1 -0
- package/dist/workflow/sanitize.d.ts +21 -0
- package/dist/workflow/sanitize.d.ts.map +1 -0
- package/dist/workflow/schema.d.ts +5 -0
- package/dist/workflow/schema.d.ts.map +1 -0
- package/dist/workflow/summary.d.ts +43 -0
- package/dist/workflow/summary.d.ts.map +1 -0
- package/dist/workflow/trace-event-fields.d.ts +6 -0
- package/dist/workflow/trace-event-fields.d.ts.map +1 -0
- package/dist/workflow/trajectory.d.ts +15 -0
- package/dist/workflow/trajectory.d.ts.map +1 -0
- package/dist/workflow/types.d.ts +68 -0
- package/dist/workflow/types.d.ts.map +1 -0
- package/dist/workspace-inspector.d.ts +67 -0
- package/dist/workspace-inspector.d.ts.map +1 -0
- package/dist/wrangler-deploy-runner.test.d.ts +2 -0
- package/dist/wrangler-deploy-runner.test.d.ts.map +1 -0
- package/docs/campaign-proposers.md +170 -0
- package/docs/concepts.md +8 -4
- package/docs/customer-journeys.md +15 -13
- package/docs/design/loop-taxonomy.md +34 -66
- package/docs/distributed-driver.md +14 -14
- package/docs/feature-guide.md +1 -1
- package/docs/hosted-ingest-spec.md +2 -3
- package/docs/multi-shot-optimization.md +8 -8
- package/docs/product-eval-adoption.md +1 -1
- package/docs/self-improvement-map.md +33 -29
- package/package.json +9 -15
- package/dist/calibration-Cpr3WaX3.d.ts +0 -101
- package/dist/chunk-47X6LRCE.js.map +0 -1
- package/dist/chunk-6SOJM3VR.js.map +0 -1
- package/dist/chunk-CVVHBFGN.js.map +0 -1
- package/dist/chunk-D3V5B42D.js.map +0 -1
- package/dist/chunk-E4GH6USR.js.map +0 -1
- package/dist/chunk-GSH6QNNS.js.map +0 -1
- package/dist/chunk-KWRRMR3J.js.map +0 -1
- package/dist/chunk-LMZQ2Z4U.js.map +0 -1
- package/dist/chunk-QAY5UIJO.js.map +0 -1
- package/dist/chunk-QG2OVF2D.js.map +0 -1
- package/dist/chunk-T375SUOZ.js.map +0 -1
- package/dist/chunk-TWS7AZEY.js.map +0 -1
- package/dist/chunk-UMMZHCPB.js.map +0 -1
- package/dist/chunk-XY4DDNEG.js.map +0 -1
- package/dist/chunk-ZFIBGEOL.js.map +0 -1
- package/dist/control-_Qb7skHX.d.ts +0 -259
- package/dist/corpus-BoR-041R.d.ts +0 -560
- package/dist/failure-cluster-CL7IVgkJ.d.ts +0 -76
- package/dist/harness-optimizer-EnEnQPsr.d.ts +0 -106
- package/dist/index-Bx3gZ8xl.d.ts +0 -159
- package/dist/pre-registration-mAnCugl9.d.ts +0 -523
- package/dist/provenance-LnqRT0sS.d.ts +0 -441
- package/dist/query-CqTxMwDw.d.ts +0 -31
- package/dist/release-report-euXIV_Sk.d.ts +0 -233
- package/dist/run-critic-BAIjX99r.d.ts +0 -56
- package/dist/run-improvement-loop-5z_l5zDz.d.ts +0 -427
- package/dist/runtime-trajectory-BDgfGZSr.d.ts +0 -49
- package/dist/semantic-concept-judge-Dn8Z6KEG.d.ts +0 -624
- package/dist/sink-fetch-B1Yg4Til.d.ts +0 -101
- package/docs/design/external-agent-wedge.md +0 -89
- package/docs/design/phase-d-rfc.md +0 -125
- package/docs/design/phase4-consumer-migration.md +0 -70
- package/docs/design/primitives-integration-spec.md +0 -393
- package/docs/design/product-self-improvement-loop.md +0 -146
- package/docs/design/self-improvement-engine.md +0 -140
- package/docs/design/self-improvement-protocol.md +0 -223
- package/docs/design/self-improvement-roadmap.md +0 -106
- package/docs/design/substrate-gaps.md +0 -118
- package/docs/phase-b-pairing-kit.md +0 -188
- package/docs/phase-b-runbook.md +0 -176
- package/docs/pilot/README.md +0 -62
- package/docs/pilot/customer-checklist.md +0 -90
- package/docs/pilot/integration-foreign-stack.md +0 -296
- package/docs/pilot/integration-tangle-stack.md +0 -248
- package/docs/pilot/one-pager.md +0 -161
- package/docs/pilot/sample-insight-report.json +0 -172
- package/docs/quickstart-external.md +0 -229
- package/docs/research/belief-state-agent-eval-roadmap.md +0 -593
- package/docs/research/research-roadmap.md +0 -205
- package/docs/specs/driver-honest-spec.md +0 -251
- package/docs/specs/hermes-self-improvement-audit.md +0 -93
- package/docs/specs/profile-versioning.md +0 -291
- package/docs/three-package-architecture.md +0 -168
- /package/dist/{chunk-QS3RBQPI.js.map → chunk-D5KBVULY.js.map} +0 -0
- /package/dist/{chunk-UHMJT4T7.js.map → chunk-IZCEK2HR.js.map} +0 -0
- /package/dist/{chunk-L3JOU6XM.js.map → chunk-NACM5RS7.js.map} +0 -0
- /package/dist/{chunk-4FBZZIYD.js.map → chunk-QTMYW64F.js.map} +0 -0
- /package/dist/{chunk-CY6U5S3X.js.map → chunk-URWVKRCS.js.map} +0 -0
- /package/dist/{chunk-Y47J2LJ3.js.map → chunk-Z6L6YSU6.js.map} +0 -0
- /package/dist/{run-campaign-RDGAM5KJ.js.map → run-campaign-WXY7KI67.js.map} +0 -0
|
@@ -1,250 +1,5 @@
|
|
|
1
|
-
|
|
2
|
-
|
|
3
|
-
|
|
4
|
-
|
|
5
|
-
|
|
6
|
-
/**
|
|
7
|
-
* BuilderSession — ties a builder-of-builders workflow together.
|
|
8
|
-
*
|
|
9
|
-
* Models agent-builder's shape: Project → Chat → Edit → Ship → App →
|
|
10
|
-
* AppAgent. Each layer is a Run (linked via parentRunId). The
|
|
11
|
-
* framework-enforced invariants:
|
|
12
|
-
*
|
|
13
|
-
* - One Project → many Chats; chatId scopes runs within a project.
|
|
14
|
-
* - One Chat = one builder Run with `layer='builder'`.
|
|
15
|
-
* - One Ship = one child Run with `layer='app-build'` + SandboxHarness.
|
|
16
|
-
* - One AppScenario = one grandchild Run with `layer='app-runtime'`.
|
|
17
|
-
*
|
|
18
|
-
* Consumers obtain a BuilderSession, call `startChat`, drive the
|
|
19
|
-
* builder agent (emitting spans), and call `ship` / `runAppScenario`
|
|
20
|
-
* as the workflow progresses. The session reconstructs itself from
|
|
21
|
-
* trace data via `resume(store, projectId)`.
|
|
22
|
-
*/
|
|
23
|
-
|
|
24
|
-
interface BuilderSessionInit {
|
|
25
|
-
projectId: string;
|
|
26
|
-
chatId?: string;
|
|
27
|
-
/** Free-form: user's task description, project name, etc. Stored on the builder Run. */
|
|
28
|
-
tags?: Record<string, string>;
|
|
29
|
-
}
|
|
30
|
-
interface ShipOptions {
|
|
31
|
-
harness: HarnessConfig;
|
|
32
|
-
driver?: SandboxDriver;
|
|
33
|
-
/** scenarioId of this app-build run. Defaults to `${projectId}/build`. */
|
|
34
|
-
scenarioId?: string;
|
|
35
|
-
}
|
|
36
|
-
interface RunAppScenarioOptions {
|
|
37
|
-
scenario: TestGradedScenario;
|
|
38
|
-
/** Harness driver override; defaults to the one the session was created with. */
|
|
39
|
-
driver?: SandboxDriver;
|
|
40
|
-
}
|
|
41
|
-
declare class BuilderSession {
|
|
42
|
-
private store;
|
|
43
|
-
private builderEmitter;
|
|
44
|
-
readonly projectId: string;
|
|
45
|
-
readonly chatId: string;
|
|
46
|
-
private builderRunId?;
|
|
47
|
-
private lastBuildRunId?;
|
|
48
|
-
private defaultDriver?;
|
|
49
|
-
constructor(store: TraceStore, init: BuilderSessionInit, driver?: SandboxDriver);
|
|
50
|
-
/** Start the builder (L0) run for this chat. Returns the runId. */
|
|
51
|
-
startChat(scenarioId?: string): Promise<string>;
|
|
52
|
-
/** The emitter for builder-level spans (edits, LLM calls, tool invocations). */
|
|
53
|
-
get emitter(): TraceEmitter;
|
|
54
|
-
/**
|
|
55
|
-
* Ship the project's generated app: run the sandbox harness as a child
|
|
56
|
-
* Run (`layer='app-build'`). Returns the build result + runId.
|
|
57
|
-
*/
|
|
58
|
-
ship(options: ShipOptions): Promise<{
|
|
59
|
-
runId: string;
|
|
60
|
-
result: SandboxHarnessResult;
|
|
61
|
-
}>;
|
|
62
|
-
/**
|
|
63
|
-
* Run a domain scenario against the just-built app as a grandchild Run
|
|
64
|
-
* (`layer='app-runtime'`). The `ship` call must precede this so the
|
|
65
|
-
* parent is set correctly; if no build exists yet the session attaches
|
|
66
|
-
* directly to the builder run (useful for prototypes).
|
|
67
|
-
*/
|
|
68
|
-
runAppScenario(options: RunAppScenarioOptions): Promise<TestGradedRunResult>;
|
|
69
|
-
/** Record an end-of-chat meta score (judge verdict on whether the builder
|
|
70
|
-
* served the user's intent). Accepts a numeric score + optional rationale. */
|
|
71
|
-
recordMetaScore(score: number, rationale?: string): Promise<void>;
|
|
72
|
-
/** Close the builder Run with a final outcome. */
|
|
73
|
-
endChat(outcome: {
|
|
74
|
-
pass: boolean;
|
|
75
|
-
score?: number;
|
|
76
|
-
notes?: string;
|
|
77
|
-
}): Promise<void>;
|
|
78
|
-
/**
|
|
79
|
-
* Inline app-runtime run — for cases where the "scenario" isn't a
|
|
80
|
-
* SWE-bench-style test suite but a live agent interaction (LLM chat,
|
|
81
|
-
* domain flow). Returns an emitter bound to a fresh Run in the
|
|
82
|
-
* `app-runtime` layer; caller emits spans inside and calls
|
|
83
|
-
* `.endRun()` with the final verdict.
|
|
84
|
-
*/
|
|
85
|
-
startAppRuntime(scenarioId: string): Promise<TraceEmitter>;
|
|
86
|
-
/**
|
|
87
|
-
* Lightweight "ship marker" — record an app-build Run with a caller-
|
|
88
|
-
* provided verdict. Use when there isn't a sandbox harness to run but
|
|
89
|
-
* you still want to mark the build state at publish time.
|
|
90
|
-
*/
|
|
91
|
-
recordShipMarker(args: {
|
|
92
|
-
pass: boolean;
|
|
93
|
-
score: number;
|
|
94
|
-
scenarioId?: string;
|
|
95
|
-
notes?: string;
|
|
96
|
-
}): Promise<string>;
|
|
97
|
-
get lastBuildRunIdValue(): string | undefined;
|
|
98
|
-
get builderRunIdValue(): string | undefined;
|
|
99
|
-
}
|
|
100
|
-
/**
|
|
101
|
-
* Reconstruct the most recent BuilderSession state for a given project —
|
|
102
|
-
* returns { builderRunId, lastBuildRunId, chatRuns }. For chat-first UIs
|
|
103
|
-
* this is how a resumed session finds its place in the edit history.
|
|
104
|
-
*/
|
|
105
|
-
declare function resumeBuilderSession(store: TraceStore, projectId: string): Promise<{
|
|
106
|
-
projectId: string;
|
|
107
|
-
chatRuns: Run[];
|
|
108
|
-
lastBuilderRun?: Run;
|
|
109
|
-
lastBuildRun?: Run;
|
|
110
|
-
lastAppRuntimeRuns: Run[];
|
|
111
|
-
}>;
|
|
112
|
-
|
|
113
|
-
/**
|
|
114
|
-
* Three-layer evaluation — the canonical scoring breakdown for
|
|
115
|
-
* builder-of-builders workflows.
|
|
116
|
-
*
|
|
117
|
-
* meta_score: did the builder understand + satisfy user intent?
|
|
118
|
-
* (judge verdict attached to the builder run)
|
|
119
|
-
* build_score: did the generated scaffold build + pass its own tests?
|
|
120
|
-
* (outcome.score on the app-build child run)
|
|
121
|
-
* runtime_score: did the generated agent pass its domain scenarios?
|
|
122
|
-
* (mean outcome.score over app-runtime grandchild runs)
|
|
123
|
-
*
|
|
124
|
-
* Returns a structured report per project. The cross-layer correlation
|
|
125
|
-
* is the highest-leverage signal the framework computes — if
|
|
126
|
-
* meta_score doesn't predict runtime_score, the builder's self-scoring
|
|
127
|
-
* is broken.
|
|
128
|
-
*
|
|
129
|
-
* Scaffold-only mode: when a project has no `app-runtime` runs (e.g. a
|
|
130
|
-
* scaffold-builder eval that grades compose + build without driving a
|
|
131
|
-
* runtime scenario), `kind` is `'scaffold-only'` and `complete` measures
|
|
132
|
-
* meta + build only. Consumers can tell the two apart without having to
|
|
133
|
-
* interpret null-runtime as either "not yet computed" or "N/A for this
|
|
134
|
-
* project shape".
|
|
135
|
-
*/
|
|
136
|
-
|
|
137
|
-
type ProjectKind = 'full' | 'scaffold-only';
|
|
138
|
-
interface ThreeLayerProjectReport {
|
|
139
|
-
projectId: string;
|
|
140
|
-
/**
|
|
141
|
-
* `'full'` when the project has at least one `app-runtime` run;
|
|
142
|
-
* `'scaffold-only'` when it only has meta + build layers. Lets
|
|
143
|
-
* downstream consumers treat a null runtime score as expected
|
|
144
|
-
* (scaffold-only) vs. missing (full, pipeline broke).
|
|
145
|
-
*/
|
|
146
|
-
kind: ProjectKind;
|
|
147
|
-
builderRunId?: string;
|
|
148
|
-
/** Judge-verdict score on the builder run (0..1 after normalization). */
|
|
149
|
-
metaScore: number | null;
|
|
150
|
-
buildRunId?: string;
|
|
151
|
-
/** 0..1 from the sandbox harness (testsPassed / testsTotal). */
|
|
152
|
-
buildScore: number | null;
|
|
153
|
-
appRuntimeRunIds: string[];
|
|
154
|
-
/** Mean of outcome.score over app-runtime runs, 0..1. Always null in scaffold-only mode. */
|
|
155
|
-
runtimeScore: number | null;
|
|
156
|
-
runtimePassRate: number | null;
|
|
157
|
-
/**
|
|
158
|
-
* Layer-aware completeness:
|
|
159
|
-
* - `kind='full'`: all three layers scored
|
|
160
|
-
* - `kind='scaffold-only'`: meta + build scored (runtime not applicable)
|
|
161
|
-
*/
|
|
162
|
-
complete: boolean;
|
|
163
|
-
}
|
|
164
|
-
declare function scoreProject(store: TraceStore, projectId: string): Promise<ThreeLayerProjectReport>;
|
|
165
|
-
/** Aggregate scoring across every project in a corpus. */
|
|
166
|
-
declare function scoreAllProjects(store: TraceStore): Promise<ThreeLayerProjectReport[]>;
|
|
167
|
-
|
|
168
|
-
/**
|
|
169
|
-
* Meta-eval correlation — the highest-leverage signal in the framework.
|
|
170
|
-
*
|
|
171
|
-
* Given a corpus of three-layer project reports, compute how well each
|
|
172
|
-
* pair of layers correlates. The question we care about most:
|
|
173
|
-
*
|
|
174
|
-
* Does `metaScore` (what the builder thinks it did) predict
|
|
175
|
-
* `runtimeScore` (what the user actually gets)?
|
|
176
|
-
*
|
|
177
|
-
* If r < ~0.4, the builder's self-scoring is broken — it's optimizing
|
|
178
|
-
* for something other than real-world success. If r > 0.7, meta_score
|
|
179
|
-
* is a usable proxy and can drive CI gates cheaply.
|
|
180
|
-
*
|
|
181
|
-
* Non-parametric rank correlation (Spearman) is also reported because
|
|
182
|
-
* meta scores are often ordinal-ish.
|
|
183
|
-
*/
|
|
184
|
-
|
|
185
|
-
interface LayerCorrelation {
|
|
186
|
-
n: number;
|
|
187
|
-
pearson: number;
|
|
188
|
-
spearman: number;
|
|
189
|
-
}
|
|
190
|
-
interface CorrelationReport {
|
|
191
|
-
/** Pairs present in the corpus (layers with ≥ 2 matched data points). */
|
|
192
|
-
metaVsBuild?: LayerCorrelation;
|
|
193
|
-
metaVsRuntime?: LayerCorrelation;
|
|
194
|
-
buildVsRuntime?: LayerCorrelation;
|
|
195
|
-
/** Number of complete projects (all 3 scores present). */
|
|
196
|
-
completeProjects: number;
|
|
197
|
-
}
|
|
198
|
-
declare function correlateLayers(reports: ThreeLayerProjectReport[]): CorrelationReport;
|
|
199
|
-
|
|
200
|
-
/**
|
|
201
|
-
* ProjectRegistry — project-level aggregation over the trace corpus.
|
|
202
|
-
*
|
|
203
|
-
* Thin reader over TraceStore that answers the questions a chat-first,
|
|
204
|
-
* resumable UI needs:
|
|
205
|
-
* - listProjects() → project IDs with latest activity
|
|
206
|
-
* - projectTimeline(id) → chats + builds + runtime runs, chronological
|
|
207
|
-
* - projectChats(id) → chat-level summaries (turn count, outcome)
|
|
208
|
-
*
|
|
209
|
-
* All queries are pure reads; no state duplication.
|
|
210
|
-
*/
|
|
211
|
-
|
|
212
|
-
interface ProjectSummary {
|
|
213
|
-
projectId: string;
|
|
214
|
-
chatCount: number;
|
|
215
|
-
buildCount: number;
|
|
216
|
-
appRuntimeCount: number;
|
|
217
|
-
lastActivityAt: number;
|
|
218
|
-
latestChatId?: string;
|
|
219
|
-
latestOutcome?: {
|
|
220
|
-
pass: boolean;
|
|
221
|
-
score?: number;
|
|
222
|
-
};
|
|
223
|
-
}
|
|
224
|
-
interface ChatSummary {
|
|
225
|
-
chatId: string;
|
|
226
|
-
projectId: string;
|
|
227
|
-
builderRunId: string;
|
|
228
|
-
startedAt: number;
|
|
229
|
-
endedAt?: number;
|
|
230
|
-
status: Run['status'];
|
|
231
|
-
outcome?: Run['outcome'];
|
|
232
|
-
/** Counts of spans emitted during the chat. */
|
|
233
|
-
llmTurns?: number;
|
|
234
|
-
toolCalls?: number;
|
|
235
|
-
buildRunId?: string;
|
|
236
|
-
appRuntimeRunIds: string[];
|
|
237
|
-
}
|
|
238
|
-
interface ProjectTimelineEntry {
|
|
239
|
-
run: Run;
|
|
240
|
-
layerBucket: 'chat' | 'build' | 'runtime' | 'other';
|
|
241
|
-
}
|
|
242
|
-
declare class ProjectRegistry {
|
|
243
|
-
private store;
|
|
244
|
-
constructor(store: TraceStore);
|
|
245
|
-
listProjects(): Promise<ProjectSummary[]>;
|
|
246
|
-
projectTimeline(projectId: string): Promise<ProjectTimelineEntry[]>;
|
|
247
|
-
projectChats(projectId: string): Promise<ChatSummary[]>;
|
|
248
|
-
}
|
|
249
|
-
|
|
250
|
-
export { BuilderSession, type BuilderSessionInit, type ChatSummary, type CorrelationReport, type LayerCorrelation, type ProjectKind, ProjectRegistry, type ProjectSummary, type ProjectTimelineEntry, type RunAppScenarioOptions, type ShipOptions, type ThreeLayerProjectReport, correlateLayers, resumeBuilderSession, scoreAllProjects, scoreProject };
|
|
1
|
+
export * from './builder-session';
|
|
2
|
+
export * from './correlation';
|
|
3
|
+
export * from './project-registry';
|
|
4
|
+
export * from './three-layer-eval';
|
|
5
|
+
//# sourceMappingURL=index.d.ts.map
|
|
@@ -0,0 +1 @@
|
|
|
1
|
+
{"version":3,"file":"index.d.ts","sourceRoot":"","sources":["../../src/builder-eval/index.ts"],"names":[],"mappings":"AAAA,cAAc,mBAAmB,CAAA;AACjC,cAAc,eAAe,CAAA;AAC7B,cAAc,oBAAoB,CAAA;AAClC,cAAc,oBAAoB,CAAA"}
|
|
@@ -1,10 +1,10 @@
|
|
|
1
1
|
import {
|
|
2
2
|
SandboxHarness,
|
|
3
3
|
runTestGradedScenario
|
|
4
|
-
} from "../chunk-
|
|
4
|
+
} from "../chunk-ZOPLCJSY.js";
|
|
5
5
|
import {
|
|
6
6
|
judgeSpans
|
|
7
|
-
} from "../chunk-
|
|
7
|
+
} from "../chunk-UFSG7ACU.js";
|
|
8
8
|
import "../chunk-5BKGXME7.js";
|
|
9
9
|
import {
|
|
10
10
|
TraceEmitter
|
|
@@ -0,0 +1,51 @@
|
|
|
1
|
+
/**
|
|
2
|
+
* ProjectRegistry — project-level aggregation over the trace corpus.
|
|
3
|
+
*
|
|
4
|
+
* Thin reader over TraceStore that answers the questions a chat-first,
|
|
5
|
+
* resumable UI needs:
|
|
6
|
+
* - listProjects() → project IDs with latest activity
|
|
7
|
+
* - projectTimeline(id) → chats + builds + runtime runs, chronological
|
|
8
|
+
* - projectChats(id) → chat-level summaries (turn count, outcome)
|
|
9
|
+
*
|
|
10
|
+
* All queries are pure reads; no state duplication.
|
|
11
|
+
*/
|
|
12
|
+
import type { Run } from '../trace/schema';
|
|
13
|
+
import type { TraceStore } from '../trace/store';
|
|
14
|
+
export interface ProjectSummary {
|
|
15
|
+
projectId: string;
|
|
16
|
+
chatCount: number;
|
|
17
|
+
buildCount: number;
|
|
18
|
+
appRuntimeCount: number;
|
|
19
|
+
lastActivityAt: number;
|
|
20
|
+
latestChatId?: string;
|
|
21
|
+
latestOutcome?: {
|
|
22
|
+
pass: boolean;
|
|
23
|
+
score?: number;
|
|
24
|
+
};
|
|
25
|
+
}
|
|
26
|
+
export interface ChatSummary {
|
|
27
|
+
chatId: string;
|
|
28
|
+
projectId: string;
|
|
29
|
+
builderRunId: string;
|
|
30
|
+
startedAt: number;
|
|
31
|
+
endedAt?: number;
|
|
32
|
+
status: Run['status'];
|
|
33
|
+
outcome?: Run['outcome'];
|
|
34
|
+
/** Counts of spans emitted during the chat. */
|
|
35
|
+
llmTurns?: number;
|
|
36
|
+
toolCalls?: number;
|
|
37
|
+
buildRunId?: string;
|
|
38
|
+
appRuntimeRunIds: string[];
|
|
39
|
+
}
|
|
40
|
+
export interface ProjectTimelineEntry {
|
|
41
|
+
run: Run;
|
|
42
|
+
layerBucket: 'chat' | 'build' | 'runtime' | 'other';
|
|
43
|
+
}
|
|
44
|
+
export declare class ProjectRegistry {
|
|
45
|
+
private store;
|
|
46
|
+
constructor(store: TraceStore);
|
|
47
|
+
listProjects(): Promise<ProjectSummary[]>;
|
|
48
|
+
projectTimeline(projectId: string): Promise<ProjectTimelineEntry[]>;
|
|
49
|
+
projectChats(projectId: string): Promise<ChatSummary[]>;
|
|
50
|
+
}
|
|
51
|
+
//# sourceMappingURL=project-registry.d.ts.map
|
|
@@ -0,0 +1 @@
|
|
|
1
|
+
{"version":3,"file":"project-registry.d.ts","sourceRoot":"","sources":["../../src/builder-eval/project-registry.ts"],"names":[],"mappings":"AAAA;;;;;;;;;;GAUG;AAEH,OAAO,KAAK,EAAE,GAAG,EAAE,MAAM,iBAAiB,CAAA;AAC1C,OAAO,KAAK,EAAE,UAAU,EAAE,MAAM,gBAAgB,CAAA;AAEhD,MAAM,WAAW,cAAc;IAC7B,SAAS,EAAE,MAAM,CAAA;IACjB,SAAS,EAAE,MAAM,CAAA;IACjB,UAAU,EAAE,MAAM,CAAA;IAClB,eAAe,EAAE,MAAM,CAAA;IACvB,cAAc,EAAE,MAAM,CAAA;IACtB,YAAY,CAAC,EAAE,MAAM,CAAA;IACrB,aAAa,CAAC,EAAE;QAAE,IAAI,EAAE,OAAO,CAAC;QAAC,KAAK,CAAC,EAAE,MAAM,CAAA;KAAE,CAAA;CAClD;AAED,MAAM,WAAW,WAAW;IAC1B,MAAM,EAAE,MAAM,CAAA;IACd,SAAS,EAAE,MAAM,CAAA;IACjB,YAAY,EAAE,MAAM,CAAA;IACpB,SAAS,EAAE,MAAM,CAAA;IACjB,OAAO,CAAC,EAAE,MAAM,CAAA;IAChB,MAAM,EAAE,GAAG,CAAC,QAAQ,CAAC,CAAA;IACrB,OAAO,CAAC,EAAE,GAAG,CAAC,SAAS,CAAC,CAAA;IACxB,+CAA+C;IAC/C,QAAQ,CAAC,EAAE,MAAM,CAAA;IACjB,SAAS,CAAC,EAAE,MAAM,CAAA;IAClB,UAAU,CAAC,EAAE,MAAM,CAAA;IACnB,gBAAgB,EAAE,MAAM,EAAE,CAAA;CAC3B;AAED,MAAM,WAAW,oBAAoB;IACnC,GAAG,EAAE,GAAG,CAAA;IACR,WAAW,EAAE,MAAM,GAAG,OAAO,GAAG,SAAS,GAAG,OAAO,CAAA;CACpD;AAED,qBAAa,eAAe;IACd,OAAO,CAAC,KAAK;gBAAL,KAAK,EAAE,UAAU;IAE/B,YAAY,IAAI,OAAO,CAAC,cAAc,EAAE,CAAC;IAgCzC,eAAe,CAAC,SAAS,EAAE,MAAM,GAAG,OAAO,CAAC,oBAAoB,EAAE,CAAC;IAgBnE,YAAY,CAAC,SAAS,EAAE,MAAM,GAAG,OAAO,CAAC,WAAW,EAAE,CAAC;CAkC9D"}
|
|
@@ -0,0 +1,55 @@
|
|
|
1
|
+
/**
|
|
2
|
+
* Three-layer evaluation — the canonical scoring breakdown for
|
|
3
|
+
* builder-of-builders workflows.
|
|
4
|
+
*
|
|
5
|
+
* meta_score: did the builder understand + satisfy user intent?
|
|
6
|
+
* (judge verdict attached to the builder run)
|
|
7
|
+
* build_score: did the generated scaffold build + pass its own tests?
|
|
8
|
+
* (outcome.score on the app-build child run)
|
|
9
|
+
* runtime_score: did the generated agent pass its domain scenarios?
|
|
10
|
+
* (mean outcome.score over app-runtime grandchild runs)
|
|
11
|
+
*
|
|
12
|
+
* Returns a structured report per project. The cross-layer correlation
|
|
13
|
+
* is the highest-leverage signal the framework computes — if
|
|
14
|
+
* meta_score doesn't predict runtime_score, the builder's self-scoring
|
|
15
|
+
* is broken.
|
|
16
|
+
*
|
|
17
|
+
* Scaffold-only mode: when a project has no `app-runtime` runs (e.g. a
|
|
18
|
+
* scaffold-builder eval that grades compose + build without driving a
|
|
19
|
+
* runtime scenario), `kind` is `'scaffold-only'` and `complete` measures
|
|
20
|
+
* meta + build only. Consumers can tell the two apart without having to
|
|
21
|
+
* interpret null-runtime as either "not yet computed" or "N/A for this
|
|
22
|
+
* project shape".
|
|
23
|
+
*/
|
|
24
|
+
import type { TraceStore } from '../trace/store';
|
|
25
|
+
export type ProjectKind = 'full' | 'scaffold-only';
|
|
26
|
+
export interface ThreeLayerProjectReport {
|
|
27
|
+
projectId: string;
|
|
28
|
+
/**
|
|
29
|
+
* `'full'` when the project has at least one `app-runtime` run;
|
|
30
|
+
* `'scaffold-only'` when it only has meta + build layers. Lets
|
|
31
|
+
* downstream consumers treat a null runtime score as expected
|
|
32
|
+
* (scaffold-only) vs. missing (full, pipeline broke).
|
|
33
|
+
*/
|
|
34
|
+
kind: ProjectKind;
|
|
35
|
+
builderRunId?: string;
|
|
36
|
+
/** Judge-verdict score on the builder run (0..1 after normalization). */
|
|
37
|
+
metaScore: number | null;
|
|
38
|
+
buildRunId?: string;
|
|
39
|
+
/** 0..1 from the sandbox harness (testsPassed / testsTotal). */
|
|
40
|
+
buildScore: number | null;
|
|
41
|
+
appRuntimeRunIds: string[];
|
|
42
|
+
/** Mean of outcome.score over app-runtime runs, 0..1. Always null in scaffold-only mode. */
|
|
43
|
+
runtimeScore: number | null;
|
|
44
|
+
runtimePassRate: number | null;
|
|
45
|
+
/**
|
|
46
|
+
* Layer-aware completeness:
|
|
47
|
+
* - `kind='full'`: all three layers scored
|
|
48
|
+
* - `kind='scaffold-only'`: meta + build scored (runtime not applicable)
|
|
49
|
+
*/
|
|
50
|
+
complete: boolean;
|
|
51
|
+
}
|
|
52
|
+
export declare function scoreProject(store: TraceStore, projectId: string): Promise<ThreeLayerProjectReport>;
|
|
53
|
+
/** Aggregate scoring across every project in a corpus. */
|
|
54
|
+
export declare function scoreAllProjects(store: TraceStore): Promise<ThreeLayerProjectReport[]>;
|
|
55
|
+
//# sourceMappingURL=three-layer-eval.d.ts.map
|
|
@@ -0,0 +1 @@
|
|
|
1
|
+
{"version":3,"file":"three-layer-eval.d.ts","sourceRoot":"","sources":["../../src/builder-eval/three-layer-eval.ts"],"names":[],"mappings":"AAAA;;;;;;;;;;;;;;;;;;;;;;GAsBG;AAIH,OAAO,KAAK,EAAE,UAAU,EAAE,MAAM,gBAAgB,CAAA;AAEhD,MAAM,MAAM,WAAW,GAAG,MAAM,GAAG,eAAe,CAAA;AAElD,MAAM,WAAW,uBAAuB;IACtC,SAAS,EAAE,MAAM,CAAA;IACjB;;;;;OAKG;IACH,IAAI,EAAE,WAAW,CAAA;IACjB,YAAY,CAAC,EAAE,MAAM,CAAA;IACrB,yEAAyE;IACzE,SAAS,EAAE,MAAM,GAAG,IAAI,CAAA;IACxB,UAAU,CAAC,EAAE,MAAM,CAAA;IACnB,gEAAgE;IAChE,UAAU,EAAE,MAAM,GAAG,IAAI,CAAA;IACzB,gBAAgB,EAAE,MAAM,EAAE,CAAA;IAC1B,4FAA4F;IAC5F,YAAY,EAAE,MAAM,GAAG,IAAI,CAAA;IAC3B,eAAe,EAAE,MAAM,GAAG,IAAI,CAAA;IAC9B;;;;OAIG;IACH,QAAQ,EAAE,OAAO,CAAA;CAClB;AAED,wBAAsB,YAAY,CAChC,KAAK,EAAE,UAAU,EACjB,SAAS,EAAE,MAAM,GAChB,OAAO,CAAC,uBAAuB,CAAC,CAoClC;AAED,0DAA0D;AAC1D,wBAAsB,gBAAgB,CAAC,KAAK,EAAE,UAAU,GAAG,OAAO,CAAC,uBAAuB,EAAE,CAAC,CAI5F"}
|
|
@@ -0,0 +1,108 @@
|
|
|
1
|
+
/**
|
|
2
|
+
* Make the trace-analyst's OWN prompt a GEPA-optimizable surface.
|
|
3
|
+
*
|
|
4
|
+
* The analyst that drives self-improvement is itself a prompt — and a
|
|
5
|
+
* hand-tuned one (a hardcoded, hand-versioned `const`). This module lets the
|
|
6
|
+
* loop optimize it: the analyst `actorDescription` becomes a `MutableSurface`
|
|
7
|
+
* that `gepaProposer` / `haloProposer` / any `SurfaceProposer` can mutate inside
|
|
8
|
+
* `runImprovementLoop` or `compareProposers`. That is the second-order loop —
|
|
9
|
+
* optimizing the optimizer's eyes, not just the agent's prompt.
|
|
10
|
+
*
|
|
11
|
+
* Two pieces, both deliberately small (the loop engine already exists — this
|
|
12
|
+
* only supplies the analyst-shaped dispatch + an objective scorer):
|
|
13
|
+
*
|
|
14
|
+
* - `buildAnalystSurfaceDispatch` — `dispatchWithSurface(surface, scenario)`
|
|
15
|
+
* runs `analyzeTraces` with `surface` as the actorDescription over the
|
|
16
|
+
* scenario's fixed trace corpus, returning its findings.
|
|
17
|
+
* - `failureModeRecallJudge` — a DETERMINISTIC judge (no LLM, no opinion)
|
|
18
|
+
* that scores those findings against the scenario's GROUND-TRUTH failure
|
|
19
|
+
* modes. This is what keeps optimizing the analyst prompt ungameable: the
|
|
20
|
+
* labels come from objective signal (e.g. AppWorld `world.evaluate()` tells
|
|
21
|
+
* us which task failed and which API calls were wrong), so we reward an
|
|
22
|
+
* analyst for surfacing the failures that really happened — not for
|
|
23
|
+
* pleasing a judge that could be talked into anything (Goodhart).
|
|
24
|
+
*
|
|
25
|
+
* Wiring (the loop is unchanged; you only pass these in):
|
|
26
|
+
*
|
|
27
|
+
* const dispatchWithSurface = buildAnalystSurfaceDispatch({ analystOptions: { ai } })
|
|
28
|
+
* await runImprovementLoop({
|
|
29
|
+
* baselineSurface: TRACE_ANALYST_ACTOR_DESCRIPTION, // the prompt under optimization
|
|
30
|
+
* scenarios: trainScenarios, // labeled trace corpora
|
|
31
|
+
* holdoutScenarios: heldOutScenarios,
|
|
32
|
+
* dispatchWithSurface,
|
|
33
|
+
* judges: [failureModeRecallJudge()],
|
|
34
|
+
* proposer: gepaProposer({ baseUrl, apiKey }),
|
|
35
|
+
* gate: heldOutGate({ minDelta: 0.02 }),
|
|
36
|
+
* autoOnPromote: 'none',
|
|
37
|
+
* })
|
|
38
|
+
*/
|
|
39
|
+
import type { AnalyzeTracesInput, AnalyzeTracesOptions, AnalyzeTracesResult } from '../trace-analyst/analyst';
|
|
40
|
+
import type { DispatchContext, JudgeConfig, MutableSurface, Scenario } from './types';
|
|
41
|
+
/**
|
|
42
|
+
* A labeled trace scenario: a FIXED trace corpus plus the failure modes a
|
|
43
|
+
* competent analyst MUST surface from it. The labels are ground truth — the
|
|
44
|
+
* objective failures that actually occurred — which is what makes optimizing
|
|
45
|
+
* the analyst prompt against them meaningful rather than circular.
|
|
46
|
+
*/
|
|
47
|
+
export interface AnalystScenario extends Scenario {
|
|
48
|
+
kind: 'analyst-surface';
|
|
49
|
+
/** OTLP-JSONL path or an in-memory store of the traces to analyze. */
|
|
50
|
+
source: AnalyzeTracesOptions['source'];
|
|
51
|
+
/** The domain question handed to the analyst (framing lives here, not in
|
|
52
|
+
* the surface under optimization). */
|
|
53
|
+
question: string;
|
|
54
|
+
/**
|
|
55
|
+
* Ground-truth failure modes a good analyst must identify. A finding "hits"
|
|
56
|
+
* a mode when it contains ANY of the mode's case-insensitive cues. Derive
|
|
57
|
+
* these from objective signal (failed task + which step broke), never from
|
|
58
|
+
* the analyst's own prior output.
|
|
59
|
+
*/
|
|
60
|
+
expectedFailureModes: Array<{
|
|
61
|
+
id: string;
|
|
62
|
+
cues: string[];
|
|
63
|
+
}>;
|
|
64
|
+
/**
|
|
65
|
+
* Cues that mark a finding as HALLUCINATED / out-of-scope for this corpus —
|
|
66
|
+
* naming a tool, error, or failure that did not occur. Presence penalizes
|
|
67
|
+
* precision. Optional; omit to score recall only.
|
|
68
|
+
*/
|
|
69
|
+
forbiddenCues?: string[];
|
|
70
|
+
}
|
|
71
|
+
/** The analyst's output for one scenario — the artifact the judge scores. */
|
|
72
|
+
export interface AnalystArtifact {
|
|
73
|
+
answer: string;
|
|
74
|
+
findings: string[];
|
|
75
|
+
/** The hardcoded-prompt version the analyst reported (provenance only; the
|
|
76
|
+
* optimized surface overrides the actual prompt text used). */
|
|
77
|
+
actorPromptVersion: string;
|
|
78
|
+
}
|
|
79
|
+
export interface BuildAnalystSurfaceDispatchOptions {
|
|
80
|
+
/**
|
|
81
|
+
* Everything `analyzeTraces` needs EXCEPT `actorDescription` (supplied by the
|
|
82
|
+
* surface under optimization) and `source` (supplied by the scenario). `ai`
|
|
83
|
+
* (the AxAIService) is required for a live run.
|
|
84
|
+
*/
|
|
85
|
+
analystOptions: Omit<AnalyzeTracesOptions, 'actorDescription' | 'source'>;
|
|
86
|
+
/** Test seam: defaults to the real `analyzeTraces`. */
|
|
87
|
+
analyze?: (input: AnalyzeTracesInput, options: AnalyzeTracesOptions) => Promise<AnalyzeTracesResult>;
|
|
88
|
+
}
|
|
89
|
+
/**
|
|
90
|
+
* Build the `dispatchWithSurface(surface, scenario, ctx)` the improvement loop
|
|
91
|
+
* calls: run the analyst with `surface` as its actorDescription over the
|
|
92
|
+
* scenario's trace corpus and return its findings.
|
|
93
|
+
*/
|
|
94
|
+
export declare function buildAnalystSurfaceDispatch(opts: BuildAnalystSurfaceDispatchOptions): (surface: MutableSurface, scenario: AnalystScenario, ctx: DispatchContext) => Promise<AnalystArtifact>;
|
|
95
|
+
export interface FailureModeRecallJudgeOptions {
|
|
96
|
+
/** Weight on recall when precision is also scored (forbiddenCues present).
|
|
97
|
+
* Default 0.5 (equal). Recall-only when no forbiddenCues exist. */
|
|
98
|
+
recallWeight?: number;
|
|
99
|
+
}
|
|
100
|
+
/**
|
|
101
|
+
* Deterministic, ground-truth judge for analyst findings. Composite =
|
|
102
|
+
* recall of the scenario's `expectedFailureModes` (optionally blended with a
|
|
103
|
+
* precision term that penalizes findings tripping `forbiddenCues`). No LLM —
|
|
104
|
+
* the score is a function of the labels, so the analyst prompt is optimized
|
|
105
|
+
* toward surfacing real failures, not toward a judge it can flatter.
|
|
106
|
+
*/
|
|
107
|
+
export declare function failureModeRecallJudge(opts?: FailureModeRecallJudgeOptions): JudgeConfig<AnalystArtifact, AnalystScenario>;
|
|
108
|
+
//# sourceMappingURL=analyst-surface.d.ts.map
|
|
@@ -0,0 +1 @@
|
|
|
1
|
+
{"version":3,"file":"analyst-surface.d.ts","sourceRoot":"","sources":["../../src/campaign/analyst-surface.ts"],"names":[],"mappings":"AAAA;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;GAqCG;AAEH,OAAO,KAAK,EACV,kBAAkB,EAClB,oBAAoB,EACpB,mBAAmB,EACpB,MAAM,0BAA0B,CAAA;AAEjC,OAAO,KAAK,EAAE,eAAe,EAAE,WAAW,EAAE,cAAc,EAAE,QAAQ,EAAE,MAAM,SAAS,CAAA;AAErF;;;;;GAKG;AACH,MAAM,WAAW,eAAgB,SAAQ,QAAQ;IAC/C,IAAI,EAAE,iBAAiB,CAAA;IACvB,sEAAsE;IACtE,MAAM,EAAE,oBAAoB,CAAC,QAAQ,CAAC,CAAA;IACtC;2CACuC;IACvC,QAAQ,EAAE,MAAM,CAAA;IAChB;;;;;OAKG;IACH,oBAAoB,EAAE,KAAK,CAAC;QAAE,EAAE,EAAE,MAAM,CAAC;QAAC,IAAI,EAAE,MAAM,EAAE,CAAA;KAAE,CAAC,CAAA;IAC3D;;;;OAIG;IACH,aAAa,CAAC,EAAE,MAAM,EAAE,CAAA;CACzB;AAED,6EAA6E;AAC7E,MAAM,WAAW,eAAe;IAC9B,MAAM,EAAE,MAAM,CAAA;IACd,QAAQ,EAAE,MAAM,EAAE,CAAA;IAClB;oEACgE;IAChE,kBAAkB,EAAE,MAAM,CAAA;CAC3B;AAED,MAAM,WAAW,kCAAkC;IACjD;;;;OAIG;IACH,cAAc,EAAE,IAAI,CAAC,oBAAoB,EAAE,kBAAkB,GAAG,QAAQ,CAAC,CAAA;IACzE,uDAAuD;IACvD,OAAO,CAAC,EAAE,CACR,KAAK,EAAE,kBAAkB,EACzB,OAAO,EAAE,oBAAoB,KAC1B,OAAO,CAAC,mBAAmB,CAAC,CAAA;CAClC;AAYD;;;;GAIG;AACH,wBAAgB,2BAA2B,CACzC,IAAI,EAAE,kCAAkC,GACvC,CACD,OAAO,EAAE,cAAc,EACvB,QAAQ,EAAE,eAAe,EACzB,GAAG,EAAE,eAAe,KACjB,OAAO,CAAC,eAAe,CAAC,CAc5B;AAED,MAAM,WAAW,6BAA6B;IAC5C;wEACoE;IACpE,YAAY,CAAC,EAAE,MAAM,CAAA;CACtB;AAED;;;;;;GAMG;AACH,wBAAgB,sBAAsB,CACpC,IAAI,GAAE,6BAAkC,GACvC,WAAW,CAAC,eAAe,EAAE,eAAe,CAAC,CA6C/C"}
|
|
@@ -0,0 +1 @@
|
|
|
1
|
+
{"version":3,"file":"analyst-surface.test.d.ts","sourceRoot":"","sources":["../../src/campaign/analyst-surface.test.ts"],"names":[],"mappings":""}
|
|
@@ -0,0 +1,46 @@
|
|
|
1
|
+
/**
|
|
2
|
+
* `openAutoPr` — thin shell-out helper for the `runImprovementLoop` preset's
|
|
3
|
+
* `autoOnPromote: 'pr'` mode. Substitutes for the per-product PR-opening
|
|
4
|
+
* code consumers duplicated 4 times. The PR body includes the campaign's
|
|
5
|
+
* manifest hash, gate verdict, and scorecard summary so reviewers can see
|
|
6
|
+
* exactly what was promoted + why.
|
|
7
|
+
*
|
|
8
|
+
* NOT a deploy mechanism — this only OPENS a PR. The human reviews + merges.
|
|
9
|
+
* The Shape B (`autoOnPromote: 'config'`) live-runtime-mutation path is
|
|
10
|
+
* deferred to Pass B with the full shadow / canary / rollback stack.
|
|
11
|
+
*/
|
|
12
|
+
import type { CampaignResult, GateResult, Scenario } from './types';
|
|
13
|
+
export interface OpenAutoPrOptions<TArtifact, TScenario extends Scenario> {
|
|
14
|
+
/** Campaign result to attach to the PR. */
|
|
15
|
+
result: CampaignResult<TArtifact, TScenario>;
|
|
16
|
+
/** Gate verdict explaining the promotion. Substrate refuses to open a PR
|
|
17
|
+
* when `gate.decision !== 'ship'` — fails loud. */
|
|
18
|
+
gate: GateResult;
|
|
19
|
+
/** Promoted surface diff — typically the new system prompt addendum or
|
|
20
|
+
* full profile diff. Substrate writes it as the PR body. */
|
|
21
|
+
promotedDiff: string;
|
|
22
|
+
/** GH owner/repo target (e.g., `tangle-network/gtm-agent`). */
|
|
23
|
+
ghOwner: string;
|
|
24
|
+
ghRepo: string;
|
|
25
|
+
/** Branch name for the PR. Default `auto/<manifestHash[:12]>`. */
|
|
26
|
+
branch?: string;
|
|
27
|
+
/** PR title. Default includes manifest hash. */
|
|
28
|
+
title?: string;
|
|
29
|
+
/** Whether to actually open the PR or just dry-run. Default reads
|
|
30
|
+
* `GH_AUTO_PR_TOKEN` env — present = open, absent = dry-run. */
|
|
31
|
+
dryRun?: boolean;
|
|
32
|
+
/** Test seam — substitute `gh pr create` invocation. */
|
|
33
|
+
ghExec?: (args: string[]) => {
|
|
34
|
+
stdout: string;
|
|
35
|
+
stderr: string;
|
|
36
|
+
status: number;
|
|
37
|
+
};
|
|
38
|
+
}
|
|
39
|
+
export interface OpenAutoPrResult {
|
|
40
|
+
opened: boolean;
|
|
41
|
+
prUrl?: string;
|
|
42
|
+
dryRun: boolean;
|
|
43
|
+
reason: string;
|
|
44
|
+
}
|
|
45
|
+
export declare function openAutoPr<TArtifact, TScenario extends Scenario>(options: OpenAutoPrOptions<TArtifact, TScenario>): OpenAutoPrResult;
|
|
46
|
+
//# sourceMappingURL=auto-pr.d.ts.map
|
|
@@ -0,0 +1 @@
|
|
|
1
|
+
{"version":3,"file":"auto-pr.d.ts","sourceRoot":"","sources":["../../src/campaign/auto-pr.ts"],"names":[],"mappings":"AAAA;;;;;;;;;;GAUG;AAMH,OAAO,KAAK,EAAE,cAAc,EAAE,UAAU,EAAE,QAAQ,EAAE,MAAM,SAAS,CAAA;AAEnE,MAAM,WAAW,iBAAiB,CAAC,SAAS,EAAE,SAAS,SAAS,QAAQ;IACtE,2CAA2C;IAC3C,MAAM,EAAE,cAAc,CAAC,SAAS,EAAE,SAAS,CAAC,CAAA;IAC5C;wDACoD;IACpD,IAAI,EAAE,UAAU,CAAA;IAChB;iEAC6D;IAC7D,YAAY,EAAE,MAAM,CAAA;IACpB,+DAA+D;IAC/D,OAAO,EAAE,MAAM,CAAA;IACf,MAAM,EAAE,MAAM,CAAA;IACd,kEAAkE;IAClE,MAAM,CAAC,EAAE,MAAM,CAAA;IACf,gDAAgD;IAChD,KAAK,CAAC,EAAE,MAAM,CAAA;IACd;qEACiE;IACjE,MAAM,CAAC,EAAE,OAAO,CAAA;IAChB,wDAAwD;IACxD,MAAM,CAAC,EAAE,CAAC,IAAI,EAAE,MAAM,EAAE,KAAK;QAAE,MAAM,EAAE,MAAM,CAAC;QAAC,MAAM,EAAE,MAAM,CAAC;QAAC,MAAM,EAAE,MAAM,CAAA;KAAE,CAAA;CAChF;AAED,MAAM,WAAW,gBAAgB;IAC/B,MAAM,EAAE,OAAO,CAAA;IACf,KAAK,CAAC,EAAE,MAAM,CAAA;IACd,MAAM,EAAE,OAAO,CAAA;IACf,MAAM,EAAE,MAAM,CAAA;CACf;AAED,wBAAgB,UAAU,CAAC,SAAS,EAAE,SAAS,SAAS,QAAQ,EAC9D,OAAO,EAAE,iBAAiB,CAAC,SAAS,EAAE,SAAS,CAAC,GAC/C,gBAAgB,CAgDlB"}
|
|
@@ -0,0 +1,69 @@
|
|
|
1
|
+
/**
|
|
2
|
+
* Agreement judge for teacher→student distillation. Scores a STUDENT artifact
|
|
3
|
+
* (the cheap analyst's produced label) against the GoldScenario's gold label
|
|
4
|
+
* (the teacher's verdict). The score IS the distillation objective: 1.0 means
|
|
5
|
+
* the student reproduced the teacher exactly, 0.0 means total disagreement.
|
|
6
|
+
*
|
|
7
|
+
* The comparison function is INJECTED (`compareLabels`) so the judge is
|
|
8
|
+
* domain-agnostic — distilling a skill-audit analyst, a triage analyst, or any
|
|
9
|
+
* other student is a one-line comparator swap. A default `fieldAgreement`
|
|
10
|
+
* comparator is provided for the common case: a flat verdict object with
|
|
11
|
+
* categorical and array fields.
|
|
12
|
+
*
|
|
13
|
+
* Everything here is PURE + unit-testable — no LLM. (The student spends tokens
|
|
14
|
+
* producing the artifact; scoring it against frozen gold does not.)
|
|
15
|
+
*/
|
|
16
|
+
import type { JudgeConfig } from '../types';
|
|
17
|
+
import type { GoldScenario } from './gold-scenarios';
|
|
18
|
+
/** What an injected comparator returns: a [0,1] composite plus the per-field
|
|
19
|
+
* (per-dimension) agreement breakdown the GEPA proposer reflects on to learn
|
|
20
|
+
* WHICH part of the verdict the student is getting wrong. */
|
|
21
|
+
export interface AgreementResult {
|
|
22
|
+
/** Overall agreement in [0,1]. */
|
|
23
|
+
score: number;
|
|
24
|
+
/** Per-dimension agreement in [0,1] — keyed by field/aspect name. The
|
|
25
|
+
* reflective proposer surfaces the weakest of these as the lever to fix. */
|
|
26
|
+
dimensions: Record<string, number>;
|
|
27
|
+
}
|
|
28
|
+
/** Compare a produced label against a gold label → agreement. Injected so the
|
|
29
|
+
* judge is domain-agnostic. */
|
|
30
|
+
export type CompareLabels<TProduced = unknown, TLabel = unknown> = (produced: TProduced, gold: TLabel) => AgreementResult;
|
|
31
|
+
export interface BuildAgreementJudgeOptions<TProduced = unknown, TLabel = unknown> {
|
|
32
|
+
/** Judge name surfaced in `CampaignResult.aggregates.byJudge` + the gate. */
|
|
33
|
+
name?: string;
|
|
34
|
+
/** The agreement function — produced student label vs gold teacher label. */
|
|
35
|
+
compareLabels: CompareLabels<TProduced, TLabel>;
|
|
36
|
+
/** Dimension keys the judge declares up-front (for `JudgeConfig.dimensions`).
|
|
37
|
+
* When omitted, the dimensions present on the first scored result are used
|
|
38
|
+
* for display only; the composite is unaffected. */
|
|
39
|
+
dimensionKeys?: string[];
|
|
40
|
+
/** Only score `gold`-kind scenarios. Default true — a mixed campaign won't
|
|
41
|
+
* mis-apply the agreement judge to non-gold scenarios. */
|
|
42
|
+
goldOnly?: boolean;
|
|
43
|
+
}
|
|
44
|
+
/** Build a `JudgeConfig` that scores a produced student artifact against the
|
|
45
|
+
* scenario's gold label. Conforms to the substrate `JudgeConfig` contract:
|
|
46
|
+
* `score({artifact, scenario, signal}) => JudgeScore`. The `composite` is the
|
|
47
|
+
* comparator's `score`; `dimensions` carries its per-field breakdown plus the
|
|
48
|
+
* scalar `agreement` so a single-dimension consumer still sees the number. */
|
|
49
|
+
export declare function buildAgreementJudge<TProduced, TInput, TLabel>(options: BuildAgreementJudgeOptions<TProduced, TLabel>): JudgeConfig<TProduced, GoldScenario<TInput, TLabel>>;
|
|
50
|
+
export interface FieldAgreementSpec {
|
|
51
|
+
/** Categorical fields — scored exact-match (1 if equal, else 0). Compared
|
|
52
|
+
* with `===` after `JSON`-normalizing so `true`/`'high'`/`3` all work. */
|
|
53
|
+
categorical?: string[];
|
|
54
|
+
/** Array fields — scored by Jaccard overlap (|A∩B| / |A∪B|). Two empty
|
|
55
|
+
* arrays agree perfectly (1.0). Order-insensitive; elements compared by
|
|
56
|
+
* their `JSON.stringify`. */
|
|
57
|
+
array?: string[];
|
|
58
|
+
}
|
|
59
|
+
/** Default comparator: average per-field agreement over a flat verdict object.
|
|
60
|
+
* Categorical fields score exact-match; array fields score set-overlap
|
|
61
|
+
* (Jaccard). The composite is the unweighted mean across all declared fields,
|
|
62
|
+
* so missing a single boolean (e.g. `public_leak_risk`) costs `1/nFields` of
|
|
63
|
+
* the score — the leak-detection lever the audit cares about is a real,
|
|
64
|
+
* non-trivial fraction of the objective, not rounding noise.
|
|
65
|
+
*
|
|
66
|
+
* Pure. A field absent from BOTH produced + gold is treated as agreeing
|
|
67
|
+
* (both undefined ⇒ 1.0); a field present in only one side disagrees. */
|
|
68
|
+
export declare function fieldAgreement<TProduced extends Record<string, unknown>, TLabel>(spec: FieldAgreementSpec): CompareLabels<TProduced, TLabel>;
|
|
69
|
+
//# sourceMappingURL=agreement-judge.d.ts.map
|
|
@@ -0,0 +1 @@
|
|
|
1
|
+
{"version":3,"file":"agreement-judge.d.ts","sourceRoot":"","sources":["../../../src/campaign/distillation/agreement-judge.ts"],"names":[],"mappings":"AAAA;;;;;;;;;;;;;;GAcG;AAEH,OAAO,KAAK,EAAE,WAAW,EAAwB,MAAM,UAAU,CAAA;AACjE,OAAO,KAAK,EAAE,YAAY,EAAE,MAAM,kBAAkB,CAAA;AAEpD;;8DAE8D;AAC9D,MAAM,WAAW,eAAe;IAC9B,kCAAkC;IAClC,KAAK,EAAE,MAAM,CAAA;IACb;iFAC6E;IAC7E,UAAU,EAAE,MAAM,CAAC,MAAM,EAAE,MAAM,CAAC,CAAA;CACnC;AAED;gCACgC;AAChC,MAAM,MAAM,aAAa,CAAC,SAAS,GAAG,OAAO,EAAE,MAAM,GAAG,OAAO,IAAI,CACjE,QAAQ,EAAE,SAAS,EACnB,IAAI,EAAE,MAAM,KACT,eAAe,CAAA;AAEpB,MAAM,WAAW,0BAA0B,CAAC,SAAS,GAAG,OAAO,EAAE,MAAM,GAAG,OAAO;IAC/E,6EAA6E;IAC7E,IAAI,CAAC,EAAE,MAAM,CAAA;IACb,6EAA6E;IAC7E,aAAa,EAAE,aAAa,CAAC,SAAS,EAAE,MAAM,CAAC,CAAA;IAC/C;;yDAEqD;IACrD,aAAa,CAAC,EAAE,MAAM,EAAE,CAAA;IACxB;+DAC2D;IAC3D,QAAQ,CAAC,EAAE,OAAO,CAAA;CACnB;AAID;;;;+EAI+E;AAC/E,wBAAgB,mBAAmB,CAAC,SAAS,EAAE,MAAM,EAAE,MAAM,EAC3D,OAAO,EAAE,0BAA0B,CAAC,SAAS,EAAE,MAAM,CAAC,GACrD,WAAW,CAAC,SAAS,EAAE,YAAY,CAAC,MAAM,EAAE,MAAM,CAAC,CAAC,CA6BtD;AAED,MAAM,WAAW,kBAAkB;IACjC;+EAC2E;IAC3E,WAAW,CAAC,EAAE,MAAM,EAAE,CAAA;IACtB;;kCAE8B;IAC9B,KAAK,CAAC,EAAE,MAAM,EAAE,CAAA;CACjB;AAED;;;;;;;;0EAQ0E;AAC1E,wBAAgB,cAAc,CAAC,SAAS,SAAS,MAAM,CAAC,MAAM,EAAE,OAAO,CAAC,EAAE,MAAM,EAC9E,IAAI,EAAE,kBAAkB,GACvB,aAAa,CAAC,SAAS,EAAE,MAAM,CAAC,CAoBlC"}
|