@tangle-network/agent-eval 0.144.11 → 0.144.13
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/CHANGELOG.md +11 -0
- package/dist/agent-profile-B9_GGsG8.d.ts +84 -0
- package/dist/agent-profile-B9_GGsG8.d.ts.map +1 -0
- package/dist/{agent-profile-cell-BOP-iA9Q.d.ts → agent-profile-cell-BkcRDikH.d.ts} +2 -2
- package/dist/{agent-profile-cell-BOP-iA9Q.d.ts.map → agent-profile-cell-BkcRDikH.d.ts.map} +1 -1
- package/dist/analyst/index.d.ts +134 -16
- package/dist/analyst/index.d.ts.map +1 -1
- package/dist/analyst/index.js +364 -10
- package/dist/analyst/index.js.map +1 -1
- package/dist/backend-integrity-CsVin_Wb.d.ts +280 -0
- package/dist/backend-integrity-CsVin_Wb.d.ts.map +1 -0
- package/dist/{baseline-C-GocmIW.js → baseline-BhPRQBVn.js} +3 -2
- package/dist/{baseline-C-GocmIW.js.map → baseline-BhPRQBVn.js.map} +1 -1
- package/dist/{benchmark-CWeqGl7x.js → benchmark-BhT16ep9.js} +2 -2
- package/dist/{benchmark-CWeqGl7x.js.map → benchmark-BhT16ep9.js.map} +1 -1
- package/dist/{agent-profile-DPi7IZg7.d.ts → benchmark-Ceoan7vk.d.ts} +4 -91
- package/dist/benchmark-Ceoan7vk.d.ts.map +1 -0
- package/dist/{benchmark-command-BteMFN62.js → benchmark-command-CY6cbhOB.js} +36 -79
- package/dist/benchmark-command-CY6cbhOB.js.map +1 -0
- package/dist/benchmarks/index.d.ts +244 -2
- package/dist/benchmarks/index.d.ts.map +1 -0
- package/dist/benchmarks/index.js +733 -1
- package/dist/benchmarks/index.js.map +1 -0
- package/dist/builder-eval/index.d.ts +23 -2
- package/dist/builder-eval/index.d.ts.map +1 -1
- package/dist/builder-eval/index.js +227 -3
- package/dist/builder-eval/index.js.map +1 -1
- package/dist/campaign/index.d.ts +10 -8
- package/dist/campaign/index.js +9 -6
- package/dist/{campaign-C2TTzQII.js → campaign-BYjBAypg.js} +21 -634
- package/dist/campaign-BYjBAypg.js.map +1 -0
- package/dist/{canonical-D011XM8r.js → canonical-D-XsTQ6_.js} +2 -2
- package/dist/{canonical-D011XM8r.js.map → canonical-D-XsTQ6_.js.map} +1 -1
- package/dist/{index-CQTZ-4XN.d.ts → capture-fetch-DDvpjVRU.d.ts} +3 -3
- package/dist/capture-fetch-DDvpjVRU.d.ts.map +1 -0
- package/dist/{default-registry-BmktKy8r.js → chat-client-Bp4Ebuuc.js} +1276 -1276
- package/dist/chat-client-Bp4Ebuuc.js.map +1 -0
- package/dist/cli.js +2 -2
- package/dist/{client-C9gzZE59.d.ts → client-KUbGulm_.d.ts} +4 -4
- package/dist/{client-C9gzZE59.d.ts.map → client-KUbGulm_.d.ts.map} +1 -1
- package/dist/contract/index.d.ts +13 -390
- package/dist/contract/index.d.ts.map +1 -1
- package/dist/contract/index.js +18 -542
- package/dist/contract/index.js.map +1 -1
- package/dist/{cost-ledger-DMFxsLKr.js → cost-ledger-BSe92yAV.js} +3 -3
- package/dist/{cost-ledger-DMFxsLKr.js.map → cost-ledger-BSe92yAV.js.map} +1 -1
- package/dist/{cost-ledger-Bv_e8XHY.d.ts → cost-ledger-DbQdN3nO.d.ts} +2 -2
- package/dist/{cost-ledger-Bv_e8XHY.d.ts.map → cost-ledger-DbQdN3nO.d.ts.map} +1 -1
- package/dist/{counterfactual-CxmxAONP.d.ts → counterfactual--bpysZF0.d.ts} +2 -14
- package/dist/{counterfactual-CxmxAONP.d.ts.map → counterfactual--bpysZF0.d.ts.map} +1 -1
- package/dist/{counterfactual-CWPTrMH7.js → counterfactual-lDfCx0Uz.js} +3 -31
- package/dist/{counterfactual-CWPTrMH7.js.map → counterfactual-lDfCx0Uz.js.map} +1 -1
- package/dist/{dataset-C8xaLXdY.d.ts → dataset-CJjKqQfA.d.ts} +2 -8
- package/dist/dataset-CJjKqQfA.d.ts.map +1 -0
- package/dist/{default-registry-Bf8Woqmq.d.ts → default-registry-Di6HP6pG.d.ts} +7 -12
- package/dist/default-registry-Di6HP6pG.d.ts.map +1 -0
- package/dist/{analyze-runs-C30yljDJ.js → define-agent-eval-iqjT--ZZ.js} +542 -130
- package/dist/define-agent-eval-iqjT--ZZ.js.map +1 -0
- package/dist/define-agent-eval-sH24zBfM.d.ts +388 -0
- package/dist/define-agent-eval-sH24zBfM.d.ts.map +1 -0
- package/dist/descriptive-B5MwKfbf.js +144 -0
- package/dist/descriptive-B5MwKfbf.js.map +1 -0
- package/dist/{dspy-rlm-engine-DbTk4JdR.js → dspy-rlm-engine-B_qhSc21.js} +4 -4
- package/dist/{dspy-rlm-engine-DbTk4JdR.js.map → dspy-rlm-engine-B_qhSc21.js.map} +1 -1
- package/dist/effect-sizes-DiH8MGOH.js +82 -0
- package/dist/effect-sizes-DiH8MGOH.js.map +1 -0
- package/dist/{engine-3hL-XqwJ.d.ts → engine-otFpE2gF.d.ts} +10 -38
- package/dist/engine-otFpE2gF.d.ts.map +1 -0
- package/dist/{errors-CKPfb2aH.d.ts → errors-DEE6u6ot.d.ts} +2 -14
- package/dist/{errors-CKPfb2aH.d.ts.map → errors-DEE6u6ot.d.ts.map} +1 -1
- package/dist/{errors-D-LKuDhb.js → errors-Dngq5h35.js} +2 -8
- package/dist/{errors-D-LKuDhb.js.map → errors-Dngq5h35.js.map} +1 -1
- package/dist/{eval-campaign-B_7wcnav.js → eval-campaign-UB-usSQ2.js} +6 -6
- package/dist/{eval-campaign-B_7wcnav.js.map → eval-campaign-UB-usSQ2.js.map} +1 -1
- package/dist/{exact-types-DSFFpLLI.d.ts → exact-types-BH1twmAJ.d.ts} +2 -2
- package/dist/{exact-types-DSFFpLLI.d.ts.map → exact-types-BH1twmAJ.d.ts.map} +1 -1
- package/dist/experiment/index.d.ts +9 -6
- package/dist/experiment/index.d.ts.map +1 -1
- package/dist/experiment/index.js +11 -7
- package/dist/experiment/index.js.map +1 -1
- package/dist/experiment-tracker-C29gXM4B.js +269 -0
- package/dist/experiment-tracker-C29gXM4B.js.map +1 -0
- package/dist/{experiment-tracker-IMntXr6J.d.ts → experiment-tracker-DWHZBAYL.d.ts} +77 -121
- package/dist/experiment-tracker-DWHZBAYL.d.ts.map +1 -0
- package/dist/{external-optimizer-contracts-CZuJNcT5.d.ts → external-optimizer-contracts-lixrOZdX.d.ts} +3 -3
- package/dist/{external-optimizer-contracts-CZuJNcT5.d.ts.map → external-optimizer-contracts-lixrOZdX.d.ts.map} +1 -1
- package/dist/external-optimizer-process-BTiNB-RH.js +301 -0
- package/dist/external-optimizer-process-BTiNB-RH.js.map +1 -0
- package/dist/{single-run-lock-DFWHEB09.js → external-optimizer-subprocess-DrJ9hR8u.js} +144 -438
- package/dist/external-optimizer-subprocess-DrJ9hR8u.js.map +1 -0
- package/dist/extract-usage-BrQ8mCLX.js +155 -0
- package/dist/extract-usage-BrQ8mCLX.js.map +1 -0
- package/dist/{failure-cluster-CqcvCcdR.d.ts → failure-cluster-BLURuWG4.d.ts} +2 -3
- package/dist/failure-cluster-BLURuWG4.d.ts.map +1 -0
- package/dist/{feedback-trajectory-CacHpxsp.d.ts → feedback-trajectory-juOozjAc.d.ts} +5 -36
- package/dist/feedback-trajectory-juOozjAc.d.ts.map +1 -0
- package/dist/fuzz.d.ts +2 -2
- package/dist/fuzz.js +2 -2
- package/dist/hosted/index.d.ts +3 -3
- package/dist/{index-CvSN3IG1.d.ts → index-B8Ui1mr1.d.ts} +2 -2
- package/dist/{index-CvSN3IG1.d.ts.map → index-B8Ui1mr1.d.ts.map} +1 -1
- package/dist/{skill-usage-CO9OLRBx.d.ts → index-BWDrSVfw.d.ts} +11 -136
- package/dist/index-BWDrSVfw.d.ts.map +1 -0
- package/dist/index-Ba3YrbAL.d.ts +1 -0
- package/dist/{index-BnEuDAK2.d.ts → index-COQYtuRF.d.ts} +3 -3
- package/dist/{index-BnEuDAK2.d.ts.map → index-COQYtuRF.d.ts.map} +1 -1
- package/dist/{index-C3ssXVLv.d.ts → index-CvjYbU0D.d.ts} +2 -2
- package/dist/{index-C3ssXVLv.d.ts.map → index-CvjYbU0D.d.ts.map} +1 -1
- package/dist/{index-DPPGNJ_R.d.ts → index-DSmEylT9.d.ts} +17 -115
- package/dist/index-DSmEylT9.d.ts.map +1 -0
- package/dist/index.d.ts +2397 -5308
- package/dist/index.d.ts.map +1 -1
- package/dist/index.js +5914 -10496
- package/dist/index.js.map +1 -1
- package/dist/{insight-report-CgX_s0Ez.d.ts → insight-report-CRi-Ufrj.d.ts} +4 -4
- package/dist/{insight-report-CgX_s0Ez.d.ts.map → insight-report-CRi-Ufrj.d.ts.map} +1 -1
- package/dist/{integrity-MLzHOfV9.js → integrity-Cy9WHAtb.js} +2 -2
- package/dist/{integrity-MLzHOfV9.js.map → integrity-Cy9WHAtb.js.map} +1 -1
- package/dist/{integrity-DY6tIbl0.js → integrity-DysDBWDu.js} +2 -2
- package/dist/{integrity-DY6tIbl0.js.map → integrity-DysDBWDu.js.map} +1 -1
- package/dist/{integrity-BuqEKu-x.d.ts → integrity-OrcI9Nau.d.ts} +3 -3
- package/dist/{integrity-BuqEKu-x.d.ts.map → integrity-OrcI9Nau.d.ts.map} +1 -1
- package/dist/internal-BDHPCnjk.js +230 -0
- package/dist/internal-BDHPCnjk.js.map +1 -0
- package/dist/judge-calibration-C5CbMYce.d.ts +117 -0
- package/dist/judge-calibration-C5CbMYce.d.ts.map +1 -0
- package/dist/judge-calibration-DZkWrm5H.js +317 -0
- package/dist/judge-calibration-DZkWrm5H.js.map +1 -0
- package/dist/{kind-factory-B8-r8-y8.js → kind-factory-CPmSd58s.js} +208 -208
- package/dist/{kind-factory-B8-r8-y8.js.map → kind-factory-CPmSd58s.js.map} +1 -1
- package/dist/ledger-core/index.d.ts +1 -1
- package/dist/ledger-core/index.js +2 -2
- package/dist/{ledger-core-DXZIqu17.js → ledger-core-BmZt19oQ.js} +110 -110
- package/dist/{ledger-core-DXZIqu17.js.map → ledger-core-BmZt19oQ.js.map} +1 -1
- package/dist/{llm-client-DzvMUsS_.js → llm-client-d0-2TT1g.js} +4 -64
- package/dist/{llm-client-DzvMUsS_.js.map → llm-client-d0-2TT1g.js.map} +1 -1
- package/dist/{skillopt-optimization-method-CQdVeM8k.js → llm-judge-dZ8P6nGI.js} +3349 -5401
- package/dist/llm-judge-dZ8P6nGI.js.map +1 -0
- package/dist/matrix/index.d.ts +2 -2
- package/dist/meta-eval/index.d.ts +3 -3
- package/dist/meta-eval/index.js +3 -3
- package/dist/{metrics-C9YY1OcL.js → metrics-Cl0L1KUy.js} +2 -108
- package/dist/{metrics-C9YY1OcL.js.map → metrics-Cl0L1KUy.js.map} +1 -1
- package/dist/{mint-B2O60ACG.js → mint-Dj9Ww_3I.js} +4 -4
- package/dist/{mint-B2O60ACG.js.map → mint-Dj9Ww_3I.js.map} +1 -1
- package/dist/{multi-layer-verifier-DnAqwl0h.d.ts → multi-layer-verifier-DIguZc8Z.d.ts} +3 -3
- package/dist/{multi-layer-verifier-DnAqwl0h.d.ts.map → multi-layer-verifier-DIguZc8Z.d.ts.map} +1 -1
- package/dist/multiplicity-DIWHvysC.d.ts +43 -0
- package/dist/multiplicity-DIWHvysC.d.ts.map +1 -0
- package/dist/multishot/index.d.ts +3 -3
- package/dist/multishot/index.js +1 -1
- package/dist/openapi.json +1 -1
- package/dist/{opencode-sqlite-8r6WUfHc.js → opencode-sqlite-DJWAXLms.js} +2 -2
- package/dist/{opencode-sqlite-8r6WUfHc.js.map → opencode-sqlite-DJWAXLms.js.map} +1 -1
- package/dist/package-version-D7lQHt_-.js +34 -0
- package/dist/package-version-D7lQHt_-.js.map +1 -0
- package/dist/paired-arms-D-XRF_fy.js +1045 -0
- package/dist/paired-arms-D-XRF_fy.js.map +1 -0
- package/dist/paired-promotion-decision-CGzg0cI_.d.ts +251 -0
- package/dist/paired-promotion-decision-CGzg0cI_.d.ts.map +1 -0
- package/dist/paired-tests-BHIhYVdu.js +213 -0
- package/dist/paired-tests-BHIhYVdu.js.map +1 -0
- package/dist/pareto-BqNW3LJR.d.ts +117 -0
- package/dist/pareto-BqNW3LJR.d.ts.map +1 -0
- package/dist/pipelines/index.d.ts +3 -64
- package/dist/pipelines/index.d.ts.map +1 -1
- package/dist/pipelines/index.js +4 -284
- package/dist/pipelines/index.js.map +1 -1
- package/dist/power-and-mde-CHIrXJll.js +195 -0
- package/dist/power-and-mde-CHIrXJll.js.map +1 -0
- package/dist/{promotion-policy-CrLrmys8.js → power-preflight-DEw-uC7q.js} +4 -184
- package/dist/power-preflight-DEw-uC7q.js.map +1 -0
- package/dist/pre-registration-CZwSFQS4.d.ts +577 -0
- package/dist/pre-registration-CZwSFQS4.d.ts.map +1 -0
- package/dist/{prime-protocol-BfSalTfR.js → prime-protocol-6tZTVsWm.js} +72 -21
- package/dist/prime-protocol-6tZTVsWm.js.map +1 -0
- package/dist/produced-state-DU79a81m.js +586 -0
- package/dist/produced-state-DU79a81m.js.map +1 -0
- package/dist/profile-cell.d.ts +1 -1
- package/dist/profile-cell.js +1 -1
- package/dist/promotion-policy-D0nPhkSy.d.ts +134 -0
- package/dist/promotion-policy-D0nPhkSy.d.ts.map +1 -0
- package/dist/promotion-policy-xzA40Evo.js +186 -0
- package/dist/promotion-policy-xzA40Evo.js.map +1 -0
- package/dist/{skillopt-optimization-method-USDKhxSA.d.ts → provenance-CCdxgLDT.d.ts} +57 -478
- package/dist/provenance-CCdxgLDT.d.ts.map +1 -0
- package/dist/registry-oJeeI4-a.d.ts +178 -0
- package/dist/registry-oJeeI4-a.d.ts.map +1 -0
- package/dist/{release-report-DA2BCu5a.d.ts → release-confidence-BFRE5WSp.d.ts} +180 -112
- package/dist/release-confidence-BFRE5WSp.d.ts.map +1 -0
- package/dist/{release-report-BUYmoKo2.js → release-confidence-CxDuiAev.js} +125 -217
- package/dist/release-confidence-CxDuiAev.js.map +1 -0
- package/dist/reporting.d.ts +6 -5
- package/dist/reporting.js +7 -5
- package/dist/{researcher-BchpD55R.d.ts → researcher-DaN4GST-.d.ts} +7 -40
- package/dist/{researcher-BchpD55R.d.ts.map → researcher-DaN4GST-.d.ts.map} +1 -1
- package/dist/{reward-hacking-BDToousL.js → reward-hacking-DNgjilrV.js} +3 -3
- package/dist/reward-hacking-DNgjilrV.js.map +1 -0
- package/dist/{reward-hacking-BI0OMAlo.d.ts → reward-hacking-DSSTuI9r.d.ts} +5 -5
- package/dist/{reward-hacking-BI0OMAlo.d.ts.map → reward-hacking-DSSTuI9r.d.ts.map} +1 -1
- package/dist/rl.d.ts +7 -7
- package/dist/rl.js +11 -10
- package/dist/rl.js.map +1 -1
- package/dist/rollout/index.d.ts +2 -2
- package/dist/rollout/index.js +4 -4
- package/dist/{rollout-DRrksrcV.js → rollout-BWtw0I_6.js} +3 -3
- package/dist/{rollout-DRrksrcV.js.map → rollout-BWtw0I_6.js.map} +1 -1
- package/dist/{rubric-predictive-validity-DvkjPYCe.d.ts → rubric-predictive-validity-BgxtKe4G.d.ts} +2 -2
- package/dist/{rubric-predictive-validity-DvkjPYCe.d.ts.map → rubric-predictive-validity-BgxtKe4G.d.ts.map} +1 -1
- package/dist/{rubric-predictive-validity-BRR632r1.js → rubric-predictive-validity-Cwwyd7ah.js} +2 -2
- package/dist/{rubric-predictive-validity-BRR632r1.js.map → rubric-predictive-validity-Cwwyd7ah.js.map} +1 -1
- package/dist/{run-record-BmSPWXJR.js → run-record-BvHPVS-i.js} +3 -3
- package/dist/{run-record-BmSPWXJR.js.map → run-record-BvHPVS-i.js.map} +1 -1
- package/dist/{run-record-CF4Dwpxr.d.ts → run-record-CKiihE6f.d.ts} +4 -4
- package/dist/{run-record-CF4Dwpxr.d.ts.map → run-record-CKiihE6f.d.ts.map} +1 -1
- package/dist/{proposal-findings-2GIUo1et.js → run-score-lDzV0X8j.js} +31 -31
- package/dist/run-score-lDzV0X8j.js.map +1 -0
- package/dist/sandbox-harness-BlSOu4LX.d.ts +70 -0
- package/dist/sandbox-harness-BlSOu4LX.d.ts.map +1 -0
- package/dist/{schema-Cef2cFmb2.d.ts → schema-Cef2cFmb.d.ts} +1 -1
- package/dist/schema-Cef2cFmb.d.ts.map +1 -0
- package/dist/semantic-concept-judge-BiJxScqe.js +406 -0
- package/dist/semantic-concept-judge-BiJxScqe.js.map +1 -0
- package/dist/{sequential-D-BLJBKU.js → sequential-C458DXNf.js} +4 -3
- package/dist/{sequential-D-BLJBKU.js.map → sequential-C458DXNf.js.map} +1 -1
- package/dist/sequential-eprocess-CbUt2htw.js +83 -0
- package/dist/sequential-eprocess-CbUt2htw.js.map +1 -0
- package/dist/series-convergence-D1cL1f-4.d.ts +129 -0
- package/dist/series-convergence-D1cL1f-4.d.ts.map +1 -0
- package/dist/{server-iu0ede49.js → server-ulsOdrTI.js} +5 -21
- package/dist/server-ulsOdrTI.js.map +1 -0
- package/dist/skillopt-optimization-method-C5cotF4E.d.ts +427 -0
- package/dist/skillopt-optimization-method-C5cotF4E.d.ts.map +1 -0
- package/dist/skillopt-optimization-method-jjdnc3YK.js +1999 -0
- package/dist/skillopt-optimization-method-jjdnc3YK.js.map +1 -0
- package/dist/{statistical-heldout-TQ-4CYiN.d.ts → statistical-heldout-DoFF5KJX.d.ts} +5 -278
- package/dist/statistical-heldout-DoFF5KJX.d.ts.map +1 -0
- package/dist/{store-otlp-Dw8PPIlL.js → store-otlp-CsptLYpN.js} +3 -3
- package/dist/{store-otlp-Dw8PPIlL.js.map → store-otlp-CsptLYpN.js.map} +1 -1
- package/dist/store-tool-spans-Cq9mFd-q.js +667 -0
- package/dist/store-tool-spans-Cq9mFd-q.js.map +1 -0
- package/dist/store-tool-spans-DbDLOBOb.d.ts +342 -0
- package/dist/store-tool-spans-DbDLOBOb.d.ts.map +1 -0
- package/dist/student-t-CvBq2mve.js +38 -0
- package/dist/student-t-CvBq2mve.js.map +1 -0
- package/dist/{summary-report-Lf-5I7xh.js → summary-report-Blysd6Z2.js} +6 -3
- package/dist/{summary-report-Lf-5I7xh.js.map → summary-report-Blysd6Z2.js.map} +1 -1
- package/dist/{summary-report-BNR7DWTj.d.ts → summary-report-CaL-Hnxt.d.ts} +5 -5
- package/dist/{summary-report-BNR7DWTj.d.ts.map → summary-report-CaL-Hnxt.d.ts.map} +1 -1
- package/dist/supervisor-run/index.d.ts +391 -3
- package/dist/supervisor-run/index.d.ts.map +1 -0
- package/dist/supervisor-run/index.js +1689 -2
- package/dist/{supervisor-run-D_sokXcO.js.map → supervisor-run/index.js.map} +1 -1
- package/dist/{extract-usage-CdZdoj1s.js → task-failure-attributes-CpQ4y5RD.js} +5 -157
- package/dist/task-failure-attributes-CpQ4y5RD.js.map +1 -0
- package/dist/{tool-groups-CZPGGlHf.d.ts → tool-groups-Cteb03Ps.d.ts} +3 -3
- package/dist/tool-groups-Cteb03Ps.d.ts.map +1 -0
- package/dist/tool-waste-BDdBZG1F.js +803 -0
- package/dist/tool-waste-BDdBZG1F.js.map +1 -0
- package/dist/tool-waste-DjRDEsuI.d.ts +128 -0
- package/dist/tool-waste-DjRDEsuI.d.ts.map +1 -0
- package/dist/trace-repair/index.d.ts +14 -5
- package/dist/trace-repair/index.d.ts.map +1 -1
- package/dist/trace-repair/index.js +35 -7
- package/dist/trace-repair/index.js.map +1 -1
- package/dist/traces.d.ts +406 -7
- package/dist/traces.d.ts.map +1 -0
- package/dist/traces.js +1011 -10
- package/dist/traces.js.map +1 -0
- package/dist/trajectory-replay/index.d.ts +16 -3
- package/dist/trajectory-replay/index.d.ts.map +1 -1
- package/dist/trajectory-replay/index.js +52 -5
- package/dist/trajectory-replay/index.js.map +1 -1
- package/dist/types-BEPZc6eo.d.ts +93 -0
- package/dist/types-BEPZc6eo.d.ts.map +1 -0
- package/dist/{usage-receipt-t7vAzCRQ.js → types-BI4fT3HN.js} +67 -67
- package/dist/types-BI4fT3HN.js.map +1 -0
- package/dist/{types-BnjdJ70P.d.ts → types-BZ59Ahr8.d.ts} +5 -5
- package/dist/{types-BnjdJ70P.d.ts.map → types-BZ59Ahr8.d.ts.map} +1 -1
- package/dist/{types-D216SgwM.d.ts → types-Cx3YUh2r.d.ts} +4 -241
- package/dist/types-Cx3YUh2r.d.ts.map +1 -0
- package/dist/{types-BvDKaULh.d.ts → types-DLQx4mKU.d.ts} +4 -4
- package/dist/{types-BvDKaULh.d.ts.map → types-DLQx4mKU.d.ts.map} +1 -1
- package/dist/{types-D4mog56g.d.ts → types-yLK8gXE9.d.ts} +2 -2
- package/dist/{types-D4mog56g.d.ts.map → types-yLK8gXE9.d.ts.map} +1 -1
- package/dist/verdict-BndeTAh_.js +61 -0
- package/dist/verdict-BndeTAh_.js.map +1 -0
- package/dist/verdict-E4eRNf7-.d.ts +392 -0
- package/dist/verdict-E4eRNf7-.d.ts.map +1 -0
- package/dist/{verdict-cache-BCcOh0kF.js → verdict-cache-mZf5FEiY.js} +3 -55
- package/dist/{verdict-cache-BCcOh0kF.js.map → verdict-cache-mZf5FEiY.js.map} +1 -1
- package/dist/wire/index.d.ts +3 -3
- package/dist/wire/index.d.ts.map +1 -1
- package/dist/wire/index.js +1 -1
- package/docs/charter.md +3 -3
- package/docs/control-runtime.md +3 -42
- package/docs/experiment.md +0 -1
- package/docs/feature-guide.md +2 -2
- package/docs/trace-repair-grader.md +1 -0
- package/docs/trajectory-replay.md +1 -0
- package/docs/verdicts.md +43 -0
- package/docs/verification-strategies.md +3 -2
- package/package.json +6 -11
- package/dist/agent-profile-DPi7IZg7.d.ts.map +0 -1
- package/dist/analyze-runs-C30yljDJ.js.map +0 -1
- package/dist/baseline-CavEbRyH.d.ts +0 -136
- package/dist/baseline-CavEbRyH.d.ts.map +0 -1
- package/dist/benchmark-command-BteMFN62.js.map +0 -1
- package/dist/benchmarks-Dzs8CKb1.js +0 -755
- package/dist/benchmarks-Dzs8CKb1.js.map +0 -1
- package/dist/campaign-C2TTzQII.js.map +0 -1
- package/dist/completion-verifier-DJA5BhPb.d.ts +0 -414
- package/dist/completion-verifier-DJA5BhPb.d.ts.map +0 -1
- package/dist/control.d.ts +0 -3
- package/dist/control.js +0 -2
- package/dist/dataset-C8xaLXdY.d.ts.map +0 -1
- package/dist/default-registry-Bf8Woqmq.d.ts.map +0 -1
- package/dist/default-registry-BmktKy8r.js.map +0 -1
- package/dist/engine-3hL-XqwJ.d.ts.map +0 -1
- package/dist/experiment-tracker-CnRICnMl.js +0 -500
- package/dist/experiment-tracker-CnRICnMl.js.map +0 -1
- package/dist/experiment-tracker-IMntXr6J.d.ts.map +0 -1
- package/dist/extract-usage-CdZdoj1s.js.map +0 -1
- package/dist/failure-cluster-CqcvCcdR.d.ts.map +0 -1
- package/dist/feedback-trajectory-CacHpxsp.d.ts.map +0 -1
- package/dist/index-BZ3-y4YL.d.ts +0 -391
- package/dist/index-BZ3-y4YL.d.ts.map +0 -1
- package/dist/index-CQTZ-4XN.d.ts.map +0 -1
- package/dist/index-DPPGNJ_R.d.ts.map +0 -1
- package/dist/index-YE4KdKbO2.d.ts +0 -335
- package/dist/index-YE4KdKbO2.d.ts.map +0 -1
- package/dist/paired-arms-iZ08VFMN.js +0 -260
- package/dist/paired-arms-iZ08VFMN.js.map +0 -1
- package/dist/paired-promotion-decision-B6zJ3gYM.d.ts +0 -114
- package/dist/paired-promotion-decision-B6zJ3gYM.d.ts.map +0 -1
- package/dist/prime-protocol-BfSalTfR.js.map +0 -1
- package/dist/promotion-policy-Ckjhzg_4.d.ts +0 -289
- package/dist/promotion-policy-Ckjhzg_4.d.ts.map +0 -1
- package/dist/promotion-policy-CrLrmys8.js.map +0 -1
- package/dist/proposal-findings-2GIUo1et.js.map +0 -1
- package/dist/propose-review-control-dSNPjFUH.js +0 -1458
- package/dist/propose-review-control-dSNPjFUH.js.map +0 -1
- package/dist/release-report-BUYmoKo2.js.map +0 -1
- package/dist/release-report-DA2BCu5a.d.ts.map +0 -1
- package/dist/replay-CohS93nE.js +0 -1859
- package/dist/replay-CohS93nE.js.map +0 -1
- package/dist/replay-DbhZ4Ked.d.ts +0 -834
- package/dist/replay-DbhZ4Ked.d.ts.map +0 -1
- package/dist/reward-hacking-BDToousL.js.map +0 -1
- package/dist/run-evidence-Dhi3C81V.d.ts +0 -225
- package/dist/run-evidence-Dhi3C81V.d.ts.map +0 -1
- package/dist/schema-Cef2cFmb2.d.ts.map +0 -1
- package/dist/semantic-concept-judge-D1z-KepS.js +0 -767
- package/dist/semantic-concept-judge-D1z-KepS.js.map +0 -1
- package/dist/series-convergence-ofsqPWhs.d.ts +0 -35
- package/dist/series-convergence-ofsqPWhs.d.ts.map +0 -1
- package/dist/server-iu0ede49.js.map +0 -1
- package/dist/single-run-lock-DFWHEB09.js.map +0 -1
- package/dist/skill-usage-CO9OLRBx.d.ts.map +0 -1
- package/dist/skillopt-optimization-method-CQdVeM8k.js.map +0 -1
- package/dist/skillopt-optimization-method-USDKhxSA.d.ts.map +0 -1
- package/dist/statistical-heldout-TQ-4CYiN.d.ts.map +0 -1
- package/dist/statistics-ByxzSiOM.js +0 -2212
- package/dist/statistics-ByxzSiOM.js.map +0 -1
- package/dist/statistics-D6Uebe_4.d.ts +0 -968
- package/dist/statistics-D6Uebe_4.d.ts.map +0 -1
- package/dist/supervisor-run-D_sokXcO.js +0 -1690
- package/dist/test-graded-scenario-D1TaI2va.d.ts +0 -141
- package/dist/test-graded-scenario-D1TaI2va.d.ts.map +0 -1
- package/dist/test-graded-scenario-JHcKQNpq.js +0 -318
- package/dist/test-graded-scenario-JHcKQNpq.js.map +0 -1
- package/dist/tool-groups-CZPGGlHf.d.ts.map +0 -1
- package/dist/tool-use-metrics-DEGMKycK.js +0 -370
- package/dist/tool-use-metrics-DEGMKycK.js.map +0 -1
- package/dist/types-D216SgwM.d.ts.map +0 -1
- package/dist/usage-receipt-t7vAzCRQ.js.map +0 -1
- package/dist/verdict-DExhxfgR.d.ts +0 -201
- package/dist/verdict-DExhxfgR.d.ts.map +0 -1
package/dist/contract/index.d.ts
CHANGED
|
@@ -1,395 +1,18 @@
|
|
|
1
|
-
import { c as CostLedgerHandle
|
|
2
|
-
import { a as RunRecord, n as RunCostProvenance, s as RunSplitTag } from "../run-record-
|
|
3
|
-
import {
|
|
4
|
-
import { _ as ProposalFinding, i as AnalystFinding, v as ProposalFindingOrigin, x as makeProposalFinding } from "../types-
|
|
5
|
-
import { n as buildDefaultAnalystRegistry, t as DefaultAnalystRegistryOptions } from "../default-registry-
|
|
6
|
-
import { C as JudgeDimension, H as SurfaceProposer, M as OptimizerConfig, R as Scenario, S as JudgeConfig, V as SessionScript, _ as GateDecision, a as CampaignResult, b as GenerationRecord, c as CampaignTraceWriter, d as DispatchContext, f as DispatchFn, g as GateContribution, h as GateContext, i as CampaignCostMeter, j as MutableSurface,
|
|
7
|
-
import { a as FailureClusterInsight, c as JudgeInsight, d as Recommendation, f as ReleaseSummary, i as FailureClassTally, l as LiftInsight, m as TokenUsageInsight, n as ExecutionErrorOutcomeCell, o as InsightReport, p as ScalarDistribution, r as ExecutionInsight, s as InterRaterInsight, t as CostProvenanceSummary, u as OutcomeCorrelationInsight } from "../insight-report-
|
|
8
|
-
import {
|
|
9
|
-
import { $
|
|
10
|
-
import { a as
|
|
11
|
-
import { c as
|
|
1
|
+
import { c as CostLedgerHandle } from "../cost-ledger-DbQdN3nO.js";
|
|
2
|
+
import { a as RunRecord, n as RunCostProvenance, s as RunSplitTag } from "../run-record-CKiihE6f.js";
|
|
3
|
+
import { p as ChatClient, v as CreateChatClientOpts, w as createChatClient } from "../types-Cx3YUh2r.js";
|
|
4
|
+
import { _ as ProposalFinding, i as AnalystFinding, v as ProposalFindingOrigin, x as makeProposalFinding } from "../types-DLQx4mKU.js";
|
|
5
|
+
import { n as buildDefaultAnalystRegistry, t as DefaultAnalystRegistryOptions } from "../default-registry-Di6HP6pG.js";
|
|
6
|
+
import { C as JudgeDimension, H as SurfaceProposer, M as OptimizerConfig, R as Scenario, S as JudgeConfig, V as SessionScript, _ as GateDecision, a as CampaignResult, b as GenerationRecord, c as CampaignTraceWriter, d as DispatchContext, f as DispatchFn, g as GateContribution, h as GateContext, i as CampaignCostMeter, j as MutableSurface, l as CodeSurface, m as GateCheckStatus, n as CampaignArtifactWriter, p as Gate, r as CampaignCellResult, t as CampaignAggregates, v as GateResult, w as JudgeScore, y as GenerationCandidate } from "../types-BZ59Ahr8.js";
|
|
7
|
+
import { a as FailureClusterInsight, c as JudgeInsight, d as Recommendation, f as ReleaseSummary, i as FailureClassTally, l as LiftInsight, m as TokenUsageInsight, n as ExecutionErrorOutcomeCell, o as InsightReport, p as ScalarDistribution, r as ExecutionInsight, s as InterRaterInsight, t as CostProvenanceSummary, u as OutcomeCorrelationInsight } from "../insight-report-CRi-Ufrj.js";
|
|
8
|
+
import { C as analyzeRuns, S as SummarizeExecutionOptions, b as AnalyzeRunsOptions, w as summarizeExecution, x as ExecutionReport } from "../engine-otFpE2gF.js";
|
|
9
|
+
import { $ as OptimizationTokenUsage, At as llmJudge, Ct as fsCampaignStorage, D as runEval, E as RunEvalOptions, G as OptimizationMethodComparison, H as CompareOptimizationMethodsOptions, J as OptimizationMethodProvenance, K as OptimizationMethodInput, Ot as LlmJudgeDimension, Q as OptimizationPackageSource, U as ComparisonCost, W as OptimizationMethod, Y as OptimizationMethodResult, at as RunCampaignOptions, b as RunImprovementLoopResult, it as CampaignCellFailureReceipt, kt as LlmJudgeOptions, ot as runCampaign, tt as compareOptimizationMethods, wt as inMemoryCampaignStorage, x as runImprovementLoop, xt as CampaignStorage, y as RunImprovementLoopOptions } from "../provenance-CCdxgLDT.js";
|
|
10
|
+
import { B as runReferenceEquivalenceJudge, C as ExternalTextOptimizerContext, E as ExternalTextEvaluationResponse, F as ReferenceEquivalenceJudgeInput, I as ReferenceEquivalenceJudgeOptions, L as ReferenceEquivalenceJudgeResult, N as REFERENCE_EQUIVALENCE_INPUT_LIMITS, P as REFERENCE_EQUIVALENCE_JUDGE_VERSION, R as ReferenceEquivalenceScenario, S as ExternalTextOptimizationMethodConfig, T as ExternalOptimizationExample, _ as DefaultProductionGateOptions, a as GepaAdaptiveEngineRun, b as composeGate, c as GepaOptimizationMethodConfig, d as gepaOptimizationMethod, f as OpenAICompatibleOptimizerModel, g as DefaultProductionGateCheck, h as heldOutGate, i as skillOptOptimizationMethod, j as campaignSplitDigest, l as GepaOptimizationRecipe, m as HeldOutGateOptions, n as SkillOptRunnerCommand, o as GepaEngineOptions, p as OptimizerModelBudget, r as SkillOptTrainerConfig, s as GepaEngineRun, t as SkillOptOptimizationMethodConfig, u as GepaRunnerCommand, v as DefaultProductionRewardHackingOptions, w as ExternalTextOptimizerResult, x as externalTextOptimizationMethod, y as defaultProductionGate, z as createReferenceEquivalenceJudge } from "../skillopt-optimization-method-C5cotF4E.js";
|
|
11
|
+
import { a as ObjectiveSource, c as PromotionPolicy, d as paretoSignificanceGate, i as EvidenceVector, l as buildEvidenceVector, n as AxisVerdict, o as ParetoSignificanceGateOptions, r as BuildEvidenceVectorOptions, s as PromotionObjective, t as AxisEvidence, u as paretoPolicy } from "../promotion-policy-D0nPhkSy.js";
|
|
12
|
+
import { c as EvalRunGenerationSnapshot, g as TraceSpanEvent, n as HostedTenant, o as EvalRunCellScore, s as EvalRunEvent } from "../client-KUbGulm_.js";
|
|
12
13
|
import { i as InMemoryOutcomeStore, n as FileSystemOutcomeStore, o as OutcomeStore, r as FileSystemOutcomeStoreOptions, t as DeploymentOutcome } from "../outcome-store-BYHIuO0e.js";
|
|
14
|
+
import { a as DefinedAgentEval, c as SelfImproveOptions, d as SelfImproveRunError, f as selfImprove, i as DefineAgentEvalOptions, l as SelfImproveProgressEvent, n as AgentEvalEvaluateOptions, o as defineAgentEval, r as AgentEvalImproveOptions, s as SelfImproveBudget, t as AgentEvalAgent, u as SelfImproveResult } from "../define-agent-eval-sH24zBfM.js";
|
|
13
15
|
import { AgentCandidateBenchmarkCellRef, AgentCandidateBenchmarkSuiteInputs, AgentCandidateBenchmarkTask, AgentCandidateBenchmarkTaskMaterial, AgentCandidateBundle, AgentCandidateEvaluationPolicy, AgentCandidateExperiment, AgentCandidateExperimentMaterial, AgentCandidateExperimentMeasurement, AgentImprovementCost, AgentImprovementMeasuredComparison, AgentProfileImprovementExperiment, AgentProfileImprovementExperimentMaterial, AgentProfileImprovementMeasuredComparison, AgentProfileImprovementMeasurement, AgentProfileImprovementRunCell, AgentProfileImprovementRunReceipt, AgentProfileImprovementSuiteInputs, AgentProfileImprovementTask, AgentProfileImprovementTaskMaterial, CandidateExecutionEvidence, Sha256Digest } from "@tangle-network/agent-interface";
|
|
14
|
-
//#region src/contract/self-improve.d.ts
|
|
15
|
-
interface SelfImproveBudget {
|
|
16
|
-
/** Hard spend cap across the full run. Each paid call reserves its enforced
|
|
17
|
-
* maximum before dispatch, so completed spend cannot cross this amount. */
|
|
18
|
-
dollars?: number;
|
|
19
|
-
/** Proposer generations. Default: 3. External methods own their rounds and
|
|
20
|
-
* require this value to be omitted or set to 1. Set 0 only for a
|
|
21
|
-
* proposer-free baseline run. */
|
|
22
|
-
generations?: number;
|
|
23
|
-
/** Candidates the proposer emits per generation. Default 2. */
|
|
24
|
-
populationSize?: number;
|
|
25
|
-
/** Max concurrent cells across the loop. Default 2. */
|
|
26
|
-
maxConcurrency?: number;
|
|
27
|
-
/** Candidate campaigns scored in parallel. Default 1. Total concurrent
|
|
28
|
-
* cells are bounded by `candidateConcurrency * maxConcurrency`. */
|
|
29
|
-
candidateConcurrency?: number;
|
|
30
|
-
/** Fraction of `scenarios` held out from training, used for the gate.
|
|
31
|
-
* Default 0.25. Ignored when `holdoutScenarios` is set explicitly. */
|
|
32
|
-
holdoutFraction?: number;
|
|
33
|
-
/** Fraction of the non-final cases reserved for method selection.
|
|
34
|
-
* Default 0.25. Used only with `method` and ignored when
|
|
35
|
-
* `selectionScenarios` is supplied explicitly. */
|
|
36
|
-
selectionFraction?: number;
|
|
37
|
-
/** Explicit held-out scenarios; overrides `holdoutFraction`. */
|
|
38
|
-
holdoutScenarios?: Scenario[];
|
|
39
|
-
/** Holdout policy. Default `'measured'`: split, re-score baseline vs winner
|
|
40
|
-
* on the held-out set, gate on that comparison. `'deferred'`: run the
|
|
41
|
-
* improvement-set campaigns + search promotion, dispatch ZERO holdout cells,
|
|
42
|
-
* force the gate to `'hold'`, return `lift: undefined`, and record
|
|
43
|
-
* `holdout: 'deferred'` in the provenance record — for callers that measure
|
|
44
|
-
* the held-out comparison in a separate later run instead of faking a
|
|
45
|
-
* static holdout scenario and recording a meaningless lift. Unless
|
|
46
|
-
* `holdoutScenarios` reserves an explicit set, ALL scenarios train. */
|
|
47
|
-
holdout?: 'measured' | 'deferred';
|
|
48
|
-
/** Per-scenario replicates per cell — raises bootstrap-CI tightness. Default 1. */
|
|
49
|
-
reps?: number;
|
|
50
|
-
/** DEPTH dial forwarded to the proposer's `propose()` as
|
|
51
|
-
* `ctx.maxImprovementShots` — max iterations an agentic candidate generator
|
|
52
|
-
* may take per candidate (verify-in-session retries). Unset ⇒ the
|
|
53
|
-
* proposer's own default. */
|
|
54
|
-
maxImprovementShots?: number;
|
|
55
|
-
}
|
|
56
|
-
type SelfImproveProgressEvent = {
|
|
57
|
-
kind: 'baseline.started';
|
|
58
|
-
scenarios: number;
|
|
59
|
-
} | {
|
|
60
|
-
kind: 'baseline.completed';
|
|
61
|
-
compositeMean: number;
|
|
62
|
-
durationMs: number;
|
|
63
|
-
} | {
|
|
64
|
-
kind: 'generation.started';
|
|
65
|
-
index: number;
|
|
66
|
-
populationSize: number;
|
|
67
|
-
} | {
|
|
68
|
-
kind: 'generation.completed';
|
|
69
|
-
index: number;
|
|
70
|
-
bestComposite: number;
|
|
71
|
-
durationMs: number;
|
|
72
|
-
} | {
|
|
73
|
-
kind: 'gate.decided';
|
|
74
|
-
decision: string;
|
|
75
|
-
lift?: number;
|
|
76
|
-
} | {
|
|
77
|
-
kind: 'power.estimated';
|
|
78
|
-
n: number;
|
|
79
|
-
sd: number;
|
|
80
|
-
mde: number;
|
|
81
|
-
underpowered: boolean;
|
|
82
|
-
};
|
|
83
|
-
interface SelfImproveOptions<TScenario extends Scenario, TArtifact> {
|
|
84
|
-
/**
|
|
85
|
-
* Your agent — a function that takes the current `MutableSurface`
|
|
86
|
-
* (typically a system prompt the loop is optimizing) plus the
|
|
87
|
-
* scenario + cell ctx, and returns the artifact your judge scores.
|
|
88
|
-
*
|
|
89
|
-
* Same shape as `RunOptimizationOptions.dispatchWithSurface`. Wrap a
|
|
90
|
-
* plain `Dispatch` if you don't have a surface seam:
|
|
91
|
-
*
|
|
92
|
-
* agent: (_surface, scenario, ctx) => yourPlainDispatch(scenario, ctx)
|
|
93
|
-
*
|
|
94
|
-
* That mode evaluates without mutating any surface — useful as a
|
|
95
|
-
* baseline-only run (set `budget.generations = 0`).
|
|
96
|
-
*/
|
|
97
|
-
agent: (surface: MutableSurface, scenario: TScenario, ctx: DispatchContext) => Promise<TArtifact>;
|
|
98
|
-
/**
|
|
99
|
-
* Snapshot-bearing model identity for agents that do not report a paid-call
|
|
100
|
-
* receipt through `ctx.cost.runPaidCall()`.
|
|
101
|
-
*
|
|
102
|
-
* Omit this when every cell reports its concrete model in a receipt.
|
|
103
|
-
*/
|
|
104
|
-
model?: string;
|
|
105
|
-
/** Scenarios to evaluate against. Train/holdout split is computed from
|
|
106
|
-
* these unless `budget.holdoutScenarios` is set explicitly. */
|
|
107
|
-
scenarios: TScenario[];
|
|
108
|
-
/** Judge that scores artifacts. Bring your own; use `langchainJudge`
|
|
109
|
-
* from `/adapters/langchain` for a Runnable-shaped one. */
|
|
110
|
-
judge: JudgeConfig<TArtifact, TScenario>;
|
|
111
|
-
/** Starting surface — system prompt, JSON config, anything `MutableSurface`
|
|
112
|
-
* accepts. The proposer mutates this each generation. */
|
|
113
|
-
baselineSurface: MutableSurface;
|
|
114
|
-
/** Budget + loop shape. All fields optional. */
|
|
115
|
-
budget?: SelfImproveBudget;
|
|
116
|
-
/**
|
|
117
|
-
* Complete prior measurement of `baselineSurface` over the TRAIN split.
|
|
118
|
-
* Forwarded to the loop body, which validates its surface hash, scenario
|
|
119
|
-
* split, seed (42), reps, and coverage, then skips the baseline search
|
|
120
|
-
* campaign entirely — no baseline dispatch, no resumability lookup. The
|
|
121
|
-
* train split is `scenarios` minus the holdout split, so premeasure with
|
|
122
|
-
* exactly that scenario set (explicit `budget.holdoutScenarios`, or
|
|
123
|
-
* `budget.holdout: 'deferred'` with no reserved set, makes the train split
|
|
124
|
-
* deterministic). Prior spend stays in the imported campaign aggregates and
|
|
125
|
-
* is not re-added to this run's cost ledger.
|
|
126
|
-
*/
|
|
127
|
-
premeasuredBaseline?: PremeasuredOptimizationBaseline<TArtifact, TScenario>;
|
|
128
|
-
/**
|
|
129
|
-
* Candidate generator for this local generation loop.
|
|
130
|
-
* Required when `budget.generations` is greater than zero.
|
|
131
|
-
*/
|
|
132
|
-
proposer?: SurfaceProposer<ProposalFinding>;
|
|
133
|
-
/**
|
|
134
|
-
* Complete optimization method, such as official GEPA or SkillOpt.
|
|
135
|
-
* The method receives disjoint train and selection cases and never receives
|
|
136
|
-
* the final comparison cases. Mutually exclusive with `proposer`.
|
|
137
|
-
*/
|
|
138
|
-
method?: OptimizationMethod<TScenario, TArtifact>;
|
|
139
|
-
/** Explicit method-selection cases. They must also appear in `scenarios`
|
|
140
|
-
* and must not overlap the final comparison cases. */
|
|
141
|
-
selectionScenarios?: TScenario[];
|
|
142
|
-
/** Custom gate. Default is `defaultProductionGate` with
|
|
143
|
-
* `deltaThreshold: 0.05` on the held-out split. */
|
|
144
|
-
gate?: Gate<TArtifact, TScenario>;
|
|
145
|
-
/** Placebo control. When supplied AND the winner differs from baseline, the
|
|
146
|
-
* loop scores a THIRD held-out arm: the winner surface with its content
|
|
147
|
-
* footprint-matched-blanked by this fn (typically via `neutralizeText`). Its
|
|
148
|
-
* scores reach the gate as `ctx.neutralizedJudgeScores`, letting a
|
|
149
|
-
* `neutralizationGate` reject a win whose lift survives blanking the content
|
|
150
|
-
* (decorative — driven by footprint, not content). Costs one extra held-out
|
|
151
|
-
* campaign; omit to skip. Compose `neutralizationGate` into `gate` to act on it. */
|
|
152
|
-
neutralize?: (winnerSurface: MutableSurface, baselineSurface: MutableSurface) => MutableSurface;
|
|
153
|
-
/** Storage backend. A filesystem run directory uses `fsCampaignStorage()`;
|
|
154
|
-
* a `mem://` directory uses in-memory storage. External methods default to
|
|
155
|
-
* a filesystem directory because their official state must survive. */
|
|
156
|
-
storage?: CampaignStorage;
|
|
157
|
-
/** Run directory. Proposer mode defaults to
|
|
158
|
-
* `mem://selfImprove-<timestamp>`. External method mode defaults to
|
|
159
|
-
* `.agent-eval/runs/self-improve-<timestamp>`. */
|
|
160
|
-
runDir?: string;
|
|
161
|
-
/** Fires once the durable provenance record + OTel spans are emitted.
|
|
162
|
-
* Receives the structured record for inline assertions / custom routing. */
|
|
163
|
-
onProvenance?: (record: LoopProvenanceRecord) => void;
|
|
164
|
-
/** Distributed execution seam — same as `RunCampaignOptions.cellPlacement`.
|
|
165
|
-
* Returns an opaque placement key the substrate forwards to your agent
|
|
166
|
-
* as `ctx.placement`. Combined with `httpDispatch` from
|
|
167
|
-
* `/adapters/http`, fans cells across regions. */
|
|
168
|
-
cellPlacement?: (input: {
|
|
169
|
-
scenario: TScenario;
|
|
170
|
-
rep: number;
|
|
171
|
-
generation?: number;
|
|
172
|
-
}) => string | undefined;
|
|
173
|
-
/** Per-cell agent dispatch deadline, applied to baseline, candidate, and
|
|
174
|
-
* held-out campaigns. Default 600_000 ms. Set 0 to disable. */
|
|
175
|
-
dispatchTimeoutMs?: number;
|
|
176
|
-
/** Streaming hook — fires on baseline + each generation + gate decision.
|
|
177
|
-
* Consumer routes events wherever (UI, dashboard, logs). */
|
|
178
|
-
onProgress?: (event: SelfImproveProgressEvent) => void;
|
|
179
|
-
/** Auto-promotion behavior on a ship decision. Default `'none'` — we
|
|
180
|
-
* return the winner; you ship it however you ship. `'pr'` opens a
|
|
181
|
-
* GitHub PR via `openAutoPr`; requires `ghOwner` + `ghRepo`. */
|
|
182
|
-
autoOnPromote?: 'pr' | 'none';
|
|
183
|
-
ghOwner?: string;
|
|
184
|
-
ghRepo?: string;
|
|
185
|
-
/**
|
|
186
|
-
* Opt-in: ship eval-run events to a hosted orchestrator (ours, your
|
|
187
|
-
* self-hosted one, or any compatible implementation of the
|
|
188
|
-
* `docs/hosted-ingest-spec.md` wire format). When set, the substrate
|
|
189
|
-
* POSTs the final `EvalRunEvent` to `${endpoint}/v1/ingest/eval-runs`
|
|
190
|
-
* after the loop completes. Failures are logged but do not fail the
|
|
191
|
-
* loop — local result is always returned.
|
|
192
|
-
*
|
|
193
|
-
* For our orchestrator: `{ endpoint: 'https://orchestrator.tangle.tools/v1', apiKey, tenantId }`.
|
|
194
|
-
*
|
|
195
|
-
* For your self-hosted: any URL serving the wire format. See
|
|
196
|
-
* `examples/hosted-ingest-server/` for the reference receiver.
|
|
197
|
-
*/
|
|
198
|
-
hostedTenant?: HostedTenant;
|
|
199
|
-
/** Free-form labels attached to the hosted event (env, branch, model id,
|
|
200
|
-
* etc.). Ignored when `hostedTenant` is unset. */
|
|
201
|
-
hostedLabels?: Record<string, string>;
|
|
202
|
-
/** Capture every search artifact and judge score to this store.
|
|
203
|
-
* The store is output only and is never exposed to candidate generation.
|
|
204
|
-
* Pass `'off'` to disable. Default: off. */
|
|
205
|
-
labeledStore?: LabeledScenarioStore | 'off';
|
|
206
|
-
/** Capture-source tag for `labeledStore`. Default `'eval-run'`. */
|
|
207
|
-
captureSource?: 'production-trace' | 'eval-run' | 'manual' | 'red-team' | 'synthetic';
|
|
208
|
-
/**
|
|
209
|
-
* Per-cell backend-integrity expectation — the fail-loud guard. A cell that
|
|
210
|
-
* produced an artifact but reported `costUsd === 0` AND zero tokens is a
|
|
211
|
-
* stub. Modes: `'assert'` throws on the first such cell, `'warn'` logs it,
|
|
212
|
-
* `'off'` skips the check (offline/replay). Default `'assert'` — `selfImprove`
|
|
213
|
-
* is the real-run path, so a stub fails loud rather than scoring a clean 0.
|
|
214
|
-
*/
|
|
215
|
-
expectUsage?: 'assert' | 'warn' | 'off';
|
|
216
|
-
/**
|
|
217
|
-
* Per-generation findings producer. Runs once on the baseline campaign (as
|
|
218
|
-
* `generation: -1`) before generation 0 proposes — so single-generation runs
|
|
219
|
-
* propose with trace context — and again after each generation is scored;
|
|
220
|
-
* whatever it returns REPLACES the proposer's `findings` for the next
|
|
221
|
-
* `propose()`. Plug a trace-analyst registry / HALO here. When absent,
|
|
222
|
-
* findings stay `opts.findings`.
|
|
223
|
-
*/
|
|
224
|
-
analyzeGeneration?: RunOptimizationOptions<TScenario, TArtifact>['analyzeGeneration'];
|
|
225
|
-
/** Static findings forwarded to the proposer's `propose()` as `ctx.findings`
|
|
226
|
-
* (a findings-grounded proposer consumes them). Default: none. */
|
|
227
|
-
findings?: ProposalFinding[];
|
|
228
|
-
/** Override how the WINNER is selected among coverage-complete candidates.
|
|
229
|
-
* Defaults to the scalar mean composite (historical behavior). A binary-with-
|
|
230
|
-
* replicates consumer whose ship-gate counts an instance resolved only when
|
|
231
|
-
* every replicate resolved passes a fail-closed lexicographic key here so that
|
|
232
|
-
* winner-selection and the ship-gate rank on the identical metric and cannot
|
|
233
|
-
* invert. See `RunOptimizationOptions.selectionRankKey`. */
|
|
234
|
-
selectionRankKey?: RunOptimizationOptions<TScenario, TArtifact>['selectionRankKey'];
|
|
235
|
-
}
|
|
236
|
-
interface SelfImproveResult<TScenario extends Scenario, TArtifact> {
|
|
237
|
-
/** Composite mean across all scenarios, baseline run. When
|
|
238
|
-
* `budget.holdout === 'deferred'` this is measured on the improvement
|
|
239
|
-
* (search) split — no holdout campaign ran. */
|
|
240
|
-
baseline: {
|
|
241
|
-
compositeMean: number;
|
|
242
|
-
perScenario: Record<string, number>;
|
|
243
|
-
};
|
|
244
|
-
/** Composite mean on the held-out set, winner run. When
|
|
245
|
-
* `budget.holdout === 'deferred'` this is the winner's improvement-set
|
|
246
|
-
* (search) measurement — no holdout campaign ran. */
|
|
247
|
-
winner: {
|
|
248
|
-
compositeMean: number;
|
|
249
|
-
perScenario: Record<string, number>;
|
|
250
|
-
surface: MutableSurface;
|
|
251
|
-
/** Proposer label for the promoted change. Absent ⇒ winner == baseline or
|
|
252
|
-
* a bare-surface mutator. */
|
|
253
|
-
label?: string;
|
|
254
|
-
/** Proposer rationale — the "because Z" that motivated the promoted change.
|
|
255
|
-
* Threaded from the proposer's `ProposedCandidate` through the loop.
|
|
256
|
-
* Absent ⇒ winner == baseline. */
|
|
257
|
-
rationale?: string;
|
|
258
|
-
};
|
|
259
|
-
/** `winner.compositeMean - baselineOnHoldout.compositeMean`. Positive
|
|
260
|
-
* means the gate observed improvement. Absent iff
|
|
261
|
-
* `budget.holdout === 'deferred'` — no held-out measurement ran, so there
|
|
262
|
-
* is no lift to report (never a fabricated 0). */
|
|
263
|
-
lift?: number;
|
|
264
|
-
/** The explicit baseline→winner unified diff. Always present (empty string
|
|
265
|
-
* when winner == baseline). */
|
|
266
|
-
diff: string;
|
|
267
|
-
/** Durable, queryable provenance record: candidate→cell→gate→promote chain +
|
|
268
|
-
* rationale + diff + backend provenance. The artifact the hosted ingest
|
|
269
|
-
* path stores; the +lift RECOMPUTES from `record.heldOutLift`. */
|
|
270
|
-
provenance: LoopProvenanceRecord;
|
|
271
|
-
/** `defaultProductionGate.decide()` result. */
|
|
272
|
-
gateDecision: 'ship' | 'hold' | 'need_more_work' | 'model_ceiling' | 'arch_ceiling';
|
|
273
|
-
/** Number of generations actually explored (may be less than the
|
|
274
|
-
* budget if the proposer gave up early). */
|
|
275
|
-
generationsExplored: number;
|
|
276
|
-
/** Wall-clock total. */
|
|
277
|
-
durationMs: number;
|
|
278
|
-
/** Total newly observed cost across the full run. */
|
|
279
|
-
totalCostUsd: number;
|
|
280
|
-
/** Canonical run-wide spend summary. */
|
|
281
|
-
cost: CostLedgerSummary;
|
|
282
|
-
/** Run-wide receipts across proposal, search, holdout, judging, analysis,
|
|
283
|
-
* and promotion work, with phase and actor attribution. */
|
|
284
|
-
receipts: CostReceipt[];
|
|
285
|
-
/** Exact external method and source identity, when `method` was used. */
|
|
286
|
-
optimization?: {
|
|
287
|
-
name: string;
|
|
288
|
-
cost: OptimizationMethodResult['cost'];
|
|
289
|
-
durationMs?: number;
|
|
290
|
-
provenance?: OptimizationMethodProvenance;
|
|
291
|
-
};
|
|
292
|
-
/**
|
|
293
|
-
* Rigor packet: distributional summary, paired-bootstrap lift CI,
|
|
294
|
-
* judge stats, contamination check, recommendations. Wired through
|
|
295
|
-
* `analyzeRuns()` on the baseline + winner cells of the campaign.
|
|
296
|
-
* Hosted-tier dashboards render this as the v3-vs-v4 decision view.
|
|
297
|
-
*/
|
|
298
|
-
insight: InsightReport;
|
|
299
|
-
/** Minimum-detectable-lift analysis from the baseline holdout cells: could this
|
|
300
|
-
* budget have shipped ANY plausible effect? Absent when the baseline produced
|
|
301
|
-
* fewer than 3 scored holdout cells. See `powerPreflight` for the standalone
|
|
302
|
-
* pre-run version (run `gate: 'none'` first, budget the real search after). */
|
|
303
|
-
power?: PowerPreflight;
|
|
304
|
-
/**
|
|
305
|
-
* Raw substrate result for advanced inspection — full per-generation
|
|
306
|
-
* candidates, full campaign artifacts, all judge scores. Useful for
|
|
307
|
-
* debugging or reporting beyond the summary.
|
|
308
|
-
*/
|
|
309
|
-
raw: RunImprovementLoopResult<TArtifact, TScenario>;
|
|
310
|
-
}
|
|
311
|
-
/** Failed self-improvement run with an immutable receipt snapshot. */
|
|
312
|
-
declare class SelfImproveRunError extends Error {
|
|
313
|
-
readonly cost: CostLedgerSummary;
|
|
314
|
-
readonly receipts: CostReceipt[];
|
|
315
|
-
constructor(cause: unknown, ledger: CostLedgerHandle);
|
|
316
|
-
}
|
|
317
|
-
/**
|
|
318
|
-
* One-shot self-improvement loop. See module docstring for defaults +
|
|
319
|
-
* extension points.
|
|
320
|
-
*
|
|
321
|
-
* @example Minimum:
|
|
322
|
-
*
|
|
323
|
-
* const result = await selfImprove({
|
|
324
|
-
* agent: (surface, scenario, ctx) => myAgent(surface, scenario, ctx.signal),
|
|
325
|
-
* scenarios,
|
|
326
|
-
* judge,
|
|
327
|
-
* baselineSurface: DEFAULT_PROMPT,
|
|
328
|
-
* proposer,
|
|
329
|
-
* })
|
|
330
|
-
* console.log(`lift: ${result.lift.toFixed(3)} (${result.gateDecision})`)
|
|
331
|
-
*
|
|
332
|
-
* @example Distributed (workers in three regions):
|
|
333
|
-
*
|
|
334
|
-
* await selfImprove({
|
|
335
|
-
* agent: httpDispatch({ resolveUrl: ({ placement }) => REGION_URLS[placement!] }),
|
|
336
|
-
* scenarios,
|
|
337
|
-
* judge,
|
|
338
|
-
* baselineSurface: DEFAULT_PROMPT,
|
|
339
|
-
* cellPlacement: ({ scenario }) => scenario.region,
|
|
340
|
-
* budget: { maxConcurrency: 12 },
|
|
341
|
-
* })
|
|
342
|
-
*/
|
|
343
|
-
declare function selfImprove<TScenario extends Scenario, TArtifact>(opts: SelfImproveOptions<TScenario, TArtifact>): Promise<SelfImproveResult<TScenario, TArtifact>>;
|
|
344
|
-
//#endregion
|
|
345
|
-
//#region src/contract/define-agent-eval.d.ts
|
|
346
|
-
type AgentEvalAgent<TScenario extends Scenario, TArtifact> = (surface: MutableSurface, scenario: TScenario, ctx: DispatchContext) => Promise<TArtifact>;
|
|
347
|
-
type DefineAgentEvalOptions<TScenario extends Scenario, TArtifact> = SelfImproveOptions<TScenario, TArtifact>;
|
|
348
|
-
interface AgentEvalEvaluateOptions<TScenario extends Scenario, TArtifact> extends Omit<RunEvalOptions<TScenario, TArtifact>, 'dispatch' | 'judges' | 'runDir' | 'scenarios'> {
|
|
349
|
-
/** Scenario set to evaluate. Defaults to the scenarios passed to `defineAgentEval`. */
|
|
350
|
-
scenarios?: TScenario[];
|
|
351
|
-
/** Surface to evaluate. Defaults to the baseline surface passed to `defineAgentEval`. */
|
|
352
|
-
surface?: MutableSurface;
|
|
353
|
-
/** Agent to evaluate. Defaults to the agent passed to `defineAgentEval`. */
|
|
354
|
-
agent?: AgentEvalAgent<TScenario, TArtifact>;
|
|
355
|
-
/** Single judge override. Ignored when `judges` is set. */
|
|
356
|
-
judge?: JudgeConfig<TArtifact, TScenario>;
|
|
357
|
-
/** Full judge list override. Defaults to the single judge passed to `defineAgentEval`. */
|
|
358
|
-
judges?: JudgeConfig<TArtifact, TScenario>[];
|
|
359
|
-
/** Logical or filesystem run directory. Defaults to an in-memory run. */
|
|
360
|
-
runDir?: string;
|
|
361
|
-
}
|
|
362
|
-
type AgentEvalImproveOptions<TScenario extends Scenario, TArtifact> = Omit<Partial<SelfImproveOptions<TScenario, TArtifact>>, 'budget' | 'hostedTenant'> & {
|
|
363
|
-
budget?: Partial<SelfImproveBudget>;
|
|
364
|
-
hostedTenant?: Partial<HostedTenant>;
|
|
365
|
-
};
|
|
366
|
-
interface DefinedAgentEval<TScenario extends Scenario, TArtifact> {
|
|
367
|
-
/** The default scenarios used by `evaluate()` and `improve()`. */
|
|
368
|
-
readonly scenarios: readonly TScenario[];
|
|
369
|
-
/** The default baseline surface used by `evaluate()` and `improve()`. */
|
|
370
|
-
readonly baselineSurface: MutableSurface;
|
|
371
|
-
/**
|
|
372
|
-
* Run one scored evaluation. Use this for a baseline score or to score one
|
|
373
|
-
* candidate surface without running an improvement loop.
|
|
374
|
-
*/
|
|
375
|
-
evaluate(opts?: AgentEvalEvaluateOptions<TScenario, TArtifact>): Promise<CampaignResult<TArtifact, TScenario>>;
|
|
376
|
-
/**
|
|
377
|
-
* Run the closed improvement loop. Per-call overrides replace the definition
|
|
378
|
-
* except for nested config objects (`budget`, `hostedTenant`), which
|
|
379
|
-
* are merged field-by-field so callers can override one knob without
|
|
380
|
-
* repeating secrets or budget defaults.
|
|
381
|
-
*/
|
|
382
|
-
improve(opts?: AgentEvalImproveOptions<TScenario, TArtifact>): Promise<SelfImproveResult<TScenario, TArtifact>>;
|
|
383
|
-
}
|
|
384
|
-
/**
|
|
385
|
-
* Define an agent eval once, then either score a surface with `evaluate()` or
|
|
386
|
-
* run the closed loop with `improve()`.
|
|
387
|
-
*
|
|
388
|
-
* This is a DX wrapper only: it delegates to `runEval()` and `selfImprove()` and
|
|
389
|
-
* returns their native result shapes.
|
|
390
|
-
*/
|
|
391
|
-
declare function defineAgentEval<TScenario extends Scenario, TArtifact>(defaults: DefineAgentEvalOptions<TScenario, TArtifact>): DefinedAgentEval<TScenario, TArtifact>;
|
|
392
|
-
//#endregion
|
|
393
16
|
//#region src/contract/measured-comparison.d.ts
|
|
394
17
|
interface SealCandidateBenchmarkSuiteOptions {
|
|
395
18
|
tasks: [AgentCandidateBenchmarkTask, ...AgentCandidateBenchmarkTask[]];
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"index.d.ts","names":[],"sources":["../../src/contract/
|
|
1
|
+
{"version":3,"file":"index.d.ts","names":[],"sources":["../../src/contract/measured-comparison.ts","../../src/contract/profile-measured-comparison.ts","../../src/contract/intake/run-record-dir.ts","../../src/contract/eval-reporting-suite.ts","../../src/contract/diff.ts","../../src/contract/intake/agent-trace.ts","../../src/contract/intake/code-agent-observation.ts","../../src/contract/intake/code-agent-session.ts","../../src/contract/intake/feedback-table.ts","../../src/contract/intake/otel-spans.ts"],"mappings":";;;;;;;;;;;;;;;;UAiCiB;EACf,QAAQ,gCAAgC;EACxC;EACA;;UAGe;EACf,YAAY;EACZ;EACA,QAAQ;EACR,MAAM;EACN,eAAe;EACf;EACA,SAAS;;UAGM;EACf,YAAY;EACZ,QAAQ,OAAO,oCAAoC,QAAQ;;EAE3D;;EAEA,aAAa;EACb,SAAS;;UAGM;EACf,cAAc;EACd;IACE;IACA,MAAM;;;UAIO;EACf,YAAY;EACZ,cAAc;EACd;IACE;IACA,MAAM;;EAER,aAAa;EACb;EACA,YAAY;EACZ;EACA,WAAW;;;UAII,kBAAkB;EACjC;EACA,UAAU;EACV,WAAW;;;UAII,yBAAyB;EACxC,MAAM,KAAK;EACX,WAAW,KAAK;IAAkB;IAAc;;EAChD,QAAQ,KAAK;EACb,eAAe,KAAK,OAAO;EAC3B,UAAU,KAAK;EACf,UAAU,KAAK;EACf,OAAO,KAAK;;UAGG,kCAAkC;EACjD,uBAAuB,kBAAkB;EACzC,QAAQ;EACR,SAAS,yBAAyB;;EAElC;;EAEA,kBAAkB;;EAElB,kBAAkB;;;KAIR,8BAA8B,KACxC;EAGA,iBAAiB;EACjB,WAAW;EACX;;;iBAIc,2BACd,UAAU,sCACT;;iBAQa,4BACd,SAAS,qCACR;;iBAiBa,wBACd,UAAU,mCACT;iBAQa,0BAA0B,iBAAiB;;iBAarC,uBACpB,SAAS,gCACR,QAAQ;;;;;;;;iBAkEK,2BAA2B,MACzC,SAAS,kCAAkC,QAC1C;;iBA8Ya,0CACd,SAAS,oCACR;;iBAuEa,oCACd,iBACC;iBAkHa,6BAA6B,iBAAiB;iBAM9C,oCACd,iBACC;iBAkBa,8BAA8B;;;;;;;;;;UC7zB7B;EACf,aAAa;EACb,QAAQ,gCAAgC;EACxC;EACA;;UAGe;EACf,YAAY;EACZ;EACA,aAAa;EACb,MAAM;EACN,SAAS;EACT;EACA,SAAS;;UAGM;EACf,YAAY;EACZ,QACE,OAAO,kDACN,QAAQ;;EAEX;;EAEA,aAAa;EACb,SAAS;;UAGM;EACf,cAAc;EACd;IACE;IACA,MAAM;;;UAIO;EACf,YAAY;EACZ,cAAc;EACd;IACE;IACA,MAAM;;EAER,aAAa;EACb;EACA,YAAY;EACZ;EACA,WAAW;;;iBAIG,gCACd,UAAU,sCACT;;iBAQa,iCACd,SAAS,0CACR;;iBAqBa,sCACd,UAAU,4CACT;iBAOa,kCAAkC,iBAAiB;iBAInD,yCACd,iBACC;iBAIa,wCACd,iBACC;;;;;;iBASmB,qCACpB,SAAS,8CACR,QAAQ;;iBA0CK,wDACd,SAAS,kDACR;;iBAuEa,kDACd,iBACC;;;;UCnPc;;EAEf;;EAEA;;EAEA;;UAGe;;;;;;EAMf;;;;;;;EAOA,WAAW;;;;;;EAMX;;UAGe;;EAEf,MAAM;;EAEN,UAAU;;EAEV;;;;;;;;;;iBAkBoB,iBACpB,cACA,UAAS,0BACR,QAAQ;;;;;KC7CC,0BAA0B;UAErB;;;;;EAKf,UAAU,KAAK;;EAEf,OAAO;;;;;;;;;;EAUP;;;;UAKe;;;EAGf,QAAQ;;EAER;;IAEE;;IAEA;;;IAGA;;IAEA;;;IAGA,UAAU;;;EAGZ;;;;;;;iBAUoB,mBACpB,OAAO,yBACP,UAAS,4BACR,QAAQ;;;;;;UC5DM;EACf;EACA;EACA;;;UAIe;EACf;EACA;EACA;EACA;EACA;;;EAGA,YAAY,eAAe,eAAe;;;;UAK3B;EACf;EACA;EACA;EACA;EACA;;EAEA,SAAS;;EAET,SAAS;;EAET,OAAO;;EAEP;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;;;;;UAMe;EACf;EACA;EACA;EACA;EACA,oBAAoB;EACpB,mBAAmB;EACnB;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;;EAEA,cAAc;;;;EAId,aAAa;;;;;;;;;iBAoDC,gBACd,QAAQ,2BACR,OAAO,4BACN;;;;;;iBAqEa,SAAS,QAAQ,cAAc,OAAO,eAAe;;;;;;;iBAsCrD,wBAAwB,KAAK,eAAe;;;KC1OhD;UAEK;EACf,MAAM;;EAEN;;UAGe;EACf;EACA;EACA;;;EAGA,cAAc;;UAGC;EACf;EACA,cAAc;EACd,QAAQ;;UAGO;EACf;EACA,eAAe;;UAGA;EACf;EACA;EACA;EACA;IAAQ;IAAc;;EACtB;IAAS;IAAe;;EACxB,OAAO;;;;UAOQ;EACf;;EAEA;;EAEA;EACA;EACA;;EAEA;;EAEA;;KAGU,kBAAkB,YAAY;;;;;;iBAW1B,gBAAgB,SAAS,qBAAqB;UAmE7C;;;;EAIf,SAAS,YAAY;;;EAGrB,cAAc;;;;;;;;iBASA,8BACd,MAAM,aACN,OAAO,kBACN;;;KCjLS;KAEA;KAEA;KAEA;KASA;UAEK;EACf;EACA;EACA;;UAGe;EACf;EACA;EACA,MAAM;EACN,SAAS;EACT;EACA,QAAQ;EACR;EACA;EACA,UAAU;;UAGK;EACf,QAAQ;EACR;EACA;EACA;IACE,QAAQ;IACR;;EAEF,SAAS;;UAGM;EACf,QAAQ;EACR;EACA;EACA,YAAY;;;;;;;iBAeE,wBACd,SAAS,iCACR;;;UCrCc;EACf;EACA;;UAGe;EACf;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;;UAGe;EACf,QAAQ;EACR;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA,WAAW;EACX;;UAGe;EACf,MAAM;EACN,aAAa;EACb,SAAS;EACT,cAAc;;UAGC;EACf;EACA;EACA;EACA;EACA;EACA;EACA,WAAW;EACX;EACA;EACA;EACA;EACA;EACA;;;EAGA,iBAAiB;;;EAGjB,YAAY;;iBAGE,oBAAoB,gBAAgB;iBAepC,iBACd,SAAS,gCACR;iBAIa,sBACd,SAAS,gCACR;iBAIa,oBACd,SAAS,gCACR;iBAIa,oBACd,SAAS,gCACR;iBAIa,cACd,SAAS,gCACR;cAIU,2BAAkB;;;UCpJd;;;EAGf;;EAEA;;;EAGA;;;EAGA,WAAW;;UAGI;EACf;;;EAGA;;EAEA;;EAEA;;EAEA;;EAEA;;EAEA;;EAEA;;EAEA;;EAEA;;;EAGA,WAAW;;;EAGX,SAAS;;UAGM;;EAEf,SAAS;;;EAGT,OAAO;;;;EAIP;IAAU;IAAa;;;;;EAIvB;;UAGe;EACf,MAAM;;;EAGN,aAAa;IAAQ;IAAe;IAAe;;;iBAGrC,kBAAkB,MAAM,2BAA2B;;;UCvBlD;EACf,OAAO;;EAEP,eAAe;;EAEf;;;;;;EAMA,eAAe,eAAe,gBAAgB;;iBAGhC,cAAc,MAAM,uBAAuB"}
|