@tangle-network/agent-eval 0.144.8 → 0.144.10
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/CHANGELOG.md +13 -0
- package/README.md +3 -0
- package/dist/{agent-profile-CgDTo40f.d.ts → agent-profile-DPi7IZg7.d.ts} +3 -3
- package/dist/{agent-profile-CgDTo40f.d.ts.map → agent-profile-DPi7IZg7.d.ts.map} +1 -1
- package/dist/analyst/index.d.ts +9 -9
- package/dist/analyst/index.js +7 -7
- package/dist/{analyze-runs-BNNK7irB.js → analyze-runs-C30yljDJ.js} +2 -2
- package/dist/{analyze-runs-BNNK7irB.js.map → analyze-runs-C30yljDJ.js.map} +1 -1
- package/dist/{benchmark-B181aMF9.js → benchmark-CWeqGl7x.js} +2 -2
- package/dist/{benchmark-B181aMF9.js.map → benchmark-CWeqGl7x.js.map} +1 -1
- package/dist/{benchmark-command-BKENp2s5.js → benchmark-command-D3fEnKdf.js} +8 -8
- package/dist/{benchmark-command-BKENp2s5.js.map → benchmark-command-D3fEnKdf.js.map} +1 -1
- package/dist/benchmarks/index.d.ts +1 -1
- package/dist/benchmarks/index.js +1 -1
- package/dist/{benchmarks-BlPmjd88.js → benchmarks-BzqyTvAr.js} +4 -4
- package/dist/{benchmarks-BlPmjd88.js.map → benchmarks-BzqyTvAr.js.map} +1 -1
- package/dist/campaign/index.d.ts +8 -8
- package/dist/campaign/index.js +5 -5
- package/dist/{campaign--HVSuvV0.js → campaign-ccOrVCuR.js} +6 -6
- package/dist/{campaign--HVSuvV0.js.map → campaign-ccOrVCuR.js.map} +1 -1
- package/dist/cli.js +1 -1
- package/dist/{client-DjXROWpx.d.ts → client-C9gzZE59.d.ts} +4 -4
- package/dist/{client-DjXROWpx.d.ts.map → client-C9gzZE59.d.ts.map} +1 -1
- package/dist/{completion-verifier-foUCLif_.d.ts → completion-verifier-DJA5BhPb.d.ts} +3 -3
- package/dist/{completion-verifier-foUCLif_.d.ts.map → completion-verifier-DJA5BhPb.d.ts.map} +1 -1
- package/dist/contract/index.d.ts +9 -9
- package/dist/contract/index.js +9 -9
- package/dist/contract/index.js.map +1 -1
- package/dist/control.d.ts +2 -2
- package/dist/control.js +1 -1
- package/dist/{default-registry-BZhStdjl.d.ts → default-registry-Bf8Woqmq.d.ts} +6 -6
- package/dist/{default-registry-BZhStdjl.d.ts.map → default-registry-Bf8Woqmq.d.ts.map} +1 -1
- package/dist/{default-registry-BaQXW1Ow.js → default-registry-BmktKy8r.js} +3 -3
- package/dist/{default-registry-BaQXW1Ow.js.map → default-registry-BmktKy8r.js.map} +1 -1
- package/dist/{dspy-rlm-engine-BiN49gK6.js → dspy-rlm-engine-DbTk4JdR.js} +3 -3
- package/dist/{dspy-rlm-engine-BiN49gK6.js.map → dspy-rlm-engine-DbTk4JdR.js.map} +1 -1
- package/dist/{engine-nB64f48I.d.ts → engine-3hL-XqwJ.d.ts} +7 -7
- package/dist/{engine-nB64f48I.d.ts.map → engine-3hL-XqwJ.d.ts.map} +1 -1
- package/dist/{eval-campaign-DNjCvAm-.js → eval-campaign-B_7wcnav.js} +2 -2
- package/dist/{eval-campaign-DNjCvAm-.js.map → eval-campaign-B_7wcnav.js.map} +1 -1
- package/dist/{exact-types-Djvzosly.d.ts → exact-types-DSFFpLLI.d.ts} +2 -2
- package/dist/{exact-types-Djvzosly.d.ts.map → exact-types-DSFFpLLI.d.ts.map} +1 -1
- package/dist/experiment/index.d.ts +2 -2
- package/dist/{extract-usage-BW27f3XW.js → extract-usage-CdZdoj1s.js} +2 -2
- package/dist/{extract-usage-BW27f3XW.js.map → extract-usage-CdZdoj1s.js.map} +1 -1
- package/dist/{feedback-trajectory-Rh280oXo.d.ts → feedback-trajectory-CacHpxsp.d.ts} +3 -3
- package/dist/{feedback-trajectory-Rh280oXo.d.ts.map → feedback-trajectory-CacHpxsp.d.ts.map} +1 -1
- package/dist/hosted/index.d.ts +3 -3
- package/dist/{index-CvXXlyz7.d.ts → index-BnEuDAK2.d.ts} +2 -2
- package/dist/{index-CvXXlyz7.d.ts.map → index-BnEuDAK2.d.ts.map} +1 -1
- package/dist/{index-CwDrUMe0.d.ts → index-CQTZ-4XN.d.ts} +2 -2
- package/dist/{index-CwDrUMe0.d.ts.map → index-CQTZ-4XN.d.ts.map} +1 -1
- package/dist/{index-C5HOo4ZF2.d.ts → index-CwYZNzMD2.d.ts} +5 -5
- package/dist/{index-C5HOo4ZF2.d.ts.map → index-CwYZNzMD2.d.ts.map} +1 -1
- package/dist/{index-Sh2I0DRc.d.ts → index-DvvvSho7.d.ts} +9 -9
- package/dist/{index-Sh2I0DRc.d.ts.map → index-DvvvSho7.d.ts.map} +1 -1
- package/dist/index.d.ts +22 -22
- package/dist/index.js +18 -18
- package/dist/{insight-report-C6h6F_4L.d.ts → insight-report-CgX_s0Ez.d.ts} +3 -3
- package/dist/{insight-report-C6h6F_4L.d.ts.map → insight-report-CgX_s0Ez.d.ts.map} +1 -1
- package/dist/{kind-factory-BHIgPmzS.js → kind-factory-B8-r8-y8.js} +3 -16
- package/dist/kind-factory-B8-r8-y8.js.map +1 -0
- package/dist/meta-eval/index.d.ts +1 -1
- package/dist/{mint-CGEkzPLf.js → mint-B2O60ACG.js} +2 -2
- package/dist/{mint-CGEkzPLf.js.map → mint-B2O60ACG.js.map} +1 -1
- package/dist/multishot/index.d.ts +1 -1
- package/dist/openapi.json +1 -1
- package/dist/{promotion-policy-ChWhTDBH.d.ts → promotion-policy-Ckjhzg_4.d.ts} +2 -2
- package/dist/{promotion-policy-ChWhTDBH.d.ts.map → promotion-policy-Ckjhzg_4.d.ts.map} +1 -1
- package/dist/{propose-review-control-qgWLA6E9.js → propose-review-control-dSNPjFUH.js} +2 -2
- package/dist/{propose-review-control-qgWLA6E9.js.map → propose-review-control-dSNPjFUH.js.map} +1 -1
- package/dist/{release-report-Dy39cbFF.js → release-report-BUYmoKo2.js} +2 -2
- package/dist/{release-report-Dy39cbFF.js.map → release-report-BUYmoKo2.js.map} +1 -1
- package/dist/{release-report-CI8uisI1.d.ts → release-report-DA2BCu5a.d.ts} +3 -3
- package/dist/{release-report-CI8uisI1.d.ts.map → release-report-DA2BCu5a.d.ts.map} +1 -1
- package/dist/{replay-DyBLaKFc.js → replay-CohS93nE.js} +5 -5
- package/dist/{replay-DyBLaKFc.js.map → replay-CohS93nE.js.map} +1 -1
- package/dist/{replay-DFf-teiC.d.ts → replay-DbhZ4Ked.d.ts} +5 -5
- package/dist/{replay-DFf-teiC.d.ts.map → replay-DbhZ4Ked.d.ts.map} +1 -1
- package/dist/reporting.d.ts +3 -3
- package/dist/reporting.js +1 -1
- package/dist/{researcher-BoaxeCzP.d.ts → researcher-BchpD55R.d.ts} +3 -3
- package/dist/{researcher-BoaxeCzP.d.ts.map → researcher-BchpD55R.d.ts.map} +1 -1
- package/dist/{reward-hacking-B2tPL9a3.js → reward-hacking-BDToousL.js} +4 -3
- package/dist/reward-hacking-BDToousL.js.map +1 -0
- package/dist/{reward-hacking-Cf1PtEOz.d.ts → reward-hacking-BI0OMAlo.d.ts} +2 -2
- package/dist/{reward-hacking-Cf1PtEOz.d.ts.map → reward-hacking-BI0OMAlo.d.ts.map} +1 -1
- package/dist/rl.d.ts +5 -5
- package/dist/rl.js +4 -4
- package/dist/rollout/index.d.ts +1 -1
- package/dist/rollout/index.js +2 -2
- package/dist/{rollout-2ECTXb2N.js → rollout-DRrksrcV.js} +2 -2
- package/dist/{rollout-2ECTXb2N.js.map → rollout-DRrksrcV.js.map} +1 -1
- package/dist/{rubric-predictive-validity-9qAwzkZm.d.ts → rubric-predictive-validity-DvkjPYCe.d.ts} +2 -2
- package/dist/{rubric-predictive-validity-9qAwzkZm.d.ts.map → rubric-predictive-validity-DvkjPYCe.d.ts.map} +1 -1
- package/dist/{run-evidence-BDFFai9R.d.ts → run-evidence-Dhi3C81V.d.ts} +3 -3
- package/dist/{run-evidence-BDFFai9R.d.ts.map → run-evidence-Dhi3C81V.d.ts.map} +1 -1
- package/dist/{run-record-DqOw5X6_.js → run-record-BmSPWXJR.js} +2 -1
- package/dist/run-record-BmSPWXJR.js.map +1 -0
- package/dist/{run-record-DdSa93_W.d.ts → run-record-CF4Dwpxr.d.ts} +4 -1
- package/dist/run-record-CF4Dwpxr.d.ts.map +1 -0
- package/dist/{semantic-concept-judge-Bmrq6yqU.js → semantic-concept-judge-D1z-KepS.js} +2 -2
- package/dist/{semantic-concept-judge-Bmrq6yqU.js.map → semantic-concept-judge-D1z-KepS.js.map} +1 -1
- package/dist/{single-run-lock-BMQEv1wG.js → single-run-lock-DFWHEB09.js} +123 -123
- package/dist/{single-run-lock-BMQEv1wG.js.map → single-run-lock-DFWHEB09.js.map} +1 -1
- package/dist/{skill-usage-CJlWEUFt.d.ts → skill-usage-CO9OLRBx.d.ts} +6 -6
- package/dist/{skill-usage-CJlWEUFt.d.ts.map → skill-usage-CO9OLRBx.d.ts.map} +1 -1
- package/dist/{skillopt-optimization-method-BO7NAl3b.d.ts → skillopt-optimization-method-9J8dJbrM.d.ts} +40 -8
- package/dist/skillopt-optimization-method-9J8dJbrM.d.ts.map +1 -0
- package/dist/{skillopt-optimization-method-CkaI2ly4.js → skillopt-optimization-method-D6Q4dLbh.js} +301 -133
- package/dist/skillopt-optimization-method-D6Q4dLbh.js.map +1 -0
- package/dist/{statistical-heldout-Dn9ruizm.d.ts → statistical-heldout-TQ-4CYiN.d.ts} +3 -3
- package/dist/{statistical-heldout-Dn9ruizm.d.ts.map → statistical-heldout-TQ-4CYiN.d.ts.map} +1 -1
- package/dist/{store-otlp-CKtTpRhv.js → store-otlp-Dw8PPIlL.js} +2 -2
- package/dist/{store-otlp-CKtTpRhv.js.map → store-otlp-Dw8PPIlL.js.map} +1 -1
- package/dist/{summary-report-DuUS_i7W.d.ts → summary-report-BNR7DWTj.d.ts} +2 -2
- package/dist/{summary-report-DuUS_i7W.d.ts.map → summary-report-BNR7DWTj.d.ts.map} +1 -1
- package/dist/{tool-groups-DIVBnJyl.d.ts → tool-groups-CZPGGlHf.d.ts} +3 -3
- package/dist/tool-groups-CZPGGlHf.d.ts.map +1 -0
- package/dist/trace-repair/index.d.ts +2 -2
- package/dist/traces.d.ts +4 -4
- package/dist/traces.js +4 -4
- package/dist/{types-DYuNHo9R.d.ts → types-BnjdJ70P.d.ts} +3 -3
- package/dist/{types-DYuNHo9R.d.ts.map → types-BnjdJ70P.d.ts.map} +1 -1
- package/dist/{types-DF_Udrp-.d.ts → types-BvDKaULh.d.ts} +2 -2
- package/dist/{types-DF_Udrp-.d.ts.map → types-BvDKaULh.d.ts.map} +1 -1
- package/dist/{usage-receipt-EVI8B8Xu.js → usage-receipt-t7vAzCRQ.js} +15 -2
- package/dist/usage-receipt-t7vAzCRQ.js.map +1 -0
- package/dist/wire/index.d.ts +1 -1
- package/docs/concepts.md +1 -0
- package/package.json +1 -1
- package/dist/kind-factory-BHIgPmzS.js.map +0 -1
- package/dist/reward-hacking-B2tPL9a3.js.map +0 -1
- package/dist/run-record-DdSa93_W.d.ts.map +0 -1
- package/dist/run-record-DqOw5X6_.js.map +0 -1
- package/dist/skillopt-optimization-method-BO7NAl3b.d.ts.map +0 -1
- package/dist/skillopt-optimization-method-CkaI2ly4.js.map +0 -1
- package/dist/tool-groups-DIVBnJyl.d.ts.map +0 -1
- package/dist/usage-receipt-EVI8B8Xu.js.map +0 -1
package/CHANGELOG.md
CHANGED
|
@@ -20,6 +20,19 @@ All notable changes to `@tangle-network/agent-eval` and its sibling `agent-eval-
|
|
|
20
20
|
- Blind statement-equivalence protocol (`defineEquivalenceCheck`, `buildEquivalenceRecord`, `runEquivalenceCheck`): the two-arm design as a typed primitive with fail-loud refusals (`EquivalenceProtocolError`) — a non-blind arm, a wrong arm count, a refutation without its separating witness, or a mismatched checker strategy throws instead of recording.
|
|
21
21
|
- `docs/verification-strategies.md`: the family, each member's failure mode, and the BCWW (4.6) formalization pilot as the worked example.
|
|
22
22
|
|
|
23
|
+
## [0.144.10] - 2026-08-10 - Optimizer candidate population
|
|
24
|
+
|
|
25
|
+
### Added
|
|
26
|
+
|
|
27
|
+
- `readExternalOptimizerObservationArtifact()` returns every distinct callback-submitted optimizer candidate after it verifies the addressed artifact's digest, canonical rows, sequence, candidate identities, and counts.
|
|
28
|
+
- `decodeExternalTextCandidate()` exposes Eval's existing canonical conversion from external text or named components to a mutable optimization surface.
|
|
29
|
+
|
|
30
|
+
## [0.144.9] - 2026-08-10 - Token usage completeness
|
|
31
|
+
|
|
32
|
+
### Fixed
|
|
33
|
+
|
|
34
|
+
- Campaign cells and run records preserve incomplete token usage as `tokensKnown: false`; their numeric counts remain known subtotals and no token-efficiency ratio is reported.
|
|
35
|
+
|
|
23
36
|
## [0.144.8] - 2026-08-10 - Duplicate candidate admission
|
|
24
37
|
|
|
25
38
|
### Fixed
|
package/README.md
CHANGED
|
@@ -337,6 +337,9 @@ Read `scores` for final-case lift and intervals.
|
|
|
337
337
|
Read `pairwise` before claiming one method beat another.
|
|
338
338
|
Read `totalCost.accountingComplete` before using the reported dollars as a complete total.
|
|
339
339
|
Each official method score records the optimizer and bridge package versions, source revisions and source-tree hashes, Python runtime, configured optimizer model when present, custom engine module hashes, compatible run ID, exact attempt ID, resume status, evaluation count, artifact directory, and available optimizer token usage in `provenance`.
|
|
340
|
+
Call `readExternalOptimizerObservationArtifact()` with `provenance.observations` to read every distinct callback-submitted candidate.
|
|
341
|
+
The reader verifies the artifact digest, canonical rows, sequence, candidate identities, and summary counts before returning candidates.
|
|
342
|
+
This verification proves that the bytes match the supplied summary; use a summary from trusted method provenance when authenticity matters.
|
|
340
343
|
|
|
341
344
|
The [optimizer guide](./docs/campaign-proposers.md) covers recipes, budgets, resuming, and data separation.
|
|
342
345
|
The [runnable comparison](./examples/compare-optimization-methods/) can run GEPA, SkillOpt, or both.
|
|
@@ -1,5 +1,5 @@
|
|
|
1
|
-
import { c as AnalystRunInputs, f as AnalystUsageReceipt, i as AnalystFinding, p as EvidenceRef, w as TraceAnalysisStore } from "./types-
|
|
2
|
-
import { E as AnalystRegistry, M as RegistryRunOpts } from "./completion-verifier-
|
|
1
|
+
import { c as AnalystRunInputs, f as AnalystUsageReceipt, i as AnalystFinding, p as EvidenceRef, w as TraceAnalysisStore } from "./types-BvDKaULh.js";
|
|
2
|
+
import { E as AnalystRegistry, M as RegistryRunOpts } from "./completion-verifier-DJA5BhPb.js";
|
|
3
3
|
import { AgentProfile, AgentProfile as AgentProfile$1, HarnessType, HarnessType as HarnessType$1 } from "@tangle-network/agent-interface";
|
|
4
4
|
//#region src/analyst/benchmark-scoring.d.ts
|
|
5
5
|
declare function scoreAnalystFindings(testCase: Pick<AnalystBenchmarkCase, 'id' | 'expectedIssues' | 'labeledEvidence'>, findings: readonly AnalystFinding[]): AnalystFindingScore;
|
|
@@ -320,4 +320,4 @@ declare function agentProfileModelId(profile: AgentProfile): string;
|
|
|
320
320
|
declare function agentProfileHash(profile: AgentProfile): string;
|
|
321
321
|
//#endregion
|
|
322
322
|
export { registryBenchmarkRunner as A, AnalystEvidenceResolution as C, AnalystIssueExpectation as D, AnalystFindingScore as E, traceStoreEvidenceResolver as M, scoreAnalystFindings as N, AnalystLatencyDistribution as O, AnalystEvidenceExpectation as S, AnalystEvidenceResolver as T, AnalystBenchmarkOutput as _, ProfileAxisSpec as a, AnalystBenchmarkRunner as b, agentProfileModelId as c, AnalystBenchmarkCase as d, AnalystBenchmarkDatasetRef as f, AnalystBenchmarkObservation as g, AnalystBenchmarkLabelState as h, HarnessType$1 as i, runAnalystBenchmark as j, RunAnalystBenchmarkOptions as k, expandProfileAxes as l, AnalystBenchmarkError as m, CODING_HARNESSES as n, agentProfileHash as o, AnalystBenchmarkDescriptor as p, HARNESS_NATIVE_MODEL as r, agentProfileId as s, AgentProfile$1 as t, harnessAxisOf as u, AnalystBenchmarkProvenance as v, AnalystEvidenceResolutionError as w, AnalystBenchmarkSummary as x, AnalystBenchmarkResult as y };
|
|
323
|
-
//# sourceMappingURL=agent-profile-
|
|
323
|
+
//# sourceMappingURL=agent-profile-DPi7IZg7.d.ts.map
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"agent-profile-
|
|
1
|
+
{"version":3,"file":"agent-profile-DPi7IZg7.d.ts","names":[],"sources":["../src/analyst/benchmark-scoring.ts","../src/analyst/benchmark.ts","../src/agent-profile.ts"],"mappings":";;;;iBASgB,qBACd,UAAU,KAAK,oEACf,mBAAmB,mBAClB;;;UCIc;EACf;EACA,OAAO;;UAGQ;EACf;EACA;EACA;EACA;EACA,oBAAoB;EACpB;;EAEA,4BAA4B;;KAGlB;UAEK,qBAAqB;EACpC;;EAEA;;EAEA,YAAY;EACZ,OAAO;EACP,yBAAyB;;EAEzB,2BAA2B;EAC3B;EACA,WAAW;;UAGI;EACf;EACA;EACA;EACA;EACA;EACA,mBAAmB;EACnB;EACA;EACA;EACA;;EAEA;;EAEA;;EAEA;EACA;;UAGe;EACf,UAAU;EACV;EACA;;UAGe;EACf;EACA;EACA,oBAAoB;EACpB,QAAQ;;EAER;;KAGU,wBAAwB,qBAAqB;EACvD;EACA,WAAW;EACX,UAAU;EACV,SAAS;gBACK;;;;;iBAMA,2BAA2B,QACzC,WAAW,OAAO,WAAW,qBAC5B,wBAAwB;UAoBV;EACf,mBAAmB;EACnB,QAAQ;EACR,WAAW;;;;;EAKX;;EAEA,QAAQ;;UAGO;EACf;EACA;EACA;EACA;;UAGe,uBAAuB;EACtC;EACA,QACE,OAAO,QACP;IAAW;IAAgB;IAAoB,SAAS;MACvD,yBAAyB,QAAQ;;UAGrB;EACf;EACA;EACA;EACA,YAAY;EACZ;EACA;EACA;EACA;EACA,mBAAmB;EACnB,OAAO;EACP,qBAAqB;EACrB;EACA,eAAe;EACf,QAAQ;EACR,iBAAiB;EACjB,QAAQ;;UAGO;EACf;EACA;EACA;EACA;EACA;;UAGe;EACf;EACA;EACA;EACA;EACA;EACA;EACA;;EAEA;;EAEA;;EAEA;;EAEA;;EAEA;;EAEA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;;EAEA;;EAEA;;EAEA;;EAEA;EACA,WAAW;EACX;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;EACA;;UAGe;EACf;EACA;EACA;;UAGe;EACf;EACA,UAAU;EACV;EACA,cAAc;EACd,WAAW;;UAGI,mCAAmC;EAClD;EACA;EACA;EACA;EACA;EACA;EACA;;UAGe;EACf,YAAY;EACZ,cAAc;EACd,WAAW;;UAGI,2BAA2B;EAC1C,gBAAgB,qBAAqB;EACrC,kBAAkB,uBAAuB;EACzC;EACA;EACA;EACA,kBAAkB,wBAAwB;EAC1C,YAAY;;EAEZ,+BAA+B;EAC/B,iBAAiB,aAAa,uCAAuC;EACrE,SAAS;;iBAGW,oBAAoB,QACxC,SAAS,2BAA2B,UACnC,QAAQ;iBAyDK,wBAAwB;EACtC;EACA,UAAU;EACV,aAAa,KAAK;;EAElB;IACE,uBAAuB;;;;;;;;;;cCpUd,2BAA2B;UAOvB;;;EAGf,MAAM;;EAEN,qBAAqB;;;EAGrB;;;;;;EAMA;;;;;;;cAQW;;;;;;;;;;;;;;;;;;;iBAoBG,kBAAkB,MAAM,kBAAkB;;;;;;;;iBAwD1C,cACd,SAAS,KAAK;EACX,SAAS;EAAa;;;;;;;;;iBAiBX,eAAe,SAAS;;;;;iBASxB,oBAAoB,SAAS;;;;;;;;;;;iBA0C7B,iBAAiB,SAAS"}
|
package/dist/analyst/index.d.ts
CHANGED
|
@@ -1,15 +1,15 @@
|
|
|
1
1
|
import { a as MultiLayerVerifier, l as VerifyOptions, o as Severity } from "../multi-layer-verifier-DnAqwl0h.js";
|
|
2
|
-
import { A as parseFindingSubject, C as FINDING_SUBJECT_KINDS, D as FindingSubjectStringSchema, E as FindingSubjectKind, F as DefineExactCustomAnalystOptions, G as SemanticConceptJudgeOptions, I as defineCustomAnalyst, L as defineTraceAnalyst, M as DspyRlmTraceEngineOptions, N as createDspyRlmTraceEngine, O as KIND_EXPECTED_SUBJECTS, P as DefineCustomAnalystOptions, S as FINDING_SUBJECT_GRAMMAR_PROMPT, T as FindingSubject, W as SemanticConceptJudgeInput, Y as RunCritic, Z as RunTrace, _ as FindingsDiff, a as SkillUsageScanConfig, b as defaultIsMaterial, c as DEFAULT_TRACE_ANALYST_KINDS, d as IMPROVEMENT_KIND_SPEC, f as FAILURE_MODE_KIND_SPEC, g as DiffPolicy, h as emitControlIntegrityFindings, i as SkillUsageReport, j as renderFindingSubject, k as findingSubjectGrammarPromptFor, l as KNOWLEDGE_POISONING_KIND_SPEC, m as ControlIntegrityAnalyst, n as SkillUsageAnalyst, o as buildSkillUsageReport, p as CONTROL_INTEGRITY_ANALYST, r as SkillUsageRecord, s as emitSkillUsageFindings, t as SKILL_USAGE_ANALYST, u as KNOWLEDGE_GAP_KIND_SPEC, v as FindingsStore, w as FINDING_SUBJECT_SYNTAX, x as diffFindings, y as PersistedFinding } from "../skill-usage-
|
|
2
|
+
import { A as parseFindingSubject, C as FINDING_SUBJECT_KINDS, D as FindingSubjectStringSchema, E as FindingSubjectKind, F as DefineExactCustomAnalystOptions, G as SemanticConceptJudgeOptions, I as defineCustomAnalyst, L as defineTraceAnalyst, M as DspyRlmTraceEngineOptions, N as createDspyRlmTraceEngine, O as KIND_EXPECTED_SUBJECTS, P as DefineCustomAnalystOptions, S as FINDING_SUBJECT_GRAMMAR_PROMPT, T as FindingSubject, W as SemanticConceptJudgeInput, Y as RunCritic, Z as RunTrace, _ as FindingsDiff, a as SkillUsageScanConfig, b as defaultIsMaterial, c as DEFAULT_TRACE_ANALYST_KINDS, d as IMPROVEMENT_KIND_SPEC, f as FAILURE_MODE_KIND_SPEC, g as DiffPolicy, h as emitControlIntegrityFindings, i as SkillUsageReport, j as renderFindingSubject, k as findingSubjectGrammarPromptFor, l as KNOWLEDGE_POISONING_KIND_SPEC, m as ControlIntegrityAnalyst, n as SkillUsageAnalyst, o as buildSkillUsageReport, p as CONTROL_INTEGRITY_ANALYST, r as SkillUsageRecord, s as emitSkillUsageFindings, t as SKILL_USAGE_ANALYST, u as KNOWLEDGE_GAP_KIND_SPEC, v as FindingsStore, w as FINDING_SUBJECT_SYNTAX, x as diffFindings, y as PersistedFinding } from "../skill-usage-CO9OLRBx.js";
|
|
3
3
|
import { b as CustomTokenPricing, c as CostLedgerHandle } from "../cost-ledger-Bv_e8XHY.js";
|
|
4
4
|
import { A as ChatClient, B as SandboxSdkTransportOpts, F as CreateChatClientOpts, I as CustomTransportOpts, L as DirectProviderTransportOpts, M as ChatResponse, N as ChatTransport, P as CliBridgeTransportOpts, R as MockTransportOpts, V as createChatClient, j as ChatRequest, k as ChatCallOpts, m as JudgeInput, p as JudgeFn, z as RouterTransportOpts } from "../types-D216SgwM.js";
|
|
5
|
-
import { I as TraceAnalystSpan, _ as ProposalFinding, a as AnalystInputKind, b as makeFinding, c as AnalystRunInputs, d as AnalystSeverity, f as AnalystUsageReceipt, g as ExecutionProbeRequest, h as ExecutionProbeOutcome, i as AnalystFinding, l as AnalystRunResult, m as ExecutionProbe, n as AnalystContext, o as AnalystRequirements, p as EvidenceRef, r as AnalystCost, s as AnalystRunEvent, t as Analyst, u as AnalystRunSummary, v as ProposalFindingOrigin, w as TraceAnalysisStore, x as makeProposalFinding, y as computeFindingId } from "../types-
|
|
6
|
-
import { a as createTraceAnalyst, c as runTraceAnalyst, d as deriveEfficiencyFindings, i as TraceAnalystDefinition, l as BehavioralAnalystOptions, n as buildDefaultAnalystRegistry, o as renderPriorFindings, r as CreateTraceAnalystOptions, s as renderUpstreamFindings, t as DefaultAnalystRegistryOptions, u as behavioralAnalyst } from "../default-registry-
|
|
7
|
-
import { a as ExactAnalystRunPolicySnapshot, c as ExactAnalystSnapshot, d as ExactExecutionComponentSnapshot, i as ExactAnalystRunEvent, l as ExactCapableAnalyst, n as ExactAnalystExecutionPlanSnapshot, o as ExactAnalystRunResult, r as ExactAnalystRunCompletion, s as ExactAnalystRunSummary, t as ExactAnalystBudgetSnapshot, u as ExactExecutionComponentIdentity } from "../exact-types-
|
|
8
|
-
import { A as ExactAnalystRunExecutionError, D as AnalystRegistryOptions, E as AnalystRegistry, M as RegistryRunOpts, N as assertExactRegistryRunOpts, O as BudgetPolicy, T as AnalystHooks, j as ExactRegistryRunOpts, k as ExactAnalystBudgetPolicy } from "../completion-verifier-
|
|
9
|
-
import { A as registryBenchmarkRunner, C as AnalystEvidenceResolution, D as AnalystIssueExpectation, E as AnalystFindingScore, M as traceStoreEvidenceResolver, N as scoreAnalystFindings, O as AnalystLatencyDistribution, S as AnalystEvidenceExpectation, T as AnalystEvidenceResolver, _ as AnalystBenchmarkOutput, b as AnalystBenchmarkRunner, d as AnalystBenchmarkCase, f as AnalystBenchmarkDatasetRef, g as AnalystBenchmarkObservation, h as AnalystBenchmarkLabelState, j as runAnalystBenchmark, k as RunAnalystBenchmarkOptions, m as AnalystBenchmarkError, p as AnalystBenchmarkDescriptor, t as AgentProfile, v as AnalystBenchmarkProvenance, w as AnalystEvidenceResolutionError, x as AnalystBenchmarkSummary, y as AnalystBenchmarkResult } from "../agent-profile-
|
|
5
|
+
import { I as TraceAnalystSpan, _ as ProposalFinding, a as AnalystInputKind, b as makeFinding, c as AnalystRunInputs, d as AnalystSeverity, f as AnalystUsageReceipt, g as ExecutionProbeRequest, h as ExecutionProbeOutcome, i as AnalystFinding, l as AnalystRunResult, m as ExecutionProbe, n as AnalystContext, o as AnalystRequirements, p as EvidenceRef, r as AnalystCost, s as AnalystRunEvent, t as Analyst, u as AnalystRunSummary, v as ProposalFindingOrigin, w as TraceAnalysisStore, x as makeProposalFinding, y as computeFindingId } from "../types-BvDKaULh.js";
|
|
6
|
+
import { a as createTraceAnalyst, c as runTraceAnalyst, d as deriveEfficiencyFindings, i as TraceAnalystDefinition, l as BehavioralAnalystOptions, n as buildDefaultAnalystRegistry, o as renderPriorFindings, r as CreateTraceAnalystOptions, s as renderUpstreamFindings, t as DefaultAnalystRegistryOptions, u as behavioralAnalyst } from "../default-registry-Bf8Woqmq.js";
|
|
7
|
+
import { a as ExactAnalystRunPolicySnapshot, c as ExactAnalystSnapshot, d as ExactExecutionComponentSnapshot, i as ExactAnalystRunEvent, l as ExactCapableAnalyst, n as ExactAnalystExecutionPlanSnapshot, o as ExactAnalystRunResult, r as ExactAnalystRunCompletion, s as ExactAnalystRunSummary, t as ExactAnalystBudgetSnapshot, u as ExactExecutionComponentIdentity } from "../exact-types-DSFFpLLI.js";
|
|
8
|
+
import { A as ExactAnalystRunExecutionError, D as AnalystRegistryOptions, E as AnalystRegistry, M as RegistryRunOpts, N as assertExactRegistryRunOpts, O as BudgetPolicy, T as AnalystHooks, j as ExactRegistryRunOpts, k as ExactAnalystBudgetPolicy } from "../completion-verifier-DJA5BhPb.js";
|
|
9
|
+
import { A as registryBenchmarkRunner, C as AnalystEvidenceResolution, D as AnalystIssueExpectation, E as AnalystFindingScore, M as traceStoreEvidenceResolver, N as scoreAnalystFindings, O as AnalystLatencyDistribution, S as AnalystEvidenceExpectation, T as AnalystEvidenceResolver, _ as AnalystBenchmarkOutput, b as AnalystBenchmarkRunner, d as AnalystBenchmarkCase, f as AnalystBenchmarkDatasetRef, g as AnalystBenchmarkObservation, h as AnalystBenchmarkLabelState, j as runAnalystBenchmark, k as RunAnalystBenchmarkOptions, m as AnalystBenchmarkError, p as AnalystBenchmarkDescriptor, t as AgentProfile, v as AnalystBenchmarkProvenance, w as AnalystEvidenceResolutionError, x as AnalystBenchmarkSummary, y as AnalystBenchmarkResult } from "../agent-profile-DPi7IZg7.js";
|
|
10
10
|
import { f as ExternalOptimizerModelExecutionObservation, h as ExternalOptimizerRunnerCommand, l as ExternalOptimizerModelCall } from "../external-optimizer-contracts-CZuJNcT5.js";
|
|
11
|
-
import { a as TraceAnalystLimits, c as RAW_FINDING_SCHEMA_PROMPT, d as RawAnalystFinding, f as RawAnalystFindingSchema, i as TraceAnalysisEngineResult, l as RawAnalystEvidence, m as parseRawFinding, n as TraceAnalysisEngine, o as resolveTraceAnalystLimits, p as evidenceRefsFromRawFinding, r as TraceAnalysisEngineRequest, s as ANALYST_SEVERITIES, t as DEFAULT_TRACE_ANALYST_LIMITS, u as RawAnalystEvidenceSchema } from "../engine-
|
|
12
|
-
import { n as buildTraceToolsForGroup, t as TraceToolGroupName } from "../tool-groups-
|
|
11
|
+
import { a as TraceAnalystLimits, c as RAW_FINDING_SCHEMA_PROMPT, d as RawAnalystFinding, f as RawAnalystFindingSchema, i as TraceAnalysisEngineResult, l as RawAnalystEvidence, m as parseRawFinding, n as TraceAnalysisEngine, o as resolveTraceAnalystLimits, p as evidenceRefsFromRawFinding, r as TraceAnalysisEngineRequest, s as ANALYST_SEVERITIES, t as DEFAULT_TRACE_ANALYST_LIMITS, u as RawAnalystEvidenceSchema } from "../engine-3hL-XqwJ.js";
|
|
12
|
+
import { n as buildTraceToolsForGroup, t as TraceToolGroupName } from "../tool-groups-CZPGGlHf.js";
|
|
13
13
|
import { i as nodeHttpPrimeBridgeTransport, n as PrimeBridgeTransportRequest, r as PrimeBridgeTransportResult, t as PrimeBridgeTransport } from "../prime-bridge-transport-6feEglLf.js";
|
|
14
14
|
import { z } from "zod";
|
|
15
15
|
//#region src/analyst/adapters.d.ts
|
|
@@ -1274,7 +1274,7 @@ declare const ANALYST_BENCHMARK_HELP = "agent-eval analyst-benchmark\n\nRun the
|
|
|
1274
1274
|
declare const ANALYST_BENCHMARK_IMPLEMENTATION_DIGEST_ALGORITHM = "sha256-canonical-source-manifest";
|
|
1275
1275
|
declare const ANALYST_BENCHMARK_DEPENDENCY_LOCK_DIGEST_ALGORITHM = "sha256-canonical-file-manifest";
|
|
1276
1276
|
declare const ANALYST_BENCHMARK_DEPENDENCY_LOCK_FILES: readonly string[];
|
|
1277
|
-
declare const ANALYST_BENCHMARK_DEPENDENCY_LOCK_SHA256 = "
|
|
1277
|
+
declare const ANALYST_BENCHMARK_DEPENDENCY_LOCK_SHA256 = "951c42191f617a9128ac81ed1af189275397c5a2fe965c8a3c694cf91a26c508";
|
|
1278
1278
|
/** The published benchmark evidence was produced at this package version, by
|
|
1279
1279
|
* the retired one-shot direct runner, before trace analysts moved to the
|
|
1280
1280
|
* recursive DSPy RLM engine. Both evidence digests below are historical facts
|
package/dist/analyst/index.js
CHANGED
|
@@ -1,12 +1,12 @@
|
|
|
1
1
|
import { i as CostLedger } from "../cost-ledger-DMFxsLKr.js";
|
|
2
|
-
import { C as createChatClient, _ as CONTROL_INTEGRITY_ANALYST, b as behavioralAnalyst, f as DEFAULT_TRACE_ANALYST_KINDS, g as FAILURE_MODE_KIND_SPEC, h as IMPROVEMENT_KIND_SPEC, i as assertExactRegistryRunOpts, m as KNOWLEDGE_GAP_KIND_SPEC, n as AnalystRegistry, p as KNOWLEDGE_POISONING_KIND_SPEC, r as ExactAnalystRunExecutionError, t as buildDefaultAnalystRegistry, v as ControlIntegrityAnalyst, x as deriveEfficiencyFindings, y as emitControlIntegrityFindings } from "../default-registry-
|
|
3
|
-
import { A as coerceJson, B as renderFindingSubject, D as RawAnalystFindingSchema, E as RawAnalystEvidenceSchema, F as FINDING_SUBJECT_SYNTAX,
|
|
4
|
-
import {
|
|
2
|
+
import { C as createChatClient, _ as CONTROL_INTEGRITY_ANALYST, b as behavioralAnalyst, f as DEFAULT_TRACE_ANALYST_KINDS, g as FAILURE_MODE_KIND_SPEC, h as IMPROVEMENT_KIND_SPEC, i as assertExactRegistryRunOpts, m as KNOWLEDGE_GAP_KIND_SPEC, n as AnalystRegistry, p as KNOWLEDGE_POISONING_KIND_SPEC, r as ExactAnalystRunExecutionError, t as buildDefaultAnalystRegistry, v as ControlIntegrityAnalyst, x as deriveEfficiencyFindings, y as emitControlIntegrityFindings } from "../default-registry-BmktKy8r.js";
|
|
3
|
+
import { A as coerceJson, B as renderFindingSubject, D as RawAnalystFindingSchema, E as RawAnalystEvidenceSchema, F as FINDING_SUBJECT_SYNTAX, I as FindingSubjectStringSchema, L as KIND_EXPECTED_SUBJECTS, M as stripCodeFences, N as FINDING_SUBJECT_GRAMMAR_PROMPT, O as evidenceRefsFromRawFinding, P as FINDING_SUBJECT_KINDS, R as findingSubjectGrammarPromptFor, T as RAW_FINDING_SCHEMA_PROMPT, U as DEFAULT_TRACE_ANALYST_LIMITS, W as resolveTraceAnalystLimits, a as buildTraceToolsForGroup, i as runTraceAnalyst, j as coerceToFindingRows, k as parseRawFinding, n as renderPriorFindings, r as renderUpstreamFindings, t as createTraceAnalyst, w as ANALYST_SEVERITIES, z as parseFindingSubject } from "../kind-factory-B8-r8-y8.js";
|
|
4
|
+
import { c as makeProposalFinding, i as validateUsageSettlementTimeout, n as settleUsageReceiptFromCostLedger, o as computeFindingId, s as makeFinding } from "../usage-receipt-t7vAzCRQ.js";
|
|
5
5
|
import { n as isProposalFinding, t as assertProposalFindings } from "../proposal-findings-2GIUo1et.js";
|
|
6
|
-
import { a as RunCritic, c as buildSkillUsageReport, d as defaultIsMaterial, f as diffFindings, h as defineTraceAnalyst, i as runSemanticConceptJudge, l as emitSkillUsageFindings, m as defineCustomAnalyst, n as SEMANTIC_CONCEPT_JUDGE_VERSION, o as SKILL_USAGE_ANALYST, s as SkillUsageAnalyst, u as FindingsStore } from "../semantic-concept-judge-
|
|
7
|
-
import { t as createDspyRlmTraceEngine } from "../dspy-rlm-engine-
|
|
8
|
-
import { a as scoreAnalystFindings, i as summarizeAnalystBenchmarkRunner, n as runAnalystBenchmark, r as traceStoreEvidenceResolver, t as registryBenchmarkRunner } from "../benchmark-
|
|
9
|
-
import { $ as ANALYST_BENCHMARK_IMPLEMENTATION_SHA256, A as summarizeCodeTraceCalibration, B as publicBenchmarkSystemPrompt, C as analystDefinitionAsymmetries, D as expandCodeTraceFailureBlocks, E as emptyPublicBenchmarkRunner, F as CODE_TRACE_BENCH_ANALYST_PROMPT, G as ANALYST_BENCHMARK_DEPENDENCY_LOCK_DIGEST_ALGORITHM, H as appendVerificationArtifactsToOtlp, I as MAX_INCORRECT_BLOCKS, J as ANALYST_BENCHMARK_EVIDENCE_DEPENDENCY_LOCK_SHA256, K as ANALYST_BENCHMARK_DEPENDENCY_LOCK_FILES, L as MAX_INCORRECT_BLOCK_STEPS, M as analystInstructionsOverrideFromText, N as effectiveAnalystProtocolSha256, O as readAnalystBenchmarkArtifact, P as readAnalystInstructionsOverride, Q as ANALYST_BENCHMARK_IMPLEMENTATION_FILES, R as publicBenchmarkProtocolSha256, S as AnalystExpressivenessError, T as adaptPublicBenchmarkFindings, U as loadCodeTraceVerificationArtifacts, V as DEFAULT_MAX_VERIFICATION_ARTIFACT_BYTES, W as parseVerificationOutcome, X as ANALYST_BENCHMARK_EVIDENCE_PACKAGE_VERSION, Y as ANALYST_BENCHMARK_EVIDENCE_IMPLEMENTATION_SHA256, Z as ANALYST_BENCHMARK_IMPLEMENTATION_DIGEST_ALGORITHM, _ as runReplVariableAnalystDefinition, a as primeAnalystProtocolSha256, at as ANALYST_BENCHMARK_OBSERVATIONS_FILE, b as runChunkedAnalystDefinition, c as nodeHttpPrimeBridgeTransport, ct as summarizeAgentRxCalibration, d as publicBenchmarkDistributions, dt as agentRxBenchmarkCase, et as analystBenchmarkDependencyLockDigest, f as publicBenchmarkSelectionReport, ft as agentRxPredictionsToFindings, g as rlmEngineLimits, h as publicRlmAnalystDefinition, ht as normalizeBenchmarkLabel, i as createPrimeBenchmarkRunner, it as ANALYST_BENCHMARK_MANIFEST_FILE, j as compareAnalystRunners, k as renderCodeTraceCalibrationMarkdown, l as loadPublicBenchmarkRows, lt as codeTraceBenchCase, m as createPublicBenchmarkRlmRunner, mt as roundAgentRxStep, n as runAnalystBenchmarkCommand, nt as ANALYST_BENCHMARK_COST_LEDGER_FILE, o as primeCodeTraceAnalystDefinition, ot as AGENT_RX_UPSTREAM_REVISION, p as selectPublicBenchmarkRows, pt as normalizeAgentRxCategory, q as ANALYST_BENCHMARK_DEPENDENCY_LOCK_SHA256, r as renderAnalystBenchmarkMarkdown, rt as ANALYST_BENCHMARK_LOCAL_RECEIPT_FILE, s as runInlineAnalystDefinition, st as renderAgentRxCalibrationMarkdown, t as ANALYST_BENCHMARK_HELP, tt as analystBenchmarkImplementationDigest, u as preparePublicAnalystBenchmark, ut as codeTracerPredictionsToFindings, v as createPublicBenchmarkDirectRunner, w as analystDefinitionProtocolSha256, x as decodeReplyRows, y as publicDirectAnalystDefinition, z as publicBenchmarkRlmInstructions } from "../benchmark-command-
|
|
6
|
+
import { a as RunCritic, c as buildSkillUsageReport, d as defaultIsMaterial, f as diffFindings, h as defineTraceAnalyst, i as runSemanticConceptJudge, l as emitSkillUsageFindings, m as defineCustomAnalyst, n as SEMANTIC_CONCEPT_JUDGE_VERSION, o as SKILL_USAGE_ANALYST, s as SkillUsageAnalyst, u as FindingsStore } from "../semantic-concept-judge-D1z-KepS.js";
|
|
7
|
+
import { t as createDspyRlmTraceEngine } from "../dspy-rlm-engine-DbTk4JdR.js";
|
|
8
|
+
import { a as scoreAnalystFindings, i as summarizeAnalystBenchmarkRunner, n as runAnalystBenchmark, r as traceStoreEvidenceResolver, t as registryBenchmarkRunner } from "../benchmark-CWeqGl7x.js";
|
|
9
|
+
import { $ as ANALYST_BENCHMARK_IMPLEMENTATION_SHA256, A as summarizeCodeTraceCalibration, B as publicBenchmarkSystemPrompt, C as analystDefinitionAsymmetries, D as expandCodeTraceFailureBlocks, E as emptyPublicBenchmarkRunner, F as CODE_TRACE_BENCH_ANALYST_PROMPT, G as ANALYST_BENCHMARK_DEPENDENCY_LOCK_DIGEST_ALGORITHM, H as appendVerificationArtifactsToOtlp, I as MAX_INCORRECT_BLOCKS, J as ANALYST_BENCHMARK_EVIDENCE_DEPENDENCY_LOCK_SHA256, K as ANALYST_BENCHMARK_DEPENDENCY_LOCK_FILES, L as MAX_INCORRECT_BLOCK_STEPS, M as analystInstructionsOverrideFromText, N as effectiveAnalystProtocolSha256, O as readAnalystBenchmarkArtifact, P as readAnalystInstructionsOverride, Q as ANALYST_BENCHMARK_IMPLEMENTATION_FILES, R as publicBenchmarkProtocolSha256, S as AnalystExpressivenessError, T as adaptPublicBenchmarkFindings, U as loadCodeTraceVerificationArtifacts, V as DEFAULT_MAX_VERIFICATION_ARTIFACT_BYTES, W as parseVerificationOutcome, X as ANALYST_BENCHMARK_EVIDENCE_PACKAGE_VERSION, Y as ANALYST_BENCHMARK_EVIDENCE_IMPLEMENTATION_SHA256, Z as ANALYST_BENCHMARK_IMPLEMENTATION_DIGEST_ALGORITHM, _ as runReplVariableAnalystDefinition, a as primeAnalystProtocolSha256, at as ANALYST_BENCHMARK_OBSERVATIONS_FILE, b as runChunkedAnalystDefinition, c as nodeHttpPrimeBridgeTransport, ct as summarizeAgentRxCalibration, d as publicBenchmarkDistributions, dt as agentRxBenchmarkCase, et as analystBenchmarkDependencyLockDigest, f as publicBenchmarkSelectionReport, ft as agentRxPredictionsToFindings, g as rlmEngineLimits, h as publicRlmAnalystDefinition, ht as normalizeBenchmarkLabel, i as createPrimeBenchmarkRunner, it as ANALYST_BENCHMARK_MANIFEST_FILE, j as compareAnalystRunners, k as renderCodeTraceCalibrationMarkdown, l as loadPublicBenchmarkRows, lt as codeTraceBenchCase, m as createPublicBenchmarkRlmRunner, mt as roundAgentRxStep, n as runAnalystBenchmarkCommand, nt as ANALYST_BENCHMARK_COST_LEDGER_FILE, o as primeCodeTraceAnalystDefinition, ot as AGENT_RX_UPSTREAM_REVISION, p as selectPublicBenchmarkRows, pt as normalizeAgentRxCategory, q as ANALYST_BENCHMARK_DEPENDENCY_LOCK_SHA256, r as renderAnalystBenchmarkMarkdown, rt as ANALYST_BENCHMARK_LOCAL_RECEIPT_FILE, s as runInlineAnalystDefinition, st as renderAgentRxCalibrationMarkdown, t as ANALYST_BENCHMARK_HELP, tt as analystBenchmarkImplementationDigest, u as preparePublicAnalystBenchmark, ut as codeTracerPredictionsToFindings, v as createPublicBenchmarkDirectRunner, w as analystDefinitionProtocolSha256, x as decodeReplyRows, y as publicDirectAnalystDefinition, z as publicBenchmarkRlmInstructions } from "../benchmark-command-D3fEnKdf.js";
|
|
10
10
|
import { a as extractPrimeJsonObject, c as primeProtocolSha256, d as runPrimeExchange, i as emptyPrimeRawUsage, l as primeReplyDefect, n as buildPrimePrompt, o as mergePrimeRawUsage, r as buildPrimeRepairPrompt, s as normalizePrimeUsage, t as analystUsageReceiptFromPrimeUsage, u as projectPrimeTrajectory } from "../prime-protocol-BfSalTfR.js";
|
|
11
11
|
//#region src/analyst/adapters.ts
|
|
12
12
|
/**
|
|
@@ -1,7 +1,7 @@
|
|
|
1
1
|
import { r as observedSplitScore } from "./reward-nw2xZGZG.js";
|
|
2
2
|
import { D as pairedCohensDz, E as pairedBootstrap, L as pearsonR, P as pairedTTest, V as spearmanR, Z as continuousAgreement, k as pairedMde, z as requiredPairedSampleSize } from "./statistics-ByxzSiOM.js";
|
|
3
3
|
import { r as pairRunRecords } from "./paired-arms-iZ08VFMN.js";
|
|
4
|
-
import { s as validateRunRecord } from "./run-record-
|
|
4
|
+
import { s as validateRunRecord } from "./run-record-BmSPWXJR.js";
|
|
5
5
|
import { r as welchsTTest } from "./baseline-C-GocmIW.js";
|
|
6
6
|
import { o as llmSpans } from "./query-Di7eEQ79.js";
|
|
7
7
|
import { r as paretoChart } from "./summary-report-Lf-5I7xh.js";
|
|
@@ -1079,4 +1079,4 @@ function buildRecommendations(ctx) {
|
|
|
1079
1079
|
//#endregion
|
|
1080
1080
|
export { checkBehavioralCanary as a, canaryLeakView as i, summarizeExecution as n, checkCanaries as o, HoldoutAuditor as r, runBehavioralCanaries as s, analyzeRuns as t };
|
|
1081
1081
|
|
|
1082
|
-
//# sourceMappingURL=analyze-runs-
|
|
1082
|
+
//# sourceMappingURL=analyze-runs-C30yljDJ.js.map
|