@tangle-network/agent-eval 0.178.0 → 0.179.0
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/CHANGELOG.md +9 -0
- package/dist/adapters/http.d.ts +2 -2
- package/dist/{agent-profile-_xPxqVJt.d.ts → agent-profile-B7yErX0q.d.ts} +3 -3
- package/dist/{agent-profile-_xPxqVJt.d.ts.map → agent-profile-B7yErX0q.d.ts.map} +1 -1
- package/dist/analyst/index.d.ts +10 -10
- package/dist/analyst/index.js +5 -5
- package/dist/{benchmark-command-DIxGSUP3.js → benchmark-command-CY6Dg5t5.js} +6 -6
- package/dist/{benchmark-command-DIxGSUP3.js.map → benchmark-command-CY6Dg5t5.js.map} +1 -1
- package/dist/benchmarks/index.d.ts +3 -3
- package/dist/campaign/index.d.ts +5 -5
- package/dist/cli.js +1 -1
- package/dist/{client-vyYQg3bm.d.ts → client-CuQgX33c.d.ts} +2 -2
- package/dist/{client-vyYQg3bm.d.ts.map → client-CuQgX33c.d.ts.map} +1 -1
- package/dist/contract/index.d.ts +9 -9
- package/dist/contract/index.js +3 -3
- package/dist/{default-registry-DBqVI4pq.js → default-registry-BryMEmr8.js} +2 -2
- package/dist/{default-registry-DBqVI4pq.js.map → default-registry-BryMEmr8.js.map} +1 -1
- package/dist/{default-registry-FfNzaUHV.d.ts → default-registry-IGDE9XIC.d.ts} +6 -6
- package/dist/{default-registry-FfNzaUHV.d.ts.map → default-registry-IGDE9XIC.d.ts.map} +1 -1
- package/dist/{define-agent-eval-DMsxDp1u.d.ts → define-agent-eval-Cx4Ls9ta.d.ts} +6 -6
- package/dist/{define-agent-eval-DMsxDp1u.d.ts.map → define-agent-eval-Cx4Ls9ta.d.ts.map} +1 -1
- package/dist/{dspy-rlm-engine-DqjER2sV.js → dspy-rlm-engine-xKiWmj_G.js} +2 -2
- package/dist/{dspy-rlm-engine-DqjER2sV.js.map → dspy-rlm-engine-xKiWmj_G.js.map} +1 -1
- package/dist/{engine-CvW_I72-.d.ts → engine-CX8ReXkn.d.ts} +5 -5
- package/dist/{engine-CvW_I72-.d.ts.map → engine-CX8ReXkn.d.ts.map} +1 -1
- package/dist/{exact-types-BKOEILRP.d.ts → exact-types-B7LC1EyX.d.ts} +2 -2
- package/dist/{exact-types-BKOEILRP.d.ts.map → exact-types-B7LC1EyX.d.ts.map} +1 -1
- package/dist/experiment/index.d.ts +2 -2
- package/dist/{experiment-tracker-CNwqCZFD.d.ts → experiment-tracker-B3TiF5-u.d.ts} +2 -2
- package/dist/{experiment-tracker-CNwqCZFD.d.ts.map → experiment-tracker-B3TiF5-u.d.ts.map} +1 -1
- package/dist/{feedback-trajectory-CMnv_uYs.d.ts → feedback-trajectory-eHWNv5Aj.d.ts} +3 -3
- package/dist/{feedback-trajectory-CMnv_uYs.d.ts.map → feedback-trajectory-eHWNv5Aj.d.ts.map} +1 -1
- package/dist/hosted/index.d.ts +1 -1
- package/dist/{index-CZ2tAJW2.d.ts → index-BxWvILU8.d.ts} +6 -6
- package/dist/{index-CZ2tAJW2.d.ts.map → index-BxWvILU8.d.ts.map} +1 -1
- package/dist/{index-BAAiSF3_.d.ts → index-CbLmrWCa.d.ts} +6 -6
- package/dist/{index-BAAiSF3_.d.ts.map → index-CbLmrWCa.d.ts.map} +1 -1
- package/dist/{index-nrWQbUgi.d.ts → index-DxNYmx4a.d.ts} +9 -9
- package/dist/{index-nrWQbUgi.d.ts.map → index-DxNYmx4a.d.ts.map} +1 -1
- package/dist/index.d.ts +15 -15
- package/dist/index.js +6 -6
- package/dist/{kind-factory-BLvL-E44.js → kind-factory-D5HOW3R0.js} +119 -15
- package/dist/kind-factory-D5HOW3R0.js.map +1 -0
- package/dist/{matrix-CJtXz1ky.d.ts → matrix-DeMmnWrP.d.ts} +2 -2
- package/dist/{matrix-CJtXz1ky.d.ts.map → matrix-DeMmnWrP.d.ts.map} +1 -1
- package/dist/multishot/golden/index.d.ts +1 -1
- package/dist/multishot/index.d.ts +2 -2
- package/dist/openapi.json +1 -1
- package/dist/{registry-7pOUBrtX.d.ts → registry-ByVld1-5.d.ts} +3 -3
- package/dist/{registry-7pOUBrtX.d.ts.map → registry-ByVld1-5.d.ts.map} +1 -1
- package/dist/rl.d.ts +1 -1
- package/dist/{semantic-concept-judge-Dw-f7TEs.js → semantic-concept-judge-Bi6_iGqg.js} +3 -3
- package/dist/{semantic-concept-judge-Dw-f7TEs.js.map → semantic-concept-judge-Bi6_iGqg.js.map} +1 -1
- package/dist/{statistical-heldout-Z9NROFFS.d.ts → statistical-heldout-0La5ZTlv.d.ts} +2 -2
- package/dist/{statistical-heldout-Z9NROFFS.d.ts.map → statistical-heldout-0La5ZTlv.d.ts.map} +1 -1
- package/dist/{store-otlp-DV_H2HDu.js → store-otlp-DWGUwlyj.js} +7 -2
- package/dist/store-otlp-DWGUwlyj.js.map +1 -0
- package/dist/{store-tool-spans-4o55ABER.d.ts → store-tool-spans-4J1EDElP.d.ts} +7 -4
- package/dist/{store-tool-spans-4o55ABER.d.ts.map → store-tool-spans-4J1EDElP.d.ts.map} +1 -1
- package/dist/{store-tool-spans-B9tjys_h.js → store-tool-spans-ceJoiUgS.js} +3 -3
- package/dist/{store-tool-spans-B9tjys_h.js.map → store-tool-spans-ceJoiUgS.js.map} +1 -1
- package/dist/{task-failure-attributes-CUy9mkIY.js → task-failure-attributes-B072KO_n.js} +2 -2
- package/dist/{task-failure-attributes-CUy9mkIY.js.map → task-failure-attributes-B072KO_n.js.map} +1 -1
- package/dist/{tool-groups-DAe1t6zb.d.ts → tool-groups-2QA0S7dK.d.ts} +4 -4
- package/dist/tool-groups-2QA0S7dK.d.ts.map +1 -0
- package/dist/trace-repair/index.d.ts +1 -1
- package/dist/traces.d.ts +4 -4
- package/dist/traces.js +4 -4
- package/dist/{types-Dd1ejaeI.d.ts → types-BmlkCrg0.d.ts} +2 -2
- package/dist/{types-Dd1ejaeI.d.ts.map → types-BmlkCrg0.d.ts.map} +1 -1
- package/dist/{types-BJz2CPTM.d.ts → types-C34V4Vto.d.ts} +2 -2
- package/dist/{types-BJz2CPTM.d.ts.map → types-C34V4Vto.d.ts.map} +1 -1
- package/dist/{types-DN2WdT5S.d.ts → types-DzuaM493.d.ts} +40 -2
- package/dist/types-DzuaM493.d.ts.map +1 -0
- package/dist/wire/index.d.ts +1 -1
- package/docs/trace-analysis.md +45 -0
- package/package.json +1 -1
- package/dist/kind-factory-BLvL-E44.js.map +0 -1
- package/dist/store-otlp-DV_H2HDu.js.map +0 -1
- package/dist/tool-groups-DAe1t6zb.d.ts.map +0 -1
- package/dist/types-DN2WdT5S.d.ts.map +0 -1
|
@@ -1,7 +1,7 @@
|
|
|
1
1
|
import { s as RunSplitTag } from "../run-record-DTv1MdjK.js";
|
|
2
|
-
import { a as CampaignResult } from "../types-
|
|
3
|
-
import { wo as CampaignStorage } from "../index-
|
|
4
|
-
import { a as BenchmarkFamily, c as BenchmarkSource, i as BenchmarkEvaluation, l as BenchmarkTaskKind, n as BenchmarkAdapter, o as BenchmarkResponder, r as BenchmarkDatasetItem, s as BenchmarkScenario, t as BENCHMARK_SPLIT_SEED, u as deterministicSplit } from "../types-
|
|
2
|
+
import { a as CampaignResult } from "../types-C34V4Vto.js";
|
|
3
|
+
import { wo as CampaignStorage } from "../index-BxWvILU8.js";
|
|
4
|
+
import { a as BenchmarkFamily, c as BenchmarkSource, i as BenchmarkEvaluation, l as BenchmarkTaskKind, n as BenchmarkAdapter, o as BenchmarkResponder, r as BenchmarkDatasetItem, s as BenchmarkScenario, t as BENCHMARK_SPLIT_SEED, u as deterministicSplit } from "../types-BmlkCrg0.js";
|
|
5
5
|
//#region src/benchmarks/calibration.d.ts
|
|
6
6
|
interface BenchmarkMetricCalibrationOptions<TPayload = unknown, TArtifact = string> {
|
|
7
7
|
adapter: BenchmarkAdapter<BenchmarkDatasetItem<TPayload>, TPayload, TArtifact>;
|
package/dist/campaign/index.d.ts
CHANGED
|
@@ -1,8 +1,8 @@
|
|
|
1
1
|
import { c as CostLedgerHandle, w as PendingCostCallView } from "../cost-ledger-DbQdN3nO.js";
|
|
2
|
-
import { _ as ProposalFinding, v as ProposalFindingOrigin, x as makeProposalFinding } from "../types-
|
|
2
|
+
import { _ as ProposalFinding, v as ProposalFindingOrigin, x as makeProposalFinding } from "../types-DzuaM493.js";
|
|
3
3
|
import { t as SeriesDistribution } from "../descriptive-B2iPaT9J.js";
|
|
4
|
-
import { $ as paretoSignificanceGate, B as PowerPreflight, G as BuildEvidenceVectorOptions, H as powerPreflight, J as ParetoSignificanceGateOptions, K as EvidenceVector, Q as paretoPolicy, U as AxisEvidence, V as PowerPreflightOptions, W as AxisVerdict, X as PromotionPolicy, Y as PromotionObjective, Z as buildEvidenceVector, _ as sequentialPairedGate, a as detectScale, c as pairHoldout, d as SequentialDecision, f as SequentialObservation, g as sequentialDecide, h as SequentialStreamState, i as PairedHoldout, l as SequentialDecideFn, m as SequentialPairedGateOptions, n as HeldoutSignificance, o as dimensionRegressions, p as SequentialPairedGate, q as ObjectiveSource, r as HeldoutSignificanceOptions, s as heldoutSignificance, t as DimensionRegression, u as SequentialDecideOptions } from "../statistical-heldout-
|
|
5
|
-
import { A as LabeledScenarioWrite, B as ScoredSurfaceOutcome, C as JudgeDimension, D as LabeledScenarioSampleArgs, E as LabeledScenarioRecord, F as ProposeContext, G as labelTrustRank, H as SurfaceProposer, I as ProposedCandidate, L as RedactionStatus, M as OptimizerConfig, N as ParetoParent, O as LabeledScenarioSource, P as ProposalTrackContext, R as Scenario, S as JudgeConfig, T as LabelTrust, U as TraceSpan, V as SessionScript, W as isProposedCandidate, _ as GateDecision, a as CampaignResult, b as GenerationRecord, c as CampaignTraceWriter, d as DispatchContext, f as DispatchFn, g as GateContribution, h as GateContext, i as CampaignCostMeter, j as MutableSurface, k as LabeledScenarioStore, l as CodeSurface, m as GateCheckStatus, n as CampaignArtifactWriter, o as CampaignScenarioIdentity, p as Gate, r as CampaignCellResult, s as CampaignTokenUsage, t as CampaignAggregates, u as ComponentSurface, v as GateResult, w as JudgeScore, x as JudgeAggregate, y as GenerationCandidate, z as ScenarioAggregate } from "../types-
|
|
6
|
-
import { $ as UserStoryVerdict, $a as SearchLedgerError, $i as CreateSearchHistoryReceiptInput, $n as LoopProvenanceRecord, $r as OptimizationMethodComposition, $t as EvalFixtureValidationMode, A as ScenarioSignal, Aa as SearchLedgerEvent, Ai as isTransientTransportFailure, An as CrossSurfaceNaiveStackSelection, Ao as campaignScenarioIdentity, Ar as SkillOptOptimizationMethodConfig, B as ProfileMatrixRow, Ba as SearchPlannedOperation, Bi as MeasuredSearchCandidate, Bn as BuildTraceAnalystSurfaceDispatchOptions, Br as gepaOptimizationMethod, Bt as RolloutArgumentDiffOptions, C as SingleRunLockOptions, Ca as SearchCandidateSurface, Ci as ReferenceEquivalenceScenario, Cn as CrossSurfaceEvidenceBreakdown, Co as cellCachePath, D as campaignMeanComposite, Da as SearchLedger, Di as LlmJudgeOptions, Dn as CrossSurfaceInteractionPath, Do as inMemoryCampaignStorage, E as campaignBreakdown, Ea as SearchFailureReason, Ei as LlmJudgeDimension, En as CrossSurfaceInteractionEffect, Eo as fsCampaignStorage, F as CreateProfileMatrixPlanOptions, Fa as SearchOperationKind, Fi as runImprovementLoop, Fn as CrossSurfaceRankedSingle, Fr as GepaEngineOptions, Ft as neutralizeText, G as runProfileMatrixSegment, Ga as SearchSurfaceKind, Gi as SearchRecorderOptions, Gn as BuildLoopProvenanceArgs, Gr as ExternalTextOptimizerContext, Gt as rolloutArgumentDiff, H as RunProfileMatrixSegmentOptions, Ha as SearchSourceRef, Hi as SearchExecutionIdentity, Hn as TraceAnalystScenario, Hr as OptimizerModelBudget, Ht as ScoredRollout, I as FinalizeProfileMatrixOptions, Ia as SearchOperationRecordedEvent, Ii as PremeasuredOptimizationBaseline, In as CrossSurfaceRelativeCost, Ir as GepaEngineRun, It as FsLabeledScenarioStore, J as PlaybackStep, Ja as SearchTokenAccounting, Ji as GepaCandidatePopulationArtifact, Jn as LoopProvenanceArgsFromResult, Jr as ExternalTextEvaluationResponse, Jt as EvalFixture, K as PlaybackContext, Ka as SearchTaskAttemptedEvent, Ki as SearchRunIdentity, Kn as EmitLoopProvenanceArgs, Kr as ExternalTextOptimizerResult, Kt as NeutralizationGateOptions, L as FinalizedProfileMatrixResult, La as SearchPlan, Li as RunOptimizationOptions, Ln as CrossSurfaceSelectionPolicy, Lr as GepaOptimizationMethodConfig, Lt as FsLabeledScenarioStoreOptions, M as selectDiscriminative, Ma as SearchLedgerReplay, Mi as transientDispatchFailure, Mn as CrossSurfacePairEvidence, Mo as campaignSplitDigestFromIdentities, Mr as SkillOptTrainerConfig, N as resolveRunDir, Na as SearchLedgerTrustedHeadMode, Ni as RunImprovementLoopOptions, Nn as CrossSurfacePairIncompatibilityReason, Nr as skillOptOptimizationMethod, Nt as scopedOptimizationMethod, O as compareRankKeys, Oa as SearchLedgerAppendResult, Oi as llmJudge, On as CrossSurfaceInteractionReport, Oo as assertCampaignDesign, P as tangleTracesRoot, Pa as SearchModelIdentity, Pi as RunImprovementLoopResult, Pn as CrossSurfacePairwiseEntry, Pr as GepaAdaptiveEngineRun, Pt as sequentialOptimizationMethod, Q as UserStory, Qa as SearchLedgerConflictError, Qi as readGepaCandidatePopulationArtifact, Qn as LoopProvenanceOptimizationMethod, Qr as OptimizationMethodComparison, Qt as EvalFixtureScenario, R as ProfileMatrixCoverage, Ra as SearchPlanExtendedEvent, Ri as RunOptimizationResult, Rn as CrossSurfaceSelections, Rr as GepaOptimizationRecipe, Rt as LabeledScenarioStoreError, S as SingleRunLock, Sa as SearchCandidateSlotClosedEvent, Sn as CrossSurfaceEligibility, So as buildCellSchedule, T as CampaignBreakdown, Ta as SearchCostAccounting, Tn as CrossSurfaceInteractionAwareSelection, To as createRunCostLedger, U as createProfileMatrixPlan, Ua as SearchSurfaceEffect, Ui as SearchLedgerBinding, Un as buildTraceAnalystSurfaceDispatch, Ur as externalTextOptimizationMethod, Ut as UngroundedLiteralReport, V as ProfileMatrixSegmentResult, Va as SearchPlannedTask, Vi as ProposedSearchCandidate, Vn as TraceAnalystArtifact, Vr as OpenAICompatibleOptimizerModel, Vt as RolloutCall, W as finalizeProfileMatrix, Wa as SearchSurfaceEvidence, Wi as SearchRecorder, Wn as traceAnalystQualityJudge, Wr as ExternalTextOptimizationMethodConfig, Wt as classifyUngroundedLiterals, X as ScoreboardRow, Xa as replaySearchLedgerText, Xi as GepaCandidatePopulationSummary, Xn as LoopProvenanceCandidate, Xr as CompareOptimizationMethodsOptions, Xt as EvalFixtureLoadOptions, Y as ScoreboardRenderOptions, Ya as openSearchLedger, Yi as GepaCandidatePopulationCandidate, Yn as LoopProvenanceBackend, Yr as decodeExternalTextCandidate, Yt as EvalFixtureFile, Z as ScoreboardSummary, Za as validateSearchLedgerEvent, Zi as GepaCandidateSelectionScore, Zn as LoopProvenanceEvidence, Zr as OptimizationMethod, Zt as EvalFixtureRunPlan, _ as componentSurfaceIdentityMaterial, _a as SearchAttemptAccounting, _i as readExternalOptimizerObservationArtifact, _n as CrossSurfaceCandidateSummary, _o as planCampaignRun, a as WorktreeAdapterError, aa as SearchHistoryReceipt, ai as OptimizationMethodScore, an as planEvalFixtureRun, ao as OpenAutoPrOptions, ar as loopProvenanceSpans, at as ProfileDispatchFn, b as surfaceDispatchRef, ba as SearchCandidateRegisteredEvent, bn as CrossSurfaceCompositionStep, bo as readCachedCell, c as verifyCodeSurface, ca as assertSearchHistoryMatchesReplay, ci as compareOptimizationMethods, cn as CrossSurfaceAdditionDecision, co as RunEvalOptions, cr as verifyLoopProvenanceRecord, ct as RunProfileMatrixOptions, d as PhoenixEvaluationResultLike, da as verifySearchHistoryArtifact, di as combineComparisonCosts, dn as CrossSurfaceBestSingleSelection, do as CampaignCellRetryPolicy, dr as DefaultProductionGateCheck, dt as runProfileMatrix, ea as SearchHistoryAdmissionOptions, ei as OptimizationMethodInput, en as LoadEvalFixtureScenariosOptions, eo as SearchLedgerIntegrityError, er as buildLoopProvenanceRecord, et as makePlaybackDispatch, f as PhoenixEvaluatorLike, fa as verifySearchHistoryReceipt, fi as costFromLedgerSummary, fn as CrossSurfaceBootstrapPolicy, fo as RunCampaignOptions, fr as DefaultProductionGateOptions, g as codeSurfaceIdentityMaterial, ga as SearchArtifactRef, gi as ExternalOptimizerSubmittedCandidate, gn as CrossSurfaceCandidateOutcome, go as PlanCampaignRunOptions, h as assertCodeSurfaceIdentity, ha as SearchAccountingAudit, hi as ExternalOptimizerObservationSummary, hn as CrossSurfaceCandidateEvidence, ho as CampaignRunPlanCell, i as WorktreeAdapter, ia as SearchHistoryPolicy, ii as OptimizationMethodRunOptions, in as loadEvalFixtureScenarios, io as crowdedFrontierParent, ir as loopProvenanceArgsFromResult, it as userStoryScoreboard, j as scoreDiscrimination, ja as SearchLedgerHash, ji as quotaExhaustedUntil, jn as CrossSurfacePairCompatibility, jo as campaignSplitDigest, jr as SkillOptRunnerCommand, k as DiscriminationScore, ka as SearchLedgerEntry, ki as TransientFailureOptions, kn as CrossSurfaceInteractionTask, ko as assertCampaignSplitIdentity, kr as composeGate, l as AutoevalsScoreLike, la as createSearchHistoryReceipt, li as optimizationTokenUsageFromSummary, ln as CrossSurfaceAdditionRejectionReason, lo as runEval, lr as HeldOutGateOptions, lt as RunProfileMatrixResult, m as phoenixEvaluatorJudge, ma as OpenSearchLedgerOptions, mi as ExternalOptimizerObservationArtifact, mn as CrossSurfaceCandidateComparison, mo as CampaignRunPlan, mr as defaultProductionGate, n as GitWorktreeAdapterOptions, na as SearchHistoryCoverage, ni as OptimizationMethodProvenance, nn as discoverEvalFixtures, no as ParentSelectionContext, nr as canonicalDigest, nt as scoreUserStory, o as gitWorktreeAdapter, oa as SearchHistoryRequiredError, oi as OptimizationPackageSource, on as analyzeCrossSurfaceInteractions, oo as OpenAutoPrResult, or as provenanceRecordPath, ot as ProfileMatrixError, p as autoevalsScorerJudge, pa as FileSearchLedger, pi as ExternalOptimizerExecutionSummary, pn as CrossSurfaceCandidate, po as runCampaign, pr as DefaultProductionRewardHackingOptions, q as PlaybackDriver, qa as SearchTaskOutcome, qi as recordCandidatePopulationSearch, qn as EmitLoopProvenanceResult, qr as ExternalOptimizationExample, qt as neutralizationGate, r as Worktree, ra as SearchHistoryCoverageRow, ri as OptimizationMethodResult, rn as loadEvalFixture, ro as ParentSelector, rr as emitLoopProvenance, rt as scoreboardSummary, s as resolveWorktreePath, sa as assertCompleteSearchHistory, si as OptimizationTokenUsage, sn as AnalyzeCrossSurfaceInteractionsInput, so as openAutoPr, sr as provenanceSpansPath, st as ProfileSummary, t as CodeSurfaceVerification, ta as SearchHistoryAuditSummary, ti as OptimizationMethodPairwise, tn as PlanEvalFixtureRunOptions, to as CrowdedFrontierParentOptions, tr as campaignMeasurementDigest, tt as renderScoreboardMarkdown, u as AutoevalsScorerLike, ua as searchHistoryCoverageRow, ui as ComparisonCost, un as CrossSurfaceAttemptCompleteness, uo as CampaignCellFailureReceipt, ur as heldOutGate, ut as ScenarioRollup, v as renderSurfaceDiff, va as SearchCandidateDecidedEvent, vn as CrossSurfaceComponent, vo as CacheIssueReason, w as acquireSingleRunLock, wa as SearchCompletedEvent, wi as createReferenceEquivalenceJudge, wn as CrossSurfaceIneligibilityReason, wo as CampaignStorage, x as surfaceHash, xa as SearchCandidateSlot, xi as ReferenceEquivalenceJudgeOptions, xn as CrossSurfaceDistribution, xo as CellScheduleSlot, y as surfaceContentHash, ya as SearchCandidateLineage, yn as CrossSurfaceComponentEvidence, yo as CacheRead, z as ProfileMatrixPlan, za as SearchPlannedEvent, zi as runOptimization, zn as CrossSurfaceTaskRow, zr as GepaRunnerCommand, zt as RolloutArgumentDiff } from "../index-
|
|
7
|
-
import { B as ExternalOptimizerModelBudget, F as ExternalOptimizerCallbackLimits, G as ExternalOptimizerProcessLimits, H as ExternalOptimizerModelCallRequest, I as ExternalOptimizerChatRequest, L as ExternalOptimizerEndpointFormat, N as DEFAULT_EXTERNAL_OPTIMIZER_CALLBACK_LIMITS, P as DEFAULT_EXTERNAL_OPTIMIZER_PROCESS_LIMITS, Q as resolveExternalOptimizerProcessLimits, R as ExternalOptimizerEvaluationObservation, U as ExternalOptimizerModelCallResult, V as ExternalOptimizerModelCall, W as ExternalOptimizerModelExecutionObservation, Y as ExternalTextCandidate, Z as resolveExternalOptimizerCallbackLimits, q as ExternalOptimizerRunnerCommand, z as ExternalOptimizerEvaluationRefusalReason } from "../agent-profile-
|
|
4
|
+
import { $ as paretoSignificanceGate, B as PowerPreflight, G as BuildEvidenceVectorOptions, H as powerPreflight, J as ParetoSignificanceGateOptions, K as EvidenceVector, Q as paretoPolicy, U as AxisEvidence, V as PowerPreflightOptions, W as AxisVerdict, X as PromotionPolicy, Y as PromotionObjective, Z as buildEvidenceVector, _ as sequentialPairedGate, a as detectScale, c as pairHoldout, d as SequentialDecision, f as SequentialObservation, g as sequentialDecide, h as SequentialStreamState, i as PairedHoldout, l as SequentialDecideFn, m as SequentialPairedGateOptions, n as HeldoutSignificance, o as dimensionRegressions, p as SequentialPairedGate, q as ObjectiveSource, r as HeldoutSignificanceOptions, s as heldoutSignificance, t as DimensionRegression, u as SequentialDecideOptions } from "../statistical-heldout-0La5ZTlv.js";
|
|
5
|
+
import { A as LabeledScenarioWrite, B as ScoredSurfaceOutcome, C as JudgeDimension, D as LabeledScenarioSampleArgs, E as LabeledScenarioRecord, F as ProposeContext, G as labelTrustRank, H as SurfaceProposer, I as ProposedCandidate, L as RedactionStatus, M as OptimizerConfig, N as ParetoParent, O as LabeledScenarioSource, P as ProposalTrackContext, R as Scenario, S as JudgeConfig, T as LabelTrust, U as TraceSpan, V as SessionScript, W as isProposedCandidate, _ as GateDecision, a as CampaignResult, b as GenerationRecord, c as CampaignTraceWriter, d as DispatchContext, f as DispatchFn, g as GateContribution, h as GateContext, i as CampaignCostMeter, j as MutableSurface, k as LabeledScenarioStore, l as CodeSurface, m as GateCheckStatus, n as CampaignArtifactWriter, o as CampaignScenarioIdentity, p as Gate, r as CampaignCellResult, s as CampaignTokenUsage, t as CampaignAggregates, u as ComponentSurface, v as GateResult, w as JudgeScore, x as JudgeAggregate, y as GenerationCandidate, z as ScenarioAggregate } from "../types-C34V4Vto.js";
|
|
6
|
+
import { $ as UserStoryVerdict, $a as SearchLedgerError, $i as CreateSearchHistoryReceiptInput, $n as LoopProvenanceRecord, $r as OptimizationMethodComposition, $t as EvalFixtureValidationMode, A as ScenarioSignal, Aa as SearchLedgerEvent, Ai as isTransientTransportFailure, An as CrossSurfaceNaiveStackSelection, Ao as campaignScenarioIdentity, Ar as SkillOptOptimizationMethodConfig, B as ProfileMatrixRow, Ba as SearchPlannedOperation, Bi as MeasuredSearchCandidate, Bn as BuildTraceAnalystSurfaceDispatchOptions, Br as gepaOptimizationMethod, Bt as RolloutArgumentDiffOptions, C as SingleRunLockOptions, Ca as SearchCandidateSurface, Ci as ReferenceEquivalenceScenario, Cn as CrossSurfaceEvidenceBreakdown, Co as cellCachePath, D as campaignMeanComposite, Da as SearchLedger, Di as LlmJudgeOptions, Dn as CrossSurfaceInteractionPath, Do as inMemoryCampaignStorage, E as campaignBreakdown, Ea as SearchFailureReason, Ei as LlmJudgeDimension, En as CrossSurfaceInteractionEffect, Eo as fsCampaignStorage, F as CreateProfileMatrixPlanOptions, Fa as SearchOperationKind, Fi as runImprovementLoop, Fn as CrossSurfaceRankedSingle, Fr as GepaEngineOptions, Ft as neutralizeText, G as runProfileMatrixSegment, Ga as SearchSurfaceKind, Gi as SearchRecorderOptions, Gn as BuildLoopProvenanceArgs, Gr as ExternalTextOptimizerContext, Gt as rolloutArgumentDiff, H as RunProfileMatrixSegmentOptions, Ha as SearchSourceRef, Hi as SearchExecutionIdentity, Hn as TraceAnalystScenario, Hr as OptimizerModelBudget, Ht as ScoredRollout, I as FinalizeProfileMatrixOptions, Ia as SearchOperationRecordedEvent, Ii as PremeasuredOptimizationBaseline, In as CrossSurfaceRelativeCost, Ir as GepaEngineRun, It as FsLabeledScenarioStore, J as PlaybackStep, Ja as SearchTokenAccounting, Ji as GepaCandidatePopulationArtifact, Jn as LoopProvenanceArgsFromResult, Jr as ExternalTextEvaluationResponse, Jt as EvalFixture, K as PlaybackContext, Ka as SearchTaskAttemptedEvent, Ki as SearchRunIdentity, Kn as EmitLoopProvenanceArgs, Kr as ExternalTextOptimizerResult, Kt as NeutralizationGateOptions, L as FinalizedProfileMatrixResult, La as SearchPlan, Li as RunOptimizationOptions, Ln as CrossSurfaceSelectionPolicy, Lr as GepaOptimizationMethodConfig, Lt as FsLabeledScenarioStoreOptions, M as selectDiscriminative, Ma as SearchLedgerReplay, Mi as transientDispatchFailure, Mn as CrossSurfacePairEvidence, Mo as campaignSplitDigestFromIdentities, Mr as SkillOptTrainerConfig, N as resolveRunDir, Na as SearchLedgerTrustedHeadMode, Ni as RunImprovementLoopOptions, Nn as CrossSurfacePairIncompatibilityReason, Nr as skillOptOptimizationMethod, Nt as scopedOptimizationMethod, O as compareRankKeys, Oa as SearchLedgerAppendResult, Oi as llmJudge, On as CrossSurfaceInteractionReport, Oo as assertCampaignDesign, P as tangleTracesRoot, Pa as SearchModelIdentity, Pi as RunImprovementLoopResult, Pn as CrossSurfacePairwiseEntry, Pr as GepaAdaptiveEngineRun, Pt as sequentialOptimizationMethod, Q as UserStory, Qa as SearchLedgerConflictError, Qi as readGepaCandidatePopulationArtifact, Qn as LoopProvenanceOptimizationMethod, Qr as OptimizationMethodComparison, Qt as EvalFixtureScenario, R as ProfileMatrixCoverage, Ra as SearchPlanExtendedEvent, Ri as RunOptimizationResult, Rn as CrossSurfaceSelections, Rr as GepaOptimizationRecipe, Rt as LabeledScenarioStoreError, S as SingleRunLock, Sa as SearchCandidateSlotClosedEvent, Sn as CrossSurfaceEligibility, So as buildCellSchedule, T as CampaignBreakdown, Ta as SearchCostAccounting, Tn as CrossSurfaceInteractionAwareSelection, To as createRunCostLedger, U as createProfileMatrixPlan, Ua as SearchSurfaceEffect, Ui as SearchLedgerBinding, Un as buildTraceAnalystSurfaceDispatch, Ur as externalTextOptimizationMethod, Ut as UngroundedLiteralReport, V as ProfileMatrixSegmentResult, Va as SearchPlannedTask, Vi as ProposedSearchCandidate, Vn as TraceAnalystArtifact, Vr as OpenAICompatibleOptimizerModel, Vt as RolloutCall, W as finalizeProfileMatrix, Wa as SearchSurfaceEvidence, Wi as SearchRecorder, Wn as traceAnalystQualityJudge, Wr as ExternalTextOptimizationMethodConfig, Wt as classifyUngroundedLiterals, X as ScoreboardRow, Xa as replaySearchLedgerText, Xi as GepaCandidatePopulationSummary, Xn as LoopProvenanceCandidate, Xr as CompareOptimizationMethodsOptions, Xt as EvalFixtureLoadOptions, Y as ScoreboardRenderOptions, Ya as openSearchLedger, Yi as GepaCandidatePopulationCandidate, Yn as LoopProvenanceBackend, Yr as decodeExternalTextCandidate, Yt as EvalFixtureFile, Z as ScoreboardSummary, Za as validateSearchLedgerEvent, Zi as GepaCandidateSelectionScore, Zn as LoopProvenanceEvidence, Zr as OptimizationMethod, Zt as EvalFixtureRunPlan, _ as componentSurfaceIdentityMaterial, _a as SearchAttemptAccounting, _i as readExternalOptimizerObservationArtifact, _n as CrossSurfaceCandidateSummary, _o as planCampaignRun, a as WorktreeAdapterError, aa as SearchHistoryReceipt, ai as OptimizationMethodScore, an as planEvalFixtureRun, ao as OpenAutoPrOptions, ar as loopProvenanceSpans, at as ProfileDispatchFn, b as surfaceDispatchRef, ba as SearchCandidateRegisteredEvent, bn as CrossSurfaceCompositionStep, bo as readCachedCell, c as verifyCodeSurface, ca as assertSearchHistoryMatchesReplay, ci as compareOptimizationMethods, cn as CrossSurfaceAdditionDecision, co as RunEvalOptions, cr as verifyLoopProvenanceRecord, ct as RunProfileMatrixOptions, d as PhoenixEvaluationResultLike, da as verifySearchHistoryArtifact, di as combineComparisonCosts, dn as CrossSurfaceBestSingleSelection, do as CampaignCellRetryPolicy, dr as DefaultProductionGateCheck, dt as runProfileMatrix, ea as SearchHistoryAdmissionOptions, ei as OptimizationMethodInput, en as LoadEvalFixtureScenariosOptions, eo as SearchLedgerIntegrityError, er as buildLoopProvenanceRecord, et as makePlaybackDispatch, f as PhoenixEvaluatorLike, fa as verifySearchHistoryReceipt, fi as costFromLedgerSummary, fn as CrossSurfaceBootstrapPolicy, fo as RunCampaignOptions, fr as DefaultProductionGateOptions, g as codeSurfaceIdentityMaterial, ga as SearchArtifactRef, gi as ExternalOptimizerSubmittedCandidate, gn as CrossSurfaceCandidateOutcome, go as PlanCampaignRunOptions, h as assertCodeSurfaceIdentity, ha as SearchAccountingAudit, hi as ExternalOptimizerObservationSummary, hn as CrossSurfaceCandidateEvidence, ho as CampaignRunPlanCell, i as WorktreeAdapter, ia as SearchHistoryPolicy, ii as OptimizationMethodRunOptions, in as loadEvalFixtureScenarios, io as crowdedFrontierParent, ir as loopProvenanceArgsFromResult, it as userStoryScoreboard, j as scoreDiscrimination, ja as SearchLedgerHash, ji as quotaExhaustedUntil, jn as CrossSurfacePairCompatibility, jo as campaignSplitDigest, jr as SkillOptRunnerCommand, k as DiscriminationScore, ka as SearchLedgerEntry, ki as TransientFailureOptions, kn as CrossSurfaceInteractionTask, ko as assertCampaignSplitIdentity, kr as composeGate, l as AutoevalsScoreLike, la as createSearchHistoryReceipt, li as optimizationTokenUsageFromSummary, ln as CrossSurfaceAdditionRejectionReason, lo as runEval, lr as HeldOutGateOptions, lt as RunProfileMatrixResult, m as phoenixEvaluatorJudge, ma as OpenSearchLedgerOptions, mi as ExternalOptimizerObservationArtifact, mn as CrossSurfaceCandidateComparison, mo as CampaignRunPlan, mr as defaultProductionGate, n as GitWorktreeAdapterOptions, na as SearchHistoryCoverage, ni as OptimizationMethodProvenance, nn as discoverEvalFixtures, no as ParentSelectionContext, nr as canonicalDigest, nt as scoreUserStory, o as gitWorktreeAdapter, oa as SearchHistoryRequiredError, oi as OptimizationPackageSource, on as analyzeCrossSurfaceInteractions, oo as OpenAutoPrResult, or as provenanceRecordPath, ot as ProfileMatrixError, p as autoevalsScorerJudge, pa as FileSearchLedger, pi as ExternalOptimizerExecutionSummary, pn as CrossSurfaceCandidate, po as runCampaign, pr as DefaultProductionRewardHackingOptions, q as PlaybackDriver, qa as SearchTaskOutcome, qi as recordCandidatePopulationSearch, qn as EmitLoopProvenanceResult, qr as ExternalOptimizationExample, qt as neutralizationGate, r as Worktree, ra as SearchHistoryCoverageRow, ri as OptimizationMethodResult, rn as loadEvalFixture, ro as ParentSelector, rr as emitLoopProvenance, rt as scoreboardSummary, s as resolveWorktreePath, sa as assertCompleteSearchHistory, si as OptimizationTokenUsage, sn as AnalyzeCrossSurfaceInteractionsInput, so as openAutoPr, sr as provenanceSpansPath, st as ProfileSummary, t as CodeSurfaceVerification, ta as SearchHistoryAuditSummary, ti as OptimizationMethodPairwise, tn as PlanEvalFixtureRunOptions, to as CrowdedFrontierParentOptions, tr as campaignMeasurementDigest, tt as renderScoreboardMarkdown, u as AutoevalsScorerLike, ua as searchHistoryCoverageRow, ui as ComparisonCost, un as CrossSurfaceAttemptCompleteness, uo as CampaignCellFailureReceipt, ur as heldOutGate, ut as ScenarioRollup, v as renderSurfaceDiff, va as SearchCandidateDecidedEvent, vn as CrossSurfaceComponent, vo as CacheIssueReason, w as acquireSingleRunLock, wa as SearchCompletedEvent, wi as createReferenceEquivalenceJudge, wn as CrossSurfaceIneligibilityReason, wo as CampaignStorage, x as surfaceHash, xa as SearchCandidateSlot, xi as ReferenceEquivalenceJudgeOptions, xn as CrossSurfaceDistribution, xo as CellScheduleSlot, y as surfaceContentHash, ya as SearchCandidateLineage, yn as CrossSurfaceComponentEvidence, yo as CacheRead, z as ProfileMatrixPlan, za as SearchPlannedEvent, zi as runOptimization, zn as CrossSurfaceTaskRow, zr as GepaRunnerCommand, zt as RolloutArgumentDiff } from "../index-BxWvILU8.js";
|
|
7
|
+
import { B as ExternalOptimizerModelBudget, F as ExternalOptimizerCallbackLimits, G as ExternalOptimizerProcessLimits, H as ExternalOptimizerModelCallRequest, I as ExternalOptimizerChatRequest, L as ExternalOptimizerEndpointFormat, N as DEFAULT_EXTERNAL_OPTIMIZER_CALLBACK_LIMITS, P as DEFAULT_EXTERNAL_OPTIMIZER_PROCESS_LIMITS, Q as resolveExternalOptimizerProcessLimits, R as ExternalOptimizerEvaluationObservation, U as ExternalOptimizerModelCallResult, V as ExternalOptimizerModelCall, W as ExternalOptimizerModelExecutionObservation, Y as ExternalTextCandidate, Z as resolveExternalOptimizerCallbackLimits, q as ExternalOptimizerRunnerCommand, z as ExternalOptimizerEvaluationRefusalReason } from "../agent-profile-B7yErX0q.js";
|
|
8
8
|
export { type AnalyzeCrossSurfaceInteractionsInput, type AutoevalsScoreLike, type AutoevalsScorerLike, type AxisEvidence, type AxisVerdict, type BuildEvidenceVectorOptions, type BuildLoopProvenanceArgs, type BuildTraceAnalystSurfaceDispatchOptions, type CacheIssueReason, type CacheRead, type CampaignAggregates, type CampaignArtifactWriter, type CampaignBreakdown, type CampaignCellFailureReceipt, type CampaignCellResult, type CampaignCellRetryPolicy, type CampaignCostMeter, type CampaignResult, type CampaignRunPlan, type CampaignRunPlanCell, type CampaignScenarioIdentity, type CampaignStorage, type CampaignTokenUsage, type CampaignTraceWriter, type CellScheduleSlot, type CodeSurface, type CodeSurfaceVerification, type CompareOptimizationMethodsOptions, type ComparisonCost, type ComponentSurface, type CostLedgerHandle, type CreateProfileMatrixPlanOptions, type CreateSearchHistoryReceiptInput, type CrossSurfaceAdditionDecision, type CrossSurfaceAdditionRejectionReason, type CrossSurfaceAttemptCompleteness, type CrossSurfaceBestSingleSelection, type CrossSurfaceBootstrapPolicy, type CrossSurfaceCandidate, type CrossSurfaceCandidateComparison, type CrossSurfaceCandidateEvidence, type CrossSurfaceCandidateOutcome, type CrossSurfaceCandidateSummary, type CrossSurfaceComponent, type CrossSurfaceComponentEvidence, type CrossSurfaceCompositionStep, type CrossSurfaceDistribution, type CrossSurfaceEligibility, type CrossSurfaceEvidenceBreakdown, type CrossSurfaceIneligibilityReason, type CrossSurfaceInteractionAwareSelection, type CrossSurfaceInteractionEffect, type CrossSurfaceInteractionPath, type CrossSurfaceInteractionReport, type CrossSurfaceInteractionTask, type CrossSurfaceNaiveStackSelection, type CrossSurfacePairCompatibility, type CrossSurfacePairEvidence, type CrossSurfacePairIncompatibilityReason, type CrossSurfacePairwiseEntry, type CrossSurfaceRankedSingle, type CrossSurfaceRelativeCost, type CrossSurfaceSelectionPolicy, type CrossSurfaceSelections, type CrossSurfaceTaskRow, type CrowdedFrontierParentOptions, DEFAULT_EXTERNAL_OPTIMIZER_CALLBACK_LIMITS, DEFAULT_EXTERNAL_OPTIMIZER_PROCESS_LIMITS, type DefaultProductionGateCheck, type DefaultProductionGateOptions, type DefaultProductionRewardHackingOptions, type DimensionRegression, type DiscriminationScore, type DispatchContext, type DispatchFn, type EmitLoopProvenanceArgs, type EmitLoopProvenanceResult, type EvalFixture, type EvalFixtureFile, type EvalFixtureLoadOptions, type EvalFixtureRunPlan, type EvalFixtureScenario, type EvalFixtureValidationMode, type EvidenceVector, type ExternalOptimizationExample, type ExternalOptimizerCallbackLimits, type ExternalOptimizerChatRequest, type ExternalOptimizerEndpointFormat, type ExternalOptimizerEvaluationObservation, type ExternalOptimizerEvaluationRefusalReason, type ExternalOptimizerExecutionSummary, type ExternalOptimizerModelBudget, type ExternalOptimizerModelCall, type ExternalOptimizerModelCallRequest, type ExternalOptimizerModelCallResult, type ExternalOptimizerModelExecutionObservation, type ExternalOptimizerObservationArtifact, type ExternalOptimizerObservationSummary, type ExternalOptimizerProcessLimits, type ExternalOptimizerRunnerCommand, type ExternalOptimizerSubmittedCandidate, type ExternalTextCandidate, type ExternalTextEvaluationResponse, type ExternalTextOptimizationMethodConfig, type ExternalTextOptimizerContext, type ExternalTextOptimizerResult, FileSearchLedger, type FinalizeProfileMatrixOptions, type FinalizedProfileMatrixResult, FsLabeledScenarioStore, type FsLabeledScenarioStoreOptions, type Gate, type GateCheckStatus, type GateContext, type GateContribution, type GateDecision, type GateResult, type GenerationCandidate, type GenerationRecord, type GepaAdaptiveEngineRun, type GepaCandidatePopulationArtifact, type GepaCandidatePopulationCandidate, type GepaCandidatePopulationSummary, type GepaCandidateSelectionScore, type GepaEngineOptions, type GepaEngineRun, type GepaOptimizationMethodConfig, type GepaOptimizationRecipe, type GepaRunnerCommand, type GitWorktreeAdapterOptions, type HeldOutGateOptions, type HeldoutSignificance, type HeldoutSignificanceOptions, type JudgeAggregate, type JudgeConfig, type JudgeDimension, type JudgeScore, type LabelTrust, type LabeledScenarioRecord, type LabeledScenarioSampleArgs, type LabeledScenarioSource, type LabeledScenarioStore, LabeledScenarioStoreError, type LabeledScenarioWrite, type LlmJudgeDimension, type LlmJudgeOptions, type LoadEvalFixtureScenariosOptions, type LoopProvenanceArgsFromResult, type LoopProvenanceBackend, type LoopProvenanceCandidate, type LoopProvenanceEvidence, type LoopProvenanceOptimizationMethod, type LoopProvenanceRecord, type MeasuredSearchCandidate, type MutableSurface, type NeutralizationGateOptions, type ObjectiveSource, type OpenAICompatibleOptimizerModel, type OpenAutoPrOptions, type OpenAutoPrResult, type OpenSearchLedgerOptions, type OptimizationMethod, type OptimizationMethodComparison, type OptimizationMethodComposition, type OptimizationMethodInput, type OptimizationMethodPairwise, type OptimizationMethodProvenance, type OptimizationMethodResult, type OptimizationMethodRunOptions, type OptimizationMethodScore, type OptimizationPackageSource, type OptimizationTokenUsage, type OptimizerConfig, type OptimizerModelBudget, type PairedHoldout, type ParentSelectionContext, type ParentSelector, type ParetoParent, type ParetoSignificanceGateOptions, type PendingCostCallView, type PhoenixEvaluationResultLike, type PhoenixEvaluatorLike, type PlanCampaignRunOptions, type PlanEvalFixtureRunOptions, type PlaybackContext, type PlaybackDriver, type PlaybackStep, type PowerPreflight, type PowerPreflightOptions, type PremeasuredOptimizationBaseline, type ProfileDispatchFn, type ProfileMatrixCoverage, ProfileMatrixError, type ProfileMatrixPlan, type ProfileMatrixRow, type ProfileMatrixSegmentResult, type ProfileSummary, type PromotionObjective, type PromotionPolicy, type ProposalFinding, type ProposalFindingOrigin, type ProposalTrackContext, type ProposeContext, type ProposedCandidate, type ProposedSearchCandidate, type RedactionStatus, type ReferenceEquivalenceJudgeOptions, type ReferenceEquivalenceScenario, type RolloutArgumentDiff, type RolloutArgumentDiffOptions, type RolloutCall, type RunCampaignOptions, type RunEvalOptions, type RunImprovementLoopOptions, type RunImprovementLoopResult, type RunOptimizationOptions, type RunOptimizationResult, type RunProfileMatrixOptions, type RunProfileMatrixResult, type RunProfileMatrixSegmentOptions, type Scenario, type ScenarioAggregate, type ScenarioRollup, type ScenarioSignal, type ScoreboardRenderOptions, type ScoreboardRow, type ScoreboardSummary, type ScoredRollout, type ScoredSurfaceOutcome, type SearchAccountingAudit, type SearchArtifactRef, type SearchAttemptAccounting, type SearchCandidateDecidedEvent, type SearchCandidateLineage, type SearchCandidateRegisteredEvent, type SearchCandidateSlot, type SearchCandidateSlotClosedEvent, type SearchCandidateSurface, type SearchCompletedEvent, type SearchCostAccounting, type SearchExecutionIdentity, type SearchFailureReason, type SearchHistoryAdmissionOptions, type SearchHistoryAuditSummary, type SearchHistoryCoverage, type SearchHistoryCoverageRow, type SearchHistoryPolicy, type SearchHistoryReceipt, SearchHistoryRequiredError, type SearchLedger, type SearchLedgerAppendResult, type SearchLedgerBinding, SearchLedgerConflictError, type SearchLedgerEntry, SearchLedgerError, type SearchLedgerEvent, type SearchLedgerHash, SearchLedgerIntegrityError, type SearchLedgerReplay, type SearchLedgerTrustedHeadMode, type SearchModelIdentity, type SearchOperationKind, type SearchOperationRecordedEvent, type SearchPlan, type SearchPlanExtendedEvent, type SearchPlannedEvent, type SearchPlannedOperation, type SearchPlannedTask, SearchRecorder, type SearchRecorderOptions, type SearchRunIdentity, type SearchSourceRef, type SearchSurfaceEffect, type SearchSurfaceEvidence, type SearchSurfaceKind, type SearchTaskAttemptedEvent, type SearchTaskOutcome, type SearchTokenAccounting, type SequentialDecideFn, type SequentialDecideOptions, type SequentialDecision, type SequentialObservation, type SequentialPairedGate, type SequentialPairedGateOptions, type SequentialStreamState, type SeriesDistribution, type SessionScript, type SingleRunLock, type SingleRunLockOptions, type SkillOptOptimizationMethodConfig, type SkillOptRunnerCommand, type SkillOptTrainerConfig, type SurfaceProposer, type TraceAnalystArtifact, type TraceAnalystScenario, type TraceSpan, type TransientFailureOptions, type UngroundedLiteralReport, type UserStory, type UserStoryVerdict, type Worktree, type WorktreeAdapter, WorktreeAdapterError, acquireSingleRunLock, analyzeCrossSurfaceInteractions, assertCampaignDesign, assertCampaignSplitIdentity, assertCodeSurfaceIdentity, assertCompleteSearchHistory, assertSearchHistoryMatchesReplay, autoevalsScorerJudge, buildCellSchedule, buildEvidenceVector, buildLoopProvenanceRecord, buildTraceAnalystSurfaceDispatch, campaignBreakdown, campaignMeanComposite, campaignMeasurementDigest, campaignScenarioIdentity, campaignSplitDigest, campaignSplitDigestFromIdentities, canonicalDigest, cellCachePath, classifyUngroundedLiterals, codeSurfaceIdentityMaterial, combineComparisonCosts, compareOptimizationMethods, compareRankKeys, componentSurfaceIdentityMaterial, composeGate, costFromLedgerSummary, createProfileMatrixPlan, createReferenceEquivalenceJudge, createRunCostLedger, createSearchHistoryReceipt, crowdedFrontierParent, decodeExternalTextCandidate, defaultProductionGate, detectScale, dimensionRegressions, discoverEvalFixtures, emitLoopProvenance, externalTextOptimizationMethod, finalizeProfileMatrix, fsCampaignStorage, gepaOptimizationMethod, gitWorktreeAdapter, heldOutGate, heldoutSignificance, inMemoryCampaignStorage, isProposedCandidate, isTransientTransportFailure, labelTrustRank, llmJudge, loadEvalFixture, loadEvalFixtureScenarios, loopProvenanceArgsFromResult, loopProvenanceSpans, makePlaybackDispatch, makeProposalFinding, neutralizationGate, neutralizeText, openAutoPr, openSearchLedger, optimizationTokenUsageFromSummary, pairHoldout, paretoPolicy, paretoSignificanceGate, phoenixEvaluatorJudge, planCampaignRun, planEvalFixtureRun, powerPreflight, provenanceRecordPath, provenanceSpansPath, quotaExhaustedUntil, readCachedCell, readExternalOptimizerObservationArtifact, readGepaCandidatePopulationArtifact, recordCandidatePopulationSearch, renderScoreboardMarkdown, renderSurfaceDiff, replaySearchLedgerText, resolveExternalOptimizerCallbackLimits, resolveExternalOptimizerProcessLimits, resolveRunDir, resolveWorktreePath, rolloutArgumentDiff, runCampaign, runEval, runImprovementLoop, runOptimization, runProfileMatrix, runProfileMatrixSegment, scopedOptimizationMethod, scoreDiscrimination, scoreUserStory, scoreboardSummary, searchHistoryCoverageRow, selectDiscriminative, sequentialDecide, sequentialOptimizationMethod, sequentialPairedGate, skillOptOptimizationMethod, surfaceContentHash, surfaceDispatchRef, surfaceHash, tangleTracesRoot, traceAnalystQualityJudge, transientDispatchFailure, userStoryScoreboard, validateSearchLedgerEvent, verifyCodeSurface, verifyLoopProvenanceRecord, verifySearchHistoryArtifact, verifySearchHistoryReceipt };
|
package/dist/cli.js
CHANGED
|
@@ -1,7 +1,7 @@
|
|
|
1
1
|
#!/usr/bin/env node
|
|
2
2
|
import { i as runRolloutReleaseCli } from "./hf-dataset-D8_RNIis.js";
|
|
3
3
|
import { t as createChatClient } from "./chat-client-CkmjYlfB.js";
|
|
4
|
-
import { t as runAnalystBenchmarkCommand } from "./benchmark-command-
|
|
4
|
+
import { t as runAnalystBenchmarkCommand } from "./benchmark-command-CY6Dg5t5.js";
|
|
5
5
|
import { a as runRpcBatch, o as runRpcOnce, p as handleVersion, r as startServerAsync, s as buildOpenApi } from "./server-D_cjseFN.js";
|
|
6
6
|
import { t as runSupervisorRunCommand } from "./report-command-DKlXfU5r.js";
|
|
7
7
|
import { writeFileSync } from "node:fs";
|
|
@@ -1,5 +1,5 @@
|
|
|
1
1
|
import { l as RunTerminalOutcome } from "./run-record-DTv1MdjK.js";
|
|
2
|
-
import { _ as GateDecision, j as MutableSurface } from "./types-
|
|
2
|
+
import { _ as GateDecision, j as MutableSurface } from "./types-C34V4Vto.js";
|
|
3
3
|
import { o as InsightReport } from "./insight-report-DETqPc_A.js";
|
|
4
4
|
//#region src/hosted/types.d.ts
|
|
5
5
|
declare const HOSTED_WIRE_VERSION: '2026-07-24.v1';
|
|
@@ -199,4 +199,4 @@ declare function hostedClientFromEnv(overrides?: Partial<HostedTenant> & {
|
|
|
199
199
|
}): HostedClient | undefined;
|
|
200
200
|
//#endregion
|
|
201
201
|
export { UnixNanoTimestamp as _, hostedTenantFromEnv as a, EvalRunGenerationSnapshot as c, HostedIngestHeaders as d, HostedWireVersion as f, TraceSpanEvent as g, IngestTracesRequest as h, hostedClientFromEnv as i, EvalRunStatus as l, IngestResponse as m, HostedTenant as n, EvalRunCellScore as o, IngestEvalRunsRequest as p, createHostedClient as r, EvalRunEvent as s, HostedClient as t, HOSTED_WIRE_VERSION as u };
|
|
202
|
-
//# sourceMappingURL=client-
|
|
202
|
+
//# sourceMappingURL=client-CuQgX33c.d.ts.map
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"client-
|
|
1
|
+
{"version":3,"file":"client-CuQgX33c.d.ts","names":[],"sources":["../src/hosted/types.ts","../src/hosted/client.ts"],"mappings":";;;;cAgCa;KACD,2BAA2B;;UAKtB;;EAEf;;EAEA;;EAEA,yBAAyB;;EAEzB;;;KAMU;UAQK;;EAEf;;EAEA;;EAEA;;EAEA,YAAY,eAAe;;EAE3B,iBAAiB;;EAEjB;;EAEA;;UAGe;;EAEf;;;EAGA;;;EAGA,UAAU;;EAEV,OAAO;;EAEP;;EAEA;;EAEA;;;;;;;UAQe;;EAEf;;EAEA;;EAEA;;EAEA,QAAQ;;EAER,QAAQ;;EAER,WAAW;;EAEX,aAAa;;EAEb,eAAe;;EAEf;;EAEA;;EAEA;;EAEA;;;;;;EAMA,gBAAgB;;;;;;KASN;;;;;;UAOK;EACf;EACA;EACA;EACA;EACA,mBAAmB;EACnB,iBAAiB;EACjB,YAAY;EACZ,SAAS;IACP,cAAc;IACd;IACA,aAAa;;EAEf;IAAW;IAAgC;;;EAE3C;;EAEA;;EAEA;;EAEA;;UAKe;EACf,aAAa;EACb,QAAQ;;UAGO;EACf,aAAa;EACb,OAAO;;UAGQ;;EAEf;;EAEA,UAAU;IAAQ;IAAe;;;;;UC1JlB;;EAEf;;EAEA;;EAEA;;EAEA,mBAAmB;;EAEnB;;EAEA;;UAGe;EACf,cAAc,OAAO,cAAc,0BAA0B,QAAQ;EACrE,eAAe,QAAQ,gBAAgB,0BAA0B,QAAQ;EACzE,aAAa,OAAO,kBAAkB,0BAA0B,QAAQ;WAC/D,QAAQ;WACR,aAAa;;iBAyGR,mBAAmB,QAAQ,eAAe;;;;;;;;;;;;;;;;;;;;;;;;;;;iBAsE1C,oBACd,YAAW,QAAQ;EAAkB,MAAM;IAC1C;iBAiBa,oBACd,YAAW,QAAQ;EAAkB,MAAM;IAC1C"}
|
package/dist/contract/index.d.ts
CHANGED
|
@@ -1,14 +1,14 @@
|
|
|
1
1
|
import { c as CostLedgerHandle } from "../cost-ledger-DbQdN3nO.js";
|
|
2
|
-
import { _ as ProposalFinding, i as AnalystFinding, v as ProposalFindingOrigin, x as makeProposalFinding } from "../types-
|
|
2
|
+
import { _ as ProposalFinding, i as AnalystFinding, v as ProposalFindingOrigin, x as makeProposalFinding } from "../types-DzuaM493.js";
|
|
3
3
|
import { S as createChatClient, _ as CreateChatClientOpts, p as ChatClient } from "../types-gvRsyJLh.js";
|
|
4
|
-
import { $ as paretoSignificanceGate, G as BuildEvidenceVectorOptions, J as ParetoSignificanceGateOptions, K as EvidenceVector, Q as paretoPolicy, U as AxisEvidence, W as AxisVerdict, X as PromotionPolicy, Y as PromotionObjective, Z as buildEvidenceVector, q as ObjectiveSource } from "../statistical-heldout-
|
|
5
|
-
import { C as JudgeDimension, H as SurfaceProposer, M as OptimizerConfig, R as Scenario, S as JudgeConfig, V as SessionScript, _ as GateDecision, a as CampaignResult, b as GenerationRecord, c as CampaignTraceWriter, d as DispatchContext, f as DispatchFn, g as GateContribution, h as GateContext, i as CampaignCostMeter, j as MutableSurface, l as CodeSurface, m as GateCheckStatus, n as CampaignArtifactWriter, p as Gate, r as CampaignCellResult, t as CampaignAggregates, v as GateResult, w as JudgeScore, y as GenerationCandidate } from "../types-
|
|
6
|
-
import { Ar as SkillOptOptimizationMethodConfig, Br as gepaOptimizationMethod, Ci as ReferenceEquivalenceScenario, Di as LlmJudgeOptions, Do as inMemoryCampaignStorage, Ei as LlmJudgeDimension, Eo as fsCampaignStorage, Fi as runImprovementLoop, Fr as GepaEngineOptions, Gr as ExternalTextOptimizerContext, Hr as OptimizerModelBudget, Ir as GepaEngineRun, Jr as ExternalTextEvaluationResponse, Kr as ExternalTextOptimizerResult, Lr as GepaOptimizationMethodConfig, Mi as transientDispatchFailure, Mr as SkillOptTrainerConfig, Ni as RunImprovementLoopOptions, Nr as skillOptOptimizationMethod, Oi as llmJudge, Pi as RunImprovementLoopResult, Pr as GepaAdaptiveEngineRun, Qr as OptimizationMethodComparison, Rr as GepaOptimizationRecipe, Si as ReferenceEquivalenceJudgeResult, Ti as runReferenceEquivalenceJudge, Ur as externalTextOptimizationMethod, Vr as OpenAICompatibleOptimizerModel, Wr as ExternalTextOptimizationMethodConfig, Xr as CompareOptimizationMethodsOptions, Zr as OptimizationMethod, bi as ReferenceEquivalenceJudgeInput, ci as compareOptimizationMethods, co as RunEvalOptions, do as CampaignCellRetryPolicy, dr as DefaultProductionGateCheck, ei as OptimizationMethodInput, fo as RunCampaignOptions, fr as DefaultProductionGateOptions, jo as campaignSplitDigest, jr as SkillOptRunnerCommand, kr as composeGate, lo as runEval, lr as HeldOutGateOptions, mr as defaultProductionGate, ni as OptimizationMethodProvenance, oi as OptimizationPackageSource, po as runCampaign, pr as DefaultProductionRewardHackingOptions, qr as ExternalOptimizationExample, ri as OptimizationMethodResult, si as OptimizationTokenUsage, ui as ComparisonCost, uo as CampaignCellFailureReceipt, ur as heldOutGate, vi as REFERENCE_EQUIVALENCE_INPUT_LIMITS, wi as createReferenceEquivalenceJudge, wo as CampaignStorage, xi as ReferenceEquivalenceJudgeOptions, yi as REFERENCE_EQUIVALENCE_JUDGE_VERSION, zr as GepaRunnerCommand } from "../index-
|
|
4
|
+
import { $ as paretoSignificanceGate, G as BuildEvidenceVectorOptions, J as ParetoSignificanceGateOptions, K as EvidenceVector, Q as paretoPolicy, U as AxisEvidence, W as AxisVerdict, X as PromotionPolicy, Y as PromotionObjective, Z as buildEvidenceVector, q as ObjectiveSource } from "../statistical-heldout-0La5ZTlv.js";
|
|
5
|
+
import { C as JudgeDimension, H as SurfaceProposer, M as OptimizerConfig, R as Scenario, S as JudgeConfig, V as SessionScript, _ as GateDecision, a as CampaignResult, b as GenerationRecord, c as CampaignTraceWriter, d as DispatchContext, f as DispatchFn, g as GateContribution, h as GateContext, i as CampaignCostMeter, j as MutableSurface, l as CodeSurface, m as GateCheckStatus, n as CampaignArtifactWriter, p as Gate, r as CampaignCellResult, t as CampaignAggregates, v as GateResult, w as JudgeScore, y as GenerationCandidate } from "../types-C34V4Vto.js";
|
|
6
|
+
import { Ar as SkillOptOptimizationMethodConfig, Br as gepaOptimizationMethod, Ci as ReferenceEquivalenceScenario, Di as LlmJudgeOptions, Do as inMemoryCampaignStorage, Ei as LlmJudgeDimension, Eo as fsCampaignStorage, Fi as runImprovementLoop, Fr as GepaEngineOptions, Gr as ExternalTextOptimizerContext, Hr as OptimizerModelBudget, Ir as GepaEngineRun, Jr as ExternalTextEvaluationResponse, Kr as ExternalTextOptimizerResult, Lr as GepaOptimizationMethodConfig, Mi as transientDispatchFailure, Mr as SkillOptTrainerConfig, Ni as RunImprovementLoopOptions, Nr as skillOptOptimizationMethod, Oi as llmJudge, Pi as RunImprovementLoopResult, Pr as GepaAdaptiveEngineRun, Qr as OptimizationMethodComparison, Rr as GepaOptimizationRecipe, Si as ReferenceEquivalenceJudgeResult, Ti as runReferenceEquivalenceJudge, Ur as externalTextOptimizationMethod, Vr as OpenAICompatibleOptimizerModel, Wr as ExternalTextOptimizationMethodConfig, Xr as CompareOptimizationMethodsOptions, Zr as OptimizationMethod, bi as ReferenceEquivalenceJudgeInput, ci as compareOptimizationMethods, co as RunEvalOptions, do as CampaignCellRetryPolicy, dr as DefaultProductionGateCheck, ei as OptimizationMethodInput, fo as RunCampaignOptions, fr as DefaultProductionGateOptions, jo as campaignSplitDigest, jr as SkillOptRunnerCommand, kr as composeGate, lo as runEval, lr as HeldOutGateOptions, mr as defaultProductionGate, ni as OptimizationMethodProvenance, oi as OptimizationPackageSource, po as runCampaign, pr as DefaultProductionRewardHackingOptions, qr as ExternalOptimizationExample, ri as OptimizationMethodResult, si as OptimizationTokenUsage, ui as ComparisonCost, uo as CampaignCellFailureReceipt, ur as heldOutGate, vi as REFERENCE_EQUIVALENCE_INPUT_LIMITS, wi as createReferenceEquivalenceJudge, wo as CampaignStorage, xi as ReferenceEquivalenceJudgeOptions, yi as REFERENCE_EQUIVALENCE_JUDGE_VERSION, zr as GepaRunnerCommand } from "../index-BxWvILU8.js";
|
|
7
7
|
import { i as InMemoryOutcomeStore, n as FileSystemOutcomeStore, o as OutcomeStore, r as FileSystemOutcomeStoreOptions, t as DeploymentOutcome } from "../outcome-store-BYHIuO0e.js";
|
|
8
8
|
import { a as FailureClusterInsight, c as JudgeInsight, d as Recommendation, f as ReleaseSummary, i as FailureClassTally, l as LiftInsight, m as TokenUsageInsight, n as ExecutionErrorOutcomeCell, o as InsightReport, p as ScalarDistribution, r as ExecutionInsight, s as InterRaterInsight, t as CostProvenanceSummary, u as OutcomeCorrelationInsight } from "../insight-report-DETqPc_A.js";
|
|
9
|
-
import { n as HostedTenant } from "../client-
|
|
10
|
-
import { _ as SelfImproveMethodResult, a as DefinedAgentEval, c as SelfImproveMethodOptions, d as SelfImproveProposerOptions, f as SelfImproveProposerResult, g as SelfImproveMethodProvenance, h as selfImprove, i as DefineAgentEvalOptions, l as SelfImproveOptions, m as SelfImproveRunError, n as AgentEvalEvaluateOptions, o as defineAgentEval, p as SelfImproveResult, r as AgentEvalImproveOptions, s as SelfImproveBudget, t as AgentEvalAgent, u as SelfImproveProgressEvent } from "../define-agent-eval-
|
|
11
|
-
import { $ as diffRunBaselineToWinner, A as CodeAgentSessionActionStatus, At as measuredComparisonFromCandidateExperiment, B as AgentTraceFile, C as fromOpenCodeSession, Ct as EvaluatePairedMeasurementsOptions, D as streamCodeAgentJsonlFile, Dt as RunCandidateExperimentOptions, E as parseCodeAgentJsonlFile, Et as PairedMeasurementEvaluation, F as CodeAgentSessionTerminalStatus, Ft as verifyCandidateExperiment, G as PartitionByAuthoringModelResult, H as AgentTraceRange, I as observeCodeAgentSession, It as verifyCandidateExperimentComparison, J as EvalCellScoreDelta, K as parseAgentTrace, L as AgentTraceContributor, M as CodeAgentSessionExecutionReceipt, Mt as sealCandidateBenchmarkSuite, N as CodeAgentSessionObservation, Nt as sealCandidateBenchmarkTask, O as CodeAgentSessionAction, Ot as SealCandidateBenchmarkSuiteOptions, P as CodeAgentSessionSource, Pt as sealCandidateExperiment, Q as diffGenerations, R as AgentTraceContributorType, S as fromKimiCodeSession, St as CompareCandidateExperimentOptions, T as parseCodeAgentJsonl, Tt as PairedMeasurementAdapter, U as AgentTraceRecord, V as AgentTraceIndex, W as AuthoringProvenance, X as EvalGenerationDiff, Y as EvalDimensionDelta, Z as EvalRunDiff, _ as CodeAgentSessionIntakeResult, _t as sealAgentProfileImprovementSuite, a as FromFeedbackTableOptions, at as FromRunRecordDirOptions, b as fromClaudeCodeSession, bt as CandidateExperimentExecutionInput, c as CodeAgentStoreObservation, ct as fromRunRecordDir, d as CodeAgentStoreScope, dt as CompareAgentProfileImprovementExperimentOptions, et as diffRuns, f as CodeAgentStoreSession, ft as RunAgentProfileImprovementExperimentOptions, g as CodeAgentSessionIntakeOptions, gt as sealAgentProfileImprovementExperiment, h as CodeAgentSessionDiagnostic, ht as runAgentProfileImprovementExperiment, i as FeedbackTableRow, it as evalReportingSuite, j as CodeAgentSessionActionSurface, jt as runCandidateExperiment, k as CodeAgentSessionActionKind, kt as evaluatePairedMeasurements, l as CodeAgentStoreRejection, lt as AgentProfileImprovementExperimentExecutionInput, m as CodeAgentJsonlLine, mt as measuredComparisonFromAgentProfileImprovementExperiment, n as fromOtelSpans, nt as EvalReportingSuiteOptions, o as FromFeedbackTableResult, ot as FromRunRecordDirResult, p as observeCodeAgentStore, pt as SealAgentProfileImprovementSuiteOptions, q as partitionRunsByAuthoringModel, r as FeedbackTableMeta, rt as EvalReportingSuiteResult, s as fromFeedbackTable, st as RunRecordRejection, t as FromOtelSpansOptions, tt as EvalReportingSuiteInput, u as CodeAgentStoreRejections, ut as AgentProfileImprovementExperimentRun, v as CodeAgentSessionMetrics, vt as sealAgentProfileImprovementTask, w as fromPiSession, wt as PairedMeasurement, x as fromCodexSession, xt as CandidateExperimentRun, y as ParsedCodeAgentJsonl, yt as verifyAgentProfileImprovementExperimentComparison, z as AgentTraceConversation } from "../index-
|
|
12
|
-
import { n as buildDefaultAnalystRegistry, t as DefaultAnalystRegistryOptions } from "../default-registry-
|
|
13
|
-
import { S as summarizeExecution, b as SummarizeExecutionOptions, v as AnalyzeRunsOptions, x as analyzeRuns, y as ExecutionReport } from "../engine-
|
|
9
|
+
import { n as HostedTenant } from "../client-CuQgX33c.js";
|
|
10
|
+
import { _ as SelfImproveMethodResult, a as DefinedAgentEval, c as SelfImproveMethodOptions, d as SelfImproveProposerOptions, f as SelfImproveProposerResult, g as SelfImproveMethodProvenance, h as selfImprove, i as DefineAgentEvalOptions, l as SelfImproveOptions, m as SelfImproveRunError, n as AgentEvalEvaluateOptions, o as defineAgentEval, p as SelfImproveResult, r as AgentEvalImproveOptions, s as SelfImproveBudget, t as AgentEvalAgent, u as SelfImproveProgressEvent } from "../define-agent-eval-Cx4Ls9ta.js";
|
|
11
|
+
import { $ as diffRunBaselineToWinner, A as CodeAgentSessionActionStatus, At as measuredComparisonFromCandidateExperiment, B as AgentTraceFile, C as fromOpenCodeSession, Ct as EvaluatePairedMeasurementsOptions, D as streamCodeAgentJsonlFile, Dt as RunCandidateExperimentOptions, E as parseCodeAgentJsonlFile, Et as PairedMeasurementEvaluation, F as CodeAgentSessionTerminalStatus, Ft as verifyCandidateExperiment, G as PartitionByAuthoringModelResult, H as AgentTraceRange, I as observeCodeAgentSession, It as verifyCandidateExperimentComparison, J as EvalCellScoreDelta, K as parseAgentTrace, L as AgentTraceContributor, M as CodeAgentSessionExecutionReceipt, Mt as sealCandidateBenchmarkSuite, N as CodeAgentSessionObservation, Nt as sealCandidateBenchmarkTask, O as CodeAgentSessionAction, Ot as SealCandidateBenchmarkSuiteOptions, P as CodeAgentSessionSource, Pt as sealCandidateExperiment, Q as diffGenerations, R as AgentTraceContributorType, S as fromKimiCodeSession, St as CompareCandidateExperimentOptions, T as parseCodeAgentJsonl, Tt as PairedMeasurementAdapter, U as AgentTraceRecord, V as AgentTraceIndex, W as AuthoringProvenance, X as EvalGenerationDiff, Y as EvalDimensionDelta, Z as EvalRunDiff, _ as CodeAgentSessionIntakeResult, _t as sealAgentProfileImprovementSuite, a as FromFeedbackTableOptions, at as FromRunRecordDirOptions, b as fromClaudeCodeSession, bt as CandidateExperimentExecutionInput, c as CodeAgentStoreObservation, ct as fromRunRecordDir, d as CodeAgentStoreScope, dt as CompareAgentProfileImprovementExperimentOptions, et as diffRuns, f as CodeAgentStoreSession, ft as RunAgentProfileImprovementExperimentOptions, g as CodeAgentSessionIntakeOptions, gt as sealAgentProfileImprovementExperiment, h as CodeAgentSessionDiagnostic, ht as runAgentProfileImprovementExperiment, i as FeedbackTableRow, it as evalReportingSuite, j as CodeAgentSessionActionSurface, jt as runCandidateExperiment, k as CodeAgentSessionActionKind, kt as evaluatePairedMeasurements, l as CodeAgentStoreRejection, lt as AgentProfileImprovementExperimentExecutionInput, m as CodeAgentJsonlLine, mt as measuredComparisonFromAgentProfileImprovementExperiment, n as fromOtelSpans, nt as EvalReportingSuiteOptions, o as FromFeedbackTableResult, ot as FromRunRecordDirResult, p as observeCodeAgentStore, pt as SealAgentProfileImprovementSuiteOptions, q as partitionRunsByAuthoringModel, r as FeedbackTableMeta, rt as EvalReportingSuiteResult, s as fromFeedbackTable, st as RunRecordRejection, t as FromOtelSpansOptions, tt as EvalReportingSuiteInput, u as CodeAgentStoreRejections, ut as AgentProfileImprovementExperimentRun, v as CodeAgentSessionMetrics, vt as sealAgentProfileImprovementTask, w as fromPiSession, wt as PairedMeasurement, x as fromCodexSession, xt as CandidateExperimentRun, y as ParsedCodeAgentJsonl, yt as verifyAgentProfileImprovementExperimentComparison, z as AgentTraceConversation } from "../index-DxNYmx4a.js";
|
|
12
|
+
import { n as buildDefaultAnalystRegistry, t as DefaultAnalystRegistryOptions } from "../default-registry-IGDE9XIC.js";
|
|
13
|
+
import { S as summarizeExecution, b as SummarizeExecutionOptions, v as AnalyzeRunsOptions, x as analyzeRuns, y as ExecutionReport } from "../engine-CX8ReXkn.js";
|
|
14
14
|
export { type AgentEvalAgent, type AgentEvalEvaluateOptions, type AgentEvalImproveOptions, type AgentProfileImprovementExperimentExecutionInput, type AgentProfileImprovementExperimentRun, type AgentTraceContributor, type AgentTraceContributorType, type AgentTraceConversation, type AgentTraceFile, type AgentTraceIndex, type AgentTraceRange, type AgentTraceRecord, type AnalystFinding, type AnalyzeRunsOptions, type AuthoringProvenance, type AxisEvidence, type AxisVerdict, type BuildEvidenceVectorOptions, type CampaignAggregates, type CampaignArtifactWriter, type CampaignCellFailureReceipt, type CampaignCellResult, type CampaignCellRetryPolicy, type CampaignCostMeter, type CampaignResult, type CampaignStorage, type CampaignTraceWriter, type CandidateExperimentExecutionInput, type CandidateExperimentRun, type ChatClient, type CodeAgentJsonlLine, type CodeAgentSessionAction, type CodeAgentSessionActionKind, type CodeAgentSessionActionStatus, type CodeAgentSessionActionSurface, type CodeAgentSessionDiagnostic, type CodeAgentSessionExecutionReceipt, type CodeAgentSessionIntakeOptions, type CodeAgentSessionIntakeResult, type CodeAgentSessionMetrics, type CodeAgentSessionObservation, type CodeAgentSessionSource, type CodeAgentSessionTerminalStatus, type CodeAgentStoreObservation, type CodeAgentStoreRejection, type CodeAgentStoreRejections, type CodeAgentStoreScope, type CodeAgentStoreSession, type CodeSurface, type CompareAgentProfileImprovementExperimentOptions, type CompareCandidateExperimentOptions, type CompareOptimizationMethodsOptions, type ComparisonCost, type CostLedgerHandle, type CostProvenanceSummary, type CreateChatClientOpts, type DefaultAnalystRegistryOptions, type DefaultProductionGateCheck, type DefaultProductionGateOptions, type DefaultProductionRewardHackingOptions, type DefineAgentEvalOptions, type DefinedAgentEval, type DeploymentOutcome, type DispatchFn as Dispatch, type DispatchContext, type EvalCellScoreDelta, type EvalDimensionDelta, type EvalGenerationDiff, type EvalReportingSuiteInput, type EvalReportingSuiteOptions, type EvalReportingSuiteResult, type EvalRunDiff, type EvaluatePairedMeasurementsOptions, type EvidenceVector, type ExecutionErrorOutcomeCell, type ExecutionInsight, type ExecutionReport, type ExternalOptimizationExample, type ExternalTextEvaluationResponse, type ExternalTextOptimizationMethodConfig, type ExternalTextOptimizerContext, type ExternalTextOptimizerResult, type FailureClassTally, type FailureClusterInsight, type FeedbackTableMeta, type FeedbackTableRow, FileSystemOutcomeStore, type FileSystemOutcomeStoreOptions, type FromFeedbackTableOptions, type FromFeedbackTableResult, type FromOtelSpansOptions, type FromRunRecordDirOptions, type FromRunRecordDirResult, type Gate, type GateCheckStatus, type GateContext, type GateContribution, type GateDecision, type GateResult, type GenerationCandidate, type GenerationRecord, type GepaAdaptiveEngineRun, type GepaEngineOptions, type GepaEngineRun, type GepaOptimizationMethodConfig, type GepaOptimizationRecipe, type GepaRunnerCommand, type HeldOutGateOptions, type HostedTenant, InMemoryOutcomeStore, type InsightReport, type InterRaterInsight, type JudgeConfig, type JudgeDimension, type JudgeInsight, type JudgeScore, type LiftInsight, type LlmJudgeDimension, type LlmJudgeOptions, type MutableSurface, type ObjectiveSource, type OpenAICompatibleOptimizerModel, type OptimizationMethod, type OptimizationMethodComparison, type OptimizationMethodInput, type OptimizationMethodProvenance, type OptimizationMethodResult, type OptimizationPackageSource, type OptimizationTokenUsage, type OptimizerConfig, type OptimizerModelBudget, type OutcomeCorrelationInsight, type OutcomeStore, type PairedMeasurement, type PairedMeasurementAdapter, type PairedMeasurementEvaluation, type ParetoSignificanceGateOptions, type ParsedCodeAgentJsonl, type PartitionByAuthoringModelResult, type PromotionObjective, type PromotionPolicy, type ProposalFinding, type ProposalFindingOrigin, REFERENCE_EQUIVALENCE_INPUT_LIMITS, REFERENCE_EQUIVALENCE_JUDGE_VERSION, type Recommendation, type ReferenceEquivalenceJudgeInput, type ReferenceEquivalenceJudgeOptions, type ReferenceEquivalenceJudgeResult, type ReferenceEquivalenceScenario, type ReleaseSummary, type RunAgentProfileImprovementExperimentOptions, type RunCampaignOptions, type RunCandidateExperimentOptions, type RunEvalOptions, type RunImprovementLoopOptions, type RunImprovementLoopResult, type RunRecordRejection, type ScalarDistribution, type Scenario, type SealAgentProfileImprovementSuiteOptions, type SealCandidateBenchmarkSuiteOptions, type SelfImproveBudget, type SelfImproveMethodOptions, type SelfImproveMethodProvenance, type SelfImproveMethodResult, type SelfImproveOptions, type SelfImproveProgressEvent, type SelfImproveProposerOptions, type SelfImproveProposerResult, type SelfImproveResult, SelfImproveRunError, type SessionScript, type SkillOptOptimizationMethodConfig, type SkillOptRunnerCommand, type SkillOptTrainerConfig, type SummarizeExecutionOptions, type SurfaceProposer, type TokenUsageInsight, analyzeRuns, buildDefaultAnalystRegistry, buildEvidenceVector, campaignSplitDigest, compareOptimizationMethods, composeGate, createChatClient, createReferenceEquivalenceJudge, defaultProductionGate, defineAgentEval, diffGenerations, diffRunBaselineToWinner, diffRuns, evalReportingSuite, evaluatePairedMeasurements, externalTextOptimizationMethod, fromClaudeCodeSession, fromCodexSession, fromFeedbackTable, fromKimiCodeSession, fromOpenCodeSession, fromOtelSpans, fromPiSession, fromRunRecordDir, fsCampaignStorage, gepaOptimizationMethod, heldOutGate, inMemoryCampaignStorage, llmJudge, makeProposalFinding, measuredComparisonFromAgentProfileImprovementExperiment, measuredComparisonFromCandidateExperiment, observeCodeAgentSession, observeCodeAgentStore, paretoPolicy, paretoSignificanceGate, parseAgentTrace, parseCodeAgentJsonl, parseCodeAgentJsonlFile, partitionRunsByAuthoringModel, runAgentProfileImprovementExperiment, runCampaign, runCandidateExperiment, runEval, runImprovementLoop, runReferenceEquivalenceJudge, sealAgentProfileImprovementExperiment, sealAgentProfileImprovementSuite, sealAgentProfileImprovementTask, sealCandidateBenchmarkSuite, sealCandidateBenchmarkTask, sealCandidateExperiment, selfImprove, skillOptOptimizationMethod, streamCodeAgentJsonlFile, summarizeExecution, transientDispatchFailure, verifyAgentProfileImprovementExperimentComparison, verifyCandidateExperiment, verifyCandidateExperimentComparison };
|
package/dist/contract/index.js
CHANGED
|
@@ -10,13 +10,13 @@ import { M as heldoutSignificance, P as decidePairedPromotion, et as campaignSpl
|
|
|
10
10
|
import { f as mapConcurrentRange } from "../ledger-core-Cs9f7385.js";
|
|
11
11
|
import { C as inMemoryCampaignStorage, S as fsCampaignStorage } from "../external-optimizer-subprocess-q3VzlGAO.js";
|
|
12
12
|
import { i as makeProposalFinding } from "../types-DQ0e2E7y.js";
|
|
13
|
-
import {
|
|
14
|
-
import { t as buildDefaultAnalystRegistry } from "../default-registry-
|
|
13
|
+
import { K as classifyOtlpSpanRole, q as isOtlpModelCall } from "../kind-factory-D5HOW3R0.js";
|
|
14
|
+
import { t as buildDefaultAnalystRegistry } from "../default-registry-BryMEmr8.js";
|
|
15
15
|
import { LLM_MODEL_ATTR_KEYS, SPAN_KIND_ATTR_KEYS } from "../trace-attributes.js";
|
|
16
16
|
import { t as extractUsage } from "../extract-usage-BrQ8mCLX.js";
|
|
17
17
|
import { t as createChatClient } from "../chat-client-CkmjYlfB.js";
|
|
18
18
|
import { n as InMemoryOutcomeStore, t as FileSystemOutcomeStore } from "../outcome-store-ChBKlTd_.js";
|
|
19
|
-
import { i as summarizeTraceErrors, n as recordAggregateMeasurements, r as summarizeExecutionMeasurements, t as readTaskFailureLabels } from "../task-failure-attributes-
|
|
19
|
+
import { i as summarizeTraceErrors, n as recordAggregateMeasurements, r as summarizeExecutionMeasurements, t as readTaskFailureLabels } from "../task-failure-attributes-B072KO_n.js";
|
|
20
20
|
import { a as externalTextOptimizationMethod, c as REFERENCE_EQUIVALENCE_INPUT_LIMITS, d as runReferenceEquivalenceJudge, i as composeGate, l as REFERENCE_EQUIVALENCE_JUDGE_VERSION, n as gepaOptimizationMethod, r as heldOutGate, t as skillOptOptimizationMethod, u as createReferenceEquivalenceJudge } from "../skillopt-optimization-method-C3oYul8v.js";
|
|
21
21
|
import { n as paretoPolicy, r as paretoSignificanceGate, t as buildEvidenceVector } from "../promotion-policy-DWOm70gx.js";
|
|
22
22
|
import { createHash } from "node:crypto";
|
|
@@ -1,7 +1,7 @@
|
|
|
1
1
|
import { a as hashCanonical, r as canonicalString } from "./canonical-DPyQ_rpt.js";
|
|
2
2
|
import { t as combineAbortSignals } from "./abort-signal-CtzAM_sJ.js";
|
|
3
3
|
import { a as assertValidAnalystUsageReceipt, c as validateUsageSettlementTimeout, l as deepFreezeCanonicalJson, r as makeFinding } from "./types-DQ0e2E7y.js";
|
|
4
|
-
import {
|
|
4
|
+
import { B as findingSubjectGrammarPromptFor, X as snapshotExactExecutionPlan, Y as snapshotExactExecutionComponentIdentity, k as spanEpochMillis, t as createTraceAnalyst } from "./kind-factory-D5HOW3R0.js";
|
|
5
5
|
import { LLM_CONTEXT_TOKENS, LLM_INPUT_TOKEN_ATTR_KEYS, LLM_OUTPUT_TOKEN_ATTR_KEYS, TOOL_NAME_ATTR_KEYS } from "./trace-attributes.js";
|
|
6
6
|
import { t as executionTrackByLane } from "./execution-tracks-CpgFPpS5.js";
|
|
7
7
|
import { t as analyzeSupervisorRunIntegrity } from "./integrity-DsHWCebQ.js";
|
|
@@ -2363,4 +2363,4 @@ function buildDefaultAnalystRegistry(options = {}) {
|
|
|
2363
2363
|
//#endregion
|
|
2364
2364
|
export { completedAnalystReviewQuality as _, KNOWLEDGE_POISONING_KIND_SPEC as a, validateAnalystReviewDecisions as b, FAILURE_MODE_KIND_SPEC as c, emitControlIntegrityFindings as d, behavioralAnalyst as f, assertUniqueFindingIds as g, analystRunDigest as h, DEFAULT_TRACE_ANALYST_KINDS as i, CONTROL_INTEGRITY_ANALYST as l, analystFindingDigest as m, AnalystRegistry as n, KNOWLEDGE_GAP_KIND_SPEC as o, deriveEfficiencyFindings as p, ExactAnalystRunExecutionError as r, IMPROVEMENT_KIND_SPEC as s, buildDefaultAnalystRegistry as t, ControlIntegrityAnalyst as u, readAnalystReview as v, snapshotAnalystRun as y };
|
|
2365
2365
|
|
|
2366
|
-
//# sourceMappingURL=default-registry-
|
|
2366
|
+
//# sourceMappingURL=default-registry-BryMEmr8.js.map
|