@tangle-network/agent-runtime 0.94.13 → 0.96.1

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (110) hide show
  1. package/README.md +64 -15
  2. package/dist/activation-B0ZD7nfX.d.ts +63 -0
  3. package/dist/agent.d.ts +6 -193
  4. package/dist/agent.js +10 -234
  5. package/dist/agent.js.map +1 -1
  6. package/dist/analyst-loop.d.ts +7 -10
  7. package/dist/analyst-loop.js +1 -2
  8. package/dist/candidate-execution/index.d.ts +43 -16
  9. package/dist/candidate-execution/index.js +17 -8
  10. package/dist/{chunk-VYA2YEKA.js → chunk-2KGAN2HM.js} +83 -14
  11. package/dist/chunk-2KGAN2HM.js.map +1 -0
  12. package/dist/chunk-3XKSBI2U.js +474 -0
  13. package/dist/chunk-3XKSBI2U.js.map +1 -0
  14. package/dist/{chunk-TVJQAYQM.js → chunk-6XKPVJAZ.js} +107 -716
  15. package/dist/chunk-6XKPVJAZ.js.map +1 -0
  16. package/dist/chunk-BLQIYRVR.js +699 -0
  17. package/dist/chunk-BLQIYRVR.js.map +1 -0
  18. package/dist/{chunk-QDSOD7RC.js → chunk-FD2MBMOH.js} +13 -101
  19. package/dist/chunk-FD2MBMOH.js.map +1 -0
  20. package/dist/{chunk-U33YZ7B2.js → chunk-FXF2OL34.js} +8 -8
  21. package/dist/{chunk-EP6RVHMX.js → chunk-HZDEXTSL.js} +848 -2
  22. package/dist/chunk-HZDEXTSL.js.map +1 -0
  23. package/dist/{chunk-WIPGQ4GT.js → chunk-IMSNJSXH.js} +1 -1
  24. package/dist/{chunk-WIPGQ4GT.js.map → chunk-IMSNJSXH.js.map} +1 -1
  25. package/dist/{chunk-VSWBYWFK.js → chunk-M6MD6JBS.js} +20 -27
  26. package/dist/chunk-M6MD6JBS.js.map +1 -0
  27. package/dist/chunk-PSOCBNM3.js +2069 -0
  28. package/dist/chunk-PSOCBNM3.js.map +1 -0
  29. package/dist/{chunk-AEG3NGJ2.js → chunk-Q2JSAVQ3.js} +34 -2
  30. package/dist/chunk-Q2JSAVQ3.js.map +1 -0
  31. package/dist/{chunk-XP5KDM3R.js → chunk-SGQ4YIQW.js} +4 -4
  32. package/dist/{chunk-C3UKLQ54.js → chunk-UQ6PNNXM.js} +18 -10
  33. package/dist/chunk-UQ6PNNXM.js.map +1 -0
  34. package/dist/{chunk-33OG2NN3.js → chunk-WYC2XJF2.js} +2 -2
  35. package/dist/{chunk-ZEYAT33L.js → chunk-Y3SRWZMP.js} +2 -2
  36. package/dist/{chunk-CNH7DF7Z.js → chunk-YOLKCWRV.js} +1116 -591
  37. package/dist/chunk-YOLKCWRV.js.map +1 -0
  38. package/dist/{completion-gate-D1gX1-hg.d.ts → completion-gate-C80jiRfN.d.ts} +1 -1
  39. package/dist/conversation.d.ts +12 -1
  40. package/dist/conversation.js +2 -3
  41. package/dist/{coordination-Dr_axlAf.d.ts → coordination-BFE3Den7.d.ts} +10 -11
  42. package/dist/environment-provider.d.ts +2 -2
  43. package/dist/environment-provider.js +1 -2
  44. package/dist/{agentic-generator-DDMM45kZ.d.ts → improve-g75IE2Cx.d.ts} +152 -4
  45. package/dist/{improvement-adapter-BieWeK5J.d.ts → improvement-adapter-HAZz-7vK.d.ts} +8 -31
  46. package/dist/index.d.ts +55 -28
  47. package/dist/index.js +206 -82
  48. package/dist/index.js.map +1 -1
  49. package/dist/intelligence.d.ts +185 -120
  50. package/dist/intelligence.js +509 -345
  51. package/dist/intelligence.js.map +1 -1
  52. package/dist/knowledge.d.ts +40 -12
  53. package/dist/knowledge.js +13 -7
  54. package/dist/{loop-runner-bin-BRQSQdHa.d.ts → loop-runner-bin-Cn1N2rRo.d.ts} +3 -3
  55. package/dist/loop-runner-bin.d.ts +6 -6
  56. package/dist/loop-runner-bin.js +8 -10
  57. package/dist/loops.d.ts +13 -13
  58. package/dist/loops.js +6 -8
  59. package/dist/mcp/bin.js +5 -7
  60. package/dist/mcp/bin.js.map +1 -1
  61. package/dist/mcp/index.d.ts +6 -6
  62. package/dist/mcp/index.js +12 -14
  63. package/dist/mcp/index.js.map +1 -1
  64. package/dist/platform.js +0 -2
  65. package/dist/platform.js.map +1 -1
  66. package/dist/primeintellect/index.js +1 -2
  67. package/dist/primeintellect/index.js.map +1 -1
  68. package/dist/profile-DbfaMTdk.d.ts +233 -0
  69. package/dist/profiles.d.ts +1 -1
  70. package/dist/profiles.js +0 -1
  71. package/dist/profiles.js.map +1 -1
  72. package/dist/{supervise-DmYOug5f.d.ts → supervise-BLPI50-w.d.ts} +3 -3
  73. package/dist/{types-ByAYqlVb.d.ts → types-B3vAW0Oq.d.ts} +1 -1
  74. package/dist/{prepare-CtdtsFNG.d.ts → types-CWqfCO8s.d.ts} +67 -298
  75. package/dist/{types-BC3bZpH0.d.ts → types-CmYCMbFT.d.ts} +12 -54
  76. package/dist/{types-1d5QGK3t.d.ts → types-CmnA2iL3.d.ts} +3 -3
  77. package/dist/{worktree-fanout-CPprU-qI.d.ts → worktree-fanout-DCA3G4bO.d.ts} +3 -3
  78. package/package.json +14 -16
  79. package/skills/build-with-agent-runtime/SKILL.md +122 -213
  80. package/dist/chunk-6O73TRHW.js +0 -142
  81. package/dist/chunk-6O73TRHW.js.map +0 -1
  82. package/dist/chunk-AEG3NGJ2.js.map +0 -1
  83. package/dist/chunk-C3UKLQ54.js.map +0 -1
  84. package/dist/chunk-CNH7DF7Z.js.map +0 -1
  85. package/dist/chunk-D3H7F6L2.js +0 -626
  86. package/dist/chunk-D3H7F6L2.js.map +0 -1
  87. package/dist/chunk-DGUM43GV.js +0 -11
  88. package/dist/chunk-DGUM43GV.js.map +0 -1
  89. package/dist/chunk-EP6RVHMX.js.map +0 -1
  90. package/dist/chunk-HGRW27YY.js +0 -214
  91. package/dist/chunk-HGRW27YY.js.map +0 -1
  92. package/dist/chunk-ISTDY47H.js +0 -849
  93. package/dist/chunk-ISTDY47H.js.map +0 -1
  94. package/dist/chunk-PCURO3DL.js +0 -661
  95. package/dist/chunk-PCURO3DL.js.map +0 -1
  96. package/dist/chunk-QDSOD7RC.js.map +0 -1
  97. package/dist/chunk-TVJQAYQM.js.map +0 -1
  98. package/dist/chunk-VSWBYWFK.js.map +0 -1
  99. package/dist/chunk-VYA2YEKA.js.map +0 -1
  100. package/dist/generator-YkAQrOoD.d.ts +0 -382
  101. package/dist/improve-BN3HyXIO.d.ts +0 -172
  102. package/dist/lifecycle.d.ts +0 -870
  103. package/dist/lifecycle.js +0 -981
  104. package/dist/lifecycle.js.map +0 -1
  105. package/dist/mcp-serve-verifier-DQQDbuyz.d.ts +0 -34
  106. package/skills/agent-runtime-adoption/SKILL.md +0 -246
  107. /package/dist/{chunk-U33YZ7B2.js.map → chunk-FXF2OL34.js.map} +0 -0
  108. /package/dist/{chunk-XP5KDM3R.js.map → chunk-SGQ4YIQW.js.map} +0 -0
  109. /package/dist/{chunk-33OG2NN3.js.map → chunk-WYC2XJF2.js.map} +0 -0
  110. /package/dist/{chunk-ZEYAT33L.js.map → chunk-Y3SRWZMP.js.map} +0 -0
@@ -1,18 +1,21 @@
1
- import { AgentProfile, AgentCandidateBundle, Sha256Digest, AgentProfileDiff, AgentProfileMcpServer } from '@tangle-network/agent-interface';
2
- import { a as LoopTraceEvent } from './types-ByAYqlVb.js';
1
+ import { AgentProfileDiff, AgentProfile, AgentProfileMcpServer, AgentImprovementActivationTarget, AgentImprovementSurface, AgentCandidateExperiment, AgentImprovementActivationIntent, AgentImprovementMeasuredComparison, AgentCandidateExperimentMeasurement, AgentImprovementProposal, AgentImprovementReviewDecision, AgentCandidateBenchmarkCellRef, Sha256Digest, AgentImprovementReview, AgentImprovementActivation, CandidateExecutionEvidence } from '@tangle-network/agent-interface';
2
+ export { AgentImprovementActivation, AgentImprovementActivationIntent, AgentImprovementActivationOutcome, AgentImprovementActivationResult, AgentImprovementMeasuredComparison, AgentImprovementProposal, AgentImprovementReview, AgentImprovementReviewDecision, CandidateExecutionEvidence, AgentCandidateProfileActivation as CandidateProfileMaterialization } from '@tangle-network/agent-interface';
3
+ import { b as LoopTraceEvent } from './types-B3vAW0Oq.js';
3
4
  import { b as ToolSpec, c as RuntimeTelemetryOptions } from './sanitize-BTSsdBXw.js';
4
5
  import { R as RuntimeStreamEvent } from './types-BwoZWq-i.js';
6
+ import { P as PrepareAgentCandidateExecutionOptions, E as ExecutePreparedAgentCandidateOptions, A as AgentCandidateExecutionClaimStore } from './profile-DbfaMTdk.js';
7
+ export { p as parseCandidateProfileMaterialization } from './profile-DbfaMTdk.js';
8
+ export { A as AgentImprovementActivationReconciliation, a as AgentImprovementActivationResultStore, b as AgentImprovementActivationTargetPlan, c as AgentImprovementActivationTransition, d as AgentImprovementActivationTransitionInput, C as CreateAgentImprovementActivationResultOptions, E as ExecuteAgentImprovementActivationInput, e as ExecuteAgentImprovementActivationOptions, f as createAgentImprovementActivationResult, g as executeAgentImprovementActivation, v as verifyAgentImprovementActivationResult } from './activation-B0ZD7nfX.js';
5
9
  import { AnalystFinding } from '@tangle-network/agent-eval/analyst';
6
- import { Scenario, SelfImproveResult } from '@tangle-network/agent-eval/contract';
7
- import { R as RunAnalystLoopOpts, a as RunAnalystLoopResult } from './types-BC3bZpH0.js';
8
- import { A as AgentCandidateBundleInput, a as AgentCandidateTaskExecution, b as AgentCandidateExecutionPorts, P as PrepareAgentCandidateExecutionOptions, E as ExecutePreparedAgentCandidateOptions, c as AgentCandidateRunFinalization } from './prepare-CtdtsFNG.js';
9
- import { I as ImproveSurface, a as ImproveOptions, b as ImproveResult } from './improve-BN3HyXIO.js';
10
- import '@tangle-network/agent-eval';
11
- import '@tangle-network/sandbox';
10
+ import { CandidateExperimentExecutionInput, Scenario, CompareCandidateExperimentOptions } from '@tangle-network/agent-eval/contract';
11
+ import { R as RunAnalystLoopOpts, a as RunAnalystLoopResult } from './types-CmYCMbFT.js';
12
+ import { c as AgentCandidateRunFinalization, d as AgentCandidateTaskExecution, e as AgentCandidateExecutionPorts, a as AgentCandidateBenchmarkGraderPort, b as AgentCandidateOutputArtifactPort, A as AgentCandidateExecutorPort } from './types-CWqfCO8s.js';
13
+ import { I as ImproveOptions, a as ImproveResult } from './improve-g75IE2Cx.js';
14
+ import { TraceStore } from '@tangle-network/agent-eval';
15
+ import { SandboxClient, SandboxResources } from '@tangle-network/sandbox';
12
16
  import '@tangle-network/agent-eval/campaign';
13
17
  import './local-harness-ZqCx51u7.js';
14
18
  import 'node:child_process';
15
- import './agentic-generator-DDMM45kZ.js';
16
19
 
17
20
  /**
18
21
  *
@@ -127,114 +130,6 @@ interface EffortOverridesCompiled {
127
130
  */
128
131
  declare function compileEffort(settings: EffortSettings): EffortOverridesCompiled;
129
132
 
130
- type AgentImprovementEvaluation<TScenario extends Scenario, TArtifact> = Pick<SelfImproveResult<TScenario, TArtifact>, 'baseline' | 'winner' | 'lift' | 'diff' | 'provenance' | 'gateDecision' | 'generationsExplored' | 'durationMs' | 'totalCostUsd' | 'insight' | 'power'>;
131
- interface AgentImprovementProposal<TScenario extends Scenario = Scenario, TArtifact = unknown> {
132
- schemaVersion: 1;
133
- kind: 'agent-improvement-proposal';
134
- runId: string;
135
- surface: ImproveSurface;
136
- proposedAt: string;
137
- baselineProfile: AgentProfile;
138
- baselineProfileHash: string;
139
- candidateProfile: AgentProfile;
140
- candidateProfileHash: string;
141
- findings: AnalystFinding[];
142
- evaluation: AgentImprovementEvaluation<TScenario, TArtifact>;
143
- candidateBundle?: AgentCandidateBundle;
144
- digest: Sha256Digest;
145
- }
146
- type AgentImprovementReviewDecision = 'approve' | 'reject' | 'request-changes';
147
- interface AgentImprovementReview {
148
- schemaVersion: 1;
149
- kind: 'agent-improvement-review';
150
- proposalDigest: Sha256Digest;
151
- candidateBundleDigest?: Sha256Digest;
152
- decision: AgentImprovementReviewDecision;
153
- reviewedBy: string;
154
- reviewedAt: string;
155
- reason: string;
156
- feedback?: string;
157
- digest: Sha256Digest;
158
- }
159
- interface CandidateExecutionEvidence {
160
- proposalDigest: Sha256Digest;
161
- reviewDigest: Sha256Digest;
162
- bundleDigest: Sha256Digest;
163
- executionId: string;
164
- executionPlanDigest: Sha256Digest;
165
- materializationReceiptDigest: Sha256Digest;
166
- succeeded: boolean;
167
- runReceiptDigest?: Sha256Digest;
168
- }
169
- interface ProposeAgentImprovementOptions<TScenario extends Scenario, TArtifact> {
170
- runId: string;
171
- profile: AgentProfile;
172
- analysis: Omit<RunAnalystLoopOpts, 'runId' | 'improvementAdapter' | 'autoApply'>;
173
- improvement: ImproveOptions<TScenario, TArtifact>;
174
- /**
175
- * Optional environment adapter that freezes an executable bundle after the
176
- * measured comparison recommends the candidate. Return the sealed output of
177
- * `buildAgentCandidateBundle` directly, or a low-level digest-free input.
178
- */
179
- buildCandidate?: (input: {
180
- analysis: RunAnalystLoopResult;
181
- improvement: ImproveResult<TScenario, TArtifact>;
182
- }) => AgentCandidateBundleInput | AgentCandidateBundle | Promise<AgentCandidateBundleInput | AgentCandidateBundle>;
183
- now?: () => Date;
184
- }
185
- interface ProposeAgentImprovementResult<TScenario extends Scenario, TArtifact> {
186
- analysis: RunAnalystLoopResult;
187
- improvement: ImproveResult<TScenario, TArtifact>;
188
- proposal: AgentImprovementProposal<TScenario, TArtifact>;
189
- }
190
- interface CreateAgentImprovementProposalOptions<TScenario extends Scenario, TArtifact> {
191
- runId: string;
192
- surface: ImproveSurface;
193
- baselineProfile: AgentProfile;
194
- candidateProfile: AgentProfile;
195
- findings: readonly AnalystFinding[];
196
- evaluation: SelfImproveResult<TScenario, TArtifact>;
197
- candidateBundle?: AgentCandidateBundleInput | AgentCandidateBundle;
198
- now?: () => Date;
199
- }
200
- interface ReviewAgentImprovementInput {
201
- decision: AgentImprovementReviewDecision;
202
- reviewedBy: string;
203
- reason: string;
204
- feedback?: string;
205
- now?: () => Date;
206
- }
207
- interface ExecuteApprovedAgentCandidateOptions {
208
- proposal: AgentImprovementProposal;
209
- review: AgentImprovementReview;
210
- /** Product-owned authentication check for the persisted approval record. */
211
- authorizeReview: (review: AgentImprovementReview, proposal: AgentImprovementProposal) => boolean | Promise<boolean>;
212
- task: AgentCandidateTaskExecution;
213
- ports: AgentCandidateExecutionPorts;
214
- preparation?: PrepareAgentCandidateExecutionOptions;
215
- execution: ExecutePreparedAgentCandidateOptions;
216
- }
217
- interface ExecuteApprovedAgentCandidateResult {
218
- finalization: AgentCandidateRunFinalization;
219
- evidence: CandidateExecutionEvidence;
220
- }
221
- /** Analyze one run and produce one measured, review-only improvement proposal. */
222
- declare function proposeAgentImprovement<TScenario extends Scenario, TArtifact>(options: ProposeAgentImprovementOptions<TScenario, TArtifact>): Promise<ProposeAgentImprovementResult<TScenario, TArtifact>>;
223
- /**
224
- * Freeze an already-measured improvement into the one reviewable proposal
225
- * contract. Products that run analysis or evaluation in separate workers use
226
- * this constructor instead of rerunning either phase or rebuilding digests.
227
- */
228
- declare function createAgentImprovementProposal<TScenario extends Scenario, TArtifact>(options: CreateAgentImprovementProposalOptions<TScenario, TArtifact>): AgentImprovementProposal<TScenario, TArtifact>;
229
- /** Persist an approve/reject/change-request decision bound to one exact proposal. */
230
- declare function reviewAgentImprovementProposal(inputProposal: AgentImprovementProposal, input: ReviewAgentImprovementInput): AgentImprovementReview;
231
- /** Verify, materialize, run, grade, and receipt only the exact approved bundle. */
232
- declare function executeApprovedAgentCandidate(options: ExecuteApprovedAgentCandidateOptions): Promise<ExecuteApprovedAgentCandidateResult>;
233
- /** Validate a proposal's schema, profile, sealed bundle, and canonical digest. */
234
- declare function verifyAgentImprovementProposal(input: unknown): AgentImprovementProposal;
235
- /** Validate a review's decision fields and canonical digest. */
236
- declare function verifyAgentImprovementReview(input: unknown): AgentImprovementReview;
237
-
238
133
  /**
239
134
  *
240
135
  * Redaction for Intelligence trace export. The trace carries the customer's
@@ -737,6 +632,122 @@ declare class CapabilityNotAdmittedError extends Error {
737
632
  */
738
633
  declare function manifestFromProfile(profile: CertifiedProfile): CapabilityManifest;
739
634
 
635
+ type AgentImprovementActivationTargetIdentity = Pick<AgentImprovementActivationTarget, 'surface' | 'identity'>;
636
+ /** Bind caller-owned target identities to the exact source state Runtime measured. */
637
+ declare function buildAgentImprovementActivationTargets(surfaces: readonly AgentImprovementSurface[], experiment: AgentCandidateExperiment, intent: AgentImprovementActivationIntent, identities: readonly AgentImprovementActivationTargetIdentity[]): [AgentImprovementActivationTarget, ...AgentImprovementActivationTarget[]];
638
+
639
+ interface AgentCandidateExperimentCellPlacement {
640
+ executionId: string;
641
+ attempt?: number;
642
+ executionRoots: AgentCandidateTaskExecution['executionRoots'];
643
+ stagingRoots: AgentCandidateTaskExecution['stagingRoots'];
644
+ ports: AgentCandidateExecutionPorts;
645
+ preparation?: PrepareAgentCandidateExecutionOptions;
646
+ execution: ExecutePreparedAgentCandidateOptions;
647
+ }
648
+ interface RunAgentCandidateExperimentOptions extends Omit<CompareCandidateExperimentOptions, 'experiment' | 'measurements'> {
649
+ experiment: AgentCandidateExperiment;
650
+ placeCell: (input: CandidateExperimentExecutionInput) => AgentCandidateExperimentCellPlacement | Promise<AgentCandidateExperimentCellPlacement>;
651
+ maxConcurrency?: number;
652
+ signal?: AbortSignal;
653
+ }
654
+ interface RunAgentCandidateExperimentResult {
655
+ experiment: AgentCandidateExperiment;
656
+ measurements: AgentCandidateExperimentMeasurement[];
657
+ evaluation: AgentImprovementMeasuredComparison;
658
+ }
659
+ interface ExecuteAgentCandidateExperimentCellOptions extends CandidateExperimentExecutionInput, AgentCandidateExperimentCellPlacement {
660
+ }
661
+ interface VerifyCandidateExecutionEvidenceOptions {
662
+ experiment: AgentCandidateExperiment;
663
+ arm: 'baseline' | 'candidate';
664
+ benchmarkCell: AgentCandidateBenchmarkCellRef;
665
+ seed: number;
666
+ attempt?: number;
667
+ resolvedResources?: ReadonlyMap<Sha256Digest, string>;
668
+ }
669
+ /** A failed baseline or candidate cell with its complete Runtime failure result. */
670
+ declare class AgentCandidateExperimentCellExecutionError extends Error {
671
+ readonly finalization: Extract<AgentCandidateRunFinalization, {
672
+ succeeded: false;
673
+ }>;
674
+ constructor(finalization: Extract<AgentCandidateRunFinalization, {
675
+ succeeded: false;
676
+ }>);
677
+ }
678
+ interface CreateAgentImprovementProposalOptions {
679
+ runId: string;
680
+ findings: readonly AnalystFinding[];
681
+ evaluation: AgentImprovementMeasuredComparison;
682
+ now?: () => Date;
683
+ }
684
+ type CreateAgentImprovementMeasuredComparisonOptions = CompareCandidateExperimentOptions;
685
+ interface ReviewAgentImprovementInput {
686
+ decision: AgentImprovementReviewDecision;
687
+ reviewedBy: string;
688
+ reason: string;
689
+ feedback?: string;
690
+ now?: () => Date;
691
+ }
692
+ interface CreateAgentImprovementActivationOptions {
693
+ intent: AgentImprovementActivationIntent;
694
+ /** Runtime derives each exact source digest; callers identify only the records to change. */
695
+ targets: [AgentImprovementActivationTargetIdentity, ...AgentImprovementActivationTargetIdentity[]];
696
+ fundingOwner: string;
697
+ authorizedBy: string;
698
+ expiresAt: string;
699
+ now?: () => Date;
700
+ }
701
+ interface ProposeAgentImprovementOptions<TScenario extends Scenario, TArtifact> {
702
+ runId: string;
703
+ profile: AgentProfile;
704
+ analysis: Omit<RunAnalystLoopOpts, 'runId' | 'improvementProposalSource'>;
705
+ improvement: ImproveOptions<TScenario, TArtifact>;
706
+ buildExperiment: (input: {
707
+ analysis: RunAnalystLoopResult;
708
+ improvement: ImproveResult<TScenario, TArtifact>;
709
+ }) => AgentCandidateExperiment | Promise<AgentCandidateExperiment>;
710
+ placeCell: RunAgentCandidateExperimentOptions['placeCell'];
711
+ maxConcurrency?: number;
712
+ signal?: AbortSignal;
713
+ candidate?: AgentImprovementMeasuredComparison['candidate'];
714
+ metadata?: AgentImprovementMeasuredComparison['metadata'];
715
+ now?: () => Date;
716
+ }
717
+ interface ProposeAgentImprovementResult<TScenario extends Scenario, TArtifact> {
718
+ analysis: RunAnalystLoopResult;
719
+ improvement: ImproveResult<TScenario, TArtifact>;
720
+ experiment: AgentCandidateExperiment;
721
+ measurements: AgentCandidateExperimentMeasurement[];
722
+ proposal: AgentImprovementProposal;
723
+ }
724
+ /** Execute both arms of one immutable experiment and derive its paired result. */
725
+ declare function runAgentCandidateExperiment(options: RunAgentCandidateExperimentOptions): Promise<RunAgentCandidateExperimentResult>;
726
+ /** Execute one exact arm, task, repetition, seed, and attempt through Runtime. */
727
+ declare function executeAgentCandidateExperimentCell(options: ExecuteAgentCandidateExperimentCellOptions): Promise<CandidateExecutionEvidence>;
728
+ /** Delegate all statistics and promotion checks to agent-eval's receipt-based comparison. */
729
+ declare function createAgentImprovementMeasuredComparison(options: CreateAgentImprovementMeasuredComparisonOptions): AgentImprovementMeasuredComparison;
730
+ /** Analyze, search, then remeasure the resulting exact candidate before proposing it. */
731
+ declare function proposeAgentImprovement<TScenario extends Scenario, TArtifact>(options: ProposeAgentImprovementOptions<TScenario, TArtifact>): Promise<ProposeAgentImprovementResult<TScenario, TArtifact>>;
732
+ /** Create the reviewable record only from a complete, recomputable experiment result. */
733
+ declare function createAgentImprovementProposal(options: CreateAgentImprovementProposalOptions): AgentImprovementProposal;
734
+ /** Persist a human or tenant-policy decision bound to one exact proposal. */
735
+ declare function reviewAgentImprovementProposal(inputProposal: AgentImprovementProposal, input: ReviewAgentImprovementInput): AgentImprovementReview;
736
+ /** Authorize product-owned writes only after the exact candidate was measured and approved. */
737
+ declare function createAgentImprovementActivation(inputProposal: AgentImprovementProposal, inputReview: AgentImprovementReview, options: CreateAgentImprovementActivationOptions): AgentImprovementActivation;
738
+ /** Validate a proposal and recompute every binding to its measured experiment. */
739
+ declare function verifyAgentImprovementProposal(input: unknown): AgentImprovementProposal;
740
+ /** Validate the canonical identity and wire shape of an improvement review. */
741
+ declare function verifyAgentImprovementReview(input: unknown): AgentImprovementReview;
742
+ /** Validate activation authority against the exact proposal, review, experiment, and base state. */
743
+ declare function verifyAgentImprovementActivation(input: {
744
+ proposal: unknown;
745
+ review: unknown;
746
+ activation: unknown;
747
+ }): AgentImprovementActivation;
748
+ /** Recheck one Runtime receipt against its exact signed experiment cell. */
749
+ declare function verifyCandidateExecutionEvidence(input: unknown, options: VerifyCandidateExecutionEvidenceOptions): CandidateExecutionEvidence;
750
+
740
751
  /**
741
752
  *
742
753
  * The capability resolver — the ONLY place that knows binding kinds. It lowers a
@@ -845,6 +856,59 @@ declare function composeCertifiedProfileFromWire(base: {
845
856
  systemPrompt: string;
846
857
  }, profile: CertifiedProfile | null, ctx?: ResolveCtx): Promise<ResolvedSurface>;
847
858
 
859
+ type SandboxClientPort = Pick<SandboxClient, 'create' | 'get' | 'list'>;
860
+ /** Declares the exact candidate surfaces the sandbox executor can run. */
861
+ declare const sandboxCandidateExperimentExecutionSupport: Readonly<{
862
+ outcomes: readonly ["output"];
863
+ outputMediaTypes: readonly ["text/*", "application/json", "*+json"];
864
+ code: readonly ["disabled"];
865
+ memory: readonly ["disabled"];
866
+ knowledge: true;
867
+ profile: Readonly<{
868
+ mcpTransports: readonly ["stdio"];
869
+ remoteMcp: false;
870
+ tools: false;
871
+ permissions: false;
872
+ modes: false;
873
+ confidential: false;
874
+ }>;
875
+ isolation: Readonly<{
876
+ freshSandbox: true;
877
+ exactProcess: true;
878
+ egress: readonly ["blocked", "strict"];
879
+ }>;
880
+ }>;
881
+ interface CreateSandboxCandidateExperimentExecutorOptions {
882
+ client: SandboxClientPort;
883
+ ports: AgentCandidateExecutionPorts;
884
+ grader: AgentCandidateBenchmarkGraderPort;
885
+ outputArtifacts: AgentCandidateOutputArtifactPort;
886
+ traceStore: TraceStore;
887
+ claimStore: AgentCandidateExecutionClaimStore;
888
+ sandbox?: {
889
+ teamId?: string;
890
+ resources?: SandboxResources;
891
+ createTimeoutMs?: number;
892
+ evidenceRetentionSeconds?: number;
893
+ };
894
+ cleanupTimeoutMs?: number;
895
+ resultTimeoutMs?: number;
896
+ }
897
+ interface SandboxCandidateExperimentExecution extends CandidateExperimentExecutionInput {
898
+ executionId: string;
899
+ attempt?: number;
900
+ executionRoots: AgentCandidateExperimentCellPlacement['executionRoots'];
901
+ stagingRoots: AgentCandidateExperimentCellPlacement['stagingRoots'];
902
+ preparation?: PrepareAgentCandidateExecutionOptions;
903
+ }
904
+ interface SandboxCandidateExperimentExecutor {
905
+ /** The same port is usable by Runtime's expired-claim recovery path. */
906
+ readonly executor: AgentCandidateExecutorPort;
907
+ execute(input: SandboxCandidateExperimentExecution): Promise<CandidateExecutionEvidence>;
908
+ }
909
+ /** Execute one signed experiment cell inside a fresh Tangle sandbox. */
910
+ declare function createSandboxCandidateExperimentExecutor(options: CreateSandboxCandidateExperimentExecutorOptions): SandboxCandidateExperimentExecutor;
911
+
848
912
  /**
849
913
  *
850
914
  * `withIntelligence` — the ONE agent-runtime hook that unifies Tangle
@@ -947,8 +1011,9 @@ declare function withIntelligence<I, O>(agent: IntelligenceAgent<I, O>, config:
947
1011
  * Tangle Intelligence SDK — trace capture plus reviewable improvement.
948
1012
  *
949
1013
  * The client keeps live-agent trace delivery best-effort. The separate
950
- * improvement-cycle exports analyze completed traces, measure one candidate,
951
- * bind human review, and execute only an approved immutable bundle.
1014
+ * improvement-cycle exports analyze completed traces, run a signed baseline
1015
+ * versus candidate experiment, bind review to its result, and activate only
1016
+ * the exact measured candidate.
952
1017
  *
953
1018
  * 1. OBSERVE — wrap a generic agent and export one trace span per call to
954
1019
  * Tangle Intelligence, swallowing every export failure so a live agent
@@ -1231,4 +1296,4 @@ interface DoctorReport {
1231
1296
  */
1232
1297
  declare function createIntelligenceClient(config: IntelligenceConfig): IntelligenceClient;
1233
1298
 
1234
- export { type AgentImprovementEvaluation, type AgentImprovementProposal, type AgentImprovementReview, type AgentImprovementReviewDecision, type AppliedIntelligence, type CandidateExecutionEvidence, type CapabilityAuth, type CapabilityInterface, type CapabilityManifest, CapabilityNotAdmittedError, type CapabilitySurface, type CertProvenance, type CertifiedArtifact, type CertifiedCapability, type CertifiedCapabilitySummary, type CertifiedProfile, type CertifiedPromptSource, type CertifiedPromptSourceOptions, type CertifiedPromptSurface, type ContentRef, type CorpusAccess, type CreateAgentImprovementProposalOptions, type CredentialRef, type DeliveryBinding, type DeliveryBindingKind, type DiffProvenance, type DoctorReport, type EffortOverrides, type EffortOverridesCompiled, type EffortSettings, type EffortTier, type ExecuteApprovedAgentCandidateOptions, type ExecuteApprovedAgentCandidateResult, type HostSpec, type IntelligenceAgent, type IntelligenceClient, type IntelligenceConfig, type IntelligenceHookConfig, type IntelligenceWrapped, type JsonSchema, type ModeReadiness, type ProposeAgentImprovementOptions, type ProposeAgentImprovementResult, type ProposedProfileDiff, type ProvisionedHost, type PullCertifiedOptions, type PullOutcome, type RecordTraceMeta, type Redactor, type RepoConfig, type ResolveCtx, type ResolvedHook, type ResolvedRetrieval, type ResolvedSubagent, type ResolvedSurface, type ReviewAgentImprovementInput, type RunRecord, type RunReport, type TraceHandle, type TraceMeta, type TraceOutcome, type UsageClass, type UsageSplit, compileEffort, composeCertifiedProfile, composeCertifiedProfileFromWire, composeCertifiedPrompt, createAgentImprovementProposal, createCertifiedPromptSource, createIntelligenceClient, defaultEffortTier, defaultRedactor, executeApprovedAgentCandidate, isIntelligenceOff, manifestFromProfile, normalizeCertifiedProfile, proposeAgentImprovement, pullCertified, resolveEffort, resolveIntelligenceBaseUrl, resolveRedactor, reviewAgentImprovementProposal, verifyAgentImprovementProposal, verifyAgentImprovementReview, withIntelligence };
1299
+ export { AgentCandidateExperimentCellExecutionError, type AgentCandidateExperimentCellPlacement, type AgentImprovementActivationTargetIdentity, type AppliedIntelligence, type CapabilityAuth, type CapabilityInterface, type CapabilityManifest, CapabilityNotAdmittedError, type CapabilitySurface, type CertProvenance, type CertifiedArtifact, type CertifiedCapability, type CertifiedCapabilitySummary, type CertifiedProfile, type CertifiedPromptSource, type CertifiedPromptSourceOptions, type CertifiedPromptSurface, type ContentRef, type CorpusAccess, type CreateAgentImprovementActivationOptions, type CreateAgentImprovementProposalOptions, type CreateSandboxCandidateExperimentExecutorOptions, type CredentialRef, type DeliveryBinding, type DeliveryBindingKind, type DiffProvenance, type DoctorReport, type EffortOverrides, type EffortOverridesCompiled, type EffortSettings, type EffortTier, type ExecuteAgentCandidateExperimentCellOptions, type HostSpec, type IntelligenceAgent, type IntelligenceClient, type IntelligenceConfig, type IntelligenceHookConfig, type IntelligenceWrapped, type JsonSchema, type ModeReadiness, type ProposeAgentImprovementOptions, type ProposeAgentImprovementResult, type ProposedProfileDiff, type ProvisionedHost, type PullCertifiedOptions, type PullOutcome, type RecordTraceMeta, type Redactor, type RepoConfig, type ResolveCtx, type ResolvedHook, type ResolvedRetrieval, type ResolvedSubagent, type ResolvedSurface, type ReviewAgentImprovementInput, type RunAgentCandidateExperimentOptions, type RunAgentCandidateExperimentResult, type RunRecord, type RunReport, type SandboxCandidateExperimentExecution, type SandboxCandidateExperimentExecutor, type TraceHandle, type TraceMeta, type TraceOutcome, type UsageClass, type UsageSplit, type VerifyCandidateExecutionEvidenceOptions, buildAgentImprovementActivationTargets, compileEffort, composeCertifiedProfile, composeCertifiedProfileFromWire, composeCertifiedPrompt, createAgentImprovementActivation, createAgentImprovementMeasuredComparison, createAgentImprovementProposal, createCertifiedPromptSource, createIntelligenceClient, createSandboxCandidateExperimentExecutor, defaultEffortTier, defaultRedactor, executeAgentCandidateExperimentCell, isIntelligenceOff, manifestFromProfile, normalizeCertifiedProfile, proposeAgentImprovement, pullCertified, resolveEffort, resolveIntelligenceBaseUrl, resolveRedactor, reviewAgentImprovementProposal, runAgentCandidateExperiment, sandboxCandidateExperimentExecutionSupport, verifyAgentImprovementActivation, verifyAgentImprovementProposal, verifyAgentImprovementReview, verifyCandidateExecutionEvidence, withIntelligence };