openpond-sdk 0.2.4 → 0.2.5

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
@@ -0,0 +1,351 @@
1
+ import { type LearningTextAsset } from "@openpond/evals/learning";
2
+ import { type RewardBinding, type RewardRelease } from "@openpond/evals/rewards";
3
+ import type { TasksetPackage } from "./taskset-package-contracts.js";
4
+ import type { ModelBatchReviewRequest } from "./model-batch-review-contracts.js";
5
+ /** Hosts supply the authorized package and selected Reward graph. Only this
6
+ * new namespace becomes editable; parent sources and decisions are not copied. */
7
+ export declare function prepareModelBatchReview(input: {
8
+ scope: string;
9
+ request: ModelBatchReviewRequest;
10
+ package: TasksetPackage;
11
+ now: string;
12
+ binding: RewardBinding;
13
+ rewards: RewardRelease[];
14
+ assets: LearningTextAsset[];
15
+ }): {
16
+ source: {
17
+ schemaVersion: "openpond.learningSource.v1";
18
+ id: string;
19
+ revision: number;
20
+ name: string;
21
+ kind: "work" | "provider" | "direct" | "benchmark" | "opentelemetry";
22
+ taskDefinition: {
23
+ id: string;
24
+ contentHash: string;
25
+ revision: number;
26
+ };
27
+ enabled: boolean;
28
+ allowedSplits: ("train" | "validation" | "test" | "frozen_eval")[];
29
+ mapping: {
30
+ schemaVersion: "openpond.taskSourceMapping.v1";
31
+ exampleId: string;
32
+ attemptId: string;
33
+ occurredAt: string;
34
+ input: string;
35
+ observedOutput: string | null;
36
+ expected: string | null;
37
+ evaluatorContext: string | null;
38
+ familyKey: string;
39
+ split: "train" | "validation" | "test" | "frozen_eval";
40
+ } | null;
41
+ adapterVersion: string | null;
42
+ contentHash: string;
43
+ reviewOrigin?: {
44
+ modelId: string;
45
+ packageHash: string;
46
+ taskset: {
47
+ id: string;
48
+ contentHash: string;
49
+ revision: number;
50
+ };
51
+ batch: {
52
+ id: string;
53
+ contentHash: string;
54
+ revision: number;
55
+ };
56
+ rewardBinding: {
57
+ id: string;
58
+ contentHash: string;
59
+ revision: number;
60
+ };
61
+ } | undefined;
62
+ };
63
+ definition: {
64
+ schemaVersion: "openpond.taskDefinition.v1";
65
+ id: string;
66
+ revision: number;
67
+ name: string;
68
+ description: string;
69
+ instructions: string;
70
+ category: "custom" | "structured" | "question_answering" | "coding" | "tool_workflow";
71
+ familyNamespace: string;
72
+ inputSchema: Record<string, unknown>;
73
+ outputSchema: Record<string, unknown>;
74
+ rewardBinding: {
75
+ id: string;
76
+ contentHash: string;
77
+ revision: number;
78
+ };
79
+ harness: {
80
+ id: string;
81
+ contentHash: string;
82
+ } | null;
83
+ execution: {
84
+ policy: {
85
+ policyVisibleFields: string[];
86
+ privilegedFields: string[];
87
+ hiddenGraderRefs: string[];
88
+ connectedAppScopes: string[];
89
+ };
90
+ environment: {
91
+ protocolVersion: "openpond.environment.v1";
92
+ kind: "text" | "work" | "agent" | "custom_program";
93
+ entrypoint: string;
94
+ stateful: boolean;
95
+ deterministicSeeds: boolean;
96
+ lifecycle: ("create" | "reset" | "step" | "collect" | "destroy")[];
97
+ networkPolicy: "none" | "declared_read_only" | "declared_scoped";
98
+ defaultTimeoutMs: number;
99
+ };
100
+ tools: {
101
+ name: string;
102
+ description: string;
103
+ inputSchema: Record<string, unknown>;
104
+ inputSchemaHash: string;
105
+ sideEffect: "read" | "write";
106
+ timeoutMs: number;
107
+ }[];
108
+ capabilities: {
109
+ id: string;
110
+ required: boolean;
111
+ scopes: string[];
112
+ portability: "portable" | "host_adapter" | "local_only" | "hosted_only";
113
+ }[];
114
+ environmentRelease?: {
115
+ id: string;
116
+ contentHash: string;
117
+ } | undefined;
118
+ verifierSetRelease?: {
119
+ id: string;
120
+ contentHash: string;
121
+ } | undefined;
122
+ };
123
+ contentHash: string;
124
+ };
125
+ binding: {
126
+ schemaVersion: "openpond.rewardBinding.v1";
127
+ id: string;
128
+ revision: number;
129
+ sources: {
130
+ graderId: string;
131
+ reward: {
132
+ id: string;
133
+ contentHash: string;
134
+ revision: number;
135
+ };
136
+ role: "evaluation" | "training";
137
+ normalization: {
138
+ kind: "identity";
139
+ } | {
140
+ kind: "linear";
141
+ minimum: number;
142
+ maximum: number;
143
+ direction: "higher" | "lower";
144
+ };
145
+ weight: number;
146
+ required: boolean;
147
+ hardGate: boolean;
148
+ privileged: boolean;
149
+ fixtureRefs: {
150
+ id: string;
151
+ contentHash: string;
152
+ }[];
153
+ }[];
154
+ aggregation: "weighted_mean";
155
+ unscorable: "exclude_optional_require_all_required";
156
+ contentHash: string;
157
+ name?: string | undefined;
158
+ description?: string | undefined;
159
+ recipeRef?: {
160
+ id: string;
161
+ contentHash: string;
162
+ revision: number;
163
+ } | undefined;
164
+ };
165
+ rewards: {
166
+ schemaVersion: "openpond.rewardRelease.v1";
167
+ id: string;
168
+ revision: number;
169
+ name: string;
170
+ description: string;
171
+ implementation: {
172
+ kind: "state" | "content" | "schema" | "artifact" | "runtime_event";
173
+ config: Record<string, unknown>;
174
+ } | {
175
+ kind: "model_judge";
176
+ rubricRef: {
177
+ id: string;
178
+ path: string;
179
+ contentHash: string;
180
+ sizeBytes: number;
181
+ mediaType: string;
182
+ visibility: "policy" | "verifier" | "host_private";
183
+ };
184
+ calibrationStatus: "failed" | "pending" | "passed";
185
+ model?: {
186
+ providerId: string;
187
+ modelId: string;
188
+ revision: string | null;
189
+ } | undefined;
190
+ temperature?: number | undefined;
191
+ } | {
192
+ kind: "custom_verifier";
193
+ networkPolicy: "none";
194
+ verifierRef: {
195
+ id: string;
196
+ path: string;
197
+ contentHash: string;
198
+ sizeBytes: number;
199
+ mediaType: string;
200
+ visibility: "policy" | "verifier" | "host_private";
201
+ };
202
+ timeoutMs: number;
203
+ exportName?: string | undefined;
204
+ } | {
205
+ kind: "human";
206
+ rubricRef: {
207
+ id: string;
208
+ path: string;
209
+ contentHash: string;
210
+ sizeBytes: number;
211
+ mediaType: string;
212
+ visibility: "policy" | "verifier" | "host_private";
213
+ };
214
+ reviewerRole: string;
215
+ } | {
216
+ kind: "learned_model";
217
+ modelVersion: {
218
+ id: string;
219
+ contentHash: string;
220
+ };
221
+ inputContract: {
222
+ id: string;
223
+ path: string;
224
+ contentHash: string;
225
+ sizeBytes: number;
226
+ mediaType: string;
227
+ visibility: "policy" | "verifier" | "host_private";
228
+ };
229
+ };
230
+ rawScore: {
231
+ minimum: number;
232
+ maximum: number;
233
+ };
234
+ assets: {
235
+ id: string;
236
+ path: string;
237
+ contentHash: string;
238
+ sizeBytes: number;
239
+ mediaType: string;
240
+ visibility: "policy" | "verifier" | "host_private";
241
+ }[];
242
+ contentHash: string;
243
+ fixtureSetRef?: {
244
+ id: string;
245
+ path: string;
246
+ contentHash: string;
247
+ sizeBytes: number;
248
+ mediaType: string;
249
+ visibility: "policy" | "verifier" | "host_private";
250
+ } | undefined;
251
+ }[];
252
+ assets: {
253
+ schemaVersion: "openpond.learningTextAsset.v1";
254
+ id: string;
255
+ revision: 1;
256
+ asset: {
257
+ id: string;
258
+ path: string;
259
+ contentHash: string;
260
+ sizeBytes: number;
261
+ mediaType: string;
262
+ visibility: "policy" | "verifier" | "host_private";
263
+ };
264
+ text: string;
265
+ contentHash: string;
266
+ }[];
267
+ evidence: {
268
+ schemaVersion: "openpond.taskEvidence.v1";
269
+ id: string;
270
+ revision: number;
271
+ source: {
272
+ id: string;
273
+ contentHash: string;
274
+ revision: number;
275
+ };
276
+ submission: {
277
+ schemaVersion: "openpond.taskExample.v1";
278
+ sourceId: string;
279
+ idempotencyKey: string;
280
+ taskDefinition: {
281
+ id: string;
282
+ contentHash: string;
283
+ revision: number;
284
+ };
285
+ exampleId: string;
286
+ attemptId: string;
287
+ occurredAt: string;
288
+ familyKey: string | null;
289
+ split: "train" | "validation" | "test" | "frozen_eval";
290
+ input: Record<string, import("zod").JSONType>;
291
+ observedOutput: Record<string, import("zod").JSONType> | null;
292
+ expected: Record<string, import("zod").JSONType> | null;
293
+ evaluatorContext: Record<string, import("zod").JSONType> | null;
294
+ assets: {
295
+ id: string;
296
+ path: string;
297
+ contentHash: string;
298
+ sizeBytes: number;
299
+ mediaType: string;
300
+ visibility: "policy" | "verifier" | "host_private";
301
+ }[];
302
+ provenance: {
303
+ sourceRecordRef: string | null;
304
+ mappingHash: string | null;
305
+ };
306
+ };
307
+ supersedes: {
308
+ id: string;
309
+ contentHash: string;
310
+ revision: number;
311
+ } | null;
312
+ correctionFeedbackId: string | null;
313
+ receivedAt: string;
314
+ contentHash: string;
315
+ }[];
316
+ proposals: {
317
+ schemaVersion: "openpond.taskFeedbackRecord.v1";
318
+ id: string;
319
+ submission: {
320
+ schemaVersion: "openpond.taskFeedback.v1";
321
+ sourceId: string;
322
+ idempotencyKey: string;
323
+ exampleId: string;
324
+ attemptId: string;
325
+ expectedEvidenceHash: string | null;
326
+ occurredAt: string;
327
+ kind: "outcome" | "target_correction" | "ground_truth_correction" | "input_correction" | "family_resolution";
328
+ value: Record<string, import("zod").JSONType>;
329
+ note: string;
330
+ };
331
+ status: "rejected" | "applied" | "superseded" | "pending_example" | "pending_review";
332
+ evidence: {
333
+ id: string;
334
+ contentHash: string;
335
+ revision: number;
336
+ } | null;
337
+ createdAt: string;
338
+ revision: number;
339
+ review: {
340
+ actorId: string;
341
+ decision: {
342
+ id: string;
343
+ contentHash: string;
344
+ revision: number;
345
+ } | null;
346
+ note: string;
347
+ resolvedAt: string;
348
+ } | null;
349
+ }[];
350
+ };
351
+ //# sourceMappingURL=model-batch-review-preparation.d.ts.map
@@ -0,0 +1 @@
1
+ {"version":3,"file":"model-batch-review-preparation.d.ts","sourceRoot":"","sources":["../../../../../src/model-batch-review-preparation.ts"],"names":[],"mappings":"AACA,OAAO,EAE8C,KAAK,iBAAiB,EAAE,MAAM,0BAA0B,CAAC;AAC9G,OAAO,EAAsF,KAAK,aAAa,EAAE,KAAK,aAAa,EAAE,MAAM,yBAAyB,CAAC;AACrK,OAAO,KAAK,EAAE,cAAc,EAAE,MAAM,gCAAgC,CAAC;AACrE,OAAO,KAAK,EAAE,uBAAuB,EAAE,MAAM,mCAAmC,CAAC;AAEjF;kFACkF;AAClF,wBAAgB,uBAAuB,CAAC,KAAK,EAAE;IAC7C,KAAK,EAAE,MAAM,CAAC;IAAC,OAAO,EAAE,uBAAuB,CAAC;IAAC,OAAO,EAAE,cAAc,CAAC;IAAC,GAAG,EAAE,MAAM,CAAC;IACtF,OAAO,EAAE,aAAa,CAAC;IAAC,OAAO,EAAE,aAAa,EAAE,CAAC;IAAC,MAAM,EAAE,iBAAiB,EAAE,CAAC;CAC/E;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;EAsFA"}