@avallon-labs/mcp 50.3.0 → 50.4.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
package/dist/index.js CHANGED
@@ -46,5 +46,5 @@ function setupFetch() {
46
46
 
47
47
  // src/index.ts
48
48
  setupFetch();
49
- await import("./server-7RPXVFML.js");
49
+ await import("./server-NVU3VZZX.js");
50
50
  //# sourceMappingURL=index.js.map
@@ -1418,12 +1418,20 @@ var createWorkerEvalFromRun = async (workerRunId, createWorkerEvalFromRunBody, o
1418
1418
  var getRunEvalUrl = (evalId) => {
1419
1419
  return `/v1/evals/${evalId}/runs`;
1420
1420
  };
1421
- var runEval = async (evalId, options) => {
1421
+ var runEval = async (evalId, runEvalBody, options) => {
1422
+ const getHeaders = (h) => {
1423
+ if (!h) return {};
1424
+ if (h instanceof Headers) return Object.fromEntries(h.entries());
1425
+ if (Array.isArray(h)) return Object.fromEntries(h);
1426
+ return h;
1427
+ };
1422
1428
  const res = await fetch(
1423
1429
  getRunEvalUrl(evalId),
1424
1430
  {
1425
1431
  ...options,
1426
- method: "POST"
1432
+ method: "POST",
1433
+ headers: { "Content-Type": "application/json", ...getHeaders(options?.headers) },
1434
+ body: JSON.stringify(runEvalBody)
1427
1435
  }
1428
1436
  );
1429
1437
  const body = [204, 205, 304].includes(res.status) ? null : await res.text();
@@ -4922,7 +4930,7 @@ var createWorkerEvalFromRunHandler = async (args, options) => {
4922
4930
  };
4923
4931
  };
4924
4932
  var runEvalHandler = async (args, options) => {
4925
- const res = await runEval(args.pathParams.evalId, options);
4933
+ const res = await runEval(args.pathParams.evalId, args.bodyParams, options);
4926
4934
  if (res.status >= 400) {
4927
4935
  return {
4928
4936
  content: [
@@ -8807,17 +8815,9 @@ var CreateWorkerEvalFromRunParams = zod.object({
8807
8815
  "workerRunId": zod.string().uuid()
8808
8816
  });
8809
8817
  var createWorkerEvalFromRunBodyNameMax = 200;
8810
- var createWorkerEvalFromRunBodyToolMocksItemDescriptionDefault = `Mocked tool available during an evaluation.`;
8811
8818
  var createWorkerEvalFromRunBodyGraderCriterionMax = 1e4;
8812
8819
  var CreateWorkerEvalFromRunBody = zod.object({
8813
8820
  "name": zod.string().min(1).max(createWorkerEvalFromRunBodyNameMax),
8814
- "tool_mocks": zod.array(zod.object({
8815
- "mcp_type": zod.string().min(1),
8816
- "tool_name": zod.string().min(1),
8817
- "description": zod.string().default(createWorkerEvalFromRunBodyToolMocksItemDescriptionDefault),
8818
- "input_schema": zod.record(zod.string(), zod.unknown()),
8819
- "responses": zod.array(zod.unknown()).min(1)
8820
- })).min(1),
8821
8821
  "grader": zod.object({
8822
8822
  "type": zod.literal("prompt"),
8823
8823
  "criterion": zod.string().min(1).max(createWorkerEvalFromRunBodyGraderCriterionMax)
@@ -8847,7 +8847,11 @@ var CreateWorkerEvalFromRunResponse = zod.object({
8847
8847
  "tool_name": zod.string(),
8848
8848
  "description": zod.string(),
8849
8849
  "input_schema": zod.record(zod.string(), zod.unknown()),
8850
- "responses": zod.array(zod.unknown())
8850
+ "match": zod.record(zod.string(), zod.unknown()).optional(),
8851
+ "logical_tool_name": zod.union([zod.string(), zod.null()]),
8852
+ "responses": zod.array(zod.unknown()),
8853
+ "inputs": zod.array(zod.unknown()).optional(),
8854
+ "default": zod.unknown().optional()
8851
8855
  })),
8852
8856
  "grader": zod.object({
8853
8857
  "type": zod.literal("prompt"),
@@ -8860,6 +8864,10 @@ var CreateWorkerEvalFromRunResponse = zod.object({
8860
8864
  var RunEvalParams = zod.object({
8861
8865
  "evalId": zod.string().uuid()
8862
8866
  });
8867
+ var runEvalBodyWorkerVersionMax = 9007199254740991;
8868
+ var RunEvalBody = zod.object({
8869
+ "worker_version": zod.number().int().min(1).max(runEvalBodyWorkerVersionMax)
8870
+ });
8863
8871
  var runEvalResponseDataTargetVersionMin = -9007199254740991;
8864
8872
  var runEvalResponseDataTargetVersionMax = 9007199254740991;
8865
8873
  var RunEvalResponse = zod.object({
@@ -8873,6 +8881,7 @@ var RunEvalResponse = zod.object({
8873
8881
  "error": zod.union([zod.string(), zod.null()]),
8874
8882
  "judge_model": zod.union([zod.string(), zod.null()]),
8875
8883
  "judge_prompt_version": zod.union([zod.string(), zod.null()]),
8884
+ "tool_trace": zod.union([zod.unknown(), zod.null()]),
8876
8885
  "created_at": zod.string().datetime({ "offset": true }),
8877
8886
  "started_at": zod.union([zod.string().datetime({ "offset": true }), zod.null()]),
8878
8887
  "completed_at": zod.union([zod.string().datetime({ "offset": true }), zod.null()])
@@ -8895,6 +8904,7 @@ var GetEvalRunResponse = zod.object({
8895
8904
  "error": zod.union([zod.string(), zod.null()]),
8896
8905
  "judge_model": zod.union([zod.string(), zod.null()]),
8897
8906
  "judge_prompt_version": zod.union([zod.string(), zod.null()]),
8907
+ "tool_trace": zod.union([zod.unknown(), zod.null()]),
8898
8908
  "created_at": zod.string().datetime({ "offset": true }),
8899
8909
  "started_at": zod.union([zod.string().datetime({ "offset": true }), zod.null()]),
8900
8910
  "completed_at": zod.union([zod.string().datetime({ "offset": true }), zod.null()])
@@ -12294,7 +12304,7 @@ var createMcpServer = (options) => {
12294
12304
  "createWorkerEvalFromRun",
12295
12305
  {
12296
12306
  title: "Create a worker eval from a run",
12297
- description: "Snapshot a worker run's trigger and resolved artifacts. Mock responses are returned in call order.",
12307
+ description: "Snapshot a worker run's trigger and resolved artifacts, and record its MCP tool responses from telemetry for replay.",
12298
12308
  inputSchema: {
12299
12309
  pathParams: CreateWorkerEvalFromRunParams,
12300
12310
  bodyParams: CreateWorkerEvalFromRunBody.optional()
@@ -12311,9 +12321,10 @@ var createMcpServer = (options) => {
12311
12321
  "runEval",
12312
12322
  {
12313
12323
  title: "Run an eval",
12314
- description: "Queue the worker's current test version against the eval's immutable artifact snapshot and mocked tools.",
12324
+ description: "Queue an explicit worker version against the eval's immutable artifact snapshot and mocked tools.",
12315
12325
  inputSchema: {
12316
- pathParams: RunEvalParams
12326
+ pathParams: RunEvalParams,
12327
+ bodyParams: RunEvalBody.optional()
12317
12328
  },
12318
12329
  outputSchema: RunEvalResponse,
12319
12330
  annotations: { destructiveHint: true }
@@ -13923,4 +13934,4 @@ var transport = new StdioServerTransport();
13923
13934
  server.connect(transport).then(() => {
13924
13935
  console.error("MCP server running on stdio");
13925
13936
  }).catch(console.error);
13926
- //# sourceMappingURL=server-7RPXVFML.js.map
13937
+ //# sourceMappingURL=server-NVU3VZZX.js.map