@gleanwork/mcp-server-tester 2.0.0-beta.4 → 2.0.0-beta.5

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
package/dist/index.d.cts CHANGED
@@ -1,5 +1,5 @@
1
- import { L as LLMProvider, M as MCPFixtureApi, a as MCPHostConfig, b as MCPHostSimulationResult, O as OAuthSetupConfig, V as ValidationResult, S as SchemaValidatorOptions, T as TextValidatorOptions, P as PatternValidatorOptions, c as SizeValidatorOptions, d as SnapshotSanitizer, R as RubricSpec, J as JudgeMatcherOptions, e as ToolPredicate, f as ToolCallExpectation, g as ToolCallCountOptions, A as AuthType, D as DatasetSource, H as HostDefinition, h as JudgeDefinition, i as MetricDefinition, j as ResultStoreDefinition, E as ExtensionConfig, k as EvalManifest, l as EvalCaseResult, m as MetricValue, n as ResolvedMetric, o as EvalDataset, p as MCPConfig, q as DatasetConfig, r as EvalRunnerResult, s as EvaluationSummary, t as EvaluationBatchItem, u as EvaluationBatchOptions, v as EvaluationBatchResult, w as ExternalHostConfig, x as ExternalHostRunResult, y as ExternalHostCapabilityImplementation, z as HostDriverId, B as HostDriverConfig, C as ExternalHostCapabilitiesConfig, F as JudgeConfig, G as Judge } from './index-CwFHKIoN.cjs';
2
- export { I as BUILT_IN_RUBRICS, K as BuiltInRubric, N as BuiltInSanitizer, Q as CLIConfig, U as CLIOAuthClient, W as CLIOAuthClientConfig, X as CLIOAuthResult, Y as CLIOutputFormat, Z as CaseComparisonResult, _ as ClientCredentialsConfig, $ as CompareEvalRunsOptions, a0 as ComparisonOutcome, a1 as ContentBlock, a2 as CreateMCPClientOptions, a3 as CustomJudgeExecutor, a4 as CustomJudgeResult, a5 as DatasetSourceContext, a6 as DiscoveryError, a7 as ENV_VAR_NAMES, a8 as EvalArm, a9 as EvalCase, aa as EvalCaseComparison, ab as EvalCaseComparisonOutcome, ac as EvalCaseRequest, ad as EvalCaseSchema, ae as EvalContext, af as EvalDatasetSchema, ag as EvalExpectBlock, ah as EvalExpectationResult, ai as EvalManifestInput, aj as EvalManifestSchema, ak as EvalMode, al as EvalResultStore, am as EvalResultStoreConfig, an as EvalResultStoreLike, ao as EvalRunComparisonLabels, ap as EvalRunComparisonResult, aq as EvalRunMetadata, ar as EvalRunnerOptions, as as EvalSummaryGenerator, at as EvaluationArmResult, au as EvaluationHostRunContext, av as EvaluationSuiteOptions, aw as EvaluationSuiteResult, ax as EvidenceSource, ay as ExpectationBreakdown, az as ExpectationResultMap, aA as ExpectationType, aB as ExperimentMetric, aC as ExternalHostCapabilityBinding, aD as ExternalHostCapabilityContext, aE as ExternalHostFailureKind, aF as ExternalHostMetadata, aG as ExternalHostSession, aH as ExternalHostSimulationResult, aI as ExternalHostType, aJ as FieldRemovalSanitizer, aK as FileEvalResultStore, aL as FileEvalResultStoreConfig, aM as GCSEvalResultStore, aN as GCSEvalResultStoreConfig, aO as HostArtifact, aP as HostBatchRequest, aQ as HostCapability, aR as HostConfig, aS as HostConfigPatch, aT as HostDiagnostics, aU as HostEvent, aV as HostEvidence, aW as HostRunContext, aX as HostRunInput, aY as HostRunOptions, aZ as HostRunResult, a_ as HostType, a$ as HttpMCPConfig, b0 as IterationResult, b1 as JudgeExpectConfig, b2 as JudgeResult, b3 as JudgeValidatorConfig, b4 as LLMToolCall, b5 as ListStoredArtifactsOptions, b6 as LoadDatasetOptions, b7 as MCPAuthConfig, b8 as MCPAuthFixtures, b9 as MCPClientCredentialsConfig, ba as MCPConfigSchema, bb as MCPConformanceCheck, bc as MCPConformanceOptions, bd as MCPConformanceRaw, be as MCPConformanceResult, bf as MCPConformanceResultData, bg as MCPEvalData, bh as MCPEvalHistoricalSummary, bi as MCPEvalReporterConfig, bj as MCPEvalRunData, bk as MCPFixtureOptions, bl as MCPHostCapabilities, bm as MCPHostSimulator, bn as MCPOAuthConfig, bo as MCPServerCapabilitiesData, bp as MCP_PROTOCOL_VERSION, bq as MetricKind, br as NormalizedToolResponse, bs as ObservationConfidence, bt as PlaywrightOAuthClientProvider, bu as PlaywrightOAuthClientProviderConfig, bv as PredicateResult, bw as ProposeVariantsContext, bx as ProtectedResourceDiscoveryResult, by as ProtectedResourceMetadata, bz as ProviderKind, bA as RegexSanitizer, bB as ResultSource, bC as RunSummary, bD as RunTelemetry, bE as SaveBaselineOptions, bF as SaveEvalRunComparisonOptions, bG as SaveServerComparisonOptions, bH as SchemaRegistry, bI as SerializedEvalDataset, bJ as ServerComparisonOptions, bK as ServerComparisonResult, bL as SnapshotSanitizers, bM as StdioMCPConfig, bN as StoredArtifactKind, bO as StoredArtifactSummary, bP as StoredClientInfo, bQ as StoredEvalArtifact, bR as StoredEvalArtifactMetadata, bS as StoredEvalResultLoadOptions, bT as StoredEvalResultRef, bU as StoredEvalResultSaveOptions, bV as StoredEvalRunRef, bW as StoredOAuthState, bX as StoredServerMetadata, bY as StoredTokens, bZ as TaggedConfig, b_ as TokenResult, b$ as ToolMetadataOverride, c0 as ToolOverrideVariant, c1 as TraceSource, c2 as UsageMetrics, c3 as VariantCandidateResult, c4 as VariantExperimentOptions, c5 as VariantExperimentReason, c6 as VariantExperimentResult, c7 as VariantExperimentRound, c8 as VariantImprovementProposal, c9 as VariantRecommendation, ca as closeMCPClient, cb as compareEvalRuns, cc as createDefaultArtifactId, cd as createEvalResultStore, ce as createMCPClientForConfig, cf as createMCPFixture, cg as createStoredEvalArtifact, ch as defaultEnvironmentMetadata, ci as discoverAuthorizationServer, cj as discoverProtectedResource, ck as extractText, cl as hasValidTokens, cm as injectTokens, cn as isBuiltInRubric, co as isEvalResultStore, cp as isHttpConfig, cq as isStdioConfig, cr as loadBaseline, cs as loadEvalDataset, ct as loadEvalDatasetFromObject, cu as loadEvalManifest, cv as loadEvalManifestFromObject, cw as loadStoredEvalRunnerResult, cx as loadTokens, cy as loadTokensFromEnv, cz as mcpAuthTest, cA as normalizeToolResponse, cB as performClientCredentialsFlow, cC as refreshAccessToken, cD as registerJudge, cE as resolveDatasetPaths, cF as resolveEvalResultStore, cG as resolveRubric, cH as runConformanceChecks, cI as runEvalCase, cJ as runEvalDataset, cK as runServerComparison, cL as runVariantExperiment, cM as saveBaseline, cN as saveEvalRunComparison, cO as saveServerComparison, cP as validateEvalCase, cQ as validateEvalDataset, cR as validateJudge, cS as validateMCPConfig, cT as validateToolCallCount, cU as validateToolCalls } from './index-CwFHKIoN.cjs';
1
+ import { L as LLMProvider, M as MCPFixtureApi, a as MCPHostConfig, b as MCPHostSimulationResult, O as OAuthSetupConfig, V as ValidationResult, S as SchemaValidatorOptions, T as TextValidatorOptions, P as PatternValidatorOptions, c as SizeValidatorOptions, d as SnapshotSanitizer, R as RubricSpec, J as JudgeMatcherOptions, e as ToolPredicate, f as ToolCallExpectation, g as ToolCallCountOptions, A as AuthType, D as DatasetSource, H as HostDefinition, h as JudgeDefinition, i as MetricDefinition, j as ResultStoreDefinition, E as ExtensionConfig, k as EvalManifest, l as EvalCaseResult, m as MetricValue, n as ResolvedMetric, o as EvalDataset, p as MCPConfig, q as DatasetConfig, r as EvalRunnerResult, s as EvaluationSummary, t as EvaluationBatchItem, u as EvaluationBatchOptions, v as EvaluationBatchResult, w as ExternalHostConfig, x as ExternalHostRunResult, y as ExternalHostCapabilityImplementation, z as HostDriverId, B as HostDriverConfig, C as ExternalHostCapabilitiesConfig, F as JudgeConfig, G as Judge } from './index-BTEdKnrn.cjs';
2
+ export { I as BUILT_IN_RUBRICS, K as BuiltInRubric, N as BuiltInSanitizer, Q as CLIConfig, U as CLIOAuthClient, W as CLIOAuthClientConfig, X as CLIOAuthResult, Y as CLIOutputFormat, Z as CaseComparisonResult, _ as ClientCredentialsConfig, $ as CompareEvalRunsOptions, a0 as ComparisonOutcome, a1 as ContentBlock, a2 as CreateMCPClientOptions, a3 as CustomJudgeExecutor, a4 as CustomJudgeResult, a5 as DatasetSourceContext, a6 as DiscoveryError, a7 as ENV_VAR_NAMES, a8 as EvalArm, a9 as EvalCase, aa as EvalCaseComparison, ab as EvalCaseComparisonOutcome, ac as EvalCaseRequest, ad as EvalCaseSchema, ae as EvalContext, af as EvalDatasetSchema, ag as EvalExpectBlock, ah as EvalExpectationResult, ai as EvalManifestInput, aj as EvalManifestSchema, ak as EvalMode, al as EvalResultStore, am as EvalResultStoreConfig, an as EvalResultStoreLike, ao as EvalRunComparisonLabels, ap as EvalRunComparisonResult, aq as EvalRunMetadata, ar as EvalRunnerOptions, as as EvalSummaryGenerator, at as EvaluationArmResult, au as EvaluationHostRunContext, av as EvaluationSuiteOptions, aw as EvaluationSuiteResult, ax as EvidenceSource, ay as ExpectationBreakdown, az as ExpectationResultMap, aA as ExpectationType, aB as ExperimentMetric, aC as ExternalHostCapabilityBinding, aD as ExternalHostCapabilityContext, aE as ExternalHostFailureKind, aF as ExternalHostMetadata, aG as ExternalHostSession, aH as ExternalHostSimulationResult, aI as ExternalHostType, aJ as FieldRemovalSanitizer, aK as FileEvalResultStore, aL as FileEvalResultStoreConfig, aM as GCSEvalResultStore, aN as GCSEvalResultStoreConfig, aO as HostArtifact, aP as HostBatchRequest, aQ as HostCapability, aR as HostConfig, aS as HostConfigPatch, aT as HostDiagnostics, aU as HostEvent, aV as HostEvidence, aW as HostRunContext, aX as HostRunInput, aY as HostRunOptions, aZ as HostRunResult, a_ as HostType, a$ as HttpMCPConfig, b0 as IterationResult, b1 as JudgeExpectConfig, b2 as JudgeResult, b3 as JudgeValidatorConfig, b4 as LLMToolCall, b5 as ListStoredArtifactsOptions, b6 as LoadDatasetOptions, b7 as MCPAuthConfig, b8 as MCPAuthFixtures, b9 as MCPClientCredentialsConfig, ba as MCPConfigSchema, bb as MCPConformanceCheck, bc as MCPConformanceOptions, bd as MCPConformanceRaw, be as MCPConformanceResult, bf as MCPConformanceResultData, bg as MCPEvalData, bh as MCPEvalHistoricalSummary, bi as MCPEvalReporterConfig, bj as MCPEvalRunData, bk as MCPFixtureOptions, bl as MCPHostCapabilities, bm as MCPHostSimulator, bn as MCPOAuthConfig, bo as MCPServerCapabilitiesData, bp as MCP_PROTOCOL_VERSION, bq as MetricKind, br as NormalizedToolResponse, bs as ObservationConfidence, bt as PlaywrightOAuthClientProvider, bu as PlaywrightOAuthClientProviderConfig, bv as PredicateResult, bw as ProposeVariantsContext, bx as ProtectedResourceDiscoveryResult, by as ProtectedResourceMetadata, bz as ProviderKind, bA as RegexSanitizer, bB as ResultSource, bC as RunSummary, bD as RunTelemetry, bE as SaveBaselineOptions, bF as SaveEvalRunComparisonOptions, bG as SaveServerComparisonOptions, bH as SchemaRegistry, bI as SerializedEvalDataset, bJ as ServerComparisonOptions, bK as ServerComparisonResult, bL as SnapshotSanitizers, bM as StdioMCPConfig, bN as StoredArtifactKind, bO as StoredArtifactSummary, bP as StoredClientInfo, bQ as StoredEvalArtifact, bR as StoredEvalArtifactMetadata, bS as StoredEvalResultLoadOptions, bT as StoredEvalResultRef, bU as StoredEvalResultSaveOptions, bV as StoredEvalRunRef, bW as StoredOAuthState, bX as StoredServerMetadata, bY as StoredTokens, bZ as TaggedConfig, b_ as TokenResult, b$ as ToolMetadataOverride, c0 as ToolOverrideVariant, c1 as TraceSource, c2 as UsageMetrics, c3 as VariantCandidateResult, c4 as VariantExperimentOptions, c5 as VariantExperimentReason, c6 as VariantExperimentResult, c7 as VariantExperimentRound, c8 as VariantImprovementProposal, c9 as VariantRecommendation, ca as closeMCPClient, cb as compareEvalRuns, cc as createDefaultArtifactId, cd as createEvalResultStore, ce as createMCPClientForConfig, cf as createMCPFixture, cg as createStoredEvalArtifact, ch as defaultEnvironmentMetadata, ci as discoverAuthorizationServer, cj as discoverProtectedResource, ck as extractText, cl as hasValidTokens, cm as injectTokens, cn as isBuiltInRubric, co as isEvalResultStore, cp as isHttpConfig, cq as isStdioConfig, cr as loadBaseline, cs as loadEvalDataset, ct as loadEvalDatasetFromObject, cu as loadEvalManifest, cv as loadEvalManifestFromObject, cw as loadStoredEvalRunnerResult, cx as loadTokens, cy as loadTokensFromEnv, cz as mcpAuthTest, cA as normalizeToolResponse, cB as performClientCredentialsFlow, cC as refreshAccessToken, cD as registerJudge, cE as resolveDatasetPaths, cF as resolveEvalResultStore, cG as resolveRubric, cH as runConformanceChecks, cI as runEvalCase, cJ as runEvalDataset, cK as runServerComparison, cL as runVariantExperiment, cM as saveBaseline, cN as saveEvalRunComparison, cO as saveServerComparison, cP as validateEvalCase, cQ as validateEvalDataset, cR as validateJudge, cS as validateMCPConfig, cT as validateToolCallCount, cU as validateToolCalls } from './index-BTEdKnrn.cjs';
3
3
  import { ZodType } from 'zod';
4
4
  import * as playwright_test from 'playwright/test';
5
5
  import { Client } from '@modelcontextprotocol/sdk/client/index.js';
package/dist/index.d.ts CHANGED
@@ -1,5 +1,5 @@
1
- import { L as LLMProvider, M as MCPFixtureApi, a as MCPHostConfig, b as MCPHostSimulationResult, O as OAuthSetupConfig, V as ValidationResult, S as SchemaValidatorOptions, T as TextValidatorOptions, P as PatternValidatorOptions, c as SizeValidatorOptions, d as SnapshotSanitizer, R as RubricSpec, J as JudgeMatcherOptions, e as ToolPredicate, f as ToolCallExpectation, g as ToolCallCountOptions, A as AuthType, D as DatasetSource, H as HostDefinition, h as JudgeDefinition, i as MetricDefinition, j as ResultStoreDefinition, E as ExtensionConfig, k as EvalManifest, l as EvalCaseResult, m as MetricValue, n as ResolvedMetric, o as EvalDataset, p as MCPConfig, q as DatasetConfig, r as EvalRunnerResult, s as EvaluationSummary, t as EvaluationBatchItem, u as EvaluationBatchOptions, v as EvaluationBatchResult, w as ExternalHostConfig, x as ExternalHostRunResult, y as ExternalHostCapabilityImplementation, z as HostDriverId, B as HostDriverConfig, C as ExternalHostCapabilitiesConfig, F as JudgeConfig, G as Judge } from './index-CwFHKIoN.js';
2
- export { I as BUILT_IN_RUBRICS, K as BuiltInRubric, N as BuiltInSanitizer, Q as CLIConfig, U as CLIOAuthClient, W as CLIOAuthClientConfig, X as CLIOAuthResult, Y as CLIOutputFormat, Z as CaseComparisonResult, _ as ClientCredentialsConfig, $ as CompareEvalRunsOptions, a0 as ComparisonOutcome, a1 as ContentBlock, a2 as CreateMCPClientOptions, a3 as CustomJudgeExecutor, a4 as CustomJudgeResult, a5 as DatasetSourceContext, a6 as DiscoveryError, a7 as ENV_VAR_NAMES, a8 as EvalArm, a9 as EvalCase, aa as EvalCaseComparison, ab as EvalCaseComparisonOutcome, ac as EvalCaseRequest, ad as EvalCaseSchema, ae as EvalContext, af as EvalDatasetSchema, ag as EvalExpectBlock, ah as EvalExpectationResult, ai as EvalManifestInput, aj as EvalManifestSchema, ak as EvalMode, al as EvalResultStore, am as EvalResultStoreConfig, an as EvalResultStoreLike, ao as EvalRunComparisonLabels, ap as EvalRunComparisonResult, aq as EvalRunMetadata, ar as EvalRunnerOptions, as as EvalSummaryGenerator, at as EvaluationArmResult, au as EvaluationHostRunContext, av as EvaluationSuiteOptions, aw as EvaluationSuiteResult, ax as EvidenceSource, ay as ExpectationBreakdown, az as ExpectationResultMap, aA as ExpectationType, aB as ExperimentMetric, aC as ExternalHostCapabilityBinding, aD as ExternalHostCapabilityContext, aE as ExternalHostFailureKind, aF as ExternalHostMetadata, aG as ExternalHostSession, aH as ExternalHostSimulationResult, aI as ExternalHostType, aJ as FieldRemovalSanitizer, aK as FileEvalResultStore, aL as FileEvalResultStoreConfig, aM as GCSEvalResultStore, aN as GCSEvalResultStoreConfig, aO as HostArtifact, aP as HostBatchRequest, aQ as HostCapability, aR as HostConfig, aS as HostConfigPatch, aT as HostDiagnostics, aU as HostEvent, aV as HostEvidence, aW as HostRunContext, aX as HostRunInput, aY as HostRunOptions, aZ as HostRunResult, a_ as HostType, a$ as HttpMCPConfig, b0 as IterationResult, b1 as JudgeExpectConfig, b2 as JudgeResult, b3 as JudgeValidatorConfig, b4 as LLMToolCall, b5 as ListStoredArtifactsOptions, b6 as LoadDatasetOptions, b7 as MCPAuthConfig, b8 as MCPAuthFixtures, b9 as MCPClientCredentialsConfig, ba as MCPConfigSchema, bb as MCPConformanceCheck, bc as MCPConformanceOptions, bd as MCPConformanceRaw, be as MCPConformanceResult, bf as MCPConformanceResultData, bg as MCPEvalData, bh as MCPEvalHistoricalSummary, bi as MCPEvalReporterConfig, bj as MCPEvalRunData, bk as MCPFixtureOptions, bl as MCPHostCapabilities, bm as MCPHostSimulator, bn as MCPOAuthConfig, bo as MCPServerCapabilitiesData, bp as MCP_PROTOCOL_VERSION, bq as MetricKind, br as NormalizedToolResponse, bs as ObservationConfidence, bt as PlaywrightOAuthClientProvider, bu as PlaywrightOAuthClientProviderConfig, bv as PredicateResult, bw as ProposeVariantsContext, bx as ProtectedResourceDiscoveryResult, by as ProtectedResourceMetadata, bz as ProviderKind, bA as RegexSanitizer, bB as ResultSource, bC as RunSummary, bD as RunTelemetry, bE as SaveBaselineOptions, bF as SaveEvalRunComparisonOptions, bG as SaveServerComparisonOptions, bH as SchemaRegistry, bI as SerializedEvalDataset, bJ as ServerComparisonOptions, bK as ServerComparisonResult, bL as SnapshotSanitizers, bM as StdioMCPConfig, bN as StoredArtifactKind, bO as StoredArtifactSummary, bP as StoredClientInfo, bQ as StoredEvalArtifact, bR as StoredEvalArtifactMetadata, bS as StoredEvalResultLoadOptions, bT as StoredEvalResultRef, bU as StoredEvalResultSaveOptions, bV as StoredEvalRunRef, bW as StoredOAuthState, bX as StoredServerMetadata, bY as StoredTokens, bZ as TaggedConfig, b_ as TokenResult, b$ as ToolMetadataOverride, c0 as ToolOverrideVariant, c1 as TraceSource, c2 as UsageMetrics, c3 as VariantCandidateResult, c4 as VariantExperimentOptions, c5 as VariantExperimentReason, c6 as VariantExperimentResult, c7 as VariantExperimentRound, c8 as VariantImprovementProposal, c9 as VariantRecommendation, ca as closeMCPClient, cb as compareEvalRuns, cc as createDefaultArtifactId, cd as createEvalResultStore, ce as createMCPClientForConfig, cf as createMCPFixture, cg as createStoredEvalArtifact, ch as defaultEnvironmentMetadata, ci as discoverAuthorizationServer, cj as discoverProtectedResource, ck as extractText, cl as hasValidTokens, cm as injectTokens, cn as isBuiltInRubric, co as isEvalResultStore, cp as isHttpConfig, cq as isStdioConfig, cr as loadBaseline, cs as loadEvalDataset, ct as loadEvalDatasetFromObject, cu as loadEvalManifest, cv as loadEvalManifestFromObject, cw as loadStoredEvalRunnerResult, cx as loadTokens, cy as loadTokensFromEnv, cz as mcpAuthTest, cA as normalizeToolResponse, cB as performClientCredentialsFlow, cC as refreshAccessToken, cD as registerJudge, cE as resolveDatasetPaths, cF as resolveEvalResultStore, cG as resolveRubric, cH as runConformanceChecks, cI as runEvalCase, cJ as runEvalDataset, cK as runServerComparison, cL as runVariantExperiment, cM as saveBaseline, cN as saveEvalRunComparison, cO as saveServerComparison, cP as validateEvalCase, cQ as validateEvalDataset, cR as validateJudge, cS as validateMCPConfig, cT as validateToolCallCount, cU as validateToolCalls } from './index-CwFHKIoN.js';
1
+ import { L as LLMProvider, M as MCPFixtureApi, a as MCPHostConfig, b as MCPHostSimulationResult, O as OAuthSetupConfig, V as ValidationResult, S as SchemaValidatorOptions, T as TextValidatorOptions, P as PatternValidatorOptions, c as SizeValidatorOptions, d as SnapshotSanitizer, R as RubricSpec, J as JudgeMatcherOptions, e as ToolPredicate, f as ToolCallExpectation, g as ToolCallCountOptions, A as AuthType, D as DatasetSource, H as HostDefinition, h as JudgeDefinition, i as MetricDefinition, j as ResultStoreDefinition, E as ExtensionConfig, k as EvalManifest, l as EvalCaseResult, m as MetricValue, n as ResolvedMetric, o as EvalDataset, p as MCPConfig, q as DatasetConfig, r as EvalRunnerResult, s as EvaluationSummary, t as EvaluationBatchItem, u as EvaluationBatchOptions, v as EvaluationBatchResult, w as ExternalHostConfig, x as ExternalHostRunResult, y as ExternalHostCapabilityImplementation, z as HostDriverId, B as HostDriverConfig, C as ExternalHostCapabilitiesConfig, F as JudgeConfig, G as Judge } from './index-BTEdKnrn.js';
2
+ export { I as BUILT_IN_RUBRICS, K as BuiltInRubric, N as BuiltInSanitizer, Q as CLIConfig, U as CLIOAuthClient, W as CLIOAuthClientConfig, X as CLIOAuthResult, Y as CLIOutputFormat, Z as CaseComparisonResult, _ as ClientCredentialsConfig, $ as CompareEvalRunsOptions, a0 as ComparisonOutcome, a1 as ContentBlock, a2 as CreateMCPClientOptions, a3 as CustomJudgeExecutor, a4 as CustomJudgeResult, a5 as DatasetSourceContext, a6 as DiscoveryError, a7 as ENV_VAR_NAMES, a8 as EvalArm, a9 as EvalCase, aa as EvalCaseComparison, ab as EvalCaseComparisonOutcome, ac as EvalCaseRequest, ad as EvalCaseSchema, ae as EvalContext, af as EvalDatasetSchema, ag as EvalExpectBlock, ah as EvalExpectationResult, ai as EvalManifestInput, aj as EvalManifestSchema, ak as EvalMode, al as EvalResultStore, am as EvalResultStoreConfig, an as EvalResultStoreLike, ao as EvalRunComparisonLabels, ap as EvalRunComparisonResult, aq as EvalRunMetadata, ar as EvalRunnerOptions, as as EvalSummaryGenerator, at as EvaluationArmResult, au as EvaluationHostRunContext, av as EvaluationSuiteOptions, aw as EvaluationSuiteResult, ax as EvidenceSource, ay as ExpectationBreakdown, az as ExpectationResultMap, aA as ExpectationType, aB as ExperimentMetric, aC as ExternalHostCapabilityBinding, aD as ExternalHostCapabilityContext, aE as ExternalHostFailureKind, aF as ExternalHostMetadata, aG as ExternalHostSession, aH as ExternalHostSimulationResult, aI as ExternalHostType, aJ as FieldRemovalSanitizer, aK as FileEvalResultStore, aL as FileEvalResultStoreConfig, aM as GCSEvalResultStore, aN as GCSEvalResultStoreConfig, aO as HostArtifact, aP as HostBatchRequest, aQ as HostCapability, aR as HostConfig, aS as HostConfigPatch, aT as HostDiagnostics, aU as HostEvent, aV as HostEvidence, aW as HostRunContext, aX as HostRunInput, aY as HostRunOptions, aZ as HostRunResult, a_ as HostType, a$ as HttpMCPConfig, b0 as IterationResult, b1 as JudgeExpectConfig, b2 as JudgeResult, b3 as JudgeValidatorConfig, b4 as LLMToolCall, b5 as ListStoredArtifactsOptions, b6 as LoadDatasetOptions, b7 as MCPAuthConfig, b8 as MCPAuthFixtures, b9 as MCPClientCredentialsConfig, ba as MCPConfigSchema, bb as MCPConformanceCheck, bc as MCPConformanceOptions, bd as MCPConformanceRaw, be as MCPConformanceResult, bf as MCPConformanceResultData, bg as MCPEvalData, bh as MCPEvalHistoricalSummary, bi as MCPEvalReporterConfig, bj as MCPEvalRunData, bk as MCPFixtureOptions, bl as MCPHostCapabilities, bm as MCPHostSimulator, bn as MCPOAuthConfig, bo as MCPServerCapabilitiesData, bp as MCP_PROTOCOL_VERSION, bq as MetricKind, br as NormalizedToolResponse, bs as ObservationConfidence, bt as PlaywrightOAuthClientProvider, bu as PlaywrightOAuthClientProviderConfig, bv as PredicateResult, bw as ProposeVariantsContext, bx as ProtectedResourceDiscoveryResult, by as ProtectedResourceMetadata, bz as ProviderKind, bA as RegexSanitizer, bB as ResultSource, bC as RunSummary, bD as RunTelemetry, bE as SaveBaselineOptions, bF as SaveEvalRunComparisonOptions, bG as SaveServerComparisonOptions, bH as SchemaRegistry, bI as SerializedEvalDataset, bJ as ServerComparisonOptions, bK as ServerComparisonResult, bL as SnapshotSanitizers, bM as StdioMCPConfig, bN as StoredArtifactKind, bO as StoredArtifactSummary, bP as StoredClientInfo, bQ as StoredEvalArtifact, bR as StoredEvalArtifactMetadata, bS as StoredEvalResultLoadOptions, bT as StoredEvalResultRef, bU as StoredEvalResultSaveOptions, bV as StoredEvalRunRef, bW as StoredOAuthState, bX as StoredServerMetadata, bY as StoredTokens, bZ as TaggedConfig, b_ as TokenResult, b$ as ToolMetadataOverride, c0 as ToolOverrideVariant, c1 as TraceSource, c2 as UsageMetrics, c3 as VariantCandidateResult, c4 as VariantExperimentOptions, c5 as VariantExperimentReason, c6 as VariantExperimentResult, c7 as VariantExperimentRound, c8 as VariantImprovementProposal, c9 as VariantRecommendation, ca as closeMCPClient, cb as compareEvalRuns, cc as createDefaultArtifactId, cd as createEvalResultStore, ce as createMCPClientForConfig, cf as createMCPFixture, cg as createStoredEvalArtifact, ch as defaultEnvironmentMetadata, ci as discoverAuthorizationServer, cj as discoverProtectedResource, ck as extractText, cl as hasValidTokens, cm as injectTokens, cn as isBuiltInRubric, co as isEvalResultStore, cp as isHttpConfig, cq as isStdioConfig, cr as loadBaseline, cs as loadEvalDataset, ct as loadEvalDatasetFromObject, cu as loadEvalManifest, cv as loadEvalManifestFromObject, cw as loadStoredEvalRunnerResult, cx as loadTokens, cy as loadTokensFromEnv, cz as mcpAuthTest, cA as normalizeToolResponse, cB as performClientCredentialsFlow, cC as refreshAccessToken, cD as registerJudge, cE as resolveDatasetPaths, cF as resolveEvalResultStore, cG as resolveRubric, cH as runConformanceChecks, cI as runEvalCase, cJ as runEvalDataset, cK as runServerComparison, cL as runVariantExperiment, cM as saveBaseline, cN as saveEvalRunComparison, cO as saveServerComparison, cP as validateEvalCase, cQ as validateEvalDataset, cR as validateJudge, cS as validateMCPConfig, cT as validateToolCallCount, cU as validateToolCalls } from './index-BTEdKnrn.js';
3
3
  import { ZodType } from 'zod';
4
4
  import * as playwright_test from 'playwright/test';
5
5
  import { Client } from '@modelcontextprotocol/sdk/client/index.js';