@thomasminh1995/depverdict 0.6.0-alpha.1
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/LICENSE +21 -0
- package/README.md +518 -0
- package/bin/depverdict.js +7 -0
- package/bin/upgradelens.js +7 -0
- package/docs/GR-01-Semantic-Grounding-Failure-Analysis.md +309 -0
- package/docs/GR-02-Versioned-Action-Evaluation-Criteria.md +187 -0
- package/docs/GR-03-Extractive-Contract-Safety-Experiment.md +242 -0
- package/docs/GR-04-Versioned-Production-Extractive-Contract.md +154 -0
- package/docs/IA-01-Repository-Usage-Discovery.md +122 -0
- package/docs/IA-02-Repository-Impact-Analysis.md +118 -0
- package/docs/IA-03-Repository-Impact-Evidence.md +160 -0
- package/docs/IA-04-CLI-Orchestration.md +235 -0
- package/docs/IA-05-Real-Provider-Validation.md +235 -0
- package/docs/IA-05-VinGrade-Validation.md +339 -0
- package/docs/MVP-01.md +48 -0
- package/docs/MVP-02-Architecture.md +536 -0
- package/docs/MVP-02-CLI-HTTP-Runtime.md +50 -0
- package/docs/MVP-02-HTTP-Lifecycle.md +37 -0
- package/docs/MVP-02-Knowledge-Manifest-Generation.md +75 -0
- package/docs/MVP-02-Knowledge-Manifest.md +279 -0
- package/docs/MVP-02-Knowledge-Research-Orchestration.md +62 -0
- package/docs/MVP-02-Knowledge-Store.md +87 -0
- package/docs/MVP-02-PyPI-Registry-Adapter.md +97 -0
- package/docs/MVP-02-Research-Planning.md +196 -0
- package/docs/MVP-02-Source-Provenance.md +81 -0
- package/docs/MVP-02-npm-Registry-Adapter.md +99 -0
- package/docs/RR-01-End-to-End-and-Real-Provider-Validation.md +393 -0
- package/docs/RR-01-RERUN-Extractive-Contract-Validation.md +566 -0
- package/docs/RR-02-Full-Product-Workflow-and-Developer-CLI-UX-Review.md +35 -0
- package/docs/RR02-FIX-01-Persistent-Qualification-Resolution.md +32 -0
- package/docs/RR02-FIX-02-Stage-aware-CLI-Progress-and-Heartbeat.md +28 -0
- package/docs/RR02-FIX-03-npm-Capture-Evidence-Exclusion.md +33 -0
- package/docs/RR02-FIX-03A-Complete-Package-Exclusion-and-Evidence-Commit.md +223 -0
- package/docs/RR02-FIX-04-Event-loop-safe-Heartbeat.md +393 -0
- package/docs/RR02-FIX-05-Materialize-Persisted-Qualification.md +207 -0
- package/docs/RR02-RERUN-CLI-Qualification-Progress-UX-and-Package-Validation.md +342 -0
- package/docs/VinGrade-MVP-02-Validation.md +480 -0
- package/docs/VinGrade-RC02-Live-Validation.md +273 -0
- package/docs/ai-capability-discovery.md +573 -0
- package/docs/ai-engineering-production-readiness.md +390 -0
- package/docs/ai-engineering-review.md +251 -0
- package/docs/ai-runtime-governance-discovery.md +754 -0
- package/docs/architecture-overview.md +78 -0
- package/docs/cli-progress.md +111 -0
- package/docs/decisions/diff-01-brand-distribution-identity.md +450 -0
- package/docs/decisions/diff-02-identity-compatibility-contract.md +274 -0
- package/docs/decisions/diff-03-repository-docs-community-migration.md +165 -0
- package/docs/decisions/diff-04-release-evidence-gap-acceptance.md +110 -0
- package/docs/discovery/mvp-05-ai-migration-planning-discovery.md +350 -0
- package/docs/gateway-runtime-discovery.md +614 -0
- package/docs/live-ai-validation.md +299 -0
- package/docs/migration-planning-qualification-resolution.md +99 -0
- package/docs/migrations/upgradelens-to-depverdict.md +97 -0
- package/docs/mp-r03-deterministic-upgrade-decision-architecture.md +135 -0
- package/docs/mp-r04-evidence-bounded-migration-handoff-architecture.md +116 -0
- package/docs/mp-r05-product-completion-and-decision-first-cli-architecture.md +162 -0
- package/docs/mvp-05-deterministic-context-runtime.md +127 -0
- package/docs/mvp-05-migration-checklist-contract.md +166 -0
- package/docs/mvp-05-migration-checklist-orchestration.md +105 -0
- package/docs/mvp-05-migration-evaluation-and-qualification.md +135 -0
- package/docs/mvp-05-provider-neutral-generator.md +79 -0
- package/docs/ollama-local-smoke-validation.md +156 -0
- package/docs/openai-compatible-runtime-discovery.md +789 -0
- package/docs/openrouter-one-dependency-validation.md +205 -0
- package/docs/oss-02-package-guard-hardening-architecture.md +131 -0
- package/docs/oss-04-public-ci-package-metadata-architecture.md +142 -0
- package/docs/package-content-policy.md +98 -0
- package/docs/releases/v0.5.0-technical-preview.md +114 -0
- package/docs/releases/v0.6.0-alpha.1-depverdict-preview.md +101 -0
- package/docs/reviews/diff-02-identity-contract-compatibility.md +413 -0
- package/docs/reviews/diff-03-repository-docs-community-migration.md +364 -0
- package/docs/reviews/diff-04-depverdict-distribution-identity-readiness-rereview.md +453 -0
- package/docs/reviews/diff-04-fix-post-rename-identity-release-remediation.md +310 -0
- package/docs/reviews/diff-05-final-preview-distribution-qualification.md +561 -0
- package/docs/reviews/mvp-05-final-product-value-workflow-rereview.md +471 -0
- package/docs/reviews/mvp-05-product-workflow-review.md +605 -0
- package/docs/reviews/oss-01-duplicate-artifact-investigation-cleanup.md +411 -0
- package/docs/reviews/oss-02-package-guard-hardening.md +303 -0
- package/docs/reviews/oss-03-community-scaffolding.md +378 -0
- package/docs/reviews/oss-04-public-ci-package-metadata.md +439 -0
- package/docs/reviews/oss-05-technical-preview-qualification.md +482 -0
- package/docs/reviews/upgradelens-vs-upgradedepdetective-source-comparison.md +355 -0
- package/docs/reviews/v0.5.0-pre-release-smoke.md +263 -0
- package/docs/reviews/v0.5.0-version-bump-release-verification.md +306 -0
- package/docs/runtime-contract-discovery.md +521 -0
- package/docs/structured-output-compatibility-report.md +100 -0
- package/docs/ts-fix-01-exact-duplicate-occurrence-target-selection-architecture.md +111 -0
- package/docs/version-analysis-architecture.md +827 -0
- package/eval/README.md +86 -0
- package/eval/datasets/generic/declared-constraint.json +59 -0
- package/eval/datasets/generic/evidence-conflict.json +73 -0
- package/eval/datasets/generic/major-breaking-release.json +66 -0
- package/eval/datasets/generic/missing-evidence.json +46 -0
- package/eval/datasets/generic/patch-release-low.json +59 -0
- package/eval/datasets/node/axios-patch-low.json +59 -0
- package/eval/datasets/node/react-major-breaking.json +66 -0
- package/eval/datasets/node/react-minor-compatibility.json +66 -0
- package/eval/datasets/python/fastapi-deprecation.json +66 -0
- package/eval/datasets/python/pydantic-major-breaking.json +66 -0
- package/eval/migration-planning/golden-dataset-v2.json +306 -0
- package/eval/migration-planning/golden-dataset.json +214 -0
- package/eval/schemas/expected-result.schema.json +88 -0
- package/eval/schemas/golden-case.schema.json +181 -0
- package/package.json +57 -0
- package/schemas/ai-scorecard.schema.json +132 -0
- package/schemas/benchmark-report.schema.json +189 -0
- package/schemas/benchmark.schema.json +55 -0
- package/schemas/capability-profile.schema.json +44 -0
- package/schemas/conformance-report.schema.json +150 -0
- package/schemas/deployment-profile.schema.json +64 -0
- package/schemas/evaluation-report.schema.json +158 -0
- package/schemas/knowledge-evidence-bundle.schema.json +150 -0
- package/schemas/knowledge-manifest.schema.json +548 -0
- package/schemas/metrics.schema.json +178 -0
- package/schemas/migration-checklist-extractive-candidate.schema.json +42 -0
- package/schemas/migration-checklist.schema.json +706 -0
- package/schemas/migration-evaluation-dataset-v2.schema.json +208 -0
- package/schemas/migration-evaluation-dataset.schema.json +204 -0
- package/schemas/migration-planning-qualification-record.schema.json +234 -0
- package/schemas/project-manifest.schema.json +308 -0
- package/schemas/qualification-record.schema.json +56 -0
- package/schemas/repository-impact-evidence.schema.json +232 -0
- package/schemas/repository-impact.schema.json +202 -0
- package/schemas/upgrade-decision.schema.json +273 -0
- package/schemas/usage-index.schema.json +179 -0
- package/schemas/version-analysis.schema.json +449 -0
- package/src/ai-runtime-debug.js +325 -0
- package/src/ai-runtime-error.js +42 -0
- package/src/ai-runtime.js +174 -0
- package/src/ai-scorecard.js +204 -0
- package/src/ai-version-analysis.js +484 -0
- package/src/artifact-root-compatibility.js +91 -0
- package/src/benchmark-report.js +111 -0
- package/src/benchmark-runner.js +191 -0
- package/src/canonical-json.js +69 -0
- package/src/cli.js +1299 -0
- package/src/conformance-report.js +158 -0
- package/src/conformance-runner.js +253 -0
- package/src/constants.js +73 -0
- package/src/cooperative-scheduler.js +79 -0
- package/src/dependencies.js +44 -0
- package/src/dependency-ai-context.js +625 -0
- package/src/detectors.js +253 -0
- package/src/discovery.js +234 -0
- package/src/ecosystem-version-adapter.js +294 -0
- package/src/environment-compatibility.js +77 -0
- package/src/evaluation-comparator.js +158 -0
- package/src/evaluation-report.js +76 -0
- package/src/evaluation-runner.js +248 -0
- package/src/evidence-source-adapter.js +472 -0
- package/src/files.js +89 -0
- package/src/governance-diagnostics.js +64 -0
- package/src/governance-loader.js +63 -0
- package/src/governance-metadata.js +346 -0
- package/src/governance-validator.js +360 -0
- package/src/http/bounded-fetch.js +278 -0
- package/src/http/cli-http-runtime.js +44 -0
- package/src/impact/input-loader.js +157 -0
- package/src/impact/matcher.js +40 -0
- package/src/impact/repository-impact.js +199 -0
- package/src/impact/runtime.js +24 -0
- package/src/impact/status.js +62 -0
- package/src/impact/writer.js +30 -0
- package/src/impact-evidence/input-loader.js +202 -0
- package/src/impact-evidence/repository-impact-evidence.js +234 -0
- package/src/impact-evidence/runtime.js +16 -0
- package/src/impact-evidence/writer.js +30 -0
- package/src/index.js +563 -0
- package/src/installed-version-baseline.js +196 -0
- package/src/knowledge-cache.js +324 -0
- package/src/knowledge-evidence-bundle.js +101 -0
- package/src/knowledge-evidence-producer.js +233 -0
- package/src/knowledge-manifest-builder.js +188 -0
- package/src/knowledge-manifest-writer.js +32 -0
- package/src/knowledge-manifest.js +255 -0
- package/src/knowledge-research.js +615 -0
- package/src/metrics-engine.js +205 -0
- package/src/migration-checklist/ai-candidate.js +320 -0
- package/src/migration-checklist/assembler.js +37 -0
- package/src/migration-checklist/context-runtime.js +828 -0
- package/src/migration-checklist/evaluation/action-criteria.js +244 -0
- package/src/migration-checklist/evaluation/comparator-v2.js +332 -0
- package/src/migration-checklist/evaluation/comparator.js +279 -0
- package/src/migration-checklist/evaluation/dataset-v2.js +227 -0
- package/src/migration-checklist/evaluation/dataset.js +336 -0
- package/src/migration-checklist/evaluation/extractive-fixtures-v2.js +148 -0
- package/src/migration-checklist/evaluation/metrics-v2.js +226 -0
- package/src/migration-checklist/evaluation/metrics.js +158 -0
- package/src/migration-checklist/evaluation/qualification-v2.js +321 -0
- package/src/migration-checklist/evaluation/qualification.js +239 -0
- package/src/migration-checklist/evaluation/runner-v2.js +294 -0
- package/src/migration-checklist/evaluation/runner.js +194 -0
- package/src/migration-checklist/evaluation/scorecard-v2.js +106 -0
- package/src/migration-checklist/evaluation/scorecard.js +86 -0
- package/src/migration-checklist/extractive-candidate.js +166 -0
- package/src/migration-checklist/extractive-prompt.js +62 -0
- package/src/migration-checklist/generator.js +702 -0
- package/src/migration-checklist/grounding-policy.js +117 -0
- package/src/migration-checklist/input-loader.js +613 -0
- package/src/migration-checklist/migration-checklist.js +635 -0
- package/src/migration-checklist/presentation.js +292 -0
- package/src/migration-checklist/progress.js +96 -0
- package/src/migration-checklist/prompt.js +83 -0
- package/src/migration-checklist/qualification-guard.js +462 -0
- package/src/migration-checklist/qualification-resolution.js +122 -0
- package/src/migration-checklist/qualification-store.js +225 -0
- package/src/migration-checklist/runtime.js +205 -0
- package/src/migration-checklist/verification.js +134 -0
- package/src/migration-checklist/writer.js +35 -0
- package/src/openai-compatible-provider.js +451 -0
- package/src/orchestration/failure-log.js +32 -0
- package/src/orchestration/pipeline.js +200 -0
- package/src/orchestration/progress-events.js +337 -0
- package/src/orchestration/progress-reporter.js +131 -0
- package/src/orchestration/text-writer.js +22 -0
- package/src/portable.js +13 -0
- package/src/product-completion.js +249 -0
- package/src/project-manifest-input.js +90 -0
- package/src/project-manifest.js +141 -0
- package/src/python-requirements.js +137 -0
- package/src/registry/npm-packument.js +256 -0
- package/src/registry/npm-registry-adapter.js +262 -0
- package/src/registry/pypi-project.js +300 -0
- package/src/registry/pypi-registry-adapter.js +235 -0
- package/src/registry/sanitize-registry-body.js +51 -0
- package/src/renderers/console.js +160 -0
- package/src/renderers/impact-presentation.js +278 -0
- package/src/renderers/markdown.js +172 -0
- package/src/research-plan.js +455 -0
- package/src/runtime-conformance.js +275 -0
- package/src/source-provenance.js +393 -0
- package/src/source-url.js +62 -0
- package/src/structured-output-schema.js +66 -0
- package/src/target-selector.js +306 -0
- package/src/upgrade-decision/input-loader.js +107 -0
- package/src/upgrade-decision/presentation.js +43 -0
- package/src/upgrade-decision/runtime.js +21 -0
- package/src/upgrade-decision/upgrade-decision.js +626 -0
- package/src/upgrade-decision/writer.js +30 -0
- package/src/usage/analyzer-registry.js +63 -0
- package/src/usage/coverage.js +116 -0
- package/src/usage/input-loader.js +139 -0
- package/src/usage/js/analyzer.js +240 -0
- package/src/usage/js/parser.js +21 -0
- package/src/usage/runtime.js +187 -0
- package/src/usage/scope.js +44 -0
- package/src/usage/source-files.js +50 -0
- package/src/usage/usage-index.js +217 -0
- package/src/usage/writer.js +31 -0
- package/src/version-analysis-loader.js +203 -0
- package/src/version-analysis-manifest.js +314 -0
- package/src/version-analysis-writer.js +30 -0
|
@@ -0,0 +1,248 @@
|
|
|
1
|
+
import { createHash } from 'node:crypto';
|
|
2
|
+
import { mkdir, open, readdir, readFile, rename, rm } from 'node:fs/promises';
|
|
3
|
+
import path from 'node:path';
|
|
4
|
+
|
|
5
|
+
import Ajv2020 from 'ajv/dist/2020.js';
|
|
6
|
+
import addFormats from 'ajv-formats';
|
|
7
|
+
|
|
8
|
+
import {
|
|
9
|
+
AI_VERSION_ANALYSIS_CANDIDATE_SCHEMA,
|
|
10
|
+
VERSION_ANALYSIS_PROMPT_VERSION,
|
|
11
|
+
analyzeDependencyAiContext
|
|
12
|
+
} from './ai-version-analysis.js';
|
|
13
|
+
import { compareEvaluationResult } from './evaluation-comparator.js';
|
|
14
|
+
import {
|
|
15
|
+
buildEvaluationReport,
|
|
16
|
+
serializeEvaluationReport
|
|
17
|
+
} from './evaluation-report.js';
|
|
18
|
+
import { compareText } from './portable.js';
|
|
19
|
+
|
|
20
|
+
export const DEFAULT_EVALUATION_DATASET_PATH = 'eval/datasets';
|
|
21
|
+
export const DEFAULT_EVALUATION_REPORT_PATH = 'evaluation-report.json';
|
|
22
|
+
|
|
23
|
+
const expectedResultSchema = JSON.parse(await readFile(
|
|
24
|
+
new URL('../eval/schemas/expected-result.schema.json', import.meta.url),
|
|
25
|
+
'utf8'
|
|
26
|
+
));
|
|
27
|
+
const goldenCaseSchema = JSON.parse(await readFile(
|
|
28
|
+
new URL('../eval/schemas/golden-case.schema.json', import.meta.url),
|
|
29
|
+
'utf8'
|
|
30
|
+
));
|
|
31
|
+
const ajv = new Ajv2020({ allErrors: true, strict: true, strictRequired: false });
|
|
32
|
+
addFormats(ajv);
|
|
33
|
+
ajv.addSchema(expectedResultSchema);
|
|
34
|
+
const validateGoldenCaseSchema = ajv.compile(goldenCaseSchema);
|
|
35
|
+
|
|
36
|
+
function digest(value) {
|
|
37
|
+
return `sha256:${createHash('sha256').update(value, 'utf8').digest('hex')}`;
|
|
38
|
+
}
|
|
39
|
+
|
|
40
|
+
function datasetError(message) {
|
|
41
|
+
return new Error(`Evaluation Dataset error: ${message}`);
|
|
42
|
+
}
|
|
43
|
+
|
|
44
|
+
async function jsonFile(file) {
|
|
45
|
+
try {
|
|
46
|
+
return JSON.parse(await readFile(file, 'utf8'));
|
|
47
|
+
} catch (error) {
|
|
48
|
+
if (error instanceof SyntaxError) throw datasetError(`${file} is not valid JSON.`);
|
|
49
|
+
throw error;
|
|
50
|
+
}
|
|
51
|
+
}
|
|
52
|
+
|
|
53
|
+
async function collectJsonFiles(inputPath) {
|
|
54
|
+
const stats = await readdir(inputPath, { withFileTypes: true }).catch(async (error) => {
|
|
55
|
+
if (error.code === 'ENOTDIR') return null;
|
|
56
|
+
throw error;
|
|
57
|
+
});
|
|
58
|
+
if (stats === null) return inputPath.endsWith('.json') ? [inputPath] : [];
|
|
59
|
+
const files = [];
|
|
60
|
+
for (const entry of stats) {
|
|
61
|
+
const child = path.join(inputPath, entry.name);
|
|
62
|
+
if (entry.isDirectory()) files.push(...await collectJsonFiles(child));
|
|
63
|
+
else if (entry.name.endsWith('.json')) files.push(child);
|
|
64
|
+
}
|
|
65
|
+
return files.sort(compareText);
|
|
66
|
+
}
|
|
67
|
+
|
|
68
|
+
export async function loadGoldenDataset(datasetPath = DEFAULT_EVALUATION_DATASET_PATH) {
|
|
69
|
+
const root = path.resolve(datasetPath);
|
|
70
|
+
const files = await collectJsonFiles(root);
|
|
71
|
+
if (files.length === 0) throw datasetError(`no JSON golden cases found at ${datasetPath}.`);
|
|
72
|
+
const cases = [];
|
|
73
|
+
for (const file of files) {
|
|
74
|
+
const value = await jsonFile(file);
|
|
75
|
+
if (!validateGoldenCaseSchema(value)) {
|
|
76
|
+
throw datasetError(`${file} failed schema validation: ${ajv.errorsText(validateGoldenCaseSchema.errors, { separator: '; ' })}`);
|
|
77
|
+
}
|
|
78
|
+
cases.push(value);
|
|
79
|
+
}
|
|
80
|
+
const ids = cases.map((item) => item.id);
|
|
81
|
+
const duplicates = ids.filter((id, index) => ids.indexOf(id) !== index).sort(compareText);
|
|
82
|
+
if (duplicates.length > 0) throw datasetError(`duplicate case id ${duplicates[0]}.`);
|
|
83
|
+
return {
|
|
84
|
+
datasetPath: root,
|
|
85
|
+
datasetVersion: cases[0]?.schemaVersion ?? '1.0.0',
|
|
86
|
+
cases: cases.sort((left, right) => compareText(left.id, right.id))
|
|
87
|
+
};
|
|
88
|
+
}
|
|
89
|
+
|
|
90
|
+
function contextFromGoldenCase(goldenCase) {
|
|
91
|
+
const selectedEvidenceIds = goldenCase.selectedEvidence.map((item) => item.id).sort(compareText);
|
|
92
|
+
const warnings = [];
|
|
93
|
+
if (goldenCase.selectedEvidence.length === 0) {
|
|
94
|
+
warnings.push({
|
|
95
|
+
code: 'EVIDENCE_MISSING',
|
|
96
|
+
packageId: goldenCase.dependency.packageId,
|
|
97
|
+
message: `No selected evidence for ${goldenCase.dependency.packageId}.`
|
|
98
|
+
});
|
|
99
|
+
}
|
|
100
|
+
if (goldenCase.selectedEvidence.some((item) => item.conflictsWith?.length > 0)) {
|
|
101
|
+
warnings.push({
|
|
102
|
+
code: 'SOURCE_CONFLICT',
|
|
103
|
+
packageId: goldenCase.dependency.packageId,
|
|
104
|
+
message: `Selected evidence has a conflict for ${goldenCase.dependency.packageId}.`
|
|
105
|
+
});
|
|
106
|
+
}
|
|
107
|
+
const material = `${goldenCase.id}:${JSON.stringify(goldenCase.dependency)}:${JSON.stringify(goldenCase.versions)}:${selectedEvidenceIds.join(',')}`;
|
|
108
|
+
return {
|
|
109
|
+
contextVersion: '1',
|
|
110
|
+
contextId: digest(material),
|
|
111
|
+
lineage: {
|
|
112
|
+
projectManifestDigest: digest(`${goldenCase.id}:project`),
|
|
113
|
+
knowledgeManifestDigest: digest(`${goldenCase.id}:knowledge`),
|
|
114
|
+
knowledgeResearchId: digest(`${goldenCase.id}:research`),
|
|
115
|
+
evidenceArtifactDigest: digest(`${goldenCase.id}:evidence`)
|
|
116
|
+
},
|
|
117
|
+
dependency: {
|
|
118
|
+
projectId: `${goldenCase.dependency.ecosystem}:${goldenCase.repository.name}`,
|
|
119
|
+
packageId: goldenCase.dependency.packageId,
|
|
120
|
+
declaredName: goldenCase.dependency.declaredName,
|
|
121
|
+
normalizedName: goldenCase.dependency.normalizedName,
|
|
122
|
+
ecosystem: goldenCase.dependency.ecosystem,
|
|
123
|
+
registry: goldenCase.dependency.registry,
|
|
124
|
+
packageManager: goldenCase.repository.packageManager,
|
|
125
|
+
dependencyType: goldenCase.dependency.dependencyType,
|
|
126
|
+
manifest: goldenCase.dependency.manifest
|
|
127
|
+
},
|
|
128
|
+
versions: {
|
|
129
|
+
analysisMode: goldenCase.versions.analysisMode,
|
|
130
|
+
declaredVersion: goldenCase.versions.declaredVersion,
|
|
131
|
+
currentVersion: goldenCase.versions.currentVersion,
|
|
132
|
+
currentVersionSource: goldenCase.versions.currentVersion === null ? null : 'exactDeclaration',
|
|
133
|
+
targetVersion: goldenCase.versions.targetVersion,
|
|
134
|
+
targetPolicy: goldenCase.versions.targetPolicy,
|
|
135
|
+
delta: goldenCase.versions.delta
|
|
136
|
+
},
|
|
137
|
+
knowledge: {
|
|
138
|
+
relevantReleases: [goldenCase.versions.targetVersion],
|
|
139
|
+
evidence: goldenCase.selectedEvidence.map((item) => ({
|
|
140
|
+
id: item.id,
|
|
141
|
+
kind: item.kind,
|
|
142
|
+
sourceId: item.sourceId,
|
|
143
|
+
sourceUrl: item.sourceUrl,
|
|
144
|
+
authority: item.authority,
|
|
145
|
+
trust: item.trust,
|
|
146
|
+
retrievedAt: '2026-07-15T00:00:00.000Z',
|
|
147
|
+
contentDigest: item.contentDigest,
|
|
148
|
+
locator: item.locator,
|
|
149
|
+
releaseVersions: [...item.releaseVersions].sort(compareText),
|
|
150
|
+
content: item.content
|
|
151
|
+
})).sort((left, right) => compareText(left.id, right.id))
|
|
152
|
+
},
|
|
153
|
+
metadata: {
|
|
154
|
+
selectedEvidenceIds,
|
|
155
|
+
missingInformation: goldenCase.selectedEvidence.length === 0 ? ['evidence'] : [],
|
|
156
|
+
warnings: warnings.sort((left, right) => compareText(left.code, right.code)),
|
|
157
|
+
size: {
|
|
158
|
+
characters: JSON.stringify(goldenCase.selectedEvidence).length,
|
|
159
|
+
evidenceItems: goldenCase.selectedEvidence.length
|
|
160
|
+
}
|
|
161
|
+
}
|
|
162
|
+
};
|
|
163
|
+
}
|
|
164
|
+
|
|
165
|
+
export function createGoldenFakeRuntime(expectedByContextId = new Map()) {
|
|
166
|
+
return {
|
|
167
|
+
async generateStructured(request) {
|
|
168
|
+
const expected = expectedByContextId.get(request.contextId);
|
|
169
|
+
if (!expected) throw new Error(`Missing golden expected result for ${request.contextId}.`);
|
|
170
|
+
const evidenceRefs = expected.expectedEvidenceRefs;
|
|
171
|
+
return {
|
|
172
|
+
output: {
|
|
173
|
+
summary: `Expected ${expected.riskLevel} dependency release risk.`,
|
|
174
|
+
summaryEvidenceRefs: evidenceRefs.summary,
|
|
175
|
+
riskLevel: expected.riskLevel,
|
|
176
|
+
riskEvidenceRefs: evidenceRefs.risk,
|
|
177
|
+
findings: expected.expectedFindings.map((finding, index) => ({
|
|
178
|
+
id: `finding-${index + 1}`,
|
|
179
|
+
kind: finding.kind,
|
|
180
|
+
summary: `${finding.kind} finding ${[...(finding.requiredKeywords ?? [])].join(' ')}`.trim(),
|
|
181
|
+
appliesToVersions: finding.appliesToVersions,
|
|
182
|
+
evidenceRefs: finding.evidenceRefs
|
|
183
|
+
}))
|
|
184
|
+
},
|
|
185
|
+
provider: 'golden-fake',
|
|
186
|
+
model: 'golden-fake',
|
|
187
|
+
latencyMs: 0
|
|
188
|
+
};
|
|
189
|
+
}
|
|
190
|
+
};
|
|
191
|
+
}
|
|
192
|
+
|
|
193
|
+
export async function runEvaluation({
|
|
194
|
+
datasetPath = DEFAULT_EVALUATION_DATASET_PATH,
|
|
195
|
+
runtime,
|
|
196
|
+
model = { provider: 'fake', name: 'fake' },
|
|
197
|
+
generatedAt = new Date(),
|
|
198
|
+
promptVersion = VERSION_ANALYSIS_PROMPT_VERSION
|
|
199
|
+
} = {}) {
|
|
200
|
+
const dataset = await loadGoldenDataset(datasetPath);
|
|
201
|
+
const contexts = dataset.cases.map((goldenCase) => ({
|
|
202
|
+
goldenCase,
|
|
203
|
+
context: contextFromGoldenCase(goldenCase)
|
|
204
|
+
}));
|
|
205
|
+
const expectedByContextId = new Map(contexts.map(({ goldenCase, context }) => [
|
|
206
|
+
context.contextId,
|
|
207
|
+
goldenCase.expectedResult
|
|
208
|
+
]));
|
|
209
|
+
const activeRuntime = runtime ?? createGoldenFakeRuntime(expectedByContextId);
|
|
210
|
+
const caseResults = [];
|
|
211
|
+
for (const { goldenCase, context } of contexts) {
|
|
212
|
+
const result = await analyzeDependencyAiContext(context, {
|
|
213
|
+
runtime: activeRuntime,
|
|
214
|
+
promptVersion,
|
|
215
|
+
outputSchema: AI_VERSION_ANALYSIS_CANDIDATE_SCHEMA
|
|
216
|
+
});
|
|
217
|
+
caseResults.push(compareEvaluationResult(goldenCase, result));
|
|
218
|
+
}
|
|
219
|
+
return buildEvaluationReport({
|
|
220
|
+
datasetPath: dataset.datasetPath,
|
|
221
|
+
datasetVersion: dataset.datasetVersion,
|
|
222
|
+
promptVersion,
|
|
223
|
+
model,
|
|
224
|
+
caseResults,
|
|
225
|
+
generatedAt
|
|
226
|
+
});
|
|
227
|
+
}
|
|
228
|
+
|
|
229
|
+
export async function writeEvaluationReport(outputPath, report) {
|
|
230
|
+
const target = path.resolve(outputPath);
|
|
231
|
+
const temporary = `${target}.${process.pid}.tmp`;
|
|
232
|
+
const contents = serializeEvaluationReport(report);
|
|
233
|
+
await mkdir(path.dirname(target), { recursive: true });
|
|
234
|
+
let handle;
|
|
235
|
+
try {
|
|
236
|
+
handle = await open(temporary, 'w', 0o600);
|
|
237
|
+
await handle.writeFile(contents, 'utf8');
|
|
238
|
+
await handle.sync();
|
|
239
|
+
await handle.close();
|
|
240
|
+
handle = null;
|
|
241
|
+
await rename(temporary, target);
|
|
242
|
+
} catch (error) {
|
|
243
|
+
await handle?.close().catch(() => {});
|
|
244
|
+
await rm(temporary, { force: true }).catch(() => {});
|
|
245
|
+
throw error;
|
|
246
|
+
}
|
|
247
|
+
return target;
|
|
248
|
+
}
|