create-mercato-app 0.6.7-develop.6726.1.983ae8a07e → 0.6.7-develop.6749.1.6b54c56dfe

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (108) hide show
  1. package/agentic/shared/ai/harness/README.md +4 -4
  2. package/agentic/shared/ai/harness/RELEASE.md +2 -2
  3. package/agentic/shared/ai/harness/cases.json +334 -467
  4. package/agentic/shared/ai/harness/cases.schema.json +1 -0
  5. package/agentic/shared/ai/harness/generated-code-review-policy.md +4 -4
  6. package/agentic/shared/ai/harness/generated-code-review-response.schema.json +53 -0
  7. package/agentic/shared/ai/harness/generated-code-review-result.schema.json +62 -0
  8. package/agentic/shared/ai/harness/release-matrix.json +24 -0
  9. package/agentic/shared/ai/harness/writable-ast-oracles.mjs +192 -0
  10. package/agentic/shared/ai/skills/om-evolve-harness/SKILL.md +1 -1
  11. package/agentic/shared/ai/skills/om-evolve-harness/references/case-template.md +4 -4
  12. package/agentic/shared/ai/skills/om-evolve-harness/references/case-workflow.md +1 -1
  13. package/agentic/shared/ai/skills/om-judge-agent-session/SKILL.md +34 -0
  14. package/agentic/shared/ai/skills/om-judge-agent-session/agents/openai.yaml +4 -0
  15. package/agentic/shared/ai/skills/om-judge-agent-session/references/agentic-setup.md +11 -0
  16. package/agentic/shared/ai/skills/om-judge-agent-session/references/input-normalization.md +31 -0
  17. package/agentic/shared/ai/skills/om-judge-agent-session/references/judge-workflow.md +39 -0
  18. package/agentic/shared/ai/skills/om-judge-agent-session/references/report-template.md +43 -0
  19. package/agentic/shared/ai/skills/om-judge-agent-session/references/rules.md +11 -0
  20. package/agentic/shared/ai/skills/tiers.json +1 -0
  21. package/agentic/shared/scripts/agent-harness-tool-server.mjs +19 -6
  22. package/agentic/shared/scripts/evaluate-agent-harness.mjs +163 -31
  23. package/agentic/shared/scripts/run-agent-harness-release.mjs +26 -13
  24. package/dist/agentic/guides/module-facts.json +2247 -172
  25. package/dist/agentic/guides/modules/ai_assistant.md +47 -3
  26. package/dist/agentic/guides/modules/api_docs.md +23 -2
  27. package/dist/agentic/guides/modules/api_keys.md +25 -3
  28. package/dist/agentic/guides/modules/attachments.md +25 -3
  29. package/dist/agentic/guides/modules/audit_logs.md +24 -3
  30. package/dist/agentic/guides/modules/auth.md +47 -3
  31. package/dist/agentic/guides/modules/business_rules.md +31 -3
  32. package/dist/agentic/guides/modules/catalog.md +69 -4
  33. package/dist/agentic/guides/modules/channel_gmail.md +19 -2
  34. package/dist/agentic/guides/modules/channel_imap.md +19 -2
  35. package/dist/agentic/guides/modules/checkout.md +34 -2
  36. package/dist/agentic/guides/modules/communication_channels.md +23 -2
  37. package/dist/agentic/guides/modules/configs.md +28 -3
  38. package/dist/agentic/guides/modules/content.md +22 -2
  39. package/dist/agentic/guides/modules/currencies.md +32 -3
  40. package/dist/agentic/guides/modules/customer_accounts.md +27 -2
  41. package/dist/agentic/guides/modules/customers.md +70 -4
  42. package/dist/agentic/guides/modules/dashboards.md +25 -3
  43. package/dist/agentic/guides/modules/data_sync.md +22 -2
  44. package/dist/agentic/guides/modules/dictionaries.md +21 -2
  45. package/dist/agentic/guides/modules/directory.md +27 -2
  46. package/dist/agentic/guides/modules/entities.md +36 -3
  47. package/dist/agentic/guides/modules/events.md +19 -2
  48. package/dist/agentic/guides/modules/feature_toggles.md +32 -3
  49. package/dist/agentic/guides/modules/gateway_stripe.md +23 -3
  50. package/dist/agentic/guides/modules/generators.md +19 -2
  51. package/dist/agentic/guides/modules/inbox_ops.md +29 -2
  52. package/dist/agentic/guides/modules/integrations.md +23 -2
  53. package/dist/agentic/guides/modules/messages.md +25 -2
  54. package/dist/agentic/guides/modules/notifications.md +24 -3
  55. package/dist/agentic/guides/modules/onboarding.md +22 -2
  56. package/dist/agentic/guides/modules/payment_gateways.md +21 -2
  57. package/dist/agentic/guides/modules/perspectives.md +19 -2
  58. package/dist/agentic/guides/modules/planner.md +27 -3
  59. package/dist/agentic/guides/modules/portal.md +27 -2
  60. package/dist/agentic/guides/modules/progress.md +19 -2
  61. package/dist/agentic/guides/modules/query_index.md +27 -3
  62. package/dist/agentic/guides/modules/record_locks.md +21 -2
  63. package/dist/agentic/guides/modules/resources.md +32 -3
  64. package/dist/agentic/guides/modules/sales.md +44 -3
  65. package/dist/agentic/guides/modules/scheduler.md +30 -3
  66. package/dist/agentic/guides/modules/search.md +38 -3
  67. package/dist/agentic/guides/modules/security.md +32 -2
  68. package/dist/agentic/guides/modules/shipping_carriers.md +21 -2
  69. package/dist/agentic/guides/modules/sso.md +23 -2
  70. package/dist/agentic/guides/modules/staff.md +48 -3
  71. package/dist/agentic/guides/modules/storage_s3.md +23 -3
  72. package/dist/agentic/guides/modules/sync_akeneo.md +23 -3
  73. package/dist/agentic/guides/modules/sync_excel.md +19 -2
  74. package/dist/agentic/guides/modules/system_status_overlays.md +19 -2
  75. package/dist/agentic/guides/modules/translations.md +21 -2
  76. package/dist/agentic/guides/modules/webhooks.md +29 -4
  77. package/dist/agentic/guides/modules/wms.md +35 -3
  78. package/dist/agentic/guides/modules/workflows.md +42 -3
  79. package/dist/agentic/guides/upstream/manifest.json +1 -1
  80. package/dist/agentic/shared/ai/harness/README.md +4 -4
  81. package/dist/agentic/shared/ai/harness/RELEASE.md +2 -2
  82. package/dist/agentic/shared/ai/harness/cases.json +334 -467
  83. package/dist/agentic/shared/ai/harness/cases.schema.json +1 -0
  84. package/dist/agentic/shared/ai/harness/generated-code-review-policy.md +4 -4
  85. package/dist/agentic/shared/ai/harness/generated-code-review-response.schema.json +53 -0
  86. package/dist/agentic/shared/ai/harness/generated-code-review-result.schema.json +62 -0
  87. package/dist/agentic/shared/ai/harness/release-matrix.json +24 -0
  88. package/dist/agentic/shared/ai/harness/writable-ast-oracles.mjs +192 -0
  89. package/dist/agentic/shared/ai/skills/om-evolve-harness/SKILL.md +1 -1
  90. package/dist/agentic/shared/ai/skills/om-evolve-harness/references/case-template.md +4 -4
  91. package/dist/agentic/shared/ai/skills/om-evolve-harness/references/case-workflow.md +1 -1
  92. package/dist/agentic/shared/ai/skills/om-judge-agent-session/SKILL.md +34 -0
  93. package/dist/agentic/shared/ai/skills/om-judge-agent-session/agents/openai.yaml +4 -0
  94. package/dist/agentic/shared/ai/skills/om-judge-agent-session/references/agentic-setup.md +11 -0
  95. package/dist/agentic/shared/ai/skills/om-judge-agent-session/references/input-normalization.md +31 -0
  96. package/dist/agentic/shared/ai/skills/om-judge-agent-session/references/judge-workflow.md +39 -0
  97. package/dist/agentic/shared/ai/skills/om-judge-agent-session/references/report-template.md +43 -0
  98. package/dist/agentic/shared/ai/skills/om-judge-agent-session/references/rules.md +11 -0
  99. package/dist/agentic/shared/ai/skills/tiers.json +1 -0
  100. package/dist/agentic/shared/scripts/agent-harness-tool-server.mjs +19 -6
  101. package/dist/agentic/shared/scripts/evaluate-agent-harness.mjs +163 -31
  102. package/dist/agentic/shared/scripts/run-agent-harness-release.mjs +26 -13
  103. package/package.json +4 -4
  104. package/template/next.config.ts +48 -0
  105. package/template/src/i18n/de.json +2 -0
  106. package/template/src/i18n/en.json +2 -0
  107. package/template/src/i18n/es.json +2 -0
  108. package/template/src/i18n/pl.json +2 -0
@@ -16,7 +16,7 @@ yarn harness:release --runner codex --prepare-targets /absolute/empty-release-ta
16
16
  yarn harness:release --runner codex --portability-runner claude --prepare-targets /absolute/empty-release-targets --acknowledge-writes
17
17
  ```
18
18
 
19
- The primary runner owns all 202 routing cases, all 46 writable cases, and all generated-code reviews. No per-case fallback or mixed primary ownership is allowed. Omitting `--portability-runner` is valid and the sanitized report records `portabilityRunner: null`; explicitly requesting an unavailable or failing secondary runner fails that extended run.
19
+ The primary runner owns all 202 routing cases, all 46 writable cases, and all generative-judge runs. No per-case fallback or mixed primary ownership is allowed. Omitting `--portability-runner` is valid and the sanitized report records `portabilityRunner: null`; explicitly requesting an unavailable or failing secondary runner fails that extended run.
20
20
 
21
21
  Writable evaluation is intentionally opt-in. The expanded catalog has a 46-case writable release target, but only cases registered in `release-matrix.json` and backed by controller-owned fixtures and oracles are executable. Copy or create a fresh standalone app for one registered case, then seed only that case and mark the target disposable:
22
22
 
@@ -31,13 +31,13 @@ The preparer refuses the controller app, non-standalone targets, reused targets,
31
31
 
32
32
  The four generated-test cases use direct controller-resolved Jest/Playwright CLIs, never target package scripts. The target and dependencies stay read-only; Jest has no network, Playwright has loopback only, and the browser lane exposes only the exact installed headless-shell runtime. JSON reporters must attest at least one passed test and zero skipped, todo, focused, flaky, or expected-failure tests before review evidence can be created.
33
33
 
34
- Generated-code review is a separate post-oracle lane, never a nested second-model call. The individual command is opt-in while developing one case; the once-per-release suite requires it for every writable case:
34
+ The generative judge is a separate post-oracle lane, never a nested second-model call. It applies the reusable `om-judge-agent-session` workflow, the pinned `om-code-review` skill, and UI design-system references when applicable. The individual command is opt-in while developing one case; the once-per-release suite requires it for every writable case:
35
35
 
36
36
  ```text
37
- yarn harness:validate --runner codex --review-writable-result /absolute/controller/.ai/harness/results/<writable-result>.json --writable-root /absolute/disposable/app
37
+ yarn harness:validate --runner codex --judge-writable-result /absolute/controller/.ai/harness/results/<writable-result>.json --writable-root /absolute/disposable/app
38
38
  ```
39
39
 
40
- The source must be a passing one-shot implementation result from the current harness and its final whole-target fingerprint must still match. The controller copies changed regular text files as line-numbered inert snapshots, plus its pinned installed `om-code-review` skill and bounded trusted evidence, into a temporary read-only bundle. Target package scripts, dependencies, Git data, tracker state, original source files, and the target's absolute path are not copied or supplied to the reviewer; trace-verified out-of-bundle, environment, or process inspection and any bundle or target mutation fail closed. A separate sanitized artifact records source-result, target, policy, and installed-skill hashes plus the strict verdict, findings, and report. This supplemental review uses prior controller oracle evidence and does not claim the full repository validation gate or CI passed.
40
+ The source must be a passing one-shot implementation result from the current harness and its final whole-target fingerprint must still match. The controller copies changed regular text files as line-numbered inert snapshots, the local judge skill, its pinned installed `om-code-review` skill, and bounded trusted evidence into a temporary read-only bundle. Target package scripts, dependencies, Git data, tracker state, original source files, and the target's absolute path are not copied or supplied to the judge; trace-verified out-of-bundle, environment, or process inspection and any bundle or target mutation fail closed. A separate sanitized artifact records source-result, target, policy, and skill hashes plus fixed evidence, artifact findings, design-system assessment, the smallest harness-owner findings, strict verdicts, and both reports. The legacy `--review-writable-result` and `--review-validation-result` flags remain read-only compatibility aliases. This supplemental judge uses prior controller evidence and does not claim validation or CI that did not run.
41
41
 
42
42
  ## Live-run security boundary
43
43
 
@@ -34,7 +34,7 @@ For externally prepared apps, `--writable-targets /absolute/release-targets.json
34
34
  }
35
35
  ```
36
36
 
37
- The current catalog contains 202 cases, including 46 writable implementation/regression cases (22.8%). The command still derives all counts and case IDs from `cases.json`, `validators.json`, and `release-matrix.json`; those figures are documented release facts, not runner constants. The matrix keeps both supported runner model selectors, an exact all-case primary profile, an exact 46-case portability profile, and runner-neutral writable assignments. Run `yarn install-skills` first so the pinned external `om-code-review` skill and ownership evidence are present. Before running a model or writing a fixture, the release command requires complete deterministic, primary live-routing, writable, trusted-oracle, target, generated-test, and generated-code-review coverage. Every one of the 46 writable cases must have an `om-code-review` assignment. Missing business fixtures or release-matrix entries fail preflight and are listed by exact case ID in the report.
37
+ The current catalog contains 202 cases, including 46 writable implementation/regression cases (22.8%). The command still derives all counts and case IDs from `cases.json`, `validators.json`, and `release-matrix.json`; those figures are documented release facts, not runner constants. The matrix keeps both supported runner model selectors, an exact all-case primary profile, an exact 46-case portability profile, and runner-neutral writable assignments. Run `yarn install-skills` first so the pinned external `om-code-review` skill and ownership evidence are present; the reusable local `om-judge-agent-session` skill ships with the scaffold. Before running a model or writing a fixture, the release command requires complete deterministic, primary live-routing, writable, trusted-oracle, target, generated-test, and generative-judge coverage. Every one of the 46 writable cases must have a judge assignment composing both skills. Missing business fixtures or release-matrix entries fail preflight and are listed by exact case ID in the report.
38
38
 
39
39
  ## PR #4529 remediation evidence
40
40
 
@@ -48,7 +48,7 @@ After preflight it runs, in order:
48
48
  4. fixture preparation and the selected primary runner for every writable case, including the controller-owned AST/behavior oracles and target typecheck;
49
49
  5. `yarn generate`, `yarn typecheck`, `yarn lint`, and `yarn build` in every writable target, after its trusted oracles;
50
50
  6. real generated-code execution for OMH-163 and OMH-192 through fixed Jest, OMH-164 through API-only Playwright, and OMH-165 through real-browser Playwright; and
51
- 7. explicit isolated `om-code-review` for every writable result, bound to its passing command attestation, any required generated-test result and artifact hash, and the final target fingerprint.
51
+ 7. explicit isolated `om-judge-agent-session` for every writable result, composing `om-code-review` and applicable design-system guidance, bound to its passing command attestation, any required generated-test result and artifact hash, and the final target fingerprint.
52
52
 
53
53
  Each writable target is single-use because fixture preparation marks it disposable. Externally supplied target realpaths must be pairwise disjoint and neither equal to, contain, nor be contained by the controller. A failed deterministic or foundation-validation step prevents model execution. Once fixture preparation succeeds, all four target commands run even when the writable gate itself fails, so every generated target has exact diagnostics. A writable case may declare `timeoutMs` only to raise the release `--case-timeout` floor (never lower it); OMH-185 and its business-language parity case OMH-193 use 600000 ms because the complete module slice exceeded the generic five-minute evaluator default while actively producing source. Generated tests run only after the trusted writable oracle and all four target commands pass; review then requires all applicable gates. A target command or generated-test failure is recorded with its sanitized diagnostic and review is skipped. Other matrix entries continue so the report remains useful.
54
54