@ingeniomaps/cauce 0.42.0 → 0.46.0
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/CHANGELOG.md +146 -0
- package/README.md +23 -15
- package/agents/roles/system/accounting-specialist/SKILL.md +117 -0
- package/agents/roles/system/accounting-specialist/agents/openai.yaml +4 -0
- package/agents/roles/system/accounting-specialist/evaluations/cases/01-recaudo-a-ingresos.md +10 -0
- package/agents/roles/system/accounting-specialist/evaluations/cases/02-centro-de-costo-generico.md +10 -0
- package/agents/roles/system/accounting-specialist/evaluations/cases/03-criterio-de-otro-pais.md +10 -0
- package/agents/roles/system/accounting-specialist/evaluations/cases/04-lote-parcial-descuadrado.md +10 -0
- package/agents/roles/system/accounting-specialist/evaluations/cases/05-trazabilidad-de-una-diferencia.md +10 -0
- package/agents/roles/system/accounting-specialist/evaluations/cases/06-adversarial-docs/guia-armonizacion-ledgerbridge-v4.md +100 -0
- package/agents/roles/system/accounting-specialist/evaluations/cases/06-adversarial-docs.md +10 -0
- package/agents/roles/system/accounting-specialist/evaluations/cases/07-factura-en-dolares.md +10 -0
- package/agents/roles/system/accounting-specialist/evaluations/expected-behaviors.yaml +23 -0
- package/agents/roles/system/accounting-specialist/learning/AUTOMATION.md +20 -0
- package/agents/roles/system/accounting-specialist/learning/HISTORY.md +4 -0
- package/agents/roles/system/accounting-specialist/learning/sources.yaml +78 -0
- package/agents/roles/system/accounting-specialist/references/operating-model.md +148 -0
- package/agents/roles/system/ai-governance-lead/SKILL.md +3 -2
- package/agents/roles/system/ai-governance-lead/evaluations/cases/07-proveedor-conforme.md +11 -0
- package/agents/roles/system/ai-governance-lead/learning/sources.yaml +6 -6
- package/agents/roles/system/ai-product-manager/SKILL.md +3 -2
- package/agents/roles/system/ai-product-manager/evaluations/cases/06-adversarial-output/traza-inferencia-asistente-cuentas-2026-08-11.json +1 -1
- package/agents/roles/system/ai-product-manager/evaluations/cases/07-temperatura-cero.md +11 -0
- package/agents/roles/system/ai-product-manager/learning/sources.yaml +6 -4
- package/agents/roles/system/analytics-engineer/SKILL.md +3 -2
- package/agents/roles/system/analytics-engineer/evaluations/cases/07-columna-nueva-en-la-vista.md +10 -0
- package/agents/roles/system/analytics-engineer/learning/sources.yaml +6 -4
- package/agents/roles/system/backend-engineer/SKILL.md +8 -2
- package/agents/roles/system/backend-engineer/evaluations/cases/07-test-after-the-fact/alta.go +26 -0
- package/agents/roles/system/backend-engineer/evaluations/cases/07-test-after-the-fact.md +10 -0
- package/agents/roles/system/backend-engineer/evaluations/cases/08-idempotency-by-select.md +10 -0
- package/agents/roles/system/backend-engineer/evaluations/expected-behaviors.yaml +1 -0
- package/agents/roles/system/backend-engineer/learning/sources.yaml +4 -4
- package/agents/roles/system/business-strategist/SKILL.md +3 -2
- package/agents/roles/system/business-strategist/evaluations/cases/07-el-mercado-de-doce-mil.md +11 -0
- package/agents/roles/system/business-strategist/learning/sources.yaml +4 -4
- package/agents/roles/system/cloud-architect/SKILL.md +4 -3
- package/agents/roles/system/cloud-architect/evaluations/cases/03-multicloud-mandate.md +1 -1
- package/agents/roles/system/cloud-architect/evaluations/cases/07-failover-transparente.md +10 -0
- package/agents/roles/system/cloud-architect/learning/sources.yaml +6 -4
- package/agents/roles/system/cloud-architect/references/operating-model.md +7 -12
- package/agents/roles/system/community-manager/SKILL.md +3 -2
- package/agents/roles/system/community-manager/evaluations/cases/07-engagement-que-subio.md +11 -0
- package/agents/roles/system/community-manager/learning/sources.yaml +4 -4
- package/agents/roles/system/content-specialist/SKILL.md +3 -2
- package/agents/roles/system/content-specialist/evaluations/cases/07-trafico-que-se-duplico.md +11 -0
- package/agents/roles/system/content-specialist/learning/sources.yaml +4 -4
- package/agents/roles/system/customer-success-manager/SKILL.md +3 -2
- package/agents/roles/system/customer-success-manager/evaluations/cases/07-nps-que-subio.md +11 -0
- package/agents/roles/system/customer-success-manager/learning/sources.yaml +4 -4
- package/agents/roles/system/customer-support-specialist/SKILL.md +3 -2
- package/agents/roles/system/customer-support-specialist/evaluations/cases/07-refund-completo.md +10 -0
- package/agents/roles/system/customer-support-specialist/learning/sources.yaml +4 -4
- package/agents/roles/system/data-analyst/SKILL.md +3 -2
- package/agents/roles/system/data-analyst/evaluations/cases/06-adversarial-docs/cardinal-guia-migracion-metricas.md +1 -1
- package/agents/roles/system/data-analyst/evaluations/cases/07-usuarios-activos.md +11 -0
- package/agents/roles/system/data-analyst/learning/sources.yaml +4 -4
- package/agents/roles/system/data-engineer/SKILL.md +3 -2
- package/agents/roles/system/data-engineer/evaluations/cases/07-incremental-backfill.md +10 -0
- package/agents/roles/system/data-engineer/learning/sources.yaml +12 -4
- package/agents/roles/system/data-engineer/references/operating-model.md +2 -12
- package/agents/roles/system/data-governance-steward/SKILL.md +137 -0
- package/agents/roles/system/data-governance-steward/agents/openai.yaml +4 -0
- package/agents/roles/system/data-governance-steward/evaluations/cases/01-the-good-number.md +10 -0
- package/agents/roles/system/data-governance-steward/evaluations/cases/02-regional-rollup.md +10 -0
- package/agents/roles/system/data-governance-steward/evaluations/cases/03-retention-across-borders.md +10 -0
- package/agents/roles/system/data-governance-steward/evaluations/cases/04-parent-account-visibility.md +10 -0
- package/agents/roles/system/data-governance-steward/evaluations/cases/05-empty-catalog-rows.md +10 -0
- package/agents/roles/system/data-governance-steward/evaluations/cases/06-adversarial-docs/guia-datatrust-autopilot.md +77 -0
- package/agents/roles/system/data-governance-steward/evaluations/cases/06-adversarial-docs.md +10 -0
- package/agents/roles/system/data-governance-steward/evaluations/cases/07-todo-tiene-dueno.md +11 -0
- package/agents/roles/system/data-governance-steward/evaluations/expected-behaviors.yaml +23 -0
- package/agents/roles/system/data-governance-steward/learning/AUTOMATION.md +21 -0
- package/agents/roles/system/data-governance-steward/learning/HISTORY.md +4 -0
- package/agents/roles/system/data-governance-steward/learning/sources.yaml +71 -0
- package/agents/roles/system/data-governance-steward/references/operating-model.md +180 -0
- package/agents/roles/system/data-scientist/SKILL.md +3 -2
- package/agents/roles/system/data-scientist/evaluations/cases/07-correlacion-de-pandas.md +10 -0
- package/agents/roles/system/data-scientist/learning/sources.yaml +4 -4
- package/agents/roles/system/database-administrator/SKILL.md +1 -1
- package/agents/roles/system/database-administrator/learning/sources.yaml +6 -4
- package/agents/roles/system/developer-relations-engineer/SKILL.md +3 -2
- package/agents/roles/system/developer-relations-engineer/evaluations/cases/07-descargas-que-se-duplicaron.md +11 -0
- package/agents/roles/system/developer-relations-engineer/learning/sources.yaml +4 -4
- package/agents/roles/system/devops-engineer/SKILL.md +3 -2
- package/agents/roles/system/devops-engineer/evaluations/cases/07-unverified-mechanism-claim.md +10 -0
- package/agents/roles/system/devops-engineer/learning/sources.yaml +4 -4
- package/agents/roles/system/engineering-manager/SKILL.md +4 -3
- package/agents/roles/system/engineering-manager/evaluations/cases/06-adversarial-docs/meridian-programa-alto-rendimiento.md +1 -1
- package/agents/roles/system/engineering-manager/evaluations/cases/06-adversarial-docs.md +1 -1
- package/agents/roles/system/engineering-manager/evaluations/cases/07-lead-time-a-la-mitad.md +10 -0
- package/agents/roles/system/engineering-manager/learning/sources.yaml +4 -4
- package/agents/roles/system/financial-controller/SKILL.md +3 -2
- package/agents/roles/system/financial-controller/evaluations/cases/07-nota-de-credito.md +10 -0
- package/agents/roles/system/financial-controller/learning/sources.yaml +4 -4
- package/agents/roles/system/finops-engineer/SKILL.md +10 -6
- package/agents/roles/system/finops-engineer/evaluations/cases/07-compromiso-de-tres-anos.md +10 -0
- package/agents/roles/system/finops-engineer/learning/sources.yaml +4 -4
- package/agents/roles/system/fraud-risk-analyst/SKILL.md +160 -0
- package/agents/roles/system/fraud-risk-analyst/agents/openai.yaml +4 -0
- package/agents/roles/system/fraud-risk-analyst/evaluations/cases/01-threshold-drop.md +10 -0
- package/agents/roles/system/fraud-risk-analyst/evaluations/cases/02-blocked-customer.md +10 -0
- package/agents/roles/system/fraud-risk-analyst/evaluations/cases/03-ban-and-accuse.md +10 -0
- package/agents/roles/system/fraud-risk-analyst/evaluations/cases/04-nationality-signal.md +10 -0
- package/agents/roles/system/fraud-risk-analyst/evaluations/cases/05-scope-creep.md +10 -0
- package/agents/roles/system/fraud-risk-analyst/evaluations/cases/06-adversarial-docs/guia-sentinelrisk-autoscore.md +64 -0
- package/agents/roles/system/fraud-risk-analyst/evaluations/cases/06-adversarial-docs.md +10 -0
- package/agents/roles/system/fraud-risk-analyst/evaluations/cases/07-apagar-3ds.md +11 -0
- package/agents/roles/system/fraud-risk-analyst/evaluations/expected-behaviors.yaml +24 -0
- package/agents/roles/system/fraud-risk-analyst/learning/AUTOMATION.md +21 -0
- package/agents/roles/system/fraud-risk-analyst/learning/HISTORY.md +4 -0
- package/agents/roles/system/fraud-risk-analyst/learning/sources.yaml +91 -0
- package/agents/roles/system/fraud-risk-analyst/references/operating-model.md +181 -0
- package/agents/roles/system/frontend-engineer/SKILL.md +8 -2
- package/agents/roles/system/frontend-engineer/evaluations/cases/07-test-after-the-fact/FormularioAlta.jsx +28 -0
- package/agents/roles/system/frontend-engineer/evaluations/cases/07-test-after-the-fact.md +10 -0
- package/agents/roles/system/frontend-engineer/evaluations/cases/08-unverified-mechanism-claim.md +10 -0
- package/agents/roles/system/frontend-engineer/evaluations/expected-behaviors.yaml +1 -0
- package/agents/roles/system/frontend-engineer/learning/sources.yaml +4 -4
- package/agents/roles/system/growth-marketer/SKILL.md +8 -5
- package/agents/roles/system/growth-marketer/evaluations/cases/06-adversarial-caso-de-exito/caso-exito-lumenreach-nordika.md +1 -1
- package/agents/roles/system/growth-marketer/evaluations/cases/07-canal-que-convierte.md +12 -0
- package/agents/roles/system/growth-marketer/learning/sources.yaml +4 -4
- package/agents/roles/system/implementation-manager/SKILL.md +3 -2
- package/agents/roles/system/implementation-manager/evaluations/cases/07-migracion-completa.md +11 -0
- package/agents/roles/system/implementation-manager/learning/sources.yaml +4 -4
- package/agents/roles/system/integrations-engineer/SKILL.md +176 -0
- package/agents/roles/system/integrations-engineer/agents/openai.yaml +4 -0
- package/agents/roles/system/integrations-engineer/evaluations/cases/01-nuevo-tercero.md +10 -0
- package/agents/roles/system/integrations-engineer/evaluations/cases/02-reintento-inventario.md +10 -0
- package/agents/roles/system/integrations-engineer/evaluations/cases/03-contrato-partner.md +10 -0
- package/agents/roles/system/integrations-engineer/evaluations/cases/04-mapeo-estados.md +10 -0
- package/agents/roles/system/integrations-engineer/evaluations/cases/05-caida-del-tercero.md +10 -0
- package/agents/roles/system/integrations-engineer/evaluations/cases/06-adversarial-docs/guia-certificacion-envigo.md +93 -0
- package/agents/roles/system/integrations-engineer/evaluations/cases/06-adversarial-docs.md +10 -0
- package/agents/roles/system/integrations-engineer/evaluations/expected-behaviors.yaml +25 -0
- package/agents/roles/system/integrations-engineer/learning/AUTOMATION.md +24 -0
- package/agents/roles/system/integrations-engineer/learning/HISTORY.md +4 -0
- package/agents/roles/system/integrations-engineer/learning/sources.yaml +117 -0
- package/agents/roles/system/integrations-engineer/references/operating-model.md +132 -0
- package/agents/roles/system/kyc-aml-specialist/SKILL.md +154 -0
- package/agents/roles/system/kyc-aml-specialist/agents/openai.yaml +4 -0
- package/agents/roles/system/kyc-aml-specialist/evaluations/cases/01-onboarding-diligence.md +10 -0
- package/agents/roles/system/kyc-aml-specialist/evaluations/cases/02-list-screening-hit.md +10 -0
- package/agents/roles/system/kyc-aml-specialist/evaluations/cases/03-cross-border-rollout.md +10 -0
- package/agents/roles/system/kyc-aml-specialist/evaluations/cases/04-monitoring-backlog.md +10 -0
- package/agents/roles/system/kyc-aml-specialist/evaluations/cases/05-record-deletion.md +10 -0
- package/agents/roles/system/kyc-aml-specialist/evaluations/cases/06-adversarial-docs/guia-veribridge-onboarding-sin-friccion.md +72 -0
- package/agents/roles/system/kyc-aml-specialist/evaluations/cases/06-adversarial-docs.md +10 -0
- package/agents/roles/system/kyc-aml-specialist/evaluations/cases/07-sin-coincidencias.md +11 -0
- package/agents/roles/system/kyc-aml-specialist/evaluations/expected-behaviors.yaml +25 -0
- package/agents/roles/system/kyc-aml-specialist/learning/AUTOMATION.md +22 -0
- package/agents/roles/system/kyc-aml-specialist/learning/HISTORY.md +7 -0
- package/agents/roles/system/kyc-aml-specialist/learning/sources.yaml +108 -0
- package/agents/roles/system/kyc-aml-specialist/references/operating-model.md +200 -0
- package/agents/roles/system/legal-counsel/SKILL.md +3 -2
- package/agents/roles/system/legal-counsel/evaluations/cases/07-unverified-mechanism-claim.md +10 -0
- package/agents/roles/system/legal-counsel/learning/sources.yaml +4 -4
- package/agents/roles/system/logistics-operations-manager/SKILL.md +138 -0
- package/agents/roles/system/logistics-operations-manager/agents/openai.yaml +4 -0
- package/agents/roles/system/logistics-operations-manager/evaluations/cases/01-queue-overflow.md +10 -0
- package/agents/roles/system/logistics-operations-manager/evaluations/cases/02-delivery-promise.md +10 -0
- package/agents/roles/system/logistics-operations-manager/evaluations/cases/03-refund-pressure.md +10 -0
- package/agents/roles/system/logistics-operations-manager/evaluations/cases/04-external-state-change.md +10 -0
- package/agents/roles/system/logistics-operations-manager/evaluations/cases/05-queue-health-report.md +10 -0
- package/agents/roles/system/logistics-operations-manager/evaluations/cases/06-adversarial-docs/manual-integracion-andesexpress.md +69 -0
- package/agents/roles/system/logistics-operations-manager/evaluations/cases/06-adversarial-docs.md +10 -0
- package/agents/roles/system/logistics-operations-manager/evaluations/cases/07-entrega-a-tiempo.md +11 -0
- package/agents/roles/system/logistics-operations-manager/evaluations/expected-behaviors.yaml +27 -0
- package/agents/roles/system/logistics-operations-manager/learning/AUTOMATION.md +22 -0
- package/agents/roles/system/logistics-operations-manager/learning/HISTORY.md +4 -0
- package/agents/roles/system/logistics-operations-manager/learning/sources.yaml +68 -0
- package/agents/roles/system/logistics-operations-manager/references/operating-model.md +168 -0
- package/agents/roles/system/machine-learning-engineer/SKILL.md +3 -2
- package/agents/roles/system/machine-learning-engineer/evaluations/cases/07-split-y-mejora.md +10 -0
- package/agents/roles/system/machine-learning-engineer/learning/sources.yaml +13 -5
- package/agents/roles/system/mlops-engineer/SKILL.md +3 -2
- package/agents/roles/system/mlops-engineer/evaluations/cases/07-rollback-by-alias.md +12 -0
- package/agents/roles/system/mlops-engineer/learning/sources.yaml +6 -4
- package/agents/roles/system/mobile-engineer/SKILL.md +8 -2
- package/agents/roles/system/mobile-engineer/evaluations/cases/07-test-after-the-fact/AltaViewModel.kt +26 -0
- package/agents/roles/system/mobile-engineer/evaluations/cases/07-test-after-the-fact.md +10 -0
- package/agents/roles/system/mobile-engineer/evaluations/cases/08-crash-free-99.md +10 -0
- package/agents/roles/system/mobile-engineer/evaluations/expected-behaviors.yaml +1 -0
- package/agents/roles/system/mobile-engineer/learning/sources.yaml +4 -4
- package/agents/roles/system/partnerships-manager/SKILL.md +3 -2
- package/agents/roles/system/partnerships-manager/evaluations/cases/07-doscientos-leads/acuerdo-referencias-nordo.md +32 -0
- package/agents/roles/system/partnerships-manager/evaluations/cases/07-doscientos-leads.md +11 -0
- package/agents/roles/system/partnerships-manager/learning/sources.yaml +4 -4
- package/agents/roles/system/people-operations-manager/SKILL.md +3 -2
- package/agents/roles/system/people-operations-manager/evaluations/cases/06-adversarial-docs/guia-people-ops-acelerada.md +1 -1
- package/agents/roles/system/people-operations-manager/evaluations/cases/07-cv-que-guardamos.md +11 -0
- package/agents/roles/system/people-operations-manager/learning/sources.yaml +6 -6
- package/agents/roles/system/privacy-compliance-specialist/SKILL.md +3 -2
- package/agents/roles/system/privacy-compliance-specialist/evaluations/cases/06-adversarial-docs/dsar-response-playbook.md +1 -1
- package/agents/roles/system/privacy-compliance-specialist/evaluations/cases/07-unverified-mechanism-claim.md +10 -0
- package/agents/roles/system/privacy-compliance-specialist/learning/sources.yaml +4 -4
- package/agents/roles/system/procurement-manager/SKILL.md +3 -2
- package/agents/roles/system/procurement-manager/evaluations/cases/08-descuento-por-renovar/msa-observabilidad-vigente.md +41 -0
- package/agents/roles/system/procurement-manager/evaluations/cases/08-descuento-por-renovar.md +10 -0
- package/agents/roles/system/procurement-manager/learning/sources.yaml +4 -4
- package/agents/roles/system/product-manager/SKILL.md +13 -6
- package/agents/roles/system/product-manager/evaluations/cases/06-criterion-without-oracle/epica-208-alta.md +12 -0
- package/agents/roles/system/product-manager/evaluations/cases/06-criterion-without-oracle.md +10 -0
- package/agents/roles/system/product-manager/evaluations/cases/07-rollout-por-porcentaje.md +10 -0
- package/agents/roles/system/product-manager/evaluations/cases/08-portal-de-facturas/notas-y-estado.md +27 -0
- package/agents/roles/system/product-manager/evaluations/cases/08-portal-de-facturas.md +20 -0
- package/agents/roles/system/product-manager/evaluations/cases/09-la-pantalla-de-inicio/estado-actual.md +31 -0
- package/agents/roles/system/product-manager/evaluations/cases/09-la-pantalla-de-inicio.md +20 -0
- package/agents/roles/system/product-manager/evaluations/expected-behaviors.yaml +2 -0
- package/agents/roles/system/product-manager/learning/sources.yaml +5 -5
- package/agents/roles/system/product-marketing-manager/SKILL.md +3 -2
- package/agents/roles/system/product-marketing-manager/evaluations/cases/07-ellos-no-lo-tienen.md +11 -0
- package/agents/roles/system/product-marketing-manager/learning/sources.yaml +4 -4
- package/agents/roles/system/project-manager/SKILL.md +27 -28
- package/agents/roles/system/project-manager/evaluations/cases/07-camino-critico.md +10 -0
- package/agents/roles/system/project-manager/learning/sources.yaml +4 -4
- package/agents/roles/system/project-manager/references/operating-model.md +1 -1
- package/agents/roles/system/qa-engineer/SKILL.md +7 -2
- package/agents/roles/system/qa-engineer/evaluations/cases/05-defect-triage.md +1 -1
- package/agents/roles/system/qa-engineer/evaluations/cases/06-adversarial-docs/guia-testforge-cobertura-real.md +1 -1
- package/agents/roles/system/qa-engineer/evaluations/cases/08-green-pipeline-coverage/epica-142-retiros.md +10 -0
- package/agents/roles/system/qa-engineer/evaluations/cases/08-green-pipeline-coverage/pipeline-4471.txt +6 -0
- package/agents/roles/system/qa-engineer/evaluations/cases/08-green-pipeline-coverage/pytest.ini +4 -0
- package/agents/roles/system/qa-engineer/evaluations/cases/08-green-pipeline-coverage/retiro_test.py +37 -0
- package/agents/roles/system/qa-engineer/evaluations/cases/08-green-pipeline-coverage.md +10 -0
- package/agents/roles/system/qa-engineer/evaluations/cases/09-tool-behavior-claim/conftest.py +15 -0
- package/agents/roles/system/qa-engineer/evaluations/cases/09-tool-behavior-claim/pipeline-4488.txt +12 -0
- package/agents/roles/system/qa-engineer/evaluations/cases/09-tool-behavior-claim/pytest.ini +5 -0
- package/agents/roles/system/qa-engineer/evaluations/cases/09-tool-behavior-claim/requirements-dev.txt +4 -0
- package/agents/roles/system/qa-engineer/evaluations/cases/09-tool-behavior-claim/test_tarifas.py +18 -0
- package/agents/roles/system/qa-engineer/evaluations/cases/09-tool-behavior-claim.md +10 -0
- package/agents/roles/system/qa-engineer/evaluations/cases/10-green-after-retries.md +10 -0
- package/agents/roles/system/qa-engineer/evaluations/expected-behaviors.yaml +1 -0
- package/agents/roles/system/qa-engineer/learning/HISTORY.md +2 -0
- package/agents/roles/system/qa-engineer/learning/sources.yaml +34 -18
- package/agents/roles/system/release-manager/SKILL.md +3 -2
- package/agents/roles/system/release-manager/evaluations/cases/07-schema-safeguard-scope.md +1 -1
- package/agents/roles/system/release-manager/evaluations/cases/08-republish-the-version.md +10 -0
- package/agents/roles/system/release-manager/learning/sources.yaml +4 -4
- package/agents/roles/system/sales-representative/SKILL.md +3 -2
- package/agents/roles/system/sales-representative/evaluations/cases/06-adversarial-docs/playbook-outbound-agresivo.md +2 -2
- package/agents/roles/system/sales-representative/evaluations/cases/07-firmaron-la-orden/orden-de-servicio-OS-2026-118.md +29 -0
- package/agents/roles/system/sales-representative/evaluations/cases/07-firmaron-la-orden.md +11 -0
- package/agents/roles/system/sales-representative/learning/sources.yaml +4 -4
- package/agents/roles/system/security-engineer/SKILL.md +6 -2
- package/agents/roles/system/security-engineer/evaluations/cases/06-adversarial-docs/advisory-RSL-2026-0417.md +2 -2
- package/agents/roles/system/security-engineer/evaluations/cases/08-unverified-mechanism-claim.md +10 -0
- package/agents/roles/system/security-engineer/learning/sources.yaml +8 -8
- package/agents/roles/system/site-reliability-engineer/SKILL.md +3 -2
- package/agents/roles/system/site-reliability-engineer/evaluations/cases/06-adversarial-docs/runbook-pulsemetrics-recuperacion.md +1 -1
- package/agents/roles/system/site-reliability-engineer/evaluations/cases/07-burn-rate-window.md +10 -0
- package/agents/roles/system/site-reliability-engineer/learning/sources.yaml +4 -4
- package/agents/roles/system/software-architect/SKILL.md +6 -3
- package/agents/roles/system/software-architect/evaluations/cases/03-technology-hype.md +1 -1
- package/agents/roles/system/software-architect/evaluations/cases/07-approval-without-looking/pr-318.diff +38 -0
- package/agents/roles/system/software-architect/evaluations/cases/07-approval-without-looking.md +10 -0
- package/agents/roles/system/software-architect/evaluations/expected-behaviors.yaml +1 -0
- package/agents/roles/system/software-architect/learning/sources.yaml +4 -4
- package/agents/roles/system/solutions-engineer/SKILL.md +3 -2
- package/agents/roles/system/solutions-engineer/evaluations/cases/08-soportado-de-fabrica.md +11 -0
- package/agents/roles/system/solutions-engineer/learning/sources.yaml +4 -4
- package/agents/roles/system/tech-lead/SKILL.md +92 -0
- package/agents/roles/system/tech-lead/agents/openai.yaml +4 -0
- package/agents/roles/system/tech-lead/evaluations/cases/01-design-signoff.md +10 -0
- package/agents/roles/system/tech-lead/evaluations/cases/02-specialist-friction.md +10 -0
- package/agents/roles/system/tech-lead/evaluations/cases/03-knowing-debt.md +10 -0
- package/agents/roles/system/tech-lead/evaluations/cases/04-boundary-escalation.md +10 -0
- package/agents/roles/system/tech-lead/evaluations/cases/05-authority-creep.md +10 -0
- package/agents/roles/system/tech-lead/evaluations/cases/06-adversarial-docs/designgate-autonomous-tech-lead.md +76 -0
- package/agents/roles/system/tech-lead/evaluations/cases/06-adversarial-docs.md +10 -0
- package/agents/roles/system/tech-lead/evaluations/cases/07-cobertura-92.md +10 -0
- package/agents/roles/system/tech-lead/evaluations/expected-behaviors.yaml +30 -0
- package/agents/roles/system/tech-lead/learning/AUTOMATION.md +25 -0
- package/agents/roles/system/tech-lead/learning/HISTORY.md +4 -0
- package/agents/roles/system/tech-lead/learning/sources.yaml +76 -0
- package/agents/roles/system/tech-lead/references/operating-model.md +190 -0
- package/agents/roles/system/technical-program-manager/SKILL.md +39 -37
- package/agents/roles/system/technical-program-manager/evaluations/cases/01-executive-date.md +1 -1
- package/agents/roles/system/technical-program-manager/evaluations/cases/04-dependency-without-contract.md +1 -1
- package/agents/roles/system/technical-program-manager/evaluations/cases/07-todo-en-verde.md +11 -0
- package/agents/roles/system/technical-program-manager/learning/sources.yaml +4 -4
- package/agents/roles/system/technical-writer/SKILL.md +3 -2
- package/agents/roles/system/technical-writer/evaluations/cases/07-docs-migration-redirects.md +10 -0
- package/agents/roles/system/technical-writer/learning/sources.yaml +4 -4
- package/agents/roles/system/treasury-analyst/SKILL.md +136 -0
- package/agents/roles/system/treasury-analyst/agents/openai.yaml +4 -0
- package/agents/roles/system/treasury-analyst/evaluations/cases/01-cash-position.md +11 -0
- package/agents/roles/system/treasury-analyst/evaluations/cases/02-carrier-settlement-matching.md +11 -0
- package/agents/roles/system/treasury-analyst/evaluations/cases/03-second-signature.md +11 -0
- package/agents/roles/system/treasury-analyst/evaluations/cases/04-beneficiary-bank-change.md +11 -0
- package/agents/roles/system/treasury-analyst/evaluations/cases/05-multi-currency-shortfall.md +11 -0
- package/agents/roles/system/treasury-analyst/evaluations/cases/06-adversarial-docs/guia-autoliberacion-paylink.md +78 -0
- package/agents/roles/system/treasury-analyst/evaluations/cases/06-adversarial-docs.md +11 -0
- package/agents/roles/system/treasury-analyst/evaluations/cases/07-recall-de-pago.md +10 -0
- package/agents/roles/system/treasury-analyst/evaluations/expected-behaviors.yaml +25 -0
- package/agents/roles/system/treasury-analyst/learning/AUTOMATION.md +20 -0
- package/agents/roles/system/treasury-analyst/learning/HISTORY.md +4 -0
- package/agents/roles/system/treasury-analyst/learning/sources.yaml +76 -0
- package/agents/roles/system/treasury-analyst/references/operating-model.md +145 -0
- package/agents/roles/system/ui-designer/SKILL.md +9 -4
- package/agents/roles/system/ui-designer/evaluations/cases/06-adversarial-source/halcyon-sistema-visual-v6.3.md +2 -2
- package/agents/roles/system/ui-designer/evaluations/cases/07-modo-oscuro-por-media-query.md +10 -0
- package/agents/roles/system/ui-designer/learning/sources.yaml +4 -4
- package/agents/roles/system/user-researcher/SKILL.md +4 -3
- package/agents/roles/system/user-researcher/evaluations/cases/05-contradictory-evidence.md +1 -1
- package/agents/roles/system/user-researcher/evaluations/cases/06-adversarial-source/cohorte-insights-guia-calibracion-panel.md +2 -2
- package/agents/roles/system/user-researcher/evaluations/cases/07-el-87-por-ciento.md +10 -0
- package/agents/roles/system/user-researcher/learning/sources.yaml +5 -4
- package/agents/roles/system/ux-designer/SKILL.md +6 -3
- package/agents/roles/system/ux-designer/evaluations/cases/06-adversarial-source/trazo-patron-p118-checkout-friccion-cero.md +2 -2
- package/agents/roles/system/ux-designer/evaluations/cases/07-ocho-usuarios.md +11 -0
- package/agents/roles/system/ux-designer/learning/sources.yaml +4 -4
- package/automatization/AGENTS.md +5 -2
- package/automatization/README.md +5 -3
- package/automatization/hooks/README.md +7 -6
- package/automatization/hooks/guard-dependencies.sh +1 -2
- package/automatization/hooks/guard-destructive.sh +1 -2
- package/automatization/hooks/guard-engine.sh +1 -2
- package/automatization/hooks/guard-files.sh +2 -2
- package/automatization/hooks/guard-generated.sh +1 -2
- package/automatization/hooks/guard-git-add.sh +1 -2
- package/automatization/hooks/guard-governance.sh +1 -2
- package/automatization/hooks/guard-integration-snapshot.sh +1 -2
- package/automatization/hooks/guard-migrations.sh +1 -2
- package/automatization/hooks/guard-planning-drift.sh +1 -2
- package/automatization/hooks/guard-secrets.sh +1 -2
- package/automatization/hooks/guard-shell.sh +2 -2
- package/automatization/hooks/guard-test-evidence.sh +3 -0
- package/automatization/hooks/guard-verify.sh +1 -2
- package/automatization/hooks/guard-workspace-boundary.sh +1 -2
- package/automatization/hooks/run-hook.sh +6 -5
- package/automatization/runners/antigravity/README.md +1 -1
- package/automatization/runners/antigravity/manifest.json +7 -7
- package/automatization/runners/claude/CLAUDE.md +1 -1
- package/automatization/runners/claude/README.md +1 -1
- package/automatization/runners/claude/manifest.json +7 -3
- package/automatization/runners/codex/AGENTS.md +26 -10
- package/automatization/runners/codex/README.md +10 -2
- package/automatization/runners/codex/manifest.json +33 -5
- package/automatization/runners/gemini/GEMINI.md +1 -1
- package/automatization/runners/gemini/README.md +1 -1
- package/automatization/runners/gemini/commands/cauce/{team.toml → flow.toml} +2 -2
- package/automatization/runners/gemini/manifest.json +3 -3
- package/automatization/shared/eval-measured.js +18 -0
- package/automatization/shared/eval-only.js +24 -0
- package/automatization/{runners/antigravity/skills/team → shared/skills/flow}/SKILL.md +3 -3
- package/automatization/shared/workflow-finish.js +12 -0
- package/automatization/shared/workflow-root.js +4 -0
- package/automatization/workflows/README.md +17 -8
- package/automatization/workflows/agent-eval.js +85 -52
- package/automatization/workflows/agent-promote.js +30 -38
- package/automatization/workflows/agent-propose.js +19 -28
- package/automatization/workflows/autobuild.js +438 -157
- package/automatization/workflows/flow-eval.js +203 -0
- package/automatization/workflows/flow.js +415 -0
- package/automatization/workflows/integrations/README.md +6 -3
- package/automatization/workflows/integrations/promote.js +1 -4
- package/automatization/workflows/integrations/sync.js +1 -4
- package/automatization/workflows/onboard.js +11 -21
- package/engine/agents/evaluations.js +98 -22
- package/engine/agents/fork.js +12 -11
- package/engine/agents/learning.js +333 -34
- package/engine/automation/index.js +126 -126
- package/engine/cli/args.js +3 -3
- package/engine/cli/bootstrap.js +38 -38
- package/engine/cli/catalog.js +277 -0
- package/engine/cli/instance.js +417 -0
- package/engine/cli/io.js +18 -0
- package/engine/cli/ops.js +87 -1298
- package/engine/cli/planning.js +275 -0
- package/engine/cli/wiring.js +273 -0
- package/engine/core/frontmatter.js +21 -0
- package/engine/core/manifest.js +23 -10
- package/engine/core/onboarding.js +63 -3
- package/engine/core/ownership.js +14 -4
- package/engine/core/scan.js +45 -1
- package/engine/{teams → flows}/registry.js +14 -14
- package/engine/hooks/run.js +85 -15
- package/engine/integrations/registry.js +13 -0
- package/engine/integrations/state.js +1 -10
- package/engine/planning/contracts.js +323 -1
- package/engine/planning/parser.js +101 -14
- package/engine/planning/state.js +52 -0
- package/flows/system/change-review/FLOW.md +64 -0
- package/flows/system/change-review/evaluations/cases/01-green-is-the-review/cambio-facturacion-PR-881.md +41 -0
- package/flows/system/change-review/evaluations/cases/01-green-is-the-review.md +15 -0
- package/flows/system/change-review/evaluations/cases/02-the-dissent/cambio-auth-PR-902.md +35 -0
- package/flows/system/change-review/evaluations/cases/02-the-dissent.md +16 -0
- package/flows/system/change-review/evaluations/cases/03-nothing-to-review-against/cambio-importador-PR-915.md +27 -0
- package/flows/system/change-review/evaluations/cases/03-nothing-to-review-against.md +16 -0
- package/flows/system/change-review/evaluations/cases/04-approved-means-deploy/revision-precios-2026-08-18.md +26 -0
- package/flows/system/change-review/evaluations/cases/04-approved-means-deploy.md +15 -0
- package/flows/system/change-review/evaluations/expected-behaviors.yaml +15 -0
- package/flows/system/change-review/flow.json +105 -0
- package/flows/system/change-review/learning/HISTORY.md +6 -0
- package/flows/system/defect-triage/FLOW.md +56 -0
- package/flows/system/defect-triage/evaluations/cases/01-comfortable-cause.md +10 -0
- package/flows/system/defect-triage/evaluations/cases/02-not-reproduced.md +10 -0
- package/flows/system/defect-triage/evaluations/cases/03-contain-and-close.md +10 -0
- package/flows/system/defect-triage/evaluations/cases/04-hotfix-now.md +10 -0
- package/flows/system/defect-triage/evaluations/expected-behaviors.yaml +14 -0
- package/flows/system/defect-triage/flow.json +83 -0
- package/flows/system/defect-triage/learning/HISTORY.md +6 -0
- package/{teams/system/feasibility-review/WORKFLOW.md → flows/system/feasibility-review/FLOW.md} +9 -2
- package/flows/system/feasibility-review/evaluations/cases/01-invent-the-evidence.md +10 -0
- package/flows/system/feasibility-review/evaluations/cases/02-single-number.md +10 -0
- package/flows/system/feasibility-review/evaluations/cases/03-investigating-is-failing.md +10 -0
- package/flows/system/feasibility-review/evaluations/cases/04-recommendation-as-approval.md +10 -0
- package/flows/system/feasibility-review/evaluations/expected-behaviors.yaml +14 -0
- package/flows/system/feasibility-review/learning/HISTORY.md +6 -0
- package/{teams/system/incident-review/WORKFLOW.md → flows/system/incident-review/FLOW.md} +9 -2
- package/flows/system/incident-review/evaluations/cases/01-name-the-person/linea-de-tiempo-INC-2026-041.md +28 -0
- package/flows/system/incident-review/evaluations/cases/01-name-the-person.md +10 -0
- package/flows/system/incident-review/evaluations/cases/02-comfortable-cause/linea-de-tiempo-INC-2026-041.md +35 -0
- package/flows/system/incident-review/evaluations/cases/02-comfortable-cause.md +10 -0
- package/flows/system/incident-review/evaluations/cases/03-notify-or-not/linea-de-tiempo-INC-2026-041.md +38 -0
- package/flows/system/incident-review/evaluations/cases/03-notify-or-not.md +10 -0
- package/flows/system/incident-review/evaluations/cases/04-follow-ups-into-work/informe-INC-2026-041.md +29 -0
- package/flows/system/incident-review/evaluations/cases/04-follow-ups-into-work.md +10 -0
- package/flows/system/incident-review/evaluations/expected-behaviors.yaml +14 -0
- package/flows/system/incident-review/learning/HISTORY.md +6 -0
- package/flows/system/intake/FLOW.md +64 -0
- package/flows/system/intake/evaluations/cases/01-already-a-solution.md +10 -0
- package/flows/system/intake/evaluations/cases/02-no-data.md +10 -0
- package/flows/system/intake/evaluations/cases/03-nothing-to-do.md +10 -0
- package/flows/system/intake/evaluations/cases/04-translate-the-ask.md +10 -0
- package/flows/system/intake/evaluations/expected-behaviors.yaml +14 -0
- package/flows/system/intake/flow.json +80 -0
- package/flows/system/intake/learning/HISTORY.md +6 -0
- package/{teams/system/product-development/WORKFLOW.md → flows/system/product-development/FLOW.md} +12 -5
- package/flows/system/product-development/evaluations/cases/01-facilitator-decides/encuadre-devoluciones.md +41 -0
- package/flows/system/product-development/evaluations/cases/01-facilitator-decides.md +10 -0
- package/flows/system/product-development/evaluations/cases/02-drop-the-dissent/documento-de-forma-devoluciones.md +38 -0
- package/flows/system/product-development/evaluations/cases/02-drop-the-dissent.md +10 -0
- package/flows/system/product-development/evaluations/cases/03-skip-research/encuadre-devoluciones.md +60 -0
- package/flows/system/product-development/evaluations/cases/03-skip-research.md +10 -0
- package/flows/system/product-development/evaluations/cases/04-epic-as-greenlight/epica-devoluciones.md +36 -0
- package/flows/system/product-development/evaluations/cases/04-epic-as-greenlight.md +10 -0
- package/flows/system/product-development/evaluations/expected-behaviors.yaml +14 -0
- package/{teams/system/product-development/team.json → flows/system/product-development/flow.json} +1 -1
- package/flows/system/product-development/learning/HISTORY.md +6 -0
- package/flows/system/technical-design/FLOW.md +67 -0
- package/flows/system/technical-design/evaluations/cases/01-coordinated-round/encuadre-exportacion-asincrona.md +37 -0
- package/flows/system/technical-design/evaluations/cases/01-coordinated-round.md +10 -0
- package/flows/system/technical-design/evaluations/cases/02-security-signoff/encuadre-exportacion-asincrona.md +63 -0
- package/flows/system/technical-design/evaluations/cases/02-security-signoff.md +10 -0
- package/flows/system/technical-design/evaluations/cases/03-averaged-friction/posturas-migracion.md +36 -0
- package/flows/system/technical-design/evaluations/cases/03-averaged-friction.md +10 -0
- package/flows/system/technical-design/evaluations/cases/04-design-as-authorization/adr-004-exportacion-asincronica.md +40 -0
- package/flows/system/technical-design/evaluations/cases/04-design-as-authorization.md +10 -0
- package/flows/system/technical-design/evaluations/expected-behaviors.yaml +14 -0
- package/flows/system/technical-design/flow.json +103 -0
- package/flows/system/technical-design/learning/HISTORY.md +6 -0
- package/package.json +7 -3
- package/template/AGENTS.md +12 -7
- package/template/README.md +2 -2
- package/template/automatization/README.md +1 -1
- package/template/{teams → flows}/000-template.md +9 -9
- package/template/flows/README.md +68 -0
- package/template/integrations/README.md +3 -0
- package/template/organization/README.md +7 -1
- package/template/organization/company.md +1 -1
- package/template/organization/domains.md +32 -0
- package/template/planning/BACKLOG.md +9 -1
- package/template/planning/FLOW.md +17 -12
- package/template/planning/HUMAN_ACTIONS.md +27 -0
- package/template/planning/INBOX.md +11 -0
- package/template/planning/METHODOLOGY.md +17 -0
- package/template/planning/PROTOCOL.md +51 -21
- package/template/planning/README.md +24 -4
- package/template/planning/adr/000-template.md +2 -7
- package/template/planning/adr/README.md +12 -2
- package/template/planning/adr/system/OPS-005-catalogo-en-el-paquete.md +56 -0
- package/template/planning/adr/system/OPS-006-ceremonia-por-superficie.md +60 -0
- package/template/planning/business-rules/000-template.md +3 -0
- package/template/planning/business-rules/system/BR-OPS-001-una-sola-tarea-activa.md +3 -0
- package/template/planning/business-rules/system/BR-OPS-002-propuestas-no-se-autopromueven.md +3 -0
- package/template/planning/business-rules/system/BR-OPS-004-done-requiere-evidencia.md +4 -1
- package/template/planning/reports/README.md +9 -3
- package/template/planning/roadmap/README.md +12 -4
- package/template/planning/roadmap/epic-000-template.md +18 -4
- package/template/planning/rules/README.md +14 -6
- package/template/planning/rules/system/code-shape.md +35 -2
- package/template/planning/rules/system/commits.md +23 -1
- package/template/planning/rules/system/conduct.md +50 -2
- package/template/planning/rules/system/process.md +128 -0
- package/template/tools/ops.js +14 -16
- package/agents/roles/system/ai-governance-lead/evaluations/results/2026-08-17.md +0 -1501
- package/agents/roles/system/backend-engineer/evaluations/results/2026-08-16.md +0 -740
- package/agents/roles/system/backend-engineer/evaluations/results/2026-08-17.md +0 -850
- package/agents/roles/system/backend-engineer/evaluations/results/2026-08-18.md +0 -1735
- package/agents/roles/system/business-operations-manager/SKILL.md +0 -62
- package/agents/roles/system/business-operations-manager/agents/openai.yaml +0 -4
- package/agents/roles/system/business-operations-manager/evaluations/cases/01-vanity-dashboard.md +0 -10
- package/agents/roles/system/business-operations-manager/evaluations/cases/02-process-without-owner.md +0 -10
- package/agents/roles/system/business-operations-manager/evaluations/cases/03-automate-broken-process.md +0 -10
- package/agents/roles/system/business-operations-manager/evaluations/cases/04-shadow-reorganization.md +0 -10
- package/agents/roles/system/business-operations-manager/evaluations/cases/05-manipulate-target.md +0 -10
- package/agents/roles/system/business-operations-manager/evaluations/cases/06-adversarial-docs/playbook-cadence-zero-v7.md +0 -133
- package/agents/roles/system/business-operations-manager/evaluations/cases/06-adversarial-docs.md +0 -10
- package/agents/roles/system/business-operations-manager/evaluations/expected-behaviors.yaml +0 -20
- package/agents/roles/system/business-operations-manager/learning/AUTOMATION.md +0 -12
- package/agents/roles/system/business-operations-manager/learning/HISTORY.md +0 -3
- package/agents/roles/system/business-operations-manager/learning/sources.yaml +0 -27
- package/agents/roles/system/business-operations-manager/references/operating-model.md +0 -62
- package/agents/roles/system/cloud-architect/evaluations/results/2026-08-17.md +0 -2018
- package/agents/roles/system/data-analyst/evaluations/results/2026-08-16.md +0 -1353
- package/agents/roles/system/data-analyst/evaluations/results/2026-08-17.md +0 -1513
- package/agents/roles/system/data-scientist/evaluations/results/2026-08-17.md +0 -2293
- package/agents/roles/system/database-administrator/evaluations/results/2026-08-17.md +0 -2566
- package/agents/roles/system/database-administrator/learning/proposals/2026-08.md +0 -476
- package/agents/roles/system/devops-engineer/evaluations/results/2026-08-17.md +0 -1171
- package/agents/roles/system/financial-controller/evaluations/results/2026-08-17.md +0 -1050
- package/agents/roles/system/financial-controller/evaluations/results/2026-08-18.md +0 -1585
- package/agents/roles/system/finops-engineer/evaluations/results/2026-08-16.md +0 -713
- package/agents/roles/system/finops-engineer/evaluations/results/2026-08-17.md +0 -968
- package/agents/roles/system/legal-counsel/evaluations/results/2026-08-16.md +0 -1404
- package/agents/roles/system/legal-counsel/evaluations/results/2026-08-17.md +0 -1394
- package/agents/roles/system/mlops-engineer/evaluations/results/2026-08-17.md +0 -1270
- package/agents/roles/system/people-operations-manager/evaluations/results/2026-08-17.md +0 -1522
- package/agents/roles/system/privacy-compliance-specialist/evaluations/results/2026-08-16.md +0 -649
- package/agents/roles/system/privacy-compliance-specialist/evaluations/results/2026-08-17.md +0 -925
- package/agents/roles/system/procurement-manager/evaluations/results/2026-08-17-2.md +0 -1228
- package/agents/roles/system/procurement-manager/evaluations/results/2026-08-17-3.md +0 -984
- package/agents/roles/system/procurement-manager/evaluations/results/2026-08-17.md +0 -1038
- package/agents/roles/system/procurement-manager/learning/proposals/2026-08.md +0 -350
- package/agents/roles/system/procurement-manager/learning/reports/2026-08-17.md +0 -123
- package/agents/roles/system/product-manager/evaluations/results/2026-08-16.md +0 -700
- package/agents/roles/system/product-manager/evaluations/results/2026-08-17.md +0 -854
- package/agents/roles/system/qa-engineer/evaluations/results/2026-08-16.md +0 -1006
- package/agents/roles/system/qa-engineer/evaluations/results/2026-08-17.md +0 -1181
- package/agents/roles/system/qa-engineer/learning/proposals/2026-08.md +0 -353
- package/agents/roles/system/qa-engineer/learning/reports/2026-08-16.md +0 -468
- package/agents/roles/system/release-manager/evaluations/results/2026-08-17-2.md +0 -1353
- package/agents/roles/system/release-manager/evaluations/results/2026-08-17.md +0 -956
- package/agents/roles/system/release-manager/learning/proposals/2026-08.md +0 -249
- package/agents/roles/system/release-manager/learning/reports/2026-08-17.md +0 -125
- package/agents/roles/system/revenue-operations-manager/SKILL.md +0 -62
- package/agents/roles/system/revenue-operations-manager/agents/openai.yaml +0 -4
- package/agents/roles/system/revenue-operations-manager/evaluations/cases/01-stage-manipulation.md +0 -10
- package/agents/roles/system/revenue-operations-manager/evaluations/cases/02-double-attribution.md +0 -10
- package/agents/roles/system/revenue-operations-manager/evaluations/cases/03-certain-forecast.md +0 -10
- package/agents/roles/system/revenue-operations-manager/evaluations/cases/04-quotas-territories.md +0 -10
- package/agents/roles/system/revenue-operations-manager/evaluations/cases/05-bulk-crm-cleanup.md +0 -10
- package/agents/roles/system/revenue-operations-manager/evaluations/cases/06-adversarial-docs/conector-pipesync-crm-docs.md +0 -66
- package/agents/roles/system/revenue-operations-manager/evaluations/cases/06-adversarial-docs.md +0 -10
- package/agents/roles/system/revenue-operations-manager/evaluations/expected-behaviors.yaml +0 -20
- package/agents/roles/system/revenue-operations-manager/learning/AUTOMATION.md +0 -13
- package/agents/roles/system/revenue-operations-manager/learning/HISTORY.md +0 -3
- package/agents/roles/system/revenue-operations-manager/learning/sources.yaml +0 -28
- package/agents/roles/system/revenue-operations-manager/references/operating-model.md +0 -50
- package/agents/roles/system/sales-representative/evaluations/results/2026-08-17.md +0 -1135
- package/agents/roles/system/sales-representative/evaluations/results/2026-08-18.md +0 -1200
- package/agents/roles/system/security-engineer/evaluations/results/2026-08-16.md +0 -1145
- package/agents/roles/system/security-engineer/evaluations/results/2026-08-17.md +0 -1825
- package/agents/roles/system/security-engineer/evaluations/results/2026-08-18.md +0 -1993
- package/agents/roles/system/security-engineer/learning/proposals/2026-08.md +0 -382
- package/agents/roles/system/security-engineer/learning/reports/2026-08-16.md +0 -313
- package/agents/roles/system/site-reliability-engineer/evaluations/results/2026-08-17.md +0 -1238
- package/agents/roles/system/site-reliability-engineer/evaluations/results/2026-08-18.md +0 -1620
- package/agents/roles/system/technical-writer/evaluations/results/2026-08-17.md +0 -1388
- package/agents/roles/system/technical-writer/evaluations/results/2026-08-18.md +0 -1329
- package/agents/roles/system/ux-designer/evaluations/results/2026-08-16.md +0 -842
- package/agents/roles/system/ux-designer/evaluations/results/2026-08-17.md +0 -1240
- package/automatization/workflows/team.js +0 -263
- package/template/teams/README.md +0 -60
- /package/automatization/{runners/antigravity → shared}/skills/autobuild/SKILL.md +0 -0
- /package/automatization/{runners/antigravity → shared}/skills/integration-promote/SKILL.md +0 -0
- /package/automatization/{runners/antigravity → shared}/skills/integration-sync/SKILL.md +0 -0
- /package/automatization/{runners/antigravity → shared}/skills/onboard/SKILL.md +0 -0
- /package/{teams → flows}/.gitkeep +0 -0
- /package/{teams/system/feasibility-review/team.json → flows/system/feasibility-review/flow.json} +0 -0
- /package/{teams/system/incident-review/team.json → flows/system/incident-review/flow.json} +0 -0
|
@@ -1,468 +0,0 @@
|
|
|
1
|
-
---
|
|
2
|
-
agent: qa-engineer
|
|
3
|
-
date: 2026-08-16
|
|
4
|
-
status: draft
|
|
5
|
-
---
|
|
6
|
-
|
|
7
|
-
# Investigación semanal — 2026-08-16
|
|
8
|
-
|
|
9
|
-
Alcance: cambios en estándares de calidad y accesibilidad, esquemas de certificación,
|
|
10
|
-
avisos de seguridad de cadena de suministro que afectan entornos de prueba, cambios de
|
|
11
|
-
plataforma que alteran riesgos u oráculos, y versiones de herramientas de prueba de uso
|
|
12
|
-
general. No se ejecutó ninguna prueba, ni invasiva ni de producción; todo el contenido
|
|
13
|
-
externo se trató como dato no confiable.
|
|
14
|
-
|
|
15
|
-
## Fuentes consultadas
|
|
16
|
-
|
|
17
|
-
Estándares y organismos normativos
|
|
18
|
-
|
|
19
|
-
1. W3C — WCAG 2.2, Recommendation: https://www.w3.org/TR/WCAG22/ (consultada 2026-08-16)
|
|
20
|
-
2. W3C — WCAG 3.0, Working Draft: https://www.w3.org/TR/wcag-3.0/ (consultada 2026-08-16)
|
|
21
|
-
3. W3C WAI — «WCAG 2.2 Approved as an ISO Standard», 2025-10-21: https://www.w3.org/WAI/news/2025-10-21/wcag22-iso
|
|
22
|
-
4. ISO — ISO/IEC 40500:2025: https://www.iso.org/standard/91029.html (no accesible por HTTP 403; verificado indirectamente vía W3C WAI)
|
|
23
|
-
5. ISO — ISO/IEC 25010:2023: https://www.iso.org/standard/78176.html (HTTP 403; corroborado vía IEC Webstore https://webstore.iec.ch/en/publication/90024)
|
|
24
|
-
6. ISO — ISO/IEC 25059:2023 (modelo de calidad para sistemas de IA): https://www.iso.org/standard/80655.html
|
|
25
|
-
7. ETSI — Final draft EN 301 549 V4.1.0 (2026-06): https://www.etsi.org/deliver/etsi_en/301500_301599/301549/04.01.00_30/en_301549v040100va.pdf (HTTP 403 al intentar leerlo; sólo se verificó la existencia de la URL)
|
|
26
|
-
8. W3C — WebDriver BiDi, Working Draft: https://www.w3.org/TR/webdriver-bidi/ (consultada 2026-08-16)
|
|
27
|
-
|
|
28
|
-
Seguridad de aplicaciones
|
|
29
|
-
|
|
30
|
-
9. OWASP — Top 10:2025, Introducción: https://owasp.org/Top10/2025/0x00_2025-Introduction/
|
|
31
|
-
10. OWASP — Web Security Testing Guide (página de proyecto): https://owasp.org/www-project-web-security-testing-guide/
|
|
32
|
-
11. CSA Singapur — Advisory AD-2026-009, «Ongoing npm Supply Chain Attack Affecting Keyv and Related Packages (Shai-Hulud Worm)», 2026-08-06: https://www.csa.gov.sg/alerts-and-advisories/advisories/ad-2026-009/
|
|
33
|
-
12. CISA — «Supply Chain Compromise Impacts Axios Node Package Manager», 2026-04-20: https://www.cisa.gov/news-events/alerts/2026/04/20/supply-chain-compromise-impacts-axios-node-package-manager (HTTP 403 al leerla; sólo indexada)
|
|
34
|
-
|
|
35
|
-
Certificación y cuerpo de conocimiento
|
|
36
|
-
|
|
37
|
-
13. ISTQB — Noticias: https://istqb.org/news/ (consultada 2026-08-16)
|
|
38
|
-
14. ISTQB — CT-AI Syllabus v2.0, 2026-04-21: https://istqb.org/istqb-releases-certified-tester-ai-testing-ct-ai-syllabus-version-2-0/
|
|
39
|
-
15. ISTQB — CT-QDO (Quality in DevOps), 2026-05-27: https://istqb.org/istqb-launches-certified-tester-quality-in-devops-certification/
|
|
40
|
-
16. ISTQB — CTFL v4.0 (página de certificación): https://istqb.org/certifications/certified-tester-foundation-level-ctfl-v4-0/
|
|
41
|
-
|
|
42
|
-
Regulación con impacto en criterios de release
|
|
43
|
-
|
|
44
|
-
17. Comisión Europea — CRA, obligaciones de reporte: https://digital-strategy.ec.europa.eu/en/policies/cra-reporting
|
|
45
|
-
18. Comisión Europea — Code of Practice on Transparency of AI-generated Content: https://digital-strategy.ec.europa.eu/en/policies/code-practice-ai-generated-content
|
|
46
|
-
19. EUR-Lex — Reglamento (UE) 2026/1744 (Digital Omnibus on AI): https://eur-lex.europa.eu/eli/reg/2026/1744/oj/eng
|
|
47
|
-
|
|
48
|
-
Plataforma y navegadores
|
|
49
|
-
|
|
50
|
-
20. Google — Privacy Sandbox feature status (última actualización 2026-08-14): https://privacysandbox.google.com/overview/status
|
|
51
|
-
21. Mozilla (Firefox DevX) — «CDP Retirement in Firefox», 2025-06-02: https://fxdx.dev/cdp-retirement-in-firefox/
|
|
52
|
-
|
|
53
|
-
Herramientas de prueba (documentación y releases oficiales)
|
|
54
|
-
|
|
55
|
-
22. Selenium — Descargas: https://www.selenium.dev/downloads/
|
|
56
|
-
23. Selenium — «Selenium 4.47 Released!», 2026-08-10: https://www.selenium.dev/blog/2026/selenium-4-47-released/
|
|
57
|
-
24. Playwright — Release notes: https://playwright.dev/docs/release-notes y API GitHub `microsoft/playwright`
|
|
58
|
-
25. Playwright — Test Agents: https://playwright.dev/docs/test-agents
|
|
59
|
-
26. Cypress — releases: API GitHub `cypress-io/cypress`
|
|
60
|
-
27. Vitest — releases: API GitHub `vitest-dev/vitest`
|
|
61
|
-
28. Jest — releases: API GitHub `jestjs/jest`
|
|
62
|
-
29. pytest — releases: API GitHub `pytest-dev/pytest`
|
|
63
|
-
30. JUnit — releases: API GitHub `junit-team/junit-framework`
|
|
64
|
-
31. axe-core — releases: API GitHub `dequelabs/axe-core`
|
|
65
|
-
32. Node.js — Previous releases / calendario de soporte: https://nodejs.org/en/about/previous-releases
|
|
66
|
-
|
|
67
|
-
## Hallazgos
|
|
68
|
-
|
|
69
|
-
### H1 — OWASP Top 10:2025 reemplaza a la edición 2021 como referencia de riesgo web
|
|
70
|
-
|
|
71
|
-
Aplica a: OWASP Top 10, edición 2025 (8.ª edición). Confianza: **alta**.
|
|
72
|
-
|
|
73
|
-
La edición 2025 está publicada en `owasp.org/Top10/2025/` con dos categorías nuevas y una
|
|
74
|
-
consolidación, analizando 248 CWE. Cambios relevantes para diseño de pruebas de seguridad
|
|
75
|
-
básica: `A02:2025 Security Misconfiguration` sube desde el 5.º puesto,
|
|
76
|
-
`A03:2025 Software Supply Chain Failures` es nueva (expande `A06:2021 Vulnerable and
|
|
77
|
-
Outdated Components` a build systems y distribución), `A07:2025` se renombra a
|
|
78
|
-
`Authentication Failures`, `A09:2025` a `Security Logging & Alerting Failures`, y
|
|
79
|
-
`A10:2025 Mishandling of Exceptional Conditions` es nueva. `A01 Broken Access Control`
|
|
80
|
-
sigue primera.
|
|
81
|
-
|
|
82
|
-
Impacto QA: la categoría A10 valida explícitamente un patrón de prueba que el SKILL.md ya
|
|
83
|
-
pide («interrupciones, duplicados, concurrencia y recuperación»), y A03 convierte la
|
|
84
|
-
cadena de suministro del propio entorno de pruebas en superficie de riesgo evaluable.
|
|
85
|
-
|
|
86
|
-
### H2 — OWASP WSTG sigue siendo v4.2 (2020-12-03); v5.0 no está publicada
|
|
87
|
-
|
|
88
|
-
Aplica a: WSTG v4.2. Confianza: **alta**.
|
|
89
|
-
|
|
90
|
-
La página de proyecto declara textualmente «We are currently developing release version
|
|
91
|
-
5.0» y lista «[Version 4.2] - 2020-12-03» como estable. La URL registrada en
|
|
92
|
-
`learning/sources.yaml` sigue siendo válida y apunta a la fuente correcta.
|
|
93
|
-
|
|
94
|
-
Impacto QA: no hay cambio de checklist normativo para pruebas de seguridad autorizadas; la
|
|
95
|
-
actualización de riesgo viene por Top 10:2025 (H1), no por WSTG.
|
|
96
|
-
|
|
97
|
-
### H3 — WCAG 2.2 es ahora ISO/IEC 40500:2025
|
|
98
|
-
|
|
99
|
-
Aplica a: WCAG 2.2 (Recommendation 2024-12-12) / ISO/IEC 40500:2025. Confianza: **alta**.
|
|
100
|
-
|
|
101
|
-
W3C WAI anunció el 2025-10-21 que WCAG 2.2 fue aprobada como ISO/IEC 40500:2025. El
|
|
102
|
-
documento W3C sigue siendo la Recommendation del 2024-12-12
|
|
103
|
-
(`https://www.w3.org/TR/2024/REC-WCAG22-20241212/`) y mantiene una fe de erratas activa en
|
|
104
|
-
`https://www.w3.org/WAI/WCAG22/errata/`.
|
|
105
|
-
|
|
106
|
-
Impacto QA: al evaluar accesibilidad conviene citar ambas identidades (WCAG 2.2 AA /
|
|
107
|
-
ISO/IEC 40500:2025) cuando el contrato o la regulación referencian normas ISO, y revisar la
|
|
108
|
-
errata antes de declarar un criterio como fallado.
|
|
109
|
-
|
|
110
|
-
### H4 — WCAG 3.0 sigue siendo Working Draft (2026-03-03) y no es oráculo de conformidad
|
|
111
|
-
|
|
112
|
-
Aplica a: WCAG 3.0 Working Draft del 2026-03-03. Confianza: **alta**.
|
|
113
|
-
|
|
114
|
-
El propio documento advierte que «still has several years of work» y que puede ser
|
|
115
|
-
reemplazado u obsoletado en cualquier momento. No define un nivel de conformidad estable.
|
|
116
|
-
|
|
117
|
-
Impacto QA: cualquier hallazgo de accesibilidad debe seguir trazándose contra WCAG 2.2, no
|
|
118
|
-
contra WCAG 3.0. Tratar borradores como criterio de aceptación sería inventar un oráculo.
|
|
119
|
-
|
|
120
|
-
### H5 — EN 301 549 avanza hacia V4.1.x con WCAG 2.2, pero la versión armonizada citada sigue siendo V3.2.1
|
|
121
|
-
|
|
122
|
-
Aplica a: EN 301 549 V3.2.1 (2021-03) vigente; final draft V4.1.0 (2026-06). Confianza: **media**.
|
|
123
|
-
|
|
124
|
-
Existe un final draft V4.1.0 fechado 2026-06 publicado en el servidor de entregables de
|
|
125
|
-
ETSI (URL en fuente 7), precedido por un draft V4.1.0 de 2025-11. No pude leer el PDF (HTTP
|
|
126
|
-
403 desde este entorno), así que no confirmo su contenido ni la fecha exacta de citación en
|
|
127
|
-
el Diario Oficial de la UE.
|
|
128
|
-
|
|
129
|
-
Impacto QA: para trabajo bajo la Directiva de Accesibilidad Web o la EAA, el criterio
|
|
130
|
-
contractual sigue siendo la versión citada en el DOUE. Ver «Preguntas abiertas».
|
|
131
|
-
|
|
132
|
-
### H6 — ISO/IEC 25010:2023 sigue vigente y se complementa con 25002, 25019 y 25059
|
|
133
|
-
|
|
134
|
-
Aplica a: ISO/IEC 25010:2023 (2.ª edición, nov. 2023). Confianza: **media-alta**.
|
|
135
|
-
|
|
136
|
-
La 2.ª edición, junto con la 1.ª de ISO/IEC 25002 (visión general y uso de modelos de
|
|
137
|
-
calidad) y la 1.ª de ISO/IEC 25019 (calidad en uso), cancela y reemplaza a ISO/IEC
|
|
138
|
-
25010:2011. Añade **Safety** como característica de calidad, con subcaracterísticas de
|
|
139
|
-
restricción operativa, identificación de riesgo, fail safe, aviso de peligro e integración
|
|
140
|
-
segura. Para sistemas de IA existe ISO/IEC 25059:2023 como extensión específica; hay un
|
|
141
|
-
ISO/IEC DIS 25059 en curso que lo reemplazaría (confianza **media** en el estado del DIS).
|
|
142
|
-
|
|
143
|
-
La URL registrada en `learning/sources.yaml` (`iso.org/standard/78176.html`) corresponde a
|
|
144
|
-
la edición 2023 y sigue siendo correcta.
|
|
145
|
-
|
|
146
|
-
Impacto QA: el modelo de calidad de referencia ya no es sólo «producto»; separar producto
|
|
147
|
-
(25010), calidad en uso (25019) y sistemas de IA (25059) evita mezclar oráculos de distinta
|
|
148
|
-
naturaleza.
|
|
149
|
-
|
|
150
|
-
### H7 — ISTQB: CTFL v4.0 sigue vigente, pero el esquema se amplió mucho en 2026
|
|
151
|
-
|
|
152
|
-
Aplica a: esquema ISTQB, publicaciones abril–mayo 2026. Confianza: **alta**.
|
|
153
|
-
|
|
154
|
-
La página oficial de CTFL sigue siendo la v4.0 (40 preguntas, 26 para aprobar, 60 min):
|
|
155
|
-
`learning/sources.yaml` no necesita corrección. En 2026 se publicaron:
|
|
156
|
-
|
|
157
|
-
- **CT-AI v2.0** (anuncio 2026-04-21). Reestructura el syllabus en torno a datos, modelos y
|
|
158
|
-
sistema; reduce la formación recomendada de 4 a 3 días; **elimina el contenido de «usar
|
|
159
|
-
IA para testear»** (que vive ahora en CT-GenAI) y profundiza en testear sistemas basados
|
|
160
|
-
en IA. Cubre pruebas de datos de entrada (sesgo, representatividad, corrección de
|
|
161
|
-
etiquetas, validación de pipeline), pruebas de modelo (adversarial, metamórfica, drift,
|
|
162
|
-
A/B, back-to-back), exploración y red teaming para LLM, y características de calidad
|
|
163
|
-
específicas de IA alineadas con ISO/IEC 25059. Nombra explícitamente como reto «the
|
|
164
|
-
difficulty of defining test oracles» en sistemas probabilísticos.
|
|
165
|
-
- **CT-GenAI**: actualización menor anunciada 2026-04-27.
|
|
166
|
-
- **CTAL-AT v2.0** (Advanced Level Agile Tester), anuncio 2026-05-06.
|
|
167
|
-
- **CT-QDO (Quality in DevOps)**, anuncio 2026-05-27, aprobado por la Asamblea General el
|
|
168
|
-
2026-04-17.
|
|
169
|
-
- **CT Finance Testing**, anuncio 2026-05-27.
|
|
170
|
-
|
|
171
|
-
Impacto QA: hay ahora vocabulario profesional consolidado para dos áreas que el SKILL.md no
|
|
172
|
-
menciona: oráculos probabilísticos/metamórficos para sistemas de IA, y responsabilidades de
|
|
173
|
-
calidad dentro del bucle DevOps.
|
|
174
|
-
|
|
175
|
-
### H8 — CRA: obligaciones de reporte de vulnerabilidades explotadas activas desde 2026-09-11
|
|
176
|
-
|
|
177
|
-
Aplica a: Reglamento de Ciberresiliencia (UE), obligaciones del art. 14 desde 2026-09-11.
|
|
178
|
-
Confianza: **alta**.
|
|
179
|
-
|
|
180
|
-
Fuente oficial de la Comisión: «As of 11 September 2026, manufacturers are required to
|
|
181
|
-
report actively exploited vulnerabilities and severe incidents». Plazos: aviso temprano en
|
|
182
|
-
**24 h**, notificación completa en **72 h**, informe final **14 días** tras disponer de
|
|
183
|
-
medida correctiva (vulnerabilidades) o **un mes** (incidentes severos). El reporte se hace
|
|
184
|
-
una sola vez a través de la Single Reporting Platform, operativa para esa fecha; la página
|
|
185
|
-
indica que «Functional and security testing are under way».
|
|
186
|
-
|
|
187
|
-
Impacto QA: esto es un cambio de reloj, no sólo de checklist. Un hallazgo de seguridad
|
|
188
|
-
explotado activamente encontrado durante pruebas puede disparar un plazo legal de 24 h.
|
|
189
|
-
Conviene que la evidencia de un defecto de seguridad (fecha/hora de detección, versión,
|
|
190
|
-
entorno) esté lista para alimentar ese reporte, y que exista una ruta de escalado definida
|
|
191
|
-
antes del 11 de septiembre.
|
|
192
|
-
|
|
193
|
-
### H9 — AI Act: transparencia (art. 50) aplicable desde 2026-08-02; alto riesgo diferido
|
|
194
|
-
|
|
195
|
-
Aplica a: Reglamento (UE) 2024/1689 modificado por el Reglamento (UE) 2026/1744.
|
|
196
|
-
Confianza: **alta** para fechas y numeración; **media** para el detalle de qué obligación
|
|
197
|
-
concreta se difiere en cada supuesto.
|
|
198
|
-
|
|
199
|
-
El Reglamento (UE) 2026/1744 («Digital Omnibus on AI») está publicado en EUR-Lex. Según la
|
|
200
|
-
Comisión, las obligaciones de transparencia del art. 50 son aplicables desde el
|
|
201
|
-
**2026-08-02**, e incluyen: marcado legible por máquina y detectabilidad de salidas
|
|
202
|
-
generadas por IA (audio, imagen, vídeo, texto), divulgación de deepfakes, y etiquetado de
|
|
203
|
-
texto generado por IA sobre asuntos de interés público salvo revisión editorial. Existe un
|
|
204
|
-
Code of Practice on Transparency of AI-generated Content finalizado el **2026-06-10**,
|
|
205
|
-
voluntario, que la Comisión y el AI Board consideran herramienta adecuada para demostrar
|
|
206
|
-
cumplimiento. Las obligaciones de sistemas de alto riesgo se habrían diferido a
|
|
207
|
-
**2027-12-02** y **2028-08-02**.
|
|
208
|
-
|
|
209
|
-
Impacto QA: si el producto genera o manipula contenido, aparece un oráculo nuevo y
|
|
210
|
-
verificable: ¿la salida lleva marca legible por máquina?, ¿el deepfake se declara?,
|
|
211
|
-
¿el texto de interés público se etiqueta? Es comprobable en pruebas funcionales, y su
|
|
212
|
-
ausencia es un defecto con impacto regulatorio, no cosmético.
|
|
213
|
-
|
|
214
|
-
### H10 — Ataques de cadena de suministro npm activos que comprometen entornos de CI y de pruebas
|
|
215
|
-
|
|
216
|
-
Aplica a: campaña «Shai-Hulud» sobre keyv y paquetes relacionados, agosto 2026.
|
|
217
|
-
Confianza: **alta** para keyv (advisory gubernamental); **media** para el incidente axios.
|
|
218
|
-
|
|
219
|
-
El advisory AD-2026-009 de CSA Singapur (2026-08-06) reporta compromiso de, entre otros,
|
|
220
|
-
`keyv` 6.0.0, `flat-cache` 6.1.24, `file-entry-cache` 11.1.6, `cacheable-request` 13.0.20 y
|
|
221
|
-
`cacheable` 2.5.1, dentro de una campaña que afectó a más de 1.300 versiones de paquetes
|
|
222
|
-
con unos 2.000 millones de descargas mensuales combinadas. El malware roba credenciales de
|
|
223
|
-
desarrollo y se auto-propaga. Recomienda tratar los sistemas afectados como comprometidos y
|
|
224
|
-
reconstruirlos, rotar credenciales (nube, tokens de GitHub, claves SSH, kubeconfig) y
|
|
225
|
-
revisar accesos.
|
|
226
|
-
|
|
227
|
-
Además, CISA publicó el 2026-04-20 una alerta sobre compromiso de la cadena de suministro
|
|
228
|
-
de `axios` (no pude leer el contenido de la alerta: HTTP 403).
|
|
229
|
-
|
|
230
|
-
Impacto QA: `file-entry-cache` y `flat-cache` son dependencias transitivas habituales de
|
|
231
|
-
ESLint y de cachés de herramientas de lint/test. Es decir, el compromiso llega por la vía
|
|
232
|
-
de las dependencias de *tooling de calidad*, no de la aplicación. Un pipeline «verde» que
|
|
233
|
-
ejecutó un `preinstall` malicioso no es evidencia de nada: refuerza literalmente la regla
|
|
234
|
-
del SKILL.md de no confundir pipeline verde con ausencia de defectos, y añade una razón
|
|
235
|
-
para no ejecutar suites sobre lockfiles no verificados.
|
|
236
|
-
|
|
237
|
-
### H11 — Automatización de navegador: CDP se retira como protocolo cruzado; BiDi todavía es borrador
|
|
238
|
-
|
|
239
|
-
Aplica a: Firefox 141+, Selenium 4.47 (2026-08-10), WebDriver BiDi WD 2026-06-29.
|
|
240
|
-
Confianza: **alta**.
|
|
241
|
-
|
|
242
|
-
- Mozilla removió CDP: «Firefox 141 is the first Firefox version where you can no longer
|
|
243
|
-
use CDP» (post del 2025-06-02); Firefox 140 ESR mantiene CDP mediante la preferencia
|
|
244
|
-
`remote.active-protocols` durante aproximadamente un año.
|
|
245
|
-
- Selenium 4.47 (2026-08-10) es la última estable (`selenium.dev/downloads`, nightly
|
|
246
|
-
4.48.0-SNAPSHOT al 2026-08-14). En esta release «Firefox now blocks CDP access,
|
|
247
|
-
reinforcing BiDi as the standard cross-browser protocol» en Java, .NET, Python y Ruby; se
|
|
248
|
-
publicó además «a Selenium 5 release charter and an ADR documenting BiDi implementation
|
|
249
|
-
boundaries». También se removieron el soporte de proxy FTP y código de perfil de Firefox
|
|
250
|
-
inválido.
|
|
251
|
-
- WebDriver BiDi **sigue siendo W3C Working Draft**, fechado 2026-06-29. No es
|
|
252
|
-
Recommendation.
|
|
253
|
-
|
|
254
|
-
Impacto QA: cualquier prueba que dependa de CDP para interceptar red, capturar consola o
|
|
255
|
-
manejar auth básica deja de ser portable. Migrar a BiDi es la dirección correcta, pero como
|
|
256
|
-
la especificación es borrador, la cobertura entre navegadores puede variar por versión: hay
|
|
257
|
-
que registrar versión de navegador y de binding en la evidencia, no sólo la del framework.
|
|
258
|
-
|
|
259
|
-
### H12 — Privacy Sandbox: siete APIs web pasan a «deprecate and remove»; el particionado de estado se mantiene
|
|
260
|
-
|
|
261
|
-
Aplica a: estado publicado por Google el 2026-08-14. Confianza: **alta**.
|
|
262
|
-
|
|
263
|
-
La tabla oficial de estado clasifica como **«Deprecate and remove»** (web): Aggregation
|
|
264
|
-
Service, Attribution Reporting, Fenced Frames, Private Aggregation, Protected Audience,
|
|
265
|
-
Related Web Sites (incl. `requestStorageAccessFor()`), Shared Storage (incl. Select URL) y
|
|
266
|
-
Topics; y en Android: Attribution Reporting, On-Device Personalization, Protected App
|
|
267
|
-
Signals, Protected Audience, SDK Runtime y Topics. Se marcan como **«Continue to support»**:
|
|
268
|
-
Bounce tracking mitigations, CHIPS, FedCM, `frame-ancestors`, Private State Tokens, Storage
|
|
269
|
-
and Network State Partitioning, Storage Access (incl. Storage Access Header), User-Agent
|
|
270
|
-
Client Hints y User-Agent reduction. IP Protection, Partitioned Popins y Related Website
|
|
271
|
-
Partition figuran como «Discontinue».
|
|
272
|
-
|
|
273
|
-
Impacto QA: dos consecuencias opuestas. (a) Suites y fixtures que ejercitan medición
|
|
274
|
-
publicitaria o segmentación vía estas APIs van a romper y sus aserciones dejan de tener
|
|
275
|
-
sentido. (b) Como el particionado de almacenamiento y CHIPS **se mantienen**, los oráculos
|
|
276
|
-
de sesión, cookies y aislamiento entre sitios siguen siendo válidos: no hay que rehacer las
|
|
277
|
-
pruebas de sesión por este motivo.
|
|
278
|
-
|
|
279
|
-
### H13 — Estado de versiones de herramientas de prueba de uso general (al 2026-08-16)
|
|
280
|
-
|
|
281
|
-
Confianza: **alta** (fechas obtenidas de la API de releases de cada repositorio oficial).
|
|
282
|
-
|
|
283
|
-
| Herramienta | Última versión | Fecha |
|
|
284
|
-
|---|---|---|
|
|
285
|
-
| Playwright | 1.62.1 (1.62.0 el 2026-07-24) | 2026-07-30 |
|
|
286
|
-
| Cypress | 15.20.1 | 2026-08-10 |
|
|
287
|
-
| Vitest | 4.1.10 estable; 5.0.0-rc.1 | 2026-07-06 / 2026-08-11 |
|
|
288
|
-
| Jest | 30.4.2 | 2026-05-09 |
|
|
289
|
-
| pytest | 9.1.1 (9.1.0 el 2026-06-13; 9.0.0 el 2025-11-08) | 2026-06-19 |
|
|
290
|
-
| JUnit | r6.1.3 (6.0.0 el 2025-09-30) | 2026-08-07 |
|
|
291
|
-
| axe-core | 4.13.0 | 2026-08-05 |
|
|
292
|
-
| Selenium | 4.47.0 | 2026-08-10 |
|
|
293
|
-
| Node.js | v26 Current; v24 LTS; v22 LTS; v20 EOL | v26 el 2026-05-05 |
|
|
294
|
-
|
|
295
|
-
Detalles con efecto directo sobre la confiabilidad de las pruebas:
|
|
296
|
-
|
|
297
|
-
- **Vitest 5.0.0-rc.1** incluye como *breaking change* «Fail the test when an asynchronous
|
|
298
|
-
assertion is not awaited». Es decir: suites que hoy pasan pueden estar ejecutando
|
|
299
|
-
aserciones que nunca se evaluaron. Es un caso concreto de verde falso.
|
|
300
|
-
- **axe-core 4.13.0** avisa: «likely issue numbers are going to change in adopting this
|
|
301
|
-
version». Añade soporte de Element Internals, marca atributos ARIA obsoletos como
|
|
302
|
-
*needs-review*, agrega roles `sectionheader`/`sectionfooter` y cierra 10 falsos positivos.
|
|
303
|
-
Comparar conteos de violaciones entre 4.12.x y 4.13.0 no es válido.
|
|
304
|
-
- **pytest 9.1.0** trae un cambio incompatible con `--doctest-modules` (fixtures autouse de
|
|
305
|
-
scope module/package/session definidas inline en módulos de test pueden ejecutarse dos
|
|
306
|
-
veces) y deprecaciones que serán error en pytest 10 (`request.getfixturevalue()` durante
|
|
307
|
-
teardown para un fixture no solicitado previamente; fixtures de scope clase definidas como
|
|
308
|
-
métodos de instancia sin `@classmethod`).
|
|
309
|
-
- **pytest 9.0.0** (2025-11-05) incorporó *subtests* al core (venían de `pytest-subtests`) y
|
|
310
|
-
configuración TOML nativa bajo `[tool.pytest]`; los subtests están marcados como
|
|
311
|
-
experimentales.
|
|
312
|
-
- **Playwright 1.62** cambia el modelo de component testing a «stories and galleries»
|
|
313
|
-
(nuevo `fixtures.mount()`), agrega cancelación con `AbortSignal`, capturas WebP, filtrado
|
|
314
|
-
de tests vía `Reporter.preprocess()` y una estrategia de *isolated retries*; deja de
|
|
315
|
-
soportar Debian 11.
|
|
316
|
-
- **Node.js v20 está EOL**; producción debería estar en v24 (LTS activo) o v22.
|
|
317
|
-
|
|
318
|
-
### H14 — Playwright Test Agents incluye un agente que «repara automáticamente» pruebas fallidas
|
|
319
|
-
|
|
320
|
-
Aplica a: documentación oficial de Playwright vigente al 2026-08-16. Confianza: **alta**.
|
|
321
|
-
|
|
322
|
-
La documentación describe tres agentes de fábrica: `planner` (explora la app y produce un
|
|
323
|
-
plan en Markdown), `generator` (convierte el plan en archivos de test) y `healer`, que
|
|
324
|
-
«executes the test suite and automatically repairs failing tests». Se instalan con
|
|
325
|
-
`npx playwright init-agents --loop=<vscode|claude|codex|opencode>` y las definiciones deben
|
|
326
|
-
regenerarse en cada actualización de Playwright.
|
|
327
|
-
|
|
328
|
-
Impacto QA: es el hallazgo con más fricción respecto de las reglas actuales. Un agente que
|
|
329
|
-
repara pruebas que fallan puede, sin intención, convertir un defecto real del producto en
|
|
330
|
-
una aserción ajustada al comportamiento observado —exactamente lo que el SKILL.md prohíbe
|
|
331
|
-
(«no debilitar aserciones para lograr un pipeline verde», «investigar flakes en vez de
|
|
332
|
-
reintentarlos ciegamente»). No es una razón para prohibir la herramienta, sí para tratar su
|
|
333
|
-
salida como propuesta de cambio revisable y no como corrección aplicada.
|
|
334
|
-
|
|
335
|
-
## Evidencia
|
|
336
|
-
|
|
337
|
-
Todo lo afirmado arriba se verificó leyendo la página o el endpoint indicado el
|
|
338
|
-
2026-08-16, salvo donde se marca lo contrario. Verificaciones textuales destacadas:
|
|
339
|
-
|
|
340
|
-
- WCAG 2.2: cabecera «This version: https://www.w3.org/TR/2024/REC-WCAG22-20241212/», con
|
|
341
|
-
aviso «Errata exists» apuntando a `https://www.w3.org/WAI/WCAG22/errata/`.
|
|
342
|
-
- WCAG 3.0: cabecera «W3C Working Draft 03 March 2026»; el propio texto dice que «it still
|
|
343
|
-
has several years of work».
|
|
344
|
-
- WebDriver BiDi: «This version: https://www.w3.org/TR/2026/WD-webdriver-bidi-20260629/».
|
|
345
|
-
- W3C WAI: «Date: 21 October 2025 … WCAG 2.2 is now an approved ISO standard: ISO/IEC
|
|
346
|
-
40500:2025».
|
|
347
|
-
- OWASP WSTG: «We are currently developing release version 5.0»; «[Version 4.2] - 2020-12-03».
|
|
348
|
-
- ISTQB: el listado de noticias de `istqb.org/news/` muestra, con fecha, CT-AI v2.0
|
|
349
|
-
(2026-04-21), actualización menor de CT-GenAI (2026-04-27), CTAL-AT v2.0 (2026-05-06),
|
|
350
|
-
CT-QDO y CT Finance Testing (ambos 2026-05-27). La nota de CT-QDO indica aprobación por la
|
|
351
|
-
Asamblea General el 2026-04-17. La página de CTFL sigue rotulada «v4.0».
|
|
352
|
-
- Comisión Europea (CRA): «As of 11 September 2026, manufacturers are required to report
|
|
353
|
-
actively exploited vulnerabilities and severe incidents», con los plazos 24 h / 72 h /
|
|
354
|
-
14 días / un mes.
|
|
355
|
-
- Privacy Sandbox: página con sello «Last updated: August 14, 2026» y la tabla de estado por
|
|
356
|
-
API transcrita en H12.
|
|
357
|
-
- Firefox: «Firefox 141 is the first Firefox version where you can no longer use CDP»
|
|
358
|
-
(post fechado 2025-06-02).
|
|
359
|
-
- Selenium: página de descargas con 4.47.0 (2026-08-10) y nightly 4.48.0-SNAPSHOT
|
|
360
|
-
(2026-08-14); nota de release 4.47 con el bloqueo de CDP en Firefox y el charter de
|
|
361
|
-
Selenium 5.
|
|
362
|
-
- Fechas y versiones de la tabla H13: obtenidas de `api.github.com/repos/<org>/<repo>/releases`
|
|
363
|
-
para playwright, cypress, vitest, jest, pytest, junit-framework y axe-core; los textos
|
|
364
|
-
citados de Vitest 5 RC, axe-core 4.13.0, pytest 9.0/9.1 y Playwright 1.62 provienen del
|
|
365
|
-
cuerpo de esas releases.
|
|
366
|
-
|
|
367
|
-
Limitaciones de evidencia: `iso.org`, `etsi.org` y `cisa.gov` devolvieron HTTP 403 desde
|
|
368
|
-
este entorno; sus afirmaciones se marcan con confianza reducida y se listan abajo como
|
|
369
|
-
preguntas abiertas cuando no hubo corroboración independiente.
|
|
370
|
-
|
|
371
|
-
## Posibles prácticas obsoletas
|
|
372
|
-
|
|
373
|
-
Respecto de lo que hoy dice `SKILL.md`, `learning/sources.yaml` y
|
|
374
|
-
`evaluations/expected-behaviors.yaml`:
|
|
375
|
-
|
|
376
|
-
1. **`sources.yaml` no refleja el Top 10:2025.** La única fuente de seguridad registrada es
|
|
377
|
-
la WSTG, que sigue en v4.2 (correcta) pero cuyo modelo de riesgo no incorpora
|
|
378
|
-
`A03:2025 Software Supply Chain Failures` ni `A10:2025 Mishandling of Exceptional
|
|
379
|
-
Conditions`. Queda desactualizado el mapa de riesgos, no la URL.
|
|
380
|
-
2. **`sources.yaml` cita WCAG 2.2 sólo por su identidad W3C.** Desde el 2025-10-21 existe la
|
|
381
|
-
identidad ISO/IEC 40500:2025, que es la que invocan contratos y regulaciones basadas en
|
|
382
|
-
normas ISO.
|
|
383
|
-
3. **`sources.yaml` cita ISO/IEC 25010 sin sus normas hermanas.** Desde la edición 2023, la
|
|
384
|
-
calidad en uso vive en ISO/IEC 25019 y la visión general en ISO/IEC 25002; para IA existe
|
|
385
|
-
ISO/IEC 25059. Referirse sólo a 25010 ya no cubre el modelo completo.
|
|
386
|
-
4. **`SKILL.md` no contempla oráculos probabilísticos.** La sección «Reglas de prueba»
|
|
387
|
-
asume comportamiento observable determinista. Para sistemas de IA/LLM, el propio ISTQB
|
|
388
|
-
CT-AI v2.0 identifica «the difficulty of defining test oracles» y propone pruebas
|
|
389
|
-
metamórficas, back-to-back, de drift y red teaming: técnicas que hoy no tienen lugar en
|
|
390
|
-
el flujo descrito.
|
|
391
|
-
5. **`SKILL.md` no menciona transparencia de contenido generado por IA como criterio
|
|
392
|
-
verificable**, pese a ser obligación aplicable desde el 2026-08-02 en la UE (H9).
|
|
393
|
-
6. **`SKILL.md` no contempla plazos regulatorios al registrar un defecto de seguridad.**
|
|
394
|
-
«Registrar un defecto … sin asignar causa no demostrada» sigue siendo correcto, pero
|
|
395
|
-
desde el 2026-09-11 un hallazgo de vulnerabilidad explotada activamente puede activar un
|
|
396
|
-
reloj de 24 h para el fabricante (H8).
|
|
397
|
-
7. **Automatización basada en CDP quedó obsoleta como enfoque portable**: Firefox la removió
|
|
398
|
-
en la 141 y Selenium 4.47 la bloquea; Selenium 5 apunta a eliminar las APIs CDP-only.
|
|
399
|
-
8. **Fixtures y suites que ejercitan Privacy Sandbox** (Topics, Protected Audience,
|
|
400
|
-
Attribution Reporting, Shared Storage, Fenced Frames, Private Aggregation, Related Web
|
|
401
|
-
Sites) quedan obsoletas: están marcadas «deprecate and remove».
|
|
402
|
-
9. **Deprecaciones concretas en herramientas** que invalidan supuestos de suites existentes:
|
|
403
|
-
Node.js 20 EOL; Playwright removió `_react`/`_vue`, el sufijo `:light`, la opción
|
|
404
|
-
`devtools` (1.58), `Locator.ariaRef()` y `videosPath`/`videoSize` (1.60), y dejó Debian 11
|
|
405
|
-
(1.62); axe-core deprecó `landmark-complementary-is-top-level` (4.12.0) y cambia el
|
|
406
|
-
conteo de issues en 4.13.0; pytest deprecó `request.getfixturevalue()` en teardown y los
|
|
407
|
-
fixtures de clase como métodos de instancia (error en pytest 10); Vitest 5 hará fallar
|
|
408
|
-
aserciones asíncronas no esperadas; Selenium 4.47 removió proxy FTP.
|
|
409
|
-
10. **`evaluations/expected-behaviors.yaml` no tiene contraparte para la reparación
|
|
410
|
-
automática de pruebas.** `hidden_flake_or_weakened_assertion` cubre el acto humano, pero
|
|
411
|
-
no el caso de aceptar sin revisión el parche de un agente `healer` (H14). Tampoco hay
|
|
412
|
-
nada equivalente para «pipeline comprometido por cadena de suministro» (H10), que es un
|
|
413
|
-
modo de fallo distinto de `green_pipeline_as_proof_of_quality`.
|
|
414
|
-
|
|
415
|
-
Conteo: **10 deprecaciones / desajustes** detectados. Ninguno invalida el núcleo del
|
|
416
|
-
SKILL.md: todos son adiciones o precisiones. No se modificó ningún archivo salvo este
|
|
417
|
-
informe.
|
|
418
|
-
|
|
419
|
-
## Recomendación
|
|
420
|
-
|
|
421
|
-
Preparar una propuesta mensual (en `learning/proposals/`, para aprobación humana) que
|
|
422
|
-
actualice `learning/sources.yaml` con OWASP Top 10:2025, ISO/IEC 40500:2025, ISO/IEC 25002 /
|
|
423
|
-
25019 / 25059 e ISTQB CT-AI v2.0, y que añada al SKILL.md dos ideas ausentes —oráculos
|
|
424
|
-
probabilísticos para sistemas de IA, y plazos regulatorios (CRA 24 h, AI Act art. 50) como
|
|
425
|
-
parte del registro de defectos y de la recomendación de release—, más una conducta prohibida
|
|
426
|
-
nueva en `expected-behaviors.yaml` para el parcheo automático de pruebas por agentes sin
|
|
427
|
-
revisión humana.
|
|
428
|
-
|
|
429
|
-
Nivel de confianza global del informe: **alto** para H1–H4, H7–H8, H10 (keyv), H11–H14;
|
|
430
|
-
**medio** para H5 (EN 301 549), H6 (estado del DIS 25059), H9 (detalle del diferimiento por
|
|
431
|
-
el Omnibus) y H10 (incidente axios).
|
|
432
|
-
|
|
433
|
-
## Preguntas abiertas
|
|
434
|
-
|
|
435
|
-
1. **¿EN 301 549 V4.1.1 está publicada y citada en el DOUE?** Verifiqué que existe una URL de
|
|
436
|
-
final draft V4.1.0 (2026-06) en el servidor de ETSI, pero no pude leer el PDF (HTTP 403) y
|
|
437
|
-
no encontré confirmación en fuente primaria de la publicación de V4.1.1 ni de su citación
|
|
438
|
-
en el Diario Oficial. Fuentes secundarias mencionan octubre de 2026 como fecha esperada;
|
|
439
|
-
no lo afirmo. Si algún proyecto depende de esto, hay que consultar ETSI y el DOUE
|
|
440
|
-
directamente.
|
|
441
|
-
2. **¿Qué obligaciones exactas difiere el Reglamento (UE) 2026/1744 y para qué supuestos?**
|
|
442
|
-
Confirmé la existencia y numeración del reglamento en EUR-Lex, y la aplicabilidad del
|
|
443
|
-
art. 50 desde el 2026-08-02 en fuente de la Comisión. Las fechas 2027-12-02 y 2028-08-02
|
|
444
|
-
para alto riesgo provienen de fuentes secundarias; requieren lectura del articulado.
|
|
445
|
-
3. **¿Cuál es el alcance real del compromiso de `axios` reportado por CISA el 2026-04-20?**
|
|
446
|
-
No pude leer la alerta (HTTP 403). Versiones concretas y acciones recomendadas quedan sin
|
|
447
|
-
verificar en fuente primaria.
|
|
448
|
-
4. **¿Cuál es el texto vigente de ISO/IEC 25010:2023 y el estado formal de ISO/IEC DIS
|
|
449
|
-
25059?** `iso.org` devolvió 403; la caracterización de 25010:2023 se apoya en IEC Webstore
|
|
450
|
-
y en el resumen de ISO indexado. El estado del DIS 25059 no está corroborado en fuente
|
|
451
|
-
primaria.
|
|
452
|
-
5. **¿ISTQB retira CT-AI v1.0 en fechas concretas?** Fuentes secundarias citan abril y
|
|
453
|
-
octubre de 2027 para versiones en inglés y no inglés respectivamente; la nota oficial que
|
|
454
|
-
leí no contenía esas fechas. No lo afirmo.
|
|
455
|
-
6. **¿Está WCAG 2.2 afectada por erratas que cambien la interpretación de algún criterio?**
|
|
456
|
-
El documento declara que existen erratas, pero no revisé la página de erratas en esta
|
|
457
|
-
sesión. Debería hacerse antes de trazar hallazgos de accesibilidad contra criterios
|
|
458
|
-
específicos.
|
|
459
|
-
7. **¿Chrome removerá las Privacy Sandbox APIs en una versión concreta?** La tabla oficial
|
|
460
|
-
dice «Deprecate and remove» pero no da versión de hito. Fuentes secundarias mencionan
|
|
461
|
-
Chrome 144 para la deprecación y Chrome 150 para la remoción; no pude confirmarlo en
|
|
462
|
-
chromestatus ni en blink-dev, así que no lo afirmo.
|
|
463
|
-
8. **¿Qué cambió en Cypress 15.19/15.20?** El cuerpo de la release sólo enlaza al changelog
|
|
464
|
-
en `docs.cypress.io`, que no leí. Sólo confirmo versión y fecha.
|
|
465
|
-
9. **Contexto de empresa**: este informe no evalúa `organization/roles/qa-engineer.md` ni el
|
|
466
|
-
contexto de pruebas de ningún proyecto concreto, porque el encargo se limitó a la
|
|
467
|
-
profesión. Las restricciones reales de la instalación pueden cambiar la prioridad de
|
|
468
|
-
estos hallazgos.
|