@saulwade/swl-ses 2.6.0 → 2.8.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (435) hide show
  1. package/CLAUDE.md +209 -197
  2. package/README.md +647 -600
  3. package/agentes/accesibilidad-wcag-swl.md +690 -690
  4. package/agentes/arquitecto-swl.md +267 -267
  5. package/agentes/auto-evolucion-swl.md +932 -932
  6. package/agentes/backend-csharp-swl.md +420 -420
  7. package/agentes/backend-go-swl.md +390 -390
  8. package/agentes/backend-java-swl.md +281 -281
  9. package/agentes/backend-rust-swl.md +364 -364
  10. package/agentes/backend-workers-swl.md +482 -482
  11. package/agentes/cloud-infra-swl.md +509 -509
  12. package/agentes/consolidador-swl.md +541 -541
  13. package/agentes/depurador-swl.md +352 -352
  14. package/agentes/devops-ci-swl.md +400 -400
  15. package/agentes/disenador-ui-swl.md +569 -569
  16. package/agentes/documentador-swl.md +345 -345
  17. package/agentes/frontend-angular-swl.md +621 -621
  18. package/agentes/frontend-css-swl.md +716 -716
  19. package/agentes/frontend-react-swl.md +692 -692
  20. package/agentes/frontend-swl.md +496 -496
  21. package/agentes/frontend-tailwind-swl.md +826 -826
  22. package/agentes/investigador-swl.md +432 -432
  23. package/agentes/investigador-ux-swl.md +505 -505
  24. package/agentes/migrador-swl.md +442 -442
  25. package/agentes/mobile-android-swl.md +511 -511
  26. package/agentes/mobile-cross-swl.md +541 -541
  27. package/agentes/mobile-ios-swl.md +502 -502
  28. package/agentes/mobile-testing-swl.md +302 -302
  29. package/agentes/nemesis-auditor-swl.md +285 -285
  30. package/agentes/observabilidad-swl.md +438 -438
  31. package/agentes/pagos-swl.md +310 -310
  32. package/agentes/perfilador-usuario-swl.md +321 -321
  33. package/agentes/planificador-swl.md +399 -399
  34. package/agentes/producto-prd-swl.md +589 -589
  35. package/agentes/red-team-swl.md +218 -218
  36. package/agentes/release-manager-swl.md +590 -590
  37. package/agentes/rendimiento-swl.md +713 -713
  38. package/agentes/revisor-angular-swl.md +278 -278
  39. package/agentes/revisor-csharp-swl.md +264 -264
  40. package/agentes/revisor-go-swl.md +259 -259
  41. package/agentes/revisor-java-swl.md +257 -257
  42. package/agentes/revisor-kotlin-swl.md +273 -273
  43. package/agentes/revisor-nextjs-swl.md +281 -281
  44. package/agentes/revisor-php-swl.md +271 -271
  45. package/agentes/revisor-react-swl.md +278 -278
  46. package/agentes/revisor-rust-swl.md +346 -346
  47. package/agentes/revisor-seguridad-swl.md +399 -399
  48. package/agentes/revisor-swift-swl.md +268 -268
  49. package/agentes/revisor-typescript-swl.md +346 -346
  50. package/agentes/tdd-qa-swl.md +393 -393
  51. package/bin/swl-ses.js +10 -0
  52. package/comandos/swl/actualizar.md +174 -174
  53. package/comandos/swl/adoptar-proyecto.md +265 -265
  54. package/comandos/swl/aprender.md +836 -836
  55. package/comandos/swl/aprobar-plan.md +146 -146
  56. package/comandos/swl/auditar-deps.md +134 -134
  57. package/comandos/swl/autoresearch.md +264 -264
  58. package/comandos/swl/ayuda.md +224 -224
  59. package/comandos/swl/brainstorm.md +52 -51
  60. package/comandos/swl/checkpoint.md +325 -325
  61. package/comandos/swl/claudemd.md +234 -234
  62. package/comandos/swl/compactar.md +310 -310
  63. package/comandos/swl/configurar-ci.md +235 -235
  64. package/comandos/swl/contexto.md +110 -110
  65. package/comandos/swl/crear-skill.md +292 -292
  66. package/comandos/swl/cron.md +194 -194
  67. package/comandos/swl/deuda-codigo.md +97 -97
  68. package/comandos/swl/discutir-fase.md +169 -169
  69. package/comandos/swl/ejecutar-fase.md +233 -233
  70. package/comandos/swl/evaluar-skill.md +520 -520
  71. package/comandos/swl/evolucion-continua.md +73 -73
  72. package/comandos/swl/evolucionar.md +267 -267
  73. package/comandos/swl/exportar-vault.md +583 -583
  74. package/comandos/swl/fix.md +118 -118
  75. package/comandos/swl/gateway.md +158 -158
  76. package/comandos/swl/inbox.md +116 -116
  77. package/comandos/swl/instalar.md +220 -220
  78. package/comandos/swl/instintos.md +86 -86
  79. package/comandos/swl/mapear-codebase.md +312 -312
  80. package/comandos/swl/mcp-status.md +176 -175
  81. package/comandos/swl/modelo.md +100 -100
  82. package/comandos/swl/nemesis.md +433 -433
  83. package/comandos/swl/notificaciones.md +299 -299
  84. package/comandos/swl/nuevo-proyecto.md +251 -251
  85. package/comandos/swl/planear-fase.md +263 -263
  86. package/comandos/swl/plugins.md +256 -256
  87. package/comandos/swl/predecir.md +169 -169
  88. package/comandos/swl/reflect-skills.md +125 -125
  89. package/comandos/swl/release.md +450 -450
  90. package/comandos/swl/revisar-impacto.md +201 -201
  91. package/comandos/swl/revisar.md +330 -330
  92. package/comandos/swl/seguridad.md +189 -189
  93. package/comandos/swl/sesiones.md +200 -200
  94. package/comandos/swl/skill-search.md +113 -113
  95. package/comandos/swl/status.md +345 -345
  96. package/comandos/swl/verificar.md +817 -817
  97. package/comandos/swl/wiki.md +620 -620
  98. package/gateway/cron/jobs.example.json +12 -12
  99. package/gateway/lib/event-channel.js +191 -191
  100. package/habilidades/agent-deep-links/SKILL.md +148 -148
  101. package/habilidades/auto-evolucion-protocolo/SKILL.md +294 -294
  102. package/habilidades/backend-async-postgres-testing/SKILL.md +216 -215
  103. package/habilidades/backend-error-design/SKILL.md +221 -221
  104. package/habilidades/backend-production-resilience/SKILL.md +288 -288
  105. package/habilidades/calidad-anti-patrones-universales/SKILL.md +105 -1
  106. package/habilidades/calidad-contract-testing/SKILL.md +165 -165
  107. package/habilidades/calidad-mutation-testing/SKILL.md +25 -1
  108. package/habilidades/changelog-generator/SKILL.md +174 -174
  109. package/habilidades/checklist-seguridad/recursos/stride-cobertura.md +60 -60
  110. package/habilidades/ci-cd-pipelines/SKILL.md +5 -1
  111. package/habilidades/compactacion-contexto/SKILL.md +2 -1
  112. package/habilidades/contenedores-docker/SKILL.md +4 -2
  113. package/habilidades/css-moderno/SKILL.md +7 -1
  114. package/habilidades/diagrama-arquitectura/assets/template.html +276 -276
  115. package/habilidades/doubt-driven-review/SKILL.md +207 -207
  116. package/habilidades/doubt-driven-review/recursos/EXAMPLES.md +130 -130
  117. package/habilidades/drift-detection/SKILL.md +1 -1
  118. package/habilidades/ejecutar-task-iterativo/SKILL.md +278 -278
  119. package/habilidades/estructura-proyecto-claude/recursos/mcp-json-template.json +57 -57
  120. package/habilidades/extractor-de-aprendizajes/SKILL.md +12 -2
  121. package/habilidades/feynman-auditor-swl/recursos/preguntas-language-agnostic.md +108 -108
  122. package/habilidades/git-worktrees-paralelo/SKILL.md +19 -1
  123. package/habilidades/harness-claude-code/SKILL.md +315 -314
  124. package/habilidades/instalar-sistema/SKILL.md +227 -227
  125. package/habilidades/meta-skills-estandar/recursos/convencion-examples.md +93 -93
  126. package/habilidades/patrones-python/recursos/patrones-avanzados.md +469 -469
  127. package/habilidades/perfil-usuario/SKILL.md +200 -200
  128. package/habilidades/planear-fase/SKILL.md +358 -358
  129. package/habilidades/prevencion-sobreingenieria/recursos/EXAMPLES.md +580 -580
  130. package/habilidades/proceso-ddia-streaming/SKILL.md +231 -231
  131. package/habilidades/proceso-discovery-machote/SKILL.md +157 -157
  132. package/habilidades/proceso-dynamic-workflows/SKILL.md +60 -0
  133. package/habilidades/proceso-dynamic-workflows/recursos/template-adversarial-verify.js +65 -65
  134. package/habilidades/proceso-dynamic-workflows/recursos/template-triage.js +65 -65
  135. package/habilidades/proceso-ingenieria-requerimientos/SKILL.md +147 -147
  136. package/habilidades/proceso-intent-engineering/SKILL.md +269 -269
  137. package/habilidades/proceso-modular-split/SKILL.md +256 -256
  138. package/habilidades/release-semver/SKILL.md +2 -2
  139. package/habilidades/state-inconsistency-auditor-swl/recursos/coupled-state-patterns.md +147 -147
  140. package/habilidades/swl-claudemd/recursos/contrato-aprender.md +83 -83
  141. package/habilidades/swl-claudemd/recursos/duplicacion-reglas-globales.md +85 -85
  142. package/habilidades/swl-claudemd/recursos/plantillas-init.md +94 -94
  143. package/habilidades/tdd-workflow/SKILL.md +749 -749
  144. package/habilidades/tdd-workflow/recursos/gherkin-bdd.md +111 -111
  145. package/hooks/agente-lifecycle.js +1 -1
  146. package/hooks/audit-trail.js +1 -1
  147. package/hooks/auto-consolidacion.js +1 -1
  148. package/hooks/calidad-pre-commit.js +159 -10
  149. package/hooks/captura-acciones-post.js +1 -1
  150. package/hooks/captura-acciones-session.js +1 -1
  151. package/hooks/captura-feedback-usuario.js +1 -1
  152. package/hooks/ciclo-evolucion-subagente.js +26 -26
  153. package/hooks/ciclo-evolucion.js +26 -26
  154. package/hooks/contexto-iteracion.js +1 -1
  155. package/hooks/degradacion-instintos.js +1 -1
  156. package/hooks/grafo-contexto.js +1 -1
  157. package/hooks/guardrail-modelo.js +1 -1
  158. package/hooks/inbox-aviso.js +1 -1
  159. package/hooks/inyeccion-contexto.js +1 -1
  160. package/hooks/lib/agent-matcher.js +1 -1
  161. package/hooks/lib/agent-routing.js +1 -1
  162. package/hooks/lib/auto-consolidator.js +335 -335
  163. package/hooks/lib/captura-acciones.js +1 -1
  164. package/hooks/lib/ciclo-evolucion.js +47 -47
  165. package/hooks/lib/deep-links.js +185 -185
  166. package/hooks/lib/error-classifier.js +308 -308
  167. package/hooks/lib/etapa-metricas.js +1 -1
  168. package/hooks/lib/evolution-tracker.js +1 -1
  169. package/hooks/lib/gateway-notify.js +193 -193
  170. package/hooks/lib/mcp-health.js +1 -1
  171. package/hooks/lib/notificacion-formato.js +92 -0
  172. package/hooks/lib/nudge-tracker.js +1 -1
  173. package/hooks/lib/otlp-exporter.js +1 -1
  174. package/hooks/lib/propose-step.js +1 -1
  175. package/hooks/lib/provenance-tracker.js +191 -191
  176. package/hooks/lib/raiz-proyecto.js +158 -102
  177. package/hooks/lib/resource-quota.js +122 -122
  178. package/hooks/lib/retry-jitter.js +165 -165
  179. package/hooks/lib/run-log.js +1 -1
  180. package/hooks/lib/security-net.js +201 -201
  181. package/hooks/lib/singleton-guard.js +20 -13
  182. package/hooks/lib/skill-auditor.js +588 -588
  183. package/hooks/lib/sync-status.js +228 -228
  184. package/hooks/lib/taint-tracker.js +107 -107
  185. package/hooks/lib/telegram-cliente.js +11 -3
  186. package/hooks/lib/text-similarity.js +241 -241
  187. package/hooks/lib/toon-compressor.js +245 -245
  188. package/hooks/notificacion-telegram.js +17 -13
  189. package/hooks/preservar-estado-pre-compact.js +1 -1
  190. package/hooks/registro-turnos.js +1 -1
  191. package/hooks/resumen-sesion.js +1 -1
  192. package/hooks/risk-scoring.js +1 -1
  193. package/hooks/session-briefing.js +13 -5
  194. package/hooks/spec-gate.js +1 -1
  195. package/hooks/sugerir-regenerar-inventario.js +1 -1
  196. package/hooks/tdd-gate.js +1 -1
  197. package/hooks/telemetria-agentes.js +1 -1
  198. package/hooks/telemetria-skill-routing.js +1 -1
  199. package/hooks/tracking-costos.js +1 -1
  200. package/hooks/validar-formato-post-subagente.js +1 -1
  201. package/hooks/validar-intent-spec.js +1 -1
  202. package/hooks/validar-planning-paths.js +1 -1
  203. package/instintos/autonomia.yaml +27 -27
  204. package/instintos/prompt-appendices.yaml +57 -57
  205. package/llms.txt +29 -29
  206. package/manifiestos/agent-output-schemas.json +57 -57
  207. package/manifiestos/canonical-hashes.json +6250 -5257
  208. package/manifiestos/harness-ir.json +47536 -0
  209. package/manifiestos/modulos.json +1429 -1428
  210. package/manifiestos/policy-bundle.json +2065 -0
  211. package/manifiestos/policy-corpus-w2.json +3926 -0
  212. package/manifiestos/runtime-adapters-core3.json +208 -0
  213. package/manifiestos/runtime-conformance.json +139 -0
  214. package/manifiestos/skills-lock.json +1275 -1275
  215. package/package.json +94 -94
  216. package/plantillas/auditor-veto-template.md +105 -105
  217. package/plantillas/github-workflows/release-please.yml +44 -44
  218. package/plantillas/github-workflows/swl-ci.yml +107 -107
  219. package/plantillas/github-workflows/swl-security.yml +51 -51
  220. package/plugin.json +369 -369
  221. package/reglas/accesibilidad.md +10 -10
  222. package/reglas/auditorias-documentales-estructurales.md +7 -7
  223. package/reglas/cloud-infra.md +8 -8
  224. package/reglas/consultar-vault-primero.md +195 -195
  225. package/reglas/git-workflow.md +1 -0
  226. package/reglas/hooks.md +6 -6
  227. package/reglas/intent-engineering.md +218 -218
  228. package/reglas/markitdown.md +8 -8
  229. package/reglas/monitor-ci.md +12 -0
  230. package/reglas/patrones.md +6 -6
  231. package/reglas/testing.md +7 -7
  232. package/reglas/tests-cleanup.md +224 -224
  233. package/schemas/agent-message.schema.json +73 -73
  234. package/schemas/agent-output-implementacion.schema.json +114 -114
  235. package/schemas/agent-output-planificacion.schema.json +150 -150
  236. package/schemas/agent-output-review.schema.json +98 -98
  237. package/schemas/diary-entry.schema.json +112 -112
  238. package/schemas/gate-state.schema.json +76 -0
  239. package/schemas/harness-ir.schema.json +369 -0
  240. package/schemas/hook-profiles.schema.json +54 -54
  241. package/schemas/hooks-config.schema.json +89 -89
  242. package/schemas/legacy-gates.schema.json +45 -0
  243. package/schemas/modulos.schema.json +38 -38
  244. package/schemas/perfiles.schema.json +36 -36
  245. package/schemas/plugin.schema.json +77 -77
  246. package/schemas/policy-bundle.schema.json +140 -0
  247. package/schemas/policy-enforcement.schema.json +117 -0
  248. package/schemas/policy-operation.schema.json +261 -0
  249. package/schemas/runtime-adapter.schema.json +176 -0
  250. package/schemas/runtime-build-attestation.schema.json +100 -0
  251. package/schemas/runtime-conformance.schema.json +239 -0
  252. package/schemas/runtime-diagnostic.schema.json +395 -0
  253. package/schemas/skill-evals.schema.json +119 -119
  254. package/schemas/skill-frontmatter.schema.json +245 -245
  255. package/schemas/w4-certification-request.schema.json +72 -0
  256. package/schemas/w4-certification-verdict.schema.json +224 -0
  257. package/schemas/w4-corpus.schema.json +172 -0
  258. package/schemas/w4-mutation-report.schema.json +116 -0
  259. package/schemas/w4-replay-result.schema.json +164 -0
  260. package/schemas/w4-scoring-report.schema.json +89 -0
  261. package/scripts/audit-tools/audit-history.js +330 -330
  262. package/scripts/audit-tools/bundle-tracker.js +290 -290
  263. package/scripts/audit-tools/canary-monitor.js +352 -352
  264. package/scripts/audit-tools/code-profiler.js +605 -605
  265. package/scripts/audit-tools/dep-doctor.js +320 -320
  266. package/scripts/audit-tools/env-validator.js +206 -206
  267. package/scripts/audit-tools/lib/fs-walk.js +48 -48
  268. package/scripts/audit-tools/lib/output.js +23 -23
  269. package/scripts/audit-tools/migration-checker.js +392 -392
  270. package/scripts/audit-tools/pentest-scanner.js +1436 -1436
  271. package/scripts/auditar-clases-conocidas.js +134 -134
  272. package/scripts/bootstrap-instintos.js +88 -14
  273. package/scripts/canario-hooks.js +166 -166
  274. package/scripts/cli/aprobar-plan.js +73 -73
  275. package/scripts/cli/autonomia.js +23 -23
  276. package/scripts/cli/benchmark-memoria.js +37 -37
  277. package/scripts/cli/briefing.js +23 -23
  278. package/scripts/cli/ciclo-autonomo.js +73 -73
  279. package/scripts/cli/ciclo-evolucion.js +26 -26
  280. package/scripts/cli/ciclo-fase-b.js +102 -102
  281. package/scripts/cli/derivar-feature-list.js +25 -25
  282. package/scripts/cli/detectar-host.js +27 -27
  283. package/scripts/cli/diary-entry.js +69 -69
  284. package/scripts/cli/execution-state.js +18 -18
  285. package/scripts/cli/gateway-notify.js +41 -41
  286. package/scripts/cli/guardrail-metrics.js +39 -39
  287. package/scripts/cli/liberar-fase.js +42 -42
  288. package/scripts/cli/mark-evolved.js +56 -56
  289. package/scripts/cli/memoria-search.js +69 -69
  290. package/scripts/cli/metricas-dora.js +26 -26
  291. package/scripts/cli/near-duplicate.js +55 -55
  292. package/scripts/cli/notificaciones.js +123 -123
  293. package/scripts/cli/nudge-accionar.js +39 -39
  294. package/scripts/cli/propose-step.js +29 -29
  295. package/scripts/cli/run-eval.js +38 -38
  296. package/scripts/cli/schedule-parse.js +19 -19
  297. package/scripts/cli/sugerir-modelo.js +20 -20
  298. package/scripts/cli/verificar-plan.js +36 -36
  299. package/scripts/cli/verificar-trazabilidad.js +35 -35
  300. package/scripts/comandos/install-asistido.js +8 -7
  301. package/scripts/configurar-branch-protection.js +418 -418
  302. package/scripts/detectar-aprendizajes-duplicados.js +151 -151
  303. package/scripts/doctor.js +61 -13
  304. package/scripts/evidencia-valor.js +101 -101
  305. package/scripts/field-report.js +16 -16
  306. package/scripts/generar-checklists-consolidados.js +273 -273
  307. package/scripts/generar-claims-runtime.js +1342 -0
  308. package/scripts/generar-harness-ir.js +257 -0
  309. package/scripts/generar-inventario.js +52 -54
  310. package/scripts/generar-policy-bundle.js +202 -0
  311. package/scripts/instalador.js +39 -7
  312. package/scripts/lib/activar-hooks-proyecto.js +116 -116
  313. package/scripts/lib/approval-receipts.js +190 -0
  314. package/scripts/lib/artefactos-python.js +43 -43
  315. package/scripts/lib/benchmark-metrics.js +160 -160
  316. package/scripts/lib/budget-enforcer.js +252 -252
  317. package/scripts/lib/certificacion-loop-state.js +421 -0
  318. package/scripts/lib/ci-reader.js +193 -193
  319. package/scripts/lib/ciclo-autonomo/candidatos.js +174 -174
  320. package/scripts/lib/ciclo-autonomo/config.js +165 -165
  321. package/scripts/lib/ciclo-autonomo/drenador-feedback.js +174 -174
  322. package/scripts/lib/ciclo-autonomo/fallback.js +77 -77
  323. package/scripts/lib/ciclo-autonomo/guard-convivencia.js +139 -139
  324. package/scripts/lib/ciclo-autonomo/higiene-nudges.js +112 -112
  325. package/scripts/lib/ciclo-autonomo/index.js +301 -301
  326. package/scripts/lib/ciclo-autonomo/lock.js +124 -124
  327. package/scripts/lib/ciclo-autonomo/presupuesto.js +122 -122
  328. package/scripts/lib/ciclo-autonomo/puente-degradacion.js +240 -240
  329. package/scripts/lib/ciclo-autonomo/runner-fase-b.js +248 -248
  330. package/scripts/lib/ciclo-autonomo/writer-instintos.js +190 -190
  331. package/scripts/lib/ciclo-autonomo/yaml-instintos.js +591 -535
  332. package/scripts/lib/clasificar-directorio.js +92 -0
  333. package/scripts/lib/contadores-inventario.js +217 -217
  334. package/scripts/lib/detectar-host-swl.js +175 -175
  335. package/scripts/lib/detectar-runtime.js +29 -20
  336. package/scripts/lib/detectar-stack-detallado.js +307 -307
  337. package/scripts/lib/detector-autoduplicacion-intra-archivo.js +234 -234
  338. package/scripts/lib/detector-reglas-duplicadas.js +220 -220
  339. package/scripts/lib/eval-metrics-store.js +218 -218
  340. package/scripts/lib/eval-quality.js +171 -171
  341. package/scripts/lib/eval-schemas.js +144 -144
  342. package/scripts/lib/eval-self-correct.js +106 -106
  343. package/scripts/lib/eval-validator.js +185 -185
  344. package/scripts/lib/evidence-verifier.js +192 -0
  345. package/scripts/lib/evidencia-release.js +322 -322
  346. package/scripts/lib/evidencia-valor.js +228 -228
  347. package/scripts/lib/expandir-targets.js +71 -71
  348. package/scripts/lib/frontmatter-canonico.js +509 -0
  349. package/scripts/lib/gate-engine.js +871 -0
  350. package/scripts/lib/gate-hooks-requires.js +249 -249
  351. package/scripts/lib/gate-licencias.js +212 -212
  352. package/scripts/lib/git-config-preflight.js +48 -0
  353. package/scripts/lib/git-metricas.js +257 -257
  354. package/scripts/lib/harness-ir.js +778 -0
  355. package/scripts/lib/harness-source-snapshot.js +309 -0
  356. package/scripts/lib/integrity-ledger.js +1147 -0
  357. package/scripts/lib/jaccard-similarity.js +98 -98
  358. package/scripts/lib/legacy-gate-migration.js +324 -0
  359. package/scripts/lib/limpiar-basura-global.js +204 -0
  360. package/scripts/lib/longmemeval-runner.js +125 -125
  361. package/scripts/lib/metricas-dora.js +204 -204
  362. package/scripts/lib/notificaciones-telegram.js +1 -0
  363. package/scripts/lib/npm-version.js +1 -0
  364. package/scripts/lib/paquetes-conocidos.js +50 -50
  365. package/scripts/lib/plan-lock.js +61 -13
  366. package/scripts/lib/policy-broker.js +338 -0
  367. package/scripts/lib/policy-bundle.js +342 -0
  368. package/scripts/lib/policy-context-provider.js +310 -0
  369. package/scripts/lib/policy-contract.js +479 -0
  370. package/scripts/lib/policy-verifier-utils.js +65 -0
  371. package/scripts/lib/pr-analyzer.js +399 -399
  372. package/scripts/lib/principal-verifier.js +178 -0
  373. package/scripts/lib/prompt-builder.js +264 -264
  374. package/scripts/lib/resolver-plan-fase.js +37 -37
  375. package/scripts/lib/rrf-fusion.js +175 -175
  376. package/scripts/lib/runtime-adapter-contract.js +267 -0
  377. package/scripts/lib/runtime-artifact-verifier.js +426 -0
  378. package/scripts/lib/runtime-build-attestation.js +127 -0
  379. package/scripts/lib/runtime-bundle-installer.js +586 -0
  380. package/scripts/lib/runtime-compiler.js +327 -0
  381. package/scripts/lib/runtime-conformance.js +202 -0
  382. package/scripts/lib/runtime-doctor-core3.js +567 -0
  383. package/scripts/lib/runtime-doctor-input.js +59 -0
  384. package/scripts/lib/runtime-operation-adapter.js +267 -0
  385. package/scripts/lib/schema-version.js +164 -164
  386. package/scripts/lib/semantic-search.js +252 -252
  387. package/scripts/lib/signed-envelope.js +545 -0
  388. package/scripts/lib/single-use-store.js +359 -0
  389. package/scripts/lib/skills-externas.js +31 -0
  390. package/scripts/lib/toml-merge.js +204 -204
  391. package/scripts/lib/transformadores/codex.js +15 -8
  392. package/scripts/lib/transformadores/gemini.js +79 -5
  393. package/scripts/lib/w4-attestation-adapter.js +158 -0
  394. package/scripts/lib/w4-canario.js +337 -0
  395. package/scripts/lib/w4-claims.js +182 -0
  396. package/scripts/lib/w4-corpus-generador.js +542 -0
  397. package/scripts/lib/w4-gate-c5.js +115 -0
  398. package/scripts/lib/w4-harness-bajo-prueba.js +155 -0
  399. package/scripts/lib/w4-matriz-combos.js +55 -0
  400. package/scripts/lib/w4-motor-mutacion.js +1348 -0
  401. package/scripts/lib/w4-motor-replay.js +735 -0
  402. package/scripts/lib/w4-pin-origen.js +54 -0
  403. package/scripts/lib/w4-publicar-request.js +132 -0
  404. package/scripts/lib/w4-revocacion.js +62 -0
  405. package/scripts/lib/w4-runtimes-core3.js +38 -0
  406. package/scripts/lib/w4-scorer-certificacion.js +692 -0
  407. package/scripts/lib/w4-superficie-candidato.js +49 -0
  408. package/scripts/lib/w4-veredicto.js +452 -0
  409. package/scripts/lib/w4-verificar-veredicto.js +302 -0
  410. package/scripts/limpiar-artefactos-python.js +131 -131
  411. package/scripts/mcp-server/auth.js +105 -105
  412. package/scripts/mcp-server/cache.js +106 -106
  413. package/scripts/migrar-csv-a-array.js +168 -168
  414. package/scripts/migrar-fase-dominio.js +200 -200
  415. package/scripts/migrar-gates-legacy.js +108 -0
  416. package/scripts/publicar-certification-request.js +115 -0
  417. package/scripts/runtime-doctor.js +107 -0
  418. package/scripts/tui/componentes/selector-multi.js +189 -189
  419. package/scripts/tui/componentes/selector-unico.js +158 -158
  420. package/scripts/tui/ejecutores.js +375 -375
  421. package/scripts/tui/lib/colores.js +129 -129
  422. package/scripts/tui/lib/render.js +264 -264
  423. package/scripts/tui/lib/teclas.js +113 -113
  424. package/scripts/tui/pantallas/install-wizard.js +408 -403
  425. package/scripts/tui/pantallas/menu-principal.js +52 -52
  426. package/scripts/tui/pantallas/progreso.js +274 -274
  427. package/scripts/tui/pantallas/resumen.js +132 -132
  428. package/scripts/validar-userland-vacio.js +110 -110
  429. package/scripts/verificar-aislamiento-swl-eval.js +87 -0
  430. package/scripts/verificar-empaquetado-downstream.js +375 -0
  431. package/scripts/verificar-loop-constructor.js +215 -0
  432. package/scripts/verificar-trazabilidad.js +13 -6
  433. package/scripts/verificar-veredicto-real.js +84 -0
  434. package/instintos/.backups/perfil-usuario.yaml.2026-07-10-165128.bak +0 -53
  435. package/instintos/.backups/proyecto.yaml.2026-07-10-165128.bak +0 -372
@@ -1,749 +1,749 @@
1
- ---
2
- name: tdd-workflow
3
- description: Flujo completo de Test-Driven Development. Ciclo RED (el test falla) → GREEN (implementación mínima) → REFACTOR (limpieza). Incluye cobertura mínima obligatoria, tests de frontera, factories, fixtures y estrategias para diferentes tipos de código (APIs, services, componentes Angular).
4
- version: "1.2.4"
5
- herramientasPermitidas: [Read, Bash]
6
- evolvable: true # default para skill estandar
7
- exclusiones:
8
- - "No cargar para escribir tests de regresión sobre código legacy sin suite existente — en código legacy sin tests, comenzar con caracterización de comportamiento actual antes del ciclo TDD."
9
- - "No cargar para pruebas de carga o performance testing — para benchmarks y load testing cargar `performance-baseline`."
10
- - "No cargar para configurar pipelines de CI/CD o runners de tests en GitHub Actions / GitLab CI — para configuración de CI cargar el skill de cloud correspondiente."
11
- - "No cargar para pruebas de seguridad o fuzzing automático — para testing de seguridad cargar `threat-model-lite` y usar herramientas especializadas (Bandit, OWASP ZAP)."
12
- ---
13
- # Habilidad: TDD Workflow Completo
14
-
15
- ## Cuándo NO cargar
16
-
17
- - La tarea es añadir tests a código legacy sin suite existente: comenzar con tests de caracterización del comportamiento actual antes del ciclo TDD.
18
- - La tarea es pruebas de carga o benchmarks: cargar `performance-baseline`.
19
- - La tarea es configurar CI/CD pipelines: cargar el skill de cloud correspondiente.
20
- - La tarea es fuzzing o testing de seguridad: cargar `threat-model-lite` y usar herramientas especializadas.
21
-
22
- ## Propósito
23
-
24
- TDD no es "escribir tests después" ni "escribir tests antes por costumbre". Es
25
- un método de diseño donde los tests guían la API pública del código antes de
26
- que exista la implementación. El resultado es código que hace exactamente lo
27
- que los tests exigen — ni más, ni menos.
28
-
29
- ## Cuándo activar
30
-
31
- - CONTEXT.md o PLAN.md indica que la fase requiere TDD
32
- - Se implementa lógica de negocio crítica (cálculos, validaciones, permisos)
33
- - El usuario pide explícitamente TDD
34
- - Se trabaja en un módulo con historial de bugs
35
-
36
- ---
37
-
38
- ## Etapa opcional previa: Gherkin (BDD) y gate de mutación
39
-
40
- Dos extensiones opt-in del ciclo, ambas con guía completa en recursos:
41
-
42
- - **Antes del ciclo** — si la fase tiene criterios de aceptación de negocio,
43
- convertirlos en escenarios Given–When–Then validados por el usuario ANTES de
44
- implementar; cada escenario es el test RED de su criterio. Guía, runners por
45
- stack y anti-patrones en [recursos/gherkin-bdd.md](recursos/gherkin-bdd.md).
46
- - **Después del ciclo** — en módulos críticos, verificar la calidad de los
47
- asserts con mutation testing incremental sobre el diff:
48
- `Skill("calidad-mutation-testing")`. La cobertura mide ejecución; los
49
- mutantes sobrevivientes miden si los tests detectarían un bug.
50
-
51
- ## El ciclo fundamental RED → GREEN → REFACTOR
52
-
53
- ### Fase RED — El test debe fallar por la razón correcta
54
-
55
- **Paso 1**: Escribir el test que describe el comportamiento esperado.
56
-
57
- ```python
58
- # RED: Este test falla porque calcular_descuento no existe todavía
59
- def test_descuento_cliente_premium_es_15_porciento():
60
- cliente = ClienteFactory(tipo="premium")
61
- resultado = calcular_descuento(cliente, monto=100.0)
62
- assert resultado == 15.0
63
- ```
64
-
65
- **Verificar que el test falla BIEN**:
66
- - Falla con `NameError` o `ImportError` si la función no existe: CORRECTO
67
- - Falla con `AssertionError` si el comportamiento es incorrecto: CORRECTO
68
- - Falla con `TypeError` si la firma es incorrecta: CORRECTO
69
- - Pasa sin que exista implementación: SEÑAL DE ALARMA — el test no prueba nada
70
-
71
- **NUNCA avanzar a GREEN si el test pasa en RED.**
72
-
73
- #### Evidencia RED en telemetría (gate G2 — proyectos con SWL)
74
-
75
- El RED debe dejar rastro verificable (cierra F-TDD-6: "TDD declarativo sin
76
- evidencia"). En proyectos con `.planning/`, registrar la corrida con el CLI
77
- (resuelve cross-scope; en el repo madre equivale a `hooks/lib/loop-telemetry.js`)
78
- ANTES de pasar a GREEN:
79
-
80
- ```bash
81
- # Una vez por fase/tarea — abre la corrida (imprime el dir)
82
- swl-ses loop-telemetry iniciar --tipo=tdd --direccion=lower_is_better --config='{"fase":"0N","tarea":"T-NN"}'
83
-
84
- # Al confirmar el RED — métrica = número de tests fallando, descripción = fallo exacto
85
- swl-ses loop-telemetry registrar --dir=<dir> --iteracion=0 --metrica=<N> --delta=0 --estado=baseline --descripcion="RED T-NN: <error textual del runner>"
86
-
87
- # Al llegar a GREEN
88
- swl-ses loop-telemetry registrar --dir=<dir> --iteracion=1 --metrica=0 --delta=-<N> --estado=keep --descripcion="GREEN T-NN: suite verde"
89
- ```
90
-
91
- `hooks/tdd-gate.js` (warn-only, ADR-0035) busca la fila RED en
92
- `.planning/loops/tdd-*/iteraciones.tsv` al commitear un feature con tests; sin
93
- evidencia emite nudge `tdd-red-evidence`. Sin `.planning/` no aplica.
94
-
95
- #### Marker de trazabilidad REQ en tests (proyectos con REQ-IDs)
96
-
97
- Cuando la fase tiene criterios `REQ-NN` (fases 01-11) o `REQ-<fase>-NN`
98
- (namespaceados, fases ≥12 — DT-IDS-NAMESPACE) en el CONTEXTO, cada test que
99
- verifica un criterio lleva el marker en comentario —
100
- `scripts/verificar-trazabilidad.js` lo usa para cerrar la cadena
101
- REQ→T→commit→test (reconoce ambos formatos):
102
-
103
- ```python
104
- def test_descuento_cliente_premium():
105
- # verifica: REQ-12-03
106
- ...
107
- ```
108
-
109
- ```javascript
110
- test('descuento cliente premium', () => {
111
- // verifica: REQ-12-03
112
- ...
113
- });
114
- ```
115
-
116
- ### Fase GREEN — Implementación mínima
117
-
118
- **Regla de oro**: Implementar solo lo que hace pasar el test. Nada más.
119
-
120
- ```python
121
- # GREEN: Implementación mínima que hace pasar el test
122
- def calcular_descuento(cliente: Cliente, monto: float) -> float:
123
- if cliente.tipo == "premium":
124
- return monto * 0.15
125
- return 0.0
126
- ```
127
-
128
- **Anti-patrón GREEN**: implementar todos los casos de una vez sin tests que los
129
- exijan. Si no hay un test para clientes "gold", no implementes el descuento gold.
130
-
131
- **Verificar**: `pytest -v test_descuentos.py` pasa con el test nuevo.
132
-
133
- ### Fase REFACTOR — Limpieza sin cambiar comportamiento
134
-
135
- **Qué refactorizar en esta fase**:
136
- - Nombres de variables o funciones poco claros
137
- - Duplicación de lógica (si ya existe en otro test)
138
- - Magic numbers que deberían ser constantes
139
- - Estructura de código que anticipa el próximo test
140
-
141
- ```python
142
- # REFACTOR: Extraer constante y mejorar legibilidad
143
- DESCUENTO_POR_TIPO = {
144
- "premium": 0.15,
145
- "gold": 0.20,
146
- "standard": 0.0,
147
- }
148
-
149
- def calcular_descuento(cliente: Cliente, monto: float) -> float:
150
- tasa = DESCUENTO_POR_TIPO.get(cliente.tipo, 0.0)
151
- return monto * tasa
152
- ```
153
-
154
- **Verificar**: todos los tests siguen pasando después del refactor.
155
-
156
- ---
157
-
158
- ## Tests de frontera (boundary tests)
159
-
160
- Para toda función que procesa datos, escribir tests de:
161
-
162
- | Tipo de frontera | Ejemplo |
163
- |----------------|---------|
164
- | Valor cero | `monto=0.0` |
165
- | Valor negativo | `monto=-100.0` |
166
- | Valor máximo | `monto=999_999_999.99` |
167
- | String vacío | `nombre=""` |
168
- | None / null | `cliente=None` |
169
- | Lista vacía | `items=[]` |
170
- | Un solo elemento | `items=[item]` |
171
- | Muchos elementos | `items=lista_de_10000` |
172
- | Valor fuera de dominio | `tipo="inexistente"` |
173
- | Caracteres especiales | `nombre="<script>alert(1)</script>"` |
174
-
175
- ---
176
-
177
- ## Factories y Fixtures
178
-
179
- ### Factories (para datos de test)
180
-
181
- Las factories crean objetos con valores válidos por defecto. Los tests solo
182
- sobreescriben lo que importa para ese test específico.
183
-
184
- **Python con factory_boy**:
185
- ```python
186
- import factory
187
- from myapp.models import Cliente, Pedido
188
-
189
- class ClienteFactory(factory.Factory):
190
- class Meta:
191
- model = Cliente
192
-
193
- id = factory.Sequence(lambda n: f"cliente-{n}")
194
- nombre = factory.Faker("name", locale="es_MX")
195
- email = factory.Faker("email")
196
- tipo = "standard" # default explícito
197
- activo = True
198
-
199
- # Uso en test
200
- def test_descuento_premium():
201
- # Solo especificar lo que importa para este test
202
- cliente = ClienteFactory(tipo="premium")
203
- assert calcular_descuento(cliente, 100.0) == 15.0
204
- ```
205
-
206
- **TypeScript con factory functions**:
207
- ```typescript
208
- // factories/user.factory.ts
209
- export const createUser = (overrides: Partial<User> = {}): User => ({
210
- id: 'user-1',
211
- name: 'Test User',
212
- email: 'test@example.com',
213
- role: 'standard',
214
- active: true,
215
- ...overrides,
216
- });
217
-
218
- // Uso en test
219
- it('should show admin panel for admin users', () => {
220
- const user = createUser({ role: 'admin' });
221
- // ...
222
- });
223
- ```
224
-
225
- ### Fixtures (para estado persistente)
226
-
227
- ```python
228
- # conftest.py
229
- import pytest
230
- from sqlalchemy.ext.asyncio import AsyncSession
231
-
232
- @pytest.fixture
233
- async def db_session():
234
- """Sesión de BD en transacción que hace rollback al terminar."""
235
- async with AsyncSessionLocal() as session:
236
- async with session.begin():
237
- yield session
238
- await session.rollback()
239
-
240
- @pytest.fixture
241
- async def cliente_premium(db_session: AsyncSession):
242
- """Cliente premium persistido en BD de test."""
243
- cliente = ClienteFactory.build(tipo="premium")
244
- db_session.add(cliente)
245
- await db_session.flush()
246
- return cliente
247
- ```
248
-
249
- ---
250
-
251
- ## TDD por tipo de código
252
-
253
- ### Services (lógica de negocio)
254
-
255
- ```python
256
- # Orden de tests para un service nuevo:
257
- # 1. Caso feliz principal
258
- # 2. Validaciones de input inválido
259
- # 3. Casos de borde del dominio
260
- # 4. Interacciones con dependencias (mocks)
261
-
262
- @pytest.mark.asyncio
263
- async def test_crear_pedido_valida_stock_disponible():
264
- producto = ProductoFactory(stock=5)
265
- with pytest.raises(StockInsuficienteError):
266
- await PedidoService.crear(producto_id=producto.id, cantidad=10)
267
- ```
268
-
269
- ### Endpoints FastAPI
270
-
271
- ```python
272
- # Usar TestClient de FastAPI
273
- from fastapi.testclient import TestClient
274
-
275
- def test_endpoint_requiere_autenticacion():
276
- response = client.get("/api/v1/pedidos")
277
- assert response.status_code == 401
278
-
279
- def test_endpoint_retorna_solo_pedidos_del_usuario(cliente_autenticado):
280
- pedido_propio = PedidoFactory(usuario_id=cliente_autenticado.id)
281
- pedido_ajeno = PedidoFactory(usuario_id="otro-usuario")
282
-
283
- response = cliente_autenticado.get("/api/v1/pedidos")
284
- ids = [p["id"] for p in response.json()["items"]]
285
-
286
- assert pedido_propio.id in ids
287
- assert pedido_ajeno.id not in ids # IDOR check
288
- ```
289
-
290
- ### Componentes Angular
291
-
292
- ```typescript
293
- // Usar TestBed + ComponentHarness
294
- describe('PedidosComponent', () => {
295
- it('should display empty state when no orders exist', async () => {
296
- const mockService = { getPedidos: () => of({ items: [], total: 0 }) };
297
- await TestBed.configureTestingModule({
298
- providers: [{ provide: PedidosService, useValue: mockService }]
299
- }).compileComponents();
300
-
301
- const fixture = TestBed.createComponent(PedidosComponent);
302
- fixture.detectChanges();
303
-
304
- const emptyState = fixture.nativeElement.querySelector('[data-testid="empty-state"]');
305
- expect(emptyState).toBeTruthy();
306
- });
307
- });
308
- ```
309
-
310
- ---
311
-
312
- ## Cobertura mínima obligatoria
313
-
314
- | Tipo de módulo | Cobertura mínima |
315
- |---------------|-----------------|
316
- | Services (lógica crítica) | 90% |
317
- | Endpoints (API) | 85% |
318
- | Utilities / helpers | 95% |
319
- | Componentes Angular | 75% |
320
- | Modelos ORM | 70% |
321
-
322
- **Verificar** con reporte de cobertura antes de marcar tarea como completada:
323
- ```bash
324
- pytest --cov=src/services --cov-fail-under=90
325
- ```
326
-
327
- ---
328
-
329
- ## Anti-patrones TDD a evitar
330
-
331
- | Anti-patrón | Descripción | Solución |
332
- |-------------|-------------|---------|
333
- | Test del mock | El test solo verifica que se llamó el mock, no el comportamiento real | Testear el efecto observable |
334
- | Test omnibus | Un solo test que verifica 10 cosas a la vez | Un test, un comportamiento |
335
- | Test frágil | Falla si cambias nombres internos sin cambiar comportamiento | Testear comportamiento, no implementación |
336
- | Fixture global | Un fixture que modifica estado global compartido entre tests | Fixtures con scope limitado, rollback |
337
- | Skip como solución | `@pytest.mark.skip` para tests que fallan | Arreglar el bug o eliminar el test |
338
-
339
- ---
340
-
341
- ## Gotchas / Errores comunes no obvios
342
-
343
- **Fixtures que apuntan a archivos que el sistema muta en runtime se rompen solos — congelar el fixture, nunca el archivo vivo** [caso real swl-ses 2026-07-10]: los tests del ciclo autónomo copiaban `instintos/proyecto.yaml` y `perfil-usuario.yaml` REALES del repo como fixtures; horas después el bootstrap del motor los pobló (72 señales, campos nuevos) y 2 tests verdes reventaron sin que nadie tocara código de test. Causa: el fixture era un puntero al estado vivo, no una instantánea. Con cualquier sistema que auto-muta archivos (telemetría, motores de aprendizaje, caches regenerables), TODO archivo del repo es potencialmente mutable en runtime. Fix: congelar la instantánea de fábrica en `tests/**/fixtures/` (p. ej. `git show HEAD:ruta > tests/x/fixtures/archivo`) y apuntar los tests ahí; documentar en el path del fixture POR QUÉ está congelado. Señal de detección temprana: un test que falla sin diff en el código de test ni en el SUT.
344
-
345
- **`node:test` hereda `process.exitCode`: un caso que lo deja en 1 marca el ARCHIVO entero como fallido aunque todos los tests pasen** [caso real swl-ses 2026-07-10]: un test de CLI que ejercita la rama de error (`wrapper que setea process.exitCode = 1` y retorna null) deja el exit code sucio; node:test reporta `pass N / fail 0` por caso pero el archivo cierra con "test failed" y exit 1. Fix: el test que ejercita ramas de error de CLIs restaura `process.exitCode = 0` tras el assert. Patrón: `assert.equal(process.exitCode, 1); process.exitCode = 0;` — verifica el contrato Y limpia.
346
-
347
- **Tests que dependen de que N llamadas caigan en el MISMO segundo (IDs con timestamp, sufijos de colisión) son flaky por frontera de segundo — congelar el reloj**: si el SUT genera identificadores tipo `tipo-YYMMDD-HHMMSS` y el test llama 3 veces esperando sufijos de colisión `-2`/`-3`, cruzar el límite de segundo entre llamadas hace que la 3ª obtenga timestamp nuevo sin colisión — falla intermitente que puede tumbar un `npm publish` (caso real swl-ses 2026-07-03: `loop-telemetry`). Causa: el SUT toma el reloj de pared internamente; el test no controla el tiempo. Fix (Node): `t.mock.timers.enable({ apis: ['Date'], now: new Date('2026-01-01T12:00:00Z') })` de `node:test` — el equivalente a freezegun; se restaura solo al terminar el test. En Python: `freezegun.freeze_time`. NUNCA "reintentar el test" ni ampliar ventanas: congelar el reloj hace la colisión determinista por construcción.
348
-
349
- **El ciclo TDD se rompe cuando el test en fase RED pasa sin implementación porque la función ya existe con otro nombre en el módulo y Python la importa silenciosamente desde un namespace diferente**: escribir `from app.services import calcular_descuento` en el test cuando `calcular_descuento` ya existe en `app.utils` (importada en `__init__.py`) hace que el test pase en RED sin error, invalidando el ciclo. Causa: los imports con `from app.services import *` en `__init__.py` pueden re-exportar funciones de submódulos, haciendo que el test encuentre una implementación inesperada. Fix: verificar con `python -c "from app.services import calcular_descuento; print(calcular_descuento.__module__)"` que el símbolo viene del módulo correcto. Usar imports explícitos en los tests (`from app.services.descuentos import calcular_descuento`) en lugar de imports de paquete.
350
-
351
- **`pytest.mark.asyncio` con `asyncio_mode = "auto"` en `pytest.ini` hace que fixtures síncronos que retornan coroutines sean llamados sin `await`, causando que el fixture entregue un objeto coroutine en lugar del valor esperado**: un fixture `def cliente_premium(db_session)` que retorna `ClienteFactory.build(tipo="premium")` funciona, pero si accidentalmente se define como `async def cliente_premium(db_session)` y se usa en un test síncrono, pytest lo trata como fixture síncrono y el test recibe el objeto coroutine. Causa: la mezcla de fixtures `async def` y `def` en el mismo `conftest.py` con `asyncio_mode = "auto"` puede crear comportamientos inesperados dependiendo de la versión de `pytest-asyncio`. Fix: en proyectos async, definir TODOS los fixtures relevantes como `async def` explícitamente y verificar que el test use `@pytest.mark.asyncio` o tenga el modo auto configurado correctamente.
352
-
353
- **La fase REFACTOR del ciclo TDD en componentes Angular introduce regresiones silenciosas cuando se extrae lógica a un `computed()` pero el template sigue usando la función directa que ahora devuelve `undefined`**: refactorizar `getTotal()` como método del componente hacia `total = computed(() => ...)` y olvidar actualizar el template de `{{ getTotal() }}` a `{{ total() }}` no genera error de compilación con Angular 17+; el template simplemente muestra `undefined`. Causa: Angular no verifica en tiempo de compilación que los métodos referenciados en templates existen en la clase si el template usa la sintaxis de interpolación sin type-checking estricto. Fix: activar `strictTemplates: true` en `tsconfig.app.json` para que el compilador de Angular valide que todas las referencias en templates corresponden a miembros públicos del componente. Ejecutar `ng build` antes de considerar el REFACTOR completo.
354
-
355
- **`db_session.rollback()` en el fixture de pytest-asyncio no deshace los datos insertados por `db.flush()` dentro de la función testeada cuando la sesión usa `autocommit=True` implícito por configuración del engine**: algunos proyectos configuran `AsyncEngine` con `isolation_level="AUTOCOMMIT"` para compatibilidad con operaciones DDL; en ese contexto, cada `flush()` hace commit inmediatamente y el `rollback()` del fixture no puede deshacer esos cambios. Causa: `AUTOCOMMIT` en PostgreSQL significa que no hay transacción activa que se pueda revertir. Fix: verificar que el engine de tests NO use `isolation_level="AUTOCOMMIT"` (la configuración debe ser solo para el engine de migraciones Alembic, no para el de la app). Para tests que necesitan AUTOCOMMIT por alguna razón, usar una BD de test separada que se trunca con `TRUNCATE ... RESTART IDENTITY CASCADE` en el teardown del fixture.
356
-
357
- **Reloj inyectable como parámetro `ahora` habilita tests deterministas sin `freezegun`, `jest.useFakeTimers()` ni `sinon.useFakeTimers()`** [PATRÓN VALIDADO en SWL Opción C webhook]: cuando una API depende del tiempo (rate-limit con bucket que se rellena, dedup con ventana de retención, cache con TTL, schedulers), recibir el timestamp por parámetro en lugar de llamar `Date.now()` internamente permite que los tests pasen 1000 segundos en 0 ms reales. Diseño: `metodo(arg1, arg2, ahora = Date.now())` — producción no cambia (llamadas siguen siendo `obj.consumir(1)`), tests pasan `ahora` explícito (`obj.consumir(1, T0 + 5000)`). Validado en 3 módulos esta sesión: `rate-limit-ip.js` (40+ tests bucket refill, capacidad, cleanup), `webhook-dedup.js` (ventana de retención, rotación idempotente), helpers internos de `webhook-server.js`. Ningún test usa `sleep`, ningún test es flaky, ningún test mockea `Date`. Aplicable a JS/TS y a Python (`def consumir(self, tokens, ahora=None)` con `ahora = ahora or datetime.now(UTC)` al inicio).
358
-
359
- ```js
360
- // MAL — test no-determinista, requiere sleep o mock global
361
- class Bucket {
362
- consumir(n) {
363
- const ahora = Date.now(); // ← imposible de controlar desde el test
364
- this._rellenar(ahora);
365
- if (this.tokens >= n) { this.tokens -= n; return true; }
366
- return false;
367
- }
368
- }
369
-
370
- // BIEN — reloj inyectable, test determinista
371
- class Bucket {
372
- consumir(n, ahora = Date.now()) { // ← default en producción, inyectable en test
373
- this._rellenar(ahora);
374
- if (this.tokens >= n) { this.tokens -= n; return true; }
375
- return false;
376
- }
377
- }
378
-
379
- // En el test:
380
- const T0 = 1700000000000;
381
- const b = new Bucket(10, 1, T0);
382
- for (let i = 0; i < 10; i++) b.consumir(1, T0); // saturar
383
- assert.equal(b.consumir(1, T0), false); // sin refill aún
384
- assert.equal(b.consumir(5, T0 + 5000), true); // 5 seg después: 5 tokens
385
- ```
386
-
387
- Aplica también a tests de clock skew (tiempo retrocede por NTP): pasar `T0 - 1000` y validar que la lógica no rompe. Origen: rate-limit-ip.js + webhook-dedup.js sesión 2026-05-13.
388
-
389
- **Tests nombrados por feature (`test_emitir_factura_exitosa`) pierden poder regresivo; nombrados por causa raíz (`test_repository_no_usa_columna_inexistente_p_monto`) detectan regresiones específicas sin reproducción manual** [CONFIRMADO en SIGM Opción C F1.4]: cuando se descubre un bug por una causa raíz concreta (typo en nombre de columna SQL, omisión de `selectinload`, mock que devuelve dict en vez de objeto, schema obsoleto), el test de regresión que se escribe debe llevar el nombre de la causa, no del feature afectado. Caso real: durante F1.4 de SIGM, el repository de pagos referenciaba `p.monto` cuando la columna se llamaba `p.monto_pagado`; el test escrito como `test_repository_no_usa_columna_inexistente_p_monto` falló inmediatamente en la siguiente sesión cuando otro agente reintrodujo el typo, sin necesidad de reproducir el escenario de negocio (emitir cobro real, verificar respuesta). Causa: los nombres orientados a feature (`test_pago_exitoso`) son ambiguos sobre QUÉ falla — si el test falla, el desarrollador debe diagnosticar; los nombres orientados a causa raíz (`test_X_no_usa_Y`, `test_query_incluye_selectinload_Z`, `test_service_devuelve_dict_no_objeto`) son auto-diagnósticos. Fix: para cada bug que cueste >30 min diagnosticar, escribir UN test adicional cuyo nombre describa la condición técnica violada, no el escenario de negocio. Convención: `test_<componente>_<condicion_tecnica>` o `test_<componente>_no_<anti_patron>`. Estos tests son tu segunda línea de defensa contra regresiones de la misma causa raíz, complementarios a los tests de comportamiento.
390
-
391
- **`process.cwd()` cacheado al `require()` rompe tests con `process.chdir(sandbox)`** [PATRÓN GENÉRICO TESTING CLI]: scripts Node exportables que leen `process.cwd()` en el scope del módulo (al cargar) congelan el cwd al directorio de invocación. Los tests que crean sandboxes con `fs.mkdtempSync()` y luego `process.chdir(sandbox)` no afectan al cwd cacheado — el script sigue leyendo del cwd original y los assertions fallan con paths inesperados. Caso real (swl-ses `scripts/derivar-feature-list.js` 2026-05-15): la función `enriquecerDesdeFases(fases)` leía `const CWD = process.cwd()` calculado al `require()`; 2 tests con `process.chdir(sandbox)` retornaron `[]` en lugar de detectar el PLAN.md fixture. Causa: el constante se evaluó cuando el `node --test` cargó el módulo desde el cwd del proyecto, no desde el sandbox del test individual. Fix obligatorio: funciones exportables deben aceptar `cwd` como parámetro opcional con fallback dinámico (`function fn(args, opciones = {}) { const cwd = opciones.cwd || process.cwd(); ... }`). El código de producción no cambia (sin args extras), pero los tests pueden inyectar el cwd correcto. Aplica también a Python (`def fn(args, cwd: str | None = None): cwd = cwd or os.getcwd()`) y a cualquier lenguaje con tests que usen chdir.
392
-
393
- ```js
394
- // MAL — cwd cacheado al require, tests con process.chdir() fallan
395
- const CWD = process.cwd();
396
- const PLANNING_DIR = path.join(CWD, '.planning');
397
-
398
- function enriquecerDesdeFases(fases) {
399
- const archivos = fs.readdirSync(path.join(PLANNING_DIR, 'fases')); // cwd congelado
400
- // ...
401
- }
402
-
403
- // BIEN — cwd dinámico con parámetro opcional para tests
404
- function enriquecerDesdeFases(fases, opciones = {}) {
405
- const cwd = opciones.cwd || process.cwd(); // recalcula al llamar
406
- const archivos = fs.readdirSync(path.join(cwd, '.planning', 'fases'));
407
- // ...
408
- }
409
-
410
- // En el test (usa setupSandboxes — regla tests-cleanup.md):
411
- const { setupSandboxes } = require('../_helpers/sandbox');
412
- const sandboxes = setupSandboxes('swl-test-');
413
-
414
- const sandbox = sandboxes.create();
415
- fs.mkdirSync(path.join(sandbox, '.planning', 'fases'), { recursive: true });
416
- // Opción A: pasar cwd explícito (recomendado)
417
- const r = enriquecerDesdeFases([], { cwd: sandbox });
418
- // Opción B: process.chdir() — solo funciona con cwd dinámico
419
- process.chdir(sandbox);
420
- const r2 = enriquecerDesdeFases([]);
421
- // Cleanup automático al final del archivo vía after() registrado por setupSandboxes.
422
- ```
423
-
424
- ---
425
-
426
- ## Gotcha: silenced tests por race condition sobre estado compartido
427
-
428
- ### El anti-patrón
429
-
430
- ```javascript
431
- // MAL — assertion condicional dentro de if que puede ser false por race
432
- const FLAG = path.join(os.tmpdir(), 'mi-app.json');
433
-
434
- test('flag sin contenido emite warning', () => {
435
- borrarFlag();
436
- const res = correrSubproceso();
437
- if (fs.existsSync(FLAG)) { // ← otro test paralelo creó el flag
438
- assert.match(res.stdout, /WARN/); // ← NUNCA se ejecuta si el if es false
439
- }
440
- // sin else → test PASA sin haber validado nada
441
- });
442
-
443
- // El test "verde" no significa "pasó" — significa "no falló ninguna assertion".
444
- // Si la assertion vive dentro de un `if (race)`, una race favorable la salta
445
- // y el test es vacío.
446
- ```
447
-
448
- ### Por qué pasa
449
-
450
- `node:test` paraleliza **archivos** `.test.js` por default (no tests dentro
451
- del mismo archivo). Si dos archivos tocan el mismo path único de filesystem
452
- (`/tmp/foo.json`, lockfiles, sockets), las operaciones se intercalan no
453
- deterministamente. Patrones típicos:
454
-
455
- - Archivo A: `borrarFlag()` → spawn subprocess → assert
456
- - Archivo B: spawn subprocess → `crearFlag()` durante A → assert de A condicionado falla
457
-
458
- ### Patrones correctos
459
-
460
- **Patrón 1 — Aislamiento por path único** (recomendado):
461
-
462
- ```javascript
463
- const { setupSandboxes } = require('../_helpers/sandbox');
464
- const sandboxes = setupSandboxes('swl-mi-app-test-');
465
- const env = { ...process.env };
466
-
467
- // Path único por test usando el helper canónico (regla tests-cleanup.md).
468
- // El cleanup es automático al final del archivo vía after() registrado.
469
- const dir = sandboxes.create();
470
- env.MI_APP_FLAG_PATH = path.join(dir, 'flag.json');
471
-
472
- const res = spawnSync('node', [BIN], { env, ... });
473
-
474
- // Ahora el assert es incondicional — el path es del test, no compartido
475
- assert.match(res.stdout, /WARN/);
476
- ```
477
-
478
- Requiere que el SUT (System Under Test) honre una env var para override
479
- del path. Si no la honra, agregar el override es parte del fix.
480
-
481
- **Patrón 2 — Serialización forzada** (cuando el path es hardcoded):
482
-
483
- ```bash
484
- # Forzar --test-concurrency=1 en la suite completa
485
- node --test --test-concurrency=1 tests/
486
- ```
487
-
488
- Tradeoff: tests más lentos pero deterministas. Aceptable si el aislamiento
489
- no es factible (legacy code).
490
-
491
- **Patrón 3 — assertions incondicionales** con setup determinista:
492
-
493
- ```javascript
494
- // MAL
495
- if (fs.existsSync(FLAG)) assert.match(...)
496
-
497
- // BIEN — setup garantiza la precondición, assertion no se salta
498
- escribirFlag({ ... });
499
- assert.ok(fs.existsSync(FLAG), 'precondición del test'); // ← assertion sobre el setup
500
- const res = correrSubproceso();
501
- assert.match(res.stdout, /WARN/); // ← assertion incondicional sobre el resultado
502
- ```
503
-
504
- ### Anti-patrón: `if (X) assert(Y)` sin `else`
505
-
506
- ```javascript
507
- // MAL — un test que pasa silenciosamente cuando X es false
508
- test('hace algo', () => {
509
- const algo = obtenerAlgo();
510
- if (algo) { // ← race u otra fuente de no-determinismo
511
- assert.equal(algo.valor, 42);
512
- }
513
- // sin else → veredicto "pass" sin haber validado nada
514
- });
515
-
516
- // BIEN — el setup garantiza la precondición o el test falla explícito
517
- test('hace algo', () => {
518
- const algo = obtenerAlgo();
519
- assert.ok(algo, 'precondición: obtenerAlgo debe devolver valor');
520
- assert.equal(algo.valor, 42);
521
- });
522
- ```
523
-
524
- **Regla**: una assertion dentro de un `if` sin `else` es **un test que
525
- puede pasar sin validar nada**. Estos "silenced tests" son la peor clase
526
- de falsa cobertura: el reporter dice "pass" y nadie revisa el código
527
- hasta que un bug llega a producción.
528
-
529
- ### Detección
530
-
531
- - Buscar `if (` dentro de cuerpos de `test(...)`/`it(...)` sin `else { fail() }`
532
- o `else { assert(...) }` correspondiente.
533
- - Si el cuerpo del `if` contiene `assert.*`, considerarlo silenced test
534
- hasta que se demuestre que el `if` no puede ser false en ningún escenario.
535
-
536
- ### Origen
537
-
538
- Detectado en sesión 2026-05-16 del proyecto swl-ses (PR #30): tests del
539
- flag `swl-ses-update-check.json` compartido entre dos archivos `.test.js`
540
- paralelos. El test "sin flag → debe advertir" pasaba en CI cuando otro
541
- archivo creaba el flag, sin ejecutar ninguna assertion. Fix: env var
542
- `SWL_UPDATE_FLAG_PATH` para aislamiento + assertions incondicionales.
543
-
544
- ---
545
-
546
- ## Tests E2E de UI con Playwright — gotchas de actionability
547
-
548
- Dos fallos recurrentes al automatizar UIs con Playwright donde el test "debería
549
- pasar" pero hace timeout o no observa el efecto esperado:
550
-
551
- - **`fill()` hace timeout en un input que el motor considera "not editable" aunque
552
- sea interactivo para el usuario** (widgets custom: input dentro de un overlay/
553
- option marcado `[disabled]`, combos con buscador, etc.). Playwright aplica
554
- checks de actionability (visible, enabled, editable) y se niega a escribir.
555
- Fix: setear el valor con el **setter nativo** y despachar el evento `input` vía
556
- `evaluate`, en vez de `fill()`:
557
-
558
- ```js
559
- await page.locator('#busqueda').evaluate((el, v) => {
560
- const setter = Object.getOwnPropertyDescriptor(
561
- window.HTMLInputElement.prototype, 'value').set;
562
- setter.call(el, v);
563
- el.dispatchEvent(new Event('input', { bubbles: true }));
564
- }, 'texto');
565
- ```
566
-
567
- - **Un click en «Guardar»/«Enviar» que no dispara su request** suele tener un
568
- **paso de confirmación intermedio** (diálogo «¿Confirmar?», modal con timeout),
569
- no un bug del submit. Antes de concluir "no persiste": verificar en la pestaña
570
- de red si hubo (o no) la petición, y buscar un diálogo de confirmación que el
571
- test deba cerrar dentro de su timeout. Un submit que pasa por confirmación
572
- necesita el click de confirmación en la aserción, no solo el del botón inicial.
573
-
574
- Regla general: ante un test E2E que falla, distinguir **bug del producto** de
575
- **gap del test** verificando el estado real (red, DOM, BD) antes de declarar el
576
- veredicto — un timeout de actionability casi nunca es un bug de la app.
577
-
578
- ## Tests E2E de CLIs interactivos sin PTY real
579
-
580
- ### El problema
581
-
582
- Probar un CLI interactivo (TUI con `readline`, prompts, keypress events,
583
- `process.stdin.isTTY`) en CI requiere normalmente un **pseudo-terminal
584
- emulado** (PTY) — usualmente vía `node-pty`, una dependencia **nativa** que:
585
-
586
- - Requiere compilación de extensiones C++ al instalar (puede fallar en
587
- contenedores minimal o en Windows sin Visual Studio Build Tools).
588
- - Agrega ~5 MB al `node_modules` por imagen.
589
- - Hace que el test suite no corra en `npm test` sin setup extra.
590
-
591
- Para CLIs interactivos donde no se necesita probar **el comportamiento
592
- real del terminal** (escape codes, redibujado, scroll), sino solo la
593
- **lógica del wizard** (¿qué pasa si el usuario presiona Esc en el paso 3?,
594
- ¿qué resuelve el promise tras Enter con default?), un harness TTY mockeado
595
- cubre ~90% de los casos sin dep nativa.
596
-
597
- ### Patrón del harness
598
-
599
- ```javascript
600
- // tests/harness-tty.js
601
- 'use strict';
602
-
603
- const readline = require('readline');
604
-
605
- function crearHarness() {
606
- // 1. Capturar estado original para restauración
607
- const stdoutOriginal = process.stdout.write.bind(process.stdout);
608
- const isTtyStdoutOriginal = process.stdout.isTTY;
609
- const isTtyStdinOriginal = process.stdin.isTTY;
610
- const setRawModeOriginal = process.stdin.setRawMode
611
- ? process.stdin.setRawMode.bind(process.stdin) : null;
612
- const emitKeypressOriginal = readline.emitKeypressEvents;
613
-
614
- let capturado = '';
615
- let listenersKeypress = [];
616
-
617
- // 2. Forzar TTY antes de cargar módulos UI (que evalúan ES_TTY al require)
618
- Object.defineProperty(process.stdout, 'isTTY', { value: true, configurable: true });
619
- Object.defineProperty(process.stdin, 'isTTY', { value: true, configurable: true });
620
-
621
- // 3. Capturar stdout en string buffer
622
- process.stdout.write = (chunk) => {
623
- capturado += typeof chunk === 'string' ? chunk : chunk.toString();
624
- return true;
625
- };
626
-
627
- // 4. Mockear setRawMode/resume/pause como no-op (evita tomar control del terminal de test)
628
- process.stdin.setRawMode = () => process.stdin;
629
- process.stdin.resume = () => process.stdin;
630
- process.stdin.pause = () => process.stdin;
631
-
632
- // 5. Interceptar registros de 'keypress' para poder emitirlos a mano
633
- const onListenerOriginal = process.stdin.on.bind(process.stdin);
634
- process.stdin.on = (evento, listener) => {
635
- if (evento === 'keypress') listenersKeypress.push(listener);
636
- return onListenerOriginal(evento, listener);
637
- };
638
-
639
- // 6. Mockear readline.emitKeypressEvents (no necesita stdin real)
640
- readline.emitKeypressEvents = (stream) => stream;
641
-
642
- // 7. Limpiar require cache de módulos UI para que se evalúen con TTY=true
643
- delete require.cache[require.resolve('../scripts/tui/lib/render')];
644
-
645
- function cargarUI() {
646
- return require('../scripts/tui/lib/render');
647
- }
648
-
649
- // 8. Emitir keypress programáticamente
650
- function tecla(nombre, extras = {}) {
651
- const key = { name: nombre, ctrl: false, meta: false, shift: false, ...extras };
652
- const str = nombre.length === 1 ? nombre : '';
653
- for (const listener of [...listenersKeypress]) {
654
- try { listener(str, key); } catch (_) { /* swallow */ }
655
- }
656
- }
657
-
658
- // 9. Esperar N ticks del event loop para promesas internas
659
- function esperarTicks(n = 1) {
660
- let p = Promise.resolve();
661
- for (let i = 0; i < n; i++) p = p.then(() => undefined);
662
- return p;
663
- }
664
-
665
- function captura(opts = {}) {
666
- const valor = capturado;
667
- if (opts.limpiar) capturado = '';
668
- return valor;
669
- }
670
-
671
- function restaurar() {
672
- Object.defineProperty(process.stdout, 'isTTY', { value: isTtyStdoutOriginal, configurable: true });
673
- Object.defineProperty(process.stdin, 'isTTY', { value: isTtyStdinOriginal, configurable: true });
674
- process.stdout.write = stdoutOriginal;
675
- if (setRawModeOriginal) process.stdin.setRawMode = setRawModeOriginal;
676
- process.stdin.on = onListenerOriginal;
677
- readline.emitKeypressEvents = emitKeypressOriginal;
678
- listenersKeypress = [];
679
- // Limpiar require cache para no contaminar otros tests
680
- delete require.cache[require.resolve('../scripts/tui/lib/render')];
681
- }
682
-
683
- return { cargarUI, tecla, esperarTicks, captura, restaurar };
684
- }
685
-
686
- module.exports = { crearHarness };
687
- ```
688
-
689
- ### Uso típico
690
-
691
- ```javascript
692
- const test = require('node:test');
693
- const assert = require('node:assert/strict');
694
- const { crearHarness } = require('./harness-tty');
695
-
696
- test('preguntarSiNo con harness: Enter resuelve con default true', async () => {
697
- const h = crearHarness();
698
- try {
699
- const ui = h.cargarUI();
700
- const promesa = ui.preguntarSiNo('test prompt', true);
701
-
702
- await h.esperarTicks(2);
703
- h.tecla('return');
704
-
705
- const timeout = new Promise((_, reject) =>
706
- setTimeout(() => reject(new Error('no resolvió en 500ms')), 500));
707
-
708
- const r = await Promise.race([promesa, timeout]).catch(() => null);
709
- // r === true si el harness simuló bien; null si readline real bloquea
710
- // (caso esperado en Windows sin PTY real; documentar limitación)
711
- } finally {
712
- h.restaurar();
713
- }
714
- });
715
- ```
716
-
717
- ### Reglas operativas
718
-
719
- - **`restaurar()` en `finally`**: el harness modifica state global
720
- (process.stdout, process.stdin, readline, require.cache). Si un test
721
- no restaura, contamina los siguientes.
722
- - **Test de captura como smoke**: agregar un test "harness captura stdout"
723
- que valida que `process.stdout.write('hola')` aparece en `captura()`.
724
- Si falla, el harness está roto antes de testear el SUT.
725
- - **Test "tecla() es no-op sin listeners"**: validar que emitir keypress
726
- cuando nadie escucha NO rompe el harness ni propaga errores.
727
- - **Limitación reconocida**: si `readline.createInterface()` real toma
728
- control de stdin (en Windows con Git Bash sin PTY), el callback de
729
- `rl.question()` no se invoca aunque el harness emita teclas. Usar
730
- `Promise.race([promesa, timeout])` para que el test no cuelgue —
731
- el test marca limitación, no falla.
732
-
733
- ### Cuándo NO usar este patrón
734
-
735
- - Cuando necesitas probar **redibujado real del terminal** (alt screen
736
- buffer, escape codes complejos, scrollback). Ahí sí necesitas PTY real
737
- via `node-pty` o test manual.
738
- - Cuando el SUT depende de **timing real del teclado** (input rates,
739
- paste detection). El mock no replica latencia.
740
- - Para CLIs sin lógica de control de flujo (solo `console.log` lineal) —
741
- ahí basta capturar stdout sin mockear TTY.
742
-
743
- ### Origen
744
-
745
- Aplicado en swl-ses v1.6.0 (`tests/scripts/tui/harness-tty.js`, ~180 LOC).
746
- Validó el TUI completo de 5 fases sin instalar `node-pty`. Limitación
747
- documentada: 1 test E2E "preguntarSiNo con harness" marca timeout en
748
- Windows + Node 22+ porque readline real bloquea pese a stdin mockeado —
749
- el harness emite la limitación sin fallar.
1
+ ---
2
+ name: tdd-workflow
3
+ description: Flujo completo de Test-Driven Development. Ciclo RED (el test falla) → GREEN (implementación mínima) → REFACTOR (limpieza). Incluye cobertura mínima obligatoria, tests de frontera, factories, fixtures y estrategias para diferentes tipos de código (APIs, services, componentes Angular).
4
+ version: "1.2.4"
5
+ herramientasPermitidas: [Read, Bash]
6
+ evolvable: true # default para skill estandar
7
+ exclusiones:
8
+ - "No cargar para escribir tests de regresión sobre código legacy sin suite existente — en código legacy sin tests, comenzar con caracterización de comportamiento actual antes del ciclo TDD."
9
+ - "No cargar para pruebas de carga o performance testing — para benchmarks y load testing cargar `performance-baseline`."
10
+ - "No cargar para configurar pipelines de CI/CD o runners de tests en GitHub Actions / GitLab CI — para configuración de CI cargar el skill de cloud correspondiente."
11
+ - "No cargar para pruebas de seguridad o fuzzing automático — para testing de seguridad cargar `threat-model-lite` y usar herramientas especializadas (Bandit, OWASP ZAP)."
12
+ ---
13
+ # Habilidad: TDD Workflow Completo
14
+
15
+ ## Cuándo NO cargar
16
+
17
+ - La tarea es añadir tests a código legacy sin suite existente: comenzar con tests de caracterización del comportamiento actual antes del ciclo TDD.
18
+ - La tarea es pruebas de carga o benchmarks: cargar `performance-baseline`.
19
+ - La tarea es configurar CI/CD pipelines: cargar el skill de cloud correspondiente.
20
+ - La tarea es fuzzing o testing de seguridad: cargar `threat-model-lite` y usar herramientas especializadas.
21
+
22
+ ## Propósito
23
+
24
+ TDD no es "escribir tests después" ni "escribir tests antes por costumbre". Es
25
+ un método de diseño donde los tests guían la API pública del código antes de
26
+ que exista la implementación. El resultado es código que hace exactamente lo
27
+ que los tests exigen — ni más, ni menos.
28
+
29
+ ## Cuándo activar
30
+
31
+ - CONTEXT.md o PLAN.md indica que la fase requiere TDD
32
+ - Se implementa lógica de negocio crítica (cálculos, validaciones, permisos)
33
+ - El usuario pide explícitamente TDD
34
+ - Se trabaja en un módulo con historial de bugs
35
+
36
+ ---
37
+
38
+ ## Etapa opcional previa: Gherkin (BDD) y gate de mutación
39
+
40
+ Dos extensiones opt-in del ciclo, ambas con guía completa en recursos:
41
+
42
+ - **Antes del ciclo** — si la fase tiene criterios de aceptación de negocio,
43
+ convertirlos en escenarios Given–When–Then validados por el usuario ANTES de
44
+ implementar; cada escenario es el test RED de su criterio. Guía, runners por
45
+ stack y anti-patrones en [recursos/gherkin-bdd.md](recursos/gherkin-bdd.md).
46
+ - **Después del ciclo** — en módulos críticos, verificar la calidad de los
47
+ asserts con mutation testing incremental sobre el diff:
48
+ `Skill("calidad-mutation-testing")`. La cobertura mide ejecución; los
49
+ mutantes sobrevivientes miden si los tests detectarían un bug.
50
+
51
+ ## El ciclo fundamental RED → GREEN → REFACTOR
52
+
53
+ ### Fase RED — El test debe fallar por la razón correcta
54
+
55
+ **Paso 1**: Escribir el test que describe el comportamiento esperado.
56
+
57
+ ```python
58
+ # RED: Este test falla porque calcular_descuento no existe todavía
59
+ def test_descuento_cliente_premium_es_15_porciento():
60
+ cliente = ClienteFactory(tipo="premium")
61
+ resultado = calcular_descuento(cliente, monto=100.0)
62
+ assert resultado == 15.0
63
+ ```
64
+
65
+ **Verificar que el test falla BIEN**:
66
+ - Falla con `NameError` o `ImportError` si la función no existe: CORRECTO
67
+ - Falla con `AssertionError` si el comportamiento es incorrecto: CORRECTO
68
+ - Falla con `TypeError` si la firma es incorrecta: CORRECTO
69
+ - Pasa sin que exista implementación: SEÑAL DE ALARMA — el test no prueba nada
70
+
71
+ **NUNCA avanzar a GREEN si el test pasa en RED.**
72
+
73
+ #### Evidencia RED en telemetría (gate G2 — proyectos con SWL)
74
+
75
+ El RED debe dejar rastro verificable (cierra F-TDD-6: "TDD declarativo sin
76
+ evidencia"). En proyectos con `.planning/`, registrar la corrida con el CLI
77
+ (resuelve cross-scope; en el repo madre equivale a `hooks/lib/loop-telemetry.js`)
78
+ ANTES de pasar a GREEN:
79
+
80
+ ```bash
81
+ # Una vez por fase/tarea — abre la corrida (imprime el dir)
82
+ swl-ses loop-telemetry iniciar --tipo=tdd --direccion=lower_is_better --config='{"fase":"0N","tarea":"T-NN"}'
83
+
84
+ # Al confirmar el RED — métrica = número de tests fallando, descripción = fallo exacto
85
+ swl-ses loop-telemetry registrar --dir=<dir> --iteracion=0 --metrica=<N> --delta=0 --estado=baseline --descripcion="RED T-NN: <error textual del runner>"
86
+
87
+ # Al llegar a GREEN
88
+ swl-ses loop-telemetry registrar --dir=<dir> --iteracion=1 --metrica=0 --delta=-<N> --estado=keep --descripcion="GREEN T-NN: suite verde"
89
+ ```
90
+
91
+ `hooks/tdd-gate.js` (warn-only, ADR-0035) busca la fila RED en
92
+ `.planning/loops/tdd-*/iteraciones.tsv` al commitear un feature con tests; sin
93
+ evidencia emite nudge `tdd-red-evidence`. Sin `.planning/` no aplica.
94
+
95
+ #### Marker de trazabilidad REQ en tests (proyectos con REQ-IDs)
96
+
97
+ Cuando la fase tiene criterios `REQ-NN` (fases 01-11) o `REQ-<fase>-NN`
98
+ (namespaceados, fases ≥12 — DT-IDS-NAMESPACE) en el CONTEXTO, cada test que
99
+ verifica un criterio lleva el marker en comentario —
100
+ `scripts/verificar-trazabilidad.js` lo usa para cerrar la cadena
101
+ REQ→T→commit→test (reconoce ambos formatos):
102
+
103
+ ```python
104
+ def test_descuento_cliente_premium():
105
+ # verifica: REQ-12-03
106
+ ...
107
+ ```
108
+
109
+ ```javascript
110
+ test('descuento cliente premium', () => {
111
+ // verifica: REQ-12-03
112
+ ...
113
+ });
114
+ ```
115
+
116
+ ### Fase GREEN — Implementación mínima
117
+
118
+ **Regla de oro**: Implementar solo lo que hace pasar el test. Nada más.
119
+
120
+ ```python
121
+ # GREEN: Implementación mínima que hace pasar el test
122
+ def calcular_descuento(cliente: Cliente, monto: float) -> float:
123
+ if cliente.tipo == "premium":
124
+ return monto * 0.15
125
+ return 0.0
126
+ ```
127
+
128
+ **Anti-patrón GREEN**: implementar todos los casos de una vez sin tests que los
129
+ exijan. Si no hay un test para clientes "gold", no implementes el descuento gold.
130
+
131
+ **Verificar**: `pytest -v test_descuentos.py` pasa con el test nuevo.
132
+
133
+ ### Fase REFACTOR — Limpieza sin cambiar comportamiento
134
+
135
+ **Qué refactorizar en esta fase**:
136
+ - Nombres de variables o funciones poco claros
137
+ - Duplicación de lógica (si ya existe en otro test)
138
+ - Magic numbers que deberían ser constantes
139
+ - Estructura de código que anticipa el próximo test
140
+
141
+ ```python
142
+ # REFACTOR: Extraer constante y mejorar legibilidad
143
+ DESCUENTO_POR_TIPO = {
144
+ "premium": 0.15,
145
+ "gold": 0.20,
146
+ "standard": 0.0,
147
+ }
148
+
149
+ def calcular_descuento(cliente: Cliente, monto: float) -> float:
150
+ tasa = DESCUENTO_POR_TIPO.get(cliente.tipo, 0.0)
151
+ return monto * tasa
152
+ ```
153
+
154
+ **Verificar**: todos los tests siguen pasando después del refactor.
155
+
156
+ ---
157
+
158
+ ## Tests de frontera (boundary tests)
159
+
160
+ Para toda función que procesa datos, escribir tests de:
161
+
162
+ | Tipo de frontera | Ejemplo |
163
+ |----------------|---------|
164
+ | Valor cero | `monto=0.0` |
165
+ | Valor negativo | `monto=-100.0` |
166
+ | Valor máximo | `monto=999_999_999.99` |
167
+ | String vacío | `nombre=""` |
168
+ | None / null | `cliente=None` |
169
+ | Lista vacía | `items=[]` |
170
+ | Un solo elemento | `items=[item]` |
171
+ | Muchos elementos | `items=lista_de_10000` |
172
+ | Valor fuera de dominio | `tipo="inexistente"` |
173
+ | Caracteres especiales | `nombre="<script>alert(1)</script>"` |
174
+
175
+ ---
176
+
177
+ ## Factories y Fixtures
178
+
179
+ ### Factories (para datos de test)
180
+
181
+ Las factories crean objetos con valores válidos por defecto. Los tests solo
182
+ sobreescriben lo que importa para ese test específico.
183
+
184
+ **Python con factory_boy**:
185
+ ```python
186
+ import factory
187
+ from myapp.models import Cliente, Pedido
188
+
189
+ class ClienteFactory(factory.Factory):
190
+ class Meta:
191
+ model = Cliente
192
+
193
+ id = factory.Sequence(lambda n: f"cliente-{n}")
194
+ nombre = factory.Faker("name", locale="es_MX")
195
+ email = factory.Faker("email")
196
+ tipo = "standard" # default explícito
197
+ activo = True
198
+
199
+ # Uso en test
200
+ def test_descuento_premium():
201
+ # Solo especificar lo que importa para este test
202
+ cliente = ClienteFactory(tipo="premium")
203
+ assert calcular_descuento(cliente, 100.0) == 15.0
204
+ ```
205
+
206
+ **TypeScript con factory functions**:
207
+ ```typescript
208
+ // factories/user.factory.ts
209
+ export const createUser = (overrides: Partial<User> = {}): User => ({
210
+ id: 'user-1',
211
+ name: 'Test User',
212
+ email: 'test@example.com',
213
+ role: 'standard',
214
+ active: true,
215
+ ...overrides,
216
+ });
217
+
218
+ // Uso en test
219
+ it('should show admin panel for admin users', () => {
220
+ const user = createUser({ role: 'admin' });
221
+ // ...
222
+ });
223
+ ```
224
+
225
+ ### Fixtures (para estado persistente)
226
+
227
+ ```python
228
+ # conftest.py
229
+ import pytest
230
+ from sqlalchemy.ext.asyncio import AsyncSession
231
+
232
+ @pytest.fixture
233
+ async def db_session():
234
+ """Sesión de BD en transacción que hace rollback al terminar."""
235
+ async with AsyncSessionLocal() as session:
236
+ async with session.begin():
237
+ yield session
238
+ await session.rollback()
239
+
240
+ @pytest.fixture
241
+ async def cliente_premium(db_session: AsyncSession):
242
+ """Cliente premium persistido en BD de test."""
243
+ cliente = ClienteFactory.build(tipo="premium")
244
+ db_session.add(cliente)
245
+ await db_session.flush()
246
+ return cliente
247
+ ```
248
+
249
+ ---
250
+
251
+ ## TDD por tipo de código
252
+
253
+ ### Services (lógica de negocio)
254
+
255
+ ```python
256
+ # Orden de tests para un service nuevo:
257
+ # 1. Caso feliz principal
258
+ # 2. Validaciones de input inválido
259
+ # 3. Casos de borde del dominio
260
+ # 4. Interacciones con dependencias (mocks)
261
+
262
+ @pytest.mark.asyncio
263
+ async def test_crear_pedido_valida_stock_disponible():
264
+ producto = ProductoFactory(stock=5)
265
+ with pytest.raises(StockInsuficienteError):
266
+ await PedidoService.crear(producto_id=producto.id, cantidad=10)
267
+ ```
268
+
269
+ ### Endpoints FastAPI
270
+
271
+ ```python
272
+ # Usar TestClient de FastAPI
273
+ from fastapi.testclient import TestClient
274
+
275
+ def test_endpoint_requiere_autenticacion():
276
+ response = client.get("/api/v1/pedidos")
277
+ assert response.status_code == 401
278
+
279
+ def test_endpoint_retorna_solo_pedidos_del_usuario(cliente_autenticado):
280
+ pedido_propio = PedidoFactory(usuario_id=cliente_autenticado.id)
281
+ pedido_ajeno = PedidoFactory(usuario_id="otro-usuario")
282
+
283
+ response = cliente_autenticado.get("/api/v1/pedidos")
284
+ ids = [p["id"] for p in response.json()["items"]]
285
+
286
+ assert pedido_propio.id in ids
287
+ assert pedido_ajeno.id not in ids # IDOR check
288
+ ```
289
+
290
+ ### Componentes Angular
291
+
292
+ ```typescript
293
+ // Usar TestBed + ComponentHarness
294
+ describe('PedidosComponent', () => {
295
+ it('should display empty state when no orders exist', async () => {
296
+ const mockService = { getPedidos: () => of({ items: [], total: 0 }) };
297
+ await TestBed.configureTestingModule({
298
+ providers: [{ provide: PedidosService, useValue: mockService }]
299
+ }).compileComponents();
300
+
301
+ const fixture = TestBed.createComponent(PedidosComponent);
302
+ fixture.detectChanges();
303
+
304
+ const emptyState = fixture.nativeElement.querySelector('[data-testid="empty-state"]');
305
+ expect(emptyState).toBeTruthy();
306
+ });
307
+ });
308
+ ```
309
+
310
+ ---
311
+
312
+ ## Cobertura mínima obligatoria
313
+
314
+ | Tipo de módulo | Cobertura mínima |
315
+ |---------------|-----------------|
316
+ | Services (lógica crítica) | 90% |
317
+ | Endpoints (API) | 85% |
318
+ | Utilities / helpers | 95% |
319
+ | Componentes Angular | 75% |
320
+ | Modelos ORM | 70% |
321
+
322
+ **Verificar** con reporte de cobertura antes de marcar tarea como completada:
323
+ ```bash
324
+ pytest --cov=src/services --cov-fail-under=90
325
+ ```
326
+
327
+ ---
328
+
329
+ ## Anti-patrones TDD a evitar
330
+
331
+ | Anti-patrón | Descripción | Solución |
332
+ |-------------|-------------|---------|
333
+ | Test del mock | El test solo verifica que se llamó el mock, no el comportamiento real | Testear el efecto observable |
334
+ | Test omnibus | Un solo test que verifica 10 cosas a la vez | Un test, un comportamiento |
335
+ | Test frágil | Falla si cambias nombres internos sin cambiar comportamiento | Testear comportamiento, no implementación |
336
+ | Fixture global | Un fixture que modifica estado global compartido entre tests | Fixtures con scope limitado, rollback |
337
+ | Skip como solución | `@pytest.mark.skip` para tests que fallan | Arreglar el bug o eliminar el test |
338
+
339
+ ---
340
+
341
+ ## Gotchas / Errores comunes no obvios
342
+
343
+ **Fixtures que apuntan a archivos que el sistema muta en runtime se rompen solos — congelar el fixture, nunca el archivo vivo** [caso real swl-ses 2026-07-10]: los tests del ciclo autónomo copiaban `instintos/proyecto.yaml` y `perfil-usuario.yaml` REALES del repo como fixtures; horas después el bootstrap del motor los pobló (72 señales, campos nuevos) y 2 tests verdes reventaron sin que nadie tocara código de test. Causa: el fixture era un puntero al estado vivo, no una instantánea. Con cualquier sistema que auto-muta archivos (telemetría, motores de aprendizaje, caches regenerables), TODO archivo del repo es potencialmente mutable en runtime. Fix: congelar la instantánea de fábrica en `tests/**/fixtures/` (p. ej. `git show HEAD:ruta > tests/x/fixtures/archivo`) y apuntar los tests ahí; documentar en el path del fixture POR QUÉ está congelado. Señal de detección temprana: un test que falla sin diff en el código de test ni en el SUT.
344
+
345
+ **`node:test` hereda `process.exitCode`: un caso que lo deja en 1 marca el ARCHIVO entero como fallido aunque todos los tests pasen** [caso real swl-ses 2026-07-10]: un test de CLI que ejercita la rama de error (`wrapper que setea process.exitCode = 1` y retorna null) deja el exit code sucio; node:test reporta `pass N / fail 0` por caso pero el archivo cierra con "test failed" y exit 1. Fix: el test que ejercita ramas de error de CLIs restaura `process.exitCode = 0` tras el assert. Patrón: `assert.equal(process.exitCode, 1); process.exitCode = 0;` — verifica el contrato Y limpia.
346
+
347
+ **Tests que dependen de que N llamadas caigan en el MISMO segundo (IDs con timestamp, sufijos de colisión) son flaky por frontera de segundo — congelar el reloj**: si el SUT genera identificadores tipo `tipo-YYMMDD-HHMMSS` y el test llama 3 veces esperando sufijos de colisión `-2`/`-3`, cruzar el límite de segundo entre llamadas hace que la 3ª obtenga timestamp nuevo sin colisión — falla intermitente que puede tumbar un `npm publish` (caso real swl-ses 2026-07-03: `loop-telemetry`). Causa: el SUT toma el reloj de pared internamente; el test no controla el tiempo. Fix (Node): `t.mock.timers.enable({ apis: ['Date'], now: new Date('2026-01-01T12:00:00Z') })` de `node:test` — el equivalente a freezegun; se restaura solo al terminar el test. En Python: `freezegun.freeze_time`. NUNCA "reintentar el test" ni ampliar ventanas: congelar el reloj hace la colisión determinista por construcción.
348
+
349
+ **El ciclo TDD se rompe cuando el test en fase RED pasa sin implementación porque la función ya existe con otro nombre en el módulo y Python la importa silenciosamente desde un namespace diferente**: escribir `from app.services import calcular_descuento` en el test cuando `calcular_descuento` ya existe en `app.utils` (importada en `__init__.py`) hace que el test pase en RED sin error, invalidando el ciclo. Causa: los imports con `from app.services import *` en `__init__.py` pueden re-exportar funciones de submódulos, haciendo que el test encuentre una implementación inesperada. Fix: verificar con `python -c "from app.services import calcular_descuento; print(calcular_descuento.__module__)"` que el símbolo viene del módulo correcto. Usar imports explícitos en los tests (`from app.services.descuentos import calcular_descuento`) en lugar de imports de paquete.
350
+
351
+ **`pytest.mark.asyncio` con `asyncio_mode = "auto"` en `pytest.ini` hace que fixtures síncronos que retornan coroutines sean llamados sin `await`, causando que el fixture entregue un objeto coroutine en lugar del valor esperado**: un fixture `def cliente_premium(db_session)` que retorna `ClienteFactory.build(tipo="premium")` funciona, pero si accidentalmente se define como `async def cliente_premium(db_session)` y se usa en un test síncrono, pytest lo trata como fixture síncrono y el test recibe el objeto coroutine. Causa: la mezcla de fixtures `async def` y `def` en el mismo `conftest.py` con `asyncio_mode = "auto"` puede crear comportamientos inesperados dependiendo de la versión de `pytest-asyncio`. Fix: en proyectos async, definir TODOS los fixtures relevantes como `async def` explícitamente y verificar que el test use `@pytest.mark.asyncio` o tenga el modo auto configurado correctamente.
352
+
353
+ **La fase REFACTOR del ciclo TDD en componentes Angular introduce regresiones silenciosas cuando se extrae lógica a un `computed()` pero el template sigue usando la función directa que ahora devuelve `undefined`**: refactorizar `getTotal()` como método del componente hacia `total = computed(() => ...)` y olvidar actualizar el template de `{{ getTotal() }}` a `{{ total() }}` no genera error de compilación con Angular 17+; el template simplemente muestra `undefined`. Causa: Angular no verifica en tiempo de compilación que los métodos referenciados en templates existen en la clase si el template usa la sintaxis de interpolación sin type-checking estricto. Fix: activar `strictTemplates: true` en `tsconfig.app.json` para que el compilador de Angular valide que todas las referencias en templates corresponden a miembros públicos del componente. Ejecutar `ng build` antes de considerar el REFACTOR completo.
354
+
355
+ **`db_session.rollback()` en el fixture de pytest-asyncio no deshace los datos insertados por `db.flush()` dentro de la función testeada cuando la sesión usa `autocommit=True` implícito por configuración del engine**: algunos proyectos configuran `AsyncEngine` con `isolation_level="AUTOCOMMIT"` para compatibilidad con operaciones DDL; en ese contexto, cada `flush()` hace commit inmediatamente y el `rollback()` del fixture no puede deshacer esos cambios. Causa: `AUTOCOMMIT` en PostgreSQL significa que no hay transacción activa que se pueda revertir. Fix: verificar que el engine de tests NO use `isolation_level="AUTOCOMMIT"` (la configuración debe ser solo para el engine de migraciones Alembic, no para el de la app). Para tests que necesitan AUTOCOMMIT por alguna razón, usar una BD de test separada que se trunca con `TRUNCATE ... RESTART IDENTITY CASCADE` en el teardown del fixture.
356
+
357
+ **Reloj inyectable como parámetro `ahora` habilita tests deterministas sin `freezegun`, `jest.useFakeTimers()` ni `sinon.useFakeTimers()`** [PATRÓN VALIDADO en SWL Opción C webhook]: cuando una API depende del tiempo (rate-limit con bucket que se rellena, dedup con ventana de retención, cache con TTL, schedulers), recibir el timestamp por parámetro en lugar de llamar `Date.now()` internamente permite que los tests pasen 1000 segundos en 0 ms reales. Diseño: `metodo(arg1, arg2, ahora = Date.now())` — producción no cambia (llamadas siguen siendo `obj.consumir(1)`), tests pasan `ahora` explícito (`obj.consumir(1, T0 + 5000)`). Validado en 3 módulos esta sesión: `rate-limit-ip.js` (40+ tests bucket refill, capacidad, cleanup), `webhook-dedup.js` (ventana de retención, rotación idempotente), helpers internos de `webhook-server.js`. Ningún test usa `sleep`, ningún test es flaky, ningún test mockea `Date`. Aplicable a JS/TS y a Python (`def consumir(self, tokens, ahora=None)` con `ahora = ahora or datetime.now(UTC)` al inicio).
358
+
359
+ ```js
360
+ // MAL — test no-determinista, requiere sleep o mock global
361
+ class Bucket {
362
+ consumir(n) {
363
+ const ahora = Date.now(); // ← imposible de controlar desde el test
364
+ this._rellenar(ahora);
365
+ if (this.tokens >= n) { this.tokens -= n; return true; }
366
+ return false;
367
+ }
368
+ }
369
+
370
+ // BIEN — reloj inyectable, test determinista
371
+ class Bucket {
372
+ consumir(n, ahora = Date.now()) { // ← default en producción, inyectable en test
373
+ this._rellenar(ahora);
374
+ if (this.tokens >= n) { this.tokens -= n; return true; }
375
+ return false;
376
+ }
377
+ }
378
+
379
+ // En el test:
380
+ const T0 = 1700000000000;
381
+ const b = new Bucket(10, 1, T0);
382
+ for (let i = 0; i < 10; i++) b.consumir(1, T0); // saturar
383
+ assert.equal(b.consumir(1, T0), false); // sin refill aún
384
+ assert.equal(b.consumir(5, T0 + 5000), true); // 5 seg después: 5 tokens
385
+ ```
386
+
387
+ Aplica también a tests de clock skew (tiempo retrocede por NTP): pasar `T0 - 1000` y validar que la lógica no rompe. Origen: rate-limit-ip.js + webhook-dedup.js sesión 2026-05-13.
388
+
389
+ **Tests nombrados por feature (`test_emitir_factura_exitosa`) pierden poder regresivo; nombrados por causa raíz (`test_repository_no_usa_columna_inexistente_p_monto`) detectan regresiones específicas sin reproducción manual** [CONFIRMADO en SIGM Opción C F1.4]: cuando se descubre un bug por una causa raíz concreta (typo en nombre de columna SQL, omisión de `selectinload`, mock que devuelve dict en vez de objeto, schema obsoleto), el test de regresión que se escribe debe llevar el nombre de la causa, no del feature afectado. Caso real: durante F1.4 de SIGM, el repository de pagos referenciaba `p.monto` cuando la columna se llamaba `p.monto_pagado`; el test escrito como `test_repository_no_usa_columna_inexistente_p_monto` falló inmediatamente en la siguiente sesión cuando otro agente reintrodujo el typo, sin necesidad de reproducir el escenario de negocio (emitir cobro real, verificar respuesta). Causa: los nombres orientados a feature (`test_pago_exitoso`) son ambiguos sobre QUÉ falla — si el test falla, el desarrollador debe diagnosticar; los nombres orientados a causa raíz (`test_X_no_usa_Y`, `test_query_incluye_selectinload_Z`, `test_service_devuelve_dict_no_objeto`) son auto-diagnósticos. Fix: para cada bug que cueste >30 min diagnosticar, escribir UN test adicional cuyo nombre describa la condición técnica violada, no el escenario de negocio. Convención: `test_<componente>_<condicion_tecnica>` o `test_<componente>_no_<anti_patron>`. Estos tests son tu segunda línea de defensa contra regresiones de la misma causa raíz, complementarios a los tests de comportamiento.
390
+
391
+ **`process.cwd()` cacheado al `require()` rompe tests con `process.chdir(sandbox)`** [PATRÓN GENÉRICO TESTING CLI]: scripts Node exportables que leen `process.cwd()` en el scope del módulo (al cargar) congelan el cwd al directorio de invocación. Los tests que crean sandboxes con `fs.mkdtempSync()` y luego `process.chdir(sandbox)` no afectan al cwd cacheado — el script sigue leyendo del cwd original y los assertions fallan con paths inesperados. Caso real (swl-ses `scripts/derivar-feature-list.js` 2026-05-15): la función `enriquecerDesdeFases(fases)` leía `const CWD = process.cwd()` calculado al `require()`; 2 tests con `process.chdir(sandbox)` retornaron `[]` en lugar de detectar el PLAN.md fixture. Causa: el constante se evaluó cuando el `node --test` cargó el módulo desde el cwd del proyecto, no desde el sandbox del test individual. Fix obligatorio: funciones exportables deben aceptar `cwd` como parámetro opcional con fallback dinámico (`function fn(args, opciones = {}) { const cwd = opciones.cwd || process.cwd(); ... }`). El código de producción no cambia (sin args extras), pero los tests pueden inyectar el cwd correcto. Aplica también a Python (`def fn(args, cwd: str | None = None): cwd = cwd or os.getcwd()`) y a cualquier lenguaje con tests que usen chdir.
392
+
393
+ ```js
394
+ // MAL — cwd cacheado al require, tests con process.chdir() fallan
395
+ const CWD = process.cwd();
396
+ const PLANNING_DIR = path.join(CWD, '.planning');
397
+
398
+ function enriquecerDesdeFases(fases) {
399
+ const archivos = fs.readdirSync(path.join(PLANNING_DIR, 'fases')); // cwd congelado
400
+ // ...
401
+ }
402
+
403
+ // BIEN — cwd dinámico con parámetro opcional para tests
404
+ function enriquecerDesdeFases(fases, opciones = {}) {
405
+ const cwd = opciones.cwd || process.cwd(); // recalcula al llamar
406
+ const archivos = fs.readdirSync(path.join(cwd, '.planning', 'fases'));
407
+ // ...
408
+ }
409
+
410
+ // En el test (usa setupSandboxes — regla tests-cleanup.md):
411
+ const { setupSandboxes } = require('../_helpers/sandbox');
412
+ const sandboxes = setupSandboxes('swl-test-');
413
+
414
+ const sandbox = sandboxes.create();
415
+ fs.mkdirSync(path.join(sandbox, '.planning', 'fases'), { recursive: true });
416
+ // Opción A: pasar cwd explícito (recomendado)
417
+ const r = enriquecerDesdeFases([], { cwd: sandbox });
418
+ // Opción B: process.chdir() — solo funciona con cwd dinámico
419
+ process.chdir(sandbox);
420
+ const r2 = enriquecerDesdeFases([]);
421
+ // Cleanup automático al final del archivo vía after() registrado por setupSandboxes.
422
+ ```
423
+
424
+ ---
425
+
426
+ ## Gotcha: silenced tests por race condition sobre estado compartido
427
+
428
+ ### El anti-patrón
429
+
430
+ ```javascript
431
+ // MAL — assertion condicional dentro de if que puede ser false por race
432
+ const FLAG = path.join(os.tmpdir(), 'mi-app.json');
433
+
434
+ test('flag sin contenido emite warning', () => {
435
+ borrarFlag();
436
+ const res = correrSubproceso();
437
+ if (fs.existsSync(FLAG)) { // ← otro test paralelo creó el flag
438
+ assert.match(res.stdout, /WARN/); // ← NUNCA se ejecuta si el if es false
439
+ }
440
+ // sin else → test PASA sin haber validado nada
441
+ });
442
+
443
+ // El test "verde" no significa "pasó" — significa "no falló ninguna assertion".
444
+ // Si la assertion vive dentro de un `if (race)`, una race favorable la salta
445
+ // y el test es vacío.
446
+ ```
447
+
448
+ ### Por qué pasa
449
+
450
+ `node:test` paraleliza **archivos** `.test.js` por default (no tests dentro
451
+ del mismo archivo). Si dos archivos tocan el mismo path único de filesystem
452
+ (`/tmp/foo.json`, lockfiles, sockets), las operaciones se intercalan no
453
+ deterministamente. Patrones típicos:
454
+
455
+ - Archivo A: `borrarFlag()` → spawn subprocess → assert
456
+ - Archivo B: spawn subprocess → `crearFlag()` durante A → assert de A condicionado falla
457
+
458
+ ### Patrones correctos
459
+
460
+ **Patrón 1 — Aislamiento por path único** (recomendado):
461
+
462
+ ```javascript
463
+ const { setupSandboxes } = require('../_helpers/sandbox');
464
+ const sandboxes = setupSandboxes('swl-mi-app-test-');
465
+ const env = { ...process.env };
466
+
467
+ // Path único por test usando el helper canónico (regla tests-cleanup.md).
468
+ // El cleanup es automático al final del archivo vía after() registrado.
469
+ const dir = sandboxes.create();
470
+ env.MI_APP_FLAG_PATH = path.join(dir, 'flag.json');
471
+
472
+ const res = spawnSync('node', [BIN], { env, ... });
473
+
474
+ // Ahora el assert es incondicional — el path es del test, no compartido
475
+ assert.match(res.stdout, /WARN/);
476
+ ```
477
+
478
+ Requiere que el SUT (System Under Test) honre una env var para override
479
+ del path. Si no la honra, agregar el override es parte del fix.
480
+
481
+ **Patrón 2 — Serialización forzada** (cuando el path es hardcoded):
482
+
483
+ ```bash
484
+ # Forzar --test-concurrency=1 en la suite completa
485
+ node --test --test-concurrency=1 tests/
486
+ ```
487
+
488
+ Tradeoff: tests más lentos pero deterministas. Aceptable si el aislamiento
489
+ no es factible (legacy code).
490
+
491
+ **Patrón 3 — assertions incondicionales** con setup determinista:
492
+
493
+ ```javascript
494
+ // MAL
495
+ if (fs.existsSync(FLAG)) assert.match(...)
496
+
497
+ // BIEN — setup garantiza la precondición, assertion no se salta
498
+ escribirFlag({ ... });
499
+ assert.ok(fs.existsSync(FLAG), 'precondición del test'); // ← assertion sobre el setup
500
+ const res = correrSubproceso();
501
+ assert.match(res.stdout, /WARN/); // ← assertion incondicional sobre el resultado
502
+ ```
503
+
504
+ ### Anti-patrón: `if (X) assert(Y)` sin `else`
505
+
506
+ ```javascript
507
+ // MAL — un test que pasa silenciosamente cuando X es false
508
+ test('hace algo', () => {
509
+ const algo = obtenerAlgo();
510
+ if (algo) { // ← race u otra fuente de no-determinismo
511
+ assert.equal(algo.valor, 42);
512
+ }
513
+ // sin else → veredicto "pass" sin haber validado nada
514
+ });
515
+
516
+ // BIEN — el setup garantiza la precondición o el test falla explícito
517
+ test('hace algo', () => {
518
+ const algo = obtenerAlgo();
519
+ assert.ok(algo, 'precondición: obtenerAlgo debe devolver valor');
520
+ assert.equal(algo.valor, 42);
521
+ });
522
+ ```
523
+
524
+ **Regla**: una assertion dentro de un `if` sin `else` es **un test que
525
+ puede pasar sin validar nada**. Estos "silenced tests" son la peor clase
526
+ de falsa cobertura: el reporter dice "pass" y nadie revisa el código
527
+ hasta que un bug llega a producción.
528
+
529
+ ### Detección
530
+
531
+ - Buscar `if (` dentro de cuerpos de `test(...)`/`it(...)` sin `else { fail() }`
532
+ o `else { assert(...) }` correspondiente.
533
+ - Si el cuerpo del `if` contiene `assert.*`, considerarlo silenced test
534
+ hasta que se demuestre que el `if` no puede ser false en ningún escenario.
535
+
536
+ ### Origen
537
+
538
+ Detectado en sesión 2026-05-16 del proyecto swl-ses (PR #30): tests del
539
+ flag `swl-ses-update-check.json` compartido entre dos archivos `.test.js`
540
+ paralelos. El test "sin flag → debe advertir" pasaba en CI cuando otro
541
+ archivo creaba el flag, sin ejecutar ninguna assertion. Fix: env var
542
+ `SWL_UPDATE_FLAG_PATH` para aislamiento + assertions incondicionales.
543
+
544
+ ---
545
+
546
+ ## Tests E2E de UI con Playwright — gotchas de actionability
547
+
548
+ Dos fallos recurrentes al automatizar UIs con Playwright donde el test "debería
549
+ pasar" pero hace timeout o no observa el efecto esperado:
550
+
551
+ - **`fill()` hace timeout en un input que el motor considera "not editable" aunque
552
+ sea interactivo para el usuario** (widgets custom: input dentro de un overlay/
553
+ option marcado `[disabled]`, combos con buscador, etc.). Playwright aplica
554
+ checks de actionability (visible, enabled, editable) y se niega a escribir.
555
+ Fix: setear el valor con el **setter nativo** y despachar el evento `input` vía
556
+ `evaluate`, en vez de `fill()`:
557
+
558
+ ```js
559
+ await page.locator('#busqueda').evaluate((el, v) => {
560
+ const setter = Object.getOwnPropertyDescriptor(
561
+ window.HTMLInputElement.prototype, 'value').set;
562
+ setter.call(el, v);
563
+ el.dispatchEvent(new Event('input', { bubbles: true }));
564
+ }, 'texto');
565
+ ```
566
+
567
+ - **Un click en «Guardar»/«Enviar» que no dispara su request** suele tener un
568
+ **paso de confirmación intermedio** (diálogo «¿Confirmar?», modal con timeout),
569
+ no un bug del submit. Antes de concluir "no persiste": verificar en la pestaña
570
+ de red si hubo (o no) la petición, y buscar un diálogo de confirmación que el
571
+ test deba cerrar dentro de su timeout. Un submit que pasa por confirmación
572
+ necesita el click de confirmación en la aserción, no solo el del botón inicial.
573
+
574
+ Regla general: ante un test E2E que falla, distinguir **bug del producto** de
575
+ **gap del test** verificando el estado real (red, DOM, BD) antes de declarar el
576
+ veredicto — un timeout de actionability casi nunca es un bug de la app.
577
+
578
+ ## Tests E2E de CLIs interactivos sin PTY real
579
+
580
+ ### El problema
581
+
582
+ Probar un CLI interactivo (TUI con `readline`, prompts, keypress events,
583
+ `process.stdin.isTTY`) en CI requiere normalmente un **pseudo-terminal
584
+ emulado** (PTY) — usualmente vía `node-pty`, una dependencia **nativa** que:
585
+
586
+ - Requiere compilación de extensiones C++ al instalar (puede fallar en
587
+ contenedores minimal o en Windows sin Visual Studio Build Tools).
588
+ - Agrega ~5 MB al `node_modules` por imagen.
589
+ - Hace que el test suite no corra en `npm test` sin setup extra.
590
+
591
+ Para CLIs interactivos donde no se necesita probar **el comportamiento
592
+ real del terminal** (escape codes, redibujado, scroll), sino solo la
593
+ **lógica del wizard** (¿qué pasa si el usuario presiona Esc en el paso 3?,
594
+ ¿qué resuelve el promise tras Enter con default?), un harness TTY mockeado
595
+ cubre ~90% de los casos sin dep nativa.
596
+
597
+ ### Patrón del harness
598
+
599
+ ```javascript
600
+ // tests/harness-tty.js
601
+ 'use strict';
602
+
603
+ const readline = require('readline');
604
+
605
+ function crearHarness() {
606
+ // 1. Capturar estado original para restauración
607
+ const stdoutOriginal = process.stdout.write.bind(process.stdout);
608
+ const isTtyStdoutOriginal = process.stdout.isTTY;
609
+ const isTtyStdinOriginal = process.stdin.isTTY;
610
+ const setRawModeOriginal = process.stdin.setRawMode
611
+ ? process.stdin.setRawMode.bind(process.stdin) : null;
612
+ const emitKeypressOriginal = readline.emitKeypressEvents;
613
+
614
+ let capturado = '';
615
+ let listenersKeypress = [];
616
+
617
+ // 2. Forzar TTY antes de cargar módulos UI (que evalúan ES_TTY al require)
618
+ Object.defineProperty(process.stdout, 'isTTY', { value: true, configurable: true });
619
+ Object.defineProperty(process.stdin, 'isTTY', { value: true, configurable: true });
620
+
621
+ // 3. Capturar stdout en string buffer
622
+ process.stdout.write = (chunk) => {
623
+ capturado += typeof chunk === 'string' ? chunk : chunk.toString();
624
+ return true;
625
+ };
626
+
627
+ // 4. Mockear setRawMode/resume/pause como no-op (evita tomar control del terminal de test)
628
+ process.stdin.setRawMode = () => process.stdin;
629
+ process.stdin.resume = () => process.stdin;
630
+ process.stdin.pause = () => process.stdin;
631
+
632
+ // 5. Interceptar registros de 'keypress' para poder emitirlos a mano
633
+ const onListenerOriginal = process.stdin.on.bind(process.stdin);
634
+ process.stdin.on = (evento, listener) => {
635
+ if (evento === 'keypress') listenersKeypress.push(listener);
636
+ return onListenerOriginal(evento, listener);
637
+ };
638
+
639
+ // 6. Mockear readline.emitKeypressEvents (no necesita stdin real)
640
+ readline.emitKeypressEvents = (stream) => stream;
641
+
642
+ // 7. Limpiar require cache de módulos UI para que se evalúen con TTY=true
643
+ delete require.cache[require.resolve('../scripts/tui/lib/render')];
644
+
645
+ function cargarUI() {
646
+ return require('../scripts/tui/lib/render');
647
+ }
648
+
649
+ // 8. Emitir keypress programáticamente
650
+ function tecla(nombre, extras = {}) {
651
+ const key = { name: nombre, ctrl: false, meta: false, shift: false, ...extras };
652
+ const str = nombre.length === 1 ? nombre : '';
653
+ for (const listener of [...listenersKeypress]) {
654
+ try { listener(str, key); } catch (_) { /* swallow */ }
655
+ }
656
+ }
657
+
658
+ // 9. Esperar N ticks del event loop para promesas internas
659
+ function esperarTicks(n = 1) {
660
+ let p = Promise.resolve();
661
+ for (let i = 0; i < n; i++) p = p.then(() => undefined);
662
+ return p;
663
+ }
664
+
665
+ function captura(opts = {}) {
666
+ const valor = capturado;
667
+ if (opts.limpiar) capturado = '';
668
+ return valor;
669
+ }
670
+
671
+ function restaurar() {
672
+ Object.defineProperty(process.stdout, 'isTTY', { value: isTtyStdoutOriginal, configurable: true });
673
+ Object.defineProperty(process.stdin, 'isTTY', { value: isTtyStdinOriginal, configurable: true });
674
+ process.stdout.write = stdoutOriginal;
675
+ if (setRawModeOriginal) process.stdin.setRawMode = setRawModeOriginal;
676
+ process.stdin.on = onListenerOriginal;
677
+ readline.emitKeypressEvents = emitKeypressOriginal;
678
+ listenersKeypress = [];
679
+ // Limpiar require cache para no contaminar otros tests
680
+ delete require.cache[require.resolve('../scripts/tui/lib/render')];
681
+ }
682
+
683
+ return { cargarUI, tecla, esperarTicks, captura, restaurar };
684
+ }
685
+
686
+ module.exports = { crearHarness };
687
+ ```
688
+
689
+ ### Uso típico
690
+
691
+ ```javascript
692
+ const test = require('node:test');
693
+ const assert = require('node:assert/strict');
694
+ const { crearHarness } = require('./harness-tty');
695
+
696
+ test('preguntarSiNo con harness: Enter resuelve con default true', async () => {
697
+ const h = crearHarness();
698
+ try {
699
+ const ui = h.cargarUI();
700
+ const promesa = ui.preguntarSiNo('test prompt', true);
701
+
702
+ await h.esperarTicks(2);
703
+ h.tecla('return');
704
+
705
+ const timeout = new Promise((_, reject) =>
706
+ setTimeout(() => reject(new Error('no resolvió en 500ms')), 500));
707
+
708
+ const r = await Promise.race([promesa, timeout]).catch(() => null);
709
+ // r === true si el harness simuló bien; null si readline real bloquea
710
+ // (caso esperado en Windows sin PTY real; documentar limitación)
711
+ } finally {
712
+ h.restaurar();
713
+ }
714
+ });
715
+ ```
716
+
717
+ ### Reglas operativas
718
+
719
+ - **`restaurar()` en `finally`**: el harness modifica state global
720
+ (process.stdout, process.stdin, readline, require.cache). Si un test
721
+ no restaura, contamina los siguientes.
722
+ - **Test de captura como smoke**: agregar un test "harness captura stdout"
723
+ que valida que `process.stdout.write('hola')` aparece en `captura()`.
724
+ Si falla, el harness está roto antes de testear el SUT.
725
+ - **Test "tecla() es no-op sin listeners"**: validar que emitir keypress
726
+ cuando nadie escucha NO rompe el harness ni propaga errores.
727
+ - **Limitación reconocida**: si `readline.createInterface()` real toma
728
+ control de stdin (en Windows con Git Bash sin PTY), el callback de
729
+ `rl.question()` no se invoca aunque el harness emita teclas. Usar
730
+ `Promise.race([promesa, timeout])` para que el test no cuelgue —
731
+ el test marca limitación, no falla.
732
+
733
+ ### Cuándo NO usar este patrón
734
+
735
+ - Cuando necesitas probar **redibujado real del terminal** (alt screen
736
+ buffer, escape codes complejos, scrollback). Ahí sí necesitas PTY real
737
+ via `node-pty` o test manual.
738
+ - Cuando el SUT depende de **timing real del teclado** (input rates,
739
+ paste detection). El mock no replica latencia.
740
+ - Para CLIs sin lógica de control de flujo (solo `console.log` lineal) —
741
+ ahí basta capturar stdout sin mockear TTY.
742
+
743
+ ### Origen
744
+
745
+ Aplicado en swl-ses v1.6.0 (`tests/scripts/tui/harness-tty.js`, ~180 LOC).
746
+ Validó el TUI completo de 5 fases sin instalar `node-pty`. Limitación
747
+ documentada: 1 test E2E "preguntarSiNo con harness" marca timeout en
748
+ Windows + Node 22+ porque readline real bloquea pese a stdin mockeado —
749
+ el harness emite la limitación sin fallar.