@saulwade/swl-ses 2.6.0 → 2.8.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (435) hide show
  1. package/CLAUDE.md +209 -197
  2. package/README.md +647 -600
  3. package/agentes/accesibilidad-wcag-swl.md +690 -690
  4. package/agentes/arquitecto-swl.md +267 -267
  5. package/agentes/auto-evolucion-swl.md +932 -932
  6. package/agentes/backend-csharp-swl.md +420 -420
  7. package/agentes/backend-go-swl.md +390 -390
  8. package/agentes/backend-java-swl.md +281 -281
  9. package/agentes/backend-rust-swl.md +364 -364
  10. package/agentes/backend-workers-swl.md +482 -482
  11. package/agentes/cloud-infra-swl.md +509 -509
  12. package/agentes/consolidador-swl.md +541 -541
  13. package/agentes/depurador-swl.md +352 -352
  14. package/agentes/devops-ci-swl.md +400 -400
  15. package/agentes/disenador-ui-swl.md +569 -569
  16. package/agentes/documentador-swl.md +345 -345
  17. package/agentes/frontend-angular-swl.md +621 -621
  18. package/agentes/frontend-css-swl.md +716 -716
  19. package/agentes/frontend-react-swl.md +692 -692
  20. package/agentes/frontend-swl.md +496 -496
  21. package/agentes/frontend-tailwind-swl.md +826 -826
  22. package/agentes/investigador-swl.md +432 -432
  23. package/agentes/investigador-ux-swl.md +505 -505
  24. package/agentes/migrador-swl.md +442 -442
  25. package/agentes/mobile-android-swl.md +511 -511
  26. package/agentes/mobile-cross-swl.md +541 -541
  27. package/agentes/mobile-ios-swl.md +502 -502
  28. package/agentes/mobile-testing-swl.md +302 -302
  29. package/agentes/nemesis-auditor-swl.md +285 -285
  30. package/agentes/observabilidad-swl.md +438 -438
  31. package/agentes/pagos-swl.md +310 -310
  32. package/agentes/perfilador-usuario-swl.md +321 -321
  33. package/agentes/planificador-swl.md +399 -399
  34. package/agentes/producto-prd-swl.md +589 -589
  35. package/agentes/red-team-swl.md +218 -218
  36. package/agentes/release-manager-swl.md +590 -590
  37. package/agentes/rendimiento-swl.md +713 -713
  38. package/agentes/revisor-angular-swl.md +278 -278
  39. package/agentes/revisor-csharp-swl.md +264 -264
  40. package/agentes/revisor-go-swl.md +259 -259
  41. package/agentes/revisor-java-swl.md +257 -257
  42. package/agentes/revisor-kotlin-swl.md +273 -273
  43. package/agentes/revisor-nextjs-swl.md +281 -281
  44. package/agentes/revisor-php-swl.md +271 -271
  45. package/agentes/revisor-react-swl.md +278 -278
  46. package/agentes/revisor-rust-swl.md +346 -346
  47. package/agentes/revisor-seguridad-swl.md +399 -399
  48. package/agentes/revisor-swift-swl.md +268 -268
  49. package/agentes/revisor-typescript-swl.md +346 -346
  50. package/agentes/tdd-qa-swl.md +393 -393
  51. package/bin/swl-ses.js +10 -0
  52. package/comandos/swl/actualizar.md +174 -174
  53. package/comandos/swl/adoptar-proyecto.md +265 -265
  54. package/comandos/swl/aprender.md +836 -836
  55. package/comandos/swl/aprobar-plan.md +146 -146
  56. package/comandos/swl/auditar-deps.md +134 -134
  57. package/comandos/swl/autoresearch.md +264 -264
  58. package/comandos/swl/ayuda.md +224 -224
  59. package/comandos/swl/brainstorm.md +52 -51
  60. package/comandos/swl/checkpoint.md +325 -325
  61. package/comandos/swl/claudemd.md +234 -234
  62. package/comandos/swl/compactar.md +310 -310
  63. package/comandos/swl/configurar-ci.md +235 -235
  64. package/comandos/swl/contexto.md +110 -110
  65. package/comandos/swl/crear-skill.md +292 -292
  66. package/comandos/swl/cron.md +194 -194
  67. package/comandos/swl/deuda-codigo.md +97 -97
  68. package/comandos/swl/discutir-fase.md +169 -169
  69. package/comandos/swl/ejecutar-fase.md +233 -233
  70. package/comandos/swl/evaluar-skill.md +520 -520
  71. package/comandos/swl/evolucion-continua.md +73 -73
  72. package/comandos/swl/evolucionar.md +267 -267
  73. package/comandos/swl/exportar-vault.md +583 -583
  74. package/comandos/swl/fix.md +118 -118
  75. package/comandos/swl/gateway.md +158 -158
  76. package/comandos/swl/inbox.md +116 -116
  77. package/comandos/swl/instalar.md +220 -220
  78. package/comandos/swl/instintos.md +86 -86
  79. package/comandos/swl/mapear-codebase.md +312 -312
  80. package/comandos/swl/mcp-status.md +176 -175
  81. package/comandos/swl/modelo.md +100 -100
  82. package/comandos/swl/nemesis.md +433 -433
  83. package/comandos/swl/notificaciones.md +299 -299
  84. package/comandos/swl/nuevo-proyecto.md +251 -251
  85. package/comandos/swl/planear-fase.md +263 -263
  86. package/comandos/swl/plugins.md +256 -256
  87. package/comandos/swl/predecir.md +169 -169
  88. package/comandos/swl/reflect-skills.md +125 -125
  89. package/comandos/swl/release.md +450 -450
  90. package/comandos/swl/revisar-impacto.md +201 -201
  91. package/comandos/swl/revisar.md +330 -330
  92. package/comandos/swl/seguridad.md +189 -189
  93. package/comandos/swl/sesiones.md +200 -200
  94. package/comandos/swl/skill-search.md +113 -113
  95. package/comandos/swl/status.md +345 -345
  96. package/comandos/swl/verificar.md +817 -817
  97. package/comandos/swl/wiki.md +620 -620
  98. package/gateway/cron/jobs.example.json +12 -12
  99. package/gateway/lib/event-channel.js +191 -191
  100. package/habilidades/agent-deep-links/SKILL.md +148 -148
  101. package/habilidades/auto-evolucion-protocolo/SKILL.md +294 -294
  102. package/habilidades/backend-async-postgres-testing/SKILL.md +216 -215
  103. package/habilidades/backend-error-design/SKILL.md +221 -221
  104. package/habilidades/backend-production-resilience/SKILL.md +288 -288
  105. package/habilidades/calidad-anti-patrones-universales/SKILL.md +105 -1
  106. package/habilidades/calidad-contract-testing/SKILL.md +165 -165
  107. package/habilidades/calidad-mutation-testing/SKILL.md +25 -1
  108. package/habilidades/changelog-generator/SKILL.md +174 -174
  109. package/habilidades/checklist-seguridad/recursos/stride-cobertura.md +60 -60
  110. package/habilidades/ci-cd-pipelines/SKILL.md +5 -1
  111. package/habilidades/compactacion-contexto/SKILL.md +2 -1
  112. package/habilidades/contenedores-docker/SKILL.md +4 -2
  113. package/habilidades/css-moderno/SKILL.md +7 -1
  114. package/habilidades/diagrama-arquitectura/assets/template.html +276 -276
  115. package/habilidades/doubt-driven-review/SKILL.md +207 -207
  116. package/habilidades/doubt-driven-review/recursos/EXAMPLES.md +130 -130
  117. package/habilidades/drift-detection/SKILL.md +1 -1
  118. package/habilidades/ejecutar-task-iterativo/SKILL.md +278 -278
  119. package/habilidades/estructura-proyecto-claude/recursos/mcp-json-template.json +57 -57
  120. package/habilidades/extractor-de-aprendizajes/SKILL.md +12 -2
  121. package/habilidades/feynman-auditor-swl/recursos/preguntas-language-agnostic.md +108 -108
  122. package/habilidades/git-worktrees-paralelo/SKILL.md +19 -1
  123. package/habilidades/harness-claude-code/SKILL.md +315 -314
  124. package/habilidades/instalar-sistema/SKILL.md +227 -227
  125. package/habilidades/meta-skills-estandar/recursos/convencion-examples.md +93 -93
  126. package/habilidades/patrones-python/recursos/patrones-avanzados.md +469 -469
  127. package/habilidades/perfil-usuario/SKILL.md +200 -200
  128. package/habilidades/planear-fase/SKILL.md +358 -358
  129. package/habilidades/prevencion-sobreingenieria/recursos/EXAMPLES.md +580 -580
  130. package/habilidades/proceso-ddia-streaming/SKILL.md +231 -231
  131. package/habilidades/proceso-discovery-machote/SKILL.md +157 -157
  132. package/habilidades/proceso-dynamic-workflows/SKILL.md +60 -0
  133. package/habilidades/proceso-dynamic-workflows/recursos/template-adversarial-verify.js +65 -65
  134. package/habilidades/proceso-dynamic-workflows/recursos/template-triage.js +65 -65
  135. package/habilidades/proceso-ingenieria-requerimientos/SKILL.md +147 -147
  136. package/habilidades/proceso-intent-engineering/SKILL.md +269 -269
  137. package/habilidades/proceso-modular-split/SKILL.md +256 -256
  138. package/habilidades/release-semver/SKILL.md +2 -2
  139. package/habilidades/state-inconsistency-auditor-swl/recursos/coupled-state-patterns.md +147 -147
  140. package/habilidades/swl-claudemd/recursos/contrato-aprender.md +83 -83
  141. package/habilidades/swl-claudemd/recursos/duplicacion-reglas-globales.md +85 -85
  142. package/habilidades/swl-claudemd/recursos/plantillas-init.md +94 -94
  143. package/habilidades/tdd-workflow/SKILL.md +749 -749
  144. package/habilidades/tdd-workflow/recursos/gherkin-bdd.md +111 -111
  145. package/hooks/agente-lifecycle.js +1 -1
  146. package/hooks/audit-trail.js +1 -1
  147. package/hooks/auto-consolidacion.js +1 -1
  148. package/hooks/calidad-pre-commit.js +159 -10
  149. package/hooks/captura-acciones-post.js +1 -1
  150. package/hooks/captura-acciones-session.js +1 -1
  151. package/hooks/captura-feedback-usuario.js +1 -1
  152. package/hooks/ciclo-evolucion-subagente.js +26 -26
  153. package/hooks/ciclo-evolucion.js +26 -26
  154. package/hooks/contexto-iteracion.js +1 -1
  155. package/hooks/degradacion-instintos.js +1 -1
  156. package/hooks/grafo-contexto.js +1 -1
  157. package/hooks/guardrail-modelo.js +1 -1
  158. package/hooks/inbox-aviso.js +1 -1
  159. package/hooks/inyeccion-contexto.js +1 -1
  160. package/hooks/lib/agent-matcher.js +1 -1
  161. package/hooks/lib/agent-routing.js +1 -1
  162. package/hooks/lib/auto-consolidator.js +335 -335
  163. package/hooks/lib/captura-acciones.js +1 -1
  164. package/hooks/lib/ciclo-evolucion.js +47 -47
  165. package/hooks/lib/deep-links.js +185 -185
  166. package/hooks/lib/error-classifier.js +308 -308
  167. package/hooks/lib/etapa-metricas.js +1 -1
  168. package/hooks/lib/evolution-tracker.js +1 -1
  169. package/hooks/lib/gateway-notify.js +193 -193
  170. package/hooks/lib/mcp-health.js +1 -1
  171. package/hooks/lib/notificacion-formato.js +92 -0
  172. package/hooks/lib/nudge-tracker.js +1 -1
  173. package/hooks/lib/otlp-exporter.js +1 -1
  174. package/hooks/lib/propose-step.js +1 -1
  175. package/hooks/lib/provenance-tracker.js +191 -191
  176. package/hooks/lib/raiz-proyecto.js +158 -102
  177. package/hooks/lib/resource-quota.js +122 -122
  178. package/hooks/lib/retry-jitter.js +165 -165
  179. package/hooks/lib/run-log.js +1 -1
  180. package/hooks/lib/security-net.js +201 -201
  181. package/hooks/lib/singleton-guard.js +20 -13
  182. package/hooks/lib/skill-auditor.js +588 -588
  183. package/hooks/lib/sync-status.js +228 -228
  184. package/hooks/lib/taint-tracker.js +107 -107
  185. package/hooks/lib/telegram-cliente.js +11 -3
  186. package/hooks/lib/text-similarity.js +241 -241
  187. package/hooks/lib/toon-compressor.js +245 -245
  188. package/hooks/notificacion-telegram.js +17 -13
  189. package/hooks/preservar-estado-pre-compact.js +1 -1
  190. package/hooks/registro-turnos.js +1 -1
  191. package/hooks/resumen-sesion.js +1 -1
  192. package/hooks/risk-scoring.js +1 -1
  193. package/hooks/session-briefing.js +13 -5
  194. package/hooks/spec-gate.js +1 -1
  195. package/hooks/sugerir-regenerar-inventario.js +1 -1
  196. package/hooks/tdd-gate.js +1 -1
  197. package/hooks/telemetria-agentes.js +1 -1
  198. package/hooks/telemetria-skill-routing.js +1 -1
  199. package/hooks/tracking-costos.js +1 -1
  200. package/hooks/validar-formato-post-subagente.js +1 -1
  201. package/hooks/validar-intent-spec.js +1 -1
  202. package/hooks/validar-planning-paths.js +1 -1
  203. package/instintos/autonomia.yaml +27 -27
  204. package/instintos/prompt-appendices.yaml +57 -57
  205. package/llms.txt +29 -29
  206. package/manifiestos/agent-output-schemas.json +57 -57
  207. package/manifiestos/canonical-hashes.json +6250 -5257
  208. package/manifiestos/harness-ir.json +47536 -0
  209. package/manifiestos/modulos.json +1429 -1428
  210. package/manifiestos/policy-bundle.json +2065 -0
  211. package/manifiestos/policy-corpus-w2.json +3926 -0
  212. package/manifiestos/runtime-adapters-core3.json +208 -0
  213. package/manifiestos/runtime-conformance.json +139 -0
  214. package/manifiestos/skills-lock.json +1275 -1275
  215. package/package.json +94 -94
  216. package/plantillas/auditor-veto-template.md +105 -105
  217. package/plantillas/github-workflows/release-please.yml +44 -44
  218. package/plantillas/github-workflows/swl-ci.yml +107 -107
  219. package/plantillas/github-workflows/swl-security.yml +51 -51
  220. package/plugin.json +369 -369
  221. package/reglas/accesibilidad.md +10 -10
  222. package/reglas/auditorias-documentales-estructurales.md +7 -7
  223. package/reglas/cloud-infra.md +8 -8
  224. package/reglas/consultar-vault-primero.md +195 -195
  225. package/reglas/git-workflow.md +1 -0
  226. package/reglas/hooks.md +6 -6
  227. package/reglas/intent-engineering.md +218 -218
  228. package/reglas/markitdown.md +8 -8
  229. package/reglas/monitor-ci.md +12 -0
  230. package/reglas/patrones.md +6 -6
  231. package/reglas/testing.md +7 -7
  232. package/reglas/tests-cleanup.md +224 -224
  233. package/schemas/agent-message.schema.json +73 -73
  234. package/schemas/agent-output-implementacion.schema.json +114 -114
  235. package/schemas/agent-output-planificacion.schema.json +150 -150
  236. package/schemas/agent-output-review.schema.json +98 -98
  237. package/schemas/diary-entry.schema.json +112 -112
  238. package/schemas/gate-state.schema.json +76 -0
  239. package/schemas/harness-ir.schema.json +369 -0
  240. package/schemas/hook-profiles.schema.json +54 -54
  241. package/schemas/hooks-config.schema.json +89 -89
  242. package/schemas/legacy-gates.schema.json +45 -0
  243. package/schemas/modulos.schema.json +38 -38
  244. package/schemas/perfiles.schema.json +36 -36
  245. package/schemas/plugin.schema.json +77 -77
  246. package/schemas/policy-bundle.schema.json +140 -0
  247. package/schemas/policy-enforcement.schema.json +117 -0
  248. package/schemas/policy-operation.schema.json +261 -0
  249. package/schemas/runtime-adapter.schema.json +176 -0
  250. package/schemas/runtime-build-attestation.schema.json +100 -0
  251. package/schemas/runtime-conformance.schema.json +239 -0
  252. package/schemas/runtime-diagnostic.schema.json +395 -0
  253. package/schemas/skill-evals.schema.json +119 -119
  254. package/schemas/skill-frontmatter.schema.json +245 -245
  255. package/schemas/w4-certification-request.schema.json +72 -0
  256. package/schemas/w4-certification-verdict.schema.json +224 -0
  257. package/schemas/w4-corpus.schema.json +172 -0
  258. package/schemas/w4-mutation-report.schema.json +116 -0
  259. package/schemas/w4-replay-result.schema.json +164 -0
  260. package/schemas/w4-scoring-report.schema.json +89 -0
  261. package/scripts/audit-tools/audit-history.js +330 -330
  262. package/scripts/audit-tools/bundle-tracker.js +290 -290
  263. package/scripts/audit-tools/canary-monitor.js +352 -352
  264. package/scripts/audit-tools/code-profiler.js +605 -605
  265. package/scripts/audit-tools/dep-doctor.js +320 -320
  266. package/scripts/audit-tools/env-validator.js +206 -206
  267. package/scripts/audit-tools/lib/fs-walk.js +48 -48
  268. package/scripts/audit-tools/lib/output.js +23 -23
  269. package/scripts/audit-tools/migration-checker.js +392 -392
  270. package/scripts/audit-tools/pentest-scanner.js +1436 -1436
  271. package/scripts/auditar-clases-conocidas.js +134 -134
  272. package/scripts/bootstrap-instintos.js +88 -14
  273. package/scripts/canario-hooks.js +166 -166
  274. package/scripts/cli/aprobar-plan.js +73 -73
  275. package/scripts/cli/autonomia.js +23 -23
  276. package/scripts/cli/benchmark-memoria.js +37 -37
  277. package/scripts/cli/briefing.js +23 -23
  278. package/scripts/cli/ciclo-autonomo.js +73 -73
  279. package/scripts/cli/ciclo-evolucion.js +26 -26
  280. package/scripts/cli/ciclo-fase-b.js +102 -102
  281. package/scripts/cli/derivar-feature-list.js +25 -25
  282. package/scripts/cli/detectar-host.js +27 -27
  283. package/scripts/cli/diary-entry.js +69 -69
  284. package/scripts/cli/execution-state.js +18 -18
  285. package/scripts/cli/gateway-notify.js +41 -41
  286. package/scripts/cli/guardrail-metrics.js +39 -39
  287. package/scripts/cli/liberar-fase.js +42 -42
  288. package/scripts/cli/mark-evolved.js +56 -56
  289. package/scripts/cli/memoria-search.js +69 -69
  290. package/scripts/cli/metricas-dora.js +26 -26
  291. package/scripts/cli/near-duplicate.js +55 -55
  292. package/scripts/cli/notificaciones.js +123 -123
  293. package/scripts/cli/nudge-accionar.js +39 -39
  294. package/scripts/cli/propose-step.js +29 -29
  295. package/scripts/cli/run-eval.js +38 -38
  296. package/scripts/cli/schedule-parse.js +19 -19
  297. package/scripts/cli/sugerir-modelo.js +20 -20
  298. package/scripts/cli/verificar-plan.js +36 -36
  299. package/scripts/cli/verificar-trazabilidad.js +35 -35
  300. package/scripts/comandos/install-asistido.js +8 -7
  301. package/scripts/configurar-branch-protection.js +418 -418
  302. package/scripts/detectar-aprendizajes-duplicados.js +151 -151
  303. package/scripts/doctor.js +61 -13
  304. package/scripts/evidencia-valor.js +101 -101
  305. package/scripts/field-report.js +16 -16
  306. package/scripts/generar-checklists-consolidados.js +273 -273
  307. package/scripts/generar-claims-runtime.js +1342 -0
  308. package/scripts/generar-harness-ir.js +257 -0
  309. package/scripts/generar-inventario.js +52 -54
  310. package/scripts/generar-policy-bundle.js +202 -0
  311. package/scripts/instalador.js +39 -7
  312. package/scripts/lib/activar-hooks-proyecto.js +116 -116
  313. package/scripts/lib/approval-receipts.js +190 -0
  314. package/scripts/lib/artefactos-python.js +43 -43
  315. package/scripts/lib/benchmark-metrics.js +160 -160
  316. package/scripts/lib/budget-enforcer.js +252 -252
  317. package/scripts/lib/certificacion-loop-state.js +421 -0
  318. package/scripts/lib/ci-reader.js +193 -193
  319. package/scripts/lib/ciclo-autonomo/candidatos.js +174 -174
  320. package/scripts/lib/ciclo-autonomo/config.js +165 -165
  321. package/scripts/lib/ciclo-autonomo/drenador-feedback.js +174 -174
  322. package/scripts/lib/ciclo-autonomo/fallback.js +77 -77
  323. package/scripts/lib/ciclo-autonomo/guard-convivencia.js +139 -139
  324. package/scripts/lib/ciclo-autonomo/higiene-nudges.js +112 -112
  325. package/scripts/lib/ciclo-autonomo/index.js +301 -301
  326. package/scripts/lib/ciclo-autonomo/lock.js +124 -124
  327. package/scripts/lib/ciclo-autonomo/presupuesto.js +122 -122
  328. package/scripts/lib/ciclo-autonomo/puente-degradacion.js +240 -240
  329. package/scripts/lib/ciclo-autonomo/runner-fase-b.js +248 -248
  330. package/scripts/lib/ciclo-autonomo/writer-instintos.js +190 -190
  331. package/scripts/lib/ciclo-autonomo/yaml-instintos.js +591 -535
  332. package/scripts/lib/clasificar-directorio.js +92 -0
  333. package/scripts/lib/contadores-inventario.js +217 -217
  334. package/scripts/lib/detectar-host-swl.js +175 -175
  335. package/scripts/lib/detectar-runtime.js +29 -20
  336. package/scripts/lib/detectar-stack-detallado.js +307 -307
  337. package/scripts/lib/detector-autoduplicacion-intra-archivo.js +234 -234
  338. package/scripts/lib/detector-reglas-duplicadas.js +220 -220
  339. package/scripts/lib/eval-metrics-store.js +218 -218
  340. package/scripts/lib/eval-quality.js +171 -171
  341. package/scripts/lib/eval-schemas.js +144 -144
  342. package/scripts/lib/eval-self-correct.js +106 -106
  343. package/scripts/lib/eval-validator.js +185 -185
  344. package/scripts/lib/evidence-verifier.js +192 -0
  345. package/scripts/lib/evidencia-release.js +322 -322
  346. package/scripts/lib/evidencia-valor.js +228 -228
  347. package/scripts/lib/expandir-targets.js +71 -71
  348. package/scripts/lib/frontmatter-canonico.js +509 -0
  349. package/scripts/lib/gate-engine.js +871 -0
  350. package/scripts/lib/gate-hooks-requires.js +249 -249
  351. package/scripts/lib/gate-licencias.js +212 -212
  352. package/scripts/lib/git-config-preflight.js +48 -0
  353. package/scripts/lib/git-metricas.js +257 -257
  354. package/scripts/lib/harness-ir.js +778 -0
  355. package/scripts/lib/harness-source-snapshot.js +309 -0
  356. package/scripts/lib/integrity-ledger.js +1147 -0
  357. package/scripts/lib/jaccard-similarity.js +98 -98
  358. package/scripts/lib/legacy-gate-migration.js +324 -0
  359. package/scripts/lib/limpiar-basura-global.js +204 -0
  360. package/scripts/lib/longmemeval-runner.js +125 -125
  361. package/scripts/lib/metricas-dora.js +204 -204
  362. package/scripts/lib/notificaciones-telegram.js +1 -0
  363. package/scripts/lib/npm-version.js +1 -0
  364. package/scripts/lib/paquetes-conocidos.js +50 -50
  365. package/scripts/lib/plan-lock.js +61 -13
  366. package/scripts/lib/policy-broker.js +338 -0
  367. package/scripts/lib/policy-bundle.js +342 -0
  368. package/scripts/lib/policy-context-provider.js +310 -0
  369. package/scripts/lib/policy-contract.js +479 -0
  370. package/scripts/lib/policy-verifier-utils.js +65 -0
  371. package/scripts/lib/pr-analyzer.js +399 -399
  372. package/scripts/lib/principal-verifier.js +178 -0
  373. package/scripts/lib/prompt-builder.js +264 -264
  374. package/scripts/lib/resolver-plan-fase.js +37 -37
  375. package/scripts/lib/rrf-fusion.js +175 -175
  376. package/scripts/lib/runtime-adapter-contract.js +267 -0
  377. package/scripts/lib/runtime-artifact-verifier.js +426 -0
  378. package/scripts/lib/runtime-build-attestation.js +127 -0
  379. package/scripts/lib/runtime-bundle-installer.js +586 -0
  380. package/scripts/lib/runtime-compiler.js +327 -0
  381. package/scripts/lib/runtime-conformance.js +202 -0
  382. package/scripts/lib/runtime-doctor-core3.js +567 -0
  383. package/scripts/lib/runtime-doctor-input.js +59 -0
  384. package/scripts/lib/runtime-operation-adapter.js +267 -0
  385. package/scripts/lib/schema-version.js +164 -164
  386. package/scripts/lib/semantic-search.js +252 -252
  387. package/scripts/lib/signed-envelope.js +545 -0
  388. package/scripts/lib/single-use-store.js +359 -0
  389. package/scripts/lib/skills-externas.js +31 -0
  390. package/scripts/lib/toml-merge.js +204 -204
  391. package/scripts/lib/transformadores/codex.js +15 -8
  392. package/scripts/lib/transformadores/gemini.js +79 -5
  393. package/scripts/lib/w4-attestation-adapter.js +158 -0
  394. package/scripts/lib/w4-canario.js +337 -0
  395. package/scripts/lib/w4-claims.js +182 -0
  396. package/scripts/lib/w4-corpus-generador.js +542 -0
  397. package/scripts/lib/w4-gate-c5.js +115 -0
  398. package/scripts/lib/w4-harness-bajo-prueba.js +155 -0
  399. package/scripts/lib/w4-matriz-combos.js +55 -0
  400. package/scripts/lib/w4-motor-mutacion.js +1348 -0
  401. package/scripts/lib/w4-motor-replay.js +735 -0
  402. package/scripts/lib/w4-pin-origen.js +54 -0
  403. package/scripts/lib/w4-publicar-request.js +132 -0
  404. package/scripts/lib/w4-revocacion.js +62 -0
  405. package/scripts/lib/w4-runtimes-core3.js +38 -0
  406. package/scripts/lib/w4-scorer-certificacion.js +692 -0
  407. package/scripts/lib/w4-superficie-candidato.js +49 -0
  408. package/scripts/lib/w4-veredicto.js +452 -0
  409. package/scripts/lib/w4-verificar-veredicto.js +302 -0
  410. package/scripts/limpiar-artefactos-python.js +131 -131
  411. package/scripts/mcp-server/auth.js +105 -105
  412. package/scripts/mcp-server/cache.js +106 -106
  413. package/scripts/migrar-csv-a-array.js +168 -168
  414. package/scripts/migrar-fase-dominio.js +200 -200
  415. package/scripts/migrar-gates-legacy.js +108 -0
  416. package/scripts/publicar-certification-request.js +115 -0
  417. package/scripts/runtime-doctor.js +107 -0
  418. package/scripts/tui/componentes/selector-multi.js +189 -189
  419. package/scripts/tui/componentes/selector-unico.js +158 -158
  420. package/scripts/tui/ejecutores.js +375 -375
  421. package/scripts/tui/lib/colores.js +129 -129
  422. package/scripts/tui/lib/render.js +264 -264
  423. package/scripts/tui/lib/teclas.js +113 -113
  424. package/scripts/tui/pantallas/install-wizard.js +408 -403
  425. package/scripts/tui/pantallas/menu-principal.js +52 -52
  426. package/scripts/tui/pantallas/progreso.js +274 -274
  427. package/scripts/tui/pantallas/resumen.js +132 -132
  428. package/scripts/validar-userland-vacio.js +110 -110
  429. package/scripts/verificar-aislamiento-swl-eval.js +87 -0
  430. package/scripts/verificar-empaquetado-downstream.js +375 -0
  431. package/scripts/verificar-loop-constructor.js +215 -0
  432. package/scripts/verificar-trazabilidad.js +13 -6
  433. package/scripts/verificar-veredicto-real.js +84 -0
  434. package/instintos/.backups/perfil-usuario.yaml.2026-07-10-165128.bak +0 -53
  435. package/instintos/.backups/proyecto.yaml.2026-07-10-165128.bak +0 -372
@@ -1,520 +1,520 @@
1
- ---
2
- name: swl:evaluar-skill
3
- description: Evalúa la calidad de un agente o skill SWL con 10 dimensiones, detecta anti-patrones y asigna badge de calidad (Platino/Oro/Plata/Bronce). Ejecutar antes de hacer merge de agentes o skills nuevas.
4
- argument-hint: <nombre-skill-o-agente> [--agente]
5
- allowed_tools: ["Read", "Bash", "Glob", "Grep"]
6
- ---
7
-
8
- # /swl:evaluar-skill — Evaluación de calidad de skills y agentes SWL
9
-
10
- Evalúa la calidad de una skill o agente SWL con un framework de 2 capas. La
11
- **Capa 1** usa verificaciones deterministas (análisis estático con herramientas
12
- del sistema). La **Capa 2** es evaluación semántica profunda realizada por el
13
- propio modelo al leer el contenido completo.
14
-
15
- Al finalizar, emite un reporte con score por dimensión, badge asignado y
16
- recomendaciones priorizadas de mejora.
17
-
18
- ## Uso
19
-
20
- ```
21
- /swl:evaluar-skill django-experto — Evalúa la skill habilidades/django-experto/SKILL.md
22
- /swl:evaluar-skill backend-python-swl --agente — Evalúa el agente agentes/backend-python-swl.md
23
- /swl:evaluar-skill — Lista skills disponibles y pide que se especifique
24
- ```
25
-
26
- ## Paso 0 — Resolver argumento
27
-
28
- Si no se pasa argumento, listar las opciones disponibles y detenerse:
29
-
30
- ```bash
31
- echo "=== SKILLS DISPONIBLES ===" && ls -d habilidades/*/ 2>/dev/null | xargs -I{} basename {} | sort
32
- echo "=== AGENTES DISPONIBLES ===" && ls agentes/*.md 2>/dev/null | xargs -I{} basename {} .md | sort
33
- ```
34
-
35
- Informar al usuario que especifique el nombre y si es agente agregar `--agente`.
36
-
37
- Si se pasa argumento sin `--agente`, buscar en `habilidades/<nombre>/SKILL.md`.
38
- Si el argumento incluye `--agente`, buscar en `agentes/<nombre>.md` (quitar el flag del nombre).
39
-
40
- Si el archivo no existe, informar y terminar:
41
-
42
- ```
43
- No se encontró: habilidades/<nombre>/SKILL.md
44
- Verifica el nombre con /swl:evaluar-skill (sin argumentos) para ver las opciones.
45
- ```
46
-
47
- ## Paso 1 — Capa 1: Análisis estático
48
-
49
- Ejecutar todas las verificaciones deterministas. Registrar cada error (E0XX) y
50
- advertencia (W0XX) encontrado. No usar juicio subjetivo en esta capa.
51
-
52
- ### 1.1 Verificaciones de frontmatter
53
-
54
- ```bash
55
- SKILL_FILE="habilidades/<nombre>/SKILL.md" # o agentes/<nombre>.md
56
-
57
- # Extraer frontmatter
58
- head -30 "$SKILL_FILE"
59
-
60
- # Verificar YAML válido del frontmatter (entre los ---) usando Python
61
- python3 -c "
62
- import sys, re
63
- content = open('$SKILL_FILE').read()
64
- match = re.match(r'^---\n(.*?)\n---', content, re.DOTALL)
65
- if not match:
66
- print('E001 YAML_INVALIDO: no se encontró bloque frontmatter')
67
- sys.exit(1)
68
- import yaml
69
- try:
70
- data = yaml.safe_load(match.group(1))
71
- print('YAML OK:', list(data.keys()) if data else 'vacío')
72
- except Exception as e:
73
- print('E001 YAML_INVALIDO:', e)
74
- " 2>/dev/null || echo "E001 YAML_INVALIDO"
75
- ```
76
-
77
- Verificar campo `name`:
78
- ```bash
79
- grep -m1 "^name:" "$SKILL_FILE" || echo "E002 NAME_AUSENTE"
80
- ```
81
-
82
- Verificar campo `description`:
83
- ```bash
84
- desc=$(grep -m1 "^description:" "$SKILL_FILE" | sed 's/^description:[[:space:]]*//')
85
- [ -z "$desc" ] && echo "E003 DESCRIPTION_AUSENTE" || echo "description OK: ${#desc} chars"
86
- ```
87
-
88
- Verificar formato kebab-case de `name`:
89
- ```bash
90
- name_val=$(grep -m1 "^name:" "$SKILL_FILE" | sed 's/^name:[[:space:]]*//')
91
- echo "$name_val" | grep -qE '^[a-z0-9][a-z0-9-]*$' || echo "E004 NAME_FORMATO: '$name_val' no es kebab-case"
92
- ```
93
-
94
- Verificar longitud de `name` (máx 64 caracteres):
95
- ```bash
96
- name_len=$(grep -m1 "^name:" "$SKILL_FILE" | sed 's/^name:[[:space:]]*//' | wc -c)
97
- [ "$name_len" -gt 64 ] && echo "E005 NAME_LONGITUD: $name_len chars" || echo "name length OK"
98
- ```
99
-
100
- Verificar que `name` no use términos reservados:
101
- ```bash
102
- name_val=$(grep -m1 "^name:" "$SKILL_FILE" | sed 's/^name:[[:space:]]*//')
103
- echo "$name_val" | grep -qiE '(anthropic|claude|swl|^tests?$|testing)' && echo "E006 NAME_RESERVADO: '$name_val'" || echo "name reservado OK"
104
- ```
105
-
106
- Verificar coincidencia entre `name` y nombre del directorio (solo para skills):
107
- ```bash
108
- dir_name="<nombre>"
109
- name_val=$(grep -m1 "^name:" "$SKILL_FILE" | sed 's/^name:[[:space:]]*//')
110
- [ "$name_val" != "$dir_name" ] && echo "E007 NAME_DIRECTORIO: name='$name_val' != dir='$dir_name'" || echo "name/dir OK"
111
- ```
112
-
113
- Verificar longitud de `description` (máx 1,024 caracteres):
114
- ```bash
115
- desc_len=$(grep -m1 "^description:" "$SKILL_FILE" | sed 's/^description:[[:space:]]*//' | wc -c)
116
- [ "$desc_len" -gt 1024 ] && echo "E008 DESCRIPTION_LONGITUD: $desc_len chars" || echo "description length OK"
117
- ```
118
-
119
- ### 1.2 Verificaciones de contenido
120
-
121
- Verificar presencia de trigger "Cargar cuando" o "Invocar cuando":
122
- ```bash
123
- grep -qi "Cargar cuando\|Invocar cuando" "$SKILL_FILE" || echo "E009 MISSING_TRIGGER"
124
- ```
125
-
126
- Verificar referencias a recursos internos:
127
- ```bash
128
- # Encontrar referencias a recursos/X.md dentro del SKILL.md
129
- grep -oE 'recursos/[^)"\s]+\.md' "$SKILL_FILE" | while read ref; do
130
- dir=$(dirname "$SKILL_FILE")
131
- [ ! -f "$dir/$ref" ] && echo "E010 REFERENCIA_ROTA: $ref"
132
- done
133
- echo "referencias OK"
134
- ```
135
-
136
- ### 1.3 Verificaciones de advertencias
137
-
138
- Verificar si la skill supera 300 líneas:
139
- ```bash
140
- lines=$(wc -l < "$SKILL_FILE")
141
- [ "$lines" -gt 300 ] && echo "W001 BLOATED_SKILL: $lines líneas (máx 300)" || echo "W001 OK: $lines líneas"
142
- ```
143
-
144
- Verificar uso excesivo de directivas absolutas:
145
- ```bash
146
- count=$(grep -cE '\bMUST\b|\bALWAYS\b|\bNEVER\b|\bNUNCA\b|\bSIEMPRE\b' "$SKILL_FILE" || echo 0)
147
- [ "$count" -gt 15 ] && echo "W002 OVER_CONSTRAINED: $count ocurrencias" || echo "W002 OK: $count ocurrencias"
148
- ```
149
-
150
- Verificar archivos huérfanos en recursos/:
151
- ```bash
152
- skill_dir=$(dirname "$SKILL_FILE")
153
- if [ -d "$skill_dir/recursos" ]; then
154
- for rec in "$skill_dir/recursos/"*.md; do
155
- base=$(basename "$rec")
156
- grep -q "$base" "$SKILL_FILE" || echo "W003 HUERFANO: recursos/$base no referenciado"
157
- done
158
- fi
159
- ```
160
-
161
- Verificar presencia de ejemplos de código si la skill cubre implementación:
162
- ```bash
163
- code_blocks=$(grep -c '```' "$SKILL_FILE" || echo 0)
164
- [ "$code_blocks" -eq 0 ] && echo "W004 SIN_EJEMPLO_CODIGO: cero bloques de código" || echo "W004 OK: $code_blocks delimitadores de bloque"
165
- ```
166
-
167
- Verificar sección de "cuándo NO usar":
168
- ```bash
169
- grep -qi "cuándo no\|cuando no\|no usar\|no cargar\|no invocar" "$SKILL_FILE" || echo "W005 SIN_CUANDO_NO_USAR"
170
- ```
171
-
172
- Verificar presencia de sección Gotchas o equivalente:
173
- ```bash
174
- # W008: skills sin sección Gotchas
175
- # Penalización inicial suave (-5) durante período de migración de Fase 3.
176
- # Tras la migración se promoverá a -12 para hacer la sección obligatoria.
177
- grep -qi "Gotcha\|Errores comunes\|trampas\|Errores no obvios\|Fallas conocidas" "$SKILL_FILE" || \
178
- echo "W008 SIN_GOTCHAS: skill sin seccion Gotchas (penalizacion -5 en robustness)"
179
- ```
180
-
181
- Verificar uso de campos legacy en inglés (sin alias en español):
182
- ```bash
183
- # W010: uso de campos legacy (inglés) sin alias en español (penalización -6 en robustness)
184
- # Promovido 2026-04-24 tras v5.11.2 (2 releases desde introducción) — período de gracia concluido.
185
- node -e "
186
- const fs = require('fs');
187
- const norm = require('./scripts/lib/skill-normalizer.js');
188
- const raw = fs.readFileSync(process.argv[1], 'utf8');
189
- const match = raw.match(/^---\n([\s\S]*?)\n---/);
190
- if (!match) process.exit(0);
191
- const fm = {};
192
- for (const linea of match[1].split(/\r?\n/)) {
193
- const m = linea.match(/^(\w[\w_-]*):\s*(.+)\$/);
194
- if (m) fm[m[1]] = m[2];
195
- }
196
- const legacy = norm.detectarUsoLegacy(fm);
197
- const divergente = norm.detectarDivergencias(fm);
198
- [...legacy, ...divergente].forEach(w => process.stderr.write(w.mensaje + '\n'));
199
- " "\$SKILL_FILE" 2>&1 | grep W010 || echo "W010 OK: sin campos legacy"
200
- ```
201
-
202
- Verificar justificación en directivas absolutas:
203
- ```bash
204
- # W009: directivas absolutas sin justificación
205
- # Si hay más de 3 directivas MUST/ALWAYS/NEVER/NUNCA/SIEMPRE y ninguna está
206
- # acompañada de palabras justificativas en la misma línea o la siguiente,
207
- # el modelo obedece pero no puede generalizar a casos edge.
208
- directive_count=$(grep -cE '\bMUST\b|\bALWAYS\b|\bNEVER\b|\bNUNCA\b|\bSIEMPRE\b' "$SKILL_FILE" || echo 0)
209
- if [ "$directive_count" -gt 3 ]; then
210
- justified=$(grep -E '\bMUST\b|\bALWAYS\b|\bNEVER\b|\bNUNCA\b|\bSIEMPRE\b' "$SKILL_FILE" | \
211
- grep -ciE 'porque|ya que|para evitar|si no|since|because|para que' || echo 0)
212
- [ "$justified" -eq 0 ] && echo "W009 DIRECTIVAS_SIN_JUSTIFICACION: $directive_count directivas absolutas sin palabras justificativas (penalizacion -8 en output_quality)" || echo "W009 OK: $justified/$directive_count directivas con justificacion"
213
- fi
214
- ```
215
-
216
- ### 1.4 Resumen de Capa 1
217
-
218
- Tabular todos los errores y advertencias encontrados. Aplicar penalizaciones:
219
-
220
- | Código | Tipo | Penalización |
221
- |--------|------|-------------|
222
- | E001–E010 | ERROR | Dimensión relacionada → 0 |
223
- | W001 | ADVERTENCIA | -8 en `progressive_disclosure` |
224
- | W002 | ADVERTENCIA | -5 en `scope_calibration` |
225
- | W003 | ADVERTENCIA | -3 en `structural_completeness` |
226
- | W004 | ADVERTENCIA | -10 en `code_template_quality` |
227
- | W005 | ADVERTENCIA | -5 en `scope_calibration` |
228
- | W008 | ADVERTENCIA | -5 en `robustness` (período de migración; se promoverá a -12 tras Fase 3) |
229
- | W009 | ADVERTENCIA | -8 en `output_quality` |
230
- | W010 | ADVERTENCIA | -6 en `robustness` (promovido 2026-04-24 tras v5.11.2; período de migración concluido — campos en español SWL son ahora esperados) |
231
-
232
- Mapeo de errores a dimensiones afectadas:
233
- - E001, E002, E003, E008 → `structural_completeness`
234
- - E004, E005, E006, E007 → `ecosystem_coherence`
235
- - E009 → `triggering_accuracy`
236
- - E010 → `structural_completeness`
237
-
238
- ### 1.5 Métricas cuantitativas de calidad
239
-
240
- Calcular métricas de eficiencia de tokens y duplicación:
241
-
242
- ```bash
243
- SKILL_FILE="habilidades/<nombre>/SKILL.md"
244
-
245
- # Estimar tokens del skill
246
- node -e "
247
- const { estimateTokens } = require('./hooks/lib/token-budget');
248
- const fs = require('fs');
249
- const content = fs.readFileSync('$SKILL_FILE', 'utf8');
250
- const tokens = estimateTokens(content, 'mixed');
251
- const lines = content.split('\n').length;
252
- const ratio = (tokens / lines).toFixed(1);
253
- console.log('TOKENS: ' + tokens);
254
- console.log('LINEAS: ' + lines);
255
- console.log('DENSIDAD: ' + ratio + ' tokens/línea');
256
- console.log(tokens > 5000 ? 'W006 TOKEN_EXCESIVO: ' + tokens + ' tokens (máx 5000)' : 'tokens OK');
257
- "
258
- ```
259
-
260
- Detección de duplicación con otros skills del sistema:
261
-
262
- ```bash
263
- # Comparar contenido con skills del mismo dominio
264
- node -e "
265
- const { jaccardSimilarity } = require('./hooks/lib/fingerprint-id');
266
- const fs = require('fs');
267
- const path = require('path');
268
- const target = fs.readFileSync('$SKILL_FILE', 'utf8');
269
- const skillsDir = 'habilidades';
270
- const dirs = fs.readdirSync(skillsDir, {withFileTypes:true}).filter(d=>d.isDirectory());
271
- const results = [];
272
- for (const d of dirs) {
273
- const p = path.join(skillsDir, d.name, 'SKILL.md');
274
- if (p === '$SKILL_FILE' || !fs.existsSync(p)) continue;
275
- const content = fs.readFileSync(p, 'utf8');
276
- const sim = jaccardSimilarity(target, content);
277
- if (sim > 0.3) results.push({name: d.name, similarity: (sim*100).toFixed(1)});
278
- }
279
- results.sort((a,b) => b.similarity - a.similarity);
280
- if (results.length > 0) {
281
- console.log('SIMILITUD con otros skills:');
282
- results.slice(0,5).forEach(r => {
283
- const flag = r.similarity > 50 ? ' W007 DUPLICADO_POTENCIAL' : '';
284
- console.log(' ' + r.name + ': ' + r.similarity + '%' + flag);
285
- });
286
- } else {
287
- console.log('Sin duplicación detectada con otros skills.');
288
- }
289
- "
290
- ```
291
-
292
- Mapeo de advertencias nuevas:
293
-
294
- | Código | Tipo | Penalización |
295
- |--------|------|-------------|
296
- | W006 | ADVERTENCIA | -8 en `token_efficiency` |
297
- | W007 | ADVERTENCIA | -10 en `orchestration_fitness` (posible duplicación) |
298
-
299
- ## Paso 2 — Capa 2: Evaluación semántica
300
-
301
- Leer el archivo completo con `Read`. Evaluar cada dimensión de 0 a 100 con
302
- criterio honesto: si la skill tiene problemas reales, el score debe reflejarlos.
303
-
304
- ### Tabla de dimensiones
305
-
306
- | Dimensión | Peso | Qué medir |
307
- |-----------|------|-----------|
308
- | `triggering_accuracy` | 25% | ¿La `description` activa la skill en los momentos correctos? ¿El trigger es ni muy amplio ni muy estrecho? ¿Evita activaciones falsas? |
309
- | `orchestration_fitness` | 20% | ¿Coordina bien con otras skills del sistema? ¿Invoca correctamente otras skills con `Skill("nombre")`? ¿Evita duplicar contenido de otras skills? |
310
- | `output_quality` | 15% | ¿Los ejemplos de código son reales y funcionales? ¿Las reglas son específicas, no genéricas? ¿El contenido refleja patrones idiomáticos del framework? ¿Las directivas MUST/ALWAYS/NEVER/NUNCA/SIEMPRE incluyen justificación de por qué la regla existe? Una directiva sin justificación no permite al modelo generalizar a casos edge (ver W009). |
311
- | `scope_calibration` | 12% | ¿El scope es coherente? ¿No cubre demasiado? ¿Hay sección de "cuándo NO usar"? ¿El contenido es específico del dominio declarado? |
312
- | `progressive_disclosure` | 10% | ¿El SKILL.md principal es conciso (< 300 líneas)? ¿El contenido extenso está en `recursos/`? ¿Las referencias a recursos son claras y útiles? |
313
- | `token_efficiency` | 6% | ¿Hay contenido redundante o repetitivo? ¿Los ejemplos son concisos pero completos? ¿Se evita documentación genérica que no agrega valor? |
314
- | `robustness` | 5% | ¿Documenta casos edge y anti-patrones? ¿Cubre los errores más comunes del dominio? |
315
- | `structural_completeness` | 3% | ¿Tiene todas las secciones mínimas requeridas? ¿El frontmatter tiene todos los campos obligatorios? |
316
- | `code_template_quality` | 2% | ¿Los ejemplos de código compilan/ejecutan? ¿Usan sintaxis actual del lenguaje o framework? |
317
- | `ecosystem_coherence` | 2% | ¿El naming sigue las convenciones del sistema SWL (kebab-case)? ¿Los patrones son consistentes con las otras skills? |
318
-
319
- **Guía de calibración de scores:**
320
- - 90-100: Excelente — referente del sistema
321
- - 80-89: Sólido — listo para uso en producción
322
- - 70-79: Funcional — mejoras menores posibles
323
- - 60-69: Aceptable — requiere revisión antes de merge
324
- - 40-59: Deficiente — problemas claros que afectan efectividad
325
- - 0-39: Insuficiente — necesita reescritura
326
-
327
- ## Paso 3 — Cálculo del score final
328
-
329
- Calcular score ponderado:
330
-
331
- ```
332
- score_final = Σ(score_dimensión × peso_dimensión)
333
-
334
- Ejemplo:
335
- triggering_accuracy = 85 × 0.25 = 21.25
336
- orchestration_fitness = 78 × 0.20 = 15.60
337
- output_quality = 90 × 0.15 = 13.50
338
- scope_calibration = 72 × 0.12 = 8.64
339
- progressive_disclosure = 80 × 0.10 = 8.00
340
- token_efficiency = 70 × 0.06 = 4.20
341
- robustness = 65 × 0.05 = 3.25
342
- structural_completeness= 95 × 0.03 = 2.85
343
- code_template_quality = 85 × 0.02 = 1.70
344
- ecosystem_coherence = 90 × 0.02 = 1.80
345
- ─────────────────────────────────────────────
346
- score_final = 80.79
347
- ```
348
-
349
- Asignar badge:
350
-
351
- ```
352
- ≥ 90 → Platino — production-ready, puede usarse como referencia
353
- ≥ 80 → Oro — listo para merge
354
- ≥ 70 → Plata — necesita mejoras menores antes del merge
355
- ≥ 60 → Bronce — requiere revisión antes de merge
356
- < 60 → Sin badge — no hacer merge hasta corregir
357
- ```
358
-
359
- ### Gate de promoción para auto-evolucion-swl (G8)
360
-
361
- Este comando es el **gate obligatorio** del flujo de promoción de skills
362
- auto-generados desde `_userland/plugins/` a `habilidades/`. El agente
363
- `auto-evolucion-swl` invoca este comando antes de mover un skill al core
364
- (ver `agentes/auto-evolucion-swl.md` sección "Gate G8").
365
-
366
- Umbral de promoción:
367
-
368
- | Badge | Acción de auto-evolucion |
369
- |-------|-------------------------|
370
- | Platino, Oro, Plata | Promover a `habilidades/`, registrar en manifiestos |
371
- | Bronce | NO promover, devolver a `_userland/` con feedback |
372
- | Sin badge | NO promover, registrar rechazo en `.planning/evolution/promociones-rechazadas.jsonl` |
373
-
374
- Si un skill es rechazado ≥3 veces consecutivas, el agente escala al usuario
375
- con análisis de qué dimensiones bajan el score. Origen: ADR 0013 sección 3C.
376
-
377
- ## Paso 4 — Emitir reporte y artefacto de procedencia
378
-
379
- Tras calcular el score final y el badge, persiste el **artefacto de
380
- evaluación con procedencia** (única fuente que `run-skill-evals.js
381
- --record-after` acepta para aprobar una evolución — anti-gaming,
382
- DT-AGP-SCORE-AUTODECLARADO):
383
-
384
- ```bash
385
- swl-ses run-skill-evals <nombre> --emitir-evaluacion \
386
- --score=<score-final> --badge=<badge> --producido-por=evaluar-skill
387
- # → escribe .planning/evolution/evaluaciones/<nombre>.json (fechado)
388
- # y registra el evento tipo:evaluacion en evoluciones.jsonl
389
- ```
390
-
391
- Es el ÚNICO archivo que este comando crea. Luego generar el siguiente
392
- reporte directamente en la conversación:
393
-
394
- ```markdown
395
- ## Evaluación de skill: [nombre]
396
- **Archivo**: habilidades/[nombre]/SKILL.md (o agentes/[nombre].md)
397
- **Fecha**: [fecha actual]
398
-
399
- ### Capa 1 — Análisis estático
400
-
401
- [PASS si no hay errores ni advertencias]
402
- [O listar cada E0XX / W0XX con descripción breve]
403
-
404
- ### Capa 2 — Evaluación semántica
405
-
406
- | Dimensión | Peso | Score | Contribución |
407
- |-----------|------|-------|-------------|
408
- | Triggering accuracy | 25% | XX/100 | XX.XX |
409
- | Orchestration fitness | 20% | XX/100 | XX.XX |
410
- | Output quality | 15% | XX/100 | XX.XX |
411
- | Scope calibration | 12% | XX/100 | XX.XX |
412
- | Progressive disclosure | 10% | XX/100 | XX.XX |
413
- | Token efficiency | 6% | XX/100 | XX.XX |
414
- | Robustness | 5% | XX/100 | XX.XX |
415
- | Structural completeness | 3% | XX/100 | XX.XX |
416
- | Code template quality | 2% | XX/100 | XX.XX |
417
- | Ecosystem coherence | 2% | XX/100 | XX.XX |
418
-
419
- **Score final: XX.XX/100 — Badge: [🏆/🥇/🥈/🥉/❌] [Platino/Oro/Plata/Bronce/Sin badge]**
420
-
421
- ### Hallazgos principales
422
-
423
- **Fortalezas:**
424
- - [2-3 aspectos bien ejecutados con evidencia específica del contenido]
425
-
426
- **Áreas de mejora:**
427
- - [hallazgos específicos con sugerencia concreta y línea o sección afectada]
428
-
429
- ### Recomendaciones para subir el score
430
-
431
- [Lista priorizada de cambios concretos que mejorarían el score,
432
- ordenados de mayor a menor impacto. Incluir la dimensión afectada.]
433
- ```
434
-
435
- ## Paso 3 — Capa 3 opcional: Evals estructurados
436
-
437
- Si el artefacto tiene un archivo de evals en formato `skill-evals.schema.json`:
438
-
439
- ```bash
440
- EVALS_PATH="habilidades/<nombre>/evals/evals.json"
441
- [ -f "$EVALS_PATH" ] && echo "EVALS_DISPONIBLES" || EVALS_PATH="agentes/evals/<nombre>.evals.json"
442
- [ -f "$EVALS_PATH" ] && echo "EVALS_DISPONIBLES" || echo "SIN_EVALS"
443
- ```
444
-
445
- Si existen, ejecutar la Capa 3:
446
-
447
- ### 3.1 — Validar el artefacto contra el schema
448
-
449
- ```bash
450
- # Validación mínima de estructura (zero-deps): comprobar que es JSON válido y
451
- # que tiene los campos obligatorios. Validación completa del schema queda para
452
- # consumidores externos (ajv, etc.) — SWL no arrastra deps.
453
- node -e "
454
- const ev = require('./$EVALS_PATH');
455
- const req = ['skill_name','schema_version','evals'];
456
- const missing = req.filter(k => !(k in ev));
457
- if (missing.length) { console.error('FALTAN:', missing.join(',')); process.exit(1); }
458
- if (!Array.isArray(ev.evals) || ev.evals.length === 0) { console.error('evals vacío'); process.exit(1); }
459
- console.log('OK', ev.evals.length, 'evals');
460
- "
461
- ```
462
-
463
- Si falla la validación, reportar y continuar solo con Capa 1+2 (no bloquear).
464
-
465
- ### 3.2 — Ejecutar cada eval contra el skill cargado
466
-
467
- Para cada `eval` del artefacto:
468
-
469
- 1. Cargar el skill con `Skill("<nombre>")`.
470
- 2. Enviar el `prompt` exacto al modelo en una respuesta aislada (sin historial).
471
- 3. Capturar la respuesta.
472
- 4. Para cada entrada de `expectations[]`, verificar si la respuesta la cumple
473
- (match semántico honesto, no literal).
474
- 5. Computar `pass = true` solo si TODAS las expectations se cumplen.
475
- 6. Aplicar `weight` (default 1.0) al score.
476
-
477
- ### 3.3 — Score de Capa 3
478
-
479
- ```
480
- score_evals = sum(pass_i * weight_i) / sum(weight_i) * 100
481
- ```
482
-
483
- ### 3.4 — Integración con score final
484
-
485
- El score final combinado es:
486
-
487
- - Sin evals: `score_final = score_capa_1_2`
488
- - Con evals: `score_final = score_capa_1_2 * 0.7 + score_evals * 0.3`
489
-
490
- Reportar ambos separadamente para trazabilidad. Si `score_evals < 60`, marcar
491
- alerta: la skill puede ser declarativa pero falla en evaluación ejecutable.
492
-
493
- ### 3.5 — Reporte por eval
494
-
495
- ```
496
- | ID | Tags | Peso | Resultado | Expectations fallidas |
497
- |----|------|------|-----------|----------------------|
498
- | 0 | primary-flow | 1.0 | ✓ pass | — |
499
- | 1 | edge-case | 1.0 | ✗ fail | "La respuesta distingue X de Y" |
500
- | anti-pattern-substitution | anti-pattern,regression | 1.5 | ✓ pass | — |
501
-
502
- Score evals: 82.4/100 (peso 30% del final)
503
- ```
504
-
505
- ## Reglas de comportamiento
506
-
507
- - La Capa 1 es **determinista**: ejecutar los scripts Bash y registrar resultados exactos. No inferir ni interpretar.
508
- - La Capa 2 es **semántica honesta**: si la skill tiene problemas reales el score debe reflejarlos. No inflar scores por cortesía.
509
- - La Capa 3 es **opcional**: si no existe `evals/evals.json`, omitirla sin penalizar. Si existe, es autoridad primaria sobre Capa 2 en caso de discrepancia (los evals son reproducibles; la evaluación semántica no).
510
- - Un skill con Capa 3 activa y `score_evals ≥ 90` es candidato a badge **Platino** aunque Capa 2 sea 85.
511
- - Los evals NUNCA se inventan en este comando — solo se ejecutan los declarados por el autor del skill. Crear evals nuevos es tarea de `/swl:aprender` o del autor del skill directamente, siguiendo `plantillas/skill-evals-template.json`.
512
- - Si el archivo no existe, informar al usuario con el path exacto y terminar.
513
- - Si `--agente` se pasa sin nombre, listar los agentes disponibles y terminar.
514
- - El reporte siempre se emite en la conversación. El único archivo que se
515
- crea es el artefacto de procedencia del Paso 4 (`.planning/evolution/
516
- evaluaciones/<nombre>.json`) — nunca reportes sueltos.
517
- - Las "Fortalezas" deben ser específicas del contenido leído, no genéricas.
518
- - Las "Áreas de mejora" deben incluir la sección o línea aproximada donde se detectó el problema.
519
- - Si la Capa 1 genera errores E001–E010, reflejar el impacto en el score de la dimensión afectada antes de sumar las contribuciones ponderadas.
520
- - Score mínimo aprobado para merge: **80/100** (badge Oro). Por debajo de ese umbral, indicar claramente que **no está listo para merge**.
1
+ ---
2
+ name: swl:evaluar-skill
3
+ description: Evalúa la calidad de un agente o skill SWL con 10 dimensiones, detecta anti-patrones y asigna badge de calidad (Platino/Oro/Plata/Bronce). Ejecutar antes de hacer merge de agentes o skills nuevas.
4
+ argument-hint: <nombre-skill-o-agente> [--agente]
5
+ allowed_tools: ["Read", "Bash", "Glob", "Grep"]
6
+ ---
7
+
8
+ # /swl:evaluar-skill — Evaluación de calidad de skills y agentes SWL
9
+
10
+ Evalúa la calidad de una skill o agente SWL con un framework de 2 capas. La
11
+ **Capa 1** usa verificaciones deterministas (análisis estático con herramientas
12
+ del sistema). La **Capa 2** es evaluación semántica profunda realizada por el
13
+ propio modelo al leer el contenido completo.
14
+
15
+ Al finalizar, emite un reporte con score por dimensión, badge asignado y
16
+ recomendaciones priorizadas de mejora.
17
+
18
+ ## Uso
19
+
20
+ ```
21
+ /swl:evaluar-skill django-experto — Evalúa la skill habilidades/django-experto/SKILL.md
22
+ /swl:evaluar-skill backend-python-swl --agente — Evalúa el agente agentes/backend-python-swl.md
23
+ /swl:evaluar-skill — Lista skills disponibles y pide que se especifique
24
+ ```
25
+
26
+ ## Paso 0 — Resolver argumento
27
+
28
+ Si no se pasa argumento, listar las opciones disponibles y detenerse:
29
+
30
+ ```bash
31
+ echo "=== SKILLS DISPONIBLES ===" && ls -d habilidades/*/ 2>/dev/null | xargs -I{} basename {} | sort
32
+ echo "=== AGENTES DISPONIBLES ===" && ls agentes/*.md 2>/dev/null | xargs -I{} basename {} .md | sort
33
+ ```
34
+
35
+ Informar al usuario que especifique el nombre y si es agente agregar `--agente`.
36
+
37
+ Si se pasa argumento sin `--agente`, buscar en `habilidades/<nombre>/SKILL.md`.
38
+ Si el argumento incluye `--agente`, buscar en `agentes/<nombre>.md` (quitar el flag del nombre).
39
+
40
+ Si el archivo no existe, informar y terminar:
41
+
42
+ ```
43
+ No se encontró: habilidades/<nombre>/SKILL.md
44
+ Verifica el nombre con /swl:evaluar-skill (sin argumentos) para ver las opciones.
45
+ ```
46
+
47
+ ## Paso 1 — Capa 1: Análisis estático
48
+
49
+ Ejecutar todas las verificaciones deterministas. Registrar cada error (E0XX) y
50
+ advertencia (W0XX) encontrado. No usar juicio subjetivo en esta capa.
51
+
52
+ ### 1.1 Verificaciones de frontmatter
53
+
54
+ ```bash
55
+ SKILL_FILE="habilidades/<nombre>/SKILL.md" # o agentes/<nombre>.md
56
+
57
+ # Extraer frontmatter
58
+ head -30 "$SKILL_FILE"
59
+
60
+ # Verificar YAML válido del frontmatter (entre los ---) usando Python
61
+ python3 -c "
62
+ import sys, re
63
+ content = open('$SKILL_FILE').read()
64
+ match = re.match(r'^---\n(.*?)\n---', content, re.DOTALL)
65
+ if not match:
66
+ print('E001 YAML_INVALIDO: no se encontró bloque frontmatter')
67
+ sys.exit(1)
68
+ import yaml
69
+ try:
70
+ data = yaml.safe_load(match.group(1))
71
+ print('YAML OK:', list(data.keys()) if data else 'vacío')
72
+ except Exception as e:
73
+ print('E001 YAML_INVALIDO:', e)
74
+ " 2>/dev/null || echo "E001 YAML_INVALIDO"
75
+ ```
76
+
77
+ Verificar campo `name`:
78
+ ```bash
79
+ grep -m1 "^name:" "$SKILL_FILE" || echo "E002 NAME_AUSENTE"
80
+ ```
81
+
82
+ Verificar campo `description`:
83
+ ```bash
84
+ desc=$(grep -m1 "^description:" "$SKILL_FILE" | sed 's/^description:[[:space:]]*//')
85
+ [ -z "$desc" ] && echo "E003 DESCRIPTION_AUSENTE" || echo "description OK: ${#desc} chars"
86
+ ```
87
+
88
+ Verificar formato kebab-case de `name`:
89
+ ```bash
90
+ name_val=$(grep -m1 "^name:" "$SKILL_FILE" | sed 's/^name:[[:space:]]*//')
91
+ echo "$name_val" | grep -qE '^[a-z0-9][a-z0-9-]*$' || echo "E004 NAME_FORMATO: '$name_val' no es kebab-case"
92
+ ```
93
+
94
+ Verificar longitud de `name` (máx 64 caracteres):
95
+ ```bash
96
+ name_len=$(grep -m1 "^name:" "$SKILL_FILE" | sed 's/^name:[[:space:]]*//' | wc -c)
97
+ [ "$name_len" -gt 64 ] && echo "E005 NAME_LONGITUD: $name_len chars" || echo "name length OK"
98
+ ```
99
+
100
+ Verificar que `name` no use términos reservados:
101
+ ```bash
102
+ name_val=$(grep -m1 "^name:" "$SKILL_FILE" | sed 's/^name:[[:space:]]*//')
103
+ echo "$name_val" | grep -qiE '(anthropic|claude|swl|^tests?$|testing)' && echo "E006 NAME_RESERVADO: '$name_val'" || echo "name reservado OK"
104
+ ```
105
+
106
+ Verificar coincidencia entre `name` y nombre del directorio (solo para skills):
107
+ ```bash
108
+ dir_name="<nombre>"
109
+ name_val=$(grep -m1 "^name:" "$SKILL_FILE" | sed 's/^name:[[:space:]]*//')
110
+ [ "$name_val" != "$dir_name" ] && echo "E007 NAME_DIRECTORIO: name='$name_val' != dir='$dir_name'" || echo "name/dir OK"
111
+ ```
112
+
113
+ Verificar longitud de `description` (máx 1,024 caracteres):
114
+ ```bash
115
+ desc_len=$(grep -m1 "^description:" "$SKILL_FILE" | sed 's/^description:[[:space:]]*//' | wc -c)
116
+ [ "$desc_len" -gt 1024 ] && echo "E008 DESCRIPTION_LONGITUD: $desc_len chars" || echo "description length OK"
117
+ ```
118
+
119
+ ### 1.2 Verificaciones de contenido
120
+
121
+ Verificar presencia de trigger "Cargar cuando" o "Invocar cuando":
122
+ ```bash
123
+ grep -qi "Cargar cuando\|Invocar cuando" "$SKILL_FILE" || echo "E009 MISSING_TRIGGER"
124
+ ```
125
+
126
+ Verificar referencias a recursos internos:
127
+ ```bash
128
+ # Encontrar referencias a recursos/X.md dentro del SKILL.md
129
+ grep -oE 'recursos/[^)"\s]+\.md' "$SKILL_FILE" | while read ref; do
130
+ dir=$(dirname "$SKILL_FILE")
131
+ [ ! -f "$dir/$ref" ] && echo "E010 REFERENCIA_ROTA: $ref"
132
+ done
133
+ echo "referencias OK"
134
+ ```
135
+
136
+ ### 1.3 Verificaciones de advertencias
137
+
138
+ Verificar si la skill supera 300 líneas:
139
+ ```bash
140
+ lines=$(wc -l < "$SKILL_FILE")
141
+ [ "$lines" -gt 300 ] && echo "W001 BLOATED_SKILL: $lines líneas (máx 300)" || echo "W001 OK: $lines líneas"
142
+ ```
143
+
144
+ Verificar uso excesivo de directivas absolutas:
145
+ ```bash
146
+ count=$(grep -cE '\bMUST\b|\bALWAYS\b|\bNEVER\b|\bNUNCA\b|\bSIEMPRE\b' "$SKILL_FILE" || echo 0)
147
+ [ "$count" -gt 15 ] && echo "W002 OVER_CONSTRAINED: $count ocurrencias" || echo "W002 OK: $count ocurrencias"
148
+ ```
149
+
150
+ Verificar archivos huérfanos en recursos/:
151
+ ```bash
152
+ skill_dir=$(dirname "$SKILL_FILE")
153
+ if [ -d "$skill_dir/recursos" ]; then
154
+ for rec in "$skill_dir/recursos/"*.md; do
155
+ base=$(basename "$rec")
156
+ grep -q "$base" "$SKILL_FILE" || echo "W003 HUERFANO: recursos/$base no referenciado"
157
+ done
158
+ fi
159
+ ```
160
+
161
+ Verificar presencia de ejemplos de código si la skill cubre implementación:
162
+ ```bash
163
+ code_blocks=$(grep -c '```' "$SKILL_FILE" || echo 0)
164
+ [ "$code_blocks" -eq 0 ] && echo "W004 SIN_EJEMPLO_CODIGO: cero bloques de código" || echo "W004 OK: $code_blocks delimitadores de bloque"
165
+ ```
166
+
167
+ Verificar sección de "cuándo NO usar":
168
+ ```bash
169
+ grep -qi "cuándo no\|cuando no\|no usar\|no cargar\|no invocar" "$SKILL_FILE" || echo "W005 SIN_CUANDO_NO_USAR"
170
+ ```
171
+
172
+ Verificar presencia de sección Gotchas o equivalente:
173
+ ```bash
174
+ # W008: skills sin sección Gotchas
175
+ # Penalización inicial suave (-5) durante período de migración de Fase 3.
176
+ # Tras la migración se promoverá a -12 para hacer la sección obligatoria.
177
+ grep -qi "Gotcha\|Errores comunes\|trampas\|Errores no obvios\|Fallas conocidas" "$SKILL_FILE" || \
178
+ echo "W008 SIN_GOTCHAS: skill sin seccion Gotchas (penalizacion -5 en robustness)"
179
+ ```
180
+
181
+ Verificar uso de campos legacy en inglés (sin alias en español):
182
+ ```bash
183
+ # W010: uso de campos legacy (inglés) sin alias en español (penalización -6 en robustness)
184
+ # Promovido 2026-04-24 tras v5.11.2 (2 releases desde introducción) — período de gracia concluido.
185
+ node -e "
186
+ const fs = require('fs');
187
+ const norm = require('./scripts/lib/skill-normalizer.js');
188
+ const raw = fs.readFileSync(process.argv[1], 'utf8');
189
+ const match = raw.match(/^---\n([\s\S]*?)\n---/);
190
+ if (!match) process.exit(0);
191
+ const fm = {};
192
+ for (const linea of match[1].split(/\r?\n/)) {
193
+ const m = linea.match(/^(\w[\w_-]*):\s*(.+)\$/);
194
+ if (m) fm[m[1]] = m[2];
195
+ }
196
+ const legacy = norm.detectarUsoLegacy(fm);
197
+ const divergente = norm.detectarDivergencias(fm);
198
+ [...legacy, ...divergente].forEach(w => process.stderr.write(w.mensaje + '\n'));
199
+ " "\$SKILL_FILE" 2>&1 | grep W010 || echo "W010 OK: sin campos legacy"
200
+ ```
201
+
202
+ Verificar justificación en directivas absolutas:
203
+ ```bash
204
+ # W009: directivas absolutas sin justificación
205
+ # Si hay más de 3 directivas MUST/ALWAYS/NEVER/NUNCA/SIEMPRE y ninguna está
206
+ # acompañada de palabras justificativas en la misma línea o la siguiente,
207
+ # el modelo obedece pero no puede generalizar a casos edge.
208
+ directive_count=$(grep -cE '\bMUST\b|\bALWAYS\b|\bNEVER\b|\bNUNCA\b|\bSIEMPRE\b' "$SKILL_FILE" || echo 0)
209
+ if [ "$directive_count" -gt 3 ]; then
210
+ justified=$(grep -E '\bMUST\b|\bALWAYS\b|\bNEVER\b|\bNUNCA\b|\bSIEMPRE\b' "$SKILL_FILE" | \
211
+ grep -ciE 'porque|ya que|para evitar|si no|since|because|para que' || echo 0)
212
+ [ "$justified" -eq 0 ] && echo "W009 DIRECTIVAS_SIN_JUSTIFICACION: $directive_count directivas absolutas sin palabras justificativas (penalizacion -8 en output_quality)" || echo "W009 OK: $justified/$directive_count directivas con justificacion"
213
+ fi
214
+ ```
215
+
216
+ ### 1.4 Resumen de Capa 1
217
+
218
+ Tabular todos los errores y advertencias encontrados. Aplicar penalizaciones:
219
+
220
+ | Código | Tipo | Penalización |
221
+ |--------|------|-------------|
222
+ | E001–E010 | ERROR | Dimensión relacionada → 0 |
223
+ | W001 | ADVERTENCIA | -8 en `progressive_disclosure` |
224
+ | W002 | ADVERTENCIA | -5 en `scope_calibration` |
225
+ | W003 | ADVERTENCIA | -3 en `structural_completeness` |
226
+ | W004 | ADVERTENCIA | -10 en `code_template_quality` |
227
+ | W005 | ADVERTENCIA | -5 en `scope_calibration` |
228
+ | W008 | ADVERTENCIA | -5 en `robustness` (período de migración; se promoverá a -12 tras Fase 3) |
229
+ | W009 | ADVERTENCIA | -8 en `output_quality` |
230
+ | W010 | ADVERTENCIA | -6 en `robustness` (promovido 2026-04-24 tras v5.11.2; período de migración concluido — campos en español SWL son ahora esperados) |
231
+
232
+ Mapeo de errores a dimensiones afectadas:
233
+ - E001, E002, E003, E008 → `structural_completeness`
234
+ - E004, E005, E006, E007 → `ecosystem_coherence`
235
+ - E009 → `triggering_accuracy`
236
+ - E010 → `structural_completeness`
237
+
238
+ ### 1.5 Métricas cuantitativas de calidad
239
+
240
+ Calcular métricas de eficiencia de tokens y duplicación:
241
+
242
+ ```bash
243
+ SKILL_FILE="habilidades/<nombre>/SKILL.md"
244
+
245
+ # Estimar tokens del skill
246
+ node -e "
247
+ const { estimateTokens } = require('./hooks/lib/token-budget');
248
+ const fs = require('fs');
249
+ const content = fs.readFileSync('$SKILL_FILE', 'utf8');
250
+ const tokens = estimateTokens(content, 'mixed');
251
+ const lines = content.split('\n').length;
252
+ const ratio = (tokens / lines).toFixed(1);
253
+ console.log('TOKENS: ' + tokens);
254
+ console.log('LINEAS: ' + lines);
255
+ console.log('DENSIDAD: ' + ratio + ' tokens/línea');
256
+ console.log(tokens > 5000 ? 'W006 TOKEN_EXCESIVO: ' + tokens + ' tokens (máx 5000)' : 'tokens OK');
257
+ "
258
+ ```
259
+
260
+ Detección de duplicación con otros skills del sistema:
261
+
262
+ ```bash
263
+ # Comparar contenido con skills del mismo dominio
264
+ node -e "
265
+ const { jaccardSimilarity } = require('./hooks/lib/fingerprint-id');
266
+ const fs = require('fs');
267
+ const path = require('path');
268
+ const target = fs.readFileSync('$SKILL_FILE', 'utf8');
269
+ const skillsDir = 'habilidades';
270
+ const dirs = fs.readdirSync(skillsDir, {withFileTypes:true}).filter(d=>d.isDirectory());
271
+ const results = [];
272
+ for (const d of dirs) {
273
+ const p = path.join(skillsDir, d.name, 'SKILL.md');
274
+ if (p === '$SKILL_FILE' || !fs.existsSync(p)) continue;
275
+ const content = fs.readFileSync(p, 'utf8');
276
+ const sim = jaccardSimilarity(target, content);
277
+ if (sim > 0.3) results.push({name: d.name, similarity: (sim*100).toFixed(1)});
278
+ }
279
+ results.sort((a,b) => b.similarity - a.similarity);
280
+ if (results.length > 0) {
281
+ console.log('SIMILITUD con otros skills:');
282
+ results.slice(0,5).forEach(r => {
283
+ const flag = r.similarity > 50 ? ' W007 DUPLICADO_POTENCIAL' : '';
284
+ console.log(' ' + r.name + ': ' + r.similarity + '%' + flag);
285
+ });
286
+ } else {
287
+ console.log('Sin duplicación detectada con otros skills.');
288
+ }
289
+ "
290
+ ```
291
+
292
+ Mapeo de advertencias nuevas:
293
+
294
+ | Código | Tipo | Penalización |
295
+ |--------|------|-------------|
296
+ | W006 | ADVERTENCIA | -8 en `token_efficiency` |
297
+ | W007 | ADVERTENCIA | -10 en `orchestration_fitness` (posible duplicación) |
298
+
299
+ ## Paso 2 — Capa 2: Evaluación semántica
300
+
301
+ Leer el archivo completo con `Read`. Evaluar cada dimensión de 0 a 100 con
302
+ criterio honesto: si la skill tiene problemas reales, el score debe reflejarlos.
303
+
304
+ ### Tabla de dimensiones
305
+
306
+ | Dimensión | Peso | Qué medir |
307
+ |-----------|------|-----------|
308
+ | `triggering_accuracy` | 25% | ¿La `description` activa la skill en los momentos correctos? ¿El trigger es ni muy amplio ni muy estrecho? ¿Evita activaciones falsas? |
309
+ | `orchestration_fitness` | 20% | ¿Coordina bien con otras skills del sistema? ¿Invoca correctamente otras skills con `Skill("nombre")`? ¿Evita duplicar contenido de otras skills? |
310
+ | `output_quality` | 15% | ¿Los ejemplos de código son reales y funcionales? ¿Las reglas son específicas, no genéricas? ¿El contenido refleja patrones idiomáticos del framework? ¿Las directivas MUST/ALWAYS/NEVER/NUNCA/SIEMPRE incluyen justificación de por qué la regla existe? Una directiva sin justificación no permite al modelo generalizar a casos edge (ver W009). |
311
+ | `scope_calibration` | 12% | ¿El scope es coherente? ¿No cubre demasiado? ¿Hay sección de "cuándo NO usar"? ¿El contenido es específico del dominio declarado? |
312
+ | `progressive_disclosure` | 10% | ¿El SKILL.md principal es conciso (< 300 líneas)? ¿El contenido extenso está en `recursos/`? ¿Las referencias a recursos son claras y útiles? |
313
+ | `token_efficiency` | 6% | ¿Hay contenido redundante o repetitivo? ¿Los ejemplos son concisos pero completos? ¿Se evita documentación genérica que no agrega valor? |
314
+ | `robustness` | 5% | ¿Documenta casos edge y anti-patrones? ¿Cubre los errores más comunes del dominio? |
315
+ | `structural_completeness` | 3% | ¿Tiene todas las secciones mínimas requeridas? ¿El frontmatter tiene todos los campos obligatorios? |
316
+ | `code_template_quality` | 2% | ¿Los ejemplos de código compilan/ejecutan? ¿Usan sintaxis actual del lenguaje o framework? |
317
+ | `ecosystem_coherence` | 2% | ¿El naming sigue las convenciones del sistema SWL (kebab-case)? ¿Los patrones son consistentes con las otras skills? |
318
+
319
+ **Guía de calibración de scores:**
320
+ - 90-100: Excelente — referente del sistema
321
+ - 80-89: Sólido — listo para uso en producción
322
+ - 70-79: Funcional — mejoras menores posibles
323
+ - 60-69: Aceptable — requiere revisión antes de merge
324
+ - 40-59: Deficiente — problemas claros que afectan efectividad
325
+ - 0-39: Insuficiente — necesita reescritura
326
+
327
+ ## Paso 3 — Cálculo del score final
328
+
329
+ Calcular score ponderado:
330
+
331
+ ```
332
+ score_final = Σ(score_dimensión × peso_dimensión)
333
+
334
+ Ejemplo:
335
+ triggering_accuracy = 85 × 0.25 = 21.25
336
+ orchestration_fitness = 78 × 0.20 = 15.60
337
+ output_quality = 90 × 0.15 = 13.50
338
+ scope_calibration = 72 × 0.12 = 8.64
339
+ progressive_disclosure = 80 × 0.10 = 8.00
340
+ token_efficiency = 70 × 0.06 = 4.20
341
+ robustness = 65 × 0.05 = 3.25
342
+ structural_completeness= 95 × 0.03 = 2.85
343
+ code_template_quality = 85 × 0.02 = 1.70
344
+ ecosystem_coherence = 90 × 0.02 = 1.80
345
+ ─────────────────────────────────────────────
346
+ score_final = 80.79
347
+ ```
348
+
349
+ Asignar badge:
350
+
351
+ ```
352
+ ≥ 90 → Platino — production-ready, puede usarse como referencia
353
+ ≥ 80 → Oro — listo para merge
354
+ ≥ 70 → Plata — necesita mejoras menores antes del merge
355
+ ≥ 60 → Bronce — requiere revisión antes de merge
356
+ < 60 → Sin badge — no hacer merge hasta corregir
357
+ ```
358
+
359
+ ### Gate de promoción para auto-evolucion-swl (G8)
360
+
361
+ Este comando es el **gate obligatorio** del flujo de promoción de skills
362
+ auto-generados desde `_userland/plugins/` a `habilidades/`. El agente
363
+ `auto-evolucion-swl` invoca este comando antes de mover un skill al core
364
+ (ver `agentes/auto-evolucion-swl.md` sección "Gate G8").
365
+
366
+ Umbral de promoción:
367
+
368
+ | Badge | Acción de auto-evolucion |
369
+ |-------|-------------------------|
370
+ | Platino, Oro, Plata | Promover a `habilidades/`, registrar en manifiestos |
371
+ | Bronce | NO promover, devolver a `_userland/` con feedback |
372
+ | Sin badge | NO promover, registrar rechazo en `.planning/evolution/promociones-rechazadas.jsonl` |
373
+
374
+ Si un skill es rechazado ≥3 veces consecutivas, el agente escala al usuario
375
+ con análisis de qué dimensiones bajan el score. Origen: ADR 0013 sección 3C.
376
+
377
+ ## Paso 4 — Emitir reporte y artefacto de procedencia
378
+
379
+ Tras calcular el score final y el badge, persiste el **artefacto de
380
+ evaluación con procedencia** (única fuente que `run-skill-evals.js
381
+ --record-after` acepta para aprobar una evolución — anti-gaming,
382
+ DT-AGP-SCORE-AUTODECLARADO):
383
+
384
+ ```bash
385
+ swl-ses run-skill-evals <nombre> --emitir-evaluacion \
386
+ --score=<score-final> --badge=<badge> --producido-por=evaluar-skill
387
+ # → escribe .planning/evolution/evaluaciones/<nombre>.json (fechado)
388
+ # y registra el evento tipo:evaluacion en evoluciones.jsonl
389
+ ```
390
+
391
+ Es el ÚNICO archivo que este comando crea. Luego generar el siguiente
392
+ reporte directamente en la conversación:
393
+
394
+ ```markdown
395
+ ## Evaluación de skill: [nombre]
396
+ **Archivo**: habilidades/[nombre]/SKILL.md (o agentes/[nombre].md)
397
+ **Fecha**: [fecha actual]
398
+
399
+ ### Capa 1 — Análisis estático
400
+
401
+ [PASS si no hay errores ni advertencias]
402
+ [O listar cada E0XX / W0XX con descripción breve]
403
+
404
+ ### Capa 2 — Evaluación semántica
405
+
406
+ | Dimensión | Peso | Score | Contribución |
407
+ |-----------|------|-------|-------------|
408
+ | Triggering accuracy | 25% | XX/100 | XX.XX |
409
+ | Orchestration fitness | 20% | XX/100 | XX.XX |
410
+ | Output quality | 15% | XX/100 | XX.XX |
411
+ | Scope calibration | 12% | XX/100 | XX.XX |
412
+ | Progressive disclosure | 10% | XX/100 | XX.XX |
413
+ | Token efficiency | 6% | XX/100 | XX.XX |
414
+ | Robustness | 5% | XX/100 | XX.XX |
415
+ | Structural completeness | 3% | XX/100 | XX.XX |
416
+ | Code template quality | 2% | XX/100 | XX.XX |
417
+ | Ecosystem coherence | 2% | XX/100 | XX.XX |
418
+
419
+ **Score final: XX.XX/100 — Badge: [🏆/🥇/🥈/🥉/❌] [Platino/Oro/Plata/Bronce/Sin badge]**
420
+
421
+ ### Hallazgos principales
422
+
423
+ **Fortalezas:**
424
+ - [2-3 aspectos bien ejecutados con evidencia específica del contenido]
425
+
426
+ **Áreas de mejora:**
427
+ - [hallazgos específicos con sugerencia concreta y línea o sección afectada]
428
+
429
+ ### Recomendaciones para subir el score
430
+
431
+ [Lista priorizada de cambios concretos que mejorarían el score,
432
+ ordenados de mayor a menor impacto. Incluir la dimensión afectada.]
433
+ ```
434
+
435
+ ## Paso 3 — Capa 3 opcional: Evals estructurados
436
+
437
+ Si el artefacto tiene un archivo de evals en formato `skill-evals.schema.json`:
438
+
439
+ ```bash
440
+ EVALS_PATH="habilidades/<nombre>/evals/evals.json"
441
+ [ -f "$EVALS_PATH" ] && echo "EVALS_DISPONIBLES" || EVALS_PATH="agentes/evals/<nombre>.evals.json"
442
+ [ -f "$EVALS_PATH" ] && echo "EVALS_DISPONIBLES" || echo "SIN_EVALS"
443
+ ```
444
+
445
+ Si existen, ejecutar la Capa 3:
446
+
447
+ ### 3.1 — Validar el artefacto contra el schema
448
+
449
+ ```bash
450
+ # Validación mínima de estructura (zero-deps): comprobar que es JSON válido y
451
+ # que tiene los campos obligatorios. Validación completa del schema queda para
452
+ # consumidores externos (ajv, etc.) — SWL no arrastra deps.
453
+ node -e "
454
+ const ev = require('./$EVALS_PATH');
455
+ const req = ['skill_name','schema_version','evals'];
456
+ const missing = req.filter(k => !(k in ev));
457
+ if (missing.length) { console.error('FALTAN:', missing.join(',')); process.exit(1); }
458
+ if (!Array.isArray(ev.evals) || ev.evals.length === 0) { console.error('evals vacío'); process.exit(1); }
459
+ console.log('OK', ev.evals.length, 'evals');
460
+ "
461
+ ```
462
+
463
+ Si falla la validación, reportar y continuar solo con Capa 1+2 (no bloquear).
464
+
465
+ ### 3.2 — Ejecutar cada eval contra el skill cargado
466
+
467
+ Para cada `eval` del artefacto:
468
+
469
+ 1. Cargar el skill con `Skill("<nombre>")`.
470
+ 2. Enviar el `prompt` exacto al modelo en una respuesta aislada (sin historial).
471
+ 3. Capturar la respuesta.
472
+ 4. Para cada entrada de `expectations[]`, verificar si la respuesta la cumple
473
+ (match semántico honesto, no literal).
474
+ 5. Computar `pass = true` solo si TODAS las expectations se cumplen.
475
+ 6. Aplicar `weight` (default 1.0) al score.
476
+
477
+ ### 3.3 — Score de Capa 3
478
+
479
+ ```
480
+ score_evals = sum(pass_i * weight_i) / sum(weight_i) * 100
481
+ ```
482
+
483
+ ### 3.4 — Integración con score final
484
+
485
+ El score final combinado es:
486
+
487
+ - Sin evals: `score_final = score_capa_1_2`
488
+ - Con evals: `score_final = score_capa_1_2 * 0.7 + score_evals * 0.3`
489
+
490
+ Reportar ambos separadamente para trazabilidad. Si `score_evals < 60`, marcar
491
+ alerta: la skill puede ser declarativa pero falla en evaluación ejecutable.
492
+
493
+ ### 3.5 — Reporte por eval
494
+
495
+ ```
496
+ | ID | Tags | Peso | Resultado | Expectations fallidas |
497
+ |----|------|------|-----------|----------------------|
498
+ | 0 | primary-flow | 1.0 | ✓ pass | — |
499
+ | 1 | edge-case | 1.0 | ✗ fail | "La respuesta distingue X de Y" |
500
+ | anti-pattern-substitution | anti-pattern,regression | 1.5 | ✓ pass | — |
501
+
502
+ Score evals: 82.4/100 (peso 30% del final)
503
+ ```
504
+
505
+ ## Reglas de comportamiento
506
+
507
+ - La Capa 1 es **determinista**: ejecutar los scripts Bash y registrar resultados exactos. No inferir ni interpretar.
508
+ - La Capa 2 es **semántica honesta**: si la skill tiene problemas reales el score debe reflejarlos. No inflar scores por cortesía.
509
+ - La Capa 3 es **opcional**: si no existe `evals/evals.json`, omitirla sin penalizar. Si existe, es autoridad primaria sobre Capa 2 en caso de discrepancia (los evals son reproducibles; la evaluación semántica no).
510
+ - Un skill con Capa 3 activa y `score_evals ≥ 90` es candidato a badge **Platino** aunque Capa 2 sea 85.
511
+ - Los evals NUNCA se inventan en este comando — solo se ejecutan los declarados por el autor del skill. Crear evals nuevos es tarea de `/swl:aprender` o del autor del skill directamente, siguiendo `plantillas/skill-evals-template.json`.
512
+ - Si el archivo no existe, informar al usuario con el path exacto y terminar.
513
+ - Si `--agente` se pasa sin nombre, listar los agentes disponibles y terminar.
514
+ - El reporte siempre se emite en la conversación. El único archivo que se
515
+ crea es el artefacto de procedencia del Paso 4 (`.planning/evolution/
516
+ evaluaciones/<nombre>.json`) — nunca reportes sueltos.
517
+ - Las "Fortalezas" deben ser específicas del contenido leído, no genéricas.
518
+ - Las "Áreas de mejora" deben incluir la sección o línea aproximada donde se detectó el problema.
519
+ - Si la Capa 1 genera errores E001–E010, reflejar el impacto en el score de la dimensión afectada antes de sumar las contribuciones ponderadas.
520
+ - Score mínimo aprobado para merge: **80/100** (badge Oro). Por debajo de ese umbral, indicar claramente que **no está listo para merge**.