@saulwade/swl-ses 2.5.2 → 2.6.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (183) hide show
  1. package/CLAUDE.md +194 -192
  2. package/README.md +600 -600
  3. package/agentes/auto-evolucion-swl.md +27 -3
  4. package/bin/swl-ses.js +32 -6
  5. package/comandos/swl/actualizar.md +174 -174
  6. package/comandos/swl/adoptar-proyecto.md +265 -265
  7. package/comandos/swl/aprender.md +836 -823
  8. package/comandos/swl/aprobar-plan.md +146 -146
  9. package/comandos/swl/auditar-deps.md +134 -134
  10. package/comandos/swl/autoresearch.md +264 -264
  11. package/comandos/swl/ayuda.md +224 -224
  12. package/comandos/swl/brainstorm.md +51 -51
  13. package/comandos/swl/briefing.md +119 -119
  14. package/comandos/swl/checkpoint.md +325 -325
  15. package/comandos/swl/claudemd.md +234 -234
  16. package/comandos/swl/compactar.md +310 -310
  17. package/comandos/swl/configurar-ci.md +235 -235
  18. package/comandos/swl/contexto.md +110 -110
  19. package/comandos/swl/contribuir.md +233 -233
  20. package/comandos/swl/crear-skill.md +292 -292
  21. package/comandos/swl/cron.md +194 -194
  22. package/comandos/swl/deuda-codigo.md +97 -97
  23. package/comandos/swl/discutir-fase.md +169 -169
  24. package/comandos/swl/ejecutar-fase.md +233 -233
  25. package/comandos/swl/evaluar-skill.md +520 -505
  26. package/comandos/swl/evolucion-continua.md +73 -0
  27. package/comandos/swl/evolucionar.md +267 -254
  28. package/comandos/swl/exportar-vault.md +583 -583
  29. package/comandos/swl/fix.md +118 -118
  30. package/comandos/swl/gateway.md +158 -158
  31. package/comandos/swl/inbox.md +116 -116
  32. package/comandos/swl/instalar.md +220 -220
  33. package/comandos/swl/instintos.md +86 -86
  34. package/comandos/swl/mapear-codebase.md +312 -312
  35. package/comandos/swl/mcp-status.md +175 -175
  36. package/comandos/swl/modelo.md +100 -100
  37. package/comandos/swl/nemesis.md +433 -433
  38. package/comandos/swl/notificaciones.md +299 -299
  39. package/comandos/swl/nuevo-proyecto.md +251 -251
  40. package/comandos/swl/planear-fase.md +263 -263
  41. package/comandos/swl/plugins.md +256 -256
  42. package/comandos/swl/predecir.md +169 -169
  43. package/comandos/swl/reflect-skills.md +125 -125
  44. package/comandos/swl/release.md +450 -450
  45. package/comandos/swl/revisar-impacto.md +201 -201
  46. package/comandos/swl/revisar.md +330 -330
  47. package/comandos/swl/seguridad.md +189 -189
  48. package/comandos/swl/sesiones.md +200 -200
  49. package/comandos/swl/skill-search.md +113 -113
  50. package/comandos/swl/status.md +343 -343
  51. package/comandos/swl/verificar.md +817 -817
  52. package/comandos/swl/wiki.md +620 -620
  53. package/gateway/cron/jobs.example.json +12 -0
  54. package/habilidades/auto-evolucion-protocolo/SKILL.md +294 -276
  55. package/habilidades/autoresearch/SKILL.md +3 -2
  56. package/habilidades/benchmark-memoria/SKILL.md +7 -7
  57. package/habilidades/changelog-generator/SKILL.md +174 -174
  58. package/habilidades/changelog-generator/scripts/parse-commits.js +2 -1
  59. package/habilidades/checkpoints-verificacion/SKILL.md +6 -0
  60. package/habilidades/context-builder/SKILL.md +4 -0
  61. package/habilidades/doubt-driven-review/SKILL.md +207 -191
  62. package/habilidades/drift-detection/SKILL.md +6 -1
  63. package/habilidades/ejecutar-fase/SKILL.md +6 -6
  64. package/habilidades/eval-framework/SKILL.md +8 -3
  65. package/habilidades/harness-claude-code/SKILL.md +314 -308
  66. package/habilidades/infra-github-actions/SKILL.md +4 -3
  67. package/habilidades/instalar-sistema/SKILL.md +227 -223
  68. package/habilidades/memoria-busqueda/SKILL.md +31 -39
  69. package/habilidades/planear-fase/SKILL.md +358 -350
  70. package/habilidades/proceso-ddia-fundamentos/SKILL.md +3 -2
  71. package/habilidades/release-semver/SKILL.md +4 -2
  72. package/habilidades/swl-claudemd/SKILL.md +6 -7
  73. package/habilidades/swl-dashboard/SKILL.md +11 -43
  74. package/habilidades/tdd-workflow/SKILL.md +749 -744
  75. package/habilidades/validacion-ci-sistema/SKILL.md +1 -1
  76. package/hooks/agente-lifecycle.js +2 -1
  77. package/hooks/aiisms-detector.js +13 -4
  78. package/hooks/audit-trail.js +2 -1
  79. package/hooks/auto-consolidacion.js +2 -1
  80. package/hooks/captura-acciones-post.js +2 -1
  81. package/hooks/captura-acciones-session.js +2 -1
  82. package/hooks/captura-feedback-usuario.js +3 -2
  83. package/hooks/claudemd-bloat-detector.js +12 -3
  84. package/hooks/claudemd-duplicacion-detector.js +13 -3
  85. package/hooks/contexto-iteracion.js +2 -1
  86. package/hooks/degradacion-instintos.js +2 -1
  87. package/hooks/extraccion-aprendizajes.js +109 -15
  88. package/hooks/grafo-contexto.js +2 -1
  89. package/hooks/guardrail-modelo.js +2 -1
  90. package/hooks/inbox-aviso.js +2 -1
  91. package/hooks/inyeccion-contexto.js +2 -1
  92. package/hooks/lib/agent-matcher.js +2 -1
  93. package/hooks/lib/agent-routing.js +2 -1
  94. package/hooks/lib/autonomia.js +5 -3
  95. package/hooks/lib/captura-acciones.js +2 -1
  96. package/hooks/lib/consolidation-lock.js +21 -10
  97. package/hooks/lib/etapa-auto-evolucion.js +10 -4
  98. package/hooks/lib/etapa-metricas.js +2 -1
  99. package/hooks/lib/etapa-perfil-usuario.js +20 -4
  100. package/hooks/lib/evolution-tracker.js +2 -1
  101. package/hooks/lib/gateway-notify.js +193 -179
  102. package/hooks/lib/loop-telemetry.js +5 -4
  103. package/hooks/lib/mcp-health.js +2 -1
  104. package/hooks/lib/memory-search.js +4 -0
  105. package/hooks/lib/merkle-audit.js +58 -6
  106. package/hooks/lib/nudge-tracker.js +2 -1
  107. package/hooks/lib/otlp-exporter.js +2 -1
  108. package/hooks/lib/propose-step.js +3 -2
  109. package/hooks/lib/raiz-proyecto.js +102 -0
  110. package/hooks/lib/run-log.js +2 -1
  111. package/hooks/lib/singleton-guard.js +218 -27
  112. package/hooks/lib/telegram-cliente.js +17 -8
  113. package/hooks/preservar-estado-pre-compact.js +2 -1
  114. package/hooks/proteccion-rutas.js +59 -3
  115. package/hooks/registro-turnos.js +2 -1
  116. package/hooks/resumen-sesion.js +2 -1
  117. package/hooks/risk-scoring.js +2 -1
  118. package/hooks/rotar-audit-auto.js +46 -20
  119. package/hooks/session-briefing.js +127 -1
  120. package/hooks/spec-gate.js +2 -1
  121. package/hooks/sugerir-contribuir.js +6 -3
  122. package/hooks/sugerir-regenerar-inventario.js +3 -2
  123. package/hooks/tdd-gate.js +2 -1
  124. package/hooks/telemetria-agentes.js +2 -1
  125. package/hooks/telemetria-skill-routing.js +2 -1
  126. package/hooks/tracking-costos.js +4 -3
  127. package/hooks/validar-formato-post-subagente.js +2 -1
  128. package/hooks/validar-intent-spec.js +2 -1
  129. package/hooks/validar-memoria-hook.js +13 -3
  130. package/hooks/validar-planning-paths.js +2 -1
  131. package/instintos/.backups/perfil-usuario.yaml.2026-07-10-165128.bak +53 -0
  132. package/instintos/.backups/proyecto.yaml.2026-07-10-165128.bak +372 -0
  133. package/instintos/perfil-usuario.yaml +506 -3
  134. package/instintos/proyecto.yaml +78 -0
  135. package/llms.txt +2 -2
  136. package/manifiestos/canonical-hashes.json +664 -2
  137. package/manifiestos/modulos.json +19 -14
  138. package/manifiestos/planning-paths.json +1 -0
  139. package/manifiestos/skills-lock.json +53 -53
  140. package/package.json +2 -3
  141. package/plugin.json +2 -2
  142. package/scripts/actualizar.js +3 -0
  143. package/scripts/auditar-clases-conocidas.js +32 -4
  144. package/scripts/benchmark-memoria.js +1 -0
  145. package/scripts/cli/autonomia.js +23 -0
  146. package/scripts/cli/benchmark-memoria.js +37 -0
  147. package/scripts/cli/ciclo-autonomo.js +73 -0
  148. package/scripts/cli/ciclo-fase-b.js +102 -0
  149. package/scripts/cli/guardrail-metrics.js +39 -0
  150. package/scripts/cli/loop-telemetry.js +4 -2
  151. package/scripts/cli/memoria-search.js +69 -0
  152. package/scripts/cli/nudge-accionar.js +39 -0
  153. package/scripts/cli/run-eval.js +38 -0
  154. package/scripts/cli/run-skill-evals.js +13 -2
  155. package/scripts/derivar-feature-list.js +15 -14
  156. package/scripts/desinstalar.js +11 -0
  157. package/scripts/doctor.js +24 -10
  158. package/scripts/instalador.js +106 -7
  159. package/scripts/lib/activar-hooks-proyecto.js +116 -0
  160. package/scripts/lib/auditar-invocaciones-comandos.js +96 -6
  161. package/scripts/lib/ciclo-autonomo/candidatos.js +174 -0
  162. package/scripts/lib/ciclo-autonomo/config.js +165 -0
  163. package/scripts/lib/ciclo-autonomo/drenador-feedback.js +174 -0
  164. package/scripts/lib/ciclo-autonomo/fallback.js +77 -0
  165. package/scripts/lib/ciclo-autonomo/guard-convivencia.js +139 -0
  166. package/scripts/lib/ciclo-autonomo/higiene-nudges.js +112 -0
  167. package/scripts/lib/ciclo-autonomo/index.js +301 -0
  168. package/scripts/lib/ciclo-autonomo/lock.js +124 -0
  169. package/scripts/lib/ciclo-autonomo/presupuesto.js +122 -0
  170. package/scripts/lib/ciclo-autonomo/puente-degradacion.js +240 -0
  171. package/scripts/lib/ciclo-autonomo/runner-fase-b.js +248 -0
  172. package/scripts/lib/ciclo-autonomo/writer-instintos.js +190 -0
  173. package/scripts/lib/ciclo-autonomo/yaml-instintos.js +535 -0
  174. package/scripts/lib/estado.js +9 -0
  175. package/scripts/lib/evidencia-valor.js +1 -1
  176. package/scripts/lib/gitignore-manifest.js +8 -1
  177. package/scripts/lib/hooks-settings.js +45 -0
  178. package/scripts/rotar-audit-logs.js +48 -2
  179. package/scripts/run-eval.js +1 -0
  180. package/scripts/run-skill-evals.js +287 -8
  181. package/scripts/smoke-test.js +16 -8
  182. package/scripts/tui/pantallas/install-wizard.js +403 -347
  183. package/scripts/validar.js +40 -1
@@ -0,0 +1,73 @@
1
+ ---
2
+ name: swl:evolucion-continua
3
+ description: Enciende, apaga o consulta el motor determinista de aprendizaje del ciclo autónomo (ADR-0041). Con on, el proyecto aprende solo — decay y promoción de instintos, drenaje de feedback al perfil, puente de degradación e higiene de nudges — vía cron nocturno o fallback de session-briefing (cada ≥24h). Subcomandos on | off | status. Nace encendido (opt-out): off/SWL_CICLO_AUTONOMO=0 son el kill-switch sagrado.
4
+ allowed_tools: ["Bash", "Read"]
5
+ ---
6
+
7
+ # /swl:evolucion-continua — Motor determinista de aprendizaje (on|off|status)
8
+
9
+ Eres el operador del motor determinista del ciclo autónomo (Nivel 0,
10
+ ADR-0041). Este comando es la cara de usuario del subcomando CLI
11
+ `swl-ses ciclo-autonomo`: NO implementa lógica propia — delega en el CLI
12
+ (invocación cross-scope, regla `validar.js §7b`).
13
+
14
+ ## Qué hace el motor cuando está encendido
15
+
16
+ Cada corrida de la Fase A (Node puro, sin LLM, <2s, $0):
17
+
18
+ 1. **Writer de instintos** — aplica decay, promueve drafts maduros
19
+ (confidence ≥0.5 + evidencia ≥3), degrada por feedback dañino y archiva
20
+ instintos muertos en `instintos/proyecto.yaml` (con backup previo).
21
+ 2. **Puente de degradación** — un aprendizaje `[DEGRADADO]` en
22
+ APRENDIZAJES.md baja la confidence del instinto derivado.
23
+ 3. **Drenador de feedback** — consolida las señales de
24
+ `evolution/feedback-queue.jsonl` (≤90 días) como drafts en
25
+ `instintos/perfil-usuario.yaml`; lo más viejo se archiva sin procesar.
26
+ 4. **Higiene de nudges** — marca atendidos los que el ciclo consume y
27
+ archiva los >90 días sin accionar.
28
+
29
+ Todo queda registrado en `evolution/ciclo-autonomo.jsonl` con
30
+ `origen: ciclo-autonomo`. Corridas sin señales son no-op sin escrituras.
31
+
32
+ ## Uso
33
+
34
+ ```
35
+ /swl:evolucion-continua on # habilita el motor en este proyecto
36
+ /swl:evolucion-continua off # lo apaga (kill-switch)
37
+ /swl:evolucion-continua status # last_run + conteos de la última corrida
38
+ ```
39
+
40
+ ## Ejecución
41
+
42
+ Resuelve el CLI con el patrón cross-scope (repo madre → bin en PATH → npx):
43
+
44
+ ```bash
45
+ # on | off | status según el argumento recibido
46
+ swl-ses ciclo-autonomo <accion>
47
+ ```
48
+
49
+ Sin binario en PATH: `npx -y @saulwade/swl-ses@latest ciclo-autonomo <accion>`.
50
+
51
+ Tras `on`, informa al usuario los dos disparadores disponibles:
52
+
53
+ 1. **Cron del gateway** (si usa `/swl:cron`): job de ejemplo en
54
+ `gateway/cron/jobs.example.json` (nocturno, `0 3 * * *`).
55
+ 2. **Fallback automático de session-briefing**: sin cron, la Fase A se
56
+ dispara sola al iniciar sesión cuando pasaron ≥24h de la última corrida
57
+ (fire-and-forget; el lock evita corridas dobles).
58
+
59
+ Una corrida manual siempre es posible: `swl-ses ciclo-autonomo`.
60
+
61
+ ## Reglas de comportamiento
62
+
63
+ - El motor **nace ENCENDIDO** (opt-out estricto, decisión del usuario
64
+ 2026-07-10): en proyectos sin señales la corrida es no-op inofensiva.
65
+ `off` y `SWL_CICLO_AUTONOMO=0` (docs/variables-entorno.md) son el
66
+ kill-switch — el off es sagrado: cero corridas, cero escrituras.
67
+ - Este comando NO corre la Fase B con LLM (Fases 22+ del ADR-0042) — el
68
+ campo `credencial` del config existe pero aquí no se consume.
69
+ - Si `status` reporta corridas con `errores`, sugiere revisar
70
+ `evolution/ciclo-autonomo.jsonl` y los backups en `instintos/.backups/`.
71
+ - La primera corrida sobre un proyecto con señales acumuladas puede mover
72
+ mucho (bootstrap con ventana de 90 días): recomienda revisar el diff de
73
+ `instintos/*.yaml` antes de commitear.
@@ -1,254 +1,267 @@
1
- ---
2
- name: swl:evolucionar
3
- description: Activa el protocolo de auto-evolución del sistema SWL. Analiza outputs recientes de agentes para detectar patrones y errores, propone mejoras a agentes y skills basándose en evidencia concreta, versiona los cambios y genera entradas de CHANGELOG. Flags disponibles: --agente=[nombre], --skill=[nombre], --dry-run.
4
- allowed_tools: ["Read", "Write", "Edit", "Bash", "Glob", "Grep"]
5
- ---
6
-
7
- # /swl:evolucionar — Protocolo de auto-evolución del sistema SWL
8
-
9
- Eres el motor de evolución del sistema SWL. Analizas el desempeño real del sistema y conviertes esa evidencia en mejoras concretas a agentes y skills. Un sistema que no evoluciona acumula deuda metodológica.
10
-
11
- Este comando es distinto a `swl:aprender`: donde `aprender` extrae conocimiento de un proyecto específico, `evolucionar` mejora el propio sistema SWL a partir de su historial de ejecución.
12
-
13
- ## Relación con otros canales de aprendizaje
14
-
15
- SWL tiene **tres canales independientes** de aprendizaje. Son complementarios, no solapados:
16
-
17
- | Canal | Produce | Disparadores | Escribe en |
18
- |-------|---------|--------------|------------|
19
- | `/swl:aprender` | Conocimiento del dominio (anti-patrones, patrones, gotchas, decisiones) | Manual o nudge de `auto-consolidacion.js` (≥24h + ≥5 sesiones) | `APRENDIZAJES.md`, skills, `CLAUDE.md` |
20
- | `/swl:evolucionar` *(este comando)* | Mejoras al sistema SWL (versionado de agentes/skills, patches, splits, deprecaciones) | Manual o nudge de `auto-evolucion.js` (≥3 fallos o ≥10 runs/14d de un agente) | `agentes/*.md`, `habilidades/*/SKILL.md`, CHANGELOG |
21
- | Agente `perfilador-usuario-swl` | Modelo del usuario (rol, stack preferido, correcciones repetidas, preferencias de comunicación) | Manual o nudge de `actualizar-perfil-usuario.js` (≥3 señales acumuladas) | `instintos/perfil-usuario.yaml` |
22
-
23
- ### Cómo se coordinan
24
-
25
- - **Evolución + perfil**: el parser de fricción (`auto-evolucion-protocolo` v1.1) cruza el log
26
- `.planning/auto-evolution/agentes.jsonl` con las señales de corrección del usuario
27
- para priorizar agentes cuyos runs coincidieron con correcciones. Ver tabla
28
- "Categorías de fricción" en el skill.
29
- - **Evolución + aprendizajes**: antes de modificar un skill, leer `APRENDIZAJES.md`
30
- para detectar si el gap ya fue observado y documentado — la "Repetición de error"
31
- es una categoría de fricción fuerte.
32
- - **Aprender + perfil**: los aprendizajes tipo **D** (mejora de metodología) pueden
33
- reforzar entradas del perfil si tocan preferencias de colaboración, pero la
34
- escritura al perfil sigue siendo responsabilidad exclusiva del agente
35
- `perfilador-usuario-swl` para centralizar privacidad (`Skill("privacy-memoria")`).
36
-
37
- **Regla**: nunca escribas a dos canales desde el mismo comando. Si `/swl:evolucionar`
38
- detecta que el usuario corrige al agente por una preferencia personal (no un bug
39
- del agente), registra la señal para el perfilador y **no** incorpores la preferencia
40
- al agente mismo — el agente debe leer el perfil, no duplicarlo.
41
-
42
- ## Cuándo usar este comando
43
-
44
- - Después de completar múltiples proyectos y detectar patrones de fallo recurrentes
45
- - Cuando el verificador reporta consistentemente los mismos tipos de errores
46
- - Cuando un agente genera outputs que regularmente requieren corrección manual
47
- - Cuando un skill tiene reglas que los desarrolladores ignoran o causan confusión
48
- - Periódicamente (recomendado: al inicio de cada sprint o ciclo de desarrollo)
49
-
50
- ## Flags soportados
51
-
52
- ```
53
- --agente=[nombre] Evolucionar solo el agente especificado
54
- --skill=[nombre] Evolucionar solo el skill especificado
55
- --dry-run Mostrar propuestas sin aplicar cambios
56
- ```
57
-
58
- ## Paso 0 — Parseo de flags y carga de habilidades
59
-
60
- Lee los flags del comando. Determina el alcance:
61
- - Sin flags: evolución completa del sistema
62
- - `--agente=[nombre]`: solo el agente indicado
63
- - `--skill=[nombre]`: solo el skill indicado
64
- - `--dry-run`: análisis completo sin modificar archivos
65
-
66
- Carga obligatoria:
67
- ```
68
- Skill("auto-evolucion-protocolo")
69
- ```
70
-
71
- El skill define el ciclo completo (Observación > Diagnóstico > Propuesta > Revisión > Aplicación > Verificación > Registro), el formato de propuesta, governance, safety checks y formato de commit evolutivo.
72
-
73
- Reporta:
74
- ```
75
- Modo: [completo | agente específico | skill específico]
76
- Dry-run: [sí | no]
77
- Alcance: [descripción]
78
- ```
79
-
80
- ## Paso 1 — Recopilación de evidencia
81
-
82
- Busca y lee:
83
- 1. **RESUMEN.md y VERIFICACION.md recientes** — extrae iteraciones, errores rechazados, correcciones manuales
84
- 2. **Historial de commits del sistema** (últimos 90 días en agentes/ habilidades/ comandos/ reglas/) — frecuencia de modificación indica inestabilidad
85
- 3. **APRENDIZAJES.md de proyectos** — clasifica aprendizajes TIPO B (anti-patrones generales) y TIPO D (mejoras de metodología)
86
- 4. **Inventario actual** — lista agentes, skills, comandos, reglas. Si hay flag de alcance, lee solo el artefacto indicado
87
-
88
- ## Paso 2 — Análisis de patrones de fallo
89
-
90
- Con la evidencia, identifica patrones en 5 categorías:
91
-
92
- | Categoría | Busca |
93
- |-----------|-------|
94
- | E1 — Reglas ignoradas | Agentes que no cargan skills obligatorios, errores recurrentes del verificador |
95
- | E2 — Skills desactualizados | Reglas que se overridean consistentemente, APIs que cambiaron |
96
- | E3 — Outputs inconsistentes | Mismo agente produce formatos distintos, instrucciones ambiguas |
97
- | E4 — Gaps de cobertura | Problemas sin skill, flujos sin agente, comandos faltantes |
98
- | E5 — Fricción innecesaria | Pasos que siempre se saltan, confirmaciones que siempre se aprueban |
99
-
100
- ## Paso 3 — Métricas de calidad
101
-
102
- Para cada agente/skill en el alcance, calcula basándose en la evidencia:
103
- - Iteraciones promedio para completar tarea
104
- - Tasa de rechazo del verificador y tipos más frecuentes
105
- - Frecuencia de modificación (últimos 90d)
106
- - Score de estabilidad/relevancia (Alto | Medio | Bajo)
107
-
108
- ## Paso 4 — Generación de propuestas
109
-
110
- Sigue el formato de propuesta definido en `Skill("auto-evolucion-protocolo")` (PROPUESTA-EVOLUCION-NNN). Para cada patrón identificado, genera una propuesta con: tipo, objetivo, evidencia (2-3 ejemplos concretos), problema, cambio propuesto, impacto esperado, prioridad y esfuerzo.
111
-
112
- Ordena por prioridad alta + menor esfuerzo primero.
113
-
114
- ## Paso 5 — Presentación y confirmación
115
-
116
- Si `--dry-run`: presenta todas las propuestas y termina.
117
-
118
- Si NO es dry-run: presenta propuestas numeradas y pide confirmación:
119
- ```
120
- Identifiqué [N] propuestas de mejora para el sistema SWL:
121
- [lista numerada con título, tipo y prioridad]
122
-
123
- ¿Deseas aplicar todas? Escribe: "aplicar todo", "aplicar [números]", o "cancelar [números]"
124
- ```
125
-
126
- Espera respuesta. No apliques cambios sin confirmación explícita.
127
-
128
- ## Paso 6 — Aplicación de cambios aprobados
129
-
130
- Aplica siguiendo las reglas de governance y safety checks del skill:
131
- - **Agentes**: usa Edit (no reescribir completo), verifica YAML válido, NUNCA eliminar instrucciones sin evidencia de daño
132
- - **Skills**: aplica en sección correspondiente, incrementa versión si existe campo version
133
- - **Nuevas entidades**: usa como template la entidad existente más similar
134
-
135
- Respeta la governance: PARCHE auto-aplicable, MENOR requiere revisión, MAYOR requiere aprobación humana. Modificar agentes siempre requiere aprobación humana.
136
-
137
- **OBLIGATORIO — Marcar como evolucionado** con el subcomando del CLI (resuelve
138
- cross-scope; ver `docs/invocacion-cli-cross-scope.md`):
139
-
140
- ```bash
141
- swl-ses mark-evolved "[RUTA_ARCHIVO_MODIFICADO]" \
142
- --by=evolucionar \
143
- --note="[descripción breve del cambio]"
144
- # fallback: npx -y @saulwade/swl-ses@latest mark-evolved "[RUTA]" --by=evolucionar --note="..."
145
- ```
146
-
147
- Reemplazar los placeholders entre corchetes con los valores reales.
148
- Si el comando Bash no está disponible, agregar manualmente en el frontmatter:
149
-
150
- ```yaml
151
- evolved: true
152
- evolved-from: "[versión actual del sistema, ej: 5.1.3]"
153
- evolved-at: "[fecha YYYY-MM-DD]"
154
- evolved-by: "evolucionar"
155
- evolved-note: "[descripción breve del cambio]"
156
- ```
157
-
158
- Para archivos sin frontmatter (reglas), el comando Bash crea automáticamente un archivo sidecar `.evolved.json`.
159
-
160
- **SIN ESTE MARCADO, LOS CAMBIOS DE EVOLUCIÓN SE PERDERÁN EN LA PRÓXIMA ACTUALIZACIÓN.**
161
-
162
- ## Paso 6.5 — Gate de regresión con evals (OBLIGATORIO si hay evals)
163
-
164
- Antes de dar por aplicado cualquier cambio, ejecutar el gate de regresión para
165
- garantizar que la evolución no degradó el skill/agente:
166
-
167
- ### 6.5.1 — Verificar si existe archivo de evals
168
-
169
- ```bash
170
- npx -y @saulwade/swl-ses@latest run-skill-evals <nombre> --list 2>/dev/null | grep "<nombre>"
171
- ```
172
-
173
- Si NO hay evals: saltar este paso y registrar en CHANGELOG:
174
- `"evolución sin gate de regresión — evals no disponibles para <nombre>"`.
175
- Sugerir al usuario crear evals siguiendo `plantillas/skill-evals-template.json`.
176
-
177
- Si SÍ hay evals: ejecutar el gate completo (6.5.2 a 6.5.5).
178
-
179
- ### 6.5.2 — Registrar baseline (ANTES de aplicar el cambio)
180
-
181
- Cargar el skill/agente ORIGINAL (antes del patch) y ejecutar cada eval contra
182
- el modelo con el contenido actual cargado. Contar aciertos.
183
-
184
- ```
185
- score_baseline = (evals_pass / evals_total) * 100 × factor_peso
186
- ```
187
-
188
- Registrar:
189
-
190
- ```bash
191
- npx -y @saulwade/swl-ses@latest run-skill-evals <nombre> --record-baseline --score=<N>
192
- ```
193
-
194
- ### 6.5.3 — Aplicar el cambio (lo que ya hacía el Paso 6)
195
-
196
- ### 6.5.4 — Re-ejecutar evals contra la versión nueva
197
-
198
- Cargar el skill/agente MODIFICADO y ejecutar cada eval del mismo archivo.
199
-
200
- ```
201
- score_after = (evals_pass / evals_total) * 100 × factor_peso
202
- ```
203
-
204
- ### 6.5.5 — Decisión
205
-
206
- | Condición | Acción |
207
- |---|---|
208
- | `score_after >= score_baseline` | **Aceptar** — `npx -y @saulwade/swl-ses@latest run-skill-evals <nombre> --record-after --score=<N>` |
209
- | `score_after < score_baseline - 5` | **Revertir** — restaurar el archivo anterior + `--record-revert --score=<N>` |
210
- | `score_baseline - 5 <= score_after < score_baseline` | **Requiere revisión humana** — reportar diferencia; usuario decide si acepta la regresión menor o revierte |
211
-
212
- Los 3 casos registran evento en `.planning/evolution/evoluciones.jsonl` para el
213
- dashboard `/swl:status evolucion`.
214
-
215
- ### Regla de oro
216
-
217
- Un skill no se evoluciona si no se puede medir. Si vas a modificar un skill
218
- sin evals, primero crea los evals (mínimo 3: uno primary-flow, uno edge-case,
219
- uno anti-pattern). Sin baseline, cualquier cambio es una apuesta.
220
-
221
- ## Paso 7 — Versionado y commit
222
-
223
- Incrementa versión del sistema según magnitud:
224
- - Solo reglas/docs de skills: PATCH
225
- - Nuevas reglas, anti-patrones, flujos: MINOR
226
- - Nuevos agentes, comandos, refactorización de flujo: MAJOR
227
-
228
- Commit con formato evolutivo del skill:
229
- ```
230
- evolve(swl): [descripción concisa]
231
- ```
232
-
233
- ## Paso 8 — CHANGELOG y reporte final
234
-
235
- Actualiza CHANGELOG.md con: propósito de la evolución, agentes/skills modificados, métricas antes, impacto esperado.
236
-
237
- ```
238
- === Evolución del sistema SWL completada ===
239
-
240
- Propuestas analizadas: [N] | Aplicadas: [N] | Diferidas: [N]
241
- Agentes modificados: [N] | Skills modificados: [N]
242
- Versión: [anterior] → [nueva]
243
-
244
- Próxima evolución recomendada: después de [N] proyectos o [fecha]
245
- ```
246
-
247
- ## Reglas de comportamiento
248
-
249
- - NUNCA apliques cambios sin evidencia concreta. "Parece que sería mejor" no es evidencia.
250
- - NUNCA elimines instrucciones de agentes basándote solo en que parecen redundantes.
251
- - En `--dry-run`, el reporte debe ser completo y accionable.
252
- - Si la evidencia contradice una regla, documenta la contradicción en CHANGELOG antes de cambiar.
253
- - Prioriza cambios con mayor impacto en iteraciones reducidas.
254
- - Si no hay evidencia suficiente, reporta exactamente eso y sugiere qué ejecutar para generarla.
1
+ ---
2
+ name: swl:evolucionar
3
+ description: Activa el protocolo de auto-evolución del sistema SWL. Analiza outputs recientes de agentes para detectar patrones y errores, propone mejoras a agentes y skills basándose en evidencia concreta, versiona los cambios y genera entradas de CHANGELOG. Flags disponibles: --agente=[nombre], --skill=[nombre], --dry-run.
4
+ allowed_tools: ["Read", "Write", "Edit", "Bash", "Glob", "Grep"]
5
+ ---
6
+
7
+ # /swl:evolucionar — Protocolo de auto-evolución del sistema SWL
8
+
9
+ Eres el motor de evolución del sistema SWL. Analizas el desempeño real del sistema y conviertes esa evidencia en mejoras concretas a agentes y skills. Un sistema que no evoluciona acumula deuda metodológica.
10
+
11
+ Este comando es distinto a `swl:aprender`: donde `aprender` extrae conocimiento de un proyecto específico, `evolucionar` mejora el propio sistema SWL a partir de su historial de ejecución.
12
+
13
+ ## Relación con otros canales de aprendizaje
14
+
15
+ SWL tiene **tres canales independientes** de aprendizaje. Son complementarios, no solapados:
16
+
17
+ | Canal | Produce | Disparadores | Escribe en |
18
+ |-------|---------|--------------|------------|
19
+ | `/swl:aprender` | Conocimiento del dominio (anti-patrones, patrones, gotchas, decisiones) | Manual o nudge de `auto-consolidacion.js` (≥24h + ≥5 sesiones) | `APRENDIZAJES.md`, skills, `CLAUDE.md` |
20
+ | `/swl:evolucionar` *(este comando)* | Mejoras al sistema SWL (versionado de agentes/skills, patches, splits, deprecaciones) | Manual o nudge de `auto-evolucion.js` (≥3 fallos o ≥10 runs/14d de un agente) | `agentes/*.md`, `habilidades/*/SKILL.md`, CHANGELOG |
21
+ | Agente `perfilador-usuario-swl` | Modelo del usuario (rol, stack preferido, correcciones repetidas, preferencias de comunicación) | Manual o nudge de `actualizar-perfil-usuario.js` (≥3 señales acumuladas) | `instintos/perfil-usuario.yaml` |
22
+
23
+ ### Cómo se coordinan
24
+
25
+ - **Evolución + perfil**: el parser de fricción (`auto-evolucion-protocolo` v1.1) cruza el log
26
+ `.planning/auto-evolution/agentes.jsonl` con las señales de corrección del usuario
27
+ para priorizar agentes cuyos runs coincidieron con correcciones. Ver tabla
28
+ "Categorías de fricción" en el skill.
29
+ - **Evolución + aprendizajes**: antes de modificar un skill, leer `APRENDIZAJES.md`
30
+ para detectar si el gap ya fue observado y documentado — la "Repetición de error"
31
+ es una categoría de fricción fuerte.
32
+ - **Aprender + perfil**: los aprendizajes tipo **D** (mejora de metodología) pueden
33
+ reforzar entradas del perfil si tocan preferencias de colaboración, pero la
34
+ escritura al perfil sigue siendo responsabilidad exclusiva del agente
35
+ `perfilador-usuario-swl` para centralizar privacidad (`Skill("privacy-memoria")`).
36
+
37
+ **Regla**: nunca escribas a dos canales desde el mismo comando. Si `/swl:evolucionar`
38
+ detecta que el usuario corrige al agente por una preferencia personal (no un bug
39
+ del agente), registra la señal para el perfilador y **no** incorpores la preferencia
40
+ al agente mismo — el agente debe leer el perfil, no duplicarlo.
41
+
42
+ ## Cuándo usar este comando
43
+
44
+ - Después de completar múltiples proyectos y detectar patrones de fallo recurrentes
45
+ - Cuando el verificador reporta consistentemente los mismos tipos de errores
46
+ - Cuando un agente genera outputs que regularmente requieren corrección manual
47
+ - Cuando un skill tiene reglas que los desarrolladores ignoran o causan confusión
48
+ - Periódicamente (recomendado: al inicio de cada sprint o ciclo de desarrollo)
49
+
50
+ ## Flags soportados
51
+
52
+ ```
53
+ --agente=[nombre] Evolucionar solo el agente especificado
54
+ --skill=[nombre] Evolucionar solo el skill especificado
55
+ --dry-run Mostrar propuestas sin aplicar cambios
56
+ ```
57
+
58
+ ## Paso 0 — Parseo de flags y carga de habilidades
59
+
60
+ Lee los flags del comando. Determina el alcance:
61
+ - Sin flags: evolución completa del sistema
62
+ - `--agente=[nombre]`: solo el agente indicado
63
+ - `--skill=[nombre]`: solo el skill indicado
64
+ - `--dry-run`: análisis completo sin modificar archivos
65
+
66
+ Carga obligatoria:
67
+ ```
68
+ Skill("auto-evolucion-protocolo")
69
+ ```
70
+
71
+ El skill define el ciclo completo (Observación > Diagnóstico > Propuesta > Revisión > Aplicación > Verificación > Registro), el formato de propuesta, governance, safety checks y formato de commit evolutivo.
72
+
73
+ Reporta:
74
+ ```
75
+ Modo: [completo | agente específico | skill específico]
76
+ Dry-run: [sí | no]
77
+ Alcance: [descripción]
78
+ ```
79
+
80
+ ## Paso 1 — Recopilación de evidencia
81
+
82
+ Busca y lee:
83
+ 1. **RESUMEN.md y VERIFICACION.md recientes** — extrae iteraciones, errores rechazados, correcciones manuales
84
+ 2. **Historial de commits del sistema** (últimos 90 días en agentes/ habilidades/ comandos/ reglas/) — frecuencia de modificación indica inestabilidad
85
+ 3. **APRENDIZAJES.md de proyectos** — clasifica aprendizajes TIPO B (anti-patrones generales) y TIPO D (mejoras de metodología)
86
+ 4. **Inventario actual** — lista agentes, skills, comandos, reglas. Si hay flag de alcance, lee solo el artefacto indicado
87
+
88
+ ## Paso 2 — Análisis de patrones de fallo
89
+
90
+ Con la evidencia, identifica patrones en 5 categorías:
91
+
92
+ | Categoría | Busca |
93
+ |-----------|-------|
94
+ | E1 — Reglas ignoradas | Agentes que no cargan skills obligatorios, errores recurrentes del verificador |
95
+ | E2 — Skills desactualizados | Reglas que se overridean consistentemente, APIs que cambiaron |
96
+ | E3 — Outputs inconsistentes | Mismo agente produce formatos distintos, instrucciones ambiguas |
97
+ | E4 — Gaps de cobertura | Problemas sin skill, flujos sin agente, comandos faltantes |
98
+ | E5 — Fricción innecesaria | Pasos que siempre se saltan, confirmaciones que siempre se aprueban |
99
+
100
+ ## Paso 3 — Métricas de calidad
101
+
102
+ Para cada agente/skill en el alcance, calcula basándose en la evidencia:
103
+ - Iteraciones promedio para completar tarea
104
+ - Tasa de rechazo del verificador y tipos más frecuentes
105
+ - Frecuencia de modificación (últimos 90d)
106
+ - Score de estabilidad/relevancia (Alto | Medio | Bajo)
107
+
108
+ ## Paso 4 — Generación de propuestas
109
+
110
+ Sigue el formato de propuesta definido en `Skill("auto-evolucion-protocolo")` (PROPUESTA-EVOLUCION-NNN). Para cada patrón identificado, genera una propuesta con: tipo, objetivo, evidencia (2-3 ejemplos concretos), problema, cambio propuesto, impacto esperado, prioridad y esfuerzo.
111
+
112
+ Ordena por prioridad alta + menor esfuerzo primero.
113
+
114
+ ## Paso 5 — Presentación y confirmación
115
+
116
+ Si `--dry-run`: presenta todas las propuestas y termina.
117
+
118
+ Si NO es dry-run: presenta propuestas numeradas y pide confirmación:
119
+ ```
120
+ Identifiqué [N] propuestas de mejora para el sistema SWL:
121
+ [lista numerada con título, tipo y prioridad]
122
+
123
+ ¿Deseas aplicar todas? Escribe: "aplicar todo", "aplicar [números]", o "cancelar [números]"
124
+ ```
125
+
126
+ Espera respuesta. No apliques cambios sin confirmación explícita.
127
+
128
+ ## Paso 6 — Aplicación de cambios aprobados
129
+
130
+ Aplica siguiendo las reglas de governance y safety checks del skill:
131
+ - **Agentes**: usa Edit (no reescribir completo), verifica YAML válido, NUNCA eliminar instrucciones sin evidencia de daño
132
+ - **Skills**: aplica en sección correspondiente, incrementa versión si existe campo version
133
+ - **Nuevas entidades**: usa como template la entidad existente más similar
134
+
135
+ Respeta la governance: PARCHE auto-aplicable, MENOR requiere revisión, MAYOR requiere aprobación humana. Modificar agentes siempre requiere aprobación humana.
136
+
137
+ **OBLIGATORIO — Marcar como evolucionado** con el subcomando del CLI (resuelve
138
+ cross-scope; ver `docs/invocacion-cli-cross-scope.md`):
139
+
140
+ ```bash
141
+ swl-ses mark-evolved "[RUTA_ARCHIVO_MODIFICADO]" \
142
+ --by=evolucionar \
143
+ --note="[descripción breve del cambio]"
144
+ # fallback: npx -y @saulwade/swl-ses@latest mark-evolved "[RUTA]" --by=evolucionar --note="..."
145
+ ```
146
+
147
+ Reemplazar los placeholders entre corchetes con los valores reales.
148
+ Si el comando Bash no está disponible, agregar manualmente en el frontmatter:
149
+
150
+ ```yaml
151
+ evolved: true
152
+ evolved-from: "[versión actual del sistema, ej: 5.1.3]"
153
+ evolved-at: "[fecha YYYY-MM-DD]"
154
+ evolved-by: "evolucionar"
155
+ evolved-note: "[descripción breve del cambio]"
156
+ ```
157
+
158
+ Para archivos sin frontmatter (reglas), el comando Bash crea automáticamente un archivo sidecar `.evolved.json`.
159
+
160
+ **SIN ESTE MARCADO, LOS CAMBIOS DE EVOLUCIÓN SE PERDERÁN EN LA PRÓXIMA ACTUALIZACIÓN.**
161
+
162
+ ## Paso 6.5 — Gate de regresión con evals (OBLIGATORIO si hay evals)
163
+
164
+ Antes de dar por aplicado cualquier cambio, ejecutar el gate de regresión para
165
+ garantizar que la evolución no degradó el skill/agente:
166
+
167
+ ### 6.5.1 — Verificar si existe archivo de evals
168
+
169
+ ```bash
170
+ npx -y @saulwade/swl-ses@latest run-skill-evals <nombre> --list 2>/dev/null | grep "<nombre>"
171
+ ```
172
+
173
+ Si NO hay evals: saltar este paso y registrar en CHANGELOG:
174
+ `"evolución sin gate de regresión — evals no disponibles para <nombre>"`.
175
+ Sugerir al usuario crear evals siguiendo `plantillas/skill-evals-template.json`.
176
+
177
+ Si SÍ hay evals: ejecutar el gate completo (6.5.2 a 6.5.5).
178
+
179
+ ### 6.5.2 — Registrar baseline (ANTES de aplicar el cambio)
180
+
181
+ Cargar el skill/agente ORIGINAL (antes del patch) y ejecutar cada eval contra
182
+ el modelo con el contenido actual cargado. Contar aciertos.
183
+
184
+ ```
185
+ score_baseline = (evals_pass / evals_total) * 100 × factor_peso
186
+ ```
187
+
188
+ Registrar:
189
+
190
+ ```bash
191
+ npx -y @saulwade/swl-ses@latest run-skill-evals <nombre> --record-baseline --score=<N>
192
+ ```
193
+
194
+ ### 6.5.3 — Aplicar el cambio (lo que ya hacía el Paso 6)
195
+
196
+ ### 6.5.4 — Re-ejecutar evals contra la versión nueva
197
+
198
+ Cargar el skill/agente MODIFICADO y ejecutar cada eval del mismo archivo.
199
+
200
+ ```
201
+ score_after = (evals_pass / evals_total) * 100 × factor_peso
202
+ ```
203
+
204
+ ### 6.5.5 — Decisión
205
+
206
+ | Condición | Acción |
207
+ |---|---|
208
+ | `score_after >= score_baseline` | **Aceptar** — `npx -y @saulwade/swl-ses@latest run-skill-evals <nombre> --record-after --score=<N>` |
209
+ | `score_after < score_baseline - 5` | **Revertir** — restaurar el archivo anterior + `--record-revert --score=<N>` |
210
+ | `score_baseline - 5 <= score_after < score_baseline` | **Requiere revisión humana** — reportar diferencia; usuario decide si acepta la regresión menor o revierte |
211
+
212
+ Los 3 casos registran evento en `.planning/evolution/evoluciones.jsonl` para el
213
+ dashboard `/swl:status evolucion`.
214
+
215
+ ### Regla de oro
216
+
217
+ Un skill no se evoluciona si no se puede medir. Si vas a modificar un skill
218
+ sin evals, primero crea los evals (mínimo 3: uno primary-flow, uno edge-case,
219
+ uno anti-pattern). Sin baseline, cualquier cambio es una apuesta.
220
+
221
+ ## Paso 7 — Versionado y commit
222
+
223
+ Incrementa versión del sistema según magnitud:
224
+ - Solo reglas/docs de skills: PATCH
225
+ - Nuevas reglas, anti-patrones, flujos: MINOR
226
+ - Nuevos agentes, comandos, refactorización de flujo: MAJOR
227
+
228
+ Commit con formato evolutivo del skill:
229
+ ```
230
+ evolve(swl): [descripción concisa]
231
+ ```
232
+
233
+ ## Paso 8 — CHANGELOG y reporte final
234
+
235
+ Actualiza CHANGELOG.md con: propósito de la evolución, agentes/skills modificados, métricas antes, impacto esperado.
236
+
237
+ ```
238
+ === Evolución del sistema SWL completada ===
239
+
240
+ Propuestas analizadas: [N] | Aplicadas: [N] | Diferidas: [N]
241
+ Agentes modificados: [N] | Skills modificados: [N]
242
+ Versión: [anterior] → [nueva]
243
+
244
+ Próxima evolución recomendada: después de [N] proyectos o [fecha]
245
+ ```
246
+
247
+ ### Cierre del ciclo de nudges (obligatorio si este comando fue disparado por un nudge)
248
+
249
+ Si esta evolución atendió un nudge de `etapa-auto-evolucion.js` / drift
250
+ (visible en el briefing o en `evolution/nudges.jsonl`), márcalo como
251
+ accionado es lo que permite al sistema distinguir sugerencias atendidas
252
+ de ruido acumulado:
253
+
254
+ ```bash
255
+ swl-ses nudge-accionar <id-del-nudge> --por evolucionar
256
+ ```
257
+
258
+ Si la evolución fue manual (sin nudge), omite este cierre.
259
+
260
+ ## Reglas de comportamiento
261
+
262
+ - NUNCA apliques cambios sin evidencia concreta. "Parece que sería mejor" no es evidencia.
263
+ - NUNCA elimines instrucciones de agentes basándote solo en que parecen redundantes.
264
+ - En `--dry-run`, el reporte debe ser completo y accionable.
265
+ - Si la evidencia contradice una regla, documenta la contradicción en CHANGELOG antes de cambiar.
266
+ - Prioriza cambios con mayor impacto en iteraciones reducidas.
267
+ - Si no hay evidencia suficiente, reporta exactamente eso y sugiere qué ejecutar para generarla.