@saulwade/swl-ses 2.5.2 → 2.6.0
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/CLAUDE.md +194 -192
- package/README.md +600 -600
- package/agentes/auto-evolucion-swl.md +27 -3
- package/bin/swl-ses.js +32 -6
- package/comandos/swl/actualizar.md +174 -174
- package/comandos/swl/adoptar-proyecto.md +265 -265
- package/comandos/swl/aprender.md +836 -823
- package/comandos/swl/aprobar-plan.md +146 -146
- package/comandos/swl/auditar-deps.md +134 -134
- package/comandos/swl/autoresearch.md +264 -264
- package/comandos/swl/ayuda.md +224 -224
- package/comandos/swl/brainstorm.md +51 -51
- package/comandos/swl/briefing.md +119 -119
- package/comandos/swl/checkpoint.md +325 -325
- package/comandos/swl/claudemd.md +234 -234
- package/comandos/swl/compactar.md +310 -310
- package/comandos/swl/configurar-ci.md +235 -235
- package/comandos/swl/contexto.md +110 -110
- package/comandos/swl/contribuir.md +233 -233
- package/comandos/swl/crear-skill.md +292 -292
- package/comandos/swl/cron.md +194 -194
- package/comandos/swl/deuda-codigo.md +97 -97
- package/comandos/swl/discutir-fase.md +169 -169
- package/comandos/swl/ejecutar-fase.md +233 -233
- package/comandos/swl/evaluar-skill.md +520 -505
- package/comandos/swl/evolucion-continua.md +73 -0
- package/comandos/swl/evolucionar.md +267 -254
- package/comandos/swl/exportar-vault.md +583 -583
- package/comandos/swl/fix.md +118 -118
- package/comandos/swl/gateway.md +158 -158
- package/comandos/swl/inbox.md +116 -116
- package/comandos/swl/instalar.md +220 -220
- package/comandos/swl/instintos.md +86 -86
- package/comandos/swl/mapear-codebase.md +312 -312
- package/comandos/swl/mcp-status.md +175 -175
- package/comandos/swl/modelo.md +100 -100
- package/comandos/swl/nemesis.md +433 -433
- package/comandos/swl/notificaciones.md +299 -299
- package/comandos/swl/nuevo-proyecto.md +251 -251
- package/comandos/swl/planear-fase.md +263 -263
- package/comandos/swl/plugins.md +256 -256
- package/comandos/swl/predecir.md +169 -169
- package/comandos/swl/reflect-skills.md +125 -125
- package/comandos/swl/release.md +450 -450
- package/comandos/swl/revisar-impacto.md +201 -201
- package/comandos/swl/revisar.md +330 -330
- package/comandos/swl/seguridad.md +189 -189
- package/comandos/swl/sesiones.md +200 -200
- package/comandos/swl/skill-search.md +113 -113
- package/comandos/swl/status.md +343 -343
- package/comandos/swl/verificar.md +817 -817
- package/comandos/swl/wiki.md +620 -620
- package/gateway/cron/jobs.example.json +12 -0
- package/habilidades/auto-evolucion-protocolo/SKILL.md +294 -276
- package/habilidades/autoresearch/SKILL.md +3 -2
- package/habilidades/benchmark-memoria/SKILL.md +7 -7
- package/habilidades/changelog-generator/SKILL.md +174 -174
- package/habilidades/changelog-generator/scripts/parse-commits.js +2 -1
- package/habilidades/checkpoints-verificacion/SKILL.md +6 -0
- package/habilidades/context-builder/SKILL.md +4 -0
- package/habilidades/doubt-driven-review/SKILL.md +207 -191
- package/habilidades/drift-detection/SKILL.md +6 -1
- package/habilidades/ejecutar-fase/SKILL.md +6 -6
- package/habilidades/eval-framework/SKILL.md +8 -3
- package/habilidades/harness-claude-code/SKILL.md +314 -308
- package/habilidades/infra-github-actions/SKILL.md +4 -3
- package/habilidades/instalar-sistema/SKILL.md +227 -223
- package/habilidades/memoria-busqueda/SKILL.md +31 -39
- package/habilidades/planear-fase/SKILL.md +358 -350
- package/habilidades/proceso-ddia-fundamentos/SKILL.md +3 -2
- package/habilidades/release-semver/SKILL.md +4 -2
- package/habilidades/swl-claudemd/SKILL.md +6 -7
- package/habilidades/swl-dashboard/SKILL.md +11 -43
- package/habilidades/tdd-workflow/SKILL.md +749 -744
- package/habilidades/validacion-ci-sistema/SKILL.md +1 -1
- package/hooks/agente-lifecycle.js +2 -1
- package/hooks/aiisms-detector.js +13 -4
- package/hooks/audit-trail.js +2 -1
- package/hooks/auto-consolidacion.js +2 -1
- package/hooks/captura-acciones-post.js +2 -1
- package/hooks/captura-acciones-session.js +2 -1
- package/hooks/captura-feedback-usuario.js +3 -2
- package/hooks/claudemd-bloat-detector.js +12 -3
- package/hooks/claudemd-duplicacion-detector.js +13 -3
- package/hooks/contexto-iteracion.js +2 -1
- package/hooks/degradacion-instintos.js +2 -1
- package/hooks/extraccion-aprendizajes.js +109 -15
- package/hooks/grafo-contexto.js +2 -1
- package/hooks/guardrail-modelo.js +2 -1
- package/hooks/inbox-aviso.js +2 -1
- package/hooks/inyeccion-contexto.js +2 -1
- package/hooks/lib/agent-matcher.js +2 -1
- package/hooks/lib/agent-routing.js +2 -1
- package/hooks/lib/autonomia.js +5 -3
- package/hooks/lib/captura-acciones.js +2 -1
- package/hooks/lib/consolidation-lock.js +21 -10
- package/hooks/lib/etapa-auto-evolucion.js +10 -4
- package/hooks/lib/etapa-metricas.js +2 -1
- package/hooks/lib/etapa-perfil-usuario.js +20 -4
- package/hooks/lib/evolution-tracker.js +2 -1
- package/hooks/lib/gateway-notify.js +193 -179
- package/hooks/lib/loop-telemetry.js +5 -4
- package/hooks/lib/mcp-health.js +2 -1
- package/hooks/lib/memory-search.js +4 -0
- package/hooks/lib/merkle-audit.js +58 -6
- package/hooks/lib/nudge-tracker.js +2 -1
- package/hooks/lib/otlp-exporter.js +2 -1
- package/hooks/lib/propose-step.js +3 -2
- package/hooks/lib/raiz-proyecto.js +102 -0
- package/hooks/lib/run-log.js +2 -1
- package/hooks/lib/singleton-guard.js +218 -27
- package/hooks/lib/telegram-cliente.js +17 -8
- package/hooks/preservar-estado-pre-compact.js +2 -1
- package/hooks/proteccion-rutas.js +59 -3
- package/hooks/registro-turnos.js +2 -1
- package/hooks/resumen-sesion.js +2 -1
- package/hooks/risk-scoring.js +2 -1
- package/hooks/rotar-audit-auto.js +46 -20
- package/hooks/session-briefing.js +127 -1
- package/hooks/spec-gate.js +2 -1
- package/hooks/sugerir-contribuir.js +6 -3
- package/hooks/sugerir-regenerar-inventario.js +3 -2
- package/hooks/tdd-gate.js +2 -1
- package/hooks/telemetria-agentes.js +2 -1
- package/hooks/telemetria-skill-routing.js +2 -1
- package/hooks/tracking-costos.js +4 -3
- package/hooks/validar-formato-post-subagente.js +2 -1
- package/hooks/validar-intent-spec.js +2 -1
- package/hooks/validar-memoria-hook.js +13 -3
- package/hooks/validar-planning-paths.js +2 -1
- package/instintos/.backups/perfil-usuario.yaml.2026-07-10-165128.bak +53 -0
- package/instintos/.backups/proyecto.yaml.2026-07-10-165128.bak +372 -0
- package/instintos/perfil-usuario.yaml +506 -3
- package/instintos/proyecto.yaml +78 -0
- package/llms.txt +2 -2
- package/manifiestos/canonical-hashes.json +664 -2
- package/manifiestos/modulos.json +19 -14
- package/manifiestos/planning-paths.json +1 -0
- package/manifiestos/skills-lock.json +53 -53
- package/package.json +2 -3
- package/plugin.json +2 -2
- package/scripts/actualizar.js +3 -0
- package/scripts/auditar-clases-conocidas.js +32 -4
- package/scripts/benchmark-memoria.js +1 -0
- package/scripts/cli/autonomia.js +23 -0
- package/scripts/cli/benchmark-memoria.js +37 -0
- package/scripts/cli/ciclo-autonomo.js +73 -0
- package/scripts/cli/ciclo-fase-b.js +102 -0
- package/scripts/cli/guardrail-metrics.js +39 -0
- package/scripts/cli/loop-telemetry.js +4 -2
- package/scripts/cli/memoria-search.js +69 -0
- package/scripts/cli/nudge-accionar.js +39 -0
- package/scripts/cli/run-eval.js +38 -0
- package/scripts/cli/run-skill-evals.js +13 -2
- package/scripts/derivar-feature-list.js +15 -14
- package/scripts/desinstalar.js +11 -0
- package/scripts/doctor.js +24 -10
- package/scripts/instalador.js +106 -7
- package/scripts/lib/activar-hooks-proyecto.js +116 -0
- package/scripts/lib/auditar-invocaciones-comandos.js +96 -6
- package/scripts/lib/ciclo-autonomo/candidatos.js +174 -0
- package/scripts/lib/ciclo-autonomo/config.js +165 -0
- package/scripts/lib/ciclo-autonomo/drenador-feedback.js +174 -0
- package/scripts/lib/ciclo-autonomo/fallback.js +77 -0
- package/scripts/lib/ciclo-autonomo/guard-convivencia.js +139 -0
- package/scripts/lib/ciclo-autonomo/higiene-nudges.js +112 -0
- package/scripts/lib/ciclo-autonomo/index.js +301 -0
- package/scripts/lib/ciclo-autonomo/lock.js +124 -0
- package/scripts/lib/ciclo-autonomo/presupuesto.js +122 -0
- package/scripts/lib/ciclo-autonomo/puente-degradacion.js +240 -0
- package/scripts/lib/ciclo-autonomo/runner-fase-b.js +248 -0
- package/scripts/lib/ciclo-autonomo/writer-instintos.js +190 -0
- package/scripts/lib/ciclo-autonomo/yaml-instintos.js +535 -0
- package/scripts/lib/estado.js +9 -0
- package/scripts/lib/evidencia-valor.js +1 -1
- package/scripts/lib/gitignore-manifest.js +8 -1
- package/scripts/lib/hooks-settings.js +45 -0
- package/scripts/rotar-audit-logs.js +48 -2
- package/scripts/run-eval.js +1 -0
- package/scripts/run-skill-evals.js +287 -8
- package/scripts/smoke-test.js +16 -8
- package/scripts/tui/pantallas/install-wizard.js +403 -347
- package/scripts/validar.js +40 -1
|
@@ -0,0 +1,73 @@
|
|
|
1
|
+
---
|
|
2
|
+
name: swl:evolucion-continua
|
|
3
|
+
description: Enciende, apaga o consulta el motor determinista de aprendizaje del ciclo autónomo (ADR-0041). Con on, el proyecto aprende solo — decay y promoción de instintos, drenaje de feedback al perfil, puente de degradación e higiene de nudges — vía cron nocturno o fallback de session-briefing (cada ≥24h). Subcomandos on | off | status. Nace encendido (opt-out): off/SWL_CICLO_AUTONOMO=0 son el kill-switch sagrado.
|
|
4
|
+
allowed_tools: ["Bash", "Read"]
|
|
5
|
+
---
|
|
6
|
+
|
|
7
|
+
# /swl:evolucion-continua — Motor determinista de aprendizaje (on|off|status)
|
|
8
|
+
|
|
9
|
+
Eres el operador del motor determinista del ciclo autónomo (Nivel 0,
|
|
10
|
+
ADR-0041). Este comando es la cara de usuario del subcomando CLI
|
|
11
|
+
`swl-ses ciclo-autonomo`: NO implementa lógica propia — delega en el CLI
|
|
12
|
+
(invocación cross-scope, regla `validar.js §7b`).
|
|
13
|
+
|
|
14
|
+
## Qué hace el motor cuando está encendido
|
|
15
|
+
|
|
16
|
+
Cada corrida de la Fase A (Node puro, sin LLM, <2s, $0):
|
|
17
|
+
|
|
18
|
+
1. **Writer de instintos** — aplica decay, promueve drafts maduros
|
|
19
|
+
(confidence ≥0.5 + evidencia ≥3), degrada por feedback dañino y archiva
|
|
20
|
+
instintos muertos en `instintos/proyecto.yaml` (con backup previo).
|
|
21
|
+
2. **Puente de degradación** — un aprendizaje `[DEGRADADO]` en
|
|
22
|
+
APRENDIZAJES.md baja la confidence del instinto derivado.
|
|
23
|
+
3. **Drenador de feedback** — consolida las señales de
|
|
24
|
+
`evolution/feedback-queue.jsonl` (≤90 días) como drafts en
|
|
25
|
+
`instintos/perfil-usuario.yaml`; lo más viejo se archiva sin procesar.
|
|
26
|
+
4. **Higiene de nudges** — marca atendidos los que el ciclo consume y
|
|
27
|
+
archiva los >90 días sin accionar.
|
|
28
|
+
|
|
29
|
+
Todo queda registrado en `evolution/ciclo-autonomo.jsonl` con
|
|
30
|
+
`origen: ciclo-autonomo`. Corridas sin señales son no-op sin escrituras.
|
|
31
|
+
|
|
32
|
+
## Uso
|
|
33
|
+
|
|
34
|
+
```
|
|
35
|
+
/swl:evolucion-continua on # habilita el motor en este proyecto
|
|
36
|
+
/swl:evolucion-continua off # lo apaga (kill-switch)
|
|
37
|
+
/swl:evolucion-continua status # last_run + conteos de la última corrida
|
|
38
|
+
```
|
|
39
|
+
|
|
40
|
+
## Ejecución
|
|
41
|
+
|
|
42
|
+
Resuelve el CLI con el patrón cross-scope (repo madre → bin en PATH → npx):
|
|
43
|
+
|
|
44
|
+
```bash
|
|
45
|
+
# on | off | status según el argumento recibido
|
|
46
|
+
swl-ses ciclo-autonomo <accion>
|
|
47
|
+
```
|
|
48
|
+
|
|
49
|
+
Sin binario en PATH: `npx -y @saulwade/swl-ses@latest ciclo-autonomo <accion>`.
|
|
50
|
+
|
|
51
|
+
Tras `on`, informa al usuario los dos disparadores disponibles:
|
|
52
|
+
|
|
53
|
+
1. **Cron del gateway** (si usa `/swl:cron`): job de ejemplo en
|
|
54
|
+
`gateway/cron/jobs.example.json` (nocturno, `0 3 * * *`).
|
|
55
|
+
2. **Fallback automático de session-briefing**: sin cron, la Fase A se
|
|
56
|
+
dispara sola al iniciar sesión cuando pasaron ≥24h de la última corrida
|
|
57
|
+
(fire-and-forget; el lock evita corridas dobles).
|
|
58
|
+
|
|
59
|
+
Una corrida manual siempre es posible: `swl-ses ciclo-autonomo`.
|
|
60
|
+
|
|
61
|
+
## Reglas de comportamiento
|
|
62
|
+
|
|
63
|
+
- El motor **nace ENCENDIDO** (opt-out estricto, decisión del usuario
|
|
64
|
+
2026-07-10): en proyectos sin señales la corrida es no-op inofensiva.
|
|
65
|
+
`off` y `SWL_CICLO_AUTONOMO=0` (docs/variables-entorno.md) son el
|
|
66
|
+
kill-switch — el off es sagrado: cero corridas, cero escrituras.
|
|
67
|
+
- Este comando NO corre la Fase B con LLM (Fases 22+ del ADR-0042) — el
|
|
68
|
+
campo `credencial` del config existe pero aquí no se consume.
|
|
69
|
+
- Si `status` reporta corridas con `errores`, sugiere revisar
|
|
70
|
+
`evolution/ciclo-autonomo.jsonl` y los backups en `instintos/.backups/`.
|
|
71
|
+
- La primera corrida sobre un proyecto con señales acumuladas puede mover
|
|
72
|
+
mucho (bootstrap con ventana de 90 días): recomienda revisar el diff de
|
|
73
|
+
`instintos/*.yaml` antes de commitear.
|
|
@@ -1,254 +1,267 @@
|
|
|
1
|
-
---
|
|
2
|
-
name: swl:evolucionar
|
|
3
|
-
description: Activa el protocolo de auto-evolución del sistema SWL. Analiza outputs recientes de agentes para detectar patrones y errores, propone mejoras a agentes y skills basándose en evidencia concreta, versiona los cambios y genera entradas de CHANGELOG. Flags disponibles: --agente=[nombre], --skill=[nombre], --dry-run.
|
|
4
|
-
allowed_tools: ["Read", "Write", "Edit", "Bash", "Glob", "Grep"]
|
|
5
|
-
---
|
|
6
|
-
|
|
7
|
-
# /swl:evolucionar — Protocolo de auto-evolución del sistema SWL
|
|
8
|
-
|
|
9
|
-
Eres el motor de evolución del sistema SWL. Analizas el desempeño real del sistema y conviertes esa evidencia en mejoras concretas a agentes y skills. Un sistema que no evoluciona acumula deuda metodológica.
|
|
10
|
-
|
|
11
|
-
Este comando es distinto a `swl:aprender`: donde `aprender` extrae conocimiento de un proyecto específico, `evolucionar` mejora el propio sistema SWL a partir de su historial de ejecución.
|
|
12
|
-
|
|
13
|
-
## Relación con otros canales de aprendizaje
|
|
14
|
-
|
|
15
|
-
SWL tiene **tres canales independientes** de aprendizaje. Son complementarios, no solapados:
|
|
16
|
-
|
|
17
|
-
| Canal | Produce | Disparadores | Escribe en |
|
|
18
|
-
|-------|---------|--------------|------------|
|
|
19
|
-
| `/swl:aprender` | Conocimiento del dominio (anti-patrones, patrones, gotchas, decisiones) | Manual o nudge de `auto-consolidacion.js` (≥24h + ≥5 sesiones) | `APRENDIZAJES.md`, skills, `CLAUDE.md` |
|
|
20
|
-
| `/swl:evolucionar` *(este comando)* | Mejoras al sistema SWL (versionado de agentes/skills, patches, splits, deprecaciones) | Manual o nudge de `auto-evolucion.js` (≥3 fallos o ≥10 runs/14d de un agente) | `agentes/*.md`, `habilidades/*/SKILL.md`, CHANGELOG |
|
|
21
|
-
| Agente `perfilador-usuario-swl` | Modelo del usuario (rol, stack preferido, correcciones repetidas, preferencias de comunicación) | Manual o nudge de `actualizar-perfil-usuario.js` (≥3 señales acumuladas) | `instintos/perfil-usuario.yaml` |
|
|
22
|
-
|
|
23
|
-
### Cómo se coordinan
|
|
24
|
-
|
|
25
|
-
- **Evolución + perfil**: el parser de fricción (`auto-evolucion-protocolo` v1.1) cruza el log
|
|
26
|
-
`.planning/auto-evolution/agentes.jsonl` con las señales de corrección del usuario
|
|
27
|
-
para priorizar agentes cuyos runs coincidieron con correcciones. Ver tabla
|
|
28
|
-
"Categorías de fricción" en el skill.
|
|
29
|
-
- **Evolución + aprendizajes**: antes de modificar un skill, leer `APRENDIZAJES.md`
|
|
30
|
-
para detectar si el gap ya fue observado y documentado — la "Repetición de error"
|
|
31
|
-
es una categoría de fricción fuerte.
|
|
32
|
-
- **Aprender + perfil**: los aprendizajes tipo **D** (mejora de metodología) pueden
|
|
33
|
-
reforzar entradas del perfil si tocan preferencias de colaboración, pero la
|
|
34
|
-
escritura al perfil sigue siendo responsabilidad exclusiva del agente
|
|
35
|
-
`perfilador-usuario-swl` para centralizar privacidad (`Skill("privacy-memoria")`).
|
|
36
|
-
|
|
37
|
-
**Regla**: nunca escribas a dos canales desde el mismo comando. Si `/swl:evolucionar`
|
|
38
|
-
detecta que el usuario corrige al agente por una preferencia personal (no un bug
|
|
39
|
-
del agente), registra la señal para el perfilador y **no** incorpores la preferencia
|
|
40
|
-
al agente mismo — el agente debe leer el perfil, no duplicarlo.
|
|
41
|
-
|
|
42
|
-
## Cuándo usar este comando
|
|
43
|
-
|
|
44
|
-
- Después de completar múltiples proyectos y detectar patrones de fallo recurrentes
|
|
45
|
-
- Cuando el verificador reporta consistentemente los mismos tipos de errores
|
|
46
|
-
- Cuando un agente genera outputs que regularmente requieren corrección manual
|
|
47
|
-
- Cuando un skill tiene reglas que los desarrolladores ignoran o causan confusión
|
|
48
|
-
- Periódicamente (recomendado: al inicio de cada sprint o ciclo de desarrollo)
|
|
49
|
-
|
|
50
|
-
## Flags soportados
|
|
51
|
-
|
|
52
|
-
```
|
|
53
|
-
--agente=[nombre] Evolucionar solo el agente especificado
|
|
54
|
-
--skill=[nombre] Evolucionar solo el skill especificado
|
|
55
|
-
--dry-run Mostrar propuestas sin aplicar cambios
|
|
56
|
-
```
|
|
57
|
-
|
|
58
|
-
## Paso 0 — Parseo de flags y carga de habilidades
|
|
59
|
-
|
|
60
|
-
Lee los flags del comando. Determina el alcance:
|
|
61
|
-
- Sin flags: evolución completa del sistema
|
|
62
|
-
- `--agente=[nombre]`: solo el agente indicado
|
|
63
|
-
- `--skill=[nombre]`: solo el skill indicado
|
|
64
|
-
- `--dry-run`: análisis completo sin modificar archivos
|
|
65
|
-
|
|
66
|
-
Carga obligatoria:
|
|
67
|
-
```
|
|
68
|
-
Skill("auto-evolucion-protocolo")
|
|
69
|
-
```
|
|
70
|
-
|
|
71
|
-
El skill define el ciclo completo (Observación > Diagnóstico > Propuesta > Revisión > Aplicación > Verificación > Registro), el formato de propuesta, governance, safety checks y formato de commit evolutivo.
|
|
72
|
-
|
|
73
|
-
Reporta:
|
|
74
|
-
```
|
|
75
|
-
Modo: [completo | agente específico | skill específico]
|
|
76
|
-
Dry-run: [sí | no]
|
|
77
|
-
Alcance: [descripción]
|
|
78
|
-
```
|
|
79
|
-
|
|
80
|
-
## Paso 1 — Recopilación de evidencia
|
|
81
|
-
|
|
82
|
-
Busca y lee:
|
|
83
|
-
1. **RESUMEN.md y VERIFICACION.md recientes** — extrae iteraciones, errores rechazados, correcciones manuales
|
|
84
|
-
2. **Historial de commits del sistema** (últimos 90 días en agentes/ habilidades/ comandos/ reglas/) — frecuencia de modificación indica inestabilidad
|
|
85
|
-
3. **APRENDIZAJES.md de proyectos** — clasifica aprendizajes TIPO B (anti-patrones generales) y TIPO D (mejoras de metodología)
|
|
86
|
-
4. **Inventario actual** — lista agentes, skills, comandos, reglas. Si hay flag de alcance, lee solo el artefacto indicado
|
|
87
|
-
|
|
88
|
-
## Paso 2 — Análisis de patrones de fallo
|
|
89
|
-
|
|
90
|
-
Con la evidencia, identifica patrones en 5 categorías:
|
|
91
|
-
|
|
92
|
-
| Categoría | Busca |
|
|
93
|
-
|-----------|-------|
|
|
94
|
-
| E1 — Reglas ignoradas | Agentes que no cargan skills obligatorios, errores recurrentes del verificador |
|
|
95
|
-
| E2 — Skills desactualizados | Reglas que se overridean consistentemente, APIs que cambiaron |
|
|
96
|
-
| E3 — Outputs inconsistentes | Mismo agente produce formatos distintos, instrucciones ambiguas |
|
|
97
|
-
| E4 — Gaps de cobertura | Problemas sin skill, flujos sin agente, comandos faltantes |
|
|
98
|
-
| E5 — Fricción innecesaria | Pasos que siempre se saltan, confirmaciones que siempre se aprueban |
|
|
99
|
-
|
|
100
|
-
## Paso 3 — Métricas de calidad
|
|
101
|
-
|
|
102
|
-
Para cada agente/skill en el alcance, calcula basándose en la evidencia:
|
|
103
|
-
- Iteraciones promedio para completar tarea
|
|
104
|
-
- Tasa de rechazo del verificador y tipos más frecuentes
|
|
105
|
-
- Frecuencia de modificación (últimos 90d)
|
|
106
|
-
- Score de estabilidad/relevancia (Alto | Medio | Bajo)
|
|
107
|
-
|
|
108
|
-
## Paso 4 — Generación de propuestas
|
|
109
|
-
|
|
110
|
-
Sigue el formato de propuesta definido en `Skill("auto-evolucion-protocolo")` (PROPUESTA-EVOLUCION-NNN). Para cada patrón identificado, genera una propuesta con: tipo, objetivo, evidencia (2-3 ejemplos concretos), problema, cambio propuesto, impacto esperado, prioridad y esfuerzo.
|
|
111
|
-
|
|
112
|
-
Ordena por prioridad alta + menor esfuerzo primero.
|
|
113
|
-
|
|
114
|
-
## Paso 5 — Presentación y confirmación
|
|
115
|
-
|
|
116
|
-
Si `--dry-run`: presenta todas las propuestas y termina.
|
|
117
|
-
|
|
118
|
-
Si NO es dry-run: presenta propuestas numeradas y pide confirmación:
|
|
119
|
-
```
|
|
120
|
-
Identifiqué [N] propuestas de mejora para el sistema SWL:
|
|
121
|
-
[lista numerada con título, tipo y prioridad]
|
|
122
|
-
|
|
123
|
-
¿Deseas aplicar todas? Escribe: "aplicar todo", "aplicar [números]", o "cancelar [números]"
|
|
124
|
-
```
|
|
125
|
-
|
|
126
|
-
Espera respuesta. No apliques cambios sin confirmación explícita.
|
|
127
|
-
|
|
128
|
-
## Paso 6 — Aplicación de cambios aprobados
|
|
129
|
-
|
|
130
|
-
Aplica siguiendo las reglas de governance y safety checks del skill:
|
|
131
|
-
- **Agentes**: usa Edit (no reescribir completo), verifica YAML válido, NUNCA eliminar instrucciones sin evidencia de daño
|
|
132
|
-
- **Skills**: aplica en sección correspondiente, incrementa versión si existe campo version
|
|
133
|
-
- **Nuevas entidades**: usa como template la entidad existente más similar
|
|
134
|
-
|
|
135
|
-
Respeta la governance: PARCHE auto-aplicable, MENOR requiere revisión, MAYOR requiere aprobación humana. Modificar agentes siempre requiere aprobación humana.
|
|
136
|
-
|
|
137
|
-
**OBLIGATORIO — Marcar como evolucionado** con el subcomando del CLI (resuelve
|
|
138
|
-
cross-scope; ver `docs/invocacion-cli-cross-scope.md`):
|
|
139
|
-
|
|
140
|
-
```bash
|
|
141
|
-
swl-ses mark-evolved "[RUTA_ARCHIVO_MODIFICADO]" \
|
|
142
|
-
--by=evolucionar \
|
|
143
|
-
--note="[descripción breve del cambio]"
|
|
144
|
-
# fallback: npx -y @saulwade/swl-ses@latest mark-evolved "[RUTA]" --by=evolucionar --note="..."
|
|
145
|
-
```
|
|
146
|
-
|
|
147
|
-
Reemplazar los placeholders entre corchetes con los valores reales.
|
|
148
|
-
Si el comando Bash no está disponible, agregar manualmente en el frontmatter:
|
|
149
|
-
|
|
150
|
-
```yaml
|
|
151
|
-
evolved: true
|
|
152
|
-
evolved-from: "[versión actual del sistema, ej: 5.1.3]"
|
|
153
|
-
evolved-at: "[fecha YYYY-MM-DD]"
|
|
154
|
-
evolved-by: "evolucionar"
|
|
155
|
-
evolved-note: "[descripción breve del cambio]"
|
|
156
|
-
```
|
|
157
|
-
|
|
158
|
-
Para archivos sin frontmatter (reglas), el comando Bash crea automáticamente un archivo sidecar `.evolved.json`.
|
|
159
|
-
|
|
160
|
-
**SIN ESTE MARCADO, LOS CAMBIOS DE EVOLUCIÓN SE PERDERÁN EN LA PRÓXIMA ACTUALIZACIÓN.**
|
|
161
|
-
|
|
162
|
-
## Paso 6.5 — Gate de regresión con evals (OBLIGATORIO si hay evals)
|
|
163
|
-
|
|
164
|
-
Antes de dar por aplicado cualquier cambio, ejecutar el gate de regresión para
|
|
165
|
-
garantizar que la evolución no degradó el skill/agente:
|
|
166
|
-
|
|
167
|
-
### 6.5.1 — Verificar si existe archivo de evals
|
|
168
|
-
|
|
169
|
-
```bash
|
|
170
|
-
npx -y @saulwade/swl-ses@latest run-skill-evals <nombre> --list 2>/dev/null | grep "<nombre>"
|
|
171
|
-
```
|
|
172
|
-
|
|
173
|
-
Si NO hay evals: saltar este paso y registrar en CHANGELOG:
|
|
174
|
-
`"evolución sin gate de regresión — evals no disponibles para <nombre>"`.
|
|
175
|
-
Sugerir al usuario crear evals siguiendo `plantillas/skill-evals-template.json`.
|
|
176
|
-
|
|
177
|
-
Si SÍ hay evals: ejecutar el gate completo (6.5.2 a 6.5.5).
|
|
178
|
-
|
|
179
|
-
### 6.5.2 — Registrar baseline (ANTES de aplicar el cambio)
|
|
180
|
-
|
|
181
|
-
Cargar el skill/agente ORIGINAL (antes del patch) y ejecutar cada eval contra
|
|
182
|
-
el modelo con el contenido actual cargado. Contar aciertos.
|
|
183
|
-
|
|
184
|
-
```
|
|
185
|
-
score_baseline = (evals_pass / evals_total) * 100 × factor_peso
|
|
186
|
-
```
|
|
187
|
-
|
|
188
|
-
Registrar:
|
|
189
|
-
|
|
190
|
-
```bash
|
|
191
|
-
npx -y @saulwade/swl-ses@latest run-skill-evals <nombre> --record-baseline --score=<N>
|
|
192
|
-
```
|
|
193
|
-
|
|
194
|
-
### 6.5.3 — Aplicar el cambio (lo que ya hacía el Paso 6)
|
|
195
|
-
|
|
196
|
-
### 6.5.4 — Re-ejecutar evals contra la versión nueva
|
|
197
|
-
|
|
198
|
-
Cargar el skill/agente MODIFICADO y ejecutar cada eval del mismo archivo.
|
|
199
|
-
|
|
200
|
-
```
|
|
201
|
-
score_after = (evals_pass / evals_total) * 100 × factor_peso
|
|
202
|
-
```
|
|
203
|
-
|
|
204
|
-
### 6.5.5 — Decisión
|
|
205
|
-
|
|
206
|
-
| Condición | Acción |
|
|
207
|
-
|---|---|
|
|
208
|
-
| `score_after >= score_baseline` | **Aceptar** — `npx -y @saulwade/swl-ses@latest run-skill-evals <nombre> --record-after --score=<N>` |
|
|
209
|
-
| `score_after < score_baseline - 5` | **Revertir** — restaurar el archivo anterior + `--record-revert --score=<N>` |
|
|
210
|
-
| `score_baseline - 5 <= score_after < score_baseline` | **Requiere revisión humana** — reportar diferencia; usuario decide si acepta la regresión menor o revierte |
|
|
211
|
-
|
|
212
|
-
Los 3 casos registran evento en `.planning/evolution/evoluciones.jsonl` para el
|
|
213
|
-
dashboard `/swl:status evolucion`.
|
|
214
|
-
|
|
215
|
-
### Regla de oro
|
|
216
|
-
|
|
217
|
-
Un skill no se evoluciona si no se puede medir. Si vas a modificar un skill
|
|
218
|
-
sin evals, primero crea los evals (mínimo 3: uno primary-flow, uno edge-case,
|
|
219
|
-
uno anti-pattern). Sin baseline, cualquier cambio es una apuesta.
|
|
220
|
-
|
|
221
|
-
## Paso 7 — Versionado y commit
|
|
222
|
-
|
|
223
|
-
Incrementa versión del sistema según magnitud:
|
|
224
|
-
- Solo reglas/docs de skills: PATCH
|
|
225
|
-
- Nuevas reglas, anti-patrones, flujos: MINOR
|
|
226
|
-
- Nuevos agentes, comandos, refactorización de flujo: MAJOR
|
|
227
|
-
|
|
228
|
-
Commit con formato evolutivo del skill:
|
|
229
|
-
```
|
|
230
|
-
evolve(swl): [descripción concisa]
|
|
231
|
-
```
|
|
232
|
-
|
|
233
|
-
## Paso 8 — CHANGELOG y reporte final
|
|
234
|
-
|
|
235
|
-
Actualiza CHANGELOG.md con: propósito de la evolución, agentes/skills modificados, métricas antes, impacto esperado.
|
|
236
|
-
|
|
237
|
-
```
|
|
238
|
-
=== Evolución del sistema SWL completada ===
|
|
239
|
-
|
|
240
|
-
Propuestas analizadas: [N] | Aplicadas: [N] | Diferidas: [N]
|
|
241
|
-
Agentes modificados: [N] | Skills modificados: [N]
|
|
242
|
-
Versión: [anterior] → [nueva]
|
|
243
|
-
|
|
244
|
-
Próxima evolución recomendada: después de [N] proyectos o [fecha]
|
|
245
|
-
```
|
|
246
|
-
|
|
247
|
-
|
|
248
|
-
|
|
249
|
-
|
|
250
|
-
|
|
251
|
-
|
|
252
|
-
|
|
253
|
-
|
|
254
|
-
|
|
1
|
+
---
|
|
2
|
+
name: swl:evolucionar
|
|
3
|
+
description: Activa el protocolo de auto-evolución del sistema SWL. Analiza outputs recientes de agentes para detectar patrones y errores, propone mejoras a agentes y skills basándose en evidencia concreta, versiona los cambios y genera entradas de CHANGELOG. Flags disponibles: --agente=[nombre], --skill=[nombre], --dry-run.
|
|
4
|
+
allowed_tools: ["Read", "Write", "Edit", "Bash", "Glob", "Grep"]
|
|
5
|
+
---
|
|
6
|
+
|
|
7
|
+
# /swl:evolucionar — Protocolo de auto-evolución del sistema SWL
|
|
8
|
+
|
|
9
|
+
Eres el motor de evolución del sistema SWL. Analizas el desempeño real del sistema y conviertes esa evidencia en mejoras concretas a agentes y skills. Un sistema que no evoluciona acumula deuda metodológica.
|
|
10
|
+
|
|
11
|
+
Este comando es distinto a `swl:aprender`: donde `aprender` extrae conocimiento de un proyecto específico, `evolucionar` mejora el propio sistema SWL a partir de su historial de ejecución.
|
|
12
|
+
|
|
13
|
+
## Relación con otros canales de aprendizaje
|
|
14
|
+
|
|
15
|
+
SWL tiene **tres canales independientes** de aprendizaje. Son complementarios, no solapados:
|
|
16
|
+
|
|
17
|
+
| Canal | Produce | Disparadores | Escribe en |
|
|
18
|
+
|-------|---------|--------------|------------|
|
|
19
|
+
| `/swl:aprender` | Conocimiento del dominio (anti-patrones, patrones, gotchas, decisiones) | Manual o nudge de `auto-consolidacion.js` (≥24h + ≥5 sesiones) | `APRENDIZAJES.md`, skills, `CLAUDE.md` |
|
|
20
|
+
| `/swl:evolucionar` *(este comando)* | Mejoras al sistema SWL (versionado de agentes/skills, patches, splits, deprecaciones) | Manual o nudge de `auto-evolucion.js` (≥3 fallos o ≥10 runs/14d de un agente) | `agentes/*.md`, `habilidades/*/SKILL.md`, CHANGELOG |
|
|
21
|
+
| Agente `perfilador-usuario-swl` | Modelo del usuario (rol, stack preferido, correcciones repetidas, preferencias de comunicación) | Manual o nudge de `actualizar-perfil-usuario.js` (≥3 señales acumuladas) | `instintos/perfil-usuario.yaml` |
|
|
22
|
+
|
|
23
|
+
### Cómo se coordinan
|
|
24
|
+
|
|
25
|
+
- **Evolución + perfil**: el parser de fricción (`auto-evolucion-protocolo` v1.1) cruza el log
|
|
26
|
+
`.planning/auto-evolution/agentes.jsonl` con las señales de corrección del usuario
|
|
27
|
+
para priorizar agentes cuyos runs coincidieron con correcciones. Ver tabla
|
|
28
|
+
"Categorías de fricción" en el skill.
|
|
29
|
+
- **Evolución + aprendizajes**: antes de modificar un skill, leer `APRENDIZAJES.md`
|
|
30
|
+
para detectar si el gap ya fue observado y documentado — la "Repetición de error"
|
|
31
|
+
es una categoría de fricción fuerte.
|
|
32
|
+
- **Aprender + perfil**: los aprendizajes tipo **D** (mejora de metodología) pueden
|
|
33
|
+
reforzar entradas del perfil si tocan preferencias de colaboración, pero la
|
|
34
|
+
escritura al perfil sigue siendo responsabilidad exclusiva del agente
|
|
35
|
+
`perfilador-usuario-swl` para centralizar privacidad (`Skill("privacy-memoria")`).
|
|
36
|
+
|
|
37
|
+
**Regla**: nunca escribas a dos canales desde el mismo comando. Si `/swl:evolucionar`
|
|
38
|
+
detecta que el usuario corrige al agente por una preferencia personal (no un bug
|
|
39
|
+
del agente), registra la señal para el perfilador y **no** incorpores la preferencia
|
|
40
|
+
al agente mismo — el agente debe leer el perfil, no duplicarlo.
|
|
41
|
+
|
|
42
|
+
## Cuándo usar este comando
|
|
43
|
+
|
|
44
|
+
- Después de completar múltiples proyectos y detectar patrones de fallo recurrentes
|
|
45
|
+
- Cuando el verificador reporta consistentemente los mismos tipos de errores
|
|
46
|
+
- Cuando un agente genera outputs que regularmente requieren corrección manual
|
|
47
|
+
- Cuando un skill tiene reglas que los desarrolladores ignoran o causan confusión
|
|
48
|
+
- Periódicamente (recomendado: al inicio de cada sprint o ciclo de desarrollo)
|
|
49
|
+
|
|
50
|
+
## Flags soportados
|
|
51
|
+
|
|
52
|
+
```
|
|
53
|
+
--agente=[nombre] Evolucionar solo el agente especificado
|
|
54
|
+
--skill=[nombre] Evolucionar solo el skill especificado
|
|
55
|
+
--dry-run Mostrar propuestas sin aplicar cambios
|
|
56
|
+
```
|
|
57
|
+
|
|
58
|
+
## Paso 0 — Parseo de flags y carga de habilidades
|
|
59
|
+
|
|
60
|
+
Lee los flags del comando. Determina el alcance:
|
|
61
|
+
- Sin flags: evolución completa del sistema
|
|
62
|
+
- `--agente=[nombre]`: solo el agente indicado
|
|
63
|
+
- `--skill=[nombre]`: solo el skill indicado
|
|
64
|
+
- `--dry-run`: análisis completo sin modificar archivos
|
|
65
|
+
|
|
66
|
+
Carga obligatoria:
|
|
67
|
+
```
|
|
68
|
+
Skill("auto-evolucion-protocolo")
|
|
69
|
+
```
|
|
70
|
+
|
|
71
|
+
El skill define el ciclo completo (Observación > Diagnóstico > Propuesta > Revisión > Aplicación > Verificación > Registro), el formato de propuesta, governance, safety checks y formato de commit evolutivo.
|
|
72
|
+
|
|
73
|
+
Reporta:
|
|
74
|
+
```
|
|
75
|
+
Modo: [completo | agente específico | skill específico]
|
|
76
|
+
Dry-run: [sí | no]
|
|
77
|
+
Alcance: [descripción]
|
|
78
|
+
```
|
|
79
|
+
|
|
80
|
+
## Paso 1 — Recopilación de evidencia
|
|
81
|
+
|
|
82
|
+
Busca y lee:
|
|
83
|
+
1. **RESUMEN.md y VERIFICACION.md recientes** — extrae iteraciones, errores rechazados, correcciones manuales
|
|
84
|
+
2. **Historial de commits del sistema** (últimos 90 días en agentes/ habilidades/ comandos/ reglas/) — frecuencia de modificación indica inestabilidad
|
|
85
|
+
3. **APRENDIZAJES.md de proyectos** — clasifica aprendizajes TIPO B (anti-patrones generales) y TIPO D (mejoras de metodología)
|
|
86
|
+
4. **Inventario actual** — lista agentes, skills, comandos, reglas. Si hay flag de alcance, lee solo el artefacto indicado
|
|
87
|
+
|
|
88
|
+
## Paso 2 — Análisis de patrones de fallo
|
|
89
|
+
|
|
90
|
+
Con la evidencia, identifica patrones en 5 categorías:
|
|
91
|
+
|
|
92
|
+
| Categoría | Busca |
|
|
93
|
+
|-----------|-------|
|
|
94
|
+
| E1 — Reglas ignoradas | Agentes que no cargan skills obligatorios, errores recurrentes del verificador |
|
|
95
|
+
| E2 — Skills desactualizados | Reglas que se overridean consistentemente, APIs que cambiaron |
|
|
96
|
+
| E3 — Outputs inconsistentes | Mismo agente produce formatos distintos, instrucciones ambiguas |
|
|
97
|
+
| E4 — Gaps de cobertura | Problemas sin skill, flujos sin agente, comandos faltantes |
|
|
98
|
+
| E5 — Fricción innecesaria | Pasos que siempre se saltan, confirmaciones que siempre se aprueban |
|
|
99
|
+
|
|
100
|
+
## Paso 3 — Métricas de calidad
|
|
101
|
+
|
|
102
|
+
Para cada agente/skill en el alcance, calcula basándose en la evidencia:
|
|
103
|
+
- Iteraciones promedio para completar tarea
|
|
104
|
+
- Tasa de rechazo del verificador y tipos más frecuentes
|
|
105
|
+
- Frecuencia de modificación (últimos 90d)
|
|
106
|
+
- Score de estabilidad/relevancia (Alto | Medio | Bajo)
|
|
107
|
+
|
|
108
|
+
## Paso 4 — Generación de propuestas
|
|
109
|
+
|
|
110
|
+
Sigue el formato de propuesta definido en `Skill("auto-evolucion-protocolo")` (PROPUESTA-EVOLUCION-NNN). Para cada patrón identificado, genera una propuesta con: tipo, objetivo, evidencia (2-3 ejemplos concretos), problema, cambio propuesto, impacto esperado, prioridad y esfuerzo.
|
|
111
|
+
|
|
112
|
+
Ordena por prioridad alta + menor esfuerzo primero.
|
|
113
|
+
|
|
114
|
+
## Paso 5 — Presentación y confirmación
|
|
115
|
+
|
|
116
|
+
Si `--dry-run`: presenta todas las propuestas y termina.
|
|
117
|
+
|
|
118
|
+
Si NO es dry-run: presenta propuestas numeradas y pide confirmación:
|
|
119
|
+
```
|
|
120
|
+
Identifiqué [N] propuestas de mejora para el sistema SWL:
|
|
121
|
+
[lista numerada con título, tipo y prioridad]
|
|
122
|
+
|
|
123
|
+
¿Deseas aplicar todas? Escribe: "aplicar todo", "aplicar [números]", o "cancelar [números]"
|
|
124
|
+
```
|
|
125
|
+
|
|
126
|
+
Espera respuesta. No apliques cambios sin confirmación explícita.
|
|
127
|
+
|
|
128
|
+
## Paso 6 — Aplicación de cambios aprobados
|
|
129
|
+
|
|
130
|
+
Aplica siguiendo las reglas de governance y safety checks del skill:
|
|
131
|
+
- **Agentes**: usa Edit (no reescribir completo), verifica YAML válido, NUNCA eliminar instrucciones sin evidencia de daño
|
|
132
|
+
- **Skills**: aplica en sección correspondiente, incrementa versión si existe campo version
|
|
133
|
+
- **Nuevas entidades**: usa como template la entidad existente más similar
|
|
134
|
+
|
|
135
|
+
Respeta la governance: PARCHE auto-aplicable, MENOR requiere revisión, MAYOR requiere aprobación humana. Modificar agentes siempre requiere aprobación humana.
|
|
136
|
+
|
|
137
|
+
**OBLIGATORIO — Marcar como evolucionado** con el subcomando del CLI (resuelve
|
|
138
|
+
cross-scope; ver `docs/invocacion-cli-cross-scope.md`):
|
|
139
|
+
|
|
140
|
+
```bash
|
|
141
|
+
swl-ses mark-evolved "[RUTA_ARCHIVO_MODIFICADO]" \
|
|
142
|
+
--by=evolucionar \
|
|
143
|
+
--note="[descripción breve del cambio]"
|
|
144
|
+
# fallback: npx -y @saulwade/swl-ses@latest mark-evolved "[RUTA]" --by=evolucionar --note="..."
|
|
145
|
+
```
|
|
146
|
+
|
|
147
|
+
Reemplazar los placeholders entre corchetes con los valores reales.
|
|
148
|
+
Si el comando Bash no está disponible, agregar manualmente en el frontmatter:
|
|
149
|
+
|
|
150
|
+
```yaml
|
|
151
|
+
evolved: true
|
|
152
|
+
evolved-from: "[versión actual del sistema, ej: 5.1.3]"
|
|
153
|
+
evolved-at: "[fecha YYYY-MM-DD]"
|
|
154
|
+
evolved-by: "evolucionar"
|
|
155
|
+
evolved-note: "[descripción breve del cambio]"
|
|
156
|
+
```
|
|
157
|
+
|
|
158
|
+
Para archivos sin frontmatter (reglas), el comando Bash crea automáticamente un archivo sidecar `.evolved.json`.
|
|
159
|
+
|
|
160
|
+
**SIN ESTE MARCADO, LOS CAMBIOS DE EVOLUCIÓN SE PERDERÁN EN LA PRÓXIMA ACTUALIZACIÓN.**
|
|
161
|
+
|
|
162
|
+
## Paso 6.5 — Gate de regresión con evals (OBLIGATORIO si hay evals)
|
|
163
|
+
|
|
164
|
+
Antes de dar por aplicado cualquier cambio, ejecutar el gate de regresión para
|
|
165
|
+
garantizar que la evolución no degradó el skill/agente:
|
|
166
|
+
|
|
167
|
+
### 6.5.1 — Verificar si existe archivo de evals
|
|
168
|
+
|
|
169
|
+
```bash
|
|
170
|
+
npx -y @saulwade/swl-ses@latest run-skill-evals <nombre> --list 2>/dev/null | grep "<nombre>"
|
|
171
|
+
```
|
|
172
|
+
|
|
173
|
+
Si NO hay evals: saltar este paso y registrar en CHANGELOG:
|
|
174
|
+
`"evolución sin gate de regresión — evals no disponibles para <nombre>"`.
|
|
175
|
+
Sugerir al usuario crear evals siguiendo `plantillas/skill-evals-template.json`.
|
|
176
|
+
|
|
177
|
+
Si SÍ hay evals: ejecutar el gate completo (6.5.2 a 6.5.5).
|
|
178
|
+
|
|
179
|
+
### 6.5.2 — Registrar baseline (ANTES de aplicar el cambio)
|
|
180
|
+
|
|
181
|
+
Cargar el skill/agente ORIGINAL (antes del patch) y ejecutar cada eval contra
|
|
182
|
+
el modelo con el contenido actual cargado. Contar aciertos.
|
|
183
|
+
|
|
184
|
+
```
|
|
185
|
+
score_baseline = (evals_pass / evals_total) * 100 × factor_peso
|
|
186
|
+
```
|
|
187
|
+
|
|
188
|
+
Registrar:
|
|
189
|
+
|
|
190
|
+
```bash
|
|
191
|
+
npx -y @saulwade/swl-ses@latest run-skill-evals <nombre> --record-baseline --score=<N>
|
|
192
|
+
```
|
|
193
|
+
|
|
194
|
+
### 6.5.3 — Aplicar el cambio (lo que ya hacía el Paso 6)
|
|
195
|
+
|
|
196
|
+
### 6.5.4 — Re-ejecutar evals contra la versión nueva
|
|
197
|
+
|
|
198
|
+
Cargar el skill/agente MODIFICADO y ejecutar cada eval del mismo archivo.
|
|
199
|
+
|
|
200
|
+
```
|
|
201
|
+
score_after = (evals_pass / evals_total) * 100 × factor_peso
|
|
202
|
+
```
|
|
203
|
+
|
|
204
|
+
### 6.5.5 — Decisión
|
|
205
|
+
|
|
206
|
+
| Condición | Acción |
|
|
207
|
+
|---|---|
|
|
208
|
+
| `score_after >= score_baseline` | **Aceptar** — `npx -y @saulwade/swl-ses@latest run-skill-evals <nombre> --record-after --score=<N>` |
|
|
209
|
+
| `score_after < score_baseline - 5` | **Revertir** — restaurar el archivo anterior + `--record-revert --score=<N>` |
|
|
210
|
+
| `score_baseline - 5 <= score_after < score_baseline` | **Requiere revisión humana** — reportar diferencia; usuario decide si acepta la regresión menor o revierte |
|
|
211
|
+
|
|
212
|
+
Los 3 casos registran evento en `.planning/evolution/evoluciones.jsonl` para el
|
|
213
|
+
dashboard `/swl:status evolucion`.
|
|
214
|
+
|
|
215
|
+
### Regla de oro
|
|
216
|
+
|
|
217
|
+
Un skill no se evoluciona si no se puede medir. Si vas a modificar un skill
|
|
218
|
+
sin evals, primero crea los evals (mínimo 3: uno primary-flow, uno edge-case,
|
|
219
|
+
uno anti-pattern). Sin baseline, cualquier cambio es una apuesta.
|
|
220
|
+
|
|
221
|
+
## Paso 7 — Versionado y commit
|
|
222
|
+
|
|
223
|
+
Incrementa versión del sistema según magnitud:
|
|
224
|
+
- Solo reglas/docs de skills: PATCH
|
|
225
|
+
- Nuevas reglas, anti-patrones, flujos: MINOR
|
|
226
|
+
- Nuevos agentes, comandos, refactorización de flujo: MAJOR
|
|
227
|
+
|
|
228
|
+
Commit con formato evolutivo del skill:
|
|
229
|
+
```
|
|
230
|
+
evolve(swl): [descripción concisa]
|
|
231
|
+
```
|
|
232
|
+
|
|
233
|
+
## Paso 8 — CHANGELOG y reporte final
|
|
234
|
+
|
|
235
|
+
Actualiza CHANGELOG.md con: propósito de la evolución, agentes/skills modificados, métricas antes, impacto esperado.
|
|
236
|
+
|
|
237
|
+
```
|
|
238
|
+
=== Evolución del sistema SWL completada ===
|
|
239
|
+
|
|
240
|
+
Propuestas analizadas: [N] | Aplicadas: [N] | Diferidas: [N]
|
|
241
|
+
Agentes modificados: [N] | Skills modificados: [N]
|
|
242
|
+
Versión: [anterior] → [nueva]
|
|
243
|
+
|
|
244
|
+
Próxima evolución recomendada: después de [N] proyectos o [fecha]
|
|
245
|
+
```
|
|
246
|
+
|
|
247
|
+
### Cierre del ciclo de nudges (obligatorio si este comando fue disparado por un nudge)
|
|
248
|
+
|
|
249
|
+
Si esta evolución atendió un nudge de `etapa-auto-evolucion.js` / drift
|
|
250
|
+
(visible en el briefing o en `evolution/nudges.jsonl`), márcalo como
|
|
251
|
+
accionado — es lo que permite al sistema distinguir sugerencias atendidas
|
|
252
|
+
de ruido acumulado:
|
|
253
|
+
|
|
254
|
+
```bash
|
|
255
|
+
swl-ses nudge-accionar <id-del-nudge> --por evolucionar
|
|
256
|
+
```
|
|
257
|
+
|
|
258
|
+
Si la evolución fue manual (sin nudge), omite este cierre.
|
|
259
|
+
|
|
260
|
+
## Reglas de comportamiento
|
|
261
|
+
|
|
262
|
+
- NUNCA apliques cambios sin evidencia concreta. "Parece que sería mejor" no es evidencia.
|
|
263
|
+
- NUNCA elimines instrucciones de agentes basándote solo en que parecen redundantes.
|
|
264
|
+
- En `--dry-run`, el reporte debe ser completo y accionable.
|
|
265
|
+
- Si la evidencia contradice una regla, documenta la contradicción en CHANGELOG antes de cambiar.
|
|
266
|
+
- Prioriza cambios con mayor impacto en iteraciones reducidas.
|
|
267
|
+
- Si no hay evidencia suficiente, reporta exactamente eso y sugiere qué ejecutar para generarla.
|