@ingeniomaps/cauce 0.19.0 → 0.21.0
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/.github/workflows/agent-learning.yml +103 -13
- package/.github/workflows/ci.yml +2 -2
- package/CHANGELOG.md +90 -0
- package/README.md +7 -2
- package/agents/roles/system/product-manager/evaluations/results/2026-08-16.md +700 -0
- package/automatization/hooks/README.md +27 -0
- package/automatization/workflows/agent-eval.js +21 -10
- package/engine/agents/fork.js +8 -3
- package/engine/agents/learning.js +12 -0
- package/engine/cli/ops.js +20 -4
- package/engine/hooks/run.js +9 -0
- package/package.json +1 -1
- package/agents/roles/system/ai-governance-lead/learning/proposals/_template.md +0 -11
- package/agents/roles/system/ai-governance-lead/learning/reports/_template.md +0 -11
- package/agents/roles/system/ai-product-manager/learning/proposals/_template.md +0 -9
- package/agents/roles/system/ai-product-manager/learning/reports/_template.md +0 -9
- package/agents/roles/system/analytics-engineer/learning/proposals/_template.md +0 -9
- package/agents/roles/system/analytics-engineer/learning/reports/_template.md +0 -9
- package/agents/roles/system/backend-engineer/learning/proposals/_template.md +0 -15
- package/agents/roles/system/backend-engineer/learning/reports/_template.md +0 -14
- package/agents/roles/system/business-operations-manager/learning/proposals/_template.md +0 -13
- package/agents/roles/system/business-operations-manager/learning/reports/_template.md +0 -12
- package/agents/roles/system/business-strategist/learning/proposals/_template.md +0 -15
- package/agents/roles/system/business-strategist/learning/reports/_template.md +0 -14
- package/agents/roles/system/cloud-architect/learning/proposals/_template.md +0 -9
- package/agents/roles/system/cloud-architect/learning/reports/_template.md +0 -9
- package/agents/roles/system/community-manager/learning/proposals/_template.md +0 -11
- package/agents/roles/system/community-manager/learning/reports/_template.md +0 -10
- package/agents/roles/system/content-specialist/learning/proposals/_template.md +0 -15
- package/agents/roles/system/content-specialist/learning/reports/_template.md +0 -14
- package/agents/roles/system/customer-success-manager/learning/proposals/_template.md +0 -15
- package/agents/roles/system/customer-success-manager/learning/reports/_template.md +0 -14
- package/agents/roles/system/customer-support-specialist/learning/proposals/_template.md +0 -15
- package/agents/roles/system/customer-support-specialist/learning/reports/_template.md +0 -14
- package/agents/roles/system/data-analyst/learning/proposals/_template.md +0 -15
- package/agents/roles/system/data-analyst/learning/reports/_template.md +0 -14
- package/agents/roles/system/data-engineer/learning/proposals/_template.md +0 -11
- package/agents/roles/system/data-engineer/learning/reports/_template.md +0 -10
- package/agents/roles/system/data-scientist/learning/proposals/_template.md +0 -11
- package/agents/roles/system/data-scientist/learning/reports/_template.md +0 -10
- package/agents/roles/system/database-administrator/learning/proposals/_template.md +0 -9
- package/agents/roles/system/database-administrator/learning/reports/_template.md +0 -9
- package/agents/roles/system/developer-relations-engineer/learning/proposals/_template.md +0 -11
- package/agents/roles/system/developer-relations-engineer/learning/reports/_template.md +0 -10
- package/agents/roles/system/devops-engineer/learning/proposals/_template.md +0 -15
- package/agents/roles/system/devops-engineer/learning/reports/_template.md +0 -14
- package/agents/roles/system/engineering-manager/learning/proposals/_template.md +0 -13
- package/agents/roles/system/engineering-manager/learning/reports/_template.md +0 -12
- package/agents/roles/system/financial-controller/learning/proposals/_template.md +0 -15
- package/agents/roles/system/financial-controller/learning/reports/_template.md +0 -14
- package/agents/roles/system/finops-engineer/learning/proposals/_template.md +0 -15
- package/agents/roles/system/finops-engineer/learning/reports/_template.md +0 -14
- package/agents/roles/system/frontend-engineer/learning/proposals/_template.md +0 -15
- package/agents/roles/system/frontend-engineer/learning/reports/_template.md +0 -14
- package/agents/roles/system/growth-marketer/learning/proposals/_template.md +0 -15
- package/agents/roles/system/growth-marketer/learning/reports/_template.md +0 -14
- package/agents/roles/system/implementation-manager/learning/proposals/_template.md +0 -11
- package/agents/roles/system/implementation-manager/learning/reports/_template.md +0 -12
- package/agents/roles/system/legal-counsel/learning/proposals/_template.md +0 -14
- package/agents/roles/system/legal-counsel/learning/reports/_template.md +0 -14
- package/agents/roles/system/machine-learning-engineer/learning/proposals/_template.md +0 -11
- package/agents/roles/system/machine-learning-engineer/learning/reports/_template.md +0 -10
- package/agents/roles/system/mlops-engineer/learning/proposals/_template.md +0 -9
- package/agents/roles/system/mlops-engineer/learning/reports/_template.md +0 -9
- package/agents/roles/system/mobile-engineer/learning/proposals/_template.md +0 -15
- package/agents/roles/system/mobile-engineer/learning/reports/_template.md +0 -14
- package/agents/roles/system/partnerships-manager/learning/proposals/_template.md +0 -11
- package/agents/roles/system/partnerships-manager/learning/reports/_template.md +0 -10
- package/agents/roles/system/people-operations-manager/learning/proposals/_template.md +0 -14
- package/agents/roles/system/people-operations-manager/learning/reports/_template.md +0 -14
- package/agents/roles/system/privacy-compliance-specialist/learning/proposals/_template.md +0 -15
- package/agents/roles/system/privacy-compliance-specialist/learning/reports/_template.md +0 -14
- package/agents/roles/system/procurement-manager/learning/proposals/_template.md +0 -14
- package/agents/roles/system/procurement-manager/learning/reports/_template.md +0 -13
- package/agents/roles/system/product-manager/learning/proposals/_template.md +0 -15
- package/agents/roles/system/product-manager/learning/reports/_template.md +0 -14
- package/agents/roles/system/product-marketing-manager/learning/proposals/_template.md +0 -15
- package/agents/roles/system/product-marketing-manager/learning/reports/_template.md +0 -14
- package/agents/roles/system/project-manager/learning/proposals/_template.md +0 -13
- package/agents/roles/system/project-manager/learning/reports/_template.md +0 -12
- package/agents/roles/system/qa-engineer/learning/proposals/_template.md +0 -15
- package/agents/roles/system/qa-engineer/learning/reports/_template.md +0 -14
- package/agents/roles/system/release-manager/learning/proposals/_template.md +0 -13
- package/agents/roles/system/release-manager/learning/reports/_template.md +0 -12
- package/agents/roles/system/revenue-operations-manager/learning/proposals/_template.md +0 -13
- package/agents/roles/system/revenue-operations-manager/learning/reports/_template.md +0 -12
- package/agents/roles/system/sales-representative/learning/proposals/_template.md +0 -15
- package/agents/roles/system/sales-representative/learning/reports/_template.md +0 -14
- package/agents/roles/system/security-engineer/learning/proposals/_template.md +0 -15
- package/agents/roles/system/security-engineer/learning/reports/_template.md +0 -14
- package/agents/roles/system/site-reliability-engineer/learning/proposals/_template.md +0 -15
- package/agents/roles/system/site-reliability-engineer/learning/reports/_template.md +0 -14
- package/agents/roles/system/software-architect/learning/proposals/_template.md +0 -15
- package/agents/roles/system/software-architect/learning/reports/_template.md +0 -14
- package/agents/roles/system/solutions-engineer/learning/proposals/_template.md +0 -13
- package/agents/roles/system/solutions-engineer/learning/reports/_template.md +0 -12
- package/agents/roles/system/technical-program-manager/learning/proposals/_template.md +0 -9
- package/agents/roles/system/technical-program-manager/learning/reports/_template.md +0 -9
- package/agents/roles/system/technical-writer/learning/proposals/_template.md +0 -14
- package/agents/roles/system/technical-writer/learning/reports/_template.md +0 -12
- package/agents/roles/system/ui-designer/learning/proposals/_template.md +0 -15
- package/agents/roles/system/ui-designer/learning/reports/_template.md +0 -14
- package/agents/roles/system/user-researcher/learning/proposals/_template.md +0 -15
- package/agents/roles/system/user-researcher/learning/reports/_template.md +0 -14
- package/agents/roles/system/ux-designer/learning/proposals/_template.md +0 -15
- package/agents/roles/system/ux-designer/learning/reports/_template.md +0 -14
|
@@ -16,9 +16,10 @@ on:
|
|
|
16
16
|
required: false
|
|
17
17
|
default: ""
|
|
18
18
|
|
|
19
|
+
# Mínimo arriba: cada job eleva sólo lo que necesita. El que corre el agente se queda en `read` —
|
|
20
|
+
# ingiere contenido web que no controlamos y no tiene por qué poder escribir el repositorio.
|
|
19
21
|
permissions:
|
|
20
|
-
contents:
|
|
21
|
-
pull-requests: write
|
|
22
|
+
contents: read
|
|
22
23
|
|
|
23
24
|
jobs:
|
|
24
25
|
discover:
|
|
@@ -26,8 +27,8 @@ jobs:
|
|
|
26
27
|
outputs:
|
|
27
28
|
agents: ${{ steps.list.outputs.agents }}
|
|
28
29
|
steps:
|
|
29
|
-
- uses: actions/checkout@v4
|
|
30
|
-
- uses: actions/setup-node@v4
|
|
30
|
+
- uses: actions/checkout@11d5960a326750d5838078e36cf38b85af677262 # v4
|
|
31
|
+
- uses: actions/setup-node@49933ea5288caeca8642d1e84afbd3f7d6820020 # v4
|
|
31
32
|
with:
|
|
32
33
|
node-version: "24"
|
|
33
34
|
|
|
@@ -71,14 +72,16 @@ jobs:
|
|
|
71
72
|
if: github.event.schedule != '17 13 1 * *'
|
|
72
73
|
needs: discover
|
|
73
74
|
runs-on: ubuntu-latest
|
|
75
|
+
permissions:
|
|
76
|
+
contents: read
|
|
74
77
|
strategy:
|
|
75
78
|
fail-fast: false
|
|
76
79
|
max-parallel: 3
|
|
77
80
|
matrix:
|
|
78
81
|
agent: ${{ fromJSON(needs.discover.outputs.agents) }}
|
|
79
82
|
steps:
|
|
80
|
-
- uses: actions/checkout@v4
|
|
81
|
-
- uses: actions/setup-node@v4
|
|
83
|
+
- uses: actions/checkout@11d5960a326750d5838078e36cf38b85af677262 # v4
|
|
84
|
+
- uses: actions/setup-node@49933ea5288caeca8642d1e84afbd3f7d6820020 # v4
|
|
82
85
|
with:
|
|
83
86
|
node-version: "24"
|
|
84
87
|
- name: Check credential
|
|
@@ -118,7 +121,7 @@ jobs:
|
|
|
118
121
|
AGENT: ${{ matrix.agent }}
|
|
119
122
|
ANTHROPIC_API_KEY: ${{ secrets.ANTHROPIC_API_KEY }}
|
|
120
123
|
run: |
|
|
121
|
-
npm install -g @anthropic-ai/claude-code
|
|
124
|
+
npm install -g @anthropic-ai/claude-code@2.1.233
|
|
122
125
|
claude -p "Leé el learning/AUTOMATION.md del cargo $AGENT y ejecutá exactamente lo que declara. El informe de esta semana ya está creado y vacío: completalo. Cada afirmación necesita enlace, fecha y versión; lo que no puedas corroborar va a Preguntas abiertas en vez de afirmarse. El único archivo que escribís es ese informe."
|
|
123
126
|
- name: Detect changes
|
|
124
127
|
if: steps.creds.outputs.ready == 'true'
|
|
@@ -129,20 +132,102 @@ jobs:
|
|
|
129
132
|
else
|
|
130
133
|
echo "changed=true" >> "$GITHUB_OUTPUT"
|
|
131
134
|
fi
|
|
132
|
-
|
|
135
|
+
# El informe sale de acá como artifact, no como commit. Lo que el agente escribió fuera de su
|
|
136
|
+
# informe se queda en este runner y muere con él: no hay credencial con que sacarlo.
|
|
137
|
+
- name: Collect report
|
|
133
138
|
if: steps.creds.outputs.ready == 'true' && steps.changes.outputs.changed == 'true'
|
|
139
|
+
id: collect
|
|
134
140
|
env:
|
|
135
141
|
AGENT: ${{ matrix.agent }}
|
|
136
|
-
GH_TOKEN: ${{ github.token }}
|
|
137
142
|
run: |
|
|
138
143
|
stamp="$(date -u +%Y-%m-%d)"
|
|
139
|
-
branch="automation/$AGENT-research-$stamp"
|
|
140
144
|
report="$(git diff --name-only -- "agents/*/$AGENT/learning/reports/$stamp.md")"
|
|
141
145
|
if [ -z "$report" ]; then
|
|
142
|
-
echo "El agente
|
|
146
|
+
echo "El agente no escribió su informe; lo que haya tocado no sale de acá." >&2
|
|
143
147
|
git diff --name-only >&2
|
|
144
148
|
exit 1
|
|
145
149
|
fi
|
|
150
|
+
echo "path=$report" >> "$GITHUB_OUTPUT"
|
|
151
|
+
echo "stamp=$stamp" >> "$GITHUB_OUTPUT"
|
|
152
|
+
- name: Upload report
|
|
153
|
+
if: steps.collect.outputs.path != ''
|
|
154
|
+
uses: actions/upload-artifact@ea165f8d65b6e75b540449e92b4886f43607fa02 # v4
|
|
155
|
+
with:
|
|
156
|
+
name: research-${{ matrix.agent }}
|
|
157
|
+
path: ${{ steps.collect.outputs.path }}
|
|
158
|
+
retention-days: 7
|
|
159
|
+
|
|
160
|
+
# Segundo job y no un paso más: acá vive la credencial de escritura, y para llegar hasta acá el
|
|
161
|
+
# informe tuvo que pasar por un artifact. Este job no habla con ningún modelo ni lee la web —
|
|
162
|
+
# recibe un archivo, comprueba que caiga donde debe, y lo commitea.
|
|
163
|
+
research-pr:
|
|
164
|
+
needs: [discover, research]
|
|
165
|
+
if: needs.research.result == 'success'
|
|
166
|
+
runs-on: ubuntu-latest
|
|
167
|
+
permissions:
|
|
168
|
+
contents: write
|
|
169
|
+
pull-requests: write
|
|
170
|
+
strategy:
|
|
171
|
+
fail-fast: false
|
|
172
|
+
max-parallel: 3
|
|
173
|
+
matrix:
|
|
174
|
+
agent: ${{ fromJSON(needs.discover.outputs.agents) }}
|
|
175
|
+
steps:
|
|
176
|
+
- uses: actions/checkout@11d5960a326750d5838078e36cf38b85af677262 # v4
|
|
177
|
+
- name: Download report
|
|
178
|
+
id: fetch
|
|
179
|
+
continue-on-error: true
|
|
180
|
+
uses: actions/download-artifact@d3f86a106a0bac45b974a628896c90dbdf5c8093 # v4
|
|
181
|
+
with:
|
|
182
|
+
name: research-${{ matrix.agent }}
|
|
183
|
+
path: ${{ github.workspace }}
|
|
184
|
+
- name: Resolve CLI
|
|
185
|
+
if: steps.fetch.outcome == 'success'
|
|
186
|
+
id: cli
|
|
187
|
+
run: |
|
|
188
|
+
for candidate in tools/ops.js engine/cli/ops.js; do
|
|
189
|
+
if [ -f "$candidate" ]; then
|
|
190
|
+
echo "path=$candidate" >> "$GITHUB_OUTPUT"
|
|
191
|
+
exit 0
|
|
192
|
+
fi
|
|
193
|
+
done
|
|
194
|
+
echo "No se encontró el CLI de Cauce." >&2
|
|
195
|
+
exit 1
|
|
196
|
+
- name: Open research pull request
|
|
197
|
+
if: steps.fetch.outcome == 'success'
|
|
198
|
+
env:
|
|
199
|
+
AGENT: ${{ matrix.agent }}
|
|
200
|
+
OPS: ${{ steps.cli.outputs.path }}
|
|
201
|
+
GH_TOKEN: ${{ github.token }}
|
|
202
|
+
run: |
|
|
203
|
+
stamp="$(date -u +%Y-%m-%d)"
|
|
204
|
+
branch="automation/$AGENT-research-$stamp"
|
|
205
|
+
# El artifact trae contenido, no destino: `upload-artifact` aplana la ruta de un archivo
|
|
206
|
+
# suelto, así que llega como `<fecha>.md` a la raíz. Dónde va se resuelve **acá**, con el
|
|
207
|
+
# mismo CLI que resolvió el catálogo antes, y eso además es la garantía: nada de lo que
|
|
208
|
+
# venga en el artifact puede redirigir dónde aterriza el archivo.
|
|
209
|
+
dir="$(node "$OPS" agents list --json | node -e '
|
|
210
|
+
let s = ""
|
|
211
|
+
process.stdin.on("data", (d) => { s += d }).on("end", () => {
|
|
212
|
+
const found = JSON.parse(s).find((role) => role.slug === process.env.AGENT)
|
|
213
|
+
if (!found) { console.error("agente desconocido"); process.exit(1) }
|
|
214
|
+
console.log(found.path)
|
|
215
|
+
})')"
|
|
216
|
+
dest="$dir/learning/reports/$stamp.md"
|
|
217
|
+
mkdir -p "$(dirname "$dest")"
|
|
218
|
+
mv "$stamp.md" "$dest"
|
|
219
|
+
report="$(git diff --name-only -- "agents/*/$AGENT/learning/reports/$stamp.md")"
|
|
220
|
+
otros="$(git status --porcelain | awk '{print $2}' | grep -v -F "$dest" || true)"
|
|
221
|
+
if [ -z "$report" ] && [ ! -f "$dest" ]; then
|
|
222
|
+
echo "No llegó el informe de $AGENT." >&2
|
|
223
|
+
exit 1
|
|
224
|
+
fi
|
|
225
|
+
if [ -n "$otros" ]; then
|
|
226
|
+
echo "Se esperaba exactamente el informe de $AGENT y nada más." >&2
|
|
227
|
+
git status --porcelain >&2
|
|
228
|
+
exit 1
|
|
229
|
+
fi
|
|
230
|
+
report="$dest"
|
|
146
231
|
git config user.name "github-actions[bot]"
|
|
147
232
|
git config user.email "41898282+github-actions[bot]@users.noreply.github.com"
|
|
148
233
|
git switch -c "$branch"
|
|
@@ -153,18 +238,23 @@ jobs:
|
|
|
153
238
|
--title "$AGENT weekly research — $stamp" \
|
|
154
239
|
--body "Investigación semanal de la profesión. No modifica SKILL.md ni propone cambios: alimenta la propuesta mensual."
|
|
155
240
|
|
|
241
|
+
# Este job no habla con ningún modelo: consolida informes ya commiteados con el CLI y abre el PR.
|
|
242
|
+
# Por eso puede escribir sin la separación que exige `research`.
|
|
156
243
|
propose:
|
|
157
244
|
if: github.event.schedule == '17 13 1 * *' || github.event_name == 'workflow_dispatch'
|
|
158
245
|
needs: discover
|
|
159
246
|
runs-on: ubuntu-latest
|
|
247
|
+
permissions:
|
|
248
|
+
contents: write
|
|
249
|
+
pull-requests: write
|
|
160
250
|
strategy:
|
|
161
251
|
fail-fast: false
|
|
162
252
|
max-parallel: 5
|
|
163
253
|
matrix:
|
|
164
254
|
agent: ${{ fromJSON(needs.discover.outputs.agents) }}
|
|
165
255
|
steps:
|
|
166
|
-
- uses: actions/checkout@v4
|
|
167
|
-
- uses: actions/setup-node@v4
|
|
256
|
+
- uses: actions/checkout@11d5960a326750d5838078e36cf38b85af677262 # v4
|
|
257
|
+
- uses: actions/setup-node@49933ea5288caeca8642d1e84afbd3f7d6820020 # v4
|
|
168
258
|
with:
|
|
169
259
|
node-version: "24"
|
|
170
260
|
|
package/.github/workflows/ci.yml
CHANGED
|
@@ -17,8 +17,8 @@ jobs:
|
|
|
17
17
|
ci:
|
|
18
18
|
runs-on: ubuntu-latest
|
|
19
19
|
steps:
|
|
20
|
-
- uses: actions/checkout@v4
|
|
21
|
-
- uses: actions/setup-node@v4
|
|
20
|
+
- uses: actions/checkout@11d5960a326750d5838078e36cf38b85af677262 # v4
|
|
21
|
+
- uses: actions/setup-node@49933ea5288caeca8642d1e84afbd3f7d6820020 # v4
|
|
22
22
|
with:
|
|
23
23
|
node-version: "24"
|
|
24
24
|
# Valida planning, automatización e integraciones y después corre las pruebas
|
package/CHANGELOG.md
CHANGED
|
@@ -8,6 +8,96 @@ esa operación sea confiable en vez de sólo cómoda: acá se lee qué cambió a
|
|
|
8
8
|
un cambio en el protocolo, en las reglas del sistema o en un guard es visible para el usuario y sube
|
|
9
9
|
minor aunque no toque una sola línea de código.
|
|
10
10
|
|
|
11
|
+
## [0.21.0] - 2026-08-17
|
|
12
|
+
|
|
13
|
+
### Corregido
|
|
14
|
+
|
|
15
|
+
- **Cada caso adversarial recibe su propio banco.** Con uno por cargo, los casos corren a la vez sobre
|
|
16
|
+
el mismo `planning/` y se leen entre sí. Correr `product-manager` lo mostró sin lugar a dudas: un
|
|
17
|
+
caso tomó por «una sesión anterior de este mismo cargo» lo que otro acababa de escribir, y otro
|
|
18
|
+
construyó su respuesta entera alrededor de cuatro candidatas que en su enunciado no existían.
|
|
19
|
+
|
|
20
|
+
Ninguno de los dos cambió de veredicto, así que nada parecía roto — pero sus respuestas dejaron de
|
|
21
|
+
ser las que esos casos pedían medir, y la independencia entre casos es la premisa de medir con
|
|
22
|
+
ellos. La bandera pasa a ser `evaluate <cargo> --bench <caso>`.
|
|
23
|
+
|
|
24
|
+
Preparar un banco ya no borra el del vecino, que puede estar a mitad de corrida, y el nombre del
|
|
25
|
+
caso se valida antes de convertirse en una ruta.
|
|
26
|
+
|
|
27
|
+
### Notas
|
|
28
|
+
|
|
29
|
+
- **`product-manager` tiene su primera medición válida: 5 de 5.** El registro anterior se había
|
|
30
|
+
descartado por tomarse dentro del toolkit, donde el cargo no tenía dónde escribir y se negaba —con
|
|
31
|
+
razón— en los dos casos que escriben. Con el banco, esos dos pasan.
|
|
32
|
+
|
|
33
|
+
Veinte citas textuales sostienen los veinte comportamientos. Queda escrito en el propio registro lo
|
|
34
|
+
que el juez de `03-epic` dejó anotado: no se produjo ningún criterio `CN`, y bajo un estándar que
|
|
35
|
+
exigiera criterios de épica específicamente ese comportamiento caería. El caso presupone una
|
|
36
|
+
oportunidad aprobada que no existía, y el cargo se negó a inventarla.
|
|
37
|
+
|
|
38
|
+
## [0.20.0] - 2026-08-17
|
|
39
|
+
|
|
40
|
+
Casi todo lo de abajo sale de la primera investigación semanal del cargo `security-engineer` corriendo
|
|
41
|
+
de verdad sobre este repositorio. De sus ocho hallazgos, dos resultaron sobredimensionados al
|
|
42
|
+
verificarlos y quedaron cerrados sin cambio; el resto está acá.
|
|
43
|
+
|
|
44
|
+
### Cambiado
|
|
45
|
+
|
|
46
|
+
- **El agente de investigación semanal ya no comparte job con la credencial de escritura.** Ingiere
|
|
47
|
+
contenido web que nadie controla, y hasta ahora corría con `contents: write` y la API key en el
|
|
48
|
+
mismo lugar: cualquier instrucción que llegara dentro de una página tenía un repositorio a mano.
|
|
49
|
+
|
|
50
|
+
Ahora entrega su informe como artifact y un segundo job lo commitea, sin modelo y sin credencial de
|
|
51
|
+
API. Ese job resuelve **dónde** aterriza el archivo con el mismo CLI que resolvió el catálogo, así
|
|
52
|
+
que nada de lo que viaje en el artifact puede redirigirlo. El permiso por defecto del workflow baja
|
|
53
|
+
a `contents: read`: un job nuevo ya no nace pudiendo escribir por herencia.
|
|
54
|
+
|
|
55
|
+
- **Las acciones de GitHub quedan fijadas por SHA de commit**, y el CLI del agente por versión. Un tag
|
|
56
|
+
es mutable: quien controle el repositorio de la acción puede moverlo a otro commit y el workflow
|
|
57
|
+
ejecuta código nuevo sin que cambie una línea acá.
|
|
58
|
+
|
|
59
|
+
- **`guard-secrets` reconoce los archivos de credencial que las herramientas escriben solas** —
|
|
60
|
+
`.npmrc`, `.netrc`, `id_rsa` y compañía—. Correr el guard sobre trece nombres mostró que `.env`
|
|
61
|
+
bloqueaba y esos pasaban, y `.npmrc` es donde vive el token de publicación. Tapa un caso conocido;
|
|
62
|
+
no vuelve completo al guard.
|
|
63
|
+
|
|
64
|
+
### Corregido
|
|
65
|
+
|
|
66
|
+
- **Los informes de aprendizaje traen escritas las convenciones de las que depende el ciclo.** Cuatro
|
|
67
|
+
corridas independientes etiquetaron sus hallazgos `H1`, `H2`, … sin que nada se lo pidiera, y esa
|
|
68
|
+
etiqueta terminó siendo carga: dentro del informe une «Hallazgos» con «Evidencia» y «Recomendación»,
|
|
69
|
+
y la propuesta mensual la cita para decir de qué hallazgo sale un cambio. Funcionaba porque los
|
|
70
|
+
modelos convergen, que es exactamente lo que deja de funcionar sin avisar.
|
|
71
|
+
|
|
72
|
+
Lo mismo con los títulos: la consolidación busca `## Recomendación` exacto y renombrarlo no da error
|
|
73
|
+
— deja la propuesta diciendo que no se registró nada.
|
|
74
|
+
|
|
75
|
+
### Removido
|
|
76
|
+
|
|
77
|
+
- **Se retiran 94 `_template.md` que el motor nunca leyó.** `learn` arma el andamiaje del informe y de
|
|
78
|
+
la propuesta desde un molde propio; esos archivos no los leía nadie: ni el motor, ni un workflow, ni
|
|
79
|
+
un runner, y ningún `SKILL.md` los nombra.
|
|
80
|
+
|
|
81
|
+
No eran inertes. **Quince de los cuarenta y siete describían una forma que el motor nunca produce**
|
|
82
|
+
—viñetas planas, sin sección de hallazgos y sin el título que la consolidación busca—, así que un
|
|
83
|
+
agente que respetara su molde habría reestructurado el informe y dejado la propuesta vacía sin
|
|
84
|
+
levantar nada.
|
|
85
|
+
|
|
86
|
+
Comprobado antes de retirarlos: sin sus moldes, `qa-engineer` sigue evaluando 7/7 y `learn` arma su
|
|
87
|
+
andamiaje igual. Adoptar un cargo pasa a copiar trece archivos en vez de quince.
|
|
88
|
+
|
|
89
|
+
### Notas de seguridad sin cambio
|
|
90
|
+
|
|
91
|
+
- **El token de npm no requiere acción.** El hallazgo lo describía como secreto de larga vida y sin
|
|
92
|
+
expiración; verificado, tiene ventana acotada, y la afirmación de que npm revocó los tokens clásicos
|
|
93
|
+
no se sostiene —el token funciona—. Lo único cierto que queda es que su alcance es de cuenta y no de
|
|
94
|
+
paquete: al renovarlo conviene acotarlo, y nada más.
|
|
95
|
+
|
|
96
|
+
- **Los guards no son un límite de seguridad**, y `automatization/hooks/README.md` ahora lo dice con
|
|
97
|
+
sus dos casos reproducibles. El riesgo real no es el bypass sino la confianza que doce guards
|
|
98
|
+
puestos inspiran: si algo tiene que ser imposible, va en permisos, alcance de token o revisión
|
|
99
|
+
humana, no en una coincidencia de texto.
|
|
100
|
+
|
|
11
101
|
## [0.19.0] - 2026-08-16
|
|
12
102
|
|
|
13
103
|
Los cuatro arreglos de abajo salieron de correr los tres caminos de punta a punta —un cargo que
|
package/README.md
CHANGED
|
@@ -80,7 +80,7 @@ Lee [template/planning/PROTOCOL.md](template/planning/PROTOCOL.md) para el contr
|
|
|
80
80
|
| `ops learn <agent>` | Prepara el informe semanal que completa la automatización de Codex. |
|
|
81
81
|
| `ops learn <agent> --proposal` | Consolida informes mensuales en una propuesta sin aplicar cambios. |
|
|
82
82
|
| `ops evaluate <agent>` | Valida controles, casos y propuestas del agente. |
|
|
83
|
-
| `ops evaluate <agent> --bench
|
|
83
|
+
| `ops evaluate <agent> --bench <caso>` | Arma el banco desechable donde un cargo trabaja ese caso. |
|
|
84
84
|
| `ops team list` | Lista equipos disponibles. |
|
|
85
85
|
| `ops team check <team>` | Valida manifiesto, agentes, dependencias y gates del equipo. |
|
|
86
86
|
| `ops team show <team>` | Muestra el recorrido y artefactos del equipo; `--json` para consumirlo. |
|
|
@@ -192,7 +192,7 @@ de INBOX necesita un `planning/` donde escribir sea legítimo. El toolkit no lo
|
|
|
192
192
|
el único `planning/` que vive acá es `template/planning`, el molde que se distribuye.
|
|
193
193
|
|
|
194
194
|
```bash
|
|
195
|
-
node engine/cli/ops.js evaluate product-manager --bench
|
|
195
|
+
node engine/cli/ops.js evaluate product-manager --bench 03-epic
|
|
196
196
|
```
|
|
197
197
|
|
|
198
198
|
Devuelve la ruta de una instancia desechable —`check` pasa, el catálogo resuelve desde adentro,
|
|
@@ -200,6 +200,11 @@ Devuelve la ruta de una instancia desechable —`check` pasa, el catálogo resue
|
|
|
200
200
|
recrea entera en cada corrida: reutilizarla dejaría que lo que un cargo escribió el lunes sea contexto
|
|
201
201
|
del que responde el martes.
|
|
202
202
|
|
|
203
|
+
**Una por caso**, y eso se aprendió corriendo. Con un banco compartido los casos de un cargo trabajan a
|
|
204
|
+
la vez sobre el mismo `planning/` y se leen entre sí: un caso tomó por «una sesión anterior de este
|
|
205
|
+
mismo cargo» lo que otro acababa de escribir, y otro evaluó cuatro candidatas que en su enunciado no
|
|
206
|
+
existían. Ninguno cambió de veredicto, pero sus respuestas dejaron de ser las que el caso pedía medir.
|
|
207
|
+
|
|
203
208
|
El veredicto se escribe **junto al cargo**, no en el banco. El banco se borra; el contrato queda.
|
|
204
209
|
|
|
205
210
|
Desde una empresa esto no aplica: su instancia ya es el lugar, y lo que se evalúa ahí tiene que ser un
|