santismm-knowledge-mcp 0.2.1
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/LICENSE +21 -0
- package/README.md +62 -0
- package/content/CONVENTIONS.md +77 -0
- package/content/LICENSE +55 -0
- package/content/architectures/ai-workforce.json +280 -0
- package/content/architectures/customer-service-agent.json +292 -0
- package/content/architectures/enterprise-knowledge-assistant.json +292 -0
- package/content/architectures/operations-center.json +280 -0
- package/content/architectures/sales-copilot.json +280 -0
- package/content/governance/agentic-ai-governance-checklist.json +323 -0
- package/content/governance/audit-framework-for-agentic-systems.json +280 -0
- package/content/governance/enterprise-ai-governance-framework.json +277 -0
- package/content/governance/eu-ai-act.json +162 -0
- package/content/governance/human-oversight-and-accountability-policy.json +275 -0
- package/content/governance/iso-42001.json +161 -0
- package/content/governance/mitre-atlas.json +280 -0
- package/content/governance/nist-ai-rmf.json +161 -0
- package/content/governance/owasp-llm-top10.json +301 -0
- package/content/harness/HRN-001-definition-and-overview.es.md +76 -0
- package/content/harness/HRN-001-definition-and-overview.md +125 -0
- package/content/harness/HRN-001-definition-and-overview.pt.md +76 -0
- package/content/harness/HRN-002-a-brief-history-of-harness-engineering.es.md +83 -0
- package/content/harness/HRN-002-a-brief-history-of-harness-engineering.md +113 -0
- package/content/harness/HRN-002-a-brief-history-of-harness-engineering.pt.md +83 -0
- package/content/harness/HRN-003-the-harness-taxonomy.es.md +105 -0
- package/content/harness/HRN-003-the-harness-taxonomy.md +158 -0
- package/content/harness/HRN-003-the-harness-taxonomy.pt.md +105 -0
- package/content/harness/HRN-004-harness-engineering-principles.es.md +91 -0
- package/content/harness/HRN-004-harness-engineering-principles.md +135 -0
- package/content/harness/HRN-004-harness-engineering-principles.pt.md +91 -0
- package/content/harness/HRN-005-memory-in-agentic-systems.es.md +98 -0
- package/content/harness/HRN-005-memory-in-agentic-systems.md +145 -0
- package/content/harness/HRN-005-memory-in-agentic-systems.pt.md +98 -0
- package/content/harness/HRN-006-observability-for-agentic-systems.es.md +97 -0
- package/content/harness/HRN-006-observability-for-agentic-systems.md +139 -0
- package/content/harness/HRN-006-observability-for-agentic-systems.pt.md +97 -0
- package/content/harness/HRN-007-evaluation-of-agentic-systems.es.md +96 -0
- package/content/harness/HRN-007-evaluation-of-agentic-systems.md +145 -0
- package/content/harness/HRN-007-evaluation-of-agentic-systems.pt.md +96 -0
- package/content/harness/HRN-008-governance-within-the-harness.es.md +105 -0
- package/content/harness/HRN-008-governance-within-the-harness.md +146 -0
- package/content/harness/HRN-008-governance-within-the-harness.pt.md +105 -0
- package/content/harness/HRN-009-planning-and-goal-management.es.md +102 -0
- package/content/harness/HRN-009-planning-and-goal-management.md +142 -0
- package/content/harness/HRN-009-planning-and-goal-management.pt.md +102 -0
- package/content/harness/HRN-010-orchestration.es.md +107 -0
- package/content/harness/HRN-010-orchestration.md +149 -0
- package/content/harness/HRN-010-orchestration.pt.md +107 -0
- package/content/harness/HRN-011-security-for-agentic-systems.es.md +107 -0
- package/content/harness/HRN-011-security-for-agentic-systems.md +147 -0
- package/content/harness/HRN-011-security-for-agentic-systems.pt.md +107 -0
- package/content/harness/HRN-012-case-studies-in-harness-engineering.es.md +120 -0
- package/content/harness/HRN-012-case-studies-in-harness-engineering.md +157 -0
- package/content/harness/HRN-012-case-studies-in-harness-engineering.pt.md +120 -0
- package/content/harness/HRN-013-glossary.es.md +109 -0
- package/content/harness/HRN-013-glossary.md +124 -0
- package/content/harness/HRN-013-glossary.pt.md +109 -0
- package/content/harness/HRN-014-bibliography.es.md +89 -0
- package/content/harness/HRN-014-bibliography.md +109 -0
- package/content/harness/HRN-014-bibliography.pt.md +89 -0
- package/content/homeric/episodes/achilles-and-hector.json +139 -0
- package/content/homeric/episodes/aeolus-and-the-winds.json +131 -0
- package/content/homeric/episodes/agamemnons-murder.json +162 -0
- package/content/homeric/episodes/calypso-ogygia.json +157 -0
- package/content/homeric/episodes/catalogue-of-ships.json +177 -0
- package/content/homeric/episodes/cattle-of-the-sun.json +131 -0
- package/content/homeric/episodes/chryse-and-the-plague.json +131 -0
- package/content/homeric/episodes/cicones-at-ismarus.json +131 -0
- package/content/homeric/episodes/circe-on-aeaea.json +131 -0
- package/content/homeric/episodes/cyclops-polyphemus.json +162 -0
- package/content/homeric/episodes/laestrygonians.json +153 -0
- package/content/homeric/episodes/lotus-eaters.json +138 -0
- package/content/homeric/episodes/menelaus-and-proteus.json +130 -0
- package/content/homeric/episodes/nekyia.json +160 -0
- package/content/homeric/episodes/phaeacians-on-scheria.json +129 -0
- package/content/homeric/episodes/priams-ransom.json +131 -0
- package/content/homeric/episodes/return-to-ithaca.json +167 -0
- package/content/homeric/episodes/scylla-and-charybdis.json +131 -0
- package/content/homeric/episodes/suitors-ambush-at-asteris.json +131 -0
- package/content/homeric/episodes/telemachus-at-pylos.json +130 -0
- package/content/homeric/episodes/telemachus-in-sparta.json +130 -0
- package/content/homeric/episodes/the-achaean-camp.json +138 -0
- package/content/homeric/episodes/the-sirens.json +129 -0
- package/content/homeric/episodes/wooden-horse.json +168 -0
- package/content/homeric/places/aeaea.json +129 -0
- package/content/homeric/places/aeolia.json +161 -0
- package/content/homeric/places/asteris.json +120 -0
- package/content/homeric/places/aulis.json +122 -0
- package/content/homeric/places/cape-malea.json +126 -0
- package/content/homeric/places/chryse.json +120 -0
- package/content/homeric/places/dodona.json +129 -0
- package/content/homeric/places/dulichium.json +177 -0
- package/content/homeric/places/egypt.json +125 -0
- package/content/homeric/places/ephyra-acheron.json +127 -0
- package/content/homeric/places/hellespont.json +125 -0
- package/content/homeric/places/house-of-hades.json +91 -0
- package/content/homeric/places/ismarus.json +120 -0
- package/content/homeric/places/ithaca.json +240 -0
- package/content/homeric/places/knossos.json +132 -0
- package/content/homeric/places/laestrygonia.json +168 -0
- package/content/homeric/places/land-of-the-cyclopes.json +169 -0
- package/content/homeric/places/land-of-the-lotus-eaters.json +122 -0
- package/content/homeric/places/mount-ida.json +126 -0
- package/content/homeric/places/mycenae.json +152 -0
- package/content/homeric/places/ogygia.json +125 -0
- package/content/homeric/places/pharos.json +120 -0
- package/content/homeric/places/planctae.json +77 -0
- package/content/homeric/places/pylos.json +188 -0
- package/content/homeric/places/same.json +177 -0
- package/content/homeric/places/scheria.json +129 -0
- package/content/homeric/places/scylla-and-charybdis.json +135 -0
- package/content/homeric/places/sirens.json +127 -0
- package/content/homeric/places/sparta.json +179 -0
- package/content/homeric/places/tenedos.json +129 -0
- package/content/homeric/places/thrinacia.json +116 -0
- package/content/homeric/places/tiryns.json +123 -0
- package/content/homeric/places/troy.json +224 -0
- package/content/homeric/places/zacynthus.json +126 -0
- package/content/homeric/routes/achaean-expedition.json +132 -0
- package/content/homeric/routes/nostoi-of-the-others.json +205 -0
- package/content/homeric/routes/odysseus-nostos.json +307 -0
- package/content/homeric/routes/telemachy.json +134 -0
- package/content/knowledge/agent-memory.json +153 -0
- package/content/knowledge/agentic-ai.json +158 -0
- package/content/knowledge/agentic-evaluation.json +156 -0
- package/content/knowledge/agentic-threat-model.json +287 -0
- package/content/knowledge/ai-agent.json +153 -0
- package/content/knowledge/ai-cyberdefense.json +274 -0
- package/content/knowledge/ai-governance.json +155 -0
- package/content/knowledge/ai-observability.json +156 -0
- package/content/knowledge/context-engineering.json +153 -0
- package/content/knowledge/embeddings.json +153 -0
- package/content/knowledge/enterprise-rag.json +154 -0
- package/content/knowledge/fine-tuning.json +153 -0
- package/content/knowledge/foundation-models.json +154 -0
- package/content/knowledge/guardrails.json +153 -0
- package/content/knowledge/harness-engineering.json +158 -0
- package/content/knowledge/human-in-the-loop.json +153 -0
- package/content/knowledge/mcp-security.json +284 -0
- package/content/knowledge/model-context-protocol.json +154 -0
- package/content/knowledge/multi-agent-architecture.json +153 -0
- package/content/knowledge/prompt-engineering.json +153 -0
- package/content/knowledge/prompt-injection.json +138 -0
- package/content/knowledge/reasoning-models.json +153 -0
- package/content/knowledge/tool-use.json +156 -0
- package/content/library/cognitive-architecture-emergent-ai.md +15 -0
- package/content/library/devready-ep108-ai-customer-experiences.md +14 -0
- package/content/library/how-genai-impact-business.md +12 -0
- package/content/library/lmm-reshaping-industries-2024.md +12 -0
- package/content/library/rethinking-ai-pause.md +12 -0
- package/content/library/rise-of-agentic-ai.md +16 -0
- package/content/library/self-improving-autonomous-ai.md +16 -0
- package/content/library/the-stopwatch-and-the-exam.md +12 -0
- package/content/library/unlock-gpt4-secrets.md +12 -0
- package/content/library/vibe-coding-enterprise.md +15 -0
- package/content/library/video-transformando-negocios-genai.md +14 -0
- package/content/library/video-volando-alto-sky-airlines.md +13 -0
- package/content/matrix/agentic-control-matrix.json +967 -0
- package/content/patterns/attributed-memory.json +237 -0
- package/content/patterns/context-compression.json +304 -0
- package/content/patterns/egress-allowlist.json +310 -0
- package/content/patterns/evaluator-optimizer.json +180 -0
- package/content/patterns/goal-decomposition.json +290 -0
- package/content/patterns/human-approval-gate.json +311 -0
- package/content/patterns/human-escalation.json +288 -0
- package/content/patterns/least-privilege-tooling.json +333 -0
- package/content/patterns/long-term-memory.json +305 -0
- package/content/patterns/orchestrator-workers.json +202 -0
- package/content/patterns/parallelization.json +180 -0
- package/content/patterns/prompt-chaining.json +181 -0
- package/content/patterns/recovery-strategy.json +305 -0
- package/content/patterns/reflection.json +298 -0
- package/content/patterns/routing.json +294 -0
- package/content/patterns/sandboxed-execution.json +311 -0
- package/content/patterns/semantic-caching.json +201 -0
- package/content/patterns/supervisor-agent.json +290 -0
- package/content/patterns/task-prioritization.json +307 -0
- package/dist/content.js +181 -0
- package/dist/index.js +27 -0
- package/dist/shape.js +649 -0
- package/dist/tools.js +652 -0
- package/package.json +47 -0
|
@@ -0,0 +1,323 @@
|
|
|
1
|
+
{
|
|
2
|
+
"id": "GOV-004",
|
|
3
|
+
"slug": "agentic-ai-governance-checklist",
|
|
4
|
+
"category": "playbook",
|
|
5
|
+
"updated": "2026-06-21",
|
|
6
|
+
"version": "1.0",
|
|
7
|
+
"featured": true,
|
|
8
|
+
"evidence": {
|
|
9
|
+
"evidenceLevel": "industry_observation",
|
|
10
|
+
"confidenceLevel": "medium",
|
|
11
|
+
"sourceType": [
|
|
12
|
+
"industry_observation",
|
|
13
|
+
"personal_experience"
|
|
14
|
+
]
|
|
15
|
+
},
|
|
16
|
+
"frameworks": [
|
|
17
|
+
"EU AI Act",
|
|
18
|
+
"ISO/IEC 42001",
|
|
19
|
+
"NIST AI RMF"
|
|
20
|
+
],
|
|
21
|
+
"patterns": [
|
|
22
|
+
"human-approval-gate",
|
|
23
|
+
"evaluator-optimizer",
|
|
24
|
+
"reflection",
|
|
25
|
+
"routing"
|
|
26
|
+
],
|
|
27
|
+
"knowledge": [
|
|
28
|
+
"ai-governance",
|
|
29
|
+
"guardrails",
|
|
30
|
+
"human-in-the-loop",
|
|
31
|
+
"ai-observability",
|
|
32
|
+
"agentic-evaluation",
|
|
33
|
+
"prompt-injection"
|
|
34
|
+
],
|
|
35
|
+
"references": [
|
|
36
|
+
{
|
|
37
|
+
"title": "NIST — AI Risk Management Framework (AI RMF 1.0)",
|
|
38
|
+
"url": "https://www.nist.gov/itl/ai-risk-management-framework"
|
|
39
|
+
},
|
|
40
|
+
{
|
|
41
|
+
"title": "EU AI Act — Article 14 (Human oversight)",
|
|
42
|
+
"url": "https://artificialintelligenceact.eu/article/14/"
|
|
43
|
+
},
|
|
44
|
+
{
|
|
45
|
+
"title": "OWASP — Top 10 for LLM Applications",
|
|
46
|
+
"url": "https://owasp.org/www-project-top-10-for-large-language-model-applications/"
|
|
47
|
+
}
|
|
48
|
+
],
|
|
49
|
+
"related": [
|
|
50
|
+
"eu-ai-act",
|
|
51
|
+
"iso-42001",
|
|
52
|
+
"nist-ai-rmf"
|
|
53
|
+
],
|
|
54
|
+
"locales": {
|
|
55
|
+
"en": {
|
|
56
|
+
"name": "Agentic AI Governance Checklist",
|
|
57
|
+
"summary": "A practical, vendor-neutral checklist for governing agentic AI in the enterprise — translating the principles of the EU AI Act, ISO/IEC 42001 and NIST AI RMF into concrete controls you can implement in a harness. It covers human oversight, guardrails, audit logging, evaluation, access control, prompt-injection defence and incident response, and maps each control to the patterns and knowledge units that operationalize it. Use it as a readiness gate before letting an agent act in production.",
|
|
58
|
+
"definition": "The agentic AI governance checklist is an operational control set that turns AI governance frameworks into concrete, implementable requirements for autonomous agents acting in production.",
|
|
59
|
+
"scope": "Teams building or deploying autonomous or semi-autonomous agents that use tools, act on systems, or make consequential decisions. It is a practical companion to the formal frameworks, not a substitute for legal advice.",
|
|
60
|
+
"keyPoints": [
|
|
61
|
+
"Human oversight by risk: gate high-impact, irreversible or regulated actions for human approval.",
|
|
62
|
+
"Guardrails on inputs and outputs, including prompt-injection and PII defence.",
|
|
63
|
+
"Full audit logging and observability so every action is traceable.",
|
|
64
|
+
"Evaluation before and after deployment, against a maintained eval set.",
|
|
65
|
+
"Least-privilege access for tools and data the agent can reach.",
|
|
66
|
+
"A defined incident response and kill-switch for agents in production."
|
|
67
|
+
],
|
|
68
|
+
"controls": [
|
|
69
|
+
{
|
|
70
|
+
"control": "Human approval gates",
|
|
71
|
+
"note": "Route high-impact actions through a human checkpoint (EU AI Act Art. 14). Implements the human-approval-gate pattern."
|
|
72
|
+
},
|
|
73
|
+
{
|
|
74
|
+
"control": "Guardrails",
|
|
75
|
+
"note": "Validate and constrain inputs and outputs; defend against prompt injection and block out-of-policy actions."
|
|
76
|
+
},
|
|
77
|
+
{
|
|
78
|
+
"control": "Audit logging & observability",
|
|
79
|
+
"note": "Trace every decision, tool call and action so the agent is reviewable and incidents are reconstructable."
|
|
80
|
+
},
|
|
81
|
+
{
|
|
82
|
+
"control": "Evaluation harness",
|
|
83
|
+
"note": "Score behaviour against an eval set before shipping and monitor for regressions after — NIST 'Measure'."
|
|
84
|
+
},
|
|
85
|
+
{
|
|
86
|
+
"control": "Least-privilege access",
|
|
87
|
+
"note": "Scope the tools, data and permissions an agent can reach to the minimum its task requires."
|
|
88
|
+
},
|
|
89
|
+
{
|
|
90
|
+
"control": "Incident response & kill-switch",
|
|
91
|
+
"note": "Define how to detect, stop and remediate a misbehaving agent, including a way to halt it immediately."
|
|
92
|
+
}
|
|
93
|
+
],
|
|
94
|
+
"checklist": [
|
|
95
|
+
"Classify the agent's risk and identify which actions need human approval.",
|
|
96
|
+
"Implement guardrails for inputs/outputs and prompt-injection defence.",
|
|
97
|
+
"Enable end-to-end audit logging and observability.",
|
|
98
|
+
"Stand up an evaluation set and run it pre-deployment and continuously.",
|
|
99
|
+
"Apply least-privilege scoping to tools, data and credentials.",
|
|
100
|
+
"Define incident response, monitoring thresholds and a kill-switch.",
|
|
101
|
+
"Map each control to your obligations under the EU AI Act, ISO 42001 and NIST AI RMF.",
|
|
102
|
+
"Document ownership and review the agent on a schedule."
|
|
103
|
+
],
|
|
104
|
+
"pitfalls": [
|
|
105
|
+
"Granting an agent broad tool/data access 'to be safe', creating a large blast radius.",
|
|
106
|
+
"Gating everything (approval fatigue) or nothing (no oversight) instead of gating by risk.",
|
|
107
|
+
"Shipping without an eval set, so quality and safety are unmeasured.",
|
|
108
|
+
"No kill-switch or incident plan when an agent misbehaves in production.",
|
|
109
|
+
"Ignoring prompt injection as an attack surface for tool-using agents."
|
|
110
|
+
],
|
|
111
|
+
"productionEvidence": {
|
|
112
|
+
"context": "Teams putting an autonomous or semi-autonomous agent into production where it uses tools and takes consequential actions.",
|
|
113
|
+
"scenario": "Before go-live, the team runs the checklist as a readiness gate: classify the agent's risk, gate high-impact actions for human approval, add guardrails and prompt-injection defence, enable audit logging and observability, stand up an evaluation set, scope least-privilege access, and define incident response and a kill-switch.",
|
|
114
|
+
"technology": "A harness combining a human-approval gate, guardrails, audit logging/observability, an evaluation harness and scoped tool/credential access.",
|
|
115
|
+
"load": "Applied per agent before deployment and re-reviewed on a schedule; the heaviest control (human approval) is reserved for the small set of high-impact actions.",
|
|
116
|
+
"results": "Observed pattern: teams that gate by risk, enforce least privilege and instrument from day one contain the blast radius of agent errors; those that grant broad access 'to be safe' or ship without evals discover failures in production. Measure escalation appropriateness, false-action rate and mean time to detect."
|
|
117
|
+
},
|
|
118
|
+
"lessons": [
|
|
119
|
+
"Treat the checklist as a readiness gate, not a one-time audit — re-run it as the agent's tools and autonomy grow.",
|
|
120
|
+
"Least-privilege access and risk-based human approval bound the blast radius more than any single guardrail.",
|
|
121
|
+
"Without an evaluation set and audit logging in place before launch, you cannot tell a safe agent from a lucky one.",
|
|
122
|
+
"Map each control to a concrete owner; governance without accountability is just documentation."
|
|
123
|
+
],
|
|
124
|
+
"examples": [
|
|
125
|
+
"An agent whose refund action is gated for human approval while read-only lookups run freely.",
|
|
126
|
+
"A guardrail blocking a prompt-injected instruction to exfiltrate data via a tool.",
|
|
127
|
+
"An evaluation run catching a safety regression before an agent update ships."
|
|
128
|
+
],
|
|
129
|
+
"faqs": [
|
|
130
|
+
{
|
|
131
|
+
"q": "Is this a substitute for the EU AI Act or ISO 42001?",
|
|
132
|
+
"a": "No. It is a practical control set that operationalizes their principles for agents. Use it alongside the formal frameworks and legal advice, not instead of them."
|
|
133
|
+
},
|
|
134
|
+
{
|
|
135
|
+
"q": "Which control matters most for autonomous agents?",
|
|
136
|
+
"a": "Risk-based human oversight plus least-privilege access and audit logging — together they bound what an agent can do and make every action accountable."
|
|
137
|
+
},
|
|
138
|
+
{
|
|
139
|
+
"q": "How does it connect to the patterns library?",
|
|
140
|
+
"a": "Each control maps to patterns that implement it — human-approval-gate for oversight, reflection and evaluator-optimizer for quality — and to knowledge units like guardrails and AI observability."
|
|
141
|
+
}
|
|
142
|
+
]
|
|
143
|
+
},
|
|
144
|
+
"es": {
|
|
145
|
+
"name": "Checklist de Gobernanza de IA Agéntica",
|
|
146
|
+
"summary": "Un checklist práctico y neutral para gobernar la IA agéntica en la empresa, que traduce los principios del EU AI Act, ISO/IEC 42001 y NIST AI RMF en controles concretos que puedes implementar en un harness. Cubre supervisión humana, guardarraíles, registro de auditoría, evaluación, control de acceso, defensa frente a inyección de prompts y respuesta a incidentes, y mapea cada control a los patrones y unidades de conocimiento que lo operacionalizan. Úsalo como puerta de preparación antes de dejar que un agente actúe en producción.",
|
|
147
|
+
"definition": "El checklist de gobernanza de IA agéntica es un conjunto de controles operativos que convierte los marcos de gobernanza de IA en requisitos concretos e implementables para agentes autónomos que actúan en producción.",
|
|
148
|
+
"scope": "Equipos que construyen o despliegan agentes autónomos o semiautónomos que usan herramientas, actúan sobre sistemas o toman decisiones de consecuencia. Es un compañero práctico de los marcos formales, no un sustituto del asesoramiento legal.",
|
|
149
|
+
"keyPoints": [
|
|
150
|
+
"Supervisión humana por riesgo: pon puertas de aprobación a las acciones de alto impacto, irreversibles o reguladas.",
|
|
151
|
+
"Guardarraíles en entradas y salidas, incluyendo defensa frente a inyección de prompts y PII.",
|
|
152
|
+
"Registro de auditoría y observabilidad completos para que cada acción sea trazable.",
|
|
153
|
+
"Evaluación antes y después del despliegue, contra un conjunto de evaluación mantenido.",
|
|
154
|
+
"Acceso de mínimo privilegio a las herramientas y datos que el agente puede alcanzar.",
|
|
155
|
+
"Una respuesta a incidentes y un interruptor de parada definidos para los agentes en producción."
|
|
156
|
+
],
|
|
157
|
+
"controls": [
|
|
158
|
+
{
|
|
159
|
+
"control": "Puertas de aprobación humana",
|
|
160
|
+
"note": "Enruta las acciones de alto impacto por un punto de control humano (Art. 14 del EU AI Act). Implementa el patrón de puerta de aprobación humana."
|
|
161
|
+
},
|
|
162
|
+
{
|
|
163
|
+
"control": "Guardarraíles",
|
|
164
|
+
"note": "Valida y restringe entradas y salidas; defiende frente a la inyección de prompts y bloquea acciones fuera de política."
|
|
165
|
+
},
|
|
166
|
+
{
|
|
167
|
+
"control": "Registro de auditoría y observabilidad",
|
|
168
|
+
"note": "Traza cada decisión, llamada a herramienta y acción para que el agente sea revisable y los incidentes reconstruibles."
|
|
169
|
+
},
|
|
170
|
+
{
|
|
171
|
+
"control": "Arnés de evaluación",
|
|
172
|
+
"note": "Puntúa el comportamiento frente a un conjunto de evaluación antes de desplegar y monitoriza regresiones después: el 'Medir' del NIST."
|
|
173
|
+
},
|
|
174
|
+
{
|
|
175
|
+
"control": "Acceso de mínimo privilegio",
|
|
176
|
+
"note": "Acota las herramientas, los datos y los permisos que un agente puede alcanzar al mínimo que su tarea requiere."
|
|
177
|
+
},
|
|
178
|
+
{
|
|
179
|
+
"control": "Respuesta a incidentes e interruptor de parada",
|
|
180
|
+
"note": "Define cómo detectar, detener y remediar un agente que se comporta mal, incluyendo una forma de pararlo de inmediato."
|
|
181
|
+
}
|
|
182
|
+
],
|
|
183
|
+
"checklist": [
|
|
184
|
+
"Clasifica el riesgo del agente e identifica qué acciones necesitan aprobación humana.",
|
|
185
|
+
"Implementa guardarraíles para entradas/salidas y defensa frente a inyección de prompts.",
|
|
186
|
+
"Habilita registro de auditoría y observabilidad de extremo a extremo.",
|
|
187
|
+
"Monta un conjunto de evaluación y ejecútalo antes del despliegue y de forma continua.",
|
|
188
|
+
"Aplica mínimo privilegio a herramientas, datos y credenciales.",
|
|
189
|
+
"Define respuesta a incidentes, umbrales de monitorización y un interruptor de parada.",
|
|
190
|
+
"Mapea cada control a tus obligaciones bajo el EU AI Act, ISO 42001 y NIST AI RMF.",
|
|
191
|
+
"Documenta la responsabilidad y revisa el agente de forma periódica."
|
|
192
|
+
],
|
|
193
|
+
"pitfalls": [
|
|
194
|
+
"Dar a un agente amplio acceso a herramientas/datos 'por si acaso', creando un gran radio de impacto.",
|
|
195
|
+
"Poner puertas a todo (fatiga de aprobación) o a nada (sin supervisión) en vez de hacerlo por riesgo.",
|
|
196
|
+
"Desplegar sin un conjunto de evaluación, dejando calidad y seguridad sin medir.",
|
|
197
|
+
"No tener interruptor de parada ni plan de incidentes cuando un agente se comporta mal en producción.",
|
|
198
|
+
"Ignorar la inyección de prompts como superficie de ataque para agentes con herramientas."
|
|
199
|
+
],
|
|
200
|
+
"productionEvidence": {
|
|
201
|
+
"context": "Equipos que ponen en producción un agente autónomo o semiautónomo que usa herramientas y toma acciones de consecuencia.",
|
|
202
|
+
"scenario": "Antes del lanzamiento, el equipo ejecuta el checklist como puerta de preparación: clasifica el riesgo del agente, pone puertas de aprobación humana a las acciones de alto impacto, añade guardarraíles y defensa frente a inyección de prompts, habilita registro de auditoría y observabilidad, monta un conjunto de evaluación, acota el acceso de mínimo privilegio y define respuesta a incidentes y un interruptor de parada.",
|
|
203
|
+
"technology": "Un harness que combina una puerta de aprobación humana, guardarraíles, registro de auditoría/observabilidad, un arnés de evaluación y acceso acotado a herramientas y credenciales.",
|
|
204
|
+
"load": "Se aplica por agente antes del despliegue y se revisa de forma periódica; el control más pesado (aprobación humana) se reserva para el pequeño conjunto de acciones de alto impacto.",
|
|
205
|
+
"results": "Patrón observado: los equipos que ponen puertas por riesgo, aplican mínimo privilegio e instrumentan desde el día uno contienen el radio de impacto de los errores del agente; los que dan acceso amplio 'por si acaso' o despliegan sin evaluaciones descubren los fallos en producción. Mide la idoneidad del escalado, la tasa de acciones erróneas y el tiempo medio de detección."
|
|
206
|
+
},
|
|
207
|
+
"lessons": [
|
|
208
|
+
"Trata el checklist como una puerta de preparación, no como una auditoría puntual: vuelve a ejecutarlo a medida que crecen las herramientas y la autonomía del agente.",
|
|
209
|
+
"El acceso de mínimo privilegio y la aprobación humana basada en riesgo acotan el radio de impacto más que cualquier guardarraíl aislado.",
|
|
210
|
+
"Sin un conjunto de evaluación y registro de auditoría antes del lanzamiento, no puedes distinguir un agente seguro de uno con suerte.",
|
|
211
|
+
"Asigna cada control a un responsable concreto; la gobernanza sin rendición de cuentas es solo documentación."
|
|
212
|
+
],
|
|
213
|
+
"examples": [
|
|
214
|
+
"Un agente cuya acción de reembolso tiene puerta de aprobación humana mientras las consultas de solo lectura corren libres.",
|
|
215
|
+
"Un guardarraíl que bloquea una instrucción inyectada para exfiltrar datos mediante una herramienta.",
|
|
216
|
+
"Una ejecución de evaluación que detecta una regresión de seguridad antes de desplegar una actualización del agente."
|
|
217
|
+
],
|
|
218
|
+
"faqs": [
|
|
219
|
+
{
|
|
220
|
+
"q": "¿Esto sustituye al EU AI Act o a ISO 42001?",
|
|
221
|
+
"a": "No. Es un conjunto de controles práctico que operacionaliza sus principios para agentes. Úsalo junto a los marcos formales y al asesoramiento legal, no en su lugar."
|
|
222
|
+
},
|
|
223
|
+
{
|
|
224
|
+
"q": "¿Qué control importa más para los agentes autónomos?",
|
|
225
|
+
"a": "La supervisión humana basada en riesgo más el acceso de mínimo privilegio y el registro de auditoría: juntos acotan lo que un agente puede hacer y hacen cada acción responsable."
|
|
226
|
+
},
|
|
227
|
+
{
|
|
228
|
+
"q": "¿Cómo conecta con la biblioteca de patrones?",
|
|
229
|
+
"a": "Cada control mapea a patrones que lo implementan —puerta de aprobación humana para la supervisión, reflexión y evaluador-optimizador para la calidad— y a unidades de conocimiento como guardarraíles y observabilidad de IA."
|
|
230
|
+
}
|
|
231
|
+
]
|
|
232
|
+
},
|
|
233
|
+
"pt": {
|
|
234
|
+
"name": "Checklist de Governança de IA Agêntica",
|
|
235
|
+
"summary": "Um checklist prático e neutro para governar a IA agêntica na empresa, que traduz os princípios do EU AI Act, ISO/IEC 42001 e NIST AI RMF em controles concretos que você pode implementar num harness. Cobre supervisão humana, guard-rails, registro de auditoria, avaliação, controle de acesso, defesa contra injeção de prompts e resposta a incidentes, e mapeia cada controle aos padrões e unidades de conhecimento que o operacionalizam. Use-o como portão de prontidão antes de deixar um agente agir em produção.",
|
|
236
|
+
"definition": "O checklist de governança de IA agêntica é um conjunto de controles operacionais que transforma os frameworks de governança de IA em requisitos concretos e implementáveis para agentes autônomos que agem em produção.",
|
|
237
|
+
"scope": "Equipes que constroem ou implantam agentes autônomos ou semiautônomos que usam ferramentas, agem sobre sistemas ou tomam decisões consequentes. É um companheiro prático dos frameworks formais, não um substituto de aconselhamento jurídico.",
|
|
238
|
+
"keyPoints": [
|
|
239
|
+
"Supervisão humana por risco: coloque portões de aprovação nas ações de alto impacto, irreversíveis ou reguladas.",
|
|
240
|
+
"Guard-rails em entradas e saídas, incluindo defesa contra injeção de prompts e PII.",
|
|
241
|
+
"Registro de auditoria e observabilidade completos para que cada ação seja rastreável.",
|
|
242
|
+
"Avaliação antes e depois da implantação, contra um conjunto de avaliação mantido.",
|
|
243
|
+
"Acesso de menor privilégio às ferramentas e dados que o agente pode alcançar.",
|
|
244
|
+
"Uma resposta a incidentes e um interruptor de parada definidos para os agentes em produção."
|
|
245
|
+
],
|
|
246
|
+
"controls": [
|
|
247
|
+
{
|
|
248
|
+
"control": "Portões de aprovação humana",
|
|
249
|
+
"note": "Roteie as ações de alto impacto por um ponto de controle humano (Art. 14 do EU AI Act). Implementa o padrão de portão de aprovação humana."
|
|
250
|
+
},
|
|
251
|
+
{
|
|
252
|
+
"control": "Guard-rails",
|
|
253
|
+
"note": "Valide e restrinja entradas e saídas; defenda contra a injeção de prompts e bloqueie ações fora da política."
|
|
254
|
+
},
|
|
255
|
+
{
|
|
256
|
+
"control": "Registro de auditoria e observabilidade",
|
|
257
|
+
"note": "Rastreie cada decisão, chamada de ferramenta e ação para que o agente seja revisável e os incidentes reconstruíveis."
|
|
258
|
+
},
|
|
259
|
+
{
|
|
260
|
+
"control": "Harness de avaliação",
|
|
261
|
+
"note": "Pontue o comportamento contra um conjunto de avaliação antes de implantar e monitore regressões depois: o 'Medir' do NIST."
|
|
262
|
+
},
|
|
263
|
+
{
|
|
264
|
+
"control": "Acesso de menor privilégio",
|
|
265
|
+
"note": "Restrinja as ferramentas, os dados e as permissões que um agente pode alcançar ao mínimo que sua tarefa requer."
|
|
266
|
+
},
|
|
267
|
+
{
|
|
268
|
+
"control": "Resposta a incidentes e interruptor de parada",
|
|
269
|
+
"note": "Defina como detectar, parar e remediar um agente que se comporta mal, incluindo uma forma de pará-lo imediatamente."
|
|
270
|
+
}
|
|
271
|
+
],
|
|
272
|
+
"checklist": [
|
|
273
|
+
"Classifique o risco do agente e identifique quais ações precisam de aprovação humana.",
|
|
274
|
+
"Implemente guard-rails para entradas/saídas e defesa contra injeção de prompts.",
|
|
275
|
+
"Habilite registro de auditoria e observabilidade ponta a ponta.",
|
|
276
|
+
"Monte um conjunto de avaliação e execute-o antes da implantação e continuamente.",
|
|
277
|
+
"Aplique menor privilégio a ferramentas, dados e credenciais.",
|
|
278
|
+
"Defina resposta a incidentes, limiares de monitoramento e um interruptor de parada.",
|
|
279
|
+
"Mapeie cada controle para suas obrigações sob o EU AI Act, ISO 42001 e NIST AI RMF.",
|
|
280
|
+
"Documente a responsabilidade e revise o agente periodicamente."
|
|
281
|
+
],
|
|
282
|
+
"pitfalls": [
|
|
283
|
+
"Dar a um agente amplo acesso a ferramentas/dados 'por precaução', criando um grande raio de impacto.",
|
|
284
|
+
"Colocar portões em tudo (fadiga de aprovação) ou em nada (sem supervisão) em vez de fazê-lo por risco.",
|
|
285
|
+
"Implantar sem um conjunto de avaliação, deixando qualidade e segurança sem medição.",
|
|
286
|
+
"Não ter interruptor de parada nem plano de incidentes quando um agente se comporta mal em produção.",
|
|
287
|
+
"Ignorar a injeção de prompts como superfície de ataque para agentes com ferramentas."
|
|
288
|
+
],
|
|
289
|
+
"productionEvidence": {
|
|
290
|
+
"context": "Equipes que colocam em produção um agente autônomo ou semiautônomo que usa ferramentas e toma ações consequentes.",
|
|
291
|
+
"scenario": "Antes do go-live, a equipe executa o checklist como portão de prontidão: classifica o risco do agente, coloca portões de aprovação humana nas ações de alto impacto, adiciona guard-rails e defesa contra injeção de prompts, habilita registro de auditoria e observabilidade, monta um conjunto de avaliação, restringe o acesso de menor privilégio e define resposta a incidentes e um interruptor de parada.",
|
|
292
|
+
"technology": "Um harness que combina um portão de aprovação humana, guard-rails, registro de auditoria/observabilidade, um harness de avaliação e acesso restrito a ferramentas e credenciais.",
|
|
293
|
+
"load": "Aplicado por agente antes da implantação e revisado periodicamente; o controle mais pesado (aprovação humana) é reservado para o pequeno conjunto de ações de alto impacto.",
|
|
294
|
+
"results": "Padrão observado: equipes que colocam portões por risco, aplicam menor privilégio e instrumentam desde o dia um contêm o raio de impacto dos erros do agente; as que dão acesso amplo 'por precaução' ou implantam sem avaliações descobrem as falhas em produção. Meça a adequação do escalonamento, a taxa de ações erradas e o tempo médio de detecção."
|
|
295
|
+
},
|
|
296
|
+
"lessons": [
|
|
297
|
+
"Trate o checklist como um portão de prontidão, não como uma auditoria pontual: execute-o novamente à medida que as ferramentas e a autonomia do agente crescem.",
|
|
298
|
+
"O acesso de menor privilégio e a aprovação humana baseada em risco limitam o raio de impacto mais do que qualquer guard-rail isolado.",
|
|
299
|
+
"Sem um conjunto de avaliação e registro de auditoria antes do lançamento, você não distingue um agente seguro de um com sorte.",
|
|
300
|
+
"Atribua cada controle a um responsável concreto; governança sem prestação de contas é só documentação."
|
|
301
|
+
],
|
|
302
|
+
"examples": [
|
|
303
|
+
"Um agente cuja ação de reembolso tem portão de aprovação humana enquanto as consultas somente leitura correm livres.",
|
|
304
|
+
"Um guard-rail que bloqueia uma instrução injetada para exfiltrar dados via uma ferramenta.",
|
|
305
|
+
"Uma execução de avaliação que detecta uma regressão de segurança antes de implantar uma atualização do agente."
|
|
306
|
+
],
|
|
307
|
+
"faqs": [
|
|
308
|
+
{
|
|
309
|
+
"q": "Isto substitui o EU AI Act ou a ISO 42001?",
|
|
310
|
+
"a": "Não. É um conjunto de controles prático que operacionaliza seus princípios para agentes. Use-o junto aos frameworks formais e ao aconselhamento jurídico, não no lugar deles."
|
|
311
|
+
},
|
|
312
|
+
{
|
|
313
|
+
"q": "Qual controle importa mais para os agentes autônomos?",
|
|
314
|
+
"a": "A supervisão humana baseada em risco mais o acesso de menor privilégio e o registro de auditoria: juntos limitam o que um agente pode fazer e tornam cada ação responsável."
|
|
315
|
+
},
|
|
316
|
+
{
|
|
317
|
+
"q": "Como conecta com a biblioteca de padrões?",
|
|
318
|
+
"a": "Cada controle mapeia para padrões que o implementam —portão de aprovação humana para a supervisão, reflexão e avaliador-otimizador para a qualidade— e para unidades de conhecimento como guard-rails e observabilidade de IA."
|
|
319
|
+
}
|
|
320
|
+
]
|
|
321
|
+
}
|
|
322
|
+
}
|
|
323
|
+
}
|
|
@@ -0,0 +1,280 @@
|
|
|
1
|
+
{
|
|
2
|
+
"id": "GOV-006",
|
|
3
|
+
"slug": "audit-framework-for-agentic-systems",
|
|
4
|
+
"category": "framework",
|
|
5
|
+
"updated": "2026-06-21",
|
|
6
|
+
"version": "1.0",
|
|
7
|
+
"featured": false,
|
|
8
|
+
"evidence": {
|
|
9
|
+
"evidenceLevel": "industry_observation",
|
|
10
|
+
"confidenceLevel": "medium",
|
|
11
|
+
"sourceType": [
|
|
12
|
+
"industry_observation",
|
|
13
|
+
"paper"
|
|
14
|
+
]
|
|
15
|
+
},
|
|
16
|
+
"frameworks": [
|
|
17
|
+
"ISO/IEC 42001",
|
|
18
|
+
"NIST AI RMF"
|
|
19
|
+
],
|
|
20
|
+
"patterns": [
|
|
21
|
+
"human-approval-gate",
|
|
22
|
+
"evaluator-optimizer"
|
|
23
|
+
],
|
|
24
|
+
"knowledge": [
|
|
25
|
+
"ai-observability",
|
|
26
|
+
"agentic-evaluation",
|
|
27
|
+
"ai-governance"
|
|
28
|
+
],
|
|
29
|
+
"references": [
|
|
30
|
+
{
|
|
31
|
+
"title": "NIST — AI Risk Management Framework (AI RMF 1.0)",
|
|
32
|
+
"url": "https://www.nist.gov/itl/ai-risk-management-framework"
|
|
33
|
+
},
|
|
34
|
+
{
|
|
35
|
+
"title": "ISO/IEC 42001:2023 — AI management systems",
|
|
36
|
+
"url": "https://www.iso.org/standard/81230.html"
|
|
37
|
+
},
|
|
38
|
+
{
|
|
39
|
+
"title": "ISACA — Auditing Artificial Intelligence",
|
|
40
|
+
"url": "https://www.isaca.org/resources/white-papers/2024/auditing-artificial-intelligence"
|
|
41
|
+
}
|
|
42
|
+
],
|
|
43
|
+
"related": [
|
|
44
|
+
"agentic-ai-governance-checklist",
|
|
45
|
+
"nist-ai-rmf",
|
|
46
|
+
"iso-42001",
|
|
47
|
+
"owasp-llm-top10",
|
|
48
|
+
"mitre-atlas"
|
|
49
|
+
],
|
|
50
|
+
"locales": {
|
|
51
|
+
"en": {
|
|
52
|
+
"name": "Audit Framework for Agentic Systems",
|
|
53
|
+
"summary": "A practical, vendor-neutral framework for making an agent auditable and for auditing it. It defines the evidence an independent reviewer needs — immutable, correlated traces of every decision and tool call, model and version provenance, evaluation reports, approval and incident records — and how to test controls and sample high-volume runs. Each evidence type maps to ISO/IEC 42001 and NIST AI RMF so an auditor can verify the agent stayed within its governed bounds. Use it to design auditability in from the start, not as an afterthought.",
|
|
54
|
+
"definition": "An agent audit is an independent, evidence-based examination that determines whether an agentic system operated within its authorized scope, controls and policies over a defined period, and whether the governance claims made about it are supported by reliable evidence.",
|
|
55
|
+
"scope": "Auditors, assurance and risk teams, and the system owners who must make their agents auditable by design. It applies to autonomous or semi-autonomous agents that use tools and act over time, and supports both internal assurance and external or regulatory audit. It is a practical companion to the formal frameworks, not a substitute for legal advice.",
|
|
56
|
+
"keyPoints": [
|
|
57
|
+
"Auditability by design: the agent must emit enough structured evidence at runtime to reconstruct any run later.",
|
|
58
|
+
"Every run produces an immutable, correlated trace: goal, each step and tool call with parameters and results, approvals, overrides and outcome.",
|
|
59
|
+
"Evidence must be complete, attributable, time-stamped and tamper-evident to hold evidentiary value.",
|
|
60
|
+
"Model and version provenance (prompt, tools, model) is captured per run so behaviour is tied to a known configuration.",
|
|
61
|
+
"Sampling is layered: risk-stratified, statistical, and 100% review of all exceptions, overrides, denials and incidents.",
|
|
62
|
+
"Audit evidence maps to ISO/IEC 42001 internal audit (Clause 9) and NIST AI RMF Measure and Manage functions."
|
|
63
|
+
],
|
|
64
|
+
"controls": [
|
|
65
|
+
{
|
|
66
|
+
"control": "Immutable audit logs and traceability",
|
|
67
|
+
"note": "Capture a correlated trace per run — agent identity and version, goal, each step, tool call, result, approvals and outcome — and protect it against alteration. Implements AI observability."
|
|
68
|
+
},
|
|
69
|
+
{
|
|
70
|
+
"control": "Model and version provenance",
|
|
71
|
+
"note": "Record the exact prompt, tool set and model version behind each run so behaviour is attributable to a known, reproducible-by-config baseline."
|
|
72
|
+
},
|
|
73
|
+
{
|
|
74
|
+
"control": "Evaluation evidence",
|
|
75
|
+
"note": "Retain pre-deployment and ongoing evaluation reports and gate results so the auditor can verify safety and quality were measured — NIST 'Measure'."
|
|
76
|
+
},
|
|
77
|
+
{
|
|
78
|
+
"control": "Control testing and sampling",
|
|
79
|
+
"note": "Test each control against evidence using a documented sampling methodology: risk-stratified, statistical, and full exception review."
|
|
80
|
+
},
|
|
81
|
+
{
|
|
82
|
+
"control": "Approval and incident records",
|
|
83
|
+
"note": "Capture human approvals, overrides and incidents with actor identity and timestamps. Implements the human-approval-gate pattern."
|
|
84
|
+
},
|
|
85
|
+
{
|
|
86
|
+
"control": "Attestations and findings management",
|
|
87
|
+
"note": "System and control owners sign attestations backed by evidence; findings are tracked to closure with severity and deadlines."
|
|
88
|
+
}
|
|
89
|
+
],
|
|
90
|
+
"checklist": [
|
|
91
|
+
"Confirm every agent run produces a complete, correlated trace tied by a stable trace ID.",
|
|
92
|
+
"Verify logs are tamper-evident, time-stamped and retained for the full audit and regulatory window.",
|
|
93
|
+
"Check that each run records model and version provenance (prompt, tools, model version).",
|
|
94
|
+
"Retrieve a control mapping / Statement of Applicability linking each control to its evidence.",
|
|
95
|
+
"Retain and review pre-deployment and ongoing evaluation reports and gate outcomes.",
|
|
96
|
+
"Confirm approval, override and incident records exist with actor identity and timestamps.",
|
|
97
|
+
"Apply a documented sampling methodology — risk-stratified, statistical, and 100% exception coverage.",
|
|
98
|
+
"Track findings to closure with severity and deadlines, and collect signed owner attestations."
|
|
99
|
+
],
|
|
100
|
+
"pitfalls": [
|
|
101
|
+
"Non-auditable agents: logging added as an afterthought, leaving gaps no audit can fill.",
|
|
102
|
+
"Mutable logs: records that could be altered, destroying their evidentiary value.",
|
|
103
|
+
"Sampling blind spots: random-only sampling that misses rare but catastrophic actions.",
|
|
104
|
+
"Attestation without evidence: owners signing off on controls they cannot demonstrate.",
|
|
105
|
+
"Findings graveyard: issues raised but never remediated or re-tested."
|
|
106
|
+
],
|
|
107
|
+
"examples": [
|
|
108
|
+
"An auditor reconstructs a disputed refund by following its correlated trace from goal to tool call to human approval.",
|
|
109
|
+
"A continuous-audit check alerts on a tool call outside the allow-list against the live log stream.",
|
|
110
|
+
"Retained evaluation reports map to NIST AI RMF Measure, evidencing that safety gates passed before deployment."
|
|
111
|
+
],
|
|
112
|
+
"faqs": [
|
|
113
|
+
{
|
|
114
|
+
"q": "Can you audit a non-deterministic agent at all?",
|
|
115
|
+
"a": "Yes — you audit the controls and the recorded behaviour, not the determinism. Complete, immutable traces make any specific run reconstructable even if it cannot be reproduced exactly."
|
|
116
|
+
},
|
|
117
|
+
{
|
|
118
|
+
"q": "How big should the audit sample be?",
|
|
119
|
+
"a": "Large enough for your target assurance level statistically, plus 100% of exceptions and high-impact actions. Sampling never replaces full exception review."
|
|
120
|
+
},
|
|
121
|
+
{
|
|
122
|
+
"q": "How does audit evidence map to the frameworks?",
|
|
123
|
+
"a": "Traces and logs support NIST AI RMF Measure and Manage and ISO/IEC 42001 Clause 9 internal audit; a control mapping or Statement of Applicability links each control to the evidence that proves it operated."
|
|
124
|
+
}
|
|
125
|
+
]
|
|
126
|
+
},
|
|
127
|
+
"es": {
|
|
128
|
+
"name": "Marco de Auditoría para Sistemas Agénticos",
|
|
129
|
+
"summary": "Un marco práctico y neutral para hacer un agente auditable y para auditarlo. Define la evidencia que necesita un revisor independiente —trazas inmutables y correlacionadas de cada decisión y llamada a herramienta, procedencia de modelo y versión, informes de evaluación, registros de aprobación e incidentes— y cómo probar controles y muestrear ejecuciones de alto volumen. Cada tipo de evidencia se mapea a ISO/IEC 42001 y NIST AI RMF para que un auditor pueda verificar que el agente se mantuvo dentro de sus límites gobernados. Úsalo para diseñar la auditabilidad desde el inicio, no como algo añadido después.",
|
|
130
|
+
"definition": "Una auditoría de agente es un examen independiente y basado en evidencia que determina si un sistema agéntico operó dentro de su alcance, controles y políticas autorizados durante un periodo definido, y si las afirmaciones de gobernanza hechas sobre él se sustentan en evidencia fiable.",
|
|
131
|
+
"scope": "Auditores, equipos de aseguramiento y de riesgo, y los responsables del sistema que deben hacer sus agentes auditables por diseño. Aplica a agentes autónomos o semiautónomos que usan herramientas y actúan a lo largo del tiempo, y da soporte tanto al aseguramiento interno como a la auditoría externa o regulatoria. Es un compañero práctico de los marcos formales, no un sustituto del asesoramiento legal.",
|
|
132
|
+
"keyPoints": [
|
|
133
|
+
"Auditabilidad por diseño: el agente debe emitir suficiente evidencia estructurada en tiempo de ejecución para reconstruir cualquier ejecución después.",
|
|
134
|
+
"Cada ejecución produce una traza inmutable y correlacionada: objetivo, cada paso y llamada a herramienta con parámetros y resultados, aprobaciones, anulaciones y resultado.",
|
|
135
|
+
"La evidencia debe ser completa, atribuible, con marca de tiempo y a prueba de manipulación para tener valor probatorio.",
|
|
136
|
+
"La procedencia de modelo y versión (prompt, herramientas, modelo) se captura por ejecución para que el comportamiento quede ligado a una configuración conocida.",
|
|
137
|
+
"El muestreo es por capas: estratificado por riesgo, estadístico, y revisión al 100% de todas las excepciones, anulaciones, denegaciones e incidentes.",
|
|
138
|
+
"La evidencia de auditoría se mapea a la auditoría interna de ISO/IEC 42001 (Cláusula 9) y a las funciones Medir y Gestionar de NIST AI RMF."
|
|
139
|
+
],
|
|
140
|
+
"controls": [
|
|
141
|
+
{
|
|
142
|
+
"control": "Registros de auditoría inmutables y trazabilidad",
|
|
143
|
+
"note": "Captura una traza correlacionada por ejecución —identidad y versión del agente, objetivo, cada paso, llamada a herramienta, resultado, aprobaciones y resultado— y protégela contra alteración. Implementa la observabilidad de IA."
|
|
144
|
+
},
|
|
145
|
+
{
|
|
146
|
+
"control": "Procedencia de modelo y versión",
|
|
147
|
+
"note": "Registra el prompt exacto, el conjunto de herramientas y la versión del modelo detrás de cada ejecución para que el comportamiento sea atribuible a una base conocida y reproducible por configuración."
|
|
148
|
+
},
|
|
149
|
+
{
|
|
150
|
+
"control": "Evidencia de evaluación",
|
|
151
|
+
"note": "Conserva los informes de evaluación previos al despliegue y continuos y los resultados de las puertas para que el auditor pueda verificar que se midieron la seguridad y la calidad: el 'Medir' del NIST."
|
|
152
|
+
},
|
|
153
|
+
{
|
|
154
|
+
"control": "Prueba de controles y muestreo",
|
|
155
|
+
"note": "Prueba cada control frente a la evidencia usando una metodología de muestreo documentada: estratificada por riesgo, estadística y revisión completa de excepciones."
|
|
156
|
+
},
|
|
157
|
+
{
|
|
158
|
+
"control": "Registros de aprobación e incidentes",
|
|
159
|
+
"note": "Captura aprobaciones humanas, anulaciones e incidentes con la identidad del actor y marcas de tiempo. Implementa el patrón de puerta de aprobación humana."
|
|
160
|
+
},
|
|
161
|
+
{
|
|
162
|
+
"control": "Atestaciones y gestión de hallazgos",
|
|
163
|
+
"note": "Los responsables del sistema y de los controles firman atestaciones respaldadas por evidencia; los hallazgos se siguen hasta su cierre con severidad y plazos."
|
|
164
|
+
}
|
|
165
|
+
],
|
|
166
|
+
"checklist": [
|
|
167
|
+
"Confirma que cada ejecución del agente produce una traza completa y correlacionada ligada por un ID de traza estable.",
|
|
168
|
+
"Verifica que los registros son a prueba de manipulación, con marca de tiempo y conservados durante toda la ventana de auditoría y regulatoria.",
|
|
169
|
+
"Comprueba que cada ejecución registra la procedencia de modelo y versión (prompt, herramientas, versión del modelo).",
|
|
170
|
+
"Obtén un mapeo de controles / Declaración de Aplicabilidad que vincule cada control con su evidencia.",
|
|
171
|
+
"Conserva y revisa los informes de evaluación previos al despliegue y continuos y los resultados de las puertas.",
|
|
172
|
+
"Confirma que existen registros de aprobación, anulación e incidentes con identidad del actor y marcas de tiempo.",
|
|
173
|
+
"Aplica una metodología de muestreo documentada: estratificada por riesgo, estadística y cobertura del 100% de excepciones.",
|
|
174
|
+
"Sigue los hallazgos hasta su cierre con severidad y plazos, y recoge atestaciones firmadas de los responsables."
|
|
175
|
+
],
|
|
176
|
+
"pitfalls": [
|
|
177
|
+
"Agentes no auditables: registro añadido como algo tardío, dejando huecos que ninguna auditoría puede llenar.",
|
|
178
|
+
"Registros mutables: registros que podrían alterarse, destruyendo su valor probatorio.",
|
|
179
|
+
"Puntos ciegos del muestreo: muestreo solo aleatorio que pasa por alto acciones raras pero catastróficas.",
|
|
180
|
+
"Atestación sin evidencia: responsables que firman controles que no pueden demostrar.",
|
|
181
|
+
"Cementerio de hallazgos: problemas planteados pero nunca remediados ni vueltos a probar."
|
|
182
|
+
],
|
|
183
|
+
"examples": [
|
|
184
|
+
"Un auditor reconstruye un reembolso en disputa siguiendo su traza correlacionada desde el objetivo a la llamada a herramienta y a la aprobación humana.",
|
|
185
|
+
"Un control de auditoría continua alerta sobre una llamada a herramienta fuera de la lista permitida contra el flujo de registros en vivo.",
|
|
186
|
+
"Los informes de evaluación conservados se mapean al Medir de NIST AI RMF, evidenciando que las puertas de seguridad pasaron antes del despliegue."
|
|
187
|
+
],
|
|
188
|
+
"faqs": [
|
|
189
|
+
{
|
|
190
|
+
"q": "¿Se puede auditar un agente no determinista?",
|
|
191
|
+
"a": "Sí: auditas los controles y el comportamiento registrado, no el determinismo. Las trazas completas e inmutables hacen reconstruible cualquier ejecución concreta aunque no se pueda reproducir exactamente."
|
|
192
|
+
},
|
|
193
|
+
{
|
|
194
|
+
"q": "¿Qué tamaño debe tener la muestra de auditoría?",
|
|
195
|
+
"a": "Suficiente para tu nivel de aseguramiento objetivo de forma estadística, más el 100% de las excepciones y las acciones de alto impacto. El muestreo nunca reemplaza la revisión completa de excepciones."
|
|
196
|
+
},
|
|
197
|
+
{
|
|
198
|
+
"q": "¿Cómo se mapea la evidencia de auditoría a los marcos?",
|
|
199
|
+
"a": "Las trazas y registros dan soporte a Medir y Gestionar de NIST AI RMF y a la auditoría interna de la Cláusula 9 de ISO/IEC 42001; un mapeo de controles o Declaración de Aplicabilidad vincula cada control con la evidencia que prueba que operó."
|
|
200
|
+
}
|
|
201
|
+
]
|
|
202
|
+
},
|
|
203
|
+
"pt": {
|
|
204
|
+
"name": "Framework de Auditoria para Sistemas Agênticos",
|
|
205
|
+
"summary": "Um framework prático e neutro para tornar um agente auditável e para auditá-lo. Define a evidência que um revisor independente precisa — traços imutáveis e correlacionados de cada decisão e chamada de ferramenta, proveniência de modelo e versão, relatórios de avaliação, registros de aprovação e incidentes — e como testar controles e amostrar execuções de alto volume. Cada tipo de evidência é mapeado para ISO/IEC 42001 e NIST AI RMF, para que um auditor possa verificar se o agente se manteve dentro de seus limites governados. Use-o para projetar a auditabilidade desde o início, não como algo adicionado depois.",
|
|
206
|
+
"definition": "Uma auditoria de agente é um exame independente e baseado em evidência que determina se um sistema agêntico operou dentro de seu escopo, controles e políticas autorizados durante um período definido, e se as alegações de governança feitas sobre ele são sustentadas por evidência confiável.",
|
|
207
|
+
"scope": "Auditores, equipes de garantia e de risco, e os responsáveis pelo sistema que devem tornar seus agentes auditáveis por design. Aplica-se a agentes autônomos ou semiautônomos que usam ferramentas e agem ao longo do tempo, e dá suporte tanto à garantia interna quanto à auditoria externa ou regulatória. É um companheiro prático dos frameworks formais, não um substituto de aconselhamento jurídico.",
|
|
208
|
+
"keyPoints": [
|
|
209
|
+
"Auditabilidade por design: o agente deve emitir evidência estruturada suficiente em tempo de execução para reconstruir qualquer execução depois.",
|
|
210
|
+
"Cada execução produz um traço imutável e correlacionado: objetivo, cada passo e chamada de ferramenta com parâmetros e resultados, aprovações, anulações e resultado.",
|
|
211
|
+
"A evidência deve ser completa, atribuível, com carimbo de tempo e à prova de adulteração para ter valor probatório.",
|
|
212
|
+
"A proveniência de modelo e versão (prompt, ferramentas, modelo) é capturada por execução para que o comportamento fique ligado a uma configuração conhecida.",
|
|
213
|
+
"A amostragem é em camadas: estratificada por risco, estatística, e revisão de 100% de todas as exceções, anulações, negações e incidentes.",
|
|
214
|
+
"A evidência de auditoria mapeia para a auditoria interna da ISO/IEC 42001 (Cláusula 9) e para as funções Medir e Gerenciar do NIST AI RMF."
|
|
215
|
+
],
|
|
216
|
+
"controls": [
|
|
217
|
+
{
|
|
218
|
+
"control": "Registros de auditoria imutáveis e rastreabilidade",
|
|
219
|
+
"note": "Capture um traço correlacionado por execução — identidade e versão do agente, objetivo, cada passo, chamada de ferramenta, resultado, aprovações e resultado — e proteja-o contra alteração. Implementa a observabilidade de IA."
|
|
220
|
+
},
|
|
221
|
+
{
|
|
222
|
+
"control": "Proveniência de modelo e versão",
|
|
223
|
+
"note": "Registre o prompt exato, o conjunto de ferramentas e a versão do modelo por trás de cada execução para que o comportamento seja atribuível a uma base conhecida e reproduzível por configuração."
|
|
224
|
+
},
|
|
225
|
+
{
|
|
226
|
+
"control": "Evidência de avaliação",
|
|
227
|
+
"note": "Retenha os relatórios de avaliação prévios à implantação e contínuos e os resultados dos portões para que o auditor possa verificar que a segurança e a qualidade foram medidas: o 'Medir' do NIST."
|
|
228
|
+
},
|
|
229
|
+
{
|
|
230
|
+
"control": "Teste de controles e amostragem",
|
|
231
|
+
"note": "Teste cada controle contra a evidência usando uma metodologia de amostragem documentada: estratificada por risco, estatística e revisão completa de exceções."
|
|
232
|
+
},
|
|
233
|
+
{
|
|
234
|
+
"control": "Registros de aprovação e incidentes",
|
|
235
|
+
"note": "Capture aprovações humanas, anulações e incidentes com a identidade do ator e carimbos de tempo. Implementa o padrão de portão de aprovação humana."
|
|
236
|
+
},
|
|
237
|
+
{
|
|
238
|
+
"control": "Atestações e gestão de achados",
|
|
239
|
+
"note": "Os responsáveis pelo sistema e pelos controles assinam atestações respaldadas por evidência; os achados são acompanhados até o fechamento com severidade e prazos."
|
|
240
|
+
}
|
|
241
|
+
],
|
|
242
|
+
"checklist": [
|
|
243
|
+
"Confirme que cada execução do agente produz um traço completo e correlacionado ligado por um ID de traço estável.",
|
|
244
|
+
"Verifique que os registros são à prova de adulteração, com carimbo de tempo e retidos durante toda a janela de auditoria e regulatória.",
|
|
245
|
+
"Verifique que cada execução registra a proveniência de modelo e versão (prompt, ferramentas, versão do modelo).",
|
|
246
|
+
"Obtenha um mapeamento de controles / Declaração de Aplicabilidade que vincule cada controle à sua evidência.",
|
|
247
|
+
"Retenha e revise os relatórios de avaliação prévios à implantação e contínuos e os resultados dos portões.",
|
|
248
|
+
"Confirme que existem registros de aprovação, anulação e incidentes com identidade do ator e carimbos de tempo.",
|
|
249
|
+
"Aplique uma metodologia de amostragem documentada: estratificada por risco, estatística e cobertura de 100% das exceções.",
|
|
250
|
+
"Acompanhe os achados até o fechamento com severidade e prazos, e colete atestações assinadas dos responsáveis."
|
|
251
|
+
],
|
|
252
|
+
"pitfalls": [
|
|
253
|
+
"Agentes não auditáveis: registro adicionado tardiamente, deixando lacunas que nenhuma auditoria pode preencher.",
|
|
254
|
+
"Registros mutáveis: registros que poderiam ser alterados, destruindo seu valor probatório.",
|
|
255
|
+
"Pontos cegos da amostragem: amostragem apenas aleatória que ignora ações raras mas catastróficas.",
|
|
256
|
+
"Atestação sem evidência: responsáveis que assinam controles que não conseguem demonstrar.",
|
|
257
|
+
"Cemitério de achados: problemas levantados mas nunca remediados ou retestados."
|
|
258
|
+
],
|
|
259
|
+
"examples": [
|
|
260
|
+
"Um auditor reconstrói um reembolso em disputa seguindo seu traço correlacionado do objetivo à chamada de ferramenta e à aprovação humana.",
|
|
261
|
+
"Um controle de auditoria contínua alerta sobre uma chamada de ferramenta fora da lista permitida contra o fluxo de registros ao vivo.",
|
|
262
|
+
"Os relatórios de avaliação retidos mapeiam para o Medir do NIST AI RMF, evidenciando que os portões de segurança passaram antes da implantação."
|
|
263
|
+
],
|
|
264
|
+
"faqs": [
|
|
265
|
+
{
|
|
266
|
+
"q": "É possível auditar um agente não determinístico?",
|
|
267
|
+
"a": "Sim: você audita os controles e o comportamento registrado, não o determinismo. Traços completos e imutáveis tornam qualquer execução específica reconstruível, mesmo que não possa ser reproduzida exatamente."
|
|
268
|
+
},
|
|
269
|
+
{
|
|
270
|
+
"q": "Qual deve ser o tamanho da amostra de auditoria?",
|
|
271
|
+
"a": "Grande o suficiente para seu nível de garantia alvo de forma estatística, mais 100% das exceções e das ações de alto impacto. A amostragem nunca substitui a revisão completa de exceções."
|
|
272
|
+
},
|
|
273
|
+
{
|
|
274
|
+
"q": "Como a evidência de auditoria mapeia para os frameworks?",
|
|
275
|
+
"a": "Traços e registros dão suporte a Medir e Gerenciar do NIST AI RMF e à auditoria interna da Cláusula 9 da ISO/IEC 42001; um mapeamento de controles ou Declaração de Aplicabilidade vincula cada controle à evidência que prova que ele operou."
|
|
276
|
+
}
|
|
277
|
+
]
|
|
278
|
+
}
|
|
279
|
+
}
|
|
280
|
+
}
|