santismm-knowledge-mcp 0.2.1

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (182) hide show
  1. package/LICENSE +21 -0
  2. package/README.md +62 -0
  3. package/content/CONVENTIONS.md +77 -0
  4. package/content/LICENSE +55 -0
  5. package/content/architectures/ai-workforce.json +280 -0
  6. package/content/architectures/customer-service-agent.json +292 -0
  7. package/content/architectures/enterprise-knowledge-assistant.json +292 -0
  8. package/content/architectures/operations-center.json +280 -0
  9. package/content/architectures/sales-copilot.json +280 -0
  10. package/content/governance/agentic-ai-governance-checklist.json +323 -0
  11. package/content/governance/audit-framework-for-agentic-systems.json +280 -0
  12. package/content/governance/enterprise-ai-governance-framework.json +277 -0
  13. package/content/governance/eu-ai-act.json +162 -0
  14. package/content/governance/human-oversight-and-accountability-policy.json +275 -0
  15. package/content/governance/iso-42001.json +161 -0
  16. package/content/governance/mitre-atlas.json +280 -0
  17. package/content/governance/nist-ai-rmf.json +161 -0
  18. package/content/governance/owasp-llm-top10.json +301 -0
  19. package/content/harness/HRN-001-definition-and-overview.es.md +76 -0
  20. package/content/harness/HRN-001-definition-and-overview.md +125 -0
  21. package/content/harness/HRN-001-definition-and-overview.pt.md +76 -0
  22. package/content/harness/HRN-002-a-brief-history-of-harness-engineering.es.md +83 -0
  23. package/content/harness/HRN-002-a-brief-history-of-harness-engineering.md +113 -0
  24. package/content/harness/HRN-002-a-brief-history-of-harness-engineering.pt.md +83 -0
  25. package/content/harness/HRN-003-the-harness-taxonomy.es.md +105 -0
  26. package/content/harness/HRN-003-the-harness-taxonomy.md +158 -0
  27. package/content/harness/HRN-003-the-harness-taxonomy.pt.md +105 -0
  28. package/content/harness/HRN-004-harness-engineering-principles.es.md +91 -0
  29. package/content/harness/HRN-004-harness-engineering-principles.md +135 -0
  30. package/content/harness/HRN-004-harness-engineering-principles.pt.md +91 -0
  31. package/content/harness/HRN-005-memory-in-agentic-systems.es.md +98 -0
  32. package/content/harness/HRN-005-memory-in-agentic-systems.md +145 -0
  33. package/content/harness/HRN-005-memory-in-agentic-systems.pt.md +98 -0
  34. package/content/harness/HRN-006-observability-for-agentic-systems.es.md +97 -0
  35. package/content/harness/HRN-006-observability-for-agentic-systems.md +139 -0
  36. package/content/harness/HRN-006-observability-for-agentic-systems.pt.md +97 -0
  37. package/content/harness/HRN-007-evaluation-of-agentic-systems.es.md +96 -0
  38. package/content/harness/HRN-007-evaluation-of-agentic-systems.md +145 -0
  39. package/content/harness/HRN-007-evaluation-of-agentic-systems.pt.md +96 -0
  40. package/content/harness/HRN-008-governance-within-the-harness.es.md +105 -0
  41. package/content/harness/HRN-008-governance-within-the-harness.md +146 -0
  42. package/content/harness/HRN-008-governance-within-the-harness.pt.md +105 -0
  43. package/content/harness/HRN-009-planning-and-goal-management.es.md +102 -0
  44. package/content/harness/HRN-009-planning-and-goal-management.md +142 -0
  45. package/content/harness/HRN-009-planning-and-goal-management.pt.md +102 -0
  46. package/content/harness/HRN-010-orchestration.es.md +107 -0
  47. package/content/harness/HRN-010-orchestration.md +149 -0
  48. package/content/harness/HRN-010-orchestration.pt.md +107 -0
  49. package/content/harness/HRN-011-security-for-agentic-systems.es.md +107 -0
  50. package/content/harness/HRN-011-security-for-agentic-systems.md +147 -0
  51. package/content/harness/HRN-011-security-for-agentic-systems.pt.md +107 -0
  52. package/content/harness/HRN-012-case-studies-in-harness-engineering.es.md +120 -0
  53. package/content/harness/HRN-012-case-studies-in-harness-engineering.md +157 -0
  54. package/content/harness/HRN-012-case-studies-in-harness-engineering.pt.md +120 -0
  55. package/content/harness/HRN-013-glossary.es.md +109 -0
  56. package/content/harness/HRN-013-glossary.md +124 -0
  57. package/content/harness/HRN-013-glossary.pt.md +109 -0
  58. package/content/harness/HRN-014-bibliography.es.md +89 -0
  59. package/content/harness/HRN-014-bibliography.md +109 -0
  60. package/content/harness/HRN-014-bibliography.pt.md +89 -0
  61. package/content/homeric/episodes/achilles-and-hector.json +139 -0
  62. package/content/homeric/episodes/aeolus-and-the-winds.json +131 -0
  63. package/content/homeric/episodes/agamemnons-murder.json +162 -0
  64. package/content/homeric/episodes/calypso-ogygia.json +157 -0
  65. package/content/homeric/episodes/catalogue-of-ships.json +177 -0
  66. package/content/homeric/episodes/cattle-of-the-sun.json +131 -0
  67. package/content/homeric/episodes/chryse-and-the-plague.json +131 -0
  68. package/content/homeric/episodes/cicones-at-ismarus.json +131 -0
  69. package/content/homeric/episodes/circe-on-aeaea.json +131 -0
  70. package/content/homeric/episodes/cyclops-polyphemus.json +162 -0
  71. package/content/homeric/episodes/laestrygonians.json +153 -0
  72. package/content/homeric/episodes/lotus-eaters.json +138 -0
  73. package/content/homeric/episodes/menelaus-and-proteus.json +130 -0
  74. package/content/homeric/episodes/nekyia.json +160 -0
  75. package/content/homeric/episodes/phaeacians-on-scheria.json +129 -0
  76. package/content/homeric/episodes/priams-ransom.json +131 -0
  77. package/content/homeric/episodes/return-to-ithaca.json +167 -0
  78. package/content/homeric/episodes/scylla-and-charybdis.json +131 -0
  79. package/content/homeric/episodes/suitors-ambush-at-asteris.json +131 -0
  80. package/content/homeric/episodes/telemachus-at-pylos.json +130 -0
  81. package/content/homeric/episodes/telemachus-in-sparta.json +130 -0
  82. package/content/homeric/episodes/the-achaean-camp.json +138 -0
  83. package/content/homeric/episodes/the-sirens.json +129 -0
  84. package/content/homeric/episodes/wooden-horse.json +168 -0
  85. package/content/homeric/places/aeaea.json +129 -0
  86. package/content/homeric/places/aeolia.json +161 -0
  87. package/content/homeric/places/asteris.json +120 -0
  88. package/content/homeric/places/aulis.json +122 -0
  89. package/content/homeric/places/cape-malea.json +126 -0
  90. package/content/homeric/places/chryse.json +120 -0
  91. package/content/homeric/places/dodona.json +129 -0
  92. package/content/homeric/places/dulichium.json +177 -0
  93. package/content/homeric/places/egypt.json +125 -0
  94. package/content/homeric/places/ephyra-acheron.json +127 -0
  95. package/content/homeric/places/hellespont.json +125 -0
  96. package/content/homeric/places/house-of-hades.json +91 -0
  97. package/content/homeric/places/ismarus.json +120 -0
  98. package/content/homeric/places/ithaca.json +240 -0
  99. package/content/homeric/places/knossos.json +132 -0
  100. package/content/homeric/places/laestrygonia.json +168 -0
  101. package/content/homeric/places/land-of-the-cyclopes.json +169 -0
  102. package/content/homeric/places/land-of-the-lotus-eaters.json +122 -0
  103. package/content/homeric/places/mount-ida.json +126 -0
  104. package/content/homeric/places/mycenae.json +152 -0
  105. package/content/homeric/places/ogygia.json +125 -0
  106. package/content/homeric/places/pharos.json +120 -0
  107. package/content/homeric/places/planctae.json +77 -0
  108. package/content/homeric/places/pylos.json +188 -0
  109. package/content/homeric/places/same.json +177 -0
  110. package/content/homeric/places/scheria.json +129 -0
  111. package/content/homeric/places/scylla-and-charybdis.json +135 -0
  112. package/content/homeric/places/sirens.json +127 -0
  113. package/content/homeric/places/sparta.json +179 -0
  114. package/content/homeric/places/tenedos.json +129 -0
  115. package/content/homeric/places/thrinacia.json +116 -0
  116. package/content/homeric/places/tiryns.json +123 -0
  117. package/content/homeric/places/troy.json +224 -0
  118. package/content/homeric/places/zacynthus.json +126 -0
  119. package/content/homeric/routes/achaean-expedition.json +132 -0
  120. package/content/homeric/routes/nostoi-of-the-others.json +205 -0
  121. package/content/homeric/routes/odysseus-nostos.json +307 -0
  122. package/content/homeric/routes/telemachy.json +134 -0
  123. package/content/knowledge/agent-memory.json +153 -0
  124. package/content/knowledge/agentic-ai.json +158 -0
  125. package/content/knowledge/agentic-evaluation.json +156 -0
  126. package/content/knowledge/agentic-threat-model.json +287 -0
  127. package/content/knowledge/ai-agent.json +153 -0
  128. package/content/knowledge/ai-cyberdefense.json +274 -0
  129. package/content/knowledge/ai-governance.json +155 -0
  130. package/content/knowledge/ai-observability.json +156 -0
  131. package/content/knowledge/context-engineering.json +153 -0
  132. package/content/knowledge/embeddings.json +153 -0
  133. package/content/knowledge/enterprise-rag.json +154 -0
  134. package/content/knowledge/fine-tuning.json +153 -0
  135. package/content/knowledge/foundation-models.json +154 -0
  136. package/content/knowledge/guardrails.json +153 -0
  137. package/content/knowledge/harness-engineering.json +158 -0
  138. package/content/knowledge/human-in-the-loop.json +153 -0
  139. package/content/knowledge/mcp-security.json +284 -0
  140. package/content/knowledge/model-context-protocol.json +154 -0
  141. package/content/knowledge/multi-agent-architecture.json +153 -0
  142. package/content/knowledge/prompt-engineering.json +153 -0
  143. package/content/knowledge/prompt-injection.json +138 -0
  144. package/content/knowledge/reasoning-models.json +153 -0
  145. package/content/knowledge/tool-use.json +156 -0
  146. package/content/library/cognitive-architecture-emergent-ai.md +15 -0
  147. package/content/library/devready-ep108-ai-customer-experiences.md +14 -0
  148. package/content/library/how-genai-impact-business.md +12 -0
  149. package/content/library/lmm-reshaping-industries-2024.md +12 -0
  150. package/content/library/rethinking-ai-pause.md +12 -0
  151. package/content/library/rise-of-agentic-ai.md +16 -0
  152. package/content/library/self-improving-autonomous-ai.md +16 -0
  153. package/content/library/the-stopwatch-and-the-exam.md +12 -0
  154. package/content/library/unlock-gpt4-secrets.md +12 -0
  155. package/content/library/vibe-coding-enterprise.md +15 -0
  156. package/content/library/video-transformando-negocios-genai.md +14 -0
  157. package/content/library/video-volando-alto-sky-airlines.md +13 -0
  158. package/content/matrix/agentic-control-matrix.json +967 -0
  159. package/content/patterns/attributed-memory.json +237 -0
  160. package/content/patterns/context-compression.json +304 -0
  161. package/content/patterns/egress-allowlist.json +310 -0
  162. package/content/patterns/evaluator-optimizer.json +180 -0
  163. package/content/patterns/goal-decomposition.json +290 -0
  164. package/content/patterns/human-approval-gate.json +311 -0
  165. package/content/patterns/human-escalation.json +288 -0
  166. package/content/patterns/least-privilege-tooling.json +333 -0
  167. package/content/patterns/long-term-memory.json +305 -0
  168. package/content/patterns/orchestrator-workers.json +202 -0
  169. package/content/patterns/parallelization.json +180 -0
  170. package/content/patterns/prompt-chaining.json +181 -0
  171. package/content/patterns/recovery-strategy.json +305 -0
  172. package/content/patterns/reflection.json +298 -0
  173. package/content/patterns/routing.json +294 -0
  174. package/content/patterns/sandboxed-execution.json +311 -0
  175. package/content/patterns/semantic-caching.json +201 -0
  176. package/content/patterns/supervisor-agent.json +290 -0
  177. package/content/patterns/task-prioritization.json +307 -0
  178. package/dist/content.js +181 -0
  179. package/dist/index.js +27 -0
  180. package/dist/shape.js +649 -0
  181. package/dist/tools.js +652 -0
  182. package/package.json +47 -0
@@ -0,0 +1,153 @@
1
+ {
2
+ "slug": "fine-tuning",
3
+ "category": "concept",
4
+ "updated": "2026-06-21",
5
+ "version": "1.0",
6
+ "related": ["foundation-models", "enterprise-rag", "prompt-engineering", "embeddings"],
7
+ "references": [
8
+ { "title": "Hu et al. — LoRA: Low-Rank Adaptation of Large Language Models (2021)", "url": "https://arxiv.org/abs/2106.09685" },
9
+ { "title": "Ouyang et al. — Training language models to follow instructions with human feedback (InstructGPT, 2022)", "url": "https://arxiv.org/abs/2203.02155" }
10
+ ],
11
+ "evidence": {
12
+ "evidenceLevel": "benchmark",
13
+ "confidenceLevel": "high",
14
+ "sourceType": ["benchmark", "paper"]
15
+ },
16
+ "locales": {
17
+ "en": {
18
+ "title": "What is Fine-tuning?",
19
+ "summary": "Fine-tuning continues training a pretrained model on a smaller, targeted dataset to specialize its behavior, style or domain knowledge. It is far cheaper than pretraining and changes the model's weights — unlike prompting or retrieval, which leave the model unchanged. Use it to lock in a consistent format, tone or skill; use retrieval instead when you need fresh or private facts.",
20
+ "definition": "Fine-tuning is the process of further training a pretrained model on a focused dataset to adapt its weights toward a specific behavior, style, format or domain.",
21
+ "takeaways": [
22
+ "Fine-tuning updates model weights; prompting and RAG do not.",
23
+ "Best for consistent behavior, style or format — not for fresh facts.",
24
+ "Parameter-efficient methods (LoRA) make it cheap and practical.",
25
+ "RLHF is a form of fine-tuning using human preferences.",
26
+ "Default to prompting and retrieval first; fine-tune when they plateau."
27
+ ],
28
+ "context": [
29
+ "A pretrained foundation model is a generalist. Fine-tuning narrows it: shown enough examples of the target behavior, the model internalizes it, so you no longer need to specify it in every prompt.",
30
+ "It is one of three adaptation levers, alongside prompting and retrieval. The art is choosing the right one: fine-tune for how the model should behave, retrieve for what it should know."
31
+ ],
32
+ "architecture": [
33
+ "Full fine-tuning updates all weights — powerful but expensive. Parameter-efficient fine-tuning (PEFT), notably LoRA, trains small adapter weights while freezing the base, capturing most of the benefit at a fraction of the cost.",
34
+ "Instruction tuning and RLHF are specialized fine-tuning stages that turn a raw base model into a helpful, aligned assistant. Quality of the dataset matters far more than its size."
35
+ ],
36
+ "components": ["Pretrained base model", "Curated training dataset", "Training objective", "PEFT / LoRA adapters", "Evaluation set"],
37
+ "pros": [
38
+ "Bakes in consistent behavior, style or format.",
39
+ "Reduces prompt length and per-call cost.",
40
+ "Can teach narrow skills a base model lacks.",
41
+ "PEFT makes it affordable and fast."
42
+ ],
43
+ "risks": [
44
+ "Does not add fresh or private facts — use retrieval for that.",
45
+ "Risk of catastrophic forgetting or overfitting.",
46
+ "Needs a quality, well-labeled dataset and an eval set.",
47
+ "Couples you to a model version; migration costs on upgrades."
48
+ ],
49
+ "tools": ["LoRA / PEFT libraries", "Provider fine-tuning APIs", "RLHF / preference-tuning pipelines", "Evaluation suites"],
50
+ "examples": [
51
+ "Fine-tuning a model to always output a strict company JSON format.",
52
+ "Teaching a consistent brand voice for generated copy.",
53
+ "Adapting a model to a specialized domain's terminology."
54
+ ],
55
+ "faqs": [
56
+ { "q": "Fine-tuning or RAG?", "a": "Fine-tune to change how the model behaves (style, format, skill); use retrieval (RAG) to give it fresh or private knowledge. They are complementary, not competing." },
57
+ { "q": "Is fine-tuning expensive?", "a": "Full fine-tuning can be, but parameter-efficient methods like LoRA train tiny adapters and make it cheap and fast for most use cases." },
58
+ { "q": "What is RLHF?", "a": "Reinforcement learning from human feedback is a fine-tuning stage that uses human preference judgments to make a model more helpful, harmless and honest." },
59
+ { "q": "When should I fine-tune?", "a": "After prompting and retrieval plateau. If you can solve it with a better prompt or relevant context, do that first — it is cheaper and more flexible." }
60
+ ]
61
+ },
62
+ "es": {
63
+ "title": "¿Qué es el Fine-tuning (Ajuste fino)?",
64
+ "summary": "El fine-tuning continúa el entrenamiento de un modelo preentrenado con un conjunto de datos más pequeño y dirigido para especializar su comportamiento, estilo o conocimiento de dominio. Es mucho más barato que el preentrenamiento y cambia los pesos del modelo, a diferencia del prompting o la recuperación, que lo dejan intacto. Úsalo para fijar un formato, tono o habilidad consistentes; usa recuperación cuando necesites hechos frescos o privados.",
65
+ "definition": "El fine-tuning es el proceso de seguir entrenando un modelo preentrenado con un conjunto de datos enfocado para adaptar sus pesos hacia un comportamiento, estilo, formato o dominio específico.",
66
+ "takeaways": [
67
+ "El fine-tuning actualiza los pesos del modelo; el prompting y el RAG no.",
68
+ "Mejor para comportamiento, estilo o formato consistentes, no para hechos frescos.",
69
+ "Los métodos eficientes en parámetros (LoRA) lo hacen barato y práctico.",
70
+ "El RLHF es una forma de fine-tuning que usa preferencias humanas.",
71
+ "Empieza por prompting y recuperación; haz fine-tuning cuando se estanquen."
72
+ ],
73
+ "context": [
74
+ "Un modelo fundacional preentrenado es un generalista. El fine-tuning lo estrecha: tras ver suficientes ejemplos del comportamiento objetivo, el modelo lo interioriza, así que ya no hace falta especificarlo en cada prompt.",
75
+ "Es una de las tres palancas de adaptación, junto al prompting y la recuperación. El arte está en elegir la adecuada: fine-tuning para cómo debe comportarse el modelo, recuperación para qué debe saber."
76
+ ],
77
+ "architecture": [
78
+ "El fine-tuning completo actualiza todos los pesos: potente pero caro. El fine-tuning eficiente en parámetros (PEFT), notablemente LoRA, entrena pequeños pesos adaptadores congelando la base, capturando casi todo el beneficio a una fracción del coste.",
79
+ "El instruction tuning y el RLHF son etapas especializadas de fine-tuning que convierten un modelo base bruto en un asistente útil y alineado. La calidad del dataset importa mucho más que su tamaño."
80
+ ],
81
+ "components": ["Modelo base preentrenado", "Dataset de entrenamiento curado", "Objetivo de entrenamiento", "Adaptadores PEFT / LoRA", "Conjunto de evaluación"],
82
+ "pros": [
83
+ "Fija un comportamiento, estilo o formato consistentes.",
84
+ "Reduce la longitud del prompt y el coste por llamada.",
85
+ "Puede enseñar habilidades estrechas que la base no tiene.",
86
+ "PEFT lo hace asequible y rápido."
87
+ ],
88
+ "risks": [
89
+ "No añade hechos frescos o privados: usa recuperación para eso.",
90
+ "Riesgo de olvido catastrófico o sobreajuste.",
91
+ "Necesita un dataset de calidad bien etiquetado y un set de evaluación.",
92
+ "Te acopla a una versión de modelo; coste de migración al actualizar."
93
+ ],
94
+ "tools": ["Librerías LoRA / PEFT", "APIs de fine-tuning de proveedores", "Pipelines de RLHF / ajuste por preferencias", "Suites de evaluación"],
95
+ "examples": [
96
+ "Hacer fine-tuning para que un modelo emita siempre un formato JSON estricto de la empresa.",
97
+ "Enseñar una voz de marca consistente para textos generados.",
98
+ "Adaptar un modelo a la terminología de un dominio especializado."
99
+ ],
100
+ "faqs": [
101
+ { "q": "¿Fine-tuning o RAG?", "a": "Haz fine-tuning para cambiar cómo se comporta el modelo (estilo, formato, habilidad); usa recuperación (RAG) para darle conocimiento fresco o privado. Son complementarios, no rivales." },
102
+ { "q": "¿El fine-tuning es caro?", "a": "El completo puede serlo, pero métodos eficientes como LoRA entrenan adaptadores diminutos y lo hacen barato y rápido para la mayoría de casos." },
103
+ { "q": "¿Qué es el RLHF?", "a": "El aprendizaje por refuerzo con feedback humano es una etapa de fine-tuning que usa juicios de preferencia humana para hacer un modelo más útil, inofensivo y honesto." },
104
+ { "q": "¿Cuándo debería hacer fine-tuning?", "a": "Cuando el prompting y la recuperación se estancan. Si puedes resolverlo con un mejor prompt o contexto relevante, hazlo primero: es más barato y flexible." }
105
+ ]
106
+ },
107
+ "pt": {
108
+ "title": "O que é Fine-tuning (Ajuste fino)?",
109
+ "summary": "O fine-tuning continua o treinamento de um modelo pré-treinado com um conjunto de dados menor e direcionado para especializar seu comportamento, estilo ou conhecimento de domínio. É muito mais barato que o pré-treinamento e muda os pesos do modelo, ao contrário do prompting ou da recuperação, que o deixam intacto. Use-o para fixar um formato, tom ou habilidade consistentes; use recuperação quando precisar de fatos frescos ou privados.",
110
+ "definition": "O fine-tuning é o processo de seguir treinando um modelo pré-treinado com um conjunto de dados focado para adaptar seus pesos rumo a um comportamento, estilo, formato ou domínio específico.",
111
+ "takeaways": [
112
+ "O fine-tuning atualiza os pesos do modelo; o prompting e o RAG não.",
113
+ "Melhor para comportamento, estilo ou formato consistentes, não para fatos frescos.",
114
+ "Métodos eficientes em parâmetros (LoRA) o tornam barato e prático.",
115
+ "O RLHF é uma forma de fine-tuning que usa preferências humanas.",
116
+ "Comece por prompting e recuperação; faça fine-tuning quando estagnarem."
117
+ ],
118
+ "context": [
119
+ "Um modelo de fundação pré-treinado é um generalista. O fine-tuning o estreita: após ver exemplos suficientes do comportamento alvo, o modelo o internaliza, então não é mais preciso especificá-lo em cada prompt.",
120
+ "É uma das três alavancas de adaptação, junto ao prompting e à recuperação. A arte está em escolher a adequada: fine-tuning para como o modelo deve se comportar, recuperação para o que deve saber."
121
+ ],
122
+ "architecture": [
123
+ "O fine-tuning completo atualiza todos os pesos: potente mas caro. O fine-tuning eficiente em parâmetros (PEFT), notavelmente o LoRA, treina pequenos pesos adaptadores congelando a base, capturando quase todo o benefício a uma fração do custo.",
124
+ "O instruction tuning e o RLHF são etapas especializadas de fine-tuning que transformam um modelo base bruto num assistente útil e alinhado. A qualidade do dataset importa muito mais que seu tamanho."
125
+ ],
126
+ "components": ["Modelo base pré-treinado", "Dataset de treinamento curado", "Objetivo de treinamento", "Adaptadores PEFT / LoRA", "Conjunto de avaliação"],
127
+ "pros": [
128
+ "Fixa um comportamento, estilo ou formato consistentes.",
129
+ "Reduz o comprimento do prompt e o custo por chamada.",
130
+ "Pode ensinar habilidades estreitas que a base não tem.",
131
+ "PEFT o torna acessível e rápido."
132
+ ],
133
+ "risks": [
134
+ "Não adiciona fatos frescos ou privados: use recuperação para isso.",
135
+ "Risco de esquecimento catastrófico ou sobreajuste.",
136
+ "Precisa de um dataset de qualidade bem rotulado e um conjunto de avaliação.",
137
+ "Acopla você a uma versão de modelo; custo de migração ao atualizar."
138
+ ],
139
+ "tools": ["Bibliotecas LoRA / PEFT", "APIs de fine-tuning de provedores", "Pipelines de RLHF / ajuste por preferências", "Suítes de avaliação"],
140
+ "examples": [
141
+ "Fazer fine-tuning para um modelo emitir sempre um formato JSON estrito da empresa.",
142
+ "Ensinar uma voz de marca consistente para textos gerados.",
143
+ "Adaptar um modelo à terminologia de um domínio especializado."
144
+ ],
145
+ "faqs": [
146
+ { "q": "Fine-tuning ou RAG?", "a": "Faça fine-tuning para mudar como o modelo se comporta (estilo, formato, habilidade); use recuperação (RAG) para dar-lhe conhecimento fresco ou privado. São complementares, não rivais." },
147
+ { "q": "O fine-tuning é caro?", "a": "O completo pode ser, mas métodos eficientes como o LoRA treinam adaptadores minúsculos e o tornam barato e rápido para a maioria dos casos." },
148
+ { "q": "O que é RLHF?", "a": "O aprendizado por reforço com feedback humano é uma etapa de fine-tuning que usa julgamentos de preferência humana para tornar um modelo mais útil, inofensivo e honesto." },
149
+ { "q": "Quando devo fazer fine-tuning?", "a": "Quando o prompting e a recuperação estagnam. Se você pode resolver com um prompt melhor ou contexto relevante, faça isso primeiro: é mais barato e flexível." }
150
+ ]
151
+ }
152
+ }
153
+ }
@@ -0,0 +1,154 @@
1
+ {
2
+ "slug": "foundation-models",
3
+ "category": "concept",
4
+ "updated": "2026-06-21",
5
+ "version": "1.0",
6
+ "featured": true,
7
+ "related": ["fine-tuning", "embeddings", "agentic-ai", "harness-engineering"],
8
+ "references": [
9
+ { "title": "Bommasani et al. — On the Opportunities and Risks of Foundation Models (2021)", "url": "https://arxiv.org/abs/2108.07258" },
10
+ { "title": "Vaswani et al. — Attention Is All You Need (2017)", "url": "https://arxiv.org/abs/1706.03762" }
11
+ ],
12
+ "evidence": {
13
+ "evidenceLevel": "benchmark",
14
+ "confidenceLevel": "high",
15
+ "sourceType": ["benchmark", "paper"]
16
+ },
17
+ "locales": {
18
+ "en": {
19
+ "title": "What are Foundation Models?",
20
+ "summary": "A foundation model is a large model pretrained on broad data at scale that can be adapted to a wide range of downstream tasks. Large language models (LLMs) and large multimodal models are the canonical examples. The term, coined at Stanford in 2021, captures a shift: instead of training a bespoke model per task, organizations build on a shared, general-purpose base — then specialize it through prompting, retrieval or fine-tuning.",
21
+ "definition": "A foundation model is a large, general-purpose model pretrained on broad data that serves as a base which can be adapted — via prompting, retrieval or fine-tuning — to many downstream tasks.",
22
+ "takeaways": [
23
+ "Foundation models are general bases adapted to many tasks.",
24
+ "LLMs and multimodal models are the leading examples.",
25
+ "Most are built on the transformer architecture.",
26
+ "Capabilities emerge with scale of data, parameters and compute.",
27
+ "You adapt them by prompting, retrieval (RAG) or fine-tuning — rarely by training from scratch."
28
+ ],
29
+ "context": [
30
+ "Before foundation models, teams trained narrow models for each task. The foundation-model paradigm flips this: one large model is pretrained once on broad data, then reused everywhere. That reuse is why a handful of models now underpin most AI products.",
31
+ "It also concentrates capability — and risk. Because so much is built on a few bases, their biases, failures and security properties propagate downstream, which is part of why governance and evaluation matter."
32
+ ],
33
+ "architecture": [
34
+ "Pretraining: a model with millions to trillions of parameters learns general patterns from massive datasets, typically with self-supervised objectives like next-token prediction. The transformer's attention mechanism makes this scalable.",
35
+ "Adaptation: the same base is specialized for use — zero/few-shot prompting, retrieval-augmented generation for fresh or private knowledge, or fine-tuning for behavior and domain. Agents wrap the model in tools and a harness."
36
+ ],
37
+ "components": ["Transformer architecture", "Pretraining data & objective", "Parameters (weights)", "Tokenizer", "Adaptation layer (prompt / RAG / fine-tune)"],
38
+ "pros": [
39
+ "One base reused across many tasks.",
40
+ "Strong general capability out of the box.",
41
+ "Rapid adaptation without training from scratch.",
42
+ "Multimodal variants span text, image, audio and more."
43
+ ],
44
+ "risks": [
45
+ "Concentrated risk: flaws propagate to everything built on them.",
46
+ "Costly to pretrain; few organizations can.",
47
+ "Inherit biases and gaps from training data.",
48
+ "Knowledge is frozen at training time without retrieval."
49
+ ],
50
+ "tools": ["Frontier LLMs (Claude, GPT, Gemini)", "Open-weight models (Llama, Mistral)", "Multimodal models", "Model hosting / inference platforms"],
51
+ "examples": [
52
+ "Using one LLM for summarization, classification and drafting across an org.",
53
+ "Adapting a base model to a domain with retrieval instead of retraining.",
54
+ "Building an agent on a frontier model plus tools and memory."
55
+ ],
56
+ "faqs": [
57
+ { "q": "Is a foundation model the same as an LLM?", "a": "An LLM is the most common type of foundation model, specialized to language. Foundation models also include multimodal and other general-purpose models." },
58
+ { "q": "Why are they called 'foundation' models?", "a": "Because they serve as a shared base that many applications are built on, rather than a model trained for a single task." },
59
+ { "q": "Do I need to train one?", "a": "Almost never. Pretraining is extremely costly; nearly all value comes from adapting an existing base via prompting, retrieval or fine-tuning." },
60
+ { "q": "How do agents relate to foundation models?", "a": "An agent uses a foundation model as its reasoning core, wrapped in tools, memory and a control loop — the harness — to take actions." }
61
+ ]
62
+ },
63
+ "es": {
64
+ "title": "¿Qué son los Modelos Fundacionales (Foundation Models)?",
65
+ "summary": "Un modelo fundacional es un modelo grande preentrenado a escala con datos amplios que puede adaptarse a una gran variedad de tareas posteriores. Los modelos de lenguaje (LLM) y los multimodales son los ejemplos canónicos. El término, acuñado en Stanford en 2021, captura un cambio: en lugar de entrenar un modelo a medida por tarea, las organizaciones construyen sobre una base general compartida y luego la especializan mediante prompting, recuperación o fine-tuning.",
66
+ "definition": "Un modelo fundacional es un modelo grande y de propósito general, preentrenado con datos amplios, que sirve de base adaptable —vía prompting, recuperación o fine-tuning— a muchas tareas posteriores.",
67
+ "takeaways": [
68
+ "Los modelos fundacionales son bases generales adaptadas a muchas tareas.",
69
+ "Los LLM y los modelos multimodales son los ejemplos principales.",
70
+ "La mayoría se construyen sobre la arquitectura transformer.",
71
+ "Las capacidades emergen con la escala de datos, parámetros y cómputo.",
72
+ "Se adaptan por prompting, recuperación (RAG) o fine-tuning; rara vez entrenando desde cero."
73
+ ],
74
+ "context": [
75
+ "Antes de los modelos fundacionales, los equipos entrenaban modelos estrechos para cada tarea. El paradigma fundacional lo invierte: un modelo grande se preentrena una vez con datos amplios y se reutiliza en todas partes. Esa reutilización es la razón por la que un puñado de modelos sustenta hoy la mayoría de productos de IA.",
76
+ "También concentra capacidad y riesgo. Como tanto se construye sobre unas pocas bases, sus sesgos, fallos y propiedades de seguridad se propagan aguas abajo, parte de por qué importan la gobernanza y la evaluación."
77
+ ],
78
+ "architecture": [
79
+ "Preentrenamiento: un modelo con millones a billones de parámetros aprende patrones generales de conjuntos de datos masivos, normalmente con objetivos autosupervisados como la predicción del siguiente token. La atención del transformer lo hace escalable.",
80
+ "Adaptación: la misma base se especializa para su uso —prompting zero/few-shot, RAG para conocimiento fresco o privado, o fine-tuning para comportamiento y dominio. Los agentes envuelven el modelo en herramientas y un harness."
81
+ ],
82
+ "components": ["Arquitectura transformer", "Datos y objetivo de preentrenamiento", "Parámetros (pesos)", "Tokenizador", "Capa de adaptación (prompt / RAG / fine-tune)"],
83
+ "pros": [
84
+ "Una base reutilizada en muchas tareas.",
85
+ "Fuerte capacidad general de fábrica.",
86
+ "Adaptación rápida sin entrenar desde cero.",
87
+ "Las variantes multimodales abarcan texto, imagen, audio y más."
88
+ ],
89
+ "risks": [
90
+ "Riesgo concentrado: los fallos se propagan a todo lo construido sobre ellos.",
91
+ "Costoso de preentrenar; pocas organizaciones pueden.",
92
+ "Heredan sesgos y lagunas de los datos de entrenamiento.",
93
+ "El conocimiento queda congelado en el momento del entrenamiento sin recuperación."
94
+ ],
95
+ "tools": ["LLM frontera (Claude, GPT, Gemini)", "Modelos de pesos abiertos (Llama, Mistral)", "Modelos multimodales", "Plataformas de hosting / inferencia"],
96
+ "examples": [
97
+ "Usar un LLM para resumir, clasificar y redactar en toda una organización.",
98
+ "Adaptar un modelo base a un dominio con recuperación en vez de reentrenar.",
99
+ "Construir un agente sobre un modelo frontera más herramientas y memoria."
100
+ ],
101
+ "faqs": [
102
+ { "q": "¿Un modelo fundacional es lo mismo que un LLM?", "a": "Un LLM es el tipo más común de modelo fundacional, especializado en lenguaje. Los modelos fundacionales también incluyen multimodales y otros de propósito general." },
103
+ { "q": "¿Por qué se llaman 'fundacionales'?", "a": "Porque sirven de base compartida sobre la que se construyen muchas aplicaciones, en lugar de un modelo entrenado para una sola tarea." },
104
+ { "q": "¿Necesito entrenar uno?", "a": "Casi nunca. El preentrenamiento es extremadamente costoso; casi todo el valor viene de adaptar una base existente vía prompting, recuperación o fine-tuning." },
105
+ { "q": "¿Cómo se relacionan los agentes con los modelos fundacionales?", "a": "Un agente usa un modelo fundacional como núcleo de razonamiento, envuelto en herramientas, memoria y un bucle de control —el harness— para tomar acciones." }
106
+ ]
107
+ },
108
+ "pt": {
109
+ "title": "O que são Modelos de Fundação (Foundation Models)?",
110
+ "summary": "Um modelo de fundação é um modelo grande pré-treinado em escala com dados amplos que pode ser adaptado a uma ampla variedade de tarefas posteriores. Os modelos de linguagem (LLMs) e os multimodais são os exemplos canônicos. O termo, cunhado em Stanford em 2021, captura uma mudança: em vez de treinar um modelo sob medida por tarefa, as organizações constroem sobre uma base geral compartilhada e depois a especializam via prompting, recuperação ou fine-tuning.",
111
+ "definition": "Um modelo de fundação é um modelo grande e de propósito geral, pré-treinado com dados amplos, que serve de base adaptável — via prompting, recuperação ou fine-tuning — a muitas tarefas posteriores.",
112
+ "takeaways": [
113
+ "Os modelos de fundação são bases gerais adaptadas a muitas tarefas.",
114
+ "Os LLMs e os modelos multimodais são os exemplos principais.",
115
+ "A maioria é construída sobre a arquitetura transformer.",
116
+ "As capacidades emergem com a escala de dados, parâmetros e computação.",
117
+ "São adaptados por prompting, recuperação (RAG) ou fine-tuning; raramente treinando do zero."
118
+ ],
119
+ "context": [
120
+ "Antes dos modelos de fundação, as equipes treinavam modelos estreitos para cada tarefa. O paradigma de fundação inverte isso: um modelo grande é pré-treinado uma vez com dados amplos e reutilizado em todo lugar. Essa reutilização é a razão pela qual um punhado de modelos sustenta hoje a maioria dos produtos de IA.",
121
+ "Também concentra capacidade e risco. Como tanto se constrói sobre poucas bases, seus vieses, falhas e propriedades de segurança se propagam para baixo, parte do porquê governança e avaliação importam."
122
+ ],
123
+ "architecture": [
124
+ "Pré-treinamento: um modelo com milhões a trilhões de parâmetros aprende padrões gerais de conjuntos de dados massivos, normalmente com objetivos autossupervisionados como a previsão do próximo token. A atenção do transformer torna isso escalável.",
125
+ "Adaptação: a mesma base é especializada para uso — prompting zero/few-shot, RAG para conhecimento fresco ou privado, ou fine-tuning para comportamento e domínio. Os agentes envolvem o modelo em ferramentas e um harness."
126
+ ],
127
+ "components": ["Arquitetura transformer", "Dados e objetivo de pré-treinamento", "Parâmetros (pesos)", "Tokenizador", "Camada de adaptação (prompt / RAG / fine-tune)"],
128
+ "pros": [
129
+ "Uma base reutilizada em muitas tarefas.",
130
+ "Forte capacidade geral de fábrica.",
131
+ "Adaptação rápida sem treinar do zero.",
132
+ "As variantes multimodais abrangem texto, imagem, áudio e mais."
133
+ ],
134
+ "risks": [
135
+ "Risco concentrado: as falhas se propagam a tudo o que é construído sobre eles.",
136
+ "Custoso de pré-treinar; poucas organizações conseguem.",
137
+ "Herdam vieses e lacunas dos dados de treinamento.",
138
+ "O conhecimento fica congelado no momento do treinamento sem recuperação."
139
+ ],
140
+ "tools": ["LLMs de fronteira (Claude, GPT, Gemini)", "Modelos de pesos abertos (Llama, Mistral)", "Modelos multimodais", "Plataformas de hosting / inferência"],
141
+ "examples": [
142
+ "Usar um LLM para resumir, classificar e redigir em toda uma organização.",
143
+ "Adaptar um modelo base a um domínio com recuperação em vez de retreinar.",
144
+ "Construir um agente sobre um modelo de fronteira mais ferramentas e memória."
145
+ ],
146
+ "faqs": [
147
+ { "q": "Um modelo de fundação é o mesmo que um LLM?", "a": "Um LLM é o tipo mais comum de modelo de fundação, especializado em linguagem. Os modelos de fundação também incluem multimodais e outros de propósito geral." },
148
+ { "q": "Por que são chamados de 'fundação'?", "a": "Porque servem de base compartilhada sobre a qual muitas aplicações são construídas, em vez de um modelo treinado para uma única tarefa." },
149
+ { "q": "Preciso treinar um?", "a": "Quase nunca. O pré-treinamento é extremamente custoso; quase todo o valor vem de adaptar uma base existente via prompting, recuperação ou fine-tuning." },
150
+ { "q": "Como os agentes se relacionam com os modelos de fundação?", "a": "Um agente usa um modelo de fundação como núcleo de raciocínio, envolvido em ferramentas, memória e um laço de controle — o harness — para tomar ações." }
151
+ ]
152
+ }
153
+ }
154
+ }
@@ -0,0 +1,153 @@
1
+ {
2
+ "slug": "guardrails",
3
+ "category": "governance",
4
+ "updated": "2026-06-21",
5
+ "version": "1.0",
6
+ "related": ["prompt-injection", "ai-governance", "human-in-the-loop", "ai-observability", "ai-cyberdefense", "agentic-threat-model"],
7
+ "references": [
8
+ { "title": "OWASP — Top 10 for LLM Applications", "url": "https://genai.owasp.org/llm-top-10/" },
9
+ { "title": "NIST — AI Risk Management Framework (AI RMF 1.0)", "url": "https://www.nist.gov/itl/ai-risk-management-framework" }
10
+ ],
11
+ "evidence": {
12
+ "evidenceLevel": "industry_observation",
13
+ "confidenceLevel": "high",
14
+ "sourceType": ["industry_observation", "paper"]
15
+ },
16
+ "locales": {
17
+ "en": {
18
+ "title": "What are AI Guardrails?",
19
+ "summary": "Guardrails are runtime controls that constrain what goes into and comes out of an AI system, keeping its behavior safe, on-policy and compliant. They check and filter inputs and outputs, validate tool actions, block disallowed content and enforce limits — sitting around the model as a safety layer. Guardrails are a primary, operational control in AI governance and a key defense against misuse and prompt injection.",
20
+ "definition": "AI guardrails are runtime safeguards that validate, filter or constrain a model's inputs, outputs and actions to keep its behavior safe, compliant and within defined policy.",
21
+ "takeaways": [
22
+ "Guardrails act at runtime on inputs, outputs and actions.",
23
+ "They enforce safety, policy and compliance, not model quality.",
24
+ "Types: input filtering, output validation, action allow-lists, limits.",
25
+ "A core defense against misuse and prompt injection.",
26
+ "Guardrails complement — they do not replace — evaluation and oversight."
27
+ ],
28
+ "context": [
29
+ "A model alone has no enforceable boundaries; it will attempt whatever the prompt elicits. Guardrails add those boundaries operationally: deterministic or model-based checks that sit between the user, the model and the systems it can touch.",
30
+ "They are how governance policies become live controls. A policy that says 'never expose PII' or 'never execute payments without approval' is realized as a guardrail that actually checks and blocks at runtime."
31
+ ],
32
+ "architecture": [
33
+ "Input guardrails screen prompts (e.g. for injection, policy violations, PII). Output guardrails validate responses (format, safety, factual constraints, PII redaction). Action guardrails gate tool calls with permissions and allow-lists. Rate, scope and budget limits cap blast radius.",
34
+ "Guardrails can be deterministic (rules, schemas, regex, allow-lists) or model-based (a classifier or LLM judge). They pair with observability to log violations and with human-in-the-loop approval for high-impact actions."
35
+ ],
36
+ "components": ["Input filtering", "Output validation / redaction", "Action allow-lists & permissions", "Rate & scope limits", "Policy classifiers", "Violation logging"],
37
+ "pros": [
38
+ "Enforces safety and policy at runtime, not just in guidance.",
39
+ "Reduces misuse, unsafe output and injection impact.",
40
+ "Operationalizes governance and compliance requirements.",
41
+ "Bounds the blast radius of agent actions."
42
+ ],
43
+ "risks": [
44
+ "Over-blocking harms usefulness (false positives).",
45
+ "Under-blocking creates a false sense of safety.",
46
+ "Model-based guardrails add latency and cost.",
47
+ "They are not a complete defense; combine with oversight and evals."
48
+ ],
49
+ "tools": ["Guardrail frameworks (e.g. NeMo Guardrails, Guardrails AI)", "Content moderation / safety classifiers", "Schema & input validation", "Permission & policy engines", "Observability for violations"],
50
+ "examples": [
51
+ "Redacting personal data from a model's output before it is shown.",
52
+ "Blocking a tool call that falls outside an allow-list of safe actions.",
53
+ "Rejecting responses that do not match a required JSON schema."
54
+ ],
55
+ "faqs": [
56
+ { "q": "Are guardrails the same as alignment?", "a": "No. Alignment shapes the model's intrinsic behavior during training; guardrails are external runtime controls around the deployed system. They are complementary." },
57
+ { "q": "Do guardrails stop prompt injection?", "a": "They reduce its impact — input screening and action allow-lists help — but no guardrail fully prevents injection. Use layered defenses plus human approval for sensitive actions." },
58
+ { "q": "Deterministic or model-based guardrails?", "a": "Both. Deterministic checks (schemas, allow-lists) are cheap and reliable for clear rules; model-based checks handle nuanced content at the cost of latency." },
59
+ { "q": "How do guardrails fit AI governance?", "a": "They are the operational layer: the runtime controls that turn governance policies into enforced behavior, evidenced through logging and audit." }
60
+ ]
61
+ },
62
+ "es": {
63
+ "title": "¿Qué son los Guardarraíles de IA (Guardrails)?",
64
+ "summary": "Los guardarraíles son controles en tiempo de ejecución que acotan lo que entra y sale de un sistema de IA, manteniendo su comportamiento seguro, conforme a la política y al cumplimiento. Comprueban y filtran entradas y salidas, validan acciones de herramientas, bloquean contenido no permitido e imponen límites, situándose alrededor del modelo como capa de seguridad. Son un control primario y operativo en la gobernanza de IA y una defensa clave contra el mal uso y la inyección de prompts.",
65
+ "definition": "Los guardarraíles de IA son salvaguardas en tiempo de ejecución que validan, filtran o acotan las entradas, salidas y acciones de un modelo para mantener su comportamiento seguro, conforme y dentro de la política definida.",
66
+ "takeaways": [
67
+ "Los guardarraíles actúan en tiempo de ejecución sobre entradas, salidas y acciones.",
68
+ "Imponen seguridad, política y cumplimiento, no la calidad del modelo.",
69
+ "Tipos: filtrado de entrada, validación de salida, listas de permitidos de acciones, límites.",
70
+ "Una defensa central contra el mal uso y la inyección de prompts.",
71
+ "Complementan —no reemplazan— la evaluación y la supervisión."
72
+ ],
73
+ "context": [
74
+ "Un modelo por sí solo no tiene límites exigibles; intentará lo que el prompt provoque. Los guardarraíles añaden esos límites de forma operativa: comprobaciones deterministas o basadas en modelo que se sitúan entre el usuario, el modelo y los sistemas que puede tocar.",
75
+ "Son la forma en que las políticas de gobernanza se vuelven controles vivos. Una política que dice 'nunca exponer datos personales' o 'nunca ejecutar pagos sin aprobación' se materializa como un guardarraíl que realmente comprueba y bloquea en tiempo de ejecución."
76
+ ],
77
+ "architecture": [
78
+ "Los guardarraíles de entrada filtran prompts (p. ej. inyección, violaciones de política, datos personales). Los de salida validan respuestas (formato, seguridad, restricciones factuales, redacción de datos personales). Los de acción acotan las llamadas a herramientas con permisos y listas de permitidos. Los límites de tasa, alcance y presupuesto contienen el radio de impacto.",
79
+ "Pueden ser deterministas (reglas, esquemas, regex, listas de permitidos) o basados en modelo (un clasificador o juez LLM). Se combinan con observabilidad para registrar violaciones y con aprobación con humano en el bucle para acciones de alto impacto."
80
+ ],
81
+ "components": ["Filtrado de entrada", "Validación / redacción de salida", "Listas de permitidos y permisos de acción", "Límites de tasa y alcance", "Clasificadores de política", "Registro de violaciones"],
82
+ "pros": [
83
+ "Impone seguridad y política en ejecución, no solo en la guía.",
84
+ "Reduce el mal uso, la salida insegura y el impacto de la inyección.",
85
+ "Operacionaliza requisitos de gobernanza y cumplimiento.",
86
+ "Acota el radio de impacto de las acciones del agente."
87
+ ],
88
+ "risks": [
89
+ "El sobrebloqueo daña la utilidad (falsos positivos).",
90
+ "El infrabloqueo crea una falsa sensación de seguridad.",
91
+ "Los guardarraíles basados en modelo añaden latencia y coste.",
92
+ "No son una defensa completa; combínalos con supervisión y evaluaciones."
93
+ ],
94
+ "tools": ["Frameworks de guardarraíles (p. ej. NeMo Guardrails, Guardrails AI)", "Clasificadores de moderación / seguridad", "Validación de esquemas y entradas", "Motores de permisos y políticas", "Observabilidad de violaciones"],
95
+ "examples": [
96
+ "Redactar datos personales de la salida de un modelo antes de mostrarla.",
97
+ "Bloquear una llamada a herramienta fuera de una lista de acciones seguras.",
98
+ "Rechazar respuestas que no cumplen un esquema JSON requerido."
99
+ ],
100
+ "faqs": [
101
+ { "q": "¿Los guardarraíles son lo mismo que la alineación?", "a": "No. La alineación moldea el comportamiento intrínseco del modelo durante el entrenamiento; los guardarraíles son controles externos en ejecución alrededor del sistema desplegado. Son complementarios." },
102
+ { "q": "¿Los guardarraíles detienen la inyección de prompts?", "a": "Reducen su impacto —el filtrado de entrada y las listas de permitidos ayudan— pero ningún guardarraíl la previene por completo. Usa defensas por capas más aprobación humana para acciones sensibles." },
103
+ { "q": "¿Guardarraíles deterministas o basados en modelo?", "a": "Ambos. Las comprobaciones deterministas (esquemas, listas) son baratas y fiables para reglas claras; las basadas en modelo manejan contenido con matices a costa de latencia." },
104
+ { "q": "¿Cómo encajan los guardarraíles en la gobernanza de IA?", "a": "Son la capa operativa: los controles en ejecución que convierten las políticas de gobernanza en comportamiento exigido, evidenciado mediante registro y auditoría." }
105
+ ]
106
+ },
107
+ "pt": {
108
+ "title": "O que são Guard-rails de IA (Guardrails)?",
109
+ "summary": "Os guard-rails são controles em tempo de execução que limitam o que entra e sai de um sistema de IA, mantendo seu comportamento seguro, em conformidade com a política e a regulação. Verificam e filtram entradas e saídas, validam ações de ferramentas, bloqueiam conteúdo não permitido e impõem limites, situando-se ao redor do modelo como camada de segurança. São um controle primário e operacional na governança de IA e uma defesa-chave contra o mau uso e a injeção de prompts.",
110
+ "definition": "Os guard-rails de IA são salvaguardas em tempo de execução que validam, filtram ou limitam as entradas, saídas e ações de um modelo para manter seu comportamento seguro, conforme e dentro da política definida.",
111
+ "takeaways": [
112
+ "Os guard-rails atuam em tempo de execução sobre entradas, saídas e ações.",
113
+ "Impõem segurança, política e conformidade, não a qualidade do modelo.",
114
+ "Tipos: filtragem de entrada, validação de saída, listas de permitidos de ações, limites.",
115
+ "Uma defesa central contra o mau uso e a injeção de prompts.",
116
+ "Complementam — não substituem — a avaliação e a supervisão."
117
+ ],
118
+ "context": [
119
+ "Um modelo sozinho não tem limites exigíveis; tentará o que o prompt provocar. Os guard-rails adicionam esses limites de forma operacional: verificações determinísticas ou baseadas em modelo que se situam entre o usuário, o modelo e os sistemas que ele pode tocar.",
120
+ "São a forma como as políticas de governança se tornam controles vivos. Uma política que diz 'nunca expor dados pessoais' ou 'nunca executar pagamentos sem aprovação' se materializa como um guard-rail que realmente verifica e bloqueia em tempo de execução."
121
+ ],
122
+ "architecture": [
123
+ "Os guard-rails de entrada filtram prompts (ex.: injeção, violações de política, dados pessoais). Os de saída validam respostas (formato, segurança, restrições factuais, redação de dados pessoais). Os de ação limitam as chamadas de ferramentas com permissões e listas de permitidos. Os limites de taxa, escopo e orçamento contêm o raio de impacto.",
124
+ "Podem ser determinísticos (regras, esquemas, regex, listas de permitidos) ou baseados em modelo (um classificador ou juiz LLM). Combinam-se com observabilidade para registrar violações e com aprovação com humano no laço para ações de alto impacto."
125
+ ],
126
+ "components": ["Filtragem de entrada", "Validação / redação de saída", "Listas de permitidos e permissões de ação", "Limites de taxa e escopo", "Classificadores de política", "Registro de violações"],
127
+ "pros": [
128
+ "Impõe segurança e política em execução, não só na orientação.",
129
+ "Reduz o mau uso, a saída insegura e o impacto da injeção.",
130
+ "Operacionaliza requisitos de governança e conformidade.",
131
+ "Limita o raio de impacto das ações do agente."
132
+ ],
133
+ "risks": [
134
+ "O bloqueio em excesso prejudica a utilidade (falsos positivos).",
135
+ "O bloqueio insuficiente cria uma falsa sensação de segurança.",
136
+ "Os guard-rails baseados em modelo adicionam latência e custo.",
137
+ "Não são uma defesa completa; combine-os com supervisão e avaliações."
138
+ ],
139
+ "tools": ["Frameworks de guard-rails (ex.: NeMo Guardrails, Guardrails AI)", "Classificadores de moderação / segurança", "Validação de esquemas e entradas", "Motores de permissões e políticas", "Observabilidade de violações"],
140
+ "examples": [
141
+ "Redigir dados pessoais da saída de um modelo antes de exibi-la.",
142
+ "Bloquear uma chamada de ferramenta fora de uma lista de ações seguras.",
143
+ "Rejeitar respostas que não cumprem um esquema JSON exigido."
144
+ ],
145
+ "faqs": [
146
+ { "q": "Os guard-rails são o mesmo que alinhamento?", "a": "Não. O alinhamento molda o comportamento intrínseco do modelo durante o treinamento; os guard-rails são controles externos em execução ao redor do sistema implantado. São complementares." },
147
+ { "q": "Os guard-rails detêm a injeção de prompts?", "a": "Reduzem seu impacto — a filtragem de entrada e as listas de permitidos ajudam — mas nenhum guard-rail a previne por completo. Use defesas em camadas mais aprovação humana para ações sensíveis." },
148
+ { "q": "Guard-rails determinísticos ou baseados em modelo?", "a": "Ambos. As verificações determinísticas (esquemas, listas) são baratas e confiáveis para regras claras; as baseadas em modelo lidam com conteúdo com nuances ao custo de latência." },
149
+ { "q": "Como os guard-rails se encaixam na governança de IA?", "a": "São a camada operacional: os controles em execução que convertem as políticas de governança em comportamento exigido, evidenciado por registro e auditoria." }
150
+ ]
151
+ }
152
+ }
153
+ }