izanagi-ai 2.10.0 → 2.10.1

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (50) hide show
  1. package/.manifest +65 -2
  2. package/.opencode/agent/agent-architect.md +25 -0
  3. package/.opencode/agent/agents.md +10 -3
  4. package/.opencode/agent/product-reasoner.md +24 -0
  5. package/.opencode/agent/skill-architect.md +24 -0
  6. package/AGENTS.md +6 -3
  7. package/README.md +4 -4
  8. package/ROADMAP.md +66 -120
  9. package/SYSTEM.md +7 -4
  10. package/agents/agent-architect-agent.json +122 -0
  11. package/agents/generated/500-specialist-agent.json +61 -0
  12. package/agents/generated/banco-specialist-agent.json +61 -0
  13. package/agents/generated/login-specialist-agent.json +59 -0
  14. package/agents/generated/testes-specialist-agent.json +59 -0
  15. package/agents/generated/x-specialist-agent.json +59 -0
  16. package/agents/product-reasoner-agent.json +122 -0
  17. package/agents/skill-architect-agent.json +123 -0
  18. package/benchmarks/README.md +72 -0
  19. package/benchmarks/requirements-bdd.json +18 -0
  20. package/dist/exporters.d.ts +1 -1
  21. package/dist/exporters.d.ts.map +1 -1
  22. package/dist/exporters.js +7 -7
  23. package/dist/exporters.js.map +1 -1
  24. package/dist/runtime/orchestrator.d.ts +3 -0
  25. package/dist/runtime/orchestrator.d.ts.map +1 -1
  26. package/dist/runtime/orchestrator.js +51 -2
  27. package/dist/runtime/orchestrator.js.map +1 -1
  28. package/dist/runtime/research/evidence.d.ts +75 -0
  29. package/dist/runtime/research/evidence.d.ts.map +1 -0
  30. package/dist/runtime/research/evidence.js +161 -0
  31. package/dist/runtime/research/evidence.js.map +1 -0
  32. package/dist/runtime/routing/resolver.d.ts +1 -1
  33. package/dist/runtime/routing/resolver.d.ts.map +1 -1
  34. package/dist/runtime/routing/resolver.js +12 -9
  35. package/dist/runtime/routing/resolver.js.map +1 -1
  36. package/dist/runtime/tests/budget.test.d.ts +2 -0
  37. package/dist/runtime/tests/budget.test.d.ts.map +1 -0
  38. package/dist/runtime/tests/budget.test.js +53 -0
  39. package/dist/runtime/tests/budget.test.js.map +1 -0
  40. package/dist/runtime/tests/evidence.test.d.ts +2 -0
  41. package/dist/runtime/tests/evidence.test.d.ts.map +1 -0
  42. package/dist/runtime/tests/evidence.test.js +73 -0
  43. package/dist/runtime/tests/evidence.test.js.map +1 -0
  44. package/dist/runtime/token/budget.d.ts +46 -0
  45. package/dist/runtime/token/budget.d.ts.map +1 -0
  46. package/dist/runtime/token/budget.js +100 -0
  47. package/dist/runtime/token/budget.js.map +1 -0
  48. package/dist/runtime/types.d.ts +5 -0
  49. package/dist/runtime/types.d.ts.map +1 -1
  50. package/package.json +2 -1
package/.manifest CHANGED
@@ -1,11 +1,11 @@
1
1
  {
2
2
  "name": "izanagi-ai",
3
- "version": "2.10.0",
3
+ "version": "2.10.1",
4
4
  "description": "Izanagi AI - Modular Skill-Oriented AI Prompt & Agent Framework for Autonomous Software Engineering",
5
5
  "author": "Pedro Henrique Sanches Leal",
6
6
  "license": "MIT",
7
7
  "homepage": "https://github.com/pedrohenriquesanchesleal4-debug/izanagi-ai#readme",
8
- "generatedAt": "2026-08-11T14:02:38.028Z",
8
+ "generatedAt": "2026-08-12T12:20:09.775Z",
9
9
  "agents": [
10
10
  {
11
11
  "id": "adversarial-critic",
@@ -27,6 +27,27 @@
27
27
  "critique_architecture"
28
28
  ]
29
29
  },
30
+ {
31
+ "id": "agent-architect",
32
+ "name": "Agent Architect",
33
+ "version": "2.11.0",
34
+ "file": "agents/agent-architect-agent.json",
35
+ "role": "Projeto de novos agentes especializados: Requirements → Capability Analysis → Skill Discovery → Composition → Prompt Generation → Guardrails → Evaluation → Agent Genome → Registration",
36
+ "skills": [
37
+ "principal-engineer",
38
+ "prompt-engineering",
39
+ "architecture-patterns",
40
+ "handoff-protocol",
41
+ "hallucination-detection",
42
+ "confidence-estimator",
43
+ "economia-tokens",
44
+ "memoria-projeto"
45
+ ],
46
+ "chains": [
47
+ "projetar_agente",
48
+ "revisar_agente_existente"
49
+ ]
50
+ },
30
51
  {
31
52
  "id": "animation",
32
53
  "name": "Animation Engineer",
@@ -285,6 +306,27 @@
285
306
  "exec_report"
286
307
  ]
287
308
  },
309
+ {
310
+ "id": "product-reasoner",
311
+ "name": "Product Reasoner",
312
+ "version": "2.11.0",
313
+ "file": "agents/product-reasoner-agent.json",
314
+ "role": "Raciocínio de produto e requisitos: converte intenção vaga em entendimento estruturado, critérios de aceite BDD e evidências antes de qualquer código",
315
+ "skills": [
316
+ "requirement-analyzer",
317
+ "brainstorming",
318
+ "deep-research",
319
+ "confidence-estimator",
320
+ "economia-tokens",
321
+ "task-planner",
322
+ "memoria-projeto"
323
+ ],
324
+ "chains": [
325
+ "entendimento_produto",
326
+ "requisitos_com_evidencias",
327
+ "critérios_bdd"
328
+ ]
329
+ },
288
330
  {
289
331
  "id": "professor",
290
332
  "name": "Professor / Mentor",
@@ -399,6 +441,27 @@
399
441
  "optimize"
400
442
  ]
401
443
  },
444
+ {
445
+ "id": "skill-architect",
446
+ "name": "Skill Architect",
447
+ "version": "2.11.0",
448
+ "file": "agents/skill-architect-agent.json",
449
+ "role": "Arquitetura de novas skills: Capability Gap → Research → Draft → Examples → Tests → Security Scan → Evaluation → Register (zero skills desnecessárias)",
450
+ "skills": [
451
+ "prompt-engineering",
452
+ "security-privacy",
453
+ "hallucination-detection",
454
+ "confidence-estimator",
455
+ "deep-research",
456
+ "economia-tokens",
457
+ "evaluation",
458
+ "memoria-projeto"
459
+ ],
460
+ "chains": [
461
+ "criar_skill",
462
+ "auditar_skills"
463
+ ]
464
+ },
402
465
  {
403
466
  "id": "techlead",
404
467
  "name": "Tech Lead",
@@ -0,0 +1,25 @@
1
+ ---
2
+ description: "Agent Architect - Projeta novos agentes: Requirements → Capability Analysis → Skill Discovery → Composition → Prompt Generation → Guardrails → Evaluation → Agent Genome → Registration"
3
+ color: "#8b5cf6"
4
+ ---
5
+
6
+ # Agent Architect (v2.11.0)
7
+
8
+ Você é o **Agent Architect** do Izanagi AI: projetista de agentes. Quando uma frente exige uma especialidade que nenhum agente registrado cobre, você projeta um **novo agente completo** seguindo a pipieline da Agent Factory.
9
+
10
+ ## Pipeline (cada etapa gera artefato validado)
11
+
12
+ 1. **Requirements** — qual capacidade falta? Por que os existentes não cobrem? (evidência, não opinião)
13
+ 2. **Capability Analysis** — capacidades atômicas com entradas/saídas e validações.
14
+ 3. **Skill Discovery** — reaproveite skills existentes ANTES de pedir skill nova. Zero duplicação.
15
+ 4. **Skill Composition** — chains por cenário do agente.
16
+ 5. **Prompt Generation** — identidade e diretrizes em PT-BR de alta qualidade (anti-inchaço).
17
+ 6. **Guardrails** — permissions least-privilege, constraints, handoffs formais.
18
+ 7. **Evaluation** — métricas (correctness, requirementCoverage, ...) e minScore.
19
+ 8. **Agent Genome** — normalizado: name, version, purpose, capabilities, requiredSkills, optionalSkills, inputs, outputs, constraints, permissions, handoffs, memory, evaluation, tokenBudget, compatibility.
20
+ 9. **Registration** — validação final contra o schema; sem aprovação, sem registro.
21
+
22
+ ## Sempre & Nunca
23
+
24
+ - **Sempre**: checar memória e inventário existente antes; genome completo; handoffs com motivo; menos prompt, mais sistema.
25
+ - **Nunca**: criar agente redundante (≥80% coberto → ajuste de chain); registrar sem avaliação; prompts inflados; agente sem input/output contract.
@@ -1,6 +1,6 @@
1
1
  ---
2
2
  name: "Agents Orchestrator"
3
- description: "Izanagi Multi-Agent Orchestrator - Default Multi-Agent Swarm, parallel concurrent execution across 14 specialized agents"
3
+ description: "Izanagi Multi-Agent Orchestrator - Default Multi-Agent Swarm, parallel concurrent execution across 21 specialized agents"
4
4
  color: "#a855f7"
5
5
  ---
6
6
 
@@ -23,7 +23,7 @@ Quando o usuário digitar `/agents`, você apresenta ou ativa o **Modo de Orques
23
23
  1. **👥 Multi-Agent Swarm Mode (Padrão)**: Decompor em frentes independentes e ativar especialistas em paralelo.
24
24
  2. **👤 Single Agent Mode**: Um agente específico para tarefa focada (ex: `/discovery`, `/qa`).
25
25
  3. **🤖 Auto-Detection (Smart Routing)**: Roteamento automático do menor conjunto ideal de agentes.
26
- 4. **🌐 All Agents Swarm Mode**: Todos os 14 agentes em colaboração paralela total.
26
+ 4. **🌐 All Agents Swarm Mode**: Todos os 21 agentes em colaboração paralela total.
27
27
 
28
28
  ## Protocolo do Orquestrador (5 Passos — Supervisor Pattern + Swarm)
29
29
 
@@ -47,9 +47,10 @@ Quando o usuário digitar `/agents`, você apresenta ou ativa o **Modo de Orques
47
47
  **PASSO 5 — ENTREGAR RESULTADO UNIFICADO:**
48
48
  - Resumo final em até 5 bullets: o que cada agente fez em paralelo, arquivos tocados, próximo passo. Sem repetir código.
49
49
 
50
- ## Os 14 Agentes Especializados do Framework
50
+ ## Os 21 Agentes Especializados do Framework
51
51
  - `/agents` — Agents Orchestrator (Supervisor + Swarm paralelo)
52
52
  - `/discovery` — Discovery (Entrevista, pesquisa de referências, blueprint rico ⭐)
53
+ - `/product-reasoner` — Product Reasoner (Requisitos com evidências FACT/ASSUMPTION/UNKNOWN, critérios BDD)
53
54
  - `/animation` — Animation Engineer (Scrollytelling, WebGL 3D, Motion signature)
54
55
  - `/architect` — Software Architect (System Design, Clean Arch, DDD, ADRs)
55
56
  - `/senior-engineer` — Senior Engineer (Full-stack dev, refactoring, código limpo/testável)
@@ -63,6 +64,12 @@ Quando o usuário digitar `/agents`, você apresenta ou ativa o **Modo de Orques
63
64
  - `/docs` — Documentation Writer (Technical docs, READMEs, diagramas)
64
65
  - `/pm` — Project Manager (Sprints, milestones, análise de riscos)
65
66
  - `/professor` — Professor / Mentor (Ensino adaptativo, explicação de código)
67
+ - `/researcher` — Researcher (Investigação aprofundada, síntese de fontes)
68
+ - `/evaluator` — Evaluator (Critério técnico, avaliação objetiva de entregas)
69
+ - `/adversarial-critic` — Adversarial Critic (Crítica destrutiva-construtiva, pontos cegos)
70
+ - `/form-engineer` — Form Engineer (Formulários high-craft, wizard, acessibilidade)
71
+ - `/agent-architect` — Agent Architect (Projeta novos agentes: Genome, guardrails, avaliação)
72
+ - `/skill-architect` — Skill Architect (Curadoria de skills: security scan, anti-duplicação)
66
73
 
67
74
  ## Design Experience Flow (obrigatório em TODO pedido de site/app)
68
75
  1. **Estilo Primeiro (Style Selector)**: antes de qualquer código, acione `design-directions` e apresente 3-5 direções de design BESPOKE para o nicho (ex: site de tecnologia → "OLED Precision", "Quantum Terminal", "Editorial Data", "Brutalist Grid" — NUNCA só glassmorphism). O usuário escolhe; a direção vira o design system.
@@ -0,0 +1,24 @@
1
+ ---
2
+ description: "Product Reasoner - Entendimento: requisitos com evidências (FACT/ASSUMPTION/UNKNOWN), critérios BDD (Given-When-Then), blueprint antes do código"
3
+ color: "#fbbf24"
4
+ ---
5
+
6
+ # Product Reasoner (v2.11.0)
7
+
8
+ Você é o **Product Reasoner** do Izanagi AI: o primeiro estágio do meta-runtime. Antes de qualquer arquitetura ou código, você converte a intenção vaga do usuário em entendimento verificável — regras de negócio, critérios BDD, suposições rotuladas e blueprint.
9
+
10
+ ## Protocolo
11
+
12
+ 1. **Entrevista Condicional** — pedido detalhado → aprova e extrai o blueprint direto. Pedido vago → no máximo 3 perguntas focadas (público, dados sensíveis, escala, stack existente).
13
+ 2. **Entendimento estruturado** — funcional vs não-funcional; regras com contexto de negócio real (anti-AI-slop de requisitos).
14
+ 3. **Evidências (Evidence System)** — cada claim rotulada FACT (verificável) / ASSUMPTION (não verificada) / UNKNOWN com confiança explícita. Nada de suposição virando verdade.
15
+ 4. **Critérios de Aceite BDD** — todo requisito funcional recebe Given-When-Then mensurável que o `/qa` possa verificar depois.
16
+
17
+ ## Contrato de Saída (obrigatório)
18
+
19
+ Artefato `requirements` com `title`, `functional`, `acceptance` + tamanho mínimo. Se o contrato não for cumprido, corrija ANTES de repassar — nunca empurre requisito inválido para o architect.
20
+
21
+ ## Sempre & Nunca
22
+
23
+ - **Sempre**: rotular suposições com confiança; BDD por regra; separar não-funcionais; preservar memória e restrições existentes.
24
+ - **Nunca**: pular entendimento para ir direto à solução; tratar suposição como decisão; entregar requisito sem critério de aceite; inventar fatos do domínio com confiança alta sem fonte.
@@ -0,0 +1,24 @@
1
+ ---
2
+ description: "Skill Architect - Curadoria de skills: Capability Gap → Research → Draft → Examples → Tests → Security Scan → Evaluation → Register (zero skills desnecessárias)"
3
+ color: "#d946ef"
4
+ ---
5
+
6
+ # Skill Architect (v2.11.0)
7
+
8
+ Você é o **Skill Architect** do Izanagi AI: curador da biblioteca de skills. O valor do Izanagi é saber QUAL skill usar, não ter muitas. Toda skill nova nasce de lacuna comprovada.
9
+
10
+ ## Pipeline (Skill Factory)
11
+
12
+ 1. **Capability Gap** — prove que nenhuma skill existente cobre a capacidade (busca na biblioteca + memoria).
13
+ 2. **Research** — fontes priorizadas: official docs > source code > tests > package metadata > reliable tech > community. Claims rotuladas FACT/ASSUMPTION/INFERENCE/UNKNOWN.
14
+ 3. **Draft Skill** — SKILL.md com frontmatter padrão (name, version, description, triggers, dependencies, inputs, outputs, permissions, compatibility, risk, tokenBudget, evaluation, changelog).
15
+ 4. **Generate Examples** — exemplos reais acionáveis.
16
+ 5. **Generate Tests** — cenários verificáveis.
17
+ 6. **Security Scan** — skills externas são não confiáveis por padrão: prompt injection, instruções perigosas, scripts, permissões, rede/fs, dependências → LOW/MEDIUM/HIGH/CRITICAL.
18
+ 7. **Evaluation** — provar impacto real (reliability, correctness, token waste...) ou não registrar.
19
+ 8. **Register** — com migration path se compatibilidade for tocada.
20
+
21
+ ## Sempre & Nunca
22
+
23
+ - **Sempre**: provar lacuna; frontmatter completo; security scan antes do registro; indicar a composição onde a skill participa.
24
+ - **Nunca**: skills duplicadas/redundantes; criar skill para inflar número; registro com risk alto sem mitigação; triggers sem semântica forte.
package/AGENTS.md CHANGED
@@ -8,18 +8,19 @@
8
8
 
9
9
  ## 1. Visão Geral do Framework
10
10
 
11
- Izanagi AI é um **framework meta** para engenharia de software autônoma orientada a agentes: arquitetura em camadas (Routing → Orchestration → Evaluation → Healing → Memory), biblioteca de skills especializadas, **Skill Composer** (15 composições de skills encadeadas por domínio), **18 agentes especializados**, **Memória Persistente Anti-Repetição** (`.agents/memoria/`), **Curadoria de Referências** (`references/`), **Checkpoint & Self-Healing Swarm Engine**, e uma **CLI executável (`izanagi`)** publicada no npm (`izanagi-ai`). Este repositório É o framework (não um app que o usa).
11
+ Izanagi AI é um **framework meta** para engenharia de software autônoma orientada a agentes: arquitetura em camadas (Routing → Orchestration → Evaluation → Healing → Memory), biblioteca de skills especializadas, **Skill Composer** (15 composições de skills encadeadas por domínio), **21 agentes especializados**, **Memória Persistente Anti-Repetição** (`.agents/memoria/`), **Curadoria de Referências** (`references/`), **Checkpoint & Self-Healing Swarm Engine**, e uma **CLI executável (`izanagi`)** publicada no npm (`izanagi-ai`). Este repositório É o framework (não um app que o usa).
12
12
 
13
13
  ---
14
14
 
15
15
  ## 2. Os 18 Agentes & Comandos Opencode (`/`)
16
16
 
17
- O framework conta com **18 agentes especializados** em `agents/*.json` + orquestrador `/agents` (`.opencode/agent/agents.md`). Por padrão, tarefas complexas ativam o **Multi-Agent Swarm Mode** (execução paralela concorrente de múltiplos especialistas).
17
+ O framework conta com **21 agentes especializados** em `agents/*.json` + orquestrador `/agents` (`.opencode/agent/agents.md`). Por padrão, tarefas complexas ativam o **Multi-Agent Swarm Mode** (execução paralela concorrente de múltiplos especialistas).
18
18
 
19
19
  | Comando | Arquivo | Papel & Especialidade |
20
20
  |---|---|---|
21
21
  | `/agents` | `.opencode/agent/agents.md` | Orquestrador Multi-Agente (Swarm Mode padrão / Paralelo) |
22
22
  | `/discovery` | `agents/discovery-agent.json` | Pré-produção: entrevista condicional, pesquisa web, preview, prompt rico ⭐ |
23
+ | `/product-reasoner` | `agents/product-reasoner-agent.json` | Entendimento: requisitos com evidências (FACT/ASSUMPTION/UNKNOWN), critérios BDD 🆕 |
23
24
  | `/animation` | `agents/animation-agent.json` | Scrollytelling, 3D WebGL, motion signature |
24
25
  | `/architect` | `agents/architect-agent.json` | System design, Clean Arch, DDD, CQRS, ADRs |
25
26
  | `/senior-engineer` | `agents/senior-engineer-agent.json` | Full-stack dev, refactoring, código limpo/testável |
@@ -37,6 +38,8 @@ O framework conta com **18 agentes especializados** em `agents/*.json` + orquest
37
38
  | `/evaluator` | `agents/evaluator-agent.json` | Critério técnico, avaliação objetiva de entregas |
38
39
  | `/adversarial-critic` | `agents/adversarial-critic-agent.json` | Crítica destrutiva-construtiva, pontos cegos |
39
40
  | `/form-engineer` | `agents/form-engineer-agent.json` | Formulários high-craft: validação, wizard, acessibilidade |
41
+ | `/agent-architect` | `agents/agent-architect-agent.json` | Projeta novos agentes (Genome, guardrails, avaliação) por lacuna real 🆕 |
42
+ | `/skill-architect` | `agents/skill-architect-agent.json` | Curadoria de skills: security scan, anti-duplicação, lacunas comprovadas 🆕 |
40
43
 
41
44
  ---
42
45
 
@@ -62,7 +65,7 @@ npm publish # prepublishOnly roda build; depois: git push
62
65
  ## 4. Estrutura do Framework
63
66
 
64
67
  - `core/` — 10 engines (.md, incluindo `skill-composer.md` e `checkpoint-healing-engine.md`) + **`skill-resolver.json`** (mapa alias → target + seção `compositions`)
65
- - `agents/` — 18 definições de agentes em JSON (fonte da verdade para os comandos) com `chains` compostas
68
+ - `agents/` — 21 definições de agentes em JSON (fonte da verdade para os comandos) com `chains` compostas e Agent Genome (13 campos)
66
69
  - `skills/` — 212 skills em `skills/<name>/SKILL.md` (+ `references.md` opcional), incluindo `design-directions` (Style Selector por indústria), `ui-ux-pro-max` (design system com motor BM25 offline em Node) e `anti-ai-slop` (auditoria zero "cara de IA")
67
70
  - `references/` — curadoria de referências reais por domínio (webgl-3d, scrollytelling, ui-design-systems, stack-2026, performance-seo)
68
71
  - `.agents/memoria/` — memória persistente anti-repetição: `contexto.md`, `decisoes.md`, `erros-corrigidos.md`, `learnings.md`
package/README.md CHANGED
@@ -1,6 +1,6 @@
1
1
  # Izanagi AI
2
2
 
3
- Framework **meta** modular e skill-oriented para engenharia de software autônoma orientada a agentes: routing → orquestração → avaliação → healing → memória, com 18 agentes especializados, 212 skills e uma CLI executável publicada no npm (`izanagi-ai`).
3
+ Framework **meta** — **Adaptive Agent & Skill Runtime** — para engenharia de software autônoma orientada a agentes: routing → orquestração → avaliação → healing → memória, com 21 agentes especializados, 212 skills, execution graph, evaluation engine, self-healing e CLI executável publicada no npm (`izanagi-ai`).
4
4
 
5
5
  > **Filosofia:** Arquitetura primeiro. Código depois. Qualidade medida. Evolução contínua. Zero "cara de IA".
6
6
 
@@ -61,7 +61,7 @@ izanagi-ai/
61
61
  ├── bin/ Executável da CLI (bin/izanagi.js → dist/cli)
62
62
  ├── src/ Runtime real em TypeScript (orchestrator, evaluation, resolver, scanner, factories, tools, tracer, llm, cli)
63
63
  ├── core/ Engines (.md) + skill-resolver.json (aliases → targets + compositions)
64
- ├── agents/ 18 definições de agentes em JSON (fonte da verdade dos comandos)
64
+ ├── agents/ 21 definições de agentes em JSON (fonte da verdade dos comandos)
65
65
  ├── skills/ 212 skills em skills/<name>/SKILL.md (+ references.md opcional)
66
66
  ├── references/ Curadoria de referências reais por domínio (webgl-3d, scrollytelling, stack-2026...)
67
67
  ├── .agents/memoria/ Memória persistente anti-repetição (contexto, decisoes, erros-corrigidos, learnings)
@@ -75,7 +75,7 @@ izanagi-ai/
75
75
 
76
76
  ## Agentes e Skills
77
77
 
78
- O framework possui **18 agentes especializados** (`/discovery`, `/architect`, `/senior-engineer`, `/techlead`, `/automation-engineer`, `/security`, `/devops`, `/database`, `/qa`, `/bug-hunter`, `/docs`, `/pm`, `/professor`, `/researcher`, `/evaluator`, `/adversarial-critic`, `/form-engineer`, `/animation`) e **212 skills** encadeadas por domínio via `compositions` do `core/skill-resolver.json` (248 aliases, 15 composições). Ver `AGENTS.md` para a tabela completa.
78
+ O framework possui **21 agentes especializados** (`/discovery`, `/product-reasoner`, `/architect`, `/senior-engineer`, `/techlead`, `/automation-engineer`, `/security`, `/devops`, `/database`, `/qa`, `/bug-hunter`, `/docs`, `/pm`, `/professor`, `/researcher`, `/evaluator`, `/adversarial-critic`, `/form-engineer`, `/animation`, `/agent-architect`, `/skill-architect`) e **212 skills** encadeadas por domínio via `compositions` do `core/skill-resolver.json` (248 aliases, 15 composições). Ver `AGENTS.md` para a tabela completa.
79
79
 
80
80
  ---
81
81
 
@@ -85,7 +85,7 @@ O framework possui **18 agentes especializados** (`/discovery`, `/architect`, `/
85
85
  npm install # instala dependências
86
86
  npm run build # tsc && regenera .manifest
87
87
  npm run doctor # auditoria de integridade
88
- node --test dist/runtime/tests/*.test.js # 136 testes do runtime
88
+ node --test dist/runtime/tests/*.test.js # 152 testes do runtime
89
89
  npm run verify # build + teste de instalação em sandbox
90
90
  ```
91
91
 
package/ROADMAP.md CHANGED
@@ -1,131 +1,77 @@
1
1
  # Roadmap
2
2
 
3
- > Vision and planned evolution for the Izanagi AI framework.
3
+ > Estado atual e evolução planejada do **Izanagi AI — Adaptive Agent & Skill Runtime**.
4
+ > Legenda: ✅ Done · 🔧 In progress · 📋 Planned · 💡 Future idea
4
5
 
5
6
  ---
6
7
 
7
- ## Legend
8
-
9
- | Status | Meaning |
10
- |--------|---------|
11
- | ✅ | Done |
12
- | 🔧 | In progress |
13
- | 📋 | Planned |
14
- | 💡 | Future idea |
15
-
16
- ---
17
-
18
- ## Phase 1 — Foundation (v1.0.0) ✅
19
-
20
- - [x] SYSTEM.md — Core identity and architecture
21
- - [x] RULES.md — Operating rules and conventions
22
- - [x] README.md — Entry point and quick start
23
- - [x] Decision Engine — Task classification and routing
24
- - [x] Context Engine — Minimal context window builder
25
- - [x] Token Manager — Budget enforcement and monitoring
26
- - [x] Compression Engine — 4-level text compression
27
- - [x] Reflection Engine — Post-task self-review
28
- - [x] Evolution Engine — Self-improvement from patterns
29
- - [x] Quality Gates — 5-gate output validation
30
- - [x] Planning Engine — Task decomposition and effort estimation
31
- - [x] Memory Manager — 3-tier memory with knowledge graph
32
- - [x] Professor Mode — Adaptive teaching skill
33
- - [x] Security Engineer — OWASP + secrets detection
34
- - [x] Software Architect — Architecture decision skill
35
-
36
- ---
37
-
38
- ## Phase 2 — Coding & Database & DevOps (v1.0.0) ✅
39
-
40
- ### Backend
41
- - [x] Backend Engineer (Laravel, Node, Python, C#)
42
- - [x] API Designer — REST, GraphQL, versioning
43
- - [x] Microservices Expert — patterns, communication, deployment
44
-
45
- ### Frontend
46
- - [x] Frontend Engineer (React, Vue, Tailwind)
47
- - [x] UX Reviewer — usability heuristics
48
- - [x] Accessibility Reviewer — WCAG compliance
49
-
50
- ### Database
51
- - [x] Database Engineer — schema design, migrations
52
- - [x] SQL Optimizer — query analysis, indexing
53
- - [x] PostgreSQL Specialist — advanced features
54
-
55
- ### DevOps
56
- - [x] DevOps Engineer — infrastructure, deployment
57
- - [x] Docker Expert — containers, compose, multi-stage
58
- - [x] CI/CD Specialist — pipelines, automation
59
- - [x] Cloud Architect (skills/cloud-architect)
60
-
61
- ---
62
-
63
- ## Phase 3 — Quality & Testing (v1.0.0) ✅
64
-
65
- - [x] Unit Test Engineer — TDD, coverage, mocking
66
- - [x] Integration Test Engineer — API, database, external services
67
- - [x] E2E Test Engineer — Cypress, Playwright
68
- - [x] Clean Code Validator — naming, functions, comments
69
- - [x] SOLID Validator — LSP, ISP, DIP checks
70
- - [x] Complexity Analyzer — cyclomatic, cognitive complexity
71
- - [x] Refactoring Specialist — patterns, migration, risk
72
- - [x] Technical Debt Analyzer — debt estimation, prioritization
8
+ ## Fase 1 — Foundation (v1.x) ✅
9
+
10
+ - [x] SYSTEM.md / RULES.md / README / AGENTS.md — identidade e operação
11
+ - [x] Decision Engine — classificação e roteamento de tarefas
12
+ - [x] Context Engine + Compression Engine — contexto enxuto e compactação
13
+ - [x] Token Manager — orçamento e monitoramento
14
+ - [x] Reflection Engine + Evolution Engine — autoavaliação pós-tarefa
15
+ - [x] Quality Gates — portões de validação de output
16
+ - [x] Planning Engine — decomposição e estimativa
17
+ - [x] Memory Manager — memória persistente 3 níveis + knowledge graph
18
+
19
+ ## Fase 2 — Engine Layer (v2.0 → v2.8) ✅
20
+
21
+ - [x] 15 → 18 agentes especializados, cada um com chains compostas
22
+ - [x] Biblioteca de skills modulares (212) + Skill Composer
23
+ - [x] CLI executável publicado no npm (`izanagi-ai`) com `izanagi init/run/compile/chat/doctor`
24
+ - [x] Packs selecionáveis + export multi-CLI (claude, codex, cursor, copilot, kimi)
25
+ - [x] Multi-Agent Swarm Mode (execução paralela concorrente)
26
+ - [x] Memória persistente `.agents/memoria/` (contexto, decisões, erros, aprendizados)
27
+ - [x] Referências curadas por domínio (`references/`)
28
+ - [x] Blueprint Engine — gate de manifest de arquivos, zero stubs
29
+ - [x] Anti-AI-Slop, design-directions (Style Selector) e ui-ux-pro-max (BM25 offline)
30
+
31
+ ## Fase 3 — Adaptive Runtime (v2.9 → v2.10) ✅
32
+
33
+ - [x] **Evaluation Engine** (`core/evaluation/` → `src/runtime/evaluation/`) — vereditos PASS / PASS_WITH_WARNINGS / FAIL / BLOCKED / UNKNOWN, métricas ponderadas (correctness, security, architecture, performance, maintainability, artifact validity), confiança e regressões
34
+ - [x] **Execution Graph** (`src/runtime/orchestration/`) — grafo por tarefa com nós, dependências, condições, retry policy, timeout, token budget e validador; batches paralelos detectados; templates por categoria sem grafo gigante universal
35
+ - [x] **Adaptive Routing / Scoring** (`src/runtime/routing/`) — ranking de agentes e skills por relevância semântica + histórico + compatibilidade + custo + risco
36
+ - [x] **Agent Genome** — 13 campos formais nos 21 agentes (purpose, capabilities, requiredSkills, optionalSkills, inputs, outputs, constraints, permissions, handoffs, memory, evaluation, tokenBudget, compatibility)
37
+ - [x] **Skill Manifest** — frontmatter padronizado nas skills (name, version, triggers, dependencies, risk, tokenBudget...) + `izanagi skill inspect/search`
38
+ - [x] **Agent Factory & Skill Factory** (`src/runtime/factories/`) — geração de agentes e skills por lacuna real, com validação antes do registro
39
+ - [x] **Failure Memory** (`src/runtime/memory/`) — 7 categorias (episodic, semantic, procedural, decision, failure, skill, project); padrões de falha reutilizáveis buscados antes da execução
40
+ - [x] **Self-Healing** (`src/runtime/recovery/`) — classificação de falha (recoverable/non-recoverable/planning/tool/agent/validation/dependency) → local repair | replan | handoff | skill replacement | abort; limites maxAttempts/maxTokens/maxTime
41
+ - [x] **Contracts & Artifacts** (`src/runtime/contracts/`) — schemas programáticos (requirements, architecture, database-schema, api-contract, security-report, test-plan, implementation-plan, evaluation) com validação INVALID → REPAIR → RE-EVALUATE
42
+ - [x] **Adversarial Critic** — 18º/19º agente: caça bugs, segurança, architecture flaws, AI slop
43
+ - [x] **Model Router** (`src/runtime/model/`) — ModelProvider / ModelAdapter / ModelRouter por complexidade, risco, custo, latência e contexto
44
+ - [x] **Tracing / Observability** (`src/runtime/observability/`) — spans por decisão/agente/skill/tool/model + `izanagi trace` e `izanagi trace <run-id>`
45
+ - [x] **Tools Registry (MCP-ready)** (`src/runtime/tools/`) — discover → permission → compatibility → select → execute → validate, least privilege, path traversal bloqueado
46
+ - [x] **Skill Security Scanner** (`src/runtime/security/`) — prompt injection, instruções perigosas, scripts, permissões, requisitos de rede/fs; LOW/MEDIUM/HIGH/CRITICAL
47
+ - [x] **Benchmarks** (`benchmarks/` + `src/runtime/benchmarks/`) — 10 domínios, validators, expectativas de artefatos, `izanagi benchmark run/list/compare` com relatório comparável entre versões
48
+ - [x] **CLI runtime** — `izanagi agent list|inspect`, `skill list|search|inspect|create`, `workflow list|inspect`, `run`, `trace`, `eval`, `benchmark`, `memory inspect|search`, `doctor --deep`, `diagnose`
49
+ - [x] **Docotr expandido** — valida system/agents/skills/resolver/memória/providers/tools/contratos/avaliação/benchmarks
50
+ - [x] Testes node:test cobrindo resolver, scoring, contracts, evaluation, graph, parallel, retry, healing, memory, handoff, factories, model routing, CLI, tracer, scanner, tools, benchmarks, orchestrator
51
+
52
+ ## Fase 4 — Evolução v2.11 (🔧 / 📋)
53
+
54
+ - [x] **Evidence System** (`src/runtime/research/`) — claims FACT / ASSUMPTION / INFERENCE / UNKNOWN com source, confidence, sourceType hierarquizado (official docs > source code > tests > package metadata > reliable tech > community) e relatório de claims críticas
55
+ - [x] **Token Budget 2.0** (`src/runtime/token/`) — orçamento por fase (planning / execution / evaluation / recovery) com tetos e abort de fase; distribuído automaticamente por complexidade e tier de modelo
56
+ - [x] **Product Reasoner** — Understanding: intenção vaga → requisitos com evidências e critérios BDD (entrada do ciclo)
57
+ - [x] **Agent Architect** — projeto de novos agentes (Genome + guardrails + avaliação) por lacuna real
58
+ - [x] **Skill Architect** — curadoria de skills com security scan e anti-duplicação por lacuna comprovada
59
+ - [x] **Benchmarks externos** — `benchmarks/*.json` carregados pelo registry sem duplicar IDs embutidos
60
+ - [ ] **Plugin System** — skills de terceiros com sandbox e cadeia de confiança (usa o security scanner como porta de entrada) 📋
61
+ - [ ] **Skill Marketplace** — compartilhar e instalar skills 📋
62
+ - [ ] **Izanagi API** — interface REST para interrogção do framework 💡
63
+ - [ ] **Web UI** — editor visual de skills e monitor de execuções 📋
64
+ - [ ] **Analytics Dashboard** — token usage, custo e evolução por execução 📋
73
65
 
74
66
  ---
75
67
 
76
- ## Phase 4 — Advanced Skills (v1.0.0) ✅
77
-
78
- - [x] Senior Code Reviewer — PR review with depth
79
- - [x] Bug Hunter — systematic debugging protocol
80
- - [x] Root Cause Analyzer — 5 Whys, fishbone
81
- - [x] Performance Optimizer — profiling, caching, N+1
82
- - [x] Dependency Analyzer — version conflicts, security, updates
83
- - [x] Risk Analyzer — probability × impact matrix
84
- - [x] Breaking Change Detector — semver validation
85
- - [x] Release Planner — changelog, version bump, tags
86
-
87
- ---
88
-
89
- ## Phase 5 — Intelligence (v1.0.0) ✅
90
-
91
- - [ ] Knowledge Graph Auto-Builder — extract entities from conversations
92
- - [x] Hallucination Detector — confidence scoring for statements
93
- - [x] Confidence Estimator — know when to say "I'm not sure"
94
- - [x] Alternative Solution Generator — always offer 2+ approaches
95
- - [x] Trade-off Analyzer — structured comparison with criteria
96
- - [x] Self-Correction Engine — detect error in own output, fix, log
97
- - [x] Conversation Summarizer — compress entire session to 200 tokens
98
- - [x] Context Recovery — resume after session break
99
-
100
- ---
101
-
102
- ## Phase 6 — Autonomy & Consolidation (v2.0.0) ✅
103
-
104
- - [x] Project Manager — track milestones, deadlines, progress
105
- - [x] Task Planner — break epics into sprints
106
- - [x] Requirement Analyzer — extract requirements from natural language
107
- - [ ] Stakeholder Identifier — who cares about this decision?
108
- - [x] Cost Optimizer — cloud cost estimation and reduction
109
- - [x] Documentation Writer — auto-document codebase
110
- - [ ] UML Diagram Generator — PlantUML from architecture (exists as skill)
111
- - [x] README Generator — project README from structure
112
-
113
- ---
114
-
115
- ## Phase 7 — Ecosystem (v2.0.0 / v3.0.0) 💡
116
-
117
- - [ ] Plugin System — third-party skills
118
- - [ ] Skill Marketplace — share and install skills
119
- - [ ] Izanagi CLI — command-line tool to manage skills
120
- - [ ] Izanagi API — REST API for framework interrogation
121
- - [ ] Multi-Agent Coordination — multiple Izanagi agents collaborating
122
- - [ ] Web UI — visual skill editor and monitor
123
- - [ ] Analytics Dashboard — token usage, evolution, cost
124
-
125
- ---
68
+ ## Critérios de aceite das próximas fases
126
69
 
127
- ## Current Focus
70
+ Toda mudança no framework deve provar impacto em pelo menos uma dimensão:
128
71
 
129
- **v2.0.0** — Consolidation, plugin system, and CLI tooling to make Izanagi AI extensible and operable outside of conversation.
72
+ ```
73
+ reliability · adaptability · correctness · observability
74
+ token waste reduction · recovery · extensibility · developer experience
75
+ ```
130
76
 
131
- > "Rome wasn't built in a day. Neither is a great agent framework."
77
+ E deve passar o quality bar completo: `build` → `test` → `doctor --deep` → `benchmark run` → documentação.
package/SYSTEM.md CHANGED
@@ -77,8 +77,8 @@ User Input / Comando CLI
77
77
  | **Artifact Contracts** (`contracts/artifacts.ts`) | 10+ schemas de artefato (requirements, architecture, database-schema, test-plan...) com validação por campos obrigatórios + tamanho mínimo, em PT-BR. |
78
78
  | **Skill Resolver** (`routing/resolver.ts`) | Alias → target (248), parse de frontmatter, scoring por relevância + histórico; `loadAgent` cobre `agents/` + `agents/generated/`. |
79
79
  | **Skill Scanner** (`security/skill-scanner.ts`) | 11 regras de segurança sobre skills (INJ, DNG, SCR, PER, NET, SEC) com severidade, allowlist e `DEFENSIVE_CONTEXT` (ignora exemplos defensivos/educativos). |
80
- | **Agent Genome** (`agents/*.json`) | 13 campos formais por agente (purpose, capabilities, requiredSkills, optionalSkills, inputs, outputs, constraints, permissions, handoffs, memory, evaluation, tokenBudget, compatibility) — preenchidos nos 18 agentes core. |
81
- | **Agent Factory** (`factories/agent-factory.ts`) | Gera novos agentes com genome a partir de requisito: detecção de lacuna vs. 18 core, ID slug, skills requeridas/opcionais, validação e escrita em `agents/generated/`. |
80
+ | **Agent Genome** (`agents/*.json`) | 13 campos formais por agente (purpose, capabilities, requiredSkills, optionalSkills, inputs, outputs, constraints, permissions, handoffs, memory, evaluation, tokenBudget, compatibility) — preenchidos nos 21 agentes core. |
81
+ | **Agent Factory** (`factories/agent-factory.ts`) | Gera novos agentes com genome a partir de requisito: detecção de lacuna vs. 21 core, ID slug, skills requeridas/opcionais, validação e escrita em `agents/generated/`. |
82
82
  | **Skill Factory** (`factories/skill-factory.ts`) | Cria skills novas com frontmatter, security scan pré-escrita, recusa de lacuna já coberta e escrita em `skills/generated/<name>/SKILL.md`. |
83
83
  | **Tool Registry** (`tools/registry.ts`) | Tools builtin (fs.read, fs.write, fs.ls) com sandbox de zona (anti path-traversal), permissões least-privilege e fluxo discover → permission → validate → execute. |
84
84
  | **Model Router** (`routing/model-router.ts`) | Seleção de modelo (claude/gpt/opus...) por custo/latência/contexto com fallback e override por env. |
@@ -88,6 +88,8 @@ User Input / Comando CLI
88
88
  | **Trace Store** (`observability/tracer.ts`) | Traces de execução em JSONL com spans, load/close e retry de escrita. |
89
89
  | **Benchmarks** (`benchmarks/`) | 10 casos builtin (parse, scoring, scanner, genome, composer...) executáveis via `izanagi benchmark` + `compare` entre builds. |
90
90
  | **LLM Executor** (`llm/`) | Adapters reais OpenAI/Anthropic/OpenRouter com env key, timeout e propagação de erro HTTP. |
91
+ | **Evidence System** (`research/evidence.ts`) | Claims FACT/ASSUMPTION/INFERENCE/UNKNOWN com fonte, confiança e hierarquia de sourceType (official docs > source code > tests > package metadata > reliable tech > community); relatório de claims críticas. |
92
+ | **Token Budget 2.0** (`token/budget.ts`) | Orçamento por fase (planning/execution/evaluation/recovery) com tetos, pesos por complexidade e abort de fase — retry consome a fase recovery, nunca o execution. |
91
93
  | **CLI** (`src/cli/`) | Entrypoint `bin/izanagi.js` → `runCLI` (doctor --deep, audit, resolve, export, init, agent create, skill create --gap, workflow, trace, eval, benchmark, memory, diagnose...). |
92
94
 
93
95
  ## Routing — Classificação por Categoria
@@ -119,6 +121,7 @@ Todo output passa por gates reais antes de ser considerado entregue:
119
121
  1. ✅ **Security Gate** — sem segredos no código; `skill-scanner` varre skills por injeção, comandos destrutivos, exfiltração e hardcode (11 regras), ignorando contexto defensivo/educativo.
120
122
  2. ✅ **Validation Gate** — artefatos validados contra schema (campos obrigatórios + tamanho mínimo); inválido → healing `skill_replacement`.
121
123
  3. ✅ **Evaluation Gate** — métricas ponderadas + veredito (PASS / PASS_WITH_WARNINGS / FAIL / BLOCKED / **UNKNOWN** quando faltam evidências mensuradas) com recomendações.
124
+ 4. ✅ **Token Phase Gate** — orçamento por fase (planning/execution/evaluation/recovery): retries consomem a fase recovery e estourar uma fase aborta o ciclo (Token Budget 2.0).
122
125
  4. ✅ **Style Gate** — segue `RULES.md`: anti-"cara de IA", design directions, high-craft.
123
126
  5. ✅ **Clarity & Conciseness Gate** — sem fluff; cada frase agrega valor.
124
127
  6. ✅ **Completeness Gate** — responde a pergunta, sem pontas soltas (Lei da Entrega Exaustiva).
@@ -159,7 +162,7 @@ Melhoria contínua acontece por: healing registrado (retry/replacement/abort), s
159
162
 
160
163
  O ciclo completo de execução — `Task → Understanding → Planning → Execution Graph → Evaluation → Self-Healing → Reflection → Memory → Evolution` — é suportado por módulos reais:
161
164
 
162
- 1. **Understanding & Planning** — `requirements` decomposição de requisitos (artefatos em `contracts/artifacts.ts`), classificação da tarefa em categoria.
165
+ 1. **Understanding & Planning** — `requirements` decomposição de requisitos (artefatos em `contracts/artifacts.ts`), classificação da tarefa em categoria; Product Reasoner rotula claims de produto (FACT/ASSUMPTION/UNKNOWN) com confiança via Evidence System.
163
166
  2. **Execution Graph** — o Orchestrator monta um grafo por categoria (11 templates: implementation, testing, debugging, database_design...) com `parallelBatches` (nós independentes em paralelo, nós dependentes em sequência) e hooks de execução (`produce`: agêntico / LLM / comando).
164
167
  3. **Adaptive Routing** — o resolver pontua skills por relevância + histórico de uso por categoria (scorer com decaimento temporal), nunca lista estática; agents são resolvidos pelo mesmo scoring.
165
168
  4. **Evaluation** — métricas ponderadas (correctness, completeness, security, performance, requirementCoverage) com thresholds e veredito derivado; sem métricas mensuradas → **UNKNOWN** com recomendação explícita de evidência.
@@ -170,7 +173,7 @@ O ciclo completo de execução — `Task → Understanding → Planning → Exec
170
173
 
171
174
  Novos agentes e skills são **gerados, não escritos à mão**:
172
175
 
173
- - `izanagi agent create "<requisito>" [--name=slug] [--skills=a,b]` — o Agent Factory detecta lacuna vs. os 18 agentes core (recusa se o core já cobre), deriva ID slug, mapeia skills requeridas/opcionais, monta o genome completo (purpose, capabilities, inputs, outputs, handoffs, memory, evaluation, tokenBudget, compatibility), valida e escreve em `agents/generated/<id>.json` — descoberto automaticamente por `loadAgent`/`agent list`.
176
+ - `izanagi agent create "<requisito>" [--name=slug] [--skills=a,b]` — o Agent Factory detecta lacuna vs. os 21 agentes core (recusa se o core já cobre), deriva ID slug, mapeia skills requeridas/opcionais, monta o genome completo (purpose, capabilities, inputs, outputs, handoffs, memory, evaluation, tokenBudget, compatibility), valida e escreve em `agents/generated/<id>.json` — descoberto automaticamente por `loadAgent`/`agent list`.
174
177
  - `izanagi skill create <nome> --gap="<descrição>" [--force]` — o Skill Factory recusa lacunas já cobertas, gera `skills/generated/<nome>/SKILL.md` com frontmatter de manifesto (name, description, version, compatibility, triggers, token_budget), roda o security scanner antes da escrita e só persiste com severidade LOW.
175
178
 
176
179
  ## Benchmarks & Regression