@claude-flow/cli 3.28.0 → 3.29.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (454) hide show
  1. package/.claude/agents/analysis/analyze-code-quality.md +178 -178
  2. package/.claude/agents/analysis/code-analyzer.md +209 -209
  3. package/.claude/agents/analysis/code-review/analyze-code-quality.md +178 -178
  4. package/.claude/agents/architecture/arch-system-design.md +156 -156
  5. package/.claude/agents/architecture/system-design/arch-system-design.md +154 -154
  6. package/.claude/agents/browser/browser-agent.yaml +182 -182
  7. package/.claude/agents/consensus/byzantine-coordinator.md +62 -62
  8. package/.claude/agents/consensus/crdt-synchronizer.md +996 -996
  9. package/.claude/agents/consensus/gossip-coordinator.md +62 -62
  10. package/.claude/agents/consensus/performance-benchmarker.md +850 -850
  11. package/.claude/agents/consensus/quorum-manager.md +822 -822
  12. package/.claude/agents/consensus/raft-manager.md +62 -62
  13. package/.claude/agents/consensus/security-manager.md +621 -621
  14. package/.claude/agents/core/planner.md +374 -374
  15. package/.claude/agents/custom/test-long-runner.md +44 -44
  16. package/.claude/agents/data/data-ml-model.md +444 -444
  17. package/.claude/agents/data/ml/data-ml-model.md +192 -192
  18. package/.claude/agents/development/backend/dev-backend-api.md +141 -141
  19. package/.claude/agents/development/dev-backend-api.md +344 -344
  20. package/.claude/agents/devops/ci-cd/ops-cicd-github.md +163 -163
  21. package/.claude/agents/devops/ops-cicd-github.md +164 -164
  22. package/.claude/agents/documentation/api-docs/docs-api-openapi.md +173 -173
  23. package/.claude/agents/documentation/docs-api-openapi.md +354 -354
  24. package/.claude/agents/flow-nexus/app-store.md +87 -87
  25. package/.claude/agents/flow-nexus/authentication.md +68 -68
  26. package/.claude/agents/flow-nexus/challenges.md +80 -80
  27. package/.claude/agents/flow-nexus/neural-network.md +87 -87
  28. package/.claude/agents/flow-nexus/payments.md +82 -82
  29. package/.claude/agents/flow-nexus/sandbox.md +75 -75
  30. package/.claude/agents/flow-nexus/swarm.md +75 -75
  31. package/.claude/agents/flow-nexus/user-tools.md +95 -95
  32. package/.claude/agents/flow-nexus/workflow.md +83 -83
  33. package/.claude/agents/github/code-review-swarm.md +377 -377
  34. package/.claude/agents/github/github-modes.md +172 -172
  35. package/.claude/agents/github/issue-tracker.md +575 -575
  36. package/.claude/agents/github/multi-repo-swarm.md +552 -552
  37. package/.claude/agents/github/pr-manager.md +437 -437
  38. package/.claude/agents/github/project-board-sync.md +508 -508
  39. package/.claude/agents/github/release-manager.md +604 -604
  40. package/.claude/agents/github/release-swarm.md +582 -582
  41. package/.claude/agents/github/repo-architect.md +397 -397
  42. package/.claude/agents/github/swarm-issue.md +572 -572
  43. package/.claude/agents/github/swarm-pr.md +427 -427
  44. package/.claude/agents/github/sync-coordinator.md +451 -451
  45. package/.claude/agents/github/workflow-automation.md +902 -902
  46. package/.claude/agents/goal/agent.md +815 -815
  47. package/.claude/agents/optimization/benchmark-suite.md +664 -664
  48. package/.claude/agents/optimization/load-balancer.md +430 -430
  49. package/.claude/agents/optimization/performance-monitor.md +671 -671
  50. package/.claude/agents/optimization/resource-allocator.md +673 -673
  51. package/.claude/agents/optimization/topology-optimizer.md +807 -807
  52. package/.claude/agents/payments/agentic-payments.md +126 -126
  53. package/.claude/agents/sona/sona-learning-optimizer.md +74 -74
  54. package/.claude/agents/sparc/architecture.md +698 -698
  55. package/.claude/agents/sparc/pseudocode.md +519 -519
  56. package/.claude/agents/sparc/refinement.md +801 -801
  57. package/.claude/agents/sparc/specification.md +477 -477
  58. package/.claude/agents/specialized/mobile/spec-mobile-react-native.md +224 -224
  59. package/.claude/agents/specialized/spec-mobile-react-native.md +226 -226
  60. package/.claude/agents/sublinear/consensus-coordinator.md +337 -337
  61. package/.claude/agents/sublinear/matrix-optimizer.md +184 -184
  62. package/.claude/agents/sublinear/pagerank-analyzer.md +298 -298
  63. package/.claude/agents/sublinear/performance-optimizer.md +367 -367
  64. package/.claude/agents/sublinear/trading-predictor.md +245 -245
  65. package/.claude/agents/swarm/adaptive-coordinator.md +1126 -1126
  66. package/.claude/agents/swarm/hierarchical-coordinator.md +709 -709
  67. package/.claude/agents/swarm/mesh-coordinator.md +962 -962
  68. package/.claude/agents/templates/automation-smart-agent.md +204 -204
  69. package/.claude/agents/templates/base-template-generator.md +289 -289
  70. package/.claude/agents/templates/coordinator-swarm-init.md +89 -89
  71. package/.claude/agents/templates/github-pr-manager.md +176 -176
  72. package/.claude/agents/templates/implementer-sparc-coder.md +258 -258
  73. package/.claude/agents/templates/memory-coordinator.md +186 -186
  74. package/.claude/agents/templates/orchestrator-task.md +138 -138
  75. package/.claude/agents/templates/performance-analyzer.md +198 -198
  76. package/.claude/agents/templates/sparc-coordinator.md +513 -513
  77. package/.claude/agents/testing/production-validator.md +394 -394
  78. package/.claude/agents/testing/tdd-london-swarm.md +243 -243
  79. package/.claude/agents/v3/aidefence-guardian.md +282 -282
  80. package/.claude/agents/v3/claims-authorizer.md +208 -208
  81. package/.claude/agents/v3/collective-intelligence-coordinator.md +993 -993
  82. package/.claude/agents/v3/ddd-domain-expert.md +220 -220
  83. package/.claude/agents/v3/injection-analyst.md +236 -236
  84. package/.claude/agents/v3/performance-engineer.md +1233 -1233
  85. package/.claude/agents/v3/pii-detector.md +151 -151
  86. package/.claude/agents/v3/reasoningbank-learner.md +213 -213
  87. package/.claude/agents/v3/security-architect-aidefence.md +410 -410
  88. package/.claude/agents/v3/security-architect.md +867 -867
  89. package/.claude/agents/v3/swarm-memory-manager.md +157 -157
  90. package/.claude/agents/v3/v3-integration-architect.md +205 -205
  91. package/.claude/commands/agents/README.md +50 -50
  92. package/.claude/commands/agents/agent-capabilities.md +140 -140
  93. package/.claude/commands/agents/agent-coordination.md +28 -28
  94. package/.claude/commands/agents/agent-spawning.md +28 -28
  95. package/.claude/commands/agents/agent-types.md +216 -216
  96. package/.claude/commands/agents/health.md +139 -139
  97. package/.claude/commands/agents/list.md +100 -100
  98. package/.claude/commands/agents/logs.md +130 -130
  99. package/.claude/commands/agents/metrics.md +122 -122
  100. package/.claude/commands/agents/pool.md +127 -127
  101. package/.claude/commands/agents/spawn.md +140 -140
  102. package/.claude/commands/agents/status.md +115 -115
  103. package/.claude/commands/agents/stop.md +102 -102
  104. package/.claude/commands/analysis/COMMAND_COMPLIANCE_REPORT.md +53 -53
  105. package/.claude/commands/analysis/README.md +9 -9
  106. package/.claude/commands/analysis/bottleneck-detect.md +162 -162
  107. package/.claude/commands/analysis/performance-bottlenecks.md +58 -58
  108. package/.claude/commands/analysis/performance-report.md +25 -25
  109. package/.claude/commands/analysis/token-efficiency.md +44 -44
  110. package/.claude/commands/analysis/token-usage.md +25 -25
  111. package/.claude/commands/automation/README.md +9 -9
  112. package/.claude/commands/automation/auto-agent.md +122 -122
  113. package/.claude/commands/automation/self-healing.md +105 -105
  114. package/.claude/commands/automation/session-memory.md +89 -89
  115. package/.claude/commands/automation/smart-agents.md +72 -72
  116. package/.claude/commands/automation/smart-spawn.md +25 -25
  117. package/.claude/commands/automation/workflow-select.md +25 -25
  118. package/.claude/commands/claude-flow-help.md +103 -103
  119. package/.claude/commands/claude-flow-memory.md +107 -107
  120. package/.claude/commands/claude-flow-swarm.md +205 -205
  121. package/.claude/commands/coordination/README.md +9 -9
  122. package/.claude/commands/coordination/agent-spawn.md +25 -25
  123. package/.claude/commands/coordination/init.md +44 -44
  124. package/.claude/commands/coordination/orchestrate.md +43 -43
  125. package/.claude/commands/coordination/spawn.md +45 -45
  126. package/.claude/commands/coordination/swarm-init.md +85 -85
  127. package/.claude/commands/coordination/task-orchestrate.md +25 -25
  128. package/.claude/commands/github/README.md +11 -11
  129. package/.claude/commands/github/code-review-swarm.md +513 -513
  130. package/.claude/commands/github/code-review.md +25 -25
  131. package/.claude/commands/github/github-modes.md +146 -146
  132. package/.claude/commands/github/github-swarm.md +121 -121
  133. package/.claude/commands/github/issue-tracker.md +291 -291
  134. package/.claude/commands/github/issue-triage.md +25 -25
  135. package/.claude/commands/github/multi-repo-swarm.md +518 -518
  136. package/.claude/commands/github/pr-enhance.md +26 -26
  137. package/.claude/commands/github/pr-manager.md +169 -169
  138. package/.claude/commands/github/project-board-sync.md +470 -470
  139. package/.claude/commands/github/release-manager.md +339 -339
  140. package/.claude/commands/github/release-swarm.md +543 -543
  141. package/.claude/commands/github/repo-analyze.md +25 -25
  142. package/.claude/commands/github/repo-architect.md +366 -366
  143. package/.claude/commands/github/swarm-issue.md +484 -484
  144. package/.claude/commands/github/swarm-pr.md +287 -287
  145. package/.claude/commands/github/sync-coordinator.md +302 -302
  146. package/.claude/commands/github/workflow-automation.md +441 -441
  147. package/.claude/commands/hive-mind/README.md +17 -17
  148. package/.claude/commands/hive-mind/hive-mind-consensus.md +8 -8
  149. package/.claude/commands/hive-mind/hive-mind-init.md +18 -18
  150. package/.claude/commands/hive-mind/hive-mind-memory.md +8 -8
  151. package/.claude/commands/hive-mind/hive-mind-metrics.md +8 -8
  152. package/.claude/commands/hive-mind/hive-mind-resume.md +8 -8
  153. package/.claude/commands/hive-mind/hive-mind-sessions.md +8 -8
  154. package/.claude/commands/hive-mind/hive-mind-spawn.md +21 -21
  155. package/.claude/commands/hive-mind/hive-mind-status.md +8 -8
  156. package/.claude/commands/hive-mind/hive-mind-stop.md +8 -8
  157. package/.claude/commands/hive-mind/hive-mind-wizard.md +8 -8
  158. package/.claude/commands/hive-mind/hive-mind.md +27 -27
  159. package/.claude/commands/hooks/README.md +11 -11
  160. package/.claude/commands/hooks/overview.md +57 -57
  161. package/.claude/commands/hooks/post-edit.md +117 -117
  162. package/.claude/commands/hooks/post-task.md +112 -112
  163. package/.claude/commands/hooks/pre-edit.md +113 -113
  164. package/.claude/commands/hooks/pre-task.md +111 -111
  165. package/.claude/commands/hooks/session-end.md +118 -118
  166. package/.claude/commands/hooks/setup.md +102 -102
  167. package/.claude/commands/memory/README.md +9 -9
  168. package/.claude/commands/memory/memory-persist.md +25 -25
  169. package/.claude/commands/memory/memory-search.md +25 -25
  170. package/.claude/commands/memory/memory-usage.md +25 -25
  171. package/.claude/commands/memory/neural.md +47 -47
  172. package/.claude/commands/monitoring/README.md +9 -9
  173. package/.claude/commands/monitoring/agent-metrics.md +25 -25
  174. package/.claude/commands/monitoring/agents.md +44 -44
  175. package/.claude/commands/monitoring/real-time-view.md +25 -25
  176. package/.claude/commands/monitoring/status.md +46 -46
  177. package/.claude/commands/monitoring/swarm-monitor.md +25 -25
  178. package/.claude/commands/optimization/README.md +9 -9
  179. package/.claude/commands/optimization/auto-topology.md +61 -61
  180. package/.claude/commands/optimization/cache-manage.md +25 -25
  181. package/.claude/commands/optimization/parallel-execute.md +25 -25
  182. package/.claude/commands/optimization/parallel-execution.md +49 -49
  183. package/.claude/commands/optimization/topology-optimize.md +25 -25
  184. package/.claude/commands/pair/README.md +260 -260
  185. package/.claude/commands/pair/commands.md +545 -545
  186. package/.claude/commands/pair/config.md +509 -509
  187. package/.claude/commands/pair/examples.md +511 -511
  188. package/.claude/commands/pair/modes.md +347 -347
  189. package/.claude/commands/pair/session.md +406 -406
  190. package/.claude/commands/pair/start.md +208 -208
  191. package/.claude/commands/sparc/analyzer.md +51 -51
  192. package/.claude/commands/sparc/architect.md +53 -53
  193. package/.claude/commands/sparc/ask.md +97 -97
  194. package/.claude/commands/sparc/batch-executor.md +54 -54
  195. package/.claude/commands/sparc/code.md +89 -89
  196. package/.claude/commands/sparc/coder.md +54 -54
  197. package/.claude/commands/sparc/debug.md +83 -83
  198. package/.claude/commands/sparc/debugger.md +54 -54
  199. package/.claude/commands/sparc/designer.md +53 -53
  200. package/.claude/commands/sparc/devops.md +109 -109
  201. package/.claude/commands/sparc/docs-writer.md +80 -80
  202. package/.claude/commands/sparc/documenter.md +54 -54
  203. package/.claude/commands/sparc/innovator.md +54 -54
  204. package/.claude/commands/sparc/integration.md +83 -83
  205. package/.claude/commands/sparc/mcp.md +117 -117
  206. package/.claude/commands/sparc/memory-manager.md +54 -54
  207. package/.claude/commands/sparc/optimizer.md +54 -54
  208. package/.claude/commands/sparc/orchestrator.md +131 -131
  209. package/.claude/commands/sparc/post-deployment-monitoring-mode.md +83 -83
  210. package/.claude/commands/sparc/refinement-optimization-mode.md +83 -83
  211. package/.claude/commands/sparc/researcher.md +54 -54
  212. package/.claude/commands/sparc/reviewer.md +54 -54
  213. package/.claude/commands/sparc/security-review.md +80 -80
  214. package/.claude/commands/sparc/sparc-modes.md +174 -174
  215. package/.claude/commands/sparc/sparc.md +111 -111
  216. package/.claude/commands/sparc/spec-pseudocode.md +80 -80
  217. package/.claude/commands/sparc/supabase-admin.md +348 -348
  218. package/.claude/commands/sparc/swarm-coordinator.md +54 -54
  219. package/.claude/commands/sparc/tdd.md +54 -54
  220. package/.claude/commands/sparc/tester.md +54 -54
  221. package/.claude/commands/sparc/tutorial.md +79 -79
  222. package/.claude/commands/sparc/workflow-manager.md +54 -54
  223. package/.claude/commands/sparc.md +166 -166
  224. package/.claude/commands/stream-chain/pipeline.md +120 -120
  225. package/.claude/commands/stream-chain/run.md +69 -69
  226. package/.claude/commands/swarm/README.md +15 -15
  227. package/.claude/commands/swarm/analysis.md +95 -95
  228. package/.claude/commands/swarm/development.md +96 -96
  229. package/.claude/commands/swarm/examples.md +168 -168
  230. package/.claude/commands/swarm/maintenance.md +102 -102
  231. package/.claude/commands/swarm/optimization.md +117 -117
  232. package/.claude/commands/swarm/research.md +136 -136
  233. package/.claude/commands/swarm/swarm-analysis.md +8 -8
  234. package/.claude/commands/swarm/swarm-background.md +8 -8
  235. package/.claude/commands/swarm/swarm-init.md +19 -19
  236. package/.claude/commands/swarm/swarm-modes.md +8 -8
  237. package/.claude/commands/swarm/swarm-monitor.md +8 -8
  238. package/.claude/commands/swarm/swarm-spawn.md +19 -19
  239. package/.claude/commands/swarm/swarm-status.md +8 -8
  240. package/.claude/commands/swarm/swarm-strategies.md +8 -8
  241. package/.claude/commands/swarm/swarm.md +87 -87
  242. package/.claude/commands/swarm/testing.md +131 -131
  243. package/.claude/commands/training/README.md +9 -9
  244. package/.claude/commands/training/model-update.md +25 -25
  245. package/.claude/commands/training/neural-patterns.md +107 -107
  246. package/.claude/commands/training/neural-train.md +75 -75
  247. package/.claude/commands/training/pattern-learn.md +25 -25
  248. package/.claude/commands/training/specialization.md +62 -62
  249. package/.claude/commands/truth/start.md +142 -142
  250. package/.claude/commands/verify/check.md +49 -49
  251. package/.claude/commands/verify/start.md +127 -127
  252. package/.claude/commands/workflows/README.md +9 -9
  253. package/.claude/commands/workflows/development.md +77 -77
  254. package/.claude/commands/workflows/research.md +62 -62
  255. package/.claude/commands/workflows/workflow-create.md +25 -25
  256. package/.claude/commands/workflows/workflow-execute.md +25 -25
  257. package/.claude/commands/workflows/workflow-export.md +25 -25
  258. package/.claude/eval/human-relevance-frozen-v1.json +17 -17
  259. package/.claude/evolve-proof/generation-0.json +211 -211
  260. package/.claude/evolve-proof/real-generation-0.json +406 -406
  261. package/.claude/evolve-proof/real-generation-1.json +406 -406
  262. package/.claude/helpers/README.md +96 -96
  263. package/.claude/helpers/adr-compliance.sh +186 -186
  264. package/.claude/helpers/auto-commit.sh +178 -178
  265. package/.claude/helpers/auto-memory-hook.mjs +430 -430
  266. package/.claude/helpers/checkpoint-manager.sh +251 -251
  267. package/.claude/helpers/daemon-manager.sh +252 -252
  268. package/.claude/helpers/ddd-tracker.sh +144 -144
  269. package/.claude/helpers/github-safe.js +156 -156
  270. package/.claude/helpers/github-setup.sh +45 -45
  271. package/.claude/helpers/guidance-hook.sh +13 -13
  272. package/.claude/helpers/guidance-hooks.sh +102 -102
  273. package/.claude/helpers/health-monitor.sh +108 -108
  274. package/.claude/helpers/helpers.manifest.json +6 -6
  275. package/.claude/helpers/hook-handler.cjs +460 -460
  276. package/.claude/helpers/intelligence.cjs +1058 -1058
  277. package/.claude/helpers/learning-hooks.sh +329 -329
  278. package/.claude/helpers/learning-optimizer.sh +127 -127
  279. package/.claude/helpers/learning-service.mjs +1144 -1144
  280. package/.claude/helpers/memory.js +83 -83
  281. package/.claude/helpers/metrics-db.mjs +503 -503
  282. package/.claude/helpers/pattern-consolidator.sh +86 -86
  283. package/.claude/helpers/perf-worker.sh +160 -160
  284. package/.claude/helpers/post-commit +16 -16
  285. package/.claude/helpers/pre-commit +26 -26
  286. package/.claude/helpers/quick-start.sh +19 -19
  287. package/.claude/helpers/router.js +105 -105
  288. package/.claude/helpers/security-scanner.sh +127 -127
  289. package/.claude/helpers/session.js +157 -157
  290. package/.claude/helpers/setup-mcp.sh +18 -18
  291. package/.claude/helpers/standard-checkpoint-hooks.sh +189 -189
  292. package/.claude/helpers/statusline-hook.sh +21 -21
  293. package/.claude/helpers/statusline.cjs +925 -925
  294. package/.claude/helpers/statusline.js +352 -352
  295. package/.claude/helpers/swarm-comms.sh +353 -353
  296. package/.claude/helpers/swarm-hooks.sh +761 -761
  297. package/.claude/helpers/swarm-monitor.sh +210 -210
  298. package/.claude/helpers/sync-v3-metrics.sh +245 -245
  299. package/.claude/helpers/update-v3-progress.sh +165 -165
  300. package/.claude/helpers/v3-quick-status.sh +57 -57
  301. package/.claude/helpers/v3.sh +110 -110
  302. package/.claude/helpers/validate-v3-config.sh +215 -215
  303. package/.claude/helpers/worker-manager.sh +170 -170
  304. package/.claude/proven-config.json +1 -1
  305. package/.claude/proven-config.manifest.json +37 -37
  306. package/.claude/proven-config.signed.json +41 -41
  307. package/.claude/settings.json +182 -182
  308. package/.claude/skills/agentdb-advanced/SKILL.md +550 -550
  309. package/.claude/skills/agentdb-learning/SKILL.md +545 -545
  310. package/.claude/skills/agentdb-memory-patterns/SKILL.md +339 -339
  311. package/.claude/skills/agentdb-optimization/SKILL.md +509 -509
  312. package/.claude/skills/agentdb-vector-search/SKILL.md +339 -339
  313. package/.claude/skills/browser/SKILL.md +204 -204
  314. package/.claude/skills/dual-mode/README.md +71 -71
  315. package/.claude/skills/dual-mode/dual-collect.md +103 -103
  316. package/.claude/skills/dual-mode/dual-coordinate.md +85 -85
  317. package/.claude/skills/dual-mode/dual-spawn.md +81 -81
  318. package/.claude/skills/flow-nexus-neural/SKILL.md +727 -727
  319. package/.claude/skills/flow-nexus-platform/SKILL.md +1154 -1154
  320. package/.claude/skills/flow-nexus-swarm/SKILL.md +604 -604
  321. package/.claude/skills/github-code-review/SKILL.md +1125 -1125
  322. package/.claude/skills/github-multi-repo/SKILL.md +862 -862
  323. package/.claude/skills/github-project-management/SKILL.md +1262 -1262
  324. package/.claude/skills/github-release-management/SKILL.md +1064 -1064
  325. package/.claude/skills/github-workflow-automation/SKILL.md +1047 -1047
  326. package/.claude/skills/hooks-automation/SKILL.md +1201 -1201
  327. package/.claude/skills/pair-programming/SKILL.md +1202 -1202
  328. package/.claude/skills/reasoningbank-agentdb/SKILL.md +446 -446
  329. package/.claude/skills/reasoningbank-intelligence/SKILL.md +201 -201
  330. package/.claude/skills/skill-builder/SKILL.md +910 -910
  331. package/.claude/skills/sparc-methodology/SKILL.md +1106 -1106
  332. package/.claude/skills/stream-chain/SKILL.md +560 -560
  333. package/.claude/skills/swarm-advanced/SKILL.md +970 -970
  334. package/.claude/skills/swarm-orchestration/SKILL.md +179 -179
  335. package/.claude/skills/v3-cli-modernization/SKILL.md +871 -871
  336. package/.claude/skills/v3-core-implementation/SKILL.md +796 -796
  337. package/.claude/skills/v3-ddd-architecture/SKILL.md +441 -441
  338. package/.claude/skills/v3-integration-deep/SKILL.md +240 -240
  339. package/.claude/skills/v3-mcp-optimization/SKILL.md +776 -776
  340. package/.claude/skills/v3-memory-unification/SKILL.md +173 -173
  341. package/.claude/skills/v3-performance-optimization/SKILL.md +389 -389
  342. package/.claude/skills/v3-security-overhaul/SKILL.md +81 -81
  343. package/.claude/skills/v3-swarm-coordination/SKILL.md +339 -339
  344. package/.claude/skills/verification-quality/SKILL.md +691 -691
  345. package/README.md +419 -419
  346. package/bin/cli.js +314 -314
  347. package/bin/mcp-server.js +224 -224
  348. package/bin/preinstall.cjs +2 -2
  349. package/catalog-manifest.json +2 -2
  350. package/dist/src/benchmarks/gaia-critic.js +24 -24
  351. package/dist/src/business-pods/bbs-budget-tracker.js +53 -53
  352. package/dist/src/commands/completions.js +409 -409
  353. package/dist/src/commands/daemon.js +44 -44
  354. package/dist/src/commands/embeddings.js +26 -26
  355. package/dist/src/commands/funnel.d.ts +2 -0
  356. package/dist/src/commands/funnel.js +110 -2
  357. package/dist/src/commands/hive-mind.js +97 -97
  358. package/dist/src/commands/hooks.js +9 -9
  359. package/dist/src/commands/init.js +94 -38
  360. package/dist/src/commands/memory.js +85 -1
  361. package/dist/src/commands/ruvector/backup.js +23 -23
  362. package/dist/src/commands/ruvector/benchmark.js +31 -31
  363. package/dist/src/commands/ruvector/import.js +14 -14
  364. package/dist/src/commands/ruvector/init.js +115 -115
  365. package/dist/src/commands/ruvector/migrate.js +99 -99
  366. package/dist/src/commands/ruvector/optimize.js +51 -51
  367. package/dist/src/commands/ruvector/setup.js +624 -624
  368. package/dist/src/commands/ruvector/status.js +38 -38
  369. package/dist/src/config/proven-config.js +2 -2
  370. package/dist/src/funnel/disclosure.d.ts +1 -0
  371. package/dist/src/funnel/disclosure.js +12 -0
  372. package/dist/src/funnel/index.d.ts +1 -1
  373. package/dist/src/funnel/index.js +1 -1
  374. package/dist/src/init/claudemd-generator.js +231 -231
  375. package/dist/src/init/executor.js +453 -453
  376. package/dist/src/init/helper-signing.d.ts +8 -1
  377. package/dist/src/init/helper-signing.js +9 -2
  378. package/dist/src/init/helpers-generator.js +751 -751
  379. package/dist/src/init/statusline-generator.js +949 -949
  380. package/dist/src/mcp-tools/agentdb-tools.js +15 -15
  381. package/dist/src/mcp-tools/browser-intent-tools.js +19 -19
  382. package/dist/src/memory/graph-edge-writer.js +22 -22
  383. package/dist/src/memory/memory-bridge.d.ts +10 -0
  384. package/dist/src/memory/memory-bridge.js +139 -88
  385. package/dist/src/memory/memory-initializer.d.ts +18 -0
  386. package/dist/src/memory/memory-initializer.js +539 -407
  387. package/dist/src/memory/rabitq-index.js +5 -5
  388. package/dist/src/runtime/headless.js +28 -28
  389. package/dist/src/ruvector/flash-attention.d.ts +195 -0
  390. package/dist/src/ruvector/flash-attention.js +643 -0
  391. package/dist/src/ruvector/moe-router.d.ts +206 -0
  392. package/dist/src/ruvector/moe-router.js +626 -0
  393. package/dist/src/services/distill-tuning.js +7 -7
  394. package/dist/src/services/event-stream.d.ts +25 -0
  395. package/dist/src/services/event-stream.js +27 -0
  396. package/dist/src/services/headless-worker-executor.js +84 -84
  397. package/dist/src/services/loop-worker-runner.d.ts +16 -0
  398. package/dist/src/services/loop-worker-runner.js +34 -0
  399. package/dist/src/services/memory-distillation.js +4 -4
  400. package/dist/src/services/runtime-capabilities.d.ts +22 -0
  401. package/dist/src/services/runtime-capabilities.js +45 -0
  402. package/dist/src/transfer/deploy-seraphine.js +23 -23
  403. package/package.json +134 -133
  404. package/plugins/ruflo-metaharness/.claude-plugin/plugin.json +32 -32
  405. package/plugins/ruflo-metaharness/README.md +72 -72
  406. package/plugins/ruflo-metaharness/agents/metaharness-architect.md +58 -58
  407. package/plugins/ruflo-metaharness/commands/ruflo-metaharness.md +48 -48
  408. package/plugins/ruflo-metaharness/scripts/_darwin.mjs +210 -210
  409. package/plugins/ruflo-metaharness/scripts/_harness.mjs +330 -330
  410. package/plugins/ruflo-metaharness/scripts/_invoke.mjs +231 -231
  411. package/plugins/ruflo-metaharness/scripts/_redblue.mjs +143 -143
  412. package/plugins/ruflo-metaharness/scripts/_similarity.mjs +161 -161
  413. package/plugins/ruflo-metaharness/scripts/_spike-similarity.mjs +223 -223
  414. package/plugins/ruflo-metaharness/scripts/audit-list.mjs +158 -158
  415. package/plugins/ruflo-metaharness/scripts/audit-trend.mjs +272 -272
  416. package/plugins/ruflo-metaharness/scripts/bench-parse-mcp-scan.mjs +146 -146
  417. package/plugins/ruflo-metaharness/scripts/bench-recordpair-overhead.mjs +186 -186
  418. package/plugins/ruflo-metaharness/scripts/bench-similarity.mjs +177 -177
  419. package/plugins/ruflo-metaharness/scripts/bench.mjs +95 -95
  420. package/plugins/ruflo-metaharness/scripts/drift-from-history.mjs +363 -363
  421. package/plugins/ruflo-metaharness/scripts/evolve.mjs +404 -404
  422. package/plugins/ruflo-metaharness/scripts/genome.mjs +80 -80
  423. package/plugins/ruflo-metaharness/scripts/gepa.mjs +153 -153
  424. package/plugins/ruflo-metaharness/scripts/learn.mjs +127 -127
  425. package/plugins/ruflo-metaharness/scripts/mcp-scan.mjs +111 -111
  426. package/plugins/ruflo-metaharness/scripts/mint.mjs +126 -126
  427. package/plugins/ruflo-metaharness/scripts/oia-audit.mjs +228 -228
  428. package/plugins/ruflo-metaharness/scripts/redblue.mjs +286 -286
  429. package/plugins/ruflo-metaharness/scripts/router-parallel-analyze.mjs +250 -250
  430. package/plugins/ruflo-metaharness/scripts/score.mjs +92 -92
  431. package/plugins/ruflo-metaharness/scripts/security-bench.mjs +174 -174
  432. package/plugins/ruflo-metaharness/scripts/similarity.mjs +158 -158
  433. package/plugins/ruflo-metaharness/scripts/smoke.sh +2353 -2353
  434. package/plugins/ruflo-metaharness/scripts/test-graceful-degradation.mjs +165 -165
  435. package/plugins/ruflo-metaharness/scripts/test-mcp-tools.mjs +472 -472
  436. package/plugins/ruflo-metaharness/scripts/test-parallel-pipeline.mjs +204 -204
  437. package/plugins/ruflo-metaharness/scripts/test-pipeline-roundtrip.mjs +586 -586
  438. package/plugins/ruflo-metaharness/scripts/test-similarity.mjs +334 -334
  439. package/plugins/ruflo-metaharness/scripts/test-with-openrouter.mjs +229 -229
  440. package/plugins/ruflo-metaharness/scripts/threat-model.mjs +59 -59
  441. package/plugins/ruflo-metaharness/skills/harness-bench/SKILL.md +64 -64
  442. package/plugins/ruflo-metaharness/skills/harness-drift-from-history/SKILL.md +65 -65
  443. package/plugins/ruflo-metaharness/skills/harness-evolve/SKILL.md +131 -131
  444. package/plugins/ruflo-metaharness/skills/harness-genome/SKILL.md +54 -54
  445. package/plugins/ruflo-metaharness/skills/harness-gepa/SKILL.md +65 -65
  446. package/plugins/ruflo-metaharness/skills/harness-learn/SKILL.md +65 -65
  447. package/plugins/ruflo-metaharness/skills/harness-mcp-scan/SKILL.md +49 -49
  448. package/plugins/ruflo-metaharness/skills/harness-mint/SKILL.md +72 -72
  449. package/plugins/ruflo-metaharness/skills/harness-oia-audit/SKILL.md +79 -79
  450. package/plugins/ruflo-metaharness/skills/harness-score/SKILL.md +66 -66
  451. package/plugins/ruflo-metaharness/skills/harness-security-bench/SKILL.md +101 -101
  452. package/plugins/ruflo-metaharness/skills/harness-similarity/SKILL.md +67 -67
  453. package/plugins/ruflo-metaharness/skills/harness-threat-model/SKILL.md +41 -41
  454. package/scripts/postinstall.cjs +153 -153
@@ -1,92 +1,92 @@
1
- #!/usr/bin/env node
2
- // score.mjs — `cost-style` wrapper around `metaharness score <path>`.
3
- //
4
- // Returns the 5-dimension scorecard (harnessFit / compileConfidence /
5
- // taskCoverage / toolSafety / memoryUsefulness) + estCostPerRunUsd +
6
- // scaffoldReady boolean. Reads-only; no side effects.
7
- //
8
- // USAGE
9
- // node scripts/score.mjs # current dir
10
- // node scripts/score.mjs --path <dir> # specific dir
11
- // node scripts/score.mjs --alert-on-fit-below 70 # exit 1 if harnessFit < 70
12
- // node scripts/score.mjs --format json
13
- //
14
- // EXIT CODES
15
- // 0 scored OK (or degraded — MetaHarness not available)
16
- // 1 --alert-on-fit-below threshold breached
17
- // 2 config error or scoring failure
18
-
19
- import { runMetaharness, emitDegradedJsonAndExit } from './_harness.mjs';
20
-
21
- const ARGS = (() => {
22
- const a = { path: '.', format: 'json', alertFitBelow: null };
23
- for (let i = 2; i < process.argv.length; i++) {
24
- const v = process.argv[i];
25
- if (v === '--path') a.path = process.argv[++i];
26
- else if (v === '--alert-on-fit-below') a.alertFitBelow = parseFloat(process.argv[++i]);
27
- else if (v === '--format') a.format = process.argv[++i];
28
- }
29
- return a;
30
- })();
31
-
32
- function main() {
33
- const r = runMetaharness(['score', ARGS.path]);
34
- if (r.degraded) {
35
- emitDegradedJsonAndExit(r.reason);
36
- return;
37
- }
38
- if (r.exitCode !== 0 || !r.json) {
39
- console.error(`score: metaharness exited ${r.exitCode}`);
40
- if (r.stderr) console.error(r.stderr.slice(0, 400));
41
- process.exit(2);
42
- }
43
- const payload = { ...r.json, durationMs: r.durationMs };
44
-
45
- if (ARGS.alertFitBelow !== null) {
46
- if (!isFinite(ARGS.alertFitBelow)) {
47
- console.error(`score: --alert-on-fit-below must be a finite number`);
48
- process.exit(2);
49
- }
50
- payload.alert = {
51
- threshold: ARGS.alertFitBelow,
52
- triggered: typeof payload.harnessFit === 'number' && payload.harnessFit < ARGS.alertFitBelow,
53
- reason: typeof payload.harnessFit === 'number' && payload.harnessFit < ARGS.alertFitBelow
54
- ? `harnessFit ${payload.harnessFit} < ${ARGS.alertFitBelow}`
55
- : `harnessFit ${payload.harnessFit ?? 'unknown'} ≥ ${ARGS.alertFitBelow} — OK`,
56
- };
57
- }
58
-
59
- if (ARGS.format === 'json') {
60
- console.log(JSON.stringify(payload, null, 2));
61
- } else {
62
- console.log(`# harness-score — ${payload.repo || ARGS.path}`);
63
- console.log('');
64
- console.log(`| Dimension | Value |`);
65
- console.log(`|---|---:|`);
66
- console.log(`| harnessFit | ${payload.harnessFit ?? '—'} |`);
67
- console.log(`| compileConfidence | ${payload.compileConfidence ?? '—'} |`);
68
- console.log(`| taskCoverage | ${payload.taskCoverage ?? '—'} |`);
69
- console.log(`| toolSafety | ${payload.toolSafety ?? '—'} |`);
70
- console.log(`| memoryUsefulness | ${payload.memoryUsefulness ?? '—'} |`);
71
- console.log(`| estCostPerRunUsd | $${payload.estCostPerRunUsd ?? '—'} |`);
72
- console.log(`| recommendedMode | ${payload.recommendedMode ?? '—'} |`);
73
- console.log(`| archetype | ${payload.archetype ?? '—'} |`);
74
- console.log(`| template | ${payload.template ?? '—'} |`);
75
- console.log(`| scaffoldReady | ${payload.scaffoldReady ?? '—'} |`);
76
- console.log(`| hardConstraints | ${payload.hardConstraints ?? '—'} |`);
77
- console.log(`| **duration** | ${payload.durationMs}ms |`);
78
- console.log('');
79
- if (payload.alert) {
80
- if (payload.alert.triggered) {
81
- console.log(`⚠ **ALERT**: ${payload.alert.reason}`);
82
- } else {
83
- console.log(`✓ ${payload.alert.reason}`);
84
- }
85
- console.log('');
86
- }
87
- }
88
-
89
- if (payload.alert?.triggered) process.exit(1);
90
- }
91
-
92
- main();
1
+ #!/usr/bin/env node
2
+ // score.mjs — `cost-style` wrapper around `metaharness score <path>`.
3
+ //
4
+ // Returns the 5-dimension scorecard (harnessFit / compileConfidence /
5
+ // taskCoverage / toolSafety / memoryUsefulness) + estCostPerRunUsd +
6
+ // scaffoldReady boolean. Reads-only; no side effects.
7
+ //
8
+ // USAGE
9
+ // node scripts/score.mjs # current dir
10
+ // node scripts/score.mjs --path <dir> # specific dir
11
+ // node scripts/score.mjs --alert-on-fit-below 70 # exit 1 if harnessFit < 70
12
+ // node scripts/score.mjs --format json
13
+ //
14
+ // EXIT CODES
15
+ // 0 scored OK (or degraded — MetaHarness not available)
16
+ // 1 --alert-on-fit-below threshold breached
17
+ // 2 config error or scoring failure
18
+
19
+ import { runMetaharness, emitDegradedJsonAndExit } from './_harness.mjs';
20
+
21
+ const ARGS = (() => {
22
+ const a = { path: '.', format: 'json', alertFitBelow: null };
23
+ for (let i = 2; i < process.argv.length; i++) {
24
+ const v = process.argv[i];
25
+ if (v === '--path') a.path = process.argv[++i];
26
+ else if (v === '--alert-on-fit-below') a.alertFitBelow = parseFloat(process.argv[++i]);
27
+ else if (v === '--format') a.format = process.argv[++i];
28
+ }
29
+ return a;
30
+ })();
31
+
32
+ function main() {
33
+ const r = runMetaharness(['score', ARGS.path]);
34
+ if (r.degraded) {
35
+ emitDegradedJsonAndExit(r.reason);
36
+ return;
37
+ }
38
+ if (r.exitCode !== 0 || !r.json) {
39
+ console.error(`score: metaharness exited ${r.exitCode}`);
40
+ if (r.stderr) console.error(r.stderr.slice(0, 400));
41
+ process.exit(2);
42
+ }
43
+ const payload = { ...r.json, durationMs: r.durationMs };
44
+
45
+ if (ARGS.alertFitBelow !== null) {
46
+ if (!isFinite(ARGS.alertFitBelow)) {
47
+ console.error(`score: --alert-on-fit-below must be a finite number`);
48
+ process.exit(2);
49
+ }
50
+ payload.alert = {
51
+ threshold: ARGS.alertFitBelow,
52
+ triggered: typeof payload.harnessFit === 'number' && payload.harnessFit < ARGS.alertFitBelow,
53
+ reason: typeof payload.harnessFit === 'number' && payload.harnessFit < ARGS.alertFitBelow
54
+ ? `harnessFit ${payload.harnessFit} < ${ARGS.alertFitBelow}`
55
+ : `harnessFit ${payload.harnessFit ?? 'unknown'} ≥ ${ARGS.alertFitBelow} — OK`,
56
+ };
57
+ }
58
+
59
+ if (ARGS.format === 'json') {
60
+ console.log(JSON.stringify(payload, null, 2));
61
+ } else {
62
+ console.log(`# harness-score — ${payload.repo || ARGS.path}`);
63
+ console.log('');
64
+ console.log(`| Dimension | Value |`);
65
+ console.log(`|---|---:|`);
66
+ console.log(`| harnessFit | ${payload.harnessFit ?? '—'} |`);
67
+ console.log(`| compileConfidence | ${payload.compileConfidence ?? '—'} |`);
68
+ console.log(`| taskCoverage | ${payload.taskCoverage ?? '—'} |`);
69
+ console.log(`| toolSafety | ${payload.toolSafety ?? '—'} |`);
70
+ console.log(`| memoryUsefulness | ${payload.memoryUsefulness ?? '—'} |`);
71
+ console.log(`| estCostPerRunUsd | $${payload.estCostPerRunUsd ?? '—'} |`);
72
+ console.log(`| recommendedMode | ${payload.recommendedMode ?? '—'} |`);
73
+ console.log(`| archetype | ${payload.archetype ?? '—'} |`);
74
+ console.log(`| template | ${payload.template ?? '—'} |`);
75
+ console.log(`| scaffoldReady | ${payload.scaffoldReady ?? '—'} |`);
76
+ console.log(`| hardConstraints | ${payload.hardConstraints ?? '—'} |`);
77
+ console.log(`| **duration** | ${payload.durationMs}ms |`);
78
+ console.log('');
79
+ if (payload.alert) {
80
+ if (payload.alert.triggered) {
81
+ console.log(`⚠ **ALERT**: ${payload.alert.reason}`);
82
+ } else {
83
+ console.log(`✓ ${payload.alert.reason}`);
84
+ }
85
+ console.log('');
86
+ }
87
+ }
88
+
89
+ if (payload.alert?.triggered) process.exit(1);
90
+ }
91
+
92
+ main();
@@ -1,174 +1,174 @@
1
- #!/usr/bin/env node
2
- // security-bench.mjs — wrapper around `metaharness-darwin security bench`.
3
- //
4
- // "Darwin Shield" — upstream's own ADR-155 — evolves a champion harness
5
- // on a 10-vuln/9-decoy corpus and measures it against four baselines
6
- // (B0 static-only, B1 LLM single-pass, B2 fixed agent, B3 Darwin champion).
7
- // The CHAMPION reaches TPR=1, FPR=0; the eight acceptance gates verify
8
- // reproducibility, statistical significance, and unsafe-output=0.
9
- //
10
- // CONNECTION TO RUFLO ADR-155
11
- // ===========================
12
- // ruflo's ADR-155 (#2417) proposes a nightly self-learning security harness
13
- // with three learning loops (per-dimension confidence weighting, severity
14
- // calibration, auto-fix bid). The upstream Darwin Shield is the closest
15
- // reference implementation — same shape, different scope (evolves a
16
- // security-detection harness vs evaluates findings; both grade by realized
17
- // TPR/FPR vs ground-truth corpus). Running `security bench` periodically
18
- // gives us the empirical baseline that ruflo's Phase 2 loop A needs before
19
- // training: if Darwin Shield converges on a known-good corpus, the loop A
20
- // gradient signal is sound; if it doesn't, the corpus / sandbox is the
21
- // gap, not the learning algorithm.
22
- //
23
- // USAGE
24
- // node scripts/security-bench.mjs # default population=2 cycles=1
25
- // node scripts/security-bench.mjs --population 4 --cycles 3 # deeper run
26
- // node scripts/security-bench.mjs --population 4 --cycles 3 --alert-on-fail
27
- //
28
- // EXIT CODES
29
- // 0 bench passed all gates (or degraded — Darwin not available)
30
- // 1 --alert-on-fail and any acceptance gate failed
31
- // 2 config error or bench infrastructure failure
32
-
33
- import { runDarwinAsync, emitDarwinDegradedJsonAndExit } from './_darwin.mjs';
34
-
35
- const ARGS = (() => {
36
- const a = {
37
- population: 2,
38
- cycles: 1,
39
- seed: null,
40
- alertOnFail: false,
41
- format: 'json',
42
- timeoutMs: null,
43
- };
44
- for (let i = 2; i < process.argv.length; i++) {
45
- const v = process.argv[i];
46
- if (v === '--population') a.population = parseInt(process.argv[++i], 10);
47
- else if (v === '--cycles') a.cycles = parseInt(process.argv[++i], 10);
48
- else if (v === '--seed') a.seed = parseInt(process.argv[++i], 10);
49
- else if (v === '--alert-on-fail') a.alertOnFail = true;
50
- else if (v === '--format') a.format = process.argv[++i];
51
- else if (v === '--timeout-ms') a.timeoutMs = parseInt(process.argv[++i], 10);
52
- }
53
- return a;
54
- })();
55
-
56
- function safetyChecks() {
57
- if (ARGS.population < 1 || ARGS.population > 20) {
58
- console.error('security-bench: --population must be 1..20 (ruflo cap)');
59
- process.exit(2);
60
- }
61
- if (ARGS.cycles < 1 || ARGS.cycles > 100) {
62
- console.error('security-bench: --cycles must be 1..100 (ruflo cap)');
63
- process.exit(2);
64
- }
65
- }
66
-
67
- function defaultTimeoutMs() {
68
- // Bench corpus has 10 vulns + 9 decoys = 19 evaluations per cycle.
69
- // Each evaluation runs the candidate detector + scores patches.
70
- // Rough budget: ~3s per evaluation × population × cycles + 30s overhead.
71
- return Math.max(60_000, 3_000 * 19 * ARGS.population * ARGS.cycles + 30_000);
72
- }
73
-
74
- // Parse the markdown report that `security bench` emits. The header
75
- // "Overall: ✅ PASS" or "❌ FAIL" is the rolled-up gate. We also extract
76
- // each acceptance gate's pass/fail line.
77
- function parseSecurityBenchMarkdown(stdout) {
78
- const overallMatch = /\*\*Overall:\s*([✅❌])\s*(PASS|FAIL)\*\*/i.exec(stdout);
79
- const overall = overallMatch ? { ok: overallMatch[2].toUpperCase() === 'PASS', icon: overallMatch[1] } : null;
80
-
81
- const gates = [];
82
- // Match lines like: "- ✅ **TPR improvement ≥ 25% vs fixed harness** — +150%"
83
- const gateRx = /^-\s+([✅❌])\s+\*\*(.+?)\*\*\s*[—-]\s*(.+)$/gm;
84
- let m;
85
- while ((m = gateRx.exec(stdout)) !== null) {
86
- gates.push({
87
- ok: m[1] === '✅',
88
- criterion: m[2].trim(),
89
- measured: m[3].trim(),
90
- });
91
- }
92
-
93
- // Extract the baselines-vs-champion table — useful for diff over time.
94
- const baselines = [];
95
- const tableRx = /^\|\s*B[0-3]\s+([^|]+?)\s*\|\s*([\d.]+)\s*\|\s*([\d.]+)\s*\|\s*([\d.]+)\s*\|\s*([\d.]+)\s*\|\s*([\d.]+)\s*\|\s*(\d+)\s*\|\s*(.+?)\s*\|/gm;
96
- while ((m = tableRx.exec(stdout)) !== null) {
97
- baselines.push({
98
- harness: m[1].trim(),
99
- fitness: parseFloat(m[2]),
100
- tpr: parseFloat(m[3]),
101
- fpr: parseFloat(m[4]),
102
- patchPass: parseFloat(m[5]),
103
- repro: parseFloat(m[6]),
104
- unsafe: parseInt(m[7], 10),
105
- cost: m[8].trim(),
106
- });
107
- }
108
-
109
- return { overall, gates, baselines };
110
- }
111
-
112
- async function main() {
113
- safetyChecks();
114
-
115
- const cliArgs = ['security', 'bench',
116
- '--population', String(ARGS.population),
117
- '--cycles', String(ARGS.cycles),
118
- ];
119
- if (ARGS.seed != null) cliArgs.push('--seed', String(ARGS.seed));
120
-
121
- const r = await runDarwinAsync(cliArgs, {
122
- timeoutMs: ARGS.timeoutMs ?? defaultTimeoutMs(),
123
- json: false, // bench output is markdown, not JSON
124
- onProgress: (line) => { if (line.trim()) process.stderr.write(`[security-bench] ${line}\n`); },
125
- });
126
-
127
- if (r.degraded) {
128
- emitDarwinDegradedJsonAndExit(r.reason);
129
- return;
130
- }
131
-
132
- if (r.exitCode !== 0 && r.exitCode !== 1) {
133
- // Exit 1 may be the bench's own "gates failed" signal; treat as data.
134
- // Anything else is infrastructure failure.
135
- const payload = {
136
- success: false,
137
- data: { exitCode: r.exitCode, stderrTail: r.stderr.slice(-400) },
138
- generatedAt: new Date().toISOString(),
139
- };
140
- console.log(JSON.stringify(payload, null, 2));
141
- process.exit(2);
142
- }
143
-
144
- const parsed = parseSecurityBenchMarkdown(r.stdout);
145
- const gatesPassed = parsed.gates.filter((g) => g.ok).length;
146
- const gatesFailed = parsed.gates.length - gatesPassed;
147
-
148
- const payload = {
149
- success: true,
150
- data: {
151
- overall: parsed.overall,
152
- gates: {
153
- total: parsed.gates.length,
154
- passed: gatesPassed,
155
- failed: gatesFailed,
156
- details: parsed.gates,
157
- },
158
- baselines: parsed.baselines,
159
- rawMarkdown: r.stdout,
160
- shape: { population: ARGS.population, cycles: ARGS.cycles, seed: ARGS.seed },
161
- durationMs: r.durationMs,
162
- },
163
- generatedAt: new Date().toISOString(),
164
- };
165
-
166
- console.log(JSON.stringify(payload, null, 2));
167
- if (ARGS.alertOnFail && parsed.overall && !parsed.overall.ok) process.exit(1);
168
- process.exit(0);
169
- }
170
-
171
- main().catch((e) => {
172
- console.error(`security-bench: unexpected failure: ${e?.message ?? e}`);
173
- process.exit(2);
174
- });
1
+ #!/usr/bin/env node
2
+ // security-bench.mjs — wrapper around `metaharness-darwin security bench`.
3
+ //
4
+ // "Darwin Shield" — upstream's own ADR-155 — evolves a champion harness
5
+ // on a 10-vuln/9-decoy corpus and measures it against four baselines
6
+ // (B0 static-only, B1 LLM single-pass, B2 fixed agent, B3 Darwin champion).
7
+ // The CHAMPION reaches TPR=1, FPR=0; the eight acceptance gates verify
8
+ // reproducibility, statistical significance, and unsafe-output=0.
9
+ //
10
+ // CONNECTION TO RUFLO ADR-155
11
+ // ===========================
12
+ // ruflo's ADR-155 (#2417) proposes a nightly self-learning security harness
13
+ // with three learning loops (per-dimension confidence weighting, severity
14
+ // calibration, auto-fix bid). The upstream Darwin Shield is the closest
15
+ // reference implementation — same shape, different scope (evolves a
16
+ // security-detection harness vs evaluates findings; both grade by realized
17
+ // TPR/FPR vs ground-truth corpus). Running `security bench` periodically
18
+ // gives us the empirical baseline that ruflo's Phase 2 loop A needs before
19
+ // training: if Darwin Shield converges on a known-good corpus, the loop A
20
+ // gradient signal is sound; if it doesn't, the corpus / sandbox is the
21
+ // gap, not the learning algorithm.
22
+ //
23
+ // USAGE
24
+ // node scripts/security-bench.mjs # default population=2 cycles=1
25
+ // node scripts/security-bench.mjs --population 4 --cycles 3 # deeper run
26
+ // node scripts/security-bench.mjs --population 4 --cycles 3 --alert-on-fail
27
+ //
28
+ // EXIT CODES
29
+ // 0 bench passed all gates (or degraded — Darwin not available)
30
+ // 1 --alert-on-fail and any acceptance gate failed
31
+ // 2 config error or bench infrastructure failure
32
+
33
+ import { runDarwinAsync, emitDarwinDegradedJsonAndExit } from './_darwin.mjs';
34
+
35
+ const ARGS = (() => {
36
+ const a = {
37
+ population: 2,
38
+ cycles: 1,
39
+ seed: null,
40
+ alertOnFail: false,
41
+ format: 'json',
42
+ timeoutMs: null,
43
+ };
44
+ for (let i = 2; i < process.argv.length; i++) {
45
+ const v = process.argv[i];
46
+ if (v === '--population') a.population = parseInt(process.argv[++i], 10);
47
+ else if (v === '--cycles') a.cycles = parseInt(process.argv[++i], 10);
48
+ else if (v === '--seed') a.seed = parseInt(process.argv[++i], 10);
49
+ else if (v === '--alert-on-fail') a.alertOnFail = true;
50
+ else if (v === '--format') a.format = process.argv[++i];
51
+ else if (v === '--timeout-ms') a.timeoutMs = parseInt(process.argv[++i], 10);
52
+ }
53
+ return a;
54
+ })();
55
+
56
+ function safetyChecks() {
57
+ if (ARGS.population < 1 || ARGS.population > 20) {
58
+ console.error('security-bench: --population must be 1..20 (ruflo cap)');
59
+ process.exit(2);
60
+ }
61
+ if (ARGS.cycles < 1 || ARGS.cycles > 100) {
62
+ console.error('security-bench: --cycles must be 1..100 (ruflo cap)');
63
+ process.exit(2);
64
+ }
65
+ }
66
+
67
+ function defaultTimeoutMs() {
68
+ // Bench corpus has 10 vulns + 9 decoys = 19 evaluations per cycle.
69
+ // Each evaluation runs the candidate detector + scores patches.
70
+ // Rough budget: ~3s per evaluation × population × cycles + 30s overhead.
71
+ return Math.max(60_000, 3_000 * 19 * ARGS.population * ARGS.cycles + 30_000);
72
+ }
73
+
74
+ // Parse the markdown report that `security bench` emits. The header
75
+ // "Overall: ✅ PASS" or "❌ FAIL" is the rolled-up gate. We also extract
76
+ // each acceptance gate's pass/fail line.
77
+ function parseSecurityBenchMarkdown(stdout) {
78
+ const overallMatch = /\*\*Overall:\s*([✅❌])\s*(PASS|FAIL)\*\*/i.exec(stdout);
79
+ const overall = overallMatch ? { ok: overallMatch[2].toUpperCase() === 'PASS', icon: overallMatch[1] } : null;
80
+
81
+ const gates = [];
82
+ // Match lines like: "- ✅ **TPR improvement ≥ 25% vs fixed harness** — +150%"
83
+ const gateRx = /^-\s+([✅❌])\s+\*\*(.+?)\*\*\s*[—-]\s*(.+)$/gm;
84
+ let m;
85
+ while ((m = gateRx.exec(stdout)) !== null) {
86
+ gates.push({
87
+ ok: m[1] === '✅',
88
+ criterion: m[2].trim(),
89
+ measured: m[3].trim(),
90
+ });
91
+ }
92
+
93
+ // Extract the baselines-vs-champion table — useful for diff over time.
94
+ const baselines = [];
95
+ const tableRx = /^\|\s*B[0-3]\s+([^|]+?)\s*\|\s*([\d.]+)\s*\|\s*([\d.]+)\s*\|\s*([\d.]+)\s*\|\s*([\d.]+)\s*\|\s*([\d.]+)\s*\|\s*(\d+)\s*\|\s*(.+?)\s*\|/gm;
96
+ while ((m = tableRx.exec(stdout)) !== null) {
97
+ baselines.push({
98
+ harness: m[1].trim(),
99
+ fitness: parseFloat(m[2]),
100
+ tpr: parseFloat(m[3]),
101
+ fpr: parseFloat(m[4]),
102
+ patchPass: parseFloat(m[5]),
103
+ repro: parseFloat(m[6]),
104
+ unsafe: parseInt(m[7], 10),
105
+ cost: m[8].trim(),
106
+ });
107
+ }
108
+
109
+ return { overall, gates, baselines };
110
+ }
111
+
112
+ async function main() {
113
+ safetyChecks();
114
+
115
+ const cliArgs = ['security', 'bench',
116
+ '--population', String(ARGS.population),
117
+ '--cycles', String(ARGS.cycles),
118
+ ];
119
+ if (ARGS.seed != null) cliArgs.push('--seed', String(ARGS.seed));
120
+
121
+ const r = await runDarwinAsync(cliArgs, {
122
+ timeoutMs: ARGS.timeoutMs ?? defaultTimeoutMs(),
123
+ json: false, // bench output is markdown, not JSON
124
+ onProgress: (line) => { if (line.trim()) process.stderr.write(`[security-bench] ${line}\n`); },
125
+ });
126
+
127
+ if (r.degraded) {
128
+ emitDarwinDegradedJsonAndExit(r.reason);
129
+ return;
130
+ }
131
+
132
+ if (r.exitCode !== 0 && r.exitCode !== 1) {
133
+ // Exit 1 may be the bench's own "gates failed" signal; treat as data.
134
+ // Anything else is infrastructure failure.
135
+ const payload = {
136
+ success: false,
137
+ data: { exitCode: r.exitCode, stderrTail: r.stderr.slice(-400) },
138
+ generatedAt: new Date().toISOString(),
139
+ };
140
+ console.log(JSON.stringify(payload, null, 2));
141
+ process.exit(2);
142
+ }
143
+
144
+ const parsed = parseSecurityBenchMarkdown(r.stdout);
145
+ const gatesPassed = parsed.gates.filter((g) => g.ok).length;
146
+ const gatesFailed = parsed.gates.length - gatesPassed;
147
+
148
+ const payload = {
149
+ success: true,
150
+ data: {
151
+ overall: parsed.overall,
152
+ gates: {
153
+ total: parsed.gates.length,
154
+ passed: gatesPassed,
155
+ failed: gatesFailed,
156
+ details: parsed.gates,
157
+ },
158
+ baselines: parsed.baselines,
159
+ rawMarkdown: r.stdout,
160
+ shape: { population: ARGS.population, cycles: ARGS.cycles, seed: ARGS.seed },
161
+ durationMs: r.durationMs,
162
+ },
163
+ generatedAt: new Date().toISOString(),
164
+ };
165
+
166
+ console.log(JSON.stringify(payload, null, 2));
167
+ if (ARGS.alertOnFail && parsed.overall && !parsed.overall.ok) process.exit(1);
168
+ process.exit(0);
169
+ }
170
+
171
+ main().catch((e) => {
172
+ console.error(`security-bench: unexpected failure: ${e?.message ?? e}`);
173
+ process.exit(2);
174
+ });