ai-developer-skill-os 9.1.1 → 9.3.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (63) hide show
  1. package/.agents/AGENTS.md +139 -42
  2. package/.agents/DEV_PROFILE.md +95 -0
  3. package/.agents/registry/capability-graph.yml +171 -334
  4. package/.agents/registry/graph.json +52 -18
  5. package/.agents/registry/index.yaml +66 -12
  6. package/.agents/registry/skills-index.yml +204 -447
  7. package/.agents/rules/coding.md +23 -0
  8. package/.agents/rules/global.md +44 -30
  9. package/.agents/skills/_template/SKILL.md +2 -300
  10. package/.agents/skills/qk-access-policy/SKILL.md +98 -393
  11. package/.agents/skills/qk-agent-observability/SKILL.md +3 -359
  12. package/.agents/skills/qk-ai-builder/SKILL.md +132 -485
  13. package/.agents/skills/qk-api-consumer/SKILL.md +256 -0
  14. package/.agents/skills/qk-api-consumer/capability.yaml +21 -0
  15. package/.agents/skills/qk-api-consumer/evals/scorecard.yaml +29 -0
  16. package/.agents/skills/qk-api-lifecycle/SKILL.md +133 -376
  17. package/.agents/skills/qk-bug-resolution/SKILL.md +128 -481
  18. package/.agents/skills/qk-code-review/SKILL.md +142 -340
  19. package/.agents/skills/qk-context-loader/SKILL.md +99 -391
  20. package/.agents/skills/qk-data-engineer/SKILL.md +253 -0
  21. package/.agents/skills/qk-data-lifecycle/SKILL.md +89 -408
  22. package/.agents/skills/qk-db-optimizer/SKILL.md +102 -408
  23. package/.agents/skills/qk-design-system-engineering/SKILL.md +76 -381
  24. package/.agents/skills/qk-devops-platform/SKILL.md +77 -383
  25. package/.agents/skills/qk-docs/SKILL.md +88 -414
  26. package/.agents/skills/qk-engineering-standard/SKILL.md +4 -508
  27. package/.agents/skills/qk-fe-api-integration/SKILL.md +343 -263
  28. package/.agents/skills/qk-fe-api-integration/evals/scorecard.yaml +29 -29
  29. package/.agents/skills/qk-feature-delivery/SKILL.md +137 -365
  30. package/.agents/skills/qk-feature-delivery/evals/scorecard.yaml +1 -1
  31. package/.agents/skills/qk-frontend-architecture/SKILL.md +5 -399
  32. package/.agents/skills/qk-help/evals/scorecard.yaml +13 -13
  33. package/.agents/skills/qk-orchestrator/SKILL.md +63 -422
  34. package/.agents/skills/qk-orchestrator/references/routing-table.md +10 -14
  35. package/.agents/skills/qk-product-specification/SKILL.md +70 -399
  36. package/.agents/skills/qk-production-release/SKILL.md +80 -457
  37. package/.agents/skills/qk-project-audit/SKILL.md +174 -0
  38. package/.agents/skills/qk-project-bootstrap/SKILL.md +244 -392
  39. package/.agents/skills/qk-project-health/SKILL.md +97 -416
  40. package/.agents/skills/qk-project-memory/SKILL.md +76 -21
  41. package/.agents/skills/qk-refactor/SKILL.md +167 -304
  42. package/.agents/skills/qk-security-audit/SKILL.md +141 -383
  43. package/.agents/skills/qk-security-audit/capability.yaml +1 -2
  44. package/.agents/skills/qk-system-evolution/SKILL.md +343 -263
  45. package/.agents/skills/qk-system-evolution/evals/scorecard.yaml +26 -26
  46. package/.agents/skills/qk-test-engineering/SKILL.md +119 -429
  47. package/.agents/skills/qk-ui-audit/SKILL.md +73 -457
  48. package/.agents/skills/qk-ui-builder/SKILL.md +521 -482
  49. package/.agents/skills/qk-ui-system-builder/SKILL.md +68 -434
  50. package/.agents/skills/qk-upgrade/SKILL.md +301 -0
  51. package/.agents/skills/qk-upgrade/capability.yaml +24 -0
  52. package/.agents/skills/qk-upgrade/evals/scorecard.yaml +26 -0
  53. package/.agents/skills/qk-validation-gate/SKILL.md +4 -523
  54. package/.agents/skills/qk-web-quality-gate/SKILL.md +85 -383
  55. package/.agents/workflows/bug-resolution.yml +6 -6
  56. package/.agents/workflows/context-discovery.yml +94 -0
  57. package/.agents/workflows/feature-delivery.yml +8 -4
  58. package/.agents/workflows/refactor.yml +6 -3
  59. package/.agents/workflows/shared/quality-gate.yml +94 -0
  60. package/.agents/workflows/skin-governance.yml +115 -0
  61. package/README.md +152 -67
  62. package/package.json +2 -2
  63. package/tooling/build-registry.js +30 -8
@@ -1,7 +1,7 @@
1
- ---
1
+ ---
2
2
  name: qk-agent-observability
3
- version: 9.1.0
4
- status: experimental
3
+ version: 9.2.1
4
+ status: archived
5
5
  description: "Lớp theo dõi (Observability) cho phép giám sát quyết định, luân chuyển và các mô hình lỗi."
6
6
  platforms: [antigravity, claude-code, cursor, windsurf, kilo-code]
7
7
 
@@ -106,359 +106,3 @@ token_budget:
106
106
 
107
107
  # Agent Observability Capability
108
108
  This skill enables tracking and observing the AI agent's own behavior, decisions, and accuracy metrics without interfering with application or infrastructure observability systems.
109
-
110
- ---
111
-
112
- ## Memory Workflow
113
-
114
- ### 0. Self-Init Protocol (Khởi Tạo Bộ Nhớ Local & Gitignore)
115
- - Trước khi tra cứu hoặc lưu trữ tri thức, BẮT BUỘC kiểm tra sự tồn tại của thư mục `.ai-local/` tại gốc dự án:
116
- - **Tự động tạo mới:** Nếu `.ai-local/` chưa tồn tại, AI phải tự động tạo cấu trúc thư mục `.ai-local/knowledge/` (và file `index.yaml` nếu cần thiết) cùng `.ai-local/candidates/`. Tuyệt đối không ngưng chạy hay hỏi ý kiến người dùng về thao tác khởi tạo tiêu chuẩn này.
117
- - **Bảo mật Gitignore:** BẮT BUỘC kiểm tra file `.gitignore` của dự án, nếu chưa có dòng `.ai-local/` thì phải tự động thêm vào để tuyệt đối bảo mật tri thức cá nhân và tránh lộ lọt lên Git.
118
-
119
- ---
120
-
121
- ### Pre-flight Retrieve (Trước khi thực thi)
122
- - Trước các task có tính lặp lại, debug, refactor, kiến trúc hoặc rủi ro cao:
123
- bắt buộc tra cứu:
124
- - `.ai-local/knowledge/index.yaml` (Private Local Knowledge)
125
-
126
- - Ưu tiên sử dụng các Knowledge đang có trạng thái `Active` thuộc:
127
- - Architecture
128
- - Hard Bug
129
- - Convention
130
- - Pattern
131
- - Tech Debt Pattern
132
- - 👉 *Domain Focus:* Hard Bug / Convention (vd: mô hình lỗi lặp vô tận, giới hạn token budget).
133
-
134
- - Memory chỉ đóng vai trò **Navigator (bản đồ chỉ đường)**.
135
- Không được xem Memory là Source of Truth.
136
- Luôn xác minh lại bằng source code, configuration và trạng thái hiện tại của dự án trước khi áp dụng.
137
-
138
- ---
139
-
140
- ### Learning Flow (AI tự học có kiểm soát)
141
- - Trong quá trình làm việc, AI được phép tự phát hiện và tạo **Candidate Memory** khi nhận thấy:
142
- - Hard Bug có khả năng tái diễn.
143
- - Pattern làm việc lặp lại trong dự án.
144
- - Convention hoặc quy tắc kiến trúc mới.
145
- - Quyết định Architecture quan trọng.
146
- - Tech Debt Pattern hoặc Code Smell có tính hệ thống.
147
- - 👉 *Domain Harvest:* Hard Bug mới có khả năng tái diễn (vd: lỗi loop định tuyến cần blacklist).
148
-
149
- - Candidate Memory chỉ là bản nháp quan sát, chưa phải tri thức chính thức.
150
- - Candidate Memory có thể lưu tạm tại: `.ai-local/candidates/`
151
- - AI không được tự động Promote Candidate Memory thành Project Knowledge.
152
-
153
- ---
154
-
155
- ### Post-flight Harvest (Đề xuất → Phê duyệt)
156
- Sau khi hoàn thành task:
157
- - AI đánh giá các Candidate Memory đã tạo.
158
- - Nếu phát hiện tri thức có giá trị tái sử dụng:
159
- - Đề xuất người dùng xem xét.
160
- - Gửi yêu cầu phê duyệt thông qua:
161
- - `/learn`
162
- - `qk-project-memory`
163
- - Chỉ sau khi được phê duyệt, Candidate Memory mới được chuyển thành Knowledge chính thức:
164
-
165
- ```
166
- .ai-local/candidates/ ──(Approve)──> .ai-local/knowledge/index.yaml
167
- ```
168
-
169
- - Project Knowledge phải được xem như tài sản kỹ thuật của dự án:
170
- - Có thể review, cập nhật, loại bỏ và có lịch sử thay đổi.
171
-
172
- ---
173
-
174
- ### Ignore (Không đưa vào Memory)
175
- Không lưu:
176
- - Trace log của một session đơn lẻ.
177
- - Temporary debugging data.
178
- - Output của một lần chạy test/scan.
179
- - Report health tạm thời của một đợt kiểm tra.
180
- - Lỗi nhỏ chỉ xảy ra một lần.
181
- - Thông tin không có khả năng tái sử dụng.
182
- - 👉 *Domain Ignore:* Trace log của một session đơn lẻ (tự XÓA sau khi thực thi).
183
-
184
- ---
185
-
186
- ### Golden Rule
187
- > **AI được phép học, nhưng không được tự quyết định tri thức chính thức.**
188
- > **AI quan sát → Đề xuất → Con người phê duyệt → Dự án tiến hóa.**
189
-
190
- ---
191
-
192
-
193
-
194
- ### Pre-flight Retrieve (Trước khi thực thi)
195
- - Trước các task có tính lặp lại, debug, refactor, kiến trúc hoặc rủi ro cao:
196
- bắt buộc tra cứu:
197
- - `.agents/knowledge/index.yaml` (Shared Project Knowledge)
198
- - `.ai-local/knowledge/index.yaml` (Private Local Knowledge)
199
-
200
- - Ưu tiên sử dụng các Knowledge đang có trạng thái `Active` thuộc:
201
- - Architecture
202
- - Hard Bug
203
- - Convention
204
- - Pattern
205
- - Tech Debt Pattern
206
- - 👉 *Domain Focus:* Hard Bug / Convention (vd: mô hình lỗi lặp vô tận, giới hạn token budget).
207
-
208
- - Memory chỉ đóng vai trò **Navigator (bản đồ chỉ đường)**.
209
- Không được xem Memory là Source of Truth.
210
- Luôn xác minh lại bằng source code, configuration và trạng thái hiện tại của dự án trước khi áp dụng.
211
-
212
- ---
213
-
214
- ### Learning Flow (AI tự học có kiểm soát)
215
- - Trong quá trình làm việc, AI được phép tự phát hiện và tạo **Candidate Memory** khi nhận thấy:
216
- - Hard Bug có khả năng tái diễn.
217
- - Pattern làm việc lặp lại trong dự án.
218
- - Convention hoặc quy tắc kiến trúc mới.
219
- - Quyết định Architecture quan trọng.
220
- - Tech Debt Pattern hoặc Code Smell có tính hệ thống.
221
- - 👉 *Domain Harvest:* Hard Bug mới có khả năng tái diễn (vd: lỗi loop định tuyến cần blacklist).
222
-
223
- - Candidate Memory chỉ là bản nháp quan sát, chưa phải tri thức chính thức.
224
- - Candidate Memory có thể lưu tạm tại: `.ai-local/candidates/`
225
- - AI không được tự động Promote Candidate Memory thành Project Knowledge.
226
-
227
- ---
228
-
229
- ### Post-flight Harvest (Đề xuất → Phê duyệt)
230
- Sau khi hoàn thành task:
231
- - AI đánh giá các Candidate Memory đã tạo.
232
- - Nếu phát hiện tri thức có giá trị tái sử dụng:
233
- - Đề xuất người dùng xem xét.
234
- - Gửi yêu cầu phê duyệt thông qua:
235
- - `/learn`
236
- - `qk-project-memory`
237
- - Chỉ sau khi được phê duyệt, Candidate Memory mới được chuyển thành Knowledge chính thức:
238
-
239
- ```
240
- .ai-local/candidates/ ──(Approve)──> .agents/knowledge/index.yaml
241
- ```
242
-
243
- - Project Knowledge phải được xem như tài sản kỹ thuật của dự án:
244
- - Có thể review, cập nhật, loại bỏ và có lịch sử thay đổi.
245
-
246
- ---
247
-
248
- ### Ignore (Không đưa vào Memory)
249
- Không lưu:
250
- - Trace log của một session đơn lẻ.
251
- - Temporary debugging data.
252
- - Output của một lần chạy test/scan.
253
- - Report health tạm thời của một đợt kiểm tra.
254
- - Lỗi nhỏ chỉ xảy ra một lần.
255
- - Thông tin không có khả năng tái sử dụng.
256
- - 👉 *Domain Ignore:* Trace log của một session đơn lẻ (tự XÓA sau khi thực thi).
257
-
258
- ---
259
-
260
- ### Golden Rule
261
- > **AI được phép học, nhưng không được tự quyết định tri thức chính thức.**
262
- > **AI quan sát → Đề xuất → Con người phê duyệt → Dự án tiến hóa.**
263
-
264
- ---
265
- ---
266
-
267
- ### Learning Flow (AI tự học có kiểm soát)
268
- - Trong quá trình làm việc, AI được phép tự phát hiện và tạo **Candidate Memory** khi nhận thấy:
269
- - Hard Bug có khả năng tái diễn.
270
- - Pattern làm việc lặp lại trong dự án.
271
- - Convention hoặc quy tắc kiến trúc mới.
272
- - Quyết định Architecture quan trọng.
273
- - Tech Debt Pattern hoặc Code Smell có tính hệ thống.
274
- - 👉 *Domain Harvest:* Hard Bug mới có khả năng tái diễn (vd: lỗi loop định tuyến cần blacklist).
275
-
276
- - Candidate Memory chỉ là bản nháp quan sát, chưa phải tri thức chính thức.
277
- - Candidate Memory có thể lưu tạm tại: `.ai-local/candidates/`
278
- - AI không được tự động Promote Candidate Memory thành Project Knowledge.
279
-
280
- ---
281
-
282
- ### Post-flight Harvest (Đề xuất → Phê duyệt)
283
- Sau khi hoàn thành task:
284
- - AI đánh giá các Candidate Memory đã tạo.
285
- - Nếu phát hiện tri thức có giá trị tái sử dụng:
286
- - Đề xuất người dùng xem xét.
287
- - Gửi yêu cầu phê duyệt thông qua:
288
- - `/learn`
289
- - `qk-project-memory`
290
- - Chỉ sau khi được phê duyệt, Candidate Memory mới được chuyển thành Knowledge chính thức:
291
-
292
- ```
293
- .ai-local/candidates/ ──(Approve)──> .agents/knowledge/index.yaml
294
- ```
295
-
296
- - Project Knowledge phải được xem như tài sản kỹ thuật của dự án:
297
- - Có thể review, cập nhật, loại bỏ và có lịch sử thay đổi.
298
-
299
- ---
300
-
301
- ### Ignore (Không đưa vào Memory)
302
- Không lưu:
303
- - Trace log của một session đơn lẻ.
304
- - Temporary debugging data.
305
- - Output của một lần chạy test/scan.
306
- - Report health tạm thời của một đợt kiểm tra.
307
- - Lỗi nhỏ chỉ xảy ra một lần.
308
- - Thông tin không có khả năng tái sử dụng.
309
- - 👉 *Domain Ignore:* Trace log của một session đơn lẻ (tự XÓA sau khi thực thi).
310
-
311
- ---
312
-
313
- ### Golden Rule
314
- > **AI được phép học, nhưng không được tự quyết định tri thức chính thức.**
315
- > **AI quan sát → Đề xuất → Con người phê duyệt → Dự án tiến hóa.**
316
-
317
- ---
318
- ---
319
-
320
- ### Learning Flow (AI tự học có kiểm soát)
321
- - Trong quá trình làm việc, AI được phép tự phát hiện và tạo **Candidate Memory** khi nhận thấy:
322
- - Hard Bug có khả năng tái diễn.
323
- - Pattern làm việc lặp lại trong dự án.
324
- - Convention hoặc quy tắc kiến trúc mới.
325
- - Quyết định Architecture quan trọng.
326
- - Tech Debt Pattern hoặc Code Smell có tính hệ thống.
327
- - 👉 *Domain Harvest:* Hard Bug mới có khả năng tái diễn (vd: lỗi loop định tuyến cần blacklist).
328
-
329
- - Candidate Memory chỉ là bản nháp quan sát, chưa phải tri thức chính thức.
330
- - Candidate Memory có thể lưu tạm tại: `.ai-local/candidates/`
331
- - AI không được tự động Promote Candidate Memory thành Project Knowledge.
332
-
333
- ---
334
-
335
- ### Post-flight Harvest (Đề xuất → Phê duyệt)
336
- Sau khi hoàn thành task:
337
- - AI đánh giá các Candidate Memory đã tạo.
338
- - Nếu phát hiện tri thức có giá trị tái sử dụng:
339
- - Đề xuất người dùng xem xét.
340
- - Gửi yêu cầu phê duyệt thông qua:
341
- - `/learn`
342
- - `qk-project-memory`
343
- - Chỉ sau khi được phê duyệt, Candidate Memory mới được chuyển thành Knowledge chính thức:
344
-
345
- ```
346
- .ai-local/candidates/ ──(Approve)──> .agents/knowledge/index.yaml
347
- ```
348
-
349
- - Project Knowledge phải được xem như tài sản kỹ thuật của dự án:
350
- - Có thể review, cập nhật, loại bỏ và có lịch sử thay đổi.
351
-
352
- ---
353
-
354
- ### Ignore (Không đưa vào Memory)
355
- Không lưu:
356
- - Trace log của một session đơn lẻ.
357
- - Temporary debugging data.
358
- - Output của một lần chạy test/scan.
359
- - Report health tạm thời của một đợt kiểm tra.
360
- - Lỗi nhỏ chỉ xảy ra một lần.
361
- - Thông tin không có khả năng tái sử dụng.
362
- - 👉 *Domain Ignore:* Trace log của một session đơn lẻ (tự XÓA sau khi thực thi).
363
-
364
- ---
365
-
366
- ### Golden Rule
367
- > **AI được phép học, nhưng không được tự quyết định tri thức chính thức.**
368
- > **AI quan sát → Đề xuất → Con người phê duyệt → Dự án tiến hóa.**
369
-
370
- ---
371
- ---
372
- ---
373
- ---
374
-
375
- ## Scope
376
- - ✅ Monitor agent decision boundaries and token budgets during execution
377
- - ✅ Record execution traces and accuracy metrics into `evals/traces/` for quantitative verification
378
- - ✅ Detect failure patterns or repetitive tool calling loops to trigger safe demotion/stopping
379
-
380
- ## Non-Goals
381
- - ❌ Monitor infrastructure servers, Kubernetes pods, or external application metrics
382
- - ❌ Alter runtime execution paths outside of established boundary validation rules
383
- - ❌ Tự tính pass/fail hay enforce threshold — đó là việc của `qk-validation-gate` (xem `decision_boundary.does_not_own`)
384
-
385
- ---
386
-
387
- ## 🧭 V1 Knowledge Protocol (AI Skin V9)
388
- - **Pre-flight Check:** BẮT BUỘC tra cứu `.ai-local/knowledge/index.yaml` hoặc `.agents/knowledge/index.yaml` (nếu tồn tại) trước khi tiến hành tìm kiếm mù toàn dự án. Nếu có pattern/fact liên quan (`status: Active`), áp dụng ngay để bỏ qua bước search dài dòng.
389
- - **Post-flight Harvest (AI Đề xuất -> Con người Phê duyệt):** Sau khi hoàn thành task, nếu phát hiện tri thức thuộc 4 loại (`Architecture`, `Convention`, `Pattern`, `Hard Bug`) có giá trị giảm thời gian cho tương lai, hãy tóm tắt đề xuất và yêu cầu Người dùng xác nhận trước khi lưu lại. Bỏ qua các thay đổi lặt vặt (typo, CSS, CRUD thường).
390
-
391
- ---
392
-
393
- ## Preconditions
394
-
395
- - [ ] Task vừa hoàn tất (bất kỳ `exit_code` nào — kể cả `FAILED`/`BLOCKED` cũng phải ghi trace, vì thất bại cũng là dữ liệu quan sát quan trọng).
396
- - [ ] `evals/scorecard.yaml` tồn tại và định nghĩa được metric cần ghi nhận.
397
-
398
- ```
399
- On missing scorecard.yaml:
400
- EXIT: BLOCKED
401
- Message: "Không tìm thấy scorecard.yaml — không xác định được field nào cần ghi vào trace."
402
- ```
403
-
404
- ---
405
-
406
- ## Workflow
407
-
408
- ### Bước 1 — Xác định có cần ghi trace không
409
-
410
- Chỉ ghi trace khi task vừa thực hiện có `complexity >= medium` (theo `global.md` R-G-01), hoặc khi task có `side_effects` khác `read_only` (nghĩa là có khả năng ảnh hưởng hệ thống thật). Task đọc-hiểu đơn giản (fast-path, complexity `low`, `read_only`) **không bắt buộc** ghi trace — tránh phình `evals/traces/` với dữ liệu ít giá trị (đúng tinh thần `token_budget.stop_early`).
411
-
412
- ### Bước 2 — Thu thập dữ liệu quan sát trong lúc chạy task chính
413
-
414
- Trong lúc skill khác (không phải chính observability) thực thi, thu thập các tín hiệu sau — không cần thêm shell command nào (`max_shell_commands: 0`), chỉ đọc lại chính transcript/tool-call history của phiên:
415
-
416
- | Field cần thu thập | Lấy từ đâu |
417
- |---|---|
418
- | `skill_used`, `skill_candidates_considered` | Bước retrieval path (`global.md` R-G-05) |
419
- | `routing.selected_on_first_try`, `clarification_asked`, `skill_switched_mid_task` | Diễn biến thực tế của phiên |
420
- | `boundary.anti_pattern_violations`, `out_of_scope_edits`, `violated_rule_ids` | Đối chiếu file đã sửa với `coding.md` R-C-09 và `global.md` R-G-03 |
421
- | `token_budget.actual_files_read`, `actual_shell_commands` | Đếm số lần gọi `view`/`bash` thực tế trong phiên |
422
- | `zero_trust.*` | Có gặp nội dung nghi injection không, có báo cáo không (`security.md` R-SEC-04) |
423
- | `exit_code` | Exit code thật của task chính (`global.md` R-G-06) |
424
-
425
- ### Bước 3 — Ghi file trace
426
-
427
- Ghi 1 file JSON vào `evals/traces/{yyyy-mm-dd}_{task-slug}.json`, đúng cấu trúc `evals/traces/TRACE_SCHEMA.md`. Để `final_score: null` — **KHÔNG** tự tính điểm ở bước này (thuộc về `qk-validation-gate`).
428
-
429
- ### Bước 4 — Phát hiện pattern lỗi lặp lại (Failure Pattern Detection)
430
-
431
- Nếu `evals/traces/` đã có ≥ 3 trace gần nhất cùng `skill_used` với `routing.selected_on_first_try: false` hoặc `boundary.anti_pattern_violations > 0`, đánh dấu cảnh báo trong report cuối: skill đó có dấu hiệu cần xem lại `decision_boundary` hoặc bổ sung tài liệu tham chiếu (theo `demotion_gate.triggers: repeated_failure`).
432
-
433
- ---
434
-
435
- ## Output Format
436
-
437
- ```
438
- 📊 Observability Trace Recorded
439
- ─────────────────────────────────────────────────
440
- Session: [session_id]
441
- Skill used: [skill_used]
442
- Trace file: evals/traces/[filename].json
443
-
444
- Signals ghi nhận:
445
- Routing: [selected_on_first_try / clarification / switched]
446
- Boundary: [N vi phạm | 0 vi phạm]
447
- Token budget: [actual/declared files_read]
448
- Zero-trust: [injection detected & reported | không có injection | KHÔNG phát hiện]
449
-
450
- ⚠️ Failure pattern: [nếu có, nêu skill nào cần review]
451
-
452
- Exit Code: SUCCESS
453
- ```
454
-
455
- ---
456
-
457
- ## Exit Codes
458
-
459
- | Code | Khi nào |
460
- |---|---|
461
- | `SUCCESS` | Trace đã ghi thành công vào `evals/traces/` |
462
- | `BLOCKED` | Thiếu `scorecard.yaml` hoặc không xác định được `session_id`/`skill_used` |
463
- | `PARTIAL` | Ghi được trace nhưng thiếu một số field không bắt buộc (ví dụ không đếm được `actual_shell_commands` chính xác) |
464
- | `FAILED` | Không ghi được file (lỗi filesystem) |