openspec-playwright 0.3.82 → 0.3.83
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/employee-standards.md +6 -11
- package/package.json +1 -1
package/employee-standards.md
CHANGED
|
@@ -49,8 +49,6 @@
|
|
|
49
49
|
## 2. 工具使用
|
|
50
50
|
|
|
51
51
|
**工具调用纪律(防循环)🔴**
|
|
52
|
-
- 🔴 一次只发一个工具调用,等结果再决定下一步;等待/轮询用单个调用内部的循环实现
|
|
53
|
-
- 🔴 单条消息并行只用于真正独立的调用,禁止复制相同调用
|
|
54
52
|
- 🔴 发现自己正在重复生成相同调用 → 立即停止,重新评估
|
|
55
53
|
- 🟡 长会话接近上下文上限时,复杂任务前先压缩上下文
|
|
56
54
|
|
|
@@ -112,29 +110,26 @@
|
|
|
112
110
|
> WHY:测试的价值在验证行为,不在覆盖率数字;截图证明像素,不证明行为。AI 用琐碎单测堆数量冒充完成度——生成烧 token、套件拖慢反馈,验收结果才决定能否交付。
|
|
113
111
|
|
|
114
112
|
**触发:改了用户可见可交互的东西,就必须在浏览器里证明**
|
|
115
|
-
- 🔴 改 DOM/交互/跳转/异步渲染/样式/响应式,或守卫/权限/多角色可见性 →
|
|
113
|
+
- 🔴 改 DOM/交互/跳转/异步渲染/样式/响应式,或守卫/权限/多角色可见性 → 浏览器验证;纯逻辑 → 按下方单测取舍,不开浏览器
|
|
116
114
|
|
|
117
115
|
**单测——命中才测,宁缺毋滥**
|
|
118
116
|
- 🟡 值得单测:业务核心计算/状态转换、含分支的纯函数、边界与错误处理路径、被多处复用的工具、修过 bug 的回归。不值得:纯透传、getter/装饰器/样板、类型系统已保证的行为、框架自带行为;模糊地带默认测(漏测代价 > 多测代价),一个行为一组断言,不拆场景凑数
|
|
119
117
|
- 🔴 验收标准点名的行为与业务核心逻辑必须被某层测试覆盖(单测或验收测试,一层即可,不重复堆);不以本条为由跳过/删除既有测试
|
|
120
|
-
- 🟡
|
|
118
|
+
- 🟡 分层反馈:单测随手跑(秒级);验收测试提交前实跑即可(分钟级)
|
|
121
119
|
|
|
122
120
|
**验收——对照 spec 验收标准的真实行为验证,层级由被验对象决定**
|
|
123
|
-
- 🔴 后端/服务 → 对真实运行的服务发真实请求验证契约与端到端行为,不以全 mock
|
|
124
|
-
-
|
|
125
|
-
- 🟡 集成测试用真实数据/依赖(seed/fixture,遵守 §4);期望锚定 spec 写「预期 X,实测 Y」(同下方自检 A),不自定期望
|
|
121
|
+
- 🔴 后端/服务 → 对真实运行的服务发真实请求验证契约与端到端行为,不以全 mock 的单测链冒充验收,落成集成测试;前端/用户可见 → 浏览器自检 + Playwright 交付测试(A/B)
|
|
122
|
+
- 🟡 集成测试用真实数据/依赖(seed/fixture,遵守 §4);所有验收验证(集成 + 浏览器自检)期望锚定 spec/验收标准写「预期 X,实测 Y」,不自定期望
|
|
126
123
|
|
|
127
124
|
**A. 自检(浏览器,开发中 AI 验证,不留测试代码)**
|
|
128
125
|
- 🔴 截图 ≠ 行为验证:交互必须验证结果(点击后的状态/跳转/渲染),仅截图不算通过
|
|
129
126
|
- 🟡 验证前核对加载的是本次产物(清缓存/停用 SW/核 hash)——跑旧包验证作废
|
|
130
|
-
- 🟡 权限类禁止注入 token
|
|
131
|
-
- 🟡 期望锚定 spec/验收标准写「预期 X,实测 Y」,不自定期望
|
|
127
|
+
- 🟡 权限类禁止注入 token(守卫未执行,验证作废),必须真实登录态;多角色各角色单独登录验证
|
|
132
128
|
- 🟡 异步渲染显式等到元素可见稳定再验证;控制台无 error、网络无 4xx/5xx/加载失败
|
|
133
129
|
|
|
134
130
|
**B. 交付(正式 Playwright 测试,提交前实跑)**
|
|
135
131
|
- 🔴 有验证价值的浏览器路径写成 Playwright 测试;临时开浏览器「看着没问题」不算完成
|
|
136
132
|
- 🔴 测试必须断言交互结果;`toBeVisible` 等存在性断言只作辅助
|
|
137
|
-
- 🟡
|
|
138
|
-
- 🟡 无法覆盖的路径说明理由;skip/fixme 必附理由
|
|
133
|
+
- 🟡 提交前实跑且通过才算完成;无法覆盖的路径(skip/fixme)必附理由
|
|
139
134
|
- 🟡 稳定选择器(data-testid/role);Healer 只消 flaky,不得掩盖断言失败
|
|
140
135
|
- 🔴 含断言的临时脚本转正为对应层级的测试(浏览器→Playwright、服务→API 集成测试)或删除
|