expert_eval_cli 2.0.0 → 2.0.1
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/dist/index.js +1 -1
- package/package.json +1 -1
- package/skill/SKILL.md +86 -5
package/dist/index.js
CHANGED
|
@@ -13,7 +13,7 @@ function createProgram() {
|
|
|
13
13
|
program
|
|
14
14
|
.name('expert_eval')
|
|
15
15
|
.description('AI-friendly CLI for ExpertEval API')
|
|
16
|
-
.version('2.0.
|
|
16
|
+
.version('2.0.1')
|
|
17
17
|
.option('--format <type>', 'Output format: json, csv, table, or auto (default: auto)', 'auto')
|
|
18
18
|
.option('-q, --quiet', 'Suppress output (exit codes only)', false);
|
|
19
19
|
program.addCommand((0, auth_js_1.makeAuthCommand)());
|
package/package.json
CHANGED
package/skill/SKILL.md
CHANGED
|
@@ -1,16 +1,46 @@
|
|
|
1
1
|
---
|
|
2
2
|
name: expert-eval-cli
|
|
3
|
-
version: "
|
|
3
|
+
version: "2.0.1"
|
|
4
4
|
description: >
|
|
5
|
-
ExpertEval CLI
|
|
6
|
-
|
|
7
|
-
|
|
5
|
+
ExpertEval CLI 工具技能:帮助用户安装、更新和使用 expert_eval_cli,完成 API Key 认证、
|
|
6
|
+
环境切换、专家管理、版本包上传与解析、评测任务创建/查询、评测记录单条或批量回写、
|
|
7
|
+
评测账号领取/释放等操作。适用于 ExpertEval、专家评估、评测任务、评测记录、版本管理、
|
|
8
|
+
agent.json/agent.yml/skills.json 上传、评测账号管理等场景。
|
|
8
9
|
---
|
|
9
10
|
|
|
10
11
|
# ExpertEval CLI 技能
|
|
11
12
|
|
|
12
13
|
本技能帮助用户和 AI Agent 使用 `expert_eval_cli` 命令行工具与 ExpertEval API 交互。
|
|
13
14
|
|
|
15
|
+
## 能力介绍
|
|
16
|
+
|
|
17
|
+
当用户需要操作 ExpertEval 平台时,使用本技能调用 `expert_eval` CLI 完成端到端任务。核心能力包括:
|
|
18
|
+
|
|
19
|
+
- **安装与升级**:安装、更新 `expert_eval_cli`,并校验 `expert_eval --version`。
|
|
20
|
+
- **认证管理**:通过环境变量或本地配置文件保存 API Key,支持查看认证状态与登出。
|
|
21
|
+
- **环境切换**:支持线上环境和开发环境 Base URL,通过环境变量或登录参数切换。
|
|
22
|
+
- **专家管理**:查询、创建、更新、删除专家;支持按关键词和状态筛选;可拉取专家原始 `agent.json` / `agent.yml`。
|
|
23
|
+
- **版本管理**:查询、获取、创建、删除版本;支持上传 ZIP 包,也支持直接传入解析后的 `agent.json`、`agent.yml`、`skills.json`。
|
|
24
|
+
- **评测任务管理**:查询、创建、获取详情、删除评测任务;详情包含版本、记录和用例信息;可拉取任务对应的被测 Agent Card。
|
|
25
|
+
- **评测记录回写**:按任务查询评测记录,单条更新状态/评论/证据,或通过 JSON/文件批量更新记录。
|
|
26
|
+
- **评测账号管理**:查询 ready/running 账号,领取评测账号并在完成后释放回 ready。
|
|
27
|
+
- **Agent 友好输出**:非 TTY 默认 JSON 输出,支持 `--format json|csv|table|auto` 与 `--quiet`,便于自动化解析和流水线集成。
|
|
28
|
+
|
|
29
|
+
## 适用场景
|
|
30
|
+
|
|
31
|
+
- 用户提到 ExpertEval、专家评估、专家/版本/评测任务/评测记录/评测账号。
|
|
32
|
+
- 用户需要创建或维护专家条目、上传专家版本包、发起评测、查看评测进度。
|
|
33
|
+
- 用户需要读取评测任务记录,并把评测结论、评论、证据链接回写到平台。
|
|
34
|
+
- 用户需要为自动化 Agent/CI 脚本配置 ExpertEval API Key、Base URL 或 JSON 输出。
|
|
35
|
+
|
|
36
|
+
## 使用原则
|
|
37
|
+
|
|
38
|
+
1. 优先使用 `--format json` 获取机器可读输出,除非用户明确需要表格或 CSV。
|
|
39
|
+
2. 需要认证时优先使用 `EXPERT_EVAL_API_KEY` 环境变量;交互式长期使用可通过 `expert_eval auth login` 写入本地配置。
|
|
40
|
+
3. 上传版本时,如已有本地 ZIP,优先使用 `--package-zip-file`;如已有解析产物,可直接使用 `--agent-json-file`、`--agent-yaml-file`、`--skill-json-file`。
|
|
41
|
+
4. 回写评测记录前,应先查询记录 ID 和现有状态,避免误更新。
|
|
42
|
+
5. 对批量更新,优先使用 `--records-file`,便于审计和重试。
|
|
43
|
+
|
|
14
44
|
## 安装与更新
|
|
15
45
|
|
|
16
46
|
### 首次安装
|
|
@@ -105,24 +135,46 @@ expert_eval --format json experts list
|
|
|
105
135
|
expert_eval experts list | cat
|
|
106
136
|
```
|
|
107
137
|
|
|
138
|
+
全局选项:
|
|
139
|
+
|
|
140
|
+
```bash
|
|
141
|
+
expert_eval --format json # 强制 JSON 输出
|
|
142
|
+
expert_eval --format csv # 强制 CSV 输出
|
|
143
|
+
expert_eval --format table # 强制表格输出
|
|
144
|
+
expert_eval --format auto # 自动选择输出格式(默认)
|
|
145
|
+
expert_eval -q # 静默模式,仅依赖 exit code
|
|
146
|
+
```
|
|
147
|
+
|
|
108
148
|
### 常用操作速查
|
|
109
149
|
|
|
110
150
|
| 操作 | 命令 |
|
|
111
151
|
|---|---|
|
|
112
152
|
| 列出专家 | `expert_eval experts list` |
|
|
153
|
+
| 按条件查询专家 | `expert_eval experts list --page 1 --page-size 50 --keyword "AI" --status published` |
|
|
154
|
+
| 获取专家详情 | `expert_eval experts get exp-001` |
|
|
113
155
|
| 创建专家 | `expert_eval experts create --expert-id exp-001 --name "AI安全专家" --owner 1847292357012580 --status developing` |
|
|
114
156
|
| 更新专家 | `expert_eval experts update exp-001 --name "新名称" --status published` |
|
|
157
|
+
| 清空专家 owner/description | `expert_eval experts update exp-001 --clear-owner --clear-description` |
|
|
115
158
|
| 查看专家卡/YAML | `expert_eval experts agent-card exp-001` / `expert_eval experts agent-yaml exp-001` |
|
|
116
159
|
| 删除专家 | `expert_eval experts delete <expert-id>` |
|
|
117
160
|
| 列出版本 | `expert_eval versions list --expert-id exp-001` |
|
|
118
|
-
|
|
|
161
|
+
| 获取版本详情 | `expert_eval versions get <version-id>` |
|
|
162
|
+
| 上传 ZIP 创建版本 | `expert_eval versions create --expert-id exp-001 --package-zip-file ./pkg.zip --package-name pkg.zip` |
|
|
163
|
+
| 用解析产物创建版本 | `expert_eval versions create --expert-id exp-001 --agent-json-file ./agent.json --agent-yaml-file ./agent.yml --skill-json-file ./skills.json` |
|
|
164
|
+
| 删除版本 | `expert_eval versions delete <version-id>` |
|
|
165
|
+
| 查询评测任务 | `expert_eval eval-tasks list --expert-id exp-001 --status in_progress` |
|
|
119
166
|
| 创建评测任务 | `expert_eval eval-tasks create --version-id v-1 --name "v1 评测"` |
|
|
120
167
|
| 获取任务详情 | `expert_eval eval-tasks get <task-id>` |
|
|
121
168
|
| 获取任务记录 | `expert_eval eval-tasks records <task-id>` |
|
|
169
|
+
| 获取任务 Agent Card | `expert_eval eval-tasks agent-card <task-id>` |
|
|
170
|
+
| 删除评测任务 | `expert_eval eval-tasks delete <task-id>` |
|
|
122
171
|
| 列出评审记录 | `expert_eval eval-records list --eval-task-id task-1` |
|
|
123
172
|
| 修改评审记录 | `expert_eval eval-records update <record-id> --status passed --comment "通过"` |
|
|
173
|
+
| 清空记录评论/证据 | `expert_eval eval-records update <record-id> --clear-comment --clear-evidence` |
|
|
124
174
|
| 批量修改记录 | `expert_eval eval-records batch --records-file ./records.json` |
|
|
125
175
|
| 查询评测账号 | `expert_eval agent-accounts list --status ready` |
|
|
176
|
+
| 领取评测账号 | `expert_eval agent-accounts start agent-001` |
|
|
177
|
+
| 释放评测账号 | `expert_eval agent-accounts done agent-001` |
|
|
126
178
|
|
|
127
179
|
### 分页查询
|
|
128
180
|
|
|
@@ -130,6 +182,35 @@ expert_eval experts list | cat
|
|
|
130
182
|
|
|
131
183
|
```bash
|
|
132
184
|
expert_eval experts list --page 2 --page-size 20
|
|
185
|
+
expert_eval versions list --page 1 --page-size 50 --expert-id exp-001
|
|
186
|
+
expert_eval eval-tasks list --page 1 --page-size 50 --version-id v-1
|
|
187
|
+
```
|
|
188
|
+
|
|
189
|
+
### 状态枚举
|
|
190
|
+
|
|
191
|
+
- 专家状态:`developing`、`adjusting`、`published`、`paused`
|
|
192
|
+
- 评测任务状态:`pending`、`in_progress`、`failed`、`changes_requested`、`passed`
|
|
193
|
+
- 评测记录状态:`untested`、`passed`、`warning`、`failed`
|
|
194
|
+
- 评测账号状态:`ready`、`running`
|
|
195
|
+
|
|
196
|
+
### 批量回写记录格式
|
|
197
|
+
|
|
198
|
+
`eval-records batch` 支持 JSON 数组或 `{ "records": [...] }`:
|
|
199
|
+
|
|
200
|
+
```json
|
|
201
|
+
[
|
|
202
|
+
{
|
|
203
|
+
"id": "record-1",
|
|
204
|
+
"status": "passed",
|
|
205
|
+
"comment": "符合标准"
|
|
206
|
+
},
|
|
207
|
+
{
|
|
208
|
+
"id": "record-2",
|
|
209
|
+
"status": "failed",
|
|
210
|
+
"comment": "未满足验收标准",
|
|
211
|
+
"evidence": "https://example.com/evidence.png"
|
|
212
|
+
}
|
|
213
|
+
]
|
|
133
214
|
```
|
|
134
215
|
|
|
135
216
|
### 错误处理
|