mindcode 0.2.0__tar.gz → 0.3.2__tar.gz

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (100) hide show
  1. mindcode-0.3.2/PKG-INFO +351 -0
  2. mindcode-0.3.2/README.md +336 -0
  3. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/_version.py +1 -1
  4. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/approval.py +30 -5
  5. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/adapters/terminal_bench.py +6 -2
  6. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/__init__.py +14 -9
  7. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/commands/chat.py +2 -2
  8. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/commands/shell.py +16 -7
  9. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/shell/completion.py +2 -5
  10. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/shell/repl.py +284 -17
  11. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/shell/slash.py +199 -116
  12. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/shell/startup.py +2 -1
  13. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/shell/tui.py +37 -14
  14. mindcode-0.3.2/mindcode/policy.py +237 -0
  15. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/render.py +105 -52
  16. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/runtime.py +68 -69
  17. mindcode-0.3.2/mindcode.egg-info/PKG-INFO +351 -0
  18. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode.egg-info/SOURCES.txt +5 -0
  19. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode.egg-info/requires.txt +1 -1
  20. {mindcode-0.2.0 → mindcode-0.3.2}/pyproject.toml +2 -2
  21. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_approval.py +15 -4
  22. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_cli_commands.py +156 -29
  23. mindcode-0.3.2/tests/test_exec_command_guard.py +118 -0
  24. mindcode-0.3.2/tests/test_external_file_approval.py +199 -0
  25. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_policy_choice.py +37 -17
  26. mindcode-0.3.2/tests/test_provider_retry_defaults.py +77 -0
  27. mindcode-0.3.2/tests/test_reasoner_compat.py +108 -0
  28. mindcode-0.3.2/tests/test_render_exec.py +236 -0
  29. mindcode-0.3.2/tests/test_shell_channels.py +1401 -0
  30. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_shell_completion.py +34 -5
  31. mindcode-0.3.2/tests/test_shell_interrupt.py +167 -0
  32. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_shell_session.py +66 -1
  33. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_shell_tui.py +227 -6
  34. mindcode-0.3.2/tests/test_slash_resume.py +470 -0
  35. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_system_prompt.py +3 -1
  36. mindcode-0.2.0/PKG-INFO +0 -244
  37. mindcode-0.2.0/README.md +0 -229
  38. mindcode-0.2.0/mindcode/policy.py +0 -173
  39. mindcode-0.2.0/mindcode.egg-info/PKG-INFO +0 -244
  40. mindcode-0.2.0/tests/test_exec_command_guard.py +0 -86
  41. mindcode-0.2.0/tests/test_render_exec.py +0 -126
  42. mindcode-0.2.0/tests/test_shell_channels.py +0 -292
  43. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/__init__.py +0 -0
  44. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/__main__.py +0 -0
  45. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/__init__.py +0 -0
  46. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/adapters/__init__.py +0 -0
  47. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/adapters/base.py +0 -0
  48. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/adapters/mini_bfcl.py +0 -0
  49. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/adapters/mini_gaia.py +0 -0
  50. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/adapters/mini_terminal.py +0 -0
  51. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/adapters/swe_bench.py +0 -0
  52. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/fake_tools.py +0 -0
  53. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/jsonutil.py +0 -0
  54. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/paths.py +0 -0
  55. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/predictions.py +0 -0
  56. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/report.py +0 -0
  57. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/runner.py +0 -0
  58. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/schema.py +0 -0
  59. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/scorers/base.py +0 -0
  60. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/scorers/composite.py +0 -0
  61. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/scorers/exact.py +0 -0
  62. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/scorers/json_call.py +0 -0
  63. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/scorers/swe.py +0 -0
  64. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/scorers/terminal.py +0 -0
  65. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/scorers/terminal_bench.py +0 -0
  66. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/trace.py +0 -0
  67. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/bench/workspace.py +0 -0
  68. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/_shared.py +0 -0
  69. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/commands/__init__.py +0 -0
  70. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/commands/bench.py +0 -0
  71. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/commands/config_cmd.py +0 -0
  72. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/commands/remote.py +0 -0
  73. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/commands/status.py +0 -0
  74. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/commands/task.py +0 -0
  75. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/commands/terminal.py +0 -0
  76. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/shell/__init__.py +0 -0
  77. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/cli/shell/menu.py +0 -0
  78. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/config.py +0 -0
  79. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/mcp.py +0 -0
  80. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/remote.py +0 -0
  81. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/skills.py +0 -0
  82. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/subagents.py +0 -0
  83. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/tasking.py +0 -0
  84. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/terminal/__init__.py +0 -0
  85. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/terminal/__main__.py +0 -0
  86. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode/terminal_core.py +0 -0
  87. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode.egg-info/dependency_links.txt +0 -0
  88. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode.egg-info/entry_points.txt +0 -0
  89. {mindcode-0.2.0 → mindcode-0.3.2}/mindcode.egg-info/top_level.txt +0 -0
  90. {mindcode-0.2.0 → mindcode-0.3.2}/setup.cfg +0 -0
  91. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_bench.py +0 -0
  92. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_config.py +0 -0
  93. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_diff_capture.py +0 -0
  94. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_policy_timeout.py +0 -0
  95. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_remote.py +0 -0
  96. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_skills_mcp.py +0 -0
  97. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_subagents.py +0 -0
  98. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_task_resume.py +0 -0
  99. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_tasking.py +0 -0
  100. {mindcode-0.2.0 → mindcode-0.3.2}/tests/test_terminal.py +0 -0
@@ -0,0 +1,351 @@
1
+ Metadata-Version: 2.4
2
+ Name: mindcode
3
+ Version: 0.3.2
4
+ Summary: codex-style interactive coding agent on top of mindagent
5
+ Author: mindcode
6
+ License: MIT
7
+ Requires-Python: >=3.10
8
+ Description-Content-Type: text/markdown
9
+ Requires-Dist: mindagent>=0.5.0
10
+ Requires-Dist: rich>=13
11
+ Requires-Dist: openai>=1.0
12
+ Requires-Dist: python-dotenv>=1.0
13
+ Requires-Dist: typer>=0.12
14
+ Requires-Dist: prompt-toolkit>=3.0.30
15
+
16
+ # mindcode
17
+
18
+ 一个能够自我进化的交互式 Coding Agent CLI,构建在 [mindagent](../) 之上。
19
+
20
+ ## 核心能力
21
+
22
+ - workspace 内的代码读取、编辑和命令执行
23
+ - 交互式会话与一次性任务
24
+ - 可选 master/coder subagent 协作(`--subagents`)
25
+ - 支持注入 Skills 与 MCP server 工具(`build_runtime(..., skills=..., mcp_clients=...)`)
26
+ - 前台/后台任务记录和进程重启后的语义恢复
27
+ - 本地持久终端和 SSH 远程命令
28
+ - mini、SWE-bench 和 Terminal-Bench 评测入口
29
+ - 配套 VS Code 聊天插件(`vscode-extension/`)
30
+
31
+ ## 特性
32
+
33
+ - **顶层 Agent 入口**:`mindcode [PROMPT] [选项]` 直接进入交互或 one-shot 模式;`chat` / `status` / `config` 等保留为公开子命令
34
+ - **可选 Subagent 模式**:`mindcode --subagents` 启用受限的 master/coder 协作;master 仅能委派,coder 才能访问 workspace
35
+ - 全屏 TUI:顶部 logo/会话信息、可滚动 Markdown 消息区、固定带边框多行输入框与状态栏
36
+ - 顶部信息栏显示本会话累计 token 消耗;provider 未返回 usage 时显示 `tokens —`
37
+ - Rich 富渲染:Markdown、彩色工具面板、file_edit diff 高亮和流式 LLM 输出
38
+ - TUI 内选择菜单:`/models`、`/permissions` 用方向键选择
39
+ - REPL 权限模式:`ask_user`(默认,写入和危险操作逐项询问)/ `full_accept`(接受权限上限内的操作风险)
40
+ - 会话持久化与恢复:基于 `LocalConversationStore`,存到 `~/.cache/mindcode/sessions/`
41
+ - OpenAI-compatible Provider 配置:首次启动时在 `~/.cache/mindcode/config.toml` 生成 rotor 示例
42
+ - 丰富 slash 命令:`/models` `/compact` `/permissions` `/status` `/resume` `/clear` `/help` `/exit`
43
+
44
+ ## VS Code 插件
45
+
46
+ 与 CLI 配套的 VS Code 聊天插件位于 [`vscode-extension/`](vscode-extension/)。
47
+ 进入该目录并按其 README 构建后,可在 VS Code 中按 `F5` 启动 Extension Development Host。
48
+
49
+ ```bash
50
+ cd vscode-extension
51
+ npm install # 首次
52
+ npm run build:all # 构建 webview 与插件
53
+ npm test # vitest 单测
54
+ ```
55
+
56
+ ## 安装
57
+
58
+ 要求 Python >= 3.10,且父项目 `mindagent` 已经以 editable 模式安装:
59
+
60
+ ```bash
61
+ cd /path/to/mindagent
62
+ pip install -e ".[openai]"
63
+ ```
64
+
65
+ 然后安装 mindcode:
66
+
67
+ ```bash
68
+ cd app/mindcode
69
+ pip install -e .
70
+
71
+ mindcode --version # 0.3.1
72
+ ```
73
+
74
+ ## 文档
75
+
76
+ - `docs/command.md` — TUI slash 命令规范(状态合同:Implemented / Removed / Proposed / Blocked)
77
+ - `docs/usage.md` — 配置与日常命令示例
78
+ - `docs/design/architecture.md` — 架构设计
79
+ - `docs/devlog/` — 需求、roadmap 与各功能设计记录
80
+ - `docs/wiki/` — channels、remote、terminal sessions 等专题
81
+ - `docs/buglist.md` — 已知问题清单
82
+ - `../../docs/guides/policies-and-approval.md` — mindagent 侧策略与审批详解
83
+
84
+ ## 命令结构
85
+
86
+ ```
87
+ mindcode [PROMPT] [选项] # 交互式 REPL;提供 PROMPT 时为 one-shot
88
+ mindcode chat -m "..." [选项] # 一次性 prompt(参数与顶层入口基本一致)
89
+ mindcode status # 显示全局状态
90
+ mindcode task <subcmd> # 任务:run / resume / list / status / tail / cancel
91
+ mindcode terminal <subcmd> # 本地终端:open / new / list / send / tail / close
92
+ mindcode remote <subcmd> # SSH 远程:add / list / show / remove / exec / tail
93
+ mindcode bench <subcmd> # 评测:list / run / report / inspect / swe-eval / terminal-eval
94
+ mindcode config <subcmd> # 配置管理
95
+ mindcode config providers # 列出所有 provider
96
+ mindcode config models <provider> # 列出 provider 的模型
97
+ mindcode config models-set <p> ... # 设置 model_list;第一个模型成为 default_model
98
+ mindcode config api-key <p> <k> # 设置 api_key
99
+ mindcode config get <p> <field> # 读取字段
100
+ mindcode config set <p> <f> <v> # 修改字段
101
+ mindcode config list # 显示完整配置(脱敏)
102
+ mindcode config path # 显示配置文件路径
103
+ mindcode --version
104
+ mindcode --help
105
+ ```
106
+
107
+ ## 配置
108
+
109
+ 首次启动 `mindcode` 会自动在 `~/.cache/mindcode/config.toml` 创建一个
110
+ OpenAI-compatible rotor 示例。默认地址是本机 `http://127.0.0.1:8000/v1`,使用前应按实际网关修改。
111
+
112
+ 模板节选:
113
+
114
+ ```toml
115
+ default_provider = "rotor"
116
+
117
+ [providers.rotor]
118
+ protocol = "openai"
119
+ api_key = ""
120
+ base_url = "http://127.0.0.1:8000/v1"
121
+ default_model = "glm-5.2"
122
+ models = ["glm-5.2", "glm-5.1", "glm-4.7"]
123
+ ```
124
+
125
+ ### 方式 A:命令行(脚本化)
126
+
127
+ ```bash
128
+ mindcode config api-key rotor sk-xxxxxxxxxxxx # 设置密钥
129
+ mindcode config providers # 列出所有 provider
130
+ mindcode config models rotor # 列出 rotor 的模型
131
+ mindcode config set rotor default_model glm-5.1
132
+ mindcode config list # 完整配置(脱敏)
133
+ ```
134
+
135
+ ### 方式 B:REPL 内 slash 命令(交互式)
136
+
137
+ ```
138
+ /models # 方向键选择切换
139
+ /compact # 生成摘要以压缩会话上下文
140
+ /permissions # Ask User / Full Accept
141
+ /resume # 列出并恢复本地保存的历史 session
142
+ /status # 当前历史 session 状态与上下文使用
143
+ /help # 完整命令列表
144
+ ```
145
+
146
+ 也可直接编辑 `~/.cache/mindcode/config.toml`。
147
+
148
+ ## 使用
149
+
150
+ ### 一次性模式
151
+
152
+ ```bash
153
+ mindcode chat -m "读取 README.md 的前 5 行并总结"
154
+ # 或
155
+ mindcode "读取 README.md 的前 5 行并总结"
156
+ # 需要 master/coder 协作时(默认仍为单 agent)
157
+ mindcode --subagents "审查当前改动并运行相关测试"
158
+ ```
159
+
160
+ ### 交互模式
161
+
162
+ - `Enter` 发送;`Esc` + `Enter` 插入换行;多行输入框会自动增高。
163
+ - 输入 `/` 显示全部 slash 命令;继续输入会筛选。`↑` / `↓` 选择,`Enter` 先填入默认第一项,再按一次才执行。
164
+ - `/models` 与 `/permissions` 使用统一的灰阶选择框:`↑` / `↓` 切换,`Enter` 应用,`Esc` 取消;需要自由输入参数时仍在底部输入框内编辑和粘贴。
165
+ - `Page Up` / `Page Down` 或鼠标滚轮滚动消息;`End` 回到底部。
166
+ - 鼠标拖选消息会复制所选文本;`Ctrl` + `Y` 复制最新一条助手回复。
167
+ - 单行文字在输入框和用户消息卡片内上下居中;多行内容向下撑开。
168
+ - 用户消息会以与输入框相同的边框卡片进入对话,助手消息保留 Markdown 排版。
169
+ - Agent 运行时显示 `Working…`,输入框仍可提交后续消息并按顺序排队。
170
+ - 工具状态使用简洁标签:`Edit`、`Command`、`Read`、`Search`、`Context`、`Memory`、`Image`、`Time`、`Calculate`、`Delegate`;完成或失败时原地更新。
171
+
172
+ ```bash
173
+ mindcode # 默认进 shell
174
+ › 在 workspace 创建 hello.txt 写入 hi
175
+ › file_edit (create) hello.txt [WRITE]
176
+ ask_user 将在执行前询问;也可切换到 /permissions full_accept
177
+ ┌─ diff: hello.txt ──────────────────────┐
178
+ │ +hi │
179
+ └─────────────────────────────────────────┘
180
+ › /resume
181
+ › /exit
182
+ ```
183
+
184
+ ### 恢复会话
185
+
186
+ ```bash
187
+ mindcode -r sess-1718530000
188
+ › 我刚才创建了什么文件?
189
+ ```
190
+
191
+ ### 顶层 `mindcode` 参数
192
+
193
+ ```
194
+ mindcode [PROMPT] [-w WORKSPACE] [-a {ask_user,full_accept}]
195
+ [-p PROVIDER] [-m MODEL]
196
+ [-r SESSION_ID] [-s SESSION_ID] [--no-stream] [--subagents]
197
+ [--max-steps N] [--step-timeout SECONDS]
198
+ [--total-timeout SECONDS]
199
+ ```
200
+
201
+ | 参数 | 说明 |
202
+ |---|---|
203
+ | `PROMPT` | 一次性 prompt;省略进入交互模式 |
204
+ | `-w, --workspace` | workspace 根目录(默认 `.`) |
205
+ | `-a, --approve-mode` | 权限模式:`ask_user`(默认,写入和危险操作逐项询问)或 `full_accept`(接受权限上限内的操作风险);`ask`/`full`/`auto` 为兼容别名 |
206
+ | `-p, --provider` | 覆盖 config.toml 中的 default_provider |
207
+ | `-m, --model` | 覆盖 provider 中的 default_model |
208
+ | `-r, --resume` | 恢复指定 session_id |
209
+ | `-s, --session` | 指定新 session_id |
210
+ | `--no-stream` | 关闭流式输出 |
211
+ | `--subagents` | 启用 master/coder 委派模式。master 只允许 `agent_delegate`,coder 负责 workspace 工具调用;委派固定等待结果,不会启动后台任务。 |
212
+ | `--max-steps` | 单个 run 的最大 ReAct step 数(默认 50) |
213
+ | `--step-timeout` | 单步超时秒数(默认 300);`0` 表示禁用 |
214
+ | `--total-timeout` | 绝对总时长上限;普通单代理交互默认禁用,one-shot/Subagent 默认 1800 秒;`0` 表示禁用 |
215
+
216
+ ## 常用命令示例
217
+
218
+ ### task(可后台运行、可恢复)
219
+
220
+ ```bash
221
+ mindcode task run "重构 tests/test_config.py 并保持测试通过" -w /path/to/proj
222
+ mindcode task run "长任务..." --background # 后台运行(-b)
223
+ mindcode task list # 列出任务
224
+ mindcode task status <task_id> # 查看单个任务状态
225
+ mindcode task tail <task_id> -n 50 # 查看最近事件;-f 持续追踪
226
+ mindcode task resume <task_id> -m "继续完成剩余步骤" # 追加消息后语义恢复
227
+ mindcode task cancel <task_id> # 取消任务
228
+ ```
229
+
230
+ ### terminal(本地持久终端)
231
+
232
+ ```bash
233
+ mindcode terminal new # 新建持久终端 session
234
+ mindcode terminal list # 列出 session
235
+ mindcode terminal send <id> "npm test" # 向 session 写入命令
236
+ mindcode terminal tail <id> -n 40 # 查看输出;-f 持续追踪
237
+ mindcode terminal close <id> # 关闭 session
238
+ mindcode terminal open -C /path/to/proj # 在 Ghostty.app 中打开目录
239
+ ```
240
+
241
+ ### remote(SSH 远程)
242
+
243
+ ```bash
244
+ mindcode remote add prod --host root@10.0.0.5 --workdir /srv/app
245
+ mindcode remote add pi --host pi@192.168.1.20 --workdir ~ --port 2222 --key ~/.ssh/id_ed25519
246
+ mindcode remote list # 列出 remote
247
+ mindcode remote show prod # 查看配置(脱敏)
248
+ mindcode remote exec prod "systemctl status app" # 远程执行命令
249
+ mindcode remote tail prod /var/log/app.log -n 80 --follow # 追踪远程日志
250
+ mindcode remote remove prod # 删除 remote
251
+ ```
252
+
253
+ ### bench(评测)
254
+
255
+ ```bash
256
+ mindcode bench list # 列出 suite 与 case 数
257
+ mindcode bench run --suite mini_gaia --limit 5 # 运行评测
258
+ mindcode bench report <run_id> # 汇总评分
259
+ mindcode bench inspect <run_id> # 查看逐 case 详情
260
+ mindcode bench swe-eval --predictions pred.jsonl # SWE-bench 官方评测
261
+ mindcode bench terminal-eval --dataset ./tasks # Terminal-Bench 评测
262
+ ```
263
+
264
+ 内置 suite:`mini_bfcl`、`mini_gaia`、`mini_terminal`(仓库 `benchmarks/` 自带 mini cases)、
265
+ `swe_bench`、`terminal_bench`。run 产物默认写入 `bench_runs/`。
266
+
267
+ ## 测试
268
+
269
+ ```bash
270
+ # 仓库根目录执行
271
+ PYTHONPATH=src:app/mindcode python -m pytest -q app/mindcode/tests
272
+
273
+ # 或在 app/mindcode 目录内
274
+ python -m pytest -q
275
+ ```
276
+
277
+ ## 模块结构
278
+
279
+ ```
280
+ mindcode/
281
+ ├── _version.py # __version__, __logo__
282
+ ├── config.py # MindcodeConfig + ProviderConfig + load/save
283
+ ├── config/ # 内置 model.toml / settings.toml 模板
284
+ ├── runtime.py # build_runtime / build_master_worker_system + DiffingFileEditTool
285
+ ├── approval.py # 审批描述、shell 审批与外部文件只读授权回调
286
+ ├── subagents.py # MasterWorkerSystem 生命周期边界
287
+ ├── policy.py # ApprovalMode + AskUserPolicy/FullAcceptPolicy + ActionAuthorizer
288
+ ├── render.py # RichRenderer(event handler,TUI 工具面板渲染)
289
+ ├── skills.py # Skill / SkillRegistry / SkillLoader(front-matter 指令块)
290
+ ├── mcp.py # MCPClient 协议 + MCPToolAdapter
291
+ ├── tasking.py # TaskStore / TaskEventRecorder(本地任务记录与事件持久化)
292
+ ├── terminal_core.py # TerminalManager + worker 协议(本地持久终端)
293
+ ├── terminal/ # python -m mindcode.terminal 终端 worker 入口
294
+ ├── remote.py # RemoteStore + SSHCommandBuilder + RemoteExecutor
295
+ ├── bench/ # benchmark adapters、runner、scorers、report
296
+ └── cli/
297
+ ├── __init__.py # typer app + DefaultShellGroup(顶层默认入口)
298
+ ├── _shared.py # 共享 console + find_config_file
299
+ ├── commands/
300
+ │ ├── shell.py # 顶层 `mindcode` 默认入口 handler
301
+ │ ├── chat.py # `mindcode chat -m "..."`
302
+ │ ├── status.py # `mindcode status`
303
+ │ ├── config_cmd.py # `mindcode config providers/models/api-key/models-set/...`
304
+ │ ├── task.py # `mindcode task run/resume/list/status/tail/cancel`
305
+ │ ├── terminal.py # `mindcode terminal open/new/list/send/tail/close`
306
+ │ ├── remote.py # `mindcode remote add/list/show/remove/exec/tail`
307
+ │ └── bench.py # `mindcode bench list/run/report/inspect/swe-eval/terminal-eval`
308
+ └── shell/
309
+ ├── repl.py # Shell 类 + REPL 主循环
310
+ ├── slash.py # slash 命令注册与分发
311
+ ├── completion.py # `/` 前缀补全与筛选
312
+ ├── tui.py # 全屏布局、Markdown 消息流与状态栏
313
+ ├── menu.py # interactive_menu(ChoiceInput 包装)
314
+ └── startup.py # build_welcome_banner(Rich Panel)
315
+ ```
316
+
317
+ ## 设计要点
318
+
319
+ - `DiffingFileEditTool` 包装 mindagent 的 `FileEditTool`,在调用前后捕获文件内容,生成 unified diff 注入到 `Observation.result["mindcode_diff"]`。
320
+ - diff 渲染监听 `OBSERVATION_CREATED` 事件而非 `ACTION_FINISHED`,因为 result payload 只在前者。
321
+ - REPL 的 `/permissions` 通过重建当前 runtime 切换 `ask_user` 与 `full_accept`;前者对写入和危险操作逐项询问,后者接受权限上限内的操作风险,切换只影响当前会话。
322
+ - typer app 用自定义 `TyperGroup.parse_args`:无公开子命令时自动注入隐藏的内部 Shell handler,顶层 `mindcode` 因而复用完整参数解析;旧的 `mindcode shell` 语法会返回迁移提示。
323
+ - 全屏 TUI 用 Prompt Toolkit 管理固定输入框和消息视口;Rich 负责 Markdown 与工具输出渲染。
324
+ - ChoiceInput 失败时(旧版 prompt_toolkit)会自动 fallback 到序号输入。
325
+
326
+ ## 文件访问与审批
327
+
328
+ - `SessionPolicy` 与 `RunConfig` 是 Core 检查的权限上限,自定义 Policy、审批回调与
329
+ `full_accept` 都不能绕过。纯 Policy 判断范围,`MindCodeActionAuthorizer` 负责等待 UI。
330
+ - `ask_user` 与 `full_accept` 读取 workspace 外文件时,都需要确认精确路径的此次只读
331
+ 访问。授权绑定 session/run/action、完整参数及文件对象,默认 120 秒内有效且只消费
332
+ 一次;写入、编辑与外部命令工作目录不适用。
333
+ - SDK 可为 `build_runtime()` / `build_master_worker_system()` 注入
334
+ `file_access_callback(context, request)`,返回绑定 `request_id` 的
335
+ `ExternalFileReadDecision`。普通 `approval_callback` 或聊天中的“允许”不能签发它。
336
+ - 外部文件授权审计默认保存在内存,可通过 `file_access_audit_sink(event)` 接入宿主
337
+ 持久化;运行结束会清理未消费的授权,不自动新增磁盘审计文件。
338
+ - 普通问答使用 `USER_INPUT_REQUIRED` 与 `submit_user_input()`;旧 `approve_run()`
339
+ 因未绑定授权请求而被拒绝。
340
+ - `exec_command` 只限制 `cwd`,不会隔离子进程访问的文件。`sed`、`find`、`git diff`
341
+ 等命令保守按写风险审批,具体范围见
342
+ [策略与权限](../../docs/guides/policies-and-approval.md)。
343
+
344
+ ## 局限
345
+
346
+ - 不支持 `/undo`:`exec_command` 的副作用可能不可逆,回滚复杂。
347
+ - 会话恢复只续聊 user/assistant 历史,不恢复 TaskState / Evidence / pending continuation。
348
+ - `task resume` 是重新观察 workspace 后创建新 Run,不会重放未确认的旧 Action。
349
+ - 后台任务目前依赖本机 PID;不提供跨主机监督或精确进程身份恢复。
350
+ - `bench run` 第一版仅支持串行(concurrency=1);`exec_command` 无沙箱,
351
+ SWE-bench / Terminal-Bench 评测依赖本机对应的评测环境。