@asterxsk/kiln 0.1.0 → 0.2.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (203) hide show
  1. package/LICENSE +21 -21
  2. package/README.md +170 -170
  3. package/agent/AGENTS.md +67 -67
  4. package/agent/README.md +5 -5
  5. package/agent/extensions/AGENTS.md +68 -68
  6. package/agent/extensions/ask-user/index.ts +418 -418
  7. package/agent/extensions/ask-user/package-lock.json +769 -769
  8. package/agent/extensions/ask-user/package.json +19 -19
  9. package/agent/extensions/ask-user/prompt.ts +45 -45
  10. package/agent/extensions/ask-user/tsconfig.json +7 -7
  11. package/agent/extensions/background-terminals/docs/implementation-guide.md +942 -942
  12. package/agent/extensions/background-terminals/index.ts +627 -627
  13. package/agent/extensions/background-terminals/manager.test.ts +735 -735
  14. package/agent/extensions/background-terminals/output.test.ts +109 -109
  15. package/agent/extensions/background-terminals/package-lock.json +769 -769
  16. package/agent/extensions/background-terminals/package.json +17 -17
  17. package/agent/extensions/background-terminals/prompt.test.ts +125 -125
  18. package/agent/extensions/background-terminals/ps.test.ts +82 -82
  19. package/agent/extensions/background-terminals/result-delivery.test.ts +44 -44
  20. package/agent/extensions/background-terminals/src/domain.ts +87 -87
  21. package/agent/extensions/background-terminals/src/manager.ts +907 -907
  22. package/agent/extensions/background-terminals/src/output.ts +84 -84
  23. package/agent/extensions/background-terminals/src/prompt.ts +142 -142
  24. package/agent/extensions/background-terminals/src/result-delivery.ts +27 -27
  25. package/agent/extensions/background-terminals/src/runtime.ts +36 -36
  26. package/agent/extensions/background-terminals/src/ui/output-view.ts +79 -79
  27. package/agent/extensions/background-terminals/src/ui/ps.ts +621 -621
  28. package/agent/extensions/background-terminals/tsconfig.json +7 -7
  29. package/agent/extensions/file-search/index.spec.ts +443 -443
  30. package/agent/extensions/file-search/index.ts +459 -459
  31. package/agent/extensions/file-search/package-lock.json +2253 -2253
  32. package/agent/extensions/file-search/package.json +23 -23
  33. package/agent/extensions/file-search/src/args.ts +122 -122
  34. package/agent/extensions/file-search/src/binaries.ts +422 -422
  35. package/agent/extensions/file-search/src/output.ts +126 -126
  36. package/agent/extensions/file-search/src/process.ts +146 -146
  37. package/agent/extensions/file-search/src/prompt.ts +52 -52
  38. package/agent/extensions/file-search/tsconfig.json +7 -7
  39. package/agent/extensions/modelconf/PLAN.md +915 -915
  40. package/agent/extensions/modelconf/index.ts +296 -296
  41. package/agent/extensions/modelconf/src/ui/ModelConfView.ts +1101 -1101
  42. package/agent/extensions/pi-web-access/CHANGELOG.md +690 -690
  43. package/agent/extensions/pi-web-access/LICENSE +21 -21
  44. package/agent/extensions/pi-web-access/README.md +470 -470
  45. package/agent/extensions/pi-web-access/SECURITY.md +5 -5
  46. package/agent/extensions/pi-web-access/activity.ts +101 -101
  47. package/agent/extensions/pi-web-access/auth-fetch.ts +148 -148
  48. package/agent/extensions/pi-web-access/brightdata-unlocker.ts +272 -272
  49. package/agent/extensions/pi-web-access/chrome-cookies.ts +669 -669
  50. package/agent/extensions/pi-web-access/content-find.ts +139 -139
  51. package/agent/extensions/pi-web-access/credential-source.ts +191 -191
  52. package/agent/extensions/pi-web-access/data-uri-sanitize.ts +406 -406
  53. package/agent/extensions/pi-web-access/datalab-pdf-extract.ts +568 -568
  54. package/agent/extensions/pi-web-access/declared-web-links.ts +173 -173
  55. package/agent/extensions/pi-web-access/evidence/CONTRACT-EVIDENCE.md +496 -496
  56. package/agent/extensions/pi-web-access/evidence/contract-probe.mjs +140 -140
  57. package/agent/extensions/pi-web-access/exa.ts +526 -526
  58. package/agent/extensions/pi-web-access/extract.ts +1196 -1196
  59. package/agent/extensions/pi-web-access/feature-config.ts +29 -29
  60. package/agent/extensions/pi-web-access/fetch-params.ts +111 -111
  61. package/agent/extensions/pi-web-access/gemini-adc.ts +298 -298
  62. package/agent/extensions/pi-web-access/gemini-api.ts +353 -353
  63. package/agent/extensions/pi-web-access/gemini-pdf-extract.ts +108 -108
  64. package/agent/extensions/pi-web-access/gemini-url-context.ts +128 -128
  65. package/agent/extensions/pi-web-access/gemini-web-config.ts +101 -101
  66. package/agent/extensions/pi-web-access/gemini-web.ts +487 -487
  67. package/agent/extensions/pi-web-access/github-api.ts +197 -197
  68. package/agent/extensions/pi-web-access/github-extract.ts +746 -746
  69. package/agent/extensions/pi-web-access/github-issue-pr.ts +700 -700
  70. package/agent/extensions/pi-web-access/index.ts +1737 -1737
  71. package/agent/extensions/pi-web-access/package-lock.json +5808 -5808
  72. package/agent/extensions/pi-web-access/package.json +64 -64
  73. package/agent/extensions/pi-web-access/page-query.ts +96 -96
  74. package/agent/extensions/pi-web-access/pdf-extract.ts +409 -409
  75. package/agent/extensions/pi-web-access/promise-try.d.ts +7 -7
  76. package/agent/extensions/pi-web-access/query-rewrite.ts +51 -51
  77. package/agent/extensions/pi-web-access/render-search-error.ts +170 -170
  78. package/agent/extensions/pi-web-access/rsc-extract.ts +338 -338
  79. package/agent/extensions/pi-web-access/source-check.ts +282 -282
  80. package/agent/extensions/pi-web-access/ssrf-protection.ts +526 -526
  81. package/agent/extensions/pi-web-access/storage.ts +521 -521
  82. package/agent/extensions/pi-web-access/summary-model-scope.ts +125 -125
  83. package/agent/extensions/pi-web-access/test/auth-fetch.test.mjs +208 -208
  84. package/agent/extensions/pi-web-access/test/brightdata-unlocker.test.mjs +840 -840
  85. package/agent/extensions/pi-web-access/test/chrome-cookie-extraction.test.mjs +441 -441
  86. package/agent/extensions/pi-web-access/test/config-path.test.mjs +283 -283
  87. package/agent/extensions/pi-web-access/test/content-find.test.mjs +25 -25
  88. package/agent/extensions/pi-web-access/test/credential-source.test.mjs +118 -118
  89. package/agent/extensions/pi-web-access/test/data-uri-sanitize.test.mjs +210 -210
  90. package/agent/extensions/pi-web-access/test/datalab-pdf-extract.test.mjs +552 -552
  91. package/agent/extensions/pi-web-access/test/declared-web-links.test.mjs +212 -212
  92. package/agent/extensions/pi-web-access/test/fetch-answer-storage.test.mjs +40 -40
  93. package/agent/extensions/pi-web-access/test/fetch-cache-storage.test.mjs +334 -334
  94. package/agent/extensions/pi-web-access/test/fetch-content-domain-policy.test.mjs +95 -95
  95. package/agent/extensions/pi-web-access/test/fetch-modes.test.mjs +53 -53
  96. package/agent/extensions/pi-web-access/test/fetch-not-found-guidance.test.mjs +92 -92
  97. package/agent/extensions/pi-web-access/test/fetch-params.test.mjs +86 -86
  98. package/agent/extensions/pi-web-access/test/fetch-render-call.test.mjs +34 -34
  99. package/agent/extensions/pi-web-access/test/fetch-routing.test.mjs +173 -173
  100. package/agent/extensions/pi-web-access/test/gemini-adc-auth.test.mjs +257 -257
  101. package/agent/extensions/pi-web-access/test/gemini-api-transport.test.mjs +170 -170
  102. package/agent/extensions/pi-web-access/test/gemini-pdf-extract.test.mjs +133 -133
  103. package/agent/extensions/pi-web-access/test/gemini-web-cookie-opt-in.test.mjs +178 -178
  104. package/agent/extensions/pi-web-access/test/gemini-web-header-overflow.test.mjs +148 -148
  105. package/agent/extensions/pi-web-access/test/get-search-content.test.mjs +223 -223
  106. package/agent/extensions/pi-web-access/test/github-extract.test.mjs +378 -378
  107. package/agent/extensions/pi-web-access/test/github-issue-pr.test.mjs +565 -565
  108. package/agent/extensions/pi-web-access/test/inline-content-config.test.mjs +99 -99
  109. package/agent/extensions/pi-web-access/test/lazy-extract-load.test.mjs +118 -118
  110. package/agent/extensions/pi-web-access/test/local-video-oversize.test.mjs +52 -52
  111. package/agent/extensions/pi-web-access/test/package-typebox-dependency.test.mjs +50 -50
  112. package/agent/extensions/pi-web-access/test/page-query.test.mjs +51 -51
  113. package/agent/extensions/pi-web-access/test/pdf-config.test.mjs +140 -140
  114. package/agent/extensions/pi-web-access/test/pdf-extract.test.mjs +500 -500
  115. package/agent/extensions/pi-web-access/test/proxy-transport.test.mjs +286 -286
  116. package/agent/extensions/pi-web-access/test/query-rewrite.test.mjs +52 -52
  117. package/agent/extensions/pi-web-access/test/rsc-fallback.test.mjs +102 -102
  118. package/agent/extensions/pi-web-access/test/search-error-render.test.mjs +152 -152
  119. package/agent/extensions/pi-web-access/test/search-providers.test.mjs +274 -274
  120. package/agent/extensions/pi-web-access/test/source-check.test.mjs +179 -179
  121. package/agent/extensions/pi-web-access/test/ssrf-allow-ranges-config.test.mjs +205 -205
  122. package/agent/extensions/pi-web-access/test/ssrf-protection.test.mjs +456 -456
  123. package/agent/extensions/pi-web-access/test/tool-registration-config.test.mjs +182 -182
  124. package/agent/extensions/pi-web-access/test/youtube-extract-errors.test.mjs +64 -64
  125. package/agent/extensions/pi-web-access/tsconfig.json +11 -11
  126. package/agent/extensions/pi-web-access/utils.ts +451 -451
  127. package/agent/extensions/pi-web-access/video-extract.ts +392 -392
  128. package/agent/extensions/pi-web-access/youtube-extract.ts +328 -328
  129. package/agent/extensions/shared/activity-status.ts +31 -31
  130. package/agent/extensions/shared/child-session.test.ts +270 -270
  131. package/agent/extensions/shared/child-session.ts +148 -148
  132. package/agent/extensions/shared/context-utilization.test.ts +48 -48
  133. package/agent/extensions/shared/context-utilization.ts +47 -47
  134. package/agent/extensions/shared/dashboard-state.ts +99 -99
  135. package/agent/extensions/shared/tool-call-timeout.test.ts +117 -117
  136. package/agent/extensions/shared/tool-call-timeout.ts +104 -104
  137. package/agent/extensions/subagents/by-the-way.test.ts +29 -29
  138. package/agent/extensions/subagents/claude.test.ts +119 -119
  139. package/agent/extensions/subagents/codex.test.ts +102 -102
  140. package/agent/extensions/subagents/context-usage.test.ts +107 -107
  141. package/agent/extensions/subagents/docs/design-plan.md +568 -568
  142. package/agent/extensions/subagents/docs/effect-v4-extension-guide.md +354 -354
  143. package/agent/extensions/subagents/docs/effect-v4-notes.md +571 -571
  144. package/agent/extensions/subagents/index.ts +779 -779
  145. package/agent/extensions/subagents/manager.test.ts +276 -276
  146. package/agent/extensions/subagents/package-lock.json +2244 -2244
  147. package/agent/extensions/subagents/package.json +19 -19
  148. package/agent/extensions/subagents/result-delivery.test.ts +27 -27
  149. package/agent/extensions/subagents/src/backend.ts +73 -73
  150. package/agent/extensions/subagents/src/backends/claude.ts +701 -701
  151. package/agent/extensions/subagents/src/backends/codex.ts +1060 -1060
  152. package/agent/extensions/subagents/src/backends/pi.ts +575 -575
  153. package/agent/extensions/subagents/src/backends/stub.ts +300 -300
  154. package/agent/extensions/subagents/src/by-the-way.ts +21 -21
  155. package/agent/extensions/subagents/src/domain.ts +253 -253
  156. package/agent/extensions/subagents/src/format.ts +74 -74
  157. package/agent/extensions/subagents/src/manager.ts +736 -736
  158. package/agent/extensions/subagents/src/prompt.ts +92 -92
  159. package/agent/extensions/subagents/src/result-delivery.ts +20 -20
  160. package/agent/extensions/subagents/src/runtime.ts +53 -53
  161. package/agent/extensions/subagents/src/ui/takeover.ts +583 -583
  162. package/agent/extensions/subagents/src/ui/transcript.ts +201 -201
  163. package/agent/extensions/subagents/takeover.test.ts +29 -29
  164. package/agent/extensions/subagents/tsconfig.json +7 -7
  165. package/agent/extensions/todo/AGENTS.md +38 -38
  166. package/agent/extensions/todo/LICENSE +21 -21
  167. package/agent/extensions/todo/config.ts +55 -55
  168. package/agent/extensions/todo/index.ts +151 -151
  169. package/agent/extensions/todo/locales/de.json +17 -17
  170. package/agent/extensions/todo/locales/en.json +15 -15
  171. package/agent/extensions/todo/locales/es.json +17 -17
  172. package/agent/extensions/todo/locales/fr.json +17 -17
  173. package/agent/extensions/todo/locales/pt-BR.json +17 -17
  174. package/agent/extensions/todo/locales/pt.json +17 -17
  175. package/agent/extensions/todo/locales/ru.json +17 -17
  176. package/agent/extensions/todo/locales/uk.json +17 -17
  177. package/agent/extensions/todo/locales/zh.json +17 -17
  178. package/agent/extensions/todo/package-lock.json +3358 -3358
  179. package/agent/extensions/todo/package.json +67 -67
  180. package/agent/extensions/todo/state/i18n-bridge.ts +64 -64
  181. package/agent/extensions/todo/state/invariants.ts +20 -20
  182. package/agent/extensions/todo/state/replay.ts +38 -38
  183. package/agent/extensions/todo/state/selectors.ts +107 -107
  184. package/agent/extensions/todo/state/state-reducer.ts +326 -326
  185. package/agent/extensions/todo/state/state.ts +18 -18
  186. package/agent/extensions/todo/state/store.ts +82 -82
  187. package/agent/extensions/todo/state/task-graph.ts +57 -57
  188. package/agent/extensions/todo/todo-overlay.ts +200 -200
  189. package/agent/extensions/todo/todo.ts +155 -155
  190. package/agent/extensions/todo/tool/response-envelope.ts +109 -109
  191. package/agent/extensions/todo/tool/types.ts +206 -206
  192. package/agent/extensions/todo/view/format.ts +177 -177
  193. package/agent/install.ps1 +637 -527
  194. package/agent/install.sh +620 -511
  195. package/agent/keybindings.json +7 -7
  196. package/bin/kiln.js +124 -11
  197. package/package.json +8 -2
  198. package/agent/extensions/taste/index.ts +0 -443
  199. package/agent/extensions/taste/install.ps1 +0 -23
  200. package/agent/extensions/taste/install.sh +0 -21
  201. /package/agent/extensions/{status line → statusline}/index.ts +0 -0
  202. /package/agent/extensions/{status line → statusline}/install.ps1 +0 -0
  203. /package/agent/extensions/{status line → statusline}/install.sh +0 -0
@@ -1,701 +1,701 @@
1
- /**
2
- * Claude Code backend — real implementation over the Claude Agent SDK.
3
- *
4
- * One SDK `query()` and one streaming-input bridge live for the whole scoped
5
- * session. User sends are pushed into that bridge, while the query iterator is
6
- * pumped in the background and translated to normalized SubagentEvents. The
7
- * CLI therefore owns conversation continuity, tool execution, and persisted
8
- * `~/.claude/projects` transcripts; this file only owns lifecycle guarantees
9
- * and the normalized view consumed by the manager.
10
- */
11
-
12
- import { randomUUID } from "node:crypto";
13
- import * as fs from "node:fs";
14
- import * as os from "node:os";
15
- import * as path from "node:path";
16
- import {
17
- query,
18
- type SDKAssistantMessage,
19
- type SDKMessage,
20
- type SDKResultMessage,
21
- type SDKUserMessage,
22
- } from "@anthropic-ai/claude-agent-sdk";
23
- import type { Cause, Scope } from "effect";
24
- import { Effect, Queue, Stream } from "effect";
25
- import type { SubagentBackend, SubagentSession } from "../backend.ts";
26
- import type {
27
- QueuedMessage,
28
- ReasoningEffort,
29
- RunOutcome,
30
- SpawnTask,
31
- SubagentEvent,
32
- SubagentMeta,
33
- TranscriptPart,
34
- } from "../domain.ts";
35
- import { SendError, SpawnError } from "../domain.ts";
36
-
37
- const CLAUDE_CONTEXT_WINDOW = 200_000;
38
- const INTERRUPT_TIMEOUT_MS = 2_000;
39
- const PREVIEW_MAX_LENGTH = 4_096;
40
-
41
- // --- Binary resolution --------------------------------------------------------
42
-
43
- let cachedClaudeBinary: string | null | undefined;
44
-
45
- function executable(file: string) {
46
- try {
47
- fs.accessSync(file, fs.constants.X_OK);
48
- return true;
49
- } catch {
50
- return false;
51
- }
52
- }
53
-
54
- /**
55
- * Resolve the Claude Code CLI once from PATH. The SDK can also run without
56
- * this (it bundles a CLI), but pointing it at the user's installed binary
57
- * keeps versions, settings, and login state consistent with their terminal.
58
- */
59
- function resolveClaudeBinary() {
60
- if (cachedClaudeBinary !== undefined) return cachedClaudeBinary ?? undefined;
61
- const names =
62
- process.platform === "win32"
63
- ? ["claude.exe", "claude.cmd", "claude"]
64
- : ["claude"];
65
- for (const directory of (process.env.PATH ?? "").split(path.delimiter)) {
66
- if (!directory) continue;
67
- for (const name of names) {
68
- const candidate = path.join(directory, name);
69
- if (executable(candidate)) {
70
- cachedClaudeBinary = candidate;
71
- return candidate;
72
- }
73
- }
74
- }
75
- cachedClaudeBinary = null;
76
- return undefined;
77
- }
78
-
79
- // --- Streaming input ---------------------------------------------------------
80
-
81
- /** A single-consumer push queue adapted to the SDK's AsyncIterable input. */
82
- class ClaudeInput implements AsyncIterable<SDKUserMessage> {
83
- private pending: SDKUserMessage[] = [];
84
- private waiter:
85
- ((result: IteratorResult<SDKUserMessage>) => void) | undefined;
86
- private closed = false;
87
-
88
- push(text: string) {
89
- if (this.closed) return undefined;
90
- const message: SDKUserMessage = {
91
- type: "user",
92
- message: { role: "user", content: text },
93
- parent_tool_use_id: null,
94
- // Stamped UUIDs make queued messages visible in interrupt receipts.
95
- uuid: randomUUID(),
96
- };
97
- const waiter = this.waiter;
98
- if (waiter) {
99
- this.waiter = undefined;
100
- waiter({ value: message, done: false });
101
- } else {
102
- this.pending.push(message);
103
- }
104
- return message;
105
- }
106
-
107
- clear() {
108
- return this.pending.splice(0);
109
- }
110
-
111
- end() {
112
- if (this.closed) return;
113
- this.closed = true;
114
- const waiter = this.waiter;
115
- this.waiter = undefined;
116
- waiter?.({ value: undefined, done: true });
117
- }
118
-
119
- async *[Symbol.asyncIterator]() {
120
- while (true) {
121
- const message = this.pending.shift();
122
- if (message) {
123
- yield message;
124
- continue;
125
- }
126
- if (this.closed) return;
127
- const next = await new Promise<IteratorResult<SDKUserMessage>>(
128
- (resolve) => {
129
- this.waiter = resolve;
130
- },
131
- );
132
- if (next.done) return;
133
- yield next.value;
134
- }
135
- }
136
- }
137
-
138
- // --- Model, effort, and transcript helpers ----------------------------------
139
-
140
- /**
141
- * Claude's deprecated-but-supported maxThinkingTokens is the closest match to
142
- * the shared numeric scale requested by this extension. Zero explicitly
143
- * disables extended thinking in SDK 0.3.207; an omitted effort leaves the CLI
144
- * default untouched.
145
- */
146
- const THINKING_BUDGETS = {
147
- off: 0,
148
- minimal: 1_024,
149
- low: 4_096,
150
- medium: 10_000,
151
- high: 16_000,
152
- xhigh: 32_000,
153
- max: 63_999,
154
- } satisfies Record<ReasoningEffort, number>;
155
-
156
- function boundedError(error: unknown) {
157
- return (error instanceof Error ? error.message : String(error)).slice(
158
- 0,
159
- 4_096,
160
- );
161
- }
162
-
163
- function singleLine(text: string) {
164
- const flattened = text.replace(/\s+/g, " ").trim();
165
- return flattened ? flattened.slice(0, PREVIEW_MAX_LENGTH) : undefined;
166
- }
167
-
168
- function safeJson(value: unknown) {
169
- try {
170
- const text = JSON.stringify(value);
171
- if (!text || text === "{}") return undefined;
172
- return singleLine(text);
173
- } catch {
174
- return undefined;
175
- }
176
- }
177
-
178
- function outputPreview(value: unknown): string | undefined {
179
- if (typeof value === "string") return singleLine(value);
180
- if (Array.isArray(value)) {
181
- const text = value
182
- .flatMap((part) => {
183
- if (!part || typeof part !== "object") return [];
184
- const record = part as { type?: unknown; text?: unknown };
185
- return record.type === "text" && typeof record.text === "string"
186
- ? [record.text]
187
- : [];
188
- })
189
- .join(" ");
190
- return singleLine(text) ?? safeJson(value);
191
- }
192
- return safeJson(value);
193
- }
194
-
195
- function assistantParts(message: SDKAssistantMessage): TranscriptPart[] {
196
- const parts: TranscriptPart[] = [];
197
- for (const block of message.message.content) {
198
- if (block.type === "text") {
199
- parts.push({ type: "text", text: block.text });
200
- } else if (block.type === "thinking") {
201
- parts.push({ type: "thinking", text: block.thinking });
202
- } else if (block.type === "redacted_thinking") {
203
- parts.push({ type: "thinking", text: "", redacted: true });
204
- } else if (block.type === "tool_use") {
205
- parts.push({
206
- type: "toolCall",
207
- toolId: block.id,
208
- name: block.name,
209
- argsPreview: safeJson(block.input),
210
- });
211
- }
212
- }
213
- return parts;
214
- }
215
-
216
- /** Claude Code's project-directory escaping, verified against CLI 2.1.207. */
217
- function sessionFilePath(cwd: string, sessionId: string) {
218
- const projectDirectory = cwd.replace(/[/.]/g, "-");
219
- return path.join(
220
- os.homedir(),
221
- ".claude",
222
- "projects",
223
- projectDirectory,
224
- `${sessionId}.jsonl`,
225
- );
226
- }
227
-
228
- /**
229
- * Context occupancy after one API request. An assistant message's `usage`
230
- * describes only that request: the full prompt (fresh + cache-read +
231
- * cache-written input) plus this response's output — exactly what now sits
232
- * in the context window. The result message's `usage` instead sums these
233
- * per-request counts across the whole run, so a multi-request turn
234
- * re-counts cached context once per request and quickly exceeds the real
235
- * window; it must never be treated as occupancy.
236
- */
237
- export function contextOccupancyTokens(
238
- usage:
239
- | {
240
- input_tokens?: number | null;
241
- cache_read_input_tokens?: number | null;
242
- cache_creation_input_tokens?: number | null;
243
- output_tokens?: number | null;
244
- }
245
- | null
246
- | undefined,
247
- ) {
248
- if (!usage || typeof usage.input_tokens !== "number") return undefined;
249
- const count = (value: number | null | undefined) =>
250
- typeof value === "number" && Number.isFinite(value) ? value : 0;
251
- return (
252
- count(usage.input_tokens) +
253
- count(usage.cache_read_input_tokens) +
254
- count(usage.cache_creation_input_tokens) +
255
- count(usage.output_tokens)
256
- );
257
- }
258
-
259
- function resultContextWindow(result: SDKResultMessage) {
260
- return Object.values(result.modelUsage)[0]?.contextWindow;
261
- }
262
-
263
- function waitBounded(operation: Promise<unknown>, timeoutMs: number) {
264
- let timer: ReturnType<typeof setTimeout> | undefined;
265
- const timeout = new Promise<void>((resolve) => {
266
- timer = setTimeout(resolve, timeoutMs);
267
- });
268
- return Promise.race([
269
- operation.then(
270
- () => undefined,
271
- () => undefined,
272
- ),
273
- timeout,
274
- ]).finally(() => {
275
- if (timer) clearTimeout(timer);
276
- });
277
- }
278
-
279
- // --- The session -------------------------------------------------------------
280
-
281
- interface NativeQueuedMessage extends QueuedMessage {
282
- readonly uuid: string;
283
- /** Raw response sequence after which this steer can be consumed. */
284
- readonly afterResponse: number;
285
- }
286
-
287
- const makeClaudeSession = (
288
- task: SpawnTask,
289
- ): Effect.Effect<SubagentSession, SpawnError, Scope.Scope> =>
290
- Effect.gen(function* () {
291
- const input = new ClaudeInput();
292
- const abortController = new AbortController();
293
- const events = yield* Queue.make<SubagentEvent, Cause.Done>();
294
- const emit = (event: SubagentEvent) => {
295
- Queue.offerUnsafe(events, event);
296
- };
297
-
298
- const state = {
299
- closed: false,
300
- activeRun: false,
301
- interruptRequested: false,
302
- runVersion: 0,
303
- lastSettledVersion: 0,
304
- responseSequence: 0,
305
- queued: [] as NativeQueuedMessage[],
306
- submittedUuids: new Set<string>(),
307
- currentText: "",
308
- liveText: "",
309
- tools: new Map<string, string>(),
310
- settleWaiters: new Set<() => void>(),
311
- meta: {
312
- backend: "claude",
313
- modelLabel: task.model,
314
- // Claude models used by this backend currently expose 200k context;
315
- // result.modelUsage replaces this fallback when the CLI knows better.
316
- contextWindow: CLAUDE_CONTEXT_WINDOW,
317
- } satisfies SubagentMeta as SubagentMeta,
318
- };
319
-
320
- const thinkingBudget = task.reasoningEffort
321
- ? THINKING_BUDGETS[task.reasoningEffort]
322
- : undefined;
323
- const claudeBinary = resolveClaudeBinary();
324
- const nativeQuery = yield* Effect.try({
325
- try: () =>
326
- query({
327
- prompt: input,
328
- options: {
329
- cwd: task.cwd,
330
- // Headless children cannot answer approval prompts. The caller
331
- // already chose to launch an autonomous subagent, so let it use
332
- // its tools without interactive permission checks.
333
- permissionMode: "bypassPermissions",
334
- allowDangerouslySkipPermissions: true,
335
- // Keep child orchestration inside this extension's global manager
336
- // and concurrency cap rather than Claude Code's native subagents.
337
- disallowedTools: ["Agent", "Task"],
338
- // For cwds pi marked untrusted, restrict to user-level settings so
339
- // an untrusted project's config cannot reconfigure the child.
340
- ...(task.parent.projectTrusted
341
- ? {}
342
- : { settingSources: ["user" as const] }),
343
- includePartialMessages: true,
344
- abortController,
345
- ...(claudeBinary
346
- ? { pathToClaudeCodeExecutable: claudeBinary }
347
- : {}),
348
- ...(task.model ? { model: task.model } : {}),
349
- ...(thinkingBudget !== undefined
350
- ? { maxThinkingTokens: thinkingBudget }
351
- : {}),
352
- },
353
- }),
354
- catch: (error) => new SpawnError({ message: boundedError(error) }),
355
- });
356
-
357
- let resolvePumpDone: (() => void) | undefined;
358
- const pumpDone = new Promise<void>((resolve) => {
359
- resolvePumpDone = resolve;
360
- });
361
-
362
- const queuedView = (): ReadonlyArray<QueuedMessage> =>
363
- state.queued.map(({ text, kind }) => ({ text, kind }));
364
-
365
- const notifySettled = () => {
366
- for (const waiter of state.settleWaiters) waiter();
367
- state.settleWaiters.clear();
368
- };
369
-
370
- const partialText = () => state.liveText || state.currentText || undefined;
371
-
372
- const settle = (outcome: RunOutcome) => {
373
- if (!state.activeRun) return;
374
- emit({ _tag: "RunSettled", outcome });
375
- state.activeRun = false;
376
- state.lastSettledVersion = state.runVersion;
377
- state.interruptRequested = false;
378
- state.liveText = "";
379
- notifySettled();
380
- };
381
-
382
- const updateMeta = (patch: Partial<SubagentMeta>) => {
383
- state.meta = { ...state.meta, ...patch };
384
- emit({ _tag: "MetaChanged", meta: patch });
385
- };
386
-
387
- const beginQueuedRunIfNeeded = () => {
388
- if (state.activeRun || state.queued.length === 0) return;
389
- // A steer arriving too late for the prior turn becomes a fresh queued
390
- // turn. The repeated init is the first reliable signal that it started.
391
- state.activeRun = true;
392
- state.runVersion++;
393
- state.currentText = "";
394
- state.liveText = "";
395
- emit({ _tag: "RunStarted" });
396
- };
397
-
398
- const clearConsumedSteers = () => {
399
- const remaining = state.queued.filter(
400
- (message) => message.afterResponse >= state.responseSequence,
401
- );
402
- if (remaining.length === state.queued.length) return;
403
- state.queued = remaining;
404
- emit({ _tag: "QueueChanged", queued: queuedView() });
405
- };
406
-
407
- const handleAssistant = (message: SDKAssistantMessage) => {
408
- const parts = assistantParts(message);
409
- if (parts.length > 0) emit({ _tag: "AssistantMessage", parts });
410
-
411
- // Top-level messages only: subagent (sidechain) requests have their own
412
- // context and must not overwrite this conversation's occupancy.
413
- if (message.parent_tool_use_id == null) {
414
- const tokens = contextOccupancyTokens(message.message.usage);
415
- if (tokens !== undefined) emit({ _tag: "UsageChanged", tokens });
416
- }
417
-
418
- const text = message.message.content
419
- .filter((block) => block.type === "text")
420
- .map((block) => block.text)
421
- .join("\n")
422
- .trim();
423
- if (text) state.currentText = text;
424
- state.liveText = "";
425
-
426
- if (message.message.model !== state.meta.modelLabel) {
427
- updateMeta({ modelLabel: message.message.model });
428
- }
429
- for (const block of message.message.content) {
430
- if (block.type !== "tool_use") continue;
431
- state.tools.set(block.id, block.name);
432
- emit({
433
- _tag: "ToolStart",
434
- toolId: block.id,
435
- name: block.name,
436
- argsPreview: safeJson(block.input),
437
- });
438
- }
439
- };
440
-
441
- const handleUser = (message: SDKUserMessage) => {
442
- const content = message.message.content;
443
- if (!Array.isArray(content)) return;
444
- for (const block of content) {
445
- if (block.type !== "tool_result") continue;
446
- const name = state.tools.get(block.tool_use_id) ?? "Tool";
447
- state.tools.delete(block.tool_use_id);
448
- emit({
449
- _tag: "ToolEnd",
450
- toolId: block.tool_use_id,
451
- name,
452
- isError: block.is_error ?? false,
453
- outputPreview: outputPreview(block.content),
454
- });
455
- }
456
- // External prompts are emitted synchronously by submit(); ignoring text
457
- // here prevents a future CLI echo from duplicating the transcript row.
458
- };
459
-
460
- const handleResult = (result: SDKResultMessage) => {
461
- // result.usage is a whole-run aggregate, not occupancy (see
462
- // contextOccupancyTokens); only the capacity is trustworthy here. The
463
- // occupancy itself was already emitted by the last assistant message.
464
- const contextWindow = resultContextWindow(result);
465
- emit({
466
- _tag: "UsageChanged",
467
- contextWindow: contextWindow ?? state.meta.contextWindow,
468
- });
469
- if (
470
- contextWindow !== undefined &&
471
- contextWindow !== state.meta.contextWindow
472
- ) {
473
- updateMeta({ contextWindow });
474
- }
475
-
476
- if (state.interruptRequested) {
477
- settle({ _tag: "Interrupted", partialText: partialText() });
478
- } else if (result.subtype === "success") {
479
- settle({
480
- _tag: "Completed",
481
- finalText: result.result.trim() || state.currentText,
482
- });
483
- } else {
484
- const details =
485
- result.errors.filter((error) => error.trim()).join("\n") ||
486
- result.stop_reason ||
487
- `Claude Code ended with ${result.subtype}`;
488
- settle({
489
- _tag: "Failed",
490
- errorText: boundedError(details),
491
- partialText: partialText(),
492
- });
493
- }
494
- };
495
-
496
- const handleMessage = (message: SDKMessage) => {
497
- if (state.closed) return;
498
- // A queued steer's turn normally announces itself with a repeated
499
- // system/init, but any turn activity is an equally valid begin signal —
500
- // without this, a missed init would stream events into a "done" run
501
- // that could then never settle.
502
- if (
503
- message.type === "stream_event" ||
504
- message.type === "assistant" ||
505
- message.type === "result"
506
- ) {
507
- beginQueuedRunIfNeeded();
508
- }
509
- if (message.type === "system" && message.subtype === "init") {
510
- beginQueuedRunIfNeeded();
511
- updateMeta({
512
- modelLabel: message.model,
513
- nativeSessionId: message.session_id,
514
- sessionFilePath: sessionFilePath(message.cwd, message.session_id),
515
- contextWindow: CLAUDE_CONTEXT_WINDOW,
516
- });
517
- } else if (message.type === "stream_event") {
518
- if (message.parent_tool_use_id !== null) return;
519
- if (message.event.type === "message_start") {
520
- state.responseSequence++;
521
- clearConsumedSteers();
522
- } else if (message.event.type === "content_block_delta") {
523
- const delta = message.event.delta;
524
- if (delta.type === "text_delta") {
525
- state.liveText += delta.text;
526
- emit({ _tag: "AssistantDelta", kind: "text", delta: delta.text });
527
- } else if (delta.type === "thinking_delta") {
528
- emit({
529
- _tag: "AssistantDelta",
530
- kind: "thinking",
531
- delta: delta.thinking,
532
- });
533
- }
534
- }
535
- } else if (message.type === "assistant") {
536
- handleAssistant(message);
537
- } else if (message.type === "user") {
538
- handleUser(message);
539
- } else if (message.type === "result") {
540
- handleResult(message);
541
- }
542
- };
543
-
544
- const pump = async () => {
545
- let failure: string | undefined;
546
- try {
547
- for await (const message of nativeQuery) handleMessage(message);
548
- } catch (error) {
549
- if (!state.closed && !abortController.signal.aborted) {
550
- failure = boundedError(error);
551
- }
552
- } finally {
553
- if (!state.closed) {
554
- if (state.activeRun) {
555
- settle(
556
- state.interruptRequested
557
- ? { _tag: "Interrupted", partialText: partialText() }
558
- : {
559
- _tag: "Failed",
560
- errorText:
561
- failure ?? "Claude Code query ended unexpectedly",
562
- partialText: partialText(),
563
- },
564
- );
565
- } else if (failure) {
566
- emit({ _tag: "BackendError", message: failure });
567
- }
568
- state.closed = true;
569
- Queue.endUnsafe(events);
570
- }
571
- resolvePumpDone?.();
572
- }
573
- };
574
-
575
- yield* Effect.addFinalizer(() =>
576
- Effect.promise(async () => {
577
- // Settle before marking closed: the pump's finally skips settlement
578
- // once closed, and every run must end in a RunSettled even when the
579
- // scope closes mid-run.
580
- if (state.activeRun) {
581
- settle({ _tag: "Interrupted", partialText: partialText() });
582
- }
583
- state.closed = true;
584
- input.end();
585
- abortController.abort();
586
- nativeQuery.close();
587
- await waitBounded(pumpDone, INTERRUPT_TIMEOUT_MS);
588
- Queue.endUnsafe(events);
589
- }),
590
- );
591
-
592
- void pump();
593
-
594
- const submit = (text: string) => {
595
- const wasActive = state.activeRun;
596
- const message = input.push(text);
597
- if (!message) return false;
598
- if (!wasActive) {
599
- state.activeRun = true;
600
- state.runVersion++;
601
- state.currentText = "";
602
- state.liveText = "";
603
- }
604
- state.submittedUuids.add(message.uuid ?? "");
605
- // Idle restarts flip status synchronously (like pi's startRun); a steer
606
- // into an active run must NOT re-emit RunStarted — its own turn begins
607
- // later via beginQueuedRunIfNeeded.
608
- if (!wasActive) emit({ _tag: "RunStarted" });
609
- emit({ _tag: "UserMessage", text });
610
- if (wasActive) {
611
- state.queued.push({
612
- text,
613
- kind: "steer",
614
- uuid: message.uuid ?? "",
615
- afterResponse: state.responseSequence,
616
- });
617
- emit({ _tag: "QueueChanged", queued: queuedView() });
618
- }
619
- return true;
620
- };
621
-
622
- const waitForVersion = (version: number) => {
623
- if (state.lastSettledVersion >= version) return Promise.resolve();
624
- return new Promise<void>((resolve) => {
625
- const waiter = () => {
626
- if (state.lastSettledVersion < version && !state.closed) return;
627
- state.settleWaiters.delete(waiter);
628
- resolve();
629
- };
630
- state.settleWaiters.add(waiter);
631
- });
632
- };
633
-
634
- emit({ _tag: "MetaChanged", meta: state.meta });
635
- submit(task.prompt);
636
-
637
- return {
638
- meta: Effect.sync(() => state.meta),
639
- events: Stream.fromQueue(events),
640
- send: (text) =>
641
- Effect.suspend((): Effect.Effect<void, SendError> => {
642
- if (state.closed) {
643
- return new SendError({ message: "Subagent session is closed." });
644
- }
645
- return submit(text)
646
- ? Effect.void
647
- : new SendError({ message: "Subagent session is closed." });
648
- }),
649
- interrupt: Effect.promise(async () => {
650
- if (state.closed || !state.activeRun) return;
651
- const version = state.runVersion;
652
- state.interruptRequested = true;
653
- input.clear();
654
- state.queued = [];
655
- emit({ _tag: "QueueChanged", queued: [] });
656
-
657
- const interruptAndSettle = (async () => {
658
- try {
659
- const receipt = await nativeQuery.interrupt();
660
- const hasOwnQueuedMessage = receipt?.still_queued?.some((uuid) =>
661
- state.submittedUuids.has(uuid),
662
- );
663
- if (hasOwnQueuedMessage) {
664
- // 0.3.207 exposes cancellation receipts but no public per-message
665
- // cancel method. Closing is the only way to prevent a cancelled
666
- // queued prompt from immediately starting another turn.
667
- input.end();
668
- nativeQuery.close();
669
- }
670
- } catch (error) {
671
- if (!state.closed) {
672
- emit({ _tag: "BackendError", message: boundedError(error) });
673
- }
674
- }
675
- await waitForVersion(version);
676
- })();
677
-
678
- await waitBounded(interruptAndSettle, INTERRUPT_TIMEOUT_MS);
679
- if (!state.closed && state.activeRun && state.runVersion === version) {
680
- // Covers pre-init/pending races and SDK versions that acknowledge an
681
- // interrupt without delivering a result. Force-close after settling
682
- // so a late native result cannot resurrect or re-settle this run.
683
- settle({ _tag: "Interrupted", partialText: partialText() });
684
- state.closed = true;
685
- input.end();
686
- abortController.abort();
687
- nativeQuery.close();
688
- Queue.endUnsafe(events);
689
- }
690
- }),
691
- } satisfies SubagentSession;
692
- });
693
-
694
- // --- Backend -----------------------------------------------------------------
695
-
696
- export const claudeBackend: SubagentBackend = {
697
- name: "claude",
698
- capabilities: { steering: true, modelSelection: true, reasoningEffort: true },
699
- available: Effect.sync(() => resolveClaudeBinary() !== undefined),
700
- spawn: makeClaudeSession,
701
- };
1
+ /**
2
+ * Claude Code backend — real implementation over the Claude Agent SDK.
3
+ *
4
+ * One SDK `query()` and one streaming-input bridge live for the whole scoped
5
+ * session. User sends are pushed into that bridge, while the query iterator is
6
+ * pumped in the background and translated to normalized SubagentEvents. The
7
+ * CLI therefore owns conversation continuity, tool execution, and persisted
8
+ * `~/.claude/projects` transcripts; this file only owns lifecycle guarantees
9
+ * and the normalized view consumed by the manager.
10
+ */
11
+
12
+ import { randomUUID } from "node:crypto";
13
+ import * as fs from "node:fs";
14
+ import * as os from "node:os";
15
+ import * as path from "node:path";
16
+ import {
17
+ query,
18
+ type SDKAssistantMessage,
19
+ type SDKMessage,
20
+ type SDKResultMessage,
21
+ type SDKUserMessage,
22
+ } from "@anthropic-ai/claude-agent-sdk";
23
+ import type { Cause, Scope } from "effect";
24
+ import { Effect, Queue, Stream } from "effect";
25
+ import type { SubagentBackend, SubagentSession } from "../backend.ts";
26
+ import type {
27
+ QueuedMessage,
28
+ ReasoningEffort,
29
+ RunOutcome,
30
+ SpawnTask,
31
+ SubagentEvent,
32
+ SubagentMeta,
33
+ TranscriptPart,
34
+ } from "../domain.ts";
35
+ import { SendError, SpawnError } from "../domain.ts";
36
+
37
+ const CLAUDE_CONTEXT_WINDOW = 200_000;
38
+ const INTERRUPT_TIMEOUT_MS = 2_000;
39
+ const PREVIEW_MAX_LENGTH = 4_096;
40
+
41
+ // --- Binary resolution --------------------------------------------------------
42
+
43
+ let cachedClaudeBinary: string | null | undefined;
44
+
45
+ function executable(file: string) {
46
+ try {
47
+ fs.accessSync(file, fs.constants.X_OK);
48
+ return true;
49
+ } catch {
50
+ return false;
51
+ }
52
+ }
53
+
54
+ /**
55
+ * Resolve the Claude Code CLI once from PATH. The SDK can also run without
56
+ * this (it bundles a CLI), but pointing it at the user's installed binary
57
+ * keeps versions, settings, and login state consistent with their terminal.
58
+ */
59
+ function resolveClaudeBinary() {
60
+ if (cachedClaudeBinary !== undefined) return cachedClaudeBinary ?? undefined;
61
+ const names =
62
+ process.platform === "win32"
63
+ ? ["claude.exe", "claude.cmd", "claude"]
64
+ : ["claude"];
65
+ for (const directory of (process.env.PATH ?? "").split(path.delimiter)) {
66
+ if (!directory) continue;
67
+ for (const name of names) {
68
+ const candidate = path.join(directory, name);
69
+ if (executable(candidate)) {
70
+ cachedClaudeBinary = candidate;
71
+ return candidate;
72
+ }
73
+ }
74
+ }
75
+ cachedClaudeBinary = null;
76
+ return undefined;
77
+ }
78
+
79
+ // --- Streaming input ---------------------------------------------------------
80
+
81
+ /** A single-consumer push queue adapted to the SDK's AsyncIterable input. */
82
+ class ClaudeInput implements AsyncIterable<SDKUserMessage> {
83
+ private pending: SDKUserMessage[] = [];
84
+ private waiter:
85
+ ((result: IteratorResult<SDKUserMessage>) => void) | undefined;
86
+ private closed = false;
87
+
88
+ push(text: string) {
89
+ if (this.closed) return undefined;
90
+ const message: SDKUserMessage = {
91
+ type: "user",
92
+ message: { role: "user", content: text },
93
+ parent_tool_use_id: null,
94
+ // Stamped UUIDs make queued messages visible in interrupt receipts.
95
+ uuid: randomUUID(),
96
+ };
97
+ const waiter = this.waiter;
98
+ if (waiter) {
99
+ this.waiter = undefined;
100
+ waiter({ value: message, done: false });
101
+ } else {
102
+ this.pending.push(message);
103
+ }
104
+ return message;
105
+ }
106
+
107
+ clear() {
108
+ return this.pending.splice(0);
109
+ }
110
+
111
+ end() {
112
+ if (this.closed) return;
113
+ this.closed = true;
114
+ const waiter = this.waiter;
115
+ this.waiter = undefined;
116
+ waiter?.({ value: undefined, done: true });
117
+ }
118
+
119
+ async *[Symbol.asyncIterator]() {
120
+ while (true) {
121
+ const message = this.pending.shift();
122
+ if (message) {
123
+ yield message;
124
+ continue;
125
+ }
126
+ if (this.closed) return;
127
+ const next = await new Promise<IteratorResult<SDKUserMessage>>(
128
+ (resolve) => {
129
+ this.waiter = resolve;
130
+ },
131
+ );
132
+ if (next.done) return;
133
+ yield next.value;
134
+ }
135
+ }
136
+ }
137
+
138
+ // --- Model, effort, and transcript helpers ----------------------------------
139
+
140
+ /**
141
+ * Claude's deprecated-but-supported maxThinkingTokens is the closest match to
142
+ * the shared numeric scale requested by this extension. Zero explicitly
143
+ * disables extended thinking in SDK 0.3.207; an omitted effort leaves the CLI
144
+ * default untouched.
145
+ */
146
+ const THINKING_BUDGETS = {
147
+ off: 0,
148
+ minimal: 1_024,
149
+ low: 4_096,
150
+ medium: 10_000,
151
+ high: 16_000,
152
+ xhigh: 32_000,
153
+ max: 63_999,
154
+ } satisfies Record<ReasoningEffort, number>;
155
+
156
+ function boundedError(error: unknown) {
157
+ return (error instanceof Error ? error.message : String(error)).slice(
158
+ 0,
159
+ 4_096,
160
+ );
161
+ }
162
+
163
+ function singleLine(text: string) {
164
+ const flattened = text.replace(/\s+/g, " ").trim();
165
+ return flattened ? flattened.slice(0, PREVIEW_MAX_LENGTH) : undefined;
166
+ }
167
+
168
+ function safeJson(value: unknown) {
169
+ try {
170
+ const text = JSON.stringify(value);
171
+ if (!text || text === "{}") return undefined;
172
+ return singleLine(text);
173
+ } catch {
174
+ return undefined;
175
+ }
176
+ }
177
+
178
+ function outputPreview(value: unknown): string | undefined {
179
+ if (typeof value === "string") return singleLine(value);
180
+ if (Array.isArray(value)) {
181
+ const text = value
182
+ .flatMap((part) => {
183
+ if (!part || typeof part !== "object") return [];
184
+ const record = part as { type?: unknown; text?: unknown };
185
+ return record.type === "text" && typeof record.text === "string"
186
+ ? [record.text]
187
+ : [];
188
+ })
189
+ .join(" ");
190
+ return singleLine(text) ?? safeJson(value);
191
+ }
192
+ return safeJson(value);
193
+ }
194
+
195
+ function assistantParts(message: SDKAssistantMessage): TranscriptPart[] {
196
+ const parts: TranscriptPart[] = [];
197
+ for (const block of message.message.content) {
198
+ if (block.type === "text") {
199
+ parts.push({ type: "text", text: block.text });
200
+ } else if (block.type === "thinking") {
201
+ parts.push({ type: "thinking", text: block.thinking });
202
+ } else if (block.type === "redacted_thinking") {
203
+ parts.push({ type: "thinking", text: "", redacted: true });
204
+ } else if (block.type === "tool_use") {
205
+ parts.push({
206
+ type: "toolCall",
207
+ toolId: block.id,
208
+ name: block.name,
209
+ argsPreview: safeJson(block.input),
210
+ });
211
+ }
212
+ }
213
+ return parts;
214
+ }
215
+
216
+ /** Claude Code's project-directory escaping, verified against CLI 2.1.207. */
217
+ function sessionFilePath(cwd: string, sessionId: string) {
218
+ const projectDirectory = cwd.replace(/[/.]/g, "-");
219
+ return path.join(
220
+ os.homedir(),
221
+ ".claude",
222
+ "projects",
223
+ projectDirectory,
224
+ `${sessionId}.jsonl`,
225
+ );
226
+ }
227
+
228
+ /**
229
+ * Context occupancy after one API request. An assistant message's `usage`
230
+ * describes only that request: the full prompt (fresh + cache-read +
231
+ * cache-written input) plus this response's output — exactly what now sits
232
+ * in the context window. The result message's `usage` instead sums these
233
+ * per-request counts across the whole run, so a multi-request turn
234
+ * re-counts cached context once per request and quickly exceeds the real
235
+ * window; it must never be treated as occupancy.
236
+ */
237
+ export function contextOccupancyTokens(
238
+ usage:
239
+ | {
240
+ input_tokens?: number | null;
241
+ cache_read_input_tokens?: number | null;
242
+ cache_creation_input_tokens?: number | null;
243
+ output_tokens?: number | null;
244
+ }
245
+ | null
246
+ | undefined,
247
+ ) {
248
+ if (!usage || typeof usage.input_tokens !== "number") return undefined;
249
+ const count = (value: number | null | undefined) =>
250
+ typeof value === "number" && Number.isFinite(value) ? value : 0;
251
+ return (
252
+ count(usage.input_tokens) +
253
+ count(usage.cache_read_input_tokens) +
254
+ count(usage.cache_creation_input_tokens) +
255
+ count(usage.output_tokens)
256
+ );
257
+ }
258
+
259
+ function resultContextWindow(result: SDKResultMessage) {
260
+ return Object.values(result.modelUsage)[0]?.contextWindow;
261
+ }
262
+
263
+ function waitBounded(operation: Promise<unknown>, timeoutMs: number) {
264
+ let timer: ReturnType<typeof setTimeout> | undefined;
265
+ const timeout = new Promise<void>((resolve) => {
266
+ timer = setTimeout(resolve, timeoutMs);
267
+ });
268
+ return Promise.race([
269
+ operation.then(
270
+ () => undefined,
271
+ () => undefined,
272
+ ),
273
+ timeout,
274
+ ]).finally(() => {
275
+ if (timer) clearTimeout(timer);
276
+ });
277
+ }
278
+
279
+ // --- The session -------------------------------------------------------------
280
+
281
+ interface NativeQueuedMessage extends QueuedMessage {
282
+ readonly uuid: string;
283
+ /** Raw response sequence after which this steer can be consumed. */
284
+ readonly afterResponse: number;
285
+ }
286
+
287
+ const makeClaudeSession = (
288
+ task: SpawnTask,
289
+ ): Effect.Effect<SubagentSession, SpawnError, Scope.Scope> =>
290
+ Effect.gen(function* () {
291
+ const input = new ClaudeInput();
292
+ const abortController = new AbortController();
293
+ const events = yield* Queue.make<SubagentEvent, Cause.Done>();
294
+ const emit = (event: SubagentEvent) => {
295
+ Queue.offerUnsafe(events, event);
296
+ };
297
+
298
+ const state = {
299
+ closed: false,
300
+ activeRun: false,
301
+ interruptRequested: false,
302
+ runVersion: 0,
303
+ lastSettledVersion: 0,
304
+ responseSequence: 0,
305
+ queued: [] as NativeQueuedMessage[],
306
+ submittedUuids: new Set<string>(),
307
+ currentText: "",
308
+ liveText: "",
309
+ tools: new Map<string, string>(),
310
+ settleWaiters: new Set<() => void>(),
311
+ meta: {
312
+ backend: "claude",
313
+ modelLabel: task.model,
314
+ // Claude models used by this backend currently expose 200k context;
315
+ // result.modelUsage replaces this fallback when the CLI knows better.
316
+ contextWindow: CLAUDE_CONTEXT_WINDOW,
317
+ } satisfies SubagentMeta as SubagentMeta,
318
+ };
319
+
320
+ const thinkingBudget = task.reasoningEffort
321
+ ? THINKING_BUDGETS[task.reasoningEffort]
322
+ : undefined;
323
+ const claudeBinary = resolveClaudeBinary();
324
+ const nativeQuery = yield* Effect.try({
325
+ try: () =>
326
+ query({
327
+ prompt: input,
328
+ options: {
329
+ cwd: task.cwd,
330
+ // Headless children cannot answer approval prompts. The caller
331
+ // already chose to launch an autonomous subagent, so let it use
332
+ // its tools without interactive permission checks.
333
+ permissionMode: "bypassPermissions",
334
+ allowDangerouslySkipPermissions: true,
335
+ // Keep child orchestration inside this extension's global manager
336
+ // and concurrency cap rather than Claude Code's native subagents.
337
+ disallowedTools: ["Agent", "Task"],
338
+ // For cwds pi marked untrusted, restrict to user-level settings so
339
+ // an untrusted project's config cannot reconfigure the child.
340
+ ...(task.parent.projectTrusted
341
+ ? {}
342
+ : { settingSources: ["user" as const] }),
343
+ includePartialMessages: true,
344
+ abortController,
345
+ ...(claudeBinary
346
+ ? { pathToClaudeCodeExecutable: claudeBinary }
347
+ : {}),
348
+ ...(task.model ? { model: task.model } : {}),
349
+ ...(thinkingBudget !== undefined
350
+ ? { maxThinkingTokens: thinkingBudget }
351
+ : {}),
352
+ },
353
+ }),
354
+ catch: (error) => new SpawnError({ message: boundedError(error) }),
355
+ });
356
+
357
+ let resolvePumpDone: (() => void) | undefined;
358
+ const pumpDone = new Promise<void>((resolve) => {
359
+ resolvePumpDone = resolve;
360
+ });
361
+
362
+ const queuedView = (): ReadonlyArray<QueuedMessage> =>
363
+ state.queued.map(({ text, kind }) => ({ text, kind }));
364
+
365
+ const notifySettled = () => {
366
+ for (const waiter of state.settleWaiters) waiter();
367
+ state.settleWaiters.clear();
368
+ };
369
+
370
+ const partialText = () => state.liveText || state.currentText || undefined;
371
+
372
+ const settle = (outcome: RunOutcome) => {
373
+ if (!state.activeRun) return;
374
+ emit({ _tag: "RunSettled", outcome });
375
+ state.activeRun = false;
376
+ state.lastSettledVersion = state.runVersion;
377
+ state.interruptRequested = false;
378
+ state.liveText = "";
379
+ notifySettled();
380
+ };
381
+
382
+ const updateMeta = (patch: Partial<SubagentMeta>) => {
383
+ state.meta = { ...state.meta, ...patch };
384
+ emit({ _tag: "MetaChanged", meta: patch });
385
+ };
386
+
387
+ const beginQueuedRunIfNeeded = () => {
388
+ if (state.activeRun || state.queued.length === 0) return;
389
+ // A steer arriving too late for the prior turn becomes a fresh queued
390
+ // turn. The repeated init is the first reliable signal that it started.
391
+ state.activeRun = true;
392
+ state.runVersion++;
393
+ state.currentText = "";
394
+ state.liveText = "";
395
+ emit({ _tag: "RunStarted" });
396
+ };
397
+
398
+ const clearConsumedSteers = () => {
399
+ const remaining = state.queued.filter(
400
+ (message) => message.afterResponse >= state.responseSequence,
401
+ );
402
+ if (remaining.length === state.queued.length) return;
403
+ state.queued = remaining;
404
+ emit({ _tag: "QueueChanged", queued: queuedView() });
405
+ };
406
+
407
+ const handleAssistant = (message: SDKAssistantMessage) => {
408
+ const parts = assistantParts(message);
409
+ if (parts.length > 0) emit({ _tag: "AssistantMessage", parts });
410
+
411
+ // Top-level messages only: subagent (sidechain) requests have their own
412
+ // context and must not overwrite this conversation's occupancy.
413
+ if (message.parent_tool_use_id == null) {
414
+ const tokens = contextOccupancyTokens(message.message.usage);
415
+ if (tokens !== undefined) emit({ _tag: "UsageChanged", tokens });
416
+ }
417
+
418
+ const text = message.message.content
419
+ .filter((block) => block.type === "text")
420
+ .map((block) => block.text)
421
+ .join("\n")
422
+ .trim();
423
+ if (text) state.currentText = text;
424
+ state.liveText = "";
425
+
426
+ if (message.message.model !== state.meta.modelLabel) {
427
+ updateMeta({ modelLabel: message.message.model });
428
+ }
429
+ for (const block of message.message.content) {
430
+ if (block.type !== "tool_use") continue;
431
+ state.tools.set(block.id, block.name);
432
+ emit({
433
+ _tag: "ToolStart",
434
+ toolId: block.id,
435
+ name: block.name,
436
+ argsPreview: safeJson(block.input),
437
+ });
438
+ }
439
+ };
440
+
441
+ const handleUser = (message: SDKUserMessage) => {
442
+ const content = message.message.content;
443
+ if (!Array.isArray(content)) return;
444
+ for (const block of content) {
445
+ if (block.type !== "tool_result") continue;
446
+ const name = state.tools.get(block.tool_use_id) ?? "Tool";
447
+ state.tools.delete(block.tool_use_id);
448
+ emit({
449
+ _tag: "ToolEnd",
450
+ toolId: block.tool_use_id,
451
+ name,
452
+ isError: block.is_error ?? false,
453
+ outputPreview: outputPreview(block.content),
454
+ });
455
+ }
456
+ // External prompts are emitted synchronously by submit(); ignoring text
457
+ // here prevents a future CLI echo from duplicating the transcript row.
458
+ };
459
+
460
+ const handleResult = (result: SDKResultMessage) => {
461
+ // result.usage is a whole-run aggregate, not occupancy (see
462
+ // contextOccupancyTokens); only the capacity is trustworthy here. The
463
+ // occupancy itself was already emitted by the last assistant message.
464
+ const contextWindow = resultContextWindow(result);
465
+ emit({
466
+ _tag: "UsageChanged",
467
+ contextWindow: contextWindow ?? state.meta.contextWindow,
468
+ });
469
+ if (
470
+ contextWindow !== undefined &&
471
+ contextWindow !== state.meta.contextWindow
472
+ ) {
473
+ updateMeta({ contextWindow });
474
+ }
475
+
476
+ if (state.interruptRequested) {
477
+ settle({ _tag: "Interrupted", partialText: partialText() });
478
+ } else if (result.subtype === "success") {
479
+ settle({
480
+ _tag: "Completed",
481
+ finalText: result.result.trim() || state.currentText,
482
+ });
483
+ } else {
484
+ const details =
485
+ result.errors.filter((error) => error.trim()).join("\n") ||
486
+ result.stop_reason ||
487
+ `Claude Code ended with ${result.subtype}`;
488
+ settle({
489
+ _tag: "Failed",
490
+ errorText: boundedError(details),
491
+ partialText: partialText(),
492
+ });
493
+ }
494
+ };
495
+
496
+ const handleMessage = (message: SDKMessage) => {
497
+ if (state.closed) return;
498
+ // A queued steer's turn normally announces itself with a repeated
499
+ // system/init, but any turn activity is an equally valid begin signal —
500
+ // without this, a missed init would stream events into a "done" run
501
+ // that could then never settle.
502
+ if (
503
+ message.type === "stream_event" ||
504
+ message.type === "assistant" ||
505
+ message.type === "result"
506
+ ) {
507
+ beginQueuedRunIfNeeded();
508
+ }
509
+ if (message.type === "system" && message.subtype === "init") {
510
+ beginQueuedRunIfNeeded();
511
+ updateMeta({
512
+ modelLabel: message.model,
513
+ nativeSessionId: message.session_id,
514
+ sessionFilePath: sessionFilePath(message.cwd, message.session_id),
515
+ contextWindow: CLAUDE_CONTEXT_WINDOW,
516
+ });
517
+ } else if (message.type === "stream_event") {
518
+ if (message.parent_tool_use_id !== null) return;
519
+ if (message.event.type === "message_start") {
520
+ state.responseSequence++;
521
+ clearConsumedSteers();
522
+ } else if (message.event.type === "content_block_delta") {
523
+ const delta = message.event.delta;
524
+ if (delta.type === "text_delta") {
525
+ state.liveText += delta.text;
526
+ emit({ _tag: "AssistantDelta", kind: "text", delta: delta.text });
527
+ } else if (delta.type === "thinking_delta") {
528
+ emit({
529
+ _tag: "AssistantDelta",
530
+ kind: "thinking",
531
+ delta: delta.thinking,
532
+ });
533
+ }
534
+ }
535
+ } else if (message.type === "assistant") {
536
+ handleAssistant(message);
537
+ } else if (message.type === "user") {
538
+ handleUser(message);
539
+ } else if (message.type === "result") {
540
+ handleResult(message);
541
+ }
542
+ };
543
+
544
+ const pump = async () => {
545
+ let failure: string | undefined;
546
+ try {
547
+ for await (const message of nativeQuery) handleMessage(message);
548
+ } catch (error) {
549
+ if (!state.closed && !abortController.signal.aborted) {
550
+ failure = boundedError(error);
551
+ }
552
+ } finally {
553
+ if (!state.closed) {
554
+ if (state.activeRun) {
555
+ settle(
556
+ state.interruptRequested
557
+ ? { _tag: "Interrupted", partialText: partialText() }
558
+ : {
559
+ _tag: "Failed",
560
+ errorText:
561
+ failure ?? "Claude Code query ended unexpectedly",
562
+ partialText: partialText(),
563
+ },
564
+ );
565
+ } else if (failure) {
566
+ emit({ _tag: "BackendError", message: failure });
567
+ }
568
+ state.closed = true;
569
+ Queue.endUnsafe(events);
570
+ }
571
+ resolvePumpDone?.();
572
+ }
573
+ };
574
+
575
+ yield* Effect.addFinalizer(() =>
576
+ Effect.promise(async () => {
577
+ // Settle before marking closed: the pump's finally skips settlement
578
+ // once closed, and every run must end in a RunSettled even when the
579
+ // scope closes mid-run.
580
+ if (state.activeRun) {
581
+ settle({ _tag: "Interrupted", partialText: partialText() });
582
+ }
583
+ state.closed = true;
584
+ input.end();
585
+ abortController.abort();
586
+ nativeQuery.close();
587
+ await waitBounded(pumpDone, INTERRUPT_TIMEOUT_MS);
588
+ Queue.endUnsafe(events);
589
+ }),
590
+ );
591
+
592
+ void pump();
593
+
594
+ const submit = (text: string) => {
595
+ const wasActive = state.activeRun;
596
+ const message = input.push(text);
597
+ if (!message) return false;
598
+ if (!wasActive) {
599
+ state.activeRun = true;
600
+ state.runVersion++;
601
+ state.currentText = "";
602
+ state.liveText = "";
603
+ }
604
+ state.submittedUuids.add(message.uuid ?? "");
605
+ // Idle restarts flip status synchronously (like pi's startRun); a steer
606
+ // into an active run must NOT re-emit RunStarted — its own turn begins
607
+ // later via beginQueuedRunIfNeeded.
608
+ if (!wasActive) emit({ _tag: "RunStarted" });
609
+ emit({ _tag: "UserMessage", text });
610
+ if (wasActive) {
611
+ state.queued.push({
612
+ text,
613
+ kind: "steer",
614
+ uuid: message.uuid ?? "",
615
+ afterResponse: state.responseSequence,
616
+ });
617
+ emit({ _tag: "QueueChanged", queued: queuedView() });
618
+ }
619
+ return true;
620
+ };
621
+
622
+ const waitForVersion = (version: number) => {
623
+ if (state.lastSettledVersion >= version) return Promise.resolve();
624
+ return new Promise<void>((resolve) => {
625
+ const waiter = () => {
626
+ if (state.lastSettledVersion < version && !state.closed) return;
627
+ state.settleWaiters.delete(waiter);
628
+ resolve();
629
+ };
630
+ state.settleWaiters.add(waiter);
631
+ });
632
+ };
633
+
634
+ emit({ _tag: "MetaChanged", meta: state.meta });
635
+ submit(task.prompt);
636
+
637
+ return {
638
+ meta: Effect.sync(() => state.meta),
639
+ events: Stream.fromQueue(events),
640
+ send: (text) =>
641
+ Effect.suspend((): Effect.Effect<void, SendError> => {
642
+ if (state.closed) {
643
+ return new SendError({ message: "Subagent session is closed." });
644
+ }
645
+ return submit(text)
646
+ ? Effect.void
647
+ : new SendError({ message: "Subagent session is closed." });
648
+ }),
649
+ interrupt: Effect.promise(async () => {
650
+ if (state.closed || !state.activeRun) return;
651
+ const version = state.runVersion;
652
+ state.interruptRequested = true;
653
+ input.clear();
654
+ state.queued = [];
655
+ emit({ _tag: "QueueChanged", queued: [] });
656
+
657
+ const interruptAndSettle = (async () => {
658
+ try {
659
+ const receipt = await nativeQuery.interrupt();
660
+ const hasOwnQueuedMessage = receipt?.still_queued?.some((uuid) =>
661
+ state.submittedUuids.has(uuid),
662
+ );
663
+ if (hasOwnQueuedMessage) {
664
+ // 0.3.207 exposes cancellation receipts but no public per-message
665
+ // cancel method. Closing is the only way to prevent a cancelled
666
+ // queued prompt from immediately starting another turn.
667
+ input.end();
668
+ nativeQuery.close();
669
+ }
670
+ } catch (error) {
671
+ if (!state.closed) {
672
+ emit({ _tag: "BackendError", message: boundedError(error) });
673
+ }
674
+ }
675
+ await waitForVersion(version);
676
+ })();
677
+
678
+ await waitBounded(interruptAndSettle, INTERRUPT_TIMEOUT_MS);
679
+ if (!state.closed && state.activeRun && state.runVersion === version) {
680
+ // Covers pre-init/pending races and SDK versions that acknowledge an
681
+ // interrupt without delivering a result. Force-close after settling
682
+ // so a late native result cannot resurrect or re-settle this run.
683
+ settle({ _tag: "Interrupted", partialText: partialText() });
684
+ state.closed = true;
685
+ input.end();
686
+ abortController.abort();
687
+ nativeQuery.close();
688
+ Queue.endUnsafe(events);
689
+ }
690
+ }),
691
+ } satisfies SubagentSession;
692
+ });
693
+
694
+ // --- Backend -----------------------------------------------------------------
695
+
696
+ export const claudeBackend: SubagentBackend = {
697
+ name: "claude",
698
+ capabilities: { steering: true, modelSelection: true, reasoningEffort: true },
699
+ available: Effect.sync(() => resolveClaudeBinary() !== undefined),
700
+ spawn: makeClaudeSession,
701
+ };