@asterxsk/kiln 0.1.0 → 0.2.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (203) hide show
  1. package/LICENSE +21 -21
  2. package/README.md +170 -170
  3. package/agent/AGENTS.md +67 -67
  4. package/agent/README.md +5 -5
  5. package/agent/extensions/AGENTS.md +68 -68
  6. package/agent/extensions/ask-user/index.ts +418 -418
  7. package/agent/extensions/ask-user/package-lock.json +769 -769
  8. package/agent/extensions/ask-user/package.json +19 -19
  9. package/agent/extensions/ask-user/prompt.ts +45 -45
  10. package/agent/extensions/ask-user/tsconfig.json +7 -7
  11. package/agent/extensions/background-terminals/docs/implementation-guide.md +942 -942
  12. package/agent/extensions/background-terminals/index.ts +627 -627
  13. package/agent/extensions/background-terminals/manager.test.ts +735 -735
  14. package/agent/extensions/background-terminals/output.test.ts +109 -109
  15. package/agent/extensions/background-terminals/package-lock.json +769 -769
  16. package/agent/extensions/background-terminals/package.json +17 -17
  17. package/agent/extensions/background-terminals/prompt.test.ts +125 -125
  18. package/agent/extensions/background-terminals/ps.test.ts +82 -82
  19. package/agent/extensions/background-terminals/result-delivery.test.ts +44 -44
  20. package/agent/extensions/background-terminals/src/domain.ts +87 -87
  21. package/agent/extensions/background-terminals/src/manager.ts +907 -907
  22. package/agent/extensions/background-terminals/src/output.ts +84 -84
  23. package/agent/extensions/background-terminals/src/prompt.ts +142 -142
  24. package/agent/extensions/background-terminals/src/result-delivery.ts +27 -27
  25. package/agent/extensions/background-terminals/src/runtime.ts +36 -36
  26. package/agent/extensions/background-terminals/src/ui/output-view.ts +79 -79
  27. package/agent/extensions/background-terminals/src/ui/ps.ts +621 -621
  28. package/agent/extensions/background-terminals/tsconfig.json +7 -7
  29. package/agent/extensions/file-search/index.spec.ts +443 -443
  30. package/agent/extensions/file-search/index.ts +459 -459
  31. package/agent/extensions/file-search/package-lock.json +2253 -2253
  32. package/agent/extensions/file-search/package.json +23 -23
  33. package/agent/extensions/file-search/src/args.ts +122 -122
  34. package/agent/extensions/file-search/src/binaries.ts +422 -422
  35. package/agent/extensions/file-search/src/output.ts +126 -126
  36. package/agent/extensions/file-search/src/process.ts +146 -146
  37. package/agent/extensions/file-search/src/prompt.ts +52 -52
  38. package/agent/extensions/file-search/tsconfig.json +7 -7
  39. package/agent/extensions/modelconf/PLAN.md +915 -915
  40. package/agent/extensions/modelconf/index.ts +296 -296
  41. package/agent/extensions/modelconf/src/ui/ModelConfView.ts +1101 -1101
  42. package/agent/extensions/pi-web-access/CHANGELOG.md +690 -690
  43. package/agent/extensions/pi-web-access/LICENSE +21 -21
  44. package/agent/extensions/pi-web-access/README.md +470 -470
  45. package/agent/extensions/pi-web-access/SECURITY.md +5 -5
  46. package/agent/extensions/pi-web-access/activity.ts +101 -101
  47. package/agent/extensions/pi-web-access/auth-fetch.ts +148 -148
  48. package/agent/extensions/pi-web-access/brightdata-unlocker.ts +272 -272
  49. package/agent/extensions/pi-web-access/chrome-cookies.ts +669 -669
  50. package/agent/extensions/pi-web-access/content-find.ts +139 -139
  51. package/agent/extensions/pi-web-access/credential-source.ts +191 -191
  52. package/agent/extensions/pi-web-access/data-uri-sanitize.ts +406 -406
  53. package/agent/extensions/pi-web-access/datalab-pdf-extract.ts +568 -568
  54. package/agent/extensions/pi-web-access/declared-web-links.ts +173 -173
  55. package/agent/extensions/pi-web-access/evidence/CONTRACT-EVIDENCE.md +496 -496
  56. package/agent/extensions/pi-web-access/evidence/contract-probe.mjs +140 -140
  57. package/agent/extensions/pi-web-access/exa.ts +526 -526
  58. package/agent/extensions/pi-web-access/extract.ts +1196 -1196
  59. package/agent/extensions/pi-web-access/feature-config.ts +29 -29
  60. package/agent/extensions/pi-web-access/fetch-params.ts +111 -111
  61. package/agent/extensions/pi-web-access/gemini-adc.ts +298 -298
  62. package/agent/extensions/pi-web-access/gemini-api.ts +353 -353
  63. package/agent/extensions/pi-web-access/gemini-pdf-extract.ts +108 -108
  64. package/agent/extensions/pi-web-access/gemini-url-context.ts +128 -128
  65. package/agent/extensions/pi-web-access/gemini-web-config.ts +101 -101
  66. package/agent/extensions/pi-web-access/gemini-web.ts +487 -487
  67. package/agent/extensions/pi-web-access/github-api.ts +197 -197
  68. package/agent/extensions/pi-web-access/github-extract.ts +746 -746
  69. package/agent/extensions/pi-web-access/github-issue-pr.ts +700 -700
  70. package/agent/extensions/pi-web-access/index.ts +1737 -1737
  71. package/agent/extensions/pi-web-access/package-lock.json +5808 -5808
  72. package/agent/extensions/pi-web-access/package.json +64 -64
  73. package/agent/extensions/pi-web-access/page-query.ts +96 -96
  74. package/agent/extensions/pi-web-access/pdf-extract.ts +409 -409
  75. package/agent/extensions/pi-web-access/promise-try.d.ts +7 -7
  76. package/agent/extensions/pi-web-access/query-rewrite.ts +51 -51
  77. package/agent/extensions/pi-web-access/render-search-error.ts +170 -170
  78. package/agent/extensions/pi-web-access/rsc-extract.ts +338 -338
  79. package/agent/extensions/pi-web-access/source-check.ts +282 -282
  80. package/agent/extensions/pi-web-access/ssrf-protection.ts +526 -526
  81. package/agent/extensions/pi-web-access/storage.ts +521 -521
  82. package/agent/extensions/pi-web-access/summary-model-scope.ts +125 -125
  83. package/agent/extensions/pi-web-access/test/auth-fetch.test.mjs +208 -208
  84. package/agent/extensions/pi-web-access/test/brightdata-unlocker.test.mjs +840 -840
  85. package/agent/extensions/pi-web-access/test/chrome-cookie-extraction.test.mjs +441 -441
  86. package/agent/extensions/pi-web-access/test/config-path.test.mjs +283 -283
  87. package/agent/extensions/pi-web-access/test/content-find.test.mjs +25 -25
  88. package/agent/extensions/pi-web-access/test/credential-source.test.mjs +118 -118
  89. package/agent/extensions/pi-web-access/test/data-uri-sanitize.test.mjs +210 -210
  90. package/agent/extensions/pi-web-access/test/datalab-pdf-extract.test.mjs +552 -552
  91. package/agent/extensions/pi-web-access/test/declared-web-links.test.mjs +212 -212
  92. package/agent/extensions/pi-web-access/test/fetch-answer-storage.test.mjs +40 -40
  93. package/agent/extensions/pi-web-access/test/fetch-cache-storage.test.mjs +334 -334
  94. package/agent/extensions/pi-web-access/test/fetch-content-domain-policy.test.mjs +95 -95
  95. package/agent/extensions/pi-web-access/test/fetch-modes.test.mjs +53 -53
  96. package/agent/extensions/pi-web-access/test/fetch-not-found-guidance.test.mjs +92 -92
  97. package/agent/extensions/pi-web-access/test/fetch-params.test.mjs +86 -86
  98. package/agent/extensions/pi-web-access/test/fetch-render-call.test.mjs +34 -34
  99. package/agent/extensions/pi-web-access/test/fetch-routing.test.mjs +173 -173
  100. package/agent/extensions/pi-web-access/test/gemini-adc-auth.test.mjs +257 -257
  101. package/agent/extensions/pi-web-access/test/gemini-api-transport.test.mjs +170 -170
  102. package/agent/extensions/pi-web-access/test/gemini-pdf-extract.test.mjs +133 -133
  103. package/agent/extensions/pi-web-access/test/gemini-web-cookie-opt-in.test.mjs +178 -178
  104. package/agent/extensions/pi-web-access/test/gemini-web-header-overflow.test.mjs +148 -148
  105. package/agent/extensions/pi-web-access/test/get-search-content.test.mjs +223 -223
  106. package/agent/extensions/pi-web-access/test/github-extract.test.mjs +378 -378
  107. package/agent/extensions/pi-web-access/test/github-issue-pr.test.mjs +565 -565
  108. package/agent/extensions/pi-web-access/test/inline-content-config.test.mjs +99 -99
  109. package/agent/extensions/pi-web-access/test/lazy-extract-load.test.mjs +118 -118
  110. package/agent/extensions/pi-web-access/test/local-video-oversize.test.mjs +52 -52
  111. package/agent/extensions/pi-web-access/test/package-typebox-dependency.test.mjs +50 -50
  112. package/agent/extensions/pi-web-access/test/page-query.test.mjs +51 -51
  113. package/agent/extensions/pi-web-access/test/pdf-config.test.mjs +140 -140
  114. package/agent/extensions/pi-web-access/test/pdf-extract.test.mjs +500 -500
  115. package/agent/extensions/pi-web-access/test/proxy-transport.test.mjs +286 -286
  116. package/agent/extensions/pi-web-access/test/query-rewrite.test.mjs +52 -52
  117. package/agent/extensions/pi-web-access/test/rsc-fallback.test.mjs +102 -102
  118. package/agent/extensions/pi-web-access/test/search-error-render.test.mjs +152 -152
  119. package/agent/extensions/pi-web-access/test/search-providers.test.mjs +274 -274
  120. package/agent/extensions/pi-web-access/test/source-check.test.mjs +179 -179
  121. package/agent/extensions/pi-web-access/test/ssrf-allow-ranges-config.test.mjs +205 -205
  122. package/agent/extensions/pi-web-access/test/ssrf-protection.test.mjs +456 -456
  123. package/agent/extensions/pi-web-access/test/tool-registration-config.test.mjs +182 -182
  124. package/agent/extensions/pi-web-access/test/youtube-extract-errors.test.mjs +64 -64
  125. package/agent/extensions/pi-web-access/tsconfig.json +11 -11
  126. package/agent/extensions/pi-web-access/utils.ts +451 -451
  127. package/agent/extensions/pi-web-access/video-extract.ts +392 -392
  128. package/agent/extensions/pi-web-access/youtube-extract.ts +328 -328
  129. package/agent/extensions/shared/activity-status.ts +31 -31
  130. package/agent/extensions/shared/child-session.test.ts +270 -270
  131. package/agent/extensions/shared/child-session.ts +148 -148
  132. package/agent/extensions/shared/context-utilization.test.ts +48 -48
  133. package/agent/extensions/shared/context-utilization.ts +47 -47
  134. package/agent/extensions/shared/dashboard-state.ts +99 -99
  135. package/agent/extensions/shared/tool-call-timeout.test.ts +117 -117
  136. package/agent/extensions/shared/tool-call-timeout.ts +104 -104
  137. package/agent/extensions/subagents/by-the-way.test.ts +29 -29
  138. package/agent/extensions/subagents/claude.test.ts +119 -119
  139. package/agent/extensions/subagents/codex.test.ts +102 -102
  140. package/agent/extensions/subagents/context-usage.test.ts +107 -107
  141. package/agent/extensions/subagents/docs/design-plan.md +568 -568
  142. package/agent/extensions/subagents/docs/effect-v4-extension-guide.md +354 -354
  143. package/agent/extensions/subagents/docs/effect-v4-notes.md +571 -571
  144. package/agent/extensions/subagents/index.ts +779 -779
  145. package/agent/extensions/subagents/manager.test.ts +276 -276
  146. package/agent/extensions/subagents/package-lock.json +2244 -2244
  147. package/agent/extensions/subagents/package.json +19 -19
  148. package/agent/extensions/subagents/result-delivery.test.ts +27 -27
  149. package/agent/extensions/subagents/src/backend.ts +73 -73
  150. package/agent/extensions/subagents/src/backends/claude.ts +701 -701
  151. package/agent/extensions/subagents/src/backends/codex.ts +1060 -1060
  152. package/agent/extensions/subagents/src/backends/pi.ts +575 -575
  153. package/agent/extensions/subagents/src/backends/stub.ts +300 -300
  154. package/agent/extensions/subagents/src/by-the-way.ts +21 -21
  155. package/agent/extensions/subagents/src/domain.ts +253 -253
  156. package/agent/extensions/subagents/src/format.ts +74 -74
  157. package/agent/extensions/subagents/src/manager.ts +736 -736
  158. package/agent/extensions/subagents/src/prompt.ts +92 -92
  159. package/agent/extensions/subagents/src/result-delivery.ts +20 -20
  160. package/agent/extensions/subagents/src/runtime.ts +53 -53
  161. package/agent/extensions/subagents/src/ui/takeover.ts +583 -583
  162. package/agent/extensions/subagents/src/ui/transcript.ts +201 -201
  163. package/agent/extensions/subagents/takeover.test.ts +29 -29
  164. package/agent/extensions/subagents/tsconfig.json +7 -7
  165. package/agent/extensions/todo/AGENTS.md +38 -38
  166. package/agent/extensions/todo/LICENSE +21 -21
  167. package/agent/extensions/todo/config.ts +55 -55
  168. package/agent/extensions/todo/index.ts +151 -151
  169. package/agent/extensions/todo/locales/de.json +17 -17
  170. package/agent/extensions/todo/locales/en.json +15 -15
  171. package/agent/extensions/todo/locales/es.json +17 -17
  172. package/agent/extensions/todo/locales/fr.json +17 -17
  173. package/agent/extensions/todo/locales/pt-BR.json +17 -17
  174. package/agent/extensions/todo/locales/pt.json +17 -17
  175. package/agent/extensions/todo/locales/ru.json +17 -17
  176. package/agent/extensions/todo/locales/uk.json +17 -17
  177. package/agent/extensions/todo/locales/zh.json +17 -17
  178. package/agent/extensions/todo/package-lock.json +3358 -3358
  179. package/agent/extensions/todo/package.json +67 -67
  180. package/agent/extensions/todo/state/i18n-bridge.ts +64 -64
  181. package/agent/extensions/todo/state/invariants.ts +20 -20
  182. package/agent/extensions/todo/state/replay.ts +38 -38
  183. package/agent/extensions/todo/state/selectors.ts +107 -107
  184. package/agent/extensions/todo/state/state-reducer.ts +326 -326
  185. package/agent/extensions/todo/state/state.ts +18 -18
  186. package/agent/extensions/todo/state/store.ts +82 -82
  187. package/agent/extensions/todo/state/task-graph.ts +57 -57
  188. package/agent/extensions/todo/todo-overlay.ts +200 -200
  189. package/agent/extensions/todo/todo.ts +155 -155
  190. package/agent/extensions/todo/tool/response-envelope.ts +109 -109
  191. package/agent/extensions/todo/tool/types.ts +206 -206
  192. package/agent/extensions/todo/view/format.ts +177 -177
  193. package/agent/install.ps1 +637 -527
  194. package/agent/install.sh +620 -511
  195. package/agent/keybindings.json +7 -7
  196. package/bin/kiln.js +124 -11
  197. package/package.json +8 -2
  198. package/agent/extensions/taste/index.ts +0 -443
  199. package/agent/extensions/taste/install.ps1 +0 -23
  200. package/agent/extensions/taste/install.sh +0 -21
  201. /package/agent/extensions/{status line → statusline}/index.ts +0 -0
  202. /package/agent/extensions/{status line → statusline}/install.ps1 +0 -0
  203. /package/agent/extensions/{status line → statusline}/install.sh +0 -0
@@ -1,406 +1,406 @@
1
- import { Buffer } from "node:buffer";
2
- import { createHash } from "node:crypto";
3
-
4
- // Replaces inline RFC 2397 data: URIs in extracted text with explicit bounded
5
- // omission markers so base64 payloads never reach model-visible tool results,
6
- // the fetch cache, or session persistence. Carved out of the original
7
- // persistence-safety layer; only the text-sanitization path is retained.
8
-
9
- const MAX_DATA_URI_HEADER_CHARS = 1024;
10
- const MAX_MIME_CHARS = 127;
11
- const MAX_MARKER_SOURCE_CHARS = 180;
12
-
13
- export type DataUriEncoding = "base64" | "percent-encoded";
14
- export type DigestBasis = "decoded" | "encoded";
15
-
16
- export interface DataUriOmission {
17
- ordinal: number;
18
- sourcePath: string;
19
- mimeType: string;
20
- encoding: DataUriEncoding;
21
- encodedBytes: number;
22
- decodedBytes: number | null;
23
- decodeError?: string;
24
- sha256: string;
25
- digestBasis: DigestBasis;
26
- retrieval: "not-retained";
27
- }
28
-
29
-
30
- interface InternalDataUriOmission extends DataUriOmission {
31
- markerStart: number;
32
- markerEnd: number;
33
- }
34
-
35
- interface SanitizationState {
36
- nextOrdinal: number;
37
- omissions: InternalDataUriOmission[];
38
- }
39
-
40
-
41
- function sha256Bytes(value: string | Uint8Array): string {
42
- return createHash("sha256").update(value).digest("hex");
43
- }
44
-
45
-
46
- function asciiLowerCode(code: number): number {
47
- return code >= 65 && code <= 90 ? code + 32 : code;
48
- }
49
-
50
- function matchesDataScheme(text: string, index: number): boolean {
51
- return index + 5 <= text.length
52
- && asciiLowerCode(text.charCodeAt(index)) === 100
53
- && asciiLowerCode(text.charCodeAt(index + 1)) === 97
54
- && asciiLowerCode(text.charCodeAt(index + 2)) === 116
55
- && asciiLowerCode(text.charCodeAt(index + 3)) === 97
56
- && text.charCodeAt(index + 4) === 58;
57
- }
58
-
59
- function isSchemeBoundary(text: string, index: number): boolean {
60
- if (index === 0) return true;
61
- const code = text.charCodeAt(index - 1);
62
- const alphaNumeric = (code >= 48 && code <= 57)
63
- || (code >= 65 && code <= 90)
64
- || (code >= 97 && code <= 122);
65
- return !alphaNumeric && code !== 43 && code !== 45 && code !== 46;
66
- }
67
-
68
- function findNextDataScheme(text: string, from: number): number {
69
- for (let i = from; i + 5 <= text.length; i++) {
70
- if (matchesDataScheme(text, i) && isSchemeBoundary(text, i)) return i;
71
- }
72
- return -1;
73
- }
74
-
75
- type DataUriEnclosure =
76
- | { kind: "quote"; close: "\"" | "'" | "`" }
77
- | { kind: "parentheses" }
78
- | { kind: "angle" }
79
- | null;
80
-
81
- interface ScannedDataUriCandidate {
82
- end: number;
83
- comma: number;
84
- enclosure: DataUriEnclosure;
85
- }
86
-
87
- function dataUriEnclosure(text: string, start: number): DataUriEnclosure {
88
- if (start === 0) return null;
89
- const immediateIndex = start - 1;
90
- const immediate = text[immediateIndex];
91
- if (immediate === "\"" || immediate === "'" || immediate === "`") {
92
- const beforeQuote = immediateIndex > 0 ? text[immediateIndex - 1] : "";
93
- const likelyOpeningQuote = immediateIndex === 0
94
- || beforeQuote === "="
95
- || beforeQuote === "("
96
- || beforeQuote === "["
97
- || beforeQuote === "{"
98
- || beforeQuote === ":"
99
- || beforeQuote === ","
100
- || /\s/.test(beforeQuote);
101
- if (likelyOpeningQuote) return { kind: "quote", close: immediate };
102
- }
103
-
104
- let openerIndex = immediateIndex;
105
- while (openerIndex >= 0 && (text[openerIndex] === " " || text[openerIndex] === "\t")) openerIndex--;
106
- const opener = text[openerIndex];
107
- if (opener === "(") return { kind: "parentheses" };
108
- if (opener === "<") return { kind: "angle" };
109
- return null;
110
- }
111
-
112
- function isBareDataUriTerminator(ch: string): boolean {
113
- const code = ch.charCodeAt(0);
114
- return code <= 32
115
- || code === 127
116
- || ch === "\""
117
- || ch === "`"
118
- || ch === "<"
119
- || ch === ">";
120
- }
121
-
122
- /** Scan one candidate exactly once. Enclosures consume malformed whitespace and
123
- * balanced inner parentheses so invalid payload suffixes cannot escape. */
124
- function scanDataUriCandidate(text: string, start: number): ScannedDataUriCandidate {
125
- const enclosure = dataUriEnclosure(text, start);
126
- let comma = -1;
127
- let depth = enclosure?.kind === "parentheses" ? 1 : 0;
128
- let index = start + 5;
129
-
130
- for (; index < text.length; index++) {
131
- const ch = text[index];
132
- if (enclosure?.kind === "quote") {
133
- if (ch === enclosure.close) break;
134
- } else if (enclosure?.kind === "parentheses") {
135
- if (ch === "(") {
136
- depth++;
137
- } else if (ch === ")") {
138
- depth--;
139
- if (depth === 0) break;
140
- }
141
- } else if (enclosure?.kind === "angle") {
142
- if (ch === ">") break;
143
- } else if (isBareDataUriTerminator(ch)) {
144
- break;
145
- }
146
- if (comma < 0 && ch === ",") comma = index;
147
- }
148
-
149
- return { end: index, comma, enclosure };
150
- }
151
-
152
- function headerEndsWithBase64(text: string, headerStart: number, comma: number): boolean {
153
- let end = comma;
154
- while (end > headerStart && (text[end - 1] === " " || text[end - 1] === "\t")) end--;
155
- const token = "base64";
156
- if (end - headerStart < token.length + 1) return false;
157
- const tokenStart = end - token.length;
158
- for (let i = 0; i < token.length; i++) {
159
- if (asciiLowerCode(text.charCodeAt(tokenStart + i)) !== token.charCodeAt(i)) return false;
160
- }
161
- return tokenStart > headerStart && text[tokenStart - 1] === ";";
162
- }
163
-
164
- function isMimeTokenChar(code: number): boolean {
165
- if (code < 33 || code > 126) return false;
166
- // RFC 2045 token = printable ASCII excluding tspecials. Slash is handled
167
- // separately as the single type/subtype separator.
168
- switch (code) {
169
- case 34: // "
170
- case 40: // (
171
- case 41: // )
172
- case 44: // ,
173
- case 47: // /
174
- case 58: // :
175
- case 59: // ;
176
- case 60: // <
177
- case 61: // =
178
- case 62: // >
179
- case 63: // ?
180
- case 64: // @
181
- case 91: // [
182
- case 92: // backslash
183
- case 93: // ]
184
- return false;
185
- default:
186
- return true;
187
- }
188
- }
189
-
190
- function normalizeMimeType(text: string, headerStart: number, comma: number): string {
191
- let end = headerStart;
192
- while (end < comma && text[end] !== ";") end++;
193
- if (end === headerStart) return "text/plain";
194
- if (end - headerStart > MAX_MIME_CHARS) return "application/octet-stream";
195
-
196
- let slashCount = 0;
197
- for (let i = headerStart; i < end; i++) {
198
- const code = text.charCodeAt(i);
199
- if (code === 47) {
200
- slashCount++;
201
- if (i === headerStart || i === end - 1) return "application/octet-stream";
202
- continue;
203
- }
204
- if (!isMimeTokenChar(code)) return "application/octet-stream";
205
- }
206
- if (slashCount !== 1) return "application/octet-stream";
207
- return text.slice(headerStart, end).toLowerCase();
208
- }
209
-
210
- function hexValue(code: number): number {
211
- if (code >= 48 && code <= 57) return code - 48;
212
- if (code >= 65 && code <= 70) return code - 55;
213
- if (code >= 97 && code <= 102) return code - 87;
214
- return -1;
215
- }
216
-
217
- function decodePercentEncoded(payload: string): { bytes: Buffer } | { error: string } {
218
- const output = Buffer.allocUnsafe(Buffer.byteLength(payload, "utf8"));
219
- let outputOffset = 0;
220
- let cursor = 0;
221
-
222
- while (cursor < payload.length) {
223
- const percent = payload.indexOf("%", cursor);
224
- const runEnd = percent < 0 ? payload.length : percent;
225
- if (runEnd > cursor) {
226
- const run = Buffer.from(payload.slice(cursor, runEnd), "utf8");
227
- run.copy(output, outputOffset);
228
- outputOffset += run.length;
229
- }
230
- if (percent < 0) break;
231
- if (percent + 2 >= payload.length) return { error: "invalid-percent-escape" };
232
- const high = hexValue(payload.charCodeAt(percent + 1));
233
- const low = hexValue(payload.charCodeAt(percent + 2));
234
- if (high < 0 || low < 0) return { error: "invalid-percent-escape" };
235
- output[outputOffset++] = (high << 4) | low;
236
- cursor = percent + 3;
237
- }
238
-
239
- return { bytes: output.subarray(0, outputOffset) };
240
- }
241
-
242
- function isBase64AlphabetByte(byte: number): boolean {
243
- return (byte >= 65 && byte <= 90)
244
- || (byte >= 97 && byte <= 122)
245
- || (byte >= 48 && byte <= 57)
246
- || byte === 43
247
- || byte === 47;
248
- }
249
-
250
- function decodeBase64Payload(payload: string): { bytes: Buffer } | { error: string } {
251
- const percentDecoded = decodePercentEncoded(payload);
252
- if ("error" in percentDecoded) return percentDecoded;
253
- const encoded = percentDecoded.bytes;
254
- let paddingStart = encoded.length;
255
- let paddingCount = 0;
256
-
257
- for (let i = 0; i < encoded.length; i++) {
258
- const byte = encoded[i];
259
- if (byte > 127) return { error: "non-ascii-base64" };
260
- if (byte === 61) {
261
- if (paddingStart === encoded.length) paddingStart = i;
262
- paddingCount++;
263
- continue;
264
- }
265
- if (paddingStart !== encoded.length) return { error: "invalid-base64-padding" };
266
- if (!isBase64AlphabetByte(byte)) return { error: "invalid-base64-character" };
267
- }
268
-
269
- if (paddingCount > 2) return { error: "invalid-base64-padding" };
270
- if (paddingCount > 0 && encoded.length % 4 !== 0) return { error: "invalid-base64-padding" };
271
- if (paddingCount === 0 && encoded.length % 4 === 1) return { error: "invalid-base64-length" };
272
- if (paddingCount === 1 && paddingStart % 4 !== 3) return { error: "invalid-base64-padding" };
273
- if (paddingCount === 2 && paddingStart % 4 !== 2) return { error: "invalid-base64-padding" };
274
-
275
- return { bytes: Buffer.from(encoded.toString("ascii"), "base64") };
276
- }
277
-
278
- function safeMarkerSource(sourcePath: string): string {
279
- const source = sourcePath || "value";
280
- let safe = "";
281
- for (const ch of source) {
282
- const code = ch.charCodeAt(0);
283
- const allowed = (code >= 48 && code <= 57)
284
- || (code >= 65 && code <= 90)
285
- || (code >= 97 && code <= 122)
286
- || ch === "."
287
- || ch === "_"
288
- || ch === "-"
289
- || ch === "["
290
- || ch === "]"
291
- || ch === "*"
292
- || ch === "$";
293
- safe += allowed ? ch : "_";
294
- }
295
- if (safe.length <= MAX_MARKER_SOURCE_CHARS) return safe;
296
- const suffix = sha256Bytes(source).slice(0, 12);
297
- return `${safe.slice(0, MAX_MARKER_SOURCE_CHARS - suffix.length - 1)}~${suffix}`;
298
- }
299
-
300
- function buildDataUriMarker(omission: DataUriOmission): string {
301
- const decoded = omission.decodedBytes === null ? "unknown" : String(omission.decodedBytes);
302
- const decodeError = omission.decodeError ? `; decodeError=${omission.decodeError}` : "";
303
- return `[pi-web-access inline data URI omitted; ordinal=${omission.ordinal}; source=${omission.sourcePath}; mime=${omission.mimeType}; encoding=${omission.encoding}; encodedBytes=${omission.encodedBytes}; decodedBytes=${decoded}${decodeError}; sha256=${omission.sha256}; digestBasis=${omission.digestBasis}; retrieval=not-retained]`;
304
- }
305
-
306
- function sanitizeTextInternal(text: string, sourcePath: string, state: SanitizationState): string {
307
- let scanFrom = 0;
308
- let retainedFrom = 0;
309
- let outputLength = 0;
310
- const pieces: string[] = [];
311
-
312
- while (scanFrom < text.length) {
313
- const start = findNextDataScheme(text, scanFrom);
314
- if (start < 0) break;
315
- const candidate = scanDataUriCandidate(text, start);
316
- const end = candidate.end;
317
- const headerStart = start + 5;
318
- const missingComma = candidate.comma < 0;
319
- // A bare prose label such as "data: value" is not an inline URI. Enclosed
320
- // or non-empty comma-less candidates are malformed URIs and are removed.
321
- if (missingComma && end === headerStart && candidate.enclosure === null) {
322
- scanFrom = end;
323
- continue;
324
- }
325
- const headerEnd = missingComma ? end : candidate.comma;
326
- const headerLength = headerEnd - headerStart;
327
- const encoding: DataUriEncoding = headerEndsWithBase64(text, headerStart, headerEnd)
328
- ? "base64"
329
- : "percent-encoded";
330
- const mimeType = normalizeMimeType(text, headerStart, headerEnd);
331
- // Without the required comma, the post-scheme bytes are ambiguous. Count
332
- // and digest the whole omitted segment on the encoded basis rather than
333
- // retaining any header/payload-looking suffix.
334
- const payload = missingComma
335
- ? text.slice(headerStart, end)
336
- : text.slice(candidate.comma + 1, end);
337
- const encodedBytes = Buffer.byteLength(payload, "utf8");
338
-
339
- let decodedBytes: number | null = null;
340
- let decodeError: string | undefined;
341
- let digestBasis: DigestBasis = "encoded";
342
- let digest = "";
343
-
344
- if (missingComma) {
345
- decodeError = "missing-comma";
346
- digest = sha256Bytes(payload);
347
- } else if (headerLength > MAX_DATA_URI_HEADER_CHARS) {
348
- decodeError = "header-too-long";
349
- digest = sha256Bytes(payload);
350
- } else {
351
- const decoded = encoding === "base64"
352
- ? decodeBase64Payload(payload)
353
- : decodePercentEncoded(payload);
354
- if ("error" in decoded) {
355
- decodeError = decoded.error;
356
- digest = sha256Bytes(payload);
357
- } else {
358
- decodedBytes = decoded.bytes.length;
359
- digestBasis = "decoded";
360
- digest = sha256Bytes(decoded.bytes);
361
- }
362
- }
363
-
364
- const omission: DataUriOmission = {
365
- ordinal: state.nextOrdinal++,
366
- sourcePath: safeMarkerSource(sourcePath),
367
- mimeType,
368
- encoding,
369
- encodedBytes,
370
- decodedBytes,
371
- ...(decodeError ? { decodeError } : {}),
372
- sha256: digest,
373
- digestBasis,
374
- retrieval: "not-retained",
375
- };
376
- const marker = buildDataUriMarker(omission);
377
- const prefix = text.slice(retainedFrom, start);
378
- pieces.push(prefix, marker);
379
- outputLength += prefix.length;
380
- const markerStart = outputLength;
381
- outputLength += marker.length;
382
- state.omissions.push({ ...omission, markerStart, markerEnd: outputLength });
383
- retainedFrom = end;
384
- scanFrom = end;
385
- }
386
-
387
- if (state.omissions.length === 0 && retainedFrom === 0) return text;
388
- pieces.push(text.slice(retainedFrom));
389
- return pieces.join("");
390
- }
391
-
392
-
393
- /** Replace every recognized RFC 2397-style inline data URI in one string. */
394
- export function sanitizeInlineDataUris(
395
- text: string,
396
- sourcePath: string,
397
- ): { text: string; omissions: DataUriOmission[] } {
398
- const state: SanitizationState = { nextOrdinal: 1, omissions: [] };
399
- const sanitized = sanitizeTextInternal(text, sourcePath, state);
400
- return {
401
- text: sanitized,
402
- omissions: state.omissions.map(({ markerStart: _start, markerEnd: _end, ...omission }) => omission),
403
- };
404
- }
405
-
406
- /** Sanitize every string leaf in a JSON-compatible value with one ordinal sequence. */
1
+ import { Buffer } from "node:buffer";
2
+ import { createHash } from "node:crypto";
3
+
4
+ // Replaces inline RFC 2397 data: URIs in extracted text with explicit bounded
5
+ // omission markers so base64 payloads never reach model-visible tool results,
6
+ // the fetch cache, or session persistence. Carved out of the original
7
+ // persistence-safety layer; only the text-sanitization path is retained.
8
+
9
+ const MAX_DATA_URI_HEADER_CHARS = 1024;
10
+ const MAX_MIME_CHARS = 127;
11
+ const MAX_MARKER_SOURCE_CHARS = 180;
12
+
13
+ export type DataUriEncoding = "base64" | "percent-encoded";
14
+ export type DigestBasis = "decoded" | "encoded";
15
+
16
+ export interface DataUriOmission {
17
+ ordinal: number;
18
+ sourcePath: string;
19
+ mimeType: string;
20
+ encoding: DataUriEncoding;
21
+ encodedBytes: number;
22
+ decodedBytes: number | null;
23
+ decodeError?: string;
24
+ sha256: string;
25
+ digestBasis: DigestBasis;
26
+ retrieval: "not-retained";
27
+ }
28
+
29
+
30
+ interface InternalDataUriOmission extends DataUriOmission {
31
+ markerStart: number;
32
+ markerEnd: number;
33
+ }
34
+
35
+ interface SanitizationState {
36
+ nextOrdinal: number;
37
+ omissions: InternalDataUriOmission[];
38
+ }
39
+
40
+
41
+ function sha256Bytes(value: string | Uint8Array): string {
42
+ return createHash("sha256").update(value).digest("hex");
43
+ }
44
+
45
+
46
+ function asciiLowerCode(code: number): number {
47
+ return code >= 65 && code <= 90 ? code + 32 : code;
48
+ }
49
+
50
+ function matchesDataScheme(text: string, index: number): boolean {
51
+ return index + 5 <= text.length
52
+ && asciiLowerCode(text.charCodeAt(index)) === 100
53
+ && asciiLowerCode(text.charCodeAt(index + 1)) === 97
54
+ && asciiLowerCode(text.charCodeAt(index + 2)) === 116
55
+ && asciiLowerCode(text.charCodeAt(index + 3)) === 97
56
+ && text.charCodeAt(index + 4) === 58;
57
+ }
58
+
59
+ function isSchemeBoundary(text: string, index: number): boolean {
60
+ if (index === 0) return true;
61
+ const code = text.charCodeAt(index - 1);
62
+ const alphaNumeric = (code >= 48 && code <= 57)
63
+ || (code >= 65 && code <= 90)
64
+ || (code >= 97 && code <= 122);
65
+ return !alphaNumeric && code !== 43 && code !== 45 && code !== 46;
66
+ }
67
+
68
+ function findNextDataScheme(text: string, from: number): number {
69
+ for (let i = from; i + 5 <= text.length; i++) {
70
+ if (matchesDataScheme(text, i) && isSchemeBoundary(text, i)) return i;
71
+ }
72
+ return -1;
73
+ }
74
+
75
+ type DataUriEnclosure =
76
+ | { kind: "quote"; close: "\"" | "'" | "`" }
77
+ | { kind: "parentheses" }
78
+ | { kind: "angle" }
79
+ | null;
80
+
81
+ interface ScannedDataUriCandidate {
82
+ end: number;
83
+ comma: number;
84
+ enclosure: DataUriEnclosure;
85
+ }
86
+
87
+ function dataUriEnclosure(text: string, start: number): DataUriEnclosure {
88
+ if (start === 0) return null;
89
+ const immediateIndex = start - 1;
90
+ const immediate = text[immediateIndex];
91
+ if (immediate === "\"" || immediate === "'" || immediate === "`") {
92
+ const beforeQuote = immediateIndex > 0 ? text[immediateIndex - 1] : "";
93
+ const likelyOpeningQuote = immediateIndex === 0
94
+ || beforeQuote === "="
95
+ || beforeQuote === "("
96
+ || beforeQuote === "["
97
+ || beforeQuote === "{"
98
+ || beforeQuote === ":"
99
+ || beforeQuote === ","
100
+ || /\s/.test(beforeQuote);
101
+ if (likelyOpeningQuote) return { kind: "quote", close: immediate };
102
+ }
103
+
104
+ let openerIndex = immediateIndex;
105
+ while (openerIndex >= 0 && (text[openerIndex] === " " || text[openerIndex] === "\t")) openerIndex--;
106
+ const opener = text[openerIndex];
107
+ if (opener === "(") return { kind: "parentheses" };
108
+ if (opener === "<") return { kind: "angle" };
109
+ return null;
110
+ }
111
+
112
+ function isBareDataUriTerminator(ch: string): boolean {
113
+ const code = ch.charCodeAt(0);
114
+ return code <= 32
115
+ || code === 127
116
+ || ch === "\""
117
+ || ch === "`"
118
+ || ch === "<"
119
+ || ch === ">";
120
+ }
121
+
122
+ /** Scan one candidate exactly once. Enclosures consume malformed whitespace and
123
+ * balanced inner parentheses so invalid payload suffixes cannot escape. */
124
+ function scanDataUriCandidate(text: string, start: number): ScannedDataUriCandidate {
125
+ const enclosure = dataUriEnclosure(text, start);
126
+ let comma = -1;
127
+ let depth = enclosure?.kind === "parentheses" ? 1 : 0;
128
+ let index = start + 5;
129
+
130
+ for (; index < text.length; index++) {
131
+ const ch = text[index];
132
+ if (enclosure?.kind === "quote") {
133
+ if (ch === enclosure.close) break;
134
+ } else if (enclosure?.kind === "parentheses") {
135
+ if (ch === "(") {
136
+ depth++;
137
+ } else if (ch === ")") {
138
+ depth--;
139
+ if (depth === 0) break;
140
+ }
141
+ } else if (enclosure?.kind === "angle") {
142
+ if (ch === ">") break;
143
+ } else if (isBareDataUriTerminator(ch)) {
144
+ break;
145
+ }
146
+ if (comma < 0 && ch === ",") comma = index;
147
+ }
148
+
149
+ return { end: index, comma, enclosure };
150
+ }
151
+
152
+ function headerEndsWithBase64(text: string, headerStart: number, comma: number): boolean {
153
+ let end = comma;
154
+ while (end > headerStart && (text[end - 1] === " " || text[end - 1] === "\t")) end--;
155
+ const token = "base64";
156
+ if (end - headerStart < token.length + 1) return false;
157
+ const tokenStart = end - token.length;
158
+ for (let i = 0; i < token.length; i++) {
159
+ if (asciiLowerCode(text.charCodeAt(tokenStart + i)) !== token.charCodeAt(i)) return false;
160
+ }
161
+ return tokenStart > headerStart && text[tokenStart - 1] === ";";
162
+ }
163
+
164
+ function isMimeTokenChar(code: number): boolean {
165
+ if (code < 33 || code > 126) return false;
166
+ // RFC 2045 token = printable ASCII excluding tspecials. Slash is handled
167
+ // separately as the single type/subtype separator.
168
+ switch (code) {
169
+ case 34: // "
170
+ case 40: // (
171
+ case 41: // )
172
+ case 44: // ,
173
+ case 47: // /
174
+ case 58: // :
175
+ case 59: // ;
176
+ case 60: // <
177
+ case 61: // =
178
+ case 62: // >
179
+ case 63: // ?
180
+ case 64: // @
181
+ case 91: // [
182
+ case 92: // backslash
183
+ case 93: // ]
184
+ return false;
185
+ default:
186
+ return true;
187
+ }
188
+ }
189
+
190
+ function normalizeMimeType(text: string, headerStart: number, comma: number): string {
191
+ let end = headerStart;
192
+ while (end < comma && text[end] !== ";") end++;
193
+ if (end === headerStart) return "text/plain";
194
+ if (end - headerStart > MAX_MIME_CHARS) return "application/octet-stream";
195
+
196
+ let slashCount = 0;
197
+ for (let i = headerStart; i < end; i++) {
198
+ const code = text.charCodeAt(i);
199
+ if (code === 47) {
200
+ slashCount++;
201
+ if (i === headerStart || i === end - 1) return "application/octet-stream";
202
+ continue;
203
+ }
204
+ if (!isMimeTokenChar(code)) return "application/octet-stream";
205
+ }
206
+ if (slashCount !== 1) return "application/octet-stream";
207
+ return text.slice(headerStart, end).toLowerCase();
208
+ }
209
+
210
+ function hexValue(code: number): number {
211
+ if (code >= 48 && code <= 57) return code - 48;
212
+ if (code >= 65 && code <= 70) return code - 55;
213
+ if (code >= 97 && code <= 102) return code - 87;
214
+ return -1;
215
+ }
216
+
217
+ function decodePercentEncoded(payload: string): { bytes: Buffer } | { error: string } {
218
+ const output = Buffer.allocUnsafe(Buffer.byteLength(payload, "utf8"));
219
+ let outputOffset = 0;
220
+ let cursor = 0;
221
+
222
+ while (cursor < payload.length) {
223
+ const percent = payload.indexOf("%", cursor);
224
+ const runEnd = percent < 0 ? payload.length : percent;
225
+ if (runEnd > cursor) {
226
+ const run = Buffer.from(payload.slice(cursor, runEnd), "utf8");
227
+ run.copy(output, outputOffset);
228
+ outputOffset += run.length;
229
+ }
230
+ if (percent < 0) break;
231
+ if (percent + 2 >= payload.length) return { error: "invalid-percent-escape" };
232
+ const high = hexValue(payload.charCodeAt(percent + 1));
233
+ const low = hexValue(payload.charCodeAt(percent + 2));
234
+ if (high < 0 || low < 0) return { error: "invalid-percent-escape" };
235
+ output[outputOffset++] = (high << 4) | low;
236
+ cursor = percent + 3;
237
+ }
238
+
239
+ return { bytes: output.subarray(0, outputOffset) };
240
+ }
241
+
242
+ function isBase64AlphabetByte(byte: number): boolean {
243
+ return (byte >= 65 && byte <= 90)
244
+ || (byte >= 97 && byte <= 122)
245
+ || (byte >= 48 && byte <= 57)
246
+ || byte === 43
247
+ || byte === 47;
248
+ }
249
+
250
+ function decodeBase64Payload(payload: string): { bytes: Buffer } | { error: string } {
251
+ const percentDecoded = decodePercentEncoded(payload);
252
+ if ("error" in percentDecoded) return percentDecoded;
253
+ const encoded = percentDecoded.bytes;
254
+ let paddingStart = encoded.length;
255
+ let paddingCount = 0;
256
+
257
+ for (let i = 0; i < encoded.length; i++) {
258
+ const byte = encoded[i];
259
+ if (byte > 127) return { error: "non-ascii-base64" };
260
+ if (byte === 61) {
261
+ if (paddingStart === encoded.length) paddingStart = i;
262
+ paddingCount++;
263
+ continue;
264
+ }
265
+ if (paddingStart !== encoded.length) return { error: "invalid-base64-padding" };
266
+ if (!isBase64AlphabetByte(byte)) return { error: "invalid-base64-character" };
267
+ }
268
+
269
+ if (paddingCount > 2) return { error: "invalid-base64-padding" };
270
+ if (paddingCount > 0 && encoded.length % 4 !== 0) return { error: "invalid-base64-padding" };
271
+ if (paddingCount === 0 && encoded.length % 4 === 1) return { error: "invalid-base64-length" };
272
+ if (paddingCount === 1 && paddingStart % 4 !== 3) return { error: "invalid-base64-padding" };
273
+ if (paddingCount === 2 && paddingStart % 4 !== 2) return { error: "invalid-base64-padding" };
274
+
275
+ return { bytes: Buffer.from(encoded.toString("ascii"), "base64") };
276
+ }
277
+
278
+ function safeMarkerSource(sourcePath: string): string {
279
+ const source = sourcePath || "value";
280
+ let safe = "";
281
+ for (const ch of source) {
282
+ const code = ch.charCodeAt(0);
283
+ const allowed = (code >= 48 && code <= 57)
284
+ || (code >= 65 && code <= 90)
285
+ || (code >= 97 && code <= 122)
286
+ || ch === "."
287
+ || ch === "_"
288
+ || ch === "-"
289
+ || ch === "["
290
+ || ch === "]"
291
+ || ch === "*"
292
+ || ch === "$";
293
+ safe += allowed ? ch : "_";
294
+ }
295
+ if (safe.length <= MAX_MARKER_SOURCE_CHARS) return safe;
296
+ const suffix = sha256Bytes(source).slice(0, 12);
297
+ return `${safe.slice(0, MAX_MARKER_SOURCE_CHARS - suffix.length - 1)}~${suffix}`;
298
+ }
299
+
300
+ function buildDataUriMarker(omission: DataUriOmission): string {
301
+ const decoded = omission.decodedBytes === null ? "unknown" : String(omission.decodedBytes);
302
+ const decodeError = omission.decodeError ? `; decodeError=${omission.decodeError}` : "";
303
+ return `[pi-web-access inline data URI omitted; ordinal=${omission.ordinal}; source=${omission.sourcePath}; mime=${omission.mimeType}; encoding=${omission.encoding}; encodedBytes=${omission.encodedBytes}; decodedBytes=${decoded}${decodeError}; sha256=${omission.sha256}; digestBasis=${omission.digestBasis}; retrieval=not-retained]`;
304
+ }
305
+
306
+ function sanitizeTextInternal(text: string, sourcePath: string, state: SanitizationState): string {
307
+ let scanFrom = 0;
308
+ let retainedFrom = 0;
309
+ let outputLength = 0;
310
+ const pieces: string[] = [];
311
+
312
+ while (scanFrom < text.length) {
313
+ const start = findNextDataScheme(text, scanFrom);
314
+ if (start < 0) break;
315
+ const candidate = scanDataUriCandidate(text, start);
316
+ const end = candidate.end;
317
+ const headerStart = start + 5;
318
+ const missingComma = candidate.comma < 0;
319
+ // A bare prose label such as "data: value" is not an inline URI. Enclosed
320
+ // or non-empty comma-less candidates are malformed URIs and are removed.
321
+ if (missingComma && end === headerStart && candidate.enclosure === null) {
322
+ scanFrom = end;
323
+ continue;
324
+ }
325
+ const headerEnd = missingComma ? end : candidate.comma;
326
+ const headerLength = headerEnd - headerStart;
327
+ const encoding: DataUriEncoding = headerEndsWithBase64(text, headerStart, headerEnd)
328
+ ? "base64"
329
+ : "percent-encoded";
330
+ const mimeType = normalizeMimeType(text, headerStart, headerEnd);
331
+ // Without the required comma, the post-scheme bytes are ambiguous. Count
332
+ // and digest the whole omitted segment on the encoded basis rather than
333
+ // retaining any header/payload-looking suffix.
334
+ const payload = missingComma
335
+ ? text.slice(headerStart, end)
336
+ : text.slice(candidate.comma + 1, end);
337
+ const encodedBytes = Buffer.byteLength(payload, "utf8");
338
+
339
+ let decodedBytes: number | null = null;
340
+ let decodeError: string | undefined;
341
+ let digestBasis: DigestBasis = "encoded";
342
+ let digest = "";
343
+
344
+ if (missingComma) {
345
+ decodeError = "missing-comma";
346
+ digest = sha256Bytes(payload);
347
+ } else if (headerLength > MAX_DATA_URI_HEADER_CHARS) {
348
+ decodeError = "header-too-long";
349
+ digest = sha256Bytes(payload);
350
+ } else {
351
+ const decoded = encoding === "base64"
352
+ ? decodeBase64Payload(payload)
353
+ : decodePercentEncoded(payload);
354
+ if ("error" in decoded) {
355
+ decodeError = decoded.error;
356
+ digest = sha256Bytes(payload);
357
+ } else {
358
+ decodedBytes = decoded.bytes.length;
359
+ digestBasis = "decoded";
360
+ digest = sha256Bytes(decoded.bytes);
361
+ }
362
+ }
363
+
364
+ const omission: DataUriOmission = {
365
+ ordinal: state.nextOrdinal++,
366
+ sourcePath: safeMarkerSource(sourcePath),
367
+ mimeType,
368
+ encoding,
369
+ encodedBytes,
370
+ decodedBytes,
371
+ ...(decodeError ? { decodeError } : {}),
372
+ sha256: digest,
373
+ digestBasis,
374
+ retrieval: "not-retained",
375
+ };
376
+ const marker = buildDataUriMarker(omission);
377
+ const prefix = text.slice(retainedFrom, start);
378
+ pieces.push(prefix, marker);
379
+ outputLength += prefix.length;
380
+ const markerStart = outputLength;
381
+ outputLength += marker.length;
382
+ state.omissions.push({ ...omission, markerStart, markerEnd: outputLength });
383
+ retainedFrom = end;
384
+ scanFrom = end;
385
+ }
386
+
387
+ if (state.omissions.length === 0 && retainedFrom === 0) return text;
388
+ pieces.push(text.slice(retainedFrom));
389
+ return pieces.join("");
390
+ }
391
+
392
+
393
+ /** Replace every recognized RFC 2397-style inline data URI in one string. */
394
+ export function sanitizeInlineDataUris(
395
+ text: string,
396
+ sourcePath: string,
397
+ ): { text: string; omissions: DataUriOmission[] } {
398
+ const state: SanitizationState = { nextOrdinal: 1, omissions: [] };
399
+ const sanitized = sanitizeTextInternal(text, sourcePath, state);
400
+ return {
401
+ text: sanitized,
402
+ omissions: state.omissions.map(({ markerStart: _start, markerEnd: _end, ...omission }) => omission),
403
+ };
404
+ }
405
+
406
+ /** Sanitize every string leaf in a JSON-compatible value with one ordinal sequence. */