@openclaw/ai 2026.7.2-beta.7 → 2026.7.33

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (78) hide show
  1. package/README.md +5 -6
  2. package/dist/{anthropic-CH4UUnZr.mjs → anthropic-BML72tLz.mjs} +468 -101
  3. package/dist/{api-registry-DlMgPR39.d.mts → api-registry-BXYnCOIR.d.mts} +2 -1
  4. package/dist/{azure-openai-responses-client-compat-C7K7QfUE.mjs → azure-openai-responses-client-compat-a_O_GVQV.mjs} +2 -23
  5. package/dist/{azure-openai-responses-CImcwB83.mjs → azure-openai-responses-kEN8II8I.mjs} +13 -11
  6. package/dist/{env-api-keys-DrgeBuva.mjs → env-api-keys-CtMlqaQ4.mjs} +4 -5
  7. package/dist/{event-stream-YjaPW20U.d.mts → event-stream-0nZeBKl2.d.mts} +1 -1
  8. package/dist/{event-stream-D8n2uFee.mjs → event-stream-ReMmOTzX.mjs} +6 -14
  9. package/dist/event-stream.d.mts +1 -1
  10. package/dist/event-stream.mjs +1 -1
  11. package/dist/{github-copilot-headers-NCJtz9i0.mjs → github-copilot-headers-BsH5cqGj.mjs} +12 -1
  12. package/dist/{google-CtSg0iTS.mjs → google-DTM4O3e9.mjs} +5 -5
  13. package/dist/{google-shared-DNBz5rcD.mjs → google-shared-BAP0BQVi.mjs} +22 -34
  14. package/dist/{google-vertex-31f1uS9L.mjs → google-vertex-D58MZHCQ.mjs} +19 -6
  15. package/dist/host-4t713IeR.mjs +37 -0
  16. package/dist/{anthropic-SrGtwsJu.d.mts → index-BoTnz8cv.d.mts} +1 -27
  17. package/dist/index.d.mts +50 -7
  18. package/dist/index.mjs +5 -5
  19. package/dist/internal/anthropic.d.mts +62 -22
  20. package/dist/internal/anthropic.mjs +4 -5
  21. package/dist/internal/openai.d.mts +82 -98
  22. package/dist/internal/openai.mjs +6 -8
  23. package/dist/internal/runtime.d.mts +34 -13
  24. package/dist/internal/runtime.mjs +14 -26
  25. package/dist/internal/shared.d.mts +9 -26
  26. package/dist/internal/shared.mjs +2 -6
  27. package/dist/{json-parse-BvXNt1-7.mjs → json-parse-DzNSIQBq.mjs} +6 -4
  28. package/dist/{llm-request-activity-BjtkplhG.mjs → llm-request-activity-CehVkZP-.mjs} +19 -1
  29. package/dist/{mistral-CWmpvWYh.mjs → mistral-CePVNdws.mjs} +39 -141
  30. package/dist/model-utils-DgmOla96.mjs +69 -0
  31. package/dist/{openai-chatgpt-responses-B84Ibtrd.mjs → openai-chatgpt-responses-BHqbcipc.mjs} +154 -101
  32. package/dist/{openai-completions-DsOxhOD1.mjs → openai-completions-9qYFVS7H.mjs} +295 -81
  33. package/dist/{openai-responses-BT7A3sLu.mjs → openai-responses-D6l9URyV.mjs} +8 -10
  34. package/dist/openai-responses-shared-L3PWZvkm.mjs +1949 -0
  35. package/dist/{openai-tool-projection-OhX64DoP.mjs → openai-tool-projection-BPlyXt8H.mjs} +12 -32
  36. package/dist/providers.d.mts +2 -3
  37. package/dist/providers.mjs +10 -11
  38. package/dist/reasoning-tag-text-partitioner-axhAdUwg.mjs +394 -0
  39. package/dist/{src-QkygScBs.mjs → src-CZ503MYJ.mjs} +5 -24
  40. package/dist/{stream-first-event-timeout-BBys9hSb.mjs → stream-first-event-timeout-RjWszj8c.mjs} +22 -2
  41. package/dist/transform-messages-BhGF_fF4.mjs +507 -0
  42. package/dist/{types-bzp5k29J.d.mts → types-DRgdPqaZ.d.mts} +0 -19
  43. package/dist/types.d.mts +5 -5
  44. package/dist/types.mjs +4 -4
  45. package/dist/{validation-B-j7cOYp.d.mts → validation-BDMWOr8d.d.mts} +1 -1
  46. package/dist/{validation-DAa_yFOM.mjs → validation-FrchoOlv.mjs} +7 -2
  47. package/dist/validation.d.mts +1 -1
  48. package/dist/validation.mjs +1 -1
  49. package/npm-shrinkwrap.json +645 -0
  50. package/package.json +11 -36
  51. package/dist/anthropic-usage-DWU-x8MI.mjs +0 -459
  52. package/dist/cache-retention-0x979a5V.mjs +0 -12
  53. package/dist/deferred-event-buffer-DAvyP7qA.mjs +0 -19
  54. package/dist/error-coercion-DgxlWC0n.mjs +0 -15
  55. package/dist/host-B9GUmcra.d.mts +0 -173
  56. package/dist/host-Dog2WQiR.mjs +0 -369
  57. package/dist/index-BVVgDSdq.d.mts +0 -1
  58. package/dist/internal/retry-after.d.mts +0 -5
  59. package/dist/internal/retry-after.mjs +0 -101
  60. package/dist/number-coercion-DvG7SNMg.mjs +0 -129
  61. package/dist/openai-completions-compat-DBWjXoMZ.d.mts +0 -43
  62. package/dist/openai-prompt-cache-2uo_1OR1.d.mts +0 -7
  63. package/dist/openai-prompt-cache-mZTCdRPo.mjs +0 -12
  64. package/dist/openai-reasoning-compat-YgeLncHw.mjs +0 -396
  65. package/dist/openai-responses-shared-pXl6Wd8S.mjs +0 -392
  66. package/dist/openai-responses-stream-internal-Cw5txaGW.mjs +0 -2964
  67. package/dist/prompt-cache-stability-Cwcjv_fx.d.mts +0 -13
  68. package/dist/provider-error-CAEvRjry.mjs +0 -47
  69. package/dist/provider-options-D8bB3z9b.d.mts +0 -144
  70. package/dist/reasoning-tag-text-partitioner-CGDyLWUR.mjs +0 -12209
  71. package/dist/simple-options-9lhRrN73.mjs +0 -50
  72. package/dist/stream-first-event-timeout-DvDeSucC.d.mts +0 -29
  73. package/dist/tls-certificate-errors-DXSpluKI.mjs +0 -93
  74. package/dist/tool-result-text-CTpIRbYd.mjs +0 -225
  75. package/dist/transform-messages-C8mBqZxF.mjs +0 -2
  76. package/dist/transport-stream-shared-D81p90xq.mjs +0 -297
  77. package/dist/transports.d.mts +0 -573
  78. package/dist/transports.mjs +0 -4110
@@ -1,4110 +0,0 @@
1
- import { n as getEnvApiKey } from "./env-api-keys-DrgeBuva.mjs";
2
- import { d as resolveClaudeSonnet5ModelIdentity, g as supportsClaudeNativeXhighEffort, h as supportsClaudeNativeMaxEffort, l as resolveClaudeNativeThinkingLevelMap, p as supportsClaudeAdaptiveThinking, u as resolveClaudeOpus5ModelIdentity } from "./src-QkygScBs.mjs";
3
- import { r as createAssistantMessageEventStream } from "./event-stream-D8n2uFee.mjs";
4
- import { a as applyClaudeRequestContract, c as requiresClaudeAdaptiveThinking, d as usesClaudeStreamingRefusalContract, f as hasNonEmptyString, g as isRecord, h as readStringValue, n as getAiTransportHost, o as defaultsClaudeAdaptiveThinking, p as normalizeLowercaseStringOrEmpty, r as resolveAiTransportHeaderSentinels, s as prepareClaudeNoPrefillRequestContext, u as usesClaudeFable5MessagesContract } from "./host-Dog2WQiR.mjs";
5
- import { n as clampOpenAIPromptCacheKey } from "./openai-prompt-cache-mZTCdRPo.mjs";
6
- import { t as resolveCacheRetention } from "./cache-retention-0x979a5V.mjs";
7
- import { a as isImageWithMediaPayload, d as stripSystemPromptCacheBoundary, m as sortPromptCacheToolsByName, n as extractToolResultBlockText, r as extractToolResultText, t as describeToolResultMediaPlaceholder, u as splitSystemPromptCacheBoundary } from "./tool-result-text-CTpIRbYd.mjs";
8
- import { a as resolveModelRequestTimeoutMs, c as resolveProviderRequestCapabilities, i as buildGuardedModelFetch, l as resolveProviderRequestPolicyConfig, n as reconcileOpenAICompletionsToolChoice, o as resolveOpenAIStrictToolSetting, r as reconcileOpenAIResponsesToolChoice, s as resolveProviderEndpoint, t as projectOpenAITools, u as transformTransportMessages } from "./openai-tool-projection-OhX64DoP.mjs";
9
- import { t as toErrorObject } from "./error-coercion-DgxlWC0n.mjs";
10
- import { S as canonicalizeBase64, _ as omitFoundryBearerCredentialHeaders, a as projectAnthropicTools, b as normalizeAnthropicInlineContent, c as ANTHROPIC_OMITTED_REASONING_TEXT, d as ANTHROPIC_SERVER_SIDE_FALLBACK_BETA, g as applyAnthropicRefusal, h as resolveAnthropicFallbackServingModelCost, i as readLastAnthropicIterationUsage, l as findActiveAnthropicToolTurnAssistantIndex, m as readAnthropicFallbackBoundary, n as readAnthropicPromptUsageSnapshot, o as reconcileAnthropicToolChoice, p as applyAnthropicFallbackBoundary, r as readAnthropicUsageTokenCount, s as resolveOriginalAnthropicToolName, u as ANTHROPIC_SERVER_SIDE_FALLBACKS, v as usesFoundryBearerAuth, x as resolveAnthropicImageMediaType, y as createAnthropicInlineImageBudget } from "./anthropic-usage-DWU-x8MI.mjs";
11
- import { a as parseStrictPositiveInteger, c as calculateCost, l as clampThinkingLevel, s as applyProviderReportedUsageCost } from "./number-coercion-DvG7SNMg.mjs";
12
- import { a as resolveOpenAICompletionsCompat, c as clearPendingCommentaryText, i as detectOpenAICompletionsCompat, l as rememberPendingCommentaryTags, n as mapOpenAIStopReason, o as resolveOpenAICompletionsResponseFormat, r as convertMessages, s as shouldOmitOllamaCompatResponseFormat, t as resolveOpenAIReasoningEffortMap, u as tagPendingCommentaryText } from "./openai-reasoning-compat-YgeLncHw.mjs";
13
- import { t as createDeferredEventBuffer } from "./deferred-event-buffer-DAvyP7qA.mjs";
14
- import { n as parseStreamingJson } from "./json-parse-BvXNt1-7.mjs";
15
- import { t as notifyLlmRequestActivity } from "./llm-request-activity-BjtkplhG.mjs";
16
- import { C as resolveSecretSentinel, S as resolveModelHeaderSentinels$1, T as supportsModelTools, _ as isGoogleGemini3ProModel, a as failTransportStream, c as mergeTransportMetadata, d as transportAbortError, f as MALFORMED_STREAMING_FRAGMENT_ERROR_MESSAGE, g as isGoogleGemini3FlashModel, h as isCodeModeModelVisibleToolName, i as createWritableTransportEventStream, l as sanitizeNonEmptyTransportPayloadText, m as estimateStringChars, n as coerceTransportToolCallArguments, o as finalizeTransportStream, p as createAbortError$1, r as createEmptyTransportUsage, s as mergeTransportHeaders, t as assignTransportErrorDetails, u as sanitizeTransportPayloadText, v as parseRetryAfterSeconds, w as sha256Hex, y as readResponseTextSnippet } from "./transport-stream-shared-D81p90xq.mjs";
17
- import { A as normalizeResponsesFailedEvent, B as resolveReplayableResponsesMessageId, C as prepareOpenAIResponsesReasoningItemForReplay, D as applyServiceTierPricing, E as tagOpenAIResponsesReasoningReplayItem, F as summarizeResponsesFailedNoDetailsObservation, G as throwIfModelStreamAborted, H as createModelStreamCooperativeScheduler, I as summarizeResponsesPayload, L as summarizeResponsesTools, M as stringifyRedactedEvent, N as stringifyRedactedPayload, O as buildResponsesFailedNoDetailsObservation, P as summarizeOpenAITransportError, R as AZURE_RESPONSES_FIRST_EVENT_TIMEOUT_MS, S as isInvalidEncryptedContentError, T as stripResponsesRequestEncryptedContent, U as log, V as GEMINI_THOUGHT_SIGNATURE_VALIDATOR_SKIP, W as resolvePromptCacheKey, Y as normalizeOpenAIStrictToolParameters, Z as resolveOpenAIProjectedToolsStrictToolFlag, b as convertResponsesMessages, bt as resolveModelPayloadDebugMode, dt as isOpenAIGpt55Model, ft as isOpenAIGpt56Model, gt as supportsOpenAIReasoningEffort, j as safeDebugValue, k as logResponsesFailedNoDetails, mt as resolveOpenAIReasoningEffortForModel, n as processResponsesStream, o as observeResponsesStream, pt as normalizeOpenAIReasoningEffort, q as findOpenAIStrictToolProjectionDiagnostics, t as ResponsesStreamFailure, ut as isOpenAIGpt54MiniModel, v as buildOpenAIResponsesReasoningReplayMetadata, vt as uniqueStrings, w as resolveAzureOpenAIApiVersion, x as createResponsesStreamWithEncryptedContentRetry, xt as resolveModelSseDebugMode, y as buildResponsesInputMessage, yt as emitModelTransportDebug, z as OPENAI_CODEX_RESPONSES_DEFAULT_INSTRUCTIONS } from "./openai-responses-stream-internal-Cw5txaGW.mjs";
18
- import { t as createReasoningTagTextPartitioner } from "./reasoning-tag-text-partitioner-CGDyLWUR.mjs";
19
- import { a as withFirstStreamEventTimeout, i as getFirstStreamEventTimeoutMs, r as getFirstStreamEventTimeoutHandler, t as createFirstStreamEventAbortController } from "./stream-first-event-timeout-BBys9hSb.mjs";
20
- import { i as resolveAzureDeploymentNameFromMap, t as isOpenAICompatibleAzureResponsesBaseUrl } from "./azure-openai-responses-client-compat-C7K7QfUE.mjs";
21
- import { randomUUID } from "node:crypto";
22
- import OpenAI, { AzureOpenAI } from "openai";
23
- //#region packages/ai/src/transports/anthropic-payload-policy.ts
24
- /**
25
- * Anthropic-family request payload policy helpers.
26
- * Applies service-tier and cache-control markers only when provider endpoint
27
- * capabilities allow them.
28
- */
29
- const ANTHROPIC_CACHE_CONTROL_LIMIT = 4;
30
- function resolveBaseUrlHostname(baseUrl) {
31
- try {
32
- return new URL(baseUrl).hostname;
33
- } catch {
34
- return;
35
- }
36
- }
37
- function isLongTtlEligibleEndpoint(baseUrl) {
38
- if (typeof baseUrl !== "string") return false;
39
- const hostname = resolveBaseUrlHostname(baseUrl);
40
- if (!hostname) return false;
41
- return hostname === "api.anthropic.com" || hostname === "aiplatform.googleapis.com" || hostname.endsWith("-aiplatform.googleapis.com");
42
- }
43
- /** Resolve Anthropic cache-control marker retention for a request endpoint. */
44
- function resolveAnthropicEphemeralCacheControl(baseUrl, cacheRetention) {
45
- const retention = resolveCacheRetention(cacheRetention);
46
- if (retention === "none") return;
47
- const ttl = retention === "long" && (cacheRetention === "long" || isLongTtlEligibleEndpoint(baseUrl)) ? "1h" : void 0;
48
- return {
49
- type: "ephemeral",
50
- ...ttl ? { ttl } : {}
51
- };
52
- }
53
- function applyAnthropicCacheControlToSystem(system, cacheControl) {
54
- if (!Array.isArray(system)) return;
55
- const normalizedBlocks = [];
56
- for (const block of system) {
57
- if (!block || typeof block !== "object") {
58
- normalizedBlocks.push(block);
59
- continue;
60
- }
61
- const record = block;
62
- if (record.type !== "text" || typeof record.text !== "string") {
63
- normalizedBlocks.push(block);
64
- continue;
65
- }
66
- const split = splitSystemPromptCacheBoundary(record.text);
67
- if (!split) {
68
- if (record.cache_control === void 0) record.cache_control = cacheControl;
69
- normalizedBlocks.push(record);
70
- continue;
71
- }
72
- const { cache_control: existingCacheControl, ...rest } = record;
73
- if (split.stablePrefix) normalizedBlocks.push({
74
- ...rest,
75
- text: split.stablePrefix,
76
- cache_control: existingCacheControl ?? cacheControl
77
- });
78
- if (split.dynamicSuffix) normalizedBlocks.push({
79
- ...rest,
80
- text: split.dynamicSuffix
81
- });
82
- }
83
- system.splice(0, system.length, ...normalizedBlocks);
84
- }
85
- function stripAnthropicSystemPromptBoundary(system) {
86
- if (!Array.isArray(system)) return;
87
- for (const block of system) {
88
- if (!block || typeof block !== "object") continue;
89
- const record = block;
90
- if (record.type === "text" && typeof record.text === "string") record.text = stripSystemPromptCacheBoundary(record.text);
91
- }
92
- }
93
- function applyAnthropicCacheControlToMessages(messages, cacheControl, markerLimit, cacheBreakpointOptOutMessageIndexes) {
94
- if (!Array.isArray(messages) || messages.length === 0 || markerLimit <= 0) return;
95
- let fallbackToolResult;
96
- for (let i = messages.length - 1; i >= 0; i--) {
97
- const message = messages[i];
98
- if (!message || typeof message !== "object") continue;
99
- const record = message;
100
- if (record.role !== "user" || cacheBreakpointOptOutMessageIndexes.has(i)) continue;
101
- const content = record.content;
102
- if (typeof content === "string") {
103
- if (fallbackToolResult && markerLimit === 1) {
104
- fallbackToolResult.cache_control = cacheControl;
105
- return;
106
- }
107
- record.content = [{
108
- type: "text",
109
- text: content,
110
- cache_control: cacheControl
111
- }];
112
- if (fallbackToolResult && markerLimit > 1) fallbackToolResult.cache_control = cacheControl;
113
- return;
114
- }
115
- if (!Array.isArray(content)) continue;
116
- for (let j = content.length - 1; j >= 0; j--) {
117
- const block = content[j];
118
- if (!block || typeof block !== "object") continue;
119
- const blockRecord = block;
120
- if (blockRecord.type === "text" || blockRecord.type === "image") {
121
- if (fallbackToolResult && markerLimit === 1) {
122
- fallbackToolResult.cache_control = cacheControl;
123
- return;
124
- }
125
- blockRecord.cache_control = cacheControl;
126
- if (fallbackToolResult && markerLimit > 1) fallbackToolResult.cache_control = cacheControl;
127
- return;
128
- }
129
- if (blockRecord.type === "tool_result" && fallbackToolResult === void 0) fallbackToolResult = blockRecord;
130
- }
131
- }
132
- if (fallbackToolResult) fallbackToolResult.cache_control = cacheControl;
133
- }
134
- function countAnthropicCacheControlMarkers(blocks) {
135
- if (!Array.isArray(blocks)) return 0;
136
- let count = 0;
137
- for (const block of blocks) if (block && typeof block === "object" && "cache_control" in block) count += 1;
138
- return count;
139
- }
140
- /** @deprecated Anthropic-family provider payload helper; do not use from third-party plugins. */
141
- function resolveAnthropicPayloadPolicy(input) {
142
- return {
143
- allowsServiceTier: resolveProviderRequestCapabilities({
144
- provider: input.provider,
145
- api: input.api,
146
- baseUrl: input.baseUrl,
147
- capability: "llm",
148
- transport: "stream"
149
- }).allowsAnthropicServiceTier,
150
- cacheControl: input.enableCacheControl === true ? resolveAnthropicEphemeralCacheControl(input.baseUrl, input.cacheRetention) : void 0,
151
- serviceTier: input.serviceTier
152
- };
153
- }
154
- /** @deprecated Anthropic-family provider payload helper; do not use from third-party plugins. */
155
- function applyAnthropicPayloadPolicyToParams(payloadObj, policy, cacheBreakpointOptOutMessageIndexes) {
156
- if (policy.allowsServiceTier && policy.serviceTier !== void 0 && payloadObj.service_tier === void 0) payloadObj.service_tier = policy.serviceTier;
157
- if (policy.cacheControl) applyAnthropicCacheControlToSystem(payloadObj.system, policy.cacheControl);
158
- else stripAnthropicSystemPromptBoundary(payloadObj.system);
159
- if (!policy.cacheControl) return;
160
- const usedMarkers = countAnthropicCacheControlMarkers(payloadObj.system) + countAnthropicCacheControlMarkers(payloadObj.tools);
161
- applyAnthropicCacheControlToMessages(payloadObj.messages, policy.cacheControl, ANTHROPIC_CACHE_CONTROL_LIMIT - usedMarkers, cacheBreakpointOptOutMessageIndexes);
162
- }
163
- /** @deprecated Anthropic-family provider payload helper; do not use from third-party plugins. */
164
- function applyAnthropicEphemeralCacheControlMarkers(payloadObj, cacheControl = { type: "ephemeral" }) {
165
- const messages = payloadObj.messages;
166
- if (!Array.isArray(messages)) return;
167
- for (const message of messages) {
168
- if (message.role === "system" || message.role === "developer") {
169
- if (!cacheControl) continue;
170
- if (typeof message.content === "string") {
171
- message.content = [{
172
- type: "text",
173
- text: message.content,
174
- cache_control: cacheControl
175
- }];
176
- continue;
177
- }
178
- if (Array.isArray(message.content) && message.content.length > 0) {
179
- const last = message.content[message.content.length - 1];
180
- if (last && typeof last === "object") {
181
- const record = last;
182
- if (record.type !== "thinking" && record.type !== "redacted_thinking") record.cache_control = cacheControl;
183
- }
184
- }
185
- continue;
186
- }
187
- if (message.role === "assistant" && Array.isArray(message.content)) for (const block of message.content) {
188
- if (!block || typeof block !== "object") continue;
189
- const record = block;
190
- if (record.type === "thinking" || record.type === "redacted_thinking") delete record.cache_control;
191
- }
192
- }
193
- }
194
- //#endregion
195
- //#region packages/ai/src/transports/json-unsafe-integers.ts
196
- /**
197
- * JSON parsing helpers that preserve integer literals larger than
198
- * Number.MAX_SAFE_INTEGER as strings before JSON.parse can round them.
199
- */
200
- const MAX_SAFE_INTEGER_ABS_STR = String(Number.MAX_SAFE_INTEGER);
201
- function isAsciiDigit(ch) {
202
- return ch !== void 0 && ch >= "0" && ch <= "9";
203
- }
204
- function parseJsonNumberToken(input, start) {
205
- let idx = start;
206
- if (input[idx] === "-") idx += 1;
207
- if (idx >= input.length) return null;
208
- if (input[idx] === "0") idx += 1;
209
- else if (isAsciiDigit(input[idx]) && input[idx] !== "0") while (isAsciiDigit(input[idx])) idx += 1;
210
- else return null;
211
- let isInteger = true;
212
- if (input[idx] === ".") {
213
- isInteger = false;
214
- idx += 1;
215
- if (!isAsciiDigit(input[idx])) return null;
216
- while (isAsciiDigit(input[idx])) idx += 1;
217
- }
218
- if (input[idx] === "e" || input[idx] === "E") {
219
- isInteger = false;
220
- idx += 1;
221
- if (input[idx] === "+" || input[idx] === "-") idx += 1;
222
- if (!isAsciiDigit(input[idx])) return null;
223
- while (isAsciiDigit(input[idx])) idx += 1;
224
- }
225
- return {
226
- token: input.slice(start, idx),
227
- end: idx,
228
- isInteger
229
- };
230
- }
231
- function isUnsafeIntegerLiteral(token) {
232
- const digits = token[0] === "-" ? token.slice(1) : token;
233
- if (digits.length < MAX_SAFE_INTEGER_ABS_STR.length) return false;
234
- if (digits.length > MAX_SAFE_INTEGER_ABS_STR.length) return true;
235
- return digits > MAX_SAFE_INTEGER_ABS_STR;
236
- }
237
- /** Quotes integer literals above Number.MAX_SAFE_INTEGER before JSON.parse. */
238
- function quoteUnsafeIntegerLiterals(input) {
239
- let out = "";
240
- let inString = false;
241
- let escaped = false;
242
- let idx = 0;
243
- while (idx < input.length) {
244
- const ch = input[idx] ?? "";
245
- if (inString) {
246
- out += ch;
247
- if (escaped) escaped = false;
248
- else if (ch === "\\") escaped = true;
249
- else if (ch === "\"") inString = false;
250
- idx += 1;
251
- continue;
252
- }
253
- if (ch === "\"") {
254
- inString = true;
255
- out += ch;
256
- idx += 1;
257
- continue;
258
- }
259
- if (ch === "-" || isAsciiDigit(ch)) {
260
- const parsed = parseJsonNumberToken(input, idx);
261
- if (parsed) {
262
- if (parsed.isInteger && isUnsafeIntegerLiteral(parsed.token)) out += `"${parsed.token}"`;
263
- else out += parsed.token;
264
- idx = parsed.end;
265
- continue;
266
- }
267
- }
268
- out += ch;
269
- idx += 1;
270
- }
271
- return out;
272
- }
273
- /** Parses JSON while preserving unsafe integer literals as strings. */
274
- function parseJsonPreservingUnsafeIntegers(input) {
275
- return JSON.parse(quoteUnsafeIntegerLiterals(input));
276
- }
277
- /** Parses or accepts an object while preserving unsafe integer literals in string input. */
278
- function parseJsonObjectPreservingUnsafeIntegers(value) {
279
- if (typeof value === "string") {
280
- try {
281
- const parsed = parseJsonPreservingUnsafeIntegers(value);
282
- if (parsed && typeof parsed === "object" && !Array.isArray(parsed)) return parsed;
283
- } catch {
284
- return null;
285
- }
286
- return null;
287
- }
288
- if (value && typeof value === "object" && !Array.isArray(value)) return value;
289
- return null;
290
- }
291
- //#endregion
292
- //#region packages/ai/src/transports/anthropic-transport-stream.ts
293
- /**
294
- * Native Anthropic Messages streaming transport.
295
- * Converts OpenClaw contexts/tools into Anthropic payloads, streams SSE events
296
- * back into runtime output blocks, and applies provider request policy.
297
- */
298
- const CLAUDE_CODE_VERSION = "2.1.75";
299
- const CLAUDE_CODE_BILLING_SYSTEM_BLOCK = `x-anthropic-billing-header: cc_version=${CLAUDE_CODE_VERSION}; cc_entrypoint=sdk-cli;`;
300
- const ANTHROPIC_MESSAGES_ERROR_BODY_MAX_BYTES = 8 * 1024;
301
- const ANTHROPIC_MESSAGES_ERROR_BODY_MAX_CHARS = 400;
302
- const ANTHROPIC_MESSAGES_ERROR_BODY_READ_IDLE_TIMEOUT_MS = 1e4;
303
- const ANTHROPIC_MESSAGES_DEFAULT_MAX_TOKENS = 4096;
304
- const ANTHROPIC_MESSAGES_FALLBACK_CONTEXT_DIVISOR = 4;
305
- const ANTHROPIC_MESSAGES_SSE_PENDING_BUFFER_MAX_CHARS = 16 * 1024 * 1024;
306
- const CLAUDE_CODE_TOOL_LOOKUP = new Map([
307
- "Read",
308
- "Write",
309
- "Edit",
310
- "Bash",
311
- "Grep",
312
- "Glob",
313
- "AskUserQuestion",
314
- "EnterPlanMode",
315
- "ExitPlanMode",
316
- "KillShell",
317
- "NotebookEdit",
318
- "Skill",
319
- "Task",
320
- "TaskOutput",
321
- "TodoWrite",
322
- "WebFetch",
323
- "WebSearch"
324
- ].map((tool) => [normalizeLowercaseStringOrEmpty(tool), tool]));
325
- function resolveAnthropicRequestModelId(model) {
326
- if (isDirectAnthropicModel(model) && /^anthropic\//i.test(model.id)) return model.id.replace(/^anthropic\//i, "");
327
- return model.id;
328
- }
329
- const EMPTY_ANTHROPIC_MESSAGES_FALLBACK_TEXT = ".";
330
- function normalizeAnthropicToolChoice(thinkingEnabled, toolChoice) {
331
- if (thinkingEnabled && (toolChoice === "any" || typeof toolChoice === "object" && toolChoice.type === "tool")) return { type: "auto" };
332
- return typeof toolChoice === "string" ? { type: toolChoice } : toolChoice;
333
- }
334
- function supportsNativeXhighEffort(model) {
335
- return supportsClaudeNativeXhighEffort(model);
336
- }
337
- function supportsAdaptiveThinking(model) {
338
- return supportsClaudeAdaptiveThinking(model);
339
- }
340
- function mapThinkingLevelToEffort(level, model) {
341
- const thinkingLevelMap = resolveClaudeNativeThinkingLevelMap(model);
342
- const resolvedLevel = clampThinkingLevel({
343
- ...model,
344
- ...typeof model.params?.canonicalModelId === "string" ? { reasoning: true } : {},
345
- ...thinkingLevelMap ? { thinkingLevelMap } : {}
346
- }, level);
347
- const mapped = thinkingLevelMap?.[resolvedLevel];
348
- if (typeof mapped === "string") return mapped;
349
- switch (resolvedLevel) {
350
- case "off":
351
- case "minimal":
352
- case "low": return "low";
353
- case "medium": return "medium";
354
- case "xhigh": return supportsNativeXhighEffort(model) ? "xhigh" : "high";
355
- case "max": return supportsClaudeNativeMaxEffort(model) ? "max" : "high";
356
- default: return "high";
357
- }
358
- }
359
- function clampReasoningLevel(level) {
360
- return level === "xhigh" || level === "max" ? "high" : level;
361
- }
362
- function resolvePositiveAnthropicTokenLimit(value) {
363
- if (typeof value !== "number" || !Number.isFinite(value)) return;
364
- const floored = Math.floor(value);
365
- return floored > 0 ? floored : void 0;
366
- }
367
- function resolveAnthropicMessagesMaxTokens(params) {
368
- const requested = resolvePositiveAnthropicTokenLimit(params.requestedMaxTokens);
369
- if (requested !== void 0) return requested;
370
- const modelMax = resolvePositiveAnthropicTokenLimit(params.modelMaxTokens);
371
- if (modelMax !== void 0) return params.useModelDefault ? modelMax : Math.min(modelMax, 32e3);
372
- if (params.modelMaxTokens !== void 0) return;
373
- const contextWindow = resolvePositiveAnthropicTokenLimit(params.modelContextWindow);
374
- return contextWindow === void 0 ? ANTHROPIC_MESSAGES_DEFAULT_MAX_TOKENS : Math.max(1, Math.min(ANTHROPIC_MESSAGES_DEFAULT_MAX_TOKENS, Math.floor(contextWindow / ANTHROPIC_MESSAGES_FALLBACK_CONTEXT_DIVISOR)));
375
- }
376
- function adjustMaxTokensForThinking(params) {
377
- const budgets = {
378
- minimal: 1024,
379
- low: 2048,
380
- medium: 8192,
381
- high: 16384,
382
- ...params.customBudgets
383
- };
384
- const minOutputTokens = 1024;
385
- let thinkingBudget = budgets[clampReasoningLevel(params.reasoningLevel)];
386
- const maxTokens = Math.min(params.baseMaxTokens + thinkingBudget, params.modelMaxTokens);
387
- if (maxTokens <= thinkingBudget) thinkingBudget = Math.max(0, maxTokens - minOutputTokens);
388
- return {
389
- maxTokens,
390
- thinkingBudget
391
- };
392
- }
393
- function isAnthropicOAuthToken(apiKey) {
394
- return (resolveSecretSentinel(apiKey) ?? apiKey).includes("sk-ant-oat");
395
- }
396
- function isDirectAnthropicModel(model) {
397
- if (normalizeLowercaseStringOrEmpty(model.provider) !== "anthropic") return false;
398
- const endpointClass = resolveProviderEndpoint(model.baseUrl).endpointClass;
399
- return endpointClass === "default" || endpointClass === "anthropic-public";
400
- }
401
- function isKimiAnthropicProvider(provider) {
402
- return /^kimi(?:-|$)/.test(normalizeLowercaseStringOrEmpty(provider ?? ""));
403
- }
404
- /**
405
- * Server-side refusal fallback is a first-party Claude API beta: proxies and
406
- * Bedrock/Vertex/Foundry reject the `fallbacks` param, and OAuth (Claude Code
407
- * identity) requests are excluded until the beta is verified there.
408
- */
409
- function useAnthropicServerSideFallback(model) {
410
- return (usesClaudeFable5MessagesContract(model) || resolveClaudeOpus5ModelIdentity(model) !== void 0) && isDirectAnthropicModel(model);
411
- }
412
- function supportsReasoningContentReplay(model) {
413
- return resolveProviderEndpoint(model.baseUrl).endpointClass === "xiaomi-native";
414
- }
415
- function buildAnthropicBetaHeader(model, betaFeatures, params) {
416
- if (!isDirectAnthropicModel(model)) return;
417
- return params.oauth ? `claude-code-20250219,oauth-2025-04-20,${betaFeatures.join(",")}` : betaFeatures.join(",");
418
- }
419
- function toClaudeCodeName(name) {
420
- return CLAUDE_CODE_TOOL_LOOKUP.get(normalizeLowercaseStringOrEmpty(name)) ?? name;
421
- }
422
- const NON_VISION_USER_IMAGE_PLACEHOLDER = "(image omitted: model does not support images)";
423
- async function convertContentBlocks(content, model, imageBudget) {
424
- const text = extractToolResultText(content);
425
- const mediaPlaceholder = describeToolResultMediaPlaceholder(content);
426
- if (!(model.input.includes("image") && content.some(isImageWithMediaPayload))) return sanitizeNonEmptyTransportPayloadText(text, mediaPlaceholder ?? "(no output)");
427
- const blocks = [];
428
- let hasTextBlock = false;
429
- for (const block of content) {
430
- if (!block || typeof block !== "object") continue;
431
- const record = block;
432
- const blockText = extractToolResultBlockText(block);
433
- if (blockText) {
434
- blocks.push({
435
- type: "text",
436
- text: sanitizeTransportPayloadText(blockText)
437
- });
438
- hasTextBlock = true;
439
- }
440
- if (!isImageWithMediaPayload(record)) continue;
441
- const [normalizedImage] = await normalizeAnthropicInlineContent([{
442
- type: "image",
443
- data: typeof record.data === "string" ? record.data : "",
444
- mimeType: typeof record.mimeType === "string" ? record.mimeType : "image/png"
445
- }], imageBudget);
446
- if (normalizedImage?.type !== "image") continue;
447
- blocks.push({
448
- type: "image",
449
- source: {
450
- type: "base64",
451
- media_type: resolveAnthropicImageMediaType(normalizedImage.mimeType),
452
- data: normalizedImage.data
453
- }
454
- });
455
- }
456
- if (!hasTextBlock) blocks.unshift({
457
- type: "text",
458
- text: mediaPlaceholder ?? "(see attached image)"
459
- });
460
- return blocks;
461
- }
462
- function normalizeToolCallId(id) {
463
- return id.replace(/[^a-zA-Z0-9_-]/g, "_").slice(0, 64);
464
- }
465
- async function convertAnthropicMessages(messages, model, isOAuthToken, options) {
466
- const params = [];
467
- const imageBudget = createAnthropicInlineImageBudget();
468
- const allowReasoningContentReplay = options.allowReasoningContentReplay === true;
469
- const replayThinkingEnabled = options.replayThinkingEnabled !== false;
470
- const transformedMessages = transformTransportMessages(messages, model, normalizeToolCallId);
471
- const activeToolTurnAssistantIndex = replayThinkingEnabled ? -1 : findActiveAnthropicToolTurnAssistantIndex(transformedMessages);
472
- for (let i = 0; i < transformedMessages.length; i += 1) {
473
- const msg = transformedMessages[i];
474
- if (!msg) continue;
475
- if (msg.role === "user") {
476
- const isRuntimeContextCarrier = msg.runtimeContextCarrier === true;
477
- if (typeof msg.content === "string") {
478
- if (msg.content.trim().length > 0) {
479
- const userParam = {
480
- role: "user",
481
- content: sanitizeTransportPayloadText(msg.content)
482
- };
483
- if (isRuntimeContextCarrier) options.cacheBreakpointOptOutMessageIndexes.add(params.length);
484
- params.push(userParam);
485
- }
486
- continue;
487
- }
488
- const blocks = (model.input.includes("image") ? await normalizeAnthropicInlineContent(msg.content, imageBudget) : msg.content.map((item) => item.type === "image" ? {
489
- type: "text",
490
- text: NON_VISION_USER_IMAGE_PLACEHOLDER
491
- } : item)).map((item) => item.type === "text" ? {
492
- type: "text",
493
- text: sanitizeTransportPayloadText(item.text)
494
- } : {
495
- type: "image",
496
- source: {
497
- type: "base64",
498
- media_type: resolveAnthropicImageMediaType(item.mimeType),
499
- data: item.data
500
- }
501
- });
502
- let filteredBlocks = model.input.includes("image") ? blocks : blocks.filter((block) => block.type !== "image");
503
- filteredBlocks = filteredBlocks.filter((block) => block.type !== "text" || block.text.trim().length > 0);
504
- if (filteredBlocks.length === 0) continue;
505
- const userParam = {
506
- role: "user",
507
- content: filteredBlocks
508
- };
509
- if (isRuntimeContextCarrier) options.cacheBreakpointOptOutMessageIndexes.add(params.length);
510
- params.push(userParam);
511
- continue;
512
- }
513
- if (msg.role === "assistant") {
514
- const blocks = [];
515
- const reasoningContent = [];
516
- let omittedThinking = false;
517
- for (const block of msg.content) {
518
- if (block.type === "text") {
519
- if (block.text.trim().length > 0) blocks.push({
520
- type: "text",
521
- text: sanitizeTransportPayloadText(block.text)
522
- });
523
- continue;
524
- }
525
- if (block.type === "thinking") {
526
- const thinkingSignature = block.thinkingSignature?.trim();
527
- const isReasoningContent = thinkingSignature === "reasoning_content";
528
- if (!replayThinkingEnabled && i !== activeToolTurnAssistantIndex && !isReasoningContent) {
529
- omittedThinking = true;
530
- continue;
531
- }
532
- if (block.redacted) {
533
- blocks.push({
534
- type: "redacted_thinking",
535
- data: block.thinkingSignature
536
- });
537
- continue;
538
- }
539
- const hasNativeThinkingSignature = Boolean(thinkingSignature) && !isReasoningContent;
540
- if (block.thinking.trim().length === 0 && !hasNativeThinkingSignature) continue;
541
- if (!thinkingSignature) blocks.push({
542
- type: "text",
543
- text: sanitizeTransportPayloadText(block.thinking)
544
- });
545
- else {
546
- const thinking = thinkingSignature === "reasoning_content" ? sanitizeTransportPayloadText(block.thinking) : block.thinking;
547
- if (thinkingSignature === "reasoning_content") {
548
- if (allowReasoningContentReplay) {
549
- blocks.push({
550
- type: "thinking",
551
- thinking,
552
- signature: thinkingSignature
553
- });
554
- reasoningContent.push(thinking);
555
- }
556
- continue;
557
- }
558
- blocks.push({
559
- type: "thinking",
560
- thinking,
561
- signature: thinkingSignature
562
- });
563
- }
564
- continue;
565
- }
566
- if (block.type === "toolCall") blocks.push({
567
- type: "tool_use",
568
- id: block.id,
569
- name: isOAuthToken ? toClaudeCodeName(block.name) : block.name,
570
- input: coerceTransportToolCallArguments(block.arguments)
571
- });
572
- }
573
- if (blocks.length === 0 && omittedThinking) blocks.push({
574
- type: "text",
575
- text: ANTHROPIC_OMITTED_REASONING_TEXT
576
- });
577
- if (blocks.length > 0) {
578
- const assistantMsg = {
579
- role: "assistant",
580
- content: blocks
581
- };
582
- if (reasoningContent.length > 0) assistantMsg.reasoning_content = reasoningContent.join("\n");
583
- else if (allowReasoningContentReplay) blocks.unshift({
584
- type: "thinking",
585
- thinking: "",
586
- signature: "reasoning_content"
587
- });
588
- params.push(assistantMsg);
589
- }
590
- continue;
591
- }
592
- if (msg.role === "toolResult") {
593
- const toolResult = msg;
594
- const toolResults = [{
595
- type: "tool_result",
596
- tool_use_id: toolResult.toolCallId,
597
- content: await convertContentBlocks(toolResult.content, model, imageBudget),
598
- is_error: toolResult.isError
599
- }];
600
- let j = i + 1;
601
- while (j < transformedMessages.length) {
602
- const nextMsg = transformedMessages.at(j);
603
- if (nextMsg?.role !== "toolResult") break;
604
- toolResults.push({
605
- type: "tool_result",
606
- tool_use_id: nextMsg.toolCallId,
607
- content: await convertContentBlocks(nextMsg.content, model, imageBudget),
608
- is_error: nextMsg.isError
609
- });
610
- j += 1;
611
- }
612
- i = j - 1;
613
- params.push({
614
- role: "user",
615
- content: toolResults
616
- });
617
- }
618
- }
619
- return params;
620
- }
621
- function ensureNonEmptyAnthropicMessages(messages) {
622
- return messages.length > 0 ? messages : [{
623
- role: "user",
624
- content: EMPTY_ANTHROPIC_MESSAGES_FALLBACK_TEXT
625
- }];
626
- }
627
- function convertAnthropicTools(tools, isOAuthToken) {
628
- const projection = projectAnthropicTools(tools ?? [], (name) => isOAuthToken ? toClaudeCodeName(name) : name);
629
- const converted = [];
630
- for (const tool of projection.tools) converted.push({
631
- name: tool.wireName,
632
- description: tool.description,
633
- input_schema: tool.inputSchema
634
- });
635
- return {
636
- projection,
637
- tools: converted
638
- };
639
- }
640
- function parseAnthropicToolCallArguments(inputJson) {
641
- return parseJsonObjectPreservingUnsafeIntegers(inputJson) ?? parseStreamingJson(inputJson);
642
- }
643
- function mapStopReason(reason) {
644
- switch (reason) {
645
- case "end_turn": return "stop";
646
- case "max_tokens": return "length";
647
- case "tool_use": return "toolUse";
648
- case "pause_turn": return "stop";
649
- case "refusal":
650
- case "sensitive": return "error";
651
- case "stop_sequence": return "stop";
652
- default: throw new Error(`Unhandled stop reason: ${String(reason)}`);
653
- }
654
- }
655
- const DEFAULT_ANTHROPIC_BASE_URL = "https://api.anthropic.com";
656
- /** Resolve the effective Anthropic API base URL from model or environment. */
657
- function resolveAnthropicBaseUrl(baseUrl) {
658
- return baseUrl?.trim() || process.env.ANTHROPIC_BASE_URL?.trim() || DEFAULT_ANTHROPIC_BASE_URL;
659
- }
660
- /** Resolve the Anthropic Messages endpoint URL for the effective base URL. */
661
- function resolveAnthropicMessagesUrl(baseUrl) {
662
- const normalized = resolveAnthropicBaseUrl(baseUrl).replace(/\/+$/, "");
663
- return normalized.endsWith("/v1") ? `${normalized}/messages` : `${normalized}/v1/messages`;
664
- }
665
- function withEffectiveAnthropicBaseUrl(model) {
666
- const baseUrl = resolveAnthropicBaseUrl(model.baseUrl);
667
- return baseUrl === model.baseUrl ? model : {
668
- ...model,
669
- baseUrl
670
- };
671
- }
672
- function createAbortError(signal) {
673
- const reason = signal.reason;
674
- if (reason instanceof Error) return reason;
675
- return createAbortError$1("Request was aborted", reason === void 0 ? void 0 : { cause: reason });
676
- }
677
- function readAnthropicSseChunk(reader, signal) {
678
- if (!signal) return reader.read();
679
- return new Promise((resolve, reject) => {
680
- let settled = false;
681
- const onAbort = () => {
682
- if (settled) return;
683
- settled = true;
684
- signal.removeEventListener("abort", onAbort);
685
- reader.cancel(signal.reason).catch(() => void 0);
686
- reject(createAbortError(signal));
687
- };
688
- if (signal.aborted) {
689
- onAbort();
690
- return;
691
- }
692
- signal.addEventListener("abort", onAbort, { once: true });
693
- reader.read().then((result) => {
694
- if (settled) return;
695
- settled = true;
696
- signal.removeEventListener("abort", onAbort);
697
- resolve(result);
698
- }, (error) => {
699
- if (settled) return;
700
- settled = true;
701
- signal.removeEventListener("abort", onAbort);
702
- reject(toErrorObject(error, "Non-Error rejection"));
703
- });
704
- });
705
- }
706
- function parseAnthropicSseEventData(data) {
707
- try {
708
- return JSON.parse(data);
709
- } catch (error) {
710
- if (error instanceof SyntaxError) throw new Error(MALFORMED_STREAMING_FRAGMENT_ERROR_MESSAGE, { cause: error });
711
- throw error;
712
- }
713
- }
714
- function assertAnthropicSsePendingBufferWithinLimit(pendingChars) {
715
- if (pendingChars <= ANTHROPIC_MESSAGES_SSE_PENDING_BUFFER_MAX_CHARS) return;
716
- throw new Error(`Anthropic Messages SSE response exceeded max pending buffer size (${ANTHROPIC_MESSAGES_SSE_PENDING_BUFFER_MAX_CHARS} chars) without event boundary`);
717
- }
718
- async function* parseAnthropicSseBody(body, signal) {
719
- const reader = body.getReader();
720
- const decoder = new TextDecoder();
721
- let buffer = "";
722
- let completed = false;
723
- try {
724
- while (true) {
725
- const { done, value } = await readAnthropicSseChunk(reader, signal);
726
- if (done) {
727
- completed = true;
728
- break;
729
- }
730
- buffer = `${buffer}${decoder.decode(value, { stream: true })}`.replaceAll("\r\n", "\n");
731
- let frameEnd = buffer.indexOf("\n\n");
732
- while (frameEnd >= 0) {
733
- assertAnthropicSsePendingBufferWithinLimit(frameEnd);
734
- const frame = buffer.slice(0, frameEnd);
735
- buffer = buffer.slice(frameEnd + 2);
736
- const data = frame.split("\n").filter((line) => line.startsWith("data:")).map((line) => line.slice(5).trimStart()).join("\n");
737
- if (data && data !== "[DONE]") yield parseAnthropicSseEventData(data);
738
- frameEnd = buffer.indexOf("\n\n");
739
- }
740
- assertAnthropicSsePendingBufferWithinLimit(buffer.length);
741
- }
742
- const tailBuffer = `${buffer}${decoder.decode()}`.replaceAll("\r\n", "\n");
743
- assertAnthropicSsePendingBufferWithinLimit(tailBuffer.length);
744
- const tail = tailBuffer.trim();
745
- if (tail) {
746
- const data = tail.split("\n").filter((line) => line.startsWith("data:")).map((line) => line.slice(5).trimStart()).join("\n");
747
- if (data && data !== "[DONE]") yield parseAnthropicSseEventData(data);
748
- }
749
- } finally {
750
- if (!completed) await reader.cancel(signal?.reason).catch(() => void 0);
751
- reader.releaseLock();
752
- }
753
- }
754
- function createAnthropicMessagesClient(params) {
755
- const url = resolveAnthropicMessagesUrl(params.baseURL);
756
- return { messages: { async *stream(body, options) {
757
- const headers = mergeTransportHeaders({
758
- "content-type": "application/json",
759
- "anthropic-version": "2023-06-01",
760
- ...params.apiKey ? { "x-api-key": params.apiKey } : {},
761
- ...params.authToken ? { authorization: `Bearer ${params.authToken}` } : {}
762
- }, params.defaultHeaders);
763
- const response = await params.fetch(url, {
764
- method: "POST",
765
- headers,
766
- body: JSON.stringify(body),
767
- signal: options?.signal
768
- });
769
- if (!response.ok) {
770
- const detail = await readAnthropicMessagesErrorBodySnippet(response);
771
- throw new Error(formatAnthropicMessagesHttpError(response, detail));
772
- }
773
- if (!response.body) return;
774
- yield* parseAnthropicSseBody(response.body, options?.signal);
775
- } } };
776
- }
777
- function formatAnthropicMessagesHttpError(response, detail) {
778
- const retryAfterSeconds = parseRetryAfterSeconds(response.headers);
779
- const retryAfterSuffix = Number.isFinite(retryAfterSeconds) ? `; Retry-After: ${Math.ceil(retryAfterSeconds ?? 0)} seconds` : "";
780
- return `HTTP ${response.status}: ${detail || "Anthropic Messages request failed"}${retryAfterSuffix}`;
781
- }
782
- async function readAnthropicMessagesErrorBodySnippet(response) {
783
- try {
784
- return await readResponseTextSnippet(response, {
785
- maxBytes: ANTHROPIC_MESSAGES_ERROR_BODY_MAX_BYTES,
786
- maxChars: ANTHROPIC_MESSAGES_ERROR_BODY_MAX_CHARS,
787
- chunkTimeoutMs: ANTHROPIC_MESSAGES_ERROR_BODY_READ_IDLE_TIMEOUT_MS,
788
- onIdleTimeout: ({ chunkTimeoutMs }) => /* @__PURE__ */ new Error(`Anthropic Messages error response stalled: no data received for ${chunkTimeoutMs}ms`)
789
- }) ?? "";
790
- } catch (error) {
791
- if (error instanceof Error && error.message.startsWith("Anthropic Messages error response stalled:")) return error.message;
792
- return "";
793
- }
794
- }
795
- function createAnthropicTransportClient(params) {
796
- const { model, context, apiKey, options } = params;
797
- const needsInterleavedBeta = (options?.interleavedThinking ?? true) && !supportsAdaptiveThinking(model);
798
- const fetch = isKimiAnthropicProvider(model.provider) && options?.thinkingEnabled === true ? buildGuardedModelFetch(model, void 0, { sanitizeSse: false }) : buildGuardedModelFetch(model);
799
- if (model.provider === "github-copilot") {
800
- const betaFeatures = needsInterleavedBeta ? ["interleaved-thinking-2025-05-14"] : [];
801
- return {
802
- client: createAnthropicMessagesClient({
803
- apiKey: null,
804
- authToken: apiKey,
805
- baseURL: model.baseUrl,
806
- defaultHeaders: mergeTransportHeaders({
807
- accept: "application/json",
808
- "anthropic-dangerous-direct-browser-access": "true",
809
- ...betaFeatures.length > 0 ? { "anthropic-beta": betaFeatures.join(",") } : {}
810
- }, model.headers, getAiTransportHost().buildCopilotDynamicHeaders(context.messages), options?.headers),
811
- fetch
812
- }),
813
- isOAuthToken: false
814
- };
815
- }
816
- if (usesFoundryBearerAuth(resolveModelHeaderSentinels$1(model))) {
817
- const betaFeatures = needsInterleavedBeta ? ["interleaved-thinking-2025-05-14"] : [];
818
- return {
819
- client: createAnthropicMessagesClient({
820
- apiKey: null,
821
- authToken: apiKey,
822
- baseURL: model.baseUrl,
823
- defaultHeaders: mergeTransportHeaders({
824
- accept: "application/json",
825
- "anthropic-dangerous-direct-browser-access": "true",
826
- ...betaFeatures.length > 0 ? { "anthropic-beta": betaFeatures.join(",") } : {}
827
- }, omitFoundryBearerCredentialHeaders(model.headers), options?.headers),
828
- fetch
829
- }),
830
- isOAuthToken: false
831
- };
832
- }
833
- const betaFeatures = ["fine-grained-tool-streaming-2025-05-14"];
834
- if (needsInterleavedBeta) betaFeatures.push("interleaved-thinking-2025-05-14");
835
- if (isAnthropicOAuthToken(apiKey)) {
836
- const betaHeader = buildAnthropicBetaHeader(model, betaFeatures, { oauth: true });
837
- return {
838
- client: createAnthropicMessagesClient({
839
- apiKey: null,
840
- authToken: apiKey,
841
- baseURL: model.baseUrl,
842
- defaultHeaders: mergeTransportHeaders({
843
- accept: "application/json",
844
- "anthropic-dangerous-direct-browser-access": "true",
845
- ...betaHeader ? { "anthropic-beta": betaHeader } : {},
846
- "user-agent": `claude-cli/${CLAUDE_CODE_VERSION}`,
847
- "x-app": "cli"
848
- }, model.headers, options?.headers),
849
- fetch
850
- }),
851
- isOAuthToken: true
852
- };
853
- }
854
- if (useAnthropicServerSideFallback(model)) betaFeatures.push(ANTHROPIC_SERVER_SIDE_FALLBACK_BETA);
855
- const betaHeader = buildAnthropicBetaHeader(model, betaFeatures, { oauth: false });
856
- return {
857
- client: createAnthropicMessagesClient({
858
- apiKey,
859
- baseURL: model.baseUrl,
860
- defaultHeaders: mergeTransportHeaders({
861
- accept: "application/json",
862
- "anthropic-dangerous-direct-browser-access": "true",
863
- ...betaHeader ? { "anthropic-beta": betaHeader } : {}
864
- }, model.headers, options?.headers),
865
- fetch
866
- }),
867
- isOAuthToken: false
868
- };
869
- }
870
- async function buildAnthropicParams(model, context, isOAuthToken, options) {
871
- const mandatoryAdaptiveThinking = requiresClaudeAdaptiveThinking(model);
872
- const replayThinkingEnabled = mandatoryAdaptiveThinking || options?.thinkingEnabled === true;
873
- const maxTokens = resolveAnthropicMessagesMaxTokens({
874
- modelContextWindow: model.contextWindow,
875
- modelMaxTokens: model.maxTokens,
876
- requestedMaxTokens: options?.maxTokens
877
- });
878
- if (maxTokens === void 0) throw new Error(`Anthropic Messages transport requires a positive maxTokens value for ${model.provider}/${model.id}`);
879
- const payloadPolicy = resolveAnthropicPayloadPolicy({
880
- provider: model.provider,
881
- api: model.api,
882
- baseUrl: model.baseUrl,
883
- cacheRetention: options?.cacheRetention,
884
- enableCacheControl: true
885
- });
886
- const cacheBreakpointOptOutMessageIndexes = /* @__PURE__ */ new Set();
887
- const messages = await convertAnthropicMessages(context.messages, model, isOAuthToken, {
888
- allowReasoningContentReplay: supportsReasoningContentReplay(model),
889
- cacheBreakpointOptOutMessageIndexes,
890
- replayThinkingEnabled
891
- });
892
- const params = {
893
- model: resolveAnthropicRequestModelId(model),
894
- messages: ensureNonEmptyAnthropicMessages(messages),
895
- max_tokens: maxTokens,
896
- stream: true
897
- };
898
- if (!isOAuthToken && useAnthropicServerSideFallback(model)) params.fallbacks = ANTHROPIC_SERVER_SIDE_FALLBACKS;
899
- if (isOAuthToken) params.system = [
900
- {
901
- type: "text",
902
- text: CLAUDE_CODE_BILLING_SYSTEM_BLOCK
903
- },
904
- {
905
- type: "text",
906
- text: "You are Claude Code, Anthropic's official CLI for Claude."
907
- },
908
- ...context.systemPrompt ? [{
909
- type: "text",
910
- text: sanitizeTransportPayloadText(context.systemPrompt)
911
- }] : []
912
- ];
913
- else if (context.systemPrompt) params.system = [{
914
- type: "text",
915
- text: sanitizeTransportPayloadText(context.systemPrompt)
916
- }];
917
- if (options?.temperature !== void 0 && !options.thinkingEnabled && !supportsNativeXhighEffort(model)) params.temperature = options.temperature;
918
- if (options?.stop !== void 0 && options.stop.length > 0) params.stop_sequences = options.stop;
919
- let toolProjection;
920
- if (context.tools) {
921
- const convertedTools = convertAnthropicTools(context.tools, isOAuthToken);
922
- toolProjection = convertedTools.projection;
923
- if (convertedTools.tools.length > 0) params.tools = convertedTools.tools;
924
- }
925
- if (mandatoryAdaptiveThinking || model.reasoning || supportsAdaptiveThinking(model)) {
926
- if (mandatoryAdaptiveThinking || options?.thinkingEnabled) if (supportsAdaptiveThinking(model)) {
927
- params.thinking = {
928
- type: "adaptive",
929
- display: options?.thinkingDisplay ?? "summarized"
930
- };
931
- const effort = options?.effort ?? (mandatoryAdaptiveThinking ? "high" : void 0);
932
- if (effort) params.output_config = { effort };
933
- } else params.thinking = {
934
- type: "enabled",
935
- budget_tokens: options?.thinkingBudgetTokens ?? 1024
936
- };
937
- else if (options?.thinkingEnabled === false) params.thinking = { type: "disabled" };
938
- }
939
- if (options?.metadata && typeof options.metadata.user_id === "string") params.metadata = { user_id: options.metadata.user_id };
940
- if (options?.toolChoice) {
941
- const normalizedToolChoice = normalizeAnthropicToolChoice(replayThinkingEnabled, options.toolChoice);
942
- const projectedToolChoice = toolProjection ? reconcileAnthropicToolChoice(normalizedToolChoice, toolProjection) : normalizedToolChoice;
943
- if (projectedToolChoice) params.tool_choice = projectedToolChoice;
944
- }
945
- applyAnthropicPayloadPolicyToParams(params, payloadPolicy, cacheBreakpointOptOutMessageIndexes);
946
- return {
947
- params,
948
- toolProjection
949
- };
950
- }
951
- function resolveAnthropicTransportOptions(model, options, apiKey) {
952
- const baseMaxTokens = resolveAnthropicMessagesMaxTokens({
953
- modelContextWindow: model.contextWindow,
954
- modelMaxTokens: model.maxTokens,
955
- requestedMaxTokens: options?.maxTokens,
956
- useModelDefault: resolveClaudeSonnet5ModelIdentity(model) !== void 0 || resolveClaudeOpus5ModelIdentity(model) !== void 0
957
- });
958
- if (baseMaxTokens === void 0) throw new Error(`Anthropic Messages transport requires a positive maxTokens value for ${model.provider}/${model.id}`);
959
- const reasoningModelMaxTokens = resolvePositiveAnthropicTokenLimit(model.maxTokens) ?? baseMaxTokens;
960
- const mandatoryAdaptiveThinking = requiresClaudeAdaptiveThinking(model);
961
- const reasoning = options?.reasoning === "off" && mandatoryAdaptiveThinking ? "low" : options?.reasoning;
962
- const resolved = {
963
- temperature: options?.temperature,
964
- stop: options?.stop,
965
- maxTokens: baseMaxTokens,
966
- signal: options?.signal,
967
- apiKey,
968
- cacheRetention: options?.cacheRetention,
969
- sessionId: options?.sessionId,
970
- headers: options?.headers,
971
- onPayload: options?.onPayload,
972
- maxRetryDelayMs: options?.maxRetryDelayMs,
973
- metadata: options?.metadata,
974
- interleavedThinking: options?.interleavedThinking,
975
- toolChoice: options?.toolChoice,
976
- thinkingBudgets: options?.thinkingBudgets,
977
- reasoning
978
- };
979
- if (reasoning === "off") {
980
- resolved.thinkingEnabled = false;
981
- return resolved;
982
- }
983
- if (!reasoning) {
984
- resolved.thinkingEnabled = defaultsClaudeAdaptiveThinking(model);
985
- if (resolved.thinkingEnabled) resolved.effort = "high";
986
- return resolved;
987
- }
988
- if (supportsAdaptiveThinking(model)) {
989
- resolved.thinkingEnabled = true;
990
- resolved.effort = mapThinkingLevelToEffort(reasoning, model);
991
- return resolved;
992
- }
993
- const adjusted = adjustMaxTokensForThinking({
994
- baseMaxTokens,
995
- modelMaxTokens: reasoningModelMaxTokens,
996
- reasoningLevel: reasoning,
997
- customBudgets: options?.thinkingBudgets
998
- });
999
- const thinkingEnabled = adjusted.thinkingBudget >= 1024;
1000
- resolved.maxTokens = adjusted.maxTokens;
1001
- resolved.thinkingEnabled = thinkingEnabled;
1002
- resolved.thinkingBudgetTokens = thinkingEnabled ? adjusted.thinkingBudget : void 0;
1003
- return resolved;
1004
- }
1005
- /** Create the stream function used by Anthropic Messages transport models. */
1006
- function createAnthropicMessagesTransportStreamFn() {
1007
- return (rawModel, context, rawOptions) => {
1008
- const model = withEffectiveAnthropicBaseUrl(rawModel);
1009
- const options = rawOptions;
1010
- const { eventStream, stream } = createWritableTransportEventStream();
1011
- (async () => {
1012
- const output = {
1013
- role: "assistant",
1014
- content: [],
1015
- api: "anthropic-messages",
1016
- provider: model.provider,
1017
- model: model.id,
1018
- usage: createEmptyTransportUsage(),
1019
- stopReason: "stop",
1020
- timestamp: Date.now()
1021
- };
1022
- const refusalBuffer = usesClaudeStreamingRefusalContract(model) ? createDeferredEventBuffer(stream, () => notifyLlmRequestActivity(options?.signal)) : void 0;
1023
- const eventSink = refusalBuffer ?? stream;
1024
- let costModel = model;
1025
- let messageStartPromptUsage;
1026
- try {
1027
- const apiKey = options?.apiKey ?? getEnvApiKey(model.provider) ?? "";
1028
- if (!apiKey) throw new Error(`No API key for provider: ${model.provider}`);
1029
- const transportOptions = resolveAnthropicTransportOptions(model, options, apiKey);
1030
- const requestContext = prepareClaudeNoPrefillRequestContext(model, context);
1031
- const { client, isOAuthToken } = createAnthropicTransportClient({
1032
- model,
1033
- context: requestContext,
1034
- apiKey,
1035
- options: transportOptions
1036
- });
1037
- const builtParams = await buildAnthropicParams(model, requestContext, isOAuthToken, transportOptions);
1038
- let params = builtParams.params;
1039
- const toolProjection = builtParams.toolProjection;
1040
- const nextParams = await transportOptions.onPayload?.(params, model);
1041
- if (nextParams !== void 0) params = nextParams;
1042
- applyClaudeRequestContract(params, model);
1043
- const anthropicStream = client.messages.stream({
1044
- ...params,
1045
- stream: true
1046
- }, transportOptions.signal ? { signal: transportOptions.signal } : void 0);
1047
- const blocks = output.content;
1048
- const blockIndexes = /* @__PURE__ */ new Map();
1049
- const pendingThinkingSignatures = /* @__PURE__ */ new Map();
1050
- const allowReasoningContentReplay = supportsReasoningContentReplay(model);
1051
- const reasoningContentThinkingBlocks = /* @__PURE__ */ new Map();
1052
- const reasoningContentTextBlocks = /* @__PURE__ */ new Map();
1053
- let sawMessageStop = false;
1054
- const pendingTextEnds = [];
1055
- const flushPendingTextEnds = () => {
1056
- for (const event of pendingTextEnds) eventSink.push(event);
1057
- pendingTextEnds.length = 0;
1058
- };
1059
- const eventIndexKey = (eventIndex) => typeof eventIndex === "number" ? eventIndex : -1;
1060
- const appendReasoningContentThinkingDelta = (eventIndex, rawText) => {
1061
- if (typeof rawText !== "string") return false;
1062
- const text = sanitizeTransportPayloadText(rawText);
1063
- if (text.length === 0) return false;
1064
- const key = eventIndexKey(eventIndex);
1065
- let contentIndex = reasoningContentThinkingBlocks.get(key);
1066
- let block = contentIndex === void 0 ? void 0 : output.content[contentIndex];
1067
- if (!block || block.type !== "thinking") {
1068
- block = {
1069
- type: "thinking",
1070
- thinking: "",
1071
- thinkingSignature: "reasoning_content"
1072
- };
1073
- output.content.push(block);
1074
- contentIndex = output.content.length - 1;
1075
- reasoningContentThinkingBlocks.set(key, contentIndex);
1076
- eventSink.push({
1077
- type: "thinking_start",
1078
- contentIndex,
1079
- partial: output
1080
- });
1081
- }
1082
- block.thinking += text;
1083
- block.thinkingSignature = "reasoning_content";
1084
- eventSink.push({
1085
- type: "thinking_delta",
1086
- contentIndex,
1087
- delta: text,
1088
- partial: output
1089
- });
1090
- return true;
1091
- };
1092
- const appendReasoningContentTextDelta = (eventIndex, rawText) => {
1093
- if (typeof rawText !== "string") return false;
1094
- const text = sanitizeTransportPayloadText(rawText);
1095
- if (text.length === 0) return false;
1096
- const key = eventIndexKey(eventIndex);
1097
- let contentIndex = reasoningContentTextBlocks.get(key);
1098
- let block = contentIndex === void 0 ? void 0 : output.content[contentIndex];
1099
- if (!block || block.type !== "text") {
1100
- block = {
1101
- type: "text",
1102
- text: ""
1103
- };
1104
- output.content.push(block);
1105
- contentIndex = output.content.length - 1;
1106
- reasoningContentTextBlocks.set(key, contentIndex);
1107
- eventSink.push({
1108
- type: "text_start",
1109
- contentIndex,
1110
- partial: output
1111
- });
1112
- }
1113
- block.text += text;
1114
- eventSink.push({
1115
- type: "text_delta",
1116
- contentIndex,
1117
- delta: text,
1118
- partial: output
1119
- });
1120
- return true;
1121
- };
1122
- const finishReasoningContentSidecars = (eventIndex) => {
1123
- const key = eventIndexKey(eventIndex);
1124
- const thinkingContentIndex = reasoningContentThinkingBlocks.get(key);
1125
- if (thinkingContentIndex !== void 0) {
1126
- reasoningContentThinkingBlocks.delete(key);
1127
- const block = output.content[thinkingContentIndex];
1128
- if (block?.type === "thinking") eventSink.push({
1129
- type: "thinking_end",
1130
- contentIndex: thinkingContentIndex,
1131
- content: block.thinking,
1132
- partial: output
1133
- });
1134
- }
1135
- const textContentIndex = reasoningContentTextBlocks.get(key);
1136
- if (textContentIndex === void 0) return;
1137
- reasoningContentTextBlocks.delete(key);
1138
- const block = output.content[textContentIndex];
1139
- if (block?.type === "text") eventSink.push({
1140
- type: "text_end",
1141
- contentIndex: textContentIndex,
1142
- content: block.text,
1143
- partial: output
1144
- });
1145
- };
1146
- for await (const event of anthropicStream) {
1147
- if (event.type === "error") {
1148
- const error = event.error;
1149
- throw new Error(error?.message || "Anthropic Messages stream failed");
1150
- }
1151
- if (event.type === "message_start") {
1152
- const message = event.message;
1153
- const usage = message?.usage ?? {};
1154
- output.responseId = typeof message?.id === "string" ? message.id : void 0;
1155
- output.responseModel = typeof message?.model === "string" ? message.model : void 0;
1156
- const promptUsage = readAnthropicPromptUsageSnapshot(usage);
1157
- const messageStartPromptTokens = promptUsage ? promptUsage.input + promptUsage.cacheRead + promptUsage.cacheWrite : 0;
1158
- messageStartPromptUsage = messageStartPromptTokens > 0 ? promptUsage : void 0;
1159
- const inputTokens = readAnthropicUsageTokenCount(usage.input_tokens);
1160
- if (inputTokens !== void 0) output.usage.input = inputTokens;
1161
- const outputTokens = readAnthropicUsageTokenCount(usage.output_tokens);
1162
- if (outputTokens !== void 0) output.usage.output = outputTokens;
1163
- const cacheReadTokens = usage.cache_read_input_tokens == null ? 0 : readAnthropicUsageTokenCount(usage.cache_read_input_tokens);
1164
- if (cacheReadTokens !== void 0) output.usage.cacheRead = cacheReadTokens;
1165
- const cacheWriteTokens = usage.cache_creation_input_tokens == null ? 0 : readAnthropicUsageTokenCount(usage.cache_creation_input_tokens);
1166
- if (cacheWriteTokens !== void 0) output.usage.cacheWrite = cacheWriteTokens;
1167
- output.usage.totalTokens = output.usage.input + output.usage.output + output.usage.cacheRead + output.usage.cacheWrite;
1168
- if (messageStartPromptUsage && outputTokens !== void 0) output.usage.contextUsage = {
1169
- state: "available",
1170
- promptTokens: messageStartPromptTokens,
1171
- totalTokens: messageStartPromptTokens + output.usage.output
1172
- };
1173
- calculateCost(costModel, output.usage);
1174
- eventSink.push({
1175
- type: "start",
1176
- partial: output
1177
- });
1178
- continue;
1179
- }
1180
- if (event.type === "message_stop") {
1181
- sawMessageStop = true;
1182
- continue;
1183
- }
1184
- if (event.type === "content_block_start") {
1185
- const contentBlock = event.content_block;
1186
- const index = typeof event.index === "number" ? event.index : -1;
1187
- const fallbackBoundary = refusalBuffer ? readAnthropicFallbackBoundary(contentBlock) : null;
1188
- if (fallbackBoundary) {
1189
- refusalBuffer?.discard();
1190
- pendingTextEnds.length = 0;
1191
- blockIndexes.clear();
1192
- pendingThinkingSignatures.clear();
1193
- applyAnthropicFallbackBoundary({
1194
- output,
1195
- boundary: fallbackBoundary,
1196
- provider: model.provider
1197
- });
1198
- costModel = {
1199
- ...model,
1200
- cost: resolveAnthropicFallbackServingModelCost({
1201
- requestedModelId: model.id,
1202
- servingModelId: fallbackBoundary.toModel,
1203
- requestedCost: model.cost
1204
- })
1205
- };
1206
- calculateCost(costModel, output.usage);
1207
- eventSink.push({
1208
- type: "start",
1209
- partial: output
1210
- });
1211
- for (const [i, block] of output.content.entries()) {
1212
- if (block.type !== "text") continue;
1213
- delete block.index;
1214
- eventSink.push({
1215
- type: "text_start",
1216
- contentIndex: i,
1217
- partial: output
1218
- });
1219
- if (block.text) eventSink.push({
1220
- type: "text_delta",
1221
- contentIndex: i,
1222
- delta: block.text,
1223
- partial: output
1224
- });
1225
- pendingTextEnds.push({
1226
- type: "text_end",
1227
- contentIndex: i,
1228
- content: block.text,
1229
- partial: output
1230
- });
1231
- }
1232
- continue;
1233
- }
1234
- pendingThinkingSignatures.delete(index);
1235
- if (contentBlock?.type === "text") {
1236
- const text = typeof contentBlock.text === "string" ? sanitizeTransportPayloadText(contentBlock.text) : "";
1237
- const block = {
1238
- type: "text",
1239
- text,
1240
- index
1241
- };
1242
- output.content.push(block);
1243
- const contentIndex = output.content.length - 1;
1244
- blockIndexes.set(index, contentIndex);
1245
- eventSink.push({
1246
- type: "text_start",
1247
- contentIndex,
1248
- partial: output
1249
- });
1250
- if (text.length > 0) eventSink.push({
1251
- type: "text_delta",
1252
- contentIndex,
1253
- delta: text,
1254
- partial: output
1255
- });
1256
- continue;
1257
- }
1258
- if (contentBlock?.type === "thinking") {
1259
- const thinking = typeof contentBlock.thinking === "string" ? contentBlock.thinking : "";
1260
- const block = {
1261
- type: "thinking",
1262
- thinking,
1263
- thinkingSignature: typeof contentBlock.signature === "string" ? contentBlock.signature : "",
1264
- index
1265
- };
1266
- output.content.push(block);
1267
- const contentIndex = output.content.length - 1;
1268
- blockIndexes.set(index, contentIndex);
1269
- eventSink.push({
1270
- type: "thinking_start",
1271
- contentIndex,
1272
- partial: output
1273
- });
1274
- if (thinking.length > 0) eventSink.push({
1275
- type: "thinking_delta",
1276
- contentIndex,
1277
- delta: thinking,
1278
- partial: output
1279
- });
1280
- continue;
1281
- }
1282
- if (contentBlock?.type === "redacted_thinking") {
1283
- const block = {
1284
- type: "thinking",
1285
- thinking: "[Reasoning redacted]",
1286
- thinkingSignature: typeof contentBlock.data === "string" ? contentBlock.data : "",
1287
- redacted: true,
1288
- index
1289
- };
1290
- output.content.push(block);
1291
- blockIndexes.set(index, output.content.length - 1);
1292
- eventSink.push({
1293
- type: "thinking_start",
1294
- contentIndex: output.content.length - 1,
1295
- partial: output
1296
- });
1297
- continue;
1298
- }
1299
- if (contentBlock?.type === "tool_use") {
1300
- tagPendingCommentaryText(output.content);
1301
- flushPendingTextEnds();
1302
- const block = {
1303
- type: "toolCall",
1304
- id: typeof contentBlock.id === "string" ? contentBlock.id : "",
1305
- name: typeof contentBlock.name === "string" ? isOAuthToken ? resolveOriginalAnthropicToolName(contentBlock.name, toolProjection) : contentBlock.name : "",
1306
- arguments: contentBlock.input && typeof contentBlock.input === "object" ? contentBlock.input : {},
1307
- partialJson: "",
1308
- index
1309
- };
1310
- output.content.push(block);
1311
- blockIndexes.set(index, output.content.length - 1);
1312
- eventSink.push({
1313
- type: "toolcall_start",
1314
- contentIndex: output.content.length - 1,
1315
- partial: output
1316
- });
1317
- }
1318
- continue;
1319
- }
1320
- if (event.type === "content_block_delta") {
1321
- const delta = event.delta;
1322
- const eventIndex = typeof event.index === "number" ? event.index : void 0;
1323
- let index = eventIndex === void 0 ? void 0 : blockIndexes.get(eventIndex);
1324
- let block = index === void 0 ? void 0 : blocks[index];
1325
- if (allowReasoningContentReplay) {
1326
- const appendedThinking = appendReasoningContentThinkingDelta(event.index, delta?.reasoning_content);
1327
- const hasNativeAnthropicDelta = delta?.type === "text_delta" && typeof delta.text === "string" || delta?.type === "thinking_delta" && typeof delta.thinking === "string" || delta?.type === "input_json_delta" && typeof delta.partial_json === "string" || delta?.type === "signature_delta" && typeof delta.signature === "string";
1328
- let appendedContent = false;
1329
- if (!hasNativeAnthropicDelta && typeof delta?.content === "string" && delta.content.length > 0) {
1330
- const text = sanitizeTransportPayloadText(delta.content);
1331
- if (text.length > 0) if (block?.type === "text") {
1332
- block.text += text;
1333
- eventSink.push({
1334
- type: "text_delta",
1335
- contentIndex: index,
1336
- delta: text,
1337
- partial: output
1338
- });
1339
- appendedContent = true;
1340
- } else appendedContent = appendReasoningContentTextDelta(event.index, text);
1341
- }
1342
- if ((appendedThinking || appendedContent) && !hasNativeAnthropicDelta) continue;
1343
- }
1344
- if (!block && delta?.type === "text_delta" && typeof delta.text === "string") {
1345
- block = {
1346
- type: "text",
1347
- text: "",
1348
- index: typeof event.index === "number" ? event.index : blocks.length
1349
- };
1350
- output.content.push(block);
1351
- index = output.content.length - 1;
1352
- if (typeof event.index === "number") blockIndexes.set(event.index, index);
1353
- eventSink.push({
1354
- type: "text_start",
1355
- contentIndex: index,
1356
- partial: output
1357
- });
1358
- }
1359
- if (block?.type === "text" && delta?.type === "text_delta" && typeof delta.text === "string") {
1360
- block.text += delta.text;
1361
- eventSink.push({
1362
- type: "text_delta",
1363
- contentIndex: index,
1364
- delta: delta.text,
1365
- partial: output
1366
- });
1367
- continue;
1368
- }
1369
- if (block?.type === "thinking" && delta?.type === "thinking_delta" && typeof delta.thinking === "string") {
1370
- block.thinking += delta.thinking;
1371
- eventSink.push({
1372
- type: "thinking_delta",
1373
- contentIndex: index,
1374
- delta: delta.thinking,
1375
- partial: output
1376
- });
1377
- continue;
1378
- }
1379
- if (block?.type === "toolCall" && delta?.type === "input_json_delta" && typeof delta.partial_json === "string") {
1380
- const partialJson = `${block.partialJson ?? ""}${delta.partial_json}`;
1381
- block.partialJson = partialJson;
1382
- block.arguments = parseAnthropicToolCallArguments(partialJson);
1383
- eventSink.push({
1384
- type: "toolcall_delta",
1385
- contentIndex: index,
1386
- delta: delta.partial_json,
1387
- partial: output
1388
- });
1389
- continue;
1390
- }
1391
- if (block?.type === "thinking" && delta?.type === "signature_delta" && typeof delta.signature === "string") {
1392
- const signatureIndex = eventIndexKey(event.index);
1393
- const pendingSignature = pendingThinkingSignatures.get(signatureIndex);
1394
- if (pendingSignature === void 0) {
1395
- block.thinkingSignature = "";
1396
- pendingThinkingSignatures.set(signatureIndex, delta.signature);
1397
- } else pendingThinkingSignatures.set(signatureIndex, pendingSignature + delta.signature);
1398
- }
1399
- continue;
1400
- }
1401
- if (event.type === "content_block_stop") {
1402
- const eventIndex = typeof event.index === "number" ? event.index : void 0;
1403
- const pendingSignature = eventIndex === void 0 ? void 0 : pendingThinkingSignatures.get(eventIndex);
1404
- if (eventIndex !== void 0) pendingThinkingSignatures.delete(eventIndex);
1405
- const index = eventIndex === void 0 ? void 0 : blockIndexes.get(eventIndex);
1406
- const block = index === void 0 ? void 0 : blocks[index];
1407
- if (eventIndex === void 0 || index === void 0 || !block) {
1408
- finishReasoningContentSidecars(event.index);
1409
- continue;
1410
- }
1411
- blockIndexes.delete(eventIndex);
1412
- delete block.index;
1413
- if (block.type === "text") {
1414
- pendingTextEnds.push({
1415
- type: "text_end",
1416
- contentIndex: index,
1417
- content: block.text,
1418
- partial: output
1419
- });
1420
- finishReasoningContentSidecars(event.index);
1421
- continue;
1422
- }
1423
- if (block.type === "thinking") {
1424
- if (pendingSignature !== void 0) block.thinkingSignature = pendingSignature;
1425
- eventSink.push({
1426
- type: "thinking_end",
1427
- contentIndex: index,
1428
- content: block.thinking,
1429
- partial: output
1430
- });
1431
- finishReasoningContentSidecars(event.index);
1432
- continue;
1433
- }
1434
- if (block.type === "toolCall") {
1435
- delete block.partialJson;
1436
- eventSink.push({
1437
- type: "toolcall_end",
1438
- contentIndex: index,
1439
- toolCall: block,
1440
- partial: output
1441
- });
1442
- finishReasoningContentSidecars(event.index);
1443
- }
1444
- continue;
1445
- }
1446
- if (event.type === "message_delta") {
1447
- const delta = event.delta;
1448
- const usage = event.usage;
1449
- if (delta?.stop_reason) if (delta.stop_reason === "refusal") applyAnthropicRefusal(output, delta.stop_details, model.provider);
1450
- else output.stopReason = mapStopReason(delta.stop_reason);
1451
- const inputTokens = readAnthropicUsageTokenCount(usage?.input_tokens);
1452
- if (inputTokens !== void 0) output.usage.input = inputTokens;
1453
- const outputTokens = readAnthropicUsageTokenCount(usage?.output_tokens);
1454
- if (outputTokens !== void 0) output.usage.output = outputTokens;
1455
- const cacheReadTokens = readAnthropicUsageTokenCount(usage?.cache_read_input_tokens);
1456
- if (cacheReadTokens !== void 0) output.usage.cacheRead = cacheReadTokens;
1457
- const cacheWriteTokens = readAnthropicUsageTokenCount(usage?.cache_creation_input_tokens);
1458
- if (cacheWriteTokens !== void 0) output.usage.cacheWrite = cacheWriteTokens;
1459
- output.usage.totalTokens = output.usage.input + output.usage.output + output.usage.cacheRead + output.usage.cacheWrite;
1460
- const iterationUsage = readLastAnthropicIterationUsage(usage ?? {});
1461
- if (iterationUsage.state === "valid") output.usage.contextUsage = {
1462
- state: "available",
1463
- promptTokens: iterationUsage.usage.contextPromptTokens,
1464
- totalTokens: iterationUsage.usage.totalTokens
1465
- };
1466
- else if (iterationUsage.state === "invalid") output.usage.contextUsage = { state: "unavailable" };
1467
- else if (outputTokens !== void 0 && (messageStartPromptUsage !== void 0 || inputTokens !== void 0 && cacheReadTokens !== void 0 && cacheWriteTokens !== void 0)) {
1468
- const promptTokens = output.usage.input + output.usage.cacheRead + output.usage.cacheWrite;
1469
- output.usage.contextUsage = {
1470
- state: "available",
1471
- promptTokens,
1472
- totalTokens: promptTokens + output.usage.output
1473
- };
1474
- } else output.usage.contextUsage = { state: "unavailable" };
1475
- calculateCost(costModel, output.usage);
1476
- if (output.stopReason === "toolUse" || output.content.some((block) => block.type === "toolCall")) tagPendingCommentaryText(output.content);
1477
- flushPendingTextEnds();
1478
- }
1479
- }
1480
- if (refusalBuffer && !sawMessageStop) throw new Error("Anthropic stream ended before message_stop");
1481
- if (transportOptions.signal?.aborted) throw transportAbortError(transportOptions.signal);
1482
- if (output.stopReason === "aborted" || output.stopReason === "error") throw new Error(output.errorMessage ?? "An unknown error occurred");
1483
- refusalBuffer?.flush();
1484
- if (output.stopReason === "toolUse" || output.content.some((block) => block.type === "toolCall")) tagPendingCommentaryText(output.content);
1485
- flushPendingTextEnds();
1486
- finalizeTransportStream({
1487
- stream,
1488
- output
1489
- });
1490
- } catch (error) {
1491
- if (refusalBuffer) {
1492
- refusalBuffer.discard();
1493
- output.content = [];
1494
- }
1495
- failTransportStream({
1496
- stream,
1497
- output,
1498
- signal: options?.signal,
1499
- error,
1500
- cleanup: () => {
1501
- for (const block of output.content) delete block.index;
1502
- }
1503
- });
1504
- }
1505
- })();
1506
- return eventStream;
1507
- };
1508
- }
1509
- //#endregion
1510
- //#region packages/ai/src/transports/deepseek-text-filter.ts
1511
- /**
1512
- * DeepSeek DSML streaming text filter.
1513
- * Removes provider-emitted DSML tool markup while buffering split tag prefixes
1514
- * across streamed chunks.
1515
- */
1516
- const DSML_KINDS = [
1517
- "tool_use_error",
1518
- "tool_calls",
1519
- "tool_call",
1520
- "function_calls"
1521
- ];
1522
- const DSML_BARS = ["|", "|"];
1523
- const DSML_OPEN_TOKENS = DSML_BARS.flatMap((bar) => DSML_KINDS.map((kind) => `<${bar}DSML${bar}${kind}>`));
1524
- const DSML_CLOSE_TOKENS = DSML_BARS.flatMap((bar) => DSML_KINDS.map((kind) => `</${bar}DSML${bar}${kind}>`));
1525
- const MAX_OPEN_TOKEN_LEN = Math.max(...DSML_OPEN_TOKENS.map((token) => token.length));
1526
- const MAX_CLOSE_TOKEN_LEN = Math.max(...DSML_CLOSE_TOKENS.map((token) => token.length));
1527
- /** Create an incremental text filter that strips DeepSeek DSML tool blocks. */
1528
- function createDeepSeekTextFilter() {
1529
- let buffer = "";
1530
- let insideDsml = false;
1531
- const consume = (final) => {
1532
- const output = [];
1533
- const emit = (text) => {
1534
- if (text) output.push(text);
1535
- };
1536
- while (buffer) {
1537
- if (insideDsml) {
1538
- const close = findEarliestToken(buffer, DSML_CLOSE_TOKENS);
1539
- if (close) {
1540
- buffer = buffer.slice(close.index + close.token.length);
1541
- insideDsml = false;
1542
- continue;
1543
- }
1544
- const keep = final ? 0 : Math.min(buffer.length, MAX_CLOSE_TOKEN_LEN - 1);
1545
- buffer = buffer.slice(buffer.length - keep);
1546
- if (final) insideDsml = false;
1547
- return output;
1548
- }
1549
- const open = findEarliestToken(buffer, DSML_OPEN_TOKENS);
1550
- if (open) {
1551
- emit(buffer.slice(0, open.index));
1552
- buffer = buffer.slice(open.index + open.token.length);
1553
- insideDsml = true;
1554
- continue;
1555
- }
1556
- if (final) {
1557
- emit(buffer);
1558
- buffer = "";
1559
- return output;
1560
- }
1561
- const keep = longestDsmlOpenPrefixSuffixLength(buffer);
1562
- const emitLength = buffer.length - keep;
1563
- if (emitLength <= 0) return output;
1564
- emit(buffer.slice(0, emitLength));
1565
- buffer = buffer.slice(emitLength);
1566
- return output;
1567
- }
1568
- return output;
1569
- };
1570
- return {
1571
- push(chunk) {
1572
- buffer += chunk;
1573
- return consume(false);
1574
- },
1575
- flush() {
1576
- return consume(true);
1577
- }
1578
- };
1579
- }
1580
- function findEarliestToken(text, tokens) {
1581
- let best = null;
1582
- for (const token of tokens) {
1583
- const index = text.indexOf(token);
1584
- if (index !== -1 && (!best || index < best.index)) best = {
1585
- index,
1586
- token
1587
- };
1588
- }
1589
- return best;
1590
- }
1591
- function longestDsmlOpenPrefixSuffixLength(text) {
1592
- const maxLength = Math.min(text.length, MAX_OPEN_TOKEN_LEN - 1);
1593
- for (let length = maxLength; length > 0; length--) {
1594
- const suffix = text.slice(text.length - length);
1595
- if (DSML_OPEN_TOKENS.some((token) => token.startsWith(suffix))) return length;
1596
- }
1597
- return 0;
1598
- }
1599
- //#endregion
1600
- //#region packages/ai/src/transports/model-max-tokens-params.ts
1601
- /**
1602
- * Max-token parameter normalization across provider/native naming variants.
1603
- * Callers canonicalize aliases before dispatch so payloads cannot carry
1604
- * conflicting limits.
1605
- */
1606
- const MAX_TOKENS_PARAM_KEYS = [
1607
- "maxTokens",
1608
- "max_completion_tokens",
1609
- "max_tokens"
1610
- ];
1611
- /** Return a finite non-negative max-token value, or undefined for invalid input. */
1612
- function resolveNonNegativeMaxTokensParam(value) {
1613
- return typeof value === "number" && Number.isFinite(value) && value >= 0 ? value : void 0;
1614
- }
1615
- /** Resolve the first supported max-token parameter present in a params object. */
1616
- function resolveMaxTokensParam(params) {
1617
- if (!params) return;
1618
- for (const key of MAX_TOKENS_PARAM_KEYS) {
1619
- const resolved = resolveNonNegativeMaxTokensParam(params[key]);
1620
- if (resolved !== void 0) return resolved;
1621
- }
1622
- }
1623
- /**
1624
- * Canonicalize merged params to `maxTokens`, preserving source precedence from
1625
- * left to right across the provided source objects.
1626
- */
1627
- function canonicalizeMaxTokensParam(params) {
1628
- let resolved;
1629
- for (const source of params.sources) {
1630
- const sourceValue = resolveMaxTokensParam(source);
1631
- if (sourceValue !== void 0) resolved = sourceValue;
1632
- }
1633
- if (resolved === void 0) return;
1634
- for (const key of MAX_TOKENS_PARAM_KEYS) delete params.merged[key];
1635
- params.merged.maxTokens = resolved;
1636
- }
1637
- //#endregion
1638
- //#region packages/ai/src/transports/model-transport-url.ts
1639
- /**
1640
- * Debug formatting helpers for model transport endpoints.
1641
- * Keeps logs useful without exposing credentials, request params, or fragments.
1642
- */
1643
- /** Return a sanitized URL suitable for logs and diagnostics. */
1644
- function formatModelTransportDebugUrl(rawUrl) {
1645
- try {
1646
- const parsed = new URL(rawUrl);
1647
- parsed.username = "";
1648
- parsed.password = "";
1649
- parsed.search = "";
1650
- parsed.hash = "";
1651
- return parsed.toString();
1652
- } catch {
1653
- return "<invalid-url>";
1654
- }
1655
- }
1656
- /** Format a configured base URL for debug output, or the implicit default. */
1657
- function formatModelTransportDebugBaseUrl(rawUrl) {
1658
- return rawUrl ? formatModelTransportDebugUrl(rawUrl) : "default";
1659
- }
1660
- //#endregion
1661
- //#region packages/ai/src/transports/openai-compatible-conversation-turn.ts
1662
- /**
1663
- * OpenAI-compatible conversation turn detector.
1664
- *
1665
- * Some providers reject requests without a non-empty user/assistant turn; this
1666
- * helper checks the loose message payload shape before transport submission.
1667
- */
1668
- function hasNonEmptyContentPart(part) {
1669
- if (!part || typeof part !== "object") return false;
1670
- const record = part;
1671
- if (record.type === "text") return hasNonEmptyString(record.text);
1672
- return true;
1673
- }
1674
- function hasNonEmptyMessageContent(content) {
1675
- if (hasNonEmptyString(content)) return true;
1676
- if (!Array.isArray(content)) return false;
1677
- return content.some(hasNonEmptyContentPart);
1678
- }
1679
- function hasAssistantToolCall(message) {
1680
- const toolCalls = message.tool_calls;
1681
- return Array.isArray(toolCalls) && toolCalls.some((toolCall) => {
1682
- return Boolean(toolCall && typeof toolCall === "object");
1683
- });
1684
- }
1685
- /** Returns whether an OpenAI-compatible messages payload contains a usable turn. */
1686
- function hasOpenAICompatibleConversationTurn(messages) {
1687
- if (!Array.isArray(messages)) return false;
1688
- return messages.some((message) => {
1689
- if (!message || typeof message !== "object") return false;
1690
- const record = message;
1691
- if (record.role === "user") return hasNonEmptyMessageContent(record.content);
1692
- if (record.role === "assistant") return hasNonEmptyMessageContent(record.content) || hasAssistantToolCall(record);
1693
- return false;
1694
- });
1695
- }
1696
- //#endregion
1697
- //#region packages/ai/src/transports/openai-completions-string-content.ts
1698
- /**
1699
- * OpenAI Chat Completions compatibility helpers. Some providers only accept
1700
- * role/content messages with plain string content instead of text block arrays.
1701
- */
1702
- function flattenStringOnlyCompletionContent(content) {
1703
- if (!Array.isArray(content)) return content;
1704
- const textParts = [];
1705
- for (const item of content) {
1706
- if (!item || typeof item !== "object" || item.type !== "text" || typeof item.text !== "string") return content;
1707
- textParts.push(item.text);
1708
- }
1709
- return textParts.join("\n");
1710
- }
1711
- /** Flatten string-only text block content arrays into newline-joined strings. */
1712
- function flattenCompletionMessagesToStringContent(messages) {
1713
- return messages.map((message) => {
1714
- if (!message || typeof message !== "object") return message;
1715
- const content = message.content;
1716
- const flattenedContent = flattenStringOnlyCompletionContent(content);
1717
- if (flattenedContent === content) return message;
1718
- return {
1719
- ...message,
1720
- content: flattenedContent
1721
- };
1722
- });
1723
- }
1724
- /** Strip completion messages to role/content fields for strict providers. */
1725
- function stripCompletionMessagesToRoleContent(messages) {
1726
- return messages.map((message) => {
1727
- if (!message || typeof message !== "object" || Array.isArray(message)) return message;
1728
- const record = message;
1729
- const stripped = {};
1730
- if (Object.hasOwn(record, "role")) stripped.role = record.role;
1731
- if (Object.hasOwn(record, "content")) stripped.content = record.content;
1732
- return stripped;
1733
- });
1734
- }
1735
- //#endregion
1736
- //#region packages/ai/src/transports/openai-transport-params.ts
1737
- const MAX_OPENAI_STRICT_TOOL_DOWNGRADE_DIAGNOSTIC_KEYS = 256;
1738
- const OPENAI_CODEX_RESPONSES_PROVIDERS = /* @__PURE__ */ new Set(["openai"]);
1739
- const loggedOpenAIStrictToolDowngradeDiagnosticKeys = /* @__PURE__ */ new Set();
1740
- function readToolPayloadField(record, field) {
1741
- try {
1742
- return Object.hasOwn(record, field) ? record[field] : void 0;
1743
- } catch {
1744
- return;
1745
- }
1746
- }
1747
- function readCodeModePayloadToolName(tool) {
1748
- if (!isRecord(tool)) return;
1749
- const name = readToolPayloadField(tool, "name");
1750
- if (typeof name === "string") return name;
1751
- const fn = readToolPayloadField(tool, "function");
1752
- if (!isRecord(fn)) return;
1753
- const fnName = readToolPayloadField(fn, "name");
1754
- return typeof fnName === "string" ? fnName : void 0;
1755
- }
1756
- function filterCodeModePayloadTools(payload, visibleToolNames) {
1757
- if (!isRecord(payload)) return;
1758
- const tools = readToolPayloadField(payload, "tools");
1759
- if (!Array.isArray(tools)) return;
1760
- payload.tools = tools.flatMap((tool) => {
1761
- const name = readCodeModePayloadToolName(tool);
1762
- if (typeof name === "string" && isCodeModeModelVisibleToolName(name, visibleToolNames)) return [tool];
1763
- if (!isRecord(tool)) return [];
1764
- const filteredGroups = {};
1765
- for (const key of ["functionDeclarations", "function_declarations"]) {
1766
- const declarations = readToolPayloadField(tool, key);
1767
- if (!Array.isArray(declarations)) continue;
1768
- const filtered = declarations.filter((declaration) => {
1769
- const declarationName = readCodeModePayloadToolName(declaration);
1770
- return typeof declarationName === "string" && isCodeModeModelVisibleToolName(declarationName, visibleToolNames);
1771
- });
1772
- if (filtered.length > 0) filteredGroups[key] = filtered;
1773
- }
1774
- return Object.keys(filteredGroups).length > 0 ? [filteredGroups] : [];
1775
- });
1776
- }
1777
- function resolveCodeModeResponsesVisibleToolNames(context) {
1778
- return new Set((context.tools ?? []).map(readCodeModePayloadToolName).filter((name) => typeof name === "string"));
1779
- }
1780
- function enforceCodeModeResponsesToolSurface(payload, visibleToolNames) {
1781
- if (!isRecord(payload)) return;
1782
- const tools = readToolPayloadField(payload, "tools");
1783
- if (!Array.isArray(tools)) return;
1784
- payload.tools = tools.filter((tool) => {
1785
- const name = readCodeModePayloadToolName(tool);
1786
- return typeof name === "string" && isCodeModeModelVisibleToolName(name, visibleToolNames);
1787
- });
1788
- }
1789
- function assertCodeModeResponsesToolSurface(payload, visibleToolNames) {
1790
- const tools = isRecord(payload) ? readToolPayloadField(payload, "tools") : void 0;
1791
- if (!Array.isArray(tools)) throw new Error("Code mode payload tool surface violation: expected exec,wait; got no tools");
1792
- const names = tools.map(readCodeModePayloadToolName).filter((name) => typeof name === "string" && name.length > 0).toSorted((left, right) => left.localeCompare(right));
1793
- if (names.length >= 2 && names.length === tools.length && new Set(names).size === names.length && names.includes("exec") && names.includes("wait") && names.every((name) => isCodeModeModelVisibleToolName(name, visibleToolNames))) return;
1794
- throw new Error(`Code mode payload tool surface violation: expected exec,wait plus direct-only tools; got ${names.length > 0 ? names.join(",") : "none"}`);
1795
- }
1796
- function buildOpenAIStrictToolDowngradeDiagnosticKey(diagnostics, context) {
1797
- return sha256Hex(JSON.stringify({
1798
- transport: context.transport,
1799
- provider: context.model.provider ?? null,
1800
- model: context.model.id ?? null,
1801
- diagnostics: diagnostics.map((entry) => ({
1802
- toolIndex: entry.toolIndex,
1803
- toolName: entry.toolName ?? null,
1804
- violations: entry.violations
1805
- }))
1806
- }));
1807
- }
1808
- function shouldLogOpenAIStrictToolDowngradeDiagnostic(diagnostics, context) {
1809
- const key = buildOpenAIStrictToolDowngradeDiagnosticKey(diagnostics, context);
1810
- if (loggedOpenAIStrictToolDowngradeDiagnosticKeys.has(key)) return false;
1811
- if (loggedOpenAIStrictToolDowngradeDiagnosticKeys.size >= MAX_OPENAI_STRICT_TOOL_DOWNGRADE_DIAGNOSTIC_KEYS) loggedOpenAIStrictToolDowngradeDiagnosticKeys.clear();
1812
- loggedOpenAIStrictToolDowngradeDiagnosticKeys.add(key);
1813
- return true;
1814
- }
1815
- function resolveOpenAIStrictToolFlagWithDiagnostics(projection, strictSetting, context) {
1816
- const strict = resolveOpenAIProjectedToolsStrictToolFlag(projection, strictSetting);
1817
- if (strictSetting === true && strict === false) {
1818
- const diagnostics = findOpenAIStrictToolProjectionDiagnostics(projection);
1819
- getAiTransportHost().logDebug("openai-transport", () => {
1820
- if (!shouldLogOpenAIStrictToolDowngradeDiagnostic(diagnostics, context)) return null;
1821
- const sample = diagnostics.slice(0, 5).map((entry) => ({
1822
- tool: entry.toolName ?? `tool[${entry.toolIndex}]`,
1823
- violations: entry.violations.slice(0, 8)
1824
- }));
1825
- return {
1826
- message: `OpenAI ${context.transport} tool schema strict mode downgraded to strict=false for ${context.model.provider ?? "unknown"}/${context.model.id ?? "unknown"} because ${diagnostics.length} tool schema(s) are not strict-compatible`,
1827
- data: {
1828
- transport: context.transport,
1829
- provider: context.model.provider,
1830
- model: context.model.id,
1831
- incompatibleToolCount: diagnostics.length,
1832
- sample
1833
- }
1834
- };
1835
- });
1836
- }
1837
- return strict;
1838
- }
1839
- function isOpenAICodexResponsesModel(model) {
1840
- return OPENAI_CODEX_RESPONSES_PROVIDERS.has(model.provider) && (model.api === "openai-chatgpt-responses" || model.api === "openclaw-openai-chatgpt-responses-transport");
1841
- }
1842
- function isNativeOpenAICodexResponsesBaseUrl(baseUrl) {
1843
- const trimmed = typeof baseUrl === "string" ? baseUrl.trim() : "";
1844
- if (!trimmed) return false;
1845
- try {
1846
- const url = new URL(trimmed);
1847
- if (url.protocol !== "http:" && url.protocol !== "https:") return false;
1848
- if (url.hostname.toLowerCase() !== "chatgpt.com") return false;
1849
- const pathname = url.pathname.replace(/\/+$/u, "").toLowerCase();
1850
- return [
1851
- "/backend-api",
1852
- "/backend-api/v1",
1853
- "/backend-api/codex",
1854
- "/backend-api/codex/v1"
1855
- ].includes(pathname);
1856
- } catch {
1857
- return false;
1858
- }
1859
- }
1860
- function usesNativeOpenAICodexResponsesBackend(model) {
1861
- return isOpenAICodexResponsesModel(model) && isNativeOpenAICodexResponsesBaseUrl(model.baseUrl);
1862
- }
1863
- function buildOpenAIClientHeaders(model, context, optionHeaders, turnHeaders, sessionId) {
1864
- const providerHeaders = { ...model.headers };
1865
- if (model.provider === "github-copilot") Object.assign(providerHeaders, getAiTransportHost().buildCopilotDynamicHeaders(context.messages));
1866
- const callerHeaders = {
1867
- ...optionHeaders,
1868
- ...turnHeaders
1869
- };
1870
- const resolvedHeaders = resolveProviderRequestPolicyConfig({
1871
- provider: model.provider,
1872
- api: model.api,
1873
- baseUrl: model.baseUrl,
1874
- capability: "llm",
1875
- transport: "stream",
1876
- providerHeaders,
1877
- callerHeaders: Object.keys(callerHeaders).length > 0 ? callerHeaders : void 0,
1878
- precedence: "caller-wins"
1879
- }).headers ?? {};
1880
- if (sessionId && !Object.keys(resolvedHeaders).some((key) => normalizeLowercaseStringOrEmpty(key) === "session_id") && usesNativeOpenAICodexResponsesBackend(model)) resolvedHeaders.session_id = clampOpenAIPromptCacheKey(sessionId) ?? sessionId;
1881
- return resolvedHeaders;
1882
- }
1883
- function resolveOpenAISdkTimeoutMs(model, timeoutMs) {
1884
- return resolveModelRequestTimeoutMs(model, timeoutMs);
1885
- }
1886
- function buildOpenAISdkClientOptions(model) {
1887
- const timeout = resolveOpenAISdkTimeoutMs(model);
1888
- return timeout === void 0 ? {} : { timeout };
1889
- }
1890
- function buildOpenAISdkRequestOptions(model, signal, options) {
1891
- const timeout = resolveOpenAISdkTimeoutMs(model, options?.timeoutMs);
1892
- const headers = options?.stream === true && usesNativeOpenAICodexResponsesBackend(model) ? { Accept: "text/event-stream" } : void 0;
1893
- if (timeout === void 0 && options?.maxRetries === void 0 && !signal && !headers) return;
1894
- return {
1895
- ...headers ? { headers } : {},
1896
- ...signal ? { signal } : {},
1897
- ...timeout !== void 0 ? { timeout } : {},
1898
- ...options?.maxRetries !== void 0 ? { maxRetries: options.maxRetries } : {}
1899
- };
1900
- }
1901
- function getCompat(model) {
1902
- const resolved = resolveOpenAICompletionsCompat(model);
1903
- const compat = model.compat ?? {};
1904
- return {
1905
- ...resolved,
1906
- cacheControlFormat: resolved.cacheControlFormat,
1907
- reasoningEffortMap: resolveOpenAIReasoningEffortMap(model, {}),
1908
- openRouterRouting: resolved.openRouterRouting ?? {},
1909
- vercelGatewayRouting: resolved.vercelGatewayRouting,
1910
- requiresStringContent: compat.requiresStringContent ?? false,
1911
- strictMessageKeys: compat.strictMessageKeys === true
1912
- };
1913
- }
1914
- //#endregion
1915
- //#region packages/ai/src/transports/openai-completions-transport.ts
1916
- function hasToolHistory(messages) {
1917
- return messages.some((message) => message.role === "toolResult" || message.role === "assistant" && Array.isArray(message.content) && message.content.some((block) => block.type === "toolCall"));
1918
- }
1919
- function assertOpenAICompletionsPayloadHasConversationTurn(params, model) {
1920
- const messages = params.messages;
1921
- if (!Array.isArray(messages) || hasOpenAICompatibleConversationTurn(messages)) return;
1922
- throw new Error(`OpenAI-compatible chat payload for ${model.provider}/${model.id} contains no non-empty user or assistant messages after compaction and transport transforms; refusing to send a system/tool-only request. Start a new user turn or repair the compacted session history.`);
1923
- }
1924
- const SSE_DONE_LINE_RE = /^data:[ \t]*\[DONE\][ \t]*$/i;
1925
- const SSE_DONE_MAX_LINE_CHARS = 1024;
1926
- function createSseDoneDetector() {
1927
- const decoder = new TextDecoder();
1928
- let line = "";
1929
- let lineOverflowed = false;
1930
- let sawDone = false;
1931
- const finishLine = () => {
1932
- if (!lineOverflowed && SSE_DONE_LINE_RE.test(line)) sawDone = true;
1933
- line = "";
1934
- lineOverflowed = false;
1935
- };
1936
- const observeText = (text) => {
1937
- for (const char of text) {
1938
- if (char === "\n" || char === "\r") {
1939
- finishLine();
1940
- continue;
1941
- }
1942
- if (!lineOverflowed && line.length < SSE_DONE_MAX_LINE_CHARS) line += char;
1943
- else lineOverflowed = true;
1944
- }
1945
- };
1946
- return {
1947
- observe(chunk) {
1948
- if (!sawDone) observeText(decoder.decode(chunk, { stream: true }));
1949
- },
1950
- finish() {
1951
- if (sawDone) return;
1952
- observeText(decoder.decode());
1953
- if (line || lineOverflowed) finishLine();
1954
- },
1955
- sawDone: () => sawDone
1956
- };
1957
- }
1958
- function createOpenAICompletionsClient(model, context, apiKey, optionHeaders, opts) {
1959
- const clientConfig = buildOpenAICompletionsClientConfig(model, context, optionHeaders);
1960
- return new OpenAI({
1961
- apiKey,
1962
- baseURL: clientConfig.baseURL,
1963
- dangerouslyAllowBrowser: true,
1964
- defaultHeaders: clientConfig.defaultHeaders,
1965
- defaultQuery: clientConfig.defaultQuery,
1966
- fetch: opts?.fetch ?? buildGuardedModelFetch(model),
1967
- ...buildOpenAISdkClientOptions(model)
1968
- });
1969
- }
1970
- function isAzureOpenAICompatibleHost(hostname) {
1971
- return hostname.endsWith(".openai.azure.com") || hostname.endsWith(".services.ai.azure.com") || hostname.endsWith(".cognitiveservices.azure.com");
1972
- }
1973
- function isKnownOpenAICompletionsEndpoint(model) {
1974
- if (!model.baseUrl.trim()) return true;
1975
- const endpointClass = resolveProviderEndpoint(model.baseUrl).endpointClass;
1976
- if (endpointClass === "openai-public" || endpointClass === "azure-openai") return true;
1977
- try {
1978
- return isAzureOpenAICompatibleHost(new URL(model.baseUrl).hostname.toLowerCase());
1979
- } catch {
1980
- return false;
1981
- }
1982
- }
1983
- function buildOpenAICompletionsClientConfig(model, context, optionHeaders) {
1984
- const headers = buildOpenAIClientHeaders(model, context, optionHeaders);
1985
- const defaultQuery = {};
1986
- let baseURL = model.baseUrl;
1987
- let isAzureHost = false;
1988
- try {
1989
- const parsed = new URL(model.baseUrl);
1990
- isAzureHost = isAzureOpenAICompatibleHost(parsed.hostname.toLowerCase());
1991
- parsed.searchParams.forEach((value, key) => {
1992
- if (value) defaultQuery[key] = value;
1993
- });
1994
- parsed.search = "";
1995
- baseURL = parsed.toString().replace(/\/$/, "");
1996
- } catch {}
1997
- if (isAzureHost) {
1998
- const apiVersionHeader = Object.keys(headers).find((key) => key.toLowerCase() === "api-version");
1999
- if (apiVersionHeader) {
2000
- const apiVersion = headers[apiVersionHeader]?.trim();
2001
- delete headers[apiVersionHeader];
2002
- if (apiVersion && !defaultQuery["api-version"]) defaultQuery["api-version"] = apiVersion;
2003
- }
2004
- }
2005
- return {
2006
- baseURL,
2007
- defaultHeaders: headers,
2008
- defaultQuery: Object.keys(defaultQuery).length > 0 ? defaultQuery : void 0
2009
- };
2010
- }
2011
- function createOpenAICompletionsTransportStreamFn() {
2012
- return (model, context, options) => {
2013
- const eventStream = createAssistantMessageEventStream();
2014
- const stream = eventStream;
2015
- (async () => {
2016
- const output = {
2017
- role: "assistant",
2018
- content: [],
2019
- api: model.api,
2020
- provider: model.provider,
2021
- model: model.id,
2022
- usage: {
2023
- input: 0,
2024
- output: 0,
2025
- cacheRead: 0,
2026
- cacheWrite: 0,
2027
- totalTokens: 0,
2028
- cost: {
2029
- input: 0,
2030
- output: 0,
2031
- cacheRead: 0,
2032
- cacheWrite: 0,
2033
- total: 0
2034
- }
2035
- },
2036
- stopReason: "stop",
2037
- timestamp: Date.now()
2038
- };
2039
- let firstEventAbort;
2040
- try {
2041
- const apiKey = options?.apiKey || getEnvApiKey(model.provider) || "";
2042
- const doneDetector = createSseDoneDetector();
2043
- const baseFetch = buildGuardedModelFetch(model);
2044
- const doneDetectingFetch = async (url, init) => {
2045
- const response = await baseFetch(url, init);
2046
- if (!response.body || !response.ok) return response;
2047
- if (typeof TransformStream === "undefined" || !response.body.pipeThrough) return response;
2048
- const transformed = response.body.pipeThrough(new TransformStream({
2049
- transform(chunk, controller) {
2050
- doneDetector.observe(chunk);
2051
- controller.enqueue(chunk);
2052
- },
2053
- flush() {
2054
- doneDetector.finish();
2055
- }
2056
- }));
2057
- return new Response(transformed, {
2058
- headers: response.headers,
2059
- status: response.status,
2060
- statusText: response.statusText
2061
- });
2062
- };
2063
- const client = createOpenAICompletionsClient(model, context, apiKey, options?.headers, { fetch: doneDetectingFetch });
2064
- let params = buildOpenAICompletionsParams(model, context, options);
2065
- const nextParams = await options?.onPayload?.(params, model);
2066
- if (nextParams !== void 0) params = nextParams;
2067
- if (options?.openclawCodeModeToolSurface === true) {
2068
- const visibleToolNames = resolveCodeModeResponsesVisibleToolNames(context);
2069
- enforceCodeModeResponsesToolSurface(params, visibleToolNames);
2070
- assertCodeModeResponsesToolSurface(params, visibleToolNames);
2071
- }
2072
- if (getCompat(model).requiresNonEmptyUserOrAssistantMessage) assertOpenAICompletionsPayloadHasConversationTurn(params, model);
2073
- const emitReasoning = shouldEmitOpenAICompletionsReasoning(model, options);
2074
- firstEventAbort = createFirstStreamEventAbortController(options?.signal);
2075
- const responseStream = await client.chat.completions.create(params, buildOpenAISdkRequestOptions(model, firstEventAbort.signal, {
2076
- timeoutMs: options?.timeoutMs,
2077
- maxRetries: options?.maxRetries
2078
- }));
2079
- stream.push({
2080
- type: "start",
2081
- partial: output
2082
- });
2083
- await processOpenAICompletionsStream(responseStream, output, model, stream, {
2084
- signal: options?.signal,
2085
- emitReasoning,
2086
- firstEventTimeoutMs: getFirstStreamEventTimeoutMs(options),
2087
- abortFirstEventStream: firstEventAbort.abort,
2088
- onFirstEventTimeout: getFirstStreamEventTimeoutHandler(options),
2089
- sawStreamDONE: doneDetector.sawDone
2090
- });
2091
- finalizeTransportStream({
2092
- stream,
2093
- output,
2094
- signal: options?.signal
2095
- });
2096
- } catch (error) {
2097
- failTransportStream({
2098
- stream,
2099
- output,
2100
- signal: options?.signal,
2101
- error
2102
- });
2103
- } finally {
2104
- firstEventAbort?.dispose();
2105
- }
2106
- })();
2107
- return eventStream;
2108
- };
2109
- }
2110
- async function processOpenAICompletionsStream(responseStream, output, model, stream, options) {
2111
- const MAX_POST_TOOL_CALL_BUFFER_BYTES = 256e3;
2112
- const MAX_TOOL_CALL_ARGUMENT_BUFFER_BYTES = 256e3;
2113
- const emitReasoning = options?.emitReasoning ?? true;
2114
- const compat = getCompat(model);
2115
- const deepSeekTextFilter = shouldFilterDeepSeekDsmlText(compat) ? createDeepSeekTextFilter() : null;
2116
- const deepSeekToolCallRecoverer = shouldFilterDeepSeekDsmlText(compat) ? createDeepSeekDsmlToolCallRecoverer() : null;
2117
- const reasoningTagTextPartitioner = createReasoningTagTextPartitioner();
2118
- let currentBlock = null;
2119
- let pendingPostToolCallDeltas = [];
2120
- let pendingPostToolCallBytes = 0;
2121
- let isFlushingPendingPostToolCallDeltas = false;
2122
- const toolCallBlocksByIndex = /* @__PURE__ */ new Map();
2123
- const toolCallBlocksById = /* @__PURE__ */ new Map();
2124
- const provisionalCommentaryTags = /* @__PURE__ */ new Map();
2125
- const toolCallBlockBytes = /* @__PURE__ */ new WeakMap();
2126
- const toolCallBlockIndices = /* @__PURE__ */ new WeakMap();
2127
- let sawStopFinishReason = false;
2128
- let sawNativeToolCallDelta = false;
2129
- const blockIndex = () => output.content.length - 1;
2130
- const measureUtf8Bytes = (text) => Buffer.byteLength(text, "utf8");
2131
- let chunkPushedEvent = false;
2132
- const pushStreamEvent = (event) => {
2133
- chunkPushedEvent = true;
2134
- stream.push(event);
2135
- };
2136
- const queuePostToolCallDelta = (next) => {
2137
- const nextBytes = measureUtf8Bytes(next.text);
2138
- if (pendingPostToolCallBytes + nextBytes > MAX_POST_TOOL_CALL_BUFFER_BYTES) throw new Error("Exceeded post-tool-call delta buffer limit");
2139
- pendingPostToolCallBytes += nextBytes;
2140
- const previous = pendingPostToolCallDeltas[pendingPostToolCallDeltas.length - 1];
2141
- if (!previous || previous.kind !== next.kind) {
2142
- pendingPostToolCallDeltas.push(next);
2143
- return;
2144
- }
2145
- if (next.kind === "thinking" && previous.kind === "thinking") {
2146
- if (previous.signature !== next.signature) {
2147
- pendingPostToolCallDeltas.push(next);
2148
- return;
2149
- }
2150
- previous.text += next.text;
2151
- return;
2152
- }
2153
- previous.text += next.text;
2154
- };
2155
- const appendThinkingDeltaInternal = (reasoningDelta) => {
2156
- if (!currentBlock || currentBlock.type !== "thinking") {
2157
- currentBlock = {
2158
- type: "thinking",
2159
- thinking: "",
2160
- ...reasoningDelta.signature ? { thinkingSignature: reasoningDelta.signature } : {}
2161
- };
2162
- output.content.push(currentBlock);
2163
- pushStreamEvent({
2164
- type: "thinking_start",
2165
- contentIndex: blockIndex(),
2166
- partial: output
2167
- });
2168
- }
2169
- currentBlock.thinking += reasoningDelta.text;
2170
- pushStreamEvent({
2171
- type: "thinking_delta",
2172
- contentIndex: blockIndex(),
2173
- delta: reasoningDelta.text,
2174
- partial: output
2175
- });
2176
- };
2177
- const appendTextDeltaInternal = (text) => {
2178
- if (!currentBlock || currentBlock.type !== "text") {
2179
- currentBlock = {
2180
- type: "text",
2181
- text: ""
2182
- };
2183
- output.content.push(currentBlock);
2184
- pushStreamEvent({
2185
- type: "text_start",
2186
- contentIndex: blockIndex(),
2187
- partial: output
2188
- });
2189
- }
2190
- currentBlock.text += text;
2191
- pushStreamEvent({
2192
- type: "text_delta",
2193
- contentIndex: blockIndex(),
2194
- delta: text
2195
- });
2196
- };
2197
- const flushPendingPostToolCallDeltas = () => {
2198
- if (isFlushingPendingPostToolCallDeltas || currentBlock?.type === "toolCall" || pendingPostToolCallDeltas.length === 0) return;
2199
- isFlushingPendingPostToolCallDeltas = true;
2200
- const bufferedDeltas = pendingPostToolCallDeltas;
2201
- pendingPostToolCallDeltas = [];
2202
- pendingPostToolCallBytes = 0;
2203
- for (const delta of bufferedDeltas) if (delta.kind === "text") appendTextDeltaInternal(delta.text);
2204
- else if (emitReasoning) appendThinkingDeltaInternal(delta);
2205
- isFlushingPendingPostToolCallDeltas = false;
2206
- };
2207
- const appendThinkingDelta = (reasoningDelta) => {
2208
- flushPendingPostToolCallDeltas();
2209
- appendThinkingDeltaInternal(reasoningDelta);
2210
- };
2211
- const appendTextDelta = (text) => {
2212
- flushPendingPostToolCallDeltas();
2213
- appendTextDeltaInternal(text);
2214
- };
2215
- const appendVisibleTextDelta = (text) => {
2216
- if (!text) return;
2217
- if (currentBlock?.type === "toolCall") queuePostToolCallDelta({
2218
- kind: "text",
2219
- text
2220
- });
2221
- else appendTextDelta(text);
2222
- };
2223
- const appendRecoveredToolCall = (toolCall) => {
2224
- if (currentBlock?.type === "toolCall") {
2225
- currentBlock = null;
2226
- flushPendingPostToolCallDeltas();
2227
- }
2228
- rememberPendingCommentaryTags(provisionalCommentaryTags, tagPendingCommentaryText(output.content));
2229
- const block = {
2230
- type: "toolCall",
2231
- id: `call_${randomUUID().replaceAll("-", "").slice(0, 24)}`,
2232
- name: toolCall.name,
2233
- arguments: toolCall.arguments,
2234
- partialArgs: toolCall.partialArgs
2235
- };
2236
- currentBlock = block;
2237
- output.content.push(block);
2238
- toolCallBlockIndices.set(block, output.content.length - 1);
2239
- pushStreamEvent({
2240
- type: "toolcall_start",
2241
- contentIndex: toolCallBlockIndices.get(block) ?? -1,
2242
- partial: output
2243
- });
2244
- pushStreamEvent({
2245
- type: "toolcall_delta",
2246
- contentIndex: toolCallBlockIndices.get(block) ?? -1,
2247
- delta: toolCall.partialArgs,
2248
- partial: output
2249
- });
2250
- };
2251
- const appendFilteredVisibleTextDelta = (text) => {
2252
- const recoveredParts = deepSeekToolCallRecoverer?.push(text) ?? [{
2253
- kind: "text",
2254
- text
2255
- }];
2256
- for (const recoveredPart of recoveredParts) {
2257
- if (recoveredPart.kind === "toolCall") {
2258
- appendRecoveredToolCall(recoveredPart);
2259
- continue;
2260
- }
2261
- const parts = deepSeekTextFilter?.push(recoveredPart.text) ?? [recoveredPart.text];
2262
- for (const part of parts) appendVisibleTextDelta(part);
2263
- }
2264
- };
2265
- const flushDeepSeekToolCallRecovererAtEnd = () => {
2266
- const recoveredParts = deepSeekToolCallRecoverer?.flush();
2267
- if (!recoveredParts) return;
2268
- for (const recoveredPart of recoveredParts) {
2269
- if (recoveredPart.kind === "toolCall") {
2270
- appendRecoveredToolCall(recoveredPart);
2271
- continue;
2272
- }
2273
- const parts = deepSeekTextFilter?.push(recoveredPart.text) ?? [recoveredPart.text];
2274
- for (const part of parts) appendVisibleTextDelta(part);
2275
- }
2276
- };
2277
- const flushDeepSeekTextFilterAtEnd = () => {
2278
- const parts = deepSeekTextFilter?.flush();
2279
- if (!parts) return;
2280
- for (const part of parts) appendVisibleTextDelta(part);
2281
- };
2282
- const appendRoutedContentDelta = (delta) => {
2283
- if (delta.kind === "text") {
2284
- appendFilteredVisibleTextDelta(delta.text);
2285
- return;
2286
- }
2287
- if (!emitReasoning) return;
2288
- if (currentBlock?.type === "toolCall") queuePostToolCallDelta(delta);
2289
- else appendThinkingDelta(delta);
2290
- };
2291
- const appendPartitionedVisibleDelta = (delta) => {
2292
- if (delta.kind === "text") appendFilteredVisibleTextDelta(delta.text);
2293
- };
2294
- const emitReasoningUsageActivity = (hasReasoningUsageActivity) => {
2295
- if (!hasReasoningUsageActivity || chunkPushedEvent || !emitReasoning) return;
2296
- const latestBlock = output.content[output.content.length - 1];
2297
- if (currentBlock?.type === "text" || currentBlock?.type === "toolCall") return;
2298
- if (latestBlock?.type === "text" || latestBlock?.type === "toolCall") return;
2299
- appendThinkingDelta({
2300
- signature: "",
2301
- text: ""
2302
- });
2303
- };
2304
- const flushReasoningTagTextPartitionerAtEnd = () => {
2305
- for (const delta of reasoningTagTextPartitioner.flush()) appendPartitionedVisibleDelta(delta);
2306
- };
2307
- const cooperativeScheduler = createModelStreamCooperativeScheduler(options?.signal);
2308
- const guardedStream = withFirstStreamEventTimeout(responseStream, {
2309
- provider: model.provider,
2310
- api: model.api,
2311
- model: model.id,
2312
- timeoutMs: options?.firstEventTimeoutMs ?? 0,
2313
- stage: "completions",
2314
- abort: options?.abortFirstEventStream,
2315
- onTimeout: options?.onFirstEventTimeout,
2316
- hint: "The provider may be stalled while parsing the tool payload; retry with a smaller tool surface or enable OPENCLAW_DEBUG_MODEL_PAYLOAD=tools to inspect exposed tools."
2317
- });
2318
- for await (const rawChunk of guardedStream) {
2319
- throwIfModelStreamAborted(options?.signal);
2320
- chunkPushedEvent = false;
2321
- if (!rawChunk || typeof rawChunk !== "object") {
2322
- await cooperativeScheduler.afterEvent();
2323
- continue;
2324
- }
2325
- notifyLlmRequestActivity(options?.signal);
2326
- const chunk = rawChunk;
2327
- output.responseId ||= chunk.id;
2328
- let hasReasoningUsageActivity = false;
2329
- if (chunk.usage) {
2330
- output.usage = parseTransportChunkUsage(chunk.usage, model);
2331
- hasReasoningUsageActivity = hasOpenAICompletionsReasoningUsageActivity(chunk.usage);
2332
- }
2333
- const choice = Array.isArray(chunk.choices) ? chunk.choices[0] : void 0;
2334
- if (!choice) {
2335
- emitReasoningUsageActivity(hasReasoningUsageActivity);
2336
- await cooperativeScheduler.afterEvent();
2337
- continue;
2338
- }
2339
- const choiceUsage = choice.usage;
2340
- if (!chunk.usage && choiceUsage) {
2341
- output.usage = parseTransportChunkUsage(choiceUsage, model);
2342
- hasReasoningUsageActivity = hasOpenAICompletionsReasoningUsageActivity(choiceUsage);
2343
- }
2344
- if (choice.finish_reason) {
2345
- const finishReasonResult = mapOpenAIStopReason(choice.finish_reason, { allowSingularToolCall: true });
2346
- output.stopReason = finishReasonResult.stopReason;
2347
- if (finishReasonResult.stopReason === "stop") sawStopFinishReason = true;
2348
- if (finishReasonResult.errorMessage) output.errorMessage = finishReasonResult.errorMessage;
2349
- }
2350
- const choiceDelta = choice.delta ?? choice.message;
2351
- if (!choiceDelta) {
2352
- emitReasoningUsageActivity(hasReasoningUsageActivity);
2353
- await cooperativeScheduler.afterEvent();
2354
- continue;
2355
- }
2356
- const reasoningDeltas = getCompletionsReasoningDeltas(choiceDelta, compat.visibleReasoningDetailTypes);
2357
- const hasMirroredReasoning = reasoningDeltas.some((delta) => delta.kind === "thinking");
2358
- if (hasMirroredReasoning) reasoningTagTextPartitioner.markStrict();
2359
- if (choiceDelta.content) {
2360
- const contentDeltas = getCompletionsContentDeltas(choiceDelta.content);
2361
- for (const contentDelta of contentDeltas) if (contentDelta.kind === "text") {
2362
- const routedDeltas = hasMirroredReasoning ? reasoningTagTextPartitioner.push(contentDelta.text) : reasoningTagTextPartitioner.pushVisible(contentDelta.text);
2363
- for (const routedDelta of routedDeltas) appendPartitionedVisibleDelta(routedDelta);
2364
- } else {
2365
- reasoningTagTextPartitioner.markStrict();
2366
- appendRoutedContentDelta(contentDelta);
2367
- }
2368
- }
2369
- const refusalText = typeof choiceDelta.refusal === "string" ? choiceDelta.refusal : "";
2370
- if (refusalText) {
2371
- const routedDeltas = hasMirroredReasoning ? reasoningTagTextPartitioner.push(refusalText) : reasoningTagTextPartitioner.pushVisible(refusalText);
2372
- for (const routedDelta of routedDeltas) appendPartitionedVisibleDelta(routedDelta);
2373
- }
2374
- for (const reasoningDelta of reasoningDeltas) {
2375
- if (reasoningDelta.kind === "thinking" && !emitReasoning) continue;
2376
- if (currentBlock?.type === "toolCall") {
2377
- queuePostToolCallDelta({ ...reasoningDelta });
2378
- continue;
2379
- }
2380
- if (reasoningDelta.kind === "text") appendTextDelta(reasoningDelta.text);
2381
- else if (emitReasoning) appendThinkingDelta(reasoningDelta);
2382
- }
2383
- if (choiceDelta.tool_calls && choiceDelta.tool_calls.length > 0) {
2384
- sawNativeToolCallDelta = true;
2385
- flushReasoningTagTextPartitionerAtEnd();
2386
- rememberPendingCommentaryTags(provisionalCommentaryTags, tagPendingCommentaryText(output.content));
2387
- for (const toolCall of choiceDelta.tool_calls) {
2388
- const streamIndex = typeof toolCall.index === "number" ? toolCall.index : void 0;
2389
- let block = streamIndex !== void 0 ? toolCallBlocksByIndex.get(streamIndex) : void 0;
2390
- if (!block && toolCall.id) block = toolCallBlocksById.get(toolCall.id);
2391
- if (!block) {
2392
- if (currentBlock?.type === "toolCall") {
2393
- currentBlock = null;
2394
- flushPendingPostToolCallDeltas();
2395
- }
2396
- const initialSig = extractGoogleThoughtSignature(toolCall);
2397
- block = {
2398
- type: "toolCall",
2399
- id: toolCall.id || "",
2400
- name: toolCall.function?.name || "",
2401
- arguments: {},
2402
- partialArgs: "",
2403
- ...initialSig ? { thoughtSignature: initialSig } : {}
2404
- };
2405
- output.content.push(block);
2406
- toolCallBlockIndices.set(block, output.content.length - 1);
2407
- pushStreamEvent({
2408
- type: "toolcall_start",
2409
- contentIndex: toolCallBlockIndices.get(block) ?? -1,
2410
- partial: output
2411
- });
2412
- }
2413
- if (streamIndex !== void 0 && !toolCallBlocksByIndex.has(streamIndex)) toolCallBlocksByIndex.set(streamIndex, block);
2414
- if (toolCall.id) {
2415
- block.id = toolCall.id;
2416
- toolCallBlocksById.set(toolCall.id, block);
2417
- }
2418
- currentBlock = block;
2419
- if (toolCall.function?.name) block.name = toolCall.function.name;
2420
- const deltaSig = extractGoogleThoughtSignature(toolCall);
2421
- if (deltaSig) block.thoughtSignature = deltaSig;
2422
- if (toolCall.function?.arguments) {
2423
- const nextArgumentBytes = measureUtf8Bytes(toolCall.function.arguments);
2424
- const currentBlockArgBytes = toolCallBlockBytes.get(block) ?? 0;
2425
- if (currentBlockArgBytes + nextArgumentBytes > MAX_TOOL_CALL_ARGUMENT_BUFFER_BYTES) throw new Error("Exceeded tool-call argument buffer limit");
2426
- toolCallBlockBytes.set(block, currentBlockArgBytes + nextArgumentBytes);
2427
- block.partialArgs += toolCall.function.arguments;
2428
- block.arguments = parseStreamingJson(block.partialArgs);
2429
- pushStreamEvent({
2430
- type: "toolcall_delta",
2431
- contentIndex: toolCallBlockIndices.get(block) ?? -1,
2432
- delta: toolCall.function.arguments,
2433
- partial: output
2434
- });
2435
- }
2436
- }
2437
- }
2438
- flushPendingPostToolCallDeltas();
2439
- emitReasoningUsageActivity(hasReasoningUsageActivity);
2440
- await cooperativeScheduler.afterEvent();
2441
- }
2442
- flushReasoningTagTextPartitionerAtEnd();
2443
- flushDeepSeekToolCallRecovererAtEnd();
2444
- flushDeepSeekTextFilterAtEnd();
2445
- currentBlock = null;
2446
- flushPendingPostToolCallDeltas();
2447
- const hasToolCalls = output.content.some((block) => block.type === "toolCall");
2448
- const hasVisibleText = output.content.some((block) => block.type === "text" && typeof block.text === "string" && block.text.trim().length > 0);
2449
- if (output.stopReason === "toolUse" && !hasToolCalls) output.stopReason = "stop";
2450
- if (output.stopReason === "stop" && hasToolCalls && !hasVisibleText && (sawStopFinishReason || sawNativeToolCallDelta && (options?.sawStreamDONE?.() ?? false))) output.stopReason = "toolUse";
2451
- if (hasToolCalls && output.stopReason !== "toolUse") output.content = output.content.filter((block) => block.type !== "toolCall");
2452
- if (output.stopReason !== "toolUse") clearPendingCommentaryText(provisionalCommentaryTags);
2453
- if (output.stopReason === "toolUse") tagPendingCommentaryText(output.content);
2454
- }
2455
- function shouldFilterDeepSeekDsmlText(compat) {
2456
- return compat.thinkingFormat === "deepseek";
2457
- }
2458
- const DEEPSEEK_DSML_BARS = ["|", "|"];
2459
- const DEEPSEEK_DSML_TOOL_KINDS = [
2460
- "tool_calls",
2461
- "tool_call",
2462
- "function_calls"
2463
- ];
2464
- const DEEPSEEK_DSML_TOOL_OPEN_TOKENS = DEEPSEEK_DSML_BARS.flatMap((bar) => DEEPSEEK_DSML_TOOL_KINDS.map((kind) => `<${bar}DSML${bar}${kind}>`));
2465
- const DEEPSEEK_DSML_TOOL_CLOSE_TOKENS = DEEPSEEK_DSML_BARS.flatMap((bar) => DEEPSEEK_DSML_TOOL_KINDS.map((kind) => `</${bar}DSML${bar}${kind}>`));
2466
- const DEEPSEEK_DSML_TOOL_MAX_OPEN_TOKEN_LEN = Math.max(...DEEPSEEK_DSML_TOOL_OPEN_TOKENS.map((token) => token.length));
2467
- function createDeepSeekDsmlToolCallRecoverer() {
2468
- let buffer = "";
2469
- const consume = (final) => {
2470
- const output = [];
2471
- while (buffer) {
2472
- const open = findEarliestStringToken(buffer, DEEPSEEK_DSML_TOOL_OPEN_TOKENS);
2473
- if (!open) {
2474
- if (final) {
2475
- output.push({
2476
- kind: "text",
2477
- text: buffer
2478
- });
2479
- buffer = "";
2480
- return output;
2481
- }
2482
- const keep = longestDeepSeekDsmlToolOpenPrefixSuffixLength(buffer);
2483
- const emitLength = buffer.length - keep;
2484
- if (emitLength > 0) {
2485
- output.push({
2486
- kind: "text",
2487
- text: buffer.slice(0, emitLength)
2488
- });
2489
- buffer = buffer.slice(emitLength);
2490
- }
2491
- return output;
2492
- }
2493
- if (open.index > 0) {
2494
- output.push({
2495
- kind: "text",
2496
- text: buffer.slice(0, open.index)
2497
- });
2498
- buffer = buffer.slice(open.index);
2499
- }
2500
- const afterOpen = buffer.slice(open.token.length);
2501
- const close = findEarliestStringToken(afterOpen, DEEPSEEK_DSML_TOOL_CLOSE_TOKENS);
2502
- if (!close) {
2503
- if (final) {
2504
- output.push({
2505
- kind: "text",
2506
- text: buffer
2507
- });
2508
- buffer = "";
2509
- }
2510
- return output;
2511
- }
2512
- const body = afterOpen.slice(0, close.index);
2513
- const blockLength = open.token.length + close.index + close.token.length;
2514
- const recoveredToolCalls = parseDeepSeekDsmlToolCallBlock(body);
2515
- if (recoveredToolCalls.length > 0) output.push(...recoveredToolCalls);
2516
- else output.push({
2517
- kind: "text",
2518
- text: buffer.slice(0, blockLength)
2519
- });
2520
- buffer = buffer.slice(blockLength);
2521
- }
2522
- return output;
2523
- };
2524
- return {
2525
- push(chunk) {
2526
- buffer += chunk;
2527
- return consume(false);
2528
- },
2529
- flush() {
2530
- return consume(true);
2531
- }
2532
- };
2533
- }
2534
- function parseDeepSeekDsmlToolCallBlock(body) {
2535
- const toolCalls = [];
2536
- const invokeOpenRegex = /<[||]DSML[||]invoke\b([^>]*)>/g;
2537
- let openMatch;
2538
- while ((openMatch = invokeOpenRegex.exec(body)) !== null) {
2539
- const invokeName = parseXmlAttribute(openMatch[1] ?? "", "name");
2540
- if (!invokeName) continue;
2541
- const invokeBodyStart = openMatch.index + openMatch[0].length;
2542
- const invokeClose = findEarliestStringToken(body.slice(invokeBodyStart), ["</|DSML|invoke>", "</|DSML|invoke>"]);
2543
- if (!invokeClose) continue;
2544
- const invokeBody = body.slice(invokeBodyStart, invokeBodyStart + invokeClose.index);
2545
- invokeOpenRegex.lastIndex = invokeBodyStart + invokeClose.index + invokeClose.token.length;
2546
- const parsedArguments = parseDeepSeekDsmlInvokeArguments(invokeBody);
2547
- if (!parsedArguments) continue;
2548
- toolCalls.push({
2549
- kind: "toolCall",
2550
- name: invokeName,
2551
- arguments: parsedArguments,
2552
- partialArgs: JSON.stringify(parsedArguments)
2553
- });
2554
- }
2555
- return toolCalls;
2556
- }
2557
- function parseDeepSeekDsmlInvokeArguments(body) {
2558
- const args = {};
2559
- const parameterRegex = /<[||]DSML[||]parameter\b([^>]*)>([\s\S]*?)<\/[||]DSML[||]parameter>/g;
2560
- let parameterMatch;
2561
- while ((parameterMatch = parameterRegex.exec(body)) !== null) {
2562
- const name = parseXmlAttribute(parameterMatch[1] ?? "", "name");
2563
- if (!name) continue;
2564
- const rawValue = parameterMatch[2] ?? "";
2565
- if (rawValue.length === 0) continue;
2566
- args[name] = decodeDeepSeekDsmlText(rawValue);
2567
- }
2568
- if (Object.keys(args).length > 0) return args;
2569
- const trimmed = body.trim();
2570
- if (!trimmed.startsWith("{")) return null;
2571
- try {
2572
- const parsed = JSON.parse(trimmed);
2573
- if (isRecord(parsed) && Object.keys(parsed).length > 0) return parsed;
2574
- } catch {
2575
- return null;
2576
- }
2577
- return null;
2578
- }
2579
- const xmlAttributeRegexCache = /* @__PURE__ */ new Map();
2580
- function xmlAttributeRegex(name) {
2581
- const cached = xmlAttributeRegexCache.get(name);
2582
- if (cached) return cached;
2583
- const escaped = name.replace(/[.*+?^${}()|[\]\\]/g, "\\$&");
2584
- const pattern = new RegExp(`\\b${escaped}=("([^"]*)"|'([^']*)'|([^\\s>]+))`);
2585
- xmlAttributeRegexCache.set(name, pattern);
2586
- return pattern;
2587
- }
2588
- function parseXmlAttribute(attributes, name) {
2589
- const match = xmlAttributeRegex(name).exec(attributes);
2590
- const value = match?.[2] ?? match?.[3] ?? match?.[4];
2591
- return value ? decodeDeepSeekDsmlText(value) : null;
2592
- }
2593
- function decodeDeepSeekDsmlText(value) {
2594
- return value.replaceAll("&quot;", "\"").replaceAll("&apos;", "'").replaceAll("&lt;", "<").replaceAll("&gt;", ">").replaceAll("&amp;", "&");
2595
- }
2596
- function findEarliestStringToken(text, tokens) {
2597
- let best = null;
2598
- for (const token of tokens) {
2599
- const index = text.indexOf(token);
2600
- if (index !== -1 && (!best || index < best.index)) best = {
2601
- index,
2602
- token
2603
- };
2604
- }
2605
- return best;
2606
- }
2607
- function longestDeepSeekDsmlToolOpenPrefixSuffixLength(text) {
2608
- const maxLength = Math.min(text.length, DEEPSEEK_DSML_TOOL_MAX_OPEN_TOKEN_LEN - 1);
2609
- for (let length = maxLength; length > 0; length -= 1) {
2610
- const suffix = text.slice(text.length - length);
2611
- if (DEEPSEEK_DSML_TOOL_OPEN_TOKENS.some((token) => token.startsWith(suffix))) return length;
2612
- }
2613
- return 0;
2614
- }
2615
- function getCompletionsContentDeltas(content) {
2616
- if (typeof content === "string") return content ? [{
2617
- kind: "text",
2618
- text: content
2619
- }] : [];
2620
- if (Array.isArray(content)) return content.flatMap((item) => getCompletionsContentDeltas(item));
2621
- if (!content || typeof content !== "object") return [];
2622
- const record = content;
2623
- const type = typeof record.type === "string" ? record.type.toLowerCase() : "";
2624
- const extractText = (value) => {
2625
- if (typeof value === "string") return value;
2626
- if (Array.isArray(value)) return value.map((item) => extractText(item)).join("");
2627
- if (value && typeof value === "object") {
2628
- const nested = value;
2629
- return extractText(nested.text ?? nested.content ?? nested.thinking);
2630
- }
2631
- return "";
2632
- };
2633
- const text = extractText(record.text ?? record.content ?? record.thinking);
2634
- if (!text) return [];
2635
- if (type.includes("thinking") || type.includes("reasoning")) return [{
2636
- kind: "thinking",
2637
- signature: "content",
2638
- text
2639
- }];
2640
- if (type === "text" || type === "output_text" || type.endsWith(".output_text")) return [{
2641
- kind: "text",
2642
- text
2643
- }];
2644
- return [];
2645
- }
2646
- function getCompletionsReasoningDeltas(delta, visibleReasoningDetailTypes) {
2647
- const output = [];
2648
- const pushDelta = (next) => {
2649
- const previous = output[output.length - 1];
2650
- if (!previous || previous.kind !== next.kind) {
2651
- output.push(next);
2652
- return;
2653
- }
2654
- if (next.kind === "thinking" && previous.kind === "thinking") {
2655
- if (previous.signature !== next.signature) {
2656
- output.push(next);
2657
- return;
2658
- }
2659
- previous.text += next.text;
2660
- return;
2661
- }
2662
- previous.text += next.text;
2663
- };
2664
- const reasoningDetails = delta.reasoning_details;
2665
- let usedReasoningThinkingDetails = false;
2666
- if (Array.isArray(reasoningDetails)) {
2667
- const visibleTypes = new Set(visibleReasoningDetailTypes);
2668
- for (const item of reasoningDetails) {
2669
- const detail = item;
2670
- if (typeof detail.text !== "string" || !detail.text) continue;
2671
- if (detail.type === "reasoning.text") {
2672
- usedReasoningThinkingDetails = true;
2673
- pushDelta({
2674
- kind: "thinking",
2675
- signature: "reasoning_details",
2676
- text: detail.text
2677
- });
2678
- continue;
2679
- }
2680
- if (typeof detail.type === "string" && visibleTypes.has(detail.type)) pushDelta({
2681
- kind: "text",
2682
- text: detail.text
2683
- });
2684
- }
2685
- }
2686
- if (!usedReasoningThinkingDetails) for (const field of [
2687
- "reasoning_content",
2688
- "reasoning",
2689
- "reasoning_text"
2690
- ]) {
2691
- const value = delta[field];
2692
- if (typeof value === "string" && value.length > 0) {
2693
- pushDelta({
2694
- kind: "thinking",
2695
- signature: field,
2696
- text: value
2697
- });
2698
- break;
2699
- }
2700
- }
2701
- return output;
2702
- }
2703
- function resolveOpenAICompletionsReasoningEffort(options) {
2704
- return options?.reasoningEffort ?? options?.reasoning ?? "high";
2705
- }
2706
- function shouldEmitOpenAICompletionsReasoning(model, options) {
2707
- if (!model.reasoning) return false;
2708
- const effort = resolveOpenAICompletionsReasoningEffort(options);
2709
- if (!effort || !isOpenAICompletionsThinkingEnabled(effort)) return false;
2710
- return true;
2711
- }
2712
- function shouldEmitOpenAICompletionsReasoningForModel(model, options) {
2713
- return shouldEmitOpenAICompletionsReasoning(model, options);
2714
- }
2715
- function resolveOpenAICompletionsMaxTokens(model, options) {
2716
- if (options?.maxTokens) return {
2717
- maxTokens: options.maxTokens,
2718
- clampToModelMaxTokens: true
2719
- };
2720
- const paramsMaxTokens = resolveMaxTokensParam(model.params);
2721
- if (paramsMaxTokens) return {
2722
- maxTokens: paramsMaxTokens,
2723
- clampToModelMaxTokens: false
2724
- };
2725
- return {
2726
- maxTokens: model.maxTokens,
2727
- clampToModelMaxTokens: false
2728
- };
2729
- }
2730
- function resolveOpenAICompletionsModelMaxTokens(model) {
2731
- return typeof model.maxTokens === "number" && Number.isFinite(model.maxTokens) && model.maxTokens > 0 ? Math.floor(model.maxTokens) : void 0;
2732
- }
2733
- const OPENAI_COMPLETIONS_INPUT_TOKEN_SAFETY_MARGIN = 1.25;
2734
- const OPENAI_COMPLETIONS_IMAGE_CHAR_ESTIMATE = 8e3;
2735
- function estimateOpenAICompletionsInputTokens(payload) {
2736
- let adjustedChars = 0;
2737
- adjustedChars += estimateOpenAICompletionsMessagesChars(payload.messages);
2738
- if (Array.isArray(payload.tools) && payload.tools.length > 0) try {
2739
- adjustedChars += estimateStringChars(JSON.stringify(payload.tools));
2740
- } catch {
2741
- adjustedChars += 1024;
2742
- }
2743
- if (payload.response_format !== void 0) try {
2744
- adjustedChars += estimateStringChars(JSON.stringify(payload.response_format));
2745
- } catch {
2746
- adjustedChars += 256;
2747
- }
2748
- return Math.ceil(adjustedChars / 4 * OPENAI_COMPLETIONS_INPUT_TOKEN_SAFETY_MARGIN);
2749
- }
2750
- function estimateOpenAICompletionsMessagesChars(messages) {
2751
- if (!Array.isArray(messages)) return 0;
2752
- let adjustedChars = 0;
2753
- for (const message of messages) {
2754
- if (!message || typeof message !== "object") continue;
2755
- const record = message;
2756
- adjustedChars += estimateOpenAICompletionsContentChars(record.content);
2757
- for (const field of COMPLETIONS_REASONING_REPLAY_FIELDS) adjustedChars += estimateOpenAICompletionsContentChars(record[field]);
2758
- if (record.tool_calls !== void 0) try {
2759
- adjustedChars += estimateStringChars(JSON.stringify(record.tool_calls));
2760
- } catch {
2761
- adjustedChars += 256;
2762
- }
2763
- }
2764
- return adjustedChars;
2765
- }
2766
- function estimateOpenAICompletionsContentChars(value) {
2767
- if (typeof value === "string") return estimateStringChars(value);
2768
- if (!Array.isArray(value)) return 0;
2769
- let adjustedChars = 0;
2770
- for (const block of value) {
2771
- if (!block || typeof block !== "object") continue;
2772
- const record = block;
2773
- if (record.type === "image_url" || record.type === "input_image") {
2774
- adjustedChars += OPENAI_COMPLETIONS_IMAGE_CHAR_ESTIMATE;
2775
- continue;
2776
- }
2777
- const text = record.text;
2778
- if (typeof text === "string") {
2779
- adjustedChars += estimateStringChars(text);
2780
- continue;
2781
- }
2782
- try {
2783
- adjustedChars += estimateStringChars(JSON.stringify(block));
2784
- } catch {
2785
- adjustedChars += 256;
2786
- }
2787
- }
2788
- return adjustedChars;
2789
- }
2790
- function resolveOpenAICompletionsEffectiveContextTokens(model) {
2791
- const contextTokens = model.contextTokens;
2792
- if (typeof contextTokens === "number" && Number.isFinite(contextTokens) && contextTokens > 0) return contextTokens;
2793
- return typeof model.contextWindow === "number" && Number.isFinite(model.contextWindow) && model.contextWindow > 0 ? model.contextWindow : void 0;
2794
- }
2795
- function isQwenOpenAICompletionsThinkingFormat(format) {
2796
- return format === "qwen" || format === "qwen-chat-template";
2797
- }
2798
- function isOpenAICompletionsThinkingEnabled(effort) {
2799
- const normalized = effort.trim().toLowerCase();
2800
- return normalized !== "off" && normalized !== "none";
2801
- }
2802
- function setQwenChatTemplateThinking(params, enabled) {
2803
- const existing = params.chat_template_kwargs;
2804
- params.chat_template_kwargs = existing && typeof existing === "object" && !Array.isArray(existing) ? {
2805
- ...existing,
2806
- enable_thinking: enabled
2807
- } : { enable_thinking: enabled };
2808
- }
2809
- function applyQwenOpenAICompletionsThinkingParams(params) {
2810
- if (!params.modelReasoning || !isQwenOpenAICompletionsThinkingFormat(params.compatThinkingFormat)) return false;
2811
- const enabled = isOpenAICompletionsThinkingEnabled(params.requestedEffort);
2812
- if (params.compatThinkingFormat === "qwen-chat-template") setQwenChatTemplateThinking(params.payload, enabled);
2813
- else params.payload.enable_thinking = enabled;
2814
- return true;
2815
- }
2816
- function applyTogetherOpenAICompletionsThinkingParams(params) {
2817
- if (!params.modelReasoning || params.compatThinkingFormat !== "together") return false;
2818
- params.payload.reasoning = { enabled: isOpenAICompletionsThinkingEnabled(params.requestedEffort) };
2819
- return true;
2820
- }
2821
- function convertTools(tools, compat, model) {
2822
- const projection = projectOpenAITools(tools);
2823
- const strict = resolveOpenAIStrictToolFlagWithDiagnostics(projection, resolveOpenAIStrictToolSetting(model, {
2824
- transport: "stream",
2825
- supportsStrictMode: compat?.supportsStrictMode
2826
- }), {
2827
- transport: "completions",
2828
- model
2829
- });
2830
- return {
2831
- projection,
2832
- tools: sortPromptCacheToolsByName(projection.tools).map((tool) => {
2833
- const functionTool = {
2834
- name: tool.name,
2835
- description: tool.description,
2836
- parameters: normalizeOpenAIStrictToolParameters(tool.parameters, strict === true, model.compat)
2837
- };
2838
- if (strict !== void 0) functionTool.strict = strict;
2839
- return {
2840
- type: "function",
2841
- function: functionTool
2842
- };
2843
- })
2844
- };
2845
- }
2846
- function extractGoogleThoughtSignature(toolCall) {
2847
- const tc = toolCall;
2848
- if (!tc) return;
2849
- const fromExtra = (tc.extra_content?.google)?.thought_signature;
2850
- if (typeof fromExtra === "string" && fromExtra.length > 0) return fromExtra;
2851
- const fromFunction = tc.function?.thought_signature;
2852
- return typeof fromFunction === "string" && fromFunction.length > 0 ? fromFunction : void 0;
2853
- }
2854
- function isGoogleOpenAICompatModel(model) {
2855
- const endpointClass = detectOpenAICompletionsCompat(model).capabilities.endpointClass;
2856
- return model.provider === "google" || endpointClass === "google-generative-ai" || endpointClass === "google-vertex";
2857
- }
2858
- function requiresGoogleCompatToolCallThoughtSignature(model) {
2859
- return isGoogleGemini3ProModel(model.id) || isGoogleGemini3FlashModel(model.id);
2860
- }
2861
- const GOOGLE_COMPAT_THOUGHT_SIGNATURE_ELLIPSIS_RE = /[\u2026]|\.\.\./;
2862
- const GOOGLE_COMPAT_THOUGHT_SIGNATURE_BASE64_RE = /^[A-Za-z0-9+/=]+$/;
2863
- function hasGoogleCompatThoughtSignatureTruncationFootprint(value) {
2864
- return GOOGLE_COMPAT_THOUGHT_SIGNATURE_ELLIPSIS_RE.test(value) || GOOGLE_COMPAT_THOUGHT_SIGNATURE_BASE64_RE.test(value) && value.length % 4 !== 0;
2865
- }
2866
- function injectToolCallThoughtSignatures(outgoingMessages, context, model) {
2867
- if (!isGoogleOpenAICompatModel(model)) return;
2868
- const sigById = /* @__PURE__ */ new Map();
2869
- const fallbackSig = requiresGoogleCompatToolCallThoughtSignature(model) ? GEMINI_THOUGHT_SIGNATURE_VALIDATOR_SKIP : void 0;
2870
- for (const msg of context.messages ?? []) {
2871
- if (msg.role !== "assistant") continue;
2872
- const source = msg;
2873
- if (!Array.isArray(source.content)) continue;
2874
- for (const block of source.content) {
2875
- if (block.type !== "toolCall") continue;
2876
- const id = block.id;
2877
- const sig = block.thoughtSignature;
2878
- if (typeof id === "string" && typeof sig === "string" && sig.length > 0) {
2879
- const isSameRoute = source.api === model.api && source.provider === model.provider && source.model === model.id;
2880
- if (!isSameRoute && !fallbackSig) continue;
2881
- sigById.set(id, isSameRoute ? sig : fallbackSig ?? sig);
2882
- }
2883
- }
2884
- }
2885
- if (sigById.size === 0 && !fallbackSig) return;
2886
- for (const message of outgoingMessages) {
2887
- const toolCalls = message.tool_calls;
2888
- if (!Array.isArray(toolCalls)) continue;
2889
- for (const toolCall of toolCalls) {
2890
- const id = toolCall.id;
2891
- if (typeof id !== "string") continue;
2892
- let sig = sigById.get(id) ?? fallbackSig;
2893
- if (typeof sig === "string" && sig.length > 0) {
2894
- if (hasGoogleCompatThoughtSignatureTruncationFootprint(sig.trim())) sig = fallbackSig;
2895
- }
2896
- if (typeof sig !== "string" || sig.length === 0) continue;
2897
- const extra = toolCall.extra_content && typeof toolCall.extra_content === "object" ? toolCall.extra_content : {};
2898
- toolCall.extra_content = extra;
2899
- const google = extra.google && typeof extra.google === "object" ? extra.google : {};
2900
- extra.google = google;
2901
- google.thought_signature = sig;
2902
- }
2903
- }
2904
- }
2905
- const COMPLETIONS_REASONING_REPLAY_FIELDS = [
2906
- "reasoning_details",
2907
- "reasoning_content",
2908
- "reasoning",
2909
- "reasoning_text"
2910
- ];
2911
- function stripCompletionsReasoningReplayFields(record) {
2912
- for (const field of COMPLETIONS_REASONING_REPLAY_FIELDS) if (field in record) delete record[field];
2913
- }
2914
- function sanitizeOpenRouterReasoningReplayFields(record) {
2915
- const reasoningDetails = record.reasoning_details;
2916
- if (typeof reasoningDetails === "string") {
2917
- if (reasoningDetails.length > 0 && typeof record.reasoning !== "string") record.reasoning = reasoningDetails;
2918
- delete record.reasoning_details;
2919
- } else if (reasoningDetails !== void 0 && !Array.isArray(reasoningDetails)) delete record.reasoning_details;
2920
- if ("reasoning" in record && (typeof record.reasoning !== "string" || record.reasoning === "")) delete record.reasoning;
2921
- if ("reasoning_content" in record && (typeof record.reasoning_content !== "string" || record.reasoning_content === "")) delete record.reasoning_content;
2922
- const reasoningText = record.reasoning_text;
2923
- if (typeof reasoningText === "string" && reasoningText.length > 0 && typeof record.reasoning !== "string" && typeof record.reasoning_content !== "string") record.reasoning = reasoningText;
2924
- if ("reasoning_text" in record) delete record.reasoning_text;
2925
- }
2926
- function sanitizeReasoningContentReplayFields(record) {
2927
- if ("reasoning_content" in record && typeof record.reasoning_content !== "string") delete record.reasoning_content;
2928
- delete record.reasoning_details;
2929
- delete record.reasoning;
2930
- delete record.reasoning_text;
2931
- }
2932
- const REASONING_CONTENT_REPLAY_MODEL_IDS = /* @__PURE__ */ new Set([
2933
- "deepseek-v4-flash",
2934
- "deepseek-v4-pro",
2935
- "kimi-for-coding",
2936
- "kimi-k2.5",
2937
- "kimi-k2.6",
2938
- "kimi-k2.7-code",
2939
- "kimi-k2.7-code-highspeed",
2940
- "kimi-k3",
2941
- "kimi-k2-thinking",
2942
- "kimi-k2-thinking-turbo",
2943
- "mimo-v2-pro",
2944
- "mimo-v2-omni",
2945
- "mimo-v2.5",
2946
- "mimo-v2.5-pro",
2947
- "mimo-v2.6-pro"
2948
- ]);
2949
- const REASONING_CONTENT_REPLAY_TIER_SUFFIXES = [
2950
- "-free",
2951
- "-paid",
2952
- "-trial"
2953
- ];
2954
- function stripReasoningContentReplayTierSuffix(modelId) {
2955
- for (const suffix of REASONING_CONTENT_REPLAY_TIER_SUFFIXES) if (modelId.length > suffix.length && modelId.endsWith(suffix)) return modelId.slice(0, -suffix.length);
2956
- return modelId;
2957
- }
2958
- function getReasoningContentReplayModelIdCandidates(modelId) {
2959
- if (typeof modelId !== "string") return [];
2960
- const normalized = modelId.trim().toLowerCase();
2961
- if (!normalized) return [];
2962
- const parts = normalized.split("/").filter(Boolean);
2963
- const finalPart = parts[parts.length - 1] ?? normalized;
2964
- const candidates = [finalPart];
2965
- const colonParts = finalPart.split(":").filter(Boolean);
2966
- if (colonParts.length > 1) candidates.push(colonParts[0] ?? "", colonParts[colonParts.length - 1] ?? "");
2967
- const baseCount = candidates.length;
2968
- for (let index = 0; index < baseCount; index += 1) {
2969
- const candidate = candidates[index];
2970
- if (typeof candidate !== "string") continue;
2971
- const stripped = stripReasoningContentReplayTierSuffix(candidate);
2972
- if (stripped !== candidate) candidates.push(stripped);
2973
- }
2974
- return uniqueStrings(candidates.filter(Boolean));
2975
- }
2976
- function shouldPreserveReasoningContentReplay(model, compat) {
2977
- if (compat.requiresReasoningContentOnAssistantMessages || compat.thinkingFormat === "deepseek" || compat.thinkingFormat === "zai" || shouldTrustReasoningContentReplayMetadata(model)) return true;
2978
- return getReasoningContentReplayModelIdCandidates(model.id).some((modelId) => REASONING_CONTENT_REPLAY_MODEL_IDS.has(modelId));
2979
- }
2980
- function shouldPreserveOpenRouterReasoningReplay(model) {
2981
- if (model.provider !== "openrouter") return true;
2982
- const normalizedModelId = model.id.trim().toLowerCase();
2983
- return !(normalizedModelId.startsWith("anthropic/") || normalizedModelId.startsWith("x-ai/"));
2984
- }
2985
- function shouldTrustReasoningContentReplayMetadata(model) {
2986
- if (!model.reasoning) return false;
2987
- if (model.provider.trim().toLowerCase() === "openai") return false;
2988
- return shouldPreserveOpenRouterReasoningReplay(model);
2989
- }
2990
- function sanitizeCompletionsReasoningReplayFields(messages, options) {
2991
- if (!Array.isArray(messages)) return;
2992
- for (const msg of messages) {
2993
- if (!msg || typeof msg !== "object") continue;
2994
- const record = msg;
2995
- if (record.role !== "assistant") continue;
2996
- if (options.preserveOpenRouterReasoning) sanitizeOpenRouterReasoningReplayFields(record);
2997
- else if (options.preserveReasoningContent) sanitizeReasoningContentReplayFields(record);
2998
- else stripCompletionsReasoningReplayFields(record);
2999
- }
3000
- }
3001
- function buildOpenAICompletionsParams(model, context, options) {
3002
- const compat = getCompat(model);
3003
- const compatDetection = detectOpenAICompletionsCompat(model);
3004
- let messages = convertMessages(model, context.systemPrompt ? {
3005
- ...context,
3006
- systemPrompt: stripSystemPromptCacheBoundary(context.systemPrompt)
3007
- } : context, compat);
3008
- injectToolCallThoughtSignatures(messages, context, model);
3009
- sanitizeCompletionsReasoningReplayFields(messages, {
3010
- preserveOpenRouterReasoning: compat.thinkingFormat === "openrouter" && shouldPreserveOpenRouterReasoningReplay(model),
3011
- preserveReasoningContent: shouldPreserveReasoningContentReplay(model, compat)
3012
- });
3013
- if (compat.strictMessageKeys) messages = stripCompletionMessagesToRoleContent(messages);
3014
- const cacheRetention = resolveCacheRetention(options?.cacheRetention);
3015
- const promptCacheKey = resolvePromptCacheKey(options, cacheRetention);
3016
- const params = {
3017
- model: model.id,
3018
- messages: compat.requiresStringContent ? flattenCompletionMessagesToStringContent(messages) : messages,
3019
- stream: true
3020
- };
3021
- if (compat.supportsUsageInStreaming) params.stream_options = { include_usage: true };
3022
- if (compat.supportsStore) params.store = false;
3023
- if (compat.supportsPromptCacheKey && promptCacheKey) {
3024
- params.prompt_cache_key = promptCacheKey;
3025
- if (cacheRetention === "long" && compat.supportsLongCacheRetention) params.prompt_cache_retention = "24h";
3026
- }
3027
- if (options?.temperature !== void 0) params.temperature = options.temperature;
3028
- if (options?.topP !== void 0) params.top_p = options.topP;
3029
- const responseFormat = resolveOpenAICompletionsResponseFormat(shouldOmitOllamaCompatResponseFormat({
3030
- provider: model.provider,
3031
- baseUrl: model.baseUrl,
3032
- hasTools: () => Boolean(context.tools?.length)
3033
- }) ? void 0 : options?.responseFormat, compat.supportsJsonSchemaResponseFormat);
3034
- if (responseFormat !== void 0) params.response_format = responseFormat;
3035
- if (options?.frequencyPenalty !== void 0) params.frequency_penalty = options.frequencyPenalty;
3036
- if (options?.presencePenalty !== void 0) params.presence_penalty = options.presencePenalty;
3037
- if (options?.seed !== void 0) params.seed = options.seed;
3038
- if (options?.stop !== void 0 && options.stop.length > 0) params.stop = options.stop;
3039
- if (supportsModelTools(model)) {
3040
- if (context.tools) {
3041
- const converted = convertTools(context.tools, compat, model);
3042
- if (converted.tools.length > 0 || converted.projection.inputToolCount === 0 && converted.projection.diagnostics.length === 0) params.tools = converted.tools;
3043
- else if (hasToolHistory(context.messages)) params.tools = [];
3044
- if (options?.toolChoice) {
3045
- const toolChoice = reconcileOpenAICompletionsToolChoice(options.toolChoice, converted.projection);
3046
- if (toolChoice !== void 0) params.tool_choice = toolChoice;
3047
- } else if (compatDetection.capabilities.usesExplicitProxyLikeEndpoint && Array.isArray(params.tools) && params.tools.length > 0) params.tool_choice = "auto";
3048
- } else if (hasToolHistory(context.messages)) params.tools = [];
3049
- if (compatDetection.capabilities.usesExplicitProxyLikeEndpoint && Array.isArray(params.tools) && params.tools.length === 0) {
3050
- delete params.tools;
3051
- delete params.tool_choice;
3052
- }
3053
- }
3054
- {
3055
- const maxTokenBudget = resolveOpenAICompletionsMaxTokens(model, options);
3056
- const effectiveMaxTokens = maxTokenBudget.maxTokens;
3057
- const effectiveContextTokens = resolveOpenAICompletionsEffectiveContextTokens(model);
3058
- let clampedMaxTokens = effectiveMaxTokens;
3059
- const modelMaxTokens = resolveOpenAICompletionsModelMaxTokens(model);
3060
- if (maxTokenBudget.clampToModelMaxTokens && clampedMaxTokens !== void 0 && modelMaxTokens !== void 0 && clampedMaxTokens > modelMaxTokens) {
3061
- clampedMaxTokens = modelMaxTokens;
3062
- emitModelTransportDebug(log, `[completions] clamp_max_tokens provider=${model.provider} api=${model.api} model=${model.id} requested=${effectiveMaxTokens} output=${clampedMaxTokens} modelMaxTokens=${modelMaxTokens}`);
3063
- }
3064
- if (compatDetection.capabilities.usesExplicitProxyLikeEndpoint && clampedMaxTokens !== void 0 && effectiveContextTokens !== void 0) {
3065
- const estimatedInputTokens = estimateOpenAICompletionsInputTokens(params);
3066
- const remainingBudget = Math.max(1, effectiveContextTokens - estimatedInputTokens - 1);
3067
- if (clampedMaxTokens > remainingBudget) {
3068
- clampedMaxTokens = remainingBudget;
3069
- emitModelTransportDebug(log, `[completions] clamp_max_tokens provider=${model.provider} api=${model.api} model=${model.id} requested=${effectiveMaxTokens} output=${clampedMaxTokens} effectiveContext=${effectiveContextTokens} estimatedInput=${estimatedInputTokens}`);
3070
- }
3071
- }
3072
- if (clampedMaxTokens) if (compat.maxTokensField === "max_tokens") params.max_tokens = clampedMaxTokens;
3073
- else params.max_completion_tokens = clampedMaxTokens;
3074
- }
3075
- const completionsReasoningEffort = resolveOpenAICompletionsReasoningEffort(options);
3076
- const resolvedCompletionsReasoningEffort = completionsReasoningEffort ? resolveOpenAIReasoningEffortForModel({
3077
- model,
3078
- effort: completionsReasoningEffort,
3079
- fallbackMap: compat.reasoningEffortMap
3080
- }) : void 0;
3081
- const omitChatCompletionsToolReasoningEffort = Array.isArray(params.tools) && params.tools.length > 0 && (isOpenAIGpt54MiniModel(model) || isOpenAIGpt55Model(model) && isKnownOpenAICompletionsEndpoint(model));
3082
- const disableChatCompletionsToolReasoning = Array.isArray(params.tools) && params.tools.length > 0 && isOpenAIGpt56Model(model) && isKnownOpenAICompletionsEndpoint(model);
3083
- const handledQwenThinkingFormat = applyQwenOpenAICompletionsThinkingParams({
3084
- compatThinkingFormat: compat.thinkingFormat,
3085
- modelReasoning: model.reasoning,
3086
- payload: params,
3087
- requestedEffort: completionsReasoningEffort
3088
- });
3089
- applyTogetherOpenAICompletionsThinkingParams({
3090
- compatThinkingFormat: compat.thinkingFormat,
3091
- modelReasoning: model.reasoning,
3092
- payload: params,
3093
- requestedEffort: completionsReasoningEffort
3094
- });
3095
- if (disableChatCompletionsToolReasoning) params.reasoning_effort = "none";
3096
- else if (compat.thinkingFormat === "openrouter" && model.reasoning && resolvedCompletionsReasoningEffort) params.reasoning = { effort: resolvedCompletionsReasoningEffort };
3097
- else if (resolvedCompletionsReasoningEffort && model.reasoning && compat.supportsReasoningEffort && !handledQwenThinkingFormat && !omitChatCompletionsToolReasoningEffort) params.reasoning_effort = resolvedCompletionsReasoningEffort;
3098
- return params;
3099
- }
3100
- function parseTransportChunkUsage(rawUsage, model) {
3101
- const cacheWriteTokens = rawUsage.prompt_tokens_details?.cache_write_tokens || 0;
3102
- const cachedTokens = rawUsage.prompt_tokens_details?.cached_tokens || 0;
3103
- const promptTokens = rawUsage.prompt_tokens || 0;
3104
- const input = Math.max(0, promptTokens - cachedTokens - cacheWriteTokens);
3105
- const outputTokens = rawUsage.completion_tokens || 0;
3106
- const reasoningTokens = rawUsage.completion_tokens_details?.reasoning_tokens;
3107
- const usage = {
3108
- input,
3109
- output: outputTokens,
3110
- cacheRead: cachedTokens,
3111
- cacheWrite: cacheWriteTokens,
3112
- ...typeof reasoningTokens === "number" && Number.isFinite(reasoningTokens) ? { reasoningTokens } : {},
3113
- totalTokens: input + outputTokens + cachedTokens + cacheWriteTokens,
3114
- cost: {
3115
- input: 0,
3116
- output: 0,
3117
- cacheRead: 0,
3118
- cacheWrite: 0,
3119
- total: 0
3120
- }
3121
- };
3122
- calculateCost(model, usage);
3123
- applyProviderReportedUsageCost(usage, rawUsage.cost);
3124
- return usage;
3125
- }
3126
- function hasOpenAICompletionsReasoningUsageActivity(rawUsage) {
3127
- const reasoningTokens = rawUsage.completion_tokens_details?.reasoning_tokens;
3128
- return typeof reasoningTokens === "number" && Number.isFinite(reasoningTokens) && reasoningTokens > 0;
3129
- }
3130
- const completionsTesting = {
3131
- getCompat,
3132
- createSseDoneDetector,
3133
- createOpenAICompletionsClient,
3134
- buildOpenAICompletionsClientConfig,
3135
- parseTransportChunkUsage,
3136
- processOpenAICompletionsStream,
3137
- shouldEmitOpenAICompletionsReasoningForModel
3138
- };
3139
- if (process.env.VITEST || false) globalThis.openclawOpenAICompletionsTransportTestApi = completionsTesting;
3140
- //#endregion
3141
- //#region packages/ai/src/transports/openai-responses-payload-policy.ts
3142
- /**
3143
- * OpenAI Responses payload policy.
3144
- * Classifies endpoint capabilities and applies store, prompt-cache,
3145
- * server-compaction, service-tier, and reasoning payload rules.
3146
- */
3147
- const OPENAI_RESPONSES_APIS = /* @__PURE__ */ new Set([
3148
- "openai-responses",
3149
- "azure-openai-responses",
3150
- "openai-chatgpt-responses",
3151
- "openclaw-openai-responses-transport",
3152
- "openclaw-openai-chatgpt-responses-transport"
3153
- ]);
3154
- const OPENAI_RESPONSES_PROVIDERS = /* @__PURE__ */ new Set([
3155
- "openai",
3156
- "azure-openai",
3157
- "azure-openai-responses"
3158
- ]);
3159
- const LOCAL_ENDPOINT_HOSTS = /* @__PURE__ */ new Set([
3160
- "localhost",
3161
- "127.0.0.1",
3162
- "::1",
3163
- "[::1]"
3164
- ]);
3165
- const MODELSTUDIO_NATIVE_BASE_URLS = /* @__PURE__ */ new Set([
3166
- "https://coding-intl.dashscope.aliyuncs.com/v1",
3167
- "https://coding.dashscope.aliyuncs.com/v1",
3168
- "https://dashscope.aliyuncs.com/compatible-mode/v1",
3169
- "https://dashscope-intl.aliyuncs.com/compatible-mode/v1"
3170
- ]);
3171
- const MOONSHOT_NATIVE_BASE_URLS = /* @__PURE__ */ new Set(["https://api.moonshot.ai/v1", "https://api.moonshot.cn/v1"]);
3172
- function normalizeLowercaseString(value) {
3173
- const stringValue = readStringValue(value)?.trim().toLowerCase();
3174
- return stringValue ? stringValue : void 0;
3175
- }
3176
- function normalizeComparableBaseUrl(value) {
3177
- const trimmed = readStringValue(value)?.trim();
3178
- if (!trimmed) return;
3179
- const parsedValue = /^[a-z0-9.[\]-]+(?::\d+)?(?:[/?#].*)?$/i.test(trimmed) ? `https://${trimmed}` : trimmed;
3180
- try {
3181
- const url = new URL(parsedValue);
3182
- if (url.protocol !== "http:" && url.protocol !== "https:") return;
3183
- url.hash = "";
3184
- url.search = "";
3185
- return url.toString().replace(/\/+$/, "").toLowerCase();
3186
- } catch {
3187
- return;
3188
- }
3189
- }
3190
- function resolveUrlHostname(value) {
3191
- const trimmed = readStringValue(value)?.trim();
3192
- if (!trimmed) return;
3193
- try {
3194
- return new URL(trimmed).hostname.toLowerCase();
3195
- } catch {
3196
- try {
3197
- return new URL(`https://${trimmed}`).hostname.toLowerCase();
3198
- } catch {
3199
- return;
3200
- }
3201
- }
3202
- }
3203
- function hostMatchesSuffix(host, suffix) {
3204
- return suffix.startsWith(".") || suffix.startsWith("-") ? host.endsWith(suffix) : host === suffix || host.endsWith(`.${suffix}`);
3205
- }
3206
- function isLocalEndpointHost(host) {
3207
- return LOCAL_ENDPOINT_HOSTS.has(host) || host.endsWith(".localhost") || host.endsWith(".local") || host.endsWith(".internal");
3208
- }
3209
- function resolveBundledOpenAIResponsesEndpointClass(baseUrl) {
3210
- const trimmed = readStringValue(baseUrl)?.trim();
3211
- if (!trimmed) return "default";
3212
- const host = resolveUrlHostname(trimmed);
3213
- if (!host) return "invalid";
3214
- const comparableBaseUrl = normalizeComparableBaseUrl(trimmed);
3215
- switch (host) {
3216
- case "api.anthropic.com": return "anthropic-public";
3217
- case "api.cerebras.ai": return "cerebras-native";
3218
- case "llm.chutes.ai": return "chutes-native";
3219
- case "api.deepseek.com": return "deepseek-native";
3220
- case "api.groq.com": return "groq-native";
3221
- case "api.mistral.ai": return "mistral-public";
3222
- case "api.openai.com": return "openai-public";
3223
- case "chatgpt.com": return "openai";
3224
- case "generativelanguage.googleapis.com": return "google-generative-ai";
3225
- case "aiplatform.googleapis.com": return "google-vertex";
3226
- case "api.x.ai": return "xai-native";
3227
- case "api.z.ai": return "zai-native";
3228
- }
3229
- if (hostMatchesSuffix(host, ".githubcopilot.com")) return "github-copilot-native";
3230
- if (hostMatchesSuffix(host, ".openai.azure.com")) return "azure-openai";
3231
- if (hostMatchesSuffix(host, "openrouter.ai")) return "openrouter";
3232
- if (hostMatchesSuffix(host, "opencode.ai")) return "opencode-native";
3233
- if (hostMatchesSuffix(host, "-aiplatform.googleapis.com")) return "google-vertex";
3234
- if (comparableBaseUrl && MOONSHOT_NATIVE_BASE_URLS.has(comparableBaseUrl)) return "moonshot-native";
3235
- if (comparableBaseUrl && MODELSTUDIO_NATIVE_BASE_URLS.has(comparableBaseUrl)) return "modelstudio-native";
3236
- if (isLocalEndpointHost(host)) return "local";
3237
- return "custom";
3238
- }
3239
- function isOpenAIResponsesApi(api) {
3240
- return api !== void 0 && OPENAI_RESPONSES_APIS.has(api);
3241
- }
3242
- function readCompatPayloadBoolean(compat, key) {
3243
- if (!compat || typeof compat !== "object") return;
3244
- const value = compat[key];
3245
- return typeof value === "boolean" ? value : void 0;
3246
- }
3247
- function resolveOpenAIResponsesPayloadCapabilities(model) {
3248
- const provider = normalizeLowercaseString(model.provider);
3249
- const api = normalizeLowercaseString(model.api);
3250
- const isOpenAIProvider = provider === "openai";
3251
- const endpointClass = resolveBundledOpenAIResponsesEndpointClass(model.baseUrl);
3252
- const isResponsesApi = isOpenAIResponsesApi(api);
3253
- const usesConfiguredBaseUrl = endpointClass !== "default";
3254
- const usesKnownNativeOpenAIEndpoint = endpointClass === "openai-public" || endpointClass === "openai" || endpointClass === "azure-openai";
3255
- const usesKnownNativeOpenAIRoute = endpointClass === "default" ? provider === "openai" : usesKnownNativeOpenAIEndpoint;
3256
- const usesExplicitProxyLikeEndpoint = usesConfiguredBaseUrl && !usesKnownNativeOpenAIEndpoint;
3257
- const promptCacheKeySupport = readCompatPayloadBoolean(model.compat, "supportsPromptCacheKey");
3258
- const shouldStripResponsesPromptCache = promptCacheKeySupport === true ? false : promptCacheKeySupport === false ? isResponsesApi : isResponsesApi && usesExplicitProxyLikeEndpoint;
3259
- const supportsResponsesStoreField = readCompatPayloadBoolean(model.compat, "supportsStore") !== false && isResponsesApi;
3260
- return {
3261
- allowsOpenAIServiceTier: provider === "openai" && (api === "openai-responses" || api === "openclaw-openai-responses-transport") && endpointClass === "openai-public" || isOpenAIProvider && (api === "openai-chatgpt-responses" || api === "openclaw-openai-chatgpt-responses-transport" || api === "openai-responses" || api === "openclaw-openai-responses-transport") && endpointClass === "openai",
3262
- allowsResponsesStore: supportsResponsesStoreField && api !== "openai-chatgpt-responses" && api !== "openclaw-openai-chatgpt-responses-transport" && provider !== void 0 && OPENAI_RESPONSES_PROVIDERS.has(provider) && usesKnownNativeOpenAIEndpoint,
3263
- shouldStripResponsesPromptCache,
3264
- supportsResponsesStoreField,
3265
- usesKnownNativeOpenAIRoute
3266
- };
3267
- }
3268
- function parsePositiveInteger(value) {
3269
- if (typeof value === "number" && Number.isFinite(value) && value > 0) return Math.floor(value);
3270
- if (typeof value === "string") return parseStrictPositiveInteger(value);
3271
- }
3272
- function resolveOpenAIResponsesCompactThreshold(model) {
3273
- const contextWindow = parsePositiveInteger(model.contextWindow);
3274
- if (contextWindow) return Math.max(1e3, Math.floor(contextWindow * .7));
3275
- return 8e4;
3276
- }
3277
- function shouldEnableOpenAIResponsesServerCompaction(explicitStore, provider, extraParams) {
3278
- const configured = extraParams?.responsesServerCompaction;
3279
- if (configured === false) return false;
3280
- if (explicitStore !== true) return false;
3281
- if (configured === true) return true;
3282
- return provider === "openai";
3283
- }
3284
- function stripDisabledOpenAIReasoningPayload(payloadObj) {
3285
- const reasoning = payloadObj.reasoning;
3286
- if (reasoning === "none") {
3287
- delete payloadObj.reasoning;
3288
- return;
3289
- }
3290
- if (!reasoning || typeof reasoning !== "object" || Array.isArray(reasoning)) return;
3291
- if (reasoning.effort === "none") delete payloadObj.reasoning;
3292
- }
3293
- /** Strip returned-item metadata rejected by strict Responses-compatible endpoints. */
3294
- function stripInputItemStatuses(input) {
3295
- if (!Array.isArray(input)) return;
3296
- for (const item of input) if (item && typeof item === "object" && !Array.isArray(item)) delete item.status;
3297
- }
3298
- /** Resolve payload mutation policy for one OpenAI Responses-style model endpoint. */
3299
- function resolveOpenAIResponsesPayloadPolicy(model, options = {}) {
3300
- const capabilities = resolveOpenAIResponsesPayloadCapabilities(model);
3301
- const storeMode = options.storeMode ?? "provider-policy";
3302
- const explicitStore = storeMode === "preserve" ? void 0 : storeMode === "disable" ? capabilities.supportsResponsesStoreField ? false : void 0 : capabilities.allowsResponsesStore ? true : void 0;
3303
- const isResponsesApi = isOpenAIResponsesApi(normalizeLowercaseString(model.api));
3304
- const shouldStripDisabledReasoningPayload = isResponsesApi && (!capabilities.usesKnownNativeOpenAIRoute || !supportsOpenAIReasoningEffort(model, "none"));
3305
- const shouldStripInputStatus = isResponsesApi && !capabilities.usesKnownNativeOpenAIRoute;
3306
- return {
3307
- allowsServiceTier: capabilities.allowsOpenAIServiceTier,
3308
- compactThreshold: parsePositiveInteger(options.extraParams?.responsesCompactThreshold) ?? resolveOpenAIResponsesCompactThreshold(model),
3309
- explicitStore,
3310
- shouldStripDisabledReasoningPayload,
3311
- shouldStripInputStatus,
3312
- shouldStripPromptCache: options.enablePromptCacheStripping === true && capabilities.shouldStripResponsesPromptCache,
3313
- shouldStripStore: explicitStore !== true && readCompatPayloadBoolean(model.compat, "supportsStore") === false && isResponsesApi,
3314
- useServerCompaction: options.enableServerCompaction === true && shouldEnableOpenAIResponsesServerCompaction(explicitStore, model.provider, options.extraParams)
3315
- };
3316
- }
3317
- /** Mutate a Responses request payload according to the resolved endpoint policy. */
3318
- function applyOpenAIResponsesPayloadPolicy(payloadObj, policy) {
3319
- if (policy.explicitStore !== void 0) payloadObj.store = policy.explicitStore;
3320
- if (policy.shouldStripStore) delete payloadObj.store;
3321
- if (policy.shouldStripPromptCache) {
3322
- delete payloadObj.prompt_cache_key;
3323
- delete payloadObj.prompt_cache_retention;
3324
- }
3325
- if (policy.useServerCompaction && payloadObj.context_management === void 0) payloadObj.context_management = [{
3326
- type: "compaction",
3327
- compact_threshold: policy.compactThreshold
3328
- }];
3329
- if (policy.shouldStripDisabledReasoningPayload) stripDisabledOpenAIReasoningPayload(payloadObj);
3330
- if (policy.shouldStripInputStatus) stripInputItemStatuses(payloadObj.input);
3331
- }
3332
- //#endregion
3333
- //#region packages/ai/src/transports/openai-responses-params-internal.ts
3334
- function convertResponsesTools(tools, model, options) {
3335
- const projection = projectOpenAITools(tools);
3336
- const strict = resolveOpenAIStrictToolFlagWithDiagnostics(projection, options?.strict, {
3337
- transport: "responses",
3338
- model
3339
- });
3340
- return {
3341
- projection,
3342
- tools: sortPromptCacheToolsByName(projection.tools).map((tool) => {
3343
- const result = {
3344
- type: "function",
3345
- name: tool.name,
3346
- description: tool.description,
3347
- parameters: normalizeOpenAIStrictToolParameters(tool.parameters, strict === true, model.compat)
3348
- };
3349
- if (strict !== void 0) result.strict = strict;
3350
- return result;
3351
- })
3352
- };
3353
- }
3354
- function getPromptCacheRetention(baseUrl, cacheRetention) {
3355
- if (cacheRetention !== "long") return;
3356
- return baseUrl?.includes("api.openai.com") ? "24h" : void 0;
3357
- }
3358
- function resolveOpenAIReasoningEffort(options) {
3359
- return normalizeOpenAIReasoningEffort(options?.reasoningEffort ?? options?.reasoning ?? "high");
3360
- }
3361
- function hasResponsesWebSearchTool(tools) {
3362
- if (!Array.isArray(tools)) return false;
3363
- return tools.some((tool) => {
3364
- if (!isRecord(tool)) return false;
3365
- if (tool.type === "web_search") return true;
3366
- if (tool.type === "function" && tool.name === "web_search") return true;
3367
- const fn = tool.function;
3368
- return isRecord(fn) && fn.name === "web_search";
3369
- });
3370
- }
3371
- function raiseMinimalReasoningForResponsesWebSearch(params) {
3372
- if (params.effort !== "minimal" || !hasResponsesWebSearchTool(params.tools)) return params.effort;
3373
- for (const effort of [
3374
- "low",
3375
- "medium",
3376
- "high"
3377
- ]) {
3378
- const resolved = resolveOpenAIReasoningEffortForModel({
3379
- model: params.model,
3380
- effort
3381
- });
3382
- if (resolved && resolved !== "none" && resolved !== "minimal") return resolved;
3383
- }
3384
- return params.effort;
3385
- }
3386
- const OPENAI_CODEX_RESPONSES_UNSUPPORTED_PARAMS = [
3387
- "max_output_tokens",
3388
- "metadata",
3389
- "prompt_cache_retention",
3390
- "service_tier",
3391
- "temperature",
3392
- "top_p"
3393
- ];
3394
- function stripOpenAICodexResponsesUnsupportedTextFields(params) {
3395
- const text = params.text;
3396
- if (!text || typeof text !== "object" || Array.isArray(text)) return;
3397
- const sanitizedText = { ...text };
3398
- delete sanitizedText.format;
3399
- if (Object.keys(sanitizedText).length > 0) params.text = sanitizedText;
3400
- else delete params.text;
3401
- }
3402
- function sanitizeOpenAICodexResponsesParams(model, params) {
3403
- if (!usesNativeOpenAICodexResponsesBackend(model)) return params;
3404
- for (const key of OPENAI_CODEX_RESPONSES_UNSUPPORTED_PARAMS) delete params[key];
3405
- stripOpenAICodexResponsesUnsupportedTextFields(params);
3406
- return params;
3407
- }
3408
- function buildOpenAICodexResponsesInstructions(context) {
3409
- if (!context.systemPrompt) return;
3410
- return sanitizeTransportPayloadText(stripSystemPromptCacheBoundary(context.systemPrompt));
3411
- }
3412
- function resolveOpenAICodexResponsesInstructions(model, context) {
3413
- const instructions = buildOpenAICodexResponsesInstructions(context);
3414
- if (instructions && instructions.trim().length > 0) return instructions;
3415
- return usesNativeOpenAICodexResponsesBackend(model) ? OPENAI_CODEX_RESPONSES_DEFAULT_INSTRUCTIONS : void 0;
3416
- }
3417
- function ensureOpenAICodexResponsesInput(messages, context) {
3418
- if (messages.length > 0 || !context.systemPrompt) return;
3419
- if (!buildOpenAICodexResponsesInstructions(context)) throw new Error("OpenAI Codex Responses requires non-empty input when only systemPrompt is provided.");
3420
- messages.push(buildResponsesInputMessage("user", [{
3421
- type: "input_text",
3422
- text: " "
3423
- }]));
3424
- }
3425
- function resolveOpenAIResponsesTextFormat(responseFormat) {
3426
- if (responseFormat.type === "json_schema" && responseFormat.json_schema && typeof responseFormat.json_schema === "object" && !Array.isArray(responseFormat.json_schema)) return {
3427
- ...responseFormat.json_schema,
3428
- type: "json_schema"
3429
- };
3430
- return responseFormat;
3431
- }
3432
- function buildOpenAIResponsesParams(model, context, options, metadata) {
3433
- const isCodexResponses = isOpenAICodexResponsesModel(model);
3434
- const isNativeCodexResponses = usesNativeOpenAICodexResponsesBackend(model);
3435
- const compat = getCompat(model);
3436
- const supportsDeveloperRole = typeof compat.supportsDeveloperRole === "boolean" ? compat.supportsDeveloperRole : void 0;
3437
- const payloadPolicy = resolveOpenAIResponsesPayloadPolicy(model, { storeMode: "disable" });
3438
- const policyAllowsReplayIds = payloadPolicy.explicitStore !== false && !payloadPolicy.shouldStripStore;
3439
- const replayResponsesItemIds = !isNativeCodexResponses && (options?.replayResponsesItemIds ?? policyAllowsReplayIds);
3440
- const messages = convertResponsesMessages(model, context, /* @__PURE__ */ new Set([
3441
- "openai",
3442
- "opencode",
3443
- "azure-openai-responses",
3444
- "github-copilot"
3445
- ]), {
3446
- includeSystemPrompt: !isCodexResponses,
3447
- supportsDeveloperRole,
3448
- replayReasoningItems: true,
3449
- replayResponsesItemIds,
3450
- authProfileId: options?.authProfileId,
3451
- sessionId: options?.sessionId
3452
- });
3453
- if (isCodexResponses) ensureOpenAICodexResponsesInput(messages, context);
3454
- const cacheRetention = resolveCacheRetention(options?.cacheRetention);
3455
- const promptCacheKey = resolvePromptCacheKey(options, cacheRetention);
3456
- const params = {
3457
- model: model.id,
3458
- input: messages,
3459
- stream: true,
3460
- prompt_cache_key: promptCacheKey,
3461
- prompt_cache_retention: getPromptCacheRetention(model.baseUrl, cacheRetention),
3462
- ...isCodexResponses ? { instructions: resolveOpenAICodexResponsesInstructions(model, context) } : {},
3463
- ...metadata ? { metadata } : {}
3464
- };
3465
- const effectiveMaxTokens = options?.maxTokens || model.maxTokens;
3466
- if (effectiveMaxTokens) params.max_output_tokens = effectiveMaxTokens;
3467
- if (options?.temperature !== void 0) params.temperature = options.temperature;
3468
- if (options?.topP !== void 0) params.top_p = options.topP;
3469
- if (options?.responseFormat !== void 0) params.text = {
3470
- ...params.text,
3471
- format: resolveOpenAIResponsesTextFormat(options.responseFormat)
3472
- };
3473
- if (options?.serviceTier !== void 0 && payloadPolicy.allowsServiceTier) params.service_tier = options.serviceTier;
3474
- if (context.tools) {
3475
- const converted = convertResponsesTools(context.tools, model, { strict: resolveOpenAIStrictToolSetting(model, { transport: "stream" }) });
3476
- if (converted.tools.length > 0 || converted.projection.inputToolCount === 0 && converted.projection.diagnostics.length === 0) params.tools = converted.tools;
3477
- if (options?.toolChoice) {
3478
- const toolChoice = reconcileOpenAIResponsesToolChoice(options.toolChoice, converted.projection);
3479
- if (toolChoice !== void 0) params.tool_choice = toolChoice;
3480
- }
3481
- }
3482
- if (model.reasoning) {
3483
- if (options?.reasoningEffort || options?.reasoning || options?.reasoningSummary) {
3484
- const resolvedReasoningEffort = resolveOpenAIReasoningEffortForModel({
3485
- model,
3486
- effort: resolveOpenAIReasoningEffort(options)
3487
- });
3488
- const reasoningEffort = resolvedReasoningEffort ? raiseMinimalReasoningForResponsesWebSearch({
3489
- model,
3490
- effort: resolvedReasoningEffort,
3491
- tools: params.tools
3492
- }) : void 0;
3493
- if (reasoningEffort) {
3494
- params.reasoning = {
3495
- effort: reasoningEffort,
3496
- ...reasoningEffort === "none" ? {} : { summary: options?.reasoningSummary || "auto" }
3497
- };
3498
- if (reasoningEffort !== "none") params.include = ["reasoning.encrypted_content"];
3499
- }
3500
- } else if (model.provider !== "github-copilot") {
3501
- const reasoningEffort = resolveOpenAIReasoningEffortForModel({
3502
- model,
3503
- effort: "none"
3504
- });
3505
- if (reasoningEffort) params.reasoning = { effort: reasoningEffort };
3506
- }
3507
- }
3508
- applyOpenAIResponsesPayloadPolicy(params, payloadPolicy);
3509
- return sanitizeOpenAICodexResponsesParams(model, params);
3510
- }
3511
- //#endregion
3512
- //#region packages/media-core/src/inline-image-data-url.ts
3513
- /** Prefix used to distinguish inline data URLs from remote/local image references. */
3514
- const INLINE_IMAGE_DATA_URL_PREFIX = "data:";
3515
- const IMAGE_SIGNATURES = [
3516
- {
3517
- mime: "image/png",
3518
- matches: (buffer) => buffer.length >= 8 && buffer[0] === 137 && buffer[1] === 80 && buffer[2] === 78 && buffer[3] === 71 && buffer[4] === 13 && buffer[5] === 10 && buffer[6] === 26 && buffer[7] === 10
3519
- },
3520
- {
3521
- mime: "image/jpeg",
3522
- matches: (buffer) => buffer.length >= 3 && buffer[0] === 255 && buffer[1] === 216 && buffer[2] === 255
3523
- },
3524
- {
3525
- mime: "image/webp",
3526
- matches: (buffer) => buffer.length >= 12 && buffer.subarray(0, 4).toString("ascii") === "RIFF" && buffer.subarray(8, 12).toString("ascii") === "WEBP"
3527
- },
3528
- {
3529
- mime: "image/gif",
3530
- matches: (buffer) => buffer.length >= 6 && (buffer.subarray(0, 6).toString("ascii") === "GIF87a" || buffer.subarray(0, 6).toString("ascii") === "GIF89a")
3531
- },
3532
- {
3533
- mime: "image/bmp",
3534
- matches: (buffer) => buffer.length >= 2 && buffer[0] === 66 && buffer[1] === 77
3535
- }
3536
- ];
3537
- const HEIC_BRANDS = /* @__PURE__ */ new Set([
3538
- "heic",
3539
- "heix",
3540
- "hevc",
3541
- "hevx",
3542
- "heis",
3543
- "heim",
3544
- "hevm",
3545
- "hevs"
3546
- ]);
3547
- const HEIF_BRANDS = /* @__PURE__ */ new Set(["mif1", "msf1"]);
3548
- const IMAGE_SIGNATURE_PREFIX_BASE64_CHARS = 128;
3549
- const INLINE_IMAGE_DATA_URL_MIMES = /* @__PURE__ */ new Set([
3550
- "image/png",
3551
- "image/jpeg",
3552
- "image/webp",
3553
- "image/gif"
3554
- ]);
3555
- function startsWithDataUrl(value) {
3556
- return value.slice(0, 5).toLowerCase() === INLINE_IMAGE_DATA_URL_PREFIX;
3557
- }
3558
- function sniffIsoBmffImageMime(buffer) {
3559
- if (buffer.length < 12 || buffer.subarray(4, 8).toString("ascii") !== "ftyp") return;
3560
- const brands = [buffer.subarray(8, 12).toString("ascii")];
3561
- for (let offset = 16; offset + 4 <= buffer.length; offset += 4) brands.push(buffer.subarray(offset, offset + 4).toString("ascii"));
3562
- if (brands.some((brand) => HEIC_BRANDS.has(brand))) return "image/heic";
3563
- if (brands.some((brand) => HEIF_BRANDS.has(brand))) return "image/heif";
3564
- }
3565
- /** Sniffs supported inline image formats from decoded bytes. */
3566
- function sniffInlineImageMime(buffer) {
3567
- return IMAGE_SIGNATURES.find((signature) => signature.matches(buffer))?.mime ?? sniffIsoBmffImageMime(buffer);
3568
- }
3569
- function isImageMimeType(value) {
3570
- return value.trim().toLowerCase().startsWith("image/");
3571
- }
3572
- /** Canonicalizes trusted inline image base64 and rejects malformed or non-image payloads. */
3573
- function sanitizeInlineImageBase64(params) {
3574
- if (!isImageMimeType(params.mimeType)) return;
3575
- const canonicalPayload = canonicalizeBase64(params.base64);
3576
- if (!canonicalPayload) return;
3577
- const sniffedMimeType = sniffInlineImageMime(Buffer.from(canonicalPayload.slice(0, IMAGE_SIGNATURE_PREFIX_BASE64_CHARS), "base64"));
3578
- if (!sniffedMimeType) return;
3579
- return {
3580
- mimeType: sniffedMimeType,
3581
- base64: canonicalPayload
3582
- };
3583
- }
3584
- function parseInlineImageDataUrl(value) {
3585
- if (!startsWithDataUrl(value)) return {
3586
- metadata: [],
3587
- payload: value
3588
- };
3589
- const commaIndex = value.indexOf(",");
3590
- if (commaIndex < 0) return;
3591
- return {
3592
- metadata: value.slice(5, commaIndex).split(";").map((part) => part.trim()),
3593
- payload: value.slice(commaIndex + 1)
3594
- };
3595
- }
3596
- function metadataAllowsImageBase64(metadata) {
3597
- const [mimeType, ...options] = metadata;
3598
- return mimeType !== void 0 && isImageMimeType(mimeType) && options.some((part) => part.toLowerCase() === "base64");
3599
- }
3600
- function sanitizeInlineImageDataUrlWithAllowedMimes(imageUrl, allowedMimes) {
3601
- const parsed = parseInlineImageDataUrl(imageUrl);
3602
- if (!parsed) return;
3603
- if (parsed.metadata.length === 0) return imageUrl;
3604
- if (!metadataAllowsImageBase64(parsed.metadata)) return;
3605
- const [mimeType] = parsed.metadata;
3606
- const sanitized = sanitizeInlineImageBase64({
3607
- mimeType: mimeType ?? "",
3608
- base64: parsed.payload
3609
- });
3610
- if (!sanitized) return;
3611
- if (allowedMimes && !allowedMimes.has(sanitized.mimeType)) return;
3612
- return `data:${sanitized.mimeType};base64,${sanitized.base64}`;
3613
- }
3614
- /** Canonicalizes provider-safe inline image data URLs and rejects unsupported formats. */
3615
- function sanitizeInlineImageDataUrl(imageUrl) {
3616
- return sanitizeInlineImageDataUrlWithAllowedMimes(imageUrl, INLINE_IMAGE_DATA_URL_MIMES);
3617
- }
3618
- //#endregion
3619
- //#region packages/ai/src/transports/responses-image-payload-sanitizer.ts
3620
- /**
3621
- * Sanitizes OpenAI Responses payloads before transport. Invalid inline images
3622
- * are replaced with text placeholders so the request remains valid and
3623
- * auditable.
3624
- */
3625
- const IMAGE_OMITTED_TEXT = "omitted image payload: invalid inline image data";
3626
- function invalidSnakeImage() {
3627
- return {
3628
- type: "input_text",
3629
- text: `[${IMAGE_OMITTED_TEXT}]`
3630
- };
3631
- }
3632
- function sanitizeValue(value) {
3633
- if (Array.isArray(value)) return value.map(sanitizeValue);
3634
- if (!isRecord(value)) return value;
3635
- if (value.type === "input_image" && typeof value.image_url === "string") {
3636
- const imageUrl = sanitizeInlineImageDataUrl(value.image_url);
3637
- return imageUrl ? {
3638
- ...value,
3639
- image_url: imageUrl
3640
- } : invalidSnakeImage();
3641
- }
3642
- const next = {};
3643
- for (const [key, child] of Object.entries(value)) next[key] = sanitizeValue(child);
3644
- return next;
3645
- }
3646
- /** Sanitize inline image fields inside a Responses API payload. */
3647
- function sanitizeResponsesImagePayload(params) {
3648
- if (!Array.isArray(params.input)) return params;
3649
- return {
3650
- ...params,
3651
- input: sanitizeValue(params.input)
3652
- };
3653
- }
3654
- //#endregion
3655
- //#region packages/ai/src/transports/openai-responses-client.ts
3656
- function resolveProviderTransportTurnState(model, params) {
3657
- const normalizedProvider = model.provider.trim().toLowerCase();
3658
- const allowRuntimePluginLoad = normalizedProvider === "openai" || normalizedProvider === "azure-openai" || normalizedProvider === "azure-openai-responses";
3659
- return getAiTransportHost().plugin.resolveTransportTurnState({
3660
- provider: model.provider,
3661
- modelId: model.id,
3662
- allowRuntimePluginLoad,
3663
- context: {
3664
- provider: model.provider,
3665
- modelId: model.id,
3666
- model,
3667
- sessionId: params.sessionId,
3668
- turnId: params.turnId,
3669
- attempt: params.attempt,
3670
- transport: params.transport
3671
- }
3672
- });
3673
- }
3674
- function createOpenAIResponsesClient(model, context, apiKey, optionHeaders, turnHeaders, sessionId) {
3675
- return new OpenAI({
3676
- apiKey,
3677
- baseURL: model.baseUrl,
3678
- dangerouslyAllowBrowser: true,
3679
- defaultHeaders: buildOpenAIClientHeaders(model, context, optionHeaders, turnHeaders, sessionId),
3680
- fetch: buildGuardedModelFetch(model),
3681
- ...buildOpenAISdkClientOptions(model)
3682
- });
3683
- }
3684
- function createResponsesTransportExecutor(config) {
3685
- return (model, context, options) => {
3686
- const responsesOptions = options;
3687
- const eventStream = createAssistantMessageEventStream();
3688
- const stream = eventStream;
3689
- (async () => {
3690
- const output = {
3691
- role: "assistant",
3692
- content: [],
3693
- api: config.outputApi ?? model.api,
3694
- provider: model.provider,
3695
- model: model.id,
3696
- usage: {
3697
- input: 0,
3698
- output: 0,
3699
- cacheRead: 0,
3700
- cacheWrite: 0,
3701
- totalTokens: 0,
3702
- cost: {
3703
- input: 0,
3704
- output: 0,
3705
- cacheRead: 0,
3706
- cacheWrite: 0,
3707
- total: 0
3708
- }
3709
- },
3710
- stopReason: "stop",
3711
- timestamp: Date.now()
3712
- };
3713
- let firstEventAbort;
3714
- try {
3715
- const apiKey = options?.apiKey || getEnvApiKey(model.provider) || "";
3716
- const turnState = resolveProviderTransportTurnState(model, {
3717
- sessionId: options?.sessionId,
3718
- turnId: randomUUID(),
3719
- attempt: 1,
3720
- transport: "stream"
3721
- });
3722
- const client = config.createClient(model, context, apiKey, options?.headers, turnState?.headers, options?.sessionId);
3723
- let params = config.buildRequest(model, context, responsesOptions, turnState?.metadata);
3724
- const nextParams = await options?.onPayload?.(params, model);
3725
- if (nextParams !== void 0) params = nextParams;
3726
- if (!isOpenAICodexResponsesModel(model)) params = mergeTransportMetadata(params, turnState?.metadata);
3727
- params = sanitizeOpenAICodexResponsesParams(model, params);
3728
- params = sanitizeResponsesImagePayload(params);
3729
- if (options?.openclawCodeModeToolSurface === true) {
3730
- const visibleToolNames = resolveCodeModeResponsesVisibleToolNames(context);
3731
- enforceCodeModeResponsesToolSurface(params, visibleToolNames);
3732
- assertCodeModeResponsesToolSurface(params, visibleToolNames);
3733
- }
3734
- const requestStartedAt = Date.now();
3735
- firstEventAbort = createFirstStreamEventAbortController(options?.signal);
3736
- const requestOptions = buildOpenAISdkRequestOptions(model, firstEventAbort.signal, {
3737
- stream: config.streamRequest,
3738
- timeoutMs: options?.timeoutMs,
3739
- maxRetries: options?.maxRetries
3740
- });
3741
- emitModelTransportDebug(log, `[responses] start provider=${model.provider} api=${model.api} model=${model.id} baseUrl=${formatModelTransportDebugBaseUrl(model.baseUrl)} timeoutMs=${safeDebugValue(requestOptions?.timeout)} apiKey=${apiKey ? "present" : "missing"} ${summarizeResponsesPayload(params)}`);
3742
- const responseStream = await config.createResponseStream({
3743
- client,
3744
- request: params,
3745
- requestOptions,
3746
- model
3747
- });
3748
- emitModelTransportDebug(log, `[responses] headers provider=${model.provider} api=${model.api} model=${model.id} elapsedMs=${Date.now() - requestStartedAt}`);
3749
- stream.push({
3750
- type: "start",
3751
- partial: output
3752
- });
3753
- await processResponsesStream(observeResponsesStream(responseStream, model), output, stream, model, {
3754
- ...config.pricingOptions?.(responsesOptions),
3755
- firstEventTimeoutMs: getFirstStreamEventTimeoutMs(options) ?? config.firstEventTimeoutMs,
3756
- abortFirstEventStream: firstEventAbort.abort,
3757
- onFirstEventTimeout: getFirstStreamEventTimeoutHandler(options),
3758
- signal: options?.signal,
3759
- reasoningReplayMetadata: buildOpenAIResponsesReasoningReplayMetadata(model, {
3760
- authProfileId: responsesOptions?.authProfileId,
3761
- sessionId: options?.sessionId
3762
- })
3763
- });
3764
- if (options?.signal?.aborted) throw transportAbortError(options.signal);
3765
- if (output.stopReason === "aborted" || output.stopReason === "error") throw new Error("An unknown error occurred");
3766
- stream.push({
3767
- type: "done",
3768
- reason: output.stopReason,
3769
- message: output
3770
- });
3771
- stream.end();
3772
- } catch (error) {
3773
- if (error instanceof ResponsesStreamFailure && error.observation) logResponsesFailedNoDetails(error.observation);
3774
- log.warn(`[responses] error provider=${model.provider} api=${model.api} model=${model.id} ` + summarizeOpenAITransportError(error));
3775
- assignTransportErrorDetails(output, error, options?.signal);
3776
- stream.push({
3777
- type: "error",
3778
- reason: output.stopReason,
3779
- error: output
3780
- });
3781
- stream.end();
3782
- } finally {
3783
- firstEventAbort?.dispose();
3784
- }
3785
- })();
3786
- return eventStream;
3787
- };
3788
- }
3789
- function createOpenAIResponsesTransportStreamFn() {
3790
- return createResponsesTransportExecutor({
3791
- streamRequest: true,
3792
- createClient: createOpenAIResponsesClient,
3793
- buildRequest: buildOpenAIResponsesParams,
3794
- createResponseStream: createResponsesStreamWithEncryptedContentRetry,
3795
- pricingOptions: (options) => ({
3796
- serviceTier: options?.serviceTier,
3797
- applyServiceTierPricing
3798
- })
3799
- });
3800
- }
3801
- function createAzureOpenAIResponsesTransportStreamFn() {
3802
- return createResponsesTransportExecutor({
3803
- outputApi: "azure-openai-responses",
3804
- firstEventTimeoutMs: AZURE_RESPONSES_FIRST_EVENT_TIMEOUT_MS,
3805
- createClient: createAzureOpenAIClient,
3806
- buildRequest: (model, context, options, metadata) => buildAzureOpenAIResponsesParams(model, context, options, resolveAzureDeploymentName(model), metadata),
3807
- createResponseStream: async ({ client, request, requestOptions }) => await client.responses.create(request, requestOptions)
3808
- });
3809
- }
3810
- function normalizeAzureBaseUrl(baseUrl) {
3811
- return baseUrl.replace(/\/+$/, "");
3812
- }
3813
- function resolveAzureDeploymentName(model) {
3814
- return resolveAzureDeploymentNameFromMap({
3815
- modelId: model.id,
3816
- deploymentMap: process.env.AZURE_OPENAI_DEPLOYMENT_NAME_MAP
3817
- });
3818
- }
3819
- function createAzureOpenAIClient(model, context, apiKey, optionHeaders, turnHeaders) {
3820
- const baseURL = normalizeAzureBaseUrl(model.baseUrl);
3821
- const clientOptions = {
3822
- apiKey,
3823
- dangerouslyAllowBrowser: true,
3824
- defaultHeaders: buildOpenAIClientHeaders(model, context, optionHeaders, turnHeaders),
3825
- baseURL,
3826
- fetch: buildGuardedModelFetch(model),
3827
- ...buildOpenAISdkClientOptions(model)
3828
- };
3829
- if (isOpenAICompatibleAzureResponsesBaseUrl(baseURL)) return new OpenAI(clientOptions);
3830
- return new AzureOpenAI({
3831
- ...clientOptions,
3832
- apiVersion: resolveAzureOpenAIApiVersion()
3833
- });
3834
- }
3835
- function buildAzureOpenAIResponsesParams(model, context, options, deploymentName, metadata) {
3836
- const params = buildOpenAIResponsesParams(model, context, options, metadata);
3837
- params.model = deploymentName;
3838
- delete params.store;
3839
- return params;
3840
- }
3841
- //#endregion
3842
- //#region packages/ai/src/transports/openai-responses-transport.ts
3843
- /** OpenAI Responses transport facade. */
3844
- const responsesTesting = {
3845
- getCompat,
3846
- assertCodeModeResponsesToolSurface,
3847
- buildOpenAIResponsesParams,
3848
- buildOpenAIClientHeaders,
3849
- buildOpenAISdkClientOptions,
3850
- buildOpenAISdkRequestOptions,
3851
- createAzureOpenAIClient,
3852
- createOpenAIResponsesClient,
3853
- enforceCodeModeResponsesToolSurface,
3854
- sanitizeOpenAICodexResponsesParams,
3855
- processResponsesStream,
3856
- formatModelTransportDebugBaseUrl,
3857
- buildResponsesFailedNoDetailsObservation,
3858
- buildOpenAIResponsesReasoningReplayMetadata,
3859
- isInvalidEncryptedContentError,
3860
- normalizeResponsesFailedEvent,
3861
- prepareOpenAIResponsesReasoningItemForReplay,
3862
- createResponsesStreamWithEncryptedContentRetry,
3863
- resolveAzureOpenAIApiVersion,
3864
- stripResponsesRequestEncryptedContent,
3865
- tagOpenAIResponsesReasoningReplayItem,
3866
- summarizeResponsesFailedNoDetailsObservation,
3867
- summarizeResponsesPayload,
3868
- summarizeResponsesTools,
3869
- stringifyRedactedEvent,
3870
- stringifyRedactedPayload
3871
- };
3872
- if (process.env.VITEST || false) globalThis.openclawOpenAIResponsesTransportTestApi = responsesTesting;
3873
- //#endregion
3874
- //#region packages/ai/src/transports/provider-transport-stream.ts
3875
- const SUPPORTED_TRANSPORT_APIS = /* @__PURE__ */ new Set([
3876
- "openai-responses",
3877
- "openai-chatgpt-responses",
3878
- "openai-completions",
3879
- "azure-openai-responses",
3880
- "anthropic-messages",
3881
- "google-generative-ai"
3882
- ]);
3883
- const SIMPLE_TRANSPORT_API_ALIAS = {
3884
- "openai-responses": "openclaw-openai-responses-transport",
3885
- "openai-chatgpt-responses": "openclaw-openai-chatgpt-responses-transport",
3886
- "openai-completions": "openclaw-openai-completions-transport",
3887
- "azure-openai-responses": "openclaw-azure-openai-responses-transport",
3888
- "anthropic-messages": "openclaw-anthropic-messages-transport",
3889
- "google-generative-ai": "openclaw-google-generative-ai-transport"
3890
- };
3891
- function createProviderOwnedGoogleTransportStreamFn(model, ctx) {
3892
- return getAiTransportHost().plugin.resolveProviderStream({
3893
- provider: model.provider,
3894
- config: ctx?.cfg,
3895
- workspaceDir: ctx?.workspaceDir,
3896
- env: ctx?.env,
3897
- context: {
3898
- config: ctx?.cfg,
3899
- agentDir: ctx?.agentDir,
3900
- workspaceDir: ctx?.workspaceDir,
3901
- provider: model.provider,
3902
- modelId: model.id,
3903
- model
3904
- }
3905
- }) ?? getAiTransportHost().plugin.resolveProviderStream({
3906
- provider: "google",
3907
- config: ctx?.cfg,
3908
- workspaceDir: ctx?.workspaceDir,
3909
- env: ctx?.env,
3910
- context: {
3911
- config: ctx?.cfg,
3912
- agentDir: ctx?.agentDir,
3913
- workspaceDir: ctx?.workspaceDir,
3914
- provider: model.provider,
3915
- modelId: model.id,
3916
- model
3917
- }
3918
- }) ?? void 0;
3919
- }
3920
- function createSupportedTransportStreamFn(model, ctx) {
3921
- switch (model.api) {
3922
- case "openai-responses":
3923
- case "openai-chatgpt-responses": return createOpenAIResponsesTransportStreamFn();
3924
- case "openai-completions": return createOpenAICompletionsTransportStreamFn();
3925
- case "azure-openai-responses": return createAzureOpenAIResponsesTransportStreamFn();
3926
- case "anthropic-messages": return createAnthropicMessagesTransportStreamFn();
3927
- case "google-generative-ai": return createProviderOwnedGoogleTransportStreamFn(model, ctx);
3928
- default: return;
3929
- }
3930
- }
3931
- function hasOpenClawTransportRequirement(model) {
3932
- return getAiTransportHost().requiresManagedTransport(model);
3933
- }
3934
- /** Returns whether OpenClaw has a managed transport implementation for this API. */
3935
- function isTransportAwareApiSupported(api) {
3936
- return SUPPORTED_TRANSPORT_APIS.has(api);
3937
- }
3938
- /** Maps public model APIs to the internal transport API id used by simple runtime dispatch. */
3939
- function resolveTransportAwareSimpleApi(api) {
3940
- return SIMPLE_TRANSPORT_API_ALIAS[api];
3941
- }
3942
- /** Creates a managed transport stream only when request overrides require it. */
3943
- function createTransportAwareStreamFnForModel(model, ctx) {
3944
- if (!hasOpenClawTransportRequirement(model)) return;
3945
- if (!isTransportAwareApiSupported(model.api)) throw new Error(`Model-provider request.proxy/request.tls/localService is not yet supported for api "${model.api}"`);
3946
- const streamFn = createSupportedTransportStreamFn(model, ctx);
3947
- if (!streamFn) throw new Error(`Managed transport stream is unavailable for api "${model.api}"`);
3948
- return streamFn;
3949
- }
3950
- /** Creates a managed OpenClaw transport stream for explicit fallback/runtime callers. */
3951
- function createOpenClawTransportStreamFnForModel(model, ctx) {
3952
- if (!isTransportAwareApiSupported(model.api)) return;
3953
- return createSupportedTransportStreamFn(model, ctx);
3954
- }
3955
- function createBoundaryAwareStreamFnForModel(model, ctx) {
3956
- if (!isTransportAwareApiSupported(model.api)) return;
3957
- return createSupportedTransportStreamFn(model, ctx);
3958
- }
3959
- function prepareTransportAwareSimpleModel(model, ctx) {
3960
- const streamFn = createTransportAwareStreamFnForModel(model, ctx);
3961
- const alias = resolveTransportAwareSimpleApi(model.api);
3962
- if (!streamFn || !alias) return model;
3963
- return getAiTransportHost().inheritManagedTransport(model, {
3964
- ...model,
3965
- api: alias
3966
- });
3967
- }
3968
- function buildTransportAwareSimpleStreamFn(model, ctx) {
3969
- return createTransportAwareStreamFnForModel(model, ctx);
3970
- }
3971
- //#endregion
3972
- //#region packages/ai/src/transports/simple-completion-transport.ts
3973
- const PROVIDER_SIMPLE_COMPLETION_API_PREFIX = "openclaw-provider-simple:";
3974
- const INVALID_CODEX_BASE_URL_MESSAGE = "OpenAI Codex Responses baseUrl must not include query parameters or fragments";
3975
- function registerCustomApi(registry, api, streamFn) {
3976
- getAiTransportHost().registerCustomApi(registry, api, streamFn);
3977
- return registry.getApiProvider(api) !== void 0;
3978
- }
3979
- function projectModel(model, patch) {
3980
- return getAiTransportHost().inheritManagedTransport(model, {
3981
- ...model,
3982
- ...patch
3983
- });
3984
- }
3985
- function resolveAnthropicVertexSimpleApi(baseUrl) {
3986
- return `openclaw-anthropic-vertex-simple:${baseUrl?.trim() ? encodeURIComponent(baseUrl.trim()) : "default"}`;
3987
- }
3988
- function normalizeCodexResponsesBaseUrlForOpenAISdk(baseUrl) {
3989
- const normalized = baseUrl?.trim() || "https://chatgpt.com/backend-api";
3990
- try {
3991
- const parsed = new URL(normalized);
3992
- const pathname = parsed.pathname.replace(/\/+$/u, "");
3993
- const path = pathname.toLowerCase();
3994
- if (parsed.hostname.toLowerCase() === "chatgpt.com" && [
3995
- "/backend-api",
3996
- "/backend-api/v1",
3997
- "/backend-api/codex",
3998
- "/backend-api/codex/v1",
3999
- "/backend-api/codex/responses"
4000
- ].includes(path)) {
4001
- parsed.pathname = "/backend-api/codex";
4002
- parsed.search = "";
4003
- parsed.hash = "";
4004
- return parsed.toString().replace(/\/$/u, "");
4005
- }
4006
- if (normalized.includes("?") || normalized.includes("#")) throw new Error(INVALID_CODEX_BASE_URL_MESSAGE);
4007
- parsed.pathname = path.endsWith("/codex/responses") ? pathname.slice(0, -10) : path.endsWith("/codex") ? pathname : `${pathname}/codex`;
4008
- return parsed.toString();
4009
- } catch (error) {
4010
- if (error instanceof Error && error.message === INVALID_CODEX_BASE_URL_MESSAGE) throw error;
4011
- }
4012
- if (normalized.includes("?") || normalized.includes("#")) throw new Error(INVALID_CODEX_BASE_URL_MESSAGE);
4013
- const path = normalized.replace(/\/+$/u, "");
4014
- if (path.endsWith("/codex/responses")) return path.slice(0, -10);
4015
- return path.endsWith("/codex") ? path : `${path}/codex`;
4016
- }
4017
- function resolveProviderSimpleCompletionApi(model) {
4018
- const parts = [
4019
- model.provider,
4020
- model.id,
4021
- model.api,
4022
- model.baseUrl || "default"
4023
- ];
4024
- return `${PROVIDER_SIMPLE_COMPLETION_API_PREFIX}${parts.map((part) => encodeURIComponent(part)).join(":")}`;
4025
- }
4026
- function applyProviderSimpleCompletionWrapper(registry, model, cfg) {
4027
- if (model.api.startsWith(PROVIDER_SIMPLE_COMPLETION_API_PREFIX)) return model;
4028
- const sourceProvider = registry.getApiProvider(model.api);
4029
- if (!sourceProvider) return model;
4030
- const sourceApi = model.api;
4031
- const sourceStreamFn = (runtimeModel, context, options) => sourceProvider.streamSimple(projectModel(runtimeModel, { api: sourceApi }), context, options);
4032
- const streamFn = getAiTransportHost().plugin.wrapSimpleCompletionStream({
4033
- provider: model.provider,
4034
- config: cfg,
4035
- context: {
4036
- config: cfg,
4037
- provider: model.provider,
4038
- modelId: model.id,
4039
- model,
4040
- streamFn: sourceStreamFn
4041
- }
4042
- });
4043
- if (!streamFn) return model;
4044
- const api = resolveProviderSimpleCompletionApi(model);
4045
- return registerCustomApi(registry, api, streamFn) ? projectModel(model, { api }) : model;
4046
- }
4047
- function prepareCodexSimpleTransportModel(registry, model, cfg) {
4048
- if (model.provider !== "openai" || model.api !== "openai-chatgpt-responses") return;
4049
- const transportModel = projectModel(model, { baseUrl: normalizeCodexResponsesBaseUrlForOpenAISdk(model.baseUrl) });
4050
- const api = resolveTransportAwareSimpleApi(model.api);
4051
- const streamFn = createOpenClawTransportStreamFnForModel(transportModel, { cfg });
4052
- if (!api || !streamFn) return;
4053
- if (!registerCustomApi(registry, api, streamFn)) return;
4054
- return projectModel(transportModel, { api });
4055
- }
4056
- function resolveModelHeaderSentinels(model) {
4057
- const headers = resolveAiTransportHeaderSentinels(model.headers);
4058
- return headers === model.headers ? model : projectModel(model, { headers });
4059
- }
4060
- function wrapPluginProviderStream(streamFn) {
4061
- return (model, context, options) => {
4062
- const host = getAiTransportHost();
4063
- const apiKey = options?.apiKey ? host.resolveSecretSentinel(options.apiKey) : options?.apiKey;
4064
- const headers = resolveAiTransportHeaderSentinels(options?.headers);
4065
- return streamFn(resolveModelHeaderSentinels(model), context, apiKey === options?.apiKey && headers === options?.headers ? options : {
4066
- ...options,
4067
- apiKey,
4068
- headers
4069
- });
4070
- };
4071
- }
4072
- function registerProviderStreamForModel(params) {
4073
- const pluginModel = resolveModelHeaderSentinels(params.model);
4074
- const providerStreamFn = getAiTransportHost().plugin.resolveProviderStream({
4075
- provider: params.model.provider,
4076
- config: params.cfg,
4077
- context: {
4078
- config: params.cfg,
4079
- provider: params.model.provider,
4080
- modelId: params.model.id,
4081
- model: pluginModel
4082
- }
4083
- });
4084
- const transportFallback = providerStreamFn ? void 0 : createTransportAwareStreamFnForModel(params.model.api === "google-generative-ai" ? pluginModel : params.model, { cfg: params.cfg });
4085
- const streamFn = providerStreamFn ? wrapPluginProviderStream(providerStreamFn) : transportFallback && params.model.api === "google-generative-ai" ? wrapPluginProviderStream(transportFallback) : transportFallback;
4086
- return streamFn && registerCustomApi(params.apiRegistry, params.model.api, streamFn) ? streamFn : void 0;
4087
- }
4088
- function prepareModelForSimpleCompletion(params) {
4089
- const { apiRegistry, model, cfg } = params;
4090
- if (!apiRegistry.getApiProvider(model.api) && registerProviderStreamForModel({
4091
- model,
4092
- cfg,
4093
- apiRegistry
4094
- })) return applyProviderSimpleCompletionWrapper(apiRegistry, model, cfg);
4095
- const codexTransportModel = prepareCodexSimpleTransportModel(apiRegistry, model, cfg);
4096
- if (codexTransportModel) return applyProviderSimpleCompletionWrapper(apiRegistry, codexTransportModel, cfg);
4097
- const transportAwareModel = prepareTransportAwareSimpleModel(model, { cfg });
4098
- if (transportAwareModel !== model) {
4099
- const streamFn = buildTransportAwareSimpleStreamFn(model, { cfg });
4100
- if (streamFn && registerCustomApi(apiRegistry, transportAwareModel.api, streamFn)) return applyProviderSimpleCompletionWrapper(apiRegistry, transportAwareModel, cfg);
4101
- }
4102
- if (model.api === "google-generative-ai") return applyProviderSimpleCompletionWrapper(apiRegistry, getAiTransportHost().prepareGoogleSimpleCompletionModel(apiRegistry, model), cfg);
4103
- if (model.provider === "anthropic-vertex") {
4104
- const api = resolveAnthropicVertexSimpleApi(model.baseUrl);
4105
- if (registerCustomApi(apiRegistry, api, getAiTransportHost().plugin.createAnthropicVertexStream(model))) return applyProviderSimpleCompletionWrapper(apiRegistry, projectModel(model, { api }), cfg);
4106
- }
4107
- return applyProviderSimpleCompletionWrapper(apiRegistry, model, cfg);
4108
- }
4109
- //#endregion
4110
- export { GEMINI_THOUGHT_SIGNATURE_VALIDATOR_SKIP, applyAnthropicEphemeralCacheControlMarkers, applyAnthropicPayloadPolicyToParams, applyOpenAIResponsesPayloadPolicy, assertCodeModeResponsesToolSurface, assignTransportErrorDetails, buildOpenAIClientHeaders, buildOpenAICompletionsParams, buildOpenAISdkClientOptions, buildOpenAISdkRequestOptions, buildTransportAwareSimpleStreamFn, canonicalizeMaxTokensParam, coerceTransportToolCallArguments, createAnthropicMessagesTransportStreamFn, createAzureOpenAIResponsesTransportStreamFn, createBoundaryAwareStreamFnForModel, createDeepSeekTextFilter, createEmptyTransportUsage, createModelStreamCooperativeScheduler, createOpenAICompletionsTransportStreamFn, createOpenAIResponsesTransportStreamFn, createOpenClawTransportStreamFnForModel, createTransportAwareStreamFnForModel, createWritableTransportEventStream, detectOpenAICompletionsCompat, emitModelTransportDebug, enforceCodeModeResponsesToolSurface, failTransportStream, filterCodeModePayloadTools, finalizeTransportStream, flattenCompletionMessagesToStringContent, formatModelTransportDebugBaseUrl, formatModelTransportDebugUrl, getCompat, hasOpenAICompatibleConversationTurn, isCodeModeModelVisibleToolName, isOpenAICodexResponsesModel, log, mergeTransportHeaders, mergeTransportMetadata, normalizeCodexResponsesBaseUrlForOpenAISdk, parseJsonObjectPreservingUnsafeIntegers, parseJsonPreservingUnsafeIntegers, prepareModelForSimpleCompletion, prepareTransportAwareSimpleModel, quoteUnsafeIntegerLiterals, readCodeModePayloadToolName, resolveAnthropicEphemeralCacheControl, resolveAnthropicMessagesUrl, resolveAnthropicPayloadPolicy, resolveCodeModeResponsesVisibleToolNames, resolveMaxTokensParam, resolveModelPayloadDebugMode, resolveModelSseDebugMode, resolveOpenAICompletionsCompat, resolveOpenAIReasoningEffortMap, resolveOpenAIResponsesPayloadPolicy, resolveOpenAIStrictToolFlagWithDiagnostics, resolvePromptCacheKey, resolveReplayableResponsesMessageId, resolveTransportAwareSimpleApi, sanitizeNonEmptyTransportPayloadText, sanitizeResponsesImagePayload, sanitizeTransportPayloadText, sortPromptCacheToolsByName as sortTransportToolsByName, stripCompletionMessagesToRoleContent, throwIfModelStreamAborted, transportAbortError, usesNativeOpenAICodexResponsesBackend };