@xiaobuyu/nodesign 0.0.1 → 0.0.2

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (282) hide show
  1. package/README.md +156 -106
  2. package/bin/nodesign.js +0 -0
  3. package/package.json +1 -1
  4. package/server/api/README.md +45 -45
  5. package/server/api/_guard.js +75 -75
  6. package/server/api/admin.js +187 -187
  7. package/server/api/assets/docx-page.js +103 -103
  8. package/server/api/assets/helpers.js +22 -22
  9. package/server/api/assets/notes.js +144 -144
  10. package/server/api/assets.js +896 -896
  11. package/server/api/board.js +57 -57
  12. package/server/api/browse.js +138 -138
  13. package/server/api/canvas.js +444 -444
  14. package/server/api/chatai.js +324 -324
  15. package/server/api/exports/build-standalone.js +980 -980
  16. package/server/api/exports/cards.js +118 -118
  17. package/server/api/exports/docx-pdf.js +46 -46
  18. package/server/api/exports/export-page.js +142 -142
  19. package/server/api/exports/handoff.js +147 -147
  20. package/server/api/exports.js +690 -690
  21. package/server/api/instruction.js +75 -75
  22. package/server/api/me.js +116 -116
  23. package/server/api/memory.js +185 -185
  24. package/server/api/pending-changes.js +366 -366
  25. package/server/api/plugins.js +164 -164
  26. package/server/api/projects.js +220 -220
  27. package/server/api/publish.js +64 -64
  28. package/server/api/recent.js +73 -73
  29. package/server/api/sessions.js +589 -589
  30. package/server/api/skills.js +77 -77
  31. package/server/api/standalone-fit.js +168 -168
  32. package/server/api/turn-compose.js +180 -180
  33. package/server/api/turn-inflight.js +44 -44
  34. package/server/auth/README.md +17 -17
  35. package/server/auth/middleware.js +138 -138
  36. package/server/auth/origin-guard.js +71 -71
  37. package/server/auth/session.js +108 -108
  38. package/server/auth/tier.js +113 -113
  39. package/server/auth/users-store.js +348 -348
  40. package/server/edit/README.md +29 -29
  41. package/server/engine/README.md +113 -113
  42. package/server/engine/agent/agent-shared.js +550 -550
  43. package/server/engine/agent/auto-mode-default-hard-deny.txt +4 -4
  44. package/server/engine/agent/auto-mode-rules.js +78 -78
  45. package/server/engine/agent/context.js +418 -418
  46. package/server/engine/agent/events.js +464 -464
  47. package/server/engine/agent/hooks/canvas-validate.js +199 -199
  48. package/server/engine/agent/hooks/failure.js +120 -120
  49. package/server/engine/agent/hooks/file-events.js +75 -75
  50. package/server/engine/agent/hooks/lifecycle.js +233 -233
  51. package/server/engine/agent/hooks/post-canvas-focus.js +80 -80
  52. package/server/engine/agent/hooks/post-guidance.js +206 -206
  53. package/server/engine/agent/hooks/post-subagent-report.js +104 -104
  54. package/server/engine/agent/hooks/post-trim.js +58 -58
  55. package/server/engine/agent/hooks/pre-board-neighborhood.js +34 -34
  56. package/server/engine/agent/hooks/pre-defaults.js +84 -84
  57. package/server/engine/agent/hooks/pre-injectors.js +277 -277
  58. package/server/engine/agent/hooks/pre-performance-log-guard.js +78 -78
  59. package/server/engine/agent/hooks/pre-starter-files.js +61 -61
  60. package/server/engine/agent/hooks/pre-workspace-scope-guard.js +78 -78
  61. package/server/engine/agent/hooks/site-validate.js +94 -94
  62. package/server/engine/agent/hooks/tool-prompts.js +31 -31
  63. package/server/engine/agent/hooks/turn-state-memory.js +56 -56
  64. package/server/engine/agent/hooks/user-prompt-submit.js +215 -215
  65. package/server/engine/agent/hooks.js +354 -354
  66. package/server/engine/agent/init-contract.js +69 -69
  67. package/server/engine/agent/isolation.js +159 -159
  68. package/server/engine/agent/model-table.js +292 -292
  69. package/server/engine/agent/plugin-loader.js +266 -266
  70. package/server/engine/agent/prompts/nodesign-prelude.md +336 -336
  71. package/server/engine/agent/prompts/tools/ask-user-question-protocol.md +71 -71
  72. package/server/engine/agent/prompts/tools/direct-edit-protocol.md +98 -98
  73. package/server/engine/agent/prompts/tools/generate-image-cookbook.gemini-gateway.md +583 -583
  74. package/server/engine/agent/prompts/tools/generate-image-cookbook.md +483 -483
  75. package/server/engine/agent/prompts/tools/hybrid-reference.md +100 -100
  76. package/server/engine/agent/prompts/tools/paint-still-cookbook.md +270 -270
  77. package/server/engine/agent/prompts/tools/roll-film-cookbook.md +70 -70
  78. package/server/engine/agent/prompts/tools/site-reference.md +106 -106
  79. package/server/engine/agent/prompts/tools/tweaks-syntax.md +125 -125
  80. package/server/engine/agent/prompts/tools/vision-checker-dispatch.md +48 -48
  81. package/server/engine/agent/session-loop.js +1024 -1024
  82. package/server/engine/agent/session-model.js +164 -164
  83. package/server/engine/agent/skill.js +204 -204
  84. package/server/engine/agent/task-events.js +78 -78
  85. package/server/engine/agents/ds-extractor.md +132 -132
  86. package/server/engine/agents/explorer.md +190 -190
  87. package/server/engine/agents/index.js +230 -230
  88. package/server/engine/agents/schemas/design-system.json +156 -156
  89. package/server/engine/agents/schemas/tweak-schema.json +113 -113
  90. package/server/engine/agents/tweak-proposer.md +127 -127
  91. package/server/engine/agents/vision-checker.md +254 -254
  92. package/server/engine/browse/capture.js +422 -422
  93. package/server/engine/browse/card.js +137 -137
  94. package/server/engine/browse/handover.js +59 -59
  95. package/server/engine/browse/page-digest.js +119 -119
  96. package/server/engine/browse/refs.js +196 -196
  97. package/server/engine/browse/registry.js +307 -307
  98. package/server/engine/browse/screencast.js +170 -170
  99. package/server/engine/browse/state.js +121 -121
  100. package/server/engine/chatai/chat-log.js +79 -79
  101. package/server/engine/chatai/index.js +193 -193
  102. package/server/engine/chatai/openai-compat.js +152 -152
  103. package/server/engine/chatai/orchestrate.js +309 -309
  104. package/server/engine/chatai/perform.js +40 -40
  105. package/server/engine/chatai/summarize.js +79 -79
  106. package/server/engine/mcp/capability-gate.js +52 -52
  107. package/server/engine/mcp/index.js +339 -339
  108. package/server/engine/mcp/param-sanitizer.js +142 -142
  109. package/server/engine/mcp/tools/arrange-on-board.js +124 -124
  110. package/server/engine/mcp/tools/artifact-session.js +278 -278
  111. package/server/engine/mcp/tools/browse-computer.js +421 -421
  112. package/server/engine/mcp/tools/browse-find-batch.js +183 -183
  113. package/server/engine/mcp/tools/browse-screenshot.js +157 -157
  114. package/server/engine/mcp/tools/browse.js +480 -480
  115. package/server/engine/mcp/tools/build-docx.js +101 -101
  116. package/server/engine/mcp/tools/clear-pending-changes.js +99 -99
  117. package/server/engine/mcp/tools/create-on-board.js +155 -155
  118. package/server/engine/mcp/tools/crystallize-skill.js +168 -168
  119. package/server/engine/mcp/tools/explain-style.js +237 -237
  120. package/server/engine/mcp/tools/export-handoff.js +133 -133
  121. package/server/engine/mcp/tools/expose-tweaks.js +149 -149
  122. package/server/engine/mcp/tools/generate-image.js +842 -842
  123. package/server/engine/mcp/tools/get-computed-styles.js +164 -164
  124. package/server/engine/mcp/tools/get-pending-changes.js +205 -205
  125. package/server/engine/mcp/tools/h3box-ssh.js +84 -84
  126. package/server/engine/mcp/tools/helpers/acquire-page.js +82 -82
  127. package/server/engine/mcp/tools/helpers/motion-lab.js +554 -554
  128. package/server/engine/mcp/tools/helpers/motion-scroll.js +112 -112
  129. package/server/engine/mcp/tools/helpers/perception-page.js +215 -215
  130. package/server/engine/mcp/tools/helpers/reference-download.js +103 -103
  131. package/server/engine/mcp/tools/helpers/rembg-bridge.py +80 -80
  132. package/server/engine/mcp/tools/helpers/shot-pipeline.js +280 -280
  133. package/server/engine/mcp/tools/highlight.js +68 -68
  134. package/server/engine/mcp/tools/list-pages.js +222 -222
  135. package/server/engine/mcp/tools/lookup-tags.js +59 -59
  136. package/server/engine/mcp/tools/navigate-to-page.js +60 -60
  137. package/server/engine/mcp/tools/organize-board.js +64 -64
  138. package/server/engine/mcp/tools/paint-still.js +434 -434
  139. package/server/engine/mcp/tools/pin-to-board.js +130 -130
  140. package/server/engine/mcp/tools/preview-deck.js +130 -130
  141. package/server/engine/mcp/tools/profile-scroll.js +305 -305
  142. package/server/engine/mcp/tools/publish-site.js +102 -102
  143. package/server/engine/mcp/tools/query-elements.js +195 -195
  144. package/server/engine/mcp/tools/read-board.js +103 -103
  145. package/server/engine/mcp/tools/read-document.js +93 -93
  146. package/server/engine/mcp/tools/read-page.js +264 -264
  147. package/server/engine/mcp/tools/read-tavern-json.js +143 -143
  148. package/server/engine/mcp/tools/record-decision.js +140 -140
  149. package/server/engine/mcp/tools/relate-on-board.js +110 -110
  150. package/server/engine/mcp/tools/report-issue.js +115 -115
  151. package/server/engine/mcp/tools/roll-film.js +266 -266
  152. package/server/engine/mcp/tools/screenshot-docx.js +138 -138
  153. package/server/engine/mcp/tools/screenshot-url.js +195 -195
  154. package/server/engine/mcp/tools/screenshot.js +583 -583
  155. package/server/engine/mcp/tools/tier-gate.js +96 -96
  156. package/server/engine/mcp/tools/trace-motion.js +215 -215
  157. package/server/engine/mcp/tools/web-search.js +548 -548
  158. package/server/engine/motion/inventory.js +349 -349
  159. package/server/engine/perception/session.js +235 -235
  160. package/server/engine/plugins/nodesign/.claude-plugin/plugin.json +5 -5
  161. package/server/engine/plugins/nodesign/skills/deskskill-engine-mini/SKILL.md +192 -192
  162. package/server/engine/plugins/nodesign/skills/deskskill-engine-mini/canvas.template.html +667 -667
  163. package/server/engine/plugins/nodesign/skills/deskskill-engine-mini/patterns/hybrid-grid.md +22 -22
  164. package/server/engine/plugins/nodesign/skills/deskskill-engine-mini/patterns/image-led-cover.md +25 -25
  165. package/server/engine/plugins/nodesign/skills/deskskill-engine-mini/patterns/portrait.md +23 -23
  166. package/server/engine/plugins/nodesign/skills/deskskill-engine-mini/patterns/quote-backdrop.md +21 -21
  167. package/server/engine/plugins/nodesign/skills/deskskill-engine-mini/patterns/section-divider.md +23 -23
  168. package/server/engine/plugins/nodesign/skills/deskskill-engine-mini/patterns/text-led.md +21 -21
  169. package/server/engine/plugins/nodesign/skills/docx-craft/SKILL.md +162 -162
  170. package/server/engine/plugins/nodesign/skills/docx-craft/references/token-schema.md +407 -407
  171. package/server/engine/plugins/nodesign/skills/docx-craft//346/226/207/346/241/243.template.json +80 -80
  172. package/server/engine/plugins/nodesign/skills/rp-craft/SKILL.md +228 -228
  173. package/server/engine/plugins/nodesign/skills/rp-craft/patterns//346/274/224/345/207/272/351/241/265-/346/234/200/345/260/217/345/256/236/347/216/260.html +78 -78
  174. package/server/engine/plugins/nodesign/skills/rp-craft//346/274/224/345/207/272.template.js +268 -268
  175. package/server/engine/plugins/nodesign/skills/site-craft/SKILL.md +323 -323
  176. package/server/engine/plugins/nodesign/skills/site-craft/patterns/build-lane.md +134 -134
  177. package/server/engine/plugins/nodesign/skills/site-craft/patterns/cutout-collage.md +61 -61
  178. package/server/engine/plugins/nodesign/skills/site-craft/patterns/mock-app.md +163 -163
  179. package/server/engine/plugins/nodesign/skills/site-craft/patterns/page-transitions.md +86 -86
  180. package/server/engine/runs/active-runs.js +698 -698
  181. package/server/engine/runs/live-turn.js +252 -252
  182. package/server/engine/runs/store.js +364 -364
  183. package/server/engine/runs/turn-relay.js +217 -217
  184. package/server/engine/runtime/workspace.js +164 -164
  185. package/server/lib/artifact-file-path.js +80 -80
  186. package/server/lib/artifact-target.js +284 -284
  187. package/server/lib/asset-refs.js +239 -239
  188. package/server/lib/async-queue.js +104 -104
  189. package/server/lib/auto-relations.js +130 -130
  190. package/server/lib/binding-types.js +60 -60
  191. package/server/lib/board-kind-sizes.js +62 -62
  192. package/server/lib/board-relations.js +133 -133
  193. package/server/lib/browse-proxy.js +180 -180
  194. package/server/lib/canvas-id.js +36 -36
  195. package/server/lib/cover.js +227 -227
  196. package/server/lib/danbooru-tags.js +291 -291
  197. package/server/lib/doc-extract.js +156 -156
  198. package/server/lib/docx/build-from-source.js +260 -260
  199. package/server/lib/docx/build.js +490 -490
  200. package/server/lib/docx/dump-styles.js +287 -287
  201. package/server/lib/docx/fonts/nodesign-cjk.conf +164 -164
  202. package/server/lib/docx/merge-runs.js +129 -129
  203. package/server/lib/docx/numbering.js +218 -218
  204. package/server/lib/docx/order.js +152 -152
  205. package/server/lib/docx/rawzip.js +172 -172
  206. package/server/lib/docx/render.js +92 -92
  207. package/server/lib/docx/text-lint.js +225 -225
  208. package/server/lib/docx/tokens.js +335 -335
  209. package/server/lib/docx/units.js +29 -29
  210. package/server/lib/docx/xml.js +291 -291
  211. package/server/lib/docx-pages.js +187 -187
  212. package/server/lib/export-collect.js +289 -289
  213. package/server/lib/export-package.js +210 -210
  214. package/server/lib/html-srcset.js +145 -145
  215. package/server/lib/image-variant.js +460 -460
  216. package/server/lib/ingress/forward-openai-chat.js +305 -305
  217. package/server/lib/ingress/openai-chat.js +491 -491
  218. package/server/lib/ingress/session-notice.js +66 -66
  219. package/server/lib/ingress/session-routes.js +68 -68
  220. package/server/lib/ingress/slot-probe.js +130 -130
  221. package/server/lib/ingress/upstream-billing.js +52 -52
  222. package/server/lib/ingress/upstream-fail-streak.js +72 -72
  223. package/server/lib/ingress/upstream-truncation.js +48 -48
  224. package/server/lib/issues-store.js +182 -182
  225. package/server/lib/kinds/deck.js +72 -72
  226. package/server/lib/kinds/docx.js +283 -283
  227. package/server/lib/kinds/file-kinds.js +113 -113
  228. package/server/lib/kinds/index.js +202 -202
  229. package/server/lib/kinds/site.js +161 -161
  230. package/server/lib/model-ingress.js +543 -543
  231. package/server/lib/moderation.js +255 -255
  232. package/server/lib/notice-store.js +103 -103
  233. package/server/lib/plugin-install.js +104 -104
  234. package/server/lib/plugin-validator.js +721 -721
  235. package/server/lib/publish-store.js +115 -115
  236. package/server/lib/quick-summary.js +52 -52
  237. package/server/lib/quota.js +270 -270
  238. package/server/lib/rate-window.js +29 -29
  239. package/server/lib/reference-assets.js +92 -92
  240. package/server/lib/region-shot.js +135 -135
  241. package/server/lib/safe-path.js +73 -73
  242. package/server/lib/sdk-session.js +33 -33
  243. package/server/lib/showcase-store.js +92 -92
  244. package/server/lib/site-publish.js +465 -465
  245. package/server/lib/ssrf-guard.js +432 -432
  246. package/server/lib/task-scan.js +158 -158
  247. package/server/lib/tavern-json.js +154 -154
  248. package/server/lib/video-variant.js +237 -237
  249. package/server/lib/workspace-path.js +33 -33
  250. package/server/ops/fix-sdk-musl.mjs +40 -40
  251. package/server/ops/install-macos-fonts.sh +114 -114
  252. package/server/ops/macos-fonts.conf +336 -336
  253. package/server/ops/sandbox-shim/bwrap +57 -57
  254. package/server/projects/assets-summary.js +119 -119
  255. package/server/projects/auto-name.js +53 -53
  256. package/server/projects/board-store.js +640 -640
  257. package/server/projects/move-entry.js +103 -103
  258. package/server/projects/store.js +270 -270
  259. package/server/projects/ui-config.js +54 -54
  260. package/server/projects/workspace-templates.js +53 -53
  261. package/server/projects/workspace.js +1025 -1025
  262. package/server/runtime/local-config.js +177 -177
  263. package/server/runtime/profile.js +72 -72
  264. package/server/services/rembg-service.py +334 -334
  265. package/server/shared/README.md +25 -25
  266. package/server/shared/deck.js +54 -54
  267. package/server/shared/time.js +49 -49
  268. package/server/style-pipeline/README.md +53 -53
  269. package/server/ws/broker.js +36 -36
  270. package/server/ws/browse-channel.js +177 -177
  271. package/server/ws/index.js +386 -386
  272. package/web/README.md +89 -89
  273. package/web/dist/assets/BrowserWindow-BYCgizHw.js +11 -0
  274. package/web/dist/assets/{DeckWindow-4G0xX7P3.js → DeckWindow-pNydEM4L.js} +1 -1
  275. package/web/dist/assets/{DocxWindow-BXQsoPkh.js → DocxWindow-PPgzh3Gq.js} +1 -1
  276. package/web/dist/assets/{SiteWindow-D6eS-2gM.js → SiteWindow-DM0LQPCO.js} +1 -1
  277. package/web/dist/assets/{index-Cbl3ATvp.js → index-BHTBJlpY.js} +32 -32
  278. package/web/dist/assets/{pending-edit-apply-DTjo2geW.js → pending-edit-apply-C0I13CbD.js} +1 -1
  279. package/web/dist/assets/{rotate-cw-LMT3x1Zj.js → rotate-cw-B1UQ8Hld.js} +1 -1
  280. package/web/dist/assets/{square-dashed-mouse-pointer-CBoAkfhi.js → square-dashed-mouse-pointer-8lrgqmfv.js} +1 -1
  281. package/web/dist/index.html +17 -17
  282. package/web/dist/assets/BrowserWindow-Dc7J7CYc.js +0 -11
@@ -1,305 +1,305 @@
1
- /**
2
- * lib/ingress/forward-openai-chat.js — openai-chat 协议上游的转发体(08-21)。
3
- * 从 model-ingress.js 拆出来(行数棘轮):转换在 ./openai-chat.js,这里只管 HTTP 往返。
4
- * 调用方给 target/path/agent(出站连接池与 joinPath 住 model-ingress,不反向依赖)。
5
- *
6
- * ## 就地重发(08-21 夜,跟 OpenCode 对齐)
7
- *
8
- * Zen 常常"只想了没说就把流断了"(无 finish_reason、零可见输出;08-21 生产 8 次)。以前我们
9
- * 发 error 事件让 CLI 重试 —— 但 CLI 对流内 error 只试 4 次,用户看到的就是一句失败文案。
10
- * OpenCode 的做法是:这种收尾归成 `unknown`,**它自己的回合循环直接再打一次模型**,对用户隐形
11
- * (见 prompt.ts 的 `!["tool-calls","unknown"].includes(finish)`)。我们隔着 CLI 学不了它的循环,
12
- * 但可以在**同一条 SSE 里**重发:客户端只看到一条消息,块号接着往下排。
13
- *
14
- * 只有「零可见输出 + 收尾原因不可信」才重发(转换层 verdict() 的 'empty'):
15
- * - 说了一半被掐 → 不重发,走 session-loop 的续接(正文已经流给用户了,重发会重复)
16
- * - 已知 finish(stop/length)+ 零可见 → 不重发,上游明说它收完了(OpenCode 同样不重试)
17
- * 额度:NODESIGN_INGRESS_EMPTY_RETRIES(默认 2)+ 墙钟预算 NODESIGN_INGRESS_RETRY_BUDGET_MS
18
- * (默认 120s,超了就不再开新的一发 —— Zen 一发能挂 185 秒,不设预算会把回合拖过 CLI 自己的
19
- * 300 秒流空闲超时)。等待期间发 `event: ping` 保活(Anthropic 官方流也发 ping,SDK 会忽略)。
20
- */
21
- import http from 'node:http';
22
- import https from 'node:https';
23
- import { toOpenAIChatRequest, fromOpenAIChatResponse, toAnthropicError, OpenAIToAnthropicSSE, truncationOfChatResponse } from './openai-chat.js';
24
-
25
- export const DEFAULT_EMPTY_RETRIES = 2;
26
- export const DEFAULT_RETRY_BUDGET_MS = 120_000;
27
- export const RETRY_DELAY_MS = 1_000;
28
- const PING_INTERVAL_MS = 15_000;
29
-
30
- /** 零可见输出时最多再打几发(0 = 关掉就地重发) */
31
- export function emptyRetryLimit(env = process.env) {
32
- const v = Number(env.NODESIGN_INGRESS_EMPTY_RETRIES);
33
- return Number.isFinite(v) && v >= 0 ? v : DEFAULT_EMPTY_RETRIES;
34
- }
35
- /** 墙钟预算:已经花掉这么久就不再开新的一发 */
36
- export function retryBudgetMs(env = process.env) {
37
- const v = Number(env.NODESIGN_INGRESS_RETRY_BUDGET_MS);
38
- return Number.isFinite(v) && v > 0 ? v : DEFAULT_RETRY_BUDGET_MS;
39
- }
40
-
41
- /**
42
- * OpenAI chat 上游:请求体转换 → POST <base>/chat/completions → 响应转回 Anthropic
43
- * (流式走 OpenAIToAnthropicSSE,非流式整包转,错误体转 Anthropic error 形状)。
44
- * ⚠️ 不转发 binary 带来的任何请求头(anthropic-version/beta 头对它无意义,UA 要自己给:
45
- * Cloudflare 对某些默认 UA 回 1010)。
46
- *
47
- * 回调:
48
- * onOutcome(ok, reason) 每个**客户端请求**报一次最终结果(不是每一发上游)→ 会话连续失败计数
49
- * onBilling({costUsd,usage}) 上游自报的费用/用量(含重发那几发,账要算它们)
50
- * onTruncated(reason|null) 这次往返是不是「说到一半被掐」→ session-loop 续接
51
- * onNotice(text) 想让用户看见的一句话(就地重发时说一声,别让人对着不动的绿点干等)
52
- */
53
- export function forwardOpenAIChat({ parsed, wire, key, res, sidShort, target, path, agent, onOutcome = () => {}, onBilling = () => {}, onTruncated = () => {}, onNotice = () => {} }) {
54
- const wantStream = !!parsed.stream;
55
- const label = wire.upstream?.label || wire.upstreamId;
56
- const body = toOpenAIChatRequest(parsed, { reasoningEffort: wire.reasoningEffort, maxOutput: wire.maxOutput });
57
- const outBody = Buffer.from(JSON.stringify(body), 'utf8');
58
- const useHttps = target.protocol === 'https:';
59
- const headers = {
60
- host: target.hostname,
61
- 'content-type': 'application/json',
62
- 'content-length': String(outBody.length),
63
- accept: wantStream ? 'text/event-stream' : 'application/json',
64
- 'user-agent': 'NoDesign-ingress/1 (+https://nodesign.xiaobuyu.trade)',
65
- authorization: `Bearer ${key}`,
66
- };
67
- const t0 = Date.now();
68
-
69
- /**
70
- * 发一发上游。onError 由调用方给 —— ⛔ **这里绝不碰 res**:
71
- * 流式那边 res 的收尾权只有一个主人(attemptOver → finish/failHard),
72
- * 谁顺手 `res.end()` 一下,正在等重发的那条流就死在半空(08-21 夜评审 P0 就是这么来的:
73
- * 上游 RST 时 req 的 'error' 先到、把流封了,1 秒后重发的输出全丢,客户端拿到一条没有
74
- * message_stop 也没有 error 的死流,回合永不收场,上游还被打满额度)。
75
- */
76
- const request = (onResponse, onError) => {
77
- const req = (useHttps ? https : http).request({
78
- hostname: target.hostname,
79
- port: target.port || (useHttps ? 443 : 80),
80
- path,
81
- method: 'POST',
82
- headers,
83
- agent,
84
- }, onResponse);
85
- req.on('error', (err) => {
86
- const detail = err.code ? `${err.code}: ${err.message}` : err.message;
87
- console.error(`[model-ingress] forward error (${wire.upstreamId}): ${detail}`);
88
- onError(detail);
89
- });
90
- req.write(outBody);
91
- req.end();
92
- return req;
93
- };
94
-
95
- // ── 流式:一条 SSE,可能跨多发上游 ──
96
- if (wantStream) {
97
- const xf = new OpenAIToAnthropicSSE({ model: parsed.model, label });
98
- // 每一发 pipe 进来都会在 xf 上挂一组监听器(drain/error/close/finish/unpipe)。放宽重发次数后
99
- // 会顶到 Node 默认的 10 个上限刷 MaxListeners 告警 —— 收尾时 unpipe(见 attemptOver)是正解,
100
- // 这条只是保险,别让告警刷屏盖住真问题。
101
- xf.setMaxListeners(64);
102
- let pingTimer = null;
103
- let streaming = false; // 已经 writeHead(200) 并把 xf 接到 res 上了吗
104
- let dead = false; // 客户端走了(点了停止 / 关了页面):立刻停手,别再打上游
105
- let currentReq = null; // 在飞的那一发,客户端一走就掐掉
106
- let retryTimer = null;
107
- let outcomeReported = false;
108
- // 一个客户端请求只报一次结果 —— 会话连续失败计数按"请求"算,报重了止损会提前触发
109
- const report = (ok, reason) => { if (outcomeReported) return; outcomeReported = true; onOutcome(ok, reason); };
110
-
111
- const stopPing = () => { if (pingTimer) { clearInterval(pingTimer); pingTimer = null; } };
112
- const startPing = () => {
113
- stopPing();
114
- pingTimer = setInterval(() => {
115
- // 只在"两发之间"发:此刻没有块在流,不会跟转换层的输出交错
116
- if (dead || res.writableEnded) { stopPing(); return; }
117
- try { res.write('event: ping\ndata: {"type":"ping"}\n\n'); } catch { stopPing(); }
118
- }, PING_INTERVAL_MS);
119
- pingTimer.unref?.();
120
- };
121
-
122
- // ⛔ 客户端断开(用户点停止 / 关页面)后,重发链会**继续打上游**:烧 token、没人收、
123
- // 而且 xf 的 'end' 永远不来(pipe 被 unpipe 了)→ onOutcome/onBilling 一次都不触发,
124
- // 这几发的账和失败计数全部消失(08-21 夜评审 P1)。
125
- res.on('close', () => {
126
- // ⚠️ 判据是 writableEnded 而不是 xf.done:**我们自己**回的 HTTP 错误体(第一发就 503)
127
- // 也会触发 close,那时 xf 根本没用过。用 xf.done 当判据会把它误判成"客户端断开",
128
- // 于是同一个请求报两次失败 → 止损计数翻倍 → 用户第 2 个 503 就吃 400(探针实测)。
129
- if (res.writableEnded) return;
130
- dead = true;
131
- stopPing();
132
- if (retryTimer) { clearTimeout(retryTimer); retryTimer = null; }
133
- try { currentReq?.destroy(); } catch { /* */ }
134
- console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} 客户端断开,停止重发(已打 ${xf.attempts} 发)`);
135
- report(false, 'client disconnected');
136
- if (xf.usageTotal || xf.cost != null) onBilling({ costUsd: xf.cost, usage: xf.usageTotal });
137
- });
138
-
139
- xf.on('error', (err) => {
140
- console.error(`[model-ingress] sse transform error: ${err.message}`);
141
- stopPing();
142
- report(false, `transform: ${err.message}`);
143
- try { res.end(); } catch { /* ignore */ }
144
- });
145
- xf.on('end', () => {
146
- stopPing();
147
- if (dead) return; // 账在 res 'close' 那里已经结过了
148
- report(!xf.failReason, xf.failReason || '');
149
- onTruncated(xf.truncated);
150
- // ⭐ 记账用**累计**(失败那几发也烧了上游的 token);给 CLI 的 message_delta 用最后一发(见 openai-chat.js)
151
- if (xf.cost != null || xf.usageTotal) onBilling({ costUsd: xf.cost, usage: xf.usageTotal });
152
- });
153
-
154
- const finish = (verdict) => { stopPing(); xf.finalize(verdict); xf.end(); };
155
- /** 还没开始流就失败:回真正的 HTTP 状态码(CLI 据此退避重试);已经在流里了:以 error 事件收场 */
156
- const failHard = (status, msg, reason) => {
157
- stopPing();
158
- if (!streaming) {
159
- report(false, reason);
160
- const errBody = JSON.stringify(toAnthropicError(status, msg));
161
- try {
162
- res.writeHead(status, { 'Content-Type': 'application/json', 'Content-Length': String(Buffer.byteLength(errBody)) });
163
- res.end(errBody);
164
- } catch { /* 客户端已经走了 */ }
165
- return;
166
- }
167
- report(false, reason);
168
- xf.failWith(toAnthropicError(status, msg).error.message, reason); // 走 failWith:置 done,_flush 不会再补第二条 error
169
- xf.end();
170
- };
171
- // 额度按**行**取(model-context 的 api.emptyRetries / api.retryBudgetMs),行内没写才走全局默认。
172
- // 这是模型体质问题不是协议问题:Ox 两个主行放宽到 6 次 / 360 秒,别的行照旧 2 次 / 120 秒。
173
- const maxRetries = Number.isFinite(wire.emptyRetries) ? wire.emptyRetries : emptyRetryLimit();
174
- const budgetMs = Number.isFinite(wire.retryBudgetMs) ? wire.retryBudgetMs : retryBudgetMs();
175
- /** 重发额度还够吗(次数 + 墙钟预算 + 客户端还在) */
176
- const canRetry = () => !dead && (xf.attempts - 1) < maxRetries && (Date.now() - t0) < budgetMs;
177
-
178
- const runAttempt = () => {
179
- if (dead) return;
180
- let over = false;
181
- let proxyRes = null;
182
- /**
183
- * 这一发结束(干净 EOF / RST / 连不上都走这里 —— res 的收尾权只有它一个主人)。
184
- * @param {string|null} why 非空 = 异常收场的原因
185
- * @param {boolean} hadResponse 拿到过响应头吗(没拿到 = 连都没连上,判决交给转换层的既有状态)
186
- */
187
- const attemptOver = (why, hadResponse = true) => {
188
- if (over || dead) return;
189
- over = true;
190
- currentReq = null;
191
- if (why) console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} 这一发异常收场(${why})`);
192
- try { proxyRes?.unpipe?.(xf); } catch { /* 已经断了就算了 */ } // 解开这一发的 pipe,别让监听器一发发攒着
193
- const verdict = xf.attemptEnd();
194
- if (verdict.kind !== 'empty') { finish(verdict); return; }
195
- if (!canRetry()) {
196
- console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} 零可见输出(${verdict.reason}),重发额度用完(第 ${xf.attempts} 发,已花 ${Math.round((Date.now() - t0) / 1000)}s)`);
197
- if (!streaming) { failHard(502, `${label}${hadResponse ? '返回了空响应' : '连不上'}(${why || verdict.reason})—— 已自动重发仍失败,稍后再发一次`, verdict.reason); return; }
198
- finish(verdict);
199
- return;
200
- }
201
- console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} 零可见输出(${verdict.reason})→ 就地重发第 ${xf.attempts} 次`);
202
- onNotice(`${label}这一发只想了没说就断了,正在原地重发(第 ${xf.attempts} 次),稍等一下别刷新。`);
203
- startPing();
204
- retryTimer = setTimeout(() => { retryTimer = null; if (dead) return; xf.beginAttempt(); runAttempt(); }, RETRY_DELAY_MS);
205
- };
206
-
207
- currentReq = request((incoming) => {
208
- proxyRes = incoming;
209
- const status = proxyRes.statusCode || 502;
210
- if (status >= 400) {
211
- const chunks = [];
212
- let settled = false;
213
- const done = (text) => {
214
- if (settled || dead) return;
215
- settled = true;
216
- currentReq = null;
217
- const msg = text?.trim() ? text : `${label} 上游返回 ${status}(模型暂时不可用,稍后再发一次)`;
218
- console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} ${status} model=${wire.wireModel} body=${String(text || '').slice(0, 200).replace(/\s+/g, ' ')}`);
219
- failHard(status, msg, `HTTP ${status}${streaming ? ' on retry' : ''}`);
220
- };
221
- proxyRes.on('data', (c) => chunks.push(c));
222
- proxyRes.on('aborted', () => done(''));
223
- proxyRes.on('error', (err) => done(`${label} 上游返回 ${status},响应还没传完就断了(${err.code || err.message})`));
224
- proxyRes.on('end', () => done(Buffer.concat(chunks).toString('utf8')));
225
- return;
226
- }
227
-
228
- stopPing();
229
- if (!streaming) {
230
- streaming = true;
231
- res.writeHead(200, { 'Content-Type': 'text/event-stream; charset=utf-8', 'Cache-Control': 'no-cache', Connection: 'keep-alive' });
232
- xf.pipe(res);
233
- }
234
- proxyRes.on('aborted', () => attemptOver('aborted'));
235
- proxyRes.on('error', (err) => attemptOver(err.code || err.message));
236
- proxyRes.on('end', () => attemptOver(null));
237
- proxyRes.pipe(xf, { end: false }); // end:false —— 这条 SSE 还要接着用(可能再打一发)
238
- }, (detail) => attemptOver(detail, false)); // 连不上 / RST:同一条判决路,绝不自己碰 res
239
- };
240
- runAttempt();
241
- return;
242
- }
243
-
244
- // ── 非流式(CLI 的兜底通路):整包转,不做就地重发 ──
245
- request((proxyRes) => {
246
- const status = proxyRes.statusCode || 502;
247
- const chunks = [];
248
- let settled = false;
249
- proxyRes.on('data', (c) => chunks.push(c));
250
- // 上游半路掐了,'end' 不来 —— 别让请求悬着,就地回 502(CLI 会重试)
251
- proxyRes.on('aborted', () => proxyRes.emit('error', Object.assign(new Error('upstream aborted'), { code: 'ECONNRESET' })));
252
- proxyRes.on('error', (err) => {
253
- if (settled) return;
254
- settled = true;
255
- const detail = err.code || err.message;
256
- console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} 非流式响应被掐断(${detail})`);
257
- onOutcome(false, `upstream stream aborted: ${detail}`);
258
- if (res.headersSent) { try { res.end(); } catch { /* */ } return; }
259
- const errBody = JSON.stringify(toAnthropicError(502, `${label} 的响应传到一半断了(${detail})—— 稍后再发一次`));
260
- res.writeHead(502, { 'Content-Type': 'application/json' }); res.end(errBody);
261
- });
262
- proxyRes.on('end', () => {
263
- if (settled) return;
264
- settled = true;
265
- const text = Buffer.concat(chunks).toString('utf8');
266
- if (status >= 400) {
267
- console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} ${status} model=${wire.wireModel} body=${text.slice(0, 200).replace(/\s+/g, ' ')}`);
268
- const msg = text.trim() ? text : `${label} 上游返回 ${status}(模型暂时不可用,稍后再发一次)`;
269
- onOutcome(false, `HTTP ${status}`);
270
- const errBody = JSON.stringify(toAnthropicError(status, msg));
271
- res.writeHead(status, { 'Content-Type': 'application/json', 'Content-Length': String(Buffer.byteLength(errBody)) });
272
- res.end(errBody);
273
- return;
274
- }
275
- let out;
276
- let upstreamJson;
277
- try { upstreamJson = JSON.parse(text); out = fromOpenAIChatResponse(upstreamJson); }
278
- catch (err) {
279
- const errBody = JSON.stringify(toAnthropicError(502, `ingress: upstream JSON unreadable (${err.message})`));
280
- res.writeHead(502, { 'Content-Type': 'application/json' }); res.end(errBody); return;
281
- }
282
- if (!out) { // 200 但没有 choices / 私货 finish_reason 且零可见输出:别包成成功
283
- const alienFinish = upstreamJson?.choices?.[0]?.finish_reason;
284
- const msg = upstreamJson?.error?.message
285
- || (alienFinish
286
- ? `${label}以 ${alienFinish} 结束了这次请求,没有输出任何正文 —— 上游自己的链路出错,已自动重试仍失败;稍后再发,或换个模型(upstream ended with finish_reason='${alienFinish}' and no visible output)`
287
- : `${label}返回了空响应,一个字都没有 —— 上游问题,已自动重试仍失败;稍后再发,或换个模型(upstream returned no choices)`);
288
- console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} 200-but-empty model=${wire.wireModel} ${String(msg).slice(0, 160)}`);
289
- onOutcome(false, String(msg).slice(0, 120));
290
- const errBody = JSON.stringify(toAnthropicError(502, String(msg)));
291
- res.writeHead(502, { 'Content-Type': 'application/json' }); res.end(errBody); return;
292
- }
293
- onOutcome(true);
294
- onTruncated(truncationOfChatResponse(upstreamJson));
295
- if (upstreamJson.cost != null || upstreamJson.usage) onBilling({ costUsd: upstreamJson.cost ?? null, usage: upstreamJson.usage || null });
296
- const respBody = JSON.stringify(out);
297
- res.writeHead(200, { 'Content-Type': 'application/json', 'Content-Length': String(Buffer.byteLength(respBody)) });
298
- res.end(respBody);
299
- });
300
- }, (detail) => {
301
- onOutcome(false, `forward: ${detail}`);
302
- if (res.headersSent) { try { res.end(); } catch { /* */ } return; }
303
- try { res.writeHead(502); res.end(`ingress forward error: ${detail}`); } catch { /* ignore */ }
304
- });
305
- }
1
+ /**
2
+ * lib/ingress/forward-openai-chat.js — openai-chat 协议上游的转发体(08-21)。
3
+ * 从 model-ingress.js 拆出来(行数棘轮):转换在 ./openai-chat.js,这里只管 HTTP 往返。
4
+ * 调用方给 target/path/agent(出站连接池与 joinPath 住 model-ingress,不反向依赖)。
5
+ *
6
+ * ## 就地重发(08-21 夜,跟 OpenCode 对齐)
7
+ *
8
+ * Zen 常常"只想了没说就把流断了"(无 finish_reason、零可见输出;08-21 生产 8 次)。以前我们
9
+ * 发 error 事件让 CLI 重试 —— 但 CLI 对流内 error 只试 4 次,用户看到的就是一句失败文案。
10
+ * OpenCode 的做法是:这种收尾归成 `unknown`,**它自己的回合循环直接再打一次模型**,对用户隐形
11
+ * (见 prompt.ts 的 `!["tool-calls","unknown"].includes(finish)`)。我们隔着 CLI 学不了它的循环,
12
+ * 但可以在**同一条 SSE 里**重发:客户端只看到一条消息,块号接着往下排。
13
+ *
14
+ * 只有「零可见输出 + 收尾原因不可信」才重发(转换层 verdict() 的 'empty'):
15
+ * - 说了一半被掐 → 不重发,走 session-loop 的续接(正文已经流给用户了,重发会重复)
16
+ * - 已知 finish(stop/length)+ 零可见 → 不重发,上游明说它收完了(OpenCode 同样不重试)
17
+ * 额度:NODESIGN_INGRESS_EMPTY_RETRIES(默认 2)+ 墙钟预算 NODESIGN_INGRESS_RETRY_BUDGET_MS
18
+ * (默认 120s,超了就不再开新的一发 —— Zen 一发能挂 185 秒,不设预算会把回合拖过 CLI 自己的
19
+ * 300 秒流空闲超时)。等待期间发 `event: ping` 保活(Anthropic 官方流也发 ping,SDK 会忽略)。
20
+ */
21
+ import http from 'node:http';
22
+ import https from 'node:https';
23
+ import { toOpenAIChatRequest, fromOpenAIChatResponse, toAnthropicError, OpenAIToAnthropicSSE, truncationOfChatResponse } from './openai-chat.js';
24
+
25
+ export const DEFAULT_EMPTY_RETRIES = 2;
26
+ export const DEFAULT_RETRY_BUDGET_MS = 120_000;
27
+ export const RETRY_DELAY_MS = 1_000;
28
+ const PING_INTERVAL_MS = 15_000;
29
+
30
+ /** 零可见输出时最多再打几发(0 = 关掉就地重发) */
31
+ export function emptyRetryLimit(env = process.env) {
32
+ const v = Number(env.NODESIGN_INGRESS_EMPTY_RETRIES);
33
+ return Number.isFinite(v) && v >= 0 ? v : DEFAULT_EMPTY_RETRIES;
34
+ }
35
+ /** 墙钟预算:已经花掉这么久就不再开新的一发 */
36
+ export function retryBudgetMs(env = process.env) {
37
+ const v = Number(env.NODESIGN_INGRESS_RETRY_BUDGET_MS);
38
+ return Number.isFinite(v) && v > 0 ? v : DEFAULT_RETRY_BUDGET_MS;
39
+ }
40
+
41
+ /**
42
+ * OpenAI chat 上游:请求体转换 → POST <base>/chat/completions → 响应转回 Anthropic
43
+ * (流式走 OpenAIToAnthropicSSE,非流式整包转,错误体转 Anthropic error 形状)。
44
+ * ⚠️ 不转发 binary 带来的任何请求头(anthropic-version/beta 头对它无意义,UA 要自己给:
45
+ * Cloudflare 对某些默认 UA 回 1010)。
46
+ *
47
+ * 回调:
48
+ * onOutcome(ok, reason) 每个**客户端请求**报一次最终结果(不是每一发上游)→ 会话连续失败计数
49
+ * onBilling({costUsd,usage}) 上游自报的费用/用量(含重发那几发,账要算它们)
50
+ * onTruncated(reason|null) 这次往返是不是「说到一半被掐」→ session-loop 续接
51
+ * onNotice(text) 想让用户看见的一句话(就地重发时说一声,别让人对着不动的绿点干等)
52
+ */
53
+ export function forwardOpenAIChat({ parsed, wire, key, res, sidShort, target, path, agent, onOutcome = () => {}, onBilling = () => {}, onTruncated = () => {}, onNotice = () => {} }) {
54
+ const wantStream = !!parsed.stream;
55
+ const label = wire.upstream?.label || wire.upstreamId;
56
+ const body = toOpenAIChatRequest(parsed, { reasoningEffort: wire.reasoningEffort, maxOutput: wire.maxOutput });
57
+ const outBody = Buffer.from(JSON.stringify(body), 'utf8');
58
+ const useHttps = target.protocol === 'https:';
59
+ const headers = {
60
+ host: target.hostname,
61
+ 'content-type': 'application/json',
62
+ 'content-length': String(outBody.length),
63
+ accept: wantStream ? 'text/event-stream' : 'application/json',
64
+ 'user-agent': 'NoDesign-ingress/1 (+https://nodesign.xiaobuyu.trade)',
65
+ authorization: `Bearer ${key}`,
66
+ };
67
+ const t0 = Date.now();
68
+
69
+ /**
70
+ * 发一发上游。onError 由调用方给 —— ⛔ **这里绝不碰 res**:
71
+ * 流式那边 res 的收尾权只有一个主人(attemptOver → finish/failHard),
72
+ * 谁顺手 `res.end()` 一下,正在等重发的那条流就死在半空(08-21 夜评审 P0 就是这么来的:
73
+ * 上游 RST 时 req 的 'error' 先到、把流封了,1 秒后重发的输出全丢,客户端拿到一条没有
74
+ * message_stop 也没有 error 的死流,回合永不收场,上游还被打满额度)。
75
+ */
76
+ const request = (onResponse, onError) => {
77
+ const req = (useHttps ? https : http).request({
78
+ hostname: target.hostname,
79
+ port: target.port || (useHttps ? 443 : 80),
80
+ path,
81
+ method: 'POST',
82
+ headers,
83
+ agent,
84
+ }, onResponse);
85
+ req.on('error', (err) => {
86
+ const detail = err.code ? `${err.code}: ${err.message}` : err.message;
87
+ console.error(`[model-ingress] forward error (${wire.upstreamId}): ${detail}`);
88
+ onError(detail);
89
+ });
90
+ req.write(outBody);
91
+ req.end();
92
+ return req;
93
+ };
94
+
95
+ // ── 流式:一条 SSE,可能跨多发上游 ──
96
+ if (wantStream) {
97
+ const xf = new OpenAIToAnthropicSSE({ model: parsed.model, label });
98
+ // 每一发 pipe 进来都会在 xf 上挂一组监听器(drain/error/close/finish/unpipe)。放宽重发次数后
99
+ // 会顶到 Node 默认的 10 个上限刷 MaxListeners 告警 —— 收尾时 unpipe(见 attemptOver)是正解,
100
+ // 这条只是保险,别让告警刷屏盖住真问题。
101
+ xf.setMaxListeners(64);
102
+ let pingTimer = null;
103
+ let streaming = false; // 已经 writeHead(200) 并把 xf 接到 res 上了吗
104
+ let dead = false; // 客户端走了(点了停止 / 关了页面):立刻停手,别再打上游
105
+ let currentReq = null; // 在飞的那一发,客户端一走就掐掉
106
+ let retryTimer = null;
107
+ let outcomeReported = false;
108
+ // 一个客户端请求只报一次结果 —— 会话连续失败计数按"请求"算,报重了止损会提前触发
109
+ const report = (ok, reason) => { if (outcomeReported) return; outcomeReported = true; onOutcome(ok, reason); };
110
+
111
+ const stopPing = () => { if (pingTimer) { clearInterval(pingTimer); pingTimer = null; } };
112
+ const startPing = () => {
113
+ stopPing();
114
+ pingTimer = setInterval(() => {
115
+ // 只在"两发之间"发:此刻没有块在流,不会跟转换层的输出交错
116
+ if (dead || res.writableEnded) { stopPing(); return; }
117
+ try { res.write('event: ping\ndata: {"type":"ping"}\n\n'); } catch { stopPing(); }
118
+ }, PING_INTERVAL_MS);
119
+ pingTimer.unref?.();
120
+ };
121
+
122
+ // ⛔ 客户端断开(用户点停止 / 关页面)后,重发链会**继续打上游**:烧 token、没人收、
123
+ // 而且 xf 的 'end' 永远不来(pipe 被 unpipe 了)→ onOutcome/onBilling 一次都不触发,
124
+ // 这几发的账和失败计数全部消失(08-21 夜评审 P1)。
125
+ res.on('close', () => {
126
+ // ⚠️ 判据是 writableEnded 而不是 xf.done:**我们自己**回的 HTTP 错误体(第一发就 503)
127
+ // 也会触发 close,那时 xf 根本没用过。用 xf.done 当判据会把它误判成"客户端断开",
128
+ // 于是同一个请求报两次失败 → 止损计数翻倍 → 用户第 2 个 503 就吃 400(探针实测)。
129
+ if (res.writableEnded) return;
130
+ dead = true;
131
+ stopPing();
132
+ if (retryTimer) { clearTimeout(retryTimer); retryTimer = null; }
133
+ try { currentReq?.destroy(); } catch { /* */ }
134
+ console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} 客户端断开,停止重发(已打 ${xf.attempts} 发)`);
135
+ report(false, 'client disconnected');
136
+ if (xf.usageTotal || xf.cost != null) onBilling({ costUsd: xf.cost, usage: xf.usageTotal });
137
+ });
138
+
139
+ xf.on('error', (err) => {
140
+ console.error(`[model-ingress] sse transform error: ${err.message}`);
141
+ stopPing();
142
+ report(false, `transform: ${err.message}`);
143
+ try { res.end(); } catch { /* ignore */ }
144
+ });
145
+ xf.on('end', () => {
146
+ stopPing();
147
+ if (dead) return; // 账在 res 'close' 那里已经结过了
148
+ report(!xf.failReason, xf.failReason || '');
149
+ onTruncated(xf.truncated);
150
+ // ⭐ 记账用**累计**(失败那几发也烧了上游的 token);给 CLI 的 message_delta 用最后一发(见 openai-chat.js)
151
+ if (xf.cost != null || xf.usageTotal) onBilling({ costUsd: xf.cost, usage: xf.usageTotal });
152
+ });
153
+
154
+ const finish = (verdict) => { stopPing(); xf.finalize(verdict); xf.end(); };
155
+ /** 还没开始流就失败:回真正的 HTTP 状态码(CLI 据此退避重试);已经在流里了:以 error 事件收场 */
156
+ const failHard = (status, msg, reason) => {
157
+ stopPing();
158
+ if (!streaming) {
159
+ report(false, reason);
160
+ const errBody = JSON.stringify(toAnthropicError(status, msg));
161
+ try {
162
+ res.writeHead(status, { 'Content-Type': 'application/json', 'Content-Length': String(Buffer.byteLength(errBody)) });
163
+ res.end(errBody);
164
+ } catch { /* 客户端已经走了 */ }
165
+ return;
166
+ }
167
+ report(false, reason);
168
+ xf.failWith(toAnthropicError(status, msg).error.message, reason); // 走 failWith:置 done,_flush 不会再补第二条 error
169
+ xf.end();
170
+ };
171
+ // 额度按**行**取(model-context 的 api.emptyRetries / api.retryBudgetMs),行内没写才走全局默认。
172
+ // 这是模型体质问题不是协议问题:Ox 两个主行放宽到 6 次 / 360 秒,别的行照旧 2 次 / 120 秒。
173
+ const maxRetries = Number.isFinite(wire.emptyRetries) ? wire.emptyRetries : emptyRetryLimit();
174
+ const budgetMs = Number.isFinite(wire.retryBudgetMs) ? wire.retryBudgetMs : retryBudgetMs();
175
+ /** 重发额度还够吗(次数 + 墙钟预算 + 客户端还在) */
176
+ const canRetry = () => !dead && (xf.attempts - 1) < maxRetries && (Date.now() - t0) < budgetMs;
177
+
178
+ const runAttempt = () => {
179
+ if (dead) return;
180
+ let over = false;
181
+ let proxyRes = null;
182
+ /**
183
+ * 这一发结束(干净 EOF / RST / 连不上都走这里 —— res 的收尾权只有它一个主人)。
184
+ * @param {string|null} why 非空 = 异常收场的原因
185
+ * @param {boolean} hadResponse 拿到过响应头吗(没拿到 = 连都没连上,判决交给转换层的既有状态)
186
+ */
187
+ const attemptOver = (why, hadResponse = true) => {
188
+ if (over || dead) return;
189
+ over = true;
190
+ currentReq = null;
191
+ if (why) console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} 这一发异常收场(${why})`);
192
+ try { proxyRes?.unpipe?.(xf); } catch { /* 已经断了就算了 */ } // 解开这一发的 pipe,别让监听器一发发攒着
193
+ const verdict = xf.attemptEnd();
194
+ if (verdict.kind !== 'empty') { finish(verdict); return; }
195
+ if (!canRetry()) {
196
+ console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} 零可见输出(${verdict.reason}),重发额度用完(第 ${xf.attempts} 发,已花 ${Math.round((Date.now() - t0) / 1000)}s)`);
197
+ if (!streaming) { failHard(502, `${label}${hadResponse ? '返回了空响应' : '连不上'}(${why || verdict.reason})—— 已自动重发仍失败,稍后再发一次`, verdict.reason); return; }
198
+ finish(verdict);
199
+ return;
200
+ }
201
+ console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} 零可见输出(${verdict.reason})→ 就地重发第 ${xf.attempts} 次`);
202
+ onNotice(`${label}这一发只想了没说就断了,正在原地重发(第 ${xf.attempts} 次),稍等一下别刷新。`);
203
+ startPing();
204
+ retryTimer = setTimeout(() => { retryTimer = null; if (dead) return; xf.beginAttempt(); runAttempt(); }, RETRY_DELAY_MS);
205
+ };
206
+
207
+ currentReq = request((incoming) => {
208
+ proxyRes = incoming;
209
+ const status = proxyRes.statusCode || 502;
210
+ if (status >= 400) {
211
+ const chunks = [];
212
+ let settled = false;
213
+ const done = (text) => {
214
+ if (settled || dead) return;
215
+ settled = true;
216
+ currentReq = null;
217
+ const msg = text?.trim() ? text : `${label} 上游返回 ${status}(模型暂时不可用,稍后再发一次)`;
218
+ console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} ${status} model=${wire.wireModel} body=${String(text || '').slice(0, 200).replace(/\s+/g, ' ')}`);
219
+ failHard(status, msg, `HTTP ${status}${streaming ? ' on retry' : ''}`);
220
+ };
221
+ proxyRes.on('data', (c) => chunks.push(c));
222
+ proxyRes.on('aborted', () => done(''));
223
+ proxyRes.on('error', (err) => done(`${label} 上游返回 ${status},响应还没传完就断了(${err.code || err.message})`));
224
+ proxyRes.on('end', () => done(Buffer.concat(chunks).toString('utf8')));
225
+ return;
226
+ }
227
+
228
+ stopPing();
229
+ if (!streaming) {
230
+ streaming = true;
231
+ res.writeHead(200, { 'Content-Type': 'text/event-stream; charset=utf-8', 'Cache-Control': 'no-cache', Connection: 'keep-alive' });
232
+ xf.pipe(res);
233
+ }
234
+ proxyRes.on('aborted', () => attemptOver('aborted'));
235
+ proxyRes.on('error', (err) => attemptOver(err.code || err.message));
236
+ proxyRes.on('end', () => attemptOver(null));
237
+ proxyRes.pipe(xf, { end: false }); // end:false —— 这条 SSE 还要接着用(可能再打一发)
238
+ }, (detail) => attemptOver(detail, false)); // 连不上 / RST:同一条判决路,绝不自己碰 res
239
+ };
240
+ runAttempt();
241
+ return;
242
+ }
243
+
244
+ // ── 非流式(CLI 的兜底通路):整包转,不做就地重发 ──
245
+ request((proxyRes) => {
246
+ const status = proxyRes.statusCode || 502;
247
+ const chunks = [];
248
+ let settled = false;
249
+ proxyRes.on('data', (c) => chunks.push(c));
250
+ // 上游半路掐了,'end' 不来 —— 别让请求悬着,就地回 502(CLI 会重试)
251
+ proxyRes.on('aborted', () => proxyRes.emit('error', Object.assign(new Error('upstream aborted'), { code: 'ECONNRESET' })));
252
+ proxyRes.on('error', (err) => {
253
+ if (settled) return;
254
+ settled = true;
255
+ const detail = err.code || err.message;
256
+ console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} 非流式响应被掐断(${detail})`);
257
+ onOutcome(false, `upstream stream aborted: ${detail}`);
258
+ if (res.headersSent) { try { res.end(); } catch { /* */ } return; }
259
+ const errBody = JSON.stringify(toAnthropicError(502, `${label} 的响应传到一半断了(${detail})—— 稍后再发一次`));
260
+ res.writeHead(502, { 'Content-Type': 'application/json' }); res.end(errBody);
261
+ });
262
+ proxyRes.on('end', () => {
263
+ if (settled) return;
264
+ settled = true;
265
+ const text = Buffer.concat(chunks).toString('utf8');
266
+ if (status >= 400) {
267
+ console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} ${status} model=${wire.wireModel} body=${text.slice(0, 200).replace(/\s+/g, ' ')}`);
268
+ const msg = text.trim() ? text : `${label} 上游返回 ${status}(模型暂时不可用,稍后再发一次)`;
269
+ onOutcome(false, `HTTP ${status}`);
270
+ const errBody = JSON.stringify(toAnthropicError(status, msg));
271
+ res.writeHead(status, { 'Content-Type': 'application/json', 'Content-Length': String(Buffer.byteLength(errBody)) });
272
+ res.end(errBody);
273
+ return;
274
+ }
275
+ let out;
276
+ let upstreamJson;
277
+ try { upstreamJson = JSON.parse(text); out = fromOpenAIChatResponse(upstreamJson); }
278
+ catch (err) {
279
+ const errBody = JSON.stringify(toAnthropicError(502, `ingress: upstream JSON unreadable (${err.message})`));
280
+ res.writeHead(502, { 'Content-Type': 'application/json' }); res.end(errBody); return;
281
+ }
282
+ if (!out) { // 200 但没有 choices / 私货 finish_reason 且零可见输出:别包成成功
283
+ const alienFinish = upstreamJson?.choices?.[0]?.finish_reason;
284
+ const msg = upstreamJson?.error?.message
285
+ || (alienFinish
286
+ ? `${label}以 ${alienFinish} 结束了这次请求,没有输出任何正文 —— 上游自己的链路出错,已自动重试仍失败;稍后再发,或换个模型(upstream ended with finish_reason='${alienFinish}' and no visible output)`
287
+ : `${label}返回了空响应,一个字都没有 —— 上游问题,已自动重试仍失败;稍后再发,或换个模型(upstream returned no choices)`);
288
+ console.warn(`[model-ingress] sid=${sidShort} upstream=${wire.upstreamId} 200-but-empty model=${wire.wireModel} ${String(msg).slice(0, 160)}`);
289
+ onOutcome(false, String(msg).slice(0, 120));
290
+ const errBody = JSON.stringify(toAnthropicError(502, String(msg)));
291
+ res.writeHead(502, { 'Content-Type': 'application/json' }); res.end(errBody); return;
292
+ }
293
+ onOutcome(true);
294
+ onTruncated(truncationOfChatResponse(upstreamJson));
295
+ if (upstreamJson.cost != null || upstreamJson.usage) onBilling({ costUsd: upstreamJson.cost ?? null, usage: upstreamJson.usage || null });
296
+ const respBody = JSON.stringify(out);
297
+ res.writeHead(200, { 'Content-Type': 'application/json', 'Content-Length': String(Buffer.byteLength(respBody)) });
298
+ res.end(respBody);
299
+ });
300
+ }, (detail) => {
301
+ onOutcome(false, `forward: ${detail}`);
302
+ if (res.headersSent) { try { res.end(); } catch { /* */ } return; }
303
+ try { res.writeHead(502); res.end(`ingress forward error: ${detail}`); } catch { /* ignore */ }
304
+ });
305
+ }