@iowarp/clio-coder 0.3.7 → 0.3.8

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (223) hide show
  1. package/CHANGELOG.md +31 -0
  2. package/README.md +7 -2
  3. package/dist/{acp-SK4MD6MM.js → acp-U67UHUK2.js} +13 -13
  4. package/dist/{agents-2FN2K6ME.js → agents-YU6SGALZ.js} +35 -33
  5. package/dist/assets/codewiki.json +1 -1
  6. package/dist/{auth-QIYZWM5I.js → auth-5ZPJOIVG.js} +32 -24
  7. package/dist/builtins-C6JMZVV6.js +17 -0
  8. package/dist/{chunk-YD734TPH.js → chunk-26LEYJZH.js} +2 -2
  9. package/dist/{chunk-TSHXZTOQ.js → chunk-2HEJ2F35.js} +5 -5
  10. package/dist/{chunk-WJHBC77E.js → chunk-2HFZQUHL.js} +5 -5
  11. package/dist/{chunk-FO5ZOVUY.js → chunk-3BINW3FP.js} +5 -5
  12. package/dist/{chunk-EOOQZZDE.js → chunk-4SPRNWDE.js} +18 -18
  13. package/dist/{chunk-EBEFWSGL.js → chunk-5DHKRSMQ.js} +7 -7
  14. package/dist/{chunk-OBMAI2DP.js → chunk-5H3GB5BO.js} +11 -9
  15. package/dist/{chunk-JTSEDYVQ.js → chunk-5Q2VVUKB.js} +7 -7
  16. package/dist/{chunk-VQNODYQ4.js → chunk-7RFXX52T.js} +294 -3704
  17. package/dist/{chunk-XEGB6BCN.js → chunk-7RGZWPB6.js} +5 -5
  18. package/dist/{chunk-GH5622CP.js → chunk-A2NJGIB3.js} +2 -2
  19. package/dist/{chunk-CEYBNUGC.js → chunk-A3WNZD3P.js} +323 -27
  20. package/dist/{chunk-D4MDIG46.js → chunk-B5CSFE7B.js} +7 -7
  21. package/dist/{chunk-2SFS6XQE.js → chunk-DGSYXYMX.js} +3 -2
  22. package/dist/{chunk-ZWLZP4ZT.js → chunk-DYIM5TJT.js} +98 -12
  23. package/dist/{chunk-KCMKRQX4.js → chunk-E77JEWSD.js} +42 -49
  24. package/dist/{chunk-J7PIKKWC.js → chunk-EMYUUSFG.js} +7 -7
  25. package/dist/{chunk-JRIO5UD2.js → chunk-EQ63NRB7.js} +5 -5
  26. package/dist/{chunk-UVDSQ6LW.js → chunk-FBVTI2TJ.js} +74 -28
  27. package/dist/{chunk-BMWK7ZIZ.js → chunk-FHJEP5SW.js} +13 -13
  28. package/dist/{chunk-FOT2FX5J.js → chunk-GN57SG4G.js} +7 -7
  29. package/dist/{chunk-SROCI7ZU.js → chunk-GPIEI3LY.js} +5 -5
  30. package/dist/{chunk-UFQ3F4FW.js → chunk-GU2UIAFZ.js} +4 -4
  31. package/dist/{chunk-UND3GU2L.js → chunk-H7IXIC72.js} +2 -2
  32. package/dist/{chunk-VREKEFLL.js → chunk-HLE42MG7.js} +3 -3
  33. package/dist/{chunk-465YSENW.js → chunk-IFBNV6H6.js} +3 -3
  34. package/dist/{chunk-LADCF22A.js → chunk-IGWKHNIQ.js} +113 -54
  35. package/dist/chunk-IIZWH4XA.js +172 -0
  36. package/dist/{chunk-UHXRNZ2J.js → chunk-IJ7RPIYJ.js} +4 -4
  37. package/dist/{chunk-M4AKACEO.js → chunk-J3YUBZWY.js} +2 -2
  38. package/dist/{chunk-AB4XIIVB.js → chunk-JOZYP4GM.js} +6 -6
  39. package/dist/{chunk-ZGH7FGS5.js → chunk-K4XHGFR5.js} +742 -12
  40. package/dist/{chunk-EELBMBT6.js → chunk-KTYTFRMB.js} +62 -5
  41. package/dist/chunk-LU7P4LHA.js +33 -0
  42. package/dist/{chunk-DQA7QLMD.js → chunk-ME6CCNFO.js} +9 -24
  43. package/dist/{chunk-KZ2H5X4G.js → chunk-MXKJU4JB.js} +88 -14
  44. package/dist/{chunk-DMD2AGVS.js → chunk-N22QMJKY.js} +20 -18
  45. package/dist/chunk-NMPKI6XL.js +3006 -0
  46. package/dist/chunk-NUGM5KR6.js +165 -0
  47. package/dist/{chunk-5C77SEEY.js → chunk-P43ETTHK.js} +2 -2
  48. package/dist/{chunk-JNXPYBB4.js → chunk-PMDBGQSJ.js} +2 -2
  49. package/dist/chunk-PT7HYKEM.js +165 -0
  50. package/dist/{chunk-GEYXPTRF.js → chunk-RWSI4YD7.js} +2 -2
  51. package/dist/{chunk-C4JBQ5SR.js → chunk-TANS5ZJS.js} +6 -6
  52. package/dist/{chunk-YTYFXUI3.js → chunk-TB5666IT.js} +9 -9
  53. package/dist/{chunk-UUANF5CR.js → chunk-TLQJPP24.js} +375 -687
  54. package/dist/{chunk-OB5HIGJY.js → chunk-TT36MB5S.js} +2 -1
  55. package/dist/{chunk-DJNLUABN.js → chunk-TTHACPOM.js} +135 -17
  56. package/dist/{chunk-6M7VS3J3.js → chunk-TYPGUK6W.js} +4 -4
  57. package/dist/{chunk-THKY7CD7.js → chunk-U6MBIEMB.js} +108 -24
  58. package/dist/{chunk-PD3MESLB.js → chunk-VAWNZU7Z.js} +4 -4
  59. package/dist/{chunk-IR4CFBFN.js → chunk-VCBR6CU7.js} +12 -12
  60. package/dist/{chunk-WHJYKASB.js → chunk-VHN4MY6O.js} +2 -2
  61. package/dist/{chunk-MXI6J5JF.js → chunk-VWZOAB7K.js} +10 -10
  62. package/dist/{chunk-QCTRSGHQ.js → chunk-WLFILSD5.js} +36 -36
  63. package/dist/{chunk-5UJ6ECTS.js → chunk-WNIJTQQK.js} +6 -6
  64. package/dist/{chunk-4DWFMQDR.js → chunk-WSB3FPX7.js} +68 -20
  65. package/dist/{chunk-3HAPLH5M.js → chunk-WWCZ5F23.js} +112 -10
  66. package/dist/{chunk-X2KV5FXT.js → chunk-WXY7KU3G.js} +2 -2
  67. package/dist/{chunk-PPAMZ32Z.js → chunk-XK56QHLX.js} +6 -1
  68. package/dist/{chunk-DOOEX22V.js → chunk-XWSF374K.js} +4 -4
  69. package/dist/{chunk-6TUKSZVF.js → chunk-YS5VLNH5.js} +8 -8
  70. package/dist/{chunk-ZZMN5OM4.js → chunk-ZNLWCMVZ.js} +2 -2
  71. package/dist/{chunk-WHGPSPT5.js → chunk-ZVJ5BLO2.js} +2 -2
  72. package/dist/cli/index.js +31 -31
  73. package/dist/{clio-WBVQEBKO.js → clio-QVTYJ57A.js} +8 -8
  74. package/dist/code-nav-FGGFIE7L.js +2 -2
  75. package/dist/codewiki/build-worker.js +4 -4
  76. package/dist/{components-F7OEATSO.js → components-ZFA3SAER.js} +8 -8
  77. package/dist/{config-TRBL3RCF.js → config-LW5IJFQN.js} +58 -53
  78. package/dist/{configure-OLCVPHNM.js → configure-7XIZCOU4.js} +26 -21
  79. package/dist/{context-XEWE3MOJ.js → context-L3WL3X7K.js} +47 -41
  80. package/dist/{context-WFPKQSM6.js → context-N52ZA626.js} +22 -22
  81. package/dist/{context-MJIJ6GOX.js → context-Y6Y7QPR6.js} +12 -12
  82. package/dist/{context-clear-KNOS2JPB.js → context-clear-MBQRLSDQ.js} +47 -41
  83. package/dist/{context-index-SSR5ECNE.js → context-index-HVMFQHK3.js} +5 -5
  84. package/dist/{context-working-set-EUXAZI6N.js → context-working-set-GS6DSO7F.js} +14 -14
  85. package/dist/{dispatch-runner-B7MTOVKL.js → dispatch-runner-22ZCNOM3.js} +83 -55
  86. package/dist/{docs-FLJTIDSE.js → docs-7LQ23DLM.js} +8 -8
  87. package/dist/{doctor-RN4YKO2X.js → doctor-M7YEDGAE.js} +24 -20
  88. package/dist/{eval-RUBJVSNQ.js → eval-BEC2WHDA.js} +71 -19
  89. package/dist/{evidence-JZNBUOQZ.js → evidence-REJUMSKM.js} +62 -56
  90. package/dist/{evolve-FJVC4KKI.js → evolve-PY5ZBA5K.js} +41 -35
  91. package/dist/{extensions-IQL36S7K.js → extensions-HVKU65YU.js} +6 -6
  92. package/dist/{fleet-BDKYJFCP.js → fleet-7WZEWRFA.js} +72 -67
  93. package/dist/{fleet-commands-ZFIWZSB3.js → fleet-commands-UVHWM76J.js} +10 -10
  94. package/dist/{fleet-graph-Y6HPXIVF.js → fleet-graph-6ULH7PES.js} +13 -13
  95. package/dist/{fleet-preflight-BHSNPBMH.js → fleet-preflight-J53T6CCE.js} +5 -5
  96. package/dist/{fleet-validate-BIYREGIK.js → fleet-validate-72PC4SLA.js} +17 -17
  97. package/dist/{init-LQUB5COQ.js → init-OG3TPGQG.js} +61 -56
  98. package/dist/{library-NJAHIGG4.js → library-CNTMPLRF.js} +18 -18
  99. package/dist/{memory-OG6HOYKM.js → memory-6IS7F275.js} +43 -37
  100. package/dist/{models-5ZG5XY7J.js → models-ENRJDA5W.js} +33 -28
  101. package/dist/{monitor-TJ7AMTGB.js → monitor-XLDVO7TN.js} +56 -38
  102. package/dist/{orchestrator-WZYB54DM.js → orchestrator-6KSPYRHA.js} +421 -303
  103. package/dist/{paths-XUC7GS6E.js → paths-DBXMZMDU.js} +5 -5
  104. package/dist/registry-LG64LTF4.js +11 -0
  105. package/dist/{reset-PXQT45IY.js → reset-RZ4ER727.js} +10 -10
  106. package/dist/{run-FQ74YF62.js → run-Y2CNK5RU.js} +79 -74
  107. package/dist/{share-FW7SVCL3.js → share-A55GYP6Z.js} +16 -16
  108. package/dist/{skills-7E7IRB3R.js → skills-ALC5J6AT.js} +19 -19
  109. package/dist/{skills-eval-LI75W6OK.js → skills-eval-JPBEBYQU.js} +52 -47
  110. package/dist/support-MIETYA5E.js +38 -0
  111. package/dist/{targets-4CIFKCTW.js → targets-VGNXIR3S.js} +42 -33
  112. package/dist/{terminal-lease-WUZY7ZV5.js → terminal-lease-WOBR64YA.js} +3 -3
  113. package/dist/{uninstall-7FV7IP4E.js → uninstall-ZJF5H5ZN.js} +8 -8
  114. package/dist/{upgrade-K2HVIVMQ.js → upgrade-FUSUAGHR.js} +27 -25
  115. package/dist/{usage-GTZELZQX.js → usage-N4MKVHKD.js} +51 -46
  116. package/dist/{verifiers-RLAHT27O.js → verifiers-YAWOJ3H2.js} +13 -13
  117. package/dist/{verify-BX3BRKH5.js → verify-LTDHYBGY.js} +9 -9
  118. package/dist/{wiki-generate-ASIFASCN.js → wiki-generate-6M7GHTBJ.js} +66 -61
  119. package/dist/worker/entry.js +68 -61
  120. package/docs/alcf-provider.md +1 -1
  121. package/docs/architecture.md +1 -1
  122. package/docs/artifact-versions.md +6 -5
  123. package/docs/built-in-agents.md +1 -1
  124. package/docs/commands-and-modes.md +2 -2
  125. package/docs/configuration-and-targets.md +8 -3
  126. package/docs/context-engine.md +1 -1
  127. package/docs/documentation-guide.md +1 -1
  128. package/docs/eval-runner.md +1 -1
  129. package/docs/evals-internal.md +1 -1
  130. package/docs/evidence-and-memory.md +70 -6
  131. package/docs/evolution.md +1 -1
  132. package/docs/extensions-and-sharing.md +1 -1
  133. package/docs/fleet-dispatch.md +34 -9
  134. package/docs/glossary.md +21 -1
  135. package/docs/installation-and-lifecycle.md +1 -1
  136. package/docs/middleware-and-components.md +1 -1
  137. package/docs/model-catalog.md +1 -1
  138. package/docs/observability.md +2 -2
  139. package/docs/proactive-memory.md +1 -1
  140. package/docs/prompt-envelope-and-tools.md +4 -2
  141. package/docs/provider-adapter-cookbook.md +1 -1
  142. package/docs/release-cut-checklist.md +41 -38
  143. package/docs/safety-model.md +1 -1
  144. package/docs/scientific-validation.md +1 -1
  145. package/docs/skills-marketplace.md +1 -1
  146. package/docs/tool-usage.md +1 -1
  147. package/docs/trace-store.md +1 -1
  148. package/docs/tui-design.md +1 -1
  149. package/docs/worker-dispatch-mechanics.md +1 -1
  150. package/package.json +1 -2
  151. package/src/cli/argv.ts +5 -0
  152. package/src/cli/configure.ts +107 -23
  153. package/src/cli/doctor.ts +5 -1
  154. package/src/cli/evidence.ts +30 -25
  155. package/src/cli/fleet-preflight.ts +2 -12
  156. package/src/cli/shared.ts +1 -0
  157. package/src/cli/targets.ts +4 -1
  158. package/src/cli/validate-model.ts +60 -5
  159. package/src/core/bus-events.ts +25 -0
  160. package/src/core/commit-attribution.ts +4 -4
  161. package/src/core/path-boundary.ts +100 -0
  162. package/src/domains/agents/extension.ts +2 -11
  163. package/src/domains/agents/fleet-contract.ts +30 -12
  164. package/src/domains/agents/recipe.ts +7 -1
  165. package/src/domains/agents/registry.ts +73 -5
  166. package/src/domains/agents/result-contract.ts +128 -17
  167. package/src/domains/agents/write-boundary.ts +15 -50
  168. package/src/domains/context/project-rules.ts +51 -1
  169. package/src/domains/dispatch/assignment-reconcile.ts +22 -5
  170. package/src/domains/dispatch/assignment-store.ts +151 -14
  171. package/src/domains/dispatch/contract.ts +15 -1
  172. package/src/domains/dispatch/delegation-plan.ts +2 -5
  173. package/src/domains/dispatch/execution-role.ts +9 -1
  174. package/src/domains/dispatch/extension.ts +156 -67
  175. package/src/domains/dispatch/fleet-run.ts +57 -3
  176. package/src/domains/dispatch/gate-role-prompts.ts +38 -0
  177. package/src/domains/dispatch/index.ts +3 -1
  178. package/src/domains/dispatch/intent-requirements.ts +40 -0
  179. package/src/domains/dispatch/intent.ts +84 -8
  180. package/src/domains/dispatch/path-scope.ts +370 -0
  181. package/src/domains/dispatch/receipt-integrity.ts +2 -1
  182. package/src/domains/dispatch/types.ts +14 -7
  183. package/src/domains/dispatch/validation.ts +6 -3
  184. package/src/domains/dispatch/write-boundary-enforcer.ts +45 -0
  185. package/src/domains/dispatch/write-boundary.ts +201 -22
  186. package/src/domains/eval/metrics/evidence.ts +79 -2
  187. package/src/domains/eval/runners/clio-run.ts +12 -2
  188. package/src/domains/evidence/build.ts +69 -11
  189. package/src/domains/evidence/index.ts +21 -0
  190. package/src/domains/evidence/provenance.ts +46 -11
  191. package/src/domains/evidence/trust-projection.ts +274 -0
  192. package/src/domains/evidence/trust-status.ts +145 -17
  193. package/src/domains/evidence/types.ts +4 -0
  194. package/src/domains/extensions/discovery.ts +88 -1
  195. package/src/domains/extensions/resources.ts +20 -8
  196. package/src/domains/extensions/state.ts +6 -2
  197. package/src/domains/extensions/types.ts +4 -1
  198. package/src/domains/lifecycle/doctor.ts +140 -1
  199. package/src/domains/prompts/contract.ts +3 -5
  200. package/src/domains/providers/extension.ts +30 -2
  201. package/src/domains/resources/common-loader.ts +3 -0
  202. package/src/domains/resources/prompts/loader.ts +119 -14
  203. package/src/domains/safety/policy-engine.ts +5 -5
  204. package/src/domains/safety/run-effects.ts +64 -1
  205. package/src/domains/safety/scope.ts +7 -12
  206. package/src/engine/acp/server.ts +4 -1
  207. package/src/engine/prompt-templates.ts +18 -1
  208. package/src/engine/worker-runtime.ts +6 -3
  209. package/src/interactive/dispatch-board.ts +53 -3
  210. package/src/interactive/interactive-event-projection.ts +14 -0
  211. package/src/interactive/overlays/settings.ts +141 -47
  212. package/src/interactive/slash-commands.ts +7 -2
  213. package/src/interactive/view/artifacts.ts +42 -9
  214. package/src/interactive/view/view-overlay.ts +15 -3
  215. package/src/interactive/worker-receipts.ts +14 -2
  216. package/src/interactive/worker-stream.ts +8 -0
  217. package/src/tools/dispatch-admission.ts +12 -13
  218. package/src/tools/dispatch-arguments.ts +27 -0
  219. package/src/tools/dispatch-plan.ts +29 -0
  220. package/src/tools/dispatch-runner.ts +48 -13
  221. package/src/tools/monitor.ts +13 -0
  222. package/src/tools/worker-evidence.ts +19 -13
  223. package/src/worker/spec-contract.ts +2 -1
@@ -0,0 +1,3006 @@
1
+ import { createRequire as __clioCreateRequire } from "node:module"; const require = __clioCreateRequire(import.meta.url);
2
+ import {
3
+ THINKING_LEVELS
4
+ } from "./chunk-4DGYLA73.js";
5
+ import {
6
+ listCatalogModelsForRuntime,
7
+ mergeCapabilities,
8
+ synthesizeCatalogBackedModel
9
+ } from "./chunk-PT7HYKEM.js";
10
+ import {
11
+ init_esm_shims
12
+ } from "./chunk-3R73A4XB.js";
13
+
14
+ // src/domains/providers/runtimes/builtins.ts
15
+ init_esm_shims();
16
+
17
+ // src/domains/providers/runtimes/antigravity/antigravity-code.ts
18
+ init_esm_shims();
19
+ var ANTIGRAVITY_AUTH_NOTICE = "Uses your existing Antigravity (`agy`) login. Clio stores no Antigravity credentials. agy runs its own agent harness as a subprocess; Clio maps autonomy levels onto its CLI flags but cannot mediate individual agy tool calls.";
20
+ var ANTIGRAVITY_MODELS = [
21
+ "Gemini 3.5 Flash (High)",
22
+ "Gemini 3.5 Flash (Medium)",
23
+ "Gemini 3.5 Flash (Low)",
24
+ "Gemini 3.1 Pro (High)",
25
+ "Gemini 3.1 Pro (Low)",
26
+ "Claude Sonnet 4.6 (Thinking)",
27
+ "Claude Opus 4.6 (Thinking)",
28
+ "GPT-OSS 120B (Medium)"
29
+ ];
30
+ var antigravityCapabilities = {
31
+ chat: true,
32
+ tools: true,
33
+ toolCallFormat: "openai",
34
+ reasoning: true,
35
+ vision: true,
36
+ audio: false,
37
+ embeddings: false,
38
+ rerank: false,
39
+ fim: false,
40
+ contextWindow: 1e6,
41
+ maxTokens: 8192
42
+ };
43
+ var antigravityCodeRuntime = {
44
+ id: "antigravity-code",
45
+ displayName: "Antigravity CLI",
46
+ kind: "subprocess",
47
+ tier: "subscription",
48
+ // Reuses the existing `google-generative-ai` api family: the worker branches
49
+ // to its own runner before any pi-ai inference, so this only needs to be a
50
+ // valid, google-backed family. The runner is selected by runtime id, and the
51
+ // plain-text parser is named by `outputParser`.
52
+ apiFamily: "google-generative-ai",
53
+ auth: "none",
54
+ authNotice: ANTIGRAVITY_AUTH_NOTICE,
55
+ knownModels: [...ANTIGRAVITY_MODELS],
56
+ binaryName: "agy",
57
+ headlessCommand: "agy --print",
58
+ outputParser: "antigravity-print-text",
59
+ defaultCapabilities: antigravityCapabilities,
60
+ synthesizeModel(target, wireModelId, kb) {
61
+ return synthesizeCatalogBackedModel({
62
+ target,
63
+ wireModelId,
64
+ kb,
65
+ defaultCapabilities: antigravityCapabilities,
66
+ runtimeId: "antigravity-code",
67
+ api: "google-generative-ai",
68
+ provider: "google",
69
+ defaultBaseUrl: "antigravity://local"
70
+ });
71
+ }
72
+ };
73
+ var antigravity_code_default = antigravityCodeRuntime;
74
+
75
+ // src/domains/providers/runtimes/claude/claude-code.ts
76
+ init_esm_shims();
77
+
78
+ // src/domains/providers/runtimes/claude/common.ts
79
+ init_esm_shims();
80
+ var CLAUDE_CODE_AUTH_NOTICE = "Uses your existing Claude Code login from the installed `claude` command. Clio stores no Claude Code credentials.";
81
+ var CLAUDE_CODE_MODELS = [
82
+ "sonnet",
83
+ "opus",
84
+ "haiku",
85
+ "claude-sonnet-4-5",
86
+ "claude-opus-4-5",
87
+ "claude-haiku-4-5",
88
+ "claude-3-7-sonnet-latest"
89
+ ];
90
+ var claudeCodeCapabilities = {
91
+ chat: true,
92
+ tools: true,
93
+ toolCallFormat: "anthropic",
94
+ reasoning: true,
95
+ thinkingFormat: "anthropic-extended",
96
+ vision: true,
97
+ audio: false,
98
+ embeddings: false,
99
+ rerank: false,
100
+ fim: false,
101
+ contextWindow: 2e5,
102
+ maxTokens: 8192
103
+ };
104
+ function synthesizeClaudeDelegatedModel(input) {
105
+ return synthesizeCatalogBackedModel({
106
+ target: input.target,
107
+ wireModelId: input.wireModelId,
108
+ kb: input.kb,
109
+ defaultCapabilities: input.defaultCapabilities,
110
+ runtimeId: input.runtimeId,
111
+ api: input.apiFamily,
112
+ provider: "anthropic",
113
+ defaultBaseUrl: "claude-code://local"
114
+ });
115
+ }
116
+
117
+ // src/domains/providers/runtimes/claude/claude-code.ts
118
+ var claudeCodeRuntime = {
119
+ id: "claude-code",
120
+ displayName: "Claude Code CLI",
121
+ kind: "subprocess",
122
+ tier: "subscription",
123
+ apiFamily: "claude-code-subprocess",
124
+ auth: "claude-cli",
125
+ authNotice: CLAUDE_CODE_AUTH_NOTICE,
126
+ knownModels: [...CLAUDE_CODE_MODELS],
127
+ binaryName: "claude",
128
+ headlessCommand: "claude -p --output-format stream-json",
129
+ outputParser: "claude-code-stream-json",
130
+ defaultCapabilities: claudeCodeCapabilities,
131
+ synthesizeModel(target, wireModelId, kb) {
132
+ return synthesizeClaudeDelegatedModel({
133
+ target,
134
+ wireModelId,
135
+ kb,
136
+ defaultCapabilities: claudeCodeCapabilities,
137
+ runtimeId: "claude-code",
138
+ apiFamily: "claude-code-subprocess"
139
+ });
140
+ }
141
+ };
142
+ var claude_code_default = claudeCodeRuntime;
143
+
144
+ // src/domains/providers/runtimes/claude/claude-sdk.ts
145
+ init_esm_shims();
146
+ var claudeSdkRuntime = {
147
+ id: "claude-sdk",
148
+ displayName: "Claude Agent SDK",
149
+ kind: "sdk",
150
+ tier: "subscription",
151
+ apiFamily: "claude-agent-sdk",
152
+ auth: "claude-cli",
153
+ authNotice: CLAUDE_CODE_AUTH_NOTICE,
154
+ knownModels: [...CLAUDE_CODE_MODELS],
155
+ binaryName: "claude",
156
+ headlessCommand: "@anthropic-ai/claude-agent-sdk query()",
157
+ outputParser: "claude-agent-sdk-messages",
158
+ defaultCapabilities: claudeCodeCapabilities,
159
+ synthesizeModel(target, wireModelId, kb) {
160
+ return synthesizeClaudeDelegatedModel({
161
+ target,
162
+ wireModelId,
163
+ kb,
164
+ defaultCapabilities: claudeCodeCapabilities,
165
+ runtimeId: "claude-sdk",
166
+ apiFamily: "claude-agent-sdk"
167
+ });
168
+ }
169
+ };
170
+ var claude_sdk_default = claudeSdkRuntime;
171
+
172
+ // src/domains/providers/runtimes/cloud/alcf.ts
173
+ init_esm_shims();
174
+
175
+ // src/domains/providers/probe/http.ts
176
+ init_esm_shims();
177
+ import { performance } from "node:perf_hooks";
178
+ async function probeHttp(opts) {
179
+ const { response, latencyMs, error } = await runFetch(opts);
180
+ if (response === null) return { ok: false, error: error ?? "unknown transport error", latencyMs };
181
+ const method = opts.method ?? "GET";
182
+ if (response.ok) return { ok: true, latencyMs };
183
+ if (method === "HEAD" && response.status === 405) return { ok: true, latencyMs };
184
+ return {
185
+ ok: false,
186
+ latencyMs,
187
+ error: `HTTP ${response.status}: ${response.statusText}`
188
+ };
189
+ }
190
+ async function probeJson(opts) {
191
+ const { response, latencyMs, error } = await runFetch(opts);
192
+ if (response === null) return { ok: false, error: error ?? "unknown transport error", latencyMs };
193
+ const method = opts.method ?? "GET";
194
+ if (!response.ok && !(method === "HEAD" && response.status === 405)) {
195
+ return {
196
+ ok: false,
197
+ latencyMs,
198
+ error: `HTTP ${response.status}: ${response.statusText}`
199
+ };
200
+ }
201
+ let data;
202
+ try {
203
+ data = await response.json();
204
+ } catch (err) {
205
+ return { ok: false, latencyMs, error: `JSON parse: ${describeError(err)}` };
206
+ }
207
+ return { ok: true, latencyMs, data };
208
+ }
209
+ async function runFetch(opts) {
210
+ const controller = new AbortController();
211
+ let timedOut = false;
212
+ const timer = setTimeout(() => {
213
+ timedOut = true;
214
+ controller.abort();
215
+ }, opts.timeoutMs);
216
+ const onExternalAbort = () => controller.abort();
217
+ if (opts.signal) {
218
+ if (opts.signal.aborted) controller.abort();
219
+ else opts.signal.addEventListener("abort", onExternalAbort, { once: true });
220
+ }
221
+ const init = {
222
+ method: opts.method ?? "GET",
223
+ signal: controller.signal
224
+ };
225
+ if (opts.headers) init.headers = opts.headers;
226
+ if (opts.body !== void 0) init.body = opts.body;
227
+ const started = performance.now();
228
+ try {
229
+ const response = await fetch(opts.url, init);
230
+ return { response, latencyMs: Math.round(performance.now() - started) };
231
+ } catch (err) {
232
+ const latencyMs = Math.round(performance.now() - started);
233
+ if (timedOut) {
234
+ return { response: null, latencyMs, error: `timeout after ${opts.timeoutMs}ms` };
235
+ }
236
+ if (opts.signal?.aborted) {
237
+ return { response: null, latencyMs, error: "aborted by caller" };
238
+ }
239
+ return { response: null, latencyMs, error: describeError(err) };
240
+ } finally {
241
+ clearTimeout(timer);
242
+ if (opts.signal) opts.signal.removeEventListener("abort", onExternalAbort);
243
+ }
244
+ }
245
+ function describeError(err) {
246
+ if (!(err instanceof Error)) return String(err);
247
+ const cause = err.cause;
248
+ if (cause instanceof Error && cause.message.length > 0) {
249
+ const code = cause.code;
250
+ return typeof code === "string" && !cause.message.includes(code) ? `${cause.message} (${code})` : cause.message;
251
+ }
252
+ return err.message;
253
+ }
254
+
255
+ // src/domains/providers/runtimes/common/local-synth.ts
256
+ init_esm_shims();
257
+
258
+ // src/domains/providers/types/local-model-quirks.ts
259
+ init_esm_shims();
260
+ var KV_CACHE_QUANTS = ["f32", "f16", "q8_0", "q4_0", "q4_1", "iq4_nl", "q5_0", "q5_1"];
261
+ function isRecord(value) {
262
+ return value !== null && typeof value === "object" && !Array.isArray(value);
263
+ }
264
+ function asKvCacheQuant(value) {
265
+ if (value === false) return false;
266
+ if (typeof value !== "string") return void 0;
267
+ return KV_CACHE_QUANTS.includes(value) ? value : void 0;
268
+ }
269
+ function asPositive(value) {
270
+ return typeof value === "number" && Number.isFinite(value) && value >= 0 ? value : void 0;
271
+ }
272
+ function asInteger(value) {
273
+ const n = asPositive(value);
274
+ return n !== void 0 && Number.isInteger(n) ? n : void 0;
275
+ }
276
+ function asPenalty(value) {
277
+ return typeof value === "number" && Number.isFinite(value) ? value : void 0;
278
+ }
279
+ function extractKvCache(raw) {
280
+ if (!isRecord(raw)) return void 0;
281
+ const out = {};
282
+ const k = asKvCacheQuant(raw.kQuant);
283
+ if (k !== void 0) out.kQuant = k;
284
+ const v = asKvCacheQuant(raw.vQuant);
285
+ if (v !== void 0) out.vQuant = v;
286
+ if (typeof raw.useFp16 === "boolean") out.useFp16 = raw.useFp16;
287
+ return Object.keys(out).length > 0 ? out : void 0;
288
+ }
289
+ function extractSamplingProfile(raw) {
290
+ if (!isRecord(raw)) return void 0;
291
+ const out = {};
292
+ const temperature = asPositive(raw.temperature);
293
+ if (temperature !== void 0) out.temperature = temperature;
294
+ const topP = asPositive(raw.topP);
295
+ if (topP !== void 0) out.topP = topP;
296
+ const topK = asInteger(raw.topK);
297
+ if (topK !== void 0) out.topK = topK;
298
+ const minP = asPositive(raw.minP);
299
+ if (minP !== void 0) out.minP = minP;
300
+ const rp = asPenalty(raw.repeatPenalty) ?? asPenalty(raw.repetitionPenalty);
301
+ if (rp !== void 0) out.repeatPenalty = rp;
302
+ const pp = asPenalty(raw.presencePenalty);
303
+ if (pp !== void 0) out.presencePenalty = pp;
304
+ const fp = asPenalty(raw.frequencyPenalty);
305
+ if (fp !== void 0) out.frequencyPenalty = fp;
306
+ const maxTokens = asInteger(raw.maxTokens);
307
+ if (maxTokens !== void 0) out.maxTokens = maxTokens;
308
+ return Object.keys(out).length > 0 ? out : void 0;
309
+ }
310
+ function extractSampling(raw) {
311
+ if (!isRecord(raw)) return void 0;
312
+ const out = {};
313
+ const thinking = extractSamplingProfile(raw.thinking);
314
+ if (thinking) out.thinking = thinking;
315
+ const instruct = extractSamplingProfile(raw.instruct);
316
+ if (instruct) out.instruct = instruct;
317
+ return Object.keys(out).length > 0 ? out : void 0;
318
+ }
319
+ var THINKING_MECHANISMS = [
320
+ "effort-levels",
321
+ "budget-tokens",
322
+ "on-off",
323
+ "always-on",
324
+ "none"
325
+ ];
326
+ function asThinkingMechanism(value) {
327
+ if (typeof value !== "string") return void 0;
328
+ return THINKING_MECHANISMS.includes(value) ? value : void 0;
329
+ }
330
+ function extractBudgetByLevel(raw) {
331
+ if (!isRecord(raw)) return void 0;
332
+ const out = {};
333
+ const minimal = asInteger(raw.minimal);
334
+ if (minimal !== void 0) out.minimal = minimal;
335
+ const low = asInteger(raw.low);
336
+ if (low !== void 0) out.low = low;
337
+ const medium = asInteger(raw.medium);
338
+ if (medium !== void 0) out.medium = medium;
339
+ const high = asInteger(raw.high);
340
+ if (high !== void 0) out.high = high;
341
+ const xhigh = asInteger(raw.xhigh);
342
+ if (xhigh !== void 0) out.xhigh = xhigh;
343
+ return Object.keys(out).length > 0 ? out : void 0;
344
+ }
345
+ function extractEffortByLevel(raw) {
346
+ if (!isRecord(raw)) return void 0;
347
+ const out = {};
348
+ if (typeof raw.off === "string" && raw.off.length > 0) out.off = raw.off;
349
+ if (typeof raw.minimal === "string" && raw.minimal.length > 0) out.minimal = raw.minimal;
350
+ if (typeof raw.low === "string" && raw.low.length > 0) out.low = raw.low;
351
+ if (typeof raw.medium === "string" && raw.medium.length > 0) out.medium = raw.medium;
352
+ if (typeof raw.high === "string" && raw.high.length > 0) out.high = raw.high;
353
+ if (typeof raw.xhigh === "string" && raw.xhigh.length > 0) out.xhigh = raw.xhigh;
354
+ return Object.keys(out).length > 0 ? out : void 0;
355
+ }
356
+ function extractThinkingQuirks(raw) {
357
+ if (!isRecord(raw)) return void 0;
358
+ const mechanism = asThinkingMechanism(raw.mechanism);
359
+ if (!mechanism) return void 0;
360
+ const out = { mechanism };
361
+ const budgetByLevel = extractBudgetByLevel(raw.budgetByLevel);
362
+ if (budgetByLevel) out.budgetByLevel = budgetByLevel;
363
+ const effortByLevel = extractEffortByLevel(raw.effortByLevel);
364
+ if (effortByLevel) out.effortByLevel = effortByLevel;
365
+ if (typeof raw.guidance === "string" && raw.guidance.length > 0) out.guidance = raw.guidance;
366
+ return out;
367
+ }
368
+ function extractLocalModelQuirks(raw) {
369
+ if (!isRecord(raw)) return void 0;
370
+ const out = {};
371
+ const kvCache = extractKvCache(raw.kvCache);
372
+ if (kvCache) out.kvCache = kvCache;
373
+ const sampling = extractSampling(raw.sampling);
374
+ if (sampling) out.sampling = sampling;
375
+ const thinking = extractThinkingQuirks(raw.thinking);
376
+ if (thinking) out.thinking = thinking;
377
+ return Object.keys(out).length > 0 ? out : void 0;
378
+ }
379
+
380
+ // src/domains/providers/runtimes/common/local-synth.ts
381
+ function openAIThinkingFormat(caps) {
382
+ switch (caps.thinkingFormat) {
383
+ case "qwen-chat-template":
384
+ case "openrouter":
385
+ case "zai":
386
+ return caps.thinkingFormat;
387
+ case "deepseek-r1":
388
+ return "deepseek";
389
+ case "harmony":
390
+ return "harmony";
391
+ default:
392
+ return void 0;
393
+ }
394
+ }
395
+ function localOpenAICompat(caps, runtimeId) {
396
+ const compat = {
397
+ supportsStore: false,
398
+ supportsDeveloperRole: false,
399
+ supportsReasoningEffort: false,
400
+ supportsUsageInStreaming: true,
401
+ supportsFinishReason: false,
402
+ maxTokensField: "max_tokens",
403
+ supportsThinkingTokenBudget: runtimeId === "vllm",
404
+ supportsStrictMode: false
405
+ };
406
+ const thinkingFormat = openAIThinkingFormat(caps);
407
+ if (thinkingFormat) compat.thinkingFormat = thinkingFormat;
408
+ return compat;
409
+ }
410
+ function localAnthropicCompat() {
411
+ return {
412
+ supportsEagerToolInputStreaming: false,
413
+ supportsLongCacheRetention: false
414
+ };
415
+ }
416
+ function synthLocalModel(input) {
417
+ const { target, wireModelId, kb, defaultCapabilities: defaultCapabilities25, apiFamily, provider } = input;
418
+ const caps = mergeCapabilities(defaultCapabilities25, kb?.entry.capabilities ?? null, null, target.capabilities ?? null);
419
+ const rawUrl = target.url ?? "";
420
+ const baseUrl = rawUrl.length > 0 ? input.baseUrlForTarget(rawUrl) : "";
421
+ const pricing = target.pricing;
422
+ const headers = target.auth?.headers;
423
+ const quirks = extractLocalModelQuirks(kb?.entry.quirks);
424
+ const model = {
425
+ id: wireModelId,
426
+ name: `${wireModelId} (${target.id})`,
427
+ api: apiFamily,
428
+ provider,
429
+ baseUrl,
430
+ reasoning: caps.reasoning,
431
+ input: caps.vision ? ["text", "image"] : ["text"],
432
+ cost: {
433
+ input: pricing?.input ?? 0,
434
+ output: pricing?.output ?? 0,
435
+ cacheRead: pricing?.cacheRead ?? 0,
436
+ cacheWrite: pricing?.cacheWrite ?? 0
437
+ },
438
+ contextWindow: caps.contextWindow,
439
+ maxTokens: caps.maxTokens,
440
+ clio: {
441
+ targetId: target.id,
442
+ runtimeId: target.runtime,
443
+ ...target.lifecycle ? { lifecycle: target.lifecycle } : {},
444
+ ...target.gateway === true ? { gateway: true } : {},
445
+ ...kb?.entry.family ? { family: kb.entry.family } : {},
446
+ ...quirks ? { quirks } : {},
447
+ ...target.lmstudio ? { lmstudio: target.lmstudio } : {}
448
+ }
449
+ };
450
+ if (headers) model.headers = headers;
451
+ if (apiFamily === "openai-completions") {
452
+ model.compat = localOpenAICompat(caps, target.runtime);
453
+ }
454
+ if (apiFamily === "anthropic-messages") {
455
+ model.compat = localAnthropicCompat();
456
+ }
457
+ return model;
458
+ }
459
+ function stripTrailingSlash(url2) {
460
+ return url2.endsWith("/") ? url2.slice(0, -1) : url2;
461
+ }
462
+ function stripRedundantV1(url2) {
463
+ return url2.endsWith("/v1") ? url2.slice(0, -"/v1".length) : url2;
464
+ }
465
+ var withV1 = (url2) => `${stripRedundantV1(stripTrailingSlash(url2))}/v1`;
466
+ var withAsIs = (url2) => stripTrailingSlash(url2);
467
+ function targetBaseUrl(target) {
468
+ return target.url ? stripTrailingSlash(target.url) : null;
469
+ }
470
+ function targetRootUrl(target) {
471
+ return target.url ? stripRedundantV1(stripTrailingSlash(target.url)) : null;
472
+ }
473
+
474
+ // src/domains/providers/runtimes/protocol/openai-compat.ts
475
+ init_esm_shims();
476
+
477
+ // src/core/context-floor.ts
478
+ init_esm_shims();
479
+ var CLIO_MIN_CONTEXT_WINDOW = 131072;
480
+ var CLIO_MIN_MAX_OUTPUT_TOKENS = 32768;
481
+ var CLIO_CONTEXT_WINDOW_WARN_BELOW = 128e3;
482
+
483
+ // src/domains/providers/probe/reasoning.ts
484
+ init_esm_shims();
485
+ import { performance as performance2 } from "node:perf_hooks";
486
+ var PROMPT = "What is 2+2? Think briefly, then answer.";
487
+ function nonEmptyString(value) {
488
+ return typeof value === "string" && value.trim().length > 0;
489
+ }
490
+ function detectReasoningField(data) {
491
+ const message = data.choices?.[0]?.message;
492
+ if (!message) return null;
493
+ if (nonEmptyString(message.reasoning_content)) return "reasoning_content";
494
+ if (nonEmptyString(message.reasoning)) return "reasoning";
495
+ if (nonEmptyString(message.reasoning_text)) return "reasoning_text";
496
+ return null;
497
+ }
498
+ function trimTrailingSlash(url2) {
499
+ return url2.endsWith("/") ? url2.slice(0, -1) : url2;
500
+ }
501
+ async function probeOpenAICompatReasoning(opts) {
502
+ const controller = new AbortController();
503
+ let timedOut = false;
504
+ const timer = setTimeout(() => {
505
+ timedOut = true;
506
+ controller.abort();
507
+ }, opts.timeoutMs);
508
+ const onExternalAbort = () => controller.abort();
509
+ if (opts.signal) {
510
+ if (opts.signal.aborted) controller.abort();
511
+ else opts.signal.addEventListener("abort", onExternalAbort, { once: true });
512
+ }
513
+ const headers = { "content-type": "application/json" };
514
+ if (opts.apiKey && opts.apiKey.length > 0) headers.authorization = `Bearer ${opts.apiKey}`;
515
+ const body = JSON.stringify({
516
+ model: opts.modelId,
517
+ messages: [{ role: "user", content: PROMPT }],
518
+ max_tokens: 200,
519
+ temperature: 0,
520
+ stream: false,
521
+ reasoning_effort: "low"
522
+ });
523
+ const url2 = `${trimTrailingSlash(opts.baseUrl)}/v1/chat/completions`;
524
+ const started = performance2.now();
525
+ try {
526
+ const response = await fetch(url2, {
527
+ method: "POST",
528
+ headers,
529
+ body,
530
+ signal: controller.signal
531
+ });
532
+ const latencyMs = Math.round(performance2.now() - started);
533
+ if (!response.ok) {
534
+ return { reasoning: false, latencyMs, error: `HTTP ${response.status}: ${response.statusText}` };
535
+ }
536
+ const data = await response.json();
537
+ const field = detectReasoningField(data);
538
+ if (field) return { reasoning: true, field, latencyMs };
539
+ return { reasoning: false, latencyMs };
540
+ } catch (err) {
541
+ const latencyMs = Math.round(performance2.now() - started);
542
+ if (timedOut) return { reasoning: false, latencyMs, error: `timeout after ${opts.timeoutMs}ms` };
543
+ if (opts.signal?.aborted) return { reasoning: false, latencyMs, error: "aborted by caller" };
544
+ return { reasoning: false, latencyMs, error: err instanceof Error ? err.message : String(err) };
545
+ } finally {
546
+ clearTimeout(timer);
547
+ if (opts.signal) opts.signal.removeEventListener("abort", onExternalAbort);
548
+ }
549
+ }
550
+
551
+ // src/domains/providers/runtimes/common/probe-helpers.ts
552
+ init_esm_shims();
553
+
554
+ // src/domains/providers/types/context-window-slots.ts
555
+ init_esm_shims();
556
+ function formatContextWindowSlots(contextWindow, slots) {
557
+ const format = (n) => Math.round(n).toLocaleString("en-US");
558
+ return `${format(contextWindow)} (${format(slots.totalContextSize)} / ${slots.slots} slots)`;
559
+ }
560
+
561
+ // src/domains/providers/runtimes/common/probe-helpers.ts
562
+ async function probeUrl(url2, ctx, method = "GET") {
563
+ const base = { url: url2, timeoutMs: ctx.httpTimeoutMs, method };
564
+ return ctx.signal ? probeHttp({ ...base, signal: ctx.signal }) : probeHttp(base);
565
+ }
566
+ async function probeOpenAIModels(base, ctx, modelsPath = "/v1/models") {
567
+ return (await probeOpenAIModelCatalog(base, ctx, modelsPath)).models;
568
+ }
569
+ var OPENAI_COMPAT_DETAIL_PATHS = ["/api/v0/models"];
570
+ async function probeModelDetailRows(base, ctx, modelsPath) {
571
+ const rows = /* @__PURE__ */ new Map();
572
+ for (const detailPath of OPENAI_COMPAT_DETAIL_PATHS) {
573
+ if (detailPath === modelsPath) continue;
574
+ const opts = { url: `${base}${detailPath}`, timeoutMs: ctx.httpTimeoutMs };
575
+ const result = await (ctx.signal ? probeJson({ ...opts, signal: ctx.signal }) : probeJson(opts));
576
+ if (!result.ok || !Array.isArray(result.data?.data)) continue;
577
+ for (const row of result.data.data) {
578
+ if (typeof row?.id !== "string" || row.id.length === 0) continue;
579
+ if (!rows.has(row.id)) rows.set(row.id, row);
580
+ }
581
+ if (rows.size > 0) break;
582
+ }
583
+ return rows;
584
+ }
585
+ async function probeOpenAIModelCatalog(base, ctx, modelsPath = "/v1/models") {
586
+ const opts = { url: `${base}${modelsPath}`, timeoutMs: ctx.httpTimeoutMs };
587
+ const result = await (ctx.signal ? probeJson({ ...opts, signal: ctx.signal }) : probeJson(opts));
588
+ if (!result.ok || !result.data?.data) return { models: [], modelCapabilities: {}, modelStates: {} };
589
+ const detail = await probeModelDetailRows(base, ctx, modelsPath);
590
+ const models = [];
591
+ const modelCapabilities = {};
592
+ const modelStates = {};
593
+ for (const row of result.data.data) {
594
+ if (typeof row?.id !== "string" || row.id.length === 0) continue;
595
+ models.push(row.id);
596
+ const detailRow = detail.get(row.id);
597
+ const caps = {
598
+ ...detailRow ? capabilitiesFromOpenAIModelEntry(detailRow) : {},
599
+ ...capabilitiesFromOpenAIModelEntry(row)
600
+ };
601
+ if (Object.keys(caps).length > 0) modelCapabilities[row.id] = caps;
602
+ const loadedContext = loadedContextFromEntry(row) ?? (detailRow ? loadedContextFromEntry(detailRow) : void 0);
603
+ const state = modelStateFromOpenAIModelEntry(row) ?? (detailRow ? modelStateFromOpenAIModelEntry(detailRow) : void 0) ?? // A reported loaded context is itself the residency answer: nothing
604
+ // serves a window for a model it has not loaded.
605
+ (loadedContext !== void 0 ? { state: "loaded" } : void 0);
606
+ const contextSlots = contextSlotsFromEntry(row) ?? (detailRow ? contextSlotsFromEntry(detailRow) : void 0);
607
+ const withSlots = contextSlots ? { ...state ?? { state: "unknown" }, contextSlots } : state;
608
+ if (withSlots) {
609
+ modelStates[row.id] = loadedContext === void 0 ? withSlots : { ...withSlots, contextLength: loadedContext };
610
+ }
611
+ }
612
+ return { models, modelCapabilities, modelStates };
613
+ }
614
+ function isRecord2(value) {
615
+ return value !== null && typeof value === "object" && !Array.isArray(value);
616
+ }
617
+ function positiveNumber(value) {
618
+ return typeof value === "number" && Number.isFinite(value) && value > 0 ? value : void 0;
619
+ }
620
+ function firstPositiveNumber(record, keys) {
621
+ for (const key of keys) {
622
+ const value = positiveNumber(record[key]);
623
+ if (value !== void 0) return value;
624
+ }
625
+ return void 0;
626
+ }
627
+ function capabilityListFlag(record, name) {
628
+ const list = record.capabilities;
629
+ if (!Array.isArray(list)) return void 0;
630
+ return list.some((entry) => entry === name) ? true : void 0;
631
+ }
632
+ function booleanFromAny(record, keys) {
633
+ for (const key of keys) {
634
+ const value = record[key];
635
+ if (typeof value === "boolean") return value;
636
+ }
637
+ return void 0;
638
+ }
639
+ function nestedRecord(record, key) {
640
+ const value = record[key];
641
+ return isRecord2(value) ? value : null;
642
+ }
643
+ function firstString(record, keys) {
644
+ if (!record) return void 0;
645
+ for (const key of keys) {
646
+ const value = record[key];
647
+ if (typeof value === "string" && value.trim().length > 0) return value.trim();
648
+ }
649
+ return void 0;
650
+ }
651
+ function firstBoolean(record, keys) {
652
+ if (!record) return void 0;
653
+ for (const key of keys) {
654
+ const value = record[key];
655
+ if (typeof value === "boolean") return value;
656
+ }
657
+ return void 0;
658
+ }
659
+ function normalizeModelState(raw) {
660
+ const value = raw?.trim().toLowerCase().replace(/[\s_]+/g, "-");
661
+ if (!value) return void 0;
662
+ if (value === "loaded" || value === "ready" || value === "running" || value === "active") return "loaded";
663
+ if (value === "loading" || value === "pending" || value === "queued" || value === "starting") return "loading";
664
+ if (value === "unloaded" || value === "not-loaded" || value === "idle" || value === "sleeping" || value === "stopped") {
665
+ return "unloaded";
666
+ }
667
+ if (value === "failed" || value === "error" || value === "errored") return "failed";
668
+ if (value === "unknown") return "unknown";
669
+ return void 0;
670
+ }
671
+ function modelStateFromOpenAIModelEntry(row) {
672
+ const status = nestedRecord(row, "status");
673
+ const failed = firstBoolean(status, ["failed"]) ?? firstBoolean(row, ["failed"]);
674
+ if (failed === true) {
675
+ const detail = firstString(status, ["error", "reason", "message"]) ?? firstString(row, ["error", "reason", "message"]);
676
+ return detail ? { state: "failed", detail } : { state: "failed" };
677
+ }
678
+ const raw = typeof row.status === "string" ? row.status : firstString(status, ["value", "state", "status"]) ?? firstString(row, ["state"]);
679
+ const normalized = normalizeModelState(raw);
680
+ if (normalized) {
681
+ const detail = firstString(status, ["detail", "message", "reason"]);
682
+ return detail ? { state: normalized, detail } : { state: normalized };
683
+ }
684
+ const loaded = firstBoolean(status, ["loaded"]) ?? firstBoolean(row, ["loaded"]);
685
+ if (loaded === true) return { state: "loaded" };
686
+ if (loaded === false) return { state: "unloaded" };
687
+ return void 0;
688
+ }
689
+ function loadedContextFromEntry(row) {
690
+ const reported = firstPositiveNumber(row, ["loaded_context_length", "loadedContextLength"]);
691
+ return reported === void 0 ? void 0 : Math.floor(reported);
692
+ }
693
+ function statusArgsFromEntry(row) {
694
+ const status = nestedRecord(row, "status");
695
+ return argsFromStatus(status);
696
+ }
697
+ function contextSlotsFromEntry(row) {
698
+ return llamaCppRequestContextWindow(parseLlamaCppServerFlags(statusArgsFromEntry(row)))?.slots;
699
+ }
700
+ function capabilitiesFromOpenAIModelEntry(row) {
701
+ const caps = {};
702
+ const meta = nestedRecord(row, "meta");
703
+ const flags = parseLlamaCppServerFlags(statusArgsFromEntry(row));
704
+ const contextWindow = llamaCppRequestContextWindow(flags)?.contextWindow ?? firstPositiveNumber(row, [
705
+ // What is actually loaded outranks what the model could support: a
706
+ // model served at 8k out of a possible 262k has an 8k window today,
707
+ // and the run has to be planned against the real one.
708
+ "loaded_context_length",
709
+ "loadedContextLength",
710
+ "context_window",
711
+ "contextWindow",
712
+ "context_length",
713
+ "contextLength",
714
+ "max_context_length",
715
+ "maxContextLength",
716
+ "n_ctx"
717
+ ]) ?? (meta ? firstPositiveNumber(meta, ["n_ctx", "n_ctx_train", "context_length", "contextWindow"]) : void 0);
718
+ if (contextWindow !== void 0) caps.contextWindow = Math.floor(contextWindow);
719
+ const maxTokens = positiveNumber(flags.maxTokens) ?? firstPositiveNumber(row, [
720
+ "max_output_tokens",
721
+ "maxOutputTokens",
722
+ "max_completion_tokens",
723
+ "maxCompletionTokens",
724
+ "max_tokens",
725
+ "maxTokens",
726
+ "n_predict"
727
+ ]);
728
+ if (maxTokens !== void 0) caps.maxTokens = Math.floor(maxTokens);
729
+ const tools = flags.jinja ?? booleanFromAny(row, ["tools", "tool_use", "toolUse", "trained_for_tool_use"]) ?? capabilityListFlag(row, "tool_use");
730
+ if (tools !== void 0) caps.tools = tools;
731
+ const reasoning = flags.reasoning ?? (flags.reasoningBudget !== void 0 ? true : void 0) ?? booleanFromAny(row, ["reasoning", "thinking"]);
732
+ if (reasoning !== void 0) caps.reasoning = reasoning;
733
+ const architecture = nestedRecord(row, "architecture");
734
+ const architectureInput = architecture?.input_modalities;
735
+ const modalities = Array.isArray(row.modalities) ? row.modalities : Array.isArray(row.input) ? row.input : Array.isArray(architectureInput) ? architectureInput : null;
736
+ if (modalities) {
737
+ caps.vision = modalities.some((entry) => entry === "image" || entry === "vision");
738
+ if (modalities.some((entry) => entry === "audio")) caps.audio = true;
739
+ }
740
+ return caps;
741
+ }
742
+ function modelEntries(payload) {
743
+ if (!Array.isArray(payload?.data)) return [];
744
+ const out = [];
745
+ for (const row of payload.data) {
746
+ if (typeof row?.id !== "string" || row.id.length === 0) continue;
747
+ out.push({ id: row.id, status: row.status });
748
+ }
749
+ return out;
750
+ }
751
+ async function probeOpenAIModelEntries(base, ctx) {
752
+ const opts = { url: `${base}/v1/models`, timeoutMs: ctx.httpTimeoutMs };
753
+ const result = await (ctx.signal ? probeJson({ ...opts, signal: ctx.signal }) : probeJson(opts));
754
+ if (!result.ok) return [];
755
+ return modelEntries(result.data);
756
+ }
757
+ function llamaCppRequestContextWindow(flags) {
758
+ const total = positiveNumber(flags.contextSize);
759
+ if (total === void 0) return void 0;
760
+ const parallel = positiveNumber(flags.parallel);
761
+ if (parallel === void 0 || parallel <= 1 || flags.kvUnified === true) return { contextWindow: Math.floor(total) };
762
+ const slots = Math.floor(parallel);
763
+ return {
764
+ contextWindow: Math.floor(total / slots),
765
+ slots: { totalContextSize: Math.floor(total), slots }
766
+ };
767
+ }
768
+ function argsFromStatus(status) {
769
+ if (!isRecord2(status)) return [];
770
+ const args = status.args;
771
+ if (Array.isArray(args)) return args.filter((entry) => typeof entry === "string");
772
+ if (typeof args === "string") return args.trim().split(/\s+/).filter(Boolean);
773
+ return [];
774
+ }
775
+ function looksLikeFlag(token) {
776
+ return token.startsWith("-") && Number.isNaN(Number(token));
777
+ }
778
+ function valueAfter(args, ...flags) {
779
+ for (const flag of flags) {
780
+ const index = args.indexOf(flag);
781
+ if (index < 0) continue;
782
+ const value = args[index + 1];
783
+ return value && !looksLikeFlag(value) ? value : void 0;
784
+ }
785
+ return void 0;
786
+ }
787
+ function numberFlag(args, ...flags) {
788
+ const value = valueAfter(args, ...flags);
789
+ if (value === void 0) return void 0;
790
+ const parsed = Number(value);
791
+ return Number.isFinite(parsed) ? parsed : void 0;
792
+ }
793
+ function booleanFlag(args, ...flags) {
794
+ const flag = flags.find((candidate) => args.includes(candidate));
795
+ if (flag === void 0) return void 0;
796
+ const value = valueAfter(args, flag);
797
+ if (value === void 0) return true;
798
+ const normalized = value.toLowerCase();
799
+ if (normalized === "true" || normalized === "on" || normalized === "1") return true;
800
+ if (normalized === "false" || normalized === "off" || normalized === "0") return false;
801
+ return void 0;
802
+ }
803
+ function parseLlamaCppServerFlags(args) {
804
+ const flags = {};
805
+ const ctxSize = numberFlag(args, "--ctx-size", "-c");
806
+ if (ctxSize !== void 0) flags.contextSize = ctxSize;
807
+ const maxTokens = numberFlag(args, "--n-predict");
808
+ if (maxTokens !== void 0) flags.maxTokens = maxTokens;
809
+ const flashAttention = booleanFlag(args, "--flash-attn");
810
+ if (flashAttention !== void 0) flags.flashAttention = flashAttention;
811
+ const jinja = booleanFlag(args, "--jinja");
812
+ if (jinja !== void 0) flags.jinja = jinja;
813
+ const reasoningRaw = valueAfter(args, "--reasoning");
814
+ if (reasoningRaw) flags.reasoning = reasoningRaw === "on" || reasoningRaw === "true" || reasoningRaw === "1";
815
+ const reasoningBudget = numberFlag(args, "--reasoning-budget");
816
+ if (reasoningBudget !== void 0) flags.reasoningBudget = reasoningBudget;
817
+ const temperature = numberFlag(args, "--temperature");
818
+ if (temperature !== void 0) flags.temperature = temperature;
819
+ const topP = numberFlag(args, "--top-p");
820
+ if (topP !== void 0) flags.topP = topP;
821
+ const topK = numberFlag(args, "--top-k");
822
+ if (topK !== void 0) flags.topK = topK;
823
+ const nGpuLayers = numberFlag(args, "--n-gpu-layers");
824
+ if (nGpuLayers !== void 0) flags.nGpuLayers = nGpuLayers;
825
+ const parallel = numberFlag(args, "--parallel", "-np");
826
+ if (parallel !== void 0) flags.parallel = parallel;
827
+ const kvUnifiedAt = Math.max(args.lastIndexOf("--kv-unified"), args.lastIndexOf("-kvu"));
828
+ const noKvUnifiedAt = args.lastIndexOf("--no-kv-unified");
829
+ if (noKvUnifiedAt > kvUnifiedAt) flags.kvUnified = false;
830
+ else if (kvUnifiedAt >= 0) flags.kvUnified = booleanFlag(args, "--kv-unified", "-kvu") ?? true;
831
+ const cacheTypeK = valueAfter(args, "--cache-type-k");
832
+ if (cacheTypeK) flags.cacheTypeK = cacheTypeK;
833
+ const cacheTypeV = valueAfter(args, "--cache-type-v");
834
+ if (cacheTypeV) flags.cacheTypeV = cacheTypeV;
835
+ const mmproj = valueAfter(args, "--mmproj");
836
+ if (mmproj) flags.mmproj = mmproj;
837
+ const chatTemplateKwargs = valueAfter(args, "--chat-template-kwargs");
838
+ if (chatTemplateKwargs) flags.chatTemplateKwargs = chatTemplateKwargs;
839
+ return flags;
840
+ }
841
+ function selectedModelEntry(entries, target) {
842
+ const expected = target.defaultModel?.trim();
843
+ if (expected) return entries.find((entry) => entry.id === expected) ?? null;
844
+ return entries[0] ?? null;
845
+ }
846
+ function statusNotes(id, status) {
847
+ if (!isRecord2(status)) return [];
848
+ const notes = [];
849
+ if (status.failed === true) notes.push(`llama.cpp router marks ${id} as failed`);
850
+ const state = typeof status.state === "string" ? status.state : void 0;
851
+ if (state === "loading") notes.push(`llama.cpp router reports ${id} is still loading`);
852
+ return notes;
853
+ }
854
+ async function probeLlamaCppModelStatus(base, target, ctx) {
855
+ const entries = await probeOpenAIModelEntries(base, ctx);
856
+ const selected = selectedModelEntry(entries, target);
857
+ if (!selected) return {};
858
+ const args = argsFromStatus(selected.status);
859
+ if (args.length === 0) return { notes: statusNotes(selected.id, selected.status) };
860
+ const flags = parseLlamaCppServerFlags(args);
861
+ const caps = {};
862
+ const window = llamaCppRequestContextWindow(flags);
863
+ if (window !== void 0) caps.contextWindow = window.contextWindow;
864
+ if (flags.maxTokens !== void 0 && flags.maxTokens > 0) caps.maxTokens = flags.maxTokens;
865
+ if (flags.reasoning === true || flags.reasoningBudget !== void 0) caps.reasoning = true;
866
+ if (flags.mmproj) caps.vision = true;
867
+ if (flags.jinja === true) caps.tools = true;
868
+ const enrichment = { modelId: selected.id, serverFlags: flags };
869
+ if (Object.keys(caps).length > 0) enrichment.discoveredCapabilities = caps;
870
+ const notes = statusNotes(selected.id, selected.status);
871
+ if (window?.slots) {
872
+ notes.push(
873
+ `${selected.id} context window ${formatContextWindowSlots(window.contextWindow, window.slots)}: --ctx-size is split across --parallel slots without --kv-unified`
874
+ );
875
+ }
876
+ if (notes.length > 0) enrichment.notes = notes;
877
+ return enrichment;
878
+ }
879
+ async function detectModelMismatch(base, target, ctx) {
880
+ const expected = target.defaultModel?.trim();
881
+ if (!expected) return null;
882
+ const ids = await probeOpenAIModels(base, ctx);
883
+ if (ids.length === 0) return null;
884
+ if (ids.includes(expected)) return null;
885
+ const loaded = ids[0] ?? "(unknown)";
886
+ return `wire model id ${expected} does not match server's loaded model ${loaded}; llama.cpp serves a single fixed model`;
887
+ }
888
+ async function probeLlamaCppProps(base, ctx) {
889
+ const opts = { url: `${base}/props`, timeoutMs: ctx.httpTimeoutMs };
890
+ const result = await (ctx.signal ? probeJson({ ...opts, signal: ctx.signal }) : probeJson(opts));
891
+ if (!result.ok || !result.data) return {};
892
+ const data = result.data;
893
+ const enrichment = {};
894
+ const caps = {};
895
+ const nCtx = data.default_generation_settings?.n_ctx;
896
+ if (typeof nCtx === "number" && nCtx > 0) caps.contextWindow = nCtx;
897
+ const nPredict = data.default_generation_settings?.n_predict;
898
+ if (typeof nPredict === "number" && nPredict > 0) caps.maxTokens = nPredict;
899
+ const vision = data.modalities?.vision;
900
+ if (typeof vision === "boolean") caps.vision = vision;
901
+ if (Object.keys(caps).length > 0) enrichment.discoveredCapabilities = caps;
902
+ if (typeof data.build_info === "string" && data.build_info.length > 0) {
903
+ enrichment.serverVersion = data.build_info;
904
+ }
905
+ return enrichment;
906
+ }
907
+
908
+ // src/domains/providers/runtimes/protocol/openai-compat.ts
909
+ function synthesizeOpenAICompatModel(input) {
910
+ return synthLocalModel({
911
+ target: input.target,
912
+ wireModelId: input.wireModelId,
913
+ kb: input.kb,
914
+ defaultCapabilities: input.defaultCapabilities,
915
+ apiFamily: input.apiFamily ?? "openai-completions",
916
+ provider: input.provider,
917
+ baseUrlForTarget: input.baseUrlForTarget ?? withV1
918
+ });
919
+ }
920
+ function makeOpenAICompatRuntime(spec) {
921
+ const apiFamily = spec.apiFamily ?? "openai-completions";
922
+ const asIs = spec.baseUrlStyle === "asIs";
923
+ const baseUrlForTarget = asIs ? withAsIs : withV1;
924
+ const healthPath = spec.healthPath ?? "/v1/models";
925
+ const modelsPath = spec.modelsPath ?? "/v1/models";
926
+ const probeBase = asIs ? targetBaseUrl : targetRootUrl;
927
+ return {
928
+ id: spec.id,
929
+ displayName: spec.displayName,
930
+ kind: "http",
931
+ tier: spec.tier,
932
+ apiFamily,
933
+ auth: spec.auth,
934
+ defaultCapabilities: spec.defaultCapabilities,
935
+ async probe(target, ctx) {
936
+ const base = probeBase(target);
937
+ if (!base) return { ok: false, error: "target has no url" };
938
+ const health = await probeUrl(`${base}${healthPath}`, ctx);
939
+ if (!health.ok) return health;
940
+ const catalog = await probeOpenAIModelCatalog(base, ctx, modelsPath);
941
+ const result = { ...health };
942
+ if (catalog.models.length > 0) result.models = catalog.models;
943
+ if (Object.keys(catalog.modelStates).length > 0) result.modelStates = catalog.modelStates;
944
+ if (Object.keys(catalog.modelCapabilities).length > 0) {
945
+ result.modelCapabilities = catalog.modelCapabilities;
946
+ const selected = target.defaultModel?.trim();
947
+ const selectedCaps = selected ? catalog.modelCapabilities[selected] : void 0;
948
+ if (selected && selectedCaps) {
949
+ result.discoveredCapabilities = selectedCaps;
950
+ result.capabilityModelId = selected;
951
+ }
952
+ }
953
+ return result;
954
+ },
955
+ async probeModels(target, ctx) {
956
+ const base = probeBase(target);
957
+ if (!base) return [];
958
+ return probeOpenAIModels(base, ctx, modelsPath);
959
+ },
960
+ async probeReasoning(target, modelId, ctx) {
961
+ const base = probeBase(target);
962
+ if (!base) return { reasoning: false, latencyMs: 0, error: "target has no url" };
963
+ const apiKeyEnv = target.auth?.apiKeyEnvVar;
964
+ const apiKey = apiKeyEnv && ctx.credentialsPresent.has(apiKeyEnv) ? process.env[apiKeyEnv] : void 0;
965
+ const probeOpts = {
966
+ baseUrl: base,
967
+ modelId,
968
+ timeoutMs: Math.max(ctx.httpTimeoutMs, 8e3)
969
+ };
970
+ if (apiKey) probeOpts.apiKey = apiKey;
971
+ if (ctx.signal) probeOpts.signal = ctx.signal;
972
+ return probeOpenAICompatReasoning(probeOpts);
973
+ },
974
+ synthesizeModel(target, wireModelId, kb) {
975
+ return synthesizeOpenAICompatModel({
976
+ target,
977
+ wireModelId,
978
+ kb,
979
+ defaultCapabilities: spec.defaultCapabilities,
980
+ apiFamily,
981
+ provider: spec.provider,
982
+ baseUrlForTarget
983
+ });
984
+ }
985
+ };
986
+ }
987
+ var defaultCapabilities = {
988
+ chat: true,
989
+ tools: false,
990
+ reasoning: false,
991
+ vision: false,
992
+ audio: false,
993
+ embeddings: false,
994
+ rerank: false,
995
+ fim: false,
996
+ contextWindow: CLIO_MIN_CONTEXT_WINDOW,
997
+ maxTokens: CLIO_MIN_MAX_OUTPUT_TOKENS
998
+ };
999
+ var openai_compat_default = makeOpenAICompatRuntime({
1000
+ id: "openai-compat",
1001
+ displayName: "Generic OpenAI-compatible",
1002
+ provider: "openai-compat",
1003
+ auth: "api-key",
1004
+ tier: "protocol",
1005
+ defaultCapabilities
1006
+ });
1007
+
1008
+ // src/domains/providers/runtimes/cloud/alcf.ts
1009
+ var CATALOG_URL = "https://inference-api.alcf.anl.gov/resource_server/list-endpoints";
1010
+ var GATEWAY_ORIGIN = "https://inference-api.alcf.anl.gov/resource_server";
1011
+ var defaultCapabilities2 = {
1012
+ chat: true,
1013
+ tools: true,
1014
+ toolCallFormat: "openai",
1015
+ reasoning: true,
1016
+ vision: false,
1017
+ audio: false,
1018
+ embeddings: false,
1019
+ rerank: false,
1020
+ fim: false,
1021
+ contextWindow: 32768,
1022
+ maxTokens: 4096
1023
+ };
1024
+ var KNOWN_MODELS = [
1025
+ "openai/gpt-oss-120b",
1026
+ "openai/gpt-oss-20b",
1027
+ "gpt-oss-120b",
1028
+ "meta-llama/Llama-4-Maverick-17B-128E-Instruct-FP8",
1029
+ "meta-llama/Llama-4-Scout-17B-16E-Instruct"
1030
+ ];
1031
+ function clusterFromUrl(url2) {
1032
+ if (!url2) return null;
1033
+ const match = /\/resource_server\/([^/]+)\//.exec(url2);
1034
+ return match ? match[1] ?? null : null;
1035
+ }
1036
+ function frameworkForCluster(cluster) {
1037
+ return cluster === "metis" ? "api" : "vllm";
1038
+ }
1039
+ function catalogModels(payload, cluster, framework) {
1040
+ const models = payload.clusters?.[cluster]?.frameworks?.[framework]?.models;
1041
+ if (!Array.isArray(models)) return [];
1042
+ return models.map((model) => String(model).trim()).filter((model) => model.length > 0);
1043
+ }
1044
+ function runningModels(payload) {
1045
+ const out = [];
1046
+ for (const job of payload.running ?? []) {
1047
+ for (const raw of String(job.Models ?? "").split(",")) {
1048
+ const id = raw.trim();
1049
+ if (id.length > 0) out.push(id);
1050
+ }
1051
+ }
1052
+ return out;
1053
+ }
1054
+ function dedupe(ids) {
1055
+ const seen = /* @__PURE__ */ new Set();
1056
+ const out = [];
1057
+ for (const id of ids) {
1058
+ if (seen.has(id)) continue;
1059
+ seen.add(id);
1060
+ out.push(id);
1061
+ }
1062
+ return out;
1063
+ }
1064
+ function authHeaders(ctx) {
1065
+ return { Authorization: `Bearer ${ctx.authToken}`, Accept: "application/json" };
1066
+ }
1067
+ async function discover(target, ctx) {
1068
+ if (!target.url) return { ok: false, error: "ALCF target has no url" };
1069
+ const cluster = clusterFromUrl(target.url);
1070
+ if (!cluster) {
1071
+ return { ok: false, error: `cannot determine ALCF cluster from url ${target.url}` };
1072
+ }
1073
+ if (!ctx.authToken) {
1074
+ return { ok: false, error: "ALCF requires Globus auth; run `clio-coder auth login alcf`." };
1075
+ }
1076
+ const framework = frameworkForCluster(cluster);
1077
+ const headers = authHeaders(ctx);
1078
+ const catalog = await probeJson({
1079
+ url: CATALOG_URL,
1080
+ headers,
1081
+ timeoutMs: ctx.httpTimeoutMs,
1082
+ ...ctx.signal ? { signal: ctx.signal } : {}
1083
+ });
1084
+ if (!catalog.ok || !catalog.data) {
1085
+ const reason = catalog.error ?? "unknown error";
1086
+ const hint = reason.includes("401") ? " (token expired or rejected; run `clio-coder auth login alcf` again)" : "";
1087
+ return {
1088
+ ok: false,
1089
+ error: `ALCF endpoint catalog unreachable: ${reason}${hint}`,
1090
+ ...catalog.latencyMs !== void 0 ? { latencyMs: catalog.latencyMs } : {}
1091
+ };
1092
+ }
1093
+ const fromCatalog = catalogModels(catalog.data, cluster, framework);
1094
+ let live = [];
1095
+ try {
1096
+ const jobs = await probeJson({
1097
+ url: `${GATEWAY_ORIGIN}/${cluster}/jobs`,
1098
+ headers,
1099
+ timeoutMs: Math.min(ctx.httpTimeoutMs, 12e3),
1100
+ ...ctx.signal ? { signal: ctx.signal } : {}
1101
+ });
1102
+ if (jobs.ok && jobs.data) live = runningModels(jobs.data);
1103
+ } catch {
1104
+ }
1105
+ const models = dedupe([...fromCatalog, ...live]);
1106
+ const result = { ok: true, models };
1107
+ if (catalog.latencyMs !== void 0) result.latencyMs = catalog.latencyMs;
1108
+ if (models.length === 0) {
1109
+ result.notes = [`ALCF ${cluster}/${framework} reported no models; the gateway may have no running jobs.`];
1110
+ }
1111
+ return result;
1112
+ }
1113
+ var alcfRuntime = {
1114
+ id: "alcf",
1115
+ displayName: "ALCF Inference (Globus)",
1116
+ kind: "http",
1117
+ tier: "cloud",
1118
+ apiFamily: "openai-completions",
1119
+ auth: "oauth",
1120
+ knownModels: KNOWN_MODELS,
1121
+ defaultCapabilities: defaultCapabilities2,
1122
+ probe(target, ctx) {
1123
+ return discover(target, ctx);
1124
+ },
1125
+ async probeModels(target, ctx) {
1126
+ const result = await discover(target, ctx);
1127
+ return result.models ?? [];
1128
+ },
1129
+ synthesizeModel(target, wireModelId, kb) {
1130
+ const model = synthesizeOpenAICompatModel({
1131
+ target,
1132
+ wireModelId,
1133
+ kb,
1134
+ defaultCapabilities: defaultCapabilities2,
1135
+ apiFamily: "openai-completions",
1136
+ provider: "alcf",
1137
+ baseUrlForTarget: withAsIs
1138
+ });
1139
+ const meta = model.clio;
1140
+ if (meta) meta.chatTemplateKwargsUnsupported = true;
1141
+ return model;
1142
+ }
1143
+ };
1144
+ var alcf_default = alcfRuntime;
1145
+
1146
+ // src/domains/providers/runtimes/cloud/anthropic.ts
1147
+ init_esm_shims();
1148
+
1149
+ // src/domains/providers/runtimes/protocol/anthropic-messages.ts
1150
+ init_esm_shims();
1151
+ function synthesizeAnthropicMessagesModel(input) {
1152
+ return synthesizeCatalogBackedModel({
1153
+ target: input.target,
1154
+ wireModelId: input.wireModelId,
1155
+ kb: input.kb,
1156
+ defaultCapabilities: input.defaultCapabilities,
1157
+ runtimeId: "anthropic",
1158
+ api: "anthropic-messages",
1159
+ provider: input.provider,
1160
+ defaultBaseUrl: input.defaultBaseUrl
1161
+ });
1162
+ }
1163
+
1164
+ // src/domains/providers/runtimes/cloud/anthropic.ts
1165
+ var defaultCapabilities3 = {
1166
+ chat: true,
1167
+ tools: true,
1168
+ toolCallFormat: "anthropic",
1169
+ reasoning: true,
1170
+ thinkingFormat: "anthropic-extended",
1171
+ vision: true,
1172
+ audio: false,
1173
+ embeddings: false,
1174
+ rerank: false,
1175
+ fim: false,
1176
+ contextWindow: 2e5,
1177
+ maxTokens: 8192
1178
+ };
1179
+ var anthropicRuntime = {
1180
+ id: "anthropic",
1181
+ displayName: "Anthropic",
1182
+ kind: "http",
1183
+ tier: "cloud",
1184
+ apiFamily: "anthropic-messages",
1185
+ auth: "api-key",
1186
+ credentialsEnvVar: "ANTHROPIC_API_KEY",
1187
+ defaultCapabilities: defaultCapabilities3,
1188
+ synthesizeModel(target, wireModelId, kb) {
1189
+ return synthesizeAnthropicMessagesModel({
1190
+ target,
1191
+ wireModelId,
1192
+ kb,
1193
+ defaultCapabilities: defaultCapabilities3,
1194
+ provider: "anthropic",
1195
+ defaultBaseUrl: "https://api.anthropic.com"
1196
+ });
1197
+ }
1198
+ };
1199
+ var anthropic_default = anthropicRuntime;
1200
+
1201
+ // src/domains/providers/runtimes/cloud/anthropic-max.ts
1202
+ init_esm_shims();
1203
+ var defaultCapabilities4 = {
1204
+ chat: true,
1205
+ tools: true,
1206
+ toolCallFormat: "anthropic",
1207
+ reasoning: true,
1208
+ thinkingFormat: "anthropic-extended",
1209
+ vision: true,
1210
+ audio: false,
1211
+ embeddings: false,
1212
+ rerank: false,
1213
+ fim: false,
1214
+ contextWindow: 2e5,
1215
+ maxTokens: 8192
1216
+ };
1217
+ var anthropicMaxRuntime = {
1218
+ id: "anthropic-max",
1219
+ displayName: "Anthropic (Claude Pro/Max)",
1220
+ kind: "http",
1221
+ tier: "cloud",
1222
+ apiFamily: "anthropic-messages",
1223
+ auth: "oauth",
1224
+ oauthProviderId: "anthropic",
1225
+ authNotice: "Connects with your Claude Pro/Max subscription via OAuth (the same path Claude Code uses). Using subscription credentials outside Anthropic's first-party apps may not align with their terms of service; enable at your own discretion.",
1226
+ defaultCapabilities: defaultCapabilities4,
1227
+ async probeModels(_target, _ctx) {
1228
+ return listCatalogModelsForRuntime("anthropic-max").map((model) => model.id);
1229
+ },
1230
+ synthesizeModel(target, wireModelId, kb) {
1231
+ return synthesizeCatalogBackedModel({
1232
+ target,
1233
+ wireModelId,
1234
+ kb,
1235
+ defaultCapabilities: defaultCapabilities4,
1236
+ runtimeId: "anthropic-max",
1237
+ api: "anthropic-messages",
1238
+ provider: "anthropic",
1239
+ defaultBaseUrl: "https://api.anthropic.com"
1240
+ });
1241
+ }
1242
+ };
1243
+ var anthropic_max_default = anthropicMaxRuntime;
1244
+
1245
+ // src/domains/providers/runtimes/cloud/bedrock.ts
1246
+ init_esm_shims();
1247
+
1248
+ // src/domains/providers/runtimes/protocol/bedrock.ts
1249
+ init_esm_shims();
1250
+ function synthesizeBedrockModel(input) {
1251
+ return synthesizeCatalogBackedModel({
1252
+ target: input.target,
1253
+ wireModelId: input.wireModelId,
1254
+ kb: input.kb,
1255
+ defaultCapabilities: input.defaultCapabilities,
1256
+ runtimeId: "bedrock",
1257
+ api: "bedrock-converse-stream",
1258
+ provider: "amazon-bedrock",
1259
+ defaultBaseUrl: ""
1260
+ });
1261
+ }
1262
+
1263
+ // src/domains/providers/runtimes/cloud/bedrock.ts
1264
+ var defaultCapabilities5 = {
1265
+ chat: true,
1266
+ tools: true,
1267
+ toolCallFormat: "anthropic",
1268
+ reasoning: true,
1269
+ thinkingFormat: "anthropic-extended",
1270
+ vision: false,
1271
+ audio: false,
1272
+ embeddings: false,
1273
+ rerank: false,
1274
+ fim: false,
1275
+ contextWindow: 2e5,
1276
+ maxTokens: 8192
1277
+ };
1278
+ var bedrockRuntime = {
1279
+ id: "bedrock",
1280
+ displayName: "Amazon Bedrock",
1281
+ kind: "http",
1282
+ tier: "cloud",
1283
+ apiFamily: "bedrock-converse-stream",
1284
+ auth: "aws-sdk",
1285
+ defaultCapabilities: defaultCapabilities5,
1286
+ synthesizeModel(target, wireModelId, kb) {
1287
+ return synthesizeBedrockModel({ target, wireModelId, kb, defaultCapabilities: defaultCapabilities5 });
1288
+ }
1289
+ };
1290
+ var bedrock_default = bedrockRuntime;
1291
+
1292
+ // src/domains/providers/runtimes/cloud/deepseek.ts
1293
+ init_esm_shims();
1294
+ var defaultCapabilities6 = {
1295
+ chat: true,
1296
+ tools: true,
1297
+ toolCallFormat: "openai",
1298
+ reasoning: true,
1299
+ thinkingFormat: "deepseek-r1",
1300
+ vision: false,
1301
+ audio: false,
1302
+ embeddings: false,
1303
+ rerank: false,
1304
+ fim: false,
1305
+ contextWindow: 128e3,
1306
+ maxTokens: 65536
1307
+ };
1308
+ var deepseekRuntime = {
1309
+ id: "deepseek",
1310
+ displayName: "DeepSeek",
1311
+ kind: "http",
1312
+ tier: "cloud",
1313
+ apiFamily: "openai-completions",
1314
+ auth: "api-key",
1315
+ credentialsEnvVar: "DEEPSEEK_API_KEY",
1316
+ defaultCapabilities: defaultCapabilities6,
1317
+ async probeModels(_target, _ctx) {
1318
+ return listCatalogModelsForRuntime("deepseek").map((model) => model.id);
1319
+ },
1320
+ synthesizeModel(target, wireModelId, kb) {
1321
+ return synthesizeCatalogBackedModel({
1322
+ target,
1323
+ wireModelId,
1324
+ kb,
1325
+ defaultCapabilities: defaultCapabilities6,
1326
+ runtimeId: "deepseek",
1327
+ api: "openai-completions",
1328
+ provider: "deepseek",
1329
+ defaultBaseUrl: "https://api.deepseek.com"
1330
+ });
1331
+ }
1332
+ };
1333
+ var deepseek_default = deepseekRuntime;
1334
+
1335
+ // src/domains/providers/runtimes/cloud/google.ts
1336
+ init_esm_shims();
1337
+
1338
+ // src/domains/providers/runtimes/protocol/google.ts
1339
+ init_esm_shims();
1340
+ function synthesizeGoogleModel(input) {
1341
+ return synthesizeCatalogBackedModel({
1342
+ target: input.target,
1343
+ wireModelId: input.wireModelId,
1344
+ kb: input.kb,
1345
+ defaultCapabilities: input.defaultCapabilities,
1346
+ runtimeId: "google",
1347
+ api: "google-generative-ai",
1348
+ provider: "google",
1349
+ defaultBaseUrl: input.defaultBaseUrl
1350
+ });
1351
+ }
1352
+
1353
+ // src/domains/providers/runtimes/cloud/google.ts
1354
+ var defaultCapabilities7 = {
1355
+ chat: true,
1356
+ tools: true,
1357
+ toolCallFormat: "openai",
1358
+ reasoning: true,
1359
+ vision: true,
1360
+ audio: false,
1361
+ embeddings: false,
1362
+ rerank: false,
1363
+ fim: false,
1364
+ contextWindow: 2e6,
1365
+ maxTokens: 8192
1366
+ };
1367
+ var googleRuntime = {
1368
+ id: "google",
1369
+ displayName: "Google Generative AI",
1370
+ kind: "http",
1371
+ tier: "cloud",
1372
+ apiFamily: "google-generative-ai",
1373
+ auth: "api-key",
1374
+ credentialsEnvVar: "GOOGLE_API_KEY",
1375
+ defaultCapabilities: defaultCapabilities7,
1376
+ synthesizeModel(target, wireModelId, kb) {
1377
+ return synthesizeGoogleModel({
1378
+ target,
1379
+ wireModelId,
1380
+ kb,
1381
+ defaultCapabilities: defaultCapabilities7,
1382
+ defaultBaseUrl: "https://generativelanguage.googleapis.com/v1beta"
1383
+ });
1384
+ }
1385
+ };
1386
+ var google_default = googleRuntime;
1387
+
1388
+ // src/domains/providers/runtimes/cloud/groq.ts
1389
+ init_esm_shims();
1390
+ var defaultCapabilities8 = {
1391
+ chat: true,
1392
+ tools: true,
1393
+ toolCallFormat: "openai",
1394
+ reasoning: false,
1395
+ vision: false,
1396
+ audio: false,
1397
+ embeddings: false,
1398
+ rerank: false,
1399
+ fim: false,
1400
+ contextWindow: 128e3,
1401
+ maxTokens: 8192
1402
+ };
1403
+ var groqRuntime = {
1404
+ id: "groq",
1405
+ displayName: "Groq",
1406
+ kind: "http",
1407
+ tier: "cloud",
1408
+ apiFamily: "openai-completions",
1409
+ auth: "api-key",
1410
+ credentialsEnvVar: "GROQ_API_KEY",
1411
+ defaultCapabilities: defaultCapabilities8,
1412
+ synthesizeModel(target, wireModelId, kb) {
1413
+ return synthesizeCatalogBackedModel({
1414
+ target,
1415
+ wireModelId,
1416
+ kb,
1417
+ defaultCapabilities: defaultCapabilities8,
1418
+ runtimeId: "groq",
1419
+ api: "openai-completions",
1420
+ provider: "groq",
1421
+ defaultBaseUrl: "https://api.groq.com/openai/v1"
1422
+ });
1423
+ }
1424
+ };
1425
+ var groq_default = groqRuntime;
1426
+
1427
+ // src/domains/providers/runtimes/cloud/mistral.ts
1428
+ init_esm_shims();
1429
+ var defaultCapabilities9 = {
1430
+ chat: true,
1431
+ tools: true,
1432
+ toolCallFormat: "mistral",
1433
+ reasoning: false,
1434
+ vision: false,
1435
+ audio: false,
1436
+ embeddings: false,
1437
+ rerank: false,
1438
+ fim: false,
1439
+ contextWindow: 128e3,
1440
+ maxTokens: 8192
1441
+ };
1442
+ var mistralRuntime = {
1443
+ id: "mistral",
1444
+ displayName: "Mistral AI",
1445
+ kind: "http",
1446
+ tier: "cloud",
1447
+ apiFamily: "mistral-conversations",
1448
+ auth: "api-key",
1449
+ credentialsEnvVar: "MISTRAL_API_KEY",
1450
+ defaultCapabilities: defaultCapabilities9,
1451
+ synthesizeModel(target, wireModelId, kb) {
1452
+ return synthesizeCatalogBackedModel({
1453
+ target,
1454
+ wireModelId,
1455
+ kb,
1456
+ defaultCapabilities: defaultCapabilities9,
1457
+ runtimeId: "mistral",
1458
+ api: "mistral-conversations",
1459
+ provider: "mistral",
1460
+ defaultBaseUrl: "https://api.mistral.ai"
1461
+ });
1462
+ }
1463
+ };
1464
+ var mistral_default = mistralRuntime;
1465
+
1466
+ // src/domains/providers/runtimes/cloud/openai.ts
1467
+ init_esm_shims();
1468
+ var defaultCapabilities10 = {
1469
+ chat: true,
1470
+ tools: true,
1471
+ toolCallFormat: "openai",
1472
+ reasoning: true,
1473
+ vision: true,
1474
+ audio: false,
1475
+ embeddings: false,
1476
+ rerank: false,
1477
+ fim: false,
1478
+ contextWindow: 272e3,
1479
+ maxTokens: 16384
1480
+ };
1481
+ var openaiRuntime = {
1482
+ id: "openai",
1483
+ displayName: "OpenAI",
1484
+ kind: "http",
1485
+ tier: "cloud",
1486
+ apiFamily: "openai-responses",
1487
+ auth: "api-key",
1488
+ credentialsEnvVar: "OPENAI_API_KEY",
1489
+ defaultCapabilities: defaultCapabilities10,
1490
+ synthesizeModel(target, wireModelId, kb) {
1491
+ return synthesizeCatalogBackedModel({
1492
+ target,
1493
+ wireModelId,
1494
+ kb,
1495
+ defaultCapabilities: defaultCapabilities10,
1496
+ runtimeId: "openai",
1497
+ api: "openai-responses",
1498
+ provider: "openai",
1499
+ defaultBaseUrl: "https://api.openai.com/v1"
1500
+ });
1501
+ }
1502
+ };
1503
+ var openai_default = openaiRuntime;
1504
+
1505
+ // src/domains/providers/runtimes/cloud/openai-codex.ts
1506
+ init_esm_shims();
1507
+ var defaultCapabilities11 = {
1508
+ chat: true,
1509
+ tools: true,
1510
+ toolCallFormat: "openai",
1511
+ reasoning: true,
1512
+ thinkingFormat: "openai-codex",
1513
+ vision: true,
1514
+ audio: false,
1515
+ embeddings: false,
1516
+ rerank: false,
1517
+ fim: false,
1518
+ contextWindow: 272e3,
1519
+ maxTokens: 16384
1520
+ };
1521
+ var openaiCodexRuntime = {
1522
+ id: "openai-codex",
1523
+ displayName: "OpenAI Codex",
1524
+ kind: "http",
1525
+ tier: "cloud",
1526
+ apiFamily: "openai-codex-responses",
1527
+ auth: "oauth",
1528
+ defaultCapabilities: defaultCapabilities11,
1529
+ async probeModels(_target, _ctx) {
1530
+ return listCatalogModelsForRuntime("openai-codex").map((model) => model.id);
1531
+ },
1532
+ synthesizeModel(target, wireModelId, kb) {
1533
+ return synthesizeCatalogBackedModel({
1534
+ target,
1535
+ wireModelId,
1536
+ kb,
1537
+ defaultCapabilities: defaultCapabilities11,
1538
+ runtimeId: "openai-codex",
1539
+ api: "openai-codex-responses",
1540
+ provider: "openai-codex",
1541
+ defaultBaseUrl: "https://chatgpt.com/backend-api"
1542
+ });
1543
+ }
1544
+ };
1545
+ var openai_codex_default = openaiCodexRuntime;
1546
+
1547
+ // src/domains/providers/runtimes/cloud/openrouter.ts
1548
+ init_esm_shims();
1549
+ var OPENROUTER_BASE_URL = "https://openrouter.ai/api/v1";
1550
+ var OPENROUTER_HEADERS = {
1551
+ "HTTP-Referer": "https://github.com/iowarp/clio-coder",
1552
+ "X-OpenRouter-Title": "Clio Coder"
1553
+ };
1554
+ var defaultCapabilities12 = {
1555
+ chat: true,
1556
+ tools: true,
1557
+ toolCallFormat: "openai",
1558
+ reasoning: false,
1559
+ thinkingFormat: "openrouter",
1560
+ vision: false,
1561
+ audio: false,
1562
+ embeddings: false,
1563
+ rerank: false,
1564
+ fim: false,
1565
+ contextWindow: 128e3,
1566
+ maxTokens: 8192
1567
+ };
1568
+ function trimTrailingSlash2(value) {
1569
+ return value.endsWith("/") && value.length > 1 ? value.slice(0, -1) : value;
1570
+ }
1571
+ function targetBaseUrl2(target) {
1572
+ return trimTrailingSlash2(target.url ?? OPENROUTER_BASE_URL);
1573
+ }
1574
+ function modelsUrl(target) {
1575
+ return `${targetBaseUrl2(target)}/models`;
1576
+ }
1577
+ function probeHeaders(target, ctx) {
1578
+ const headers = { ...OPENROUTER_HEADERS, ...target.auth?.headers ?? {} };
1579
+ const envName = target.auth?.apiKeyEnvVar ?? "OPENROUTER_API_KEY";
1580
+ if (ctx.credentialsPresent.has(envName)) {
1581
+ const key = process.env[envName]?.trim();
1582
+ if (key) headers.authorization = `Bearer ${key}`;
1583
+ }
1584
+ return headers;
1585
+ }
1586
+ async function fetchModels(target, ctx) {
1587
+ const opts = {
1588
+ url: modelsUrl(target),
1589
+ timeoutMs: ctx.httpTimeoutMs,
1590
+ headers: probeHeaders(target, ctx)
1591
+ };
1592
+ const result = await (ctx.signal ? probeJson({ ...opts, signal: ctx.signal }) : probeJson(opts));
1593
+ if (!result.ok) return result;
1594
+ const models = (result.data?.data ?? []).map((row) => typeof row?.id === "string" ? row.id : null).filter((id) => id !== null);
1595
+ const out = { ok: true, models };
1596
+ if (result.latencyMs !== void 0) out.latencyMs = result.latencyMs;
1597
+ const configured = target.defaultModel?.trim();
1598
+ if (configured && models.length > 0 && !models.includes(configured)) {
1599
+ out.ok = false;
1600
+ out.error = `configured model '${configured}' was not returned by OpenRouter`;
1601
+ }
1602
+ return out;
1603
+ }
1604
+ var openrouterRuntime = {
1605
+ id: "openrouter",
1606
+ displayName: "OpenRouter",
1607
+ kind: "http",
1608
+ tier: "cloud",
1609
+ apiFamily: "openai-completions",
1610
+ auth: "api-key",
1611
+ credentialsEnvVar: "OPENROUTER_API_KEY",
1612
+ defaultCapabilities: defaultCapabilities12,
1613
+ probe(target, ctx) {
1614
+ return fetchModels(target, ctx);
1615
+ },
1616
+ async probeModels(target, ctx) {
1617
+ const result = await fetchModels(target, ctx);
1618
+ return result.ok && result.models ? [...result.models] : [];
1619
+ },
1620
+ synthesizeModel(target, wireModelId, kb) {
1621
+ return synthesizeCatalogBackedModel({
1622
+ target,
1623
+ wireModelId,
1624
+ kb,
1625
+ defaultCapabilities: defaultCapabilities12,
1626
+ runtimeId: "openrouter",
1627
+ api: "openai-completions",
1628
+ provider: "openrouter",
1629
+ defaultBaseUrl: OPENROUTER_BASE_URL,
1630
+ defaultHeaders: OPENROUTER_HEADERS
1631
+ });
1632
+ }
1633
+ };
1634
+ var openrouter_default = openrouterRuntime;
1635
+
1636
+ // src/domains/providers/runtimes/local-native/lemonade-anthropic.ts
1637
+ init_esm_shims();
1638
+
1639
+ // src/domains/providers/runtimes/protocol/anthropic-compat.ts
1640
+ init_esm_shims();
1641
+ function synthesizeAnthropicCompatModel(input) {
1642
+ return synthLocalModel({
1643
+ target: input.target,
1644
+ wireModelId: input.wireModelId,
1645
+ kb: input.kb,
1646
+ defaultCapabilities: input.defaultCapabilities,
1647
+ apiFamily: "anthropic-messages",
1648
+ provider: input.provider,
1649
+ baseUrlForTarget: input.baseUrlForTarget ?? withAsIs
1650
+ });
1651
+ }
1652
+ function makeAnthropicCompatRuntime(spec) {
1653
+ const messagesPath = spec.messagesPath ?? "/v1/messages";
1654
+ const modelsPath = spec.modelsPath ?? "/v1/models";
1655
+ return {
1656
+ id: spec.id,
1657
+ displayName: spec.displayName,
1658
+ kind: "http",
1659
+ tier: spec.tier,
1660
+ apiFamily: "anthropic-messages",
1661
+ auth: spec.auth,
1662
+ defaultCapabilities: spec.defaultCapabilities,
1663
+ ...spec.hidden === true ? { hidden: true } : {},
1664
+ async probe(target, ctx) {
1665
+ const base = targetBaseUrl(target);
1666
+ if (!base) return { ok: false, error: "target has no url" };
1667
+ return probeUrl(`${base}${messagesPath}`, ctx, "HEAD");
1668
+ },
1669
+ async probeModels(target, ctx) {
1670
+ const base = targetBaseUrl(target);
1671
+ if (!base) return [];
1672
+ return probeOpenAIModels(base, ctx, modelsPath);
1673
+ },
1674
+ synthesizeModel(target, wireModelId, kb) {
1675
+ return synthesizeAnthropicCompatModel({
1676
+ target,
1677
+ wireModelId,
1678
+ kb,
1679
+ defaultCapabilities: spec.defaultCapabilities,
1680
+ provider: spec.provider
1681
+ });
1682
+ }
1683
+ };
1684
+ }
1685
+ var defaultCapabilities13 = {
1686
+ chat: true,
1687
+ tools: true,
1688
+ toolCallFormat: "anthropic",
1689
+ reasoning: false,
1690
+ vision: false,
1691
+ audio: false,
1692
+ embeddings: false,
1693
+ rerank: false,
1694
+ fim: false,
1695
+ contextWindow: CLIO_MIN_CONTEXT_WINDOW,
1696
+ maxTokens: CLIO_MIN_MAX_OUTPUT_TOKENS
1697
+ };
1698
+ var anthropic_compat_default = makeAnthropicCompatRuntime({
1699
+ id: "anthropic-compat",
1700
+ displayName: "Generic Anthropic-compatible",
1701
+ provider: "anthropic-compat",
1702
+ auth: "api-key",
1703
+ tier: "protocol",
1704
+ defaultCapabilities: defaultCapabilities13
1705
+ });
1706
+
1707
+ // src/domains/providers/runtimes/local-native/lemonade-anthropic.ts
1708
+ var defaultCapabilities14 = {
1709
+ chat: true,
1710
+ tools: true,
1711
+ toolCallFormat: "anthropic",
1712
+ reasoning: false,
1713
+ vision: false,
1714
+ audio: false,
1715
+ embeddings: false,
1716
+ rerank: false,
1717
+ fim: false,
1718
+ contextWindow: CLIO_MIN_CONTEXT_WINDOW,
1719
+ maxTokens: CLIO_MIN_MAX_OUTPUT_TOKENS
1720
+ };
1721
+ var lemonade_anthropic_default = makeAnthropicCompatRuntime({
1722
+ id: "lemonade-anthropic",
1723
+ displayName: "Lemonade (Anthropic-compat)",
1724
+ provider: "lemonade",
1725
+ auth: "api-key",
1726
+ tier: "local-native",
1727
+ defaultCapabilities: defaultCapabilities14,
1728
+ hidden: true
1729
+ });
1730
+
1731
+ // src/domains/providers/runtimes/local-native/lemonade-openai.ts
1732
+ init_esm_shims();
1733
+ var defaultCapabilities15 = {
1734
+ chat: true,
1735
+ tools: true,
1736
+ toolCallFormat: "openai",
1737
+ reasoning: false,
1738
+ vision: false,
1739
+ audio: false,
1740
+ embeddings: false,
1741
+ rerank: false,
1742
+ fim: false,
1743
+ contextWindow: CLIO_MIN_CONTEXT_WINDOW,
1744
+ maxTokens: CLIO_MIN_MAX_OUTPUT_TOKENS
1745
+ };
1746
+ var lemonade_openai_default = makeOpenAICompatRuntime({
1747
+ id: "lemonade",
1748
+ displayName: "Lemonade (OpenAI-compat)",
1749
+ provider: "lemonade",
1750
+ auth: "api-key",
1751
+ tier: "local-native",
1752
+ defaultCapabilities: defaultCapabilities15
1753
+ });
1754
+
1755
+ // src/domains/providers/runtimes/local-native/llamacpp.ts
1756
+ init_esm_shims();
1757
+ var defaultCapabilities16 = {
1758
+ chat: true,
1759
+ tools: true,
1760
+ toolCallFormat: "openai",
1761
+ structuredOutputs: "json-schema",
1762
+ reasoning: false,
1763
+ vision: false,
1764
+ audio: false,
1765
+ embeddings: false,
1766
+ rerank: false,
1767
+ fim: false,
1768
+ contextWindow: CLIO_MIN_CONTEXT_WINDOW,
1769
+ maxTokens: CLIO_MIN_MAX_OUTPUT_TOKENS
1770
+ };
1771
+ function targetUrl(target) {
1772
+ return targetRootUrl(target);
1773
+ }
1774
+ var llamacppRuntime = {
1775
+ id: "llamacpp",
1776
+ displayName: "llama.cpp",
1777
+ kind: "http",
1778
+ tier: "local-native",
1779
+ apiFamily: "openai-completions",
1780
+ auth: "api-key",
1781
+ defaultCapabilities: defaultCapabilities16,
1782
+ async probe(target, ctx) {
1783
+ const base = targetUrl(target);
1784
+ if (!base) return { ok: false, error: "target has no url" };
1785
+ const healthOpts = { url: `${base}/health`, timeoutMs: ctx.httpTimeoutMs };
1786
+ const health = await (ctx.signal ? probeHttp({ ...healthOpts, signal: ctx.signal }) : probeHttp(healthOpts));
1787
+ if (!health.ok) return health;
1788
+ const props = await probeLlamaCppProps(base, ctx);
1789
+ const status = await probeLlamaCppModelStatus(base, target, ctx);
1790
+ const catalog = await probeOpenAIModelCatalog(base, ctx);
1791
+ const result = { ok: true };
1792
+ if (catalog.models.length > 0) result.models = catalog.models;
1793
+ if (Object.keys(catalog.modelCapabilities).length > 0) result.modelCapabilities = catalog.modelCapabilities;
1794
+ if (Object.keys(catalog.modelStates).length > 0) result.modelStates = catalog.modelStates;
1795
+ if (typeof health.latencyMs === "number") result.latencyMs = health.latencyMs;
1796
+ const discoveredCapabilities = {
1797
+ ...props.discoveredCapabilities ?? {},
1798
+ ...status.discoveredCapabilities ?? {}
1799
+ };
1800
+ if (Object.keys(discoveredCapabilities).length > 0) {
1801
+ result.discoveredCapabilities = discoveredCapabilities;
1802
+ if (status.modelId) result.capabilityModelId = status.modelId;
1803
+ }
1804
+ if (props.serverVersion) result.serverVersion = props.serverVersion;
1805
+ const note = await detectModelMismatch(base, target, ctx);
1806
+ const notes = [...status.notes ?? [], ...note ? [note] : []];
1807
+ if (notes.length > 0) result.notes = notes;
1808
+ return result;
1809
+ },
1810
+ async probeModels(target, ctx) {
1811
+ const base = targetUrl(target);
1812
+ if (!base) return [];
1813
+ return probeOpenAIModels(base, ctx);
1814
+ },
1815
+ synthesizeModel(target, wireModelId, kb) {
1816
+ return synthLocalModel({
1817
+ target,
1818
+ wireModelId,
1819
+ kb,
1820
+ defaultCapabilities: defaultCapabilities16,
1821
+ apiFamily: "openai-completions",
1822
+ provider: "llamacpp",
1823
+ baseUrlForTarget: withV1
1824
+ });
1825
+ }
1826
+ };
1827
+ var llamacpp_default = llamacppRuntime;
1828
+
1829
+ // src/domains/providers/runtimes/local-native/llamacpp-anthropic.ts
1830
+ init_esm_shims();
1831
+ var defaultCapabilities17 = {
1832
+ chat: true,
1833
+ tools: true,
1834
+ toolCallFormat: "anthropic",
1835
+ reasoning: false,
1836
+ vision: false,
1837
+ audio: false,
1838
+ embeddings: false,
1839
+ rerank: false,
1840
+ fim: true,
1841
+ contextWindow: CLIO_MIN_CONTEXT_WINDOW,
1842
+ maxTokens: CLIO_MIN_MAX_OUTPUT_TOKENS
1843
+ };
1844
+ function url(target) {
1845
+ return target.url ? stripTrailingSlash(target.url) : null;
1846
+ }
1847
+ var llamacppAnthropicRuntime = {
1848
+ id: "llamacpp-anthropic",
1849
+ displayName: "llama.cpp (Anthropic-compat)",
1850
+ kind: "http",
1851
+ tier: "local-native",
1852
+ apiFamily: "anthropic-messages",
1853
+ auth: "api-key",
1854
+ defaultCapabilities: defaultCapabilities17,
1855
+ hidden: true,
1856
+ async probe(target, ctx) {
1857
+ const base = url(target);
1858
+ if (!base) return { ok: false, error: "target has no url" };
1859
+ const healthOpts = { url: `${base}/health`, timeoutMs: ctx.httpTimeoutMs };
1860
+ const health = await (ctx.signal ? probeHttp({ ...healthOpts, signal: ctx.signal }) : probeHttp(healthOpts));
1861
+ if (!health.ok) return health;
1862
+ const headOpts = {
1863
+ url: `${base}/v1/messages`,
1864
+ method: "HEAD",
1865
+ timeoutMs: ctx.httpTimeoutMs
1866
+ };
1867
+ const head = await (ctx.signal ? probeHttp({ ...headOpts, signal: ctx.signal }) : probeHttp(headOpts));
1868
+ if (!head.ok) return head;
1869
+ const props = await probeLlamaCppProps(base, ctx);
1870
+ const enriched = { ...head };
1871
+ if (props.discoveredCapabilities) enriched.discoveredCapabilities = props.discoveredCapabilities;
1872
+ if (props.serverVersion) enriched.serverVersion = props.serverVersion;
1873
+ const note = await detectModelMismatch(base, target, ctx);
1874
+ if (note) enriched.notes = [note];
1875
+ return enriched;
1876
+ },
1877
+ async probeModels(target, ctx) {
1878
+ const base = url(target);
1879
+ if (!base) return [];
1880
+ const opts = { url: `${base}/v1/models`, timeoutMs: ctx.httpTimeoutMs };
1881
+ const result = await (ctx.signal ? probeJson({ ...opts, signal: ctx.signal }) : probeJson(opts));
1882
+ if (!result.ok || !result.data?.data) return [];
1883
+ return result.data.data.map((row) => typeof row?.id === "string" ? row.id : null).filter((id) => id !== null);
1884
+ },
1885
+ synthesizeModel(target, wireModelId, kb) {
1886
+ return synthLocalModel({
1887
+ target,
1888
+ wireModelId,
1889
+ kb,
1890
+ defaultCapabilities: defaultCapabilities17,
1891
+ apiFamily: "anthropic-messages",
1892
+ provider: "llamacpp",
1893
+ baseUrlForTarget: withAsIs
1894
+ });
1895
+ }
1896
+ };
1897
+ var llamacpp_anthropic_default = llamacppAnthropicRuntime;
1898
+
1899
+ // src/domains/providers/runtimes/local-native/llamacpp-completion.ts
1900
+ init_esm_shims();
1901
+ var defaultCapabilities18 = {
1902
+ chat: false,
1903
+ tools: false,
1904
+ reasoning: false,
1905
+ vision: false,
1906
+ audio: false,
1907
+ embeddings: false,
1908
+ rerank: false,
1909
+ fim: true,
1910
+ structuredOutputs: "gbnf",
1911
+ contextWindow: 8192,
1912
+ maxTokens: 4096
1913
+ };
1914
+ function targetUrl2(target) {
1915
+ return targetRootUrl(target);
1916
+ }
1917
+ function parseChunk(raw) {
1918
+ const chunk = {
1919
+ content: typeof raw.content === "string" ? raw.content : "",
1920
+ stop: raw.stop === true
1921
+ };
1922
+ if (raw.stop_type === "eos" || raw.stop_type === "limit" || raw.stop_type === "word" || raw.stop_type === "none") {
1923
+ chunk.stop_type = raw.stop_type;
1924
+ }
1925
+ if (typeof raw.tokens_predicted === "number") chunk.tokens_predicted = raw.tokens_predicted;
1926
+ if (typeof raw.tokens_evaluated === "number") chunk.tokens_evaluated = raw.tokens_evaluated;
1927
+ return chunk;
1928
+ }
1929
+ async function* streamSse(body) {
1930
+ const reader = body.getReader();
1931
+ const decoder = new TextDecoder("utf-8");
1932
+ let buffered = "";
1933
+ let droppedFrames = 0;
1934
+ try {
1935
+ while (true) {
1936
+ const { done, value } = await reader.read();
1937
+ if (done) break;
1938
+ buffered += decoder.decode(value, { stream: true });
1939
+ let nl = buffered.indexOf("\n");
1940
+ while (nl !== -1) {
1941
+ const line = buffered.slice(0, nl).trimEnd();
1942
+ buffered = buffered.slice(nl + 1);
1943
+ nl = buffered.indexOf("\n");
1944
+ if (line.length === 0) continue;
1945
+ const payload = line.startsWith("data:") ? line.slice(5).trim() : line;
1946
+ if (payload.length === 0 || payload === "[DONE]") continue;
1947
+ try {
1948
+ const parsed = JSON.parse(payload);
1949
+ const chunk = parseChunk(parsed);
1950
+ yield chunk;
1951
+ if (chunk.stop) return;
1952
+ } catch {
1953
+ droppedFrames += 1;
1954
+ }
1955
+ }
1956
+ }
1957
+ const tail = buffered.trim();
1958
+ if (tail.length > 0) {
1959
+ const payload = tail.startsWith("data:") ? tail.slice(5).trim() : tail;
1960
+ if (payload !== "[DONE]") {
1961
+ try {
1962
+ const parsed = JSON.parse(payload);
1963
+ yield parseChunk(parsed);
1964
+ } catch {
1965
+ droppedFrames += 1;
1966
+ }
1967
+ }
1968
+ }
1969
+ } finally {
1970
+ if (droppedFrames > 0) {
1971
+ process.stderr.write(`[clio:llamacpp] dropped ${droppedFrames} malformed stream frame(s)
1972
+ `);
1973
+ }
1974
+ reader.releaseLock();
1975
+ }
1976
+ }
1977
+ async function postStream(url2, body, signal) {
1978
+ const init = {
1979
+ method: "POST",
1980
+ headers: { "content-type": "application/json", accept: "text/event-stream" },
1981
+ body: JSON.stringify(body)
1982
+ };
1983
+ if (signal) init.signal = signal;
1984
+ const response = await fetch(url2, init);
1985
+ if (!response.ok || !response.body) {
1986
+ throw new Error(`HTTP ${response.status}: ${response.statusText}`);
1987
+ }
1988
+ return response.body;
1989
+ }
1990
+ function buildCompleteBody(opts) {
1991
+ const body = { prompt: opts.prompt, stream: true };
1992
+ if (opts.n_predict !== void 0) body.n_predict = opts.n_predict;
1993
+ if (opts.stop && opts.stop.length > 0) body.stop = opts.stop;
1994
+ if (opts.grammar) body.grammar = opts.grammar;
1995
+ if (opts.json_schema) body.json_schema = opts.json_schema;
1996
+ if (opts.cache_prompt !== void 0) body.cache_prompt = opts.cache_prompt;
1997
+ return body;
1998
+ }
1999
+ function buildInfillBody(opts) {
2000
+ const body = buildCompleteBody(opts);
2001
+ body.input_prefix = opts.input_prefix;
2002
+ body.input_suffix = opts.input_suffix;
2003
+ if (opts.input_extra) body.input_extra = opts.input_extra;
2004
+ return body;
2005
+ }
2006
+ var llamacppCompletionRuntime = {
2007
+ id: "llamacpp-completion",
2008
+ displayName: "llama.cpp (completion / infill)",
2009
+ kind: "http",
2010
+ tier: "local-native",
2011
+ apiFamily: "openai-completions",
2012
+ auth: "api-key",
2013
+ defaultCapabilities: defaultCapabilities18,
2014
+ hidden: true,
2015
+ async probe(target, ctx) {
2016
+ const base = targetUrl2(target);
2017
+ if (!base) return { ok: false, error: "target has no url" };
2018
+ const healthOpts = { url: `${base}/health`, timeoutMs: ctx.httpTimeoutMs };
2019
+ const health = await (ctx.signal ? probeHttp({ ...healthOpts, signal: ctx.signal }) : probeHttp(healthOpts));
2020
+ if (!health.ok) return health;
2021
+ const props = await probeLlamaCppProps(base, ctx);
2022
+ const status = await probeLlamaCppModelStatus(base, target, ctx);
2023
+ const enriched = { ...health };
2024
+ const discoveredCapabilities = {
2025
+ ...props.discoveredCapabilities ?? {},
2026
+ ...status.discoveredCapabilities ?? {}
2027
+ };
2028
+ if (Object.keys(discoveredCapabilities).length > 0) {
2029
+ enriched.discoveredCapabilities = discoveredCapabilities;
2030
+ if (status.modelId) enriched.capabilityModelId = status.modelId;
2031
+ }
2032
+ if (props.serverVersion) enriched.serverVersion = props.serverVersion;
2033
+ const note = await detectModelMismatch(base, target, ctx);
2034
+ const notes = [...status.notes ?? [], ...note ? [note] : []];
2035
+ if (notes.length > 0) enriched.notes = notes;
2036
+ return enriched;
2037
+ },
2038
+ async probeModels(target, ctx) {
2039
+ const base = targetUrl2(target);
2040
+ if (!base) return [];
2041
+ return probeOpenAIModels(base, ctx);
2042
+ },
2043
+ synthesizeModel(target, wireModelId, kb) {
2044
+ return synthLocalModel({
2045
+ target,
2046
+ wireModelId,
2047
+ kb,
2048
+ defaultCapabilities: defaultCapabilities18,
2049
+ apiFamily: "openai-completions",
2050
+ provider: "llamacpp",
2051
+ baseUrlForTarget: withV1
2052
+ });
2053
+ },
2054
+ async *complete(target, opts) {
2055
+ const base = targetUrl2(target);
2056
+ if (!base) throw new Error("target has no url");
2057
+ const body = await postStream(`${base}/completion`, buildCompleteBody(opts), opts.signal);
2058
+ for await (const chunk of streamSse(body)) yield chunk;
2059
+ },
2060
+ async *infill(target, opts) {
2061
+ const base = targetUrl2(target);
2062
+ if (!base) throw new Error("target has no url");
2063
+ const body = await postStream(`${base}/infill`, buildInfillBody(opts), opts.signal);
2064
+ for await (const chunk of streamSse(body)) yield chunk;
2065
+ }
2066
+ };
2067
+ var llamacpp_completion_default = llamacppCompletionRuntime;
2068
+
2069
+ // src/domains/providers/runtimes/local-native/llamacpp-embed.ts
2070
+ init_esm_shims();
2071
+ var defaultCapabilities19 = {
2072
+ chat: false,
2073
+ tools: false,
2074
+ reasoning: false,
2075
+ vision: false,
2076
+ audio: false,
2077
+ embeddings: true,
2078
+ rerank: false,
2079
+ fim: false,
2080
+ contextWindow: 8192,
2081
+ maxTokens: 0
2082
+ };
2083
+ function targetUrl3(target) {
2084
+ return targetRootUrl(target);
2085
+ }
2086
+ function meanPool(matrix) {
2087
+ if (matrix.length === 0) return [];
2088
+ const dim = matrix[0]?.length ?? 0;
2089
+ const sum = new Array(dim).fill(0);
2090
+ for (const row of matrix) {
2091
+ for (let i = 0; i < dim; i++) sum[i] = (sum[i] ?? 0) + (row[i] ?? 0);
2092
+ }
2093
+ return sum.map((v) => v / matrix.length);
2094
+ }
2095
+ function flattenNativeEmbedding(entry) {
2096
+ const value = entry.embedding;
2097
+ if (!value || value.length === 0) return [];
2098
+ if (Array.isArray(value[0])) return meanPool(value);
2099
+ return value;
2100
+ }
2101
+ async function postJson(url2, body, signal) {
2102
+ const init = {
2103
+ method: "POST",
2104
+ headers: { "content-type": "application/json" },
2105
+ body: JSON.stringify(body)
2106
+ };
2107
+ if (signal) init.signal = signal;
2108
+ const response = await fetch(url2, init);
2109
+ if (!response.ok) return { status: response.status, data: null };
2110
+ try {
2111
+ const data = await response.json();
2112
+ return { status: response.status, data };
2113
+ } catch {
2114
+ return { status: response.status, data: null };
2115
+ }
2116
+ }
2117
+ var llamacppEmbedRuntime = {
2118
+ id: "llamacpp-embed",
2119
+ displayName: "llama.cpp (embeddings)",
2120
+ kind: "http",
2121
+ tier: "local-native",
2122
+ apiFamily: "openai-completions",
2123
+ auth: "api-key",
2124
+ defaultCapabilities: defaultCapabilities19,
2125
+ hidden: true,
2126
+ async probe(target, ctx) {
2127
+ const base = targetUrl3(target);
2128
+ if (!base) return { ok: false, error: "target has no url" };
2129
+ const healthOpts = { url: `${base}/health`, timeoutMs: ctx.httpTimeoutMs };
2130
+ const health = await (ctx.signal ? probeHttp({ ...healthOpts, signal: ctx.signal }) : probeHttp(healthOpts));
2131
+ if (!health.ok) return health;
2132
+ const probeResponse = await fetch(`${base}/embedding`, {
2133
+ method: "POST",
2134
+ headers: { "content-type": "application/json" },
2135
+ body: JSON.stringify({ content: "probe" }),
2136
+ ...ctx.signal ? { signal: ctx.signal } : {}
2137
+ }).catch((err) => {
2138
+ return new Response(null, { status: 599, statusText: String(err) });
2139
+ });
2140
+ if (!probeResponse.ok) {
2141
+ return { ok: false, error: `/embedding not available: HTTP ${probeResponse.status}` };
2142
+ }
2143
+ const props = await probeLlamaCppProps(base, ctx);
2144
+ const result = { ok: true };
2145
+ if (health.latencyMs !== void 0) result.latencyMs = health.latencyMs;
2146
+ if (props.discoveredCapabilities) result.discoveredCapabilities = props.discoveredCapabilities;
2147
+ if (props.serverVersion) result.serverVersion = props.serverVersion;
2148
+ return result;
2149
+ },
2150
+ async probeModels(target, ctx) {
2151
+ const base = targetUrl3(target);
2152
+ if (!base) return [];
2153
+ return probeOpenAIModels(base, ctx);
2154
+ },
2155
+ synthesizeModel(target, wireModelId, kb) {
2156
+ return synthLocalModel({
2157
+ target,
2158
+ wireModelId,
2159
+ kb,
2160
+ defaultCapabilities: defaultCapabilities19,
2161
+ apiFamily: "openai-completions",
2162
+ provider: "llamacpp",
2163
+ baseUrlForTarget: withV1
2164
+ });
2165
+ },
2166
+ async embed(target, input, ctx) {
2167
+ const base = targetUrl3(target);
2168
+ if (!base) throw new Error("target has no url");
2169
+ const modelId = target.defaultModel ?? "default";
2170
+ const inputs = Array.isArray(input) ? input : [input];
2171
+ const oai = await postJson(
2172
+ `${base}/v1/embeddings`,
2173
+ { input: inputs, model: modelId, encoding_format: "float" },
2174
+ ctx.signal
2175
+ );
2176
+ if (oai.data && Array.isArray(oai.data.data)) {
2177
+ const rows = oai.data.data;
2178
+ const sorted = [...rows].sort((a, b) => (a.index ?? 0) - (b.index ?? 0));
2179
+ const vectors2 = sorted.map((row) => row.embedding ?? []);
2180
+ const tokens = oai.data.usage?.total_tokens ?? oai.data.usage?.prompt_tokens ?? void 0;
2181
+ const dim = vectors2[0]?.length ?? 0;
2182
+ const result = {
2183
+ vectors: vectors2,
2184
+ model: oai.data.model ?? modelId,
2185
+ dimensions: dim
2186
+ };
2187
+ if (tokens !== void 0) result.tokensUsed = tokens;
2188
+ return result;
2189
+ }
2190
+ const probeOpts = { url: `${base}/embedding`, timeoutMs: ctx.httpTimeoutMs };
2191
+ const native = await (ctx.signal ? probeJson({
2192
+ ...probeOpts,
2193
+ method: "POST",
2194
+ body: JSON.stringify({ content: inputs }),
2195
+ headers: { "content-type": "application/json" },
2196
+ signal: ctx.signal
2197
+ }) : probeJson({
2198
+ ...probeOpts,
2199
+ method: "POST",
2200
+ body: JSON.stringify({ content: inputs }),
2201
+ headers: { "content-type": "application/json" }
2202
+ }));
2203
+ if (!native.ok || !native.data) {
2204
+ throw new Error(`llama.cpp embedding failed: ${native.error ?? "unknown"}`);
2205
+ }
2206
+ const items = native.data;
2207
+ items.sort((a, b) => (a.index ?? 0) - (b.index ?? 0));
2208
+ const vectors = items.map(flattenNativeEmbedding);
2209
+ return {
2210
+ vectors,
2211
+ model: modelId,
2212
+ dimensions: vectors[0]?.length ?? 0
2213
+ };
2214
+ }
2215
+ };
2216
+ var llamacpp_embed_default = llamacppEmbedRuntime;
2217
+
2218
+ // src/domains/providers/runtimes/local-native/llamacpp-rerank.ts
2219
+ init_esm_shims();
2220
+ var defaultCapabilities20 = {
2221
+ chat: false,
2222
+ tools: false,
2223
+ reasoning: false,
2224
+ vision: false,
2225
+ audio: false,
2226
+ embeddings: false,
2227
+ rerank: true,
2228
+ fim: false,
2229
+ contextWindow: 8192,
2230
+ maxTokens: 0
2231
+ };
2232
+ function targetUrl4(target) {
2233
+ return targetRootUrl(target);
2234
+ }
2235
+ var llamacppRerankRuntime = {
2236
+ id: "llamacpp-rerank",
2237
+ displayName: "llama.cpp (rerank)",
2238
+ kind: "http",
2239
+ tier: "local-native",
2240
+ apiFamily: "openai-completions",
2241
+ auth: "api-key",
2242
+ defaultCapabilities: defaultCapabilities20,
2243
+ hidden: true,
2244
+ async probe(target, ctx) {
2245
+ const base = targetUrl4(target);
2246
+ if (!base) return { ok: false, error: "target has no url" };
2247
+ const healthOpts = { url: `${base}/health`, timeoutMs: ctx.httpTimeoutMs };
2248
+ const health = await (ctx.signal ? probeHttp({ ...healthOpts, signal: ctx.signal }) : probeHttp(healthOpts));
2249
+ if (!health.ok) return health;
2250
+ const modelId = target.defaultModel ?? "default";
2251
+ const probeResponse = await fetch(`${base}/reranking`, {
2252
+ method: "POST",
2253
+ headers: { "content-type": "application/json" },
2254
+ body: JSON.stringify({ query: "probe", documents: ["a"], model: modelId }),
2255
+ ...ctx.signal ? { signal: ctx.signal } : {}
2256
+ }).catch((err) => new Response(null, { status: 599, statusText: String(err) }));
2257
+ if (!(probeResponse.status === 200 || probeResponse.status === 202)) {
2258
+ return { ok: false, error: `/reranking not available: HTTP ${probeResponse.status}` };
2259
+ }
2260
+ const props = await probeLlamaCppProps(base, ctx);
2261
+ const result = { ok: true };
2262
+ if (health.latencyMs !== void 0) result.latencyMs = health.latencyMs;
2263
+ if (props.discoveredCapabilities) result.discoveredCapabilities = props.discoveredCapabilities;
2264
+ if (props.serverVersion) result.serverVersion = props.serverVersion;
2265
+ return result;
2266
+ },
2267
+ async probeModels(target, ctx) {
2268
+ const base = targetUrl4(target);
2269
+ if (!base) return [];
2270
+ return probeOpenAIModels(base, ctx);
2271
+ },
2272
+ synthesizeModel(target, wireModelId, kb) {
2273
+ return synthLocalModel({
2274
+ target,
2275
+ wireModelId,
2276
+ kb,
2277
+ defaultCapabilities: defaultCapabilities20,
2278
+ apiFamily: "openai-completions",
2279
+ provider: "llamacpp",
2280
+ baseUrlForTarget: withV1
2281
+ });
2282
+ },
2283
+ async rerank(target, query, documents, ctx) {
2284
+ const base = targetUrl4(target);
2285
+ if (!base) throw new Error("target has no url");
2286
+ const modelId = target.defaultModel ?? "default";
2287
+ const req = {
2288
+ url: `${base}/reranking`,
2289
+ method: "POST",
2290
+ timeoutMs: ctx.httpTimeoutMs,
2291
+ headers: { "content-type": "application/json" },
2292
+ body: JSON.stringify({
2293
+ query,
2294
+ documents,
2295
+ top_n: documents.length,
2296
+ model: modelId
2297
+ })
2298
+ };
2299
+ const result = await (ctx.signal ? probeJson({ ...req, signal: ctx.signal }) : probeJson(req));
2300
+ if (!result.ok || !result.data) {
2301
+ throw new Error(`llama.cpp rerank failed: ${result.error ?? "unknown"}`);
2302
+ }
2303
+ const rows = result.data.results ?? [];
2304
+ const items = rows.map((row) => {
2305
+ const idx = typeof row.index === "number" ? row.index : 0;
2306
+ const score = typeof row.relevance_score === "number" ? row.relevance_score : 0;
2307
+ const doc = typeof row.document === "string" ? row.document : typeof row.document?.text === "string" ? row.document.text : void 0;
2308
+ const item = { index: idx, score };
2309
+ if (doc !== void 0) item.document = doc;
2310
+ return item;
2311
+ });
2312
+ return { items, model: result.data.model ?? modelId };
2313
+ }
2314
+ };
2315
+ var llamacpp_rerank_default = llamacppRerankRuntime;
2316
+
2317
+ // src/domains/providers/runtimes/local-native/lmstudio.ts
2318
+ init_esm_shims();
2319
+
2320
+ // src/domains/providers/runtimes/common/lmstudio-http.ts
2321
+ init_esm_shims();
2322
+ import { performance as performance3 } from "node:perf_hooks";
2323
+ var catalogsByHost = /* @__PURE__ */ new Map();
2324
+ function isRecord3(value) {
2325
+ return value !== null && typeof value === "object" && !Array.isArray(value);
2326
+ }
2327
+ function positiveNumber2(value) {
2328
+ return typeof value === "number" && Number.isFinite(value) && value > 0 ? value : void 0;
2329
+ }
2330
+ function nonEmptyString2(value) {
2331
+ return typeof value === "string" && value.trim().length > 0 ? value.trim() : void 0;
2332
+ }
2333
+ function lmStudioRootUrl(url2) {
2334
+ const normalized = targetRootUrl({ id: "lmstudio", runtime: "lmstudio", url: url2 });
2335
+ if (!normalized) return "";
2336
+ if (normalized.startsWith("ws://")) return `http://${normalized.slice("ws://".length)}`;
2337
+ if (normalized.startsWith("wss://")) return `https://${normalized.slice("wss://".length)}`;
2338
+ return normalized;
2339
+ }
2340
+ function lmStudioRequestHeaders(base, apiKey) {
2341
+ const headers = { ...base ?? {} };
2342
+ const token = apiKey?.trim();
2343
+ if (token) headers.authorization = `Bearer ${token}`;
2344
+ return headers;
2345
+ }
2346
+ function lmStudioProbeHeaders(target, ctx) {
2347
+ let token = ctx.authToken?.trim();
2348
+ const envName = target.auth?.apiKeyEnvVar;
2349
+ if (!token && envName && ctx.credentialsPresent.has(envName)) token = process.env[envName]?.trim();
2350
+ return lmStudioRequestHeaders(target.auth?.headers, token);
2351
+ }
2352
+ function combinedSignal(timeoutMs, signal) {
2353
+ const controller = new AbortController();
2354
+ const timer = setTimeout(() => controller.abort(new Error(`timeout after ${timeoutMs}ms`)), timeoutMs);
2355
+ const onAbort = () => controller.abort(signal?.reason);
2356
+ if (signal?.aborted) controller.abort(signal.reason);
2357
+ else signal?.addEventListener("abort", onAbort, { once: true });
2358
+ return {
2359
+ signal: controller.signal,
2360
+ close() {
2361
+ clearTimeout(timer);
2362
+ signal?.removeEventListener("abort", onAbort);
2363
+ }
2364
+ };
2365
+ }
2366
+ async function requestLmStudioJson(url2, init, timeoutMs, signal) {
2367
+ const started = performance3.now();
2368
+ const bounded = combinedSignal(timeoutMs, signal);
2369
+ try {
2370
+ const response = await fetch(url2, { ...init, signal: bounded.signal });
2371
+ let data;
2372
+ try {
2373
+ data = await response.json();
2374
+ } catch {
2375
+ data = void 0;
2376
+ }
2377
+ const result = {
2378
+ ok: response.ok,
2379
+ status: response.status,
2380
+ latencyMs: Math.round(performance3.now() - started)
2381
+ };
2382
+ if (data !== void 0) result.data = data;
2383
+ if (!response.ok) {
2384
+ const message = isRecord3(data) ? nonEmptyString2(data.error) : void 0;
2385
+ result.error = message ?? `HTTP ${response.status}`;
2386
+ }
2387
+ return result;
2388
+ } catch (error) {
2389
+ return {
2390
+ ok: false,
2391
+ status: 0,
2392
+ latencyMs: Math.round(performance3.now() - started),
2393
+ error: error instanceof Error ? error.message : String(error)
2394
+ };
2395
+ } finally {
2396
+ bounded.close();
2397
+ }
2398
+ }
2399
+ function loadedInstances(value) {
2400
+ if (!Array.isArray(value)) return [];
2401
+ const instances = [];
2402
+ for (const raw of value) {
2403
+ if (!isRecord3(raw)) continue;
2404
+ const id = nonEmptyString2(raw.id);
2405
+ if (!id) continue;
2406
+ instances.push({ id, config: isRecord3(raw.config) ? { ...raw.config } : {} });
2407
+ }
2408
+ return instances;
2409
+ }
2410
+ function reasoningOptions(capabilities2) {
2411
+ if (!isRecord3(capabilities2) || !isRecord3(capabilities2.reasoning)) return void 0;
2412
+ const allowed = capabilities2.reasoning.allowed_options;
2413
+ if (!Array.isArray(allowed)) return void 0;
2414
+ const options = allowed.filter((entry) => typeof entry === "string");
2415
+ return options.length > 0 ? options : void 0;
2416
+ }
2417
+ function parseLmStudioV1Models(data) {
2418
+ if (!isRecord3(data) || !Array.isArray(data.models)) return null;
2419
+ const models = [];
2420
+ for (const raw of data.models) {
2421
+ if (!isRecord3(raw)) continue;
2422
+ const key = nonEmptyString2(raw.key);
2423
+ if (!key) continue;
2424
+ const capabilities2 = isRecord3(raw.capabilities) ? raw.capabilities : void 0;
2425
+ const info = {
2426
+ key,
2427
+ loadedInstances: loadedInstances(raw.loaded_instances),
2428
+ metadata: { ...raw }
2429
+ };
2430
+ const type = nonEmptyString2(raw.type);
2431
+ if (type) info.type = type;
2432
+ const maxContextLength = positiveNumber2(raw.max_context_length);
2433
+ if (maxContextLength !== void 0) info.maxContextLength = maxContextLength;
2434
+ if (capabilities2 && typeof capabilities2.vision === "boolean") info.vision = capabilities2.vision;
2435
+ else if (type) info.vision = type === "vlm";
2436
+ if (capabilities2 && typeof capabilities2.trained_for_tool_use === "boolean") {
2437
+ info.tools = capabilities2.trained_for_tool_use;
2438
+ }
2439
+ const options = reasoningOptions(capabilities2);
2440
+ if (options) info.reasoningOptions = options;
2441
+ if (capabilities2 && "reasoning" in capabilities2) {
2442
+ info.reasoning = capabilities2.reasoning === true || isRecord3(capabilities2.reasoning);
2443
+ }
2444
+ models.push(info);
2445
+ }
2446
+ return models;
2447
+ }
2448
+ function foldLmStudioModels(models) {
2449
+ const byKey = /* @__PURE__ */ new Map();
2450
+ for (const model of models) {
2451
+ const previous = byKey.get(model.key);
2452
+ if (!previous) {
2453
+ byKey.set(model.key, { ...model, loadedInstances: [...model.loadedInstances] });
2454
+ continue;
2455
+ }
2456
+ const knownIds = new Set(previous.loadedInstances.map((instance) => instance.id));
2457
+ for (const instance of model.loadedInstances) {
2458
+ if (!knownIds.has(instance.id)) previous.loadedInstances.push(instance);
2459
+ }
2460
+ if (previous.maxContextLength === void 0 && model.maxContextLength !== void 0) {
2461
+ previous.maxContextLength = model.maxContextLength;
2462
+ }
2463
+ if (previous.vision === void 0 && model.vision !== void 0) previous.vision = model.vision;
2464
+ if (previous.tools === void 0 && model.tools !== void 0) previous.tools = model.tools;
2465
+ if (previous.reasoningOptions === void 0 && model.reasoningOptions !== void 0) {
2466
+ previous.reasoningOptions = model.reasoningOptions;
2467
+ }
2468
+ if (previous.reasoning === void 0 && model.reasoning !== void 0) previous.reasoning = model.reasoning;
2469
+ }
2470
+ return [...byKey.values()];
2471
+ }
2472
+ function rememberHostCatalog(target, models) {
2473
+ const rootUrl = lmStudioRootUrl(target.url ?? "");
2474
+ if (!rootUrl) return;
2475
+ catalogsByHost.set(rootUrl, { targetId: target.id, rootUrl, models: foldLmStudioModels(models) });
2476
+ }
2477
+ function peerTargetsFor(target, instanceId) {
2478
+ const rootUrl = lmStudioRootUrl(target.url ?? "");
2479
+ const peers = [];
2480
+ for (const catalog of catalogsByHost.values()) {
2481
+ if (catalog.rootUrl === rootUrl) continue;
2482
+ if (catalog.models.some((model) => model.loadedInstances.some((instance) => instance.id === instanceId))) {
2483
+ peers.push(catalog.targetId);
2484
+ }
2485
+ }
2486
+ return [...new Set(peers)];
2487
+ }
2488
+ function resolveLmStudioInstance(target, models, requestedId, configuredDefault) {
2489
+ const folded = foldLmStudioModels(models);
2490
+ for (const model of folded) {
2491
+ const explicit = model.loadedInstances.find((instance2) => instance2.id === requestedId);
2492
+ if (explicit) {
2493
+ return {
2494
+ requestedId,
2495
+ wireModelId: explicit.id,
2496
+ model,
2497
+ instance: explicit,
2498
+ peerTargets: peerTargetsFor(target, explicit.id),
2499
+ state: "instance"
2500
+ };
2501
+ }
2502
+ if (model.key !== requestedId) continue;
2503
+ if (model.loadedInstances.length === 0) {
2504
+ return { requestedId, wireModelId: requestedId, model, peerTargets: [], state: "jit" };
2505
+ }
2506
+ const preferred = configuredDefault ? model.loadedInstances.find((instance2) => instance2.id === configuredDefault) : void 0;
2507
+ const local = model.loadedInstances.find((instance2) => peerTargetsFor(target, instance2.id).length === 0);
2508
+ const instance = preferred ?? local ?? model.loadedInstances[0];
2509
+ if (!instance) return { requestedId, wireModelId: requestedId, model, peerTargets: [], state: "jit" };
2510
+ return {
2511
+ requestedId,
2512
+ wireModelId: instance.id,
2513
+ model,
2514
+ instance,
2515
+ peerTargets: peerTargetsFor(target, instance.id),
2516
+ state: "instance"
2517
+ };
2518
+ }
2519
+ return { requestedId, wireModelId: requestedId, peerTargets: [], state: "unknown" };
2520
+ }
2521
+ function lmStudioReasoningLevels(options) {
2522
+ if (!options || options.length === 0) return [...THINKING_LEVELS];
2523
+ if (options.includes("on") && !options.includes("low") && !options.includes("medium") && !options.includes("high")) {
2524
+ return ["off", "low"];
2525
+ }
2526
+ const levels = ["off"];
2527
+ if (options.includes("low")) levels.push("minimal", "low");
2528
+ if (options.includes("medium")) levels.push("medium");
2529
+ if (options.includes("high")) levels.push("high", "xhigh", "max");
2530
+ return [...new Set(levels)];
2531
+ }
2532
+ function lmStudioReasoningEffort(level, options) {
2533
+ if (level === "off") return "none";
2534
+ if (options?.includes("on") && !options.includes("medium") && !options.includes("high")) return "low";
2535
+ if (level === "medium" && options?.includes("medium") !== false) return "medium";
2536
+ if ((level === "high" || level === "xhigh" || level === "max") && options?.includes("high") !== false) return "high";
2537
+ return "low";
2538
+ }
2539
+ function v0Models(data) {
2540
+ if (!isRecord3(data) || !Array.isArray(data.data)) return null;
2541
+ const models = [];
2542
+ for (const raw of data.data) {
2543
+ if (!isRecord3(raw)) continue;
2544
+ const key = nonEmptyString2(raw.id);
2545
+ if (!key) continue;
2546
+ const state = nonEmptyString2(raw.state);
2547
+ const loadedContext = positiveNumber2(raw.loaded_context_length);
2548
+ const config = loadedContext === void 0 ? {} : { context_length: loadedContext };
2549
+ const info = {
2550
+ key,
2551
+ loadedInstances: state === "loaded" || loadedContext !== void 0 ? [{ id: key, config }] : [],
2552
+ metadata: { ...raw }
2553
+ };
2554
+ const type = nonEmptyString2(raw.type);
2555
+ if (type) {
2556
+ info.type = type;
2557
+ info.vision = type === "vlm";
2558
+ }
2559
+ const maxContextLength = positiveNumber2(raw.max_context_length);
2560
+ if (maxContextLength !== void 0) info.maxContextLength = maxContextLength;
2561
+ if (Array.isArray(raw.capabilities)) info.tools = raw.capabilities.includes("tool_use");
2562
+ models.push(info);
2563
+ }
2564
+ return models;
2565
+ }
2566
+ function openAIModels(data) {
2567
+ if (!isRecord3(data) || !Array.isArray(data.data)) return null;
2568
+ const models = [];
2569
+ for (const raw of data.data) {
2570
+ if (!isRecord3(raw)) continue;
2571
+ const key = nonEmptyString2(raw.id);
2572
+ if (key) models.push({ key, loadedInstances: [], metadata: { ...raw } });
2573
+ }
2574
+ return models;
2575
+ }
2576
+ function authFailure(result) {
2577
+ if (result.status !== 401 && result.status !== 403) return null;
2578
+ return {
2579
+ ok: false,
2580
+ models: [],
2581
+ latencyMs: result.latencyMs,
2582
+ error: "LM Studio authentication required",
2583
+ authRequired: true
2584
+ };
2585
+ }
2586
+ async function listLmStudioModels(target, ctx) {
2587
+ if (!target.url) return { ok: false, models: [], error: "target has no url" };
2588
+ const root = lmStudioRootUrl(target.url);
2589
+ const headers = lmStudioProbeHeaders(target, ctx);
2590
+ const init = { headers };
2591
+ const v1 = await requestLmStudioJson(`${root}/api/v1/models`, init, ctx.httpTimeoutMs, ctx.signal);
2592
+ const v1Auth = authFailure(v1);
2593
+ if (v1Auth) return v1Auth;
2594
+ const parsedV1 = parseLmStudioV1Models(v1.data);
2595
+ if (v1.ok && parsedV1) {
2596
+ rememberHostCatalog(target, parsedV1);
2597
+ return { ok: true, models: parsedV1, tier: "0.4+", latencyMs: v1.latencyMs };
2598
+ }
2599
+ const v0 = await requestLmStudioJson(`${root}/api/v0/models`, init, ctx.httpTimeoutMs, ctx.signal);
2600
+ const v0Auth = authFailure(v0);
2601
+ if (v0Auth) return v0Auth;
2602
+ const parsedV0 = v0Models(v0.data);
2603
+ if (v0.ok && parsedV0) {
2604
+ rememberHostCatalog(target, parsedV0);
2605
+ return { ok: true, models: parsedV0, tier: "0.3.x", latencyMs: v0.latencyMs };
2606
+ }
2607
+ const openAI = await requestLmStudioJson(`${root}/v1/models`, init, ctx.httpTimeoutMs, ctx.signal);
2608
+ const openAIAuth = authFailure(openAI);
2609
+ if (openAIAuth) return openAIAuth;
2610
+ const parsedOpenAI = openAIModels(openAI.data);
2611
+ if (openAI.ok && parsedOpenAI) {
2612
+ rememberHostCatalog(target, parsedOpenAI);
2613
+ return { ok: true, models: parsedOpenAI, tier: "openai-compat", latencyMs: openAI.latencyMs };
2614
+ }
2615
+ return {
2616
+ ok: false,
2617
+ models: [],
2618
+ latencyMs: v1.latencyMs + v0.latencyMs + openAI.latencyMs,
2619
+ error: v1.error ?? v0.error ?? openAI.error ?? "LM Studio returned no recognized model catalog"
2620
+ };
2621
+ }
2622
+ async function greetLmStudio(target, ctx) {
2623
+ if (!target.url) return { ok: false, error: "target has no url" };
2624
+ const result = await requestLmStudioJson(
2625
+ `${lmStudioRootUrl(target.url)}/lmstudio-greeting`,
2626
+ { headers: lmStudioProbeHeaders(target, ctx) },
2627
+ ctx.httpTimeoutMs,
2628
+ ctx.signal
2629
+ );
2630
+ if (result.ok && isRecord3(result.data) && result.data.lmstudio === true) {
2631
+ return { ok: true, latencyMs: result.latencyMs };
2632
+ }
2633
+ return { ok: false, latencyMs: result.latencyMs, error: result.error ?? "endpoint did not return {lmstudio:true}" };
2634
+ }
2635
+ function loadedContextLength(instance) {
2636
+ return positiveNumber2(instance?.config.context_length);
2637
+ }
2638
+
2639
+ // src/domains/providers/runtimes/local-native/lmstudio.ts
2640
+ var defaultCapabilities21 = {
2641
+ chat: true,
2642
+ tools: true,
2643
+ toolCallFormat: "openai",
2644
+ structuredOutputs: "json-schema",
2645
+ reasoning: true,
2646
+ vision: true,
2647
+ audio: false,
2648
+ embeddings: false,
2649
+ rerank: false,
2650
+ fim: false,
2651
+ contextWindow: CLIO_MIN_CONTEXT_WINDOW,
2652
+ maxTokens: CLIO_MIN_MAX_OUTPUT_TOKENS
2653
+ };
2654
+ var reasoningOptionsByTargetModel = /* @__PURE__ */ new Map();
2655
+ function reasoningOptionsKey(target, modelId) {
2656
+ const url2 = (target.url ?? "").replace(/^ws:/u, "http:").replace(/^wss:/u, "https:").replace(/\/$/u, "");
2657
+ return `${target.id}|${url2}|${modelId}`;
2658
+ }
2659
+ function rememberReasoningOptions(target, models) {
2660
+ const prefix = reasoningOptionsKey(target, "");
2661
+ for (const key of reasoningOptionsByTargetModel.keys()) {
2662
+ if (key.startsWith(prefix)) reasoningOptionsByTargetModel.delete(key);
2663
+ }
2664
+ for (const model of models) {
2665
+ if (!model.reasoningOptions) continue;
2666
+ reasoningOptionsByTargetModel.set(reasoningOptionsKey(target, model.key), model.reasoningOptions);
2667
+ for (const instance of model.loadedInstances) {
2668
+ reasoningOptionsByTargetModel.set(reasoningOptionsKey(target, instance.id), model.reasoningOptions);
2669
+ }
2670
+ }
2671
+ }
2672
+ function configuredModel(target) {
2673
+ const id = target.defaultModel?.trim();
2674
+ return id && id.length > 0 ? id : void 0;
2675
+ }
2676
+ function resolveModel(models, id) {
2677
+ if (id) {
2678
+ for (const model2 of models) {
2679
+ if (model2.key === id) return { model: model2, ...model2.loadedInstances[0] ? { instance: model2.loadedInstances[0] } : {} };
2680
+ const instance = model2.loadedInstances.find((entry) => entry.id === id);
2681
+ if (instance) return { model: model2, instance };
2682
+ }
2683
+ return null;
2684
+ }
2685
+ const model = models.find((entry) => entry.loadedInstances.length > 0) ?? models[0];
2686
+ return model ? { model, ...model.loadedInstances[0] ? { instance: model.loadedInstances[0] } : {} } : null;
2687
+ }
2688
+ function capabilities(model, instance) {
2689
+ const out = {};
2690
+ if (model.vision !== void 0) out.vision = model.vision;
2691
+ if (model.tools !== void 0) out.tools = model.tools;
2692
+ if (model.reasoning !== void 0) out.reasoning = model.reasoning;
2693
+ else if (model.reasoningOptions !== void 0)
2694
+ out.reasoning = model.reasoningOptions.some((option) => option !== "off");
2695
+ const contextWindow = loadedContextLength(instance) ?? model.maxContextLength;
2696
+ if (contextWindow !== void 0) out.contextWindow = contextWindow;
2697
+ return out;
2698
+ }
2699
+ function statusFor(model, instance, reasoningLevels) {
2700
+ const status = {
2701
+ state: instance ? "loaded" : "unloaded",
2702
+ key: model.key,
2703
+ reasoningLevels
2704
+ };
2705
+ if (instance) {
2706
+ status.instanceId = instance.id;
2707
+ status.loadConfig = instance.config;
2708
+ const contextLength = loadedContextLength(instance);
2709
+ if (contextLength !== void 0) status.contextLength = contextLength;
2710
+ }
2711
+ return status;
2712
+ }
2713
+ function probeFromCatalog(catalog, target) {
2714
+ if (!catalog.ok) {
2715
+ return {
2716
+ ok: false,
2717
+ ...catalog.latencyMs !== void 0 ? { latencyMs: catalog.latencyMs } : {},
2718
+ error: catalog.error ?? "LM Studio model listing failed"
2719
+ };
2720
+ }
2721
+ const models = foldLmStudioModels(catalog.models);
2722
+ rememberReasoningOptions(target, models);
2723
+ const ids = [];
2724
+ const modelCapabilities = {};
2725
+ const modelStates = {};
2726
+ for (const model of models) {
2727
+ const levels = lmStudioReasoningLevels(model.reasoningOptions);
2728
+ const keyInstance = model.loadedInstances[0];
2729
+ modelCapabilities[model.key] = capabilities(model, keyInstance);
2730
+ modelStates[model.key] = statusFor(model, keyInstance, levels);
2731
+ for (const instance of model.loadedInstances) {
2732
+ if (!ids.includes(instance.id)) ids.push(instance.id);
2733
+ modelCapabilities[instance.id] = capabilities(model, instance);
2734
+ const instanceStatus = statusFor(model, instance, levels);
2735
+ modelStates[instance.id] = instanceStatus;
2736
+ const resolution = resolveLmStudioInstance(target, models, instance.id, configuredModel(target));
2737
+ instanceStatus.detail = resolution.peerTargets.length > 0 ? `loaded on ${target.id}; also loaded on ${resolution.peerTargets.join(", ")}` : `loaded on ${target.id}`;
2738
+ }
2739
+ if (model.loadedInstances.length === 0) {
2740
+ ids.push(model.key);
2741
+ const keyStatus = modelStates[model.key];
2742
+ if (keyStatus) keyStatus.detail = "not loaded (LM Studio will load it on first use)";
2743
+ }
2744
+ }
2745
+ const selected = resolveModel(models, configuredModel(target));
2746
+ const result = {
2747
+ ok: true,
2748
+ models: ids,
2749
+ modelCapabilities,
2750
+ modelStates,
2751
+ serverVersion: catalog.tier === "0.4+" ? "LM Studio API 0.4+" : catalog.tier === "0.3.x" ? "LM Studio API 0.3.x" : "LM Studio OpenAI-compatible API",
2752
+ surfaces: {
2753
+ openaiChat: "/v1/chat/completions",
2754
+ ...catalog.tier === "0.4+" ? { nativeV1: "/api/v1/models" } : {},
2755
+ ...catalog.tier === "0.3.x" ? { nativeV0: "/api/v0/models" } : {}
2756
+ }
2757
+ };
2758
+ if (catalog.latencyMs !== void 0) result.latencyMs = catalog.latencyMs;
2759
+ if (selected) {
2760
+ result.discoveredCapabilities = capabilities(selected.model, selected.instance);
2761
+ result.capabilityModelId = configuredModel(target) ?? selected.model.key;
2762
+ }
2763
+ const loaded = models.flatMap(
2764
+ (model) => model.loadedInstances.map((instance) => {
2765
+ const context = loadedContextLength(instance);
2766
+ return `${model.key} as ${instance.id}${context ? ` at ${context} tokens` : ""}`;
2767
+ })
2768
+ );
2769
+ result.notes = [
2770
+ `LM Studio surface tier ${catalog.tier ?? "unknown"}`,
2771
+ `Surfaces: ${Object.values(result.surfaces ?? {}).join(", ")}`,
2772
+ ...loaded.length > 0 ? [`Loaded instances: ${loaded.join(", ")}`] : []
2773
+ ];
2774
+ return result;
2775
+ }
2776
+ var lmstudioRuntime = {
2777
+ id: "lmstudio",
2778
+ aliases: ["lmstudio-native"],
2779
+ displayName: "LM Studio",
2780
+ kind: "http",
2781
+ tier: "local-native",
2782
+ apiFamily: "openai-completions",
2783
+ auth: "api-key",
2784
+ defaultCapabilities: defaultCapabilities21,
2785
+ async probe(target, ctx) {
2786
+ const [greeting, catalog] = await Promise.all([greetLmStudio(target, ctx), listLmStudioModels(target, ctx)]);
2787
+ if (!greeting.ok && catalog.tier !== "0.3.x") {
2788
+ return {
2789
+ ok: false,
2790
+ ...greeting.latencyMs !== void 0 ? { latencyMs: greeting.latencyMs } : {},
2791
+ error: `URL did not identify itself as LM Studio: ${greeting.error ?? "greeting missing"}`
2792
+ };
2793
+ }
2794
+ return probeFromCatalog(catalog, target);
2795
+ },
2796
+ async probeModels(target, ctx) {
2797
+ const catalog = await listLmStudioModels(target, ctx);
2798
+ return probeFromCatalog(catalog, target).models ?? [];
2799
+ },
2800
+ synthesizeModel(target, wireModelId, kb) {
2801
+ const canonicalTarget = target.runtime === "lmstudio" ? target : { ...target, runtime: "lmstudio" };
2802
+ const model = synthLocalModel({
2803
+ target: canonicalTarget,
2804
+ wireModelId,
2805
+ kb,
2806
+ defaultCapabilities: defaultCapabilities21,
2807
+ apiFamily: "openai-completions",
2808
+ provider: "lmstudio",
2809
+ baseUrlForTarget: (url2) => withV1(url2.replace(/^ws:/u, "http:").replace(/^wss:/u, "https:"))
2810
+ });
2811
+ const metadata = model.clio;
2812
+ if (metadata) {
2813
+ metadata.chatTemplateKwargsUnsupported = true;
2814
+ if (target.defaultModel) metadata.lmstudioDefaultModel = target.defaultModel;
2815
+ const options = reasoningOptionsByTargetModel.get(reasoningOptionsKey(canonicalTarget, wireModelId));
2816
+ if (options) metadata.lmstudioReasoningOptions = options;
2817
+ }
2818
+ return model;
2819
+ }
2820
+ };
2821
+ var lmstudio_default = lmstudioRuntime;
2822
+
2823
+ // src/domains/providers/runtimes/local-native/ollama-native.ts
2824
+ init_esm_shims();
2825
+ var defaultCapabilities22 = {
2826
+ chat: true,
2827
+ tools: true,
2828
+ toolCallFormat: "openai",
2829
+ reasoning: false,
2830
+ vision: false,
2831
+ audio: false,
2832
+ embeddings: false,
2833
+ rerank: false,
2834
+ fim: false,
2835
+ contextWindow: CLIO_MIN_CONTEXT_WINDOW,
2836
+ maxTokens: CLIO_MIN_MAX_OUTPUT_TOKENS
2837
+ };
2838
+ function positiveNumber3(value) {
2839
+ return typeof value === "number" && Number.isFinite(value) && value > 0 ? value : void 0;
2840
+ }
2841
+ async function probeResidentModelStates(base, ctx) {
2842
+ const opts = { url: `${base}/api/ps`, timeoutMs: ctx.httpTimeoutMs };
2843
+ const result = await (ctx.signal ? probeJson({ ...opts, signal: ctx.signal }) : probeJson(opts));
2844
+ if (!result.ok || !result.data?.models) return void 0;
2845
+ const states = {};
2846
+ for (const row of result.data.models) {
2847
+ const id = typeof row?.model === "string" ? row.model : typeof row?.name === "string" ? row.name : null;
2848
+ if (!id) continue;
2849
+ const status = { state: "loaded" };
2850
+ const sizeVram = positiveNumber3(row?.size_vram);
2851
+ if (sizeVram !== void 0) status.sizeVramBytes = sizeVram;
2852
+ const size = positiveNumber3(row?.size);
2853
+ if (size !== void 0) status.sizeBytes = size;
2854
+ states[id] = status;
2855
+ }
2856
+ return Object.keys(states).length > 0 ? states : void 0;
2857
+ }
2858
+ var ollamaNativeRuntime = {
2859
+ id: "ollama-native",
2860
+ displayName: "Ollama (native)",
2861
+ kind: "http",
2862
+ tier: "local-native",
2863
+ apiFamily: "ollama-native",
2864
+ auth: "none",
2865
+ defaultCapabilities: defaultCapabilities22,
2866
+ async probe(target, ctx) {
2867
+ const base = targetBaseUrl(target);
2868
+ if (!base) return { ok: false, error: "target has no url" };
2869
+ const opts = { url: `${base}/api/tags`, timeoutMs: ctx.httpTimeoutMs };
2870
+ const result = await (ctx.signal ? probeJson({ ...opts, signal: ctx.signal }) : probeJson(opts));
2871
+ if (!result.ok) {
2872
+ const failed = { ok: false };
2873
+ if (result.error) failed.error = result.error;
2874
+ if (result.latencyMs !== void 0) failed.latencyMs = result.latencyMs;
2875
+ return failed;
2876
+ }
2877
+ const out = { ok: true };
2878
+ if (result.latencyMs !== void 0) out.latencyMs = result.latencyMs;
2879
+ const modelStates = await probeResidentModelStates(base, ctx);
2880
+ if (modelStates) out.modelStates = modelStates;
2881
+ return out;
2882
+ },
2883
+ async probeModels(target, ctx) {
2884
+ const base = targetBaseUrl(target);
2885
+ if (!base) return [];
2886
+ const opts = { url: `${base}/api/tags`, timeoutMs: ctx.httpTimeoutMs };
2887
+ const result = await (ctx.signal ? probeJson({ ...opts, signal: ctx.signal }) : probeJson(opts));
2888
+ if (!result.ok || !result.data?.models) return [];
2889
+ return result.data.models.map((row) => typeof row?.name === "string" ? row.name : null).filter((name) => name !== null);
2890
+ },
2891
+ synthesizeModel(target, wireModelId, kb) {
2892
+ return synthLocalModel({
2893
+ target,
2894
+ wireModelId,
2895
+ kb,
2896
+ defaultCapabilities: defaultCapabilities22,
2897
+ apiFamily: "ollama-native",
2898
+ provider: "ollama",
2899
+ baseUrlForTarget: withAsIs
2900
+ });
2901
+ }
2902
+ };
2903
+ var ollama_native_default = ollamaNativeRuntime;
2904
+
2905
+ // src/domains/providers/runtimes/local-native/sglang.ts
2906
+ init_esm_shims();
2907
+ var defaultCapabilities23 = {
2908
+ chat: true,
2909
+ tools: true,
2910
+ toolCallFormat: "openai",
2911
+ reasoning: false,
2912
+ vision: false,
2913
+ audio: false,
2914
+ embeddings: false,
2915
+ rerank: false,
2916
+ fim: false,
2917
+ contextWindow: CLIO_MIN_CONTEXT_WINDOW,
2918
+ maxTokens: CLIO_MIN_MAX_OUTPUT_TOKENS
2919
+ };
2920
+ var sglang_default = makeOpenAICompatRuntime({
2921
+ id: "sglang",
2922
+ displayName: "SGLang",
2923
+ provider: "sglang",
2924
+ auth: "api-key",
2925
+ tier: "local-native",
2926
+ defaultCapabilities: defaultCapabilities23
2927
+ });
2928
+
2929
+ // src/domains/providers/runtimes/local-native/vllm.ts
2930
+ init_esm_shims();
2931
+ var defaultCapabilities24 = {
2932
+ chat: true,
2933
+ tools: true,
2934
+ toolCallFormat: "openai",
2935
+ reasoning: false,
2936
+ vision: false,
2937
+ audio: false,
2938
+ embeddings: false,
2939
+ rerank: false,
2940
+ fim: false,
2941
+ contextWindow: CLIO_MIN_CONTEXT_WINDOW,
2942
+ maxTokens: CLIO_MIN_MAX_OUTPUT_TOKENS
2943
+ };
2944
+ var vllm_default = makeOpenAICompatRuntime({
2945
+ id: "vllm",
2946
+ displayName: "vLLM",
2947
+ provider: "vllm",
2948
+ auth: "api-key",
2949
+ tier: "local-native",
2950
+ defaultCapabilities: defaultCapabilities24,
2951
+ healthPath: "/health"
2952
+ });
2953
+
2954
+ // src/domains/providers/runtimes/builtins.ts
2955
+ var BUILTIN_RUNTIMES = [
2956
+ alcf_default,
2957
+ anthropic_default,
2958
+ anthropic_max_default,
2959
+ bedrock_default,
2960
+ deepseek_default,
2961
+ google_default,
2962
+ groq_default,
2963
+ mistral_default,
2964
+ openai_default,
2965
+ openai_codex_default,
2966
+ openrouter_default,
2967
+ lemonade_anthropic_default,
2968
+ lemonade_openai_default,
2969
+ llamacpp_default,
2970
+ llamacpp_anthropic_default,
2971
+ llamacpp_completion_default,
2972
+ llamacpp_embed_default,
2973
+ llamacpp_rerank_default,
2974
+ lmstudio_default,
2975
+ ollama_native_default,
2976
+ anthropic_compat_default,
2977
+ openai_compat_default,
2978
+ sglang_default,
2979
+ vllm_default,
2980
+ claude_code_default,
2981
+ claude_sdk_default,
2982
+ antigravity_code_default
2983
+ ];
2984
+ function registerBuiltinRuntimes(registry) {
2985
+ for (const desc of BUILTIN_RUNTIMES) {
2986
+ if (registry.get(desc.id) !== null) continue;
2987
+ registry.register(desc);
2988
+ }
2989
+ }
2990
+
2991
+ export {
2992
+ CLIO_MIN_CONTEXT_WINDOW,
2993
+ CLIO_MIN_MAX_OUTPUT_TOKENS,
2994
+ CLIO_CONTEXT_WINDOW_WARN_BELOW,
2995
+ extractLocalModelQuirks,
2996
+ lmStudioRootUrl,
2997
+ requestLmStudioJson,
2998
+ resolveLmStudioInstance,
2999
+ lmStudioReasoningEffort,
3000
+ listLmStudioModels,
3001
+ greetLmStudio,
3002
+ formatContextWindowSlots,
3003
+ BUILTIN_RUNTIMES,
3004
+ registerBuiltinRuntimes
3005
+ };
3006
+ //# sourceMappingURL=chunk-NMPKI6XL.js.map