@ponythewhite/base-context 1.0.0 → 1.0.1

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (285) hide show
  1. package/CHANGELOG.md +33 -0
  2. package/NOTICE +0 -5
  3. package/README.md +44 -27
  4. package/dist/NOTICE +0 -5
  5. package/dist/base-context-runtime/pyproject.toml +1 -1
  6. package/dist/base-context-runtime/src/rlm/__init__.py +7 -5
  7. package/dist/base-context-runtime/test/test_subagent_registry.py +28 -1
  8. package/dist/base-context-runtime/uv.lock +1 -1
  9. package/dist/build-info.json +1 -1
  10. package/dist/bundle/amazon-bedrock.js +21 -0
  11. package/dist/bundle/{anthropic-YY4S534V.js → anthropic-UV5GZDGU.js} +5 -5
  12. package/dist/bundle/{azure-openai-responses-JRP6MIM3.js → azure-openai-responses-WSNPXLYC.js} +6 -6
  13. package/dist/bundle/{bundled-modules-P5HARVZA.js → bundled-modules-TXUMJ2XQ.js} +71 -16
  14. package/dist/bundle/chunk-27QCJ2AZ.js +2578 -0
  15. package/dist/bundle/{chunk-MZHTNNVA.js → chunk-4GXPNXOJ.js} +8 -0
  16. package/dist/bundle/{chunk-SC5KG5R4.js → chunk-DGNX7HQ3.js} +1 -7
  17. package/dist/bundle/{chunk-A53O363M.js → chunk-GRJFXLBM.js} +0 -1
  18. package/dist/bundle/chunk-HKINIBP4.js +29 -0
  19. package/dist/bundle/{chunk-UDSW6FNG.js → chunk-KTNETTHI.js} +1 -1
  20. package/dist/bundle/{chunk-BYVP7LWV.js → chunk-S3INFPZZ.js} +1861 -4662
  21. package/dist/bundle/{chunk-73DCPU3D.js → chunk-V3L54UD6.js} +1019 -3427
  22. package/dist/bundle/{chunk-U7AUVG3B.js → chunk-VSIYFWYI.js} +24 -6
  23. package/dist/bundle/{chunk-IW77OXFS.js → chunk-W46VZFI6.js} +0 -2099
  24. package/dist/bundle/{cli-main-O4X7GFGY.js → cli-main-BYMSRPH6.js} +8 -6
  25. package/dist/bundle/cli.js +2 -2
  26. package/dist/bundle/{google-AUTVGDGZ.js → google-T32FMD4G.js} +6 -6
  27. package/dist/bundle/{google-vertex-Q75D7RKS.js → google-vertex-56KP6I3B.js} +3 -3
  28. package/dist/bundle/{main-XKOW2BV6.js → main-ODOYCEQC.js} +7 -5
  29. package/dist/bundle/{mistral-7ESB7QUD.js → mistral-WGBMYIVU.js} +5 -5
  30. package/dist/bundle/{openai-codex-responses-LV3QRPN4.js → openai-codex-responses-PIV2RQ3G.js} +6 -6
  31. package/dist/bundle/{openai-completions-OJECLPXJ.js → openai-completions-64C3JPR4.js} +11 -22
  32. package/dist/bundle/{openai-responses-FN6HZMBC.js → openai-responses-UI7RSTDV.js} +6 -6
  33. package/dist/cli/args.d.ts.map +1 -1
  34. package/dist/cli/args.js +108 -59
  35. package/dist/cli/args.js.map +1 -1
  36. package/dist/cli/daemon-ps.d.ts +4 -3
  37. package/dist/cli/daemon-ps.d.ts.map +1 -1
  38. package/dist/cli/daemon-ps.js +6 -1
  39. package/dist/cli/daemon-ps.js.map +1 -1
  40. package/dist/cli/product-doctor.d.ts +0 -1
  41. package/dist/cli/product-doctor.d.ts.map +1 -1
  42. package/dist/cli/product-doctor.js +6 -3
  43. package/dist/cli/product-doctor.js.map +1 -1
  44. package/dist/config.d.ts +0 -3
  45. package/dist/config.d.ts.map +1 -1
  46. package/dist/config.js +0 -8
  47. package/dist/config.js.map +1 -1
  48. package/dist/core/agent-session-config.d.ts +1 -2
  49. package/dist/core/agent-session-config.d.ts.map +1 -1
  50. package/dist/core/agent-session-config.js +0 -3
  51. package/dist/core/agent-session-config.js.map +1 -1
  52. package/dist/core/agent-session-runtime.d.ts.map +1 -1
  53. package/dist/core/agent-session-runtime.js +5 -4
  54. package/dist/core/agent-session-runtime.js.map +1 -1
  55. package/dist/core/agent-session-services.d.ts +5 -3
  56. package/dist/core/agent-session-services.d.ts.map +1 -1
  57. package/dist/core/agent-session-services.js +2 -27
  58. package/dist/core/agent-session-services.js.map +1 -1
  59. package/dist/core/agent-session.d.ts +10 -6
  60. package/dist/core/agent-session.d.ts.map +1 -1
  61. package/dist/core/agent-session.js +107 -107
  62. package/dist/core/agent-session.js.map +1 -1
  63. package/dist/core/auth-storage.d.ts +8 -35
  64. package/dist/core/auth-storage.d.ts.map +1 -1
  65. package/dist/core/auth-storage.js +33 -243
  66. package/dist/core/auth-storage.js.map +1 -1
  67. package/dist/core/cron-jobs.d.ts.map +1 -1
  68. package/dist/core/cron-jobs.js +7 -1
  69. package/dist/core/cron-jobs.js.map +1 -1
  70. package/dist/core/inference-coordinator.d.ts +6 -1
  71. package/dist/core/inference-coordinator.d.ts.map +1 -1
  72. package/dist/core/inference-coordinator.js +18 -2
  73. package/dist/core/inference-coordinator.js.map +1 -1
  74. package/dist/core/kernel/bootstrap.d.ts.map +1 -1
  75. package/dist/core/kernel/bootstrap.js +2 -2
  76. package/dist/core/kernel/bootstrap.js.map +1 -1
  77. package/dist/core/kernel/repl-manager.d.ts +2 -0
  78. package/dist/core/kernel/repl-manager.d.ts.map +1 -1
  79. package/dist/core/kernel/repl-manager.js +44 -1
  80. package/dist/core/kernel/repl-manager.js.map +1 -1
  81. package/dist/core/logging.d.ts +4 -3
  82. package/dist/core/logging.d.ts.map +1 -1
  83. package/dist/core/logging.js +6 -6
  84. package/dist/core/logging.js.map +1 -1
  85. package/dist/core/mcp/mcp-manager.d.ts.map +1 -1
  86. package/dist/core/mcp/mcp-manager.js +3 -3
  87. package/dist/core/mcp/mcp-manager.js.map +1 -1
  88. package/dist/core/model-registry.d.ts +1 -16
  89. package/dist/core/model-registry.d.ts.map +1 -1
  90. package/dist/core/model-registry.js +88 -196
  91. package/dist/core/model-registry.js.map +1 -1
  92. package/dist/core/model-resolver.d.ts +2 -19
  93. package/dist/core/model-resolver.d.ts.map +1 -1
  94. package/dist/core/model-resolver.js +36 -266
  95. package/dist/core/model-resolver.js.map +1 -1
  96. package/dist/core/provider-contracts.d.ts +5 -6
  97. package/dist/core/provider-contracts.d.ts.map +1 -1
  98. package/dist/core/provider-contracts.js +25 -36
  99. package/dist/core/provider-contracts.js.map +1 -1
  100. package/dist/core/provider-display-names.d.ts.map +1 -1
  101. package/dist/core/provider-display-names.js +0 -2
  102. package/dist/core/provider-display-names.js.map +1 -1
  103. package/dist/core/rlm-max-subagents.d.ts +32 -0
  104. package/dist/core/rlm-max-subagents.d.ts.map +1 -0
  105. package/dist/core/rlm-max-subagents.js +50 -0
  106. package/dist/core/rlm-max-subagents.js.map +1 -0
  107. package/dist/core/rlm-runtime.d.ts +3 -3
  108. package/dist/core/rlm-runtime.d.ts.map +1 -1
  109. package/dist/core/rlm-runtime.js.map +1 -1
  110. package/dist/core/sdk.d.ts +4 -3
  111. package/dist/core/sdk.d.ts.map +1 -1
  112. package/dist/core/sdk.js +27 -14
  113. package/dist/core/sdk.js.map +1 -1
  114. package/dist/core/settings-manager.d.ts +3 -16
  115. package/dist/core/settings-manager.d.ts.map +1 -1
  116. package/dist/core/settings-manager.js +12 -44
  117. package/dist/core/settings-manager.js.map +1 -1
  118. package/dist/core/slash-commands.d.ts.map +1 -1
  119. package/dist/core/slash-commands.js +6 -6
  120. package/dist/core/slash-commands.js.map +1 -1
  121. package/dist/index.d.ts +1 -1
  122. package/dist/index.d.ts.map +1 -1
  123. package/dist/index.js.map +1 -1
  124. package/dist/installer.mjs +2 -3
  125. package/dist/main.d.ts.map +1 -1
  126. package/dist/main.js +39 -34
  127. package/dist/main.js.map +1 -1
  128. package/dist/modes/acp/acp-mode.d.ts.map +1 -1
  129. package/dist/modes/acp/acp-mode.js +1 -1
  130. package/dist/modes/acp/acp-mode.js.map +1 -1
  131. package/dist/modes/agent-connection/daemon-agent-connection.d.ts +6 -2
  132. package/dist/modes/agent-connection/daemon-agent-connection.d.ts.map +1 -1
  133. package/dist/modes/agent-connection/daemon-agent-connection.js +13 -2
  134. package/dist/modes/agent-connection/daemon-agent-connection.js.map +1 -1
  135. package/dist/modes/agent-connection/in-process-agent-connection.d.ts +2 -0
  136. package/dist/modes/agent-connection/in-process-agent-connection.d.ts.map +1 -1
  137. package/dist/modes/agent-connection/in-process-agent-connection.js +6 -0
  138. package/dist/modes/agent-connection/in-process-agent-connection.js.map +1 -1
  139. package/dist/modes/agent-connection/types.d.ts +3 -0
  140. package/dist/modes/agent-connection/types.d.ts.map +1 -1
  141. package/dist/modes/agent-connection/types.js.map +1 -1
  142. package/dist/modes/agents-view/agents-view-mode.d.ts.map +1 -1
  143. package/dist/modes/agents-view/agents-view-mode.js +2 -19
  144. package/dist/modes/agents-view/agents-view-mode.js.map +1 -1
  145. package/dist/modes/daemon/daemon-mode.d.ts +5 -0
  146. package/dist/modes/daemon/daemon-mode.d.ts.map +1 -1
  147. package/dist/modes/daemon/daemon-mode.js +107 -12
  148. package/dist/modes/daemon/daemon-mode.js.map +1 -1
  149. package/dist/modes/daemon/daemon-protocol.d.ts +194 -165
  150. package/dist/modes/daemon/daemon-protocol.d.ts.map +1 -1
  151. package/dist/modes/daemon/daemon-protocol.js +16 -11
  152. package/dist/modes/daemon/daemon-protocol.js.map +1 -1
  153. package/dist/modes/daemon/daemon-rlm-capacity-coordinator.d.ts +19 -0
  154. package/dist/modes/daemon/daemon-rlm-capacity-coordinator.d.ts.map +1 -0
  155. package/dist/modes/daemon/daemon-rlm-capacity-coordinator.js +74 -0
  156. package/dist/modes/daemon/daemon-rlm-capacity-coordinator.js.map +1 -0
  157. package/dist/modes/daemon/daemon-rlm-capacity.d.ts +19 -0
  158. package/dist/modes/daemon/daemon-rlm-capacity.d.ts.map +1 -0
  159. package/dist/modes/daemon/daemon-rlm-capacity.js +85 -0
  160. package/dist/modes/daemon/daemon-rlm-capacity.js.map +1 -0
  161. package/dist/modes/daemon/daemon-session-summarizer.d.ts +2 -3
  162. package/dist/modes/daemon/daemon-session-summarizer.d.ts.map +1 -1
  163. package/dist/modes/daemon/daemon-session-summarizer.js +32 -23
  164. package/dist/modes/daemon/daemon-session-summarizer.js.map +1 -1
  165. package/dist/modes/daemon/daemon-state-root.d.ts +15 -0
  166. package/dist/modes/daemon/daemon-state-root.d.ts.map +1 -0
  167. package/dist/modes/daemon/daemon-state-root.js +40 -0
  168. package/dist/modes/daemon/daemon-state-root.js.map +1 -0
  169. package/dist/modes/daemon/daemon-supervisor-ownership.d.ts +2 -0
  170. package/dist/modes/daemon/daemon-supervisor-ownership.d.ts.map +1 -1
  171. package/dist/modes/daemon/daemon-supervisor-ownership.js +27 -0
  172. package/dist/modes/daemon/daemon-supervisor-ownership.js.map +1 -1
  173. package/dist/modes/daemon/daemon-supervisor.d.ts +10 -1
  174. package/dist/modes/daemon/daemon-supervisor.d.ts.map +1 -1
  175. package/dist/modes/daemon/daemon-supervisor.js +213 -20
  176. package/dist/modes/daemon/daemon-supervisor.js.map +1 -1
  177. package/dist/modes/daemon/daemon-worker-protocol.d.ts +28 -1
  178. package/dist/modes/daemon/daemon-worker-protocol.d.ts.map +1 -1
  179. package/dist/modes/daemon/daemon-worker-protocol.js +16 -2
  180. package/dist/modes/daemon/daemon-worker-protocol.js.map +1 -1
  181. package/dist/modes/daemon/saved-session-catalog.d.ts.map +1 -1
  182. package/dist/modes/daemon/saved-session-catalog.js +2 -0
  183. package/dist/modes/daemon/saved-session-catalog.js.map +1 -1
  184. package/dist/modes/interactive/auth-flows.d.ts +0 -6
  185. package/dist/modes/interactive/auth-flows.d.ts.map +1 -1
  186. package/dist/modes/interactive/auth-flows.js +6 -126
  187. package/dist/modes/interactive/auth-flows.js.map +1 -1
  188. package/dist/modes/interactive/components/configuration-menu.d.ts +3 -0
  189. package/dist/modes/interactive/components/configuration-menu.d.ts.map +1 -1
  190. package/dist/modes/interactive/components/configuration-menu.js +13 -2
  191. package/dist/modes/interactive/components/configuration-menu.js.map +1 -1
  192. package/dist/modes/interactive/components/footer.d.ts +1 -1
  193. package/dist/modes/interactive/components/footer.d.ts.map +1 -1
  194. package/dist/modes/interactive/components/footer.js +2 -2
  195. package/dist/modes/interactive/components/footer.js.map +1 -1
  196. package/dist/modes/interactive/components/index.d.ts +0 -1
  197. package/dist/modes/interactive/components/index.d.ts.map +1 -1
  198. package/dist/modes/interactive/components/index.js +0 -1
  199. package/dist/modes/interactive/components/index.js.map +1 -1
  200. package/dist/modes/interactive/components/login-dialog.d.ts +0 -1
  201. package/dist/modes/interactive/components/login-dialog.d.ts.map +1 -1
  202. package/dist/modes/interactive/components/login-dialog.js +3 -40
  203. package/dist/modes/interactive/components/login-dialog.js.map +1 -1
  204. package/dist/modes/interactive/components/model-selector.d.ts +2 -0
  205. package/dist/modes/interactive/components/model-selector.d.ts.map +1 -1
  206. package/dist/modes/interactive/components/model-selector.js +13 -2
  207. package/dist/modes/interactive/components/model-selector.js.map +1 -1
  208. package/dist/modes/interactive/components/oauth-selector.d.ts.map +1 -1
  209. package/dist/modes/interactive/components/oauth-selector.js +2 -11
  210. package/dist/modes/interactive/components/oauth-selector.js.map +1 -1
  211. package/dist/modes/interactive/feature-hints.d.ts.map +1 -1
  212. package/dist/modes/interactive/feature-hints.js +0 -4
  213. package/dist/modes/interactive/feature-hints.js.map +1 -1
  214. package/dist/modes/interactive/interactive-mode.d.ts +3 -12
  215. package/dist/modes/interactive/interactive-mode.d.ts.map +1 -1
  216. package/dist/modes/interactive/interactive-mode.js +81 -507
  217. package/dist/modes/interactive/interactive-mode.js.map +1 -1
  218. package/dist/modes/interactive/onboarding.d.ts +0 -3
  219. package/dist/modes/interactive/onboarding.d.ts.map +1 -1
  220. package/dist/modes/interactive/onboarding.js +0 -17
  221. package/dist/modes/interactive/onboarding.js.map +1 -1
  222. package/dist/modes/rpc/rpc-client.d.ts +2 -1
  223. package/dist/modes/rpc/rpc-client.d.ts.map +1 -1
  224. package/dist/modes/rpc/rpc-client.js +24 -11
  225. package/dist/modes/rpc/rpc-client.js.map +1 -1
  226. package/dist/node/amazon-bedrock.d.ts +2 -0
  227. package/dist/node/amazon-bedrock.d.ts.map +1 -0
  228. package/dist/node/amazon-bedrock.js +6 -0
  229. package/dist/node/amazon-bedrock.js.map +1 -0
  230. package/dist/product-identity.d.ts +0 -1
  231. package/dist/product-identity.d.ts.map +1 -1
  232. package/dist/product-identity.js +0 -1
  233. package/dist/product-identity.js.map +1 -1
  234. package/docs/development.md +1 -1
  235. package/docs/fork-philosophy.md +4 -8
  236. package/docs/installation.md +83 -62
  237. package/docs/providers.md +23 -25
  238. package/docs/quickstart.md +19 -10
  239. package/docs/rlm-runtime.md +13 -5
  240. package/docs/rpc.md +4 -4
  241. package/docs/sdk.md +20 -11
  242. package/docs/sessions.md +0 -1
  243. package/docs/settings.md +9 -42
  244. package/docs/skills.md +0 -1
  245. package/docs/upstream-0.9.5.md +171 -0
  246. package/docs/usage.md +14 -10
  247. package/package.json +4 -4
  248. package/dist/core/agent-traces.d.ts +0 -149
  249. package/dist/core/agent-traces.d.ts.map +0 -1
  250. package/dist/core/agent-traces.js +0 -904
  251. package/dist/core/agent-traces.js.map +0 -1
  252. package/dist/core/prime-inference-auth.d.ts +0 -70
  253. package/dist/core/prime-inference-auth.d.ts.map +0 -1
  254. package/dist/core/prime-inference-auth.js +0 -352
  255. package/dist/core/prime-inference-auth.js.map +0 -1
  256. package/dist/core/prime-inference-model-selection.d.ts +0 -16
  257. package/dist/core/prime-inference-model-selection.d.ts.map +0 -1
  258. package/dist/core/prime-inference-model-selection.js +0 -16
  259. package/dist/core/prime-inference-model-selection.js.map +0 -1
  260. package/dist/core/prime-inference-models.d.ts +0 -6
  261. package/dist/core/prime-inference-models.d.ts.map +0 -1
  262. package/dist/core/prime-inference-models.js +0 -62
  263. package/dist/core/prime-inference-models.js.map +0 -1
  264. package/dist/core/telemetry.d.ts +0 -95
  265. package/dist/core/telemetry.d.ts.map +0 -1
  266. package/dist/core/telemetry.js +0 -637
  267. package/dist/core/telemetry.js.map +0 -1
  268. package/dist/modes/interactive/components/prime-onboarding-splash.d.ts +0 -39
  269. package/dist/modes/interactive/components/prime-onboarding-splash.d.ts.map +0 -1
  270. package/dist/modes/interactive/components/prime-onboarding-splash.js +0 -286
  271. package/dist/modes/interactive/components/prime-onboarding-splash.js.map +0 -1
  272. package/dist/modes/interactive/components/prime-team-selector.d.ts +0 -30
  273. package/dist/modes/interactive/components/prime-team-selector.d.ts.map +0 -1
  274. package/dist/modes/interactive/components/prime-team-selector.js +0 -166
  275. package/dist/modes/interactive/components/prime-team-selector.js.map +0 -1
  276. package/dist/skills/prime-intellect/SKILL.md +0 -87
  277. package/dist/skills/prime-intellect/references/compute.md +0 -45
  278. package/dist/skills/prime-intellect/references/environments.md +0 -73
  279. package/dist/skills/prime-intellect/references/inference.md +0 -47
  280. package/dist/skills/prime-intellect/references/sandboxes.md +0 -75
  281. package/skills/prime-intellect/SKILL.md +0 -87
  282. package/skills/prime-intellect/references/compute.md +0 -45
  283. package/skills/prime-intellect/references/environments.md +0 -73
  284. package/skills/prime-intellect/references/inference.md +0 -47
  285. package/skills/prime-intellect/references/sandboxes.md +0 -75
@@ -16030,2105 +16030,6 @@ var MODELS = {
16030
16030
  maxTokens: 235929
16031
16031
  }
16032
16032
  },
16033
- "prime-inference": {
16034
- "anthropic/claude-fable-5": {
16035
- id: "anthropic/claude-fable-5",
16036
- name: "Claude Fable 5",
16037
- api: "openai-completions",
16038
- provider: "prime-inference",
16039
- baseUrl: "https://api.pinference.ai/api/v1",
16040
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16041
- reasoning: true,
16042
- thinkingLevelMap: { "off": null, "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
16043
- input: ["text", "image"],
16044
- cost: {
16045
- input: 10,
16046
- output: 50,
16047
- cacheRead: 1,
16048
- cacheWrite: 12.5
16049
- },
16050
- contextWindow: 1e6,
16051
- maxTokens: 128e3,
16052
- featured: true
16053
- },
16054
- "anthropic/claude-fable-5.1": {
16055
- id: "anthropic/claude-fable-5.1",
16056
- name: "Claude Fable 5.1",
16057
- api: "openai-completions",
16058
- provider: "prime-inference",
16059
- baseUrl: "https://api.pinference.ai/api/v1",
16060
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16061
- reasoning: true,
16062
- thinkingLevelMap: { "off": null, "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
16063
- input: ["text", "image"],
16064
- cost: {
16065
- input: 10,
16066
- output: 50,
16067
- cacheRead: 1,
16068
- cacheWrite: 12.5
16069
- },
16070
- contextWindow: 1e6,
16071
- maxTokens: 128e3
16072
- },
16073
- "anthropic/claude-haiku-4.5": {
16074
- id: "anthropic/claude-haiku-4.5",
16075
- name: "Claude Haiku 4.5",
16076
- api: "openai-completions",
16077
- provider: "prime-inference",
16078
- baseUrl: "https://api.pinference.ai/api/v1",
16079
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16080
- reasoning: true,
16081
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16082
- input: ["text", "image"],
16083
- cost: {
16084
- input: 1,
16085
- output: 5,
16086
- cacheRead: 0.1,
16087
- cacheWrite: 1.25
16088
- },
16089
- contextWindow: 2e5,
16090
- maxTokens: 64e3,
16091
- featured: true
16092
- },
16093
- "anthropic/claude-opus-4.1": {
16094
- id: "anthropic/claude-opus-4.1",
16095
- name: "Claude Opus 4.1",
16096
- api: "openai-completions",
16097
- provider: "prime-inference",
16098
- baseUrl: "https://api.pinference.ai/api/v1",
16099
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16100
- reasoning: true,
16101
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16102
- input: ["text", "image"],
16103
- cost: {
16104
- input: 15,
16105
- output: 75,
16106
- cacheRead: 1.5,
16107
- cacheWrite: 18.75
16108
- },
16109
- contextWindow: 2e5,
16110
- maxTokens: 32e3
16111
- },
16112
- "anthropic/claude-opus-4.5": {
16113
- id: "anthropic/claude-opus-4.5",
16114
- name: "Claude Opus 4.5",
16115
- api: "openai-completions",
16116
- provider: "prime-inference",
16117
- baseUrl: "https://api.pinference.ai/api/v1",
16118
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16119
- reasoning: true,
16120
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16121
- input: ["text", "image"],
16122
- cost: {
16123
- input: 5,
16124
- output: 25,
16125
- cacheRead: 0.5,
16126
- cacheWrite: 6.25
16127
- },
16128
- contextWindow: 2e5,
16129
- maxTokens: 64e3
16130
- },
16131
- "anthropic/claude-opus-4.6": {
16132
- id: "anthropic/claude-opus-4.6",
16133
- name: "Claude Opus 4.6",
16134
- api: "openai-completions",
16135
- provider: "prime-inference",
16136
- baseUrl: "https://api.pinference.ai/api/v1",
16137
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16138
- reasoning: true,
16139
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": "max" },
16140
- input: ["text", "image"],
16141
- cost: {
16142
- input: 5,
16143
- output: 25,
16144
- cacheRead: 0.5,
16145
- cacheWrite: 6.25
16146
- },
16147
- contextWindow: 1e6,
16148
- maxTokens: 128e3,
16149
- featured: true
16150
- },
16151
- "anthropic/claude-opus-4.7": {
16152
- id: "anthropic/claude-opus-4.7",
16153
- name: "Claude Opus 4.7",
16154
- api: "openai-completions",
16155
- provider: "prime-inference",
16156
- baseUrl: "https://api.pinference.ai/api/v1",
16157
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16158
- reasoning: true,
16159
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
16160
- input: ["text", "image"],
16161
- cost: {
16162
- input: 5,
16163
- output: 25,
16164
- cacheRead: 0.5,
16165
- cacheWrite: 6.25
16166
- },
16167
- contextWindow: 1e6,
16168
- maxTokens: 128e3,
16169
- featured: true
16170
- },
16171
- "anthropic/claude-opus-4.8": {
16172
- id: "anthropic/claude-opus-4.8",
16173
- name: "Claude Opus 4.8",
16174
- api: "openai-completions",
16175
- provider: "prime-inference",
16176
- baseUrl: "https://api.pinference.ai/api/v1",
16177
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16178
- reasoning: true,
16179
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
16180
- input: ["text", "image"],
16181
- cost: {
16182
- input: 5,
16183
- output: 25,
16184
- cacheRead: 0.5,
16185
- cacheWrite: 6.25
16186
- },
16187
- contextWindow: 1e6,
16188
- maxTokens: 128e3,
16189
- featured: true
16190
- },
16191
- "anthropic/claude-opus-5": {
16192
- id: "anthropic/claude-opus-5",
16193
- name: "Claude Opus 5",
16194
- api: "openai-completions",
16195
- provider: "prime-inference",
16196
- baseUrl: "https://api.pinference.ai/api/v1",
16197
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16198
- reasoning: true,
16199
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
16200
- input: ["text", "image"],
16201
- cost: {
16202
- input: 5,
16203
- output: 25,
16204
- cacheRead: 0.5,
16205
- cacheWrite: 6.25
16206
- },
16207
- contextWindow: 1e6,
16208
- maxTokens: 128e3
16209
- },
16210
- "anthropic/claude-sonnet-4": {
16211
- id: "anthropic/claude-sonnet-4",
16212
- name: "Claude Sonnet 4",
16213
- api: "openai-completions",
16214
- provider: "prime-inference",
16215
- baseUrl: "https://api.pinference.ai/api/v1",
16216
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16217
- reasoning: true,
16218
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16219
- input: ["text", "image"],
16220
- cost: {
16221
- input: 3,
16222
- output: 15,
16223
- cacheRead: 0.30000000000000004,
16224
- cacheWrite: 3.75
16225
- },
16226
- contextWindow: 2e5,
16227
- maxTokens: 64e3
16228
- },
16229
- "anthropic/claude-sonnet-4.5": {
16230
- id: "anthropic/claude-sonnet-4.5",
16231
- name: "Claude Sonnet 4.5",
16232
- api: "openai-completions",
16233
- provider: "prime-inference",
16234
- baseUrl: "https://api.pinference.ai/api/v1",
16235
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16236
- reasoning: true,
16237
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16238
- input: ["text", "image"],
16239
- cost: {
16240
- input: 3,
16241
- output: 15,
16242
- cacheRead: 0.30000000000000004,
16243
- cacheWrite: 3.75
16244
- },
16245
- contextWindow: 2e5,
16246
- maxTokens: 64e3,
16247
- featured: true
16248
- },
16249
- "anthropic/claude-sonnet-4.6": {
16250
- id: "anthropic/claude-sonnet-4.6",
16251
- name: "Claude Sonnet 4.6",
16252
- api: "openai-completions",
16253
- provider: "prime-inference",
16254
- baseUrl: "https://api.pinference.ai/api/v1",
16255
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16256
- reasoning: true,
16257
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": "max" },
16258
- input: ["text", "image"],
16259
- cost: {
16260
- input: 3,
16261
- output: 15,
16262
- cacheRead: 0.30000000000000004,
16263
- cacheWrite: 3.75
16264
- },
16265
- contextWindow: 1e6,
16266
- maxTokens: 128e3,
16267
- featured: true
16268
- },
16269
- "anthropic/claude-sonnet-5": {
16270
- id: "anthropic/claude-sonnet-5",
16271
- name: "Claude Sonnet 5",
16272
- api: "openai-completions",
16273
- provider: "prime-inference",
16274
- baseUrl: "https://api.pinference.ai/api/v1",
16275
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16276
- reasoning: true,
16277
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
16278
- input: ["text", "image"],
16279
- cost: {
16280
- input: 2,
16281
- output: 10,
16282
- cacheRead: 0.2,
16283
- cacheWrite: 2.5
16284
- },
16285
- contextWindow: 1e6,
16286
- maxTokens: 128e3,
16287
- featured: true
16288
- },
16289
- "deepseek/deepseek-chat": {
16290
- id: "deepseek/deepseek-chat",
16291
- name: "Deepseek Chat",
16292
- api: "openai-completions",
16293
- provider: "prime-inference",
16294
- baseUrl: "https://api.pinference.ai/api/v1",
16295
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16296
- reasoning: false,
16297
- input: ["text"],
16298
- cost: {
16299
- input: 0.4,
16300
- output: 1.3,
16301
- cacheRead: 0,
16302
- cacheWrite: 0
16303
- },
16304
- contextWindow: 163840,
16305
- maxTokens: 16384
16306
- },
16307
- "deepseek/deepseek-chat-v3-0324": {
16308
- id: "deepseek/deepseek-chat-v3-0324",
16309
- name: "Deepseek Chat V3 0324",
16310
- api: "openai-completions",
16311
- provider: "prime-inference",
16312
- baseUrl: "https://api.pinference.ai/api/v1",
16313
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16314
- reasoning: false,
16315
- input: ["text"],
16316
- cost: {
16317
- input: 0.27,
16318
- output: 1.12,
16319
- cacheRead: 0,
16320
- cacheWrite: 0
16321
- },
16322
- contextWindow: 163840,
16323
- maxTokens: 147456
16324
- },
16325
- "deepseek/deepseek-chat-v3.1": {
16326
- id: "deepseek/deepseek-chat-v3.1",
16327
- name: "Deepseek Chat V3.1",
16328
- api: "openai-completions",
16329
- provider: "prime-inference",
16330
- baseUrl: "https://api.pinference.ai/api/v1",
16331
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16332
- reasoning: true,
16333
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16334
- input: ["text"],
16335
- cost: {
16336
- input: 0.6,
16337
- output: 1.7,
16338
- cacheRead: 0,
16339
- cacheWrite: 0
16340
- },
16341
- contextWindow: 163840,
16342
- maxTokens: 144900
16343
- },
16344
- "deepseek/deepseek-v3.1-terminus": {
16345
- id: "deepseek/deepseek-v3.1-terminus",
16346
- name: "Deepseek V3.1 Terminus",
16347
- api: "openai-completions",
16348
- provider: "prime-inference",
16349
- baseUrl: "https://api.pinference.ai/api/v1",
16350
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16351
- reasoning: true,
16352
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16353
- input: ["text"],
16354
- cost: {
16355
- input: 0.27,
16356
- output: 1,
16357
- cacheRead: 0,
16358
- cacheWrite: 0
16359
- },
16360
- contextWindow: 163840,
16361
- maxTokens: 32768
16362
- },
16363
- "deepseek/deepseek-v3.2": {
16364
- id: "deepseek/deepseek-v3.2",
16365
- name: "Deepseek V3.2",
16366
- api: "openai-completions",
16367
- provider: "prime-inference",
16368
- baseUrl: "https://api.pinference.ai/api/v1",
16369
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16370
- reasoning: true,
16371
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16372
- input: ["text"],
16373
- cost: {
16374
- input: 0.3705,
16375
- output: 1.1115,
16376
- cacheRead: 0,
16377
- cacheWrite: 0
16378
- },
16379
- contextWindow: 163840,
16380
- maxTokens: 65536,
16381
- featured: true
16382
- },
16383
- "deepseek/deepseek-v3.2-exp": {
16384
- id: "deepseek/deepseek-v3.2-exp",
16385
- name: "Deepseek V3.2 EXP",
16386
- api: "openai-completions",
16387
- provider: "prime-inference",
16388
- baseUrl: "https://api.pinference.ai/api/v1",
16389
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16390
- reasoning: true,
16391
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16392
- input: ["text"],
16393
- cost: {
16394
- input: 0.27,
16395
- output: 0.41,
16396
- cacheRead: 0,
16397
- cacheWrite: 0
16398
- },
16399
- contextWindow: 163840,
16400
- maxTokens: 65536
16401
- },
16402
- "deepseek/deepseek-v4-flash": {
16403
- id: "deepseek/deepseek-v4-flash",
16404
- name: "Deepseek V4 Flash",
16405
- api: "openai-completions",
16406
- provider: "prime-inference",
16407
- baseUrl: "https://api.pinference.ai/api/v1",
16408
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false, "requiresReasoningContentOnAssistantMessages": true, "thinkingFormat": "deepseek" },
16409
- reasoning: true,
16410
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": "max", "max": null },
16411
- input: ["text"],
16412
- cost: {
16413
- input: 0.44,
16414
- output: 1.32,
16415
- cacheRead: 0,
16416
- cacheWrite: 0
16417
- },
16418
- contextWindow: 1048576,
16419
- maxTokens: 384e3,
16420
- featured: true
16421
- },
16422
- "deepseek/deepseek-v4-flash-0731": {
16423
- id: "deepseek/deepseek-v4-flash-0731",
16424
- name: "Deepseek V4 Flash 0731",
16425
- api: "openai-completions",
16426
- provider: "prime-inference",
16427
- baseUrl: "https://api.pinference.ai/api/v1",
16428
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false, "requiresReasoningContentOnAssistantMessages": true, "thinkingFormat": "deepseek" },
16429
- reasoning: true,
16430
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": "max", "max": null },
16431
- input: ["text"],
16432
- cost: {
16433
- input: 0.44,
16434
- output: 1.32,
16435
- cacheRead: 0,
16436
- cacheWrite: 0
16437
- },
16438
- contextWindow: 1310720,
16439
- maxTokens: 131072
16440
- },
16441
- "deepseek/deepseek-v4-pro": {
16442
- id: "deepseek/deepseek-v4-pro",
16443
- name: "Deepseek V4 PRO",
16444
- api: "openai-completions",
16445
- provider: "prime-inference",
16446
- baseUrl: "https://api.pinference.ai/api/v1",
16447
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false, "requiresReasoningContentOnAssistantMessages": true, "thinkingFormat": "deepseek" },
16448
- reasoning: true,
16449
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": "max", "max": null },
16450
- input: ["text"],
16451
- cost: {
16452
- input: 1.91,
16453
- output: 3.83,
16454
- cacheRead: 0,
16455
- cacheWrite: 0
16456
- },
16457
- contextWindow: 1048576,
16458
- maxTokens: 384e3,
16459
- featured: true
16460
- },
16461
- "google/gemini-2.5-flash": {
16462
- id: "google/gemini-2.5-flash",
16463
- name: "Gemini 2.5 Flash",
16464
- api: "openai-completions",
16465
- provider: "prime-inference",
16466
- baseUrl: "https://api.pinference.ai/api/v1",
16467
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16468
- reasoning: true,
16469
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16470
- input: ["text", "image"],
16471
- cost: {
16472
- input: 0.3,
16473
- output: 2.5,
16474
- cacheRead: 0,
16475
- cacheWrite: 0
16476
- },
16477
- contextWindow: 1048576,
16478
- maxTokens: 65535
16479
- },
16480
- "google/gemini-2.5-flash-lite": {
16481
- id: "google/gemini-2.5-flash-lite",
16482
- name: "Gemini 2.5 Flash Lite",
16483
- api: "openai-completions",
16484
- provider: "prime-inference",
16485
- baseUrl: "https://api.pinference.ai/api/v1",
16486
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16487
- reasoning: true,
16488
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16489
- input: ["text", "image"],
16490
- cost: {
16491
- input: 0.1,
16492
- output: 0.4,
16493
- cacheRead: 0,
16494
- cacheWrite: 0
16495
- },
16496
- contextWindow: 1048576,
16497
- maxTokens: 65535
16498
- },
16499
- "google/gemini-2.5-pro": {
16500
- id: "google/gemini-2.5-pro",
16501
- name: "Gemini 2.5 PRO",
16502
- api: "openai-completions",
16503
- provider: "prime-inference",
16504
- baseUrl: "https://api.pinference.ai/api/v1",
16505
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16506
- reasoning: true,
16507
- thinkingLevelMap: { "off": null, "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16508
- input: ["text", "image"],
16509
- cost: {
16510
- input: 1.25,
16511
- output: 10,
16512
- cacheRead: 0,
16513
- cacheWrite: 0
16514
- },
16515
- contextWindow: 1048576,
16516
- maxTokens: 65536
16517
- },
16518
- "google/gemini-3-flash-preview": {
16519
- id: "google/gemini-3-flash-preview",
16520
- name: "Gemini 3 Flash Preview",
16521
- api: "openai-completions",
16522
- provider: "prime-inference",
16523
- baseUrl: "https://api.pinference.ai/api/v1",
16524
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16525
- reasoning: true,
16526
- thinkingLevelMap: { "minimal": "minimal", "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": null },
16527
- input: ["text", "image"],
16528
- cost: {
16529
- input: 0.5,
16530
- output: 3,
16531
- cacheRead: 0,
16532
- cacheWrite: 0
16533
- },
16534
- contextWindow: 1048576,
16535
- maxTokens: 65536
16536
- },
16537
- "google/gemini-3.1-pro-preview": {
16538
- id: "google/gemini-3.1-pro-preview",
16539
- name: "Gemini 3.1 PRO Preview",
16540
- api: "openai-completions",
16541
- provider: "prime-inference",
16542
- baseUrl: "https://api.pinference.ai/api/v1",
16543
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16544
- reasoning: true,
16545
- thinkingLevelMap: { "off": null, "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": null },
16546
- input: ["text", "image"],
16547
- cost: {
16548
- input: 2,
16549
- output: 12,
16550
- cacheRead: 0,
16551
- cacheWrite: 0
16552
- },
16553
- contextWindow: 1048576,
16554
- maxTokens: 65536
16555
- },
16556
- "google/gemini-3.5-flash": {
16557
- id: "google/gemini-3.5-flash",
16558
- name: "Gemini 3.5 Flash",
16559
- api: "openai-completions",
16560
- provider: "prime-inference",
16561
- baseUrl: "https://api.pinference.ai/api/v1",
16562
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16563
- reasoning: true,
16564
- thinkingLevelMap: { "off": null, "minimal": "minimal", "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": null },
16565
- input: ["text", "image"],
16566
- cost: {
16567
- input: 1.5,
16568
- output: 9,
16569
- cacheRead: 0,
16570
- cacheWrite: 0
16571
- },
16572
- contextWindow: 1048576,
16573
- maxTokens: 65536
16574
- },
16575
- "google/gemini-3.6-flash": {
16576
- id: "google/gemini-3.6-flash",
16577
- name: "Gemini 3.6 Flash",
16578
- api: "openai-completions",
16579
- provider: "prime-inference",
16580
- baseUrl: "https://api.pinference.ai/api/v1",
16581
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16582
- reasoning: true,
16583
- thinkingLevelMap: { "off": null, "minimal": "minimal", "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": null },
16584
- input: ["text", "image"],
16585
- cost: {
16586
- input: 1.5,
16587
- output: 7.5,
16588
- cacheRead: 0,
16589
- cacheWrite: 0
16590
- },
16591
- contextWindow: 1048576,
16592
- maxTokens: 65536
16593
- },
16594
- "google/gemini-3.7-flash": {
16595
- id: "google/gemini-3.7-flash",
16596
- name: "Gemini 3.7 Flash",
16597
- api: "openai-completions",
16598
- provider: "prime-inference",
16599
- baseUrl: "https://api.pinference.ai/api/v1",
16600
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16601
- reasoning: true,
16602
- thinkingLevelMap: { "off": null, "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": null },
16603
- input: ["text", "image"],
16604
- cost: {
16605
- input: 1.35,
16606
- output: 6.75,
16607
- cacheRead: 0,
16608
- cacheWrite: 0
16609
- },
16610
- contextWindow: 1048576,
16611
- maxTokens: 65536
16612
- },
16613
- "google/gemini-3.8-flash": {
16614
- id: "google/gemini-3.8-flash",
16615
- name: "Gemini 3.8 Flash",
16616
- api: "openai-completions",
16617
- provider: "prime-inference",
16618
- baseUrl: "https://api.pinference.ai/api/v1",
16619
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16620
- reasoning: true,
16621
- thinkingLevelMap: { "off": null, "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": null },
16622
- input: ["text", "image"],
16623
- cost: {
16624
- input: 0.75,
16625
- output: 3.75,
16626
- cacheRead: 0,
16627
- cacheWrite: 0
16628
- },
16629
- contextWindow: 1048576,
16630
- maxTokens: 65536
16631
- },
16632
- "google/gemma-3-27b-it": {
16633
- id: "google/gemma-3-27b-it",
16634
- name: "Gemma 3 27B IT",
16635
- api: "openai-completions",
16636
- provider: "prime-inference",
16637
- baseUrl: "https://api.pinference.ai/api/v1",
16638
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16639
- reasoning: false,
16640
- input: ["text", "image"],
16641
- cost: {
16642
- input: 0.119,
16643
- output: 0.3,
16644
- cacheRead: 0,
16645
- cacheWrite: 0
16646
- },
16647
- contextWindow: 131072,
16648
- maxTokens: 117964
16649
- },
16650
- "meta-llama/Llama-3.2-1B-Instruct": {
16651
- id: "meta-llama/Llama-3.2-1B-Instruct",
16652
- name: "Llama 3.2 1B Instruct",
16653
- api: "openai-completions",
16654
- provider: "prime-inference",
16655
- baseUrl: "https://api.pinference.ai/api/v1",
16656
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16657
- reasoning: false,
16658
- input: ["text"],
16659
- cost: {
16660
- input: 0.027,
16661
- output: 0.201,
16662
- cacheRead: 0,
16663
- cacheWrite: 0
16664
- },
16665
- contextWindow: 6e4,
16666
- maxTokens: 54e3
16667
- },
16668
- "meta-llama/Llama-3.2-3B-Instruct": {
16669
- id: "meta-llama/Llama-3.2-3B-Instruct",
16670
- name: "Llama 3.2 3B Instruct",
16671
- api: "openai-completions",
16672
- provider: "prime-inference",
16673
- baseUrl: "https://api.pinference.ai/api/v1",
16674
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16675
- reasoning: false,
16676
- input: ["text"],
16677
- cost: {
16678
- input: 0.0509,
16679
- output: 0.335,
16680
- cacheRead: 0,
16681
- cacheWrite: 0
16682
- },
16683
- contextWindow: 8e4,
16684
- maxTokens: 8e4
16685
- },
16686
- "meta-llama/llama-3.3-70b-instruct": {
16687
- id: "meta-llama/llama-3.3-70b-instruct",
16688
- name: "Llama 3.3 70B Instruct",
16689
- api: "openai-completions",
16690
- provider: "prime-inference",
16691
- baseUrl: "https://api.pinference.ai/api/v1",
16692
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16693
- reasoning: false,
16694
- input: ["text"],
16695
- cost: {
16696
- input: 1.04,
16697
- output: 2.253,
16698
- cacheRead: 0,
16699
- cacheWrite: 0
16700
- },
16701
- contextWindow: 131072,
16702
- maxTokens: 16384
16703
- },
16704
- "meta-llama/llama-4-maverick": {
16705
- id: "meta-llama/llama-4-maverick",
16706
- name: "Llama 4 Maverick",
16707
- api: "openai-completions",
16708
- provider: "prime-inference",
16709
- baseUrl: "https://api.pinference.ai/api/v1",
16710
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16711
- reasoning: false,
16712
- input: ["text", "image"],
16713
- cost: {
16714
- input: 0.35,
16715
- output: 1.15,
16716
- cacheRead: 0,
16717
- cacheWrite: 0
16718
- },
16719
- contextWindow: 1048576,
16720
- maxTokens: 115200
16721
- },
16722
- "minimax/minimax-m2.5": {
16723
- id: "minimax/minimax-m2.5",
16724
- name: "Minimax M2.5",
16725
- api: "openai-completions",
16726
- provider: "prime-inference",
16727
- baseUrl: "https://api.pinference.ai/api/v1",
16728
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16729
- reasoning: true,
16730
- thinkingLevelMap: { "off": null, "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16731
- input: ["text"],
16732
- cost: {
16733
- input: 0.6,
16734
- output: 2.4,
16735
- cacheRead: 0,
16736
- cacheWrite: 0
16737
- },
16738
- contextWindow: 204800,
16739
- maxTokens: 128e3
16740
- },
16741
- "minimax/minimax-m2.7": {
16742
- id: "minimax/minimax-m2.7",
16743
- name: "Minimax M2.7",
16744
- api: "openai-completions",
16745
- provider: "prime-inference",
16746
- baseUrl: "https://api.pinference.ai/api/v1",
16747
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16748
- reasoning: true,
16749
- thinkingLevelMap: { "off": null, "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16750
- input: ["text"],
16751
- cost: {
16752
- input: 0.6,
16753
- output: 2.4,
16754
- cacheRead: 0,
16755
- cacheWrite: 0
16756
- },
16757
- contextWindow: 204800,
16758
- maxTokens: 131072
16759
- },
16760
- "minimax/minimax-m3": {
16761
- id: "minimax/minimax-m3",
16762
- name: "Minimax M3",
16763
- api: "openai-completions",
16764
- provider: "prime-inference",
16765
- baseUrl: "https://api.pinference.ai/api/v1",
16766
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16767
- reasoning: true,
16768
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16769
- input: ["text", "image"],
16770
- cost: {
16771
- input: 0.3,
16772
- output: 1.2,
16773
- cacheRead: 0,
16774
- cacheWrite: 0
16775
- },
16776
- contextWindow: 524288,
16777
- maxTokens: 512e3,
16778
- featured: true
16779
- },
16780
- "mistralai/mistral-large-2512": {
16781
- id: "mistralai/mistral-large-2512",
16782
- name: "Mistral Large 2512",
16783
- api: "openai-completions",
16784
- provider: "prime-inference",
16785
- baseUrl: "https://api.pinference.ai/api/v1",
16786
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16787
- reasoning: false,
16788
- input: ["text", "image"],
16789
- cost: {
16790
- input: 0.5,
16791
- output: 1.5,
16792
- cacheRead: 0,
16793
- cacheWrite: 0
16794
- },
16795
- contextWindow: 262144,
16796
- maxTokens: 209715
16797
- },
16798
- "mistralai/mistral-nemo": {
16799
- id: "mistralai/mistral-nemo",
16800
- name: "Mistral Nemo",
16801
- api: "openai-completions",
16802
- provider: "prime-inference",
16803
- baseUrl: "https://api.pinference.ai/api/v1",
16804
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16805
- reasoning: false,
16806
- input: ["text"],
16807
- cost: {
16808
- input: 0.165,
16809
- output: 0.17,
16810
- cacheRead: 0,
16811
- cacheWrite: 0
16812
- },
16813
- contextWindow: 131072,
16814
- maxTokens: 16384
16815
- },
16816
- "mistralai/mistral-small-2603": {
16817
- id: "mistralai/mistral-small-2603",
16818
- name: "Mistral Small 2603",
16819
- api: "openai-completions",
16820
- provider: "prime-inference",
16821
- baseUrl: "https://api.pinference.ai/api/v1",
16822
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16823
- reasoning: true,
16824
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16825
- input: ["text", "image"],
16826
- cost: {
16827
- input: 0.165,
16828
- output: 0.66,
16829
- cacheRead: 0,
16830
- cacheWrite: 0
16831
- },
16832
- contextWindow: 262144,
16833
- maxTokens: 209715
16834
- },
16835
- "mistralai/mixtral-8x22b-instruct": {
16836
- id: "mistralai/mixtral-8x22b-instruct",
16837
- name: "Mixtral 8X22B Instruct",
16838
- api: "openai-completions",
16839
- provider: "prime-inference",
16840
- baseUrl: "https://api.pinference.ai/api/v1",
16841
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16842
- reasoning: false,
16843
- input: ["text"],
16844
- cost: {
16845
- input: 2.2,
16846
- output: 6.6,
16847
- cacheRead: 0,
16848
- cacheWrite: 0
16849
- },
16850
- contextWindow: 65536,
16851
- maxTokens: 52428
16852
- },
16853
- "moonshotai/kimi-k2-0905": {
16854
- id: "moonshotai/kimi-k2-0905",
16855
- name: "Kimi K2 0905",
16856
- api: "openai-completions",
16857
- provider: "prime-inference",
16858
- baseUrl: "https://api.pinference.ai/api/v1",
16859
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16860
- reasoning: false,
16861
- input: ["text"],
16862
- cost: {
16863
- input: 0.6,
16864
- output: 2.5,
16865
- cacheRead: 0,
16866
- cacheWrite: 0
16867
- },
16868
- contextWindow: 98304,
16869
- maxTokens: 98304
16870
- },
16871
- "moonshotai/kimi-k2.5": {
16872
- id: "moonshotai/kimi-k2.5",
16873
- name: "Kimi K2.5",
16874
- api: "openai-completions",
16875
- provider: "prime-inference",
16876
- baseUrl: "https://api.pinference.ai/api/v1",
16877
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16878
- reasoning: true,
16879
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16880
- input: ["text", "image"],
16881
- cost: {
16882
- input: 0.6,
16883
- output: 3,
16884
- cacheRead: 0,
16885
- cacheWrite: 0
16886
- },
16887
- contextWindow: 262144,
16888
- maxTokens: 65535
16889
- },
16890
- "moonshotai/kimi-k2.6": {
16891
- id: "moonshotai/kimi-k2.6",
16892
- name: "Kimi K2.6",
16893
- api: "openai-completions",
16894
- provider: "prime-inference",
16895
- baseUrl: "https://api.pinference.ai/api/v1",
16896
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16897
- reasoning: true,
16898
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16899
- input: ["text", "image"],
16900
- cost: {
16901
- input: 0.95,
16902
- output: 4,
16903
- cacheRead: 0,
16904
- cacheWrite: 0
16905
- },
16906
- contextWindow: 262144,
16907
- maxTokens: 262144
16908
- },
16909
- "moonshotai/kimi-k2.7-code": {
16910
- id: "moonshotai/kimi-k2.7-code",
16911
- name: "Kimi K2.7 Code",
16912
- api: "openai-completions",
16913
- provider: "prime-inference",
16914
- baseUrl: "https://api.pinference.ai/api/v1",
16915
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16916
- reasoning: true,
16917
- thinkingLevelMap: { "off": null, "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16918
- input: ["text", "image"],
16919
- cost: {
16920
- input: 1.9,
16921
- output: 8,
16922
- cacheRead: 0,
16923
- cacheWrite: 0
16924
- },
16925
- contextWindow: 262144,
16926
- maxTokens: 235929,
16927
- featured: true
16928
- },
16929
- "moonshotai/kimi-k3": {
16930
- id: "moonshotai/kimi-k3",
16931
- name: "Kimi K3",
16932
- api: "openai-completions",
16933
- provider: "prime-inference",
16934
- baseUrl: "https://api.pinference.ai/api/v1",
16935
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16936
- reasoning: true,
16937
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": null, "high": "high", "xhigh": null, "max": "max" },
16938
- input: ["text", "image"],
16939
- cost: {
16940
- input: 3.45,
16941
- output: 17.25,
16942
- cacheRead: 0,
16943
- cacheWrite: 0
16944
- },
16945
- contextWindow: 1048576,
16946
- maxTokens: 1048576,
16947
- featured: true
16948
- },
16949
- "nvidia/nemotron-3-nano-30b-a3b": {
16950
- id: "nvidia/nemotron-3-nano-30b-a3b",
16951
- name: "Nemotron 3 Nano 30B A3B",
16952
- api: "openai-completions",
16953
- provider: "prime-inference",
16954
- baseUrl: "https://api.pinference.ai/api/v1",
16955
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
16956
- reasoning: true,
16957
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
16958
- input: ["text"],
16959
- cost: {
16960
- input: 0.06,
16961
- output: 0.24,
16962
- cacheRead: 0,
16963
- cacheWrite: 0
16964
- },
16965
- contextWindow: 262144,
16966
- maxTokens: 235929,
16967
- featured: true
16968
- },
16969
- "nvidia/nemotron-3-super-120b-a12b": {
16970
- id: "nvidia/nemotron-3-super-120b-a12b",
16971
- name: "Nemotron 3 Super 120B A12B",
16972
- api: "openai-completions",
16973
- provider: "prime-inference",
16974
- baseUrl: "https://api.pinference.ai/api/v1",
16975
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16976
- reasoning: true,
16977
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": null, "xhigh": null, "max": null },
16978
- input: ["text"],
16979
- cost: {
16980
- input: 0.3,
16981
- output: 0.65,
16982
- cacheRead: 0,
16983
- cacheWrite: 0
16984
- },
16985
- contextWindow: 262144,
16986
- maxTokens: 4096,
16987
- featured: true
16988
- },
16989
- "openai/gpt-4.1": {
16990
- id: "openai/gpt-4.1",
16991
- name: "GPT 4.1",
16992
- api: "openai-completions",
16993
- provider: "prime-inference",
16994
- baseUrl: "https://api.pinference.ai/api/v1",
16995
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
16996
- reasoning: false,
16997
- input: ["text", "image"],
16998
- cost: {
16999
- input: 2,
17000
- output: 8,
17001
- cacheRead: 0,
17002
- cacheWrite: 0
17003
- },
17004
- contextWindow: 1047576,
17005
- maxTokens: 32768
17006
- },
17007
- "openai/gpt-4.1-mini": {
17008
- id: "openai/gpt-4.1-mini",
17009
- name: "GPT 4.1 Mini",
17010
- api: "openai-completions",
17011
- provider: "prime-inference",
17012
- baseUrl: "https://api.pinference.ai/api/v1",
17013
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17014
- reasoning: false,
17015
- input: ["text", "image"],
17016
- cost: {
17017
- input: 0.4,
17018
- output: 1.6,
17019
- cacheRead: 0,
17020
- cacheWrite: 0
17021
- },
17022
- contextWindow: 1047576,
17023
- maxTokens: 32768
17024
- },
17025
- "openai/gpt-4.1-nano": {
17026
- id: "openai/gpt-4.1-nano",
17027
- name: "GPT 4.1 Nano",
17028
- api: "openai-completions",
17029
- provider: "prime-inference",
17030
- baseUrl: "https://api.pinference.ai/api/v1",
17031
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17032
- reasoning: false,
17033
- input: ["text", "image"],
17034
- cost: {
17035
- input: 0.1,
17036
- output: 0.4,
17037
- cacheRead: 0,
17038
- cacheWrite: 0
17039
- },
17040
- contextWindow: 1047576,
17041
- maxTokens: 32768
17042
- },
17043
- "openai/gpt-4o": {
17044
- id: "openai/gpt-4o",
17045
- name: "GPT 4O",
17046
- api: "openai-completions",
17047
- provider: "prime-inference",
17048
- baseUrl: "https://api.pinference.ai/api/v1",
17049
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17050
- reasoning: false,
17051
- input: ["text", "image"],
17052
- cost: {
17053
- input: 2.5,
17054
- output: 10,
17055
- cacheRead: 0,
17056
- cacheWrite: 0
17057
- },
17058
- contextWindow: 128e3,
17059
- maxTokens: 16384
17060
- },
17061
- "openai/gpt-4o-mini": {
17062
- id: "openai/gpt-4o-mini",
17063
- name: "GPT 4O Mini",
17064
- api: "openai-completions",
17065
- provider: "prime-inference",
17066
- baseUrl: "https://api.pinference.ai/api/v1",
17067
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17068
- reasoning: false,
17069
- input: ["text", "image"],
17070
- cost: {
17071
- input: 0.15,
17072
- output: 0.6,
17073
- cacheRead: 0,
17074
- cacheWrite: 0
17075
- },
17076
- contextWindow: 128e3,
17077
- maxTokens: 16384
17078
- },
17079
- "openai/gpt-5": {
17080
- id: "openai/gpt-5",
17081
- name: "GPT 5",
17082
- api: "openai-completions",
17083
- provider: "prime-inference",
17084
- baseUrl: "https://api.pinference.ai/api/v1",
17085
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17086
- reasoning: true,
17087
- thinkingLevelMap: { "off": null, "minimal": "minimal", "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": null },
17088
- input: ["text", "image"],
17089
- cost: {
17090
- input: 1.25,
17091
- output: 10,
17092
- cacheRead: 0,
17093
- cacheWrite: 0
17094
- },
17095
- contextWindow: 4e5,
17096
- maxTokens: 128e3
17097
- },
17098
- "openai/gpt-5-mini": {
17099
- id: "openai/gpt-5-mini",
17100
- name: "GPT 5 Mini",
17101
- api: "openai-completions",
17102
- provider: "prime-inference",
17103
- baseUrl: "https://api.pinference.ai/api/v1",
17104
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17105
- reasoning: true,
17106
- thinkingLevelMap: { "off": null, "minimal": "minimal", "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": null },
17107
- input: ["text", "image"],
17108
- cost: {
17109
- input: 0.25,
17110
- output: 2,
17111
- cacheRead: 0,
17112
- cacheWrite: 0
17113
- },
17114
- contextWindow: 4e5,
17115
- maxTokens: 128e3
17116
- },
17117
- "openai/gpt-5-nano": {
17118
- id: "openai/gpt-5-nano",
17119
- name: "GPT 5 Nano",
17120
- api: "openai-completions",
17121
- provider: "prime-inference",
17122
- baseUrl: "https://api.pinference.ai/api/v1",
17123
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17124
- reasoning: true,
17125
- thinkingLevelMap: { "off": null, "minimal": "minimal", "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": null },
17126
- input: ["text", "image"],
17127
- cost: {
17128
- input: 0.05,
17129
- output: 0.4,
17130
- cacheRead: 0,
17131
- cacheWrite: 0
17132
- },
17133
- contextWindow: 4e5,
17134
- maxTokens: 128e3
17135
- },
17136
- "openai/gpt-5.1": {
17137
- id: "openai/gpt-5.1",
17138
- name: "GPT 5.1",
17139
- api: "openai-completions",
17140
- provider: "prime-inference",
17141
- baseUrl: "https://api.pinference.ai/api/v1",
17142
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17143
- reasoning: true,
17144
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": null },
17145
- input: ["text", "image"],
17146
- cost: {
17147
- input: 1.25,
17148
- output: 10,
17149
- cacheRead: 0,
17150
- cacheWrite: 0
17151
- },
17152
- contextWindow: 4e5,
17153
- maxTokens: 128e3
17154
- },
17155
- "openai/gpt-5.2": {
17156
- id: "openai/gpt-5.2",
17157
- name: "GPT 5.2",
17158
- api: "openai-completions",
17159
- provider: "prime-inference",
17160
- baseUrl: "https://api.pinference.ai/api/v1",
17161
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17162
- reasoning: true,
17163
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": null },
17164
- input: ["text", "image"],
17165
- cost: {
17166
- input: 1.75,
17167
- output: 14,
17168
- cacheRead: 0,
17169
- cacheWrite: 0
17170
- },
17171
- contextWindow: 4e5,
17172
- maxTokens: 128e3
17173
- },
17174
- "openai/gpt-5.2-pro": {
17175
- id: "openai/gpt-5.2-pro",
17176
- name: "GPT 5.2 PRO",
17177
- api: "openai-completions",
17178
- provider: "prime-inference",
17179
- baseUrl: "https://api.pinference.ai/api/v1",
17180
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17181
- reasoning: true,
17182
- thinkingLevelMap: { "off": null, "minimal": null, "low": null, "medium": "medium", "high": "high", "xhigh": "xhigh", "max": null },
17183
- input: ["text", "image"],
17184
- cost: {
17185
- input: 21,
17186
- output: 168,
17187
- cacheRead: 0,
17188
- cacheWrite: 0
17189
- },
17190
- contextWindow: 4e5,
17191
- maxTokens: 128e3
17192
- },
17193
- "openai/gpt-5.3-codex": {
17194
- id: "openai/gpt-5.3-codex",
17195
- name: "GPT 5.3 Codex",
17196
- api: "openai-completions",
17197
- provider: "prime-inference",
17198
- baseUrl: "https://api.pinference.ai/api/v1",
17199
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17200
- reasoning: true,
17201
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": null },
17202
- input: ["text", "image"],
17203
- cost: {
17204
- input: 1.75,
17205
- output: 14,
17206
- cacheRead: 0,
17207
- cacheWrite: 0
17208
- },
17209
- contextWindow: 4e5,
17210
- maxTokens: 128e3,
17211
- featured: true
17212
- },
17213
- "openai/gpt-5.4": {
17214
- id: "openai/gpt-5.4",
17215
- name: "GPT 5.4",
17216
- api: "openai-completions",
17217
- provider: "prime-inference",
17218
- baseUrl: "https://api.pinference.ai/api/v1",
17219
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17220
- reasoning: true,
17221
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": null },
17222
- input: ["text", "image"],
17223
- cost: {
17224
- input: 2.5,
17225
- output: 15,
17226
- cacheRead: 0,
17227
- cacheWrite: 0
17228
- },
17229
- contextWindow: 105e4,
17230
- maxTokens: 128e3,
17231
- featured: true
17232
- },
17233
- "openai/gpt-5.4-mini": {
17234
- id: "openai/gpt-5.4-mini",
17235
- name: "GPT 5.4 Mini",
17236
- api: "openai-completions",
17237
- provider: "prime-inference",
17238
- baseUrl: "https://api.pinference.ai/api/v1",
17239
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17240
- reasoning: true,
17241
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": null },
17242
- input: ["text", "image"],
17243
- cost: {
17244
- input: 0.75,
17245
- output: 4.5,
17246
- cacheRead: 0,
17247
- cacheWrite: 0
17248
- },
17249
- contextWindow: 4e5,
17250
- maxTokens: 128e3,
17251
- featured: true
17252
- },
17253
- "openai/gpt-5.4-nano": {
17254
- id: "openai/gpt-5.4-nano",
17255
- name: "GPT 5.4 Nano",
17256
- api: "openai-completions",
17257
- provider: "prime-inference",
17258
- baseUrl: "https://api.pinference.ai/api/v1",
17259
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17260
- reasoning: true,
17261
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": null },
17262
- input: ["text", "image"],
17263
- cost: {
17264
- input: 0.2,
17265
- output: 1.25,
17266
- cacheRead: 0,
17267
- cacheWrite: 0
17268
- },
17269
- contextWindow: 4e5,
17270
- maxTokens: 128e3
17271
- },
17272
- "openai/gpt-5.4-pro": {
17273
- id: "openai/gpt-5.4-pro",
17274
- name: "GPT 5.4 PRO",
17275
- api: "openai-completions",
17276
- provider: "prime-inference",
17277
- baseUrl: "https://api.pinference.ai/api/v1",
17278
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17279
- reasoning: true,
17280
- thinkingLevelMap: { "off": null, "minimal": null, "low": null, "medium": "medium", "high": "high", "xhigh": "xhigh", "max": null },
17281
- input: ["text", "image"],
17282
- cost: {
17283
- input: 30,
17284
- output: 180,
17285
- cacheRead: 0,
17286
- cacheWrite: 0
17287
- },
17288
- contextWindow: 105e4,
17289
- maxTokens: 128e3,
17290
- featured: true
17291
- },
17292
- "openai/gpt-5.5": {
17293
- id: "openai/gpt-5.5",
17294
- name: "GPT 5.5",
17295
- api: "openai-completions",
17296
- provider: "prime-inference",
17297
- baseUrl: "https://api.pinference.ai/api/v1",
17298
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17299
- reasoning: true,
17300
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": null },
17301
- input: ["text", "image"],
17302
- cost: {
17303
- input: 5,
17304
- output: 30,
17305
- cacheRead: 0,
17306
- cacheWrite: 0
17307
- },
17308
- contextWindow: 105e4,
17309
- maxTokens: 128e3,
17310
- featured: true
17311
- },
17312
- "openai/gpt-5.6": {
17313
- id: "openai/gpt-5.6",
17314
- name: "GPT 5.6",
17315
- api: "openai-completions",
17316
- provider: "prime-inference",
17317
- baseUrl: "https://api.pinference.ai/api/v1",
17318
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17319
- reasoning: true,
17320
- thinkingLevelMap: { "xhigh": "xhigh", "minimal": null, "max": "max" },
17321
- input: ["text"],
17322
- cost: {
17323
- input: 5,
17324
- output: 30,
17325
- cacheRead: 0,
17326
- cacheWrite: 0
17327
- },
17328
- contextWindow: 128e3,
17329
- maxTokens: 8192
17330
- },
17331
- "openai/gpt-5.6-luna": {
17332
- id: "openai/gpt-5.6-luna",
17333
- name: "GPT 5.6 Luna",
17334
- api: "openai-completions",
17335
- provider: "prime-inference",
17336
- baseUrl: "https://api.pinference.ai/api/v1",
17337
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17338
- reasoning: true,
17339
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
17340
- input: ["text", "image"],
17341
- cost: {
17342
- input: 0.2,
17343
- output: 1.2,
17344
- cacheRead: 0,
17345
- cacheWrite: 0
17346
- },
17347
- contextWindow: 105e4,
17348
- maxTokens: 128e3
17349
- },
17350
- "openai/gpt-5.6-luna-pro": {
17351
- id: "openai/gpt-5.6-luna-pro",
17352
- name: "GPT 5.6 Luna PRO",
17353
- api: "openai-completions",
17354
- provider: "prime-inference",
17355
- baseUrl: "https://api.pinference.ai/api/v1",
17356
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17357
- reasoning: true,
17358
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
17359
- input: ["text", "image"],
17360
- cost: {
17361
- input: 1,
17362
- output: 6,
17363
- cacheRead: 0,
17364
- cacheWrite: 0
17365
- },
17366
- contextWindow: 105e4,
17367
- maxTokens: 128e3
17368
- },
17369
- "openai/gpt-5.6-sol": {
17370
- id: "openai/gpt-5.6-sol",
17371
- name: "GPT 5.6 SOL",
17372
- api: "openai-completions",
17373
- provider: "prime-inference",
17374
- baseUrl: "https://api.pinference.ai/api/v1",
17375
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17376
- reasoning: true,
17377
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
17378
- input: ["text", "image"],
17379
- cost: {
17380
- input: 5,
17381
- output: 30,
17382
- cacheRead: 0,
17383
- cacheWrite: 0
17384
- },
17385
- contextWindow: 105e4,
17386
- maxTokens: 128e3
17387
- },
17388
- "openai/gpt-5.6-sol-pro": {
17389
- id: "openai/gpt-5.6-sol-pro",
17390
- name: "GPT 5.6 SOL PRO",
17391
- api: "openai-completions",
17392
- provider: "prime-inference",
17393
- baseUrl: "https://api.pinference.ai/api/v1",
17394
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17395
- reasoning: true,
17396
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
17397
- input: ["text", "image"],
17398
- cost: {
17399
- input: 5,
17400
- output: 30,
17401
- cacheRead: 0,
17402
- cacheWrite: 0
17403
- },
17404
- contextWindow: 105e4,
17405
- maxTokens: 128e3
17406
- },
17407
- "openai/gpt-5.6-terra": {
17408
- id: "openai/gpt-5.6-terra",
17409
- name: "GPT 5.6 Terra",
17410
- api: "openai-completions",
17411
- provider: "prime-inference",
17412
- baseUrl: "https://api.pinference.ai/api/v1",
17413
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17414
- reasoning: true,
17415
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
17416
- input: ["text", "image"],
17417
- cost: {
17418
- input: 2.5,
17419
- output: 15,
17420
- cacheRead: 0,
17421
- cacheWrite: 0
17422
- },
17423
- contextWindow: 105e4,
17424
- maxTokens: 128e3
17425
- },
17426
- "openai/gpt-5.6-terra-pro": {
17427
- id: "openai/gpt-5.6-terra-pro",
17428
- name: "GPT 5.6 Terra PRO",
17429
- api: "openai-completions",
17430
- provider: "prime-inference",
17431
- baseUrl: "https://api.pinference.ai/api/v1",
17432
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17433
- reasoning: true,
17434
- thinkingLevelMap: { "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
17435
- input: ["text", "image"],
17436
- cost: {
17437
- input: 2.5,
17438
- output: 15,
17439
- cacheRead: 0,
17440
- cacheWrite: 0
17441
- },
17442
- contextWindow: 105e4,
17443
- maxTokens: 128e3
17444
- },
17445
- "openai/gpt-6-astra": {
17446
- id: "openai/gpt-6-astra",
17447
- name: "GPT 6 Astra",
17448
- api: "openai-completions",
17449
- provider: "prime-inference",
17450
- baseUrl: "https://api.pinference.ai/api/v1",
17451
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17452
- reasoning: true,
17453
- thinkingLevelMap: { "off": null, "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": "max" },
17454
- input: ["text", "image"],
17455
- cost: {
17456
- input: 10,
17457
- output: 50,
17458
- cacheRead: 0,
17459
- cacheWrite: 0
17460
- },
17461
- contextWindow: 105e4,
17462
- maxTokens: 128e3
17463
- },
17464
- "openai/gpt-oss-120b": {
17465
- id: "openai/gpt-oss-120b",
17466
- name: "GPT OSS 120B",
17467
- api: "openai-completions",
17468
- provider: "prime-inference",
17469
- baseUrl: "https://api.pinference.ai/api/v1",
17470
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17471
- reasoning: true,
17472
- thinkingLevelMap: { "off": null, "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": null },
17473
- input: ["text"],
17474
- cost: {
17475
- input: 0.35,
17476
- output: 0.75,
17477
- cacheRead: 0,
17478
- cacheWrite: 0
17479
- },
17480
- contextWindow: 131072,
17481
- maxTokens: 117964
17482
- },
17483
- "openai/gpt-oss-20b": {
17484
- id: "openai/gpt-oss-20b",
17485
- name: "GPT OSS 20B",
17486
- api: "openai-completions",
17487
- provider: "prime-inference",
17488
- baseUrl: "https://api.pinference.ai/api/v1",
17489
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17490
- reasoning: true,
17491
- thinkingLevelMap: { "off": null, "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": null, "max": null },
17492
- input: ["text"],
17493
- cost: {
17494
- input: 0.07,
17495
- output: 0.3,
17496
- cacheRead: 0,
17497
- cacheWrite: 0
17498
- },
17499
- contextWindow: 131072,
17500
- maxTokens: 131072
17501
- },
17502
- "poolside/laguna-s-2.1": {
17503
- id: "poolside/laguna-s-2.1",
17504
- name: "Laguna S 2.1",
17505
- api: "openai-completions",
17506
- provider: "prime-inference",
17507
- baseUrl: "https://api.pinference.ai/api/v1",
17508
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
17509
- reasoning: true,
17510
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17511
- input: ["text"],
17512
- cost: {
17513
- input: 0.09,
17514
- output: 0.18,
17515
- cacheRead: 0,
17516
- cacheWrite: 0
17517
- },
17518
- contextWindow: 1048576,
17519
- maxTokens: 131072
17520
- },
17521
- "poolside/laguna-xs-2.1": {
17522
- id: "poolside/laguna-xs-2.1",
17523
- name: "Laguna XS 2.1",
17524
- api: "openai-completions",
17525
- provider: "prime-inference",
17526
- baseUrl: "https://api.pinference.ai/api/v1",
17527
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
17528
- reasoning: true,
17529
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17530
- input: ["text"],
17531
- cost: {
17532
- input: 0.06,
17533
- output: 0.12,
17534
- cacheRead: 0,
17535
- cacheWrite: 0
17536
- },
17537
- contextWindow: 262144,
17538
- maxTokens: 32768
17539
- },
17540
- "qwen/qwen3-235b-a22b-2507": {
17541
- id: "qwen/qwen3-235b-a22b-2507",
17542
- name: "QWEN3 235B A22B 2507",
17543
- api: "openai-completions",
17544
- provider: "prime-inference",
17545
- baseUrl: "https://api.pinference.ai/api/v1",
17546
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17547
- reasoning: false,
17548
- input: ["text"],
17549
- cost: {
17550
- input: 0.25,
17551
- output: 1,
17552
- cacheRead: 0,
17553
- cacheWrite: 0
17554
- },
17555
- contextWindow: 262144,
17556
- maxTokens: 16384
17557
- },
17558
- "qwen/qwen3-30b-a3b-instruct-2507": {
17559
- id: "qwen/qwen3-30b-a3b-instruct-2507",
17560
- name: "QWEN3 30B A3B Instruct 2507",
17561
- api: "openai-completions",
17562
- provider: "prime-inference",
17563
- baseUrl: "https://api.pinference.ai/api/v1",
17564
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17565
- reasoning: false,
17566
- input: ["text"],
17567
- cost: {
17568
- input: 0.13,
17569
- output: 0.52,
17570
- cacheRead: 0,
17571
- cacheWrite: 0
17572
- },
17573
- contextWindow: 262144,
17574
- maxTokens: 32e3,
17575
- featured: true
17576
- },
17577
- "qwen/qwen3-8b": {
17578
- id: "qwen/qwen3-8b",
17579
- name: "QWEN3 8B",
17580
- api: "openai-completions",
17581
- provider: "prime-inference",
17582
- baseUrl: "https://api.pinference.ai/api/v1",
17583
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
17584
- reasoning: true,
17585
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17586
- input: ["text"],
17587
- cost: {
17588
- input: 0.117,
17589
- output: 0.455,
17590
- cacheRead: 0,
17591
- cacheWrite: 0
17592
- },
17593
- contextWindow: 131072,
17594
- maxTokens: 8192
17595
- },
17596
- "qwen/qwen3-coder": {
17597
- id: "qwen/qwen3-coder",
17598
- name: "QWEN3 Coder",
17599
- api: "openai-completions",
17600
- provider: "prime-inference",
17601
- baseUrl: "https://api.pinference.ai/api/v1",
17602
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17603
- reasoning: false,
17604
- input: ["text"],
17605
- cost: {
17606
- input: 0.975,
17607
- output: 4.875,
17608
- cacheRead: 0,
17609
- cacheWrite: 0
17610
- },
17611
- contextWindow: 262144,
17612
- maxTokens: 65536
17613
- },
17614
- "qwen/qwen3-coder-next": {
17615
- id: "qwen/qwen3-coder-next",
17616
- name: "QWEN3 Coder Next",
17617
- api: "openai-completions",
17618
- provider: "prime-inference",
17619
- baseUrl: "https://api.pinference.ai/api/v1",
17620
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17621
- reasoning: false,
17622
- input: ["text"],
17623
- cost: {
17624
- input: 0.3,
17625
- output: 1.5,
17626
- cacheRead: 0,
17627
- cacheWrite: 0
17628
- },
17629
- contextWindow: 262144,
17630
- maxTokens: 235929,
17631
- featured: true
17632
- },
17633
- "qwen/qwen3-max": {
17634
- id: "qwen/qwen3-max",
17635
- name: "QWEN3 MAX",
17636
- api: "openai-completions",
17637
- provider: "prime-inference",
17638
- baseUrl: "https://api.pinference.ai/api/v1",
17639
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17640
- reasoning: false,
17641
- input: ["text"],
17642
- cost: {
17643
- input: 1.2,
17644
- output: 6,
17645
- cacheRead: 0,
17646
- cacheWrite: 0
17647
- },
17648
- contextWindow: 262144,
17649
- maxTokens: 65536,
17650
- featured: true
17651
- },
17652
- "qwen/qwen3-vl-235b-a22b-instruct": {
17653
- id: "qwen/qwen3-vl-235b-a22b-instruct",
17654
- name: "QWEN3 VL 235B A22B Instruct",
17655
- api: "openai-completions",
17656
- provider: "prime-inference",
17657
- baseUrl: "https://api.pinference.ai/api/v1",
17658
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17659
- reasoning: false,
17660
- input: ["text", "image"],
17661
- cost: {
17662
- input: 0.3,
17663
- output: 1.5,
17664
- cacheRead: 0,
17665
- cacheWrite: 0
17666
- },
17667
- contextWindow: 262144,
17668
- maxTokens: 32768
17669
- },
17670
- "qwen/qwen3-vl-235b-a22b-thinking": {
17671
- id: "qwen/qwen3-vl-235b-a22b-thinking",
17672
- name: "QWEN3 VL 235B A22B Thinking",
17673
- api: "openai-completions",
17674
- provider: "prime-inference",
17675
- baseUrl: "https://api.pinference.ai/api/v1",
17676
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
17677
- reasoning: true,
17678
- thinkingLevelMap: { "off": null, "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17679
- input: ["text", "image"],
17680
- cost: {
17681
- input: 0.98,
17682
- output: 4,
17683
- cacheRead: 0,
17684
- cacheWrite: 0
17685
- },
17686
- contextWindow: 131072,
17687
- maxTokens: 32768,
17688
- featured: true
17689
- },
17690
- "qwen/qwen3-vl-30b-a3b-instruct": {
17691
- id: "qwen/qwen3-vl-30b-a3b-instruct",
17692
- name: "QWEN3 VL 30B A3B Instruct",
17693
- api: "openai-completions",
17694
- provider: "prime-inference",
17695
- baseUrl: "https://api.pinference.ai/api/v1",
17696
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17697
- reasoning: false,
17698
- input: ["text", "image"],
17699
- cost: {
17700
- input: 0.2,
17701
- output: 0.7,
17702
- cacheRead: 0,
17703
- cacheWrite: 0
17704
- },
17705
- contextWindow: 262144,
17706
- maxTokens: 16384
17707
- },
17708
- "qwen/qwen3-vl-8b-instruct": {
17709
- id: "qwen/qwen3-vl-8b-instruct",
17710
- name: "QWEN3 VL 8B Instruct",
17711
- api: "openai-completions",
17712
- provider: "prime-inference",
17713
- baseUrl: "https://api.pinference.ai/api/v1",
17714
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17715
- reasoning: false,
17716
- input: ["text", "image"],
17717
- cost: {
17718
- input: 0.117,
17719
- output: 0.455,
17720
- cacheRead: 0,
17721
- cacheWrite: 0
17722
- },
17723
- contextWindow: 262144,
17724
- maxTokens: 32768
17725
- },
17726
- "qwen/qwen3.5-35b-a3b": {
17727
- id: "qwen/qwen3.5-35b-a3b",
17728
- name: "QWEN3.5 35B A3B",
17729
- api: "openai-completions",
17730
- provider: "prime-inference",
17731
- baseUrl: "https://api.pinference.ai/api/v1",
17732
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
17733
- reasoning: true,
17734
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17735
- input: ["text", "image"],
17736
- cost: {
17737
- input: 0.25,
17738
- output: 1.3,
17739
- cacheRead: 0,
17740
- cacheWrite: 0
17741
- },
17742
- contextWindow: 262144,
17743
- maxTokens: 16384
17744
- },
17745
- "qwen/qwen3.5-397b-a17b": {
17746
- id: "qwen/qwen3.5-397b-a17b",
17747
- name: "QWEN3.5 397B A17B",
17748
- api: "openai-completions",
17749
- provider: "prime-inference",
17750
- baseUrl: "https://api.pinference.ai/api/v1",
17751
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
17752
- reasoning: true,
17753
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17754
- input: ["text", "image"],
17755
- cost: {
17756
- input: 0.6,
17757
- output: 3.6,
17758
- cacheRead: 0,
17759
- cacheWrite: 0
17760
- },
17761
- contextWindow: 262144,
17762
- maxTokens: 65536
17763
- },
17764
- "qwen/qwen3.6-27b": {
17765
- id: "qwen/qwen3.6-27b",
17766
- name: "QWEN3.6 27B",
17767
- api: "openai-completions",
17768
- provider: "prime-inference",
17769
- baseUrl: "https://api.pinference.ai/api/v1",
17770
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
17771
- reasoning: true,
17772
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17773
- input: ["text", "image"],
17774
- cost: {
17775
- input: 0.6,
17776
- output: 3.6,
17777
- cacheRead: 0,
17778
- cacheWrite: 0
17779
- },
17780
- contextWindow: 262144,
17781
- maxTokens: 65536
17782
- },
17783
- "qwen/qwen3.6-35b-a3b": {
17784
- id: "qwen/qwen3.6-35b-a3b",
17785
- name: "QWEN3.6 35B A3B",
17786
- api: "openai-completions",
17787
- provider: "prime-inference",
17788
- baseUrl: "https://api.pinference.ai/api/v1",
17789
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
17790
- reasoning: true,
17791
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17792
- input: ["text", "image"],
17793
- cost: {
17794
- input: 0.25,
17795
- output: 1.25,
17796
- cacheRead: 0,
17797
- cacheWrite: 0
17798
- },
17799
- contextWindow: 262144,
17800
- maxTokens: 235929
17801
- },
17802
- "qwen/qwen3.7-flash": {
17803
- id: "qwen/qwen3.7-flash",
17804
- name: "QWEN3.7 Flash",
17805
- api: "openai-completions",
17806
- provider: "prime-inference",
17807
- baseUrl: "https://api.pinference.ai/api/v1",
17808
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
17809
- reasoning: true,
17810
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17811
- input: ["text", "image"],
17812
- cost: {
17813
- input: 0.03,
17814
- output: 0.13,
17815
- cacheRead: 0,
17816
- cacheWrite: 0
17817
- },
17818
- contextWindow: 1e6,
17819
- maxTokens: 65536
17820
- },
17821
- "qwen/qwen3.8-max": {
17822
- id: "qwen/qwen3.8-max",
17823
- name: "QWEN3.8 MAX",
17824
- api: "openai-completions",
17825
- provider: "prime-inference",
17826
- baseUrl: "https://api.pinference.ai/api/v1",
17827
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17828
- reasoning: true,
17829
- thinkingLevelMap: { "off": null, "minimal": "minimal", "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": null },
17830
- input: ["text", "image"],
17831
- cost: {
17832
- input: 2,
17833
- output: 6,
17834
- cacheRead: 0,
17835
- cacheWrite: 0
17836
- },
17837
- contextWindow: 1e6,
17838
- maxTokens: 131072,
17839
- featured: true
17840
- },
17841
- "x-ai/grok-4.20": {
17842
- id: "x-ai/grok-4.20",
17843
- name: "Grok 4.20",
17844
- api: "openai-completions",
17845
- provider: "prime-inference",
17846
- baseUrl: "https://api.pinference.ai/api/v1",
17847
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
17848
- reasoning: true,
17849
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17850
- input: ["text", "image"],
17851
- cost: {
17852
- input: 2,
17853
- output: 6,
17854
- cacheRead: 0,
17855
- cacheWrite: 0
17856
- },
17857
- contextWindow: 2e6,
17858
- maxTokens: 3e4,
17859
- featured: true
17860
- },
17861
- "x-ai/grok-4.20-multi-agent": {
17862
- id: "x-ai/grok-4.20-multi-agent",
17863
- name: "Grok 4.20 Multi Agent",
17864
- api: "openai-completions",
17865
- provider: "prime-inference",
17866
- baseUrl: "https://api.pinference.ai/api/v1",
17867
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17868
- reasoning: true,
17869
- thinkingLevelMap: { "off": null, "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": null },
17870
- input: ["text", "image"],
17871
- cost: {
17872
- input: 2,
17873
- output: 6,
17874
- cacheRead: 0,
17875
- cacheWrite: 0
17876
- },
17877
- contextWindow: 2e6,
17878
- maxTokens: 3e4,
17879
- featured: true
17880
- },
17881
- "x-ai/grok-4.6": {
17882
- id: "x-ai/grok-4.6",
17883
- name: "Grok 4.6",
17884
- api: "openai-completions",
17885
- provider: "prime-inference",
17886
- baseUrl: "https://api.pinference.ai/api/v1",
17887
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false },
17888
- reasoning: true,
17889
- thinkingLevelMap: { "off": null, "minimal": null, "low": "low", "medium": "medium", "high": "high", "xhigh": "xhigh", "max": null },
17890
- input: ["text", "image"],
17891
- cost: {
17892
- input: 2,
17893
- output: 6,
17894
- cacheRead: 0,
17895
- cacheWrite: 0
17896
- },
17897
- contextWindow: 5e5,
17898
- maxTokens: 45e4
17899
- },
17900
- "xiaomi/mimo-v2.5": {
17901
- id: "xiaomi/mimo-v2.5",
17902
- name: "Mimo V2.5",
17903
- api: "openai-completions",
17904
- provider: "prime-inference",
17905
- baseUrl: "https://api.pinference.ai/api/v1",
17906
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
17907
- reasoning: true,
17908
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17909
- input: ["text", "image"],
17910
- cost: {
17911
- input: 0.168,
17912
- output: 0.336,
17913
- cacheRead: 0,
17914
- cacheWrite: 0
17915
- },
17916
- contextWindow: 105e4,
17917
- maxTokens: 131072
17918
- },
17919
- "xiaomi/mimo-v2.5-pro": {
17920
- id: "xiaomi/mimo-v2.5-pro",
17921
- name: "Mimo V2.5 PRO",
17922
- api: "openai-completions",
17923
- provider: "prime-inference",
17924
- baseUrl: "https://api.pinference.ai/api/v1",
17925
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "openrouter" },
17926
- reasoning: true,
17927
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17928
- input: ["text"],
17929
- cost: {
17930
- input: 0.48024,
17931
- output: 1.5,
17932
- cacheRead: 0,
17933
- cacheWrite: 0
17934
- },
17935
- contextWindow: 105e4,
17936
- maxTokens: 131072
17937
- },
17938
- "z-ai/glm-4.5": {
17939
- id: "z-ai/glm-4.5",
17940
- name: "GLM 4.5",
17941
- api: "openai-completions",
17942
- provider: "prime-inference",
17943
- baseUrl: "https://api.pinference.ai/api/v1",
17944
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "zai" },
17945
- reasoning: true,
17946
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17947
- input: ["text"],
17948
- cost: {
17949
- input: 0.6,
17950
- output: 2.2,
17951
- cacheRead: 0,
17952
- cacheWrite: 0
17953
- },
17954
- contextWindow: 131072,
17955
- maxTokens: 98304
17956
- },
17957
- "z-ai/glm-4.5-air": {
17958
- id: "z-ai/glm-4.5-air",
17959
- name: "GLM 4.5 AIR",
17960
- api: "openai-completions",
17961
- provider: "prime-inference",
17962
- baseUrl: "https://api.pinference.ai/api/v1",
17963
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "zai" },
17964
- reasoning: true,
17965
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17966
- input: ["text"],
17967
- cost: {
17968
- input: 0.2,
17969
- output: 1.1,
17970
- cacheRead: 0,
17971
- cacheWrite: 0
17972
- },
17973
- contextWindow: 131072,
17974
- maxTokens: 98304
17975
- },
17976
- "z-ai/glm-4.6": {
17977
- id: "z-ai/glm-4.6",
17978
- name: "GLM 4.6",
17979
- api: "openai-completions",
17980
- provider: "prime-inference",
17981
- baseUrl: "https://api.pinference.ai/api/v1",
17982
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "zai" },
17983
- reasoning: true,
17984
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
17985
- input: ["text"],
17986
- cost: {
17987
- input: 0.6,
17988
- output: 2.2,
17989
- cacheRead: 0,
17990
- cacheWrite: 0
17991
- },
17992
- contextWindow: 204800,
17993
- maxTokens: 131072
17994
- },
17995
- "z-ai/glm-4.7": {
17996
- id: "z-ai/glm-4.7",
17997
- name: "GLM 4.7",
17998
- api: "openai-completions",
17999
- provider: "prime-inference",
18000
- baseUrl: "https://api.pinference.ai/api/v1",
18001
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "zai" },
18002
- reasoning: true,
18003
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
18004
- input: ["text"],
18005
- cost: {
18006
- input: 0.6,
18007
- output: 2.2,
18008
- cacheRead: 0,
18009
- cacheWrite: 0
18010
- },
18011
- contextWindow: 204800,
18012
- maxTokens: 131072
18013
- },
18014
- "z-ai/glm-4.7-flash": {
18015
- id: "z-ai/glm-4.7-flash",
18016
- name: "GLM 4.7 Flash",
18017
- api: "openai-completions",
18018
- provider: "prime-inference",
18019
- baseUrl: "https://api.pinference.ai/api/v1",
18020
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "zai" },
18021
- reasoning: true,
18022
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
18023
- input: ["text"],
18024
- cost: {
18025
- input: 0.07,
18026
- output: 0.4,
18027
- cacheRead: 0,
18028
- cacheWrite: 0
18029
- },
18030
- contextWindow: 202752,
18031
- maxTokens: 16384
18032
- },
18033
- "z-ai/glm-5": {
18034
- id: "z-ai/glm-5",
18035
- name: "GLM 5",
18036
- api: "openai-completions",
18037
- provider: "prime-inference",
18038
- baseUrl: "https://api.pinference.ai/api/v1",
18039
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "zai" },
18040
- reasoning: true,
18041
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
18042
- input: ["text"],
18043
- cost: {
18044
- input: 1,
18045
- output: 3.2,
18046
- cacheRead: 0,
18047
- cacheWrite: 0
18048
- },
18049
- contextWindow: 204800,
18050
- maxTokens: 131072,
18051
- featured: true
18052
- },
18053
- "z-ai/glm-5.1": {
18054
- id: "z-ai/glm-5.1",
18055
- name: "GLM 5.1",
18056
- api: "openai-completions",
18057
- provider: "prime-inference",
18058
- baseUrl: "https://api.pinference.ai/api/v1",
18059
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "zai" },
18060
- reasoning: true,
18061
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null, "max": null },
18062
- input: ["text"],
18063
- cost: {
18064
- input: 1.4,
18065
- output: 4.4,
18066
- cacheRead: 0,
18067
- cacheWrite: 0
18068
- },
18069
- contextWindow: 204800,
18070
- maxTokens: 128e3,
18071
- featured: true
18072
- },
18073
- "z-ai/glm-5.2": {
18074
- id: "z-ai/glm-5.2",
18075
- name: "GLM 5.2",
18076
- api: "openai-completions",
18077
- provider: "prime-inference",
18078
- baseUrl: "https://api.pinference.ai/api/v1",
18079
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "zai" },
18080
- reasoning: true,
18081
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": "xhigh", "max": null },
18082
- input: ["text"],
18083
- cost: {
18084
- input: 1.54,
18085
- output: 4.84,
18086
- cacheRead: 0,
18087
- cacheWrite: 0
18088
- },
18089
- contextWindow: 1048576,
18090
- maxTokens: 131072,
18091
- featured: true
18092
- },
18093
- "z-ai/glm-5.3": {
18094
- id: "z-ai/glm-5.3",
18095
- name: "GLM 5.3",
18096
- api: "openai-completions",
18097
- provider: "prime-inference",
18098
- baseUrl: "https://api.pinference.ai/api/v1",
18099
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "zai" },
18100
- reasoning: true,
18101
- thinkingLevelMap: { "off": null, "minimal": null, "low": "low", "medium": null, "high": "high", "xhigh": null, "max": "max" },
18102
- input: ["text"],
18103
- cost: {
18104
- input: 1.4,
18105
- output: 4.4,
18106
- cacheRead: 0,
18107
- cacheWrite: 0
18108
- },
18109
- contextWindow: 1310720,
18110
- maxTokens: 262144
18111
- },
18112
- "z-ai/glm-5.3-flash": {
18113
- id: "z-ai/glm-5.3-flash",
18114
- name: "GLM 5.3 Flash",
18115
- api: "openai-completions",
18116
- provider: "prime-inference",
18117
- baseUrl: "https://api.pinference.ai/api/v1",
18118
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "thinkingFormat": "zai" },
18119
- reasoning: true,
18120
- thinkingLevelMap: { "off": null, "minimal": null, "low": "low", "medium": null, "high": "high", "xhigh": null, "max": "max" },
18121
- input: ["text", "image"],
18122
- cost: {
18123
- input: 0.15,
18124
- output: 0.5,
18125
- cacheRead: 0,
18126
- cacheWrite: 0
18127
- },
18128
- contextWindow: 1310720,
18129
- maxTokens: 131072
18130
- }
18131
- },
18132
16033
  "vercel-ai-gateway": {
18133
16034
  "alibaba/qwen-3-14b": {
18134
16035
  id: "alibaba/qwen-3-14b",