@code-yeongyu/senpi 2026.6.10 → 2026.6.12-2

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (197) hide show
  1. package/CHANGELOG.md +28 -1
  2. package/README.md +18 -18
  3. package/dist/cli/startup-ui.d.ts +10 -0
  4. package/dist/cli/startup-ui.d.ts.map +1 -1
  5. package/dist/cli/startup-ui.js +72 -1
  6. package/dist/cli/startup-ui.js.map +1 -1
  7. package/dist/core/bash-executor.d.ts.map +1 -1
  8. package/dist/core/bash-executor.js +31 -7
  9. package/dist/core/bash-executor.js.map +1 -1
  10. package/dist/core/extensions/builtin/compaction/degradation-monitor.d.ts +0 -1
  11. package/dist/core/extensions/builtin/compaction/degradation-monitor.d.ts.map +1 -1
  12. package/dist/core/extensions/builtin/compaction/degradation-monitor.js +0 -1
  13. package/dist/core/extensions/builtin/compaction/degradation-monitor.js.map +1 -1
  14. package/dist/core/extensions/builtin/compaction/index.d.ts.map +1 -1
  15. package/dist/core/extensions/builtin/compaction/index.js +4 -4
  16. package/dist/core/extensions/builtin/compaction/index.js.map +1 -1
  17. package/dist/core/extensions/builtin/compaction/policy.d.ts +0 -5
  18. package/dist/core/extensions/builtin/compaction/policy.d.ts.map +1 -1
  19. package/dist/core/extensions/builtin/compaction/policy.js +0 -4
  20. package/dist/core/extensions/builtin/compaction/policy.js.map +1 -1
  21. package/dist/core/extensions/builtin/compaction/speculative.d.ts +0 -6
  22. package/dist/core/extensions/builtin/compaction/speculative.d.ts.map +1 -1
  23. package/dist/core/extensions/builtin/compaction/speculative.js +0 -3
  24. package/dist/core/extensions/builtin/compaction/speculative.js.map +1 -1
  25. package/dist/core/extensions/builtin/gpt-apply-patch/extension.d.ts +1 -1
  26. package/dist/core/extensions/builtin/gpt-apply-patch/extension.d.ts.map +1 -1
  27. package/dist/core/extensions/builtin/gpt-apply-patch/extension.js +10 -2
  28. package/dist/core/extensions/builtin/gpt-apply-patch/extension.js.map +1 -1
  29. package/dist/core/extensions/builtin/permission-system/cli.d.ts +0 -3
  30. package/dist/core/extensions/builtin/permission-system/cli.d.ts.map +1 -1
  31. package/dist/core/extensions/builtin/permission-system/cli.js +0 -13
  32. package/dist/core/extensions/builtin/permission-system/cli.js.map +1 -1
  33. package/dist/core/extensions/types.d.ts +1 -0
  34. package/dist/core/extensions/types.d.ts.map +1 -1
  35. package/dist/core/extensions/types.js.map +1 -1
  36. package/dist/core/model-registry.d.ts +0 -3
  37. package/dist/core/model-registry.d.ts.map +1 -1
  38. package/dist/core/model-registry.js +1 -3
  39. package/dist/core/model-registry.js.map +1 -1
  40. package/dist/core/model-resolver.d.ts +1 -0
  41. package/dist/core/model-resolver.d.ts.map +1 -1
  42. package/dist/core/model-resolver.js +20 -5
  43. package/dist/core/model-resolver.js.map +1 -1
  44. package/dist/core/resolve-config-value.d.ts +0 -4
  45. package/dist/core/resolve-config-value.d.ts.map +1 -1
  46. package/dist/core/resolve-config-value.js +0 -15
  47. package/dist/core/resolve-config-value.js.map +1 -1
  48. package/dist/core/settings-manager.d.ts +6 -0
  49. package/dist/core/settings-manager.d.ts.map +1 -1
  50. package/dist/core/settings-manager.js +17 -0
  51. package/dist/core/settings-manager.js.map +1 -1
  52. package/dist/core/tools/edit-diff.d.ts +0 -5
  53. package/dist/core/tools/edit-diff.d.ts.map +1 -1
  54. package/dist/core/tools/edit-diff.js +0 -7
  55. package/dist/core/tools/edit-diff.js.map +1 -1
  56. package/dist/core/tools/index.d.ts +0 -5
  57. package/dist/core/tools/index.d.ts.map +1 -1
  58. package/dist/core/tools/index.js +0 -67
  59. package/dist/core/tools/index.js.map +1 -1
  60. package/dist/core/tools/output-accumulator.d.ts +3 -5
  61. package/dist/core/tools/output-accumulator.d.ts.map +1 -1
  62. package/dist/core/tools/output-accumulator.js +38 -34
  63. package/dist/core/tools/output-accumulator.js.map +1 -1
  64. package/dist/core/tools/tail-window.d.ts +15 -0
  65. package/dist/core/tools/tail-window.d.ts.map +1 -0
  66. package/dist/core/tools/tail-window.js +75 -0
  67. package/dist/core/tools/tail-window.js.map +1 -0
  68. package/dist/main.d.ts.map +1 -1
  69. package/dist/main.js +8 -1
  70. package/dist/main.js.map +1 -1
  71. package/dist/modes/interactive/components/first-time-setup.d.ts +25 -0
  72. package/dist/modes/interactive/components/first-time-setup.d.ts.map +1 -0
  73. package/dist/modes/interactive/components/first-time-setup.js +101 -0
  74. package/dist/modes/interactive/components/first-time-setup.js.map +1 -0
  75. package/dist/modes/interactive/components/index.d.ts +1 -0
  76. package/dist/modes/interactive/components/index.d.ts.map +1 -1
  77. package/dist/modes/interactive/components/index.js +1 -0
  78. package/dist/modes/interactive/components/index.js.map +1 -1
  79. package/dist/modes/interactive/components/tool-execution.d.ts +6 -0
  80. package/dist/modes/interactive/components/tool-execution.d.ts.map +1 -1
  81. package/dist/modes/interactive/components/tool-execution.js +45 -0
  82. package/dist/modes/interactive/components/tool-execution.js.map +1 -1
  83. package/dist/modes/interactive/interactive-mode.d.ts +1 -0
  84. package/dist/modes/interactive/interactive-mode.d.ts.map +1 -1
  85. package/dist/modes/interactive/interactive-mode.js +12 -5
  86. package/dist/modes/interactive/interactive-mode.js.map +1 -1
  87. package/dist/modes/interactive/theme/theme.d.ts +0 -4
  88. package/dist/modes/interactive/theme/theme.d.ts.map +1 -1
  89. package/dist/modes/interactive/theme/theme.js +0 -7
  90. package/dist/modes/interactive/theme/theme.js.map +1 -1
  91. package/dist/modes/rpc/rpc-types.d.ts +0 -1
  92. package/dist/modes/rpc/rpc-types.d.ts.map +1 -1
  93. package/dist/modes/rpc/rpc-types.js.map +1 -1
  94. package/docs/compaction-guide.md +9 -9
  95. package/docs/compaction.md +2 -2
  96. package/docs/containerization.md +22 -22
  97. package/docs/custom-provider.md +13 -13
  98. package/docs/development.md +4 -2
  99. package/docs/extensions.md +18 -19
  100. package/docs/index.md +4 -4
  101. package/docs/json.md +21 -15
  102. package/docs/keybindings.md +6 -3
  103. package/docs/models.md +6 -6
  104. package/docs/packages.md +11 -11
  105. package/docs/prompt-templates.md +2 -2
  106. package/docs/providers.md +9 -9
  107. package/docs/rpc.md +14 -13
  108. package/docs/sdk.md +13 -9
  109. package/docs/security.md +7 -7
  110. package/docs/session-format.md +4 -4
  111. package/docs/sessions.md +14 -14
  112. package/docs/settings.md +13 -11
  113. package/docs/skills.md +8 -8
  114. package/docs/terminal-setup.md +2 -2
  115. package/docs/termux.md +3 -3
  116. package/docs/tui.md +4 -4
  117. package/docs/usage.md +51 -58
  118. package/node_modules/@earendil-works/pi-agent-core/README.md +4 -3
  119. package/node_modules/@earendil-works/pi-agent-core/dist/harness/types.d.ts +0 -2
  120. package/node_modules/@earendil-works/pi-agent-core/dist/harness/types.d.ts.map +1 -1
  121. package/node_modules/@earendil-works/pi-agent-core/dist/harness/types.js +0 -4
  122. package/node_modules/@earendil-works/pi-agent-core/dist/harness/types.js.map +1 -1
  123. package/node_modules/@earendil-works/pi-agent-core/dist/types.d.ts +1 -1
  124. package/node_modules/@earendil-works/pi-agent-core/dist/types.js.map +1 -1
  125. package/node_modules/@earendil-works/pi-agent-core/package.json +2 -2
  126. package/node_modules/@earendil-works/pi-ai/README.md +2 -4
  127. package/node_modules/@earendil-works/pi-ai/dist/api-registry.d.ts +0 -1
  128. package/node_modules/@earendil-works/pi-ai/dist/api-registry.d.ts.map +1 -1
  129. package/node_modules/@earendil-works/pi-ai/dist/api-registry.js +0 -3
  130. package/node_modules/@earendil-works/pi-ai/dist/api-registry.js.map +1 -1
  131. package/node_modules/@earendil-works/pi-ai/dist/models.d.ts.map +1 -1
  132. package/node_modules/@earendil-works/pi-ai/dist/models.generated.d.ts +104 -454
  133. package/node_modules/@earendil-works/pi-ai/dist/models.generated.d.ts.map +1 -1
  134. package/node_modules/@earendil-works/pi-ai/dist/models.generated.js +162 -475
  135. package/node_modules/@earendil-works/pi-ai/dist/models.generated.js.map +1 -1
  136. package/node_modules/@earendil-works/pi-ai/dist/models.js +12 -5
  137. package/node_modules/@earendil-works/pi-ai/dist/models.js.map +1 -1
  138. package/node_modules/@earendil-works/pi-ai/dist/providers/amazon-bedrock.d.ts.map +1 -1
  139. package/node_modules/@earendil-works/pi-ai/dist/providers/amazon-bedrock.js +11 -2
  140. package/node_modules/@earendil-works/pi-ai/dist/providers/amazon-bedrock.js.map +1 -1
  141. package/node_modules/@earendil-works/pi-ai/dist/providers/google-shared.d.ts +0 -4
  142. package/node_modules/@earendil-works/pi-ai/dist/providers/google-shared.d.ts.map +1 -1
  143. package/node_modules/@earendil-works/pi-ai/dist/providers/google-shared.js +0 -13
  144. package/node_modules/@earendil-works/pi-ai/dist/providers/google-shared.js.map +1 -1
  145. package/node_modules/@earendil-works/pi-ai/dist/providers/simple-options.d.ts +0 -6
  146. package/node_modules/@earendil-works/pi-ai/dist/providers/simple-options.d.ts.map +1 -1
  147. package/node_modules/@earendil-works/pi-ai/dist/providers/simple-options.js +0 -14
  148. package/node_modules/@earendil-works/pi-ai/dist/providers/simple-options.js.map +1 -1
  149. package/node_modules/@earendil-works/pi-ai/dist/utils/event-stream.d.ts +4 -1
  150. package/node_modules/@earendil-works/pi-ai/dist/utils/event-stream.d.ts.map +1 -1
  151. package/node_modules/@earendil-works/pi-ai/dist/utils/event-stream.js +54 -8
  152. package/node_modules/@earendil-works/pi-ai/dist/utils/event-stream.js.map +1 -1
  153. package/node_modules/@earendil-works/pi-ai/dist/utils/overflow.d.ts +0 -4
  154. package/node_modules/@earendil-works/pi-ai/dist/utils/overflow.d.ts.map +1 -1
  155. package/node_modules/@earendil-works/pi-ai/dist/utils/overflow.js +0 -6
  156. package/node_modules/@earendil-works/pi-ai/dist/utils/overflow.js.map +1 -1
  157. package/node_modules/@earendil-works/pi-ai/package.json +1 -1
  158. package/node_modules/@earendil-works/pi-tui/README.md +1 -2
  159. package/node_modules/@earendil-works/pi-tui/dist/components/editor.d.ts +2 -0
  160. package/node_modules/@earendil-works/pi-tui/dist/components/editor.d.ts.map +1 -1
  161. package/node_modules/@earendil-works/pi-tui/dist/components/editor.js +80 -7
  162. package/node_modules/@earendil-works/pi-tui/dist/components/editor.js.map +1 -1
  163. package/node_modules/@earendil-works/pi-tui/dist/components/markdown.d.ts +1 -0
  164. package/node_modules/@earendil-works/pi-tui/dist/components/markdown.d.ts.map +1 -1
  165. package/node_modules/@earendil-works/pi-tui/dist/components/markdown.js +72 -1
  166. package/node_modules/@earendil-works/pi-tui/dist/components/markdown.js.map +1 -1
  167. package/node_modules/@earendil-works/pi-tui/dist/index.d.ts +2 -2
  168. package/node_modules/@earendil-works/pi-tui/dist/index.d.ts.map +1 -1
  169. package/node_modules/@earendil-works/pi-tui/dist/index.js +2 -2
  170. package/node_modules/@earendil-works/pi-tui/dist/index.js.map +1 -1
  171. package/node_modules/@earendil-works/pi-tui/dist/terminal-image.d.ts +0 -1
  172. package/node_modules/@earendil-works/pi-tui/dist/terminal-image.d.ts.map +1 -1
  173. package/node_modules/@earendil-works/pi-tui/dist/terminal-image.js +4 -7
  174. package/node_modules/@earendil-works/pi-tui/dist/terminal-image.js.map +1 -1
  175. package/node_modules/@earendil-works/pi-tui/dist/utils.d.ts +1 -4
  176. package/node_modules/@earendil-works/pi-tui/dist/utils.d.ts.map +1 -1
  177. package/node_modules/@earendil-works/pi-tui/dist/utils.js +1 -7
  178. package/node_modules/@earendil-works/pi-tui/dist/utils.js.map +1 -1
  179. package/node_modules/@earendil-works/pi-tui/package.json +1 -1
  180. package/npm-shrinkwrap.json +12 -12
  181. package/package.json +4 -4
  182. package/dist/core/experimental.d.ts +0 -2
  183. package/dist/core/experimental.d.ts.map +0 -1
  184. package/dist/core/experimental.js +0 -4
  185. package/dist/core/experimental.js.map +0 -1
  186. package/dist/core/extensions/builtin/compaction/overflow-detection.d.ts +0 -11
  187. package/dist/core/extensions/builtin/compaction/overflow-detection.d.ts.map +0 -1
  188. package/dist/core/extensions/builtin/compaction/overflow-detection.js +0 -40
  189. package/dist/core/extensions/builtin/compaction/overflow-detection.js.map +0 -1
  190. package/dist/core/extensions/builtin/system-messages.d.ts +0 -47
  191. package/dist/core/extensions/builtin/system-messages.d.ts.map +0 -1
  192. package/dist/core/extensions/builtin/system-messages.js +0 -117
  193. package/dist/core/extensions/builtin/system-messages.js.map +0 -1
  194. package/dist/core/index.d.ts +0 -13
  195. package/dist/core/index.d.ts.map +0 -1
  196. package/dist/core/index.js +0 -13
  197. package/dist/core/index.js.map +0 -1
@@ -2988,30 +2988,13 @@ export const MODELS = {
2988
2988
  reasoning: true,
2989
2989
  input: ["text"],
2990
2990
  cost: {
2991
- input: 0.25,
2992
- output: 0.69,
2991
+ input: 0.35,
2992
+ output: 0.75,
2993
2993
  cacheRead: 0,
2994
2994
  cacheWrite: 0,
2995
2995
  },
2996
2996
  contextWindow: 131072,
2997
- maxTokens: 32768,
2998
- },
2999
- "llama3.1-8b": {
3000
- id: "llama3.1-8b",
3001
- name: "Llama 3.1 8B",
3002
- api: "openai-completions",
3003
- provider: "cerebras",
3004
- baseUrl: "https://api.cerebras.ai/v1",
3005
- reasoning: false,
3006
- input: ["text"],
3007
- cost: {
3008
- input: 0.1,
3009
- output: 0.1,
3010
- cacheRead: 0,
3011
- cacheWrite: 0,
3012
- },
3013
- contextWindow: 32000,
3014
- maxTokens: 8000,
2997
+ maxTokens: 40960,
3015
2998
  },
3016
2999
  "zai-glm-4.7": {
3017
3000
  id: "zai-glm-4.7",
@@ -3019,7 +3002,7 @@ export const MODELS = {
3019
3002
  api: "openai-completions",
3020
3003
  provider: "cerebras",
3021
3004
  baseUrl: "https://api.cerebras.ai/v1",
3022
- reasoning: false,
3005
+ reasoning: true,
3023
3006
  input: ["text"],
3024
3007
  cost: {
3025
3008
  input: 2.25,
@@ -3028,7 +3011,7 @@ export const MODELS = {
3028
3011
  cacheWrite: 0,
3029
3012
  },
3030
3013
  contextWindow: 131072,
3031
- maxTokens: 40000,
3014
+ maxTokens: 40960,
3032
3015
  },
3033
3016
  },
3034
3017
  "cloudflare-ai-gateway": {
@@ -4159,6 +4142,25 @@ export const MODELS = {
4159
4142
  },
4160
4143
  },
4161
4144
  "github-copilot": {
4145
+ "claude-fable-5": {
4146
+ id: "claude-fable-5",
4147
+ name: "Claude Fable 5",
4148
+ api: "openai-completions",
4149
+ provider: "github-copilot",
4150
+ baseUrl: "https://api.individual.githubcopilot.com",
4151
+ headers: { "User-Agent": "GitHubCopilotChat/0.35.0", "Editor-Version": "vscode/1.107.0", "Editor-Plugin-Version": "copilot-chat/0.35.0", "Copilot-Integration-Id": "vscode-chat" },
4152
+ compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false },
4153
+ reasoning: true,
4154
+ input: ["text", "image"],
4155
+ cost: {
4156
+ input: 10,
4157
+ output: 50,
4158
+ cacheRead: 1,
4159
+ cacheWrite: 12.5,
4160
+ },
4161
+ contextWindow: 1000000,
4162
+ maxTokens: 128000,
4163
+ },
4162
4164
  "claude-haiku-4.5": {
4163
4165
  id: "claude-haiku-4.5",
4164
4166
  name: "Claude Haiku 4.5 (latest)",
@@ -5091,77 +5093,9 @@ export const MODELS = {
5091
5093
  },
5092
5094
  },
5093
5095
  "groq": {
5094
- "deepseek-r1-distill-llama-70b": {
5095
- id: "deepseek-r1-distill-llama-70b",
5096
- name: "DeepSeek R1 Distill Llama 70B",
5097
- api: "openai-completions",
5098
- provider: "groq",
5099
- baseUrl: "https://api.groq.com/openai/v1",
5100
- reasoning: true,
5101
- input: ["text"],
5102
- cost: {
5103
- input: 0.75,
5104
- output: 0.99,
5105
- cacheRead: 0,
5106
- cacheWrite: 0,
5107
- },
5108
- contextWindow: 131072,
5109
- maxTokens: 8192,
5110
- },
5111
- "gemma2-9b-it": {
5112
- id: "gemma2-9b-it",
5113
- name: "Gemma 2 9B",
5114
- api: "openai-completions",
5115
- provider: "groq",
5116
- baseUrl: "https://api.groq.com/openai/v1",
5117
- reasoning: false,
5118
- input: ["text"],
5119
- cost: {
5120
- input: 0.2,
5121
- output: 0.2,
5122
- cacheRead: 0,
5123
- cacheWrite: 0,
5124
- },
5125
- contextWindow: 8192,
5126
- maxTokens: 8192,
5127
- },
5128
- "groq/compound": {
5129
- id: "groq/compound",
5130
- name: "Compound",
5131
- api: "openai-completions",
5132
- provider: "groq",
5133
- baseUrl: "https://api.groq.com/openai/v1",
5134
- reasoning: true,
5135
- input: ["text"],
5136
- cost: {
5137
- input: 0,
5138
- output: 0,
5139
- cacheRead: 0,
5140
- cacheWrite: 0,
5141
- },
5142
- contextWindow: 131072,
5143
- maxTokens: 8192,
5144
- },
5145
- "groq/compound-mini": {
5146
- id: "groq/compound-mini",
5147
- name: "Compound Mini",
5148
- api: "openai-completions",
5149
- provider: "groq",
5150
- baseUrl: "https://api.groq.com/openai/v1",
5151
- reasoning: true,
5152
- input: ["text"],
5153
- cost: {
5154
- input: 0,
5155
- output: 0,
5156
- cacheRead: 0,
5157
- cacheWrite: 0,
5158
- },
5159
- contextWindow: 131072,
5160
- maxTokens: 8192,
5161
- },
5162
5096
  "llama-3.1-8b-instant": {
5163
5097
  id: "llama-3.1-8b-instant",
5164
- name: "Llama 3.1 8B Instant",
5098
+ name: "Llama 3.1 8B",
5165
5099
  api: "openai-completions",
5166
5100
  provider: "groq",
5167
5101
  baseUrl: "https://api.groq.com/openai/v1",
@@ -5178,7 +5112,7 @@ export const MODELS = {
5178
5112
  },
5179
5113
  "llama-3.3-70b-versatile": {
5180
5114
  id: "llama-3.3-70b-versatile",
5181
- name: "Llama 3.3 70B Versatile",
5115
+ name: "Llama 3.3 70B",
5182
5116
  api: "openai-completions",
5183
5117
  provider: "groq",
5184
5118
  baseUrl: "https://api.groq.com/openai/v1",
@@ -5193,60 +5127,9 @@ export const MODELS = {
5193
5127
  contextWindow: 131072,
5194
5128
  maxTokens: 32768,
5195
5129
  },
5196
- "llama3-70b-8192": {
5197
- id: "llama3-70b-8192",
5198
- name: "Llama 3 70B",
5199
- api: "openai-completions",
5200
- provider: "groq",
5201
- baseUrl: "https://api.groq.com/openai/v1",
5202
- reasoning: false,
5203
- input: ["text"],
5204
- cost: {
5205
- input: 0.59,
5206
- output: 0.79,
5207
- cacheRead: 0,
5208
- cacheWrite: 0,
5209
- },
5210
- contextWindow: 8192,
5211
- maxTokens: 8192,
5212
- },
5213
- "llama3-8b-8192": {
5214
- id: "llama3-8b-8192",
5215
- name: "Llama 3 8B",
5216
- api: "openai-completions",
5217
- provider: "groq",
5218
- baseUrl: "https://api.groq.com/openai/v1",
5219
- reasoning: false,
5220
- input: ["text"],
5221
- cost: {
5222
- input: 0.05,
5223
- output: 0.08,
5224
- cacheRead: 0,
5225
- cacheWrite: 0,
5226
- },
5227
- contextWindow: 8192,
5228
- maxTokens: 8192,
5229
- },
5230
- "meta-llama/llama-4-maverick-17b-128e-instruct": {
5231
- id: "meta-llama/llama-4-maverick-17b-128e-instruct",
5232
- name: "Llama 4 Maverick 17B",
5233
- api: "openai-completions",
5234
- provider: "groq",
5235
- baseUrl: "https://api.groq.com/openai/v1",
5236
- reasoning: false,
5237
- input: ["text", "image"],
5238
- cost: {
5239
- input: 0.2,
5240
- output: 0.6,
5241
- cacheRead: 0,
5242
- cacheWrite: 0,
5243
- },
5244
- contextWindow: 131072,
5245
- maxTokens: 8192,
5246
- },
5247
5130
  "meta-llama/llama-4-scout-17b-16e-instruct": {
5248
5131
  id: "meta-llama/llama-4-scout-17b-16e-instruct",
5249
- name: "Llama 4 Scout 17B",
5132
+ name: "Llama 4 Scout 17B 16E",
5250
5133
  api: "openai-completions",
5251
5134
  provider: "groq",
5252
5135
  baseUrl: "https://api.groq.com/openai/v1",
@@ -5261,57 +5144,6 @@ export const MODELS = {
5261
5144
  contextWindow: 131072,
5262
5145
  maxTokens: 8192,
5263
5146
  },
5264
- "mistral-saba-24b": {
5265
- id: "mistral-saba-24b",
5266
- name: "Mistral Saba 24B",
5267
- api: "openai-completions",
5268
- provider: "groq",
5269
- baseUrl: "https://api.groq.com/openai/v1",
5270
- reasoning: false,
5271
- input: ["text"],
5272
- cost: {
5273
- input: 0.79,
5274
- output: 0.79,
5275
- cacheRead: 0,
5276
- cacheWrite: 0,
5277
- },
5278
- contextWindow: 32768,
5279
- maxTokens: 32768,
5280
- },
5281
- "moonshotai/kimi-k2-instruct": {
5282
- id: "moonshotai/kimi-k2-instruct",
5283
- name: "Kimi K2 Instruct",
5284
- api: "openai-completions",
5285
- provider: "groq",
5286
- baseUrl: "https://api.groq.com/openai/v1",
5287
- reasoning: false,
5288
- input: ["text"],
5289
- cost: {
5290
- input: 1,
5291
- output: 3,
5292
- cacheRead: 0,
5293
- cacheWrite: 0,
5294
- },
5295
- contextWindow: 131072,
5296
- maxTokens: 16384,
5297
- },
5298
- "moonshotai/kimi-k2-instruct-0905": {
5299
- id: "moonshotai/kimi-k2-instruct-0905",
5300
- name: "Kimi K2 Instruct 0905",
5301
- api: "openai-completions",
5302
- provider: "groq",
5303
- baseUrl: "https://api.groq.com/openai/v1",
5304
- reasoning: false,
5305
- input: ["text"],
5306
- cost: {
5307
- input: 1,
5308
- output: 3,
5309
- cacheRead: 0.5,
5310
- cacheWrite: 0,
5311
- },
5312
- contextWindow: 262144,
5313
- maxTokens: 16384,
5314
- },
5315
5147
  "openai/gpt-oss-120b": {
5316
5148
  id: "openai/gpt-oss-120b",
5317
5149
  name: "GPT OSS 120B",
@@ -5363,26 +5195,9 @@ export const MODELS = {
5363
5195
  contextWindow: 131072,
5364
5196
  maxTokens: 65536,
5365
5197
  },
5366
- "qwen-qwq-32b": {
5367
- id: "qwen-qwq-32b",
5368
- name: "Qwen QwQ 32B",
5369
- api: "openai-completions",
5370
- provider: "groq",
5371
- baseUrl: "https://api.groq.com/openai/v1",
5372
- reasoning: true,
5373
- input: ["text"],
5374
- cost: {
5375
- input: 0.29,
5376
- output: 0.39,
5377
- cacheRead: 0,
5378
- cacheWrite: 0,
5379
- },
5380
- contextWindow: 131072,
5381
- maxTokens: 16384,
5382
- },
5383
5198
  "qwen/qwen3-32b": {
5384
5199
  id: "qwen/qwen3-32b",
5385
- name: "Qwen3 32B",
5200
+ name: "Qwen3-32B",
5386
5201
  api: "openai-completions",
5387
5202
  provider: "groq",
5388
5203
  baseUrl: "https://api.groq.com/openai/v1",
@@ -6832,8 +6647,8 @@ export const MODELS = {
6832
6647
  baseUrl: "https://integrate.api.nvidia.com/v1",
6833
6648
  headers: { "NVCF-POLL-SECONDS": "3600" },
6834
6649
  compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false },
6835
- reasoning: false,
6836
- input: ["text"],
6650
+ reasoning: true,
6651
+ input: ["text", "image"],
6837
6652
  cost: {
6838
6653
  input: 0,
6839
6654
  output: 0,
@@ -6862,44 +6677,6 @@ export const MODELS = {
6862
6677
  contextWindow: 262144,
6863
6678
  maxTokens: 262144,
6864
6679
  },
6865
- "nvidia/llama-3.3-nemotron-super-49b-v1": {
6866
- id: "nvidia/llama-3.3-nemotron-super-49b-v1",
6867
- name: "Llama 3.3 Nemotron Super 49B v1",
6868
- api: "openai-completions",
6869
- provider: "nvidia",
6870
- baseUrl: "https://integrate.api.nvidia.com/v1",
6871
- headers: { "NVCF-POLL-SECONDS": "3600" },
6872
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false },
6873
- reasoning: true,
6874
- input: ["text"],
6875
- cost: {
6876
- input: 0,
6877
- output: 0,
6878
- cacheRead: 0,
6879
- cacheWrite: 0,
6880
- },
6881
- contextWindow: 131072,
6882
- maxTokens: 131072,
6883
- },
6884
- "nvidia/llama-3.3-nemotron-super-49b-v1.5": {
6885
- id: "nvidia/llama-3.3-nemotron-super-49b-v1.5",
6886
- name: "Llama 3.3 Nemotron Super 49B v1.5",
6887
- api: "openai-completions",
6888
- provider: "nvidia",
6889
- baseUrl: "https://integrate.api.nvidia.com/v1",
6890
- headers: { "NVCF-POLL-SECONDS": "3600" },
6891
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false },
6892
- reasoning: true,
6893
- input: ["text"],
6894
- cost: {
6895
- input: 0,
6896
- output: 0,
6897
- cacheRead: 0,
6898
- cacheWrite: 0,
6899
- },
6900
- contextWindow: 131072,
6901
- maxTokens: 131072,
6902
- },
6903
6680
  "nvidia/nemotron-3-nano-30b-a3b": {
6904
6681
  id: "nvidia/nemotron-3-nano-30b-a3b",
6905
6682
  name: "nemotron-3-nano-30b-a3b",
@@ -6995,9 +6772,9 @@ export const MODELS = {
6995
6772
  contextWindow: 131072,
6996
6773
  maxTokens: 131072,
6997
6774
  },
6998
- "openai/gpt-oss-20b": {
6999
- id: "openai/gpt-oss-20b",
7000
- name: "GPT OSS 20B",
6775
+ "openai/gpt-oss-120b": {
6776
+ id: "openai/gpt-oss-120b",
6777
+ name: "GPT-OSS-120B",
7001
6778
  api: "openai-completions",
7002
6779
  provider: "nvidia",
7003
6780
  baseUrl: "https://integrate.api.nvidia.com/v1",
@@ -7011,18 +6788,18 @@ export const MODELS = {
7011
6788
  cacheRead: 0,
7012
6789
  cacheWrite: 0,
7013
6790
  },
7014
- contextWindow: 131072,
7015
- maxTokens: 32768,
6791
+ contextWindow: 128000,
6792
+ maxTokens: 8192,
7016
6793
  },
7017
- "qwen/qwen3-coder-480b-a35b-instruct": {
7018
- id: "qwen/qwen3-coder-480b-a35b-instruct",
7019
- name: "Qwen3 Coder 480B A35B Instruct",
6794
+ "openai/gpt-oss-20b": {
6795
+ id: "openai/gpt-oss-20b",
6796
+ name: "GPT OSS 20B",
7020
6797
  api: "openai-completions",
7021
6798
  provider: "nvidia",
7022
6799
  baseUrl: "https://integrate.api.nvidia.com/v1",
7023
6800
  headers: { "NVCF-POLL-SECONDS": "3600" },
7024
6801
  compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false },
7025
- reasoning: false,
6802
+ reasoning: true,
7026
6803
  input: ["text"],
7027
6804
  cost: {
7028
6805
  input: 0,
@@ -7030,8 +6807,8 @@ export const MODELS = {
7030
6807
  cacheRead: 0,
7031
6808
  cacheWrite: 0,
7032
6809
  },
7033
- contextWindow: 262144,
7034
- maxTokens: 66536,
6810
+ contextWindow: 131072,
6811
+ maxTokens: 32768,
7035
6812
  },
7036
6813
  "qwen/qwen3.5-122b-a10b": {
7037
6814
  id: "qwen/qwen3.5-122b-a10b",
@@ -8135,7 +7912,7 @@ export const MODELS = {
8135
7912
  cost: {
8136
7913
  input: 0.14,
8137
7914
  output: 0.28,
8138
- cacheRead: 0.03,
7915
+ cacheRead: 0.028,
8139
7916
  cacheWrite: 0,
8140
7917
  },
8141
7918
  contextWindow: 1000000,
@@ -8152,13 +7929,32 @@ export const MODELS = {
8152
7929
  thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": "max" },
8153
7930
  input: ["text"],
8154
7931
  cost: {
8155
- input: 0,
8156
- output: 0,
8157
- cacheRead: 0,
7932
+ input: 0,
7933
+ output: 0,
7934
+ cacheRead: 0,
7935
+ cacheWrite: 0,
7936
+ },
7937
+ contextWindow: 200000,
7938
+ maxTokens: 128000,
7939
+ },
7940
+ "deepseek-v4-pro": {
7941
+ id: "deepseek-v4-pro",
7942
+ name: "DeepSeek V4 Pro",
7943
+ api: "openai-completions",
7944
+ provider: "opencode",
7945
+ baseUrl: "https://opencode.ai/zen/v1",
7946
+ compat: { "maxTokensField": "max_tokens", "requiresReasoningContentOnAssistantMessages": true, "thinkingFormat": "deepseek" },
7947
+ reasoning: true,
7948
+ thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": "max" },
7949
+ input: ["text"],
7950
+ cost: {
7951
+ input: 1.74,
7952
+ output: 3.84,
7953
+ cacheRead: 0.145,
8158
7954
  cacheWrite: 0,
8159
7955
  },
8160
- contextWindow: 200000,
8161
- maxTokens: 128000,
7956
+ contextWindow: 1000000,
7957
+ maxTokens: 384000,
8162
7958
  },
8163
7959
  "gemini-3-flash": {
8164
7960
  id: "gemini-3-flash",
@@ -9553,7 +9349,7 @@ export const MODELS = {
9553
9349
  cacheRead: 0.135,
9554
9350
  cacheWrite: 0,
9555
9351
  },
9556
- contextWindow: 163840,
9352
+ contextWindow: 131072,
9557
9353
  maxTokens: 16384,
9558
9354
  },
9559
9355
  "deepseek/deepseek-chat-v3.1": {
@@ -9669,13 +9465,13 @@ export const MODELS = {
9669
9465
  thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": "xhigh" },
9670
9466
  input: ["text"],
9671
9467
  cost: {
9672
- input: 0.0983,
9673
- output: 0.1966,
9674
- cacheRead: 0.019700000000000002,
9468
+ input: 0.098,
9469
+ output: 0.196,
9470
+ cacheRead: 0.02,
9675
9471
  cacheWrite: 0,
9676
9472
  },
9677
9473
  contextWindow: 1048576,
9678
- maxTokens: 131072,
9474
+ maxTokens: 4096,
9679
9475
  },
9680
9476
  "deepseek/deepseek-v4-pro": {
9681
9477
  id: "deepseek/deepseek-v4-pro",
@@ -9995,12 +9791,12 @@ export const MODELS = {
9995
9791
  input: ["text", "image"],
9996
9792
  cost: {
9997
9793
  input: 0.12,
9998
- output: 0.36,
9794
+ output: 0.35,
9999
9795
  cacheRead: 0.09,
10000
9796
  cacheWrite: 0,
10001
9797
  },
10002
9798
  contextWindow: 262144,
10003
- maxTokens: 8192,
9799
+ maxTokens: 262144,
10004
9800
  },
10005
9801
  "google/gemma-4-31b-it:free": {
10006
9802
  id: "google/gemma-4-31b-it:free",
@@ -10301,9 +10097,9 @@ export const MODELS = {
10301
10097
  reasoning: true,
10302
10098
  input: ["text"],
10303
10099
  cost: {
10304
- input: 0.27,
10305
- output: 1.08,
10306
- cacheRead: 0.054,
10100
+ input: 0.25,
10101
+ output: 1,
10102
+ cacheRead: 0.049999999999999996,
10307
10103
  cacheWrite: 0,
10308
10104
  },
10309
10105
  contextWindow: 204800,
@@ -10693,31 +10489,13 @@ export const MODELS = {
10693
10489
  reasoning: true,
10694
10490
  input: ["text", "image"],
10695
10491
  cost: {
10696
- input: 0.6799999999999999,
10697
- output: 3.41,
10698
- cacheRead: 0.33999999999999997,
10699
- cacheWrite: 0,
10700
- },
10701
- contextWindow: 262144,
10702
- maxTokens: 262142,
10703
- },
10704
- "moonshotai/kimi-k2.6:free": {
10705
- id: "moonshotai/kimi-k2.6:free",
10706
- name: "MoonshotAI: Kimi K2.6 (free)",
10707
- api: "openai-completions",
10708
- provider: "openrouter",
10709
- baseUrl: "https://openrouter.ai/api/v1",
10710
- compat: { "supportsDeveloperRole": false, "requiresReasoningContentOnAssistantMessages": true },
10711
- reasoning: true,
10712
- input: ["text", "image"],
10713
- cost: {
10714
- input: 0,
10715
- output: 0,
10716
- cacheRead: 0,
10492
+ input: 0.67,
10493
+ output: 3.39,
10494
+ cacheRead: 0.14,
10717
10495
  cacheWrite: 0,
10718
10496
  },
10719
10497
  contextWindow: 262144,
10720
- maxTokens: 4096,
10498
+ maxTokens: 262144,
10721
10499
  },
10722
10500
  "nex-agi/nex-n2-pro:free": {
10723
10501
  id: "nex-agi/nex-n2-pro:free",
@@ -10889,23 +10667,6 @@ export const MODELS = {
10889
10667
  contextWindow: 128000,
10890
10668
  maxTokens: 128000,
10891
10669
  },
10892
- "nvidia/nemotron-nano-9b-v2": {
10893
- id: "nvidia/nemotron-nano-9b-v2",
10894
- name: "NVIDIA: Nemotron Nano 9B V2",
10895
- api: "openai-completions",
10896
- provider: "openrouter",
10897
- baseUrl: "https://openrouter.ai/api/v1",
10898
- reasoning: true,
10899
- input: ["text"],
10900
- cost: {
10901
- input: 0.04,
10902
- output: 0.16,
10903
- cacheRead: 0,
10904
- cacheWrite: 0,
10905
- },
10906
- contextWindow: 131072,
10907
- maxTokens: 16384,
10908
- },
10909
10670
  "nvidia/nemotron-nano-9b-v2:free": {
10910
10671
  id: "nvidia/nemotron-nano-9b-v2:free",
10911
10672
  name: "NVIDIA: Nemotron Nano 9B V2 (free)",
@@ -12644,13 +12405,13 @@ export const MODELS = {
12644
12405
  reasoning: true,
12645
12406
  input: ["text", "image"],
12646
12407
  cost: {
12647
- input: 0.14,
12408
+ input: 0.15,
12648
12409
  output: 1,
12649
- cacheRead: 0,
12410
+ cacheRead: 0.049999999999999996,
12650
12411
  cacheWrite: 0,
12651
12412
  },
12652
12413
  contextWindow: 262144,
12653
- maxTokens: 262140,
12414
+ maxTokens: 262144,
12654
12415
  },
12655
12416
  "qwen/qwen3.6-flash": {
12656
12417
  id: "qwen/qwen3.6-flash",
@@ -12729,10 +12490,10 @@ export const MODELS = {
12729
12490
  reasoning: true,
12730
12491
  input: ["text", "image"],
12731
12492
  cost: {
12732
- input: 0.39999999999999997,
12733
- output: 1.5999999999999999,
12734
- cacheRead: 0.08,
12735
- cacheWrite: 0.5,
12493
+ input: 0.32,
12494
+ output: 1.28,
12495
+ cacheRead: 0.064,
12496
+ cacheWrite: 0.39999999999999997,
12736
12497
  },
12737
12498
  contextWindow: 1000000,
12738
12499
  maxTokens: 65536,
@@ -13273,13 +13034,13 @@ export const MODELS = {
13273
13034
  reasoning: true,
13274
13035
  input: ["text", "image"],
13275
13036
  cost: {
13276
- input: 0.6799999999999999,
13277
- output: 3.41,
13278
- cacheRead: 0.33999999999999997,
13037
+ input: 0.67,
13038
+ output: 3.39,
13039
+ cacheRead: 0.14,
13279
13040
  cacheWrite: 0,
13280
13041
  },
13281
13042
  contextWindow: 262144,
13282
- maxTokens: 262142,
13043
+ maxTokens: 262144,
13283
13044
  },
13284
13045
  "~openai/gpt-latest": {
13285
13046
  id: "~openai/gpt-latest",
@@ -13317,25 +13078,6 @@ export const MODELS = {
13317
13078
  },
13318
13079
  },
13319
13080
  "together": {
13320
- "MiniMaxAI/MiniMax-M2.5": {
13321
- id: "MiniMaxAI/MiniMax-M2.5",
13322
- name: "MiniMax-M2.5",
13323
- api: "openai-completions",
13324
- provider: "together",
13325
- baseUrl: "https://api.together.ai/v1",
13326
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false, "thinkingFormat": "together" },
13327
- reasoning: true,
13328
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null },
13329
- input: ["text"],
13330
- cost: {
13331
- input: 0.3,
13332
- output: 1.2,
13333
- cacheRead: 0.06,
13334
- cacheWrite: 0,
13335
- },
13336
- contextWindow: 204800,
13337
- maxTokens: 131072,
13338
- },
13339
13081
  "MiniMaxAI/MiniMax-M2.7": {
13340
13082
  id: "MiniMaxAI/MiniMax-M2.7",
13341
13083
  name: "MiniMax-M2.7",
@@ -13355,28 +13097,27 @@ export const MODELS = {
13355
13097
  contextWindow: 202752,
13356
13098
  maxTokens: 131072,
13357
13099
  },
13358
- "Qwen/Qwen3-235B-A22B-Instruct-2507-tput": {
13359
- id: "Qwen/Qwen3-235B-A22B-Instruct-2507-tput",
13360
- name: "Qwen3 235B A22B Instruct 2507 FP8",
13100
+ "Qwen/Qwen2.5-7B-Instruct-Turbo": {
13101
+ id: "Qwen/Qwen2.5-7B-Instruct-Turbo",
13102
+ name: "Qwen 2.5 7B Instruct Turbo",
13361
13103
  api: "openai-completions",
13362
13104
  provider: "together",
13363
13105
  baseUrl: "https://api.together.ai/v1",
13364
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false, "thinkingFormat": "together" },
13365
- reasoning: true,
13366
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null },
13106
+ compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false },
13107
+ reasoning: false,
13367
13108
  input: ["text"],
13368
13109
  cost: {
13369
- input: 0.2,
13370
- output: 0.6,
13110
+ input: 0.3,
13111
+ output: 0.3,
13371
13112
  cacheRead: 0,
13372
13113
  cacheWrite: 0,
13373
13114
  },
13374
- contextWindow: 262144,
13375
- maxTokens: 262144,
13115
+ contextWindow: 32768,
13116
+ maxTokens: 32768,
13376
13117
  },
13377
- "Qwen/Qwen3-Coder-480B-A35B-Instruct-FP8": {
13378
- id: "Qwen/Qwen3-Coder-480B-A35B-Instruct-FP8",
13379
- name: "Qwen3 Coder 480B A35B Instruct",
13118
+ "Qwen/Qwen3-235B-A22B-Instruct-2507-tput": {
13119
+ id: "Qwen/Qwen3-235B-A22B-Instruct-2507-tput",
13120
+ name: "Qwen3 235B A22B Instruct 2507 FP8",
13380
13121
  api: "openai-completions",
13381
13122
  provider: "together",
13382
13123
  baseUrl: "https://api.together.ai/v1",
@@ -13384,36 +13125,36 @@ export const MODELS = {
13384
13125
  reasoning: false,
13385
13126
  input: ["text"],
13386
13127
  cost: {
13387
- input: 2,
13388
- output: 2,
13128
+ input: 0.2,
13129
+ output: 0.6,
13389
13130
  cacheRead: 0,
13390
13131
  cacheWrite: 0,
13391
13132
  },
13392
13133
  contextWindow: 262144,
13393
13134
  maxTokens: 262144,
13394
13135
  },
13395
- "Qwen/Qwen3-Coder-Next-FP8": {
13396
- id: "Qwen/Qwen3-Coder-Next-FP8",
13397
- name: "Qwen3 Coder Next FP8",
13136
+ "Qwen/Qwen3.5-397B-A17B": {
13137
+ id: "Qwen/Qwen3.5-397B-A17B",
13138
+ name: "Qwen3.5 397B A17B",
13398
13139
  api: "openai-completions",
13399
13140
  provider: "together",
13400
13141
  baseUrl: "https://api.together.ai/v1",
13401
13142
  compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false, "thinkingFormat": "together" },
13402
13143
  reasoning: true,
13403
13144
  thinkingLevelMap: { "minimal": null, "low": null, "medium": null },
13404
- input: ["text"],
13145
+ input: ["text", "image"],
13405
13146
  cost: {
13406
- input: 0.5,
13407
- output: 1.2,
13147
+ input: 0.6,
13148
+ output: 3.6,
13408
13149
  cacheRead: 0,
13409
13150
  cacheWrite: 0,
13410
13151
  },
13411
13152
  contextWindow: 262144,
13412
- maxTokens: 262144,
13153
+ maxTokens: 130000,
13413
13154
  },
13414
- "Qwen/Qwen3.5-397B-A17B": {
13415
- id: "Qwen/Qwen3.5-397B-A17B",
13416
- name: "Qwen3.5 397B A17B",
13155
+ "Qwen/Qwen3.5-9B": {
13156
+ id: "Qwen/Qwen3.5-9B",
13157
+ name: "Qwen3.5 9B",
13417
13158
  api: "openai-completions",
13418
13159
  provider: "together",
13419
13160
  baseUrl: "https://api.together.ai/v1",
@@ -13422,13 +13163,13 @@ export const MODELS = {
13422
13163
  thinkingLevelMap: { "minimal": null, "low": null, "medium": null },
13423
13164
  input: ["text", "image"],
13424
13165
  cost: {
13425
- input: 0.6,
13426
- output: 3.6,
13166
+ input: 0.17,
13167
+ output: 0.25,
13427
13168
  cacheRead: 0,
13428
13169
  cacheWrite: 0,
13429
13170
  },
13430
13171
  contextWindow: 262144,
13431
- maxTokens: 130000,
13172
+ maxTokens: 65536,
13432
13173
  },
13433
13174
  "Qwen/Qwen3.6-Plus": {
13434
13175
  id: "Qwen/Qwen3.6-Plus",
@@ -13455,9 +13196,8 @@ export const MODELS = {
13455
13196
  api: "openai-completions",
13456
13197
  provider: "together",
13457
13198
  baseUrl: "https://api.together.ai/v1",
13458
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false, "thinkingFormat": "together" },
13459
- reasoning: true,
13460
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null },
13199
+ compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false },
13200
+ reasoning: false,
13461
13201
  input: ["text"],
13462
13202
  cost: {
13463
13203
  input: 2.5,
@@ -13468,44 +13208,6 @@ export const MODELS = {
13468
13208
  contextWindow: 1000000,
13469
13209
  maxTokens: 500000,
13470
13210
  },
13471
- "deepseek-ai/DeepSeek-V3": {
13472
- id: "deepseek-ai/DeepSeek-V3",
13473
- name: "DeepSeek-V3",
13474
- api: "openai-completions",
13475
- provider: "together",
13476
- baseUrl: "https://api.together.ai/v1",
13477
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false, "thinkingFormat": "together" },
13478
- reasoning: true,
13479
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null },
13480
- input: ["text"],
13481
- cost: {
13482
- input: 1.25,
13483
- output: 1.25,
13484
- cacheRead: 0,
13485
- cacheWrite: 0,
13486
- },
13487
- contextWindow: 131072,
13488
- maxTokens: 131072,
13489
- },
13490
- "deepseek-ai/DeepSeek-V3-1": {
13491
- id: "deepseek-ai/DeepSeek-V3-1",
13492
- name: "DeepSeek V3.1",
13493
- api: "openai-completions",
13494
- provider: "together",
13495
- baseUrl: "https://api.together.ai/v1",
13496
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false, "thinkingFormat": "together" },
13497
- reasoning: true,
13498
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null },
13499
- input: ["text"],
13500
- cost: {
13501
- input: 0.6,
13502
- output: 1.7,
13503
- cacheRead: 0,
13504
- cacheWrite: 0,
13505
- },
13506
- contextWindow: 131072,
13507
- maxTokens: 131072,
13508
- },
13509
13211
  "deepseek-ai/DeepSeek-V4-Pro": {
13510
13212
  id: "deepseek-ai/DeepSeek-V4-Pro",
13511
13213
  name: "DeepSeek V4 Pro",
@@ -13517,8 +13219,8 @@ export const MODELS = {
13517
13219
  thinkingLevelMap: { "minimal": null, "low": null, "medium": null, "high": "high", "xhigh": null },
13518
13220
  input: ["text"],
13519
13221
  cost: {
13520
- input: 2.1,
13521
- output: 4.4,
13222
+ input: 1.74,
13223
+ output: 3.48,
13522
13224
  cacheRead: 0.2,
13523
13225
  cacheWrite: 0,
13524
13226
  },
@@ -13554,8 +13256,8 @@ export const MODELS = {
13554
13256
  thinkingLevelMap: { "minimal": null, "low": null, "medium": null },
13555
13257
  input: ["text", "image"],
13556
13258
  cost: {
13557
- input: 0.2,
13558
- output: 0.5,
13259
+ input: 0.39,
13260
+ output: 0.97,
13559
13261
  cacheRead: 0,
13560
13262
  cacheWrite: 0,
13561
13263
  },
@@ -13580,25 +13282,6 @@ export const MODELS = {
13580
13282
  contextWindow: 131072,
13581
13283
  maxTokens: 131072,
13582
13284
  },
13583
- "moonshotai/Kimi-K2.5": {
13584
- id: "moonshotai/Kimi-K2.5",
13585
- name: "Kimi K2.5",
13586
- api: "openai-completions",
13587
- provider: "together",
13588
- baseUrl: "https://api.together.ai/v1",
13589
- compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false, "thinkingFormat": "together" },
13590
- reasoning: true,
13591
- thinkingLevelMap: { "minimal": null, "low": null, "medium": null },
13592
- input: ["text", "image"],
13593
- cost: {
13594
- input: 0.5,
13595
- output: 2.8,
13596
- cacheRead: 0,
13597
- cacheWrite: 0,
13598
- },
13599
- contextWindow: 262144,
13600
- maxTokens: 262144,
13601
- },
13602
13285
  "moonshotai/Kimi-K2.6": {
13603
13286
  id: "moonshotai/Kimi-K2.6",
13604
13287
  name: "Kimi K2.6",
@@ -13656,6 +13339,44 @@ export const MODELS = {
13656
13339
  contextWindow: 131072,
13657
13340
  maxTokens: 131072,
13658
13341
  },
13342
+ "openai/gpt-oss-20b": {
13343
+ id: "openai/gpt-oss-20b",
13344
+ name: "GPT OSS 20B",
13345
+ api: "openai-completions",
13346
+ provider: "together",
13347
+ baseUrl: "https://api.together.ai/v1",
13348
+ compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": true, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false, "thinkingFormat": "openai" },
13349
+ reasoning: true,
13350
+ thinkingLevelMap: { "off": null, "minimal": null },
13351
+ input: ["text"],
13352
+ cost: {
13353
+ input: 0.05,
13354
+ output: 0.2,
13355
+ cacheRead: 0,
13356
+ cacheWrite: 0,
13357
+ },
13358
+ contextWindow: 131072,
13359
+ maxTokens: 131072,
13360
+ },
13361
+ "zai-org/GLM-5": {
13362
+ id: "zai-org/GLM-5",
13363
+ name: "GLM-5",
13364
+ api: "openai-completions",
13365
+ provider: "together",
13366
+ baseUrl: "https://api.together.ai/v1",
13367
+ compat: { "supportsStore": false, "supportsDeveloperRole": false, "supportsReasoningEffort": false, "maxTokensField": "max_tokens", "supportsStrictMode": false, "supportsLongCacheRetention": false, "thinkingFormat": "together" },
13368
+ reasoning: true,
13369
+ thinkingLevelMap: { "minimal": null, "low": null, "medium": null },
13370
+ input: ["text"],
13371
+ cost: {
13372
+ input: 1,
13373
+ output: 3.2,
13374
+ cacheRead: 0,
13375
+ cacheWrite: 0,
13376
+ },
13377
+ contextWindow: 202752,
13378
+ maxTokens: 131072,
13379
+ },
13659
13380
  "zai-org/GLM-5.1": {
13660
13381
  id: "zai-org/GLM-5.1",
13661
13382
  name: "GLM-5.1",
@@ -15233,40 +14954,6 @@ export const MODELS = {
15233
14954
  contextWindow: 262114,
15234
14955
  maxTokens: 262114,
15235
14956
  },
15236
- "moonshotai/kimi-k2-thinking-turbo": {
15237
- id: "moonshotai/kimi-k2-thinking-turbo",
15238
- name: "Kimi K2 Thinking Turbo",
15239
- api: "anthropic-messages",
15240
- provider: "vercel-ai-gateway",
15241
- baseUrl: "https://ai-gateway.vercel.sh",
15242
- reasoning: true,
15243
- input: ["text"],
15244
- cost: {
15245
- input: 1.15,
15246
- output: 8,
15247
- cacheRead: 0.15,
15248
- cacheWrite: 0,
15249
- },
15250
- contextWindow: 262114,
15251
- maxTokens: 262114,
15252
- },
15253
- "moonshotai/kimi-k2-turbo": {
15254
- id: "moonshotai/kimi-k2-turbo",
15255
- name: "Kimi K2 Turbo",
15256
- api: "anthropic-messages",
15257
- provider: "vercel-ai-gateway",
15258
- baseUrl: "https://ai-gateway.vercel.sh",
15259
- reasoning: false,
15260
- input: ["text"],
15261
- cost: {
15262
- input: 1.15,
15263
- output: 8,
15264
- cacheRead: 0.15,
15265
- cacheWrite: 0,
15266
- },
15267
- contextWindow: 256000,
15268
- maxTokens: 16384,
15269
- },
15270
14957
  "moonshotai/kimi-k2.5": {
15271
14958
  id: "moonshotai/kimi-k2.5",
15272
14959
  name: "Kimi K2.5",