pi-ollama-cloud 0.5.0 → 0.7.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
@@ -1,1353 +1,721 @@
1
1
  // Auto-generated by scripts/generate-models.ts
2
2
  // Do not edit manually.
3
- // Generated: 2026-05-19T20:41:09.610Z
4
- // Model count: 36
3
+ // Generated: 2026-07-17T19:55:27.551Z
4
+ // Model count: 18
5
5
 
6
6
  import type { ProviderModelConfig } from "@earendil-works/pi-coding-agent";
7
7
 
8
8
  export const GENERATED_MODELS: ProviderModelConfig[] = [
9
9
  {
10
- id: "ministral-3:14b",
11
- name: "ministral-3:14b",
12
- reasoning: false,
13
- input: ["text", "image"],
14
- cost: {
15
- input: 0,
16
- output: 0,
17
- cacheRead: 0,
18
- cacheWrite: 0,
19
- },
20
- contextWindow: 262144,
21
- maxTokens: 32768,
22
- compat: {
23
- supportsDeveloperRole: false,
24
- supportsReasoningEffort: true,
25
- supportsStore: false,
26
- maxTokensField: "max_tokens",
27
- supportsUsageInStreaming: true,
28
- requiresToolResultName: false,
29
- requiresAssistantAfterToolResult: false,
30
- requiresThinkingAsText: false,
31
- requiresReasoningContentOnAssistantMessages: false,
32
- thinkingFormat: "openai",
33
- supportsStrictMode: false,
34
- sendSessionAffinityHeaders: false,
35
- supportsLongCacheRetention: false,
36
- zaiToolStream: false,
37
- openRouterRouting: {},
38
- vercelGatewayRouting: {},
39
- },
40
- },
41
- {
42
- id: "devstral-small-2:24b",
43
- name: "devstral-small-2:24b",
44
- reasoning: false,
45
- input: ["text", "image"],
46
- cost: {
47
- input: 0,
48
- output: 0,
49
- cacheRead: 0,
50
- cacheWrite: 0,
51
- },
52
- contextWindow: 262144,
53
- maxTokens: 32768,
54
- compat: {
55
- supportsDeveloperRole: false,
56
- supportsReasoningEffort: true,
57
- supportsStore: false,
58
- maxTokensField: "max_tokens",
59
- supportsUsageInStreaming: true,
60
- requiresToolResultName: false,
61
- requiresAssistantAfterToolResult: false,
62
- requiresThinkingAsText: false,
63
- requiresReasoningContentOnAssistantMessages: false,
64
- thinkingFormat: "openai",
65
- supportsStrictMode: false,
66
- sendSessionAffinityHeaders: false,
67
- supportsLongCacheRetention: false,
68
- zaiToolStream: false,
69
- openRouterRouting: {},
70
- vercelGatewayRouting: {},
71
- },
72
- },
73
- {
74
- id: "glm-5.1",
75
- name: "glm-5.1",
76
- reasoning: true,
77
- thinkingLevelMap: {
78
- off: "none",
79
- minimal: null,
80
- low: "low",
81
- medium: "medium",
82
- high: "high",
83
- xhigh: "max",
84
- },
85
- input: ["text"],
86
- cost: {
87
- input: 0,
88
- output: 0,
89
- cacheRead: 0,
90
- cacheWrite: 0,
91
- },
92
- contextWindow: 202752,
93
- maxTokens: 32768,
94
- compat: {
95
- supportsDeveloperRole: false,
96
- supportsReasoningEffort: true,
97
- supportsStore: false,
98
- maxTokensField: "max_tokens",
99
- supportsUsageInStreaming: true,
100
- requiresToolResultName: false,
101
- requiresAssistantAfterToolResult: false,
102
- requiresThinkingAsText: false,
103
- requiresReasoningContentOnAssistantMessages: false,
104
- thinkingFormat: "openai",
105
- supportsStrictMode: false,
106
- sendSessionAffinityHeaders: false,
107
- supportsLongCacheRetention: false,
108
- zaiToolStream: false,
109
- openRouterRouting: {},
110
- vercelGatewayRouting: {},
111
- },
112
- },
113
- {
114
- id: "qwen3-vl:235b-instruct",
115
- name: "qwen3-vl:235b-instruct",
116
- reasoning: false,
117
- input: ["text", "image"],
118
- cost: {
119
- input: 0,
120
- output: 0,
121
- cacheRead: 0,
122
- cacheWrite: 0,
123
- },
124
- contextWindow: 262144,
125
- maxTokens: 32768,
126
- compat: {
127
- supportsDeveloperRole: false,
128
- supportsReasoningEffort: true,
129
- supportsStore: false,
130
- maxTokensField: "max_tokens",
131
- supportsUsageInStreaming: true,
132
- requiresToolResultName: false,
133
- requiresAssistantAfterToolResult: false,
134
- requiresThinkingAsText: false,
135
- requiresReasoningContentOnAssistantMessages: false,
136
- thinkingFormat: "openai",
137
- supportsStrictMode: false,
138
- sendSessionAffinityHeaders: false,
139
- supportsLongCacheRetention: false,
140
- zaiToolStream: false,
141
- openRouterRouting: {},
142
- vercelGatewayRouting: {},
143
- },
144
- },
145
- {
146
- id: "qwen3.5:397b",
147
- name: "qwen3.5:397b",
148
- reasoning: true,
149
- thinkingLevelMap: {
150
- off: "none",
151
- minimal: null,
152
- low: null,
153
- medium: "medium",
154
- high: null,
155
- xhigh: null,
156
- },
157
- input: ["text", "image"],
158
- cost: {
159
- input: 0,
160
- output: 0,
161
- cacheRead: 0,
162
- cacheWrite: 0,
163
- },
164
- contextWindow: 262144,
165
- maxTokens: 32768,
166
- compat: {
167
- supportsDeveloperRole: false,
168
- supportsReasoningEffort: true,
169
- supportsStore: false,
170
- maxTokensField: "max_tokens",
171
- supportsUsageInStreaming: true,
172
- requiresToolResultName: false,
173
- requiresAssistantAfterToolResult: false,
174
- requiresThinkingAsText: false,
175
- requiresReasoningContentOnAssistantMessages: false,
176
- thinkingFormat: "openai",
177
- supportsStrictMode: false,
178
- sendSessionAffinityHeaders: false,
179
- supportsLongCacheRetention: false,
180
- zaiToolStream: false,
181
- openRouterRouting: {},
182
- vercelGatewayRouting: {},
183
- },
184
- },
185
- {
186
- id: "glm-4.7",
187
- name: "glm-4.7",
188
- reasoning: true,
189
- thinkingLevelMap: {
190
- off: "none",
191
- minimal: null,
192
- low: "low",
193
- medium: "medium",
194
- high: "high",
195
- xhigh: "max",
196
- },
197
- input: ["text"],
198
- cost: {
199
- input: 0,
200
- output: 0,
201
- cacheRead: 0,
202
- cacheWrite: 0,
203
- },
204
- contextWindow: 202752,
205
- maxTokens: 32768,
206
- compat: {
207
- supportsDeveloperRole: false,
208
- supportsReasoningEffort: true,
209
- supportsStore: false,
210
- maxTokensField: "max_tokens",
211
- supportsUsageInStreaming: true,
212
- requiresToolResultName: false,
213
- requiresAssistantAfterToolResult: false,
214
- requiresThinkingAsText: false,
215
- requiresReasoningContentOnAssistantMessages: false,
216
- thinkingFormat: "openai",
217
- supportsStrictMode: false,
218
- sendSessionAffinityHeaders: false,
219
- supportsLongCacheRetention: false,
220
- zaiToolStream: false,
221
- openRouterRouting: {},
222
- vercelGatewayRouting: {},
223
- },
224
- },
225
- {
226
- id: "qwen3-next:80b",
227
- name: "qwen3-next:80b",
228
- reasoning: true,
229
- thinkingLevelMap: {
230
- off: "none",
231
- minimal: null,
232
- low: null,
233
- medium: "medium",
234
- high: null,
235
- xhigh: null,
236
- },
237
- input: ["text"],
238
- cost: {
239
- input: 0,
240
- output: 0,
241
- cacheRead: 0,
242
- cacheWrite: 0,
243
- },
244
- contextWindow: 262144,
245
- maxTokens: 32768,
246
- compat: {
247
- supportsDeveloperRole: false,
248
- supportsReasoningEffort: true,
249
- supportsStore: false,
250
- maxTokensField: "max_tokens",
251
- supportsUsageInStreaming: true,
252
- requiresToolResultName: false,
253
- requiresAssistantAfterToolResult: false,
254
- requiresThinkingAsText: false,
255
- requiresReasoningContentOnAssistantMessages: false,
256
- thinkingFormat: "openai",
257
- supportsStrictMode: false,
258
- sendSessionAffinityHeaders: false,
259
- supportsLongCacheRetention: false,
260
- zaiToolStream: false,
261
- openRouterRouting: {},
262
- vercelGatewayRouting: {},
263
- },
264
- },
265
- {
266
- id: "deepseek-v3.2",
267
- name: "deepseek-v3.2",
268
- reasoning: true,
269
- thinkingLevelMap: {
270
- off: "none",
271
- minimal: null,
272
- low: "low",
273
- medium: "medium",
274
- high: "high",
275
- xhigh: "max",
276
- },
277
- input: ["text"],
278
- cost: {
279
- input: 0,
280
- output: 0,
281
- cacheRead: 0,
282
- cacheWrite: 0,
283
- },
284
- contextWindow: 163840,
285
- maxTokens: 32768,
286
- compat: {
287
- supportsDeveloperRole: false,
288
- supportsReasoningEffort: true,
289
- supportsStore: false,
290
- maxTokensField: "max_tokens",
291
- supportsUsageInStreaming: true,
292
- requiresToolResultName: false,
293
- requiresAssistantAfterToolResult: false,
294
- requiresThinkingAsText: false,
295
- requiresReasoningContentOnAssistantMessages: false,
296
- thinkingFormat: "openai",
297
- supportsStrictMode: false,
298
- sendSessionAffinityHeaders: false,
299
- supportsLongCacheRetention: false,
300
- zaiToolStream: false,
301
- openRouterRouting: {},
302
- vercelGatewayRouting: {},
303
- },
304
- },
305
- {
306
- id: "deepseek-v4-pro",
307
- name: "deepseek-v4-pro",
308
- reasoning: true,
309
- thinkingLevelMap: {
310
- off: "none",
311
- minimal: null,
312
- low: "low",
313
- medium: "medium",
314
- high: "high",
315
- xhigh: "max",
316
- },
317
- input: ["text"],
318
- cost: {
319
- input: 0,
320
- output: 0,
321
- cacheRead: 0,
322
- cacheWrite: 0,
323
- },
324
- contextWindow: 1048576,
325
- maxTokens: 32768,
326
- compat: {
327
- supportsDeveloperRole: false,
328
- supportsReasoningEffort: true,
329
- supportsStore: false,
330
- maxTokensField: "max_tokens",
331
- supportsUsageInStreaming: true,
332
- requiresToolResultName: false,
333
- requiresAssistantAfterToolResult: false,
334
- requiresThinkingAsText: false,
335
- requiresReasoningContentOnAssistantMessages: false,
336
- thinkingFormat: "openai",
337
- supportsStrictMode: false,
338
- sendSessionAffinityHeaders: false,
339
- supportsLongCacheRetention: false,
340
- zaiToolStream: false,
341
- openRouterRouting: {},
342
- vercelGatewayRouting: {},
343
- },
344
- },
345
- {
346
- id: "gpt-oss:20b",
347
- name: "gpt-oss:20b",
348
- reasoning: true,
349
- thinkingLevelMap: {
350
- off: null,
351
- minimal: null,
352
- low: "low",
353
- medium: "medium",
354
- high: "high",
355
- xhigh: null,
356
- },
357
- input: ["text"],
358
- cost: {
359
- input: 0,
360
- output: 0,
361
- cacheRead: 0,
362
- cacheWrite: 0,
363
- },
364
- contextWindow: 131072,
365
- maxTokens: 32768,
366
- compat: {
367
- supportsDeveloperRole: false,
368
- supportsReasoningEffort: true,
369
- supportsStore: false,
370
- maxTokensField: "max_tokens",
371
- supportsUsageInStreaming: true,
372
- requiresToolResultName: false,
373
- requiresAssistantAfterToolResult: false,
374
- requiresThinkingAsText: false,
375
- requiresReasoningContentOnAssistantMessages: false,
376
- thinkingFormat: "openai",
377
- supportsStrictMode: false,
378
- sendSessionAffinityHeaders: false,
379
- supportsLongCacheRetention: false,
380
- zaiToolStream: false,
381
- openRouterRouting: {},
382
- vercelGatewayRouting: {},
383
- },
384
- },
385
- {
386
- id: "ministral-3:3b",
387
- name: "ministral-3:3b",
388
- reasoning: false,
389
- input: ["text", "image"],
390
- cost: {
391
- input: 0,
392
- output: 0,
393
- cacheRead: 0,
394
- cacheWrite: 0,
395
- },
396
- contextWindow: 262144,
397
- maxTokens: 32768,
10
+ id: "deepseek-v4-flash",
11
+ name: "deepseek-v4-flash",
398
12
  compat: {
399
- supportsDeveloperRole: false,
400
- supportsReasoningEffort: true,
401
- supportsStore: false,
402
13
  maxTokensField: "max_tokens",
403
- supportsUsageInStreaming: true,
404
- requiresToolResultName: false,
405
- requiresAssistantAfterToolResult: false,
406
- requiresThinkingAsText: false,
407
- requiresReasoningContentOnAssistantMessages: false,
408
- thinkingFormat: "openai",
409
- supportsStrictMode: false,
410
- sendSessionAffinityHeaders: false,
411
- supportsLongCacheRetention: false,
412
- zaiToolStream: false,
413
14
  openRouterRouting: {},
414
- vercelGatewayRouting: {},
415
- },
416
- },
417
- {
418
- id: "gemini-3-flash-preview",
419
- name: "gemini-3-flash-preview",
420
- reasoning: true,
421
- thinkingLevelMap: {
422
- off: "none",
423
- minimal: null,
424
- low: "low",
425
- medium: "medium",
426
- high: "high",
427
- xhigh: "max",
428
- },
429
- input: ["text", "image"],
430
- cost: {
431
- input: 0,
432
- output: 0,
433
- cacheRead: 0,
434
- cacheWrite: 0,
435
- },
436
- contextWindow: 1048576,
437
- maxTokens: 32768,
438
- compat: {
439
- supportsDeveloperRole: false,
440
- supportsReasoningEffort: true,
441
- supportsStore: false,
442
- maxTokensField: "max_tokens",
443
- supportsUsageInStreaming: true,
444
- requiresToolResultName: false,
445
15
  requiresAssistantAfterToolResult: false,
446
- requiresThinkingAsText: false,
447
16
  requiresReasoningContentOnAssistantMessages: false,
448
- thinkingFormat: "openai",
449
- supportsStrictMode: false,
450
- sendSessionAffinityHeaders: false,
451
- supportsLongCacheRetention: false,
452
- zaiToolStream: false,
453
- openRouterRouting: {},
454
- vercelGatewayRouting: {},
455
- },
456
- },
457
- {
458
- id: "kimi-k2:1t",
459
- name: "kimi-k2:1t",
460
- reasoning: false,
461
- input: ["text"],
462
- cost: {
463
- input: 0,
464
- output: 0,
465
- cacheRead: 0,
466
- cacheWrite: 0,
467
- },
468
- contextWindow: 262144,
469
- maxTokens: 32768,
470
- compat: {
471
- supportsDeveloperRole: false,
472
- supportsReasoningEffort: true,
473
- supportsStore: false,
474
- maxTokensField: "max_tokens",
475
- supportsUsageInStreaming: true,
476
- requiresToolResultName: false,
477
- requiresAssistantAfterToolResult: false,
478
17
  requiresThinkingAsText: false,
479
- requiresReasoningContentOnAssistantMessages: false,
480
- thinkingFormat: "openai",
481
- supportsStrictMode: false,
482
- sendSessionAffinityHeaders: false,
483
- supportsLongCacheRetention: false,
484
- zaiToolStream: false,
485
- openRouterRouting: {},
486
- vercelGatewayRouting: {},
487
- },
488
- },
489
- {
490
- id: "kimi-k2-thinking",
491
- name: "kimi-k2-thinking",
492
- reasoning: true,
493
- thinkingLevelMap: {
494
- off: null,
495
- minimal: null,
496
- low: "low",
497
- medium: "medium",
498
- high: "high",
499
- xhigh: "max",
500
- },
501
- input: ["text"],
502
- cost: {
503
- input: 0,
504
- output: 0,
505
- cacheRead: 0,
506
- cacheWrite: 0,
507
- },
508
- contextWindow: 262144,
509
- maxTokens: 32768,
510
- compat: {
511
- supportsDeveloperRole: false,
512
- supportsReasoningEffort: true,
513
- supportsStore: false,
514
- maxTokensField: "max_tokens",
515
- supportsUsageInStreaming: true,
516
18
  requiresToolResultName: false,
517
- requiresAssistantAfterToolResult: false,
518
- requiresThinkingAsText: false,
519
- requiresReasoningContentOnAssistantMessages: false,
520
- thinkingFormat: "openai",
521
- supportsStrictMode: false,
522
19
  sendSessionAffinityHeaders: false,
523
- supportsLongCacheRetention: false,
524
- zaiToolStream: false,
525
- openRouterRouting: {},
526
- vercelGatewayRouting: {},
527
- },
528
- },
529
- {
530
- id: "qwen3-vl:235b",
531
- name: "qwen3-vl:235b",
532
- reasoning: true,
533
- thinkingLevelMap: {
534
- off: null,
535
- minimal: null,
536
- low: "low",
537
- medium: "medium",
538
- high: "high",
539
- xhigh: "max",
540
- },
541
- input: ["text", "image"],
542
- cost: {
543
- input: 0,
544
- output: 0,
545
- cacheRead: 0,
546
- cacheWrite: 0,
547
- },
548
- contextWindow: 262144,
549
- maxTokens: 32768,
550
- compat: {
551
20
  supportsDeveloperRole: false,
552
- supportsReasoningEffort: true,
553
- supportsStore: false,
554
- maxTokensField: "max_tokens",
555
- supportsUsageInStreaming: true,
556
- requiresToolResultName: false,
557
- requiresAssistantAfterToolResult: false,
558
- requiresThinkingAsText: false,
559
- requiresReasoningContentOnAssistantMessages: false,
560
- thinkingFormat: "openai",
561
- supportsStrictMode: false,
562
- sendSessionAffinityHeaders: false,
563
21
  supportsLongCacheRetention: false,
564
- zaiToolStream: false,
565
- openRouterRouting: {},
566
- vercelGatewayRouting: {},
567
- },
568
- },
569
- {
570
- id: "minimax-m2",
571
- name: "minimax-m2",
572
- reasoning: false,
573
- input: ["text"],
574
- cost: {
575
- input: 0,
576
- output: 0,
577
- cacheRead: 0,
578
- cacheWrite: 0,
579
- },
580
- contextWindow: 204800,
581
- maxTokens: 32768,
582
- compat: {
583
- supportsDeveloperRole: false,
584
22
  supportsReasoningEffort: true,
585
23
  supportsStore: false,
586
- maxTokensField: "max_tokens",
587
- supportsUsageInStreaming: true,
588
- requiresToolResultName: false,
589
- requiresAssistantAfterToolResult: false,
590
- requiresThinkingAsText: false,
591
- requiresReasoningContentOnAssistantMessages: false,
592
- thinkingFormat: "openai",
593
24
  supportsStrictMode: false,
594
- sendSessionAffinityHeaders: false,
595
- supportsLongCacheRetention: false,
596
- zaiToolStream: false,
597
- openRouterRouting: {},
598
- vercelGatewayRouting: {},
599
- },
600
- },
601
- {
602
- id: "gemma4:31b",
603
- name: "gemma4:31b",
604
- reasoning: true,
605
- thinkingLevelMap: {
606
- off: "none",
607
- minimal: null,
608
- low: "low",
609
- medium: "medium",
610
- high: "high",
611
- xhigh: "max",
612
- },
613
- input: ["text", "image"],
614
- cost: {
615
- input: 0,
616
- output: 0,
617
- cacheRead: 0,
618
- cacheWrite: 0,
619
- },
620
- contextWindow: 262144,
621
- maxTokens: 32768,
622
- compat: {
623
- supportsDeveloperRole: false,
624
- supportsReasoningEffort: true,
625
- supportsStore: false,
626
- maxTokensField: "max_tokens",
627
25
  supportsUsageInStreaming: true,
628
- requiresToolResultName: false,
629
- requiresAssistantAfterToolResult: false,
630
- requiresThinkingAsText: false,
631
- requiresReasoningContentOnAssistantMessages: false,
632
26
  thinkingFormat: "openai",
633
- supportsStrictMode: false,
634
- sendSessionAffinityHeaders: false,
635
- supportsLongCacheRetention: false,
636
- zaiToolStream: false,
637
- openRouterRouting: {},
638
27
  vercelGatewayRouting: {},
28
+ zaiToolStream: false,
639
29
  },
640
- },
641
- {
642
- id: "rnj-1:8b",
643
- name: "rnj-1:8b",
644
- reasoning: false,
645
- input: ["text"],
30
+ contextWindow: 1048576,
646
31
  cost: {
647
- input: 0,
648
- output: 0,
649
- cacheRead: 0,
32
+ cacheRead: 0.0028,
650
33
  cacheWrite: 0,
34
+ input: 0.14,
35
+ output: 0.28,
651
36
  },
652
- contextWindow: 32768,
37
+ input: ["text"],
653
38
  maxTokens: 32768,
654
- compat: {
655
- supportsDeveloperRole: false,
656
- supportsReasoningEffort: true,
657
- supportsStore: false,
658
- maxTokensField: "max_tokens",
659
- supportsUsageInStreaming: true,
660
- requiresToolResultName: false,
661
- requiresAssistantAfterToolResult: false,
662
- requiresThinkingAsText: false,
663
- requiresReasoningContentOnAssistantMessages: false,
664
- thinkingFormat: "openai",
665
- supportsStrictMode: false,
666
- sendSessionAffinityHeaders: false,
667
- supportsLongCacheRetention: false,
668
- zaiToolStream: false,
669
- openRouterRouting: {},
670
- vercelGatewayRouting: {},
671
- },
672
- },
673
- {
674
- id: "cogito-2.1:671b",
675
- name: "cogito-2.1:671b",
676
39
  reasoning: true,
677
40
  thinkingLevelMap: {
678
- off: "none",
679
- minimal: null,
41
+ high: "high",
680
42
  low: "low",
681
43
  medium: "medium",
682
- high: "high",
44
+ minimal: null,
45
+ off: "none",
683
46
  xhigh: "max",
684
47
  },
685
- input: ["text"],
686
- cost: {
687
- input: 0,
688
- output: 0,
689
- cacheRead: 0,
690
- cacheWrite: 0,
691
- },
692
- contextWindow: 163840,
693
- maxTokens: 32768,
48
+ },
49
+ {
50
+ id: "deepseek-v4-pro",
51
+ name: "deepseek-v4-pro",
694
52
  compat: {
695
- supportsDeveloperRole: false,
696
- supportsReasoningEffort: true,
697
- supportsStore: false,
698
53
  maxTokensField: "max_tokens",
699
- supportsUsageInStreaming: true,
700
- requiresToolResultName: false,
54
+ openRouterRouting: {},
701
55
  requiresAssistantAfterToolResult: false,
702
- requiresThinkingAsText: false,
703
56
  requiresReasoningContentOnAssistantMessages: false,
704
- thinkingFormat: "openai",
705
- supportsStrictMode: false,
57
+ requiresThinkingAsText: false,
58
+ requiresToolResultName: false,
706
59
  sendSessionAffinityHeaders: false,
60
+ supportsDeveloperRole: false,
707
61
  supportsLongCacheRetention: false,
708
- zaiToolStream: false,
709
- openRouterRouting: {},
62
+ supportsReasoningEffort: true,
63
+ supportsStore: false,
64
+ supportsStrictMode: false,
65
+ supportsUsageInStreaming: true,
66
+ thinkingFormat: "openai",
710
67
  vercelGatewayRouting: {},
68
+ zaiToolStream: false,
711
69
  },
712
- },
713
- {
714
- id: "glm-5",
715
- name: "glm-5",
70
+ contextWindow: 524288,
71
+ cost: {
72
+ cacheRead: 0.003625,
73
+ cacheWrite: 0,
74
+ input: 0.435,
75
+ output: 0.87,
76
+ },
77
+ input: ["text"],
78
+ maxTokens: 32768,
716
79
  reasoning: true,
717
80
  thinkingLevelMap: {
718
- off: "none",
719
- minimal: null,
81
+ high: "high",
720
82
  low: "low",
721
83
  medium: "medium",
722
- high: "high",
84
+ minimal: null,
85
+ off: "none",
723
86
  xhigh: "max",
724
87
  },
725
- input: ["text"],
726
- cost: {
727
- input: 0,
728
- output: 0,
729
- cacheRead: 0,
730
- cacheWrite: 0,
731
- },
732
- contextWindow: 202752,
733
- maxTokens: 32768,
88
+ },
89
+ {
90
+ id: "gemma4:31b",
91
+ name: "gemma4:31b",
734
92
  compat: {
735
- supportsDeveloperRole: false,
736
- supportsReasoningEffort: true,
737
- supportsStore: false,
738
93
  maxTokensField: "max_tokens",
739
- supportsUsageInStreaming: true,
740
- requiresToolResultName: false,
94
+ openRouterRouting: {},
741
95
  requiresAssistantAfterToolResult: false,
742
- requiresThinkingAsText: false,
743
96
  requiresReasoningContentOnAssistantMessages: false,
744
- thinkingFormat: "openai",
745
- supportsStrictMode: false,
97
+ requiresThinkingAsText: false,
98
+ requiresToolResultName: false,
746
99
  sendSessionAffinityHeaders: false,
100
+ supportsDeveloperRole: false,
747
101
  supportsLongCacheRetention: false,
748
- zaiToolStream: false,
749
- openRouterRouting: {},
102
+ supportsReasoningEffort: true,
103
+ supportsStore: false,
104
+ supportsStrictMode: false,
105
+ supportsUsageInStreaming: true,
106
+ thinkingFormat: "openai",
750
107
  vercelGatewayRouting: {},
108
+ zaiToolStream: false,
751
109
  },
752
- },
753
- {
754
- id: "nemotron-3-nano:30b",
755
- name: "nemotron-3-nano:30b",
110
+ contextWindow: 262144,
111
+ cost: {
112
+ cacheRead: 0.12,
113
+ cacheWrite: 0,
114
+ input: 0.22,
115
+ output: 0.55,
116
+ },
117
+ input: ["text", "image"],
118
+ maxTokens: 32768,
756
119
  reasoning: true,
757
120
  thinkingLevelMap: {
758
- off: "none",
759
- minimal: null,
121
+ high: "high",
760
122
  low: "low",
761
123
  medium: "medium",
762
- high: "high",
124
+ minimal: null,
125
+ off: "none",
763
126
  xhigh: "max",
764
127
  },
765
- input: ["text"],
766
- cost: {
767
- input: 0,
768
- output: 0,
769
- cacheRead: 0,
770
- cacheWrite: 0,
771
- },
772
- contextWindow: 262144,
773
- maxTokens: 32768,
128
+ },
129
+ {
130
+ id: "glm-5.1",
131
+ name: "glm-5.1",
774
132
  compat: {
775
- supportsDeveloperRole: false,
776
- supportsReasoningEffort: true,
777
- supportsStore: false,
778
133
  maxTokensField: "max_tokens",
779
- supportsUsageInStreaming: true,
780
- requiresToolResultName: false,
134
+ openRouterRouting: {},
781
135
  requiresAssistantAfterToolResult: false,
782
- requiresThinkingAsText: false,
783
136
  requiresReasoningContentOnAssistantMessages: false,
784
- thinkingFormat: "openai",
785
- supportsStrictMode: false,
137
+ requiresThinkingAsText: false,
138
+ requiresToolResultName: false,
786
139
  sendSessionAffinityHeaders: false,
140
+ supportsDeveloperRole: false,
787
141
  supportsLongCacheRetention: false,
788
- zaiToolStream: false,
789
- openRouterRouting: {},
142
+ supportsReasoningEffort: true,
143
+ supportsStore: false,
144
+ supportsStrictMode: false,
145
+ supportsUsageInStreaming: true,
146
+ thinkingFormat: "openai",
790
147
  vercelGatewayRouting: {},
148
+ zaiToolStream: false,
791
149
  },
792
- },
793
- {
794
- id: "minimax-m2.7",
795
- name: "minimax-m2.7",
150
+ contextWindow: 202752,
151
+ cost: {
152
+ cacheRead: 0.26,
153
+ cacheWrite: 0,
154
+ input: 1.4,
155
+ output: 4.4,
156
+ },
157
+ input: ["text"],
158
+ maxTokens: 32768,
796
159
  reasoning: true,
797
160
  thinkingLevelMap: {
798
- off: null,
799
- minimal: null,
161
+ high: "high",
800
162
  low: "low",
801
163
  medium: "medium",
802
- high: "high",
164
+ minimal: null,
165
+ off: "none",
803
166
  xhigh: "max",
804
167
  },
805
- input: ["text"],
806
- cost: {
807
- input: 0,
808
- output: 0,
809
- cacheRead: 0,
810
- cacheWrite: 0,
811
- },
812
- contextWindow: 196608,
813
- maxTokens: 32768,
168
+ },
169
+ {
170
+ id: "glm-5.2",
171
+ name: "glm-5.2",
814
172
  compat: {
815
- supportsDeveloperRole: false,
816
- supportsReasoningEffort: true,
817
- supportsStore: false,
818
173
  maxTokensField: "max_tokens",
819
- supportsUsageInStreaming: true,
820
- requiresToolResultName: false,
174
+ openRouterRouting: {},
821
175
  requiresAssistantAfterToolResult: false,
822
- requiresThinkingAsText: false,
823
176
  requiresReasoningContentOnAssistantMessages: false,
824
- thinkingFormat: "openai",
825
- supportsStrictMode: false,
177
+ requiresThinkingAsText: false,
178
+ requiresToolResultName: false,
826
179
  sendSessionAffinityHeaders: false,
180
+ supportsDeveloperRole: false,
827
181
  supportsLongCacheRetention: false,
828
- zaiToolStream: false,
829
- openRouterRouting: {},
182
+ supportsReasoningEffort: true,
183
+ supportsStore: false,
184
+ supportsStrictMode: false,
185
+ supportsUsageInStreaming: true,
186
+ thinkingFormat: "openai",
830
187
  vercelGatewayRouting: {},
188
+ zaiToolStream: false,
831
189
  },
832
- },
833
- {
834
- id: "mistral-large-3:675b",
835
- name: "mistral-large-3:675b",
836
- reasoning: false,
837
- input: ["text", "image"],
190
+ contextWindow: 1000000,
838
191
  cost: {
839
- input: 0,
840
- output: 0,
841
- cacheRead: 0,
192
+ cacheRead: 0.26,
842
193
  cacheWrite: 0,
194
+ input: 1.4,
195
+ output: 4.4,
843
196
  },
844
- contextWindow: 262144,
197
+ input: ["text"],
845
198
  maxTokens: 32768,
199
+ reasoning: true,
200
+ thinkingLevelMap: {
201
+ high: "high",
202
+ low: null,
203
+ medium: null,
204
+ minimal: null,
205
+ off: "none",
206
+ xhigh: "max",
207
+ },
208
+ },
209
+ {
210
+ id: "gpt-oss:120b",
211
+ name: "gpt-oss:120b",
846
212
  compat: {
847
- supportsDeveloperRole: false,
848
- supportsReasoningEffort: true,
849
- supportsStore: false,
850
213
  maxTokensField: "max_tokens",
851
- supportsUsageInStreaming: true,
852
- requiresToolResultName: false,
214
+ openRouterRouting: {},
853
215
  requiresAssistantAfterToolResult: false,
854
- requiresThinkingAsText: false,
855
216
  requiresReasoningContentOnAssistantMessages: false,
856
- thinkingFormat: "openai",
857
- supportsStrictMode: false,
217
+ requiresThinkingAsText: false,
218
+ requiresToolResultName: false,
858
219
  sendSessionAffinityHeaders: false,
220
+ supportsDeveloperRole: false,
859
221
  supportsLongCacheRetention: false,
860
- zaiToolStream: false,
861
- openRouterRouting: {},
222
+ supportsReasoningEffort: true,
223
+ supportsStore: false,
224
+ supportsStrictMode: false,
225
+ supportsUsageInStreaming: true,
226
+ thinkingFormat: "openai",
862
227
  vercelGatewayRouting: {},
228
+ zaiToolStream: false,
863
229
  },
864
- },
865
- {
866
- id: "devstral-2:123b",
867
- name: "devstral-2:123b",
868
- reasoning: false,
869
- input: ["text"],
230
+ contextWindow: 131072,
870
231
  cost: {
871
- input: 0,
872
- output: 0,
873
232
  cacheRead: 0,
874
233
  cacheWrite: 0,
234
+ input: 0.037,
235
+ output: 0.17,
875
236
  },
876
- contextWindow: 262144,
237
+ input: ["text"],
877
238
  maxTokens: 32768,
239
+ reasoning: true,
240
+ thinkingLevelMap: {
241
+ high: "high",
242
+ low: "low",
243
+ medium: "medium",
244
+ minimal: null,
245
+ off: null,
246
+ xhigh: null,
247
+ },
248
+ },
249
+ {
250
+ id: "gpt-oss:20b",
251
+ name: "gpt-oss:20b",
878
252
  compat: {
879
- supportsDeveloperRole: false,
880
- supportsReasoningEffort: true,
881
- supportsStore: false,
882
253
  maxTokensField: "max_tokens",
883
- supportsUsageInStreaming: true,
884
- requiresToolResultName: false,
254
+ openRouterRouting: {},
885
255
  requiresAssistantAfterToolResult: false,
886
- requiresThinkingAsText: false,
887
256
  requiresReasoningContentOnAssistantMessages: false,
888
- thinkingFormat: "openai",
889
- supportsStrictMode: false,
257
+ requiresThinkingAsText: false,
258
+ requiresToolResultName: false,
890
259
  sendSessionAffinityHeaders: false,
260
+ supportsDeveloperRole: false,
891
261
  supportsLongCacheRetention: false,
892
- zaiToolStream: false,
893
- openRouterRouting: {},
262
+ supportsReasoningEffort: true,
263
+ supportsStore: false,
264
+ supportsStrictMode: false,
265
+ supportsUsageInStreaming: true,
266
+ thinkingFormat: "openai",
894
267
  vercelGatewayRouting: {},
268
+ zaiToolStream: false,
895
269
  },
896
- },
897
- {
898
- id: "qwen3-coder-next",
899
- name: "qwen3-coder-next",
900
- reasoning: false,
901
- input: ["text"],
270
+ contextWindow: 131072,
902
271
  cost: {
903
- input: 0,
904
- output: 0,
905
- cacheRead: 0,
272
+ cacheRead: 0.03,
906
273
  cacheWrite: 0,
274
+ input: 0.03,
275
+ output: 0.13,
907
276
  },
908
- contextWindow: 262144,
277
+ input: ["text"],
909
278
  maxTokens: 32768,
279
+ reasoning: true,
280
+ thinkingLevelMap: {
281
+ high: "high",
282
+ low: "low",
283
+ medium: "medium",
284
+ minimal: null,
285
+ off: null,
286
+ xhigh: null,
287
+ },
288
+ },
289
+ {
290
+ id: "kimi-k2.5",
291
+ name: "kimi-k2.5",
910
292
  compat: {
911
- supportsDeveloperRole: false,
912
- supportsReasoningEffort: true,
913
- supportsStore: false,
914
293
  maxTokensField: "max_tokens",
915
- supportsUsageInStreaming: true,
916
- requiresToolResultName: false,
294
+ openRouterRouting: {},
917
295
  requiresAssistantAfterToolResult: false,
918
- requiresThinkingAsText: false,
919
296
  requiresReasoningContentOnAssistantMessages: false,
920
- thinkingFormat: "openai",
921
- supportsStrictMode: false,
297
+ requiresThinkingAsText: false,
298
+ requiresToolResultName: false,
922
299
  sendSessionAffinityHeaders: false,
300
+ supportsDeveloperRole: false,
923
301
  supportsLongCacheRetention: false,
924
- zaiToolStream: false,
925
- openRouterRouting: {},
302
+ supportsReasoningEffort: true,
303
+ supportsStore: false,
304
+ supportsStrictMode: false,
305
+ supportsUsageInStreaming: true,
306
+ thinkingFormat: "openai",
926
307
  vercelGatewayRouting: {},
308
+ zaiToolStream: false,
927
309
  },
928
- },
929
- {
930
- id: "deepseek-v4-flash",
931
- name: "deepseek-v4-flash",
310
+ contextWindow: 262144,
311
+ cost: {
312
+ cacheRead: 0.1,
313
+ cacheWrite: 0,
314
+ input: 0.6,
315
+ output: 3,
316
+ },
317
+ input: ["text", "image"],
318
+ maxTokens: 32768,
932
319
  reasoning: true,
933
320
  thinkingLevelMap: {
934
- off: "none",
935
- minimal: null,
321
+ high: "high",
936
322
  low: "low",
937
323
  medium: "medium",
938
- high: "high",
324
+ minimal: null,
325
+ off: "none",
939
326
  xhigh: "max",
940
327
  },
941
- input: ["text"],
942
- cost: {
943
- input: 0,
944
- output: 0,
945
- cacheRead: 0,
946
- cacheWrite: 0,
947
- },
948
- contextWindow: 1048576,
949
- maxTokens: 32768,
328
+ },
329
+ {
330
+ id: "kimi-k2.6",
331
+ name: "kimi-k2.6",
950
332
  compat: {
951
- supportsDeveloperRole: false,
952
- supportsReasoningEffort: true,
953
- supportsStore: false,
954
333
  maxTokensField: "max_tokens",
955
- supportsUsageInStreaming: true,
956
- requiresToolResultName: false,
334
+ openRouterRouting: {},
957
335
  requiresAssistantAfterToolResult: false,
958
- requiresThinkingAsText: false,
959
336
  requiresReasoningContentOnAssistantMessages: false,
960
- thinkingFormat: "openai",
961
- supportsStrictMode: false,
337
+ requiresThinkingAsText: false,
338
+ requiresToolResultName: false,
962
339
  sendSessionAffinityHeaders: false,
340
+ supportsDeveloperRole: false,
963
341
  supportsLongCacheRetention: false,
964
- zaiToolStream: false,
965
- openRouterRouting: {},
342
+ supportsReasoningEffort: true,
343
+ supportsStore: false,
344
+ supportsStrictMode: false,
345
+ supportsUsageInStreaming: true,
346
+ thinkingFormat: "openai",
966
347
  vercelGatewayRouting: {},
348
+ zaiToolStream: false,
967
349
  },
968
- },
969
- {
970
- id: "minimax-m2.1",
971
- name: "minimax-m2.1",
350
+ contextWindow: 262144,
351
+ cost: {
352
+ cacheRead: 0.16,
353
+ cacheWrite: 0,
354
+ input: 0.95,
355
+ output: 4,
356
+ },
357
+ input: ["text", "image"],
358
+ maxTokens: 32768,
972
359
  reasoning: true,
973
360
  thinkingLevelMap: {
974
- off: null,
975
- minimal: null,
361
+ high: "high",
976
362
  low: "low",
977
363
  medium: "medium",
978
- high: "high",
364
+ minimal: null,
365
+ off: "none",
979
366
  xhigh: "max",
980
367
  },
981
- input: ["text"],
982
- cost: {
983
- input: 0,
984
- output: 0,
985
- cacheRead: 0,
986
- cacheWrite: 0,
987
- },
988
- contextWindow: 204800,
989
- maxTokens: 32768,
368
+ },
369
+ {
370
+ id: "kimi-k2.7-code",
371
+ name: "kimi-k2.7-code",
990
372
  compat: {
991
- supportsDeveloperRole: false,
992
- supportsReasoningEffort: true,
993
- supportsStore: false,
994
373
  maxTokensField: "max_tokens",
995
- supportsUsageInStreaming: true,
996
- requiresToolResultName: false,
374
+ openRouterRouting: {},
997
375
  requiresAssistantAfterToolResult: false,
998
- requiresThinkingAsText: false,
999
376
  requiresReasoningContentOnAssistantMessages: false,
1000
- thinkingFormat: "openai",
1001
- supportsStrictMode: false,
377
+ requiresThinkingAsText: false,
378
+ requiresToolResultName: false,
1002
379
  sendSessionAffinityHeaders: false,
380
+ supportsDeveloperRole: false,
1003
381
  supportsLongCacheRetention: false,
1004
- zaiToolStream: false,
1005
- openRouterRouting: {},
382
+ supportsReasoningEffort: true,
383
+ supportsStore: false,
384
+ supportsStrictMode: false,
385
+ supportsUsageInStreaming: true,
386
+ thinkingFormat: "openai",
1006
387
  vercelGatewayRouting: {},
388
+ zaiToolStream: false,
1007
389
  },
1008
- },
1009
- {
1010
- id: "nemotron-3-super",
1011
- name: "nemotron-3-super",
390
+ contextWindow: 262144,
391
+ cost: {
392
+ cacheRead: 0.19,
393
+ cacheWrite: 0,
394
+ input: 0.95,
395
+ output: 4,
396
+ },
397
+ input: ["text", "image"],
398
+ maxTokens: 32768,
1012
399
  reasoning: true,
1013
400
  thinkingLevelMap: {
1014
- off: "none",
1015
- minimal: null,
401
+ high: "high",
1016
402
  low: "low",
1017
403
  medium: "medium",
1018
- high: "high",
404
+ minimal: null,
405
+ off: "none",
1019
406
  xhigh: "max",
1020
407
  },
1021
- input: ["text"],
1022
- cost: {
1023
- input: 0,
1024
- output: 0,
1025
- cacheRead: 0,
1026
- cacheWrite: 0,
1027
- },
1028
- contextWindow: 262144,
1029
- maxTokens: 32768,
408
+ },
409
+ {
410
+ id: "minimax-m2.5",
411
+ name: "minimax-m2.5",
1030
412
  compat: {
1031
- supportsDeveloperRole: false,
1032
- supportsReasoningEffort: true,
1033
- supportsStore: false,
1034
413
  maxTokensField: "max_tokens",
1035
- supportsUsageInStreaming: true,
1036
- requiresToolResultName: false,
414
+ openRouterRouting: {},
1037
415
  requiresAssistantAfterToolResult: false,
1038
- requiresThinkingAsText: false,
1039
416
  requiresReasoningContentOnAssistantMessages: false,
1040
- thinkingFormat: "openai",
1041
- supportsStrictMode: false,
417
+ requiresThinkingAsText: false,
418
+ requiresToolResultName: false,
1042
419
  sendSessionAffinityHeaders: false,
420
+ supportsDeveloperRole: false,
1043
421
  supportsLongCacheRetention: false,
1044
- zaiToolStream: false,
1045
- openRouterRouting: {},
422
+ supportsReasoningEffort: true,
423
+ supportsStore: false,
424
+ supportsStrictMode: false,
425
+ supportsUsageInStreaming: true,
426
+ thinkingFormat: "openai",
1046
427
  vercelGatewayRouting: {},
428
+ zaiToolStream: false,
1047
429
  },
1048
- },
1049
- {
1050
- id: "deepseek-v3.1:671b",
1051
- name: "deepseek-v3.1:671b",
430
+ contextWindow: 196608,
431
+ cost: {
432
+ cacheRead: 0.03,
433
+ cacheWrite: 0.375,
434
+ input: 0.3,
435
+ output: 1.2,
436
+ },
437
+ input: ["text"],
438
+ maxTokens: 32768,
1052
439
  reasoning: true,
1053
440
  thinkingLevelMap: {
1054
- off: "none",
1055
- minimal: null,
441
+ high: "high",
1056
442
  low: "low",
1057
443
  medium: "medium",
1058
- high: "high",
444
+ minimal: null,
445
+ off: null,
1059
446
  xhigh: "max",
1060
447
  },
1061
- input: ["text"],
1062
- cost: {
1063
- input: 0,
1064
- output: 0,
1065
- cacheRead: 0,
1066
- cacheWrite: 0,
1067
- },
1068
- contextWindow: 163840,
1069
- maxTokens: 32768,
448
+ },
449
+ {
450
+ id: "minimax-m2.7",
451
+ name: "minimax-m2.7",
1070
452
  compat: {
1071
- supportsDeveloperRole: false,
1072
- supportsReasoningEffort: true,
1073
- supportsStore: false,
1074
453
  maxTokensField: "max_tokens",
1075
- supportsUsageInStreaming: true,
1076
- requiresToolResultName: false,
454
+ openRouterRouting: {},
1077
455
  requiresAssistantAfterToolResult: false,
1078
- requiresThinkingAsText: false,
1079
456
  requiresReasoningContentOnAssistantMessages: false,
1080
- thinkingFormat: "openai",
1081
- supportsStrictMode: false,
457
+ requiresThinkingAsText: false,
458
+ requiresToolResultName: false,
1082
459
  sendSessionAffinityHeaders: false,
460
+ supportsDeveloperRole: false,
1083
461
  supportsLongCacheRetention: false,
1084
- zaiToolStream: false,
1085
- openRouterRouting: {},
462
+ supportsReasoningEffort: true,
463
+ supportsStore: false,
464
+ supportsStrictMode: false,
465
+ supportsUsageInStreaming: true,
466
+ thinkingFormat: "openai",
1086
467
  vercelGatewayRouting: {},
468
+ zaiToolStream: false,
1087
469
  },
1088
- },
1089
- {
1090
- id: "minimax-m2.5",
1091
- name: "minimax-m2.5",
470
+ contextWindow: 196608,
471
+ cost: {
472
+ cacheRead: 0.06,
473
+ cacheWrite: 0.375,
474
+ input: 0.3,
475
+ output: 1.2,
476
+ },
477
+ input: ["text"],
478
+ maxTokens: 32768,
1092
479
  reasoning: true,
1093
480
  thinkingLevelMap: {
1094
- off: null,
1095
- minimal: null,
481
+ high: "high",
1096
482
  low: "low",
1097
483
  medium: "medium",
1098
- high: "high",
484
+ minimal: null,
485
+ off: null,
1099
486
  xhigh: "max",
1100
487
  },
1101
- input: ["text"],
1102
- cost: {
1103
- input: 0,
1104
- output: 0,
1105
- cacheRead: 0,
1106
- cacheWrite: 0,
1107
- },
1108
- contextWindow: 196608,
1109
- maxTokens: 32768,
488
+ },
489
+ {
490
+ id: "minimax-m3",
491
+ name: "minimax-m3",
1110
492
  compat: {
1111
- supportsDeveloperRole: false,
1112
- supportsReasoningEffort: true,
1113
- supportsStore: false,
1114
493
  maxTokensField: "max_tokens",
1115
- supportsUsageInStreaming: true,
1116
- requiresToolResultName: false,
494
+ openRouterRouting: {},
1117
495
  requiresAssistantAfterToolResult: false,
1118
- requiresThinkingAsText: false,
1119
496
  requiresReasoningContentOnAssistantMessages: false,
1120
- thinkingFormat: "openai",
1121
- supportsStrictMode: false,
497
+ requiresThinkingAsText: false,
498
+ requiresToolResultName: false,
1122
499
  sendSessionAffinityHeaders: false,
500
+ supportsDeveloperRole: false,
1123
501
  supportsLongCacheRetention: false,
1124
- zaiToolStream: false,
1125
- openRouterRouting: {},
502
+ supportsReasoningEffort: true,
503
+ supportsStore: false,
504
+ supportsStrictMode: false,
505
+ supportsUsageInStreaming: true,
506
+ thinkingFormat: "openai",
1126
507
  vercelGatewayRouting: {},
508
+ zaiToolStream: false,
1127
509
  },
1128
- },
1129
- {
1130
- id: "glm-4.6",
1131
- name: "glm-4.6",
510
+ contextWindow: 524288,
511
+ cost: {
512
+ cacheRead: 0.06,
513
+ cacheWrite: 0,
514
+ input: 0.3,
515
+ output: 1.2,
516
+ },
517
+ input: ["text", "image"],
518
+ maxTokens: 32768,
1132
519
  reasoning: true,
1133
520
  thinkingLevelMap: {
1134
- off: "none",
1135
- minimal: null,
521
+ high: "high",
1136
522
  low: "low",
1137
523
  medium: "medium",
1138
- high: "high",
524
+ minimal: null,
525
+ off: null,
1139
526
  xhigh: "max",
1140
527
  },
1141
- input: ["text"],
1142
- cost: {
1143
- input: 0,
1144
- output: 0,
1145
- cacheRead: 0,
1146
- cacheWrite: 0,
1147
- },
1148
- contextWindow: 202752,
1149
- maxTokens: 32768,
528
+ },
529
+ {
530
+ id: "mistral-large-3:675b",
531
+ name: "mistral-large-3:675b",
1150
532
  compat: {
1151
- supportsDeveloperRole: false,
1152
- supportsReasoningEffort: true,
1153
- supportsStore: false,
1154
533
  maxTokensField: "max_tokens",
1155
- supportsUsageInStreaming: true,
1156
- requiresToolResultName: false,
534
+ openRouterRouting: {},
1157
535
  requiresAssistantAfterToolResult: false,
1158
- requiresThinkingAsText: false,
1159
536
  requiresReasoningContentOnAssistantMessages: false,
1160
- thinkingFormat: "openai",
1161
- supportsStrictMode: false,
537
+ requiresThinkingAsText: false,
538
+ requiresToolResultName: false,
1162
539
  sendSessionAffinityHeaders: false,
540
+ supportsDeveloperRole: false,
1163
541
  supportsLongCacheRetention: false,
1164
- zaiToolStream: false,
1165
- openRouterRouting: {},
542
+ supportsReasoningEffort: true,
543
+ supportsStore: false,
544
+ supportsStrictMode: false,
545
+ supportsUsageInStreaming: true,
546
+ thinkingFormat: "openai",
1166
547
  vercelGatewayRouting: {},
548
+ zaiToolStream: false,
1167
549
  },
1168
- },
1169
- {
1170
- id: "kimi-k2.5",
1171
- name: "kimi-k2.5",
1172
- reasoning: true,
1173
- thinkingLevelMap: {
1174
- off: "none",
1175
- minimal: null,
1176
- low: "low",
1177
- medium: "medium",
1178
- high: "high",
1179
- xhigh: "max",
1180
- },
1181
- input: ["text", "image"],
550
+ contextWindow: 262144,
1182
551
  cost: {
1183
- input: 0,
1184
- output: 0,
1185
552
  cacheRead: 0,
1186
553
  cacheWrite: 0,
554
+ input: 0.5,
555
+ output: 1.5,
1187
556
  },
1188
- contextWindow: 262144,
557
+ input: ["text", "image"],
1189
558
  maxTokens: 32768,
559
+ reasoning: false,
560
+ },
561
+ {
562
+ id: "nemotron-3-nano:30b",
563
+ name: "nemotron-3-nano:30b",
1190
564
  compat: {
1191
- supportsDeveloperRole: false,
1192
- supportsReasoningEffort: true,
1193
- supportsStore: false,
1194
565
  maxTokensField: "max_tokens",
1195
- supportsUsageInStreaming: true,
1196
- requiresToolResultName: false,
566
+ openRouterRouting: {},
1197
567
  requiresAssistantAfterToolResult: false,
1198
- requiresThinkingAsText: false,
1199
568
  requiresReasoningContentOnAssistantMessages: false,
1200
- thinkingFormat: "openai",
1201
- supportsStrictMode: false,
569
+ requiresThinkingAsText: false,
570
+ requiresToolResultName: false,
1202
571
  sendSessionAffinityHeaders: false,
572
+ supportsDeveloperRole: false,
1203
573
  supportsLongCacheRetention: false,
1204
- zaiToolStream: false,
1205
- openRouterRouting: {},
574
+ supportsReasoningEffort: true,
575
+ supportsStore: false,
576
+ supportsStrictMode: false,
577
+ supportsUsageInStreaming: true,
578
+ thinkingFormat: "openai",
1206
579
  vercelGatewayRouting: {},
580
+ zaiToolStream: false,
1207
581
  },
1208
- },
1209
- {
1210
- id: "kimi-k2.6",
1211
- name: "kimi-k2.6",
582
+ contextWindow: 262144,
583
+ cost: {
584
+ cacheRead: 0,
585
+ cacheWrite: 0,
586
+ input: 0.05,
587
+ output: 0.2,
588
+ },
589
+ input: ["text"],
590
+ maxTokens: 32768,
1212
591
  reasoning: true,
1213
592
  thinkingLevelMap: {
1214
- off: "none",
1215
- minimal: null,
593
+ high: "high",
1216
594
  low: "low",
1217
595
  medium: "medium",
1218
- high: "high",
596
+ minimal: null,
597
+ off: "none",
1219
598
  xhigh: "max",
1220
599
  },
1221
- input: ["text", "image"],
1222
- cost: {
1223
- input: 0,
1224
- output: 0,
1225
- cacheRead: 0,
1226
- cacheWrite: 0,
1227
- },
1228
- contextWindow: 262144,
1229
- maxTokens: 32768,
600
+ },
601
+ {
602
+ id: "nemotron-3-super",
603
+ name: "nemotron-3-super",
1230
604
  compat: {
1231
- supportsDeveloperRole: false,
1232
- supportsReasoningEffort: true,
1233
- supportsStore: false,
1234
605
  maxTokensField: "max_tokens",
1235
- supportsUsageInStreaming: true,
1236
- requiresToolResultName: false,
606
+ openRouterRouting: {},
1237
607
  requiresAssistantAfterToolResult: false,
1238
- requiresThinkingAsText: false,
1239
608
  requiresReasoningContentOnAssistantMessages: false,
1240
- thinkingFormat: "openai",
1241
- supportsStrictMode: false,
609
+ requiresThinkingAsText: false,
610
+ requiresToolResultName: false,
1242
611
  sendSessionAffinityHeaders: false,
612
+ supportsDeveloperRole: false,
1243
613
  supportsLongCacheRetention: false,
1244
- zaiToolStream: false,
1245
- openRouterRouting: {},
614
+ supportsReasoningEffort: true,
615
+ supportsStore: false,
616
+ supportsStrictMode: false,
617
+ supportsUsageInStreaming: true,
618
+ thinkingFormat: "openai",
1246
619
  vercelGatewayRouting: {},
620
+ zaiToolStream: false,
1247
621
  },
1248
- },
1249
- {
1250
- id: "qwen3-coder:480b",
1251
- name: "qwen3-coder:480b",
1252
- reasoning: false,
1253
- input: ["text"],
622
+ contextWindow: 262144,
1254
623
  cost: {
1255
- input: 0,
1256
- output: 0,
1257
624
  cacheRead: 0,
1258
625
  cacheWrite: 0,
626
+ input: 0.2,
627
+ output: 0.8,
1259
628
  },
1260
- contextWindow: 262144,
629
+ input: ["text"],
1261
630
  maxTokens: 32768,
631
+ reasoning: true,
632
+ thinkingLevelMap: {
633
+ high: "high",
634
+ low: "low",
635
+ medium: "medium",
636
+ minimal: null,
637
+ off: "none",
638
+ xhigh: "max",
639
+ },
640
+ },
641
+ {
642
+ id: "nemotron-3-ultra",
643
+ name: "nemotron-3-ultra",
1262
644
  compat: {
1263
- supportsDeveloperRole: false,
1264
- supportsReasoningEffort: true,
1265
- supportsStore: false,
1266
645
  maxTokensField: "max_tokens",
1267
- supportsUsageInStreaming: true,
1268
- requiresToolResultName: false,
646
+ openRouterRouting: {},
1269
647
  requiresAssistantAfterToolResult: false,
1270
- requiresThinkingAsText: false,
1271
648
  requiresReasoningContentOnAssistantMessages: false,
1272
- thinkingFormat: "openai",
1273
- supportsStrictMode: false,
649
+ requiresThinkingAsText: false,
650
+ requiresToolResultName: false,
1274
651
  sendSessionAffinityHeaders: false,
652
+ supportsDeveloperRole: false,
1275
653
  supportsLongCacheRetention: false,
1276
- zaiToolStream: false,
1277
- openRouterRouting: {},
654
+ supportsReasoningEffort: true,
655
+ supportsStore: false,
656
+ supportsStrictMode: false,
657
+ supportsUsageInStreaming: true,
658
+ thinkingFormat: "openai",
1278
659
  vercelGatewayRouting: {},
660
+ zaiToolStream: false,
1279
661
  },
1280
- },
1281
- {
1282
- id: "gpt-oss:120b",
1283
- name: "gpt-oss:120b",
662
+ contextWindow: 262144,
663
+ cost: {
664
+ cacheRead: 0.15,
665
+ cacheWrite: 0,
666
+ input: 0.5,
667
+ output: 2.5,
668
+ },
669
+ input: ["text"],
670
+ maxTokens: 32768,
1284
671
  reasoning: true,
1285
672
  thinkingLevelMap: {
1286
- off: null,
1287
- minimal: null,
673
+ high: "high",
1288
674
  low: "low",
1289
675
  medium: "medium",
1290
- high: "high",
1291
- xhigh: null,
1292
- },
1293
- input: ["text"],
1294
- cost: {
1295
- input: 0,
1296
- output: 0,
1297
- cacheRead: 0,
1298
- cacheWrite: 0,
676
+ minimal: null,
677
+ off: "none",
678
+ xhigh: "max",
1299
679
  },
1300
- contextWindow: 131072,
1301
- maxTokens: 32768,
680
+ },
681
+ {
682
+ id: "qwen3.5:397b",
683
+ name: "qwen3.5:397b",
1302
684
  compat: {
1303
- supportsDeveloperRole: false,
1304
- supportsReasoningEffort: true,
1305
- supportsStore: false,
1306
685
  maxTokensField: "max_tokens",
1307
- supportsUsageInStreaming: true,
1308
- requiresToolResultName: false,
686
+ openRouterRouting: {},
1309
687
  requiresAssistantAfterToolResult: false,
1310
- requiresThinkingAsText: false,
1311
688
  requiresReasoningContentOnAssistantMessages: false,
1312
- thinkingFormat: "openai",
1313
- supportsStrictMode: false,
689
+ requiresThinkingAsText: false,
690
+ requiresToolResultName: false,
1314
691
  sendSessionAffinityHeaders: false,
692
+ supportsDeveloperRole: false,
1315
693
  supportsLongCacheRetention: false,
1316
- zaiToolStream: false,
1317
- openRouterRouting: {},
694
+ supportsReasoningEffort: true,
695
+ supportsStore: false,
696
+ supportsStrictMode: false,
697
+ supportsUsageInStreaming: true,
698
+ thinkingFormat: "openai",
1318
699
  vercelGatewayRouting: {},
700
+ zaiToolStream: false,
1319
701
  },
1320
- },
1321
- {
1322
- id: "ministral-3:8b",
1323
- name: "ministral-3:8b",
1324
- reasoning: false,
1325
- input: ["text", "image"],
702
+ contextWindow: 262144,
1326
703
  cost: {
1327
- input: 0,
1328
- output: 0,
1329
704
  cacheRead: 0,
1330
705
  cacheWrite: 0,
706
+ input: 0.6,
707
+ output: 3.6,
1331
708
  },
1332
- contextWindow: 262144,
709
+ input: ["text", "image"],
1333
710
  maxTokens: 32768,
1334
- compat: {
1335
- supportsDeveloperRole: false,
1336
- supportsReasoningEffort: true,
1337
- supportsStore: false,
1338
- maxTokensField: "max_tokens",
1339
- supportsUsageInStreaming: true,
1340
- requiresToolResultName: false,
1341
- requiresAssistantAfterToolResult: false,
1342
- requiresThinkingAsText: false,
1343
- requiresReasoningContentOnAssistantMessages: false,
1344
- thinkingFormat: "openai",
1345
- supportsStrictMode: false,
1346
- sendSessionAffinityHeaders: false,
1347
- supportsLongCacheRetention: false,
1348
- zaiToolStream: false,
1349
- openRouterRouting: {},
1350
- vercelGatewayRouting: {},
711
+ reasoning: true,
712
+ thinkingLevelMap: {
713
+ high: null,
714
+ low: null,
715
+ medium: "medium",
716
+ minimal: null,
717
+ off: "none",
718
+ xhigh: null,
1351
719
  },
1352
720
  },
1353
721
  ];