@mastra/mcp-docs-server 1.2.26-alpha.3 → 1.2.26-alpha.8

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (50) hide show
  1. package/.docs/docs/agents/overview.md +1 -1
  2. package/.docs/docs/agents/processors.md +21 -0
  3. package/.docs/docs/deployment/mastra-server.md +8 -2
  4. package/.docs/docs/guides/context-engineering.md +1 -1
  5. package/.docs/docs/harness/background-tasks.md +30 -24
  6. package/.docs/docs/harness/signals.md +39 -0
  7. package/.docs/docs/index.md +1 -1
  8. package/.docs/docs/memory/message-history.md +5 -1
  9. package/.docs/integrations/agentic-ui/ai-sdk-ui.md +7 -0
  10. package/.docs/integrations/file-storage/archil.md +3 -3
  11. package/.docs/integrations/frameworks/electron.md +1 -1
  12. package/.docs/integrations/sandboxes/cloudflare-sandbox.md +2 -0
  13. package/.docs/integrations/sandboxes/docker.md +13 -0
  14. package/.docs/models/gateways/merge-gateway.md +6 -1
  15. package/.docs/models/gateways/netlify.md +4 -1
  16. package/.docs/models/gateways/openrouter.md +10 -2
  17. package/.docs/models/index.md +1 -1
  18. package/.docs/models/providers/above.md +1 -1
  19. package/.docs/models/providers/baseten.md +2 -1
  20. package/.docs/models/providers/bothub.md +2 -1
  21. package/.docs/models/providers/cline-pass.md +18 -17
  22. package/.docs/models/providers/cortecs.md +3 -3
  23. package/.docs/models/providers/deepinfra.md +6 -3
  24. package/.docs/models/providers/digitalocean.md +1 -1
  25. package/.docs/models/providers/edenai.md +23 -4
  26. package/.docs/models/providers/empiriolabs.md +3 -1
  27. package/.docs/models/providers/greenpt.md +2 -1
  28. package/.docs/models/providers/huggingface.md +4 -1
  29. package/.docs/models/providers/hyper.md +3 -3
  30. package/.docs/models/providers/kilo.md +21 -14
  31. package/.docs/models/providers/llmgateway-providers.md +7 -2
  32. package/.docs/models/providers/llmgateway.md +8 -2
  33. package/.docs/models/providers/nan.md +1 -1
  34. package/.docs/models/providers/nano-gpt.md +12 -3
  35. package/.docs/models/providers/ofox.md +15 -9
  36. package/.docs/models/providers/ollama-cloud.md +2 -1
  37. package/.docs/models/providers/pioneer.md +11 -2
  38. package/.docs/models/providers/requesty.md +2 -2
  39. package/.docs/models/providers/volcengine-coding-plan.md +3 -1
  40. package/.docs/reference/configuration.md +2 -2
  41. package/.docs/reference/index.md +2 -0
  42. package/.docs/reference/memory/cloneThread.md +2 -0
  43. package/.docs/reference/memory/copyThread.md +65 -0
  44. package/.docs/reference/memory/memory-class.md +2 -1
  45. package/.docs/reference/memory/updateThreadResourceId.md +46 -0
  46. package/.docs/reference/processors/processor-interface.md +2 -0
  47. package/.docs/reference/pubsub/redis-streams.md +6 -0
  48. package/.docs/reference/pubsub/valkey-streams.md +6 -0
  49. package/.docs/reference/workspace/filesystem.md +72 -0
  50. package/package.json +6 -6
@@ -4,7 +4,7 @@
4
4
 
5
5
  # ![Deep Infra logo](https://models.dev/logos/deepinfra.svg)Deep Infra
6
6
 
7
- Access 64 Deep Infra models through Mastra's model router. Authentication is handled automatically using the `DEEPINFRA_API_KEY` environment variable.
7
+ Access 67 Deep Infra models through Mastra's model router. Authentication is handled automatically using the `DEEPINFRA_API_KEY` environment variable.
8
8
 
9
9
  Learn more in the [Deep Infra documentation](https://deepinfra.com/models).
10
10
 
@@ -49,7 +49,10 @@ for await (const chunk of stream) {
49
49
  | `deepinfra/deepseek-ai/DeepSeek-V4-Flash-Vision-Exp` | 1.0M | | | | | | $0.44 | $1 |
50
50
  | `deepinfra/deepseek-ai/DeepSeek-V4-Pro` | 1.0M | | | | | | $1 | $3 |
51
51
  | `deepinfra/deepseek-ai/DeepSeek-V4-Pro-0813` | 1.0M | | | | | | $1 | $3 |
52
- | `deepinfra/deepseek-ai/DeepSeek-V4.1-Flash` | 1.0M | | | | | | $0.30 | $1 |
52
+ | `deepinfra/deepseek-ai/DeepSeek-V4.1-Flash` | 1.0M | | | | | | $0.20 | $0.60 |
53
+ | `deepinfra/google/gemma-3-12b-it` | 131K | | | | | | $0.05 | $0.15 |
54
+ | `deepinfra/google/gemma-3-27b-it` | 131K | | | | | | $0.08 | $0.16 |
55
+ | `deepinfra/google/gemma-3-4b-it` | 131K | | | | | | $0.05 | $0.10 |
53
56
  | `deepinfra/google/gemma-4-26B-A4B-it` | 262K | | | | | | $0.07 | $0.34 |
54
57
  | `deepinfra/google/gemma-4-31B-it` | 262K | | | | | | $0.13 | $0.38 |
55
58
  | `deepinfra/google/gemma-4-E4B-it` | 131K | | | | | | $0.02 | $0.10 |
@@ -85,7 +88,7 @@ for await (const chunk of stream) {
85
88
  | `deepinfra/tencent/Hy3` | 262K | | | | | | $0.14 | $0.58 |
86
89
  | `deepinfra/thinkingmachines/Inkling` | 524K | | | | | | $0.95 | $4 |
87
90
  | `deepinfra/thinkingmachines/Inkling-Small` | 524K | | | | | | $0.45 | $1 |
88
- | `deepinfra/XiaomiMiMo/MiMo-V2.5` | 262K | | | | | | $0.40 | $2 |
91
+ | `deepinfra/XiaomiMiMo/MiMo-V2.5` | 262K | | | | | | $0.14 | $0.28 |
89
92
  | `deepinfra/XiaomiMiMo/MiMo-V2.5-Pro` | 1.0M | | | | | | $1 | $3 |
90
93
  | `deepinfra/zai-org/GLM-4.6` | 203K | | | | | | $0.50 | $2 |
91
94
  | `deepinfra/zai-org/GLM-4.7` | 203K | | | | | | $0.40 | $2 |
@@ -74,7 +74,7 @@ for await (const chunk of stream) {
74
74
  | `digitalocean/glm-5` | 64K | | | | | | $1 | $3 |
75
75
  | `digitalocean/glm-5.1` | 164K | | | | | | $1 | $4 |
76
76
  | `digitalocean/glm-5.2` | 262K | | | | | | $0.70 | $2 |
77
- | `digitalocean/glm-5.3` | 1.0M | | | | | | $1 | $4 |
77
+ | `digitalocean/glm-5.3` | 1.0M | | | | | | $0.95 | $3 |
78
78
  | `digitalocean/glm-5.3-flash` | 1.0M | | | | | | $0.15 | $0.50 |
79
79
  | `digitalocean/gte-large-en-v1.5` | 8K | | | | | | $0.09 | — |
80
80
  | `digitalocean/kimi-k2.5` | 262K | | | | | | $0.50 | $3 |
@@ -4,7 +4,7 @@
4
4
 
5
5
  # ![Eden AI logo](https://models.dev/logos/edenai.svg)Eden AI
6
6
 
7
- Access 260 Eden AI models through Mastra's model router. Authentication is handled automatically using the `EDENAI_API_KEY` environment variable.
7
+ Access 279 Eden AI models through Mastra's model router. Authentication is handled automatically using the `EDENAI_API_KEY` environment variable.
8
8
 
9
9
  Learn more in the [Eden AI documentation](https://docs.edenai.co).
10
10
 
@@ -44,10 +44,22 @@ for await (const chunk of stream) {
44
44
  | `edenai/amazon/amazon.nova-micro-v1:0@us` | 128K | | | | | | $0.04 | $0.14 |
45
45
  | `edenai/amazon/amazon.nova-pro-v1:0` | 300K | | | | | | $0.80 | $3 |
46
46
  | `edenai/amazon/amazon.nova-pro-v1:0@us` | 300K | | | | | | $0.80 | $3 |
47
+ | `edenai/amazon/google.gemma-3-12b-it` | 128K | | | | | | $0.09 | $0.29 |
48
+ | `edenai/amazon/google.gemma-3-12b-it@us` | 128K | | | | | | $0.09 | $0.29 |
49
+ | `edenai/amazon/google.gemma-3-27b-it` | 128K | | | | | | $0.23 | $0.38 |
50
+ | `edenai/amazon/google.gemma-3-27b-it@us` | 128K | | | | | | $0.23 | $0.38 |
51
+ | `edenai/amazon/google.gemma-3-4b-it` | 128K | | | | | | $0.04 | $0.08 |
52
+ | `edenai/amazon/google.gemma-3-4b-it@us` | 128K | | | | | | $0.04 | $0.08 |
47
53
  | `edenai/amazon/mistral.pixtral-large-2502-v1:0` | 128K | | | | | | $2 | $6 |
48
54
  | `edenai/amazon/mistral.pixtral-large-2502-v1:0@us` | 128K | | | | | | $2 | $6 |
55
+ | `edenai/amazon/mistral.voxtral-mini-3b-2507` | 128K | | | | | | $0.04 | $0.04 |
56
+ | `edenai/amazon/mistral.voxtral-mini-3b-2507@us` | 128K | | | | | | $0.04 | $0.04 |
57
+ | `edenai/amazon/mistral.voxtral-small-24b-2507` | 128K | | | | | | $0.10 | $0.30 |
58
+ | `edenai/amazon/mistral.voxtral-small-24b-2507@us` | 128K | | | | | | $0.10 | $0.30 |
49
59
  | `edenai/amazon/moonshot.kimi-k2-thinking` | 128K | | | | | | $0.60 | $3 |
50
60
  | `edenai/amazon/moonshotai.kimi-k2.5` | 262K | | | | | | $0.60 | $3 |
61
+ | `edenai/amazon/openai.gpt-oss-safeguard-20b` | 128K | | | | | | $0.07 | $0.20 |
62
+ | `edenai/amazon/openai.gpt-oss-safeguard-20b@us` | 128K | | | | | | $0.07 | $0.20 |
51
63
  | `edenai/amazon/zai.glm-4.7-flash` | 200K | | | | | | $0.07 | $0.40 |
52
64
  | `edenai/amazon/zai.glm-4.7-flash@us` | 200K | | | | | | $0.07 | $0.40 |
53
65
  | `edenai/anthropic/claude-fable-5` | 1.0M | | | | | | $10 | $50 |
@@ -94,7 +106,10 @@ for await (const chunk of stream) {
94
106
  | `edenai/deepinfra/deepseek-ai/DeepSeek-V3-0324` | 164K | | | | | | $0.24 | $0.90 |
95
107
  | `edenai/deepinfra/deepseek-ai/DeepSeek-V4-Flash-0731` | 1.0M | | | | | | $0.06 | $0.18 |
96
108
  | `edenai/deepinfra/deepseek-ai/DeepSeek-V4-Pro-0813` | 1.0M | | | | | | $1 | $3 |
97
- | `edenai/deepinfra/deepseek-ai/DeepSeek-V4.1-Flash` | 1.0M | | | | | | $0.30 | $1 |
109
+ | `edenai/deepinfra/deepseek-ai/DeepSeek-V4.1-Flash` | 1.0M | | | | | | $0.20 | $0.60 |
110
+ | `edenai/deepinfra/google/gemma-3-12b-it` | 131K | | | | | | $0.05 | $0.15 |
111
+ | `edenai/deepinfra/google/gemma-3-27b-it` | 131K | | | | | | $0.08 | $0.16 |
112
+ | `edenai/deepinfra/google/gemma-3-4b-it` | 131K | | | | | | $0.05 | $0.10 |
98
113
  | `edenai/deepinfra/meta-llama/Llama-3.2-11B-Vision-Instruct` | 131K | | | | | | $0.34 | $0.34 |
99
114
  | `edenai/deepinfra/meta-llama/Llama-3.3-70B-Instruct` | 131K | | | | | | $0.10 | $0.32 |
100
115
  | `edenai/deepinfra/meta-llama/Llama-Guard-3-8B` | 131K | | | | | | $0.06 | $0.06 |
@@ -146,8 +161,10 @@ for await (const chunk of stream) {
146
161
  | `edenai/google/gemini-pro-latest` | 1.0M | | | | | | $2 | $12 |
147
162
  | `edenai/groq/openai/gpt-oss-120b` | 131K | | | | | | $0.15 | $0.60 |
148
163
  | `edenai/groq/openai/gpt-oss-20b` | 131K | | | | | | $0.07 | $0.30 |
149
- | `edenai/ionos/meta-llama/Llama-3.3-70B-Instruct` | 128K | | | | | | $0.76 | $0.76 |
150
- | `edenai/ionos/openai/gpt-oss-120b` | 131K | | | | | | $0.17 | $0.76 |
164
+ | `edenai/groq/openai/gpt-oss-safeguard-20b` | 131K | | | | | | $0.07 | $0.30 |
165
+ | `edenai/infomaniak/mistralai/Ministral-3-14B-Instruct-2512` | 100K | | | | | | $0.35 | $0.46 |
166
+ | `edenai/ionos/meta-llama/Llama-3.3-70B-Instruct` | 128K | | | | | | $0.75 | $0.75 |
167
+ | `edenai/ionos/openai/gpt-oss-120b` | 131K | | | | | | $0.17 | $0.75 |
151
168
  | `edenai/minimax/MiniMax-M2` | 205K | | | | | | $0.30 | $1 |
152
169
  | `edenai/minimax/MiniMax-M2.1` | 205K | | | | | | $0.30 | $1 |
153
170
  | `edenai/minimax/MiniMax-M2.5` | 205K | | | | | | $0.30 | $1 |
@@ -171,6 +188,7 @@ for await (const chunk of stream) {
171
188
  | `edenai/moonshot/kimi-k3` | 1.0M | | | | | | $3 | $15 |
172
189
  | `edenai/nebius/deepseek-ai/DeepSeek-V4-Flash-0731` | 1.0M | | | | | | $0.14 | $0.28 |
173
190
  | `edenai/nebius/deepseek-ai/DeepSeek-V4-Pro-0813` | 979K | | | | | | $1 | $4 |
191
+ | `edenai/nebius/google/gemma-3-27b-it` | 110K | | | | | | $0.10 | $0.30 |
174
192
  | `edenai/nebius/meta-llama/Llama-3.3-70B-Instruct` | 131K | | | | | | $0.13 | $0.40 |
175
193
  | `edenai/nebius/nvidia/nemotron-3-super-120b-a12b` | 262K | | | | | | $0.30 | $0.90 |
176
194
  | `edenai/nebius/nvidia/Nemotron-3-Ultra-550b-a55b` | 1.0M | | | | | | $1 | $3 |
@@ -243,6 +261,7 @@ for await (const chunk of stream) {
243
261
  | `edenai/qwen/qwen3.8-max-0902` | 1.0M | | | | | | $2 | $6 |
244
262
  | `edenai/qwen/qwq-plus` | 131K | | | | | | $0.80 | $2 |
245
263
  | `edenai/scaleway/deepseek-v4-flash-0731` | 256K | | | | | | $0.46 | $0.93 |
264
+ | `edenai/scaleway/gemma-3-27b-it` | 40K | | | | | | $0.29 | $0.57 |
246
265
  | `edenai/scaleway/gpt-oss-120b` | 128K | | | | | | $0.17 | $0.70 |
247
266
  | `edenai/scaleway/llama-3.3-70b-instruct` | 128K | | | | | | $1 | $1 |
248
267
  | `edenai/tensorx/deepseek/deepseek-v4-flash-0731` | 1.0M | | | | | | $0.25 | $0.30 |
@@ -4,7 +4,7 @@
4
4
 
5
5
  # ![EmpirioLabs AI logo](https://models.dev/logos/empiriolabs.svg)EmpirioLabs AI
6
6
 
7
- Access 58 EmpirioLabs AI models through Mastra's model router. Authentication is handled automatically using the `EMPIRIOLABS_API_KEY` environment variable.
7
+ Access 60 EmpirioLabs AI models through Mastra's model router. Authentication is handled automatically using the `EMPIRIOLABS_API_KEY` environment variable.
8
8
 
9
9
  Learn more in the [EmpirioLabs AI documentation](https://docs.empiriolabs.ai).
10
10
 
@@ -45,6 +45,8 @@ for await (const chunk of stream) {
45
45
  | `empiriolabs/deepseek-v4-pro-0813` | 1.0M | | | | | | $1 | $4 |
46
46
  | `empiriolabs/fugu-ultra-v1-0` | 1.0M | | | | | | $8 | $45 |
47
47
  | `empiriolabs/fugu-ultra-v1-1` | 1.0M | | | | | | $5 | $30 |
48
+ | `empiriolabs/fugu-ultra-v2-0` | 1.0M | | | | | | $5 | $30 |
49
+ | `empiriolabs/gemma-3-27b` | 128K | | | | | | — | — |
48
50
  | `empiriolabs/gemma-4-26b-a4b` | 262K | | | | | | $0.05 | $0.29 |
49
51
  | `empiriolabs/glm-4-5-flash` | 200K | | | | | | — | — |
50
52
  | `empiriolabs/glm-4-6v-flash` | 128K | | | | | | — | — |
@@ -4,7 +4,7 @@
4
4
 
5
5
  # ![GreenPT logo](https://models.dev/logos/greenpt.svg)GreenPT
6
6
 
7
- Access 39 GreenPT models through Mastra's model router. Authentication is handled automatically using the `GREENPT_API_KEY` environment variable.
7
+ Access 40 GreenPT models through Mastra's model router. Authentication is handled automatically using the `GREENPT_API_KEY` environment variable.
8
8
 
9
9
  Learn more in the [GreenPT documentation](https://docs.greenpt.ai).
10
10
 
@@ -39,6 +39,7 @@ for await (const chunk of stream) {
39
39
  | Model | Context | Tools | Reasoning | Image | Audio | Video | Input $/1M | Output $/1M |
40
40
  | --------------------------------------------- | ------- | ----- | --------- | ----- | ----- | ----- | ---------- | ----------- |
41
41
  | `greenpt/deepseek-v4-flash-0731` | 1.0M | | | | | | $0.16 | $0.40 |
42
+ | `greenpt/deepseek-v4.1-flash` | 1.0M | | | | | | $0.26 | $1 |
42
43
  | `greenpt/devstral-2-123b-instruct-2512` | 200K | | | | | | $0.57 | $3 |
43
44
  | `greenpt/gemma-3-27b-it` | 40K | | | | | | $0.34 | $0.68 |
44
45
  | `greenpt/gemma4` | 262K | | | | | | $0.57 | $2 |
@@ -4,7 +4,7 @@
4
4
 
5
5
  # ![Hugging Face logo](https://models.dev/logos/huggingface.svg)Hugging Face
6
6
 
7
- Access 74 Hugging Face models through Mastra's model router. Authentication is handled automatically using the `HF_TOKEN` environment variable.
7
+ Access 77 Hugging Face models through Mastra's model router. Authentication is handled automatically using the `HF_TOKEN` environment variable.
8
8
 
9
9
  Learn more in the [Hugging Face documentation](https://huggingface.co).
10
10
 
@@ -50,6 +50,9 @@ for await (const chunk of stream) {
50
50
  | `huggingface/deepseek-ai/DeepSeek-V4-Pro` | 1.0M | | | | | | $0.43 | $0.87 |
51
51
  | `huggingface/deepseek-ai/DeepSeek-V4-Pro-0813` | 1.0M | | | | | | $1 | $4 |
52
52
  | `huggingface/deepseek-ai/DeepSeek-V4.1-Flash` | 1.0M | | | | | | $0.30 | $1 |
53
+ | `huggingface/google/gemma-3-12b-it` | 131K | | | | | | $0.05 | $0.15 |
54
+ | `huggingface/google/gemma-3-27b-it` | 131K | | | | | | $0.08 | $0.16 |
55
+ | `huggingface/google/gemma-3-4b-it` | 131K | | | | | | $0.05 | $0.10 |
53
56
  | `huggingface/google/gemma-4-26B-A4B-it` | 262K | | | | | | $0.13 | $0.40 |
54
57
  | `huggingface/google/gemma-4-31B-it` | 262K | | | | | | $0.14 | $0.40 |
55
58
  | `huggingface/meta-llama/Llama-3.1-8B-Instruct` | 131K | | | | | | $0.06 | $0.06 |
@@ -43,13 +43,13 @@ for await (const chunk of stream) {
43
43
  | `hyper/deepseek-v4-pro` | 1.0M | | | | | | $2 | $5 |
44
44
  | `hyper/deepseek-v4-pro-0813` | 1.0M | | | | | | $1 | $4 |
45
45
  | `hyper/deepseek-v4.1-flash` | 1.0M | | | | | | $0.30 | $1 |
46
- | `hyper/gemma-4-26b-a4b-it` | 256K | | | | | | $0.12 | $0.42 |
46
+ | `hyper/gemma-4-26b-a4b-it` | 256K | | | | | | $0.10 | $0.36 |
47
47
  | `hyper/glm-5` | 203K | | | | | | $0.86 | $3 |
48
48
  | `hyper/glm-5.1` | 203K | | | | | | $1 | $4 |
49
49
  | `hyper/glm-5.2` | 1.0M | | | | | | $2 | $5 |
50
50
  | `hyper/glm-5.3` | 1.0M | | | | | | $2 | $5 |
51
51
  | `hyper/glm-5.3-flash` | 1.0M | | | | | | $0.16 | $0.54 |
52
- | `hyper/gpt-oss-120b` | 128K | | | | | | $0.18 | $0.68 |
52
+ | `hyper/gpt-oss-120b` | 128K | | | | | | $0.17 | $0.66 |
53
53
  | `hyper/inkling` | 1.0M | | | | | | $1 | $4 |
54
54
  | `hyper/kimi-k2-thinking` | 262K | | | | | | $0.60 | $3 |
55
55
  | `hyper/kimi-k2.5` | 262K | | | | | | $0.56 | $3 |
@@ -57,7 +57,7 @@ for await (const chunk of stream) {
57
57
  | `hyper/kimi-k2.7-code` | 262K | | | | | | $1 | $4 |
58
58
  | `hyper/kimi-k3` | 1.0M | | | | | | $3 | $16 |
59
59
  | `hyper/llama-3.3-70b-instruct` | 128K | | | | | | $0.61 | $1 |
60
- | `hyper/llama-4-maverick-17b-128e-instruct-fp8` | 430K | | | | | | $0.27 | $0.90 |
60
+ | `hyper/llama-4-maverick-17b-128e-instruct-fp8` | 430K | | | | | | $0.26 | $0.84 |
61
61
  | `hyper/minimax-m2.7` | 262K | | | | | | $0.40 | $1 |
62
62
  | `hyper/minimax-m3` | 512K | | | | | | $0.33 | $1 |
63
63
  | `hyper/qwen3-coder-480b-a35b-instruct-int4-mixed-ar` | 106K | | | | | | $0.45 | $2 |
@@ -4,7 +4,7 @@
4
4
 
5
5
  # ![Kilo Gateway logo](https://models.dev/logos/kilo.svg)Kilo Gateway
6
6
 
7
- Access 368 Kilo Gateway models through Mastra's model router. Authentication is handled automatically using the `KILO_API_KEY` environment variable.
7
+ Access 375 Kilo Gateway models through Mastra's model router. Authentication is handled automatically using the `KILO_API_KEY` environment variable.
8
8
 
9
9
  Learn more in the [Kilo Gateway documentation](https://kilo.ai).
10
10
 
@@ -42,15 +42,18 @@ for await (const chunk of stream) {
42
42
  | `kilo/~anthropic/claude-haiku-latest` | 200K | | | | | | $1 | $5 |
43
43
  | `kilo/~anthropic/claude-opus-latest` | 1.0M | | | | | | $5 | $25 |
44
44
  | `kilo/~anthropic/claude-sonnet-latest` | 1.0M | | | | | | $2 | $10 |
45
- | `kilo/~deepseek/deepseek-v4-flash-latest` | 1.0M | | | | | | $0.05 | $0.16 |
45
+ | `kilo/~deepseek/deepseek-v4-flash-latest` | 1.0M | | | | | | $0.03 | $0.07 |
46
46
  | `kilo/~google/gemini-flash-latest` | 1.0M | | | | | | $0.75 | $4 |
47
47
  | `kilo/~google/gemini-pro-latest` | 1.0M | | | | | | $2 | $12 |
48
- | `kilo/~moonshotai/kimi-latest` | 1.0M | | | | | | $2 | $12 |
49
- | `kilo/~openai/gpt-latest` | 1.1M | | | | | | $2 | $10 |
48
+ | `kilo/~moonshotai/kimi-latest` | 1.0M | | | | | | $2 | $13 |
49
+ | `kilo/~openai/gpt-astra-latest` | 1.1M | | | | | | $10 | $50 |
50
+ | `kilo/~openai/gpt-luna-latest` | 1.1M | | | | | | $0.20 | $1 |
50
51
  | `kilo/~openai/gpt-mini-latest` | 400K | | | | | | $0.75 | $5 |
52
+ | `kilo/~openai/gpt-sol-latest` | 1.1M | | | | | | $2 | $10 |
53
+ | `kilo/~openai/gpt-terra-latest` | 1.1M | | | | | | $2 | $12 |
51
54
  | `kilo/~x-ai/grok-latest` | 500K | | | | | | $2 | $6 |
52
55
  | `kilo/~z-ai/glm-flash-latest` | 1.0M | | | | | | $0.07 | $0.25 |
53
- | `kilo/~z-ai/glm-latest` | 1.0M | | | | | | $0.70 | $2 |
56
+ | `kilo/~z-ai/glm-latest` | 1.0M | | | | | | $0.87 | $3 |
54
57
  | `kilo/aion-labs/aion-2.0` | 131K | | | | | | $0.80 | $2 |
55
58
  | `kilo/aion-labs/aion-3.0` | 131K | | | | | | $3 | $6 |
56
59
  | `kilo/aion-labs/aion-3.0-mini` | 131K | | | | | | $0.70 | $1 |
@@ -92,7 +95,7 @@ for await (const chunk of stream) {
92
95
  | `kilo/cohere/command-r7b-12-2024` | 128K | | | | | | $0.04 | $0.15 |
93
96
  | `kilo/cohere/north-mini-code:free` | 256K | | | | | | — | — |
94
97
  | `kilo/deepseek/deepseek-chat` | 128K | | | | | | $0.26 | $1 |
95
- | `kilo/deepseek/deepseek-chat-v3-0324` | 164K | | | | | | $0.29 | $1 |
98
+ | `kilo/deepseek/deepseek-chat-v3-0324` | 164K | | | | | | $0.25 | $1 |
96
99
  | `kilo/deepseek/deepseek-chat-v3.1` | 164K | | | | | | $0.27 | $1 |
97
100
  | `kilo/deepseek/deepseek-r1` | 64K | | | | | | $0.70 | $3 |
98
101
  | `kilo/deepseek/deepseek-r1-0528` | 164K | | | | | | $0.70 | $3 |
@@ -145,7 +148,10 @@ for await (const chunk of stream) {
145
148
  | `kilo/inclusionai/ling-3.0-flash-fin` | 262K | | | | | | $0.06 | $0.18 |
146
149
  | `kilo/inclusionai/ling-3.0-flash-fin:free` | 262K | | | | | | — | — |
147
150
  | `kilo/inclusionai/ling-3.0-flash-sante:free` | 262K | | | | | | — | — |
151
+ | `kilo/inclusionai/ling-3.0-flash-vl` | 131K | | | | | | $0.06 | $0.18 |
148
152
  | `kilo/inclusionai/ling-3.0-flash-vl:free` | 262K | | | | | | — | — |
153
+ | `kilo/inference-net/schematron-v2-small` | 128K | | | | | | $0.05 | $0.23 |
154
+ | `kilo/inference-net/schematron-v2-turbo` | 128K | | | | | | $0.03 | $0.15 |
149
155
  | `kilo/kilo-auto/balanced` | 1.0M | | | | | | $0.33 | $2 |
150
156
  | `kilo/kilo-auto/efficient` | 1.0M | | | | | | $0.33 | $2 |
151
157
  | `kilo/kilo-auto/free` | 256K | | | | | | — | — |
@@ -215,13 +221,13 @@ for await (const chunk of stream) {
215
221
  | `kilo/nousresearch/hermes-4-405b` | 131K | | | | | | $1 | $3 |
216
222
  | `kilo/nvidia/nemotron-3-nano-30b-a3b` | 262K | | | | | | $0.05 | $0.20 |
217
223
  | `kilo/nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free` | 256K | | | | | | — | — |
218
- | `kilo/nvidia/nemotron-3-super-120b-a12b` | 262K | | | | | | $0.09 | $0.40 |
224
+ | `kilo/nvidia/nemotron-3-super-120b-a12b` | 262K | | | | | | $0.08 | $0.45 |
219
225
  | `kilo/nvidia/nemotron-3-super-120b-a12b:free` | 262K | | | | | | — | — |
220
226
  | `kilo/nvidia/nemotron-3-ultra-550b-a55b` | 256K | | | | | | $0.50 | $2 |
221
227
  | `kilo/nvidia/nemotron-3-ultra-550b-a55b:free` | 1.0M | | | | | | — | — |
222
228
  | `kilo/nvidia/nemotron-3.5-content-safety` | 131K | | | | | | $0.20 | $0.20 |
223
229
  | `kilo/nvidia/nemotron-3.5-content-safety:free` | 128K | | | | | | — | — |
224
- | `kilo/nvidia/nemotron-3.5-lightning` | 262K | | | | | | $0.08 | $0.20 |
230
+ | `kilo/nvidia/nemotron-3.5-lightning` | 262K | | | | | | $0.07 | $0.18 |
225
231
  | `kilo/nvidia/nemotron-3.5-lightning:free` | 1.0M | | | | | | — | — |
226
232
  | `kilo/openai/gpt-3.5-turbo` | 16K | | | | | | $0.50 | $2 |
227
233
  | `kilo/openai/gpt-3.5-turbo-0613` | 4K | | | | | | $1 | $2 |
@@ -309,7 +315,7 @@ for await (const chunk of stream) {
309
315
  | `kilo/qwen/qwen3-235b-a22b-2507` | 262K | | | | | | $0.15 | $0.60 |
310
316
  | `kilo/qwen/qwen3-235b-a22b-thinking-2507` | 131K | | | | | | $0.23 | $2 |
311
317
  | `kilo/qwen/qwen3-30b-a3b` | 41K | | | | | | $0.13 | $0.52 |
312
- | `kilo/qwen/qwen3-30b-a3b-instruct-2507` | 128K | | | | | | $0.13 | $0.52 |
318
+ | `kilo/qwen/qwen3-30b-a3b-instruct-2507` | 262K | | | | | | $0.13 | $0.52 |
313
319
  | `kilo/qwen/qwen3-30b-a3b-thinking-2507` | 82K | | | | | | $0.20 | $2 |
314
320
  | `kilo/qwen/qwen3-32b` | 41K | | | | | | $0.08 | $0.28 |
315
321
  | `kilo/qwen/qwen3-8b` | 131K | | | | | | $0.12 | $0.46 |
@@ -346,14 +352,16 @@ for await (const chunk of stream) {
346
352
  | `kilo/qwen/qwen3.7-max` | 1.0M | | | | | | $1 | $4 |
347
353
  | `kilo/qwen/qwen3.7-plus` | 1.0M | | | | | | $0.32 | $1 |
348
354
  | `kilo/qwen/qwen3.8-2.4t-a95b` | 1.0M | | | | | | $2 | $6 |
349
- | `kilo/qwen/qwen3.8-27b` | 1.0M | | | | | | $0.42 | $3 |
355
+ | `kilo/qwen/qwen3.8-27b` | 262K | | | | | | $0.42 | $3 |
350
356
  | `kilo/qwen/qwen3.8-flash` | 1.0M | | | | | | $0.15 | $0.47 |
351
357
  | `kilo/qwen/qwen3.8-max-0902` | 1.0M | | | | | | $2 | $6 |
352
358
  | `kilo/rekaai/reka-edge` | 16K | | | | | | $0.10 | $0.10 |
353
359
  | `kilo/rekaai/reka-flash-3` | 66K | | | | | | $0.10 | $0.20 |
354
360
  | `kilo/relace/relace-apply-3` | 256K | | | | | | $0.85 | $1 |
355
361
  | `kilo/relace/relace-search` | 256K | | | | | | $1 | $3 |
362
+ | `kilo/sakana/fugu-max` | 1.0M | | | | | | $2 | $6 |
356
363
  | `kilo/sakana/fugu-ultra` | 1.0M | | | | | | $5 | $30 |
364
+ | `kilo/sakana/fugu-ultra-v2` | 1.0M | | | | | | $5 | $30 |
357
365
  | `kilo/sakana/sakana-namazu` | 262K | | | | | | $0.95 | $4 |
358
366
  | `kilo/sao10k/l3-lunaris-8b` | 8K | | | | | | $0.04 | $0.05 |
359
367
  | `kilo/sao10k/l3.1-euryale-70b` | 131K | | | | | | $0.85 | $0.85 |
@@ -370,16 +378,15 @@ for await (const chunk of stream) {
370
378
  | `kilo/tencent/hy-mt2-1.8b` | 8K | | | | | | $0.04 | $0.18 |
371
379
  | `kilo/tencent/hy-mt2-30b-a3b` | 8K | | | | | | $0.07 | $0.29 |
372
380
  | `kilo/tencent/hy-mt2-7b` | 8K | | | | | | $0.07 | $0.29 |
373
- | `kilo/tencent/hy3` | 262K | | | | | | $0.08 | $0.33 |
381
+ | `kilo/tencent/hy3` | 262K | | | | | | $0.14 | $0.58 |
374
382
  | `kilo/tencent/hy3-preview` | 262K | | | | | | $0.18 | $0.60 |
375
383
  | `kilo/tencent/hy4-preview` | 1.0M | | | | | | $0.83 | $3 |
376
384
  | `kilo/thedrummer/cydonia-24b-v4.1` | 131K | | | | | | $0.30 | $0.50 |
377
385
  | `kilo/thedrummer/skyfall-36b-v2` | 33K | | | | | | $0.55 | $0.80 |
378
386
  | `kilo/thedrummer/unslopnemo-12b` | 1.0M | | | | | | $0.40 | $0.40 |
379
- | `kilo/thinkingmachines/inkling` | 1.0M | | | | | | $0.95 | $4 |
387
+ | `kilo/thinkingmachines/inkling` | 524K | | | | | | $0.95 | $4 |
380
388
  | `kilo/thinkingmachines/inkling-small` | 524K | | | | | | $0.45 | $1 |
381
389
  | `kilo/thinkingmachines/inkling-small:free` | 1.0M | | | | | | — | — |
382
- | `kilo/thinkingmachines/inkling:free` | 1.0M | | | | | | — | — |
383
390
  | `kilo/undi95/remm-slerp-l2-13b` | 6K | | | | | | $0.35 | $0.65 |
384
391
  | `kilo/upstage/solar-pro-3` | 131K | | | | | | $0.15 | $0.60 |
385
392
  | `kilo/upstage/solar-pro4` | 524K | | | | | | $0.30 | $1 |
@@ -402,7 +409,7 @@ for await (const chunk of stream) {
402
409
  | `kilo/z-ai/glm-5` | 198K | | | | | | $0.60 | $2 |
403
410
  | `kilo/z-ai/glm-5-turbo` | 203K | | | | | | $1 | $4 |
404
411
  | `kilo/z-ai/glm-5.1` | 200K | | | | | | $1 | $4 |
405
- | `kilo/z-ai/glm-5.2` | 1.0M | | | | | | $1 | $4 |
412
+ | `kilo/z-ai/glm-5.2` | 203K | | | | | | $1 | $4 |
406
413
  | `kilo/z-ai/glm-5.3` | 1.0M | | | | | | $1 | $4 |
407
414
  | `kilo/z-ai/glm-5.3-flash` | 1.0M | | | | | | $0.15 | $0.50 |
408
415
  | `kilo/z-ai/glm-5v-turbo` | 203K | | | | | | $1 | $4 |
@@ -4,7 +4,7 @@
4
4
 
5
5
  # ![LLM Gateway logo](https://models.dev/logos/llmgateway-providers.svg)LLM Gateway
6
6
 
7
- Access 375 LLM Gateway models through Mastra's model router. Authentication is handled automatically using the `LLMGATEWAY_API_KEY` environment variable.
7
+ Access 380 LLM Gateway models through Mastra's model router. Authentication is handled automatically using the `LLMGATEWAY_API_KEY` environment variable.
8
8
 
9
9
  Learn more in the [LLM Gateway documentation](https://llmgateway.io/docs).
10
10
 
@@ -43,6 +43,7 @@ for await (const chunk of stream) {
43
43
  | `llmgateway-providers/alibaba/glm-5` | 203K | | | | | | $0.57 | $3 |
44
44
  | `llmgateway-providers/alibaba/glm-5.2` | 1.0M | | | | | | $1 | $4 |
45
45
  | `llmgateway-providers/alibaba/kimi-k2.5` | 262K | | | | | | $0.57 | $3 |
46
+ | `llmgateway-providers/alibaba/kimi-k3` | 1.0M | | | | | | $3 | $15 |
46
47
  | `llmgateway-providers/alibaba/qwen-coder-plus` | 131K | | | | | | $0.50 | $1 |
47
48
  | `llmgateway-providers/alibaba/qwen-flash` | 1.0M | | | | | | $0.05 | $0.40 |
48
49
  | `llmgateway-providers/alibaba/qwen-max` | 33K | | | | | | $2 | $6 |
@@ -99,6 +100,7 @@ for await (const chunk of stream) {
99
100
  | `llmgateway-providers/aws-mantle/gpt-5.6-luna` | 279K | | | | | | $0.22 | $1 |
100
101
  | `llmgateway-providers/aws-mantle/gpt-5.6-sol` | 279K | | | | | | $6 | $33 |
101
102
  | `llmgateway-providers/aws-mantle/gpt-5.6-terra` | 279K | | | | | | $2 | $13 |
103
+ | `llmgateway-providers/aws-mantle/gpt-6-astra` | 1.1M | | | | | | $10 | $50 |
102
104
  | `llmgateway-providers/azure-ai-foundry/grok-4-1-fast-non-reasoning` | 2.0M | | | | | | $0.20 | $0.50 |
103
105
  | `llmgateway-providers/azure-ai-foundry/grok-4-1-fast-reasoning` | 2.0M | | | | | | $0.20 | $0.50 |
104
106
  | `llmgateway-providers/azure-ai-foundry/grok-4-3` | 20K | | | | | | $1 | $3 |
@@ -166,7 +168,7 @@ for await (const chunk of stream) {
166
168
  | `llmgateway-providers/cerebras/gpt-oss-120b` | 131K | | | | | | $0.35 | $0.75 |
167
169
  | `llmgateway-providers/cerebras/llama-3.3-70b-instruct` | 128K | | | | | | $0.85 | $1 |
168
170
  | `llmgateway-providers/cerebras/qwen3-235b-a22b-instruct-2507` | 262K | | | | | | $0.60 | $1 |
169
- | `llmgateway-providers/consensusprotocol/deepseek-v4-flash` | 1.0M | | | | | | $0.05 | $0.10 |
171
+ | `llmgateway-providers/consensusprotocol/deepseek-v4-flash` | 1.1M | | | | | | $0.05 | $0.10 |
170
172
  | `llmgateway-providers/consensusprotocol/gemma-4-31b-it` | 262K | | | | | | $0.10 | $0.25 |
171
173
  | `llmgateway-providers/consensusprotocol/glm-5.3-flash` | 1.0M | | | | | | $0.10 | $0.25 |
172
174
  | `llmgateway-providers/consensusprotocol/gpt-oss-20b` | 66K | | | | | | $0.04 | $0.19 |
@@ -338,6 +340,7 @@ for await (const chunk of stream) {
338
340
  | `llmgateway-providers/perplexity/sonar-reasoning-pro` | 128K | | | | | | $2 | $8 |
339
341
  | `llmgateway-providers/quartz/gemini-3.1-pro-preview` | 1.0M | | | | | | $2 | $12 |
340
342
  | `llmgateway-providers/ranoai/deepseek-v4-flash` | 1.0M | | | | | | $0.14 | $0.28 |
343
+ | `llmgateway-providers/runpod/kimi-k3` | 1.0M | | | | | | $3 | $15 |
341
344
  | `llmgateway-providers/runware/deepseek-v4-flash` | 1.0M | | | | | | $0.08 | $0.15 |
342
345
  | `llmgateway-providers/runware/deepseek-v4-pro` | 1.0M | | | | | | $0.96 | $2 |
343
346
  | `llmgateway-providers/runware/gemma-4-31b-it` | 262K | | | | | | $0.10 | $0.30 |
@@ -347,7 +350,9 @@ for await (const chunk of stream) {
347
350
  | `llmgateway-providers/runware/gpt-oss-120b` | 131K | | | | | | $0.03 | $0.14 |
348
351
  | `llmgateway-providers/runware/kimi-k2.6` | 262K | | | | | | $0.60 | $3 |
349
352
  | `llmgateway-providers/runware/kimi-k3` | 1.0M | | | | | | $3 | $15 |
353
+ | `llmgateway-providers/sakana/fugu-max` | 1.0M | | | | | | $2 | $6 |
350
354
  | `llmgateway-providers/sakana/fugu-ultra` | 1.0M | | | | | | $5 | $30 |
355
+ | `llmgateway-providers/sakana/fugu-ultra-v2.0` | 1.0M | | | | | | $5 | $30 |
351
356
  | `llmgateway-providers/scx-ai-gp/glm-5.2` | 1.0M | | | | | | $0.80 | $3 |
352
357
  | `llmgateway-providers/scx-ai-gp/glm-5.2-fast` | 1.0M | | | | | | $2 | $7 |
353
358
  | `llmgateway-providers/scx-ai-gp/glm-5.3` | 1.0M | | | | | | $1 | $4 |
@@ -4,7 +4,7 @@
4
4
 
5
5
  # ![DevPass (LLM Gateway) logo](https://models.dev/logos/llmgateway.svg)DevPass (LLM Gateway)
6
6
 
7
- Access 186 DevPass (LLM Gateway) models through Mastra's model router. Authentication is handled automatically using the `LLMGATEWAY_API_KEY` environment variable.
7
+ Access 192 DevPass (LLM Gateway) models through Mastra's model router. Authentication is handled automatically using the `LLMGATEWAY_API_KEY` environment variable.
8
8
 
9
9
  Learn more in the [DevPass (LLM Gateway) documentation](https://llmgateway.io/docs).
10
10
 
@@ -60,7 +60,9 @@ for await (const chunk of stream) {
60
60
  | `llmgateway/deepseek-v4-pro` | 1.1M | | | | | | $0.43 | $0.87 |
61
61
  | `llmgateway/deepseek-v4.1-flash` | 1.1M | | | | | | $0.15 | $0.60 |
62
62
  | `llmgateway/ernie-4.5-vl-424b-a47b` | 123K | | | | | | $0.42 | $1 |
63
+ | `llmgateway/fugu-max` | 1.0M | | | | | | $2 | $6 |
63
64
  | `llmgateway/fugu-ultra` | 1.0M | | | | | | $5 | $30 |
65
+ | `llmgateway/fugu-ultra-v2.0` | 1.0M | | | | | | $5 | $30 |
64
66
  | `llmgateway/gemini-2.5-flash` | 1.0M | | | | | | $0.30 | $3 |
65
67
  | `llmgateway/gemini-2.5-flash-lite` | 1.0M | | | | | | $0.10 | $0.40 |
66
68
  | `llmgateway/gemini-2.5-pro` | 1.0M | | | | | | $1 | $10 |
@@ -88,11 +90,13 @@ for await (const chunk of stream) {
88
90
  | `llmgateway/glm-4.7-flash` | 200K | | | | | | $0.06 | $0.40 |
89
91
  | `llmgateway/glm-4.7-flashx` | 200K | | | | | | $0.07 | $0.40 |
90
92
  | `llmgateway/glm-5` | 203K | | | | | | $0.72 | $2 |
93
+ | `llmgateway/glm-5-turbo` | 200K | | | | | | $1 | $4 |
91
94
  | `llmgateway/glm-5.1` | 205K | | | | | | $0.93 | $3 |
92
95
  | `llmgateway/glm-5.2` | 1.0M | | | | | | $0.80 | $3 |
93
96
  | `llmgateway/glm-5.2-fast` | 1.0M | | | | | | $2 | $7 |
94
97
  | `llmgateway/glm-5.3` | 1.0M | | | | | | $1 | $4 |
95
98
  | `llmgateway/glm-5.3-flash` | 1.0M | | | | | | $0.09 | $0.25 |
99
+ | `llmgateway/glm-5v-turbo` | 200K | | | | | | $1 | $4 |
96
100
  | `llmgateway/gpt-3.5-turbo` | 16K | | | | | | $0.50 | $2 |
97
101
  | `llmgateway/gpt-4` | 8K | | | | | | $30 | $60 |
98
102
  | `llmgateway/gpt-4-turbo` | 128K | | | | | | $10 | $30 |
@@ -137,7 +141,9 @@ for await (const chunk of stream) {
137
141
  | `llmgateway/grok-4-5` | 500K | | | | | | $2 | $6 |
138
142
  | `llmgateway/grok-4-6` | 500K | | | | | | $2 | $6 |
139
143
  | `llmgateway/grok-build-0-1` | 256K | | | | | | $1 | $2 |
140
- | `llmgateway/hy3` | 262K | | | | | | $0.14 | $0.58 |
144
+ | `llmgateway/hy-mt2-plus` | 8K | | | | | | $0.07 | $0.29 |
145
+ | `llmgateway/hy3` | 262K | | | | | | $0.13 | $0.53 |
146
+ | `llmgateway/hy4-preview` | 1.0M | | | | | | $0.83 | $3 |
141
147
  | `llmgateway/kimi-k2` | 256K | | | | | | $0.57 | $2 |
142
148
  | `llmgateway/kimi-k2-thinking` | 262K | | | | | | $0.60 | $3 |
143
149
  | `llmgateway/kimi-k2.5` | 262K | | | | | | $0.41 | $2 |
@@ -40,7 +40,7 @@ for await (const chunk of stream) {
40
40
  | ----------------------- | ------- | ----- | --------- | ----- | ----- | ----- | ---------- | ----------- |
41
41
  | `nan/deepseek-v4-flash` | 1.0M | | | | | | — | — |
42
42
  | `nan/gemma4` | 262K | | | | | | — | — |
43
- | `nan/glm5.2` | 500K | | | | | | — | — |
43
+ | `nan/glm5.3` | 1.0M | | | | | | — | — |
44
44
  | `nan/glm5.3-flash` | 1.0M | | | | | | — | — |
45
45
  | `nan/mimo-v2.5` | 1.0M | | | | | | — | — |
46
46
  | `nan/qwen3.6` | 262K | | | | | | — | — |
@@ -4,7 +4,7 @@
4
4
 
5
5
  # ![NanoGPT logo](https://models.dev/logos/nano-gpt.svg)NanoGPT
6
6
 
7
- Access 585 NanoGPT models through Mastra's model router. Authentication is handled automatically using the `NANO_GPT_API_KEY` environment variable.
7
+ Access 594 NanoGPT models through Mastra's model router. Authentication is handled automatically using the `NANO_GPT_API_KEY` environment variable.
8
8
 
9
9
  Learn more in the [NanoGPT documentation](https://docs.nano-gpt.com).
10
10
 
@@ -276,6 +276,7 @@ for await (const chunk of stream) {
276
276
  | `nano-gpt/inflatebot/MN-12B-Mag-Mell-R1` | 16K | | | | | | $0.49 | $0.49 |
277
277
  | `nano-gpt/kimi-k2-instruct-fast` | 131K | | | | | | $0.40 | $2 |
278
278
  | `nano-gpt/LatitudeGames/Wayfarer-Large-70B-Llama-3.3` | 33K | | | | | | $0.70 | $0.70 |
279
+ | `nano-gpt/lightonai/LightOnOCR-2-1B` | 33K | | | | | | $0.18 | $0.35 |
279
280
  | `nano-gpt/liquid/lfm-2.5-2.6b` | 128K | | | | | | $0.10 | $0.20 |
280
281
  | `nano-gpt/LLM360/K2-Think` | 128K | | | | | | $0.17 | $0.68 |
281
282
  | `nano-gpt/longcat-2.0` | 1.0M | | | | | | $0.75 | $3 |
@@ -287,6 +288,7 @@ for await (const chunk of stream) {
287
288
  | `nano-gpt/mercury-2` | 128K | | | | | | $0.25 | $0.75 |
288
289
  | `nano-gpt/mercury-coder-small` | 33K | | | | | | $0.25 | $1 |
289
290
  | `nano-gpt/Meta-Llama-3-1-8B-Instruct-FP8` | 128K | | | | | | $0.02 | $0.03 |
291
+ | `nano-gpt/meta-llama/llama-3.1-405b-instruct` | 131K | | | | | | $2 | $2 |
290
292
  | `nano-gpt/meta-llama/llama-3.1-8b-instruct` | 131K | | | | | | $0.05 | $0.09 |
291
293
  | `nano-gpt/meta-llama/llama-3.2-3b-instruct` | 131K | | | | | | $0.03 | $0.05 |
292
294
  | `nano-gpt/meta-llama/llama-3.3-70b-instruct` | 131K | | | | | | $0.05 | $0.23 |
@@ -329,6 +331,7 @@ for await (const chunk of stream) {
329
331
  | `nano-gpt/mistralai/mistral-medium-3.1` | 131K | | | | | | $0.40 | $2 |
330
332
  | `nano-gpt/mistralai/Mistral-Nemo-Instruct-2407` | 16K | | | | | | $0.10 | $0.12 |
331
333
  | `nano-gpt/mistralai/mistral-saba` | 33K | | | | | | $0.20 | $0.59 |
334
+ | `nano-gpt/mistralai/mistral-small-24b-instruct-2501` | 33K | | | | | | $0.12 | $0.35 |
332
335
  | `nano-gpt/mistralai/mistral-small-4-119b-2603` | 262K | | | | | | $0.40 | $1 |
333
336
  | `nano-gpt/mistralai/mistral-small-4-119b-2603:thinking` | 262K | | | | | | $0.40 | $1 |
334
337
  | `nano-gpt/mistralai/mixtral-8x22b-instruct-v0.1` | 66K | | | | | | $2 | $6 |
@@ -398,11 +401,15 @@ for await (const chunk of stream) {
398
401
  | `nano-gpt/openai/gpt-5.6-terra-pro` | 1.1M | | | | | | $2 | $12 |
399
402
  | `nano-gpt/openai/gpt-6-astra` | 1.1M | | | | | | $10 | $50 |
400
403
  | `nano-gpt/openai/gpt-6-astra-pro` | 1.1M | | | | | | $10 | $50 |
404
+ | `nano-gpt/openai/gpt-astra-latest` | 1.1M | | | | | | $10 | $50 |
401
405
  | `nano-gpt/openai/gpt-chat-latest` | 1.1M | | | | | | $2 | $10 |
402
406
  | `nano-gpt/openai/gpt-latest` | 1.1M | | | | | | $10 | $50 |
407
+ | `nano-gpt/openai/gpt-luna-latest` | 1.1M | | | | | | $0.20 | $1 |
403
408
  | `nano-gpt/openai/gpt-oss-120b` | 128K | | | | | | $0.35 | $0.75 |
404
409
  | `nano-gpt/openai/gpt-oss-20b` | 128K | | | | | | $0.20 | $0.30 |
405
410
  | `nano-gpt/openai/gpt-oss-safeguard-20b` | 128K | | | | | | $0.07 | $0.30 |
411
+ | `nano-gpt/openai/gpt-sol-latest` | 1.1M | | | | | | $2 | $10 |
412
+ | `nano-gpt/openai/gpt-terra-latest` | 1.1M | | | | | | $2 | $12 |
406
413
  | `nano-gpt/openai/o1` | 200K | | | | | | $15 | $60 |
407
414
  | `nano-gpt/openai/o1-pro` | 200K | | | | | | $150 | $600 |
408
415
  | `nano-gpt/openai/o3` | 200K | | | | | | $2 | $8 |
@@ -492,8 +499,9 @@ for await (const chunk of stream) {
492
499
  | `nano-gpt/qwen3.8-max` | 991K | | | | | | $2 | $6 |
493
500
  | `nano-gpt/qwen3.8-max:thinking` | 991K | | | | | | $2 | $6 |
494
501
  | `nano-gpt/ReadyArt/MS3.2-The-Omega-Directive-24B-Unslop-v2.0` | 33K | | | | | | $0.50 | $0.50 |
495
- | `nano-gpt/sakana/fugu-ultra` | 1.0M | | | | | | $5 | $32 |
496
- | `nano-gpt/sakana/fugu-ultra-v1.1` | 1.0M | | | | | | $5 | $32 |
502
+ | `nano-gpt/sakana/fugu-max` | 1.0M | | | | | | $2 | $6 |
503
+ | `nano-gpt/sakana/fugu-ultra` | 1.0M | | | | | | $5 | $30 |
504
+ | `nano-gpt/sakana/fugu-ultra-v1.1` | 1.0M | | | | | | $5 | $30 |
497
505
  | `nano-gpt/Salesforce/Llama-xLAM-2-70b-fc-r` | 128K | | | | | | $3 | $3 |
498
506
  | `nano-gpt/Sao10K/L3-8B-Stheno-v3.2` | 16K | | | | | | $0.20 | $0.20 |
499
507
  | `nano-gpt/Sao10K/L3.1-70B-Euryale-v2.2` | 20K | | | | | | $0.31 | $0.36 |
@@ -535,6 +543,7 @@ for await (const chunk of stream) {
535
543
  | `nano-gpt/TEE/kimi-k3` | 1.0M | | | | | | $3 | $15 |
536
544
  | `nano-gpt/TEE/llama3-3-70b` | 128K | | | | | | $2 | $3 |
537
545
  | `nano-gpt/TEE/muse-glimmer-30b` | 131K | | | | | | $0.35 | $2 |
546
+ | `nano-gpt/TEE/nemotron-3.5-lightning` | 262K | | | | | | $0.08 | $0.20 |
538
547
  | `nano-gpt/TEE/qwen2.5-vl-72b-instruct` | 66K | | | | | | $0.70 | $0.70 |
539
548
  | `nano-gpt/TEE/qwen3-8b` | 41K | | | | | | $0.11 | $0.45 |
540
549
  | `nano-gpt/TEE/qwen3.5-27b` | 262K | | | | | | $0.30 | $2 |