@agentjido/llmdb 2026.8.2 → 2026.8.3

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (180) hide show
  1. package/dist/full.js +177 -169
  2. package/dist/generated/manifest.d.ts +1 -1
  3. package/dist/generated/manifest.js +1 -1
  4. package/dist/generated/provider-loaders.js +8 -0
  5. package/dist/providers/abacus.d.ts +1 -1
  6. package/dist/providers/abacus.js +1 -1
  7. package/dist/providers/aiand.d.ts +1 -1
  8. package/dist/providers/aiand.js +1 -1
  9. package/dist/providers/aihubmix.d.ts +1 -1
  10. package/dist/providers/aihubmix.js +1 -1
  11. package/dist/providers/alibaba.d.ts +1 -1
  12. package/dist/providers/alibaba.js +1 -1
  13. package/dist/providers/alibaba_cn.js +1 -1
  14. package/dist/providers/alibaba_token_plan.d.ts +1 -1
  15. package/dist/providers/alibaba_token_plan.js +1 -1
  16. package/dist/providers/alibaba_token_plan_cn.d.ts +1 -1
  17. package/dist/providers/alibaba_token_plan_cn.js +1 -1
  18. package/dist/providers/amazon_bedrock.d.ts +1 -1
  19. package/dist/providers/amazon_bedrock.js +1 -1
  20. package/dist/providers/ambient.js +1 -1
  21. package/dist/providers/amd.d.ts +11 -0
  22. package/dist/providers/amd.js +5 -0
  23. package/dist/providers/anthropic.js +1 -1
  24. package/dist/providers/azure.d.ts +1 -1
  25. package/dist/providers/azure.js +1 -1
  26. package/dist/providers/azure_cognitive_services.d.ts +1 -1
  27. package/dist/providers/azure_cognitive_services.js +1 -1
  28. package/dist/providers/baseten.d.ts +1 -1
  29. package/dist/providers/baseten.js +1 -1
  30. package/dist/providers/berget.js +1 -1
  31. package/dist/providers/blueclaw.js +1 -1
  32. package/dist/providers/chutes.d.ts +1 -1
  33. package/dist/providers/chutes.js +1 -1
  34. package/dist/providers/clarifai.js +1 -1
  35. package/dist/providers/cloudferro_sherlock.js +1 -1
  36. package/dist/providers/cloudflare_ai_gateway.d.ts +1 -1
  37. package/dist/providers/cloudflare_ai_gateway.js +1 -1
  38. package/dist/providers/cloudflare_workers_ai.d.ts +1 -1
  39. package/dist/providers/cloudflare_workers_ai.js +1 -1
  40. package/dist/providers/coralbricks.d.ts +11 -0
  41. package/dist/providers/coralbricks.js +5 -0
  42. package/dist/providers/cortecs.d.ts +1 -1
  43. package/dist/providers/cortecs.js +1 -1
  44. package/dist/providers/crof.js +1 -1
  45. package/dist/providers/crossmodel.d.ts +1 -1
  46. package/dist/providers/crossmodel.js +1 -1
  47. package/dist/providers/crusoe.d.ts +11 -0
  48. package/dist/providers/crusoe.js +5 -0
  49. package/dist/providers/daoxe.js +1 -1
  50. package/dist/providers/deepinfra.d.ts +1 -1
  51. package/dist/providers/deepinfra.js +1 -1
  52. package/dist/providers/deepseek.js +1 -1
  53. package/dist/providers/digitalocean.d.ts +1 -1
  54. package/dist/providers/digitalocean.js +1 -1
  55. package/dist/providers/edenai.d.ts +11 -0
  56. package/dist/providers/edenai.js +5 -0
  57. package/dist/providers/empiriolabs.d.ts +1 -1
  58. package/dist/providers/empiriolabs.js +1 -1
  59. package/dist/providers/evroc.d.ts +1 -1
  60. package/dist/providers/evroc.js +1 -1
  61. package/dist/providers/fastrouter.js +1 -1
  62. package/dist/providers/fireworks_ai.d.ts +1 -1
  63. package/dist/providers/fireworks_ai.js +1 -1
  64. package/dist/providers/friendli.d.ts +1 -1
  65. package/dist/providers/friendli.js +1 -1
  66. package/dist/providers/github_copilot.d.ts +1 -1
  67. package/dist/providers/github_copilot.js +1 -1
  68. package/dist/providers/gmicloud.js +1 -1
  69. package/dist/providers/google.d.ts +1 -1
  70. package/dist/providers/google.js +1 -1
  71. package/dist/providers/google_vertex.d.ts +1 -1
  72. package/dist/providers/google_vertex.js +1 -1
  73. package/dist/providers/greenpt.js +1 -1
  74. package/dist/providers/groq.js +1 -1
  75. package/dist/providers/hetzner.d.ts +1 -1
  76. package/dist/providers/hetzner.js +1 -1
  77. package/dist/providers/huggingface.d.ts +1 -1
  78. package/dist/providers/huggingface.js +1 -1
  79. package/dist/providers/hyper.d.ts +1 -1
  80. package/dist/providers/hyper.js +1 -1
  81. package/dist/providers/impossibl.js +1 -1
  82. package/dist/providers/inceptron.d.ts +1 -1
  83. package/dist/providers/inceptron.js +1 -1
  84. package/dist/providers/inferx.d.ts +1 -1
  85. package/dist/providers/inferx.js +1 -1
  86. package/dist/providers/infomaniak.js +1 -1
  87. package/dist/providers/io_net.js +1 -1
  88. package/dist/providers/kenari.js +1 -1
  89. package/dist/providers/kilo.d.ts +1 -1
  90. package/dist/providers/kilo.js +1 -1
  91. package/dist/providers/llmgateway.d.ts +1 -1
  92. package/dist/providers/llmgateway.js +1 -1
  93. package/dist/providers/llmtr.d.ts +1 -1
  94. package/dist/providers/llmtr.js +1 -1
  95. package/dist/providers/lmstudio.js +1 -1
  96. package/dist/providers/meganova.js +1 -1
  97. package/dist/providers/merge_gateway.d.ts +1 -1
  98. package/dist/providers/merge_gateway.js +1 -1
  99. package/dist/providers/meta.d.ts +1 -1
  100. package/dist/providers/meta.js +1 -1
  101. package/dist/providers/modal.js +1 -1
  102. package/dist/providers/modelscope.js +1 -1
  103. package/dist/providers/nano_gpt.d.ts +1 -1
  104. package/dist/providers/nano_gpt.js +1 -1
  105. package/dist/providers/nearai.js +1 -1
  106. package/dist/providers/nebius.d.ts +1 -1
  107. package/dist/providers/nebius.js +1 -1
  108. package/dist/providers/neon.d.ts +1 -1
  109. package/dist/providers/neon.js +1 -1
  110. package/dist/providers/neuralwatt.d.ts +1 -1
  111. package/dist/providers/neuralwatt.js +1 -1
  112. package/dist/providers/novita_ai.js +1 -1
  113. package/dist/providers/nvidia.d.ts +1 -1
  114. package/dist/providers/nvidia.js +1 -1
  115. package/dist/providers/ofox.d.ts +1 -1
  116. package/dist/providers/ofox.js +1 -1
  117. package/dist/providers/opencode.d.ts +1 -1
  118. package/dist/providers/opencode.js +1 -1
  119. package/dist/providers/opencode_go.d.ts +1 -1
  120. package/dist/providers/opencode_go.js +1 -1
  121. package/dist/providers/openrouter.d.ts +1 -1
  122. package/dist/providers/openrouter.js +1 -1
  123. package/dist/providers/perplexity_agent.d.ts +1 -1
  124. package/dist/providers/perplexity_agent.js +1 -1
  125. package/dist/providers/pioneer.d.ts +1 -1
  126. package/dist/providers/pioneer.js +1 -1
  127. package/dist/providers/privatemode_ai.d.ts +1 -1
  128. package/dist/providers/privatemode_ai.js +1 -1
  129. package/dist/providers/regolo_ai.d.ts +1 -1
  130. package/dist/providers/regolo_ai.js +1 -1
  131. package/dist/providers/requesty.d.ts +1 -1
  132. package/dist/providers/requesty.js +1 -1
  133. package/dist/providers/runinfra.d.ts +11 -0
  134. package/dist/providers/runinfra.js +5 -0
  135. package/dist/providers/salad_cloud.d.ts +11 -0
  136. package/dist/providers/salad_cloud.js +5 -0
  137. package/dist/providers/scnet_token_plan.d.ts +11 -0
  138. package/dist/providers/scnet_token_plan.js +5 -0
  139. package/dist/providers/siliconflow.js +1 -1
  140. package/dist/providers/siliconflow_cn.js +1 -1
  141. package/dist/providers/snowflake_cortex.d.ts +1 -1
  142. package/dist/providers/snowflake_cortex.js +1 -1
  143. package/dist/providers/stackit.js +1 -1
  144. package/dist/providers/submodel.js +1 -1
  145. package/dist/providers/synthetic.js +1 -1
  146. package/dist/providers/tensorx.js +1 -1
  147. package/dist/providers/thinkingmachines.js +1 -1
  148. package/dist/providers/tinfoil.d.ts +1 -1
  149. package/dist/providers/tinfoil.js +1 -1
  150. package/dist/providers/togetherai.d.ts +1 -1
  151. package/dist/providers/togetherai.js +1 -1
  152. package/dist/providers/umans_ai.d.ts +1 -1
  153. package/dist/providers/umans_ai.js +1 -1
  154. package/dist/providers/umans_ai_coding_plan.d.ts +1 -1
  155. package/dist/providers/umans_ai_coding_plan.js +1 -1
  156. package/dist/providers/upstage.d.ts +1 -1
  157. package/dist/providers/upstage.js +1 -1
  158. package/dist/providers/venice.d.ts +1 -1
  159. package/dist/providers/venice.js +1 -1
  160. package/dist/providers/vercel.d.ts +1 -1
  161. package/dist/providers/vercel.js +1 -1
  162. package/dist/providers/vivgrid.d.ts +1 -1
  163. package/dist/providers/vivgrid.js +1 -1
  164. package/dist/providers/vultr.js +1 -1
  165. package/dist/providers/wandb.d.ts +1 -1
  166. package/dist/providers/wandb.js +1 -1
  167. package/dist/providers/watsonx.d.ts +11 -0
  168. package/dist/providers/watsonx.js +5 -0
  169. package/dist/providers/xai.d.ts +1 -1
  170. package/dist/providers/xai.js +1 -1
  171. package/dist/providers/zai_coding_plan.d.ts +1 -1
  172. package/dist/providers/zai_coding_plan.js +1 -1
  173. package/dist/providers/zeldoc.d.ts +1 -1
  174. package/dist/providers/zeldoc.js +1 -1
  175. package/dist/providers/zenmux.d.ts +1 -1
  176. package/dist/providers/zenmux.js +1 -1
  177. package/dist/providers/zhipuai_coding_plan.d.ts +1 -1
  178. package/dist/providers/zhipuai_coding_plan.js +1 -1
  179. package/dist/snapshot.js +352 -336
  180. package/package.json +2 -2
@@ -1,5 +1,5 @@
1
1
  import { createProviderCatalog } from "../provider.js";
2
2
 
3
- export const data = {"alias_of":null,"base_url":"https://go.fastrouter.ai/api/v1","catalog_only":true,"config_schema":null,"doc":"https://fastrouter.ai/models","env":["FASTROUTER_API_KEY"],"exclude_models":null,"extra":null,"id":"fastrouter","models":{"anthropic/claude-opus-4.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":1.5,"cache_write":18.75,"input":15,"output":75},"deprecated":false,"extra":{"attachment":true,"description":"Flagship Claude model for deep reasoning, coding, and long-horizon agents","family":"claude-opus","open_weights":false,"reasoning_options":[{"max":32000,"min":1024,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"anthropic/claude-opus-4.1","knowledge":"2025-03-31","last_updated":"2025-08-05","lifecycle":null,"limits":{"context":200000,"output":32000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.1","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"anthropic/claude-opus-4.8":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":5,"output":25},"deprecated":false,"extra":{"attachment":true,"description":"Top Claude Opus tier for the hardest reasoning, coding, and long-horizon agents","family":"claude-opus","open_weights":false,"reasoning_options":[{"max":32000,"min":1024,"type":"budget_tokens"}],"temperature":false},"family":null,"id":"anthropic/claude-opus-4.8","knowledge":"2026-01","last_updated":"2026-05-28","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.8","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-05-28","retired":false,"tags":null},"anthropic/claude-sonnet-4":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.3,"cache_write":3.75,"input":3,"output":15},"deprecated":false,"extra":{"attachment":true,"description":"Balanced Claude model for coding, analysis, agent workflows, and cost control","family":"claude-sonnet","open_weights":false,"reasoning_options":[{"max":32000,"min":1024,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"anthropic/claude-sonnet-4","knowledge":"2025-03-31","last_updated":"2025-05-22","lifecycle":null,"limits":{"context":200000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Sonnet 4","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-05-22","retired":false,"tags":null},"anthropic/claude-sonnet-4.6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":3,"output":15},"deprecated":false,"extra":{"attachment":true,"description":"Claude workhorse for coding agents, careful analysis, and production cost control","family":"claude-sonnet","open_weights":false,"reasoning_options":[{"max":32000,"min":1024,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"anthropic/claude-sonnet-4.6","knowledge":"2025-08-31","last_updated":"2026-03-13","lifecycle":null,"limits":{"context":1000000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Sonnet 4.6","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-02-17","retired":false,"tags":null},"bytedance/seedance-2":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Video model for prompt-guided generation, editing, and motion workflows","family":"seed","open_weights":false,"temperature":false},"family":null,"id":"bytedance/seedance-2","knowledge":null,"last_updated":"2026-04-01","lifecycle":null,"limits":{"context":4096},"modalities":{"input":["text","image"],"output":["video"]},"model":null,"name":"Seedance 2","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-01","retired":false,"tags":null},"deepseek-ai/deepseek-r1-distill-llama-70b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"text":true,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":{"input":0.03,"output":0.14},"deprecated":false,"extra":{"attachment":false,"description":"DeepSeek reasoning model for multi-step analysis, math, coding, and tools","family":"deepseek-thinking","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"deepseek-ai/deepseek-r1-distill-llama-70b","knowledge":"2024-10","last_updated":"2025-01-23","lifecycle":null,"limits":{"context":131072,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek R1 Distill Llama 70B","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-01-23","retired":false,"tags":null},"deepseek/deepseek-v4-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.74,"output":3.48},"deprecated":false,"extra":{"attachment":false,"description":"Open MoE flagship with million-token context for coding and long agent runs","family":"deepseek-thinking","open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"deepseek/deepseek-v4-pro","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Pro","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"google/gemini-2.5-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.0375,"input":0.3,"output":2.5},"deprecated":false,"extra":{"attachment":true,"description":"Fast Gemini model balancing multimodal reasoning, tool use, and cost","family":"gemini-flash","open_weights":false,"reasoning_options":[{"type":"toggle"},{"max":24576,"min":0,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"google/gemini-2.5-flash","knowledge":"2025-01","last_updated":"2025-06-17","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Gemini 2.5 Flash","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-06-17","retired":false,"tags":null},"google/gemini-2.5-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.31,"input":1.25,"output":10},"deprecated":false,"extra":{"attachment":true,"description":"Advanced Gemini model for complex reasoning, coding, and multimodal analysis","family":"gemini-pro","open_weights":false,"reasoning_options":[{"max":32768,"min":128,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"google/gemini-2.5-pro","knowledge":"2025-01","last_updated":"2025-06-17","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Gemini 2.5 Pro","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-06-17","retired":false,"tags":null},"google/gemini-3-pro-image-preview":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"text":true,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":{"input":2,"output":12},"deprecated":false,"extra":{"attachment":true,"description":"Nano Banana Pro for higher-fidelity image generation and design-heavy edits","family":"gemini-pro","open_weights":false,"reasoning_options":[],"temperature":true},"family":null,"id":"google/gemini-3-pro-image-preview","knowledge":"2025-01","last_updated":"2025-11-20","lifecycle":null,"limits":{"context":65536,"output":32768},"modalities":{"input":["text","image"],"output":["text","image"]},"model":null,"name":"Nano Banana Pro","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-11-20","retired":false,"tags":null},"google/gemini-3.1-flash-image-preview":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"text":true,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":{"input":0.5,"output":3},"deprecated":false,"extra":{"attachment":true,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"gemini-flash","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"google/gemini-3.1-flash-image-preview","knowledge":"2025-01","last_updated":"2026-02-26","lifecycle":null,"limits":{"context":65536,"output":65536},"modalities":{"input":["text","image","pdf"],"output":["text","image"]},"model":null,"name":"Nano Banana 2","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-02-26","retired":false,"tags":null},"google/gemini-3.1-pro-preview":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":2,"output":12},"deprecated":false,"extra":{"attachment":true,"description":"Reasoning-first Gemini preview for agentic coding and complex problem solving","family":"gemini-pro","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"google/gemini-3.1-pro-preview","knowledge":"2025-01","last_updated":"2026-02-19","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","video","audio","pdf"],"output":["text"]},"model":null,"name":"Gemini 3.1 Pro Preview","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-02-19","retired":false,"tags":null},"google/gemini-3.5-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.5,"output":9},"deprecated":false,"extra":{"attachment":true,"description":"Fast Gemini model balancing multimodal reasoning, tool use, and cost","family":"gemini-flash","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"google/gemini-3.5-flash","knowledge":"2025-01","last_updated":"2026-05-19","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","video","audio","pdf"],"output":["text"]},"model":null,"name":"Gemini 3.5 Flash","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-05-19","retired":false,"tags":null},"google/gemma-4-31b-it":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.13,"output":0.38},"deprecated":false,"extra":{"attachment":true,"description":"Largest Gemma 4 instruction model for open, self-hosted chat and reasoning","family":"gemma","open_weights":true,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"google/gemma-4-31b-it","knowledge":null,"last_updated":"2026-04-02","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Gemma 4 31B IT","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-02","retired":false,"tags":null},"google/imagen-4.0-fast":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":false,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"imagen","open_weights":false,"temperature":false},"family":null,"id":"google/imagen-4.0-fast","knowledge":null,"last_updated":"2025-05-20","lifecycle":null,"limits":{"context":480},"modalities":{"input":["text"],"output":["image"]},"model":null,"name":"Imagen 4 Fast","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-05-20","retired":false,"tags":null},"google/imagen-4.0-ultra":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":false,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"imagen","open_weights":false,"temperature":false},"family":null,"id":"google/imagen-4.0-ultra","knowledge":null,"last_updated":"2025-05-20","lifecycle":null,"limits":{"context":480},"modalities":{"input":["text"],"output":["image"]},"model":null,"name":"Imagen 4 Ultra","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-05-20","retired":false,"tags":null},"google/veo3.1":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Video model for prompt-guided generation, editing, and motion workflows","family":"veo","open_weights":false,"temperature":false},"family":null,"id":"google/veo3.1","knowledge":null,"last_updated":"2026-05-01","lifecycle":null,"limits":{"context":400000},"modalities":{"input":["text","image"],"output":["video"]},"model":null,"name":"Veo 3.1","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-05-01","retired":false,"tags":null},"google/veo3.1-fast":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Video model for prompt-guided generation, editing, and motion workflows","family":"veo","open_weights":false,"temperature":false},"family":null,"id":"google/veo3.1-fast","knowledge":null,"last_updated":"2026-05-01","lifecycle":null,"limits":{"context":400000},"modalities":{"input":["text","image"],"output":["video"]},"model":null,"name":"Veo 3.1 Fast","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-05-01","retired":false,"tags":null},"google/veo3.1-lite":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Video model for prompt-guided generation, editing, and motion workflows","family":"veo","open_weights":false,"temperature":false},"family":null,"id":"google/veo3.1-lite","knowledge":null,"last_updated":"2026-05-01","lifecycle":null,"limits":{"context":400000},"modalities":{"input":["text","image"],"output":["video"]},"model":null,"name":"Veo 3.1 Lite","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-05-01","retired":false,"tags":null},"leonardo-ai/lucid-origin":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"lucid","open_weights":false,"temperature":false},"family":null,"id":"leonardo-ai/lucid-origin","knowledge":null,"last_updated":"2025-06-01","lifecycle":null,"limits":{"context":4096},"modalities":{"input":["text","image"],"output":["image"]},"model":null,"name":"Lucid Origin","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-06-01","retired":false,"tags":null},"leonardo-ai/lucid-realism":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"lucid","open_weights":false,"temperature":false},"family":null,"id":"leonardo-ai/lucid-realism","knowledge":null,"last_updated":"2025-06-01","lifecycle":null,"limits":{"context":4096},"modalities":{"input":["text","image"],"output":["image"]},"model":null,"name":"Lucid Realism","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-06-01","retired":false,"tags":null},"minimax/minimax-m2.7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.3,"output":1.2},"deprecated":false,"extra":{"attachment":false,"description":"Open MiniMax flagship for coding agents, office automation, and complex environments","family":"minimax","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"minimax/minimax-m2.7","knowledge":null,"last_updated":"2026-03-18","lifecycle":null,"limits":{"context":204800,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax-M2.7","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-03-18","retired":false,"tags":null},"minimax/minimax-m2.7-highspeed":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.6,"output":2.4},"deprecated":false,"extra":{"attachment":false,"description":"Low-latency M2.7 variant for interactive coding plans and agent loops","family":"minimax","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"minimax/minimax-m2.7-highspeed","knowledge":null,"last_updated":"2026-03-18","lifecycle":null,"limits":{"context":204800,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax-M2.7-highspeed","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-03-18","retired":false,"tags":null},"moonshotai/kimi-k2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.55,"output":2.2},"deprecated":false,"extra":{"attachment":false,"description":"Kimi model for long-context chat, coding, and agentic reasoning","family":"kimi-k2","open_weights":true,"temperature":true},"family":null,"id":"moonshotai/kimi-k2","knowledge":"2024-10","last_updated":"2025-07-11","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Kimi K2","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-07-11","retired":false,"tags":null},"moonshotai/kimi-k2.6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.75,"output":3.5},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal Kimi workhorse for agent loops, coding tasks, and visual context","family":"kimi-k2","open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"moonshotai/kimi-k2.6","knowledge":"2025-01","last_updated":"2026-04-21","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K2.6","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-21","retired":false,"tags":null},"openai/gpt-4.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.5,"input":2,"output":8},"deprecated":false,"extra":{"attachment":true,"description":"Long-lived GPT workhorse for coding, instruction following, and production apps","family":"gpt","open_weights":false,"temperature":true},"family":null,"id":"openai/gpt-4.1","knowledge":"2024-04","last_updated":"2025-04-14","lifecycle":null,"limits":{"context":1047576,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-4.1","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-04-14","retired":false,"tags":null},"openai/gpt-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.125,"input":1.25,"output":10},"deprecated":false,"extra":{"attachment":true,"description":"GPT model for general reasoning, writing, coding, and tool-assisted tasks","family":"gpt","open_weights":false,"reasoning_options":[],"temperature":true},"family":null,"id":"openai/gpt-5","knowledge":"2024-10-01","last_updated":"2025-08-07","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-08-07","retired":false,"tags":null},"openai/gpt-5-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.025,"input":0.25,"output":2},"deprecated":false,"extra":{"attachment":true,"description":"Compact GPT model for low-latency assistance and high-volume workloads","family":"gpt-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"openai/gpt-5-mini","knowledge":"2024-10-01","last_updated":"2025-08-07","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5 Mini","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-08-07","retired":false,"tags":null},"openai/gpt-5-nano":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.005,"input":0.05,"output":0.4},"deprecated":false,"extra":{"attachment":true,"description":"Compact GPT model for low-latency assistance and high-volume workloads","family":"gpt-nano","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"openai/gpt-5-nano","knowledge":"2024-10-01","last_updated":"2025-08-07","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5 Nano","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-08-07","retired":false,"tags":null},"openai/gpt-5.3-codex":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.75,"output":14},"deprecated":false,"extra":{"attachment":true,"description":"Coding-optimized GPT model for repository edits, reviews, and agentic software work","family":"gpt-codex","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"openai/gpt-5.3-codex","knowledge":"2025-08-31","last_updated":"2026-02-05","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.3 Codex","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-02-05","retired":false,"tags":null},"openai/gpt-5.4-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.75,"output":4.5},"deprecated":false,"extra":{"attachment":true,"description":"Strong small GPT for coding subagents, quick tool use, and high-volume work","family":"gpt-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"openai/gpt-5.4-mini","knowledge":"2025-08-31","last_updated":"2026-03-17","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.4 mini","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-03-17","retired":false,"tags":null},"openai/gpt-5.4-nano":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.2,"output":1.25},"deprecated":false,"extra":{"attachment":true,"description":"Cheapest GPT-5.4 lane for simple routing, extraction, and bulk automation","family":"gpt-nano","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"openai/gpt-5.4-nano","knowledge":"2025-08-31","last_updated":"2026-03-17","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.4 nano","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-03-17","retired":false,"tags":null},"openai/gpt-5.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":5,"output":30},"deprecated":false,"extra":{"attachment":true,"description":"Default frontier GPT for coding, computer use, research, and knowledge work","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"openai/gpt-5.5","knowledge":"2025-12-01","last_updated":"2026-04-23","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.5","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-23","retired":false,"tags":null},"openai/gpt-5.5-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":30,"output":180},"deprecated":false,"extra":{"attachment":true,"description":"Highest-accuracy GPT-5.5 tier for slower, precision-heavy reasoning and coding","family":"gpt-pro","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"openai/gpt-5.5-pro","knowledge":"2025-12-01","last_updated":"2026-04-23","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.5 Pro","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-23","retired":false,"tags":null},"openai/gpt-image-2":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"gpt-image","open_weights":false,"temperature":true},"family":null,"id":"openai/gpt-image-2","knowledge":null,"last_updated":"2026-04-21","lifecycle":null,"limits":{"context":128000},"modalities":{"input":["text","image"],"output":["image"]},"model":null,"name":"GPT Image 2","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-21","retired":false,"tags":null},"openai/gpt-oss-120b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.15,"output":0.6},"deprecated":false,"extra":{"attachment":false,"description":"Open-weight GPT model for self-hosted reasoning and instruction-following workloads","family":"gpt-oss","llmfit":{"architecture":"gpt_oss","context_length":4194304,"discovered":true,"gguf_sources":[{"provider":"unsloth","repo":"unsloth/gpt-oss-120b-GGUF"},{"provider":"ggml-org","repo":"ggml-org/gpt-oss-120b-GGUF"}],"hf_downloads":4197649,"hf_likes":5069,"matched_hugging_face_id":"openai/gpt-oss-120b","memory":{"min_ram_gb":67.3,"min_vram_gb":61.7,"recommended_ram_gb":112.1},"model_id":"openai/gpt-oss-120b","moe":{"active_experts":4,"active_parameters":9595358141,"is_moe":true,"num_experts":128},"parameter_count":"120.4B","parameters_raw":120412337472,"pipeline_tag":"text-generation","provider":"openai","quantization":"Q4_K_M","release_date":"2025-08-04","source":"llmfit","use_case":"General purpose text generation"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"openai/gpt-oss-120b","knowledge":null,"last_updated":"2025-08-05","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT OSS 120B","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"openai/gpt-oss-20b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.05,"output":0.2},"deprecated":false,"extra":{"attachment":false,"description":"Open-weight GPT model for self-hosted reasoning and instruction-following workloads","family":"gpt-oss","llmfit":{"architecture":"gpt_oss","context_length":4194304,"discovered":true,"gguf_sources":[{"provider":"unsloth","repo":"unsloth/gpt-oss-20b-GGUF"},{"provider":"ggml-org","repo":"ggml-org/gpt-oss-20b-GGUF"},{"provider":"mradermacher","repo":"mradermacher/gpt-oss-20b-GGUF"}],"hf_downloads":8501701,"hf_likes":4869,"matched_hugging_face_id":"openai/gpt-oss-20b","memory":{"min_ram_gb":12.0,"min_vram_gb":11.0,"recommended_ram_gb":20.0},"model_id":"openai/gpt-oss-20b","moe":{"active_experts":4,"active_parameters":3630142231,"is_moe":true,"num_experts":32},"parameter_count":"21.5B","parameters_raw":21511953984,"pipeline_tag":"text-generation","provider":"openai","quantization":"Q4_K_M","release_date":"2025-08-04","source":"llmfit","use_case":"General purpose text generation"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"openai/gpt-oss-20b","knowledge":null,"last_updated":"2025-08-05","lifecycle":null,"limits":{"context":131072,"output":65536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT OSS 20B","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"openai/gpt-realtime-1.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":4,"output":16},"deprecated":false,"extra":{"attachment":true,"description":"Speech generation model for controllable voice, narration, and audio delivery","family":"gpt","open_weights":false,"temperature":true},"family":null,"id":"openai/gpt-realtime-1.5","knowledge":null,"last_updated":"2025-06-01","lifecycle":null,"limits":{"context":32000,"output":4096},"modalities":{"input":["text","audio","image"],"output":["text","audio"]},"model":null,"name":"GPT Realtime 1.5","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-06-01","retired":false,"tags":null},"qwen/qwen3-coder":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.3,"output":1.2},"deprecated":false,"extra":{"attachment":false,"description":"Qwen coding model for software agents, repository edits, and code reasoning","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen/qwen3-coder","knowledge":"2025-04","last_updated":"2025-07-23","lifecycle":null,"limits":{"context":262144,"output":66536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Coder","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-07-23","retired":false,"tags":null},"sarvam/sarvam-105b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.04,"output":0.16},"deprecated":false,"extra":{"attachment":false,"description":"Flagship Indian-language reasoning model for enterprise multilingual applications","family":"sarvam","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"sarvam/sarvam-105b","knowledge":null,"last_updated":"2025-09-01","lifecycle":null,"limits":{"context":131072,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Sarvam 105B","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-09-01","retired":false,"tags":null},"sarvam/sarvam-30b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.02,"output":0.1},"deprecated":false,"extra":{"attachment":false,"description":"Efficient Indian-language reasoning model for chat, coding, and multilingual work","family":"sarvam","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"sarvam/sarvam-30b","knowledge":null,"last_updated":"2026-02-18","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Sarvam 30B","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-02-18","retired":false,"tags":null},"wanx/wan-v2-6":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Video model for prompt-guided generation, editing, and motion workflows","open_weights":true,"temperature":false},"family":null,"id":"wanx/wan-v2-6","knowledge":null,"last_updated":"2025-12-01","lifecycle":null,"limits":{"context":400000},"modalities":{"input":["text","image"],"output":["video"]},"model":null,"name":"Wan 2.6","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-12-01","retired":false,"tags":null},"x-ai/grok-4":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.75,"cache_write":15,"input":3,"output":15},"deprecated":false,"extra":{"attachment":false,"description":"Grok model for agentic tool use, reasoning, coding, and live assistance","family":"grok","open_weights":false,"reasoning_options":[],"temperature":true},"family":null,"id":"x-ai/grok-4","knowledge":"2025-07","last_updated":"2025-07-09","lifecycle":null,"limits":{"context":256000,"output":64000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Grok 4","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-07-09","retired":false,"tags":null},"x-ai/grok-4.3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.25,"output":2.5},"deprecated":false,"extra":{"attachment":true,"description":"xAI's default Grok for chat, coding, agentic tools, and lower hallucination risk","family":"grok","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"x-ai/grok-4.3","knowledge":null,"last_updated":"2026-04-17","lifecycle":null,"limits":{"context":1000000,"output":30000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Grok 4.3","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null},"x-ai/grok-build-0.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1,"output":2},"deprecated":false,"extra":{"attachment":true,"description":"Fast Grok coding model tuned for agentic engineering and iterative edits","family":"grok-build","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"x-ai/grok-build-0.1","knowledge":null,"last_updated":"2026-04-16","lifecycle":null,"limits":{"context":256000,"output":256000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Grok Build 0.1","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-16","retired":false,"tags":null},"z-ai/glm-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.95,"output":3.15},"deprecated":false,"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"z-ai/glm-5","knowledge":null,"last_updated":"2026-02-11","lifecycle":null,"limits":{"context":204800,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-02-11","retired":false,"tags":null},"z-ai/glm-5.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.05,"output":3.5},"deprecated":false,"extra":{"attachment":false,"description":"Strong GLM coding model for agentic engineering, terminals, and repository generation","family":"glm","open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"z-ai/glm-5.1","knowledge":null,"last_updated":"2026-04-07","lifecycle":null,"limits":{"context":200000,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5.1","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-07","retired":false,"tags":null}},"name":"FastRouter","pricing_defaults":null};
3
+ export const data = {"alias_of":null,"base_url":"https://go.fastrouter.ai/api/v1","catalog_only":true,"config_schema":null,"doc":"https://fastrouter.ai/models","env":["FASTROUTER_API_KEY"],"exclude_models":null,"extra":null,"id":"fastrouter","models":{"anthropic/claude-opus-4.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":1.5,"cache_write":18.75,"input":15,"output":75},"deprecated":false,"extra":{"attachment":true,"description":"Flagship Claude model for deep reasoning, coding, and long-horizon agents","family":"claude-opus","open_weights":false,"reasoning_options":[{"max":32000,"min":1024,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"anthropic/claude-opus-4.1","knowledge":"2025-03-31","last_updated":"2025-08-05","lifecycle":null,"limits":{"context":200000,"output":32000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.1","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"anthropic/claude-opus-4.8":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":5,"output":25},"deprecated":false,"extra":{"attachment":true,"description":"Top Claude Opus tier for the hardest reasoning, coding, and long-horizon agents","family":"claude-opus","open_weights":false,"reasoning_options":[{"max":32000,"min":1024,"type":"budget_tokens"}],"temperature":false},"family":null,"id":"anthropic/claude-opus-4.8","knowledge":"2026-01","last_updated":"2026-05-28","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.8","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-05-28","retired":false,"tags":null},"anthropic/claude-sonnet-4":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.3,"cache_write":3.75,"input":3,"output":15},"deprecated":false,"extra":{"attachment":true,"description":"Balanced Claude model for coding, analysis, agent workflows, and cost control","family":"claude-sonnet","open_weights":false,"reasoning_options":[{"max":32000,"min":1024,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"anthropic/claude-sonnet-4","knowledge":"2025-03-31","last_updated":"2025-05-22","lifecycle":null,"limits":{"context":200000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Sonnet 4","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-05-22","retired":false,"tags":null},"anthropic/claude-sonnet-4.6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":3,"output":15},"deprecated":false,"extra":{"attachment":true,"description":"Claude workhorse for coding agents, careful analysis, and production cost control","family":"claude-sonnet","open_weights":false,"reasoning_options":[{"max":32000,"min":1024,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"anthropic/claude-sonnet-4.6","knowledge":"2025-08-31","last_updated":"2026-03-13","lifecycle":null,"limits":{"context":1000000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Sonnet 4.6","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-02-17","retired":false,"tags":null},"bytedance/seedance-2":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Video model for prompt-guided generation, editing, and motion workflows","family":"seed","open_weights":false,"temperature":false},"family":null,"id":"bytedance/seedance-2","knowledge":null,"last_updated":"2026-04-01","lifecycle":null,"limits":{"context":4096},"modalities":{"input":["text","image"],"output":["video"]},"model":null,"name":"Seedance 2","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-01","retired":false,"tags":null},"deepseek-ai/deepseek-r1-distill-llama-70b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"text":true,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":{"input":0.03,"output":0.14},"deprecated":false,"extra":{"attachment":false,"description":"DeepSeek reasoning model for multi-step analysis, math, coding, and tools","family":"deepseek-thinking","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"deepseek-ai/deepseek-r1-distill-llama-70b","knowledge":"2024-10","last_updated":"2025-01-23","lifecycle":null,"limits":{"context":131072,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek R1 Distill Llama 70B","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-01-23","retired":false,"tags":null},"deepseek/deepseek-v4-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.74,"output":3.48},"deprecated":false,"extra":{"attachment":false,"description":"Open MoE flagship with million-token context for coding and long agent runs","family":"deepseek-thinking","open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"deepseek/deepseek-v4-pro","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Pro","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"google/gemini-2.5-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.0375,"input":0.3,"output":2.5},"deprecated":false,"extra":{"attachment":true,"description":"Fast Gemini model balancing multimodal reasoning, tool use, and cost","family":"gemini-flash","open_weights":false,"reasoning_options":[{"type":"toggle"},{"max":24576,"min":0,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"google/gemini-2.5-flash","knowledge":"2025-01","last_updated":"2025-06-17","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Gemini 2.5 Flash","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-06-17","retired":false,"tags":null},"google/gemini-2.5-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.31,"input":1.25,"output":10},"deprecated":false,"extra":{"attachment":true,"description":"Advanced Gemini model for complex reasoning, coding, and multimodal analysis","family":"gemini-pro","open_weights":false,"reasoning_options":[{"max":32768,"min":128,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"google/gemini-2.5-pro","knowledge":"2025-01","last_updated":"2025-06-17","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Gemini 2.5 Pro","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-06-17","retired":false,"tags":null},"google/gemini-3-pro-image-preview":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"text":true,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":{"input":2,"output":12},"deprecated":false,"extra":{"attachment":true,"description":"Nano Banana Pro for higher-fidelity image generation and design-heavy edits","family":"gemini-pro","open_weights":false,"reasoning_options":[],"temperature":true},"family":null,"id":"google/gemini-3-pro-image-preview","knowledge":"2025-01","last_updated":"2025-11-20","lifecycle":null,"limits":{"context":65536,"output":32768},"modalities":{"input":["text","image"],"output":["text","image"]},"model":null,"name":"Nano Banana Pro","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-11-20","retired":false,"tags":null},"google/gemini-3.1-flash-image-preview":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"text":true,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":{"input":0.5,"output":3},"deprecated":false,"extra":{"attachment":true,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"gemini-flash","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"google/gemini-3.1-flash-image-preview","knowledge":"2025-01","last_updated":"2026-02-26","lifecycle":null,"limits":{"context":65536,"output":65536},"modalities":{"input":["text","image","pdf"],"output":["text","image"]},"model":null,"name":"Nano Banana 2","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-02-26","retired":false,"tags":null},"google/gemini-3.1-pro-preview":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":2,"output":12},"deprecated":false,"extra":{"attachment":true,"description":"Reasoning-first Gemini preview for agentic coding and complex problem solving","family":"gemini-pro","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"google/gemini-3.1-pro-preview","knowledge":"2025-01","last_updated":"2026-02-19","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","video","audio","pdf"],"output":["text"]},"model":null,"name":"Gemini 3.1 Pro Preview","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-02-19","retired":false,"tags":null},"google/gemini-3.5-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.5,"output":9},"deprecated":false,"extra":{"attachment":true,"description":"Fast Gemini model balancing multimodal reasoning, tool use, and cost","family":"gemini-flash","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"google/gemini-3.5-flash","knowledge":"2025-01","last_updated":"2026-05-19","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","video","audio","pdf"],"output":["text"]},"model":null,"name":"Gemini 3.5 Flash","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-05-19","retired":false,"tags":null},"google/gemma-4-31b-it":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.13,"output":0.38},"deprecated":false,"extra":{"attachment":true,"description":"Largest Gemma 4 instruction model for open, self-hosted chat and reasoning","family":"gemma","open_weights":true,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"google/gemma-4-31b-it","knowledge":null,"last_updated":"2026-04-02","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Gemma 4 31B IT","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-02","retired":false,"tags":null},"google/imagen-4.0-fast":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":false,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"imagen","open_weights":false,"temperature":false},"family":null,"id":"google/imagen-4.0-fast","knowledge":null,"last_updated":"2025-05-20","lifecycle":null,"limits":{"context":480},"modalities":{"input":["text"],"output":["image"]},"model":null,"name":"Imagen 4 Fast","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-05-20","retired":false,"tags":null},"google/imagen-4.0-ultra":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":false,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"imagen","open_weights":false,"temperature":false},"family":null,"id":"google/imagen-4.0-ultra","knowledge":null,"last_updated":"2025-05-20","lifecycle":null,"limits":{"context":480},"modalities":{"input":["text"],"output":["image"]},"model":null,"name":"Imagen 4 Ultra","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-05-20","retired":false,"tags":null},"google/veo3.1":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Video model for prompt-guided generation, editing, and motion workflows","family":"veo","open_weights":false,"temperature":false},"family":null,"id":"google/veo3.1","knowledge":null,"last_updated":"2026-05-01","lifecycle":null,"limits":{"context":400000},"modalities":{"input":["text","image"],"output":["video"]},"model":null,"name":"Veo 3.1","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-05-01","retired":false,"tags":null},"google/veo3.1-fast":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Video model for prompt-guided generation, editing, and motion workflows","family":"veo","open_weights":false,"temperature":false},"family":null,"id":"google/veo3.1-fast","knowledge":null,"last_updated":"2026-05-01","lifecycle":null,"limits":{"context":400000},"modalities":{"input":["text","image"],"output":["video"]},"model":null,"name":"Veo 3.1 Fast","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-05-01","retired":false,"tags":null},"google/veo3.1-lite":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Video model for prompt-guided generation, editing, and motion workflows","family":"veo","open_weights":false,"temperature":false},"family":null,"id":"google/veo3.1-lite","knowledge":null,"last_updated":"2026-05-01","lifecycle":null,"limits":{"context":400000},"modalities":{"input":["text","image"],"output":["video"]},"model":null,"name":"Veo 3.1 Lite","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-05-01","retired":false,"tags":null},"leonardo-ai/lucid-origin":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"lucid","open_weights":false,"temperature":false},"family":null,"id":"leonardo-ai/lucid-origin","knowledge":null,"last_updated":"2025-06-01","lifecycle":null,"limits":{"context":4096},"modalities":{"input":["text","image"],"output":["image"]},"model":null,"name":"Lucid Origin","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-06-01","retired":false,"tags":null},"leonardo-ai/lucid-realism":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"lucid","open_weights":false,"temperature":false},"family":null,"id":"leonardo-ai/lucid-realism","knowledge":null,"last_updated":"2025-06-01","lifecycle":null,"limits":{"context":4096},"modalities":{"input":["text","image"],"output":["image"]},"model":null,"name":"Lucid Realism","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-06-01","retired":false,"tags":null},"minimax/minimax-m2.7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.3,"output":1.2},"deprecated":false,"extra":{"attachment":false,"description":"Open MiniMax flagship for coding agents, office automation, and complex environments","family":"minimax","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"minimax/minimax-m2.7","knowledge":null,"last_updated":"2026-03-18","lifecycle":null,"limits":{"context":204800,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax-M2.7","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-03-18","retired":false,"tags":null},"minimax/minimax-m2.7-highspeed":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.6,"output":2.4},"deprecated":false,"extra":{"attachment":false,"description":"Low-latency M2.7 variant for interactive coding plans and agent loops","family":"minimax","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"minimax/minimax-m2.7-highspeed","knowledge":null,"last_updated":"2026-03-18","lifecycle":null,"limits":{"context":204800,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax-M2.7-highspeed","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-03-18","retired":false,"tags":null},"moonshotai/kimi-k2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.55,"output":2.2},"deprecated":false,"extra":{"attachment":false,"description":"Kimi model for long-context chat, coding, and agentic reasoning","family":"kimi-k2","open_weights":true,"temperature":true},"family":null,"id":"moonshotai/kimi-k2","knowledge":"2024-10","last_updated":"2025-07-11","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Kimi K2","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-07-11","retired":false,"tags":null},"moonshotai/kimi-k2.6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.75,"output":3.5},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal Kimi workhorse for agent loops, coding tasks, and visual context","family":"kimi-k2","open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"moonshotai/kimi-k2.6","knowledge":"2025-01","last_updated":"2026-04-21","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K2.6","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-21","retired":false,"tags":null},"openai/gpt-4.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.5,"input":2,"output":8},"deprecated":false,"extra":{"attachment":true,"description":"Long-lived GPT workhorse for coding, instruction following, and production apps","family":"gpt","open_weights":false,"temperature":true},"family":null,"id":"openai/gpt-4.1","knowledge":"2024-04","last_updated":"2025-04-14","lifecycle":null,"limits":{"context":1047576,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-4.1","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-04-14","retired":false,"tags":null},"openai/gpt-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.125,"input":1.25,"output":10},"deprecated":false,"extra":{"attachment":true,"description":"GPT model for general reasoning, writing, coding, and tool-assisted tasks","family":"gpt","open_weights":false,"reasoning_options":[],"temperature":true},"family":null,"id":"openai/gpt-5","knowledge":"2024-10-01","last_updated":"2025-08-07","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-08-07","retired":false,"tags":null},"openai/gpt-5-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.025,"input":0.25,"output":2},"deprecated":false,"extra":{"attachment":true,"description":"Compact GPT model for low-latency assistance and high-volume workloads","family":"gpt-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"openai/gpt-5-mini","knowledge":"2024-10-01","last_updated":"2025-08-07","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5 Mini","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-08-07","retired":false,"tags":null},"openai/gpt-5-nano":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.005,"input":0.05,"output":0.4},"deprecated":false,"extra":{"attachment":true,"description":"Compact GPT model for low-latency assistance and high-volume workloads","family":"gpt-nano","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"openai/gpt-5-nano","knowledge":"2024-10-01","last_updated":"2025-08-07","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5 Nano","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-08-07","retired":false,"tags":null},"openai/gpt-5.3-codex":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.75,"output":14},"deprecated":false,"extra":{"attachment":true,"description":"Coding-optimized GPT model for repository edits, reviews, and agentic software work","family":"gpt-codex","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"openai/gpt-5.3-codex","knowledge":"2025-08-31","last_updated":"2026-02-05","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.3 Codex","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-02-05","retired":false,"tags":null},"openai/gpt-5.4-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.75,"output":4.5},"deprecated":false,"extra":{"attachment":true,"description":"Strong small GPT for coding subagents, quick tool use, and high-volume work","family":"gpt-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"openai/gpt-5.4-mini","knowledge":"2025-08-31","last_updated":"2026-03-17","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.4 mini","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-03-17","retired":false,"tags":null},"openai/gpt-5.4-nano":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.2,"output":1.25},"deprecated":false,"extra":{"attachment":true,"description":"Cheapest GPT-5.4 lane for simple routing, extraction, and bulk automation","family":"gpt-nano","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"openai/gpt-5.4-nano","knowledge":"2025-08-31","last_updated":"2026-03-17","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.4 nano","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-03-17","retired":false,"tags":null},"openai/gpt-5.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":5,"output":30},"deprecated":false,"extra":{"attachment":true,"description":"Default frontier GPT for coding, computer use, research, and knowledge work","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"openai/gpt-5.5","knowledge":"2025-12-01","last_updated":"2026-04-23","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.5","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-23","retired":false,"tags":null},"openai/gpt-5.5-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":30,"output":180},"deprecated":false,"extra":{"attachment":true,"description":"Highest-accuracy GPT-5.5 tier for slower, precision-heavy reasoning and coding","family":"gpt-pro","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"openai/gpt-5.5-pro","knowledge":"2025-12-01","last_updated":"2026-04-23","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.5 Pro","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-23","retired":false,"tags":null},"openai/gpt-image-2":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"gpt-image","open_weights":false,"temperature":true},"family":null,"id":"openai/gpt-image-2","knowledge":null,"last_updated":"2026-04-21","lifecycle":null,"limits":{"context":128000},"modalities":{"input":["text","image"],"output":["image"]},"model":null,"name":"GPT Image 2","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-21","retired":false,"tags":null},"openai/gpt-oss-120b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.15,"output":0.6},"deprecated":false,"extra":{"attachment":false,"description":"Open-weight GPT model for self-hosted reasoning and instruction-following workloads","family":"gpt-oss","llmfit":{"architecture":"gpt_oss","context_length":4194304,"discovered":true,"gguf_sources":[{"provider":"unsloth","repo":"unsloth/gpt-oss-120b-GGUF"},{"provider":"ggml-org","repo":"ggml-org/gpt-oss-120b-GGUF"}],"hf_downloads":4479205,"hf_likes":5106,"matched_hugging_face_id":"openai/gpt-oss-120b","memory":{"min_ram_gb":65.3,"min_vram_gb":59.8,"recommended_ram_gb":108.8},"model_id":"openai/gpt-oss-120b","moe":{"active_experts":4,"active_parameters":9309823421,"is_moe":true,"num_experts":128},"parameter_count":"116.8B","parameters_raw":116829156672,"pipeline_tag":"text-generation","provider":"openai","quantization":"Q4_K_M","release_date":"2025-08-04","source":"llmfit","use_case":"General purpose text generation"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"openai/gpt-oss-120b","knowledge":null,"last_updated":"2025-08-05","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT OSS 120B","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"openai/gpt-oss-20b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.05,"output":0.2},"deprecated":false,"extra":{"attachment":false,"description":"Open-weight GPT model for self-hosted reasoning and instruction-following workloads","family":"gpt-oss","llmfit":{"architecture":"gpt_oss","context_length":4194304,"discovered":true,"gguf_sources":[{"provider":"unsloth","repo":"unsloth/gpt-oss-20b-GGUF"},{"provider":"ggml-org","repo":"ggml-org/gpt-oss-20b-GGUF"},{"provider":"mradermacher","repo":"mradermacher/gpt-oss-20b-GGUF"}],"hf_downloads":7966494,"hf_likes":4923,"matched_hugging_face_id":"openai/gpt-oss-20b","memory":{"min_ram_gb":12.0,"min_vram_gb":11.0,"recommended_ram_gb":20.0},"model_id":"openai/gpt-oss-20b","moe":{"active_experts":4,"active_parameters":3630142231,"is_moe":true,"num_experts":32},"parameter_count":"21.5B","parameters_raw":21511953984,"pipeline_tag":"text-generation","provider":"openai","quantization":"Q4_K_M","release_date":"2025-08-04","source":"llmfit","use_case":"General purpose text generation"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"openai/gpt-oss-20b","knowledge":null,"last_updated":"2025-08-05","lifecycle":null,"limits":{"context":131072,"output":65536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT OSS 20B","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"openai/gpt-realtime-1.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":4,"output":16},"deprecated":false,"extra":{"attachment":true,"description":"Speech generation model for controllable voice, narration, and audio delivery","family":"gpt","open_weights":false,"temperature":true},"family":null,"id":"openai/gpt-realtime-1.5","knowledge":null,"last_updated":"2025-06-01","lifecycle":null,"limits":{"context":32000,"output":4096},"modalities":{"input":["text","audio","image"],"output":["text","audio"]},"model":null,"name":"GPT Realtime 1.5","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-06-01","retired":false,"tags":null},"qwen/qwen3-coder":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.3,"output":1.2},"deprecated":false,"extra":{"attachment":false,"description":"Qwen coding model for software agents, repository edits, and code reasoning","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen/qwen3-coder","knowledge":"2025-04","last_updated":"2025-07-23","lifecycle":null,"limits":{"context":262144,"output":66536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Coder","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-07-23","retired":false,"tags":null},"sarvam/sarvam-105b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.04,"output":0.16},"deprecated":false,"extra":{"attachment":false,"description":"Flagship Indian-language reasoning model for enterprise multilingual applications","family":"sarvam","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"sarvam/sarvam-105b","knowledge":null,"last_updated":"2025-09-01","lifecycle":null,"limits":{"context":131072,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Sarvam 105B","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-09-01","retired":false,"tags":null},"sarvam/sarvam-30b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.02,"output":0.1},"deprecated":false,"extra":{"attachment":false,"description":"Efficient Indian-language reasoning model for chat, coding, and multilingual work","family":"sarvam","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"sarvam/sarvam-30b","knowledge":null,"last_updated":"2026-02-18","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Sarvam 30B","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-02-18","retired":false,"tags":null},"wanx/wan-v2-6":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":true,"description":"Video model for prompt-guided generation, editing, and motion workflows","open_weights":true,"temperature":false},"family":null,"id":"wanx/wan-v2-6","knowledge":null,"last_updated":"2025-12-01","lifecycle":null,"limits":{"context":400000},"modalities":{"input":["text","image"],"output":["video"]},"model":null,"name":"Wan 2.6","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-12-01","retired":false,"tags":null},"x-ai/grok-4":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.75,"cache_write":15,"input":3,"output":15},"deprecated":false,"extra":{"attachment":false,"description":"Grok model for agentic tool use, reasoning, coding, and live assistance","family":"grok","open_weights":false,"reasoning_options":[],"temperature":true},"family":null,"id":"x-ai/grok-4","knowledge":"2025-07","last_updated":"2025-07-09","lifecycle":null,"limits":{"context":256000,"output":64000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Grok 4","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2025-07-09","retired":false,"tags":null},"x-ai/grok-4.3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.25,"output":2.5},"deprecated":false,"extra":{"attachment":true,"description":"xAI's default Grok for chat, coding, agentic tools, and lower hallucination risk","family":"grok","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"x-ai/grok-4.3","knowledge":null,"last_updated":"2026-04-17","lifecycle":null,"limits":{"context":1000000,"output":30000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Grok 4.3","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null},"x-ai/grok-build-0.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1,"output":2},"deprecated":false,"extra":{"attachment":true,"description":"Fast Grok coding model tuned for agentic engineering and iterative edits","family":"grok-build","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"x-ai/grok-build-0.1","knowledge":null,"last_updated":"2026-04-16","lifecycle":null,"limits":{"context":256000,"output":256000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Grok Build 0.1","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-16","retired":false,"tags":null},"z-ai/glm-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.95,"output":3.15},"deprecated":false,"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"z-ai/glm-5","knowledge":null,"last_updated":"2026-02-11","lifecycle":null,"limits":{"context":204800,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-02-11","retired":false,"tags":null},"z-ai/glm-5.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.05,"output":3.5},"deprecated":false,"extra":{"attachment":false,"description":"Strong GLM coding model for agentic engineering, terminals, and repository generation","family":"glm","open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"z-ai/glm-5.1","knowledge":null,"last_updated":"2026-04-07","lifecycle":null,"limits":{"context":200000,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5.1","pricing":null,"provider":"fastrouter","provider_model_id":null,"release_date":"2026-04-07","retired":false,"tags":null}},"name":"FastRouter","pricing_defaults":null};
4
4
  const provider = /* @__PURE__ */ createProviderCatalog(data);
5
5
  export default provider;
@@ -6,6 +6,6 @@ import type {
6
6
  export declare const data: Provider;
7
7
  declare const provider: ProviderCatalog<
8
8
  "fireworks_ai",
9
- "accounts/fireworks/models/deepseek-v4-flash" | "accounts/fireworks/models/deepseek-v4-flash-0731" | "accounts/fireworks/models/deepseek-v4-pro" | "accounts/fireworks/models/glm-5p2" | "accounts/fireworks/models/gpt-oss-120b" | "accounts/fireworks/models/gpt-oss-20b" | "accounts/fireworks/models/kimi-k2p6" | "accounts/fireworks/models/kimi-k2p7-code" | "accounts/fireworks/models/kimi-k3" | "accounts/fireworks/models/minimax-m2p7" | "accounts/fireworks/models/minimax-m3" | "accounts/fireworks/models/qwen3p7-plus" | "accounts/fireworks/routers/glm-5p2-fast" | "accounts/fireworks/routers/kimi-k2p6-fast" | "accounts/fireworks/routers/kimi-k2p6-turbo" | "accounts/fireworks/routers/kimi-k2p7-code-fast" | "accounts/fireworks/routers/kimi-k3-fast"
9
+ "accounts/fireworks/models/deepseek-v4-flash" | "accounts/fireworks/models/deepseek-v4-flash-0731" | "accounts/fireworks/models/deepseek-v4-pro" | "accounts/fireworks/models/deepseek-v4-pro-0813" | "accounts/fireworks/models/glm-5p2" | "accounts/fireworks/models/gpt-oss-120b" | "accounts/fireworks/models/gpt-oss-20b" | "accounts/fireworks/models/inkling" | "accounts/fireworks/models/kimi-k2p6" | "accounts/fireworks/models/kimi-k2p7-code" | "accounts/fireworks/models/kimi-k3" | "accounts/fireworks/models/minimax-m2p7" | "accounts/fireworks/models/minimax-m3" | "accounts/fireworks/models/muse-glimmer-30b" | "accounts/fireworks/models/nemotron-3-ultra-nvfp4" | "accounts/fireworks/models/nemotron-lightning-3p5-30b-a3b" | "accounts/fireworks/models/qwen3p7-plus" | "accounts/fireworks/models/qwen3p8-max" | "accounts/fireworks/routers/glm-5p2-fast" | "accounts/fireworks/routers/kimi-k2p6-fast" | "accounts/fireworks/routers/kimi-k2p6-turbo" | "accounts/fireworks/routers/kimi-k2p7-code-fast" | "accounts/fireworks/routers/kimi-k3-fast"
10
10
  >;
11
11
  export default provider;
@@ -1,5 +1,5 @@
1
1
  import { createProviderCatalog } from "../provider.js";
2
2
 
3
- export const data = {"alias_of":null,"base_url":"https://api.fireworks.ai/inference/v1","config_schema":null,"doc":"https://fireworks.ai/docs/","env":["FIREWORKS_API_KEY"],"exclude_models":null,"extra":null,"id":"fireworks_ai","models":{"accounts/fireworks/models/deepseek-v4-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.028,"input":0.14,"output":0.28},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Fast DeepSeek V4 lane for economical reasoning, coding, and long-context work","family":"deepseek-flash","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["high","max"]}],"structured_output":true,"temperature":true},"family":null,"id":"accounts/fireworks/models/deepseek-v4-flash","knowledge":"2025-05","last_updated":"2026-06-16","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Flash","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"accounts/fireworks/models/deepseek-v4-flash-0731":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.028,"input":0.14,"output":0.28},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Official DeepSeek V4 Flash release with enhanced agentic capabilities and integrated DSpark speculative decoding","family":"deepseek-flash","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","high","max"]}],"structured_output":true,"temperature":true},"family":null,"id":"accounts/fireworks/models/deepseek-v4-flash-0731","knowledge":"2025-05","last_updated":"2026-07-31","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Flash 0731","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-07-31","retired":false,"tags":null},"accounts/fireworks/models/deepseek-v4-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.145,"input":1.74,"output":3.48},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open MoE flagship with million-token context for coding and long agent runs","family":"deepseek-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["high","max"]}],"structured_output":true,"temperature":true},"family":null,"id":"accounts/fireworks/models/deepseek-v4-pro","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Pro","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"accounts/fireworks/models/glm-5p2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.14,"input":1.4,"output":4.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["high","max"]}],"temperature":true},"family":null,"id":"accounts/fireworks/models/glm-5p2","knowledge":null,"last_updated":"2026-06-16","lifecycle":null,"limits":{"context":1048575,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM 5.2","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-16","retired":false,"tags":null},"accounts/fireworks/models/gpt-oss-120b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.015,"input":0.15,"output":0.6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open-weight GPT model for self-hosted reasoning and instruction-following workloads","family":"gpt-oss","open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"accounts/fireworks/models/gpt-oss-120b","knowledge":null,"last_updated":"2026-06-16","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT OSS 120B","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"accounts/fireworks/models/gpt-oss-20b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.035,"input":0.07,"output":0.3},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open-weight GPT model for self-hosted reasoning and instruction-following workloads","family":"gpt-oss","open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"accounts/fireworks/models/gpt-oss-20b","knowledge":null,"last_updated":"2025-08-05","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT OSS 20B","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"accounts/fireworks/models/kimi-k2p6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.16,"input":0.95,"output":4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Kimi reasoning model for long-horizon research, planning, and tool use","family":"kimi-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"accounts/fireworks/models/kimi-k2p6","knowledge":null,"last_updated":"2026-04-17","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.6","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null},"accounts/fireworks/models/kimi-k2p7-code":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.19,"input":0.95,"output":4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Kimi coding model for software agents, refactors, and repository reasoning","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"accounts/fireworks/models/kimi-k2p7-code","knowledge":null,"last_updated":"2026-06-16","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.7 Code","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"accounts/fireworks/models/kimi-k3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.3,"input":3,"output":15},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Multimodal Kimi model with 1M context and toggleable max-effort thinking for long-horizon agent work","family":"kimi-k3","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","max"]},{"min":1024,"type":"budget_tokens"}],"structured_output":true,"temperature":false},"family":null,"id":"accounts/fireworks/models/kimi-k3","knowledge":null,"last_updated":"2026-07-27","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K3","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-07-27","retired":false,"tags":null},"accounts/fireworks/models/minimax-m2p7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.06,"input":0.3,"output":1.2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"MiniMax model for chat, coding, office work, and agentic tasks","family":"minimax","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"accounts/fireworks/models/minimax-m2p7","knowledge":null,"last_updated":"2026-04-12","lifecycle":null,"limits":{"context":196608,"output":196608},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax-M2.7","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-04-12","retired":false,"tags":null},"accounts/fireworks/models/minimax-m3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.06,"input":0.3,"output":1.2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"MiniMax multimodal coding model for long-context reasoning and agent tasks","family":"minimax","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"accounts/fireworks/models/minimax-m3","knowledge":null,"last_updated":"2026-06-12","lifecycle":null,"limits":{"context":512000,"output":512000},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"MiniMax-M3","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"accounts/fireworks/models/qwen3p7-plus":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.08,"input":0.4,"output":1.6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high"]},{"min":1,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"accounts/fireworks/models/qwen3p7-plus","knowledge":null,"last_updated":"2026-06-12","lifecycle":null,"limits":{"context":262144,"output":65536},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen 3.7 Plus","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"accounts/fireworks/routers/glm-5p2-fast":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.21,"input":2.1,"output":6.6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Efficient GLM model for fast reasoning, coding, and agent workflows","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["high","max"]}],"temperature":true},"family":null,"id":"accounts/fireworks/routers/glm-5p2-fast","knowledge":null,"last_updated":"2026-06-26","lifecycle":null,"limits":{"context":1048575,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM 5.2 Fast","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-26","retired":false,"tags":null},"accounts/fireworks/routers/kimi-k2p6-fast":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.3,"input":2,"output":8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Kimi reasoning model for long-horizon research, planning, and tool use","family":"kimi-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"accounts/fireworks/routers/kimi-k2p6-fast","knowledge":null,"last_updated":"2026-06-05","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.6 Fast","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null},"accounts/fireworks/routers/kimi-k2p6-turbo":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.3,"input":2,"output":8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Kimi reasoning model for long-horizon research, planning, and tool use","family":"kimi-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"accounts/fireworks/routers/kimi-k2p6-turbo","knowledge":null,"last_updated":"2026-04-17","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.6 Turbo","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null},"accounts/fireworks/routers/kimi-k2p7-code-fast":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.38,"input":1.9,"output":8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Kimi coding model for software agents, refactors, and repository reasoning","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"accounts/fireworks/routers/kimi-k2p7-code-fast","knowledge":null,"last_updated":"2026-06-16","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.7 Code Fast","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"accounts/fireworks/routers/kimi-k3-fast":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.45,"input":4.5,"output":22.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Multimodal Kimi model with 1M context and toggleable max-effort thinking for long-horizon agent work","family":"kimi-k3","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","max"]},{"min":1024,"type":"budget_tokens"}],"structured_output":true,"temperature":false},"family":null,"id":"accounts/fireworks/routers/kimi-k3-fast","knowledge":null,"last_updated":"2026-07-27","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K3 Fast","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-07-27","retired":false,"tags":null}},"name":"Fireworks AI","pricing_defaults":null,"runtime":{"auth":{"env":["FIREWORKS_API_KEY"],"headers":[],"type":"bearer"},"base_url":"https://api.fireworks.ai/inference/v1","config_schema":null,"default_headers":{},"default_query":{},"doc_url":"https://fireworks.ai/docs/"}};
3
+ export const data = {"alias_of":null,"base_url":"https://api.fireworks.ai/inference/v1","config_schema":null,"doc":"https://fireworks.ai/docs/","env":["FIREWORKS_API_KEY"],"exclude_models":null,"extra":null,"id":"fireworks_ai","models":{"accounts/fireworks/models/deepseek-v4-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.028,"input":0.14,"output":0.28},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Fast DeepSeek V4 lane for economical reasoning, coding, and long-context work","family":"deepseek-flash","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["high","max"]}],"structured_output":true,"temperature":true},"family":null,"id":"accounts/fireworks/models/deepseek-v4-flash","knowledge":"2025-05","last_updated":"2026-06-16","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Flash","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"accounts/fireworks/models/deepseek-v4-flash-0731":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.028,"input":0.14,"output":0.28},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Official DeepSeek V4 Flash release with enhanced agentic capabilities and integrated DSpark speculative decoding","family":"deepseek-flash","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","high","max"]}],"structured_output":true,"temperature":true},"family":null,"id":"accounts/fireworks/models/deepseek-v4-flash-0731","knowledge":"2025-05","last_updated":"2026-07-31","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Flash 0731","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-07-31","retired":false,"tags":null},"accounts/fireworks/models/deepseek-v4-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.145,"input":1.74,"output":3.48},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open MoE flagship with million-token context for coding and long agent runs","family":"deepseek-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["high","max"]}],"structured_output":true,"temperature":true},"family":null,"id":"accounts/fireworks/models/deepseek-v4-pro","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Pro","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"accounts/fireworks/models/deepseek-v4-pro-0813":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.044,"input":1.32,"output":3.96},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"DeepSeek V4 Pro snapshot with million-token context and support for thinking and non-thinking modes","family":"deepseek-thinking","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["high","max"]}],"structured_output":true,"temperature":true},"family":null,"id":"accounts/fireworks/models/deepseek-v4-pro-0813","knowledge":null,"last_updated":"2026-08-12","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Pro 0813","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-08-12","retired":false,"tags":null},"accounts/fireworks/models/glm-5p2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.14,"input":1.4,"output":4.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["high","max"]}],"temperature":true},"family":null,"id":"accounts/fireworks/models/glm-5p2","knowledge":null,"last_updated":"2026-06-16","lifecycle":null,"limits":{"context":1048575,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM 5.2","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-16","retired":false,"tags":null},"accounts/fireworks/models/gpt-oss-120b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.015,"input":0.15,"output":0.6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open-weight GPT model for self-hosted reasoning and instruction-following workloads","family":"gpt-oss","open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"accounts/fireworks/models/gpt-oss-120b","knowledge":null,"last_updated":"2026-06-16","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT OSS 120B","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"accounts/fireworks/models/gpt-oss-20b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.035,"input":0.07,"output":0.3},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open-weight GPT model for self-hosted reasoning and instruction-following workloads","family":"gpt-oss","open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"accounts/fireworks/models/gpt-oss-20b","knowledge":null,"last_updated":"2025-08-05","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT OSS 20B","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"accounts/fireworks/models/inkling":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.17,"input":1,"output":4.05},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Multimodal MoE reasoning model (975B total, 41B active) for text, image, and audio","family":"ling","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"accounts/fireworks/models/inkling","knowledge":null,"last_updated":"2026-07-15","lifecycle":null,"limits":{"context":1048576,"output":1048576},"modalities":{"input":["text","image","audio"],"output":["text"]},"model":null,"name":"Inkling","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-07-15","retired":false,"tags":null},"accounts/fireworks/models/kimi-k2p6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.16,"input":0.95,"output":4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Kimi reasoning model for long-horizon research, planning, and tool use","family":"kimi-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"accounts/fireworks/models/kimi-k2p6","knowledge":null,"last_updated":"2026-04-17","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.6","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null},"accounts/fireworks/models/kimi-k2p7-code":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.19,"input":0.95,"output":4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Kimi coding model for software agents, refactors, and repository reasoning","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"accounts/fireworks/models/kimi-k2p7-code","knowledge":null,"last_updated":"2026-06-16","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.7 Code","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"accounts/fireworks/models/kimi-k3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.3,"input":3,"output":15},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Multimodal Kimi model with 1M context and toggleable max-effort thinking for long-horizon agent work","family":"kimi-k3","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","max"]},{"min":1024,"type":"budget_tokens"}],"structured_output":true,"temperature":false},"family":null,"id":"accounts/fireworks/models/kimi-k3","knowledge":null,"last_updated":"2026-07-27","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K3","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-07-27","retired":false,"tags":null},"accounts/fireworks/models/minimax-m2p7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.06,"input":0.3,"output":1.2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"MiniMax model for chat, coding, office work, and agentic tasks","family":"minimax","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"accounts/fireworks/models/minimax-m2p7","knowledge":null,"last_updated":"2026-04-12","lifecycle":null,"limits":{"context":196608,"output":196608},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax-M2.7","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-04-12","retired":false,"tags":null},"accounts/fireworks/models/minimax-m3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.06,"input":0.3,"output":1.2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"MiniMax multimodal coding model for long-context reasoning and agent tasks","family":"minimax","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"accounts/fireworks/models/minimax-m3","knowledge":null,"last_updated":"2026-06-12","lifecycle":null,"limits":{"context":512000,"output":512000},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"MiniMax-M3","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"accounts/fireworks/models/muse-glimmer-30b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.04,"input":0.35,"output":1.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Muse Glimmer is a 30-billion-parameter open-weight multimodal model from Meta Superintelligence Labs, distilled from Muse Spark for always-on local agents, tool use, coding, and image understanding.","family":"muse","open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high","xhigh"]}],"structured_output":true,"temperature":true},"family":null,"id":"accounts/fireworks/models/muse-glimmer-30b","knowledge":"2026-01-04","last_updated":"2026-08-10","lifecycle":null,"limits":{"context":131072,"output":131072},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Muse Glimmer 30B","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-08-10","retired":false,"tags":null},"accounts/fireworks/models/nemotron-3-ultra-nvfp4":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.119,"input":0.6,"output":2.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Largest Nemotron 3 model for maximum open-weight reasoning and agent accuracy","family":"nemotron","open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"accounts/fireworks/models/nemotron-3-ultra-nvfp4","knowledge":null,"last_updated":"2026-06-04","lifecycle":null,"limits":{"context":262144,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Nemotron 3 Ultra 550B A55B","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-04","retired":false,"tags":null},"accounts/fireworks/models/nemotron-lightning-3p5-30b-a3b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.01,"input":0.05,"output":0.2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Fast NVIDIA Nemotron MoE for reliable agentic tasks across enterprise workloads","family":"nemotron","open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"accounts/fireworks/models/nemotron-lightning-3p5-30b-a3b","knowledge":null,"last_updated":"2026-08-11","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Nemotron 3.5 Lightning 30B A3B","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-08-11","retired":false,"tags":null},"accounts/fireworks/models/qwen3p7-plus":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.08,"input":0.4,"output":1.6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high"]},{"min":1,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"accounts/fireworks/models/qwen3p7-plus","knowledge":null,"last_updated":"2026-06-12","lifecycle":null,"limits":{"context":262144,"output":65536},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen 3.7 Plus","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"accounts/fireworks/models/qwen3p8-max":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.25,"input":2,"output":6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"2.4-trillion-parameter MoE flagship for coding, professional work, multimodal understanding, and long-horizon agentic workflows","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"accounts/fireworks/models/qwen3p8-max","knowledge":null,"last_updated":"2026-08-03","lifecycle":null,"limits":{"context":262144,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3.8 Max","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-08-03","retired":false,"tags":null},"accounts/fireworks/routers/glm-5p2-fast":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.21,"input":2.1,"output":6.6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Efficient GLM model for fast reasoning, coding, and agent workflows","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["high","max"]}],"temperature":true},"family":null,"id":"accounts/fireworks/routers/glm-5p2-fast","knowledge":null,"last_updated":"2026-06-26","lifecycle":null,"limits":{"context":1048575,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM 5.2 Fast","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-26","retired":false,"tags":null},"accounts/fireworks/routers/kimi-k2p6-fast":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.3,"input":2,"output":8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Kimi reasoning model for long-horizon research, planning, and tool use","family":"kimi-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"accounts/fireworks/routers/kimi-k2p6-fast","knowledge":null,"last_updated":"2026-06-05","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.6 Fast","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null},"accounts/fireworks/routers/kimi-k2p6-turbo":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.3,"input":2,"output":8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Kimi reasoning model for long-horizon research, planning, and tool use","family":"kimi-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"accounts/fireworks/routers/kimi-k2p6-turbo","knowledge":null,"last_updated":"2026-04-17","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.6 Turbo","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null},"accounts/fireworks/routers/kimi-k2p7-code-fast":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.38,"input":1.9,"output":8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Kimi coding model for software agents, refactors, and repository reasoning","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"accounts/fireworks/routers/kimi-k2p7-code-fast","knowledge":null,"last_updated":"2026-06-16","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.7 Code Fast","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"accounts/fireworks/routers/kimi-k3-fast":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.45,"input":4.5,"output":22.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Multimodal Kimi model with 1M context and toggleable max-effort thinking for long-horizon agent work","family":"kimi-k3","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","max"]},{"min":1024,"type":"budget_tokens"}],"structured_output":true,"temperature":false},"family":null,"id":"accounts/fireworks/routers/kimi-k3-fast","knowledge":null,"last_updated":"2026-07-27","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K3 Fast","pricing":null,"provider":"fireworks_ai","provider_model_id":null,"release_date":"2026-07-27","retired":false,"tags":null}},"name":"Fireworks AI","pricing_defaults":null,"runtime":{"auth":{"env":["FIREWORKS_API_KEY"],"headers":[],"type":"bearer"},"base_url":"https://api.fireworks.ai/inference/v1","config_schema":null,"default_headers":{},"default_query":{},"doc_url":"https://fireworks.ai/docs/"}};
4
4
  const provider = /* @__PURE__ */ createProviderCatalog(data);
5
5
  export default provider;
@@ -6,6 +6,6 @@ import type {
6
6
  export declare const data: Provider;
7
7
  declare const provider: ProviderCatalog<
8
8
  "friendli",
9
- "MiniMaxAI/MiniMax-M2.5" | "Qwen/Qwen3-235B-A22B-Instruct-2507" | "deepseek-ai/DeepSeek-V3.2" | "google/gemma-4-31B-it" | "zai-org/GLM-5.1" | "zai-org/GLM-5.2"
9
+ "MiniMaxAI/MiniMax-M2.5" | "deepseek-ai/DeepSeek-V3.2" | "google/gemma-4-31B-it" | "zai-org/GLM-5.1" | "zai-org/GLM-5.2"
10
10
  >;
11
11
  export default provider;