@agentjido/llmdb 2026.8.2
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/LICENSE +203 -0
- package/README.md +117 -0
- package/dist/catalog.d.ts +2 -0
- package/dist/catalog.js +53 -0
- package/dist/errors.d.ts +14 -0
- package/dist/errors.js +20 -0
- package/dist/full.d.ts +3 -0
- package/dist/full.js +191 -0
- package/dist/generated/manifest.d.ts +3 -0
- package/dist/generated/manifest.js +1 -0
- package/dist/generated/provider-loaders.d.ts +3 -0
- package/dist/generated/provider-loaders.js +185 -0
- package/dist/index.d.ts +8 -0
- package/dist/index.js +8 -0
- package/dist/lazy.d.ts +9 -0
- package/dist/lazy.js +73 -0
- package/dist/provider.d.ts +2 -0
- package/dist/provider.js +63 -0
- package/dist/providers/302ai.d.ts +11 -0
- package/dist/providers/302ai.js +5 -0
- package/dist/providers/abacus.d.ts +11 -0
- package/dist/providers/abacus.js +5 -0
- package/dist/providers/abliteration_ai.d.ts +11 -0
- package/dist/providers/abliteration_ai.js +5 -0
- package/dist/providers/ai_router.d.ts +11 -0
- package/dist/providers/ai_router.js +5 -0
- package/dist/providers/aiand.d.ts +11 -0
- package/dist/providers/aiand.js +5 -0
- package/dist/providers/aihubmix.d.ts +11 -0
- package/dist/providers/aihubmix.js +5 -0
- package/dist/providers/aki_io.d.ts +11 -0
- package/dist/providers/aki_io.js +5 -0
- package/dist/providers/alibaba.d.ts +11 -0
- package/dist/providers/alibaba.js +5 -0
- package/dist/providers/alibaba_cn.d.ts +11 -0
- package/dist/providers/alibaba_cn.js +5 -0
- package/dist/providers/alibaba_coding_plan.d.ts +11 -0
- package/dist/providers/alibaba_coding_plan.js +5 -0
- package/dist/providers/alibaba_coding_plan_cn.d.ts +11 -0
- package/dist/providers/alibaba_coding_plan_cn.js +5 -0
- package/dist/providers/alibaba_token_plan.d.ts +11 -0
- package/dist/providers/alibaba_token_plan.js +5 -0
- package/dist/providers/alibaba_token_plan_cn.d.ts +11 -0
- package/dist/providers/alibaba_token_plan_cn.js +5 -0
- package/dist/providers/amazon_bedrock.d.ts +11 -0
- package/dist/providers/amazon_bedrock.js +5 -0
- package/dist/providers/ambient.d.ts +11 -0
- package/dist/providers/ambient.js +5 -0
- package/dist/providers/anthropic.d.ts +11 -0
- package/dist/providers/anthropic.js +5 -0
- package/dist/providers/anyapi.d.ts +11 -0
- package/dist/providers/anyapi.js +5 -0
- package/dist/providers/atomic_chat.d.ts +11 -0
- package/dist/providers/atomic_chat.js +5 -0
- package/dist/providers/auriko.d.ts +11 -0
- package/dist/providers/auriko.js +5 -0
- package/dist/providers/azure.d.ts +11 -0
- package/dist/providers/azure.js +5 -0
- package/dist/providers/azure_cognitive_services.d.ts +11 -0
- package/dist/providers/azure_cognitive_services.js +5 -0
- package/dist/providers/bailing.d.ts +11 -0
- package/dist/providers/bailing.js +5 -0
- package/dist/providers/baseten.d.ts +11 -0
- package/dist/providers/baseten.js +5 -0
- package/dist/providers/berget.d.ts +11 -0
- package/dist/providers/berget.js +5 -0
- package/dist/providers/blueclaw.d.ts +11 -0
- package/dist/providers/blueclaw.js +5 -0
- package/dist/providers/cerebras.d.ts +11 -0
- package/dist/providers/cerebras.js +5 -0
- package/dist/providers/chutes.d.ts +11 -0
- package/dist/providers/chutes.js +5 -0
- package/dist/providers/clarifai.d.ts +11 -0
- package/dist/providers/clarifai.js +5 -0
- package/dist/providers/claudinio.d.ts +11 -0
- package/dist/providers/claudinio.js +5 -0
- package/dist/providers/cline_pass.d.ts +11 -0
- package/dist/providers/cline_pass.js +5 -0
- package/dist/providers/cloudferro_sherlock.d.ts +11 -0
- package/dist/providers/cloudferro_sherlock.js +5 -0
- package/dist/providers/cloudflare_ai_gateway.d.ts +11 -0
- package/dist/providers/cloudflare_ai_gateway.js +5 -0
- package/dist/providers/cloudflare_workers_ai.d.ts +11 -0
- package/dist/providers/cloudflare_workers_ai.js +5 -0
- package/dist/providers/cohere.d.ts +11 -0
- package/dist/providers/cohere.js +5 -0
- package/dist/providers/cortecs.d.ts +11 -0
- package/dist/providers/cortecs.js +5 -0
- package/dist/providers/crof.d.ts +11 -0
- package/dist/providers/crof.js +5 -0
- package/dist/providers/crossmodel.d.ts +11 -0
- package/dist/providers/crossmodel.js +5 -0
- package/dist/providers/daoxe.d.ts +11 -0
- package/dist/providers/daoxe.js +5 -0
- package/dist/providers/databricks.d.ts +11 -0
- package/dist/providers/databricks.js +5 -0
- package/dist/providers/deepinfra.d.ts +11 -0
- package/dist/providers/deepinfra.js +5 -0
- package/dist/providers/deepseek.d.ts +11 -0
- package/dist/providers/deepseek.js +5 -0
- package/dist/providers/digitalocean.d.ts +11 -0
- package/dist/providers/digitalocean.js +5 -0
- package/dist/providers/dinference.d.ts +11 -0
- package/dist/providers/dinference.js +5 -0
- package/dist/providers/drun.d.ts +11 -0
- package/dist/providers/drun.js +5 -0
- package/dist/providers/ebcloud.d.ts +11 -0
- package/dist/providers/ebcloud.js +5 -0
- package/dist/providers/elevenlabs.d.ts +11 -0
- package/dist/providers/elevenlabs.js +5 -0
- package/dist/providers/empiriolabs.d.ts +11 -0
- package/dist/providers/empiriolabs.js +5 -0
- package/dist/providers/evroc.d.ts +11 -0
- package/dist/providers/evroc.js +5 -0
- package/dist/providers/fastrouter.d.ts +11 -0
- package/dist/providers/fastrouter.js +5 -0
- package/dist/providers/fireworks_ai.d.ts +11 -0
- package/dist/providers/fireworks_ai.js +5 -0
- package/dist/providers/freemodel.d.ts +11 -0
- package/dist/providers/freemodel.js +5 -0
- package/dist/providers/friendli.d.ts +11 -0
- package/dist/providers/friendli.js +5 -0
- package/dist/providers/frogbot.d.ts +11 -0
- package/dist/providers/frogbot.js +5 -0
- package/dist/providers/github_copilot.d.ts +11 -0
- package/dist/providers/github_copilot.js +5 -0
- package/dist/providers/github_models.d.ts +11 -0
- package/dist/providers/github_models.js +5 -0
- package/dist/providers/gitlab.d.ts +11 -0
- package/dist/providers/gitlab.js +5 -0
- package/dist/providers/gmicloud.d.ts +11 -0
- package/dist/providers/gmicloud.js +5 -0
- package/dist/providers/google.d.ts +11 -0
- package/dist/providers/google.js +5 -0
- package/dist/providers/google_vertex.d.ts +11 -0
- package/dist/providers/google_vertex.js +5 -0
- package/dist/providers/google_vertex_anthropic.d.ts +11 -0
- package/dist/providers/google_vertex_anthropic.js +5 -0
- package/dist/providers/greenpt.d.ts +11 -0
- package/dist/providers/greenpt.js +5 -0
- package/dist/providers/groq.d.ts +11 -0
- package/dist/providers/groq.js +5 -0
- package/dist/providers/helicone.d.ts +11 -0
- package/dist/providers/helicone.js +5 -0
- package/dist/providers/hetzner.d.ts +11 -0
- package/dist/providers/hetzner.js +5 -0
- package/dist/providers/hpc_ai.d.ts +11 -0
- package/dist/providers/hpc_ai.js +5 -0
- package/dist/providers/huggingface.d.ts +11 -0
- package/dist/providers/huggingface.js +5 -0
- package/dist/providers/hyper.d.ts +11 -0
- package/dist/providers/hyper.js +5 -0
- package/dist/providers/iflowcn.d.ts +11 -0
- package/dist/providers/iflowcn.js +5 -0
- package/dist/providers/impossibl.d.ts +11 -0
- package/dist/providers/impossibl.js +5 -0
- package/dist/providers/inception.d.ts +11 -0
- package/dist/providers/inception.js +5 -0
- package/dist/providers/inceptron.d.ts +11 -0
- package/dist/providers/inceptron.js +5 -0
- package/dist/providers/inference.d.ts +11 -0
- package/dist/providers/inference.js +5 -0
- package/dist/providers/inferx.d.ts +11 -0
- package/dist/providers/inferx.js +5 -0
- package/dist/providers/infomaniak.d.ts +11 -0
- package/dist/providers/infomaniak.js +5 -0
- package/dist/providers/io_net.d.ts +11 -0
- package/dist/providers/io_net.js +5 -0
- package/dist/providers/jiekou.d.ts +11 -0
- package/dist/providers/jiekou.js +5 -0
- package/dist/providers/kenari.d.ts +11 -0
- package/dist/providers/kenari.js +5 -0
- package/dist/providers/kilo.d.ts +11 -0
- package/dist/providers/kilo.js +5 -0
- package/dist/providers/kimi_for_coding.d.ts +11 -0
- package/dist/providers/kimi_for_coding.js +5 -0
- package/dist/providers/kuae_cloud_coding_plan.d.ts +11 -0
- package/dist/providers/kuae_cloud_coding_plan.js +5 -0
- package/dist/providers/lilac.d.ts +11 -0
- package/dist/providers/lilac.js +5 -0
- package/dist/providers/llama.d.ts +11 -0
- package/dist/providers/llama.js +5 -0
- package/dist/providers/llmgateway.d.ts +11 -0
- package/dist/providers/llmgateway.js +5 -0
- package/dist/providers/llmtr.d.ts +11 -0
- package/dist/providers/llmtr.js +5 -0
- package/dist/providers/lmstudio.d.ts +11 -0
- package/dist/providers/lmstudio.js +5 -0
- package/dist/providers/longcat.d.ts +11 -0
- package/dist/providers/longcat.js +5 -0
- package/dist/providers/lucidquery.d.ts +11 -0
- package/dist/providers/lucidquery.js +5 -0
- package/dist/providers/lynkr.d.ts +11 -0
- package/dist/providers/lynkr.js +5 -0
- package/dist/providers/meganova.d.ts +11 -0
- package/dist/providers/meganova.js +5 -0
- package/dist/providers/merge_gateway.d.ts +11 -0
- package/dist/providers/merge_gateway.js +5 -0
- package/dist/providers/meta.d.ts +11 -0
- package/dist/providers/meta.js +5 -0
- package/dist/providers/minimax.d.ts +11 -0
- package/dist/providers/minimax.js +5 -0
- package/dist/providers/minimax_cn.d.ts +11 -0
- package/dist/providers/minimax_cn.js +5 -0
- package/dist/providers/minimax_cn_coding_plan.d.ts +11 -0
- package/dist/providers/minimax_cn_coding_plan.js +5 -0
- package/dist/providers/minimax_coding_plan.d.ts +11 -0
- package/dist/providers/minimax_coding_plan.js +5 -0
- package/dist/providers/mistral.d.ts +11 -0
- package/dist/providers/mistral.js +5 -0
- package/dist/providers/mixlayer.d.ts +11 -0
- package/dist/providers/mixlayer.js +5 -0
- package/dist/providers/moark.d.ts +11 -0
- package/dist/providers/moark.js +5 -0
- package/dist/providers/modal.d.ts +11 -0
- package/dist/providers/modal.js +5 -0
- package/dist/providers/model_oracle_ai.d.ts +11 -0
- package/dist/providers/model_oracle_ai.js +5 -0
- package/dist/providers/modelis.d.ts +11 -0
- package/dist/providers/modelis.js +5 -0
- package/dist/providers/modelscope.d.ts +11 -0
- package/dist/providers/modelscope.js +5 -0
- package/dist/providers/moonshotai.d.ts +11 -0
- package/dist/providers/moonshotai.js +5 -0
- package/dist/providers/moonshotai_cn.d.ts +11 -0
- package/dist/providers/moonshotai_cn.js +5 -0
- package/dist/providers/morph.d.ts +11 -0
- package/dist/providers/morph.js +5 -0
- package/dist/providers/nano_gpt.d.ts +11 -0
- package/dist/providers/nano_gpt.js +5 -0
- package/dist/providers/nearai.d.ts +11 -0
- package/dist/providers/nearai.js +5 -0
- package/dist/providers/nebius.d.ts +11 -0
- package/dist/providers/nebius.js +5 -0
- package/dist/providers/neon.d.ts +11 -0
- package/dist/providers/neon.js +5 -0
- package/dist/providers/neuralwatt.d.ts +11 -0
- package/dist/providers/neuralwatt.js +5 -0
- package/dist/providers/nova.d.ts +11 -0
- package/dist/providers/nova.js +5 -0
- package/dist/providers/novita_ai.d.ts +11 -0
- package/dist/providers/novita_ai.js +5 -0
- package/dist/providers/nvidia.d.ts +11 -0
- package/dist/providers/nvidia.js +5 -0
- package/dist/providers/ofox.d.ts +11 -0
- package/dist/providers/ofox.js +5 -0
- package/dist/providers/ollama_cloud.d.ts +11 -0
- package/dist/providers/ollama_cloud.js +5 -0
- package/dist/providers/openai.d.ts +11 -0
- package/dist/providers/openai.js +5 -0
- package/dist/providers/opencode.d.ts +11 -0
- package/dist/providers/opencode.js +5 -0
- package/dist/providers/opencode_go.d.ts +11 -0
- package/dist/providers/opencode_go.js +5 -0
- package/dist/providers/openrouter.d.ts +11 -0
- package/dist/providers/openrouter.js +5 -0
- package/dist/providers/orcarouter.d.ts +11 -0
- package/dist/providers/orcarouter.js +5 -0
- package/dist/providers/ovhcloud.d.ts +11 -0
- package/dist/providers/ovhcloud.js +5 -0
- package/dist/providers/perplexity.d.ts +11 -0
- package/dist/providers/perplexity.js +5 -0
- package/dist/providers/perplexity_agent.d.ts +11 -0
- package/dist/providers/perplexity_agent.js +5 -0
- package/dist/providers/pioneer.d.ts +11 -0
- package/dist/providers/pioneer.js +5 -0
- package/dist/providers/poe.d.ts +11 -0
- package/dist/providers/poe.js +5 -0
- package/dist/providers/poolside.d.ts +11 -0
- package/dist/providers/poolside.js +5 -0
- package/dist/providers/privatemode_ai.d.ts +11 -0
- package/dist/providers/privatemode_ai.js +5 -0
- package/dist/providers/qihang_ai.d.ts +11 -0
- package/dist/providers/qihang_ai.js +5 -0
- package/dist/providers/qiniu_ai.d.ts +11 -0
- package/dist/providers/qiniu_ai.js +5 -0
- package/dist/providers/qvac.d.ts +11 -0
- package/dist/providers/qvac.js +5 -0
- package/dist/providers/regolo_ai.d.ts +11 -0
- package/dist/providers/regolo_ai.js +5 -0
- package/dist/providers/requesty.d.ts +11 -0
- package/dist/providers/requesty.js +5 -0
- package/dist/providers/routing_run.d.ts +11 -0
- package/dist/providers/routing_run.js +5 -0
- package/dist/providers/sakana.d.ts +11 -0
- package/dist/providers/sakana.js +5 -0
- package/dist/providers/sap_ai_core.d.ts +11 -0
- package/dist/providers/sap_ai_core.js +5 -0
- package/dist/providers/sarvam.d.ts +11 -0
- package/dist/providers/sarvam.js +5 -0
- package/dist/providers/scaleway.d.ts +11 -0
- package/dist/providers/scaleway.js +5 -0
- package/dist/providers/scx.d.ts +11 -0
- package/dist/providers/scx.js +5 -0
- package/dist/providers/siliconflow.d.ts +11 -0
- package/dist/providers/siliconflow.js +5 -0
- package/dist/providers/siliconflow_cn.d.ts +11 -0
- package/dist/providers/siliconflow_cn.js +5 -0
- package/dist/providers/snowflake_cortex.d.ts +11 -0
- package/dist/providers/snowflake_cortex.js +5 -0
- package/dist/providers/stackit.d.ts +11 -0
- package/dist/providers/stackit.js +5 -0
- package/dist/providers/stepfun.d.ts +11 -0
- package/dist/providers/stepfun.js +5 -0
- package/dist/providers/stepfun_ai.d.ts +11 -0
- package/dist/providers/stepfun_ai.js +5 -0
- package/dist/providers/stepfun_ai_step_plan.d.ts +11 -0
- package/dist/providers/stepfun_ai_step_plan.js +5 -0
- package/dist/providers/stepfun_step_plan.d.ts +11 -0
- package/dist/providers/stepfun_step_plan.js +5 -0
- package/dist/providers/subconscious.d.ts +11 -0
- package/dist/providers/subconscious.js +5 -0
- package/dist/providers/submodel.d.ts +11 -0
- package/dist/providers/submodel.js +5 -0
- package/dist/providers/synthetic.d.ts +11 -0
- package/dist/providers/synthetic.js +5 -0
- package/dist/providers/tencent_coding_plan.d.ts +11 -0
- package/dist/providers/tencent_coding_plan.js +5 -0
- package/dist/providers/tencent_token_plan.d.ts +11 -0
- package/dist/providers/tencent_token_plan.js +5 -0
- package/dist/providers/tencent_tokenhub.d.ts +11 -0
- package/dist/providers/tencent_tokenhub.js +5 -0
- package/dist/providers/tensorx.d.ts +11 -0
- package/dist/providers/tensorx.js +5 -0
- package/dist/providers/the_grid_ai.d.ts +11 -0
- package/dist/providers/the_grid_ai.js +5 -0
- package/dist/providers/thinkingmachines.d.ts +11 -0
- package/dist/providers/thinkingmachines.js +5 -0
- package/dist/providers/tinfoil.d.ts +11 -0
- package/dist/providers/tinfoil.js +5 -0
- package/dist/providers/togetherai.d.ts +11 -0
- package/dist/providers/togetherai.js +5 -0
- package/dist/providers/trustedrouter.d.ts +11 -0
- package/dist/providers/trustedrouter.js +5 -0
- package/dist/providers/umans_ai.d.ts +11 -0
- package/dist/providers/umans_ai.js +5 -0
- package/dist/providers/umans_ai_coding_plan.d.ts +11 -0
- package/dist/providers/umans_ai_coding_plan.js +5 -0
- package/dist/providers/unorouter.d.ts +11 -0
- package/dist/providers/unorouter.js +5 -0
- package/dist/providers/upstage.d.ts +11 -0
- package/dist/providers/upstage.js +5 -0
- package/dist/providers/v0.d.ts +11 -0
- package/dist/providers/v0.js +5 -0
- package/dist/providers/venice.d.ts +11 -0
- package/dist/providers/venice.js +5 -0
- package/dist/providers/vercel.d.ts +11 -0
- package/dist/providers/vercel.js +5 -0
- package/dist/providers/vivgrid.d.ts +11 -0
- package/dist/providers/vivgrid.js +5 -0
- package/dist/providers/vultr.d.ts +11 -0
- package/dist/providers/vultr.js +5 -0
- package/dist/providers/wafer_ai.d.ts +11 -0
- package/dist/providers/wafer_ai.js +5 -0
- package/dist/providers/wandb.d.ts +11 -0
- package/dist/providers/wandb.js +5 -0
- package/dist/providers/xai.d.ts +11 -0
- package/dist/providers/xai.js +5 -0
- package/dist/providers/xiaomi.d.ts +11 -0
- package/dist/providers/xiaomi.js +5 -0
- package/dist/providers/xiaomi_token_plan_ams.d.ts +11 -0
- package/dist/providers/xiaomi_token_plan_ams.js +5 -0
- package/dist/providers/xiaomi_token_plan_cn.d.ts +11 -0
- package/dist/providers/xiaomi_token_plan_cn.js +5 -0
- package/dist/providers/xiaomi_token_plan_sgp.d.ts +11 -0
- package/dist/providers/xiaomi_token_plan_sgp.js +5 -0
- package/dist/providers/xpersona.d.ts +11 -0
- package/dist/providers/xpersona.js +5 -0
- package/dist/providers/zai.d.ts +11 -0
- package/dist/providers/zai.js +5 -0
- package/dist/providers/zai_coder.d.ts +11 -0
- package/dist/providers/zai_coder.js +5 -0
- package/dist/providers/zai_coding_plan.d.ts +11 -0
- package/dist/providers/zai_coding_plan.js +5 -0
- package/dist/providers/zeldoc.d.ts +11 -0
- package/dist/providers/zeldoc.js +5 -0
- package/dist/providers/zenifra.d.ts +11 -0
- package/dist/providers/zenifra.js +5 -0
- package/dist/providers/zenmux.d.ts +11 -0
- package/dist/providers/zenmux.js +5 -0
- package/dist/providers/zhipuai.d.ts +11 -0
- package/dist/providers/zhipuai.js +5 -0
- package/dist/providers/zhipuai_coding_plan.d.ts +11 -0
- package/dist/providers/zhipuai_coding_plan.js +5 -0
- package/dist/snapshot.d.ts +3 -0
- package/dist/snapshot.js +377 -0
- package/dist/spec.d.ts +4 -0
- package/dist/spec.js +46 -0
- package/dist/types.d.ts +287 -0
- package/dist/types.js +1 -0
- package/package.json +80 -0
|
@@ -0,0 +1,5 @@
|
|
|
1
|
+
import { createProviderCatalog } from "../provider.js";
|
|
2
|
+
|
|
3
|
+
export const data = {"alias_of":null,"base_url":"https://api.cloudflare.com/client/v4/accounts/${CLOUDFLARE_ACCOUNT_ID}/ai/v1","config_schema":null,"doc":"https://developers.cloudflare.com/workers-ai/models/","env":["CLOUDFLARE_ACCOUNT_ID","CLOUDFLARE_API_KEY"],"exclude_models":null,"extra":null,"id":"cloudflare_workers_ai","models":{"@cf/aisingapore/gemma-sea-lion-v4-27b-it":{"aliases":[],"base_url":null,"capabilities":null,"cost":{"input":0.351,"output":0.555},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open Gemma instruction model for efficient chat and self-hosted deployments","family":"gemma","open_weights":true,"structured_output":false,"temperature":true},"family":null,"id":"@cf/aisingapore/gemma-sea-lion-v4-27b-it","knowledge":null,"last_updated":"2025-09-23","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Gemma Sea Lion V4 27B It","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2025-09-23","retired":false,"tags":null},"@cf/deepseek-ai/deepseek-r1-distill-qwen-32b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"text":true,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"cost":{"input":0.497,"output":4.881},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Classic open reasoning model for transparent math, coding, and deliberate problem solving","family":"deepseek-thinking","open_weights":true,"reasoning_options":[],"structured_output":false,"temperature":true},"family":null,"id":"@cf/deepseek-ai/deepseek-r1-distill-qwen-32b","knowledge":"2024-07","last_updated":"2025-05-29","lifecycle":null,"limits":{"context":80000,"output":80000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Deepseek R1 Distill Qwen 32B","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2025-01-20","retired":false,"tags":null},"@cf/google/gemma-4-26b-a4b-it":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.1,"output":0.3},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Open Gemma instruction model for efficient chat and self-hosted deployments","family":"gemma","interleaved":true,"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"@cf/google/gemma-4-26b-a4b-it","knowledge":null,"last_updated":"2026-04-02","lifecycle":null,"limits":{"context":256000,"output":16384},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Gemma 4 26B A4B IT","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2026-04-02","retired":false,"tags":null},"@cf/ibm-granite/granite-4.0-h-micro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.017,"output":0.112},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Efficient model for low-latency assistance, extraction, and routine automation","family":"granite","open_weights":true,"structured_output":false,"temperature":true},"family":null,"id":"@cf/ibm-granite/granite-4.0-h-micro","knowledge":null,"last_updated":"2025-10-07","lifecycle":null,"limits":{"context":131000,"output":131000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Granite 4.0 H Micro","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2025-10-07","retired":false,"tags":null},"@cf/meta/llama-3.1-8b-instruct-fp8":{"aliases":[],"base_url":null,"capabilities":null,"cost":{"input":0.152,"output":0.287},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open Llama instruction model for multilingual chat, reasoning, and coding","family":"llama","open_weights":true,"structured_output":false,"temperature":true},"family":null,"id":"@cf/meta/llama-3.1-8b-instruct-fp8","knowledge":null,"last_updated":"2024-07-25","lifecycle":null,"limits":{"context":32000,"output":32000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Llama 3.1 8B Instruct fp8","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2024-07-25","retired":false,"tags":null},"@cf/meta/llama-3.2-11b-vision-instruct":{"aliases":[],"base_url":null,"capabilities":null,"cost":{"input":0.0485,"output":0.676},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Open Llama multimodal model for image understanding and text reasoning","family":"llama","open_weights":true,"structured_output":false,"temperature":true},"family":null,"id":"@cf/meta/llama-3.2-11b-vision-instruct","knowledge":null,"last_updated":"2024-09-25","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Llama 3.2 11B Vision Instruct","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2024-09-25","retired":false,"tags":null},"@cf/meta/llama-3.2-1b-instruct":{"aliases":[],"base_url":null,"capabilities":null,"cost":{"input":0.027,"output":0.201},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open Llama instruction model for multilingual chat, reasoning, and coding","family":"llama","open_weights":true,"structured_output":false,"temperature":true},"family":null,"id":"@cf/meta/llama-3.2-1b-instruct","knowledge":null,"last_updated":"2024-09-25","lifecycle":null,"limits":{"context":60000,"output":60000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Llama 3.2 1B Instruct","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2024-09-25","retired":false,"tags":null},"@cf/meta/llama-3.2-3b-instruct":{"aliases":[],"base_url":null,"capabilities":null,"cost":{"input":0.0509,"output":0.335},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open Llama instruction model for multilingual chat, reasoning, and coding","family":"llama","open_weights":true,"structured_output":false,"temperature":true},"family":null,"id":"@cf/meta/llama-3.2-3b-instruct","knowledge":null,"last_updated":"2024-09-25","lifecycle":null,"limits":{"context":80000,"output":80000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Llama 3.2 3B Instruct","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2024-09-25","retired":false,"tags":null},"@cf/meta/llama-3.3-70b-instruct-fp8-fast":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.293,"output":2.253},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Popular open Llama workhorse for multilingual chat, coding, and self-hosting","family":"llama","open_weights":true,"structured_output":false,"temperature":true},"family":null,"id":"@cf/meta/llama-3.3-70b-instruct-fp8-fast","knowledge":"2023-12","last_updated":"2024-12-06","lifecycle":null,"limits":{"context":24000,"output":24000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Llama 3.3 70B Instruct fp8 Fast","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2024-12-06","retired":false,"tags":null},"@cf/meta/llama-4-scout-17b-16e-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.27,"output":0.85},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Open Llama with long-context vision for efficient multimodal agents","family":"llama","open_weights":true,"structured_output":false,"temperature":true},"family":null,"id":"@cf/meta/llama-4-scout-17b-16e-instruct","knowledge":"2024-08","last_updated":"2025-04-05","lifecycle":null,"limits":{"context":131000,"output":16384},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Llama 4 Scout 17B 16E Instruct","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2025-04-05","retired":false,"tags":null},"@cf/meta/llama-guard-3-8b":{"aliases":[],"base_url":null,"capabilities":null,"cost":{"input":0.484,"output":0.03},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Safety model for policy screening, moderation, and risk-aware routing workflows","family":"llama","open_weights":true,"structured_output":false,"temperature":true},"family":null,"id":"@cf/meta/llama-guard-3-8b","knowledge":null,"last_updated":"2025-01-22","lifecycle":null,"limits":{"context":131072,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Llama Guard 3 8B","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2025-01-22","retired":false,"tags":null},"@cf/mistralai/mistral-small-3.1-24b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.351,"output":0.555},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Efficient Mistral model for fast chat, extraction, and production assistants","family":"mistral-small","open_weights":true,"structured_output":false,"temperature":true},"family":null,"id":"@cf/mistralai/mistral-small-3.1-24b-instruct","knowledge":null,"last_updated":"2025-03-18","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Mistral Small 3.1 24B Instruct","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2025-03-18","retired":false,"tags":null},"@cf/moonshotai/kimi-k2.6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.16,"input":0.95,"output":4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Multimodal Kimi workhorse for agent loops, coding tasks, and visual context","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"@cf/moonshotai/kimi-k2.6","knowledge":"2025-01","last_updated":"2026-04-21","lifecycle":null,"limits":{"context":262144,"output":256000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.6","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2026-04-21","retired":false,"tags":null},"@cf/moonshotai/kimi-k2.7-code":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.19,"input":0.95,"output":4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Coding-focused Kimi model, stronger on long-horizon repo work with less overthinking","family":"kimi-k2","open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"@cf/moonshotai/kimi-k2.7-code","knowledge":"2025-01","last_updated":"2026-06-12","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.7 Code","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"@cf/nvidia/nemotron-3-120b-a12b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.5,"output":1.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Nemotron middle tier for collaborative agents and high-volume reasoning workloads","family":"nemotron","interleaved":true,"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"@cf/nvidia/nemotron-3-120b-a12b","knowledge":null,"last_updated":"2026-03-11","lifecycle":null,"limits":{"context":256000,"output":256000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Nemotron 3 Super 120B","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2026-03-11","retired":false,"tags":null},"@cf/openai/gpt-oss-120b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.35,"output":0.75},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open GPT reasoning model for self-hosted agents and controllable deployments","family":"gpt-oss","open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"@cf/openai/gpt-oss-120b","knowledge":null,"last_updated":"2025-08-05","lifecycle":null,"limits":{"context":128000,"output":16384},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT OSS 120B","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"@cf/openai/gpt-oss-20b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.2,"output":0.3},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open-weight GPT model for self-hosted reasoning and instruction-following workloads","family":"gpt-oss","open_weights":true,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"@cf/openai/gpt-oss-20b","knowledge":null,"last_updated":"2025-08-05","lifecycle":null,"limits":{"context":128000,"output":16384},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT OSS 20B","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"@cf/qwen/qwen2.5-coder-32b-instruct":{"aliases":[],"base_url":null,"capabilities":null,"cost":{"input":0.66,"output":1},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen coding model for software agents, repository edits, and code reasoning","family":"qwen","open_weights":true,"structured_output":false,"temperature":true},"family":null,"id":"@cf/qwen/qwen2.5-coder-32b-instruct","knowledge":null,"last_updated":"2025-02-27","lifecycle":null,"limits":{"context":32768,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen2.5 Coder 32B Instruct","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2025-02-27","retired":false,"tags":null},"@cf/qwen/qwen3-30b-a3b-fp8":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.0509,"output":0.335},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":true,"reasoning_options":[],"structured_output":false,"temperature":true},"family":null,"id":"@cf/qwen/qwen3-30b-a3b-fp8","knowledge":null,"last_updated":"2025-04-30","lifecycle":null,"limits":{"context":32768,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 30B A3b fp8","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2025-04-30","retired":false,"tags":null},"@cf/qwen/qwq-32b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"text":true,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"cost":{"input":0.66,"output":1},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen reasoning model for deliberate problem solving, math, and coding","family":"qwen","open_weights":true,"reasoning_options":[],"structured_output":false,"temperature":true},"family":null,"id":"@cf/qwen/qwq-32b","knowledge":null,"last_updated":"2025-03-05","lifecycle":null,"limits":{"context":24000,"output":24000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwq 32B","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2025-03-05","retired":false,"tags":null},"@cf/zai-org/glm-4.7-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.0605,"output":0.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Efficient GLM model for fast reasoning, coding, and agent workflows","family":"glm-flash","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"@cf/zai-org/glm-4.7-flash","knowledge":"2025-04","last_updated":"2026-01-19","lifecycle":null,"limits":{"context":131072,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-4.7-Flash","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2026-01-19","retired":false,"tags":null},"@cf/zai-org/glm-5.2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.26,"input":1.4,"output":4.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open flagship GLM for long-horizon coding agents and million-token context work","family":"glm","open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"@cf/zai-org/glm-5.2","knowledge":null,"last_updated":"2026-06-13","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Glm 5.2","pricing":null,"provider":"cloudflare_workers_ai","provider_model_id":null,"release_date":"2026-06-13","retired":false,"tags":null}},"name":"Cloudflare Workers AI","pricing_defaults":null,"runtime":{"auth":{"env":["CLOUDFLARE_API_KEY"],"headers":[],"type":"bearer"},"base_url":"https://api.cloudflare.com/client/v4/accounts/{account_id}/ai/v1","config_schema":[{"doc":"Cloudflare account ID used in the Workers AI base URL template.","name":"account_id","required":true,"type":"string"}],"default_headers":{},"default_query":{},"doc_url":"https://developers.cloudflare.com/workers-ai/models/"}};
|
|
4
|
+
const provider = /* @__PURE__ */ createProviderCatalog(data);
|
|
5
|
+
export default provider;
|
|
@@ -0,0 +1,11 @@
|
|
|
1
|
+
import type {
|
|
2
|
+
Provider,
|
|
3
|
+
ProviderCatalog,
|
|
4
|
+
} from "../types.js";
|
|
5
|
+
|
|
6
|
+
export declare const data: Provider;
|
|
7
|
+
declare const provider: ProviderCatalog<
|
|
8
|
+
"cohere",
|
|
9
|
+
"c4ai-aya-expanse-32b" | "c4ai-aya-expanse-8b" | "c4ai-aya-vision-32b" | "c4ai-aya-vision-8b" | "command-a-03-2025" | "command-a-plus-05-2026" | "command-a-reasoning-08-2025" | "command-a-translate-08-2025" | "command-a-vision-07-2025" | "command-r-08-2024" | "command-r-plus-08-2024" | "command-r7b-12-2024" | "command-r7b-arabic-02-2025" | "north-mini-code-1-0" | "rerank-english-v3.0" | "rerank-multilingual-v3.0" | "rerank-v3.5" | "rerank-v4.0-fast" | "rerank-v4.0-pro"
|
|
10
|
+
>;
|
|
11
|
+
export default provider;
|
|
@@ -0,0 +1,5 @@
|
|
|
1
|
+
import { createProviderCatalog } from "../provider.js";
|
|
2
|
+
|
|
3
|
+
export const data = {"alias_of":null,"base_url":null,"config_schema":null,"doc":"https://docs.cohere.com/docs/models","env":["COHERE_API_KEY"],"exclude_models":null,"extra":null,"id":"cohere","models":{"c4ai-aya-expanse-32b":{"aliases":[],"base_url":null,"capabilities":null,"cost":null,"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":false,"description":"Open multilingual model optimized for generation across 23 languages","open_weights":true,"temperature":true},"family":null,"id":"c4ai-aya-expanse-32b","knowledge":null,"last_updated":"2024-10-24","lifecycle":null,"limits":{"context":128000,"output":4000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Aya Expanse 32B","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2024-10-24","retired":false,"tags":null},"c4ai-aya-expanse-8b":{"aliases":[],"base_url":null,"capabilities":null,"cost":null,"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":false,"description":"Compact open multilingual model optimized for generation across 23 languages","open_weights":true,"temperature":true},"family":null,"id":"c4ai-aya-expanse-8b","knowledge":null,"last_updated":"2024-10-24","lifecycle":null,"limits":{"context":8000,"output":4000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Aya Expanse 8B","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2024-10-24","retired":false,"tags":null},"c4ai-aya-vision-32b":{"aliases":[],"base_url":null,"capabilities":null,"cost":null,"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":true,"description":"Open multilingual vision model for OCR, visual reasoning, and image question answering","open_weights":true,"temperature":true},"family":null,"id":"c4ai-aya-vision-32b","knowledge":null,"last_updated":"2025-05-14","lifecycle":null,"limits":{"context":16000,"output":4000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Aya Vision 32B","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2025-03-04","retired":false,"tags":null},"c4ai-aya-vision-8b":{"aliases":[],"base_url":null,"capabilities":null,"cost":null,"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":true,"description":"Compact open multilingual vision model for OCR and visual question answering","open_weights":true,"temperature":true},"family":null,"id":"c4ai-aya-vision-8b","knowledge":null,"last_updated":"2025-05-14","lifecycle":null,"limits":{"context":16000,"output":4000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Aya Vision 8B","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2025-03-04","retired":false,"tags":null},"command-a-03-2025":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":2.5,"output":10},"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":false,"description":"Cohere command model for multilingual enterprise agents, tools, and chat","family":"command-a","open_weights":true,"temperature":true},"family":null,"id":"command-a-03-2025","knowledge":"2024-06-01","last_updated":"2025-03-13","lifecycle":null,"limits":{"context":256000,"output":8000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Command A","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2025-03-13","retired":false,"tags":null},"command-a-plus-05-2026":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":2.5,"output":10},"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":true,"description":"Cohere's stronger command model for multilingual agents and enterprise workflows","family":"command-a","open_weights":true,"reasoning_options":[{"type":"toggle"},{"min":1,"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"command-a-plus-05-2026","knowledge":"2025-04-01","last_updated":"2026-06-09","lifecycle":null,"limits":{"context":128000,"output":64000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Command A Plus","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2026-05-20","retired":false,"tags":null},"command-a-reasoning-08-2025":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":2.5,"output":10},"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":false,"description":"Cohere reasoning model for multilingual enterprise agents, tools, and complex workflows","family":"command-a","open_weights":true,"reasoning_options":[{"type":"toggle"},{"min":1,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"command-a-reasoning-08-2025","knowledge":"2024-06-01","last_updated":"2025-08-21","lifecycle":null,"limits":{"context":256000,"output":32000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Command A Reasoning","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2025-08-21","retired":false,"tags":null},"command-a-translate-08-2025":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":2.5,"output":10},"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":false,"description":"Translation model for multilingual conversion, localization, and cross-language workflows","family":"command-a","open_weights":true,"temperature":true},"family":null,"id":"command-a-translate-08-2025","knowledge":"2024-06-01","last_updated":"2025-08-28","lifecycle":null,"limits":{"context":8000,"output":8000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Command A Translate","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2025-08-28","retired":false,"tags":null},"command-a-vision-07-2025":{"aliases":[],"base_url":null,"capabilities":null,"cost":{"input":2.5,"output":10},"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":true,"description":"Cohere vision model for multilingual document analysis, OCR, and image understanding","family":"command-a","open_weights":true,"temperature":true},"family":null,"id":"command-a-vision-07-2025","knowledge":"2024-06-01","last_updated":"2025-07-31","lifecycle":null,"limits":{"context":128000,"output":8000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Command A Vision","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2025-07-31","retired":false,"tags":null},"command-r-08-2024":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.15,"output":0.6},"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":false,"description":"Cohere retrieval model for long-context chat and enterprise RAG workflows","family":"command-r","open_weights":true,"temperature":true},"family":null,"id":"command-r-08-2024","knowledge":"2024-06-01","last_updated":"2024-08-30","lifecycle":null,"limits":{"context":128000,"output":4000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Command R","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2024-08-30","retired":false,"tags":null},"command-r-plus-08-2024":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":2.5,"output":10},"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":false,"description":"Cohere's RAG workhorse for long-context enterprise search and tool use","family":"command-r","open_weights":true,"temperature":true},"family":null,"id":"command-r-plus-08-2024","knowledge":"2024-06-01","last_updated":"2024-08-30","lifecycle":null,"limits":{"context":128000,"output":4000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Command R+","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2024-08-30","retired":false,"tags":null},"command-r7b-12-2024":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.0375,"output":0.15},"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":false,"description":"Cohere retrieval model for long-context chat and enterprise RAG workflows","family":"command-r","open_weights":true,"temperature":true},"family":null,"id":"command-r7b-12-2024","knowledge":"2024-06-01","last_updated":"2024-12-02","lifecycle":null,"limits":{"context":128000,"output":4000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Command R7B","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2024-12-02","retired":false,"tags":null},"command-r7b-arabic-02-2025":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.0375,"output":0.15},"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":false,"description":"Open Command R model optimized for Arabic enterprise chat, RAG, and cultural knowledge","family":"command-r","open_weights":true,"temperature":true},"family":null,"id":"command-r7b-arabic-02-2025","knowledge":"2024-06-01","last_updated":"2025-02-27","lifecycle":null,"limits":{"context":128000,"output":4000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Command R7B Arabic","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2025-02-27","retired":false,"tags":null},"north-mini-code-1-0":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0,"output":0},"deprecated":false,"execution":{"object":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"},"text":{"family":"cohere_chat","path":"/v2/chat","supported":true,"wire_protocol":"cohere_chat"}},"extra":{"attachment":false,"description":"Cohere coding model for practical software engineering and agentic edits","family":"north","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"api":"https://api.cohere.ai/compatibility/v1","npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"north-mini-code-1-0","knowledge":"2025-09-23","last_updated":"2026-06-09","lifecycle":null,"limits":{"context":256000,"output":64000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"North Mini Code","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2026-06-09","retired":false,"tags":null},"rerank-english-v3.0":{"aliases":[],"base_url":null,"capabilities":{"chat":false,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":true,"streaming":{"text":false,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":false,"open_weights":false,"reasoning":false,"supported_generation_methods":["rerank"],"temperature":false,"tool_call":false,"type":"rerank"},"family":"rerank","id":"rerank-english-v3.0","knowledge":null,"last_updated":null,"lifecycle":null,"limits":{"context":4096},"modalities":null,"model":null,"name":"Rerank English 3.0","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":null,"retired":false,"tags":null},"rerank-multilingual-v3.0":{"aliases":[],"base_url":null,"capabilities":{"chat":false,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":true,"streaming":{"text":false,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":false,"open_weights":false,"reasoning":false,"supported_generation_methods":["rerank"],"temperature":false,"tool_call":false,"type":"rerank"},"family":"rerank","id":"rerank-multilingual-v3.0","knowledge":null,"last_updated":null,"lifecycle":null,"limits":{"context":4096},"modalities":null,"model":null,"name":"Rerank Multilingual 3.0","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":null,"retired":false,"tags":null},"rerank-v3.5":{"aliases":[],"base_url":null,"capabilities":{"chat":false,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":true,"streaming":{"text":false,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":false,"open_weights":false,"reasoning":false,"supported_generation_methods":["rerank"],"temperature":false,"tool_call":false,"type":"rerank"},"family":"rerank","id":"rerank-v3.5","knowledge":null,"last_updated":"2024-12-02","lifecycle":null,"limits":{"context":4096},"modalities":null,"model":null,"name":"Rerank 3.5","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2024-12-02","retired":false,"tags":null},"rerank-v4.0-fast":{"aliases":[],"base_url":null,"capabilities":{"chat":false,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":true,"streaming":{"text":false,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":false,"open_weights":false,"reasoning":false,"supported_generation_methods":["rerank"],"temperature":false,"tool_call":false,"type":"rerank"},"family":"rerank","id":"rerank-v4.0-fast","knowledge":null,"last_updated":"2025-12-11","lifecycle":null,"limits":{"context":32768},"modalities":null,"model":null,"name":"Rerank 4.0 Fast","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2025-12-11","retired":false,"tags":null},"rerank-v4.0-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":false,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":true,"streaming":{"text":false,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":null,"deprecated":false,"extra":{"attachment":false,"open_weights":false,"reasoning":false,"supported_generation_methods":["rerank"],"temperature":false,"tool_call":false,"type":"rerank"},"family":"rerank","id":"rerank-v4.0-pro","knowledge":null,"last_updated":"2025-12-11","lifecycle":null,"limits":{"context":32768},"modalities":null,"model":null,"name":"Rerank 4.0 Pro","pricing":null,"provider":"cohere","provider_model_id":null,"release_date":"2025-12-11","retired":false,"tags":null}},"name":"Cohere","pricing_defaults":null,"runtime":{"auth":{"env":["COHERE_API_KEY"],"headers":[],"type":"bearer"},"base_url":"https://api.cohere.com","config_schema":null,"default_headers":{},"default_query":{},"doc_url":"https://docs.cohere.com/docs/models"}};
|
|
4
|
+
const provider = /* @__PURE__ */ createProviderCatalog(data);
|
|
5
|
+
export default provider;
|
|
@@ -0,0 +1,11 @@
|
|
|
1
|
+
import type {
|
|
2
|
+
Provider,
|
|
3
|
+
ProviderCatalog,
|
|
4
|
+
} from "../types.js";
|
|
5
|
+
|
|
6
|
+
export declare const data: Provider;
|
|
7
|
+
declare const provider: ProviderCatalog<
|
|
8
|
+
"cortecs",
|
|
9
|
+
"claude-4-5-sonnet" | "claude-4-6-sonnet" | "claude-haiku-4-5" | "claude-opus4-5" | "claude-opus4-6" | "claude-opus4-7" | "claude-opus4-8" | "claude-sonnet-4" | "codestral-2508" | "deepseek-r1-0528" | "deepseek-v3-0324" | "deepseek-v3.2" | "deepseek-v4-flash" | "deepseek-v4-flash-0731" | "deepseek-v4-pro" | "devstral-2512" | "gemini-2.5-pro" | "glm-4.5" | "glm-4.5-air" | "glm-4.7" | "glm-4.7-flash" | "glm-5" | "glm-5-turbo" | "glm-5.1" | "glm-5.2" | "glm-5v-turbo" | "gpt-4.1" | "gpt-5.4" | "gpt-oss-120b" | "hermes-4-70b" | "hy3" | "intellect-3" | "kimi-k2-instruct" | "kimi-k2-thinking" | "kimi-k2.5" | "kimi-k2.6" | "kimi-k2.7-code" | "kimi-k3" | "llama-3.1-405b-instruct" | "llama-3.3-70b-instruct" | "llama-4-maverick" | "minimax-m2" | "minimax-m2.1" | "minimax-m2.5" | "minimax-m2.7" | "minimax-m3" | "mistral-large-2512" | "mixtral-8x7B-instruct-v0.1" | "nemotron-3-super-120b-a12b" | "nova-pro-v1" | "qwen-2.5-72b-instruct" | "qwen3-235b-a22b-instruct-2507" | "qwen3-32b" | "qwen3-coder-30b-a3b-instruct" | "qwen3-coder-480b-a35b-instruct" | "qwen3-coder-next" | "qwen3-next-80b-a3b-thinking" | "qwen3.5-122b-a10b" | "qwen3.5-397b-a17b"
|
|
10
|
+
>;
|
|
11
|
+
export default provider;
|
|
@@ -0,0 +1,5 @@
|
|
|
1
|
+
import { createProviderCatalog } from "../provider.js";
|
|
2
|
+
|
|
3
|
+
export const data = {"alias_of":null,"base_url":"https://api.cortecs.ai/v1","catalog_only":true,"config_schema":null,"doc":"https://api.cortecs.ai/v1/models","env":["CORTECS_API_KEY"],"exclude_models":null,"extra":null,"id":"cortecs","models":{"claude-4-5-sonnet":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":3.259,"output":16.296},"deprecated":false,"extra":{"attachment":true,"description":"Balanced Claude model for coding, analysis, agent workflows, and cost control","family":"claude-sonnet","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]},{"min":1024,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"claude-4-5-sonnet","knowledge":"2025-07-31","last_updated":"2025-09-29","lifecycle":null,"limits":{"context":200000,"output":200000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude 4.5 Sonnet","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-09-29","retired":false,"tags":null},"claude-4-6-sonnet":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":3.59,"output":17.92},"deprecated":false,"extra":{"attachment":true,"description":"Balanced Claude model for coding, analysis, agent workflows, and cost control","family":"claude-sonnet","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]},{"min":1024,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"claude-4-6-sonnet","knowledge":"2025-08-31","last_updated":"2026-03-13","lifecycle":null,"limits":{"context":1000000,"output":1000000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Sonnet 4.6","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-02-17","retired":false,"tags":null},"claude-haiku-4-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.09,"output":5.43},"deprecated":false,"extra":{"attachment":true,"description":"Fast Claude model for responsive assistance, classification, and lightweight agents","family":"claude-haiku","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]},{"min":1024,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"claude-haiku-4-5","knowledge":"2025-02-28","last_updated":"2025-10-15","lifecycle":null,"limits":{"context":200000,"output":200000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Haiku 4.5","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-10-15","retired":false,"tags":null},"claude-opus4-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":5.98,"output":29.89},"deprecated":false,"extra":{"attachment":true,"description":"Flagship Claude model for deep reasoning, coding, and long-horizon agents","family":"claude-opus","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]},{"min":1024,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"claude-opus4-5","knowledge":"2025-03-31","last_updated":"2025-11-24","lifecycle":null,"limits":{"context":200000,"output":200000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.5","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-11-24","retired":false,"tags":null},"claude-opus4-6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":5.98,"output":29.89},"deprecated":false,"extra":{"attachment":true,"description":"Flagship Claude model for deep reasoning, coding, and long-horizon agents","family":"claude-opus","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]},{"min":1024,"type":"budget_tokens"}],"temperature":true},"family":null,"id":"claude-opus4-6","knowledge":"2025-05-31","last_updated":"2026-03-13","lifecycle":null,"limits":{"context":1000000,"output":1000000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.6","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-02-05","retired":false,"tags":null},"claude-opus4-7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.56,"cache_write":6.99,"input":5.6,"output":27.99},"deprecated":false,"extra":{"attachment":true,"description":"Flagship Claude model for deep reasoning, coding, and long-horizon agents","family":"claude-opus","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":false},"family":null,"id":"claude-opus4-7","knowledge":"2026-01-31","last_updated":"2026-04-16","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.7","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-04-16","retired":false,"tags":null},"claude-opus4-8":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.563,"cache_write":7.049,"input":5.64,"output":28.198},"deprecated":false,"extra":{"attachment":true,"description":"Top Claude Opus tier for the hardest reasoning, coding, and long-horizon agents","family":"claude-opus","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":false},"family":null,"id":"claude-opus4-8","knowledge":"2026-01","last_updated":"2026-05-28","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.8","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-05-28","retired":false,"tags":null},"claude-sonnet-4":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":3.307,"output":16.536},"deprecated":false,"extra":{"attachment":false,"description":"Balanced Claude model for coding, analysis, agent workflows, and cost control","family":"claude-sonnet","open_weights":false,"temperature":true},"family":null,"id":"claude-sonnet-4","knowledge":"2025-03","last_updated":"2025-05-22","lifecycle":null,"limits":{"context":200000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Sonnet 4","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-05-22","retired":false,"tags":null},"codestral-2508":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.03,"input":0.3,"output":0.9},"deprecated":false,"extra":{"attachment":false,"description":"Mistral coding model for code completion, generation, and developer workflows","family":"mistral","open_weights":true,"temperature":true},"family":null,"id":"codestral-2508","knowledge":"2025-03","last_updated":"2025-07-30","lifecycle":null,"limits":{"context":256000,"output":256000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Codestral 2508","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-07-30","retired":false,"tags":null},"deepseek-r1-0528":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.585,"output":2.307},"deprecated":false,"extra":{"attachment":false,"description":"DeepSeek reasoning model for multi-step analysis, math, coding, and tools","family":"deepseek-thinking","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"deepseek-r1-0528","knowledge":"2024-07","last_updated":"2025-05-28","lifecycle":null,"limits":{"context":164000,"output":164000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek R1 0528","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-05-28","retired":false,"tags":null},"deepseek-v3-0324":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.551,"output":1.654},"deprecated":false,"extra":{"attachment":false,"description":"DeepSeek chat model for instruction following, coding, and analysis","family":"deepseek","open_weights":true,"temperature":true},"family":null,"id":"deepseek-v3-0324","knowledge":"2024-07","last_updated":"2025-03-24","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V3 0324","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-03-24","retired":false,"tags":null},"deepseek-v3.2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.266,"output":0.444},"deprecated":false,"extra":{"attachment":false,"description":"DeepSeek chat model for instruction following, coding, and analysis","family":"deepseek","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"deepseek-v3.2","knowledge":"2024-07","last_updated":"2025-12-01","lifecycle":null,"limits":{"context":163840,"output":163840},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V3.2","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-12-01","retired":false,"tags":null},"deepseek-v4-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.0028,"input":0.133,"output":0.266},"deprecated":false,"extra":{"attachment":false,"description":"Fast DeepSeek V4 lane for economical reasoning, coding, and long-context work","family":"deepseek-flash","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"deepseek-v4-flash","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1048576,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Flash","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"deepseek-v4-flash-0731":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.0645,"input":0.258,"output":0.31},"deprecated":false,"extra":{"attachment":false,"description":"Official DeepSeek V4 Flash release with enhanced agentic capabilities and integrated DSpark speculative decoding","family":"deepseek-flash","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"deepseek-v4-flash-0731","knowledge":"2025-05","last_updated":"2026-07-31","lifecycle":null,"limits":{"context":1048576,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Flash 0731","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-07-31","retired":false,"tags":null},"deepseek-v4-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.003625,"input":1.553,"output":3.106},"deprecated":false,"extra":{"attachment":false,"description":"Open MoE flagship with million-token context for coding and long agent runs","family":"deepseek-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"deepseek-v4-pro","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1048576,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Pro","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"devstral-2512":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0,"output":0},"deprecated":false,"extra":{"attachment":false,"description":"Mistral coding agent model for repository tasks and software engineering workflows","open_weights":true,"temperature":true},"family":null,"id":"devstral-2512","knowledge":"2025-12","last_updated":"2025-12-09","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Devstral 2 2512","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-12-09","retired":false,"tags":null},"gemini-2.5-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.654,"output":11.024},"deprecated":false,"extra":{"attachment":false,"description":"Advanced Gemini model for complex reasoning, coding, and multimodal analysis","family":"gemini-pro","open_weights":false,"temperature":true},"family":null,"id":"gemini-2.5-pro","knowledge":"2025-01","last_updated":"2025-06-17","lifecycle":null,"limits":{"context":1048576,"output":65535},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Gemini 2.5 Pro","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-03-20","retired":false,"tags":null},"glm-4.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.67,"output":2.46},"deprecated":false,"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"glm-4.5","knowledge":"2025-04","last_updated":"2025-07-29","lifecycle":null,"limits":{"context":131072,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM 4.5","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-07-29","retired":false,"tags":null},"glm-4.5-air":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.22,"output":1.34},"deprecated":false,"extra":{"attachment":false,"description":"Efficient GLM model for fast reasoning, coding, and agent workflows","family":"glm-air","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"glm-4.5-air","knowledge":"2025-04","last_updated":"2025-08-01","lifecycle":null,"limits":{"context":131072,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM 4.5 Air","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-08-01","retired":false,"tags":null},"glm-4.7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.45,"output":2.23},"deprecated":false,"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"glm-4.7","knowledge":"2025-04","last_updated":"2025-12-22","lifecycle":null,"limits":{"context":198000,"output":198000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM 4.7","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-12-22","retired":false,"tags":null},"glm-4.7-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.09,"output":0.53},"deprecated":false,"extra":{"attachment":false,"description":"Efficient GLM model for fast reasoning, coding, and agent workflows","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"glm-4.7-flash","knowledge":"2025-04","last_updated":"2025-08-08","lifecycle":null,"limits":{"context":203000,"output":203000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-4.7-Flash","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-08-08","retired":false,"tags":null},"glm-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.08,"output":3.44},"deprecated":false,"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"glm-5","knowledge":null,"last_updated":"2026-02-11","lifecycle":null,"limits":{"context":202752,"output":202752},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM 5","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-02-11","retired":false,"tags":null},"glm-5-turbo":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.308,"cache_write":1.544,"input":1.235,"output":4.118},"deprecated":false,"extra":{"attachment":false,"description":"Faster GLM-5 lane for coding agents that need lower latency","family":"glm","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"glm-5-turbo","knowledge":null,"last_updated":"2026-03-16","lifecycle":null,"limits":{"context":200000,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5-Turbo","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-03-16","retired":false,"tags":null},"glm-5.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.24,"input":1.31,"output":4.1},"deprecated":false,"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"glm-5.1","knowledge":null,"last_updated":"2026-04-14","lifecycle":null,"limits":{"context":204800,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5.1","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-04-14","retired":false,"tags":null},"glm-5.2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.39,"input":1.44,"output":4.53},"deprecated":false,"extra":{"attachment":false,"description":"Open flagship GLM for long-horizon coding agents and million-token context work","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["high","max"]}],"structured_output":true,"temperature":true},"family":null,"id":"glm-5.2","knowledge":null,"last_updated":"2026-06-13","lifecycle":null,"limits":{"context":1000000,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5.2","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-06-13","retired":false,"tags":null},"glm-5v-turbo":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.308,"cache_write":1.544,"input":1.235,"output":4.118},"deprecated":false,"extra":{"attachment":true,"description":"Fast GLM vision model for screenshots, documents, and multimodal agent tasks","family":"glm","open_weights":false,"reasoning_options":[],"temperature":true},"family":null,"id":"glm-5v-turbo","knowledge":null,"last_updated":"2026-04-01","lifecycle":null,"limits":{"context":200000,"output":131072},"modalities":{"input":["text","image","video","pdf"],"output":["text"]},"model":null,"name":"GLM-5V-Turbo","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-04-01","retired":false,"tags":null},"gpt-4.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":2.354,"output":9.417},"deprecated":false,"extra":{"attachment":false,"description":"GPT model for general reasoning, writing, coding, and tool-assisted tasks","family":"gpt","open_weights":false,"temperature":true},"family":null,"id":"gpt-4.1","knowledge":"2024-06","last_updated":"2025-04-14","lifecycle":null,"limits":{"context":1047576,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT 4.1","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-04-14","retired":false,"tags":null},"gpt-5.4":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.25,"input":3,"output":16.13},"deprecated":false,"extra":{"attachment":true,"description":"Agent-ready GPT for coding and computer-use workflows at a lower cost","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.4","knowledge":"2025-08-31","last_updated":"2026-03-05","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.4","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-03-05","retired":false,"tags":null},"gpt-oss-120b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0,"output":0},"deprecated":false,"extra":{"attachment":false,"description":"Open-weight GPT model for self-hosted reasoning and instruction-following workloads","family":"gpt-oss","open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"temperature":true},"family":null,"id":"gpt-oss-120b","knowledge":"2024-01","last_updated":"2025-08-05","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT Oss 120b","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"hermes-4-70b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.116,"output":0.358},"deprecated":false,"extra":{"attachment":false,"description":"Reasoning model for deliberate analysis, multi-step problem solving, and tool use","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"hermes-4-70b","knowledge":"2023-12","last_updated":"2025-08-26","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Hermes 4 70B","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-08-26","retired":false,"tags":null},"hy3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.103,"input":0.41,"output":1.025},"deprecated":false,"extra":{"attachment":false,"description":"Tencent Hy reasoning model for coding, instruction following, and agent tasks","family":"Hy","open_weights":true,"reasoning_options":[{"type":"effort","values":["none","low","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"hy3","knowledge":null,"last_updated":"2026-07-06","lifecycle":null,"limits":{"context":262144,"output":64000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Hy3","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-07-06","retired":false,"tags":null},"intellect-3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.219,"output":1.202},"deprecated":false,"extra":{"attachment":true,"description":"Reasoning model for deliberate analysis, multi-step problem solving, and tool use","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"intellect-3","knowledge":"2025-11","last_updated":"2025-11-26","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"INTELLECT 3","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-11-26","retired":false,"tags":null},"kimi-k2-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.551,"output":2.646},"deprecated":false,"extra":{"attachment":false,"description":"Kimi model for long-context chat, coding, and agentic reasoning","family":"kimi-k2","open_weights":true,"temperature":true},"family":null,"id":"kimi-k2-instruct","knowledge":"2024-07","last_updated":"2025-09-05","lifecycle":null,"limits":{"context":131000,"output":131000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Kimi K2 Instruct","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-07-11","retired":false,"tags":null},"kimi-k2-thinking":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.656,"output":2.731},"deprecated":false,"extra":{"attachment":true,"description":"Kimi reasoning model for long-horizon research, planning, and tool use","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"kimi-k2-thinking","knowledge":"2025-12","last_updated":"2025-12-08","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Kimi K2 Thinking","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-12-08","retired":false,"tags":null},"kimi-k2.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.55,"output":2.76},"deprecated":false,"extra":{"attachment":false,"description":"Kimi reasoning model for long-horizon research, planning, and tool use","family":"kimi-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"kimi-k2.5","knowledge":"2025-01","last_updated":"2026-01-27","lifecycle":null,"limits":{"context":256000,"output":256000},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K2.5","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-01-27","retired":false,"tags":null},"kimi-k2.6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.2,"input":0.81,"output":3.54},"deprecated":false,"extra":{"attachment":false,"description":"Kimi reasoning model for long-horizon research, planning, and tool use","family":"kimi-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"kimi-k2.6","knowledge":null,"last_updated":"2026-04-17","lifecycle":null,"limits":{"context":256000,"output":256000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.6","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null},"kimi-k2.7-code":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.32,"input":1.28,"output":4.63},"deprecated":false,"extra":{"attachment":true,"description":"Coding-focused Kimi model, stronger on long-horizon repo work with less overthinking","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k2.7-code","knowledge":"2025-01","last_updated":"2026-06-12","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K2.7 Code","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"kimi-k3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":3,"output":15},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal Kimi model with 1M context and toggleable max-effort thinking for long-horizon agent work","family":"kimi-k3","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k3","knowledge":null,"last_updated":"2026-07-16","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K3","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-07-16","retired":false,"tags":null},"llama-3.1-405b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0,"output":0},"deprecated":false,"extra":{"attachment":false,"description":"Open Llama instruction model for multilingual chat, reasoning, and coding","family":"llama","open_weights":true,"temperature":true},"family":null,"id":"llama-3.1-405b-instruct","knowledge":"2023-12","last_updated":"2024-07-23","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Llama 3.1 405B Instruct","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2024-07-23","retired":false,"tags":null},"llama-3.3-70b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.089,"output":0.275},"deprecated":false,"extra":{"attachment":false,"description":"Popular open Llama workhorse for multilingual chat, coding, and self-hosting","family":"llama","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"llama-3.3-70b-instruct","knowledge":"2023-12","last_updated":"2024-12-06","lifecycle":null,"limits":{"context":131000,"output":131000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Llama 3.3 70B Instruct","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2024-12-06","retired":false,"tags":null},"llama-4-maverick":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.03,"cache_write":0.151,"input":0.124,"output":0.603},"deprecated":false,"extra":{"attachment":true,"description":"Open multimodal Llama for strong reasoning with efficient everyday serving","family":"llama","open_weights":true,"temperature":true},"family":null,"id":"llama-4-maverick","knowledge":"2024-08","last_updated":"2025-04-05","lifecycle":null,"limits":{"context":1000000,"output":16384},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Llama 4 Maverick 17B Instruct","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-04-05","retired":false,"tags":null},"minimax-m2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.39,"output":1.57},"deprecated":false,"extra":{"attachment":false,"description":"MiniMax model for chat, coding, office work, and agentic tasks","family":"minimax","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"minimax-m2","knowledge":"2024-11","last_updated":"2025-10-27","lifecycle":null,"limits":{"context":400000,"output":400000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax-M2","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-10-27","retired":false,"tags":null},"minimax-m2.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.34,"output":1.34},"deprecated":false,"extra":{"attachment":false,"description":"MiniMax model for chat, coding, office work, and agentic tasks","family":"minimax","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"minimax-m2.1","knowledge":null,"last_updated":"2025-12-23","lifecycle":null,"limits":{"context":196000,"output":196000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax-M2.1","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-12-23","retired":false,"tags":null},"minimax-m2.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.32,"output":1.18},"deprecated":false,"extra":{"attachment":false,"description":"MiniMax model for chat, coding, office work, and agentic tasks","family":"minimax","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"minimax-m2.5","knowledge":null,"last_updated":"2026-02-12","lifecycle":null,"limits":{"context":196608,"output":196608},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax-M2.5","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-02-12","retired":false,"tags":null},"minimax-m2.7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.47,"output":1.4},"deprecated":false,"extra":{"attachment":false,"description":"MiniMax model for chat, coding, office work, and agentic tasks","family":"minimax","open_weights":true,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"minimax-m2.7","knowledge":null,"last_updated":"2026-03-18","lifecycle":null,"limits":{"context":202752,"output":196072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax-m2.7","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-03-18","retired":false,"tags":null},"minimax-m3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.089,"input":0.355,"output":1.775},"deprecated":false,"extra":{"attachment":true,"description":"MiniMax multimodal model for long-context coding, perception, and agent planning","family":"minimax","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"minimax-m3","knowledge":null,"last_updated":"2026-06-01","lifecycle":null,"limits":{"context":512000,"output":128000},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"MiniMax-M3","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-06-01","retired":false,"tags":null},"mistral-large-2512":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.05,"input":0.5,"output":1.5},"deprecated":false,"extra":{"attachment":true,"description":"Mistral's largest general model for enterprise agents, coding, and multilingual reasoning","family":"mistral-large","open_weights":true,"temperature":true},"family":null,"id":"mistral-large-2512","knowledge":"2025-12","last_updated":"2025-12-01","lifecycle":null,"limits":{"context":256000,"output":256000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Mistral Large 3 2512","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-12-01","retired":false,"tags":null},"mixtral-8x7B-instruct-v0.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"text":true,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":{"input":0.438,"output":0.68},"deprecated":false,"extra":{"attachment":false,"description":"Reasoning model for deliberate analysis, multi-step problem solving, and tool use","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"mixtral-8x7B-instruct-v0.1","knowledge":"2023-09","last_updated":"2023-12-11","lifecycle":null,"limits":{"context":32000,"output":32000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Mixtral 8x7B Instruct v0.1","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2023-12-11","retired":false,"tags":null},"nemotron-3-super-120b-a12b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.266,"output":0.799},"deprecated":false,"extra":{"attachment":false,"description":"Nemotron middle tier for collaborative agents and high-volume reasoning workloads","family":"nemotron","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"nemotron-3-super-120b-a12b","knowledge":"2025-12","last_updated":"2026-03-11","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Nemotron 3 Super 120B A12B","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-03-11","retired":false,"tags":null},"nova-pro-v1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":1.016,"output":4.061},"deprecated":false,"extra":{"attachment":false,"description":"Flagship model for demanding analysis, coding, and production agent workflows","family":"nova-pro","open_weights":false,"temperature":true},"family":null,"id":"nova-pro-v1","knowledge":"2024-04","last_updated":"2024-12-03","lifecycle":null,"limits":{"context":300000,"output":5000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Nova Pro 1.0","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2024-12-03","retired":false,"tags":null},"qwen-2.5-72b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.062,"output":0.231},"deprecated":false,"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen-2.5-72b-instruct","knowledge":"2024-06","last_updated":"2024-09-19","lifecycle":null,"limits":{"context":33000,"output":33000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen2.5 72B Instruct","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2024-09-19","retired":false,"tags":null},"qwen3-235b-a22b-instruct-2507":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.062,"output":0.408},"deprecated":false,"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"qwen3-235b-a22b-instruct-2507","knowledge":"2025-04","last_updated":"2025-07-23","lifecycle":null,"limits":{"context":131000,"output":131000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 235B A22B Instruct 2507","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-07-23","retired":false,"tags":null},"qwen3-32b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.099,"output":0.33},"deprecated":false,"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen3-32b","knowledge":"2024-12","last_updated":"2025-04-29","lifecycle":null,"limits":{"context":16384,"output":16384},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 32B","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-04-29","retired":false,"tags":null},"qwen3-coder-30b-a3b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.053,"output":0.222},"deprecated":false,"extra":{"attachment":false,"description":"Smaller Qwen coder for efficient local agents and repo-level fixes","family":"qwen","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"qwen3-coder-30b-a3b-instruct","knowledge":"2025-04","last_updated":"2025-07-31","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Coder 30B A3B Instruct","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-07-31","retired":false,"tags":null},"qwen3-coder-480b-a35b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.441,"output":1.984},"deprecated":false,"extra":{"attachment":false,"description":"Qwen coding model for software agents, repository edits, and code reasoning","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen3-coder-480b-a35b-instruct","knowledge":"2025-01","last_updated":"2025-07-25","lifecycle":null,"limits":{"context":262000,"output":262000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Coder 480B A35B Instruct","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-07-25","retired":false,"tags":null},"qwen3-coder-next":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.158,"output":0.84},"deprecated":false,"extra":{"attachment":false,"description":"Qwen coding model for software agents, repository edits, and code reasoning","family":"qwen","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"qwen3-coder-next","knowledge":"2025-04","last_updated":"2026-02-04","lifecycle":null,"limits":{"context":256000,"output":65536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Coder Next 80B","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-02-04","retired":false,"tags":null},"qwen3-next-80b-a3b-thinking":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.164,"output":1.311},"deprecated":false,"extra":{"attachment":false,"description":"Reasoning model for deliberate analysis, multi-step problem solving, and tool use","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"qwen3-next-80b-a3b-thinking","knowledge":"2025-04","last_updated":"2025-09-11","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Next 80B A3B Thinking","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2025-09-11","retired":false,"tags":null},"qwen3.5-122b-a10b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.444,"output":3.106},"deprecated":false,"extra":{"attachment":false,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"qwen3.5-122b-a10b","knowledge":"2026-01","last_updated":"2026-02-24","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3.5 122B A10B","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-02-24","retired":false,"tags":null},"qwen3.5-397b-a17b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.6,"output":3.6},"deprecated":false,"extra":{"attachment":false,"description":"Large open Qwen multimodal MoE for visual agents and long technical tasks","family":"qwen","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"qwen3.5-397b-a17b","knowledge":"2026-01","last_updated":"2026-02-16","lifecycle":null,"limits":{"context":250000,"output":250000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3.5 397B A17B","pricing":null,"provider":"cortecs","provider_model_id":null,"release_date":"2026-02-16","retired":false,"tags":null}},"name":"Cortecs","pricing_defaults":null};
|
|
4
|
+
const provider = /* @__PURE__ */ createProviderCatalog(data);
|
|
5
|
+
export default provider;
|
|
@@ -0,0 +1,11 @@
|
|
|
1
|
+
import type {
|
|
2
|
+
Provider,
|
|
3
|
+
ProviderCatalog,
|
|
4
|
+
} from "../types.js";
|
|
5
|
+
|
|
6
|
+
export declare const data: Provider;
|
|
7
|
+
declare const provider: ProviderCatalog<
|
|
8
|
+
"crof",
|
|
9
|
+
"deepseek-v3.2" | "deepseek-v4-flash" | "deepseek-v4-flash-0731" | "deepseek-v4-pro" | "deepseek-v4-pro-lightning" | "gemma-4-31b-it" | "glm-4.7" | "glm-4.7-flash" | "glm-5" | "glm-5.1" | "glm-5.2" | "greg-1-mini" | "greg-2-super" | "greg-2-ultra" | "greg-rp" | "kimi-k2.5" | "kimi-k2.5-lightning" | "kimi-k2.6" | "kimi-k2.7-code" | "kimi-k3" | "kimi-k3-eco" | "mimo-v2.5-pro" | "minimax-m2.5" | "qwen3.5-397b-a17b" | "qwen3.5-9b" | "qwen3.6-27b"
|
|
10
|
+
>;
|
|
11
|
+
export default provider;
|
|
@@ -0,0 +1,5 @@
|
|
|
1
|
+
import { createProviderCatalog } from "../provider.js";
|
|
2
|
+
|
|
3
|
+
export const data = {"alias_of":null,"base_url":"https://crof.ai/v1","catalog_only":true,"config_schema":null,"doc":"https://crof.ai/docs","env":["CROF_API_KEY"],"exclude_models":null,"extra":null,"id":"crof","models":{"deepseek-v3.2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.04,"input":0.18,"output":0.35},"deprecated":false,"extra":{"attachment":false,"description":"DeepSeek chat model for instruction following, coding, and analysis","family":"deepseek","open_weights":false,"temperature":true},"family":null,"id":"deepseek-v3.2","knowledge":null,"last_updated":"2025-07-22","lifecycle":null,"limits":{"context":163840,"output":163840},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V3.2","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2025-07-22","retired":false,"tags":null},"deepseek-v4-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.003,"input":0.12,"output":0.21},"deprecated":false,"extra":{"attachment":false,"description":"Fast DeepSeek V4 lane for economical reasoning, coding, and long-context work","family":"deepseek-flash","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"deepseek-v4-flash","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1000000,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Flash","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"deepseek-v4-flash-0731":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.003,"input":0.12,"output":0.21},"deprecated":false,"extra":{"attachment":false,"description":"Official DeepSeek V4 Flash release with enhanced agentic capabilities and integrated DSpark speculative decoding","family":"deepseek-flash","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"deepseek-v4-flash-0731","knowledge":"2025-05","last_updated":"2026-07-31","lifecycle":null,"limits":{"context":1000000,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Flash (New)","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-07-31","retired":false,"tags":null},"deepseek-v4-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.003,"input":0.35,"output":0.8},"deprecated":false,"extra":{"attachment":false,"description":"Open MoE flagship with million-token context for coding and long agent runs","family":"deepseek-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"deepseek-v4-pro","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1000000,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Pro","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"deepseek-v4-pro-lightning":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.02,"input":0.8,"output":1.6},"deprecated":false,"extra":{"attachment":false,"description":"Open MoE flagship with million-token context for coding and long agent runs","family":"deepseek-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"deepseek-v4-pro-lightning","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1000000,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Pro Lightning","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"gemma-4-31b-it":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.02,"input":0.1,"output":0.3},"deprecated":false,"extra":{"attachment":true,"description":"Largest Gemma 4 instruction model for open, self-hosted chat and reasoning","family":"gemma","open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"gemma-4-31b-it","knowledge":null,"last_updated":"2026-04-02","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Gemma 4 31B IT","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-04-02","retired":false,"tags":null},"glm-4.7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.05,"cache_write":0,"input":0.25,"output":1.1},"deprecated":false,"extra":{"attachment":false,"description":"Mature GLM model for dependable coding, reasoning, and structured agent tasks","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[],"temperature":true},"family":null,"id":"glm-4.7","knowledge":"2025-04","last_updated":"2025-12-22","lifecycle":null,"limits":{"context":202752,"output":202752},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-4.7","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2025-12-22","retired":false,"tags":null},"glm-4.7-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.008,"cache_write":0,"input":0.04,"output":0.3},"deprecated":false,"extra":{"attachment":false,"description":"Budget GLM lane for fast coding help, routing, and everyday automation","family":"glm-flash","open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[],"temperature":true},"family":null,"id":"glm-4.7-flash","knowledge":"2025-04","last_updated":"2026-01-19","lifecycle":null,"limits":{"context":202752,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-4.7-Flash","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-01-19","retired":false,"tags":null},"glm-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.1,"cache_write":0,"input":0.48,"output":1.9},"deprecated":false,"extra":{"attachment":false,"description":"General GLM flagship for coding, analysis, and tool-heavy engineering workflows","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[],"temperature":true},"family":null,"id":"glm-5","knowledge":null,"last_updated":"2026-02-12","lifecycle":null,"limits":{"context":202752,"output":202752},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-02-12","retired":false,"tags":null},"glm-5.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.08,"cache_write":0,"input":0.45,"output":2.15},"deprecated":false,"extra":{"attachment":false,"description":"Strong GLM coding model for agentic engineering, terminals, and repository generation","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"glm-5.1","knowledge":null,"last_updated":"2026-04-07","lifecycle":null,"limits":{"context":202752,"output":202752},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5.1","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-04-07","retired":false,"tags":null},"glm-5.2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.08,"input":0.5,"output":2.2},"deprecated":false,"extra":{"attachment":false,"description":"Open flagship GLM for long-horizon coding agents and million-token context work","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"glm-5.2","knowledge":null,"last_updated":"2026-06-13","lifecycle":null,"limits":{"context":1000000,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5.2","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-06-13","retired":false,"tags":null},"greg-1-mini":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":{"cache_read":0.01,"input":0.07,"output":0.15},"deprecated":false,"extra":{"attachment":false,"description":"Efficient model for low-latency assistance, extraction, and routine automation","open_weights":false,"temperature":true},"family":null,"id":"greg-1-mini","knowledge":null,"last_updated":"2026-01-27","lifecycle":null,"limits":{"context":229376,"output":229376},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Greg 1 Mini","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-01-27","retired":false,"tags":null},"greg-2-super":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":{"cache_read":0.25,"input":1.5,"output":5},"deprecated":false,"extra":{"attachment":false,"description":"General-purpose chat model for instruction following, writing, and analysis","open_weights":false,"temperature":true},"family":null,"id":"greg-2-super","knowledge":null,"last_updated":"2026-06-14","lifecycle":null,"limits":{"context":229376,"output":229376},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Greg 2 Super","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-06-14","retired":false,"tags":null},"greg-2-ultra":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":{"cache_read":0.5,"input":3,"output":10},"deprecated":false,"extra":{"attachment":false,"description":"Flagship model for demanding analysis, coding, and production agent workflows","open_weights":false,"temperature":true},"family":null,"id":"greg-2-ultra","knowledge":null,"last_updated":"2026-06-14","lifecycle":null,"limits":{"context":229376,"output":229376},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Greg 2 Ultra","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-06-14","retired":false,"tags":null},"greg-rp":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":{"cache_read":0.02,"input":0.1,"output":0.3},"deprecated":false,"extra":{"attachment":false,"description":"General-purpose chat model for instruction following, writing, and analysis","open_weights":false,"temperature":true},"family":null,"id":"greg-rp","knowledge":null,"last_updated":"2026-01-27","lifecycle":null,"limits":{"context":229376,"output":229376},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Greg (Roleplay)","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-01-27","retired":false,"tags":null},"kimi-k2.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.07,"input":0.35,"output":1.7},"deprecated":false,"extra":{"attachment":true,"description":"Earlier Kimi frontier model for long-context agents, coding, and multimodal work","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k2.5","knowledge":"2025-01","last_updated":"2026-01","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K2.5","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-01","retired":false,"tags":null},"kimi-k2.5-lightning":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.2,"input":1,"output":3},"deprecated":false,"extra":{"attachment":false,"description":"Kimi multimodal agent model for visual understanding, coding, and planning","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k2.5-lightning","knowledge":null,"last_updated":"2026-02-06","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K2.5 (Lightning)","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-02-06","retired":false,"tags":null},"kimi-k2.6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.05,"input":0.5,"output":1.99},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal Kimi workhorse for agent loops, coding tasks, and visual context","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"kimi-k2.6","knowledge":"2025-01","last_updated":"2026-04-21","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K2.6","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-04-21","retired":false,"tags":null},"kimi-k2.7-code":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.05,"input":0.55,"output":2.25},"deprecated":false,"extra":{"attachment":true,"description":"Coding-focused Kimi model, stronger on long-horizon repo work with less overthinking","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k2.7-code","knowledge":"2025-01","last_updated":"2026-06-12","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K2.7 Code","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"kimi-k3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.25,"input":2,"output":8},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal Kimi model with 1M context and toggleable max-effort thinking for long-horizon agent work","family":"kimi-k3","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","high","max"]}],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k3","knowledge":null,"last_updated":"2026-07-16","lifecycle":null,"limits":{"context":1000000,"output":262144},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K3","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-07-16","retired":false,"tags":null},"kimi-k3-eco":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.1,"input":1,"output":4},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal Kimi model with 1M context and toggleable max-effort thinking for long-horizon agent work","family":"kimi-k3","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","high","max"]}],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k3-eco","knowledge":null,"last_updated":"2026-07-16","lifecycle":null,"limits":{"context":1000000,"output":131072},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K3 Eco","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-07-16","retired":false,"tags":null},"mimo-v2.5-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.003,"input":0.4,"output":0.8},"deprecated":false,"extra":{"attachment":false,"description":"Stronger MiMo Pro tier for multimodal reasoning and coding-agent execution","family":"mimo","interleaved":{"field":"reasoning_content"},"open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"temperature":true},"family":null,"id":"mimo-v2.5-pro","knowledge":"2024-12","last_updated":"2026-04-22","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiMo-V2.5-Pro","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-04-22","retired":false,"tags":null},"minimax-m2.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.02,"cache_write":0.375,"input":0.11,"output":0.95},"deprecated":false,"extra":{"attachment":false,"description":"Prior MiniMax coding model for agent workflows, office edits, and automation","family":"minimax","open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[],"temperature":true},"family":null,"id":"minimax-m2.5","knowledge":null,"last_updated":"2026-02-12","lifecycle":null,"limits":{"context":204800,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax-M2.5","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-02-12","retired":false,"tags":null},"qwen3.5-397b-a17b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.07,"input":0.35,"output":1.75},"deprecated":false,"extra":{"attachment":true,"description":"Large open Qwen multimodal MoE for visual agents and long technical tasks","family":"qwen","open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.5-397b-a17b","knowledge":null,"last_updated":"2026-02-15","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text","image","video","audio"],"output":["text"]},"model":null,"name":"Qwen3.5 397B-A17B","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-02-15","retired":false,"tags":null},"qwen3.5-9b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.008,"input":0.04,"output":0.15},"deprecated":false,"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.5-9b","knowledge":null,"last_updated":"2026-03-13","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text","image","video","audio"],"output":["text"]},"model":null,"name":"Qwen3.5 9B","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-03-13","retired":false,"tags":null},"qwen3.6-27b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.04,"input":0.2,"output":1.5},"deprecated":false,"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":true,"provider":{"npm":"@ai-sdk/openai-compatible"},"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.6-27b","knowledge":null,"last_updated":"2026-04-22","lifecycle":null,"limits":{"context":262144,"output":262144},"modalities":{"input":["text","image","video","audio"],"output":["text"]},"model":null,"name":"Qwen3.6 27B","pricing":null,"provider":"crof","provider_model_id":null,"release_date":"2026-04-22","retired":false,"tags":null}},"name":"CrofAI","pricing_defaults":null};
|
|
4
|
+
const provider = /* @__PURE__ */ createProviderCatalog(data);
|
|
5
|
+
export default provider;
|
|
@@ -0,0 +1,11 @@
|
|
|
1
|
+
import type {
|
|
2
|
+
Provider,
|
|
3
|
+
ProviderCatalog,
|
|
4
|
+
} from "../types.js";
|
|
5
|
+
|
|
6
|
+
export declare const data: Provider;
|
|
7
|
+
declare const provider: ProviderCatalog<
|
|
8
|
+
"crossmodel",
|
|
9
|
+
"anthropic/claude-fable-5" | "anthropic/claude-haiku-4-5" | "anthropic/claude-opus-4-7" | "anthropic/claude-opus-4-8" | "anthropic/claude-opus-5" | "anthropic/claude-sonnet-4-6" | "anthropic/claude-sonnet-5" | "deepseek/deepseek-v4-flash" | "deepseek/deepseek-v4-pro" | "gemini/gemini-2.5-flash" | "gemini/gemini-2.5-flash-lite" | "gemini/gemini-2.5-pro" | "gemini/gemini-3-flash-preview" | "gemini/gemini-3.1-pro-preview" | "gemini/gemini-3.5-flash" | "gemini/gemini-3.5-flash-lite" | "gemini/gemini-3.6-flash" | "minimax/minimax-m2.7" | "minimax/minimax-m3" | "moonshot/kimi-k2.5" | "moonshot/kimi-k2.6" | "moonshot/kimi-k2.7-code" | "moonshot/kimi-k3" | "openai/gpt-4o-mini" | "openai/gpt-5.4" | "openai/gpt-5.4-mini" | "openai/gpt-5.4-nano" | "openai/gpt-5.5" | "openai/gpt-5.5-pro" | "openai/gpt-5.6-luna" | "openai/gpt-5.6-sol" | "openai/gpt-5.6-terra" | "qwen/qwen3.6-flash" | "qwen/qwen3.6-plus" | "qwen/qwen3.7-flash" | "qwen/qwen3.7-max" | "qwen/qwen3.7-plus" | "qwen/qwen3.8-max" | "tencent/hy3" | "tencent/hy3-preview" | "x-ai/grok-4.3" | "x-ai/grok-4.5" | "x-ai/grok-build-0.1" | "xiaomi/mimo-v2.5" | "xiaomi/mimo-v2.5-pro" | "z-ai/glm-4.7" | "z-ai/glm-5" | "z-ai/glm-5-turbo" | "z-ai/glm-5.1" | "z-ai/glm-5.2"
|
|
10
|
+
>;
|
|
11
|
+
export default provider;
|