@agentjido/llmdb 2026.8.2
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/LICENSE +203 -0
- package/README.md +117 -0
- package/dist/catalog.d.ts +2 -0
- package/dist/catalog.js +53 -0
- package/dist/errors.d.ts +14 -0
- package/dist/errors.js +20 -0
- package/dist/full.d.ts +3 -0
- package/dist/full.js +191 -0
- package/dist/generated/manifest.d.ts +3 -0
- package/dist/generated/manifest.js +1 -0
- package/dist/generated/provider-loaders.d.ts +3 -0
- package/dist/generated/provider-loaders.js +185 -0
- package/dist/index.d.ts +8 -0
- package/dist/index.js +8 -0
- package/dist/lazy.d.ts +9 -0
- package/dist/lazy.js +73 -0
- package/dist/provider.d.ts +2 -0
- package/dist/provider.js +63 -0
- package/dist/providers/302ai.d.ts +11 -0
- package/dist/providers/302ai.js +5 -0
- package/dist/providers/abacus.d.ts +11 -0
- package/dist/providers/abacus.js +5 -0
- package/dist/providers/abliteration_ai.d.ts +11 -0
- package/dist/providers/abliteration_ai.js +5 -0
- package/dist/providers/ai_router.d.ts +11 -0
- package/dist/providers/ai_router.js +5 -0
- package/dist/providers/aiand.d.ts +11 -0
- package/dist/providers/aiand.js +5 -0
- package/dist/providers/aihubmix.d.ts +11 -0
- package/dist/providers/aihubmix.js +5 -0
- package/dist/providers/aki_io.d.ts +11 -0
- package/dist/providers/aki_io.js +5 -0
- package/dist/providers/alibaba.d.ts +11 -0
- package/dist/providers/alibaba.js +5 -0
- package/dist/providers/alibaba_cn.d.ts +11 -0
- package/dist/providers/alibaba_cn.js +5 -0
- package/dist/providers/alibaba_coding_plan.d.ts +11 -0
- package/dist/providers/alibaba_coding_plan.js +5 -0
- package/dist/providers/alibaba_coding_plan_cn.d.ts +11 -0
- package/dist/providers/alibaba_coding_plan_cn.js +5 -0
- package/dist/providers/alibaba_token_plan.d.ts +11 -0
- package/dist/providers/alibaba_token_plan.js +5 -0
- package/dist/providers/alibaba_token_plan_cn.d.ts +11 -0
- package/dist/providers/alibaba_token_plan_cn.js +5 -0
- package/dist/providers/amazon_bedrock.d.ts +11 -0
- package/dist/providers/amazon_bedrock.js +5 -0
- package/dist/providers/ambient.d.ts +11 -0
- package/dist/providers/ambient.js +5 -0
- package/dist/providers/anthropic.d.ts +11 -0
- package/dist/providers/anthropic.js +5 -0
- package/dist/providers/anyapi.d.ts +11 -0
- package/dist/providers/anyapi.js +5 -0
- package/dist/providers/atomic_chat.d.ts +11 -0
- package/dist/providers/atomic_chat.js +5 -0
- package/dist/providers/auriko.d.ts +11 -0
- package/dist/providers/auriko.js +5 -0
- package/dist/providers/azure.d.ts +11 -0
- package/dist/providers/azure.js +5 -0
- package/dist/providers/azure_cognitive_services.d.ts +11 -0
- package/dist/providers/azure_cognitive_services.js +5 -0
- package/dist/providers/bailing.d.ts +11 -0
- package/dist/providers/bailing.js +5 -0
- package/dist/providers/baseten.d.ts +11 -0
- package/dist/providers/baseten.js +5 -0
- package/dist/providers/berget.d.ts +11 -0
- package/dist/providers/berget.js +5 -0
- package/dist/providers/blueclaw.d.ts +11 -0
- package/dist/providers/blueclaw.js +5 -0
- package/dist/providers/cerebras.d.ts +11 -0
- package/dist/providers/cerebras.js +5 -0
- package/dist/providers/chutes.d.ts +11 -0
- package/dist/providers/chutes.js +5 -0
- package/dist/providers/clarifai.d.ts +11 -0
- package/dist/providers/clarifai.js +5 -0
- package/dist/providers/claudinio.d.ts +11 -0
- package/dist/providers/claudinio.js +5 -0
- package/dist/providers/cline_pass.d.ts +11 -0
- package/dist/providers/cline_pass.js +5 -0
- package/dist/providers/cloudferro_sherlock.d.ts +11 -0
- package/dist/providers/cloudferro_sherlock.js +5 -0
- package/dist/providers/cloudflare_ai_gateway.d.ts +11 -0
- package/dist/providers/cloudflare_ai_gateway.js +5 -0
- package/dist/providers/cloudflare_workers_ai.d.ts +11 -0
- package/dist/providers/cloudflare_workers_ai.js +5 -0
- package/dist/providers/cohere.d.ts +11 -0
- package/dist/providers/cohere.js +5 -0
- package/dist/providers/cortecs.d.ts +11 -0
- package/dist/providers/cortecs.js +5 -0
- package/dist/providers/crof.d.ts +11 -0
- package/dist/providers/crof.js +5 -0
- package/dist/providers/crossmodel.d.ts +11 -0
- package/dist/providers/crossmodel.js +5 -0
- package/dist/providers/daoxe.d.ts +11 -0
- package/dist/providers/daoxe.js +5 -0
- package/dist/providers/databricks.d.ts +11 -0
- package/dist/providers/databricks.js +5 -0
- package/dist/providers/deepinfra.d.ts +11 -0
- package/dist/providers/deepinfra.js +5 -0
- package/dist/providers/deepseek.d.ts +11 -0
- package/dist/providers/deepseek.js +5 -0
- package/dist/providers/digitalocean.d.ts +11 -0
- package/dist/providers/digitalocean.js +5 -0
- package/dist/providers/dinference.d.ts +11 -0
- package/dist/providers/dinference.js +5 -0
- package/dist/providers/drun.d.ts +11 -0
- package/dist/providers/drun.js +5 -0
- package/dist/providers/ebcloud.d.ts +11 -0
- package/dist/providers/ebcloud.js +5 -0
- package/dist/providers/elevenlabs.d.ts +11 -0
- package/dist/providers/elevenlabs.js +5 -0
- package/dist/providers/empiriolabs.d.ts +11 -0
- package/dist/providers/empiriolabs.js +5 -0
- package/dist/providers/evroc.d.ts +11 -0
- package/dist/providers/evroc.js +5 -0
- package/dist/providers/fastrouter.d.ts +11 -0
- package/dist/providers/fastrouter.js +5 -0
- package/dist/providers/fireworks_ai.d.ts +11 -0
- package/dist/providers/fireworks_ai.js +5 -0
- package/dist/providers/freemodel.d.ts +11 -0
- package/dist/providers/freemodel.js +5 -0
- package/dist/providers/friendli.d.ts +11 -0
- package/dist/providers/friendli.js +5 -0
- package/dist/providers/frogbot.d.ts +11 -0
- package/dist/providers/frogbot.js +5 -0
- package/dist/providers/github_copilot.d.ts +11 -0
- package/dist/providers/github_copilot.js +5 -0
- package/dist/providers/github_models.d.ts +11 -0
- package/dist/providers/github_models.js +5 -0
- package/dist/providers/gitlab.d.ts +11 -0
- package/dist/providers/gitlab.js +5 -0
- package/dist/providers/gmicloud.d.ts +11 -0
- package/dist/providers/gmicloud.js +5 -0
- package/dist/providers/google.d.ts +11 -0
- package/dist/providers/google.js +5 -0
- package/dist/providers/google_vertex.d.ts +11 -0
- package/dist/providers/google_vertex.js +5 -0
- package/dist/providers/google_vertex_anthropic.d.ts +11 -0
- package/dist/providers/google_vertex_anthropic.js +5 -0
- package/dist/providers/greenpt.d.ts +11 -0
- package/dist/providers/greenpt.js +5 -0
- package/dist/providers/groq.d.ts +11 -0
- package/dist/providers/groq.js +5 -0
- package/dist/providers/helicone.d.ts +11 -0
- package/dist/providers/helicone.js +5 -0
- package/dist/providers/hetzner.d.ts +11 -0
- package/dist/providers/hetzner.js +5 -0
- package/dist/providers/hpc_ai.d.ts +11 -0
- package/dist/providers/hpc_ai.js +5 -0
- package/dist/providers/huggingface.d.ts +11 -0
- package/dist/providers/huggingface.js +5 -0
- package/dist/providers/hyper.d.ts +11 -0
- package/dist/providers/hyper.js +5 -0
- package/dist/providers/iflowcn.d.ts +11 -0
- package/dist/providers/iflowcn.js +5 -0
- package/dist/providers/impossibl.d.ts +11 -0
- package/dist/providers/impossibl.js +5 -0
- package/dist/providers/inception.d.ts +11 -0
- package/dist/providers/inception.js +5 -0
- package/dist/providers/inceptron.d.ts +11 -0
- package/dist/providers/inceptron.js +5 -0
- package/dist/providers/inference.d.ts +11 -0
- package/dist/providers/inference.js +5 -0
- package/dist/providers/inferx.d.ts +11 -0
- package/dist/providers/inferx.js +5 -0
- package/dist/providers/infomaniak.d.ts +11 -0
- package/dist/providers/infomaniak.js +5 -0
- package/dist/providers/io_net.d.ts +11 -0
- package/dist/providers/io_net.js +5 -0
- package/dist/providers/jiekou.d.ts +11 -0
- package/dist/providers/jiekou.js +5 -0
- package/dist/providers/kenari.d.ts +11 -0
- package/dist/providers/kenari.js +5 -0
- package/dist/providers/kilo.d.ts +11 -0
- package/dist/providers/kilo.js +5 -0
- package/dist/providers/kimi_for_coding.d.ts +11 -0
- package/dist/providers/kimi_for_coding.js +5 -0
- package/dist/providers/kuae_cloud_coding_plan.d.ts +11 -0
- package/dist/providers/kuae_cloud_coding_plan.js +5 -0
- package/dist/providers/lilac.d.ts +11 -0
- package/dist/providers/lilac.js +5 -0
- package/dist/providers/llama.d.ts +11 -0
- package/dist/providers/llama.js +5 -0
- package/dist/providers/llmgateway.d.ts +11 -0
- package/dist/providers/llmgateway.js +5 -0
- package/dist/providers/llmtr.d.ts +11 -0
- package/dist/providers/llmtr.js +5 -0
- package/dist/providers/lmstudio.d.ts +11 -0
- package/dist/providers/lmstudio.js +5 -0
- package/dist/providers/longcat.d.ts +11 -0
- package/dist/providers/longcat.js +5 -0
- package/dist/providers/lucidquery.d.ts +11 -0
- package/dist/providers/lucidquery.js +5 -0
- package/dist/providers/lynkr.d.ts +11 -0
- package/dist/providers/lynkr.js +5 -0
- package/dist/providers/meganova.d.ts +11 -0
- package/dist/providers/meganova.js +5 -0
- package/dist/providers/merge_gateway.d.ts +11 -0
- package/dist/providers/merge_gateway.js +5 -0
- package/dist/providers/meta.d.ts +11 -0
- package/dist/providers/meta.js +5 -0
- package/dist/providers/minimax.d.ts +11 -0
- package/dist/providers/minimax.js +5 -0
- package/dist/providers/minimax_cn.d.ts +11 -0
- package/dist/providers/minimax_cn.js +5 -0
- package/dist/providers/minimax_cn_coding_plan.d.ts +11 -0
- package/dist/providers/minimax_cn_coding_plan.js +5 -0
- package/dist/providers/minimax_coding_plan.d.ts +11 -0
- package/dist/providers/minimax_coding_plan.js +5 -0
- package/dist/providers/mistral.d.ts +11 -0
- package/dist/providers/mistral.js +5 -0
- package/dist/providers/mixlayer.d.ts +11 -0
- package/dist/providers/mixlayer.js +5 -0
- package/dist/providers/moark.d.ts +11 -0
- package/dist/providers/moark.js +5 -0
- package/dist/providers/modal.d.ts +11 -0
- package/dist/providers/modal.js +5 -0
- package/dist/providers/model_oracle_ai.d.ts +11 -0
- package/dist/providers/model_oracle_ai.js +5 -0
- package/dist/providers/modelis.d.ts +11 -0
- package/dist/providers/modelis.js +5 -0
- package/dist/providers/modelscope.d.ts +11 -0
- package/dist/providers/modelscope.js +5 -0
- package/dist/providers/moonshotai.d.ts +11 -0
- package/dist/providers/moonshotai.js +5 -0
- package/dist/providers/moonshotai_cn.d.ts +11 -0
- package/dist/providers/moonshotai_cn.js +5 -0
- package/dist/providers/morph.d.ts +11 -0
- package/dist/providers/morph.js +5 -0
- package/dist/providers/nano_gpt.d.ts +11 -0
- package/dist/providers/nano_gpt.js +5 -0
- package/dist/providers/nearai.d.ts +11 -0
- package/dist/providers/nearai.js +5 -0
- package/dist/providers/nebius.d.ts +11 -0
- package/dist/providers/nebius.js +5 -0
- package/dist/providers/neon.d.ts +11 -0
- package/dist/providers/neon.js +5 -0
- package/dist/providers/neuralwatt.d.ts +11 -0
- package/dist/providers/neuralwatt.js +5 -0
- package/dist/providers/nova.d.ts +11 -0
- package/dist/providers/nova.js +5 -0
- package/dist/providers/novita_ai.d.ts +11 -0
- package/dist/providers/novita_ai.js +5 -0
- package/dist/providers/nvidia.d.ts +11 -0
- package/dist/providers/nvidia.js +5 -0
- package/dist/providers/ofox.d.ts +11 -0
- package/dist/providers/ofox.js +5 -0
- package/dist/providers/ollama_cloud.d.ts +11 -0
- package/dist/providers/ollama_cloud.js +5 -0
- package/dist/providers/openai.d.ts +11 -0
- package/dist/providers/openai.js +5 -0
- package/dist/providers/opencode.d.ts +11 -0
- package/dist/providers/opencode.js +5 -0
- package/dist/providers/opencode_go.d.ts +11 -0
- package/dist/providers/opencode_go.js +5 -0
- package/dist/providers/openrouter.d.ts +11 -0
- package/dist/providers/openrouter.js +5 -0
- package/dist/providers/orcarouter.d.ts +11 -0
- package/dist/providers/orcarouter.js +5 -0
- package/dist/providers/ovhcloud.d.ts +11 -0
- package/dist/providers/ovhcloud.js +5 -0
- package/dist/providers/perplexity.d.ts +11 -0
- package/dist/providers/perplexity.js +5 -0
- package/dist/providers/perplexity_agent.d.ts +11 -0
- package/dist/providers/perplexity_agent.js +5 -0
- package/dist/providers/pioneer.d.ts +11 -0
- package/dist/providers/pioneer.js +5 -0
- package/dist/providers/poe.d.ts +11 -0
- package/dist/providers/poe.js +5 -0
- package/dist/providers/poolside.d.ts +11 -0
- package/dist/providers/poolside.js +5 -0
- package/dist/providers/privatemode_ai.d.ts +11 -0
- package/dist/providers/privatemode_ai.js +5 -0
- package/dist/providers/qihang_ai.d.ts +11 -0
- package/dist/providers/qihang_ai.js +5 -0
- package/dist/providers/qiniu_ai.d.ts +11 -0
- package/dist/providers/qiniu_ai.js +5 -0
- package/dist/providers/qvac.d.ts +11 -0
- package/dist/providers/qvac.js +5 -0
- package/dist/providers/regolo_ai.d.ts +11 -0
- package/dist/providers/regolo_ai.js +5 -0
- package/dist/providers/requesty.d.ts +11 -0
- package/dist/providers/requesty.js +5 -0
- package/dist/providers/routing_run.d.ts +11 -0
- package/dist/providers/routing_run.js +5 -0
- package/dist/providers/sakana.d.ts +11 -0
- package/dist/providers/sakana.js +5 -0
- package/dist/providers/sap_ai_core.d.ts +11 -0
- package/dist/providers/sap_ai_core.js +5 -0
- package/dist/providers/sarvam.d.ts +11 -0
- package/dist/providers/sarvam.js +5 -0
- package/dist/providers/scaleway.d.ts +11 -0
- package/dist/providers/scaleway.js +5 -0
- package/dist/providers/scx.d.ts +11 -0
- package/dist/providers/scx.js +5 -0
- package/dist/providers/siliconflow.d.ts +11 -0
- package/dist/providers/siliconflow.js +5 -0
- package/dist/providers/siliconflow_cn.d.ts +11 -0
- package/dist/providers/siliconflow_cn.js +5 -0
- package/dist/providers/snowflake_cortex.d.ts +11 -0
- package/dist/providers/snowflake_cortex.js +5 -0
- package/dist/providers/stackit.d.ts +11 -0
- package/dist/providers/stackit.js +5 -0
- package/dist/providers/stepfun.d.ts +11 -0
- package/dist/providers/stepfun.js +5 -0
- package/dist/providers/stepfun_ai.d.ts +11 -0
- package/dist/providers/stepfun_ai.js +5 -0
- package/dist/providers/stepfun_ai_step_plan.d.ts +11 -0
- package/dist/providers/stepfun_ai_step_plan.js +5 -0
- package/dist/providers/stepfun_step_plan.d.ts +11 -0
- package/dist/providers/stepfun_step_plan.js +5 -0
- package/dist/providers/subconscious.d.ts +11 -0
- package/dist/providers/subconscious.js +5 -0
- package/dist/providers/submodel.d.ts +11 -0
- package/dist/providers/submodel.js +5 -0
- package/dist/providers/synthetic.d.ts +11 -0
- package/dist/providers/synthetic.js +5 -0
- package/dist/providers/tencent_coding_plan.d.ts +11 -0
- package/dist/providers/tencent_coding_plan.js +5 -0
- package/dist/providers/tencent_token_plan.d.ts +11 -0
- package/dist/providers/tencent_token_plan.js +5 -0
- package/dist/providers/tencent_tokenhub.d.ts +11 -0
- package/dist/providers/tencent_tokenhub.js +5 -0
- package/dist/providers/tensorx.d.ts +11 -0
- package/dist/providers/tensorx.js +5 -0
- package/dist/providers/the_grid_ai.d.ts +11 -0
- package/dist/providers/the_grid_ai.js +5 -0
- package/dist/providers/thinkingmachines.d.ts +11 -0
- package/dist/providers/thinkingmachines.js +5 -0
- package/dist/providers/tinfoil.d.ts +11 -0
- package/dist/providers/tinfoil.js +5 -0
- package/dist/providers/togetherai.d.ts +11 -0
- package/dist/providers/togetherai.js +5 -0
- package/dist/providers/trustedrouter.d.ts +11 -0
- package/dist/providers/trustedrouter.js +5 -0
- package/dist/providers/umans_ai.d.ts +11 -0
- package/dist/providers/umans_ai.js +5 -0
- package/dist/providers/umans_ai_coding_plan.d.ts +11 -0
- package/dist/providers/umans_ai_coding_plan.js +5 -0
- package/dist/providers/unorouter.d.ts +11 -0
- package/dist/providers/unorouter.js +5 -0
- package/dist/providers/upstage.d.ts +11 -0
- package/dist/providers/upstage.js +5 -0
- package/dist/providers/v0.d.ts +11 -0
- package/dist/providers/v0.js +5 -0
- package/dist/providers/venice.d.ts +11 -0
- package/dist/providers/venice.js +5 -0
- package/dist/providers/vercel.d.ts +11 -0
- package/dist/providers/vercel.js +5 -0
- package/dist/providers/vivgrid.d.ts +11 -0
- package/dist/providers/vivgrid.js +5 -0
- package/dist/providers/vultr.d.ts +11 -0
- package/dist/providers/vultr.js +5 -0
- package/dist/providers/wafer_ai.d.ts +11 -0
- package/dist/providers/wafer_ai.js +5 -0
- package/dist/providers/wandb.d.ts +11 -0
- package/dist/providers/wandb.js +5 -0
- package/dist/providers/xai.d.ts +11 -0
- package/dist/providers/xai.js +5 -0
- package/dist/providers/xiaomi.d.ts +11 -0
- package/dist/providers/xiaomi.js +5 -0
- package/dist/providers/xiaomi_token_plan_ams.d.ts +11 -0
- package/dist/providers/xiaomi_token_plan_ams.js +5 -0
- package/dist/providers/xiaomi_token_plan_cn.d.ts +11 -0
- package/dist/providers/xiaomi_token_plan_cn.js +5 -0
- package/dist/providers/xiaomi_token_plan_sgp.d.ts +11 -0
- package/dist/providers/xiaomi_token_plan_sgp.js +5 -0
- package/dist/providers/xpersona.d.ts +11 -0
- package/dist/providers/xpersona.js +5 -0
- package/dist/providers/zai.d.ts +11 -0
- package/dist/providers/zai.js +5 -0
- package/dist/providers/zai_coder.d.ts +11 -0
- package/dist/providers/zai_coder.js +5 -0
- package/dist/providers/zai_coding_plan.d.ts +11 -0
- package/dist/providers/zai_coding_plan.js +5 -0
- package/dist/providers/zeldoc.d.ts +11 -0
- package/dist/providers/zeldoc.js +5 -0
- package/dist/providers/zenifra.d.ts +11 -0
- package/dist/providers/zenifra.js +5 -0
- package/dist/providers/zenmux.d.ts +11 -0
- package/dist/providers/zenmux.js +5 -0
- package/dist/providers/zhipuai.d.ts +11 -0
- package/dist/providers/zhipuai.js +5 -0
- package/dist/providers/zhipuai_coding_plan.d.ts +11 -0
- package/dist/providers/zhipuai_coding_plan.js +5 -0
- package/dist/snapshot.d.ts +3 -0
- package/dist/snapshot.js +377 -0
- package/dist/spec.d.ts +4 -0
- package/dist/spec.js +46 -0
- package/dist/types.d.ts +287 -0
- package/dist/types.js +1 -0
- package/package.json +80 -0
|
@@ -0,0 +1,5 @@
|
|
|
1
|
+
import { createProviderCatalog } from "../provider.js";
|
|
2
|
+
|
|
3
|
+
export const data = {"alias_of":null,"base_url":null,"catalog_only":true,"config_schema":null,"doc":"https://docs.aihubmix.com","env":["AIHUBMIX_API_KEY"],"exclude_models":null,"extra":null,"id":"aihubmix","models":{"alicloud-deepseek-v4-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.028,"input":0.14,"output":0.28},"deprecated":false,"extra":{"attachment":false,"description":"Fast DeepSeek model for efficient chat, coding help, and agent loops","family":"deepseek-flash","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"alicloud-deepseek-v4-flash","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Flash (Alibaba Cloud)","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"alicloud-deepseek-v4-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.13,"input":1.69,"output":3.38},"deprecated":false,"extra":{"attachment":false,"description":"Flagship DeepSeek model for coding, reasoning, and agentic work","family":"deepseek-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"alicloud-deepseek-v4-pro","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Pro (Alibaba Cloud)","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"alicloud-glm-5.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.169,"cache_write":1.05625,"input":0.84,"output":3.38},"deprecated":false,"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"alicloud-glm-5.1","knowledge":null,"last_updated":"2026-03-27","lifecycle":null,"limits":{"context":200000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5.1 (Alibaba Cloud)","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-03-27","retired":false,"tags":null},"claude-fable-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":1.1,"cache_write":13.75,"input":11,"output":55},"deprecated":false,"extra":{"attachment":true,"description":"Claude model for creative writing, analysis, and controlled agent workflows","family":"claude-fable","interleaved":true,"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","xhigh","max"]}],"structured_output":true,"temperature":false},"family":null,"id":"claude-fable-5","knowledge":"2026-01-31","last_updated":"2026-06-09","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Claude Fable 5","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-06-09","retired":false,"tags":null},"claude-opus-4-6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.5,"cache_write":6.25,"input":5,"output":25},"deprecated":false,"extra":{"attachment":true,"description":"Flagship Claude model for deep reasoning, coding, and long-horizon agents","family":"claude-opus","interleaved":true,"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","max"]},{"min":1024,"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"claude-opus-4-6","knowledge":"2025-05-31","last_updated":"2026-03-13","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.6","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-02-05","retired":false,"tags":null},"claude-opus-4-6-think":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.5,"cache_write":6.25,"input":5,"output":25},"deprecated":false,"extra":{"attachment":true,"description":"Flagship Claude model for deep reasoning, coding, and long-horizon agents","family":"claude-opus","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","max"]},{"min":1024,"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"claude-opus-4-6-think","knowledge":"2025-05-31","last_updated":"2026-03-13","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.6 Thinking","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-02-05","retired":false,"tags":null},"claude-opus-4-7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.5,"cache_write":6.25,"input":5,"output":25},"deprecated":false,"extra":{"attachment":true,"description":"Flagship Claude model for deep reasoning, coding, and long-horizon agents","family":"claude-opus","interleaved":true,"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","xhigh","max"]}],"structured_output":true,"temperature":false},"family":null,"id":"claude-opus-4-7","knowledge":"2026-01-31","last_updated":"2026-04-16","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.7","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-16","retired":false,"tags":null},"claude-opus-4-7-think":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.5,"cache_write":6.25,"input":5,"output":25},"deprecated":false,"extra":{"attachment":true,"description":"Flagship Claude model for deep reasoning, coding, and long-horizon agents","family":"claude-opus","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","xhigh","max"]}],"structured_output":true,"temperature":false},"family":null,"id":"claude-opus-4-7-think","knowledge":"2026-01-31","last_updated":"2026-04-16","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.7 Thinking","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-16","retired":false,"tags":null},"claude-opus-4-8":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.5,"cache_write":6.25,"input":5,"output":25},"deprecated":false,"extra":{"attachment":true,"description":"Top Claude Opus tier for the hardest reasoning, coding, and long-horizon agents","family":"claude-opus","interleaved":true,"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","xhigh","max"]}],"temperature":false},"family":null,"id":"claude-opus-4-8","knowledge":"2026-01","last_updated":"2026-05-28","lifecycle":null,"limits":{"context":200000,"output":32000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Claude Opus 4.8","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-05-28","retired":false,"tags":null},"claude-opus-4-8-think":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.5,"cache_write":6.25,"input":5,"output":25},"deprecated":false,"extra":{"attachment":true,"description":"Top Claude Opus tier for the hardest reasoning, coding, and long-horizon agents","family":"claude-opus","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","xhigh","max"]}],"temperature":false},"family":null,"id":"claude-opus-4-8-think","knowledge":"2026-01","last_updated":"2026-05-28","lifecycle":null,"limits":{"context":200000,"output":32000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Claude Opus 4.8","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-05-28","retired":false,"tags":null},"claude-sonnet-4-6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.3,"cache_write":3.75,"input":3,"output":15},"deprecated":false,"extra":{"attachment":true,"description":"Balanced Claude model for coding, analysis, agent workflows, and cost control","family":"claude-sonnet","interleaved":true,"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","max"]},{"min":1024,"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"claude-sonnet-4-6","knowledge":"2025-08-31","last_updated":"2026-03-13","lifecycle":null,"limits":{"context":1000000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Sonnet 4.6","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-02-17","retired":false,"tags":null},"claude-sonnet-4-6-think":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.3,"cache_write":3.75,"input":3,"output":15},"deprecated":false,"extra":{"attachment":true,"description":"Balanced Claude model for coding, analysis, agent workflows, and cost control","family":"claude-sonnet","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","max"]},{"min":1024,"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"claude-sonnet-4-6-think","knowledge":"2025-08-31","last_updated":"2026-03-13","lifecycle":null,"limits":{"context":1000000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Sonnet 4.6 Thinking","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-02-17","retired":false,"tags":null},"claude-sonnet-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.2,"cache_write":2.5,"input":2,"output":10},"deprecated":false,"extra":{"attachment":true,"description":"Everyday Claude agent model for coding, planning, browsing, and general work","family":"claude-sonnet","interleaved":true,"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high","xhigh","max"]}],"structured_output":true,"temperature":false},"family":null,"id":"claude-sonnet-5","knowledge":"2026-01-31","last_updated":"2026-06-30","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Claude Sonnet 5","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-06-30","retired":false,"tags":null},"coding-glm-5.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.013,"input":0.06,"output":0.22},"deprecated":false,"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"coding-glm-5.1","knowledge":null,"last_updated":"2026-04-11","lifecycle":null,"limits":{"context":200000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Coding GLM 5.1","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-11","retired":false,"tags":null},"coding-glm-5.1-free":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0,"output":0},"deprecated":false,"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm-free","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"coding-glm-5.1-free","knowledge":null,"last_updated":"2026-04-11","lifecycle":null,"limits":{"context":200000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Coding GLM 5.1 (free)","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-11","retired":false,"tags":null},"coding-minimax-m2.7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.2,"output":0.2},"deprecated":false,"extra":{"attachment":false,"description":"MiniMax model for chat, coding, office work, and agentic tasks","family":"minimax","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"coding-minimax-m2.7","knowledge":null,"last_updated":"2026-03-18","lifecycle":null,"limits":{"context":204800,"output":128100},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Coding MiniMax M2.7","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-03-18","retired":false,"tags":null},"coding-minimax-m2.7-free":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0,"output":0},"deprecated":false,"extra":{"attachment":false,"description":"MiniMax model for chat, coding, office work, and agentic tasks","family":"minimax-free","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"coding-minimax-m2.7-free","knowledge":null,"last_updated":"2026-03-18","lifecycle":null,"limits":{"context":204800,"output":128100},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Coding MiniMax M2.7 (Free)","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-03-18","retired":false,"tags":null},"coding-minimax-m2.7-highspeed":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.2,"output":0.2},"deprecated":false,"extra":{"attachment":false,"description":"High-speed MiniMax model for low-latency coding and agent workflows","family":"minimax","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"coding-minimax-m2.7-highspeed","knowledge":null,"last_updated":"2026-03-18","lifecycle":null,"limits":{"context":204800,"output":128100},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Coding MiniMax M2.7 Highspeed","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-03-18","retired":false,"tags":null},"coding-xiaomi-mimo-v2.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.016,"input":0.08,"output":0.4},"deprecated":false,"extra":{"attachment":true,"description":"Open MiMo model for multimodal coding agents and long-context automation","family":"mimo-v2.5","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"coding-xiaomi-mimo-v2.5","knowledge":"2024-12","last_updated":"2026-05-13","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text","image","audio","video"],"output":["text"]},"model":null,"name":"Coding Xiaomi MiMo-V2.5","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-22","retired":false,"tags":null},"coding-xiaomi-mimo-v2.5-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.04,"input":0.2,"output":0.6},"deprecated":false,"extra":{"attachment":false,"description":"Stronger MiMo Pro tier for multimodal reasoning and coding-agent execution","family":"mimo-v2.5-pro","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"coding-xiaomi-mimo-v2.5-pro","knowledge":"2024-12","last_updated":"2026-05-13","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Coding Xiaomi MiMo-V2.5-Pro","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-22","retired":false,"tags":null},"deep-deepseek-v4-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.0308,"input":0.154,"output":0.308},"deprecated":false,"extra":{"attachment":false,"description":"Fast DeepSeek model for efficient chat, coding help, and agent loops","family":"deepseek-flash","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"deep-deepseek-v4-flash","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Flash (DeepSeek)","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"deep-deepseek-v4-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.004302,"input":0.478,"output":0.956},"deprecated":false,"extra":{"attachment":false,"description":"Flagship DeepSeek model for coding, reasoning, and agentic work","family":"deepseek-thinking","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"deep-deepseek-v4-pro","knowledge":"2025-05","last_updated":"2026-04-24","lifecycle":null,"limits":{"context":1000000,"output":384000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"DeepSeek V4 Pro (DeepSeek)","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-24","retired":false,"tags":null},"doubao-seed-2-0-code-preview":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.09644,"input":0.48,"output":2.41},"deprecated":false,"extra":{"attachment":true,"description":"Coding model for repository understanding, refactors, and agentic engineering tasks","family":"seed","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"doubao-seed-2-0-code-preview","knowledge":null,"last_updated":"2026-02-14","lifecycle":null,"limits":{"context":256000,"output":128000},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Doubao Seed 2.0 Code Preview","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-02-14","retired":false,"tags":null},"doubao-seed-2-0-lite-260428":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.01692,"input":0.08,"input_audio":1.269,"output":0.51},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal reasoning model for visual analysis, planning, and tool use","family":"seed","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"doubao-seed-2-0-lite-260428","knowledge":null,"last_updated":"2026-04-28","lifecycle":null,"limits":{"context":256000,"output":128000},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Doubao Seed 2.0 Lite 260428","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-28","retired":false,"tags":null},"doubao-seed-2-0-mini-260428":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.00564,"input":0.03,"input_audio":0.423,"output":0.28},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal reasoning model for visual analysis, planning, and tool use","family":"seed","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"doubao-seed-2-0-mini-260428","knowledge":null,"last_updated":"2026-04-28","lifecycle":null,"limits":{"context":256000,"output":128000},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Doubao Seed 2.0 Mini 260428","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-28","retired":false,"tags":null},"doubao-seed-2-0-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.09644,"input":0.48,"output":2.41},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal reasoning model for visual analysis, planning, and tool use","family":"seed","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"doubao-seed-2-0-pro","knowledge":null,"last_updated":"2026-02-14","lifecycle":null,"limits":{"context":256000,"output":128000},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Doubao Seed 2.0 Pro","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-02-14","retired":false,"tags":null},"gemini-2.5-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.03,"input":0.3,"input_audio":1,"output":2.5},"deprecated":false,"extra":{"attachment":true,"description":"Fast Gemini model balancing multimodal reasoning, tool use, and cost","family":"gemini-flash","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","high"]},{"max":24576,"min":0,"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"gemini-2.5-flash","knowledge":"2025-01","last_updated":"2025-06-05","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","audio","video","pdf"],"output":["text"]},"model":null,"name":"Gemini 2.5 Flash","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2025-03-20","retired":false,"tags":null},"gemini-2.5-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.125,"input":1.25,"output":10},"deprecated":false,"extra":{"attachment":true,"description":"Advanced Gemini model for complex reasoning, coding, and multimodal analysis","family":"gemini-pro","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"gemini-2.5-pro","knowledge":"2025-01","last_updated":"2025-06-05","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","audio","video","pdf"],"output":["text"]},"model":null,"name":"Gemini 2.5 Pro","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2025-03-20","retired":false,"tags":null},"gemini-3-flash-preview":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.05,"input":0.5,"output":3},"deprecated":false,"extra":{"attachment":true,"description":"Fast Gemini model balancing multimodal reasoning, tool use, and cost","family":"gemini-flash","open_weights":false,"reasoning_options":[{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"gemini-3-flash-preview","knowledge":"2025-01","last_updated":"2025-12-17","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","audio","video","pdf"],"output":["text"]},"model":null,"name":"Gemini 3 Flash Preview","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2025-12-17","retired":false,"tags":null},"gemini-3.1-flash-lite":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.025,"cache_write":1,"input":0.25,"output":1.5},"deprecated":false,"extra":{"attachment":true,"description":"Low-latency Gemini model for high-volume multimodal and agent workloads","family":"gemini-flash-lite","open_weights":false,"reasoning_options":[{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"gemini-3.1-flash-lite","knowledge":"2025-01","last_updated":"2026-05-07","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","audio","video","pdf"],"output":["text"]},"model":null,"name":"Gemini 3.1 Flash Lite","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-05-07","retired":false,"tags":null},"gemini-3.1-pro-preview":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.2,"input":2,"output":12},"deprecated":false,"extra":{"attachment":true,"description":"Advanced Gemini model for complex reasoning, coding, and multimodal analysis","family":"gemini-pro","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"gemini-3.1-pro-preview","knowledge":"2025-01","last_updated":"2026-02-19","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","audio","video","pdf"],"output":["text"]},"model":null,"name":"Gemini 3.1 Pro Preview","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-02-19","retired":false,"tags":null},"gemini-3.1-pro-preview-customtools":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.2,"input":2,"output":12},"deprecated":false,"extra":{"attachment":true,"description":"Advanced Gemini model for complex reasoning, coding, and multimodal analysis","family":"gemini-pro","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"gemini-3.1-pro-preview-customtools","knowledge":"2025-01","last_updated":"2026-02-19","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","audio","video","pdf"],"output":["text"]},"model":null,"name":"Gemini 3.1 Pro Preview Custom Tools","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-02-19","retired":false,"tags":null},"gemini-3.5-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":1.5,"input":1.5,"output":9},"deprecated":false,"extra":{"attachment":true,"description":"Fast Gemini model balancing multimodal reasoning, tool use, and cost","family":"gemini-flash","open_weights":false,"reasoning_options":[{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"gemini-3.5-flash","knowledge":"2025-01","last_updated":"2026-05-19","lifecycle":null,"limits":{"context":1000000,"output":64000},"modalities":{"input":["text","image","audio","video"],"output":["text"]},"model":null,"name":"Gemini 3.5 Flash","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-05-19","retired":false,"tags":null},"glm-5.2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.2817,"input":1.1268,"output":3.9438},"deprecated":false,"extra":{"attachment":false,"description":"Open flagship GLM for long-horizon coding agents and million-token context work","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["high","max"]}],"structured_output":true,"temperature":true},"family":null,"id":"glm-5.2","knowledge":null,"last_updated":"2026-06-13","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5.2","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-06-13","retired":false,"tags":null},"glm-5v-turbo":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.169008,"input":0.7042,"output":3.09848},"deprecated":false,"extra":{"attachment":true,"description":"GLM vision model for visual reasoning, documents, and multimodal agents","family":"glmv","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"glm-5v-turbo","knowledge":null,"last_updated":"2026-05-09","lifecycle":null,"limits":{"context":200000,"output":128000},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"GLM 5 Vision Turbo","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-05-09","retired":false,"tags":null},"gpt-5.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.13,"input":1.25,"output":10},"deprecated":false,"extra":{"attachment":true,"description":"GPT model for general reasoning, writing, coding, and tool-assisted tasks","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.1","knowledge":"2024-09-30","last_updated":"2025-11-13","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.1","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2025-11-13","retired":false,"tags":null},"gpt-5.1-codex":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.125,"input":1.25,"output":10},"deprecated":false,"extra":{"attachment":true,"description":"Coding-optimized GPT model for repository edits, reviews, and agentic software work","family":"gpt-codex","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.1-codex","knowledge":"2024-09-30","last_updated":"2025-11-13","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.1 Codex","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2025-11-13","retired":false,"tags":null},"gpt-5.1-codex-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.025,"input":0.25,"output":2},"deprecated":false,"extra":{"attachment":true,"description":"Coding-optimized GPT model for repository edits, reviews, and agentic software work","family":"gpt-codex","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.1-codex-mini","knowledge":"2024-09-30","last_updated":"2025-11-13","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.1 Codex mini","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2025-11-13","retired":false,"tags":null},"gpt-5.2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.175,"input":1.75,"output":14},"deprecated":false,"extra":{"attachment":true,"description":"GPT model for general reasoning, writing, coding, and tool-assisted tasks","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.2","knowledge":"2025-08-31","last_updated":"2025-12-11","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.2","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2025-12-11","retired":false,"tags":null},"gpt-5.2-codex":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.175,"input":1.75,"output":14},"deprecated":false,"extra":{"attachment":true,"description":"Coding-optimized GPT model for repository edits, reviews, and agentic software work","family":"gpt-codex","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high","xhigh"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.2-codex","knowledge":"2025-08-31","last_updated":"2025-12-11","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.2 Codex","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2025-12-11","retired":false,"tags":null},"gpt-5.3-codex":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.175,"input":1.75,"output":14},"deprecated":false,"extra":{"attachment":true,"description":"Coding-optimized GPT model for repository edits, reviews, and agentic software work","family":"gpt-codex","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high","xhigh"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.3-codex","knowledge":"2025-08-31","last_updated":"2026-02-05","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.3 Codex","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-02-05","retired":false,"tags":null},"gpt-5.4":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.25,"input":2.5,"output":15},"deprecated":false,"extra":{"attachment":true,"description":"Frontier GPT model for professional reasoning, coding, and multimodal work","experimental":{"modes":{"fast":{"cost":{"cache_read":0.5,"input":5,"output":30},"provider":{"body":{"service_tier":"priority"}}}}},"family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.4","knowledge":"2025-08-31","last_updated":"2026-03-05","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.4","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-03-05","retired":false,"tags":null},"gpt-5.4-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.075,"input":0.75,"output":4.5},"deprecated":false,"extra":{"attachment":true,"description":"Compact GPT model for low-latency assistance and high-volume workloads","experimental":{"modes":{"fast":{"cost":{"cache_read":0.15,"input":1.5,"output":9},"provider":{"body":{"service_tier":"priority"}}}}},"family":"gpt-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.4-mini","knowledge":"2025-08-31","last_updated":"2026-03-17","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.4 mini","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-03-17","retired":false,"tags":null},"gpt-5.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.5,"input":5,"output":30},"deprecated":false,"extra":{"attachment":true,"description":"Frontier GPT model for professional reasoning, coding, and multimodal work","experimental":{"modes":{"fast":{"cost":{"cache_read":1.25,"input":12.5,"output":75},"provider":{"body":{"service_tier":"priority"}}}}},"family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.5","knowledge":"2025-12-01","last_updated":"2026-04-23","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.5","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-23","retired":false,"tags":null},"gpt-5.6-luna":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.1,"cache_write":1.25,"input":1,"output":6},"deprecated":false,"extra":{"attachment":true,"description":"Cost-efficient GPT-5.6 model for fast, high-volume workloads","family":"gpt-luna","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh","max"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.6-luna","knowledge":"2026-02-16","last_updated":"2026-07-09","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.6 Luna","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-07-09","retired":false,"tags":null},"gpt-5.6-sol":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.5,"cache_write":6.25,"input":5,"output":30},"deprecated":false,"extra":{"attachment":true,"description":"Frontier GPT-5.6 model for complex professional work, coding, and agentic workflows","family":"gpt-sol","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh","max"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.6-sol","knowledge":"2026-02-16","last_updated":"2026-07-09","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.6 Sol","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-07-09","retired":false,"tags":null},"gpt-5.6-terra":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.25,"cache_write":3.125,"input":2.5,"output":15},"deprecated":false,"extra":{"attachment":true,"description":"Balanced GPT-5.6 model for capable, cost-efficient everyday work","family":"gpt-terra","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh","max"]}],"structured_output":true,"temperature":false},"family":null,"id":"gpt-5.6-terra","knowledge":"2026-02-16","last_updated":"2026-07-09","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.6 Terra","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-07-09","retired":false,"tags":null},"grok-4.3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.2,"input":1.25,"output":2.5},"deprecated":false,"extra":{"attachment":true,"description":"Grok model for agentic tool use, reasoning, coding, and live assistance","family":"grok","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"grok-4.3","knowledge":null,"last_updated":"2026-05-01","lifecycle":null,"limits":{"context":1000000,"output":1000000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Grok 4.3","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-05-01","retired":false,"tags":null},"grok-4.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.5,"input":2,"output":6},"deprecated":false,"extra":{"attachment":true,"description":"xAI's latest Grok for chat, coding, agentic tools, and lower hallucination risk","family":"grok","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"grok-4.5","knowledge":null,"last_updated":"2026-07-08","lifecycle":null,"limits":{"context":1000000,"output":1000000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Grok 4.5","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-07-08","retired":false,"tags":null},"grok-build-0.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.2,"input":1,"output":2},"deprecated":false,"extra":{"attachment":true,"description":"Fast Grok coding model tuned for agentic engineering and iterative edits","family":"grok-build","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"grok-build-0.1","knowledge":null,"last_updated":"2026-04-16","lifecycle":null,"limits":{"context":256000,"output":256000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Grok Build 0.1","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-16","retired":false,"tags":null},"hy3-preview":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.051,"input":0.17,"output":0.566661},"deprecated":false,"extra":{"attachment":false,"description":"Tencent Hy reasoning model for coding, instruction following, and agent tasks","family":"Hy","open_weights":true,"reasoning_options":[{"type":"effort","values":["none","low","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"hy3-preview","knowledge":null,"last_updated":"2026-04-20","lifecycle":null,"limits":{"context":256000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Hy3 Preview","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-20","retired":false,"tags":null},"kimi-k2.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.1,"input":0.6,"output":3},"deprecated":false,"extra":{"attachment":true,"description":"Kimi multimodal agent model for visual understanding, coding, and planning","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k2.5","knowledge":"2025-01","last_updated":"2026-01","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K2.5","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-01","retired":false,"tags":null},"kimi-k2.6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.16,"input":0.95,"output":4},"deprecated":false,"extra":{"attachment":true,"description":"Kimi multimodal agent model for visual understanding, coding, and planning","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k2.6","knowledge":"2025-01","last_updated":"2026-04-21","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K2.6","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-21","retired":false,"tags":null},"kimi-k2.7-code":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.160835,"input":0.95,"output":3.9995},"deprecated":false,"extra":{"attachment":true,"description":"Coding-focused Kimi model, stronger on long-horizon repo work with less overthinking","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k2.7-code","knowledge":"2025-01","last_updated":"2026-06-12","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K2.7 Code","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"kimi-k2.7-code-highspeed":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.32167,"input":1.9,"output":7.999},"deprecated":false,"extra":{"attachment":true,"description":"Lower-latency Kimi Code variant for interactive edits and coding-agent loops","family":"kimi-k2","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k2.7-code-highspeed","knowledge":"2025-01","last_updated":"2026-06-12","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K2.7 Code Highspeed","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"kimi-k3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.3,"input":3,"output":15},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal Kimi model with 1M context and toggleable max-effort thinking for long-horizon agent work","family":"kimi-k3","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","high","max"]}],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k3","knowledge":null,"last_updated":"2026-07-27","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Kimi K3","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-07-16","retired":false,"tags":null},"minimax-m2.7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.06,"cache_write":0.375,"input":0.3,"output":1.2},"deprecated":false,"extra":{"attachment":false,"description":"MiniMax model for chat, coding, office work, and agentic tasks","family":"minimax","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"minimax-m2.7","knowledge":null,"last_updated":"2026-03-18","lifecycle":null,"limits":{"context":204800,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax M2.7","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-03-18","retired":false,"tags":null},"qwen3.6-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.0169,"cache_write":0.21125,"input":0.17,"output":1.01},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal reasoning model for visual analysis, planning, and tool use","family":"qwen3.6","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.6-flash","knowledge":"2025-04","last_updated":"2026-04-02","lifecycle":null,"limits":{"context":991000,"output":64000},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Qwen3.6 Flash","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-02","retired":false,"tags":null},"qwen3.6-max-preview":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.1268,"cache_write":1.585,"input":1.27,"output":7.61},"deprecated":false,"extra":{"attachment":false,"description":"Flagship model for demanding analysis, coding, and production agent workflows","family":"qwen3.6","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.6-max-preview","knowledge":"2025-04","last_updated":"2026-05-09","lifecycle":null,"limits":{"context":240000,"output":64000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3.6 Max Preview","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-05-09","retired":false,"tags":null},"qwen3.6-plus":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.0282,"cache_write":0.3525,"input":0.28,"output":1.69},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal reasoning model for visual analysis, planning, and tool use","family":"qwen3.6","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.6-plus","knowledge":"2025-04","last_updated":"2026-05-09","lifecycle":null,"limits":{"context":991000,"output":64000},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Qwen3.6 Plus","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-05-09","retired":false,"tags":null},"qwen3.7-max":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.169,"cache_write":2.1125,"input":1.69,"output":5.07},"deprecated":false,"extra":{"attachment":false,"description":"Qwen frontier model tuned for agent frameworks, coding assistants, and long tasks","family":"qwen","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"},{"max":262144,"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.7-max","knowledge":null,"last_updated":"2026-05-21","lifecycle":null,"limits":{"context":991000,"output":64000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3.7 Max","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-05-21","retired":false,"tags":null},"qwen3.7-plus":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.0564,"cache_write":0.3525,"input":0.282,"output":1.128},"deprecated":false,"extra":{"attachment":true,"description":"Multimodal Qwen workhorse for long-context agents, visual inputs, and coding","family":"qwen","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"},{"max":262144,"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.7-plus","knowledge":"2025-04","last_updated":"2026-06-02","lifecycle":null,"limits":{"context":991000,"output":64000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3.7 Plus","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-06-02","retired":false,"tags":null},"xiaomi-mimo-v2.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.088,"input":0.44,"output":2.2},"deprecated":false,"extra":{"attachment":true,"description":"Open MiMo model for multimodal coding agents and long-context automation","family":"mimo-v2.5","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"xiaomi-mimo-v2.5","knowledge":"2024-12","last_updated":"2026-05-13","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text","image","audio","video"],"output":["text"]},"model":null,"name":"Xiaomi MiMo-V2.5","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-22","retired":false,"tags":null},"xiaomi-mimo-v2.5-free":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0,"input":0,"output":0},"deprecated":false,"extra":{"attachment":true,"description":"Open MiMo model for multimodal coding agents and long-context automation","family":"mimo-v2.5","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"xiaomi-mimo-v2.5-free","knowledge":"2024-12","last_updated":"2026-05-13","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text","image","audio","video"],"output":["text"]},"model":null,"name":"Xiaomi MiMo-V2.5 (free)","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-22","retired":false,"tags":null},"xiaomi-mimo-v2.5-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.22,"input":1.1,"output":3.3},"deprecated":false,"extra":{"attachment":false,"description":"Stronger MiMo Pro tier for multimodal reasoning and coding-agent execution","family":"mimo-v2.5-pro","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"xiaomi-mimo-v2.5-pro","knowledge":"2024-12","last_updated":"2026-05-13","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Xiaomi MiMo-V2.5-Pro","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-22","retired":false,"tags":null},"xiaomi-mimo-v2.5-pro-free":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0,"input":0,"output":0},"deprecated":false,"extra":{"attachment":false,"description":"Stronger MiMo Pro tier for multimodal reasoning and coding-agent execution","family":"mimo-v2.5-pro","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"xiaomi-mimo-v2.5-pro-free","knowledge":"2024-12","last_updated":"2026-05-13","lifecycle":null,"limits":{"context":1048576,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Xiaomi MiMo-V2.5-Pro (free)","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-04-22","retired":false,"tags":null},"zai-glm-5.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0.183112,"input":0.845,"output":3.38},"deprecated":false,"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true},"family":null,"id":"zai-glm-5.1","knowledge":null,"last_updated":"2026-03-27","lifecycle":null,"limits":{"context":200000,"output":128000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5.1 (Z.ai)","pricing":null,"provider":"aihubmix","provider_model_id":null,"release_date":"2026-03-27","retired":false,"tags":null}},"name":"AIHubMix","pricing_defaults":null};
|
|
4
|
+
const provider = /* @__PURE__ */ createProviderCatalog(data);
|
|
5
|
+
export default provider;
|
|
@@ -0,0 +1,11 @@
|
|
|
1
|
+
import type {
|
|
2
|
+
Provider,
|
|
3
|
+
ProviderCatalog,
|
|
4
|
+
} from "../types.js";
|
|
5
|
+
|
|
6
|
+
export declare const data: Provider;
|
|
7
|
+
declare const provider: ProviderCatalog<
|
|
8
|
+
"aki_io",
|
|
9
|
+
"gemma4-26b" | "gpt-oss-120b" | "kimi-k2.7-code-1100b" | "minimax-m2.5-230b" | "mistral4-119b" | "qwen3.6-35b"
|
|
10
|
+
>;
|
|
11
|
+
export default provider;
|
|
@@ -0,0 +1,5 @@
|
|
|
1
|
+
import { createProviderCatalog } from "../provider.js";
|
|
2
|
+
|
|
3
|
+
export const data = {"alias_of":null,"base_url":"https://aki.io/v1","catalog_only":true,"config_schema":null,"doc":"https://aki.io/docs/","env":["AKI_IO_API_KEY"],"exclude_models":null,"extra":null,"id":"aki_io","models":{"gemma4-26b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.1,"output":0.5},"deprecated":false,"extra":{"attachment":false,"description":"Open Gemma instruction model for efficient chat and self-hosted deployments","family":"gemma","open_weights":true,"reasoning_options":[{"type":"effort","values":["none","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"gemma4-26b","knowledge":null,"last_updated":"2026-04-02","lifecycle":null,"limits":{"context":256000,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Gemma 4 26B A4B IT","pricing":null,"provider":"aki_io","provider_model_id":null,"release_date":"2026-04-02","retired":false,"tags":null},"gpt-oss-120b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.15,"output":0.55},"deprecated":false,"extra":{"attachment":false,"description":"Open GPT reasoning model for self-hosted agents and controllable deployments","family":"gpt-oss","open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"gpt-oss-120b","knowledge":null,"last_updated":"2025-08-05","lifecycle":null,"limits":{"context":128000,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT OSS 120B","pricing":null,"provider":"aki_io","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"kimi-k2.7-code-1100b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.86,"output":3},"deprecated":false,"extra":{"attachment":false,"description":"Coding-focused Kimi model, stronger on long-horizon repo work with less overthinking","family":"kimi-k2","open_weights":true,"reasoning_options":[],"structured_output":true,"temperature":false},"family":null,"id":"kimi-k2.7-code-1100b","knowledge":"2025-01","last_updated":"2026-06-12","lifecycle":null,"limits":{"context":262144,"output":81920},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Kimi K2.7 Code","pricing":null,"provider":"aki_io","provider_model_id":null,"release_date":"2026-06-12","retired":false,"tags":null},"minimax-m2.5-230b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.25,"output":1.2},"deprecated":false,"extra":{"attachment":false,"description":"Prior MiniMax coding model for agent workflows, office edits, and automation","family":"minimax","open_weights":true,"reasoning_options":[],"temperature":true},"family":null,"id":"minimax-m2.5-230b","knowledge":null,"last_updated":"2026-02-12","lifecycle":null,"limits":{"context":196608,"output":65536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"MiniMax-M2.5","pricing":null,"provider":"aki_io","provider_model_id":null,"release_date":"2026-02-12","retired":false,"tags":null},"mistral4-119b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.2,"output":0.6},"deprecated":false,"extra":{"attachment":false,"description":"Fast Mistral production model for chat, extraction, and cost-sensitive agents","family":"mistral-small","open_weights":true,"reasoning_options":[{"type":"effort","values":["none","high"]}],"temperature":true},"family":null,"id":"mistral4-119b","knowledge":"2025-06","last_updated":"2026-03-16","lifecycle":null,"limits":{"context":262144,"output":81920},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Mistral Small 4","pricing":null,"provider":"aki_io","provider_model_id":null,"release_date":"2026-03-16","retired":false,"tags":null},"qwen3.6-35b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.15,"output":0.5},"deprecated":false,"extra":{"attachment":false,"description":"Open multimodal Qwen MoE for local agents that need vision, audio, and code","family":"qwen","open_weights":true,"reasoning_options":[{"type":"effort","values":["none","high"]}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.6-35b","knowledge":null,"last_updated":"2026-04-17","lifecycle":null,"limits":{"context":256000,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen3.6 35B-A3B","pricing":null,"provider":"aki_io","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null}},"name":"AKI.IO","pricing_defaults":null};
|
|
4
|
+
const provider = /* @__PURE__ */ createProviderCatalog(data);
|
|
5
|
+
export default provider;
|
|
@@ -0,0 +1,11 @@
|
|
|
1
|
+
import type {
|
|
2
|
+
Provider,
|
|
3
|
+
ProviderCatalog,
|
|
4
|
+
} from "../types.js";
|
|
5
|
+
|
|
6
|
+
export declare const data: Provider;
|
|
7
|
+
declare const provider: ProviderCatalog<
|
|
8
|
+
"alibaba",
|
|
9
|
+
"qvq-max" | "qwen-flash" | "qwen-max" | "qwen-mt-plus" | "qwen-mt-turbo" | "qwen-omni-turbo" | "qwen-omni-turbo-realtime" | "qwen-plus" | "qwen-plus-character-ja" | "qwen-turbo" | "qwen-vl-max" | "qwen-vl-ocr" | "qwen-vl-plus" | "qwen2-5-14b-instruct" | "qwen2-5-32b-instruct" | "qwen2-5-72b-instruct" | "qwen2-5-7b-instruct" | "qwen2-5-omni-7b" | "qwen2-5-vl-72b-instruct" | "qwen2-5-vl-7b-instruct" | "qwen3-14b" | "qwen3-235b-a22b" | "qwen3-32b" | "qwen3-8b" | "qwen3-asr-flash" | "qwen3-coder-30b-a3b-instruct" | "qwen3-coder-480b-a35b-instruct" | "qwen3-coder-flash" | "qwen3-coder-plus" | "qwen3-livetranslate-flash-realtime" | "qwen3-max" | "qwen3-next-80b-a3b-instruct" | "qwen3-next-80b-a3b-thinking" | "qwen3-omni-flash" | "qwen3-omni-flash-realtime" | "qwen3-vl-235b-a22b" | "qwen3-vl-30b-a3b" | "qwen3-vl-plus" | "qwen3.5-122b-a10b" | "qwen3.5-27b" | "qwen3.5-35b-a3b" | "qwen3.5-397b-a17b" | "qwen3.5-plus" | "qwen3.6-27b" | "qwen3.6-35b-a3b" | "qwen3.6-flash" | "qwen3.6-max-preview" | "qwen3.6-plus" | "qwen3.7-max" | "qwen3.7-plus" | "qwen3.8-max" | "qwq-plus"
|
|
10
|
+
>;
|
|
11
|
+
export default provider;
|
|
@@ -0,0 +1,5 @@
|
|
|
1
|
+
import { createProviderCatalog } from "../provider.js";
|
|
2
|
+
|
|
3
|
+
export const data = {"alias_of":null,"base_url":"https://dashscope-intl.aliyuncs.com/compatible-mode/v1","config_schema":null,"doc":"https://www.alibabacloud.com/help/en/model-studio/models","env":["DASHSCOPE_API_KEY"],"exclude_models":null,"extra":null,"id":"alibaba","models":{"qvq-max":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":1.2,"output":4.8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qvq","open_weights":false,"reasoning_options":[],"temperature":true},"family":null,"id":"qvq-max","knowledge":"2024-04","last_updated":"2025-03-25","lifecycle":null,"limits":{"context":131072,"output":8192},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"QVQ Max","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-03-25","retired":false,"tags":null},"qwen-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.05,"output":0.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Efficient Qwen model for fast chat, extraction, and high-volume workloads","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen-flash","knowledge":"2024-04","last_updated":"2025-07-28","lifecycle":null,"limits":{"context":1000000,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen Flash","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-07-28","retired":false,"tags":null},"qwen-max":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":1.6,"output":6.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Flagship Qwen model for complex reasoning, coding, and agentic workflows","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen-max","knowledge":"2024-04","last_updated":"2025-01-25","lifecycle":null,"limits":{"context":32768,"output":8192},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen Max","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-04-03","retired":false,"tags":null},"qwen-mt-plus":{"aliases":[],"base_url":null,"capabilities":null,"cost":{"input":2.46,"output":7.37},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Translation model for multilingual conversion, localization, and cross-language workflows","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen-mt-plus","knowledge":"2024-04","last_updated":"2025-01","lifecycle":null,"limits":{"context":16384,"output":8192},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen-MT Plus","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-01","retired":false,"tags":null},"qwen-mt-turbo":{"aliases":[],"base_url":null,"capabilities":null,"cost":{"input":0.16,"output":0.49},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Translation model for multilingual conversion, localization, and cross-language workflows","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen-mt-turbo","knowledge":"2024-04","last_updated":"2025-01","lifecycle":null,"limits":{"context":16384,"output":8192},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen-MT Turbo","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-01","retired":false,"tags":null},"qwen-omni-turbo":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.07,"input_audio":4.44,"output":0.27,"output_audio":8.89},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen omni model for text, vision, audio, and multimodal agent tasks","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen-omni-turbo","knowledge":"2024-04","last_updated":"2025-03-26","lifecycle":null,"limits":{"context":32768,"output":2048},"modalities":{"input":["text","image","audio","video"],"output":["text","audio"]},"model":null,"name":"Qwen-Omni Turbo","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-01-19","retired":false,"tags":null},"qwen-omni-turbo-realtime":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.27,"input_audio":4.44,"output":1.07,"output_audio":8.89},"deprecated":false,"extra":{"attachment":false,"description":"Qwen omni model for text, vision, audio, and multimodal agent tasks","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen-omni-turbo-realtime","knowledge":"2024-04","last_updated":"2025-05-08","lifecycle":null,"limits":{"context":32768,"output":2048},"modalities":{"input":["text","image","audio"],"output":["text","audio"]},"model":null,"name":"Qwen-Omni Turbo Realtime","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-05-08","retired":false,"tags":null},"qwen-plus":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.4,"output":1.2,"reasoning":4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen-plus","knowledge":"2024-04","last_updated":"2025-09-11","lifecycle":null,"limits":{"context":1000000,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen Plus","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-01-25","retired":false,"tags":null},"qwen-plus-character-ja":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.5,"output":1.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen-plus-character-ja","knowledge":"2024-04","last_updated":"2024-01","lifecycle":null,"limits":{"context":8192,"output":512},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen Plus Character (Japanese)","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-01","retired":false,"tags":null},"qwen-turbo":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.05,"output":0.2,"reasoning":0.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Efficient Qwen model for fast chat, extraction, and high-volume workloads","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen-turbo","knowledge":"2024-04","last_updated":"2025-04-28","lifecycle":null,"limits":{"context":1000000,"output":16384},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen Turbo","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-11-01","retired":false,"tags":null},"qwen-vl-max":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.8,"output":3.2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen-vl-max","knowledge":"2024-04","last_updated":"2025-08-13","lifecycle":null,"limits":{"context":131072,"output":8192},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen-VL Max","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-04-08","retired":false,"tags":null},"qwen-vl-ocr":{"aliases":[],"base_url":null,"capabilities":null,"cost":{"input":0.72,"output":0.72},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"OCR model for extracting structured text from documents and screenshots","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen-vl-ocr","knowledge":"2024-04","last_updated":"2025-04-13","lifecycle":null,"limits":{"context":34096,"output":4096},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen-VL OCR","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-10-28","retired":false,"tags":null},"qwen-vl-plus":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.21,"output":0.63},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen-vl-plus","knowledge":"2024-04","last_updated":"2025-08-15","lifecycle":null,"limits":{"context":131072,"output":8192},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen-VL Plus","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-01-25","retired":false,"tags":null},"qwen2-5-14b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.35,"output":1.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen2-5-14b-instruct","knowledge":"2024-04","last_updated":"2024-09","lifecycle":null,"limits":{"context":131072,"output":8192},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen2.5 14B Instruct","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-09","retired":false,"tags":null},"qwen2-5-32b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.7,"output":2.8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen2-5-32b-instruct","knowledge":"2024-04","last_updated":"2024-09","lifecycle":null,"limits":{"context":131072,"output":8192},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen2.5 32B Instruct","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-09","retired":false,"tags":null},"qwen2-5-72b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":1.4,"output":5.6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen2-5-72b-instruct","knowledge":"2024-04","last_updated":"2024-09","lifecycle":null,"limits":{"context":131072,"output":8192},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen2.5 72B Instruct","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-09","retired":false,"tags":null},"qwen2-5-7b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.175,"output":0.7},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen2-5-7b-instruct","knowledge":"2024-04","last_updated":"2024-09","lifecycle":null,"limits":{"context":131072,"output":8192},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen2.5 7B Instruct","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-09","retired":false,"tags":null},"qwen2-5-omni-7b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.1,"input_audio":6.76,"output":0.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen omni model for text, vision, audio, and multimodal agent tasks","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen2-5-omni-7b","knowledge":"2024-04","last_updated":"2024-12","lifecycle":null,"limits":{"context":32768,"output":2048},"modalities":{"input":["text","image","audio","video"],"output":["text","audio"]},"model":null,"name":"Qwen2.5-Omni 7B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-12","retired":false,"tags":null},"qwen2-5-vl-72b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":2.8,"output":8.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen2-5-vl-72b-instruct","knowledge":"2024-04","last_updated":"2024-09","lifecycle":null,"limits":{"context":131072,"output":8192},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen2.5-VL 72B Instruct","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-09","retired":false,"tags":null},"qwen2-5-vl-7b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.35,"output":1.05},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen2-5-vl-7b-instruct","knowledge":"2024-04","last_updated":"2024-09","lifecycle":null,"limits":{"context":131072,"output":8192},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen2.5-VL 7B Instruct","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2024-09","retired":false,"tags":null},"qwen3-14b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.35,"output":1.4,"reasoning":4.2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3-14b","knowledge":"2025-04","last_updated":"2025-04","lifecycle":null,"limits":{"context":131072,"output":8192},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 14B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-04","retired":false,"tags":null},"qwen3-235b-a22b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.7,"output":2.8,"reasoning":8.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Large open Qwen MoE for multilingual reasoning, coding, and tool use","family":"qwen","open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3-235b-a22b","knowledge":"2025-04","last_updated":"2025-04","lifecycle":null,"limits":{"context":131072,"output":16384},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 235B-A22B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-04","retired":false,"tags":null},"qwen3-32b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.7,"output":2.8,"reasoning":8.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Dense open Qwen model for self-hosted chat, reasoning, and coding","family":"qwen","open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3-32b","knowledge":"2025-04","last_updated":"2025-04","lifecycle":null,"limits":{"context":131072,"output":16384},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 32B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-04","retired":false,"tags":null},"qwen3-8b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.18,"output":0.7,"reasoning":2.1},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3-8b","knowledge":"2025-04","last_updated":"2025-04","lifecycle":null,"limits":{"context":131072,"output":8192},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 8B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-04","retired":false,"tags":null},"qwen3-asr-flash":{"aliases":[],"base_url":null,"capabilities":null,"cost":{"input":0.035,"output":0.035},"deprecated":false,"execution":{"transcription":{"family":"openai_transcription","path":"/audio/transcriptions","supported":true,"wire_protocol":"openai_transcription"}},"extra":{"attachment":false,"description":"Speech transcription model for accurate audio-to-text and captioning workflows","family":"qwen","open_weights":false,"temperature":false},"family":null,"id":"qwen3-asr-flash","knowledge":"2024-04","last_updated":"2025-09-08","lifecycle":null,"limits":{"context":53248,"output":4096},"modalities":{"input":["audio"],"output":["text"]},"model":null,"name":"Qwen3-ASR Flash","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-09-08","retired":false,"tags":null},"qwen3-coder-30b-a3b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.45,"output":2.25},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Smaller Qwen coder for efficient local agents and repo-level fixes","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen3-coder-30b-a3b-instruct","knowledge":"2025-04","last_updated":"2025-04","lifecycle":null,"limits":{"context":262144,"output":65536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3-Coder 30B-A3B Instruct","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-04","retired":false,"tags":null},"qwen3-coder-480b-a35b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":1.5,"output":7.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open Qwen coding heavyweight for repository reasoning and agentic engineering","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen3-coder-480b-a35b-instruct","knowledge":"2025-04","last_updated":"2025-04","lifecycle":null,"limits":{"context":262144,"output":65536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3-Coder 480B-A35B Instruct","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-04","retired":false,"tags":null},"qwen3-coder-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.3,"output":1.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen coding model for software agents, repository edits, and code reasoning","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen3-coder-flash","knowledge":"2025-04","last_updated":"2025-07-28","lifecycle":null,"limits":{"context":1000000,"output":65536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Coder Flash","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-07-28","retired":false,"tags":null},"qwen3-coder-plus":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":1,"output":5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Hosted Qwen coder for software agents, repo edits, and long-context code","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen3-coder-plus","knowledge":"2025-04","last_updated":"2025-07-23","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Coder Plus","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-07-23","retired":false,"tags":null},"qwen3-livetranslate-flash-realtime":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":{"input":10,"input_audio":10,"output":10,"output_audio":38},"deprecated":false,"extra":{"attachment":false,"description":"Speech generation model for controllable voice, narration, and audio delivery","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen3-livetranslate-flash-realtime","knowledge":"2024-04","last_updated":"2025-09-22","lifecycle":null,"limits":{"context":53248,"output":4096},"modalities":{"input":["text","image","audio","video"],"output":["text","audio"]},"model":null,"name":"Qwen3-LiveTranslate Flash Realtime","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-09-22","retired":false,"tags":null},"qwen3-max":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":1.2,"output":6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Flagship Qwen3 model for coding agents, complex reasoning, and tool use","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen3-max","knowledge":"2025-04","last_updated":"2025-09-23","lifecycle":null,"limits":{"context":262144,"output":65536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Max","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-09-23","retired":false,"tags":null},"qwen3-next-80b-a3b-instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.5,"output":2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","open_weights":true,"temperature":true},"family":null,"id":"qwen3-next-80b-a3b-instruct","knowledge":"2025-04","last_updated":"2025-09","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3-Next 80B-A3B Instruct","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-09","retired":false,"tags":null},"qwen3-next-80b-a3b-thinking":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.5,"output":6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Efficient Qwen thinking model for local reasoning, math, and coding agents","family":"qwen","open_weights":true,"reasoning_options":[{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3-next-80b-a3b-thinking","knowledge":"2025-04","last_updated":"2025-09","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3-Next 80B-A3B (Thinking)","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-09","retired":false,"tags":null},"qwen3-omni-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.43,"input_audio":3.81,"output":1.66,"output_audio":15.11},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen omni model for text, vision, audio, and multimodal agent tasks","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"}],"temperature":true},"family":null,"id":"qwen3-omni-flash","knowledge":"2024-04","last_updated":"2025-09-15","lifecycle":null,"limits":{"context":65536,"output":16384},"modalities":{"input":["text","image","audio","video"],"output":["text","audio"]},"model":null,"name":"Qwen3-Omni Flash","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-09-15","retired":false,"tags":null},"qwen3-omni-flash-realtime":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"input":0.52,"input_audio":4.57,"output":1.99,"output_audio":18.13},"deprecated":false,"extra":{"attachment":false,"description":"Qwen omni model for text, vision, audio, and multimodal agent tasks","family":"qwen","open_weights":false,"temperature":true},"family":null,"id":"qwen3-omni-flash-realtime","knowledge":"2024-04","last_updated":"2025-09-15","lifecycle":null,"limits":{"context":65536,"output":16384},"modalities":{"input":["text","image","audio","video"],"output":["text","audio"]},"model":null,"name":"Qwen3-Omni Flash Realtime","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-09-15","retired":false,"tags":null},"qwen3-vl-235b-a22b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.7,"output":2.8,"reasoning":8.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":true,"reasoning_options":[{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3-vl-235b-a22b","knowledge":"2025-04","last_updated":"2025-04","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen3-VL 235B-A22B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-04","retired":false,"tags":null},"qwen3-vl-30b-a3b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.2,"output":0.8,"reasoning":2.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":true,"reasoning_options":[{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3-vl-30b-a3b","knowledge":"2025-04","last_updated":"2025-04","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen3-VL 30B-A3B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-04","retired":false,"tags":null},"qwen3-vl-plus":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.2,"output":1.6,"reasoning":4.8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3-vl-plus","knowledge":"2025-04","last_updated":"2025-09-23","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen3-VL Plus","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-09-23","retired":false,"tags":null},"qwen3.5-122b-a10b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.4,"output":3.2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.5-122b-a10b","knowledge":null,"last_updated":"2026-02-23","lifecycle":null,"limits":{"context":262144,"output":65536},"modalities":{"input":["text","image","video","audio"],"output":["text"]},"model":null,"name":"Qwen3.5 122B-A10B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-02-23","retired":false,"tags":null},"qwen3.5-27b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.3,"output":2.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.5-27b","knowledge":null,"last_updated":"2026-02-23","lifecycle":null,"limits":{"context":262144,"output":65536},"modalities":{"input":["text","image","video","audio"],"output":["text"]},"model":null,"name":"Qwen3.5 27B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-02-23","retired":false,"tags":null},"qwen3.5-35b-a3b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.25,"output":2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.5-35b-a3b","knowledge":null,"last_updated":"2026-02-23","lifecycle":null,"limits":{"context":262144,"output":65536},"modalities":{"input":["text","image","video","audio"],"output":["text"]},"model":null,"name":"Qwen3.5 35B-A3B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-02-23","retired":false,"tags":null},"qwen3.5-397b-a17b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.6,"output":3.6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Large open Qwen multimodal MoE for visual agents and long technical tasks","family":"qwen","open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.5-397b-a17b","knowledge":null,"last_updated":"2026-02-15","lifecycle":null,"limits":{"context":262144,"output":65536},"modalities":{"input":["text","image","video","audio"],"output":["text"]},"model":null,"name":"Qwen3.5 397B-A17B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-02-15","retired":false,"tags":null},"qwen3.5-plus":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.4,"output":2.4,"reasoning":2.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3.5-plus","knowledge":"2025-04","last_updated":"2026-02-16","lifecycle":null,"limits":{"context":1000000,"output":65536},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Qwen3.5 Plus","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-02-16","retired":false,"tags":null},"qwen3.6-27b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.6,"output":3.6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.6-27b","knowledge":null,"last_updated":"2026-04-22","lifecycle":null,"limits":{"context":262144,"output":65536},"modalities":{"input":["text","image","video","audio"],"output":["text"]},"model":null,"name":"Qwen3.6 27B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-04-22","retired":false,"tags":null},"qwen3.6-35b-a3b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.248,"output":1.485},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Open multimodal Qwen MoE for local agents that need vision, audio, and code","family":"qwen","open_weights":true,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.6-35b-a3b","knowledge":null,"last_updated":"2026-04-17","lifecycle":null,"limits":{"context":262144,"output":65536},"modalities":{"input":["text","image","video","audio"],"output":["text"]},"model":null,"name":"Qwen3.6 35B-A3B","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null},"qwen3.6-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_write":0.234375,"input":0.1875,"output":1.125},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen3.6","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.6-flash","knowledge":null,"last_updated":"2026-04-27","lifecycle":null,"limits":{"context":1000000,"output":65536},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Qwen3.6 Flash","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-04-27","retired":false,"tags":null},"qwen3.6-max-preview":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.13,"cache_write":1.625,"input":1.3,"output":7.8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Flagship Qwen model for complex reasoning, coding, and agentic workflows","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3.6-max-preview","knowledge":"2025-04","last_updated":"2026-04-20","lifecycle":null,"limits":{"context":262144,"output":65536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3.6 Max Preview","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-04-20","retired":false,"tags":null},"qwen3.6-plus":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.05,"cache_write":0.625,"input":0.5,"output":3},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Earlier Qwen multimodal workhorse for million-token agent and document tasks","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3.6-plus","knowledge":"2025-04","last_updated":"2026-04-02","lifecycle":null,"limits":{"context":1000000,"output":65536},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Qwen3.6 Plus","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-04-02","retired":false,"tags":null},"qwen3.7-max":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.5,"cache_write":3.125,"input":2.5,"output":7.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen frontier model tuned for agent frameworks, coding assistants, and long tasks","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3.7-max","knowledge":null,"last_updated":"2026-05-21","lifecycle":null,"limits":{"context":1000000,"output":65536},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3.7 Max","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-05-21","retired":false,"tags":null},"qwen3.7-plus":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.05,"cache_write":0.625,"input":0.5,"output":3},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Multimodal Qwen workhorse for long-context agents, visual inputs, and coding","family":"qwen","open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"budget_tokens"}],"temperature":true},"family":null,"id":"qwen3.7-plus","knowledge":"2025-04","last_updated":"2026-06-04","lifecycle":null,"limits":{"context":1000000,"output":65536},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Qwen3.7 Plus","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-06-02","retired":false,"tags":null},"qwen3.8-max":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.25,"cache_write":2.5,"input":2,"output":6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"2.4-trillion-parameter MoE flagship for coding, professional work, multimodal understanding, and long-horizon agentic workflows","family":"qwen","interleaved":{"field":"reasoning_content"},"open_weights":false,"reasoning_options":[{"type":"toggle"},{"type":"effort","values":["low","medium","xhigh"]},{"max":262144,"min":0,"type":"budget_tokens"}],"structured_output":true,"temperature":true},"family":null,"id":"qwen3.8-max","knowledge":null,"last_updated":"2026-08-03","lifecycle":null,"limits":{"context":1000000,"output":131072},"modalities":{"input":["text","image","video"],"output":["text"]},"model":null,"name":"Qwen3.8 Max","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2026-08-03","retired":false,"tags":null},"qwq-plus":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.8,"output":2.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen reasoning model for deliberate problem solving, math, and coding","family":"qwen","open_weights":false,"reasoning_options":[],"temperature":true},"family":null,"id":"qwq-plus","knowledge":"2024-04","last_updated":"2025-03-05","lifecycle":null,"limits":{"context":131072,"output":8192},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"QwQ Plus","pricing":null,"provider":"alibaba","provider_model_id":null,"release_date":"2025-03-05","retired":false,"tags":null}},"name":"Alibaba","pricing_defaults":null,"runtime":{"auth":{"env":["DASHSCOPE_API_KEY"],"headers":[],"type":"bearer"},"base_url":"https://dashscope-intl.aliyuncs.com/compatible-mode/v1","config_schema":null,"default_headers":{},"default_query":{},"doc_url":"https://www.alibabacloud.com/help/en/model-studio/models"}};
|
|
4
|
+
const provider = /* @__PURE__ */ createProviderCatalog(data);
|
|
5
|
+
export default provider;
|
|
@@ -0,0 +1,11 @@
|
|
|
1
|
+
import type {
|
|
2
|
+
Provider,
|
|
3
|
+
ProviderCatalog,
|
|
4
|
+
} from "../types.js";
|
|
5
|
+
|
|
6
|
+
export declare const data: Provider;
|
|
7
|
+
declare const provider: ProviderCatalog<
|
|
8
|
+
"alibaba_cn",
|
|
9
|
+
"MiniMax-M2.5" | "MiniMax/MiniMax-M2.7" | "deepseek-r1" | "deepseek-r1-0528" | "deepseek-r1-distill-llama-70b" | "deepseek-r1-distill-llama-8b" | "deepseek-r1-distill-qwen-1-5b" | "deepseek-r1-distill-qwen-14b" | "deepseek-r1-distill-qwen-32b" | "deepseek-r1-distill-qwen-7b" | "deepseek-v3" | "deepseek-v3-1" | "deepseek-v3-2-exp" | "deepseek-v4-flash" | "deepseek-v4-pro" | "glm-5" | "glm-5.1" | "glm-5.2" | "kimi-k2-thinking" | "kimi-k2.5" | "kimi-k2.6" | "kimi/kimi-k2.5" | "moonshot-kimi-k2-instruct" | "qvq-max" | "qwen-deep-research" | "qwen-doc-turbo" | "qwen-flash" | "qwen-long" | "qwen-math-plus" | "qwen-math-turbo" | "qwen-max" | "qwen-mt-plus" | "qwen-mt-turbo" | "qwen-omni-turbo" | "qwen-omni-turbo-realtime" | "qwen-plus" | "qwen-plus-character" | "qwen-turbo" | "qwen-vl-max" | "qwen-vl-ocr" | "qwen-vl-plus" | "qwen2-5-14b-instruct" | "qwen2-5-32b-instruct" | "qwen2-5-72b-instruct" | "qwen2-5-7b-instruct" | "qwen2-5-coder-32b-instruct" | "qwen2-5-coder-7b-instruct" | "qwen2-5-math-72b-instruct" | "qwen2-5-math-7b-instruct" | "qwen2-5-omni-7b" | "qwen2-5-vl-72b-instruct" | "qwen2-5-vl-7b-instruct" | "qwen3-14b" | "qwen3-235b-a22b" | "qwen3-32b" | "qwen3-8b" | "qwen3-asr-flash" | "qwen3-coder-30b-a3b-instruct" | "qwen3-coder-480b-a35b-instruct" | "qwen3-coder-flash" | "qwen3-coder-plus" | "qwen3-max" | "qwen3-next-80b-a3b-instruct" | "qwen3-next-80b-a3b-thinking" | "qwen3-omni-flash" | "qwen3-omni-flash-realtime" | "qwen3-vl-235b-a22b" | "qwen3-vl-30b-a3b" | "qwen3-vl-plus" | "qwen3.5-397b-a17b" | "qwen3.5-flash" | "qwen3.5-plus" | "qwen3.6-flash" | "qwen3.6-max-preview" | "qwen3.6-plus" | "qwen3.7-flash" | "qwen3.7-max" | "qwen3.7-plus" | "qwen3.8-max" | "qwq-32b" | "qwq-plus" | "siliconflow/deepseek-r1-0528" | "siliconflow/deepseek-v3-0324" | "siliconflow/deepseek-v3.1-terminus" | "siliconflow/deepseek-v3.2" | "tongyi-intent-detect-v3"
|
|
10
|
+
>;
|
|
11
|
+
export default provider;
|