@agentjido/llmdb 2026.8.2 → 2026.8.3
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/dist/full.js +177 -169
- package/dist/generated/manifest.d.ts +1 -1
- package/dist/generated/manifest.js +1 -1
- package/dist/generated/provider-loaders.js +8 -0
- package/dist/providers/abacus.d.ts +1 -1
- package/dist/providers/abacus.js +1 -1
- package/dist/providers/aiand.d.ts +1 -1
- package/dist/providers/aiand.js +1 -1
- package/dist/providers/aihubmix.d.ts +1 -1
- package/dist/providers/aihubmix.js +1 -1
- package/dist/providers/alibaba.d.ts +1 -1
- package/dist/providers/alibaba.js +1 -1
- package/dist/providers/alibaba_cn.js +1 -1
- package/dist/providers/alibaba_token_plan.d.ts +1 -1
- package/dist/providers/alibaba_token_plan.js +1 -1
- package/dist/providers/alibaba_token_plan_cn.d.ts +1 -1
- package/dist/providers/alibaba_token_plan_cn.js +1 -1
- package/dist/providers/amazon_bedrock.d.ts +1 -1
- package/dist/providers/amazon_bedrock.js +1 -1
- package/dist/providers/ambient.js +1 -1
- package/dist/providers/amd.d.ts +11 -0
- package/dist/providers/amd.js +5 -0
- package/dist/providers/anthropic.js +1 -1
- package/dist/providers/azure.d.ts +1 -1
- package/dist/providers/azure.js +1 -1
- package/dist/providers/azure_cognitive_services.d.ts +1 -1
- package/dist/providers/azure_cognitive_services.js +1 -1
- package/dist/providers/baseten.d.ts +1 -1
- package/dist/providers/baseten.js +1 -1
- package/dist/providers/berget.js +1 -1
- package/dist/providers/blueclaw.js +1 -1
- package/dist/providers/chutes.d.ts +1 -1
- package/dist/providers/chutes.js +1 -1
- package/dist/providers/clarifai.js +1 -1
- package/dist/providers/cloudferro_sherlock.js +1 -1
- package/dist/providers/cloudflare_ai_gateway.d.ts +1 -1
- package/dist/providers/cloudflare_ai_gateway.js +1 -1
- package/dist/providers/cloudflare_workers_ai.d.ts +1 -1
- package/dist/providers/cloudflare_workers_ai.js +1 -1
- package/dist/providers/coralbricks.d.ts +11 -0
- package/dist/providers/coralbricks.js +5 -0
- package/dist/providers/cortecs.d.ts +1 -1
- package/dist/providers/cortecs.js +1 -1
- package/dist/providers/crof.js +1 -1
- package/dist/providers/crossmodel.d.ts +1 -1
- package/dist/providers/crossmodel.js +1 -1
- package/dist/providers/crusoe.d.ts +11 -0
- package/dist/providers/crusoe.js +5 -0
- package/dist/providers/daoxe.js +1 -1
- package/dist/providers/deepinfra.d.ts +1 -1
- package/dist/providers/deepinfra.js +1 -1
- package/dist/providers/deepseek.js +1 -1
- package/dist/providers/digitalocean.d.ts +1 -1
- package/dist/providers/digitalocean.js +1 -1
- package/dist/providers/edenai.d.ts +11 -0
- package/dist/providers/edenai.js +5 -0
- package/dist/providers/empiriolabs.d.ts +1 -1
- package/dist/providers/empiriolabs.js +1 -1
- package/dist/providers/evroc.d.ts +1 -1
- package/dist/providers/evroc.js +1 -1
- package/dist/providers/fastrouter.js +1 -1
- package/dist/providers/fireworks_ai.d.ts +1 -1
- package/dist/providers/fireworks_ai.js +1 -1
- package/dist/providers/friendli.d.ts +1 -1
- package/dist/providers/friendli.js +1 -1
- package/dist/providers/github_copilot.d.ts +1 -1
- package/dist/providers/github_copilot.js +1 -1
- package/dist/providers/gmicloud.js +1 -1
- package/dist/providers/google.d.ts +1 -1
- package/dist/providers/google.js +1 -1
- package/dist/providers/google_vertex.d.ts +1 -1
- package/dist/providers/google_vertex.js +1 -1
- package/dist/providers/greenpt.js +1 -1
- package/dist/providers/groq.js +1 -1
- package/dist/providers/hetzner.d.ts +1 -1
- package/dist/providers/hetzner.js +1 -1
- package/dist/providers/huggingface.d.ts +1 -1
- package/dist/providers/huggingface.js +1 -1
- package/dist/providers/hyper.d.ts +1 -1
- package/dist/providers/hyper.js +1 -1
- package/dist/providers/impossibl.js +1 -1
- package/dist/providers/inceptron.d.ts +1 -1
- package/dist/providers/inceptron.js +1 -1
- package/dist/providers/inferx.d.ts +1 -1
- package/dist/providers/inferx.js +1 -1
- package/dist/providers/infomaniak.js +1 -1
- package/dist/providers/io_net.js +1 -1
- package/dist/providers/kenari.js +1 -1
- package/dist/providers/kilo.d.ts +1 -1
- package/dist/providers/kilo.js +1 -1
- package/dist/providers/llmgateway.d.ts +1 -1
- package/dist/providers/llmgateway.js +1 -1
- package/dist/providers/llmtr.d.ts +1 -1
- package/dist/providers/llmtr.js +1 -1
- package/dist/providers/lmstudio.js +1 -1
- package/dist/providers/meganova.js +1 -1
- package/dist/providers/merge_gateway.d.ts +1 -1
- package/dist/providers/merge_gateway.js +1 -1
- package/dist/providers/meta.d.ts +1 -1
- package/dist/providers/meta.js +1 -1
- package/dist/providers/modal.js +1 -1
- package/dist/providers/modelscope.js +1 -1
- package/dist/providers/nano_gpt.d.ts +1 -1
- package/dist/providers/nano_gpt.js +1 -1
- package/dist/providers/nearai.js +1 -1
- package/dist/providers/nebius.d.ts +1 -1
- package/dist/providers/nebius.js +1 -1
- package/dist/providers/neon.d.ts +1 -1
- package/dist/providers/neon.js +1 -1
- package/dist/providers/neuralwatt.d.ts +1 -1
- package/dist/providers/neuralwatt.js +1 -1
- package/dist/providers/novita_ai.js +1 -1
- package/dist/providers/nvidia.d.ts +1 -1
- package/dist/providers/nvidia.js +1 -1
- package/dist/providers/ofox.d.ts +1 -1
- package/dist/providers/ofox.js +1 -1
- package/dist/providers/opencode.d.ts +1 -1
- package/dist/providers/opencode.js +1 -1
- package/dist/providers/opencode_go.d.ts +1 -1
- package/dist/providers/opencode_go.js +1 -1
- package/dist/providers/openrouter.d.ts +1 -1
- package/dist/providers/openrouter.js +1 -1
- package/dist/providers/perplexity_agent.d.ts +1 -1
- package/dist/providers/perplexity_agent.js +1 -1
- package/dist/providers/pioneer.d.ts +1 -1
- package/dist/providers/pioneer.js +1 -1
- package/dist/providers/privatemode_ai.d.ts +1 -1
- package/dist/providers/privatemode_ai.js +1 -1
- package/dist/providers/regolo_ai.d.ts +1 -1
- package/dist/providers/regolo_ai.js +1 -1
- package/dist/providers/requesty.d.ts +1 -1
- package/dist/providers/requesty.js +1 -1
- package/dist/providers/runinfra.d.ts +11 -0
- package/dist/providers/runinfra.js +5 -0
- package/dist/providers/salad_cloud.d.ts +11 -0
- package/dist/providers/salad_cloud.js +5 -0
- package/dist/providers/scnet_token_plan.d.ts +11 -0
- package/dist/providers/scnet_token_plan.js +5 -0
- package/dist/providers/siliconflow.js +1 -1
- package/dist/providers/siliconflow_cn.js +1 -1
- package/dist/providers/snowflake_cortex.d.ts +1 -1
- package/dist/providers/snowflake_cortex.js +1 -1
- package/dist/providers/stackit.js +1 -1
- package/dist/providers/submodel.js +1 -1
- package/dist/providers/synthetic.js +1 -1
- package/dist/providers/tensorx.js +1 -1
- package/dist/providers/thinkingmachines.js +1 -1
- package/dist/providers/tinfoil.d.ts +1 -1
- package/dist/providers/tinfoil.js +1 -1
- package/dist/providers/togetherai.d.ts +1 -1
- package/dist/providers/togetherai.js +1 -1
- package/dist/providers/umans_ai.d.ts +1 -1
- package/dist/providers/umans_ai.js +1 -1
- package/dist/providers/umans_ai_coding_plan.d.ts +1 -1
- package/dist/providers/umans_ai_coding_plan.js +1 -1
- package/dist/providers/upstage.d.ts +1 -1
- package/dist/providers/upstage.js +1 -1
- package/dist/providers/venice.d.ts +1 -1
- package/dist/providers/venice.js +1 -1
- package/dist/providers/vercel.d.ts +1 -1
- package/dist/providers/vercel.js +1 -1
- package/dist/providers/vivgrid.d.ts +1 -1
- package/dist/providers/vivgrid.js +1 -1
- package/dist/providers/vultr.js +1 -1
- package/dist/providers/wandb.d.ts +1 -1
- package/dist/providers/wandb.js +1 -1
- package/dist/providers/watsonx.d.ts +11 -0
- package/dist/providers/watsonx.js +5 -0
- package/dist/providers/xai.d.ts +1 -1
- package/dist/providers/xai.js +1 -1
- package/dist/providers/zai_coding_plan.d.ts +1 -1
- package/dist/providers/zai_coding_plan.js +1 -1
- package/dist/providers/zeldoc.d.ts +1 -1
- package/dist/providers/zeldoc.js +1 -1
- package/dist/providers/zenmux.d.ts +1 -1
- package/dist/providers/zenmux.js +1 -1
- package/dist/providers/zhipuai_coding_plan.d.ts +1 -1
- package/dist/providers/zhipuai_coding_plan.js +1 -1
- package/dist/snapshot.js +352 -336
- package/package.json +2 -2
package/dist/providers/nearai.js
CHANGED
|
@@ -1,5 +1,5 @@
|
|
|
1
1
|
import { createProviderCatalog } from "../provider.js";
|
|
2
2
|
|
|
3
|
-
export const data = {"alias_of":null,"base_url":"https://cloud-api.near.ai/v1","config_schema":null,"doc":"https://docs.near.ai/","env":["NEARAI_API_KEY"],"exclude_models":null,"extra":null,"id":"nearai","models":{"Qwen/Qwen3-30B-A3B-Instruct-2507":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.15,"output":0.55},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","llmfit":{"architecture":"qwen3_moe","context_length":262144,"discovered":true,"gguf_sources":[{"provider":"unsloth","repo":"unsloth/Qwen3-30B-A3B-Instruct-2507-GGUF"},{"provider":"mradermacher","repo":"mradermacher/Qwen3-30B-A3B-Instruct-2507-GGUF"}],"hf_downloads":1902844,"hf_likes":822,"matched_hugging_face_id":"Qwen/Qwen3-30B-A3B-Instruct-2507","memory":{"min_ram_gb":17.1,"min_vram_gb":15.6,"recommended_ram_gb":28.4},"model_id":"Qwen/Qwen3-30B-A3B-Instruct-2507","moe":{"active_experts":8,"active_parameters":3339450907,"is_moe":true,"num_experts":128},"parameter_count":"30.5B","parameters_raw":30532122624,"pipeline_tag":"text-generation","provider":"Alibaba","quantization":"Q4_K_M","release_date":"2025-07-28","source":"llmfit","use_case":"Instruction following, chat"},"open_weights":true,"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"Qwen/Qwen3-30B-A3B-Instruct-2507","knowledge":null,"last_updated":"2025-07-29","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 30B-A3B Instruct 2507","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-07-29","retired":false,"tags":null},"Qwen/Qwen3-Embedding-0.6B":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":{"input":0.01,"output":0},"deprecated":false,"extra":{"attachment":false,"description":"Embedding model for semantic search, retrieval, clustering, and ranking pipelines","family":"text-embedding","llmfit":{"architecture":"qwen3","context_length":32768,"discovered":true,"gguf_sources":[{"provider":"mradermacher","repo":"mradermacher/Qwen3-Embedding-0.6B-GGUF"}],"hf_downloads":9852592,"hf_likes":0,"matched_hugging_face_id":"Qwen/Qwen3-Embedding-0.6B","memory":{"min_ram_gb":1.0,"min_vram_gb":0.5,"recommended_ram_gb":2.0},"model_id":"Qwen/Qwen3-Embedding-0.6B","parameter_count":"596M","parameters_raw":595776512,"pipeline_tag":"feature-extraction","provider":"Alibaba","quantization":"Q4_K_M","source":"llmfit","use_case":"Text embeddings for RAG"},"open_weights":true,"temperature":false},"family":null,"id":"Qwen/Qwen3-Embedding-0.6B","knowledge":null,"last_updated":"2025-06-03","lifecycle":null,"limits":{"context":40960,"output":1024},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Embedding 0.6B","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-06-03","retired":false,"tags":null},"Qwen/Qwen3-Reranker-0.6B":{"aliases":[],"base_url":null,"capabilities":{"chat":false,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":true,"streaming":{"text":false,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":{"input":0.01,"output":0.01},"deprecated":false,"extra":{"attachment":false,"description":"Reranking model for improving retrieval quality in search and recommendation systems","family":"qwen","open_weights":true,"temperature":false},"family":null,"id":"Qwen/Qwen3-Reranker-0.6B","knowledge":null,"last_updated":"2025-06-03","lifecycle":null,"limits":{"context":40960,"output":1024},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Reranker 0.6B","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-06-03","retired":false,"tags":null},"Qwen/Qwen3-VL-30B-A3B-Instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.15,"output":0.55},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","llmfit":{"architecture":"qwen3_vl_moe","context_length":262144,"discovered":true,"gguf_sources":[],"hf_downloads":815503,"hf_likes":0,"matched_hugging_face_id":"Qwen/Qwen3-VL-30B-A3B-Instruct","memory":{"min_ram_gb":17.4,"min_vram_gb":15.9,"recommended_ram_gb":28.9},"model_id":"Qwen/Qwen3-VL-30B-A3B-Instruct","moe":{"active_experts":8,"active_parameters":3398363717,"is_moe":true,"num_experts":128},"parameter_count":"31.1B","parameters_raw":31070754032,"pipeline_tag":"image-text-to-text","provider":"Alibaba","quantization":"Q4_K_M","source":"llmfit","use_case":"Multimodal, vision and text"},"open_weights":true,"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"Qwen/Qwen3-VL-30B-A3B-Instruct","knowledge":null,"last_updated":"2025-09-23","lifecycle":null,"limits":{"context":256000,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen3-VL 30B-A3B Instruct","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-09-23","retired":false,"tags":null},"Qwen/Qwen3.5-122B-A10B":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.4,"output":3.2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","llmfit":{"architecture":"qwen3_5_moe","context_length":262144,"discovered":false,"gguf_sources":[{"provider":"unsloth","repo":"unsloth/Qwen3.5-122B-A10B-GGUF"},{"provider":"mradermacher","repo":"mradermacher/Qwen3.5-122B-A10B-GGUF"}],"hf_downloads":2114418,"hf_likes":603,"matched_hugging_face_id":"Qwen/Qwen3.5-122B-A10B","memory":{"min_ram_gb":69.9,"min_vram_gb":64.1,"recommended_ram_gb":116.5},"model_id":"Qwen/Qwen3.5-122B-A10B","moe":{"active_experts":8,"active_parameters":10000000000,"is_moe":true,"num_experts":256},"parameter_count":"125.1B","parameters_raw":125086497008,"pipeline_tag":"image-text-to-text","provider":"Alibaba","quantization":"Q4_K_M","release_date":"2026-02-24","source":"llmfit","use_case":"Multimodal, vision and text"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"Qwen/Qwen3.5-122B-A10B","knowledge":null,"last_updated":"2026-02-23","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3.5 122B-A10B","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-02-23","retired":false,"tags":null},"Qwen/Qwen3.6-35B-A3B-FP8":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.056,"input":0.17,"output":1.1},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Open multimodal Qwen MoE for local agents that need vision, audio, and code","family":"qwen","llmfit":{"architecture":"qwen3_5_moe","context_length":262144,"discovered":true,"gguf_sources":[],"hf_downloads":8818827,"hf_likes":0,"matched_hugging_face_id":"Qwen/Qwen3.6-35B-A3B-FP8","memory":{"min_ram_gb":20.1,"min_vram_gb":18.4,"recommended_ram_gb":33.5},"model_id":"Qwen/Qwen3.6-35B-A3B-FP8","moe":{"active_experts":8,"active_parameters":2865078437,"is_moe":true,"num_experts":256},"parameter_count":"36.0B","parameters_raw":35953925552,"pipeline_tag":"image-text-to-text","provider":"Alibaba","quantization":"Q4_K_M","source":"llmfit","use_case":"Multimodal, vision and text"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"Qwen/Qwen3.6-35B-A3B-FP8","knowledge":null,"last_updated":"2026-04-17","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen 3.6 35B A3B FP8","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null},"anthropic/claude-haiku-4-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.1,"cache_write":1.25,"input":1,"output":5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Fast Claude lane for lightweight agents, office tasks, and responsive chat","family":"claude-haiku","open_weights":false,"reasoning_options":[{"type":"toggle"},{"min":1024,"type":"budget_tokens"}],"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"anthropic/claude-haiku-4-5","knowledge":"2025-02-28","last_updated":"2025-10-15","lifecycle":null,"limits":{"context":200000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Haiku 4.5 (latest)","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-10-15","retired":false,"tags":null},"anthropic/claude-opus-4-6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.5,"cache_write":6.25,"input":5,"output":25},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"High-end Claude for difficult coding, planning, and slower expert reasoning","family":"claude-opus","open_weights":false,"reasoning_options":[{"type":"toggle"},{"min":1024,"type":"budget_tokens"}],"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"anthropic/claude-opus-4-6","knowledge":"2025-05-31","last_updated":"2026-03-13","lifecycle":null,"limits":{"context":200000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.6","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-02-05","retired":false,"tags":null},"anthropic/claude-opus-4-7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.5,"cache_write":6.25,"input":5,"output":25},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Stronger Opus tier for advanced software work and high-stakes reasoning","family":"claude-opus","open_weights":false,"reasoning_options":[{"type":"toggle"}],"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"anthropic/claude-opus-4-7","knowledge":"2026-01-31","last_updated":"2026-04-16","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.7","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-04-16","retired":false,"tags":null},"anthropic/claude-sonnet-4-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.3,"cache_write":3.75,"input":3,"output":15.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Balanced Claude model for coding, analysis, agent workflows, and cost control","family":"claude-sonnet","open_weights":false,"reasoning_options":[{"type":"toggle"},{"min":1024,"type":"budget_tokens"}],"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"anthropic/claude-sonnet-4-5","knowledge":"2025-07-31","last_updated":"2025-09-29","lifecycle":null,"limits":{"context":200000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Sonnet 4.5 (latest)","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-09-29","retired":false,"tags":null},"anthropic/claude-sonnet-4-6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.3,"cache_write":3.75,"input":3,"output":15},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Claude workhorse for coding agents, careful analysis, and production cost control","family":"claude-sonnet","open_weights":false,"reasoning_options":[{"type":"toggle"},{"min":1024,"type":"budget_tokens"}],"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"anthropic/claude-sonnet-4-6","knowledge":"2025-08-31","last_updated":"2026-03-13","lifecycle":null,"limits":{"context":1000000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Sonnet 4.6","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-02-17","retired":false,"tags":null},"black-forest-labs/FLUX.2-klein-4B":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":{"input":1,"output":1},"deprecated":false,"extra":{"attachment":false,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"flux","open_weights":true,"temperature":true},"family":null,"id":"black-forest-labs/FLUX.2-klein-4B","knowledge":null,"last_updated":"2026-01-14","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text","image"],"output":["image"]},"model":null,"name":"FLUX.2 Klein 4B","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-01-14","retired":false,"tags":null},"google/gemini-2.5-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.03,"input":0.3,"input_audio":1,"output":2.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Fast Gemini workhorse for multimodal apps where latency and price matter","family":"gemini-flash","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"google/gemini-2.5-flash","knowledge":"2025-01","last_updated":"2025-06-17","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","audio","video","pdf"],"output":["text"]},"model":null,"name":"Gemini 2.5 Flash","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-06-17","retired":false,"tags":null},"google/gemini-2.5-flash-lite":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.01,"input":0.1,"input_audio":0.3,"output":0.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Lean Gemini 2.5 lane for cheap multimodal traffic and quick agents","family":"gemini-flash-lite","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"google/gemini-2.5-flash-lite","knowledge":"2025-01","last_updated":"2025-06-17","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","audio","video","pdf"],"output":["text"]},"model":null,"name":"Gemini 2.5 Flash-Lite","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-06-17","retired":false,"tags":null},"google/gemini-2.5-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.125,"input":1.25,"output":10},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Google's proven reasoning model for coding, math, and multimodal analysis","family":"gemini-pro","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"google/gemini-2.5-pro","knowledge":"2025-01","last_updated":"2025-06-17","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","audio","video","pdf"],"output":["text"]},"model":null,"name":"Gemini 2.5 Pro","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-06-17","retired":false,"tags":null},"google/gemini-3-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0,"input":1.25,"output":15},"deprecated":false,"extra":{"attachment":true,"description":"Preview Gemini flagship for complex reasoning, coding, and rich multimodal prompts","family":"gemini-pro","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"google/gemini-3-pro","knowledge":"2025-01","last_updated":"2025-11-18","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","video","audio","pdf"],"output":["text"]},"model":null,"name":"Gemini 3 Pro Preview","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-11-18","retired":false,"tags":null},"google/gemini-3.1-flash-lite":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.025,"input":0.25,"input_audio":0.5,"output":1.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Low-latency Gemini model for high-volume multimodal and agent workloads","family":"gemini-flash-lite","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"google/gemini-3.1-flash-lite","knowledge":"2025-01","last_updated":"2026-05-07","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","video","audio","pdf"],"output":["text"]},"model":null,"name":"Gemini 3.1 Flash Lite","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-05-07","retired":false,"tags":null},"google/gemini-3.5-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.15,"input":1.5,"input_audio":1.5,"output":9},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Fast Gemini model balancing multimodal reasoning, tool use, and cost","family":"gemini-flash","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"google/gemini-3.5-flash","knowledge":"2025-01","last_updated":"2026-05-19","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","video","audio","pdf"],"output":["text"]},"model":null,"name":"Gemini 3.5 Flash","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-05-19","retired":false,"tags":null},"google/gemma-4-31B-it":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.026,"input":0.13,"output":0.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Largest Gemma 4 instruction model for open, self-hosted chat and reasoning","family":"gemma","llmfit":{"architecture":"gemma4","context_length":262144,"discovered":false,"gguf_sources":[{"provider":"unsloth","repo":"unsloth/gemma-4-31B-it-GGUF"}],"hf_downloads":11886065,"hf_likes":3433,"matched_hugging_face_id":"google/gemma-4-31B-it","memory":{"min_ram_gb":18.3,"min_vram_gb":16.7,"recommended_ram_gb":30.4},"model_id":"google/gemma-4-31B-it","parameter_count":"32.7B","parameters_raw":32682372656,"pipeline_tag":"image-text-to-text","provider":"Google","quantization":"Q4_K_M","release_date":"2026-03-11","source":"llmfit","use_case":"Multimodal, vision and text"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"google/gemma-4-31B-it","knowledge":null,"last_updated":"2026-04-02","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Gemma 4 31B IT","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-04-02","retired":false,"tags":null},"openai/gpt-4.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.5,"input":2,"output":8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Long-lived GPT workhorse for coding, instruction following, and production apps","family":"gpt","open_weights":false,"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-4.1","knowledge":"2024-04","last_updated":"2025-04-14","lifecycle":null,"limits":{"context":1047576,"output":32768},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-4.1","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-04-14","retired":false,"tags":null},"openai/gpt-4.1-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.1,"input":0.4,"output":1.6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Affordable GPT-4.1 lane for fast coding help and structured extraction","family":"gpt-mini","open_weights":false,"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-4.1-mini","knowledge":"2024-04","last_updated":"2025-04-14","lifecycle":null,"limits":{"context":1047576,"output":32768},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-4.1 mini","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-04-14","retired":false,"tags":null},"openai/gpt-4.1-nano":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.025,"input":0.1,"output":0.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Tiny GPT-4.1 option for classification, routing, and very high-volume tasks","family":"gpt-nano","open_weights":false,"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-4.1-nano","knowledge":"2024-04","last_updated":"2025-04-14","lifecycle":null,"limits":{"context":1047576,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-4.1 nano","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-04-14","retired":false,"tags":null},"openai/gpt-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.125,"input":1.25,"output":10},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Original GPT-5 workhorse for reasoning, coding, writing, and tool workflows","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5","knowledge":"2024-09-30","last_updated":"2025-08-07","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-08-07","retired":false,"tags":null},"openai/gpt-5-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.025,"input":0.25,"output":2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Small GPT-5 for responsive agents, coding help, and everyday automation","family":"gpt-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5-mini","knowledge":"2024-05-30","last_updated":"2025-08-07","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5 Mini","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-08-07","retired":false,"tags":null},"openai/gpt-5-nano":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.005,"input":0.05,"output":0.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Tiny GPT-5 lane for routing, extraction, classification, and bulk jobs","family":"gpt-nano","open_weights":false,"reasoning_options":[{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5-nano","knowledge":"2024-05-30","last_updated":"2025-08-07","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5 Nano","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-08-07","retired":false,"tags":null},"openai/gpt-5.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.125,"input":1.25,"output":10},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Sharper GPT-5 generation for coding, product work, and tool-assisted tasks","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5.1","knowledge":"2024-09-30","last_updated":"2025-11-13","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.1","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-11-13","retired":false,"tags":null},"openai/gpt-5.2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.18,"input":1.8,"output":15.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Reliable GPT generation for broad coding, writing, and tool-assisted product work","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5.2","knowledge":"2025-08-31","last_updated":"2025-12-11","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.2","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-12-11","retired":false,"tags":null},"openai/gpt-5.4":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.25,"input":2.5,"output":15},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Agent-ready GPT for coding and computer-use workflows at a lower cost","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5.4","knowledge":"2025-08-31","last_updated":"2026-03-05","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.4","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-03-05","retired":false,"tags":null},"openai/gpt-5.4-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.075,"input":0.75,"output":4.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Strong small GPT for coding subagents, quick tool use, and high-volume work","family":"gpt-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5.4-mini","knowledge":"2025-08-31","last_updated":"2026-03-17","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.4 mini","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-03-17","retired":false,"tags":null},"openai/gpt-5.4-nano":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.02,"input":0.2,"output":1.25},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Cheapest GPT-5.4 lane for simple routing, extraction, and bulk automation","family":"gpt-nano","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5.4-nano","knowledge":"2025-08-31","last_updated":"2026-03-17","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.4 nano","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-03-17","retired":false,"tags":null},"openai/gpt-5.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.5,"input":5,"output":30},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Default frontier GPT for coding, computer use, research, and knowledge work","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5.5","knowledge":"2025-12-01","last_updated":"2026-04-23","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.5","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-04-23","retired":false,"tags":null},"openai/gpt-oss-120b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.15,"output":0.55},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open GPT reasoning model for self-hosted agents and controllable deployments","family":"gpt-oss","llmfit":{"architecture":"gpt_oss","context_length":4194304,"discovered":true,"gguf_sources":[{"provider":"unsloth","repo":"unsloth/gpt-oss-120b-GGUF"},{"provider":"ggml-org","repo":"ggml-org/gpt-oss-120b-GGUF"}],"hf_downloads":4197649,"hf_likes":5069,"matched_hugging_face_id":"openai/gpt-oss-120b","memory":{"min_ram_gb":67.3,"min_vram_gb":61.7,"recommended_ram_gb":112.1},"model_id":"openai/gpt-oss-120b","moe":{"active_experts":4,"active_parameters":9595358141,"is_moe":true,"num_experts":128},"parameter_count":"120.4B","parameters_raw":120412337472,"pipeline_tag":"text-generation","provider":"openai","quantization":"Q4_K_M","release_date":"2025-08-04","source":"llmfit","use_case":"General purpose text generation"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-oss-120b","knowledge":null,"last_updated":"2025-08-05","lifecycle":null,"limits":{"context":131000,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT-OSS 120B","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"openai/o3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.5,"input":2,"output":8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Deliberate o-series reasoner for hard math, coding, and multi-step analysis","family":"o","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/o3","knowledge":"2024-05","last_updated":"2025-04-16","lifecycle":null,"limits":{"context":200000,"output":100000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"o3","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-04-16","retired":false,"tags":null},"openai/o3-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.55,"input":1.1,"output":4.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Smaller o-series reasoner for economical coding, math, and planning tasks","family":"o-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/o3-mini","knowledge":"2024-05","last_updated":"2025-01-29","lifecycle":null,"limits":{"context":200000,"output":100000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"o3-mini","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2024-12-20","retired":false,"tags":null},"openai/o4-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.275,"input":1.1,"output":4.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Fast o-series model for compact reasoning, coding, and tool use","family":"o-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/o4-mini","knowledge":"2024-05","last_updated":"2025-04-16","lifecycle":null,"limits":{"context":200000,"output":100000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"o4-mini","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-04-16","retired":false,"tags":null},"openai/whisper-large-v3":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":{"input":0.01,"output":0},"deprecated":false,"extra":{"attachment":false,"description":"Speech transcription model for accurate audio-to-text and captioning workflows","family":"whisper","open_weights":true,"temperature":false},"family":null,"id":"openai/whisper-large-v3","knowledge":null,"last_updated":"2023-11-06","lifecycle":null,"limits":{"context":448,"output":448},"modalities":{"input":["audio"],"output":["text"]},"model":null,"name":"Whisper Large v3","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2023-11-06","retired":false,"tags":null},"zai-org/GLM-5.1-FP8":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.85,"output":3.3},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"llmfit":{"architecture":"glm_moe_dsa","context_length":202752,"discovered":true,"gguf_sources":[],"hf_downloads":494825,"hf_likes":119,"matched_hugging_face_id":"zai-org/GLM-5.1-FP8","memory":{"min_ram_gb":421.3,"min_vram_gb":386.2,"recommended_ram_gb":702.1},"model_id":"zai-org/GLM-5.1-FP8","moe":{"active_experts":8,"active_parameters":60077205033,"is_moe":true,"num_experts":256},"parameter_count":"753.9B","parameters_raw":753910024032,"pipeline_tag":"text-generation","provider":"zai-org","quantization":"Q4_K_M","release_date":"2026-04-03","source":"llmfit","use_case":"General purpose text generation"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"zai-org/GLM-5.1-FP8","knowledge":null,"last_updated":"2026-03-27","lifecycle":null,"limits":{"context":202752,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5.1 FP8","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-03-27","retired":false,"tags":null}},"name":"NEAR AI Cloud","pricing_defaults":null,"runtime":{"auth":{"env":["NEARAI_API_KEY"],"headers":[],"type":"bearer"},"base_url":"https://cloud-api.near.ai/v1","config_schema":null,"default_headers":{},"default_query":{},"doc_url":"https://docs.near.ai/cloud/guides/openai-compatibility/"}};
|
|
3
|
+
export const data = {"alias_of":null,"base_url":"https://cloud-api.near.ai/v1","config_schema":null,"doc":"https://docs.near.ai/","env":["NEARAI_API_KEY"],"exclude_models":null,"extra":null,"id":"nearai","models":{"Qwen/Qwen3-30B-A3B-Instruct-2507":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.15,"output":0.55},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Qwen instruction model for multilingual chat, reasoning, and tool use","family":"qwen","llmfit":{"architecture":"qwen3_moe","context_length":262144,"discovered":true,"gguf_sources":[{"provider":"unsloth","repo":"unsloth/Qwen3-30B-A3B-Instruct-2507-GGUF"},{"provider":"mradermacher","repo":"mradermacher/Qwen3-30B-A3B-Instruct-2507-GGUF"}],"hf_downloads":1903290,"hf_likes":827,"matched_hugging_face_id":"Qwen/Qwen3-30B-A3B-Instruct-2507","memory":{"min_ram_gb":17.1,"min_vram_gb":15.6,"recommended_ram_gb":28.4},"model_id":"Qwen/Qwen3-30B-A3B-Instruct-2507","moe":{"active_experts":8,"active_parameters":3339450907,"is_moe":true,"num_experts":128},"parameter_count":"30.5B","parameters_raw":30532122624,"pipeline_tag":"text-generation","provider":"Alibaba","quantization":"Q4_K_M","release_date":"2025-07-28","source":"llmfit","use_case":"Instruction following, chat"},"open_weights":true,"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"Qwen/Qwen3-30B-A3B-Instruct-2507","knowledge":null,"last_updated":"2025-07-29","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 30B-A3B Instruct 2507","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-07-29","retired":false,"tags":null},"Qwen/Qwen3-Embedding-0.6B":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":{"input":0.01,"output":0},"deprecated":false,"extra":{"attachment":false,"description":"Embedding model for semantic search, retrieval, clustering, and ranking pipelines","family":"text-embedding","llmfit":{"architecture":"qwen3","context_length":32768,"discovered":true,"gguf_sources":[{"provider":"mradermacher","repo":"mradermacher/Qwen3-Embedding-0.6B-GGUF"}],"hf_downloads":8108569,"hf_likes":0,"matched_hugging_face_id":"Qwen/Qwen3-Embedding-0.6B","memory":{"min_ram_gb":1.0,"min_vram_gb":0.5,"recommended_ram_gb":2.0},"model_id":"Qwen/Qwen3-Embedding-0.6B","parameter_count":"596M","parameters_raw":595776512,"pipeline_tag":"feature-extraction","provider":"Alibaba","quantization":"Q4_K_M","source":"llmfit","use_case":"Text embeddings for RAG"},"open_weights":true,"temperature":false},"family":null,"id":"Qwen/Qwen3-Embedding-0.6B","knowledge":null,"last_updated":"2025-06-03","lifecycle":null,"limits":{"context":40960,"output":1024},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Embedding 0.6B","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-06-03","retired":false,"tags":null},"Qwen/Qwen3-Reranker-0.6B":{"aliases":[],"base_url":null,"capabilities":{"chat":false,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":true,"streaming":{"text":false,"tool_calls":false},"tools":{"enabled":false,"parallel":false,"streaming":false,"strict":false}},"catalog_only":true,"cost":{"input":0.01,"output":0.01},"deprecated":false,"extra":{"attachment":false,"description":"Reranking model for improving retrieval quality in search and recommendation systems","family":"qwen","open_weights":true,"temperature":false},"family":null,"id":"Qwen/Qwen3-Reranker-0.6B","knowledge":null,"last_updated":"2025-06-03","lifecycle":null,"limits":{"context":40960,"output":1024},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3 Reranker 0.6B","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-06-03","retired":false,"tags":null},"Qwen/Qwen3-VL-30B-A3B-Instruct":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.15,"output":0.55},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","llmfit":{"architecture":"qwen3_vl_moe","context_length":262144,"discovered":true,"gguf_sources":[],"hf_downloads":393070,"hf_likes":0,"matched_hugging_face_id":"Qwen/Qwen3-VL-30B-A3B-Instruct","memory":{"min_ram_gb":17.4,"min_vram_gb":15.9,"recommended_ram_gb":28.9},"model_id":"Qwen/Qwen3-VL-30B-A3B-Instruct","moe":{"active_experts":8,"active_parameters":3398363717,"is_moe":true,"num_experts":128},"parameter_count":"31.1B","parameters_raw":31070754032,"pipeline_tag":"image-text-to-text","provider":"Alibaba","quantization":"Q4_K_M","source":"llmfit","use_case":"Multimodal, vision and text"},"open_weights":true,"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"Qwen/Qwen3-VL-30B-A3B-Instruct","knowledge":null,"last_updated":"2025-09-23","lifecycle":null,"limits":{"context":256000,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"Qwen3-VL 30B-A3B Instruct","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-09-23","retired":false,"tags":null},"Qwen/Qwen3.5-122B-A10B":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.4,"output":3.2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Qwen vision-language model for visual reasoning, documents, and agent tasks","family":"qwen","llmfit":{"architecture":"qwen3_5_moe","context_length":262144,"discovered":false,"gguf_sources":[{"provider":"unsloth","repo":"unsloth/Qwen3.5-122B-A10B-GGUF"},{"provider":"mradermacher","repo":"mradermacher/Qwen3.5-122B-A10B-GGUF"}],"hf_downloads":2211510,"hf_likes":606,"matched_hugging_face_id":"Qwen/Qwen3.5-122B-A10B","memory":{"min_ram_gb":69.9,"min_vram_gb":64.1,"recommended_ram_gb":116.5},"model_id":"Qwen/Qwen3.5-122B-A10B","moe":{"active_experts":8,"active_parameters":10000000000,"is_moe":true,"num_experts":256},"parameter_count":"125.1B","parameters_raw":125086497008,"pipeline_tag":"image-text-to-text","provider":"Alibaba","quantization":"Q4_K_M","release_date":"2026-02-24","source":"llmfit","use_case":"Multimodal, vision and text"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"Qwen/Qwen3.5-122B-A10B","knowledge":null,"last_updated":"2026-02-23","lifecycle":null,"limits":{"context":131072,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen3.5 122B-A10B","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-02-23","retired":false,"tags":null},"Qwen/Qwen3.6-35B-A3B-FP8":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.056,"input":0.17,"output":1.1},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Open multimodal Qwen MoE for local agents that need vision, audio, and code","family":"qwen","llmfit":{"architecture":"qwen3_5_moe","context_length":262144,"discovered":true,"gguf_sources":[],"hf_downloads":11633364,"hf_likes":0,"matched_hugging_face_id":"Qwen/Qwen3.6-35B-A3B-FP8","memory":{"min_ram_gb":20.1,"min_vram_gb":18.4,"recommended_ram_gb":33.5},"model_id":"Qwen/Qwen3.6-35B-A3B-FP8","moe":{"active_experts":8,"active_parameters":2865078437,"is_moe":true,"num_experts":256},"parameter_count":"36.0B","parameters_raw":35953925552,"pipeline_tag":"image-text-to-text","provider":"Alibaba","quantization":"Q4_K_M","source":"llmfit","use_case":"Multimodal, vision and text"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"Qwen/Qwen3.6-35B-A3B-FP8","knowledge":null,"last_updated":"2026-04-17","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Qwen 3.6 35B A3B FP8","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-04-17","retired":false,"tags":null},"anthropic/claude-haiku-4-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.1,"cache_write":1.25,"input":1,"output":5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Fast Claude lane for lightweight agents, office tasks, and responsive chat","family":"claude-haiku","open_weights":false,"reasoning_options":[{"type":"toggle"},{"min":1024,"type":"budget_tokens"}],"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"anthropic/claude-haiku-4-5","knowledge":"2025-02-28","last_updated":"2025-10-15","lifecycle":null,"limits":{"context":200000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Haiku 4.5 (latest)","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-10-15","retired":false,"tags":null},"anthropic/claude-opus-4-6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.5,"cache_write":6.25,"input":5,"output":25},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"High-end Claude for difficult coding, planning, and slower expert reasoning","family":"claude-opus","open_weights":false,"reasoning_options":[{"type":"toggle"},{"min":1024,"type":"budget_tokens"}],"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"anthropic/claude-opus-4-6","knowledge":"2025-05-31","last_updated":"2026-03-13","lifecycle":null,"limits":{"context":200000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.6","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-02-05","retired":false,"tags":null},"anthropic/claude-opus-4-7":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.5,"cache_write":6.25,"input":5,"output":25},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Stronger Opus tier for advanced software work and high-stakes reasoning","family":"claude-opus","open_weights":false,"reasoning_options":[{"type":"toggle"}],"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"anthropic/claude-opus-4-7","knowledge":"2026-01-31","last_updated":"2026-04-16","lifecycle":null,"limits":{"context":1000000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Opus 4.7","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-04-16","retired":false,"tags":null},"anthropic/claude-sonnet-4-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.3,"cache_write":3.75,"input":3,"output":15.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Balanced Claude model for coding, analysis, agent workflows, and cost control","family":"claude-sonnet","open_weights":false,"reasoning_options":[{"type":"toggle"},{"min":1024,"type":"budget_tokens"}],"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"anthropic/claude-sonnet-4-5","knowledge":"2025-07-31","last_updated":"2025-09-29","lifecycle":null,"limits":{"context":200000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Sonnet 4.5 (latest)","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-09-29","retired":false,"tags":null},"anthropic/claude-sonnet-4-6":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.3,"cache_write":3.75,"input":3,"output":15},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Claude workhorse for coding agents, careful analysis, and production cost control","family":"claude-sonnet","open_weights":false,"reasoning_options":[{"type":"toggle"},{"min":1024,"type":"budget_tokens"}],"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"anthropic/claude-sonnet-4-6","knowledge":"2025-08-31","last_updated":"2026-03-13","lifecycle":null,"limits":{"context":1000000,"output":64000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"Claude Sonnet 4.6","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-02-17","retired":false,"tags":null},"black-forest-labs/FLUX.2-klein-4B":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":{"input":1,"output":1},"deprecated":false,"extra":{"attachment":false,"description":"Image model for prompt-driven generation, editing, and visual design workflows","family":"flux","open_weights":true,"temperature":true},"family":null,"id":"black-forest-labs/FLUX.2-klein-4B","knowledge":null,"last_updated":"2026-01-14","lifecycle":null,"limits":{"context":128000,"output":128000},"modalities":{"input":["text","image"],"output":["image"]},"model":null,"name":"FLUX.2 Klein 4B","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-01-14","retired":false,"tags":null},"google/gemini-2.5-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.03,"input":0.3,"input_audio":1,"output":2.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Fast Gemini workhorse for multimodal apps where latency and price matter","family":"gemini-flash","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"google/gemini-2.5-flash","knowledge":"2025-01","last_updated":"2025-06-17","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","audio","video","pdf"],"output":["text"]},"model":null,"name":"Gemini 2.5 Flash","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-06-17","retired":false,"tags":null},"google/gemini-2.5-flash-lite":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.01,"input":0.1,"input_audio":0.3,"output":0.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Lean Gemini 2.5 lane for cheap multimodal traffic and quick agents","family":"gemini-flash-lite","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"google/gemini-2.5-flash-lite","knowledge":"2025-01","last_updated":"2025-06-17","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","audio","video","pdf"],"output":["text"]},"model":null,"name":"Gemini 2.5 Flash-Lite","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-06-17","retired":false,"tags":null},"google/gemini-2.5-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.125,"input":1.25,"output":10},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Google's proven reasoning model for coding, math, and multimodal analysis","family":"gemini-pro","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"google/gemini-2.5-pro","knowledge":"2025-01","last_updated":"2025-06-17","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","audio","video","pdf"],"output":["text"]},"model":null,"name":"Gemini 2.5 Pro","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-06-17","retired":false,"tags":null},"google/gemini-3-pro":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"catalog_only":true,"cost":{"cache_read":0,"input":1.25,"output":15},"deprecated":false,"extra":{"attachment":true,"description":"Preview Gemini flagship for complex reasoning, coding, and rich multimodal prompts","family":"gemini-pro","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true},"family":null,"id":"google/gemini-3-pro","knowledge":"2025-01","last_updated":"2025-11-18","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","video","audio","pdf"],"output":["text"]},"model":null,"name":"Gemini 3 Pro Preview","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-11-18","retired":false,"tags":null},"google/gemini-3.1-flash-lite":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.025,"input":0.25,"input_audio":0.5,"output":1.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Low-latency Gemini model for high-volume multimodal and agent workloads","family":"gemini-flash-lite","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"google/gemini-3.1-flash-lite","knowledge":"2025-01","last_updated":"2026-05-07","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","video","audio","pdf"],"output":["text"]},"model":null,"name":"Gemini 3.1 Flash Lite","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-05-07","retired":false,"tags":null},"google/gemini-3.5-flash":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.15,"input":1.5,"input_audio":1.5,"output":9},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Fast Gemini model balancing multimodal reasoning, tool use, and cost","family":"gemini-flash","open_weights":false,"reasoning_options":[],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"google/gemini-3.5-flash","knowledge":"2025-01","last_updated":"2026-05-19","lifecycle":null,"limits":{"context":1048576,"output":65536},"modalities":{"input":["text","image","video","audio","pdf"],"output":["text"]},"model":null,"name":"Gemini 3.5 Flash","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-05-19","retired":false,"tags":null},"google/gemma-4-31B-it":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.026,"input":0.13,"output":0.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Largest Gemma 4 instruction model for open, self-hosted chat and reasoning","family":"gemma","llmfit":{"architecture":"gemma4","context_length":262144,"discovered":false,"gguf_sources":[{"provider":"ggml-org","repo":"ggml-org/gemma-4-31B-it-GGUF"}],"hf_downloads":9704552,"hf_likes":3575,"matched_hugging_face_id":"google/gemma-4-31B-it","memory":{"min_ram_gb":17.5,"min_vram_gb":16.0,"recommended_ram_gb":29.1},"model_id":"google/gemma-4-31B-it","parameter_count":"31.3B","parameters_raw":31273088876,"pipeline_tag":"image-text-to-text","provider":"Google","quantization":"Q4_K_M","release_date":"2026-03-11","source":"llmfit","use_case":"Multimodal, vision and text"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"google/gemma-4-31B-it","knowledge":null,"last_updated":"2026-04-02","lifecycle":null,"limits":{"context":262144,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"Gemma 4 31B IT","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-04-02","retired":false,"tags":null},"openai/gpt-4.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.5,"input":2,"output":8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Long-lived GPT workhorse for coding, instruction following, and production apps","family":"gpt","open_weights":false,"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-4.1","knowledge":"2024-04","last_updated":"2025-04-14","lifecycle":null,"limits":{"context":1047576,"output":32768},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-4.1","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-04-14","retired":false,"tags":null},"openai/gpt-4.1-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.1,"input":0.4,"output":1.6},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Affordable GPT-4.1 lane for fast coding help and structured extraction","family":"gpt-mini","open_weights":false,"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-4.1-mini","knowledge":"2024-04","last_updated":"2025-04-14","lifecycle":null,"limits":{"context":1047576,"output":32768},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-4.1 mini","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-04-14","retired":false,"tags":null},"openai/gpt-4.1-nano":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":false},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.025,"input":0.1,"output":0.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Tiny GPT-4.1 option for classification, routing, and very high-volume tasks","family":"gpt-nano","open_weights":false,"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-4.1-nano","knowledge":"2024-04","last_updated":"2025-04-14","lifecycle":null,"limits":{"context":1047576,"output":32768},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-4.1 nano","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-04-14","retired":false,"tags":null},"openai/gpt-5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.125,"input":1.25,"output":10},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Original GPT-5 workhorse for reasoning, coding, writing, and tool workflows","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5","knowledge":"2024-09-30","last_updated":"2025-08-07","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-08-07","retired":false,"tags":null},"openai/gpt-5-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.025,"input":0.25,"output":2},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Small GPT-5 for responsive agents, coding help, and everyday automation","family":"gpt-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5-mini","knowledge":"2024-05-30","last_updated":"2025-08-07","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5 Mini","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-08-07","retired":false,"tags":null},"openai/gpt-5-nano":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.005,"input":0.05,"output":0.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Tiny GPT-5 lane for routing, extraction, classification, and bulk jobs","family":"gpt-nano","open_weights":false,"reasoning_options":[{"type":"effort","values":["minimal","low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5-nano","knowledge":"2024-05-30","last_updated":"2025-08-07","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5 Nano","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-08-07","retired":false,"tags":null},"openai/gpt-5.1":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.125,"input":1.25,"output":10},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Sharper GPT-5 generation for coding, product work, and tool-assisted tasks","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5.1","knowledge":"2024-09-30","last_updated":"2025-11-13","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.1","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-11-13","retired":false,"tags":null},"openai/gpt-5.2":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.18,"input":1.8,"output":15.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Reliable GPT generation for broad coding, writing, and tool-assisted product work","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5.2","knowledge":"2025-08-31","last_updated":"2025-12-11","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.2","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-12-11","retired":false,"tags":null},"openai/gpt-5.4":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.25,"input":2.5,"output":15},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Agent-ready GPT for coding and computer-use workflows at a lower cost","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5.4","knowledge":"2025-08-31","last_updated":"2026-03-05","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.4","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-03-05","retired":false,"tags":null},"openai/gpt-5.4-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.075,"input":0.75,"output":4.5},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Strong small GPT for coding subagents, quick tool use, and high-volume work","family":"gpt-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5.4-mini","knowledge":"2025-08-31","last_updated":"2026-03-17","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.4 mini","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-03-17","retired":false,"tags":null},"openai/gpt-5.4-nano":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.02,"input":0.2,"output":1.25},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Cheapest GPT-5.4 lane for simple routing, extraction, and bulk automation","family":"gpt-nano","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5.4-nano","knowledge":"2025-08-31","last_updated":"2026-03-17","lifecycle":null,"limits":{"context":400000,"output":128000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"GPT-5.4 nano","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-03-17","retired":false,"tags":null},"openai/gpt-5.5":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.5,"input":5,"output":30},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Default frontier GPT for coding, computer use, research, and knowledge work","family":"gpt","open_weights":false,"reasoning_options":[{"type":"effort","values":["none","low","medium","high","xhigh"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-5.5","knowledge":"2025-12-01","last_updated":"2026-04-23","lifecycle":null,"limits":{"context":1050000,"output":128000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"GPT-5.5","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-04-23","retired":false,"tags":null},"openai/gpt-oss-120b":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.15,"output":0.55},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Open GPT reasoning model for self-hosted agents and controllable deployments","family":"gpt-oss","llmfit":{"architecture":"gpt_oss","context_length":4194304,"discovered":true,"gguf_sources":[{"provider":"unsloth","repo":"unsloth/gpt-oss-120b-GGUF"},{"provider":"ggml-org","repo":"ggml-org/gpt-oss-120b-GGUF"}],"hf_downloads":4479205,"hf_likes":5106,"matched_hugging_face_id":"openai/gpt-oss-120b","memory":{"min_ram_gb":65.3,"min_vram_gb":59.8,"recommended_ram_gb":108.8},"model_id":"openai/gpt-oss-120b","moe":{"active_experts":4,"active_parameters":9309823421,"is_moe":true,"num_experts":128},"parameter_count":"116.8B","parameters_raw":116829156672,"pipeline_tag":"text-generation","provider":"openai","quantization":"Q4_K_M","release_date":"2025-08-04","source":"llmfit","use_case":"General purpose text generation"},"open_weights":true,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/gpt-oss-120b","knowledge":null,"last_updated":"2025-08-05","lifecycle":null,"limits":{"context":131000,"output":32768},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GPT-OSS 120B","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-08-05","retired":false,"tags":null},"openai/o3":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.5,"input":2,"output":8},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Deliberate o-series reasoner for hard math, coding, and multi-step analysis","family":"o","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/o3","knowledge":"2024-05","last_updated":"2025-04-16","lifecycle":null,"limits":{"context":200000,"output":100000},"modalities":{"input":["text","image","pdf"],"output":["text"]},"model":null,"name":"o3","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-04-16","retired":false,"tags":null},"openai/o3-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.55,"input":1.1,"output":4.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Smaller o-series reasoner for economical coding, math, and planning tasks","family":"o-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/o3-mini","knowledge":"2024-05","last_updated":"2025-01-29","lifecycle":null,"limits":{"context":200000,"output":100000},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"o3-mini","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2024-12-20","retired":false,"tags":null},"openai/o4-mini":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"cache_read":0.275,"input":1.1,"output":4.4},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":true,"description":"Fast o-series model for compact reasoning, coding, and tool use","family":"o-mini","open_weights":false,"reasoning_options":[{"type":"effort","values":["low","medium","high"]}],"structured_output":true,"temperature":false,"wire":{"protocol":"openai_chat"}},"family":null,"id":"openai/o4-mini","knowledge":"2024-05","last_updated":"2025-04-16","lifecycle":null,"limits":{"context":200000,"output":100000},"modalities":{"input":["text","image"],"output":["text"]},"model":null,"name":"o4-mini","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2025-04-16","retired":false,"tags":null},"openai/whisper-large-v3":{"aliases":[],"base_url":null,"capabilities":null,"catalog_only":true,"cost":{"input":0.01,"output":0},"deprecated":false,"extra":{"attachment":false,"description":"Speech transcription model for accurate audio-to-text and captioning workflows","family":"whisper","open_weights":true,"temperature":false},"family":null,"id":"openai/whisper-large-v3","knowledge":null,"last_updated":"2023-11-06","lifecycle":null,"limits":{"context":448,"output":448},"modalities":{"input":["audio"],"output":["text"]},"model":null,"name":"Whisper Large v3","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2023-11-06","retired":false,"tags":null},"zai-org/GLM-5.1-FP8":{"aliases":[],"base_url":null,"capabilities":{"chat":true,"embeddings":false,"json":{"native":false,"schema":false,"strict":false},"reasoning":{"enabled":true},"rerank":false,"streaming":{"tool_calls":true},"tools":{"enabled":true}},"cost":{"input":0.85,"output":3.3},"deprecated":false,"execution":{"object":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"},"text":{"family":"openai_chat_compatible","path":"/chat/completions","supported":true,"wire_protocol":"openai_chat"}},"extra":{"attachment":false,"description":"Flagship GLM model for hybrid reasoning, coding, and agentic engineering","family":"glm","interleaved":{"field":"reasoning_content"},"llmfit":{"architecture":"glm_moe_dsa","context_length":202752,"discovered":true,"gguf_sources":[],"hf_downloads":476878,"hf_likes":120,"matched_hugging_face_id":"zai-org/GLM-5.1-FP8","memory":{"min_ram_gb":421.3,"min_vram_gb":386.2,"recommended_ram_gb":702.1},"model_id":"zai-org/GLM-5.1-FP8","moe":{"active_experts":8,"active_parameters":60077205033,"is_moe":true,"num_experts":256},"parameter_count":"753.9B","parameters_raw":753910024032,"pipeline_tag":"text-generation","provider":"zai-org","quantization":"Q4_K_M","release_date":"2026-04-03","source":"llmfit","use_case":"General purpose text generation"},"open_weights":true,"reasoning_options":[{"type":"toggle"}],"structured_output":true,"temperature":true,"wire":{"protocol":"openai_chat"}},"family":null,"id":"zai-org/GLM-5.1-FP8","knowledge":null,"last_updated":"2026-03-27","lifecycle":null,"limits":{"context":202752,"output":131072},"modalities":{"input":["text"],"output":["text"]},"model":null,"name":"GLM-5.1 FP8","pricing":null,"provider":"nearai","provider_model_id":null,"release_date":"2026-03-27","retired":false,"tags":null}},"name":"NEAR AI Cloud","pricing_defaults":null,"runtime":{"auth":{"env":["NEARAI_API_KEY"],"headers":[],"type":"bearer"},"base_url":"https://cloud-api.near.ai/v1","config_schema":null,"default_headers":{},"default_query":{},"doc_url":"https://docs.near.ai/cloud/guides/openai-compatibility/"}};
|
|
4
4
|
const provider = /* @__PURE__ */ createProviderCatalog(data);
|
|
5
5
|
export default provider;
|
|
@@ -6,6 +6,6 @@ import type {
|
|
|
6
6
|
export declare const data: Provider;
|
|
7
7
|
declare const provider: ProviderCatalog<
|
|
8
8
|
"nebius",
|
|
9
|
-
"MiniMaxAI/MiniMax-M2.5" | "MiniMaxAI/MiniMax-M2.5-fast" | "MiniMaxAI/MiniMax-M3" | "NousResearch/Hermes-4-405B" | "NousResearch/Hermes-4-70B" | "PrimeIntellect/INTELLECT-3" | "Qwen/Qwen2.5-VL-72B-Instruct" | "Qwen/Qwen3-235B-A22B-Instruct-2507" | "Qwen/Qwen3-235B-A22B-Thinking-2507-fast" | "Qwen/Qwen3-30B-A3B-Instruct-2507" | "Qwen/Qwen3-32B" | "Qwen/Qwen3-Embedding-8B" | "Qwen/Qwen3-Next-80B-A3B-Thinking" | "Qwen/Qwen3-Next-80B-A3B-Thinking-fast" | "Qwen/Qwen3.5-397B-A17B" | "Qwen/Qwen3.5-397B-A17B-fast" | "deepseek-ai/DeepSeek-V3.2" | "deepseek-ai/DeepSeek-V3.2-fast" | "deepseek-ai/DeepSeek-V4-Pro" | "google/gemma-3-27b-it" | "meta-llama/Llama-3.3-70B-Instruct" | "moonshotai/Kimi-K2.5" | "moonshotai/Kimi-K2.5-fast" | "moonshotai/Kimi-K2.7-Code" | "moonshotai/Kimi-K3" | "nvidia/Llama-3_1-Nemotron-Ultra-253B-v1" | "nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B" | "nvidia/Nemotron-3-Nano-Omni" | "nvidia/nemotron-3-super-120b-a12b" | "openai/gpt-oss-120b" | "openai/gpt-oss-120b-fast" | "zai-org/GLM-5" | "zai-org/GLM-5.2"
|
|
9
|
+
"MiniMaxAI/MiniMax-M2.5" | "MiniMaxAI/MiniMax-M2.5-fast" | "MiniMaxAI/MiniMax-M3" | "NousResearch/Hermes-4-405B" | "NousResearch/Hermes-4-70B" | "PrimeIntellect/INTELLECT-3" | "Qwen/Qwen2.5-VL-72B-Instruct" | "Qwen/Qwen3-235B-A22B-Instruct-2507" | "Qwen/Qwen3-235B-A22B-Thinking-2507-fast" | "Qwen/Qwen3-30B-A3B-Instruct-2507" | "Qwen/Qwen3-32B" | "Qwen/Qwen3-Embedding-8B" | "Qwen/Qwen3-Next-80B-A3B-Thinking" | "Qwen/Qwen3-Next-80B-A3B-Thinking-fast" | "Qwen/Qwen3.5-397B-A17B" | "Qwen/Qwen3.5-397B-A17B-fast" | "deepseek-ai/DeepSeek-V3.2" | "deepseek-ai/DeepSeek-V3.2-fast" | "deepseek-ai/DeepSeek-V4-Flash" | "deepseek-ai/DeepSeek-V4-Pro" | "google/gemma-3-27b-it" | "meta-llama/Llama-3.3-70B-Instruct" | "moonshotai/Kimi-K2.5" | "moonshotai/Kimi-K2.5-fast" | "moonshotai/Kimi-K2.7-Code" | "moonshotai/Kimi-K3" | "nvidia/Llama-3_1-Nemotron-Ultra-253B-v1" | "nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B" | "nvidia/Nemotron-3-Nano-Omni" | "nvidia/nemotron-3-super-120b-a12b" | "openai/gpt-oss-120b" | "openai/gpt-oss-120b-fast" | "zai-org/GLM-5" | "zai-org/GLM-5.2"
|
|
10
10
|
>;
|
|
11
11
|
export default provider;
|