@henjicc/ai-sdk 0.2.8 → 0.3.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (236) hide show
  1. package/CHANGELOG.md +153 -143
  2. package/README.md +486 -461
  3. package/dist/capabilities/embedding/bailian.d.ts +23 -0
  4. package/dist/capabilities/embedding/bailian.js +10 -0
  5. package/dist/capabilities/embedding/bigmodel.d.ts +9 -0
  6. package/dist/capabilities/embedding/bigmodel.js +5 -0
  7. package/dist/capabilities/embedding/index.d.ts +1 -0
  8. package/dist/capabilities/embedding/index.js +1 -0
  9. package/dist/capabilities/embedding/ppio.d.ts +7 -0
  10. package/dist/capabilities/embedding/ppio.js +5 -0
  11. package/dist/capabilities/embedding/siliconflow.d.ts +21 -0
  12. package/dist/capabilities/embedding/siliconflow.js +10 -0
  13. package/dist/capabilities/embedding/volcengine.d.ts +10 -0
  14. package/dist/capabilities/embedding/volcengine.js +6 -0
  15. package/dist/capabilities/rerank/bailian.d.ts +21 -0
  16. package/dist/capabilities/rerank/bailian.js +14 -0
  17. package/dist/capabilities/rerank/bigmodel.d.ts +9 -0
  18. package/dist/capabilities/rerank/bigmodel.js +5 -0
  19. package/dist/capabilities/rerank/index.d.ts +1 -0
  20. package/dist/capabilities/rerank/index.js +1 -0
  21. package/dist/capabilities/rerank/ppio.d.ts +7 -0
  22. package/dist/capabilities/rerank/ppio.js +5 -0
  23. package/dist/capabilities/rerank/siliconflow.d.ts +21 -0
  24. package/dist/capabilities/rerank/siliconflow.js +10 -0
  25. package/dist/capabilities/retrieval/http.d.ts +3 -0
  26. package/dist/capabilities/retrieval/http.js +48 -0
  27. package/dist/capabilities/retrieval/module.d.ts +11 -0
  28. package/dist/capabilities/retrieval/module.js +110 -0
  29. package/dist/capabilities/retrieval/types.d.ts +54 -0
  30. package/dist/capabilities/retrieval/types.js +1 -0
  31. package/dist/capabilities/retrieval/validation.d.ts +10 -0
  32. package/dist/capabilities/retrieval/validation.js +65 -0
  33. package/dist/capabilities/types.d.ts +1 -1
  34. package/dist/catalog/apimart/gpt-image-2.5.model.d.ts +2 -0
  35. package/dist/catalog/apimart/gpt-image-2.5.model.js +51 -0
  36. package/dist/catalog/fal/gpt-image-2.5.model.d.ts +2 -0
  37. package/dist/catalog/fal/gpt-image-2.5.model.js +53 -0
  38. package/dist/catalog/fal/ic-light-v2.model.js +9 -13
  39. package/dist/catalog/grsai/gpt-image-2.5.model.d.ts +2 -0
  40. package/dist/catalog/grsai/gpt-image-2.5.model.js +54 -0
  41. package/dist/catalog/grsai/gptImage25Sizes.d.ts +1 -0
  42. package/dist/catalog/grsai/gptImage25Sizes.js +76 -0
  43. package/dist/catalog/index.js +112 -104
  44. package/dist/catalog/kie/gpt-image-2.5.model.d.ts +2 -0
  45. package/dist/catalog/kie/gpt-image-2.5.model.js +38 -0
  46. package/dist/catalog/shared/gptImage25.d.ts +16 -0
  47. package/dist/catalog/shared/gptImage25.js +48 -0
  48. package/dist/catalog/shared/gptImage25Pricing.d.ts +12 -0
  49. package/dist/catalog/shared/gptImage25Pricing.js +508 -0
  50. package/dist/llm/defaults.d.ts +1 -1
  51. package/dist/llm/defaults.js +1 -1
  52. package/dist/llm/modelCatalogEntries.js +16 -0
  53. package/dist/llm/providerPresets.js +2 -2
  54. package/dist/packs/models/apimart/gpt-image-2.5.d.ts +6 -0
  55. package/dist/packs/models/apimart/gpt-image-2.5.js +7 -0
  56. package/dist/packs/models/fal/gpt-image-2.5.d.ts +6 -0
  57. package/dist/packs/models/fal/gpt-image-2.5.js +7 -0
  58. package/dist/packs/models/grsai/gpt-image-2.5.d.ts +6 -0
  59. package/dist/packs/models/grsai/gpt-image-2.5.js +7 -0
  60. package/dist/packs/models/kie/gpt-image-2.5.d.ts +6 -0
  61. package/dist/packs/models/kie/gpt-image-2.5.js +7 -0
  62. package/dist/packs/provider-packs/apimart.d.ts +1 -1
  63. package/dist/packs/provider-packs/apimart.js +21 -20
  64. package/dist/packs/provider-packs/fal.d.ts +1 -1
  65. package/dist/packs/provider-packs/fal.js +37 -36
  66. package/dist/packs/provider-packs/grsai.d.ts +1 -1
  67. package/dist/packs/provider-packs/grsai.js +6 -5
  68. package/dist/packs/provider-packs/kie.d.ts +1 -1
  69. package/dist/packs/provider-packs/kie.js +28 -27
  70. package/dist/packs/tool-models/fal/{qwen-image-edit-2509-multiple-angles.d.ts → qwen-image-edit-2511-multiple-angles.d.ts} +1 -1
  71. package/dist/packs/tool-models/fal/{qwen-image-edit-2509-multiple-angles.js → qwen-image-edit-2511-multiple-angles.js} +1 -1
  72. package/dist/packs/tool-packs/fal-multi-angle-tools.js +1 -1
  73. package/dist/tool-packs/fal-multi-angle/models/qwen-image-edit-2511-multiple-angles.model.d.ts +2 -0
  74. package/dist/tool-packs/fal-multi-angle/models/{qwen-image-edit-2509-multiple-angles.model.js → qwen-image-edit-2511-multiple-angles.model.js} +20 -17
  75. package/docs/README.md +26 -26
  76. package/docs/consumers.md +54 -48
  77. package/docs/llm-adaptation/README.md +139 -139
  78. package/docs/llm-adaptation//344/276/233/345/272/224/345/225/206/DeepSeek.md +103 -91
  79. package/docs/llm-adaptation//344/276/233/345/272/224/345/225/206/Kimi.md +75 -75
  80. package/docs/llm-adaptation//344/276/233/345/272/224/345/225/206/MiniMax.md +84 -84
  81. package/docs/llm-adaptation//344/276/233/345/272/224/345/225/206//345/260/217/347/261/263MiMo.md +85 -85
  82. package/docs/llm-adaptation//344/276/233/345/272/224/345/225/206//346/231/272/350/260/261GLM.md +232 -232
  83. package/docs/llm-adaptation//344/276/233/345/272/224/345/225/206//347/201/253/345/261/261/345/274/225/346/223/216.md +87 -87
  84. package/docs/llm-adaptation//344/276/233/345/272/224/345/225/206//347/231/276/347/202/274Qwen.md +84 -84
  85. package/docs/llm-adaptation//346/226/207/346/241/243/351/207/207/351/233/206/346/211/213/345/206/214.md +88 -88
  86. package/docs/model-adaptation/Bria-Eraser/Bria-Eraser_Fal.md +32 -32
  87. package/docs/model-adaptation/Bria-/345/210/233/346/204/217/346/224/276/345/244/247/Bria-/345/210/233/346/204/217/346/224/276/345/244/247_Fal.md +31 -31
  88. package/docs/model-adaptation/ControlLight/ControlLight_Fal.md +85 -85
  89. package/docs/model-adaptation/FLUX-2-/345/244/232/350/247/222/345/272/246/FLUX-2-/345/244/232/350/247/222/345/272/246_Fal.md +107 -107
  90. package/docs/model-adaptation/Finegrain-Eraser/Finegrain-Eraser_Fal.md +31 -31
  91. package/docs/model-adaptation/Flux-Pro-Erase/Flux-Pro-Erase_Fal.md +34 -34
  92. package/docs/model-adaptation/Fun-ASR/Fun-ASR_/347/231/276/347/202/274.md +43 -43
  93. package/docs/model-adaptation/Fun-ASR-Flash-2026-06-15/Fun-ASR-Flash-2026-06-15_/347/231/276/347/202/274.md +41 -41
  94. package/docs/model-adaptation/Fun-ASR-Realtime/Fun-ASR-Realtime_/347/231/276/347/202/274.md +37 -37
  95. package/docs/model-adaptation/Fun-ASR-Realtime-2026-02-28/Fun-ASR-Realtime-2026-02-28_/347/231/276/347/202/274.md +39 -39
  96. package/docs/model-adaptation/GLM-5.3-Flash/GLM-5.3-Flash_/346/231/272/350/260/261.md +207 -207
  97. package/docs/model-adaptation/GPT-Image-2/GPT-Image-2_APIMart.md +173 -173
  98. package/docs/model-adaptation/GPT-Image-2/GPT-Image-2_Fal.md +94 -94
  99. package/docs/model-adaptation/GPT-Image-2/GPT-Image-2_Grsai.md +137 -137
  100. package/docs/model-adaptation/GPT-Image-2/GPT-Image-2_KIE.md +93 -93
  101. package/docs/model-adaptation/GPT-Image-2.5/GPT-Image-2.5_APIMart.md +66 -0
  102. package/docs/model-adaptation/GPT-Image-2.5/GPT-Image-2.5_Fal.md +55 -0
  103. package/docs/model-adaptation/GPT-Image-2.5/GPT-Image-2.5_Grsai.md +53 -0
  104. package/docs/model-adaptation/GPT-Image-2.5/GPT-Image-2.5_KIE.md +55 -0
  105. package/docs/model-adaptation/GPT-OSS-20B/GPT-OSS-20B_Groq.md +62 -62
  106. package/docs/model-adaptation/Gemini-Omni-Flash/Gemini-Omni-Flash_APIMart.md +124 -124
  107. package/docs/model-adaptation/Gemini-Omni-Flash/Gemini-Omni-Flash_Fal.md +84 -84
  108. package/docs/model-adaptation/Gemini-Omni-Flash/Gemini-Omni-Flash_KIE.md +129 -129
  109. package/docs/model-adaptation/Grok-Imagine/Grok-Imagine_KIE.md +36 -36
  110. package/docs/model-adaptation/Grok-Imagine-2.0/Grok-Imagine-2.0_APIMart.md +250 -250
  111. package/docs/model-adaptation/Grok-Imagine-2.0/Grok-Imagine-2.0_Fal.md +84 -84
  112. package/docs/model-adaptation/Grok-Imagine-2.0/Grok-Imagine-2.0_KIE.md +105 -105
  113. package/docs/model-adaptation/Hailuo-02/Hailuo-02_Fal.md +93 -93
  114. package/docs/model-adaptation/Hailuo-02/Hailuo-02_KIE.md +56 -56
  115. package/docs/model-adaptation/Hailuo-2.3/Hailuo-2.3_Fal.md +88 -88
  116. package/docs/model-adaptation/Hailuo-2.3/Hailuo-2.3_KIE.md +51 -51
  117. package/docs/model-adaptation/Hailuo-2.3/Hailuo-2.3_/346/264/276/346/254/247/344/272/221.md +70 -70
  118. package/docs/model-adaptation/IC-Light-v2/IC-Light-v2_Fal.md +97 -94
  119. package/docs/model-adaptation/Ideogram-/345/233/276/347/211/207/346/224/276/345/244/247/Ideogram-/345/233/276/347/211/207/346/224/276/345/244/247_Fal.md +41 -41
  120. package/docs/model-adaptation/Image-Apps-v2-/345/225/206/345/223/201/346/221/204/345/275/261/Image-Apps-v2-/345/225/206/345/223/201/346/221/204/345/275/261_Fal.md +72 -72
  121. package/docs/model-adaptation/Image-Apps-v2-/346/211/251/345/233/276/Image-Apps-v2-/346/211/251/345/233/276_Fal.md +93 -93
  122. package/docs/model-adaptation/Image-Apps-v2-/347/205/247/347/211/207/344/277/256/345/244/215/Image-Apps-v2-/347/205/247/347/211/207/344/277/256/345/244/215_Fal.md +86 -86
  123. package/docs/model-adaptation/Image-Apps-v2-/351/207/215/346/211/223/345/205/211/Image-Apps-v2-/351/207/215/346/211/223/345/205/211_Fal.md +84 -84
  124. package/docs/model-adaptation/Kling-3.0/Kling-3.0_APIMart.md +112 -112
  125. package/docs/model-adaptation/Kling-3.0/Kling-3.0_Fal.md +89 -89
  126. package/docs/model-adaptation/Kling-3.0/Kling-3.0_KIE.md +106 -106
  127. package/docs/model-adaptation/Kling-3.0/Kling-3.0_/346/264/276/346/254/247/344/272/221.md +119 -119
  128. package/docs/model-adaptation/Kling-3.0-Omni/Kling-3.0-Omni_APIMart.md +125 -125
  129. package/docs/model-adaptation/Kling-3.0-Omni/Kling-3.0-Omni_Fal.md +107 -107
  130. package/docs/model-adaptation/Kling-3.0-Omni/Kling-3.0-Omni_KIE.md +143 -143
  131. package/docs/model-adaptation/Kling-3.0-Turbo/Kling-3.0-Turbo_APIMart.md +85 -85
  132. package/docs/model-adaptation/Kling-3.0-Turbo/Kling-3.0-Turbo_Fal.md +83 -83
  133. package/docs/model-adaptation/Kling-3.0-Turbo/Kling-3.0-Turbo_KIE.md +84 -84
  134. package/docs/model-adaptation/Midjourney/Midjourney_APIMart.md +396 -396
  135. package/docs/model-adaptation/MiniMax-H3/MiniMax-H3_APIMart.md +234 -234
  136. package/docs/model-adaptation/MiniMax-H3/MiniMax-H3_Fal.md +108 -108
  137. package/docs/model-adaptation/MiniMax-H3/MiniMax-H3_KIE.md +111 -111
  138. package/docs/model-adaptation/MiniMax-Speech/MiniMax-Speech_/346/264/276/346/254/247/344/272/221.md +170 -170
  139. package/docs/model-adaptation/Nano-Banana-2/Nano-Banana-2_APIMart.md +89 -89
  140. package/docs/model-adaptation/Nano-Banana-2/Nano-Banana-2_Fal.md +99 -99
  141. package/docs/model-adaptation/Nano-Banana-2/Nano-Banana-2_Grsai.md +82 -82
  142. package/docs/model-adaptation/Nano-Banana-2/Nano-Banana-2_KIE.md +70 -70
  143. package/docs/model-adaptation/Nano-Banana-2-Lite/Nano-Banana-2-Lite_APIMart.md +79 -79
  144. package/docs/model-adaptation/Nano-Banana-2-Lite/Nano-Banana-2-Lite_Grsai.md +65 -65
  145. package/docs/model-adaptation/Nano-Banana-2-Lite/Nano-Banana-2-Lite_KIE.md +64 -64
  146. package/docs/model-adaptation/Nano-Banana-Pro/Nano-Banana-Pro_APIMart.md +83 -83
  147. package/docs/model-adaptation/Nano-Banana-Pro/Nano-Banana-Pro_Fal.md +89 -89
  148. package/docs/model-adaptation/Nano-Banana-Pro/Nano-Banana-Pro_Grsai.md +82 -82
  149. package/docs/model-adaptation/Nano-Banana-Pro/Nano-Banana-Pro_KIE.md +64 -64
  150. package/docs/model-adaptation/Pixelcut-/350/203/214/346/231/257/347/247/273/351/231/244/Pixelcut-/350/203/214/346/231/257/347/247/273/351/231/244_Fal.md +79 -79
  151. package/docs/model-adaptation/Qwen-Image-3.0/Qwen-Image-3.0_APIMart.md +117 -117
  152. package/docs/model-adaptation/Qwen-Image-3.0/Qwen-Image-3.0_Fal.md +84 -84
  153. package/docs/model-adaptation/Qwen-Image-3.0/Qwen-Image-3.0_KIE.md +103 -103
  154. package/docs/model-adaptation/Qwen-Image-3.0/Qwen-Image-3.0_/347/231/276/347/202/274.md +138 -138
  155. package/docs/model-adaptation/Qwen-Image-Edit-2511-/345/244/232/350/247/222/345/272/246/Qwen-Image-Edit-2511-/345/244/232/350/247/222/345/272/246_Fal.md +57 -0
  156. package/docs/model-adaptation/Qwen-MT-Flash/Qwen-MT-Flash_/347/231/276/347/202/274.md +47 -47
  157. package/docs/model-adaptation/Qwen-MT-Lite/Qwen-MT-Lite_/347/231/276/347/202/274.md +39 -39
  158. package/docs/model-adaptation/Qwen-MT-Plus/Qwen-MT-Plus_/347/231/276/347/202/274.md +39 -39
  159. package/docs/model-adaptation/Qwen3-ASR-Flash/Qwen3-ASR-Flash_/347/231/276/347/202/274.md +40 -40
  160. package/docs/model-adaptation/Qwen3-ASR-Flash-2026-02-10/Qwen3-ASR-Flash-2026-02-10_/347/231/276/347/202/274.md +33 -33
  161. package/docs/model-adaptation/Qwen3-ASR-Flash-Filetrans/Qwen3-ASR-Flash-Filetrans_/347/231/276/347/202/274.md +41 -41
  162. package/docs/model-adaptation/Qwen3-ASR-Flash-Realtime/Qwen3-ASR-Flash-Realtime_/347/231/276/347/202/274.md +35 -35
  163. package/docs/model-adaptation/Qwen3-ASR-Flash-Realtime-2026-02-10/Qwen3-ASR-Flash-Realtime-2026-02-10_/347/231/276/347/202/274.md +37 -37
  164. package/docs/model-adaptation/README.md +313 -295
  165. package/docs/model-adaptation/SeedASR-2.0-File/SeedASR-2.0-File_/347/201/253/345/261/261/345/274/225/346/223/216.md +115 -115
  166. package/docs/model-adaptation/SeedASR-2.0-Realtime/SeedASR-2.0-Realtime_/347/201/253/345/261/261/345/274/225/346/223/216.md +143 -143
  167. package/docs/model-adaptation/SeedVR2-/345/233/276/347/211/207/346/224/276/345/244/247/SeedVR2-/345/233/276/347/211/207/346/224/276/345/244/247_Fal.md +45 -45
  168. package/docs/model-adaptation/Seedance-2.0/Seedance-2.0_APIMart.md +121 -121
  169. package/docs/model-adaptation/Seedance-2.0/Seedance-2.0_Fal.md +97 -97
  170. package/docs/model-adaptation/Seedance-2.0/Seedance-2.0_KIE.md +86 -86
  171. package/docs/model-adaptation/Seedance-2.0-Fast/Seedance-2.0-Fast_APIMart.md +89 -89
  172. package/docs/model-adaptation/Seedance-2.0-Fast/Seedance-2.0-Fast_Fal.md +95 -95
  173. package/docs/model-adaptation/Seedance-2.0-Fast/Seedance-2.0-Fast_KIE.md +78 -78
  174. package/docs/model-adaptation/Seedance-2.0-Mini/Seedance-2.0-Mini_APIMart.md +89 -89
  175. package/docs/model-adaptation/Seedance-2.0-Mini/Seedance-2.0-Mini_Fal.md +96 -96
  176. package/docs/model-adaptation/Seedance-2.0-Mini/Seedance-2.0-Mini_KIE.md +78 -78
  177. package/docs/model-adaptation/Seedance-2.5/Seedance-2.5_APIMart.md +212 -212
  178. package/docs/model-adaptation/Seedance-2.5/Seedance-2.5_Fal.md +94 -94
  179. package/docs/model-adaptation/Seedance-2.5/Seedance-2.5_KIE.md +89 -89
  180. package/docs/model-adaptation/Seedream-5.0-Lite/Seedream-5.0-Lite_APIMart.md +106 -106
  181. package/docs/model-adaptation/Seedream-5.0-Lite/Seedream-5.0-Lite_Fal.md +91 -91
  182. package/docs/model-adaptation/Seedream-5.0-Lite/Seedream-5.0-Lite_KIE.md +89 -89
  183. package/docs/model-adaptation/Seedream-5.0-Lite/Seedream-5.0-Lite_/347/201/253/345/261/261/345/274/225/346/223/216.md +108 -108
  184. package/docs/model-adaptation/Seedream-5.0-Pro/Seedream-5.0-Pro_APIMart.md +194 -194
  185. package/docs/model-adaptation/Seedream-5.0-Pro/Seedream-5.0-Pro_Fal.md +100 -100
  186. package/docs/model-adaptation/Seedream-5.0-Pro/Seedream-5.0-Pro_KIE.md +141 -141
  187. package/docs/model-adaptation/Seedream-5.0-Pro/Seedream-5.0-Pro_/347/201/253/345/261/261/345/274/225/346/223/216.md +137 -137
  188. package/docs/model-adaptation/SenseVoiceSmall/SenseVoiceSmall_/347/241/205/345/237/272/346/265/201/345/212/250.md +69 -69
  189. package/docs/model-adaptation/TeleSpeechASR/TeleSpeechASR_/347/241/205/345/237/272/346/265/201/345/212/250.md +72 -72
  190. package/docs/model-adaptation/Topaz-/345/233/276/347/211/207/346/224/276/345/244/247/Topaz-/345/233/276/347/211/207/346/224/276/345/244/247_Fal.md +87 -87
  191. package/docs/model-adaptation/Topaz-/351/200/217/346/230/216/345/233/276/346/224/276/345/244/247/Topaz-/351/200/217/346/230/216/345/233/276/346/224/276/345/244/247_Fal.md +34 -34
  192. package/docs/model-adaptation/Wan-2.5-Preview/Wan-2.5-Preview_/346/264/276/346/254/247/344/272/221.md +82 -82
  193. package/docs/model-adaptation/Wan-2.6/Wan-2.6_/346/264/276/346/254/247/344/272/221.md +84 -84
  194. package/docs/model-adaptation/Wan-2.7/Wan-2.7_/346/264/276/346/254/247/344/272/221.md +122 -122
  195. package/docs/model-adaptation/Whisper-Large-v3/Whisper-Large-v3_Groq.md +76 -76
  196. package/docs/model-adaptation/Whisper-Large-v3-Turbo/Whisper-Large-v3-Turbo_Groq.md +75 -75
  197. package/docs/model-adaptation/Z-Image-Turbo/Z-Image-Turbo_APIMart.md +88 -88
  198. package/docs/model-adaptation/Z-Image-Turbo/Z-Image-Turbo_Fal.md +95 -95
  199. package/docs/model-adaptation/Z-Image-Turbo/Z-Image-Turbo_KIE.md +71 -71
  200. package/docs/model-adaptation/Z-Image-Turbo/Z-Image-Turbo_/347/231/276/347/202/274.md +122 -122
  201. package/docs/model-adaptation/Z-Image-Turbo/Z-Image-Turbo_/351/255/224/346/220/255.md +97 -97
  202. package/docs/model-adaptation//344/276/233/345/272/224/345/225/206/APIMart.md +238 -238
  203. package/docs/model-adaptation//344/276/233/345/272/224/345/225/206/Fal.md +172 -172
  204. package/docs/model-adaptation//344/276/233/345/272/224/345/225/206/Groq.md +121 -121
  205. package/docs/model-adaptation//344/276/233/345/272/224/345/225/206/Grsai.md +217 -217
  206. package/docs/model-adaptation//344/276/233/345/272/224/345/225/206/KIE.md +131 -131
  207. package/docs/model-adaptation//344/276/233/345/272/224/345/225/206//345/200/231/351/200/211/344/276/233/345/272/224/345/225/206/350/260/203/347/240/224-/345/233/276/347/211/207/345/267/245/345/205/267.md +151 -151
  208. package/docs/model-adaptation//344/276/233/345/272/224/345/225/206//345/277/253/351/200/237/351/200/202/351/205/215/344/276/233/345/272/224/345/225/206.md +65 -65
  209. package/docs/model-adaptation//344/276/233/345/272/224/345/225/206//346/264/276/346/254/247/344/272/221.md +147 -138
  210. package/docs/model-adaptation//344/276/233/345/272/224/345/225/206//347/201/253/345/261/261/345/274/225/346/223/216.md +181 -171
  211. package/docs/model-adaptation//344/276/233/345/272/224/345/225/206//347/231/276/347/202/274.md +237 -227
  212. package/docs/model-adaptation//344/276/233/345/272/224/345/225/206//347/241/205/345/237/272/346/265/201/345/212/250.md +110 -88
  213. package/docs/model-adaptation//344/276/233/345/272/224/345/225/206//351/255/224/346/220/255.md +207 -207
  214. package/docs/model-adaptation//346/226/207/346/241/243/351/207/207/351/233/206/346/211/213/345/206/214.md +338 -311
  215. package/docs/model-adaptation//351/200/217/350/247/206/345/217/230/346/215/242//351/200/217/350/247/206/345/217/230/346/215/242_Fal.md +59 -59
  216. package/docs//346/216/245/345/205/245/346/214/207/345/215/227/Electron.md +77 -77
  217. package/docs//346/216/245/345/205/245/346/214/207/345/215/227/Tauri.md +81 -81
  218. package/docs//346/216/245/345/205/245/346/214/207/345/215/227/UXP.md +169 -169
  219. package/docs//346/216/245/345/205/245/346/214/207/345/215/227//344/276/233/345/272/224/345/225/206/345/237/237/345/220/215.md +83 -83
  220. package/docs//346/216/245/345/205/245/346/214/207/345/215/227//351/224/231/350/257/257/345/244/204/347/220/206.md +72 -72
  221. package/examples/form-renderer/README.md +17 -17
  222. package/examples/form-renderer/cli.ts +32 -32
  223. package/examples/form-renderer/index.ts +144 -144
  224. package/examples/form-renderer/package.json +16 -16
  225. package/examples/form-renderer/tsconfig.json +14 -14
  226. package/examples/llm-chat/README.md +32 -32
  227. package/examples/llm-chat/index.ts +100 -100
  228. package/examples/llm-chat/package.json +19 -19
  229. package/examples/llm-chat/tsconfig.json +14 -14
  230. package/examples/minimal-node/README.md +31 -31
  231. package/examples/minimal-node/index.ts +138 -138
  232. package/examples/minimal-node/package.json +17 -17
  233. package/examples/minimal-node/tsconfig.json +14 -14
  234. package/package.json +252 -197
  235. package/dist/tool-packs/fal-multi-angle/models/qwen-image-edit-2509-multiple-angles.model.d.ts +0 -2
  236. package/docs/model-adaptation/Qwen-Image-Edit-2509-/345/244/232/350/247/222/345/272/246/Qwen-Image-Edit-2509-/345/244/232/350/247/222/345/272/246_Fal.md +0 -116
@@ -1,75 +1,75 @@
1
- # Kimi(Moonshot)
2
-
3
- > 核对时间:2026-08-26。信息来源见文末「原始链接索引」,均无需登录。
4
-
5
- ## 1. 摘要
6
-
7
- | 项目 | 取值 |
8
- |---|---|
9
- | `providerId`(项目内约定) | `kimi` / `moonshot` |
10
- | 对应项目 `adapter` | `openai`(Chat Completions 兼容) |
11
- | 接入优先级(本项目约定,见 [README 第三节](../README.md)) | 官方**没有** Responses API 也**没有** Anthropic Messages API,Chat Completions 是唯一路径,已实现,无需再排优先级 |
12
- | 鉴权 | `Authorization: Bearer $MOONSHOT_API_KEY` |
13
- | Base URL | `https://api.moonshot.cn/v1`(文档站已迁移到 `platform.kimi.com`,但**接口域名仍是 moonshot.cn**,不要混淆两个域名) |
14
- | 官方协议 | 仅 OpenAI Chat Completions,**没有 Responses API** |
15
-
16
- ## 2. 协议现状
17
-
18
- Kimi 官方文档全文没有出现过 `responses.create`;`platform.kimi.com/docs/llms.txt` 索引里也没有 Responses API 页面。三个消费方(助手、画布文本节点、提示词优化)走本项目现有的 `openai-compatible` 协议即可完整覆盖 Kimi,**不需要等 Responses API 适配器**。
19
-
20
- ## 3. 模型
21
-
22
- | 模型 ID | 简介 | 输入 → 输出 | 上下文 | 最大输出 |
23
- |---|---|---|---|---|
24
- | `kimi-k3` | 当前旗舰,2.8 万亿参数,KDA 混合线性注意力,全球首个开源 3 万亿级模型 | 文本、图片、视频 → 文本 | 1,048,576 tokens(1M) | 默认 131,072,最大可设 1,048,576 |
25
-
26
- 价格(元/百万 tokens):缓存命中 2、缓存未命中 20、输出 100。
27
-
28
- K3 是付费解锁模型:**充值后才能调用**,新用户认证赠送的 15 元代金券不能用于 K3。
29
-
30
- ## 4. 思考模式(始终开启,不可关闭)
31
-
32
- - 顶层 `reasoning_effort`:`low` / `high` / `max`,默认 `max`。**没有 `off`**——K2.x 系列的 `thinking` 配置迁移到 K3 时要整段删除,改传 `reasoning_effort`。
33
- - 多轮对话/工具调用时必须把 API 返回的**完整** assistant message(含 `reasoning_content` 和 `tool_calls`)原样回传,只保留 `content` 会破坏推理连续性。
34
-
35
- ## 5. 固定采样参数(不要显式传)
36
-
37
- `temperature=1.0`、`top_p=0.95`、`n=1`、`presence_penalty=0`、`frequency_penalty=0` 是官方文档明确写出的固定值,"建议不要显式传入"——如果项目通用请求构建层默认带上自己的 `temperature`/`topP`,K3 这边等于被覆盖成无效参数,属于容易被忽视的静默问题。
38
-
39
- ## 6. 视觉输入(重要限制)
40
-
41
- - 图片必须走 `image_url.url` 的 **base64 data URL**(`data:image/png;base64,...`),**不支持公网图片直链**。这与大多数供应商"直接传 URL"的默认假设相反,接入时要单独处理。
42
- - 视频走 Files API 先上传拿 `file_id`,再用 `video_url.url = "ms://<file-id>"` 引用,用完建议调用 `client.files.delete` 清理。
43
- - `content` 必须是对象数组,不能是拼好的字符串。
44
-
45
- ## 7. 结构化输出
46
-
47
- `response_format: {type: "json_schema", json_schema: {name, strict: true, schema}}`,只解析 `message.content`,不解析 `reasoning_content`。
48
-
49
- ## 8. 联网搜索(官方明确提示不建议用于生产)
50
-
51
- - 内置工具名 `$web_search`,声明方式和普通 function 不同:`type` 要写成 `"builtin_function"`(不是 `"function"`),且**只需要 `function.name`,不需要 `parameters`**:
52
- ```json
53
- { "type": "builtin_function", "function": { "name": "$web_search" } }
54
- ```
55
- `$` 前缀是 Kimi 保留给内置函数的命名空间,普通 `function` 类型的工具名不允许出现 `$`。
56
- - 执行方式:模型返回 `finish_reason=tool_calls` 且 `tool_call.function.name="$web_search"` 时,调用方**原样把 `arguments` 塞回一条 `role=tool` 消息**即可,不需要真的执行搜索——搜索本身由 Kimi 服务端完成。
57
- - 价格:¥0.03/次(只在 `finish_reason=tool_calls` 且工具名是 `$web_search` 时收取;如果中途放弃 `tool_calls` 循环,只收这笔工具调用费,不收搜索内容占用的 token 费)。搜索结果本身也会计入下一次请求的 `prompt_tokens`,可从 `tool_call.function.arguments.usage.total_tokens` 读到这部分用量。
58
- - **官方定价页原文警告**:「联网搜索(`web_search`)正在更新升级中,近期不建议使用该功能,当前文档已经过时」。项目侧如果要接这个能力,应该默认关闭并在 UI 上标注"实验性/暂不稳定",而不是当作可靠能力直接暴露。
59
- - 官方更推荐的替代路径是走 Formula 官方工具通道(标准 OpenAI `function` 类型,见「官方工具」文档),但同样标注"联网搜索工具正在更新,近期不建议使用"。
60
-
61
- ## 9. 动态加载工具(K3 独有能力)
62
-
63
- 把完整工具定义放进一条 `role=system` 且不含 `content`、只含 `tools` 字段的消息里,可以从对话中间某一轮开始动态生效,不需要在最初就声明全部工具。用于工具数量多、想省 token 或提升工具选择准确率的场景。
64
-
65
- ## 原始链接索引(均无需登录)
66
-
67
- - [Kimi API 概览](https://platform.kimi.com/docs/overview)
68
- - [Kimi K3 快速开始](https://platform.kimi.com/docs/guide/kimi-k3-quickstart)
69
- - [推理强度](https://platform.kimi.com/docs/guide/use-reasoning-effort)
70
- - [使用 Kimi API 的联网搜索功能](https://platform.kimi.com/docs/guide/use-web-search)
71
- - [如何在 Kimi API 中使用官方工具](https://platform.kimi.com/docs/guide/use-official-tools)
72
- - [Kimi K3 定价](https://platform.kimi.com/docs/pricing/chat-k3)
73
- - [联网搜索定价](https://platform.kimi.com/docs/pricing/tools)
74
- - [使用思考模式](https://platform.kimi.com/docs/guide/use-thinking-models)
75
- - [Kimi 文档全量索引](https://platform.kimi.com/docs/llms.txt)
1
+ # Kimi(Moonshot)
2
+
3
+ > 核对时间:2026-08-26。信息来源见文末「原始链接索引」,均无需登录。
4
+
5
+ ## 1. 摘要
6
+
7
+ | 项目 | 取值 |
8
+ |---|---|
9
+ | `providerId`(项目内约定) | `kimi` / `moonshot` |
10
+ | 对应项目 `adapter` | `openai`(Chat Completions 兼容) |
11
+ | 接入优先级(本项目约定,见 [README 第三节](../README.md)) | 官方**没有** Responses API 也**没有** Anthropic Messages API,Chat Completions 是唯一路径,已实现,无需再排优先级 |
12
+ | 鉴权 | `Authorization: Bearer $MOONSHOT_API_KEY` |
13
+ | Base URL | `https://api.moonshot.cn/v1`(文档站已迁移到 `platform.kimi.com`,但**接口域名仍是 moonshot.cn**,不要混淆两个域名) |
14
+ | 官方协议 | 仅 OpenAI Chat Completions,**没有 Responses API** |
15
+
16
+ ## 2. 协议现状
17
+
18
+ Kimi 官方文档全文没有出现过 `responses.create`;`platform.kimi.com/docs/llms.txt` 索引里也没有 Responses API 页面。三个消费方(助手、画布文本节点、提示词优化)走本项目现有的 `openai-compatible` 协议即可完整覆盖 Kimi,**不需要等 Responses API 适配器**。
19
+
20
+ ## 3. 模型
21
+
22
+ | 模型 ID | 简介 | 输入 → 输出 | 上下文 | 最大输出 |
23
+ |---|---|---|---|---|
24
+ | `kimi-k3` | 当前旗舰,2.8 万亿参数,KDA 混合线性注意力,全球首个开源 3 万亿级模型 | 文本、图片、视频 → 文本 | 1,048,576 tokens(1M) | 默认 131,072,最大可设 1,048,576 |
25
+
26
+ 价格(元/百万 tokens):缓存命中 2、缓存未命中 20、输出 100。
27
+
28
+ K3 是付费解锁模型:**充值后才能调用**,新用户认证赠送的 15 元代金券不能用于 K3。
29
+
30
+ ## 4. 思考模式(始终开启,不可关闭)
31
+
32
+ - 顶层 `reasoning_effort`:`low` / `high` / `max`,默认 `max`。**没有 `off`**——K2.x 系列的 `thinking` 配置迁移到 K3 时要整段删除,改传 `reasoning_effort`。
33
+ - 多轮对话/工具调用时必须把 API 返回的**完整** assistant message(含 `reasoning_content` 和 `tool_calls`)原样回传,只保留 `content` 会破坏推理连续性。
34
+
35
+ ## 5. 固定采样参数(不要显式传)
36
+
37
+ `temperature=1.0`、`top_p=0.95`、`n=1`、`presence_penalty=0`、`frequency_penalty=0` 是官方文档明确写出的固定值,"建议不要显式传入"——如果项目通用请求构建层默认带上自己的 `temperature`/`topP`,K3 这边等于被覆盖成无效参数,属于容易被忽视的静默问题。
38
+
39
+ ## 6. 视觉输入(重要限制)
40
+
41
+ - 图片必须走 `image_url.url` 的 **base64 data URL**(`data:image/png;base64,...`),**不支持公网图片直链**。这与大多数供应商"直接传 URL"的默认假设相反,接入时要单独处理。
42
+ - 视频走 Files API 先上传拿 `file_id`,再用 `video_url.url = "ms://<file-id>"` 引用,用完建议调用 `client.files.delete` 清理。
43
+ - `content` 必须是对象数组,不能是拼好的字符串。
44
+
45
+ ## 7. 结构化输出
46
+
47
+ `response_format: {type: "json_schema", json_schema: {name, strict: true, schema}}`,只解析 `message.content`,不解析 `reasoning_content`。
48
+
49
+ ## 8. 联网搜索(官方明确提示不建议用于生产)
50
+
51
+ - 内置工具名 `$web_search`,声明方式和普通 function 不同:`type` 要写成 `"builtin_function"`(不是 `"function"`),且**只需要 `function.name`,不需要 `parameters`**:
52
+ ```json
53
+ { "type": "builtin_function", "function": { "name": "$web_search" } }
54
+ ```
55
+ `$` 前缀是 Kimi 保留给内置函数的命名空间,普通 `function` 类型的工具名不允许出现 `$`。
56
+ - 执行方式:模型返回 `finish_reason=tool_calls` 且 `tool_call.function.name="$web_search"` 时,调用方**原样把 `arguments` 塞回一条 `role=tool` 消息**即可,不需要真的执行搜索——搜索本身由 Kimi 服务端完成。
57
+ - 价格:¥0.03/次(只在 `finish_reason=tool_calls` 且工具名是 `$web_search` 时收取;如果中途放弃 `tool_calls` 循环,只收这笔工具调用费,不收搜索内容占用的 token 费)。搜索结果本身也会计入下一次请求的 `prompt_tokens`,可从 `tool_call.function.arguments.usage.total_tokens` 读到这部分用量。
58
+ - **官方定价页原文警告**:「联网搜索(`web_search`)正在更新升级中,近期不建议使用该功能,当前文档已经过时」。项目侧如果要接这个能力,应该默认关闭并在 UI 上标注"实验性/暂不稳定",而不是当作可靠能力直接暴露。
59
+ - 官方更推荐的替代路径是走 Formula 官方工具通道(标准 OpenAI `function` 类型,见「官方工具」文档),但同样标注"联网搜索工具正在更新,近期不建议使用"。
60
+
61
+ ## 9. 动态加载工具(K3 独有能力)
62
+
63
+ 把完整工具定义放进一条 `role=system` 且不含 `content`、只含 `tools` 字段的消息里,可以从对话中间某一轮开始动态生效,不需要在最初就声明全部工具。用于工具数量多、想省 token 或提升工具选择准确率的场景。
64
+
65
+ ## 原始链接索引(均无需登录)
66
+
67
+ - [Kimi API 概览](https://platform.kimi.com/docs/overview)
68
+ - [Kimi K3 快速开始](https://platform.kimi.com/docs/guide/kimi-k3-quickstart)
69
+ - [推理强度](https://platform.kimi.com/docs/guide/use-reasoning-effort)
70
+ - [使用 Kimi API 的联网搜索功能](https://platform.kimi.com/docs/guide/use-web-search)
71
+ - [如何在 Kimi API 中使用官方工具](https://platform.kimi.com/docs/guide/use-official-tools)
72
+ - [Kimi K3 定价](https://platform.kimi.com/docs/pricing/chat-k3)
73
+ - [联网搜索定价](https://platform.kimi.com/docs/pricing/tools)
74
+ - [使用思考模式](https://platform.kimi.com/docs/guide/use-thinking-models)
75
+ - [Kimi 文档全量索引](https://platform.kimi.com/docs/llms.txt)
@@ -1,84 +1,84 @@
1
- # MiniMax
2
-
3
- > 核对时间:2026-08-26。信息来源见文末「原始链接索引」,均无需登录。
4
-
5
- ## 1. 摘要
6
-
7
- | 项目 | 取值 |
8
- |---|---|
9
- | `providerId`(项目内约定) | `minimax` |
10
- | 对应项目 `adapter` | `openai`(Chat Completions / Responses 均可)。官方推荐的 Anthropic 路径在本项目没有可选的 adapter——那个选项从未接通,已删除,见下方"接入优先级" |
11
- | 官方协议 | Anthropic Messages(官方推荐)、OpenAI Chat Completions、OpenAI Responses API 三选一,同域名不同路径 |
12
- | 接入优先级(本项目约定,见 [README 第三节](../README.md)) | MiniMax-M3 已默认走 **Responses API** → Chat Completions 兼容;Anthropic 暂不实现、不显示 |
13
-
14
- MiniMax 是本次调研 7 家里**唯一把 Anthropic 协议列为默认推荐接入方式**的供应商——官方"通过 SDK 接入"快速开始页第一步就是装 `anthropic` SDK,不是 `openai`;原因是 Anthropic 协议能拿到原生 `thinking` 块和 interleaved thinking,Chat/Responses 路径下这部分体验打折扣。**但本项目按统一的协议接入优先级执行,不因为某一家官方推荐就单独提高 Anthropic 的实现顺序**——MiniMax 官方文档自己也说 Chat Completions 与 Responses 两条路径"功能对等,只是拿不到原生 thinking 块",所以 Responses API 仍然是够用的第一选择。
15
-
16
- ## 2. Base URL
17
-
18
- | 协议 | Base URL |
19
- |---|---|
20
- | Anthropic Messages(推荐) | `https://api.minimaxi.com/anthropic` |
21
- | OpenAI Chat Completions | `https://api.minimaxi.com/v1`(路径 `/chat/completions`) |
22
- | OpenAI Responses API | `https://api.minimaxi.com/v1`(路径 `/responses`) |
23
-
24
- ## 3. 模型清单
25
-
26
- | 模型 ID | 简介 | 输入 → 输出 | 上下文 | 最大输出 |
27
- |---|---|---|---|---|
28
- | `MiniMax-M3` | 当前最新旗舰,原生多模态,1M 上下文,面向 Frontier Coding、复杂推理、Agent | 文本、图片、视频 → 文本 | 1,000,000 | 官方建议 131,072,硬上限 524,288 |
29
-
30
- `MiniMax-M2.7`(含 `-highspeed`)仍在正常提供服务,属于上一代仍在售的并行线,不是 M3 的档位变体;`M2.5`/`M2.1`/`M2` 系列已归入官方"历史模型"分组。
31
-
32
- ### 价格(元/百万 tokens,当前促销"永久五折"后)
33
-
34
- | 输入长度 | 输入 | 输出 | 缓存读取 |
35
- |---|---|---|---|
36
- | ≤ 512K | 2.10 | 8.40 | 0.42 |
37
- | > 512K | 4.20 | 16.80 | 0.84 |
38
-
39
- `service_tier: "priority"` 优先服务档按上表 1.5 倍计费,可换取更快响应与更低失败率。
40
-
41
- ## 4. Anthropic 协议接入要点(官方推荐路径,但本项目最低优先级,仅供顺手接入时参考)
42
-
43
- ```python
44
- import anthropic
45
- client = anthropic.Anthropic(base_url="https://api.minimaxi.com/anthropic", api_key="<KEY>")
46
- message = client.messages.create(model="MiniMax-M3", max_tokens=1000, messages=[...])
47
- for block in message.content:
48
- if block.type == "thinking": ... # 原生 thinking 块
49
- elif block.type == "text": ...
50
- ```
51
-
52
- - 支持 `thinking` 内容块和 interleaved thinking(推理与工具调用交替)——这是官方文档反复强调的 M3 核心卖点,Chat Completions 路径下只能拿到扁平化的 `reasoning_content` 字符串,信息密度不如原生 `thinking` 块。
53
- - 官方 Mini-Agent 示例项目就是用 Anthropic 协议 + interleaved thinking 演示"如何用 M3 搭 Agent"的最佳实践,可作为项目内 Agent 集成的参考实现。
54
-
55
- ## 5. 联网搜索(Server Tools,Beta,两个协议都支持——这与此前认知不同)
56
-
57
- **更正**:此前认为 MiniMax 的 `web_search` 只在 Anthropic Messages 文档出现,OpenAI/Responses 路径不支持——这是过时信息。**官方当前 Server Tools 文档明确写:Anthropic Messages API 和 OpenAI Responses API 都支持**,只是工具类型标识不同:
58
-
59
- | 接口 | 工具声明 |
60
- |---|---|
61
- | Anthropic Messages API | `{"type": "web_search_20250305", "name": "web_search"}` |
62
- | OpenAI Responses API | `{"type": "web_search"}` |
63
-
64
- 服务端工具(Server Tools)与项目自研的 function-calling 工具是两套机制:模型在 MiniMax 服务端自动执行搜索并把结果直接嵌进响应,调用方不需要多轮回传 `tool_result`,一次请求内完成。
65
-
66
- - Anthropic 路径响应里会依次出现 `text`(引导语)→ `server_tool_use`(`name=web_search`, `input.query`)→ `web_search_tool_result`(含 `title`/`url`/`page_age`/`content`)→ `text`(最终答案),直接读最后一个 `text` 块即可。
67
- - Responses API 路径的 `output` 数组包含 `web_search_call`(含 `action.query`)和 `message`,可以直接读顶层聚合字段 `output_text`。
68
- - **纯 Chat Completions(`/v1/chat/completions`)不支持这个工具**——只有 Anthropic Messages 和 Responses 两条路径能用,选型时要注意。
69
- - 价格 ¥0.03/次;处于 **Beta 阶段**,官方提示行为与参数可能随时调整,服务端全程执行导致单次请求耗时可能更长,客户端超时要放宽。
70
-
71
- ## 6. 兼容性说明
72
-
73
- - OpenAI Chat Completions 与 Anthropic Messages 是"等价的两套非流式样例",官方文档明确"如果你的项目已经接入 OpenAI SDK,把 base_url 和 model 换成 MiniMax 的值即可直接复用,无需迁移 SDK"——即两条路径功能对等(除服务端工具的可用面略有差异),选哪个更多是团队已有技术栈的问题,不是能力取舍。这也是本项目仍把 Responses API 排在 Anthropic 前面的依据:不用 Anthropic 也不会丢失核心能力,只是拿不到原生 `thinking` 块和 interleaved thinking 这部分体验加成。
74
- - `LlmProviderConfig.adapter` 只保留内部供应商特性标识;协议由 `apiProtocol` 和预制模型矩阵决定。Anthropic 虽是 MiniMax 官方推荐路径,但项目暂不实现、不显示;MiniMax-M3 由 SDK 自动走 Responses。
75
-
76
- ## 原始链接索引(均无需登录)
77
-
78
- - [模型概览](https://platform.minimaxi.com/docs/guides/models-intro)
79
- - [模型调用(URL 配置、双协议示例)](https://platform.minimaxi.com/docs/guides/text-generation)
80
- - [通过 SDK 接入(Anthropic SDK 快速开始)](https://platform.minimaxi.com/docs/guides/quickstart-sdk)
81
- - [服务端工具(Server Tools / web_search)](https://platform.minimaxi.com/docs/guides/server-tools)
82
- - [工具使用 & 交错思维链](https://platform.minimaxi.com/docs/guides/text-m3-function-call)
83
- - [按量计费](https://platform.minimaxi.com/docs/guides/pricing-paygo)
84
- - [MiniMax 文档全量索引](https://platform.minimaxi.com/docs/llms.txt)
1
+ # MiniMax
2
+
3
+ > 核对时间:2026-08-26。信息来源见文末「原始链接索引」,均无需登录。
4
+
5
+ ## 1. 摘要
6
+
7
+ | 项目 | 取值 |
8
+ |---|---|
9
+ | `providerId`(项目内约定) | `minimax` |
10
+ | 对应项目 `adapter` | `openai`(Chat Completions / Responses 均可)。官方推荐的 Anthropic 路径在本项目没有可选的 adapter——那个选项从未接通,已删除,见下方"接入优先级" |
11
+ | 官方协议 | Anthropic Messages(官方推荐)、OpenAI Chat Completions、OpenAI Responses API 三选一,同域名不同路径 |
12
+ | 接入优先级(本项目约定,见 [README 第三节](../README.md)) | MiniMax-M3 已默认走 **Responses API** → Chat Completions 兼容;Anthropic 暂不实现、不显示 |
13
+
14
+ MiniMax 是本次调研 7 家里**唯一把 Anthropic 协议列为默认推荐接入方式**的供应商——官方"通过 SDK 接入"快速开始页第一步就是装 `anthropic` SDK,不是 `openai`;原因是 Anthropic 协议能拿到原生 `thinking` 块和 interleaved thinking,Chat/Responses 路径下这部分体验打折扣。**但本项目按统一的协议接入优先级执行,不因为某一家官方推荐就单独提高 Anthropic 的实现顺序**——MiniMax 官方文档自己也说 Chat Completions 与 Responses 两条路径"功能对等,只是拿不到原生 thinking 块",所以 Responses API 仍然是够用的第一选择。
15
+
16
+ ## 2. Base URL
17
+
18
+ | 协议 | Base URL |
19
+ |---|---|
20
+ | Anthropic Messages(推荐) | `https://api.minimaxi.com/anthropic` |
21
+ | OpenAI Chat Completions | `https://api.minimaxi.com/v1`(路径 `/chat/completions`) |
22
+ | OpenAI Responses API | `https://api.minimaxi.com/v1`(路径 `/responses`) |
23
+
24
+ ## 3. 模型清单
25
+
26
+ | 模型 ID | 简介 | 输入 → 输出 | 上下文 | 最大输出 |
27
+ |---|---|---|---|---|
28
+ | `MiniMax-M3` | 当前最新旗舰,原生多模态,1M 上下文,面向 Frontier Coding、复杂推理、Agent | 文本、图片、视频 → 文本 | 1,000,000 | 官方建议 131,072,硬上限 524,288 |
29
+
30
+ `MiniMax-M2.7`(含 `-highspeed`)仍在正常提供服务,属于上一代仍在售的并行线,不是 M3 的档位变体;`M2.5`/`M2.1`/`M2` 系列已归入官方"历史模型"分组。
31
+
32
+ ### 价格(元/百万 tokens,当前促销"永久五折"后)
33
+
34
+ | 输入长度 | 输入 | 输出 | 缓存读取 |
35
+ |---|---|---|---|
36
+ | ≤ 512K | 2.10 | 8.40 | 0.42 |
37
+ | > 512K | 4.20 | 16.80 | 0.84 |
38
+
39
+ `service_tier: "priority"` 优先服务档按上表 1.5 倍计费,可换取更快响应与更低失败率。
40
+
41
+ ## 4. Anthropic 协议接入要点(官方推荐路径,但本项目最低优先级,仅供顺手接入时参考)
42
+
43
+ ```python
44
+ import anthropic
45
+ client = anthropic.Anthropic(base_url="https://api.minimaxi.com/anthropic", api_key="<KEY>")
46
+ message = client.messages.create(model="MiniMax-M3", max_tokens=1000, messages=[...])
47
+ for block in message.content:
48
+ if block.type == "thinking": ... # 原生 thinking 块
49
+ elif block.type == "text": ...
50
+ ```
51
+
52
+ - 支持 `thinking` 内容块和 interleaved thinking(推理与工具调用交替)——这是官方文档反复强调的 M3 核心卖点,Chat Completions 路径下只能拿到扁平化的 `reasoning_content` 字符串,信息密度不如原生 `thinking` 块。
53
+ - 官方 Mini-Agent 示例项目就是用 Anthropic 协议 + interleaved thinking 演示"如何用 M3 搭 Agent"的最佳实践,可作为项目内 Agent 集成的参考实现。
54
+
55
+ ## 5. 联网搜索(Server Tools,Beta,两个协议都支持——这与此前认知不同)
56
+
57
+ **更正**:此前认为 MiniMax 的 `web_search` 只在 Anthropic Messages 文档出现,OpenAI/Responses 路径不支持——这是过时信息。**官方当前 Server Tools 文档明确写:Anthropic Messages API 和 OpenAI Responses API 都支持**,只是工具类型标识不同:
58
+
59
+ | 接口 | 工具声明 |
60
+ |---|---|
61
+ | Anthropic Messages API | `{"type": "web_search_20250305", "name": "web_search"}` |
62
+ | OpenAI Responses API | `{"type": "web_search"}` |
63
+
64
+ 服务端工具(Server Tools)与项目自研的 function-calling 工具是两套机制:模型在 MiniMax 服务端自动执行搜索并把结果直接嵌进响应,调用方不需要多轮回传 `tool_result`,一次请求内完成。
65
+
66
+ - Anthropic 路径响应里会依次出现 `text`(引导语)→ `server_tool_use`(`name=web_search`, `input.query`)→ `web_search_tool_result`(含 `title`/`url`/`page_age`/`content`)→ `text`(最终答案),直接读最后一个 `text` 块即可。
67
+ - Responses API 路径的 `output` 数组包含 `web_search_call`(含 `action.query`)和 `message`,可以直接读顶层聚合字段 `output_text`。
68
+ - **纯 Chat Completions(`/v1/chat/completions`)不支持这个工具**——只有 Anthropic Messages 和 Responses 两条路径能用,选型时要注意。
69
+ - 价格 ¥0.03/次;处于 **Beta 阶段**,官方提示行为与参数可能随时调整,服务端全程执行导致单次请求耗时可能更长,客户端超时要放宽。
70
+
71
+ ## 6. 兼容性说明
72
+
73
+ - OpenAI Chat Completions 与 Anthropic Messages 是"等价的两套非流式样例",官方文档明确"如果你的项目已经接入 OpenAI SDK,把 base_url 和 model 换成 MiniMax 的值即可直接复用,无需迁移 SDK"——即两条路径功能对等(除服务端工具的可用面略有差异),选哪个更多是团队已有技术栈的问题,不是能力取舍。这也是本项目仍把 Responses API 排在 Anthropic 前面的依据:不用 Anthropic 也不会丢失核心能力,只是拿不到原生 `thinking` 块和 interleaved thinking 这部分体验加成。
74
+ - `LlmProviderConfig.adapter` 只保留内部供应商特性标识;协议由 `apiProtocol` 和预制模型矩阵决定。Anthropic 虽是 MiniMax 官方推荐路径,但项目暂不实现、不显示;MiniMax-M3 由 SDK 自动走 Responses。
75
+
76
+ ## 原始链接索引(均无需登录)
77
+
78
+ - [模型概览](https://platform.minimaxi.com/docs/guides/models-intro)
79
+ - [模型调用(URL 配置、双协议示例)](https://platform.minimaxi.com/docs/guides/text-generation)
80
+ - [通过 SDK 接入(Anthropic SDK 快速开始)](https://platform.minimaxi.com/docs/guides/quickstart-sdk)
81
+ - [服务端工具(Server Tools / web_search)](https://platform.minimaxi.com/docs/guides/server-tools)
82
+ - [工具使用 & 交错思维链](https://platform.minimaxi.com/docs/guides/text-m3-function-call)
83
+ - [按量计费](https://platform.minimaxi.com/docs/guides/pricing-paygo)
84
+ - [MiniMax 文档全量索引](https://platform.minimaxi.com/docs/llms.txt)
@@ -1,85 +1,85 @@
1
- # 小米 MiMo
2
-
3
- > 核对时间:2026-08-26。信息来源见文末「原始链接索引」,均无需登录(文档站是 SPA,curl 拿不到正文,用浏览器渲染后取 `innerText`,见采集手册)。
4
-
5
- ## 1. 摘要
6
-
7
- | 项目 | 取值 |
8
- |---|---|
9
- | `providerId`(项目内约定,代码中已存在) | `mimo` |
10
- | 对应项目 `adapter` | `openai`(Chat Completions);官方也提供 Anthropic Messages API |
11
- | 官方协议 | OpenAI Chat Completions + **Anthropic Messages API**,**没有 Responses API** |
12
- | 接入优先级(本项目约定,见 [README 第三节](../README.md)) | 官方**没有** Responses API;Chat Completions 是唯一已实现且能用联网搜索的路径;Anthropic **最低优先级**,且接了也拿不到联网搜索(第 7 节) |
13
- | 已知协议怪癖(代码里已实现) | 额外发送 `api-key` 认证头;请求体 `max_tokens` 要改名成 `max_completion_tokens`,见 `packages/ai-sdk/src/llm/providerProtocol.ts` |
14
-
15
- ## 2. Base URL
16
-
17
- | 用法 | OpenAI 兼容 | Anthropic 兼容 |
18
- |---|---|---|
19
- | 按量计费 | `https://api.xiaomimimo.com/v1` | `https://api.xiaomimimo.com/anthropic` |
20
- | Token Plan(订阅套餐) | `https://token-plan-cn.xiaomimimo.com/v1` | `https://token-plan-cn.xiaomimimo.com/anthropic` |
21
-
22
- 两种用法的 Base URL 和 API Key 都不同,Token Plan 走独立域名——如果项目未来要支持订阅制账号,不能简单复用按量计费的 Base URL。
23
-
24
- ## 3. 认证怪癖(已在代码里处理,供交叉核对)
25
-
26
- 官方文档给出的 Header 名是 `api-key`(不是 `Authorization: Bearer`):
27
-
28
- ```
29
- curl --header "api-key: $MIMO_API_KEY" ...
30
- ```
31
-
32
- 这与项目 `providerProtocol.ts` 里 `PROVIDER_EXTRA_AUTH_HEADERS: { mimo: 'api-key' }` 的注释描述完全一致——代码是**额外补发**这个头而不是替换 `Authorization`,因为通用 OpenAI 兼容实现默认发的是 Bearer,MiMo 网关只认它认识的那个头,两个头同时发是安全的。
33
-
34
- ## 4. 模型清单
35
-
36
- | 模型 ID | 简介 | 输入 → 输出 | 上下文 / 最大输出 | RPM / TPM |
37
- |---|---|---|---|---|
38
- | `mimo-v2.5-pro` | 复杂推理、深度分析、长文档场景 | 文本 → 文本 | 1M / 128K | 100 / 10M |
39
- | `mimo-v2.5` | 全模态理解,图片/音频/视频场景 | 文本、图片、音频、视频 → 文本 | 1M / 128K | — |
40
-
41
- 能力标签(官方模型列表页原文):两个模型都标注支持 Deep Thinking、Streaming、Function Call、Structured Output、**Web Search**;`mimo-v2.5` 额外标注 Full-modal Understanding。
42
-
43
- `mimo-v2-pro`/`mimo-v2-omni`/`mimo-v2-flash`/`mimo-v2-tts` 已于 2026-06-30 正式下线,不要再作为可选模型出现在任何清单里。
44
-
45
- ### 价格(国内,元/百万 tokens)
46
-
47
- | 模型 | 缓存命中 | 缓存未命中 | 输出 |
48
- |---|---|---|---|
49
- | `mimo-v2.5-pro` | 0.025 | 3.00 | 6.00 |
50
- | `mimo-v2.5` | 0.02 | 1.00 | 2.00 |
51
-
52
- 海外价格另有独立美元档(见原始链接),缓存写入限时免费。
53
-
54
- ## 5. `max_completion_tokens` 怪癖(已在代码里处理,供交叉核对)
55
-
56
- 官方 Quick Start 示例请求体直接用的就是 `max_completion_tokens`,不是通用 OpenAI 实现默认的 `max_tokens`。这与项目 `applyProviderRequestBodyQuirks` 的注释一致——实测发 `max_tokens` 时六项能力探测**全部返回 400 `Invalid request parameters`**,包括最基础的纯文本对话,说明这不是能力缺失,是请求字段本身不被接受。
57
-
58
- ## 6. 思考模式的多轮回传
59
-
60
- 思考模式下,`assistant` 消息会带 `reasoning_content` 字段(与 `content`/`tool_calls` 并列)。多轮工具调用场景,官方建议把历史轮次的 `reasoning_content` 也保留在 `messages` 里回传,以获得最佳效果——这点和 Kimi K3、GLM 的"必须回传完整 assistant message"是同一类要求,三家风格接近,可以复用同一套"assistant message 原样回传"逻辑,不用分别实现。
61
-
62
- ## 7. 联网搜索(需要先在控制台激活插件,且只支持 Chat Completions)
63
-
64
- - **前置步骤**:控制台 → 插件管理,先激活 Web Search 插件,否则 API 侧声明了 `tools` 也不会生效。
65
- - 声明方式(比 GLM 简单,扁平结构而非嵌套):
66
- ```json
67
- {
68
- "type": "web_search",
69
- "max_keyword": 3,
70
- "force_search": true,
71
- "limit": 1,
72
- "user_location": { "type": "approximate", "country": "China", "region": "Hubei", "city": "Wuhan" }
73
- }
74
- ```
75
- - **官方原文明确写"其他 API 协议暂不支持"**——即联网搜索只能走 OpenAI Chat Completions,Anthropic Messages 路径下不可用,即便两个模型基础对话都支持 Anthropic 协议。
76
- - 响应里搜索来源以 `annotations: [{type:"url_citation", url, title, ...}]` 形式附在 `message` 里,usage 里会带 `web_search_usage: {tool_usage, page_usage}`。
77
- - 有 5 分钟缓存期:刚开关搜索插件后 5 分钟内可能不会立即生效,排查"为什么没触发搜索"时先看这一条。
78
- - 价格:国内 ¥16/1000 次、海外 $5/1000 次;一轮搜索按 `max_keyword` 并发展开多个关键词,会产生多次调用计费;网页内容本身按标准 token 单价计入 `prompt_tokens`。
79
-
80
- ## 原始链接索引(均无需登录,需浏览器渲染)
81
-
82
- - [模型列表](https://mimo.mi.com/docs/quick-start/summary/model)
83
- - [首次 API 调用(含 OpenAI/Anthropic 双协议示例)](https://mimo.mi.com/docs/quick-start/summary/first-api-call)
84
- - [联网搜索](https://mimo.mi.com/docs/en-US/quick-start/usage-guide/text-generation/tool-calling/web-search)
85
- - [按量计费价格](https://mimo.mi.com/docs/en-US/price/pay-as-you-go)
1
+ # 小米 MiMo
2
+
3
+ > 核对时间:2026-08-26。信息来源见文末「原始链接索引」,均无需登录(文档站是 SPA,curl 拿不到正文,用浏览器渲染后取 `innerText`,见采集手册)。
4
+
5
+ ## 1. 摘要
6
+
7
+ | 项目 | 取值 |
8
+ |---|---|
9
+ | `providerId`(项目内约定,代码中已存在) | `mimo` |
10
+ | 对应项目 `adapter` | `openai`(Chat Completions);官方也提供 Anthropic Messages API |
11
+ | 官方协议 | OpenAI Chat Completions + **Anthropic Messages API**,**没有 Responses API** |
12
+ | 接入优先级(本项目约定,见 [README 第三节](../README.md)) | 官方**没有** Responses API;Chat Completions 是唯一已实现且能用联网搜索的路径;Anthropic **最低优先级**,且接了也拿不到联网搜索(第 7 节) |
13
+ | 已知协议怪癖(代码里已实现) | 额外发送 `api-key` 认证头;请求体 `max_tokens` 要改名成 `max_completion_tokens`,见 `packages/ai-sdk/src/llm/providerProtocol.ts` |
14
+
15
+ ## 2. Base URL
16
+
17
+ | 用法 | OpenAI 兼容 | Anthropic 兼容 |
18
+ |---|---|---|
19
+ | 按量计费 | `https://api.xiaomimimo.com/v1` | `https://api.xiaomimimo.com/anthropic` |
20
+ | Token Plan(订阅套餐) | `https://token-plan-cn.xiaomimimo.com/v1` | `https://token-plan-cn.xiaomimimo.com/anthropic` |
21
+
22
+ 两种用法的 Base URL 和 API Key 都不同,Token Plan 走独立域名——如果项目未来要支持订阅制账号,不能简单复用按量计费的 Base URL。
23
+
24
+ ## 3. 认证怪癖(已在代码里处理,供交叉核对)
25
+
26
+ 官方文档给出的 Header 名是 `api-key`(不是 `Authorization: Bearer`):
27
+
28
+ ```
29
+ curl --header "api-key: $MIMO_API_KEY" ...
30
+ ```
31
+
32
+ 这与项目 `providerProtocol.ts` 里 `PROVIDER_EXTRA_AUTH_HEADERS: { mimo: 'api-key' }` 的注释描述完全一致——代码是**额外补发**这个头而不是替换 `Authorization`,因为通用 OpenAI 兼容实现默认发的是 Bearer,MiMo 网关只认它认识的那个头,两个头同时发是安全的。
33
+
34
+ ## 4. 模型清单
35
+
36
+ | 模型 ID | 简介 | 输入 → 输出 | 上下文 / 最大输出 | RPM / TPM |
37
+ |---|---|---|---|---|
38
+ | `mimo-v2.5-pro` | 复杂推理、深度分析、长文档场景 | 文本 → 文本 | 1M / 128K | 100 / 10M |
39
+ | `mimo-v2.5` | 全模态理解,图片/音频/视频场景 | 文本、图片、音频、视频 → 文本 | 1M / 128K | — |
40
+
41
+ 能力标签(官方模型列表页原文):两个模型都标注支持 Deep Thinking、Streaming、Function Call、Structured Output、**Web Search**;`mimo-v2.5` 额外标注 Full-modal Understanding。
42
+
43
+ `mimo-v2-pro`/`mimo-v2-omni`/`mimo-v2-flash`/`mimo-v2-tts` 已于 2026-06-30 正式下线,不要再作为可选模型出现在任何清单里。
44
+
45
+ ### 价格(国内,元/百万 tokens)
46
+
47
+ | 模型 | 缓存命中 | 缓存未命中 | 输出 |
48
+ |---|---|---|---|
49
+ | `mimo-v2.5-pro` | 0.025 | 3.00 | 6.00 |
50
+ | `mimo-v2.5` | 0.02 | 1.00 | 2.00 |
51
+
52
+ 海外价格另有独立美元档(见原始链接),缓存写入限时免费。
53
+
54
+ ## 5. `max_completion_tokens` 怪癖(已在代码里处理,供交叉核对)
55
+
56
+ 官方 Quick Start 示例请求体直接用的就是 `max_completion_tokens`,不是通用 OpenAI 实现默认的 `max_tokens`。这与项目 `applyProviderRequestBodyQuirks` 的注释一致——实测发 `max_tokens` 时六项能力探测**全部返回 400 `Invalid request parameters`**,包括最基础的纯文本对话,说明这不是能力缺失,是请求字段本身不被接受。
57
+
58
+ ## 6. 思考模式的多轮回传
59
+
60
+ 思考模式下,`assistant` 消息会带 `reasoning_content` 字段(与 `content`/`tool_calls` 并列)。多轮工具调用场景,官方建议把历史轮次的 `reasoning_content` 也保留在 `messages` 里回传,以获得最佳效果——这点和 Kimi K3、GLM 的"必须回传完整 assistant message"是同一类要求,三家风格接近,可以复用同一套"assistant message 原样回传"逻辑,不用分别实现。
61
+
62
+ ## 7. 联网搜索(需要先在控制台激活插件,且只支持 Chat Completions)
63
+
64
+ - **前置步骤**:控制台 → 插件管理,先激活 Web Search 插件,否则 API 侧声明了 `tools` 也不会生效。
65
+ - 声明方式(比 GLM 简单,扁平结构而非嵌套):
66
+ ```json
67
+ {
68
+ "type": "web_search",
69
+ "max_keyword": 3,
70
+ "force_search": true,
71
+ "limit": 1,
72
+ "user_location": { "type": "approximate", "country": "China", "region": "Hubei", "city": "Wuhan" }
73
+ }
74
+ ```
75
+ - **官方原文明确写"其他 API 协议暂不支持"**——即联网搜索只能走 OpenAI Chat Completions,Anthropic Messages 路径下不可用,即便两个模型基础对话都支持 Anthropic 协议。
76
+ - 响应里搜索来源以 `annotations: [{type:"url_citation", url, title, ...}]` 形式附在 `message` 里,usage 里会带 `web_search_usage: {tool_usage, page_usage}`。
77
+ - 有 5 分钟缓存期:刚开关搜索插件后 5 分钟内可能不会立即生效,排查"为什么没触发搜索"时先看这一条。
78
+ - 价格:国内 ¥16/1000 次、海外 $5/1000 次;一轮搜索按 `max_keyword` 并发展开多个关键词,会产生多次调用计费;网页内容本身按标准 token 单价计入 `prompt_tokens`。
79
+
80
+ ## 原始链接索引(均无需登录,需浏览器渲染)
81
+
82
+ - [模型列表](https://mimo.mi.com/docs/quick-start/summary/model)
83
+ - [首次 API 调用(含 OpenAI/Anthropic 双协议示例)](https://mimo.mi.com/docs/quick-start/summary/first-api-call)
84
+ - [联网搜索](https://mimo.mi.com/docs/en-US/quick-start/usage-guide/text-generation/tool-calling/web-search)
85
+ - [按量计费价格](https://mimo.mi.com/docs/en-US/price/pay-as-you-go)