@chatcode/cco-llm-chatcode-config 0.1.0
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/LICENSE +21 -0
- package/README.md +124 -0
- package/README.zh.md +133 -0
- package/cordis.patch.yml +4 -0
- package/cordis.web.patch.yml +12 -0
- package/docs/chatcode-login.md +88 -0
- package/docs/chatcode-login.zh.md +179 -0
- package/docs/chatcode-models.md +29 -0
- package/docs/chatcode-models.zh.md +29 -0
- package/docs/chatcode-reporting.md +96 -0
- package/docs/chatcode-reporting.zh.md +96 -0
- package/docs/decisions/2026-08-31-chatcode-model-source.md +39 -0
- package/docs/decisions/2026-08-31-chatcode-model-source.zh.md +39 -0
- package/docs/decisions/2026-09-16-actual-model-adapter-routing.md +31 -0
- package/docs/decisions/2026-09-16-actual-model-adapter-routing.zh.md +31 -0
- package/lib/client.js +469 -0
- package/lib/index.d.ts +263 -0
- package/lib/index.d.ts.map +1 -0
- package/lib/index.js +4873 -0
- package/lib/index.js.map +1 -0
- package/lib/startup-gate-BaCbWaKH.js +164 -0
- package/lib/startup-gate-BaCbWaKH.js.map +1 -0
- package/lib/web-startup.d.ts +9 -0
- package/lib/web-startup.d.ts.map +1 -0
- package/lib/web-startup.js +20 -0
- package/lib/web-startup.js.map +1 -0
- package/package.json +121 -0
- package/vendor/README.md +7 -0
- package/vendor/dsh-llm-pi-ai/LICENSE +21 -0
- package/vendor/dsh-llm-pi-ai/README.i18n.yaml +6 -0
- package/vendor/dsh-llm-pi-ai/README.md +238 -0
- package/vendor/dsh-llm-pi-ai/README.zh.md +238 -0
- package/vendor/dsh-llm-pi-ai/package.json +65 -0
- package/vendor/dsh-llm-pi-ai/src/adapter.ts +434 -0
- package/vendor/dsh-llm-pi-ai/src/auth.ts +241 -0
- package/vendor/dsh-llm-pi-ai/src/catalog.ts +908 -0
- package/vendor/dsh-llm-pi-ai/src/config.ts +478 -0
- package/vendor/dsh-llm-pi-ai/src/context.ts +349 -0
- package/vendor/dsh-llm-pi-ai/src/discovery.ts +284 -0
- package/vendor/dsh-llm-pi-ai/src/index.ts +336 -0
- package/vendor/dsh-llm-pi-ai/src/invariant.ts +30 -0
- package/vendor/dsh-llm-pi-ai/src/login.ts +161 -0
- package/vendor/dsh-llm-pi-ai/src/provider.ts +192 -0
- package/vendor/dsh-llm-pi-ai/src/replay.ts +249 -0
- package/vendor/dsh-llm-pi-ai/src/stream.ts +232 -0
- package/vendor/dsh-llm-pi-ai/tests/adapter.e2e.ts +168 -0
- package/vendor/dsh-llm-pi-ai/tests/adapter.spec.ts +1034 -0
- package/vendor/dsh-llm-pi-ai/tests/assemble.ts +32 -0
- package/vendor/dsh-llm-pi-ai/tests/auth-double.ts +39 -0
- package/vendor/dsh-llm-pi-ai/tests/auth.spec.ts +221 -0
- package/vendor/dsh-llm-pi-ai/tests/catalog.spec.ts +1220 -0
- package/vendor/dsh-llm-pi-ai/tests/config.spec.ts +111 -0
- package/vendor/dsh-llm-pi-ai/tests/context.spec.ts +474 -0
- package/vendor/dsh-llm-pi-ai/tests/convert.spec.ts +922 -0
- package/vendor/dsh-llm-pi-ai/tests/discovery.spec.ts +374 -0
- package/vendor/dsh-llm-pi-ai/tests/dynamic-config.spec.ts +241 -0
- package/vendor/dsh-llm-pi-ai/tests/fixtures/qr-code.png +0 -0
- package/vendor/dsh-llm-pi-ai/tests/loader-composition.spec.ts +244 -0
- package/vendor/dsh-llm-pi-ai/tests/login.spec.ts +198 -0
- package/vendor/dsh-llm-pi-ai/tests/mock-server.ts +82 -0
- package/vendor/dsh-llm-pi-ai/tests/provider-apis.e2e.ts +266 -0
- package/vendor/dsh-llm-pi-ai/tests/sdk-options.spec.ts +106 -0
- package/vendor/dsh-llm-pi-ai/tsconfig.json +4 -0
- package/vendor/dsh-llm-pi-ai/tsconfig.upstream.json +51 -0
|
@@ -0,0 +1,238 @@
|
|
|
1
|
+
---
|
|
2
|
+
description: "面向用户与维护者的 pi-ai 多提供方适配器说明:通过 pi-ai 目录与手工声明网关路由 harness LLM 服务。"
|
|
3
|
+
kind: "package-reference"
|
|
4
|
+
---
|
|
5
|
+
|
|
6
|
+
# @deepseek-ai/dsh-llm-pi-ai
|
|
7
|
+
|
|
8
|
+
[English](README.md) | 中文
|
|
9
|
+
|
|
10
|
+
## 概述
|
|
11
|
+
|
|
12
|
+
`@deepseek-ai/dsh-llm-pi-ai` 是 harness LLM 服务基于 pi-ai 的多提供方适配器:一个插件实例拥有一份提供方路由字典,每条路由都通过 [`@earendil-works/pi-ai`](https://www.npmjs.com/package/@earendil-works/pi-ai) 服务。点名已安装 pi-ai 提供方的路由会继承其端点、协议格式与模型目录作为默认值;pi-ai 不提供的路由可以直接声明,因此 OpenAI 兼容网关或自托管服务器只是配置,而非代码变更。profile 与凭据通过可选 settings 与凭据 seam 按请求解析,因此编辑用户设置文档即可改变下一个请求,无需重启。提供登录的提供方可以通过 harness 授权 seam 登录,存储的登录——OAuth grant,或在 pi-ai 自己的登录提示里键入的密钥——为其路由完成认证,并在存储的跨进程锁下自行刷新。插件可以零路由休眠挂载,一旦 settings 分节提供 profile 便立即激活它们。
|
|
13
|
+
|
|
14
|
+
## 目录
|
|
15
|
+
|
|
16
|
+
- [使用本包](#use-this-package)
|
|
17
|
+
- [理解实现](#understand-the-implementation)
|
|
18
|
+
- [进一步探索](#further-exploration)
|
|
19
|
+
- [模型体验](#model-experience)
|
|
20
|
+
- [已知限制与延期工作](#known-limitations-and-deferred-work)
|
|
21
|
+
- [开发备注](#dev-note)
|
|
22
|
+
|
|
23
|
+
-----
|
|
24
|
+
|
|
25
|
+
<a id="use-this-package"></a>
|
|
26
|
+
## 使用本包
|
|
27
|
+
|
|
28
|
+
当组合需要通过 pi-ai 的提供方目录、或通过 pi-ai 已安装目录未描述的网关路由模型请求时挂载本插件。`providers` 字典就是整个配置面:每个键都是请求用 `GenerateOptions.provider` 选择的提供方路由名。
|
|
29
|
+
|
|
30
|
+
### 何时选择
|
|
31
|
+
|
|
32
|
+
当同一组合服务多个提供方、某条路由需要 pi-ai 目录默认值并修正少数字段、或必须通过自有端点与协议到达手工声明网关时,选择本适配器。当部署不需要其他提供方时,选择 `dsh-llm-deepseek` 直连 DeepSeek 路由。两个适配器可以同时挂载,因为它们的路由名不冲突;注册其他适配器已拥有的路由会导致插件加载失败。
|
|
33
|
+
|
|
34
|
+
### 配置提供方路由
|
|
35
|
+
|
|
36
|
+
每个 profile 都可以设置 `retryPolicy`;省略时使用 normal mode、最多重试五次。`apiKeyEnv` 是按请求经 harness 凭据 seam 解析的凭据引用,因此配置文件绝不包含密钥;解析为空的引用会让请求以 `MISSING_CREDENTIAL` 失败。省略它会让路由保持已配置但无密钥(configured-but-keyless)状态,对已安装目录路由而言即交由 pi-ai 提供方原生的环境发现。
|
|
37
|
+
|
|
38
|
+
```yaml
|
|
39
|
+
- name: '@deepseek-ai/dsh-llm-pi-ai'
|
|
40
|
+
config:
|
|
41
|
+
providers:
|
|
42
|
+
openai:
|
|
43
|
+
apiKeyEnv: OPENAI_API_KEY
|
|
44
|
+
baseURL: https://proxy.example.com:8443
|
|
45
|
+
reasoning: high
|
|
46
|
+
requestImagePixelBudget: 4194304 # total pixels; 2048 by 2048 default
|
|
47
|
+
requestImageMaxBytes: 1048576 # raw bytes before base64 expansion
|
|
48
|
+
maxRequestImageBytes: 20971520 # accumulated base64 payload
|
|
49
|
+
retryPolicy:
|
|
50
|
+
mode: normal
|
|
51
|
+
maxRetries: 3
|
|
52
|
+
anthropic:
|
|
53
|
+
apiKeyEnv: ANTHROPIC_API_KEY
|
|
54
|
+
models:
|
|
55
|
+
- id: claude-sonnet-4-5
|
|
56
|
+
contextWindow: 200000
|
|
57
|
+
acme-gateway:
|
|
58
|
+
displayName: Acme Gateway
|
|
59
|
+
apiKeyEnv: ACME_GATEWAY_API_KEY
|
|
60
|
+
api: openai-completions
|
|
61
|
+
baseURL: https://gateway.acme.example/v1
|
|
62
|
+
compat:
|
|
63
|
+
thinkingFormat: deepseek
|
|
64
|
+
models:
|
|
65
|
+
- id: acme-think
|
|
66
|
+
name: Acme Think
|
|
67
|
+
contextWindow: 262144
|
|
68
|
+
reasoningEfforts:
|
|
69
|
+
off:
|
|
70
|
+
high: high
|
|
71
|
+
```
|
|
72
|
+
|
|
73
|
+
| 字段 | 默认值 | 含义 |
|
|
74
|
+
|---|---|---|
|
|
75
|
+
| `apiKeyEnv` | 无 | 按请求解析的凭据引用;省略时交由 pi-ai 环境发现 |
|
|
76
|
+
| `displayName` | 提供方名 | 选择器界面显示的标签 |
|
|
77
|
+
| `api` | 目录协议 | 协议格式;仅目录不提供的路由需要 |
|
|
78
|
+
| `baseURL` | 目录端点 | 路由上所有模型的端点 |
|
|
79
|
+
| `models` | 已安装目录 | 整体替换路由目录;每个条目从已安装模型取默认值 |
|
|
80
|
+
| `modelOverrides` | 无 | 重塑个别已安装目录模型,而不替换其余模型 |
|
|
81
|
+
| `compat` | 目录检测 | 无法识别端点的协议兼容开关 |
|
|
82
|
+
| `defaultContextWindow` | `262,144` | 未描述模型的容量回退 |
|
|
83
|
+
| `defaultMaxTokens` | `32,768` | 未描述模型的输出上限回退 |
|
|
84
|
+
| `requestImagePixelBudget` | `4,194,304` | 每张确定性请求图片的总像素预算 |
|
|
85
|
+
| `requestImageMaxBytes` | `1 MiB` | 每张请求图片在 base64 扩展前的编码字节目标 |
|
|
86
|
+
| `maxRequestImageBytes` | `20 MiB` | 带最旧优先卸载的 base64 图片载荷总上限 |
|
|
87
|
+
| `retryPolicy` | normal,5 次重试 | 由 `dsh-llm-retry` 执行的提供方自有重试策略 |
|
|
88
|
+
|
|
89
|
+
生成的[配置目录](../../../docs/config-catalog.zh.md#deepseek-aidsh-llm-pi-ai)是每个受支持字段及其 JSDoc 的穷尽式真源。
|
|
90
|
+
|
|
91
|
+
### 登录提供方
|
|
92
|
+
|
|
93
|
+
pi-ai 提供登录的提供方可以通过 harness 授权 seam 登录:流程提供 OAuth 或交互式密钥提示(密钥键入 pi-ai 自己的登录提示,而非设置表单),得到的凭据存储在 harness 凭据存储的 `llm-pi-ai/<provider id>` 记录中。存储的登录在其路由的 `apiKeyEnv` 覆盖之下完成认证,并在存储的跨进程锁下自行刷新;退出登录即删除存储记录。落在记录文法之外——小写连字符标识符——的手工声明路由键无法登录,因为对它的记录写入会以 `LlmError('UNSTORABLE_PROVIDER_ID')` 拒绝;这类路由改用 `apiKeyEnv` 或提供方 ambient 设置认证。
|
|
94
|
+
|
|
95
|
+
### 解析模型目录
|
|
96
|
+
|
|
97
|
+
profile 的 `models` 列表会替换而非扩展路由的已安装目录;每个条目从同 id 已安装模型取未设置字段的默认值,因此把路由收窄到两个模型、修正一个容量或添加比已安装目录更新的模型都是一行编辑。`modelOverrides` 无需该代价即可重塑个别已安装目录模型——修正一个模型,保留其余三十七个——当它与 `models` 列表并存、位于手工声明路由上、或点名目录未描述的模型时会被拒绝,因为静默不变的模型会成为别人日后寻找的拼写错误。
|
|
98
|
+
|
|
99
|
+
### 带推理与协议兼容运行
|
|
100
|
+
|
|
101
|
+
`reasoningEfforts` 声明模型可选择的 thinking 等级:每个键都是选择器提供的等级,其值是该等级过线的拼写,因此 `max: ultra` 可以为拥有自有词汇的网关重命名等级。省略该字段时保留已安装目录条目的能力;`false` 声明非推理模型。对于 pi-ai 无法识别的端点,`compat` 开关重塑请求——哪个角色携带系统提示词、哪个字段限制输出、thinking 等级如何传递——可逐路由、逐模型配置。条目与已安装目录都没有尺寸的模型,会采用路由的 `defaultContextWindow` 与 `defaultMaxTokens` 回退值。
|
|
102
|
+
|
|
103
|
+
对于支持该选项的 OpenAI Chat Completions 网关,可设置提供方配置 `reasoningSplit: true`,通过 `reasoning_split` 请求将思考与回答分别返回。`false` 显式请求不分离格式;省略时保留网关默认值。其他协议会拒绝该字段。它只控制响应格式,与思考强度无关。
|
|
104
|
+
|
|
105
|
+
### 运行时更改配置
|
|
106
|
+
|
|
107
|
+
profile 通过可选 settings seam 每次操作重新读取:base 与用户的 `llm-pi-ai:` 设置分节按提供方合并,因此用户可以新增路由、覆盖组合路由的一个字段或把路由指向另一个代理,全部在下一个请求生效、无需重启。适配器无法服务的分节会在写入处被拒绝——`settings.mutate` 回答 `settings-rejected`——之后失效的已存储分节会保留 namespace 最后有效值。当路由集合或某路由的重试策略变化时,插件会原子地重新注册:冲突路由会让此前路由继续服务。
|
|
108
|
+
|
|
109
|
+
### 从端点发现模型
|
|
110
|
+
|
|
111
|
+
插件会回答"该提供方可以提供哪些模型?",供配置界面正在编辑或起草的路由使用。已安装目录提供的路由直接由目录回答,不发网络请求;只有目录未描述的路由才会经网络询问(`openai-completions` 与 `openai-responses` 形状)。回答是界面可以提供给用户采纳的候选元数据——不存储任何内容,`settings.yaml` 仍然是决定路由服务内容的唯一事实。
|
|
112
|
+
|
|
113
|
+
### 失败与恢复
|
|
114
|
+
|
|
115
|
+
pi-ai 不提供的路由需要 `api`、`baseURL` 与非空 `models` 列表;无法服务的 profile 会在写入处被拒绝,并点名路由与模型。失败携带稳定 code:无法使用的凭据以 `INVALID_CREDENTIAL` 失败并点名路由与引用,`apiKeyEnv` 引用解析为空的路由以 `MISSING_CREDENTIAL` 失败,未配置模型以 `UNKNOWN_MODEL` 失败,终止性提供方失败则区分 `QUOTA` 与暂时性 `RATE_LIMIT`。`GenerateOptions.stop` 以 `UNSUPPORTED_OPTION` 被拒绝,因为 pi-ai 的通用流式 UI 无法跨提供方保证它。
|
|
116
|
+
|
|
117
|
+
-----
|
|
118
|
+
|
|
119
|
+
<a id="understand-the-implementation"></a>
|
|
120
|
+
## 理解实现
|
|
121
|
+
|
|
122
|
+
<details>
|
|
123
|
+
<summary>实现细节——点击展开</summary>
|
|
124
|
+
|
|
125
|
+
本节解释适配器背后的设计;可观察行为已在[使用本包](#use-this-package)中完整说明。
|
|
126
|
+
|
|
127
|
+
### 设计理念
|
|
128
|
+
|
|
129
|
+
其他配置来源插件可使用已解析的配置、私有请求认证与隔离凭据存储来构造 `PiAiAdapter`。[ChatCode 适配器](../llm-chatcode-config/README.zh.md) 使用此扩展,无需挂载 pi-ai 设置插件。
|
|
130
|
+
|
|
131
|
+
适配器建立在不可变快照与按操作解析之上。每个操作都会在第一次 `await` 前捕获整个快照——profile 加一个持有每条路由所构建 `Provider` 的 `createModels()` 集合——配置变更会构建新集合而非修改使用中的集合,因此在一个配置下开始的请求绝不会在另一个配置下结束。路由自己的凭据引用经 harness seam 解析,并以请求 `apiKey` 选项传入,pi-ai 将其视为优先级最高的 auth 覆盖——这正是快速失败(fail-loud)引用语义的所在。该覆盖未覆盖的一切都经集合自身的 auth 到达 pi-ai:凭据存储持有登录写入、刷新轮换的记录(以 `llm-pi-ai/<provider id>` 寻址),auth context 回答提供方解析时提出的 ambient 问题。两者跨快照保持稳定,因此配置变更重建集合时不会忘记谁已登录。
|
|
132
|
+
|
|
133
|
+
### 源码地图
|
|
134
|
+
|
|
135
|
+
| 文件 | 职责 |
|
|
136
|
+
|---|---|
|
|
137
|
+
| [`src/index.ts`](src/index.ts) | 插件入口:profile 解析、settings 接线、目录与路由注册 |
|
|
138
|
+
| [`src/auth.ts`](src/auth.ts) | 覆盖 harness 凭据平面的凭据存储与 ambient auth context |
|
|
139
|
+
| [`src/login.ts`](src/login.ts) | 面向提供登录的已安装提供方的授权流程 |
|
|
140
|
+
| [`src/config.ts`](src/config.ts) | Profile schema、解析与可服务性校验 |
|
|
141
|
+
| [`src/catalog.ts`](src/catalog.ts) | 已安装目录集成与漂移门禁 |
|
|
142
|
+
| [`src/provider.ts`](src/provider.ts) | 受支持协议表与提供方构建 |
|
|
143
|
+
| [`src/context.ts`](src/context.ts) | ChatCode CLI 到 pi-ai 的上下文转换、图片处理、回放恢复 |
|
|
144
|
+
| [`src/stream.ts`](src/stream.ts) | 把 pi-ai 事件转换为 harness `StreamChunk` 值 |
|
|
145
|
+
| [`src/replay.ts`](src/replay.ts) | 带版本的 `ReplayEnvelope` 存储与校验 |
|
|
146
|
+
| [`src/discovery.ts`](src/discovery.ts) | 面向配置界面的端点询问 |
|
|
147
|
+
|
|
148
|
+
### 注册与目录
|
|
149
|
+
|
|
150
|
+
插件会在可配置提供方目录中声明它能认证的每个已安装目录提供方,并加入当前 profile 声明的每条路由,因此配置界面可以在任何路由存在之前提供完整目录。每个条目都携带 `declared`——pi-ai 是否在该键下不提供任何内容——因为只有适配器能区分手工声明路由与收窄目录路由。路由注册具有原子性:与其他适配器冲突的候选集合会让此前路由继续服务。零路由的裸挂载即休眠姿态:settings 分节提供 profile 前不注册任何内容,分节清空时路由随之消失。
|
|
151
|
+
|
|
152
|
+
### 回放与词汇
|
|
153
|
+
|
|
154
|
+
成功 assistant 响应会存储带版本的、无损 JSON 回放状态,与产生它们的提供方和模型放在一起——响应级事实加每个流式块一条逐块条目。请求时,`LlmRuntime` 仅当同一适配器实例拥有两条路由时才传递回放状态;适配器校验它并恢复原生响应 id 与提供方签名,无法使用的状态会降级为提供方无关内容而不是让请求失败。pi-ai 工具调用参数是解析后的对象,因此适配器解析输入并重新字符串化输出,以符合 harness 原始 JSON 约定;pi-ai 流内错误事件映射为终止 `finish` 分片。
|
|
155
|
+
|
|
156
|
+
</details>
|
|
157
|
+
|
|
158
|
+
-----
|
|
159
|
+
|
|
160
|
+
<a id="further-exploration"></a>
|
|
161
|
+
## 进一步探索
|
|
162
|
+
|
|
163
|
+
当包级约定不够用时阅读以下页面。它们从服务约定逐步进入孪生适配器与共享类型。
|
|
164
|
+
|
|
165
|
+
- [dsh-llm 服务](../llm/README.zh.md)——本适配器注册其上的提供方无关服务。
|
|
166
|
+
- [llm-deepseek 适配器](../llm-deepseek/README.zh.md)——`deepseek-official` 路由的 DeepSeek 直连孪生。
|
|
167
|
+
- [LLM 流式子系统](../../../docs/subsystems/llm-streaming.zh.md)——`StreamChunk` 协议与适配器约定。
|
|
168
|
+
- [llm-retry](../llm-retry/README.zh.md)——应用每个 profile `retryPolicy` 的重试执行器。
|
|
169
|
+
- [孪生 LLM 适配器](../../../.agents/notes/implemented/architecture/2026-06-13-twin-llm-adapters.zh.md)——为什么 DeepSeek 路由交付两个结构不同的适配器。
|
|
170
|
+
- [生成配置目录](../../../docs/config-catalog.zh.md#deepseek-aidsh-llm-pi-ai)——每个受支持配置字段及其源声明。
|
|
171
|
+
|
|
172
|
+
-----
|
|
173
|
+
|
|
174
|
+
<a id="model-experience"></a>
|
|
175
|
+
## 模型体验
|
|
176
|
+
|
|
177
|
+
### 经 pi-ai 的提供方请求
|
|
178
|
+
|
|
179
|
+
#### 模型看到什么
|
|
180
|
+
|
|
181
|
+
所选目录模型会收到 `GenerateOptions.system`、历史、工具与 pi-ai 通用流式 API 支持的采样字段。每张保留图片前都会有文本,注明其完整附件 id 与实际请求尺寸。当前执行文件系统可以映射附件提供方的宿主对象时,该文本还会携带只读规范化对象路径,并警告规范化或请求投影可能缩放或重新编码上传内容。当累计 base64 图片载荷超过路由的 `maxRequestImageBytes` 时,每张卸载图片都会在替换文本中保留自己的身份与当前已解析访问方式。卸载的规范化附件不会读取或变换。提供方原生回放元数据只在适配器针对历史内容校验通过后恢复。
|
|
182
|
+
|
|
183
|
+
#### Token 影响
|
|
184
|
+
|
|
185
|
+
提供方分词决定精确输入。保留图片会添加稳定的附件与尺寸描述符;卸载占位符会替代省略图片的视觉 token。回放元数据可能让原生 API 复用提供方侧状态。
|
|
186
|
+
|
|
187
|
+
#### KV Cache 影响
|
|
188
|
+
|
|
189
|
+
转换保持逻辑请求顺序,图片句柄与卸载占位符则会添加模型可见文本。即使附件身份与请求字节保持稳定,执行世界路径变化也会改写历史句柄,并可能从该图片起阻止复用。更换适配器实例、提供方、模型或其他上游 token 具有相同的后缀影响。越过图片上限会把较早图片替换为占位文本,因此复用在该消息处结束,直到被卸载前缀稳定。
|
|
190
|
+
|
|
191
|
+
### 提供方响应
|
|
192
|
+
|
|
193
|
+
#### 模型看到什么
|
|
194
|
+
|
|
195
|
+
pi-ai 事件变成 harness 的推理、文本、工具调用、用量与 finish 分片。适配器把解析后的工具参数以原始 JSON 字符串传给 harness。
|
|
196
|
+
|
|
197
|
+
#### Token 影响
|
|
198
|
+
|
|
199
|
+
生成内容只在 loop 记录后才影响后续输入。提供方未单独报告推理 token 时,pi-ai 会把推理 token 并入输出用量,并原样保留其精确 `totalTokens` 值。
|
|
200
|
+
|
|
201
|
+
#### KV Cache 影响
|
|
202
|
+
|
|
203
|
+
已记录的响应内容会追加到下一个请求,不会使其更早可复用前缀失效。未记录的传输元数据与用量计量不影响缓存标识。
|
|
204
|
+
|
|
205
|
+
## 已知限制与延期工作
|
|
206
|
+
|
|
207
|
+
<a id="known-limitations-and-deferred-work"></a>
|
|
208
|
+
|
|
209
|
+
|
|
210
|
+
这些限制说明适配器在哪里停止、由未来工作接续。它们是当前包约束,不是通用 pi-ai 对比或任务积压。
|
|
211
|
+
|
|
212
|
+
- **`maxRequestImageBytes` 只计算 base64 图片载荷**——文本、工具、描述符与 JSON 结构在该上限之外,因此它必须留有余量地低于网关请求体上限。卸载是确定性请求投影,不会记录为会话事件。
|
|
213
|
+
- **登录只存在于发起它的进程中**——授权尝试不持久,因此登录中途刷新页面会放弃它,用户需要重新开始。退出登录是对已存储记录执行 `deleteRecord`,只在本地忘记它,不会告知签发方。
|
|
214
|
+
- **提供方原生发现经本插件的 ambient context 回答**——不点名凭据的路由交由目录提供方自身解析,它会询问环境值(`AZURE_OPENAI_API_KEY`、`AWS_PROFILE` 及各提供方自有集合)与本地凭据文件。两个问题都在这里得到回答:凭据 seam 先于进程环境被查询,文件存在性则针对宿主进程的文件系统以 `~` 展开后检查。它做不到的是*读取*凭据文件内容——自行解析 `~/.aws/credentials` 的提供方会直接读取,不经该 seam。
|
|
215
|
+
- **设置可以新增或覆盖路由,不能移除组合路由**——用户层覆盖组合 base,因此删除 `cordis.yml` 提供的提供方属于组合变更。
|
|
216
|
+
- **分层合并对字典键没有删除**——base 声明的 `reasoningEfforts` 等级、`modelOverrides` 条目或 `compat` 字段可以被用户层覆盖,但不能被移除。
|
|
217
|
+
- **`headers` 可以携带 redactor 永远看不到的凭据**——profile 的 `headers` 字典是纯字符串;以 `apiKeyEnv` 引用存储凭据。
|
|
218
|
+
- **路由目录不会自行刷新**——目录就是 `settings.yaml` 的内容;这里没有任何机制向提供方查询它提供的模型。
|
|
219
|
+
- **每条路由一种协议格式**——混合协议目录路由无法承载另一协议格式的模型;把提供方拆到两个路由键是变通办法。
|
|
220
|
+
- **模态声明不受校验**——声明 `image` 而其网关不支持的模型会在提示词准入后被提供方拒绝。持久图片仍留在历史中,同一误声明模型可能再次失败;切换到纯文本模型仍然可行,因为共享 LLM 运行时会针对该请求把图片引用投影为稳定文本。
|
|
221
|
+
- **未认证路由取决于其协议**——不点名凭据的路由解析为已配置但无密钥,但 pi-ai 的 OpenAI 兼容实现仍要求 API 密钥或 `Authorization` 标头,因此无密钥本地服务器需要由 `apiKeyEnv` 引用或 `headers` 中的 `Authorization` 条目提供的占位凭据。
|
|
222
|
+
- **不支持 `GenerateOptions.stop`**——pi-ai 的通用流式选项无法跨提供方保证停止序列行为。
|
|
223
|
+
- **历史中的 `system` 消息使用 pi-ai 通用上下文转换**——提供方专属放置遵循 pi-ai,而非 harness 自有的协议覆盖。
|
|
224
|
+
- **提供方 HTTP 状态不可用**——pi-ai 错误事件不跨提供方暴露稳定 HTTP 状态。
|
|
225
|
+
- **重试策略由提供方自有,而非 SDK 重试**——pi-ai SDK 重试保持禁用,因此持久 agent 步骤与 `llm/retry` 事件拥有每个可见尝试,直接 `ctx.llm.stream()` 调用仍是单次尝试。
|
|
226
|
+
|
|
227
|
+
<a id="dev-note"></a>
|
|
228
|
+
### 开发备注
|
|
229
|
+
|
|
230
|
+
<details>
|
|
231
|
+
<summary>维护者的工作上下文——点击展开</summary>
|
|
232
|
+
|
|
233
|
+
本开发备注是不具权威性的工作上下文:尚未决定的探索方向与维护者备注。已交付的行为与既定理由以上文、包代码和相关 Agent Note 为准。
|
|
234
|
+
|
|
235
|
+
- 提供的协议集合刻意比 pi-ai 的完整 API 集合更窄:Bedrock、Vertex、Azure 与 Codex 通过 profile 无法以密钥、端点与标头完整描述的流程认证;目录路由仍可经自有提供方到达它们,只有显式覆盖会被拒绝。Codex 可经授权流程的 OAuth grant 登录。
|
|
236
|
+
- `compat` 开关集合由漂移门禁钉在 pi-ai 的 compat 类型上;上游升级若新增字段、为更多协议赋予 compat 类型或扩大值联合,会在有人分类前让构建失败。
|
|
237
|
+
|
|
238
|
+
</details>
|
|
@@ -0,0 +1,65 @@
|
|
|
1
|
+
{
|
|
2
|
+
"name": "@deepseek-ai/dsh-llm-pi-ai",
|
|
3
|
+
"description": "pi-ai-backed adapter for the ChatCode CLI LLM seam (design-verification twin of dsh-llm-deepseek)",
|
|
4
|
+
"version": "0.1.2-alpha.3",
|
|
5
|
+
"publishConfig": {
|
|
6
|
+
"access": "public"
|
|
7
|
+
},
|
|
8
|
+
"repository": {
|
|
9
|
+
"type": "git",
|
|
10
|
+
"url": "git+https://github.com/deepseek-ai/deepseek-harness.git",
|
|
11
|
+
"directory": "packages/llm/llm-pi-ai"
|
|
12
|
+
},
|
|
13
|
+
"type": "module",
|
|
14
|
+
"main": "lib/index.js",
|
|
15
|
+
"types": "lib/types/index.d.ts",
|
|
16
|
+
"exports": {
|
|
17
|
+
".": {
|
|
18
|
+
"types": "./lib/types/index.d.ts",
|
|
19
|
+
"default": "./lib/index.js"
|
|
20
|
+
},
|
|
21
|
+
"./invariant": {
|
|
22
|
+
"types": "./lib/types/invariant.d.ts",
|
|
23
|
+
"default": "./lib/invariant.js"
|
|
24
|
+
},
|
|
25
|
+
"./src/*": "./src/*",
|
|
26
|
+
"./package.json": "./package.json"
|
|
27
|
+
},
|
|
28
|
+
"files": [
|
|
29
|
+
"lib/index.js",
|
|
30
|
+
"lib/invariant.js",
|
|
31
|
+
"lib/types/**/*.d.ts"
|
|
32
|
+
],
|
|
33
|
+
"license": "MIT",
|
|
34
|
+
"peerDependencies": {
|
|
35
|
+
"@deepseek-ai/cordis": "workspace:^",
|
|
36
|
+
"@deepseek-ai/dsh-attachment": "workspace:^",
|
|
37
|
+
"@deepseek-ai/dsh-authorization": "workspace:^",
|
|
38
|
+
"@deepseek-ai/dsh-credentials": "workspace:^",
|
|
39
|
+
"@deepseek-ai/dsh-fs": "workspace:^",
|
|
40
|
+
"@deepseek-ai/dsh-invariants": "workspace:^",
|
|
41
|
+
"@deepseek-ai/dsh-launch-environment": "workspace:^",
|
|
42
|
+
"@deepseek-ai/dsh-llm": "workspace:^",
|
|
43
|
+
"@deepseek-ai/dsh-settings": "workspace:^",
|
|
44
|
+
"@deepseek-ai/dsh-timeout": "workspace:^"
|
|
45
|
+
},
|
|
46
|
+
"dependencies": {
|
|
47
|
+
"@deepseek-ai/dsh-brand": "workspace:^",
|
|
48
|
+
"@deepseek-ai/dsh-util-values": "workspace:^",
|
|
49
|
+
"@deepseek-ai/schemastery": "workspace:^",
|
|
50
|
+
"@earendil-works/pi-ai": "^0.84.2"
|
|
51
|
+
},
|
|
52
|
+
"devDependencies": {
|
|
53
|
+
"@deepseek-ai/cordis": "workspace:^",
|
|
54
|
+
"@deepseek-ai/dsh-attachment": "workspace:^",
|
|
55
|
+
"@deepseek-ai/dsh-authorization": "workspace:^",
|
|
56
|
+
"@deepseek-ai/dsh-credentials": "workspace:^",
|
|
57
|
+
"@deepseek-ai/dsh-fs": "workspace:^",
|
|
58
|
+
"@deepseek-ai/dsh-invariants": "workspace:^",
|
|
59
|
+
"@deepseek-ai/dsh-launch-environment": "workspace:^",
|
|
60
|
+
"@deepseek-ai/dsh-llm": "workspace:^",
|
|
61
|
+
"@deepseek-ai/dsh-llm-deepseek": "workspace:^",
|
|
62
|
+
"@deepseek-ai/dsh-settings": "workspace:^",
|
|
63
|
+
"@deepseek-ai/dsh-timeout": "workspace:^"
|
|
64
|
+
}
|
|
65
|
+
}
|