blun-king-cli 9.1.87 → 9.1.88
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/README.md +3 -3
- package/blun.mjs +5 -1
- package/package.json +1 -1
package/README.md
CHANGED
|
@@ -9,7 +9,7 @@ Voraussetzung ist Node.js 24.15 oder neuer. Die geprüfte Version wird exakt
|
|
|
9
9
|
installiert:
|
|
10
10
|
|
|
11
11
|
```powershell
|
|
12
|
-
npm install -g blun-king-cli@9.1.
|
|
12
|
+
npm install -g blun-king-cli@9.1.88
|
|
13
13
|
```
|
|
14
14
|
|
|
15
15
|
## Reproduzierbares Staging und Packen
|
|
@@ -101,9 +101,9 @@ doppelten Namen bleiben unverändert.
|
|
|
101
101
|
|
|
102
102
|
## Kontextentlastung bei langen Sitzungen
|
|
103
103
|
|
|
104
|
-
King bewahrt den vollständigen Verlauf weiterhin im Sitzungs-Wire auf.
|
|
104
|
+
King bewahrt den vollständigen Verlauf weiterhin im Sitzungs-Wire auf. Bei 75 Prozent der wirksamen Verdichtungsgrenze ersetzt die Modellprojektion ältere große Werkzeugergebnisse sowie große Argumente abgeschlossener Werkzeugaufrufe durch kurze Platzhalter. Die Druckmessung verwendet die frühere Grenze aus Modellfenster und Vollverdichtungsbudget; bei einem Modellfenster von 1.048.576 Token und einer Vollverdichtung bei 256.000 Token liegt der Mikrodruckpunkt daher bei 192.000 Token. Werkzeugargumente werden nur entlastet, wenn ein zugehöriges Werkzeugergebnis vorliegt und die gespeicherten Argumente gültiges JSON sind. Die letzten 20 Nachrichten bleiben unverändert. Solange der Prefix-Cache warm ist, wird der Schnitt höchstens nach jeweils 20 weiteren Nachrichten verschoben. Nach einer Stunde ohne Modellantwort darf er sofort nachziehen.
|
|
105
105
|
|
|
106
|
-
Dabei werden keine gespeicherten Nachrichten geändert oder gelöscht. Fortsetzen, Exportieren und die sichtbare Historie behalten die ursprünglichen Werkzeugergebnisse und Werkzeugargumente. Das Telemetrieereignis `micro_compaction_finished` nennt den Auslöser, den Schnitt und die geschätzte Tokenzahl vor und nach der Entlastung. Außerdem zählt es getrennt, wie viele Werkzeugergebnisse und Werkzeugargumente entlastet wurden. Der Sitzungsinspektor summiert zusätzlich die eingesparten Argument-Token, ohne Inhalte offenzulegen. Beispiel: Ein früherer `Write`-Aufruf mit einem vollständigen Dateiinhalt bleibt im Wire erhalten; die Modellprojektion trägt nur noch einen Platzhalter, sobald für diesen `Write`-Aufruf ein zugehöriges Ergebnis vorliegt.
|
|
106
|
+
Dabei werden keine gespeicherten Nachrichten geändert oder gelöscht. Fortsetzen, Exportieren und die sichtbare Historie behalten die ursprünglichen Werkzeugergebnisse und Werkzeugargumente. Das Telemetrieereignis `micro_compaction_finished` nennt den Auslöser, den Schnitt, die verwendete Druckgrenze, das Modellfenster und die geschätzte Tokenzahl vor und nach der Entlastung. Außerdem zählt es getrennt, wie viele Werkzeugergebnisse und Werkzeugargumente entlastet wurden. Der Sitzungsinspektor summiert zusätzlich die eingesparten Argument-Token, ohne Inhalte offenzulegen. Beispiel: Ein früherer `Write`-Aufruf mit einem vollständigen Dateiinhalt bleibt im Wire erhalten; die Modellprojektion trägt nur noch einen Platzhalter, sobald für diesen `Write`-Aufruf ein zugehöriges Ergebnis vorliegt.
|
|
107
107
|
|
|
108
108
|
## Große Werkzeugausgaben und isolierte Teilagenten
|
|
109
109
|
|
package/blun.mjs
CHANGED
|
@@ -75950,7 +75950,9 @@ var init_micro = __esmMin((() => {
|
|
|
75950
75950
|
detect() {
|
|
75951
75951
|
const config = this.config;
|
|
75952
75952
|
const { history, lastAssistantAt } = this.agent.context;
|
|
75953
|
-
const
|
|
75953
|
+
const modelContextTokens = this.agent.config.modelCapabilities.max_context_tokens;
|
|
75954
|
+
const compactionBudgetTokens = this.agent.fullCompaction?.getCompactionBudgetTokens();
|
|
75955
|
+
const maxContextTokens = Number.isFinite(compactionBudgetTokens) && compactionBudgetTokens > 0 && (modelContextTokens <= 0 || compactionBudgetTokens < modelContextTokens) ? compactionBudgetTokens : modelContextTokens;
|
|
75954
75956
|
const contextTokens = this.agent.context.tokenCountWithPending;
|
|
75955
75957
|
const selection = selectMicroCompactionCutoff({
|
|
75956
75958
|
historyLength: history.length,
|
|
@@ -75981,6 +75983,8 @@ var init_micro = __esmMin((() => {
|
|
|
75981
75983
|
truncated_arguments_marker: config.truncatedArgumentsMarker,
|
|
75982
75984
|
min_context_usage_ratio: config.minContextUsageRatio,
|
|
75983
75985
|
context_usage_ratio: selection.contextUsageRatio,
|
|
75986
|
+
pressure_window_tokens: maxContextTokens,
|
|
75987
|
+
model_context_tokens: modelContextTokens,
|
|
75984
75988
|
truncated_tool_result_count: effect.truncatedToolResultCount,
|
|
75985
75989
|
truncated_tool_result_tokens_before: effect.truncatedToolResultTokensBefore,
|
|
75986
75990
|
truncated_tool_result_tokens_after: effect.truncatedToolResultTokensAfter,
|