blun-king-cli 9.1.87 → 9.1.88

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (3) hide show
  1. package/README.md +3 -3
  2. package/blun.mjs +5 -1
  3. package/package.json +1 -1
package/README.md CHANGED
@@ -9,7 +9,7 @@ Voraussetzung ist Node.js 24.15 oder neuer. Die geprüfte Version wird exakt
9
9
  installiert:
10
10
 
11
11
  ```powershell
12
- npm install -g blun-king-cli@9.1.87
12
+ npm install -g blun-king-cli@9.1.88
13
13
  ```
14
14
 
15
15
  ## Reproduzierbares Staging und Packen
@@ -101,9 +101,9 @@ doppelten Namen bleiben unverändert.
101
101
 
102
102
  ## Kontextentlastung bei langen Sitzungen
103
103
 
104
- King bewahrt den vollständigen Verlauf weiterhin im Sitzungs-Wire auf. Erreicht der aktive Verlauf 75 Prozent des Modellfensters, ersetzt die Modellprojektion ältere große Werkzeugergebnisse sowie große Argumente abgeschlossener Werkzeugaufrufe durch kurze Platzhalter. Werkzeugargumente werden nur entlastet, wenn ein zugehöriges Werkzeugergebnis vorliegt und die gespeicherten Argumente gültiges JSON sind. Die letzten 20 Nachrichten bleiben unverändert. Solange der Prefix-Cache warm ist, wird der Schnitt höchstens nach jeweils 20 weiteren Nachrichten verschoben. Nach einer Stunde ohne Modellantwort darf er sofort nachziehen.
104
+ King bewahrt den vollständigen Verlauf weiterhin im Sitzungs-Wire auf. Bei 75 Prozent der wirksamen Verdichtungsgrenze ersetzt die Modellprojektion ältere große Werkzeugergebnisse sowie große Argumente abgeschlossener Werkzeugaufrufe durch kurze Platzhalter. Die Druckmessung verwendet die frühere Grenze aus Modellfenster und Vollverdichtungsbudget; bei einem Modellfenster von 1.048.576 Token und einer Vollverdichtung bei 256.000 Token liegt der Mikrodruckpunkt daher bei 192.000 Token. Werkzeugargumente werden nur entlastet, wenn ein zugehöriges Werkzeugergebnis vorliegt und die gespeicherten Argumente gültiges JSON sind. Die letzten 20 Nachrichten bleiben unverändert. Solange der Prefix-Cache warm ist, wird der Schnitt höchstens nach jeweils 20 weiteren Nachrichten verschoben. Nach einer Stunde ohne Modellantwort darf er sofort nachziehen.
105
105
 
106
- Dabei werden keine gespeicherten Nachrichten geändert oder gelöscht. Fortsetzen, Exportieren und die sichtbare Historie behalten die ursprünglichen Werkzeugergebnisse und Werkzeugargumente. Das Telemetrieereignis `micro_compaction_finished` nennt den Auslöser, den Schnitt und die geschätzte Tokenzahl vor und nach der Entlastung. Außerdem zählt es getrennt, wie viele Werkzeugergebnisse und Werkzeugargumente entlastet wurden. Der Sitzungsinspektor summiert zusätzlich die eingesparten Argument-Token, ohne Inhalte offenzulegen. Beispiel: Ein früherer `Write`-Aufruf mit einem vollständigen Dateiinhalt bleibt im Wire erhalten; die Modellprojektion trägt nur noch einen Platzhalter, sobald für diesen `Write`-Aufruf ein zugehöriges Ergebnis vorliegt.
106
+ Dabei werden keine gespeicherten Nachrichten geändert oder gelöscht. Fortsetzen, Exportieren und die sichtbare Historie behalten die ursprünglichen Werkzeugergebnisse und Werkzeugargumente. Das Telemetrieereignis `micro_compaction_finished` nennt den Auslöser, den Schnitt, die verwendete Druckgrenze, das Modellfenster und die geschätzte Tokenzahl vor und nach der Entlastung. Außerdem zählt es getrennt, wie viele Werkzeugergebnisse und Werkzeugargumente entlastet wurden. Der Sitzungsinspektor summiert zusätzlich die eingesparten Argument-Token, ohne Inhalte offenzulegen. Beispiel: Ein früherer `Write`-Aufruf mit einem vollständigen Dateiinhalt bleibt im Wire erhalten; die Modellprojektion trägt nur noch einen Platzhalter, sobald für diesen `Write`-Aufruf ein zugehöriges Ergebnis vorliegt.
107
107
 
108
108
  ## Große Werkzeugausgaben und isolierte Teilagenten
109
109
 
package/blun.mjs CHANGED
@@ -75950,7 +75950,9 @@ var init_micro = __esmMin((() => {
75950
75950
  detect() {
75951
75951
  const config = this.config;
75952
75952
  const { history, lastAssistantAt } = this.agent.context;
75953
- const maxContextTokens = this.agent.config.modelCapabilities.max_context_tokens;
75953
+ const modelContextTokens = this.agent.config.modelCapabilities.max_context_tokens;
75954
+ const compactionBudgetTokens = this.agent.fullCompaction?.getCompactionBudgetTokens();
75955
+ const maxContextTokens = Number.isFinite(compactionBudgetTokens) && compactionBudgetTokens > 0 && (modelContextTokens <= 0 || compactionBudgetTokens < modelContextTokens) ? compactionBudgetTokens : modelContextTokens;
75954
75956
  const contextTokens = this.agent.context.tokenCountWithPending;
75955
75957
  const selection = selectMicroCompactionCutoff({
75956
75958
  historyLength: history.length,
@@ -75981,6 +75983,8 @@ var init_micro = __esmMin((() => {
75981
75983
  truncated_arguments_marker: config.truncatedArgumentsMarker,
75982
75984
  min_context_usage_ratio: config.minContextUsageRatio,
75983
75985
  context_usage_ratio: selection.contextUsageRatio,
75986
+ pressure_window_tokens: maxContextTokens,
75987
+ model_context_tokens: modelContextTokens,
75984
75988
  truncated_tool_result_count: effect.truncatedToolResultCount,
75985
75989
  truncated_tool_result_tokens_before: effect.truncatedToolResultTokensBefore,
75986
75990
  truncated_tool_result_tokens_after: effect.truncatedToolResultTokensAfter,
package/package.json CHANGED
@@ -1,6 +1,6 @@
1
1
  {
2
2
  "name": "blun-king-cli",
3
- "version": "9.1.87",
3
+ "version": "9.1.88",
4
4
  "description": "BLUN CLI - your own AI agent with a Telegram channel. Get it done. With BLUN.",
5
5
  "license": "MIT",
6
6
  "bin": {