langchain 1.4.5-dev-1781048185730 → 1.4.6-dev-1781485641139
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/CHANGELOG.md +8 -0
- package/dist/agents/ReactAgent.cjs +5 -2
- package/dist/agents/ReactAgent.cjs.map +1 -1
- package/dist/agents/ReactAgent.d.cts +1 -1
- package/dist/agents/ReactAgent.d.cts.map +1 -1
- package/dist/agents/ReactAgent.d.ts +1 -1
- package/dist/agents/ReactAgent.d.ts.map +1 -1
- package/dist/agents/ReactAgent.js +4 -1
- package/dist/agents/ReactAgent.js.map +1 -1
- package/dist/agents/index.cjs +3 -1
- package/dist/agents/index.cjs.map +1 -1
- package/dist/agents/index.d.cts +3 -1
- package/dist/agents/index.d.cts.map +1 -1
- package/dist/agents/index.d.ts +3 -1
- package/dist/agents/index.d.ts.map +1 -1
- package/dist/agents/index.js +3 -1
- package/dist/agents/index.js.map +1 -1
- package/dist/agents/middleware/constants.cjs +25 -0
- package/dist/agents/middleware/constants.cjs.map +1 -1
- package/dist/agents/middleware/constants.js +25 -0
- package/dist/agents/middleware/constants.js.map +1 -1
- package/dist/agents/middleware/contextEditing.cjs.map +1 -1
- package/dist/agents/middleware/contextEditing.d.cts.map +1 -1
- package/dist/agents/middleware/contextEditing.d.ts.map +1 -1
- package/dist/agents/middleware/contextEditing.js.map +1 -1
- package/dist/agents/middleware/hitl.cjs +68 -29
- package/dist/agents/middleware/hitl.cjs.map +1 -1
- package/dist/agents/middleware/hitl.d.cts +2 -105
- package/dist/agents/middleware/hitl.d.cts.map +1 -1
- package/dist/agents/middleware/hitl.d.ts +2 -105
- package/dist/agents/middleware/hitl.d.ts.map +1 -1
- package/dist/agents/middleware/hitl.js +68 -29
- package/dist/agents/middleware/hitl.js.map +1 -1
- package/dist/agents/middleware/index.cjs +1 -0
- package/dist/agents/middleware/index.d.cts +2 -1
- package/dist/agents/middleware/index.d.ts +2 -1
- package/dist/agents/middleware/index.js +1 -0
- package/dist/agents/middleware/llmToolSelector.cjs +14 -0
- package/dist/agents/middleware/llmToolSelector.cjs.map +1 -1
- package/dist/agents/middleware/llmToolSelector.js +14 -0
- package/dist/agents/middleware/llmToolSelector.js.map +1 -1
- package/dist/agents/middleware/modelCallLimit.cjs +12 -0
- package/dist/agents/middleware/modelCallLimit.cjs.map +1 -1
- package/dist/agents/middleware/modelCallLimit.js +12 -0
- package/dist/agents/middleware/modelCallLimit.js.map +1 -1
- package/dist/agents/middleware/modelRetry.cjs +10 -1
- package/dist/agents/middleware/modelRetry.cjs.map +1 -1
- package/dist/agents/middleware/modelRetry.js +10 -1
- package/dist/agents/middleware/modelRetry.js.map +1 -1
- package/dist/agents/middleware/pii.cjs +9 -0
- package/dist/agents/middleware/pii.cjs.map +1 -1
- package/dist/agents/middleware/pii.js +9 -0
- package/dist/agents/middleware/pii.js.map +1 -1
- package/dist/agents/middleware/piiRedaction.cjs +6 -1
- package/dist/agents/middleware/piiRedaction.cjs.map +1 -1
- package/dist/agents/middleware/piiRedaction.js +6 -1
- package/dist/agents/middleware/piiRedaction.js.map +1 -1
- package/dist/agents/middleware/provider/anthropic/promptCaching.cjs +19 -0
- package/dist/agents/middleware/provider/anthropic/promptCaching.cjs.map +1 -1
- package/dist/agents/middleware/provider/anthropic/promptCaching.js +19 -0
- package/dist/agents/middleware/provider/anthropic/promptCaching.js.map +1 -1
- package/dist/agents/middleware/provider/openai/moderation.cjs.map +1 -1
- package/dist/agents/middleware/provider/openai/moderation.js.map +1 -1
- package/dist/agents/middleware/providerToolSearch.cjs +130 -0
- package/dist/agents/middleware/providerToolSearch.cjs.map +1 -0
- package/dist/agents/middleware/providerToolSearch.d.cts +75 -0
- package/dist/agents/middleware/providerToolSearch.d.cts.map +1 -0
- package/dist/agents/middleware/providerToolSearch.d.ts +75 -0
- package/dist/agents/middleware/providerToolSearch.d.ts.map +1 -0
- package/dist/agents/middleware/providerToolSearch.js +129 -0
- package/dist/agents/middleware/providerToolSearch.js.map +1 -0
- package/dist/agents/middleware/summarization.cjs +62 -1
- package/dist/agents/middleware/summarization.cjs.map +1 -1
- package/dist/agents/middleware/summarization.js +62 -1
- package/dist/agents/middleware/summarization.js.map +1 -1
- package/dist/agents/middleware/todoListMiddleware.cjs.map +1 -1
- package/dist/agents/middleware/todoListMiddleware.js.map +1 -1
- package/dist/agents/middleware/toolCallLimit.cjs +24 -0
- package/dist/agents/middleware/toolCallLimit.cjs.map +1 -1
- package/dist/agents/middleware/toolCallLimit.js +24 -0
- package/dist/agents/middleware/toolCallLimit.js.map +1 -1
- package/dist/agents/middleware/toolEmulator.cjs.map +1 -1
- package/dist/agents/middleware/toolEmulator.js.map +1 -1
- package/dist/agents/middleware/toolRetry.cjs +17 -0
- package/dist/agents/middleware/toolRetry.cjs.map +1 -1
- package/dist/agents/middleware/toolRetry.js +17 -0
- package/dist/agents/middleware/toolRetry.js.map +1 -1
- package/dist/agents/middleware.cjs.map +1 -1
- package/dist/agents/middleware.js.map +1 -1
- package/dist/agents/nodes/AfterAgentNode.cjs.map +1 -1
- package/dist/agents/nodes/AfterAgentNode.js.map +1 -1
- package/dist/agents/nodes/AfterModelNode.cjs.map +1 -1
- package/dist/agents/nodes/AfterModelNode.js.map +1 -1
- package/dist/agents/nodes/AgentNode.cjs +17 -0
- package/dist/agents/nodes/AgentNode.cjs.map +1 -1
- package/dist/agents/nodes/AgentNode.js +17 -0
- package/dist/agents/nodes/AgentNode.js.map +1 -1
- package/dist/agents/nodes/BeforeAgentNode.cjs.map +1 -1
- package/dist/agents/nodes/BeforeAgentNode.js.map +1 -1
- package/dist/agents/nodes/BeforeModelNode.cjs.map +1 -1
- package/dist/agents/nodes/BeforeModelNode.js.map +1 -1
- package/dist/agents/nodes/ToolNode.cjs +3 -0
- package/dist/agents/nodes/ToolNode.cjs.map +1 -1
- package/dist/agents/nodes/ToolNode.js +3 -0
- package/dist/agents/nodes/ToolNode.js.map +1 -1
- package/dist/agents/nodes/middleware.cjs +3 -0
- package/dist/agents/nodes/middleware.cjs.map +1 -1
- package/dist/agents/nodes/middleware.js +3 -0
- package/dist/agents/nodes/middleware.js.map +1 -1
- package/dist/agents/nodes/utils.cjs.map +1 -1
- package/dist/agents/nodes/utils.js.map +1 -1
- package/dist/agents/responses.cjs.map +1 -1
- package/dist/agents/responses.js.map +1 -1
- package/dist/agents/tests/utils.cjs.map +1 -1
- package/dist/agents/tests/utils.js.map +1 -1
- package/dist/agents/transformers/index.cjs +2 -0
- package/dist/agents/transformers/index.d.cts +3 -0
- package/dist/agents/transformers/index.d.ts +3 -0
- package/dist/agents/transformers/index.js +3 -0
- package/dist/agents/transformers/subagent.cjs +205 -0
- package/dist/agents/transformers/subagent.cjs.map +1 -0
- package/dist/agents/transformers/subagent.d.cts +34 -0
- package/dist/agents/transformers/subagent.d.cts.map +1 -0
- package/dist/agents/transformers/subagent.d.ts +34 -0
- package/dist/agents/transformers/subagent.d.ts.map +1 -0
- package/dist/agents/transformers/subagent.js +204 -0
- package/dist/agents/transformers/subagent.js.map +1 -0
- package/dist/agents/{stream.cjs → transformers/tool-call.cjs} +3 -15
- package/dist/agents/transformers/tool-call.cjs.map +1 -0
- package/dist/agents/transformers/tool-call.d.cts +17 -0
- package/dist/agents/transformers/tool-call.d.cts.map +1 -0
- package/dist/agents/transformers/tool-call.d.ts +17 -0
- package/dist/agents/transformers/tool-call.d.ts.map +1 -0
- package/dist/agents/{stream.js → transformers/tool-call.js} +2 -14
- package/dist/agents/transformers/tool-call.js.map +1 -0
- package/dist/agents/{stream.d.cts → transformers/types.d.cts} +50 -20
- package/dist/agents/transformers/types.d.cts.map +1 -0
- package/dist/agents/{stream.d.ts → transformers/types.d.ts} +50 -20
- package/dist/agents/transformers/types.d.ts.map +1 -0
- package/dist/agents/utils.cjs +3 -0
- package/dist/agents/utils.cjs.map +1 -1
- package/dist/agents/utils.js +3 -0
- package/dist/agents/utils.js.map +1 -1
- package/dist/browser.cjs +9 -3
- package/dist/browser.d.cts +6 -3
- package/dist/browser.d.ts +6 -3
- package/dist/browser.js +6 -2
- package/dist/chat_models/universal.cjs.map +1 -1
- package/dist/chat_models/universal.js.map +1 -1
- package/dist/hub/index.cjs.map +1 -1
- package/dist/hub/index.js.map +1 -1
- package/dist/hub/node.cjs.map +1 -1
- package/dist/hub/node.js.map +1 -1
- package/dist/index.cjs +9 -3
- package/dist/index.d.cts +6 -3
- package/dist/index.d.ts +6 -3
- package/dist/index.js +6 -2
- package/dist/storage/encoder_backed.cjs.map +1 -1
- package/dist/storage/encoder_backed.js.map +1 -1
- package/dist/storage/file_system.cjs.map +1 -1
- package/dist/storage/file_system.js.map +1 -1
- package/package.json +13 -13
- package/dist/agents/stream.cjs.map +0 -1
- package/dist/agents/stream.d.cts.map +0 -1
- package/dist/agents/stream.d.ts.map +0 -1
- package/dist/agents/stream.js.map +0 -1
|
@@ -0,0 +1,129 @@
|
|
|
1
|
+
import { createMiddleware } from "../middleware.js";
|
|
2
|
+
import { isLangChainTool } from "@langchain/core/utils/function_calling";
|
|
3
|
+
//#region src/agents/middleware/providerToolSearch.ts
|
|
4
|
+
const SERVER_SEARCH_PROVIDERS = ["anthropic", "openai"];
|
|
5
|
+
const SERVER_TOOL_SEARCH_TOOLS = {
|
|
6
|
+
anthropic: {
|
|
7
|
+
type: "tool_search_tool_bm25_20251119",
|
|
8
|
+
name: "tool_search_tool_bm25"
|
|
9
|
+
},
|
|
10
|
+
openai: { type: "tool_search" }
|
|
11
|
+
};
|
|
12
|
+
/**
|
|
13
|
+
* Provider-side tool search middleware.
|
|
14
|
+
*
|
|
15
|
+
* Leverages server-side tool search: the full client tool catalog is forwarded
|
|
16
|
+
* to the provider, with deferred tools marked `defer_loading` so the provider
|
|
17
|
+
* discloses them on demand via its own search. A tool is deferred when it is
|
|
18
|
+
* named in `searchableTools` or built with `extras.defer_loading: true`.
|
|
19
|
+
*
|
|
20
|
+
* Requires a model with server-side tool search support: OpenAI gpt-5.4+ or Anthropic
|
|
21
|
+
* Claude Sonnet 4+/Opus 4+/Haiku 4.5+. Non-Anthropic/OpenAI providers throw; an
|
|
22
|
+
* in-family model that is too old surfaces the provider's own API error rather
|
|
23
|
+
* than being gated here.
|
|
24
|
+
*
|
|
25
|
+
* @example
|
|
26
|
+
* ```ts
|
|
27
|
+
* import { createAgent, providerToolSearchMiddleware } from "langchain";
|
|
28
|
+
* import { ChatAnthropic } from "@langchain/anthropic";
|
|
29
|
+
*
|
|
30
|
+
* const agent = createAgent({
|
|
31
|
+
* model: new ChatAnthropic({ model: "claude-sonnet-4-5" }),
|
|
32
|
+
* tools: [getWeather, ...nicheTools],
|
|
33
|
+
* middleware: [
|
|
34
|
+
* // Defer the niche tools behind the provider's tool search; the model
|
|
35
|
+
* // discovers them on demand instead of receiving every schema up front.
|
|
36
|
+
* providerToolSearchMiddleware({ searchableTools: nicheTools }),
|
|
37
|
+
* ],
|
|
38
|
+
* });
|
|
39
|
+
* ```
|
|
40
|
+
*
|
|
41
|
+
* @example
|
|
42
|
+
* ```ts
|
|
43
|
+
* import { tool } from "@langchain/core/tools";
|
|
44
|
+
* import { createAgent, providerToolSearchMiddleware } from "langchain";
|
|
45
|
+
* import { ChatAnthropic } from "@langchain/anthropic";
|
|
46
|
+
*
|
|
47
|
+
* // A tool marked `defer_loading` at construction is deferred on its own —
|
|
48
|
+
* // no need to list it in `searchableTools`; the middleware honors the flag.
|
|
49
|
+
* const sendEmail = tool(sendEmailFn, {
|
|
50
|
+
* name: "send_email",
|
|
51
|
+
* description: "Send an email",
|
|
52
|
+
* schema: sendEmailSchema,
|
|
53
|
+
* extras: { defer_loading: true },
|
|
54
|
+
* });
|
|
55
|
+
*
|
|
56
|
+
* const agent = createAgent({
|
|
57
|
+
* model: new ChatAnthropic({ model: "claude-sonnet-4-5" }),
|
|
58
|
+
* tools: [getWeather, sendEmail],
|
|
59
|
+
* middleware: [providerToolSearchMiddleware()],
|
|
60
|
+
* });
|
|
61
|
+
* ```
|
|
62
|
+
*
|
|
63
|
+
* @param config - Configuration options for the middleware
|
|
64
|
+
* @param config.searchableTools - Tools to defer behind tool search
|
|
65
|
+
* @returns A middleware instance that can be used with `createAgent`
|
|
66
|
+
*/
|
|
67
|
+
function providerToolSearchMiddleware(config = {}) {
|
|
68
|
+
const deferNames = toToolNames(config.searchableTools);
|
|
69
|
+
return createMiddleware({
|
|
70
|
+
name: "ProviderToolSearch",
|
|
71
|
+
wrapModelCall: (request, handler) => {
|
|
72
|
+
const tools = request.tools ?? [];
|
|
73
|
+
if (deferNames.size > 0) {
|
|
74
|
+
const available = tools.filter(isLangChainTool).map((t) => t.name);
|
|
75
|
+
const unknown = [...deferNames].filter((name) => !available.includes(name));
|
|
76
|
+
if (unknown.length > 0) throw new Error(`providerToolSearchMiddleware: searchableTools references tool(s) not bound to the model: ${unknown.join(", ")}`);
|
|
77
|
+
}
|
|
78
|
+
const provider = getModelProvider(request.model);
|
|
79
|
+
if (!supportsProviderToolSearch(provider)) throw new Error(`providerToolSearchMiddleware requires a provider with server-side tool search, but got ${provider}`);
|
|
80
|
+
if (!hasDeferredTools(tools, deferNames)) return handler(request);
|
|
81
|
+
const boundTools = tools.map((tool) => deferToolIfNeeded(tool, deferNames));
|
|
82
|
+
const nativeSearchTool = SERVER_TOOL_SEARCH_TOOLS[provider];
|
|
83
|
+
return handler({
|
|
84
|
+
...request,
|
|
85
|
+
tools: [...boundTools, nativeSearchTool]
|
|
86
|
+
});
|
|
87
|
+
}
|
|
88
|
+
});
|
|
89
|
+
}
|
|
90
|
+
function isDeferred(tool, deferNames) {
|
|
91
|
+
return isLangChainTool(tool) && (tool.extras?.defer_loading === true || deferNames.has(tool.name));
|
|
92
|
+
}
|
|
93
|
+
function hasDeferredTools(tools, deferNames) {
|
|
94
|
+
return tools.some((tool) => isDeferred(tool, deferNames));
|
|
95
|
+
}
|
|
96
|
+
/**
|
|
97
|
+
* If a tool should be deferred, return a minimal binding spec carrying `defer_loading`.
|
|
98
|
+
* Otherwise return it as-is
|
|
99
|
+
*/
|
|
100
|
+
function deferToolIfNeeded(tool, deferNames) {
|
|
101
|
+
if (!isDeferred(tool, deferNames)) return tool;
|
|
102
|
+
return {
|
|
103
|
+
name: tool.name,
|
|
104
|
+
description: tool.description,
|
|
105
|
+
schema: tool.schema,
|
|
106
|
+
extras: {
|
|
107
|
+
...tool.extras,
|
|
108
|
+
defer_loading: true
|
|
109
|
+
}
|
|
110
|
+
};
|
|
111
|
+
}
|
|
112
|
+
/** Flatten a list of tool names/instances into a set of tool names. */
|
|
113
|
+
function toToolNames(tools = []) {
|
|
114
|
+
return new Set(tools.map((t) => typeof t === "string" ? t : t.name));
|
|
115
|
+
}
|
|
116
|
+
function getModelProvider(model) {
|
|
117
|
+
const name = model.getName();
|
|
118
|
+
const configured = name === "ConfigurableModel" ? model._defaultConfig?.modelProvider : void 0;
|
|
119
|
+
if (name === "ChatAnthropic" || configured === "anthropic") return "anthropic";
|
|
120
|
+
if (name === "ChatOpenAI" || configured === "openai") return "openai";
|
|
121
|
+
return "other";
|
|
122
|
+
}
|
|
123
|
+
function supportsProviderToolSearch(provider) {
|
|
124
|
+
return SERVER_SEARCH_PROVIDERS.includes(provider);
|
|
125
|
+
}
|
|
126
|
+
//#endregion
|
|
127
|
+
export { providerToolSearchMiddleware };
|
|
128
|
+
|
|
129
|
+
//# sourceMappingURL=providerToolSearch.js.map
|
|
@@ -0,0 +1 @@
|
|
|
1
|
+
{"version":3,"file":"providerToolSearch.js","names":[],"sources":["../../../src/agents/middleware/providerToolSearch.ts"],"sourcesContent":["import type {\n StructuredToolInterface,\n StructuredToolParams,\n ClientTool,\n ServerTool,\n} from \"@langchain/core/tools\";\nimport { isLangChainTool } from \"@langchain/core/utils/function_calling\";\nimport { createMiddleware } from \"../middleware.js\";\nimport type { LanguageModelLike } from \"@langchain/core/language_models/base\";\nimport type {\n ChatModelProvider,\n ConfigurableModel,\n} from \"../../chat_models/universal.js\";\n\ntype ToolName = string;\nexport type ToolIdentifier = ToolName | StructuredToolInterface;\n\nexport type ProviderToolSearchMiddlewareConfig = {\n /**\n * Which tools are deferred; withheld from the model until its tool search surfaces them.\n *\n * Tools already constructed with `extras.defer_loading === true` are deferred\n * regardless of this option; if `searchableTools` is omitted, only those pre-marked\n * tools are deferred.\n */\n searchableTools?: ToolIdentifier[];\n};\n\nconst SERVER_SEARCH_PROVIDERS = [\n \"anthropic\",\n \"openai\",\n] as const satisfies readonly ChatModelProvider[];\n\ntype ServerSearchCapableProvider = (typeof SERVER_SEARCH_PROVIDERS)[number];\ntype DetectedProvider = ServerSearchCapableProvider | \"other\";\n\ntype ServerToolSearchTool = { type: string; name?: string };\n\nconst SERVER_TOOL_SEARCH_TOOLS = {\n anthropic: {\n type: \"tool_search_tool_bm25_20251119\",\n name: \"tool_search_tool_bm25\",\n },\n openai: { type: \"tool_search\" },\n} as const satisfies Record<ServerSearchCapableProvider, ServerToolSearchTool>;\n\n/**\n * Provider-side tool search middleware.\n *\n * Leverages server-side tool search: the full client tool catalog is forwarded\n * to the provider, with deferred tools marked `defer_loading` so the provider\n * discloses them on demand via its own search. A tool is deferred when it is\n * named in `searchableTools` or built with `extras.defer_loading: true`.\n *\n * Requires a model with server-side tool search support: OpenAI gpt-5.4+ or Anthropic\n * Claude Sonnet 4+/Opus 4+/Haiku 4.5+. Non-Anthropic/OpenAI providers throw; an\n * in-family model that is too old surfaces the provider's own API error rather\n * than being gated here.\n *\n * @example\n * ```ts\n * import { createAgent, providerToolSearchMiddleware } from \"langchain\";\n * import { ChatAnthropic } from \"@langchain/anthropic\";\n *\n * const agent = createAgent({\n * model: new ChatAnthropic({ model: \"claude-sonnet-4-5\" }),\n * tools: [getWeather, ...nicheTools],\n * middleware: [\n * // Defer the niche tools behind the provider's tool search; the model\n * // discovers them on demand instead of receiving every schema up front.\n * providerToolSearchMiddleware({ searchableTools: nicheTools }),\n * ],\n * });\n * ```\n *\n * @example\n * ```ts\n * import { tool } from \"@langchain/core/tools\";\n * import { createAgent, providerToolSearchMiddleware } from \"langchain\";\n * import { ChatAnthropic } from \"@langchain/anthropic\";\n *\n * // A tool marked `defer_loading` at construction is deferred on its own —\n * // no need to list it in `searchableTools`; the middleware honors the flag.\n * const sendEmail = tool(sendEmailFn, {\n * name: \"send_email\",\n * description: \"Send an email\",\n * schema: sendEmailSchema,\n * extras: { defer_loading: true },\n * });\n *\n * const agent = createAgent({\n * model: new ChatAnthropic({ model: \"claude-sonnet-4-5\" }),\n * tools: [getWeather, sendEmail],\n * middleware: [providerToolSearchMiddleware()],\n * });\n * ```\n *\n * @param config - Configuration options for the middleware\n * @param config.searchableTools - Tools to defer behind tool search\n * @returns A middleware instance that can be used with `createAgent`\n */\nexport function providerToolSearchMiddleware(\n config: ProviderToolSearchMiddlewareConfig = {}\n) {\n const deferNames = toToolNames(config.searchableTools);\n\n return createMiddleware({\n name: \"ProviderToolSearch\",\n wrapModelCall: (request, handler) => {\n const tools = request.tools ?? [];\n\n // Fail fast if we try to defer a tool that is not bound to the model\n if (deferNames.size > 0) {\n const available = tools.filter(isLangChainTool).map((t) => t.name);\n const unknown = [...deferNames].filter(\n (name) => !available.includes(name)\n );\n if (unknown.length > 0) {\n throw new Error(\n `providerToolSearchMiddleware: searchableTools references tool(s) not bound to the model: ${unknown.join(\", \")}`\n );\n }\n }\n\n const provider = getModelProvider(request.model);\n if (!supportsProviderToolSearch(provider)) {\n throw new Error(\n `providerToolSearchMiddleware requires a provider with server-side tool search, but got ${provider}`\n );\n }\n\n // Nothing to defer -> pass thru\n if (!hasDeferredTools(tools, deferNames)) return handler(request);\n\n // For each deferred tool, emit a minimal binding spec carrying `defer_loading`.\n const boundTools = tools.map((tool) =>\n deferToolIfNeeded(tool, deferNames)\n );\n\n const nativeSearchTool = SERVER_TOOL_SEARCH_TOOLS[provider];\n return handler({ ...request, tools: [...boundTools, nativeSearchTool] });\n },\n });\n}\n\nfunction isDeferred(\n tool: unknown,\n deferNames: Set<string>\n): tool is StructuredToolParams {\n return (\n isLangChainTool(tool) &&\n (tool.extras?.defer_loading === true || deferNames.has(tool.name))\n );\n}\n\nfunction hasDeferredTools(\n tools: readonly (ClientTool | ServerTool)[],\n deferNames: Set<string>\n): boolean {\n return tools.some((tool) => isDeferred(tool, deferNames));\n}\n\n/**\n * If a tool should be deferred, return a minimal binding spec carrying `defer_loading`.\n * Otherwise return it as-is\n */\nfunction deferToolIfNeeded(\n tool: ClientTool | ServerTool,\n deferNames: Set<string>\n): ClientTool | ServerTool {\n if (!isDeferred(tool, deferNames)) return tool;\n return {\n name: tool.name,\n description: tool.description,\n schema: tool.schema,\n extras: { ...tool.extras, defer_loading: true },\n };\n}\n\n/** Flatten a list of tool names/instances into a set of tool names. */\nfunction toToolNames(tools: ToolIdentifier[] = []): Set<string> {\n return new Set(tools.map((t) => (typeof t === \"string\" ? t : t.name)));\n}\n\nfunction getModelProvider(model: LanguageModelLike): DetectedProvider {\n const name = model.getName();\n const configured =\n name === \"ConfigurableModel\"\n ? (model as ConfigurableModel)._defaultConfig?.modelProvider\n : undefined;\n if (name === \"ChatAnthropic\" || configured === \"anthropic\")\n return \"anthropic\";\n if (name === \"ChatOpenAI\" || configured === \"openai\") return \"openai\";\n return \"other\";\n}\n\nfunction supportsProviderToolSearch(\n provider: DetectedProvider\n): provider is ServerSearchCapableProvider {\n return (SERVER_SEARCH_PROVIDERS as readonly string[]).includes(provider);\n}\n"],"mappings":";;;AA4BA,MAAM,0BAA0B,CAC9B,aACA,SACD;AAOD,MAAM,2BAA2B;CAC/B,WAAW;EACT,MAAM;EACN,MAAM;EACP;CACD,QAAQ,EAAE,MAAM,eAAe;CAChC;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;AAyDD,SAAgB,6BACd,SAA6C,EAAE,EAC/C;CACA,MAAM,aAAa,YAAY,OAAO,gBAAgB;AAEtD,QAAO,iBAAiB;EACtB,MAAM;EACN,gBAAgB,SAAS,YAAY;GACnC,MAAM,QAAQ,QAAQ,SAAS,EAAE;AAGjC,OAAI,WAAW,OAAO,GAAG;IACvB,MAAM,YAAY,MAAM,OAAO,gBAAgB,CAAC,KAAK,MAAM,EAAE,KAAK;IAClE,MAAM,UAAU,CAAC,GAAG,WAAW,CAAC,QAC7B,SAAS,CAAC,UAAU,SAAS,KAAK,CACpC;AACD,QAAI,QAAQ,SAAS,EACnB,OAAM,IAAI,MACR,4FAA4F,QAAQ,KAAK,KAAK,GAC/G;;GAIL,MAAM,WAAW,iBAAiB,QAAQ,MAAM;AAChD,OAAI,CAAC,2BAA2B,SAAS,CACvC,OAAM,IAAI,MACR,0FAA0F,WAC3F;AAIH,OAAI,CAAC,iBAAiB,OAAO,WAAW,CAAE,QAAO,QAAQ,QAAQ;GAGjE,MAAM,aAAa,MAAM,KAAK,SAC5B,kBAAkB,MAAM,WAAW,CACpC;GAED,MAAM,mBAAmB,yBAAyB;AAClD,UAAO,QAAQ;IAAE,GAAG;IAAS,OAAO,CAAC,GAAG,YAAY,iBAAiB;IAAE,CAAC;;EAE3E,CAAC;;AAGJ,SAAS,WACP,MACA,YAC8B;AAC9B,QACE,gBAAgB,KAAK,KACpB,KAAK,QAAQ,kBAAkB,QAAQ,WAAW,IAAI,KAAK,KAAK;;AAIrE,SAAS,iBACP,OACA,YACS;AACT,QAAO,MAAM,MAAM,SAAS,WAAW,MAAM,WAAW,CAAC;;;;;;AAO3D,SAAS,kBACP,MACA,YACyB;AACzB,KAAI,CAAC,WAAW,MAAM,WAAW,CAAE,QAAO;AAC1C,QAAO;EACL,MAAM,KAAK;EACX,aAAa,KAAK;EAClB,QAAQ,KAAK;EACb,QAAQ;GAAE,GAAG,KAAK;GAAQ,eAAe;GAAM;EAChD;;;AAIH,SAAS,YAAY,QAA0B,EAAE,EAAe;AAC9D,QAAO,IAAI,IAAI,MAAM,KAAK,MAAO,OAAO,MAAM,WAAW,IAAI,EAAE,KAAM,CAAC;;AAGxE,SAAS,iBAAiB,OAA4C;CACpE,MAAM,OAAO,MAAM,SAAS;CAC5B,MAAM,aACJ,SAAS,sBACJ,MAA4B,gBAAgB,gBAC7C,KAAA;AACN,KAAI,SAAS,mBAAmB,eAAe,YAC7C,QAAO;AACT,KAAI,SAAS,gBAAgB,eAAe,SAAU,QAAO;AAC7D,QAAO;;AAGT,SAAS,2BACP,UACyC;AACzC,QAAQ,wBAA8C,SAAS,SAAS"}
|
|
@@ -46,8 +46,17 @@ const DEFAULT_FALLBACK_MESSAGE_COUNT = 15;
|
|
|
46
46
|
const SEARCH_RANGE_FOR_TOOL_PAIRS = 5;
|
|
47
47
|
const tokenCounterSchema = zod_v3.z.function().args(zod_v3.z.array(zod_v3.z.custom())).returns(zod_v3.z.union([zod_v3.z.number(), zod_v3.z.promise(zod_v3.z.number())]));
|
|
48
48
|
const contextSizeSchema = zod_v3.z.object({
|
|
49
|
+
/**
|
|
50
|
+
* Fraction of the model's context size to use as the trigger
|
|
51
|
+
*/
|
|
49
52
|
fraction: zod_v3.z.number().gt(0, "Fraction must be greater than 0").max(1, "Fraction must be less than or equal to 1").optional(),
|
|
53
|
+
/**
|
|
54
|
+
* Number of tokens to use as the trigger
|
|
55
|
+
*/
|
|
50
56
|
tokens: zod_v3.z.number().positive("Tokens must be greater than 0").optional(),
|
|
57
|
+
/**
|
|
58
|
+
* Number of messages to use as the trigger
|
|
59
|
+
*/
|
|
51
60
|
messages: zod_v3.z.number().int("Messages must be an integer").positive("Messages must be greater than 0").optional()
|
|
52
61
|
}).refine((data) => {
|
|
53
62
|
return [
|
|
@@ -57,7 +66,13 @@ const contextSizeSchema = zod_v3.z.object({
|
|
|
57
66
|
].filter((v) => v !== void 0).length >= 1;
|
|
58
67
|
}, { message: "At least one of fraction, tokens, or messages must be provided" });
|
|
59
68
|
const keepSchema = zod_v3.z.object({
|
|
69
|
+
/**
|
|
70
|
+
* Fraction of the model's context size to keep
|
|
71
|
+
*/
|
|
60
72
|
fraction: zod_v3.z.number().min(0, "Messages must be non-negative").max(1, "Fraction must be less than or equal to 1").optional(),
|
|
73
|
+
/**
|
|
74
|
+
* Number of tokens to keep
|
|
75
|
+
*/
|
|
61
76
|
tokens: zod_v3.z.number().min(0, "Tokens must be greater than or equal to 0").optional(),
|
|
62
77
|
messages: zod_v3.z.number().int("Messages must be an integer").min(0, "Messages must be non-negative").optional()
|
|
63
78
|
}).refine((data) => {
|
|
@@ -68,14 +83,55 @@ const keepSchema = zod_v3.z.object({
|
|
|
68
83
|
].filter((v) => v !== void 0).length === 1;
|
|
69
84
|
}, { message: "Exactly one of fraction, tokens, or messages must be provided" });
|
|
70
85
|
const contextSchema = zod_v3.z.object({
|
|
86
|
+
/**
|
|
87
|
+
* Model to use for summarization
|
|
88
|
+
*/
|
|
71
89
|
model: zod_v3.z.custom(),
|
|
90
|
+
/**
|
|
91
|
+
* Trigger conditions for summarization.
|
|
92
|
+
* Can be a single condition object (all properties must be met) or an array of conditions (any condition must be met).
|
|
93
|
+
*
|
|
94
|
+
* @example
|
|
95
|
+
* ```ts
|
|
96
|
+
* // Single condition: trigger if tokens >= 5000 AND messages >= 3
|
|
97
|
+
* trigger: { tokens: 5000, messages: 3 }
|
|
98
|
+
*
|
|
99
|
+
* // Multiple conditions: trigger if (tokens >= 5000 AND messages >= 3) OR (tokens >= 3000 AND messages >= 6)
|
|
100
|
+
* trigger: [
|
|
101
|
+
* { tokens: 5000, messages: 3 },
|
|
102
|
+
* { tokens: 3000, messages: 6 }
|
|
103
|
+
* ]
|
|
104
|
+
* ```
|
|
105
|
+
*/
|
|
72
106
|
trigger: zod_v3.z.union([contextSizeSchema, zod_v3.z.array(contextSizeSchema)]).optional(),
|
|
107
|
+
/**
|
|
108
|
+
* Keep conditions for summarization
|
|
109
|
+
*/
|
|
73
110
|
keep: keepSchema.optional(),
|
|
111
|
+
/**
|
|
112
|
+
* Token counter function to use for summarization
|
|
113
|
+
*/
|
|
74
114
|
tokenCounter: tokenCounterSchema.optional(),
|
|
115
|
+
/**
|
|
116
|
+
* Summary prompt to use for summarization
|
|
117
|
+
* @default {@link DEFAULT_SUMMARY_PROMPT}
|
|
118
|
+
*/
|
|
75
119
|
summaryPrompt: zod_v3.z.string().default(DEFAULT_SUMMARY_PROMPT),
|
|
120
|
+
/**
|
|
121
|
+
* Number of tokens to trim to before summarizing
|
|
122
|
+
*/
|
|
76
123
|
trimTokensToSummarize: zod_v3.z.number().optional(),
|
|
124
|
+
/**
|
|
125
|
+
* Prefix to add to the summary
|
|
126
|
+
*/
|
|
77
127
|
summaryPrefix: zod_v3.z.string().optional(),
|
|
128
|
+
/**
|
|
129
|
+
* @deprecated Use `trigger: { tokens: value }` instead.
|
|
130
|
+
*/
|
|
78
131
|
maxTokensBeforeSummary: zod_v3.z.number().optional(),
|
|
132
|
+
/**
|
|
133
|
+
* @deprecated Use `keep: { messages: value }` instead.
|
|
134
|
+
*/
|
|
79
135
|
messagesToKeep: zod_v3.z.number().optional()
|
|
80
136
|
});
|
|
81
137
|
/**
|
|
@@ -140,7 +196,12 @@ function summarizationMiddleware(options) {
|
|
|
140
196
|
if (error) throw new Error(`Invalid summarization middleware options: ${zod_v4.z.prettifyError(error)}`);
|
|
141
197
|
return require_middleware.createMiddleware({
|
|
142
198
|
name: "SummarizationMiddleware",
|
|
143
|
-
contextSchema: contextSchema.extend({
|
|
199
|
+
contextSchema: contextSchema.extend({
|
|
200
|
+
/**
|
|
201
|
+
* `model` should be required when initializing the middleware,
|
|
202
|
+
* but can be omitted within context when invoking the middleware.
|
|
203
|
+
*/
|
|
204
|
+
model: zod_v3.z.custom().optional() }),
|
|
144
205
|
beforeModel: async (state, runtime) => {
|
|
145
206
|
let trigger = userOptions.trigger;
|
|
146
207
|
let keep = userOptions.keep;
|
|
@@ -1 +1 @@
|
|
|
1
|
-
{"version":3,"file":"summarization.cjs","names":["z","z4","createMiddleware","initChatModel","countTokensApproximately","HumanMessage","RemoveMessage","REMOVE_ALL_MESSAGES","SystemMessage","AIMessage","hasToolCalls","ToolMessage"],"sources":["../../../src/agents/middleware/summarization.ts"],"sourcesContent":["import { z } from \"zod/v3\";\nimport { z as z4 } from \"zod/v4\";\nimport { v4 as uuid } from \"@langchain/core/utils/uuid\";\nimport {\n BaseMessage,\n AIMessage,\n SystemMessage,\n ToolMessage,\n RemoveMessage,\n trimMessages,\n HumanMessage,\n getBufferString,\n} from \"@langchain/core/messages\";\nimport {\n BaseLanguageModel,\n getModelContextSize,\n} from \"@langchain/core/language_models/base\";\nimport {\n interopSafeParse,\n InferInteropZodInput,\n InferInteropZodOutput,\n} from \"@langchain/core/utils/types\";\nimport {\n mergeConfigs,\n pickRunnableConfigKeys,\n type RunnableConfig,\n} from \"@langchain/core/runnables\";\nimport { REMOVE_ALL_MESSAGES } from \"@langchain/langgraph\";\nimport { createMiddleware } from \"../middleware.js\";\nimport { countTokensApproximately } from \"./utils.js\";\nimport { hasToolCalls } from \"../utils.js\";\nimport { initChatModel } from \"../../chat_models/universal.js\";\nimport type { Runtime } from \"../runtime.js\";\n\nexport const DEFAULT_SUMMARY_PROMPT = `<role>\nContext Extraction Assistant\n</role>\n\n<primary_objective>\nYour sole objective in this task is to extract the highest quality/most relevant context from the conversation history below.\n</primary_objective>\n\n<objective_information>\nYou're nearing the total number of input tokens you can accept, so you must extract the highest quality/most relevant pieces of information from your conversation history.\nThis context will then overwrite the conversation history presented below. Because of this, ensure the context you extract is only the most important information to your overall goal.\n</objective_information>\n\n<instructions>\nThe conversation history below will be replaced with the context you extract in this step. Because of this, you must do your very best to extract and record all of the most important context from the conversation history.\nYou want to ensure that you don't repeat any actions you've already completed, so the context you extract from the conversation history should be focused on the most important information to your overall goal.\n</instructions>\n\nThe user will message you with the full message history you'll be extracting context from, to then replace. Carefully read over it all, and think deeply about what information is most important to your overall goal that should be saved:\n\nWith all of this in mind, please carefully read over the entire conversation history, and extract the most important and relevant context to replace it so that you can free up space in the conversation history.\nRespond ONLY with the extracted context. Do not include any additional information, or text before or after the extracted context.\n\n<messages>\nMessages to summarize:\n{messages}\n</messages>`;\n\nconst DEFAULT_SUMMARY_PREFIX = \"Here is a summary of the conversation to date:\";\nconst DEFAULT_MESSAGES_TO_KEEP = 20;\nconst DEFAULT_TRIM_TOKEN_LIMIT = 4000;\nconst DEFAULT_FALLBACK_MESSAGE_COUNT = 15;\nconst SEARCH_RANGE_FOR_TOOL_PAIRS = 5;\n\nconst tokenCounterSchema = z\n .function()\n .args(z.array(z.custom<BaseMessage>()))\n .returns(z.union([z.number(), z.promise(z.number())]));\nexport type TokenCounter = (\n messages: BaseMessage[]\n) => number | Promise<number>;\n\nexport const contextSizeSchema = z\n .object({\n /**\n * Fraction of the model's context size to use as the trigger\n */\n fraction: z\n .number()\n .gt(0, \"Fraction must be greater than 0\")\n .max(1, \"Fraction must be less than or equal to 1\")\n .optional(),\n /**\n * Number of tokens to use as the trigger\n */\n tokens: z.number().positive(\"Tokens must be greater than 0\").optional(),\n /**\n * Number of messages to use as the trigger\n */\n messages: z\n .number()\n .int(\"Messages must be an integer\")\n .positive(\"Messages must be greater than 0\")\n .optional(),\n })\n .refine(\n (data) => {\n const count = [data.fraction, data.tokens, data.messages].filter(\n (v) => v !== undefined\n ).length;\n return count >= 1;\n },\n {\n message: \"At least one of fraction, tokens, or messages must be provided\",\n }\n );\nexport type ContextSize = z.infer<typeof contextSizeSchema>;\n\nexport const keepSchema = z\n .object({\n /**\n * Fraction of the model's context size to keep\n */\n fraction: z\n .number()\n .min(0, \"Messages must be non-negative\")\n .max(1, \"Fraction must be less than or equal to 1\")\n .optional(),\n /**\n * Number of tokens to keep\n */\n tokens: z\n .number()\n .min(0, \"Tokens must be greater than or equal to 0\")\n .optional(),\n messages: z\n .number()\n .int(\"Messages must be an integer\")\n .min(0, \"Messages must be non-negative\")\n .optional(),\n })\n .refine(\n (data) => {\n const count = [data.fraction, data.tokens, data.messages].filter(\n (v) => v !== undefined\n ).length;\n return count === 1;\n },\n {\n message: \"Exactly one of fraction, tokens, or messages must be provided\",\n }\n );\nexport type KeepSize = z.infer<typeof keepSchema>;\n\nconst contextSchema = z.object({\n /**\n * Model to use for summarization\n */\n model: z.custom<string | BaseLanguageModel>(),\n /**\n * Trigger conditions for summarization.\n * Can be a single condition object (all properties must be met) or an array of conditions (any condition must be met).\n *\n * @example\n * ```ts\n * // Single condition: trigger if tokens >= 5000 AND messages >= 3\n * trigger: { tokens: 5000, messages: 3 }\n *\n * // Multiple conditions: trigger if (tokens >= 5000 AND messages >= 3) OR (tokens >= 3000 AND messages >= 6)\n * trigger: [\n * { tokens: 5000, messages: 3 },\n * { tokens: 3000, messages: 6 }\n * ]\n * ```\n */\n trigger: z.union([contextSizeSchema, z.array(contextSizeSchema)]).optional(),\n /**\n * Keep conditions for summarization\n */\n keep: keepSchema.optional(),\n /**\n * Token counter function to use for summarization\n */\n tokenCounter: tokenCounterSchema.optional(),\n /**\n * Summary prompt to use for summarization\n * @default {@link DEFAULT_SUMMARY_PROMPT}\n */\n summaryPrompt: z.string().default(DEFAULT_SUMMARY_PROMPT),\n /**\n * Number of tokens to trim to before summarizing\n */\n trimTokensToSummarize: z.number().optional(),\n /**\n * Prefix to add to the summary\n */\n summaryPrefix: z.string().optional(),\n /**\n * @deprecated Use `trigger: { tokens: value }` instead.\n */\n maxTokensBeforeSummary: z.number().optional(),\n /**\n * @deprecated Use `keep: { messages: value }` instead.\n */\n messagesToKeep: z.number().optional(),\n});\n\nexport type SummarizationMiddlewareConfig = InferInteropZodInput<\n typeof contextSchema\n>;\n\n/**\n * Get max input tokens from model profile or fallback to model name lookup\n */\nexport function getProfileLimits(input: BaseLanguageModel): number | undefined {\n // Access maxInputTokens on the model profile directly if available\n if (\n \"profile\" in input &&\n typeof input.profile === \"object\" &&\n input.profile &&\n \"maxInputTokens\" in input.profile &&\n (typeof input.profile.maxInputTokens === \"number\" ||\n input.profile.maxInputTokens == null)\n ) {\n return input.profile.maxInputTokens ?? undefined;\n }\n\n // Fallback to using model name if available\n if (\"model\" in input && typeof input.model === \"string\") {\n return getModelContextSize(input.model);\n }\n if (\"modelName\" in input && typeof input.modelName === \"string\") {\n return getModelContextSize(input.modelName);\n }\n\n return undefined;\n}\n\n/**\n * Summarization middleware that automatically summarizes conversation history when token limits are approached.\n *\n * This middleware monitors message token counts and automatically summarizes older\n * messages when a threshold is reached, preserving recent messages and maintaining\n * context continuity by ensuring AI/Tool message pairs remain together.\n *\n * @param options Configuration options for the summarization middleware\n * @returns A middleware instance\n *\n * @example\n * ```ts\n * import { summarizationMiddleware } from \"langchain\";\n * import { createAgent } from \"langchain\";\n *\n * // Single condition: trigger if tokens >= 4000 AND messages >= 10\n * const agent1 = createAgent({\n * llm: model,\n * tools: [getWeather],\n * middleware: [\n * summarizationMiddleware({\n * model: new ChatOpenAI({ model: \"gpt-4o\" }),\n * trigger: { tokens: 4000, messages: 10 },\n * keep: { messages: 20 },\n * })\n * ],\n * });\n *\n * // Multiple conditions: trigger if (tokens >= 5000 AND messages >= 3) OR (tokens >= 3000 AND messages >= 6)\n * const agent2 = createAgent({\n * llm: model,\n * tools: [getWeather],\n * middleware: [\n * summarizationMiddleware({\n * model: new ChatOpenAI({ model: \"gpt-4o\" }),\n * trigger: [\n * { tokens: 5000, messages: 3 },\n * { tokens: 3000, messages: 6 },\n * ],\n * keep: { messages: 20 },\n * })\n * ],\n * });\n *\n * ```\n */\nexport function summarizationMiddleware(\n options: SummarizationMiddlewareConfig\n) {\n /**\n * Parse user options to get their explicit values\n */\n const { data: userOptions, error } = interopSafeParse(contextSchema, options);\n if (error) {\n throw new Error(\n `Invalid summarization middleware options: ${z4.prettifyError(error)}`\n );\n }\n\n return createMiddleware({\n name: \"SummarizationMiddleware\",\n contextSchema: contextSchema.extend({\n /**\n * `model` should be required when initializing the middleware,\n * but can be omitted within context when invoking the middleware.\n */\n model: z.custom<BaseLanguageModel>().optional(),\n }),\n beforeModel: async (state, runtime) => {\n let trigger: ContextSize | ContextSize[] | undefined =\n userOptions.trigger;\n let keep: ContextSize = userOptions.keep as InferInteropZodOutput<\n typeof keepSchema\n >;\n\n /**\n * Handle deprecated parameters\n */\n if (userOptions.maxTokensBeforeSummary !== undefined) {\n console.warn(\n \"maxTokensBeforeSummary is deprecated. Use `trigger: { tokens: value }` instead.\"\n );\n if (trigger === undefined) {\n trigger = { tokens: userOptions.maxTokensBeforeSummary };\n }\n }\n\n /**\n * Handle deprecated parameters\n */\n if (userOptions.messagesToKeep !== undefined) {\n console.warn(\n \"messagesToKeep is deprecated. Use `keep: { messages: value }` instead.\"\n );\n if (\n !keep ||\n (keep &&\n \"messages\" in keep &&\n keep.messages === DEFAULT_MESSAGES_TO_KEEP)\n ) {\n keep = { messages: userOptions.messagesToKeep };\n }\n }\n\n /**\n * Merge context with user options\n */\n const resolvedTrigger =\n runtime.context?.trigger !== undefined\n ? runtime.context.trigger\n : trigger;\n const resolvedKeep =\n runtime.context?.keep !== undefined\n ? runtime.context.keep\n : (keep ?? { messages: DEFAULT_MESSAGES_TO_KEEP });\n\n const validatedKeep = keepSchema.parse(resolvedKeep);\n\n /**\n * Validate trigger conditions\n */\n let triggerConditions: ContextSize[] = [];\n if (resolvedTrigger === undefined) {\n triggerConditions = [];\n } else if (Array.isArray(resolvedTrigger)) {\n /**\n * It's an array of ContextSize objects\n */\n triggerConditions = (resolvedTrigger as ContextSize[]).map((t) =>\n contextSizeSchema.parse(t)\n );\n } else {\n /**\n * Single ContextSize object - all properties must be satisfied (AND logic)\n */\n triggerConditions = [contextSizeSchema.parse(resolvedTrigger)];\n }\n\n /**\n * Check if profile is required\n */\n const requiresProfile =\n triggerConditions.some((c) => \"fraction\" in c) ||\n \"fraction\" in validatedKeep;\n\n const model =\n typeof userOptions.model === \"string\"\n ? await initChatModel(userOptions.model)\n : userOptions.model;\n\n if (requiresProfile && !getProfileLimits(model)) {\n throw new Error(\n \"Model profile information is required to use fractional token limits. \" +\n \"Use absolute token counts instead.\"\n );\n }\n\n const summaryPrompt =\n runtime.context?.summaryPrompt === DEFAULT_SUMMARY_PROMPT\n ? (userOptions.summaryPrompt ?? DEFAULT_SUMMARY_PROMPT)\n : (runtime.context?.summaryPrompt ??\n userOptions.summaryPrompt ??\n DEFAULT_SUMMARY_PROMPT);\n const summaryPrefix =\n runtime.context.summaryPrefix ??\n userOptions.summaryPrefix ??\n DEFAULT_SUMMARY_PREFIX;\n const trimTokensToSummarize =\n runtime.context?.trimTokensToSummarize !== undefined\n ? runtime.context.trimTokensToSummarize\n : (userOptions.trimTokensToSummarize ?? DEFAULT_TRIM_TOKEN_LIMIT);\n\n /**\n * Ensure all messages have IDs\n */\n ensureMessageIds(state.messages);\n\n const tokenCounter =\n runtime.context?.tokenCounter !== undefined\n ? runtime.context.tokenCounter\n : (userOptions.tokenCounter ?? countTokensApproximately);\n const totalTokens = await tokenCounter(state.messages);\n const doSummarize = await shouldSummarize(\n state.messages,\n totalTokens,\n triggerConditions,\n model\n );\n\n if (!doSummarize) {\n return;\n }\n\n const { systemPrompt, conversationMessages } = splitSystemMessage(\n state.messages\n );\n const cutoffIndex = await determineCutoffIndex(\n conversationMessages,\n validatedKeep,\n tokenCounter,\n model\n );\n\n if (cutoffIndex <= 0) {\n return;\n }\n\n const { messagesToSummarize, preservedMessages } = partitionMessages(\n systemPrompt,\n conversationMessages,\n cutoffIndex\n );\n\n const summary = await createSummary(\n messagesToSummarize,\n model,\n summaryPrompt,\n tokenCounter,\n trimTokensToSummarize,\n runtime\n );\n\n const summaryMessage = new HumanMessage({\n content: `${summaryPrefix}\\n\\n${summary}`,\n id: uuid(),\n additional_kwargs: { lc_source: \"summarization\" },\n });\n\n return {\n messages: [\n new RemoveMessage({ id: REMOVE_ALL_MESSAGES }),\n summaryMessage,\n ...preservedMessages,\n ],\n };\n },\n });\n}\n\n/**\n * Ensure all messages have unique IDs\n */\nfunction ensureMessageIds(messages: BaseMessage[]): void {\n for (const msg of messages) {\n if (!msg.id) {\n msg.id = uuid();\n }\n }\n}\n\n/**\n * Separate system message from conversation messages\n */\nfunction splitSystemMessage(messages: BaseMessage[]): {\n systemPrompt?: SystemMessage;\n conversationMessages: BaseMessage[];\n} {\n if (messages.length > 0 && SystemMessage.isInstance(messages[0])) {\n return {\n systemPrompt: messages[0] as SystemMessage,\n conversationMessages: messages.slice(1),\n };\n }\n return {\n conversationMessages: messages,\n };\n}\n\n/**\n * Partition messages into those to summarize and those to preserve\n */\nfunction partitionMessages(\n systemPrompt: SystemMessage | undefined,\n conversationMessages: BaseMessage[],\n cutoffIndex: number\n): { messagesToSummarize: BaseMessage[]; preservedMessages: BaseMessage[] } {\n const messagesToSummarize = conversationMessages.slice(0, cutoffIndex);\n const preservedMessages = conversationMessages.slice(cutoffIndex);\n\n // Include system message in messages to summarize to capture previous summaries\n if (systemPrompt) {\n messagesToSummarize.unshift(systemPrompt);\n }\n\n return { messagesToSummarize, preservedMessages };\n}\n\n/**\n * Determine whether summarization should run for the current token usage\n *\n * @param messages - Current messages in the conversation\n * @param totalTokens - Total token count for all messages\n * @param triggerConditions - Array of trigger conditions. Returns true if ANY condition is satisfied (OR logic).\n * Within each condition, ALL specified properties must be satisfied (AND logic).\n * @param model - The language model being used\n * @returns true if summarization should be triggered\n */\nasync function shouldSummarize(\n messages: BaseMessage[],\n totalTokens: number,\n triggerConditions: ContextSize[],\n model: BaseLanguageModel\n): Promise<boolean> {\n if (triggerConditions.length === 0) {\n return false;\n }\n\n /**\n * Check each condition (OR logic between conditions)\n */\n for (const trigger of triggerConditions) {\n /**\n * Within a single condition, all specified properties must be satisfied (AND logic)\n */\n let conditionMet = true;\n let hasAnyProperty = false;\n\n if (trigger.messages !== undefined) {\n hasAnyProperty = true;\n if (messages.length < trigger.messages) {\n conditionMet = false;\n }\n }\n\n if (trigger.tokens !== undefined) {\n hasAnyProperty = true;\n if (totalTokens < trigger.tokens) {\n conditionMet = false;\n }\n }\n\n if (trigger.fraction !== undefined) {\n hasAnyProperty = true;\n const maxInputTokens = getProfileLimits(model);\n if (typeof maxInputTokens === \"number\") {\n const threshold = Math.floor(maxInputTokens * trigger.fraction);\n if (totalTokens < threshold) {\n conditionMet = false;\n }\n } else {\n /**\n * If fraction is specified but we can't get model limits, skip this condition\n */\n conditionMet = false;\n }\n }\n\n /**\n * If condition has at least one property and all properties are satisfied, trigger summarization\n */\n if (hasAnyProperty && conditionMet) {\n return true;\n }\n }\n\n return false;\n}\n\n/**\n * Determine cutoff index respecting retention configuration\n */\nasync function determineCutoffIndex(\n messages: BaseMessage[],\n keep: ContextSize,\n tokenCounter: TokenCounter,\n model: BaseLanguageModel\n): Promise<number> {\n if (\"tokens\" in keep || \"fraction\" in keep) {\n const tokenBasedCutoff = await findTokenBasedCutoff(\n messages,\n keep,\n tokenCounter,\n model\n );\n if (typeof tokenBasedCutoff === \"number\") {\n return tokenBasedCutoff;\n }\n /**\n * Fallback to message count if token-based fails\n */\n return findSafeCutoff(messages, DEFAULT_MESSAGES_TO_KEEP);\n }\n /**\n * find cutoff index based on message count\n */\n return findSafeCutoff(messages, keep.messages ?? DEFAULT_MESSAGES_TO_KEEP);\n}\n\n/**\n * Find cutoff index based on target token retention\n */\nasync function findTokenBasedCutoff(\n messages: BaseMessage[],\n keep: ContextSize,\n tokenCounter: TokenCounter,\n model: BaseLanguageModel\n): Promise<number | undefined> {\n if (messages.length === 0) {\n return 0;\n }\n\n let targetTokenCount: number;\n\n if (\"fraction\" in keep && keep.fraction !== undefined) {\n const maxInputTokens = getProfileLimits(model);\n if (typeof maxInputTokens !== \"number\") {\n return;\n }\n targetTokenCount = Math.floor(maxInputTokens * keep.fraction);\n } else if (\"tokens\" in keep && keep.tokens !== undefined) {\n targetTokenCount = Math.floor(keep.tokens);\n } else {\n return;\n }\n\n if (targetTokenCount <= 0) {\n targetTokenCount = 1;\n }\n\n const totalTokens = await tokenCounter(messages);\n if (totalTokens <= targetTokenCount) {\n return 0;\n }\n\n /**\n * Use binary search to identify the earliest message index that keeps the\n * suffix within the token budget.\n */\n let left = 0;\n let right = messages.length;\n let cutoffCandidate = messages.length;\n const maxIterations = Math.floor(Math.log2(messages.length)) + 1;\n\n for (let i = 0; i < maxIterations; i++) {\n if (left >= right) {\n break;\n }\n\n const mid = Math.floor((left + right) / 2);\n const suffixTokens = await tokenCounter(messages.slice(mid));\n if (suffixTokens <= targetTokenCount) {\n cutoffCandidate = mid;\n right = mid;\n } else {\n left = mid + 1;\n }\n }\n\n if (cutoffCandidate === messages.length) {\n cutoffCandidate = left;\n }\n\n if (cutoffCandidate >= messages.length) {\n if (messages.length === 1) {\n return 0;\n }\n cutoffCandidate = messages.length - 1;\n }\n\n /**\n * Find safe cutoff point that preserves AI/Tool pairs.\n * If cutoff lands on ToolMessage, move backward to include the AIMessage.\n */\n const safeCutoff = findSafeCutoffPoint(messages, cutoffCandidate);\n\n /**\n * If findSafeCutoffPoint moved forward (fallback case), verify it's safe.\n * If it moved backward, we already have a safe point.\n */\n if (safeCutoff <= cutoffCandidate) {\n return safeCutoff;\n }\n\n /**\n * Fallback: iterate backward to find a safe cutoff\n */\n for (let i = cutoffCandidate; i >= 0; i--) {\n if (isSafeCutoffPoint(messages, i)) {\n return i;\n }\n }\n\n return 0;\n}\n\n/**\n * Find safe cutoff point that preserves AI/Tool message pairs\n */\nfunction findSafeCutoff(\n messages: BaseMessage[],\n messagesToKeep: number\n): number {\n if (messages.length <= messagesToKeep) {\n return 0;\n }\n\n const targetCutoff = messages.length - messagesToKeep;\n\n /**\n * First, try to find a safe cutoff point using findSafeCutoffPoint.\n * This handles the case where cutoff lands on a ToolMessage by moving\n * backward to include the corresponding AIMessage.\n */\n const safeCutoff = findSafeCutoffPoint(messages, targetCutoff);\n\n /**\n * If findSafeCutoffPoint moved backward (found matching AIMessage), use it.\n */\n if (safeCutoff <= targetCutoff) {\n return safeCutoff;\n }\n\n /**\n * Fallback: iterate backward to find a safe cutoff\n */\n for (let i = targetCutoff; i >= 0; i--) {\n if (isSafeCutoffPoint(messages, i)) {\n return i;\n }\n }\n\n return 0;\n}\n\n/**\n * Check if cutting at index would separate AI/Tool message pairs\n */\nfunction isSafeCutoffPoint(\n messages: BaseMessage[],\n cutoffIndex: number\n): boolean {\n if (cutoffIndex >= messages.length) {\n return true;\n }\n\n /**\n * Prevent preserved messages from starting with AI message containing tool calls\n */\n if (\n cutoffIndex < messages.length &&\n AIMessage.isInstance(messages[cutoffIndex]) &&\n hasToolCalls(messages[cutoffIndex])\n ) {\n return false;\n }\n\n const searchStart = Math.max(0, cutoffIndex - SEARCH_RANGE_FOR_TOOL_PAIRS);\n const searchEnd = Math.min(\n messages.length,\n cutoffIndex + SEARCH_RANGE_FOR_TOOL_PAIRS\n );\n\n for (let i = searchStart; i < searchEnd; i++) {\n if (!hasToolCalls(messages[i])) {\n continue;\n }\n\n const toolCallIds = extractToolCallIds(messages[i] as AIMessage);\n if (cutoffSeparatesToolPair(messages, i, cutoffIndex, toolCallIds)) {\n return false;\n }\n }\n\n return true;\n}\n\n/**\n * Extract tool call IDs from an AI message\n */\nfunction extractToolCallIds(aiMessage: AIMessage): Set<string> {\n const toolCallIds = new Set<string>();\n if (aiMessage.tool_calls) {\n for (const toolCall of aiMessage.tool_calls) {\n const id =\n typeof toolCall === \"object\" && \"id\" in toolCall ? toolCall.id : null;\n if (id) {\n toolCallIds.add(id);\n }\n }\n }\n return toolCallIds;\n}\n\n/**\n * Find a safe cutoff point that doesn't split AI/Tool message pairs.\n *\n * If the message at `cutoffIndex` is a `ToolMessage`, search backward for the\n * `AIMessage` containing the corresponding `tool_calls` and adjust the cutoff to\n * include it. This ensures tool call requests and responses stay together.\n *\n * Falls back to advancing forward past `ToolMessage` objects only if no matching\n * `AIMessage` is found (edge case).\n */\nfunction findSafeCutoffPoint(\n messages: BaseMessage[],\n cutoffIndex: number\n): number {\n if (\n cutoffIndex >= messages.length ||\n !ToolMessage.isInstance(messages[cutoffIndex])\n ) {\n return cutoffIndex;\n }\n\n // Collect tool_call_ids from consecutive ToolMessages at/after cutoff\n const toolCallIds = new Set<string>();\n let idx = cutoffIndex;\n while (idx < messages.length && ToolMessage.isInstance(messages[idx])) {\n const toolMsg = messages[idx] as ToolMessage;\n if (toolMsg.tool_call_id) {\n toolCallIds.add(toolMsg.tool_call_id);\n }\n idx++;\n }\n\n // Search backward for AIMessage with matching tool_calls\n for (let i = cutoffIndex - 1; i >= 0; i--) {\n const msg = messages[i];\n if (AIMessage.isInstance(msg) && hasToolCalls(msg)) {\n const aiToolCallIds = extractToolCallIds(msg as AIMessage);\n // Check if there's any overlap between the tool_call_ids\n for (const id of toolCallIds) {\n if (aiToolCallIds.has(id)) {\n // Found the AIMessage - move cutoff to include it\n return i;\n }\n }\n }\n }\n\n // Fallback: no matching AIMessage found, advance past ToolMessages to avoid\n // orphaned tool responses\n return idx;\n}\n\n/**\n * Check if cutoff separates an AI message from its corresponding tool messages\n */\nfunction cutoffSeparatesToolPair(\n messages: BaseMessage[],\n aiMessageIndex: number,\n cutoffIndex: number,\n toolCallIds: Set<string>\n): boolean {\n for (let j = aiMessageIndex + 1; j < messages.length; j++) {\n const message = messages[j];\n if (\n ToolMessage.isInstance(message) &&\n toolCallIds.has(message.tool_call_id)\n ) {\n const aiBeforeCutoff = aiMessageIndex < cutoffIndex;\n const toolBeforeCutoff = j < cutoffIndex;\n if (aiBeforeCutoff !== toolBeforeCutoff) {\n return true;\n }\n }\n }\n return false;\n}\n\n/**\n * Generate summary for the given messages.\n *\n * @param messagesToSummarize - Messages to summarize.\n * @param model - The language model to use for summarization.\n * @param summaryPrompt - The prompt template for summarization.\n * @param tokenCounter - Function to count tokens.\n * @param trimTokensToSummarize - Optional token limit for trimming messages.\n * @param runtime - The runtime environment, used to inherit config so that\n * LangGraph's handlers can properly track and tag the summarization model call.\n */\nasync function createSummary(\n messagesToSummarize: BaseMessage[],\n model: BaseLanguageModel,\n summaryPrompt: string,\n tokenCounter: TokenCounter,\n trimTokensToSummarize: number | undefined,\n runtime: Runtime<unknown>\n): Promise<string> {\n if (!messagesToSummarize.length) {\n return \"No previous conversation history.\";\n }\n\n const trimmedMessages = await trimMessagesForSummary(\n messagesToSummarize,\n tokenCounter,\n trimTokensToSummarize\n );\n\n if (!trimmedMessages.length) {\n return \"Previous conversation was too long to summarize.\";\n }\n\n /**\n * Format messages using getBufferString to avoid token inflation from metadata\n * when str() / JSON.stringify is called on message objects.\n * This produces compact output like:\n * ```\n * Human: What's the weather?\n * AI: Let me check...[tool_calls]\n * Tool: 72°F and sunny\n * ```\n */\n const formattedMessages = getBufferString(trimmedMessages);\n\n try {\n const formattedPrompt = summaryPrompt.replace(\n \"{messages}\",\n formattedMessages\n );\n /**\n * Merge parent runnable config with summarization metadata so LangGraph's\n * stream handlers (and other callback-based consumers) can properly track\n * and tag the summarization model call.\n */\n const baseConfig: RunnableConfig = pickRunnableConfigKeys(runtime) ?? {};\n const config = mergeConfigs(baseConfig, {\n metadata: { lc_source: \"summarization\" },\n });\n const response = await model.invoke(formattedPrompt, config);\n const content = response.content;\n /**\n * Handle both string content and MessageContent array\n */\n if (typeof content === \"string\") {\n return content.trim();\n } else if (Array.isArray(content)) {\n /**\n * Extract text from MessageContent array\n */\n const textContent = content\n .map((item) => {\n if (typeof item === \"string\") return item;\n if (typeof item === \"object\" && item !== null && \"text\" in item) {\n return (item as { text: string }).text;\n }\n return \"\";\n })\n .join(\"\");\n return textContent.trim();\n }\n return \"Error generating summary: Invalid response format\";\n } catch (e) {\n return `Error generating summary: ${e}`;\n }\n}\n\n/**\n * Trim messages to fit within summary generation limits\n */\nasync function trimMessagesForSummary(\n messages: BaseMessage[],\n tokenCounter: TokenCounter,\n trimTokensToSummarize: number | undefined\n): Promise<BaseMessage[]> {\n if (trimTokensToSummarize === undefined) {\n return messages;\n }\n\n try {\n return await trimMessages(messages, {\n maxTokens: trimTokensToSummarize,\n tokenCounter: async (msgs) => tokenCounter(msgs),\n strategy: \"last\",\n allowPartial: true,\n includeSystem: true,\n });\n } catch {\n /**\n * Fallback to last N messages if trimming fails\n */\n return messages.slice(-DEFAULT_FALLBACK_MESSAGE_COUNT);\n }\n}\n"],"mappings":";;;;;;;;;;;;;;AAkCA,MAAa,yBAAyB;;;;;;;;;;;;;;;;;;;;;;;;;;;AA4BtC,MAAM,yBAAyB;AAC/B,MAAM,2BAA2B;AACjC,MAAM,2BAA2B;AACjC,MAAM,iCAAiC;AACvC,MAAM,8BAA8B;AAEpC,MAAM,qBAAqBA,OAAAA,EACxB,UAAU,CACV,KAAKA,OAAAA,EAAE,MAAMA,OAAAA,EAAE,QAAqB,CAAC,CAAC,CACtC,QAAQA,OAAAA,EAAE,MAAM,CAACA,OAAAA,EAAE,QAAQ,EAAEA,OAAAA,EAAE,QAAQA,OAAAA,EAAE,QAAQ,CAAC,CAAC,CAAC,CAAC;AAKxD,MAAa,oBAAoBA,OAAAA,EAC9B,OAAO;CAIN,UAAUA,OAAAA,EACP,QAAQ,CACR,GAAG,GAAG,kCAAkC,CACxC,IAAI,GAAG,2CAA2C,CAClD,UAAU;CAIb,QAAQA,OAAAA,EAAE,QAAQ,CAAC,SAAS,gCAAgC,CAAC,UAAU;CAIvE,UAAUA,OAAAA,EACP,QAAQ,CACR,IAAI,8BAA8B,CAClC,SAAS,kCAAkC,CAC3C,UAAU;CACd,CAAC,CACD,QACE,SAAS;AAIR,QAHc;EAAC,KAAK;EAAU,KAAK;EAAQ,KAAK;EAAS,CAAC,QACvD,MAAM,MAAM,KAAA,EACd,CAAC,UACc;GAElB,EACE,SAAS,kEACV,CACF;AAGH,MAAa,aAAaA,OAAAA,EACvB,OAAO;CAIN,UAAUA,OAAAA,EACP,QAAQ,CACR,IAAI,GAAG,gCAAgC,CACvC,IAAI,GAAG,2CAA2C,CAClD,UAAU;CAIb,QAAQA,OAAAA,EACL,QAAQ,CACR,IAAI,GAAG,4CAA4C,CACnD,UAAU;CACb,UAAUA,OAAAA,EACP,QAAQ,CACR,IAAI,8BAA8B,CAClC,IAAI,GAAG,gCAAgC,CACvC,UAAU;CACd,CAAC,CACD,QACE,SAAS;AAIR,QAHc;EAAC,KAAK;EAAU,KAAK;EAAQ,KAAK;EAAS,CAAC,QACvD,MAAM,MAAM,KAAA,EACd,CAAC,WACe;GAEnB,EACE,SAAS,iEACV,CACF;AAGH,MAAM,gBAAgBA,OAAAA,EAAE,OAAO;CAI7B,OAAOA,OAAAA,EAAE,QAAoC;CAiB7C,SAASA,OAAAA,EAAE,MAAM,CAAC,mBAAmBA,OAAAA,EAAE,MAAM,kBAAkB,CAAC,CAAC,CAAC,UAAU;CAI5E,MAAM,WAAW,UAAU;CAI3B,cAAc,mBAAmB,UAAU;CAK3C,eAAeA,OAAAA,EAAE,QAAQ,CAAC,QAAQ,uBAAuB;CAIzD,uBAAuBA,OAAAA,EAAE,QAAQ,CAAC,UAAU;CAI5C,eAAeA,OAAAA,EAAE,QAAQ,CAAC,UAAU;CAIpC,wBAAwBA,OAAAA,EAAE,QAAQ,CAAC,UAAU;CAI7C,gBAAgBA,OAAAA,EAAE,QAAQ,CAAC,UAAU;CACtC,CAAC;;;;AASF,SAAgB,iBAAiB,OAA8C;AAE7E,KACE,aAAa,SACb,OAAO,MAAM,YAAY,YACzB,MAAM,WACN,oBAAoB,MAAM,YACzB,OAAO,MAAM,QAAQ,mBAAmB,YACvC,MAAM,QAAQ,kBAAkB,MAElC,QAAO,MAAM,QAAQ,kBAAkB,KAAA;AAIzC,KAAI,WAAW,SAAS,OAAO,MAAM,UAAU,SAC7C,SAAA,GAAA,qCAAA,qBAA2B,MAAM,MAAM;AAEzC,KAAI,eAAe,SAAS,OAAO,MAAM,cAAc,SACrD,SAAA,GAAA,qCAAA,qBAA2B,MAAM,UAAU;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;AAoD/C,SAAgB,wBACd,SACA;;;;CAIA,MAAM,EAAE,MAAM,aAAa,WAAA,GAAA,4BAAA,kBAA2B,eAAe,QAAQ;AAC7E,KAAI,MACF,OAAM,IAAI,MACR,6CAA6CC,OAAAA,EAAG,cAAc,MAAM,GACrE;AAGH,QAAOC,mBAAAA,iBAAiB;EACtB,MAAM;EACN,eAAe,cAAc,OAAO,EAKlC,OAAOF,OAAAA,EAAE,QAA2B,CAAC,UAAU,EAChD,CAAC;EACF,aAAa,OAAO,OAAO,YAAY;GACrC,IAAI,UACF,YAAY;GACd,IAAI,OAAoB,YAAY;;;;AAOpC,OAAI,YAAY,2BAA2B,KAAA,GAAW;AACpD,YAAQ,KACN,kFACD;AACD,QAAI,YAAY,KAAA,EACd,WAAU,EAAE,QAAQ,YAAY,wBAAwB;;;;;AAO5D,OAAI,YAAY,mBAAmB,KAAA,GAAW;AAC5C,YAAQ,KACN,yEACD;AACD,QACE,CAAC,QACA,QACC,cAAc,QACd,KAAK,aAAa,yBAEpB,QAAO,EAAE,UAAU,YAAY,gBAAgB;;;;;GAOnD,MAAM,kBACJ,QAAQ,SAAS,YAAY,KAAA,IACzB,QAAQ,QAAQ,UAChB;GACN,MAAM,eACJ,QAAQ,SAAS,SAAS,KAAA,IACtB,QAAQ,QAAQ,OACf,QAAQ,EAAE,UAAU,0BAA0B;GAErD,MAAM,gBAAgB,WAAW,MAAM,aAAa;;;;GAKpD,IAAI,oBAAmC,EAAE;AACzC,OAAI,oBAAoB,KAAA,EACtB,qBAAoB,EAAE;YACb,MAAM,QAAQ,gBAAgB;;;;AAIvC,uBAAqB,gBAAkC,KAAK,MAC1D,kBAAkB,MAAM,EAAE,CAC3B;;;;;AAKD,uBAAoB,CAAC,kBAAkB,MAAM,gBAAgB,CAAC;;;;GAMhE,MAAM,kBACJ,kBAAkB,MAAM,MAAM,cAAc,EAAE,IAC9C,cAAc;GAEhB,MAAM,QACJ,OAAO,YAAY,UAAU,WACzB,MAAMG,8BAAAA,cAAc,YAAY,MAAM,GACtC,YAAY;AAElB,OAAI,mBAAmB,CAAC,iBAAiB,MAAM,CAC7C,OAAM,IAAI,MACR,2GAED;GAGH,MAAM,gBACJ,QAAQ,SAAS,kBAAkB,yBAC9B,YAAY,iBAAiB,yBAC7B,QAAQ,SAAS,iBAClB,YAAY,iBACZ;GACN,MAAM,gBACJ,QAAQ,QAAQ,iBAChB,YAAY,iBACZ;GACF,MAAM,wBACJ,QAAQ,SAAS,0BAA0B,KAAA,IACvC,QAAQ,QAAQ,wBACf,YAAY,yBAAyB;;;;AAK5C,oBAAiB,MAAM,SAAS;GAEhC,MAAM,eACJ,QAAQ,SAAS,iBAAiB,KAAA,IAC9B,QAAQ,QAAQ,eACf,YAAY,gBAAgBC,gBAAAA;GACnC,MAAM,cAAc,MAAM,aAAa,MAAM,SAAS;AAQtD,OAAI,CAPgB,MAAM,gBACxB,MAAM,UACN,aACA,mBACA,MACD,CAGC;GAGF,MAAM,EAAE,cAAc,yBAAyB,mBAC7C,MAAM,SACP;GACD,MAAM,cAAc,MAAM,qBACxB,sBACA,eACA,cACA,MACD;AAED,OAAI,eAAe,EACjB;GAGF,MAAM,EAAE,qBAAqB,sBAAsB,kBACjD,cACA,sBACA,YACD;GAWD,MAAM,iBAAiB,IAAIC,yBAAAA,aAAa;IACtC,SAAS,GAAG,cAAc,MAVZ,MAAM,cACpB,qBACA,OACA,eACA,cACA,uBACA,QACD;IAIC,KAAA,GAAA,2BAAA,KAAU;IACV,mBAAmB,EAAE,WAAW,iBAAiB;IAClD,CAAC;AAEF,UAAO,EACL,UAAU;IACR,IAAIC,yBAAAA,cAAc,EAAE,IAAIC,qBAAAA,qBAAqB,CAAC;IAC9C;IACA,GAAG;IACJ,EACF;;EAEJ,CAAC;;;;;AAMJ,SAAS,iBAAiB,UAA+B;AACvD,MAAK,MAAM,OAAO,SAChB,KAAI,CAAC,IAAI,GACP,KAAI,MAAA,GAAA,2BAAA,KAAW;;;;;AAQrB,SAAS,mBAAmB,UAG1B;AACA,KAAI,SAAS,SAAS,KAAKC,yBAAAA,cAAc,WAAW,SAAS,GAAG,CAC9D,QAAO;EACL,cAAc,SAAS;EACvB,sBAAsB,SAAS,MAAM,EAAE;EACxC;AAEH,QAAO,EACL,sBAAsB,UACvB;;;;;AAMH,SAAS,kBACP,cACA,sBACA,aAC0E;CAC1E,MAAM,sBAAsB,qBAAqB,MAAM,GAAG,YAAY;CACtE,MAAM,oBAAoB,qBAAqB,MAAM,YAAY;AAGjE,KAAI,aACF,qBAAoB,QAAQ,aAAa;AAG3C,QAAO;EAAE;EAAqB;EAAmB;;;;;;;;;;;;AAanD,eAAe,gBACb,UACA,aACA,mBACA,OACkB;AAClB,KAAI,kBAAkB,WAAW,EAC/B,QAAO;;;;AAMT,MAAK,MAAM,WAAW,mBAAmB;;;;EAIvC,IAAI,eAAe;EACnB,IAAI,iBAAiB;AAErB,MAAI,QAAQ,aAAa,KAAA,GAAW;AAClC,oBAAiB;AACjB,OAAI,SAAS,SAAS,QAAQ,SAC5B,gBAAe;;AAInB,MAAI,QAAQ,WAAW,KAAA,GAAW;AAChC,oBAAiB;AACjB,OAAI,cAAc,QAAQ,OACxB,gBAAe;;AAInB,MAAI,QAAQ,aAAa,KAAA,GAAW;AAClC,oBAAiB;GACjB,MAAM,iBAAiB,iBAAiB,MAAM;AAC9C,OAAI,OAAO,mBAAmB;QAExB,cADc,KAAK,MAAM,iBAAiB,QAAQ,SAAS,CAE7D,gBAAe;;;;;AAMjB,kBAAe;;;;;AAOnB,MAAI,kBAAkB,aACpB,QAAO;;AAIX,QAAO;;;;;AAMT,eAAe,qBACb,UACA,MACA,cACA,OACiB;AACjB,KAAI,YAAY,QAAQ,cAAc,MAAM;EAC1C,MAAM,mBAAmB,MAAM,qBAC7B,UACA,MACA,cACA,MACD;AACD,MAAI,OAAO,qBAAqB,SAC9B,QAAO;;;;AAKT,SAAO,eAAe,UAAU,yBAAyB;;;;;AAK3D,QAAO,eAAe,UAAU,KAAK,YAAY,yBAAyB;;;;;AAM5E,eAAe,qBACb,UACA,MACA,cACA,OAC6B;AAC7B,KAAI,SAAS,WAAW,EACtB,QAAO;CAGT,IAAI;AAEJ,KAAI,cAAc,QAAQ,KAAK,aAAa,KAAA,GAAW;EACrD,MAAM,iBAAiB,iBAAiB,MAAM;AAC9C,MAAI,OAAO,mBAAmB,SAC5B;AAEF,qBAAmB,KAAK,MAAM,iBAAiB,KAAK,SAAS;YACpD,YAAY,QAAQ,KAAK,WAAW,KAAA,EAC7C,oBAAmB,KAAK,MAAM,KAAK,OAAO;KAE1C;AAGF,KAAI,oBAAoB,EACtB,oBAAmB;AAIrB,KADoB,MAAM,aAAa,SAAS,IAC7B,iBACjB,QAAO;;;;;CAOT,IAAI,OAAO;CACX,IAAI,QAAQ,SAAS;CACrB,IAAI,kBAAkB,SAAS;CAC/B,MAAM,gBAAgB,KAAK,MAAM,KAAK,KAAK,SAAS,OAAO,CAAC,GAAG;AAE/D,MAAK,IAAI,IAAI,GAAG,IAAI,eAAe,KAAK;AACtC,MAAI,QAAQ,MACV;EAGF,MAAM,MAAM,KAAK,OAAO,OAAO,SAAS,EAAE;AAE1C,MADqB,MAAM,aAAa,SAAS,MAAM,IAAI,CAAC,IACxC,kBAAkB;AACpC,qBAAkB;AAClB,WAAQ;QAER,QAAO,MAAM;;AAIjB,KAAI,oBAAoB,SAAS,OAC/B,mBAAkB;AAGpB,KAAI,mBAAmB,SAAS,QAAQ;AACtC,MAAI,SAAS,WAAW,EACtB,QAAO;AAET,oBAAkB,SAAS,SAAS;;;;;;CAOtC,MAAM,aAAa,oBAAoB,UAAU,gBAAgB;;;;;AAMjE,KAAI,cAAc,gBAChB,QAAO;;;;AAMT,MAAK,IAAI,IAAI,iBAAiB,KAAK,GAAG,IACpC,KAAI,kBAAkB,UAAU,EAAE,CAChC,QAAO;AAIX,QAAO;;;;;AAMT,SAAS,eACP,UACA,gBACQ;AACR,KAAI,SAAS,UAAU,eACrB,QAAO;CAGT,MAAM,eAAe,SAAS,SAAS;;;;;;CAOvC,MAAM,aAAa,oBAAoB,UAAU,aAAa;;;;AAK9D,KAAI,cAAc,aAChB,QAAO;;;;AAMT,MAAK,IAAI,IAAI,cAAc,KAAK,GAAG,IACjC,KAAI,kBAAkB,UAAU,EAAE,CAChC,QAAO;AAIX,QAAO;;;;;AAMT,SAAS,kBACP,UACA,aACS;AACT,KAAI,eAAe,SAAS,OAC1B,QAAO;;;;AAMT,KACE,cAAc,SAAS,UACvBC,yBAAAA,UAAU,WAAW,SAAS,aAAa,IAC3CC,cAAAA,aAAa,SAAS,aAAa,CAEnC,QAAO;CAGT,MAAM,cAAc,KAAK,IAAI,GAAG,cAAc,4BAA4B;CAC1E,MAAM,YAAY,KAAK,IACrB,SAAS,QACT,cAAc,4BACf;AAED,MAAK,IAAI,IAAI,aAAa,IAAI,WAAW,KAAK;AAC5C,MAAI,CAACA,cAAAA,aAAa,SAAS,GAAG,CAC5B;EAGF,MAAM,cAAc,mBAAmB,SAAS,GAAgB;AAChE,MAAI,wBAAwB,UAAU,GAAG,aAAa,YAAY,CAChE,QAAO;;AAIX,QAAO;;;;;AAMT,SAAS,mBAAmB,WAAmC;CAC7D,MAAM,8BAAc,IAAI,KAAa;AACrC,KAAI,UAAU,WACZ,MAAK,MAAM,YAAY,UAAU,YAAY;EAC3C,MAAM,KACJ,OAAO,aAAa,YAAY,QAAQ,WAAW,SAAS,KAAK;AACnE,MAAI,GACF,aAAY,IAAI,GAAG;;AAIzB,QAAO;;;;;;;;;;;;AAaT,SAAS,oBACP,UACA,aACQ;AACR,KACE,eAAe,SAAS,UACxB,CAACC,yBAAAA,YAAY,WAAW,SAAS,aAAa,CAE9C,QAAO;CAIT,MAAM,8BAAc,IAAI,KAAa;CACrC,IAAI,MAAM;AACV,QAAO,MAAM,SAAS,UAAUA,yBAAAA,YAAY,WAAW,SAAS,KAAK,EAAE;EACrE,MAAM,UAAU,SAAS;AACzB,MAAI,QAAQ,aACV,aAAY,IAAI,QAAQ,aAAa;AAEvC;;AAIF,MAAK,IAAI,IAAI,cAAc,GAAG,KAAK,GAAG,KAAK;EACzC,MAAM,MAAM,SAAS;AACrB,MAAIF,yBAAAA,UAAU,WAAW,IAAI,IAAIC,cAAAA,aAAa,IAAI,EAAE;GAClD,MAAM,gBAAgB,mBAAmB,IAAiB;AAE1D,QAAK,MAAM,MAAM,YACf,KAAI,cAAc,IAAI,GAAG,CAEvB,QAAO;;;AAQf,QAAO;;;;;AAMT,SAAS,wBACP,UACA,gBACA,aACA,aACS;AACT,MAAK,IAAI,IAAI,iBAAiB,GAAG,IAAI,SAAS,QAAQ,KAAK;EACzD,MAAM,UAAU,SAAS;AACzB,MACEC,yBAAAA,YAAY,WAAW,QAAQ,IAC/B,YAAY,IAAI,QAAQ,aAAa;OAEd,iBAAiB,gBACf,IAAI,YAE3B,QAAO;;;AAIb,QAAO;;;;;;;;;;;;;AAcT,eAAe,cACb,qBACA,OACA,eACA,cACA,uBACA,SACiB;AACjB,KAAI,CAAC,oBAAoB,OACvB,QAAO;CAGT,MAAM,kBAAkB,MAAM,uBAC5B,qBACA,cACA,sBACD;AAED,KAAI,CAAC,gBAAgB,OACnB,QAAO;;;;;;;;;;;CAaT,MAAM,qBAAA,GAAA,yBAAA,iBAAoC,gBAAgB;AAE1D,KAAI;EACF,MAAM,kBAAkB,cAAc,QACpC,cACA,kBACD;EAOD,MAAM,UAAA,GAAA,0BAAA,eAAA,GAAA,0BAAA,wBADoD,QAAQ,IAAI,EAAE,EAChC,EACtC,UAAU,EAAE,WAAW,iBAAiB,EACzC,CAAC;EAEF,MAAM,WADW,MAAM,MAAM,OAAO,iBAAiB,OAAO,EACnC;;;;AAIzB,MAAI,OAAO,YAAY,SACrB,QAAO,QAAQ,MAAM;WACZ,MAAM,QAAQ,QAAQ,CAa/B,QAToB,QACjB,KAAK,SAAS;AACb,OAAI,OAAO,SAAS,SAAU,QAAO;AACrC,OAAI,OAAO,SAAS,YAAY,SAAS,QAAQ,UAAU,KACzD,QAAQ,KAA0B;AAEpC,UAAO;IACP,CACD,KAAK,GAAG,CACQ,MAAM;AAE3B,SAAO;UACA,GAAG;AACV,SAAO,6BAA6B;;;;;;AAOxC,eAAe,uBACb,UACA,cACA,uBACwB;AACxB,KAAI,0BAA0B,KAAA,EAC5B,QAAO;AAGT,KAAI;AACF,SAAO,OAAA,GAAA,yBAAA,cAAmB,UAAU;GAClC,WAAW;GACX,cAAc,OAAO,SAAS,aAAa,KAAK;GAChD,UAAU;GACV,cAAc;GACd,eAAe;GAChB,CAAC;SACI;;;;AAIN,SAAO,SAAS,MAAM,CAAC,+BAA+B"}
|
|
1
|
+
{"version":3,"file":"summarization.cjs","names":["z","z4","createMiddleware","initChatModel","countTokensApproximately","HumanMessage","RemoveMessage","REMOVE_ALL_MESSAGES","SystemMessage","AIMessage","hasToolCalls","ToolMessage"],"sources":["../../../src/agents/middleware/summarization.ts"],"sourcesContent":["import { z } from \"zod/v3\";\nimport { z as z4 } from \"zod/v4\";\nimport { v4 as uuid } from \"@langchain/core/utils/uuid\";\nimport {\n BaseMessage,\n AIMessage,\n SystemMessage,\n ToolMessage,\n RemoveMessage,\n trimMessages,\n HumanMessage,\n getBufferString,\n} from \"@langchain/core/messages\";\nimport {\n BaseLanguageModel,\n getModelContextSize,\n} from \"@langchain/core/language_models/base\";\nimport {\n interopSafeParse,\n InferInteropZodInput,\n InferInteropZodOutput,\n} from \"@langchain/core/utils/types\";\nimport {\n mergeConfigs,\n pickRunnableConfigKeys,\n type RunnableConfig,\n} from \"@langchain/core/runnables\";\nimport { REMOVE_ALL_MESSAGES } from \"@langchain/langgraph\";\nimport { createMiddleware } from \"../middleware.js\";\nimport { countTokensApproximately } from \"./utils.js\";\nimport { hasToolCalls } from \"../utils.js\";\nimport { initChatModel } from \"../../chat_models/universal.js\";\nimport type { Runtime } from \"../runtime.js\";\n\nexport const DEFAULT_SUMMARY_PROMPT = `<role>\nContext Extraction Assistant\n</role>\n\n<primary_objective>\nYour sole objective in this task is to extract the highest quality/most relevant context from the conversation history below.\n</primary_objective>\n\n<objective_information>\nYou're nearing the total number of input tokens you can accept, so you must extract the highest quality/most relevant pieces of information from your conversation history.\nThis context will then overwrite the conversation history presented below. Because of this, ensure the context you extract is only the most important information to your overall goal.\n</objective_information>\n\n<instructions>\nThe conversation history below will be replaced with the context you extract in this step. Because of this, you must do your very best to extract and record all of the most important context from the conversation history.\nYou want to ensure that you don't repeat any actions you've already completed, so the context you extract from the conversation history should be focused on the most important information to your overall goal.\n</instructions>\n\nThe user will message you with the full message history you'll be extracting context from, to then replace. Carefully read over it all, and think deeply about what information is most important to your overall goal that should be saved:\n\nWith all of this in mind, please carefully read over the entire conversation history, and extract the most important and relevant context to replace it so that you can free up space in the conversation history.\nRespond ONLY with the extracted context. Do not include any additional information, or text before or after the extracted context.\n\n<messages>\nMessages to summarize:\n{messages}\n</messages>`;\n\nconst DEFAULT_SUMMARY_PREFIX = \"Here is a summary of the conversation to date:\";\nconst DEFAULT_MESSAGES_TO_KEEP = 20;\nconst DEFAULT_TRIM_TOKEN_LIMIT = 4000;\nconst DEFAULT_FALLBACK_MESSAGE_COUNT = 15;\nconst SEARCH_RANGE_FOR_TOOL_PAIRS = 5;\n\nconst tokenCounterSchema = z\n .function()\n .args(z.array(z.custom<BaseMessage>()))\n .returns(z.union([z.number(), z.promise(z.number())]));\nexport type TokenCounter = (\n messages: BaseMessage[]\n) => number | Promise<number>;\n\nexport const contextSizeSchema = z\n .object({\n /**\n * Fraction of the model's context size to use as the trigger\n */\n fraction: z\n .number()\n .gt(0, \"Fraction must be greater than 0\")\n .max(1, \"Fraction must be less than or equal to 1\")\n .optional(),\n /**\n * Number of tokens to use as the trigger\n */\n tokens: z.number().positive(\"Tokens must be greater than 0\").optional(),\n /**\n * Number of messages to use as the trigger\n */\n messages: z\n .number()\n .int(\"Messages must be an integer\")\n .positive(\"Messages must be greater than 0\")\n .optional(),\n })\n .refine(\n (data) => {\n const count = [data.fraction, data.tokens, data.messages].filter(\n (v) => v !== undefined\n ).length;\n return count >= 1;\n },\n {\n message: \"At least one of fraction, tokens, or messages must be provided\",\n }\n );\nexport type ContextSize = z.infer<typeof contextSizeSchema>;\n\nexport const keepSchema = z\n .object({\n /**\n * Fraction of the model's context size to keep\n */\n fraction: z\n .number()\n .min(0, \"Messages must be non-negative\")\n .max(1, \"Fraction must be less than or equal to 1\")\n .optional(),\n /**\n * Number of tokens to keep\n */\n tokens: z\n .number()\n .min(0, \"Tokens must be greater than or equal to 0\")\n .optional(),\n messages: z\n .number()\n .int(\"Messages must be an integer\")\n .min(0, \"Messages must be non-negative\")\n .optional(),\n })\n .refine(\n (data) => {\n const count = [data.fraction, data.tokens, data.messages].filter(\n (v) => v !== undefined\n ).length;\n return count === 1;\n },\n {\n message: \"Exactly one of fraction, tokens, or messages must be provided\",\n }\n );\nexport type KeepSize = z.infer<typeof keepSchema>;\n\nconst contextSchema = z.object({\n /**\n * Model to use for summarization\n */\n model: z.custom<string | BaseLanguageModel>(),\n /**\n * Trigger conditions for summarization.\n * Can be a single condition object (all properties must be met) or an array of conditions (any condition must be met).\n *\n * @example\n * ```ts\n * // Single condition: trigger if tokens >= 5000 AND messages >= 3\n * trigger: { tokens: 5000, messages: 3 }\n *\n * // Multiple conditions: trigger if (tokens >= 5000 AND messages >= 3) OR (tokens >= 3000 AND messages >= 6)\n * trigger: [\n * { tokens: 5000, messages: 3 },\n * { tokens: 3000, messages: 6 }\n * ]\n * ```\n */\n trigger: z.union([contextSizeSchema, z.array(contextSizeSchema)]).optional(),\n /**\n * Keep conditions for summarization\n */\n keep: keepSchema.optional(),\n /**\n * Token counter function to use for summarization\n */\n tokenCounter: tokenCounterSchema.optional(),\n /**\n * Summary prompt to use for summarization\n * @default {@link DEFAULT_SUMMARY_PROMPT}\n */\n summaryPrompt: z.string().default(DEFAULT_SUMMARY_PROMPT),\n /**\n * Number of tokens to trim to before summarizing\n */\n trimTokensToSummarize: z.number().optional(),\n /**\n * Prefix to add to the summary\n */\n summaryPrefix: z.string().optional(),\n /**\n * @deprecated Use `trigger: { tokens: value }` instead.\n */\n maxTokensBeforeSummary: z.number().optional(),\n /**\n * @deprecated Use `keep: { messages: value }` instead.\n */\n messagesToKeep: z.number().optional(),\n});\n\nexport type SummarizationMiddlewareConfig = InferInteropZodInput<\n typeof contextSchema\n>;\n\n/**\n * Get max input tokens from model profile or fallback to model name lookup\n */\nexport function getProfileLimits(input: BaseLanguageModel): number | undefined {\n // Access maxInputTokens on the model profile directly if available\n if (\n \"profile\" in input &&\n typeof input.profile === \"object\" &&\n input.profile &&\n \"maxInputTokens\" in input.profile &&\n (typeof input.profile.maxInputTokens === \"number\" ||\n input.profile.maxInputTokens == null)\n ) {\n return input.profile.maxInputTokens ?? undefined;\n }\n\n // Fallback to using model name if available\n if (\"model\" in input && typeof input.model === \"string\") {\n return getModelContextSize(input.model);\n }\n if (\"modelName\" in input && typeof input.modelName === \"string\") {\n return getModelContextSize(input.modelName);\n }\n\n return undefined;\n}\n\n/**\n * Summarization middleware that automatically summarizes conversation history when token limits are approached.\n *\n * This middleware monitors message token counts and automatically summarizes older\n * messages when a threshold is reached, preserving recent messages and maintaining\n * context continuity by ensuring AI/Tool message pairs remain together.\n *\n * @param options Configuration options for the summarization middleware\n * @returns A middleware instance\n *\n * @example\n * ```ts\n * import { summarizationMiddleware } from \"langchain\";\n * import { createAgent } from \"langchain\";\n *\n * // Single condition: trigger if tokens >= 4000 AND messages >= 10\n * const agent1 = createAgent({\n * llm: model,\n * tools: [getWeather],\n * middleware: [\n * summarizationMiddleware({\n * model: new ChatOpenAI({ model: \"gpt-4o\" }),\n * trigger: { tokens: 4000, messages: 10 },\n * keep: { messages: 20 },\n * })\n * ],\n * });\n *\n * // Multiple conditions: trigger if (tokens >= 5000 AND messages >= 3) OR (tokens >= 3000 AND messages >= 6)\n * const agent2 = createAgent({\n * llm: model,\n * tools: [getWeather],\n * middleware: [\n * summarizationMiddleware({\n * model: new ChatOpenAI({ model: \"gpt-4o\" }),\n * trigger: [\n * { tokens: 5000, messages: 3 },\n * { tokens: 3000, messages: 6 },\n * ],\n * keep: { messages: 20 },\n * })\n * ],\n * });\n *\n * ```\n */\nexport function summarizationMiddleware(\n options: SummarizationMiddlewareConfig\n) {\n /**\n * Parse user options to get their explicit values\n */\n const { data: userOptions, error } = interopSafeParse(contextSchema, options);\n if (error) {\n throw new Error(\n `Invalid summarization middleware options: ${z4.prettifyError(error)}`\n );\n }\n\n return createMiddleware({\n name: \"SummarizationMiddleware\",\n contextSchema: contextSchema.extend({\n /**\n * `model` should be required when initializing the middleware,\n * but can be omitted within context when invoking the middleware.\n */\n model: z.custom<BaseLanguageModel>().optional(),\n }),\n beforeModel: async (state, runtime) => {\n let trigger: ContextSize | ContextSize[] | undefined =\n userOptions.trigger;\n let keep: ContextSize = userOptions.keep as InferInteropZodOutput<\n typeof keepSchema\n >;\n\n /**\n * Handle deprecated parameters\n */\n if (userOptions.maxTokensBeforeSummary !== undefined) {\n console.warn(\n \"maxTokensBeforeSummary is deprecated. Use `trigger: { tokens: value }` instead.\"\n );\n if (trigger === undefined) {\n trigger = { tokens: userOptions.maxTokensBeforeSummary };\n }\n }\n\n /**\n * Handle deprecated parameters\n */\n if (userOptions.messagesToKeep !== undefined) {\n console.warn(\n \"messagesToKeep is deprecated. Use `keep: { messages: value }` instead.\"\n );\n if (\n !keep ||\n (keep &&\n \"messages\" in keep &&\n keep.messages === DEFAULT_MESSAGES_TO_KEEP)\n ) {\n keep = { messages: userOptions.messagesToKeep };\n }\n }\n\n /**\n * Merge context with user options\n */\n const resolvedTrigger =\n runtime.context?.trigger !== undefined\n ? runtime.context.trigger\n : trigger;\n const resolvedKeep =\n runtime.context?.keep !== undefined\n ? runtime.context.keep\n : (keep ?? { messages: DEFAULT_MESSAGES_TO_KEEP });\n\n const validatedKeep = keepSchema.parse(resolvedKeep);\n\n /**\n * Validate trigger conditions\n */\n let triggerConditions: ContextSize[] = [];\n if (resolvedTrigger === undefined) {\n triggerConditions = [];\n } else if (Array.isArray(resolvedTrigger)) {\n /**\n * It's an array of ContextSize objects\n */\n triggerConditions = (resolvedTrigger as ContextSize[]).map((t) =>\n contextSizeSchema.parse(t)\n );\n } else {\n /**\n * Single ContextSize object - all properties must be satisfied (AND logic)\n */\n triggerConditions = [contextSizeSchema.parse(resolvedTrigger)];\n }\n\n /**\n * Check if profile is required\n */\n const requiresProfile =\n triggerConditions.some((c) => \"fraction\" in c) ||\n \"fraction\" in validatedKeep;\n\n const model =\n typeof userOptions.model === \"string\"\n ? await initChatModel(userOptions.model)\n : userOptions.model;\n\n if (requiresProfile && !getProfileLimits(model)) {\n throw new Error(\n \"Model profile information is required to use fractional token limits. \" +\n \"Use absolute token counts instead.\"\n );\n }\n\n const summaryPrompt =\n runtime.context?.summaryPrompt === DEFAULT_SUMMARY_PROMPT\n ? (userOptions.summaryPrompt ?? DEFAULT_SUMMARY_PROMPT)\n : (runtime.context?.summaryPrompt ??\n userOptions.summaryPrompt ??\n DEFAULT_SUMMARY_PROMPT);\n const summaryPrefix =\n runtime.context.summaryPrefix ??\n userOptions.summaryPrefix ??\n DEFAULT_SUMMARY_PREFIX;\n const trimTokensToSummarize =\n runtime.context?.trimTokensToSummarize !== undefined\n ? runtime.context.trimTokensToSummarize\n : (userOptions.trimTokensToSummarize ?? DEFAULT_TRIM_TOKEN_LIMIT);\n\n /**\n * Ensure all messages have IDs\n */\n ensureMessageIds(state.messages);\n\n const tokenCounter =\n runtime.context?.tokenCounter !== undefined\n ? runtime.context.tokenCounter\n : (userOptions.tokenCounter ?? countTokensApproximately);\n const totalTokens = await tokenCounter(state.messages);\n const doSummarize = await shouldSummarize(\n state.messages,\n totalTokens,\n triggerConditions,\n model\n );\n\n if (!doSummarize) {\n return;\n }\n\n const { systemPrompt, conversationMessages } = splitSystemMessage(\n state.messages\n );\n const cutoffIndex = await determineCutoffIndex(\n conversationMessages,\n validatedKeep,\n tokenCounter,\n model\n );\n\n if (cutoffIndex <= 0) {\n return;\n }\n\n const { messagesToSummarize, preservedMessages } = partitionMessages(\n systemPrompt,\n conversationMessages,\n cutoffIndex\n );\n\n const summary = await createSummary(\n messagesToSummarize,\n model,\n summaryPrompt,\n tokenCounter,\n trimTokensToSummarize,\n runtime\n );\n\n const summaryMessage = new HumanMessage({\n content: `${summaryPrefix}\\n\\n${summary}`,\n id: uuid(),\n additional_kwargs: { lc_source: \"summarization\" },\n });\n\n return {\n messages: [\n new RemoveMessage({ id: REMOVE_ALL_MESSAGES }),\n summaryMessage,\n ...preservedMessages,\n ],\n };\n },\n });\n}\n\n/**\n * Ensure all messages have unique IDs\n */\nfunction ensureMessageIds(messages: BaseMessage[]): void {\n for (const msg of messages) {\n if (!msg.id) {\n msg.id = uuid();\n }\n }\n}\n\n/**\n * Separate system message from conversation messages\n */\nfunction splitSystemMessage(messages: BaseMessage[]): {\n systemPrompt?: SystemMessage;\n conversationMessages: BaseMessage[];\n} {\n if (messages.length > 0 && SystemMessage.isInstance(messages[0])) {\n return {\n systemPrompt: messages[0] as SystemMessage,\n conversationMessages: messages.slice(1),\n };\n }\n return {\n conversationMessages: messages,\n };\n}\n\n/**\n * Partition messages into those to summarize and those to preserve\n */\nfunction partitionMessages(\n systemPrompt: SystemMessage | undefined,\n conversationMessages: BaseMessage[],\n cutoffIndex: number\n): { messagesToSummarize: BaseMessage[]; preservedMessages: BaseMessage[] } {\n const messagesToSummarize = conversationMessages.slice(0, cutoffIndex);\n const preservedMessages = conversationMessages.slice(cutoffIndex);\n\n // Include system message in messages to summarize to capture previous summaries\n if (systemPrompt) {\n messagesToSummarize.unshift(systemPrompt);\n }\n\n return { messagesToSummarize, preservedMessages };\n}\n\n/**\n * Determine whether summarization should run for the current token usage\n *\n * @param messages - Current messages in the conversation\n * @param totalTokens - Total token count for all messages\n * @param triggerConditions - Array of trigger conditions. Returns true if ANY condition is satisfied (OR logic).\n * Within each condition, ALL specified properties must be satisfied (AND logic).\n * @param model - The language model being used\n * @returns true if summarization should be triggered\n */\nasync function shouldSummarize(\n messages: BaseMessage[],\n totalTokens: number,\n triggerConditions: ContextSize[],\n model: BaseLanguageModel\n): Promise<boolean> {\n if (triggerConditions.length === 0) {\n return false;\n }\n\n /**\n * Check each condition (OR logic between conditions)\n */\n for (const trigger of triggerConditions) {\n /**\n * Within a single condition, all specified properties must be satisfied (AND logic)\n */\n let conditionMet = true;\n let hasAnyProperty = false;\n\n if (trigger.messages !== undefined) {\n hasAnyProperty = true;\n if (messages.length < trigger.messages) {\n conditionMet = false;\n }\n }\n\n if (trigger.tokens !== undefined) {\n hasAnyProperty = true;\n if (totalTokens < trigger.tokens) {\n conditionMet = false;\n }\n }\n\n if (trigger.fraction !== undefined) {\n hasAnyProperty = true;\n const maxInputTokens = getProfileLimits(model);\n if (typeof maxInputTokens === \"number\") {\n const threshold = Math.floor(maxInputTokens * trigger.fraction);\n if (totalTokens < threshold) {\n conditionMet = false;\n }\n } else {\n /**\n * If fraction is specified but we can't get model limits, skip this condition\n */\n conditionMet = false;\n }\n }\n\n /**\n * If condition has at least one property and all properties are satisfied, trigger summarization\n */\n if (hasAnyProperty && conditionMet) {\n return true;\n }\n }\n\n return false;\n}\n\n/**\n * Determine cutoff index respecting retention configuration\n */\nasync function determineCutoffIndex(\n messages: BaseMessage[],\n keep: ContextSize,\n tokenCounter: TokenCounter,\n model: BaseLanguageModel\n): Promise<number> {\n if (\"tokens\" in keep || \"fraction\" in keep) {\n const tokenBasedCutoff = await findTokenBasedCutoff(\n messages,\n keep,\n tokenCounter,\n model\n );\n if (typeof tokenBasedCutoff === \"number\") {\n return tokenBasedCutoff;\n }\n /**\n * Fallback to message count if token-based fails\n */\n return findSafeCutoff(messages, DEFAULT_MESSAGES_TO_KEEP);\n }\n /**\n * find cutoff index based on message count\n */\n return findSafeCutoff(messages, keep.messages ?? DEFAULT_MESSAGES_TO_KEEP);\n}\n\n/**\n * Find cutoff index based on target token retention\n */\nasync function findTokenBasedCutoff(\n messages: BaseMessage[],\n keep: ContextSize,\n tokenCounter: TokenCounter,\n model: BaseLanguageModel\n): Promise<number | undefined> {\n if (messages.length === 0) {\n return 0;\n }\n\n let targetTokenCount: number;\n\n if (\"fraction\" in keep && keep.fraction !== undefined) {\n const maxInputTokens = getProfileLimits(model);\n if (typeof maxInputTokens !== \"number\") {\n return;\n }\n targetTokenCount = Math.floor(maxInputTokens * keep.fraction);\n } else if (\"tokens\" in keep && keep.tokens !== undefined) {\n targetTokenCount = Math.floor(keep.tokens);\n } else {\n return;\n }\n\n if (targetTokenCount <= 0) {\n targetTokenCount = 1;\n }\n\n const totalTokens = await tokenCounter(messages);\n if (totalTokens <= targetTokenCount) {\n return 0;\n }\n\n /**\n * Use binary search to identify the earliest message index that keeps the\n * suffix within the token budget.\n */\n let left = 0;\n let right = messages.length;\n let cutoffCandidate = messages.length;\n const maxIterations = Math.floor(Math.log2(messages.length)) + 1;\n\n for (let i = 0; i < maxIterations; i++) {\n if (left >= right) {\n break;\n }\n\n const mid = Math.floor((left + right) / 2);\n const suffixTokens = await tokenCounter(messages.slice(mid));\n if (suffixTokens <= targetTokenCount) {\n cutoffCandidate = mid;\n right = mid;\n } else {\n left = mid + 1;\n }\n }\n\n if (cutoffCandidate === messages.length) {\n cutoffCandidate = left;\n }\n\n if (cutoffCandidate >= messages.length) {\n if (messages.length === 1) {\n return 0;\n }\n cutoffCandidate = messages.length - 1;\n }\n\n /**\n * Find safe cutoff point that preserves AI/Tool pairs.\n * If cutoff lands on ToolMessage, move backward to include the AIMessage.\n */\n const safeCutoff = findSafeCutoffPoint(messages, cutoffCandidate);\n\n /**\n * If findSafeCutoffPoint moved forward (fallback case), verify it's safe.\n * If it moved backward, we already have a safe point.\n */\n if (safeCutoff <= cutoffCandidate) {\n return safeCutoff;\n }\n\n /**\n * Fallback: iterate backward to find a safe cutoff\n */\n for (let i = cutoffCandidate; i >= 0; i--) {\n if (isSafeCutoffPoint(messages, i)) {\n return i;\n }\n }\n\n return 0;\n}\n\n/**\n * Find safe cutoff point that preserves AI/Tool message pairs\n */\nfunction findSafeCutoff(\n messages: BaseMessage[],\n messagesToKeep: number\n): number {\n if (messages.length <= messagesToKeep) {\n return 0;\n }\n\n const targetCutoff = messages.length - messagesToKeep;\n\n /**\n * First, try to find a safe cutoff point using findSafeCutoffPoint.\n * This handles the case where cutoff lands on a ToolMessage by moving\n * backward to include the corresponding AIMessage.\n */\n const safeCutoff = findSafeCutoffPoint(messages, targetCutoff);\n\n /**\n * If findSafeCutoffPoint moved backward (found matching AIMessage), use it.\n */\n if (safeCutoff <= targetCutoff) {\n return safeCutoff;\n }\n\n /**\n * Fallback: iterate backward to find a safe cutoff\n */\n for (let i = targetCutoff; i >= 0; i--) {\n if (isSafeCutoffPoint(messages, i)) {\n return i;\n }\n }\n\n return 0;\n}\n\n/**\n * Check if cutting at index would separate AI/Tool message pairs\n */\nfunction isSafeCutoffPoint(\n messages: BaseMessage[],\n cutoffIndex: number\n): boolean {\n if (cutoffIndex >= messages.length) {\n return true;\n }\n\n /**\n * Prevent preserved messages from starting with AI message containing tool calls\n */\n if (\n cutoffIndex < messages.length &&\n AIMessage.isInstance(messages[cutoffIndex]) &&\n hasToolCalls(messages[cutoffIndex])\n ) {\n return false;\n }\n\n const searchStart = Math.max(0, cutoffIndex - SEARCH_RANGE_FOR_TOOL_PAIRS);\n const searchEnd = Math.min(\n messages.length,\n cutoffIndex + SEARCH_RANGE_FOR_TOOL_PAIRS\n );\n\n for (let i = searchStart; i < searchEnd; i++) {\n if (!hasToolCalls(messages[i])) {\n continue;\n }\n\n const toolCallIds = extractToolCallIds(messages[i] as AIMessage);\n if (cutoffSeparatesToolPair(messages, i, cutoffIndex, toolCallIds)) {\n return false;\n }\n }\n\n return true;\n}\n\n/**\n * Extract tool call IDs from an AI message\n */\nfunction extractToolCallIds(aiMessage: AIMessage): Set<string> {\n const toolCallIds = new Set<string>();\n if (aiMessage.tool_calls) {\n for (const toolCall of aiMessage.tool_calls) {\n const id =\n typeof toolCall === \"object\" && \"id\" in toolCall ? toolCall.id : null;\n if (id) {\n toolCallIds.add(id);\n }\n }\n }\n return toolCallIds;\n}\n\n/**\n * Find a safe cutoff point that doesn't split AI/Tool message pairs.\n *\n * If the message at `cutoffIndex` is a `ToolMessage`, search backward for the\n * `AIMessage` containing the corresponding `tool_calls` and adjust the cutoff to\n * include it. This ensures tool call requests and responses stay together.\n *\n * Falls back to advancing forward past `ToolMessage` objects only if no matching\n * `AIMessage` is found (edge case).\n */\nfunction findSafeCutoffPoint(\n messages: BaseMessage[],\n cutoffIndex: number\n): number {\n if (\n cutoffIndex >= messages.length ||\n !ToolMessage.isInstance(messages[cutoffIndex])\n ) {\n return cutoffIndex;\n }\n\n // Collect tool_call_ids from consecutive ToolMessages at/after cutoff\n const toolCallIds = new Set<string>();\n let idx = cutoffIndex;\n while (idx < messages.length && ToolMessage.isInstance(messages[idx])) {\n const toolMsg = messages[idx] as ToolMessage;\n if (toolMsg.tool_call_id) {\n toolCallIds.add(toolMsg.tool_call_id);\n }\n idx++;\n }\n\n // Search backward for AIMessage with matching tool_calls\n for (let i = cutoffIndex - 1; i >= 0; i--) {\n const msg = messages[i];\n if (AIMessage.isInstance(msg) && hasToolCalls(msg)) {\n const aiToolCallIds = extractToolCallIds(msg as AIMessage);\n // Check if there's any overlap between the tool_call_ids\n for (const id of toolCallIds) {\n if (aiToolCallIds.has(id)) {\n // Found the AIMessage - move cutoff to include it\n return i;\n }\n }\n }\n }\n\n // Fallback: no matching AIMessage found, advance past ToolMessages to avoid\n // orphaned tool responses\n return idx;\n}\n\n/**\n * Check if cutoff separates an AI message from its corresponding tool messages\n */\nfunction cutoffSeparatesToolPair(\n messages: BaseMessage[],\n aiMessageIndex: number,\n cutoffIndex: number,\n toolCallIds: Set<string>\n): boolean {\n for (let j = aiMessageIndex + 1; j < messages.length; j++) {\n const message = messages[j];\n if (\n ToolMessage.isInstance(message) &&\n toolCallIds.has(message.tool_call_id)\n ) {\n const aiBeforeCutoff = aiMessageIndex < cutoffIndex;\n const toolBeforeCutoff = j < cutoffIndex;\n if (aiBeforeCutoff !== toolBeforeCutoff) {\n return true;\n }\n }\n }\n return false;\n}\n\n/**\n * Generate summary for the given messages.\n *\n * @param messagesToSummarize - Messages to summarize.\n * @param model - The language model to use for summarization.\n * @param summaryPrompt - The prompt template for summarization.\n * @param tokenCounter - Function to count tokens.\n * @param trimTokensToSummarize - Optional token limit for trimming messages.\n * @param runtime - The runtime environment, used to inherit config so that\n * LangGraph's handlers can properly track and tag the summarization model call.\n */\nasync function createSummary(\n messagesToSummarize: BaseMessage[],\n model: BaseLanguageModel,\n summaryPrompt: string,\n tokenCounter: TokenCounter,\n trimTokensToSummarize: number | undefined,\n runtime: Runtime<unknown>\n): Promise<string> {\n if (!messagesToSummarize.length) {\n return \"No previous conversation history.\";\n }\n\n const trimmedMessages = await trimMessagesForSummary(\n messagesToSummarize,\n tokenCounter,\n trimTokensToSummarize\n );\n\n if (!trimmedMessages.length) {\n return \"Previous conversation was too long to summarize.\";\n }\n\n /**\n * Format messages using getBufferString to avoid token inflation from metadata\n * when str() / JSON.stringify is called on message objects.\n * This produces compact output like:\n * ```\n * Human: What's the weather?\n * AI: Let me check...[tool_calls]\n * Tool: 72°F and sunny\n * ```\n */\n const formattedMessages = getBufferString(trimmedMessages);\n\n try {\n const formattedPrompt = summaryPrompt.replace(\n \"{messages}\",\n formattedMessages\n );\n /**\n * Merge parent runnable config with summarization metadata so LangGraph's\n * stream handlers (and other callback-based consumers) can properly track\n * and tag the summarization model call.\n */\n const baseConfig: RunnableConfig = pickRunnableConfigKeys(runtime) ?? {};\n const config = mergeConfigs(baseConfig, {\n metadata: { lc_source: \"summarization\" },\n });\n const response = await model.invoke(formattedPrompt, config);\n const content = response.content;\n /**\n * Handle both string content and MessageContent array\n */\n if (typeof content === \"string\") {\n return content.trim();\n } else if (Array.isArray(content)) {\n /**\n * Extract text from MessageContent array\n */\n const textContent = content\n .map((item) => {\n if (typeof item === \"string\") return item;\n if (typeof item === \"object\" && item !== null && \"text\" in item) {\n return (item as { text: string }).text;\n }\n return \"\";\n })\n .join(\"\");\n return textContent.trim();\n }\n return \"Error generating summary: Invalid response format\";\n } catch (e) {\n return `Error generating summary: ${e}`;\n }\n}\n\n/**\n * Trim messages to fit within summary generation limits\n */\nasync function trimMessagesForSummary(\n messages: BaseMessage[],\n tokenCounter: TokenCounter,\n trimTokensToSummarize: number | undefined\n): Promise<BaseMessage[]> {\n if (trimTokensToSummarize === undefined) {\n return messages;\n }\n\n try {\n return await trimMessages(messages, {\n maxTokens: trimTokensToSummarize,\n tokenCounter: async (msgs) => tokenCounter(msgs),\n strategy: \"last\",\n allowPartial: true,\n includeSystem: true,\n });\n } catch {\n /**\n * Fallback to last N messages if trimming fails\n */\n return messages.slice(-DEFAULT_FALLBACK_MESSAGE_COUNT);\n }\n}\n"],"mappings":";;;;;;;;;;;;;;AAkCA,MAAa,yBAAyB;;;;;;;;;;;;;;;;;;;;;;;;;;;AA4BtC,MAAM,yBAAyB;AAC/B,MAAM,2BAA2B;AACjC,MAAM,2BAA2B;AACjC,MAAM,iCAAiC;AACvC,MAAM,8BAA8B;AAEpC,MAAM,qBAAqBA,OAAAA,EACxB,UAAU,CACV,KAAKA,OAAAA,EAAE,MAAMA,OAAAA,EAAE,QAAqB,CAAC,CAAC,CACtC,QAAQA,OAAAA,EAAE,MAAM,CAACA,OAAAA,EAAE,QAAQ,EAAEA,OAAAA,EAAE,QAAQA,OAAAA,EAAE,QAAQ,CAAC,CAAC,CAAC,CAAC;AAKxD,MAAa,oBAAoBA,OAAAA,EAC9B,OAAO;;;;CAIN,UAAUA,OAAAA,EACP,QAAQ,CACR,GAAG,GAAG,kCAAkC,CACxC,IAAI,GAAG,2CAA2C,CAClD,UAAU;;;;CAIb,QAAQA,OAAAA,EAAE,QAAQ,CAAC,SAAS,gCAAgC,CAAC,UAAU;;;;CAIvE,UAAUA,OAAAA,EACP,QAAQ,CACR,IAAI,8BAA8B,CAClC,SAAS,kCAAkC,CAC3C,UAAU;CACd,CAAC,CACD,QACE,SAAS;AAIR,QAHc;EAAC,KAAK;EAAU,KAAK;EAAQ,KAAK;EAAS,CAAC,QACvD,MAAM,MAAM,KAAA,EACd,CAAC,UACc;GAElB,EACE,SAAS,kEACV,CACF;AAGH,MAAa,aAAaA,OAAAA,EACvB,OAAO;;;;CAIN,UAAUA,OAAAA,EACP,QAAQ,CACR,IAAI,GAAG,gCAAgC,CACvC,IAAI,GAAG,2CAA2C,CAClD,UAAU;;;;CAIb,QAAQA,OAAAA,EACL,QAAQ,CACR,IAAI,GAAG,4CAA4C,CACnD,UAAU;CACb,UAAUA,OAAAA,EACP,QAAQ,CACR,IAAI,8BAA8B,CAClC,IAAI,GAAG,gCAAgC,CACvC,UAAU;CACd,CAAC,CACD,QACE,SAAS;AAIR,QAHc;EAAC,KAAK;EAAU,KAAK;EAAQ,KAAK;EAAS,CAAC,QACvD,MAAM,MAAM,KAAA,EACd,CAAC,WACe;GAEnB,EACE,SAAS,iEACV,CACF;AAGH,MAAM,gBAAgBA,OAAAA,EAAE,OAAO;;;;CAI7B,OAAOA,OAAAA,EAAE,QAAoC;;;;;;;;;;;;;;;;;CAiB7C,SAASA,OAAAA,EAAE,MAAM,CAAC,mBAAmBA,OAAAA,EAAE,MAAM,kBAAkB,CAAC,CAAC,CAAC,UAAU;;;;CAI5E,MAAM,WAAW,UAAU;;;;CAI3B,cAAc,mBAAmB,UAAU;;;;;CAK3C,eAAeA,OAAAA,EAAE,QAAQ,CAAC,QAAQ,uBAAuB;;;;CAIzD,uBAAuBA,OAAAA,EAAE,QAAQ,CAAC,UAAU;;;;CAI5C,eAAeA,OAAAA,EAAE,QAAQ,CAAC,UAAU;;;;CAIpC,wBAAwBA,OAAAA,EAAE,QAAQ,CAAC,UAAU;;;;CAI7C,gBAAgBA,OAAAA,EAAE,QAAQ,CAAC,UAAU;CACtC,CAAC;;;;AASF,SAAgB,iBAAiB,OAA8C;AAE7E,KACE,aAAa,SACb,OAAO,MAAM,YAAY,YACzB,MAAM,WACN,oBAAoB,MAAM,YACzB,OAAO,MAAM,QAAQ,mBAAmB,YACvC,MAAM,QAAQ,kBAAkB,MAElC,QAAO,MAAM,QAAQ,kBAAkB,KAAA;AAIzC,KAAI,WAAW,SAAS,OAAO,MAAM,UAAU,SAC7C,SAAA,GAAA,qCAAA,qBAA2B,MAAM,MAAM;AAEzC,KAAI,eAAe,SAAS,OAAO,MAAM,cAAc,SACrD,SAAA,GAAA,qCAAA,qBAA2B,MAAM,UAAU;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;;AAoD/C,SAAgB,wBACd,SACA;;;;CAIA,MAAM,EAAE,MAAM,aAAa,WAAA,GAAA,4BAAA,kBAA2B,eAAe,QAAQ;AAC7E,KAAI,MACF,OAAM,IAAI,MACR,6CAA6CC,OAAAA,EAAG,cAAc,MAAM,GACrE;AAGH,QAAOC,mBAAAA,iBAAiB;EACtB,MAAM;EACN,eAAe,cAAc,OAAO;;;;;AAKlC,OAAOF,OAAAA,EAAE,QAA2B,CAAC,UAAU,EAChD,CAAC;EACF,aAAa,OAAO,OAAO,YAAY;GACrC,IAAI,UACF,YAAY;GACd,IAAI,OAAoB,YAAY;;;;AAOpC,OAAI,YAAY,2BAA2B,KAAA,GAAW;AACpD,YAAQ,KACN,kFACD;AACD,QAAI,YAAY,KAAA,EACd,WAAU,EAAE,QAAQ,YAAY,wBAAwB;;;;;AAO5D,OAAI,YAAY,mBAAmB,KAAA,GAAW;AAC5C,YAAQ,KACN,yEACD;AACD,QACE,CAAC,QACA,QACC,cAAc,QACd,KAAK,aAAa,yBAEpB,QAAO,EAAE,UAAU,YAAY,gBAAgB;;;;;GAOnD,MAAM,kBACJ,QAAQ,SAAS,YAAY,KAAA,IACzB,QAAQ,QAAQ,UAChB;GACN,MAAM,eACJ,QAAQ,SAAS,SAAS,KAAA,IACtB,QAAQ,QAAQ,OACf,QAAQ,EAAE,UAAU,0BAA0B;GAErD,MAAM,gBAAgB,WAAW,MAAM,aAAa;;;;GAKpD,IAAI,oBAAmC,EAAE;AACzC,OAAI,oBAAoB,KAAA,EACtB,qBAAoB,EAAE;YACb,MAAM,QAAQ,gBAAgB;;;;AAIvC,uBAAqB,gBAAkC,KAAK,MAC1D,kBAAkB,MAAM,EAAE,CAC3B;;;;;AAKD,uBAAoB,CAAC,kBAAkB,MAAM,gBAAgB,CAAC;;;;GAMhE,MAAM,kBACJ,kBAAkB,MAAM,MAAM,cAAc,EAAE,IAC9C,cAAc;GAEhB,MAAM,QACJ,OAAO,YAAY,UAAU,WACzB,MAAMG,8BAAAA,cAAc,YAAY,MAAM,GACtC,YAAY;AAElB,OAAI,mBAAmB,CAAC,iBAAiB,MAAM,CAC7C,OAAM,IAAI,MACR,2GAED;GAGH,MAAM,gBACJ,QAAQ,SAAS,kBAAkB,yBAC9B,YAAY,iBAAiB,yBAC7B,QAAQ,SAAS,iBAClB,YAAY,iBACZ;GACN,MAAM,gBACJ,QAAQ,QAAQ,iBAChB,YAAY,iBACZ;GACF,MAAM,wBACJ,QAAQ,SAAS,0BAA0B,KAAA,IACvC,QAAQ,QAAQ,wBACf,YAAY,yBAAyB;;;;AAK5C,oBAAiB,MAAM,SAAS;GAEhC,MAAM,eACJ,QAAQ,SAAS,iBAAiB,KAAA,IAC9B,QAAQ,QAAQ,eACf,YAAY,gBAAgBC,gBAAAA;GACnC,MAAM,cAAc,MAAM,aAAa,MAAM,SAAS;AAQtD,OAAI,CAAC,MAPqB,gBACxB,MAAM,UACN,aACA,mBACA,MACD,CAGC;GAGF,MAAM,EAAE,cAAc,yBAAyB,mBAC7C,MAAM,SACP;GACD,MAAM,cAAc,MAAM,qBACxB,sBACA,eACA,cACA,MACD;AAED,OAAI,eAAe,EACjB;GAGF,MAAM,EAAE,qBAAqB,sBAAsB,kBACjD,cACA,sBACA,YACD;GAWD,MAAM,iBAAiB,IAAIC,yBAAAA,aAAa;IACtC,SAAS,GAAG,cAAc,MAAM,MAVZ,cACpB,qBACA,OACA,eACA,cACA,uBACA,QACD;IAIC,KAAA,GAAA,2BAAA,KAAU;IACV,mBAAmB,EAAE,WAAW,iBAAiB;IAClD,CAAC;AAEF,UAAO,EACL,UAAU;IACR,IAAIC,yBAAAA,cAAc,EAAE,IAAIC,qBAAAA,qBAAqB,CAAC;IAC9C;IACA,GAAG;IACJ,EACF;;EAEJ,CAAC;;;;;AAMJ,SAAS,iBAAiB,UAA+B;AACvD,MAAK,MAAM,OAAO,SAChB,KAAI,CAAC,IAAI,GACP,KAAI,MAAA,GAAA,2BAAA,KAAW;;;;;AAQrB,SAAS,mBAAmB,UAG1B;AACA,KAAI,SAAS,SAAS,KAAKC,yBAAAA,cAAc,WAAW,SAAS,GAAG,CAC9D,QAAO;EACL,cAAc,SAAS;EACvB,sBAAsB,SAAS,MAAM,EAAE;EACxC;AAEH,QAAO,EACL,sBAAsB,UACvB;;;;;AAMH,SAAS,kBACP,cACA,sBACA,aAC0E;CAC1E,MAAM,sBAAsB,qBAAqB,MAAM,GAAG,YAAY;CACtE,MAAM,oBAAoB,qBAAqB,MAAM,YAAY;AAGjE,KAAI,aACF,qBAAoB,QAAQ,aAAa;AAG3C,QAAO;EAAE;EAAqB;EAAmB;;;;;;;;;;;;AAanD,eAAe,gBACb,UACA,aACA,mBACA,OACkB;AAClB,KAAI,kBAAkB,WAAW,EAC/B,QAAO;;;;AAMT,MAAK,MAAM,WAAW,mBAAmB;;;;EAIvC,IAAI,eAAe;EACnB,IAAI,iBAAiB;AAErB,MAAI,QAAQ,aAAa,KAAA,GAAW;AAClC,oBAAiB;AACjB,OAAI,SAAS,SAAS,QAAQ,SAC5B,gBAAe;;AAInB,MAAI,QAAQ,WAAW,KAAA,GAAW;AAChC,oBAAiB;AACjB,OAAI,cAAc,QAAQ,OACxB,gBAAe;;AAInB,MAAI,QAAQ,aAAa,KAAA,GAAW;AAClC,oBAAiB;GACjB,MAAM,iBAAiB,iBAAiB,MAAM;AAC9C,OAAI,OAAO,mBAAmB;QAExB,cADc,KAAK,MAAM,iBAAiB,QAAQ,SAC3B,CACzB,gBAAe;;;;;AAMjB,kBAAe;;;;;AAOnB,MAAI,kBAAkB,aACpB,QAAO;;AAIX,QAAO;;;;;AAMT,eAAe,qBACb,UACA,MACA,cACA,OACiB;AACjB,KAAI,YAAY,QAAQ,cAAc,MAAM;EAC1C,MAAM,mBAAmB,MAAM,qBAC7B,UACA,MACA,cACA,MACD;AACD,MAAI,OAAO,qBAAqB,SAC9B,QAAO;;;;AAKT,SAAO,eAAe,UAAU,yBAAyB;;;;;AAK3D,QAAO,eAAe,UAAU,KAAK,YAAY,yBAAyB;;;;;AAM5E,eAAe,qBACb,UACA,MACA,cACA,OAC6B;AAC7B,KAAI,SAAS,WAAW,EACtB,QAAO;CAGT,IAAI;AAEJ,KAAI,cAAc,QAAQ,KAAK,aAAa,KAAA,GAAW;EACrD,MAAM,iBAAiB,iBAAiB,MAAM;AAC9C,MAAI,OAAO,mBAAmB,SAC5B;AAEF,qBAAmB,KAAK,MAAM,iBAAiB,KAAK,SAAS;YACpD,YAAY,QAAQ,KAAK,WAAW,KAAA,EAC7C,oBAAmB,KAAK,MAAM,KAAK,OAAO;KAE1C;AAGF,KAAI,oBAAoB,EACtB,oBAAmB;AAIrB,KAAI,MADsB,aAAa,SAAS,IAC7B,iBACjB,QAAO;;;;;CAOT,IAAI,OAAO;CACX,IAAI,QAAQ,SAAS;CACrB,IAAI,kBAAkB,SAAS;CAC/B,MAAM,gBAAgB,KAAK,MAAM,KAAK,KAAK,SAAS,OAAO,CAAC,GAAG;AAE/D,MAAK,IAAI,IAAI,GAAG,IAAI,eAAe,KAAK;AACtC,MAAI,QAAQ,MACV;EAGF,MAAM,MAAM,KAAK,OAAO,OAAO,SAAS,EAAE;AAE1C,MAAI,MADuB,aAAa,SAAS,MAAM,IAAI,CAAC,IACxC,kBAAkB;AACpC,qBAAkB;AAClB,WAAQ;QAER,QAAO,MAAM;;AAIjB,KAAI,oBAAoB,SAAS,OAC/B,mBAAkB;AAGpB,KAAI,mBAAmB,SAAS,QAAQ;AACtC,MAAI,SAAS,WAAW,EACtB,QAAO;AAET,oBAAkB,SAAS,SAAS;;;;;;CAOtC,MAAM,aAAa,oBAAoB,UAAU,gBAAgB;;;;;AAMjE,KAAI,cAAc,gBAChB,QAAO;;;;AAMT,MAAK,IAAI,IAAI,iBAAiB,KAAK,GAAG,IACpC,KAAI,kBAAkB,UAAU,EAAE,CAChC,QAAO;AAIX,QAAO;;;;;AAMT,SAAS,eACP,UACA,gBACQ;AACR,KAAI,SAAS,UAAU,eACrB,QAAO;CAGT,MAAM,eAAe,SAAS,SAAS;;;;;;CAOvC,MAAM,aAAa,oBAAoB,UAAU,aAAa;;;;AAK9D,KAAI,cAAc,aAChB,QAAO;;;;AAMT,MAAK,IAAI,IAAI,cAAc,KAAK,GAAG,IACjC,KAAI,kBAAkB,UAAU,EAAE,CAChC,QAAO;AAIX,QAAO;;;;;AAMT,SAAS,kBACP,UACA,aACS;AACT,KAAI,eAAe,SAAS,OAC1B,QAAO;;;;AAMT,KACE,cAAc,SAAS,UACvBC,yBAAAA,UAAU,WAAW,SAAS,aAAa,IAC3CC,cAAAA,aAAa,SAAS,aAAa,CAEnC,QAAO;CAGT,MAAM,cAAc,KAAK,IAAI,GAAG,cAAc,4BAA4B;CAC1E,MAAM,YAAY,KAAK,IACrB,SAAS,QACT,cAAc,4BACf;AAED,MAAK,IAAI,IAAI,aAAa,IAAI,WAAW,KAAK;AAC5C,MAAI,CAACA,cAAAA,aAAa,SAAS,GAAG,CAC5B;EAGF,MAAM,cAAc,mBAAmB,SAAS,GAAgB;AAChE,MAAI,wBAAwB,UAAU,GAAG,aAAa,YAAY,CAChE,QAAO;;AAIX,QAAO;;;;;AAMT,SAAS,mBAAmB,WAAmC;CAC7D,MAAM,8BAAc,IAAI,KAAa;AACrC,KAAI,UAAU,WACZ,MAAK,MAAM,YAAY,UAAU,YAAY;EAC3C,MAAM,KACJ,OAAO,aAAa,YAAY,QAAQ,WAAW,SAAS,KAAK;AACnE,MAAI,GACF,aAAY,IAAI,GAAG;;AAIzB,QAAO;;;;;;;;;;;;AAaT,SAAS,oBACP,UACA,aACQ;AACR,KACE,eAAe,SAAS,UACxB,CAACC,yBAAAA,YAAY,WAAW,SAAS,aAAa,CAE9C,QAAO;CAIT,MAAM,8BAAc,IAAI,KAAa;CACrC,IAAI,MAAM;AACV,QAAO,MAAM,SAAS,UAAUA,yBAAAA,YAAY,WAAW,SAAS,KAAK,EAAE;EACrE,MAAM,UAAU,SAAS;AACzB,MAAI,QAAQ,aACV,aAAY,IAAI,QAAQ,aAAa;AAEvC;;AAIF,MAAK,IAAI,IAAI,cAAc,GAAG,KAAK,GAAG,KAAK;EACzC,MAAM,MAAM,SAAS;AACrB,MAAIF,yBAAAA,UAAU,WAAW,IAAI,IAAIC,cAAAA,aAAa,IAAI,EAAE;GAClD,MAAM,gBAAgB,mBAAmB,IAAiB;AAE1D,QAAK,MAAM,MAAM,YACf,KAAI,cAAc,IAAI,GAAG,CAEvB,QAAO;;;AAQf,QAAO;;;;;AAMT,SAAS,wBACP,UACA,gBACA,aACA,aACS;AACT,MAAK,IAAI,IAAI,iBAAiB,GAAG,IAAI,SAAS,QAAQ,KAAK;EACzD,MAAM,UAAU,SAAS;AACzB,MACEC,yBAAAA,YAAY,WAAW,QAAQ,IAC/B,YAAY,IAAI,QAAQ,aAAa;OAEd,iBAAiB,gBACf,IAAI,YAE3B,QAAO;;;AAIb,QAAO;;;;;;;;;;;;;AAcT,eAAe,cACb,qBACA,OACA,eACA,cACA,uBACA,SACiB;AACjB,KAAI,CAAC,oBAAoB,OACvB,QAAO;CAGT,MAAM,kBAAkB,MAAM,uBAC5B,qBACA,cACA,sBACD;AAED,KAAI,CAAC,gBAAgB,OACnB,QAAO;;;;;;;;;;;CAaT,MAAM,qBAAA,GAAA,yBAAA,iBAAoC,gBAAgB;AAE1D,KAAI;EACF,MAAM,kBAAkB,cAAc,QACpC,cACA,kBACD;EAOD,MAAM,UAAA,GAAA,0BAAA,eAAA,GAAA,0BAAA,wBADoD,QAAQ,IAAI,EAAE,EAChC,EACtC,UAAU,EAAE,WAAW,iBAAiB,EACzC,CAAC;EAEF,MAAM,WAAU,MADO,MAAM,OAAO,iBAAiB,OAAO,EACnC;;;;AAIzB,MAAI,OAAO,YAAY,SACrB,QAAO,QAAQ,MAAM;WACZ,MAAM,QAAQ,QAAQ,CAa/B,QAToB,QACjB,KAAK,SAAS;AACb,OAAI,OAAO,SAAS,SAAU,QAAO;AACrC,OAAI,OAAO,SAAS,YAAY,SAAS,QAAQ,UAAU,KACzD,QAAQ,KAA0B;AAEpC,UAAO;IACP,CACD,KAAK,GACU,CAAC,MAAM;AAE3B,SAAO;UACA,GAAG;AACV,SAAO,6BAA6B;;;;;;AAOxC,eAAe,uBACb,UACA,cACA,uBACwB;AACxB,KAAI,0BAA0B,KAAA,EAC5B,QAAO;AAGT,KAAI;AACF,SAAO,OAAA,GAAA,yBAAA,cAAmB,UAAU;GAClC,WAAW;GACX,cAAc,OAAO,SAAS,aAAa,KAAK;GAChD,UAAU;GACV,cAAc;GACd,eAAe;GAChB,CAAC;SACI;;;;AAIN,SAAO,SAAS,MAAM,CAAC,+BAA+B"}
|
|
@@ -45,8 +45,17 @@ const DEFAULT_FALLBACK_MESSAGE_COUNT = 15;
|
|
|
45
45
|
const SEARCH_RANGE_FOR_TOOL_PAIRS = 5;
|
|
46
46
|
const tokenCounterSchema = z$1.function().args(z$1.array(z$1.custom())).returns(z$1.union([z$1.number(), z$1.promise(z$1.number())]));
|
|
47
47
|
const contextSizeSchema = z$1.object({
|
|
48
|
+
/**
|
|
49
|
+
* Fraction of the model's context size to use as the trigger
|
|
50
|
+
*/
|
|
48
51
|
fraction: z$1.number().gt(0, "Fraction must be greater than 0").max(1, "Fraction must be less than or equal to 1").optional(),
|
|
52
|
+
/**
|
|
53
|
+
* Number of tokens to use as the trigger
|
|
54
|
+
*/
|
|
49
55
|
tokens: z$1.number().positive("Tokens must be greater than 0").optional(),
|
|
56
|
+
/**
|
|
57
|
+
* Number of messages to use as the trigger
|
|
58
|
+
*/
|
|
50
59
|
messages: z$1.number().int("Messages must be an integer").positive("Messages must be greater than 0").optional()
|
|
51
60
|
}).refine((data) => {
|
|
52
61
|
return [
|
|
@@ -56,7 +65,13 @@ const contextSizeSchema = z$1.object({
|
|
|
56
65
|
].filter((v) => v !== void 0).length >= 1;
|
|
57
66
|
}, { message: "At least one of fraction, tokens, or messages must be provided" });
|
|
58
67
|
const keepSchema = z$1.object({
|
|
68
|
+
/**
|
|
69
|
+
* Fraction of the model's context size to keep
|
|
70
|
+
*/
|
|
59
71
|
fraction: z$1.number().min(0, "Messages must be non-negative").max(1, "Fraction must be less than or equal to 1").optional(),
|
|
72
|
+
/**
|
|
73
|
+
* Number of tokens to keep
|
|
74
|
+
*/
|
|
60
75
|
tokens: z$1.number().min(0, "Tokens must be greater than or equal to 0").optional(),
|
|
61
76
|
messages: z$1.number().int("Messages must be an integer").min(0, "Messages must be non-negative").optional()
|
|
62
77
|
}).refine((data) => {
|
|
@@ -67,14 +82,55 @@ const keepSchema = z$1.object({
|
|
|
67
82
|
].filter((v) => v !== void 0).length === 1;
|
|
68
83
|
}, { message: "Exactly one of fraction, tokens, or messages must be provided" });
|
|
69
84
|
const contextSchema = z$1.object({
|
|
85
|
+
/**
|
|
86
|
+
* Model to use for summarization
|
|
87
|
+
*/
|
|
70
88
|
model: z$1.custom(),
|
|
89
|
+
/**
|
|
90
|
+
* Trigger conditions for summarization.
|
|
91
|
+
* Can be a single condition object (all properties must be met) or an array of conditions (any condition must be met).
|
|
92
|
+
*
|
|
93
|
+
* @example
|
|
94
|
+
* ```ts
|
|
95
|
+
* // Single condition: trigger if tokens >= 5000 AND messages >= 3
|
|
96
|
+
* trigger: { tokens: 5000, messages: 3 }
|
|
97
|
+
*
|
|
98
|
+
* // Multiple conditions: trigger if (tokens >= 5000 AND messages >= 3) OR (tokens >= 3000 AND messages >= 6)
|
|
99
|
+
* trigger: [
|
|
100
|
+
* { tokens: 5000, messages: 3 },
|
|
101
|
+
* { tokens: 3000, messages: 6 }
|
|
102
|
+
* ]
|
|
103
|
+
* ```
|
|
104
|
+
*/
|
|
71
105
|
trigger: z$1.union([contextSizeSchema, z$1.array(contextSizeSchema)]).optional(),
|
|
106
|
+
/**
|
|
107
|
+
* Keep conditions for summarization
|
|
108
|
+
*/
|
|
72
109
|
keep: keepSchema.optional(),
|
|
110
|
+
/**
|
|
111
|
+
* Token counter function to use for summarization
|
|
112
|
+
*/
|
|
73
113
|
tokenCounter: tokenCounterSchema.optional(),
|
|
114
|
+
/**
|
|
115
|
+
* Summary prompt to use for summarization
|
|
116
|
+
* @default {@link DEFAULT_SUMMARY_PROMPT}
|
|
117
|
+
*/
|
|
74
118
|
summaryPrompt: z$1.string().default(DEFAULT_SUMMARY_PROMPT),
|
|
119
|
+
/**
|
|
120
|
+
* Number of tokens to trim to before summarizing
|
|
121
|
+
*/
|
|
75
122
|
trimTokensToSummarize: z$1.number().optional(),
|
|
123
|
+
/**
|
|
124
|
+
* Prefix to add to the summary
|
|
125
|
+
*/
|
|
76
126
|
summaryPrefix: z$1.string().optional(),
|
|
127
|
+
/**
|
|
128
|
+
* @deprecated Use `trigger: { tokens: value }` instead.
|
|
129
|
+
*/
|
|
77
130
|
maxTokensBeforeSummary: z$1.number().optional(),
|
|
131
|
+
/**
|
|
132
|
+
* @deprecated Use `keep: { messages: value }` instead.
|
|
133
|
+
*/
|
|
78
134
|
messagesToKeep: z$1.number().optional()
|
|
79
135
|
});
|
|
80
136
|
/**
|
|
@@ -139,7 +195,12 @@ function summarizationMiddleware(options) {
|
|
|
139
195
|
if (error) throw new Error(`Invalid summarization middleware options: ${z.prettifyError(error)}`);
|
|
140
196
|
return createMiddleware({
|
|
141
197
|
name: "SummarizationMiddleware",
|
|
142
|
-
contextSchema: contextSchema.extend({
|
|
198
|
+
contextSchema: contextSchema.extend({
|
|
199
|
+
/**
|
|
200
|
+
* `model` should be required when initializing the middleware,
|
|
201
|
+
* but can be omitted within context when invoking the middleware.
|
|
202
|
+
*/
|
|
203
|
+
model: z$1.custom().optional() }),
|
|
143
204
|
beforeModel: async (state, runtime) => {
|
|
144
205
|
let trigger = userOptions.trigger;
|
|
145
206
|
let keep = userOptions.keep;
|