@librechat/agents 3.3.12 → 3.4.0

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (109) hide show
  1. package/dist/cjs/graphs/Graph.cjs +10 -0
  2. package/dist/cjs/graphs/Graph.cjs.map +1 -1
  3. package/dist/cjs/instrumentation.cjs +1 -0
  4. package/dist/cjs/instrumentation.cjs.map +1 -1
  5. package/dist/cjs/langfuseSpanRegistry.cjs +6 -3
  6. package/dist/cjs/langfuseSpanRegistry.cjs.map +1 -1
  7. package/dist/cjs/llm/anthropic/index.cjs +35 -206
  8. package/dist/cjs/llm/anthropic/index.cjs.map +1 -1
  9. package/dist/cjs/llm/bedrock/index.cjs +121 -241
  10. package/dist/cjs/llm/bedrock/index.cjs.map +1 -1
  11. package/dist/cjs/llm/google/index.cjs +19 -12
  12. package/dist/cjs/llm/google/index.cjs.map +1 -1
  13. package/dist/cjs/llm/mistral/index.cjs +26 -0
  14. package/dist/cjs/llm/mistral/index.cjs.map +1 -0
  15. package/dist/cjs/llm/openai/index.cjs +82 -80
  16. package/dist/cjs/llm/openai/index.cjs.map +1 -1
  17. package/dist/cjs/llm/openrouter/index.cjs.map +1 -1
  18. package/dist/cjs/llm/providers.cjs +19 -19
  19. package/dist/cjs/llm/providers.cjs.map +1 -1
  20. package/dist/cjs/llm/stream/chunkAdapters.cjs +198 -0
  21. package/dist/cjs/llm/stream/chunkAdapters.cjs.map +1 -0
  22. package/dist/cjs/llm/stream/smoother.cjs +369 -0
  23. package/dist/cjs/llm/stream/smoother.cjs.map +1 -0
  24. package/dist/cjs/llm/vertexai/index.cjs +13 -1
  25. package/dist/cjs/llm/vertexai/index.cjs.map +1 -1
  26. package/dist/cjs/main.cjs +18 -10
  27. package/dist/cjs/tools/subagent/SubagentExecutor.cjs +34 -2
  28. package/dist/cjs/tools/subagent/SubagentExecutor.cjs.map +1 -1
  29. package/dist/cjs/utils/tokens.cjs +76 -29
  30. package/dist/cjs/utils/tokens.cjs.map +1 -1
  31. package/dist/esm/graphs/Graph.mjs +10 -0
  32. package/dist/esm/graphs/Graph.mjs.map +1 -1
  33. package/dist/esm/instrumentation.mjs +1 -0
  34. package/dist/esm/instrumentation.mjs.map +1 -1
  35. package/dist/esm/langfuseSpanRegistry.mjs +6 -3
  36. package/dist/esm/langfuseSpanRegistry.mjs.map +1 -1
  37. package/dist/esm/llm/anthropic/index.mjs +34 -205
  38. package/dist/esm/llm/anthropic/index.mjs.map +1 -1
  39. package/dist/esm/llm/bedrock/index.mjs +120 -240
  40. package/dist/esm/llm/bedrock/index.mjs.map +1 -1
  41. package/dist/esm/llm/google/index.mjs +19 -12
  42. package/dist/esm/llm/google/index.mjs.map +1 -1
  43. package/dist/esm/llm/mistral/index.mjs +26 -0
  44. package/dist/esm/llm/mistral/index.mjs.map +1 -0
  45. package/dist/esm/llm/openai/index.mjs +82 -80
  46. package/dist/esm/llm/openai/index.mjs.map +1 -1
  47. package/dist/esm/llm/openrouter/index.mjs.map +1 -1
  48. package/dist/esm/llm/providers.mjs +3 -3
  49. package/dist/esm/llm/providers.mjs.map +1 -1
  50. package/dist/esm/llm/stream/chunkAdapters.mjs +195 -0
  51. package/dist/esm/llm/stream/chunkAdapters.mjs.map +1 -0
  52. package/dist/esm/llm/stream/smoother.mjs +365 -0
  53. package/dist/esm/llm/stream/smoother.mjs.map +1 -0
  54. package/dist/esm/llm/vertexai/index.mjs +13 -1
  55. package/dist/esm/llm/vertexai/index.mjs.map +1 -1
  56. package/dist/esm/main.mjs +4 -2
  57. package/dist/esm/tools/subagent/SubagentExecutor.mjs +34 -2
  58. package/dist/esm/tools/subagent/SubagentExecutor.mjs.map +1 -1
  59. package/dist/esm/utils/tokens.mjs +76 -30
  60. package/dist/esm/utils/tokens.mjs.map +1 -1
  61. package/dist/types/graphs/Graph.d.ts +3 -0
  62. package/dist/types/index.d.ts +3 -0
  63. package/dist/types/llm/google/index.d.ts +2 -0
  64. package/dist/types/llm/mistral/index.d.ts +11 -0
  65. package/dist/types/llm/openai/index.d.ts +20 -4
  66. package/dist/types/llm/openrouter/index.d.ts +4 -1
  67. package/dist/types/llm/stream/chunkAdapters.d.ts +48 -0
  68. package/dist/types/llm/stream/smoother.d.ts +95 -0
  69. package/dist/types/llm/vertexai/index.d.ts +2 -0
  70. package/dist/types/tools/subagent/SubagentExecutor.d.ts +3 -0
  71. package/dist/types/types/graph.d.ts +5 -0
  72. package/dist/types/types/llm.d.ts +21 -14
  73. package/dist/types/utils/tokens.d.ts +10 -0
  74. package/package.json +2 -2
  75. package/src/graphs/Graph.ts +11 -0
  76. package/src/index.ts +8 -0
  77. package/src/instrumentation.ts +1 -0
  78. package/src/langfuseSpanRegistry.ts +9 -0
  79. package/src/llm/anthropic/index.ts +85 -354
  80. package/src/llm/bedrock/index.ts +174 -390
  81. package/src/llm/bedrock/llm.spec.ts +2 -0
  82. package/src/llm/bedrock/streamSealDispatch.test.ts +76 -0
  83. package/src/llm/custom-chat-models.smoke.test.ts +16 -1
  84. package/src/llm/google/index.ts +17 -18
  85. package/src/llm/google/streamSmoothing.test.ts +121 -0
  86. package/src/llm/mistral/index.ts +33 -0
  87. package/src/llm/mistral/streamSmoothing.test.ts +97 -0
  88. package/src/llm/openai/deepseek.test.ts +56 -0
  89. package/src/llm/openai/index.ts +119 -126
  90. package/src/llm/openrouter/index.ts +4 -1
  91. package/src/llm/providers.ts +3 -3
  92. package/src/llm/stream/chunkAdapters.test.ts +202 -0
  93. package/src/llm/stream/chunkAdapters.ts +317 -0
  94. package/src/llm/stream/reassembly.test.ts +241 -0
  95. package/src/llm/stream/smoother.bench.test.ts +155 -0
  96. package/src/llm/stream/smoother.test.ts +519 -0
  97. package/src/llm/stream/smoother.ts +574 -0
  98. package/src/llm/vertexai/index.ts +17 -1
  99. package/src/llm/vertexai/streamSmoothing.test.ts +109 -0
  100. package/src/specs/langfuse-instrumentation.test.ts +26 -0
  101. package/src/specs/langfuse-span-registry.test.ts +17 -0
  102. package/src/specs/subagent.test.ts +44 -0
  103. package/src/specs/summarization.test.ts +5 -2
  104. package/src/specs/tokens.test.ts +159 -14
  105. package/src/tools/__tests__/SubagentExecutor.test.ts +48 -1
  106. package/src/tools/subagent/SubagentExecutor.ts +69 -5
  107. package/src/types/graph.ts +5 -0
  108. package/src/types/llm.ts +53 -36
  109. package/src/utils/tokens.ts +115 -30
@@ -1 +1 @@
1
- {"version":3,"file":"index.cjs","names":["ChatGoogleGenerativeAI","GenerativeAI","FunctionCallingMode","convertBaseMessagesToContent","dropUnsupportedModelTurnPrefill","mapGenerateContentResultToChatResult","convertResponseContentToChatGenerationChunk","ChatGenerationChunk","AIMessageChunk"],"sources":["../../../../src/llm/google/index.ts"],"sourcesContent":["/* eslint-disable @typescript-eslint/ban-ts-comment */\nimport { AIMessageChunk } from '@langchain/core/messages';\nimport { ChatGenerationChunk } from '@langchain/core/outputs';\nimport { ChatGoogleGenerativeAI } from '@langchain/google-genai';\nimport { getEnvironmentVariable } from '@langchain/core/utils/env';\nimport {\n FunctionCallingMode,\n GoogleGenerativeAI as GenerativeAI,\n} from '@google/generative-ai';\nimport type {\n GenerateContentRequest,\n SafetySetting,\n ToolConfig,\n} from '@google/generative-ai';\nimport type { CallbackManagerForLLMRun } from '@langchain/core/callbacks/manager';\nimport type { BaseMessage, UsageMetadata } from '@langchain/core/messages';\nimport type { GeminiApiUsageMetadata, InputTokenDetails } from './types';\nimport type { GoogleClientOptions, GoogleThinkingConfig } from '@/types';\nimport {\n convertResponseContentToChatGenerationChunk,\n convertBaseMessagesToContent,\n dropUnsupportedModelTurnPrefill,\n mapGenerateContentResultToChatResult,\n} from './utils/common';\n\ntype GoogleToolConfigWithServerSideInvocations = ToolConfig & {\n includeServerSideToolInvocations?: boolean;\n functionCallingConfig?: Omit<\n NonNullable<ToolConfig['functionCallingConfig']>,\n 'mode'\n > & {\n mode?:\n | NonNullable<ToolConfig['functionCallingConfig']>['mode']\n | 'VALIDATED';\n };\n};\n\nexport class CustomChatGoogleGenerativeAI extends ChatGoogleGenerativeAI {\n thinkingConfig?: GoogleThinkingConfig;\n includeServerSideToolInvocations?: boolean;\n\n /**\n * Override to add gemini-3 model support for multimodal and function calling thought signatures\n */\n get _isMultimodalModel(): boolean {\n return (\n this.model.startsWith('gemini-1.5') ||\n this.model.startsWith('gemini-2') ||\n (this.model.startsWith('gemma-3-') &&\n !this.model.startsWith('gemma-3-1b')) ||\n this.model.startsWith('gemini-3')\n );\n }\n\n constructor(fields: GoogleClientOptions) {\n super(fields);\n\n this.model = fields.model.replace(/^models\\//, '');\n\n this.maxOutputTokens = fields.maxOutputTokens ?? this.maxOutputTokens;\n\n if (this.maxOutputTokens != null && this.maxOutputTokens < 0) {\n throw new Error('`maxOutputTokens` must be a positive integer');\n }\n\n this.temperature = fields.temperature ?? this.temperature;\n if (\n this.temperature != null &&\n (this.temperature < 0 || this.temperature > 2)\n ) {\n throw new Error('`temperature` must be in the range of [0.0,2.0]');\n }\n\n this.topP = fields.topP ?? this.topP;\n if (this.topP != null && this.topP < 0) {\n throw new Error('`topP` must be a positive integer');\n }\n\n if (this.topP != null && this.topP > 1) {\n throw new Error('`topP` must be below 1.');\n }\n\n this.topK = fields.topK ?? this.topK;\n if (this.topK != null && this.topK < 0) {\n throw new Error('`topK` must be a positive integer');\n }\n\n this.stopSequences = fields.stopSequences ?? this.stopSequences;\n\n this.apiKey = fields.apiKey ?? getEnvironmentVariable('GOOGLE_API_KEY');\n if (this.apiKey == null || this.apiKey === '') {\n throw new Error(\n 'Please set an API key for Google GenerativeAI ' +\n 'in the environment variable GOOGLE_API_KEY ' +\n 'or in the `apiKey` field of the ' +\n 'ChatGoogleGenerativeAI constructor'\n );\n }\n\n this.safetySettings = fields.safetySettings ?? this.safetySettings;\n if (this.safetySettings && this.safetySettings.length > 0) {\n const safetySettingsSet = new Set(\n this.safetySettings.map((s) => s.category)\n );\n if (safetySettingsSet.size !== this.safetySettings.length) {\n throw new Error(\n 'The categories in `safetySettings` array must be unique'\n );\n }\n }\n\n this.thinkingConfig = fields.thinkingConfig ?? this.thinkingConfig;\n this.includeServerSideToolInvocations =\n fields.includeServerSideToolInvocations ??\n this.includeServerSideToolInvocations;\n\n this.streaming = fields.streaming ?? this.streaming;\n this.json = fields.json;\n\n // @ts-ignore - Accessing private property from parent class\n this.client = new GenerativeAI(this.apiKey).getGenerativeModel(\n {\n model: this.model,\n safetySettings: this.safetySettings as SafetySetting[],\n generationConfig: {\n stopSequences: this.stopSequences,\n maxOutputTokens: this.maxOutputTokens,\n temperature: this.temperature,\n topP: this.topP,\n topK: this.topK,\n ...(this.json != null\n ? { responseMimeType: 'application/json' }\n : {}),\n },\n },\n {\n apiVersion: fields.apiVersion,\n baseUrl: fields.baseUrl,\n customHeaders: fields.customHeaders,\n }\n );\n this.streamUsage = fields.streamUsage ?? this.streamUsage;\n }\n\n static lc_name(): 'LibreChatGoogleGenerativeAI' {\n return 'LibreChatGoogleGenerativeAI';\n }\n\n /**\n * Helper function to convert Gemini API usage metadata to LangChain format\n * Includes support for cached tokens and tier-based tracking for gemini-3-pro-preview\n */\n private _convertToUsageMetadata(\n usageMetadata: GeminiApiUsageMetadata | undefined,\n model: string\n ): UsageMetadata | undefined {\n if (!usageMetadata) {\n return undefined;\n }\n\n const output: UsageMetadata = {\n input_tokens: usageMetadata.promptTokenCount ?? 0,\n output_tokens:\n (usageMetadata.candidatesTokenCount ?? 0) +\n (usageMetadata.thoughtsTokenCount ?? 0),\n total_tokens: usageMetadata.totalTokenCount ?? 0,\n };\n\n if (usageMetadata.cachedContentTokenCount) {\n output.input_token_details ??= {};\n output.input_token_details.cache_read =\n usageMetadata.cachedContentTokenCount;\n }\n\n // gemini-3-pro-preview has bracket based tracking of tokens per request\n if (model === 'gemini-3-pro-preview') {\n const over200k = Math.max(\n 0,\n (usageMetadata.promptTokenCount ?? 0) - 200000\n );\n const cachedOver200k = Math.max(\n 0,\n (usageMetadata.cachedContentTokenCount ?? 0) - 200000\n );\n if (over200k) {\n output.input_token_details = {\n ...output.input_token_details,\n over_200k: over200k,\n } as InputTokenDetails;\n }\n if (cachedOver200k) {\n output.input_token_details = {\n ...output.input_token_details,\n cache_read_over_200k: cachedOver200k,\n } as InputTokenDetails;\n }\n }\n\n return output;\n }\n\n invocationParams(\n options?: this['ParsedCallOptions']\n ): Omit<GenerateContentRequest, 'contents'> {\n const params = super.invocationParams(options);\n if (this.thinkingConfig) {\n /** @ts-ignore */\n this.client.generationConfig = {\n /** @ts-ignore */\n ...this.client.generationConfig,\n /** @ts-ignore */\n thinkingConfig: this.thinkingConfig,\n };\n }\n if (\n this.includeServerSideToolInvocations === true &&\n Array.isArray(params.tools) &&\n params.tools.length > 0\n ) {\n const toolConfig = params.toolConfig as\n | GoogleToolConfigWithServerSideInvocations\n | undefined;\n const functionCallingConfig = toolConfig?.functionCallingConfig;\n params.toolConfig = {\n ...toolConfig,\n ...(functionCallingConfig?.mode === FunctionCallingMode.AUTO\n ? {\n functionCallingConfig: {\n ...functionCallingConfig,\n mode: 'VALIDATED',\n },\n }\n : {}),\n includeServerSideToolInvocations: true,\n } as ToolConfig;\n }\n return params;\n }\n\n async _generate(\n messages: BaseMessage[],\n options: this['ParsedCallOptions'],\n runManager?: CallbackManagerForLLMRun\n ): Promise<import('@langchain/core/outputs').ChatResult> {\n const prompt = convertBaseMessagesToContent(\n messages,\n this._isMultimodalModel,\n this.useSystemInstruction,\n this.model\n );\n let actualPrompt = prompt;\n if (prompt?.[0].role === 'system') {\n const [systemInstruction] = prompt;\n /** @ts-ignore */\n this.client.systemInstruction = systemInstruction;\n actualPrompt = prompt.slice(1);\n }\n actualPrompt = dropUnsupportedModelTurnPrefill(actualPrompt, this.model);\n const parameters = this.invocationParams(options);\n const request = {\n ...parameters,\n contents: actualPrompt,\n };\n\n const res = await this.caller.callWithOptions(\n { signal: options.signal },\n async () =>\n /** @ts-ignore */\n this.client.generateContent(request)\n );\n\n const response = res.response;\n const usageMetadata = this._convertToUsageMetadata(\n /** @ts-ignore */\n response.usageMetadata,\n this.model\n );\n\n /** @ts-ignore */\n const generationResult = mapGenerateContentResultToChatResult(response, {\n usageMetadata,\n });\n\n await runManager?.handleLLMNewToken(\n generationResult.generations[0].text || '',\n undefined,\n undefined,\n undefined,\n undefined,\n undefined\n );\n return generationResult;\n }\n\n async *_streamResponseChunks(\n messages: BaseMessage[],\n options: this['ParsedCallOptions'],\n runManager?: CallbackManagerForLLMRun\n ): AsyncGenerator<ChatGenerationChunk> {\n const prompt = convertBaseMessagesToContent(\n messages,\n this._isMultimodalModel,\n this.useSystemInstruction,\n this.model\n );\n let actualPrompt = prompt;\n if (prompt?.[0].role === 'system') {\n const [systemInstruction] = prompt;\n /** @ts-ignore */\n this.client.systemInstruction = systemInstruction;\n actualPrompt = prompt.slice(1);\n }\n actualPrompt = dropUnsupportedModelTurnPrefill(actualPrompt, this.model);\n const parameters = this.invocationParams(options);\n const request = {\n ...parameters,\n contents: actualPrompt,\n };\n const stream = await this.caller.callWithOptions(\n { signal: options.signal },\n async () => {\n /** @ts-ignore */\n const { stream } = await this.client.generateContentStream(request);\n return stream;\n }\n );\n\n let index = 0;\n let lastUsageMetadata: UsageMetadata | undefined;\n for await (const response of stream) {\n if (\n 'usageMetadata' in response &&\n this.streamUsage !== false &&\n options.streamUsage !== false\n ) {\n lastUsageMetadata = this._convertToUsageMetadata(\n response.usageMetadata as GeminiApiUsageMetadata | undefined,\n this.model\n );\n }\n\n const chunk = convertResponseContentToChatGenerationChunk(response, {\n usageMetadata: undefined,\n index,\n });\n index += 1;\n if (!chunk) {\n continue;\n }\n\n yield chunk;\n await runManager?.handleLLMNewToken(\n chunk.text || '',\n undefined,\n undefined,\n undefined,\n undefined,\n { chunk }\n );\n }\n\n if (lastUsageMetadata) {\n const finalChunk = new ChatGenerationChunk({\n text: '',\n message: new AIMessageChunk({\n content: '',\n usage_metadata: lastUsageMetadata,\n }),\n });\n yield finalChunk;\n await runManager?.handleLLMNewToken(\n finalChunk.text || '',\n undefined,\n undefined,\n undefined,\n undefined,\n { chunk: finalChunk }\n );\n }\n }\n}\n"],"mappings":";;;;;;;AAqCA,IAAa,+BAAb,cAAkDA,wBAAAA,uBAAuB;CACvE;CACA;;;;CAKA,IAAI,qBAA8B;EAChC,OACE,KAAK,MAAM,WAAW,YAAY,KAClC,KAAK,MAAM,WAAW,UAAU,KAC/B,KAAK,MAAM,WAAW,UAAU,KAC/B,CAAC,KAAK,MAAM,WAAW,YAAY,KACrC,KAAK,MAAM,WAAW,UAAU;CAEpC;CAEA,YAAY,QAA6B;EACvC,MAAM,MAAM;EAEZ,KAAK,QAAQ,OAAO,MAAM,QAAQ,aAAa,EAAE;EAEjD,KAAK,kBAAkB,OAAO,mBAAmB,KAAK;EAEtD,IAAI,KAAK,mBAAmB,QAAQ,KAAK,kBAAkB,GACzD,MAAM,IAAI,MAAM,8CAA8C;EAGhE,KAAK,cAAc,OAAO,eAAe,KAAK;EAC9C,IACE,KAAK,eAAe,SACnB,KAAK,cAAc,KAAK,KAAK,cAAc,IAE5C,MAAM,IAAI,MAAM,iDAAiD;EAGnE,KAAK,OAAO,OAAO,QAAQ,KAAK;EAChC,IAAI,KAAK,QAAQ,QAAQ,KAAK,OAAO,GACnC,MAAM,IAAI,MAAM,mCAAmC;EAGrD,IAAI,KAAK,QAAQ,QAAQ,KAAK,OAAO,GACnC,MAAM,IAAI,MAAM,yBAAyB;EAG3C,KAAK,OAAO,OAAO,QAAQ,KAAK;EAChC,IAAI,KAAK,QAAQ,QAAQ,KAAK,OAAO,GACnC,MAAM,IAAI,MAAM,mCAAmC;EAGrD,KAAK,gBAAgB,OAAO,iBAAiB,KAAK;EAElD,KAAK,SAAS,OAAO,WAAA,GAAA,0BAAA,uBAAA,CAAiC,gBAAgB;EACtE,IAAI,KAAK,UAAU,QAAQ,KAAK,WAAW,IACzC,MAAM,IAAI,MACR,6JAIF;EAGF,KAAK,iBAAiB,OAAO,kBAAkB,KAAK;EACpD,IAAI,KAAK,kBAAkB,KAAK,eAAe,SAAS;OAIlD,IAH0B,IAC5B,KAAK,eAAe,KAAK,MAAM,EAAE,QAAQ,CAEvB,CAAC,CAAC,SAAS,KAAK,eAAe,QACjD,MAAM,IAAI,MACR,yDACF;EAAA;EAIJ,KAAK,iBAAiB,OAAO,kBAAkB,KAAK;EACpD,KAAK,mCACH,OAAO,oCACP,KAAK;EAEP,KAAK,YAAY,OAAO,aAAa,KAAK;EAC1C,KAAK,OAAO,OAAO;EAGnB,KAAK,SAAS,IAAIC,sBAAAA,mBAAa,KAAK,MAAM,CAAC,CAAC,mBAC1C;GACE,OAAO,KAAK;GACZ,gBAAgB,KAAK;GACrB,kBAAkB;IAChB,eAAe,KAAK;IACpB,iBAAiB,KAAK;IACtB,aAAa,KAAK;IAClB,MAAM,KAAK;IACX,MAAM,KAAK;IACX,GAAI,KAAK,QAAQ,OACb,EAAE,kBAAkB,mBAAmB,IACvC,CAAC;GACP;EACF,GACA;GACE,YAAY,OAAO;GACnB,SAAS,OAAO;GAChB,eAAe,OAAO;EACxB,CACF;EACA,KAAK,cAAc,OAAO,eAAe,KAAK;CAChD;CAEA,OAAO,UAAyC;EAC9C,OAAO;CACT;;;;;CAMA,wBACE,eACA,OAC2B;EAC3B,IAAI,CAAC,eACH;EAGF,MAAM,SAAwB;GAC5B,cAAc,cAAc,oBAAoB;GAChD,gBACG,cAAc,wBAAwB,MACtC,cAAc,sBAAsB;GACvC,cAAc,cAAc,mBAAmB;EACjD;EAEA,IAAI,cAAc,yBAAyB;GACzC,OAAO,wBAAwB,CAAC;GAChC,OAAO,oBAAoB,aACzB,cAAc;EAClB;EAGA,IAAI,UAAU,wBAAwB;GACpC,MAAM,WAAW,KAAK,IACpB,IACC,cAAc,oBAAoB,KAAK,GAC1C;GACA,MAAM,iBAAiB,KAAK,IAC1B,IACC,cAAc,2BAA2B,KAAK,GACjD;GACA,IAAI,UACF,OAAO,sBAAsB;IAC3B,GAAG,OAAO;IACV,WAAW;GACb;GAEF,IAAI,gBACF,OAAO,sBAAsB;IAC3B,GAAG,OAAO;IACV,sBAAsB;GACxB;EAEJ;EAEA,OAAO;CACT;CAEA,iBACE,SAC0C;EAC1C,MAAM,SAAS,MAAM,iBAAiB,OAAO;EAC7C,IAAI,KAAK;;EAEP,KAAK,OAAO,mBAAmB;;GAE7B,GAAG,KAAK,OAAO;;GAEf,gBAAgB,KAAK;EACvB;EAEF,IACE,KAAK,qCAAqC,QAC1C,MAAM,QAAQ,OAAO,KAAK,KAC1B,OAAO,MAAM,SAAS,GACtB;GACA,MAAM,aAAa,OAAO;GAG1B,MAAM,wBAAwB,YAAY;GAC1C,OAAO,aAAa;IAClB,GAAG;IACH,GAAI,uBAAuB,SAASC,sBAAAA,oBAAoB,OACpD,EACA,uBAAuB;KACrB,GAAG;KACH,MAAM;IACR,EACF,IACE,CAAC;IACL,kCAAkC;GACpC;EACF;EACA,OAAO;CACT;CAEA,MAAM,UACJ,UACA,SACA,YACuD;EACvD,MAAM,SAASC,eAAAA,6BACb,UACA,KAAK,oBACL,KAAK,sBACL,KAAK,KACP;EACA,IAAI,eAAe;EACnB,IAAI,SAAS,EAAE,CAAC,SAAS,UAAU;GACjC,MAAM,CAAC,qBAAqB;;GAE5B,KAAK,OAAO,oBAAoB;GAChC,eAAe,OAAO,MAAM,CAAC;EAC/B;EACA,eAAeC,eAAAA,gCAAgC,cAAc,KAAK,KAAK;EAEvE,MAAM,UAAU;GACd,GAFiB,KAAK,iBAAiB,OAE3B;GACZ,UAAU;EACZ;EASA,MAAM,YAAW,MAPC,KAAK,OAAO,gBAC5B,EAAE,QAAQ,QAAQ,OAAO,GACzB,YAEE,KAAK,OAAO,gBAAgB,OAAO,CACvC,EAAA,CAEqB;;EAQrB,MAAM,mBAAmBC,eAAAA,qCAAqC,UAAU,EACtE,eARoB,KAAK;;GAEzB,SAAS;GACT,KAAK;EAKO,EACd,CAAC;EAED,MAAM,YAAY,kBAChB,iBAAiB,YAAY,EAAE,CAAC,QAAQ,IACxC,KAAA,GACA,KAAA,GACA,KAAA,GACA,KAAA,GACA,KAAA,CACF;EACA,OAAO;CACT;CAEA,OAAO,sBACL,UACA,SACA,YACqC;EACrC,MAAM,SAASF,eAAAA,6BACb,UACA,KAAK,oBACL,KAAK,sBACL,KAAK,KACP;EACA,IAAI,eAAe;EACnB,IAAI,SAAS,EAAE,CAAC,SAAS,UAAU;GACjC,MAAM,CAAC,qBAAqB;;GAE5B,KAAK,OAAO,oBAAoB;GAChC,eAAe,OAAO,MAAM,CAAC;EAC/B;EACA,eAAeC,eAAAA,gCAAgC,cAAc,KAAK,KAAK;EAEvE,MAAM,UAAU;GACd,GAFiB,KAAK,iBAAiB,OAE3B;GACZ,UAAU;EACZ;EACA,MAAM,SAAS,MAAM,KAAK,OAAO,gBAC/B,EAAE,QAAQ,QAAQ,OAAO,GACzB,YAAY;;GAEV,MAAM,EAAE,WAAW,MAAM,KAAK,OAAO,sBAAsB,OAAO;GAClE,OAAO;EACT,CACF;EAEA,IAAI,QAAQ;EACZ,IAAI;EACJ,WAAW,MAAM,YAAY,QAAQ;GACnC,IACE,mBAAmB,YACnB,KAAK,gBAAgB,SACrB,QAAQ,gBAAgB,OAExB,oBAAoB,KAAK,wBACvB,SAAS,eACT,KAAK,KACP;GAGF,MAAM,QAAQE,eAAAA,4CAA4C,UAAU;IAClE,eAAe,KAAA;IACf;GACF,CAAC;GACD,SAAS;GACT,IAAI,CAAC,OACH;GAGF,MAAM;GACN,MAAM,YAAY,kBAChB,MAAM,QAAQ,IACd,KAAA,GACA,KAAA,GACA,KAAA,GACA,KAAA,GACA,EAAE,MAAM,CACV;EACF;EAEA,IAAI,mBAAmB;GACrB,MAAM,aAAa,IAAIC,wBAAAA,oBAAoB;IACzC,MAAM;IACN,SAAS,IAAIC,yBAAAA,eAAe;KAC1B,SAAS;KACT,gBAAgB;IAClB,CAAC;GACH,CAAC;GACD,MAAM;GACN,MAAM,YAAY,kBAChB,WAAW,QAAQ,IACnB,KAAA,GACA,KAAA,GACA,KAAA,GACA,KAAA,GACA,EAAE,OAAO,WAAW,CACtB;EACF;CACF;AACF"}
1
+ {"version":3,"file":"index.cjs","names":["ChatGoogleGenerativeAI","resolveStreamDelay","GenerativeAI","FunctionCallingMode","convertBaseMessagesToContent","dropUnsupportedModelTurnPrefill","mapGenerateContentResultToChatResult","smoothGenerationChunks","convertResponseContentToChatGenerationChunk","ChatGenerationChunk","AIMessageChunk"],"sources":["../../../../src/llm/google/index.ts"],"sourcesContent":["/* eslint-disable @typescript-eslint/ban-ts-comment */\nimport { AIMessageChunk } from '@langchain/core/messages';\nimport { ChatGenerationChunk } from '@langchain/core/outputs';\nimport { ChatGoogleGenerativeAI } from '@langchain/google-genai';\nimport { getEnvironmentVariable } from '@langchain/core/utils/env';\nimport {\n FunctionCallingMode,\n GoogleGenerativeAI as GenerativeAI,\n} from '@google/generative-ai';\nimport type {\n GenerateContentRequest,\n SafetySetting,\n ToolConfig,\n} from '@google/generative-ai';\nimport type { CallbackManagerForLLMRun } from '@langchain/core/callbacks/manager';\nimport type { BaseMessage, UsageMetadata } from '@langchain/core/messages';\nimport type { GeminiApiUsageMetadata, InputTokenDetails } from './types';\nimport type { GoogleClientOptions, GoogleThinkingConfig } from '@/types';\nimport { smoothGenerationChunks } from '@/llm/stream/chunkAdapters';\nimport { resolveStreamDelay } from '@/llm/stream/smoother';\nimport {\n convertResponseContentToChatGenerationChunk,\n convertBaseMessagesToContent,\n dropUnsupportedModelTurnPrefill,\n mapGenerateContentResultToChatResult,\n} from './utils/common';\n\ntype GoogleToolConfigWithServerSideInvocations = ToolConfig & {\n includeServerSideToolInvocations?: boolean;\n functionCallingConfig?: Omit<\n NonNullable<ToolConfig['functionCallingConfig']>,\n 'mode'\n > & {\n mode?:\n | NonNullable<ToolConfig['functionCallingConfig']>['mode']\n | 'VALIDATED';\n };\n};\n\nexport class CustomChatGoogleGenerativeAI extends ChatGoogleGenerativeAI {\n _lc_stream_delay: number;\n thinkingConfig?: GoogleThinkingConfig;\n includeServerSideToolInvocations?: boolean;\n\n /**\n * Override to add gemini-3 model support for multimodal and function calling thought signatures\n */\n get _isMultimodalModel(): boolean {\n return (\n this.model.startsWith('gemini-1.5') ||\n this.model.startsWith('gemini-2') ||\n (this.model.startsWith('gemma-3-') &&\n !this.model.startsWith('gemma-3-1b')) ||\n this.model.startsWith('gemini-3')\n );\n }\n\n constructor(fields: GoogleClientOptions) {\n super(fields);\n\n this._lc_stream_delay = resolveStreamDelay(fields._lc_stream_delay);\n this.model = fields.model.replace(/^models\\//, '');\n\n this.maxOutputTokens = fields.maxOutputTokens ?? this.maxOutputTokens;\n\n if (this.maxOutputTokens != null && this.maxOutputTokens < 0) {\n throw new Error('`maxOutputTokens` must be a positive integer');\n }\n\n this.temperature = fields.temperature ?? this.temperature;\n if (\n this.temperature != null &&\n (this.temperature < 0 || this.temperature > 2)\n ) {\n throw new Error('`temperature` must be in the range of [0.0,2.0]');\n }\n\n this.topP = fields.topP ?? this.topP;\n if (this.topP != null && this.topP < 0) {\n throw new Error('`topP` must be a positive integer');\n }\n\n if (this.topP != null && this.topP > 1) {\n throw new Error('`topP` must be below 1.');\n }\n\n this.topK = fields.topK ?? this.topK;\n if (this.topK != null && this.topK < 0) {\n throw new Error('`topK` must be a positive integer');\n }\n\n this.stopSequences = fields.stopSequences ?? this.stopSequences;\n\n this.apiKey = fields.apiKey ?? getEnvironmentVariable('GOOGLE_API_KEY');\n if (this.apiKey == null || this.apiKey === '') {\n throw new Error(\n 'Please set an API key for Google GenerativeAI ' +\n 'in the environment variable GOOGLE_API_KEY ' +\n 'or in the `apiKey` field of the ' +\n 'ChatGoogleGenerativeAI constructor'\n );\n }\n\n this.safetySettings = fields.safetySettings ?? this.safetySettings;\n if (this.safetySettings && this.safetySettings.length > 0) {\n const safetySettingsSet = new Set(\n this.safetySettings.map((s) => s.category)\n );\n if (safetySettingsSet.size !== this.safetySettings.length) {\n throw new Error(\n 'The categories in `safetySettings` array must be unique'\n );\n }\n }\n\n this.thinkingConfig = fields.thinkingConfig ?? this.thinkingConfig;\n this.includeServerSideToolInvocations =\n fields.includeServerSideToolInvocations ??\n this.includeServerSideToolInvocations;\n\n this.streaming = fields.streaming ?? this.streaming;\n this.json = fields.json;\n\n // @ts-ignore - Accessing private property from parent class\n this.client = new GenerativeAI(this.apiKey).getGenerativeModel(\n {\n model: this.model,\n safetySettings: this.safetySettings as SafetySetting[],\n generationConfig: {\n stopSequences: this.stopSequences,\n maxOutputTokens: this.maxOutputTokens,\n temperature: this.temperature,\n topP: this.topP,\n topK: this.topK,\n ...(this.json != null\n ? { responseMimeType: 'application/json' }\n : {}),\n },\n },\n {\n apiVersion: fields.apiVersion,\n baseUrl: fields.baseUrl,\n customHeaders: fields.customHeaders,\n }\n );\n this.streamUsage = fields.streamUsage ?? this.streamUsage;\n }\n\n static lc_name(): 'LibreChatGoogleGenerativeAI' {\n return 'LibreChatGoogleGenerativeAI';\n }\n\n /**\n * Helper function to convert Gemini API usage metadata to LangChain format\n * Includes support for cached tokens and tier-based tracking for gemini-3-pro-preview\n */\n private _convertToUsageMetadata(\n usageMetadata: GeminiApiUsageMetadata | undefined,\n model: string\n ): UsageMetadata | undefined {\n if (!usageMetadata) {\n return undefined;\n }\n\n const output: UsageMetadata = {\n input_tokens: usageMetadata.promptTokenCount ?? 0,\n output_tokens:\n (usageMetadata.candidatesTokenCount ?? 0) +\n (usageMetadata.thoughtsTokenCount ?? 0),\n total_tokens: usageMetadata.totalTokenCount ?? 0,\n };\n\n if (usageMetadata.cachedContentTokenCount) {\n output.input_token_details ??= {};\n output.input_token_details.cache_read =\n usageMetadata.cachedContentTokenCount;\n }\n\n // gemini-3-pro-preview has bracket based tracking of tokens per request\n if (model === 'gemini-3-pro-preview') {\n const over200k = Math.max(\n 0,\n (usageMetadata.promptTokenCount ?? 0) - 200000\n );\n const cachedOver200k = Math.max(\n 0,\n (usageMetadata.cachedContentTokenCount ?? 0) - 200000\n );\n if (over200k) {\n output.input_token_details = {\n ...output.input_token_details,\n over_200k: over200k,\n } as InputTokenDetails;\n }\n if (cachedOver200k) {\n output.input_token_details = {\n ...output.input_token_details,\n cache_read_over_200k: cachedOver200k,\n } as InputTokenDetails;\n }\n }\n\n return output;\n }\n\n invocationParams(\n options?: this['ParsedCallOptions']\n ): Omit<GenerateContentRequest, 'contents'> {\n const params = super.invocationParams(options);\n if (this.thinkingConfig) {\n /** @ts-ignore */\n this.client.generationConfig = {\n /** @ts-ignore */\n ...this.client.generationConfig,\n /** @ts-ignore */\n thinkingConfig: this.thinkingConfig,\n };\n }\n if (\n this.includeServerSideToolInvocations === true &&\n Array.isArray(params.tools) &&\n params.tools.length > 0\n ) {\n const toolConfig = params.toolConfig as\n | GoogleToolConfigWithServerSideInvocations\n | undefined;\n const functionCallingConfig = toolConfig?.functionCallingConfig;\n params.toolConfig = {\n ...toolConfig,\n ...(functionCallingConfig?.mode === FunctionCallingMode.AUTO\n ? {\n functionCallingConfig: {\n ...functionCallingConfig,\n mode: 'VALIDATED',\n },\n }\n : {}),\n includeServerSideToolInvocations: true,\n } as ToolConfig;\n }\n return params;\n }\n\n async _generate(\n messages: BaseMessage[],\n options: this['ParsedCallOptions'],\n runManager?: CallbackManagerForLLMRun\n ): Promise<import('@langchain/core/outputs').ChatResult> {\n const prompt = convertBaseMessagesToContent(\n messages,\n this._isMultimodalModel,\n this.useSystemInstruction,\n this.model\n );\n let actualPrompt = prompt;\n if (prompt?.[0].role === 'system') {\n const [systemInstruction] = prompt;\n /** @ts-ignore */\n this.client.systemInstruction = systemInstruction;\n actualPrompt = prompt.slice(1);\n }\n actualPrompt = dropUnsupportedModelTurnPrefill(actualPrompt, this.model);\n const parameters = this.invocationParams(options);\n const request = {\n ...parameters,\n contents: actualPrompt,\n };\n\n const res = await this.caller.callWithOptions(\n { signal: options.signal },\n async () =>\n /** @ts-ignore */\n this.client.generateContent(request)\n );\n\n const response = res.response;\n const usageMetadata = this._convertToUsageMetadata(\n /** @ts-ignore */\n response.usageMetadata,\n this.model\n );\n\n /** @ts-ignore */\n const generationResult = mapGenerateContentResultToChatResult(response, {\n usageMetadata,\n });\n\n await runManager?.handleLLMNewToken(\n generationResult.generations[0].text || '',\n undefined,\n undefined,\n undefined,\n undefined,\n undefined\n );\n return generationResult;\n }\n\n async *_streamResponseChunks(\n messages: BaseMessage[],\n options: this['ParsedCallOptions'],\n runManager?: CallbackManagerForLLMRun\n ): AsyncGenerator<ChatGenerationChunk> {\n yield* smoothGenerationChunks({\n chunks: this._streamProviderChunks(messages, options),\n delayMs: this._lc_stream_delay,\n signal: options.signal,\n runManager,\n });\n }\n\n private async *_streamProviderChunks(\n messages: BaseMessage[],\n options: this['ParsedCallOptions']\n ): AsyncGenerator<ChatGenerationChunk> {\n const prompt = convertBaseMessagesToContent(\n messages,\n this._isMultimodalModel,\n this.useSystemInstruction,\n this.model\n );\n let actualPrompt = prompt;\n if (prompt?.[0].role === 'system') {\n const [systemInstruction] = prompt;\n /** @ts-ignore */\n this.client.systemInstruction = systemInstruction;\n actualPrompt = prompt.slice(1);\n }\n actualPrompt = dropUnsupportedModelTurnPrefill(actualPrompt, this.model);\n const parameters = this.invocationParams(options);\n const request = {\n ...parameters,\n contents: actualPrompt,\n };\n const stream = await this.caller.callWithOptions(\n { signal: options.signal },\n async () => {\n /** @ts-ignore */\n const { stream } = await this.client.generateContentStream(request);\n return stream;\n }\n );\n\n let index = 0;\n let lastUsageMetadata: UsageMetadata | undefined;\n for await (const response of stream) {\n if (\n 'usageMetadata' in response &&\n this.streamUsage !== false &&\n options.streamUsage !== false\n ) {\n lastUsageMetadata = this._convertToUsageMetadata(\n response.usageMetadata as GeminiApiUsageMetadata | undefined,\n this.model\n );\n }\n\n const chunk = convertResponseContentToChatGenerationChunk(response, {\n usageMetadata: undefined,\n index,\n });\n index += 1;\n if (!chunk) {\n continue;\n }\n\n yield chunk;\n }\n\n if (lastUsageMetadata) {\n yield new ChatGenerationChunk({\n text: '',\n message: new AIMessageChunk({\n content: '',\n usage_metadata: lastUsageMetadata,\n }),\n });\n }\n }\n}\n"],"mappings":";;;;;;;;;AAuCA,IAAa,+BAAb,cAAkDA,wBAAAA,uBAAuB;CACvE;CACA;CACA;;;;CAKA,IAAI,qBAA8B;EAChC,OACE,KAAK,MAAM,WAAW,YAAY,KAClC,KAAK,MAAM,WAAW,UAAU,KAC/B,KAAK,MAAM,WAAW,UAAU,KAC/B,CAAC,KAAK,MAAM,WAAW,YAAY,KACrC,KAAK,MAAM,WAAW,UAAU;CAEpC;CAEA,YAAY,QAA6B;EACvC,MAAM,MAAM;EAEZ,KAAK,mBAAmBC,iBAAAA,mBAAmB,OAAO,gBAAgB;EAClE,KAAK,QAAQ,OAAO,MAAM,QAAQ,aAAa,EAAE;EAEjD,KAAK,kBAAkB,OAAO,mBAAmB,KAAK;EAEtD,IAAI,KAAK,mBAAmB,QAAQ,KAAK,kBAAkB,GACzD,MAAM,IAAI,MAAM,8CAA8C;EAGhE,KAAK,cAAc,OAAO,eAAe,KAAK;EAC9C,IACE,KAAK,eAAe,SACnB,KAAK,cAAc,KAAK,KAAK,cAAc,IAE5C,MAAM,IAAI,MAAM,iDAAiD;EAGnE,KAAK,OAAO,OAAO,QAAQ,KAAK;EAChC,IAAI,KAAK,QAAQ,QAAQ,KAAK,OAAO,GACnC,MAAM,IAAI,MAAM,mCAAmC;EAGrD,IAAI,KAAK,QAAQ,QAAQ,KAAK,OAAO,GACnC,MAAM,IAAI,MAAM,yBAAyB;EAG3C,KAAK,OAAO,OAAO,QAAQ,KAAK;EAChC,IAAI,KAAK,QAAQ,QAAQ,KAAK,OAAO,GACnC,MAAM,IAAI,MAAM,mCAAmC;EAGrD,KAAK,gBAAgB,OAAO,iBAAiB,KAAK;EAElD,KAAK,SAAS,OAAO,WAAA,GAAA,0BAAA,uBAAA,CAAiC,gBAAgB;EACtE,IAAI,KAAK,UAAU,QAAQ,KAAK,WAAW,IACzC,MAAM,IAAI,MACR,6JAIF;EAGF,KAAK,iBAAiB,OAAO,kBAAkB,KAAK;EACpD,IAAI,KAAK,kBAAkB,KAAK,eAAe,SAAS;OAIlD,IAH0B,IAC5B,KAAK,eAAe,KAAK,MAAM,EAAE,QAAQ,CAEvB,CAAC,CAAC,SAAS,KAAK,eAAe,QACjD,MAAM,IAAI,MACR,yDACF;EAAA;EAIJ,KAAK,iBAAiB,OAAO,kBAAkB,KAAK;EACpD,KAAK,mCACH,OAAO,oCACP,KAAK;EAEP,KAAK,YAAY,OAAO,aAAa,KAAK;EAC1C,KAAK,OAAO,OAAO;EAGnB,KAAK,SAAS,IAAIC,sBAAAA,mBAAa,KAAK,MAAM,CAAC,CAAC,mBAC1C;GACE,OAAO,KAAK;GACZ,gBAAgB,KAAK;GACrB,kBAAkB;IAChB,eAAe,KAAK;IACpB,iBAAiB,KAAK;IACtB,aAAa,KAAK;IAClB,MAAM,KAAK;IACX,MAAM,KAAK;IACX,GAAI,KAAK,QAAQ,OACb,EAAE,kBAAkB,mBAAmB,IACvC,CAAC;GACP;EACF,GACA;GACE,YAAY,OAAO;GACnB,SAAS,OAAO;GAChB,eAAe,OAAO;EACxB,CACF;EACA,KAAK,cAAc,OAAO,eAAe,KAAK;CAChD;CAEA,OAAO,UAAyC;EAC9C,OAAO;CACT;;;;;CAMA,wBACE,eACA,OAC2B;EAC3B,IAAI,CAAC,eACH;EAGF,MAAM,SAAwB;GAC5B,cAAc,cAAc,oBAAoB;GAChD,gBACG,cAAc,wBAAwB,MACtC,cAAc,sBAAsB;GACvC,cAAc,cAAc,mBAAmB;EACjD;EAEA,IAAI,cAAc,yBAAyB;GACzC,OAAO,wBAAwB,CAAC;GAChC,OAAO,oBAAoB,aACzB,cAAc;EAClB;EAGA,IAAI,UAAU,wBAAwB;GACpC,MAAM,WAAW,KAAK,IACpB,IACC,cAAc,oBAAoB,KAAK,GAC1C;GACA,MAAM,iBAAiB,KAAK,IAC1B,IACC,cAAc,2BAA2B,KAAK,GACjD;GACA,IAAI,UACF,OAAO,sBAAsB;IAC3B,GAAG,OAAO;IACV,WAAW;GACb;GAEF,IAAI,gBACF,OAAO,sBAAsB;IAC3B,GAAG,OAAO;IACV,sBAAsB;GACxB;EAEJ;EAEA,OAAO;CACT;CAEA,iBACE,SAC0C;EAC1C,MAAM,SAAS,MAAM,iBAAiB,OAAO;EAC7C,IAAI,KAAK;;EAEP,KAAK,OAAO,mBAAmB;;GAE7B,GAAG,KAAK,OAAO;;GAEf,gBAAgB,KAAK;EACvB;EAEF,IACE,KAAK,qCAAqC,QAC1C,MAAM,QAAQ,OAAO,KAAK,KAC1B,OAAO,MAAM,SAAS,GACtB;GACA,MAAM,aAAa,OAAO;GAG1B,MAAM,wBAAwB,YAAY;GAC1C,OAAO,aAAa;IAClB,GAAG;IACH,GAAI,uBAAuB,SAASC,sBAAAA,oBAAoB,OACpD,EACA,uBAAuB;KACrB,GAAG;KACH,MAAM;IACR,EACF,IACE,CAAC;IACL,kCAAkC;GACpC;EACF;EACA,OAAO;CACT;CAEA,MAAM,UACJ,UACA,SACA,YACuD;EACvD,MAAM,SAASC,eAAAA,6BACb,UACA,KAAK,oBACL,KAAK,sBACL,KAAK,KACP;EACA,IAAI,eAAe;EACnB,IAAI,SAAS,EAAE,CAAC,SAAS,UAAU;GACjC,MAAM,CAAC,qBAAqB;;GAE5B,KAAK,OAAO,oBAAoB;GAChC,eAAe,OAAO,MAAM,CAAC;EAC/B;EACA,eAAeC,eAAAA,gCAAgC,cAAc,KAAK,KAAK;EAEvE,MAAM,UAAU;GACd,GAFiB,KAAK,iBAAiB,OAE3B;GACZ,UAAU;EACZ;EASA,MAAM,YAAW,MAPC,KAAK,OAAO,gBAC5B,EAAE,QAAQ,QAAQ,OAAO,GACzB,YAEE,KAAK,OAAO,gBAAgB,OAAO,CACvC,EAAA,CAEqB;;EAQrB,MAAM,mBAAmBC,eAAAA,qCAAqC,UAAU,EACtE,eARoB,KAAK;;GAEzB,SAAS;GACT,KAAK;EAKO,EACd,CAAC;EAED,MAAM,YAAY,kBAChB,iBAAiB,YAAY,EAAE,CAAC,QAAQ,IACxC,KAAA,GACA,KAAA,GACA,KAAA,GACA,KAAA,GACA,KAAA,CACF;EACA,OAAO;CACT;CAEA,OAAO,sBACL,UACA,SACA,YACqC;EACrC,OAAOC,sBAAAA,uBAAuB;GAC5B,QAAQ,KAAK,sBAAsB,UAAU,OAAO;GACpD,SAAS,KAAK;GACd,QAAQ,QAAQ;GAChB;EACF,CAAC;CACH;CAEA,OAAe,sBACb,UACA,SACqC;EACrC,MAAM,SAASH,eAAAA,6BACb,UACA,KAAK,oBACL,KAAK,sBACL,KAAK,KACP;EACA,IAAI,eAAe;EACnB,IAAI,SAAS,EAAE,CAAC,SAAS,UAAU;GACjC,MAAM,CAAC,qBAAqB;;GAE5B,KAAK,OAAO,oBAAoB;GAChC,eAAe,OAAO,MAAM,CAAC;EAC/B;EACA,eAAeC,eAAAA,gCAAgC,cAAc,KAAK,KAAK;EAEvE,MAAM,UAAU;GACd,GAFiB,KAAK,iBAAiB,OAE3B;GACZ,UAAU;EACZ;EACA,MAAM,SAAS,MAAM,KAAK,OAAO,gBAC/B,EAAE,QAAQ,QAAQ,OAAO,GACzB,YAAY;;GAEV,MAAM,EAAE,WAAW,MAAM,KAAK,OAAO,sBAAsB,OAAO;GAClE,OAAO;EACT,CACF;EAEA,IAAI,QAAQ;EACZ,IAAI;EACJ,WAAW,MAAM,YAAY,QAAQ;GACnC,IACE,mBAAmB,YACnB,KAAK,gBAAgB,SACrB,QAAQ,gBAAgB,OAExB,oBAAoB,KAAK,wBACvB,SAAS,eACT,KAAK,KACP;GAGF,MAAM,QAAQG,eAAAA,4CAA4C,UAAU;IAClE,eAAe,KAAA;IACf;GACF,CAAC;GACD,SAAS;GACT,IAAI,CAAC,OACH;GAGF,MAAM;EACR;EAEA,IAAI,mBACF,MAAM,IAAIC,wBAAAA,oBAAoB;GAC5B,MAAM;GACN,SAAS,IAAIC,yBAAAA,eAAe;IAC1B,SAAS;IACT,gBAAgB;GAClB,CAAC;EACH,CAAC;CAEL;AACF"}
@@ -0,0 +1,26 @@
1
+ const require_smoother = require("../stream/smoother.cjs");
2
+ const require_chunkAdapters = require("../stream/chunkAdapters.cjs");
3
+ let _langchain_mistralai = require("@langchain/mistralai");
4
+ //#region src/llm/mistral/index.ts
5
+ var CustomChatMistralAI = class extends _langchain_mistralai.ChatMistralAI {
6
+ _lc_stream_delay;
7
+ static lc_name() {
8
+ return "LibreChatMistralAI";
9
+ }
10
+ constructor(fields) {
11
+ super(fields);
12
+ this._lc_stream_delay = require_smoother.resolveStreamDelay(fields?._lc_stream_delay);
13
+ }
14
+ async *_streamResponseChunks(messages, options, runManager) {
15
+ yield* require_chunkAdapters.smoothGenerationChunks({
16
+ chunks: super._streamResponseChunks(messages, options, void 0),
17
+ delayMs: this._lc_stream_delay,
18
+ signal: options.signal,
19
+ runManager
20
+ });
21
+ }
22
+ };
23
+ //#endregion
24
+ exports.CustomChatMistralAI = CustomChatMistralAI;
25
+
26
+ //# sourceMappingURL=index.cjs.map
@@ -0,0 +1 @@
1
+ {"version":3,"file":"index.cjs","names":["ChatMistralAI","resolveStreamDelay","smoothGenerationChunks"],"sources":["../../../../src/llm/mistral/index.ts"],"sourcesContent":["import { ChatMistralAI } from '@langchain/mistralai';\nimport type { CallbackManagerForLLMRun } from '@langchain/core/callbacks/manager';\nimport type { ChatGenerationChunk } from '@langchain/core/outputs';\nimport type { BaseMessage } from '@langchain/core/messages';\nimport type { MistralAIClientOptions } from '@/types';\nimport { smoothGenerationChunks } from '@/llm/stream/chunkAdapters';\nimport { resolveStreamDelay } from '@/llm/stream/smoother';\n\nexport class CustomChatMistralAI extends ChatMistralAI {\n _lc_stream_delay: number;\n\n static lc_name(): 'LibreChatMistralAI' {\n return 'LibreChatMistralAI';\n }\n\n constructor(fields?: MistralAIClientOptions) {\n super(fields);\n this._lc_stream_delay = resolveStreamDelay(fields?._lc_stream_delay);\n }\n\n async *_streamResponseChunks(\n messages: BaseMessage[],\n options: this['ParsedCallOptions'],\n runManager?: CallbackManagerForLLMRun\n ): AsyncGenerator<ChatGenerationChunk> {\n yield* smoothGenerationChunks({\n chunks: super._streamResponseChunks(messages, options, undefined),\n delayMs: this._lc_stream_delay,\n signal: options.signal,\n runManager,\n });\n }\n}\n"],"mappings":";;;;AAQA,IAAa,sBAAb,cAAyCA,qBAAAA,cAAc;CACrD;CAEA,OAAO,UAAgC;EACrC,OAAO;CACT;CAEA,YAAY,QAAiC;EAC3C,MAAM,MAAM;EACZ,KAAK,mBAAmBC,iBAAAA,mBAAmB,QAAQ,gBAAgB;CACrE;CAEA,OAAO,sBACL,UACA,SACA,YACqC;EACrC,OAAOC,sBAAAA,uBAAuB;GAC5B,QAAQ,MAAM,sBAAsB,UAAU,SAAS,KAAA,CAAS;GAChE,SAAS,KAAK;GACd,QAAQ,QAAQ;GAChB;EACF,CAAC;CACH;AACF"}
@@ -2,27 +2,19 @@ const require_cache = require("../../messages/cache.cjs");
2
2
  const require_core = require("../../messages/core.cjs");
3
3
  const require_streamedToolCallSeals = require("../../tools/streamedToolCallSeals.cjs");
4
4
  const require_intentArg = require("../../tools/intentArg.cjs");
5
+ const require_smoother = require("../stream/smoother.cjs");
6
+ const require_chunkAdapters = require("../stream/chunkAdapters.cjs");
5
7
  const require_index = require("./utils/index.cjs");
6
8
  const require_streamMetadata = require("./streamMetadata.cjs");
7
9
  let _langchain_openai = require("@langchain/openai");
8
10
  let _langchain_core_messages = require("@langchain/core/messages");
11
+ let _langchain_core_outputs = require("@langchain/core/outputs");
9
12
  let openai = require("openai");
10
13
  let _langchain_xai = require("@langchain/xai");
11
- let _langchain_core_outputs = require("@langchain/core/outputs");
12
14
  let _langchain_deepseek = require("@langchain/deepseek");
13
15
  let _langchain_core_utils_function_calling = require("@langchain/core/utils/function_calling");
14
16
  //#region src/llm/openai/index.ts
15
17
  const iife = (fn) => fn();
16
- const STREAM_CHUNK_MIN_SIZE = 4;
17
- const STREAM_BOUNDARIES = new Set([
18
- " ",
19
- ".",
20
- ",",
21
- "!",
22
- "?",
23
- ";",
24
- ":"
25
- ]);
26
18
  function isHeaders(headers) {
27
19
  return typeof Headers !== "undefined" && headers !== null && typeof headers === "object" && Object.prototype.toString.call(headers) === "[object Headers]";
28
20
  }
@@ -504,38 +496,60 @@ function getCustomOpenAIClientOptions(owner, options) {
504
496
  ...options
505
497
  };
506
498
  }
507
- function findStreamChunkBoundary(text, minSize) {
508
- if (minSize >= text.length) return text.length;
509
- for (let position = minSize; position < text.length; position++) if (STREAM_BOUNDARIES.has(text[position])) return position + 1;
510
- return text.length;
511
- }
512
- function splitStreamToken(text) {
513
- const chunks = [];
514
- let currentIndex = 0;
515
- while (currentIndex < text.length) {
516
- const chunkSize = findStreamChunkBoundary(text.slice(currentIndex), STREAM_CHUNK_MIN_SIZE);
517
- chunks.push(text.slice(currentIndex, currentIndex + chunkSize));
518
- currentIndex += chunkSize;
519
- }
520
- return chunks;
521
- }
522
- function splitTextGenerationChunk(chunk) {
499
+ /**
500
+ * Classifies a generation chunk for the smoothing engine:
501
+ * - splittable: plain visible text (string content equal to `chunk.text`, no
502
+ * logprobs / finish_reason) — sliced adaptively at the pacing cadence.
503
+ * ANY logprobs value blocks splitting here (this family only attaches
504
+ * logprobs on request; the DeepSeek suite pins chunks with them staying
505
+ * intact) deliberately stricter than `stream/chunkAdapters.ts`, where
506
+ * google-common's always-present empty logprobs must not block.
507
+ * - atomic: text- or reasoning-bearing chunks whose metadata cannot survive
508
+ * slicing paced as one piece, never split (legacy parity: these were
509
+ * emitted whole but still paced).
510
+ * - passthrough: tool-call deltas, usage-only, finish_reason and other
511
+ * metadata chunks — strict FIFO, zero delay.
512
+ */
513
+ function toSmoothItem(chunk) {
523
514
  const { message } = chunk;
524
- if (!chunk.text || !(message instanceof _langchain_core_messages.AIMessageChunk) || typeof message.content !== "string" || message.content !== chunk.text || chunk.generationInfo?.logprobs != null || chunk.generationInfo?.finish_reason != null) return [chunk];
525
- const tokenChunks = splitStreamToken(chunk.text);
526
- if (tokenChunks.length <= 1) return [chunk];
527
- let emittedUsage = false;
528
- return tokenChunks.map((token) => {
529
- const usageMetadata = emittedUsage && message.usage_metadata != null ? void 0 : message.usage_metadata;
530
- if (message.usage_metadata != null && !emittedUsage) emittedUsage = true;
531
- return new _langchain_core_outputs.ChatGenerationChunk({
532
- text: token,
533
- generationInfo: chunk.generationInfo,
534
- message: new _langchain_core_messages.AIMessageChunk(Object.assign({}, message, {
535
- content: token,
536
- usage_metadata: usageMetadata
537
- }))
538
- });
515
+ const isMessageChunk = message instanceof _langchain_core_messages.AIMessageChunk;
516
+ if (Boolean(chunk.text) && isMessageChunk && typeof message.content === "string" && message.content === chunk.text && chunk.generationInfo?.logprobs == null && chunk.generationInfo?.finish_reason == null && !require_chunkAdapters.hasReasoningKwargs(message) && !require_chunkAdapters.hasToolCallChunks(message)) return {
517
+ text: chunk.text,
518
+ smooth: true,
519
+ emit: (piece) => cloneGenerationChunkPiece(chunk, piece)
520
+ };
521
+ const pacedText = chunk.text || (isMessageChunk ? require_chunkAdapters.getReasoningKwargsText(message) : "");
522
+ if (pacedText !== "") return {
523
+ text: pacedText,
524
+ smooth: true,
525
+ atomic: true,
526
+ emit: () => chunk
527
+ };
528
+ return {
529
+ text: "",
530
+ smooth: false,
531
+ emit: () => chunk
532
+ };
533
+ }
534
+ /**
535
+ * Usage metadata, additional kwargs and response metadata survive only on
536
+ * the first piece: the aggregator's dict merge concatenates string fields
537
+ * and sums usage, so replication across pieces corrupts them. Unlike the
538
+ * generic adapter, `generationInfo` stays on every piece — per-piece token
539
+ * indices ride in it and `dropRepeatedScalarMetadata` owns repetition there.
540
+ */
541
+ function cloneGenerationChunkPiece(chunk, piece) {
542
+ if (piece.isFirst && piece.isLast) return chunk;
543
+ const message = chunk.message;
544
+ return new _langchain_core_outputs.ChatGenerationChunk({
545
+ text: piece.text,
546
+ generationInfo: chunk.generationInfo,
547
+ message: new _langchain_core_messages.AIMessageChunk(Object.assign({}, message, {
548
+ content: piece.text,
549
+ usage_metadata: piece.isFirst ? message.usage_metadata : void 0,
550
+ additional_kwargs: piece.isFirst ? message.additional_kwargs : {},
551
+ response_metadata: piece.isFirst ? message.response_metadata : {}
552
+ }))
539
553
  });
540
554
  }
541
555
  async function emitStreamChunkCallback(chunk, runManager) {
@@ -549,42 +563,30 @@ function getStreamChunkTokenIndices(chunk) {
549
563
  completion
550
564
  };
551
565
  }
566
+ /**
567
+ * Adaptive smoothing adapter for the OpenAI chat-model family, layered over
568
+ * the shared `smoothStream` engine. Keeps the historical signature so every
569
+ * `_streamResponseChunks` call site is unchanged.
570
+ *
571
+ * `seenScalarMetadata`: when provided, de-duplicates repeated scalar metadata
572
+ * just before emitting, so token callbacks and the yielded chunk observe the
573
+ * same cleaned data. Omitted by callers that wrap this stream and finalize
574
+ * downstream (e.g. `ChatOpenRouter`, which needs the raw `finish_reason` as
575
+ * its flush signal and de-duplicates after its own processing).
576
+ */
552
577
  async function* delayStreamChunks(chunks, delay, signal, runManager, seenScalarMetadata) {
553
- let lastYieldedAt;
554
- for await (const chunk of chunks) {
555
- const outputChunks = delay != null && delay > 0 ? splitTextGenerationChunk(chunk) : [chunk];
556
- for (const outputChunk of outputChunks) {
557
- signal?.throwIfAborted();
558
- if (delay != null && delay > 0 && lastYieldedAt != null) {
559
- const timeSinceLastYield = Date.now() - lastYieldedAt;
560
- const timeToWait = Math.max(0, delay - timeSinceLastYield);
561
- if (timeToWait > 0) await sleepWithAbort(timeToWait, signal);
562
- }
563
- signal?.throwIfAborted();
564
- lastYieldedAt = Date.now();
565
- if (seenScalarMetadata != null) require_streamMetadata.dropRepeatedScalarMetadata(outputChunk, seenScalarMetadata);
566
- await emitStreamChunkCallback(outputChunk, runManager);
567
- signal?.throwIfAborted();
568
- yield outputChunk;
569
- }
570
- }
571
- }
572
- async function sleepWithAbort(delay, signal) {
573
- if (delay <= 0) return;
574
- signal?.throwIfAborted();
575
- await new Promise((resolve, reject) => {
576
- const timeout = setTimeout(() => {
577
- signal?.removeEventListener("abort", onAbort);
578
- resolve();
579
- }, delay);
580
- const onAbort = () => {
581
- clearTimeout(timeout);
582
- signal?.removeEventListener("abort", onAbort);
583
- reject(signal?.reason ?? /* @__PURE__ */ new Error("AbortError: User aborted request."));
584
- };
585
- signal?.addEventListener("abort", onAbort, { once: true });
586
- if (signal?.aborted === true) onAbort();
578
+ const smoothed = require_smoother.smoothStream({
579
+ source: (async function* () {
580
+ for await (const chunk of chunks) yield toSmoothItem(chunk);
581
+ })(),
582
+ delayMs: delay != null && delay > 0 ? delay : 0,
583
+ signal
587
584
  });
585
+ for await (const outputChunk of smoothed) {
586
+ if (seenScalarMetadata != null) require_streamMetadata.dropRepeatedScalarMetadata(outputChunk, seenScalarMetadata);
587
+ await emitStreamChunkCallback(outputChunk, runManager);
588
+ yield outputChunk;
589
+ }
588
590
  }
589
591
  function createAbortHandler(controller) {
590
592
  return function() {
@@ -1184,7 +1186,7 @@ var ChatOpenAI = class extends _langchain_openai.ChatOpenAI {
1184
1186
  _lc_stream_delay;
1185
1187
  constructor(fields) {
1186
1188
  super(withLibreChatOpenAIFields(fields));
1187
- this._lc_stream_delay = fields?._lc_stream_delay;
1189
+ this._lc_stream_delay = require_smoother.resolveStreamDelay(fields?._lc_stream_delay);
1188
1190
  }
1189
1191
  get exposedClient() {
1190
1192
  return getExposedOpenAIClient(this.completions, this.responses, this._useResponsesApi(void 0));
@@ -1237,7 +1239,7 @@ var AzureChatOpenAI = class extends _langchain_openai.AzureChatOpenAI {
1237
1239
  super(fields);
1238
1240
  this.completions = new LibreChatAzureOpenAICompletions(fields);
1239
1241
  this.responses = new LibreChatAzureOpenAIResponses(fields);
1240
- this._lc_stream_delay = fields?._lc_stream_delay;
1242
+ this._lc_stream_delay = require_smoother.resolveStreamDelay(fields?._lc_stream_delay);
1241
1243
  }
1242
1244
  get exposedClient() {
1243
1245
  return getExposedOpenAIClient(this.completions, this.responses, this._useResponsesApi(void 0));
@@ -1309,7 +1311,7 @@ var ChatDeepSeek = class extends _langchain_deepseek.ChatDeepSeek {
1309
1311
  _lc_stream_delay;
1310
1312
  constructor(fields) {
1311
1313
  super(fields);
1312
- this._lc_stream_delay = fields?._lc_stream_delay;
1314
+ this._lc_stream_delay = require_smoother.resolveStreamDelay(fields?._lc_stream_delay);
1313
1315
  }
1314
1316
  get exposedClient() {
1315
1317
  return this.client;
@@ -1572,7 +1574,7 @@ var ChatXAI = class extends _langchain_xai.ChatXAI {
1572
1574
  _lc_stream_delay;
1573
1575
  constructor(fields) {
1574
1576
  super(fields);
1575
- this._lc_stream_delay = fields?._lc_stream_delay;
1577
+ this._lc_stream_delay = require_smoother.resolveStreamDelay(fields?._lc_stream_delay);
1576
1578
  const customBaseURL = fields?.configuration?.baseURL ?? fields?.clientConfig?.baseURL;
1577
1579
  if (customBaseURL != null && customBaseURL) {
1578
1580
  this.clientConfig = {