neoagent 3.2.1-beta.1 → 3.2.1-beta.10

This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
Files changed (172) hide show
  1. package/extensions/chrome-browser/background.mjs +318 -88
  2. package/extensions/chrome-browser/http.mjs +136 -0
  3. package/extensions/chrome-browser/protocol.mjs +654 -90
  4. package/flutter_app/lib/main_chat.dart +118 -739
  5. package/flutter_app/lib/main_controller.dart +111 -20
  6. package/flutter_app/lib/main_integrations.dart +607 -8
  7. package/flutter_app/lib/main_models.dart +3 -0
  8. package/flutter_app/lib/main_operations.dart +334 -321
  9. package/flutter_app/lib/main_security.dart +266 -112
  10. package/flutter_app/lib/main_settings.dart +4 -3
  11. package/flutter_app/lib/main_shared.dart +14 -11
  12. package/flutter_app/lib/src/backend_client.dart +78 -0
  13. package/flutter_app/lib/src/desktop_companion_actions.dart +185 -31
  14. package/flutter_app/lib/src/desktop_companion_io.dart +319 -86
  15. package/flutter_app/windows/runner/flutter_window.cpp +143 -32
  16. package/landing/index.html +3 -1
  17. package/lib/manager.js +106 -89
  18. package/lib/schema_migrations.js +115 -13
  19. package/package.json +30 -15
  20. package/runtime/paths.js +49 -5
  21. package/server/db/database.js +2 -2
  22. package/server/guest-agent.cli.package.json +13 -0
  23. package/server/guest_agent.js +85 -40
  24. package/server/http/middleware.js +24 -0
  25. package/server/http/routes.js +11 -6
  26. package/server/public/.last_build_id +1 -1
  27. package/server/public/assets/fonts/MaterialIcons-Regular.otf +0 -0
  28. package/server/public/flutter_bootstrap.js +2 -2
  29. package/server/public/main.dart.js +73083 -72209
  30. package/server/routes/admin.js +1 -1
  31. package/server/routes/android.js +30 -34
  32. package/server/routes/browser.js +23 -15
  33. package/server/routes/desktop.js +18 -1
  34. package/server/routes/integrations.js +107 -1
  35. package/server/routes/memory.js +1 -0
  36. package/server/routes/settings.js +16 -5
  37. package/server/routes/social_reach.js +12 -3
  38. package/server/routes/social_video.js +4 -0
  39. package/server/services/agents/manager.js +1 -1
  40. package/server/services/ai/capabilityHealth.js +62 -96
  41. package/server/services/ai/compaction.js +7 -2
  42. package/server/services/ai/history.js +45 -6
  43. package/server/services/ai/integrated_tools/http_request.js +8 -0
  44. package/server/services/ai/loop/agent_engine_core.js +390 -162
  45. package/server/services/ai/loop/blank_recovery.js +5 -4
  46. package/server/services/ai/loop/callbacks.js +1 -0
  47. package/server/services/ai/loop/completion_judge.js +121 -5
  48. package/server/services/ai/loop/conversation_loop.js +510 -332
  49. package/server/services/ai/loop/messaging_delivery.js +129 -57
  50. package/server/services/ai/loop/model_call_guard.js +91 -0
  51. package/server/services/ai/loop/model_io.js +20 -45
  52. package/server/services/ai/loop/progress_classification.js +2 -0
  53. package/server/services/ai/loop/tool_dispatch.js +19 -8
  54. package/server/services/ai/loopPolicy.js +48 -21
  55. package/server/services/ai/messagingFallback.js +17 -17
  56. package/server/services/ai/model_discovery.js +227 -0
  57. package/server/services/ai/model_failure_cache.js +108 -0
  58. package/server/services/ai/model_identity.js +71 -0
  59. package/server/services/ai/models.js +68 -163
  60. package/server/services/ai/providerRetry.js +17 -59
  61. package/server/services/ai/provider_selector.js +166 -0
  62. package/server/services/ai/providers/anthropic.js +2 -2
  63. package/server/services/ai/providers/claudeCode.js +21 -33
  64. package/server/services/ai/providers/githubCopilot.js +41 -20
  65. package/server/services/ai/providers/google.js +135 -97
  66. package/server/services/ai/providers/grok.js +4 -3
  67. package/server/services/ai/providers/grokOauth.js +19 -27
  68. package/server/services/ai/providers/nvidia.js +10 -5
  69. package/server/services/ai/providers/ollama.js +111 -84
  70. package/server/services/ai/providers/ollama_stream.js +142 -0
  71. package/server/services/ai/providers/openai.js +39 -5
  72. package/server/services/ai/providers/openaiCodex.js +11 -4
  73. package/server/services/ai/providers/openrouter.js +29 -7
  74. package/server/services/ai/providers/provider_error.js +36 -0
  75. package/server/services/ai/settings.js +26 -2
  76. package/server/services/ai/systemPrompt.js +19 -12
  77. package/server/services/ai/taskAnalysis.js +58 -10
  78. package/server/services/ai/terminal_reply.js +18 -0
  79. package/server/services/ai/toolEvidence.js +350 -29
  80. package/server/services/ai/tools.js +190 -111
  81. package/server/services/android/controller.js +770 -237
  82. package/server/services/android/process.js +140 -0
  83. package/server/services/android/sdk_download.js +143 -0
  84. package/server/services/android/uia.js +6 -5
  85. package/server/services/artifacts/store.js +24 -0
  86. package/server/services/browser/controller.js +843 -385
  87. package/server/services/browser/extension/gateway.js +40 -16
  88. package/server/services/browser/extension/protocol.js +15 -1
  89. package/server/services/browser/extension/provider.js +71 -47
  90. package/server/services/browser/extension/registry.js +155 -34
  91. package/server/services/cli/executor.js +62 -9
  92. package/server/services/credentials/bitwarden_cli.js +322 -0
  93. package/server/services/credentials/broker.js +594 -0
  94. package/server/services/desktop/gateway.js +41 -4
  95. package/server/services/desktop/protocol.js +3 -0
  96. package/server/services/desktop/provider.js +39 -42
  97. package/server/services/desktop/registry.js +137 -52
  98. package/server/services/integrations/bitwarden/constants.js +14 -0
  99. package/server/services/integrations/bitwarden/provider.js +197 -0
  100. package/server/services/integrations/bitwarden/snapshot.js +65 -0
  101. package/server/services/integrations/figma/provider.js +78 -12
  102. package/server/services/integrations/github/common.js +11 -6
  103. package/server/services/integrations/github/provider.js +52 -53
  104. package/server/services/integrations/google/provider.js +55 -19
  105. package/server/services/integrations/home_assistant/network.js +17 -20
  106. package/server/services/integrations/home_assistant/provider.js +7 -5
  107. package/server/services/integrations/home_assistant/tools.js +17 -5
  108. package/server/services/integrations/http.js +51 -0
  109. package/server/services/integrations/manager.js +159 -53
  110. package/server/services/integrations/microsoft/provider.js +80 -13
  111. package/server/services/integrations/neoarchive/provider.js +55 -29
  112. package/server/services/integrations/neorecall/client.js +17 -10
  113. package/server/services/integrations/neorecall/provider.js +20 -11
  114. package/server/services/integrations/notion/provider.js +16 -13
  115. package/server/services/integrations/oauth_provider.js +115 -51
  116. package/server/services/integrations/registry.js +2 -0
  117. package/server/services/integrations/slack/provider.js +98 -9
  118. package/server/services/integrations/spotify/provider.js +67 -71
  119. package/server/services/integrations/trello/provider.js +21 -7
  120. package/server/services/integrations/weather/provider.js +18 -12
  121. package/server/services/integrations/whatsapp/provider.js +76 -16
  122. package/server/services/manager.js +110 -1
  123. package/server/services/memory/embedding_index.js +20 -8
  124. package/server/services/memory/embeddings.js +151 -90
  125. package/server/services/memory/ingestion.js +50 -9
  126. package/server/services/memory/ingestion_documents.js +13 -3
  127. package/server/services/memory/manager.js +52 -19
  128. package/server/services/messaging/automation.js +85 -10
  129. package/server/services/messaging/formatting_guides.js +7 -4
  130. package/server/services/messaging/http_platforms.js +33 -13
  131. package/server/services/messaging/inbound_queue.js +78 -24
  132. package/server/services/messaging/inbound_store.js +224 -0
  133. package/server/services/messaging/manager.js +326 -51
  134. package/server/services/messaging/typing_keepalive.js +5 -2
  135. package/server/services/messaging/whatsapp.js +22 -14
  136. package/server/services/network/http.js +210 -0
  137. package/server/services/network/safe_request.js +307 -0
  138. package/server/services/runtime/backends/local-vm.js +227 -67
  139. package/server/services/runtime/docker-vm-manager.js +9 -0
  140. package/server/services/runtime/guest_bootstrap.js +30 -4
  141. package/server/services/runtime/guest_image.js +43 -12
  142. package/server/services/runtime/manager.js +77 -23
  143. package/server/services/runtime/validation.js +7 -6
  144. package/server/services/security/tool_categories.js +6 -0
  145. package/server/services/social_reach/channels/github.js +10 -4
  146. package/server/services/social_reach/channels/reddit.js +4 -4
  147. package/server/services/social_reach/channels/rss.js +2 -2
  148. package/server/services/social_reach/channels/social_video.js +12 -7
  149. package/server/services/social_reach/channels/v2ex.js +21 -8
  150. package/server/services/social_reach/channels/x.js +2 -2
  151. package/server/services/social_reach/channels/xueqiu.js +5 -5
  152. package/server/services/social_reach/service.js +9 -6
  153. package/server/services/social_reach/utils.js +65 -14
  154. package/server/services/social_video/service.js +160 -50
  155. package/server/services/tasks/integration_runtime.js +18 -8
  156. package/server/services/tasks/runtime.js +39 -4
  157. package/server/services/voice/agentBridge.js +17 -4
  158. package/server/services/voice/bufferedLiveRelayAdapter.js +5 -0
  159. package/server/services/voice/liveSession.js +31 -0
  160. package/server/services/voice/message.js +1 -1
  161. package/server/services/voice/openaiSpeech.js +33 -8
  162. package/server/services/voice/providers.js +233 -151
  163. package/server/services/voice/runtime.js +2 -2
  164. package/server/services/voice/runtimeManager.js +118 -20
  165. package/server/services/voice/turnRunner.js +6 -0
  166. package/server/services/wearable/firmware_manifest.js +51 -13
  167. package/server/services/wearable/service.js +1 -0
  168. package/server/utils/abort.js +96 -0
  169. package/server/utils/cloud-security.js +110 -3
  170. package/server/utils/files.js +31 -0
  171. package/server/utils/image_payload.js +95 -0
  172. package/server/utils/retry.js +107 -0
@@ -55,6 +55,16 @@ const { normalizeCompletionConfidence, shouldAcceptTaskComplete } = require('../
55
55
  const { enforceRateLimits } = require('../rate_limits');
56
56
  const { ToolRepetitionGuard } = require('../repetitionGuard');
57
57
  const { shortenRunId, summarizeForLog } = require('../logFormat');
58
+ const {
59
+ normalizeModelSelections,
60
+ resolveModelSelection,
61
+ } = require('../model_identity');
62
+ const {
63
+ isModelCoolingDown,
64
+ recordModelFailure,
65
+ recordModelSuccess,
66
+ } = require('../model_failure_cache');
67
+ const { getProviderForUser } = require('../provider_selector');
58
68
  const { IterationBudget } = require('./iteration_budget');
59
69
  const {
60
70
  buildBlankAfterToolFailureGuidance,
@@ -116,7 +126,7 @@ const {
116
126
  const {
117
127
  requestModelResponse: requestModelResponseImpl,
118
128
  requestStructuredJson: requestStructuredJsonImpl,
119
- withModelCallTimeout,
129
+ runAbortableModelCall,
120
130
  } = require('./model_io');
121
131
  const {
122
132
  publishInterimUpdate: publishInterimUpdateImpl,
@@ -144,6 +154,7 @@ const {
144
154
  buildModelFailureLoopPrompt,
145
155
  } = require('../messagingFallback');
146
156
  const {
157
+ assessResearchAdequacy,
147
158
  classifyToolExecution,
148
159
  gatheredNewEvidence,
149
160
  isSubstantiveProgressToolName,
@@ -164,6 +175,7 @@ const {
164
175
  normalizeRetrievalPlan,
165
176
  shouldEnhanceRetrieval,
166
177
  } = require('../../memory/retrieval_reasoning');
178
+ const { isAbortError, throwIfAborted } = require('../../../utils/abort');
167
179
 
168
180
  function generateTitle(task) {
169
181
  if (!task || typeof task !== 'string') return 'Untitled';
@@ -291,13 +303,34 @@ function summarizeReadTargets(toolExecutions = []) {
291
303
  return targets.join('; ');
292
304
  }
293
305
 
294
- function buildNoProgressWrapupPrompt({ readOnlyCount = 0, alreadyRead = '', platform = null } = {}) {
306
+ function buildNoProgressWrapupPrompt({
307
+ readOnlyCount = 0,
308
+ alreadyRead = '',
309
+ platform = null,
310
+ researchAdequacy = null,
311
+ } = {}) {
312
+ const adequacy = researchAdequacy && typeof researchAdequacy === 'object'
313
+ ? researchAdequacy
314
+ : null;
315
+ const researchIncomplete = adequacy
316
+ && adequacy.adequate === false
317
+ && adequacy.intensity
318
+ && adequacy.intensity !== 'none';
295
319
  return [
296
320
  `This is the final turn for this run (no further tool calls; ${Math.max(0, Number(readOnlyCount) || 0)} read-only turns without a state change).`,
297
321
  alreadyRead ? `Already gathered: ${alreadyRead}.` : '',
322
+ researchIncomplete
323
+ ? `Research coverage is incomplete: ${adequacy.reason || 'requested targets still lack primary evidence.'}`
324
+ : '',
325
+ researchIncomplete && adequacy.uncoveredTargets?.length
326
+ ? `Uncovered research targets: ${adequacy.uncoveredTargets.join('; ')}.`
327
+ : '',
298
328
  'Write the answer now from everything you have already gathered in this conversation. Deliver the useful result you DO have — calendar, weather, emails, search findings, whatever was collected — formatted as the actual answer to the original request.',
299
329
  'If one part could not be retrieved, still deliver everything else and note the missing part in at most one short clause. Never withhold a useful answer because a single detail is missing.',
300
- 'Only report a pure blocker if you genuinely gathered nothing usable at all. Do not describe the result as unfinished, unconfirmed, "blocked", or "still working" when you have something useful this IS the final answer.',
330
+ 'Do not invent entities, products, people, files, outcomes, or next-step work that is not already supported by tool evidence in this conversation.',
331
+ researchIncomplete
332
+ ? 'Because research is incomplete, clearly label assumptions and missing targets. Prefer a partial verified answer or a concrete blocker over a confident fabricated comparison.'
333
+ : 'Only report a pure blocker if you genuinely gathered nothing usable at all. Do not describe the result as unfinished, unconfirmed, "blocked", or "still working" when you have something useful — this IS the final answer.',
301
334
  buildMaxIterationWrapupPrompt(platform),
302
335
  ].filter(Boolean).join('\n\n');
303
336
  }
@@ -403,145 +436,75 @@ function buildAutonomyPolicyFromAnalysis(analysis = {}) {
403
436
  };
404
437
  }
405
438
 
406
- async function getProviderForUser(userId, task = '', isSubagent = false, modelOverride = null, providerConfig = {}) {
407
- const { getSupportedModels, createProviderInstance } = require('../models');
408
- const agentId = providerConfig.agentId || null;
409
- const aiSettings = getAiSettings(userId, agentId);
410
- const models = await getSupportedModels(userId, agentId);
411
-
412
- let enabledIds = Array.isArray(aiSettings.enabled_models) ? aiSettings.enabled_models : [];
413
- const defaultChatModel = aiSettings.default_chat_model || 'auto';
414
- const defaultSubagentModel = aiSettings.default_subagent_model || 'auto';
415
- const smarterSelection = aiSettings.smarter_model_selector !== false && aiSettings.smarter_model_selector !== 'false';
416
-
417
- const knownModelIds = new Set(models.map((m) => m.id));
418
- const selectableModels = models.filter((m) => m.available !== false);
419
-
420
- enabledIds = Array.isArray(enabledIds)
421
- ? enabledIds
422
- .map((id) => String(id))
423
- .filter((id) => knownModelIds.has(id))
424
- : [];
425
-
426
- let availableModels = selectableModels.filter((m) => enabledIds.includes(m.id));
427
- if (availableModels.length === 0) {
428
- enabledIds = selectableModels.map((m) => m.id);
429
- availableModels = [...selectableModels];
430
- }
431
-
432
- const fallbackModel = availableModels.length > 0 ? availableModels[0] : selectableModels[0];
433
-
434
- if (!fallbackModel) {
435
- throw new Error('No AI providers are currently available. Open Settings and configure at least one provider.');
436
- }
437
-
438
- let selectedModelDef = fallbackModel;
439
- const userSelectedDefault = isSubagent ? defaultSubagentModel : defaultChatModel;
440
-
441
- if (modelOverride && typeof modelOverride === 'string') {
442
- const requested = models.find((m) => m.id === modelOverride.trim());
443
- // An explicit override (e.g. a failure fallback picked by getFailureFallbackModelId)
444
- // may intentionally sit outside the user's enabled_models pool — that's the whole
445
- // point when no in-pool cross-provider option exists. Only require availability.
446
- if (requested && requested.available !== false) {
447
- selectedModelDef = requested;
448
- return {
449
- provider: createProviderInstance(selectedModelDef.provider, userId, providerConfig),
450
- model: selectedModelDef.id,
451
- providerName: selectedModelDef.provider
452
- };
453
- }
454
- }
455
-
456
- if (userSelectedDefault && userSelectedDefault !== 'auto') {
457
- selectedModelDef = models.find((m) => m.id === userSelectedDefault) || fallbackModel;
458
- } else {
459
- const selectionHint = providerConfig.selectionHint && typeof providerConfig.selectionHint === 'object'
460
- ? providerConfig.selectionHint
461
- : {};
462
- const preferredPurpose = String(selectionHint.purpose || '').trim().toLowerCase();
463
- const highAutonomy = selectionHint.autonomyLevel === 'high' || selectionHint.complexity === 'complex';
464
- const requiredConfidence = String(selectionHint.requiredConfidence || '').trim().toLowerCase();
465
- const costMode = String(selectionHint.costMode || aiSettings.cost_mode || 'balanced_auto').trim().toLowerCase();
466
- const requestedPurpose = ['planning', 'coding', 'general', 'fast'].includes(preferredPurpose)
467
- ? preferredPurpose
468
- : '';
469
- const priceRank = { free: 0, cheap: 1, medium: 2, expensive: 3 };
470
- const chooseForPurpose = (purpose) => {
471
- const candidates = availableModels.filter((model) => model.purpose === purpose);
472
- if (candidates.length === 0) return null;
473
- if (['economy', 'cost_saver', 'lowest_cost'].includes(costMode)) {
474
- return [...candidates].sort((left, right) => (
475
- (priceRank[left.priceTier] ?? 99) - (priceRank[right.priceTier] ?? 99)
476
- ))[0];
477
- }
478
- if (['quality', 'highest_quality'].includes(costMode) || requiredConfidence === 'high') {
479
- return candidates.find((model) => model.priceTier !== 'free' && model.priceTier !== 'cheap') || candidates[0];
480
- }
481
- return candidates[0];
482
- };
483
-
484
- if (smarterSelection && requestedPurpose) {
485
- selectedModelDef = chooseForPurpose(requestedPurpose) || fallbackModel;
486
- } else if (smarterSelection && highAutonomy) {
487
- selectedModelDef = chooseForPurpose('planning') || chooseForPurpose('general') || fallbackModel;
488
- } else if (isSubagent) {
489
- selectedModelDef = chooseForPurpose('fast') || fallbackModel;
490
- } else {
491
- selectedModelDef = chooseForPurpose('general') || fallbackModel;
492
- }
493
- }
494
-
495
- return {
496
- provider: createProviderInstance(selectedModelDef.provider, userId, providerConfig),
497
- model: selectedModelDef.id,
498
- providerName: selectedModelDef.provider
499
- };
500
- }
501
-
502
- async function getFailureFallbackModelId(userId, agentId, currentModelId, preferredFallbackId = null, failureError = null) {
439
+ async function getFailureFallbackModelId(
440
+ userId,
441
+ agentId,
442
+ currentModelId,
443
+ preferredFallbackId = null,
444
+ failureError = null,
445
+ signal = null,
446
+ excludedModelIds = [],
447
+ ) {
503
448
  const { getSupportedModels } = require('../models');
504
449
  const aiSettings = getAiSettings(userId, agentId);
505
- const models = await getSupportedModels(userId, agentId);
506
- const availableModels = models.filter((model) => model.available !== false);
507
- const knownIds = new Set(availableModels.map((model) => model.id));
508
- const enabledIds = Array.isArray(aiSettings.enabled_models)
509
- ? aiSettings.enabled_models.map((id) => String(id)).filter((id) => knownIds.has(id))
450
+ const models = await getSupportedModels(userId, agentId, { signal });
451
+ const excluded = new Set(
452
+ [...excludedModelIds]
453
+ .map((id) => String(id || '').trim())
454
+ .filter(Boolean),
455
+ );
456
+ const availableModels = models.filter(
457
+ (model) => model.available !== false
458
+ && !isModelCoolingDown(userId, agentId, model.id)
459
+ && !excluded.has(model.id),
460
+ );
461
+ const configuredEnabledIds = Array.isArray(aiSettings.enabled_models)
462
+ ? aiSettings.enabled_models.map((id) => String(id).trim()).filter(Boolean)
510
463
  : [];
511
- const pool = enabledIds.length > 0
464
+ const enabledIds = normalizeModelSelections(availableModels, configuredEnabledIds);
465
+ const pool = configuredEnabledIds.length > 0
512
466
  ? availableModels.filter((model) => enabledIds.includes(model.id))
513
467
  : availableModels;
514
- const fallbackSearchPool = pool.length > 0 ? pool : availableModels;
515
- const currentModel = pool.find((model) => model.id === currentModelId)
516
- || availableModels.find((model) => model.id === currentModelId)
517
- || null;
518
-
519
- // When the failure is a provider-level rate limit, the preferred fallback is
520
- // likely on the same provider and will hit the same limit. Skip it and prefer
521
- // a fallback from a different provider instead.
522
- const isProviderRateLimit = /429|rate.?limit|free-models-per/i.test(String(failureError?.message || ''));
523
-
524
- if (preferredFallbackId && preferredFallbackId !== currentModelId && !isProviderRateLimit) {
525
- const preferred = fallbackSearchPool.find((model) => model.id === preferredFallbackId)
526
- || availableModels.find((model) => model.id === preferredFallbackId);
527
- if (preferred) return preferred.id;
468
+ const fallbackSearchPool = pool;
469
+ const currentModel = resolveModelSelection(models, currentModelId);
470
+
471
+ // Provider-wide failures (credentials, throttling, or service outages) are
472
+ // likely to affect another model on the same provider. Prefer a different
473
+ // provider before consulting the configured fallback.
474
+ const failureStatus = Number(
475
+ failureError?.status
476
+ ?? failureError?.statusCode
477
+ ?? failureError?.response?.status,
478
+ );
479
+ const isProviderScopedFailure = (
480
+ failureStatus === 401
481
+ || failureStatus === 403
482
+ || failureStatus === 429
483
+ || (failureStatus >= 500 && failureStatus < 600)
484
+ || /rate.?limit|free-models-per|service unavailable|provider unavailable|authentication|api key/i
485
+ .test(String(failureError?.message || ''))
486
+ );
487
+
488
+ if (preferredFallbackId && !isProviderScopedFailure) {
489
+ const preferred = resolveModelSelection(fallbackSearchPool, preferredFallbackId)
490
+ || resolveModelSelection(availableModels, preferredFallbackId);
491
+ if (preferred && preferred.id !== currentModel?.id) return preferred.id;
528
492
  }
529
493
 
530
494
  if (currentModel?.provider) {
531
495
  const differentProvider = fallbackSearchPool.find((model) =>
532
- model.id !== currentModelId && model.provider !== currentModel.provider);
496
+ model.id !== currentModel.id && model.provider !== currentModel.provider);
533
497
  if (differentProvider) return differentProvider.id;
534
498
  }
535
499
 
536
- // If no different-provider model exists, still try the preferred fallback
537
- // even on rate limits (it's better than nothing).
538
- if (preferredFallbackId && preferredFallbackId !== currentModelId) {
539
- const preferred = fallbackSearchPool.find((model) => model.id === preferredFallbackId)
540
- || availableModels.find((model) => model.id === preferredFallbackId);
541
- if (preferred) return preferred.id;
500
+ // If no different-provider model exists, still try the preferred fallback.
501
+ if (preferredFallbackId) {
502
+ const preferred = resolveModelSelection(fallbackSearchPool, preferredFallbackId)
503
+ || resolveModelSelection(availableModels, preferredFallbackId);
504
+ if (preferred && preferred.id !== currentModel?.id) return preferred.id;
542
505
  }
543
506
 
544
- const differentModel = fallbackSearchPool.find((model) => model.id !== currentModelId);
507
+ const differentModel = fallbackSearchPool.find((model) => model.id !== currentModel?.id);
545
508
  return differentModel?.id || null;
546
509
  }
547
510
 
@@ -552,6 +515,7 @@ function estimateTokenValue(value) {
552
515
  }
553
516
 
554
517
  async function runConversation(engine, userId, userMessage, options = {}, _modelOverride = null) {
518
+ throwIfAborted(options.signal, 'Agent run aborted before startup.');
555
519
  const triggerType = options.triggerType || 'user';
556
520
  const { resolveAgentId } = require('../../agents/manager');
557
521
  const agentId = resolveAgentId(userId, options.agentId || options.agent_id || null);
@@ -563,7 +527,9 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
563
527
  const triggerSource = options.triggerSource || 'web';
564
528
  let provider = null;
565
529
  let model = null;
530
+ let modelSelectionId = null;
566
531
  let providerName = null;
532
+ const modelTurnFailedModelSelectionIds = new Set();
567
533
  let messages = [];
568
534
  let iteration = 0;
569
535
  let totalTokens = 0;
@@ -572,7 +538,9 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
572
538
  let failedStepCount = 0;
573
539
  let toolExecutions = [];
574
540
  let deliverableWorkflow = null;
575
- let runTitle;
541
+ let detachExternalAbort = null;
542
+ const runTitle = generateTitle(userMessage);
543
+ let runRecordCreated = false;
576
544
  const timelineService = app?.locals?.timelineService || null;
577
545
 
578
546
  const { releaseReservation } = enforceRateLimits(userId, {
@@ -589,6 +557,59 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
589
557
  // analysis when the mode is known. See the post-analysis policy rebuild below.
590
558
  let loopPolicy = buildLoopPolicy(aiSettings, triggerType, 'execute', options);
591
559
  let maxIterations = loopPolicy.maxIterations;
560
+ const initialRunMetadata = buildInitialRunMetadata(options);
561
+ const requestedModel = String(
562
+ _modelOverride
563
+ || (triggerType === 'subagent' ? aiSettings.default_subagent_model : aiSettings.default_chat_model)
564
+ || 'auto',
565
+ ).trim();
566
+ try {
567
+ db.prepare(`INSERT INTO agent_runs(
568
+ id, user_id, agent_id, title, status, trigger_type, trigger_source, model, metadata_json
569
+ ) VALUES(?, ?, ?, ?, 'running', ?, ?, ?, ?)`).run(
570
+ runId,
571
+ userId,
572
+ agentId,
573
+ runTitle,
574
+ triggerType,
575
+ triggerSource,
576
+ requestedModel,
577
+ Object.keys(initialRunMetadata).length ? JSON.stringify(initialRunMetadata) : null,
578
+ );
579
+ runRecordCreated = true;
580
+ } catch (error) {
581
+ if (/unique|primary key|constraint/i.test(String(error?.message || ''))) {
582
+ const conflict = new Error(`A run with id "${runId}" already exists.`);
583
+ conflict.code = 'RUN_ID_CONFLICT';
584
+ throw conflict;
585
+ }
586
+ throw error;
587
+ }
588
+ const startupAbortController = new AbortController();
589
+ engine.activeRuns.set(runId, {
590
+ userId,
591
+ agentId,
592
+ title: runTitle,
593
+ status: 'running',
594
+ aborted: false,
595
+ abortController: startupAbortController,
596
+ pauseAvailable: false,
597
+ toolPids: new Set(),
598
+ subagentDepth: Math.max(0, Number(options.subagentDepth) || 0),
599
+ });
600
+ if (options.signal) {
601
+ const abortFromExternal = () => {
602
+ engine.interruptRun(
603
+ runId,
604
+ String(options.signal.reason || 'Agent run interrupted by its caller.'),
605
+ );
606
+ };
607
+ if (options.signal.aborted) abortFromExternal();
608
+ else options.signal.addEventListener('abort', abortFromExternal, { once: true });
609
+ detachExternalAbort = () => {
610
+ options.signal.removeEventListener('abort', abortFromExternal);
611
+ };
612
+ }
592
613
  const providerStatusConfig = {
593
614
  agentId,
594
615
  onStatus: (status) => {
@@ -605,18 +626,61 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
605
626
  userMessage,
606
627
  triggerType === 'subagent',
607
628
  _modelOverride,
608
- providerStatusConfig
629
+ { ...providerStatusConfig, signal: startupAbortController.signal }
609
630
  );
610
631
  provider = selectedProvider.provider;
611
632
  model = selectedProvider.model;
633
+ modelSelectionId = selectedProvider.modelSelectionId;
612
634
  providerName = selectedProvider.providerName;
613
- const switchToFallbackModel = async (failedModel, error, phase) => {
614
- const fallbackModelId = await getFailureFallbackModelId(userId, agentId, failedModel, aiSettings.fallback_model_id, error);
615
- if (!fallbackModelId || fallbackModelId === failedModel) return false;
616
- console.log(`[Engine] ${phase} failed on ${failedModel}; attempting fallback to: ${fallbackModelId}`);
635
+ if (
636
+ startupAbortController.signal.aborted
637
+ || engine.getRunMeta(runId)?.status !== 'running'
638
+ ) {
639
+ const startupError = new Error(
640
+ String(startupAbortController.signal.reason || 'Run stopped during model selection.'),
641
+ );
642
+ startupError.name = 'AbortError';
643
+ startupError.code = 'ABORT_ERR';
644
+ throw startupError;
645
+ }
646
+ db.prepare('UPDATE agent_runs SET model = ?, updated_at = datetime(\'now\') WHERE id = ?')
647
+ .run(modelSelectionId, runId);
648
+ const recordFailedModel = (failedSelectionId, error, excludedModels) => {
649
+ excludedModels.add(failedSelectionId);
650
+ recordModelFailure(userId, agentId, failedSelectionId, error);
651
+ };
652
+ const switchToFallbackModel = async (
653
+ failedSelectionId,
654
+ error,
655
+ phase,
656
+ excludedModels,
657
+ ) => {
658
+ recordFailedModel(failedSelectionId, error, excludedModels);
659
+ const fallbackModelId = await getFailureFallbackModelId(
660
+ userId,
661
+ agentId,
662
+ failedSelectionId,
663
+ aiSettings.fallback_model_id,
664
+ error,
665
+ engine.getRunMeta(runId)?.abortController?.signal,
666
+ excludedModels,
667
+ );
668
+ if (!fallbackModelId || fallbackModelId === failedSelectionId) return false;
669
+ const failureSummary = summarizeForLog(error?.message || error, 180);
670
+ console.log(
671
+ `[Engine] ${phase} failed on ${failedSelectionId}: ${failureSummary}; attempting fallback to: ${fallbackModelId}`
672
+ );
673
+ engine.recordRunEvent(userId, runId, 'model_fallback', {
674
+ phase,
675
+ failedModel: failedSelectionId,
676
+ fallbackModel: fallbackModelId,
677
+ errorCode: error?.code || null,
678
+ errorStatus: error?.status || error?.statusCode || error?.response?.status || null,
679
+ error: failureSummary,
680
+ }, { agentId });
617
681
  engine.emit(userId, 'run:interim', {
618
682
  runId,
619
- message: `Model service failed on ${failedModel}; retrying with ${fallbackModelId}.`,
683
+ message: `Model service failed on ${failedSelectionId}; retrying with ${fallbackModelId}.`,
620
684
  phase: 'model_fallback'
621
685
  });
622
686
  const fallback = await getProviderForUser(
@@ -624,46 +688,50 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
624
688
  userMessage,
625
689
  triggerType === 'subagent',
626
690
  fallbackModelId,
627
- providerStatusConfig
691
+ {
692
+ ...providerStatusConfig,
693
+ signal: engine.getRunMeta(runId)?.abortController?.signal,
694
+ }
628
695
  );
629
696
  provider = fallback.provider;
630
697
  model = fallback.model;
698
+ modelSelectionId = fallback.modelSelectionId;
631
699
  providerName = fallback.providerName;
700
+ db.prepare('UPDATE agent_runs SET model = ?, updated_at = datetime(\'now\') WHERE id = ?')
701
+ .run(modelSelectionId, runId);
702
+ Object.assign(engine.getRunMeta(runId) || {}, {
703
+ model,
704
+ modelSelectionId,
705
+ providerName,
706
+ });
632
707
  return true;
633
708
  };
634
709
  const runWithModelFallback = async (phase, fn) => {
635
- try {
636
- return await fn();
637
- } catch (err) {
638
- const failedModel = model;
639
- const switched = await switchToFallbackModel(failedModel, err, phase);
640
- if (!switched) throw err;
641
- return await fn();
710
+ let recoveries = 0;
711
+ const failedModels = new Set();
712
+ while (true) {
713
+ try {
714
+ const result = await fn();
715
+ recordModelSuccess(userId, agentId, modelSelectionId);
716
+ return result;
717
+ } catch (err) {
718
+ if (recoveries >= loopPolicy.maxModelFailureRecoveries) {
719
+ recordFailedModel(modelSelectionId, err, failedModels);
720
+ throw err;
721
+ }
722
+ const failedSelectionId = modelSelectionId;
723
+ const switched = await switchToFallbackModel(
724
+ failedSelectionId,
725
+ err,
726
+ phase,
727
+ failedModels,
728
+ );
729
+ if (!switched) throw err;
730
+ recoveries += 1;
731
+ }
642
732
  }
643
733
  };
644
734
 
645
- runTitle = generateTitle(userMessage);
646
- const initialRunMetadata = buildInitialRunMetadata(options);
647
- db.prepare(`INSERT INTO agent_runs(
648
- id, user_id, agent_id, title, status, trigger_type, trigger_source, model, metadata_json
649
- ) VALUES(?, ?, ?, ?, 'running', ?, ?, ?, ?)
650
- ON CONFLICT(id) DO UPDATE SET
651
- status = 'running',
652
- model = excluded.model,
653
- updated_at = datetime('now'),
654
- completed_at = NULL,
655
- error = NULL,
656
- metadata_json = COALESCE(agent_runs.metadata_json, excluded.metadata_json)`).run(
657
- runId,
658
- userId,
659
- agentId,
660
- runTitle,
661
- triggerType,
662
- triggerSource,
663
- model,
664
- Object.keys(initialRunMetadata).length ? JSON.stringify(initialRunMetadata) : null,
665
- );
666
-
667
735
  const retryMessagingState = options.messagingRetryState || {};
668
736
  const carriedFinalMessage = String(retryMessagingState.lastFinalMessage || '').trim();
669
737
  const carriedExplicitMessageSent = retryMessagingState.explicitMessageSent === true;
@@ -685,6 +753,9 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
685
753
  userId,
686
754
  agentId,
687
755
  title: runTitle,
756
+ model,
757
+ modelSelectionId,
758
+ providerName,
688
759
  status: 'running',
689
760
  aborted: false,
690
761
  messagingSent: false,
@@ -709,7 +780,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
709
780
  voiceSessionId: options.voiceSessionId || null,
710
781
  steeringQueue: [],
711
782
  systemSteeringQueue: [],
712
- abortController: new AbortController(),
783
+ abortController: startupAbortController,
713
784
  pauseAvailable: false,
714
785
  toolPids: new Set(),
715
786
  subagentDepth: Math.max(0, Number(options.subagentDepth) || 0),
@@ -735,10 +806,21 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
735
806
  goalContract: carriedGoalContract,
736
807
  });
737
808
  engine.startMessagingProgressSupervisor(runId);
738
- engine.emit(userId, 'run:start', { runId, agentId, title: runTitle, model, triggerType, triggerSource });
809
+ engine.emit(userId, 'run:start', {
810
+ runId,
811
+ agentId,
812
+ title: runTitle,
813
+ model,
814
+ modelSelectionId,
815
+ provider: providerName,
816
+ triggerType,
817
+ triggerSource,
818
+ });
739
819
  engine.recordRunEvent(userId, runId, 'run_started', {
740
820
  title: runTitle,
741
821
  model,
822
+ modelSelectionId,
823
+ provider: providerName,
742
824
  triggerType,
743
825
  triggerSource,
744
826
  }, { agentId });
@@ -752,7 +834,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
752
834
  triggerSource,
753
835
  });
754
836
  console.info(
755
- `[Run ${shortenRunId(runId)}] started trigger=${triggerSource} type=${triggerType} model=${model} title=${summarizeForLog(runTitle, 120)}`
837
+ `[Run ${shortenRunId(runId)}] started trigger=${triggerSource} type=${triggerType} model=${modelSelectionId} title=${summarizeForLog(runTitle, 120)}`
756
838
  );
757
839
 
758
840
  const systemPrompt = await engine.buildSystemPrompt(userId, {
@@ -883,7 +965,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
883
965
  if (triggerSource === 'messaging') {
884
966
  const runMetaForCompose = engine.getRunMeta(runId);
885
967
  if (runMetaForCompose) {
886
- runMetaForCompose.composeProgressUpdate = async ({ stalled = false } = {}) => {
968
+ runMetaForCompose.composeProgressUpdate = async ({ stalled = false, signal = null } = {}) => {
887
969
  try {
888
970
  const rm = engine.getRunMeta(runId);
889
971
  const ledger = rm?.progressLedger || {};
@@ -900,7 +982,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
900
982
  const priorUpdate = String(rm?.lastInterimMessage || '').trim();
901
983
  const contextBlock = [
902
984
  buildProgressUpdatePrompt(),
903
- stalled ? 'This step has been running a while with no new progress; reassure the user you are still on it.' : '',
985
+ stalled ? 'No verified progress has occurred for the stall threshold. State that fact plainly if it matters; do not reassure, promise continued work, or imply activity beyond the evidence.' : '',
904
986
  '',
905
987
  `Original request: ${summarizeForLog(userMessage, 320)}`,
906
988
  currentTool ? `Doing now: using ${currentTool}` : '',
@@ -910,17 +992,24 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
910
992
  // Reuse the run's real system prompt so the update follows the same voice and
911
993
  // formatting guidelines as every other message (single source of truth).
912
994
  const sysContent = [systemPrompt?.stable, systemPrompt?.dynamic].filter(Boolean).join('\n\n')
913
- || 'You are a helpful assistant.';
914
- const resp = await withModelCallTimeout(
915
- provider.chat(
995
+ || 'You are the user\'s favorite contact: warm, direct, and competent.';
996
+ const resp = await runAbortableModelCall(
997
+ (signal) => provider.chat(
916
998
  [
917
999
  { role: 'system', content: sysContent },
918
1000
  { role: 'user', content: contextBlock },
919
1001
  ],
920
1002
  [],
921
- { model, reasoningEffort: engine.getReasoningEffort(providerName, options) },
1003
+ {
1004
+ model,
1005
+ reasoningEffort: engine.getReasoningEffort(providerName, options),
1006
+ signal,
1007
+ },
922
1008
  ),
923
- options,
1009
+ {
1010
+ ...options,
1011
+ signals: [rm?.abortController?.signal, signal],
1012
+ },
924
1013
  'Progress update compose',
925
1014
  );
926
1015
  return sanitizeModelOutput(resp.content || '', { model });
@@ -1031,6 +1120,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1031
1120
  null,
1032
1121
  {
1033
1122
  ...providerStatusConfig,
1123
+ signal: engine.getRunMeta(runId)?.abortController?.signal,
1034
1124
  selectionHint: {
1035
1125
  purpose: requestedPurpose,
1036
1126
  complexity: analysis?.complexity,
@@ -1040,15 +1130,21 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1040
1130
  },
1041
1131
  }
1042
1132
  );
1043
- if (selectedAfterAnalysis.model !== model) {
1133
+ if (selectedAfterAnalysis.modelSelectionId !== modelSelectionId) {
1044
1134
  provider = selectedAfterAnalysis.provider;
1045
1135
  model = selectedAfterAnalysis.model;
1136
+ modelSelectionId = selectedAfterAnalysis.modelSelectionId;
1046
1137
  providerName = selectedAfterAnalysis.providerName;
1047
1138
  db.prepare('UPDATE agent_runs SET model = ?, updated_at = datetime(\'now\') WHERE id = ?')
1048
- .run(model, runId);
1139
+ .run(modelSelectionId, runId);
1140
+ Object.assign(engine.getRunMeta(runId) || {}, {
1141
+ model,
1142
+ modelSelectionId,
1143
+ providerName,
1144
+ });
1049
1145
  engine.emit(userId, 'run:interim', {
1050
1146
  runId,
1051
- message: `Switched to ${model} for this run after task analysis.`,
1147
+ message: `Switched to ${modelSelectionId} for this run after task analysis.`,
1052
1148
  phase: 'model_selection'
1053
1149
  });
1054
1150
  }
@@ -1239,7 +1335,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1239
1335
  reason,
1240
1336
  stoppedBy: hookResult.stopped_by || hookResult.stoppedBy || null,
1241
1337
  }, { agentId });
1242
- lastContent = reason;
1338
+ engine.stopRun(runId, reason);
1243
1339
  break;
1244
1340
  }
1245
1341
  const systemSteering = String(hookResult?.systemSteering || hookResult?.system_steering || '').trim();
@@ -1298,6 +1394,47 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1298
1394
  continue;
1299
1395
  }
1300
1396
  alreadyRead = summarizeReadTargets(toolExecutions);
1397
+ const researchAdequacyAtCap = assessResearchAdequacy({
1398
+ analysis,
1399
+ goalContext: runGoalCtx,
1400
+ toolExecutions,
1401
+ });
1402
+ // Incomplete multi-target research is not "stuck" yet if primary sources
1403
+ // remain uncovered. Give one guided research continuation instead of
1404
+ // force-finishing with a guessed comparison.
1405
+ if (
1406
+ researchAdequacyAtCap.adequate === false
1407
+ && researchAdequacyAtCap.intensity !== 'none'
1408
+ && iterMeta
1409
+ && iterMeta.researchAdequacyDeferralUsed !== true
1410
+ && (
1411
+ researchAdequacyAtCap.uncoveredTargets.length > 0
1412
+ || researchAdequacyAtCap.primarySourceCount < researchAdequacyAtCap.requiredPrimarySources
1413
+ )
1414
+ ) {
1415
+ iterMeta.researchAdequacyDeferralUsed = true;
1416
+ iterMeta.consecutiveReadOnlyIterations = Math.max(0, churnNudgeThreshold - 1);
1417
+ messages.push({
1418
+ role: 'system',
1419
+ content: [
1420
+ 'Research self-check: evidence is still incomplete, so this run must not force-finish yet.',
1421
+ researchAdequacyAtCap.reason ? `Gap: ${researchAdequacyAtCap.reason}` : '',
1422
+ researchAdequacyAtCap.nextActions?.length
1423
+ ? `Next safe steps:\n- ${researchAdequacyAtCap.nextActions.join('\n- ')}`
1424
+ : '',
1425
+ 'Open or fetch primary sources for uncovered targets now. Do not invent the missing comparison from memory or search snippets alone.',
1426
+ ].filter(Boolean).join('\n'),
1427
+ });
1428
+ engine.recordRunEvent(userId, runId, 'read_only_wrapup_deferred_for_research', {
1429
+ iteration,
1430
+ readOnlyCount,
1431
+ intensity: researchAdequacyAtCap.intensity,
1432
+ uncoveredTargets: researchAdequacyAtCap.uncoveredTargets,
1433
+ primarySourceCount: researchAdequacyAtCap.primarySourceCount,
1434
+ requiredPrimarySources: researchAdequacyAtCap.requiredPrimarySources,
1435
+ }, { agentId });
1436
+ continue;
1437
+ }
1301
1438
  triggerForceWrapup = true;
1302
1439
  } else if (readOnlyCount >= churnNudgeThreshold) {
1303
1440
  alreadyRead = summarizeReadTargets(toolExecutions);
@@ -1362,8 +1499,8 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1362
1499
  });
1363
1500
  let wrapTokens = 0;
1364
1501
  try {
1365
- const wrapResponse = await withModelCallTimeout(
1366
- provider.chat(
1502
+ const wrapResponse = await runAbortableModelCall(
1503
+ (signal) => provider.chat(
1367
1504
  sanitizeConversationMessages([
1368
1505
  ...messages,
1369
1506
  {
@@ -1372,13 +1509,22 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1372
1509
  readOnlyCount,
1373
1510
  alreadyRead,
1374
1511
  platform: options?.source || null,
1512
+ researchAdequacy: assessResearchAdequacy({
1513
+ analysis,
1514
+ goalContext: runGoalCtx,
1515
+ toolExecutions,
1516
+ }),
1375
1517
  }),
1376
1518
  },
1377
1519
  ]),
1378
1520
  [],
1379
- { model, reasoningEffort: engine.getReasoningEffort(providerName, options) },
1521
+ {
1522
+ model,
1523
+ reasoningEffort: engine.getReasoningEffort(providerName, options),
1524
+ signal,
1525
+ },
1380
1526
  ),
1381
- options,
1527
+ { ...options, signal: engine.getRunMeta(runId)?.abortController?.signal },
1382
1528
  'No-progress wrap-up',
1383
1529
  );
1384
1530
  wrapTokens = wrapResponse.usage?.totalTokens || 0;
@@ -1431,9 +1577,9 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1431
1577
  let metrics = engine.estimatePromptMetrics(messages, tools);
1432
1578
  const contextWindow = provider.getContextWindow(model);
1433
1579
  if (metrics.totalEstimatedTokens > contextWindow * loopPolicy.compactionThreshold) {
1434
- messages = await withModelCallTimeout(
1435
- compact(messages, provider, model, contextWindow),
1436
- options,
1580
+ messages = await runAbortableModelCall(
1581
+ (signal) => compact(messages, provider, model, contextWindow, { signal }),
1582
+ { ...options, signal: engine.getRunMeta(runId)?.abortController?.signal },
1437
1583
  `Context compaction before iteration ${iteration}`,
1438
1584
  );
1439
1585
  messages = sanitizeConversationMessages(messages);
@@ -1453,48 +1599,59 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1453
1599
  let responseModel = model;
1454
1600
  let streamContent = '';
1455
1601
 
1456
- const tryModelCall = async (retryForFallback = true) => {
1457
- try {
1458
- const modelCall = await engine.requestModelResponse({
1459
- provider,
1460
- providerName,
1461
- model,
1462
- messages,
1463
- tools,
1464
- options: {
1465
- ...options,
1466
- userId,
1467
- agentId,
1602
+ const tryModelCall = async () => {
1603
+ let requestMessages = messages;
1604
+ let requestPhase = 'model_turn';
1605
+ while (true) {
1606
+ try {
1607
+ const modelCall = await engine.requestModelResponse({
1608
+ provider,
1609
+ providerName,
1610
+ model,
1611
+ messages: requestMessages,
1612
+ tools,
1613
+ options: {
1614
+ ...options,
1615
+ userId,
1616
+ agentId,
1617
+ runId,
1618
+ phase: requestPhase,
1619
+ signal: engine.getRunMeta(runId)?.abortController?.signal,
1620
+ },
1468
1621
  runId,
1469
- phase: 'model_turn',
1470
- signal: engine.getRunMeta(runId)?.abortController?.signal,
1471
- },
1472
- runId,
1473
- iteration,
1474
- });
1475
- response = modelCall.response;
1476
- responseModel = modelCall.responseModel;
1477
- streamContent = modelCall.streamContent;
1478
- } catch (err) {
1479
- console.error(`[Engine] Model call failed (${model}):`, err.message);
1480
- const fallbackModelId = retryForFallback
1481
- ? await getFailureFallbackModelId(userId, agentId, model, aiSettings.fallback_model_id, err)
1482
- : null;
1483
- if (fallbackModelId) {
1622
+ iteration,
1623
+ });
1624
+ response = modelCall.response;
1625
+ responseModel = modelCall.responseModel;
1626
+ streamContent = modelCall.streamContent;
1627
+ recordModelSuccess(userId, agentId, modelSelectionId);
1628
+ return;
1629
+ } catch (err) {
1630
+ console.error(`[Engine] Model call failed (${model}):`, err.message);
1631
+ const runSignal = engine.getRunMeta(runId)?.abortController?.signal;
1632
+ if (isAbortError(err) || runSignal?.aborted) throw err;
1633
+ if (modelFailureRecoveries >= loopPolicy.maxModelFailureRecoveries) {
1634
+ recordFailedModel(
1635
+ modelSelectionId,
1636
+ err,
1637
+ modelTurnFailedModelSelectionIds,
1638
+ );
1639
+ throw err;
1640
+ }
1641
+
1484
1642
  const failedModel = model;
1485
- console.log(`[Engine] Attempting fallback to: ${fallbackModelId}`);
1486
- const fallback = await getProviderForUser(
1487
- userId,
1488
- userMessage,
1489
- triggerType === 'subagent',
1490
- fallbackModelId,
1491
- providerStatusConfig
1643
+ const switched = await switchToFallbackModel(
1644
+ modelSelectionId,
1645
+ err,
1646
+ 'model turn',
1647
+ modelTurnFailedModelSelectionIds,
1492
1648
  );
1493
- provider = fallback.provider;
1494
- model = fallback.model;
1495
- providerName = fallback.providerName;
1649
+ if (!switched) throw err;
1496
1650
 
1497
- const retryMessages = sanitizeConversationMessages([
1651
+ modelFailureRecoveries += 1;
1652
+ failedStepCount += 1;
1653
+ requestPhase = 'model_turn_fallback';
1654
+ requestMessages = sanitizeConversationMessages([
1498
1655
  ...messages,
1499
1656
  {
1500
1657
  role: 'system',
@@ -1505,22 +1662,6 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1505
1662
  })
1506
1663
  }
1507
1664
  ]);
1508
-
1509
- const fallbackCall = await engine.requestModelResponse({
1510
- provider,
1511
- providerName,
1512
- model,
1513
- messages: retryMessages,
1514
- tools,
1515
- options: { ...options, userId },
1516
- runId,
1517
- iteration,
1518
- });
1519
- response = fallbackCall.response;
1520
- responseModel = fallbackCall.responseModel;
1521
- streamContent = fallbackCall.streamContent;
1522
- } else {
1523
- throw err;
1524
1665
  }
1525
1666
  }
1526
1667
  };
@@ -1543,30 +1684,6 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1543
1684
  continue;
1544
1685
  }
1545
1686
  if (lifecycleControl?.action === 'stop' || lifecycleControl?.action === 'interrupt') break;
1546
- const modelError = String(err?.message || 'Model call failed');
1547
-
1548
- if (modelFailureRecoveries < loopPolicy.maxModelFailureRecoveries) {
1549
- const failedModel = model;
1550
- const switched = await switchToFallbackModel(failedModel, err, 'model turn');
1551
- if (!switched) throw err;
1552
- modelFailureRecoveries += 1;
1553
- failedStepCount += 1;
1554
- messages.push({
1555
- role: 'system',
1556
- content: buildModelFailureLoopPrompt({
1557
- failedModel,
1558
- nextModel: model,
1559
- errorMessage: modelError
1560
- })
1561
- });
1562
- engine.emit(userId, 'run:interim', {
1563
- runId,
1564
- message: 'Model call failed; adapting and retrying autonomously.',
1565
- phase: 'recovering'
1566
- });
1567
- continue;
1568
- }
1569
-
1570
1687
  throw err;
1571
1688
  }
1572
1689
 
@@ -1601,10 +1718,6 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1601
1718
  toolCallCount: response.toolCalls?.length || 0,
1602
1719
  contentPreview: String(lastContent || streamContent || '').slice(0, 240),
1603
1720
  }, { agentId });
1604
- engine.updateRunProgress(runId, {}, {
1605
- verified: true,
1606
- });
1607
-
1608
1721
  const assistantMessage = { role: 'assistant', content: lastContent };
1609
1722
  if (response.toolCalls?.length) assistantMessage.tool_calls = response.toolCalls;
1610
1723
  if (response.providerContentBlocks?.length) assistantMessage.providerContentBlocks = response.providerContentBlocks;
@@ -1714,13 +1827,23 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1714
1827
  iteration,
1715
1828
  }, { agentId });
1716
1829
  if (loopDecision.decision.status === 'continue') {
1830
+ const researchGuidance = loopDecision.researchAdequacy?.adequate === false
1831
+ ? [
1832
+ `Research still incomplete: ${loopDecision.researchAdequacy.reason || 'gather primary evidence for remaining targets.'}`,
1833
+ loopDecision.researchAdequacy.nextActions?.length
1834
+ ? `Next safe steps: ${loopDecision.researchAdequacy.nextActions.join(' ')}`
1835
+ : '',
1836
+ ].filter(Boolean).join(' ')
1837
+ : '';
1717
1838
  messages.push({
1718
1839
  role: 'system',
1719
1840
  content: [
1720
1841
  'The run self-check determined the latest assistant text is not terminal.',
1721
1842
  'Continue with the next safe tool/model step.',
1722
1843
  'If the text was only a progress note, do not repeat it; either make progress or provide a real final/blocker reply.',
1723
- ].join(' '),
1844
+ 'Do not invent missing targets, outcomes, or tool results. Gather evidence or return a truthful partial/blocker answer.',
1845
+ researchGuidance,
1846
+ ].filter(Boolean).join(' '),
1724
1847
  });
1725
1848
  lastContent = '';
1726
1849
  continue;
@@ -1731,7 +1854,10 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1731
1854
 
1732
1855
  const canRunParallelBatch = (
1733
1856
  response.toolCalls.length > 1
1734
- && response.toolCalls.every((toolCall) => engine.isReadOnlyToolCall(toolCall))
1857
+ && response.toolCalls.every((toolCall) => engine.isReadOnlyToolCall(
1858
+ toolCall,
1859
+ tools.find((tool) => tool?.name === toolCall?.function?.name) || null,
1860
+ ))
1735
1861
  );
1736
1862
  if (canRunParallelBatch) {
1737
1863
  const parallelToolNames = response.toolCalls
@@ -1768,6 +1894,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1768
1894
  item.toolArgs,
1769
1895
  item.result,
1770
1896
  item.error || '',
1897
+ tools.find((tool) => tool?.name === item.toolName) || null,
1771
1898
  );
1772
1899
  execution.input = item.toolArgs;
1773
1900
  execution.artifacts = await extractArtifactsFromResult(item.toolName, item.result);
@@ -1807,7 +1934,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
1807
1934
  currentTool: null,
1808
1935
  currentStepStartedAt: null,
1809
1936
  }, {
1810
- verified: true,
1937
+ verified: batchGatheredNewEvidence,
1811
1938
  });
1812
1939
  if (analysis.mode === 'execute' || analysis.mode === 'plan_execute') {
1813
1940
  const iterMeta = engine.getRunMeta(runId);
@@ -2054,11 +2181,20 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2054
2181
  });
2055
2182
  if (lifecycleAfterTool?.action === 'stop' || lifecycleAfterTool?.action === 'interrupt') break;
2056
2183
 
2057
- const execution = classifyToolExecution(toolName, toolArgs, toolResult, toolErrorMessage);
2184
+ const execution = classifyToolExecution(
2185
+ toolName,
2186
+ toolArgs,
2187
+ toolResult,
2188
+ toolErrorMessage,
2189
+ tools.find((tool) => tool?.name === toolName) || null,
2190
+ );
2058
2191
  execution.input = toolArgs;
2059
2192
  const repetitionObservation = repetitionGuard?.observe(toolName, toolArgs, toolResult);
2060
- if ((execution.stateChanged && isProgressToolCall(toolName, toolArgs))
2061
- || gatheredNewEvidence(execution, repetitionObservation)) {
2193
+ const toolMadeConcreteProgress = (
2194
+ (execution.stateChanged && isProgressToolCall(toolName, toolArgs))
2195
+ || gatheredNewEvidence(execution, repetitionObservation)
2196
+ );
2197
+ if (toolMadeConcreteProgress) {
2062
2198
  iterationConcreteProgress = true;
2063
2199
  }
2064
2200
  execution.artifacts = await extractArtifactsFromResult(toolName, toolResult);
@@ -2206,7 +2342,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2206
2342
  currentTool: null,
2207
2343
  currentStepStartedAt: null,
2208
2344
  }, {
2209
- verified: true,
2345
+ verified: toolMadeConcreteProgress,
2210
2346
  stepId,
2211
2347
  });
2212
2348
 
@@ -2256,20 +2392,18 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2256
2392
 
2257
2393
  if (engine.isRunStopped(runId)) {
2258
2394
  const stoppedRunMeta = engine.getRunMeta(runId);
2259
- const terminalStatus = stoppedRunMeta?.status === 'interrupted' ? 'interrupted' : 'stopped';
2395
+ const persistedTerminal = db.prepare(
2396
+ 'SELECT status, error FROM agent_runs WHERE id = ?',
2397
+ ).get(runId);
2398
+ const terminalStatus = persistedTerminal?.status === 'interrupted'
2399
+ || stoppedRunMeta?.status === 'interrupted'
2400
+ ? 'interrupted'
2401
+ : 'stopped';
2260
2402
  const stopReason = stoppedRunMeta?.stopReason || null;
2261
- db.prepare(
2262
- `UPDATE agent_runs
2263
- SET status = ?,
2264
- error = COALESCE(?, error),
2265
- updated_at = datetime('now'),
2266
- completed_at = datetime('now')
2267
- WHERE id = ?`
2268
- ).run(terminalStatus, stopReason, runId);
2269
2403
  console.warn(
2270
2404
  `[Run ${shortenRunId(runId)}] ${terminalStatus} trigger=${triggerSource} steps=${stepIndex} tokens=${totalTokens}`
2271
2405
  );
2272
- engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
2406
+ await engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
2273
2407
  engine.stopMessagingProgressSupervisor(runId);
2274
2408
  engine.activeRuns.delete(runId);
2275
2409
  engine.emit(userId, terminalStatus === 'interrupted' ? 'run:interrupted' : 'run:stopped', {
@@ -2320,16 +2454,20 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2320
2454
  if (budgetExhaustedWithoutCompletion) {
2321
2455
  console.warn(`[Run ${shortenRunId(runId)}] max_iteration_wrapup model=${model} iteration=${iteration}/${maxIterations}`);
2322
2456
  try {
2323
- const wrapResponse = await withModelCallTimeout(
2324
- provider.chat(
2457
+ const wrapResponse = await runAbortableModelCall(
2458
+ (signal) => provider.chat(
2325
2459
  sanitizeConversationMessages([
2326
2460
  ...messages,
2327
2461
  { role: 'system', content: buildMaxIterationWrapupPrompt(options?.source || null) },
2328
2462
  ]),
2329
2463
  [],
2330
- { model, reasoningEffort: engine.getReasoningEffort(providerName, options) },
2464
+ {
2465
+ model,
2466
+ reasoningEffort: engine.getReasoningEffort(providerName, options),
2467
+ signal,
2468
+ },
2331
2469
  ),
2332
- options,
2470
+ { ...options, signal: engine.getRunMeta(runId)?.abortController?.signal },
2333
2471
  'Max-iteration wrap-up',
2334
2472
  );
2335
2473
  totalTokens += wrapResponse.usage?.totalTokens || 0;
@@ -2362,8 +2500,8 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2362
2500
  console.warn(`[Run ${shortenRunId(runId)}] blank_reply_recovery model=${model}`);
2363
2501
  let recoveredTokens = 0;
2364
2502
  try {
2365
- const recoveryResponse = await withModelCallTimeout(
2366
- provider.chat(
2503
+ const recoveryResponse = await runAbortableModelCall(
2504
+ (signal) => provider.chat(
2367
2505
  sanitizeConversationMessages([
2368
2506
  ...messages,
2369
2507
  {
@@ -2374,10 +2512,11 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2374
2512
  [],
2375
2513
  {
2376
2514
  model,
2377
- reasoningEffort: engine.getReasoningEffort(providerName, options)
2515
+ reasoningEffort: engine.getReasoningEffort(providerName, options),
2516
+ signal,
2378
2517
  }
2379
2518
  ),
2380
- options,
2519
+ { ...options, signal: engine.getRunMeta(runId)?.abortController?.signal },
2381
2520
  'Blank messaging reply recovery',
2382
2521
  );
2383
2522
  recoveredTokens = recoveryResponse.usage?.totalTokens || 0;
@@ -2390,7 +2529,9 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2390
2529
  // own wrap-up (it summarizes what it tried / where it got blocked from the run
2391
2530
  // evidence) instead of second-guessing it into a generic blob. Only fall back to
2392
2531
  // a deterministic message when the model returned nothing usable.
2393
- const recoveredVisible = Boolean(normalizeOutgoingMessage(lastContent, options?.source || null));
2532
+ const recoveredVisible = Boolean(
2533
+ normalizeOutgoingMessage(lastContent, options?.source || null),
2534
+ );
2394
2535
  if (!recoveredVisible) {
2395
2536
  lastContent = buildDeterministicMessagingFallback({ failedStepCount, stepIndex, toolExecutions });
2396
2537
  }
@@ -2418,7 +2559,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2418
2559
  || lifecycleBeforeFinalize?.action === 'interrupt'
2419
2560
  ) {
2420
2561
  const terminal = db.prepare('SELECT status FROM agent_runs WHERE id = ?').get(runId)?.status || 'stopped';
2421
- engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
2562
+ await engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
2422
2563
  engine.stopMessagingProgressSupervisor(runId);
2423
2564
  engine.activeRuns.delete(runId);
2424
2565
  return { runId, content: '', totalTokens, iterations: iteration, status: terminal };
@@ -2536,6 +2677,9 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2536
2677
  });
2537
2678
  }
2538
2679
 
2680
+ // Final reply terminality is decided by the AI completion judge / task_complete path.
2681
+ // Do not phrase-match natural-language drafts here.
2682
+
2539
2683
  if (deliverableWorkflow && deliverablePlan) {
2540
2684
  engine.recordRunEvent(userId, runId, 'deliverable_validation_started', {
2541
2685
  type: deliverableWorkflow.selection.type,
@@ -2580,8 +2724,23 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2580
2724
  db.prepare('UPDATE conversations SET total_tokens = total_tokens + ?, updated_at = datetime(\'now\') WHERE id = ?')
2581
2725
  .run(totalTokens, conversationId);
2582
2726
  if (options.skipConversationMaintenance !== true) {
2583
- refreshConversationSummary(conversationId, provider, model, historyWindow).catch((err) => {
2584
- console.error('[AI] Conversation summary refresh failed:', err.message);
2727
+ engine.trackBackgroundTask(
2728
+ (signal) => refreshConversationSummary(
2729
+ conversationId,
2730
+ provider,
2731
+ model,
2732
+ historyWindow,
2733
+ false,
2734
+ { signal },
2735
+ ),
2736
+ {
2737
+ key: `conversation-summary:${conversationId}`,
2738
+ signal: runMeta?.abortController?.signal || null,
2739
+ },
2740
+ ).catch((err) => {
2741
+ if (!isAbortError(err, runMeta?.abortController?.signal) && !engine.shuttingDown) {
2742
+ console.error('[AI] Conversation summary refresh failed:', err.message);
2743
+ }
2585
2744
  });
2586
2745
  }
2587
2746
  }
@@ -2603,6 +2762,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2603
2762
  // Fallback: if this was a messaging-triggered run and no final delivery
2604
2763
  // was already sent in this run, auto-send the final assistant text.
2605
2764
  // Interim progress updates do not suppress this final delivery.
2765
+ await engine.stopMessagingProgressSupervisor(runId);
2606
2766
  if (triggerSource === 'messaging' && options.source && options.chatId) {
2607
2767
  if (engine.shouldSendMessagingFinalFallback(runMeta, lastContent || '', options.source) && !lastFinalDeliveryMessage) {
2608
2768
  await engine.deliverMessagingFinalFallback({
@@ -2622,7 +2782,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2622
2782
  });
2623
2783
  if (!completionWon) {
2624
2784
  const terminal = db.prepare('SELECT status FROM agent_runs WHERE id = ?').get(runId)?.status || 'stopped';
2625
- engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
2785
+ await engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
2626
2786
  engine.stopMessagingProgressSupervisor(runId);
2627
2787
  engine.activeRuns.delete(runId);
2628
2788
  return { runId, content: '', totalTokens, iterations: iteration, status: terminal };
@@ -2639,7 +2799,12 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2639
2799
  analysis,
2640
2800
  verification,
2641
2801
  historyWindow,
2642
- options: { ...options, userId, agentId },
2802
+ options: {
2803
+ ...options,
2804
+ userId,
2805
+ agentId,
2806
+ signal: engine.getRunMeta(runId)?.abortController?.signal || null,
2807
+ },
2643
2808
  }).catch((err) => {
2644
2809
  console.error('[AI] Conversation working state refresh failed:', err.message);
2645
2810
  });
@@ -2648,7 +2813,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2648
2813
  console.info(
2649
2814
  `[Run ${shortenRunId(runId)}] completed trigger=${triggerSource} steps=${stepIndex} tokens=${totalTokens} durationMs=${runMeta?.startedAt ? Date.now() - runMeta.startedAt : 0} finalResponse=${finalResponseText ? 'yes' : 'no'} sentMessages=${runMeta?.sentMessages?.length || 0}`
2650
2815
  );
2651
- engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
2816
+ await engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
2652
2817
  engine.stopMessagingProgressSupervisor(runId);
2653
2818
  engine.activeRuns.delete(runId);
2654
2819
  engine.emit(userId, 'run:complete', {
@@ -2681,12 +2846,16 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2681
2846
  // Fire-and-forget: plugins can use this for self-improvement, memory
2682
2847
  // consolidation, analytics, or other post-run housekeeping.
2683
2848
  if (globalHooks.has('on_loop_end')) {
2684
- globalHooks.run('on_loop_end', {
2685
- userId, runId, agentId, status: 'completed',
2686
- iterations: iteration, totalTokens,
2687
- taskAnalysis: analysis,
2688
- finalContent: finalResponseText,
2689
- }).catch(() => {});
2849
+ engine.trackBackgroundTask(
2850
+ (signal) => globalHooks.run('on_loop_end', {
2851
+ userId, runId, agentId, status: 'completed',
2852
+ iterations: iteration, totalTokens,
2853
+ taskAnalysis: analysis,
2854
+ finalContent: finalResponseText,
2855
+ signal,
2856
+ }),
2857
+ { signal: runMeta?.abortController?.signal || null },
2858
+ ).catch(() => {});
2690
2859
  }
2691
2860
  if (engine.learningManager) {
2692
2861
  try {
@@ -2712,25 +2881,37 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2712
2881
 
2713
2882
  return { runId, content: lastContent, totalTokens, iterations: iteration, status: 'completed' };
2714
2883
  } catch (err) {
2884
+ if (!runRecordCreated) throw err;
2715
2885
  if (engine.isRunStopped(runId)) {
2716
- db.prepare('UPDATE agent_runs SET status = ?, updated_at = datetime(\'now\'), completed_at = datetime(\'now\') WHERE id = ?')
2717
- .run('stopped', runId);
2886
+ const stoppedRunMeta = engine.getRunMeta(runId);
2887
+ const persistedTerminal = db.prepare(
2888
+ 'SELECT status, error FROM agent_runs WHERE id = ?',
2889
+ ).get(runId);
2890
+ const terminalStatus = persistedTerminal?.status === 'interrupted'
2891
+ || stoppedRunMeta?.status === 'interrupted'
2892
+ ? 'interrupted'
2893
+ : 'stopped';
2718
2894
  console.warn(
2719
- `[Run ${shortenRunId(runId)}] stopped trigger=${triggerSource} steps=${stepIndex} tokens=${totalTokens}`
2895
+ `[Run ${shortenRunId(runId)}] ${terminalStatus} trigger=${triggerSource} steps=${stepIndex} tokens=${totalTokens}`
2720
2896
  );
2721
- engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
2897
+ await engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
2722
2898
  engine.stopMessagingProgressSupervisor(runId);
2723
2899
  engine.activeRuns.delete(runId);
2724
- engine.emit(userId, 'run:stopped', { runId, triggerSource });
2725
- engine.recordRunEvent(userId, runId, 'run_stopped', {
2900
+ engine.emit(userId, terminalStatus === 'interrupted' ? 'run:interrupted' : 'run:stopped', {
2901
+ runId,
2902
+ triggerSource,
2903
+ reason: stoppedRunMeta?.stopReason || persistedTerminal?.error || null,
2904
+ });
2905
+ engine.recordRunEvent(userId, terminalStatus === 'interrupted' ? 'run_interrupted' : 'run_stopped', {
2726
2906
  triggerSource,
2727
2907
  totalTokens,
2728
2908
  iterations: iteration,
2729
2909
  }, { agentId });
2730
- return { runId, content: '', totalTokens, iterations: iteration, status: 'stopped' };
2910
+ return { runId, content: '', totalTokens, iterations: iteration, status: terminalStatus };
2731
2911
  }
2732
2912
 
2733
2913
  const runMeta = engine.activeRuns.get(runId);
2914
+ await engine.stopMessagingProgressSupervisor(runId);
2734
2915
 
2735
2916
  const deliverableFailureResponse = err?.deliverableResult?.summary
2736
2917
  || err?.deliverableValidation?.summary
@@ -2754,16 +2935,19 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2754
2935
  content: `The run encountered a runtime error and cannot continue reliably. Use the actual run scenario below to explain the blocker naturally.\n\nScenario:\n${failureScenario || 'No additional scenario details were captured.'}\n\nDo not call tools. Write exactly one short user message. Do not ask the user to resend or restate the same task. Only ask the user for something if a specific external input, permission, or configuration change is actually required. Do not promise future work unless it will happen automatically before this reply is sent.\n\n${buildPlatformFormattingGuide(options?.source || null)}`
2755
2936
  }
2756
2937
  ]);
2757
- const modelReply = await withModelCallTimeout(
2758
- provider.chat(failedMessage, [], {
2938
+ const modelReply = await runAbortableModelCall(
2939
+ (signal) => provider.chat(failedMessage, [], {
2759
2940
  model,
2760
- reasoningEffort: engine.getReasoningEffort(providerName, options)
2941
+ reasoningEffort: engine.getReasoningEffort(providerName, options),
2942
+ signal,
2761
2943
  }),
2762
- options,
2944
+ { ...options, signal: runMeta?.abortController?.signal },
2763
2945
  'Messaging failure reply',
2764
2946
  );
2765
2947
  const drafted = sanitizeModelOutput(modelReply.content || '', { model });
2766
- if (normalizeOutgoingMessage(drafted, options?.source || null)) {
2948
+ if (
2949
+ normalizeOutgoingMessage(drafted, options?.source || null)
2950
+ ) {
2767
2951
  messagingFailureContent = drafted.trim();
2768
2952
  }
2769
2953
  } catch {
@@ -2785,7 +2969,11 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2785
2969
  options.source,
2786
2970
  options.chatId,
2787
2971
  messagingFailureContent,
2788
- { runId, agentId },
2972
+ {
2973
+ runId,
2974
+ agentId,
2975
+ signal: runMeta?.abortController?.signal || null,
2976
+ },
2789
2977
  );
2790
2978
  requireSuccessfulMessagingDelivery(deliveryResult, 'Messaging failure delivery');
2791
2979
  sendSucceeded = true;
@@ -2810,7 +2998,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2810
2998
  totalTokens,
2811
2999
  });
2812
3000
  if (!failureWon) {
2813
- engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
3001
+ await engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
2814
3002
  engine.stopMessagingProgressSupervisor(runId);
2815
3003
  engine.activeRuns.delete(runId);
2816
3004
  const terminal = db.prepare('SELECT status FROM agent_runs WHERE id = ?').get(runId)?.status || 'stopped';
@@ -2820,7 +3008,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2820
3008
  `[Run ${shortenRunId(runId)}] failed trigger=${triggerSource} steps=${stepIndex} tokens=${totalTokens} error=${summarizeForLog(err.message, 180)}`
2821
3009
  );
2822
3010
 
2823
- engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
3011
+ await engine.cleanupSubagentsForRun(runId, { cancelRunning: true });
2824
3012
  engine.stopMessagingProgressSupervisor(runId);
2825
3013
  engine.activeRuns.delete(runId);
2826
3014
  engine.emit(userId, 'run:error', { runId, error: err.message });
@@ -2830,17 +3018,6 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2830
3018
  iterations: iteration,
2831
3019
  deliverableType: deliverableWorkflow?.selection?.type || null,
2832
3020
  }, { agentId });
2833
- timelineService?.recordRunLifecycle?.({
2834
- userId,
2835
- agentId,
2836
- runId,
2837
- title: runTitle,
2838
- eventKind: 'run_failed',
2839
- status: 'failed',
2840
- triggerSource,
2841
- error: err.message,
2842
- });
2843
-
2844
3021
  if (messagingFailureContent) {
2845
3022
  return {
2846
3023
  runId,
@@ -2853,6 +3030,7 @@ async function runConversation(engine, userId, userMessage, options = {}, _model
2853
3030
 
2854
3031
  throw err;
2855
3032
  } finally {
3033
+ detachExternalAbort?.();
2856
3034
  releaseReservation();
2857
3035
  }
2858
3036
  }