claude-smart 0.2.42 → 0.2.44
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/.claude-plugin/marketplace.json +3 -3
- package/README.md +1 -1
- package/bin/claude-smart.js +2 -2
- package/package.json +9 -3
- package/plugin/.claude-plugin/plugin.json +9 -3
- package/plugin/.codex-plugin/plugin.json +1 -1
- package/plugin/README.md +23 -3
- package/plugin/pyproject.toml +3 -3
- package/plugin/scripts/_lib.sh +91 -0
- package/plugin/scripts/backend-service.sh +51 -4
- package/plugin/scripts/cli.sh +3 -1
- package/plugin/scripts/codex-hook.js +72 -4
- package/plugin/scripts/dashboard-build.sh +1 -0
- package/plugin/scripts/dashboard-service.sh +1 -0
- package/plugin/scripts/ensure-plugin-root.sh +1 -0
- package/plugin/scripts/hook_entry.sh +6 -3
- package/plugin/scripts/smart-install.sh +3 -2
- package/plugin/src/README.md +57 -0
- package/plugin/src/claude_smart/context_format.py +11 -12
- package/plugin/src/claude_smart/cs_cite.py +26 -12
- package/plugin/src/claude_smart/ids.py +13 -5
- package/plugin/uv.lock +126 -5
- package/plugin/vendor/reflexio/.env.example +62 -0
- package/plugin/vendor/reflexio/LICENSE +201 -0
- package/plugin/vendor/reflexio/README.md +338 -0
- package/plugin/vendor/reflexio/pyproject.toml +274 -0
- package/plugin/vendor/reflexio/reflexio/README.md +184 -0
- package/plugin/vendor/reflexio/reflexio/__init__.py +166 -0
- package/plugin/vendor/reflexio/reflexio/benchmarks/__init__.py +1 -0
- package/plugin/vendor/reflexio/reflexio/benchmarks/retrieval_latency/README.md +109 -0
- package/plugin/vendor/reflexio/reflexio/benchmarks/retrieval_latency/__init__.py +1 -0
- package/plugin/vendor/reflexio/reflexio/benchmarks/retrieval_latency/backends.py +175 -0
- package/plugin/vendor/reflexio/reflexio/benchmarks/retrieval_latency/bench.py +642 -0
- package/plugin/vendor/reflexio/reflexio/benchmarks/retrieval_latency/embed_cache.py +330 -0
- package/plugin/vendor/reflexio/reflexio/benchmarks/retrieval_latency/report.py +317 -0
- package/plugin/vendor/reflexio/reflexio/benchmarks/retrieval_latency/results/report.md +43 -0
- package/plugin/vendor/reflexio/reflexio/benchmarks/retrieval_latency/results/results.json +4478 -0
- package/plugin/vendor/reflexio/reflexio/benchmarks/retrieval_latency/scenarios.py +134 -0
- package/plugin/vendor/reflexio/reflexio/benchmarks/retrieval_latency/seed.py +255 -0
- package/plugin/vendor/reflexio/reflexio/cli/README.md +287 -0
- package/plugin/vendor/reflexio/reflexio/cli/__init__.py +0 -0
- package/plugin/vendor/reflexio/reflexio/cli/__main__.py +56 -0
- package/plugin/vendor/reflexio/reflexio/cli/_client.py +86 -0
- package/plugin/vendor/reflexio/reflexio/cli/app.py +127 -0
- package/plugin/vendor/reflexio/reflexio/cli/bootstrap_config.py +265 -0
- package/plugin/vendor/reflexio/reflexio/cli/codex_auth.py +503 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/__init__.py +0 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/admin_cmd.py +65 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/agent_playbooks.py +503 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/api.py +114 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/auth.py +109 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/config_cmd.py +511 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/doctor.py +127 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/embeddings.py +53 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/interactions.py +478 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/profiles.py +303 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/services.py +289 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/setup_cmd.py +964 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/shortcuts.py +285 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/status_cmd.py +143 -0
- package/plugin/vendor/reflexio/reflexio/cli/commands/user_playbooks.py +373 -0
- package/plugin/vendor/reflexio/reflexio/cli/env_loader.py +284 -0
- package/plugin/vendor/reflexio/reflexio/cli/errors.py +217 -0
- package/plugin/vendor/reflexio/reflexio/cli/log_format.py +247 -0
- package/plugin/vendor/reflexio/reflexio/cli/output.py +867 -0
- package/plugin/vendor/reflexio/reflexio/cli/paths.py +41 -0
- package/plugin/vendor/reflexio/reflexio/cli/run_services.py +391 -0
- package/plugin/vendor/reflexio/reflexio/cli/state.py +204 -0
- package/plugin/vendor/reflexio/reflexio/cli/stop_services.py +96 -0
- package/plugin/vendor/reflexio/reflexio/cli/utils.py +329 -0
- package/plugin/vendor/reflexio/reflexio/client/__init__.py +3 -0
- package/plugin/vendor/reflexio/reflexio/client/cache.py +150 -0
- package/plugin/vendor/reflexio/reflexio/client/client.py +2613 -0
- package/plugin/vendor/reflexio/reflexio/defaults.py +23 -0
- package/plugin/vendor/reflexio/reflexio/integrations/__init__.py +0 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/.clawhubignore +7 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/README.md +274 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/TESTING.md +517 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/hook/handler.js +473 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/package-lock.json +2156 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/package.json +18 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/plugin/hook/handler.ts +241 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/plugin/hook/setup.ts +140 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/plugin/index.ts +130 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/plugin/lib/publish.ts +113 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/plugin/lib/search.ts +52 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/plugin/lib/server.ts +103 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/plugin/lib/sqlite-buffer.ts +156 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/plugin/lib/user-id.ts +134 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/plugin/openclaw.plugin.json +41 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/plugin/package.json +17 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/plugin/rules/reflexio.md +24 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/plugin/skills/reflexio/SKILL.md +48 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/publish_clawhub.sh +278 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/references/HOOK.md +164 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/scripts/install.sh +36 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/scripts/uninstall.sh +35 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/tests/publish.test.ts +27 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/tests/search.test.ts +31 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/tests/server.test.ts +42 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/tests/setup.test.ts +49 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/tests/sqlite-buffer.test.ts +91 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/tests/user-id.test.ts +50 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/tsconfig.json +16 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/types/openclaw.d.ts +230 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw/vitest.config.ts +13 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/README.md +120 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/TESTING.md +168 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/package-lock.json +1657 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/package.json +16 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/HEARTBEAT.md +6 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/README.md +84 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/SKILL.md +194 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/_meta.json +6 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/agents/reflexio-extractor.md +45 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/hook/handler.ts +214 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/hook/setup.ts +55 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/index.ts +327 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/lib/consolidate.ts +233 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/lib/dedup.ts +80 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/lib/io.ts +155 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/lib/openclaw-cli.ts +67 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/lib/search.ts +33 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/lib/write-playbook.ts +76 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/lib/write-profile.ts +79 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/openclaw.plugin.json +46 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/package.json +18 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/prompts/README.md +36 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/prompts/full_consolidation.md +56 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/prompts/playbook_extraction.md +217 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/prompts/profile_extraction.md +132 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/skills/reflexio-consolidate/SKILL.md +33 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/plugin/skills/reflexio-embedded/SKILL.md +194 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/references/HOOK.md +18 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/references/architecture.md +49 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/references/comparison.md +31 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/references/future-work.md +47 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/references/porting-notes.md +52 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/scripts/install.sh +52 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/scripts/uninstall.sh +36 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/tests/consolidate.test.ts +135 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/tests/dedup.test.ts +104 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/tests/io.test.ts +175 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/tests/search.test.ts +66 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/tests/smoke-test.ts +140 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/tests/write-playbook.test.ts +93 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/tests/write-profile.test.ts +174 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/tsconfig.json +16 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/types/openclaw.d.ts +230 -0
- package/plugin/vendor/reflexio/reflexio/integrations/openclaw-embedded/vitest.config.ts +7 -0
- package/plugin/vendor/reflexio/reflexio/lib/__init__.py +23 -0
- package/plugin/vendor/reflexio/reflexio/lib/_agent_playbook.py +310 -0
- package/plugin/vendor/reflexio/reflexio/lib/_base.py +225 -0
- package/plugin/vendor/reflexio/reflexio/lib/_config.py +83 -0
- package/plugin/vendor/reflexio/reflexio/lib/_dashboard.py +266 -0
- package/plugin/vendor/reflexio/reflexio/lib/_generation.py +176 -0
- package/plugin/vendor/reflexio/reflexio/lib/_interactions.py +334 -0
- package/plugin/vendor/reflexio/reflexio/lib/_operations.py +153 -0
- package/plugin/vendor/reflexio/reflexio/lib/_profiles.py +545 -0
- package/plugin/vendor/reflexio/reflexio/lib/_reflection.py +52 -0
- package/plugin/vendor/reflexio/reflexio/lib/_search.py +167 -0
- package/plugin/vendor/reflexio/reflexio/lib/_storage_labels.py +103 -0
- package/plugin/vendor/reflexio/reflexio/lib/_user_playbook.py +288 -0
- package/plugin/vendor/reflexio/reflexio/lib/reflexio_lib.py +27 -0
- package/plugin/vendor/reflexio/reflexio/models/__init__.py +0 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/__init__.py +0 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/braintrust_schema.py +141 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/common.py +41 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/domain/__init__.py +3 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/domain/entities.py +1112 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/domain/enums.py +63 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/eval_overview_schema.py +487 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/internal_schema.py +28 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/pending_tool_call_schema.py +83 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/retriever_schema.py +768 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/service_schemas.py +9 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/stall_state_schema.py +32 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/ui/__init__.py +3 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/ui/converters.py +177 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/ui/entities.py +129 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/ui/enums.py +25 -0
- package/plugin/vendor/reflexio/reflexio/models/api_schema/validators.py +333 -0
- package/plugin/vendor/reflexio/reflexio/models/config_schema.py +908 -0
- package/plugin/vendor/reflexio/reflexio/models/py.typed +0 -0
- package/plugin/vendor/reflexio/reflexio/server/OVERVIEW.md +90 -0
- package/plugin/vendor/reflexio/reflexio/server/README.md +622 -0
- package/plugin/vendor/reflexio/reflexio/server/__init__.py +210 -0
- package/plugin/vendor/reflexio/reflexio/server/__main__.py +132 -0
- package/plugin/vendor/reflexio/reflexio/server/_auth.py +25 -0
- package/plugin/vendor/reflexio/reflexio/server/api.py +2868 -0
- package/plugin/vendor/reflexio/reflexio/server/api_endpoints/README.md +34 -0
- package/plugin/vendor/reflexio/reflexio/server/api_endpoints/account_api.py +143 -0
- package/plugin/vendor/reflexio/reflexio/server/api_endpoints/health_api.py +91 -0
- package/plugin/vendor/reflexio/reflexio/server/api_endpoints/pending_tool_call_api.py +572 -0
- package/plugin/vendor/reflexio/reflexio/server/api_endpoints/precondition_checks.py +66 -0
- package/plugin/vendor/reflexio/reflexio/server/api_endpoints/publisher_api.py +562 -0
- package/plugin/vendor/reflexio/reflexio/server/api_endpoints/request_context.py +50 -0
- package/plugin/vendor/reflexio/reflexio/server/api_endpoints/stall_state_api.py +100 -0
- package/plugin/vendor/reflexio/reflexio/server/cache/__init__.py +15 -0
- package/plugin/vendor/reflexio/reflexio/server/cache/reflexio_cache.py +208 -0
- package/plugin/vendor/reflexio/reflexio/server/correlation.py +46 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/__init__.py +30 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/embedding_service.py +359 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/image_utils.py +55 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/litellm_client.py +1871 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/llm_utils.py +140 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/model_defaults.py +479 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/providers/__init__.py +1 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/providers/claude_code_provider.py +1122 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/providers/claude_code_stream_parser.py +197 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/providers/embedding_service_provider.py +338 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/providers/local_embedding_provider.py +213 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/providers/nomic_embedding_provider.py +288 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/rerank/__init__.py +6 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/rerank/cross_encoder_reranker.py +187 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/rerank/llm_reranker.py +148 -0
- package/plugin/vendor/reflexio/reflexio/server/llm/tools.py +716 -0
- package/plugin/vendor/reflexio/reflexio/server/operation_limiter.py +179 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/__init__.py +0 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/_dispatchers.py +54 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/README.md +121 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/agent_success_evaluation/v1.0.0.prompt.md +58 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/agent_success_evaluation_with_comparison/v1.0.0.prompt.md +76 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/answer_synthesis/v1.5.2.prompt.md +88 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/compress_session_for_query/v1.3.0.prompt.md +31 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/document_expansion/v1.0.0.prompt.md +20 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/memory_reflection/v1.0.0.prompt.md +53 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/memory_reflection/v1.1.0.prompt.md +57 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/memory_reflection/v1.2.0.prompt.md +68 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/memory_reflection/v1.3.0.prompt.md +70 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/memory_reflection/v1.4.0.prompt.md +77 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/memory_reflection/v1.5.0.prompt.md +82 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/memory_reflection/v1.6.0.prompt.md +83 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_aggregation/v2.1.0.prompt.md +193 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_aggregation/v2.2.0.prompt.md +206 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_consolidation/v1.0.0-deprecated.prompt.md +66 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_consolidation/v1.0.0.prompt.md +43 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_consolidation/v1.1.0.prompt.md +46 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_consolidation/v2.0.0-deprecated.prompt.md +64 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_consolidation/v2.0.0.prompt.md +39 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_consolidation/v2.1.0.prompt.md +39 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_consolidation/v2.2.0.prompt.md +47 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_consolidation/v2.3.0.prompt.md +58 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_consolidation/v2.3.1.prompt.md +69 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_consolidation/v2.3.2.prompt.md +71 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_context/v4.0.2.prompt.md +254 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_context/v4.1.0.prompt.md +274 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_context/v4.2.0.prompt.md +283 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_context/v4.2.2.prompt.md +234 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_context/v4.2.3.prompt.md +244 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_context_expert/v1.0.0.prompt.md +73 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_context_expert/v2.0.0.prompt.md +86 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_context_expert/v3.0.0.prompt.md +97 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_context_expert/v3.1.0.prompt.md +119 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_context_expert/v3.2.0.prompt.md +123 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_context_expert/v3.3.0.prompt.md +137 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_main/v1.0.0.prompt.md +14 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_main/v1.1.0.prompt.md +24 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_main/v1.2.0.prompt.md +29 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_main_expert/v1.0.0.prompt.md +11 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_main_expert/v1.1.0.prompt.md +21 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_extraction_main_expert/v1.2.0.prompt.md +25 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_optimizer_judge/v1.0.0.prompt.md +37 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_optimizer_judge/v1.1.0.prompt.md +40 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_optimizer_judge/v1.2.0.prompt.md +36 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_should_generate/v1.0.0.prompt.md +45 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_should_generate/v2.0.0.prompt.md +81 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_should_generate/v3.0.0.prompt.md +80 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/playbook_should_generate_expert/v1.0.0.prompt.md +34 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/profile_deduplication/v1.0.0.prompt.md +116 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/profile_should_generate/v1.0.0.prompt.md +33 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/profile_should_generate_override/v1.0.0.prompt.md +16 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/profile_update_instruction_start/v1.0.0.prompt.md +140 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/profile_update_instruction_start/v1.1.0.prompt.md +160 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/profile_update_main/v1.0.0.prompt.md +14 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/query_reformulation/v1.0.0.prompt.md +19 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/rerank_relevance/v1.1.0.prompt.md +44 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/shadow_comparison/v1.0.0.prompt.md +43 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_bank/shadow_content_evaluation/v1.0.0.prompt.md +33 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_evaluation/prompt_evaluation_dataset/feedback_extraction_main_v1.jsonl +10 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_evaluation/prompt_evaluation_dataset/profile_update_main_v1.jsonl +10 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_manager.py +280 -0
- package/plugin/vendor/reflexio/reflexio/server/prompt/prompt_schema.py +11 -0
- package/plugin/vendor/reflexio/reflexio/server/services/README.md +58 -0
- package/plugin/vendor/reflexio/reflexio/server/services/agent_success_evaluation/_eval_health.py +131 -0
- package/plugin/vendor/reflexio/reflexio/server/services/agent_success_evaluation/agent_success_evaluation_constants.py +60 -0
- package/plugin/vendor/reflexio/reflexio/server/services/agent_success_evaluation/agent_success_evaluation_service.py +228 -0
- package/plugin/vendor/reflexio/reflexio/server/services/agent_success_evaluation/agent_success_evaluation_utils.py +87 -0
- package/plugin/vendor/reflexio/reflexio/server/services/agent_success_evaluation/agent_success_evaluator.py +372 -0
- package/plugin/vendor/reflexio/reflexio/server/services/agent_success_evaluation/delayed_group_evaluator.py +156 -0
- package/plugin/vendor/reflexio/reflexio/server/services/agent_success_evaluation/group_evaluation_runner.py +336 -0
- package/plugin/vendor/reflexio/reflexio/server/services/agent_success_evaluation/regen_jobs.py +471 -0
- package/plugin/vendor/reflexio/reflexio/server/services/base_generation_service.py +1668 -0
- package/plugin/vendor/reflexio/reflexio/server/services/braintrust/__init__.py +0 -0
- package/plugin/vendor/reflexio/reflexio/server/services/braintrust/_cron.py +196 -0
- package/plugin/vendor/reflexio/reflexio/server/services/braintrust/_encryption.py +101 -0
- package/plugin/vendor/reflexio/reflexio/server/services/braintrust/client.py +167 -0
- package/plugin/vendor/reflexio/reflexio/server/services/braintrust/service.py +281 -0
- package/plugin/vendor/reflexio/reflexio/server/services/configurator/base_configurator.py +179 -0
- package/plugin/vendor/reflexio/reflexio/server/services/configurator/config_storage.py +62 -0
- package/plugin/vendor/reflexio/reflexio/server/services/configurator/configurator.py +87 -0
- package/plugin/vendor/reflexio/reflexio/server/services/configurator/local_file_config_storage.py +187 -0
- package/plugin/vendor/reflexio/reflexio/server/services/configurator/test_config_storage.py +162 -0
- package/plugin/vendor/reflexio/reflexio/server/services/deduplication_utils.py +112 -0
- package/plugin/vendor/reflexio/reflexio/server/services/embedding_text.py +62 -0
- package/plugin/vendor/reflexio/reflexio/server/services/evaluation_overview/__init__.py +0 -0
- package/plugin/vendor/reflexio/reflexio/server/services/evaluation_overview/distribution.py +33 -0
- package/plugin/vendor/reflexio/reflexio/server/services/evaluation_overview/eval_sampler.py +126 -0
- package/plugin/vendor/reflexio/reflexio/server/services/evaluation_overview/group_aggregation.py +192 -0
- package/plugin/vendor/reflexio/reflexio/server/services/evaluation_overview/hero_state.py +75 -0
- package/plugin/vendor/reflexio/reflexio/server/services/evaluation_overview/rule_attribution.py +97 -0
- package/plugin/vendor/reflexio/reflexio/server/services/evaluation_overview/service.py +515 -0
- package/plugin/vendor/reflexio/reflexio/server/services/evaluation_overview/shadow_aggregation.py +90 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extraction/__init__.py +0 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extraction/agent_run_records.py +91 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extraction/invariants.py +303 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extraction/outcome.py +25 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extraction/pending_tool_call_dispatch.py +358 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extraction/plan.py +138 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extraction/prior_answer_search.py +217 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extraction/resumable_agent.py +535 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extraction/resume_scheduler.py +171 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extraction/resume_worker.py +779 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extraction/tools.py +1125 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extractor_config_utils.py +94 -0
- package/plugin/vendor/reflexio/reflexio/server/services/extractor_interaction_utils.py +251 -0
- package/plugin/vendor/reflexio/reflexio/server/services/generation_service.py +702 -0
- package/plugin/vendor/reflexio/reflexio/server/services/operation_state_utils.py +835 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook/README.md +89 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook/playbook_aggregator.py +1388 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook/playbook_consolidator.py +1045 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook/playbook_extractor.py +436 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook/playbook_generation_service.py +808 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook/playbook_service_constants.py +28 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook/playbook_service_utils.py +362 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook_optimizer/__init__.py +24 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook_optimizer/assistant_webhook.py +246 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook_optimizer/gepa_adapter.py +291 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook_optimizer/judge.py +97 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook_optimizer/models.py +96 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook_optimizer/optimizer.py +645 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook_optimizer/rollout.py +35 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook_optimizer/scenario_resolver.py +93 -0
- package/plugin/vendor/reflexio/reflexio/server/services/playbook_optimizer/scheduler.py +174 -0
- package/plugin/vendor/reflexio/reflexio/server/services/pre_retrieval/__init__.py +26 -0
- package/plugin/vendor/reflexio/reflexio/server/services/pre_retrieval/_document_expander.py +179 -0
- package/plugin/vendor/reflexio/reflexio/server/services/pre_retrieval/_query_reformulator.py +297 -0
- package/plugin/vendor/reflexio/reflexio/server/services/profile/profile_deduplicator.py +772 -0
- package/plugin/vendor/reflexio/reflexio/server/services/profile/profile_extractor.py +462 -0
- package/plugin/vendor/reflexio/reflexio/server/services/profile/profile_generation_service.py +737 -0
- package/plugin/vendor/reflexio/reflexio/server/services/profile/profile_generation_service_utils.py +290 -0
- package/plugin/vendor/reflexio/reflexio/server/services/reflection/__init__.py +17 -0
- package/plugin/vendor/reflexio/reflexio/server/services/reflection/reflection_extractor.py +247 -0
- package/plugin/vendor/reflexio/reflexio/server/services/reflection/reflection_service.py +803 -0
- package/plugin/vendor/reflexio/reflexio/server/services/reflection/reflection_service_utils.py +146 -0
- package/plugin/vendor/reflexio/reflexio/server/services/retrieval/__init__.py +0 -0
- package/plugin/vendor/reflexio/reflexio/server/services/retrieval/relevance_floor.py +80 -0
- package/plugin/vendor/reflexio/reflexio/server/services/search/__init__.py +0 -0
- package/plugin/vendor/reflexio/reflexio/server/services/service_utils.py +756 -0
- package/plugin/vendor/reflexio/reflexio/server/services/shadow_comparison/__init__.py +1 -0
- package/plugin/vendor/reflexio/reflexio/server/services/shadow_comparison/judge.py +184 -0
- package/plugin/vendor/reflexio/reflexio/server/services/shadow_comparison/outcome.py +81 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/constants.py +2 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/error.py +11 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/retention.py +154 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/retention_mixin.py +155 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/sqlite_storage/__init__.py +59 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/sqlite_storage/_agent_run.py +1298 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/sqlite_storage/_base.py +1945 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/sqlite_storage/_extras.py +600 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/sqlite_storage/_operations.py +346 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/sqlite_storage/_playbook.py +1378 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/sqlite_storage/_profiles.py +747 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/sqlite_storage/_requests.py +263 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/sqlite_storage/_shadow_verdicts.py +193 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/sqlite_storage/_share_links.py +166 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/sqlite_storage/_stall_state.py +217 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/storage_base/__init__.py +153 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/storage_base/_agent_run.py +384 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/storage_base/_base.py +71 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/storage_base/_extras.py +235 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/storage_base/_operations.py +170 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/storage_base/_playbook.py +677 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/storage_base/_profiles.py +250 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/storage_base/_requests.py +154 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/storage_base/_shadow_verdicts.py +130 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/storage_base/_share_links.py +93 -0
- package/plugin/vendor/reflexio/reflexio/server/services/storage/storage_base/_stall_state.py +76 -0
- package/plugin/vendor/reflexio/reflexio/server/services/unified_search_service.py +572 -0
- package/plugin/vendor/reflexio/reflexio/server/site_var/README.md +77 -0
- package/plugin/vendor/reflexio/reflexio/server/site_var/feature_flags.py +116 -0
- package/plugin/vendor/reflexio/reflexio/server/site_var/site_var_manager.py +263 -0
- package/plugin/vendor/reflexio/reflexio/server/site_var/site_var_sources/feature_flags.json +13 -0
- package/plugin/vendor/reflexio/reflexio/server/site_var/site_var_sources/llm_model_setting.json +7 -0
- package/plugin/vendor/reflexio/reflexio/server/tracing.py +158 -0
- package/plugin/vendor/reflexio/reflexio/server/usage_metrics.py +113 -0
- package/plugin/vendor/reflexio/reflexio/server/uvicorn_logging.py +76 -0
- package/plugin/vendor/reflexio/reflexio/test_support/__init__.py +1 -0
- package/plugin/vendor/reflexio/reflexio/test_support/llm_fixtures.py +62 -0
- package/plugin/vendor/reflexio/reflexio/test_support/llm_mock.py +242 -0
- package/plugin/vendor/reflexio/reflexio/test_support/llm_model_registry.py +129 -0
- package/plugin/vendor/reflexio/reflexio/test_support/skip_decorators.py +43 -0
|
@@ -0,0 +1,1668 @@
|
|
|
1
|
+
"""
|
|
2
|
+
Base class for generation services
|
|
3
|
+
"""
|
|
4
|
+
|
|
5
|
+
import contextvars
|
|
6
|
+
import logging
|
|
7
|
+
import os
|
|
8
|
+
import re
|
|
9
|
+
import time
|
|
10
|
+
import uuid
|
|
11
|
+
from abc import ABC, abstractmethod
|
|
12
|
+
from concurrent.futures import ThreadPoolExecutor
|
|
13
|
+
from concurrent.futures import TimeoutError as FuturesTimeoutError
|
|
14
|
+
from dataclasses import dataclass
|
|
15
|
+
from datetime import UTC, datetime, timedelta
|
|
16
|
+
from enum import StrEnum
|
|
17
|
+
from typing import Any, Generic, TypeVar
|
|
18
|
+
|
|
19
|
+
from reflexio.models.api_schema.internal_schema import RequestInteractionDataModel
|
|
20
|
+
from reflexio.models.api_schema.service_schemas import Status
|
|
21
|
+
from reflexio.server.api_endpoints.request_context import RequestContext
|
|
22
|
+
from reflexio.server.llm.litellm_client import LiteLLMClient
|
|
23
|
+
from reflexio.server.services.extraction.outcome import ExtractionOutcome
|
|
24
|
+
from reflexio.server.services.extractor_config_utils import (
|
|
25
|
+
filter_extractor_configs,
|
|
26
|
+
get_extractor_name,
|
|
27
|
+
)
|
|
28
|
+
from reflexio.server.services.extractor_interaction_utils import (
|
|
29
|
+
get_effective_source_filter,
|
|
30
|
+
get_extractor_window_params,
|
|
31
|
+
should_extractor_run_by_stride,
|
|
32
|
+
)
|
|
33
|
+
from reflexio.server.services.operation_state_utils import OperationStateManager
|
|
34
|
+
from reflexio.server.services.service_utils import log_llm_messages, log_model_response
|
|
35
|
+
from reflexio.server.services.storage.storage_base import AgentRunStatus
|
|
36
|
+
from reflexio.server.usage_metrics import record_usage_event
|
|
37
|
+
|
|
38
|
+
|
|
39
|
+
class StatusChangeOperation(StrEnum):
|
|
40
|
+
"""Operation type for upgrade/downgrade responses."""
|
|
41
|
+
|
|
42
|
+
UPGRADE = "upgrade"
|
|
43
|
+
DOWNGRADE = "downgrade"
|
|
44
|
+
|
|
45
|
+
|
|
46
|
+
class ExtractorExecutionError(RuntimeError):
|
|
47
|
+
"""Raised when the configured extractor fails for a request/user context."""
|
|
48
|
+
|
|
49
|
+
|
|
50
|
+
logger = logging.getLogger(__name__)
|
|
51
|
+
|
|
52
|
+
|
|
53
|
+
# Cheap-signal thresholds for the pre-LLM should_run filter. Tuned for
|
|
54
|
+
# coding-assistant traffic where most turns are either slash commands
|
|
55
|
+
# or tool scaffolding, and where the LLM should_run gate costs 5–7s
|
|
56
|
+
# even when it ultimately votes False.
|
|
57
|
+
_MIN_USER_CONTENT_LEN = 30
|
|
58
|
+
# Heuristic match for reflexio's own extractor system prompts that
|
|
59
|
+
# sometimes leak into the corpus via the claude-code LLM provider's
|
|
60
|
+
# self-invocation. Kept conservative — false positives just mean one
|
|
61
|
+
# real interaction gets skipped this cycle (it'll re-enter at the next
|
|
62
|
+
# publish), false negatives are what we're actually trying to avoid.
|
|
63
|
+
_EXTRACTOR_PROMPT_PREFIXES = (
|
|
64
|
+
"you are a detector",
|
|
65
|
+
"you are an user signal",
|
|
66
|
+
"you are a signal detection",
|
|
67
|
+
"you are an extractor",
|
|
68
|
+
)
|
|
69
|
+
# Matches a single slash-command token at the start of a message. The
|
|
70
|
+
# ``:`` allows plugin-namespaced commands like ``/claude-smart:tag``.
|
|
71
|
+
_SLASH_COMMAND_TOKEN_RE = re.compile(r"^/[A-Za-z0-9_:-]+\s*")
|
|
72
|
+
|
|
73
|
+
|
|
74
|
+
def _is_pure_slash_command(content: str) -> bool:
|
|
75
|
+
"""Whether ``content`` is a bare slash command with no substantive text.
|
|
76
|
+
|
|
77
|
+
``/learn`` and ``/claude-smart:tag`` return True. ``/btw some note``
|
|
78
|
+
and ``/claude-smart:tag fix the foo`` return False because the text
|
|
79
|
+
after the command token carries user signal the extractors should see.
|
|
80
|
+
"""
|
|
81
|
+
stripped = content.lstrip()
|
|
82
|
+
if not stripped.startswith("/"):
|
|
83
|
+
return False
|
|
84
|
+
remainder = _SLASH_COMMAND_TOKEN_RE.sub("", stripped, count=1)
|
|
85
|
+
return not remainder.strip()
|
|
86
|
+
|
|
87
|
+
|
|
88
|
+
def _iter_user_contents(
|
|
89
|
+
session_data_models: list[RequestInteractionDataModel],
|
|
90
|
+
) -> list[str]:
|
|
91
|
+
"""Collect the ``content`` of every User-role interaction, order-preserving."""
|
|
92
|
+
out: list[str] = []
|
|
93
|
+
for model in session_data_models:
|
|
94
|
+
out.extend(
|
|
95
|
+
interaction.content
|
|
96
|
+
for interaction in model.interactions
|
|
97
|
+
if interaction.role == "User" and interaction.content
|
|
98
|
+
)
|
|
99
|
+
return out
|
|
100
|
+
|
|
101
|
+
|
|
102
|
+
def _cheap_should_run_reject(
|
|
103
|
+
session_data_models: list[RequestInteractionDataModel],
|
|
104
|
+
) -> str | None:
|
|
105
|
+
"""Cheap pre-filter for the consolidated should_run LLM gate.
|
|
106
|
+
|
|
107
|
+
Returns a short reason string when we can cheaply decide the batch
|
|
108
|
+
has no learnable signal — the caller logs the reason and skips the
|
|
109
|
+
LLM call. Returns None when we cannot decide cheaply and the LLM
|
|
110
|
+
should run.
|
|
111
|
+
|
|
112
|
+
Rejection rules:
|
|
113
|
+
- No user message at least ``_MIN_USER_CONTENT_LEN`` chars long
|
|
114
|
+
(purely short commands / confirmations).
|
|
115
|
+
- Every user message is a bare slash-command dispatch with no
|
|
116
|
+
substantive trailing text (e.g. ``/commit``, ``/review``,
|
|
117
|
+
``/claude-smart:tag``). Slash commands that carry user text
|
|
118
|
+
after the token (e.g. ``/btw some note``) are kept.
|
|
119
|
+
- Any user message begins with a known extractor-prompt prefix
|
|
120
|
+
(reflexio talking to itself via the claude-code LLM provider).
|
|
121
|
+
|
|
122
|
+
Args:
|
|
123
|
+
session_data_models: The deduplicated per-session interaction
|
|
124
|
+
batch built by ``_collect_scoped_interactions_for_precheck``.
|
|
125
|
+
|
|
126
|
+
Returns:
|
|
127
|
+
str | None: Reason code for the reject, or None to fall through.
|
|
128
|
+
"""
|
|
129
|
+
user_contents = _iter_user_contents(session_data_models)
|
|
130
|
+
if not user_contents:
|
|
131
|
+
return "no_user_turns"
|
|
132
|
+
|
|
133
|
+
for content in user_contents:
|
|
134
|
+
lowered = content.lstrip().lower()
|
|
135
|
+
if any(lowered.startswith(p) for p in _EXTRACTOR_PROMPT_PREFIXES):
|
|
136
|
+
return "extractor_prompt_echo"
|
|
137
|
+
|
|
138
|
+
if not any(len(c.strip()) >= _MIN_USER_CONTENT_LEN for c in user_contents):
|
|
139
|
+
return "all_user_turns_too_short"
|
|
140
|
+
|
|
141
|
+
if all(_is_pure_slash_command(c) for c in user_contents):
|
|
142
|
+
return "all_slash_commands"
|
|
143
|
+
|
|
144
|
+
return None
|
|
145
|
+
|
|
146
|
+
|
|
147
|
+
# Timeout for individual extractor execution (safety net if LLM provider ignores its own timeout)
|
|
148
|
+
EXTRACTOR_TIMEOUT_SECONDS = 300
|
|
149
|
+
|
|
150
|
+
TExtractorConfig = TypeVar("TExtractorConfig")
|
|
151
|
+
TExtractor = TypeVar("TExtractor")
|
|
152
|
+
TGenerationServiceConfig = TypeVar("TGenerationServiceConfig")
|
|
153
|
+
TRequest = TypeVar("TRequest")
|
|
154
|
+
|
|
155
|
+
|
|
156
|
+
@dataclass(frozen=True)
|
|
157
|
+
class PreparedGenerationRun(Generic[TExtractorConfig]): # noqa: UP046
|
|
158
|
+
extractor_config: TExtractorConfig
|
|
159
|
+
extractor_name: str
|
|
160
|
+
identifier: str
|
|
161
|
+
|
|
162
|
+
|
|
163
|
+
# Unified base class for all generation services (evaluation, playbook, profile)
|
|
164
|
+
class BaseGenerationService(
|
|
165
|
+
ABC,
|
|
166
|
+
Generic[TExtractorConfig, TExtractor, TGenerationServiceConfig, TRequest], # noqa: UP046
|
|
167
|
+
):
|
|
168
|
+
"""
|
|
169
|
+
Base class for generation services that run one configured extractor.
|
|
170
|
+
|
|
171
|
+
This unified class supports two types of services:
|
|
172
|
+
1. Evaluation services (playbook, agent success) - process interactions and save UserPlaybook
|
|
173
|
+
2. Profile services - process interactions with existing data and apply updates
|
|
174
|
+
|
|
175
|
+
Type Parameters:
|
|
176
|
+
TExtractorConfig: The extractor configuration type from YAML (e.g., PlaybookConfig, ProfileExtractorConfig)
|
|
177
|
+
TExtractor: The extractor type (e.g., PlaybookExtractor, ProfileExtractor, AgentSuccessEvaluator)
|
|
178
|
+
TGenerationServiceConfig: The runtime service configuration type (e.g., PlaybookGenerationServiceConfig, ProfileGenerationServiceConfig)
|
|
179
|
+
TRequest: The request type (e.g., ProfileGenerationRequest, PlaybookGenerationRequest, AgentSuccessEvaluationRequest)
|
|
180
|
+
|
|
181
|
+
Child classes must implement:
|
|
182
|
+
- _load_extractor_config(): Load extractor configuration from configurator
|
|
183
|
+
- _load_generation_service_config(): Extract parameters from request and return GenerationServiceConfig
|
|
184
|
+
- _create_extractor(): Create extractor instance with extractor config and service config
|
|
185
|
+
- _get_service_name(): Get service name for logging
|
|
186
|
+
- _process_results(): Process and save results (can access self.service_config)
|
|
187
|
+
"""
|
|
188
|
+
|
|
189
|
+
def __init__(
|
|
190
|
+
self, llm_client: LiteLLMClient, request_context: RequestContext
|
|
191
|
+
) -> None:
|
|
192
|
+
"""
|
|
193
|
+
Initialize the base generation service.
|
|
194
|
+
|
|
195
|
+
Args:
|
|
196
|
+
llm_client: Unified LLM client supporting both OpenAI and Claude
|
|
197
|
+
request_context: Request context with storage, configurator, and org_id
|
|
198
|
+
"""
|
|
199
|
+
self.client = llm_client
|
|
200
|
+
self.storage = request_context.storage
|
|
201
|
+
self.org_id = request_context.org_id
|
|
202
|
+
self.configurator = request_context.configurator
|
|
203
|
+
self.request_context = request_context
|
|
204
|
+
self.service_config: TGenerationServiceConfig | None = None
|
|
205
|
+
self._is_batch_mode: bool = False
|
|
206
|
+
self._last_extractor_run_stats: dict[str, int] = {
|
|
207
|
+
"total": 0,
|
|
208
|
+
"failed": 0,
|
|
209
|
+
"timed_out": 0,
|
|
210
|
+
}
|
|
211
|
+
self._last_extraction_run_ids: list[str] = []
|
|
212
|
+
|
|
213
|
+
def _usage_pipeline(self) -> str | None:
|
|
214
|
+
service_name = self._get_service_name()
|
|
215
|
+
if "profile" in service_name:
|
|
216
|
+
return "profile"
|
|
217
|
+
if "playbook" in service_name:
|
|
218
|
+
return "playbook"
|
|
219
|
+
if "evaluation" in service_name:
|
|
220
|
+
return "evaluation"
|
|
221
|
+
return None
|
|
222
|
+
|
|
223
|
+
def _usage_context(self) -> dict[str, Any]:
|
|
224
|
+
service_config = self.service_config
|
|
225
|
+
return {
|
|
226
|
+
"org_id": self.org_id,
|
|
227
|
+
"user_id": getattr(service_config, "user_id", None),
|
|
228
|
+
"request_id": getattr(service_config, "request_id", None),
|
|
229
|
+
"source": getattr(service_config, "source", None),
|
|
230
|
+
"agent_version": getattr(service_config, "agent_version", None),
|
|
231
|
+
"pipeline": self._usage_pipeline(),
|
|
232
|
+
}
|
|
233
|
+
|
|
234
|
+
def _record_generation_event(
|
|
235
|
+
self,
|
|
236
|
+
*,
|
|
237
|
+
event_name: str,
|
|
238
|
+
outcome: str,
|
|
239
|
+
count_value: int = 1,
|
|
240
|
+
duration_ms: int | None = None,
|
|
241
|
+
error_kind: str | None = None,
|
|
242
|
+
metadata: dict[str, Any] | None = None,
|
|
243
|
+
) -> None:
|
|
244
|
+
record_usage_event(
|
|
245
|
+
**self._usage_context(),
|
|
246
|
+
event_name=event_name,
|
|
247
|
+
event_category="generation",
|
|
248
|
+
outcome=outcome,
|
|
249
|
+
count_value=count_value,
|
|
250
|
+
duration_ms=duration_ms,
|
|
251
|
+
error_kind=error_kind,
|
|
252
|
+
metadata=metadata,
|
|
253
|
+
)
|
|
254
|
+
|
|
255
|
+
@staticmethod
|
|
256
|
+
def _count_generated_results(result: Any) -> int:
|
|
257
|
+
if isinstance(result, list):
|
|
258
|
+
return len(result)
|
|
259
|
+
return 1 if result else 0
|
|
260
|
+
|
|
261
|
+
@abstractmethod
|
|
262
|
+
def _load_extractor_config(self) -> TExtractorConfig | None:
|
|
263
|
+
"""
|
|
264
|
+
Load extractor configuration from the configurator.
|
|
265
|
+
|
|
266
|
+
Returns:
|
|
267
|
+
Extractor configuration object from YAML, or None when disabled.
|
|
268
|
+
"""
|
|
269
|
+
|
|
270
|
+
@abstractmethod
|
|
271
|
+
def _load_generation_service_config(
|
|
272
|
+
self, request: TRequest
|
|
273
|
+
) -> TGenerationServiceConfig:
|
|
274
|
+
"""
|
|
275
|
+
Extract parameters from request object and return GenerationServiceConfig.
|
|
276
|
+
|
|
277
|
+
Args:
|
|
278
|
+
request: The request object
|
|
279
|
+
|
|
280
|
+
Returns:
|
|
281
|
+
GenerationServiceConfig object (e.g., PlaybookGenerationServiceConfig, ProfileGenerationServiceConfig)
|
|
282
|
+
"""
|
|
283
|
+
|
|
284
|
+
@abstractmethod
|
|
285
|
+
def _create_extractor(
|
|
286
|
+
self,
|
|
287
|
+
extractor_config: TExtractorConfig,
|
|
288
|
+
service_config: TGenerationServiceConfig,
|
|
289
|
+
) -> TExtractor:
|
|
290
|
+
"""
|
|
291
|
+
Create an extractor instance from extractor config and service config.
|
|
292
|
+
|
|
293
|
+
Args:
|
|
294
|
+
extractor_config: The extractor configuration object from YAML (e.g., PlaybookConfig, ProfileExtractorConfig)
|
|
295
|
+
service_config: The runtime service configuration object (e.g., PlaybookGenerationServiceConfig, ProfileGenerationServiceConfig)
|
|
296
|
+
|
|
297
|
+
Returns:
|
|
298
|
+
An extractor instance
|
|
299
|
+
"""
|
|
300
|
+
|
|
301
|
+
@abstractmethod
|
|
302
|
+
def _get_service_name(self) -> str:
|
|
303
|
+
"""
|
|
304
|
+
Get the name of the service for logging purposes.
|
|
305
|
+
|
|
306
|
+
Returns:
|
|
307
|
+
Service name string
|
|
308
|
+
"""
|
|
309
|
+
|
|
310
|
+
@abstractmethod
|
|
311
|
+
def _get_base_service_name(self) -> str:
|
|
312
|
+
"""
|
|
313
|
+
Get the base service name for OperationStateManager keys.
|
|
314
|
+
|
|
315
|
+
This is the service identity used for progress/lock key construction,
|
|
316
|
+
independent of whether the operation is a rerun or regular run.
|
|
317
|
+
|
|
318
|
+
Returns:
|
|
319
|
+
Base service name (e.g., "profile_generation", "playbook_generation")
|
|
320
|
+
"""
|
|
321
|
+
|
|
322
|
+
@abstractmethod
|
|
323
|
+
def _process_results(self, results: list) -> None:
|
|
324
|
+
"""
|
|
325
|
+
Process and save all results from extractors. Called once after all extractors complete.
|
|
326
|
+
|
|
327
|
+
Responsible for flattening, deduplication (if applicable), and saving results.
|
|
328
|
+
Can access self.service_config for context.
|
|
329
|
+
|
|
330
|
+
Args:
|
|
331
|
+
results: List of all results from extractors (one per successful extractor)
|
|
332
|
+
"""
|
|
333
|
+
|
|
334
|
+
def _finalize_extracted_items(self, items: list) -> None:
|
|
335
|
+
"""Persist already-flattened extracted items through the service path."""
|
|
336
|
+
if items:
|
|
337
|
+
self._process_results([items])
|
|
338
|
+
|
|
339
|
+
@abstractmethod
|
|
340
|
+
def _should_track_in_progress(self) -> bool:
|
|
341
|
+
"""
|
|
342
|
+
Return True if this service should track in-progress state to prevent duplicates.
|
|
343
|
+
|
|
344
|
+
Profile and Feedback services should return True to prevent duplicate generation
|
|
345
|
+
when back-to-back requests arrive. AgentSuccess services should return False
|
|
346
|
+
as they process per-request and don't have the same duplication issue.
|
|
347
|
+
|
|
348
|
+
Returns:
|
|
349
|
+
bool: True if in-progress tracking should be enabled
|
|
350
|
+
"""
|
|
351
|
+
|
|
352
|
+
@abstractmethod
|
|
353
|
+
def _get_lock_scope_id(self, request: TRequest) -> str | None:
|
|
354
|
+
"""
|
|
355
|
+
Get the scope ID for lock key construction.
|
|
356
|
+
|
|
357
|
+
Profile services return user_id (per-user lock), playbook services return None (per-org lock).
|
|
358
|
+
|
|
359
|
+
Args:
|
|
360
|
+
request: The generation request
|
|
361
|
+
|
|
362
|
+
Returns:
|
|
363
|
+
Optional[str]: Scope ID (e.g., user_id) or None for org-level scope
|
|
364
|
+
"""
|
|
365
|
+
|
|
366
|
+
def _filter_extractor_config_by_service_config(
|
|
367
|
+
self,
|
|
368
|
+
extractor_config: TExtractorConfig,
|
|
369
|
+
service_config: TGenerationServiceConfig,
|
|
370
|
+
) -> TExtractorConfig | None:
|
|
371
|
+
"""
|
|
372
|
+
Filter the extractor config based on request_sources_enabled and manual_trigger.
|
|
373
|
+
"""
|
|
374
|
+
filtered = filter_extractor_configs(
|
|
375
|
+
extractor_configs=[extractor_config],
|
|
376
|
+
source=getattr(service_config, "source", None),
|
|
377
|
+
allow_manual_trigger=getattr(service_config, "allow_manual_trigger", False),
|
|
378
|
+
)
|
|
379
|
+
return filtered[0] if filtered else None
|
|
380
|
+
|
|
381
|
+
def _get_extractor_state_service_name(self) -> str | None:
|
|
382
|
+
"""
|
|
383
|
+
Get the service name used for extractor state (stride_size bookmark) lookups.
|
|
384
|
+
|
|
385
|
+
Override in subclasses that support stride_size-based pre-filtering to return
|
|
386
|
+
the OperationStateManager service name (e.g., "profile_extractor", "playbook_extractor").
|
|
387
|
+
Returns None by default, meaning stride_size pre-filtering is skipped.
|
|
388
|
+
|
|
389
|
+
Returns:
|
|
390
|
+
Optional[str]: Service name for OperationStateManager, or None to skip stride_size pre-filtering
|
|
391
|
+
"""
|
|
392
|
+
return None
|
|
393
|
+
|
|
394
|
+
def _filter_config_by_stride(
|
|
395
|
+
self, extractor_config: TExtractorConfig
|
|
396
|
+
) -> TExtractorConfig | None:
|
|
397
|
+
"""
|
|
398
|
+
Filter extractor config by stride_size check before the should_run LLM call.
|
|
399
|
+
|
|
400
|
+
Skips filtering when:
|
|
401
|
+
- _get_extractor_state_service_name() returns None (service doesn't support stride_size)
|
|
402
|
+
- auto_run is False (rerun/manual flows skip stride_size)
|
|
403
|
+
|
|
404
|
+
Args:
|
|
405
|
+
extractor_config: Extractor config after source/manual_trigger filtering
|
|
406
|
+
|
|
407
|
+
Returns:
|
|
408
|
+
Extractor config when it passes the stride_size check, otherwise None.
|
|
409
|
+
"""
|
|
410
|
+
state_service_name = self._get_extractor_state_service_name()
|
|
411
|
+
if state_service_name is None:
|
|
412
|
+
return extractor_config
|
|
413
|
+
|
|
414
|
+
if not getattr(self.service_config, "auto_run", True):
|
|
415
|
+
return extractor_config
|
|
416
|
+
|
|
417
|
+
if getattr(self.service_config, "force_extraction", False):
|
|
418
|
+
return extractor_config
|
|
419
|
+
|
|
420
|
+
root_config = self.request_context.configurator.get_config()
|
|
421
|
+
global_window_size = (
|
|
422
|
+
getattr(root_config, "window_size", None) if root_config else None
|
|
423
|
+
)
|
|
424
|
+
global_stride_size = (
|
|
425
|
+
getattr(root_config, "stride_size", None) if root_config else None
|
|
426
|
+
)
|
|
427
|
+
|
|
428
|
+
state_manager = OperationStateManager(
|
|
429
|
+
self.storage, # type: ignore[reportArgumentType]
|
|
430
|
+
self.org_id,
|
|
431
|
+
state_service_name, # type: ignore[reportArgumentType]
|
|
432
|
+
)
|
|
433
|
+
|
|
434
|
+
name = get_extractor_name(extractor_config)
|
|
435
|
+
_, stride_size = get_extractor_window_params(
|
|
436
|
+
extractor_config, global_window_size, global_stride_size
|
|
437
|
+
)
|
|
438
|
+
|
|
439
|
+
# Resolve effective source filter for this extractor
|
|
440
|
+
should_skip, effective_source = get_effective_source_filter(
|
|
441
|
+
extractor_config, getattr(self.service_config, "source", None)
|
|
442
|
+
)
|
|
443
|
+
if should_skip:
|
|
444
|
+
return None
|
|
445
|
+
|
|
446
|
+
(
|
|
447
|
+
_,
|
|
448
|
+
new_interactions,
|
|
449
|
+
) = state_manager.get_extractor_state_with_new_interactions(
|
|
450
|
+
extractor_name=name,
|
|
451
|
+
user_id=getattr(self.service_config, "user_id", None),
|
|
452
|
+
sources=effective_source,
|
|
453
|
+
)
|
|
454
|
+
new_count = sum(len(ri.interactions) for ri in new_interactions)
|
|
455
|
+
|
|
456
|
+
if should_extractor_run_by_stride(new_count, stride_size):
|
|
457
|
+
return extractor_config
|
|
458
|
+
|
|
459
|
+
logger.info(
|
|
460
|
+
"Stride pre-filter: skipping extractor '%s' (new=%d, stride_size=%s)",
|
|
461
|
+
name,
|
|
462
|
+
new_count,
|
|
463
|
+
stride_size,
|
|
464
|
+
)
|
|
465
|
+
return None
|
|
466
|
+
|
|
467
|
+
# ===============================
|
|
468
|
+
# In-progress state management via OperationStateManager
|
|
469
|
+
# ===============================
|
|
470
|
+
|
|
471
|
+
def _create_state_manager(self) -> OperationStateManager:
|
|
472
|
+
"""Create an OperationStateManager for this service.
|
|
473
|
+
|
|
474
|
+
Returns:
|
|
475
|
+
OperationStateManager instance configured for this service
|
|
476
|
+
"""
|
|
477
|
+
return OperationStateManager(
|
|
478
|
+
self.storage, # type: ignore[reportArgumentType]
|
|
479
|
+
self.org_id,
|
|
480
|
+
self._get_base_service_name(), # type: ignore[reportArgumentType]
|
|
481
|
+
)
|
|
482
|
+
|
|
483
|
+
def _serialize_request_for_queue(self, request: TRequest) -> dict | None:
|
|
484
|
+
"""Serialize a request for the pending-request queue.
|
|
485
|
+
|
|
486
|
+
Default implementation handles Pydantic ``BaseModel`` requests via
|
|
487
|
+
``model_dump(mode="json")``. Override in subclasses whose requests
|
|
488
|
+
are not Pydantic models.
|
|
489
|
+
|
|
490
|
+
The queued payload is what the rerun loop will run when this request
|
|
491
|
+
comes off the queue — so it MUST capture every field the run needs to
|
|
492
|
+
reproduce the original publish (user_id, request_id, agent_version,
|
|
493
|
+
source, force_extraction, etc.). Without this, the rerun runs with the
|
|
494
|
+
wrong holder's request and the queued user's interactions are silently
|
|
495
|
+
skipped (R2).
|
|
496
|
+
|
|
497
|
+
Returns ``None`` to opt out — the queue then stores only the
|
|
498
|
+
request_id and the rerun falls back to the original holder's request,
|
|
499
|
+
which is the pre-fix behaviour. Use only for services where the
|
|
500
|
+
per-request payload doesn't differ between concurrent callers.
|
|
501
|
+
"""
|
|
502
|
+
# Pydantic BaseModel — handles the common case (PlaybookGenerationRequest,
|
|
503
|
+
# ProfileGenerationRequest).
|
|
504
|
+
model_dump = getattr(request, "model_dump", None)
|
|
505
|
+
if callable(model_dump):
|
|
506
|
+
try:
|
|
507
|
+
dumped = model_dump(mode="json")
|
|
508
|
+
except Exception: # pragma: no cover — defensive
|
|
509
|
+
logger.warning(
|
|
510
|
+
"Failed to model_dump %s request for queue; "
|
|
511
|
+
"rerun will fall back to original holder's request",
|
|
512
|
+
self._get_service_name(),
|
|
513
|
+
)
|
|
514
|
+
return None
|
|
515
|
+
if isinstance(dumped, dict):
|
|
516
|
+
return dumped
|
|
517
|
+
return None
|
|
518
|
+
|
|
519
|
+
def _deserialize_request_from_queue(
|
|
520
|
+
self,
|
|
521
|
+
payload: dict,
|
|
522
|
+
original_request: TRequest,
|
|
523
|
+
) -> TRequest:
|
|
524
|
+
"""Reconstruct a request object from a queued payload.
|
|
525
|
+
|
|
526
|
+
Default implementation calls ``type(original_request).model_validate(payload)``
|
|
527
|
+
for Pydantic-backed requests. Override in subclasses with non-Pydantic
|
|
528
|
+
request types.
|
|
529
|
+
|
|
530
|
+
Args:
|
|
531
|
+
payload: The dict previously produced by ``_serialize_request_for_queue``
|
|
532
|
+
original_request: The request the lock holder ran with — used as a
|
|
533
|
+
fallback type and for any fields the payload doesn't carry
|
|
534
|
+
"""
|
|
535
|
+
request_cls = type(original_request)
|
|
536
|
+
model_validate = getattr(request_cls, "model_validate", None)
|
|
537
|
+
if callable(model_validate):
|
|
538
|
+
try:
|
|
539
|
+
rebuilt = model_validate(payload)
|
|
540
|
+
except Exception as exc: # pragma: no cover — defensive
|
|
541
|
+
logger.warning(
|
|
542
|
+
"Failed to model_validate queued payload for %s: %s; "
|
|
543
|
+
"falling back to original request",
|
|
544
|
+
self._get_service_name(),
|
|
545
|
+
exc,
|
|
546
|
+
)
|
|
547
|
+
return original_request
|
|
548
|
+
# Narrow the object type to TRequest — model_validate on
|
|
549
|
+
# type(original_request) returns the same class, so the cast is
|
|
550
|
+
# safe in practice. Pyright can't see through getattr, so we
|
|
551
|
+
# use isinstance to satisfy the type checker.
|
|
552
|
+
if isinstance(rebuilt, request_cls):
|
|
553
|
+
return rebuilt # type: ignore[reportReturnType]
|
|
554
|
+
return original_request
|
|
555
|
+
|
|
556
|
+
def run(self, request: TRequest) -> None:
|
|
557
|
+
"""
|
|
558
|
+
Run the generation service for the given request.
|
|
559
|
+
|
|
560
|
+
This is the main entry point that:
|
|
561
|
+
1. If in-progress tracking is enabled, handles lock acquisition/release
|
|
562
|
+
2. Validates and extracts parameters from the request into GenerationServiceConfig
|
|
563
|
+
3. Runs extractors sequentially (each extractor handles its own data collection)
|
|
564
|
+
4. Processes results
|
|
565
|
+
5. Re-runs if new requests came in during generation
|
|
566
|
+
|
|
567
|
+
Args:
|
|
568
|
+
request: The request object containing parameters
|
|
569
|
+
"""
|
|
570
|
+
# Check if this service tracks in-progress state
|
|
571
|
+
if not self._should_track_in_progress():
|
|
572
|
+
self._run_generation(request)
|
|
573
|
+
return
|
|
574
|
+
|
|
575
|
+
# Get scope ID and request ID for in-progress tracking
|
|
576
|
+
scope_id = self._get_lock_scope_id(request)
|
|
577
|
+
my_request_id = getattr(request, "request_id", None) or str(uuid.uuid4())
|
|
578
|
+
|
|
579
|
+
state_manager = self._create_state_manager()
|
|
580
|
+
|
|
581
|
+
# Try to acquire lock — pass the serialized payload so blocked
|
|
582
|
+
# publishes land in the queue with their own data attached. This is
|
|
583
|
+
# the fix for R2: without the payload, the
|
|
584
|
+
# rerun re-uses the holder's request and the queued users' batches
|
|
585
|
+
# never get extracted.
|
|
586
|
+
my_payload = self._serialize_request_for_queue(request)
|
|
587
|
+
if not state_manager.acquire_lock(
|
|
588
|
+
my_request_id, scope_id=scope_id, payload=my_payload
|
|
589
|
+
):
|
|
590
|
+
return # Another operation is running, we've enqueued ourselves
|
|
591
|
+
|
|
592
|
+
current_request: TRequest = request
|
|
593
|
+
|
|
594
|
+
# Re-run loop: drain the pending queue (FIFO) until empty
|
|
595
|
+
try:
|
|
596
|
+
while True:
|
|
597
|
+
self._run_generation(current_request)
|
|
598
|
+
|
|
599
|
+
# If in batch mode and cancellation was requested, clear lock
|
|
600
|
+
# to prevent queued pending requests from running, then stop
|
|
601
|
+
if self._is_batch_mode and state_manager.is_cancellation_requested():
|
|
602
|
+
state_manager.clear_lock(scope_id=scope_id)
|
|
603
|
+
logger.info(
|
|
604
|
+
"Cancellation detected in run() for %s, cleared lock to prevent pending re-runs",
|
|
605
|
+
self._get_service_name(),
|
|
606
|
+
)
|
|
607
|
+
break
|
|
608
|
+
|
|
609
|
+
# Pop the next queued request (if any). Returns the queued
|
|
610
|
+
# request's ID + payload so the rerun runs against THAT
|
|
611
|
+
# publish's data, not the original holder's.
|
|
612
|
+
next_entry = state_manager.release_lock_pop_queue(
|
|
613
|
+
my_request_id, scope_id=scope_id
|
|
614
|
+
)
|
|
615
|
+
|
|
616
|
+
if next_entry is None:
|
|
617
|
+
break # Queue empty — we're done
|
|
618
|
+
|
|
619
|
+
next_request_id = next_entry["request_id"]
|
|
620
|
+
next_payload = next_entry.get("payload")
|
|
621
|
+
|
|
622
|
+
logger.info(
|
|
623
|
+
"Draining queued %s request: prev_request_id=%s, next_request_id=%s, "
|
|
624
|
+
"payload_present=%s",
|
|
625
|
+
self._get_service_name(),
|
|
626
|
+
my_request_id,
|
|
627
|
+
next_request_id,
|
|
628
|
+
next_payload is not None,
|
|
629
|
+
)
|
|
630
|
+
|
|
631
|
+
# Reconstruct the queued request. If the payload is missing
|
|
632
|
+
# (legacy state row from a pre-fix server), fall back to the
|
|
633
|
+
# original request — matches pre-fix behaviour.
|
|
634
|
+
if next_payload:
|
|
635
|
+
current_request = self._deserialize_request_from_queue(
|
|
636
|
+
next_payload, request
|
|
637
|
+
)
|
|
638
|
+
else:
|
|
639
|
+
current_request = request
|
|
640
|
+
|
|
641
|
+
my_request_id = next_request_id
|
|
642
|
+
|
|
643
|
+
except Exception:
|
|
644
|
+
# Clear lock on error to prevent deadlock
|
|
645
|
+
state_manager.clear_lock(scope_id=scope_id)
|
|
646
|
+
raise
|
|
647
|
+
|
|
648
|
+
def _run_generation(self, request: TRequest) -> None:
|
|
649
|
+
"""
|
|
650
|
+
Run the actual generation logic.
|
|
651
|
+
|
|
652
|
+
Orchestrates validation, config loading, extractor execution, and result
|
|
653
|
+
processing by delegating to _prepare_generation_run and _execute_extractor.
|
|
654
|
+
|
|
655
|
+
Args:
|
|
656
|
+
request: The request object containing parameters
|
|
657
|
+
"""
|
|
658
|
+
if not request:
|
|
659
|
+
logger.error("Received None request for %s", self._get_service_name())
|
|
660
|
+
return
|
|
661
|
+
|
|
662
|
+
generation_start = time.perf_counter()
|
|
663
|
+
try:
|
|
664
|
+
prepared = self._prepare_generation_run(request)
|
|
665
|
+
if prepared is None:
|
|
666
|
+
return
|
|
667
|
+
|
|
668
|
+
self._record_generation_event(
|
|
669
|
+
event_name="generation_started",
|
|
670
|
+
outcome="started",
|
|
671
|
+
count_value=1,
|
|
672
|
+
metadata={
|
|
673
|
+
"identifier": prepared.identifier,
|
|
674
|
+
"extractor_name": prepared.extractor_name,
|
|
675
|
+
},
|
|
676
|
+
)
|
|
677
|
+
self._last_extraction_run_ids = []
|
|
678
|
+
result = self._execute_extractor(
|
|
679
|
+
prepared.extractor_config, prepared.identifier
|
|
680
|
+
)
|
|
681
|
+
generated_count = self._count_generated_results(result)
|
|
682
|
+
|
|
683
|
+
try:
|
|
684
|
+
if result:
|
|
685
|
+
self._process_results([result])
|
|
686
|
+
self._finalize_extraction_runs()
|
|
687
|
+
except Exception as exc:
|
|
688
|
+
self._mark_extraction_runs_finalization_failed(exc)
|
|
689
|
+
raise
|
|
690
|
+
|
|
691
|
+
self._record_generation_event(
|
|
692
|
+
event_name="generation_succeeded",
|
|
693
|
+
outcome="success",
|
|
694
|
+
count_value=generated_count,
|
|
695
|
+
duration_ms=int((time.perf_counter() - generation_start) * 1000),
|
|
696
|
+
metadata={
|
|
697
|
+
"identifier": prepared.identifier,
|
|
698
|
+
"extractor_name": prepared.extractor_name,
|
|
699
|
+
"extractor_failed": bool(
|
|
700
|
+
self._last_extractor_run_stats.get("failed")
|
|
701
|
+
),
|
|
702
|
+
"extractor_timed_out": bool(
|
|
703
|
+
self._last_extractor_run_stats.get("timed_out")
|
|
704
|
+
),
|
|
705
|
+
},
|
|
706
|
+
)
|
|
707
|
+
|
|
708
|
+
except Exception as e:
|
|
709
|
+
self._record_generation_event(
|
|
710
|
+
event_name="generation_failed",
|
|
711
|
+
outcome="failed",
|
|
712
|
+
duration_ms=int((time.perf_counter() - generation_start) * 1000),
|
|
713
|
+
error_kind=type(e).__name__,
|
|
714
|
+
)
|
|
715
|
+
logger.error(
|
|
716
|
+
"Failed to run %s due to %s, exception type: %s",
|
|
717
|
+
self._get_service_name(),
|
|
718
|
+
str(e),
|
|
719
|
+
type(e).__name__,
|
|
720
|
+
)
|
|
721
|
+
if isinstance(e, ExtractorExecutionError):
|
|
722
|
+
raise
|
|
723
|
+
|
|
724
|
+
def _prepare_generation_run(
|
|
725
|
+
self, request: TRequest
|
|
726
|
+
) -> PreparedGenerationRun[TExtractorConfig] | None:
|
|
727
|
+
"""
|
|
728
|
+
Validate request, load config, filter extractor config, and run pre-extraction checks.
|
|
729
|
+
|
|
730
|
+
Loads the generation service config from the request, loads and filters the
|
|
731
|
+
extractor config by source, manual trigger, and stride_size, then runs the
|
|
732
|
+
pre-extraction gate.
|
|
733
|
+
|
|
734
|
+
Args:
|
|
735
|
+
request: The request object containing parameters
|
|
736
|
+
|
|
737
|
+
Returns:
|
|
738
|
+
PreparedGenerationRun when generation should proceed, otherwise None.
|
|
739
|
+
"""
|
|
740
|
+
self.service_config = self._load_generation_service_config(request)
|
|
741
|
+
|
|
742
|
+
extractor_config = self._load_extractor_config()
|
|
743
|
+
if extractor_config is None:
|
|
744
|
+
logger.warning("No %s extractor config found", self._get_service_name())
|
|
745
|
+
return None
|
|
746
|
+
|
|
747
|
+
extractor_config = self._filter_extractor_config_by_service_config(
|
|
748
|
+
extractor_config, self.service_config
|
|
749
|
+
)
|
|
750
|
+
|
|
751
|
+
if extractor_config is None:
|
|
752
|
+
source = getattr(self.service_config, "source", "N/A")
|
|
753
|
+
source_display = source or "N/A"
|
|
754
|
+
logger.info(
|
|
755
|
+
"No %s extractor config enabled for source: %s",
|
|
756
|
+
self._get_service_name(),
|
|
757
|
+
source_display,
|
|
758
|
+
)
|
|
759
|
+
return None
|
|
760
|
+
|
|
761
|
+
extractor_config = self._filter_config_by_stride(extractor_config)
|
|
762
|
+
if extractor_config is None:
|
|
763
|
+
logger.info(
|
|
764
|
+
"Extractor config did not pass stride_size check for %s",
|
|
765
|
+
self._get_service_name(),
|
|
766
|
+
)
|
|
767
|
+
return None
|
|
768
|
+
|
|
769
|
+
identifier = getattr(self.service_config, "user_id", None) or getattr(
|
|
770
|
+
self.service_config, "request_id", "unknown"
|
|
771
|
+
)
|
|
772
|
+
extractor_name = get_extractor_name(extractor_config)
|
|
773
|
+
|
|
774
|
+
should_run = self._should_run_before_extraction(extractor_config)
|
|
775
|
+
self._record_generation_event(
|
|
776
|
+
event_name="generation_gate_evaluated",
|
|
777
|
+
outcome="should_run" if should_run else "should_skip",
|
|
778
|
+
count_value=1,
|
|
779
|
+
metadata={
|
|
780
|
+
"identifier": identifier,
|
|
781
|
+
"extractor_name": extractor_name,
|
|
782
|
+
},
|
|
783
|
+
)
|
|
784
|
+
|
|
785
|
+
if not should_run:
|
|
786
|
+
logger.info(
|
|
787
|
+
"Pre-extraction check returned False for %s identifier=%s, skipping",
|
|
788
|
+
self._get_service_name(),
|
|
789
|
+
identifier,
|
|
790
|
+
)
|
|
791
|
+
return None
|
|
792
|
+
|
|
793
|
+
return PreparedGenerationRun(
|
|
794
|
+
extractor_config=extractor_config,
|
|
795
|
+
extractor_name=extractor_name,
|
|
796
|
+
identifier=identifier,
|
|
797
|
+
)
|
|
798
|
+
|
|
799
|
+
def _execute_extractor(
|
|
800
|
+
self,
|
|
801
|
+
extractor_config: TExtractorConfig,
|
|
802
|
+
identifier: str,
|
|
803
|
+
) -> Any | None:
|
|
804
|
+
"""
|
|
805
|
+
Run the configured extractor with timeout and error handling.
|
|
806
|
+
|
|
807
|
+
The extractor runs in a thread pool with a timeout guard so providers that
|
|
808
|
+
ignore their own timeout cannot block generation forever.
|
|
809
|
+
|
|
810
|
+
Args:
|
|
811
|
+
extractor_config: Filtered extractor config to execute
|
|
812
|
+
identifier: Logging context identifier (user_id or request_id)
|
|
813
|
+
|
|
814
|
+
Returns:
|
|
815
|
+
Extractor result, or None if the extractor succeeded with no output.
|
|
816
|
+
|
|
817
|
+
Raises:
|
|
818
|
+
ExtractorExecutionError: If the extractor fails with an exception or timeout.
|
|
819
|
+
"""
|
|
820
|
+
if (
|
|
821
|
+
self.service_config is None
|
|
822
|
+
): # pragma: no cover — set by _prepare_generation_run
|
|
823
|
+
raise RuntimeError("service_config must be set before executing extractor")
|
|
824
|
+
|
|
825
|
+
self._last_extractor_run_stats = {"total": 1, "failed": 0, "timed_out": 0}
|
|
826
|
+
extractor = self._create_extractor(extractor_config, self.service_config)
|
|
827
|
+
executor: ThreadPoolExecutor | None = None
|
|
828
|
+
try:
|
|
829
|
+
executor = ThreadPoolExecutor(max_workers=1)
|
|
830
|
+
# Copy context so correlation ID propagates to worker thread
|
|
831
|
+
ctx = contextvars.copy_context()
|
|
832
|
+
future = executor.submit(ctx.run, extractor.run) # type: ignore[reportAttributeAccessIssue]
|
|
833
|
+
result = future.result(timeout=EXTRACTOR_TIMEOUT_SECONDS)
|
|
834
|
+
if isinstance(result, ExtractionOutcome):
|
|
835
|
+
if result.run_id:
|
|
836
|
+
self._last_extraction_run_ids.append(result.run_id)
|
|
837
|
+
if result.status == "completed" and result.items:
|
|
838
|
+
return result.items
|
|
839
|
+
logger.info(
|
|
840
|
+
"No results generated for %s identifier: %s",
|
|
841
|
+
self._get_service_name(),
|
|
842
|
+
identifier,
|
|
843
|
+
)
|
|
844
|
+
return None
|
|
845
|
+
if result:
|
|
846
|
+
return result
|
|
847
|
+
logger.info(
|
|
848
|
+
"No results generated for %s identifier: %s",
|
|
849
|
+
self._get_service_name(),
|
|
850
|
+
identifier,
|
|
851
|
+
)
|
|
852
|
+
return None
|
|
853
|
+
except FuturesTimeoutError as exc:
|
|
854
|
+
self._last_extractor_run_stats = {"total": 1, "failed": 1, "timed_out": 1}
|
|
855
|
+
error_msg = (
|
|
856
|
+
f"Extractor timed out after {EXTRACTOR_TIMEOUT_SECONDS} seconds "
|
|
857
|
+
f"for {self._get_service_name()} identifier={identifier}"
|
|
858
|
+
)
|
|
859
|
+
logger.error(error_msg)
|
|
860
|
+
self._fail_active_extraction_runs(
|
|
861
|
+
extractor_kind=get_extractor_name(extractor_config),
|
|
862
|
+
last_error=error_msg,
|
|
863
|
+
)
|
|
864
|
+
raise ExtractorExecutionError(error_msg) from exc
|
|
865
|
+
except Exception as exc:
|
|
866
|
+
self._last_extractor_run_stats = {"total": 1, "failed": 1, "timed_out": 0}
|
|
867
|
+
error_msg = (
|
|
868
|
+
f"Extractor failed for {self._get_service_name()} "
|
|
869
|
+
f"identifier={identifier}: {exc} (type={type(exc).__name__})"
|
|
870
|
+
)
|
|
871
|
+
logger.error(error_msg)
|
|
872
|
+
raise ExtractorExecutionError(error_msg) from exc
|
|
873
|
+
finally:
|
|
874
|
+
if executor is not None:
|
|
875
|
+
executor.shutdown(wait=False, cancel_futures=True)
|
|
876
|
+
|
|
877
|
+
def _fail_active_extraction_runs(
|
|
878
|
+
self,
|
|
879
|
+
*,
|
|
880
|
+
extractor_kind: str,
|
|
881
|
+
last_error: str,
|
|
882
|
+
) -> None:
|
|
883
|
+
"""Mark active agent-run rows failed when the service timeout fires."""
|
|
884
|
+
if self.storage is None or self.service_config is None:
|
|
885
|
+
return
|
|
886
|
+
request_id = getattr(self.service_config, "request_id", None)
|
|
887
|
+
if not request_id:
|
|
888
|
+
return
|
|
889
|
+
user_id = getattr(self.service_config, "user_id", None)
|
|
890
|
+
try:
|
|
891
|
+
failed_count = self.storage.fail_running_agent_runs_for_request(
|
|
892
|
+
org_id=self.request_context.org_id,
|
|
893
|
+
extractor_kind=extractor_kind,
|
|
894
|
+
user_id=user_id,
|
|
895
|
+
request_id=request_id,
|
|
896
|
+
last_error=last_error,
|
|
897
|
+
)
|
|
898
|
+
except NotImplementedError:
|
|
899
|
+
return
|
|
900
|
+
except Exception as exc: # noqa: BLE001 - keep timeout error primary
|
|
901
|
+
logger.warning(
|
|
902
|
+
"Failed to mark timed-out %s agent runs failed: %s",
|
|
903
|
+
extractor_kind,
|
|
904
|
+
exc,
|
|
905
|
+
)
|
|
906
|
+
return
|
|
907
|
+
if failed_count:
|
|
908
|
+
logger.warning(
|
|
909
|
+
"Marked %d timed-out %s agent run(s) failed for request_id=%s",
|
|
910
|
+
failed_count,
|
|
911
|
+
extractor_kind,
|
|
912
|
+
request_id,
|
|
913
|
+
)
|
|
914
|
+
|
|
915
|
+
def _finalize_extraction_runs(self) -> None:
|
|
916
|
+
if self.storage is None:
|
|
917
|
+
return
|
|
918
|
+
for run_id in self._last_extraction_run_ids:
|
|
919
|
+
run = self.storage.get_agent_run(run_id)
|
|
920
|
+
if run is None:
|
|
921
|
+
continue
|
|
922
|
+
status = (
|
|
923
|
+
AgentRunStatus.FINALIZED_PENDING_TOOL
|
|
924
|
+
if run.pending_tool_call_ids
|
|
925
|
+
else AgentRunStatus.FINALIZED
|
|
926
|
+
)
|
|
927
|
+
self.storage.update_agent_run_status(
|
|
928
|
+
run_id,
|
|
929
|
+
status,
|
|
930
|
+
pending_tool_call_ids=run.pending_tool_call_ids,
|
|
931
|
+
)
|
|
932
|
+
|
|
933
|
+
def _mark_extraction_runs_finalization_failed(self, exc: Exception) -> None:
|
|
934
|
+
if self.storage is None:
|
|
935
|
+
return
|
|
936
|
+
root_config = self.request_context.configurator.get_config()
|
|
937
|
+
pending_config = getattr(root_config, "pending_tool_call_config", None)
|
|
938
|
+
for run_id in self._last_extraction_run_ids:
|
|
939
|
+
run = self.storage.get_agent_run(run_id)
|
|
940
|
+
if run is None or run.committed_output is None:
|
|
941
|
+
continue
|
|
942
|
+
next_attempt_count = run.finalization_attempts + 1
|
|
943
|
+
max_attempts = (
|
|
944
|
+
pending_config.max_finalization_attempts
|
|
945
|
+
if pending_config is not None
|
|
946
|
+
else 3
|
|
947
|
+
)
|
|
948
|
+
status = (
|
|
949
|
+
AgentRunStatus.FAILED
|
|
950
|
+
if next_attempt_count >= max_attempts
|
|
951
|
+
else AgentRunStatus.FINALIZATION_FAILED
|
|
952
|
+
)
|
|
953
|
+
delay_seconds = min(300, max(1, 2 ** max(0, next_attempt_count - 1)))
|
|
954
|
+
self.storage.update_agent_run_status(
|
|
955
|
+
run_id,
|
|
956
|
+
status,
|
|
957
|
+
next_resume_at=datetime.now(UTC) + timedelta(seconds=delay_seconds),
|
|
958
|
+
last_error=str(exc),
|
|
959
|
+
increment_finalization_attempts=True,
|
|
960
|
+
)
|
|
961
|
+
|
|
962
|
+
def _should_run_before_extraction(self, extractor_config: TExtractorConfig) -> bool:
|
|
963
|
+
"""
|
|
964
|
+
Pre-extraction check called before extractor execution.
|
|
965
|
+
|
|
966
|
+
Template method that:
|
|
967
|
+
1. Skips for non-auto runs and mock mode
|
|
968
|
+
2. Returns True immediately when service_config.force_extraction=True
|
|
969
|
+
(bypasses cheap pre-filter and LLM should_run vote)
|
|
970
|
+
3. Collects scoped interactions via _collect_scoped_interactions_for_precheck
|
|
971
|
+
4. Delegates prompt building to _build_should_run_prompt (subclass hook)
|
|
972
|
+
5. Makes a single LLM call to determine if extraction should proceed
|
|
973
|
+
|
|
974
|
+
Override _build_should_run_prompt in subclasses to provide service-specific
|
|
975
|
+
criteria and prompt construction. Default returns True (always run) when
|
|
976
|
+
no prompt hook is provided.
|
|
977
|
+
|
|
978
|
+
Args:
|
|
979
|
+
extractor_config: Enabled extractor config that will be run
|
|
980
|
+
|
|
981
|
+
Returns:
|
|
982
|
+
bool: True if extraction should proceed, False to skip
|
|
983
|
+
"""
|
|
984
|
+
# Skip for non-auto runs (rerun/manual flows always run)
|
|
985
|
+
if not getattr(self.service_config, "auto_run", True):
|
|
986
|
+
return True
|
|
987
|
+
|
|
988
|
+
# Skip for mock mode
|
|
989
|
+
if os.getenv("MOCK_LLM_RESPONSE", "").lower() == "true":
|
|
990
|
+
return True
|
|
991
|
+
|
|
992
|
+
# `force_extraction=True` is the caller's explicit "no gates" signal —
|
|
993
|
+
# corrections, manual /learn, anything time-sensitive. Bypass the
|
|
994
|
+
# cheap pre-filter (slash-only / too-short rejects) and the LLM
|
|
995
|
+
# should_run vote so the extractor always runs on this batch.
|
|
996
|
+
if getattr(self.service_config, "force_extraction", False):
|
|
997
|
+
return True
|
|
998
|
+
|
|
999
|
+
# Skip if org config disables the pre-extraction check
|
|
1000
|
+
root_config = self.request_context.configurator.get_config()
|
|
1001
|
+
if root_config and root_config.skip_should_run_check:
|
|
1002
|
+
logger.info(
|
|
1003
|
+
"skip_should_run_check is enabled for %s, bypassing pre-extraction check",
|
|
1004
|
+
self._get_service_name(),
|
|
1005
|
+
)
|
|
1006
|
+
return True
|
|
1007
|
+
|
|
1008
|
+
# Collect scoped interactions
|
|
1009
|
+
session_data_models, scoped_config = (
|
|
1010
|
+
self._collect_scoped_interactions_for_precheck(extractor_config)
|
|
1011
|
+
)
|
|
1012
|
+
if not session_data_models:
|
|
1013
|
+
logger.info(
|
|
1014
|
+
"No interactions found for consolidated should_generate check for %s",
|
|
1015
|
+
self._get_service_name(),
|
|
1016
|
+
)
|
|
1017
|
+
return False
|
|
1018
|
+
|
|
1019
|
+
# Cheap pre-filter: reject batches that are structurally unable
|
|
1020
|
+
# to yield signal (slash-commands only, too-short user turns,
|
|
1021
|
+
# extractor-prompt echoes) without burning a 5–7s LLM call. See
|
|
1022
|
+
# _cheap_should_run_reject for the rule set.
|
|
1023
|
+
reject_reason = _cheap_should_run_reject(session_data_models)
|
|
1024
|
+
if reject_reason is not None:
|
|
1025
|
+
logger.info(
|
|
1026
|
+
"Cheap pre-filter rejected %s should_run: reason=%s identifier=%s",
|
|
1027
|
+
self._get_service_name(),
|
|
1028
|
+
reject_reason,
|
|
1029
|
+
getattr(self.service_config, "user_id", None) or "unknown",
|
|
1030
|
+
)
|
|
1031
|
+
return False
|
|
1032
|
+
|
|
1033
|
+
# Build prompt via subclass hook
|
|
1034
|
+
prompt = self._build_should_run_prompt(scoped_config, session_data_models)
|
|
1035
|
+
if not prompt:
|
|
1036
|
+
return True # No prompt means no check needed, proceed
|
|
1037
|
+
|
|
1038
|
+
# Resolve model and make LLM call
|
|
1039
|
+
should_run_model = self._resolve_should_run_model()
|
|
1040
|
+
identifier = getattr(self.service_config, "user_id", None) or "unknown"
|
|
1041
|
+
try:
|
|
1042
|
+
should_start = time.perf_counter()
|
|
1043
|
+
logger.info(
|
|
1044
|
+
"event=consolidated_should_run_start service=%s identifier=%s model=%s extractor=%s",
|
|
1045
|
+
self._get_service_name(),
|
|
1046
|
+
identifier,
|
|
1047
|
+
should_run_model,
|
|
1048
|
+
get_extractor_name(extractor_config),
|
|
1049
|
+
)
|
|
1050
|
+
log_llm_messages(
|
|
1051
|
+
logger,
|
|
1052
|
+
"Should extract check",
|
|
1053
|
+
[{"role": "user", "content": prompt}],
|
|
1054
|
+
)
|
|
1055
|
+
|
|
1056
|
+
content = self.client.generate_chat_response(
|
|
1057
|
+
messages=[{"role": "user", "content": prompt}],
|
|
1058
|
+
model=should_run_model,
|
|
1059
|
+
)
|
|
1060
|
+
log_model_response(
|
|
1061
|
+
logger,
|
|
1062
|
+
f"Consolidated {self._get_service_name()} should_run response",
|
|
1063
|
+
content,
|
|
1064
|
+
)
|
|
1065
|
+
decision = bool(content and "true" in content.lower()) # type: ignore[reportAttributeAccessIssue]
|
|
1066
|
+
logger.info(
|
|
1067
|
+
"event=consolidated_should_run_end service=%s identifier=%s elapsed_seconds=%.3f decision=%s",
|
|
1068
|
+
self._get_service_name(),
|
|
1069
|
+
identifier,
|
|
1070
|
+
time.perf_counter() - should_start,
|
|
1071
|
+
decision,
|
|
1072
|
+
)
|
|
1073
|
+
return decision
|
|
1074
|
+
except Exception as exc:
|
|
1075
|
+
logger.error(
|
|
1076
|
+
"Consolidated should_generate check failed for %s: %s, defaulting to run",
|
|
1077
|
+
self._get_service_name(),
|
|
1078
|
+
str(exc),
|
|
1079
|
+
)
|
|
1080
|
+
return True
|
|
1081
|
+
|
|
1082
|
+
def _build_should_run_prompt(
|
|
1083
|
+
self,
|
|
1084
|
+
scoped_config: TExtractorConfig, # noqa: ARG002
|
|
1085
|
+
session_data_models: list[RequestInteractionDataModel], # noqa: ARG002
|
|
1086
|
+
) -> str | None:
|
|
1087
|
+
"""
|
|
1088
|
+
Build the prompt for the consolidated should_run LLM check.
|
|
1089
|
+
|
|
1090
|
+
Override in subclasses to provide service-specific criteria building
|
|
1091
|
+
and prompt rendering. Return None if no check is needed (always proceed).
|
|
1092
|
+
|
|
1093
|
+
Args:
|
|
1094
|
+
scoped_config: Extractor config that had scoped interactions
|
|
1095
|
+
session_data_models: Deduplicated request interaction data models
|
|
1096
|
+
|
|
1097
|
+
Returns:
|
|
1098
|
+
Optional[str]: The rendered prompt string, or None to skip the check
|
|
1099
|
+
"""
|
|
1100
|
+
return None
|
|
1101
|
+
|
|
1102
|
+
def _collect_scoped_interactions_for_precheck(
|
|
1103
|
+
self, extractor_config: TExtractorConfig
|
|
1104
|
+
) -> tuple[list[RequestInteractionDataModel], TExtractorConfig]:
|
|
1105
|
+
"""
|
|
1106
|
+
Collect interactions for consolidated pre-check using extractor-scoped filters.
|
|
1107
|
+
|
|
1108
|
+
Mirrors each extractor's source/window scope so the consolidated gate
|
|
1109
|
+
does not skip valid extraction because of an unrelated fixed interaction slice.
|
|
1110
|
+
|
|
1111
|
+
Args:
|
|
1112
|
+
extractor_config: Enabled extractor config after request-level filtering
|
|
1113
|
+
|
|
1114
|
+
Returns:
|
|
1115
|
+
tuple: (session data models, extractor config)
|
|
1116
|
+
"""
|
|
1117
|
+
root_config = self.request_context.configurator.get_config()
|
|
1118
|
+
global_window_size = (
|
|
1119
|
+
getattr(root_config, "window_size", None) if root_config else None
|
|
1120
|
+
)
|
|
1121
|
+
global_stride_size = (
|
|
1122
|
+
getattr(root_config, "stride_size", None) if root_config else None
|
|
1123
|
+
)
|
|
1124
|
+
|
|
1125
|
+
extra_kwargs = self._get_precheck_interaction_query_kwargs()
|
|
1126
|
+
|
|
1127
|
+
should_skip, effective_source = get_effective_source_filter(
|
|
1128
|
+
extractor_config, getattr(self.service_config, "source", None)
|
|
1129
|
+
)
|
|
1130
|
+
if should_skip:
|
|
1131
|
+
return [], extractor_config
|
|
1132
|
+
|
|
1133
|
+
window_size, _ = get_extractor_window_params(
|
|
1134
|
+
extractor_config, global_window_size, global_stride_size
|
|
1135
|
+
)
|
|
1136
|
+
session_data_models, _ = self.storage.get_last_k_interactions_grouped( # type: ignore[reportOptionalMemberAccess]
|
|
1137
|
+
user_id=getattr(self.service_config, "user_id", None),
|
|
1138
|
+
k=window_size,
|
|
1139
|
+
sources=effective_source,
|
|
1140
|
+
start_time=getattr(self.service_config, "rerun_start_time", None),
|
|
1141
|
+
end_time=getattr(self.service_config, "rerun_end_time", None),
|
|
1142
|
+
**extra_kwargs,
|
|
1143
|
+
)
|
|
1144
|
+
|
|
1145
|
+
return session_data_models, extractor_config
|
|
1146
|
+
|
|
1147
|
+
def _get_precheck_interaction_query_kwargs(self) -> dict:
|
|
1148
|
+
"""
|
|
1149
|
+
Return extra keyword arguments for get_last_k_interactions_grouped in precheck.
|
|
1150
|
+
|
|
1151
|
+
Override in subclasses that need additional query parameters
|
|
1152
|
+
(e.g., agent_version for playbook services).
|
|
1153
|
+
|
|
1154
|
+
Returns:
|
|
1155
|
+
dict: Extra kwargs to pass to get_last_k_interactions_grouped
|
|
1156
|
+
"""
|
|
1157
|
+
return {}
|
|
1158
|
+
|
|
1159
|
+
def _resolve_should_run_model(self) -> str:
|
|
1160
|
+
"""
|
|
1161
|
+
Resolve the model name for should_run/should_generate LLM checks.
|
|
1162
|
+
|
|
1163
|
+
Uses LLM config override if available, falls back to site var setting.
|
|
1164
|
+
|
|
1165
|
+
Returns:
|
|
1166
|
+
str: Model name for the should_run check
|
|
1167
|
+
"""
|
|
1168
|
+
from reflexio.server.llm.model_defaults import ModelRole, resolve_model_name
|
|
1169
|
+
from reflexio.server.site_var.site_var_manager import SiteVarManager
|
|
1170
|
+
|
|
1171
|
+
root_config = self.request_context.configurator.get_config()
|
|
1172
|
+
llm_config = root_config.llm_config if root_config else None
|
|
1173
|
+
api_key_config = root_config.api_key_config if root_config else None
|
|
1174
|
+
|
|
1175
|
+
model_setting = SiteVarManager().get_site_var("llm_model_setting")
|
|
1176
|
+
site_var = model_setting if isinstance(model_setting, dict) else {}
|
|
1177
|
+
|
|
1178
|
+
return resolve_model_name(
|
|
1179
|
+
ModelRole.SHOULD_RUN,
|
|
1180
|
+
site_var_value=site_var.get("should_run_model_name"),
|
|
1181
|
+
config_override=llm_config.should_run_model_name if llm_config else None,
|
|
1182
|
+
api_key_config=api_key_config,
|
|
1183
|
+
)
|
|
1184
|
+
|
|
1185
|
+
# ===============================
|
|
1186
|
+
# Batch with progress (shared by rerun + manual)
|
|
1187
|
+
# ===============================
|
|
1188
|
+
|
|
1189
|
+
def _run_batch_with_progress(
|
|
1190
|
+
self,
|
|
1191
|
+
user_ids: list[str],
|
|
1192
|
+
request: TRequest,
|
|
1193
|
+
request_params: dict,
|
|
1194
|
+
state_manager: OperationStateManager,
|
|
1195
|
+
) -> tuple[int, int]:
|
|
1196
|
+
"""Run a batch of users with progress tracking.
|
|
1197
|
+
|
|
1198
|
+
Shared logic for both run_rerun() and run_manual_regular().
|
|
1199
|
+
Initializes progress, processes each user, and finalizes.
|
|
1200
|
+
Checks for cancellation before each user.
|
|
1201
|
+
|
|
1202
|
+
Args:
|
|
1203
|
+
user_ids: List of user IDs to process
|
|
1204
|
+
request: The original request object
|
|
1205
|
+
request_params: Parameters dict for progress state
|
|
1206
|
+
state_manager: OperationStateManager instance
|
|
1207
|
+
|
|
1208
|
+
Returns:
|
|
1209
|
+
Tuple of (users_processed, total_generated)
|
|
1210
|
+
"""
|
|
1211
|
+
total_users = len(user_ids)
|
|
1212
|
+
self._is_batch_mode = True
|
|
1213
|
+
|
|
1214
|
+
# Initialize progress
|
|
1215
|
+
state_manager.initialize_progress(
|
|
1216
|
+
total_users=total_users,
|
|
1217
|
+
request_params=request_params,
|
|
1218
|
+
)
|
|
1219
|
+
|
|
1220
|
+
try:
|
|
1221
|
+
# Process each user
|
|
1222
|
+
users_processed = 0
|
|
1223
|
+
processed_user_ids: list[str] = []
|
|
1224
|
+
for user_id in user_ids:
|
|
1225
|
+
# Check for cancellation before starting next user
|
|
1226
|
+
if state_manager.is_cancellation_requested():
|
|
1227
|
+
logger.info(
|
|
1228
|
+
"Cancellation requested for %s, stopping after %d/%d users",
|
|
1229
|
+
self._get_base_service_name(),
|
|
1230
|
+
users_processed,
|
|
1231
|
+
total_users,
|
|
1232
|
+
)
|
|
1233
|
+
state_manager.mark_cancelled()
|
|
1234
|
+
return users_processed, self._get_generated_count(
|
|
1235
|
+
request, processed_user_ids=processed_user_ids
|
|
1236
|
+
)
|
|
1237
|
+
|
|
1238
|
+
state_manager.set_current_item(user_id)
|
|
1239
|
+
|
|
1240
|
+
try:
|
|
1241
|
+
run_request = self._create_run_request_for_item(user_id, request)
|
|
1242
|
+
self.run(run_request)
|
|
1243
|
+
users_processed += 1
|
|
1244
|
+
processed_user_ids.append(user_id)
|
|
1245
|
+
|
|
1246
|
+
state_manager.update_progress(
|
|
1247
|
+
item_id=user_id,
|
|
1248
|
+
count=0, # Extractors collect their own data
|
|
1249
|
+
success=True,
|
|
1250
|
+
total_users=total_users,
|
|
1251
|
+
)
|
|
1252
|
+
|
|
1253
|
+
except Exception as e:
|
|
1254
|
+
logger.error(
|
|
1255
|
+
"Failed to process user %s for %s: %s",
|
|
1256
|
+
user_id,
|
|
1257
|
+
self._get_base_service_name(),
|
|
1258
|
+
str(e),
|
|
1259
|
+
)
|
|
1260
|
+
state_manager.update_progress(
|
|
1261
|
+
item_id=user_id,
|
|
1262
|
+
count=0,
|
|
1263
|
+
success=False,
|
|
1264
|
+
total_users=total_users,
|
|
1265
|
+
error=str(e),
|
|
1266
|
+
)
|
|
1267
|
+
continue
|
|
1268
|
+
|
|
1269
|
+
# Get generated count and finalize
|
|
1270
|
+
total_generated = self._get_generated_count(
|
|
1271
|
+
request, processed_user_ids=processed_user_ids
|
|
1272
|
+
)
|
|
1273
|
+
state_manager.finalize_progress(users_processed, total_generated)
|
|
1274
|
+
|
|
1275
|
+
return users_processed, total_generated
|
|
1276
|
+
finally:
|
|
1277
|
+
self._is_batch_mode = False
|
|
1278
|
+
|
|
1279
|
+
# ===============================
|
|
1280
|
+
# Rerun methods (optional - override to enable rerun functionality)
|
|
1281
|
+
# ===============================
|
|
1282
|
+
|
|
1283
|
+
def _get_rerun_user_ids(self, request: TRequest) -> list[str]:
|
|
1284
|
+
"""Get user IDs to process during rerun.
|
|
1285
|
+
|
|
1286
|
+
Override this method to enable rerun functionality for the service.
|
|
1287
|
+
Returns a list of user IDs that have interactions matching the request filters.
|
|
1288
|
+
Each extractor collects its own data using its configured window_size.
|
|
1289
|
+
|
|
1290
|
+
Args:
|
|
1291
|
+
request: The rerun request object
|
|
1292
|
+
|
|
1293
|
+
Returns:
|
|
1294
|
+
List of user IDs to process
|
|
1295
|
+
"""
|
|
1296
|
+
raise NotImplementedError("Rerun not supported by this service")
|
|
1297
|
+
|
|
1298
|
+
def _build_rerun_request_params(self, request: TRequest) -> dict:
|
|
1299
|
+
"""Build request params dict for operation state tracking.
|
|
1300
|
+
|
|
1301
|
+
Override this method to enable rerun functionality for the service.
|
|
1302
|
+
|
|
1303
|
+
Args:
|
|
1304
|
+
request: The rerun request object
|
|
1305
|
+
|
|
1306
|
+
Returns:
|
|
1307
|
+
Dictionary of request parameters for state tracking
|
|
1308
|
+
"""
|
|
1309
|
+
raise NotImplementedError("Rerun not supported by this service")
|
|
1310
|
+
|
|
1311
|
+
def _create_run_request_for_item(self, user_id: str, request: TRequest) -> TRequest:
|
|
1312
|
+
"""Create the request object to pass to self.run() for a single user.
|
|
1313
|
+
|
|
1314
|
+
Override this method to enable rerun functionality for the service.
|
|
1315
|
+
Each extractor collects its own data using its configured window_size.
|
|
1316
|
+
|
|
1317
|
+
Args:
|
|
1318
|
+
user_id: The user ID to process
|
|
1319
|
+
request: The original rerun request object
|
|
1320
|
+
|
|
1321
|
+
Returns:
|
|
1322
|
+
A request object suitable for self.run()
|
|
1323
|
+
"""
|
|
1324
|
+
raise NotImplementedError("Rerun not supported by this service")
|
|
1325
|
+
|
|
1326
|
+
def _create_rerun_response(self, success: bool, msg: str, count: int) -> Any:
|
|
1327
|
+
"""Create the rerun response object.
|
|
1328
|
+
|
|
1329
|
+
Override this method to enable rerun functionality for the service.
|
|
1330
|
+
|
|
1331
|
+
Args:
|
|
1332
|
+
success: Whether the operation succeeded
|
|
1333
|
+
msg: Status message
|
|
1334
|
+
count: Number of items generated
|
|
1335
|
+
|
|
1336
|
+
Returns:
|
|
1337
|
+
A response object (e.g., RerunProfileGenerationResponse)
|
|
1338
|
+
"""
|
|
1339
|
+
raise NotImplementedError("Rerun not supported by this service")
|
|
1340
|
+
|
|
1341
|
+
def _get_generated_count(
|
|
1342
|
+
self,
|
|
1343
|
+
request: TRequest,
|
|
1344
|
+
processed_user_ids: list[str] | None = None,
|
|
1345
|
+
) -> int:
|
|
1346
|
+
"""Get the count of generated items (profiles or playbooks) after rerun.
|
|
1347
|
+
|
|
1348
|
+
Override this method to enable rerun functionality for the service.
|
|
1349
|
+
|
|
1350
|
+
Args:
|
|
1351
|
+
request: The rerun request object (for filtering)
|
|
1352
|
+
processed_user_ids: List of user IDs that were successfully processed
|
|
1353
|
+
in the batch. Provided by _run_batch_with_progress so overrides
|
|
1354
|
+
don't need to handle user_id=None from batch requests.
|
|
1355
|
+
|
|
1356
|
+
Returns:
|
|
1357
|
+
Number of items generated during rerun
|
|
1358
|
+
"""
|
|
1359
|
+
raise NotImplementedError("Rerun not supported by this service")
|
|
1360
|
+
|
|
1361
|
+
def _pre_process_rerun(self, request: TRequest) -> None: # noqa: B027
|
|
1362
|
+
"""Hook called before processing rerun items.
|
|
1363
|
+
|
|
1364
|
+
Override in subclasses to perform cleanup or preparation before rerun.
|
|
1365
|
+
Default implementation does nothing.
|
|
1366
|
+
|
|
1367
|
+
Args:
|
|
1368
|
+
request: The rerun request object
|
|
1369
|
+
"""
|
|
1370
|
+
|
|
1371
|
+
def run_rerun(self, request: TRequest) -> Any:
|
|
1372
|
+
"""Run the rerun workflow for the service.
|
|
1373
|
+
|
|
1374
|
+
This template method orchestrates the rerun process:
|
|
1375
|
+
1. Check for existing in-progress operations
|
|
1376
|
+
2. Get user IDs to process
|
|
1377
|
+
3. Pre-process hook
|
|
1378
|
+
4. Run batch with progress tracking
|
|
1379
|
+
5. Return response
|
|
1380
|
+
|
|
1381
|
+
Child classes must implement the hook methods to enable rerun functionality:
|
|
1382
|
+
- _get_rerun_user_ids()
|
|
1383
|
+
- _build_rerun_request_params()
|
|
1384
|
+
- _create_run_request_for_item()
|
|
1385
|
+
- _create_rerun_response()
|
|
1386
|
+
|
|
1387
|
+
Args:
|
|
1388
|
+
request: The rerun request object
|
|
1389
|
+
|
|
1390
|
+
Returns:
|
|
1391
|
+
A response object with success status, message, and count
|
|
1392
|
+
"""
|
|
1393
|
+
state_manager = self._create_state_manager()
|
|
1394
|
+
|
|
1395
|
+
try:
|
|
1396
|
+
# 1. Check for existing in-progress operation
|
|
1397
|
+
error = state_manager.check_in_progress()
|
|
1398
|
+
if error:
|
|
1399
|
+
return self._create_rerun_response(False, error, 0)
|
|
1400
|
+
|
|
1401
|
+
# 2. Get user IDs to process
|
|
1402
|
+
user_ids = self._get_rerun_user_ids(request)
|
|
1403
|
+
if not user_ids:
|
|
1404
|
+
return self._create_rerun_response(
|
|
1405
|
+
False, "No interactions found matching the specified filters", 0
|
|
1406
|
+
)
|
|
1407
|
+
|
|
1408
|
+
# 3. Pre-process hook (e.g., delete existing pending items)
|
|
1409
|
+
self._pre_process_rerun(request)
|
|
1410
|
+
|
|
1411
|
+
# 4. Run batch with progress tracking
|
|
1412
|
+
users_processed, total_generated = self._run_batch_with_progress(
|
|
1413
|
+
user_ids=user_ids,
|
|
1414
|
+
request=request,
|
|
1415
|
+
request_params=self._build_rerun_request_params(request),
|
|
1416
|
+
state_manager=state_manager,
|
|
1417
|
+
)
|
|
1418
|
+
|
|
1419
|
+
msg = f"Completed for {users_processed} user(s)"
|
|
1420
|
+
return self._create_rerun_response(True, msg, total_generated)
|
|
1421
|
+
|
|
1422
|
+
except Exception as e:
|
|
1423
|
+
state_manager.mark_progress_failed(str(e))
|
|
1424
|
+
return self._create_rerun_response(
|
|
1425
|
+
False,
|
|
1426
|
+
f"Failed to run {self._get_base_service_name()}: {str(e)}",
|
|
1427
|
+
0,
|
|
1428
|
+
)
|
|
1429
|
+
|
|
1430
|
+
# ===============================
|
|
1431
|
+
# Upgrade/Downgrade methods (optional - override to enable)
|
|
1432
|
+
# ===============================
|
|
1433
|
+
|
|
1434
|
+
def _has_items_with_status(self, status: Status | None, request: TRequest) -> bool:
|
|
1435
|
+
"""Check if items exist with given status and filters from request.
|
|
1436
|
+
|
|
1437
|
+
Override this method to enable upgrade/downgrade functionality for the service.
|
|
1438
|
+
|
|
1439
|
+
Args:
|
|
1440
|
+
status: The status to check for (None for CURRENT)
|
|
1441
|
+
request: The upgrade/downgrade request object with filters
|
|
1442
|
+
|
|
1443
|
+
Returns:
|
|
1444
|
+
bool: True if any matching items exist
|
|
1445
|
+
"""
|
|
1446
|
+
raise NotImplementedError("Upgrade/downgrade not supported by this service")
|
|
1447
|
+
|
|
1448
|
+
def _delete_items_by_status(self, status: Status, request: TRequest) -> int:
|
|
1449
|
+
"""Delete items with given status matching request filters.
|
|
1450
|
+
|
|
1451
|
+
Override this method to enable upgrade/downgrade functionality for the service.
|
|
1452
|
+
|
|
1453
|
+
Args:
|
|
1454
|
+
status: The status of items to delete
|
|
1455
|
+
request: The upgrade/downgrade request object with filters
|
|
1456
|
+
|
|
1457
|
+
Returns:
|
|
1458
|
+
int: Number of items deleted
|
|
1459
|
+
"""
|
|
1460
|
+
raise NotImplementedError("Upgrade/downgrade not supported by this service")
|
|
1461
|
+
|
|
1462
|
+
def _update_items_status(
|
|
1463
|
+
self,
|
|
1464
|
+
old_status: Status | None,
|
|
1465
|
+
new_status: Status | None,
|
|
1466
|
+
request: TRequest,
|
|
1467
|
+
user_ids: list[str] | None = None,
|
|
1468
|
+
) -> int:
|
|
1469
|
+
"""Update items from old_status to new_status with request filters.
|
|
1470
|
+
|
|
1471
|
+
Override this method to enable upgrade/downgrade functionality for the service.
|
|
1472
|
+
|
|
1473
|
+
Args:
|
|
1474
|
+
old_status: The current status to match (None for CURRENT)
|
|
1475
|
+
new_status: The new status to set (None for CURRENT)
|
|
1476
|
+
request: The upgrade/downgrade request object with filters
|
|
1477
|
+
user_ids: Optional pre-computed list of user IDs to filter by
|
|
1478
|
+
|
|
1479
|
+
Returns:
|
|
1480
|
+
int: Number of items updated
|
|
1481
|
+
"""
|
|
1482
|
+
raise NotImplementedError("Upgrade/downgrade not supported by this service")
|
|
1483
|
+
|
|
1484
|
+
def _get_affected_user_ids_for_upgrade(self, request: TRequest) -> list[str] | None: # noqa: ARG002
|
|
1485
|
+
"""Get user IDs to filter by for upgrade operations.
|
|
1486
|
+
|
|
1487
|
+
Override this method to support the only_affected_users flag.
|
|
1488
|
+
By default returns None (no filtering).
|
|
1489
|
+
|
|
1490
|
+
Args:
|
|
1491
|
+
request: The upgrade request object
|
|
1492
|
+
|
|
1493
|
+
Returns:
|
|
1494
|
+
Optional[list[str]]: List of user IDs to filter by, or None for no filtering
|
|
1495
|
+
"""
|
|
1496
|
+
return None
|
|
1497
|
+
|
|
1498
|
+
def _get_affected_user_ids_for_downgrade(
|
|
1499
|
+
self,
|
|
1500
|
+
request: TRequest, # noqa: ARG002
|
|
1501
|
+
) -> list[str] | None:
|
|
1502
|
+
"""Get user IDs to filter by for downgrade operations.
|
|
1503
|
+
|
|
1504
|
+
Override this method to support the only_affected_users flag.
|
|
1505
|
+
By default returns None (no filtering).
|
|
1506
|
+
|
|
1507
|
+
Args:
|
|
1508
|
+
request: The downgrade request object
|
|
1509
|
+
|
|
1510
|
+
Returns:
|
|
1511
|
+
Optional[list[str]]: List of user IDs to filter by, or None for no filtering
|
|
1512
|
+
"""
|
|
1513
|
+
return None
|
|
1514
|
+
|
|
1515
|
+
def _create_status_change_response(
|
|
1516
|
+
self,
|
|
1517
|
+
operation: StatusChangeOperation,
|
|
1518
|
+
success: bool,
|
|
1519
|
+
counts: dict,
|
|
1520
|
+
msg: str,
|
|
1521
|
+
) -> Any:
|
|
1522
|
+
"""Create upgrade or downgrade response object based on operation type.
|
|
1523
|
+
|
|
1524
|
+
Override this method to enable upgrade/downgrade functionality for the service.
|
|
1525
|
+
|
|
1526
|
+
Args:
|
|
1527
|
+
operation: The operation type (UPGRADE or DOWNGRADE)
|
|
1528
|
+
success: Whether the operation succeeded
|
|
1529
|
+
counts: Dictionary of counts (upgrade: deleted/archived/promoted, downgrade: demoted/restored)
|
|
1530
|
+
msg: Status message
|
|
1531
|
+
|
|
1532
|
+
Returns:
|
|
1533
|
+
A response object (e.g., UpgradeProfilesResponse, DowngradeUserPlaybooksResponse)
|
|
1534
|
+
"""
|
|
1535
|
+
raise NotImplementedError("Upgrade/downgrade not supported by this service")
|
|
1536
|
+
|
|
1537
|
+
def run_upgrade(self, request: TRequest) -> Any:
|
|
1538
|
+
"""Run the upgrade workflow for the service.
|
|
1539
|
+
|
|
1540
|
+
This template method orchestrates the upgrade process:
|
|
1541
|
+
1. Validate that pending items exist
|
|
1542
|
+
2. Delete old archived items
|
|
1543
|
+
3. Archive current items (None → ARCHIVED)
|
|
1544
|
+
4. Promote pending items (PENDING → None/CURRENT)
|
|
1545
|
+
|
|
1546
|
+
Child classes must implement the hook methods to enable upgrade functionality:
|
|
1547
|
+
- _has_items_with_status()
|
|
1548
|
+
- _delete_items_by_status()
|
|
1549
|
+
- _update_items_status()
|
|
1550
|
+
- _create_status_change_response()
|
|
1551
|
+
|
|
1552
|
+
Args:
|
|
1553
|
+
request: The upgrade request object with optional filters
|
|
1554
|
+
|
|
1555
|
+
Returns:
|
|
1556
|
+
A response object with success status, counts, and message
|
|
1557
|
+
"""
|
|
1558
|
+
try:
|
|
1559
|
+
# 1. Validate pending items exist
|
|
1560
|
+
if not self._has_items_with_status(Status.PENDING, request):
|
|
1561
|
+
return self._create_status_change_response(
|
|
1562
|
+
StatusChangeOperation.UPGRADE,
|
|
1563
|
+
False,
|
|
1564
|
+
{"deleted": 0, "archived": 0, "promoted": 0},
|
|
1565
|
+
"No pending items found to upgrade",
|
|
1566
|
+
)
|
|
1567
|
+
|
|
1568
|
+
# Get affected user IDs once (child class determines the logic)
|
|
1569
|
+
affected_user_ids = self._get_affected_user_ids_for_upgrade(request)
|
|
1570
|
+
|
|
1571
|
+
# 2. Delete old archived items (skip if archive_current=False)
|
|
1572
|
+
deleted = 0
|
|
1573
|
+
archived = 0
|
|
1574
|
+
if getattr(request, "archive_current", True):
|
|
1575
|
+
deleted = self._delete_items_by_status(Status.ARCHIVED, request)
|
|
1576
|
+
|
|
1577
|
+
# 3. Archive current items (None → ARCHIVED)
|
|
1578
|
+
archived = self._update_items_status(
|
|
1579
|
+
None, Status.ARCHIVED, request, user_ids=affected_user_ids
|
|
1580
|
+
)
|
|
1581
|
+
|
|
1582
|
+
# 4. Promote pending items (PENDING → None)
|
|
1583
|
+
promoted = self._update_items_status(
|
|
1584
|
+
Status.PENDING, None, request, user_ids=affected_user_ids
|
|
1585
|
+
)
|
|
1586
|
+
|
|
1587
|
+
msg = f"Upgraded: {promoted} promoted, {archived} archived, {deleted} old archived deleted"
|
|
1588
|
+
return self._create_status_change_response(
|
|
1589
|
+
StatusChangeOperation.UPGRADE,
|
|
1590
|
+
True,
|
|
1591
|
+
{"deleted": deleted, "archived": archived, "promoted": promoted},
|
|
1592
|
+
msg,
|
|
1593
|
+
)
|
|
1594
|
+
|
|
1595
|
+
except Exception as e:
|
|
1596
|
+
return self._create_status_change_response(
|
|
1597
|
+
StatusChangeOperation.UPGRADE,
|
|
1598
|
+
False,
|
|
1599
|
+
{"deleted": 0, "archived": 0, "promoted": 0},
|
|
1600
|
+
f"Failed to upgrade: {str(e)}",
|
|
1601
|
+
)
|
|
1602
|
+
|
|
1603
|
+
def run_downgrade(self, request: TRequest) -> Any:
|
|
1604
|
+
"""Run the downgrade workflow for the service.
|
|
1605
|
+
|
|
1606
|
+
This template method orchestrates the downgrade process:
|
|
1607
|
+
1. Validate that archived items exist
|
|
1608
|
+
2. Demote current items (None → ARCHIVE_IN_PROGRESS)
|
|
1609
|
+
3. Restore archived items (ARCHIVED → None/CURRENT)
|
|
1610
|
+
4. Complete archiving (ARCHIVE_IN_PROGRESS → ARCHIVED)
|
|
1611
|
+
|
|
1612
|
+
Child classes must implement the hook methods to enable downgrade functionality:
|
|
1613
|
+
- _has_items_with_status()
|
|
1614
|
+
- _update_items_status()
|
|
1615
|
+
- _create_status_change_response()
|
|
1616
|
+
|
|
1617
|
+
Args:
|
|
1618
|
+
request: The downgrade request object with optional filters
|
|
1619
|
+
|
|
1620
|
+
Returns:
|
|
1621
|
+
A response object with success status, counts, and message
|
|
1622
|
+
"""
|
|
1623
|
+
try:
|
|
1624
|
+
# 1. Validate archived items exist
|
|
1625
|
+
if not self._has_items_with_status(Status.ARCHIVED, request):
|
|
1626
|
+
return self._create_status_change_response(
|
|
1627
|
+
StatusChangeOperation.DOWNGRADE,
|
|
1628
|
+
False,
|
|
1629
|
+
{"demoted": 0, "restored": 0},
|
|
1630
|
+
"No archived items found to restore",
|
|
1631
|
+
)
|
|
1632
|
+
|
|
1633
|
+
# Get affected user IDs once (child class determines the logic)
|
|
1634
|
+
affected_user_ids = self._get_affected_user_ids_for_downgrade(request)
|
|
1635
|
+
|
|
1636
|
+
# 2. Demote current (None → ARCHIVE_IN_PROGRESS)
|
|
1637
|
+
demoted = self._update_items_status(
|
|
1638
|
+
None, Status.ARCHIVE_IN_PROGRESS, request, user_ids=affected_user_ids
|
|
1639
|
+
)
|
|
1640
|
+
|
|
1641
|
+
# 3. Restore archived (ARCHIVED → None)
|
|
1642
|
+
restored = self._update_items_status(
|
|
1643
|
+
Status.ARCHIVED, None, request, user_ids=affected_user_ids
|
|
1644
|
+
)
|
|
1645
|
+
|
|
1646
|
+
# 4. Complete archiving (ARCHIVE_IN_PROGRESS → ARCHIVED)
|
|
1647
|
+
self._update_items_status(
|
|
1648
|
+
Status.ARCHIVE_IN_PROGRESS,
|
|
1649
|
+
Status.ARCHIVED,
|
|
1650
|
+
request,
|
|
1651
|
+
user_ids=affected_user_ids,
|
|
1652
|
+
)
|
|
1653
|
+
|
|
1654
|
+
msg = f"Downgraded: {demoted} archived, {restored} restored"
|
|
1655
|
+
return self._create_status_change_response(
|
|
1656
|
+
StatusChangeOperation.DOWNGRADE,
|
|
1657
|
+
True,
|
|
1658
|
+
{"demoted": demoted, "restored": restored},
|
|
1659
|
+
msg,
|
|
1660
|
+
)
|
|
1661
|
+
|
|
1662
|
+
except Exception as e:
|
|
1663
|
+
return self._create_status_change_response(
|
|
1664
|
+
StatusChangeOperation.DOWNGRADE,
|
|
1665
|
+
False,
|
|
1666
|
+
{"demoted": 0, "restored": 0},
|
|
1667
|
+
f"Failed to downgrade: {str(e)}",
|
|
1668
|
+
)
|