gennady 0.6.0 → 0.7.0
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/README.md +2 -15
- package/ai/agents/agent-resolve-conflicts.xml +6 -0
- package/ai/agents/agent-review-verifier.xml +6 -0
- package/ai/directives/architecture/README.md +21 -0
- package/ai/directives/coding/README.md +23 -0
- package/ai/directives/coding/result-conventions.xml +55 -0
- package/ai/directives/coding/svelte5-runes.xml +248 -0
- package/ai/directives/coding/sveltekit-rules.xml +247 -0
- package/ai/directives/coding/typescript-rules.xml +589 -0
- package/ai/directives/coding/uikit-component-storybook.xml +347 -0
- package/ai/directives/coding/uikit-component-svelte.xml +344 -0
- package/ai/directives/coding/uikit-spec-drafting.xml +243 -0
- package/ai/directives/dbc-audit.directive.xml +131 -0
- package/ai/directives/dev-review.directive.xml +148 -0
- package/ai/directives/infra/README.md +11 -0
- package/ai/directives/infra/eslint-setup.xml +467 -0
- package/ai/directives/infra/git-setup.xml +261 -0
- package/ai/directives/infra/nodejs-npm-setup.xml +354 -0
- package/ai/directives/infra/storybook-setup.xml +153 -0
- package/ai/directives/knowledge.xml +206 -0
- package/ai/directives/perf-auditor/perf-auditor.directive.xml +75 -0
- package/ai/directives/perf-auditor/rules/async-latency.xml +101 -0
- package/ai/directives/perf-auditor/rules/data-structures.xml +103 -0
- package/ai/directives/perf-auditor/rules/iteration-fusion.xml +96 -0
- package/ai/directives/perf-auditor/rules/memory-gc.xml +102 -0
- package/ai/directives/sdd/README.md +49 -0
- package/ai/directives/sdd/audit.directive.xml +543 -0
- package/ai/directives/sdd/discovery.directive.xml +824 -0
- package/ai/directives/sdd/fix.directive.xml +249 -0
- package/ai/directives/sdd/module-decomposition.directive.xml +666 -0
- package/ai/directives/sdd/phase-execution-protocol.xml +339 -0
- package/ai/directives/sdd/scaffold.directive.xml +717 -0
- package/ai/directives/sdd/setup.directive.xml +213 -0
- package/ai/directives/sdd/svelte-ui-discovery.directive.xml +263 -0
- package/ai/directives/semantic-change-extractor.directive.xml +99 -0
- package/ai/directives/testing/README.md +25 -0
- package/ai/directives/testing/common.xml +234 -0
- package/ai/directives/testing/node-test.xml +288 -0
- package/ai/directives/testing/playwright-cli.xml +199 -0
- package/ai/directives/testing/playwright-e2e.xml +292 -0
- package/ai/directives/testing/storybook-usage.xml +173 -0
- package/ai/directives/testing/svelte-testing.xml +237 -0
- package/ai/directives/testing/vitest-rules.xml +326 -0
- package/ai/docs/README.md +17 -0
- package/ai/docs/ai-icl.md +538 -0
- package/ai/docs/ai-priming.md +548 -0
- package/ai/docs/ai-prompt-formats.md +406 -0
- package/ai/docs/ai-promting.md +572 -0
- package/ai/drafts/DRAFT.md +120 -0
- package/ai/drafts/agent-devgen-class-from-description.rules.xml +123 -0
- package/ai/drafts/agent-typescript-devgen.v1.xml +303 -0
- package/ai/drafts/d.md +65 -0
- package/ai/drafts/music-posts.md +105 -0
- package/ai/fw/v1/architecture/blueprint-factory.xml +77 -0
- package/ai/fw/v1/core/mental-model.xml +50 -0
- package/ai/fw/v1/discovery/intent-reactor.xml +92 -0
- package/ai/fw/v1/production/swarm-protocol.xml +122 -0
- package/ai/fw/v1/review/quality-pipeline.xml +102 -0
- package/ai/fw/v2/arch-universal.xml +73 -0
- package/ai/fw-draft/README.md +79 -0
- package/ai/fw-draft/bin/discovery.sh +116 -0
- package/ai/fw-draft/gennady.xml +58 -0
- package/ai/fw-draft/provider/claude.xml +16 -0
- package/ai/fw-draft/provider/cursor.xml +23 -0
- package/ai/fw-draft/provider/default.xml +12 -0
- package/ai/fw-draft/roles/developer.xml +18 -0
- package/ai/fw-draft/router.xml +39 -0
- package/ai/fw-draft/routes/development.xml +32 -0
- package/ai/fw-draft/routes/universal.xml +58 -0
- package/ai/fw-draft/rules/dev/base/file-structure-rules.xml +89 -0
- package/ai/fw-draft/rules/dev/typescript/contacts.xml +194 -0
- package/dist/ai/agents/agent-resolve-conflicts.xml +6 -0
- package/dist/ai/agents/agent-review-verifier.xml +6 -0
- package/dist/ai/directives/architecture/README.md +21 -0
- package/dist/ai/directives/coding/README.md +23 -0
- package/dist/ai/directives/coding/result-conventions.xml +55 -0
- package/dist/ai/directives/coding/svelte5-runes.xml +248 -0
- package/dist/ai/directives/coding/sveltekit-rules.xml +247 -0
- package/dist/ai/directives/coding/typescript-rules.xml +589 -0
- package/dist/ai/directives/coding/uikit-component-storybook.xml +347 -0
- package/dist/ai/directives/coding/uikit-component-svelte.xml +344 -0
- package/dist/ai/directives/coding/uikit-spec-drafting.xml +243 -0
- package/dist/ai/directives/dbc-audit.directive.xml +131 -0
- package/dist/ai/directives/dev-review.directive.xml +148 -0
- package/dist/ai/directives/infra/README.md +11 -0
- package/dist/ai/directives/infra/eslint-setup.xml +467 -0
- package/dist/ai/directives/infra/git-setup.xml +261 -0
- package/dist/ai/directives/infra/nodejs-npm-setup.xml +354 -0
- package/dist/ai/directives/infra/storybook-setup.xml +153 -0
- package/dist/ai/directives/knowledge.xml +206 -0
- package/dist/ai/directives/perf-auditor/perf-auditor.directive.xml +75 -0
- package/dist/ai/directives/perf-auditor/rules/async-latency.xml +101 -0
- package/dist/ai/directives/perf-auditor/rules/data-structures.xml +103 -0
- package/dist/ai/directives/perf-auditor/rules/iteration-fusion.xml +96 -0
- package/dist/ai/directives/perf-auditor/rules/memory-gc.xml +102 -0
- package/dist/ai/directives/sdd/README.md +49 -0
- package/dist/ai/directives/sdd/audit.directive.xml +543 -0
- package/dist/ai/directives/sdd/discovery.directive.xml +824 -0
- package/dist/ai/directives/sdd/fix.directive.xml +249 -0
- package/dist/ai/directives/sdd/module-decomposition.directive.xml +666 -0
- package/dist/ai/directives/sdd/phase-execution-protocol.xml +339 -0
- package/dist/ai/directives/sdd/scaffold.directive.xml +717 -0
- package/dist/ai/directives/sdd/setup.directive.xml +213 -0
- package/dist/ai/directives/sdd/svelte-ui-discovery.directive.xml +263 -0
- package/dist/ai/directives/semantic-change-extractor.directive.xml +99 -0
- package/dist/ai/directives/testing/README.md +25 -0
- package/dist/ai/directives/testing/common.xml +234 -0
- package/dist/ai/directives/testing/node-test.xml +288 -0
- package/dist/ai/directives/testing/playwright-cli.xml +199 -0
- package/dist/ai/directives/testing/playwright-e2e.xml +292 -0
- package/dist/ai/directives/testing/storybook-usage.xml +173 -0
- package/dist/ai/directives/testing/svelte-testing.xml +237 -0
- package/dist/ai/directives/testing/vitest-rules.xml +326 -0
- package/dist/ai/docs/README.md +17 -0
- package/dist/ai/docs/ai-icl.md +538 -0
- package/dist/ai/docs/ai-priming.md +548 -0
- package/dist/ai/docs/ai-prompt-formats.md +406 -0
- package/dist/ai/docs/ai-promting.md +572 -0
- package/dist/ai/drafts/DRAFT.md +120 -0
- package/dist/ai/drafts/agent-devgen-class-from-description.rules.xml +123 -0
- package/dist/ai/drafts/agent-typescript-devgen.v1.xml +303 -0
- package/dist/ai/drafts/d.md +65 -0
- package/dist/ai/drafts/music-posts.md +105 -0
- package/dist/ai/fw/v1/architecture/blueprint-factory.xml +77 -0
- package/dist/ai/fw/v1/core/mental-model.xml +50 -0
- package/dist/ai/fw/v1/discovery/intent-reactor.xml +92 -0
- package/dist/ai/fw/v1/production/swarm-protocol.xml +122 -0
- package/dist/ai/fw/v1/review/quality-pipeline.xml +102 -0
- package/dist/ai/fw/v2/arch-universal.xml +73 -0
- package/dist/ai/fw-draft/README.md +79 -0
- package/dist/ai/fw-draft/bin/discovery.sh +116 -0
- package/dist/ai/fw-draft/gennady.xml +58 -0
- package/dist/ai/fw-draft/provider/claude.xml +16 -0
- package/dist/ai/fw-draft/provider/cursor.xml +23 -0
- package/dist/ai/fw-draft/provider/default.xml +12 -0
- package/dist/ai/fw-draft/roles/developer.xml +18 -0
- package/dist/ai/fw-draft/router.xml +39 -0
- package/dist/ai/fw-draft/routes/development.xml +32 -0
- package/dist/ai/fw-draft/routes/universal.xml +58 -0
- package/dist/ai/fw-draft/rules/dev/base/file-structure-rules.xml +89 -0
- package/dist/ai/fw-draft/rules/dev/typescript/contacts.xml +194 -0
- package/dist/chunks/devtools-B-7ugZhF.js +79 -0
- package/dist/chunks/{help.cmd-CWasx25o.js → help.cmd-B_G7EWzF.js} +9 -2
- package/dist/chunks/{index-B63fYXL2.js → index-BeL1Zcbg.js} +1 -1
- package/dist/chunks/index-CVR66voe.js +26963 -0
- package/dist/chunks/index-CXuhZzS3.js +16979 -0
- package/dist/chunks/{index-B5bA2T7A.js → index-CaahtXiM.js} +33 -9
- package/dist/chunks/{index-iqg0w_pE.js → index-CiEM-8nJ.js} +35 -19
- package/dist/chunks/{index-B4m0-PAT.js → index-D1qsi0Uc.js} +57 -33
- package/dist/chunks/index-D9ceRUyB.js +443 -0
- package/dist/chunks/index-DJpVmyp2.js +176 -0
- package/dist/chunks/{index-C0andxna.js → index-DU6jD7SS.js} +1 -1
- package/dist/chunks/index-KxSZKmZn.js +540 -0
- package/dist/chunks/{index-Dqe1TdW4.js → index-UbHoePfr.js} +12 -12
- package/dist/chunks/{index-5xIgwwKx.js → index-g1LXlp77.js} +2 -2
- package/dist/chunks/index-zBnnuvLA.js +3788 -0
- package/dist/chunks/{run-review-command.logic-a_M3CkeZ.js → run-review-command.logic-DpkRoEi8.js} +2 -2
- package/dist/chunks/services-CaLOhuLV.js +2889 -0
- package/dist/chunks/shared-Bjy30TeM.js +665 -0
- package/dist/cli/cmd/_shared/prompt/io/load-agent-template.io.d.ts +3 -3
- package/dist/cli/cmd/_shared/prompt/logic/build-ai-first-knowledge-block.logic.d.ts +3 -3
- package/dist/cli/cmd/_shared/prompt/logic/build-ai-verify-placeholders.logic.d.ts +7 -4
- package/dist/cli/cmd/_shared/prompt/logic/verify-commands/resolve-verify-commands.logic.d.ts +5 -0
- package/dist/cli/cmd/_shared/update-check-worker.d.ts +1 -0
- package/dist/cli/cmd/_shared/update-check.d.ts +38 -0
- package/dist/cli/cmd/agent-mon/cmd/create-providers.d.ts +15 -0
- package/dist/cli/cmd/agent-mon/cmd/index.d.ts +1 -0
- package/dist/cli/cmd/agent-mon/cmd/run.d.ts +12 -0
- package/dist/cli/cmd/agent-mon/state/create-state-manager.d.ts +32 -0
- package/dist/cli/cmd/agent-mon/state/group-by-provider.d.ts +14 -0
- package/dist/cli/cmd/agent-mon/state/index.d.ts +5 -0
- package/dist/cli/cmd/agent-mon/state/is-waiting.d.ts +9 -0
- package/dist/cli/cmd/agent-mon/state/view-model.type.d.ts +74 -0
- package/dist/cli/cmd/agent-mon/ui/app.d.ts +16 -0
- package/dist/cli/cmd/agent-mon/ui/column-view.d.ts +14 -0
- package/dist/cli/cmd/agent-mon/ui/index.d.ts +10 -0
- package/dist/cli/cmd/agent-mon/ui/provider-column.d.ts +14 -0
- package/dist/cli/cmd/agent-mon/ui/session-card.d.ts +12 -0
- package/dist/cli/cmd/agent-mon/ui/status-badge.d.ts +10 -0
- package/dist/cli/cmd/alt-opinion/alt-opinion-parser.d.ts +18 -0
- package/dist/cli/cmd/alt-opinion/alt-opinion-runner.d.ts +32 -0
- package/dist/cli/cmd/alt-opinion/alt-opinion.cmd.d.ts +34 -0
- package/dist/cli/cmd/alt-opinion/alt-opinion.types.d.ts +88 -0
- package/dist/cli/cmd/alt-opinion/index.d.ts +1 -0
- package/dist/cli/cmd/cat/cat-url.fn.d.ts +19 -0
- package/dist/cli/cmd/lint/checks/anchor.check.d.ts +11 -0
- package/dist/cli/cmd/lint/checks/dbc-contract.check.d.ts +16 -0
- package/dist/cli/cmd/lint/checks/disables.check.d.ts +12 -0
- package/dist/cli/cmd/lint/checks/file-header.check.d.ts +10 -0
- package/dist/cli/cmd/lint/checks/language.check.d.ts +11 -0
- package/dist/cli/cmd/lint/index.d.ts +1 -0
- package/dist/cli/cmd/lint/lint.cmd.d.ts +18 -0
- package/dist/cli/cmd/lint/lint.types.d.ts +72 -0
- package/dist/cli/cmd/lint/utils/resolve-references.fn.d.ts +32 -0
- package/dist/cli/cmd/remote-console/index.d.ts +2 -0
- package/dist/cli/cmd/remote-console/remote-console.cmd.d.ts +55 -0
- package/dist/cli/cmd/resolve-conflicts/_core/io/resolve-conflicts-template-load.io.d.ts +2 -2
- package/dist/cli/cmd/resolve-conflicts/_core/logic/resolve-conflicts-command-args-parse.logic.d.ts +3 -3
- package/dist/cli/cmd/resolve-conflicts/_core/logic/resolve-conflicts-command-run.logic.d.ts +3 -3
- package/dist/cli/cmd/resolve-conflicts/_core/logic/resolve-conflicts-context-git-build.logic.d.ts +4 -4
- package/dist/cli/cmd/resolve-conflicts/_core/types/resolve-conflicts-artifact.type.d.ts +3 -1
- package/dist/cli/cmd/resolve-conflicts/_core/types/resolve-conflicts-command-args.type.d.ts +3 -1
- package/dist/cli/cmd/resolve-conflicts/_core/types/resolve-conflicts-command-result.type.d.ts +5 -1
- package/dist/cli/cmd/resolve-conflicts/_core/types/resolve-conflicts-context-git.type.d.ts +18 -2
- package/dist/cli/cmd/resolve-conflicts/_core/xml/resolve-conflicts-artifact-build.xml.d.ts +6 -6
- package/dist/cli/cmd/resolve-conflicts/_core/xml/resolve-conflicts-render.xml.d.ts +4 -4
- package/dist/cli/cmd/review/_core/io/load-review-verify-template.io.d.ts +2 -2
- package/dist/cli/cmd/review/_core/logic/build-review-context-git.logic.d.ts +3 -3
- package/dist/cli/cmd/review/_core/logic/build-review-context-vcs.logic.d.ts +2 -2
- package/dist/cli/cmd/review/_core/logic/load-review-context-mr.logic.d.ts +5 -5
- package/dist/cli/cmd/review/_core/logic/parse-review-command-args.logic.d.ts +3 -3
- package/dist/cli/cmd/review/_core/logic/resolve-review-intent.logic.d.ts +3 -3
- package/dist/cli/cmd/review/_core/logic/run-review-command.logic.d.ts +3 -3
- package/dist/cli/cmd/review/_core/types/review-artifact.type.d.ts +4 -1
- package/dist/cli/cmd/review/_core/types/review-command-args.type.d.ts +7 -1
- package/dist/cli/cmd/review/_core/types/review-command-mode.type.d.ts +1 -1
- package/dist/cli/cmd/review/_core/types/review-command-options.type.d.ts +3 -1
- package/dist/cli/cmd/review/_core/types/review-command-result.type.d.ts +5 -1
- package/dist/cli/cmd/review/_core/types/review-context-git.type.d.ts +3 -1
- package/dist/cli/cmd/review/_core/types/review-context-mr.type.d.ts +22 -3
- package/dist/cli/cmd/review/_core/types/review-context-vcs.type.d.ts +4 -1
- package/dist/cli/cmd/review/_core/types/review-intent.type.d.ts +1 -1
- package/dist/cli/cmd/review/_core/xml/build-review-artifact.xml.d.ts +10 -10
- package/dist/cli/cmd/review/_core/xml/render-review-issues.xml.d.ts +3 -3
- package/dist/cli/cmd/review/_core/xml/render-review-verify.xml.d.ts +4 -4
- package/dist/cli/cmd/sync/index.d.ts +1 -0
- package/dist/cli/cmd/sync/sync-core.d.ts +65 -0
- package/dist/cli/cmd/sync/sync-formatter.d.ts +12 -0
- package/dist/cli/cmd/sync/sync.cmd.d.ts +33 -0
- package/dist/cli/cmd/sync/sync.types.d.ts +50 -0
- package/dist/cli/cmd/vcs-reply/vcs-reply.cmd.d.ts +4 -4
- package/dist/cli/utils/ai-legacy/ai-legacy-agent.d.ts +12 -11
- package/dist/cli/utils/ai-legacy/ai-legacy-core.d.ts +33 -17
- package/dist/cli/utils/ai-legacy/ai-legacy-model.d.ts +42 -23
- package/dist/cli/utils/cat-gen/cat-gen.d.ts +19 -8
- package/dist/cli/utils/commit-gen/commit-gen.d.ts +39 -15
- package/dist/cli/utils/prompts/index.d.ts +6 -6
- package/dist/cli/utils/review-gen/review-gen.d.ts +33 -9
- package/dist/gennady.js +30 -10
- package/dist/index.d.ts +1 -0
- package/dist/index.js +44 -23
- package/dist/services/agent-mon/diff/diff.d.ts +9 -0
- package/dist/services/agent-mon/diff/index.d.ts +1 -0
- package/dist/services/agent-mon/index.d.ts +10 -0
- package/dist/services/agent-mon/model/agent-provider.type.d.ts +20 -0
- package/dist/services/agent-mon/model/agent-session.type.d.ts +49 -0
- package/dist/services/agent-mon/model/errors.d.ts +20 -0
- package/dist/services/agent-mon/model/index.d.ts +7 -0
- package/dist/services/agent-mon/model/observe-opts.type.d.ts +7 -0
- package/dist/services/agent-mon/model/scan-opts.type.d.ts +7 -0
- package/dist/services/agent-mon/model/session-changes.type.d.ts +10 -0
- package/dist/services/agent-mon/monitor/agent-monitor.d.ts +44 -0
- package/dist/services/agent-mon/monitor/create-monitor.d.ts +6 -0
- package/dist/services/agent-mon/monitor/index.d.ts +2 -0
- package/dist/services/agent-mon/observe/index.d.ts +1 -0
- package/dist/services/agent-mon/observe/observe.d.ts +12 -0
- package/dist/services/agent-mon/providers/claude/claude-provider.d.ts +50 -0
- package/dist/services/agent-mon/providers/claude/index.d.ts +5 -0
- package/dist/services/agent-mon/providers/claude/ps.d.ts +36 -0
- package/dist/services/agent-mon/providers/claude/session-json.d.ts +37 -0
- package/dist/services/agent-mon/providers/opencode/db.d.ts +41 -0
- package/dist/services/agent-mon/providers/opencode/index.d.ts +3 -0
- package/dist/services/agent-mon/providers/opencode/model-parser.d.ts +6 -0
- package/dist/services/agent-mon/providers/opencode/opencode-provider.d.ts +45 -0
- package/dist/services/ai-client/providers/ai-model.type.d.ts +14 -0
- package/dist/services/ai-client/providers/open-router/open-router-model.type.d.ts +1 -4
- package/dist/services/ai-client/providers/open-router/open-router-provider.d.ts +17 -0
- package/dist/services/ai-client/providers/openai-like-provider.d.ts +1 -0
- package/dist/services/data-ore/telegram/telegram-data-ore.d.ts +17 -0
- package/dist/services/data-ore/telegram/telegram-data-ore.types.d.ts +4 -0
- package/dist/services/data-ore/telegram/telegram-demo-music-helper.d.ts +1 -0
- package/dist/services/data-ore/telegram/telegram-demo.d.ts +1 -0
- package/dist/services/dbc/linter/dbc-ast-adapter.types.d.ts +82 -0
- package/dist/services/dbc/linter/dbc-linter.types.d.ts +95 -0
- package/dist/services/dbc/linter/implementations/ts/dbc-ts-ast-adapter.d.ts +183 -0
- package/dist/services/dbc/linter/implementations/ts/dbc-ts-linter.d.ts +152 -0
- package/dist/services/dbc/parser/dbc-parser.types.d.ts +16 -16
- package/dist/services/dbc/parser/implementations/jsdoc/dbc-jsdoc-parser.d.ts +14 -4
- package/dist/services/logger/logger.d.ts +26 -6
- package/dist/services/remote-console/client/remote-console-client-serializer.d.ts +7 -0
- package/dist/services/remote-console/client/remote-console-client.d.ts +20 -0
- package/dist/services/remote-console/client/remote-console-client.types.d.ts +88 -0
- package/dist/services/remote-console/remote-console.d.ts +6 -0
- package/dist/services/remote-console/server/remote-console-server.d.ts +10 -0
- package/dist/services/remote-console/server/remote-console-server.types.d.ts +44 -0
- package/dist/services/remote-console/server/remote-console-stdout-writer.d.ts +26 -0
- package/dist/services/vcs-client/abstract/vcs-client-merge-discussions.d.ts +22 -14
- package/dist/services/vcs-client/abstract/vcs-client-merge-requests.d.ts +31 -14
- package/dist/services/vcs-client/abstract/vcs-client-repository-files.d.ts +16 -0
- package/dist/services/vcs-client/abstract/vcs-client.d.ts +9 -5
- package/dist/services/vcs-client/entities/vcs-file-content.type.d.ts +24 -0
- package/dist/services/vcs-client/entities/vcs-merge-request-changes.type.d.ts +32 -0
- package/dist/services/vcs-client/entities/vcs-url.type.d.ts +14 -0
- package/dist/services/vcs-client/entities/vcs-user.type.d.ts +3 -0
- package/dist/services/vcs-client/github/vcs-github-client.d.ts +31 -0
- package/dist/services/vcs-client/github/vcs-github-merge-requests.d.ts +40 -0
- package/dist/services/vcs-client/github/vcs-github-repository-files.d.ts +27 -0
- package/dist/services/vcs-client/gitlab/vcs-gitlab-client.d.ts +13 -4
- package/dist/services/vcs-client/gitlab/vcs-gitlab-merge-discussions.d.ts +16 -5
- package/dist/services/vcs-client/gitlab/vcs-gitlab-merge-requests.d.ts +24 -5
- package/dist/services/vcs-client/gitlab/vcs-gitlab-repository-files.d.ts +27 -0
- package/dist/services/vcs-client/parse-vcs-url.d.ts +3 -0
- package/dist/shared/backend/git/git-core.d.ts +24 -22
- package/dist/shared/backend/git/git-diff.d.ts +16 -5
- package/dist/shared/backend/rc/rc-config.d.ts +27 -15
- package/dist/shared/common/exec.d.ts +4 -6
- package/dist/shared/common/files.d.ts +1 -3
- package/dist/shared/common/language.d.ts +3 -6
- package/dist/shared/common/parse-args.d.ts +1 -4
- package/dist/shared/common/style.d.ts +3 -3
- package/dist/shared/common/think.d.ts +1 -5
- package/dist/shared/common/tokens.d.ts +1 -5
- package/dist/shared/common/unguard.d.ts +4 -8
- package/dist/shared/common/xml.d.ts +16 -12
- package/package.json +20 -4
- package/dist/.ai/agents/agent-review-verifier.xml +0 -181
- package/dist/chunks/index-CNbmXK8M.js +0 -3548
- package/dist/chunks/services-Sb7TwLxt.js +0 -122
- package/dist/chunks/shared-BgLzFWMH.js +0 -577
|
@@ -0,0 +1,538 @@
|
|
|
1
|
+
<Module_ID id="ICL_RESEARCH_PLAN_2026" />
|
|
2
|
+
|
|
3
|
+
# In-Context Learning (ICL)
|
|
4
|
+
|
|
5
|
+
## Модуль 1. Природа ICL: От Few-Shot к Many-Shot
|
|
6
|
+
|
|
7
|
+
- **Суть:** Как модель адаптирует поведение по примерам в контексте без изменения весов. Разница между few-shot и many-shot режимом.
|
|
8
|
+
- **Ресерч:** [Language Models are Few-Shot Learners](https://arxiv.org/abs/2005.14165), [Many-Shot In-Context Learning](https://arxiv.org/abs/2404.11018), [Why Can GPT Learn In-Context? Language Models Secretly Perform Gradient Descent as Meta-Optimizers](https://aclanthology.org/2023.findings-acl.247), [Transformers learn to implement preconditioned gradient descent for in-context learning](https://arxiv.org/abs/2306.00297).
|
|
9
|
+
|
|
10
|
+
## Модуль 2. Архитектура примера (Example Design)
|
|
11
|
+
|
|
12
|
+
- **Суть:** Что делает пример сильным: релевантность, формат, полнота входа, репрезентативность и наличие промежуточных шагов там, где они действительно нужны.
|
|
13
|
+
- **Ресерч:** [What Makes Good In-Context Examples for GPT-3?](https://aclanthology.org/2022.deelio-1.10), [Rethinking the Role of Demonstrations: What Makes In-Context Learning Work?](https://aclanthology.org/2022.emnlp-main.759), [Chain-of-Thought Prompting Elicits Reasoning in Large Language Models](https://arxiv.org/abs/2201.11903), [Self-Consistency Improves Chain of Thought Reasoning in Language Models](https://arxiv.org/abs/2203.11171).
|
|
14
|
+
|
|
15
|
+
## Модуль 3. Проблема порядка и смещения (Ordering & Bias)
|
|
16
|
+
|
|
17
|
+
- **Суть:** Почему один и тот же набор примеров может работать по-разному при разном порядке, и как длинный контекст меняет использование информации.
|
|
18
|
+
- **Ресерч:** [Fantastically Ordered Prompts and Where to Find Them](https://aclanthology.org/2022.acl-long.556), [What Makes a Good Order of Examples in In-Context Learning](https://aclanthology.org/2024.findings-acl.884), [Calibrate Before Use: Improving Few-Shot Performance of Language Models](https://proceedings.mlr.press/v139/zhao21c.html), [Lost in the Middle: How Language Models Use Long Contexts](https://arxiv.org/abs/2307.03172).
|
|
19
|
+
|
|
20
|
+
## Модуль 4. Синтетический ICL (Self-Generated Examples)
|
|
21
|
+
|
|
22
|
+
- **Суть:** Как использовать самогенерацию подзадач, тест-кейсов, аналогий и промежуточных reasoning traces перед финальным ответом.
|
|
23
|
+
- **Ресерч:** [STaR: Self-Taught Reasoner Bootstrapping Reasoning With Reasoning](https://arxiv.org/abs/2203.14465), [Self-Instruct: Aligning Language Models with Self-Generated Instructions](https://aclanthology.org/2023.acl-long.754), [Tree of Thoughts: Deliberate Problem Solving with Large Language Models](https://arxiv.org/abs/2305.10601).
|
|
24
|
+
|
|
25
|
+
## Модуль 5. Отрицательный ICL (Negative Counter-Examples)
|
|
26
|
+
|
|
27
|
+
- **Суть:** Использование плохих и хороших примеров для задания границ качества, безопасности и допустимого формата ответа.
|
|
28
|
+
- **Ресерч:** Прямая литература по plain-text negative exemplars уже, чем по CoT и ordering; для практики полезны смежные работы: [Constitutional AI: Harmlessness from AI Feedback](https://arxiv.org/abs/2212.08073), [Self-Refine: Iterative Refinement with Self-Feedback](https://arxiv.org/abs/2303.17651).
|
|
29
|
+
|
|
30
|
+
## Модуль 6. Интеграция в AI-Protocol: XML-библиотеки шотов и retrieval
|
|
31
|
+
|
|
32
|
+
- **Суть:** Как хранить, индексировать, выбирать и переиспользовать примеры через библиотеки артефактов, retrieval и протоколы подачи контекста.
|
|
33
|
+
- **Ресерч:** [Learning to Retrieve Prompts for In-Context Learning](https://aclanthology.org/2022.naacl-main.191), [Self-Adaptive In-Context Learning](https://aclanthology.org/2023.acl-long.79), [Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks](https://arxiv.org/abs/2005.11401).
|
|
34
|
+
|
|
35
|
+
---
|
|
36
|
+
|
|
37
|
+
### Общая картина
|
|
38
|
+
|
|
39
|
+
In-Context Learning — это режим работы LLM, в котором поведение модели смещается за счет содержимого текущего запроса: инструкций, примеров, контекста и формата. Базовая точка отсчета здесь — GPT-3, где few-shot prompting был показан как общий механизм адаптации без fine-tuning: [Brown et al., 2020](https://arxiv.org/abs/2005.14165).
|
|
40
|
+
|
|
41
|
+
Позднее many-shot режим получил отдельное сильное эмпирическое подтверждение: на ряде задач качество продолжает расти и после десятков примеров, а не только в диапазоне 1-8 шотов: [Many-Shot In-Context Learning](https://arxiv.org/abs/2404.11018).
|
|
42
|
+
|
|
43
|
+
При этом ICL не следует трактовать как полную замену fine-tuning. Это один из способов адаптации модели, особенно полезный там, где важны скорость итерации, прозрачность и возможность быстро менять поведение без переобучения.
|
|
44
|
+
|
|
45
|
+
---
|
|
46
|
+
|
|
47
|
+
<Module_ID id="MOD_ICL_01_NATURE_2026" />
|
|
48
|
+
|
|
49
|
+
# Модуль 1. Природа ICL: От Few-Shot к Many-Shot
|
|
50
|
+
|
|
51
|
+
### Суть метода
|
|
52
|
+
|
|
53
|
+
Few-shot ICL подает модели несколько демонстраций формата или поведения. Many-shot ICL расширяет этот режим до десятков, сотен и более примеров. В таком режиме модель сильнее подстраивается под локальную статистику текущего контекста, а не только под общий prior, сформированный предобучением.
|
|
54
|
+
|
|
55
|
+
### 1. Сферы применения и примеры
|
|
56
|
+
|
|
57
|
+
#### Сфера: Классификация по внутренним корпоративным правилам
|
|
58
|
+
|
|
59
|
+
- **Задача:** Разметка тикетов, писем или заявок по внутренней таксономии компании.
|
|
60
|
+
- **ICL-прайминг:** Подача размеченных примеров по каждой категории.
|
|
61
|
+
- **Эффект:** Модель лучше схватывает локальные критерии, которые трудно описать одной инструкцией.
|
|
62
|
+
|
|
63
|
+
#### Сфера: Трансформация текста в заданный формат
|
|
64
|
+
|
|
65
|
+
- **Задача:** Привести вход к корпоративному шаблону отчета, карточки кейса или JSON-структуры.
|
|
66
|
+
- **ICL-прайминг:** Подача набора входов и целевых выходов в одном формате.
|
|
67
|
+
- **Эффект:** Модель подстраивается под тип ответа, глубину и структуру.
|
|
68
|
+
|
|
69
|
+
#### Сфера: Узкодоменная редактура
|
|
70
|
+
|
|
71
|
+
- **Задача:** Переписывать текст в жанре legal review, risk memo, incident report.
|
|
72
|
+
- **ICL-прайминг:** Подача репрезентативных образцов именно этого жанра.
|
|
73
|
+
- **Эффект:** Модель сильнее ориентируется на локальный паттерн задачи, чем на усредненный интернет-стиль.
|
|
74
|
+
|
|
75
|
+
---
|
|
76
|
+
|
|
77
|
+
### 2. Научное подтверждение и Fact-Checking
|
|
78
|
+
|
|
79
|
+
#### Прямо подтверждается:
|
|
80
|
+
|
|
81
|
+
- LLM действительно могут адаптироваться по демонстрациям прямо в промпте: [Language Models are Few-Shot Learners](https://arxiv.org/abs/2005.14165).
|
|
82
|
+
- На длинном контексте полезность демонстраций сохраняется и в many-shot режиме: [Many-Shot In-Context Learning](https://arxiv.org/abs/2404.11018).
|
|
83
|
+
|
|
84
|
+
#### Косвенно подтверждается:
|
|
85
|
+
|
|
86
|
+
- ICL можно интерпретировать как форму внутренней оптимизации или мета-обучения: [Why Can GPT Learn In-Context? Language Models Secretly Perform Gradient Descent as Meta-Optimizers](https://aclanthology.org/2023.findings-acl.247), [Transformers learn to implement preconditioned gradient descent for in-context learning](https://arxiv.org/abs/2306.00297).
|
|
87
|
+
|
|
88
|
+
#### Не подтверждено / требует аккуратности:
|
|
89
|
+
|
|
90
|
+
- Что many-shot ICL в общем случае заменяет fine-tuning.
|
|
91
|
+
- Что ICL уже окончательно объяснен как один конкретный внутренний алгоритм для всех моделей и всех задач.
|
|
92
|
+
|
|
93
|
+
---
|
|
94
|
+
|
|
95
|
+
### 3. Эвристическая интерпретация LLM
|
|
96
|
+
|
|
97
|
+
Это не научное доказательство, а рабочая модель интерпретации.
|
|
98
|
+
|
|
99
|
+
С точки зрения поведения LLM few-shot действует как локальная калибровка: модель получает несколько опорных точек и подстраивает вероятности продолжения в сторону увиденного формата. Many-shot усиливает этот эффект: локальный контекст начинает сильнее конкурировать с более общими паттернами, усвоенными при предобучении.
|
|
100
|
+
|
|
101
|
+
Именно поэтому many-shot часто полезен для задач со сложными локальными правилами, но одновременно становится хрупким к шуму и противоречивым примерам.
|
|
102
|
+
|
|
103
|
+
---
|
|
104
|
+
|
|
105
|
+
### 4. Практическая ценность
|
|
106
|
+
|
|
107
|
+
- Few-shot полезен, когда нужно быстро задать формат и базовое поведение.
|
|
108
|
+
- Many-shot полезен, когда задача сильно зависит от локальных примеров и не укладывается в короткую инструкцию.
|
|
109
|
+
- Рост числа примеров полезен только до тех пор, пока сами примеры релевантны, непротиворечивы и не перегружают контекст.
|
|
110
|
+
|
|
111
|
+
---
|
|
112
|
+
|
|
113
|
+
### 5. Плюсы, Минусы и Опасности
|
|
114
|
+
|
|
115
|
+
#### Плюсы:
|
|
116
|
+
|
|
117
|
+
- **Мгновенная адаптация:** Не требуется отдельное дообучение.
|
|
118
|
+
- **Прозрачность:** Видно, на каких примерах строится текущее поведение.
|
|
119
|
+
- **Гибкость:** Поведение можно менять на уровне запроса.
|
|
120
|
+
|
|
121
|
+
#### Минусы:
|
|
122
|
+
|
|
123
|
+
- **Стоимость токенов:** Большие библиотеки примеров дороги.
|
|
124
|
+
- **Латентность:** Длинный префикс замедляет обработку.
|
|
125
|
+
- **Хрупкость к шуму:** Противоречивые шоты быстро портят результат.
|
|
126
|
+
|
|
127
|
+
#### Опасности:
|
|
128
|
+
|
|
129
|
+
- **Label Noise:** Ошибочные примеры закрепляют неверное правило.
|
|
130
|
+
- **Overfitting to Context:** Модель может слишком сильно подстроиться под локальный стиль в ущерб задаче.
|
|
131
|
+
- **Context Budget Collapse:** Полезность many-shot исчезает, если контекст заполнен слабым или дублирующим материалом.
|
|
132
|
+
|
|
133
|
+
---
|
|
134
|
+
|
|
135
|
+
<Module_ID id="MOD_ICL_02_EXAMPLE_DESIGN_2026" />
|
|
136
|
+
|
|
137
|
+
## Модуль 2. Архитектура примера (Example Design)
|
|
138
|
+
|
|
139
|
+
### Суть метода
|
|
140
|
+
|
|
141
|
+
Качество ICL зависит не только от числа примеров, но и от того, как именно они устроены. Сильный пример должен быть репрезентативным, достаточно полным и совпадать с реальным распределением входов и выходов.
|
|
142
|
+
|
|
143
|
+
### 1. Сферы применения и техники дизайна
|
|
144
|
+
|
|
145
|
+
#### Техника 1: Input -> Output
|
|
146
|
+
|
|
147
|
+
- **Дизайн:** Короткий вход и целевой ответ без промежуточных шагов.
|
|
148
|
+
- **Сфера:** Извлечение полей, нормализация, форматирование, простая классификация.
|
|
149
|
+
- **Эффект:** Минимальный шум и минимальный расход токенов.
|
|
150
|
+
|
|
151
|
+
#### Техника 2: Input -> Reasoning -> Answer
|
|
152
|
+
|
|
153
|
+
- **Дизайн:** Вход, затем краткий ход решения, затем финальный ответ.
|
|
154
|
+
- **Сфера:** Математика, логика, отладка, аналитические задачи.
|
|
155
|
+
- **Эффект:** На сложных задачах модель чаще воспроизводит не только ответ, но и способ получения ответа.
|
|
156
|
+
|
|
157
|
+
#### Техника 3: Хороший/плохой формат
|
|
158
|
+
|
|
159
|
+
- **Дизайн:** Валидный и невалидный образец с пояснением различия.
|
|
160
|
+
- **Сфера:** JSON, code review, style guide, безопасный код.
|
|
161
|
+
- **Эффект:** Пример задает границу допустимого поведения, а не только целевую точку.
|
|
162
|
+
|
|
163
|
+
---
|
|
164
|
+
|
|
165
|
+
### 2. Научное подтверждение и Fact-Checking
|
|
166
|
+
|
|
167
|
+
#### Прямо подтверждается:
|
|
168
|
+
|
|
169
|
+
- Качество демонстраций существенно влияет на качество ICL: [What Makes Good In-Context Examples for GPT-3?](https://aclanthology.org/2022.deelio-1.10).
|
|
170
|
+
- Свойства примеров важны не меньше, чем простая пара вход-выход: [Rethinking the Role of Demonstrations: What Makes In-Context Learning Work?](https://aclanthology.org/2022.emnlp-main.759).
|
|
171
|
+
- Для reasoning-задач полезны примеры с промежуточными шагами: [Chain-of-Thought Prompting Elicits Reasoning in Large Language Models](https://arxiv.org/abs/2201.11903), [Self-Consistency Improves Chain of Thought Reasoning in Language Models](https://arxiv.org/abs/2203.11171).
|
|
172
|
+
|
|
173
|
+
#### Косвенно подтверждается:
|
|
174
|
+
|
|
175
|
+
- Хороший пример задает не только ответ, но и локальную процедуру решения. Это следует из reasoning-литературы, но не сводится к одному универсальному механизму.
|
|
176
|
+
|
|
177
|
+
#### Не подтверждено / требует аккуратности:
|
|
178
|
+
|
|
179
|
+
- Что CoT является лучшим дизайном примера для любой задачи.
|
|
180
|
+
- Что любой подробный reasoning-образец автоматически улучшает результат.
|
|
181
|
+
|
|
182
|
+
---
|
|
183
|
+
|
|
184
|
+
### 3. Эвристическая интерпретация LLM
|
|
185
|
+
|
|
186
|
+
Это не научное доказательство, а рабочая модель интерпретации.
|
|
187
|
+
|
|
188
|
+
Хороший пример задает LLM локальную геометрию задачи: что считать входом, что считать существенным сигналом, какой тип ответа является допустимым. Если пример содержит reasoning, модель часто начинает продолжать не только результат, но и траекторию вывода. Если reasoning слабый или нерелевантный, модель так же послушно унаследует и эту слабость.
|
|
189
|
+
|
|
190
|
+
---
|
|
191
|
+
|
|
192
|
+
### 4. Практическая ценность
|
|
193
|
+
|
|
194
|
+
- Для простой задачи лучше короткий и чистый пример без лишнего reasoning.
|
|
195
|
+
- Для сложной задачи имеет смысл тестировать CoT-демонстрации.
|
|
196
|
+
- Примеры должны быть репрезентативными, а не декоративными.
|
|
197
|
+
- Один качественный пример часто полезнее трех красивых, но нерелевантных.
|
|
198
|
+
|
|
199
|
+
---
|
|
200
|
+
|
|
201
|
+
### 5. Плюсы, Минусы и Опасности
|
|
202
|
+
|
|
203
|
+
#### Плюсы:
|
|
204
|
+
|
|
205
|
+
- **Точность формата:** Пример быстрее задает нужный шаблон ответа.
|
|
206
|
+
- **Снижение неоднозначности:** Меньше пространства для свободной трактовки.
|
|
207
|
+
- **Перенос процедуры:** В reasoning-задачах пример может переносить не только ответ, но и метод.
|
|
208
|
+
|
|
209
|
+
#### Минусы:
|
|
210
|
+
|
|
211
|
+
- **Хрупкость к плохим примерам:** Ошибка в демонстрации масштабируется.
|
|
212
|
+
- **Token Overhead:** Подробные примеры быстро съедают контекст.
|
|
213
|
+
|
|
214
|
+
#### Опасности:
|
|
215
|
+
|
|
216
|
+
- **Template Copying:** Модель копирует форму даже там, где она уже мешает.
|
|
217
|
+
- **Reasoning Drift:** Слабое reasoning в примере задает слабую траекторию решения.
|
|
218
|
+
- **Distribution Mismatch:** Примеры слишком далеки от реальных входов.
|
|
219
|
+
|
|
220
|
+
---
|
|
221
|
+
|
|
222
|
+
<Module_ID id="MOD_ICL_03_ORDER_BIAS_2026" />
|
|
223
|
+
|
|
224
|
+
## Модуль 3. Проблема порядка и смещения (Ordering & Bias)
|
|
225
|
+
|
|
226
|
+
### Суть метода
|
|
227
|
+
|
|
228
|
+
ICL чувствителен не только к составу набора примеров, но и к их порядку. При длинном контексте дополнительно появляются позиционные эффекты: начало и конец окна часто обрабатываются лучше, чем середина.
|
|
229
|
+
|
|
230
|
+
### 1. Сферы применения и стратегии борьбы
|
|
231
|
+
|
|
232
|
+
#### Сфера: Классификация и label-heavy задачи
|
|
233
|
+
|
|
234
|
+
- **Проблема:** Несбалансированный хвост примеров смещает модель к одной категории.
|
|
235
|
+
- **Стратегия:** Балансировать категории ближе к финальным позициям и тестировать несколько порядков.
|
|
236
|
+
|
|
237
|
+
#### Сфера: Длинные retrieval-контексты
|
|
238
|
+
|
|
239
|
+
- **Проблема:** Критичная информация оказывается в середине большого блока и используется хуже.
|
|
240
|
+
- **Стратегия:** Повторять ключевые условия ближе к месту применения и избегать перегруженной середины.
|
|
241
|
+
|
|
242
|
+
#### Сфера: Многошаговое reasoning
|
|
243
|
+
|
|
244
|
+
- **Проблема:** Последний reasoning-пример задает неподходящую траекторию для следующей задачи.
|
|
245
|
+
- **Стратегия:** Упорядочивать примеры от простого к сложному или по типу подзадачи.
|
|
246
|
+
|
|
247
|
+
---
|
|
248
|
+
|
|
249
|
+
### 2. Научное подтверждение и Fact-Checking
|
|
250
|
+
|
|
251
|
+
#### Прямо подтверждается:
|
|
252
|
+
|
|
253
|
+
- Few-shot ICL чувствителен к порядку примеров: [Fantastically Ordered Prompts and Where to Find Them](https://aclanthology.org/2022.acl-long.556).
|
|
254
|
+
- Свойства удачного порядка можно исследовать отдельно: [What Makes a Good Order of Examples in In-Context Learning](https://aclanthology.org/2024.findings-acl.884).
|
|
255
|
+
- Label bias и калибровка few-shot режима подтверждены: [Calibrate Before Use: Improving Few-Shot Performance of Language Models](https://proceedings.mlr.press/v139/zhao21c.html).
|
|
256
|
+
- Позиционные эффекты в длинном контексте подтверждены: [Lost in the Middle: How Language Models Use Long Contexts](https://arxiv.org/abs/2307.03172).
|
|
257
|
+
|
|
258
|
+
#### Косвенно подтверждается:
|
|
259
|
+
|
|
260
|
+
- Практики вроде curriculum ordering и balanced shuffling логично следуют из литературы по order sensitivity, хотя конкретные схемы зависят от задачи и модели.
|
|
261
|
+
|
|
262
|
+
#### Не подтверждено / требует аккуратности:
|
|
263
|
+
|
|
264
|
+
- Что последний пример всегда важнее всех остальных.
|
|
265
|
+
- Что существует универсальный оптимальный порядок примеров.
|
|
266
|
+
|
|
267
|
+
---
|
|
268
|
+
|
|
269
|
+
### 3. Эвристическая интерпретация LLM
|
|
270
|
+
|
|
271
|
+
Это не научное доказательство, а рабочая модель интерпретации.
|
|
272
|
+
|
|
273
|
+
LLM не читает длинный контекст как одинаково ровное поле. Последние и первые участки часто оказываются более "активными" для генерации, а середина длинного блока — менее заметной. Поэтому порядок примеров выглядит не как вопрос косметики, а как вопрос распределения внимания внутри окна.
|
|
274
|
+
|
|
275
|
+
---
|
|
276
|
+
|
|
277
|
+
### 4. Практическая ценность
|
|
278
|
+
|
|
279
|
+
- Один и тот же набор шотов нужно тестировать в нескольких порядках.
|
|
280
|
+
- В длинных пайплайнах важны не только релевантность документов, но и их позиция в окне.
|
|
281
|
+
- Порядок примеров — это параметр оптимизации, а не декоративная деталь.
|
|
282
|
+
|
|
283
|
+
---
|
|
284
|
+
|
|
285
|
+
### 5. Плюсы, Минусы и Опасности
|
|
286
|
+
|
|
287
|
+
#### Плюсы:
|
|
288
|
+
|
|
289
|
+
- **Бесплатная оптимизация:** Иногда перестановка примеров улучшает результат без новых данных.
|
|
290
|
+
- **Локальное управление поведением:** Порядком можно менять акцент модели.
|
|
291
|
+
|
|
292
|
+
#### Минусы:
|
|
293
|
+
|
|
294
|
+
- **Нестабильность:** Один порядок может быть удачным для одной модели и слабым для другой.
|
|
295
|
+
- **Трудоемкость:** Оптимальный порядок часто приходится искать экспериментально.
|
|
296
|
+
|
|
297
|
+
#### Опасности:
|
|
298
|
+
|
|
299
|
+
- **Recency Bias:** Последние примеры перевешивают более важные ранние правила.
|
|
300
|
+
- **Majority Label Bias:** Дисбаланс примеров смещает ответ.
|
|
301
|
+
- **Middle Neglect:** Ключевые условия в середине используются хуже.
|
|
302
|
+
|
|
303
|
+
---
|
|
304
|
+
|
|
305
|
+
<Module_ID id="MOD_ICL_04_SYNTHETIC_SELF_GEN_2026" />
|
|
306
|
+
|
|
307
|
+
## Модуль 4. Синтетический ICL (Self-Generated Examples)
|
|
308
|
+
|
|
309
|
+
### Суть метода
|
|
310
|
+
|
|
311
|
+
Синтетический ICL использует промежуточную самогенерацию: модель сначала строит подзадачи, аналогии, тест-кейсы или черновые шаги решения, а затем использует этот материал как дополнительный локальный контекст.
|
|
312
|
+
|
|
313
|
+
### 1. Сферы применения и примеры
|
|
314
|
+
|
|
315
|
+
#### Сфера: Математика и логика
|
|
316
|
+
|
|
317
|
+
- **Задача:** Решить сложную задачу, требующую нескольких переходов.
|
|
318
|
+
- **Синтетический цикл:** Сначала выписать более простые подзадачи или промежуточные шаги.
|
|
319
|
+
- **Эффект:** Модель снижает вероятность одного крупного ошибочного прыжка.
|
|
320
|
+
|
|
321
|
+
#### Сфера: Код и edge cases
|
|
322
|
+
|
|
323
|
+
- **Задача:** Сгенерировать функцию с учетом граничных случаев.
|
|
324
|
+
- **Синтетический цикл:** Сначала выписать тест-кейсы и ожидаемое поведение.
|
|
325
|
+
- **Эффект:** Финальный код чаще учитывает границы задачи.
|
|
326
|
+
|
|
327
|
+
#### Сфера: Аналитика и планирование
|
|
328
|
+
|
|
329
|
+
- **Задача:** Подготовить структурированный разбор решения.
|
|
330
|
+
- **Синтетический цикл:** Сначала план, затем критерии, затем финальный вывод.
|
|
331
|
+
- **Эффект:** Ответ становится более управляемым и проверяемым.
|
|
332
|
+
|
|
333
|
+
---
|
|
334
|
+
|
|
335
|
+
### 2. Научное подтверждение и Fact-Checking
|
|
336
|
+
|
|
337
|
+
#### Прямо подтверждается:
|
|
338
|
+
|
|
339
|
+
- Bootstrap-механика самогенерируемых reasoning traces: [STaR: Self-Taught Reasoner Bootstrapping Reasoning With Reasoning](https://arxiv.org/abs/2203.14465).
|
|
340
|
+
- Самогенерация инструкций и задач как полезный способ улучшения instruction-following: [Self-Instruct: Aligning Language Models with Self-Generated Instructions](https://aclanthology.org/2023.acl-long.754).
|
|
341
|
+
- Полезность промежуточных веток рассуждения на inference time: [Tree of Thoughts: Deliberate Problem Solving with Large Language Models](https://arxiv.org/abs/2305.10601).
|
|
342
|
+
|
|
343
|
+
#### Косвенно подтверждается:
|
|
344
|
+
|
|
345
|
+
- Самогенерация аналогий и тест-кейсов для инженерных задач логично следует из общей scaffold-логики этих работ.
|
|
346
|
+
|
|
347
|
+
#### Не подтверждено / требует аккуратности:
|
|
348
|
+
|
|
349
|
+
- Что самогенерируемые примеры универсально надежнее внешних примеров.
|
|
350
|
+
- Что любая аналогия или self-generated scaffold обязательно улучшает ответ.
|
|
351
|
+
|
|
352
|
+
---
|
|
353
|
+
|
|
354
|
+
### 3. Эвристическая интерпретация LLM
|
|
355
|
+
|
|
356
|
+
Это не научное доказательство, а рабочая модель интерпретации.
|
|
357
|
+
|
|
358
|
+
Когда модель сначала генерирует промежуточные опоры, она создает сама для себя локальный набор ориентиров внутри контекста. После этого финальный ответ уже строится не на пустом месте, а на ранее сформированной внутренней траектории. Поэтому синтетический ICL часто помогает, но только если промежуточный материал сам по себе качественный.
|
|
359
|
+
|
|
360
|
+
---
|
|
361
|
+
|
|
362
|
+
### 4. Практическая ценность
|
|
363
|
+
|
|
364
|
+
- Техника особенно полезна там, где задача плохо решается одним прямым ответом.
|
|
365
|
+
- Самогенерация должна быть короткой, контролируемой и привязанной к цели задачи.
|
|
366
|
+
- Синтетический контекст полезен только тогда, когда его потом можно проверить или использовать как опору.
|
|
367
|
+
|
|
368
|
+
---
|
|
369
|
+
|
|
370
|
+
### 5. Плюсы, Минусы и Опасности
|
|
371
|
+
|
|
372
|
+
#### Плюсы:
|
|
373
|
+
|
|
374
|
+
- **Глубже прорабатывает задачу:** Модель строит опоры до финального ответа.
|
|
375
|
+
- **Помогает увидеть edge cases:** Особенно в коде и аналитике.
|
|
376
|
+
- **Повышает проверяемость:** У ответа появляются промежуточные артефакты.
|
|
377
|
+
|
|
378
|
+
#### Минусы:
|
|
379
|
+
|
|
380
|
+
- **Высокая стоимость:** Растут токены и время.
|
|
381
|
+
- **Не всегда нужен:** Для простых задач только мешает.
|
|
382
|
+
|
|
383
|
+
#### Опасности:
|
|
384
|
+
|
|
385
|
+
- **Self-Reinforced Error:** Ошибка в промежуточном шаге переходит в финал.
|
|
386
|
+
- **Echo Chamber:** Модель зацикливается на собственном промежуточном допущении.
|
|
387
|
+
|
|
388
|
+
---
|
|
389
|
+
|
|
390
|
+
<Module_ID id="MOD_ICL_05_NEGATIVE_CONTRASTIVE_2026" />
|
|
391
|
+
|
|
392
|
+
## Модуль 5. Отрицательный ICL (Negative Counter-Examples)
|
|
393
|
+
|
|
394
|
+
### Суть метода
|
|
395
|
+
|
|
396
|
+
Отрицательный ICL показывает не только целевой образец, но и нарушение правила: плохой пример, причину ошибки и корректный вариант. Это задает границы допустимого поведения заметно лучше, чем один только позитивный образец.
|
|
397
|
+
|
|
398
|
+
### 1. Сферы применения и примеры
|
|
399
|
+
|
|
400
|
+
#### Сфера: Безопасный код
|
|
401
|
+
|
|
402
|
+
- **Задача:** Снизить вероятность небезопасных SQL и shell-patterns.
|
|
403
|
+
- **Контрастный шот:** Уязвимый пример, краткая критика, безопасный вариант.
|
|
404
|
+
- **Эффект:** Модель лучше различает паттерны, которые нужно избегать.
|
|
405
|
+
|
|
406
|
+
#### Сфера: Строгий формат вывода
|
|
407
|
+
|
|
408
|
+
- **Задача:** Выдавать только валидный JSON или schema-constrained output.
|
|
409
|
+
- **Контрастный шот:** Сломанный пример и валидный пример.
|
|
410
|
+
- **Эффект:** Повышается чувствительность к границам допустимого формата.
|
|
411
|
+
|
|
412
|
+
#### Сфера: Стиль и редактура
|
|
413
|
+
|
|
414
|
+
- **Задача:** Избегать штампов, канцелярита или AI-клише.
|
|
415
|
+
- **Контрастный шот:** Штампованный абзац и улучшенный вариант с пояснением различия.
|
|
416
|
+
- **Эффект:** Граница между слабым и сильным стилем становится явной.
|
|
417
|
+
|
|
418
|
+
---
|
|
419
|
+
|
|
420
|
+
### 2. Научное подтверждение и Fact-Checking
|
|
421
|
+
|
|
422
|
+
#### Прямо подтверждается:
|
|
423
|
+
|
|
424
|
+
- Критика и последующая правка ответа работают как управляемый механизм выравнивания: [Constitutional AI: Harmlessness from AI Feedback](https://arxiv.org/abs/2212.08073), [Self-Refine: Iterative Refinement with Self-Feedback](https://arxiv.org/abs/2303.17651).
|
|
425
|
+
|
|
426
|
+
#### Косвенно подтверждается:
|
|
427
|
+
|
|
428
|
+
- Контрастная подача плохого и хорошего образца логично опирается на critique/refinement литературу и практику schema/style enforcement.
|
|
429
|
+
|
|
430
|
+
#### Не подтверждено / требует аккуратности:
|
|
431
|
+
|
|
432
|
+
- Для plain-text negative exemplars нет такой же широкой и устойчивой экспериментальной базы, как для CoT или ordering.
|
|
433
|
+
- Нельзя утверждать, что negative examples универсально лучший способ обучить модель границам поведения.
|
|
434
|
+
|
|
435
|
+
---
|
|
436
|
+
|
|
437
|
+
### 3. Эвристическая интерпретация LLM
|
|
438
|
+
|
|
439
|
+
Это не научное доказательство, а рабочая модель интерпретации.
|
|
440
|
+
|
|
441
|
+
Отрицательные примеры работают как явные маркеры нежелательной траектории. Если плохой пример размечен четко, а рядом дан хороший вариант, модель получает не только целевой шаблон, но и локальную границу: что считается ошибкой и почему. Если разметка слабая, эффект легко становится обратным, и модель начинает копировать именно ошибку.
|
|
442
|
+
|
|
443
|
+
---
|
|
444
|
+
|
|
445
|
+
### 4. Практическая ценность
|
|
446
|
+
|
|
447
|
+
- Контрастные пары полезнее всего там, где ошибка легко локализуется и формализуется.
|
|
448
|
+
- Плохой пример должен быть однозначно помечен как плохой.
|
|
449
|
+
- Нельзя перегружать контекст множеством негативных образцов: это смещает модель в сторону чрезмерной осторожности.
|
|
450
|
+
|
|
451
|
+
---
|
|
452
|
+
|
|
453
|
+
### 5. Плюсы, Минусы и Опасности
|
|
454
|
+
|
|
455
|
+
#### Плюсы:
|
|
456
|
+
|
|
457
|
+
- **Четкая граница допустимого:** Особенно полезно для качества и безопасности.
|
|
458
|
+
- **Обучение на ошибках:** Подходит для повторяющихся сбоев поведения.
|
|
459
|
+
|
|
460
|
+
#### Минусы:
|
|
461
|
+
|
|
462
|
+
- **Token Overhead:** Нужны минимум два образца вместо одного.
|
|
463
|
+
- **Риск путаницы:** Плохой пример должен быть размечен без двусмысленности.
|
|
464
|
+
|
|
465
|
+
#### Опасности:
|
|
466
|
+
|
|
467
|
+
- **Over-Correction:** Модель начинает избегать и допустимых вариантов.
|
|
468
|
+
- **Negative Dominance:** Слишком много плохих образцов ухудшают уверенность модели.
|
|
469
|
+
|
|
470
|
+
---
|
|
471
|
+
|
|
472
|
+
<Module_ID id="MOD_ICL_06_PROTOCOL_INTEGRATION_2026" />
|
|
473
|
+
|
|
474
|
+
## Модуль 6. Интеграция в AI-Protocol: XML-библиотеки шотов и retrieval
|
|
475
|
+
|
|
476
|
+
### Суть метода
|
|
477
|
+
|
|
478
|
+
В production-системах примеры обычно живут не внутри одного длинного монолитного промпта, а в виде библиотеки артефактов: индекс, теги, retrieval, правила отбора и ограниченный набор наиболее релевантных демонстраций на конкретный запрос.
|
|
479
|
+
|
|
480
|
+
### 1. Архитектура библиотеки артефактов (Artifact Library)
|
|
481
|
+
|
|
482
|
+
1. **Индекс артефактов:** Список примеров, их тегов и условий применения.
|
|
483
|
+
2. **Тело артефактов:** Сами демонстрации, разбитые по типам задач.
|
|
484
|
+
3. **Логика отбора:** Механизм, который решает, какие примеры подставлять в текущий контекст.
|
|
485
|
+
|
|
486
|
+
### 2. Научное подтверждение и Fact-Checking
|
|
487
|
+
|
|
488
|
+
#### Прямо подтверждается:
|
|
489
|
+
|
|
490
|
+
- Retrieval релевантных демонстраций полезен как отдельный механизм: [Learning to Retrieve Prompts for In-Context Learning](https://aclanthology.org/2022.naacl-main.191).
|
|
491
|
+
- Выбор и ordering примеров можно оптимизировать автоматически: [Self-Adaptive In-Context Learning](https://aclanthology.org/2023.acl-long.79).
|
|
492
|
+
- Retrieval-контекст является центральным элементом knowledge-intensive пайплайнов: [Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks](https://arxiv.org/abs/2005.11401).
|
|
493
|
+
|
|
494
|
+
#### Косвенно подтверждается:
|
|
495
|
+
|
|
496
|
+
- Идея библиотек шотов и их индексирования хорошо соответствует литературе по retrieval, example selection и long-context optimization.
|
|
497
|
+
|
|
498
|
+
#### Не подтверждено / требует аккуратности:
|
|
499
|
+
|
|
500
|
+
- Что XML является универсальным научным стандартом для ICL.
|
|
501
|
+
- Что один конкретный формат упаковки библиотеки лучше для всех моделей и всех задач.
|
|
502
|
+
|
|
503
|
+
---
|
|
504
|
+
|
|
505
|
+
### 3. Эвристическая интерпретация LLM
|
|
506
|
+
|
|
507
|
+
Это не научное доказательство, а рабочая модель интерпретации.
|
|
508
|
+
|
|
509
|
+
Библиотека шотов полезна не сама по себе, а как способ подать в окно только те примеры, которые действительно нужны текущей задаче. Для модели разница между хаотичной кучей примеров и компактным отобранным набором часто эквивалентна разнице между слабым и сильным локальным контекстом.
|
|
510
|
+
|
|
511
|
+
---
|
|
512
|
+
|
|
513
|
+
### 4. Практическая ценность
|
|
514
|
+
|
|
515
|
+
- Лучше подавать меньше, но более релевантных примеров.
|
|
516
|
+
- Библиотеку шотов нужно индексировать по типу задачи, а не хранить как один длинный набор.
|
|
517
|
+
- Retrieval и ICL работают лучше вместе, чем по отдельности в сложных production-сценариях.
|
|
518
|
+
|
|
519
|
+
---
|
|
520
|
+
|
|
521
|
+
### 5. Плюсы, Минусы и Опасности
|
|
522
|
+
|
|
523
|
+
#### Плюсы:
|
|
524
|
+
|
|
525
|
+
- **Масштабируемость:** Примеры можно переиспользовать между задачами.
|
|
526
|
+
- **Управляемость:** Отбор шотов становится контролируемым.
|
|
527
|
+
- **Экономия контекста:** В окно попадает только нужное.
|
|
528
|
+
|
|
529
|
+
#### Минусы:
|
|
530
|
+
|
|
531
|
+
- **Сложность инфраструктуры:** Нужны индекс, retrieval и правила отбора.
|
|
532
|
+
- **Новая зона ошибок:** Плохой retrieval портит хороший ICL.
|
|
533
|
+
|
|
534
|
+
#### Опасности:
|
|
535
|
+
|
|
536
|
+
- **Wrong Retrieval:** В окно попадают нерелевантные или конфликтующие примеры.
|
|
537
|
+
- **Stale Library:** Библиотека артефактов устаревает быстрее, чем кажется.
|
|
538
|
+
- **Format Over-Engineering:** Избыточная разметка увеличивает стоимость без прироста качества.
|