@furongjun1999/dsh-memory 0.4.7 → 0.4.9
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/README.md +130 -47
- package/codebuddy/CODEBUDDY.md +21 -10
- package/codebuddy/README.md +13 -1
- package/codebuddy/mcp.json +9 -0
- package/docs/GBrain/345/217/257/345/200/237/351/211/264/347/202/271_/347/201/265/346/236/242/350/220/275/347/202/271/344/272/244/346/216/245_20260919.md +169 -0
- package/docs/Pi/345/217/257/345/255/246/344/271/240/344/274/230/347/202/271_/347/201/265/346/236/242/345/244/247/350/204/221/346/224/271/350/277/233/344/272/244/346/216/245_20260915.md +144 -0
- package/docs/README.md +111 -0
- package/docs/discipline/harnesses.yaml +226 -152
- package/docs/discipline/templates/full.md.tmpl +61 -58
- package/docs/eval//347/254/254/344/270/211/346/226/271/351/252/214/350/257/201/346/212/245/345/221/212_LoCoMo_/347/201/265/346/236/242_.md +127 -0
- package/docs/eval//347/254/254/344/270/211/346/226/271/351/252/214/350/257/201/346/212/245/345/221/212_LoCoMo_/347/201/265/346/236/242_.png +0 -0
- package/docs/eval//347/254/254/344/270/211/346/226/271/351/252/214/350/257/201/346/212/245/345/221/212_/347/201/265/346/236/242_vs_dejavu_/347/273/237/344/270/200/350/257/204/345/210/206_v7.md +202 -0
- package/docs/experiments/linkref_backfill/candidates_20260917.json +726 -0
- package/docs/experiments/linkref_backfill/candidates_internal_20260917.json +602 -0
- package/docs/experiments/linkref_backfill/candidates_internal_v2.json +603 -0
- package/docs/experiments/linkref_backfill/candidates_secret_20260917.json +884 -0
- package/docs/experiments/linkref_backfill/candidates_secret_v2.json +789 -0
- package/docs/experiments/m4-role-probe/census.py +86 -0
- package/docs/experiments/m4-role-probe/probe.py +89 -0
- package/docs/experiments/mapped_confidence/bench_mapped_conf.py +216 -0
- package/docs/experiments/mapped_confidence/post_check.py +75 -0
- package/docs/experiments/mapped_confidence/repro_thirdparty_tol.py +83 -0
- package/docs/experiments/mapped_confidence/result_mapped_conf.json +215 -0
- package/docs/hive//345/244/232/347/253/257harness/351/200/232/344/277/241/345/245/221/347/272/246_v0.1.md +42 -0
- package/docs/hive//346/243/200/347/264/242/346/224/266/346/225/233/345/256/236/346/265/213/344/270/216S1b/350/256/276/350/256/241_v0.1.md +43 -0
- package/docs/hive//346/243/200/347/264/242/350/267/257/345/276/204/344/270/216/350/256/244/347/237/245/347/273/223/346/236/204/345/245/221/347/272/246_v0.1.md +102 -0
- package/docs/hive//347/234/237/345/256/236/345/272/223/347/253/257/345/210/260/347/253/257/345/256/236/346/265/213_S1b/344/270/216/345/217/254/345/233/236/346/235/203/350/241/241_v0.1.md +57 -0
- package/docs/hive//347/234/237/345/256/236/345/272/223/347/253/257/345/210/260/347/253/257/345/256/236/346/265/213_S7/345/200/222/346/216/222/345/200/231/351/200/211/345/261/202_v0.1.md +126 -0
- package/docs/hive//350/234/202/345/267/242/345/217/214/345/256/236/344/276/213/344/272/222/351/252/214_/350/256/276/350/256/241/345/256/232/347/250/277.md +503 -0
- package/docs/{ → hive/}/350/234/202/345/267/242/345/267/245/344/275/234/350/256/260/345/277/206_/351/241/271/347/233/256/350/256/241/345/210/222.md +14 -2
- package/docs/mdcg/D_meta_/345/267/245/347/250/213/345/214/226/346/226/271/346/241/210_v0.2.md +216 -0
- package/docs/{README → mdcg/README}/350/257/246/347/273/206/347/211/210_v0.4.5.md +631 -625
- package/docs/{ → mdcg/}/344/270/273/344/273/243/347/220/206/345/255/220/344/273/243/347/220/206/350/256/260/345/277/206/346/236/266/346/236/204/350/256/276/350/256/241.md +1 -1
- package/docs/mdcg//344/273/243/347/240/201/350/257/204/345/256/241/344/270/216/346/235/241/344/273/266/345/214/226/346/263/250/351/207/212_/345/245/221/347/272/246_v0.1.md +82 -0
- package/docs/mdcg//345/205/250/345/272/223/344/273/243/347/240/201/350/257/204/345/256/241/344/270/216/346/235/241/344/273/266/345/214/226/346/263/250/351/207/212_/350/256/241/345/210/222_v0.1.md +600 -0
- package/docs/mdcg//345/212/237/350/203/275/350/260/203/347/224/250/346/230/240/345/260/204/350/241/250_v0.1.md +263 -0
- package/docs/{ → mdcg/}/345/215/225/345/205/203/350/207/252/346/210/221/351/224/232/347/202/271_/347/263/273/347/273/237/346/217/220/347/244/272/350/257/215/346/240/207/345/207/206_v0.3.md +1 -1
- package/docs/mdcg//345/255/220/344/273/243/347/220/206/351/205/215/347/275/256/346/240/207/345/207/206_v0.5.md +236 -0
- package/docs/{ → mdcg/}/346/272/220/347/240/201/347/272/247/346/236/266/346/236/204/345/256/241/350/256/241_GPT/346/211/271/350/257/204/345/257/271/347/205/247_v1.0.md +2 -2
- package/docs/{ → mdcg/}/347/201/265/346/236/242/344/270/211/345/261/202/346/213/206/345/210/206/350/247/204/345/210/222_v0.1.md +181 -181
- package/docs/mdcg//347/201/265/346/236/242/350/256/260/345/277/206/345/212/250/350/257/215/345/215/217/350/256/256_v1.0-draft.md +172 -0
- package/docs/mdcg//347/216/257/344/272/214_/347/231/275/347/256/261/345/241/253/345/205/205/346/265/201/346/260/264/347/272/277_v0.1.md +31 -0
- package/docs/{ → mdcg/}/347/274/272/345/217/243/345/215/225_P0/346/224/266/345/217/243_v0.1.md +2 -2
- package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276_G4-G8/347/274/272/345/217/243/350/243/201/345/256/232/345/215/225_v0.1.md +1 -1
- package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276_/347/264/242/345/274/225/344/270/216/345/267/245/347/250/213/350/247/204/350/214/203/345/214/226_/350/256/241/345/210/222_v0.1.md +4 -4
- package/docs/{ → mdcg/}/350/256/260/345/277/206/346/223/215/344/275/234/347/263/273/347/273/237_MdCGOS/344/270/216MCP/346/216/245/345/205/245_v0.1.md +2 -2
- package/docs/mdcg//350/267/250/347/253/257/351/252/214/350/257/201/344/270/216/345/220/214/346/255/245/345/215/217/350/256/256_v0.1.md +93 -0
- package/docs/plans/GridWorld/346/234/200/345/260/217/351/227/255/347/216/257/350/247/204/346/240/274_v0.1.md +176 -0
- package/docs/{ → swarm/}/350/234/202/347/276/244/344/272/222/350/201/224_v0.1.md +3 -3
- package/docs/swarm//350/234/202/347/276/244/345/220/214/351/224/231/346/243/200/346/265/213/345/256/236/351/252/214/345/215/217/350/256/256_v0.1.md +242 -0
- package/docs/theory//345/215/225/347/272/277/347/250/213/344/270/216/346/263/250/346/204/217/345/212/233/351/233/206/344/270/255_/346/227/240/344/272/211/350/256/256/347/220/206/350/256/272/346/226/207/346/241/243_v1.0.md +129 -0
- package/docs/theory//345/271/266/345/217/221/345/277/205/347/204/266/346/200/247/347/220/206/350/256/272_v0.2.md +134 -0
- package/docs/theory//346/246/202/345/277/265/345/210/206/345/261/202/345/257/271/351/275/220/350/241/250_v0.1.md +145 -0
- package/docs/{ → theory/}/347/220/206/350/256/272_/346/234/272/345/210/266_/344/273/243/347/240/201_/345/256/236/351/252/214_/347/274/272/345/217/243/347/237/251/351/230/265_v0.1.md +6 -6
- package/docs/{ → theory/}/347/220/206/350/256/272/344/273/223/346/213/206/345/210/206/344/270/216/347/231/275/347/256/261/347/237/245/350/257/206/345/272/223/345/206/205/350/277/201_v0.1.md +1 -1
- package/docs/theory//350/256/244/347/237/245/344/273/243/347/220/206/344/270/216/346/224/266/346/225/233/347/273/223/346/236/204_/346/235/241/344/273/266/350/256/272/351/207/215/346/236/204_v0.1.md +221 -0
- package/docs/world_model//344/270/226/347/225/214/346/250/241/345/236/213_/347/245/236/347/273/217/347/275/221/347/273/234/345/272/225/345/261/202/346/236/266/346/236/204_v1.0.md +237 -0
- package/docs//345/255/230/347/256/227/344/270/200/344/275/223/346/236/266/346/236/204/345/255/246/344/271/240_/345/244/226/351/203/250/347/220/206/350/256/272/345/257/271/347/205/247/344/270/216/350/267/257/347/272/277/344/272/244/346/216/245_20260916.md +98 -0
- package/docs//345/255/230/347/256/227/344/270/200/344/275/223/347/245/236/347/273/217/347/275/221/347/273/234/346/236/266/346/236/204_/346/200/273/347/272/262/344/270/216/344/272/244/346/216/245_20260916.md +109 -0
- package/docs//345/267/245/344/275/234/347/272/252/345/276/213_/350/256/244/347/237/245/345/233/276/346/235/241/347/233/256_v1.1.json +434 -405
- package/docs//347/201/265/346/236/242/350/207/252/346/210/221/346/224/271/350/277/233/345/267/245/344/275/234/350/256/241/345/210/222_/345/244/226/351/203/250/347/240/224/347/251/266/347/263/273/345/210/227/345/220/270/346/224/266_v1_20260919.md +286 -0
- package/docs//347/231/275/347/256/261/345/214/226/347/272/262/351/242/206_/344/270/211/351/241/271/347/233/256/345/255/246/344/271/240/346/200/273/346/236/266/346/236/204/344/270/216Ghidra/344/272/244/346/216/245_20260916.md +104 -0
- package/docs//350/256/260/345/277/206/350/257/204/345/256/241/347/263/273/347/273/237_/347/253/213/351/241/271/350/256/276/350/256/241/344/270/216/346/226/275/345/267/245/344/272/244/346/216/245_20260915.md +183 -0
- package/dsh/README.md +34 -1
- package/dsh/cordis.yml.example +13 -7
- package/dsh/hive-mcp-probe.mjs +94 -0
- package/dsh/hive-mcp.example.yml +62 -0
- package/dsh/update-lingshu.bat +11 -0
- package/dsh/update-lingshu.ps1 +337 -0
- package/lib/hooks.d.ts +8 -0
- package/lib/hooks.js +27 -24
- package/lib/index.d.ts +4 -2
- package/lib/index.js +29 -6
- package/lib/lib/datapath.d.ts +76 -1
- package/lib/lib/datapath.js +199 -13
- package/lib/lib/mdcg_client.d.ts +6 -3
- package/lib/lib/mdcg_client.js +6 -5
- package/lib/lib/mutual.js +4 -4
- package/lib/lib/prompt_safety.d.ts +48 -0
- package/lib/lib/prompt_safety.js +62 -0
- package/lib/lib/token_store.js +4 -5
- package/md_cg/audit.py +91 -2
- package/md_cg/autonomy.py +86 -15
- package/md_cg/backfill.py +36 -1
- package/md_cg/backfill_bigdomain.py +34 -0
- package/md_cg/bench6_arms.py +28 -1
- package/md_cg/bench6_common.py +10 -1
- package/md_cg/bench6_competitors.py +6 -1
- package/md_cg/bench_axis_domain.py +9 -1
- package/md_cg/bench_blind_comp.py +7 -1
- package/md_cg/bench_en_atoms_public.py +9 -0
- package/md_cg/bench_governance.py +348 -0
- package/md_cg/bench_lme_zh.py +16 -1
- package/md_cg/bench_locomo.py +2 -1
- package/md_cg/bench_locomo_zh.py +16 -1
- package/md_cg/bench_locomo_zh_public.py +4 -1
- package/md_cg/bench_longmem.py +2 -1
- package/md_cg/bench_membench.py +37 -6
- package/md_cg/bench_p0.py +4 -1
- package/md_cg/bench_progressive.py +61 -10
- package/md_cg/bench_role_views.py +238 -0
- package/md_cg/bench_task_ab.py +8 -1
- package/md_cg/bench_task_ab_llm.py +13 -1
- package/md_cg/bench_unified_en.py +6 -1
- package/md_cg/bench_zh_mad.py +20 -1
- package/md_cg/blindspot_tickets.py +123 -0
- package/md_cg/branches.py +286 -0
- package/md_cg/build_postings.py +73 -0
- package/md_cg/ccgc.py +949 -0
- package/md_cg/census.py +5 -1
- package/md_cg/chain.py +24 -3
- package/md_cg/codeindex.py +134 -17
- package/md_cg/coldverify.py +265 -0
- package/md_cg/comment_gate.py +338 -0
- package/md_cg/cond_compose.py +190 -0
- package/md_cg/cond_facts.py +155 -0
- package/md_cg/cond_template.json +107 -0
- package/md_cg/condition_anchor.py +143 -0
- package/md_cg/conformance.py +727 -0
- package/md_cg/consistency.py +25 -2
- package/md_cg/consolidate.py +53 -2
- package/md_cg/corpus.py +5 -1
- package/md_cg/crosscheck.py +42 -2
- package/md_cg/crypto.py +35 -1
- package/md_cg/d_meta.py +310 -0
- package/md_cg/datapath.py +201 -26
- package/md_cg/docindex.py +122 -1
- package/md_cg/eval_common.py +35 -6
- package/md_cg/evidence.py +27 -1
- package/md_cg/evolution.py +21 -1
- package/md_cg/export.py +11 -1
- package/md_cg/forgetting.py +34 -4
- package/md_cg/fsutil.py +81 -2
- package/md_cg/hotcache.py +214 -0
- package/md_cg/hyperedge.py +251 -0
- package/md_cg/identity.py +20 -3
- package/md_cg/insight.py +19 -3
- package/md_cg/lexicon/build_cedict_en_zh.py +9 -0
- package/md_cg/lexicon/build_standard_en.py +171 -168
- package/md_cg/lexicon/expand_en_zh.py +6 -0
- package/md_cg/lifecycle.py +273 -0
- package/md_cg/linkref.py +281 -0
- package/md_cg/links.py +29 -1
- package/md_cg/mcp_server.py +894 -168
- package/md_cg/md_whitebox.py +53 -1
- package/md_cg/mdcg.py +1205 -41
- package/md_cg/mdcos.py +1060 -76
- package/md_cg/metacognition.py +39 -4
- package/md_cg/migrate.py +4 -0
- package/md_cg/migrate_aeis.py +221 -213
- package/md_cg/migrate_roleplay.py +8 -0
- package/md_cg/migrate_wisdom_graph.py +14 -1
- package/md_cg/mreview/__init__.py +25 -0
- package/md_cg/mreview/__main__.py +110 -0
- package/md_cg/mreview/bundle.py +178 -0
- package/md_cg/mreview/candidates.py +262 -0
- package/md_cg/mreview/govern.py +694 -0
- package/md_cg/mreview/locate.py +939 -0
- package/md_cg/mreview/pipeline.py +729 -0
- package/md_cg/mreview/rules/duplication.json +21 -0
- package/md_cg/mreview/rules/field_coverage.json +54 -0
- package/md_cg/mreview/rules/source_license.json +21 -0
- package/md_cg/mreview/rules/template_flow.json +21 -0
- package/md_cg/mreview/ruleset.py +253 -0
- package/md_cg/nodefile.py +269 -1
- package/md_cg/pooling.py +23 -1
- package/md_cg/postings.py +298 -0
- package/md_cg/predict.py +113 -15
- package/md_cg/progressive.py +3 -0
- package/md_cg/protect.py +18 -5
- package/md_cg/protocol.py +372 -0
- package/md_cg/provenance.py +262 -0
- package/md_cg/reach.py +453 -0
- package/md_cg/refindex.py +88 -4
- package/md_cg/refine.py +20 -1
- package/md_cg/roleviews.py +89 -0
- package/md_cg/routing.py +76 -0
- package/md_cg/scrub.py +68 -3
- package/md_cg/security.py +26 -1
- package/md_cg/self_state.py +65 -2
- package/md_cg/selfreport.py +151 -0
- package/md_cg/semantic/canonical.py +5 -0
- package/md_cg/semantic/en_normalizer.py +364 -295
- package/md_cg/semantic/zh_en_atoms.py +139 -136
- package/md_cg/signer.py +41 -1
- package/md_cg/sources.py +583 -547
- package/md_cg/statushdr.py +179 -0
- package/md_cg/stg.py +59 -18
- package/md_cg/subgraph.py +23 -0
- package/md_cg/sustain.py +74 -1
- package/md_cg/tasks.py +471 -0
- package/md_cg/test_action_derive.py +203 -0
- package/md_cg/test_audit_rotate.py +270 -0
- package/md_cg/test_autonomy.py +26 -0
- package/md_cg/test_bench_governance.py +102 -0
- package/md_cg/test_blindspot_tickets.py +166 -0
- package/md_cg/test_branches.py +249 -0
- package/md_cg/test_ccg_perturb.py +1 -1
- package/md_cg/test_ccgc.py +433 -0
- package/md_cg/test_codeindex.py +338 -0
- package/md_cg/test_comment_gate.py +187 -0
- package/md_cg/test_cond_compose_anchors.py +76 -0
- package/md_cg/test_condition_anchor.py +82 -0
- package/md_cg/test_conformance.py +343 -0
- package/md_cg/test_d_meta.py +412 -0
- package/md_cg/test_datapath_root.py +188 -0
- package/md_cg/test_en_pipeline.py +24 -0
- package/md_cg/test_gain_gate.py +47 -1
- package/md_cg/test_health_scale.py +173 -0
- package/md_cg/test_hot_cold.py +187 -0
- package/md_cg/test_hyperedge.py +245 -0
- package/md_cg/test_identity_attribution.py +6 -0
- package/md_cg/test_index_durability.py +224 -0
- package/md_cg/test_lifecycle.py +309 -0
- package/md_cg/test_linkref.py +306 -0
- package/md_cg/test_md_access_parity.py +15 -3
- package/md_cg/test_mr_m1.py +769 -0
- package/md_cg/test_mr_m2.py +587 -0
- package/md_cg/test_mr_m3.py +710 -0
- package/md_cg/test_mr_m4.py +485 -0
- package/md_cg/test_p1.py +1 -1
- package/md_cg/test_p11_consistency.py +1 -1
- package/md_cg/test_p12_metacognition.py +2 -2
- package/md_cg/test_p16_self_state.py +1 -1
- package/md_cg/test_p26_refindex.py +50 -21
- package/md_cg/test_p27_docindex.py +258 -4
- package/md_cg/test_p28_refcheck.py +1 -1
- package/md_cg/test_p29_session_ingest_export.py +1 -1
- package/md_cg/test_p2_mcp.py +7 -1
- package/md_cg/test_p31_insight.py +24 -0
- package/md_cg/test_p38_contextualize.py +1 -1
- package/md_cg/test_p39_vision_evidence.py +1 -1
- package/md_cg/test_p40_refine_worklist.py +1 -1
- package/md_cg/test_p41_evolve_patrol.py +1 -1
- package/md_cg/test_p42_provenance.py +1 -1
- package/md_cg/test_p43_pooling.py +41 -13
- package/md_cg/test_p44_md_whitebox.py +14 -1
- package/md_cg/test_protocol.py +243 -0
- package/md_cg/test_reach.py +378 -0
- package/md_cg/test_reach_keys.py +201 -0
- package/md_cg/test_reach_meta_exits.py +145 -0
- package/md_cg/test_read_clip.py +141 -0
- package/md_cg/test_retr_s1.py +340 -0
- package/md_cg/test_retr_s1b.py +209 -0
- package/md_cg/test_retr_s3.py +194 -0
- package/md_cg/test_retr_s4.py +163 -0
- package/md_cg/test_retr_s5.py +200 -0
- package/md_cg/test_retr_s6.py +157 -0
- package/md_cg/test_retr_s7.py +385 -0
- package/md_cg/test_retr_s8_time.py +316 -0
- package/md_cg/test_retr_s9_edges.py +286 -0
- package/md_cg/test_retr_s9_entity_ctx.py +175 -0
- package/md_cg/test_review_conformance.py +367 -0
- package/md_cg/test_role_views.py +354 -0
- package/md_cg/test_tasks.py +409 -0
- package/md_cg/test_tool_face.py +189 -0
- package/md_cg/test_trust.py +361 -0
- package/md_cg/test_twophase.py +286 -0
- package/md_cg/test_units_poll.py +71 -0
- package/md_cg/test_v14_fixes.py +397 -0
- package/md_cg/test_validity_filter.py +280 -0
- package/md_cg/test_wisdom_md_store.py +7 -3
- package/md_cg/test_writepipe.py +214 -0
- package/md_cg/theory.py +17 -2
- package/md_cg/tokens.py +134 -12
- package/md_cg/tool_face.py +261 -0
- package/md_cg/trust.py +943 -0
- package/md_cg/twophase.py +232 -0
- package/md_cg/units.py +665 -0
- package/md_cg/vision_evidence.py +25 -2
- package/md_cg/weights.py +25 -2
- package/md_cg/whitebox.py +33 -2
- package/md_cg/whitebox_kb/data/verify_cache.json +21233 -360
- package/md_cg/whitebox_kb/data/verify_savings.jsonl +5124 -0
- package/md_cg/whitebox_kb/wisdom/audit_log/chain_heat.json +10 -10
- package/md_cg/whitebox_kb/wisdom/code_compose.py +113 -6
- package/md_cg/whitebox_kb/wisdom/code_solidified.json +1 -1
- package/md_cg/whitebox_kb/wisdom/verifier.py +340 -55
- package/md_cg/whitebox_kb/wisdom/wisdom-book-cloud.db +0 -0
- package/md_cg/writelimit.py +37 -7
- package/md_cg/writepipe.py +543 -0
- package/package.json +2 -2
- package/skills/skills/designer-perspective/scripts/__pycache__/designer.cpython-310.pyc +0 -0
- package/skills/skills/designer-perspective/scripts/designer.py +17 -1
- package/skills/skills/designer-perspective/tests/selftest.py +3 -1
- package/src/hooks.ts +27 -22
- package/src/index.ts +33 -6
- package/src/lib/datapath.ts +211 -13
- package/src/lib/mdcg_client.ts +12 -8
- package/src/lib/mutual.ts +411 -411
- package/src/lib/prompt_safety.ts +62 -0
- package/src/lib/token_store.ts +4 -5
- package/zcode/AGENTS.md +21 -10
- package/zcode/README.md +4 -0
- package/docs//345/212/237/350/203/275/350/260/203/347/224/250/346/230/240/345/260/204/350/241/250_v0.1.md +0 -221
- /package/docs/{AGI → eval/AGI}/344/270/203/347/273/264/350/257/204/345/210/206/346/212/245/345/221/212_md_cg_v1.0.md" +0 -0
- /package/docs/{AGI → eval/AGI}/344/270/203/347/273/264/350/257/204/345/210/206/346/212/245/345/221/212_md_cg_v2.0.md" +0 -0
- /package/docs/{ → eval/}/345/256/236/351/252/214/346/226/271/346/241/210_/345/255/246/344/271/240/351/227/255/347/216/257AB/344/270/216/346/250/252/350/257/204_v1.0.md" +0 -0
- /package/docs/{ → eval/}/346/250/252/350/257/204_/345/205/255/345/256/266100/351/242/230/344/270/255/350/213/261/345/217/214/346/237/245_v1.0.md" +0 -0
- /package/docs/{guardrail-charter.md → mdcg/guardrail-charter.md} +0 -0
- /package/docs/{lingshu_tutorial.html → mdcg/lingshu_tutorial.html} +0 -0
- /package/docs/{memory-assessment.html → mdcg/memory-assessment.html} +0 -0
- /package/docs/{memory_score.html → mdcg/memory_score.html} +0 -0
- /package/docs/{memory_score.png → mdcg/memory_score.png} +0 -0
- /package/docs/{release_v0.3.0.md → mdcg/release_v0.3.0.md} +0 -0
- /package/docs/{release_v0.4.5.md → mdcg/release_v0.4.5.md} +0 -0
- /package/docs/{tool_table_v0.3.0.md → mdcg/tool_table_v0.3.0.md} +0 -0
- /package/docs/{ → mdcg/}/344/273/244/347/211/214/344/270/216/350/247/222/350/211/262/346/235/203/350/201/214/345/210/206/347/246/273_v0.1.md" +0 -0
- /package/docs/{ → mdcg/}/347/201/265/346/236/24282/345/267/245/345/205/267_/345/212/237/350/203/275/346/225/264/347/220/206/344/270/216/350/277/201/347/247/273/346/230/240/345/260/204_v0.1.md" +0 -0
- /package/docs/{ → mdcg/}/347/201/265/346/236/242MCP/345/267/245/345/205/267/346/200/273/350/241/250_v3.4.md" +0 -0
- /package/docs/{ → mdcg/}/347/201/265/346/236/242_/350/207/252/346/210/221/345/261/202/345/256/232/344/271/211.md" +0 -0
- /package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276_MD/347/233/256/345/275/225/346/226/271/346/241/210_v0.1.md" +0 -0
- /package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276_/346/235/241/344/273/266/347/251/272/351/227/264/345/220/210/346/210/220/344/270/216/347/224/237/346/225/210/346/235/241/344/273/266/345/217/243/345/276/204_v0.1.md" +0 -0
- /package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276/344/275/234/344/270/272/350/256/260/345/277/206/346/223/215/344/275/234/347/263/273/347/273/237_/350/257/204/344/274/260/344/270/216/350/267/257/347/272/277_v0.1.md" +0 -0
- /package/docs/{ → plans/}/345/221/275/345/220/215/346/262/273/347/220/206_/351/241/271/347/233/256/350/256/241/345/210/222.md" +0 -0
- /package/docs/{ → plans/}/347/237/245/350/257/206/345/233/276/350/260/261/351/241/271/347/233/256_/344/272/244/346/216/245/346/226/207/346/241/243_20260914.md" +0 -0
- /package/docs/{ → swarm/}/350/234/202/347/276/244/345/244/232/346/231/272/350/203/275/344/275/223_/344/275/277/347/224/250/346/212/245/345/221/212_20260913.md" +0 -0
- /package/docs/{ → swarm/}/350/234/202/347/276/244/345/244/232/346/231/272/350/203/275/344/275/223_/345/212/237/350/203/275/350/257/264/346/230/216_v0.6.md" +0 -0
- /package/docs/{ → swarm/}/350/234/202/347/276/244/347/233/262/345/214/272/346/240/207/350/256/260_v1.0.md" +0 -0
- /package/docs/{ → theory/}/344/277/241/346/201/257/345/267/256/344/270/272/344/273/200/344/271/210/345/277/205/347/204/266/345/255/230/345/234/250/344/270/224/350/207/252/347/204/266/346/211/251/345/244/247.md" +0 -0
- /package/docs/{ → theory/}/346/231/272/350/203/275/347/232/204/345/205/254/347/220/206/345/214/226/345/237/272/347/237/263.md" +0 -0
- /package/docs/{ → theory/}/346/231/272/350/203/275/347/232/204/350/256/244/347/237/245/350/277/207/347/250/213.md" +0 -0
- /package/docs/{ → theory/}/346/231/272/350/203/275/350/256/2723.4.md" +0 -0
- /package/docs/{ → theory/}/347/231/275/347/256/261/346/231/272/350/203/275/346/230/257/344/273/200/344/271/210/357/274/237.md" +0 -0
- /package/docs/{ → theory/}/347/231/275/347/256/261/346/231/272/350/203/275/347/263/273/345/210/227/302/267/347/254/254/344/272/224/347/257/207/357/274/232/350/256/251AI/347/234/237/346/255/243/350/243/205/344/270/212/350/256/260/345/277/206.md" +0 -0
package/md_cg/bench_locomo.py
CHANGED
|
@@ -40,6 +40,7 @@ GROUPS = {
|
|
|
40
40
|
POS_GROUPS = ("precise", "temporal", "interference")
|
|
41
41
|
|
|
42
42
|
|
|
43
|
+
# 生效条件:命令行参数可被解析、GROUPS 中每组题型可按 --n 抽样时,按 --calibrated 选择 ROOT_LC_CAL 或 legacy 库评估并打印,无返回值。
|
|
43
44
|
def main():
|
|
44
45
|
ap = argparse.ArgumentParser()
|
|
45
46
|
ap.add_argument("--n", type=int, default=0, help="每组抽样上限(0=全量)")
|
|
@@ -118,4 +119,4 @@ def main():
|
|
|
118
119
|
|
|
119
120
|
|
|
120
121
|
if __name__ == "__main__":
|
|
121
|
-
main()
|
|
122
|
+
main()
|
package/md_cg/bench_locomo_zh.py
CHANGED
|
@@ -89,6 +89,7 @@ KNOWN_DANGLING = {"scene_3_session_10_turn_19"}
|
|
|
89
89
|
MAX_DF_FIXED = 5
|
|
90
90
|
|
|
91
91
|
|
|
92
|
+
# 生效条件:任意 n_pool(含 0 等假值,源码不做校验)下返回 max(MAX_DF_FIXED, int(round(0.05 * n_pool))),结果不小于模块级常量 MAX_DF_FIXED。
|
|
92
93
|
def max_df_auto(n_pool):
|
|
93
94
|
"""池规模 → edges 的 df 上限。
|
|
94
95
|
|
|
@@ -100,6 +101,7 @@ def max_df_auto(n_pool):
|
|
|
100
101
|
return max(MAX_DF_FIXED, int(round(0.05 * n_pool)))
|
|
101
102
|
|
|
102
103
|
|
|
104
|
+
# 生效条件:path 指向逐行 JSON 的 UTF-8 文本时,跳过空行并逐行 yield json.loads 结果。
|
|
103
105
|
def iter_jsonl(path):
|
|
104
106
|
with open(path, encoding="utf-8") as f:
|
|
105
107
|
for line in f:
|
|
@@ -108,11 +110,13 @@ def iter_jsonl(path):
|
|
|
108
110
|
yield json.loads(line)
|
|
109
111
|
|
|
110
112
|
|
|
113
|
+
# 生效条件:path 能被 open(path, encoding="utf-8") 打开时返回 json.load(f) 的解析结果。
|
|
111
114
|
def load_json(path):
|
|
112
115
|
with open(path, encoding="utf-8") as f:
|
|
113
116
|
return json.load(f)
|
|
114
117
|
|
|
115
118
|
|
|
119
|
+
# 生效条件:os.path.isdir(d) 为假时直接返回空 dict;为真时按 sorted(os.listdir(d)) 顺序读取后缀为 .json 的分片并 out.update(part)(后者覆盖前者),任一分片不是 dict 时抛 SystemExit,否则返回合并后的 out。
|
|
116
120
|
def load_chunks(d):
|
|
117
121
|
"""合并目录下全部分片 JSON(后者覆盖前者,便于修订单条)。"""
|
|
118
122
|
out = {}
|
|
@@ -133,6 +137,7 @@ _SPEAKER_RE = re.compile(r"^([A-Za-z][A-Za-z .'\-]{0,24}): ")
|
|
|
133
137
|
_DATE_RE = re.compile(r"Data time: (\d{1,2}:\d{2} [AP]M on \w+ \d{1,2} \w+, \d{4})")
|
|
134
138
|
|
|
135
139
|
|
|
140
|
+
# 生效条件:调用即从 locomo_corpus.jsonl 建 id→记录映射、读 locomo_questions.jsonl,逐题取 q.get("evidence_turns") or [](缺键或假值按空列表)去重排序为证据 turn,text/title 用 c.get(...) or "" 兜假值、speaker/date 由 _SPEAKER_RE.match / _DATE_RE.search 命中才非空;verbose=True 时额外打印含 KNOWN_DANGLING 未登记告警与直接取键 q["qtype"] 的题型统计,verbose=False 时只跳过打印,写 RAW_TURNS/RAW_QUESTIONS 与返回 (rows, questions) 不变。
|
|
136
141
|
def cmd_dump(verbose=True):
|
|
137
142
|
"""确定性派生:证据 turn 全集 + 题库 → raw_turns/raw_questions(零标注)。"""
|
|
138
143
|
os.makedirs(ZH_TURNS, exist_ok=True)
|
|
@@ -176,6 +181,7 @@ def cmd_dump(verbose=True):
|
|
|
176
181
|
|
|
177
182
|
|
|
178
183
|
# ------------------------------------------------------------------ status
|
|
184
|
+
# 生效条件:verbose=True 时打印写入/查询侧完成度、多余 turn/qid 键与待补项(各截取前 head 项),并对已产出中文层用 bz.parse_zh 检查 identity/time/summary/terms 四项真值(并非五槽),非全真者记入 bad;verbose=False 时不打印、不做该槽位检查,返回值中 bad 恒为 []。
|
|
179
185
|
def cmd_status(verbose=True, head=12):
|
|
180
186
|
"""产出进度:中文层 / 中文查询的覆盖与缺口(分批产出时用)。"""
|
|
181
187
|
turns, questions = cmd_dump(verbose=False)
|
|
@@ -217,6 +223,7 @@ def cmd_status(verbose=True, head=12):
|
|
|
217
223
|
|
|
218
224
|
|
|
219
225
|
# ------------------------------------------------------------------ prepare
|
|
226
|
+
# 生效条件:miss_t 或 miss_q 任一非空即 raise SystemExit,否则按 sort_key(仅接受 scene_数字_session_数字_turn_数字 形式的 id,否则 raise SystemExit)对 turns 数值序排序,写出 corpus567.jsonl/questions500.jsonl 并返回 (corpus, out_q),其中 answer 与 evidence_turns 为假值时分别落为 "" 与 [],verbose 只控制末尾打印。
|
|
220
227
|
def cmd_prepare(verbose=True):
|
|
221
228
|
"""合并中文层 → corpus567.jsonl + questions500.jsonl(幂等覆盖)。"""
|
|
222
229
|
turns, questions = cmd_dump(verbose=False)
|
|
@@ -231,6 +238,7 @@ def cmd_prepare(verbose=True):
|
|
|
231
238
|
f"先跑 `status` 看缺口。")
|
|
232
239
|
|
|
233
240
|
# 语料:按 (scene, session, turn) 数值序 —— 「承接前一条」需要确定的时间序
|
|
241
|
+
# 生效条件:tid 匹配 ^scene_(\d+)_session_(\d+)_turn_(\d+)$ 时返回三个整数的 tuple(scene, session, turn),否则 raise SystemExit(不做其他容错或回退)。
|
|
234
242
|
def sort_key(tid):
|
|
235
243
|
m = re.match(r"scene_(\d+)_session_(\d+)_turn_(\d+)$", tid)
|
|
236
244
|
if not m:
|
|
@@ -275,6 +283,7 @@ def cmd_prepare(verbose=True):
|
|
|
275
283
|
|
|
276
284
|
|
|
277
285
|
# ------------------------------------------------------------------ build
|
|
286
|
+
# 生效条件:max_df 为 None(默认)时用 max_df_auto(len(corpus)) 自动取值,max_df 传出值(含 0 等假值)则直接使用;随后对 bz.ARMS 每臂调 bz.build_arm(corpus, arm, max_df=md, root_base=...) 并返回 {arm["name"]: 建库结果};verbose 形参在该符号源码段内未参与如何分支。
|
|
278
287
|
def cmd_build(max_df=None, verbose=True):
|
|
279
288
|
corpus, _ = cmd_prepare(verbose=False)
|
|
280
289
|
md = max_df if max_df is not None else max_df_auto(len(corpus))
|
|
@@ -296,6 +305,7 @@ GATE_RE = re.compile(r"拒答率:([\d.]+)%")
|
|
|
296
305
|
LINE_RE = re.compile(r"拒答线(正例 hit@1 题 Top-1 分 p10):([\d.]+)")
|
|
297
306
|
|
|
298
307
|
|
|
308
|
+
# 生效条件:RUST_BIN 经 os.path.exists 为假时抛 SystemExit;否则以 argv 列表 [RUST_BIN, "--dataset", "lc", "--tag", name, "--lib", lib, "--qfile", qfile](extra 为真值时追加其元素)执行 subprocess.run,返回码非 0 或 stdout 未匹配 ROW_RE 时抛 SystemExit,成功时返回 (got, neg, line),其中 GATE_RE/LINE_RE 未命中时对应值为 None。
|
|
299
309
|
def run_one(name, lib, qfile, extra=None):
|
|
300
310
|
"""调用 Rust 评测器跑一臂(--dataset lc 的组映射 + 显式 lib/qfile)。
|
|
301
311
|
|
|
@@ -326,6 +336,7 @@ def run_one(name, lib, qfile, extra=None):
|
|
|
326
336
|
(float(line.group(1)) if line else None)
|
|
327
337
|
|
|
328
338
|
|
|
339
|
+
# 生效条件:对 rows 中每个 (label, got, note) 按 GROUPS 顺序打印 got[g] 的 hit@1/MRR(got 缺任一 GROUPS 键会 KeyError),并对 POS_GROUPS 组按样本数 n 加权算正例 hit@1/MRR;baseline 非 None 且某行 label 等于 baseline 时该行值记为参照,其后 label 不等于 baseline 的行附加 Δpp,无返回值。
|
|
329
340
|
def print_table(title, rows, baseline=None):
|
|
330
341
|
"""rows: [(label, got, note)];baseline = 参照行 label(算 Δ)。"""
|
|
331
342
|
print(f"\n== {title} ==")
|
|
@@ -355,6 +366,7 @@ def print_table(title, rows, baseline=None):
|
|
|
355
366
|
+ f"{ov_h1 * 100:>10.1f}%{ov_mrr:>10.3f}{delta}{suffix}")
|
|
356
367
|
|
|
357
368
|
|
|
369
|
+
# 生效条件:seeds 等于 "sorted" 时给每个 run_one 追加 ["--graph-seeds", "sorted"],seeds 为其它值(含 None)时不追加;先 cmd_build(max_df=max_df) 取各臂库,再对 bz.ARMS 逐臂 run_one,neg 非 None 时把拒答率写入 note,返回 rows 并以 bz.ARMS[0]["name"] 为 baseline 打印主表。
|
|
358
370
|
def cmd_run(max_df=None, seeds=None):
|
|
359
371
|
"""消融主表(5 组;正例 hit@1/MRR = precise+temporal+interference)。"""
|
|
360
372
|
roots = cmd_build(max_df=max_df)
|
|
@@ -373,6 +385,7 @@ def cmd_run(max_df=None, seeds=None):
|
|
|
373
385
|
return rows
|
|
374
386
|
|
|
375
387
|
|
|
388
|
+
# 生效条件:cmd_build(max_df=max_df) 后取 bz.ARMS[-1]["name"] 对应的库,对同一库分别以索引序(lczh_a4_index,无额外参数)与 --graph-seeds sorted(lczh_a4_sorted)各跑一次 run_one,返回这两行结果并以 baseline="a4/index" 打印对照表。
|
|
376
389
|
def cmd_seed(max_df=None):
|
|
377
390
|
"""对照:同一个 a4 库,只切换 graph 路种子口径(隔离种子缺陷与边质量)。"""
|
|
378
391
|
roots = cmd_build(max_df=max_df)
|
|
@@ -389,6 +402,7 @@ def cmd_seed(max_df=None):
|
|
|
389
402
|
return rows
|
|
390
403
|
|
|
391
404
|
|
|
405
|
+
# 生效条件:kind 等于 "turn" 时从 RAW_TURNS 读取并按 id/speaker/date/text 打印 rows[start:end](序号自 start+1 起,text 截到 width);kind 为其它任何值时改从 RAW_QUESTIONS 按 qid/qtype/question 打印同一区间,无返回值。
|
|
392
406
|
def cmd_show(kind, start, end, width=240):
|
|
393
407
|
"""打印 [start, end) 区间的待标注项(分批产出时读原文用)。
|
|
394
408
|
|
|
@@ -403,6 +417,7 @@ def cmd_show(kind, start, end, width=240):
|
|
|
403
417
|
print(f"{i}\t{r['qid']}\t{r['qtype']}\t{r['question'][:width]}")
|
|
404
418
|
|
|
405
419
|
|
|
420
|
+
# 生效条件:len(argv) > 1 时 cmd 取 argv[1]、否则 cmd 为 "status";遍历 argv 时遇 "--max-df" 取 argv[i+1] 转 int 为 max_df、遇 "--seeds" 取 argv[i+1] 为 seeds;cmd 为 "show" 时调 cmd_show(argv[2], int(argv[3]), int(argv[4])),为 "dump"/"status"/"prepare" 时分别无参转调同名函数,为 "build"/"seed" 时传 max_df=max_df,为 "run" 时传 max_df=max_df 与 seeds=seeds,其余 cmd 值抛 SystemExit("未知子命令")。
|
|
406
421
|
def main(argv):
|
|
407
422
|
cmd = argv[1] if len(argv) > 1 else "status"
|
|
408
423
|
max_df = None
|
|
@@ -433,4 +448,4 @@ def main(argv):
|
|
|
433
448
|
|
|
434
449
|
|
|
435
450
|
if __name__ == "__main__":
|
|
436
|
-
main(sys.argv)
|
|
451
|
+
main(sys.argv)
|
|
@@ -55,6 +55,7 @@ CONFIGS = (
|
|
|
55
55
|
REFERENCE = {"lexical": 0.936, "lexical,fuzzy": 0.976}
|
|
56
56
|
|
|
57
57
|
|
|
58
|
+
# 生效条件:c 含 zh_fields(identity、time、summary、terms、condition)与 text 时,返回按身份/时间/摘要/词/条件/原始陈述拼接的正文。
|
|
58
59
|
def body_of(c):
|
|
59
60
|
"""正文:与 bench_axis_domain.body_of / bench_zh_mad 的 a0 臂**逐字一致**。
|
|
60
61
|
|
|
@@ -74,6 +75,7 @@ def body_of(c):
|
|
|
74
75
|
])
|
|
75
76
|
|
|
76
77
|
|
|
78
|
+
# 生效条件:传入 corpus 时,若 rebuild 为真且 ROOT 是目录则先删除 ROOT;随后以 MdCGOS(ROOT, autoflush=500) 打开,若已有节点数 >= len(corpus)(corpus 为空列表时该式恒真)则直接返回 cg,否则逐条 cg.add(c["id"], body_of(c), layer="knowledge", eval_src="public:locomo-zh-500", verification_basis="data") 并 cg.flush() 后返回 cg;
|
|
77
79
|
def build_pool(corpus, rebuild=False):
|
|
78
80
|
"""把 567 条灌成灵枢记忆库(layer=knowledge,无 tags)。
|
|
79
81
|
|
|
@@ -99,6 +101,7 @@ def build_pool(corpus, rebuild=False):
|
|
|
99
101
|
return cg
|
|
100
102
|
|
|
101
103
|
|
|
104
|
+
# 生效条件:无参数;仅当 CORPUS567 与 QUESTIONS500 的 os.path.exists 均为真时才继续执行,否则立即 raise SystemExit;
|
|
102
105
|
def main():
|
|
103
106
|
if not os.path.exists(CORPUS567) or not os.path.exists(QUESTIONS500):
|
|
104
107
|
raise SystemExit(
|
|
@@ -142,4 +145,4 @@ def main():
|
|
|
142
145
|
|
|
143
146
|
|
|
144
147
|
if __name__ == "__main__":
|
|
145
|
-
main()
|
|
148
|
+
main()
|
package/md_cg/bench_longmem.py
CHANGED
|
@@ -35,6 +35,7 @@ GROUPS = {
|
|
|
35
35
|
POS_GROUPS = ("precise", "temporal", "interference")
|
|
36
36
|
|
|
37
37
|
|
|
38
|
+
# 生效条件:命令行参数可被解析、GROUPS 中每组题型可按 --n 抽样时,按 --calibrated 选择 ROOT_LM_CAL 或 legacy 库评估并打印,无返回值。
|
|
38
39
|
def main():
|
|
39
40
|
ap = argparse.ArgumentParser()
|
|
40
41
|
ap.add_argument("--n", type=int, default=0, help="每组抽样上限(0=全量)")
|
|
@@ -109,4 +110,4 @@ def main():
|
|
|
109
110
|
|
|
110
111
|
|
|
111
112
|
if __name__ == "__main__":
|
|
112
|
-
main()
|
|
113
|
+
main()
|
package/md_cg/bench_membench.py
CHANGED
|
@@ -52,11 +52,13 @@ SEG_SPLIT = re.compile(r"([,。;:、,;.!?!?\s]+)")
|
|
|
52
52
|
|
|
53
53
|
# --------------------------------------------------------------------------- 数据
|
|
54
54
|
|
|
55
|
+
# 生效条件:按 path(默认模块常量 DATA)以 utf-8 打开文件逐行 json.loads,仅保留 l.strip() 为真的行,返回解析出的记录列表。
|
|
55
56
|
def load_rows(path=DATA):
|
|
56
57
|
with open(path, encoding="utf-8") as f:
|
|
57
58
|
return [json.loads(l) for l in f if l.strip()]
|
|
58
59
|
|
|
59
60
|
|
|
61
|
+
# 生效条件:以 root(默认模块常量 ROOT)建 MdCGOS,rows 为假值(None/空容器)时回落 load_rows() 取数据,逐行用 r["id"] 与 r["text"] 调 add,仅当 r["id"] 已在构建开始时取的 cg.index["nodes"] 快照 have 中才 continue(该快照不随新增 id 更新),verbose 假值则不打印,最后 cg.flush() 并返回 cg。
|
|
60
62
|
def build(root=ROOT, rows=None, verbose=True):
|
|
61
63
|
"""把数据集写进 md 认知图(幂等:同 id 覆盖)。"""
|
|
62
64
|
rows = rows or load_rows()
|
|
@@ -81,6 +83,7 @@ def build(root=ROOT, rows=None, verbose=True):
|
|
|
81
83
|
|
|
82
84
|
# --------------------------------------------------------------------- 查询构造
|
|
83
85
|
|
|
86
|
+
# 生效条件:遍历 SYNONYM_GROUPS_WEIGHTED 每组,按权重降序找第一个出现在当前 out(初值 text,可能已被前组改写)里的词 w,若组内除 w 外还有词则用其中权重最大者 alt 执行一次 out.replace(w, alt, 1) 且 hits+1,随后 break 该组;返回 (out, hits)。
|
|
84
87
|
def paraphrase(text):
|
|
85
88
|
"""按加权同义词组做一次同义/泛化改写,返回 (改写后, 替换次数)。
|
|
86
89
|
|
|
@@ -99,6 +102,7 @@ def paraphrase(text):
|
|
|
99
102
|
return out, hits
|
|
100
103
|
|
|
101
104
|
|
|
105
|
+
# 生效条件:text 经 SEG_SPLIT.split 后剔除空白项与分隔符本身得 parts,len(parts)<=1 时原样返回 text,否则按 rng.random() < keep_p(默认 0.5;keep_p 为 0 时全被丢弃)保留片段,若一条未留则回退 [parts[0]],返回拼接串。
|
|
102
106
|
def drop_segments(text, rng, keep_p=0.5):
|
|
103
107
|
"""随机丢弃约一半语义片段(模拟「记得不全」)。"""
|
|
104
108
|
parts = [p for p in SEG_SPLIT.split(text)
|
|
@@ -111,6 +115,7 @@ def drop_segments(text, rng, keep_p=0.5):
|
|
|
111
115
|
return "".join(kept)
|
|
112
116
|
|
|
113
117
|
|
|
118
|
+
# 生效条件:rows 中 r.get("label")=="signal" 且 r.get("text") 为真的行入选,n 为真值且 n < len(sig) 时才用 random.Random(seed) 抽 n 条(n=0 等假值不抽样),每条产生 orig/head/drop 三条查询,仅在 paraphrase(t[:60]) 的 hits 非零时追加 para 查询,返回 qs。
|
|
114
119
|
def make_queries(rows, n=250, seed=7):
|
|
115
120
|
"""从 signal 条目构造查询集(多模式)。"""
|
|
116
121
|
sig = [r for r in rows if r.get("label") == "signal" and r.get("text")]
|
|
@@ -131,11 +136,13 @@ def make_queries(rows, n=250, seed=7):
|
|
|
131
136
|
|
|
132
137
|
# ----------------------------------------------------------------------- 评测
|
|
133
138
|
|
|
139
|
+
# 生效条件:传入 cg 后把 cg._read 换成按 entry["path"] 缓存的闭包(该 path 未命中才调用原 _read),返回该 cache 字典。
|
|
134
140
|
def install_read_cache(cg):
|
|
135
141
|
"""评测是只读的:把节点文件读进内存,避免每次检索重复 1000 次磁盘 I/O。"""
|
|
136
142
|
cache = {}
|
|
137
143
|
orig = cg._read
|
|
138
144
|
|
|
145
|
+
# 生效条件:entry["path"] 不在闭包 cache 中时调用 orig(entry) 存入该键,随后返回 cache[p](同一 path 后续命中直接取缓存)。
|
|
139
146
|
def _cached(entry):
|
|
140
147
|
p = entry["path"]
|
|
141
148
|
if p not in cache:
|
|
@@ -146,6 +153,7 @@ def install_read_cache(cg):
|
|
|
146
153
|
return cache
|
|
147
154
|
|
|
148
155
|
|
|
156
|
+
# 生效条件:对 queries 每条 item 以 cg.search_rrf(item["q"], k=k, paths=arm, judge=False, record=False, path_weights=path_weights, recall_only=recall_only, fusion=fusion) 取结果,rank 记 item["target"] 在返回 ids 中的 1 基位次(不在 ids 中记 0),逐条追加明细后返回 out。
|
|
149
157
|
def run_arm(cg, queries, arm, k=10, path_weights=None, recall_only=None,
|
|
150
158
|
fusion="sum"):
|
|
151
159
|
"""跑一臂,返回 per-query 明细。"""
|
|
@@ -167,6 +175,7 @@ def run_arm(cg, queries, arm, k=10, path_weights=None, recall_only=None,
|
|
|
167
175
|
return out
|
|
168
176
|
|
|
169
177
|
|
|
178
|
+
# 生效条件:对 queries 每条以 cg.search_rrf(item["q"], k=k, paths=(path,)) 单路取结果,rank 记 item["target"] 的 1 基位次(未命中记 0),fuzzy_hit 恒为 False、expand_source 恒为 None,返回 out。
|
|
170
179
|
def run_single(cg, queries, path, k=10):
|
|
171
180
|
"""单路独立排序(用于诊断每路的自身质量)。"""
|
|
172
181
|
out = []
|
|
@@ -181,6 +190,7 @@ def run_single(cg, queries, path, k=10):
|
|
|
181
190
|
return out
|
|
182
191
|
|
|
183
192
|
|
|
193
|
+
# 生效条件:rows 为空时返回 None;否则按 n=len(rows) 算 self@1、self@k(0<rank<=k,k 由形参给定)、mrr(仅 rank 非 0 行取 1/rank 再除 n)与标签占比(分母 sum(lab.values()) or 1,无标签时用 1),fuzzy_prov 在 hit_rows 为空时记 0.0。
|
|
184
194
|
def summarize(rows, k=10):
|
|
185
195
|
"""汇总一个查询模式的指标。"""
|
|
186
196
|
n = len(rows)
|
|
@@ -203,10 +213,12 @@ def summarize(rows, k=10):
|
|
|
203
213
|
}
|
|
204
214
|
|
|
205
215
|
|
|
216
|
+
# 生效条件:把 x 乘 100 后按 5 位宽保留一位小数加百分号返回,源码未对 x 做类型或范围校验。
|
|
206
217
|
def _pct(x):
|
|
207
218
|
return f"{x * 100:5.1f}%"
|
|
208
219
|
|
|
209
220
|
|
|
221
|
+
# 生效条件:r4 长度为 0 时返回 {};否则以 seed 建 rng,对 (1,"self@1") 与 (k,f"self@{k}") 由 r4/r5 的 0<rank<=kk 命中向量算 b01/b10,m=b01+b10 为 0 时 p=1.0 否则取 McNemar 精确单侧和除以 2**m,并用 n_boot 次有放回重采样取 deltas[int(0.025*n_boot)] 与 deltas[int(0.975*n_boot)-1] 为 ci,另加 MRR 键(b01/b10/p 与 ci 均为 None)后返回。
|
|
210
222
|
def paired_test(r4, r5, k=10, seed=0, n_boot=5000):
|
|
211
223
|
"""配对显著性:bootstrap 95% CI + McNemar 精确单侧 p(H1: 五路更好)。"""
|
|
212
224
|
from math import comb
|
|
@@ -237,6 +249,7 @@ def paired_test(r4, r5, k=10, seed=0, n_boot=5000):
|
|
|
237
249
|
return out
|
|
238
250
|
|
|
239
251
|
|
|
252
|
+
# 生效条件:scopes 以 ("全合并", r4, r5) 起头,仅当某模式在 r4 中有条目时才追加该模式(orig/head/para/drop)的 (模式名, 筛选后 a, 筛选后 b);对每个 scope 用 k、seed 调 paired_test 并逐项打印 self@1、self@k、MRR 的 delta/ci/b01-b10/p,函数本身不返回值。
|
|
240
253
|
def print_sig(r4, r5, qs, k=10, seed=0):
|
|
241
254
|
"""按查询模式 + 全模式合并,打印配对显著性。"""
|
|
242
255
|
print(f"\n配对显著性(五路 − 四路,配对 bootstrap 5000 次 + McNemar 精确单侧)")
|
|
@@ -260,6 +273,7 @@ def print_sig(r4, r5, qs, k=10, seed=0):
|
|
|
260
273
|
print("-" * 66)
|
|
261
274
|
|
|
262
275
|
|
|
276
|
+
# 生效条件:把 cg._path_fuzzy 换成闭包,原结果按分数降序取前 50 后用 random.Random(seed) 打乱并改写为递减伪分;本函数自身无 return。
|
|
263
277
|
def patch_shuffled_fuzzy(cg, seed=0):
|
|
264
278
|
"""把 fuzzy 路**候选集保留、内部顺序打乱**(对照:区分「候选集贡献」与「排序质量贡献」)。
|
|
265
279
|
|
|
@@ -269,6 +283,7 @@ def patch_shuffled_fuzzy(cg, seed=0):
|
|
|
269
283
|
rng = random.Random(seed)
|
|
270
284
|
orig = cg._path_fuzzy
|
|
271
285
|
|
|
286
|
+
# 生效条件:以 (query, entries, context, expand=expand) 调用原 _path_fuzzy,结果按分数降序取前 50 条,用闭包 rng 打乱后改写为递减伪分 (node, float(n-i)),返回 (out, str(src)+"+shuffled")。
|
|
272
287
|
def _shuf(query, entries, context=None, expand=None):
|
|
273
288
|
out, src = orig(query, entries, context, expand=expand)
|
|
274
289
|
out = sorted(out, key=lambda x: -x[1])[:50] # fuzzy 真实候选集
|
|
@@ -280,10 +295,12 @@ def patch_shuffled_fuzzy(cg, seed=0):
|
|
|
280
295
|
cg._path_fuzzy = _shuf
|
|
281
296
|
|
|
282
297
|
|
|
298
|
+
# 生效条件:把 cg._path_fuzzy 换成忽略 context/expand、对 cg._read_many 全量条目按 random.Random(seed) 随机分降序排序的闭包;本函数自身无 return。
|
|
283
299
|
def patch_random_path(cg, seed=0):
|
|
284
300
|
"""把第 5 路替换为**全库随机排序**(对照:max 融合机制本身能带来多少增益)。"""
|
|
285
301
|
rng = random.Random(seed)
|
|
286
302
|
|
|
303
|
+
# 生效条件:忽略 context 与 expand,对 cg._read_many(entries, stat) 的每条记录用 rng.random() 打分并降序排序,节点 id 取 fm.get("id") or e["path"],返回 (out, "random")。
|
|
287
304
|
def _rand(query, entries, context=None, expand=None):
|
|
288
305
|
stat = {"scanned": 0}
|
|
289
306
|
out = []
|
|
@@ -296,25 +313,33 @@ def patch_random_path(cg, seed=0):
|
|
|
296
313
|
cg._path_fuzzy = _rand
|
|
297
314
|
|
|
298
315
|
|
|
316
|
+
# 生效条件:不使用 cg,直接把 md_cg.mdcos.GLOBAL_CAP 置为 10**9 并返回该值。
|
|
299
317
|
def patch_symmetric_pool(cg):
|
|
300
|
-
"""
|
|
318
|
+
"""【2026-09-16 起已冗余】抬高 GLOBAL_CAP,让 lexical 与 fuzzy 候选池对称。
|
|
301
319
|
|
|
302
|
-
lexical
|
|
303
|
-
|
|
320
|
+
背景:lexical 命中数超 GLOBAL_CAP 时按**插入序**截断,fuzzy 则全库打分后取
|
|
321
|
+
Top-50;两条路候选池不对称,会系统性偏袒 fuzzy。当时以「抬高 cap」对冲。
|
|
322
|
+
|
|
323
|
+
现状:截断依据已改为**相关度**(`mdcg.cut_by_relevance` 与 `mdcos._lexical`
|
|
324
|
+
均先全量打分再排序截断,cap 值仍为 500)——插入序偏置的根因已消除,本 patch
|
|
325
|
+
不再必要。保留仅为兼容既有对照命令(`--symmetric-pool`)与历史口径复现。
|
|
304
326
|
"""
|
|
305
327
|
from md_cg import mdcos as _m
|
|
306
328
|
_m.GLOBAL_CAP = 10 ** 9
|
|
307
329
|
return _m.GLOBAL_CAP
|
|
308
330
|
|
|
309
331
|
|
|
332
|
+
# 生效条件:把 cg._lexical 换成先 cg._read_many(entries, stat) 全量读入、再 cg._score(docs, query, bigrams(query)) 打分的闭包;本函数自身无 return。
|
|
310
333
|
def patch_lexical_full(cg):
|
|
311
334
|
"""让 lexical 也对**全量候选池**打分(消除「扫描范围」差异,只留排序算法差异)。
|
|
312
335
|
|
|
313
|
-
默认 _lexical 只在 LIKE 命中集上打分(中位约 20 条),而 _path_fuzzy 扫全库 1000
|
|
314
|
-
|
|
336
|
+
默认 _lexical 只在 LIKE 命中集上打分(中位约 20 条),而 _path_fuzzy 扫全库 1000 条。
|
|
337
|
+
注:截断依据改为相关度后(2026-09-16),「排序依据不对等」已消除,此处差异
|
|
338
|
+
仅剩**扫描范围**一项;本 patch 仍用于隔离排序算法差异的对照实验。
|
|
315
339
|
"""
|
|
316
340
|
from md_cg.mdcg import bigrams
|
|
317
341
|
|
|
342
|
+
# 生效条件:entries 经 cg._read_many(entries, stat) 全量读入后交给 cg._score(docs, query, bigrams(query)) 打分并返回其结果。
|
|
318
343
|
def _lex(query, entries, stat):
|
|
319
344
|
docs = cg._read_many(entries, stat)
|
|
320
345
|
return cg._score(docs, query, bigrams(query))
|
|
@@ -322,12 +347,14 @@ def patch_lexical_full(cg):
|
|
|
322
347
|
cg._lexical = _lex
|
|
323
348
|
|
|
324
349
|
|
|
350
|
+
# 生效条件:把 cg._read 包装为仅当原 _read 返回的 fm 是 dict 时覆写 fm["importance"]=0.5(非 dict 不修改),返回 (fm, c);本函数自身无 return。
|
|
325
351
|
def patch_zero_importance(cg):
|
|
326
352
|
"""抹掉 importance:数据集里 signal 的 importance 系统性偏高(≈0.6),
|
|
327
353
|
而 search_rrf 用 (-score, -importance) 做同分 tie-break → 会泄漏 label。
|
|
328
354
|
"""
|
|
329
355
|
orig = cg._read
|
|
330
356
|
|
|
357
|
+
# 生效条件:orig(entry) 返回的 fm 是 dict 时把 fm["importance"] 设为 0.5(非 dict 不修改),返回 (fm, c)。
|
|
331
358
|
def _z(entry):
|
|
332
359
|
fm, c = orig(entry)
|
|
333
360
|
if isinstance(fm, dict):
|
|
@@ -337,6 +364,7 @@ def patch_zero_importance(cg):
|
|
|
337
364
|
cg._read = _z
|
|
338
365
|
|
|
339
366
|
|
|
367
|
+
# 生效条件:cg 与 qs 均须可用;内部先经 cg._candidates() 取候选池、cg._read_many 读正文,再按每题 query terms 统计 _like 命中数;只打印诊断(含 GLOBAL_CAP 与截断计数)并返回 None,不改库;
|
|
340
368
|
def pool_diag(cg, qs):
|
|
341
369
|
"""候选池对称性诊断:lexical 的 LIKE 命中数是否真的被 GLOBAL_CAP 截断。"""
|
|
342
370
|
from md_cg import mdcos as _m
|
|
@@ -359,6 +387,7 @@ def pool_diag(cg, qs):
|
|
|
359
387
|
return 0
|
|
360
388
|
|
|
361
389
|
|
|
390
|
+
# 生效条件:cg.search_rrf 可用、queries 每项含 q/target/mode 时,对目标未列首的题打印顶替者与目标在 ARM5 各单路的排名,最多打印 limit 例。
|
|
362
391
|
def diag_failures(cg, queries, k=10, arm=ARM5, limit=6, path_weights=None):
|
|
363
392
|
"""打印失败案例:谁把目标挤掉了、目标在单路里排第几。"""
|
|
364
393
|
print(f"\n失败案例诊断({'+'.join(arm)},Top-{k} 未把目标排第一)")
|
|
@@ -390,6 +419,7 @@ def diag_failures(cg, queries, k=10, arm=ARM5, limit=6, path_weights=None):
|
|
|
390
419
|
print(" (无失败案例)")
|
|
391
420
|
|
|
392
421
|
|
|
422
|
+
# 生效条件:args.ablate=="pool" 时直接返回 pool_diag(cg, qs);=="idcheck" 时对四路 sum 与四路 max 逐条比较 rank/labels 并打印差异数后返回 0;其余取值时先算四路基线与五路 fuzzy max 基线,再按 =="shuffle" 调 patch_shuffled_fuzzy、否则调 patch_random_path 做扰动臂,打印三臂指标后返回 0(k 取 args.k)。
|
|
393
423
|
def ablate(cg, qs, args):
|
|
394
424
|
"""对照实验:分离「候选集贡献」「排序质量贡献」「融合机制红利」。"""
|
|
395
425
|
k = args.k
|
|
@@ -433,6 +463,7 @@ def ablate(cg, qs, args):
|
|
|
433
463
|
return 0
|
|
434
464
|
|
|
435
465
|
|
|
466
|
+
# 生效条件:argv 经 argparse 解析(--n/--k/--seed/--rebuild/--per-path/--sweep/--diag/--ablate/--sympool/--fusion/--lexfull/--zero-importance 等);外部数据集缺失即抛异常、不静默降级;返回进程退出码;
|
|
436
467
|
def main():
|
|
437
468
|
ap = argparse.ArgumentParser()
|
|
438
469
|
ap.add_argument("--n", type=int, default=250, help="抽样 signal 条数(0=全量)")
|
|
@@ -599,4 +630,4 @@ def main():
|
|
|
599
630
|
|
|
600
631
|
if __name__ == "__main__":
|
|
601
632
|
sys.stdout = io.TextIOWrapper(sys.stdout.buffer, encoding="utf-8")
|
|
602
|
-
sys.exit(main())
|
|
633
|
+
sys.exit(main())
|
package/md_cg/bench_p0.py
CHANGED
|
@@ -40,6 +40,7 @@ QUERIES = [("能量守恒", "物理学"), ("二分查找", "计算机科学"), (
|
|
|
40
40
|
("事务隔离", "计算机科学")]
|
|
41
41
|
|
|
42
42
|
|
|
43
|
+
# 生效条件:fn 为可不带参调用的可调用对象时,重复执行 repeat 次并返回耗时(毫秒)的中位数、最小值、最大值三元组。
|
|
43
44
|
def timeit(fn, repeat=5):
|
|
44
45
|
ts = []
|
|
45
46
|
for _ in range(repeat):
|
|
@@ -49,6 +50,7 @@ def timeit(fn, repeat=5):
|
|
|
49
50
|
return statistics.median(ts), min(ts), max(ts)
|
|
50
51
|
|
|
51
52
|
|
|
53
|
+
# 生效条件:模块级常量 ROOT 不是目录(not os.path.isdir(ROOT))时打印未找到提示并返回 1;否则在 ROOT 上建 MdCG 依次跑检索延迟、情境对比与写入/维护基准,打印各项统计与耗时,并返回 0。
|
|
52
54
|
def main():
|
|
53
55
|
if not os.path.isdir(ROOT):
|
|
54
56
|
print(f"未找到 md 库 {ROOT},请先跑 python -m md_cg.test_p0")
|
|
@@ -81,6 +83,7 @@ def main():
|
|
|
81
83
|
|
|
82
84
|
# ---- 2. 条件路由(情境正确)vs 全量 vs 朴素全库读盘扫描 ----
|
|
83
85
|
# 朴素参照:每个查询都把全部节点文件读出来做一次子串匹配(无索引的代价上限)
|
|
86
|
+
# 生效条件:给定 q 时遍历 cg.index["nodes"] 逐个读取 ROOT/e["path"],内容含 q 子串(q 为空串时任何可读内容都命中)即收集其 path,读取抛 OSError 的条目被跳过,返回 hits 列表。
|
|
84
87
|
def brute_force(q):
|
|
85
88
|
hits = []
|
|
86
89
|
for e in cg.index["nodes"].values():
|
|
@@ -144,4 +147,4 @@ if __name__ == "__main__":
|
|
|
144
147
|
# 会在解释器退出阶段丢缓冲(实测只落盘 444 字节),CI 里会看不到结果。
|
|
145
148
|
if hasattr(sys.stdout, "reconfigure"):
|
|
146
149
|
sys.stdout.reconfigure(encoding="utf-8")
|
|
147
|
-
sys.exit(main())
|
|
150
|
+
sys.exit(main())
|
|
@@ -48,11 +48,13 @@ from md_cg.test_sem_noise import ( # noqa: E402
|
|
|
48
48
|
GOLD, GOLD_COND, NEG_TEXTS, NEIGHBORS, QUERY, UNREL_DOCS, _doc)
|
|
49
49
|
|
|
50
50
|
|
|
51
|
+
# 生效条件:ev、ids 给定时按 ids 顺序找首个满足 nid in ev 的 1-based 位次返回,找不到(或 ids 为空、ev 为空)时返回 0。
|
|
51
52
|
def rank_of(ev, ids):
|
|
52
53
|
"""gold 在 id 排名中的位次(不在则 0)。"""
|
|
53
54
|
return next((r for r, nid in enumerate(ids, 1) if nid in ev), 0)
|
|
54
55
|
|
|
55
56
|
|
|
57
|
+
# 生效条件:rank 为 1 时 st["h1"] 加 1,rank 落在 0<rank<=5 时 st["h5"] 加 1,落在 0<rank<=10 时 st["h10"] 加 1,rank 为真值时 st["rr"] 加 1.0/rank(负 rank 亦进入该分支得负增量),无返回值。
|
|
56
58
|
def _agg(rank, st):
|
|
57
59
|
if rank == 1:
|
|
58
60
|
st["h1"] += 1
|
|
@@ -64,6 +66,7 @@ def _agg(rank, st):
|
|
|
64
66
|
st["rr"] += 1.0 / rank
|
|
65
67
|
|
|
66
68
|
|
|
69
|
+
# 生效条件:label、st、n 与可选 extra 给定时打印 label、st["h1"/"h5"/"h10"]*100.0/n、st["rr"]/n 及 extra 组成的行,n 为 0 时因源码直接相除抛 ZeroDivisionError(源码未校验 n)。
|
|
67
70
|
def _show(label, st, n, extra=""):
|
|
68
71
|
print(" %-22s hit@1=%5.1f%% hit@5=%5.1f%% hit@10=%5.1f%% "
|
|
69
72
|
"MRR=%.4f%s" % (label, st["h1"] * 100.0 / n,
|
|
@@ -71,6 +74,7 @@ def _show(label, st, n, extra=""):
|
|
|
71
74
|
st["rr"] / n, extra))
|
|
72
75
|
|
|
73
76
|
|
|
77
|
+
# 生效条件:qa、docs 给定时对 docs 每项按 jaccard(qa, na) 降序、id 升序排序并返回其 id 序列,docs 为空返回空列表,qa 为空时全部分数相同故只按 id 升序。
|
|
74
78
|
def full_rank(qa, docs):
|
|
75
79
|
"""全池 Jaccard 排序 → id 序列(与 run_arm 同判据)。"""
|
|
76
80
|
scored = sorted(((jaccard(qa, na), nid) for nid, na in docs),
|
|
@@ -78,6 +82,7 @@ def full_rank(qa, docs):
|
|
|
78
82
|
return [nid for _s, nid in scored]
|
|
79
83
|
|
|
80
84
|
|
|
85
|
+
# 生效条件:无 required 形参;以模块级常量 CORPUS、QUESTIONS 逐行 json.loads 建语料与题目,每题取 evidence_turns 与 question 分词结果,qa 为空则跳过且不计入 n,最终返回含 g0/g2/g1i/g1f/n/fa10_conservative/avg_pool 的统计字典(分母均以 max(·,1) 兜零)。
|
|
81
86
|
def exp_locomo():
|
|
82
87
|
"""实验一:原子面渐进三形态。"""
|
|
83
88
|
t0 = time.time()
|
|
@@ -91,15 +96,19 @@ def exp_locomo():
|
|
|
91
96
|
print("[progressive] 实验一 locomo-zh-500 · 语料 %d / 题 %d"
|
|
92
97
|
% (len(corpus), len(questions)))
|
|
93
98
|
|
|
99
|
+
pool_sizes = [] # G1 各阶段候选池大小(统计面)
|
|
100
|
+
|
|
101
|
+
# 生效条件:used 给定时对其 frozenset 调 full_rank 取前 20 条,把该池大小追加进 pool_sizes,返回由这些 id 与 0.0 组成的二元组列表。
|
|
94
102
|
def rank_fn(used):
|
|
95
|
-
|
|
96
|
-
|
|
103
|
+
ranked = full_rank(frozenset(used), docs)[:20]
|
|
104
|
+
pool_sizes.append(len(ranked))
|
|
105
|
+
return [(nid, 0.0) for nid in ranked]
|
|
97
106
|
|
|
98
107
|
st_g0 = {"h1": 0, "h5": 0, "h10": 0, "rr": 0.0}
|
|
99
108
|
st_g2 = dict(st_g0)
|
|
100
109
|
st_i = dict(st_g0)
|
|
101
110
|
st_f = dict(st_g0)
|
|
102
|
-
steps_sum = conv = n = 0
|
|
111
|
+
steps_sum = conv = n = fa10_sum = 0
|
|
103
112
|
for q in questions:
|
|
104
113
|
ev = set(q.get("evidence_turns") or [])
|
|
105
114
|
qa = [w for w in zh_map_en(str(q.get("question") or ""),
|
|
@@ -117,8 +126,11 @@ def exp_locomo():
|
|
|
117
126
|
ratio=0.5, k=10, max_stages=4)
|
|
118
127
|
_agg(rank_of(ev, full_rank(frozenset(tr["stages"][0]["used"]),
|
|
119
128
|
docs)), st_i)
|
|
120
|
-
|
|
121
|
-
|
|
129
|
+
fin_all = full_rank(frozenset(tr["stages"][-1]["used"]), docs)
|
|
130
|
+
_agg(rank_of(ev, fin_all), st_f)
|
|
131
|
+
# 保守 false_accept 口径:final top10 内非 gold 条数(本语料无资格
|
|
132
|
+
# 判定面,非 gold 全计为假接受——上界,见打印行口径注明)
|
|
133
|
+
fa10_sum += sum(1 for nid in fin_all[:10] if nid not in ev)
|
|
122
134
|
steps_sum += len(tr["added"])
|
|
123
135
|
conv += 1 if (tr["converged"] or len(tr["added"]) < 3) else 0
|
|
124
136
|
|
|
@@ -130,9 +142,19 @@ def exp_locomo():
|
|
|
130
142
|
print(" refinement: 平均加条件数=%.2f 一步收敛率=%.1f%% (n=%d, %.0fs)"
|
|
131
143
|
% (steps_sum / max(n, 1), conv * 100.0 / max(n, 1), n,
|
|
132
144
|
time.time() - t0))
|
|
133
|
-
|
|
145
|
+
print(" false_accept(保守口径)=%.2f%% =G1 final top10 非 gold 平均占比"
|
|
146
|
+
"(上界:本语料无 CCG 注释面,非 gold 全计为假接受)"
|
|
147
|
+
% (fa10_sum * 10.0 / max(n, 1)))
|
|
148
|
+
print(" 候选池: G1 各阶段平均 top 池大小=%.1f (k=20 上限)"
|
|
149
|
+
% (sum(pool_sizes) / max(len(pool_sizes), 1)))
|
|
150
|
+
print(" 四态分布: 本实验为原子面(语料无 CCG 注释,judge_qualification "
|
|
151
|
+
"将全判 BLINDSPOT)——资格判定不适用,不硬造数字;四态实证见实验二")
|
|
152
|
+
return {"g0": st_g0, "g2": st_g2, "g1i": st_i, "g1f": st_f, "n": n,
|
|
153
|
+
"fa10_conservative": fa10_sum * 10.0 / max(n, 1),
|
|
154
|
+
"avg_pool": sum(pool_sizes) / max(len(pool_sizes), 1)}
|
|
134
155
|
|
|
135
156
|
|
|
157
|
+
# 生效条件:无必需形参;自建临时库(tempfile.mkdtemp + MdCGOS)注入 GOLD/NEIGHBORS 语料后跑渐进消歧,finally 清理临时目录;返回指标 dict,不依赖外部数据;
|
|
136
158
|
def exp_controlled():
|
|
137
159
|
"""实验二:受控干扰池——条件冒充形态下渐进消歧(引擎侧真检索)。"""
|
|
138
160
|
print("\n[progressive] 实验二 受控干扰池(42+2 节点真实 MdCGOS)")
|
|
@@ -162,12 +184,14 @@ def exp_controlled():
|
|
|
162
184
|
KW = dict(paths=("lexical", "bucket", "entity", "graph", "fuzzy"),
|
|
163
185
|
fusion="sum", judge_ranking=True)
|
|
164
186
|
|
|
187
|
+
# 生效条件:used 给定时,used 为假值(空列表等)则查询串仅为 QUERY,否则为 QUERY 加空格再加空格连接的 used,再经 cg.search_rrf(k=10, judge=True, **KW) 返回 (id, 分值) 列表。
|
|
165
188
|
def engine_rank(used):
|
|
166
189
|
res, _m = cg.search_rrf(QUERY + (" " + " ".join(used)
|
|
167
190
|
if used else ""),
|
|
168
191
|
k=10, judge=True, **KW)
|
|
169
192
|
return [(r[0]["id"], r[1]) for r in res]
|
|
170
193
|
|
|
194
|
+
# 生效条件:res 给定时遍历其前 10 项,跳过 r[0]["id"] 属于外层 gold_ids 的项,对余项取 r[2](len(r)<=2 时取空 dict)并仅在 (ji or {}).get("state")=="ACCEPT" 时把该 id 收入,返回收集到的 out 列表。
|
|
171
195
|
def false_accepts(res):
|
|
172
196
|
out = []
|
|
173
197
|
for r in res[:10]:
|
|
@@ -179,13 +203,34 @@ def exp_controlled():
|
|
|
179
203
|
out.append(nid)
|
|
180
204
|
return out
|
|
181
205
|
|
|
206
|
+
# 生效条件:res 给定时遍历其前 10 项,len(r)>2 时取 (r[2] or {}).get("state")、否则取 None,该值属于 ACCEPT/DEFER/REJECT/BLINDSPOT 四键之一则对应计数、否则计入「无judge」,返回只保留计数非零项的字典(全零则返回空 dict)。
|
|
207
|
+
def state_dist(res):
|
|
208
|
+
"""渐进循环四态分布(top10 内 judge state 计数,只列非零项)。
|
|
209
|
+
|
|
210
|
+
judge info 直接复用 search_rrf(judge=True) 注入的
|
|
211
|
+
judge_qualification 产物(结果第三元),不重复判定。
|
|
212
|
+
"""
|
|
213
|
+
d = {"ACCEPT": 0, "DEFER": 0, "REJECT": 0, "BLINDSPOT": 0,
|
|
214
|
+
"无judge": 0}
|
|
215
|
+
for r in res[:10]:
|
|
216
|
+
st = (r[2] or {}).get("state") if len(r) > 2 else None
|
|
217
|
+
d[st if st in d else "无judge"] += 1
|
|
218
|
+
return {k: v for k, v in d.items() if v}
|
|
219
|
+
|
|
220
|
+
# 生效条件:res、fa 给定时返回 100.0*len(fa)/max(1, min(10, len(res))),即 len(res)>=10 时除以 10、不足时除以 len(res),len(res) 为 0 时被 max(1,·) 兜为除数 1。
|
|
221
|
+
def fa_rate(res, fa):
|
|
222
|
+
return 100.0 * len(fa) / max(1, min(10, len(res)))
|
|
223
|
+
|
|
182
224
|
# 宽检索(不加任何条件;judgeinfo 直接取 results 第三元)
|
|
183
225
|
wide_res, _m = cg.search_rrf(QUERY, k=10, judge=True, **KW)
|
|
184
226
|
wide = [(r[0]["id"], r[1]) for r in wide_res]
|
|
185
227
|
fa_pre = false_accepts(wide_res)
|
|
186
228
|
top1_pre = wide[0][0] if wide else None
|
|
187
|
-
print(" 宽检索 top1=%s top10 内 False ACCEPT=%s"
|
|
188
|
-
% (top1_pre, fa_pre or "无"))
|
|
229
|
+
print(" 宽检索 top1=%s top10 内 False ACCEPT=%s(率=%.1f%%)"
|
|
230
|
+
% (top1_pre, fa_pre or "无", fa_rate(wide_res, fa_pre)))
|
|
231
|
+
print(" 四态分布(宽检索 top10)=%s 候选池=%d judge 剔除=%s"
|
|
232
|
+
% (state_dist(wide_res), len(wide_res),
|
|
233
|
+
(_m or {}).get("judge_filtered", 0)))
|
|
189
234
|
|
|
190
235
|
# 渐进:候选间区分性条件词 → 带条件重排
|
|
191
236
|
POOL = ["我", "喝水", "吃饭", "电脑", "书", "音乐", "出门",
|
|
@@ -203,7 +248,12 @@ def exp_controlled():
|
|
|
203
248
|
fa_post = false_accepts(refined_res)
|
|
204
249
|
top1_post = refined_res[0][0]["id"] if refined_res else None
|
|
205
250
|
print(" 区分性条件=%r → 重排 top1=%s top10 内 "
|
|
206
|
-
"False ACCEPT=%s"
|
|
251
|
+
"False ACCEPT=%s(率=%.1f%%)"
|
|
252
|
+
% (cond, top1_post, fa_post or "无",
|
|
253
|
+
fa_rate(refined_res, fa_post)))
|
|
254
|
+
print(" 四态分布(重排 top10)=%s 候选池=%d judge 剔除=%s"
|
|
255
|
+
% (state_dist(refined_res), len(refined_res),
|
|
256
|
+
(_m2 or {}).get("judge_filtered", 0)))
|
|
207
257
|
ok1 = top1_post in gold_ids
|
|
208
258
|
no_new = set(fa_post) <= set(fa_pre)
|
|
209
259
|
print(" 断言①渐进后 top1∈gold:%s" % ("PASS" if ok1 else "FAIL"))
|
|
@@ -225,6 +275,7 @@ def exp_controlled():
|
|
|
225
275
|
shutil.rmtree(tmp, ignore_errors=True)
|
|
226
276
|
|
|
227
277
|
|
|
278
|
+
# 生效条件:无 required 形参;先执行 exp_locomo(),再按 exp_controlled() 返回值 ok 的真假返回 0(真)或 1(假)。
|
|
228
279
|
def main():
|
|
229
280
|
exp_locomo()
|
|
230
281
|
ok = exp_controlled()
|
|
@@ -234,4 +285,4 @@ def main():
|
|
|
234
285
|
|
|
235
286
|
|
|
236
287
|
if __name__ == "__main__":
|
|
237
|
-
raise SystemExit(main())
|
|
288
|
+
raise SystemExit(main())
|