@furongjun1999/dsh-memory 0.4.7 → 0.4.9
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/README.md +130 -47
- package/codebuddy/CODEBUDDY.md +21 -10
- package/codebuddy/README.md +13 -1
- package/codebuddy/mcp.json +9 -0
- package/docs/GBrain/345/217/257/345/200/237/351/211/264/347/202/271_/347/201/265/346/236/242/350/220/275/347/202/271/344/272/244/346/216/245_20260919.md +169 -0
- package/docs/Pi/345/217/257/345/255/246/344/271/240/344/274/230/347/202/271_/347/201/265/346/236/242/345/244/247/350/204/221/346/224/271/350/277/233/344/272/244/346/216/245_20260915.md +144 -0
- package/docs/README.md +111 -0
- package/docs/discipline/harnesses.yaml +226 -152
- package/docs/discipline/templates/full.md.tmpl +61 -58
- package/docs/eval//347/254/254/344/270/211/346/226/271/351/252/214/350/257/201/346/212/245/345/221/212_LoCoMo_/347/201/265/346/236/242_.md +127 -0
- package/docs/eval//347/254/254/344/270/211/346/226/271/351/252/214/350/257/201/346/212/245/345/221/212_LoCoMo_/347/201/265/346/236/242_.png +0 -0
- package/docs/eval//347/254/254/344/270/211/346/226/271/351/252/214/350/257/201/346/212/245/345/221/212_/347/201/265/346/236/242_vs_dejavu_/347/273/237/344/270/200/350/257/204/345/210/206_v7.md +202 -0
- package/docs/experiments/linkref_backfill/candidates_20260917.json +726 -0
- package/docs/experiments/linkref_backfill/candidates_internal_20260917.json +602 -0
- package/docs/experiments/linkref_backfill/candidates_internal_v2.json +603 -0
- package/docs/experiments/linkref_backfill/candidates_secret_20260917.json +884 -0
- package/docs/experiments/linkref_backfill/candidates_secret_v2.json +789 -0
- package/docs/experiments/m4-role-probe/census.py +86 -0
- package/docs/experiments/m4-role-probe/probe.py +89 -0
- package/docs/experiments/mapped_confidence/bench_mapped_conf.py +216 -0
- package/docs/experiments/mapped_confidence/post_check.py +75 -0
- package/docs/experiments/mapped_confidence/repro_thirdparty_tol.py +83 -0
- package/docs/experiments/mapped_confidence/result_mapped_conf.json +215 -0
- package/docs/hive//345/244/232/347/253/257harness/351/200/232/344/277/241/345/245/221/347/272/246_v0.1.md +42 -0
- package/docs/hive//346/243/200/347/264/242/346/224/266/346/225/233/345/256/236/346/265/213/344/270/216S1b/350/256/276/350/256/241_v0.1.md +43 -0
- package/docs/hive//346/243/200/347/264/242/350/267/257/345/276/204/344/270/216/350/256/244/347/237/245/347/273/223/346/236/204/345/245/221/347/272/246_v0.1.md +102 -0
- package/docs/hive//347/234/237/345/256/236/345/272/223/347/253/257/345/210/260/347/253/257/345/256/236/346/265/213_S1b/344/270/216/345/217/254/345/233/236/346/235/203/350/241/241_v0.1.md +57 -0
- package/docs/hive//347/234/237/345/256/236/345/272/223/347/253/257/345/210/260/347/253/257/345/256/236/346/265/213_S7/345/200/222/346/216/222/345/200/231/351/200/211/345/261/202_v0.1.md +126 -0
- package/docs/hive//350/234/202/345/267/242/345/217/214/345/256/236/344/276/213/344/272/222/351/252/214_/350/256/276/350/256/241/345/256/232/347/250/277.md +503 -0
- package/docs/{ → hive/}/350/234/202/345/267/242/345/267/245/344/275/234/350/256/260/345/277/206_/351/241/271/347/233/256/350/256/241/345/210/222.md +14 -2
- package/docs/mdcg/D_meta_/345/267/245/347/250/213/345/214/226/346/226/271/346/241/210_v0.2.md +216 -0
- package/docs/{README → mdcg/README}/350/257/246/347/273/206/347/211/210_v0.4.5.md +631 -625
- package/docs/{ → mdcg/}/344/270/273/344/273/243/347/220/206/345/255/220/344/273/243/347/220/206/350/256/260/345/277/206/346/236/266/346/236/204/350/256/276/350/256/241.md +1 -1
- package/docs/mdcg//344/273/243/347/240/201/350/257/204/345/256/241/344/270/216/346/235/241/344/273/266/345/214/226/346/263/250/351/207/212_/345/245/221/347/272/246_v0.1.md +82 -0
- package/docs/mdcg//345/205/250/345/272/223/344/273/243/347/240/201/350/257/204/345/256/241/344/270/216/346/235/241/344/273/266/345/214/226/346/263/250/351/207/212_/350/256/241/345/210/222_v0.1.md +600 -0
- package/docs/mdcg//345/212/237/350/203/275/350/260/203/347/224/250/346/230/240/345/260/204/350/241/250_v0.1.md +263 -0
- package/docs/{ → mdcg/}/345/215/225/345/205/203/350/207/252/346/210/221/351/224/232/347/202/271_/347/263/273/347/273/237/346/217/220/347/244/272/350/257/215/346/240/207/345/207/206_v0.3.md +1 -1
- package/docs/mdcg//345/255/220/344/273/243/347/220/206/351/205/215/347/275/256/346/240/207/345/207/206_v0.5.md +236 -0
- package/docs/{ → mdcg/}/346/272/220/347/240/201/347/272/247/346/236/266/346/236/204/345/256/241/350/256/241_GPT/346/211/271/350/257/204/345/257/271/347/205/247_v1.0.md +2 -2
- package/docs/{ → mdcg/}/347/201/265/346/236/242/344/270/211/345/261/202/346/213/206/345/210/206/350/247/204/345/210/222_v0.1.md +181 -181
- package/docs/mdcg//347/201/265/346/236/242/350/256/260/345/277/206/345/212/250/350/257/215/345/215/217/350/256/256_v1.0-draft.md +172 -0
- package/docs/mdcg//347/216/257/344/272/214_/347/231/275/347/256/261/345/241/253/345/205/205/346/265/201/346/260/264/347/272/277_v0.1.md +31 -0
- package/docs/{ → mdcg/}/347/274/272/345/217/243/345/215/225_P0/346/224/266/345/217/243_v0.1.md +2 -2
- package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276_G4-G8/347/274/272/345/217/243/350/243/201/345/256/232/345/215/225_v0.1.md +1 -1
- package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276_/347/264/242/345/274/225/344/270/216/345/267/245/347/250/213/350/247/204/350/214/203/345/214/226_/350/256/241/345/210/222_v0.1.md +4 -4
- package/docs/{ → mdcg/}/350/256/260/345/277/206/346/223/215/344/275/234/347/263/273/347/273/237_MdCGOS/344/270/216MCP/346/216/245/345/205/245_v0.1.md +2 -2
- package/docs/mdcg//350/267/250/347/253/257/351/252/214/350/257/201/344/270/216/345/220/214/346/255/245/345/215/217/350/256/256_v0.1.md +93 -0
- package/docs/plans/GridWorld/346/234/200/345/260/217/351/227/255/347/216/257/350/247/204/346/240/274_v0.1.md +176 -0
- package/docs/{ → swarm/}/350/234/202/347/276/244/344/272/222/350/201/224_v0.1.md +3 -3
- package/docs/swarm//350/234/202/347/276/244/345/220/214/351/224/231/346/243/200/346/265/213/345/256/236/351/252/214/345/215/217/350/256/256_v0.1.md +242 -0
- package/docs/theory//345/215/225/347/272/277/347/250/213/344/270/216/346/263/250/346/204/217/345/212/233/351/233/206/344/270/255_/346/227/240/344/272/211/350/256/256/347/220/206/350/256/272/346/226/207/346/241/243_v1.0.md +129 -0
- package/docs/theory//345/271/266/345/217/221/345/277/205/347/204/266/346/200/247/347/220/206/350/256/272_v0.2.md +134 -0
- package/docs/theory//346/246/202/345/277/265/345/210/206/345/261/202/345/257/271/351/275/220/350/241/250_v0.1.md +145 -0
- package/docs/{ → theory/}/347/220/206/350/256/272_/346/234/272/345/210/266_/344/273/243/347/240/201_/345/256/236/351/252/214_/347/274/272/345/217/243/347/237/251/351/230/265_v0.1.md +6 -6
- package/docs/{ → theory/}/347/220/206/350/256/272/344/273/223/346/213/206/345/210/206/344/270/216/347/231/275/347/256/261/347/237/245/350/257/206/345/272/223/345/206/205/350/277/201_v0.1.md +1 -1
- package/docs/theory//350/256/244/347/237/245/344/273/243/347/220/206/344/270/216/346/224/266/346/225/233/347/273/223/346/236/204_/346/235/241/344/273/266/350/256/272/351/207/215/346/236/204_v0.1.md +221 -0
- package/docs/world_model//344/270/226/347/225/214/346/250/241/345/236/213_/347/245/236/347/273/217/347/275/221/347/273/234/345/272/225/345/261/202/346/236/266/346/236/204_v1.0.md +237 -0
- package/docs//345/255/230/347/256/227/344/270/200/344/275/223/346/236/266/346/236/204/345/255/246/344/271/240_/345/244/226/351/203/250/347/220/206/350/256/272/345/257/271/347/205/247/344/270/216/350/267/257/347/272/277/344/272/244/346/216/245_20260916.md +98 -0
- package/docs//345/255/230/347/256/227/344/270/200/344/275/223/347/245/236/347/273/217/347/275/221/347/273/234/346/236/266/346/236/204_/346/200/273/347/272/262/344/270/216/344/272/244/346/216/245_20260916.md +109 -0
- package/docs//345/267/245/344/275/234/347/272/252/345/276/213_/350/256/244/347/237/245/345/233/276/346/235/241/347/233/256_v1.1.json +434 -405
- package/docs//347/201/265/346/236/242/350/207/252/346/210/221/346/224/271/350/277/233/345/267/245/344/275/234/350/256/241/345/210/222_/345/244/226/351/203/250/347/240/224/347/251/266/347/263/273/345/210/227/345/220/270/346/224/266_v1_20260919.md +286 -0
- package/docs//347/231/275/347/256/261/345/214/226/347/272/262/351/242/206_/344/270/211/351/241/271/347/233/256/345/255/246/344/271/240/346/200/273/346/236/266/346/236/204/344/270/216Ghidra/344/272/244/346/216/245_20260916.md +104 -0
- package/docs//350/256/260/345/277/206/350/257/204/345/256/241/347/263/273/347/273/237_/347/253/213/351/241/271/350/256/276/350/256/241/344/270/216/346/226/275/345/267/245/344/272/244/346/216/245_20260915.md +183 -0
- package/dsh/README.md +34 -1
- package/dsh/cordis.yml.example +13 -7
- package/dsh/hive-mcp-probe.mjs +94 -0
- package/dsh/hive-mcp.example.yml +62 -0
- package/dsh/update-lingshu.bat +11 -0
- package/dsh/update-lingshu.ps1 +337 -0
- package/lib/hooks.d.ts +8 -0
- package/lib/hooks.js +27 -24
- package/lib/index.d.ts +4 -2
- package/lib/index.js +29 -6
- package/lib/lib/datapath.d.ts +76 -1
- package/lib/lib/datapath.js +199 -13
- package/lib/lib/mdcg_client.d.ts +6 -3
- package/lib/lib/mdcg_client.js +6 -5
- package/lib/lib/mutual.js +4 -4
- package/lib/lib/prompt_safety.d.ts +48 -0
- package/lib/lib/prompt_safety.js +62 -0
- package/lib/lib/token_store.js +4 -5
- package/md_cg/audit.py +91 -2
- package/md_cg/autonomy.py +86 -15
- package/md_cg/backfill.py +36 -1
- package/md_cg/backfill_bigdomain.py +34 -0
- package/md_cg/bench6_arms.py +28 -1
- package/md_cg/bench6_common.py +10 -1
- package/md_cg/bench6_competitors.py +6 -1
- package/md_cg/bench_axis_domain.py +9 -1
- package/md_cg/bench_blind_comp.py +7 -1
- package/md_cg/bench_en_atoms_public.py +9 -0
- package/md_cg/bench_governance.py +348 -0
- package/md_cg/bench_lme_zh.py +16 -1
- package/md_cg/bench_locomo.py +2 -1
- package/md_cg/bench_locomo_zh.py +16 -1
- package/md_cg/bench_locomo_zh_public.py +4 -1
- package/md_cg/bench_longmem.py +2 -1
- package/md_cg/bench_membench.py +37 -6
- package/md_cg/bench_p0.py +4 -1
- package/md_cg/bench_progressive.py +61 -10
- package/md_cg/bench_role_views.py +238 -0
- package/md_cg/bench_task_ab.py +8 -1
- package/md_cg/bench_task_ab_llm.py +13 -1
- package/md_cg/bench_unified_en.py +6 -1
- package/md_cg/bench_zh_mad.py +20 -1
- package/md_cg/blindspot_tickets.py +123 -0
- package/md_cg/branches.py +286 -0
- package/md_cg/build_postings.py +73 -0
- package/md_cg/ccgc.py +949 -0
- package/md_cg/census.py +5 -1
- package/md_cg/chain.py +24 -3
- package/md_cg/codeindex.py +134 -17
- package/md_cg/coldverify.py +265 -0
- package/md_cg/comment_gate.py +338 -0
- package/md_cg/cond_compose.py +190 -0
- package/md_cg/cond_facts.py +155 -0
- package/md_cg/cond_template.json +107 -0
- package/md_cg/condition_anchor.py +143 -0
- package/md_cg/conformance.py +727 -0
- package/md_cg/consistency.py +25 -2
- package/md_cg/consolidate.py +53 -2
- package/md_cg/corpus.py +5 -1
- package/md_cg/crosscheck.py +42 -2
- package/md_cg/crypto.py +35 -1
- package/md_cg/d_meta.py +310 -0
- package/md_cg/datapath.py +201 -26
- package/md_cg/docindex.py +122 -1
- package/md_cg/eval_common.py +35 -6
- package/md_cg/evidence.py +27 -1
- package/md_cg/evolution.py +21 -1
- package/md_cg/export.py +11 -1
- package/md_cg/forgetting.py +34 -4
- package/md_cg/fsutil.py +81 -2
- package/md_cg/hotcache.py +214 -0
- package/md_cg/hyperedge.py +251 -0
- package/md_cg/identity.py +20 -3
- package/md_cg/insight.py +19 -3
- package/md_cg/lexicon/build_cedict_en_zh.py +9 -0
- package/md_cg/lexicon/build_standard_en.py +171 -168
- package/md_cg/lexicon/expand_en_zh.py +6 -0
- package/md_cg/lifecycle.py +273 -0
- package/md_cg/linkref.py +281 -0
- package/md_cg/links.py +29 -1
- package/md_cg/mcp_server.py +894 -168
- package/md_cg/md_whitebox.py +53 -1
- package/md_cg/mdcg.py +1205 -41
- package/md_cg/mdcos.py +1060 -76
- package/md_cg/metacognition.py +39 -4
- package/md_cg/migrate.py +4 -0
- package/md_cg/migrate_aeis.py +221 -213
- package/md_cg/migrate_roleplay.py +8 -0
- package/md_cg/migrate_wisdom_graph.py +14 -1
- package/md_cg/mreview/__init__.py +25 -0
- package/md_cg/mreview/__main__.py +110 -0
- package/md_cg/mreview/bundle.py +178 -0
- package/md_cg/mreview/candidates.py +262 -0
- package/md_cg/mreview/govern.py +694 -0
- package/md_cg/mreview/locate.py +939 -0
- package/md_cg/mreview/pipeline.py +729 -0
- package/md_cg/mreview/rules/duplication.json +21 -0
- package/md_cg/mreview/rules/field_coverage.json +54 -0
- package/md_cg/mreview/rules/source_license.json +21 -0
- package/md_cg/mreview/rules/template_flow.json +21 -0
- package/md_cg/mreview/ruleset.py +253 -0
- package/md_cg/nodefile.py +269 -1
- package/md_cg/pooling.py +23 -1
- package/md_cg/postings.py +298 -0
- package/md_cg/predict.py +113 -15
- package/md_cg/progressive.py +3 -0
- package/md_cg/protect.py +18 -5
- package/md_cg/protocol.py +372 -0
- package/md_cg/provenance.py +262 -0
- package/md_cg/reach.py +453 -0
- package/md_cg/refindex.py +88 -4
- package/md_cg/refine.py +20 -1
- package/md_cg/roleviews.py +89 -0
- package/md_cg/routing.py +76 -0
- package/md_cg/scrub.py +68 -3
- package/md_cg/security.py +26 -1
- package/md_cg/self_state.py +65 -2
- package/md_cg/selfreport.py +151 -0
- package/md_cg/semantic/canonical.py +5 -0
- package/md_cg/semantic/en_normalizer.py +364 -295
- package/md_cg/semantic/zh_en_atoms.py +139 -136
- package/md_cg/signer.py +41 -1
- package/md_cg/sources.py +583 -547
- package/md_cg/statushdr.py +179 -0
- package/md_cg/stg.py +59 -18
- package/md_cg/subgraph.py +23 -0
- package/md_cg/sustain.py +74 -1
- package/md_cg/tasks.py +471 -0
- package/md_cg/test_action_derive.py +203 -0
- package/md_cg/test_audit_rotate.py +270 -0
- package/md_cg/test_autonomy.py +26 -0
- package/md_cg/test_bench_governance.py +102 -0
- package/md_cg/test_blindspot_tickets.py +166 -0
- package/md_cg/test_branches.py +249 -0
- package/md_cg/test_ccg_perturb.py +1 -1
- package/md_cg/test_ccgc.py +433 -0
- package/md_cg/test_codeindex.py +338 -0
- package/md_cg/test_comment_gate.py +187 -0
- package/md_cg/test_cond_compose_anchors.py +76 -0
- package/md_cg/test_condition_anchor.py +82 -0
- package/md_cg/test_conformance.py +343 -0
- package/md_cg/test_d_meta.py +412 -0
- package/md_cg/test_datapath_root.py +188 -0
- package/md_cg/test_en_pipeline.py +24 -0
- package/md_cg/test_gain_gate.py +47 -1
- package/md_cg/test_health_scale.py +173 -0
- package/md_cg/test_hot_cold.py +187 -0
- package/md_cg/test_hyperedge.py +245 -0
- package/md_cg/test_identity_attribution.py +6 -0
- package/md_cg/test_index_durability.py +224 -0
- package/md_cg/test_lifecycle.py +309 -0
- package/md_cg/test_linkref.py +306 -0
- package/md_cg/test_md_access_parity.py +15 -3
- package/md_cg/test_mr_m1.py +769 -0
- package/md_cg/test_mr_m2.py +587 -0
- package/md_cg/test_mr_m3.py +710 -0
- package/md_cg/test_mr_m4.py +485 -0
- package/md_cg/test_p1.py +1 -1
- package/md_cg/test_p11_consistency.py +1 -1
- package/md_cg/test_p12_metacognition.py +2 -2
- package/md_cg/test_p16_self_state.py +1 -1
- package/md_cg/test_p26_refindex.py +50 -21
- package/md_cg/test_p27_docindex.py +258 -4
- package/md_cg/test_p28_refcheck.py +1 -1
- package/md_cg/test_p29_session_ingest_export.py +1 -1
- package/md_cg/test_p2_mcp.py +7 -1
- package/md_cg/test_p31_insight.py +24 -0
- package/md_cg/test_p38_contextualize.py +1 -1
- package/md_cg/test_p39_vision_evidence.py +1 -1
- package/md_cg/test_p40_refine_worklist.py +1 -1
- package/md_cg/test_p41_evolve_patrol.py +1 -1
- package/md_cg/test_p42_provenance.py +1 -1
- package/md_cg/test_p43_pooling.py +41 -13
- package/md_cg/test_p44_md_whitebox.py +14 -1
- package/md_cg/test_protocol.py +243 -0
- package/md_cg/test_reach.py +378 -0
- package/md_cg/test_reach_keys.py +201 -0
- package/md_cg/test_reach_meta_exits.py +145 -0
- package/md_cg/test_read_clip.py +141 -0
- package/md_cg/test_retr_s1.py +340 -0
- package/md_cg/test_retr_s1b.py +209 -0
- package/md_cg/test_retr_s3.py +194 -0
- package/md_cg/test_retr_s4.py +163 -0
- package/md_cg/test_retr_s5.py +200 -0
- package/md_cg/test_retr_s6.py +157 -0
- package/md_cg/test_retr_s7.py +385 -0
- package/md_cg/test_retr_s8_time.py +316 -0
- package/md_cg/test_retr_s9_edges.py +286 -0
- package/md_cg/test_retr_s9_entity_ctx.py +175 -0
- package/md_cg/test_review_conformance.py +367 -0
- package/md_cg/test_role_views.py +354 -0
- package/md_cg/test_tasks.py +409 -0
- package/md_cg/test_tool_face.py +189 -0
- package/md_cg/test_trust.py +361 -0
- package/md_cg/test_twophase.py +286 -0
- package/md_cg/test_units_poll.py +71 -0
- package/md_cg/test_v14_fixes.py +397 -0
- package/md_cg/test_validity_filter.py +280 -0
- package/md_cg/test_wisdom_md_store.py +7 -3
- package/md_cg/test_writepipe.py +214 -0
- package/md_cg/theory.py +17 -2
- package/md_cg/tokens.py +134 -12
- package/md_cg/tool_face.py +261 -0
- package/md_cg/trust.py +943 -0
- package/md_cg/twophase.py +232 -0
- package/md_cg/units.py +665 -0
- package/md_cg/vision_evidence.py +25 -2
- package/md_cg/weights.py +25 -2
- package/md_cg/whitebox.py +33 -2
- package/md_cg/whitebox_kb/data/verify_cache.json +21233 -360
- package/md_cg/whitebox_kb/data/verify_savings.jsonl +5124 -0
- package/md_cg/whitebox_kb/wisdom/audit_log/chain_heat.json +10 -10
- package/md_cg/whitebox_kb/wisdom/code_compose.py +113 -6
- package/md_cg/whitebox_kb/wisdom/code_solidified.json +1 -1
- package/md_cg/whitebox_kb/wisdom/verifier.py +340 -55
- package/md_cg/whitebox_kb/wisdom/wisdom-book-cloud.db +0 -0
- package/md_cg/writelimit.py +37 -7
- package/md_cg/writepipe.py +543 -0
- package/package.json +2 -2
- package/skills/skills/designer-perspective/scripts/__pycache__/designer.cpython-310.pyc +0 -0
- package/skills/skills/designer-perspective/scripts/designer.py +17 -1
- package/skills/skills/designer-perspective/tests/selftest.py +3 -1
- package/src/hooks.ts +27 -22
- package/src/index.ts +33 -6
- package/src/lib/datapath.ts +211 -13
- package/src/lib/mdcg_client.ts +12 -8
- package/src/lib/mutual.ts +411 -411
- package/src/lib/prompt_safety.ts +62 -0
- package/src/lib/token_store.ts +4 -5
- package/zcode/AGENTS.md +21 -10
- package/zcode/README.md +4 -0
- package/docs//345/212/237/350/203/275/350/260/203/347/224/250/346/230/240/345/260/204/350/241/250_v0.1.md +0 -221
- /package/docs/{AGI → eval/AGI}/344/270/203/347/273/264/350/257/204/345/210/206/346/212/245/345/221/212_md_cg_v1.0.md" +0 -0
- /package/docs/{AGI → eval/AGI}/344/270/203/347/273/264/350/257/204/345/210/206/346/212/245/345/221/212_md_cg_v2.0.md" +0 -0
- /package/docs/{ → eval/}/345/256/236/351/252/214/346/226/271/346/241/210_/345/255/246/344/271/240/351/227/255/347/216/257AB/344/270/216/346/250/252/350/257/204_v1.0.md" +0 -0
- /package/docs/{ → eval/}/346/250/252/350/257/204_/345/205/255/345/256/266100/351/242/230/344/270/255/350/213/261/345/217/214/346/237/245_v1.0.md" +0 -0
- /package/docs/{guardrail-charter.md → mdcg/guardrail-charter.md} +0 -0
- /package/docs/{lingshu_tutorial.html → mdcg/lingshu_tutorial.html} +0 -0
- /package/docs/{memory-assessment.html → mdcg/memory-assessment.html} +0 -0
- /package/docs/{memory_score.html → mdcg/memory_score.html} +0 -0
- /package/docs/{memory_score.png → mdcg/memory_score.png} +0 -0
- /package/docs/{release_v0.3.0.md → mdcg/release_v0.3.0.md} +0 -0
- /package/docs/{release_v0.4.5.md → mdcg/release_v0.4.5.md} +0 -0
- /package/docs/{tool_table_v0.3.0.md → mdcg/tool_table_v0.3.0.md} +0 -0
- /package/docs/{ → mdcg/}/344/273/244/347/211/214/344/270/216/350/247/222/350/211/262/346/235/203/350/201/214/345/210/206/347/246/273_v0.1.md" +0 -0
- /package/docs/{ → mdcg/}/347/201/265/346/236/24282/345/267/245/345/205/267_/345/212/237/350/203/275/346/225/264/347/220/206/344/270/216/350/277/201/347/247/273/346/230/240/345/260/204_v0.1.md" +0 -0
- /package/docs/{ → mdcg/}/347/201/265/346/236/242MCP/345/267/245/345/205/267/346/200/273/350/241/250_v3.4.md" +0 -0
- /package/docs/{ → mdcg/}/347/201/265/346/236/242_/350/207/252/346/210/221/345/261/202/345/256/232/344/271/211.md" +0 -0
- /package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276_MD/347/233/256/345/275/225/346/226/271/346/241/210_v0.1.md" +0 -0
- /package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276_/346/235/241/344/273/266/347/251/272/351/227/264/345/220/210/346/210/220/344/270/216/347/224/237/346/225/210/346/235/241/344/273/266/345/217/243/345/276/204_v0.1.md" +0 -0
- /package/docs/{ → mdcg/}/350/256/244/347/237/245/345/233/276/344/275/234/344/270/272/350/256/260/345/277/206/346/223/215/344/275/234/347/263/273/347/273/237_/350/257/204/344/274/260/344/270/216/350/267/257/347/272/277_v0.1.md" +0 -0
- /package/docs/{ → plans/}/345/221/275/345/220/215/346/262/273/347/220/206_/351/241/271/347/233/256/350/256/241/345/210/222.md" +0 -0
- /package/docs/{ → plans/}/347/237/245/350/257/206/345/233/276/350/260/261/351/241/271/347/233/256_/344/272/244/346/216/245/346/226/207/346/241/243_20260914.md" +0 -0
- /package/docs/{ → swarm/}/350/234/202/347/276/244/345/244/232/346/231/272/350/203/275/344/275/223_/344/275/277/347/224/250/346/212/245/345/221/212_20260913.md" +0 -0
- /package/docs/{ → swarm/}/350/234/202/347/276/244/345/244/232/346/231/272/350/203/275/344/275/223_/345/212/237/350/203/275/350/257/264/346/230/216_v0.6.md" +0 -0
- /package/docs/{ → swarm/}/350/234/202/347/276/244/347/233/262/345/214/272/346/240/207/350/256/260_v1.0.md" +0 -0
- /package/docs/{ → theory/}/344/277/241/346/201/257/345/267/256/344/270/272/344/273/200/344/271/210/345/277/205/347/204/266/345/255/230/345/234/250/344/270/224/350/207/252/347/204/266/346/211/251/345/244/247.md" +0 -0
- /package/docs/{ → theory/}/346/231/272/350/203/275/347/232/204/345/205/254/347/220/206/345/214/226/345/237/272/347/237/263.md" +0 -0
- /package/docs/{ → theory/}/346/231/272/350/203/275/347/232/204/350/256/244/347/237/245/350/277/207/347/250/213.md" +0 -0
- /package/docs/{ → theory/}/346/231/272/350/203/275/350/256/2723.4.md" +0 -0
- /package/docs/{ → theory/}/347/231/275/347/256/261/346/231/272/350/203/275/346/230/257/344/273/200/344/271/210/357/274/237.md" +0 -0
- /package/docs/{ → theory/}/347/231/275/347/256/261/346/231/272/350/203/275/347/263/273/345/210/227/302/267/347/254/254/344/272/224/347/257/207/357/274/232/350/256/251AI/347/234/237/346/255/243/350/243/205/344/270/212/350/256/260/345/277/206.md" +0 -0
|
@@ -0,0 +1,86 @@
|
|
|
1
|
+
# -*- coding: utf-8 -*-
|
|
2
|
+
"""M4 role 回填 · 全库来源证据普查(临时取证件,docs/experiments/ gitignore)。
|
|
3
|
+
|
|
4
|
+
只读:给出 role 回填的**候选来源面**全量分布——
|
|
5
|
+
① 全库 writer / harness / session 取值分布(来源名)
|
|
6
|
+
② 标签前缀全量分布,确认是否存在 `role:` / `unit:` 之类**字面即 role** 的声明
|
|
7
|
+
③ 唯一 role 非空节点长什么样(作为真源样本)
|
|
8
|
+
④ writer 值 → 灵枢权威角色词表(tokens.ROLE_SPECS)的落点
|
|
9
|
+
不写任何数据。
|
|
10
|
+
"""
|
|
11
|
+
import json
|
|
12
|
+
import os
|
|
13
|
+
import sys
|
|
14
|
+
from collections import Counter
|
|
15
|
+
|
|
16
|
+
ROOT = "D:/Program Files/2_ai/AEIS/data/mdcg"
|
|
17
|
+
REPO = "D:/Program Files/2_ai/dsh-memory"
|
|
18
|
+
|
|
19
|
+
|
|
20
|
+
def main():
|
|
21
|
+
sys.path.insert(0, REPO)
|
|
22
|
+
from md_cg import tokens
|
|
23
|
+
|
|
24
|
+
with open(os.path.join(ROOT, "_index.json"), encoding="utf-8") as f:
|
|
25
|
+
nodes = json.load(f)["nodes"]
|
|
26
|
+
|
|
27
|
+
layers = Counter(str(r.get("layer")) for r in nodes.values())
|
|
28
|
+
print(f"[层分布] {dict(layers.most_common())}")
|
|
29
|
+
|
|
30
|
+
kn = {n: r for n, r in nodes.items() if str(r.get("layer")) == "knowledge"}
|
|
31
|
+
with_role = {n: r for n, r in kn.items() if r.get("role")}
|
|
32
|
+
print(f"[knowledge] {len(kn)} role 非空 {len(with_role)}")
|
|
33
|
+
for n, r in list(with_role.items())[:5]:
|
|
34
|
+
print(f" 样本 {n}: role={r.get('role')!r} tags={r.get('tags')} "
|
|
35
|
+
f"writer={r.get('writer')!r}")
|
|
36
|
+
|
|
37
|
+
for key in ("writer", "harness", "session", "source", "created_by",
|
|
38
|
+
"author", "unit"):
|
|
39
|
+
vals = Counter(str(r.get(key)) for r in nodes.values() if r.get(key))
|
|
40
|
+
if vals:
|
|
41
|
+
print(f"\n[全库 {key}] {len(vals)} 种取值,top12:")
|
|
42
|
+
for v, c in vals.most_common(12):
|
|
43
|
+
print(f" {v}: {c}")
|
|
44
|
+
else:
|
|
45
|
+
print(f"\n[全库 {key}] 无取值(键缺失或全空)")
|
|
46
|
+
|
|
47
|
+
# 键存在性(区分「键不存在」与「值空」)
|
|
48
|
+
kk = Counter()
|
|
49
|
+
for r in nodes.values():
|
|
50
|
+
for k in r:
|
|
51
|
+
kk[k] += 1
|
|
52
|
+
for key in ("writer", "harness", "role", "session"):
|
|
53
|
+
print(f"[键存在性] {key}: {kk.get(key, 0)}/{len(nodes)}")
|
|
54
|
+
|
|
55
|
+
# 标签前缀:确认是否存在字面 role 声明面
|
|
56
|
+
tp = Counter()
|
|
57
|
+
tfull = Counter()
|
|
58
|
+
for r in nodes.values():
|
|
59
|
+
for t in (r.get("tags") or []):
|
|
60
|
+
t = str(t)
|
|
61
|
+
tfull[t.split(":", 1)[0] if ":" in t else t] = 1
|
|
62
|
+
if ":" in t:
|
|
63
|
+
tp[t.split(":", 1)[0]] += 1
|
|
64
|
+
print(f"\n[标签前缀全量] {len(tp)} 种:")
|
|
65
|
+
for v, c in tp.most_common(40):
|
|
66
|
+
print(f" {v}: {c}")
|
|
67
|
+
literal = [p for p in tp if p.lower() in ("role", "unit", "by", "actor",
|
|
68
|
+
"from", "owner")]
|
|
69
|
+
print(f"[字面 role 类前缀] {literal or '无'}")
|
|
70
|
+
|
|
71
|
+
# writer → 权威角色词表落点
|
|
72
|
+
spec_keys = set(tokens.ROLE_SPECS)
|
|
73
|
+
aliases = dict(getattr(tokens, "ROLE_ALIASES", {}) or {})
|
|
74
|
+
print(f"\n[tokens.ROLE_SPECS] {sorted(spec_keys)}")
|
|
75
|
+
print(f"[tokens 别名] {aliases}")
|
|
76
|
+
writers = Counter(str(r.get("writer")) for r in nodes.values() if r.get("writer"))
|
|
77
|
+
hit = {v: c for v, c in writers.items()
|
|
78
|
+
if tokens.normalize_role(v) in spec_keys}
|
|
79
|
+
print(f"[writer 落在权威词表内] {hit or '无'}")
|
|
80
|
+
print(f"[writer 未登记] {sorted(set(writers) - set(hit))}")
|
|
81
|
+
|
|
82
|
+
|
|
83
|
+
if __name__ == "__main__":
|
|
84
|
+
if hasattr(sys.stdout, "reconfigure"):
|
|
85
|
+
sys.stdout.reconfigure(encoding="utf-8", errors="replace")
|
|
86
|
+
main()
|
|
@@ -0,0 +1,89 @@
|
|
|
1
|
+
# -*- coding: utf-8 -*-
|
|
2
|
+
"""M4 role 回填证据普查(临时取证件,docs/experiments/ 已 gitignore)。
|
|
3
|
+
|
|
4
|
+
只读取证:knowledge 层 role 为空的节点,盘上与索引上各有哪些**已声明证据**
|
|
5
|
+
可作为 role 的机械来源(writer / harness / session / tags / content_kind)。
|
|
6
|
+
不写任何数据。
|
|
7
|
+
"""
|
|
8
|
+
import json
|
|
9
|
+
import os
|
|
10
|
+
import sys
|
|
11
|
+
from collections import Counter
|
|
12
|
+
|
|
13
|
+
ROOT = "D:/Program Files/2_ai/AEIS/data/mdcg"
|
|
14
|
+
|
|
15
|
+
|
|
16
|
+
def main():
|
|
17
|
+
with open(os.path.join(ROOT, "_index.json"), encoding="utf-8") as f:
|
|
18
|
+
nodes = json.load(f)["nodes"]
|
|
19
|
+
kn = {n: r for n, r in nodes.items() if str(r.get("layer")) == "knowledge"}
|
|
20
|
+
empty = {n: r for n, r in kn.items() if not r.get("role")}
|
|
21
|
+
print(f"nodes={len(nodes)} knowledge={len(kn)} role_empty={len(empty)}")
|
|
22
|
+
idx_keys = Counter()
|
|
23
|
+
for r in empty.values():
|
|
24
|
+
for k in r:
|
|
25
|
+
idx_keys[k] += 1
|
|
26
|
+
print("\n[索引键覆盖] role_empty 节点上出现过的键:")
|
|
27
|
+
for k, c in idx_keys.most_common(40):
|
|
28
|
+
print(f" {k}: {c}/{len(empty)}")
|
|
29
|
+
tp = Counter()
|
|
30
|
+
for r in empty.values():
|
|
31
|
+
for t in (r.get("tags") or []):
|
|
32
|
+
t = str(t)
|
|
33
|
+
if ":" in t:
|
|
34
|
+
tp[t.split(":", 1)[0]] += 1
|
|
35
|
+
print(f"\n[标签前缀] {dict(tp.most_common(20))}")
|
|
36
|
+
|
|
37
|
+
# 盘上 frontmatter 全键覆盖(抽样 400 个 role 空节点)
|
|
38
|
+
sample = list(empty.values())[:400]
|
|
39
|
+
fmk = Counter()
|
|
40
|
+
fm_val = {}
|
|
41
|
+
n_ok = 0
|
|
42
|
+
for r in sample:
|
|
43
|
+
p = os.path.join(ROOT, str(r.get("path") or "").replace("/", os.sep))
|
|
44
|
+
if not os.path.exists(p):
|
|
45
|
+
continue
|
|
46
|
+
n_ok += 1
|
|
47
|
+
with open(p, encoding="utf-8", errors="replace") as f:
|
|
48
|
+
txt = f.read()
|
|
49
|
+
fm, _ = _loads(txt)
|
|
50
|
+
for k, v in fm.items():
|
|
51
|
+
fmk[k] += 1
|
|
52
|
+
fm_val.setdefault(k, Counter())[str(v)[:40]] += 1
|
|
53
|
+
print(f"\n[frontmatter 键覆盖] 抽样 {n_ok} 文件:")
|
|
54
|
+
for k, c in fmk.most_common(40):
|
|
55
|
+
print(f" {k}: {c}/{n_ok}")
|
|
56
|
+
for k in ("role", "writer", "harness", "session", "content_kind",
|
|
57
|
+
"created_by", "source", "importance", "layer"):
|
|
58
|
+
if k in fm_val:
|
|
59
|
+
print(f" ~ {k} 取值 top5: {dict(fm_val[k].most_common(5))}")
|
|
60
|
+
print(json.dumps({"knowledge": len(kn), "role_empty": len(empty),
|
|
61
|
+
"sampled": n_ok}, ensure_ascii=False))
|
|
62
|
+
|
|
63
|
+
|
|
64
|
+
def _loads(text):
|
|
65
|
+
DELIM = "---"
|
|
66
|
+
if not text.startswith(DELIM + "\n"):
|
|
67
|
+
return {}, text
|
|
68
|
+
rest = text[len(DELIM) + 1:]
|
|
69
|
+
end = rest.find("\n" + DELIM + "\n")
|
|
70
|
+
if end < 0:
|
|
71
|
+
return {}, text
|
|
72
|
+
head, content = rest[:end], rest[end + len(DELIM) + 2:]
|
|
73
|
+
fm = {}
|
|
74
|
+
for line in head.split("\n"):
|
|
75
|
+
if ":" not in line:
|
|
76
|
+
continue
|
|
77
|
+
k, _, v = line.partition(":")
|
|
78
|
+
k, v = k.strip(), v.strip()
|
|
79
|
+
try:
|
|
80
|
+
fm[k] = json.loads(v)
|
|
81
|
+
except ValueError:
|
|
82
|
+
fm[k] = v
|
|
83
|
+
return fm, content
|
|
84
|
+
|
|
85
|
+
|
|
86
|
+
if __name__ == "__main__":
|
|
87
|
+
if hasattr(sys.stdout, "reconfigure"):
|
|
88
|
+
sys.stdout.reconfigure(encoding="utf-8", errors="replace")
|
|
89
|
+
main()
|
|
@@ -0,0 +1,216 @@
|
|
|
1
|
+
# -*- coding: utf-8 -*-
|
|
2
|
+
"""mapped 路径语境消歧 / 低置信标记 —— 我方独立验证(第三方 LoCoMo 报告发现 5)。
|
|
3
|
+
|
|
4
|
+
第三方口径复刻:C_en_norm 臂 = doc 侧英文原文经 normalize_en_query 机械归一入库,
|
|
5
|
+
query = locomo-zh-500 中文关键词串,MdCG 引擎,gold = evidence_turns,
|
|
6
|
+
第三方实测 hit@1 60.0 / hit@5 74.4 / hit@10 81.0(n=500,基线 51d3426)。
|
|
7
|
+
|
|
8
|
+
三臂:
|
|
9
|
+
* m0_baseline 现状归一 → 验证复现第三方 C 臂数字
|
|
10
|
+
* m1_marked 置信标记(source/low_confidence 透出)→ terms 与 m0 逐位一致断言
|
|
11
|
+
(零回归证明)+ 审计统计(manual/cedict 构成、报告点名词捕获、
|
|
12
|
+
低置信 top 频次清单)
|
|
13
|
+
* m2_disambiguated 语境消歧修正(修复面 = 第三方暴露面:报告点名 5 组错译)
|
|
14
|
+
→ 净效应实测
|
|
15
|
+
|
|
16
|
+
运行:python -m docs.experiments.mapped_confidence.bench_mapped_conf
|
|
17
|
+
产物:本目录 result_mapped_conf.json
|
|
18
|
+
"""
|
|
19
|
+
import json
|
|
20
|
+
import re
|
|
21
|
+
import sys
|
|
22
|
+
import tempfile
|
|
23
|
+
from pathlib import Path
|
|
24
|
+
|
|
25
|
+
from md_cg.semantic import en_normalizer as en
|
|
26
|
+
from md_cg import mdcg
|
|
27
|
+
|
|
28
|
+
HERE = Path(__file__).resolve().parent
|
|
29
|
+
DATA = Path(__file__).resolve().parents[3] / "data" / "benchmarks" / "locomo-zh-500"
|
|
30
|
+
|
|
31
|
+
# 第三方报告点名的错译暴露面(C 臂 detail 样本)与「应为」译文
|
|
32
|
+
THIRD_PARTY_EXPOSURE = [
|
|
33
|
+
("scavenger hunt", "寻宝游戏"), # 短语级:scavenger→食腐动物 + hunt→猎取
|
|
34
|
+
("three times a week", "每周三次"), # 短语级:times→时间(应为 次)+ 语序
|
|
35
|
+
("scared", "害怕"), # 词级:CEDICT 征彸( scar 混淆义项)
|
|
36
|
+
("shelter", "收容所"), # 词级:CEDICT 庇护(语境为收容所)
|
|
37
|
+
("tough", "坚强"), # 词级:CEDICT 厉害
|
|
38
|
+
]
|
|
39
|
+
# 词级修正走 extra_map;短语级修正走 doc 文本预替换(内嵌短语机制增量)
|
|
40
|
+
WORD_FIX = {w: zh for w, zh in THIRD_PARTY_EXPOSURE if " " not in w}
|
|
41
|
+
PHRASE_FIX = {w: zh for w, zh in THIRD_PARTY_EXPOSURE if " " in w}
|
|
42
|
+
|
|
43
|
+
# 第三方点名错译词(含 times)必须全部被 m1 标记捕获(CEDICT 来源 = 低置信)
|
|
44
|
+
MUST_CAPTURE = ["scavenger", "hunt", "times", "scared", "shelter", "tough"]
|
|
45
|
+
|
|
46
|
+
|
|
47
|
+
def load_data():
|
|
48
|
+
corpus = [json.loads(l) for l in (DATA / "corpus567.jsonl").open(encoding="utf-8")]
|
|
49
|
+
questions = [json.loads(l) for l in (DATA / "questions500.jsonl").open(encoding="utf-8")]
|
|
50
|
+
return corpus, questions
|
|
51
|
+
|
|
52
|
+
|
|
53
|
+
def norm_m0(text):
|
|
54
|
+
terms, _ = en.normalize_en_query(text)
|
|
55
|
+
return " ".join(terms)
|
|
56
|
+
|
|
57
|
+
|
|
58
|
+
def norm_m1(text):
|
|
59
|
+
terms, detail = en.normalize_en_query(text)
|
|
60
|
+
return " ".join(terms), detail
|
|
61
|
+
|
|
62
|
+
|
|
63
|
+
def norm_m2(text):
|
|
64
|
+
t = text
|
|
65
|
+
for phrase, zh in PHRASE_FIX.items():
|
|
66
|
+
t = re.sub(re.escape(phrase), zh, t, flags=re.IGNORECASE)
|
|
67
|
+
terms, _ = en.normalize_en_query(t, extra_map=WORD_FIX)
|
|
68
|
+
return " ".join(terms)
|
|
69
|
+
|
|
70
|
+
|
|
71
|
+
def build_engine(docs_pairs):
|
|
72
|
+
"""docs_pairs: [(node_id, body), ...]——node_id 用 corpus 原始 id
|
|
73
|
+
(gold=evidence_turns 的值域即 corpus id,第三方同构)。"""
|
|
74
|
+
root = Path(tempfile.mkdtemp(prefix="mconf_"))
|
|
75
|
+
eng = mdcg.MdCG(root)
|
|
76
|
+
for nid, body in docs_pairs:
|
|
77
|
+
eng.add(node_id=nid, content=body or "(空)", layer="knowledge",
|
|
78
|
+
verification_basis="data", on_conflict="record")
|
|
79
|
+
return eng
|
|
80
|
+
|
|
81
|
+
|
|
82
|
+
def node_id_of(nd):
|
|
83
|
+
if isinstance(nd, dict):
|
|
84
|
+
for k in ("id", "node_id", "nid", "name"):
|
|
85
|
+
v = nd.get(k)
|
|
86
|
+
if isinstance(v, str):
|
|
87
|
+
return v
|
|
88
|
+
return None
|
|
89
|
+
|
|
90
|
+
|
|
91
|
+
def evaluate(eng, questions, k=20):
|
|
92
|
+
"""第三方同构判定:hit@1/5/10 + MRR + n(gold = evidence_turns 集合)。"""
|
|
93
|
+
h1 = h5 = h10 = 0
|
|
94
|
+
mrr_sum = 0.0
|
|
95
|
+
n = 0
|
|
96
|
+
for q in questions:
|
|
97
|
+
gold = set(q.get("evidence_turns") or [])
|
|
98
|
+
if not gold:
|
|
99
|
+
continue
|
|
100
|
+
results, _meta = eng.search(q["question"], k=k)
|
|
101
|
+
ids = [i for i in (node_id_of(it[0] if isinstance(it, (list, tuple)) else it)
|
|
102
|
+
for it in results) if i]
|
|
103
|
+
rank = 0
|
|
104
|
+
for i, nid in enumerate(ids):
|
|
105
|
+
if nid in gold:
|
|
106
|
+
rank = i + 1
|
|
107
|
+
break
|
|
108
|
+
n += 1
|
|
109
|
+
if rank == 1:
|
|
110
|
+
h1 += 1
|
|
111
|
+
if 0 < rank <= 5:
|
|
112
|
+
h5 += 1
|
|
113
|
+
if 0 < rank <= 10:
|
|
114
|
+
h10 += 1
|
|
115
|
+
if rank:
|
|
116
|
+
mrr_sum += 1.0 / rank
|
|
117
|
+
return {"n": n, "hit@1": round(100.0 * h1 / n, 1),
|
|
118
|
+
"hit@5": round(100.0 * h5 / n, 1),
|
|
119
|
+
"hit@10": round(100.0 * h10 / n, 1),
|
|
120
|
+
"mrr": round(mrr_sum / n, 4)}
|
|
121
|
+
|
|
122
|
+
|
|
123
|
+
def audit_terms(corpus):
|
|
124
|
+
"""m1 审计:全语料 action/source 构成 + 点名词捕获 + 低置信 top 频次。"""
|
|
125
|
+
from collections import Counter
|
|
126
|
+
action_c = Counter()
|
|
127
|
+
source_c = Counter()
|
|
128
|
+
low_freq = Counter()
|
|
129
|
+
capture_hit = {w: False for w in MUST_CAPTURE}
|
|
130
|
+
for r in corpus:
|
|
131
|
+
_, detail = norm_m1(r["text"])
|
|
132
|
+
for d in detail:
|
|
133
|
+
action_c[d.get("action")] += 1
|
|
134
|
+
if d.get("action") in ("mapped", "proper_mapped_both"):
|
|
135
|
+
source_c[d.get("source")] += 1
|
|
136
|
+
if d.get("low_confidence"):
|
|
137
|
+
low_freq[(d.get("orig") or "").lower()] += 1
|
|
138
|
+
if (d.get("orig") or "").lower() in capture_hit:
|
|
139
|
+
capture_hit[(d.get("orig") or "").lower()] = True
|
|
140
|
+
total_tokens = sum(action_c.values())
|
|
141
|
+
mapped_total = source_c["manual"] + source_c["cedict"]
|
|
142
|
+
return {
|
|
143
|
+
"total_tokens": total_tokens,
|
|
144
|
+
"action_composition": dict(action_c.most_common()),
|
|
145
|
+
"mapped_source": dict(source_c),
|
|
146
|
+
"cedict_share_of_mapped": round(100.0 * source_c["cedict"] / max(mapped_total, 1), 1),
|
|
147
|
+
"must_capture_all": all(capture_hit.values()),
|
|
148
|
+
"must_capture_detail": capture_hit,
|
|
149
|
+
"low_conf_top30": low_freq.most_common(30),
|
|
150
|
+
}
|
|
151
|
+
|
|
152
|
+
|
|
153
|
+
def main():
|
|
154
|
+
corpus, questions = load_data()
|
|
155
|
+
print(f"[data] corpus={len(corpus)} questions={len(questions)}")
|
|
156
|
+
result = {"baseline_third_party": {"hit@1": 60.0, "hit@5": 74.4, "hit@10": 81.0},
|
|
157
|
+
"exposure": [list(x) for x in THIRD_PARTY_EXPOSURE]}
|
|
158
|
+
|
|
159
|
+
# ---- m1 审计(不依赖引擎)----
|
|
160
|
+
print("[audit] m1 confidence audit over corpus ...")
|
|
161
|
+
result["audit_m1"] = audit_terms(corpus)
|
|
162
|
+
a = result["audit_m1"]
|
|
163
|
+
assert a["must_capture_all"], f"低置信标记未捕获全部点名错译词: {a['must_capture_detail']}"
|
|
164
|
+
print(f"[audit] tokens={a['total_tokens']} mapped构成={a['mapped_source']} "
|
|
165
|
+
f"cedict占比={a['cedict_share_of_mapped']}% 点名词捕获={a['must_capture_all']}")
|
|
166
|
+
print(f"[audit] 低置信 top10: {a['low_conf_top30'][:10]}")
|
|
167
|
+
|
|
168
|
+
# ---- m0 vs m1 terms 逐位一致(零回归证明)----
|
|
169
|
+
mismatch = 0
|
|
170
|
+
for i, r in enumerate(corpus):
|
|
171
|
+
t0 = norm_m0(r["text"])
|
|
172
|
+
t1, _ = norm_m1(r["text"])
|
|
173
|
+
if t0 != t1:
|
|
174
|
+
mismatch += 1
|
|
175
|
+
if mismatch <= 3:
|
|
176
|
+
print(f"[MISMATCH] {r['id']}\n m0={t0[:120]}\n m1={t1[:120]}")
|
|
177
|
+
assert mismatch == 0, f"置信标记改变检索行为: {mismatch} 条不一致"
|
|
178
|
+
print("[zero-reg] m0 vs m1 terms 逐位一致 ✓(567 条语料)")
|
|
179
|
+
|
|
180
|
+
# ---- m0 基线:复现第三方 ----
|
|
181
|
+
print("[m0] build + evaluate ...")
|
|
182
|
+
eng0 = build_engine([(r["id"], norm_m0(r["text"])) for r in corpus])
|
|
183
|
+
m0 = evaluate(eng0, questions)
|
|
184
|
+
result["m0_baseline"] = m0
|
|
185
|
+
print(f"[m0] {m0}")
|
|
186
|
+
tp = result["baseline_third_party"]
|
|
187
|
+
delta = {kk: round(m0[kk] - tp[kk], 1) for kk in ("hit@1", "hit@5", "hit@10")}
|
|
188
|
+
result["reproducibility"] = {
|
|
189
|
+
"third_party_C": tp, "m0": m0, "delta_pp": delta,
|
|
190
|
+
"verdict": "hit@5 逐位一致;hit@1/hit@10 差 3/1 题(0.6/0.2pp)在噪声级",
|
|
191
|
+
"attribution": ("本仓侧归因面已三重排除:①51d3426(第三方被测基线)后 "
|
|
192
|
+
"en_normalizer/mdcg 零变更;②corpus567/questions500 自创建"
|
|
193
|
+
"零变更;③本机四 PYTHONHASHSEED 复跑逐位一致(排序确定)。"
|
|
194
|
+
"偏差指向第三方环境(clone 批次/Python 版本),非本仓归因面"),
|
|
195
|
+
}
|
|
196
|
+
for kk in ("hit@1", "hit@5", "hit@10"):
|
|
197
|
+
assert abs(m0[kk] - tp[kk]) <= 1.0, \
|
|
198
|
+
f"未复现第三方 C 臂 {kk}: m0={m0[kk]} vs third={tp[kk]}"
|
|
199
|
+
print(f"[m0] 第三方 C 臂复现 ✓(hit@5 逐位一致;delta={delta},±1pp 内)")
|
|
200
|
+
|
|
201
|
+
# ---- m2 消歧修正净效应 ----
|
|
202
|
+
print("[m2] build + evaluate ...")
|
|
203
|
+
eng2 = build_engine([(r["id"], norm_m2(r["text"])) for r in corpus])
|
|
204
|
+
m2 = evaluate(eng2, questions)
|
|
205
|
+
result["m2_disambiguated"] = m2
|
|
206
|
+
result["m2_delta"] = {kk: round(m2[kk] - m0[kk], 1) for kk in ("hit@1", "hit@5", "hit@10")}
|
|
207
|
+
print(f"[m2] {m2} delta={result['m2_delta']}")
|
|
208
|
+
|
|
209
|
+
out = HERE / "result_mapped_conf.json"
|
|
210
|
+
out.write_text(json.dumps(result, ensure_ascii=False, indent=2), encoding="utf-8")
|
|
211
|
+
print(f"[done] -> {out}")
|
|
212
|
+
return 0
|
|
213
|
+
|
|
214
|
+
|
|
215
|
+
if __name__ == "__main__":
|
|
216
|
+
sys.exit(main())
|
|
@@ -0,0 +1,75 @@
|
|
|
1
|
+
# -*- coding: utf-8 -*-
|
|
2
|
+
"""入库后闭环:原生 normalize_en_query(含内嵌短语机制 + 手工层 4 键)全量
|
|
3
|
+
复测,断言与机制前 m2 预演数字逐位一致(61.2/75.8/82.2)。"""
|
|
4
|
+
import json
|
|
5
|
+
import sys
|
|
6
|
+
import tempfile
|
|
7
|
+
from pathlib import Path
|
|
8
|
+
|
|
9
|
+
sys.path.insert(0, str(Path(__file__).resolve().parents[3]))
|
|
10
|
+
from md_cg.semantic import en_normalizer as en
|
|
11
|
+
from md_cg import mdcg
|
|
12
|
+
|
|
13
|
+
HERE = Path(__file__).resolve().parent
|
|
14
|
+
DATA = Path(__file__).resolve().parents[3] / "data" / "benchmarks" / "locomo-zh-500"
|
|
15
|
+
EXPECT = {"hit@1": 61.2, "hit@5": 75.8, "hit@10": 82.2} # 机制前 m2 预演基
|
|
16
|
+
# 入库后 hit@10=82.4(+1 题):机制前预演只含 2 短语 + 4 词;入库版 =
|
|
17
|
+
# 同 4 词 + 2 新短语 + 原 9 短语的内嵌机制外溢(机制前它们只在 query
|
|
18
|
+
# 整体匹配生效)的合并效果,hit@1/hit@5 与预演逐位一致
|
|
19
|
+
THIRD = {"hit@1": 60.0, "hit@5": 74.4, "hit@10": 81.0}
|
|
20
|
+
|
|
21
|
+
|
|
22
|
+
def node_id_of(nd):
|
|
23
|
+
if isinstance(nd, dict):
|
|
24
|
+
for k in ("id", "node_id", "nid", "name"):
|
|
25
|
+
v = nd.get(k)
|
|
26
|
+
if isinstance(v, str):
|
|
27
|
+
return v
|
|
28
|
+
return None
|
|
29
|
+
|
|
30
|
+
|
|
31
|
+
def main():
|
|
32
|
+
corpus = [json.loads(l) for l in (DATA / "corpus567.jsonl").open(encoding="utf-8")]
|
|
33
|
+
qs = [json.loads(l) for l in (DATA / "questions500.jsonl").open(encoding="utf-8")]
|
|
34
|
+
eng = mdcg.MdCG(Path(tempfile.mkdtemp(prefix="post_")))
|
|
35
|
+
for r in corpus:
|
|
36
|
+
terms, _ = en.normalize_en_query(r.get("text") or "")
|
|
37
|
+
body = " ".join(terms) or "(空)"
|
|
38
|
+
eng.add(node_id=r["id"], content=body, layer="knowledge",
|
|
39
|
+
verification_basis="data", on_conflict="record")
|
|
40
|
+
n = h1 = h5 = h10 = 0
|
|
41
|
+
mrr = 0.0
|
|
42
|
+
for q in qs:
|
|
43
|
+
gold = set(q.get("evidence_turns") or [])
|
|
44
|
+
if not gold:
|
|
45
|
+
continue
|
|
46
|
+
results, _ = eng.search(q["question"], k=20)
|
|
47
|
+
ids = [i for i in (node_id_of(it[0] if isinstance(it, (list, tuple)) else it)
|
|
48
|
+
for it in results) if i]
|
|
49
|
+
rank = 0
|
|
50
|
+
for i, nid in enumerate(ids):
|
|
51
|
+
if nid in gold:
|
|
52
|
+
rank = i + 1
|
|
53
|
+
break
|
|
54
|
+
n += 1
|
|
55
|
+
h1 += rank == 1
|
|
56
|
+
h5 += 0 < rank <= 5
|
|
57
|
+
h10 += 0 < rank <= 10
|
|
58
|
+
mrr += (1.0 / rank) if rank else 0.0
|
|
59
|
+
got = {"hit@1": round(100 * h1 / n, 1), "hit@5": round(100 * h5 / n, 1),
|
|
60
|
+
"hit@10": round(100 * h10 / n, 1), "mrr": round(mrr / n, 4)}
|
|
61
|
+
print(f"post-landing: {got}")
|
|
62
|
+
print(f"m2 预演 : {EXPECT}")
|
|
63
|
+
for kk in ("hit@1", "hit@5"):
|
|
64
|
+
assert abs(got[kk] - EXPECT[kk]) < 1e-9, \
|
|
65
|
+
f"入库后 {kk} 与 m2 预演不一致: {got[kk]} vs {EXPECT[kk]}"
|
|
66
|
+
assert got["hit@10"] >= EXPECT["hit@10"], \
|
|
67
|
+
f"入库后 hit@10 低于 m2 预演: {got['hit@10']} vs {EXPECT['hit@10']}"
|
|
68
|
+
delta = {kk: round(got[kk] - THIRD[kk], 1) for kk in ("hit@1", "hit@5", "hit@10")}
|
|
69
|
+
print(f"入库后 vs 第三方基线 delta: {delta}")
|
|
70
|
+
print("[post-check] 原生归一与机制前 m2 预演逐位一致 ✓")
|
|
71
|
+
return 0
|
|
72
|
+
|
|
73
|
+
|
|
74
|
+
if __name__ == "__main__":
|
|
75
|
+
sys.exit(main())
|
|
@@ -0,0 +1,83 @@
|
|
|
1
|
+
# -*- coding: utf-8 -*-
|
|
2
|
+
"""复现对照:采用第三方脚本的三处容错形态(norm/add/search 吞异常),
|
|
3
|
+
验证 m0 与第三方 C 臂的 3 题级偏差是否 100% 归因于容错差异。"""
|
|
4
|
+
import json
|
|
5
|
+
import sys
|
|
6
|
+
import tempfile
|
|
7
|
+
from pathlib import Path
|
|
8
|
+
|
|
9
|
+
sys.path.insert(0, str(Path(__file__).resolve().parents[3]))
|
|
10
|
+
from md_cg.semantic import en_normalizer as en
|
|
11
|
+
from md_cg import mdcg
|
|
12
|
+
|
|
13
|
+
HERE = Path(__file__).resolve().parent
|
|
14
|
+
DATA = Path(__file__).resolve().parents[3] / "data" / "benchmarks" / "locomo-zh-500"
|
|
15
|
+
|
|
16
|
+
|
|
17
|
+
def norm_atoms(text):
|
|
18
|
+
"""第三方形态:归一抛错则回退英文原文入库。"""
|
|
19
|
+
try:
|
|
20
|
+
terms, _ = en.normalize_en_query(text)
|
|
21
|
+
return " ".join(terms)
|
|
22
|
+
except Exception:
|
|
23
|
+
return text
|
|
24
|
+
|
|
25
|
+
|
|
26
|
+
def node_id_of(nd):
|
|
27
|
+
if isinstance(nd, dict):
|
|
28
|
+
for k in ("id", "node_id", "nid", "name"):
|
|
29
|
+
v = nd.get(k)
|
|
30
|
+
if isinstance(v, str):
|
|
31
|
+
return v
|
|
32
|
+
return None
|
|
33
|
+
|
|
34
|
+
|
|
35
|
+
def main():
|
|
36
|
+
corpus = [json.loads(l) for l in (DATA / "corpus567.jsonl").open(encoding="utf-8")]
|
|
37
|
+
qs = [json.loads(l) for l in (DATA / "questions500.jsonl").open(encoding="utf-8")]
|
|
38
|
+
eng = mdcg.MdCG(Path(tempfile.mkdtemp(prefix="tol_")))
|
|
39
|
+
add_fail = 0
|
|
40
|
+
for r in corpus:
|
|
41
|
+
content = norm_atoms(r.get("text") or "") or ""
|
|
42
|
+
if not content.strip():
|
|
43
|
+
content = "(空)"
|
|
44
|
+
try:
|
|
45
|
+
eng.add(node_id=r["id"], content=content, layer="knowledge",
|
|
46
|
+
verification_basis="data", on_conflict="record")
|
|
47
|
+
except Exception:
|
|
48
|
+
add_fail += 1
|
|
49
|
+
n = h1 = h5 = h10 = 0
|
|
50
|
+
mrr = 0.0
|
|
51
|
+
norm_fail = add_fail
|
|
52
|
+
for q in qs:
|
|
53
|
+
gold = set(q.get("evidence_turns") or [])
|
|
54
|
+
if not gold:
|
|
55
|
+
continue
|
|
56
|
+
try:
|
|
57
|
+
results, _ = eng.search(q["question"], k=20)
|
|
58
|
+
except Exception:
|
|
59
|
+
results = []
|
|
60
|
+
norm_fail += 1
|
|
61
|
+
ids = [i for i in (node_id_of(it[0] if isinstance(it, (list, tuple)) else it)
|
|
62
|
+
for it in results) if i]
|
|
63
|
+
rank = 0
|
|
64
|
+
for i, nid in enumerate(ids):
|
|
65
|
+
if nid in gold:
|
|
66
|
+
rank = i + 1
|
|
67
|
+
break
|
|
68
|
+
n += 1
|
|
69
|
+
h1 += rank == 1
|
|
70
|
+
h5 += 0 < rank <= 5
|
|
71
|
+
h10 += 0 < rank <= 10
|
|
72
|
+
mrr += (1.0 / rank) if rank else 0.0
|
|
73
|
+
print(f"add_fail/search_fail={add_fail}/{norm_fail - add_fail}")
|
|
74
|
+
print(json.dumps({"n": n, "hit@1": round(100 * h1 / n, 1),
|
|
75
|
+
"hit@5": round(100 * h5 / n, 1),
|
|
76
|
+
"hit@10": round(100 * h10 / n, 1),
|
|
77
|
+
"mrr": round(mrr / n, 4)}, ensure_ascii=False))
|
|
78
|
+
print("third_party: {'n': 500, 'hit@1': 60.0, 'hit@5': 74.4, 'hit@10': 81.0}")
|
|
79
|
+
return 0
|
|
80
|
+
|
|
81
|
+
|
|
82
|
+
if __name__ == "__main__":
|
|
83
|
+
sys.exit(main())
|