math-skill 2.0.1 → 3.0.0
This diff represents the content of publicly available package versions that have been released to one of the supported registries. The information contained in this diff is provided for informational purposes only and reflects changes between package versions as they appear in their respective public registries.
- package/README.en-US.md +167 -175
- package/README.md +167 -175
- package/agents/math-critic.en.md +235 -0
- package/agents/math-critic.md +10 -8
- package/commands/ask.md +3 -12
- package/design-patterns/attention/equivariant-attention.en.md +72 -0
- package/design-patterns/attention/equivariant-attention.md +72 -0
- package/design-patterns/attention/geometry-aware-attention.en.md +73 -0
- package/design-patterns/attention/geometry-aware-attention.md +72 -0
- package/design-patterns/attention/information-bottleneck-attention.en.md +72 -0
- package/design-patterns/attention/information-bottleneck-attention.md +72 -0
- package/design-patterns/attention/projection-attention.en.md +68 -0
- package/design-patterns/attention/projection-attention.md +68 -0
- package/design-patterns/attention/spectral-attention.en.md +71 -0
- package/design-patterns/attention/spectral-attention.md +71 -0
- package/design-patterns/compression/leverage-score-selection.en.md +71 -0
- package/design-patterns/compression/leverage-score-selection.md +71 -0
- package/design-patterns/compression/low-rank-kv-cache.en.md +60 -0
- package/design-patterns/compression/low-rank-kv-cache.md +60 -0
- package/design-patterns/compression/spectral-token-pruning.en.md +61 -0
- package/design-patterns/compression/spectral-token-pruning.md +61 -0
- package/design-patterns/compression/topology-preserving-compression.en.md +64 -0
- package/design-patterns/compression/topology-preserving-compression.md +64 -0
- package/design-patterns/loss/constraint-penalty.en.md +67 -0
- package/design-patterns/loss/constraint-penalty.md +78 -0
- package/design-patterns/loss/contrastive-loss.en.md +59 -0
- package/design-patterns/loss/contrastive-loss.md +68 -0
- package/design-patterns/loss/information-bottleneck-loss.en.md +69 -0
- package/design-patterns/loss/information-bottleneck-loss.md +74 -0
- package/design-patterns/loss/orthogonality-loss.en.md +56 -0
- package/design-patterns/loss/orthogonality-loss.md +60 -0
- package/design-patterns/loss/variational-loss.en.md +61 -0
- package/design-patterns/loss/variational-loss.md +71 -0
- package/design-patterns/representation/equivariant-split.en.md +87 -0
- package/design-patterns/representation/equivariant-split.md +89 -0
- package/design-patterns/representation/manifold-representation.en.md +85 -0
- package/design-patterns/representation/manifold-representation.md +87 -0
- package/design-patterns/representation/shared-private-decomposition.en.md +84 -0
- package/design-patterns/representation/shared-private-decomposition.md +86 -0
- package/design-patterns/representation/subspace-alignment.en.md +90 -0
- package/design-patterns/representation/subspace-alignment.md +92 -0
- package/design-patterns/routing/graph-routing.en.md +79 -0
- package/design-patterns/routing/graph-routing.md +81 -0
- package/design-patterns/routing/moe-routing.en.md +85 -0
- package/design-patterns/routing/moe-routing.md +87 -0
- package/design-patterns/routing/optimal-transport-routing.en.md +68 -0
- package/design-patterns/routing/optimal-transport-routing.md +72 -0
- package/design-patterns/routing/spectral-clustering-routing.en.md +88 -0
- package/design-patterns/routing/spectral-clustering-routing.md +90 -0
- package/knowledge-base/differential-geometry/connection.en.md +51 -0
- package/knowledge-base/differential-geometry/connection.md +51 -0
- package/knowledge-base/differential-geometry/curvature.en.md +49 -0
- package/knowledge-base/differential-geometry/curvature.md +49 -0
- package/knowledge-base/differential-geometry/geodesic.en.md +51 -0
- package/knowledge-base/differential-geometry/geodesic.md +51 -0
- package/knowledge-base/differential-geometry/manifold.en.md +47 -0
- package/knowledge-base/differential-geometry/manifold.md +47 -0
- package/knowledge-base/differential-geometry/metric-tensor.en.md +50 -0
- package/knowledge-base/differential-geometry/metric-tensor.md +50 -0
- package/knowledge-base/differential-geometry/tangent-space.en.md +48 -0
- package/knowledge-base/differential-geometry/tangent-space.md +48 -0
- package/knowledge-base/information-geometry/fisher-metric.en.md +56 -0
- package/knowledge-base/information-geometry/fisher-metric.md +56 -0
- package/knowledge-base/information-geometry/natural-gradient.en.md +54 -0
- package/knowledge-base/information-geometry/natural-gradient.md +54 -0
- package/knowledge-base/lie-theory/equivariance.en.md +54 -0
- package/knowledge-base/lie-theory/equivariance.md +54 -0
- package/knowledge-base/lie-theory/group-action.en.md +51 -0
- package/knowledge-base/lie-theory/group-action.md +51 -0
- package/knowledge-base/lie-theory/lie-algebra.en.md +51 -0
- package/knowledge-base/lie-theory/lie-algebra.md +51 -0
- package/knowledge-base/lie-theory/lie-group.en.md +51 -0
- package/knowledge-base/lie-theory/lie-group.md +51 -0
- package/knowledge-base/lie-theory/representation.en.md +52 -0
- package/knowledge-base/lie-theory/representation.md +52 -0
- package/knowledge-base/matrix-analysis/low-rank-approximation.en.md +49 -0
- package/knowledge-base/matrix-analysis/low-rank-approximation.md +49 -0
- package/knowledge-base/matrix-analysis/matrix-perturbation.en.md +49 -0
- package/knowledge-base/matrix-analysis/matrix-perturbation.md +49 -0
- package/knowledge-base/matrix-analysis/positive-semidefinite.en.md +50 -0
- package/knowledge-base/matrix-analysis/positive-semidefinite.md +50 -0
- package/knowledge-base/matrix-analysis/projection.en.md +47 -0
- package/knowledge-base/matrix-analysis/projection.md +47 -0
- package/knowledge-base/matrix-analysis/spectral-decomposition.en.md +48 -0
- package/knowledge-base/matrix-analysis/spectral-decomposition.md +48 -0
- package/knowledge-base/optimization/constrained-optimization.en.md +53 -0
- package/knowledge-base/optimization/constrained-optimization.md +53 -0
- package/knowledge-base/optimization/convex-optimization.en.md +50 -0
- package/knowledge-base/optimization/convex-optimization.md +50 -0
- package/knowledge-base/optimization/lagrangian-duality.en.md +50 -0
- package/knowledge-base/optimization/lagrangian-duality.md +50 -0
- package/knowledge-base/optimization/proximal-method.en.md +52 -0
- package/knowledge-base/optimization/proximal-method.md +52 -0
- package/knowledge-base/optimization/riemannian-optimization.en.md +51 -0
- package/knowledge-base/optimization/riemannian-optimization.md +51 -0
- package/knowledge-base/overview.en.md +39 -0
- package/knowledge-base/overview.md +29 -218
- package/knowledge-base/probability/concentration-inequality.en.md +45 -0
- package/knowledge-base/probability/concentration-inequality.md +45 -0
- package/knowledge-base/probability/entropy.en.md +47 -0
- package/knowledge-base/probability/entropy.md +47 -0
- package/knowledge-base/probability/fisher-information.en.md +48 -0
- package/knowledge-base/probability/fisher-information.md +48 -0
- package/knowledge-base/probability/information-bottleneck.en.md +49 -0
- package/knowledge-base/probability/information-bottleneck.md +49 -0
- package/knowledge-base/probability/kl-divergence.en.md +51 -0
- package/knowledge-base/probability/kl-divergence.md +51 -0
- package/knowledge-base/topology/euler-characteristic.en.md +54 -0
- package/knowledge-base/topology/euler-characteristic.md +54 -0
- package/knowledge-base/topology/fundamental-group.en.md +52 -0
- package/knowledge-base/topology/fundamental-group.md +52 -0
- package/knowledge-base/topology/persistent-homology.en.md +54 -0
- package/knowledge-base/topology/persistent-homology.md +54 -0
- package/lenses/algorithmic.en.md +49 -0
- package/lenses/algorithmic.md +49 -0
- package/lenses/axiomatization.en.md +48 -0
- package/lenses/axiomatization.md +48 -0
- package/lenses/categorical.en.md +48 -0
- package/lenses/categorical.md +48 -0
- package/lenses/causal.en.md +49 -0
- package/lenses/causal.md +49 -0
- package/lenses/duality.en.md +47 -0
- package/lenses/duality.md +47 -0
- package/lenses/game.en.md +50 -0
- package/lenses/game.md +50 -0
- package/lenses/geometric.en.md +53 -0
- package/lenses/geometric.md +53 -0
- package/lenses/local-to-global.en.md +52 -0
- package/lenses/local-to-global.md +52 -0
- package/lenses/perturbation.en.md +51 -0
- package/lenses/perturbation.md +51 -0
- package/lenses/probabilistic.en.md +48 -0
- package/lenses/probabilistic.md +48 -0
- package/lenses/projection.en.md +50 -0
- package/lenses/projection.md +50 -0
- package/lenses/spectral.en.md +52 -0
- package/lenses/spectral.md +52 -0
- package/lenses/symmetry.en.md +49 -0
- package/lenses/symmetry.md +49 -0
- package/lenses/topological.en.md +48 -0
- package/lenses/topological.md +48 -0
- package/lenses/variational.en.md +48 -0
- package/lenses/variational.md +48 -0
- package/package.json +11 -3
- package/references/agentic-workflow.en.md +53 -0
- package/references/agentic-workflow.md +2 -0
- package/references/books/abstract-algebra.md +9 -5
- package/references/books/algebraic-geometry-rising-sea.md +9 -5
- package/references/books/differential-geometry.md +7 -3
- package/references/books/matrix-analysis.md +8 -4
- package/references/books/micro-lie-theory.md +7 -3
- package/references/books/optimization-ml.md +5 -1
- package/references/books/smooth-manifolds.md +7 -3
- package/references/gpu-friendly-math.en.md +65 -0
- package/references/gpu-friendly-math.md +4 -2
- package/references/inspiration.en.md +113 -0
- package/references/inspiration.md +4 -2
- package/skills/math-research-activator/SKILL.en.md +187 -0
- package/skills/math-research-activator/SKILL.md +162 -108
- package/skills/math-research-activator/original-texts.en.md +105 -0
- package/skills/math-research-activator/original-texts.md +11 -11
- package/commands/abstraction.md +0 -13
- package/commands/algorithmic-thinking.md +0 -13
- package/commands/axiomatization.md +0 -13
- package/commands/causal-inference.md +0 -13
- package/commands/discrete-combinatorial.md +0 -13
- package/commands/game-theory.md +0 -13
- package/commands/induction-analogy.md +0 -13
- package/commands/information-theory.md +0 -13
- package/commands/logic-deduction.md +0 -13
- package/commands/modeling.md +0 -13
- package/commands/optimization.md +0 -13
- package/commands/probability-statistics.md +0 -13
- package/commands/symmetry-invariance.md +0 -13
- package/commands/topological-thinking.md +0 -13
- package/commands/transformation.md +0 -13
- package/skills/abstraction/SKILL.md +0 -119
- package/skills/abstraction/original-texts.md +0 -175
- package/skills/algorithmic-thinking/SKILL.md +0 -136
- package/skills/algorithmic-thinking/original-texts.md +0 -256
- package/skills/axiomatization/SKILL.md +0 -149
- package/skills/axiomatization/original-texts.md +0 -160
- package/skills/causal-inference/SKILL.md +0 -149
- package/skills/causal-inference/original-texts.md +0 -167
- package/skills/discrete-combinatorial/SKILL.md +0 -129
- package/skills/discrete-combinatorial/original-texts.md +0 -185
- package/skills/game-theory/SKILL.md +0 -121
- package/skills/game-theory/original-texts.md +0 -131
- package/skills/induction-analogy/SKILL.md +0 -150
- package/skills/induction-analogy/original-texts.md +0 -154
- package/skills/information-theory/SKILL.md +0 -138
- package/skills/information-theory/original-texts.md +0 -127
- package/skills/logic-deduction/SKILL.md +0 -133
- package/skills/logic-deduction/original-texts.md +0 -173
- package/skills/modeling/SKILL.md +0 -137
- package/skills/modeling/original-texts.md +0 -165
- package/skills/optimization/SKILL.md +0 -133
- package/skills/optimization/original-texts.md +0 -168
- package/skills/probability-statistics/SKILL.md +0 -149
- package/skills/probability-statistics/original-texts.md +0 -193
- package/skills/symmetry-invariance/SKILL.md +0 -137
- package/skills/symmetry-invariance/original-texts.md +0 -221
- package/skills/topological-thinking/SKILL.md +0 -126
- package/skills/topological-thinking/original-texts.md +0 -164
- package/skills/transformation/SKILL.md +0 -122
- package/skills/transformation/original-texts.md +0 -216
|
@@ -1,185 +0,0 @@
|
|
|
1
|
-
# 离散与组合思想 — 原始文献与历史语境 / Discrete & Combinatorial Thinking — Original Texts & Historical Context
|
|
2
|
-
|
|
3
|
-
---
|
|
4
|
-
|
|
5
|
-
## 1. Pigeonhole Principle — Dirichlet (1834) / 鸽巢原理 — Dirichlet (1834)
|
|
6
|
-
|
|
7
|
-
Peter Gustav Lejeune Dirichlet 在 1834 年以"Schubfachprinzip"(抽屉原理)阐述鸽巢原理,用于数论存在性证明。
|
|
8
|
-
|
|
9
|
-
> "Wenn man n + 1 Objecte in n Facher distribuiert, so ist mindestens ein Fach mit zwei Objecten besetzt."
|
|
10
|
-
> — Dirichlet, 1834
|
|
11
|
-
|
|
12
|
-
**核心陈述 / Core statement:**
|
|
13
|
-
- 基本形式:若 n 物品放入 m 个盒子且 n > m,则某盒子含至少 ⌈n/m⌉ 个物品
|
|
14
|
-
- 推广形式:kn+1 物品入 n 盒子 → 某盒至少含 k+1 个物品
|
|
15
|
-
- 数论应用:对任意实数 α 和整数 N,存在 q ≤ N 使得 |qα − p| < 1/(N+1)(即 qα 逼近整数)
|
|
16
|
-
|
|
17
|
-
**Diophantine 逼近 / Diophantine approximation:** 将 [0,1) 分为 N+1 个等长区间("盒子"),考虑 N+2 个数 {0, {α}, {2α}, ..., {(N+1)α}}("物品"),鸽巢保证必有两个落入同一区间,得 |(q₁−q₂)α − ⌊(q₁−q₂)α⌋| < 1/(N+1)。这是 Dirichlet 逼近定理的标准鸽巢证明。
|
|
18
|
-
|
|
19
|
-
---
|
|
20
|
-
|
|
21
|
-
## 2. Euler's Generating Functions (1748) / Euler 的生成函数 (1748)
|
|
22
|
-
|
|
23
|
-
Leonhard Euler 在 **Introductio in analysin infinitorum** (1748) 中开创生成函数方法——序列变换为幂级数,计数变换为代数运算。
|
|
24
|
-
|
|
25
|
-
> "If we ask how many ways a given number can be partitioned, we are led to a study of the generating function." — Euler, 1748
|
|
26
|
-
|
|
27
|
-
**分拆函数生成函数 / Partition GF:**
|
|
28
|
-
$$P(x) = \sum_{n=0}^{\infty} p(n) x^n = \prod_{k=1}^{\infty} \frac{1}{1-x^k}$$
|
|
29
|
-
- p(n) = 将 n 分为正整数之和的分拆数。p(5) = 7:{5, 4+1, 3+2, 3+1+1, 2+2+1, 2+1+1+1, 1+1+1+1+1}
|
|
30
|
-
- 乘积形式:1/(1−x^k) = 1+x^k+x^{2k}+... 表示"取 k 的 0,1,2,... 次",各 k 独立故乘积编码组合
|
|
31
|
-
|
|
32
|
-
**五角数定理 / Pentagonal number theorem (Euler 1750):**
|
|
33
|
-
$$\prod_{k=1}^{\infty}(1-x^k) = \sum_{m=-\infty}^{\infty} (-1)^m x^{m(3m-1)/2}$$
|
|
34
|
-
- 广义五角数 e_m = m(3m−1)/2:0, 1, 2, 5, 7, 12, 15, 22, ...
|
|
35
|
-
- 由 P(x)·∏(1−x^k) = Σ(−1)^m x^{e_m},得递推 p(n) = p(n−1)+p(n−2)−p(n−5)−p(n−7)+...
|
|
36
|
-
- 这是有限递推控制无限序列的经典实例——组合思想的精髓
|
|
37
|
-
|
|
38
|
-
**Hardy-Ramanujan 渐近公式 (1918):**
|
|
39
|
-
$$p(n) \sim \frac{1}{4n\sqrt{3}} \exp\left(\pi\sqrt{\frac{2n}{3}}\right)$$
|
|
40
|
-
|
|
41
|
-
---
|
|
42
|
-
|
|
43
|
-
## 3. Catalan Numbers / Catalan 数
|
|
44
|
-
|
|
45
|
-
**历史 / History:** Eugène Catalan (1838) 研究括号嵌套的计数问题,Catalan 数由此得名。但 Euler 早在 1751 年就研究过类似问题(多边形三角剖分)。
|
|
46
|
-
|
|
47
|
-
**定义与公式 / Definition and formula:**
|
|
48
|
-
$$C_n = \frac{1}{n+1}\binom{2n}{n} = \frac{(2n)!}{n!(n+1)!}$$
|
|
49
|
-
- 递推:C₀ = 1, C_n = ΣC_i·C_{n−1−i}
|
|
50
|
-
- 生成函数:C(x) = ΣC_n x^n = (1−√(1−4x))/(2x),由 C(x) = 1 + x·C(x)² 解得
|
|
51
|
-
|
|
52
|
-
**组合解释(60+种) / Combinatorial interpretations (60+):**
|
|
53
|
-
- **二叉树**:n 个节点的有序二叉树数 = C_n
|
|
54
|
-
- **Dyck 路径**:从 (0,0) 到 (2n,0) 的格点路径,每步 (+1,+1) 或 (+1,−1),不越 y=0
|
|
55
|
-
- **括号序列**:n 对括号的合法嵌套方式数 = C_n
|
|
56
|
-
- **投票问题 (Ballot problem)**:A 得 n+1 票、B 得 n 票,A 全程领先 B 的序列数 = C_n(Bertrand 1887)
|
|
57
|
-
- **多边形三角剖分**:n+2 边形的不同三角剖分数 = C_n
|
|
58
|
-
|
|
59
|
-
前几项:C₀=1, C₁=1, C₂=2, C₃=5, C₄=14, C₅=42, C₆=132
|
|
60
|
-
|
|
61
|
-
---
|
|
62
|
-
|
|
63
|
-
## 4. Ramsey Theory — Ramsey (1930) / Ramsey 理论 — Ramsey (1930)
|
|
64
|
-
|
|
65
|
-
Frank P. Ramsey 在 **"On a Problem of Formal Logic"** (1930) 中证明:足够大的系统必存在某种结构——鸽巢原理的深刻推广。
|
|
66
|
-
|
|
67
|
-
> "In any sufficiently large system, complete disorder is impossible." — Cohen
|
|
68
|
-
|
|
69
|
-
**Ramsey 数 / Ramsey numbers:**
|
|
70
|
-
$$R(s,t) = \min\{n : \text{任意 } n \text{ 阶 2-色完全图中必有红 } K_s \text{ 或蓝 } K_t\}$$
|
|
71
|
-
|
|
72
|
-
**已知值:** R(3,3)=6(6人聚会必有3人互识或互不识;证明:固定一人,5人中至少3人同色关系(鸽巢),此3人中若2人同色则3人组,否则此3人构成另一色3人组), R(4,4)=18, R(3,4)=9, R(3,5)=14.
|
|
73
|
-
|
|
74
|
-
**一般界:** Erdős 1947 概率方法: R(k,k) > 2^{k/2}; 上界 R(k,k) ≤ 4^k. R(5,5)未知(43≤R(5,5)≤48). Erdős:"外星人要R(5,5)就动员所有计算机;要R(6,6)就准备战斗。"
|
|
75
|
-
|
|
76
|
-
---
|
|
77
|
-
|
|
78
|
-
## 5. Graph Theory — Euler (1736) / 图论 — Euler (1736)
|
|
79
|
-
|
|
80
|
-
**Königsberg 七桥问题 / Seven Bridges of Königsberg (1736):**
|
|
81
|
-
|
|
82
|
-
Leonhard Euler 在 **"Solutio problematis ad geometriam situs pertinentis"** (1736) 解决柯尼斯堡七桥问题,开创图论。
|
|
83
|
-
|
|
84
|
-
> "The problem... is to find whether one can cross each of the seven bridges exactly once and return to the starting point." — Euler, 1736
|
|
85
|
-
|
|
86
|
-
**Euler 环定理 / Euler circuit theorem:**
|
|
87
|
-
- 连通图存在 Euler 环(经过每边恰好一次的闭路径)iff 所有顶点度数为偶数
|
|
88
|
-
- 柯尼斯堡图:4 个顶点度数为 3, 3, 3, 5(均为奇数),故 Euler 环不存在——问题无解
|
|
89
|
-
|
|
90
|
-
**Euler 平面图公式 / Euler's planar formula (1750):**
|
|
91
|
-
$$V - E + F = 2$$
|
|
92
|
-
- 对任意连通平面图:顶点数 V、边数 E、面数 F 满足此公式
|
|
93
|
-
- 推论:简单连通平面图 E ≤ 3V − 6;不含 K₃ 的平面图 E ≤ 2V − 4
|
|
94
|
-
|
|
95
|
-
**匹配理论 / Matching theory:**
|
|
96
|
-
- König (1931):二分图中最大匹配数 = 最小顶点覆盖数(König 定理)
|
|
97
|
-
- Hall 婚姻定理 (1935):二分图 G(X,Y) 有 X 到 Y 的完美匹配 iff 对任意 S ⊆ X,|N(S)| ≥ |S|
|
|
98
|
-
|
|
99
|
-
---
|
|
100
|
-
|
|
101
|
-
## 6. Pólya Enumeration Theorem (1937) / Pólya 计数定理 (1937)
|
|
102
|
-
|
|
103
|
-
George Pólya 在 1937 年的论文中给出对称性下的计数方法——轨道计数定理,组合计数与群论的交汇点。
|
|
104
|
-
|
|
105
|
-
> "The number of distinct colorings is obtained by averaging over the group action." — Pólya, 1937
|
|
106
|
-
|
|
107
|
-
**定理陈述 / Theorem statement:**
|
|
108
|
-
设群 G 作用于集合 X,k-着色等价类数(轨道数):
|
|
109
|
-
$$N = \frac{1}{|G|} \sum_{g \in G} k^{c(g)}$$
|
|
110
|
-
c(g) = 置换 g 的循环数。应用: 化学异构体、珠串图案。Burnside 引理 (1897): N = (1/|G|)Σ|Fix(g)|,是 Pólya 特例。Pólya 推广为带权版本: GF × 循环指数 = 对称计数。
|
|
111
|
-
|
|
112
|
-
---
|
|
113
|
-
|
|
114
|
-
## 7. Inclusion-Exclusion Principle / 容斥原理
|
|
115
|
-
|
|
116
|
-
**历史:** da Vinci 用容斥思想计算面积;Sylvester (1882) 形式化。容斥处理交集重叠——直接相加重计交集,需逐层修正。
|
|
117
|
-
|
|
118
|
-
基本形式: |A₁∪...∪A_n| = Σ|A_i| − Σ|A_i∩A_j| + ... ± |A₁∩...∩A_n|. 补集计数: "不具有P" = 全部 − "具有P".
|
|
119
|
-
|
|
120
|
-
**错排数:** D(n) = n! − C(n,1)(n−1)! + C(n,2)(n−2)! − ... = n!Σ(−1)^k/k! ≈ n!/e (n→∞). 概率形式: P(A₁∪...∪A_n) = ΣP(A_i) − ΣP(A_i∩A_j) + ...
|
|
121
|
-
|
|
122
|
-
---
|
|
123
|
-
|
|
124
|
-
## 8. Recurrence Relations / 递推关系
|
|
125
|
-
|
|
126
|
-
**Fibonacci 数列 / Fibonacci sequence:**
|
|
127
|
-
$$F_0 = 0, F_1 = 1, F_n = F_{n-1} + F_{n-2}$$
|
|
128
|
-
- 生成函数:F(x) = ΣF_n x^n = x/(1−x−x²)
|
|
129
|
-
- Binet 公式:F_n = (φ^n − ψ^n)/√5,φ = (1+√5)/2 ≈ 1.618(黄金比)
|
|
130
|
-
|
|
131
|
-
**汉诺塔 / Tower of Hanoi:**
|
|
132
|
-
$$T_1 = 1, T_n = 2T_{n-1} + 1$$
|
|
133
|
-
- 解:T_n = 2^n − 1。64 层需 2^{64} − 1 ≈ 1.8×10^{19} 步
|
|
134
|
-
|
|
135
|
-
**GF 求解递推 / Solving recurrences via GF:**
|
|
136
|
-
1. 递推乘以 x^n,对 n 求和 → A(x) 的方程
|
|
137
|
-
2. 利用初始条件,解出 A(x)(代数/微分方程)
|
|
138
|
-
3. 提取 a_n:部分分式、Taylor 展开、幂级数对照
|
|
139
|
-
|
|
140
|
-
**Catalan GF 推导:** C(x) = 1 + x·C(x)² → 解 x·C² − C + 1 = 0 → C(x) = (1−√(1−4x))/(2x) → C_n = (1/(n+1))C(2n,n)
|
|
141
|
-
|
|
142
|
-
---
|
|
143
|
-
|
|
144
|
-
## 9. Combinatorial Optimization / 组合优化
|
|
145
|
-
|
|
146
|
-
**最小生成树 / Minimum spanning tree:**
|
|
147
|
-
- Kruskal (1956):按边权升序贪心选取不成环的边,O(E log E)
|
|
148
|
-
- Prim (1957):从单点扩展,每次选最小权连接边,O(E log V)(优先队列)
|
|
149
|
-
|
|
150
|
-
**最大流最小割 / Max-flow min-cut:**
|
|
151
|
-
- Ford-Fulkerson (1956):增广路径法,流量逐步增加直至无增广路径
|
|
152
|
-
- 最大流最小割定理:最大流值 = 最小割容量(LP 对偶性的组合表现)
|
|
153
|
-
- Edmonds-Karp (1972):BFS 选最短增广路径,保证 O(VE²)
|
|
154
|
-
|
|
155
|
-
**匹配理论 / Matching theory:**
|
|
156
|
-
- Hungarian 算法 (Kuhn 1955):O(V³) 最大加权二分匹配
|
|
157
|
-
- Edmonds 带花树算法 (1965):一般图最大匹配,O(V³)
|
|
158
|
-
|
|
159
|
-
---
|
|
160
|
-
|
|
161
|
-
## 10. The Twelvefold Way / 十二重道
|
|
162
|
-
|
|
163
|
-
Richard P. Stanley 在 **Enumerative Combinatorics Vol. 1** 中统一分类 n球入k盒的12种基本计数(2×2×3: 球有标号/无标号 × 盒有标号/无标号 × 任意/至多1/至少1):
|
|
164
|
-
|
|
165
|
-
| 球 / Balls | 盒子 / Boxes | 条件 / Condition | 公式 / Formula |
|
|
166
|
-
|---|---|---|---|
|
|
167
|
-
| 有标号 distinct | 有标号 distinct | 任意 any | k^n |
|
|
168
|
-
| 无标号 identical | 有标号 distinct | 任意 any | C(n+k−1, k−1) |
|
|
169
|
-
| 有标号 distinct | 无标号 identical | 任意 any | Σ S₂(n,i), i=1..k |
|
|
170
|
-
| 无标号 identical | 无标号 identical | 任意 any | p_k(n)(受限分拆) |
|
|
171
|
-
| 有标号 distinct | 有标号 distinct | 至多一个 ≤1 | P(k,n) = k!/(k−n)! |
|
|
172
|
-
| 无标号 identical | 有标号 distinct | 至多一个 ≤1 | C(k,n) |
|
|
173
|
-
| 有标号 distinct | 无标号 identical | 至多一个 ≤1 | 1 if n≤k, 0 else |
|
|
174
|
-
| 无标号 identical | 无标号 identical | 至多一个 ≤1 | 1 if n≤k, 0 else |
|
|
175
|
-
| 有标号 distinct | 有标号 distinct | 至少一个 ≥1 | k!·S₂(n,k) |
|
|
176
|
-
| 无标号 identical | 有标号 distinct | 至至少一个 ≥1 | C(n−1, k−1) |
|
|
177
|
-
| 有标号 distinct | 无标号 identical | 至少一个 ≥1 | S₂(n,k) − S₂(n,k−1) |
|
|
178
|
-
| 无标号 identical | 无标号 identical | 至少一个 ≥1 | p_k(n) − p_{k−1}(n) |
|
|
179
|
-
|
|
180
|
-
**关键洞察:** 2×2×3=12种基本计数覆盖组合数学核心场景。有标号用EGF,无标号用OGF。**Stirling数:** S₁(n,k)=n元素k循环排列数; S₂(n,k)=n元素k非空子集数。
|
|
181
|
-
|
|
182
|
-
---
|
|
183
|
-
|
|
184
|
-
*本文件为离散与组合思想技能的数学参考与历史语境,涵盖从 Euler 到现代组合数学的核心成果。*
|
|
185
|
-
*This file provides mathematical references and historical context for the discrete-combinatorial skill, covering core results from Euler to modern combinatorics.*
|
|
@@ -1,121 +0,0 @@
|
|
|
1
|
-
---
|
|
2
|
-
name: game-theory
|
|
3
|
-
description: |
|
|
4
|
-
触发:当策略取决于他人选择、需计算纳什均衡、分析零和/非零和博弈、做机制设计;或为多智能体系统、对抗训练、路由博弈设计策略时调用。
|
|
5
|
-
English: Trigger when optimal strategy depends on others' choices, needing Nash equilibrium computation, zero-sum/non-zero-sum analysis, mechanism design; or designing strategies for multi-agent systems, adversarial training, routing games.
|
|
6
|
-
---
|
|
7
|
-
|
|
8
|
-
# 🎯 博弈论思想 / Game Theory
|
|
9
|
-
|
|
10
|
-
> "你的最优选择取决于他人的选择——思考不仅要深入,还要互动。"
|
|
11
|
-
> "Your optimal choice depends on others' choices — thinking must be interactive, not just deep."
|
|
12
|
-
>
|
|
13
|
-
> —— 博弈论、决策论、机制设计 / Game Theory, Decision Theory, Mechanism Design
|
|
14
|
-
|
|
15
|
-
## 核心原则 / Core Principle
|
|
16
|
-
|
|
17
|
-
**战略互动——你的最优行动取决于他人做什么,而他人的最优行动取决于你做什么。纳什均衡:无人能从单方面偏离中获益的策略组合。**
|
|
18
|
-
|
|
19
|
-
**Strategic interaction — your best action depends on what others do, and theirs depend on what you do. Nash equilibrium: strategy profile where no player benefits from unilateral deviation.**
|
|
20
|
-
|
|
21
|
-
关键概念:**支付矩阵(Payoff Matrix)**、**占优策略(Dominant Strategy)**、**混合策略(Mixed Strategy)**、**帕累托最优性(Pareto Optimality)**。分类维度:合作 vs 非合作、零和 vs 一般和、同时 vs 序列。
|
|
22
|
-
|
|
23
|
-
> **数学形式化 / Mathematical Formalization**
|
|
24
|
-
>
|
|
25
|
-
> 形式化定义:n 个参与者,每人有策略集 $S_i$ 和支付函数 $u_i: S_1 \times \cdots \times S_n \to \mathbb{R}$。
|
|
26
|
-
>
|
|
27
|
-
> 纳什均衡:策略组合 $s^* = (s_1^*, \ldots, s_n^*)$ 满足 $u_i(s^*) \geq u_i(s_i, s^*_{-i})$ 对所有 $s_i \in S_i$、所有 $i$ 成立,其中 $s^*_{-i}$ 为除 $i$ 外所有人的策略。混合策略纳什均衡:概率分布 $\sigma^*$ 使 $u_i(\sigma^*) \geq u_i(s_i, \sigma^*_{-i})$。
|
|
28
|
-
>
|
|
29
|
-
> 占优策略:严格 $u_i(s_i^*, s_{-i}) > u_i(s_i, s_{-i})$;弱占优 $\geq$ 且至少一处严格。
|
|
30
|
-
>
|
|
31
|
-
> 零和 minimax:$\max_x \min_y f(x,y) = \min_y \max_x f(x,y)$。
|
|
32
|
-
|
|
33
|
-
## GPU 友好性 / GPU-Friendliness(横切检查)
|
|
34
|
-
|
|
35
|
-
博弈求解映射 GPU 的能力差异极大,过 `../../references/gpu-friendly-math.md` 八维门:
|
|
36
|
-
|
|
37
|
-
- **矩阵博弈 / 双人零和(minimax)**:等价于线性规划(LP),支付矩阵运算可 GEMM 化、可批量并行——**友好**。
|
|
38
|
-
- **混合策略均衡求解**:支撑集上的线性方程组/无差异方程,小规模可批量解;规模大时注意稀疏性与条件数。
|
|
39
|
-
- **大规模多智能体均衡精确求解**:n 人纳什均衡 PPAD-complete,一般情形**不可算**→ **反模式**,改用近似/学习方法(fictitious play、虚拟自博、多智能体 RL、NFSP)。
|
|
40
|
-
- **演化/重复博弈模拟**:群体与策略批量更新可并行;注意 agent 间通信与同步开销。
|
|
41
|
-
|
|
42
|
-
八维最低判定(正式术语):**张量化**看玩家/策略/回合是否能批量展开;**GEMM 可映射**看支付矩阵、minimax、LP/线性方程是否落矩阵运算;**复杂度**标注 Nash/机制求解的 PPAD/组合爆炸风险;**显存与 KV-Cache**看策略-状态笛卡尔积是否可压缩;**低精度稳定**看均衡求解、LP、soft best-response 是否条件数可控;**并行与通信**看多智能体 rollout 的同步成本;**稀疏结构**看交互图是否结构化;**算子融合**看收益、mask、best-response 更新能否融合。
|
|
43
|
-
|
|
44
|
-
> 配合 `../../references/books/optimization-ml.md`(对偶/minimax、博弈学习算法)与 `../../references/books/matrix-analysis.md`(矩阵博弈、线性方程组)。
|
|
45
|
-
|
|
46
|
-
## 不适用场景 / When NOT to Use
|
|
47
|
-
|
|
48
|
-
- **单人决策问题,与他人无互动**——优化思想更适用,无需考虑他人策略响应。
|
|
49
|
-
- **纯合作问题,无利益冲突**——参与者目标完全一致,无需战略分析。
|
|
50
|
-
- **确定性问题,无战略不确定性**——结果由自身行动唯一决定,不涉及他人反应。
|
|
51
|
-
- **纯粹运气决定的结果,各方无策略选择**——无策略集可分析,博弈论不适用。
|
|
52
|
-
|
|
53
|
-
## 何时使用 / When to Use
|
|
54
|
-
|
|
55
|
-
- 多个决策者相互影响,各自策略影响他人收益;最佳策略取决于他人响应,需预判他人行动。
|
|
56
|
-
- 需设计激励机制,使自利行为导向社会最优结果;预测给定规则下的均衡稳定状态。
|
|
57
|
-
- 分析竞争市场中的定价、进入、退出;谈判/讨价还价中的利益分配与威胁点。
|
|
58
|
-
- **为多智能体系统、对抗训练(GAN/鲁棒学习)、路由博弈设计策略与均衡目标**。
|
|
59
|
-
|
|
60
|
-
## 方法流程 / Method
|
|
61
|
-
|
|
62
|
-
### 第一步:识别参与者与策略
|
|
63
|
-
定义博弈基本要素:参与者 $N=\{1,\ldots,n\}$;策略集 $S_i$;支付函数 $u_i: S_1\times\cdots\times S_n\to\mathbb{R}$;信息结构(是否对称?是否不完全信息?行动是否序列?能否通信?)。核心是识别"互动结构"——谁的选择影响谁的结果,遗漏关键参与者是最常见错误。
|
|
64
|
-
|
|
65
|
-
### 第二步:分析博弈类型
|
|
66
|
-
先判定零和/一般和、同时/序列、合作/非合作、完全信息/不完全信息。类型决定方法:零和用 minimax/LP;序列博弈用逆向归纳与子博弈完美均衡;合作博弈用 Shapley 值按边际贡献分配:
|
|
67
|
-
$$\phi_i(v)=\sum_{S\subseteq N\setminus\{i\}}\frac{|S|!(n-|S|-1)!}{n!}[v(S\cup\{i\})-v(S)]$$
|
|
68
|
-
误判类型会直接导致均衡概念和求解方法错用。
|
|
69
|
-
|
|
70
|
-
### 第三步:构建支付矩阵/函数
|
|
71
|
-
2 人博弈用支付矩阵,单元格 $(u_1,u_2)$;n 人博弈用 $u_i(s_1,\ldots,s_n)$。验证完备性:是否遗漏参与者或策略?支付是否准确反映偏好?是否存在外部性?支付是分析根基,评估不准则后续全偏。
|
|
72
|
-
|
|
73
|
-
### 第四步:寻找占优策略
|
|
74
|
-
严格占优 $u_i(s_i^*,s_{-i}) > u_i(s_i,s_{-i})$ 对所有 $s_i\neq s_i^*$、所有 $s_{-i}$;弱占优 $\geq$ 且至少一处严格;**迭代消去劣策略**依次删去劣策略缩小空间。存在占优策略均衡是最强结论——无人有任何偏离动机;否则进入均衡分析。
|
|
75
|
-
|
|
76
|
-
### 第五步:计算均衡
|
|
77
|
-
按第二步的博弈类型选方法。纯策略纳什:对每个 $s_{-i}$ 找最优响应 $BR_i(s_{-i})$,交叉点即均衡。混合策略:求使他人无差异的概率分布 $u_j(s_j,\sigma^*_{-j})=u_j(s_j',\sigma^*_{-j})$ 对所有 $s_j,s_j'\in S_j$。零和矩阵博弈可走 minimax $\max_x\min_y f=\min_y\max_x f$;序列博弈用逆向归纳;合作博弈输出分配方案而非普通纳什。多重均衡做帕累托排序,标注最优与劣均衡。
|
|
78
|
-
|
|
79
|
-
### 第六步:检查均衡稳定性
|
|
80
|
-
颤抖手完美(微小失误下仍稳定,排除依赖"对手绝不犯错"的均衡);演化稳定策略 ESS(重复互动中抵御入侵);偏离均衡路径激励(序列博弈中是否有动机遵守承诺)。追问:均衡唯一还是多重?对微小扰动是否鲁棒?稳定均衡才是可信预测。
|
|
81
|
-
|
|
82
|
-
### 第七步:设计机制与改进
|
|
83
|
-
若不存在好的均衡,重新设计博弈:改变支付结构(奖惩)、增加可执行规则、引入通信与声誉、Vickrey 拍卖(报真实估值为占优策略)。机制设计形式化:
|
|
84
|
-
$$\max\ \text{social welfare}\quad\text{s.t.}\quad\text{incentive compatibility + individual rationality}$$
|
|
85
|
-
显示原理:任何贝叶斯博弈均衡都可由直接机制实现——如实报告类型即均衡。机制设计是最实用分支——与其抱怨人不合作,不如改变规则让合作成为自利选择。
|
|
86
|
-
|
|
87
|
-
## 常见错误 / Common Errors
|
|
88
|
-
|
|
89
|
-
| 错误 / Error | 批评 / Critique | 正确做法 / Correct Approach |
|
|
90
|
-
|---|---|---|
|
|
91
|
-
| 假设他人像自己一样思考 | 他人支付函数/理性水平不同,$u_i\neq u_j$ | 明确各参与者支付函数与信念 |
|
|
92
|
-
| 忽略混合策略 | 纯策略均衡可能不存在,混合均衡总存在(Nash, 1950) | 检查是否需混合策略分析 |
|
|
93
|
-
| 混淆纳什均衡与帕累托最优 | 纳什均衡可帕累托劣(囚徒困境),两者独立 | 分别标注均衡性与效率性 |
|
|
94
|
-
| 忽略信息不对称 | 不完全信息均衡与完全信息截然不同 | 区分贝叶斯博弈与完全信息博弈 |
|
|
95
|
-
| 过度简化支付结构 | 遗漏关键支付维度使均衡失真 | 系统检查所有参与者完整支付 |
|
|
96
|
-
| 忽略重复互动动态 | 单次均衡在重复博弈中可能改变(folk theorem) | 分析子博弈完美均衡 |
|
|
97
|
-
| 大规模均衡精确求解不可算 | n 人纳什均衡 PPAD-complete,精确解不可行 | 过 GPU 八维门,改用近似/学习(虚拟自博、MARL) |
|
|
98
|
-
|
|
99
|
-
## 操作规程 / Operating Procedure
|
|
100
|
-
|
|
101
|
-
当本 skill 被触发时,输出必须包含:
|
|
102
|
-
|
|
103
|
-
1. **[参与者]**:所有决策者及其类型(理性/有限理性/未知)。
|
|
104
|
-
2. **[策略集]**:每个参与者的可选策略,标注有限/无限。
|
|
105
|
-
3. **[支付矩阵]**:核心策略组合的支付值 $(u_1,u_2,\ldots)$ 或支付函数形式。
|
|
106
|
-
4. **[博弈类型]**:零和/非零和/序列/合作,对应分析方法。
|
|
107
|
-
5. **[均衡]**:所有适用均衡(纯策略、混合策略、子博弈完美、合作分配等),标注多重均衡。
|
|
108
|
-
6. **[稳定性]**:颤抖手完美性、演化稳定性、偏离均衡路径激励。
|
|
109
|
-
7. **[机制建议]**:若均衡不理想,提出机制设计建议(改变支付、增加规则、引入声誉等)。
|
|
110
|
-
8. **[GPU 可行性]**:矩阵博弈/minimax→LP 可 GEMM;大规模多智能体均衡是否不可算→近似/学习方法,过八维门。
|
|
111
|
-
|
|
112
|
-
**输出不得只给分析而无结论。**
|
|
113
|
-
|
|
114
|
-
## 与其他 skill 的关系 / Relations to Other Skills
|
|
115
|
-
|
|
116
|
-
- **优化思想**:纳什均衡是互相优化——每人在他人策略约束下优化自己支付,均衡是所有优化问题的共同解。
|
|
117
|
-
- **概率与统计**:混合策略以概率分布选行动,贝叶斯博弈用概率处理类型不确定性,均衡依赖期望支付。
|
|
118
|
-
- **信息论思想**:信息不对称与信号传递——Spence 信号博弈中信息结构直接影响均衡存在与性质。
|
|
119
|
-
- **因果推断思想**:策略选择因果影响他人收益,战略互动中的因果链是双向的。
|
|
120
|
-
- **算法思想**:纳什均衡计算复杂度(PPAD-complete)、Lemke-Howson 算法、演化博弈模拟。
|
|
121
|
-
- **现代数学激活**:`../../references/books/optimization-ml.md`(对偶/minimax、博弈学习算法)、`../../references/books/matrix-analysis.md`(矩阵博弈、支付矩阵的线性代数结构)。
|
|
@@ -1,131 +0,0 @@
|
|
|
1
|
-
# 数学出处与经典文献 / Mathematical Sources and Classic Texts
|
|
2
|
-
|
|
3
|
-
## Zermelo 定理 / Zermelo's Theorem (1913)
|
|
4
|
-
|
|
5
|
-
> Zermelo(1913)证明:在有限完美信息二人博弈中(如国际象棋),先手或后手必有一方有必胜策略或双方有必和策略。即博弈是"确定的"(determined)。
|
|
6
|
-
|
|
7
|
-
**核心论点**:对任何有限完美信息博弈,$\exists$ 先手必胜策略 $\lor$ $\exists$ 后手必胜策略 $\lor$ $\exists$ 双方必和策略。证明了此类博弈不存在真正的"不确定性"——不确定性的来源是计算复杂度而非逻辑结构。
|
|
8
|
-
|
|
9
|
-
**思想**:完美信息博弈的结局在逻辑上是预定的——不确定性来自计算能力的限制而非博弈本身。Zermelo 的证明使用逆向归纳法(backward induction),这在后来成为子博弈完美均衡的核心工具。数学背景:Zermelo 同年也在集合论中提出选择公理(AC),博弈论与集合论共享"有限选择必可穷尽"的逻辑。
|
|
10
|
-
|
|
11
|
-
## von Neumann Minimax 定理 / von Neumann's Minimax Theorem (1928)
|
|
12
|
-
|
|
13
|
-
> von Neumann(1928)证明:在二人零和博弈中,$\max_{x \in \Delta} \min_{y \in \Delta} \sum_{ij} a_{ij} x_i y_j = \min_{y \in \Delta} \max_{x \in \Delta} \sum_{ij} a_{ij} x_i y_j$。即保守策略的最优结果等于对手保守策略下的最优结果——max-min = min-max。
|
|
14
|
-
|
|
15
|
-
**核心定理**:对任何二人零和矩阵博弈 $A$,存在混合策略 $x^*$ 和 $y^*$ 使得
|
|
16
|
-
|
|
17
|
-
$$v^* = \max_x \min_y x^\top A y = \min_y \max_x x^\top A y$$
|
|
18
|
-
|
|
19
|
-
$v^*$ 称为博弈的值(value of the game)。证明利用了凸集分离定理(后与 Brouwer 不动点定理有深层联系)。
|
|
20
|
-
|
|
21
|
-
**思想**:minimax 定理揭示了零和博弈的结构对称性——"我尽可能赢"等价于"对手尽可能防"。最优混合策略使对手对所有纯策略无差异。此定理是线性规划对偶性的先声:Dantzig(1947)发现 LP 对偶与 minimax 等价,von Neumann 独立发现了同样联系。
|
|
22
|
-
|
|
23
|
-
## Nash 均衡的存在性 / Existence of Nash Equilibrium (1950)
|
|
24
|
-
|
|
25
|
-
> Nash(1950)证明:每个有限博弈(任意人数、非零和)至少存在一个混合策略纳什均衡。证明使用 Brouwer 不动点定理——构造最优响应映射 $BR: \Delta \to \Delta$,其不动点即为纳什均衡。
|
|
26
|
-
|
|
27
|
-
**核心定理**:对任何有限博弈 $(N, \{S_i\}, \{u_i\})$,$\exists \sigma^* \in \Delta_1 \times \cdots \times \Delta_n$ 使得对所有 $i$ 和 $s_i \in S_i$,
|
|
28
|
-
|
|
29
|
-
$$u_i(\sigma^*) \geq u_i(s_i, \sigma^*_{-i})$$
|
|
30
|
-
|
|
31
|
-
Nash 的证明将 Brouwer 不动点定理应用于最优响应映射:$F(\sigma) = (BR_1(\sigma_{-1}), \ldots, BR_n(\sigma_{-n}))$,$F$ 的不动点即均衡。后续证明也用 Kakutani 不动点定理(对应集值映射)。
|
|
32
|
-
|
|
33
|
-
**思想**:纳什均衡的存在性不依赖参与者的"善意"或"合作意愿"——它是自私行为在战略互动中的逻辑必然。Nash 均衡推广了 minimax 定理到非零和博弈,从二人对抗到多人互动。数学背景:Brouwer 不动点定理(1911)是拓扑学核心定理——连续映射必有不动点,博弈论与拓扑学在此交汇。
|
|
34
|
-
|
|
35
|
-
## 囚徒困境 / Prisoner's Dilemma
|
|
36
|
-
|
|
37
|
-
> 囚徒困境是博弈论最经典的范例:两个参与者各自有"合作"和"背叛"策略。背叛是占优策略,但(背叛, 背叛)是帕累托劣于(合作, 合作)——个体理性导致集体非理性。
|
|
38
|
-
|
|
39
|
-
**支付矩阵**:
|
|
40
|
-
|
|
41
|
-
| | 合作 (C) | 背叛 (D) |
|
|
42
|
-
|---|---|---|
|
|
43
|
-
| 合作 (C) | (3, 3) | (0, 5) |
|
|
44
|
-
| 背叛 (D) | (5, 0) | (1, 1) |
|
|
45
|
-
|
|
46
|
-
严格占优策略分析:对每个参与者,背叛严格优于合作($5 > 3$ 且 $1 > 0$)。唯一纳什均衡 (D, D) 支付 (1, 1),帕累托劣于 (C, C) 支付 (3, 3)。
|
|
47
|
-
|
|
48
|
-
**思想**:囚徒困境揭示了个体理性与集体理性的根本张力——纳什均衡不保证帕累托最优。此困境在现实中无处不在:军备竞赛、公地悲剧、价格战、碳排放。Axelrod(1984)的计算机竞赛表明:在重复囚徒困境中,"一报还一报"(Tit-for-Tat)策略可维持合作——重复互动改变均衡结构。
|
|
49
|
-
|
|
50
|
-
## 逆向归纳法与子博弈完美 / Backward Induction & Subgame Perfection
|
|
51
|
-
|
|
52
|
-
> 逆向归纳法(backward induction)是序列博弈的核心分析工具:从终端节点向前回溯,每步选择最优行动。Selten(1965)定义子博弈完美均衡(subgame perfect equilibrium, SPE):在每个子博弈上都构成纳什均衡的策略组合——排除基于不可信威胁的均衡。
|
|
53
|
-
|
|
54
|
-
**核心概念**:纳什均衡允许"不可信威胁"——参与者声称将采取某行动,但到达该节点时偏离更有利。SPE 要求均衡在每个子博弈上都成立,因此排除了不可信威胁。逆向归纳法是求解 SPE 的标准方法。
|
|
55
|
-
|
|
56
|
-
**思想**:序列博弈中,时间结构引入了承诺与可信性问题——"威胁"必须是理性的才有效。逆向归纳法将多阶段决策分解为单阶段子问题,与 Bellman 最优性原理一脉相承。数学背景:Zermelo(1913)的定理使用逆向归纳法,Selten(1965)将其系统化为 SPE 概念。Selten 与 Nash、Harsanyi 共获 1994 年诺贝尔经济学奖。
|
|
57
|
-
|
|
58
|
-
## Shapley 值与合作博弈 / Shapley Value & Cooperative Game Theory (1953)
|
|
59
|
-
|
|
60
|
-
> Shapley(1953)提出合作博弈中唯一满足效率、对称性、哑元性和可加性的分配规则——Shapley 值 $\phi_i(v)$。它按边际贡献的平均值分配联盟收益。
|
|
61
|
-
|
|
62
|
-
$$\phi_i(v) = \sum_{S \subseteq N \setminus \{i\}} \frac{|S|!(n - |S| - 1)!}{n!} [v(S \cup \{i\}) - v(S)]$$
|
|
63
|
-
|
|
64
|
-
Shapley 值是唯一满足以下四条公理的分配:
|
|
65
|
-
1. **效率性**:$\sum_i \phi_i(v) = v(N)$
|
|
66
|
-
2. **对称性**:若 $i$ 和 $j$ 在所有联盟中贡献相同,则 $\phi_i = \phi_j$
|
|
67
|
-
3. **哑元性**:若 $i$ 对所有联盟无边际贡献,则 $\phi_i = 0$
|
|
68
|
-
4. **可加性**:$\phi_i(v + w) = \phi_i(v) + \phi_i(w)$
|
|
69
|
-
|
|
70
|
-
**思想**:Shapley 值将"公平"转化为数学公理——公平不是主观判断,而是逻辑必然。合作博弈的核心问题:联盟产生的总收益如何分配?Shapley 值给出唯一满足公理的答案。核心(core)是另一种解概念——任何联盟的分配不低于其自身价值,但核心可能为空集。
|
|
71
|
-
|
|
72
|
-
## Nash 讨价还价解 / Nash Bargaining Solution (1950)
|
|
73
|
-
|
|
74
|
-
> Nash(1950)提出满足帕累托最优性、对称性、尺度无关性和独立性缩减的唯二讨价还价解。设威胁点 $d = (d_1, d_2)$,可行集 $S \subseteq \mathbb{R}^2$,Nash 解最大化 $(u_1 - d_1)(u_2 - d_2)$。
|
|
75
|
-
|
|
76
|
-
$$\max_{(u_1, u_2) \in S, u_i \geq d_i} (u_1 - d_1)(u_2 - d_2)$$
|
|
77
|
-
|
|
78
|
-
Nash 证明此解是满足四条公理的唯一分配。威胁点 $d$ 是谈判失败时各方的收益——威胁点越有利,谈判结果越有利。
|
|
79
|
-
|
|
80
|
-
**思想**:讨价还价问题将"谈判"转化为数学优化——在可行集和威胁点约束下最大化联合收益。Nash 解的对称性与帕累托最优性使其成为公平谈判的自然基准。数学背景:此模型将合作博弈与非合作博弈联系起来——Nash 程序(Nash program)主张所有合作博弈解都应通过非合作博弈模型推导。
|
|
81
|
-
|
|
82
|
-
## 演化博弈论 / Evolutionary Game Theory (Maynard Smith, 1973)
|
|
83
|
-
|
|
84
|
-
> Maynard Smith(1973)提出演化稳定策略(Evolutionarily Stable Strategy, ESS):策略 $\sigma^*$ 是 ESS,若对任何入侵策略 $\sigma \neq \sigma^*$,要么 $u(\sigma^*, \sigma^*) > u(\sigma, \sigma^*)$,要么 $u(\sigma^*, \sigma^*) = u(\sigma, \sigma^*)$ 且 $u(\sigma^*, \sigma) > u(\sigma, \sigma)$。
|
|
85
|
-
|
|
86
|
-
**核心定义**:ESS 是比纳什均衡更强的稳定性概念——不仅要"不被偏离",还要"不被入侵"。纳什均衡是 ESS 的必要条件,但 ESS 附加了稳定性要求。
|
|
87
|
-
|
|
88
|
-
**思想**:演化博弈论将博弈论从"理性选择"推广到"适应性动态"——参与者不必理性,只需在重复互动中调整策略。生物学应用:性别比例博弈、鹰鸽博弈(Hawk-Dove)、资源竞争。经济学应用:市场惯例的形成、技术标准的扩散。数学背景:ESS 与复制者动态(replicator dynamics)联系——ESS 是复制者动态的局部稳定点。
|
|
89
|
-
|
|
90
|
-
## Vickrey 拍卖与拍卖理论 / Vickrey Auction & Auction Theory (1961)
|
|
91
|
-
|
|
92
|
-
> Vickrey(1961)提出第二价格拍卖(second-price sealed-bid auction):出价最高者获胜,但支付第二高出价。报真实估值是占优策略——机制设计的奠基之作。
|
|
93
|
-
|
|
94
|
-
**核心定理**:在 Vickrey 拍卖中,报真实估值 $b_i = v_i$ 是每个投标者的弱占优策略。证明:设真实估值 $v_i$,第二高出价 $p$。若 $v_i > p$,报 $b_i = v_i$ 获胜支付 $p$,收益 $v_i - p > 0$;若 $b_i > v_i > p$ 同样获胜但收益不变;若 $b_i < v_i$ 可能失去正收益。因此如实报告最优。
|
|
95
|
-
|
|
96
|
-
Vickrey 证明了对称风险中性投标者,四种标准拍卖(英式、荷式、第一价格密封、第二价格密封)的期望收入相等——**收入等价定理(Revenue Equivalence Theorem)**。Milgrom & Weber(1982)推广到关联估值(affiliated values),发现英式拍卖收入最高。
|
|
97
|
-
|
|
98
|
-
**思想**:Vickrey 拍卖是激励相容(incentive-compatible)机制的典范——通过巧妙设计支付规则,使自利行为自动导向效率最优。拍卖理论将博弈论应用于市场设计:如何通过规则引导理性参与者产生最优结果?数学背景:Vickrey 共获 1996 年诺贝尔经济学奖。
|
|
99
|
-
|
|
100
|
-
## 机制设计 / Mechanism Design (Hurwicz, Myerson, Maskin — Nobel 2007)
|
|
101
|
-
|
|
102
|
-
> 机制设计是博弈论的"逆向工程"——给定目标结果,设计博弈规则使理性参与者的自利行为自动实现该目标。Hurwicz、Myerson、Maskin 因此获 2007 年诺贝尔经济学奖。
|
|
103
|
-
|
|
104
|
-
**核心概念**:
|
|
105
|
-
- **激励相容性(Incentive Compatibility)**:如实报告类型是均衡策略——参与者没有动机谎报
|
|
106
|
-
- **显示原理(Revelation Principle)**:任何贝叶斯博弈的均衡都可由直接机制实现——参与者如实报告类型即达均衡,无需复杂策略
|
|
107
|
-
- **Myerson 最优拍卖**:在独立私人估值模型下,最大化卖家期望收入的最优机制——虚拟估值 $v_i - (1 - F_i(v_i))/f_i(v_i)$ 最高者获胜
|
|
108
|
-
|
|
109
|
-
$$\text{Virtual valuation: } \varphi_i(v_i) = v_i - \frac{1 - F_i(v_i)}{f_i(v_i)}$$
|
|
110
|
-
|
|
111
|
-
- **Maskin 可实施性(Maskin Monotonicity)**:社会选择函数可被纳什实施的必要条件——偏好单调性
|
|
112
|
-
|
|
113
|
-
**思想**:机制设计回答"如何设计规则"而非"给定规则下如何行动"——从博弈的结果反推博弈的结构。显示原理简化了机制设计:只需考虑直接机制。激励相容性保证了规则与动机的一致——制度设计不是空想,而是可被数学验证的工程。数学背景:Hurwicz(1960s)引入激励相容性概念;Myerson(1981)发展最优拍卖理论;Maskin(1977/1999)发展纳什可实施性理论。
|
|
114
|
-
|
|
115
|
-
## 信号博弈 / Signaling Games (Spence, 1973)
|
|
116
|
-
|
|
117
|
-
> Spence(1973)提出信号传递模型:在信息不对称下,拥有私人信息的发送者通过可观察的行动(信号)向接收者传递信息。经典应用:教育作为能力信号——高能力者获得教育的成本更低,因此教育投资传递了能力信息。
|
|
118
|
-
|
|
119
|
-
**核心模型**:发送者有类型 $t \in \{H, L\}$(高/低能力),选择信号 $s \in \{e, 0\}$(受教育/不受教育),接收者观测 $s$ 后选择响应 $a$。分离均衡:$H$ 选 $e$,$L$ 选 $0$——信号完美传递类型。混同均衡:两者都选相同信号——信号无信息量。
|
|
120
|
-
|
|
121
|
-
**思想**:信号博弈揭示了信息传递的经济学——信号必须有成本差异才能传递信息(否则人人都会模仿)。Spence 模型中,教育的社会价值可能完全是信号价值而非生产力提升——这引发了关于教育本质的深刻讨论。Spence 共获 2001 年诺贝尔经济学奖。数学背景:信号博弈是贝叶斯博弈的子类——类型是私人信息,策略是类型依赖的。
|
|
122
|
-
|
|
123
|
-
## 重复博弈与 Folk 定理 / Repeated Games & Folk Theorem
|
|
124
|
-
|
|
125
|
-
> Folk 定理(民间定理,1970s 非正式流传,Aumann 1981 系统化):在无限重复博弈中,任何个体理性支付 $v_i \geq \min_{s_{-i}} \max_{s_i} u_i(s_i, s_{-i})$(minimax 支付)都可以作为子博弈完美均衡的平均支付被实现。
|
|
126
|
-
|
|
127
|
-
**核心定理**:设 $v = (v_1, \ldots, v_n)$ 为可行且个体理性的支付向量($v_i \geq \underline{v}_i$,$\underline{v}_i$ 为 $i$ 的 minimax 值),则在贴现因子 $\delta$ 足够接近 1 时,$v$ 可作为无限重复博弈的子博弈完美均衡的平均支付被实现。
|
|
128
|
-
|
|
129
|
-
实现机制:惩罚策略(punishment strategy)——偏离者将被"惩罚"回 minimax 支付水平,偏离的短期收益被长期惩罚抵消。
|
|
130
|
-
|
|
131
|
-
**思想**:Folk 定理是重复博弈的核心结果——它解释了为什么合作在长期互动中可能维持:偏离的短期收益小于长期惩罚的损失。此定理也解释了为什么重复博弈有无数个均衡——几乎任何可行支付都可被实现。Aumann(2005 年诺贝尔奖)系统化了此理论。数学背景:贴现因子 $\delta$ 趋近 1 使得未来惩罚足够重——$\delta \geq \frac{g}{g + l}$,$g$ 为偏离收益,$l$ 为惩罚损失。
|
|
@@ -1,150 +0,0 @@
|
|
|
1
|
-
---
|
|
2
|
-
name: induction-analogy
|
|
3
|
-
description: |
|
|
4
|
-
触发:从数据/经验找规律、特殊→一般、已知→未知、数学归纳证明(弱/强/结构/超限)、跨域类比迁移结构、为算法/算子设计借鉴其他领域结构等科研语境时调用。
|
|
5
|
-
English: Trigger when finding patterns from data/experience, specific→general, known→unknown, mathematical induction proofs (weak/strong/structural/transfinite), cross-domain analogical transfer of structures, or borrowing structures from other fields for algorithm/operator design.
|
|
6
|
-
---
|
|
7
|
-
|
|
8
|
-
# 📈 归纳与类比 / Induction & Analogy
|
|
9
|
-
|
|
10
|
-
> "从特殊到一般,从已知到未知——归纳发现规律,类比迁移经验,两者都不等于证明"
|
|
11
|
-
> "From the specific to the general, from the known to the unknown—induction discovers patterns, analogy transfers experience, but neither equals proof"
|
|
12
|
-
>
|
|
13
|
-
> —— Pólya《数学与猜想》、Lakatos《证明与反驳》
|
|
14
|
-
> —— Pólya "Mathematics and Plausible Reasoning", Lakatos "Proofs and Refutations"
|
|
15
|
-
|
|
16
|
-
## 核心原则 / Core Principle
|
|
17
|
-
|
|
18
|
-
**归纳是从有限实例中发现一般规律的过程,是创造新知识的引擎;类比是将一个领域的理解迁移到另一个领域的桥梁。两者都不是严格证明,但都是发现定理、提出假说、产生创新的根本方法。严格性是验证的工具,而非发现的工具——Pólya。**
|
|
19
|
-
|
|
20
|
-
**Induction discovers general patterns from limited instances—the engine of new knowledge; analogy transfers understanding across domains. Neither is rigorous proof, but both are fundamental to discovering theorems, proposing hypotheses, and generating innovation. Rigor is a tool of verification, not of discovery—Pólya.**
|
|
21
|
-
|
|
22
|
-
归纳与类比的区别:**归纳**从 N 个具体案例 → 一般规律(纵向深入);**类比**从领域 A 的结构 → 领域 B 的结构(横向迁移);两者都产生假设而非定理,需后续验证。
|
|
23
|
-
|
|
24
|
-
> **数学形式化 / Mathematical Formalization**
|
|
25
|
-
>
|
|
26
|
-
> 归纳推理与归纳证明的严格区分:
|
|
27
|
-
> - 归纳推理(inductive reasoning):经验性的,从观察中提出假说
|
|
28
|
-
> - 归纳证明(inductive proof):逻辑性的,数学归纳法是严格的演绎证明格式
|
|
29
|
-
> - 关键:归纳推理产生猜想,归纳证明验证猜想——两者不可混淆
|
|
30
|
-
>
|
|
31
|
-
> 归纳证明的变体及其适用场景:
|
|
32
|
-
> - **弱归纳法(Weak Induction)**:证明 P(1) 成立 + 证明 ∀k(P(k)→P(k+1)) → 得出 ∀n P(n);适用:P(k+1) 仅依赖 P(k)
|
|
33
|
-
> - **强归纳法(Strong / Complete Induction)**:假设 P(1), P(2), …, P(k) 全部成立,证明 P(k+1) 成立;适用:P(k+1) 依赖多个前驱
|
|
34
|
-
> - **结构归纳法(Structural Induction)**:证明 P(base) 成立 + P(composite) 由 P(components) 推出;适用:递归定义的结构(树、列表、表达式)
|
|
35
|
-
> - **超限归纳法(Transfinite Induction)**:对良序集 (W, <),证明 ∀α∈W(∀β<α P(β) → P(α)) → ∀α∈W P(α);适用:索引超越自然数的良序集
|
|
36
|
-
>
|
|
37
|
-
> Lakatos 方法论的形式化描述:
|
|
38
|
-
> - **怪物排除(monster-barring)**:将反例归为不属于假说本意范围的对象,在假说中显式排除——最简单的修正,但需警惕过度排除导致假说空洞化
|
|
39
|
-
> - **引理吸收(lemma-incorporation)**:将反例暴露的隐藏条件纳入假说作为新引理——使假说更精确
|
|
40
|
-
> - **证明策略修订(proof-strategy revision)**:反例揭示原证明思路有根本缺陷,需换一种证明框架——最深刻的修正
|
|
41
|
-
>
|
|
42
|
-
> 类比的结构性相似度度量:
|
|
43
|
-
> - 结构相似度 = (成功映射的关系数 + 成功映射的组件数) / (源关系总数 + 源组件总数)
|
|
44
|
-
> - 高有效性(同态映射 homomorphism):大部分结构有对应,关键关系保持
|
|
45
|
-
> - 中有效性(部分同态 partial homomorphism):部分结构和关系保持,部分失真
|
|
46
|
-
> - 低有效性(表面相似 surface similarity):仅外观或术语相似,深层结构不同
|
|
47
|
-
|
|
48
|
-
## GPU 友好性 / GPU-Friendliness(横切检查)
|
|
49
|
-
|
|
50
|
-
归纳与类比本身偏**元启发式**——它们产生猜想、迁移结构,但不直接规定计算。真正要过 GPU 八维门的是它们的**产物**:被迁移到算法/算子设计中的那个结构。类比迁移来的结构若不可算则需改造。
|
|
51
|
-
|
|
52
|
-
- **友好**:迁移来的结构能写成稠密 GEMM 链或低秩线性映射——如结构归纳思路落到递归算子的可融合实现、代数同态类比成低秩 GEMM(维度 1/2/4)。
|
|
53
|
-
- **可改造**:迁移来的全局/串行结构(朴素上同调计算、非结构化图遍历、朴素 RNN 式递推)→ 用块稀疏化、低秩投影、热带半环松弛改造(见 `../../references/gpu-friendly-math.md` 改造手法)。
|
|
54
|
-
- **反模式**:仅因结构同构/同态优美就采用,却忽略 O(n²) 显存、fp64 依赖或长串行递推——"数学美 ≠ 可算",类比结论即便数学正确也未必硬件可行。
|
|
55
|
-
|
|
56
|
-
八维最低判定(正式术语):**张量化**检查迁移结构的可批量表达;**GEMM 可映射**检查类比后的核心算子是否落矩阵乘;**复杂度**检查从源领域带来的全局构造是否爆炸;**显存与 KV-Cache**检查是否引入大表或长缓存;**低精度稳定**检查类比结构是否依赖精确符号/高精度;**并行与通信**检查递推或交互能否分块;**稀疏结构**检查稀疏是否规则;**算子融合**检查迁移结构是否可实现为少量 fused ops。
|
|
57
|
-
|
|
58
|
-
> 配合 `../../references/gpu-friendly-math.md`(八维门)、`../../references/books/abstract-algebra.md`(同态/同构结构)、`../../references/books/algebraic-geometry-rising-sea.md`(跨域结构迁移与压缩)。
|
|
59
|
-
|
|
60
|
-
## 不适用场景 / When NOT to Use
|
|
61
|
-
|
|
62
|
-
- **需要严格证明**——归纳推理和类比只能产生假设,不是证明;但数学归纳法本身是证明方法。
|
|
63
|
-
- **样本只有一个或极少**——归纳推理需要足够的实例支撑。
|
|
64
|
-
- **两个领域差异太大**——类比需要结构相似性,而非表面相似。
|
|
65
|
-
- **结论必须零误差**——归纳推理有不确定性,类比有失真风险。
|
|
66
|
-
- **问题可用演绎直接解决**——不必绕道归纳。
|
|
67
|
-
|
|
68
|
-
## 何时使用 / When to Use
|
|
69
|
-
|
|
70
|
-
- 观察到多个案例有共同模式,想要提出一般性假说。
|
|
71
|
-
- 在科研中尝试发现新定理或新规律。
|
|
72
|
-
- 需要对递归定义的结构(树、列表、表达式)进行性质证明——使用结构归纳法。
|
|
73
|
-
- 需要证明涉及分解的命题(如整数的素因子分解)——使用强归纳法。
|
|
74
|
-
- 需要对超越自然数的良序集进行论证——使用超限归纳法。
|
|
75
|
-
- 跨学科借鉴——其他领域的方法能否用到我的问题?
|
|
76
|
-
- **为算法/算子设计借鉴其他领域的结构**——跨域类比迁移结构(如代数同态→低秩映射、层扩散→块摘要),迁移后过 GPU 八维门再采用。
|
|
77
|
-
|
|
78
|
-
## 方法流程 / Method
|
|
79
|
-
|
|
80
|
-
### 第一步:收集具体案例 / Collect Concrete Cases
|
|
81
|
-
系统收集与观察具体实例:阅读文献提取关键案例、收集实验数据中的模式、整理已知定理;确保案例覆盖边界值、典型值与极端值。案例的多样性与覆盖度决定归纳质量——太少或太单一会误导。
|
|
82
|
-
|
|
83
|
-
### 第二步:识别模式 / Identify Patterns
|
|
84
|
-
比较案例的共同点与差异:什么特征在所有(或大多数)案例中出现?什么只出现在部分?差异是否有规律?注意模式可能在若干案例后突然破坏(如 Borwein 积分现象)——只看共同点会忽视反例。
|
|
85
|
-
|
|
86
|
-
### 第三步:提出假说 / Formulate a Hypothesis
|
|
87
|
-
基于观察到的模式提出一般性假说:**强假说** ∀n P(n)(所有情况成立);**弱假说** P(n) 对足够大的 n 成立(存在例外);**条件假说** ∀n∈S P(n)(特定子集)。选择原则:优先尝试强假说,再用反例逐级弱化。假说必须足够明确以至于可被推翻。
|
|
88
|
-
|
|
89
|
-
### 第四步:搜索反例 / Search for Counterexamples
|
|
90
|
-
主动寻找推翻假说的反例——区分科学与伪科学的关键。找到反例则修改(弱化或加条件);找不到则假说暂时成立。特别关注边界条件、极端值、参数变化时模式是否突然失效。
|
|
91
|
-
|
|
92
|
-
### 第五步:尝试证明 / Attempt a Proof
|
|
93
|
-
对数学假说尝试严格证明,选择正确的归纳变体是关键:
|
|
94
|
-
|
|
95
|
-
- **弱归纳法(Weak Induction)**:证明 P(1) + ∀k(P(k)→P(k+1)) → ∀n P(n);适用 P(k+1) 仅依赖 P(k)(求和公式、简单递推);示例 1+2+…+n = n(n+1)/2。
|
|
96
|
-
- **强归纳法(Strong Induction)**:假设 P(1)..P(k) 全部成立证 P(k+1);适用 P(k+1) 依赖多个前驱(分解、拆分命题);示例:每个大于 1 的整数都是素数乘积、斐波那契性质。关键:P(k+1) 需引用 P(j)(j<k) 时必须用强归纳。
|
|
97
|
-
- **结构归纳法(Structural Induction)**:证 P(base) + P(composite) 由 P(components) 推出;适用递归定义结构(树、列表、表达式、公式、程序语义);示例:二叉树叶节点数 = 内部节点数 + 1。它是数学归纳法在递归结构上的自然推广。
|
|
98
|
-
- **超限归纳法(Transfinite Induction)**:对良序集 (W,<) 证 ∀α∈W(∀β<α P(β)→P(α)) → ∀α∈W P(α);适用索引超越自然数的良序集(序数、偏序集、拓扑传递闭包);示例:Zorn 引理应用、集合论递归构造。
|
|
99
|
-
- **良序原理等价性**:每个非空子集有最小元 ↔ 自然数归纳法 ↔ 强归纳法 ↔ 良序集上的超限归纳。实践意义:选最自然的形式。
|
|
100
|
-
|
|
101
|
-
### 第六步:类比迁移 / Analogical Transfer
|
|
102
|
-
使用类比必须定量评估而非仅凭直觉:
|
|
103
|
-
|
|
104
|
-
- **结构性相似度度量**:结构相似度 = (成功映射的关系数 + 成功映射的组件数) / (源关系总数 + 源组件总数)。
|
|
105
|
-
- **类比有效性分级**:**高有效性(同态映射 homomorphism)**——大部分结构有对应、关键关系保持,结论可信度高;**中有效性(部分同态)**——部分保持部分失真,结论需修正后使用;**低有效性(表面相似)**——仅外观/术语相似,深层结构不同,结论基本不可信。
|
|
106
|
-
- **系统性检验清单**:① 源领域每个组件,目标领域是否有对应?② 每个关系在目标领域是否成立?③ 每个操作在目标领域是否有定义?④ 映射一致性:若 a↦a', b↦b',则 R(a,b) 是否蕴含 R'(a',b')?
|
|
107
|
-
|
|
108
|
-
### 第七步:假说修正 / Hypothesis Revision
|
|
109
|
-
据反例与证明尝试结果修正假说,遵循 Lakatos 方法论:**怪物排除(monster-barring)**——将反例归为不属于假说本意范围并显式排除(最简单,警惕过度排除致空洞化);**引理吸收(lemma-incorporation)**——将反例暴露的隐藏条件纳入为新引理(使假说更精确);**证明策略修订(proof-strategy revision)**——反例揭示原证明思路根本缺陷,换证明框架(最深刻)。修正后回到第四步,迭代直至假说稳定。
|
|
110
|
-
|
|
111
|
-
## 常见错误 / Common Errors
|
|
112
|
-
|
|
113
|
-
| 错误 / Error | 批评 / Critique | 正确做法 / Correct Approach |
|
|
114
|
-
|---|---|---|
|
|
115
|
-
| 样本不足就归纳 | 从 2-3 个案例归纳的"规律"极不可靠 | 样本量要足够大,且覆盖各种情况 |
|
|
116
|
-
| 把归纳推理当证明 | 归纳推理只产生假设,不是证明;数学归纳法才是证明 | 区分归纳推理与归纳证明,前者产猜想后者验证 |
|
|
117
|
-
| 确认偏差 | 只看到支持假说的案例,忽视反例 | 主动寻找反例——最关键的一步 |
|
|
118
|
-
| 表面类比 | 基于表面相似而非结构相似的类比 | 类比的依据是结构同构/同态,不是表面相似 |
|
|
119
|
-
| 类比过度 | 两个领域不完全同构,类比结论不完全成立 | 用结构性相似度量化评估类比强度 |
|
|
120
|
-
| 归纳后不验证 | 提出假说后不去检验 | 假说必须经过反例检验和/或证明 |
|
|
121
|
-
| 需强归纳却用弱归纳 | P(k+1) 依赖多个前驱时,弱归纳无法完成归纳步骤 | 识别依赖结构:若 P(k+1) 需引用 P(j)(j<k),用强归纳 |
|
|
122
|
-
| 仅凭表面特征评估类比 | 表面特征相似不意味着结构相似,结论可能完全错误 | 用系统映射逐一比较组件、关系、操作 |
|
|
123
|
-
| 混淆归纳推理与归纳证明 | 归纳推理是经验性的,归纳证明是演绎性的——性质完全不同 | 明确区分:推理→假说,证明→定理 |
|
|
124
|
-
| 忽略模式破坏(Borwein积分) | 模式在前若干案例中成立后可能突然失效,归纳推理有盲区 | 检查足够多案例,关注边界与参数变化时的模式突变 |
|
|
125
|
-
| 类比迁移来不可算的结构 | 仅因结构同构优美就采用,忽略 O(n²) 显存或 fp64 依赖——"数学美 ≠ 可算" | 迁移来的结构先过 GPU 八维门,不可算则改造(低秩/块稀疏/松弛)后再采用 |
|
|
126
|
-
|
|
127
|
-
## 操作规程 / Operating Procedure
|
|
128
|
-
|
|
129
|
-
当本 skill 被触发时,输出必须包含:
|
|
130
|
-
|
|
131
|
-
1. **案例清单**:`[案例N]: [描述] [关键特征]`,确保覆盖边界值与极端值。
|
|
132
|
-
2. **模式识别**:`[共同模式]: [描述] [出现频率: N/M] [差异模式]: [描述]`,注意是否有 Borwein 型突然破坏。
|
|
133
|
-
3. **假说表述**:`[假说]: [内容] [类型: 强/弱/条件]`,优先尝试强假说。
|
|
134
|
-
4. **反例搜索**:`[反例]: [找到/未找到]。如找到: [描述],假说修正: [新表述]`。
|
|
135
|
-
5. **证明方向**:`[归纳类型: 弱/强/结构/超限]` 并给出证明思路;说明为何选择该变体。
|
|
136
|
-
6. **类比映射**:`[源领域A] → [目标领域B]: [对应关系] [结构相似度: X/Y] [有效性: 高/中/低]`,逐项检验组件、关系、操作。
|
|
137
|
-
7. **假说修正**:`[修正方式: 怪物排除/引理吸收/策略修订] [修正后假说]`。
|
|
138
|
-
8. **[GPU 可行性]**(若迁移结构用于算法/算子设计)— 迁移来的结构过 `../../references/gpu-friendly-math.md` 八维门,标注友好/可改造/不友好 + 改造建议。
|
|
139
|
-
|
|
140
|
-
**输出不得只给分析而无结论;需要继续执行时,在结尾用一句话说明接下来将做什么。**
|
|
141
|
-
|
|
142
|
-
## 与其他 skill 的关系 / Relations to Other Skills
|
|
143
|
-
|
|
144
|
-
- **逻辑演绎**:归纳产生假说,演绎证明假说——发现与验证的双翼。
|
|
145
|
-
- **抽象化思想**:类比本质上是识别两个领域的共同抽象结构。
|
|
146
|
-
- **概率与统计**:归纳推理的概率版本就是统计推断。
|
|
147
|
-
- **建模思想**:从数据中发现规律的归纳过程也是建模的一部分。
|
|
148
|
-
- **算法思想**:归纳作为正确性证明范式——循环不变量即归纳假设,递归程序正确性依赖结构归纳。
|
|
149
|
-
- **离散/组合思想**:组合归纳——对组合对象的归纳论证,如图论归纳、生成函数方法中的归纳递推。
|
|
150
|
-
- **现代数学激活**:`../../references/books/abstract-algebra.md`(结构类比:同态/同构作为类比的形式化)、`../../references/books/algebraic-geometry-rising-sea.md`(跨域结构迁移:层/限制映射/Plücker 压缩)。
|