知经百科 / Z

重期望定律

重期望定律 (Law of Iterated Expectations)

重期望定律(Law of Iterated Expectations,简称 LIE),又称全期望定律(Law of Total Expectation),是概率论计量经济学中最基础且应用最广泛的定理之一。它揭示了条件期望与无条件期望之间的递推关系:随机变量 YY 的无条件期望等于其关于另一个随机变量 XX 的条件期望的期望值。

形式化定义

(Ω,F,P)(\Omega, \mathcal{F}, P) 为概率空间,XXYY 为定义于其上的随机变量,且 E[Y]<E[|Y|] < \infty。重期望定律表述为:

E[Y]=E[E[YX]]E[Y] = E\big[E[Y \mid X]\big]

其中内层 E[YX]E[Y \mid X] 是给定 XXYY 的条件期望(一个关于 XX 的随机变量),外层期望对该随机变量取平均。更一般地,若 G\mathcal{G}F\mathcal{F} 的子 σ\sigma-代数,则有 E[Y]=E[E[YG]]E[Y] = E[E[Y \mid \mathcal{G}]]

直观解释

重期望定律给出了一种"分步计算"期望的策略:先按 XX 的取值将总体划分为若干子群体,在每一子群体内计算 YY 的条件均值 E[YX=x]E[Y \mid X = x],再将这些条件均值按 XX 的分布加权平均:

E[Y]=xE[YX=x]P(X=x)(离散情形)E[Y] = \sum_{x} E[Y \mid X = x] \cdot P(X = x) \quad \text{(离散情形)}
E[Y]=E[YX=x]fX(x)dx(连续情形)E[Y] = \int_{-\infty}^{\infty} E[Y \mid X = x] \cdot f_X(x) \, dx \quad \text{(连续情形)}

这一分解的思路在经济学直觉中十分自然:想知道全国平均收入,可以先算每个省份的平均收入,再按各省人口数加权平均——两种路径应得到同一结果。

证明概要

以连续情形为例,设联合密度为 fX,Y(x,y)f_{X,Y}(x,y),边缘密度为 fX(x)f_X(x),条件密度为 fYX(yx)f_{Y|X}(y|x)

E[E[YX]]=(yfYX(yx)dy)fX(x)dx=yfYX(yx)fX(x)dydx=yfX,Y(x,y)dydx=y(fX,Y(x,y)dx)dy=yfY(y)dy=E[Y]\begin{aligned} E\big[E[Y \mid X]\big] &= \int_{-\infty}^{\infty} \left( \int_{-\infty}^{\infty} y \, f_{Y|X}(y|x) \, dy \right) f_X(x) \, dx \\ &= \int_{-\infty}^{\infty} \int_{-\infty}^{\infty} y \, f_{Y|X}(y|x) \, f_X(x) \, dy \, dx \\ &= \int_{-\infty}^{\infty} \int_{-\infty}^{\infty} y \, f_{X,Y}(x,y) \, dy \, dx \\ &= \int_{-\infty}^{\infty} y \left( \int_{-\infty}^{\infty} f_{X,Y}(x,y) \, dx \right) dy \\ &= \int_{-\infty}^{\infty} y \, f_Y(y) \, dy = E[Y] \end{aligned}

关键在于条件密度与边缘密度的乘积等于联合密度:fYX(yx)fX(x)=fX,Y(x,y)f_{Y|X}(y|x) f_X(x) = f_{X,Y}(x,y)

核心性质与推论

重期望定律衍生出多个重要推论。第一,全方差定律(Law of Total Variance):将方差分解为条件方差的期望与条件期望的方差之和:

Var(Y)=E[Var(YX)]+Var(E[YX])\operatorname{Var}(Y) = E[\operatorname{Var}(Y \mid X)] + \operatorname{Var}(E[Y \mid X])

其中第一项度量"组内变异",第二项度量"组间变异"。这一分解在方差分析(ANOVA)和分层抽样中至关重要。

第二,对任意可测函数 gg,有 E[Yg(X)]=E[E[YX]g(X)]E[Y \cdot g(X)] = E[E[Y \mid X] \cdot g(X)]。该性质在推导工具变量估计量的大样本性质时频繁使用。

第三,若 E[YX]=0E[Y \mid X] = 0,则 E[Y]=0E[Y] = 0 且对任意函数 h(X)h(X),有 E[Yh(X)]=0E[Y \cdot h(X)] = 0。这一正交性条件是线性回归中误差项与解释变量不相关的理论基础。

计量经济学中的应用

重期望定律在计量经济学中无处不在。在普通最小二乘法(OLS)中,一阶条件 E[Xi(YiXiβ)]=0E[X_i (Y_i - X_i'\beta)] = 0 可通过重期望定律改写为 E{E[Xi(YiXiβ)Xi]}=E[Xi0]=0E\{E[X_i (Y_i - X_i'\beta) \mid X_i]\} = E[X_i \cdot 0] = 0,从而保证无偏性证明的严密性。

面板数据分析中,固定效应估计量本质上是对组内去均值后的变量应用重期望定律——先用组内变异识别参数,再通过对各组估计量的加权平均得到总体参数。在贝叶斯统计中,后验期望 E[θdata]E[\theta \mid \text{data}] 的无条件期望等于先验期望 E[θ]E[\theta](当数据尚未观测时),这正是重期望定律的直接应用。

预测理论中,重期望定律保证了条件期望 E[YX]E[Y \mid X] 是均方误差最小的预测函数:对任意预测函数 g(X)g(X)E[(YE[YX])2]E[(Yg(X))2]E[(Y - E[Y \mid X])^2] \le E[(Y - g(X))^2]。该结果可通过向条件期望中加减 g(X)g(X) 并利用重期望定律展开平方完成证明。

扩展与一般化

重期望定律可迭代推广至多个变量的情形。若 (Gt)(\mathcal{G}_t) 为递增的 σ\sigma-代数族(即一个滤波),则对 s<ts < t 有:

E[YGs]=E[E[YGt]Gs]E[Y \mid \mathcal{G}_s] = E\big[E[Y \mid \mathcal{G}_t] \mid \mathcal{G}_s\big]

这是(martingale)理论的支柱性质。在动态规划随机最优控制中,贝尔曼方程的价值函数迭代正是以此性质为逻辑基础。重期望定律以简洁的形式贯穿概率论、统计学和经济学的理论体系,其"分步取期望"的逻辑既是数学严谨性的保障,也是应用建模中不可或缺的思维工具。

返回百科索引