知经百科 / S

数学期望与方差的计算

数学期望与方差的计算 (Calculation of Mathematical Expectation and Variance)

概率论统计学中,数学期望 (Mathematical Expectation) 与 方差 (Variance) 是描述一个随机变量 (Random Variable) 分布特征的两个最核心的数字特征。数学期望衡量了随机变量取值的“中心趋势”或“平均水平”,而方差则度量了随机变量取值在其中心周围的“离散程度”或“波动大小”。掌握它们的计算方法是进行统计推断、金融建模和风险评估等众多应用领域的基础。

本讲义将系统地介绍离散型和连续型两种随机变量的数学期望与方差的定义、计算公式及核心性质。

一. 数学期望 (Mathematical Expectation)

数学期望,通常记为 E(X) E(X) μ \mu ,是一个随机变量所有可能取值按其出现概率加权的平均值。它揭示了随机变量在大量重复试验中的长期平均表现。计算方法依据随机变量的类型而有所不同。

1. 离散型随机变量 (Discrete Random Variable) 的期望

对于一个离散型随机变量 X X ,其所有可能的取值为 x1,x2,,xn, x_1, x_2, \dots, x_n, \dots ,对应的概率分别为 P(X=x1),P(X=x2),,P(X=xn), P(X=x_1), P(X=x_2), \dots, P(X=x_n), \dots 。其数学期望定义为:

E(X)=ixiP(X=xi)E(X) = \sum_{i} x_i P(X=x_i)

这个公式的本质是一个加权平均数,其中每个取值 xi x_i 的“权重”就是它发生的概率 P(X=xi) P(X=x_i)

示例:掷一个公平的六面骰子 设随机变量 X X 为掷出骰子的点数。 可能取值 xi x_i {1,2,3,4,5,6} \{1, 2, 3, 4, 5, 6\} 。 由于骰子是公平的,每个点数出现的概率 P(X=xi) P(X=x_i) 均为 16 \frac{1}{6} 。 根据公式,其数学期望为:

E(X)=116+216+316+416+516+616=1+2+3+4+5+66=216=3.5E(X) = 1 \cdot \frac{1}{6} + 2 \cdot \frac{1}{6} + 3 \cdot \frac{1}{6} + 4 \cdot \frac{1}{6} + 5 \cdot \frac{1}{6} + 6 \cdot \frac{1}{6} = \frac{1+2+3+4+5+6}{6} = \frac{21}{6} = 3.5

注意:计算出的期望值 3.5 自身并不是一个可能的掷骰结果。它代表的是,如果我们进行无数次掷骰子试验,所有结果的平均值将趋近于 3.5。

2. 连续型随机变量 (Continuous Random Variable) 的期望

对于一个连续型随机变量 X X ,其行为由概率密度函数 (Probability Density Function, PDF) f(x) f(x) 描述。其数学期望定义为:

E(X)=xf(x)dxE(X) = \int_{-\infty}^{\infty} x f(x) dx

此处的积分是离散情况下求和的自然延伸。它计算了所有可能取值 x x 与其微小邻域概率密度 f(x)dx f(x)dx 乘积的累加。

示例:均匀分布 (Uniform Distribution) 假设随机变量 X X 在区间 [a,b] [a, b] 上服从均匀分布。 其概率密度函数为: f(x)={1ba,if axb0,otherwise f(x) = \begin{cases} \frac{1}{b-a}, & \text{if } a \le x \le b \\ 0, & \text{otherwise} \end{cases} 根据公式,其数学期望为:

E(X)=abx1badx=1ba[12x2]ab=1bab2a22=(ba)(b+a)2(ba)=a+b2E(X) = \int_a^b x \cdot \frac{1}{b-a} dx = \frac{1}{b-a} \left[ \frac{1}{2}x^2 \right]_a^b = \frac{1}{b-a} \cdot \frac{b^2 - a^2}{2} = \frac{(b-a)(b+a)}{2(b-a)} = \frac{a+b}{2}

这个结果符合直觉:一个在区间上均匀分布的变量,其平均值就是该区间的中点。

3. 期望的性质 (Properties of Expectation)

期望具有非常重要的线性性质,这使得计算变得简单。设 X X Y Y 是两个随机变量,a,b,c a, b, c 是常数。

  • 常数的期望E(c)=c E(c) = c
  • 线性运算
  • E(aX)=aE(X) E(aX) = aE(X)
  • E(X+b)=E(X)+b E(X+b) = E(X) + b
  • 综合起来:E(aX+b)=aE(X)+b E(aX+b) = aE(X) + b
  • 期望的可加性E(X+Y)=E(X)+E(Y) E(X+Y) = E(X) + E(Y)
  • 这个性质极其强大,因为它对任何两个随机变量都成立,无论它们是否独立
  • 推广到多个变量:E(aX+bY)=aE(X)+bE(Y) E(aX + bY) = aE(X) + bE(Y)

二. 方差 (Variance)

方差,通常记为 Var(X) Var(X) D(X) D(X) σ2 \sigma^2 ,衡量的是随机变量 X X 的取值与其数学期望 E(X) E(X) 的偏离程度。方差越大,说明数据点越分散;方差越小,说明数据点越集中。

1. 方差的定义

方差被定义为随机变量与期望之差的平方的期望值。设 μ=E(X) \mu = E(X)

Var(X)=E[(Xμ)2]Var(X) = E \left[ (X - \mu)^2 \right]

这个定义有两个关键点:

  • (Xμ) (X-\mu) :计算每个值与均值的偏差。
  • 平方:将偏差平方,使得正负偏差不会相互抵消,并且对较大的偏差给予更高的“惩罚”。

2. 方差的计算公式

根据随机变量类型的不同,基于定义的计算公式如下:

  • 离散型随机变量
Var(X)=i(xiμ)2P(X=xi)Var(X) = \sum_{i} (x_i - \mu)^2 P(X=x_i)
  • 连续型随机变量
Var(X)=(xμ)2f(x)dxVar(X) = \int_{-\infty}^{\infty} (x - \mu)^2 f(x) dx

3. 一个更实用的计算公式

虽然定义式在理论上很重要,但在实际计算中,通常使用一个等价的计算公式,因为它往往能简化计算过程:

Var(X)=E(X2)[E(X)]2Var(X) = E(X^2) - [E(X)]^2

推导过程: 令 μ=E(X) \mu = E(X) Var(X)=E[(Xμ)2]=E[X22μX+μ2] Var(X) = E[(X-\mu)^2] = E[X^2 - 2\mu X + \mu^2] 根据期望的线性性质: =E(X2)E(2μX)+E(μ2) = E(X^2) - E(2\mu X) + E(\mu^2) 由于 μ \mu 2 2 都是常数: =E(X2)2μE(X)+μ2 = E(X^2) - 2\mu E(X) + \mu^2 μ=E(X) \mu = E(X) 代回: =E(X2)2[E(X)][E(X)]+[E(X)]2 = E(X^2) - 2[E(X)][E(X)] + [E(X)]^2 =E(X2)[E(X)]2 = E(X^2) - [E(X)]^2

这个公式的含义是“随机变量平方的期望减去期望的平方”。

示例:再次计算掷骰子的方差 我们已经知道 E(X)=3.5 E(X) = 3.5 。现在使用计算公式 Var(X)=E(X2)[E(X)]2 Var(X) = E(X^2) - [E(X)]^2 。 首先,计算 E(X2) E(X^2)

E(X2)=1216+2216+3216+4216+5216+6216E(X^2) = 1^2 \cdot \frac{1}{6} + 2^2 \cdot \frac{1}{6} + 3^2 \cdot \frac{1}{6} + 4^2 \cdot \frac{1}{6} + 5^2 \cdot \frac{1}{6} + 6^2 \cdot \frac{1}{6}
E(X2)=1+4+9+16+25+366=916E(X^2) = \frac{1+4+9+16+25+36}{6} = \frac{91}{6}

然后,计算方差:

Var(X)=E(X2)[E(X)]2=916(3.5)2=916(7/2)2=916494Var(X) = E(X^2) - [E(X)]^2 = \frac{91}{6} - (3.5)^2 = \frac{91}{6} - (7/2)^2 = \frac{91}{6} - \frac{49}{4}
Var(X)=18214712=35122.917Var(X) = \frac{182 - 147}{12} = \frac{35}{12} \approx 2.917

此方法通常比使用定义式逐项计算 (xiμ)2 (x_i - \mu)^2 更为快捷。

4. 方差的性质 (Properties of Variance)

X X Y Y 是两个随机变量,a,b,c a, b, c 是常数。

  • 非负性Var(X)0 Var(X) \ge 0 。方差永远不为负。
  • 常数的方差Var(c)=0 Var(c) = 0 。一个常数没有任何波动,因此方差为零。
  • 位移不变性Var(X+b)=Var(X) Var(X+b) = Var(X) 。将所有数据点平移一个常数,其离散程度不变。
  • 尺度变换Var(aX)=a2Var(X) Var(aX) = a^2 Var(X) 。将随机变量乘以一个常数 a a ,其方差会乘以 a2 a^2
  • 线性变换的通用公式Var(aX+b)=a2Var(X) Var(aX+b) = a^2Var(X)
  • 随机变量和的方差
  • 如果 X X Y Y 独立的随机变量,则:

Var(X+Y) = Var(X) + Var(Y)

  • 如果 X X Y Y 不独立,则公式更为复杂,需要引入协方差 (Covariance):Var(X+Y)=Var(X)+Var(Y)+2Cov(X,Y) Var(X+Y) = Var(X) + Var(Y) + 2Cov(X,Y) 。这是期望和方差性质的一个关键区别。

三. 标准差 (Standard Deviation)

尽管方差在数学上很方便,但它的单位是原始数据单位的平方(例如,如果 X X 的单位是米,则 Var(X) Var(X) 的单位是平方米),这使得其在直观解释上存在困难。为了解决这个问题,我们引入了标准差

标准差 (Standard Deviation),通常记为 σ(X) \sigma(X) σ \sigma ,被定义为方差的算术平方根:

σ(X)=Var(X)\sigma(X) = \sqrt{Var(X)}

标准差的单位与原始随机变量和其期望的单位相同,因此它提供了一个关于数据“平均偏离均值”多少的更直观的度量。例如,在掷骰子的例子中,标准差为 σ(X)=35/121.708 \sigma(X) = \sqrt{35/12} \approx 1.708

学习要点总结

特征数学期望 E(X) E(X) 方差 Var(X) Var(X)
含义随机变量的中心趋势、平均值随机变量的离散程度、波动大小
离散型计算xiP(X=xi) \sum x_i P(X=x_i) E(X2)[E(X)]2 E(X^2) - [E(X)]^2
连续型计算xf(x)dx \int x f(x) dx E(X2)[E(X)]2 E(X^2) - [E(X)]^2
线性变换 aX+b aX+b aE(X)+b aE(X)+b a2Var(X) a^2Var(X)
变量求和 X+Y X+Y E(X)+E(Y) E(X)+E(Y) (始终成立)Var(X)+Var(Y) Var(X)+Var(Y) (仅在 X,Y X,Y 独立时成立)

返回百科索引