拉普拉斯分布

{{Infobox 機率分佈 |
name =拉普拉斯分布|
type =密度|
pdf_image =|
cdf_image =|
parameters =\mu\, 位置参数(实数)
b > 0\, 尺度参数(实数)|
support =x \in (-\infty; +\infty)\,|
pdf =\frac{1}{2\,b} \exp \left(-\fracb \right) \,|
cdf =参见正文部分|
mean =\mu\,|
median =\mu\,|
mode =\mu\,|
variance =2\,b^2|
skewness =0\,|
kurtosis =3\,|
entropy =1 + \ln(2\,b)|
mgf =\frac{\exp(\mu\,t)}{1-b^2\,t^2}\,\! for |t||
char =\frac{\exp(\mu\,i\,t)}{1+b^2\,t^2}\,\!|
}}
在概率论与统计学中,拉普拉斯分布 (Laplace distribution) 是以皮埃尔-西蒙·拉普拉斯的名字命名的一种连续概率分布。由于它可看作两平移指数分布背靠背拼接在一起,因此又稱双指数分布 (Double exponential distribution)。两个相互独立同概率分布指数随机变量之间的差别是按照指数分布的随机时间布朗运动,所以它遵循拉普拉斯分布。

概率分布、概率密度以及分位数函数
如果随机变量的概率密度函数分布为

:f(x|\mu,b) = \frac{1}{2b} \exp \left( -\frac{b} \right) \,\!
:: = \frac{1}{2b}
\left\{\begin{matrix}
\exp \left( -\frac{\mu-x}{b} \right) & \mbox{if }x

那么它就是拉普拉斯分布。其中,\mu 是位置参数,b>0 是尺度参数。如果 \mu=0,b=1, 那么,正半部分恰好是 \frac{1}{2}倍 \lambda=1 的指数分布。

拉普拉斯分布的概率密度函数让我们联想到正态分布,但是,正态分布是用相对于 \mu 平均值的差的平方来表示,而拉普拉斯概率密度用相对于平均值的差的绝对值来表示。因此,拉普拉斯分布的尾部比正态分布更加平坦。

根据绝对值函数,如果将一个拉普拉斯分布分成两个对称的情形,那么很容易对拉普拉斯分布进行积分。它的累积分布函数为:
{b}))]
|}
逆累积分布函数为

:F^{-1}(p) = \mu - b\,\sgn(p-0.5)\,\ln(1 - 2|p-0.5|)

生成拉普拉斯变量
已知区间 (-\frac{1}{2},\frac{1}{2}] 中均匀分布上的随机变量 U,随机变量
:X=\mu - b\,\sgn(U)\,\ln(1 - 2|U|)

为参数 \mu 与 b 的拉普拉斯分布。根据上面的逆累计分布函数可以得到这样的结果。

当两个相互独立同分布指数(\frac{1}{b})变化的时候也可以得到 \operatorname{Laplace}(0, b) 变量。同样,当两个相互独立同分布一致变量的比值变化的时候也可以得到 \operatorname{Laplace}(0, 1) 变量。

相关分布

  • 如果 Y = |X-\mu| 并且 X \sim \mathrm{Laplace},则 Y \sim \mathrm{Exponential} 是指数分布。
  • 如果 Y = X_1 - X_2 与 X_1,\, X_2 \sim \mathrm{Exponential},则 Y \sim \mathrm{Laplace}。

统计推断
参数估计
给定N个独立同分布的样本x_1,x_2,...,x_N,\mu的极大似然估计\hat{\mu}为样本的中位数,b的极大似然估计\hat{b}为样本与样本中位数\hat{\mu}的平均绝对偏差,即

\hat{b}=\frac{1}{N}\sum_{i=1}^{N}\left\vert x_i-\hat{\mu} \right\vert

(揭示了拉普拉斯分布和最小绝对偏差(LAD)之间的联系)。

在回归分析中,如果误差具有拉普拉斯分布,则最小绝对偏差估计(LADE)将作为最大似然估计(MLE)出现。

评论 (0)

  • 还没有评论,来抢沙发吧。