指数分布

{{機率分佈
|name =指數分配
|type =密度
|pdf_image =
|cdf_image =|
parameters =\lambda > 0 \, 率
|support =x \in [0;\infty)\!
|pdf =\,\lambda e^{-\lambda x}
|cdf =1 - e^{-\lambda x}
|mean =\lambda^{-1}\,
|median =\ln(2)/\lambda\,
|mode =0\,
|variance =\lambda^{-2}\,
|skewness =2\,
|kurtosis =6\,
|entropy =1 - \ln(\lambda)\,
|mgf =\left(1 - \frac{t}{\lambda}\right)^{-1}\,
|char =\left(1 - \frac{it}{\lambda}\right)^{-1}\,
}}

在機率論和統計學中,指數分布()是一種連續機率分佈。指數分布可用于建模平均发生率恒定且连续、独立事件的发生间隔,例如旅客進入機場的時間間隔、電話打進客服中心的時間間隔、中文維基百科新條目出現的時間間隔、機器的壽命等。

記號
指數分布即形狀母數 \alpha 為1的伽瑪分布。

若隨機變數X服从母數為\lambda或\beta的指数分布,則記作

X\sim \text{Exp}(\lambda )
或 X\sim \text{Exp}(\beta )

兩者意義相同,只是\lambda 與\beta 互為倒數關係。只要將以下式子做{\color{Red}\lambda =\frac{1}{\beta}}的替換即可,即,指數分布之機率密度函數為:

:
f(x;{\color{Red}\lambda}) = \left\{\begin{matrix}
{\color{Red}\lambda} e^{-{\color{Red}\lambda} x} & x \ge 0, \\
0 &,\; x

:
f(x;{\color{Red}\beta}) = \left\{\begin{matrix}
{\color{Red}\frac{1}{\beta}} e^{-{\color{Red}\frac{1}{\beta}} x} & x \ge 0, \\
0 &,\; x

累积分布函数為:
:
F(x;{\color{Red}\lambda}) = \left\{\begin{matrix}
1-e^{-\color{Red}{\lambda} x}&,\; x \ge 0, \\
0 &,\; x

:
F(x;{\color{Red}\beta}) = \left\{\begin{matrix}
1-e^{-{\color{Red}\frac{1}{\beta}} x}&,\; x \ge 0, \\
0 &,\; x

其中\lambda>0是分布的母數,即每单位时间发生该事件的次数;\beta為比例母數,即該事件在每單位時間內的發生率。兩者常被称为率参数(rate parameter)。指数分布的区间是[0,∞)。

特性
期望值与變異數
随机变量 X(X 的母數為 \lambda 或 \beta )的期望值是:

:\mathbf{E}(X) = \frac{1}{\color{Red}{\lambda}}={\color{Red}\beta}

例如:如果你平均每个小时接到2次电话,那么你预期等待每一次电话的时间是半个小时。

X 的方差是:

:\mathbf{Var}(X) = \frac{1}{\color{Red}{\lambda^2}}={\color{Red}\beta^2}

X 的偏態系数是:
\mathbf{V}[X]=1

无记忆性
指数函数的一个重要特征是无记忆性(Memoryless Property,又稱遺失記憶性)。这表示如果一个随机变量呈指数分布,它的条件概率遵循:

:P(T > s + t\; |\; T > t) = P(T > s) \;\; \hbox{for all}\ s, t \ge 0.
与泊松过程的关系
泊松過程是一种重要的随机过程。泊松過程中,第 k 次随机事件与第 k+1 次随机事件出现的时间间隔服从指数分布。而根据泊松過程的定义,长度为 t 的时间段内没有随机事件出现的概率等于
:\frac{e^{-\lambda t} (\lambda t)^0}{0!} = e^{-\lambda t},
长度为 t 的时间段内随机事件发生一次的概率等于
\frac{e^{-\lambda t} (\lambda t)^1}{1!}=e^{-\lambda t} \lambda t,
所以第 k 次随机事件之后长度为 t 的时间段内,第 k+n 次(n=1, 2, 3,\cdots)随机事件出现的概率等于1-e^{-\lambda t}。这是指数分布。这还表明了泊松过程的无记忆性。

四分位数
率参数 \lambda 的四分位数函数(Quartile function)是:

:F^{-1}(p;\lambda) = \frac{-\ln(1-p)}{\lambda},\qquad 0 \le p

  • 第一四分位数:\frac{\ln(\frac{4}{3})}{\lambda}
  • 中位数:\frac{\ln(2)}{\lambda}
  • 第三四分位数:\frac{\ln(4)}{\lambda}

因此,四分位距為\frac{\ln(3)}{\lambda}。

参数估计
最大概似法
给定独立同分布样本 x =x_1, \cdots, x_n,\lambda 的似然函数(Likelihood function)是:

: L(\lambda) = \prod_{i=1}^n \lambda \, \exp(-\lambda x_i) = \lambda^n \, \exp\!\left(\!-\lambda \sum_{i=1}^n x_i\right)=\lambda^n\exp\left(-\lambda n \overline{x}\right)

其中:
:\overline{x}={1 \over n}\sum_{i=1}^n x_i是样本期望値。

似然函数对数的导数是:

:\frac{\mathrm{d}}{\mathrm{d}\lambda} \ln L(\lambda) = \frac{\mathrm{d}}{\mathrm{d}\lambda} \left( n \ln(\lambda) - \lambda n\overline{x} \right) = {n \over \lambda}-n\overline{x}\ \left\{\begin{matrix} > 0 & \mbox{if}\ 0 \frac{1}{\overline{x}}. \end{matrix}\right.

参数 \lambda 的最大概似估計(Maximum likelihood)值是:
:\widehat{\lambda} = \frac1{\overline{x}}

參見
*拉普拉斯分布(又稱:雙指數分布)
*幾何分布

参考文獻

Donald E. Knuth (1998). The Art of Computer Programming, volume 2: Seminumerical Algorithms, 3rd edn. Boston: Addison-Wesley. ISBN 0-201-89684-2. pp. 133

Luc Devroye (1986). Non-Uniform Random Variate Generation. New York: Springer-Verlag. ISBN 0-387-96305-7. pp. 392–401

外部連結

评论 (0)

  • 还没有评论,来抢沙发吧。