司徒頓t分布
{{機率分佈 |name = 学生t 分布 |type = 密度 |pdf_image = |cdf_image = |parameters =\nu > 0\!自由度 |support = x \in (-\infty; +\infty)\! |pdf = \frac{\Gamma((\nu+1)/2)} {\sqrt{\nu\pi}\,\Gamma(\nu/2)\,(1+x^2/\nu)^{(\nu+1)/2}}\! |cdf =\…
共 19 篇文章
{{機率分佈 |name = 学生t 分布 |type = 密度 |pdf_image = |cdf_image = |parameters =\nu > 0\!自由度 |support = x \in (-\infty; +\infty)\! |pdf = \frac{\Gamma((\nu+1)/2)} {\sqrt{\nu\pi}\,\Gamma(\nu/2)\,(1+x^2/\nu)^{(\nu+1)/2}}\! |cdf =\…
的歷史資料中,溫度的變化(紅色)會領先二氧化碳(藍色)的排放,到近期兩者才一起變化]] 領先落後效果(lead–lag effect)是統計學和時間序列分析上的現象,指一個領先變數和其他較晚出現的變數之間的互相关性,常見於經濟學。 在自然及氣候中,較大的系統常常會有領先落後效果。根據NASA資料,北冰洋的冰在九月17日最少,是在北半球日照時間尖峰日的三個月後。 经济学家也發現,一些大資本組合的股票和小資本組合的股票股價之間也有領先落後效…
缺失数据(或missing values)指在统计调查的过程中,由于受访者对问题的遗漏、拒绝,或是调查员与调查问卷本身的一些疏忽,使得经常会出现缺失数据问题。此外,经济学、社会学和政治学研究中,政府或私人机构可能选择不报告或无法报告关键的统计数据,也会导致缺失数据。数据收集不当或录入错误等研究者自身的原因也会造成缺失值。几乎所有标准统计方法都假设每个单独个案有可用于分析的所有变量信息,因此缺失数据就成为统计研究或问卷调查的工作人员必须解…
自我迴歸模型(,簡稱AR模型),是統計上一種處理時間序列的方法,用同一變數例如x的之前各期,亦即x_{1}至x_{t-1}來預測本期x_{t}的表現,並假設它們為一線性關係。因為這是從迴歸分析中的線性迴歸發展而來,只是不用x預測y,而是用x預測x(自己);因此叫做自我迴歸。它可用於描述來自多種自然和人工來源的時變過程。該模型指定了輸出變量,這些變量在隨機基礎上線性依賴其自身的先前值。此模型採隨機差分方程(或遞推關係)的形式,切勿將其與微…
在测量学或测绘学中,测量精度(accuracy and precision of measurement)简称“精度”,包括了准确度(accuracy)和精密度(precision,或译精确度)两种含义;广义上,尚包括了正确度(trueness,或译真实度)及公差(tolerance)等蕴意。 准确度(accuracy)定义为:某一物理量的观测、计算、估计值或测量值与其真实值的一致程度或接近程度。 精密度(precision)定义为:在…
變異數分析(,簡稱:ANOVA)為資料分析中常見的統計模型,主要為探討連續型(Continuous)資料型態之因变量與類別型資料型態之自变量的關係,當自變項的因子中包含等於或超過三個類別情況下,檢定其各類別間平均數是否相等的統計模式,廣義上可將T檢定中變異數相等(Equality of variance)的合併T檢定(Pooled T-test)視為是變異數分析的一種,基於T檢定為分析兩組平均數是否相等,並且採用相同的計算概念,而實際上…
在统计学中,给定数据的百分位排名或称百分位等級(,PR)是其次數分布中,小于该数值的数据的百分比。其数学公式为 : PR = \frac{CF - (0.5 \times F)}{N} \times 100, 其中CF,即,是小于或等于感兴趣数值的所有数据的计数,F是感兴趣数值的次數,N是分布中分数的数量。或者,如果CF'是小于感兴趣分数的所有数值的计数,则 : PR = \frac{CF' + (0.5 \times F)}{N} \…
殘差平方和(,縮寫:RSS)在統計學上是指將所有做預測時的誤差值平方加起來得出的數: :RSS=\sum_{i=1}^n e_i^2 \, 它是衡量数据与估计模型之间差异的尺度。较小的残差平方和表示模型能良好地拟合数据。在确定参数和选择模型时,残差平方和是一种最优性准则。通常,总的方差=已经被模型解释了的平方和+残差平方和。 殘差平方和這個數值在機器學習上是普通最小二乘法等演算法的重心。 与皮尔逊相关系数的关系 对于两变量x和y, 它们…
在回归分析当中,最常用的估计\beta(回归系数)的方法是普通最小二乘法(,簡稱OLS),它基於誤差值之上。用這種方法估计\beta,首先要計算残差平方和(;RSS),RSS是指将所有误差值的平方加起來得出的数: RSS=\sum_{i=1}^n e_i^2 \, \beta_0與\beta_1的数值可以用以下算式计算出來: \widehat{\beta}_1=\frac{\sum(x_i-\bar{x})(y_i-\bar{y})}{…
百分位数()是统計學術语,若将一组数据从小到大排序,并计算相应的累计百分点,则某百分点所对应数据的值,就称为这百分点的百分位数,以P_k表示第k百分位數。 百分位数是用来比较个体在群体中的相对地位量数()。 一个数值的百分等级(),也称PR值,是其在同一概率分布中超过其他数值的百分比。在教育統計學中,百分等级可用來表現測驗成績。 求法 若一群資料的個數為 N,且由小到大排列,設 N\times k \% =a 若 a\in \mathb…
任意抽样是的一種,以容易取得的資料作為抽樣的樣本。由於代表性不足,在科學上以任意抽样為基礎的研究無法提供有關母體的資訊。 例如有人在某天早上在某一家店門口提供問卷請大家填寫,可以接觸到的人會受限在那個時間出現在那一家店的人,無法代表那附近人們的觀點,若問卷是一週幾天,每天幾個時段請大家填寫,會比較有代表性。 官方統計機構不建議用任意抽样作為研究依據,因為可能會有抽樣誤差,也無法代表母體的資訊。不過有些情形下,只能用任意抽样來進行抽樣。這…
分位圖()又稱QQ圖(Q-Q plot,Q代表分位数),在统计学中是-{zh-hans:通过;zh-tw:經由}-比较两个概率分布的分位数,來比較这两个概率分布的概率图方法。首先选定分位数的对应概率区间集合,在此概率区间上,点(x,y)对应于第一个分布的一个分位数x和第二个分布在和x相同概率区间上相同的分位数。因此画出的是一条含参数的曲线,参数为概率区间的分割数。 如果被比较的两个分布比较相似,则其分位圖近似地位于y = x上。如果两个…
曲線擬合(),簡稱擬合,俗稱拉曲線,是一種構建一個函数曲線,使之最佳地吻合現有的過程,該過程可能附加若干條件限制。通俗地說,科学和工程问题通过诸如采样、实验等方法获得了若干离散的数据点。根据这些数据,我们往往希望得到一个连续的函数(也就是曲线)或者更加密集的离散方程与已知数据相吻合,该过程就叫做“拟合”,而得到的曲线方程就称为“拟合函数”。曲线拟合又译为:曲線配適、曲線貼合、曲線適插法,均有助理解其选择曲线方程(解析函数)来“模拟吻合”…
向量自我迴歸模型(,简称VAR模型)是一种常用的计量经济模型,由计量经济学家和宏观经济学家克里斯托弗·西姆斯()提出。它擴充了只能使用一個變量的自我迴歸模型(簡稱:AR模型),使容納大於1個變量,因此經常用在多變量時間序列模型的分析上。 定义 VAR模型描述在同一样本期间内的n个变量(内生变量)可以作为它们过去值的线性函数。 一个VAR(p)模型可以写成为: :y_{t}=c + A_{1}y_{t-1} + A_{2}y_{t-2} …
ARMA模型(,全稱:自我迴歸滑動平均模型)。是研究时间序列的重要方法,由自迴歸模型(简称AR模型)与移动平均模型(简称MA模型)为基础“混合”构成。在市场研究中常用于长期追踪资料的研究,如:Panel研究中,用于消费行为模式变迁研究;在零售研究中,用于具有季节变动特征的销售量、市场规模的预测等。 自我迴歸AR(p)模型 : X_t = c + \sum_{i=1}^p \varphi_i X_{t-i}+ \varepsilon_t …
-{zh-tw:偽發現率;zh-cn:假发现率;}-(False discovery rate, FDR)完善了对多重假设测试的检验, \mathrm{FDR} = Q_e = \mathrm{E}\!\left [Q \right ], 其中E表示期望,Q = V/R = V/(V+S),V表示错误拒绝零假设的数目,R表示拒绝零假设的数目。R取0时FDR直接取0,写成一句话就是 \mathrm{FDR} = \mathrm{E}\!\…
強抽樣與弱抽樣(英語:Strong and weak sampling)是统计学中的两种抽样方法,在计算认知科学中很受欢迎。在强抽样中,假设数据是作为一个概念的正例有意生成的,而在弱抽样中,假设数据的生成没有任何限制。 正式定義 在强抽样中,我们假设观察结果是从真實假说中随机抽样的。 P(x|h) = \begin{cases} \frac{1} \text{, if } x \in h \\ 0 \text{, otherwise} …
在时间序列分析中,移动平均模型(简记为:MA模型)是一个常见的对单一变量时间序列进行建模的方法。 移动平均模型和自回归模型都是时间序列中 ARMA模型 和 ARIMA模型 模型的重要组成部分,也是一种特殊情况。尽管名称类似,但移动平均模型不应与移动平均值相混淆。与自回归模型不同,移动平均模型总是平稳的。 定义 q 阶移动平均模型通常简记为MA(q): : x_t=\mu+\varepsilon_t-\theta_1\varepsilon…
個人之間分數的差異,主要是來自答對題數的不同,而不是每一個題目本身所佔的分數比例差異。這種分數計算方式,比較不會因為不同科目的難度或題型差異,而影響到各科成績總和的差異。 使用量尺分數評分的考試 某些升學考試,例如:基本學力測驗、全民英語能力分級檢定測驗、TOEIC、托福與GRE 某些智力測驗 某些心理測驗 外部連結 [https://web.archive.org/web/20060713232913/http://www.irt.o…