平均数
平均数(,或稱平均值)是统计中的一个重要概念。为集中趋势的最常用测度值,目的是确定一组数据的均衡点。 概述 在统计中算术平均数常用于表示统计对象的一般水平,它是描述数据集中程度的一个统计量。我们既可以用它来反映一组数据的一般情况,也可以用它进行不同组数据的比较,以看出组与组之间的差别。用平均数表示一组数据的情况,有直观、简明的特点,所以在日常生活中经常用到,如平均的速度、平均的身高、平均的产量、平均的成绩、平均的氣溫等。 不適用的狀況 …
共 73 篇文章
平均数(,或稱平均值)是统计中的一个重要概念。为集中趋势的最常用测度值,目的是确定一组数据的均衡点。 概述 在统计中算术平均数常用于表示统计对象的一般水平,它是描述数据集中程度的一个统计量。我们既可以用它来反映一组数据的一般情况,也可以用它进行不同组数据的比较,以看出组与组之间的差别。用平均数表示一组数据的情况,有直观、简明的特点,所以在日常生活中经常用到,如平均的速度、平均的身高、平均的产量、平均的成绩、平均的氣溫等。 不適用的狀況 …
环比及同比為統計名詞,用于描述统计数据的变化情况。在台灣,環比及同比一詞雖然較少使用,但亦有在政府統計機關公開使用的情況。環比通常使用「與前期相比」或直接以「季增/減」、「月增/減」表示;同比通常使用「與去年同期相比」或「年增/減」、「月/季營收YoY」等表示法。 定義 环比表示本次统计段与相连的上次统计段之间的比较。比如2010年中国第一季度GDP为G10-1亿元,第二季度GDP为G10-2亿元,则第二季度GDP环比增长(G10-2-…
推計人口是以日本國勢調查(人口普查)為基础,以每月的人口出生、死亡、遷入、遷出作加減而計算出來的人口推計值,其數值包括了外国人。 由於是基於国勢調查人口(面向實際居住者的全数調查)的數值,推計人口也稱為「常住人口」或「現住人口」,被認為能夠可靠地反映總人口。然而這也有例外情況。 因三宅島火山噴發,2000年(平成12年)9月2日全島避難的三宅村於10月1日国勢調查中為「人口0人」,於是只能以0人為基準,每月計算推計人口;又如,伴隨東北地…
在统计学中,最大似然估计(,簡作MLE),也称极大似然估计,是用来估計一个概率模型的参数的一种方法。 预备知识 下方的讨论要求读者熟悉概率论中的基本定义,如概率分布、概率密度函数、随机变量、数学期望等。读者還須先熟悉连续实函数的基本性质,比如使用微分来求一个函数的极值(即极大值或极小值)。 同時,讀者須先擁有似然函數的背景知識,以了解最大似然估計的出發點及應用目的。 最大似然估计的原理 给定一个概率分布D,已知其概率密度函数(连续分布)…
在统计学中,样本的第k顺序统计量()即它从小到大排列时的第k个值,常用于非参数估计与推断中。常见的顺序统计量包括样本的最大值、最小值、中位数等。 记号 任给样本x_1, x_2, \cdots, x_n,将其从小到大排成一列,记为:x_{(1)}, x_{(2)}, \cdots, x_{(n)}.则其第一顺序统计量(即最小值)为x_{(1)},第n顺序统计量(即最大值)为x_{(n)}。 概率 随机变量X_{(k)}的累积分布函数F_…
隊列研究()又译世代研究、小组研究()、群组研究、定群研究、追蹤研究、梯次研究等,是在医学、社会科学、精算学、生态学等领域中使用的一种縱向研究()。它是对风险因子的分析手段,通过对某一特定患病或未患疾病的人群在一定时间内的观察,根据相关性来确定被观察对象疾病變化或患病的風險。它是一种临床研究设计,应与()相互参照。队列研究的对象大多是有特定生活经历的人群及其中的个人。 群體(或)或群组、队列、世代,是指一群在特定时期内有“共同特征或经历…
长尾(),或译长尾效应,最初由《連線》的總編輯克里斯·安德森()於2004年發表於自家的雜誌中,用来描述诸如亞馬遜公司、Netflix和Real.com/Rhapsody之类的网站之商业和经济模式。是指那些原来不受到重视的销量小但种类多的产品或服务由于总量巨大,累积起来的总收益超过主流产品的现象。在互联网领域,长尾效应尤为显著。长尾这一术语也在统计学中被使用,通常应用在财产的分布和词汇。 簡介 帕雷托法則向來被商業界視為鐵律,其內涵認為…
费雪变换()是统计学中用于相关系数假设检验的一种方法。对样本相关系数进行费雪变换后,可以用来检验关于总体相关系数ρ的假设。 定义 已知组双变量样本,样本相关系数为 :r = \frac{\sum ^N _{i=1}(X_i - \bar{X})(Y_i - \bar{Y})}{\sqrt{\sum ^N _{i=1}(X_i - \bar{X})^2} \sqrt{\sum ^N _{i=1}(Y_i - \bar{Y})^2}} 于是…
在机器学习和统计学中,特征选择()也被称为变量选择、属性选择 或变量子集选择 。它是指:为了构建模型而选择相关特征(即属性、指标)子集的过程。使用特征选择技术有三个原因: : :简化模型,使之更易于被研究人员或用户理解, :缩短训练时间, :改善通用性、降低过拟合(即降低方差 ) 要使用特征选择技术的关键假设是:训练数据包含许多冗余 或无关 的特征,因而移除这些特征并不会导致丢失信息。 冗余 或无关 特征是两个不同的概念。如果一个特征本…
正規化均方根誤差(,縮寫為NRMSE)是將均方根誤差正規化後所得的統計數值。正規化均方根誤差經常被被使用於量測兩個信號,如圖像、影片,及聲音訊號等之間的相似度。 定義 在影像處理中,給定兩個單色影像 x[m,n] 和y[m,n] ,那麼它們的正規化均方根誤差可定義如下: : \mathrm{NRMSE} = \sqrt{\frac{\sum^{M-1}_{m=0}\sum^{N-1}_{n=0}^{2}}{\sum^{M-1}_{m=0…
幽灵数据(), 是指从数据科学、统计学角度处理我们一般看不见的数据,量子成像或,“暗物质”或“暗能量”及其在计算机视觉领域中的新发现,甚至还包括与文物资料、经历等相关的认知数据。 在量子场论的术语中,(ghost)、幽灵场(ghost field)或规范幽灵(gauge ghost)是规范场论中的非物理状态。在局部场超过多个物理自由度的情况下,必须使幽灵保持理论的不变性。在数据科学、统计学、计算机等术语中,幽灵数据包括为数字幽灵(dig…
,左侧是少数占据主导地位的事物(也称为 80/20法则 )。]] 在统计学中, 冪定律或称幂法则()是两个量之间的一种函数关系 ,其中一个量的相对变化会导致另一个量的相对变化,且该变化与该变化的幂次方成正比:一个量随另一个量的变化呈幂律关系。这种变化与这两个量的初始大小无关。 冪定律是一種多項式關係。遵守這關係的多項式,會展現出的性質。最普通的,表達兩個變量之間關係的冪定律,其形式為 :f(x) = ax^k +o(x^k)\,\!; …
最佳线性无偏预测(best linear unbiased prediction, 简称BLUP),又音译为“布拉普”,是统计学上用于线性对随机效应进行预测的一种方法。最佳线性无偏预测由提出。随机效应的最佳线性无偏预测(BLUP)等同于固定效应的最佳线性无偏估计(best linear unbiased estimates, BLUE)(参见高斯-马尔可夫定理)。因为对固定效应使用估计一词,而对随机效应使用预测,这两个术语基本是等同的。…
在统计学里,离散程度(,scatter,spread)或离散度,又稱统计变异性(statistical variability),简称 變異、變差(variation)、变率,是指一个分布或随机变量的拉伸或压缩程度。{{clarify|习惯上,“离散”常用来描述数据分布,而“變異”(指:變異-{}-數、方-{}-差)更常用来描述随机变量的变异程度。}}用以描述离散程度或變異的量主要有方差、標準差、變異系数和四分位距等。 离散程度与集中趋…
樣本()是统计学术语,指从全体中随机抽取的个体。通过对样本的调查,可以大概的了解全体的情况。抽樣时抽取样本来进行调查,而普查时则需要调查每一个个体。樣本統計學是罗纳德·费希尔;}-博士提出的。 樣本統計學並不是將整個母體拿去調查,所以必有誤差。 樣本統計學的內容有統計結果、可信度和誤差,不同的統計公司會統計出不同的統計內容。 樣本的規定 樣本,從母體抽樣時,應符合下列條件,才可表現出資料母體的型態: #母體的分佈需很平均,在抽樣時才不會…
示意地圖(),又稱比較統計地圖,是將地圖根據統計數據變形的得到示意圖,通常是將各個地理單位的面積擴大或縮小,來表示有關數據的數值。 示意地圖的用途在於視覺上展示統計數據,在盡可能保持各數據點之間的相對位置之時,亦透過數據點的實際面積來標示其數值,使讀者不會因為地理因素影響以產生錯覺。舉個例子:2004年美國總統選舉的投票分佈圖,若以傳統的地理圖表顯示,會看到小布殊得到壓倒性的支持。不過,一旦用示意地圖把同一組數據重組,就會發現原來因為大…
在精算學中,生命表(也稱死亡率表或精算表)是一個表。其中顯示一個人在每一個年齡,他在下一個生日前死亡的概率。運用這個概率和統計學算式,可得出多項統計數據,而這些數據也會列入生命表中。這些數據包括: 一個人在每一個年齡,他在下一個生日時生存的概率 人們在不同的年齡的預期壽命 原有出生的一群人仍然活著的比例 估計原有出生的一群人的長壽性 保險中的應用 為了就保險產品定價,並確保保險公司保留充足的儲備以維持償付能力,精算師必須預測今後的投保事…
,或稱白噪音,是一種功率譜密度為常數的隨機信號或随机过程。即此信號在各個频段上的功率一致。由于白光是由各種頻率(颜色)的单色光混合而成,因而此信号的平坦功率谱性质稱為“白色”,此信号也因此得名為白噪声。相对的,其他不具有这一性质的噪声信号則称为有色噪声。 理想的白噪声具有無限頻寬,因而其能量是無限大,這在现实世界是不可能存在的。实际上,人常常將有限頻寬的平整訊號視為白噪声,以方便进行數學分析。 常见的白噪声例子包括电风扇的声音、电视机无…
描述統計(descriptive statistics),是统计学中,來描绘或总结观察量的基本情况的統計总称。其与統計推論相对应。 内容 研究者可以透過對數據資料的图像化处理,將資料摘要变為圖表,以直观了解整體資料分布的情況。通常會使用的工具是频数分布表與圖示法,如折线圖、直方圖、饼图、散点圖等。 研究者也可以透過分析數據資料,以了解各變量內的观察值集中與分散的情況。運用的工具有:,如平均數、中位數、眾數、幾何平均數、調和平均數。與,如…
個體()是单个的人、其他生物或或其他不可分的实体,有不可分的整体、总体或单一体的意思。個體相對於群體、集體。 在生物學中,每一隻動物、一株植物、甚至一個能以單細胞生存的生命形式都可稱為“單一個體”。 在哲學或社會學中,個體一般指“一個人”或是“一個群體中的特定主體”,指人時也稱個人。個體性(,)又稱個性,則是指能夠成為一個個體的特性或是狀態。 從15世紀或更早(以及今天在統計學和形而上學領域)開始,個體的意思是“不可分割的”;而在統計學…