隨機化回答
隨機化回答是進行問卷調查的一種特殊手法,可以一方面讓研究員搜集到公眾在敏感課題的情況或態度,而一方面個別受訪者可以保持私隱,是進行敏感課題研究時的一種折衷手法。 起源 隨機化回答最先由S.L. Warner在1965年提出,目的是為了解決進行社會研究時涉及敏感問題才帶來的困難。在問卷調查中涉及受訪者的犯罪行為、越軌行為或性行為等情況,若使用傳統的直接發問方式,例如「請問你有沒有試過盜竊?」,不難想像得到的結果會是絕大部份受訪者回答「沒有…
共 73 篇文章
隨機化回答是進行問卷調查的一種特殊手法,可以一方面讓研究員搜集到公眾在敏感課題的情況或態度,而一方面個別受訪者可以保持私隱,是進行敏感課題研究時的一種折衷手法。 起源 隨機化回答最先由S.L. Warner在1965年提出,目的是為了解決進行社會研究時涉及敏感問題才帶來的困難。在問卷調查中涉及受訪者的犯罪行為、越軌行為或性行為等情況,若使用傳統的直接發問方式,例如「請問你有沒有試過盜竊?」,不難想像得到的結果會是絕大部份受訪者回答「沒有…
统计语言学是数理语言学的一个分支,是运用统计学的方法研究各种语言现象的学科。 歷史 18世纪时,开始用统计学来解释语言的消失与保存。1880年代,青年语法学派中的一些学者也使用过统计方法来研究语言。自发明电子计算机以后,统计语言学得到了迅速发展。 研究方向 统计语言学主要研究: 语言单位的出现频率 作家的用词频率、词长分布和句长分布,以确定作家的写作风格 计算语言存在的绝对年代以及亲属语言从共同原始语分化出来的年代 參見 计量语言学 *
统计噪声(英语:statistical noise)是一个统计学概念,它是指随机变量观测值的變異相对于随机变量服从的真实分布的變異不可解释的部分,即这些观测值的未解釋變異(英语:unexplainable variation)。
Z-因子(Z-factor)是一个关于信号区间和变异的组合,它已成为评估测试方法质量的主要参数。Z-因子是统计效应大小的度量,它的提出是用来判断高通量筛选中测定的反应强度是否达到进一步研究的要求。 背景 Z-因子于1999年首次发表以来,已被視為一个非常有用的评估试验的统计学方法。在高通量筛选中,一次会将数十万至数千万样品与阴性和阳性对照样品一起进行筛选,并对它们的结果进行比较。因为这种大通量的筛选耗时且昂贵,所以要使用较小规模的筛选(…
统计量 或 抽样统计量 是样本测量的一种属性(例如,计算样本算术平均值)。 它计算的通过对数据集进行某种函数(统计算法)的运算后得到的值。 统计学定义一个统计量为一个总体参数的点估计量。统计量的函数本身可以用于计算全体数据,而统计量则将抽取的样本作用于这一函数。 统计量不同于统计参数。统计参数通常由于数量过大而不便于统计计算。而统计量仅仅统计抽出来的样本。统计量可以用于对统计参数进行估计。 例子 例如,在计算样本的算术平均值时,算法会先…
在贝叶斯统计学中,「最大后验概率估计」是后验概率分布的众数。利用最大后验概率估计可以获得对实验数据中无法直接观察到的量的点估计。它与最大似然估计中的经典方法有密切关系,但是它使用了一个增广的优化目标,进一步考虑了被估计量的先验概率分布。所以最大后验概率估计可以看作是的最大似然估计。 假设我们需要根据观察数据 x 估计没有观察到的总体参数 \theta,让 f 作为 x 的采样分布,这样 f(x|\theta) 就是总体参数为 \thet…
利特尔伍德定律(Littlewood's law),指的是一个人大致一个月就会有一次见到所谓的“奇迹”。 提出 该定律由英国剑桥大学教授约翰·伊登斯尔·利特尔伍德提出,发表在他1986年出版的作品集《一个数学家的杂集》里。他提出这个定律的目的是破除人们对超自然现象的迷思。这个定律和巨数定律相关。巨数定律认为,只要样本数量足够大,不管多么难以想象的事情都会发生。需要指出这两个定律都不是经过严格证明的统计学定律。 定律内容 利特尔伍德定义“…
趨勢主要是指時間軸上的某個可見動向,在統計學上,趨勢具有時間性,是資訊變動的一個橫面觀察。在科技分析上面,趨勢經常使用在財經走向的觀測中。英語以Trend代表趨勢,但亦有潮流之意,中文的趨勢一詞,可能源自於「趨炎附勢」這個成語。在宋史《李垂傳》中,原意為「趨炎附熱」。後人將熱改為權勢的勢。現代在專業的分析術語中,趨勢是有走向的,例如上升的趨勢是由一組不斷往上的波頂和波底所組成。此外,圖表與趨勢的分析是息息相關的。許多的趨勢都是透過圖表來…
图极限(graphon),或称图极限函数(graphon function),是用统计网络分析中,用以描述一类具有顶点可交换性结构的图之结构的二元函数。概念上,图极限函数可以被理解为一个内在结构恒定的随机图,在顶点数趋于无穷时所收敛到的极限(假定其顶点已按恰当的次序排列)。 图极限函数为描述随机图的结构和渐近性质提供了基础工具,对图极限的估计和统计推断,是近年来统计网络分析的前沿课题之一。 定义 在文献中,图极限函数的定义,通常必须和顶…
国际统计学是利用统计數字比較不國家的情況的學科。而為使不同國家的统计數字可以互相比較及分析,國際間在編制统计數字時都會盡力遵守各國際組織定立的統計準則。 最基本的準則是國際貨幣基金組織定立的發布數據特別準則(Special Data Dissemination Standard)或一般數據發布系統(General Data Dissemination System),該些準則定明有關统计數字的範圍、周期性、及時性、誠信性、素質及數據開放…
极值理论是处理与概率分布的中值相离极大的情况的理论,常用来分析概率罕见的情况,如百年一遇的地震、洪水等,在风险管理和可靠性研究中时常用到。极值理论最早由提出Gambul分布的Emil Julius Gambul阐述。极值理论和很多广泛应用的分布如正态分布、威布尔分布相联系。
醫學統計學 (有時以生物測定學著名, 雖然生物測定學的新發展是涉及另外一個領域)一般來說是統計對生物學和醫學的應用。由於在生物和醫學研究問題是各種各樣的, 生物統計學擴展它的領域包括任何定量,不僅統計,也許其他模型。對臨床試驗的設計和分析就是醫學統計學在醫學裡最明顯的應用。 大部分的醫學統計學課程都是給大學學士畢業生的。在公共衛生學校、醫學院、林業或農業或應用統計的學院是常見的課程,甚至某些美國的大學會為醫學統計學設立獨立學院。 醫學統…
線性預估,對於某一時間點的數值,可利用若干個前面時間點的數值,以線性組合的方式來預估。在數位信號處理中,線性預估又常被稱為線性預估編碼。 預估模型 最常見的表示法為 :\widehat{x}(n) = \sum_{i=1}^p a_i x(n-i)\, 其中 \widehat{x}(n) 是在時間點 n 所預估出來的數值,而 x(n-i) 是在時間點 n-i 的數值,對於每個 x(n-i) 都有一個對應的預估係數 a_i,預估模型的階數…