效度()又稱有效度,是研究方法中關於測量方法能否如實反映所欲測量對象的能力,即测量值与实际值相符合的程度。一項效度高的衡量較一項效度低的衡量更為準確。
譬如以一個國家的國會是否定期經人民於公平公開的競爭性普選產生;政府領袖是否經人民直接選舉或由人民直選產生的國會間接選舉產生;國會內的有效政黨數目;言論自由、新聞自由、出版自由、集會自由、結社自由等人權是否受保障等指標來衡量一個國家是否自由民主就比一個國家是否有憲法、是否存在投票制度、有多少位國會議員等來得更精確。
在心理测量学中,效度具有特定的应用,称为测验效度(test validity):指“证据和理论支持对测验分数解释的程度”。效度的概念涉及对现实本质的统计测量,因此既是一个认识论和哲学问题,也是一个测量问题。例如,以一个国家是否有宪法、是否存在投票制度、有多少位国会议员等表面指标来衡量民主,就不如以国会是否定期经人民于公平公开的竞争性普选产生、政府领袖是否经人民直接选举或由人民直选产生的国会间接选举产生、国会内的有效政党数目、言论自由、新闻自由、出版自由、集会自由、结社自由等人权是否受保障等指标来得精确。
效度与信度的关系
效度不应与信度混淆,后者是测量结果一致性的程度。仅凭一个测量工具具有信度,并不能保证其具有效度——例如,一个总是偏差5磅的秤是可信的(每次都一致),但不是有效的(没有测准真实重量)。反之,一个测验如果没有信度,则一定没有效度。此外,效度(与信度类似)是一个相对概念,并不是全有或全无的判断。效度有多种不同类型,每种类型回答不同的问题。
分類
度量工具能重覆顯示相同結果(信度高)又能正確量出所量之物就是有效度,而其中可以以下不同的形式
*():測驗給人的第一印象,非事實能測到什麼,可使受試者安心或感到親切,增加配合度。
*建構效度():某工具是否真的量度所測之物,如用作文來考人的數學運算能力。
*內容效度、邏輯效度():測驗內容是否能代表樣本行為(代表性、適切性)
*內部效度():會否影響變量間的關係,例如學校一開始精英班或普通班,再用新的教學法「隨機分配」在精英班,測試學生的成績變化
*外部效度():能否將一個實驗的結果套在其他地方上,例如某間富人的小學能否代表整個國家的小學情況。
*效標效度 ():與其他量度工具的關係。
*預測效度 ():在一個已有的測驗結果能否可以用來估計其他相關測驗,例如用托福的成績來估計雅思的英文掌握等級。
*():兩個量度工具能否給類似結果。
*():不同量度工具能否有效測量同一概念。
*():量度工具能否有效分出不同的情況,如有病與健康。
*():外部效度的一種,指樣本推論至其他母體的程度。
*():外部效度的一種,樣本推論至所代表母體的程度。
诊断效度
在精神病学中,对诊断分类本身的效度评估是一个特殊问题。Robins和Guze于1970年提出了确立精神病诊断效度的五项标准:清晰的临床描述(包括症状特征、人口学特征和典型诱因)、实验室研究(包括心理测试、影像学和尸验发现)、与其他疾病的区分(通过排除标准)、随访研究显示特征性病程,以及家庭研究显示家族聚集性。这些标准后来成为Feighner标准和研究诊断标准(RDC)的基础,进而构成了DSM和ICD诊断分类体系。Kendell和Jablensky(2003)强调区分效度与“实用性”(utility)的重要性,主张只有当诊断类别被证明是具有自然边界的离散实体时,才应被视为有效。
參見
*信度 ()
*準確度
参考资料
评论 (0)