第4章 测量的信度与效度
- 格式:ppt
- 大小:474.00 KB
- 文档页数:31
一、信度1.定义信度主要是指测量结果的可靠性或一致性。
信度只受随机误差的影响,随机误差越大,信度越低。
因此,信度可以视为测试结果受随机误差影响的程度。
系统误差产生恒定效应,不影响信度。
每一个测试的实得分数(X)总是由真实分数(T)和误差(E)两部分构成的,用公式表示如下:X=T+E如果我们讨论一组测验分数的特性时,可用方差代表具体分数,得到公式:S^2(x)=S^2(t)+S^2(e)公式中,S^2(x)是实得分数的方差,S^2(t)是真分数的方差,S^2(e)是误差的方差在测量理论中,信度被定义为:一组测量分数的真分数方差与中方差(实得方差)的比率。
即:r(xx)=S^2(t)/S^2(x)2.信度的指标大部分情况下,信度是以信度系数为指标,它是一种相关系数。
常常是同一被试样本所得到的两组资料的相关,理论上说就是真分数方差与实得分数方差的比值,公式为:r(xx)=r^2(xt)=S^2(t)/S^2(x)3.信度信度评估的方法(见具体例子)(一)重测信度,又称为稳定性系数,它的计量方法是采用重测法:用同一测验,在不同时间对同一群体施测两次,这两次测量分数的相关系数即为重测系数。
重测信度所考察的误差来源是时间的变化所带来的随机影响。
在评估重测信度时,必须注意重测间隔的时间。
对于人格测验,重测间隔在两周到6个月之间比较合适。
在进行重测信度的评估时,还应注意以下两个重要问题:⑴重测信度一般只反映由随机因素导致的变化,而不反映被试行为的长久变化。
⑵不同的行为受随机误差影响不同。
(二)复本信度,是以两个测验复本来测量同一群体,然后求得应试者在这两个测验上得分的相关系数。
复本信度的高低反映了这两个测验复本在内容上的等值性程度。
两个等值的测验互为复本。
计算复本信度的主要目的在于考察两个测验复本的题目取样或内容取样是否等值。
复本信度也考虑两个复本实施的时间间隔。
复本信度的主要优点在于:⑴能够避免重测信度的一些问题,如记忆效果、练习效应等;⑵适用于进行长期追踪研究或调查某些干涉变量对测验成绩影响;⑶减少了辅导或作弊的可能性。
第4章测量与操作化(9学时)作为一种认识社会现象的活动,社会研究必然会涉及对社会现象进行测量的问题。
社会研究的资料以及社会研究成果的质量,都直接与测量的质量紧密相连。
因此,社会研究者必须高度重视测量的工作。
在本章中,我们将对测量的概念与特征、概念的操作化过程、指数与量表、测量的层次、测量的信度与效度等内容进行介绍。
第一节测量的概念与层次一、什么是测量美国学者史蒂文斯认为:测量就是依据某种法则给物体安排数字。
这一定义被许多社会科学研究人员所采用。
在此基础上我们采用下述定义来进一步解释测量的含义:所谓测量,就是根据一定的法则,将某种物体或现象所具有的属性或特征用数字或符手表示出来的过程。
测量的主要作用,在于确定一个特定分析单位的特定属性的类别或水平。
它不仅可以对事物的同性做定量的说明(即确定特定属性的水平),同时,它也能对事物的属性做定性的说明(即确定特定属性的类别)。
而在社会研究中,研究者所进行的大部分测量往往都是这种定性的测量。
二、测量的四个要秦为了更好地理解测量的概念,有必要对构成上述测量定义的四个必不可少的要素进行专门的说明。
这四个要素是:测量的客体、测量的内容、测量的法则、数字或符号。
(1)测量客体,即测量的对象。
它是客观世界中所存在的事物或现象,是我们要用数字或符号来进行表达、解释和说明的对象。
(2)测量内容,即测量客体的某种属性或特征。
实际上,在任何一种测量中,我们所测量的对象虽然是某一客体,但所测量的内容却并不是客体本身,而是这一客体的特征或属性。
(3)测量法则,即用数字和符号表达事物各种属性或特征的操作规则。
也可以说,它是某种具体的操作程序和区分不同特征或属性的标难。
(4)数字和符号,即用来表示测量结果的工具。
比如,120厘米、110厘米等等就是测量桌子高度所得的结果;350元、400元等等就是测量人们收入的结果。
在社会研究中,研究者进行测量的结果中,许多是用数字来表示的。
三、社会现象的测量我们知道,测量在自然科学的研究中应用十分广泛,十分普遍,也十分成熟。
第四章效度信度解决的是测验分数是否可靠的问题,但即使一个测验分数有跨时间的稳定性和跨情境的一致性,却不能保证测验分数代表了被试的真实水平。
比如说,某测验的目的是测量能力,但测题却都是一些死记硬背的知识,测验分数是不能代表被试真实能力水平的。
这就涉及了测量的客观性和准确性问题,即测验的效度问题。
第一节效度概述一、效度的概念测验的效度(validity)指的是测验的有效性,即测验分数能够代表所要测量的心理特质的程度,或测验结果达到测验目的的程度。
任何测验对所要测量的心理特质的测量都不是绝对客观和准确的。
一些编制得好的智力测验一般是效度较高的,但也免不了受智力之外的因素的影响。
因为测验的题目必然要从人们的生活实践中选材,来自不同生活背景的人对同一个测验题目的熟悉程度是不同的,即使智力相同,测验分数也会不同。
因此人们的知识经验就成了影响测验分数的无关因素之一。
研究表明,文化和种族因素会造成测验的不公平,因为与测验分数有关的并不完全是智力。
人格和成就测验同样存在无关因素影响测验分数的问题。
效度总是针对一定的测验目的而言的。
例如,用编制得好的人格测验测量人的个性,诊断心理障碍是有效的,即有一定效度,但若用来测量智力,测量结果就是无效的。
因为人格与智力无关,故分数的高低不能代表智力的高低。
以上讨论的是心理测量中的效度问题,在物理测量中,效度问题也是同样存在的。
如,用不标准的尺子量物体,用不准确的称去称物体,都会使测量的结果不准确。
可见,效度是由于测量工具(量尺)本身的问题造成的,在多次测量中都会恒定地出现而无法消除,因而称系统误差。
测量的效度问题是测验结果中包含了多大比例的系统误差的问题,系统误差可能是由以下几方面原因造成的:(1)所要测量的特质有多方面的含义,而量表本身未能全部包含这些方面;(2)测验题目中包含了与所测特质无关的题目;(3)记分方面的问题,如选择题的备选答案是不全面的,即没有完全体现被试情况的差异,因此答案就不是足够准确的,而且各题目得分是简单累加而未经加权处理,不同题目的重要性程度就没有得到区分。
戴海崎《心理与教育测量》(第4版)笔记和课后习题(含考研真题)详解完整版>精研学习网>无偿试用20%资料全国547所院校视频及题库资料考研全套>视频资料>课后答案>往年真题>职称考试第1章心理与教育测量概论1.1复习笔记1.2课后习题详解1.3典型题(含考研真题)详解第2章心理与教育测量简史2.1复习笔记2.2课后习题详解2.3典型题(含考研真题)详解第3章经典测验理论的基本假设3.1复习笔记3.2课后习题详解3.3典型题(含考研真题)详解第4章测量信度4.1复习笔记4.2课后习题详解4.3典型题(含考研真题)详解第5章测量效度5.1复习笔记5.2课后习题详解5.3典型题(含考研真题)详解第6章测验的项目分析6.1复习笔记6.2课后习题详解6.3典型题(含考研真题)详解第7章心理与教育测验的编制与实施7.1复习笔记7.2课后习题详解7.3典型题(含考研真题)详解第8章常模参照测验8.1复习笔记8.2课后习题详解8.3典型题(含考研真题)详解第9章目标参照测验9.1复习笔记9.2课后习题详解9.3典型题(含考研真题)详解第10章测验等值10.1复习笔记10.2课后习题详解10.3典型题(含考研真题)详解第11章学绩测验11.1复习笔记11.2课后习题详解11.3典型题(含考研真题)详解第12章能力测验(上)12.1复习笔记12.2课后习题详解12.3典型题(含考研真题)详解第13章能力测验(下)13.1复习笔记13.2课后习题详解13.3典型题(含考研真题)详解第14章人格测量14.1复习笔记14.2课后习题详解14.3典型题(含考研真题)详解第15章其他心理与教育测验15.1复习笔记15.2课后习题详解15.3典型题(含考研真题)详解第16章测量应用实务16.1复习笔记16.2课后习题详解16.3典型题(含考研真题)详解第17章测量理论与应用的新发展17.1复习笔记17.2课后习题详解17.3典型题(含考研真题)详解。
信度和效度名词解释一、信度1. 定义- 信度是指测验结果的一致性、稳定性及可靠性。
一般多以内部一致性来加以表示该测验信度的高低。
信度系数愈高即表示该测验的结果愈一致、稳定与可靠。
例如,用同一个量表对同一组被试在不同时间进行测量,如果每次测量结果都很相近,就说明这个量表的信度较高。
2. 信度的类型- 重测信度:用同一种测验,对同一组被试者,前后施测两次,再根据被试者两次测验分数计算其相关系数,即得重测信度。
它反映了测验跨时间的稳定性。
例如,在一个月内,对同一批学生使用相同的智力测验进行两次测试,两次测试结果的相关性就是重测信度。
- 复本信度:复本是内容、形式、难度等方面与原测验相似的测验。
复本信度是根据一组被试者接受两个复本测验的得分计算的相关系数。
有A、B两套英语水平测试题,它们在题型、难度等方面相似,对同一组学生先进行A卷测试,过一段时间再进行B卷测试,然后计算两次成绩的相关系数就是复本信度。
- 内部一致性信度:主要反映的是测验内部题目之间的关系,表示测验能够测量相同内容或特质的程度。
例如,在一个包含多个项目的人格测验中,内部一致性信度高意味着各个项目之间测量的是人格的同一个方面,常用的计算方法有克伦巴赫α系数等。
- 评分者信度:用于衡量不同评分者对同一组被试评分的一致性程度。
在一些主观性较强的测验中,如作文评分、面试评分等,评分者信度就非常重要。
如果不同评分者对同一篇作文或同一个面试者的评分比较接近,那么评分者信度就较高。
3. 影响信度的因素- 被试样本:被试样本的同质性(相似性)程度会影响信度。
如果被试样本的同质性高,信度可能会较低,因为他们在测验所测特质上的差异较小;反之,异质性高的被试样本可能会使信度较高。
例如,在一个只针对高智商学生的智力测验中,由于学生的智商都比较高且接近,可能会导致信度系数较低。
- 测验长度:一般来说,测验的题目数量越多,信度越高。
因为较长的测验能够更全面地测量被试的特质,减少随机误差的影响。
研究信度与效度的关系一、信度与效度的定义信度即可靠性,它指的是采取同样的方法对同一对象重复进行测量时,其所得结果相一致的程度,或者说,信度是指测量结果的一致性或稳定性。
效度即准确度,它是指测量工具或测量手段能够准确测出所要测量的变量的程度,或者说能够准确、真实地度量事物属性的程度。
二、信度与效度的关系(一)教育科学研究中信度与效度的关系信度是研究结果所显示的一致性、稳定性程度,也是对研究结果一致性和稳定性的评价标准。
一个具有信度的研究程序,不论其过程是由谁操作,或进行多少次同样的操作,其结果总是非常一致的。
效度是一个研究程序的性质和功能,也是对研究结果正确性的评价标准,一个有效度的研究程序,不仅能够明确地回答研究的问题和解释研究结果,而且能够保证研究结果在一定规模的领域中推广。
把两者的作用结合起来看,信度和效度是一项教育科学研究活动和结果具有科学价值和意义的保证。
研究的信度是研究的效度的一个必要的前提,没有信度,效度不可能单独存在,也就是说,一项研究不可能没有信度却具有效度。
(二)人力资源招聘信度与效度的关系影响测评信度的因素有很多,主要是系统误差和随机误差。
包括测评者的专业性和素质、被测评者本人的心理、侧评工具的稳定性、环境的稳定性等都会影响测评的可信度。
影响测评的效度因素也有很多,如测评工具、测评过程及测评者因素、被测评者状态、效标因素和信度因素等。
在实际招聘与录用评估过程中要把握各相关方面,不仅要有专业的测评人员,同时也要在稳定的环境中为被测评者提供一个放松真实的氛围。
信度和效度是人才侧评与选拔质量的重要指标。
图形形式表现分析得出的信度和效度的三种关系,则会是以下这些样式,如图8-l .图8-2和图8-3所示。
所以,:高信度是高效度的必要条件,但非充分条件。
即信度高不一定其效度就高,但要想获得较高的测评效度,其信度必定要高,(三)用结构式问卷来测量家长“溺爱孩子”的行为中信度与效度的关系当我们用结构式问卷来测量家长“溺爱孩子”的行为时,可以得到相对较高一些的测量信度,用同样的问题反复询问同样的对象时,所得到的结果的一致性程度会比较高,但是,这种测量方法的效度往往会比较低,因为家长们在培养孩子方面的认识、态度和具体做法远比问卷中的五个问题丰富多彩,我们在问卷中所能够测量的只是其中的很少、很表面、很有限的一部分,反之,如果我们用深入到每一个家庭、实地去考察、与家长仔细交谈的方法来进行测量,那么,所得到的资料的效度会比较高,我们实实在在地看到和感受到家长们是如何培养孩子的,但是,此时,我们却降低了观察的一致性程度。