卫生统计学-卡方检验
- 格式:doc
- 大小:308.00 KB
- 文档页数:9
卡方检验医学统计学卡方检验是医学统计学中最常用的检验方法之一,它可用于测量两组数据之间的关联性。
在研究中,我们常常需要探究二者之间是否存在某种关联,卡方检验就是我们解决这个问题的利器。
卡方检验的原理卡方检验的原理是基于期望频数和实际频数的差异来检验两个变量之间的关系。
期望频数指的是在假设两个变量独立的情况下,我们可以根据样本量和其他条件,计算出不同组之间的理论值。
而实际频数则是实验中观察到的实际结果。
卡方检验的步骤如下:1.建立零假设和备择假设。
零假设指的是假设两个变量之间不存在任何关系,备择假设则是反之。
2.确定显著性水平 alpha,通常取值为0.05。
3.构建卡方检验统计量。
计算方法为将所有观察值与期望值的差平方后,再除以期望值的总和。
4.根据自由度和显著性水平,查卡方分布表得到 P 值。
5.如果 P 值小于显著性水平,拒绝零假设;否则无法拒绝零假设。
卡方检验的应用卡方检验可以应用于多个领域,其中医学统计学是最为常见的一个。
卡方检验可以用来分析两个疾病之间的相关性或者测量一种治疗方法的效果。
举个例子,某药厂要研发一种新的药物来治疗心脏病。
为了验证该药的疗效,实验组和对照组各50 人。
在 6 个月的治疗后,实验组和对照组中分别有 10 人和 15 人痊愈了。
卡方检验的作用就在于此时可以用来检验两组之间的差异是否具有统计学意义。
除了医学统计学之外,卡方检验在社会学、心理学、市场营销、物理等领域也都有广泛应用。
卡方检验的限制虽然卡方检验被广泛应用于各种实验和研究中,但它也有着自己的限制。
其中比较明显的一点就是对样本量有一定的要求。
当样本量较小的时候,期望频数的计算就会出现一定的误差,进而导致检验结果不准确。
此外,在面对非常态分布数据时,卡方检验也会出现问题。
当数据呈现正态分布时,卡方检验的准确性最高。
然而,实际上,很多数据都呈现出非正态分布,这时需要使用一些修正方法来解决。
卡方检验是医学统计学中最常用的统计方法之一,它可以用来测量两个变量之间的关联性。
公卫执业医师-综合笔试-卫生统计学-第七单元卡方检验[单选题]1.多个样本率比较X2检验中,若P≤a,拒绝H0,接受H1,所得的结论是A.多个样本率全相等B.多个总体率全相等(江南博哥)C.多个样本率不全相等D.多个总体率不全相等E.多个总体率全不相等正确答案:D参考解析:多个样本率的检验假设,H0多个总体率全相等,H1是多个总体率不全相等.掌握“行×列表资料的χ2检验★”知识点。
[单选题]2.在四行三列表χ2检验中,统计量χ2的自由度等于A.2B.3C.4D.6E.12正确答案:D参考解析:在行×列表χ2检验中,其自由度=(行数-1)×(列数-1)。
本题中自由度=(4-1)×(3-1)=6。
掌握“行×列表资料的χ2检验★”知识点。
[单选题]3.5个总体率比较的行×列表资料χ2检验的无效假设是5个总体率A.至少有2个相等B.至少有3个相等C.至少有4个相等D.全相等E.各不相等正确答案:D参考解析:行×列表资料χ2检验的无效假设是各总体率全相等。
所以选项D正确。
掌握“行×列表资料的χ2检验★”知识点。
[单选题]4.欲比较某药三个不同剂量水平对某病的疗效,宜选用的假设检验方法是A.四格表资料的χ2检验B.成组资料的t检验C.行×列表资料的χ2检验D.秩和检验E.方差分析正确答案:C参考解析:行×列表资料:当比较组数大于等于2,或资料的属性分类数大于等于2种时,数据可采用多行×多列表形式来表达,称行×列表。
行×列表的χ2检验用于检验两个或多个样本率(构成比)的差别是否有统计学意义。
该资料属于行×列表资料,应采用行×列表的χ2检验,故选项C正确。
掌握“行×列表资料的χ2检验★”知识点。
[单选题]5.多个样本率比较的R×C表χ2检验,以下错误的一项是A.其备择假设是多个总体率不全相等B.χ2的自由度是(R一1)(C--1)C.χ2值越小,越有理由认为理论频数与实际频数符合的好D.由于格子数较多,可不必考虑每个格子的理论数的大小E.若P0.01,还不能推断每两个率值不等正确答案:D参考解析:在卡方检验中,不论格子多少,都需要考虑每个格子的理论数的大小。
卫⽣统计学第七章卡⽅检验⼀、题型:A1题号: 1 本题分数: 2四格表资料两样本率⽐较的χ2检验,正确的⼀项为A. χ2值为两样本率⽐较中u值B. P<α前提下,χ2值越⼤,越有理由拒绝H0C. χ2值⼤⼩与样本含量⽆关D. 每个格⼦的理论频数与实际频数的差值相等E. χ2检验只能进⾏单侧检验正确答案: B答案解析:根据专业知识确定四格表资料两样本率⽐较的χ2检验采⽤单侧检验或是双侧检验, (也可使⽤四格表专⽤公式),可以证明四格表计算得出的χ2值与正态近似法两率⽐较中u值的平⽅相等,其⼤⼩与样本含量有关,且每个格⼦的理论频数与实际频数的差的绝对值相等,P<α前提下,⾃由度⼀定时,χ2值越⼤,P值越⼩,越有理由拒绝H0,故答案为B。
做答⼈数:0做对⼈数:0所占⽐例: 0题号: 2 本题分数: 2下列能⽤χ2检验的是A. 成组设计的两样本均数的⽐较B. 配对设计差值的⽐较C. 多个样本频率的⽐较D. 单个样本均数的⽐较E. 多个样本均数的⽐较正确答案: C答案解析:χ2检验可⽤于率或构成⽐⽐较的假设检验中,不适宜于均数的⽐较。
做答⼈数:0做对⼈数:0所占⽐例: 0题号: 3 本题分数: 2⾏×列表的⾃由度是A. ⾏数-1B. 列数-1C. ⾏数×列数D. (⾏数-1)×(列数-1)E. 样本含量-1正确答案: D答案解析:⾏×列表中,⾏的⾃由度=⾏数-1,列的⾃由度=列数-1,⾏×列⼆维表资料的χ2统计量所对应的⾃由度=(⾏数-1)×(列数-1)。
做答⼈数:0做对⼈数:0所占⽐例: 0题号: 4 本题分数: 2四个百分率做⽐较,有⼀个理论数⼩于5,其他都⼤于5,则A. 只能做校正χ2检验B. 不能做χ2检验C. 直接采⽤⾏×列表χ2检验D. 必须先做合理的合并E. 只能做秩和检验正确答案: C答案解析:四个百分率做⽐较,资料可整理为4×2的⾏×列表,多个率⽐较的⾏×列表资料不适宜采⽤秩和检验,当满⾜⾏×列⼩于5,可直接进⾏χ2检验。
卫生统计学之卡方检验一、教学大纲要求(一) 掌握内容 1. 2χ检验的用途。
2. 四格表的2χ检验。
(1) 四格表2χ检验公式的应用条件; (2) 不满足应用条件时的解决办法; (3) 配对四格表的2χ检验。
3. 行⨯列表的2χ检验。
(二) 熟悉内容频数分布拟合优度的2χ检验。
(三) 了解内容 1.2χ分布的图形。
2.四格表的确切概率法。
二、教学内容精要(一)2χ检验的用途2χ检验(Chi-square test )用途较广,主要用途如下:1.推断两个率及多个总体率或总体构成比之间有无差别 2.两种属性或两个变量之间有无关联性 3.频数分布的拟合优度检验 (二)2χ检验的基本思想1.2χ检验的基本思想是以2χ值的大小来反映理论频数与实际频数的吻合程度。
在零假设0H (比如0H :21ππ=)成立的条件下,实际频数与理论频数相差不应该很大,即2χ值不应该很大,若实际计算出的2χ值较大,超过了设定的检验水准所对应的界值,则有理由怀疑0H 的真实性,从而拒绝0H ,接受H 1(比如1H :21ππ≠)。
2. 基本公式:()∑-=TT A 22χ,A 为实际频数(Actual Frequency ),T 为理论频数(Theoretical Frequency )。
四格表2χ检验的专用公式正是由此公式推导出来的,用专用公式与用基本公式计算出的2χ值是一致的。
(三)率的抽样误差与可信区间 1.率的抽样误差与标准误样本率与总体率之间存在抽样误差,其度量方法:np )1(ππσ-=,π为总体率,或 (8-1)np p S p )1(-=, p 为样本率; (8-2) 2.总体率的可信区间当n 足够大,且p 和1-p 均不太小,p 的抽样分布逼近正态分布。
总体率的可信区间:(p p S u p S u p ⨯+⨯-2/2/,αα)。
(8-3) (四)2χ检验的基本计算 见表8-1。
表8-12χ检验的用途、假设的设立及基本计算公式资料形式用途0H 、1H 的设立与计算公式自由度四格表①独立资料两 样本率的比较②配对资料两 样本率的比较0H :两总体率相等 1H :两总体率不等①专用公式))()()(()(22d b c a d c b a nbc ad ++++-=χ ②当n ≥40但1≤T<5时,校正公式))()()(()2/(22d b c a d c b a n n bc ad ++++--=χ ③配对设计cb c b +--=22)1(χ1R ⨯C 表①多个样本率、 构成比的比较②两个变量之 间关联性分析0H :多个总体率(构成比)相等(0H :两种属性间存在关联)1H :多个总体率(构成比)不全相等(0H :两种属性间存在关联))1(22-=∑CR n n A n χ (R-1)(C-1)频数分布表 频数分布的拟合优度检验0H :资料服从某已知的理论分布 1H :资料不服从某已知的理论分布∑-TT A 2)( 据频数表的组数而定(五)四格表的确切概率法当四格表有理论数小于1或n <40时,宜用四格表的确切概率法。
(六)2χ检验的应用条件及注意事项1.分析四格表资料时,应注意连续性校正的问题,当1<T <5,n >40时,用连续性校正2χ检验;T ≤1,或n ≤40时,用Fisher 精确概率法。
2.对于R ⨯C 表资料应注意以下两点:(1)理论频数不宜太小,一般要求:理论频数<5的格子数不应超过全部格子的1/5; (2)注意考察是否有有序变量存在。
对于单向有序R ⨯C 表资料,当指标分组变量是有序的时,宜用秩和检验;对于双向有序且属性不同的R ⨯C 表资料,若希望弄清两有序变量之间是否存在线性相关关系或存在线性变化趋势,应选用定性资料的相关分析或线性趋势检验;对于双向有序且属性相同的R ⨯C 表资料,为考察两种方法检测的一致性,应选用Kappa 检验。
三、典型试题分析(一)单项选择题1.下列哪项检验不适用2χ检验( )A . 两样本均数的比较B . 两样本率的比较C . 多个样本构成比的比较D . 拟合优度检验 答案:A[评析] 本题考点:2χ检验的主要用途。
2χ检验不能用于均数差别的比较。
2.分析四格表时,通常在什么情况下需用Fisher 精确概率法( )A .1<T <5,n>40B .T <5C .T 1≤或n 40≤D .T 1≤或n 100≤ 答案: C[评析] 本题考点:对于四格表,当T 1≤或n 40≤时,不宜用2χ检验,应用Fisher 精确概率法。
3.2χ值的取值范围为A .∞-<2χ<∞+B .+∞≤≤20χC .12≤χD .02≤≤∞-χ答案: B[评析]根据2χ分布的图形或2χ的基本公式可以判断2χ值一定是大于等于零且没有上界的,故应选B 。
(二)是非题 两样本率的比较可以采用2χ检验,也可以采用双侧u 检验。
答案:正确。
[评析]就两个样本率的比较而言,双侧u 检验与2χ检验是等价的。
(三)简答题1.四格表的2χ检验和u 检验有何联系与区别?答案:相同点:凡是能用u 检验进行的两个率比较检验的资料,都可用2χ检验,两者是等价的,即22χ=u ;相异点:(1)u 检验可进行单侧检验;(2)满足四格表u 检验的资料,计算两个率之差的可信区间,可从专业上判断两率之差有无实际意义;(3)2χ检验可用于2⨯2列联表资料有无关联的检验。
2.R ⨯C 表2χ检验的适用条件及当条件不满足时可以考虑的处理方法是什么? 答案:R ⨯C 表2χ检验的适用条件是理论频数不宜过小,否则有可能产生偏性。
当条件不满足时有三种处理方法:①增大样本例数使理论频数变大;②删去理论数太小的行或列;③将理论数太小的行或列与性质相近的邻行或邻列合并,使重新计算的理论频数变大。
但②、③法都可能会损失信息或损害样本的随机性,因此应慎用。
(四)计算题1.为研究静脉曲张是否与肥胖有关,观察122对同胞兄弟,每对同胞兄弟中有一个属肥胖,另一个属正常体重,记录得静脉曲张发生情况见表8-2,试分析之。
表8-2 122对同胞兄弟静脉曲张发生情况正常体重 肥胖合计 发生 未发生 发 生19 5 24 未发生 12 86 98 合 计31 91122[评析]这是一个配对设计的资料,因此用配对2χ检验公式计算。
H 0:肥胖者与正常体重者的静脉曲张发生情况无差别 H 1:肥胖者与正常体重者的静脉曲张发生情况不同 05.0=α cb c b +--=22)1(χ=()12.212511252=+--,1=ν2χ=2.11<21,05.0χ,P >0.05,尚不能认为静脉曲张与肥胖有关。
2.某卫生防疫站在中小学观察三种矫正近视眼措施的效果,近期疗效数据见表8-3。
试对这三种措施的疗效作出评价。
夏天无眼药水 51 84 135 37.78 新医疗法 6 26 32 18.75 眼保健操 5 13 18 27.78 合计 62 123 18533.51[评析]0H :三种措施有效率相等1H :三种措施有效率不相等或不全相等 05.0=α)1(22-=∑cr n n A n χ=185⨯⎪⎪⎭⎫ ⎝⎛-⨯+⨯+⨯+⨯+⨯+⨯1181231318625321232632626135123841356251222222=4.498,ν=(2-1)(3-1)=2查表得0.25>P >0.10,按0.05α=水准不拒绝0H ,尚不能认为三种措施有效率有差别。
3.某医院以400例自愿接受妇科门诊手术的未产妇为观察对象,将其分为4组,每组100例,分别给予不同的镇痛处理,观察的镇痛效果见表8-4,问4种镇痛方法的效果有无差异?表8-4 4种镇痛方法的效果比较 镇痛方法 例数 有效率(%)颈麻100 41 注药100 94 置栓100 89 对照100 27 [评析] 为了应用2χ检验,首先应计算出有效和无效的实际频数,列出计算表,见表8-5。
颈麻41 59 100 注药94 6 100 置栓89 11 100 对照27 73 100 合计251 149 400 0H :4种镇痛方法的效果相同 1H :4种镇痛方法的效果不全相同05.0=α)1(22-=∑c r n n A n χ=400⎪⎪⎭⎫ ⎝⎛-⨯++⨯+⨯⨯110014973...1001495910025141222=146.175, ν=(4-1)(2-1)=3查表得P <0.05,按0.05α=水准拒绝0H ,接受1H ,即4种镇痛方法的效果不全相同。
四、习 题(一) 单项选择题1. 关于样本率p 的分布正确的说法是: A . 服从正态分布 B . 服从2χ分布C . 当n 足够大,且p 和1-p 均不太小,p 的抽样分布逼近正态分布D . 服从t 分布 2. 以下说法正确的是: A . 两样本率比较可用u 检验 B . 两样本率比较可用t 检验C . 两样本率比较时,有2χ=uD . 两样本率比较时,有22χ=t3. 率的标准误的计算公式是: A .)1(p p - B .np p )1(- C.1-n p D.np p )1(- 4. 以下关于2χ检验的自由度的说法,正确的是: A .拟合优度检验时,2-=n ν(n 为观察频数的个数) B .对一个43⨯表进行检验时,11=ν C .对四格表检验时,ν=4D .若2,05.02,05.0ηνχχ>,则ην>5. 用两种方法检查某疾病患者120名,甲法检出率为60%,乙法检出率为50%,甲、乙法一致的检出率为35%,问两种方法何者为优?A .不能确定B .甲、乙法一样C .甲法优于乙法D .乙法优于甲法 6.已知男性的钩虫感染率高于女性。
今欲比较甲乙两乡居民的钩虫感染率,适当的方法是:A .分性别比较B .两个率比较的2χ检验C .不具可比性,不能比较D .对性别进行标准化后再做比较 7.以下说法正确的是A .两个样本率的比较可用u 检验也可用2χ检验B .两个样本均数的比较可用u 检验也可用2χ检验C .对于多个率或构成比的比较,u 检验可以替代2χ检验D .对于两个样本率的比较,2χ检验比u 检验可靠 (二) 名词解释1. 实际频数与理论频数 2. 2χ界值表 3. 拟合优度 4. 配对四格表5. 双向有序分类资料 6. 率的标准误7. 多个率的两两比较 8. Fisher 精确概率 9. McNemar 检验 10. Yates 校正 (三) 是非题四个样本率做比较,2)3(05.02χχ> ,可认为各总体率均不相等。
(四) 计算题1.121名前列腺癌患者中,82名接受电切术治疗,术后有合并症者11人;39名接受开放手术治疗,术后有合并症1人。