第七章 相关与回归分析
- 格式:ppt
- 大小:332.50 KB
- 文档页数:29
第七章相关与回归分析学习内容一、变量间的相关关系二、一元线性回归三、线性回归方程拟合优度的测定学习目标1. 掌握相关系数的含义、计算方法和应用2. 掌握一元线性回归的基本原理和参数的最小二3. 掌握回归方程的显著性检验4. 利用回归方程进行预测5. 了解可化为线性回归的曲线回归6. 用Excel 进行回归分析一、变量间的相关关系1. 变量间的关系(函数关系)1)是一一对应的确定关系。
2)设有两个变量x和y,变量y 随变量x一起变化,并完全依赖于x,当变量x 取某个数值时,y依确定的关系取相应的值,则称y 是x的函数,记为y = f (x),其中x 称为自变量,y 称为因变量。
3)各观测点落在一条线上。
4)函数关系的例子–某种商品的销售额(y)与销售量(x)之间的关系可表示为 y = p x (p 为单价)。
–圆的面积(S)与半径之间的关系可表示为S = π R2。
–企业的原材料消耗额(y)与产量x1、单位产量消耗x2、原材料价格x3间的关系可表示为y =x1 x2 x3。
单选题下面的函数关系是()A、销售人员测验成绩与销售额大小的关系B、圆周的长度决定于它的半径C、家庭的收入和消费的关系D、数学成绩与统计学成绩的关系2. 变量间的关系(相关关系)1)变量间关系不能用函数关系精确表达。
2)一个变量的取值不能由另一个变量唯一确定。
3)当变量 x 取某个值时,变量 y 的取值可能有几个。
4)各观测点分布在直线周围。
5)相关关系的例子–商品的消费量(y)与居民收入(x)之间的关系。
–商品销售额(y)与广告费支出(x)之间的关系。
–粮食亩产量(y)与施肥量(x1)、降雨量(x2)、温度 (x3)之间的关系。
–收入水平(y)与受教育程度(x)之间的关系。
–父亲身高(y)与子女身高(x)之间的关系。
3. 相关图表1)相关表:将具有相关关系的原始数据,按某一顺序平行排列在一张表上,以观察它们之间的相互关系。
2)相关图:也称为分布图或散点图,它是在平面直角坐标中把相关关系的原始数据用点描绘出来,通常以直角坐标轴的横轴代表自变量x,纵轴代表因变量y。
第七章 相关与回归分析一、本章学习要点(一)相关分析就是研究两个或两个以上变量之间相关程度大小以及用一定函数来表达现象相互关系的方法。
现象之间的相互关系可以分为两种,一种是函数关系,一种是相关关系。
函数关系是一种完全确定性的依存关系,相关关系是一种不完全确定的依存关系。
相关关系是相关分析的研究对象,而函数关系则是相关分析的工具。
相关按其程度不同,可分为完全相关、不完全相关和不相关。
其中不完全相关关系是相关分析的主要对象;相关按方向不同,可分为正相关和负相关;相关按其形式不同,可分为线性相关和非线性相关;相关按影响因素多少不同,可分为单相关和复相关。
(二)判断现象之间是否存在相关关系及其程度,可以根据对客观现象的定性认识作出,也可以通过编制相关表、绘制相关图的方式来作出,而最精确的方式是计算相关系数。
相关系数是测定变量之间相关密切程度和相关方向的代表性指标。
相关系数用符号“γ”表示,其特点表现在:参与相关分析的两个变量是对等的,不分自变量和因变量,因此相关系数只有一个;相关系数有正负号反映相关系数的方向,正号反映正相关,负号反映负相关;计算相关系数的两个变量都是随机变量。
相关系数的取值区间是[-1,+1],不同取值有不同的含义。
当1||=γ时,x 与y 的变量为完全相关,即函数关系;当1||0<<γ时,表示x 与y 存在一定的线性相关,||γ的数值越大,越接近于1,表示相关程度越高;反之,越接近于0,相关程度越低,通常判别标准是:3.0||<γ称为微弱相关,5.0||3.0<<γ称为低度相关,8.0||5.0<<γ称为显著相关,1||8.0<<γ称为高度相关;当0||=γ时,表示y 的变化与x 无关,即不相关;当0>γ时,表示x 与y 为线性正相关,当0<γ时,表示x 与y 为线性负相关。
皮尔逊积距相关系数计算的基本公式是: ∑∑∑∑∑∑∑---==])(][)([22222y y n x x n y x xy n y x xy σσσγ 斯皮尔曼等级相关系数和肯特尔等级相关系数是测量两个等级变量(定序测度)之间相关密切程度的常用指标。
第七章相关分析与回归分析1.企业 编号 产量(千 件)生产费用 (千元)企业编 号 产量(千 件)生产费用 (千元) 1 40 130 7 84 165 2 42 140 8 100 170 3 49 155 9 110 167 4 49 150 10 114 183 550 154 11 125 175 65516012130189试根据上表材料: (1) 绘制散点图。
(2) 计算相关系数。
(3) 配合一条直线回归方程。
解: ( 1)(2) 企业编号产量(千件)x生产费用(千元)yxy x2 y2 1 40 130 **** **** 16900 2 42 140 5880 1764 19600 3 49 155 **** **** 24025 4 49 150 **** **** 22500 5 50 154 7700 2500 23716 6 55 160 8800 3025 25600 784 165 138607056272258 100170 17000 10000 28900 911016718370 12100 278896080040200 150 100产量与生产费用散点图512x159062 -948x1938.12 88368 -9482、12 316190 -19382(3)设回归方程为? = a bxb』甞7n Z x 一(送 x)12 159062-948 1938 12y -bx =1^ -0.4423948=126.558312 12所以回归方程为$ =126.5583 0.4423x2.某县城研究居民月家庭人均生活费支出和月家庭收入的相互关系,随机抽样 10利用上表材料:(1) 绘制散点图并观察两变量之间是否存在线性关系 (2) 计算相关系数,建立回归方程。
(3) 计算估计标准误差。
(4) 测算人均收入为200时,其人均生活费应为多少元 解: ( 1)12 88368-9482_ n 瓦xy-任x)任y) n' x 2 -r x)2. n' y 2 -(' y)2 71520 78838.84-0.907271520 161712二 0.4423(2) 家庭序号月人均收入(元)x月人均生活费(元)yxy x2y21 100 85 8500 10000 72252 110 88 968012100 77443 120 90 10800 14400 81004 130 94 12220 16900 88365 140 96 13440 19600 9216 6 150 100 15000 22500 100007 160 106 16960 25600 112368 170 118 20060 28900 13924 9180 120 21600 32400 14400 10 190 124 23560 36100 15376合计14501021151820 218500 106057n' xy-C x)(' y)10 151820 -1450 1021设回归方程为bxn £ xy-(£ x)(£ y) 10 汇 151820 —1450 乂 1021 n' x 2-C x)2 n' y 2-(' y)2 _ 10 218500 -14502a-bx=1021-0.45761450=35.74810 10所以回归方程为? =35.748 0.4576x (3)、10 218500 -14502 一 10 106057 -10212费活生均人月200-C x)2 .. n'y 2-c y)2 3775038673.54= 0.97613775082500 = 0.4576月人均生活费与人均收入散点图120140160月人均收入180oo oooooo 4 2 0 8 6 4 2' y2-a' y-b' xy _ 106057-35.748 1021-0.4576 151820 目二n-2 「10-2= 3.2684(4)当x=200 时,人均生活费为:y =35.748 0.4576 200 =127.2683. 已知x、y两变量的相关系数r = 0.8 , X =20, y = 50,二y为二x的两倍,求y 对x 的回归方程。
第七章 相关与回归分析(一)填空题1、相关关系按其相关的程度不同,可分为 、 和 。
2、相关系数的正负表示相关关系的方向,r 为正值,两变量是 ;r 为负数,两变量是 。
3、r=0,说明两个变量之间 ;r=+1,说明两个变量之间 ;r=-1说明两个变量之间 。
4、一元线性回归方程bx a y+=ˆ 中的参数a 代表 ,数学上称为 ;b 代表 ,数学上称为 。
5、 分析要根据研究的目的确定哪一个为自变量,哪一个为因变量,在这一点与 分析时不同。
6、相关关系按方向不同,可分为 和 。
7、完全线性相关的相关系数r 值等于 。
8、计算回归方程要注意资料中因变量是 的,自变量是 的。
9、回归方程只能用于由 推算 。
(二)单项选择题(在每小题备选答案中,选出一个正确答案)1、相关分析研究的是( )A. 变量之间关系的密切程度B. 变量之间的因果关系C. 变量之间严格的相互依存关系D. 变量之间的线性关系2、相关关系是( )A 、现象间客观存在的依存关系B 、现象间的一种非确定性的数量关系C 、现象间的一种确定性的数量关系D 、现象间存在的函数关系3、下列情形中称为正相关的是( )A. 随着一个变量的增加,另一个变量也增加B. 随着一个变量的减少,另一个变量增加C. 随着一个变量的增加,另一个变量减少D. 两个变量无关4、当自变量x 的值增加,因变量y 的值也随之增加,两变量之间存在着( )A 、曲线相关B 、正相关C 、负相关D 、无相关5、相关系数r 的取值范围是( )A. B.C. 6、当自变量x 的值增加,因变量y 的值也随之减少,两变量之间存在着( )A 、曲线相关B 、正相关C 、负相关D 、无相关7、相关系数等于零表明两变量( )A. 是严格的函数关系B. 不存在相关关系C. 不存在线性相关关系D. 存在曲线相关关系8、相关系数r 的取值范围是( )A 、从0到1B 、从-1到0C 、从-1到1D 、无范围限制11<<-r 10≤≤r 11≤≤-r9、相关分析对资料的要求是( )A. 两变量均为随机的B. 两变量均不是随机的C. 自变量是随机的,因变量不是随机的D. 自变量不是随机的,因变量是随机的10、相关分析与回归分析相比,对变量的性质要求是不同的,回归分析中要求( )A 、自变量是给定的,因变量是随机的B 、两个变量都是随机的C 、两个变量都是非随机的D 、因变量是给定的,自变量是随机的11、回归方程 中的回归系数b说明自变量变动一个单位时,因变量( )A. 变动b个单位 B. 平均变动b 个单位C.变动a+b 个单位 D. 变动a 个单位12、一般来说,当居民收入减少时,居民储蓄存款也会相应减少,二者之间的关系是( )A 、负相关B 、正相关C 、零相关D 曲线相关13、回归系数与相关系数的符号是一致的,其符号均可判断现象( )A. 线性相关还是非线性相关B. 正相关还是负相关C. 完全相关还是不完全相关D. 简单相关还是复相关14、配合回归方程比较合理的方法是( )A 、移动平均法B 、半数平均法C 、散点法D 、最小平方法15、在相关分析中不能把两个变量区分为确定性的自变量和随机性的因变量,在回归分析中( )A. 也不能区分自变量和因变量B. 必须区分自变量和因变量C. 能区分,但不重要D. 可以区分,也可以不区分16、价格愈低,商品需求量愈大,这两者之间的关系是( )A 、复相关B 、不相关C 、正相关D 、负相关17、按最小平方法估计回归方程 中参数的实质是使( )A. B. C. D. 18、判断现象之间相关关系密切程度的方法是( )A 、作定性分析B 、制作相关图C 、计算相关系数D 、计算回归系数19、在线性相关条件下,自变量的标准差为2,因变量的标准差为5,而相关系数为0.8,其回归系数为( )A. 8B. 12.5C. 0.32D. 2.020、已知某产品产量与生产成本有直线关系,在这条直线上,当产量为1000件时,其生产成本为50000元,其中不随产量变化的成本为12000元,则成本总额对产量的回归方程是( )A 、Y=12000+38XB 、Y=50000+12000XC 、Y=38000+12XD 、Y=12000+50000Xbx a y +=ˆbx a y +=ˆ∑=-最小值2)ˆ(y y21、已知,则相关系数为()A.不能计算 22、相关图又称( )A 、散布表B 、折线图C 、散点图D 、曲线图23、工人的出勤率与产品合格率之间的相关系数如果等于0.85,可以断定两者是( )A 、显著相关B 、高度相关C 、正相关D 、负相关24、相关分析与回归分析的一个重要区别是( )A 、前者研究变量之间的关系程度,后者研究变量间的变动关系,并用方程式表示B 、前者研究变量之间的变动关系,后者研究变量间的密切程度C 、两者都研究变量间的变动关系D 、两者都不研究变量间的变动关系25、当所有观测值都落在回归直线上,则这两个变量之间的相关系数为( )A 、1B 、-1C 、+1或-1D 、大于-1,小于+126、一元线性回归方程y=a+bx 中,b 表示( )A 、自变量x 每增加一个单位,因变量y 增加的数量B 、自变量x 每增加一个单位,因变量y 平均增加或减少的数量C 、自变量x 每减少一个单位,因变量y 减少的数量D 、自变量x 每减少一个单位,因变量y 增加的数量(三)多项选择题(在每小题备选答案中,至少有两个答案是正确的)1、直线回归方程 中,两个变量x 和y ( )A. 前一个是自变量 ,后一个是因变量B. 两个变量都是随机变量C. 两个都是给定的量D. 前一个是给定的量 ,后一个是随机变量E. 前一个随机变量 ,后一个是给定的量2、相关分析( )A 、分析对象是相关关系B 、分析方法是配合回归方程C 、分析方法主要是绘制相关图和计算相关系数D 、分析目的是确定自变量和因变量E 、分析目的是判断现象之间相关的密切程度,并配合相应的回归方程以便进行推算和预测3、相关分析的特点有 ( )A. 两个变量是对等的关系B. 它只反映自变量和因变量的关系C. 可以计算出两个相关系数D. 相关系数的符号都是正的E. 相关的两个变量必须都是随机的4、下列现象中存在相关关系的有( )A 、职工家庭收入不断增长,消费支出也相应增长B 、产量大幅度增加,单位成本相应下降C 、税率一定,纳税额随销售收入增加而增加D 、商品价格一定,销售额随销量增加而增加E 、农作物收获率随着耕作深度的加深而提高bx a y +=ˆ5、相关关系与函数关系的区别在于( )A. 相关关系是变量间存在相互存在依存关系,而且函数关系是因果关系B. 相关关系的变量间是确定不变的,而函数关系值是变化的C. 相关关系是模糊的,函数关系是确定的D. 两种关系没有区别6、商品流通费用率与商品销售额之间的关系是( )A 、相关关系B 、函数关系C 、正相关D 、负相关E 、单相关7、为了揭示变量x 与y 之间的相互关系,可运用( )A. 相关表B. 回归方程C.相关系数D. 散点图8、相关系数( )A 、是测定两个变量间有无相关关系的指标B 、是在线性相关条件下测定两个变量间相关关系密切程度的指标C 、也能表明变量之间相关的方向D 、其数值大小决定有无必要配合回归方程E 、与回归系数密切相关9、可以借助回归系数来确定( )A. 两变量之间的数量因果关系B. 两变量之间的相关方向C. 两变量之间的相关的密切程度D.10、直线回归方程( )A、建立前提条件是现象之间具有较密切的直线相关关系B 、关键在于确定方程中的参数a 和bC 、表明两个相关变量间的数量变动关系D 、可用来根据自变量值推算因变量值,并可进行回归预测E 、回归系数b=0时,相关系数r=011、可用来判断现象相关方向的指标有( )A. 相关系数B. 回归系数C. 回归参数aD. 协方差E. 估计标准误差 12、某种产品的单位成本y (元)与工人劳动生产率x (件/人)之间的回归直线方程Y=50-0.5X ,则( )A 、0.5为回归系数B 、50为回归直线的起点值C 、表明工人劳动生产率每增加1件/人,单位成本平均提高0.5元D 、表明工人劳动生产率每增加1件/人,单位成本平均下降0.5元E 、表明工人劳动生产率每减少1件/人,单位成本平均提高50元13、对于回归系数,下列说法中正确的有( )A. b 是回归直线的斜率B. b 的绝对值介于0-1之间C. bD. bE. b 满足方程组y S ⎪⎩⎪⎨⎧+=+=∑∑∑∑∑2xb x a xy x b na y14、相关关系的特点是()A、现象之间确实存在数量上的依存关系B、现象之间不确定存在数量上的依存关系C、现象之间的数量依存关系值是不确定的D、现象之间的数量依存关系值是确定的E、现象之间不存在数量上的依存关系15、回归方程可用于( )A. 根据自变量预测因变量B. 给定因变量推算自变量C. 给定自变量推算因变量D. 推算时间数列中缺失的数据E. 用于控制因变量16、建立一元线性回归方程是为了()A、说明变量之间的数量变动关系B、通过给定自变量数值来估计因变量的可能值C、确定两个变量间的相关程度D、用两个变量相互推算E、用给定的因变量数值推算自变量的可能值17、在直线回归方程中,两个变量x和y()A、一个是自变量,一个是因变量B、一个是给定的变量,一个是随机变量C、两个都是随机变量D、两个都是给定的变量E、两个是相关的变量18、在直线回归方程中()A、在两个变量中须确定自变量和因变量B、回归系数只能取正值C、回归系数和相关系数的符号是一致的D、要求两个变量都是随机的E、要求因变量是随机的,而自变量是给定的19、现象间的相关关系按相关形式分为()A、正相关B、负相关C、直线相关D、曲线相关E、不相关20、配合一元线性回归方程须具备下列前提条件()A、现象间确实存在数量上的相互依存关系B、现象间的关系是直线关系,这种直线关系可用散点图来表示C、具备一组自变量与因变量的对应资料,且能明确哪个是自变量,哪个是因变量D、两个变量之间不是对等关系E、自变量是随机的,因变量是给定的值21、由直线回归方程y=a+bx所推算出来的y值()A、是一组估计值B、是一组平均值C、是一个等差级数D、可能等于实际值E、与实际值的离差平方和等于0(四)是非题1、判断现象之间是否存在相关关系必须计算相关系数。