首页 高中数学 统计 板块六 回归分析完整讲义(学生版)

高中数学 统计 板块六 回归分析完整讲义(学生版)

举报
开通vip

高中数学 统计 板块六 回归分析完整讲义(学生版)PAGE学而思高中完整讲义:统计.板块六.回归分析.学生版知识内容一.随机抽样1.随机抽样:满足每个个体被抽到的机会是均等的抽样,共有三种经常采用的随机抽样方法:⑴简单随机抽样:从元素个数为的总体中不放回地抽取容量为的样本,如果每一次抽取时总体中的各个个体有相同的可能性被抽到,这种抽样方法叫做简单随机抽样.抽出办法:①抽签法:用纸片或小球分别标号后抽签的方法.②随机数表法:随机数表是使用计算器或计算机的应用程序生成随机数的功能生成的一张数表.表中每一位置出现各个数字的可能性相同.随机数表法是对样本进行编号后,...

高中数学 统计 板块六 回归分析完整讲义(学生版)
PAGE学而思高中完整讲义:统计.板块六.回归分析.学生版知识内容一.随机抽样1.随机抽样:满足每个个体被抽到的机会是均等的抽样,共有三种经常采用的随机抽样方法:⑴简单随机抽样:从元素个数为的总体中不放回地抽取容量为的样本,如果每一次抽取时总体中的各个个体有相同的可能性被抽到,这种抽样方法叫做简单随机抽样.抽出办法:①抽签法:用纸片或小球分别标号后抽签的方法.②随机数 关于同志近三年现实表现材料材料类招标技术评分表图表与交易pdf视力表打印pdf用图表说话 pdf 法:随机数表是使用计算器或计算机的应用程序生成随机数的功能生成的一张数表.表中每一位置出现各个数字的可能性相同.随机数表法是对样本进行编号后,按照一定的规律从随机数表中读数,并取出相应的样本的方法.简单随机抽样是最简单、最基本的抽样方法.⑵系统抽样:将总体分成均衡的若干部分,然后按照预先制定的规则,从每一部分抽取一个个体,得到所需要的样本的抽样方法.抽出办法:从元素个数为的总体中抽取容量为的样本,如果总体容量能被样本容量整除,设,先对总体进行编号,号码从到,再从数字到中随机抽取一个数作为起始数,然后顺次抽取第个数,这样就得到容量为的样本.如果总体容量不能被样本容量整除,可随机地从总体中剔除余数,然后再按系统抽样方法进行抽样.系统抽样适用于大规模的抽样调查,由于抽样间隔相等,又被称为等距抽样.⑶分层抽样:当总体有明显差别的几部分组成时,要反映总体情况,常采用分层抽样,使总体中各个个体按某种特征分成若干个互不重叠的几部分,每一部分叫做层,在各层中按层在总体中所占比例进行简单随机抽样,这种抽样方法叫做分层抽样.分层抽样的样本具有较强的代表性,而且各层抽样时,可灵活选用不同的抽样方法,应用广泛.2.简单随机抽样必须具备下列特点:⑴简单随机抽样要求被抽取的样本的总体个数是有限的.⑵简单随机样本数小于等于样本总体的个数.⑶简单随机样本是从总体中逐个抽取的.⑷简单随机抽样是一种不放回的抽样.⑸简单随机抽样的每个个体入样的可能性均为.3.系统抽样时,当总体个数恰好是样本容量的整数倍时,取;若不是整数时,先从总体中随机地剔除几个个体,使得总体中剩余的个体数能被样本容量整除.因为每个个体被剔除的机会相等,因而整个抽样过程中每个个体被抽取的机会仍然相等,为.二.频率直方图列出样本数据的频率分布表和频率分布直方图的步骤:①计算极差:找出数据的最大值与最小值,计算它们的差;②决定组距与组数:取组距,用决定组数;③决定分点:决定起点,进行分组;④列频率分布直方图:对落入各小组的数据累计,算出各小数的频数,除以样本容量,得到各小组的频率.⑤绘制频率分布直方图:以数据的值为横坐标,以的值为纵坐标绘制直方图,知小长方形的面积=组距×=频率.频率分布折线图:将频率分布直方图各个长方形上边的中点用线段连接起来,就得到频率分布折线图,一般把折线图画成与横轴相连,所以横轴左右两端点没有实际意义.总体密度曲线:样本容量不断增大时,所分组数不断增加,分组的组距不断缩小,频率分布直方图可以用一条光滑曲线来描绘,这条光滑曲线就叫做总体密度曲线.总体密度曲线精确地反映了一个总体在各个区域内取值的规律.三.茎叶图制作茎叶图的步骤:①将数据分为“茎”、“叶”两部分;②将最大茎与最小茎之间的数字按大小顺序排成一列,并画上竖线作为分隔线;③将各个数据的“叶”在分界线的一侧对应茎处同行列出.四.统计数据的数字特征用样本平均数估计总体平均数;用样本 标准 excel标准偏差excel标准偏差函数exl标准差函数国标检验抽样标准表免费下载红头文件格式标准下载 差估计总体标准差.数据的离散程序可以用极差、方差或标准差来描述.极差又叫全距,是一组数据的最大值和最小值之差,反映一组数据的变动幅度;样本方差描述了一组数据平均数波动的大小,样本的标准差是方差的算术平方根.一般地,设样本的元素为样本的平均数为,定义样本方差为,样本标准差简化公式:.五.独立性检验1.两个变量之间的关系;常见的有两类:一类是确定性的函数关系;另一类是变量间存在关系,但又不具备函数关系所要求的确定性,它们的关系是带有一定随机性的.当一个变量取值一定时,另一个变量的取值带有一定随机性的两个变量之间的关系叫做相关关系.2.散点图:将样本中的个数据点描在平面直角坐标系中,就得到了散点图.散点图形象地反映了各个数据的密切程度,根据散点图的分布趋势可以直观地判断分析两个变量的关系.3.如果当一个变量的值变大时,另一个变量的值也在变大,则这种相关称为正相关;此时,散点图中的点在从左下角到右上角的区域.反之,一个变量的值变大时,另一个变量的值由大变小,这种相关称为负相关.此时,散点图中的点在从左上角到右下角的区域.散点图可以判断两个变量之间有没有相关关系.4.统计假设:如果事件与独立,这时应该有,用字母表示此式,即,称之为统计假设.5.(读作“卡方”)统计量:统计学中有一个非常有用的统计量,它的表达式为,用它的大小可以用来决定是否拒绝原来的统计假设.如果的值较大,就拒绝,即认为与是有关的.统计量的两个临界值:、;当时,有的把握说事件与有关;当时,有的把握说事件与有关;当时,认为事件与是无关的.独立性检验的基本思想与反证法类似,由结论不成立时推出有利于结论成立的小概率事件发生,而小概率事件在一次试验中通常是不会发生的,所以认为结论在很大程度上是成立的.1.独立性检验的步骤:统计假设:;列出联表;计算统计量;查对临界值表,作出判断.2.几个临界值:.联表的独立性检验:如果对于某个群体有两种状态,对于每种状态又有两个情况,这样排成一张的表,如下:状态状态合计状态状态如果有调查得来的四个数据,并希望根据这样的个数据来检验上述的两种状态与是否有关,就称之为联表的独立性检验.六.回归分析1.回归分析:对于具有相关关系的两个变量进行统计分析的方法叫做回归分析,即回归分析就是寻找相关关系中这种非确定关系的某种确定性.回归直线:如果散点图中的各点都大致分布在一条直线附近,就称这两个变量之间具有线性相关关系,这条直线叫做回归直线.2.最小二乘法:记回归直线方程为:,称为变量对变量的回归直线方程,其中叫做回归系数.是为了区分的实际值,当取值时,变量的相应观察值为,而直线上对应于的纵坐标是.设的一组观察值为,,且回归直线方程为,当取值时,的相应观察值为,差刻画了实际观察值与回归直线上相应点的纵坐标之间的偏离程度,称这些值为离差.我们希望这个离差构成的总离差越小越好,这样才能使所找的直线很贴近已知点.记,回归直线就是所有直线中取最小值的那条.这种使“离差平方和为最小”的方法,叫做最小二乘法.用最小二乘法求回归系数有如下的公式:,,其中上方加“”,表示是由观察值按最小二乘法求得的回归系数.3.线性回归模型:将用于估计值的线性函数作为确定性函数;的实际值与估计值之间的误差记为,称之为随机误差;将称为线性回归模型.产生随机误差的主要原因有:①所用的确定性函数不恰当即模型近似引起的误差;②忽略了某些因素的影响,通常这些影响都比较小;③由于测量工具等原因,存在观测误差.4.线性回归系数的最佳估计值:利用最小二乘法可以得到的计算公式为,,其中,由此得到的直线就称为回归直线,此直线方程即为线性回归方程.其中,分别为,的估计值,称为回归截距,称为回归系数,称为回归值.5.相关系数:6.相关系数的性质:⑴;⑵越接近于1,的线性相关程度越强;⑶越接近于0,的线性相关程度越弱.可见,一条回归直线有多大的预测功能,和变量间的相关系数密切相关.7.转化思想:根据专业知识或散点图,对某些特殊的非线性关系,选择适当的变量代换,把非线性方程转化为线性回归方程,从而确定未知参数.8.一些备案①回归(regression)一词的来历:“回归”这个词英国统计学家FrancilsGalton提出来的.1889年,他在研究祖先与后代的身高之间的关系时发现,身材较高的父母,他们的孩子也较高,但这些孩子的平均身高并没有他们父母的平均身高高;身材较矮的父母,他们的孩子也较矮,但这些孩子的平均身高却比他们父母的平均身高高.Galton把这种后代的身高向中间值靠近的趋势称为“回归现象”.后来,人们把由一个变量的变化去推测另一个变量的变化的方法称为回归分析.②回归系数的推导过程:,把上式看成的二次函数,的系数,因此当时取最小值.同理,把的展开式按的降幂排列,看成的二次函数,当时取最小值.解得:,,其中,是样本平均数.9.对相关系数进行相关性检验的步骤:①提出统计假设:变量不具有线性相关关系;②如果以的把握作出推断,那么可以根据与(是样本容量)在相关性检验的临界值表中查出一个的临界值(其中称为检验水平);③计算样本相关系数;④作出统计推断:若,则否定,表明有的把握认为变量与之间具有线性相关关系;若,则没有理由拒绝,即就目前数据而言,没有充分理由认为变量与之间具有线性相关关系.说明:⑴对相关系数进行显著性检验,一般取检验水平,即可靠程度为.⑵这里的指的是线性相关系数,的绝对值很小,只是说明线性相关程度低,不一定不相关,可能是非线性相关的某种关系.⑶这里的是对抽样数据而言的.有时即使,两者也不一定是线性相关的.故在统计分析时,不能就数据论数据,要结合实际情况进行合理解释.典例分析题型一线性相关及回归已知变量与之间的相关系数是,查表得到相关系数临界值,要使可靠性不低于,则变量与之间()A.不具有线性相关关系B.具有线性相关关系C.线性相关关系还待进一步确定D.具有确定性关系当相关系数时,表明()A现象之间完全无关B相关程度较小C现象之间完全相关D无直线相关关系下列结论中,能表示变量具有线性相关关系的是()A.B.C.D.下列现象的相关密切程度最高的是()A.某商店的职工人数与商品销售额之间的相关系数B.流通费用水平与利润率之间的相关关系为C.商品销售额与利润率之间的相关系数为D.商品销售额与流通费用水平的相关系数为在吸烟与患肺病这两个分类变量的计算中,下列说法正确的是()①若的值为6.635,我们有的把握认为吸烟与患肺病有关系,那么在100个吸烟的人中必有99人患有肺病;②从独立性检验可知有的把握认为吸烟与患肺病有关系时,我们说某人吸烟,那么他有99%的可能患有肺病;③若从统计量中求出有的把握认为吸烟与患肺病有关系,是指有的可能性使得判断出现错误;④以上三种说法都不正确.设两个变量和之间具有线性相关关系,它们的相关系数是,关于的回归直线的斜率是,纵截距是,那么必有()A.与的符号相同B.与的符号相同C.与的相反D.与的符号相反定义:点与直线的“纵向距离”为.已知三点,存在直线,使三点到直线的“纵向距离的平方和”最小.⑴求直线的方程和的最小值;⑵判断点与直线的位置关系.(2020宁夏海南卷理)对变量,有观测数据,得散点图1;对变量,有观测数据,得散点图2.由这两个散点图可以判断.A.变量与正相关,与正相关B.变量与正相关,与负相关C.变量与负相关,与正相关D.变量与负相关,与负相关为了考查两个变量和之间的线性关系,甲、乙两位同学各自独立做了次和次的试验,并且利用线性回归方法求得回归直线分别为,已知两人得到的试验数据中,变量和的数据的平均值都对应相等,那么下列说法正确的是(  )A.直线和一定有交点B.直线一定平行于直线C.直线一定与重合D.以上都不对某地高校教育经费与高校学生人数连续6年的统计资料如下:教育经费(万元)316343373393418455在校学生(万人)111618202225试求回归直线方程,估计教育经费为500万元时的在校学生数.一家庭问题研究机构想知道是否夫妻所受的教育越高越不愿生孩子,现随机抽样了对夫妻,计算夫妻所受教育的总年数与孩子数,得结果如下191721181512142013112321试求对回归直线方程.某种产品的广告费支出与销售额(单位:百万元)之间有如下对应数据:⑴画出散点图;⑵求回归直线方程.某五星级大饭店的住屋率与每天每间客房的成本(元)如下:1007565555020002500280032004000⑴试求对回归直线;⑵若的表示不变,以小数表示(如表为),求新的回归直线.某兴趣小组欲研究昼夜温差大小与患感冒人数多少之间的关系,他们分别到气象局与某医院抄录了至月份每月号的昼夜温差情况与因患感冒而就诊的人数,得到如下资料:日期月日月日月日月日月日月日昼夜温差()就诊人数(个)该兴趣小组确定的研究 方案 气瓶 现场处置方案 .pdf气瓶 现场处置方案 .doc见习基地管理方案.doc关于群访事件的化解方案建筑工地扬尘治理专项方案下载 是:先从这六组数据中选取组,用剩下的组数据求线性回归方程,再用被选取的组数据进行检验.⑴若选取的月与月的两组数据,请根据至月份的数据,求出关于的线性回归方程;⑵若由线性回归方程得到的估计数据与所选出的检验数据的误差均不超过人,则认为得到的线性回归方程是理想的,试问该小组所得线性回归方程是否理想?某种产品的产量与单位在成本的资料如下:产量(千件)234345单位成本(元/件)737271736968试求:⑴计算相关系数;⑵对直线回归方程;⑶指出产量每增加件时,单位成本平均下降了多少元?求回归直线方程以下是收集到的某城市的新房屋销售价格与房屋的大小的数据:房屋大小()销售价格(万元)⑴画出数据的散点图;⑵用最小二乘法求回归直线方程;⑶估计该城市一个平米的房屋销售价格大约为多少?⑷写一个程序,计算出和的值,再比较大小.(07广东)下表提供了某厂节能降耗技术改造后生产甲产品过程中记录的产量(吨)与相应的生产能耗(吨标准煤)的几组对照数据345634⑴请画出上表数据的散点图;⑵请根据上表提供的数据,用最小二乘法求出关于的线性回归方程;⑶已知该厂技改前100吨甲产品的生产能耗为90吨标准煤.试根据(2)求出的线性回归方程,预测生产100吨甲产品的生产能耗比技改前降低多少吨标准煤?(参考数值:)测定某肉鸡的生长过程,每两周记录一次鸡的重量,数据如下表:(周)2468101214()由经验知生长曲线为,试求对的回归曲线方程.为了研究某种细菌随时间x变化的繁殖个数,收集数据如下:天数123456繁殖个数612254995190⑴作出这些数据的散点图;⑵求出y对x的回归方程.
本文档为【高中数学 统计 板块六 回归分析完整讲义(学生版)】,请使用软件OFFICE或WPS软件打开。作品中的文字与图均可以修改和编辑, 图片更改请在作品中右键图片并更换,文字修改请直接点击文字进行修改,也可以新增和删除文档中的内容。
该文档来自用户分享,如有侵权行为请发邮件ishare@vip.sina.com联系网站客服,我们会及时删除。
[版权声明] 本站所有资料为用户分享产生,若发现您的权利被侵害,请联系客服邮件isharekefu@iask.cn,我们尽快处理。
本作品所展示的图片、画像、字体、音乐的版权可能需版权方额外授权,请谨慎使用。
网站提供的党政主题相关内容(国旗、国徽、党徽..)目的在于配合国家政策宣传,仅限个人学习分享使用,禁止用于任何广告和商用目的。
下载需要: 免费 已有0 人下载
最新资料
资料动态
专题动态
个人认证用户
言言无悔一生
暂无简介~
格式:doc
大小:1MB
软件:Word
页数:9
分类:高中数学
上传时间:2022-01-20
浏览量:0