收藏 分销(赏)

2021高考数学总复习专题系列——统计.板块三.茎叶图.学生版-Word版含答案.docx

上传人:人****来 文档编号:3797584 上传时间:2024-07-18 格式:DOCX 页数:4 大小:413.51KB 下载积分:5 金币
下载 相关 举报
2021高考数学总复习专题系列——统计.板块三.茎叶图.学生版-Word版含答案.docx_第1页
第1页 / 共4页
2021高考数学总复习专题系列——统计.板块三.茎叶图.学生版-Word版含答案.docx_第2页
第2页 / 共4页


点击查看更多>>
资源描述
板块三.茎叶图 学问内容 一.随机抽样 1.随机抽样:满足每个个体被抽到的机会是均等的抽样,共有三种经常接受的随机抽样方法: ⑴简洁随机抽样:从元素个数为的总体中不放回地抽取容量为的样本,假如每一次抽取时总体中的各个个体有相同的可能性被抽到,这种抽样方法叫做简洁随机抽样. 抽出方法:①抽签法:用纸片或小球分别标号后抽签的方法. ②随机数表法:随机数表是使用计算器或计算机的应用程序生成随机数的功能生成的一张数表.表中每一位置毁灭各个数字的可能性相同. 随机数表法是对样本进行编号后,依据确定的规律从随机数表中读数,并取出相应的样本的方法. 简洁随机抽样是最简洁、最基本的抽样方法. ⑵系统抽样:将总体分成均衡的若干部分,然后依据预先制定的规章,从每一部分抽取一个个体,得到所需要的样本的抽样方法. 抽出方法:从元素个数为的总体中抽取容量为的样本,假如总体容量能被样本容量整除,设,先对总体进行编号,号码从到,再从数字到中随机抽取一个数作为起始数,然后顺次抽取第个数,这样就得到容量为的样本.假如总体容量不能被样本容量整除,可随机地从总体中剔除余数,然后再按系统抽样方法进行抽样. 系统抽样适用于大规模的抽样调查,由于抽样间隔相等,又被称为等距抽样. ⑶分层抽样:当总体有明显差别的几部分组成时,要反映总体状况,常接受分层抽样,使总体中各个个体按某种特征分成若干个互不重叠的几部分,每一部分叫做层,在各层中按层在总体中所占比例进行简洁随机抽样,这种抽样方法叫做分层抽样. 分层抽样的样本具有较强的代表性,而且各层抽样时,可机敏选用不同的抽样方法,应用广泛. 2.简洁随机抽样必需具备下列特点: ⑴简洁随机抽样要求被抽取的样本的总体个数是有限的. ⑵简洁随机样本数小于等于样本总体的个数. ⑶简洁随机样本是从总体中逐个抽取的. ⑷简洁随机抽样是一种不放回的抽样. ⑸简洁随机抽样的每个个体入样的可能性均为. 3.系统抽样时,当总体个数恰好是样本容量的整数倍时,取; 若不是整数时,先从总体中随机地剔除几个个体,使得总体中剩余的个体数能被样本容量整除.由于每个个体被剔除的机会相等,因而整个抽样过程中每个个体被抽取的机会照旧相等,为. 二.频率直方图 列出样本数据的频率分布表和频率分布直方图的步骤: ①计算极差:找出数据的最大值与最小值,计算它们的差; ②打算组距与组数:取组距,用打算组数; ③打算分点:打算起点,进行分组; ④列频率分布直方图:对落入各小组的数据累计,算出各小数的频数,除以样本容量,得到各小组的频率. ⑤绘制频率分布直方图:以数据的值为横坐标,以的值为纵坐标绘制直方图, 知小长方形的面积=组距×=频率. 频率分布折线图:将频率分布直方图各个长方形上边的中点用线段连接起来,就得到频率分布折线图,一般把折线图画成与横轴相连,所以横轴左右两端点没有实际意义. 总体密度曲线:样本容量不断增大时,所分组数不断增加,分组的组距不断缩小,频率分布直方图可以用一条光滑曲线来描绘,这条光滑曲线就叫做总体密度曲线.总体密度曲线精确地反映了一个总体在各个区域内取值的规律. 三.茎叶图 制作茎叶图的步骤: ①将数据分为“茎”、“叶”两部分; ②将最大茎与最小茎之间的数字按大小挨次排成一列,并画上竖线作为分隔线; ③将各个数据的“叶”在分界线的一侧对应茎处同行列出. 四.统计数据的数字特征 用样本平均数估量总体平均数;用样本标准差估量总体标准差. 数据的离散程序可以用极差、方差或标准差来描述. 极差又叫全距,是一组数据的最大值和最小值之差,反映一组数据的变动幅度; 样本方差描述了一组数据平均数波动的大小,样本的标准差是方差的算术平方根. 一般地,设样本的元素为样本的平均数为, 定义样本方差为, 样本标准差 简化公式:. 五.独立性检验 1.两个变量之间的关系; 常见的有两类:一类是确定性的函数关系;另一类是变量间存在关系,但又不具备函数关系所要求的确定性,它们的关系是带有确定随机性的.当一个变量取值确定时,另一个变量的取值带有确定随机性的两个变量之间的关系叫做相关关系. 2.散点图:将样本中的个数据点描在平面直角坐标系中,就得到了散点图. 散点图形象地反映了各个数据的亲热程度,依据散点图的分布趋势可以直观地推断分析两个变量的关系. 3.假如当一个变量的值变大时,另一个变量的值也在变大,则这种相关称为正相关;此时,散点图中的点在从左下角到右上角的区域. 反之,一个变量的值变大时,另一个变量的值由大变小,这种相关称为负相关.此时,散点图中的点在从左上角到右下角的区域. 散点图可以推断两个变量之间有没有相关关系. 4.统计假设:假如大事与独立,这时应当有,用字母表示此式,即,称之为统计假设. 5.(读作“卡方”)统计量: 统计学中有一个格外有用的统计量,它的表达式为,用它的大小可以用来打算是否拒绝原来的统计假设.假如的值较大,就拒绝,即认为与是有关的. 统计量的两个临界值:、;当时,有的把握说大事与有关;当时,有的把握说大事与有关;当时,认为大事与是无关的. 独立性检验的基本思想与反证法类似,由结论不成立时推出有利于结论成立的小概率大事发生,而小概率大事在一次试验中通常是不会发生的,所以认为结论在很大程度上是成立的. 1.独立性检验的步骤:统计假设:;列出联表;计算统计量;查对临界值表,作出推断. 2.几个临界值:. 联表的独立性检验: 假如对于某个群体有两种状态,对于每种状态又有两个状况,这样排成一张的表,如下: 状态 状态 合计 状态 状态 假如有调查得来的四个数据,并期望依据这样的个数据来检验上述的两种状态与是否有关,就称之为联表的独立性检验. 六.回归分析 1.回归分析:对于具有相关关系的两个变量进行统计分析的方法叫做回归分析,即回归分析就是查找相关关系中这种非确定关系的某种确定性. 回归直线:假如散点图中的各点都大致分布在一条直线四周,就称这两个变量之间具有线性相关关系,这条直线叫做回归直线. 2.最小二乘法: 记回归直线方程为:,称为变量对变量的回归直线方程,其中叫做回归系数. 是为了区分的实际值,当取值时,变量的相应观看值为,而直线上对应于的纵坐标是. 设的一组观看值为,,且回归直线方程为, 当取值时,的相应观看值为,差刻画了实际观看值与回归直线上相应点的纵坐标之间的偏离程度,称这些值为离差. 我们期望这个离差构成的总离差越小越好,这样才能使所找的直线很贴近已知点. 记,回归直线就是全部直线中取最小值的那条. 这种使“离差平方和为最小”的方法,叫做最小二乘法. 用最小二乘法求回归系数有如下的公式: ,,其中上方加“”,表示是由观看值按最小二乘法求得的回归系数. 3.线性回归模型:将用于估量值的线性函数作为确定性函数;的实际值与估量值之间的误差记为,称之为随机误差;将称为线性回归模型. 产生随机误差的主要缘由有: ①所用的确定性函数不恰当即模型近似引起的误差; ②忽视了某些因素的影响,通常这些影响都比较小; ③由于测量工具等缘由,存在观测误差. 4.线性回归系数的最佳估量值: 利用最小二乘法可以得到的计算公式为 ,,其中, 由此得到的直线就称为回归直线,此直线方程即为线性回归方程.其中,分别为,的估量值,称为回归截距,称为回归系数,称为回归值. 5.相关系数: 6.相关系数的性质: ⑴; ⑵越接近于1,的线性相关程度越强; ⑶越接近于0,的线性相关程度越弱. 可见,一条回归直线有多大的猜想功能,和变量间的相关系数亲热相关. 7.转化思想: 依据专业学问或散点图,对某些特殊的非线性关系,选择适当的变量代换,把非线性方程转化为线性回归方程,从而确定未知参数. 8.一些备案 ①回归(regression)一词的来历:“回归”这个词英国统计学家Francils Galton提出来的.1889年,他在争辩祖先与后代的身高之间的关系时发觉,身材较高的父母,他们的孩子也较高,但这些孩子的平均身高并没有他们父母的平均身高高;身材较矮的父母,他们的孩子也较矮,但这些孩子的平均身高却比他们父母的平均身高高.Galton把这种后代的身高向中间值靠近的趋势称为“回归现象”.后来,人们把由一个变量的变化去推想另一个变量的变化的方法称为回归分析. ②回归系数的推导过程: , 把上式看成的二次函数,的系数, 因此当时取最小值. 同理,把的开放式按的降幂排列,看成的二次函数,当时取最小值. 解得:,, 其中,是样本平均数. 9. 对相关系数进行相关性检验的步骤: ①提出统计假设:变量不具有线性相关关系; ②假如以的把握作出推断,那么可以依据与(是样本容量)在相关性检验的临界值表中查出一个的临界值(其中称为检验水平); ③计算样本相关系数; ④作出统计推断:若,则否定,表明有的把握认为变量与之间具有线性相关关系;若,则没有理由拒绝,即就目前数据而言,没有充分理由认为变量与之间具有线性相关关系. 说明: ⑴对相关系数进行显著性检验,一般取检验水平,即牢靠程度为. ⑵这里的指的是线性相关系数,的确定值很小,只是说明线性相关程度低,不愿定不相关,可能是非线性相关的某种关系. ⑶这里的是对抽样数据而言的.有时即使,两者也不愿定是线性相关的.故在统计分析时,不能就数据论数据,要结合实际状况进行合理解释. 典例分析 题型一 茎叶图 【例1】 (2010丰台二模) 甲、乙两名运动员的次测试成果如下图所示 设分别表示甲、乙两名运动员测试成果的标准差,分别表示甲、乙两名运动员测试成果的平均数,则有( ) A., B., C., D., 【例2】 (2010宣武二模) 随机抽取某中学甲,乙两班各10名同学,测量他们的身高(单位:cm),获得身高数据的茎叶图如图 ,则下列关于甲,乙两班这10名同学身高的结论正确的是 ( ) A. 甲班同学身高的方差较大 B. 甲班同学身高的平均值较大 C. 甲班同学身高的中位数较大 D. 甲班同学身高在175以上的人数较多 【例3】 (2010天津高考) 甲、乙两人在10天中每天加工零件的个数用茎叶图表示如下图,中间一列的数字表示零件个数的十位数,两边的数字表示零件个数的个位数,则这10天甲、乙两人日加工零件的平均数分别为 和 . 【例4】 右图是某赛季甲、乙两名篮球运动员每场竞赛得分的茎叶图, 则甲、乙两人这几场竞赛得分的中位数之和是( ) A. B. C. D. 【例5】 在某五场篮球竞赛中,甲、乙两名运动员得分的茎叶图如右.下列说法正确的是 A.在这五场竞赛中,甲的平均得分比乙好,且甲比乙稳定 B.在这五场竞赛中,甲的平均得分比乙好,但乙比甲稳定 C.在这五场竞赛中,乙的平均得分比甲好,且乙比甲稳定 D.在这五场竞赛中,乙的平均得分比甲好,但甲比乙稳定 【例6】 (2009年福建12) 作品 8 9 8 9 9 2 3 2 1 4 某校开展“爱我海西、爱我家乡”摄影竞赛,位评委为参赛作品给出的分数如茎叶图所示,记分员在去掉一个最高分和一个最低分后,算得平均分为,复核员在复核时,发觉有一个数字(茎叶图中的)无法看清.若记分员计算无误,则数字应当是 . 【例7】 (2010东城一模) 在一次数学统考后,某班随机抽取名同学的成果进行样本分析,获得成果数据的茎叶图如下. ⑴计算样本的平均成果及方差; ⑵在这个样本中,现从不低于分的成果中随机抽取个,求分的成果被抽中的概率. 【例8】 某班甲、乙两同学的高考备考成果如下: 甲: 乙: ⑴用茎叶图表示两同学的成果; ⑵分别求两同学成果的中位数和平均分. 【例9】 某电脑杂志的一篇文章中,每个句子的字数如下: , 某报纸的一篇文章中,每个句子所含的字数如下: . ⑴将两组数据用茎叶图表示; ⑵比较分析,能得到什么结论? 【例10】 (2009广东18) 随机抽取某中学甲乙两班各名同学,测量他们的身高(单位:cm),获得身高数据的茎叶图如图. ⑴依据茎叶图推断哪个班的平均身高较高; ⑵计算甲班的样本方差. ⑶现从乙班这名同学中随机抽取两名身高不低于的同学,求身高为的同学被抽中的概率.
展开阅读全文

开通  VIP会员、SVIP会员  优惠大
下载10份以上建议开通VIP会员
下载20份以上建议开通SVIP会员


开通VIP      成为共赢上传

当前位置:首页 > 考试专区 > 高考

移动网页_全站_页脚广告1

关于我们      便捷服务       自信AI       AI导航        抽奖活动

©2010-2025 宁波自信网络信息技术有限公司  版权所有

客服电话:0574-28810668  投诉电话:18658249818

gongan.png浙公网安备33021202000488号   

icp.png浙ICP备2021020529号-1  |  浙B2-20240490  

关注我们 :微信公众号    抖音    微博    LOFTER 

客服