2.2.1用样本估计总体
2.2.1用样本的频率分布估计总体分布01学案
学习课题:2.2.1用样本的频率分布估计总体分布(1)※学习目标1.通过实例体会分布的意义和作用;2. 在表示样本数据的过程中,学会列频率分布表,画频率分布直方图;3. 通过实例体会频率分布直方图的各自特征,从而会用上述方法分析样本的分布,准确地做出总体估计。
※课前准备(阅读课本P65-P67)※探索新知探究1:考察课本表2-1这组数据的最大值、最小值分别是什么?极差是什么?样本数据的范围是多少?探究2:怎样决定一个样本的组距与组数?请你把表2-1进行适当的分组。
探究3:根据你决定的组距与组数,将表2-1数据分组。
探究4:统计各小组的个数,即频数,然后计算各个小组的频率,并列出频率分布表。
探究5:选取适当的单位长度,画频率分布直方图。
试一试:1、频率的计算公式是怎样的?若某个小组的频率是0.3,样本容量是50,则该小组的频数的多少?2、频率分布直方图中的各个小长方形的面积表示相应各组的____________;个小长方形的面积之和为__________,即个小组的频率之和为________。
3、你能从频率分布直方图获取哪些信息?※典型例题下表给出了某校500名12岁男孩中用随机抽样得出的120人的身高(单位cm)(1)列出样本频率分布表;(2)画出频率分布直方图;(3)试从你所画的频率分布直方图计算[134,138)这一组的频率。
※学习小结1、画频率分布直方图的的步骤是怎样的?2、根据样本数据的频率分布,可以推测总体的频率分布。
※ 当堂检测(ABC 班完成)1、若一个样本的最大值是93,最小值是54,则该样本的极差是( )A .39B .49C .-39D .-492、若一个样本的极差为12.4,组距为2,则该组数据分成的组数是( )A .5B .6C .7D .83、将一组数据分成6组,若第1,2,3,5,6组的频率分别为0.1,0.15,0.2,0.2,0.15,0.05,则第4组的频率是( )A .0.1B .0.15C .0.2D .0.05 4、观察新生婴儿的体重,其频率分布直方图如图所示,则新生婴儿体重在(]2700,3000的频率为 ;如果所观察的新生儿共有2000人,则体重在(]2700,3000的人数是______5、为了了解高一学生的体能情况,某校抽取部分学生进行一分钟跳绳次数的测试,将所得数据整理后,画出频率分布直方图(如图),图中从左到右各小长方形面积之比为2:4:17:15:9:3,第二小组频数为12.(1)二小组的频率是多少?样本容量是多少? (2)若次数在110以上(含110次)为达标,试估计该学校全体高一学生的达标率是多少?※ 延伸拓展(AB 班完成)为了了解初三学生女生身高情况,某中学对初三女生身高进行了一次测量,所得数据整理后列出则______,______,______,______m n M N ====。
【优化方案】2012高中数学 第2章2.2.1用样本的频率分布估计总体分布课件 新人教A版必修3
课堂互动讲练
考点突破 频率分布表、 频率分布表、频率分布直方图及折 线图 频率分布表是反映总体频率分布的表格, 频率分布表是反映总体频率分布的表格, 一般内容有数据的分组、频率的统计、 一般内容有数据的分组、频率的统计、频 数和频率等内容.根据这个表格, 数和频率等内容.根据这个表格,就可以 在坐标系中画频率分布直方图. 在坐标系中画频率分布直方图.
4.茎叶图的特点 . 当样本数据较少时, 当样本数据较少时,用茎叶图表示数据 的效果较好,它不但可以保留所有信息, 的效果较好,它不但可以保留所有信息, 而且可以随时记录, 而且可以随时记录,给数据的记录和表 示都带来了方便. 示都带来了方便.
问题探究 1.什么是总体分布? .什么是总体分布? 提示: 总体分布是指总体取值的分布规律, 提示 : 总体分布是指总体取值的分布规律 , 即 某小组数据在总体数据中所占的比例大小. 某小组数据在总体数据中所占的比例大小. 2.在一组测量长度的数据 单位:cm)中最小数 单位: .在一组测量长度的数据(单位 中最小数 据为15.2, 最大数据为 据为 , 最大数据为20.3, 如果组距为 , 那 , 如果组距为1, 么画频率分布直方图时, 可分为几组较好? 么画频率分布直方图时 , 可分为几组较好 ? 第 一组数据及最后一组数据,如何限定区间? 一组数据及最后一组数据,如何限定区间? 提示:因为20.3-15.2=5.1,可分为 组,第一 提示:因为 - = ,可分为6组 组可限定为(15.1,16.1),最后一组为 组可限定为 , (20.1,21.1). .思维总结】 【思维总结】绘制茎叶图的关键是分清茎和
一般地说, 如果数据是整数(至少为两位 叶 . 一般地说 , 如果数据是整数 至少为两位 数 )的 , 除个位数字以外的其它数字为 “ 茎 ” , 的 除个位数字以外的其它数字为“ 个位数字为“ 如果是小数的, 个位数字为“叶”;如果是小数的,通常把整 数部分作为“ 小数部分作为“ 数部分作为“茎”,小数部分作为“叶”.解 题时要根据数据特点合理选择茎和叶. 题时要根据数据特点合理选择茎和叶.
人教高中数学必修三2.2.1用样本的频率分布估计总体分布课件
频率散布直方图以面积的情势反应了数据落在 各个小组的频率的大小.
作业
1、课时训练 P73 2、探究咱班学生的身高
散布情况 3、探究频率散布折线图和
总密度曲线
频率 组距 0.5 0.4 0.3 0.2 0.1
宽度:组距
高度:
频率 组距
O 0.5 1 1.5 2 2.5 3 3.5 4 4.5 月均用水量/t
画频率散布直方图
频率/组距
注意:
① 这里的纵坐标不是频率, 而是频率/组距;
0.50 0.40
0.50 ② 某个区间上的频率用
0.44
这个区间矩形的面积表示;
2.2.1用样本的频率散布 估计总体散布
学习目标
1、理解并学会画频率散布表; 2、掌握频率散布直方图的画法,
并能理解在频率散布直方图 中用面积表示频率。
一、复习回顾
1.我们已经学习了哪些抽样的方法?
简单随机抽样
系统抽样
分层抽样
随机抽样是收集数据的方法,如何通过 样本数据所包含的信息,估计总体的基 本特征,即用样本估计总体,是我们需 要进一步学习的内容.
二、样本估计总体的方法
一般分成两种: ①用样本的频率散布估计总体的散布. ②用样本的数字特征(如平均数、标准差 等)估计总体的数字特征.
• 我国是世界上严重缺水的国家之一。
如何划在本市试
行居民生活用水定额管理,即确定一个居民月用 水量标准a , 用水量不超过a的部分按平价收费,超 过a的部分按议价收费。
思考:由上表,大家可以得到什么信息?
三、样本分析
一般通过表、图、计算来分析 数据,帮助我们找出样本数据中的 规律,使数据所包含的信息转化成 直观的容易理解的情势。
高中数学人教新课标B版必修3--《2.2.1用样本的频率分布估计总体的分布》课件4
1
解1:总睡眠时间约为 6.25×5+6.75×17 +7.25×33+7.75×37+8.25×6+8.75×2 =739(h)
故平均睡眠时间约为7.39h 解2:求各组中值与对应频率之积的和, 6.25×0.05+6.75×0.17+7.25×0.33+7.75× 37+8.25×0.06+8.75×0.02 =7.39(h)
解:估计该单位职工的平均年收入为 12500×10%+17500×15%+22500×20%+ 27500×25%+32500×15%+37500×10%+ 45000×5%=26125(元) 答:估计该单位人均年收入约为26125元.
练习题: 1.若M个数的平均数是x,N个数的平均数
Mx Ny
(2)中位数不受少数几个极端数据的影 响,容易计算,它仅利用了数据中排在中 间的数据的信息。当样本数据质量比较差, 即存在一些错误数据时,应该用抗极端数 据强的中位数表示数据的中心值。
(3)平均数受样本中的每一个数据的影 响,“越离群”的数据,对平均数的影响 也越大,与众数和中位数相比,平均数代 表了数据更多的信息,当样本数据质量比 较差时,使用平均数描述数据的中心位置 可能与实际情况产生较大的误差。
2.2.2 用样本的数字特征估计 总体的数字特征(一)
一、众数、中位数、平均数
(1)众数:在样本数据中,频率散布最 大值所对应的样本数据或出现次数最多的 那个数据。
(2)中位数:样本数据中,累计频率为 0.5时所对应的样本数据或将数据按大小 排列,位于最中间的数据(如果数据的个 数为偶数,就取当中两个数据的平均数作 为中位数)。
人教a版必修三:《2.2.1用样本的频率分布估计总体分布(2)》ppt课件(33页)
明目标、知重点
填要点、记疑点
主目录
探要点、究所然
当堂测、查疑缺
探要点、究所然
2.2.1(二)
探究点二:茎叶图
思考3 一般地,画出一组样本数据的茎叶图的步骤如何?
答 第一步,将每个数据分为“茎”(高位)和“叶”(低位)两部分;
第二步,将最小的茎和最大的茎之间的数按大小次序排成一列,写在左(右)侧; 第三步,将各个数据的叶按次序写在茎右(左)侧.
第二章 统 计
§2.2 用样本估计总体
2.2.1 用样本的频率分布估计总体分布(二)
本节知识目录
2.2.1(二)
用样本
明目标、知重点
的频率
分布估
填要点、记疑点 探究点一 探要点、究所然 探究点二 当堂测、查疑缺 频率分布折线图、总体 密度曲线的概念 茎叶图
计总体
分布
(二)
明目标、知重点
填要点、记疑点
中称这条光滑曲线为总体密度曲线.那么下图中阴影部分的面积有何实际意义?
答 图中阴影部分的面积,就是总体在区间(a,b)内的取值的百分比.
明目标、知重点 填要点、记疑点
主目录
探要点、究所然
当堂测、查疑缺
探要点、究所然
2.2.1(二)
探究点一:频率分布折线图、总体密度曲线的概念
思考 5
对于一个总体,如果存在总体密度曲线,能否通过样本数据准确地画出总
明目标、知重点 填要点、记疑点
主目录
B.x甲>x乙;甲比乙成绩稳定 D.x甲<x乙;甲比乙成绩稳定
探要点、究所然 当堂测、查疑缺
探要点、究所然
2.2.1(二)
探究点二:茎叶图
解析 从茎叶图可知,甲五次成绩中一次茎为8,一次茎为9,而乙五次成绩中,茎 8和茎9各两次,故可知x甲<x乙,乙比甲成绩稳定.
2.2.1用样本的频率分布估计总体分布
分 组 [0,0.5) [0,0.5) [0.5, [0.5,1) [1,1.5) [1,1.5) [1.5, [1.5,2) [2,2.5) [2,2.5) [2.5, [2.5,3) [3,3.5) [3,3.5) [3.5, [3.5,4) [4, [4,4.5] 合计
频数 4 正 8 正 正 正 15 正 正 正 正 22 正 正 正 正 正 25 正 正 14 正 一 6 4 2 100
1.9 0.3 0.5 0.6 0.8 0.7 0.9 0.5 0.8 0.6
1.6 0.4 3.8 4.1 4.3 2.0 2.3 2.4 2.4 2.2
思考1 上述100个数据中的最大值和最 思考1:上述100个数据中的最大值和最 100 小值分别是什么? 小值分别是什么?由此说明样本数据的 变化范围是什么? 变化范围是什么? 0.2~ 0.2~4.3 思考2:样本数据中的最大值和最小值 思考2 的差称为极差 如果将上述100 极差. 100个数据 的差称为极差.如果将上述100个数据 组距为0.5进行分组 进行分组, 按组距为0.5进行分组,那么这些数据 共分为多少组? 共分为多少组? 4.3-0.2) (4.3-0.2)÷0.5=8.2
上图称为频率分布直方图, 上图称为频率分布直方图,其中横轴 频率分布直方图 表示月均用水量,纵轴表示频率/组距. 表示月均用水量,纵轴表示频率/组距. 频率分布直方图中各小长方形的和高 度在数量上有何特点? 度在数量上有何特点?
思考2 思考2:频率分布直方图中各小长方形的 面积表示什么? 面积表示什么?各小长方形的面积之和 为多少? 为多少?
频率 组距 0.5 0.4 0.3 0.2 0.1
O
0.5 1 1.5 2 2.5 3 3.5 4 4.5
2.2.1用样本的频率分布估计总体的分布课件(刘爱娟,2014.2.26)
• • • • • • • • • •
25.39 25.41 25.40 25.37 25.35 25.40 25.36 25.41 25.47 25.40
25.36 25.43 25.39 25.44 25.32 25.43 25.42 25.32 25.34 25.35
25.34 25.44 25.41 25.33 25.45 25.44 25.39 25.38 25.30 25.41
1.将每个数据分为茎(高位)和叶(低位) 两部分,在此例中,茎为十位上的数字, 叶为个位上的数字. 2.将最小茎和最大茎之间的数按大小次序 排成一列,写在中间. 3.将各个数据的叶按大小次序写在其茎的 左(右)侧.
用茎叶图表示数据的优点
一是从统计图上没有原始信息的损失,所 有的数据信息都可以从茎叶图中得到; 二是茎叶图可以在比赛是随时记录,方便 记录与表示。但茎叶图只便于表示两位有 效数字的数据,虽然可以表示两个人以上 的比赛结果(或两个以上的记录),但没 有表示两个记录那么直观、清晰
二、频率分布折线图
把频率分布直方图各个长方形上边的中点用线段 连接起来,就得到分布折线图。
三、总体密度曲线
• 频率分布直方图表明了所抽取的100件产品中, 尺寸落在各个小组内的频率大小.样本容量越大, 所分组数越多,各组的频率就越接近于总体在相 应各组取值的概率.设想样本容量无限增大,分
组的组距无限缩小,则频率分布直方图就会无限 接近于一条光滑曲线——总体密度曲线.它反映 了总体在各个范围内取值的规率.总体密度曲线
3、甲乙两个小组各10名学生的英语口语测试成绩如下(单位:分)
甲组 76 乙组 82 90 84 84 85 86 89 81 79 87 80 86 91 82 89 85 79 83 74
2.2.1 用样本的频率分布估计总体分布(共54张PPT)
题型三
易错辨析
【例题 3】有一同型号的汽车 100 辆,为了了解这种汽车的耗油情况, 现从中随机抽取 10 辆在同一条件下进行耗油 1L 所行驶路程的试验, 得到的数据(单位:km)频率分布表如下: 分组 频数 频率 [12.45,12.95) 2 0.2 [12.95,13.45) 3 0.3 [13.45,13.95) 4 0.4 [13.95,14.45] 1 0.1 合计 10 1.0 试画出频率分布直方图.
解:甲、乙两人数学成绩的茎叶图如图所示. 从这个茎叶图上可以看出,乙同学的得分情况是大致对称的,中 位数是 98;甲同学的得分情况除一个特殊得分外,也大致对称,中位 数是 88.因此乙同学发挥比较稳定,总体得分情况比甲同学好.
用茎叶图表示数据的特点如下: ①用茎叶图表示数据有两个突出的优点,一是统计图上没有原始信 息的损失,所有的数据信息都可以从茎叶图中得到;二是茎叶图可以 在比赛时随时记录,用 3| 389 就表示了 33,38,39 这 3 个数据,方便记 录与表示.但茎叶图只便于表示两位有效数字的数据,虽然可以表示 两个人以上的比赛结果(或两个以上的记录),但没有表示两个记录 那么直观、清晰. ②茎叶图在样本数据较少,较为集中且位数不多时比较适用.由于它 较好地保留了原始数据,所以可以帮助分析样本数据的大致频率分 布,还可以用来分析样本数据的一些数字特征,如众数、中位数、平 均数等.
分析:依据步骤画出频率分布直方图;用样本中的百分比(即频率)来 估计长度在 5.75~6.05cm 之间的麦穗在这批麦穗中所占的百分比. 解:步骤是: (1)计算极差,7.4-4.0=3.4(cm). (2)决定组距与组数. 3.4 1 若取组距为 0.3cm,由于 =11 ,需分成 12 组,组数合适.于是取
课件6:2.2.1 用样本的频率分布估计总体的分布
[思路探索] 根据画频率分布直方图的步骤先画频率分布直方图,再 画折线图.
解 (1)频率分布表如下:
分组
频数 频率
[10.75,10.85)
3Байду номын сангаас
0.03
[10.85,10.95)
9
0.09
[10.95,11.05) [11.05,11.15) [11.15,11.25) [11.25,11.35) [11.35,11.45) [11.45,11.55) [11.55,11.65]
题型二 频率的分布直方图的应用 例2.(1)为了帮助班上的两名贫困生解决经济困难,班上的20名同学捐出 了自己的零花钱,他们捐款数(单位:元)如下:19,20,25,30,24, 23,25,29,27,27,28,28,26,27,21,30,20,19,22,20.班主 任老师准备将这组数据制成频率分布直方图,以表彰他们的爱心.制图 时先计算最大值与最小值的差是________.若取组距为2,则应分成 ________组;若第一组的起点定为18.5,则在[26.5,28.5)内的频数为 ________. (2)将容量为100的某个样本数据拆分为10组,若前七组的频率之和为0.79, 而剩下的三组中频率依次相差0.05,则剩下的三组中频率最大的一组的 频率为________.
(4)数据小于11.20的可能性即数据小于11.20的频率,设为x, 则(x-0.41)÷(11.20-11.15) =(0.67-0.41)÷(11.25-11.15), 所以x-0.41=0.13,即x=0.54, 从而估计数据小于11.20的可能性是54%.
变式3.美国历届总统中,就任时年纪最小的是罗斯福,他于1901年 就任,当时年仅42岁;就任时年纪最大的是里根,他于1981年就 任,当时69岁.下面按时间顺序(从1789年的华盛顿到2009年的奥 巴马,共44任)给出了历届美国总统就任时的年龄: 57,61,57,57,58,57,61,54,68,51,49,64,50,48, 65,52,56,46,54,49,51,47,55,55,54,42,51,56, 55,51,54,51,60,62,43,55,56,61,52,69,64,46, 54,48 (1)将数据进行适当的分组,并画出相应的频率分布直方图和频率 分布折线图. (2)用自己的语言描述一下历届美国总统就任时年龄的分布情况.
人教A版必修3《2.2.1用样本的频率分布估计总体分布》优化训练ppt课件
(1)列出样本频率分布表; (2)画出频率分布直方图. 解:(1)在样本数据中,最大值是 518,最小值是 483,极 差为 35.
35 3 若取组距为 4,则 4 =84,要分为 9 组,组数合适,故取
组距为 4,分 9 组,分点比数据多一位小数,故把第一组起点
稍微小一点,故分组如下:
[482.5,486.5],[486.5,490.5],„,[514.5,518.5].
(2)频率分布直方图,如图 D13.
图 D13
【变式与拓展】
2.为了让学生了解环保知识,增强环保意识,某中学举行
了一次“环保知识竞赛”,共有 900 名学生参加了这次竞赛.为 了解本次竞赛成绩情况,从中抽取了部分学生的成绩(得分均为 整数,满分为 100 分)进行统计.请你根据尚未完成并有局部污损 的频率分布表和频率分布直方图(如图 2-2-3),解答下列问题: (1)填充频率分布表的空格(将答案直接填在表格内);
列表如下: 分组 [482.5,486.5) [486.5,490.5) [490.5,494.5) [494.5,498.5) [498.5,502.5) [502.5,506.5) [506.5,510.5) [510.5,514.5) [514.5,518.5] 合计 频数累计 正 正正正 正正正正 正正 正正 正正正 正 频数 8 3 17 20 14 10 19 6 3 100 频率 0.08 0.03 0.17 0.20 0.14 0.10 0.19 0.06 0.03 1.00
当数据由整数部分和小数部分组成时,可以把整数部分作为
________ ,小数部分作为________. 茎 叶
练习 2:为了了解某校教师使用多媒体进行教学的情况,
2.2.1用样本的频率分布估计总体分布
总体密度曲线
反映了总体在各个范围内取值的百分比,精确地 反映了总体的分布规律。是研究总体分布的工具. 用样本分布直方图去估计相应的总体分布时, 一般样本容量越大,频率分布直方图就会无限接 近总体密度曲线,就越精确地反映了总体的分布 规律,即越精确地反映了总体在各个范围内取值 百分比。
定额管理,即确定一个居民月用水量标准a, 用水量不超过a的部分按平价收费,超出a的 部分按议价收费.那么①标准a定为多少比较合 理呢? ②为了较合理地确定这个标准,你认 为需要做哪些工作?
通过抽样,我们获得了100位居民某年的月平均 用 水量(单位: t) ,如下表:
思考:由上表,大家可以得到什么信息?
2019/4/10
二、画频率分布直方图的步骤
1.求极差(即一组数据中最大值与最小值的差)
4.3 - 0.2 = 4.1
极差 4.1 2.决定组距与组数: = 组距= = 0.5 8 组数
当数据在100个以内时,常分8-12组.
3.将数据分组
[0,0.5 ),[0.5,1 ),…,[4,4.5]
4.列频率分布表
月均用水量 /t 4.5
归纳: 作频率分布直方图的方法为:
把横轴分成若干段,每一段对应一个组 的组距,以此线段为底作矩形,高等于 该组的频率/组距, 这样得到一系列矩形, 每一个矩形的面积恰好是该组上的频率, 这些矩形构成了频率分布直方图.
三、频率分布直方图再认识 1、小长方形
频率
的面积总和=?
频率 组距 0.5 0.4 0.3 0.2 0.1
O
0.5 1 1.5 2 2.5 3 3.5 4 4.5 月均用水量/t
2019/4/10
当总体中的个体数很多时(如抽样调查全国城市 居民月均用水量) ,随着样本容量的增加,作图时 所分的组数增多,组距减少,你能想象出相应的 频率分布折线图会发生什么变化吗?
2020版数学人教B版必修3学案:第二章 2.2.1 用样本的频率分布估计总体的分布(一) Word版含解析
2.2 用样本估计总体2.2.1 用样本的频率分布估计总体的分布(一)学习目标 1.体会分布的意义和作用.2.学会用频率分布表,画频率分布直方图表示样本数据.3.能通过频率分布表或频率分布直方图对数据做出总体统计.知识点一 用样本估计总体 思考 还记得我们抽样的初衷吗?答案 用样本去估计总体,为决策提供依据. 梳理 用样本的频率分布估计总体的分布. 知识点二 频率分布表与频率分布直方图思考1 要做频率分布表,需要对原始数据做哪些工作? 答案 分组,频数累计,计算频数和频率. 思考2 如何决定组数与组距? 答案 若极差组距为整数,则极差组距=组数.若极差组距不为整数,则⎣⎢⎡⎦⎥⎤极差组距+1=组数. 注意:[x]表示不大于x 的最大整数.思考3 同样一组数据,如果组距不同,得到的频率分布直方图也会不同吗?答案 不同.对于同一组数据分析时,要选好组距和组数,不同的组距与组数对结果有一定的影响.梳理 一般地,频数指某组中包含的个体数,各组频数和=样本容量;频率=频数样本容量,各组频率和等于1.在频率分布直方图中,纵轴表示频率组距,数据落在各小组内的频率用小长方形的面积来表示,各小长方形的面积的总和等于1.1.频率分布直方图中小长方形的高表示该组上的个体在样本中出现的频率与组距的比值.( √ )2.频率分布直方图中小长方形的面积表示该组的个体数.( × ) 3.频率分布直方图中所有小长方形面积之和为1.( √ )题型一 频率分布的理解例1 关于频率分布直方图,下列说法正确的是( ) A .直方图中小长方形的高表示取某数的频率B .直方图中小长方形的高表示该组上的个体在样本中出现的频率C .直方图中小长方形的高表示该组上的个体在样本中出现的频数与组距的比值D .直方图中小长方形的高表示该组上的个体在样本中出现的频率与组距的比值 答案 D解析 注意频率分布直方图和条形图的区别,在直方图中,纵轴(小长方形的高)表示频率与组距的比值,其相应组距上的频率等于该组距上的小长方形的面积.反思与感悟 由频率的定义不难得出,各组数据的频率之和为1,因为各组数据的个数之和为样本容量.在列频率分布表时,可以利用这种方法检查是否有数据的丢失. 跟踪训练1 一个容量为20的样本数据,将其分组如下表:则样本在区间(-∞,50)上的频率为( ) A .0.5 B .0.25 C .0.6 D .0.7 答案 D解析 样本在区间(-∞,50)上的频率为2+3+4+520=1420=0.7.题型二 频率分布直方图的绘制例2 某中学从高一年级随机抽取50名学生进行智力测验,其得分如下(单位:分): 48 64 52 86 71 48 64 41 86 79 71 68 82 84 68 64 62 68 81 57 90 52 74 73 56 78 47 66 55 64 56 88 69 40 73 97 68 56 67 59 70 52 79 44 55 69 62 58 32 58 根据上面的数据,回答下列问题:(1) 这次测验成绩的最高分和最低分分别是多少?(2)将区间[30,100]平均分成7个小区间,试列出这50名学生智力测验成绩的频率分布表,进而画出频率分布直方图;(3)分析频率分布直方图,你能得出什么结论?解(1)这次测验成绩的最低分是32分,最高分是97分.(2)根据题意,列出样本的频率分布表如下:频率分布直方图如图所示.(3)从频率分布直方图可以看出,这50名学生的智力测验成绩大体上呈两头小、中间大,左右基本对称的状态,说明这50名学生中智力特别好或特别差的占极少数,而智力一般的占多数,这是一种最常见的分布.反思与感悟组距和组数的确定没有固定的标准,将数据分组时,组数应力求合适,以使数据的分布规律能较清楚地呈现出来.组数太多或太少,都会影响我们了解数据的分布情况.数据分组的组数与样本容量有关,一般样本容量越大,所分组数越多.当样本容量不超过100时,按照数据的多少,常分成5至12组.跟踪训练2一个农技站为了考察某种麦穗生长的分布情况,在一块试验田里抽取了100株麦穗,量得长度如下(单位:cm):6.5 6.4 6.7 5.8 5.9 5.9 5.2 4.0 5.4 4.65.8 5.5 6.0 6.5 5.1 6.5 5.3 5.9 5.5 5.86.2 5.4 5.0 5.0 6.8 6.0 5.0 5.7 6.0 5.56.8 6.0 6.3 5.5 5.0 6.3 5.2 6.07.0 6.46.4 5.8 5.9 5.7 6.8 6.6 6.0 6.4 5.77.46.0 5.4 6.5 6.0 6.8 5.8 6.3 6.0 6.3 5.6 5.3 6.4 5.7 6.7 6.2 5.6 6.0 6.7 6.7 6.0 5.6 6.2 6.1 5.3 6.2 6.8 6.6 4.7 5.7 5.7 5.8 5.3 7.0 6.0 6.0 5.9 5.4 6.0 5.2 6.0 6.3 5.7 6.8 6.1 4.5 5.6 6.3 6.0 5.8 6.3根据上面的数据列出频率分布表、绘制出频率分布直方图,并估计在这块试验田里长度在5.75~6.35 cm 之间的麦穗所占的百分比. 解 (1)计算极差:7.4-4.0=3.4; (2)决定组距与组数:若取组距为0.3,因为3.40.3≈11.3,需分为12组,组数合适,所以取组距为0.3,组数为12;(3)决定分点:使分点比数据多一位小数,并且把第1小组的起点稍微减小一点,那么所分的12个小组可以是3.95~4.25,4.25~4.55,4.55~4.85,…,7.25~7.55; (4)列频率分布表:(5)绘制频率分布直方图如图.从表中看到,样本数据落在5.75~6.35之间的频率是0.28+0.13=0.41,于是可以估计,在这块试验田里长度在5.75~6.35 cm 之间的麦穗约占41%. 题型三 频率分布表及频率分布直方图的应用例3 从某校随机抽取100名学生,获得了他们一周课外阅读时间(单位:小时)的数据,整理得到数据分组及频数分布表和频率分布直方图:(1)从该校随机选取一名学生,试估计这名学生该周课外阅读时间少于12小时的概率; (2)求频率分布直方图中的a ,b 的值;(3)假设同一组中的每个数据可用该组区间的中点值代替,试估计样本中的100名学生该周课外阅读时间的平均数在第几组(只需写出结论).解 (1)根据频数分布表知,100名学生中一周课外阅读时间不少于12小时的学生共有6+2+2=10(名),所以样本中的学生一周课外阅读时间少于12小时的频率是1-10100=0.9.故从该校随机选取一名学生,估计其该周课外阅读时间少于12小时的概率为0.9.(2)课外阅读时间落在[4,6)组内的有17人,频率为0.17,所以a =频率组距=0.172=0.085.课外阅读时间落在[8,10)组内的有25人,频率为0.25,所以b =频率组距=0.252=0.125.(3)样本中的100名学生该周课外阅读时间的平均数在第4组.反思与感悟 在频率分布直方图中,各小长方形的面积等于相应各组的频率,小长方形的高与频数成正比,各组频数之和等于样本容量,频率之和等于1.跟踪训练3 为了了解高一年级学生的体能情况,某校抽取部分学生进行一分钟跳绳次数测试,将所得数据整理后,画出频率分布直方图(如图所示),图中从左到右各小矩形的面积之比为2∶4∶17∶15∶9∶3,第二小组的频数为12.(1)第二小组的频率是多少?样本容量是多少?(2)若次数在110以上(含110次)为达标,则该校全体高一年级学生的达标率约是多少? 解 (1)频率分布直方图是以面积的形式来反映数据落在各小组内的频率大小的, 因此第二小组的频率为42+4+17+15+9+3=0.08.因为第二小组的频率=第二小组的频数样本容量,所以样本容量=第二小组的频数第二小组的频率=120.08=150.(2)由直方图可估计该校全体高一年级学生的达标率约为17+15+9+32+4+17+15+9+3×100%=88%.1.如图所示是一容量为100的样本的频率分布直方图,则由图中的数据可知,样本落在[15,20]内的频数为( )A .20B .30C .40D .50 答案 B解析 样本数据落在[15,20]内的频数为100×[1-5×(0.04+0.1)]=30.2.已知样本数据:10,8,6,10,13,8,10,12,11,7,8,9,11,9,12,9,10,11,12,11.那么频率为0.2的是() A.[5.5,7.5) B.[7.5,9.5)C.[9.5,11.5) D.[11.5,13.5]答案 D解析列出频率分布表,依次对照就可以找到答案,频率分布表如下:从表中可以看出频率为0.2的是[11.5,13.5],故选D.3.如图是将高三某班60名学生参加某次数学模拟考试所得的成绩(成绩均为整数)整理后画出的频率分布直方图,则此班的优秀(120分及以上为优秀)率为________.答案30%解析优秀率为10×(0.022 5+0.005+0.002 5)=0.3=30%.4.一个频数分布表(样本容量为50)不小心被损坏了一部分,只记得样本中数据在[20,60)内的频率为0.6,则估计样本在[40,50),[50,60)内的数据个数之和是________.答案21解析根据题意,设分布在[40,50),[50,60)内的数据个数分别为x,y.∵样本中数据在[20,60)内的频率为0.6,样本容量为50,∴4+5+x+y50=0.6,解得x+y=21.即样本在[40,50),[50,60)内的数据个数之和为21.5.暑假期间某班为了增强学生的社会实践能力,把该班学生分成四个小组到一果园帮果农测量果树的产量,某小组来到一片种植苹果的山地,他们随机选取20株作为样本测量每一株的果实产量(单位:kg),获得的数据按照区间[40,45),[45,50),[50,55),[55,60]进行分组,得到如下频率分布表:已知样本中产量在区间[45,50)内的株数是产量在区间[50,60]内的株数的43倍.(1)分别求出a ,b ,c 的值; (2)作出频率分布直方图. 解 (1)易得c =1.0.由题意得⎩⎪⎨⎪⎧a =43(0.1+b ),0.3+a +0.1+b =1.0,∴a =0.4,b =0.2.(2)根据频率分布表画出频率分布直方图,如图所示.1.频率分布是指一个样本数据在各个小范围内所占比例的大小,总体分布是指总体取值的频率分布规律,我们通常用样本的频率分布表或频率分布直方图去估计总体的分布. 2.频率分布表和频率分布直方图,是对相同数据的两种不同表达方式,用紧凑的表格改变数据的排列方式和构成形式,可展示数据的分布情况.通过作图既可以从数据中提取信息,又可以利用图形传递信息.3.样本数据的频率分布表和频率分布直方图,是通过各小组数据在样本容量中所占比例大小来表示数据的分布规律,它可以让我们更清楚地看到整个样本数据的频率分布情况,并由此估计总体的分布情况.一、选择题1.观察新生婴儿的体重(单位:g),其频率分布直方图如图所示,则新生婴儿的体重在[2 700,3 000)内的频率为( )A .0.001B .0.01C .0.003D .0.3答案 D解析 频率=频率组距×组距,组距=3 000-2 700=300,频率组距=0.001, ∴频率=0.001×300=0.3.2.容量为100的样本数据,按从小到大的顺序分为8组,如下表:第三组的频数和频率分别是( ) A .14和0.14 B .0.14和14 C.114和0.14 D.13和114答案 A解析 x =100-(10+13+14+15+13+12+9)=100-86=14,第三组的频率为14100=0.14.3.为了研究某药品的疗效,选取若干名志愿者进行临床试验,所有志愿者的舒张压数据(单位:kPa )的分组区间为[12,13),[13,14),[14,15),[15,16),[16,17],将其按从左到右的顺序分别编号为第一组,第二组,…,第五组,如图是根据试验数据制成的频率分布直方图.已知第一组与第二组共有20人,第三组中没有疗效的有6人,则第三组中有疗效的人数为( )A .6B .8C .12D .18 答案 C解析 志愿者的总人数为20(0.16+0.24)×1=50,所以第三组人数为50×0.36×1=18, 有疗效的人数为18-6=12.4.某校为了解高三学生的身体情况,抽取了100名女生的体重.将所得的数据整理后,画出了如图所示的频率分布直方图,则所抽取的女生中体重在[40,45) kg 的人数是( )A .10B .2C .5D .15 答案 A解析 由图可知频率=频率组距×组距,频率=0.02×5=0.1,∴女生体重在[40,45) kg 的人数为0.1×100=10.5.为了了解某幼儿园儿童的身高情况,抽查该园120名儿童的身高绘制成如图所示的频率分布直方图,则抽查的120名儿童身高大于或等于98 cm 且小于104 cm 的有( )A .90名B .75名C .65名D .40名 答案 A解析 由图可知身高大于或等于98 cm 且小于104 cm 的儿童的频率为(0.1+0.15+0.125)×2=0.75,抽查的120名儿童有120×0.75=90(名)儿童的身高大于或等于98 cm 且小于104 cm. 6.将容量为n 的样本中的数据分成6组,绘制频率分布直方图.若第一组至第六组数据的频率之比为2∶3∶4∶6∶4∶1,且前三组数据的频数之和等于27,则n 的值为( ) A .20 B .27 C .6 D .60答案 D解析 ∵n ·2+3+42+3+4+6+4+1=27,∴n =60.7.某校从高一年级学生中随机抽取部分学生,将他们的模块测试成绩分成6组:[40,50),[50,60),[60,70),[70,80),[80,90),[90,100]加以统计,得到如图所示的频率分布直方图.已知高一年级共有学生600名,据此估计,该模块测试成绩不少于60分的学生人数为( )A .588B .480C .450D .120 答案 B解析 ∵少于60分的学生人数为600×(0.05+0.15)=120, ∴不少于60分的学生人数为600-120=480.8.对某种电子元件使用寿命进行跟踪调查,所得样本频率分布直方图如图.由图可知,这一批电子元件中寿命在100~300 h 的电子元件的数量与寿命在300~600 h 的电子元件的数量的比是( )A .1∶2B .1∶3C .1∶4D .1∶6 答案 C解析 由题意,寿命在100~300 h 的电子元件的频率为100×⎝⎛⎭⎫12 000+32 000=0.2,寿命在300~600 h 的电子元件的频率为100×⎝⎛⎭⎫1400+1250+3 2 000=0.8,则寿命在100~300 h 的电子元件的数量与寿命在300~600 h 的电子元件的数量比大约是0.2∶0.8=1∶4. 二、填空题9.将一个容量为n 的样本分成若干组,已知甲组的频数和频率分别为36和14,则容量n =________,频率为16的乙组的频数是________.答案 144 24解析 14=36n ,所以n =36×4=144,同理16=x144,x =24.10.某大学对1 000名学生的自主招生水平测试成绩进行统计,得到样本频率分布直方图(如图所示),现规定不低于70分为合格,则合格人数是________.答案 600解析 由频率分布直方图知合格的频率为(0.035+0.015+0.01)×10=0.6, 故合格人数为1 000×0.6=600.11.下列命题正确的是________.(填序号)①频率分布直方图中每个小矩形的面积等于相应组的频数; ②频率分布直方图中各小矩形面积之和等于1;③频率分布直方图中各小矩形的高(平行于纵轴的边)表示频率与组距的比. 答案 ②③解析 在频率分布直方图中,横轴表示样本数据,纵轴表示频率组距.由于小矩形的面积=组距×频率组距=频率,所以各小矩形的面积等于相应各组的频率,因此各小矩形面积之和等于1.综上可知②③正确.12.如图是根据部分城市某年6月份的平均气温(单位:℃)数据得到的样本频率分布直方图,其中平均气温的范围是[20.5,26.5],样本数据的分组为[20.5,21.5),[21.5,22.5),[22.5,23.5),[23.5,24.5),[24.5,25.5),[25.5,26.5].已知样本中平均气温低于22.5 ℃的城市个数为11,则样本中平均气温不低于25.5 ℃的城市个数为________.答案 9解析 最左边两个矩形面积之和为0.10×1+0.12×1=0.22,总城市数为11÷0.22=50,最右面矩形面积为0.18×1=0.18,50×0.18=9.13.从某小区抽取100户居民进行月用电量调查,发现其用电量都在50至350度之间,频率分布直方图如图所示.则频率分布直方图中x 的值为 __________.答案 0.004 4解析 ∵(0.002 4+0.003 6+0.006 0+x +0.002 4+0.001 2)×50=1,∴x =0.004 4. 三、解答题14.为加强中学生实践创新能力和团队精神的培养,促进教育教学改革,某市教育局将举办全市中学生创新知识竞赛.某校举行选拔赛,共有200名学生参加,为了了解成绩情况,从中抽取50名学生的成绩(得分均为整数,满分为100分)进行统计,请你根据尚未完成的频率分布表解答问题:(1)求a ,b ,c ,d ,e 的值; (2)作出频率分布直方图.解 (1)根据题意,得分在[60.5,70.5)内的频数是a =50×0.26=13,在[90.5,100.5]内的频数是b =50-13-15-18=4,在[70.5,80.5)内的频率是c =1550=0.30,在[90.5,100.5]内的频率是d =450=0.08,频率和e =1. (2)根据频率分布表作出频率分布直方图,如图所示.四、探究与拓展15.某市共有5 000名高三学生参加联考,为了了解这些学生对数学知识的掌握情况,现从中随机抽出若干名学生在这次测试中的数学成绩,制成如下频率分布表:根据上面的频率分布表,可知①处的数值为________,②处的数值为__________. 答案 3 0.025解析 由位于[110,120)的频数为 36,频率=36n =0.300,得样本容量n =120,所以[130,140)的频率=12120=0.1,②处的数值=1-0.050-0.200-0.300-0.275-0.1-0.050=0.025;①处的数值为0.025×120=3.。
人教a版必修三:《2.2.1用样本的频率分布估计总体分布(1)》ppt课件(38页)
填要点、记疑点
主目录
探要点、究所然
当堂测、查疑缺
探要点、究所然
2.2.1(一)
探究点二:频率分布直方图
跟踪训练 2 下表给出了某校 500 名 12 岁男孩中用随机抽样得出的 120 人的身高(单位:cm).
区间界限 人数 区间界限 人数
[122,126) [126,130) [130,134) [134,138) [138,142) 5 8 10 22 33
明目标、知重点
填要点、记疑点
主目录
探要点、究所然
当堂测、查疑缺
探要点、究所然
2.2.1(一)
探究点一:频率分布表
分组 [150.5,153.5) [153.5,156.5) [156.5,159.5) [159.5,162.5) [162.5,165.5) [165.5,168.5) [168.5,171.5) [171.5,174.5)
主目录
频率 0.025 0.075 0.15 0.225 0.35 0.075 0.075 0.025 1
探要点、究所然 当堂测、查疑缺
探要点、究所然
2.2.1(一)
探究点二:频率分布直方图
(2)频率分布直方图如图所示.
明目标、知重点
填要点、记疑点
主目录
探要点、究所然
当堂测、查疑缺
探要点、究所然
明目标、知重点 填要点、记疑点
频数 5 8 10 22 33 20 11 6 5 120
主目录
频率 0.04 0.07 0.08 0.18 0.28 0.17 0.09 0.05 0.04 1
探要点、究所然 当堂测、查疑缺
探要点、究所然
2.2.1(一)
(人教a版)必修三同步课件:2.2.1用样本的频率分布估计总体分布
(-∞,- 为____________ . 1)
8,10,则其中位数位 __. 7
(-1,+∞)
6
2.已知一组数分别为:2,3,5,7,8,10,11,则其中位数为__;数据2,3,5,7,
[预习导引]
1.用样本估计总体的两种情况
频率分布 (1)用样本的_________ 估计总体分布.
数字特征 (2)用样本的_________ 估计总体数字特征.
0.045 5
0.159 1 0.181 8 0.363 6 0.113 6 0.090 9 0.045 5 1.00
合计
(2)从频率分布表中可以看出60%左右的美国总统就任时的年 龄在50岁至60岁之间,45岁以下以及65岁以上就任的总统所 占的比例相对较小.
要点二
例2
茎叶图及其应用
某中学甲、乙两名同学最近几次的数学考试成绩情况如下: 甲的得分:95,81,75,89,71,65,76,88,94,110,107; 乙的得分:83,86,93,99,88,103,98,114,98,79,101.
画出两人数学成绩的茎叶图,并根据茎叶图对两人的成绩进行比较.
组距
4.茎叶图
中间 (1)定义:顾名思义,茎是指_____的一列数,叶就是从茎的 _____生长出来的数,中间
旁边 的数字表示十位数,旁边的数字表示个位数.
(2)茎叶图的优点与不足
①优点:一是原始数据信息在图中能够保留,所有数据信息都可以从茎叶图中得到;二
是茎叶图中的数据可以随时记录,随时添加,方便记录与表示. ②不足:当样本数据较多时,茎叶图就显得不太方便.
2.作频率分布直方图的步骤
最大值 (1)求极差:即一组数据中_______和_______ 的差;
人教b版数学必修三:2.2.1《用样本的频率分布估计、总体的分布》导学案
§2.2用样本估计总体2.2.1用样本的频率分布估计总体的分布自主学习学习目标1.通过实例体会分布的意义和作用,在表示样本数据的过程中,学会列频率分布表、画频率分布直方图、频率折线图、茎叶图,体会它们各自的特点.2.在解决统计问题的过程中,进一步体会用样本估计总体的思想,会用样本的频率分布估计总体的分布,初步体会样本频率分布的随机性.自学导引1.极差的概念极差是一组数据的________________的差,它反映了一组数据____________,极差又叫________.2.频数、频率的概念将一批数据按要求分为若干组,对落在各个小组内数据的________进行累计,这个累计数叫做各个小组的______,各个小组的______除以________,即得该小组的______.3.频率分布直方图在频率分布直方图中,纵轴表示________________,各小长方形的面积等于________________,所有长方形面积之和等于________.4.频率分布折线图连接频率分布直方图中各个小长方形的____________,就得到频率分布折线图.5.总体密度曲线如果样本容量越大,所分组数越多,频率分布直方图中表示的频率分布就越接近总体在各个小组内所取值的________________的大小;当样本容量不断增大,分组的组距不断缩小时,频率分布直方图实际上越来越接近于____________,它可以用一条____________来描绘,这条光滑曲线就叫做________________.6.茎叶图用茎叶图表示数据的两个优点在于:一是从茎叶图上没有____________的损失,所有的数据信息都可以从茎叶图中得到;二是茎叶图可以在比赛时____________,方便记录与表示.对点讲练知识点一画频率分布直方图、频率分布折线图例1某中学同年级40名男生的体重数据如下(单位:千克):61605959595858575757575656565656565655555555545454545353525252525251515150504948列出样本的频率分布表,画出频率分布直方图,画出频率分布折线图.变式迁移1有一容量为200的样本,数据的分组以及各组的频数如下:[-20,-15),7;[-15,-10),11;[-10,-5),15;[-5,0),40;[0,5),49;[5,10),41;[10,15),20;[15,20),17.(1)列出样本的频率分布表;(2)画出频率分布直方图;(3)求样本数据不足0的频率.知识点二用样本的频率分布估计总体分布寿命(2)画出频率分布直方图及折线图;(3)估计电子元件寿命在400 h以上的概率.变式迁移2为了解小学生的体能情况,抽取了某小学同年级部分学生进行跳绳测试,将所得数据整理后,画出频率分布直方图如图所示,已知图中从左到右前三个小组的频率分别是0.1,0.3,0.4,第一小组的频数为5.(1)求第四小组的频率;(2)问参加这次测试的学生人数是多少?(3)问在这次测试中,学生跳绳次数的中位数落在第几小组内?例3某赛季甲、乙两名篮球运动员每场比赛的得分情况如下:甲的得分12,15,24,25,31,31,36,36,37,39,44,49,50;乙的得分8,13,14,16,23,26,28,33,38,39,51.(1)画出甲、乙两名运动员得分数据的茎叶图;(2)根据茎叶图分析甲、乙两运动员的水平.变式迁移3在某电脑杂志的一篇文章中,每个句子所含的字数如下:10,28,31,17,23,27,18,15,26,24,20,19,36,27,14,25,15,22,11,24,27,17;在某报纸的一篇文章中,每个句子所含的字数如下:27,39,33,24,28,19,32,41,33,27,35,12,36,41,27,13,22,23,18,46,32,22.(1)将这两组数据用茎叶图表示;(2)将这两组数据进行比较分析,得到什么结论?几种表示频率分布的方法的优点与不足(1)频率分布表在数量表示上比较确切,但不够直观、形象,分析数据分布的总体态势不太方便.(2)频率分布直方图能够很容易地表示大量数据,非常直观地表明分布的形状,使我们能够看到在分布表中看不清楚的数据模式.(3)频率分布折线图的优点是它反映了数据的变化趋势.如果样本容量不断增大,分组的组距不断缩小,那么折线图就趋向于总体密度曲线.(4)用茎叶图刻画数据有两个优点:一是所有的信息都可以从这个茎叶图中得到;二是茎叶图便于记录和表示,能够展示数据的分布情况,但当样本数据较多或数据位数较多时,茎叶图就显得不太方便了.课时作业一、选择题1.关于频率分布直方图中的有关数据,下列说法正确的是()A.小矩形的高表示取某数的频率B.小矩形的高表示该组上的个体在样本中出现的频率C.小矩形的高表示该组上的个体数与组距的比值D.小矩形的高表示该组上个体在样本中出现的频率与组距的比值2.关于样本频率分布直方图与总体密度曲线的关系,下列说法中正确的是()A.频率分布直方图与总体密度曲线无关B.频率分布直方图就是总体密度曲线C.样本容量很大的频率分布直方图就是总体密度曲线D.如果样本容量无限增大,分组的组距无限减小,那么相应的频率分布折线图会越来越接近一条光滑曲线,则这条光滑曲线为总体密度曲线3.已知10个数据如下:63,65,67,69,66,64,66,64,65,68.如果对这些数据绘制频率分布表,那么其中在64.5~66.5这组的频率是()A.0.4 B.0.5 C.5 D.4A.0.5 B.0.24 C.0.6 D.0.7二、填空题5.在求频率分布时,把数据分为5组,若已知其中的前四组频率分别为0.1,0.3,0.3,0.1,则第五组的频率是______,这五组的频数之比为________.6.在样本的频率分布直方图中,共有5个小长方形,已知中间一个小长方形面积是其余4个小长方形面积之和的13,且中间一组的频数为10,则这个样本容量是________.三、解答题7.在学校开展的综合实践活动中,某班进行了小制作评比,作品上交时间为6月1日至30日,评委会把同学们上交作品的件数按5天一组分组统计,绘制了频率分布直方图(如图),已知从左到右各长方形的高的比为2∶3∶4∶6∶4∶1,第三组的频数为12,请解答下列问题:(1)本次活动共有多少件作品参加评比?(2)哪组上交的作品数量最多?有多少件?(3)经过评比,第四组和第六组分别有10件、2件作品获奖,问这两组哪组获奖率较高?8.有关部门从甲,乙两个城市所有的自动售货机中分别随机抽取了16台,记录下一上午各自的销售情况如下:(单位:元)甲18,8,10,43,5,30,10,22,6,27,25,58,14,18,30,41乙22,31,32,42,20,27,48,23,38,43,12,34,18,10,34,23(1)请画出这两组数据的茎叶图.(2)将这两组数据进行比较分析,你能得到什么结论?§2.2用样本估计总体2.2.1用样本的频率分布估计总体的分布自学导引1.最大值与最小值变化的幅度全距2.个数频数频数样本容量频率3.频率与组距的比值相应各组的频率 14.上边的中点5.个数与总数比值总体的分布光滑曲线y=f(x)总体密度曲线6.原始信息随时记录对点讲练例1解(1)计算:61-48=13;(2)决定组距与组数,取组距为2,∵132=612,∴共分7组;(3)决定分点,使分点比数据多一位小数.并把第1小组的分点减小0.5,即分成如下7组:47.5~49.5,49.5~51.5,51.5~53.5,53.5~55.5,55.5~57.5,57.5~59.5,59.5~61.5.(4)51.5~53.5 7 0.175 53.5~55.5 8 0.20 55.5~57.5 11 0.275 57.5~59.5 5 0.125 59.5~61.5 2 0.05 合计4040 1.00(5)(6)取各小长方形上边的中点并用线段连接就构成了频率分布折线图. 变式迁移1 解 (1)分组 频数 频率[-20,-15)7 0.035 [-15,-10)11 0.055 [-10,-5)15 0.075 [-5,0)40 0.200 [0,5) 49 0.245 [5,10) 41 0.205 [10,15) 20 0.100 [15,20) 17 0.085合计200 (2)(3)样本数据不足0的频率为7+11+15+40200=0.365.例2 解 (1)寿命(h ) 频数 频率100~20020 0.10 200~30030 0.15 300~40080 0.40 400~50040 0.20 500~60030 0.15 合计200 1.00 (2)(3)由频率分布表可知,寿命在400 h 以上的电子元件出现的频率为0.20+0.15=0.35,故我们估计电子元件寿命在400 h 以上的频率为0.35.变式迁移2 解 (1)第四小组的频率为1-(0.1+0.3+0.4)=0.2. (2)n =第一小组的频数÷第一小组的频率=5÷0.1=50.(3)由0.1×50=5,0.3×50=15,0.4×50=20,0.2×50=10,得第一、第二、第三、第四小组的频数分别为5,15,20,10.所以学生跳绳次数的中位数落在第三小组内. 例3 解 (1)作出茎叶图如下图:(2)由上面的茎叶图可以看出,甲运动员的得分情况是大致对称的,中位数是36分;乙运动员的得分情况除一个特殊得分外,也大致对称,中位数是26分.因此甲运动员的发挥比较稳定,总体得分情况比乙运动员好.变式迁移3 解 (1)茎叶图如图所示:(2)电脑杂志上每个句子的字数集中在10~30之间,报纸上每个句子的字数集中在20~40之间,说明电脑杂志上每个句子的平均字数要比报纸上每个句子的平均字数要少.课时作业 1.D 2.D3.A [∵在这组中的数只有4个,∴频率=410=0.4.]4.D5.0.2 1∶3∶3∶1∶2 6.40解析 可知中间长方形的面积是所有长方形面积的14,即频率为14,∴样本容量为1014=40.7.解 (1)依题意知第三组的频率为42+3+4+6+4+1=15,又∵第三组的频数为12,∴本次活动的参评作品数为1215=60(件).(2)根据频率分布直方图,可以看出第四组上交的作品数量最多,共有60×62+3+4+6+4+1=18(件)(3)第四组的获奖率是1018=59,第六组上交的作品数量为60×12+3+4+6+4+1=3(件)∴第六组的获奖率为23=69,显然第六组的获奖率较高. 8.解 (1)茎叶图如图所示.(2)由图可以看出乙城市的销售额分布较对称,集中程度较高,故乙城市一上午的销售情况比较稳定且销售额较高.。
2.2.1用样本的频率分布估计总体
频率/组距
0.4 0.3 0.2 0.1 0 0-0.5 0.5-1 1-1.5 1.5-2 2-2.5 2.5-3 3-3.5 3.5-4 4-4.5
用水量范围
连接频率分布直方图中各个小长方形上端的中点,频率分布折线图
随着样本容量的增加,作图时所分的组数也会增加,相应的频 率折线图会越来越接近于一条光滑的曲线,统计学中称这条光滑的 曲线为总体密度曲线
(3)根据频率分布直方图估计,数据落在[15.5, 24.5)的百分比是多少?
解:(1)组距为3,列频率分布表
分组 频数 频率 频率/ 组距
[12.5, [15.5, [18.5, [21.5, [24.5, [27.5, [30.5,
15.5) 3 18.5) 8 21.5) 9 24.5) 11 27.5) 10 30.5) 5 33.5) 4
甲 8 4 6 3 3 6 8 3 8 9 1 0 1
乙
2 5 5 4 1 1 6 6 7 9 4 9 0
2
3 4 5
茎叶图的特征:
(1)用茎叶图表示数据有两个优点:一是从统计图上没 有原始数据信息的损失,所有数据信息都可以从茎叶图 中得到;二是茎叶图中的数据可以随时记录,随时添加, 方便记录与表示; (2)茎叶图只便于表示两位(或一位)有效数字的数据, 对位数多的数据不太容易操作;而且茎叶图只方便记录 两组的数据,两个以上的数据虽然能够记录,但是没有 表示两个记录那么直观,清晰; (3)茎叶图对重复出现的数据要重复记录,不能遗漏.
[0,0.5 ),[0.5,1 ),…,[4,4.5]
分组时,通常对组内数值所在区间取左 闭右开区间,最后一组取闭区间,当然也 可以采用其他分组方法。
4.列频率分布表
2.2.1用样本的频率分布估计总体分布
1
板出课题 1 分钟
让学生展开讨论 2 分钟
填空 2 分钟
以课本 P66 制定 居民用水标准问 题为例, 题为例,经过以 上几个步骤画出 频率分布直方 图。 学生动手作 ( 图)10 分钟 让学生仔细观察 表和图, 表和图,得出结 论 2 分钟
心灵寄语 :后悔过去,不如奋斗将来。——马克思 (1) 从频率分布直方图可以清楚的看出数据分布的总体趋势。 ) 从频率分布直方图可以清楚的看出数据分布的总体趋势。 不出原始的数据内容, (2) 从频率分布直方图得不出原始的数据内容,把数据表示成直方图后,原有 ) 从频率分布直方图得不出原始的数据内容 把数据表示成直方图后, 的具体数据信息就被抹掉了。 的具体数据信息就被抹掉了。 探究〗 同样一组数据,如果组距不同,横轴、纵轴的单位不同,得到的图和形状也会不同。 :同样一组数据 〖探究〗 同样一组数据,如果组距不同,横轴、纵轴的单位不同,得到的图和形状也会不同。 : 不同的形状给人以不同的印象,这种印象有时会影响我们对总体的判断, 不同的形状给人以不同的印象,这种印象有时会影响我们对总体的判断,分别以 0.1 和 1 为组距 重新作图,然后谈谈你对图的印象? 重新作图,然后谈谈你对图的印象? 思考〗 :如果当地政府希望使 以上的居民每月的用水量不超出标准, 〖思考〗 如果当地政府希望使 85%以上的居民每月的用水量不超出标准,根据频率分布表 2-2 : 以上的居民每月的用水量不超出标准 和频率分布直方图 2.2-1,你能对制定月用水量标准提出建议吗? ,你能对制定月用水量标准提出建议吗? 频率分布折线图、 〈二〉频率分布折线图、总体密度曲线 1.频率分布折线图的定义: .频率分布折线图的定义: 连接频率分布直方图中各小长方形上端的中点 就得到频率分布折线图。 中各小长方形上端的中点, 连接频率分布直方图中各小长方形上端的中点,就得到频率分布折线图。 2.总体密度曲线的定义: .总体密度曲线的定义: 在样本频率分布直方图中, 相应的频率折线图会越来越接近于一条光滑曲线, 在样本频率分布直方图中, 相应的频率折线图会越来越接近于一条光滑曲线, 统计中 称这条光滑曲线为总体密度曲线。它能够精确地反映了总体在各个范围内取值的百分比, 称这条光滑曲线为总体密度曲线。它能够精确地反映了总体在各个范围内取值的百分比, 它能给我们提供更加精细的信息。 它能给我们提供更加精细的信息。 思考〗 〖思考〗 : 对于任何一个总体,它的密度曲线是不是一定存在?为什么? 1.对于任何一个总体,它的密度曲线是不是一定存在?为什么? 对于任何一个总体,它的密度曲线是否可以被非常准确地画出来? 2.对于任何一个总体,它的密度曲线是否可以被非常准确地画出来?为什么 实际上,尽管有些总体密度曲线是饿、客观存在的, 实际上,尽管有些总体密度曲线是饿、客观存在的,但一般很难想函数图象那样准确 地画出来,我们只能用样本的频率分布对它进行估计 一般来说,样本容量越大, 进行估计, 地画出来,我们只能用样本的频率分布对它进行估计,一般来说,样本容量越大,这种估 计就越精确. 计就越精确. 〈三〉茎叶图 茎叶图的概念: 1.茎叶图的概念: 当数据是两位有效数字时,用中间的数字表示十位数,即第一个有效数字, 当数据是两位有效数字时,用中间的数字表示十位数,即第一个有效数字,两边的数 字表示个位数,即第二个有效数字,它的中间部分像植物的茎, 字表示个位数,即第二个有效数字,它的中间部分像植物的茎,两边部分像植物茎上长出 来的叶子,因此通常把这样的图叫做茎叶图。 来的叶子,因此通常把这样的图叫做茎叶图。 2.茎叶图的特征: .茎叶图的特征: 用茎叶图表示数据有两个优点:一是从统计图上没有原始数据信息的损失, (1)用茎叶图表示数据有两个优点:一是从统计图上没有原始数据信息的损失,所有数据 信息都可以从茎叶图中得到;二是茎叶图中的数据可以随时记录,随时添加, 信息都可以从茎叶图中得到;二是茎叶图中的数据可以随时记录,随时添加,方便记 录与表示。 录与表示。 茎叶图只便于表示两位有效数字的数据, 且茎叶图只方便记录两组的数据, (2)茎叶图只便于表示两位有效数字的数据,而且茎叶图只方便记录两组的数据,两个 以上的数据虽然能够记录,但是没有表示两个记录那么直观,清晰。 以上的数据虽然能够记录,但是没有表示两个记录那么直观,清晰。 三、典型例题 例题精析】 【例题精析】 人的身高(单位cm cm) 例 1 下表给出了某校 500 名 12 岁男孩中用随机抽样得出的 120 人的身高(单位cm) 观察表和图, 观察表和图,得 出结论 2 分钟
高中数学人教版A版必修三课时作业习题及答案:第二章2-2 用样本估计总体
第二章统计2.2 用样本估计总体2.2.1用样本的频率分布估计总体分布课时目标 1.理解用样本的频率分布估计总体分布的方法.2.会列频率分布表,画频率分布直方图,频率分布折线图,茎叶图.3.能够利用图形解决实际问题.1,用样本估计总体的两种情况(1)用样本的____________估计总体的分布.(2)用样本的____________估计总体的数字特征.2,数据分析的基本方法(1)借助于图形分析数据的一种基本方法是用图将它们画出来,此法可以达到两个目的,一是从数据中____________,二是利用图形________信息.(2)借助于表格分析数据的另一方法是用紧凑的________改变数据的排列方式,此法是通过改变数据的____________,为我们提供解释数据的新方式.3,频率分布直方图在频率分布直方图中,纵轴表示____________,数据落在各小组内的频率用________________来表示,各小长方形的面积的总和等于____.4,频率分布折线图和总体密度曲线(1)频率分布折线图连接频率分布直方图中各小长方形__________,就得到了频率分布折线图.(2)总体密度曲线随着样本容量的增加,作图时所分的____增加,组距减小,相应的频率分布折线图就会越来越接近于一条________,统计中称之为总体密度曲线,它反映了总体在各个范围内取值的百分比.5,茎叶图(1)适用范围:当样本数据较少时,用茎叶图表示数据的效果较好.(2)优点:它不但可以____________,而且可以__________,给数据的记录和表示都带来方便.(3)缺点:当样本数据______时,枝叶就会很长,茎叶图就显得不太方便.一、选择题1,下列说法不正确的是()A,频率分布直方图中每个小矩形的高就是该组的频率B,频率分布直方图中各个小矩形的面积之和等于1C,频率分布直方图中各个小矩形的宽一样大D,频率分布折线图是依次连接频率分布直方图的每个小矩形上端中点得到的2,一个容量为100的样本,其数据的分组与各组的频数如下:组别(0,10] (10,20] (20,30] (30,40] (40,50] (50,60] (60,70] 频数12 13 24 15 16 13 7 则样本数据落在(10,40]上的频率为()A,0.13 B.0.39 C.0.52 D.0.643,100辆汽车通过某一段公路时的时速的频率分布直方图如下图所示,则时速在[60,70)的汽车大约有()A.30辆B.40辆C,60辆D.80辆4,如图是总体密度曲线,下列说法正确的是()A,组距越大,频率分布折线图越接近于它B,样本容量越小,频率分布折线图越接近于它C,阴影部分的面积代表总体在(a,b)内取值的百分比D,阴影部分的平均高度代表总体在(a,b)内取值的百分比5,一个容量为35的样本数据,分组后,组距与频数如下:[5,10),5个;[10,15),12个;[15,20),7个;[20,25),5个;[25,30),4个;[30,35),2个.则样本在区间[20,+∞)上的频率为()A,20% B.69%C,31% D.27%6,某工厂对一批产品进行了抽样检测.右图是根据抽样检测后的产品净重(单位:克)数据绘制的频率分布直方图,其中产品净重的范围是[96,106],样本数据分组为[96,98),[98,100),[100,102),[102,104),[104,106],已知样本中产品净重小于100克的个数是36,则样本中净重大于或等于98克并且小于104克的产品的个数是()A,90 B.75 C.60 D.45题号 1 2 3 4 5 6答案二、填空题7,将容量为n的样本中的数据分成6组,绘制频率分布直方图.若第一组至第六组数据的频率之比为2∶3∶4∶6∶4∶1,且前三组数据的频数之和等于27,则n=________. 8,在如图所示的茎叶图中,甲,乙两组数据的中位数分别是________.9.在抽查产品的尺寸过程中,将其尺寸分成若干组,[a,b)是其中的一组,抽查出的个体在各组上的频率为m,该组上直方图的高为h,则|a-b|=________.三、解答题10,抽查100袋洗衣粉,测得它们的重量如下(单位:g):494498493505496492485483508 511495494483485511493505488 501491493509509512484509510 495497498504498483510503497 502511497500493509510493491 497515503515518510514509499 493499509492505489494501509 498502500508491509509499495 493509496509505499486491492 496499508485498496495496505 499505496501510496487511501496(1)列出样本的频率分布表:(2)画出频率分布直方图,频率分布折线图;(3)估计重量在[494.5,506.5]g的频率以及重量不足500 g的频率.能力提升11,在某电脑杂志的一篇文章中,每个句子的字数如下:10,28,31,17,23,27,18,15,26,24,20,19,36,27,14,25,15,22,11,24,27,17在某报纸的一篇文章中,每个句子的字数如下:27,39,33,24,28,19,32,41,33,27,35,12,36,41,27,13,22,23,18,46,32,22(1)将这两组数据用茎叶图表示;(2)将这两组数据进行比较分析,你会得到什么结论?12,某市2010年4月1日-4月30日对空气污染指数的监测数据如下(主要污染物为可吸入颗粒物):61,76,70,56,81,91,92,91,75,81,88,67,101,103,95,91,77,86,81,83,82,82,64,79,86,85,75,71,49,45.(1)完成频率分布表.(2)作出频率分布直方图.(3)根据国家标准,污染指数在0~50之间时,空气质量为优;在51~100之间时,为良;在101~150之间时,为轻微污染;在151~200之间时,为轻度污染.请你依据所给数据和上述标准,对该市的空气质量给出一个简短评价.答案: 2.2.1 用样本的频率分布估计总体分布 知识梳理1,(1)频率分布 (2)数字特征 2.(1)提取信息 传递 (2)表格 构成形式 3.频率/组距 小长方形的面积 1 4.(1)上端的中点 (2)组数 光滑曲线5,(2)保留所有信息 随时记录 (3)较多作业设计1,A 2,C [样本数据落在(10,40]上的频数为13+24+15=52,故其频率为52100=0.52.] 3,B [时速在[60,70)的汽车的频率为:0,04×(70-60)=0.4,又因汽车的总辆数为100, 所以时速在[60,70)的汽车大约有0.4×100=40(辆).]4,C5,C [由题意,样本中落在[20,+∞)上的频数为5+4+2=11,∴在区间[20,+∞)上的频率为1135≈0.31.]6,A [∵样本中产品净重小于100克的频率为(0.050+0.100)×2=0.3,频数为36, ∴样本总数为360.3=120.∵样本中净重大于或等于98克并且小于104克的产品的频率为(0.100+0.150+0.125)×2=0.75,∴样本中净重大于或等于98克并且小于104克的产品的个数为120×0.75=90.] 7,60解析 ∵n·2+3+42+3+4+6+4+1=27, ∴n =60.8,45,46解析 由茎叶图及中位数的概念可知x 甲中=45,x 乙中=46. 9.m h解析频率组距=h ,故|a -b|=组距=频率h =m h . 10,解 (1)在样本数据中,最大值是518,最小值是483,它们相差35,若取组距为4,由于354=834,要分9组,组数合适,于是决定取组距为4 g ,分9组,使分点比数据多一位小数,且把第一组起点稍微减小一点,得分组如下:[482.5,486.5),[486.5,490.5),…,[514.5,518.5). 列出频率分布表:分组 个数累计 频数 频率 累积频率 [482.5,486.5) 正 8 0.08 0.08 [486.5,490.5) 3 0.03 0.11[490.5,494.5) 正正正 17 0.17 0.28 [494.5,498.5) 正正正正- 21 0.21 0.49 [498.5,502.5) 正正 14 0.14 0.63 [502.5,506.5) 正 9 0.09 0.72[506.5,510.5) 正正正 19 0.19 0.91 [510.5,514.5) 正- 6 0.06 0.97[514.5,518.5] 3 0.03 1.00合计 100 1.00(2)频率分布直方图与频率分布折线图如图.(3)重量在[494.5,506.5]g 的频率为:0.21+0.14+0.09=0.44.设重量不足500 g 的频率为b ,根据频率分布表,b -0.49500-498.5≈0.63-0.48502.5-498.5,故b ≈0.55.因此重量不足500 g 的频率约为0.55. 11,解 (1)(2)电脑杂志上每个句子的字数集中在10~30之间;而报纸上每个句子的字数集中在20~40之间.还可以看出电脑杂志上每个句子的平均字数比报纸上每个句子的平均字数要少.说明电脑杂志作为科普读物需要通俗易懂、简明.12,解 (1)(2)(3)答对下述两条中的一条即可:①该市有一个月中空气污染指数有2天处于优的水平,占当月天数的115;有26天处于良的水平,占当月天数的1315;处于优或良的天数为28,占当月天数的1415.说明该市空气质量基本良好.②轻微污染有2天,占当月天数的115;污染指数在80以上的接近轻微污染的天数15,加上处于轻微污染的天数2,占当月天数的1730,超过50%;说明该市空气质量有待进一步改善.2.2.2用样本的数字特征估计总体的数字特征课时目标 1.会求样本的众数,中位数,平均数,标准差,方差.2.理解用样本的数字特征来估计总体数字特征的方法.3.会应用相关知识解决简单的统计实际问题.1,众数,中位数,平均数(1)众数的定义:一组数据中重复出现次数________的数称为这组数的众数.(2)中位数的定义及求法把一组数据按从小到大的顺序排列,把处于最______位置的那个数称为这组数据的中位数.①当数据个数为奇数时,中位数是按从小到大顺序排列的__________那个数.②当数据个数为偶数时,中位数为排列的最中间的两个数的________.(3)平均数①平均数的定义:如果有n个数x1,x2,…,x n,那么x=____________,叫做这n个数的平均数.②平均数的分类:总体平均数:________所有个体的平均数叫总体平均数.样本平均数:________所有个体的平均数叫样本平均数.2,标准差,方差(1)标准差的求法:标准差是样本数据到平均数的一种平均距离,一般用s表示.s=________________________________________________________________________.(2)方差的求法:标准差的平方s2叫做方差.s2=________________________________________________________________________.一、选择题1,下列说法正确的是()A,在两组数据中,平均值较大的一组方差较大B,平均数反映数据的集中趋势,方差则反映数据离平均值的波动大小C,方差的求法是求出各个数据与平均值的差的平方后再求和D,在记录两个人射击环数的两组数据中,方差大的表示射击水平高2,已知10名工人生产同一零件,生产的件数分别是16,18,15,11,16,18,18,17,15,13,设其平均数为a,中位数为b,众数为c,则有()A,a>b>c B.a>c>bC,c>a>b D.c>b>a3,甲,乙两位同学都参加了由学校举办的篮球比赛,他们都参加了全部的7场比赛,平均得分均为16分,标准差分别为5.09和3.72,则甲,乙两同学在这次篮球比赛活动中,发挥得更稳定的是()A,甲B.乙C,甲,乙相同D.不能确定4,一组数据的方差为s2,将这组数据中的每个数据都扩大3倍,所得到的一组数据的方差是()A.13s2B.s2C,3s2D.9s25,如图是2010年某校举行的元旦诗歌朗诵比赛中,七位评委为某位选手打出分数的茎叶统计图,去掉一个最高分和一个最低分,所剩数据的平均数和方差分别为()A,84,4.84 B.84,1.6C,85,1.6 D.85,0.46,如图,样本A和B分别取自两个不同的总体,它们的样本平均数分别为x A和x B,样本标准差分别为s A和s B则()A.x A>x B,s A>s BB.x A<x B,s A>s BC.x A>x B,s A<s BD.x A<x B,s A<s B题号 1 2 3 4 5 6答案二、填空题7,已知样本9,10,11,x,y的平均数是10,方差是4,则xy=________.8,甲,乙两名射击运动员参加某大型运动会的预选赛,他们分别射击了5次,成绩如下表(单位:环):甲10 8 9 9 9乙10 10 7 9 9如果甲,乙两人只能有1人入选,则入选的应为________.9,若a1,a2,…,a20,这20个数据的平均数为x,方差为0.20,则数据a1,a2,…,a20,x这21个数据的方差为________.三、解答题10,甲,乙两人在相同条件下各射靶10次,每次射靶的成绩情况如图所示:(1)请填写表:平均数方差中位数命中9环及9环以上的次数甲乙(2)请从下列四个不同的角度对这次测试结果进行分析:①从平均数和方差相结合看(分析谁的成绩更稳定);②从平均数和中位数相结合看(分析谁的成绩好些);③从平均数和命中9环及9环以上的次数相结合看(分析谁的成绩好些);④从折线图上两人射击命中环数的走势看(分析谁更有潜力).能力提升11,下面是一家快餐店所有工作人员(共7人)一周的工资表:总经理大厨二厨采购员杂工服务员会计3 000元450元350元400元320元320元410元(1)计算所有人员一周的平均工资;(2)计算出的平均工资能反映一般工作人员一周的收入水平吗?(3)去掉总经理的工资后,再计算剩余人员的平均工资,这能代表一般工作人员一周的收入水平吗?12,1,平均数、众数、中位数都是描述数据的集中趋势的,其中平均数是最重要的量.众数体现了样本数据的最大集中点,但它对其他数据信息的忽视使得无法客观地反映总体特征;中位数是样本数据所占频率的等分线,它不受少数几个极端值的影响,这在某些情况下是优点,但它对极端值的不敏感有时也成为缺点,因为这些极端值有时是不能忽视的.由于平均数与每一个样本的数据有关,所以任何一个样本数据的改变都会引起平均数的改变,这是众数、中位数不具有的性质.也正因为这个原因,与众数、中位数比较起来,平均数可以反映出更多的关于样本数据全体的信息.但平均数受数据中的极端值的影响较大,使平均数在估计总体时可靠性降低.2,在频率分布直方图中,中位数左边和右边的直方图的面积应该相等.3,极差、方差、标准差是描述数据的离散程度的,即各数据与其平均数的离散程度.标准差、方差描述了一组数据围绕平均数波动的大小.标准差、方差越大,数据的离散程度越大;标准差、方差越小,数据的离散程度越小.答案:2,2.2用样本的数字特征估计总体的数字特征知识梳理1,(1)最多 (2)中间 ①中间位置的 ②平均数 (3)①x 1+x 2+…+x n n ②总体中 样本中2,(1)1n[(x 1-x )2+(x 2-x )2+…+(x n -x )2] (2)1n [(x 1-x )2+(x 2-x )2+…+(x n -x )2] 作业设计1,B [A 中平均值和方差是数据的两个特征,不存在这种关系;C 中求和后还需取平均数;D 中方差越大,射击越不平稳,水平越低.]2,D [由题意a =110(16+18+15+11+16+18+18+17+15+13)=15710=15.7,中位数为16,众数为18,即b =16,c =18,∴c>b>a.]3,B [方差或标准差越小,数据的离散程度越小,表明发挥得越稳定.∵5.09>3.72,故选B .]4,D [s 20=1n [9x 21+9x 22+…+9x 2n -n(3x )2]=9·1n(x 21+x 22+…+x 2n -n x 2)=9·s 2(s 20为新数据的方差).]5,C [由题意x =15(84+84+86+84+87)=85.s 2=15[(84-85)2+(84-85)2+(86-85)2+(84-85)2+(87-85)2]=15(1+1+1+1+4)=85=1.6.]6,B [样本A 数据均小于或等于10,样本B 数据均大于或等于10,故x A <x B , 又样本B 波动范围较小,故s A >s B .] 7,91解析 由题意得8,甲解析 x 甲=9,2S 甲=0.4,x 乙=9,2S 乙=1.2,故甲的成绩较稳定,选甲.9,0.19 解析 这21个数的平均数仍为20,从而方差为121×[20×0.2+(20-20)2]≈0.19. 10,解 由折线图,知甲射击10次中靶环数分别为:9,5,7,8,7,6,8,6,7,7.将它们由小到大重排为:5,6,6,7,7,7,7,8,8,9.乙射击10次中靶环数分别为: 2,4,6,8,7,7,8,9,9,10.也将它们由小到大重排为:2,4,6,7,7,8,8,9,9,10.(1)x 甲=110×(5+6×2+7×4+8×2+9)=7010=7(环), x 乙=110×(2+4+6+7×2+8×2+9×2+10)=7010=7(环),s 2甲=110×[(5-7)2+(6-7)2×2+(7-7)2×4+(8-7)2×2+(9-7)2]=110×(4+2+0+2+4)=1.2,s 2乙=110×[(2-7)2+(4-7)2+(6-7)2+(7-7)2×2+(8-7)2×2+(9-7)2×2+(10-7)2] =110×(25+9+1+0+2+8+9)=5.4. 根据以上的分析与计算填表如下:平均数 方差 中位数 命中9环及9环以上的次数甲 7 1.2 7 1乙 7 5.4 7.5 3 (2)①∵平均数相同,2S 甲<2S 乙,∴甲成绩比乙稳定. ②∵平均数相同,甲的中位数<乙的中位数,∴乙的成绩比甲好些.③∵平均数相同,命中9环及9环以上的次数甲比乙少,∴乙成绩比甲好些.④甲成绩在平均数上下波动;而乙处于上升势头,从第四次以后就没有比甲少的情况发生,乙较有潜力.11,解 (1)平均工资即为该组数据的平均数 x =17×(3 000+450+350+400+320+320+410)=17×5 250=750(元).(2)由于总经理的工资明显偏高,所以该值为极端值,因此由(1)所得的平均工资不能反映一般工作人员一周的收入水平.(3)除去总经理的工资后,其他工作人员的平均工资为:x ′=16×(450+350+400+320+320+410)=16×2 250=375(元).这个平均工资能代表一般工作人员一周的收入水平.12,解 设第一组20名学生的成绩为x i (i =1,2,…,20),第二组20名学生的成绩为y i (i =1,2,…,20), 依题意有:x =120(x 1+x 2+…+x 20)=90,y =120(y 1+y 2+…+y 20)=80,故全班平均成绩为:140(x 1+x 2+…+x 20+y 1+y 2+…+y 20)=140(90×20+80×20)=85;又设第一组学生成绩的标准差为s 1,第二组学生成绩的标准差为s 2,则s 21=120(x 21+x 22+…+x 220-20x 2),s 22=120(y 21+y 22+…+y 220-20y 2) (此处,x =90,y =80),又设全班40名学生的标准差为s ,平均成绩为z (z =85),故有s 2=140(x 21+x 22+…+x 220+y 21+y 22+…+y 220-40z 2) =140(20s 21+20x 2+20s 22+20y 2-40z 2) =12(62+42+902+802-2×852)=51. s =51.所以全班同学的平均成绩为85分,标准差为51.。
高中数学人教必修三课件:2.2.1用样本的频率分布估计总体分布
(2)当样本容量无限增大(无限大时即 认为到达总体时),作图时所分的组数增 加,组距无限缩小,那么频率散布折线图 就会无限接近于一条光滑曲线—总体密度 曲线。
总体密度曲线
频率 组距
月均用 水量/t
ab
图中阴影部分的面积,表示总体在某个区间 (a, b) 内取值的百分比(频率)。
通过抽样,我们获得了100位居民某年的月平均用水量(单位:t) ,如下表:
请同学们阅读教材66页到67页,了解并掌握如何用频率 散布表和频率散布直方图对样本数据进行统计分析?
画频率散布直方图的操作步骤
(一表一图的制作方法)
1.求极差.即数据中最大值与最小值的差 2.决定组距与组数 :组数=极差/组距 3.将数据分组.通常对组内数值所在区间,取左闭右 开区间 , 最后一组取闭区间
总体密度曲线反应了总体在各个范围 内取值的百分比,精确地反应了总体的散 布规律。是研究总体散布的工具。
频率 组距
月均用 水量/t
ab
图中阴影部分的面积,表示总体在某个区间 (a, b) 内取值的百分比(频率)。
练习
有一个容量为50的样本数据的分组的频数如下:
[12.5, 15.5) 3
[24.5, 27.5) 10
4.列出频率散布表.计算频数和频率, 列出频率散布表
5.画出频率散布直方图(纵轴表示频率/组距)
100位居民月平均用水量的频率散布表
100位居民月平均用水量的频率散布直方图
频率/组距
0.50 0.40 0.30 0.20 0.10
0 0.5 1 1.5 2 2.5 3 3.5 4 4.5
月平均用水量/t
2.2.1 用样本的频率散布估计总体散布
- 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
- 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
- 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。
频率分布 (1)用样本的______________ 估计总体分布. 数字特征 (2)用样本的_____________ 估计总体的数字特征.
2.数据分析的基本方法 (1)借助于图形 分析数据的一种基本方法是用图将它们画出来, 此方法可以达到两个
提取信息 传递信息 . 目的,一是从数据中_____________ ,二是利用图形_____________
A
2.从一群学生中抽取一个一定容量的样本,对他们的学习成绩进行 分析. 已知不超过 80 分的为 10 人, 其累积频率为 0.5, 则样本容量是( A.20 C.80 B.40 D.60 )
10 【解析】 样本容量=0.5=20.
【答案】 A
教材整理 3 频率分布折线图和总体密度曲线 阅读教材 P69 的内容,完成下列问题. 1.频率分布折线图
2.茎叶图的优缺点
较少 在样本数据______________ 时,用茎叶图表示数据的效果较好.它不 记录 但可以保留所有信息,而且可以随时______________ ,这对数据的记录和
较多 表示都能带来方便.但是当样本数据______________ 时,茎叶图就显得不
太方便,因为每一个数据都要在图中占据一个空间,如果数据很多,枝叶 就会很长.
教材整理 4 茎叶图 阅读教材 P70 的内容,完成下列问题. 1.茎叶图的制作方法
茎 将 所 有 两 位 数 的 十 位 数 字 作 为 ______________ ,个位数字作为
叶 小到大 ______________ ,茎相同者共用一个茎,茎按从______________ 的顺序从
上向下列出.
山东省为了了解和掌握 2016 年高考考生的实际答卷情况, 随机地取出了 100 名考生的数学成绩,数据如下:(单位:分) 135 98 102 110 99 121 110 96 100 103 125 97 117 113 110 92 102 109 104 112 105 124 87 131 97 102 123 104 104 128
Байду номын сангаас
阅读教材 P66~P68 的内容,完成下列问题. 画频率分布直方图的步骤
1.一个容量为 80 的样本中,数据的最大值为 152,最小值为 60,组 距为 10,应将样本数据分为( A.10 组 C.8 组
【解析】
【答案】
) B.9 组 D.7 组
152-60 由题意可知, =9.2,故应将数据分为 10 组. 10
(2)借助于表格
表格 分 析 数 据 的 另 一 种 方 法 是 用 紧 凑 的 _____________ 改变数据的
排列方式 构成 __________________ ,此方法是通过改变数据的____________ 形式,为我 解释 们提供___________数据的新方式.
教材整理 2
频率分布直方图
2.2 用样本估计总体 2.2.1 用样本的频率分布估计总体分布
1.理解用样本的频率分布估计总体分布的方法. 2. 会列频率分布表, 画频率分布直方图、 频率分布折线图、 茎叶图. (重 点) 3.能够利用图形解决实际问题.(难点)
[基础· 初探] 教材整理 1 用样本估计总体、数据分析 的基本方法 阅读教材 P65~P66 上半部分的内容,完成下列问题. 1.用样本估计总体的两种情况
1.判断(正确的打“√”,错误的打“×”) (1)样本容量越大,估计的越准确.( (2)频率分布直方图的纵轴表示频率.( (3)茎叶图不能增加数据.(
【答案】 (1)√ (2)× (3)×
) )
)
2.如图 221 是一个班的语文成绩的茎叶图(单位:分),则优秀率(90 分以上)是________,最低分是________. 5 15 6 034467889 7 3555679 8 023357 9 1 图 221
上端的中点 连接频率分布直方图中各小长方形________________, 就得到了频率
分布折线图. 2.总体密度曲线
组数 随着样本容量的增加, 作图时所分的______________ 也在增加, 组距减小, 光滑曲线 相应的频率分布折线图就会越来越接近于一条______________ , 统计中称 之为总体密度曲线,它反映了总体在各个范围内取值的百分比.
分组 [80,85) [85,90) [90,95) [95,100) [100,105) [105,110) [110,115) [115,120) [120,125) [125,130) [130,135] 合计
频数 1 2 4 14 24 15 12 9 11 6 2 100
109 123 111 103 105 92 114 108 104 102 129 126 97 100 115 111 106 117 104 109 111 89 110 121 80 120 121 104 108 118 129 99 90 99 121 123 107 111 91 100 99 101 116 97 102 108 101 95 107 101 102 108 117 99 118 106 119 97 126 108 123 119 98 121 101 113 102 103 104 108
【解析】 由茎叶图知,样本容量为 25,90 分以上的有 1 人,故优 1 秀率为 =4%,最低分为 51 分. 25
【答案】 4% 51
[质疑· 手记] 预习完成后,请将你的疑问记录,并与“小伙伴们”探讨交流: 疑问 1: 解惑: 疑问 2: 解惑: 疑问 3: 解惑:
[小组合作型]
频率分布直方图的绘制
(1)列出频率分布表; (2)画出频率分布直方图和折线图; (3)估计该省考生数学成绩在[100,120)分之间的比例.
【精彩点拨】 先求极差.根据极差与数据个数确定组距、组数,然 后按频率分布直方图的画法绘制分析.
【尝试解答】 100 个数据中,最大值为 135,最小值为 80,极差为 55 135-80=55.取组距为 5,则组数为 =11. 5 (1)频率分布表如下: