第五章_抽样推断
第5章--抽样分布与参数估计教案资料

(5)
(5.5)
(6)
(6.5)
(7)
(7.5)
(8)
(8.5)
(9)
9
9,1
9,2
9,3
9,4
9,5
9,6
9,7
9,8
9,9
9,10
(5)
(5.5)
(6)
(6.5)
(7)
(7.5)
(8)
(8.5)
(9)
(9.5)
10
10,1
10,2
10,3
10,4
10,5
10,6
10,7
10,8
10,9
10,10
数是 ,标准差是 ,从这个总体中抽出一 个容量是 n 的样本,则样本平均数 X 也服从 正态分布,其平均数 E( X ) 仍为 ,其标准
差为 。 X 5-19
从正态分布的再生定理可以看出,只要总体 变量服从正态分布,则从中抽取的样本,不管n 是多少,样本平均数都服从正态分布。但是在 客观实际中,总体并非都是正态分布。对于从 非正态分布的总体中抽取的样本平均数的分布 问题,需要由中心极限定理来解决。
第5章--抽样分布与参数估计
第一节 抽样的基本概念与数学原理
一、有关抽样的基本概念 二、大数定理与中心极限定理
5-2
一、有关抽样的基本概念
(一)样本容量与样本个数 1.样本容量。样本是从总体中抽出的部分
单位的集合,这个集合的大小称为样本容量, 一般用n表示,它表明一个样本中所包含的单 位数。
lim
n
1 n
p
n
i 1
X
i
1
(5.5)
5-17
大数定理表明:尽管个别现象受偶然因 素影响,有各自不同的表现。但是,对总体 的大量观察后进行平均,就能使偶然因素的 影响相互抵消,消除由个别偶然因素引起的 极端性影响,从而使总体平均数稳定下来, 反映出事物变化的一般规律。
抽样推断的一般问题抽样误差

抽样平均误差是抽样平均数或抽样成数的标准差,反映了抽样指标与总体指标的平均误差程度。
例如:假设总体包含1、2、3、4、5,五个数字。
则:总体平均数为 =(1+2+3+4+5)/5=3
现在,采用重复抽样从中抽出两个,组成一个样本。可能组成的样本数目:25个。
如:(1+3)/2=2、(1+4)/2=2.5、(2+4)/2=3、(3+5)/2=4…
二、抽样推断的内容
参数估计:参数估计是依据所获得的样本观察资料,对所研究现象总体的水平、结构、规模等数量特征进行估计。
假设检验:假设检验是利用样本的实际资料来检验事先对总体某些数量特征所作的假设是否可信的一种统计分析方法。
三、有关抽样的基本概念
(一)总体和样本
总体:又称全及总体。指所要认识的研究对象全体。总体单位总数用“N”表示。
上式可变形为:Δ=tμ(极限误差是t倍的抽样平均误差)
例题二:某厂生产一种新型灯泡共2000只,随机抽出400只作耐用时间试验,测试结果
平均使用寿命为4800小时,样本标准差为300小时,求抽样推断的平均误差?
解:已知:N=2000n=400σx=300 =4800
则:
计算结果表明:根据部分产品推断全部产品的平均使用寿命时,采用不重复抽样比重复抽样的平均误差要小。
②抽样平均数的标准差仅为总体标准差的
③可通过调整样本单位数来控制抽样平均误差。
例题:假定抽样单位数增加2倍、0.5倍时,抽样平均误差怎样变化?
解:抽样单位数增加2倍,即为原来的3倍
则:
即:当样本单位数增加2倍时,抽样平均误差为原来的0.577倍。
抽样单位数增加0.5倍,即为原来的1.5倍
统计学 第五章

第五章 抽样推断抽样推断定义:是一种非全面调查,是按随机原则,从总体中抽取一部分单位进行调查,并以其结果对总体某一数量特征作出估计和推断的一种统计方法。
(一) 总体和样本在抽样推断中面临两个不同的总体,即全及总体和样本总体,全及总体也叫母体,简称总体。
全及总体的单位数用N 表示全及总体⎪⎩⎪⎨⎧⎩⎨⎧属性总体有限总体无限总体变量总体样本总体又叫抽样总体、子样,简称样本,样本总体的单位数称样本容量,用n 表示。
(二) 参数和统计量参数亦称全及指标,由于全及总体是唯一确定的,故根据全及总体计算的参数也是个定值 对于属性总体,可以有如下参数,全及总体成数p ,全及总体标准差)(2p p σσ方差 属性总体标准差:()p p p-=1σ统计量即样本指标设样本总体有n 个变量:n x x x x ,...,,,321 则:样本平均数 nx x ∑=(三) 样本容量与样本个数样本容量是指一个样本所包含的单位数,用n 来表示,一般地,样本单位数达到或超过30个的样本称为大样本,而在30个以下称为小样本。
社会经济统计的抽样推断多属于大样本,而科学实验的抽样观察则多取小样本。
样本个数又称样本可能数目,是指从全及总体中可能抽取的样本的个数。
一个总体可能抽取多少样本,与样本容量大小有关,也与抽样的方法有关。
在样本容量确定之后,样本的可能数目便完全取决于抽样方法。
抽样误差是抽样调查自身所固有的,不可避免的误差,虽然不能消除这种误差,但有办法进行计算,并能对其加以控制。
抽样平均误差越大,表示样本的代表性越低;抽样平均误差越小,表示样本的代表性越高。
在重复简单随机抽样时,样本平均数的抽样分布有数学期望值E(a)=a(a代表全及总体平均数,即X)X⇔。
样本平均数的平均数=总体平均数抽样平均误差=抽样标准误差=样本平均数的标准差(它反映抽样平均数与总体平均数的平均误差程度)例题:某班组4个工人的月工资(N=4)分别是:1400元,1500元,1600元,1700元,现用重复简单随机抽样的方法从全及总体中抽选出容量大小为2的样本(n=2),求抽样平均误差?解:全及总体平均工资)(15501700160015001400元=+++=X全及总体标准差()4500002=-=∑NX Xσ抽样平均误差x μ=nnσσ=2=)(0569.792*450000元=例题:某班组4个工人的月工资(N=4)分别是:1400元,1500元,1600元,1700元,现用不重复简单随机抽样的方法从全部总体中抽选容量大小为2的样本(n=2),求抽样平均误差?解:全及总体平均工资)(155041700160015001400元=+++==∑NXX全及总体标准差()4500002=-=∑NX Xσx μ=⎪⎭⎫ ⎝⎛--∙12N n N n σ=)(55.6414244*250000元=--∙例题:某电子元件厂,生产某型号晶体管,按正常生产试验,产品中属于一级品的占70%,现在从10000件晶体管中,抽取100件进行抽查检验,求一级品率的抽样平均误差? 解:已知:P=0.7 , P(1-P)=0.21在重复抽样的情况下,抽样平均误差为:()np p p -=1μ=%58.410021.0=在不重复抽样的情况下,抽样平均误差为:()⎪⎭⎫⎝⎛-∙-=N n n p p p 11μ=%56.410000*********.0=⎪⎭⎫ ⎝⎛-∙参数估计()()⎪⎪⎩⎪⎪⎨⎧→-==+≤≤是概率度是置信度,极限误差)样本指标总体指标极限误差—(样本指标区间估计:求不高的情况准确程度与可靠程度要点估计:适用于推断的t t F t F P α1例题:已知某车间某产品的合格率在某个置信度下的估计区间是(85%,95%),还已知样本容量为100,求置信度?解:显然p p ∆-=85%,p p ∆+=95%,即p=90%,p ∆=5%p ∆=μ⋅t μpt ∆=⇒=()()67.1100%901%90%51=-∙=-∆np p p ()t F =0.9052即置信度为90.51% ★求置信度,只需要求出t影响抽样数目的因素⎪⎪⎪⎪⎩⎪⎪⎪⎪⎨⎧∆样本单位不重置抽样可以少抽些单位,抽样需要多抽一些样本、在同等条件下,重置单位,则反之值越大,则多抽些样本、概率度则反之单位,的值大可以少抽些样本)、允许误差(极限误差越多,则反之值越大,必要抽样数目、总体标准差4321t x σ例题:某城市组织职工家庭生活抽样调查,职工家庭平均每户每月收入的标准差为11.50元,要求把握程度为95.45%,允许误差为1元,问需抽选多少户? 解:()t F =0.95452=⇒t , 元元,150.11=∆=x σxt n 222∆=σ=()户529150.1142=∙。
第5章__抽样推断

抽样误差的影响因素
(1)总体各单位标志变异程度。 (2)样本容量的大小。 (3)抽样方法。 (4)抽样的组织形式。
四、抽样极限误差
含义:
抽样极限误差指在进行抽样估计时,根据研究对象的变 异程度和分析任务的要求所确定的样本指标与总体指标 之间可允许的最大误差范围。
计算方法:
它等于样本指标可允许变动的上限或下限与总体指标 之差的绝对值。
则:
x
n
10 1(公斤) 100
即:当根据样本学生的平均体重估计全部学生的平均 体重时,抽样平均误差为1公斤。
例题二解 已知: N 2000, n 400, x 4800, 300
则:
x
n
300 15(小时) 400
x
2 1 n
3002 1
400
13.42(小时)
n N
-20
400
-15
225
-5
25
0
0
-15
225
-10
100
0
0
5
25
-5
25
0
0
10
100
15
225
0
0
5
25
15
225
20
400
0
2000
样本平均数的平均数( x )
x
样本可能数目
960 16
60元
所以 (x) X
样抽样平均误差x
x (x)2
样本可能数目
2000 11.18元 16
四个工人工资分别为40、50、70、80元
抽样平均误差 x
n
15.81 11.18元 2
第五章练习一、判断题 1、抽样推断是利用样本资料对总体的数.

2、在一定的抽样平均误差条件下( A )。 A、扩大极限误差范围,可以提高推断的可靠程度 B、扩大极限误差范围,会降低推断的可靠程度 C、缩小极限误差范围,可以提高推断的可靠程度 D、缩小极限误差范围,不改变推断的可靠程度
3、反映样本指标与总体指标之间的平均误差程度 的指标是( C )。 A、抽样误差系数 B、概率度 C、抽样平均误差 D、抽样极限误差
8、采用类型抽样的组织形式( ABD )。 A、需要对总体各单位进行分组 B、适用于总体各单位标志值差异较大的总体 C、随机抽选其中的某一类型,并对其所有单 位进行调查 D、抽样误差较小 E、最符合随机原则
四、填空题 1、抽样推断是在(抽样调查 )的基础上,利用样 本资料计算样本指标,并据以推算( 总体数量特 征 )特征 的一种统计分析方法。 2、从全部总体单位中随机抽选样本单位的方法有两 种,即(重复 )抽样和(不重复 )抽样。
2
f
148.5 150.3 10 151.5 150.3 20
2 2
100
32.4 12.8 2 28.8 100
76 0.872 100
x
n
x
0.872 100
பைடு நூலகம்0.0872
t 3 0.0872 0.2616
12、假定一个拥有一亿人口的大国和百万人口 的小国居民年龄变异程度相同,现在各自用 重复抽样方法抽取本国的1%人口计算平均年 龄,则平均年龄抽样平均误差(D)。 A、不能确定 B、两者相等 C、前者比后者大 D、前者比后者小
三、多项选择题 1、在抽样平均误差一定的条件下,( AD ) A、扩大极限误差的范围,可以提高推断的可靠程度 B、缩小极限误差范围,可以提高推断的可靠程度 C、扩大极限误差的范围,只能降低推断的可靠程度 D、缩小极限误差的范围,只能降低推断的可靠程度 E、扩大极限误差的范围与推断的可靠程度无关
统计学第五章抽样习题

11.用抽样指标估计总体指标应满足的要求是( )
A、一致性 B、准确性 C、客观性
D、无偏性 E、有效性
12.在其他条件不变的情况下,下列关于抽样平均误差、总体变 异程度及样本容量之间关系的陈述,正确的有( )
A、总体变异程度一定时,样本容量越大,抽样平均误差越大
B、总体变异程度一定时,样本容量越大,抽样平均误差越小
B、抽样单位数占总体单位数的比重很大时
C、抽样单位数目很少时
D、抽样单位数目很多时
2020/3/17
7
10、在其他条件不变的情况下,抽样单位数目和抽样误差的关系 是( ) A、抽样单位数目越大,抽样误差越大 B、抽样单位数目越大,抽样误差越小 C、抽样单位数目的变化与抽样误差的数值无关 D、抽样误差变化程度是抽样单位数变动程度的1/2
19、随着样本单位数的无限增大,样本指标和未知的总体
指标之差的绝对值小于任意小的正整数的可能性趋于
必然性,称为抽样估计的( )
A、无偏性
B、一致性
C、有效性
D、 充足性
20、能够事先加以计算和控制的误差是( )
A、抽样误差
B、登记误差
C、标准差
D、标准差系数
2020/3/17
13
21、在一定抽样平均误差的条件下,要提高推断的可靠
;
;
;
。
10.对于简单随机重复抽样,若其他条件不变,则当误差范围
缩小一半,抽样单位数必须
倍,若误差范围扩大一
倍,则抽样单位数为原来的
。
11.点估计是直接用
估计不考虑
及
估计总体指标的推断方法。点 。
2020/3/17
29
14. 抽样法的基本特点是( )
统计学第5章抽样推断

任 何 抽 样 误 差 因 素 。 即 用 x直 接 代 表 X , 用 p 直 接 代 表 P。
例 在 全 部 产 品 中 , 抽 取 100件 进 行 仔 细 检 查 , 得 到 平 均 重 量 x1002克 , 合 格 率 p98% , 我 们 直 接 推 断 全 部 产 品 的 平 均 重 量 X 1002克 , 合 格 率 P 98% 。
(1)
2
n
(1 )
12 2 (1
100
) 1.19 (千克 )
x
n
N
100 10000
(2) 若以概率 95.45%(t 2)保证,该农场 10000 亩小麦的平均
亩产量的可能范围为:
X : x 400 2 1.19 x
X (: 397 .62 ,402.38 ) (3) 若以概率 99.73%(t 3)保证,该农场 10000 亩小麦的平均
在重复抽样情况下:
p (1 p )
p
n
在不重复抽样情况下:
p (1 p ) n
(1 )
p
n
N
例
某玻璃器皿厂某日生产15000只印花玻璃 杯,现按重复抽样方式从中抽取150只进行 质量检验,结果有147只合格,其余3只为不 合格品,试求这批印花玻璃杯合格率(成数) 的抽样平均误差。
N15000n150
二、区间估计
根据样本指标和抽样误差去推断全及 指标的可能范围,它能说清楚估计的准 确程度和把握程度。
总体平均数和总体成数的估计
X :(x x, x x)
1的概率保证下:x tx
P:(pp, pp)
1的概率保证下: p tp
统计学第五章课后题及答案解析

第五章一、单项选择题1.抽样推断的目的在于( )A.对样本进行全面调查 B.了解样本的基本情况C.了解总体的基本情况 D.推断总体指标2.在重复抽样条件下纯随机抽样的平均误差取决于( )A.样本单位数 B.总体方差C.抽样比例 D.样本单位数和总体方差3.根据重复抽样的资料,一年级优秀生比重为10%,二年级为20%,若抽样人数相等时,优秀生比重的抽样误差( )A.一年级较大 B.二年级较大C.误差相同 D.无法判断4.用重复抽样的抽样平均误差公式计算不重复抽样的抽样平均误差结果将( )A.高估误差 B.低估误差C.恰好相等 D.高估或低估5.在其他条件不变的情况下,如果允许误差缩小为原来的1/2,则样本容量( )A.扩大到原来的2倍 B.扩大到原来的4倍C.缩小到原来的1/4 D.缩小到原来的1/26.当总体单位不很多且差异较小时宜采用( )A.整群抽样 B.纯随机抽样C.分层抽样 D.等距抽样7.在分层抽样中影响抽样平均误差的方差是()A.层间方差 B.层内方差C.总方差 D.允许误差二、多项选择题1.抽样推断的特点有()A.建立在随机抽样原则基础上 B.深入研究复杂的专门问题C.用样本指标来推断总体指标 D.抽样误差可以事先计算E.抽样误差可以事先控制2.影响抽样误差的因素有( )A.样本容量的大小 B.是有限总体还是无限总体C.总体单位的标志变动度 D.抽样方法E.抽样组织方式3.抽样方法根据取样的方式不同分为( )A.重复抽样 B.等距抽样 C.整群抽样D.分层抽样 E.不重复抽样4.抽样推断的优良标准是( )A.无偏性 B.同质性 C.一致性D.随机性 E.有效性5.影响必要样本容量的主要因素有( )A.总体方差的大小 B.抽样方法C.抽样组织方式 D.允许误差范围大小E.要求的概率保证程度6.参数估计的三项基本要素有()A.估计值 B.极限误差C.估计的优良标准 D.概率保证程度E.显著性水平7.分层抽样中分层的原则是( )A.尽量缩小层内方差 B.尽量扩大层内方差C.层量扩大层间方差 D.尽量缩小层间方差E.便于样本单位的抽取三、填空题1.抽样推断和全面调查结合运用,既实现了调查资料的_______性,又保证于调查资料的_______性。
05第五章 抽样推断

置信水平
(confidence level)
1.
2.
将构造置信区间的步骤重复很多次,置信区间 包含总体参数真值的次数所占的比例,也称置 信度 表示为 (1 - 为是总体参数未在区间内的比例
3.
常用的置信水平值有 99%, 95%, 90% 相应的 为0.01,0.05,0.10
总体参数估计就是以样本统计量来估 计总体参数。 参数估计要求:
1. 精确性—适当的极限误差范围;
2. 可靠性—估计结果正确的概率。
参数估计—点估计和区间估计。
2014-3-30 第五章 抽样推断 20
2.2 点估计(point estimate)
点估计就是根据总体参数与样本统计 量之间的内在联系,直接以样本统计量 作为相应总体参数的估计值,点估计又 称为定值估计。 常用的点估计量有:
第五章
抽样推断
第一节 抽样推断及其特点
第二节 总体参数估计 第三节 假设检验概述
统计名言
不象其他科学,统计从来不打算使自 己完美无缺,统计意味着你永远不需 要确定无疑
—— Gudmund R.Iversen
参数估计在统计方法中的地位
统计方法
描述统计 推断统计
参数估计
2014-3-30 第五章 抽样推断
ˆ x X
2014-3-30
2 ( x x )
ˆp ˆ 2 S2 P
n1
21
第五章 抽样推断
估计量与估计值
(estimator & estimated value)
1. 2.
3. 4.
参数估计 (parameter estimation) 就是用样本统计量去估 计总体的参数 估计量:用于估计总体参数的统计量的名称 如样本均值,样本比例,样本方差等 例如: 样本均值就是总体均值 的一个估计量 参数用 表示,估计量用 表示 ˆ 估计值:估计参数时计算出来的统计量的具体值 如果样本均值 x =80,则80就是 的估计值
第五章《用样本推断总体》复习讲义(解析版)

第五章 用样本推断总体(考点讲义)1.样本容量:样本中个体的数目叫做样本容量。
2.在用样本特性估计总体特性时,要注意一是样本要有代表性,二是样本容量要足够大。
3.求平均数的公式:123nx x x x x n++++=L【类型一】利用样本平均数估算总体数量【例1】为了创设全新的校园文化氛围,进一步组织学生开展课外阅读,让学生在丰富多彩的书海中,扩大知识源,亲近母语,提高文学素养.某校准备开展“与经典为友、与名著为伴”的阅读活动,活动前对本校学生进行了“你最喜欢的图书类型(只写一项)”的随机抽样调查,相关数据统计如下:请根据以上信息解答下列问题:(1)该校对_____名学生进行了抽样调查,m = _____n =_____(2)请将图1和图2补充完整,并求出扇形统计图中小说所对应的圆心角度数;(3)已知该校共有学生800人,利用样本数据估计全校学生中最喜欢科幻人数约为多少人?【解析】(1)用其它初一它的百分比即可;(2)用360∘乘以所占得百分比;(3)用样本估计总体.解:(1)20÷10%=200(名).由图1,得n=40,m=100-20-10-40=30答:该校对200名学生进行了抽样调查;m=30,n=40(2)如图:小说对应的圆心角度数为360∘×20%=72∘;(3)800×30%=240.答:全校学生中最喜欢小说的人数约为240名.【对应训练1】为了估计湖里有多少条鱼,小刚先从湖里捞出了100条鱼做上标记,然后放回湖里去.经过一段时间,带有标记的鱼完全混合于鱼群后,小刚又从湖里捞出200条鱼,如果其中15条有标记,那么估计湖里有鱼()A.1333条B.3000条C.300条D.1500条【答案】A【解析】在样本中“捕捞200条鱼,发现其中15条有标记”,即可求得有标记的所占比例,而这一比例也适用于整体,据此即可解答.【对应训练2】我国古代数学名著《九章算术》有“米谷粒分”.粮仓开仓收粮,有人送来谷米1608石,验得其中夹有谷粒.现从中抽取谷米一把,共数得256粒,其中夹有谷粒32粒,则这批谷米内夹有谷粒约是________石.【答案】201【解析】根据256粒内夹谷32粒,可得比例,再乘以1608石,即可得出答案.【解答】解:根据题意,得1608×32=201(石),256∴这批谷米内夹有谷粒约201石.【对应训练3】某山区中学280名学生参加植树节活动,要求每人植3至6棵,活动结束后随机抽查了若干名学生每人的植树量,并分为四种类型,A:3棵;B:4棵;C:5棵;D:6棵,将各类的人数绘制成扇形图(如图1)和条形图(如图2).回答下列问题:(1)这次调查一共抽查了________名学生的植树量;请将条形图补充完整;(2)被调查学生每人植树量的众数是________棵、中位数是________棵;(3)求被调查学生每人植树量的平均数,并估计这280名学生共植树多少棵?【解析】(1)由B类型的人数及其所占百分比可得总人数,总人数乘以D类型的对应的百分比即可求出其人数,据此可补全图形;(2)根据众数和中位数的概念可得答案;(3)先求出样本的平均数,再乘以总人数即可.【解答】(1)这次调查一共抽查植树的学生人数为8÷40%=20(人),D类人数=20×10%=2(人);条形图补充如图:(2)植树4棵的人数最多,则众数是4,共有20人植树,其中位数是第10、11人植树数量的平均数,则中位数是4,(3)x=4×48×562×7=5.3(棵),205.3×280=148(棵).答:估计这3280名学生共植树1484棵.【类型二】用样本估计总体【例2】为了提高学生的综合素养,某校开设了五门第二课堂活动课,按照类别分为:A“剪纸”、B“绘画”、C“雕刻”、D“泥塑”、E“插花”.为了了解学生对每种活动课的喜爱情况,随机抽取了部分同学进行调查,将调查结果绘制成如下两幅不完整的统计图.根据信息,回答下列问题:(1)本次调查的样本容量为________,统计图中的a=________,b=________;(2)通过计算补全条形统计图;(3)该校共有3000名学生,请你估计全校喜爱“雕刻”的学生人数.解:(1)样本容量为1815%=120,a=120×10%=12,b=120×30%=36.故答案为:120;12;36.(2)组频数:120―18―12―30―36=24(人),补全条形统计图如图所示:(3)3000×30120=750(人),答:该校喜爱“雕刻”约有750人.【跟踪训练1】在一个不透明的盒子中装有20个黄、白两种颜色的乒乓球,除颜色外其它都相同,小明进行了多次摸球试验,发现摸到白色乒乓球的频率稳定在0.2左右,由此可知盒子中黄色乒乓球约有…()A.2个B.4个C.18个D.16个【答案】D【跟踪训练2】质检部门从1000件电子元件中随机抽取100件进行检测,其中有2件是次品.试据此估计这批电子元件中大约有________件次品.【答案】20【解析】根据随机抽取100件进行检测,其中有2件是次品,可以计算出这批电子元件中大约有多少件次品.【跟踪训练3】书籍是人类进步的阶梯.为了解学生的课外阅读情况,某校随机抽查了部分学生本学期阅读课外书的册数,并绘制出如下统计图.(1)共抽查了多少名学生?(2)请补全条形统计图,并写出被抽查学生本学期阅读课外书册数的众数、中位数;(3)根据抽查结果,请估计该校1200名学生中本学期课外阅读5册书的学生人数.解:(1)12÷30%=40(名).(2)如图所示,由图知,众数为5,中位数为5.(3)∵抽查的样本中,课外阅读5册书的学生人数占14×100%=35%,40∴估计该校学生课外阅读5册书的学生人数约占35%,∴该校1200名学生中课外阅读5册书的学生人数约为1200×35%=420(人).【类型三】用样本频率估计总体频率【例3】中长跑(男生1000m,女生800m)是河南省某市中招体育考试的必考项目.甲、乙两校为了解本校九年级学生的训练情况,各随机抽取了20名九年级学生的中长跑模拟测试成绩(满分:30分),将成绩进行统计、整理与分析,过程如下:【收集数据】【整理数据】整理以上数据,得到模拟测试成绩x(分)的频数分布表.【分析数据】根据以上数据,得到以下统计量.根据以上信息,回答下列问题:(1)填空:a= ________,b=_________, m=________, n=________;(2)综合上表中的统计量,推断________校学生中长跑成绩更好,理由为________(写出一条即可)(3)若甲、乙两校各有800名学生,请估计两校中长跑模拟测试成绩不低于25分的学生一共有多少名?解:(1)由数据可得,a=7,b=8,m=24.75,n=23.4. 故答案为:7;8;24.75;23.4.(2)甲校学生成绩的平均数比乙校学生成绩的平均数高,且甲校学生成绩的方差比乙校学生成绩的方差小,成绩较稳定.(答案不唯一,合理即可)故答案为:甲.=720(名),(3)(800+800)×1082020答:估计两校中长跑模拟测试成绩不低于25分的学生一共有720名.【跟踪训练】今年是建党100周年,为了让全校学生牢固树立爱国爱党的崇高信念,某校开展了形式多样的党史学习教育活动,八、九年级(各有500名学生)举行了一次党史知识竞答(满分为100分),然后随机各抽取20名同学的成绩进行了收集、统计与分析,过程如下:【收集数据】两个年级抽取的20名同学的成绩如下表:八年级:7968878985598997898998938586899077898379九年级:8688979194625194877194789255979294948598【整理数据】将两个年级的抽样成绩进行分组整理:成绩x(分)50≤x<6060≤x<7070≤x<8080≤x<9090≤x<100八年级113114九年级2a b411【分析数据】抽样的平均数、众数、中位数、方差和优秀率(90分及以上为优秀)如下表:年级统计量平均数众数中位数方差优秀率八年级8589c80.420%九年级859491.5192d请根据以下信息,回答下列问题:(1)填空:a=________,b= ________,c=________,d=________;(2)请估计此次知识竞答中,八年级成绩优秀的学生人数;(3)小李同学认为九年级的整体成绩更好,请从至少两个方面分析其合理性.解:(1)由表中数据可知,九年级落在60≤x<70内的只有62,故a=1;九年级落在70≤x<80内的有71,78,故b=2;八年级成绩按照从小到大的顺序排列后,落在第10,11的数为87,89,∴中位数为88,故c=88;九年级90分及以上的学生有11人,∴九年级的优秀率为1120×100%=55%.故答案为:1;2;88;55%.(2)∵500×20%=100,∴估计此次知识竞答中,八年级成绩优秀的学生人数为100人.(3)九年级抽样成绩的众数,中位数和优秀率均高于八年级,说明九年级平均成绩更高,高分更多,因此九年级整体成绩更好.【类型四】用样本推断总体的实际应用【例4】某运动鞋经销商随机调查某校40名女生的运动鞋号码,结果如下表:鞋的号码35.53636.53737.5人数4616122现在该经销商要进200双上述五种运动鞋,你认为应该怎样进货比较合理?解析:先求出各鞋码所占比例,再乘200,即可得到所需进货数.解:由表中数据可知各鞋码的女生的比例,根据比例进货.需要进35.5码运动鞋:200×440=20(双),需要进36码运动鞋:200×640=30(双)需要进36.5码运动鞋:200×1640=80(双),需要进37码运动鞋:200×1240=60(双)需要进37.5码运动鞋:200×240=10(双)。
统计学第五章抽样习题

A、缩小概率度
B、增大抽样误差范围
C、缩小抽样误差范围 E、增大概率度
D、 增加抽样数目
2020/3/17
24
8.抽样法是一种( ) A、搜集统计资料的方法 B、对现象的总体进行科学估计和推断的方法 C、随机性的非全面调查的方法 D、快速准确的全面调查方法 E、抽选少数典型单位所进行的调查方法
2020/3/17
E、大小是可以控制的
11.用抽样指标估计总体指标应满足的要求是( )
A、一致性 B、准确性 C、客观性
D、无偏性 E、有效性
12.在其他条件不变的情况下,下列关于抽样平均误差、总体变 异程度及样本容量之间关系的陈述,正确的有( )
A、总体变异程度一定时,样本容量越大,抽样平均误差越大
B、总体变异程度一定时,样本容量越大,抽样平均误差越小
B、抽样单位数占总体单位数的比重很大时
C、抽样单位数目很少时
D、抽样单位数目很多时
2020/3/17
7
10、在其他条件不变的情况下,抽样单位数目和抽样误差的关系 是( ) A、抽样单位数目越大,抽样误差越大 B、抽样单位数目越大,抽样误差越小 C、抽样单位数目的变化与抽样误差的数值无关 D、抽样误差变化程度是抽样单位数变动程度的1/2
2020/3/17
22
4、从一个总体中可以抽出许多个样本,因此 ( A、抽样指标的数值不是唯一确定的 B、抽样指标是用来估计总体参数的 C、总体指标是一个随机变量 D、样本指标是随机变量 E、样本指标称为统计量
5、在抽样推断中,样本单位数的多少取决于 ( A、总体标准差的大小 B、允许误差的大小 C、抽样估计的把握程度 D、总体参数的大小 E、抽样方法和组织形式
的
《统计学原理》第5章:抽样推断

n
抽样推断的基本原理
统计推断的理论基础—样本的概率分布
按一定方法随机抽取样本时,所有可能样本的 特征值及其所对应的概率分布情况
学生 A B C D E F G 成绩 30 40 50 60 70 80 90
按随机原则考虑顺序重复抽样抽选出4名学生。
抽样推断的一般问题
样本可能数目
按照一定的抽样方法和组织方式,从总体N中抽取n个 单位构成样本,一共可以抽出的不同样本的数量,一般 用M表示.
考虑顺序的不重复抽样 考虑顺序的重复抽样
M N! (N n)!
M Nn
不考虑顺序的不重复抽样 不考虑顺序的重复抽样
M N! n!(N n)!
全及指标与样本指标
•根据全及总体中各单位的标志值或标志属性计算得 来,反映总体某种特征的指标 •根据样本总体中各单位的标志值或标志属性计算得 来的综合指标.
抽样推断的一般问题
抽样方法
•重复抽样和不重复抽样
•考虑顺序的抽样和不考虑顺序的抽样
抽样推断的一般问题
抽样方法—重复抽样
从总体N个单位中随机抽取一个容量为n的样本,每 次抽取一个单位,把结果登记后再放回到总体中,重新 参加下一次的抽取.
抽出个体
登记特征
放回总体
继续抽取
抽样推断的一般问题
抽样方法—不重复抽样
从总体N个单位中随机抽取一个容量为n的样本, 每次抽取一个单位,把结果登记后不再放回到 总体参加下一次的抽取.
抽出 个体
登记 特征
继续 抽取
抽样推断的一般问题
抽样方法—考虑顺序的抽样
从总体N个单位中抽取n个单位构成样本,不但考虑样本 各单位成分的不同,而且还要考虑样本各单位的中选顺 序.
5 应用统计学(教案)-抽样推断

4、抽样估计的一般步骤
设计抽样方案 抽取样本单位 收集样本资料
整理样本资料
推断总体指标
(1)抽样方案设计的基本准则
随机原则: 确保每个总体单位都有 被抽取的可能。 抽样误差最小: 控制和选择抽样数 目及抽样组织方式 费用最少: 在误差达到一定要求的 条件下,选择费用最少 的方案。
(2)抽样方案设计的主要内容 ① 编制抽样框 抽样框即总体单位的名单。 主要形式: 名单抽样框 区域抽样框 时间表抽样框 编制要求: 应包括全部总体单位 总体单位不应重复 应便于抽样的实施 应尽量利用资料,提高抽 样效果
第五章 抽样推断
基本概念
抽样误差
抽样估计 抽样组织方式
第一节 抽样估计的基本概念
一、抽样估计的意义和一般步骤 1、抽样估计的概念
抽样估计 按随机原则从总体中抽取一部 分单位进行调查,并以调查结 果对总体数量特征作出具有一 定可靠程度的估计与推断,从 而认识总体的一种统计方法。 也是一种收集资料的方法,所以也称为抽 样调查。
另外,分两个以上阶段完成抽取样本的多阶段抽 样,多在总体单位数量多分布广时采用。一般前阶段 采用分层或有关标志排队等距抽样;后阶段采用简单 随机或无关标志排队等距抽样。
④ 确定抽样数目 抽样数目: 即样本容量、样本单位数 大样本:n ≥ 30 小样本:n < 30 抽样数目的确定,与抽样误差、费 用及抽样组织方式有直接的关系。 误差小费用多时抽样数目多,误差 大费用少时抽样数目少;分层抽样除确 定整个样本容量外,还需确定子样本容 量;整群抽样需确定样本群数;多阶段 抽样需确定各阶段抽样数目。
| x - X |≤△ x (在一定概率下) 置信度、概率保证度、 可信度、把握程度,)与△x 是一对矛盾
第五章 抽样估计

步骤: 步骤:
例题1.(题型一)
某乡水道总面积2000亩,从中随机抽取40亩(重复抽样),每亩产量资料如下:
每亩产量(斤)
亩数
x
xf
(x- ) f
400—450
450—500
500—550
550—600
600—650
650—700
1)常用的参数和统计量(指标:平均指标和变异指标)
对于数量标志,计算平均指标和变异指标( )
对于品质标志,计算成数指标(结构相对指标)来表示某种性质的单位数在总体全部单位数中所占的比重。即p=(n1/n),则总体中不具有某种性质的单位数在总体中所占的比重为:q=1-p
如果进行对品质标志是非标志进行赋值,即:定义为“1”和“0”,则有:
(五)抽样估计的置信度
前面我们学习了两种误差,即平均误差和极限误差,这两种误差有着不同的含义。
抽样平均误差反映抽样误差一般水平,是样本资料和总体之间所有离差值的一个平均数。极限误差指进行抽样在统计工作前设立的一个误差最大值。二者的关系是 ( )用抽样误差概率度来表示的。
我们客观地承认,只要进行抽样调查,必然存在误差,并且根据经验或工作要求,我们可以设置一个误差最大值,但要使抽样调查结果一定符合误差在极限误差范围内,却并非能够实现。所以要保证误差不超过一定范围的,只能给一定程度的概率保证程度。抽样估计置信度就是表明抽样指标和总体指标的误差不超过一定范围的概率保证程度。
如:t=1 F(t)=P=68.27%查《正态分布概率分t=2 F(t)=F(2)=P=95.45%布表》
t=3 F(t)=F(3)=P=99.73%
t=1.64 F(t)=90%
统计学5章

有数学期望值 E ( x ) = a a 代表全及总体平均数) (
设总体变量有 N 个:X1,X2,… , XN,则
样本容量为 n:x1 , x2 , … , xn , 则:
X1 X 2 X N X= N
x1 x2 xn x = n
∵ ∴ =
2 x
x1, x2,…, xn相互独立
1 n2 E x1 X
2
E x2 X
2
E xn X
2
2
E ( xi X )( x j X ) i j
=
1 n2 1 n2
E ( x X )2 E x X 1 2 E X X
对于属性总体来说则有如下对应样本指标: 设样本总体 n 个单位中有 n1 个单位具有某种属性, n0 个单位不具有某种属性,且n1 +n0 = n 。则:
n1 p n n0 n n1 q 1 p n n
样本标准差
s
p1 p
(二)参数和统计量
(三)样本容量与样本个数
样本容量是指一个样本所包含的单位数,用 n 来 表示。一般地讲,样本单位数达到或超过30个的样本 称为大样本,而在30个以下称为小样本。 样本个数又称样本可能数目,是指从全及总体中
二、抽样推断的几个基本概念
抽样推断的几个基本概念(见图5-1)。
图5-1 抽样推断的几个基本概念
(一) 总体和样本
在抽样推断中面临两个不同的总体,即 全及总体和样本总体(见图5-2)。
图5-2 全及总体和样本总体关系示意
(一) 总体和样本
统计学第五章抽样推断

统计学第五章抽样推断二、单项选择题1、对总体的数量特征进行抽样估计的前提是抽样必须遵循(B)。
A.大量性B.随机性C.可靠性D.准确性2、一般认为大样本的样本单位数至少要大于(A)。
A.30B.50C.100D.2003、抽样平均误差是指(D)。
A.抽中样本的样本指标与总体指标的实际误差B.抽中样本的样本指标与总体指标的误差范围C.所有可能样本的抽样误差的算术平均数D.所有可能样本的样本指标的标准差4、在其它条件相同的情况下,重复抽样的抽样误差(A)不重复抽样的抽样误差。
A.大于B.小于C.总是等于D.通常小于或等于5、在其它条件不变的情况下,要使抽样误差减少1/3,样本单位数必须增加(D)。
A.1/3B.1.25倍C.3倍D.9倍6、从产品生产线上每隔10分钟抽取一件产品进行质量检验。
推断全天产品的合格率时,其抽样平均误差常常是按(C)的误差公式近似计算的。
A.简单随机抽样B.整群抽样C.等距抽样D.类型抽样7、通常使样本单位在总体中分布最不均匀的抽样组织方式是(B)。
A.简单随机抽样B.整群抽样C.分层抽样D.等距抽样9、抽样平均误差和极限误差的关系是(D)A抽样平均误差大于极限误差B抽样平均误差等于极限误差C抽样平均误差小于极限误差D抽样平均误差大于、等于、小于极限误差都可能10、抽样平均误差的实质是(D)A、总体标准差B、样本标准差C、抽样误差的标准差D、全部可能样本平均数的标准差三、多项选择题C、可以计算抽样误差D、以概率论和数理统计学为理论基础2、影响抽样平均误差大小的因素有(ABCD)。
A、总体各单位标志值的差异程度B、抽样数目C、样本各单位标志值的差异程度D、抽样组织方式E、抽样推断的把握程度3、影响必要的抽样数目的因素有(BCDE)。
A、总体各单位标志值的差异程度B、样本各单位标志值的差异程度C、抽样方法和抽样组织方式D、抽样推断的把握程度E、允许误差4、计算抽样平均误差时,由于总体方差是未知的,通常有下列代替方法(ACE)。
抽样推断法优品ppt资料

对于无限总体,如果对任意
2 x
2
n
放回抽样 对于无限总体,如果对任意
所有可能的样本的成数(
)所形成的分布,称为样本成数的抽样分布。
x
n
抽样误差
样本均值的抽样分布(简称均值的分布)
任何原始分在总体中的位
(2)从有限 中心极限定理:无论总体为何种分布,只要样本n足够大(n≥30),均值(
n
S2n11(Xi X)2
•抽样分布:某一统计量所有可能的样本的取值形成 的分布。
性质
0≤P(Xi)1 ∑P(Xi)=1
数字特征
均值E(X) 方差E[x-E(x)]2
方差的平方根即抽样分布的标准差就是 推断的 抽样误差。
抽样误差就是样本平均数分布数列的标准差。
x X,
x
(xi x)2 f f
计算标准分
一个估计量如能完全地包含未知参数信息,即为充分量
2 Pˆ
Pq/n
Pˆ
Pq n
抽样误差
2 Pˆ
Pq(Nn) n N1
Pˆ
Pq(Nn) n N1
抽样误差
根据中心极限定理,只要样本足够大,Pˆ的分布就近 似正态分布。(np和nq大于5时)
两个样本成数之差的抽样分布
抽样
(1) (P ˆP ˆ)~N(PP,P1q1P2q2)
N n 则服从正态分布,即:
)标准化为(2z)变量,必定服从标准正态分布,均值(
)
Nn 有限总体不放回抽样(n等比例分配于各层)
2
x
总抽体样不放回 E(x) x n ( N1) 抽样误差 n N1 方差E[x-E(x)]2
统计学5-8章习题答

第五章抽样推断练习一、单项选择题:1.在抽样调查中,(A )A. 全及指标是唯一确定的B. 全及指标只有一个C. 样本是唯一确定的D. 样本指标只有一个2.抽样误差产生的原因是(C )A. 在调查过程中由于观察、测量等差错所引起的误差B. 在调查中违反随机原则出现的系统误差C. 因随机抽样而产生的代表性误差D. 人为原因所造成的误差3.抽样平均误差是( C )A. 全及总体的标准差B. 样本的标准差C. 抽样指标的标准差D. 抽样误差的平均差4.样本平均数和全及总体平均数,( C )A. 前者是一个确定值,后者是随机变量B. 两者都是随机变量C. 前者是随机变量,后者是一个确定值D. 两者都是确定值5.在纯随机重复抽样的情况下,要使抽样误差减少一半,其他条件不变,则样本单位数必须(D )A. 增加2倍 B. 增加到2倍C. 增加4倍D. 增加到4倍6.抽样调查中,在其他条件不变的情况下,抽样单位数越多,则(D )A. 系统误差越大B. 系统误差越小C. 抽样误差越大D. 抽样误差越小7.在一定的抽样平均误差条件下(A )A. 扩大极限误差范围,可以提高推断的可靠程度B. 扩大极限误差范围,会降低推断的可靠程度C. 缩小极限误差范围,可以提高推断的可靠程度D. 缩小极限误差范围,不改变推断的可靠程度8.抽样极限误差是( B )A.随机误差B.抽样估计所允许的误差的上下界限C.最小抽样误差D.最大抽样误差9.抽样估计的可靠性和精确度( B )A.是一致的B.是矛盾的C.成正比D.无关系10.对某种连续生产的产品进行质量检验,要求每隔一小时抽出10分钟生产的所有产品进行检验,这种抽查方式是(D )A. 简单随机抽样B. 类型抽样C. 等距抽样D. 整群抽样二、多项选择题:1.抽样推断的优点()。
①时效性强②更经济③能够控制抽样估计的误差④适用范围广⑤无调查误差2.抽样调查适用于下列哪些场合:(ABC )A. 不宜进行全面调查而又要了解全面情况B. 工业产品质量检验C. 调查项目多、时效性强D. 只需了解一部分单位的情况E. 适用于任何调查3.在抽样调查中,下列说法正确的有(ABD)A. 全及总体是唯一确定的B. 样本指标是随机变量C. 样本是唯一的D. 样本指标可以有多个E. 总体指标只有一个4.抽样调查时,所估计的总体指标的区间范围(ACD )A. 是一个可能范围B. 是绝对可靠的范围C. 不是绝对可靠的范围D. 是有一定把握程度的范围E. 是毫无把握的范围5.抽样调查的组织方式有(ABCD)。
【统计学概论】抽样推断

每包重量(克) 149以下 149—150
150—151 151以上
包数 10 20 50 20
(1)以99.73%的概率保证估计这批茶叶平均每包重量的 可能范围
(2)以同样的概率保证估计这批茶叶包装的合格率的可 能范围
• 三必要抽样数目的确定
• (一)影响抽样数目的因素
•
影响抽样数目的因素有:
(一)总体和样本
总体:调查研究的事物或现象的全体,所包含 的单位数用“N”表示。
样本:从总体中所抽取的部分个体所构成的小 的总体,当中所包含的单位数用“n”
表 示,称为“样本容量”。 样本可分为: 大样本 小样本
(二)全及指标与样本指标 (参数与统计量)
1、全及指标:说明全及总体的综合数量 特征,是唯一的,又称为“参数”。
尺度,用“ ”。
2、公式:
(1)重复抽样条件下:
(2)不重复抽样条件下:
五、抽样极限(允许)误差
1、概念:是在一定的概率保证下,用样本 指标估计全及指标时允许出现的
最 大误差,用“△”表示.
2、计算公式: 根据置信度(即可靠性,F(t)=1-α),
查正态概率分布表,查得对应的概率度t。 (在总体方差未知的情况下)
例3:P94
例4 P95
例5 P96
三、抽样误差
1、概念:是在遵循随机原则的条件下,用 样本指标来代表全及指标所不可避免 的误差。就是统计误差中的随机误差
抽样误差=样本指标 -全及指标 2、影响因素:
①抽取单位数n的多少 ②被研究标志的变异程度 ③抽样方法 ④抽样组织方式
四、抽样平均误差
1、概念:是所有可能组成的样本的抽样误 差的平均数,反映样本指标与全及指标的 平均误差程度,是衡量样本代表性大小的
- 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
- 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
- 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。
第五章 抽样推断
一、填空题
2、抽样推断的基础是________,抽样推断中产生的抽样误差不但可以________,而且还能加以________。
9、抽样平均误差就是所有可能的样本的________与________的平均误差。
14、区间估计必须具备三个要素:________、________ 和 ________。
15、如果全及平均数落在区间(550,650)内的概率是95.45%,则抽样平均误差等于________。
18、影响样本容量的主要因素有________、________、________、________ 和 ________。
二、是非题
2、对于无限总体,不能进行全面调查,只能使用抽样推断。
( )
4、变量总体中构成总体的各个单位可以用一定的数量标志加以计量。
( )
6、抽样平均误差越大,样本的代表性越大。
( )
8、不重复简单随机抽样全部样本可能的数目为C n N . ( )
10、对一个服从正态分布的全及总体进行抽样调查,不论样本容量大小如何,其样本平均数的分布总是趋近正态分布的。
( )
12、点估计是用样本的统计量直接估计和代表总体参数。
( )
16、样本方差S 2 n 与修正样本方差S 2 n-1关系可表示为 S 2 n =
n n 1 S 2 n-1 。
( )
三、单项选择题
1、 全及总体是惟一确定的,样本总体( )
A 、 也惟一
B 、有无数个
C 、不惟一
D 、有C n N 个
3、 重复简单随机抽样下,抽样平均误差要减少1/3,则样本单位数就要扩大到( )
A 、4倍
B 、2倍
C 、3倍
D 、9倍
5、 满足条件( )时,可以认为抽样成数的概率分布近似正态分布( )。
A 、n<30 np<5 n(1-p)<5
B 、n>30 np<5 n(1-p)>5
C 、n>30 np>5 n(1-p)<5
D 、n>30 np>5 n(1-p)>5
7、计算抽样平均误差时,如有多个标准差的资料,应根据( )计算。
A 、中间一个
B 、平均值
C 、最大一个
D 、最小一个
9、区间估计的置信度是指( )
A 、概率
B 、允许误差的大小
C 、概率保证程度
D 、抽样平均误差的大小
四、多项选择题
3、全面调查和抽样调查中都存在的误差是( )
A 、系统性误差
B 、登记性误差
C 、责任心误差
D 、技术性误差
E 、代表性误差
4、重复随机抽样的特点是()
A、总体中每个单位在各次抽样中被抽取的机会相等
B、总体中每个单位在各次抽样中被抽取的机会不等
C、n次抽样就是n次相互独立的实验
D、每次抽选时,总体单位数始终不变
E、每次抽选时,总体单位数逐渐减少
8、在概率度t一定的条件下()
A、允许的相对误差越大,应抽取的单位数越少
B、允许的相对误差越小,应抽取的单位数越少
C、抽样误差范围越大,样本标志值之间的离差越大
D、抽样误差范围越大,应抽取的单位数越多
E、抽样误差范围越小,应抽取的单位数越多
10、影响抽样数目的因素有()
A、被调查标志的变异程度
B、允许误差
C、概率度
D、抽样方法
E、抽样的组织方式
五、简答题
1、什么是抽样推断?它有哪些基本的特点?
六、综合题
3、某电子公司,生产某型号集成电路,按正常生产试验,产品中属于一级品的占80%,
现在从20000件集成电路中,抽取200件进行抽样检验,求一级品率的抽样平均误差。
5、采用随机重复抽样的方法,在2000件产品中抽查200件,其中合格品190件,要求:
(1)计算合格品率及其抽样平均误差;
(2)以95.45%的概率保证程度(t=2)对合格品率和合格品数量进行区间估计。
6、调查一批机械零件的合格率。
根据过去的资料,合格品率曾有过98%,97%和96%三种
情况。
现在要求极限误差不超过2%,推断的把握程度为95.45%,问需要抽查多少个零件?
9、某乡某年播种小麦400公顷。
随机抽查40公顷,测得每公顷产量为3500kg,标准差为20kg,试计算:
(1)概率为95%的条件下,平均每公顷产量的可能范围。
(2)推算400公顷小麦总产量的可能范围。