贾俊平《统计学》考研真题(含复试)与典型习题详解(分类数据分析)【圣才出品】
贾俊平《统计学》(第7版)考研真题与典型题详解 第9章~第10章【圣才出品】

这个表格是( )。 A.4×3 列联表 B.3×2 列联表 C.2×3 列联表 D.3×4 列联表 【答案】B 【解析】表中的行是态度变量,这里划分为三类,即赞成、中立和反对;表中的列是单 位变量,这里划分为两类,即男同学和女同学,因此这个表格是 3×2 列联表。
2 / 60
圣才电子书
十万种考研考证电子书、题库视频学习平台
第 9 章 分类数据分析
一、单项选择题 1.列联分析是利用列联表来研究( )。 A.两个数值型变量的关系 B.两个分类变量的关系 C.两个数值型变量的分布 D.一个分类变量和一个数值型变量的关系 【答案】B 【解析】列联表是由两个或以上的变量进行交叉分类的频数分布表,列联分析是利用列 联表来研究两个分类变量之间的关系。
10.某大学为了解男女毕业生对开设《职业规划》这门课程的看法,分别抽取了 500 名男学生和 500 名女学生进行调查,得到的结果如表 9-7 所示。
表 9-7 关于开设《职业规划》课子书、题库视频学习平台
如果要检验男女毕业生对开设《职业规划》这门课程的看法是否相同,即检验假设 H0: π1=π2=850/1000=0.85,χ2 检验统计量的自由度是( )。
表 9-5
根据这个列联表计算的χ2 统计量的值为( )。 A.0.6176 B.1.2352 C.2.6176 D.3.2352 【答案】B 【解析】非参数检验中的χ2 拟合优度检验和可以应用于列联表的独立性检验来测定两 个分类变量之间的相关程度。用 fo 表示观察值频数,用 fe 表示期望值频数,则χ2 统计量为:
4 / 60
圣才电子书 十万种考研考证电子书、题库视频学习平台
【解析】赞成研究生奖学金制度改革的行百分比分别为:(90/174)×100%=51.7%; (84/174)×100%=48.3%。
贾俊平《统计学》配套题库 【课后习题】详解 第9章~第10章【圣才出品】

第9章分类数据分析一、思考题1.简述列联表的构造与列联表的分布。
答:列联表是由两个以上的变量进行交叉分类的频数分布表。
列联表的分布可以从两个方面看,一个是观察值的分布,又称为条件分布,每个具体的观察值就是条件频数;一个是期望值的分布。
2.用一张报纸、一份杂志或你周围的例子构造一个列联表,说明这个调查中两个分类变量的关系,并提出进行检验的问题。
答:对三个生产厂甲、乙、丙提供的学习机的A、B、C 三种性能进行质量检验,欲了解生产厂家同学习机性能的质量差异是否有关系。
抽查了450部学习机次品,整理成为如表9-2所示的3×3列联表。
表9-2A B C 总计甲乙丙204015459065357070100200150总计75200175450根据抽查检验的数据表明:次品类型与厂家(即哪一个厂)生产是无关的(即是相互独立的)。
建立假设:H 0:次品类型与厂家生产是独立的,H 1:次品类型与厂家生产不是独立的。
次品类型生产厂可以计算各组的期望值,如表9-3所示(表中括号内的数值为期望值)。
表9-3各组的期望值计算表A B C 总计甲乙丙20(17)40(33)15(25)45(44)90(89)65(67)35(39)70(78)70(58)100200150总计75200175450所以2222(2017)(4033)(7058)9.821173358χ---=+++=…。
而自由度等于(R -1)(C -1)=(3-1)×(3-1)=4,若以0.01的显著性水平进行检验,查χ2分布表得20.01(4)13.277χ=。
由于220.019.821(4)13.277χχ=<=,故接受原假设H 0,即次品类型与厂家生产是独立的。
3.说明计算2χ统计量的步骤。
答:计算2χ统计量的步骤:(1)用观察值o f 减去期望值e f ;(2)将(o f -e f )之差平方;(3)将平方结果2)(e o f f -除以e f ;(4)将步骤(3)的结果加总,即得:22()o e ef f f χ-=∑。
贾俊平《统计学》考研真题(含复试)与典型习题详解(数据的概括性度量)【圣才出品】

2.统计学期中考试非常简单,为了评估简单程度,教师记录了 9 名学生交上考试试卷
的时间如下(分钟)
33 29
45 60 42 19 52 38 36[东北财经大学
2012 研]
(1)这些数据的极差为( )。
A.3.00
B.-3.00
C.41.00
D.-41.00
【答案】C
【解析】数据按从小到大排序结果如下:
A.0.38
B.0.40
C.0.54
D.2.48
【答案】A
【解析】离散系数也称为变异系数,它是一组数据的标准差与其相应的平均数之比。其
计算公式为: vs
s x
。得到 vs
22.85 0.38 。 12.45
9.已知某工厂生产的某零件的平均厚度是 2 厘米,标准差是 0.25 厘米。如果已知该 厂生产的零件厚度为正态分布,可以判断厚度在 1.5 厘米到 2.5 厘米之间的零件大约占 ( )。[浙江工商大学 2011 研]
圣才电子书 十万种考研考证电子书、题库视频学习平台
5.随机变量 X 的方差为 2,随机变量 Y=2X,那么 y 的方差是( )。[中央财经大学 2011 研]
A.1 B.2 C.4 D.8 【答案】D
【解析】Var(cX ) c2Var(X ) 22 2 8
7.设 X1,X2,…,X n 为随机样本,则哪个统计量能较好地反映样本值的分散程度( )。
[中山大学 2012 研] A.样本平均 B.样本中位数 C.样子书
【答案】C
十万种考研考证电子书、题库视频学习平台
【解析】集中趋势是指 一 组 数 据 向 某 一 中 心 值 靠 拢 的 程 度 ,它 反 映 了 一 组 数 据 中 心
贾俊平《统计学》(第5版)课后习题-第9章 分类数据分析【圣才出品】

第9章 分类数据分析一、思考题1.简述列联表的构造与列联表的分布。
答:列联表是由两个以上的变量进行交叉分类的频数分布表。
列联表的分布可以从两个方面看,一个是观察值的分布,又称为条件分布,每个具体的观察值就是条件频数;一个是期望值的分布。
2.用一张报纸、一份杂志或你周围的例子构造一个列联表,说明这个调查中两个分类变量的关系,并提出进行检验的问题。
答:对三个生产厂甲、乙、丙提供的学习机的A、B、C三种性能进行质量检验,欲了解生产厂家同学习机性能的质量差异是否有关系。
抽查了450部学习机次品,整理成为如表9-2所示的3×3列联表。
表9-2根据抽查检验的数据表明:次品类型与厂家(即哪一个厂)生产是无关的(即是相互独立的)。
建立假设:H0:次品类型与厂家生产是独立的,H1:次品类型与厂家生产不是独立的。
可以计算各组的期望值,如表9-3所示(表中括号内的数值为期望值)。
表9-3 各组的期望值计算表所以2222(2017)(4033)(7058)9.821173358χ---=+++=…。
而自由度等于(R -1)(C -1)=(3-1)×(3-1)=4,若以0.01的显著性水平进行检验,查χ2分布表得20.01(4)13.277χ=。
由于220.019.821(4)13.277χχ=<=,故接受原假设H 0,即次品类型与厂家生产是独立的。
3.说明计算2χ统计量的步骤。
答:计算2χ统计量的步骤:(1)用观察值o f 减去期望值e f ;(2)将(o f -e f )之差平方;(3)将平方结果2)(e o f f -除以e f ;(4)将步骤(3)的结果加总,即得:22()o e ef f f χ-=∑。
4.简述ϕ系数、c 系数、V 系数的各自特点。
答:(1)ϕ相关系数是描述2×2列联表数据相关程度最常用的一种相关系数。
它的计算公式为:ϕ,式中,∑-=ee of f f 22)(χ;n 为列联表中的总频数,也即样本量。
贾俊平《统计学》(第五版)考研真题(含复试)与典型习题详解 分类数据分析

合计
赞成
35
30
65
反对
15
20
35
合计
50
50
100
如果要检验男女教师对教师体制改革的看法是否相同,提出的原假设为( )。
A.H0:π1=π2=35 B.H0:π1=π2=50 C.H0:π1=π2=65
6 / 19
圣才电子书
D.H0:π1=π2=0.65
十万种考研考证电子书、题库视频学习平台
156 162
圣才电子书
A.0.6176
十万种考研考证电子书、题库视频学习平台
B.1.2352
C.2.6176
D.3.2352
【答案】B
【解析】 2 检验可以用于变量间拟合优度检验和独立性检验,可以用于测定两个分类 变量之间的相关程度。用 fo 表示观察值频数,用 fe 表示期望值频数,则 2 统计量为:
圣才电子书
十万种考研考证电子书、题库视频学习平台
第 9 章 分类数据分析
一、单项选择题
1.列联分析是利用列联表来研究( )。
A.两个数值型变量的关系
B.两个分类变量的关系
C.两个数值型变量的分布
D.一个分类变量和一个数值型变量的关系
【答案】B
【解析】列联表是由两个以上的变量进行交叉分类的频数分布表,列联分析是利用列联
【解析】表中的行是态度变量,这里划分为三类,即赞成,中立和反对;表中的列是单 位变量,这里划分为两类,即男同学和女同学,即 3×2 列联表。
5.一所大学为了解男女学生对后勤服务质量的评价,分别抽取了 300 名男学生和 240
名女学生进行调查,得到的结果如表 9-2 所示。
表 9-2 关于后勤服务质量评价的调查结果
贾俊平《统计学》复习笔记课后习题详解及典型题详解 第9章~第10章【圣才出品】

第9章分类数据分析9.1复习笔记一、分类数据与χ2统计量1.分类数据按照所采用的计量尺度不同,可以将统计数据分为分类数据、顺序数据和数值型数据。
分类数据和顺序数据都是只能归于某一类别的非数字型数据,它们是对事物进行分类的结果,其结果均表现为类别,用文字来表述,不过顺序数据的类别是有序的;数值型数据是按数字尺度测量的观测值,其结果表现为具体的数值。
分类数据是对事物进行分类的结果,其特征是,调查结果虽然用数值表示,但不同数值描述了调查对象的不同特征。
数值型数据可以转化为分类数据。
分类数据的结果是频数,χ2检验是对分类数据的频数进行分析的统计方法。
2.χ2统计量χ2统计量可以对分类数据做拟合优度检验和独立性检验,可以用于测定两个分类变量之间的相关程度。
若用f o 表示观察值频数,用f e 表示期望值频数,则χ2统计量可以写为:22()o e e f f f χ-=∑χ2检验:χ2检验是利用随机样本对总体分布与某种特定分布拟合程度的检验,也就是检验观察值与理论值之间的紧密程度。
χ2检验主要用于拟合优度检验和独立性检验。
(1)χ2统计量的特征①χ2≥0,因为它是对平方值结果的汇总;②χ2统计量的分布与自由度有关;③χ2统计量描述了观察值与期望值的接近程度。
两者越接近,即f o-f e的绝对值越小,计算出的χ2值越小;反之,f o-f e的绝对值越大,计算出的χ2值也越大。
χ2检验正是通过对χ2的计算结果与χ2分布中的临界值进行比较,做出是否拒绝原假设的统计决策。
(2)χ2分布与自由度的密切关系自由度越小,χ2的分布就越向左边倾斜;随着自由度的增加,χ2分布的偏斜程度趋于缓解,逐渐显露出对称性,随着自由度的继续增大,χ2分布将趋近于对称的正态分布。
(3)应用χ2检验统计量的注意事项①各组的理论频数f e不得小于总频数n;②总频数应较大,至少大于50;③如果某组理论频数小于5,可将相邻的若干组合并,直至理论频数大于5为止;④倘若有两个以上的单元,如果20%的单元期望频数f e小于5,则不能应用χ2检验。
贾俊平《统计学》复习笔记课后习题详解及典型题详解(数据的图表展示)【圣才出品】

②列联表和交叉表
由两个或两个以上变量交叉分类的频数分布表也称为列联表。
二维的列联表(两个变量交叉分类)也称为交叉表。
③比例(构成比)、百分比和比率
比例是一个样本(或总体)中各个部分的数据与全部数据之比,通常用于反映样本(或
二、品质数据的整理与展示 1.分类数据的整理与图示 分类数据本身就是对事物的一种分类,为对数据及其特征有一个初步的了解,在整理时 首先列出所分的类别,然后计算出每一类别的频数、频率或比例、比率等,形成一张频数分 布表,最后根据需要选择适当的图形进行展示。 (1)频数与频数分布 ①频数与频数分布 频数又称为次数,是各组占有的单位个数,将总体所有单位按一定标志进行归类排列, 称为频数分布。频数(频率)愈大的组所对应的标志值,它对于总体标志平均水平所起的作 用也愈大;反之,频数(频率)愈小的组所对应的标志值对于总体标志平均水平所起的作用
总体)的构成或结构。将比例乘以 100 得到的结果称为百分比,用%表示。比率是样本(或
总体)中各不同类别数据之间的比值,其比值可能大于 1。
(2)分类数据的图示
统计图是统计数据直观的表现形式,可以将复杂的数据用生动的图形表现出来,因而绘
制并使用好统计图就成为统计分析的基本功。常见的分类数据展示图形有条形图、帕累托图、
三、数值型数据的整理与展示 1.数据分组
4 / 52
圣才电子书 十万种考研考证电子书、题库视频学习平台
(1)数据分组的概念和目的 数据分组是根据统计研究的需要,为了观察数据的分布特征,将原始数据按照某种标准 划分成不同的组别,分组后的数据称为分组数据。经分组后再计算出各组中数据出现的频数, 就形成了一张频数分布表。在分组时,如果按照性别、质量等级等定性指标分组,称为按品 质标志分组;如果按照数量或数值等定量指标分组,称为按数量标志分组。 (2)数据分组的方法 ①单变量值分组:把每一个变量值作为一组,这种分组通常只适合离散变量,且在变量 值较少的情况下使用; ②组距分组:将全部变量值依次划分为若干个区间,并将这一区间的变量值作为一组。 在组距分组中,一个组的最小值称为下限;一个组的最大值称为上限。适用于连续变量或变 量值较多的情况。 (3)分组和编制频数分布表的具体步骤 ①确定组数 一般情况下,一组数据所分的组数不应少于 5 组且不多于 15 组,即 5≤K≤15。实际应 用时,可根据数据的多少和特点及分析的要求来确定组数。 ②确定各组的组距 组距是一个组的上限与下限的差。组距可根据全部数据的最大值和最小值及所分的组数 来确定,即组距=(最大值-最小值)÷组数。 注意:为便于计算,组距宜取 5 或 10 的倍数,而且第一组的下限应低于最小变量值, 最后一组的上限应高于最大变量值。 ③根据分组整理成频数分布表 (4)组距分组的注意事项
贾俊平《统计学》(第7版)考点归纳和课后习题详解(含考研真题)-第四章至第六章【圣才出品】

第4章数据的概括性度量4.1考点归纳【知识框架】【考点提示】(1)集中趋势、离散趋势的度量指标,包括每个指标的含义、计算公式、特点、意义、适用范围(选择题、简答题、计算题考点);(2)众数、中位数和平均数三个指标的特点和应用场合,偏态分布下三个指标的关系(选择题、简答题、计算题考点);(3)分布形状的测度指标:偏态系数和峰态系数的数值含义(选择题、简答题考点)。
(4)标准分数的计算公式及应用(选择题、简答题、计算题考点);(5)经验法则、切比雪夫不等式的具体应用(选择题考点)。
【核心考点】考点一:集中趋势的度量表4-1集中趋势度量指标【注意】不同偏态程度的分布中集中趋势度量指标的关系:①对称分布中,众数、中位数和平均数相等;②左偏分布中,数据存在极小值,拉动平均数向极小值一方靠,而众数和中位数不受极值的影响,有_x<M e<M o;③右偏分布中,数据存在极大值,必然拉动平均数向极大值一方靠,因此M o<M e<_x。
【知识拓展】不同的教材分位数的计算公式不同,除了表中的计算公式,一种比较精确的计算公式:下四分位数Q L的位置=(n+1)/4,上四分位数Q U的位置=(3n+1)/4。
【真题精选】假定标志值所对应的权数都缩小1/10,则算术平均数()。
[浙江财经大学2019研]A.不变B.无法判断C.缩小百分之一D.扩大十倍【答案】A【解析】假设标志值为x,其对应的权数为f,则算术平均数为_x=∑xf/∑f;若各权数都缩小1/10,则新的算术平均数为110110xf xf x x f f '===∑∑∑∑考点二:离散程度的度量数据的离散程度反映了各变量值远离其中心值的程度,离散程度越小,代表性就越好。
表4-2离散程度的度量指标【注意】①表中方差和标准差的计算公式均为样本数据的方差和标准差。
若为总体数据,则分母应为n。
②标准差系数,也称变异系数或离散系数。
③表中平均差、样本方差、样本标准差仅给出了未分组数据的计算公式,分组数据的计算公式实质是等于未分组数据的计算公式,会运用即可。
贾俊平《统计学》章节题库(含考研真题)(数据的图表展示)【圣才出品】

1 / 33
圣才电子书 十万种考研考证电子书、题库视频学习平台
【解析】茎叶图是保留并反映原始数据分布的图形,它由茎和叶两部分构成,其图形是 由数字组成的。ACD 三项都需要对原始数据进行处理,求得一些测度值之后再作出图形。
8.对于 100 名学生某一门课程的成绩,若想得到四分之一分位数、中位数与四分之三 分位数,以下哪种描述统计的办法更有效?( )[中山大学 2012 研]
A.直方图 B.茎叶图 C.饼图 D.点图
4 / 33
圣才电子书
【答案】B
十万种考研考证电子书、题库视频学习平台
12.饼图的主要用途是( )。 A.反映一个样本或总体的结构 B.比较多个总体的构成 C.反映一组数据的分布 D.比较多个样本的相似性 【答案】A 【解析】饼图是用圆形及圆内扇形的角度来表示数值大小的图形。它主要用于表示一个 样本(或总体)中各组成部分的数据占全部数据的比例,对于研究结构性问题十分有用。
【解析】直方图、饼图描述的数值型数据是分组数据,而茎叶图描述的是未分组的数值
型数据,点图描述的是两个变量之间的关系。茎叶图保留了原始数据的信息,可以计算其分
位数。
9.某外商投资企业按工资水平分为四组:1000 元以下,1000~1500 元;1500~2000 元;2000 元以上。第一组和第四组的组中值分别为( )。[首经贸 2009 研]
圣才电子书 十万种考研考证电子书、题库视频学习平台
第 3 章 数据的图表展示
一、单项选择题 1.对于大批量的数据,最适合描述其分布的图形是( )。[中国海洋大学 2018 研] A.条形图 B.茎叶图 C.直方图 D.饼图 【答案】C 【解析】在应用方面,直方图通常适用于大批量数据,茎叶图通常适用于小批量数据。 条形图是用宽度相同的条形的高度或长短来表示数据多少的图形;饼图是用圆形及圆内扇形 的角度来表示数值大小的图形,它主要用于表示一个样本(或总体)中各组成部分的数据占 全部数据的比例。
贾俊平《统计学》章节题库(分类数据分析)详解【圣才出品】

第9章分类数据分析一、单项选择题1.列联分析是利用列联表来研究()。
A.两个数值型变量的关系B.两个分类变量的关系C.两个数值型变量的分布D.一个分类变量和一个数值型变量的关系【答案】B【解析】列联表是由两个或以上的变量进行交叉分类的频数分布表,列联分析是利用列联表来研究两个分类变量之间的关系。
2.列联表中的每个变量()。
A.只能有一个类别B.只能有两个类别C.对类别没有限制D.可以有两个或两个以上的类别【答案】D3.设列联表的行数为3,列数为4,则χ2检验的自由度为()。
A.3B.4C.6D.12【答案】C【解析】列联分析中,χ2检验的自由度=(行数-1)(列数-1)=(R-1)(C-1)=(3-)×(4-1)=6。
4.一所大学准备采取一项学生对餐厅改革意见的调查,为了解男女学生对这一措施的看法,分别抽取了300名男学生和240名女学生进行调查,得到的结果如表9-1所示。
这个表格是()。
A.4×3列联表B.3×2列联表C.2×3列联表D.3×4列联表【答案】B【解析】表中的行是态度变量,这里划分为三类,即赞成、中立和反对;表中的列是单位变量,这里划分为两类,即男同学和女同学,因此这个表格是3×2列联表。
5.一所大学为了解男女学生对后勤服务质量的评价,分别抽取了300名男学生和240名女学生进行调查,得到的结果如表9-2所示。
这个列联表的最下边一行称为()。
A.总频数B.条件频数C.行边缘频数D.列边缘频数【答案】D6.某中学为了解教师对新课标改革的看法,分别抽取了300名男教师和240名女教师进行调查,得到的结果如表9-3所示。
这个列联表的最右边一列称为()。
A.总频数B.条件频数C.行边缘频数D.列边缘频数【答案】C7.某大学为了解学生对研究生奖学金制度改革的看法,分别抽取了300名男研究生和240名女研究生进行调查,得到的结果如表9-4所示。
贾俊平《统计学》章节题库(分类数据分析)【圣才出品】

观察值
105
78
期望值
102
8l
根据这个列联表计算的 Χ2 统计量为( )。
A.0.6176
B.1.6176
C.0.3088
D.1.3088
【答案】A
【解析】 2 f0 fe 2 45 482 42 392 105 1022 78 812
87
反对
105
78
183
合计
150
120
270
这个列联表的最下边一行称为( )。
A.列边缘频数
B.行边缘频数
3 / 25
圣才电子书
C.条件频数
十万种考研考证电子书、题库视频学习平台
D.总频数
【答案】A
7.一所大学准备采取一项学生在宿舍上网收费的措施,为了解男女学生对这一措施的
2.设 R 为列联表的行数,C 为列联表的列数,则 Χ2 分布的自由度为( )。 A.R B.C C.R×C D.(R-1)×(C-1) 【答案】D
【解析】 2 检验的自由度=(行数-1)(列数-1)=(R-1)(C-1)。
1 / 25
圣才电子书 十万种考研考证电子书、题库视频学习平台
看法,分别抽取了 150 名男学生和 120 名女学生进行调查,得到的结果如下:
男学生
女学生
合计
赞成
45
42
87
反对
105
78
183
合计
150
120
270
根据这个列联表计算的赞成上网收费的行百分比分别为( )。
A.51.7%和 48.3%
B.57.4%和 42.6%
C.30%和 70%
D.35%和 65%
贾俊平《统计学》(第7版)考点归纳和课后习题详解(含考研真题)-第九章至第十一章【圣才出品】

第9章分类数据分析9.1考点归纳【知识框架】【考点提示】(1)χ2统计量的计算公式及应用(计算题考点);(2)拟合优度检验(一个分类变量)和独立性检验(两个分类变量)(简答题、计算题考点);(3)列联表中的相关测量:三个系数的计算公式、特点及应用(选择题、简答题、计算题考点)。
【核心考点】考点一:χ2统计量(1)χ2统计量计算公式22()o e ef f f χ-=∑f o 表示观察值频数,用f e 表示期望值频数。
(2)χ2统计量的特征①χ2≥0;②χ2统计量的分布与自由度有关;③χ2统计量描述了观察值与期望值的接近程度。
(3)χ2分布与自由度的关系χ2分布随着自由度的增加而向右倾斜,且逐渐趋近于对称的正态分布。
考点二:列联表中的相关测量表9-1列联表的测量指标【真题精选】当列联表中的两个变量相互独立时,计算的相关系数c()。
[中国海洋大学2018研]A.等于1B.大于1C.等于0D.小于0【答案】C【解析】两个随机变量独立,则这两个随机变量不相关,反之不成立。
9.2课后习题详解一、思考题1.简述列联表的构造与列联表的分布。
答:(1)列联表的构造:列联表是将两个以上的变量进行交叉分类的频数分布表。
(2)列联表的分布:列联表的分布可以从两个方面看,一个是观察值的分布,又称为条件分布,每个具体的观察值就是条件频数;一个是期望值的分布。
2.用一张报纸、一份杂志或你周围的例子构造一个列联表,说明这个调查中两个分类变量的关系,并提出进行检验的问题。
答:(1)构造列联表:对三个生产厂甲、乙、丙提供的学习机的A、B、C三种性能进行质量检验,欲了解生产厂家同学习机性能的质量差异是否有关系。
抽查了450部学习机次品,整理成为如表9-2所示的3×3列联表。
表9-2(2)提出检验问题根据抽查检验的数据表明:次品类型与厂家(即哪一个厂)生产是无关的(即是相互独立的)。
(3)进行检验建立假设:H0:次品类型与厂家生产是独立的;H1:次品类型与厂家生产不是独立的。
贾俊平《统计学》(第7版)考研真题与典型题详解-第2章 数据的搜集【圣才出品】

第2章数据的搜集一、单项选择题1.为了解大学生的消费状况,一学生社团通过微信朋友圈投放调查问卷,并邀请收到问卷的同学在自己的朋友圈内分享问卷。
关于这种调查方式,以下说法正确的是()。
[中央财经大学2018研]A.使用的抽样方式是简单随机抽样B.使用的抽样方式是配额抽样C.使用的抽样方式是非概率抽样D.这种调查不是抽样调查【答案】C【解析】非概率抽样是相对于概率抽样而言的,指抽取样本时不是依据随机原则,而是根据研究目的对数据的要求,采用某种方式从总体中抽出部分单位对其实施调查。
题中的调查方式属于非概率抽样中的滚雪球抽样。
2.为了快速了解北京居民对空气污染问题的态度,最适合的数据收集方式是()。
[中央财经大学2018研]A.面访B.电话调查C.邮寄问卷D.座谈会【答案】B【解析】电话调查是指调查人员通过打电话的方式向被调查者实施调查。
电话调查的最大特点是速度快,能够在很短的时间内完成调查。
而面访、邮寄问卷、座谈会的调查周期都比较长。
3.某居民小区为了解住户对物业服务的看法,准备采取抽样调查方式搜集数据。
物业管理部门利用最初的居民户登记名单进行抽样,但现在的小区中,原有的一些居民户已经搬走,同时有些是新入住的居民户。
由此造成的误差属于()。
[中央财经大学2018研] A.随机误差B.抽样框误差C.计量误差D.无回答误差【答案】B【解析】抽样框误差是指由于抽样框的不完善性造成的统计推断错误。
在概率抽样中需要根据抽样框抽取样本。
一个好的抽样框应该是:抽样框中的单位和研究总体中的单位有一一对应的关系。
现在的小区中,原有的一些居民户已经搬走,同时有些是新入住的居民户,这时,抽样框中的单位与研究总体的单位就不存在一一对应的关系,使用这样的抽样框抽取样本就会出现抽样框误差。
4.为了调查某校学生的购书费用支出,将全校学生的名单按拼音顺序排列后,每隔50名学生抽取一名学生进行调查,这种调查方法是()。
[山东大学2017研;对外经济贸易大学2017研]A.简单随机抽样B.整群抽样C.系统抽样D.分层抽样【答案】C【解析】系统抽样是将总体中的所有单位(抽样单位)按一定顺序排列,在规定的范围内随机地抽取一个单位作为初始单位,然后按事先规定好的规则确定其他样本单位。
贾俊平《统计学》章节题库(含考研真题)(1-4章)【圣才出品】

第1章导论一、单项选择题1.在抽样推断中,总体参数是一个()。
[中央财经大学2018研]A.随机变量B.已知的量C.统计量D.确定的量【答案】D【解析】参数是用来描述总体特征的概括性数字度量,它是研究者想要了解的总体的某种特征值。
由于总体数据通常是不知道的,所以参数是一个未知的确定的常数。
2.统计年鉴中2016年全国各大城市的人均家庭收入数据属于()。
[中央财经大学2018研]A.定类数据B.定序数据C.截面数据D.时间序列数据【答案】C【解析】按照被描述的现象与时间的关系,可以将统计数据分为截面数据和时间序列数据。
截面数据是在相同或近似相同的时间点上收集的数据,这类数据通常是在不同的空间获得的,用于描述现象在某一时刻的变化情况。
比如,2010年我国各地区的国内生产总值就是截面数据。
时间序列数据是在不同时间收集到的数据,这类数据是按时间顺序收集到的,用于描述现象随时间变化的情况。
比如2010~2012年我国的国内生产总值就是时间序列数据。
3.在教学评估中,某省三所高校的等级分别是优秀、良好、及格,则“等级”是()。
[浙江工商大学2017研]A.品质标志B.数量标志C.标志值D.数量指标【答案】A【解析】“等级”属于顺序数据,只能用文字来描述,因此是品质标志,其标志值为“优秀”“良好”“及格”。
4.下面不属于描述统计问题的是()。
[山东大学2015研]A.根据样本信息对总体进行的推断B.了解数据分布的特征顺序数据C.分析感兴趣的总体特征D.利用图、表或其他数据汇总工具分析数据【答案】A【解析】描述统计研究的是数据收集、处理、汇总、图表描述、概括与分析等统计方法。
BCD三项都是描述统计问题。
A项中根据样本信息对总体进行推断则是推断统计内容。
5.一项民意调查的目的是想确定年轻人愿意与其父母讨论的话题。
调查结果表明:45%的年轻人愿意与其父母讨论家庭财务状况,38%的年轻人愿意与其父母讨论有关教育的话题,15%的年轻人愿意与其父母讨论爱情问题。
贾俊平《统计学》考研真题(含复试)与典型习题详解(指 数)【圣才出品】

【答案】C
【解析】加权平均价格指数是计算综合指数的另一种形式,它是以某一时期的销售额为
权数对单个商品价格指数的加权平均。设 p1/p0 为某一商品的价格指数,当使用基期的销售
额 p0q0 为权数时,一组商品的价格综合指数的计算公式为:
Ip
p1 p0
p0q0
p0q0
当使用报告期的销售额 p1q1 为权数时,一组商品的价格综合指数的计算公式为:
2 / 33
圣才电子书 十万种考研考证电子书、题库视频学习平台
加的收入分别是( )。[中南财大 2005 研] A.21.9%和 10.19 亿元 B.21.9%和 7.81 亿元 C.8.49%和 10.19 亿元 D.8.49%和 7.81 亿元 【答案】C 【解析】收购总额指数=1+15%=115%,收购价格指数=106%,由于收购总额指数=
13.某商店本期商品销售量比上期增长 10%,同期的销售额比上期增长 15%,则销售
生产费用支出总额指数 单位成本指数 产量指数 (1 32%)(1 26%) 85.68%
10.加权平均价格指数是以某一时期的( )为权数对单个商品价格指数的加权平 均。
4 / 33
圣才电子书
A.销售量
十万种考研考证电子书、题库视频学习平台
B.商品价格
C.销售额
D.综合指数
收购价格指数×收购量指数,所以收购量指数=115%/106%=108.49%。即农产品收购量增 加的百分比为 8.49%,因此增加的收入为 120×8.49%=10.19(亿元)。
6.在指数数列中具有不变权数的数列是( )。[中南财大 2004 研] A.拉氏定基指数 B.帕氏定基指数 C.拉氏环比指数 D.帕氏环比指数 【答案】A 【解析】BCD 三项采用的是可变权数。
贾俊平《统计学》(第7版)考点归纳和课后习题详解(含考研真题)(第12章多元线性回归)【圣才出品】

贾俊平《统计学》(第7版)考点归纳和课后习题详解(含考研真题)(第12章多元线性回归)【圣才出品】第12章多元线性回归12.1 考点归纳【知识框架】【考点提⽰】(1)多元线性回归模型,包括回归模型的基本假定(简答题考点),最⼩⼆乘估计(选择题、计算题考点);(2)回归模型的拟合优度评价(简答题、计算题考点);(3)显著性检验(计算题考点);(4)多重共线性的含义、产⽣的问题、判别及处理⽅式(简答题考点)。
【核⼼考点】考点⼀:多元线性回归模型1.回归模型假定(1)E (ε)=0;(2)D (ε)=σ2;(3)()2cov ,0i j i j i j σεε?==?≠?2.参数的最⼩⼆乘估计使残差平⽅和Q =∑(y i -y ∧i )2=∑(y ∧i =β∧0-β∧1x 1-β∧2x 2-…-β∧k x k )2达到最⼩的β∧0,β∧1,β∧2,…,β∧k 。
由此可以得到求解β∧0,β∧1,β∧2,…,β∧k 的标准⽅程组为:00?0?00,1,2,,i i ββi ββQ βQ i k β==??===???多元线性回归的最⼩⼆乘估计是最优线性⽆偏估计。
考点⼆:回归⽅程的拟合优度表12-1 多元线性回归⽅程的评价【提⽰】实际应⽤中,采⽤调整的判定系数来评价多元回归⽅程的拟合优度。
【真题精选】多元线性回归模型的调整的多重判定系数取值范围在0⾄1之间。
[对外经济贸易⼤学2018研]【答案】√【解析】多重判定系数R2=SSR/SST是多元回归中的回归平⽅和占总平⽅和的⽐例,它是度量多元回归⽅程拟合程度的⼀个统计量,反映了在因变量y的变差中被估计的回归⽅程所解释的⽐例,取值为0~1。
调整的多重判定系数R a2与多重判定系数R2不同之处在于:R a2同时考虑了样本量n和模型中⾃变量的个数k的影响,这就使得R a2的值永远⼩于R2,⽽且R a2的值不会由于模型中⾃变量个数的增加⽽越来越接近1,因此R a2的取值也为0~1。
贾俊平《统计学》考研真题(含复试)与典型习题详解(第6版)

目录分析
1.2课后习题详解
1.1复习笔记
1.3典型习题详解
2.2课后习题详解
2.1复习笔记
2.3典型习题详解
3.2课后习题详解
3.1复习笔记
3.3典型习题详解
4.2课后习题详解
4.1复习笔记
4.3典型习题详解
5.2课后习题详解
5.1复习笔记
5.3典型习题详解
6.2课后习题详解
6.1复习笔记
12.1复习笔记
12.3典型习题详解
13.2课后习题详解
13.1复习笔记
13.3典型习题详解
14.2课后习题详解
14.1复习笔记
14.3典型习题详解
作者介绍
谢谢观看
6.3典型习题详解
7.2课后习题详解
7.1复习笔记
7.3典型习题详解
8.2课后习题详解
8.1复习笔记
8.3典型习题详解
9.2课后习题详解
9.1复习笔记
9.3典型习题详解
10.2课后习题详解
10.1复习笔记
10.3典型习题详解
11.2课后习题详解
11.1复习笔记
11.3典型习题详解
12.2课后习题详解
精彩摘录
统计学是收集、处理、分析、解释数据并从数据中得出结论的科学。 参数是用来描述总体特征的概括性数字度量 不论如何偏斜,中位数总是在众数与算术平均数之间。经验表明,在适度偏斜的情况下,众数与中位数的距 离约为中位数与算术平均数距离的2倍。 概率抽样最主要的优点是可以依据调查结果,计算估计量误差,从而得到对总体目标量进行推断的可靠程度。 从另一个方面讲,也可以按照要求的精确度,计算必要的样本单位数目。 统计推断的三个中心内容:抽样分布、参数估计和假设检验。 统计学上的自由度是指当以样本的统计量来估计总体的参数时,样本中独立或能自由变化的变量的个数 样本方差:样本数据个数减1后除离差平方和。其中样本数据个数减1,即n-1称为自由度 几何平均数主要用于计算比率的平均 控制抽样误差的主要方法是改变样本量,要求的抽样误差越小,所需要的样本量就越大。 概率抽样(随机抽样):指遵循随机原则进行的抽样,总体中每个单位都有一定的机会被选入样本。
贾俊平《统计学》考研真题(含复试)与典型习题详解(数据的搜集)【圣才出品】

第2章数据的搜集一、单项选择题1.为了调查某校学生的购书费用支出,从各年级的学生中分别抽取100名学生,组成样本进行调查,这种抽样方法属于()。
[浙江工商大学2011研]A.简单随机抽样B.分层抽样C.系统抽样D.整群抽样【答案】B【解析】简单随机抽样就是即使从包括N个单位的抽样框中随机地、一个个地抽取n个单位作为样本,每个单位的入样概率是相等的;分层抽样是将抽样单位按某种特征或某种规则划分为不同的层,然后从不同的层中独立、随机地抽取样本,将各层的样本结合起来,对总体的目标量进行估计;系统随机抽样也称为机械随机抽样或等距离随机抽样。
它是先将总体中各单位按一定的顺序排列,然后每隔一定的距离抽取一个单位构成样本;整群抽样又称聚类抽样,是将总体中若干个单位合并为组,这样的组称为群,抽样时直接抽取群,然后对中选群中的所有单位全部实施调查。
2.为调查在中国的省会城市和4个直辖市的居民年收入,需要从这些城市的居民中抽取一个样本,你认为以下四种抽样方式哪一种会得到更有代表性的样本?( )。
[中山大学2011研]A.简单随机抽样B.整群抽样C.系统随机抽样D.分层随机抽样【答案】D【解析】在规模较大的调查中,很少直接采用简单随机抽样,一般是把这种方法和其他抽样方法结合在一起使用;整群抽样又称聚类抽样,是将总体中若干个单位合并为组,这样的组称为群,抽样时直接抽取群,然后对中选群中的所有单位全部实施调查;系统随机抽样也称为机械随机抽样或等距离随机抽样。
它是先将总体中各单位按一定的顺序排列,然后每隔一定的距离抽取一个单位构成样本;分层抽样是将抽样单位按某种特征或某种规则划分为不同的层,然后从不同的层中独立、随机地抽取样本,分层抽样在实践中得到了广泛的应用。
3.某政府机构想尽快了解社会公众对其出台的一项政策的态度,最恰当的数据搜集方式是( )。
[中央财经大学2011研]A.面访B.深度访谈C.计算机辅助电话调查D.邮寄调查【答案】C【解析】面访即调查者直接走访被调查者,当面听取被调查者的意见。
贾俊平《统计学》考研真题(含复试)与典型习题详解 第13章~第14章【圣才出品】

A.消除偶然因素引起的不规则变动 B.消除非偶然因素引起的不规则变动 C.消除绝对数变动 D.消除计算误差 【答案】A 【解析】平稳时间序列通常只含有随机成分,其预测方法主要有简单平均法、移动平均 法和指数平滑法等,这些方法主要是通过对时间序列进行平滑以消除其随机波动。
1 / 72
圣才电子书 十万种考研考证电子书、题库视频学习平台
测值逐渐降低,并以 0 为极限。
3.某一时间数列,当取时间变量t=1,2,3,……时,有Y=38+72t,若取t=0, 2,4,……,则趋势方程为( )。[浙江工商大学 2011 研]
A.y=38+144t B.y=110+36t C.y=72+110t D.y=34+36t 【答案】B
【解析】线性趋势方程式 Yˆt b0 b1t 中, Yˆt 代表时间序列 Yt 的预测值;t 代表时间标 号;b0 代表趋势线在 Y 轴上的截距,是当 t=0 时, Yˆt 的数值;b1 是趋势线的斜率,表示
时问 t 变动一个单位,观察值的平均变动数量。
4.如果时间序列不存在季节变动,则各期的季节指数应( )。[安徽财经大学 2012
10.时间序列分析中,计算季节指数通常采用的是( )。[中南财大 2003 研] A.同期平均法 B.最小平方法 C.几何平均法 D.调和平均法 【答案】A 【解析】计算季节指数较常用的是同期平均法和趋势剔除法。
3 / 72
圣才电子书 十万种考研考证电子书、题库视频学习平台
7.如果时间序列的环比增长量大致相等,则应采用的趋势模型为( )。[中央财经大 学 2012 研]
贾俊平《统计学》(第7版)考点归纳和课后习题详解(含考研真题)-第一章至第三章【圣才出品】

第1章导论1.1考点归纳【知识框架】【考点提示】(1)统计学的目的(选择题考点);(2)描述统计和推断统计的区分、参数估计和假设检验的区分(选择题考点);(3)统计数据类型、分类、各自特点及其具体应用(选择题、简答题考点)(非常重要);(4)统计学中的基本概念(选择题、简答题考点)。
【核心考点】考点一:统计数据的类型(见表1-1)表1-1统计数据的类型【注意】①分类数据和顺序数据说明的是事物的品质特征,其结果均表现为类别,因而也统称为定性数据或称品质数据;数值型数据说明的是现象的数量特征,因此也称为定量数据或数量数据。
②对不同类型的数据采用不同的统计方法来处理和分析。
对分类数据可以计算出各类别的频率,而数值型数据则可以进行数学运算。
【真题精选】1.在对数据进行汇总时,往往将男性用“1”来表示,女性用“0”来表示,所以将性别视为数值型变量。
[对外经济贸易大学2018研]【答案】×【解析】数值型变量是说明事物数字特征的一个名称,其取值是数值型数据,数值型数据是按数字尺度测量的观察值,其结果表现为具体的数值;分类变量是说明事物类别的一个名称,其取值是分类数据,分类数据是只能归于某一类别的非数字型数据,它是对事物进行分类的结果,数据表现为类别,是用文字来表述的。
性别是分类变量,为便于统计处理,对于分类变量可以用数字代码来表示各个类别。
2.下列数据不属于时间序列数据的是()。
[四川大学2016研]A.1990~2014年我国每年进出口总额B.2014年某品牌手机在中国各个省市的销售量C.成都市2014年每个月的PM2.5月平均浓度D.某股票在2015年1月的日收盘价【答案】B【解析】时间序列数据是在不同时间收集到的数据,这类数据是按时间顺序收集到的,用于描述现象随时间变化的情况。
本题中B项是在相同的时间点、不同的空间上获得的数据,属于截面数据。
考点二:统计中的基本概念1.总体和样本(1)总体、个体(2)样本、样本量2.参数和统计量(1)参数:用于描述总体特征,是未知的常数。
- 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
- 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
- 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。
赞成
35
30
65
反对
15
20
35
合计
50
50
100
如果要检验男女教师对教师体制改革的看法是否相同,提出的原假设为( )。
A.H0:π1=π2=35
6 / 19
圣才电子书
B.H0:π1=π2=50
十万种考研考证电子书、题库视频学习平台
C.H0:π1=π2=65
D.H0:π1=π2=0.65
【解析】 2 检验的自由度=(行数-1)(列数-1)=(R-1)(C-1)=(3-1)×
(4-1)=6。
4.一所大学准备采取一项学生对餐厅改革的调查,为了解男女学生对这一措施的看法,
分别抽取了 300 名男学生和 2餐厅改革的调查结果
位变量,这里划分为两类,即男同学和女同学,即 3×2 列联表。
5.一所大学为了解男女学生对后勤服务质量的评价,分别抽取了 300 名男学生和 240
名女学生进行调查,得到的结果如表 9-2 所示。
表 9-2 关于后勤服务质量评价的调查结果
男同学
女同学
合计
满意
200
180
380
一般
60
40
100
不满意
A.1
B.2
C.3
D.4
2
( fo fe)2 fe
将表 9-5 中的数据代入计算得: 2 =1.2352。
9.某学校准备采取一项新的教师体制改革,为了解男女教师对这一措施的看法,分别
抽取了 50 名男教师和 50 名女教师进行调查,得到的结果如表 9-6 所示。
表 9-6 关于教师体制改革的调查结果
男教师
女教师
合计
期望值
204
162
根据这个列联表计算的 χ2 统计量的值为( )。
A.0.6176
B.1.2352
C.2.6176
D.3.2352
【答案】B
【解析】 2 检验可以用于变量间拟合优度检验和独立性检验,可以用于测定两个分类
变量之间的相关程度。用 fo 表示观察值频数,用 fe 表示期望值频数,则 2 统计量为:
8.某学校准备采取一项新的教师体制改革,为了解男女学生对这一措施的看法,分别 抽取了 300 名男学生和 240 名女学生进行调查,得到的结果如表 9-5 所示。
赞成 观察值 期望值
反对 观察值
表 9-5 男同学
90 96
210
5 / 19
女同学
84 78 156
圣才电子书 十万种考研考证电子书、题库视频学习平台
根据这个列联表计算的赞成研究生奖学金制度改革的行百分比分别为( )。
A.51.7%;48.3%
B.57.4%;42.6%
C.30%;70%
D.35%;65%
【答案】A
【 解析 】 赞 成研 究生奖 学金 制度 改革 的行 百分比 分别 为: 90/174×100%=51.7% ;
84/174×100%=48.3%。
师进行调查,得到的结果如表 9-3 所示。
表 9-3 关于中学新课标改革的调查结果
男教师
女教师
合计
赞成
240
200
440
中立
50
35
85
反对
10
5
15
合计
300
240
540
这个列联表的最右边一列称为( )。
A.总频数
B.条件频数
C.行边缘频数
D.列边缘频数
【答案】C
7.某大学为了解学生对研究生奖学金制度改革的看法,分别抽取了 300 名男研究生和
【答案】D
【解析】如果男女生对教师体制改革的看法不存在差异,则男女教师赞成教师体制改革
的比例应该是相同的(均为 65/100=0.65)。所以提出的原假设和备择假设分别为:
H0:π1=π2=0.65(赞成比例一致);H1:1 2 (赞成比例不一致)
10.某大学为了解男女毕业生对开设《职业规划》这门课程的看法,分别抽取了 500
50
20
70
合计
310
240
550
这个列联表的最下边一行称为( )。
A.总频数
B.条件频数
C.行边缘频数
D.列边缘频数
【答案】D
6.某中学为了解教师对新课标改革的看法,分别抽取了 300 名男教师和 240 名女教
3 / 19
圣才电子书 十万种考研考证电子书、题库视频学习平台
2.列联表中的每个变量( )。 A.只能有一个类别 B.只能有两个类别 C.对类别没有限制 D.可以有两个或两个以上的类别 【答案】D
1 / 19
圣才电子书 十万种考研考证电子书、题库视频学习平台
3.设列联表的行数为 3,列数为 4,则 χ2 检验的自由度为( )。 A.3 B.4 C.6 D.12 【答案】C
圣才电子书 十万种考研考证电子书、题库视频学习平台
第 9 章 分类数据分析 一、单项选择题 1.列联分析是利用列联表来研究( )。 A.两个数值型变量的关系 B.两个分类变量的关系 C.两个数值型变量的分布 D.一个分类变量和一个数值型变量的关系 【答案】B 【解析】列联表是由两个以上的变量进行交叉分类的频数分布表,列联分析是利用列联 表来研究两个分类变量之间的关系。
名男学生和 500 名女学生进行调查,得到的结果如表 9-7 所示。
表 9-7 关于开设《职业规划》课程的调查结果
男同学
女同学
合计
赞成
400
450
850
中立
60
40
100
反对
40
10
50
合计
500
500
1000
如果要检验男女毕业生对开设《职业规划》这门课程的看法是否相同,即检验假设 H0: π1=π2=850/1000=0.85,χ2 检验统计量的自由度是( )。
240 名女研究生进行调查,得到的结果如表 9-4 所示。
表 9-4 关于研究生奖学金制度改革的调查结果
男研究生
女研究生
合计
赞成
90
84
174
中立
100
56
156
反对
110
100
210
4 / 19
圣才电子书 十万种考研考证电子书、题库视频学习平台
合计
300
240
540
男同学
女同学
合计
赞成
90
84
174
中立
100
56
156
反对
110
100
210
合计
300
240
540
这个表格是( )。
A.4×3 列联表
B.3×2 列联表
C.2×3 列联表
2 / 19
圣才电子书
D.3×4 列联表
十万种考研考证电子书、题库视频学习平台
【答案】B
【解析】表中的行是态度变量,这里划分为三类,即赞成,中立和反对;表中的列是单