第17章 抽样调查
第七章 抽样调查

例 题 四 解:
已知: N 60000 n 300 n1 6
则:样本合格率 p n n1 300 6 0.98
n
300
p
p1 p 0.98 0.02 0.Biblioteka 08(%)n300
p
p1
p 1
n
n N
0.98 0.02 1
300
0.806(%)
300 60000
=2
1+4 2
=2.5
2+4 2
=3
3+5 = 4 …….. 2
多数样本指标与总体指标都有误差,误差有大、有小,有正、有负,抽 样平均误差就是将所有的误差综合起来,再求其平均数,所以抽样平 均误差是反映抽样误差一般水平的指标。
抽样平均误差的计算理论公式
抽样平均数 的平均误差
x
xX 2
M
抽样成数 平均误差
第五节 抽样单位数目的确定
第五节 抽样单位数目的确定
样本单位数的计算方法: 教材P302-306
通过抽样极限误差公式计算必要的样本单位数。
抽样平均数 抽样成数
重复抽样:
n
t
2
2 x
2x
不重复抽样:
n
t
2
N
2 x
2x N t 2
2 x
n
t 2 p1
2p
p
n
t2 Np1 p N2p t 2 p1
产品质量 x 数量(件) f
合格品 1
N1
不合格品 0
N0
合计
N
平均数
x xf f
1 N1 0 N0 N1 P (成数)
N1 N0
第六章抽样调查习题答案

第六章抽样调查习题答案一、单项选择题1、 C2、 A3、 D4、 D5、C6、 D7、 C8、 A9、 D 10、A11、 D 12、C 13、B 14、 A 15、A16、 B 17、 B 18、D 19、 A 20、A21、 A 22、 D 23、 D 24、 B 25、A二、判断题1、CD2、AE3、BCD4、ABDE5、ABD6、AB7、ABCD8、AC9、ABCD三、判断题1、×2、√3、√4、√5、√6、×7、√8、×9、√10、√11、×12、√13、√14、×15、×16、√17、√18、×四、填空题1、随机、部分、总体2、计算、控制3、重复、不重复4、大于5、点估计、区间估计6、增加到4倍、减少三分之二、减少四分之三7、大样本、小样本8、正、反五、复习思考题1、影响抽样误差的主要因素有哪些?答:影响抽样误差大小的因素主要有:(1)总体单位的标志值的差异程度。
差异程度愈大则抽样误差愈大,反之则愈小。
(2)样本单位数的多少。
在其他条件相同的情况下,样本单位数愈多,则抽样误差愈小。
(3)抽样方法。
抽样方法不同,抽样误差也不相同。
一般说,重复抽样比不重复抽样,误差要大些。
(4)抽样调查的组织形式。
抽样调查的组织形式不同,其抽样误差也不相同,而且同一组织形式的合理程度也会影响抽样误差。
2、什么是抽样调查?它有哪些特点?答:抽样调查是根据部分实际调查结果来推断总体标志总量的一种统计调查方法,属于非全面调查的范畴。
它是按照科学的原理和计算,从若干单位组成的事物总体中,抽取部分样本单位来进行调查、观察,用所得到的调查标志的数据以代表总体,推断总体。
(1)只抽取总体中的一部分单位进行调查。
(2)用一部分单位的指标数值去推断总体的指标数值(3)调查样本是按随机的原则抽取的,在总体中每一个单位被抽取的机会是均等的,因此,能够保证被抽中的单位在总体中的均匀分布,不致出现倾向性误差,代表性强。
统计学原理-第六章 抽样调查(复旦大学第六版)

2.样本总体:简称样本,是从全及总体中随机
抽取出来,代表全及总体部分单 位的集合体。单位数用n表示。
5
二.全及指标和抽样指标
(一)全及指标
X 总体平均数: X N 总体成数:P
2
XF 或X F Q=
2 2
N1 N N
(X-X) 总体方差: = 总体标准差:= (X-X)
(一)考虑顺序的不重复抽样数目
N! A N ( N 1)(N 2) ( N n 1) ( N n)! 4 3 2 1 2 例如A4 12 2 1
n N
(二)考虑顺序的重复抽样数目
B N
n N 2 4
n 2
例如 B 4 16
10
(三)不考虑顺序的不重复抽样数目
Ex X
28
2、一致性 当抽样单位数充分大时,抽样指标和未知 的总体指标之间的绝对离差为任意小的可能性 也趋于必然性。
x X 任意小
3、有效性
即用抽样指标估计总体指标,要求作为优良估 计量方差应该比其他估计量的方差小。
2
x X f
2
f
2
x X f
x
x E ( x)
2
18
说明:根据数理统计理论,在重复抽样条件下, 抽样平均误差与全及总体的标准差成正比例关系。 与抽样总体单位平方根成反比关系。
19
在不重复抽样情况下,抽样平均误差计算公式如下:
x x
N n 250 4-2 ( )= ( ) =9.13(件) n N 1 2 4-1
2
N
X X F 或 F X X F 或 F
抽样调查答案

抽样技术第1、2章试题一、单选题1.非概率抽样的优点( D )A.能计算抽样误差B.能从概率的意义上控制误差C.样本数据能对总体情况进行推断D.操作简单,不需要抽样框,经济、快速,调查数据的处理也容易2.概率抽样与非概率抽样的根本区别是( B )A、是否能保证总体中每个单位都有完全相同的概率被抽中B、是否能保证总体中每个单位都有事先已知或可以计算的非零概率被抽中C、是否能减少调查误差D、是否能计算和控制抽样误差3.以下哪种抽样不属于非概率抽样( C )A、判断抽样B、方便抽样C、不等概率抽样D、配额抽样3. 抽样调查的根本功能是( C )A、获取样本资料 B.、计算样本资料C、推断总体数量特征D、节约费用4.下列不属于概率抽样的是( B )A、不等概率抽样B、滚雪球抽样C、系统抽样D、整群抽样5.下列抽样框中不属于名录框的是( A )A、时间B、学生名单C、公司名录册D、电话号码簿6.用样本统计量对总体参数进行估计时产生的误差是( C )A、总体方差B、样本方差C、估计量方差D、偏倚7.以下抽样方法不属于非概率抽样的是( C )A、目的抽样B、随意抽样C、随机抽样D、判断抽样8.下列说法错误的是( C )A、对于无偏估计量,均方误差等于方差B、抽样误差是抽样方法本身所引起的误差,是由于样本不能完全代替总体而导致的误差C、抽样方差是依据样本方差计算,而方差估计量是依据总体方差计算D、抽样标准误差是抽样方差的平方根9.下列关于非概率抽样和概率抽样说法正确的是( A )A、非概率抽样的一个重要应用是充当预调查角色,作为开发概率抽样的厨师步骤。
B、概率抽样是指按照一定的概率以随机原则抽取样本,也称为等概率抽样。
C、随机与随便的本质区别就在于,是否按照给定的抽样概率,通过一定的随机化程序抽取样本单元。
D、非概率抽样的偏倚较小,有利于评价样本的代表性。
10.概率抽样中的基本抽样方法不包括( C )A、简单随机抽样B、分层抽样C 、定额抽样D 、整群抽样11. 下列属于总体参数的是( B )A 、)y y (ˆn21+++=L y n N Y B 、)(121N Y Y Y NY +++=LC 、)(n1ˆ21ny y y P +++=L D 、∑∑===ni ini i x y R 11/ˆ 12. 抽样框的具体表现形式不包括( B ) A 、区域框 B 、初级框 C 、自然框 D 、名录框13. 估计量方差是( B )A 、指按照某一抽样方案反复进行抽样,估计值的数学期望与待估参数之间的离差。
统计学原理第七章 抽样调查

合
计
x A 2 x A ( d ) f ( d )f d σ f f
2
256 72 σ 50 11504 50 53.63 200 200
2
30
第三节 全及指标的推断
一、全及指标的点估计
22
不具有某一标志的单位数用N0表示。 ► 总体成数和标准差与样本成数和标准差的计 算方法相同。只是总体指标用大写字母表示, 样本指标用小写字母表示。例如: ► 具有某一标志的单位数占总体的比重:
N1 P N
总体成数
n1 p n
样本成数
不具有某一标志的单位数占总体的比重:
N0 Q 1 P N
13
► 2.
(二)中心极限定律 ► 1. 独立同分布中心极限定理:证明不论变量 总体服从何种分布,只要它的数学期望和方 差存在,从中抽取容量为n 的样本,则这个 样本的总和或平均数是个随机变量,当n 充 分大时,样本的总和或平均数趋于正态分布.
► 2.
德莫佛-拉普拉斯中心极限定理:证明属性 总体的样本成数和样本方差,在n足够大时, 同样趋于正态分布。
σ N n σ n μx ( ) μx (1 ) n N 1 n N
2 2
总体单位总数
样本单位总数
抽样比例
21
(一)抽样成数的抽样平均误差μp ► 属性总体的标志值是用文字表示的,且标志 只有两个取值,非此即彼,故将属性总体的 标志称为“交替标志”或“是非标志”。 ► 交替标志也可以计算平均数(即成数)和标 准差。为了计算交替标志的平均数和标准差 必须将交替变异的标志过渡到数量标志。 ► 交替标志仍以x表示,设:x =1表示单位具有 某一标志, x = 0表示单位不具有某一标志。 具有某一标志的单位数用N1表示;
第16章 抽样调查

按比例分配,初高中应抽取的人数:
n1
391 2900 5400
209.9
210 , n2
391 2500 5400
181.0
181
小结
1. 调查资料统计分析的主要目的是估计总体参数的置信区间。 不论采用何种抽样方式,总体均数的置信区间估计公式都是
X t / 2,n1S X 或 X Z / 2 S X 总体概率的置信区间估计公式都是
P
1.96SP
123 270
1.96(0.030)
(0.397,
0.514)
该中学学生的平均视力介于 0.74 和 0.86 之间,患近视眼学生所占的 百分比介于 39.7%和 51.4%之间。
二、样本含量的估算
(一)区间估计样本含量估算的依据 三方面信息: 变异、精度、置信度
1.个体的变异程度 个体间变异: 变异系数 CV
n
57.3Z / 2
2
arcsin[P / P(1 P)]
对于例 16-1, P 123 (介于 0.2-0.8 之间) 270
相对误差 10%
置信水平 1 95%
n
Z2 / 2 (1
2P
P)
(1.96)2 (1 123 / 270) (0.1)2 (123 / 270)
3.置信程度 置信水平1 研究者自行规定,通常取 90%,95%,99%
(二)样本含量的估算
1. 总体均数估计的样本含量
2
n
Z
/ 2CV
(16-3)
对于例 16-1,将 270 名中学生的资料视为预调查,
CV 0.54 0.675 0.8
若要求最大相对误差为 1 0 % ,置信水平为1 95% ,则
第7章 抽样调查及答案

第七章 抽样调查一、本章重点1.抽样调查也叫做抽样推断或参数估计,必须坚持随机抽样的原则。
它是一种非全面调查,其意义在于对总体的推断上,存在可控制性误差。
是一种灵活快捷的调查方式。
2.抽样调查有全及总体与样本总体之区分。
样本容量小于30时一般称为小样本。
对于抽样调查来讲全及总体的指标叫做母体参数,是唯一确定的未知的量,样本指标是根据样本总体各单位标志值计算的综合性指标,是样本的一个函数,是一个随机变量,抽样调查就是要用样本指标去估计相应的总体指标。
样本可能数目与样本容量有关也与抽样的方法有关。
抽样方法可以分为考虑顺序的抽样与不考虑顺序的抽样;重复抽样与不重复抽样。
3.大数定律、正态分布理论、中心极限定理是抽样调查的数理基础。
正态分布的密度函数有两个重要的参数(σ;x )。
它有对称性、非负性等特点。
中心极限定理证明了所有样本指标的平均数等于总体指标如X x E =)(。
推出了样本分布的标准差为:1--=N n N n x σμ。
4.抽样推断在逻辑上使用的是归纳推理的方法、在方法上使用的是概率估计的方法、存在着一定误差。
无偏性、一致性和有效性是抽样估计的优良标准。
抽样调查既有登记性误差,也有代表性误差,抽样误差是一个随机变量,而抽样的平均误差是一个确定的值。
抽样误差受总体标志值的差异程度、样本容量、抽样方法、抽样组织形式的影响。
在重复抽样下抽样的平均误差与总体标志值的差异程度成正比,与样本容量的平方根成反比即n x σμ=,不重复抽样的抽样平均误差仅与重复抽样的平均误差相差一个修正因子即N nn x -=1σμ。
在通常情况下总体的方差是未知的,一般要用样本的方差来代替。
把抽样调查中允许的误差范围称作抽样的极限误差x ∆或p ∆。
μt =∆,用抽样的平均误差来度量抽样的极限误差。
把抽样估计的把握程度称为抽样估计的置信度。
抽样的极限误差越大,抽样估计的置信度也越大。
抽样估计又可区分为点估计和区间估计。
《统计学》课后练习题答案

A.透视表B.合并计算C.单变量求解D.分类汇总
5.小张收集了1957-2007年中国GDP的数据,如果要反映这50年我国生产发展的趋势,用什么图形最为合适?()(知识点3.5答案:D)
A.直方图B.散点图C.饼图D.折线图
37
பைடு நூலகம்33.6
130-140
12
10.9
103
93.6
19
17.3
140-150
5
4.5
108
98.2
7
6.4
150-160
2
1.8
110
100.0
2
1.8
合计
110
100
—
—
—
—
A.树苗高度低于110厘米的占总数的39.1%B.树苗高度低于110厘米的占总数的84.5%
C.树苗高度高于130厘米的有19棵D.树苗高度高于130厘米的有103棵
第二章数据的收集与整理
2.1数据的来源
2.2统计调查方案设计
2.3调查方法
2.4调查的组织方式:普查、抽样调查、重点调查、典型调查
2.5抽样的组织方式:简单随机抽样、系统抽样、分层抽样、整群抽样
2.6数据的审定:误差
2.7数据的分组
2.8.编制次数分布表:频数(次数)、频率
习题
一、单项选择题
1.小吴为写毕业论文去收集数据资料,()是次级数据。(知识点:2.1答案:C)
A.指标B.标志C.变量D.标志值
8.以一、二、三等品来衡量产品质地的优劣,那么该产品等级是()。(知识点:1.7答案:A)
A.品质标志B.数量标志C.质量指标D.数量指标