简单随机抽样习题及解答
第2章简单随机抽样

称简单随机抽样,所得的样本称为不放回的
简单随机样本,简称简单随机样本
精选可编辑ppt
2
简单随机抽样的实施方法:将总体中的单元 依次从1到N进行编号,然后利用抽签法或随 机数法来进行简单随机抽样
抽签法:一般用于总体所含单元不多的情况, 首先做N个签并依次写上1至N的号码,然后 将签充分混合均匀,再一次抽取其中的n个 签或逐个不放回地抽取n个签,则编号为这n 个签上的号码的单元就构成一个简单随机样 本
注3: V(y),V(Yˆ) 中的 S
2 Y
一般是未知的,因此需要通
过样本进行估计
精选可编辑ppt
14
定理2.2.3
在简单随机抽样中,样本方差
s
2 y
是总体方差
S
2 Y
的无偏估计量,样本协方差 s y x
是总体协方差 S Y X 的无偏估计量
推论2.2.1 在简单随机抽样中,
Vˆ(y) ˆ 1 f n
在一定条件下,利用辅助指标的信息可以提 高对主要指标的估计的精度
一般地,辅助指标可以是主要指标的前期资 料,也可以是表示单元规模的量,或者是单 元的某个易测指标,等等
精选可编辑ppt
31
如果主要指标Y与辅助指标X之间有正相关关 系,就可以构造比估计量
在简单随机抽样中,称 YˆR ˆ yR ˆ RˆX 为总体均 值 Y 的比估计量,称 YˆRˆ NyRRˆX为总体总 值 Y 的比估计量,其中 X 或 X 必须已知
sy2
是
V
(
y
) 的无偏估计量
Vˆ(Yˆ)ˆ N21f n
sy2 是 V
( Yˆ )
的无偏估计量
注:把 Vˆ(y), Vˆ(Yˆ) 分别作为 V(y), V(Yˆ) 的估计 量,都称为标准差估计量
高一数学《随机抽样》练习题

高一数学《随机抽样》练习题一、选择题1。
对于简单随机抽样,个体被抽到的机会 A.相等B .不相等 C.不确定 D.与抽取的次数有关2. 抽签法中确保样本代表性的关键是A.制签 B 。
搅拌均匀 C .逐一抽取 D.抽取不放回3。
用随机数表法从100名学生(男生25人)中20人进行评教,某男学生被抽到的机率是A.1001 B .251C.51D.414。
某校有40个班,每班50人,每班选派3人参加“学代会”,在这个问题中样本容量是 A.40 B 。
50 C .120 D.1505。
从某批零件中抽取50个,然后再从50个中抽出40个进行合格检查,发现合格品有36个,则该批产品的合格率为A。
36%B .72% C .90%D .25%6。
为了解1200名学生对学校教改试验,打算从中抽取一个容量为30的样本,考虑采用系统抽样,则分段的间隔k为A 。
40B .30 C.20 D.127。
从N 个编号中要抽取n 个号码入样,若采用系统抽样方法抽取,则分段间隔应为 A。
n N C.[n N ] D.[nN]1 8.下列说法正确的个数是①总体的个体数不多时宜用简单随机抽样法②在总体均分后的每一部分进行抽样时,采用的是简单随机抽样 ③百货商场的抓奖活动是抽签法④整个抽样过程中,每个个体被抽取的机率相等(有剔除时例外) A.1 B.2 C .3 D 。
49。
某单位有职工160人,其中业务员有104人,管理人员32人,后勤服务人员24人,现用分层抽样法从中抽取一容量为20的样本,则抽取管理人员 A 。
3人 B。
4人 C 。
7人 D.12人 10. 问题:①有1000个乒乓球分别装在3个箱子内,其中箱子内有500个,蓝色箱子内有200个,箱子内有300个,现从中抽取一个容量为100的样本;②从20名学生中选出3名参加座谈会.方法:Ⅰ。
随机抽样法Ⅱ。
系统抽样法Ⅲ。
分层抽样法。
其中问题与方法能配对的是A.①Ⅰ,②ⅡB。
《抽样技术》练习题5及答案

习题一1.请列举一些你所了解的以及被接受的抽样调查。
2.抽样调查基础理论及其意义;3.抽样调查的特点。
4.样本可能数目及其意义;5.影响抽样误差的因素;6.某个总体抽取一个n=50的独立同分布样本,样本数据如下:567 601 665 732 366 937 462 619 279 287690 520 502 312 452 562 557 574 350 875834 203 593 980 172 287 753 259 276 876692 371 887 641 399 442 927 442 918 11178 416 405 210 58 797 746 153 644 4761)计算样本均值y与样本方差s2;2)若用y估计总体均值,按数理统计结果,y是否无偏,并写出它的方差表达式;3)根据上述样本数据,如何估计v(y)?4)假定y的分布是近似正态的,试分别给出总体均值μ的置信度为80%,90%,95%,99%的(近似)置信区间。
习题二一判断题1 普查是对总体的所有单元进行调查,而抽样调查仅对总体的部分单元进行调查。
2 概率抽样就是随机抽样,即要求按一定的概率以随机原则抽取样本,同时每个单元被抽中的概率是可以计算出来的。
3 抽样单元与总体单元是一致的。
4 偏倚是由于系统性因素产生的。
5 在没有偏倚的情况下,用样本统计量对目标量进行估计,要求估计量的方差越小越好。
6 偏倚与抽样误差一样都是由于抽样的随机性产生的。
7 偏倚与抽样误差一样都随样本量的增大而减小。
8 抽样单元是构成抽样框的基本要素,抽样单元只包含一个个体。
9 抽样单元可以分级,但在抽样调查中却没有与之相对应的不同级的抽样框。
10 总体目标量与样本统计量有不同的意义,但样本统计量它是样本的函数,是随机变量。
11 一个抽样设计方案比另一个抽样设计方案好,是因为它的估计量方差小。
12 抽样误差在概率抽样中可以对其进行计量并加以控制,随着样本量的增大抽样误差会越来越小,随着n越来越接近N,抽样误差几乎可以消除。
《抽样技术》练习题5及答案

《抽样技术》练习题5及答案习题⼀1.请列举⼀些你所了解的以及被接受的抽样调查。
2.抽样调查基础理论及其意义;3.抽样调查的特点。
4.样本可能数⽬及其意义;5.影响抽样误差的因素;6.某个总体抽取⼀个n=50的独⽴同分布样本,样本数据如下:567 601 665 732 366 937 462 619 279 287690 520 502 312 452 562 557 574 350 875834 203 593 980 172 287 753 259 276 876692 371 887 641 399 442 927 442 918 11178 416 405 210 58 797 746 153 644 4761)计算样本均值y与样本⽅差s2;2)若⽤y估计总体均值,按数理统计结果,y是否⽆偏,并写出它的⽅差表达式;3)根据上述样本数据,如何估计v(y)?4)假定y的分布是近似正态的,试分别给出总体均值µ的置信度为80%,90%,95%,99%的(近似)置信区间。
习题⼆⼀判断题1 普查是对总体的所有单元进⾏调查,⽽抽样调查仅对总体的部分单元进⾏调查。
2 概率抽样就是随机抽样,即要求按⼀定的概率以随机原则抽取样本,同时每个单元被抽中的概率是可以计算出来的。
3 抽样单元与总体单元是⼀致的。
4 偏倚是由于系统性因素产⽣的。
5 在没有偏倚的情况下,⽤样本统计量对⽬标量进⾏估计,要求估计量的⽅差越⼩越好。
6 偏倚与抽样误差⼀样都是由于抽样的随机性产⽣的。
7 偏倚与抽样误差⼀样都随样本量的增⼤⽽减⼩。
8 抽样单元是构成抽样框的基本要素,抽样单元只包含⼀个个体。
9 抽样单元可以分级,但在抽样调查中却没有与之相对应的不同级的抽样框。
10 总体⽬标量与样本统计量有不同的意义,但样本统计量它是样本的函数,是随机变量。
11 ⼀个抽样设计⽅案⽐另⼀个抽样设计⽅案好,是因为它的估计量⽅差⼩。
12 抽样误差在概率抽样中可以对其进⾏计量并加以控制,随着样本量的增⼤抽样误差会越来越⼩,随着n越来越接近N,抽样误差⼏乎可以消除。
抽样调查习题答案

抽样调查习题答案【篇一:抽样调查习题及答案】ss=txt>1. 抽样调查是遵循随机的原则抽选样本,通过对样本单位的调查来对研究对象的总体数量特征作出推断的。
2. 采用不重复抽样方法,从总体为n的单位中,抽取样本容量为n的可能样本个数为n(n-1)(n-2)??(n-n+1)。
3. 只要使用非全面调查的方法,即使遵守随机原则,抽样误差也不可避免会产生。
4. 参数估计有两种形式:一是点估计,二是区间估计。
5. 判别估计量优良性的三个准则是:无偏性、一致性和有效性。
6. 我们采用“抽样指标的标准差”,即所有抽样估计值的标准差,作为衡量抽样估计的抽样误差大小的尺度。
7. 常用的抽样方法有简单随机抽样、类型(分组)抽样、等距抽样、整群抽样和分阶段抽样。
9. 如果总体平均数落在区间960~1040内的概率是95%,则抽样平均数是1000,极限抽样误差是40.82,抽样平均误差是20.41。
10. 在同样的精度要求下,不重复抽样比重复抽样需要的样本容量少,整群抽样比个体抽样需要的样本容量多。
二、判断题3. 重复抽样条件下的抽样平均误差总是大于不重复抽样条件下的抽样平均误差。
(√) 4. 在其他条件不变的情况下,抽样平均误差要减少为原来的1/3,则样本容量必须增大到9倍。
(√)1. 用简单随机抽样(重复)方法抽取样本单位,如果要使抽样平均误差降低50%,则样本容量需扩大为原来的(c)a. 2倍b. 3倍c. 4倍d. 5倍2. 事先将全及总体各单位按某一标志排列,然后依固定顺序和间隔来抽选调查单位的抽样组织方式叫做(d)a. 分层抽样b. 简单随机抽样c. 整群抽样d. 等距抽样3. 计算抽样平均误差时,若有多个样本标准差的资料,应选哪个来计算(b)a. 最小一个 b. 最大一个 c. 中间一个 d. 平均值4. 抽样误差是指(d)a. 计算过程中产生的误差b. 调查中产生的登记性误差c. 调查中产生的系统性误差d. 随机性的代表性误差5. 抽样成数是一个(a)a. 结构相对数b. 比例相对数c. 比较相对数d. 强度相对数 6. 成数和成数方差的关系是(c)A.成数越接近于0,成数方差越大B.成数越接近于1,成数方差越大C.成数越接近于0.5,成数方差越大D.成数越接近于0.25,成数方差越大 7. 整群抽样是对被抽中的群作全面调查,所以整群抽样是(b)a. 全面调查b. 非全面调查c. 一次性调查d. 经常性调查8. 对400名大学生抽取19%进行不重复抽样调查,其中优等生比重为20%,概率保证程度为95.45%,则优等生比重的极限抽样误差为(40%)a. 4% b. 4.13% c. 9.18% d. 8.26%9. 根据5%抽样资料表明,甲产品合格率为60%,乙产品合格率为80%,在抽样产品数相等的条件下,合格率的抽样误差是(b)a. 甲产品大b. 乙产品大c. 相等d. 无法判断10. 抽样调查结果表明,甲企业职工平均工资方差为25,乙企业为100,又知乙企业工人数比甲企业工人数多3倍,则随机抽样误差(b)a. 甲企业较大b. 乙企业较大c. 不能作出结论d. 相同四、多项选择题抽样调查中的抽样误差是(abcde)a. 是不可避免要产生的b. 是可以通过改进调查方法来避免的c. 是可以计算出来的d. 只能在调查结果之后才能计算e. 其大小是可以控制的 2. 重复抽样的特点是(ac)a. 各次抽选相互影响b. 各次抽选互不影响c. 每次抽选时,总体单位数始终不变 d 每次抽选时,总体单位数逐渐减少e. 各单位被抽中的机会在各次抽选中相等 3. 抽样调查所需的样本容量取决于(abe)a. 总体中各单位标志间的变异程度b. 允许误差c. 样本个数d. 置信度e. 抽样方法4. 分层抽样误差的大小取决于(bcd)a. 各组样本容量占总体比重的分配状况b. 各组间的标志变异程度c. 样本容量的大小d. 各组内标志值的变异程度e. 总体标志值的变异程度 5. 在抽样调查中(acd)a. 全及指标是唯一确定的b. 样本指标是唯一确定的c. 全及总体是唯一确定的d. 样本指标是随机变量e. 全及指标是随机变量五、名词解释 1.抽样推断 2.抽样误差3.重复抽样与不重复抽样4.区间估计六、计算题1.某公司有职工3000人,现从中随机抽取60人调查其工资收入情况,得到有关资料如下:(1)试以0.95的置信度估计该公司工人的月平均工资所在范围。
抽样调查习题及答案

第四章习题抽样调查一、填空题1. 抽样调查是遵循随机的原则抽选样本,通过对样本单位的调查来对研究对象的总体数量特征作出推断的。
2. 采用不重复抽样方法,从总体为N的单位中,抽取样本容量为n的可能样本个数为N(N-1)(N-2)……(N-N+1)。
3. 只要使用非全面调查的方法,即使遵守随机原则,抽样误差也不可避免会产生。
4. 参数估计有两种形式:一是点估计,二是区间估计。
5. 判别估计量优良性的三个准则是:无偏性、一致性和有效性。
6. 我们采用“抽样指标的标准差”,即所有抽样估计值的标准差,作为衡量抽样估计的抽样误差大小的尺度。
7. 常用的抽样方法有简单随机抽样、类型(分组)抽样、等距抽样、整群抽样和分阶段抽样。
8. 对于简单随机重复抽样,若其他条件不变,则当极限误差范围Δ缩小一半,抽样单位数必须为原来的4倍。
若Δ扩大一倍,则抽样单位数为原来的1/4。
9. 如果总体平均数落在区间960~1040内的概率是95%,则抽样平均数是1000,极限抽样误差是40.82,抽样平均误差是20.41。
10. 在同样的精度要求下,不重复抽样比重复抽样需要的样本容量少,整群抽样比个体抽样需要的样本容量多。
二、判断题1. 抽样误差是抽样调查中无法避免的误差。
(√)2. 抽样误差的产生是由于破坏了随机原则所造成的。
(×)3. 重复抽样条件下的抽样平均误差总是大于不重复抽样条件下的抽样平均误差。
(√)4. 在其他条件不变的情况下,抽样平均误差要减少为原来的1/3,则样本容量必须增大到9倍。
(√)5. 抽样调查所遵循的基本原则是可靠性原则。
(×)6. 样本指标是一个客观存在的常数。
(×)7. 全面调查只有登记性误差而没有代表性误差,抽样调查只有代表性误差而没有登记性误差。
(×)8. 抽样平均误差就是抽样平均数的标准差。
(×)三、单项选择题1. 用简单随机抽样(重复)方法抽取样本单位,如果要使抽样平均误差降低50%,则样本容量需扩大为原来的(C)A. 2倍B. 3倍C. 4倍D. 5倍2. 事先将全及总体各单位按某一标志排列,然后依固定顺序和间隔来抽选调查单位的抽样组织方式叫做(D)A. 分层抽样B. 简单随机抽样C. 整群抽样D. 等距抽样3. 计算抽样平均误差时,若有多个样本标准差的资料,应选哪个来计算(B)A. 最小一个B. 最大一个C. 中间一个D. 平均值4. 抽样误差是指(D)A. 计算过程中产生的误差B. 调查中产生的登记性误差C. 调查中产生的系统性误差D. 随机性的代表性误差5. 抽样成数是一个(A)A. 结构相对数B. 比例相对数C. 比较相对数D. 强度相对数6. 成数和成数方差的关系是(C)A.成数越接近于0,成数方差越大B.成数越接近于1,成数方差越大C.成数越接近于0.5,成数方差越大D.成数越接近于0.25,成数方差越大7. 整群抽样是对被抽中的群作全面调查,所以整群抽样是(B)A. 全面调查B. 非全面调查C. 一次性调查D. 经常性调查8. 对400名大学生抽取19%进行不重复抽样调查,其中优等生比重为20%,概率保证程度为95.45%,则优等生比重的极限抽样误差为(40%)A. 4%B. 4.13%C. 9.18%D. 8.26%9. 根据5%抽样资料表明,甲产品合格率为60%,乙产品合格率为80%,在抽样产品数相等的条件下,合格率的抽样误差是(B)A. 甲产品大B. 乙产品大C. 相等D. 无法判断10. 抽样调查结果表明,甲企业职工平均工资方差为25,乙企业为100,又知乙企业工人数比甲企业工人数多3倍,则随机抽样误差(B)A. 甲企业较大B. 乙企业较大C. 不能作出结论D. 相同四、多项选择题抽样调查中的抽样误差是(ABCDE)A. 是不可避免要产生的B. 是可以通过改进调查方法来避免的C. 是可以计算出来的D. 只能在调查结果之后才能计算E. 其大小是可以控制的2. 重复抽样的特点是(AC)A. 各次抽选相互影响B. 各次抽选互不影响C. 每次抽选时,总体单位数始终不变D 每次抽选时,总体单位数逐渐减少E. 各单位被抽中的机会在各次抽选中相等3. 抽样调查所需的样本容量取决于(ABE)A. 总体中各单位标志间的变异程度B. 允许误差C. 样本个数D. 置信度E. 抽样方法4. 分层抽样误差的大小取决于(BCD)A. 各组样本容量占总体比重的分配状况B. 各组间的标志变异程度C. 样本容量的大小D. 各组内标志值的变异程度E. 总体标志值的变异程度5. 在抽样调查中(ACD)A. 全及指标是唯一确定的B. 样本指标是唯一确定的C. 全及总体是唯一确定的D. 样本指标是随机变量E. 全及指标是随机变量五、名词解释1.抽样推断2.抽样误差3.重复抽样与不重复抽样4.区间估计六、计算题1.某公司有职工3000人,现从中随机抽取60人调查其工资收入情况,得到有关资料如下:(1)试以0.95的置信度估计该公司工人的月平均工资所在范围。
随机抽样、用样本估计总体习题及答案解析

随机抽样、用样本估计总体1.某棉纺厂为了解一批棉花的质量,从中随机抽测了100根棉花纤维的长度(棉花纤维的长度是棉花质量的重要指标).所得数据均在区间[5,40]中,其频率分布直方图如图所示,则在抽测的100根中,有 根棉花纤维的长度小于20 mm.惠生活 观影指南爱尚嘟嘟园迅播影院请支持我们,有更多资源和动力【答案】 30【解析】 因为频率分布直方图的矩形的高为,频率概率故矩形的高⨯组距即为频率.从图中可知长 度小于20 mm 的频率为(0.01+0.01+0.04)50⨯=.3,又总体为100根,故纤维长度小于20 mm 的根 数为1000⨯.3=30根. 惠生活 观影指南 爱尚 嘟嘟园 迅播影院 请支持我们,有更多资源和动力 课后作业夯基基础巩固2.从2 008名学生中选取50名学生参加全国数学联赛,若采用下面的方法选取:先用简单随机抽 样从2 008人中剔除8人,剩下的2 000人再按系统抽样的方法抽取,则这2 008名学生中每人入选的概率( )A.不全相等B.均不相等C.都相等,且为502008D.都相等,且为140【答案】 C 【解析】 随机抽样过程中,保证每个个体被抽取的可能性是相等的,所以每人入选的概率都相等,且为502008. 3.某校选修乒乓球课程的学生中,高一年级有30名,高二年级有40名,现用分层抽样的方法在这70名学生中抽取一个样本,已知在高一年级的学生中抽取了6名,则在高二年 级的学生中应抽取的人数为… ( )A.6B.8C.10D.12【答案】 B【解析】 分层抽样的原理是按照各部分所占的比例抽取样本,设从高二年级抽取的学生数为n ,则30640n=,得n =8. 4.某工厂对一批产品进行了抽样检测.下图是根据抽样检测后的产品净重(单位:克)数据绘制的 频率分布直方图,其中产品净重的范围是[96,106],样本数据分组为[96,98),[98,100),[100,102),[102,104),[104,106],已知样本中产品净重小于100克的个数是36,则样本中净重大于或等于98克并且小于104克的产品的个数是( )A.90B.75C.60D.45【答案】A【解析】样本中产品净重小于100克的频率为(0.050+0.100)⨯2=0.3,频数为36.样本总数为36120 03= ..∵样本中净重大于或等于98克并且小于104克的产品的频率为(0.100+0.150+0.125)20⨯=.75, ∴样本中净重大于或等于98克并且小于104克的产品的个数为1200⨯.75=90.5.若某校高一年级8个班参加合唱比赛的得分如茎叶图所示,则这组数据的中位数和平均数分别是( )A.91.5和91.5B.91.5和92C.91和91.5D.92和92【答案】A【解析】按照从小到大的顺序排列为87,89,90,91,92,93,94,96.∵有8个数据,∴中位数是中间两个数的平均数:91922+=91.5,平均数为8789909192939496918+++++++=.5,故选A.6.一组数据的平均数是4.8,方差是3.6,若将这组数据中的每一个数据都加上60,得到一组新数据,则所得新数据的平均数和方差分别是( )A.55.2,3.6B.55.2,56.4C.64.8,63.6D.64.8,3.6【答案】D【解析】每一个数据都加上60时,平均数也应加上60,而方差不变.7.为了解1 200名学生对学校某项教改实验的意见,打算从中抽取一个容量为30的样本,考虑采取系统抽样,则分段的间隔k为.【答案】40【解析】在系统抽样中,确定分段间隔k,对编号进行分段,(N k N n=为总体的容量,n 为样本的容量), ∴12004030N k n ===. 8.高三(1)班共有56人,学号依次为1,2,3,…,56,现用系统抽样的办法抽取一个容量为4的样本,已知 学号为6,34,48的同学在样本中,那么还有一个同学的学号应为 .【答案】 20【解析】 根据题意,56人应分为4组,每组14人,第一组为6号,第二组为6+14=20号,第三组为20+14=34号,第四组为34+14=48号,故还有一个同学的学号为20.9.为了调查某厂工人生产某种产品的能力,随机抽查了20位工人某天生产该产品的数量,产品数量的分组区间为[45,55),[55,65),[65,75),[75,85),[85,95],由此得到频率分布直方图如图,则由此估计该厂工人一天生产该产品数量在[55,70)的人数约占该厂工人总数的百分率是 .【答案】 52.5%【解析】 结合频率分布直方图可以看出:生产数量在[55,65)的人数频率为0.04100⨯=.4,生产数量在[65,75)的人数频率为0.025⨯10=0.25,而生产数量在[65,70)的人数频率约为0.25⨯102=.125,那么生产数量在[55,70)的人数频率约为0.4+0.125=0.525,即52.5%. 10.(2011江苏高考,6)某老师从星期一到星期五收到的信件数分别为10,6,8,5,6,则该组数据的方差2s = .【答案】 165【解析】 ∵10685675x ++++==, ∴2s = 22222(107)(67)(87)(57)(67)1655-+-+-+-+-=. 11.为了分析某篮球运动员在比赛中发挥的稳定程度,统计了该运动员在6场比赛中的得分,用茎叶图表示如图,则该组数据的方差为.【答案】 5 【解析】 该运动员6场的总得分为14+17+18+18+20+21=108,平均得分为10818(6=分),方差为 2222221[(1418)(1718)(1818)(1818)(2018)(2118)]56-+-+-+-+-+-=,故填5. 12.对甲、乙两名自行车赛手在相同条件下进行了6次测试,测得他们的最大速度(m/s)的数据如 下表:惠生活 观影指南 爱尚 嘟嘟园 迅播影院 请支持我们,有更多资源和动力(1)画出茎叶图,由茎叶图你能获得哪些信息?(2)分别求出甲、乙两名自行车赛手最大速度(m/s)数据的平均数、中位数、标准差,并判断选谁参加比赛更合适【解】 (1)画茎叶图,如图所示,中间数为数据的十位数.从这个茎叶图上可以看出,甲、乙的得分情况都是分布均匀的,只是乙更好一些;乙的中位数是33.5,甲的中位数是33.因此乙总体得分情况比甲好(2)根据公式得3333x x =,=甲乙;s =甲 3.96s ,=乙 3.35;甲的中位数是33,乙的中位数是综合比较选乙参加比赛较为合适.。
《抽样技术》第四版习题答案

第2章2.1解:()1这种抽样方法是等概率的。
在每次抽取样本单元时,尚未被抽中的编号为1~64的这些单元中每一个单元被抽到的概率都是1 100。
()2这种抽样方法不是等概率的。
利用这种方法,在每次抽取样本单元时,尚未被抽中的编号为1~35以及编号为64的这36个单元中每个单元的入样概率都是2100,而尚未被抽中的编号为36~63的每个单元的入样概率都是1 100。
()3这种抽样方法是等概率的。
在每次抽取样本单元时,尚未被抽中的编号为20 000~21 000中的每个单元的入样概率都是11000,所以这种抽样是等概率的。
2.2解:2.3 解:首先估计该市居民日用电量的95%的置信区间。
根据中心极限定理可知,在大样本的条件下_y E yy -=近似服从标准正态分布, _Y 的195%α-=的置信区间为2y z y z y y αα⎡⎡-+=-+⎣⎣。
而()21f V y S n-=中总体的方差2S 是未知的,用样本方差2s 来代替,置信区间为,y y ⎡⎤-+⎢⎥⎣⎦。
由题意知道,_29.5,206y s ==,而且样本量为300,50000n N ==,代入可以求得 _21130050000()2060.6825300f v y s n --==⨯=。
将它们代入上面的式子可得该市居民日用电量的95%置信区间为7.8808,11.1192⎡⎤⎣⎦。
下一步计算样本量。
绝对误差限d 和相对误差限r的关系为_d rY =。
根据置信区间的求解方法可知____11P y Y r Y P αα⎫⎪⎧⎫-≤≥-⇒≤≥-⎨⎬⎩⎭根据正态分布的分位数可以知道1P Z αα⎫⎪⎪≤≥-⎬⎪⎪⎭,所以()2_r Y V y z α⎛⎫⎪= ⎪⎝⎭。
也就是2_2_222/21111r Y r Y S n N z S n N z αα⎡⎤⎛⎫⎢⎥⎛⎫ ⎪⎛⎫⎝⎭ ⎪⎢⎥-=⇒=+ ⎪ ⎪⎢⎥⎝⎭⎝⎭⎢⎥⎣⎦。
把_29.5,206,10%,50000y s r N ====代入上式可得,861.75862n =≈。
- 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
- 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
- 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。
简单随机抽样习题及解答
一、名词解释
简单随机抽样 抽样比 设计效应
二、单选题
1、假设根据抽样方差公式确定的初始样本量为400,有效回答率为0.8,那么实际样本量应
为:( )
A 320 B 800 C 400 D 480
答案:B
2、已知某方案的设计效应为0.8,若计算得简单随机抽样的必要样本量为300, 则该方案
所需样本量为( )
A 375 B 540 C 240 D 360
答案:C
3、假设根据抽样方差公式确定的初始样本量为400,如现在要将抽样相对误差降低20%,
则样本量应为:( )
A 256 B 320 C 500 D 625
答案:D
三、多选题
1、简单随机抽样的抽样原则有( )
A 随机抽样原则
B 抽样单元入样概率已知
C 抽样单元入样概率相等
D 随意抽取原则
答案:ABC
2、影响样本容量的因素有:
A 总体大小
B 抽样误差
C 总体方差
D 置信水平
答案:ABCD
3、简单随机抽样的实施方法有( )
A 随机数法
B 抽签法
C 计算机抽取
D 判断抽取
答案:ABC
四、简答题
1、简述样本容量的确定步骤
2、简述预估计总体方差的方法
五、计算
1、某工厂欲制定工作定额,估计所需平均操作时间,从全厂98名从事该项作业的工人中随
机抽选8人,其操作时间分别为4.2,5.1,7.9,3.8,5.3,4.6,5.1,4.1(单位:分),试以
95%的置信度估计该项作业平均所需时间的置信区间(有限总体修正系数可忽略)。
2、某居民区共有10000户,现用抽样调查的方法估计该区居民的用水量。采用简单随机抽
样抽选了100户,得ý=12.5,s2=12.52。估计该居民区的总用水量95%的置信区间。若要求
估计的相对误差不超过20%,试问应抽多少户做样本?
(1)该区居民的平均用水量的置信区间:
该区居民的用水总量的95%置信区间:(1181,1319)
(2)
35.96)5.122.052.1296.1()(220YrSun
9643.95100Nnnn
3. 某县采用简单随机抽样估计粮食、棉花、大豆的播种面积,抽样单元为农户。根据以往
资料其变量的变异系数为
名称 粮食 棉花 大豆
变异系数 0.38 0.39 0.44
若要求以上各个项目的置信度为95%,相对误差不超过4%,需要抽取多少户?若用这一样
本估计粮食的播种面积,其精度是多少?
(1)
)04.6,98.3(
4356.036.20125.54356.0)(1897.0)9881(86527.1)1()(0125.51ˆ21
ys
fnsyv
ynyY
n
i
i
)19.13,81.11(
35.096.15.1235.0)(1239.0)01.01(10052.12)1()(5.12ˆ2
ys
fnsyv
yY
2
22
r
ct
n
名称 粮食 棉花 大豆
样本量 347 366 465
需要抽取465户
(2)
4. 从一叠单据中用简单随机抽样方法抽取了250张,发现其中有50张单据出现错误,试
以95%的置信度估计这批单据中有错误的比例。若已知这批单据共1000张,你的结论有何
变化?若要求估计的绝对误差不超过1%,则至少抽取多少张单据作样本?
2.025050nap
05.0025.096.1025.0)(000643.01)(d
ps
n
pq
pv
这批单据中有错误的比例95%的置信区间:(0.15,0.25)
已知这批单据共1000张,有错误的比例95%的置信区间:(0.16,0.24)
6147220dPQun
98.046538.0111ncr