统计学教案第6章抽样推断

合集下载

统计学课件-6 抽样推断

统计学课件-6 抽样推断
• 抽样推断可以用于工业生产过程的质量控制。 • 利用抽样推断法还可以对于某种总体的假设进行检验,
判断其真伪,以作出正确的决策。
5
6.1.2 抽样推断的基本概念
全及总体和样本总体
全及总体也称母体,简称总体(Population), 是指所要研究对象的全体。
样本总体又称子样,简称样本(Sample)。它 是从全及总体中随机抽取出来的,用以代表全及 总体的部分单位的集合。
抽样误差有实际抽样误差、抽样平均误差和抽样 极限误差三个密切联系而又相互区别的概念
18
6.2 抽样误差总体总体参数样本样本统计量
4
抽样推断的特点
• 建立在随机取样的基础上 • 运用概率估计法 • 存在着可控性误差
统计推断的作用
• 对有些不可能或不必要进行全面调查, 但又需要了解 其全面数量情况的社会经济现象,可以运用抽样推断, 实现调查的目的。
• 抽样调查与全面调查同时进行,可以发挥互相补充和 检查调查质量的作用。
非概率抽样又称非随机抽样,是对总体中每一个 体都给予平等的抽取机会,即每一个体抽中或不 抽取完全由机遇规律来决定,排除人的主观因素 的选择。
10
抽样框与抽样单元
抽样框又称抽样结构,是指包括全部抽样单位的 名单框架 。
• 抽样框的主要形式
✓ 名单抽样框,即列出全部总体单位的名录一览表。 ✓ 区域抽样框,即按地理位置将总体范围划分为若干小区域,
《淮南子·说山训》 偶然的东西是没有根据的,因为它是偶然的; 但同样因为它是偶然的,它又是有根据的。
黑格尔
3
6.1 抽样推断概述
6.1.1 抽样推断的意义及特点
抽样推断的意义
抽样推断是在随机抽样基础上推论有关总体的情 况,即用样本对从中抽取样本的那个总体的数量 特征作出具有一定可靠程度的估计和判断。

统计学基础课件(第六章抽样推断)

统计学基础课件(第六章抽样推断)

统计学基础
第六章 抽样推断
其中一类是登记性误差,即在调查过程中由于观察、 测量、登记、计算上的差错所引起的误差,这类误差 是所有统计调查都可能发生的。
另一类是代表性误差,即样本各单位的结构不足以 代表总体而引起的误差。
Fundamentals of Statistics
统计学基础
第六章 抽样推断
第六章 抽样推断
第六章 抽样推断
Fundamentals of Statistics
统计学基础
第六章 抽样推断
教学目的与要求:
抽样估计是抽样调查的继续, 它提供了一套利用抽样资料来 估计总体数量特征的方法。通 过本章的学习,要理解和掌握 抽样估计的概念、特点,抽样 误差的含义、计算方法,抽样 估计的置信度,推断总体参数 的方法,能结合实际资料进行 抽样估计。
(只有两种表现)
Fundamentals of Statistics
总体成数
P=
N1 N
成数标准差 p
P 1 P 统计学基础
第六章 抽样推断
样本指标是根据样本各单位标志值或标志属性
计算的综合指标。
x
=
∑x n
研究数 样本平均数
x
=
∑xf ∑f
量标志
样本标准差
x
2
x
n
x
x
2
x
f
f
研究品 质标志
含义: 抽样极限误差是指样本指标和总体指标之间抽
样误差的可能范围。由于总体指标是一个确定的 数,而样本指标则是围绕着总体指标左右变动的 量,它与总体指标可能产生正离差,也可能产生 负离差,样本指标变动的上限或下限与总体指标 之差的绝对值就可以表示抽样误差的可能范围, 我们将这种以绝对值形式表示的抽样误差可能范 围称为抽样极限误差。

统计学第六章抽样推断

统计学第六章抽样推断

尖山一委…
尖山二委
居民一组
居民二


第六章 抽样推断
某外国公司在##进行 微波炉市场调查:
STAT
在商场的大门口
在微波炉柜台前
在市区街道旁边
在某个住宅小区
时间表抽样框
第六章 抽样推断
连续出产的产品总体 可以编制抽样框:均STAT 匀的出产时间、可以 预见到的产品总量.
连续到加油站加油的 汽车总体无法编制抽 样框:时间不定、总 量也无法确定.
抽样估计的特点
第六章 抽样推断
按随机原则抽取样本单位
目的是推断总体的数量特征
抽样推断的结果具有一定的可靠程度, 抽样误差可以事先计算并控制
抽样估计的应用
第六章 抽样推断
不可能进行全面调查时 不必要进行全面调查时 来不及进行全面调查时 对全面调查资料进行补充修正时
抽样调查研究
Sampling Study
P N nN N NN n
共n个
⒉ 不重复抽样的可能样本数目:
C N n N N 1 N n 1
第六章 抽样推断
第六章 抽样推断
STAT
★§1.1 抽样方案的设计 ★§1.2 简单随机抽样的抽样误差的测定
§1.3 简单随机抽样的抽样估计
第六章 抽样推断
§1.2 简单随机抽样的抽样误差的测定 STAT
n1 1{i n1E(xiX)2nn(E xX)2} 由E(于 xX)2D (x)D (i1 nxi)n 1 2i n1D (xi)n2
E(sn21)n11{n2nn2}
2
⒋ 样本成数:
pn1,qn0 1p nn
⒌ 样本单位是非标志的标准差:
第六章 抽样推断

统计学基础课件(第六章抽样推断)

统计学基础课件(第六章抽样推断)

Fundamentals of Statistics
统计是指这种偶然性代表性误差。 即按随机原则抽样时,在没有登记性误差和系统性误 差的条件下单纯由于不同的随机样本得出不同估计量 而产生的误差。抽样误差是抽样调查所固有的,是无 法避免与消除的,但可以运用数学方法计算其数量界 限,并通过抽样设计程序控制其范围,所以这种抽样 误差也称为可控制误差。 需要指出,抽样误差不是 固定不变的数,它的数值是随样本不同而变化的,所 以它也是随机变量。
重复抽样 AA AB AC AD BA BB BC BD CA CB CC CD DA DB DC DD
N n = 42 =16 (个样本)
Fundamentals of Statistics
统计学基础
第六章 抽样推断
不重复抽样
N(N-1)(N-2)……. 4×3 = 12(个样本)
Fundamentals of Statistics
Fundamentals of Statistics
统计学基础
第六章 抽样推断
本章主要内容 •抽样推断概述 •抽样误差 •抽样估计的方法 •样本容量的确定
Fundamentals of Statistics
统计学基础
第第一六章节抽样推抽断样推断概述
一、抽样推断的概念和特点 概念
抽样推断是在抽样调查的基础上,用样 本实际资料计算样本指标,并据以推算总 体相应的数量特征的一种统计分析方法。
代表性误差的发生有以下两种情况:
一种是由于违反抽样调查的随机原则,如有意地多选较好的 单位或较坏的单位进行调查。这样做,所据以计算的抽样指标 必然出现偏高或偏低现象,造成系统性的误差。系统性误差和 登记性误差都是不应当发生的,是可以也应该采取措施避免发 生或将其减小到最小限度。

统计学 第 6 章 抽样与参数估计

统计学  第 6 章   抽样与参数估计

第6章抽样与参数估计第6章抽样与参数估计6.1抽样与抽样分布6.2参数估计的基本方法6.3总体均值的区间估计6.4总体比例的区间估计6.5样本容量的确定学习目标理解抽样方法与抽样分布估计量与估计值的概念点估计与区间估计的区别评价估计量优良性的标准总体均值的区间估计方法总体比例的区间估计方法样本容量的确定方法参数估计在统计方法中的地位统计推断的过程6.1抽样与抽样分布什么是抽样推断概率捕样方法抽样分布抽样方法抽样方法概率抽样(probabilitysampling)也称随机抽样特点按一定的概率以随机原则抽取样本抽取样本时使每个单位都有一定的机会被抽中每个单位被抽中的概率是已知的,或是可以计算出来的当用样本对总体目标量进行估计时,要考虑到每个样本单位被抽中的概率简单随机抽样(simplerandomsampling)从总体N个单位中随机地抽取n个单位作为样本,每个单位入抽样本的概率是相等的最基本的抽样方法,是其它抽样方法的基础特点简单、直观,在抽样框完整时,可直接从中抽取样本用样本统计量对目标量进行估计比较方便局限性当N很大时,不易构造抽样框抽出的单位很分散,给实施调查增加了困难没有利用其它辅助信息以提高估计的效率分层抽样(stratifiedsampling)将抽样单位按某种特征或某种规则划分为不同的层,然后从不同的层中独立、随机地抽取样本优点保证样本的结构与总体的结构比较相近,从而提高估计的精度组织实施调查方便既可以对总体参数进行估计,也可以对各层的目标量进行估计系统抽样(systematicsainplmg)将总体中的所有单位(抽样单位)按一定顺序排列,在规定的范闱内随机地抽取一个单位作为初始单位,然后按爭先规定好的规则确定其它样本单位先从数字1到k之间随机抽取一个数字r作为初始单位,以后依次取r+k,r+2k…等单位优点:操作简便,可提高估计的精度缺点:对估计量方差的估计比较困难整群抽样(clustersampling)将总体中若干个单位合并为组(群),抽样时直接抽取群,然后对中选群中的所有单位全部实施调查特点抽样时只需群的抽样框,可简化工作量调查的地点相对集中,节省调查费用,方便调查的实施缺点是估计的精度较差抽样分布总体中各元素的观察值所形成的分布分布通常是未知的可以假定它服从某种分布总体分布(populationdistribution)一个样本中各观察值的分布也称经验分布当样本容屋n逐渐增大时,样本分布逐渐接近总体的分布样本分布(sampledistribution)抽样分布的概念(samplingdistribution)抽样分布是指样本统计屋的分布,即把某种样本统计量看作一个随机变量,这个随机变屋的全部可能值构成的新的总体所形成的分布即为某种统计量的抽样分布.统计量:样本均值,样本比例,样本方差等样本统计量的概率分布是一种理论概率分布随机变量是样本统计量样本均值,样本比例,样本方差等结果来自容量相同的所有可能样本提供了样本统计量长远稳定的信息,是进行推断的理论基础,也是抽样推断科学性的重要依据对抽样分布的理解抽样分布:即不是总体分布,也不是样本分布,是根据所有可能样本计算的统计量的全部可能取值形成的分布样本均值的抽样分布容量相同的所有町能样本的样本均值的概率分布一种理论概率分布进行推断总体均值的理论基础样本均值的抽样分布样本均值的抽样分布(例题分析)【例】设一个总体,含有4个元素(个体),即总体单位数N=4。

精品课件-统计学原理与应用-第06章 抽样推断

精品课件-统计学原理与应用-第06章 抽样推断


在一定的抽样平均误差条件下,概率度t越大,则极限误差△
越大,区间(

x)或(xp-△x p,x p+△p)范围越宽,
总体指标落在该区间内的概率(可能性)越大,抽样估计的
可靠程度越高。
三、影响抽样误差大小的因素
1、总体各单位标志值的差异程度 2、样本容量即样本单位数 3、抽样调查的组织方式和抽样方法
【例6-4】要估计某乡粮食亩产量和总产量水平,从8000 亩粮食作物中,用不重复抽样方法抽取400亩,求得平均 亩产为450千克。如果确定抽样极限误差为5千克,这就 要求某乡粮食亩产为450±5千克,即在445千克至455千 克之间,而粮食总产量为8000×(450±5)千克,即在3 560吨至3 640吨之间。
x,p
概率保证程度 F t
2、区间估计的模式 (1)在给定误差范围条件下的区间估计模式
1.抽取样本,计算抽样指标。 2.根据给定的极限误差范围,估计算总体指标的上限和下限。 3.计算概率度,查表求出概率F(t),并对总体参数作出区 间估计。
【例6-8】 【例6-9】
2、区间估计的模式
(2)在给定概率保证程度下的区间估计模式
抽样平均误差:
则:样本成数
p
p1 p
n
0.2 0.8 0.02 400
例题4
一批食品罐头共60000桶,随机抽查300桶,发现有6桶不
合格,求合格品率的抽样平
均误差?
已知: N 60000 n 300 n1 6
p n n1 300 6 0.98
n
300
则:样本合格率
p
二、抽样推断的内容 (一)参数估计 (二)假设检验
三、抽样推断的一些基本概念 (一)总体和样本

统计学第六章 抽样法

统计学第六章  抽样法
31
第六章 抽样法
序号
1 2 3 4
5 6 7 8
9 10 11 12
13 14 15 16 合计
样本变量x
40、40 40、50 40、70 40、80
50、40 50、50 50、70 50、80
70、40 70、50 70、70 70、80
80、40 80、50 80、70 80、80

x
x E(x)
总体
研究如何利用 样本数据来 推断总体特 征。
内容包括:参 数估计和假 设检验。
目的:对总体
特征作出推
样 本
断。
这是推断统计学研 究的问题
5
第六章 抽样法
描述统计与推断统计的关系
反映客观 现象的数

概率论
(包括分布理论、大 数定律和中心极限定
理等)
样本数
描述统计
推断统计

总体数 据
(统计数据的搜集 、整理、显示和分
13
第六章 抽样法
第二节 有关抽样的基本概念(2)
(二)抽样总体
也称子样,样本或样本总体,它是从全 及总体中随机抽取出来的,代表全及总体的 那部分单位的集合体。抽样总体的单位数称 为样本容量,用n表示,对于N来说,n是很 小的。
总体
样 本
14
第六章 抽样法
第二节 有关抽样的基本概念(3)
• 二 全及指标和抽样指标p.249 (一) 全及指标
研究总体中 的品质标志
总体成数 P N1
N
总体成数标准差 P
P1 P
17
第六章 抽样法
第二节 有关抽样的基本概念(5)
(二)抽样指标
抽样指标是由样本总体各单位标志值 或标志特征计算的综合指标,也称统计量。 与全及指标相对应有:样本平均数,样本 标准差;样本成数,样本成数的标准差。

胡德华版统计学第六章

胡德华版统计学第六章

6.2.2 机械抽样
机械抽样又称等距抽样或系统抽样, 机械抽样又称等距抽样或系统抽样,就是将总体的各单位按某一标 志的大小进行排队,用总体单位数除以样本单位数求得抽样间隔, 志的大小进行排队,用总体单位数除以样本单位数求得抽样间隔,然后 按照相同的间隔等距抽取样本的一种抽样方式。 按照相同的间隔等距抽取样本的一种抽样方式。 根据总体单位排列方法,等距抽样可分为两类: 根据总体单位排列方法,等距抽样可分为两类:一是按有关标志排 二是按无关标志排队。 队;二是按无关标志排队。 所谓有关标志就是指与调查问题直接相关的标志。 所谓有关标志就是指与调查问题直接相关的标志。 采用等距抽样法,主要应解决以下两个问题: 采用等距抽样法,主要应解决以下两个问题: 一是要计算抽样间隔, 代表抽样间隔, 代表总体单位数 代表总体单位数, 代 一是要计算抽样间隔,若K代表抽样间隔,N代表总体单位数,n代 代表抽样间隔 表抽取的样本单位数, 表抽取的样本单位数,则K=N / n 。 二是要确定起点样本,即第一个样本。 二是要确定起点样本,即第一个样本。通常的方法可采取在第一组 1-K个样本单位中随机抽取的方法,也可以在第一组 个样本单位中随机抽取的方法, 个样本单位中随机抽取的方法 也可以在第一组1-K个样本单位中采 个样本单位中采 用取中间值的方法,然后,每隔K个单位抽取一个样本 个单位抽取一个样本, 用取中间值的方法,然后,每隔 个单位抽取一个样本,直到抽够样本 为止。 为止。 等距随机抽样方法可以使样本单位均匀地分布在总体的各个部分, 等距随机抽样方法可以使样本单位均匀地分布在总体的各个部分, 因而使样本具有更高的代表性,减少了抽样误差; 因而使样本具有更高的代表性,减少了抽样误差;采用机械顺序抽取样 简单易行,便于操作。但是,在应用等距抽样方法时, 本,简单易行,便于操作。但是,在应用等距抽样方法时,要注意抽样 间隔与现象本身所具有的规律不能重叠,否则,会加大抽样误差。 间隔与现象本身所具有的规律不能重叠,否则,会加大抽样误差。 等距随机抽样方法比较适合于同质性较高的总体。 等距随机抽样方法比较适合于同质性较高的总体。
  1. 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
  2. 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
  3. 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。
例如
就是一个统计量,称为样本均值(Sample mean),
也是统计量,称为样本方差(Sample variance),
3.重复抽样与不重复抽样
(1)重复抽样:是指从总体中抽出一个样本单位,记录其标志值后,又将其放回总体中继续参加下一次样本单位的抽取。
(2)不重复抽样:即每次从总体中抽取一个单位,登记后不放回原总体,不参加下一次抽样。
(2)有效性:
设 , 均为未知参数 的无偏估计量,如果对参数 的一切可能取值有 ,则称无偏估计量 比 有效
一个无偏估计量并不意味着他就非常接近被估计的参数,他还必须与总体参数的离散程度比较小。对同一总体参数的两个无偏点估计量,方差小者更有效。
(3)一致性:
指随着样本单位数n的增大,样本估计量将在概率意义下越来越接近于总体真实值
(3)因为未知参数 是非随机变量,所以不能说 落入区间 [ , ]的概率是 ,而应是随机区间 [ , ]包含 的概率是 。
通俗地(二)总体均值的区间估计
1.正态总体且方差已知;或非正态总体、方差未知、大样本情况下
在这种情况下,样本均值的抽样分布呈正态分布,其数学期望为总体均值 ,方差为 。则 称为总体均值在 置信水平下的置信区间。
第二节抽样推断的方法
一、点估计
(一)点估计的概念及特点
参数估计:以样本统计量对总体参数进行估计,有点估计和区间估计两种。
点估计:直接以样本统计量作为相应的总体参数的估计量。
优点:直接给出了总体参数的具体数值
缺点:未能反映误差的大小
参数点估计有:
(1)样本均值估计总体均值
(2)样本成数估计总体成数
(3)样本方差估计总体方差
则称随机区间 [ , ]是参数 的置信水平为 的置信区间, 称为 [ , ]的置信度, , 称为置信限。
这里有几点需要说明:
(1)区间 [ , ]的端点 , 及长度 - 都是样本的函数,从而都是随机变量,因此 [ , ]是一个随机区间。
(2) 是说随机区间 [ , ]以 的概率包含未知参数真值,区间长度 - 描述估计的精度,置信水平 描述了估计的可靠度。
2.根据部分推断总体的数量特征
3.抽样推断的结果具有一定的可靠性和准确性,抽样误差可以事先计算和控制
其他特点有经济性、时效性、准确性、灵活性等
(三)抽样推断的应用
1.不可能进行全面调查时
2.不必要进行全面调查时
3.检查生产过程正常与否
4.对全面调查资料进行补充修正时
二、抽样的几个基本概念
1.样本容量与样本个数
关资料,以推断总体
统计推断:根据抽样调查所获得的信息,对总体的数量特征作出具有一定程度的估
计和推断。
(二)特点
1.按随机原则(等可能性原则)抽取调查单位.随机抽样的目的是为了排除人的主观影响,使每个样本都有系统的可能性被抽中,使样本对总体具有充分的代表性。随机性原则是保证抽样推断正确性的一个重要前提条件。随机抽样不是随便抽样。
区间估计步骤:
1.计算样本统计量
2.计算抽样平均误差
3.计算极限误差
4.确定置信区间
5.估计总量指标
注意抽样方法的不同
[例]保险公司从投保人中随机抽取36人,计算得36人的平均年龄 岁,已知投保人平均年龄近似服从正态分布,标准差为7.2岁,试求全体投保人平均年龄的置信水平为99%的置信区间。
解: 查 表得
(1)样本容量:样本是从总体中抽出的部分单位的集合,这个集合的大小称为样本容量,一般用n表示,它表明一个样本中所包含的单位数。一般地,样本单位数大于30个的样本称为大样本,不超过30个的样本称为小样本。
(2)样本个数:又称样本可能数目,它是指从一个总体中可能抽取多少个样本。样本个数的多少与抽样方法有关。
故全体投保人平均年龄的置信水平为99%的置信区间为[36.41,42.59]
(二)估计的评价标准:
(1)无偏性:
设 是未知参数 的一个点估计量,若 满足 即估计量的数学期望等于被估计参数则称 是 的无偏估计量,否则称为有偏估计量。
需要注意的是,由于估计量 是样本 的函数,样本量是 维随机变量,所以对 求平均是按样本 的概率分布求平均。
无偏性是我们衡量点估计量好坏的一个评价标准,这个评价标准的直观意义如下:由于样本的出现带有随机性,所以基于一次具体抽样所得的参数估计值未必等于参数真值,这是由样本的随机性造成的。我们希望当大量使用这个估计量对参数进行估计时,一系列估计值的平均值应该与待估参数真值相等。这就从平均效果上对估计量的优劣给出一个评价标准。
若对于任意ε>0,有
二、区间估计法
在参数估计中,虽然点估计可以给出未知参数的一个估计,但不能给出估计的精度。为此人们希望利用样本给出一个范围,要求它以足够大的概率包含待估参数真值。这就是导致区间估计问题。
所谓区间估计,就是估计总体参数的区间范围,并要求给出区间估计成立的概率值。
设 是未知参数, 是来自总体的样本,构造两个统计量 , ,对于给定的 (0< <1),若 、 满足
统计学
授课题目
第6章抽样推断
课次
第8-9次
授课方式
讲授
课时安排
第8教学周-第9教学周,共4课时
教学目的:
通过本章的学习,要求掌握利用样本统计资料来推断总体数量特征的原理及方法;深刻理解抽样推断的概念及特点;了解抽样误差产生的原因,并对抽样误差、抽样平均误差、抽样极限误差加以区别,掌握抽样平均误差、抽样极限误差的计算;掌握点估计和区间估计的方法;掌握必要样本单位数的确定方法。
2.总体参数与样本统计量
(1)总体参数:总体分布的数量特征就是总体参数,也是抽样统计推断的对象。常见的总
体参数有:总体的平均数指标,总体成数(比重)指标,总体分布的方差、标准差等等。
(2)样本统计量:与总体参数对应的是样本统计量。
设( )是总体 容量为n的样本,若样本函数
( )
中不含任何未知参数,则称 为一个统计量。
教学重点及难点提示:
重点:区间估计
难点:抽样平均误差的计算
案例导入:大学生消费调查:一个月你花多少?
第一节抽样推断概述
一、抽样推断的概念及特点
(一)概念
按随机原则从总体中抽取部分单位,根据这部分单位的信息对总体的数量特征进行科学估计与推断的方法。
包括抽样调查和统计推断
抽样调查:一种非全面调查,按随机原则从总体中抽取部分单位进行调查以获得相
相关文档
最新文档