卫生统计学知识点总结
卫生统计学知识点整理

卫生统计学知识点整理1.数据类型:卫生统计学包括两种主要类型的数据,即定量数据和定性数据。
定量数据是数值型数据,如身高、体重等,可以使用各种统计方法进行分析。
定性数据是非数值型数据,如性别、职业等,可以使用描述性统计方法进行分析。
2.数据收集方法:卫生统计学使用多种方法收集数据,其中包括调查、观察、实验和文献研究等。
调查是最常用的数据收集方法,通过设计问卷或面对面访谈等手段收集信息。
观察是观察和记录事件或行为,以获取相关数据。
实验是通过对照组和干预组进行比较来确定原因和效果的方法。
文献研究是通过分析已有的文献、报告和统计数据来获取相关信息。
3.数据描述和总结:在数据收集完成后,卫生统计学需要对数据进行描述和总结。
这包括计算各种统计指标,如平均数、中位数、众数和标准差等,以了解数据的分布和变异程度。
4.假设检验:卫生统计学中常用的方法之一是假设检验,用于判断一些变量是否与其他变量有显著关联或差异。
假设检验基于统计学原理,通过计算样本数据与预期数据之间的差异,评估是否拒绝或接受一些假设。
5.相关分析:相关分析是研究两个或多个变量之间关系的统计方法。
它可以确定变量之间的相关性大小和方向,并计算相关系数来度量相关性的强弱。
6.回归分析:回归分析是用来预测和解释一个或多个因变量与一个或多个自变量之间关系的方法。
它可以估计自变量对因变量的影响程度,并评估其统计显著性。
7.生存分析:生存分析是研究个体在一定时间内生存或发生一些事件的概率的统计方法。
它通常用于研究疾病的生存率和治疗效果。
8.抽样方法:抽样方法是在卫生调查中常用的一种方法,它可以通过选择一部分样本来代表整体群体。
常见的抽样方法包括随机抽样、系统抽样、分层抽样和整群抽样等。
9.统计软件:卫生统计学使用各种统计软件来进行数据分析和统计计算。
常用的统计软件包括SPSS、SAS、R和STATA等,它们提供了丰富的统计功能和图形展示方式。
10.数据伦理:卫生统计学中数据伦理是一个重要的问题,主要涉及数据的保密性、隐私保护和知情同意等方面。
(完整word版)卫生统计学知识点总结

卫生统计学统计工作基本步骤:统计设计(调查设计和实验设计)、资料分析{收集资料、整理资料、分析资料【统计描述和统计推断(参数估计和假设检验)】。
★统计推断:是利用样本所提供的信息来推断总体特征,包括:参数估计和假设检验。
a参数估计是指利用样本信息来估计总体参数,主要有点估计(把样本统计量直接作为总体参数估计值)和区间估计【按预先设定的可信度(1-α),来确定总体均数的所在范围】。
b假设检验:是以小概率反证法的逻辑推理来判断总体参数间是否有质的区别。
变量资料可分为定性变量、定量变量。
不同类型的变量可以进行转化,通常是由高级向低级转化。
资料按性质可分为计量资料、计数资料和等级资料。
定量资料的统计描述1频率分布表和频率分布图是描述计量资料分布类型及分布特征的方法。
离散型定量变量的频率分布图可用直条图表达。
2频率分布表(图)的用途:①描述资料的分布类型;②描述分布的集中趋势和离散趋势;③便于发现一些特大和特小的可疑值;④便于进一步的统计分析和处理;⑤当样本含量足够大时,以频率作为概率的估计值。
★3集中趋势和离散趋势是定量资料中总体分布的两个重要指标。
(1)描述集中趋势的统计指标:平均数(算术均数、几何均数和中位数)、百分位数(是一种位置参数,用于确定医学参考值范围,P50就是中位数)、众数。
算术均数:适用于对称分布资料,特别是正态分布资料或近似正态分布资料;几何均数:对数正态分布资料(频率图一般呈正偏峰分布)、等比数列;中位数:适用于各种分布的资料,特别是偏峰分布资料,也可用于分布末端无确定值得资料。
(2)描述离散趋势的指标:极差、四分位数间距、方差、标准差和变异系数。
四分位数间距:适用于各种分布的资料,特别是偏峰分布资料,常把中位数和四分位数间距结合起来描述资料的集中趋势和离散趋势。
方差和标准差:都适用于对称分布资料,特别对正态分布资料或近似正态分布资料,常把均数和标准差结合起来描述资料的集中趋势和离散趋势;变异系数:主要用于量纲不同时,或均数相差较大时变量间变异程度的比较。
卫生统计学知识点汇总

卫生统计学知识点汇总卫生统计学知识点汇总卫生统计学是一门研究如何收集、整理、分析和解释与人类健康相关的统计数据的学科。
以下是一些卫生统计学的知识点汇总:1. 健康指标和健康统计数据卫生统计学研究的核心是健康指标和健康统计数据。
健康指标是用来衡量人类健康状况的指标,如死亡率、发病率、存活率等。
健康统计数据是指收集和整理的与人类健康相关的数据信息。
2. 健康调查和流行病学研究卫生统计学包括健康调查和流行病学研究。
健康调查是通过问卷调查、面访和体检等方式,对人群的健康状况进行评估和监测。
流行病学研究是研究疾病在人群中分布、发生和传播规律的学科。
3. 死因统计学死因统计学是研究人口死亡原因及其统计方法的学科。
通过对死亡证明和其他相关资料的分析,可以得到不同死因的死亡率和死因结构,为公共卫生和医疗健康政策制定提供依据。
4. 卫生服务利用统计卫生服务利用统计研究人群对卫生服务的需求,以及卫生服务的提供情况。
包括统计各类卫生机构的数量、位置和服务范围,以及人群对卫生服务的需求和利用情况。
5. 卫生经济学指标卫生经济学指标是研究卫生经济学相关问题的统计指标。
包括卫生资源投入和产出指标,如医疗卫生总费用、卫生人力资源和医疗服务产出等。
6. 因素分析和回归分析因素分析是研究多个相关变量之间关系的统计方法,可以用于探索影响健康的各种因素。
回归分析是通过建立数学模型,研究一个或多个自变量对因变量的影响程度和方向。
7. 卫生统计学软件与工具卫生统计学的研究除了基本的统计学知识外,还需要掌握一些卫生统计学软件和工具的使用。
如SPSS、R、EpiInfo等数据处理和分析软件。
以上是一些卫生统计学的知识点汇总,这门学科涵盖了众多的知识领域,为研究人类健康提供了重要的数据支持和决策依据。
卫生统计学重点总结

第一章绪论1.卫生统计学的概念P1卫生统计学是应用概率论和数理统计学的基本原理和方法,研究居民卫生情况以及卫生服务领域中数据的收集、整理和分析的一门科学。
2.卫生(医学)统计学的主要步骤P3设计;收集资料;整理资料;分析资料3.(选择、判断)卫生统计学的基本概念P4同质(homogeneity):统计学中,若某些观察对象具有相同的特征或属性,称之为同质或具有同质性。
变异(variation):将同质个体的某项特征或属性的观察值或测量值之间的差异称为变异。
总体(population):是根据研究目的确定的的所有观察单位某种特征或属性的观察值或测量值的集合。
样本(sample):是从总体中随机抽取的具有代表性的部分观察单位的集合。
样本中包含的观察单位个数称为样本含量。
参数(parameter):反映总体特征的指标称为参数,一般是未知的,常用希腊字母表示。
统计量(statistic):根据样本观察值计算出来的指标称为统计量,常用拉丁字母表示。
变量(variable):每个观察单位的某项特征或属性称为变量。
抽样研究(sampling research):从总体中随机抽取样本,通过样本信息推断总体特征的研究方法称为抽样研究。
抽样误差(sampling error):由随机抽样造成的样本统计量与总体参数之间、样本统计量之间的差异称为抽样误差。
资料(data):变量值的集合称之为资料。
★4.资料的分类P4(1)定量资料:亦称计量资料,其变量值是定量的,表现为数值大小,一般有度、量、衡单位。
(2)定性资料:亦称分类资料,其观察值是定性的,表现为互不相容的类别或属性,一般无度、量、衡单位。
可进一步细分为两种资料:1)计数资料:指将观察单位按某种类别或属性进行分组,清点各组观察单位数所得的资料。
包括:①二项分类资料;②无序多项分类资料2)等级资料:亦称有序多分类资料,是将观察单位按某特征或属性的程度或等级顺序分组,清点各组观察单位数所得的资料。
《卫生统计学》考试重点复习资料

卫生统计学Statistics第一章绪论统计学:是一门通过收集、分析、解释、表达数据,目的是求得可靠的结果。
总体:根据研究目的确定的同质(大同小异)的观察单位的全体。
分为目标总体和研究总体。
样本:从总体中随机抽取部分观察单位,其测量结果的集合称为样本(sample)。
样本应具有代表性。
所谓有代表性的样本,是指用随机抽样方法获得的样本。
抽样:从研究总体中抽取少量有代表性的个体。
变量:表现出个体变异性的任何特征或属性。
分定型变量和定量变量。
定型变量:1)分类变量或名义变量:最简单的是二分类变量。
0-1变量也常称为假变量或哑变量。
2)有序变量或等级变量。
定量变量:分离散型变量和连续型变量。
变量只能由高级向低级转化:定量→有序→分类→二值。
常见的三种资料类型1)计量或测量或数值资料,如身高、体重等。
2)计数资料或分类资料,如性别、血型等。
3)等级资料,如尿蛋白含量-、+、++、+++、…第一章定量变量的统计描述此章节x即为样本均数(X拔)1.离散型定量变量的取值是不连续的。
累计频数为该组及前面各组的频数之和。
累计频率表示各组累计频数在总例数中所占的比例。
可用直条图表达。
2.编制频数表的步骤与要点步骤:1确定极差2确定组数3确定各组段的上下限4列表要点(注意事项)1)制表是为了揭示数据的分布特征,故分组不宜过粗或过细。
2)为计算方便,组段下限一般取较整齐的数值3)第一组段应包含最小值,最后一个组段应包含最大值。
3.频率分布表(图)的用途1)描述变量的分布类型2)揭示变量的分布特征3)便于发现某些离群值或极端值4)便于进一步计算统计指标和统计分析。
4.描述平均水平的统计指标算术均数(mean):描述一组数据在数量上的平均水平。
总体均数用μ表示,样本均数用X表示。
适用于服从对称分布变量的平均水平描述,这时均数位于分布的中心,能反应全部观察值的平均水平。
分:直接法和频率表法。
即所有变量值加和除以总数n或所有频数f k乘以组中值X0k后求和再除以总数n。
卫生统计学的重点归纳

卫生统计学的重点归纳卫生统计学的重点归纳一、卫生统计学的定义卫生统计学是以统计理论和方法为基础,应用数学、物理、化学、计算机等学科技术,研究卫生和医疗问题的数据分析方法。
它以收集,处理,分析和解释卫生和医疗等领域的统计数据为基础,以定量分析和定性分析卫生数据,研究卫生和应用流行病学方法,识别患病危险因素,以及制定卫生与医疗保健的政策与措施,为医学和公共卫生提供科学依据的一门学科。
二、卫生统计学的基本原理(1)基本理论卫生统计学的基本理论包括:(1)数理统计学:数理统计学是以统计学的数据处理方法为工具,探讨多变量间相互关系的学科;(2)社会科学统计学:社会科学统计学是以统计学的方法为工具,研究社会判断和实证研究的学科;(3)中国统计学:中国统计学是以中国传统的统计学理论和方法为基础,研究社会发展进程中社会变迁的学科;(4)应用统计学:应用统计学是以统计学的方法来解决实际问题,如实验设计与分析、生态学分析、经济学分析等。
(2)基本方法卫生统计学的基本方法包括:(1)分类法:分类法是按照实际问题的性质,将被研究对象进行科学的定性分类;(2)测度法:测度法是按照实际问题的性质,将被研究对象进行科学的定量测度;(3)统计方法:统计方法是利用统计技术处理数据,以处理、描述、分析和预测实证问题;(4)流行病学方法:流行病学方法是指在全面调查的基础上,利用统计技术,研究病因、流行病学及其预防控制等方面的方法。
三、卫生统计学的应用1、卫生统计学用于事件分析。
事件分析包括:病原体检测、医疗并发症监测、病因研究、新药研发、疾病控制等研究;2、卫生统计学用于政策分析,为卫生政策、医疗政策、公共卫生政策的制订、实施和评价,提供科学依据;3、卫生统计学用于质量控制。
对质量控制体系中的质量指标进行定量分析、定性分析和评价;4、卫生统计学用于教育考试。
有助于改进教育评价,提高客观能力,开发判断及决策技能;5、卫生统计学用于职业卫生领域,可以指导职业卫生政策的制定和促进各种职业病的预防。
卫生统计学-重点整理资料

卫生统计学第一章绪论1、卫生统计学的概念(P1)卫生统计学是应用概率论和数理统计学的基本原理和方法,研究居民卫生状况以及卫生服务领域中数据的收集、整理和分析的一门科学,是卫生及其相关领域研究中不可缺少的分析问题。
2、卫生统计学的4个基本步骤(P3):设计、收集资料、整理资料、分析资料3、卫生统计学的几个基本概念(P4):⑴同质:在统计学中,若某些观察对象具有相同的特征或属性,我们就称之为同质,或具有同质性。
⑵变异:同质个体的某项特征或属性的观察值或测量值之间的差异。
⑶总体:同质的所有观察单位某种特征或属性的观察值或测量值的集合。
⑷样本:从总体中随机抽取的具有代表性的部分观察单位的集合。
样本中包含的观察单位个数成为样本含量。
⑸参数:反映总体特征的指标,一般是未知的,常用希腊字母表示,如总体均数μ、总体率π等。
⑹统计量:根据样本观察值计算出来的指标,常用拉丁字母表示,如样本均数⎺x 、样本率ρ等。
⑺变量与资料:对每个观察单位进行观察或测量的某项特征或属性称为变量;变量值的集合成为资料。
⑻定量资料:亦称计量资料,其变量值是定量的,表现为数值大小,一般有度、量、衡单位。
⑼定性资料:亦称分类资料,其观察值是定性的,表现为互不相容的类别或属性,一般无度、量、衡单位。
可细分为:①计数资料;②等级资料第二章调查研究设计★1、调查研究的特点(P7):①不能人为施加干预措施;②不能随机分组;③很难控制干扰因素;④一般不能下因果结论2、常用抽样方法(名称、原理):⑴单纯随机抽样:先将调查总体的全部观察单位统一编号,然后采用随机数字表、统计软件或抽签方法之一随机抽取n(样本大小)个编号,由这n 个编号所对应的n个观察单位构成研究样本。
⑵系统抽样:又称机械抽样或等距抽样。
事先将总体内全部观察单位按某一顺序号等距分成n(样本大小)个部分,每一部分内含m个观察单位;然后从第一部分开始,从中随机抽出第i号观察单位,依此用相等间隔m机械地在第2部分、第3部分直至第n部分内各抽出一个观察单位组成样本。
卫生统计知识点总结

卫生统计知识点总结1. 卫生统计学的基本概念卫生统计学主要包括了一些基本的概念,比如卫生数据的来源、收集、整理和分析方法等。
卫生数据的来源通常包括了临床记录、流行病学调查、专门调查、统计报表等。
在数据收集方面,卫生统计学强调了数据的质量和准确性,以及避免数据偏倚和错误。
数据整理方面,卫生统计学的方法包括了数据清理、归并和分类等,以确保数据的有效性和可分析性。
而在数据分析方面,卫生统计学的方法包括了描述性统计、推断性统计、假设检验、回归分析、生存分析等。
2. 卫生调查和流行病学卫生统计学与卫生调查和流行病学密切相关。
卫生调查是指对于个人和集体的健康状况、卫生问题和医疗服务等进行调查的活动。
流行病学则是研究人群中疾病的发病规律和传播特点的学科。
卫生调查和流行病学的知识点包括了调查设计、样本选择、问卷设计、调查实施、数据分析和结论推断等。
在卫生调查和流行病学中,卫生统计学的方法和技巧是非常重要的。
3. 生物统计学和生物信息学生物统计学是统计学在生物学领域的应用,包括了基因组学、蛋白质组学、代谢组学等领域的统计方法。
在卫生统计学中,生物统计学的知识点包括了遗传分析、基因关联研究、基因组关联分析、蛋白质质谱分析等。
而生物信息学则是应用计算机和统计学方法进行生物学数据的处理和分析,包括了序列比对、基因结构预测、蛋白结构预测、基因表达分析等。
在当今的医学和卫生领域,生物统计学和生物信息学的知识是非常重要的。
4. 健康统计学健康统计学是研究人群健康状况、卫生问题和医疗服务等的统计学方法和理论。
健康统计学的知识包括了健康指标的计算、健康数据的分析、健康状况的评估、卫生问题的研究和医疗服务的评价等。
在健康统计学中,常用的指标包括了死亡率、发病率、患病率、健康质量等。
健康统计学的知识对于评价和改善人群健康状况具有非常重要的意义。
5. 卫生经济学和医疗统计学卫生经济学是研究卫生服务的经济问题的学科,主要包括了卫生支出、卫生保险、医疗机构的效率和成本、医疗资源的配置等。
- 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
- 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
- 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。
卫生统计学统计工作基本步骤:统计设计(调查设计和实验设计)、资料分析{收集资料、整理资料、分析资料【统计描述和统计推断(参数估计和假设检验)】。
★统计推断:是利用样本所提供的信息来推断总体特征,包括:参数估计和假设检验。
a参数估计是指利用样本信息来估计总体参数,主要有点估计(把样本统计量直接作为总体参数估计值)和区间估计【按预先设定的可信度(1-α),来确定总体均数的所在范围】。
b假设检验:是以小概率反证法的逻辑推理来判断总体参数间是否有质的区别。
变量资料可分为定性变量、定量变量。
不同类型的变量可以进行转化,通常是由高级向低级转化。
资料按性质可分为计量资料、计数资料和等级资料。
定量资料的统计描述1频率分布表和频率分布图是描述计量资料分布类型及分布特征的方法。
离散型定量变量的频率分布图可用直条图表达。
2频率分布表(图)的用途:①描述资料的分布类型;②描述分布的集中趋势和离散趋势;③便于发现一些特大和特小的可疑值;④便于进一步的统计分析和处理;⑤当样本含量足够大时,以频率作为概率的估计值。
★3集中趋势和离散趋势是定量资料中总体分布的两个重要指标。
(1)描述集中趋势的统计指标:平均数(算术均数、几何均数和中位数)、百分位数(是一种位置参数,用于确定医学参考值范围,P50就是中位数)、众数。
算术均数:适用于对称分布资料,特别是正态分布资料或近似正态分布资料;几何均数:对数正态分布资料(频率图一般呈正偏峰分布)、等比数列;中位数:适用于各种分布的资料,特别是偏峰分布资料,也可用于分布末端无确定值得资料。
(2)描述离散趋势的指标:极差、四分位数间距、方差、标准差和变异系数。
四分位数间距:适用于各种分布的资料,特别是偏峰分布资料,常把中位数和四分位数间距结合起来描述资料的集中趋势和离散趋势。
方差和标准差:都适用于对称分布资料,特别对正态分布资料或近似正态分布资料,常把均数和标准差结合起来描述资料的集中趋势和离散趋势;变异系数:主要用于量纲不同时,或均数相差较大时变量间变异程度的比较。
标准差的应用:①表示变量分布的离散程度;②结合均数计算变异系数、描述对称分布资料;③结合样本含量计算标准误。
定性资料的统计描述1定性资料的基础数据是绝对数。
描述一组定性资料的数据特征,通常需要计算相对数。
定性变量可以通过频率分布表描述其分布特征。
2常用相对数类型:频率型、强度型和相对比型指标。
相对比:A、B两指标可以是绝对数、相对数或平均数。
最常见的相对比是人口学中的男女性别比,流行病学中的相对危险度10也是相对比指标。
3应用相对数应该注意:①防止概念混淆,避免以比代率的错误现象;②计算相对数时分母应有足够数量,如果例数较少会使相对数波动较大,应该使用绝对数;③正确的计算频率(或强度)指标的合计值。
当分组的资料需要合并起来估计频率(或强度)时,应将各组频率的分子相加作为合并估计的分子,各组的分母相加作为合并估计的分母;④频率型指标的解释要紧扣总体和属性;⑤相对数间比较要具备可比性:要注意观察对象是否同质、研究方法是否相同、观察时间是否一致、观察对象内部结构是否一致、对比不同时期资料应注意客观条件是否相同;⑥正确进行相对数的统计推断:在随机抽样的情况下,从样本估计值推断总体相对数应该考虑抽样误差,因此要进行参数估计和假设检验。
4医学人口统计资料主要来源为日常工作记录(报告单、卡、册)、统计报表、人口调查(普查和抽样调查)。
5描述人口学特征的常用指标一般有人口总数和反映人口学基本特征的某些指标。
人口学的基本特征包括性别、年龄、文化、职业等,最常用来描述人口结构的是性别和年龄。
人口学特征指标:老年人口系数、少儿人口系数、负担系数、老少比、性别比。
6有关生育的常用指标有出生率、生育率和人口再生产指标。
测量生育水平的统计指标:粗出生率、总生育率、年龄别生育率、总和生育率。
测量人口再生育的统计指标:自然增长率、粗再生率和净再生率。
7常用的死亡统计指标有:粗死亡率、年龄别死亡率、婴儿死亡率、新生儿死亡率、围生儿死亡率、死因别死亡率、某病病死率和死因构成等。
8疾病统计资料主要来源于:疾病报告和报表材料、医疗卫生工作记录、疾病专题调查资料。
9⑴标准化:两个率或多个率之间进行比较时,为消除内部构成不同的影响,采用统一的标准,对两组或多组资料进行校正(调整),计算得到标准化率后再做比较的方法,称为~。
其目的是统一内部构成,消除混杂因素,是资料具有可比性。
⑵应用标准化法的注意事项:①标准化法的应用范围很广。
当某个分类变量在两组中分布不同时,这两个分类变量就成为两组频率比较的混杂因素,标准化的目的是消除混杂因素。
②标准化后的标准化率,已经不再反映当时当地的实际水平,只表示相互比较的资料间的相对水平。
③标准化法实质是找一个标准,使两组得意在一个共同的平台上进行比较。
选择不同的标准,算出的标准化率也会不同,比较的结果也未必相同,因此报告比较结果时必须说明所选用的标准和理由④两样本标准化率是样本值,存在抽样误差。
比较两样本标准化率,当样本含量较小时,还应作假设检验。
10常用的动态数列分析指标有:绝对增长量、发展速度与增长速度、平均发展速度与平均增长速度。
(1)绝对增长量:是说明事物在一定时期增长的绝对值,可分为:累计增长量(报告期指标与基线期指标之差)和逐年增长量(报告期指标与前一期指标之差)。
(2)发展速度与增长速度:均为相对比,说明事物在一定时期的变化,可计算定基比(即报告期指标与基线期指标的比:0)和环比(报告期指标与其前一期指标之比:1)。
增长速度表示的是净增长速度,增长速度=发展速度-100%。
(3)平均发展速度与平均增长速度:用于概括某现象在一段时期中的平均变化。
平均发展速度是发展速度的几何平均数,平均发展速度=,平均增长速度=平均发展速度-100%。
11统计表和统计图是描述资料特征、呈现统计分析结果的重要工具。
统计表结构标题、标目、线条、数字和备注。
12常用统计图用途:①条图:适用于相互独立的资料(资料有明确分组、不连续);②百分条图、圆图适用于构成比资料;③线图适用于连续性资料,表达事物的动态变化(绝对差值);半对数线图适用于连续性资料,表达事物的发展速度(相对比);④直方图用于描述连续变量的频数分布;⑤散点图适用于双变量资料,用点的排列趋势和密集度表示两变量的相关关系。
常用概率分布1正态分布(连续型随机变量的概率分布)(1)正态概率密度曲线特点:①关于μ对称;②在μ处取得该概率密度函数的最大值,在μ±σ处有拐点;③曲线下面积为1;④正态分布有两个参数:位置参数μ(决定曲线在横轴上的位置)和变异参数σ(决定曲线的形状);⑤μ±1.64σ面积为90%,μ±1.96σ面积为95%,μ±2.58σ面积为99%。
(2)Z变换与标准正态分布:对于任意一个服从正态分布N(μ,σ2)的随机变量,可作Z变:,变换后的z值仍然服从正态分布,且其总体均数为0、总体标准差为1,称此为标准正态分布,用N(0,1)表示。
Φ(z)为标准正态分布Z变量的累积面积,-∞→Z的面积,即下侧累计面积。
★(3)正态分布的应用:①确定医学参考值范围:是指特定的“正常”人群(排除了对所研究的指标有影响的的疾病和有关因素的特定人群)的解剖、生理、生化指标及组织代谢产物含量等数据中大多数个体的取值所在范围,习惯用该人群的95%的个体某项医学指标的取值范围作为该指标的医学参考值范围。
方法:a百分位数法:适用于任何分布类型的资料;b正态分布法。
②质量控制图:如果某一波动仅仅由个体差异或随机测量误差所致,那么观察结果服从正态分布。
控制图共有7条水平线,中心线位于总体均数μ处,警戒限位于μ±2σ处,控制限位于μ±3σ处,此外还有两条位于μ±σ处。
★(4)确定医学参考值的步骤:①从“正常人”总体中抽样,明确研究总体;②用统一和准确的方法测定相应的指标;③根据不同的用途选定适当的百分界限,常用95%;④根据此指标的实际意义,决定单侧范围还是双侧范围;⑤根据此指标的分布决定计算方法,常用的计算方法:正态分布法、百分位数法。
2二项分布:(1)是一种离散型随机变量的分布类型。
如果每个观察对象阳性结果的发生概率为π,阴性结果的发生概率为(1-π);而且每个观察对象的结果是相互对立的,那么,重复观察n个人,发生阳性结果的人数X的概率分布为而二项分布,记作B(n,π)。
二项分布的概率函数P(X)=π(1-π), =⑵适用条件:①每次实验只有两种互斥的结果;②各次实验互相独立;③发生成功事件的概率恒定。
⑶分布特征:二项分布的特征由二项分布的参数π以及观察的次数n决定。
①图形分布特征:二项分布图的高峰在μπ处或附近;π=0.5时,图形对称;π≠0.5时,分布不对称,且对同一n,π离0.5愈远,对称性愈差。
对于同一π,随着n的增大,分布趋于对称。
当n→∞时,只要π不太靠近0或1(特别是当nπ和n(1-π)均大于5时),二项分布趋于对称。
②二项分布的均数和标准差:若X服从二项分布B(n,π),则X的总体均数为μπ,总体方差为σ2π(1-π),总体标准差为σ=;若将出现阳性结果的频率记为:,则样本率P的总体均数为μπ,总体方差为σ =,总体标准差为σ,σp是频率P的标准差,又称频率的标准误,反映阳性频率的抽样误差大小。
⑷累积概率计算:①二项分布出现阳性的次数至多为k次的概率为:P(X≤k)=②出现阳性的次数至少为k次的概率为:P(X≥k)=。
3 分布:⑴是一种离散型随机变量的分布类型,是二项分布的特例,用以描述单位时间、空间、面积等的罕见事件发生次数的概率分布。
一般记作P(λ),λ是分布的唯一参数。
总体均数为λπ。
前提条件:互斥、独立、恒定。
⑵概率函数为:P(X)λ,X为观察单位内稀有事件的发生次数,2.71828。
⑶分布特性:分布是非对称的,总体参数λ值越小,分布越偏;随着λ→∞,分布趋于对称,当λ≥20时,分布资料可按正态分布处理。
①分布总体均数与总体方差相等,均为λ;②分布的观察结果可加性,即对于服从分布的m歌互相独立的随机变量X1、X2…,它们的和也服从分布,其均数为这个m随机变量的均数之和。
⑷概率计算:如果稀有事件发生次数的总体均数为λ,有事件发生次数至多为k次的概率为:P(X≤k)= ;生次数至少为k次的概率:P(X ≥k)=1(X≤1)★4三种常用分布之间的关系:①二项分布与分布的关系:当n很大,发生概率π(或1-π)很小,二项分布B(n,π)近似于分布P(nπ);②二项分布与正态分布的关系:当n较大,π不接近0或1(特别是当nπ和n(1-π)均大于5时),二项分布B(n,π)近似于正态分布N(nπ,nπ(1-π));④分布与正态分布的关系:当λ≥20时,分布渐进正态分布N(λ,λ)。