医学统计学教学大纲

医学统计学教学大纲
医学统计学教学大纲

《医学统计学》教学大纲(60学时)

课程编码:

课程名称:医学统计学

英文名称:Medical Statistics

开课学期:

学时/学分:60 / 4 (其中实习学时:20 )

课程类型:专业课

开课专业:临床医学七年制学生

选用教材:马斌荣主编:《医学统计学》(第三版)人民卫生出版社2003年6月第三版

主要参考书:

1、方积乾主编:卫生统计学第5版人民卫生出版社2003年

2、倪宗瓒主编:卫生统计学第四版人民卫生出版社2000年

3、余松林主编:医学统计学人民卫生出版社2002年

4、徐勇勇主编:医学统计学高等教育出版社2001年

执笔人:陶育纯

一、课程性质、目的与任务

医学统计学是把概率论和数理统计原理和方法应用于医学研究、公共卫生事业和卫生事业管理的一门科学,是临床医学七年制学生必修的主要课程。医学统计学也是该专业学生将来从事临床医学相关科研工作不可缺少的重要工具,是加强和提高学生统计分析素养的重要课程,对于培养学生科研能力很有益处。

本课程的内容包括医学统计方法必要的基本理论知识和方法、统计表和统计图、医学科研设计方法等。它需要较扎实的语文基本知识及一些必要的数学基础知识。

本课程通过课堂讲授、实习等形式进行,注重基本技能训练、严密统计逻辑思维、严谨的工作态度的培养。采用提问、考试等方式评价教学效果。

二、教学基本要求

1、掌握医学统计方法必要的基本理论知识和方法。

2、掌握常用的和重要的统计分析方法,为将来阅读医学专业书刊和从事临床医学相关科研工作打下必要的统计学基础。

3、熟悉运用统计图表表达统计分析工作中的相关指标。

4、了解医学科研设计常用的基本方法,熟悉医学科研设计的基本原则。

5、熟练掌握科学型计算器统计功能的使用方法,了解统计软件的功能和基本使用方法。

6、注重统计分析基本技能的训练,加强统计逻辑思维和严谨的工作态度的培养。

三、各章节内容及学时分配

第一章医学统计中的基本概念(2学时)

教学目的与要求

通过本章的学习,要求学生掌握和理解同质和变异、总体和样本、参数和统计量的概念,掌握

医学统计资料的分类,了解医学统计工作的内容。

教学内容

第一节绪论

第二节医学统计工作的内容及资料类型

第三节医学统计中的基本概念

外文专业术语

statistics, medical statistics, population, sample, parameter, statistic, probability.

考核要求

了解:医学统计工作的内容。

理解:同质和变异、总体和样本、参数和统计量的概念。

掌握:医学统计资料的分类。

第二章平均水平(集中趋势)的统计描述(2学时)

教学目的与要求

通过本章的学习,熟悉频数分布表的编制方法和用途,掌握均数、几何均数、中位数和百分位数的各自意义、计算方法及应用范围。

教学内容

第一节频数分布

一、频数表

二、直方图

三、频数分布表的用途

第二节平均数

一、算术均数

二、几何均数

三、中位数和百分位数

外文专业术语

frequency distribution table, mean, geometric mean, median, percentile.

考核要求

了解:频数分布表的用途。

理解:频数分布表的编制方法。

掌握:均数、几何均数、中位数和百分位数的各自意义、计算方法及应用范围。

实习课(2学时)

教学目的与要求

通过本节课的学习和实习,借助教师的理论讲解和对具体资料和习题的演练,使学生掌握科学型计算器统计功能的使用方法。

教学内容

一、电子计算器统计功能的使用方法(教师讲授)

二、具体资料和习题(见教材后的练习题和相关的实习材料)的演练(学生实习)

三、教师讲解

第三章离散趋势的统计描述(2学时)

教学目的与要求

通过本章的学习,学生应掌握极差、四分位数间距、方差、标准差和变异系数的各自意义、计算方法及应用范围,熟悉和理解正态分布的概念和特征,掌握医学参考值范围的制定方法。

教学内容

第一节衡量变异程度(或离散程度)的指标

一、极差和四分位数间距

二、离均差平方和、方差、标准差和变异系数

第二节正态分布及应用

一、正态分布

二、标准正态分布

三、正态分布的应用

第三节医学参考值范围

一、医学参考值范围的概念

二、医学参考值范围的制定方法

外文专业术语

range, quartile, variance, standard deviation, coefficient of variation, normal distribution, standard normal distribution, reference value range.

考核要求

了解:医学参考值范围的概念。

理解:正态分布的概念和特征。

掌握:极差、四分位数间距、方差、标准差和变异系数的各自意义、计算方法及应用范围和医学参考值范围的制定方法。

实习课(2学时)

教学目的与要求

通过本节课的实习,借助教师的总结和归纳和学生对具体资料和习题的演练,使学生掌握计量资料的统计描述方法的计算,掌握医学参考值范围的计算方法。

教学内容

一、总结和归纳(教师讲授)

二、具体资料和习题(见教材后的练习题和相关的实习材料)的演练(学生实习)

三、教师讲解

第四章抽样误差与假设检验(2学时)

教学目的与要求

通过本章的学习,学生应理解抽样误差的意义,了解抽样误差的计算原理,掌握均数的标准误的计算方法,掌握总体均数可信区间的计算方法,理解假设检验的意义,掌握假设检验的基本步骤。

教学内容

第一节均数的抽样误差与标准误

第二节总体均数的估计

一、可信区间的概念

二、总体均数可信区间的计算

第三节假设检验的意义和步骤

一、假设检验的基本概念

二、建立检验假设和确定检验水准

三、选择检验方法和统计推断分析

外文专业术语

sampling error, standard error, interval estimation, confidence interval, hypothesis test, size of test, test statistic, statistical significance.

考核要求

了解:抽样误差的计算原理。

理解:抽样误差的意义和假设检验的意义。

掌握:均数的标准误的计算方法,总体均数可信区间的计算方法,假设检验的基本步骤。

第五章t 检验(6学时)

教学目的与要求

通过本章的学习,学生应了解t 分布的概念和特征,了解假设检验中两类错误的概念,掌握单个样本的t 检验、配对样本的t 检验和两独立样本的t 检验。

教学内容

第一节t 分布

第二节单个样本的t 检验

第三节配对样本的t 检验

第四节两独立样本的t 检验

一、总体方差相等时的两独立样本t 检验

二、总体方差不等时的两样本t’检验

三、完全随机设计两样本几何均数比较的t 检验

第五节t 检验中的注意事项

一、要有严密的抽样设计

二、选用的检验方法必须符合其适用条件

三、单侧检验和双侧检验

四、假设检验的结论不能绝对化

五、正确理解P值与差别有无统计意义

六、假设检验和可信区间的关系

第六节假设检验中两类错误

一、I 型错误

二、II 型错误

外文专业术语

t test, paired sample t-test, two independent sample t-test, homogeneity, type I error, type II error.

考核要求

了解:t 分布的概念和特征,假设检验中两类错误的概念。

理解:单侧检验和双侧检验,P值与差别有无统计意义,假设检验和可信区间的关系。

掌握:单个样本的t 检验、配对样本的t 检验和两独立样本的t 检验。

实习课(2学时)

教学目的与要求

通过本节课的实习,借助教师的总结和归纳和学生对具体资料和习题的演练,使学生掌握单个样本的t 检验、配对样本的t 检验和两独立样本的t 检验的计算方法。

教学内容

一、总结和归纳(教师讲授)

二、具体资料和习题(见教材后的练习题和相关的实习材料)的演练(学生实习)

三、教师讲解

第六章方差分析(8学时)

教学目的与要求

通过本章的学习,学生应掌握完全随机设计和随机区组设计的方差分析方法,掌握多个样本均数的两两比较方法,了解析因设计的方差分析方法,了解多个方差齐性检验的方法。

教学内容

第一节完全随机设计的方差分析

第二节随机区组设计的方差分析

第三节多个样本均数的两两(多重)比较

一、q检验法(Newman-Keuls test, NK)

二、新复极差法(Duncan’s new multiple range method, Duncan新法)

第四节析因设计的方差分析

一、随机效应模型的方差分析

二、固定效应模型的方差分析

三、混合模型的方差分析

第五节多个方差齐性检验

外文专业术语

analysis of variance(ANOV A), multiple comparison, Newman-Keuls test, Duncan’s new multiple range method, factorial design.

考核要求

了解:析因设计的方差分析方法,多个方差齐性检验的方法。

理解:方差分析的基本思想和计算原理。

掌握:完全随机设计和随机区组设计的方差分析方法,多个样本均数的两两比较方法。

实习课(4学时)

教学目的与要求

通过本节课的实习,借助教师的总结和归纳和学生对具体资料和习题的演练,使学生掌握完全随机设计和随机区组设计的方差分析的计算方法,掌握多个样本均数的两两比较方法。

教学内容

一、总结和归纳(教师讲授)

二、具体资料和习题(见教材后的练习题和相关的实习材料)的演练(学生实习)

三、教师讲解

第七章相对数及其应用(2学时)

教学目的与要求

通过本章的学习,学生应掌握相对数的概念和率的抽样误差的计算,掌握相对数的计算和总体率的区间估计方法,了解率的标准化。

教学内容

第一节相对数的概念及计算

一、率

二、构成比

三、相对比

第二节相对数使用应注意的问题

第三节率的标准化

一、标准化的意义

二、标准化直接法的计算步骤

第四节医学中常用的相对数指标

一、死亡的统计指标

二、常用疾病统计的指标

第五节率的抽样误差与区间估计

一、率的标准误

二、率的区间估计

外文专业术语

rate, constituent ratio, relative ratio, standardized rate.

考核要求

了解:医学中常用的相对数指标。

理解:率的标准化意义。

掌握:相对数的概念和率的抽样误差的计算,相对数的计算和总体率的区间估计方法。

实习课(2学时)

教学目的与要求

通过本节课的实习,借助教师的总结和归纳和学生对具体资料和习题的演练,使学生掌握相对数的计算和总体率的区间估计方法。

教学内容

一、总结和归纳(教师讲授)

二、具体资料和习题(见教材后的练习题和相关的实习材料)的演练(学生实习)

三、教师讲解

第八章χ2检验(6学时)

教学目的与要求

通过本章的学习,学生应掌握四格表χ2检验、行×列表χ2检验和配对四格表χ2检验,了解四格表的确切概率检验法的原理和作用。

教学内容

第一节2×2表χ2检验

一、四格表χ2检验

二、四格表χ2检验的连续性校正

三、四格表χ2检验的确切概率检验法

第二节行×列表χ2检验

一、行×列表的简化计算公式

二、行×列表的分割

第三节配对资料χ2检验

外文专业术语

chi square test, actual frequency, theoretical(expected) frequency, Fisher’s exact test.

考核要求

了解:四格表的确切概率检验法的原理和作用。

理解:χ2检验的基本思想。

掌握:四格表χ2检验、行×列表χ2检验和配对四格表χ2检验。

实习课(2学时)

教学目的与要求

通过本节课的实习,借助教师的总结和归纳和学生对具体资料和习题的演练,使学生掌握四格表χ2检验、行×列表χ2检验和配对四格表χ2检验的计算方法。

教学内容

一、总结和归纳(教师讲授)

二、具体资料和习题(见教材后的练习题和相关的实习材料)的演练(学生实习)

三、教师讲解

第九章非参数检验方法(2学时)

教学目的与要求

通过本章的学习,学生应掌握配对资料和两样本比较的秩和检验,熟悉多个样本比较的秩和检验。

教学内容

第一节配对资料的符号秩和检验

一、一般步骤和基本思想

二、配对资料的符号秩和检验

第二节两样本比较的秩和检验

一、一般步骤和基本思想

二、两样本比较的秩和检验

第三节多个样本比较的秩和检验

一、一般步骤和基本思想

二、多个样本比较的秩和检验

外文专业术语

nonparametric test, Wilcoxon signed rank test, Wilcoxon(Mann-Whitney) test, Kruskal-Wallis test.

考核要求

了解:参数检验与非参数检验的区别和各自优缺点。

理解:非参数检验的基本思想。

掌握:配对资料和两样本比较的秩和检验,多个样本比较的秩和检验。

实习课(2学时)

教学目的与要求

通过本节课的实习,借助教师的总结和归纳和学生对具体资料和习题的演练,使学生掌握配对资料和两样本比较的秩和检验,熟悉多个样本比较的秩和检验。

教学内容

一、总结和归纳(教师讲授)

二、具体资料和习题(见教材后的练习题和相关的实习材料)的演练(学生实习)

三、教师讲解

第十章线性相关与回归(2学时)

教学目的与要求

通过本章的学习,学生应掌握线性相关与回归分析方法,熟悉线性相关与回归的区别与联系,了解等级相关分析方法。

教学内容

第一节线性相关

一、线性相关的基本概念

二、线性相关系数

三、线性相关系数的假设检验

四、进行线性相关分析时的注意事项

第二节线性回归

一、线性回归的基本概念

二、线性回归方程的计算

三、线性回归方程的假设检验

四、进行线性回归分析时的注意事项

第三节线性相关与回归的区别与联系

一、区别

二、联系

第四节等级相关

一、等级相关系数的计算

二、等级相关系数的假设检验

外文专业术语

correlation, regression, coefficient of correlation, linear regression, linear regression equation, regression coefficient, rank correlation coefficient.

考核要求

了解:等级相关分析方法。

理解:线性相关的基本概念,线性回归的基本概念,线性相关与回归的区别与联系。

掌握:线性相关系数的计算和假设检验,线性回归方程的计算和假设检验。

实习课(2学时)

教学目的与要求

通过本节课的实习,借助教师的总结和归纳和学生对具体资料和习题的演练,使学生掌握线性相关与回归分析方法。

教学内容

一、总结和归纳(教师讲授)

二、具体资料和习题(见教材后的练习题和相关的实习材料)的演练(学生实习)

三、教师讲解

第十一章多元线性回归(2学时)

教学目的与要求

通过本章的学习,学生应掌握多元线性回归的基本思想,了解多元逐步回归的意义。

教学内容

第一节多元线性回归的基本概念

一、多元回归方程的建立

二、多元回归方程的统计学意义的假设检验

三、标准化偏回归系数

四、复相关系数

第二节多元逐步回归

一、多元逐步回归的基本思想

二、偏回归平方和的定义

三、偏回归平方和的检验

四、实例

第三节多元回归分析的注意事项

一、多元回归的基本假设

二、样本含量

三、变量筛选

四、自变量的联合作用分析

五、自变量的共线性

六、结果分析

外文专业术语

multiple linear regression, multiple linear regression equation, partial regression coefficient, multiple correlation coefficient, stepwise regression.

考核要求

了解:多元线性回归的基本概念,多元逐步回归的意义。

理解:多元逐步回归的计算过程。

掌握:多元线性回归的基本思想。

第十二章统计表与统计图(2学时)

教学目的与要求

通过本章的学习,学生应掌握正确使用统计表的方法,掌握常用统计图的绘制方法和用途。

教学内容

第一节统计表

一、统计表的结构

二、统计表的种类

三、编制统计表的基本要求

第二节统计图

一、统计图的构造

二、常用统计图的绘制方法及基本要求

外文专业术语

statistical table, statistical chart, bar chart, pie chart, percentage chart, line chart, semi-logarithmic line chart, histogram, scatter chart.

考核要求

了解:统计表的结构和种类。

理解:正确使用统计表和统计图的方法。

掌握:编制统计表的基本要求,常用统计图的绘制方法和用途。

实习课(2学时)

教学目的与要求

通过本节课的实习,借助教师的总结和归纳和学生对具体资料和习题的演练,使学生掌握正确使用统计表的方法,掌握常用统计图的绘制方法和用途。

教学内容

一、总结和归纳(教师讲授)

二、具体资料和习题(见教材后的练习题和相关的实习材料)的演练(学生实习)

三、教师讲解

医学统计学分析计算题_与解析

第二单元 计量资料的统计推断 分析计算题 2.1 某地随机抽样调查了部分健康成人的红细胞数和血红蛋白量,结果见表4: 表4 某年某地健康成年人的红细胞数和血红蛋白含量 指 标 性 别 例 数 均 数 标准差 标准值* 红细胞数/1012 ·L -1 男 360 4.66 0.58 4.84 女 255 4.18 0.29 4.33 血红蛋白/g ·L -1 男 360 134.5 7.1 140.2 女 255 117.6 10.2 124.7 请就上表资料: (1) 说明女性的红细胞数与血红蛋白的变异程度何者为大? (2) 分别计算男、女两项指标的抽样误差。 (3) 试估计该地健康成年男、女红细胞数的均数。 (4) 该地健康成年男、女血红蛋白含量有无差别? (5) 该地男、女两项血液指标是否均低于上表的标准值(若测定方法相同)? 2.1解: (1) 红细胞数和血红蛋白含量的分布一般为正态分布,但二者的单位不一致,应采用变异系数(CV )比较二者的变异程度。 女性红细胞数的变异系数0.29 100%100% 6.94%4.18 S CV X = ?=?= 女性血红蛋白含量的变异系数10.2 100%100%8.67%117.6 S CV X =?=?= 由此可见,女性血红蛋白含量的变异程度较红细胞数的变异程度大。 (2) 抽样误差的大小用标准误X S 来表示,由表4计算各项指标的标准误。 男性红细胞数的标准误0.031 X S = ==(1210/L ) 男性血红蛋白含量的标准误0.374 X S = ==(g/L )

女性红细胞数的标准误0.018X S = ==(1210/L ) 女性血红蛋白含量的标准误0.639X S = ==(g/L ) (3) 本题采用区间估计法估计男、女红细胞数的均数。样本含量均超过100,可视为大样本。σ未知,但n 足够大 ,故总体均数的区间估计按 (/2/2X X X u S X u S αα-+ , )计算。 该地男性红细胞数总体均数的95%可信区间为: (4.66-1.96×0.031 , 4.66+1.96×0.031),即(4.60 , 4.72)1210/L 。 该地女性红细胞数总体均数的95%可信区间为: (4.18-1.96×0.018 , 4.18+1.96×0.018),即(4.14 , 4.22)1210/L 。 (4) 两成组大样本均数的比较,用u 检验。 1) 建立检验假设,确定检验水准 H 0:12μμ=,即该地健康成年男、女血红蛋白含量均数无差别 H 1:12μμ≠,即该地健康成年男、女血红蛋白含量均数有差别 0.05α= 2) 计算检验统计量 22.829X X u === 3) 确定P 值,作出统计推断 查t 界值表(ν=∞时)得P <0.001,按0.05α=水准,拒绝H 0,接受H 1,差别有统计学意义,可以认为该地健康成年男、女的血红蛋白含量均数不同,男性高于女性。 (5) 样本均数与已知总体均数的比较,因样本含量较大,均作近似u 检验。 1) 男性红细胞数与标准值的比较 ① 建立检验假设,确定检验水准 H 0:0μμ=,即该地男性红细胞数的均数等于标准值

医学统计学考试重点整理

一、基本概念 1.总体与样本 总体:所有同质观察单位某种观察值(即变量值)的全体 样本:是总体中抽取部分观察单位的观察值的集合 2.普查与抽样调查 普查:就是全面调查,即调查目标总体中全部观察对象 抽样调查:是一种非全面调查,即从总体中抽取一定数量的观察单位组成样本,对样本进行调查 3.参数与统计量 参数:总体的某些数值特征 统计量:根据样本算得的某些数值特征 4.Ⅰ型与Ⅱ型错误 假设检验的结论 真实情况拒绝H 不拒绝H

H 正确Ⅰ型错误(ɑ) 0 推断正确(1?ɑ) 不正确推断正确(1?β) H Ⅱ型错误(β) 为真时却被拒绝,弃真错误 Ⅰ型错误(ɑ错误): H 为假时却被接受,取伪错误 Ⅱ型错误(β错误): H 5.随机化原则与安慰剂对照 随机化原则:是将研究对象随机分配到实验组和对照组,使每个研究对象都有同 等机会被分配到各组中去,以平衡两组中已知和未知的混杂因素,从而提高两组的 可比性,避免造成偏倚。(意义: ①是提高组间均衡性的重要设计方法;②避免有意 扩大或缩小组间差别导致的偏倚;③各种统计学方法均建立在随机化基础上)安慰剂对照:是一种常用的对照方法。安慰剂又称伪药物,是一种无药理作用的制剂,不含试验药物的有效成分,但其感观如剂型、大小、颜色、质量、气味及口味等都与试验药物一样,不能被受试对象和研究者所识别。(安慰剂对照主要用于临床试验,其目的在于控制研究者和受试对象的心理因素导致的偏倚,并提高依从性。安慰剂对照还可以控制疾病自然进程的影响,显示试验药物的效应) 6.误差与标准误(区分率与均数)

㈠均数 抽样误差:由个体变异产生的、随机抽样引起的样本统计量与总体参数间的差异。 标准误:是指样本均数的标准差,反映抽样误差大小的定量指标,其公式表示 =S/√n 为S x ㈡样本率 率的抽样误差:样本率p和总体率π的差异 率的标准误:样本率的标准差,公式为σp=√π(1-π)/n 7.方差分析 方差分析:又称F检验,是通过对数据变异按设计类型的不同,分解成两个或多个样本均数所代表总体均数是否有差别的一种统计学方法。 (方差分析的基本思想:把全部观察值间的变异按设计类型的不同,分解成两个或多个组成部分,然后将各部分的变异与随机误差进行比较,以判断各部分的变异是否具有统计学意义) 二、问题 1.集中趋势与离散趋势描述的常用指标、适用范围与优缺点 ㈠描述集中趋势的常用指标:

医学统计学总结

医学统计学总结 一、绪论 1,医学统计学:运用概率论与数理统计学得原理与方法,研究医学领域中随机现象有关数据得搜集、整理、分析与推断,进而阐明其客观规律性得一门应用科学。 2,医学统计学得主要内容: 1) 统计研究设计调查研究设计与实验研究设计 2) 医学统计学得基本原理与方法研究设计与数据处理中得基本统计理论与方法。A:资料得搜集与整 理 B:常用统计描述,集中趋势与离散趋势,相对数,相关系数,回归系数,统计表,统计图 C:统计推断,如参数估计与假设检验。 3)医学多元统计方法多元线性回归与逐步回归分析、判别分析、聚类分析、主成分分析、因子分析、 logistic回归与Cox回归分析。 3,统计工作步骤: 1) 设计明确研究目得与研究假说,确定观察对象与观察单位,样本含量与抽样方法,拟定研究方案,预 期分析指标,误差控制措施,进度与费用。 2) 搜集材料 A, 搜集材料得原则及时、准确、完整 B, 统计资料得来源医学领域得统计资料得来源主要有三个方面。一就是统计报表,二就是经常性工作记录,三就是专题调查或专题实验。 C, 资料贮存 3) 整理资料 a检查核对b设计分组c拟定整理表d归表 4) 分析资料统计分析包括统计描述与统计推断 4,同质(homogeneity):指被研究指标得影响因素相同。 变异(variation):同质基础上得各观察单位间得差异。 变量(variable):收集资料过程中,根据研究目得确定同质观察单位,再对每个观察单位得某项 特征进行测量或观察,这种特征称为变量 变量值:变量得观察结果或测量值。 5,总体(population) 根据研究目得所确定得同质研究对象中所有观察单位某变量值得集合。总体 具有得基本特征就是:同质性 样本(sample) 从总体中随机抽取部分观察单位,其变量值得集合构成样本。样本必须具有代表 性。代表性就是指样本来自同质总体,足够得样本含量与随机抽样得前提。 统计量(statistics)描述样本变量值特征得指标(样本率,样本均数,样本标准差)。 参数(parameter)描述总体变量值特征得指标(总体率,标准差,总体均数)。

医学统计学重点图表总结

描述内容 指 标 意 义 适 用 场 合 平均水平 均 数 个体的平均值 对称分布 几何均数 平均倍数 取对数后对称分布 中 位 数 位次居中的观察值 ①非对称分布;②半定量资料;③末端开口资料;④分布不明 众 数 频数最多的观察值 不拘分布形式,概略分析 调和均数 基于倒数变换的平均值 正偏峰分布资料 变 异 度 全 距 观察值取值范围 不拘分布形式,概略分析 标 准 差 (方 差) 观察值平均离开均数的程度 对称分布,特别是正态分布资料 四分位数间距 居中半数观察值的全距 ①非对称分布;②半定量资料;③末端开口资料;④分布不明 变异系数 标准差与均数的相对比 ①不同量纲的变量间比较;②量纲相同但数量级相差悬殊的变量间比较 4. 常用统计图有哪些?分别适用于什么分析目的? 常用统计图的适用资料及实施方法 图 形 适 用 资 料 实 施 方 法 条 图 组间数量对比 用直条高度表示数量大小 直 方 图 定量资料的分布 用直条的面积表示各组段的频数或频率 百分条图 构成比 用直条分段的长度表示全体中各部分的构成比 饼 图 构成比 用圆饼的扇形面积表示全体中各部分的构成比 线 图 定量资料数值变动 线条位于横、纵坐标均为算术尺度的坐标系 半对数线图 定量资料发展速度 线条位于算术尺度为横坐标和对数尺度为纵坐标的坐标系 散 点 图 双变量间的关联 点的密集程度和形成的趋势,表示两现象间的相关关系 箱 式 图 定量资料取值范围 用箱体、线条标志四分位数间距及中位数、全距的位置 茎 叶 图 定量资料的分布 用茎表示组段的设置情形,叶片为个体值,叶长为频数 定性资料统计描述常用的统计指标及其适用场合 指标 计算公式 适用场合 频率 n/N 估计总体中某一结局发生的概率 频率分布 n 1/N ,n 2/N,…..,n k /N 估计总体中所有可能结局发生的概率 强度 阳性人数/总观察人时数 估计总体中单位时间内某一结局发生的概率 比 A/B 估计两个指标的相对大小 4.常用参考值范围的制定? 参考值范 围(%) 正态分布法 百分位数法 双侧 单侧 双侧 单侧 下限 上限 下限 上限 90 S X 64.1± S X 1.28- S X 1.28+ P 5~P 95 P 10 P 90 95 S X 96.1± S X 64.1- S X 64.1+ P 2.5~P 97.5 P 5 P 95 99 S X 58.2± S X 2.33- S X 2.33+ P 0.5~P 99.5 P 1 P 99

医学统计学重点总结

医学统计学 第一章 医学统计中的基本概念 1 医学统计工作的内容:设计,收集资料,整理资料,分析资料。 2 资料的类型:计量资料(数值变量),计数资料(无序分类),等 变异(variation):在同质的基础上被观察个体的差异。级分组资料(有序分类)。 3 同质(homogeneity):对研究指标有影响的非实验因素相同。 4 总体(population):根据研究目的确定的同质的全部研究对象称总体 。 样本(sample):根据随机化的原则从总体中抽出有代表性的一部分观察单位组成的子集称样本。 5 参数(parameter):总体的设计指标称为参数。 统计量(statistic):样本的统计指标称为统计量。 6 变量(variable):观察对象的特征或指标称为变量,测量的结果即为变量值。 7 概率(probability):描述随机事件发生的可能性的大小的一个量度,其概率介于0与1之间。 第二章 集中趋势的统计描述 一 算术均法(mean)简称为均数,适用于正态或近似正态分布资料 (一)直接法 X n x n X X X n ∑= +?++= 21 (二)加权法(针对频数表)n fx n x f f f X k k ∑= +++= (21) 二 几何均数(geometic mean,G)适用于倍数关系变化,经对数转换后呈正态分布(如:抗体滴度, 血清凝集效价,细菌计数,某些物质浓度等) G= n n X X X ?21 为了计算方便,常改用对数的形式计算,即=G lg 1 -( n X ∑lg ) 对于频数表资料,可用公式 G=lg 1 -( n x f ∑lg ) 三 中位数(M)与百分位数 中位数:适用于偏态分布资料,末端无确切数值的资料及分布情况不确定 公式:M=L+( M L f f n -5.0) M i L,M i ,M f 分别为M 所在组段的下限,组距与频数,L f 为M 所在组段之前各组数的累积频数。 百分位数:用符号X P 表示,x 即百分位 公式:x P =L+( x L f f x n -%·)x i 式中L,x i ,x f 分别为x P 所在组段的下限,组距与频数,L f 为x P 所在组段之前各组段的累积频数

医学统计学分析题

五、分析应用题(4题,共40分) 1、为观察某病西医治疗及中西医结合治疗的疗效, 单纯型用西医治疗, 疑难型用中西医结合治疗, 疗效如下: 某病西医治疗及中西医结合治疗疗效比较 疗法例数治愈数治愈率(%) 西医治疗 70 50 74.29 中西医治疗 60 22 36.67 X2 =5.29 0.05>P>0.01, 西医治疗的疗效较好。你认为如何?请说出理由(6分) 1、答:结论不可信(2分);因为在设计分组上不科学,两组间不具有可比性(4分)。 2、24名志愿者完全随机地分成两组,接受降胆固醇试验。甲组为特殊饮食组,乙组为药物处理组,受试者在试验前后各测量一次血清胆固醇(mmol/L),数据如下表, 甲组乙组 受试者试验前试验后受试者试验前试验后 1 6.11 6.00 1 6.90 6.93 2 6.81 6.8 3 2 6.40 6.35 3 6.48 6.49 3 6.48 6.41 4 7.59 7.28 4 7.00 7.10 5 6.42 6.30 5 6.53 6.41 6 6.94 6.64 6 6.70 6.68 7 9.17 8.42 7 9.10 9.05 8 7.33 7.00 8 7.31 6.83 9 6.94 6.58 9 6.96 6.91 10 7.67 7.22 10 6.81 6.73 11 8.15 6.57 11 8.16 7.65 12 6.60 6.17 12 6.98 6.52 (1)欲分析两种治疗方法是否有效,采用何种统计分析方法?(6分) (2)欲判断两种降血清胆固醇措施效果是否相当,又采用何种统计分析方法?(6分) 2、答:(1)欲分析两种治疗方法是否有效,可用治疗前后比较,属配对设计(2分),应用配对t检验(3分)。(2)如判断两种方法的效果有无差别,则属成组设计(2分),应用两样本均数比较的t检验(3分)。 3、检验血磷含量有甲、乙两种方法,其中,乙法具有快速、简便等优点。现用甲、乙两法检测相同的血液样品,所得结果如下表。 样本号 1 2 3 4 5 6 7 乙法 2.74 0.54 1.20 5.00 3.85 1.82 6.51 甲法 4.49 1.21 2.13 7.52 5.81 3.35 9.61 问:⑴若要判断能否用乙法推算甲法,又用何统计方法?(6分) ⑵欲比较甲乙两法检出血磷是否相同,用何统计方法?(6分) 3、答:(1)根据题意,应用回归分析(6分) (2)这是配对设计计量资料(2分),应用配对t检验(4分) 4、某单位对常住本市5年以上,从未接触过铅作业,也未服过含铅药物或其它重金属,饮用自来水,无肝、肾疾患及贫血,近日未使用利尿剂的健康成年,用乙酸乙酰法测24小时尿δ-ALA的结果如下,欲制定其95%正常值范围。请问:用何种估计方法?说出理由并给出计算公式。(10分) δ-ALA 0.5- 1.0- 1.5- 2.0- 2.5- 3.0- 3.5- 4.0 -4.5- 5.0-5.5 合计

医学统计学重点要点

医学统计学重点 第一章绪论 1.基本概念: 总体:根据研究目的确定的性质相同或相近的研究对象的某个变量值的全体。 样本:从总体中随机抽取部分个体的某个变量值的集合。 总体参数:刻画总体特征的指标,简称参数。是固定不变的常数,一般未知。 统计量:刻画样本特征的指标,由样本观察值计算得到,不包含任何未知参数。 抽样误差:由随机抽样造成的样本统计量与相应的总体参数之间的差异。 频率:若事件A在n次独立重复试验中发生了m次,则称m为频数。称m/n为事件A在n次试验中出现的频率或相对频率。 概率:频率所稳定的常数称为概率。 统计描述:选用合适统计指标(样本统计量)、统计图、统计表对数据的数量特征及其分布规律进行刻画和描述。 统计推断:包括参数估计和假设检验。用样本统计指标(统计量)来推断总体相应指标(参数),称为参数估计。用样本差别或样本与总体差别推断总体之间是否可能存在差别,称为假设检验。 2.样本特点:足够的样本含量、可靠性、代表性。 3.资料类型: (1)定量资料:又称计量资料、数值变量或尺度资料。是对观察对象测量指标的数值大小所得的资料,观察指标是定量的,表现为数值大小。每个个体都能观察到一个观察指标的数值,有度量衡单位。 (2)分类资料:包括无序分类资料(计数资料)和有序分类资料(等级资料) ①计数资料:是将观察单位按某种属性或类别分组,清点各组观察单位的个数(频数),由 各分组标志及其频数构成。包括二分类资料和多分类资料。 二分类:将观察对象按两种对立的属性分类,两类间相互对立,互不相容。 多分类:将观察对象按多种互斥的属性分类 ②等级资料:将观察单位按某种属性的不同程度、档次或等级顺序分组,清点各组观察单 位的个数所得的资料。 4.统计工作基本步骤:统计设计、资料收集、资料整理、统计分析。

预防医学与医学统计学总结

绪论 进和维护健康,预防疾病、失能和早逝 二.预防医学特点:1.工作对象包括个体及确定的群体,主要着眼于健康和无症状患者;2研究方法注重微观和宏观相结合,但更侧重于影响健康的因素与人群的关系;3.采取的对策更具积极的预防作用,具有较临床医学更大的人群健康效应。 三.健康决定因素:指决定个体和人群健康状态的因素。包括:1、社会经济环境。2、物质环境3.个人因素。4卫生服务。 四.三级预防策略:1.第一级预防:又称病因预防,即防止疾病的发生。2.第二级预防:在疾病的临床前期做好早起发现、早期诊断、早起治疗的“三早”预防工作,以控制疾病的发展和恶化。3.第三级预防:对已患某些病者,采取及时的、有效的治疗措施,防止病情恶化,预防并发症和伤残,延长生命。 第一章流行病学概论 进健康的策略和措施的科学。 流行病学定义涵:1.流行病学的研究对象时人群。2.流行病学关注的事件包括疾病与健康状况。3.流行病学主要研究容是:(1)揭示现象(2)找出原因(3)评价效果。4.流行病学研究和实践的目的是防治疾病、促进健康。 二.流行病学基本原理:1.分布论。2.病因论。3.健康-疾病连续带。4预防控制理论(三级预防理论)5.数理模型。6.流行病学的几个基本原则:(1)群体原则(2)现场原则(3)对比原则(核心)(4)代表性原则 三.流行病学的用途:1.描述疾病及健康状况的分布。2.探讨疾病的病因。3.研究疾病自然史,提高临床诊断、治疗水平和预后评估。4.疾病的预防控制及其效果评价。5.流行病学分支。 第二章疾病分布 的存在方式及其发生、发展规律。 二.疾病分布的测量指标:1.发病率:指在一定期间(一般为1年)特定群中某病新病例出现的频率。 病频率的测量(日、周、旬、月),常用于疾病暴发或流行时的调查。 例。患病率=发病率*病程。 病的人数占所有易感接触者总数的百分率。 5.死亡率:指在一定时间期间(通常为1年),某人群中死于某病(或死于所有原因)的频率。死亡率是测量入群死亡危险最常用的指标。 6.病死率:表示一定时期,患某病的全部病人中因该病死亡者所占的比例。 三.疾病的分布形式(“三间分布”) 1.地区分布:疾病的地方性:由于自然环境和社会因素的影响而使一些疾病无需从外地输入,只存在于某一地区,或在某一地区的发病率水平总是较高,这种现象称为疾病的地方性。 2.时间分布 3.人群分布:出生队列分析:将同一时期出生的人划归为一组称为一个出生队列,对其随访观察若干年,观察死亡等情况。 4.判断疾病地方性的依据:(1)该病在当地居住的各群组

医学统计学总结

医学统计学总结 一。绪论 1,医学统计学:运用概率论和数理统计学的原理和方法,研究医学领域中随机现象有关数据的搜集、整理、分析和推断,进而阐明其客观规律性的一门应用科学. 2,医学统计学的主要内容: 1) 统计研究设计调查研究设计和实验研究设计 2)医学统计学的基本原理和方法研究设计和数据处理中的基本统计理论和方法.A:资料的搜集与整理 B:常用统计描述,集中趋势和离散趋势,相对数,相关系数,回归系数,统计表,统计图 C:统计推断,如参数估计和假设检验. 3)医学多元统计方法多元线性回归和逐步回归分析、判别分析、聚类分析、主成分分析、因子分析、logistic回归与Cox回归分析. 3,统计工作步骤: 1)设计明确研究目的和研究假说,确定观察对象与观察单位,样本含量和抽样方法,拟定研究方案,预期分析指标,误差控制措施,进度与费用。 2)搜集材料 A,搜集材料的原则及时、准确、完整 B, 统计资料的来源医学领域的统计资料的来源主要有三个方面。一是统计报表,二是经常性工作记录,三是专题调查或专题实验。 C,资料贮存 3)整理资料 a检查核对b设计分组c拟定整理表d归表 4)分析资料统计分析包括统计描述和统计推断 4,同质(homogeneity):指被研究指标的影响因素相同。 变异(variation):同质基础上的各观察单位间的差异。 变量(variable):收集资料过程中,根据研究目的确定同质观察单位,再对每个观察单位的某项 特征进行测量或观察,这种特征称为变量 变量值:变量的观察结果或测量值。 变量类型变量值表现实例资料类型 数值变量离散型 定量测量值,有计量单位产前检查次数 计量资料 连续型身高 分类变量无 序 二分类对立的两类属性性别(男女) 计数资料多分类不相容的多类属性血型(A,B,O,AB) 有 序 多分类类间有程度差异的属性受教育程度(小学,中 学,高中,大学…)等级资料5,总体(population) 根据研究目的所确定的同质研究对象中所有观察单位某变量值的集合。总体具有的基本特征是:同质性 样本(sample)从总体中随机抽取部分观察单位,其变量值的集合构成样本。样本必须具有代表性.代表性是指样本来自同质总体,足够的样本含量和随机抽样的前提。 统计量(statistics)描述样本变量值特征的指标(样本率,样本均数,样本标准差)。

医学统计学案例分析报告.doc

医学统计学案例分析评述 医学期刊论著:《口岸出入境人员预防接种统计分析》 【题目】口岸出入境人员预防接种统计分析 【研究目标】对口岸出入境人员的预防接种情况进行统计分析,为各种跨国传染性疾病的预防提供参考数据。 【研究人群】2010 年1 月--2012 年5 月口岸接受预防接种的出入境人员6870 位,其基本资料如下:男3678 人,女3021 人;年龄在3-79 岁之 间,平均年龄45.6 岁。经免疫前检查和询问,研究对象均无严重 的疾病,且无接种疫苗过敏史及禁忌症。 【资料类型】本资料是计数资料。 (1)原文:研究对象:选择我处2010 年1 月-2011 年4 月,2011 年5 月-2012 年5月两个时间段6870 位出入境人员,将其按公务人员、船员、劳 务人员、留学人员、旅游探亲及商务等进行分组。 (2)问题:①文献中未明确“我处”的具体含义,没有明确研究对象的来源。 ②文献中未提及“6870 位出入境人员”是如何产生的,即是普查, 还是抽样调查?如果是抽样调查,未明确抽样的方法,是如何应用 随机抽样的方法选择这6870 位研究对象的? 【统计方法】 (1)本论著未明确使用了何种统计学方法,我们组认为:首先应对资料进行正态性检验和方差齐性检验,若满足正态、方差齐,选择χ2检验,否则应选用秩和检验。 一篇论文结论的正确与否,需根据该篇论文所选用的检验方法和检验结果进行判断。如果没有检验方法或检验方法不合理,就无法知道检验结果是否出错,也就无法对结论进行准确判断。 (2)文献尽管在“1.4 统计学处理”中提及了“使用SPSSl5.2 软件进行统计学分析”,注明所采用的统计软件,但方法中未注明统计推断方法,没有明确

医学统计学总结

医学统计学总结 一.绪论 1,医学统计学:运用概率论和数理统计学的原理和方法,研究医学领域中随机现象有关数据的搜集、整理、分析和推断,进而阐明其客观规律性的一门应用科学。 2,医学统计学的主要内容: 1)统计研究设计调查研究设计和实验研究设计 2)医学统计学的基本原理和方法研究设计和数据处理中的基本统计理论和方法。A:资料的搜集与整理 B:常用统计描述,集中趋势和离散趋势,相对数,相关系数,回归系数,统计表,统计图 C:统计推断,如参数估计和假设检验。 3)医学多元统计方法多元线性回归和逐步回归分析、判别分析、聚类分析、主成分分析、因子分析、logistic回归与Cox回归分析。 3,统计工作步骤: 1)设计明确研究目的和研究假说,确定观察对象与观察单位,样本含量和抽样方法,拟定研究方案,预期分析指标,误差控制措施,进度与费用。 2)搜集材料 A,搜集材料的原则及时、准确、完整 B,统计资料的来源医学领域的统计资料的来源主要有三个方面。一是统计报表,二是经常性工作记录,三是专题调查或专题实验。 C,资料贮存 3)整理资料 a检查核对b设计分组c拟定整理表d归表 4)分析资料统计分析包括统计描述和统计推断 4,同质(homogeneity):指被研究指标的影响因素相同。 变异(variation):同质基础上的各观察单位间的差异。 变量(variable):收集资料过程中,根据研究目的确定同质观察单位,再对每个观察单位的某 项特征进行测量或观察,这种特征称为变量 变量值:变量的观察结果或测量值。 5,总体(population)根据研究目的所确定的同质研究对象中所有观察单位某变量值的集合。总 体具有的基本特征是:同质性 样本(sample)从总体中随机抽取部分观察单位,其变量值的集合构成样本。样本必须具有代 表性。代表性是指样本来自同质总体,足够的样本含量和随机抽样的前提。 统计量(statistics)描述样本变量值特征的指标(样本率,样本均数,样本标准差)。

医学统计学题库完整

第一章 绪论习题 一、选择题 1.统计工作和统计研究的全过程可分为以下步骤:(D ) A. 调查、录入数据、分析资料、撰写论文 B. 实验、录入数据、分析资料、撰写论文 C. 调查或实验、整理资料、分析资料 D. 设计、收集资料、整理资料、分析资料 E. 收集资料、整理资料、分析资料 2.在统计学中,习惯上把(B )的事件称为小概率事件。 A.10.0≤P B. 05.0≤P 或01.0≤P C. 005.0≤P D.05.0≤P E. 01.0≤P 3~8 A.计数资料 B.等级资料 C.计量资料 D.名义资料 E.角度资料 3.某偏僻农村144名妇女生育情况如下:0胎5人、1胎25人、2胎70人、3胎30人、4胎14人。该资料的类型是( A )。 4.分别用两种不同成分的培养基(A 与B )培养鼠疫杆菌,重复实验单元数均为5个,记录48小时各实验单元上生长的活菌数如下,A :48、84、90、123、171;B :90、116、124、225、84。该资料的类型是(C )。 5.空腹血糖测量值,属于( C )资料。 6.用某种新疗法治疗某病患者41人,治疗结果如下:治愈8人、显效23人、好转6人、恶化3人、死亡1人。该资料的类型是(B )。 7.某血库提供6094例ABO 血型分布资料如下:O 型1823、A 型1598、B 型2032、AB 型641。该资料的类型是(D )。 8. 100名18岁男生的身高数据属于(C )。 二、问答题 1.举例说明总体与样本的概念. 答:统计学家用总体这个术语表示小异的对象全体,通常称为目标总体,而资料常来源于目标总体的一个较小总体,称为研究总体。实际中由于研究总体的个体众多,甚至无限多,因此科学的办法是从中抽取一部分具有代表性的个体,称为样本。例如,关于吸烟与肺癌的研究以英国成年男子为总体目标,1951年英国全部注册医生作为研究总体,按照实验设计随机抽取的一定量的个体则组成了研究的样本。 2.举例说明同质与变异的概念 答:同质与变异是两个相对的概念。对于总体来说,同质是指该总体的共同特征,即该总体区别于其他总体的特征;变异是指该总体部的差异,即个体的特异性。例如,某地同性别同年龄的小学生具有同质性,其身高、体重等存在变异。 3.简要阐述统计设计与统计分析的关系 答:统计设计与统计分析是科学研究中两个不可分割的重要方面。一般的,统计设计在前,然而一定的统计设计

医学统计学分析基本思路指南

医学统计学分析基本思路指南 医学统计学的学习一定要以理解为主。对于初学者,不必强记一大堆的公式,也不要死钻牛角尖,非要弄明白为什么这种方法叫“t检验”、“F检验”,为什么这个残差叫做“学生化残差”等等。这些都是历史遗留问题,感兴趣的读者可以查阅统计学史。对于只想应用的人来讲,你只要了解在什么情况下应该用什么方法,什么指标应该用于什么情形。尽管多数统计教材都说了数据分析应该先做假设检验,然后选定统计量,然后怎么怎么。但实际中我们拿到一堆数据的时候,不会坐在桌上先列出零假设和备择假设,也不会满座子地计算统计量。更实际的分析思路是: (1)先确定研究目的,根据研究目的选择方法。不同研究目的采用的统计方法不同,常见的研究目的主要有三类:一是差异性研究,即比较组间均数、率等的差异,可用的方法有t 检验、方差分析、χ2检验、非参数检验等。二是相关性分析,即分析两个或多个变量之间的关系,可用的方法有相关分析。三是影响性分析,即分析某一结局发生的影响因素,可用的方法有线性回归、logistic回归、Cox回归等。 (2)明确数据类型,根据数据类型进一步确定方法。不同数据类型采用的统计方法也不同。定量资料可 用的方法有t检验、方差分析、非参数检验、线性相关、线性回归等。分类资料可用的方法有χ2检验、对数线性模型、logistic回归等。图1.6简要列出了不同研究目的、不同数据类型常用的统计分析方法。 (3)选定统计方法后,需要利用统计软件具体实现统计分析过程。SAS中,不同的统计方法对应不同的命令,只要方法选定,便可通过对应的命令辅之以相应的选项实现统计结果的输出。 (4)统计结果的输出并非数据分析的完成。一般统计软件都会输出很多结果,需要从中选择自己需要的部分,并做出统计学结论。但统计学结论不同于专业结论,最终还需要结合实际做出合理专业结论。 下面是本人简单总结的常用方法的选择,可供读者参考。如有引用本图者,请注明引自《医学案例统计分析与SAS应用》一书,谢谢。

医学统计学重点图表总结

定量资料统计描述常用的统计指标及其适用场合 描述内容指标意义适用场合 平均水平均数个体的平均值对称分布 几何均数平均倍数取对数后对称分布 中位数位次居中的观察值 ①非对称分布;②半定量资料;③末端开口资料; ④分布不明 众数频数最多的观察值不拘分布形式,概略分析 调和均数基于倒数变换的平 均值 正偏峰分布资料 变异度全距观察值取值范围不拘分布形式,概略分析 标准差(方差)观察值平均离开均 数的程度 对称分布,特别是正态分布资料 四分位数间距居中半数观察值的 全距 ①非对称分布;②半定量资料;③末端开口资料; ④分布不明 变异系数标准差与均数的相 对比 ①不同量纲的变量间比较;②量纲相同但数量级相 差悬殊的变量间比较 4. 常用统计图有哪些?分别适用于什么分析目的? 常用统计图的适用资料及实施方法 条图组间数量对比用直条高度表示数量大小 直方图定量资料的分布用直条的面积表示各组段的频数或频率 百分条图构成比用直条分段的长度表示全体中各部分的构成比 饼图构成比用圆饼的扇形面积表示全体中各部分的构成比 线图定量资料数值变动线条位于横、纵坐标均为算术尺度的坐标系 半对数线图定量资料发展速度线条位于算术尺度为横坐标和对数尺度为纵坐标的坐标系 1

1 散 点 图 双变量间的关联 点的密集程度和形成的趋势,表示两现象间的相关关系 箱 式 图 定量资料取值范围 用箱体、线条标志四分位数间距及中位数、全距的位置 茎 叶 图 定量资料的分布 用茎表示组段的设置情形,叶片为个体值,叶长为频数 定性资料统计描述常用的统计指标及其适用场合 指标 计算公式 适用场合 频率 n/N 估计总体中某一结局发生的概率 频率分布 n 1/N ,n 2/N,…..,n k /N 估计总体中所有可能结局发生的概率 强度 阳性人数/总观察人时数 估计总体中单位时间内某一结局发生的概率 比 A/B 估计两个指标的相对大小 4.常用参考值范围的制定? 参考值范围(%) 正态分布法 百分位数法 双侧 单侧 双侧 单侧 下限 上限 下限 上限 90 S X 64.1± S X 1.28- S X 1.28+ P 5~P 95 P 10 P 90 95 S X 96.1± S X 64.1- S X 64.1+ P 2.5~P 97 .5 P 5 P 95 99 S X 58.2± S X 2.33- S X 2.33+ P 0.5~P 99 .5 P 1 P 99 1.标准差与标准误的区别与联系?

医学统计学总结重点笔记复习

章第一1 选2)是根据研究目的确定的同质观察单位(研究对象)的全体,population总体:总体(实际上是某一变量值的集合。可分为有限总体和无限总体。总体中的所有单位都能够标识者为有限总体,反之为无限总体。总体population根据研究目的而确定的同质观察单位的全体。)。样样本:从总体中随机抽取部分观察单位,其测量结果的集合称为样本(sample本应具有代表性。所谓有代表性的样本,是指用随机抽样方法获得的样本。从总体中随机抽得的部分观察单位,其实测值的集合。样本sample1 3选(即在大量重复试验中出现的频率非常低)的事件小概率事件:我们把概率很接近于0 称为小概率事件。值即概率,反映某一事件发生的可能性大小。统计学根据显著性检验方法所得P 值:P 认为有高 P ≤0.01 P 到的P 值反应结果真实程度,一般以≤ 0.05 认为有统计学意义,或0.01。度统计学意义,其含义是样本间的差异由抽样误差所致的概率等于或小于0.05 值是:P 1) 一种概率,一种在原假设为真的前提下出现观察样本以及更极端情况的概率。 2) 拒绝原假设的最小显著性水平。实例的) 显著性水平。3) 观察到的( 4) 表示对原假设的支持程度,是用于确定是否应该拒绝原假设的另一种方法。小概率原理:一个事件如果发生的概率很小的话,那么可认为它在一次实际实验中是不会发生的,数学上称之小概率原理,也称为小概率的实际不可能性原理。统计学中,一 0.01的概率为小概率。般认为等于或小于0.05或 1)资料的类型(3选)计量资料:对每个观察单位用定量的方法测定某项指标量的大小,所得的资料称1(其变量值是定量.为计量资料(measurement data)。计量资料亦称定量资料、测量资料。、红细胞(kg)的,表现为数值大小,一般有度量衡单位。如某一患者的身高(cm)、体重12L分)、血压(KPa(10/)等。)、脉搏(次/计数numerical quantitative data数值变量资料计量资料measurement data定量资料variable 为观测每个观察单位某项指标的大小,而获得的资料。)计数资料:将观察单位按某种属性或类别分组,所得的观察单位数称为计数资料2()。计数资料亦称定性资料或分类资料。其观察值是定性的,表现为互不相count data(容的类别或属性。如调查某地某时的男、女性人口数;治疗一批患者,其治疗效果为有效、 O 四种血型的人数等。ABA、B、、无效的人数;调查一批少数民族居民的unordered qualitative data定性资料无序分类变量资料enumeration data 计量资料nominal variable 名义变量资料categorical variable 为将观察单位按某种属性或类别分组计数,分组汇总各组观察单位数后而得到的资料。. )等级资料:将观察单位按测量结果的某种属性的不同程度分组,所得各组的观察3()。等级资料又称有序变量。如患者的治疗结果可ordinal data单位数,称为等级资料(分为治愈、好转、有效、无效或死亡,各种结果既是分类结果,又有顺序和等级差别,但等。、+++这种差别却不能准确测量;一批肾病患者尿蛋白含量的测定结果分为 +、++等级资料ranked data半定量资料semi-quantitative data有序分类变量ordinal categorical variable资料 为将观察单位按某种属性的不同程度分成等级后分组计数,分类汇总各组观察单位后而得到的资料。 等级资料与计数资料不同:属性分组有程度差别,各组按大小顺序排列。 等级资料与计量资料不同:每个观察单位未确切定量,故亦称为半计量资料。 两种误差(2选1) 抽样误差(sampling error )由于抽样而引起的总体指标(参数)与样本指标(统计数)之间的差异。抽样误差是由个体变异或其它随机因素造成的,是不可避免的,但误差分布有规律可循,可

医学统计学重点总结

<<医学统计学>>重点总结 1. 总体:根据研究的目的确定的同质研究对象中所有的观察单位变量值的集合。 2. 样本:按随机化原则从同质总体中随机抽取的部分观察单位某变量值的集合。 3. 同质:影响研究指标的主要因素易控制的因素基本上相同。 4. 抽样误差:在抽样研究中,由于变异的存在,即使在同一总体中抽取的几个样本,各样本统计量往往不等。样本统计量与总体参数也不等,这种由于抽样研究所至样本之间和样本与总体之间的差异称为。。。 5. 变量:观察指标在统计学上统称为指标变量,它反应的是生物个体间的变异情况,根据其性质可分为定性变量(分类)和定量变量(连续)。 6. 截尾数据:生存时间观察过程被人为的截止称为截尾,又称删失或终检。原因:失访/退出/ 终止(研究时限已到而终止观察)。 7. 卡方基本思想:X2分布是一种连续型分布,可用于检验资料的实际频数和按检验假设计算的理论频数是否相等等问题。X2反应实现了实际频数与理论频数的吻合程度。如果检验假设成立,则A-T 一般不大,X2应很小,即出现大X2值概率很小。即X2越大,P越小,若P≤a时,就怀疑假设的成立,拒绝H0。若P>a则没有理由拒绝H0。 8. X2用途: (1)实际频数与拟合频数拟合优度:A推断两个或两个以上总体率或构成比有无差别(四格表/行x 列表)。B两变量之间有无相互关系。C频数分布的拟合优度检验(判断次样本是否来自某种分布)。(2)某些分布可用X2近似。 (3)间接应用:如t分布和F分布就是在X2分布基础上推导出来的。 9. 方差分析的基本思想:根据研究目的和设计类型,把总体变异中离均差平方和分解成两部分或更多部分,也把总变异中的自由度相应分成两部分或更多部分,然后再进行比较,评价由某种因素引起的变异是否具有统计学意义。 10. 假设检验中P,a,b(倍他)的关系及统计学意义: a:检验水准,即显著性检验,在此概率之下的认为是小概率事件,统计学上以为此事件“不可能发生”,以此判断是否不拒绝H0无效假设,在假设检验中,按a检验水准,拒绝了原来正确的H0,即犯了第1类错误,犯此错误的概率为a。 b:在T假设检验中,按照a检验标准,没有拒绝原来错误的无效假设,即犯了第2类错误,犯次错误的概率是b。 P:是在H0成立时大于等于用样本计算的统计值出现的概率用P值与检验水准a比较,根据比较的结果作出统计判断。如果P≤a时,就怀疑假设的成立,拒绝H0。若P>a则接受H0拒绝H1。P值越小只能说明作出拒绝H0,接受H1的推论时犯错误的机会越小。 11.行x列表X2检验应注意: (1)行x列表中不宜有1/5以上格子的理论频数小于5或有一个格子的理论频数小于1,若发生上述情况可采用:A将理论频数过小的格子所在的行或列与性质相近的邻近行或列中的实际频数合并,使重新计算的理论频数增大。B删去理论频数过小的行或列。C增大样本含量以增大理论频数。 (2)当效应按强弱分为若干级别,则按实验结果可整理为单向有序行x列表,在比较各处理组的效应有无差别时,宜用秩和检验,ridit分析等。如作X2检验只说明各组构成比的差异有无统计学意义。

医学统计学重点总结

1.简述总体和样本的定义,并且举例说明。 总体是研究目的确定的所有同质观察单位的全体。样品是从研究总体中抽取部分有代表性的观察单位。 2.简述参数和统计量的定义,并且举例说明。 描述总体特征的指标称为参数,描述样本特征的指标称为统计量。 3.变量的类型有哪几种?举例说明各种类型变量有什么特点。 ①定量数据:计量资料;定量的观测值是定量的,其特点是能够用数值的大小衡量其水平的 高低。 ②定性数据:计数资料;变量的观测值是定性的,表现为互不相容的类别或属性。 ③有序数据:半定量数据/等级资料;变量的观测值是定性的,但各类别(属性)有程度或顺 序上的差异。 4.请举例说明一种类型的变量如何变换为另一种类型的变量。定量数据>有序数据>定性数据 ---------------> 5.请简述什么是小概率事件? 概率是描述事件发生可能性大小的度量,P0.05事件称为小概率事件。 6.举例说明什么是配对设计。 配对设计是将受试对象按某些重要特征相近的原则配成对子,每对中的两个个体随机地给予两种处理。①同源配对:同一受试对象或同一标本的两个部分,随机分配接受两种不同处理;②异源配对:为消除混杂因素的影响,将两个同质受试对象配对分别接受两种处理。 7.非参数假设检验适合什么类型数据进行分析? ①总体分布类型未知或非正态分布数据;②定量或半定量数据;③数据两端无确定的数值。 8.简述P 25 P 50 P 75 的统计学意义。(条件:明显偏态且不能转化为正态或近似对称;一端或两端无 确定数值;分布情况未知) 用来描述资料的观测值序列在某百分位置的水平,四分位数间距可以作为说明个体差异的指标(说明个体在不同位置的变异情况)。 9.直条图、直方图、圆饼图的使用条件是什么? 直条图:各自独立的统计指标的数值大小和他们之间的对比; 直方图:连续变量频数分布情况; 圆饼图:全体中各部分所占的比例。 10.统计分析包括哪两个方面的内容?为什么要进行统计推断? 统计描述和统计分析; 统计描述用来描述及总结一组数据的重要特征,其目的是使实验或观察得到的数据表达清楚并便于分析。统计推断指由样本数据的特征推断总体特征的方法,包括参数估计(点估计和区间估计)和假设检验(判断随机波动引起差别的概率大小)。 统计推断是通过样本推断总体的统计方法/根据样本提供的信息和抽样分布的规律,以一定的概率推断总体的特征。总体是通过总体分布的数量特征即参数 (如方差) 来反映的。很多时候并不知道总体的参数,只能由样本统计量推断获得。 11.定量数据如何进行统计描述?请举例说明。通过具体数值反应高低水平。 12.定性数据如何进行统计描述?请举例说明。根据类别或属性的不同分类。 13.简述均数的抽样误差及率的抽样误差。 由抽样造成的样本统计量与总体参数的差异称为抽样误差,样本均数不等于总体均数μ,总体率参数π不等于样本率p。 14.简述正态分布和标准正态分布的关系。 (μ=0,)关系:标准正态分布是正态分布的一种,具有正态分布的所有特征。所有 正态分布都可以通过Z分数公式转换成标准正态分布。 区别:正态分布的平均数为μ,标准差为σ;不同的正态分布可能有不同的μ值和d值,正态分布曲线形态因此不同。标准正态分布平均数μ=0,标准差σ=1,μ和σ都是固定值;标准正态分布曲线形态固定。

相关文档
最新文档