统计学各章节课后习题答案

统计学各章节课后习题答案
统计学各章节课后习题答案

统计学各章练习题答案第1章绪论(略)

第2章统计数据的描述

2.1 (1)属于顺序数据。

(2)频数分布表如下:

服务质量等级评价的频数分布

服务质量等级家庭数(频率)频率%

A1414

B2121

C3232

D1818

E1515

合计100100

(3)条形图(略)

2.2 (1)频数分布表如下:

(2)某管理局下属40个企分组表

按销售收入分组(万元)企业数(个)频率(%)

先进企业良好企业一般企业落后企业11

11

9

9

27.5

27.5

22.5

22.5

合计40 100.0 2.3 频数分布表如下:

某百货公司日商品销售额分组表

按销售额分组(万元)频数(天)频率(%)

25~30 30~35 35~40 40~45 45~50

4

6

15

9

6

10.0

15.0

37.5

22.5

15.0

合计40 100.0 直方图(略)。

2.4 (1)排序略。

(2)频数分布表如下:

100只灯泡使用寿命非频数分布

按使用寿命分组(小时)灯泡个数(只)频率(%)650~660 2 2

660~670 5 5

670~680 6 6

680~690 14 14

690~700 26 26

700~710 18 18

710~720 13 13

720~730 10 10

730~740 3 3

740~750 3 3

合计100 100 直方图(略)。

2.5 (1)属于数值型数据。

(2)分组结果如下:

分组天数(天)

-25~-20 6

-20~-15 8

-15~-10 10

-10~-5 13

-5~0 12

0~5 4

5~10 7

合计60

(3)直方图(略)。

2.6 (1)直方图(略)。

(2)自学考试人员年龄的分布为右偏。

2.7 (1

(2)A 班考试成绩的分布比较集中,且平均分数较高;B 班考试成绩的分布比A 班分散,

且平均成绩较A 班低。

2.8

2.9 (1)x =274.1(万元);Me=272.5 ;Q L =260.25;Q U =291.25。

(2)17.21=s (万元)。

2.10 (1)甲企业平均成本=19.41(元),乙企业平均成本=18.29(元);原因:尽管两个企业的单位成本相同,但

单位成本较低的产品在乙企业的产量中所占比重较大,因此拉低了总平均成本。 2.11 x =426.67(万元);48.116=s (万元)。 2.12 (1)(2)两位调查人员所得到的平均身高和标准差应该差不多相同,因为均值和标准差的大小基本上不受样本

大小的影响。

(3)具有较大样本的调查人员有更大的机会取到最高或最低者,因为样本越大,变化的范围就可能越大。 2.13 (1)女生的体重差异大,因为女生其中的离散系数为0.1大于男生体重的离散系数0.08。 (2) 男生:x =27.27(磅),27.2=s (磅); 女生:x =22.73(磅),27.2=s (磅); (3)68%;

(4)95%。

2.14 (1)离散系数,因为它消除了不同组数据水平高地的影响。

(2)成年组身高的离散系数:024.01.1722

.4==

s v ; 幼儿组身高的离散系数:032.03

.713

.2==

s v ; 由于幼儿组身高的离散系数大于成年组身高的离散系数,说明幼儿组身高的离散程度相对较大。 2.15

2.16 (1)方差或标准差;(2)商业类股票;(3)(略)。 2.17 (略)。

第3章 概率与概率分布

3.1设A =女性,B =工程师,AB =女工程师,A+B =女性或工程师 (1)P(A)=4/12=1/3 (2)P(B)=4/12=1/3 (3)P(AB)=2/12=1/6

(4)P(A+B)=P(A)+P(B)-P(AB)=1/3+1/3-1/6=1/2

3.2求这种零件的次品率,等于计算“任取一个零件为次品”(记为A )的概率()P A 。 考虑逆事件A =“任取一个零件为正品”,表示通过三道工序都合格。据题意,有:

()(10.2)(10.1)(10.1)0.648P A =---=

于是 ()1()10.6480.352P A P A =-=-=

3.3设A 表示“合格”,B 表示“优秀”。由于B =AB ,于是

)|()()(A B P A P B P ==0.8×0.15=0.12

3.4 设A =第1发命中。B =命中碟靶。求命中概率是一个全概率的计算问题。再利用对立事件的概率即可求得脱靶的概率。

)|()()|()()(A B P A P A B P A P B P += =0.8×1+0.2×0.5=0.9 脱靶的概率=1-0.9=0.1

或(解法二):P (脱靶)=P (第1次脱靶)×P(第2次脱靶)=0.2×0.5=0.1 3.5 设A =活到55岁,B =活到70岁。所求概率为:

()()0.63

(|)0.75()()0.84

P AB P B P B A P A P A =

=== 3.6这是一个计算后验概率的问题。

设A =优质率达95%,A =优质率为80%,B =试验所生产的5件全部优质。 P(A)=0.4,P (A )=0.6,P (B|A )=0.955, P(B |A )=0.85,所求概率为:

6115.050612

.030951

.0)|()()|()()|()()|(===

A B P A P A B P A P A B P A P B A P +

决策者会倾向于采用新的生产管理流程。

3.7 令A 1、A 2、A 3分别代表从甲、乙、丙企业采购产品,B 表示次品。由题意得:P (A 1)=0.25,P (A 2)=0.30, P (A 3)=0.45;P (B |A 1)=0.04,P (B |A 2)=0.05,P (B |A 3)=0.03;因此,所求概率分别为:

(1))|()()|()()|()()(332211A B P A P A B P A P A B P A P B P ++= =0.25×0.04+0.30×0.05+0.45×0.03=0.0385

(2)3506.00385

.00135

.00.030.450.050.300.040.2503.045.0)|(3==++=

????B A P

3.8据题意,在每个路口遇到红灯的概率是p =24/(24+36)=0.4。

设途中遇到红灯的次数=X ,因此,X ~B(3,0.4)。其概率分布如下表:

3.9 设被保险人死亡数=X ,X ~B (20000,0.0005)。

(1)收入=20000×50(元)=100万元。要获利至少50万元,则赔付保险金额应该不超过50万元,等价于被保险人死亡数不超过10人。所求概率为:P(X ≤10)=0.58304。

(2)当被保险人死亡数超过20人时,保险公司就要亏本。所求概率为: P(X >20)=1-P(X ≤20)=1-0.99842=0.00158 (3)支付保险金额的均值=50000×E (X ) =50000×20000×0.0005(元)=50(万元) 支付保险金额的标准差=50000×σ(X )

=50000×(20000×0.0005×0.9995)1/2=158074(元)

3.10 (1)可以。当n 很大而p 很小时,二项分布可以利用泊松分布来近似计算。本例中,λ= np =20000×0.0005=10,即有X ~P (10)。计算结果与二项分布所得结果几乎完全一致。

(2)也可以。尽管p 很小,但由于n 非常大,np 和np(1-p)都大于5,二项分布也可以利用正态分布来近似计算。

本例中,np=20000×0.0005=10,np(1-p)=20000×0.0005×(1-0.0005)=9.995, 即有X ~N (10,9.995)。相应的概率为: P (X ≤10.5)=0.51995,P(X ≤20.5)=0.853262。

可见误差比较大(这是由于P 太小,二项分布偏斜太严重)。

【注】由于二项分布是离散型分布,而正态分布是连续性分布,所以,用正态分布来近似计算二项分布的概率时,通常在二项分布的变量值基础上加减0.5作为正态分布对应的区间点,这就是所谓的“连续性校正”。

(3)由于p =0.0005,假如n =5000,则np =2.5<5,二项分布呈明显的偏态,用正态分布来计算就会出现非常大的误差。此时宜用泊松分布去近似。 3.11(1))6667.1()30

200

150()150(-<-<

=

(2) 设所求值为K ,满足电池寿命在200±K 小时范围内的概率不小于0.9,即有:

|200|(|200|){||}0.93030

X K

P X K P Z --<=<≥=

即:{}0.9530

K

P Z <

≥,K /30≥1.64485,故K ≥49.3456。 3.12设X =同一时刻需用咨询服务的商品种数,由题意有X ~B(6,0.2)

(1)X 的最可能值为:X 0=[(n+1)p]=[7×0.2]=1 (取整数) (2)∑=--

=≤-=>2

668.02.01)2(1)2(k k k k C X P X P

=1-0.9011=0.0989

第4章 抽样与抽样分布

4.1 a. 20, 2 b. 近似正态 c. -2.25 d. 1.50

4.2 a. 0.0228 b. 0.0668 c. 0.0062 d. 0.8185 e. 0.0013 4.3 a. 0.8944 b. 0.0228 c. 0.1292 d. 0.9699 4.4 a. 101, 99 b. 1 c. 不必 4.5 趋向正态

4.6. a. 正态分布, 213, 4.5918 b. 0.5, 0.031, 0.938

4.7. a. 406, 1.68, 正态分布 b. 0.001 c. 是,因为小概率出现了 4.8. a. 增加 b. 减少

4.9. a. 正态 b. 约等于0 c. 不正常 d. 正态, 0.06 4.10 a. 0.015 b. 0.0026 c. 0.1587

4.11. a. (0.012, 0.028) b. 0.6553, 0.7278 4.12. a. 0.05 b. 1 c. 0.000625

第5章 参数估计

5.1 (1)79.0=x σ。(2)E =1.55。

5.2 (1)14.2=x σ。(2)E =4.2。(3)(115.8,124.2)。 5.3 (2.88,3.76);(2.80,3.84);(2.63,4.01)。 5.4 (7.1,12.9)。 5.5 (7.18,11.57)。

5.6 (18.11%,27.89%);(17.17%,22.835)。 5.7 (1)(51.37%,7

6.63%);(2)36。 5.8 (1.86,1

7.74);(0.19,19.41)。

5.9

(1)2±1.176;(2)2±3.986;(3)2±3.986;(4)2±3.587;(5)2±3.364。

5.10 (1)75.1=d ,63.2=d s ;(2)1.75±4.27。 5.11 (1)10%±

6.98%;(2)10%±8.32%。 5.12 (4.06,14.35)。 5.13 48。 5.14 139。 5.15 57。 5.16 769。

第6章 假设检验

6.1 研究者想要寻找证据予以支持的假设是“新型弦线的平均抗拉强度相对于以前提高了”,所以原假设与备择假设

应为:1035:0≤μH ,1035:1>μH 。

6.2

π=“某一品种的小鸡因为同类相残而导致的死亡率”,04.0:0≥πH ,04.0:1<πH 。 6.3 65:0=μH ,65:1≠μH 。

6.4 (1)第一类错误是该供应商提供的这批炸土豆片的平均重量的确大于等于60克,但检验结果却提供证据支持店

方倾向于认为其重量少于60克;

(2)第二类错误是该供应商提供的这批炸土豆片的平均重量其实少于60克,但检验结果却没有提供足够的证据支持店方发现这一点,从而拒收这批产品;

(3)连锁店的顾客们自然看重第二类错误,而供应商更看重第一类错误。

6.5 (1)检验统计量n

s x z /μ-=

,在大样本情形下近似服从标准正态分布;

(2)如果05.0z z >,就拒绝0H ;

(3)检验统计量z =2.94>1.645,所以应该拒绝0H 。 6.6 z =3.11,拒绝0H 。 6.7 z =1.93,不拒绝0H 。 6.8 z =7.48,拒绝0H 。

6.9

2χ=206.22,拒绝0H 。 6.10 z =-5.145,拒绝0H 。 6.11 t =1.36,不拒绝0H 。 6.12 z =-4.05,拒绝0H 。

6.13 F =8.28,拒绝0H 。 6.14 (1)检验结果如下:

t-检验: 双样本等方差假设

变量 1

变量 2

平均 100.7

109.9

方差 24.11578947

33.35789474

观测值 20

20

合并方差 28.73684211

假设平均差 0 df 38

t Stat -5.427106029 P(T<=t) 单尾 1.73712E-06 t 单尾临界 1.685953066 P(T<=t) 双尾 3.47424E-06 t 双尾临界

2.024394234

t-检验: 双样本异方差假设

变量 1

变量 2

平均 100.7

109.9

方差 24.11578947

33.35789474

观测值 20 20

假设平均差 0 df 37

t Stat -5.427106029 P(T<=t) 单尾 1.87355E-06 t 单尾临界 1.687094482 P(T<=t) 双尾 3.74709E-06 t 双尾临界

2.026190487

(2)方差检验结果如下:

F-检验 双样本方差分析

变量 1

变量 2

平均 100.7

109.9

方差

24.11578947

33.35789474

观测值 20 20 df 19

19

F

0.722940991 P(F<=f) 单尾 0.243109655 F 单尾临界

0.395811384

第7章 方差分析与试验设计

7.1 0215.86574.401.0=<=F F (或01.00409.0=>=-αvalue P ),不能拒绝原假设。 7.2 8853.30684.1705.0=>=F F (或05.00003.0=<=-αvalue P ),拒绝原假设。

85.54.14304.44=>=-=-LSD x x B A ,拒绝原假设; 85.58.16.424.44=<=-=-LSD x x C A ,不能拒绝原假设; 85.56.126.4230=>=-=-LSD x x C B ,拒绝原假设。

7.3

05

.0(或),不能拒绝原假设。 7.4 有5种不同品种的种子和4种不同的施肥方案,在20快同样面积的土地上,分别采用5种种子和4种施肥方案

搭配进行试验,取得的收获量数据如下表:

2592.32397.705.0=>=F F 种子(或05.00033.0=<=-αvalue P ),拒绝原假设。

4903.32047.905.0=<=F F 施肥方案(或05.00019.0=<=-αvalue P ),拒绝原假设。

7.5 9443.60727.005.0=<=F F 地区(或05.09311.0=>=-αvalue P ),不能拒绝原假设。

9443.61273.305.0=<=F F 包装方法(或05.01522.0=>=-αvalue P ),不能拒绝原假设。 7.6 1432.575.1005.0=>=F F 广告方案(或05.00104.0=<=-αvalue P ),拒绝原假设。

9874.5305.0=<=F F 广告媒体(或05.01340.0=>=-αvalue P ),不能拒绝原假设。

1432.575.105.0=<=F F 交互作用(或05.02519.0=>=-αvalue P ),不能拒绝原假设。 第8章 相关与回归分析

8.1(1)利用Excel 计算结果可知,相关系数为 0.948138XY r =,说明相关程度较高。 (2)计算t 统计量

2.681739

8.4368510.317859t =

=

=

=

给定显著性水平=0.05,查t 分布表得自由度n-2=10-2=8的临界值2t α为2.306,

显然2t t α>,表明相关系数 r 在统计上是显著的。

8.2 利用Excel 中的”数据分析”计算各省市人均GDP 和第一产业中就业比例的相关系数为:-0.34239,这说明人均GDP 与第一产业中就业比例是负相关,但相关系数只有-0.34239,表明二者负相关程度并不大。 相关系数检验:

在总体相关系数0=ρ的原假设下,计算t 统计量:

1.9624

t===-

查t分布表,自由度为31-2=29,当显著性水平取05

.0

=

α时,

2

α

t=2.045;当显著性水平取0.1

α=时,

2

α

t=1.699。

由于计算的t统计量的绝对值1.9624小于

2

α

t=2.045,所以在05

.0

=

α的显著性水平下,不能拒绝相关系数0

=

ρ

的原假设。即是说,在05

.0

=

α的显著性水平下不能认为人均GDP与第一产业中就业比例有显著的线性相关性。

但是计算的t统计量的绝对值1.9624大于

2

α

t=1.699,所以在0.1

α=的显著性水平下,可以拒绝相关系数0

=

ρ的原假设。即在0.1

α=的显著性水平下,可以认为人均GDP与第一产业中就业比例有一定的线性相关性。

8.3设当年红利为Y,每股帐面价值为X

建立回归方程

12

i i i

Y X u

ββ

=++

估计参数为

^

0.4797750.072876

i i

Y X

=+

参数的经济意义是每股帐面价值增加1元时,当年红利将平均增加0.072876元。

序号6的公司每股帐面价值为19.25元,增加1元后为20.25元,当年红利可能为:

^

0.4797750.07287620.25 1.955514

i

Y=+?=(元)

8.4(1)数据散点图如下:

(2)根据散点图可以看出,随着航班正点率的提高,投诉率呈现出下降的趋势,两者之间存在着一定的负相关关系。

(3)设投诉率为Y,航班正点率为X

建立回归方程

12

i i i

Y X u

ββ

=++

估计参数为

^

6.01780.07

i i

Y X

=-

(4)参数的经济意义是航班正点率每提高一个百分点,相应的投诉率(次/10万名乘客)下降0.07。

(5)航班按时到达的正点率为80%,估计每10万名乘客投诉的次数可能为:

4187

.0

80

07

.0

0178

.6

?=

?

-

=

i

Y(次/10万)

8.5由Excel回归输出的结果可以看出:

(1)回归结果为

^

233

32.993090.0716190.1687270.179042

i i i i

Y X X X

=+++

(2)由Excel的计算结果已知:

1234

,,,

ββββ对应的t 统计量分别为0.51206、4.853871、4.222811、3.663731 ,其

绝对值均大于临界值

0.025

(224) 2.101

t-=,所以各个自变量都对Y有明显影响。

由F=58.20479, 大于临界值

0.05

(41,224) 3.16

F--=,说明模型在整体上是显著的。

8.6 (1)该回归分析中样本容量是14+1=15 (2)计算RSS=66042-65965=77

ESS 的自由度为k-1=2,RSS 的自由度 n-k=15-3=12 (3)计算:可决系数 2

65965/660420.9988R == 修正的可决系数 2

151

1(10.9988)0.9986

153

R -=-

?-=- (4)检验X2和X3对Y 是否有显著影响

/(1)65965/232982

5140.11/()77/12 6.4166

ESS k F RSS n k -=

===-

(5) F 统计量远比F 临界值大,说明X2和X3联合起来对Y 有显著影响,但并不能确定X2和X3各自对Y 的贡献为多少。

8.7

8.8 (1)用Excel 输入和X 数据,生成2

X 和

3X 的数据,用Y 对X 、

2X 、3X 回归,估计参数

^

231726.737.8796468740.00895 3.7124906i i Y X X E X =-+-+-

t=(-1.9213) (2.462897) (-2.55934) (3.118062)

20.973669R = 2

0.963764R =

(2)检验参数的显著性:当取0.05α=时,查t 分布表得0.025(124) 2.306t -=,与t 统计量对比,除了截距项外,

各回归系数对应的t 统计量的绝对值均大于临界值,表明在这样的显著性水平下,回归系数显著不为0。 (3)检验整个回归方程的显著性:模型的20.973669R =,2

0.963794R =,说明可决系数较高,对样本数据拟合较好。由于F=98.60668,而当取0.05α=时,查F 分布表得0.05(41,124) 4.07F --=,因为F=98.60668>4.07,应拒绝0234:0H βββ===,说明X 、2

X 、3

X 联合起来对Y 确有显著影响。

(4)计算总成本对产量的非线性相关系数:因为2

0.973669R =因此总成本对产量的非线性相关系数为

20.973669R =或R=0.9867466

(5)评价:虽然经t 检验各个系数均是显著的,但与临界值都十分接近,说明t 检验只是勉强通过,其把握并不大。如果取0.01α=,则查t 分布表得0.005(124) 3.3554t -=,这时各个参数对应的t 统计量的绝对值均小于临界值,则在0.01α=的显著性水平下都应接受0:0j H β=的原假设。 8.9 利用Excel 输入X 、y 和Y 数据,用Y 对X 回归,估计参数结果为

i

i x Y 314.073.5?-= t 值=(9.46)(-6.515) 794.02

=R 775.02

=R

整理后得到:x

e y

314.09693.307?-?=

第9章 时间序列分析

9.1 (1)30× 31.06×2

1.05= 30×1.3131 = 39.393(万辆)

(2117.11%== (3)设按7.4%的增长速度n 年可翻一番

则有 1.07460/302n

==

所以 n = log2 / log1.074 = 9.71(年)

故能提前0.29年达到翻一番的预定目标。

9.2 (1)(1)以1987年为基期,2003年与1987年相比该地区社会商品零售额共增长: %86.2313186.213186.31%)8.61(%)2.81(%)101(555==-=-+?+?+ (2)年平均增长速度为

1%)8.61(%)2.81(%)101(15

555-+?+?+=0.0833=8.33%

(3) 2004年的社会商品零售额应为

509.52)0833.01(307=+?(亿元)

9.3 (1)发展总速度%12.259%)81(%)101(%)121(343=+?+?+

平均增长速度=%9892.91%12.25910=-

(2)8.561%)61(5002=+?(亿元)

(3)平均数∑====415.1424

57041j j y y (亿元)

, 2002年一季度的计划任务:625.1495.142%105=?(亿元)。

9.4 (1)用每股收益与年份序号回归得^

0.3650.193t Y t =+。预测下一年(第11年)的每股收益为

488.211193.0365.0?11

=?+=Y 元 (2)时间数列数据表明该公司股票收益逐年增加,趋势方程也表明平均每年增长0.193元。是一个较为适合的投资

方向。

9.5 (1)移动平均法消除季节变动计算表

(2)t T t

?+=63995.09625.8? (3

上表中,其趋势拟合为直线方程t T t

?+=63995.09625.8。

根据上表计算的季节比率,按照公式KL t t t S T Y -?=计算可得:

2004年第一季度预测值:

7723.21097301.1)1763995.09625.8(???1

1717=??+=?=S T Y 2004年第二季度预测值:

49725.23147237.1)1863995.09625.8(???2

1818=??+=?=S T Y 2004年第三季度预测值:

009.18852641.0)1963995.09625.8(???3

1919=??+=?=S T Y 2004年第四季度预测值:

6468.19902822.0)2063995.09625.8(???4

2020=??+=?=S T Y

平均法计算季节比率表:

季节比率的图形如下:

(2)

原时间序列与移动平均的趋势如下图所示:

9.7 (1)采用线性趋势方程法:t T i

0065.70607.460?+= 剔除其长期趋势。 趋势分析法剔除长期趋势表:

剔除长期趋势后分析其季节变动情况表:

(3)运用分解法可得到循环因素如下图:

第10章 统计指数

10.1 %73.1072.2039

8.2196 , %16.1042.2039212400010001==∑∑===∑∑=q p q p L p q p q L p q ;

%39.1072124

2281 , %83.1038.2196228110111011==∑∑===∑∑=q p q p P p q p q P p q

。 10.2 %99.10342364405

8.21962.203922812124==++=q E ;%99.103%83.103%16.104=?=q F ;

%00.1042

%83.103%16.104=+=q B 。

10.3 %27.93125550

117100 , %83.921018009450010111011==∑∑='==∑∑=p q p q P z q z q P q q 。

10.4 %73.1072.20398.21960

000==

∑∑=

q p q p i A p p ;%39.1072124

22811111==∑∑=p

p i q p q p H ;%01.1070000=∏=∑q p q

p p p i G 。

10.5 V P L p q =?;%86.111%39.107%16.104=? ;8.2411578.84=+。

10.6 ⑴2.43%12360=?;⑵0.24%67.6360 , %67.106%105%112=?=÷;

⑶2.19%5%67.106360=??;⑷2.432.190.24 , %112%105%67.106=+=?。

10.7 ⑴3483.220904908

, 6967.220905636 , 3816.21960466810======假定x x x

⑵3816.26967

.23483.26967.23816.23483.2=

?,%23.113%84.114%60.98=? ⑶3816

.26967

.21960209046685636?

= %23.113%63.106%74.120?= , 6.6586.309968+≈

10.8 依据有关公式列表计算各企业的工业经济效益综合指数如下:

各企业经济效益综合指数一览表(标准比值法)

10.9 依据有关公式列表计算各企业的工业经济效益综合指数如下表:

各企业经济效益综合指数一览表(改进的功效系数法)

上面两种方法给出的综合评价结果的差异表现在D 、E 两个企业的综合经济效益排名不同。原因在于两种方法的对比标准不同(以下具

体说明)。

第11章 统计决策

11.1(1)根据最大的最大收益值准则,应该选择方案一。

(2)根据最大的最小收益值准则,应该选择方案三。

(3)方案一的最大后悔值为250,方案二的最大后悔值为200,方案三的最大后悔值为300,所以根据最小的最大后悔值准则,应选择方案二。

(4)当乐观系数为0.7时,可得:方案一的期望值为220,方案二的期望值为104,方案三的期望值为85。根据折中原则,应该选择方案一。

(5)假设各种状况出现的概率相同,则三个方案的期望值分别为:116.67、93.33、83.33 按等可能性准则,应选择方案一。

11.2(1)略

(2)三个方案的期望值分别为:150万元、140万元和96万元。但方案一的变异系数为1.09,方案二的变异系数为0.80,根据期望值准则结合变异系数准则,应选择方案二。

(3)宜采用满意准则。选择方案二。

(4) 宜采用满意准则。选择方案三。

11.3 钥匙留在车内为A,汽车被盗为E。

P(A/E)=(0.2*0.05)/ (0.02*0.05+0.8*0.01)= 55.56%。

11.4 (1)买到传动装置有问题的车的概率是30%。

(2)修理工判断车子有问题为B1,,车子真正有问题为A1,

P(A1/B1)=(0.3*0.9)/(0.3*0.9+0.7*0.2)= 66%

(3)修理工判断车子没有问题为B2,车子真正有问题为A1

P(A1/B2)=(0.3*0.1)/(0.3*0.1 +0.7*0.8)= 5%

11.5 决策树图略。

(1)生产该品种的期望收益值为41.5万元大于不生产的期望值,根据现有信息可生产。

(2)自行调查得出受欢迎结论的概率=0.65*0.7+0.35*0.30=0.56,

此时,市场真实欢迎的概率=0.65*0.7/(0.65*0.7+0.35*0.30)=0.8125

期望收益值=(77*0.8125 -33*0.1875)0.56+(-3*0.44) =30.25万元

(3)委托调查得出受欢迎结论的概率=0.65*0.8 +0.35*0.20=0.59

此时,市场真实受欢迎的概率= 0.65*0.8/(0.65*0.8 +0.35*0.20)=0.8814

期望收益值=(75*0.8814 -35*0.1186)0.59+(-5*0.41)=34.50万元

根据以上分析结果。由于进一步调查的可靠性不高,并要花费相应的费用,所以没有必要进一步调查。

第12章国民经济统计基础知识

12.1 生产法GDP=168760亿元;

分配法GDP=168755亿元

使用法GDP=154070亿元

国内生产净值=149755亿元(按生产法计算)

国民总收入=165575亿元(按收入法计算)

国民可支配总收入=167495亿元

国民可支配净收入=148490亿元

消费率=67.95%(按可支配总收入计算)

储蓄率=32.05%(按可支配总收入计算)

投资率=27.31%(按使用法GDP计算)

12.2 国民财富总额为:216765亿元

12.3生产法GDP增长速度为8.69%;紧缩价格指数为102.83%。

使用法GDP增长速度为8.25%。紧缩价格指数为103.25%。

社会统计学复习题(有答案)

社会统计学课程期末复习题 一、填空题(计算结果一般保留两位小数) 1、第五次人口普查南京市和上海市的人口总数之比为 比较 相对指标;某企业男女职工人数之比为 比例 相对指标;某产品的废品率为 结构 相对指标;某地区福利机构网点密度为 强度 相对指标。 2、各变量值与其算术平均数离差之和为 零 ;各变量值与其算术平均数离差的平方和为 最小值 。 3、在回归分析中,各实际观测值y 与估计值y ?的离差平方和称为 剩余 变差。 4、平均增长速度= 平均发展速度 —1(或100%)。 5、 正J 形 反J 形 曲线的特征是变量值分布的次数随变量值的增大而逐步增多; 曲线的特征是变量值分布的次数随变量值的增大而逐步减少。 6、调查宝钢、鞍钢等几家主要钢铁企业来了解我国钢铁生产的基本情况,这种调查方式属于 重点 调查。 7、要了解某市大学多媒体教学设备情况,则总体是 该市大学中的全部多媒体教学设备 ;总体单位是 该市大学中的每一套多媒体教学设备; 。 8、若某厂计划规定A 产品单位成本较上年降低6%,实际降低了7%,则A 产品单位成本计划超额完成程度为 100%7% A 100% 1.06%100%6% -=-=-产品单位成本计划超额完成程度 ;若某厂计划规定B 产品产量较上年增长5%,实际增长了10%,则B 产品产量计划超额完成程度为 100%10% 100% 4.76%100%5% +=-=+B 产品产量计划超额完成程度 。 9、按照标志表现划分,学生的民族、性别、籍贯属于 品质 标志;学生的体重、年龄、成绩属于 数量 标志。 10、从内容上看,统计表由 主词 和 宾词 两个部分组成;从格式上看,统计表由 总标题 、 横行标题 、 纵栏标题 和 指标数值(或统计数值); 四个部分组成。 11、从变量间的变化方向来看,企业广告费支出与销售额的相关关系,单位产品成本与单位产品原材料消耗量的相关关系属于 正 相关;而市场价格与消费者需求数量的相关关系,单位产品成本与产品产量的相关关系属于 负 相关。 12、按指标所反映的数量性质不同划分,国民生产总值属于 数量 指标;单位成本属于 质量 指标。 13、如果相关系数r=0,则表明两个变量之间 不存在线性相关关系 。 二、判断题

统计学第一章习题答案

1、指出下面的变量中哪一个属于分类变量(D) A、年龄 B、工资 C、汽车产量 D、购买商品时的支付方式(现金、信用卡、支票) 2、指出下列的变量中哪一个属于顺序变量(C) A、企业的销售收入 B、员工的工资 C、员工对企业某项改革措施的态度(赞成、中立、反对) D、汽车产量 3、指出下面的变量中哪一个属于数值型变量(A) A、生活费指出 B、产品的等级 C、企业类型 D、员工对企业某项改革措施的态度 4、某研究部门准备在全市200万个家庭中抽取2000个家庭,以推断该城市所有职工家庭的 年人均收入。这项研究总体是(B) A、2000个家庭 B、200万个家庭 C、2000个家庭的人均收入 D、200万个家庭的人均收入 5、某研究部门准备在全市200万个家庭中抽取2000个家庭,以推断该城市所有职工家庭的 年人均收入。这项研究的样本是(A) A、2000个家庭 B、200万个家庭 C、2000个家庭的人均收入 D、200万个家庭的人均收入 6、一家研究机构从IT从业者中随机抽取500人作为样本进行调查,其中60%回答他们的月收入在5000元以上,50%的人回答他们的消费支付方式是用信用卡。这里的总体是(A)A、IT业的全部从业者B、IT业的500个从业者 C、IT从业者的总收入 D、IT从业者的消费支付方式 7、一家研究机构从IT从业者中随机抽取500人作为样本进行调查,其中60%回答他们的月收入在5000元以上,50%的人回答他们的消费支付方式是用信用卡。这里的“消费支付方 式”是(A) A、分类变量 B、顺序变量 C、数值型变量 D、连续变量 8、一家研究机构从IT从业者中随机抽取500人作为样本进行调查,其中60%回答他们的月收入在5000元以上,50%的人回答他们的消费支付方式是用信用卡。这里的“月收入”是 (C) A、分类变量 B、顺序变量 C、数值型变量 D、离散变量 9、一项调查表明,在所抽取的1000个消费者中,他们每月在网上购物的平均花费是200元,他们选择在网上购物的主要原因是“价格便宜”。这里的总体是(D) A、1000个消费者 B、所有在网上购物的消费者 C、所有在网上购物的消费者的总花费 D、1000个消费者的平均花费 10、下列不属于描述统计问题的是(A) A、根据样本信息对总体进行的推断 B、了解数据分布的特征

统计学(第三版课后习题答案

Hah 和网速是无形的 1:各章练习题答案 2.1 (1)属于顺序数据。 (2)频数分布表如下: 服务质量等级评价的频数分布 服务质量等级家庭数(频率)频率% A1414 B2121 C3232 D1818 E1515 合计100100 (3)条形图(略) 2.2 (1)频数分布表如下: 40个企业按产品销售收入分组表 按销售收入分组(万元)企业数 (个) 频率 (%) 向上累积向下累积 企业数频率企业数频率 100以下100~110 110~120 120~130 130~140 140以上 5 9 12 7 4 3 12.5 22.5 30.0 17.5 10.0 7.5 5 14 26 33 37 40 12.5 35.0 65.0 82.5 92.5 100.0 40 35 26 14 7 3 100.0 87.5 65.0 35.0 17.5 7.5 合计40 100.0 ————(2)某管理局下属40个企分组表 按销售收入分组(万元)企业数(个)频率(%) 先进企业良好企业一般企业落后企业11 11 9 9 27.5 27.5 22.5 22.5 合计40 100.0

2.3 频数分布表如下: 某百货公司日商品销售额分组表 按销售额分组(万元)频数(天)频率(%) 25~30 30~35 35~40 40~45 45~50 4 6 15 9 6 10.0 15.0 37.5 22.5 15.0 合计40 100.0 直方图(略)。 2.4 (1)排序略。 (2)频数分布表如下: 100只灯泡使用寿命非频数分布 按使用寿命分组(小时)灯泡个数(只)频率(%) 650~660 2 2 660~670 5 5 670~680 6 6 680~690 14 14 690~700 26 26 700~710 18 18 710~720 13 13 720~730 10 10 730~740 3 3 740~750 3 3 合计100 100 直方图(略)。 (3)茎叶图如下: 65 1 8 66 1 4 5 6 8 67 1 3 4 6 7 9 68 1 1 2 3 3 3 4 5 5 5 8 8 9 9 69 0 0 1 1 1 1 2 2 2 3 3 4 4 5 5 6 6 6 7 7 8 8 8 8 9 9 70 0 0 1 1 2 2 3 4 5 6 6 6 7 7 8 8 8 9 71 0 0 2 2 3 3 5 6 7 7 8 8 9 72 0 1 2 2 5 6 7 8 9 9 73 3 5 6 74 1 4 7

统计学各章节课后习题答案

统计学各章练习题答案第1章绪论(略) 第2章统计数据的描述 2.1 (1)属于顺序数据。 (2)频数分布表如下: 服务质量等级评价的频数分布 服务质量等级家庭数(频率)频率% A1414 B2121 C3232 D1818 E1515 合计100100 (3)条形图(略) 2.2 (1)频数分布表如下: (2)某管理局下属40个企分组表 按销售收入分组(万元)企业数(个)频率(%) 先进企业良好企业一般企业落后企业11 11 9 9 27.5 27.5 22.5 22.5 合计40 100.0 2.3 频数分布表如下: 某百货公司日商品销售额分组表 按销售额分组(万元)频数(天)频率(%) 25~30 30~35 35~40 40~45 45~50 4 6 15 9 6 10.0 15.0 37.5 22.5 15.0 合计40 100.0 直方图(略)。

2.4 (1)排序略。 (2)频数分布表如下: 100只灯泡使用寿命非频数分布 按使用寿命分组(小时)灯泡个数(只)频率(%)650~660 2 2 660~670 5 5 670~680 6 6 680~690 14 14 690~700 26 26 700~710 18 18 710~720 13 13 720~730 10 10 730~740 3 3 740~750 3 3 合计100 100 直方图(略)。 2.5 (1)属于数值型数据。 (2)分组结果如下: 分组天数(天) -25~-20 6 -20~-15 8 -15~-10 10 -10~-5 13 -5~0 12 0~5 4 5~10 7 合计60 (3)直方图(略)。 2.6 (1)直方图(略)。 (2)自学考试人员年龄的分布为右偏。 2.7 (1

心理和教育统计学课后题答案解析

张厚粲现代心理与教育统计学第一章答案 1名词概念 (1 )随机变量 答:在统计学上把取值之前,不能准确预料取到什么值的变量,称为随机变量。 (2)总体 答:总体(population )又称为母全体或全域,是具有某种特征的一类事物的总体,是研究对象的全体。 (3)样本 答:样本是从总体中抽取的一部分个体。 (4)个体 答:构成总体的每个基本单元。 (5)次数 是指某一事件在某一类别中出现的数目,又称作频数,用f表示。 (6)频率 答:又称相对次数,即某一事件发生的次数除以总的事件数目,通常用比例或百分数来表示。 (7)概率 答:概率(probability), 概率论术语,指随机事件发生的可能性大小度量指标。其描述性定义。随机事件A在所有试验中发生的可能性大小的量值,称为事件A的概率,记为P(A)。 (8)统计量 答:样本的特征值叫做统计量,又称作特征值。 (9)参数 答:又称总体参数,是描述一个总体情况的统计指标。 (10)观测值 答:随机变量的取值,一个随机变量可以有多个观测值。 2何谓心理与教育统计学?学习它有何意义? 答:(1)心理与教育统计学是专门研究如何运用统计学原理和方法,搜集、整理、分析心理 与教育科学研究中获得的随机性数据资料,并根据这些数据资料传递的信息,进行科学推论 找出心理与教育统计活动规律的一门学科。具体讲,就是在心理与教育研究中,通过调查、实验、测量等手段有意地获取一些数据,并将得到的数据按统计学原理和步骤加以整理、计 算、绘制图表、分析、判断、推理,最后得出结论的一种研究方法。 (2)学习心理与教育统计学有重要的意义。 ①统计学为科学研究提供了一种科学方法。 科学是一种知识体系。它的研究对象存在于现实世界各个领域的客观事实之中。它的主 要任务是对客观事实进行预测和分类,从而揭示蕴藏于其中的种种因果关系。要提高对客观 事实观测及分析研究的能力,就必须运用科学的方法。统计学正是提供了这样一种科学方法。统计方法是从事科学研究的一种必不可少的工具。 ②心理与教育统计学是心理与教育科研定量分析的重要工具。 凡是客观存在事物,都有数量的表现。凡是有数量表现的事物,都可以进行测量。心理 与教育现象是一种客观存在的事物,它也有数量的表现。虽然心理与教育测量具有多变性而 且旨起它发生变化的因素很多,难以准确测量。但是它毕竟还是可以测量的。因此,在进行 心理与教育科学研究时,在一定条件下,是可以对心理与教育现象进行定量分析的。心理与 教育统计就是对心理与教育问题进行定量分析的重要的科学工具。 ③广大心理与教育工作者学习心理与教育统计学的具体意义。 a. 可经顺利阅读国内外先进的研究成果。 b. 可以提高心理与教育工作的科学性和效率。

统计学第一章绪论习题

第一章绪论 练习题 一、填空题 1.政治算术派产生于世纪资本主义的英国,代表人物是,代表作是。 2.国势学派产生于世纪的德国,创始人是。 3.数理统计学派的创始人是比利时学者。 4.按照统计方法的类型,可将统计学分为和。 5.总体是由许多具有的个别事物组成的整体;总体单位是的组成单位。 6.统计总体具有四个基本特征,即,,和。 7.标志是说明总体单位特征的名称,按表现形式不同分为和两种。 8.统计指标按其所说明的总体现象内容的不同,可分为和。 9.指标与标志的主要区别在于:(1)指标是说明特征的,而标志则是说明特征的;(2)标志有不能用表示的与能用表示的,而指标都是能用的。 10.一个完整的统计工作过程可以划分为、、、四个阶段。 11.样本是从中抽出来,作为代表的部分单位组成的集合体。 12.推断统计学研究的是如何根据去推断的方法。 13.统计学自身的发展,沿着两个不同的方向,形成和。 14.数学研究的是数量规律,而统计学则是研究、数量规律。 15.统计指标是说明客观现象总体数量特征的和的统一体。 16.理论统计学是以为中心建立统计方法体系,而应用统计学是以为中心应用统计方法分析和解决实际问题。 二、单项选择题 1.统计总体的同质性是指( ) A总体各单位具有某一共同的品质标志或数量标志 B总体各单位具有某一共同的品质标志属性或数量标志值 C总体各单位具有若干互不相同的品质标志或数量标志 D总体各单位具有若干互不相同的品质标志属性或数量标志值 2.设某地区有800家独立核算的工业企业,要研究这些企业的产品生产情况,总体单位是( ) A该全部工业企业 B 这800家工业企业 C每一件产品 D 800家工业企业的全部工业产品生产情况 3.要了解全国的人口情况,总体单位是( ) A每个省的人 B每一户 C全国总人口 D全国的每一个人 4.有200家公司每位员工的工资资料,如果要调查这200家公司的工资水平情况,则统计总体为( ) A 这200家公司的全部员工 B 这200家公司 C 这200家公司职工的全部工资 D 这200家公司每个职工的工资 5.要了解某班50个学生的学习情况,则总体单位是( ) A该班全体学生 B 该班全体学生的学习成绩 C该班的每一个学生 D该班每一个学生的学习成绩 6.设某地区有60家生产皮鞋的企业,要研究它们的产品生产情况,不能成为指标是( ) A所有企业 B企业数

统计学课后习题和答案

第一章 1*.下面的列联表是根据一个小城市的居民教育水平(以获得了高中文凭和没有获得高中文凭分类)和就业状况(以全职和非全职分类)所做出 如果原假设即在教育水平和工作状态之间没有联系为真,那么下列哪一个选项表明了获得了高中文凭并且是全职工作的期望值? A. 9252157g B. 9282157g C.528292g D. 655292g E. 9252 82 g 1*. Answer :B Analysis :本题考查二维表中两个变量的独立性,如果原假设独立成立,那么cell “earned at least a high school diploma ”和“ employed full time ”的期望值为: 92829282 (,)()()157157157157 P Earned Employed Total P Earned P Employed Total == = g g g g g g 2*.一次实验中,每一个随机样本中的成人都有他的最喜爱的颜色,下表展示了按年龄分组 的试验结果。 如果对于颜色的偏好是同年龄组相互独立,下列哪一个选项表明了年龄组30到50岁,喜爱 绿色的人数的期望值? A. (99)(108)314 B. (69)(108)314 C. (99)(35)108 D. (35)(108)314 E. (99)(35) 314 2*. Answer :A Analysis :本题考查二维表中两个变量的独立性,如果两个变量独立,那么cell “aged 30 to 50”和“prefer green ”的期望值为: 1089999108 (3050,)(3050)()314314314314 P green Total P P green Total -=-= = g g g g g g 第二章 1*.下面的直方图代表了五种不同的数据集的分布,每个都包含28个整数,从1到7,水平和垂直比例对所有图形都是相同的。下面哪个图代表了有最大标准差的数据集?

统计学1-3章练习题参考答案

第一章统计总论 一、单项选择题 1.属于统计总体的是() A.某县的粮食总产量 B.某地区的全部企业 C.某商店的全部商品销售额 D.某单位的全部职工人数 B 2.构成统计总体的个别事物称为()。 A.调查单位 B.标志值 C.品质标志 D.总体单位 D 3.对某城市工业企业未安装设备进行普查,总体单位是()。 A.工业企业全部未安装设备 B.工业企业每一台未安装设备 C.每个工业企业的未安装设备 D.每一个工业企业 B 4.工业企业的设备台数、产品产值是()。 A.连续变量 B.离散变量 C.前者是连续变量,后者是离散变量 D.前者是离散变量,后者是连续变量 D 5.在全国人口普查中()。 A.男性是品质标志 B.人的年龄是变量 C.人口的平均寿命是数量标志 D.全国人口是统计指标 B 6.总体的变异性是指()。 A.总体之间有差异 B.总体单位之间在某一标志表现上有差异 C.总体随时间变化而变化 D.总体单位之间有差异 B 7.几位学生的某门课成绩分别是67分、78分、88分、89分、96分,“学生成绩”是()。 A.品质标志 B.数量标志 C.标志值 D.数量指标 B 8.某年级学生四门功课的最高考分分别是98分、86分、88分和95,这四个数字是() A.指标 B.标志 C.变量 D.标志值 D 9.下列指标中属于质量指标的是()。 A.社会总产值 B.产品合格率 C.产品总成本 D.人口总数 B 10.下列属于质量指标的是() A.产品的产量 B.产品的出口额 C.产品的合格品数量 D.产品的评价 D

11.下列属于离散型变量的是() A.职工的工资 B.商品的价格 C.粮食的亩产量 D.汽车的产量 D 12.标志的具体表现是指() A.标志名称之后所列示的属性或数值 B.如性别 C.标志名称之后所列示的属性 D.标志名称之后所列示的数值 A 13.社会经济统计的研究对象是()。 A.抽象的数量特征和数量关系 B.社会经济现象的规律性 C.社会经济现象的数量特征和数量关系 D.、社会经济统计认识过程的规律和方法 C 14.统计指标按所反映的数量特点不同可以分为数量指标和质量指标两种。其中数量指标的表现形式是()。 A.绝对数 B.相对数 C.平均数 D.百分数 A 15.以产品的等级来衡量某种产品的质量好坏,则该产品“等级”是() A.数量标注 B. 品质标志 C. 数量指标 D. 质量指标 B 16.设某地区有670家工业企业,要研究这些企业的产品生产情况,总体单位是() A.每个工业企业; B.670家工业企业; C.每一件产品; D.全部工业产品 C 17.某机床厂要统计该企业的自动机床的产量和产值,上述两个变量是()。 A.二者均为离散变量 B.二者均为连续变量 C.前者为连续变量,后者为离散变量 D.前者为离散变量,后者为连续变量 D 18.下列哪个是连续型变量() A. 工厂数 B. 人数 C. 净产值 D.设备台数 C 19.设某地区有670家工业企业,要研究这些企业的产品生产情况,总体单位是() A.每个工业企业; B.670家工业企业; C.每一件产品; D.全部工业产品 C 20.统计工作过程不包括()。 A.统计调查 B.统计分布 C.统计整理 D.统计分析 B 二、多项选择题 1.统计一词的含义是()

教育统计学与SPSS课后作业答案祥解题目

教育统计学课后作业 一、P118 1 题目:10位大一学生平均每周所花的学习时间与他们的期末考试成绩见表6-17.试问: (1)学习时间与考试成绩之间是否相关? (2)比较两组数据谁的差异程度大一些? (3)比较学生2与学生9的期末考试测验成绩。 表6-17 学习时间与期末考试成绩 1 2 3 4 5 6 7 8 9 10 学习时间考试成绩40 58 43 73 18 56 10 47 25 58 33 54 27 45 17 32 30 68 47 69 解题步骤: (1)第一步:定义变量:“xuexishijian”、“xuexichengji”后,输入数据.如下图: 1

第二步:单击选择“分析(Analyze)”中的“相关(Correlate)”中的“双变量(Bivariate Correlations)”, 将上图中的“xuexishijian”和“xuexichengji”添加到右边变量框中,如下图: 第三步:点击“确定“后,输出结果如下图: 第四步:分析结果

3 由上图可知:学习时间与学习成绩之间的pearson 相关系数为0.714,p (双侧)为0.20。自由度 df=10-2=8时,查“皮尔逊积差相关系数显著临界值表”知:r 0.05= 0.623 ; r 0.01=0.765。 因为0.765 > 0.714 >0.623,所以在0.05水平上学习时间和学习成绩是相关显著的。 (2)SPSS 软件分析结果如下图: 由上图可知:学习时间标准差和平均值为:S 1=12.037 ?X 1= 29.00 ;学习时间标准差和平均值为:S 2=12.437?X 2=56.00 根据差异系数公式可知: 学习时间差异系数为:%100?=X S CV S =12.037/29.00×100%=41.51% 学习成绩差异系数为:%100?= X S CV S =12.437/56.00×100%=22.27% 有上述结果可知学习时间差异程度大于学习成绩差异程度。 (4) 把学生2和学生9的期末考试成绩转化成标准分数: Z 2=(X -?X) /S= (73—56)/12.437=1.367 Z 9=(X-?X)/S=(68—56)/12.437=0.965 由上计算可知:学生2期末考试测验成绩优于学生9的期末考试测验成绩。 二、P119 2 题目:某班数学的平均成绩为90,标准差10;化学的平均分为85,标准差为8;物理的平均分为79,标准差为15.某生这三科成绩分别为95,80,80.试问 (1) 该生在哪一学科上突出一些? (2) 该班三科成绩的差异度如何?有无学习分化现象? (3) 该生的学期分数是多少? (4) 三科的总平均和总标准差是多少? 解题步骤:

社会统计学习题和答案--相关与回归分析报告

第十二章 相关与回归分析 第一节 变量之间的相关关系 相关程度与方向·因果关系与对称关系 第二节 定类变量的相关 双变量交互分类(列联表)·削减误差比例(PRE )·λ系数与τ系数 第三节 定序变量的相关分析 同序对、异序对和同分对·Gamma 系数·肯德尔等级相关系数(τa 系数、τb 与τc 系数)·萨默斯系数(d 系数)·斯皮尔曼等级相关(ρ相关)·肯德尔和谐系数 第四节 定距变量的相关分析 相关表和相关图·积差系数的导出和计算·积差系数的性质 第五节 回归分析 线性回归·积差系数的PRE 性质·相关指数R 第六节 曲线相关与回归 可线性化的非线性函数·实例分析(二次曲线指数曲线) 一、填空 1.对于表现为因果关系的相关关系来说,自变量一般都是确定性变量,依变量则一般是( 随机性 )变量。 2.变量间的相关程度,可以用不知Y 与X 有关系时预测Y 的全部误差E 1,减去知道Y 与X 有关系时预测Y 的联系误差E 2,再将其化为比例来度量,这就是( 削减误差比例 )。 3.依据数理统计原理,在样本容量较大的情况下,可以作出以下两个假定:(1)实际观察值Y 围绕每个估计值c Y 是服从( );(2)分布中围绕每个可能的c Y 值的( )是相同的。 4.在数量上表现为现象依存关系的两个变量,通常称为自变量和因变量。自变量是作为( 变化根据 )的变量,因变量是随( 自变量 )的变化而发生相应变化的变量。 5.根据资料,分析现象之间是否存在相关关系,其表现形式或类型如何,并对具有相关关系的现象之间数量变化的议案关系进行测定,即建立一个相关的数学表达式,称为( 回归方程 ),并据以进行估计和预测。这种分析方法,通常又称为( 回归分析 )。 6.积差系数r 是( 协方差 )与X 和Y 的标准差的乘积之比。 二、单项选择 1.当x 按一定数额增加时,y 也近似地按一定数额随之增加,那么可以说x 与y 之间 存在( A )关系。 A 直线正相关 B 直线负相关 C 曲线正相关 D 曲线负相关

统计学第一章练习题19785

第一题:单项选择题 1.同质性、大量性、差异性() A只有有限总体具有 B只有无限总体具有 C有限总体和无限总体都具有 D有限总体和无限总体都不具有 2.”统计”的基本含义是() A统计调查、统计整理、统计分析 B统计分析、统计推断、统计描述 C统计工作、统计资料、统计学 D统计分组、统计指标、统计分析 3.研究生招生目录中,201为英语、202为俄语、203为日语。这里语种属于() A定类数据 B定序数据 C定距数据 D定比数据 4.电视观众对收费频道是否应该插入广告的态度为不应该、应该、无所谓。这里“不应该、应该、无所谓”是() A定类数据 B定序数据 C定距数据 D定比数据 5.学生的智商等级是() A定类数据 B定序数据 C定距数据 D定比数据 6.下列表述正确的是() A定序数据包含定类数据和定距数据的全部数据 B定类数据包含定序数据的全部信息 C定序数据与定类数据是平行的 D定比数据包含了定类数据、定序数据和定距数据的全部信息 7.用部分数据去估计总体数据的理论和方法,属于() A理论统计学 B应用统计学 C描述统计学 D推断统计学 8.了解学生的学习情况,要调查足够多的学生,这个方法称为() A大量观察法 B统计分组法 C综合指标法 D相关分析法 9.了解居民的消费支出情况,则() A所有居民的消费支出额是总体单位 B所有居民是总体 C某个居民的消费支出额是总体

D所有居民是总体单位 10.统计学的数量性特点表现在它是() A一种纯数量的研究 B利用大量的数字资料建立数学模型 C在质与量的联系中来研究现象总体的数量特征 D以数学公式为基础的定量研究 11.统计学的总体性特点是指() A研究现象各个个体的数量特征 B研究由大量个别事物构成的现象整体的数量特征 C从认识总体入手开始研究现象的数量特征 D从现象量的研究开始来认识现象的性质和规律 12.统计研究中的大量观察法是指() A一种具体的调查研究方法 B对总体中的所有个体进行观察和研究的方法 C收集大量总体资料的方法 D要认识总体的数量特征就必须对全部或足够多个体进行观察和研究13.对全市工业企业职工的生活状况进行调查,调查对象是() A该市全部工业企业 B该市全部工业企业的职工 C该市每一个工业企业 D该市工业企业的每一个职业 14.某年全国汽车总产量是() A随机变量 B连续变量 C离散变量 D任意变量 15.要反映我国工业企业的整体业绩水平,总体单位是() A我国每一家工业企业 B我国所有工业企业 C我国工业企业总数 D我国工业企业的利润总额16.统计总体的特点是() A同质性、大量性、可比性 B同质性、大量性、差异性 C数量性、总体性、差异性 D数量性、综合性、同质性 第二题:多项选择题

统计学课后第一章习题答案.doc

第1章导论 1、某森林公园的一项研究试图确定哪些因素有利于成年松树长到60英尺以上的高度。经估计,森林公园生长着25000颗成年松树,该研究需要从中随机抽取250颗成年松树并丈量它们的高度后进行分析。该研究的总体是() A、250颗成年松树 B、公园中25000颗成年松树 C、所有高于60英尺的成年松树 D、森林公园中所有年龄的松树 2、某森林公园的一项研究试图确定成年松树的高度。该研究需要从中随机抽取250颗成年松树并丈量它们的高度后进行分析。该研究所感兴趣的变量是() A、森林公园中松树的年龄 B、森林公园中松树的数量 C、森林公园中松树的高度 D、森林公园中数目的种类 3、推断统计的主要功能是() A、应用总体的信息描述样本 B、描述样本中包含的信息 C、描述总体中包含的信息 D、应用样本信息描述总体 4、对高中生的一项抽样调查表明,85%的高中生愿意接受大学教育。这一叙述是()的结果 A、定性变量 B、试验 C、描述统计 D、推断统计 5、一名统计学专业的学生为了完成其统计学作业,在图书馆找到一本参考书中包含美国50个州的家庭收入中位数。在该生的作业中,他应该将此数据报告来源于() A、试验 B、实际观察 C、随机抽样 D、已发表的资料

6、某大公司的人力资源部主任需要研究公司雇员的饮食习惯。他注意到,雇员的午饭要么从家里带来,要么在公司餐厅就餐,要么在外面的餐馆就餐。该研究的目的是为了改善公司餐厅的现状。这种数据的收集方式可以认为是() A、观察研究 B、设计的试验 C、随机抽样 D、全面调查 7、下列不属于描述统计问题的是() A、根据样本信息对总体进行的推断 B、感兴趣的总体或样本 C、图、表或其他数据汇总工具 D、了解数据分布特征 8、某大学的一位研究人员希望估计该大学一年级新生在教科书上的花费,为此,他观察了200名新生在教科书上的花费,发现他们每个学期平均在教科书上的花费是250元。该研究人员感兴趣的总体是() A、该大学的所有学生 B、所有的大学生 C、该大学所有的一年级新生 D、样本中的200名新生 9、某大学的一位研究人员希望估计该大学一年级新生在教科书上的花费,为此,他观察了200名新生在教科书上的花费,发现他们每个学期平均在教科书上的花费是250元。该研究人员感兴趣的变量是()A、该大学一年级新生的教科书费用 B、该大学的学生数 C、该大学新生的年龄 D、大学生的生活成本 10、在下列叙述中,关于推断统计的描述是() A、一个饼图描述了某医院治疗过的癌症类型,其中2%是肾癌,19%是乳腺癌; B、.从一个果园中采摘36个橘子,利用这36个橘子的平均重量估计

教育统计学复习题及答案

《教育统计学》复习题及答案一、填空题 1.教育统计学的研究对象是.教育问题。 2.一般情况下,大样本是指样本容量.大于30 的样本。 3.标志是说明总体单位的名称,它有.品质标志和数量标志两种。 4.统计工作的三个基本步骤是:、和。 5.集中量数是反映一组数据的趋势的。 6.“65、66、72、83、89”这组数据的算术平均数是。 7.6位学生的身高分别为:145、135、128、145、140、130厘米,他们的众数是。 8.若某班学生数学成绩的标准差是8分,平均分是80分,其标准差系数是。 9.参数估计的方法有和两种。 10.若两个变量之间的相关系数是负数,则它们之间存在。 11.统计工作与统计资料的关系是和的关系。 12.标准差越大,说明总体平均数的代表性越,标准差越小,说明总体平均数的代表性越。 13.总量指标按其反映的内容不同可以分为和。 二、判断题 1、教育统计学属于应用统计学。()

2、标志是说明总体特征的,指标是说明总体单位特征的。() 3、统计数据的真实性是统计工作的生命() 4、汉族是一个品质标志。() 5、描述一组数据波动情况的量数称为差异量数。() 6、集中量数反映的是一组数据的集中趋势。() 7、在一个总体中,算术平均数、众数、中位数可能相等。() 8、同一总体各组的结构相对指标数值之和不一定等于100%。() 9、不重复抽样误差一定大于重复抽样误差。() 10. 一致性是用样本统计量估计统计参数时最基本的要求。() 三、选择题 1.某班学生的平均年龄为22岁,这里的22岁为( )。 A.指标值 B.标志值 C.变量值 D.数量标志值 2.统计调查中,调查标志的承担者是( )。 A.调查对象 B.调查单位 C.填报单位 D.调查表 3.统计分组的关键是( )。 A.确定组数和组距 B.抓住事物本质 C.选择分组标志和划分各组界限 D.统计表的形式设计 4.下列属于全面调查的有( )。 A.重点调查 B.典型调查 C.抽样调查 D.普查 5.统计抽样调查中,样本的取得遵循的原则是( )。 A.可靠性 B.准确性 C.及时性 D.随机性 6. 在直线回归方程Yc =a+bx中,b表示( )。 增加1个单位,y增加a的数量增加1个单位,x增加b的数量 增加1个单位,x的平均增加量增加1个单位,y的平均增加量 7.下列统计指标中,属于数量指标的有() A、工资总额 B、单位产品成本 C、合格品率 D、人口密度 8.在其他条件不变情况下,重复抽样的抽样极限误差增加1倍,则样本单位数变为( )。 A.原来的2倍 B.原来的4倍 C.原来的1/2倍 D.原来的1/4倍 四、简答题 1.学习教育统计学有哪些意义?

统计学第三章课后题及答案解析

第三章 一、单项选择题 1.统计整理的中心工作是() A.对原始资料进行审核B.编制统计表 C.统计汇总问题D.汇总资料的再审核 2.统计汇总要求资料具有() A.及时性B.正确性 C.全面性D.系统性 3.某连续变量分为五组:第一组为40—50,第二组为50—60,第三组为60—70,第四组为70—80,第五组为80以上,依习惯上规定() A.50在第一组,70在第四组B.60在第二组,80在第五组 C.70在第四组,80在第五组D.80在第四组,50在第二组 4.若数量标志的取值有限,且是为数不多的等差数值,宜编制() A.等距式分布数列B.单项式分布数列 C.开口式数列D.异距式数列 5.组距式分布数列多适用于() A.随机变量B.确定型变量 C.连续型变量D.离散型变量 6.向上累计次数表示截止到某一组为止() A.上限以下的累计次数B.下限以上的累计次数 C.各组分布的次数D.各组分布的频率 7.次数分布有朝数量大的一边偏尾,曲线高峰偏向数量小的方向,该分布曲线属于()A.正态分布曲线B.J型分布曲线 C.右偏分布曲线D.左偏分布曲线 8.划分连续变量的组限时,相临组的组限一般要() A.交叉B.不等 C.重叠D.间断 二、多项选择题 1.统计整理的基本内容主要包括() A.统计分组B.逻辑检查 C.数据录入D.统计汇总 E.制表打印 2.影响组距数列分布的要素有() A.组类B.组限 C.组距D.组中值 E.组数据 3.常见的频率分布类型主要有() A.钟型分布B.χ型分布 C.U型分布D.J型分布 E.F型分布 4.根据分组标志不同,分组数列可以分为() A.组距数列B.品质数列 C.单项数列D.变量数列 E.开口数列 5.下列变量一般是钟型分布的有()

《管理统计学》习题及标准答案

《管理统计学》作业集习题集及答案 第一章导论 *1-1 对50名职工的工资收入情况进行调查,则总体单位是(单选)( 3 )(1)50名职工(2)50名职工的工资总额 (3)每一名职工(4)每一名职工的工资 *1-2 一个统计总体(单选)( 4 ) (1)只能有一个标志(2)只能有一个指标 (3)可以有多个标志(4)可以有多个指标 *1-3 某班学生数学考试成绩分别为65分、71分、80分和87分,这四个数字是(单选)( 4 ) (1)指标(2)标志(3)变量(4)标志值 第二章统计数据的调查与收集 *2-1 非全面调查包括(多项选择题)(12 4 ) (1)重点调查(2)抽样调查(3)快速普查 (4)典型调查(5)统计年报 *2-2 统计调查按搜集资料的方法不同,可以分为(多项选择题)( 12 3 ) (1)采访法(2)抽样调查法(3)直接观察法 (4)典型调查法(5)报告法 *2-3 某市进行工业企业生产设备状况普查,要求在7月1日至7月5日全部调查完毕。则规定的这一时间是(单项选择题)(2) (1) 调查时间(2) 调查期限(3) 标准时间(4) 登记期限 *2-4 某城市拟对占全市储蓄额五分之四的几个大储蓄所进行调查,以了解全市储蓄的一般情况,则这种调查方式是(单项选择题)(4) (1) 普查(2) 典型调查(3) 抽样调查(4) 重点调查 *2-5 下列判断中,不正确的有(多项选择题)(23 4 ) (1)重点调查是一种非全面调查,既可用于经常性调查,也可用于一次性调查; (2)抽样调查是非全面调查中最科学的方法,因此它适用于完成任何调查任务; (3)在非全面调查中,抽样调查最重要,重点调查次之,典型调查最不重要; (4)如果典型调查的目的是为了近似地估计总体的数值,则可以选择若干中等的典型单位进行调查; (5)普查是取得全面统计资料的主要调查方法。 *2-6 下列属于品质标志的是(单项选择题)( 2 ) (1)工人年龄(2)工人性别(3)工人体重(4)工人工资 *2-7 下列标志中,属于数量标志的有(多项选择题)(3) (1)性别(2)工种(3)工资(4)民族(5)年龄 *2-8 下列指标中属于质量指标的有(多项选择题)(13 4 ) (1)劳动生产率(2)废品量(3)单位产品成本 (1)资金利润率(5)上缴税利额 第三章统计数据的整理 *3-1 区分下列几组基本概念: (1)频数和频率;

教育统计学课后练习参考答案

教育统计学课后练习参考答案 第一章 1、教育统计学,就是应用数理统计学的一般原理和方法,对教育调查和教育实验等途径所获得的数据资料进行整理、分析,并以此为依据,进行科学推断,从而揭示蕴含在教育现象中的客观规律的一门科学。 教育统计学既是统计科学中的一个分支学科,又是教育科学中的一个分支学科,是两种科学相互结合、相互渗透而形成的一门交叉学科。从学科体系来看,教育统计学属于教育科学体系的一个方法论分支;从学科性质来看,教育统计学又属于统计学的一个应用分支。 2、描述统计主要是通过对数据资料进行整理,计算出简单明白的统计量数来描述庞大的资料,以显示其分布特征的统计方法。 推断统计又叫分析统计,它根据统计学的原理和方法,从我们所研究的全体对象(即总体)中,按照等可能性原则采取随机抽样的方法,抽出总体中具有代表性的部分个体组成样本,在样本所提供的数据的基础上,运用概率理论进行分析、论证,在一定可靠程度上对总体的情况进行科学推断的一种统计方法。 3、在自然界或教育研究中,一种事物常存在几种可能出现的情况或获得几种可能的结果,这类现象称为随机现象。 随机现象具的特点: (1)一次条件完全相同的实验有多种可能的结果(这样的实验称为随机实验); (2)在实验之前不能确切知道哪种结果会发生; (3)在相同的条件下可以重复进行这样的实验。 4、总体,也叫做母体或全域,是指具有某种共同特征的个体的总和。 当所研究的总体数量非常大时,可以从总体中抽取其中一部分个体来观测,由此来推断总体的信息,从总体中抽出的这部分个体就称为样本,它是用以表征总体的个体的集合。 通常将样本中样本个数大于或等于30个的样本称为大样本,小于30个的称为小样本。 5、复置抽样指每次抽出的个体经观测后,仍放回原总体,然后再从总体中抽取下一个个体。 6、反映总体特征的量数叫做总体参数,简称参数。反映样本特征的量数叫做样本统计量,简称统计量。 参数是总体的真正数值,是固定的常量,理论上应该通过计算总体中全部个体的数值而获得,但由于总体中个体的数量通常很大,总体参数往往很难获得,在统计分析中一般通过样本的数值来估计。在进行推断统计时,就是根据样本统计量来推断总体相应的参数。 第二章 1、按照数据的来源,可分为计数数据和度量数据;按照数据的取值情况,可分为间断性数据和连续性数据;按照数据的测量水平,可分为称名数据、顺序数据、等距数据和比率数据。 2、数据整理的基本方法包括对数据进行排序、统计分组、绘制统计图表等。 3、表的结构要简洁明了;表的层次要清晰;主谓分明。 4、连续性数据:(2),(3);间断性数据:(1),(4)。 5、略 6、(1)50;(2)75;(3)34;(4)5;(5)45

社会统计学复习题有答案

社会统计学复习题有答 案 集团标准化工作小组 #Q8QGGQT-GX8G08Q8-GNQGJ8-MHHGN#

社会统计学课程期末复习题 一、填空题(计算结果一般保留两位小数) 1、第五次人口普查南京市和上海市的人口总数之比为 比较 相对指标;某企业男女职工人数之比为 比例 相对指标;某产品的废品率为 结构 相对指标;某地区福利机构网点密度为 强度 相对指标。 2、各变量值与其算术平均数离差之和为 零 ;各变量值与其算术平均数离差的平方和为 最小值 。 3、在回归分析中,各实际观测值y 与估计值y ?的离差平方和称为 剩余 变差。 4、平均增长速度= 平均发展速度 —1(或100%)。 5、 正J 形 反J 形 曲线的特征是变量值分布的次数随变量值的增大而逐步增多; 曲线的特征是变量值分布的次数随变量值的增大而逐步减少。 6、调查宝钢、鞍钢等几家主要钢铁企业来了解我国钢铁生产的基本情况,这种调查方式属于 重点 调查。 7、要了解某市大学多媒体教学设备情况,则总体是 该市大学中的全部多媒体教学设备 ;总体单位是 该市大学中的每一套多媒体教学设备; 。 8、若某厂计划规定A 产品单位成本较上年降低6%,实际降低了7%,则A 产品单位成本计划超额完成程度为 100%7% A 100% 1.06%100%6% -=- =-产品单位成本计划超额完成程度 ;若某厂计划规定B 产品产量较上年增长5%,实际增长了10%,则B 产品产量计划超额完成程度为 100%10% 100% 4.76%100%5% += -=+B 产品产量计划超额完成程度 。

9、按照标志表现划分,学生的民族、性别、籍贯属于品质标志;学生的体重、年龄、成绩属于数量标志。 10、从内容上看,统计表由主词和宾词两个部分组成;从格式上看,统计表由 总标题、横行标题、纵栏标题和指标数值(或统计数值); 四个部分组成。 11、从变量间的变化方向来看,企业广告费支出与销售额的相关关系,单位产品成本与单位产品原材料消耗量的相关关系属于正相关;而市场价格与消费者需求数量的相关关系,单位产品成本与产品产量的相关关系属于负相关。 12、按指标所反映的数量性质不同划分,国民生产总值属于数量指标;单位成本属于质量指标。 13、如果相关系数r=0,则表明两个变量之间不存在线性相关关系。 二、判断题 1、在季节变动分析中,若季节比率大于100%,说明现象处在淡季;若季节比率小于100%,说明现象处在旺季。(×;答案提示:在季节变动分析中,若季节比率大于100%,说明现象处在旺季;若季节比率小于100%,说明现象处在淡季。 ) 2、工业产值属于离散变量;设备数量属于连续变量。(×;答案提示:工业产值属于连续变量;设备数量属于离散变量) 3、中位数与众数不容易受到原始数据中极值的影响。(√;) 4、有意识地选择十个具有代表性的城市调查居民消费情况,这种调查方式属于典型调查。(√)

统计学贾俊平第五版课后习题答案完整版

亲爱的,一章一章来,肯定能弄完的,你是最棒的! 统计学(第五版)贾俊平课后习题答案(完整版) 第一章思考题 i.i什么是统计学 统计学是关于数据的一门学科,它收集,处理,分析,解释来自各个领域的数据并从中得岀结论。 1.2解释描述统计和推断统计 描述统计;它研究的是数据收集,处理,汇总,图表描述,概括与分析等统计方法。推断统计;它是研究如何利用样本数据来推断总体特征的统计方法。 1.3统计学的类型和不同类型的特点统计数据;按所采用的计量尺度不同分; (定性数据)分类数据:只能归于某一类别的非数字型数据,它是对事物进行分类的结果,数据表现为类别,用文字来表述; (定性数据)顺序数据:只能归于某一有序类别的非数字型数据。它也是有类别的,但这些类别是有序的。 (定量数据)数值型数据:按数字尺度测量的观察值,其结果表现为具体的数值。 统计数据;按统计数据都收集方法分; 观测数据:是通过调查或观测而收集到的数据,这类数据是在没有对事物人为控制的条件下得到的。实验数据:在实验中控制实验对象而收集到的数据。 统计数据;按被描述的现象与实践的关系分;截面数据:在相同或相似的时间点收集到的数据,也叫静态数据。 时间序列数据:按时间顺序收集到的,用于描述现象随时间变化的情况,也叫动态数据。 1.4解释分类数据,顺序数据和数值型数据 答案同1.3 1.5举例说明总体,样本,参数,统计量,变量这几个概念 对一千灯泡进行寿命测试,那么这千个灯泡就是总体,从中抽取一百个进行检测,这一百个灯泡的集合就是样本,这一千个灯泡的寿命的平均值和标准差还有合格率等描述特征的数值就是参数,这一百个灯泡的寿命的平均值和标准差还有合格率等描述特征的数值就是统计量,变量就是说明现象某种特征的概念,比如说灯泡的寿命。 1.6变量的分类变量可以分为分类变量,顺序变量,数值型变量。 变量也可以分为随机变量和非随机变量。经验变量和理论变量。 1.7举例说明离散型变量和连续性变量离散型变量,只能取有限个值,取值以整数位断开,比如“企业数” 连续型变量,取之连续不断,不能一一列举,比如“温度”。 1.8统计应用实例 人口普查,商场的名意调查等。 1.9统计应用的领域经济分析和政府分析还有物理,生物等等各个领域。 第二章思考题 2.1什么是二手资料?使用二手资料应注意什么问题 与研究内容有关,由别人调查和试验而来已经存在,并会被我们利用的资料为“二手资料”。使用时要进行评估,要考虑到资料的原始收集人,收集目的,收集途径,收集时间使用时要注明数据来源。 2.2 比较概率抽样和非概率抽样的特点,指出各自适用情况概率抽样:抽样时按一定的概率以随机原则抽取样本。每个单位别抽中的概率已知或可以计算,当用样本对总体目标量进行估计时,要考虑到每个单位样本被抽到的概率。技术含量和成本都比较高。如果调查目的在于掌握和研究对象总体的数量特征,得到总体参数的置信区间,就使用概率抽样。

相关文档
最新文档