案例一用回归模型预测木材剩余物计量经济学

案例一：用回归模型预测木材剩余物（file:b1c3）

伊春林区位于黑龙江省东北部。全区有森林面积218.9732万公顷，木材蓄积量为2.324602亿m3。森林覆盖率为62.5%，是我国主要的木材工业基地之一。1999年伊春林区木材采伐量为532万m3。按此速度44年之后，1999年的蓄积量将被采伐一空。所以目前亟待调整木材采伐规划与方式，保护森林生态环境。为缓解森林资源危机，并解决部分职工就业问题，除了做好木材的深加工外，还要充分利用木材剩余物生产林业产品，如纸浆、纸袋、纸板等。因此预测林区的年木材剩余物是安排木材剩余物加工生产的一个关键环节。下面，利用一元线性回归模型预测林区每年的木材剩余物。显然引起木材剩余物变化的关键因素是年木材采伐量。

给出伊春林区16个林业局1999年木材剩余物和年木材采伐量数据如表1.1。散点图见图1.1。观测点近似服从线性关系。建立一元线性回归模型如下：

y t = β0 + β1 x t + u t

表1.1 年剩余物y t和年木材采伐量x t数据

林业局名年木材剩余物y t（万m3）年木材采伐量x t（万m3）

乌伊岭26.13 61.4

东风23.49 48.3

新青21.97 51.8

红星11.53 35.9

五营7.18 17.8

上甘岭 6.80 17.0

友好18.43 55.0

翠峦11.69 32.7

乌马河 6.80 17.0

美溪9.69 27.3

大丰7.99 21.5

南岔12.15 35.5

带岭 6.80 17.0

朗乡17.20 50.0

桃山9.50 30.0

双丰 5.52 13.8

合计202.87 532.00

图1.1 年剩余物y t和年木材采伐量x t散点图

图1.2 EViews 输出结果

EViews 估计结果见图1.2。在已建立Eviews 数据文件的基础上，进行OLS 估计的操作步骤如下：打开工作文件，从主菜单上点击Quick 键，选Estimate Equation 功能。在出现的对话框中输入y c x 。点击Ok 键。立即会得到如图1.2所示的结果。

下面分析EViews 输出结果。先看图1.2的最上部分。被解释变量是y t 。估计方法是最小二乘法。本次估计用了16对样本观测值。输出格式的中间部分给出5列。第1列给出截

距项（C ）和解释变量x t 。第2列给出第1列相应项的回归参数估计值（0?β和1?

β）。第3列给出相应回归参数估计值的样本标准差（s(0?

β), s(1?

β)）。第4列给出相应t 值。第5列给出t 统计量取值大于用样本计算的t 值（绝对值）的概率值。以t = 12.11266为例，相应概率0.0000表示统计量t 取值（绝对值）大于12.1的概率是一个比万分之一还小的数。换句话说，若给定检验水平为0.05，则临界值为t 0.05 (14) = 2.15。t = 12.1>2.15落在了H 0的拒绝域，所以结论是β1不为零。输出格式的最下部分给出了评价估计的回归函数的若干个统计量的值。依纵向顺序，这些统计量依次是可决系数R 2、调整的可决系数2R （第3章介绍）、回归函

数的标准差（s.e.，即均方误差的算术根σ?）、残差平方和、对数极大似然函数值（第2章介绍）、DW 统计量的值、被解释变量的平均数（y ）、被解释变量的标准差（)(t y s ）、赤池（Akaike ）

信息准则（是一个选择变量最优滞后期的统计量）、施瓦茨（Schwatz ）准则（是一个选择变量最优滞后期的统计量）、F 统计量（第3章介绍）的值以及F 统计量取值大于该值的概率。

注意：S.D.和s.e.的区别。s.e.和SSE 的关系。

根据EViews 输出结果（图1.2），写出OLS 估计式如下：

t y

-0.7629 + 0.4043

x t

(1.1)

(-0.6) (12.1) R 2

= 0.91, s. e . = 2.04

其中括号内数字是相应t 统计量的值。s.e .是回归函数的标准误差，即σ?=)216(?2-∑t u 。

R 2是可决系数。R 2 = 0.91说明上式的拟合情况较好。y t 变差的91%由变量x t 解释。检验回归系数显著性的原假设和备择假设是（给定α = 0.05）

H 0：β1 = 0； H 1：β1 ≠ 0

图1.3 残差图

因为t = 12.1 > t 0.05 (14) = 2.15，所以检验结果是拒绝β1 = 0，即认为年木材剩余物和年木材采伐量之间存在回归关系。上述模型的经济解释是，对于伊春林区每采伐1 m 3木材，将平均产生0.4 m 3的剩余物。

图1.3给出相应的残差图。Actual 表示y t

的实际观测值，Fitted 表示y t

的拟合值t y

?，Residual 表示残差t u ?。残差图中的两条虚线与中心线的距离表示残差的一个标准差，即s.e .。

通过残差图可以看到，大部分残差值都落在了正、负一个标准差之内。估计β1的置信区间。由

t = P {

)

(111

?βββs -≤ t 0.05 (14) } = 0.95

得

1?ββ-≤ t 0.05 (14) )?

(1βs β1的置信区间是

[1?β- t 0.05 (14) )?(1βs , 1?β+ t 0.05 (14) )?(1βs ]

[0.4043 - 2.15 ? 0.0334, 0.4043 + 2.15 ? 0.0334]

[0.3325, 0.4761]

以95%的置信度认为，β1的真值范围应在[0.3325, 0.4761 ]范围中。

下面求y t 的点预测和平均木材剩余物产出量的置信区间预测。假设乌伊岭林业局2000年计划采伐木材20万m 3，求木材剩余物的点预测值。

y ?2000 = - 0.7629 + 0.4043 x 2000

= -0.7629 + 0.4043 ? 20 = 7.3231万m 3

s 2(E (y ?2000)) = 2?σ(T 1

+ ∑--2

)()(x x x x F ) = 4.1453 (161+2606.3722)25.3320(2

-) = 0.4546

s (E (y ?2000)) =

4546.0= 0.6742 因为

E (y ?2000) = E(0?β+1?βx 2000 ) = β0 + β1 x 2000 = E(y 2000)

t = )?()(?200020002000y s y E y

-~ t (T -2)

则置信度为0.95的2000年平均木材剩余物E(y 2000)的置信区间是

y ?2000 ± t 0.05 (14) s (E (y ?2000)) = 7.3231 ± 2.15 ? 0.6742

= 5.8736, 8.7726

从而得出预测结果，2000年若采伐木材20万m 3，产生木材剩余物的点估计值是7.3231万m 3。平均木材剩余物产出量的置信区间估计是在 [5.8736, 8.7726] 万m 3之间。从而为恰当安排2000年木材剩余物的加工生产提供依据。

木材剩余物产出量单点的置信区间的计算。

s 2(y ?2000) = 2?σ(1+T 1+ ∑--22

)()

(x x x x F )

= 4.1453 (1+161+2606.3722)25.3320(2

-) = 4.5999

s (y ?2000)

EViews 通过预测程序计算的结果是

，

木材剩余物产出量单点的置信区间的估计结果是

y ?2000 ± t 0.05 (14) s (y ?2000) = 7.3231 ± 2.15 ? 2.145 = [2.71，11.93]

问题：估计结果中0?

β没有显著性，去掉截距项 β0可以吗？

答：依据实际意义可知，没有木材采伐量就没有木材剩余物，所以理论上β0是可以取零的。而有些问题就不可以。例如家庭消费和收入的关系。即使家庭收入为零，消费仍然非零。一般来说，截距项的估计量没有显著性时，也不做剔出处理。本案例剔出截距项后的估计结果是

t y ?= 0.3853 x t

(28.3) R 2

= 0.91, s. e . = 2.0

点预测值是

y ?2000 = 0.3853 x 2000 = 0.3853 ? 20 = 7.7060万m 3

多元线性回归模型的案例分析

1. 表1列出了某地区家庭人均鸡肉年消费量Y 与家庭月平均收入X ，鸡肉价格P 1，猪肉价格P 2与牛肉价格P 3的相关数据。年份 Y/千克 X/ 元 P 1/(元/千克) P 2/(元/千克) P 3/(元/千克) 年份 Y/千克 X/元 P 1/(元/ 千克) P 2/(元/ 千克) P 3/(元/千克) 1980 2.78 397 4.22 5.07 7.83 1992 4.18 911 3.97 7.91 11.40 1981 2.99 413 3.81 5.20 7.92 1993 4.04 931 5.21 9.54 12.41 1982 2.98 439 4.03 5.40 7.92 1994 4.07 1021 4.89 9.42 12.76 1983 3.08 459 3.95 5.53 7.92 1995 4.01 1165 5.83 12.35 14.29 1984 3.12 492 3.73 5.47 7.74 1996 4.27 1349 5.79 12.99 14.36 1985 3.33 528 3.81 6.37 8.02 1997 4.41 1449 5.67 11.76 13.92 1986 3.56 560 3.93 6.98 8.04 1998 4.67 1575 6.37 13.09 16.55 1987 3.64 624 3.78 6.59 8.39 1999 5.06 1759 6.16 12.98 20.33 1988 3.67 666 3.84 6.45 8.55 2000 5.01 1994 5.89 12.80 21.96 1989 3.84 717 4.01 7.00 9.37 2001 5.17 2258 6.64 14.10 22.16 1990 4.04 768 3.86 7.32 10.61 2002 5.29 2478 7.04 16.82 23.26 1991 4.03 843 3.98 6.78 10.48 （1）求出该地区关于家庭鸡肉消费需求的如下模型： 01213243ln ln ln ln ln Y X P P P u βββββ=+++++ （2）请分析，鸡肉的家庭消费需求是否受猪肉及牛肉价格的影响。先做回归分析，过程如下：输出结果如下：

自回归分布滞后模型ADL的运用试验指导-时间序列分析

案例六自回归分布滞后模型（ADL ）的运用实验指导一、实验目的理解ADL 模型的原理与应用条件，学会运用ADL 模型来估计变量之间长期稳定关系。理解从经济理论上来说，两个经济变量之间的确有长期关系采用使用该模型进行估计。理解ADL 模型的优点：不管回归项是不是1阶单整或平稳都可以进行检验和估计。而进行标准的协整分析前，必须把变量分类成(0)I 和(1)I 。二、基本概念 Jorgenson(1966)提出的（,p q ）阶自回归分布滞后模型ADL(autoregressive distributed lag)：011111 i t t p t p t t q t q i t i i y y y ταφφεθεθεβ-----='=++++--+∑x ，其中t i -x 是滞后i 期的外生变量向量（维数与变量个数相同），且每个外生变量的最大滞后阶数为i τ，i β是参数向量。当不存在外生变量时，模型就退化为一般ARMA （,p q ）模型。如果模型中不含有移动平均项，可以采用OLS 方法估计参数，若模型中含有移动平均项，线性OLS 估计将是非一致性估计，应采用非线性最小二乘估计。三、实验内容及要求（1）实验内容运用ADL 模型研究1992年1月到1998年12月我国城镇居民月对数人均生活费支出yt 和对数可支配收入xt 之间的长期稳定关系。（2）实验要求在认真理解模型应用条件的基础上，通过实验掌握ADL 模型的实际应用方法，并熟悉Eniews 的具体操作过程。四、实验指导（1）数据录入打开Eviews 软件，选择“File”菜单中的“New --Workfile”选项，在“Workfile structure type ”栏选择“Dated-regular frequency ”，在“Data specification ”栏中“Frequency ”中选择“Monthly ”即月份数据，起始时间输入1992m1即1992年1月份，止于1998m12，点击ok ，见图6-1，这样就建立了一个工作文件。图6-1 建立工作文件窗口

MA AB 回归预测模型

MATLAB---回归预测模型 Matlab统计工具箱用命令regress实现多元线性回归，用的方法是最小二乘法，用法是： b=regress(Y,X) [b,bint,r,rint,stats]=regress(Y,X,alpha) Y,X为提供的X和Y数组，alpha为显着性水平（缺省时设定为0.05），b,bint为回归系数估计值和它们的置信区间，r,rint为残差（向量）及其置信区间，stats 是用于检验回归模型的统计量，有四个数值，第一个是R2，第二个是F，第三个是与F对应的概率 p ，p <α拒绝 H0，回归模型成立，第四个是残差的方差 s2 。残差及其置信区间可以用 rcoplot(r,rint)画图。例1合金的强度y与其中的碳含量x有比较密切的关系，今从生产中收集了一批数据如下表 1。先画出散点图如下： x=0.1:0.01:0.18; y=[42,41.5,45.0,45.5,45.0,47.5,49.0,55.0,50.0]; plot(x,y,'+') 可知 y 与 x 大致上为线性关系。

设回归模型为y =β 0+β 1 x 用regress 和rcoplot 编程如下： clc,clear x1=[0.1:0.01:0.18]'; y=[42,41.5,45.0,45.5,45.0,47.5,49.0,55.0,50.0]'; x=[ones(9,1),x1]; [b,bint,r,rint,stats]=regress(y,x); b,bint,stats,rcoplot(r,rint) 得到 b =27.4722 137.5000 bint =18.6851 36.2594 75.7755 199.2245 stats =0.7985 27.7469 0.0012 4.0883 即β 0=27.4722 β 1 =137.5000 β 的置信区间是[18.6851,36.2594]， β 1 的置信区间是[75.7755,199.2245]； R2= 0.7985 ， F = 27.7469 ， p = 0.0012 ， s2 =4.0883 。

一元线性回归模型案例分析

一元线性回归模型案例分析一、研究的目的要求居民消费在社会经济的持续发展中有着重要的作用。居民合理的消费模式和居民适度的消费规模有利于经济持续健康的增长，而且这也是人民生活水平的具体体现。改革开放以来随着中国经济的快速发展，人民生活水平不断提高，居民的消费水平也不断增长。但是在看到这个整体趋势的同时，还应看到全国各地区经济发展速度不同，居民消费水平也有明显差异。例如，2002年全国城市居民家庭平均每人每年消费支出为6029.88元, 最低的黑龙江省仅为人均4462.08元，最高的上海市达人均10464元，上海是黑龙江的2.35倍。为了研究全国居民消费水平及其变动的原因，需要作具体的分析。影响各地区居民消费支出有明显差异的因素可能很多，例如，居民的收入水平、就业状况、零售物价指数、利率、居民财产、购物环境等等都可能对居民消费有影响。为了分析什么是影响各地区居民消费支出有明显差异的最主要因素，并分析影响因素与消费水平的数量关系，可以建立相应的计量经济模型去研究。二、模型设定我们研究的对象是各地区居民消费的差异。居民消费可分为城市居民消费和农村居民消费，由于各地区的城市与农村人口比例及经济结构有较大差异，最具有直接对比可比性的是城市居民消费。而且，由于各地区人口和经济总量不同，只能用“城市居民每人每年的平均消费支出”来比较，而这正是可从统计年鉴中获得数据的变量。所以模型的被解释变量Y 选定为“城市居民每人每年的平均消费支出”。因为研究的目的是各地区城市居民消费的差异，并不是城市居民消费在不同时间的变动，所以应选择同一时期各地区城市居民的消费支出来建立模型。因此建立的是2002年截面数据模型。影响各地区城市居民人均消费支出有明显差异的因素有多种，但从理论和经验分析，最主要的影响因素应是居民收入，其他因素虽然对居民消费也有影响，但有的不易取得数据，如“居民财产”和“购物环境”；有的与居民收入可能高度相关，如“就业状况”、“居民财产”；还有的因素在运用截面数据时在地区间的差异并不大，如“零售物价指数”、“利率”。因此这些其他因素可以不列入模型，即便它们对居民消费有某些影响也可归入随即扰动项中。为了与“城市居民人均消费支出”相对应，选择在统计年鉴中可以获得的“城市居民每人每年可支配收入”作为解释变量X。从2002年《中国统计年鉴》中得到表2.5的数据: 表2.52002年中国各地区城市居民人均年消费支出和可支配收入

计量经济学案例分析

第二章案例分析研究目的：分析各地区城镇居民计算机拥有量与城镇居民收入水平的关系，对更多规律的研究具有指导意义. 一．模型设定 2011年年底城镇居民家庭平均每百户计算机拥有量Y 与城镇居民平均每人全年家庭总收入X 的关系图2.1 各地区城镇居民每百户计算机拥有量与人均总收入的散点图由图可知，各地区城镇居民每百户计算机拥有量随着人均总收入水平的提高而增加，近似于线性关系，为分析其数量性变动规律，可建立如下简单线性回归模型： Y t =β1+β2X t +u t 50 60 708090100 110120130140 X Y

二．估计参数假定所建模型及其随机扰动项u i满足各项古典假设，用普通最小二乘法（OLSE）估计模型参数.其结果如下：表2.1 回归结果 Dependent Variable: Y Method: Least Squares Date: 11/13/17 Time: 12:50 Sample: 1 31 Included observations: 31 Variable Coefficient Std. Error t-Statistic Prob. C 11.95802 5.622841 2.126686 0.0421 X 0.002873 0.000240 11.98264 0.0000 R-squared 0.831966 Mean dependent var 77.08161 Adjusted R-squared 0.826171 S.D. dependent var 19.25503 S.E. of regression 8.027957 Akaike info criterion 7.066078 Sum squared resid 1868.995 Schwarz criterion 7.158593 Log likelihood -107.5242 Hannan-Quinn criter. 7.096236 F-statistic 143.5836 Durbin-Watson stat 1.656123 Prob(F-statistic) 0.000000 由表2.1可得， β1=11.9580，β2=0.0029 故简单线性回归模型可写为： ^ Y X t t=11.9580+0.0029 其中：SE(β1)=5.6228, SE(β2)=0.0002 R-squared=0.8320，F=143.5836，n=31

经典单方程计量经济学模型多元线性回归模型

第三章、经典单方程计量经济学模型：多元线性回归模型一、内容提要本章将一元回归模型拓展到了多元回归模型，其基本的建模思想与建模方法与一元的情形相同。主要内容仍然包括模型的基本假定、模型的估计、模型的检验以及模型在预测方面的应用等方面。只不过为了多元建模的需要，在基本假设方面以及检验方面有所扩充。本章仍重点介绍了多元线性回归模型的基本假设、估计方法以及检验程序。与一元回归分析相比，多元回归分析的基本假设中引入了多个解释变量间不存在（完全）多重共线性这一假设；在检验部分，一方面引入了修正的可决系数，另一方面引入了对多个解释变量是否对被解释变量有显著线性影响关系的联合性F检验，并讨论了F检验与拟合优度检验的内在联系。本章的另一个重点是将线性回归模型拓展到非线性回归模型，主要学习非线性模型如何转化为线性回归模型的常见类型与方法。这里需要注意各回归参数的具体经济含义。本章第三个学习重点是关于模型的约束性检验问题，包括参数的线性约束与非线性约束检验。参数的线性约束检验包括对参数线性约束的检验、对模型增加或减少解释变量的检验以及参数的稳定性检验三方面的内容，其中参数稳定性检验又包括邹氏参数稳定性检验与邹氏预测检验两种类型的检验。检验都是以F检验为主要检验工具，以受约束模型与无约束模型是否有显著差异为检验基点。参数的非线性约束检验主要包括最大似然比检验、沃尔德检验与拉格朗日乘数检验。它们仍以估计无约束模型与受约束模型为基础，但以最大似然 χ分布为检验统计原理进行估计，且都适用于大样本情形，都以约束条件个数为自由度的2 量的分布特征。非线性约束检验中的拉格朗日乘数检验在后面的章节中多次使用。二、典型例题分析例1．某地区通过一个样本容量为722的调查数据得到劳动力受教育的一个回归方程为36 .0 . + = - 10+ 094 medu fedu .0 sibs edu210 131 .0 R2=0.214 式中，edu为劳动力受教育年数，sibs为该劳动力家庭中兄弟姐妹的个数，medu与fedu分别为母亲与父亲受到教育的年数。问

多元线性回归模型案例分析

多元线性回归模型案例分析 ——中国人口自然增长分析一·研究目的要求中国从1971年开始全面开展了计划生育,使中国总和生育率很快从1970年的降到1980年,接近世代更替水平。此后，人口自然增长率（即人口的生育率）很大程度上与经济的发展等各方面的因素相联系，与经济生活息息相关，为了研究此后影响中国人口自然增长的主要原因，分析全国人口增长规律，与猜测中国未来的增长趋势，需要建立计量经济学模型。影响中国人口自然增长率的因素有很多，但据分析主要因素可能有：（1）从宏观经济上看，经济整体增长是人口自然增长的基本源泉；（2）居民消费水平，它的高低可能会间接影响人口增长率。(3)文化程度，由于教育年限的高低，相应会转变人的传统观念，可能会间接影响人口自然增长率（4）人口分布，非农业与农业人口的比率也会对人口增长率有相应的影响。二·模型设定为了全面反映中国“人口自然增长率”的全貌，选择人口增长率作为被解释变量，以反映中国人口的增长；选择“国名收入”及“人均GDP”作为经济整体增长的代表；选择“居民消费价格指数增长率”作为居民消费水平的代表。暂不考虑文化程度及人口分布的影响。从《中国统计年鉴》收集到以下数据（见表1）：表1 中国人口增长率及相关数据

，设定的线性回归模型为： 1222334t t t t t Y X X X u ββββ=++++ 三、估计参数利用EViews 估计模型的参数，方法是： 1、建立工作文件：启动EViews ，点击File\New\Workfile ，在对话框“Workfile Range ”。在“Workfile frequency ”中选择“Annual ” (年年份 @ 人口自然增长率（%。）国民总收入（亿元）居民消费价格指数增长率（CPI ）% 人均GDP （元） 1988 15037 1366 1989 … 17001 18 1519 1990 18718 1644 1991 【 21826 1893 1992 26937 2311 1993 . 35260 2998 1994 48108 4044 1995 — 59811 5046 1996 70142 5846 1997 ~ 78061 6420 1998 83024 6796 1999 【 88479 7159 2000 98000 7858 2001 [ 108068 8622 2002 119096 9398 2003 ： 135174 10542 2004 159587 12336 2005 、 184089 14040 2006 213132 16024

自回归综合移动平均预测模型

自回归综合移动平均预测模型数据采集本文选取了2011年某省电力系统从1月1日开始之后80天的电力负荷观测，如表一。第n天负荷量第n天负荷量第n天负荷量第n天负荷量 1 2565957.38 21 2705368.6 41 2429907.99 61 2743833.56 2 2588923.0 3 22 2677964.55 42 2476962.26 62 2736933.52 3 2595037.39 23 2667444.01 43 2576255. 4 63 2773791.8 4 2621899.1 5 24 2659986.34 44 2614097.2 64 2748178.37 5 2605604.4 25 2646095.54 45 2680843.85 65 2737334.22 6 2597404.13 26 2652315.14 46 2775056.43 66 2720053.61 7 2363386.42 27 2641570.43 47 2728907.25 67 2700061.15 8 2620185.38 28 2584430.88 48 2611172.72 68 2709553.04 9 2615940.83 29 2474001.24 49 2601989.82 69 2681309.47 10 2615480.96 30 2396095.97 50 2668757.4 70 2683185.56 11 2612348.58 31 2288598.13 51 2677390.06 71 2661837.7 12 2610054.23 32 2166399.62 52 2695802.63 72 2644097.64 13 2610964.36 33 2062979.7 53 2689571.21 73 2685694.93 14 2637653.21 34 1997281.18 54 2654423.52 74 2702991.02 15 2633388.14 35 1925136.26 55 2642984.00 5 75 2687024.37 5 16 2640311.3 36 1970438.06 56 2712142.78 76 2680354.45 17 2678530.11 37 1976557.67 8 57 2754918.32 77 2682596.37 18 2687189.9 38 2050309.54 58 2758839.28 78 2695560.6 19 2694733.01 39 2154488.52 59 2817728.94 79 2674342.97 20 2709637.21 8 40 2384011.84 60 2759327.72 80 2685891.98 表1 数据处理利用spass绘制时间序列原始数据的散点图

计量经济学案例分析汇总

计量经济学案例分析1 一、研究的目的要求居民消费在社会经济的持续发展中有着重要的作用。居民合理的消费模式和居民适度的消费规模有利于经济持续健康的增长，而且这也是人民生活水平的具体体现。改革开放以来随着中国经济的快速发展，人民生活水平不断提高，居民的消费水平也不断增长。但是在看到这个整体趋势的同时，还应看到全国各地区经济发展速度不同，居民消费水平也有明显差异。例如，2002年全国城市居民家庭平均每人每年消费支出为元, 最低的黑龙江省仅为人均元，最高的上海市达人均10464元，上海是黑龙江的倍。为了研究全国居民消费水平及其变动的原因，需要作具体的分析。影响各地区居民消费支出有明显差异的因素可能很多，例如，居民的收入水平、就业状况、零售物价指数、利率、居民财产、购物环境等等都可能对居民消费有影响。为了分析什么是影响各地区居民消费支出有明显差异的最主要因素，并分析影响因素与消费水平的数量关系，可以建立相应的计量经济模型去研究。二、模型设定我们研究的对象是各地区居民消费的差异。居民消费可分为城市居民消费和农村居民消费，由于各地区的城市与农村人口比例及经济结构有较大差异，最具有直接对比可比性的是城市居民消费。而且，由于各地区人口和经济总量不同，只能用“城市居民每人每年的平均消费支出”来比较，而这正是可从统计年鉴中获得数据的变量。所以模型的被解释变量Y选定为“城市居民每人每年的平均消费支出”。因为研究的目的是各地区城市居民消费的差异，并不是城市居民消费在不同时间的变动，所以应选择同一时期各地区城市居民的消费支出来建立模型。因此建立的是2002年截面数据模型。影响各地区城市居民人均消费支出有明显差异的因素有多种，但从理论和经验分析，最主要的影响因素应是居民收入，其他因素虽然对居民消费也有影响，但有的不易取得数据，如“居民财产”和“购物环境”；有的与居民收入可能高度相关，如“就业状况”、“居民财产”；还有的因素在运用截面数据时在地区间的差异并不大，如“零售物价指数”、“利率”。因此这些其他因素可以不列入模型，即便它们对居民消费有某些影响也可归入随即扰动项中。为了与“城市居民人均消费支出”相对应，选择在统计年鉴中可以获得的“城市居民每人每年可支配收入”作为解释变量X。从2002年《中国统计年鉴》中得到表的数据: 表 2002年中国各地区城市居民人均年消费支出和可支配收入

案例分析一元线性回归模型

案例分析报告（2014——2015学年第一学期）课程名称：预测与决策专业班级：电子商务1202 学号： 2204120202 学生姓名：陈维维 2014 年 11月案例分析（一元线性回归模型）我国城镇居民家庭人均消费支出预测一、研究目的与要求居民消费在社会经济的持续发展中有着重要的作用，居民合理的消费模式和居民适度的消费规模有利于经济持续健康的增长，而且这也是人民生活水平的具体体现。从理论角度讲，消费需求的具体内容主要体现在消费结构上，要增加居民消费，就要从研究居民消费结构入手，只有了解居民消费结构变化的趋势和规律，掌握消费需求的热点和发展方向，才能为消费者提供良好的政策环境，引导消费者合理扩大消费，才能促进产业结构调整与消费结构优化升级相协调，才能推动国民经济平稳、健康发展。例如，2008年全国城镇居民家庭平均每人每年消费支出为11242.85元，?最低的青海省仅为人均8192.56元，最高的上海市达人均19397.89元，上海是黑龙江的2.37倍。为了研究全国居民消费水平及其变动的原因，需要作具体的分析。影响各地区居民消费支出有明显差异的因素可能很多，例如，零售物价指数、利率、居民财产、购物环境等等都可能对居民消费有影响。为了分析什么是影响各地区居民消费支出有明显差异的最主要因素，并分析影响因素与消费水平的数量关系，可以建立相应的计量经济模型去研究。二、模型设定?

我研究的对象是各地区居民消费的差异。居民消费可分为城镇居民消费和农村居民消费，由于各地区的城镇与农村人口比例及经济结构有较大差异，最具有直接对比可比性的是城市居民消费。而且，由于各地区人口和经济总量不同，只能用“城镇居民每人每年的平均消费支出”来比较，而这正是可从统计年鉴中获得数据的变量。所以模型的被解释变量Y选定为“城镇居民每人每年的平均消费支出”。因为研究的目的是各地区城镇居民消费的差异，并不是城镇居民消费在不同时间的变动，所以应选择同一时期各地区城镇居民的消费支出来建立模型。因此建立的是2008年截面数据模型。影响各地区城镇居民人均消费支出有明显差异的因素有多种，但从理论和经验分析，最主要的影响因素应是居民收入，其他因素虽然对居民消费也有影响，但有的不易取得数据，如“居民财产”和“购物环境”；有的与居民收入可能高度相关，如“就业状况”、“居民财产”；还有的因素在运用截面数据时在地区间的差异并不大，如“零售物价指数”、“利率”。因此这些其他因素可以不列入模型，即便它们对居民消费有某些影响也可归入随即扰动项中。为了与“城镇居民人均消费支出”相对应，选择在统计年鉴中可以获得的“城市居民每人每年可支配收入”作为解释变量X。以下是2008年各地区城镇居民人均年消费支出和可支配收入表

计量经济学-案例分析-第六章

第六章案例分析一、研究目的 2003年中国农村人口占59.47％，而消费总量却只占41.4%，农村居民的收入和消费是一个值得研究的问题。消费模型是研究居民消费行为的常用工具。通过中国农村居民消费模型的分析可判断农村居民的边际消费倾向，这是宏观经济分析的重要参数。同时，农村居民消费模型也能用于农村居民消费水平的预测。二、模型设定正如第二章所讲述的，影响居民消费的因素很多，但由于受各种条件的限制，通常只引入居民收入一个变量做解释变量，即消费模型设定为 t t t u X Y ++=21ββ （6.43）式中，Y t 为农村居民人均消费支出，X t 为农村人均居民纯收入，u t 为随机误差项。表6.3是从《中国统计年鉴》收集的中国农村居民1985-2003年的收入与消费数据。表6.3 1985-2003年农村居民人均收入和消费单位：元

2000 2001 2002 2003 2253.40 2366.40 2475.60 2622.24 1670.00 1741.00 1834.00 1943.30 314.0 316.5 315.2 320.2 717.64 747.68 785.41 818.86 531.85 550.08 581.85 606.81 为了消除价格变动因素对农村居民收入和消费支出的影响，不宜直接采用现价人均纯收入和现价人均消费支出的数据，而需要用经消费价格指数进行调整后的1985年可比价格计的人均纯收入和人均消费支出的数据作回归分析。根据表6.3中调整后的1985年可比价格计的人均纯收入和人均消费支出的数据，使用普通最小二乘法估计消费模型得 t t X Y 0.59987528.106?+= （6.44） Se = (12.2238) (0.0214) t = (8.7332) (28.3067) R 2 = 0.9788，F = 786.0548，d f = 17，DW = 0.7706 该回归方程可决系数较高，回归系数均显著。对样本量为19、一个解释变量的模型、5%显著水平，查DW 统计表可知，d L =1.18，d U = 1.40，模型中DW

线性回归和灰色预测模型案例

预测未来2015年到2020年的货运量灰色预测模型是通过少量的、不完全的信息，建立数学模型并做出预测的一种预测方法.当我们应用运筹学的思想方法解决实际问题，制定发展战略和政策、进行重大问题的决策时，都必须对未来进行科学的预测. 预测是根据客观事物的过去和现在的发展规律，借助于科学的方法对其未来的发展趋势和状况进行描述和分析，并形成科学的假设和判断. 灰色系统的定义灰色系统是黑箱概念的一种推广。我们把既含有已知信息又含有未知信息的系统称为灰色系统.作为两个极端，我们将称信息完全未确定的系统为黑色系统；称信息完全确定的系统为白色系统.区别白色系统与黑色系统的重要标志是系统各因素之间是否具有确定的关系。

建模原理模型的求解

原始序列为： ) 16909 15781 13902 12987 12495 11067 10149 9926 9329 10923 7691())6(),...1(()0()0()0(==x x x 构造累加生成序列 ) 131159,114250,98469,84567,71580,59085, 48018,37869,27943,18614,7691())6(),...1(()1()1()1(==x x x 归纳上面的式子可写为称此式所表示的数据列为原始数据列的一次累加生成，简称为一次累加生成. 对(1)X 作紧邻均值生成 ,.... 2)) 1()((21)()1() 1() 1(=-+=k k z k z k z MATLAB 代码如下： x=[7691 18614 27943 37869 48018 590857 71580 84567 98469 114250 131159]; z(1)=x(1); for i=2:6 z(i)=0.5*(x(i)+x(i-1)); end format long g z z = Columns 1 through 3 7691 13152.5 23278.5 Columns 4 through 6 32906 42943.5 319437.5

现代计量经济学模型体系解析

#学术探讨# 现代计量经济学模型体系解析* 李子奈刘亚清内容提要:本文对现代计量经济学模型体系进行了系统的解析,指出了现代计量经济学的各个分支是以问题为导向,在经典计量经济学模型理论的基础上,发展成为相对独立的模型理论体系,包括基于研究对象和数据特征而发展的微观计量经济学、基于充分利用数据信息而发展的面板数据计量经济学、基于计量经济学模型的数学基础而发展的现代时间序列计量经济学、基于非设定的模型结构而发展的非参数计量经济学,并对每个分支进行了扼要的描述。最后在/交叉与综合0的方向上提出了现代计量经济学模型理论的研究前沿领域。关键词:经典计量经济学时间序列计量经济学微观计量经济学一、引言计量经济学自20世纪20年代末30年代初诞生以来,已经形成了十分丰富的内容体系。一般认为,可以以20世纪70年代为界将计量经济学分为经典计量经济学(Classical Econometrics)和现代计量经济学(Mo dern Eco no metr ics),而现代计量经济学又可以分为四个分支:时间序列计量经济学(Tim e Ser ies Econo metrics)、微观计量经济学(M-i cro-econometrics)、非参数计量经济学(Nonpara-m etric Econometrics)以及面板数据计量经济学(Panel Data Eco nom etrics)。这些分支作为独立的课程已经被列入经济学研究生的课程表,独立的教科书也已陆续出版,应用研究已十分广泛,标志着它们作为计量经济学的分支学科已经成熟。据此提出三个问题:一是经典计量经济学的地位问题。既然现代计量经济学模型体系已经成熟,而且它们都是在经典模型理论的基础上发展的,那么经典模型还有应用价值吗?是不是凡是采用经典模型的研究都是低水平和落后的?二是现代计量经济学的各个分支的发展导向问题。即它们是如何发展起来的?三是现代计量经济学进一步创新和发展的基点在哪里?回答这些问题,对于正确理解计量经济学的学科体系,对于计量经济学的课程设计和教学内容安排,对于正确评价计量经济学理论和应用研究的水平,对于进一步推动中国的计量经济学理论研究,都是十分有益的。现代计量经济学的各个分支是以问题为导向,以经典计量经济学模型理论为基础而发展起来的。所谓/问题0,包括研究对象和表征研究对象状态和变化的数据。研究对象不同,表征研究对象状态和变化的数据具有不同的特征,用以进行经验实证研究的计量经济学模型既然不同,已有的模型理论方法不适用了,就需要发展新的模型理论方法。按照这个思路,就可以用图1简单地描述经典计量经济学模型与现代计量经济学模型各个分支之间的关系。本文试图从方法论的角度对现代计量经济学模型的发展,特别是现代计量经济学模型与经典计量经济学模型之间的关系进行较为系统的讨论,以期对未来我国计量经济学的发展研究提供借鉴和启示。本文的内容安排如下:首先分析经典计量经济学模型的基础地位,明确它在现代的应用价值,同时对发生于20世纪70年代的/卢卡斯批判0的实质进行讨论;然后依次讨论时间序列计量经济学、微观计量经济学、非参数计量经济学以及面板数据计量经济学的发展,回答它们是以什么问题为导向,以什么为目的而发展的;最后以/现代计量经济学模型体系的分解与综合0为题,讨论现代计量经济学的前沿研究领域以及从对我国计量经济学理论的创新和发展 ) 22 ) *本文受国家社会科学基金重点项目(08AJY001,计量经济学模型方法论基础研究)的资助。

向量自回归与ARCH、GARCH模型

向量自回归预测是计量经济分析的重要部分，宽泛的说，依据时间序列数据进行经济预测的方法有五种：（1）指数平滑法；（2）单一方程回归模型；（3）联立方程回归模型；（4）单整自回归移动平均模型；（5）向量自回归模型（V AR ，vector autoregression ）。一、V AR 的估计 V AR 方法论同时考虑几个内生变量，它看起来类似于联立方程模型。但是，在V AR 模型中，每一个内生变量都是由它的滞后或过去值以及模型中所有其他内生变量的滞后或过去值来解释。通常模型中没有任何外生变量。在联立方程模型中，我们把一些变量看作内生的，而另一些变量看作外生的或预定的，在估计这些模型之前，必须肯定方程组中的方程是可识别的，而为达到识别的目的，常常要假定某些预定变量仅出现在某些方程之中，这些决定往往是主观的，因此这种方法受到C.A.西姆斯（Christopher Sims ）的严厉批评，他认为如果在一组变量中有真实的联立性，这些变量就应该平等对待，而不应事先区分内生和外生变量，以此思路，其推出了V AR 模型。例我们想考虑中国的货币（M1）与利率（R ）的关系。如果通过格兰杰因果关系检验，我们无法拒绝两者之间有双向因果关系的假设，即M1 影响R ，而R 反过来又影响M1，这种情形是应用V AR 的理想情形。假定每个方程都含有M1 和R 的k 个滞后值作为回归元，每个方程都可以用OLS 去估计，实际模型如下： 11111k k t j t j j t j t j j M M R u αβγ--===+++∑∑

2111k k t j t j j t j t j j R M R u αθλ--=='=+++∑∑ 其中u 是随机误差项，在V AR 术语中称为脉冲值（impulses ）。在估计以上方程时，必须先决定最大滞后长度，这是一个经验问题，包括过多的滞后项将消耗自由度，而且会引入多重共线性的可能性，而包含过少的滞后值将导致设定误差，解决这个问题的方法之一就是使用赤池、施瓦茨或汉南—奎因准则中的某一个准则，并选择准则最低值的模型，因此，这个过程中试错法就不可避免。值得注意的是，向量自回归模型中同时引入同一变量的几个滞后项，可能因多重共线性而使每个估计系数在统计上都不显著，但基于F 检验它们可能是联合显著的。二、V AR 建模的一些问题 V AR 的倡导者强调此法有如下的优点：（1）方法简单，无需决定哪些变量是内生的，哪些变量是外生的，V AR 中的全部变量都是内生的。（2）估计简单：常用的OLS 法可以用于逐个估计每一个方程。（3）在许多案例中，此方法得到的预测优于用更复杂的联立方程模型得到的预测。但V AR 建模的批评者指出如下的一些问题： 1、不同于联立方程模型，V AR 利用较少的先验信息，所有是缺乏理论支撑的，因为在联立方程中排除或包含某些变量，对模型的识别起到关键性作用。 2、由于重点放到预测，V AR 模型不适合用于政策分析。 3、实际上，对V AR 建模最大的挑战在于选择适当滞后长度。假

计量经济学-案例分析-第八章

第八章案例分析改革开放以来，随着经济的发展中国城乡居民的收入快速增长，同时城乡居民的储蓄存款也迅速增长。经济学界的一种观点认为，20世纪90年代以后由于经济体制、住房、医疗、养老等社会保障体制的变化，使居民的储蓄行为发生了明显改变。为了考察改革开放以来中国居民的储蓄存款与收入的关系是否已发生变化，以城乡居民人民币储蓄存款年底余额代表居民储蓄（Y），以国民总收入GNI代表城乡居民收入，分析居民收入对储蓄存款影响的数量关系。表8.1为1978-2003年中国的国民总收入和城乡居民人民币储蓄存款年底余额及增加额的数据。单位：亿元 2004 鉴数值，与用年底余额计算的数值有差异。为了研究1978—2003年期间城乡居民储蓄存款随收入的变化规律是否有变化,考证城

乡居民储蓄存款、国民总收入随时间的变化情况，如下图所示: 图8.5 从图8.5中，尚无法得到居民的储蓄行为发生明显改变的详尽信息。若取居民储蓄的增量（YY ）,并作时序图（见图 8.6）从居民储蓄增量图可以看出，城乡居民的储蓄行为表现出了明显的阶段特征: 2000年有两个明显的转折点。再从城乡居民储蓄存款增量与国民总收入之间关系的散布图看（见图8.7），也呈现出了相同的阶段性特征。为了分析居民储蓄行为在 1996年前后和2000年前后三个阶段的数量关系，引入虚拟变量D 和D2°D 和D 2的选择，是以1996>2000年两个转折点作为依据，1996年的GNI 为66850.50 亿元,2000年的GNI 为国为民8254.00亿元，并设定了如下以加法和乘法两种方式同时引入虚拟变量的的模型: YY = 1+ 2GNI t 3 GNI t 66850.50 D 1t + 4 GNh 88254.00 D 2t i D 1 t 1996年以后 D 1 t 2000年以后其中: D 1t _ t 1996年及以前 2t 0 t 2000年及以前对上式进行回归后，有: Dependent Variable: YY Method: Least Squares Date: 06/16/05 Time: 23:27 120000 8.7 1996年和 100000- 40000 2WM GNi o eOB2&ISEea9a9l2949698[Ma2 20CUC ir-“- 1CC0C 图 8.6 *OOCO mnoot ， RtKXD Tconr GF*

计量经济学-案例分析-第二章

第二章案例分析一、研究的目的要求居民消费在社会经济的持续发展中有着重要的作用。居民合理的消费模式和居民适度的消费规模有利于经济持续健康的增长，而且这也是人民生活水平的具体体现。改革开放以来随着中国经济的快速发展，人民生活水平不断提高，居民的消费水平也不断增长。但是在看到这个整体趋势的同时，还应看到全国各地区经济发展速度不同，居民消费水平也有明显差异。例如，2002年全国城市居民家庭平均每人每年消费支出为6029.88元, 最低的黑龙江省仅为人均4462.08元，最高的上海市达人均10464元，上海是黑龙江的2.35倍。为了研究全国居民消费水平及其变动的原因，需要作具体的分析。影响各地区居民消费支出有明显差异的因素可能很多，例如，居民的收入水平、就业状况、零售物价指数、利率、居民财产、购物环境等等都可能对居民消费有影响。为了分析什么是影响各地区居民消费支出有明显差异的最主要因素，并分析影响因素与消费水平的数量关系，可以建立相应的计量经济模型去研究。二、模型设定我们研究的对象是各地区居民消费的差异。居民消费可分为城市居民消费和农村居民消费，由于各地区的城市与农村人口比例及经济结构有较大差异，最具有直接对比可比性的是城市居民消费。而且，由于各地区人口和经济总量不同，只能用“城市居民每人每年的平均消费支出”来比较，而这正是可从统计年鉴中获得数据的变量。所以模型的被解释变量Y 选定为“城市居民每人每年的平均消费支出”。因为研究的目的是各地区城市居民消费的差异，并不是城市居民消费在不同时间的变动，所以应选择同一时期各地区城市居民的消费支出来建立模型。因此建立的是2002年截面数据模型。影响各地区城市居民人均消费支出有明显差异的因素有多种，但从理论和经验分析，最主要的影响因素应是居民收入，其他因素虽然对居民消费也有影响，但有的不易取得数据，如“居民财产”和“购物环境”；有的与居民收入可能高度相关，如“就业状况”、“居民财产”；还有的因素在运用截面数据时在地区间的差异并不大，如“零售物价指数”、“利率”。因此这些其他因素可以不列入模型，即便它们对居民消费有某些影响也可归入随即扰动项中。为了与“城市居民人均消费支出”相对应，选择在统计年鉴中可以获得的“城市居民每人每年可支配收入”作为解释变量X。从2002年《中国统计年鉴》中得到表2.5的数据: 表2.52002年中国各地区城市居民人均年消费支出和可支配收入

多元线性回归模型案例

我国农民收入影响因素的回归分析本文力图应用适当的多元线性回归模型,对有关农民收入的历史数据和现状进行分析,探讨影响农民收入的主要因素,并在此基础上对如何增加农民收入提出相应的政策建议。?农民收入水平的度量常采用人均纯收入指标。影响农民收入增长的因素是多方面的，既有结构性矛盾因素，又有体制性障碍因素。但可以归纳为以下几个方面：一是农产品收购价格水平。二是农业剩余劳动力转移水平。三是城市化、工业化水平。四是农业产业结构状况。五是农业投入水平。考虑到复杂性和可行性，所以对农业投入与农民收入，本文暂不作讨论。因此，以全国为例，把农民收入与各影响因素关系进行线性回归分析，并建立数学模型。一、计量经济模型分析 (一)、数据搜集根据以上分析，我们在影响农民收入因素中引入7个解释变量。即：2x -财政用于农业的支出的比重，3x -第二、三产业从业人数占全社会从业人数的比重，4x -非农村人口比重，5x -乡村从业人员占农村人口的比重，6x -农业总产值占农林牧总产值的比重，7x -农作物播种面积，8x —农村用电量。

资料来源《中国统计年鉴2006》。 (二)、计量经济学模型建立我们设定模型为下面所示的形式：利用Eviews 软件进行最小二乘估计，估计结果如下表所示： DependentVariable:Y Method:LeastSquares Sample: Includedobservations:19 Variable Coefficient t-Statistic Prob. C X1 X3 X4 X5 X6 X7 X8 R-squared Meandependentvar AdjustedR-squared 表1最小二乘估计结果回归分析报告为： () ()()()()()()()()()()()()()()() 2345678 2? -1102.373-6.6354X +18.2294X +2.4300X -16.2374X -2.1552X +0.0100X +0.0634X 375.83 3.7813 2.066618.37034 5.8941 2.77080.002330.02128 -2.933 1.7558.820900.20316 2.7550.778 4.27881 2.97930.99582i Y SE t R ===---=230.99316519 1.99327374.66 R Df DW F ====二、计量经济学检验 (一)、多重共线性的检验及修正 ①、检验多重共线性 (a)、直观法从“表1最小二乘估计结果”中可以看出，虽然模型的整体拟合的很好，但是x4x6