回归大作业-基于多元线性回归的期权价格预测模型

  1. 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
  2. 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
  3. 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。

基于多元线性回归的期权价格预测模型

王某某

(北京航空航天大学计算机学院北京100191)1

摘要:期权是国际市场成熟、普遍的金融衍生品,是金融市场极为重要的金融工具。2015年2月9日,上海证券交易所正式推出了我国首支场内交易期权——上证50ETF期权,翻开了境内场内期权市场的新篇章。50ETF期权上市以来,市场规模逐步扩大,其发展情况境外期权产品相同时期。本文以此为研究背景,以“50ETF购12月1.95”这支期权为研究对象,以今日开盘价、收盘价、最高价、最低价、结算价、成交量、成交额、持仓量、涨停价和跌停价为解释变量,通过多元线性回归模型,预测该期权的明日收盘价。本次研究以多元线性回归的全模型(模型1)为出发点,通过异方差检验、残差的独立性检验、误差的正太分布检验以及多重共线性检验,说明该模型不违反回归的基本假设条件。进而通过主成分回归(模型4)和逐步回归(模型5)进行降维,结果表明因变量与解释变量之间存在强烈的线性相关关系,且主成分回归和逐步回归相比全模型有更好的预测能力。

关键词:期权价格多元线性回归50ETF 多重共线性因子分析

一、引言

期权(option)是依据合约形态划分的一种衍生品,指赋予其购买方在规定期限内按买卖双方约定的价格(即协议价格或行权价格)购买或者出售一定数量某种金融资产(即标的资产)的权利的合约。期权购买方为了获得这个权利,必须支付给期权出售方一定的费用,称为权利金或期权价格[1]。

2015年2月9日,上海证券交易所正式推出了我国首支场内交易期权——上证50ETF,翻开了境内场内期权市场的新篇章。期权是与期货并列的基础衍生产品,是金融市场极为重要的金融工具之一。

自50ETF上市以来,市场规模逐步扩大。2015年2月日均合约成交面值为5.45亿元,12月就达到了47.69亿元,增长了7.75倍;2月日均合约成交量为2.33万张,12月就达到了19.81万张,增长了7.5倍;2月权利金总成交额为2.48亿元,12月就达到了35.98亿元,增长了13.51倍[1]。

我国股票市场有上亿的个人投资者,是一个较为典型的散户市场[1]。相较于专业投资机构讲,散户缺乏时间,精力以及专业分析,投资具有很大的投机行为。对于这些投资者来说,期权价格的变动则是他们最为关注的问题,其变化直接影响到自身的收益。在实际情况中,影响股票价格的因素很多,涉及到金融政策、利率政策以及国际市场等因素,其作用机制也相当复杂[2]。因此,对于期权价格预测的研究,则可以降低投资者的投资风险,及时调整投资结构,从而保障自身的收益。

1作者简介:王某某,北京航空航天大学研究生邮箱:**************。

本文选择“50ETF购12月1.95(期权代码:10000629)”这支期权作为研究对象,根据过去一个月内期权的交易数据,以今日开盘价、收盘价、最高价、最低价、结算价、成交量、成交额、持仓量、涨停价和跌停价为解释变量,通过多元线性回归模型,预测该期权的明日收盘价。

下文由如下几部分构成:

第二部分介绍了本次研究的数据集,包括数据来源、和数据字段;

第三部分重点介绍了各个多元线性回归模型,包括全模型及异方差检验,残差的独立性检验、误差的正太分布检验和多种共线性检验,在第4小节和第5小节分别采用主成分回归和逐步回归对模型加以改善;

第四部分运用第三部分建立的各个模型对期权价格进行了预测;

第五部分对本文研究进行了总结并未来的研究加以展望。

二、数据说明

本次研究的数据来源于Wind资讯金融终端,从上面获取了“50ETF购12月1.95”这支期权自2016年10月24日至2016年11月24日(只包含工作日)共计24日的交易数据。经过整理后得到最终的数据字段,见表1。

表 1 期权交易数据字段

期权交易数据见附录1。

三、建模

1 符号说明

各个变量及其符号说明见表2。

表 2 各个变量及其符号说明

变量符号

明日收盘价Y

今日开盘价X1

今日收盘价X2

今日最高价X3

今日最低价X4

今日结算价X5

今日成交额X6

今日成交量X7

今日持仓量X8

今日涨停价X9

今日跌停价X10

2 解释变量与指标变量的散点图

在建立模型之前,首先利用MATLAB绘制各个解释变量与指标变量(明日收盘价)之间的散点图,观察各个解释变量与指标变量之间的关系,散点图结果见图1。

图 1 各个解释变量与指标变量(明日收盘价)的散点图

通过图一中的散点图可以看出,明日收盘价与今日收盘价、今日开盘价、今日最高价、今日最低价、今日结算价、今日持仓量、今日涨停价以及今日跌停价之间有较为明显的线性关系;而与今日成交额以及今日成交量之间的线性关系并不明显。

3 全模型

通过散点图我们观察到指标变量与各个解释变量之间大致上为线性关系,所以考虑多元线性回归模型进行建模。

3.1 模型建立与求解

首先建立各个解释变量与指标变量的全模型,即考虑如下模型:

{Y =β0+β1X 1+⋯+β10X 10+ εε∼N (0,σ2)

式中,β0,β1,…,β10,σ2都是与解释变量无关的未知参数,其中β0,β1,…,β10称为回归系数。

在MATLAB 中使用regress 函数即可求解此多元线性回归模型,求解结果见表3.

表 3 MATLAB 求解全模型结果

回归系数 回归系数的估计值

回归系数置信区间 β0 0.1555 -0.1938 0.5049 β1 1.8288 -0.9212 4.5787 β2 0.0586 -1.5671 1.6843 β3

0.6199

-0.4249 1.6647

相关文档
最新文档