金融数据及其特征
金融时间序列分析将是原本的线性时间序列分析的扩展 我们将补充金融时间序列的背景知识 扩展在原本的时间序列分析中学习的方法;并且在金融时间序列分析(多元)引入多元时间序列分析的问题
资产收益率
我们计Pt为某时刻资产的净值 时间单位不限制
简单收益率
单期简单毛收益率:
1+Rt=Pt−1Pt
单期简单净收益率,简单收益率:
Rt=Pt−1Pt−1=Pt−1Pt−Pt−1
k期简单毛收益率:
1+Rt[k]=Pt−kPt=j=0∏k−1(1+Rt−j).
k期净收益率:
Rt[k]=Pt−kPt−1=Pt−kPt−Pt−k
连续复利收益率
设某资产的的初始值为C,名义上的年利率为r,但是在一年内分成m次付息,理论上每次付息Cmr,最终的资产净值应为C+Cmr×m=C(1+r);
但是,因为提前付息,所以提前支付的利息也进入账户增值,从第二次付息开始,支付的利息就超过了Cmr,使得一年后的净值要高于C(1+r)。一年后的净值为
C(1+mr)m
当m→∞时,由极限limx→+∞(1+x1)x=e,可知
m→∞limC(1+mr)m=m→∞limC[(1+mr)rm]r=Cer.
这时r称为连续复利,它也对应某个时间单位(一般是年)
R=er−1是连续复利
r对应的实际利率,
r与
R的关系为
R=er−1,r=ln(1+R)
资产组合收益率
设有N项资产,在t−1时刻组合净值为
Ap,t−1=j=1∑NAi,t−1=Ap,t−1j=1∑Nwi
其中wi=Ai,t−1/Ap,t−1是第i项资产的权重
于是
Ap,t=j=1∑NAi,t−1(1+Ri,t)=Ap,t−1j=1∑nwi(1+Ri,t)=Ap,t−1(1+j=1∑nwiRi,t)
所以资产组合的简单收益率为
Rp,t=j=1∑nwiRi,t
注意其中wi是第t−1时刻的权重。如果继续计算Rp,t+1, 权重应该使用t时刻的权重。
当然,如果资产比例变化不大,使用不变的{wi}近似也是可以的。
对于对数收益率没有如此简单的公式。 当收益很小时近似有
rp,t≈j=1∑nwiri,t
红利支付与收益率
对价格Pt−1的某资产,如果在t−1到t之间每单位还支付Dt红利,则到t时刻时,收益为
Pt−Pt−1+Dt,所以这时收益率应计算为
Rt=Pt−1Pt−Pt−1+Dt,rt=ln(Pt+Dt)−lnPt−1
超额收益率
Zt=Rt−R0t,zt=rt−r0t
其中R0t和r0t是某项参考资产的收益率,如美国短期国债收益率。
超额收益率为负数 实际收益率为正数 依旧一般被认为是亏损
债劵收益率
债劵类型
投资者以市场价格买入债券,在到期日收回票面价格的现金。买入价格低于票面价格。从而赚取收益
有些债券还在持有期间定期派发利息,利息按照票面利率(coupon payment)和面额计算,比如,面值为100元,票面利率为6%, 如果每半年派发一次利息,则每次派息100×0.06/2=3元。有些债券不在中间派息,这样的债券称为零息债券。
当期收益率
当期收益率仅计算每年的表面收益,不考虑资金的时间成本。
当期收益率=买入价格每年派息额×100%
到期收益率
对于零息债券,持有期间没有任何利息收入。 如果购入价格为P, 面值为F,持有k年到期,则收益率为
(PF)1/k−1
这称为到期收益率(Yield To Maturity, YTM)。
如果持有期间有利息 那么计算将会比较复杂 分别计算每一个阶段的派息才能给出准确的结果 不过直接考虑简单收益率也未尝不可
对数收益率
对数收益率(Logarithmic Return),是金融学中常用的一种计算资产收益率的方法。它通过取自然对数的方式来衡量资产价格变化的百分比。对数收益率通常用于股票、债券、外汇等金融资产的收益计算。
定义为
rt=ln(Pt−1Pt)
我们之所以使用对数收益率,是因为
- 时间可加性:对数收益率在时间上是可加的,即多个连续时间段的对数收益率之和等于这些时间段的总对数收益率。这使得对数收益率非常适合用于长期投资收益的计算
- 对数收益率反映了资产价格的连续复合增长,这与金融资产的复利效应相符合
- 对数收益率对于价格的极端变化不敏感,这有助于减少异常值对收益率计算的影响。
- 我们一般假设对数收益率正态分布 但是它有着厚尾特性 这样普通的收益率服从对数正态分布
资产波动率
金融数据中最关心的除了资产价格、收益率, 就是资产波动率。 资产波动率度量某项资产的风险,波动率是期权定价和资产分配的关键因素。 波动率对计算风险管理中的VaR(风险值)有重要作用。 一些波动率指数已经成为金融工具本身
波动率的特征
波动率(volatility)指的是资产价格的波动强弱程度, 类似于概率论中随机变量标准差的概念。 波动率不能直接观测, 可以从资产收益率中看出波动率的一些特征 如
- 存在波动率聚集(volatility clustering)
- 波动率随时间连续变化,一般不出现波动率的跳跃式变动
- 波动率一般在固定的范围内变化,意味着动态的波动率是平稳的
- 在资产价格大幅上扬和大幅下跌两种情形下, 波动率的反映不同, 大幅下跌时波动率一般也更大, 这种现象称为杠杆效应(leverage effect)
这些性质对波动率模型的提出、改进有重要意义, 许多新的波动率模型都是诊断原有模型不能反映上面的某型特征而提出的
不同的波动率计算方法使用不同的数据源 股票的三种数据源有
- 每个交易日的日收益率;
- 伴随IBM股票的期权数据
- 盘中交易和报价的分笔数据;
分别可以计算如下三种不同的波动率:
- 作为日收益率的条件标准差(或条件方差) 本章的模型是针对这种波动率定义。
- 隐含波动率:根据期权的理论公式如BS公式, 从股票价格和期权价格数据反解出模型中的波动率, 这样的得到的波动率称为隐含波动率。 隐含波动率倾向于比用日收益率建模得到的波动率数值要大。 CBOE的VIX指数就是隐含波动率。
- 实际波动率:利用一天内所有的收益率数据, 如每5分钟的收益率,估计一天收益率的方差(波动率平方)。 已实现波动率(realized volatility, RV)是这样的波动率
类似于利率, 度量波动率的时间区间一般也取为一年, 波动率一般是年化波动率。 如果有了日波动率, 可以将其乘以转换252成年化的波动率
波动率模型的结构
我们从一元波动率模型开始我们的介绍;一元波动率模型就是试图刻画收益率本身不相关或低阶自相关, 但是不独立的性质 比如我们发现一个序列通过了白噪声检验 ACF也体现了基本没有的相关性 但是如果作绝对值(或平方等运算)以后就无法通过白噪声检验并且ACF体现了自相关性
用Ft−1表示截止到t−1时刻的收益率信息,尤其是包括这些收益率的线性组合,考察rt在Ft−1条件下的条件均值和条件方差:
μt=E(rt∣Ft−1),σt2=Var(rt∣Ft−1)=E[(rt−μt)2∣Ft−1]
通过分析实例的经验可知,、{rt}通常比较简单,如平稳ARMA(p,q)序列。
对一般的对数收益率{rt},设其服从ARMA(p,q)模型:
rt=ϕ0+j=1∑pϕjrt−j+at+j=1∑qθjat−j
其中{at}为不相关的白噪声列 于是
μt=E(rt∣Ft−1)=ϕ0+j=1∑pϕjrt−j+j=1∑qθjat−j=rt−at
这里我们对白噪声列假定at=rt−E(rt∣Ft−1),称这样的白噪声列{at}为平稳列{rt}的新息列(innovation)或扰动列
rt可分解为(移项)
rt=μt+at.
如果可以获得其他的解释变量(外生变量),可以建立模型rt=μt+at,其中
μt=ϕ0+i=1∑kβixi,t−1+j=1∑pϕjyt−j+j=1∑qθjat−j
其中xi,t−1是第i个解释变量在t−1时刻的值,yt−j是剔除解释变量影响后的rt−j的值。(这就是回归引入了时间序列误差线性时间序列分析 的“含有时间序列误差的回归模型”一节)
μt服从的ARMA
(p,q)的阶与数据的采样频率有关,股票指数的日频数据往往有较小的前后相关性,月度数据则可能没有任何显著的前后相关。
**现在我们建立了一个结构,整体思想试:原本的基本时间序列可以分解为均值列和新息列的和,均值列可以用含有时间序列误差的回归模型估计,新息列不相关
我们曾经的时间序列建模结构线性时间序列分析都是在对均值列建模,新息列视为随机误差,现在这里要有变化了
综合前面的结构有
σt2=Var(rt∣Ft−1)=Var(at∣Ft−1)=E(at2∣Ft−1).
这里的σt就是波动率,是收益率的条件标准差。如果假设模型中的白噪声{at}是独立序列,则σt2≡σ2 ,波动率就没有建模的可能。这里假定{at}是零均值不相关平稳列,满足E(at∣Ft−1)=0,但不是独立序列。
本章的问题就是对σt2建模,这种模型叫做条件异方差模型。条件异方差模型分为两类:
- 用确定函数来刻画σt2的变化,ARCH和GARCH模型属于这一类;
- 用随机方程描述σt2的变化,随机波动率(SV)模型属于这一类。
μt 的模型称为
rt的均值方程,
σt2的模型称为
rt的波动率方程。条件异方差模型就是在原来对
rt的均值
μt建模的基础上,再增加一个描述资产收益率的条件方差随时间变化的模型。这可以更精确刻画给定
r1,r2,…,rt后
rt+1所服从的条件分布。
建立波动率模型的步骤
对资产收益率序列建立波动率模型需要如下四个步骤:
- 通过检验序列的自相关性建立均值项的方程, 必要时还可以引入适当的解释变量;
- 对均值方程的残差作白噪声检验, 通过后,对残差检验ARCH效应;
- 如果ARCH效应检验结果显著, 则指定一个波动率模型, 对均值方程和波动率方程进行联合估计;
- 对得到的模型进行验证, 需要时做改进。
ARCH模型
ARCH效应检验
我们自然的知道 想要知道是否需要ARCH模型 首先需要对ARCH效应作检验
为了检验ARCH效应,先建立均值模型,拟合μt,计算残差at=rt−μt。用残差序列的平方{at2}作ARCH效应检验。
有两种检验方法。一种是对{at2}作Ljung-Box白噪声检验,检验不显著时没有ARCH效应,检验显著时有ARCH效应。
另一种检验方法是R.F.Engle提出的。 考虑如下的最小二乘问题:
at2=α0+α1at−12+⋯+αmat−m2+et,t=m+1,…,T
其中T为样本量,m是适当的AR阶数,et为回归残差。零假设为
H0:α1=⋯=αm=0
拒绝H0时有ARCH效应。 这称为Engle的拉格朗日乘子法检验。
这就是OLS的方程显著性检验 线性回归基础 的“回归方程的显著性检验”一节
ARCH公式
ARCH模型(自回归条件异方差模型)是对波动率的建模的最基础模型 我们的基本思想是
- 资产收益率的扰动序列at=rt−E(rt∣Ft−1)是前后不相关的,但是前后不独立。
- at的不独立性,描述为Var(rt∣Ft−1)=Var(at∣Ft−1) 可以用at2的滞后值的线性组合表示。
其中Ft=σ({rt,rt−1,…})
具体地,ARCH(m)模型为
at=σtεt,σt2=α0+α1at−12+⋯+αmat−m2.
其中{εt}是零均值单位方差的独立同分布白噪声,α0>0,αj≥0,j=1,2,…,m,另外{αj}还需要满足一些条件使得Var(at)有限,类似于AR(p)序列的平稳性的特征根条件。
本质上这里就是一个AR(p) 序列来估计方差
第一行体现了随机性,第二行体现了波动率隐含的确定性 ^03b43c
在波动率方程的右侧,仅出现了截止到t−1时刻的 at−1,…,at−m的确定性函数而没有新增的随机扰动,所以称ARCH模型为确定性的波动率模型,这意味着σt2关于Ft−1可测,即在t−1时刻可以确定条件方差σt2的值。
εt的分布常取为标准正态分布,标准化的t分布,广义误差分布(Generalized Error Distribution), 有些情况下还取为有偏的分布。
如果εt∼N(0,1), 记μt=E(rt∣Ft−1), 考虑p=1情形,则
rt∣Ft−1∼N(μt,σt2)=N(μt,α0+α1at−12).
所以在ARCH模型中εt的分布称为“条件分布”, 即在Ft−1条件下rt的条件分布的类型。
因为at=rt−E(rt∣Ft−1)所以Eat=0, E(at∣Ft−1)=0。由{εt}独立可知 εt与Ft−1独立,从而与σt2独立,于是
Var(rt∣Ft−1)===E[(rt−E(rt∣Ft−1))2∣Ft−1]=E(at2∣Ft−1)E(εt2σt2∣Ft−1)=σt2E(εt2∣Ft−1)=σt2α0+α1at−12+⋯+αmat−m2.
即前一节给出了rt的条件方差方程。
因为系数αj都是非负数,所以历史值at−j2较大意味着at的条件方差较大,于是在ARCH模型框架下,大的扰动后面倾向于会出现较大的扰动。
这里“倾向于”不是指一定会出现大的扰动,因为at−j2较大使得条件方差σt2较大,而方差大只能说出现较大的at的概率变大,而不是一定会出现大的扰动at。这种现象能够解释资产收益率的波动率聚集现象。
现在我们有多种序列和研究的对象,
- 我们研究原始的收益率序列rt 以及他的方差σt2
- 我们研究rt减除了趋势项以后的波动项序列at 计算他需要使用随机波动ϵt和收益率序列的方差 σt2
- 想要估计收益率序列的方差σt2则需要使用at2滞后的线性组合
注意:有些作者用ht=σt2作为条件方差的记号,这时扰动at=εtht。
ARCH模型的性质
我们以最简单的ARCH模型为例
at=σtεt,σt2=α0+α1at−12.
其中α0>0,0<α1<1。
α1>0是因为如果等于零就不能算ARCH(1),
α1<1是为了
at方差有限。
新息性质
令Ft=σ({rt,rt−1,…}) 按at定义,
at=rt−E(rt∣Ft−1),
{at}称为
{rt}的新息序列(innovation series)。
他满足
E(at∣Ft−1)==E[rt−E(rt∣Ft−1)∣Ft−1]E(rt∣Ft−1)−E(rt∣Ft−1)=0,
实际上
E(at)=E[E(at∣Ft−1)]=0.
计算方差有
因为Var(at)为常数,所以这要求0<α1<1。Var(at)=E(at2)=E[E(at2∣Ft−1)]E[E(σt2εt2∣Ft−1)]=E[σt2E(εt2∣Ft−1)]E[σt2E(εt2)]=E(σt2)=α0+α1E(at−12).Var(at)=E(at2)=1−α1α0.
AR模型
所谓的ARCH效应,在数据上就是{rt}本身表现为白噪声,但是{rt2}具有明显的相关性。以前面一节的例子为例,
若rt=at, 可以证明rt2服从一个AR(1)模型
一般化的ARCH模型的性质
其性质和我们在前面讨论的简单例子类似 最核心的就是新息性质
ARCH模型优缺点
优点:
- 可以产生波动率聚集(广泛存在于金融时间序列的特点)
- 扰动at具有厚尾分布(广泛存在于金融时间序列的特点)
缺点
- 因为假定at−j通过at−j2影响波动率σt,所以正的扰动和负的扰动对波动率影响相同,但是实际的资产收益率中正负扰动对波动率影响不同,较大的负扰动比正扰动引起的波动更大。
- ARCH模型对模型参数有较严格的约束条件,即使是ARCH(1),为了能计算峰度,也需要α1∈(0,33),高阶的ARCH(m)的约束条件更为复杂。这对带高斯新息的ARCH模型通过超额峰度表达厚尾性是一个限制
- 只能描述条件方差的变化,但是不能解释变化的原因。
- 由模型做的波动率预测会偏高。
- 可能需要较大的m。
ARCH模型建模方法
定阶
在ARCH效应检验显著后本文“ARCH效应检验”一节 可以考察{at2} 的PCAF来进行定阶
首先,模型为
σt2=α0+α1at−12+⋯+αmat−m2
因为E(at2∣Ft−1)=σt2,所以认为近似有
at2≈α0+α1at−12+⋯+αmat−m2
这样可以用{at2}序列的PACF的截尾性来估计ARCH阶m。
如果定阶发现需要过高阶的AR模型 那么可能ARCH模型不太适用于此序列
模型估计
我们在公式出介绍过 实际上ARCH模型的估计应该分为两个步骤
参见本文“相关段落”一节。
模型的似然函数与假定的ϵt的分布有关, 存在多种似然函数形式。
正态分布
当假定εt为独立同标准正态分布分布随机变量列时 条件对数似然函数为
ℓ(am+1,…,aT∣α)=−21t=m+1∑T[lnσt2+σt2at2]+常数项
t分布
因为收益率分布厚尾, 有些应用中假设服从标准化t分布 先验的设计t分布的自由度以后
=ℓ(am+1,…,aT∣v,α,a1,…,am)(T−m)[lnΓ(2v+1)−lnΓ(2v)−21ln((v−2)π)]+ℓ(am+1,…,aT∣α,a1,…,am).
有偏t分布
资产收益率分布除了厚尾之外还常常有偏。可以修改t分布使其变成标准化的有偏的单峰密度。有多种方法可以做这种修改,这里使用(Fernandez and Steel)的做法。该方法可以在任何连续单峰且关于0对称的一元分布中引入有偏性。将t(v)分布进行有偏化后密度为
g(ε∣v,ξ)={ξ+ξ12c2f(ξ(c2εt+c1)∣v),ξ+ξ12c2f((c2εt+c1)/ξ∣v),εt<−c2c1,εt≥−c2c1.
广义误差分布假设
εt的另一种可取分布是广义误差分布(GED),密度为
f(x∣v)=λ21+v1Γ(v1)ve−21∣λw∣v,x∈(−∞,∞)(0<v≤∞).
其中v=2时即标准正态分布,0<v<2时为厚尾分布。
λ=[2−v2Γ(v3)Γ(v1)]21.
模型验证
对一个建立好的ARCH模型,可计算标准化残差
a~t=σtat,
其中at是均值方程的残差,σt是波动率方程拟合的值。{a~t}应表现为零均值、单位标准差的独立同分布序列。
- 对{a~t}作Ljung-Box白噪声检验,可以考察均值方程的充分性。
- 对{a~t2}作Ljung-Box白噪声检验,可以考察波动率方程的充分性。
- {a~t}的偏度、峰度、QQ图可以用来与εt的假定分布比较,以检验模型假定的正确性。
预测
ARCH模型的预测类似AR模型的预测。从预测原点h出发,对σt2序列作超前一步预测,即预测σh+12,有
σh2(1)=σh+12=α0+α1ah2+⋯+αmah+1−m2.
要做超前2步预测时,因为ah+1未知,有 E(ah+12∣Fh)=σh2(1),所以
σh2(2)=α0+α1σh2(1)+α2ah2+⋯+αmah+2−m2.
一般地,σh2(ℓ)可以滚动计算,
σh2(ℓ)=α0+j=1∑mαjσh2(ℓ−j).
GARCH模型
ARCH模型用来描述波动率能得到很好的效果, 但实际建模时可能需要较高的阶数, 考虑类似从AR推广到ARMA的模型变化。
GARCH模型方程
(Bollerslev 1986)提出了ARCH模型的一种重要推广模型,称为GARCH模型。 对于一个对数收益率序列rt,令at=rt−μt=rt−E(rt∣Ft−1)为其新息序列,称{at}服从GARCH(m,s)模型,如果at满足
at=σtεt,σt2=α0+i=1∑mαiat−i2+j=1∑sβjσt−j2
其中{εt}为零均值单位方差的独立同分布白噪声列,α0>0,αi≥0,βj≥0,
0<∑i=1mαi+∑j=1sβj<1,这最后一个条件用来保证满足模型的
at的无条件方差有限且不变,而条件方差
σt2可以随时间
t而变。
GARCH模型性质
下面以最简单的GARCH(1,1)为例研究GARCH模型的性质。 令Ft−1表示截止到t−1时刻的at−i和σt−j所包含的信息。模型为
at=σtεt,εt i.i.d. WN(0,1),σt2=α0+α1at−12+β1σt−12.
为了计算无条件均值Eat,先计算条件期望
E(at∣Ft−1)=E(σtεt∣Ft−1)=σtE(εt∣Ft−1)=0.
这里用了σt∈Ft−1而εt与Ft−1独立。于是
Eat=E[E(at∣Ft−1)]=0.
即GARCH模型的新息at的无条件期望为零。
来计算at的无条件方差。 设模型(18.1)的{at}序列存在严平稳解,则
Var(at)=====E(at2)=E[E(at2∣Ft−1)]=E[E(σt2εt2∣Ft−1)]E[σt2E(εt2∣Ft−1)]=E[σt2E(εt2)]E[σt2]=E[α0+α1αt−12+β1σt−12]α0+α1E(at−12)+β1E[E(at−12∣Ft−2)]α0+(α1+β1)E(at−12).
令Eat2=Eat−12,解得
Var(at)=Eat2=1−α1−β1α0.
这些研究和本文“ARCH模型的性质”一节没有区别
总结有:
第一,像ARCH模型一样,at存在波动率聚集,一个较大的at−1或σt−1使得1步以后的条件方差变大,从而倾向于出现较大的对数收益率。
第二,当εt为标准正态分布时,在如下条件下at有无条件四阶矩:
1−2α12−(α1+β1)2>0.
这时超额峰度为
(Eat2)2Eat4−3=1−(α1+β1)2−2α122[1−(α1+β1)2+α12]>0.
即at分布厚尾。但是,对实际数据建模时即使使用条件t分布,对数据的厚尾性的拟合仍可能不足。
第三,GARCH模型给出了一个比较简单的波动率模型。
第四,因为σt2对at−i的依赖是通过at−i2,所以一个取正值的扰动at−i和一个取负值的at−i,只要绝对值相等,对后续波动率的影响就是相等的,不能体现杠杆效应。
预测
可以用类似ARMA预测的方法预测波动率。 仍以GARCH(1,1)为例 进行超前一步预测有
σh+12=α0+α1ah2+β1σh2∈Fh.
迭代生成ah+1 计算两步预测有
σh+22===α0+α1ah+12+β1σh+12α0+α1σh+12εh+12+β1σh+12α0+(α1εh+12+β1)σh+12
借此实现循环 进行超前多步预测有
σh2(ℓ)→1−α1−β1α0=Var(at).
也就是超前多步条件方差预测趋于at的无条件方差
模型估计
ARCH模型的建模步骤也适用于GARCH模型的建模。 GARCH模型的定阶方法研究不多 使用类似于ARMA模型研究方法就基本已经足够 一般我们不会使用过高阶数的GARCH模型 也就是最高不超过GARCH(2,2) 此时使用试错法也是可以接受的
模型的检验方法完全参考 本文“模型验证”一节 通过考察标准化残差来考察模型的估计效果
两步估计法
在传统的GARCH建模中 我们使用的估计方法是本文“ARCH模型建模方法”一节 直接对整个模型进行极大似然估计
在很多的研究中我们提出如下的两步估计方法来估计GARCH模型
- 忽略ARCH效应, 用线性时间序列建模方法(如最大似然估计)对收益率序列建立均值方程。 残差序列用at表示
- 将{at2}作为观测序列,可以用最大似然估计方法估计参数。用ϕ^i和θ^i分别表示AR和MA部分的系数估计值。则GARCH模型参数估计为β^i=−θ^i,α^i=ϕ^i+θ^i。这种估计方法只是一种近似,没有理论结果证明其合理性,但是一些经验显示这样的估计往往能够给出不错的近似结果,尤其是大中样本情形
IGARCH
我们考虑向ARIMA模型的扩展
GARCH模型可以写成(18.2)这样的关于at2的ARMA形式,其中ηt=at2−σt2是模型的扰动,是鞅差白噪声:
at2=α0+i=1∑max(m,s)(αi+βi)at−i2+ηt−j=1∑sβjηt−j,
如果这个模型中的AR部分有单位根 (有特征根等于1), 则对应的模型不再满足GARCH模型条件,称为IGARCH模型,或单位根GARCH模型。类似于ARIMA模型,IGARCH模型的扰动ηt=at2−σt2对at2的影响是持久的、不衰减的。
IGARCH(1,1)模型可以写成
at=σtεt,σt2=α0+α1at−12+(1−α1)σt−12.
GARCH-M模型
有些金融资产的收益率的条件均值受到其波动率的影响,称为风险溢价。GARCH-M模型就是用来描述这样的现象,M表示条件均值依赖于GARCH模型。 一种简单的GARCH-M(1,1)模型为
rt=μ+cσt2+at,at=σtεt,σt2=α0+α1at−12+β1σt−12
模型中的收益率条件均值为 E(rt∣Ft−1)=μ+cσt2 需要用条件方差σt2=Var(rt∣Ft−1)描述。参数c称为风险溢价参数,如果c为正值则收益率与波动率正相关。
文献中还有其他的风险溢价模型形式,如
rt=μ+cσt+atrt=μ+clnσt2+at
收益率rt不再是不相关列,而是序列相关的,相关性来自σt2的序列相关性。 风险溢价的存在是股票收益率具有序列相关性的原因之一。
扩展GARCH
本章讲GARCH模型的一些有针对性的改进 暂时没有细致的整理
EGARCH
(Nelson 1991)提出的指数GARCH(EGARCH)模型允许正负资产收益率对波动率有不对称的影响。 考虑如下变换
g(εt)=αεt+γ[∣εt∣−E∣εt∣],
其中α和γ是实常数。{εt}和{∣εt∣−E∣εt∣}都分别是零均值独立同分布白噪声,分布为连续分布。易见
Eg(εt)=0。
由下式可见g(εt)的分布是非对称的:
g(εt)={(α+γ)εt−γE∣εt∣,(α−γ)εt−γE∣εt∣,εt≥0,εt<0.
当εt∼N(0,1)时E∣εt∣=π2。 对式(17.6)中的标准t分布,有
E∣εt∣=(v−1)Γ(2v)π2v−2Γ(2v+1).
EGARCH(m,s)模型可以用滞后算子的形式写成
at=σtεt,lnσt2=α0′+1−β1B−⋯−βsBs1+α2B+⋯+αmBm−1g(εt−1)
α0′为常数,其中
B是滞后算子,多项式
1+α2z+⋯+αmzm−1和
1−β1z−⋯−βmzm的根都在
单位圆外且两个多项式没有公因子。
注意这里的模型阶相当于GARCH(m,s)
记ξt=lnσt2,则(19.3)给出的ξt为一个平稳线性ARMA(s,m−1)序列,以零均值独立同分布白噪声g(εt−1)为新息;但是,lnσt2通过εt−j=at−j/σt−j对{at}序列依赖。原始的GARCH模型的σt2的方程是直接依赖于at−j2的,±at−j对σt2影响相同。
易见Elnσt2=α0′。
更一般地,可以令g(⋅)中的γ随滞后j变化,模型变成:
at=lnσt2=σtεt,α0+j=1∑m[αjεt−j+γj(∣εt−j∣−E∣εt−j∣)]+i=1∑sβilnσt−i2.
(19.4)
在(19.4)中,αj代表了对数收益率的正负扰动对波动率的不同影响,如果αj=0,则正负扰动对波动率
影响就相同了。
EGARCH与GARCH模型的区别还有:
- 使用条件方差的对数建模,因为对数值可正可负,这就取消了GARCH模型对系数必须非负的限制。2. g(εt−j)=g(at−j/σt−j)的使用使得波动率对at−j的依赖关系与at−j的正负号有关,可以用来描述正
负收益率对波动率的不同的影响,即杠杆效应。
GJR-GARCH
GJR-GARCH模型是另一个能够反映杠杆效应的波动率模型,参见(Glosten,Jagannathan,and Runkle
1993)和(Zakoian 1994)。 或称为TGARCH。 GJR-GARCH(m,s)模型的形式为
σt2=α0+i=1∑m(αi+γiNt−i)at−i2+j=1∑sβjσt−j2
(19.9)
其中Nt−i是表示at−i<0的示性函数,即
Nt−i={1,0,at−i<0at−i≥0
αi,γi,βj是非负参数,满足与GARCH模型类似的参数条件。
正的at−i对σt2的影响为αiat−i2,负的at−i对σt2的影响为(αi+γi)at−i2,当γi>0时负的at−i影响较大。
模型用0作为at−i的门限,还可以用其它实数值作为门限。关于门限模型参见(Tsay 2010)第4章。
ARARCH模型
Ding,Granger.and Engle提出了非对称幂(asymmetric power) ARCH模型(APARCH模型), 模型形式为
rt=μt+at,at=σtεt,εt∼D(0,1)σtδ=ω+i=1∑mαi(∣at−i∣−γiat−i)δ+j=1∑sβjσt−jδ
其中μt是条件均值,D(0,1)表示某个零均值单位方差分布,δ为正实数,系数ω,αi,γi,βj满足某些正则性条件使得波动率为正。
最常用的是最简单的APARCH(1,1)模型。这个模型中包含了许多其它模型。
当δ=2且γj=0时即普通的GARCH模型。
当δ=2时即TGARCH模型(形式略有不同)。
当δ=1时波动率方程直接使用波动率σt和新息at而非其平方。APARCH中的幂变换旨在提高拟合程度,但幂次δ没有很好解释。
普通随机波动率SV模型
前面的波动率方程中σt2=Var(at∣Ft−1)都是被σt−1,…和 at−1,…完全决定。另一种方法是假定σt2的模型本身有新息,这样的模型称为随机波动率(Stochastic Volatility, SV)模型。模型写成
at=σtεt,(1−α1B−⋯−αmBm)lnσt2=α0+vt.
其中σt2取对数是为了取消系数必须为非负的限制。{εt}独立同标准正态分布,{vt}独立同N(0,σv2)分布, {εt}和{vt}相互独立。αi为常数,特征多项式1−α1z−⋯−αmzm根都在单位圆外。记ξt=lnσt2 ,则{ξt}是一个严平稳AR(m)序列。
加入vt新息后,收益率rt的一个新息at就包含了εt和vt两个新息,这增加了模型的自由度,但是使得从rt数据估计模型参数变得更加困难,需要使用Kalman滤波或者随机模拟方法计算拟似然估计。
SV模型经常在拟合上有所改善, 但是波动率的样本外预测时好时坏
长记忆随机波动率模型
对资产收益率的实证分析发现,收益率本身没有长记忆性,但是其平方序列或者绝对值序列的ACF往往衰减很慢。 前面GARCH类模型的建模中σt−12的系数很接近于1,也提示有长记忆。
简单的长记忆随机波动率(LMSV)模型可以写成
at=σtεt,σt=σe21ut,(1−B)dut=ηt.
其中σ>0, {εt}和{ηt}是两个相互独立的独立同分布高斯白噪声列,εt∼N(0,1),ηt∼N(0,ση2),0<d<0.5。长记忆来源于分数差分(1−B)d,这使得ut的ACF以负幂速度衰减而非负指数速度衰减。
对LMSV有
lnat2===ln(σt2εt2)=lnσ2+ut+lnεt2(lnσ2+Elnεt2)+ut+(lnεt2−Elnεt2)μ+ut+et.
其中ut是一个长记忆的平稳高斯时间序列,et是一个非高斯的独立同分布白噪声列。
LMSV估计比较复杂,分数参数d可以用拟最大似然估计法或者回归方法估计。