定义#
协方差矩阵记录一组资产两两之间的共同波动幅度。对角线上是每个资产自己的方差,非对角线上是两个资产的协方差——正值代表倾向同涨同跌,负值代表反向,零代表没有线性关系。
它是几乎所有组合风险计算的输入:组合方差要用它算,最小方差组合、风险归因、对冲比例都建在它上面。麻烦也出在这里——它不是观测到的,而是估出来的,而估计误差会被优化器放大成离谱的权重。
公式#
其中 是 的协方差矩阵, 是权重向量。Ledoit-Wolf 收缩估计把不稳定的样本矩阵往一个结构简单的目标矩阵拉:
是样本协方差矩阵, 是结构化的目标矩阵, 是收缩强度,由数据自动定出,本质是在偏差和方差之间取平衡。
算一笔账#
两个资产,年化波动分别是 20% 和 30%,相关系数 0.4。协方差 。
等权组合的方差 ,波动率 。
再看维度问题:50 个资产的协方差矩阵有 个待估参数。若只用 250 个交易日的数据,等于拿 250 行样本去定 1275 个数——矩阵必然不稳定,某些方向的方差会被估成接近零,优化器就会往那些方向猛压仓位。
常见问题#
协方差和相关系数有什么区别?#
相关系数就是协方差除以两个标准差,把量纲去掉后压进 −1 到 1 之间,方便横向比较。协方差保留了幅度信息,所以组合风险计算用协方差;判断「关系强不强」时看相关系数更直观。
为什么组合优化器算出来的权重那么极端?#
因为它把协方差矩阵当成了真值。样本估计里那些偶然出现的低方差方向,在优化器眼里是免费的风险削减机会,于是仓位被推到极限;换一段样本,权重又翻天覆地。收缩估计正是为了抑制这个现象。
收缩强度该设多大?#
不用手工设。Ledoit-Wolf 方法会根据样本量和资产数量自动算出使估计误差最小的 ——资产多、样本短时收缩得更狠,样本充足时自然接近样本矩阵。手工调这个参数通常只是把一次拟合变成了一次调参。