国金证券金融工程行业研究框架培训内容总结
培训目的与内容概述
国金证券研究所的行业研究框架培训旨在帮助投资者掌握量化选股技术框架,通过系统化的方法论指导研究过程,避免弯路。培训内容涵盖多因子模型发展、数据处理、单因子检验、线性和AI多因子模型、风险模型及投资组合管理,强调研究所的全产业链覆盖和团队经验。
多因子模型体系关键环节
多因子模型体系包括数据管理、预处理、阿尔法模型和分析模型构建。本次培训重点讲解阿尔法模型、风险模型及投资管理理论,涵盖数据管理、单因子检验、多因子模型构建等环节。
量化选股技术框架发展历程
量化选股技术框架自20世纪八九十年代发展至今,经历了从单因子测试产品到价值与动量因子线性组合,再到全球金融危机后的精细化因子挖掘和择时探索。当前,高频数据、舆情数据及AI模型等新技术的应用日益广泛。
多因子模型基本假设
多因子模型假设股票收益率由特定定价因子的暴露决定,将预期收益率拆分为因子配置收益(被定价因子解释部分)和阿尔法项(市场意向收益)。
数据处理方法
- 异常值处理:固定比例法、均值方差法、MID法等。
- 数据标准化:Z-score标准化、排名正态标准化法等。
- 缺失值填充:直接删除或统计量填充(均值、中位数等),回归填充等。
- 证券化处理:通过回归法去除目标因子与其他因子的相关性。
单因子检验方法及有效因子评估
- 有效因子条件:经济学逻辑、持续性、增量信息、低参数敏感性、数据稳定性。
- 因子评估方法:
- 多空组合法:构建多头和空头组合,通过收益率、波动率、夏普比率等指标评估因子表现,但存在信息浪费、线性假设等问题。
- 信息系数IC:衡量因子值与股票收益率之间的截面相关性,通过均值、标准差、T值等统计量评估因子有效性。
线性多因子模型
- 模型原理:通过预测因子未来收益并配置权重来预测股票收益。
- 因子选择与配置:选取合适因子并进行权重配置,需考虑因子贡献性避免解释力降低。
- 因子加权方法:等权、基于IC/ICR2加权、全局最小发展风险加权等。
非线性特征与模型构建
- 问题:许多因子与股票收益率呈现非线性特征,线性模型难以适应。
- 解决方案:使用A模型等学习算法或另类算法构建预测模型,擅长处理非线性问题。
- A模型数据与标准化:涵盖基本面、技术面、市场情绪、宏观经济等数据,进行数据集层面的标准化(disco或minmax)。
- 常见应用模型:决策树(特征划分与经济系数计算)、神经网络(循环迭代训练,如加U和ISI模型)。
AI选股模型构建过程
- 步骤:输入特征、数据标准化、模型训练、超参数调优,最终输出预测信号。
- 示例:结合基橘子树和特定因子构建多因子模型,兼顾收益持续性和稳定性。
风险模型
- 作用:预测风险,用于组合优化(股票间相关系数估计)和业绩归因分析。
- 分类:宏观风险模型、镜面风险模型、统计风险模型(如八月模型)。
- 八月模型:基本面风险模型,核心是对协方差矩阵进行降维处理。
投资组合管理
- 组合构建形式:
- 主观加权:基于个人偏好设置股票权重。
- 系统化加权:简单加权、加权、波动率倒数加权等。
- 优化方式:均值方差优化模型(设定波动率目标并最大化预期收益率)。
- 现代机构更多采用优化方式构建投资组合。