DeepSeek开源模型助推银行业应用跃迁
核心观点与关键数据
- DeepSeek模型性能:DeepSeek模型在Post-Train阶段大规模应用强化学习方法,R1-Zero版本模型使用纯强化学习方法,推理能力显著提升,展现高准确率和long-CoT能力。
- 模型架构与优化:DeepSeek通过优化训练方法降低算力消耗,采用MoE架构、多头潜注意力机制(MLA)、冷启动+大规模强化学习、大规模跨节点专家并行(EP)等技术,适配银行高并行、高响应业务场景。
- 开源模型竞争力:DeepSeek R1等开源模型能力接近闭源模型,如OpenAI o1,压缩闭源模型生存空间,使各行业机构轻松获取前沿模型能力并私有化部署。
- 成本与利润率:DeepSeek低价策略下理论成本利润率高达545%,部署成本极低,通过优化可进一步降低成本。
- QwQ-32B模型:阿里开源的QwQ-32B模型性能对标DeepSeek-R1,大幅降低部署成本,支持消费级显卡本地运行,集成智能体能力,满足快速响应及数据安全需求。
- 蒸馏小型模型:DeepSeek开源R1蒸馏版本,如15亿到700亿参数模型,展现Test-time Scaling,支持多项基础业务场景,如李飞飞团队s1模型仅用1000个微调示例达到类似r1的准确度。
- 非结构化数据分析:DeepSeek通过API接口或数据中台架构实现与传统银行技术系统的数据交互,释放海量私域数据价值,Post-Train阶段模型具备更强的自主推理能力。
- 多模态模型:Janus-Pro等开源多模态模型在多模态理解和文本到图像生成方面取得重大进步,超越DALL-E 3和Stable Diffusion 3-Medium。
金融应用层次
- 降本增效:大模型承担智能客服角色,如工商银行结合知识搜索与大模型生成能力实现智能客服;助力信贷审批,如苏商银行将信贷材料综合识别准确率提升至97%以上;智能合同质检,如江苏银行利用DeepSeek-VL2模型提升效率与准确性。
- 价值创造:AI编程赋能开发,如澳新银行实验显示AI编程助手使软件开发人员平均生产率提高42%;智能风控,如重庆农村商业银行利用DeepSeek模型动态识别欺诈行为;AI赋能实现个性化智能营销,如北京银行部署DeepSeek系列模型在营销场景落地应用。
- 决策赋能:高级分析能力赋能管理决策,如OpenAI的Deep Research功能支持查找、分析和综合数百个在线资源创建综合报告。
落地进展与重要选择
- 大行与中小银行:大行如工商银行、建设银行等大力投入大模型研发并多场景探索应用,中小银行多以单场景切入探索更多应用。
- AI一体机:大模型本地部署需专业技术支持,AI一体机凭借开箱即用、软硬件一体化等优势成为银行智能化转型的重要选择,如宇信科技、京北方、天阳科技等已推出相关解决方案。
各银行DeepSeek落地进展
- 工商银行:引入DeepSeek开源模型构建财报分析助手、AI财富管家等场景。
- 建设银行:总行完成DeepSeek定制化训练,子公司按需调用模型,建信理财探索资产配置优化等理财场景。
- 邮储银行:本地部署DeepSeek-V3和DeepSeek-R1模型应用于智能客服“小邮助手”。
- 招商银行:“AI理财顾问”引入DeepSeek-VL2模型实现个性化理财建议定制。
- 兴业银行:完成DeepSeek初步测试,计划集成到投研分析系统中。
- 浦发银行:基于昇腾Atlas 800T A2算力集群部署DeepSeek-R1模型,赋能智能问答、指标问答等场景。
- 江苏银行:部署DeepSeek-VL2和R1模型,合同质检准确率达96%,自动化估值对账场景日均节省人工工作量。
风险提示
- AI技术落地不及预期的风险。
- 行业竞争加剧的风险。
- 报告信息更新不及时的风险。