您的浏览器禁用了JavaScript(一种计算机语言,用以实现您与网页的交互),请解除该禁用,或者联系我们。 [未知机构]:国金DeepSeek V4s测评及本地部署方案会 - 发现报告

国金DeepSeek V4s测评及本地部署方案会

2026-08-12 未知机构 Yàng
报告封面

发布时间:2026-08-12 一、核心要点 1. 本次会议为DeepSeek V4s测评及本地部署的专业交流,由国金证券金融工程团队举办,面向专业投资机构客户。2. 会议对DeepSeek V4s、Kimi K3、智谱GLM5.2三款国产模型,在估值建模、多因子选股、半导体产业链研究三类金融投研任务上做横向对比测评。3. DeepSeek V4s价格优势显著,当前输入100万token仅1元,输出2元,涨价一倍后仍比竞品低5倍以上;模型规模仅248B,比DeepSeek R1小约1/3,输出速度较快,单token输出速度可达31.9token/秒(六并发场景)。 二、测评结果 1. 估值建模任务:Kimi K3表现最优,逻辑拆解颗粒度最细;DeepSeek V4s在国产模型中底稿工程质量最佳,关联关系完善,但收入拆解较粗,排第二;GLM5.2底稿可用性差,公式异常无法正常计算,排第三。 2. 多因子选股任务:DeepSeek V4s表现最优,是唯一考虑单边千三交易成本的模型,回测策略有明确超额收益,底稿明细完整;Kimi K3未扣交易成本,收益被高估;GLM5.2未区分信号日与交易成本,底稿不完善。 3. 半导体产业链研究任务:Kimi K3表现最优,有完整六维度投资评分体系,推导清晰;DeepSeek V4s次之,覆盖20多只成分股核心数据,知识库可核对;GLM5.2不可核查,排第三。 三、本地部署方案 1. DeepSeek V4s为轻量级模型,本地部署对GPU要求较高:官方推荐用SGLang等框架,满血版需4张英伟达H200或8张B200(单卡显存140G以上),成本较高。2. 个人轻量化部署可选用量化版:Mac Studio(M3 Ultra等)搭配100G以上内存,可部署Q2/Q3量化版(约90-104G),社区测试单机双96G显存显卡可实现约100token/秒的输出速度。 四、风险与关注 1. DeepSeek V4s并非多模态模型,文本外场景能力有限。2. 金融投研任务测评仅覆盖三类典型场景,未包含更多复杂细分场景。3. 后续需关注DeepSeek Pro发布情况及国产模型对海外模型的赶超进展。