核心观点
DeepSeek AI 通过发布 V3、R1 和 Janus-Pro 等创新模型,在多项评测中胜过主流开源模型,并具有成本优势,推动 AI 大模型降本,有望驱动大模型革新,促使 AI 服务更加普及和实惠。
关键数据和研究结论
- DeepSeek-V3:拥有 671B 总参数,每个令牌激活 37B,在性能上与 GPT-4o 和 Claude-3.5-Sonnet 等顶尖闭源模型相当,且训练成本仅为 557.6 万美元。
- DeepSeek-R1:在 AIME2024 基准测试中成绩提升显著,蒸馏模型性能卓越且为开源,有望推动端侧部署,带动 AI 终端时代来临。
- Janus-Pro:在多模态理解和文本到图像生成能力上实现重大突破,多模态理解能力方面在多个基准测试中超越 Janus、TokenFlow 和 MetaMorph 等模型,视觉生成能力方面在 GenEval 基准测试中总体准确率达 80%,超越了 Transfusion、SD3-Medium 和 DALL-E3 等统一或生成专用模型。
- Kimi k1.5:在数学、代码、多模态推理能力等方面全面对标 OpenAI o1,尤其是 kimi-k1.5-short,成为 SOTA short cot 模型,并大幅领先 GPT-4o 和 Claude 3.5 Sonnet(提升幅度高达 550%)。
- 豆包大模型 1.5 Pro:采用稀疏 MoE 架构,仅用较小参数激活的 MoE 模型,性能即可超过 Llama3.1-405B 等超大稠密预训练模型,多模态能力也得到全面提升。
- Qwen2.5-VL 和 Qwen2.5-1M:Qwen2.5-VL 能够更准确地解析图像内容,突破性地支持超 1 小时的视频理解,Qwen2.5-1M 在处理百万级别长文本输入时可实现近 7 倍的提速。
- Qwen2.5-Max:综合性能强劲,在多项公开主流模型评测基准上录得高分,全面超越了目前全球领先的开源 MoE 模型以及最大的开源稠密模型。
AI 端侧发展趋势
- DeepSeek-R1 同步开源多个蒸馏小模型,极大扩展了终端侧模型部署的可选性,促进 AI 的端侧应用落地。
- DeepSeek 将接入微软 AIPC,微软宣布专为神经处理单元(NPU)优化的 DeepSeek R1 模型即将登陆 Copilot+ PC(Windows 11 AI+ PC)。
- 英特尔 2023 年启动 AI PC 加速计划,推动 AI PC 生态的快速发展,目前已有超过 500 个 AI 模型支持 AI PC。
- AI PC 市场需求持续扩大,进入快速发展阶段,预计 2028 年占据 PC 市场主导地位。
- 智能眼镜行业发展路径:传统眼镜—>音频眼镜—>拍摄+音频眼镜—>多模态 AI 眼镜—>AR 眼镜。
- 巨头积极布局,智驾加速渗透,高速 NOA 渗透率持续走高,自主车企进展领先合资品牌。
- AI 玩具市场市场规模 2022-2030 CAGR 超过 16%,AI 陪伴正成为大模型能力突破 C 端落地困境的新希望。
行情回顾
本周申万电子板块涨幅为 6.14%,半导体和消费电子领域涨幅前五的个股分别为安凯微、龙迅股份、大为股份、长光华芯、芯海科技和光弘科技、福立旺、光大同创、苏州天脉、卓翼科技。
相关标的
- 国产算力:中芯国际、寒武纪、海光信息、景嘉微、深南电路、长电科技、通富微电、兴森科技、甬矽电子、盛科通信、华丰科技、泰嘉股份
- 消费电子:代工厂&终端、电池、结构件&功能件、散热、FPC、芯片、SoC、光学、智能硬件芯片、智能声学硬件、AR/VR 相关、智能手机、智能驾驶