核心观点与关键数据
- WAIC2025大会聚焦AI核心领域:本次大会重点展示了多种大模型及智能体、AI算力芯片和服务器,涵盖“学术突破、软硬结合、全球治理”等亮点。
- 国产AI大模型及智能体进展:
- 阶跃星辰Step-3:采用MoE架构,在MMMU、MathVision等榜单获开源最佳成绩,国产芯片上推理效率、兼容性及成本控制突出,计划全球开源并构建生态联盟。
- 商汤科技日日新V6.5:强调图文交错思维,多模态交互得分超过Gemini2.5Flash和GPT-4o,性价比较前代提升3倍,“商汤小浣熊”智能体综合测试得分与Claude-4-Opus相当。
- 腾讯混元3D世界模型1.0:支持通过文本或图像快速生成可编辑虚拟世界,开源后下载量超230万次,四款端侧小模型具备Agent能力和长上下文处理能力,其中7B模型在特定测试中优于同类产品。
- 阿里云Qwen3-Coder:编程测试成绩接近ClaudeSonnet4,输入输出成本优势明显,同步发布的千问3系列开源模型位居全球开源榜前列。
- 沐曦股份发布旗舰GPU曦云C600:基于国产供应链,实现核心技术自主可控,集成大容量存储与多精度混合算力,支持MetaXLink超节点扩展技术,内置ECC/RAS多重安全防护模块。
- 华为展示昇腾384超节点:基于超节点架构,采用全对等(Peer-to-Peer)UB总线,将384颗NPU与192颗鲲鹏CPU紧密互联,算力达300PFLOPs,点到点访问时延不足1微秒,适用于大模型推理、MOE训练等场景。
研究结论
- 国产AI产业齐头并进:从大模型、算力芯片到服务器设备,国产AI产业链正在多方面取得突破,展现出强劲的发展势头。
- 投资机会:尽管面临美国对先进算力芯片的限制,但国内企业持续升级大模型能力和硬件设备指标,相关投资机会值得长期关注。
- 风险提示:需关注先进算力芯片限制加强、下游应用需求不及预期、国产模型迭代升级迟缓等风险。
产品性能数据
- 阶跃星辰Step-3:总参数量321B,激活参数量38B,在MMMU、MathVision等榜单上取得开源多模态推理模型的SOTA成绩,国产芯片上推理效率最高可达DeepSeek-R1的300%。
- 商汤科技日日新V6.5:多模态交互平均得分77.97,领先于Gemini2.5Flash(76.04)和GPT-4o(75.40),性价比较前代V6.0提升3倍。
- 腾讯混元7B模型:在AIME2024和AIME2025测试中的得分优于同类模型,在语言理解、数学、推理等领域表现出色。
- 阿里云Qwen3-Coder:参数480B(激活35B),原生支持256K上下文,Agent测试得分达69.6%,输入、输出价格分别为$0.2/MillionTokens、$0.8/MillionTokens。
- 沐曦曦云C600:集成大容量存储与多精度混合算力,支持MetaXLink超节点扩展技术,内置ECC/RAS多重安全防护模块。
- 华为昇腾384超节点:算力达300PFLOPs,LLaMA3等千亿稠密模型训练性能为传统集群的2.5倍以上,Qwen、DS及MOE模型性能提升达3倍,点到点访问时延不足1微秒。