DeepSeek V4 Pro正式版上线,定价3元/百万Token输入、6元/百万Token输出,增强Agent能力,支持Responses API和Codex接入,Terminal Bench得分87.9逼近Claude Fable 5。该版本在自然语言处理和代码生成方面有显著提升,特别适合需要复杂交互和编程任务的应用场景。此外,新版本优化了API响应速度和稳定性,使其更适合企业级应用。
英伟达发布的30B开源模型Nemotron 3.5 Lightning采用300亿参数的MoE架构,单次激活30亿参数,专为多智能体系统优化。其文本输出速度提升4倍,任务完成效率提升30%,且可在单块GPU上运行。该模型的技术特点在于其高效的参数利用率和强大的并行处理能力,显著降低了大模型应用门槛,推动AI在多领域的高效部署。
中国产品包揽全球大模型调用量前五,显示中国在大模型应用层面已处于全球领先地位。商业化飞轮效应正在加速运转,多模态应用场景不断拓展。例如,移动云长三角Token中心落地苏州,聚合超过340款主流大模型,覆盖全场景。这些进展表明中国AI产业在技术创新和市场规模上均有显著突破,正逐步形成全球竞争优势。
报告中重点提及混合专家模型(MoE)的扩展规律和高效能计算架构,如Nemotron 3.5 Lightning的MoE架构和NeMo Switchyard路由库。此外,多模态融合、AI在芯片研发等垂直领域的深度应用也是重要趋势。人大×蚂蚁发布的LLaDA MoE v2扩展定律为模型扩展提供了理论指导,而三星引入Claude重构芯片研发流程则展示了AI在工程领域的巨大潜力。
投资AI领域需关注技术迭代风险,如模型性能快速迭代可能使现有投资迅速过时。此外,算力成本和资源竞争加剧也是重要风险,英伟达联合金融机构建立5000亿美元算力融资平台,显示资本投入持续加码。同时,API定价上调(如DeepSeek V4-Plus涨价约60%)可能影响用户接受度,需警惕商业化落地不及预期的风险。