核心观点与关键数据
- 国产开源模型能力提升:DeepSeek V4 Pro 发布,多项测试接近 Fable 5;Qwen3.8-2.4T-A95B 开源,首次开放 Qwen-Max 级模型(2.4T MoE 架构、95B 激活参数),支持 256K+ 长上下文;Grok 4.6 发布,平衡性能、速度与成本,更适合高频 Coding 与实时 Agent 场景。
- 成本与性价比:DeepSeek V4 Pro API 百万 Token 输入 3 元、输出 6 元、缓存命中 0.025 元,保持高性价比;模型选择从“最强能力”转向“单位成本生产力”。
技术趋势与应用落地
- AI 进入真实工作流:模型能力提升加速 AI 在 Coding、办公、营销、电商等场景的应用,推动端到端自动化与 Agent 商业化落地。
- 模型演进方向:强化真实世界 RL 训练,推动模型向企业级 Agent 演进;云厂商推动私有化与多模型部署。
云厂商受益逻辑
- 开源模型普及与推理成本下降:企业走向私有化与多模型部署,云平台在推理、托管与 MaaS 方面价值提升。
- Agent 使用增长:Token 消耗与推理需求上升,进一步带动云平台业务。
建议关注
- 云厂商(CSP):阿里巴巴、腾讯控股。
- Token 运营及垂类数据:荣信文化、易点天下、中信出版等。
- AI 影视内容生成与多模态内容:荣信文化、中文在线、掌阅科技等。
- 全链路 AI 营销+电商:易点天下、汇量科技、蓝色光标等。
- AI 智能体解决方案:迈富时。
风险提示