DeepSeekV4.1-Flash发布在能力升级的同时实现了降价。高峰时段每百万Token未缓存输入/输出价分别为2/8元,较前代Flash降低33%/11%;缓存命中输入降至0.04元,降低60%,闲时再减半。该模型原生支持视觉理解及1M上下文,有望扩大长任务Agent应用范围。
KimiK2.8Preview上线后,Coding与Agent能力继续升级,性能接近K3,思考效率较K2.7 Code明显提升,最高1M上下文开放至全部会员档。这些进展表明Kimi在代码理解和生成、智能代理执行等方面取得了显著进步,有助于提升开发效率和用户体验。
报告认为大模型行业正朝着能力持续迭代和成本下降的方向发展。以DeepSeek和Kimi为代表的企业通过技术优化和商业化探索,推动着模型性能提升和价格合理化。同时,行业竞争加剧,如GPT6Astra引发的反蒸馏讨论,也显示出技术路线的多样性和演进复杂性。未来,模型能力与商业化模式的平衡将是行业发展的关键。
报告重点分析了Kimi和智谱的商业化进展。Kimi通过推进FDE伙伴计划,ARR据报约10亿美元,26年年末ARR或可达20亿美元,并与华胜天成、金山云等共建FDE队伍。智谱拟融资50亿美元,用于研发、算力部署及业务扩张。这些举措表明模型公司正积极寻求多元化收入来源和规模化发展路径。
报告提示了大模型行业的潜在风险,包括技术路线不确定性,如Astra可能通过循环调用Transformer层增加内部有效计算深度,但若有效CoT等过程监督减少,蒸馏效率可能下降,增加蒸馏成本。此外,市场竞争加剧可能导致价格战,影响企业盈利能力。同时,OpenAI自动化研究进展也暗示了未来技术迭代可能带来的颠覆性变化。