这份报告主要分析了海内外大模型及Consumer/Work Agent产业跟踪,重点关注大模型竞争转向效率与分层,以及Agent应用加速落地的趋势。报告涵盖了模型效率提升推动调用扩张、单位智能成本下降释放真实调用需求、应用端从“生成内容”进入“执行任务”、Work Agent开始进入企业真实工作流等核心要点,并观察了OpenRouter平台的调用规模、国产模型份额、调用趋势等数据。此外,报告还探讨了Consumer/Commerce Agent和Work Agent的应用进展,以及投资观点和风险提示。
大模型产业目前的发展趋势主要体现在模型效率提升推动调用扩张和单位智能成本下降释放真实调用需求。海外GPT-6、Astra、Claude、Gemini等模型持续提升复杂推理、Coding、Computer Use及长程Agent能力,头部厂商加速将前沿能力向中端及轻量模型下沉,形成分层结构。国内模型同样加速Flash化及工程效率优化。同时,OpenRouter平台的调用规模快速扩张,国产模型份额升至61.9%,调用趋势从“最强模型”转向“能力×成本×效率”的综合选择。这些趋势表明,模型能力持续提升,效率下降正在成为产业扩张的重要驱动力,随着Token成本、单位任务成本及运行延迟持续下降,模型能力向更多应用和工作流渗透的门槛进一步降低。
报告重点分析了模型效率提升对调用扩张的影响、单位智能成本下降释放的真实调用需求、应用端从“生成内容”进入“执行任务”的转变、Work Agent进入企业真实工作流的进展等方向。报告详细探讨了海外和国内模型的效率提升路径,以及OpenRouter平台上国产模型的份额和调用趋势。此外,报告还重点分析了Consumer/Commerce Agent和Work Agent的应用进展,包括Muse和WorkBuddy的产品特点、商业化路径和商业模式。报告通过这些分析,揭示了AI应用进入任务执行和商业闭环阶段的趋势。
目前大模型市场的现状是调用规模快速扩张,国产模型份额显著提升,调用趋势从追求最强模型转向能力、成本和效率的综合选择。根据OpenRouter平台的数据,2026年9月日均Token较年初提升近18倍,国产模型厂商份额由2026年1月的22.5%提升至9月的61.9%。同时,国产调用加速向Flash集中,9月Flash占比升至52.4%。这些数据表明,大模型市场正在经历从追求最强模型向更注重性价比和效率的转变,国产模型厂商正在快速崛起,Flash架构成为主流趋势。
这份报告提到了模型能力提升及Agent渗透不及预期、推理成本下降速度不及预期、应用用户留存及商业化低于预期、行业竞争加剧及数据安全与监管政策变化等风险提示。报告指出,虽然模型能力持续提升,效率下降正在成为产业扩张的重要驱动力,但模型能力提升及Agent渗透可能不及预期。此外,推理成本下降速度可能不及预期,应用用户留存及商业化也可能低于预期。同时,行业竞争加剧和数据安全与监管政策变化也可能对大模型产业带来风险。这些风险提示提醒投资者在关注产业发展的同时,也要关注潜在的风险因素。