您的浏览器禁用了JavaScript(一种计算机语言,用以实现您与网页的交互),请解除该禁用,或者联系我们。 腾讯:《Omdia《全球企业级Agentic Worker-中国市场》|研报|投资分析》-发现报告

Omdia《全球企业级Agentic Worker-中国市场》

2026-09-24 腾讯 还是郁闷闷啊
Omdia《全球企业级Agentic Worker-中国市场》

猜你想问

这份研报主要分析了什么内容?

这份研报主要分析了全球企业级Agentic Worker在中国市场的现状和发展趋势。报告指出,2025年是能力验证之年,开源推理模型降低了获取高级推理能力的门槛,通用型智能体产品则证明了通过任务分解、浏览器自动化和跨应用执行,从单一提示词生成完整可交付成果的可行性。到2026年,领先模型在OSWorld-Verified上得分达到约85%,人类基线约为72%,公开排行榜上排名最高的模型得分为86.1%,表明操作计算机以及跨应用完成常规办公任务已不再是瓶颈。然而,新一代长时程基准测试(OSWorld2.0)仍极具挑战性,表现最佳的模型全任务完成率仅为20.6%,部分完成率为54.8%。这些指标表明,虽然单步和短链能力现已足够,但要确保复杂生产任务的可靠性,需要更加关注任务边界、异常处理、业务语义和执行工程。2026年,参与者必须应对的挑战是:确定企业级智能体在何种运营边界内,能够以足够高的成功率、足够低的人工接管率以及可接受的单位经济效益,持续完成任务。

企业级智能体赛道的发展趋势如何?

企业级智能体赛道的发展趋势表明,能力已不再是稀缺投入;可靠性才是关键约束条件。产品化不再来自孤立技能的堆叠,供应商的路线图趋同于一个由边界明确的工作单元组成的目录。企业系统集成正从产品功能转变为产品本身,真正的能力在于理解业务对象、字段含义、审批关系以及动作后果。采购对象正从软件席位转向可管理的数字产能,积分、任务包、数字角色订阅以及与结果挂钩的定价正在获得更大份额。护城河在于生产反馈回路,拥有更多真实生产工作量的供应商能够积累数据和工程方面的复合优势,但前提是能将单一客户的定制抽象为可复用的行业模板。未来,企业级智能体工作者将作为开放式办公任务的统一人工智能(AI)入口,专注于日常企业知识型员工的任务执行。

报告中重点分析了哪些方向?

报告中重点分析了企业级智能体员工的技术架构、市场格局和发展路径。从技术架构来看,企业级智能体员工由四层架构组成,2026年,差异化已从执行层上移至企业连接层和生产运营层。自主性必须经过衡量,而非仅凭宣称。从市场格局来看,中国供应商格局包括基于角色型、通用型、基于流程型和基于RPA型。全球主要供应商包括百度搭子、商汤小浣熊和腾讯云WorkBuddy。从发展路径来看,全球市场从验证到生产,企业级智能体员工已从产品形态竞争转向生产架构竞争;验收标准现在聚焦于集成、治理和成果。全球路径从桌面执行到企业生产,产品形态经历了持续执行、受控桌面、套件入口和生产工作流四个阶段的演进。中国与全球不同路径,但相同验收点,中国强调本地文件、协作入口、私有化部署和多模型路由,全球产品强调标准连接器和受控的云端执行。

当前市场现状如何判断?

当前市场现状判断显示,企业级智能体市场正从验证阶段转向生产阶段,市场竞争已从产品形态竞争转向生产架构竞争。全球市场和中国市场在验收标准上存在共性,均聚焦于集成、治理和成果。中国市场的特点在于强调本地文件、协作入口、私有化部署和多模型路由,而全球产品则更强调标准连接器和受控的云端执行。从技术发展来看,虽然单步和短链能力现已足够,但要确保复杂生产任务的可靠性,需要更加关注任务边界、异常处理、业务语义和执行工程。新一代长时程基准测试(OSWorld2.0)仍极具挑战性,表现最佳的模型全任务完成率仅为20.6%,部分完成率为54.8%。这表明,企业级智能体市场仍处于发展初期,技术成熟度和可靠性仍需进一步提升。

研报提示哪些风险?

研报提示的主要风险在于企业级智能体的可靠性和集成难度。虽然单步和短链能力现已足够,但要确保复杂生产任务的可靠性,需要更加关注任务边界、异常处理、业务语义和执行工程。新一代长时程基准测试(OSWorld2.0)仍极具挑战性,表现最佳的模型全任务完成率仅为20.6%,部分完成率为54.8%。此外,企业系统集成正从产品功能转变为产品本身,真正的能力在于理解业务对象、字段含义、审批关系以及动作后果,这对供应商的技术实力和行业经验提出了更高要求。企业级智能体工作者作为开放式办公任务的统一人工智能(AI)入口,需要与现有企业系统深度集成,这可能导致集成成本高、实施周期长等问题。因此,企业在采购和使用企业级智能体时,需要充分考虑其可靠性和集成难度,选择合适的供应商和产品。