您的浏览器禁用了JavaScript(一种计算机语言,用以实现您与网页的交互),请解除该禁用,或者联系我们。 [世界经济论坛]:AI代理行动指南:可信采纳、授权与扩展手册 - 发现报告

AI代理行动指南:可信采纳、授权与扩展手册

信息技术 2026-05-15 - 世界经济论坛 林菁|Jade
报告封面

洞察报告 2026年5月 Getty Images 图片: 内容 执行摘要4前言 3引言 5 1. 代理指南 7 1.1 建立自主、权威与后果的共同语言 1.511部署场景与基准治理 1.712从企业指南到部署授权 2.3Prepare and deploy23 2.4Monitor and improve27 附录:ACAP摘要游戏计划31 免责声明 本文件由世界经济论坛发布,作为对某项目、洞察领域或互动的贡献。此处表达的研究发现、解读和结论是经世界经济论坛促进和认可的合作过程的结果,但其结果不一定代表世界经济论坛、其全体成员、合作伙伴或其他利益相关者的观点。 2026年世界经济论坛。版权所有©。本出版物之任何部分均不得以任何形式或任何方式复制或传播,包括影印和录音,或通过任何信息存储和检索系统。 前言 瓦尔特·达里乌斯 首席执行官,嘉信咨询 人工智能卓越中心主任;世界经济论坛执行委员会成员 总经理,首席技术官,世界经济论坛 人工智能(AI)代理已离开研究实验室,成为组织工作流程中的常设环节。这一转变超出了我们现有治理框架的步伐。在第一份出版物奠定概念基础、第二份出版物介绍评估和分类工具之后,本系列第三份报告聚焦于一个明确的实践性问题:在具体操作层面,组织如何将权力委托给自动化系统,同时对其行为完全负责? 在生产环境中积极维护。只有这样,组织才能从孤立的试点项目过渡到部署代理的组合,在不受内部控制、监管合规性或利益相关者信任受损的情况下,实现自动化所带来的预期效益。 本报告是来自不同行业从业者、技术团队、风险管理职能和法律专家之间密切合作的结果。它并非提供普适性的答案,而是一个结构化、可适应且可审计的授权模型:代理能力与授权概况(ACAP)。该模型将企业政策转化为每个部署的操作指令。 此问题的答案并非主要在于技术层面,而在于组织层面。在我们的工作中,我们观察到人工智能全球联盟(AI Global Alliance)安全系统与技术工作组(Safe Systems and Technologies working group)的成员们发现,组织们能够理解智能体(agent)能做什么,但在具体情境下应授权其做什么,却难以界定。这种能力与授权之间的差距,既是大规模应用的核心挑战,也是本指南(playbook)的制定依据。 我们希望这份行动指南能为寻求负责任地将AI代理集成到其组织中的团队提供实用资源,并更广泛地促进关于授权代理治理的共同标准的制定。正如安德烈·卡帕西所说:AI代理的时代已经开启。1 我们今天奠定基础的方式将决定我们明天能信任它们多少。 人工智能代理的治理不能是事后才考虑的事情。它必须在设计阶段就融入其中,在部署前就要正式化。 执行摘要 代理能力与授权配置文件是一个实用框架,旨在帮助组织采用、授权和扩展AI代理。 特别是在定义其被授权行动的条件方面,以及在系统运行中确保这种授权得到执行方面。 一个投资组合中的许多代理可能共享同一个基础模型,因此,单个模型层面的漏洞可能会同时在整个组织的代理资产中传播,这进一步强化了需要对每个实例进行部署级别的授权和监控的必要性。 本指南将代理能力与授权配置文件(ACAP)介绍为一种用于代理系统的部署级授权工具。ACAP通过一个单一、可重复的工作流程,将企业授权策略、系统设计和运营监督联系起来,使授权行动可审计、可执行和可审查。 它提供了三个核心要素:清晰的代理指南、可执行的授权配置文件,以及从试点到推广的渐进式采用生命周期。这建立了一个明确的、可分配的授权模型,提供了一条从试点到生产的结构化路径,并构建了一个从单个部署到代理组合的扩展一致性框架。 通过ACAP,该手册为AI代理部署建立了一个结构化的运营模式:通过评估验证其就绪状态,通过 引言 人工智能代理的发展速度正快于治理——如今,关键瓶颈在于授权而非能力。 人工智能代理受托在政策、工具和访问控制设定的约束下,代表个人或组织追求既定目标。 人工智能(AI)代理已迅速从实验阶段进入早期实施阶段,一些观察者谈论着“AI代理的十年”2即将到来。这个长远的时间跨度既预示着巨大的机遇,也表明“采用和部署代理还为时过早”3这一现实。 安装软件等,更像是引入一个新的组织参与者,需要结构化的入职引导、明确的决策权以及持续的业务运营监督。 在本操作指南中,授权是在代理解决方案层面定义的。当多个代理协作,或当协调代理协调子代理时,部署被视为一个统一的系统,用于授权目的,即使其内部组成在演变。因此,ACAP反映了给定解决方案的综合架构、共享工具访问、协调逻辑和端到端授权边界,包括代理角色、工具访问和内存的组件级规范。 本报告针对早期部署中出现的一个实践性差距。组织越来越能够描述代理能做什么,但通常缺乏一种一致的方法来确定代理在特定工作流中被授权做什么。本手册介绍了代理能力和授权配置文件(ACAP)作为代理系统部署级别的授权记录,并解释了它在采用生命周期中如何被创建、批准和维护。该模型将随着该领域的发展而演进和成熟,应被视为为代理系统部署级别授权标准化做出的早期贡献。一个共享的授权结构可以立即带来运营价值,同时为长期更强的保证奠定基础。 本报告是关于AI代理的三部分系列报告中的第三部分;通过查阅早期的出版物,可以更深入地了解上下文。报告《穿越AI前沿:进化4 primers》建立了共享和AI代理的影响定义,并描述了不同类型代理的演变。第二篇论文《行动中的AI代理:评估和治理的基础》介绍了代理分类、评估、风险评估和适度治理。本系列中的第三篇也是最后一篇报告,在上述基础上,提供了一种结构化和以行动为导向的采用和集成框架。 在某些方面,招募代理商可以类比为招募新员工。该过程涉及评估能力、分配职责、授予访问权限、界定监督范围,并随着绩效和信任的建立而调整行动范围。这仅是一种结构上的比较,因为代理商缺乏明确的法律地位、道德责任和声誉激励——治理体系旨在弥补这些差距。这种比较是有用的,因为“代理商”一词长期以来指在既定范围内代表组织行事的人。房地产代理商、呼叫中心代理商和公共部门代理商都拥有授权权限、清晰的流程,并在出现例外情况时进行升级处理。 该操作手册借鉴了人工智能全球联盟6(AI GlobalAlliance 6)安全系统与技术工作组(Safe Systems and Technologies working group)组织的工作组会议、研讨会及深度访谈,旨在识别智能体部署中涌现的实践方法、常见陷阱和运营模式。它面向正在试点、评估和部署人工智能智能体的从业者。 这里引入的框架将随着技术的成熟而需要修订。ACAP模型的更新可能由其尚不能兼容的新功能、暴露治理空白的事故或重新定义合规性的监管变化所触发。 AI代理被如此描述的原因相同。它们被委托代表个人或组织在既定目标下行动,同时受到政策、工具和访问控制的约束。与传统软件不同,它们能够解释上下文,并在事先未完全明确的情况下判断下一步该做什么。这种非确定性与授权行动的结合,使得采用过程不像 在人工智能代理的十年中,以清晰的授权和监督模型为起点是维持大规模可信部署的先决条件。 如何使用此手册 本手册旨在作为从代理飞行员过渡到授权监控部署的实用操作指南。它将采用的每一步与代理实施的生命周期相结合,并使用ACAP作为贯穿整个生命周期创建、完成和更新的动态授权记录。 从宏观上看,该行动方案包含三个核心要素: 采用生命周期(第2.2、2.3和2.4节) 代理指南(第一章) 作为特定工作流程内特定代理解决方案的书面授权,记录其范围、操作环境、权限、控制措施、所需证据、负责所有者及重新授权的周期。 定义了授权代理的企业政策,包括共享术语、决策权、部署标准和基准治理预期。 通过三个阶段实施授权:1)系统设计与评估,2)准备与部署,3)监控与改进。每个阶段都明确规定了必须设计的内容、需提供的证据、需批准的事项以及需持续维护的内容。阶段之间的过渡受阶段门控制,进入下一阶段前必须满足预定义的最低要求。 如何将其应用于实践: 若贵组织需要共同语言和明确的授权决策权,请从代理指南开始。 如果您正在运行试点项目,并且需要在生产发布前明确范围、权限、控制措施和证据,则应针对单个部署建立ACAP。 请以生命周期阶段作为您的执行计划,从设计过渡到受控发布,再到监控运行和变更。 本报告附录中提供了一份关于完整ACAP步骤的一页概览。该概览旨在作为快速参考指南,但各步骤应在第2章所述的生命周期阶段中执行并得以维持。 1.代理指南 引入自主系统需要适宜的组织条件,以确保其有效、负责任地部署。 人工智能代理的成功应用始于对所构建和部署内容以及各环节责任归属的共同理解。早期试点表明,许多挑战源于术语不清、期望错位以及技术与运营团队之间的脱节。尽早建立通用语言并明确界定角色,是应用过程中的关键一步。 代理指南旨在作为一项新的企业级工具,由领导层认可并在所有部署中应用。它们确立了代理可被引入的共同语言和基本条件。 通过在组织层面一次性定义这些要素,指南确保了部署决策具有可比性,避免了责任在团队间的碎片化,并确保代理权限的扩大是基于证据而非临时做法。 1.1 建立自主、权威与后果的共同语言 组织层面的共同语言和定义有助于确保技术、运营和治理职能在评估部署时依据相同的参数。 代理指南首先通过定义管理授权的运营概念而开始。在企业层面建立共享术语和已记录的治理概念,符合AI管理系统对政策、角色和运营控制(如ISO 42001中定义的)的期望。8 这些定义有助于确定如何评估部署、需要哪些控制以及何时必须进行人工干预。 输出结果:后果性事件具有重大影响——法律、财务、安全(包括冒充)、安全、道德、声誉或面向客户的互动——无论是在组织内部还是外部。这些影响可能超出系统本身,因此需要在整个过程中设置明确的检查点和控制门。 工作流程、操作环境(用户、系统、数据类别和管辖区域),代理在其中运作的上下文。 核心概念包括: 代理的自主性程度决定了目标如何被追求、设定其子目标,并在没有实时人类指导的情况下执行行动。 预期用途的明确限制,包括禁止行为和升级触发因素。 权限 权力授予执行操作,例如读取、写入、执行、通信或跨系统及数据交易。包括代表组织行事的代表权,以及在明确授予的情况下,做出具有约束力承诺的决策权。 组织层面的共同语言和定义有助于确保技术、运营和治理职能根据相同的参数评估部署,并使授权决策在整个组织内保持一致。9 当组织开始采用多个代理时,这一基础和共享背景是有帮助的。 1.2 在整个生命周期中分配决策权与问责制 代理指南明确规定,将授权委托给代理人需要明确分配与实践中引入和监督代理人相关的人为所有权。这反映了广泛使用的风险治理实践,例如由美国国家标准与技术研究院(NIST)定义的AI风险管理框架,该框架强调在整个AI生命周期中明确定义的角色、问责制和监督。10 目标是确保每个代理部署都有以下方面的指定负责人: 开发人员与工程团队与数据所有者合作,共同监控质量、定义系统的技术特性、约束条件并执行强制性控制措施。 开发人员与工程团队协作,与数据所有者共同监控质量、定义系统的技术特性、约束条件及可执行控制,从而构建起稳固的护栏。 确定领域专家(SME)在具体情境下可接受的表现和输出是怎样的,并在运行过程中解读行为信号,为评估奠定基础。 风险、合规与法务职能在组织内部控制框架内批准授权,并设定所需的治理水平。 定义代理人的操作角色和范围 基于风险授予和扩大其权限 评估并接受相关风险 实施对重大事件的实时人类监督检查点,并在界限被触及时进行干预。 监督后续事件 – 批准能力、访问权限或背景的重大变更 人力资源与变革管理将角色演变、培训职能及激励与人力/代理操作模式相匹配。 在实践中,这些决策权在整个代理系统生命周期中保持不变,但行使这些权利的责任则分散在多个职能部门,并且通常跨越多个代理系统。在典型部