您的浏览器禁用了JavaScript(一种计算机语言,用以实现您与网页的交互),请解除该禁用,或者联系我们。 中移智库&中国移动研究院:《智能体安全评测体系与实践白皮书(2026年)|投资分析》-发现报告

智能体安全评测体系与实践白皮书(2026年)

智能体安全评测体系与实践白皮书(2026年)

猜你想问

智能体安全评测体系包含哪些核心维度?

智能体安全评测体系包含基模安全、交互安全、运行安全和基础安全四大维度。基模安全评测大模型本体内生安全能力;交互安全评测感知层全场景风险;运行安全管控记忆层、决策层的动态运行态风险;基础安全覆盖执行层及底层支撑体系风险。这四大维度全面覆盖智能体典型安全风险,确保评测体系的系统性和全面性。

信息技术行业智能体赛道未来发展趋势如何?

信息技术行业智能体赛道未来将呈现五大发展趋势:分层权责化评测全面落地,安全左移融入研发工程化链路;自动化红蓝对抗技术成为核心研发赛道;供应链安全范式迭代升级,建立双维风控框架;动态风险驱动评测替代静态加权评分;政企产学研协同治理生态成型。这些趋势标志着智能体安全评测技术正由单点静态检测向全域体系化主动治理跨越,推动产业向安全可控方向稳健发展。

白皮书重点分析了智能体的哪些安全风险?

白皮书重点分析了智能体四层架构中的典型安全风险:感知层风险涉及多源异构输入下的信任边界失守,如提示注入、恶意内容投递等;记忆层风险关注持久化存储机制引发的污染跨期生效,如恶意对话交互、RAG知识库污染等;决策层风险剖析上游风险汇聚下的推理链路级联失效,如多轮渐进式诱导攻击等;执行层风险则聚焦多重风险叠加驱动的实质性损害落地,如参数注入、指令篡改诱导违规操作等。这些风险覆盖智能体全生命周期,需系统评测和管理。

当前智能体市场存在哪些主要问题?

当前智能体市场主要面临安全治理滞后问题,其自主闭环运行特性催生了区别于传统大模型的新型系统性风险。攻击面广、隐蔽性强、风险传导快、危害持久是主要特征。传统AI安全评测方法难以覆盖智能体特有攻击面,交互安全仍是当前面临的主要风险来源,基础安全中的供应链管理和敏感数据保护也是普遍存在的薄弱环节。这些问题制约了智能体规模化合规发展。

本白皮书对智能体安全提出了哪些风险提示?

本白皮书提示智能体安全需关注四大风险:一是感知层易受多通道输入攻击,需加强输入校验和风险隔离;二是记忆层存在持久化污染风险,需管控长期记忆与上下文存储安全;三是决策层易受上游风险汇聚影响,需防范推理链路级联失效;四是执行层存在违规操作风险,需强化工具使用和权限管控。这些风险需通过体系化评测和实践建议加以防范,确保智能体安全可控发展。