核心观点与关键数据
大模型安全风险
- OWASP LLM Top10风险层攻击类型:包括输入层提示注入攻击(如诱导模型越狱)、API密钥劫持、多模态内容攻击、上下文语义攻击、过度代理风险等;数据层风险包括训练数据投毒、虚假信息传播等;输出层风险包括系统提示泄露、不当输出内容、敏感信息泄露等;治理层风险包括模型盗窃与滥用、DDos攻击、供应链漏洞风险、资源滥用等。
- 全球各国安全管理政策:欧盟《人工智能法案》、新加坡《AI系统安全指南》、美国《AI权利法案蓝图》《AI风险管理框架》、日本AI治理框架、《安全、创新和包容的AI首尔宣言》等。
- 我国安全管理政策:《互联网信息服务深度合成管理规定》《生成式人工智能服务管理暂行办法》《生成式人工智能服务安全基本要求》等,明确要求企业遵守法律法规,保护数据安全,防范AI风险。
LLM-WAF 大模型安全防护
- 功能:LLM-WAF为专为大语言模型设计的智能安全防护网关,提供多模型、多场景、高并发环境下的全链路防护能力,支持实时检测并拦截算力滥用、提示词攻击及数据泄露风险。
- 防护能力:包括算力消耗防护、提示词注入&内容安全防护、业务防护-BOT管理、业务防护-API安全等。
- 算力消耗防护:基于请求频次和Token消耗量检测算力消耗行为,拒绝伪装设备访问和自动化访问。
- 提示词注入&内容安全防护:检测用户敏感信息、不当信息、提示词泄露,支持自定义敏感信息拦截。
- 业务防护-BOT管理:全流量分类标签,智能评分体系,动态验证技术,AI异常检测模型等。
- 业务防护-API安全:API流量分析、API资产梳理、API事件管理、API安全防护等。
典型场景应用
- 金融行业:智能投顾、对话银行及开放银行API等,防护提示词投毒、API套利刷单、KYC/授信数据外泄等风险。
- 泛互行业:内容平台、社交网络与游戏公司,防护大规模爬虫套壳、越狱Prompt生成涉政/色情/仇恨内容等。
- 零售行业:智能客服、动态优惠券抢购及个性化推荐模型,防护提示词诱导输出不当信息、自动化脚本批量刷券等。
试用申请
- 腾讯云LLMWAF公测:符合条件的企业用户可免费体验核心功能,包括模型输入输出保护、敏感数据防泄漏、恶意行为防护等。
- 试用申请方式:扫描二维码进行试用申请(https://doc.weixin.qq.com/forms/AJEAIQdfAAoAUsACgbMAK8PWuTYc4RRBf)。