通用人工智能模型行为守则草案
核心观点: 本草案旨在为通用人工智能模型(尤其是具有系统性风险的模型)提供者提供指导,确保其履行《AI法案》规定的义务,并促进对通用人工智能模型的理解和风险管理。
关键数据:
- 草案由四个工作组制定,收集了近430份意见书,并计划于2024年11月28日前开放公众反馈。
- 草案适用于通用人工智能模型,涵盖具有系统性风险的模型。
- 最终版本的《代码》预计于2025年5月1日前准备好。
主要内容:
一、起草计划和原则
- 草案目前处于高层次概述阶段,详细措施和关键绩效指标(KPIs)将在后续版本中完善。
- 草案遵循以下高级原则:
- 与欧盟原则和价值观保持一致。
- 与《AI法案》和国际方法保持一致。
- 风险的适当比例。
- 与提供者的规模和能力相称的适当比例。
- 支持和促进人工智能安全生态系统的成长。
- 为未来做好准备。
二、通用人工智能模型提供者规则
- 透明度: 提供者需制定并保持技术文档,并向AI办公室和国家主管机关提供。同时,需向计划整合其模型的系统提供者提供相关信息和文档。
- 与版权有关的规则: 提供者需制定政策,遵守欧盟版权及相关权利法律,并识别和遵守权利保留条款。同时,需确保下游版权合规性,并保持足够的透明度。
三、系统性风险的分类
- 草案提出了系统性风险的分类方法,包括系统性风险的类型、性质和来源。
- 风险类型包括网络犯罪、化学、生物、放射性和核风险、失去控制、自动使用模型进行AI研究和发展、说服和操纵、大规模歧视等。
- 风险性质包括起源、参与者、意图、新颖性、概率严重性比、风险发生速度、可见性、事件过程等。
- 风险来源包括危险模型能力、危险模型倾向、模式负担和社会技术背景等。
四、具有系统风险的通用AI模型提供者规则
- 风险评估: 提供者需采用安全与安全框架(SSF)进行风险评估,包括风险识别、风险分析、证据收集和风险评估生命周期等。
- 技术风险缓解: 提供者需在SSF中详细说明缓解措施,包括安全缓解措施、安全和安保报告等。
- 发展和部署决定: 提供者需建立过程,决定是否继续推进具有系统性风险的一般人工智能模型的研发与部署。
- 治理风险减轻: 提供者需确保在组织层面拥有足够的所有权以评估并按比例减轻系统性风险。同时,需进行SSF的遵守情况和充分性评估,并在适当情况下,使独立专家能够对通用人工智能模型进行全面的风险评估和缓解措施评估。
五、公共透明度
- 提供者需提供适当的公共透明度,通过发布其SSF和SSRs来实现这一目标。
结论: 本草案是通用人工智能模型行为守则的初步版本,旨在为通用人工智能模型提供者提供指导,并促进对通用人工智能模型的理解和风险管理。草案将根据利益相关方的反馈进行完善,并最终在2025年5月1日前发布。