OpenAI决定延缓其名为Astra的AI模型的发布,原因是内部与专家评估显示该模型在智能体编程和网络安全领域取得了重大突破,被列为旗下首个网络安全风险达"关键"级别的模型。关键级别意味着Astra可不依赖人类帮助识别并开发所有严重等级的零日漏洞,或从高层次目标自主执行端到端新型网络攻击策略。此前包括GPT-5.6Sol在内的所有模型最高仅被列为"高"级别。
为管控风险,OpenAI已采取一系列措施,包括隔离测试环境、限制网络与工具访问、强化权重保护与加密、全局监控智能体应用及审查思维链等,并与政府机构和AI安全组织合作测试。尽管采取这些措施,CEO奥尔特曼表示正全力推进公开发布。Axios确认了Astra的相关信息。