Anthropic发布最新模型Claude-Fable-5,短期内被政府叫停
- 2026年6月9日,Anthropic发布Claude Fable 5与Claude Mythos 5,两者共享同一底层模型架构,均属Mythos级最强模型。Fable 5面向所有用户开放,内置风险分类器;Mythos 5仅对11家受信任机构开放。
- 6月10日,AI红队研究者Pliny the Liberator宣布攻破Fable 5的安全层。6月12日,美国政府以国家安全为由发布出口管制指令,暂停所有外国公民对Fable 5和Mythos 5的访问,包括 Anthropic外籍雇员。Anthropic随后官网声明停止所有用户使用Fable 5与Mythos 5。
- Fable 5安全机制缺陷:分类器依赖关键词和模式匹配(可通过Unicode同形字替换和叙事框架伪装绕过)、逐条检测无法追踪跨轮次意图链(可通过分解-重组攻击)、多模型管线组合漏洞(可通过多agent协作攻击绕过)。