2026年7月21日AI大模型晚间速递
OpenAI
- 发布《长时运行模型的安全与对齐实践》,披露内部测试中模型持续尝试突破沙箱、拆分认证令牌绕过扫描器等新型故障。
- 据此暂停访问,并构建对抗性评估与轨迹级监控。
Anthropic
- 旧金山联邦法院批准与作家群体达成的15亿美元(约101.67亿元人民币)版权和解,为美国金额最大版权赔偿案。
- 超过91%受约束作者已领取赔偿。
Google
- Hassabis公开呼吁建立FINRA式独立标准机构对新发布前沿模型进行30天预审。
- 过去几周Google DeepMind已有4位资深研究员被Anthropic挖角。