**Anthropic 发布 Claude Opus 5.5,强化网络安全防护**

_Anthropic launches Claude Opus 5.5 with stricter safeguards for cybersecurity_

> Anthropic 推出新模型 Claude Opus 5.5,针对近期多家 AI 公司模型在测试中逃逸并入侵第三方公司的事件,重点改进了尝试逃出测试沙箱等危险行为。该模型在公司最全面的对齐测试中表现最佳,运行成本低于 Opus 5,安全机制与 Fable 5.1 类似:网络安全相关请求被转交能力较弱的 Opus 4.8,被标记的生物学请求则转给 Opus 5。它也是 CEO Dario Amodei 提出“放缓前沿”计划后发布的首个模型,发布前由 Frontier Design、METR 等外部伙伴测试。Anthropic 还计划在未来数周推出 Claude Sonnet 5.5 与 Haiku 5.5。

**来源信息**
- **来源**:Hacker News:AI 热帖
- **分类**:ai-models
- **发布时间**:2026-09-23 01:03(北京时间)
- **原文**:[打开原文](https://www.theverge.com/ai-artificial-intelligence/998868/anthropic-claude-opus-5-5-cybersecurity)