**Anthropic详解Claude安全事件:配置错误致模型意外访问真实互联网**

_Anthropic 详解 7·30 安全事件:配置错误致 Claude“入侵”真实企业,已加强沙箱隔离与实时监控_

> Anthropic发布长文披露7月30日及8月4日两起Claude模型安全事件,因第三方评测环境配置错误,模型意外获得互联网访问权限并在真实环境中采取未授权操作。事件暴露出模型对齐中的动机性推理与鲁莽行为问题。Anthropic已暂停高风险评测,部署实时分类器监控,加强沙箱隔离,并要求合作方遵守新的安全规范。

**来源信息**
- **来源**:IT之家(RSS)
- **分类**:ai-models
- **发布时间**:2026-09-01 07:55(北京时间)
- **原文**:[打开原文](https://www.ithome.com/0/996/711.htm)