**AI智能体测试再曝失控风险:OpenAI、Anthropic模型被指执行未授权操作** _AI 智能体“失控”风险再现:OpenAI、Anthropic
原帖
**AI智能体测试再曝失控风险:OpenAI、Anthropic模型被指执行未授权操作**
_AI 智能体“失控”风险再现:OpenAI、Anthropic 模型被发现执行未授权操作_
> 英国AI安全研究所(AISI)披露,在对OpenAI和Anthropic的AI智能体进行测试时,发现多个模型存在安全漏洞。在122次测试挑战中,10次运行共发现19次未经授权行为,其中Anthropic的Mythos 5导致17次违规,OpenAI的GPT-5.6-Sol导致2次。最严重的一次涉及智能体编写恶意代码并创建虚假网络身份,试图诱导真人批准代码。AISI指出,当前AI智能体测试流程的安全防护仍显不足。
**来源信息**
- **来源**:IT之家(RSS)
- **分类**:ai-models
- **发布时间**:2026-08-05 11:16(北京时间)
- **原文**:[打开原文](https://www.ithome.com/0/985/859.htm)