#人工智能 OpenAI 在内部调查中发现更多智能体逃逸迹象,但目前尚未公开发布完整的内部调查细节。路透社从知情人士获得的消息称,OpenAI 在调查 HF 抱抱脸攻击事件时,又发现其他自主 AI 智能体突破隔离环境的迹象。不过知情人士称新发现的情况被描述为范围有限,这些智能体目前被认为尚未离开 OpenAI 自身网络,但 OpenAI 已经将这些线索纳入进一步调查。查看全文:https://ourl.co/114151
早前 OpenAI 发现自己的内部测试模型驱动的智能体从隔离环境中逃逸,随后这个智能体针对开源模型和数据集托管平台抱抱脸🤗(HuggingFace) 发起攻击并在基础设施中横向移动。抱抱脸检测到攻击后及时阻断并使用智谱开源模型完成审计,事后 OpenAI 才承认发起攻击的智能体来自该公司内部。
之后 Anthropic 进行内部调查后也发现智能体逃逸证据,后者 AI 模型驱动的智能体在网络安全评测中出现 3 起真实系统访问事件,而且要不是 Anthropic 调查,估计被入侵的公司也没有发现自己的生产环境已经遭到未经授权的访问。

路透社在 7 月 31 日发布报告称,两名知情人士透露,OpenAI 在调查此前抱抱脸安全事件时,又发现其他自主 AI 智能体突破隔离环境的迹象。需要注意的是,新发现的情况目前被描述为范围有限,知情人士称这些智能体目前被认为并未离开 OpenAI 自身网络,不过 OpenAI 已经将这些线索纳入进一步调查。
不过当前知情人士并未透露新发现的逃逸迹象详情,也没有说明发生时间,而 OpenAI 可能会在完成调查后才会发布详细的技术报告,所以现阶段我们无法知晓新发现的逃逸情况是否严重,如果没有离开 OpenAI 自身网络,那可能不会对其他公司造成影响,至少不应该出现直接入侵其他公司生产系统的情况。
在 OpenAI 和 Anthropic 相继披露 AI 智能体越界事件后,美国和欧洲监管机构已经开始关注这类风险。美国总统特朗普在被问及此事时表示正在考虑相关控制措施;欧盟委员会也称已就这些黑客事件与 OpenAI 和 Anthropic 进行沟通。
美国参议院情报委员会民主党高层 Mark Warner 则表示,Anthropic 事件说明要求先进模型进行强制能力测试是有必要的。
这类事件目前还不算是传统意义上的大规模恶意攻击,但这也已经把一个长期停留在安全论文和红队测试里的问题推到现实环境:当 AI 智能体拥有足够强的网络攻击能力时,实验室是否真的能稳定限制智能体的行动边界。



![[关注] 谷歌工程师提议禁止安卓ADB本地连接 Shizuku等高级应用将受到严重影响](https://img.lancdn.com/landian/2026/07/114073T.png)

