OpenAI发现更多智能体逃逸案例 但目前尚未公开发布完整的内部调查细节
2026-8-1 07:52:55 Author: www.landian.news(查看原文) 阅读量:23 收藏

#人工智能 OpenAI 在内部调查中发现更多智能体逃逸迹象,但目前尚未公开发布完整的内部调查细节。路透社从知情人士获得的消息称,OpenAI 在调查 HF 抱抱脸攻击事件时,又发现其他自主 AI 智能体突破隔离环境的迹象。不过知情人士称新发现的情况被描述为范围有限,这些智能体目前被认为尚未离开 OpenAI 自身网络,但 OpenAI 已经将这些线索纳入进一步调查。查看全文:https://ourl.co/114151

早前 OpenAI 发现自己的内部测试模型驱动的智能体从隔离环境中逃逸,随后这个智能体针对开源模型和数据集托管平台抱抱脸🤗(HuggingFace) 发起攻击并在基础设施中横向移动。抱抱脸检测到攻击后及时阻断并使用智谱开源模型完成审计,事后 OpenAI 才承认发起攻击的智能体来自该公司内部。

之后 Anthropic 进行内部调查后也发现智能体逃逸证据,后者 AI 模型驱动的智能体在网络安全评测中出现 3 起真实系统访问事件,而且要不是 Anthropic 调查,估计被入侵的公司也没有发现自己的生产环境已经遭到未经授权的访问。

华尔街日报称OpenAI考虑大幅度降低Token价格与A社打价格战 抢夺企业客户

路透社在 7 月 31 日发布报告称,两名知情人士透露,OpenAI 在调查此前抱抱脸安全事件时,又发现其他自主 AI 智能体突破隔离环境的迹象。需要注意的是,新发现的情况目前被描述为范围有限,知情人士称这些智能体目前被认为并未离开 OpenAI 自身网络,不过 OpenAI 已经将这些线索纳入进一步调查。

不过当前知情人士并未透露新发现的逃逸迹象详情,也没有说明发生时间,而 OpenAI 可能会在完成调查后才会发布详细的技术报告,所以现阶段我们无法知晓新发现的逃逸情况是否严重,如果没有离开 OpenAI 自身网络,那可能不会对其他公司造成影响,至少不应该出现直接入侵其他公司生产系统的情况。

在 OpenAI 和 Anthropic 相继披露 AI 智能体越界事件后,美国和欧洲监管机构已经开始关注这类风险。美国总统特朗普在被问及此事时表示正在考虑相关控制措施;欧盟委员会也称已就这些黑客事件与 OpenAI 和 Anthropic 进行沟通。

美国参议院情报委员会民主党高层 Mark Warner 则表示,Anthropic 事件说明要求先进模型进行强制能力测试是有必要的。

这类事件目前还不算是传统意义上的大规模恶意攻击,但这也已经把一个长期停留在安全论文和红队测试里的问题推到现实环境:当 AI 智能体拥有足够强的网络攻击能力时,实验室是否真的能稳定限制智能体的行动边界。

即将结束终于补货!99元/年境外CN2服务器又可以购买,限量销售,售完即止。另有3年超低价国内VPS服务器。

  • <b>CF/TK/GQ所有免费域名已在7月31日到期 必须付费注册后才能继续使用</b>

  • <b>重大噩耗!Codex已再次硬重置 但从明天开始将重新恢复5小时使用限额</b>

  • <b>英国神卡GiffGaff正在大规模封号清退 禁止用户长期在英国境外漫游使用</b>

  • [关注] 谷歌工程师提议禁止安卓ADB本地连接 Shizuku等高级应用将受到严重影响

  • 受AI冲击GitHub改革漏洞奖励计划 大幅度下调奖励金额 但升级VIP后奖励翻四倍

  • 挖洞需谨慎!小米安全中心发布违规通报 谴责以漏洞测试为借口进行黑客行为


文章来源: https://www.landian.news/archives/114151.html
如有侵权请联系:admin#unsafe.sh