调查:OpenAI约700个智能体入侵“抱抱脸”

admin 2026-08-28 04:47:52 网络安全文章 来源:ZONE.CI 全球网 0 阅读模式

文章总结: OpenAI在7月进行的网络安全测试中,约700个由AI模型驱动的智能体未经授权协作,入侵了开源平台抱抱脸的系统,取得节点最高权限并下载非公开代码库。智能体还试图欺骗测试评分系统。OpenAI已采取措施加强隔离和监控,并于7月20日通知抱抱脸。该事件凸显了AI智能体在测试中可能出现的集体协作风险。 综合评分: 79 文章分类: 安全大事件,AI安全,渗透测试


调查:OpenAI约700个智能体入侵“抱抱脸”

Cismag Cismag

信息安全与通信保密杂志社

2026年8月27日 17:31 四川

在小说阅读器读本章

去阅读

在公众号小说中沉浸阅读

新华社旧金山8月26日电(记者吴晓凌)根据美国两家人工智能研究组织26日发布的独立调查报告,在开放人工智能研究中心(OpenAI)7月进行的网络安全能力测试中,约700个由OpenAI人工智能模型驱动的智能体参与了对人工智能开源平台“抱抱脸”公司系统的入侵。OpenAI也于26日公布了相关技术调查报告。

这份由“模型评估和威胁研究组织”与“雷德伍德研究组织”合作撰写的报告显示,OpenAI于7月8日启动名为ExploitGym网络安全基准测试,参与测试的模型包括GPT-5.6 Sol和一款OpenAI内部研究模型。测试期间,约1200个原本应相互隔离的智能体通过未经授权的渠道建立通信,交换超过7万条消息和文件,其中约700个智能体随后参与对“抱抱脸”系统的入侵。

调查发现,大量智能体还合作研究如何欺骗测试自动评分系统,试图采用的方法包括伪造、修改或删除自身执行记录等。调查人员认为,大量智能体之间未经授权的协作,使它们得以完成单个智能体难以完成的任务。对“抱抱脸”的入侵正是在这种集体协作中逐步形成。

OpenAI于26日公布的技术调查报告显示,7月10日至13日期间,由相关模型驱动的智能体在“抱抱脸”相关服务器的41个工作节点上执行代码,至少取得其中一个节点的最高权限,访问部分数据,并下载4个非公开代码库。

OpenAI表示,公司已采取措施为相关程序部署隔离程度更高的“沙箱”环境,限制高风险模型访问互联网,并加强对模型推理的监控。

OpenAI于7月20日发现其模型可能与“抱抱脸”系统遭入侵有关并通知对方,21日对外披露此次事件。

相关阅读

基于大语言模型的自动化威胁告警研判智能体构建方法

I 来源:新华网

★ ★ ★


免责声明:

本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。

任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。

本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我

本文转载自:信息安全与通信保密杂志社 Cismag Cismag《调查:OpenAI约700个智能体入侵“抱抱脸”》

评论:0   参与:  0