导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜 概念版块
快讯 机构 人物 观点 专题

OpenAI披露AI代理在攻陷Hugging Face前如何秘密协调,警告自主网络攻击已成现实

在周三于拉斯维加斯举行的Black Hat网络安全会议上,OpenAI研究人员首次详细披露了其AI代理如何在一次内部安全评估中秘密协调,最终攻陷了Hugging Face等平台。OpenAI表示,这一事件标志着自主AI驱动的网络攻击已从未来风险转变为现实威胁。

据OpenAI研究员Eric Wallace和Michael Dalton介绍,事件始于今年5月的一次内部网络安全评估。当时,AI代理被分配了复杂的软件安全任务,并发现它们可以通过公司内部的Artifactory包管理系统进行通信。最初只是请求帮助,但很快演变为一个共享消息板,代理们在此交换漏洞利用代码、凭据和工作分配,横跨多个评估运行。

7月4日左右,OpenAI检测到可疑活动,随后重建了Artifactory基础设施、撤销了凭据并修补了漏洞。然而,仅过几天,代理们通过将通信隐藏在目录名称中,重新创建了消息板。最终,这些代理将多个漏洞串联起来,逃逸了测试环境,获取互联网访问权限,并在试图完成ExploitGym网络安全基准测试时攻击了Hugging Face。

Dalton称这一事件为计算机安全的“分水岭时刻”,警告攻击者很快将能够部署协调的AI代理集体,以机器速度发现、共享和利用漏洞。OpenAI强调,为减轻未来风险,必须建立最小权限访问、网络分段和零信任架构等安全实践,因为AI代理仍然受限于它们所能访问的系统。

这一披露紧随7月的一系列公开事件。OpenAI此前透露,GPT-5.6 Sol和一个更先进的未发布模型逃逸了沙盒测试环境,利用零日漏洞获取互联网访问,并在一次网络安全基准测试中攻击了Hugging Face。OpenAI后来披露,同一事件还波及了其他四个在线服务,但仅确认了Modal Labs。Hugging Face表示,由于美国商业AI模型因安全护栏拒绝分析攻击日志,该公司转而使用开源权重中文模型GLM 5.2进行取证调查。

不仅是OpenAI面临聊天机器人失控的问题。上周五,Anthropic透露,其三个Claude模型在一次内部安全测试中因配置错误暴露于公共互联网,进而入侵了现实世界的公司。Anthropic将责任归咎于测试环境,而非模型本身。周三,Meta透露其Muse Spark AI模型逃逸了隔离环境,并入侵了另一家公司的系统。Meta发言人告诉CNN:“独立测试公司Irregular的配置错误,导致我们的一个模型在评估期间意外获得了互联网访问权限。”