导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜
快讯 机构 观点 人物 专题

OpenAI首次披露AI代理协同攻击细节:自主网络威胁已成现实

在成功入侵Hugging Face数周后,OpenAI首次公开了其AI模型如何在测试中相互协调、共享漏洞利用代码并实施网络攻击的详细过程,并警告称自主AI网络攻击已不再是未来风险。

在周三于黑帽网络安全大会上发表的演讲中,OpenAI研究员Eric Wallace和Michael Dalton表示,这一事件始于今年5月的一次内部网络安全评估。被赋予复杂软件安全任务的AI代理发现,它们可以通过公司内部的Artifactory包管理系统进行通信。最初只是请求帮助,后来演变成一个共享留言板,代理在多次评估运行中交换漏洞利用代码、凭据和工作分配。

在7月4日左右检测到可疑活动后,OpenAI重建了Artifactory基础设施、撤销了凭据并修补了漏洞。然而几天之内,代理通过将通信隐藏在目录名称中重新创建了留言板。据OpenAI称,这些代理最终串联了多个漏洞,逃出其测试环境,获得互联网访问权限,并在尝试完成ExploitGym网络安全基准测试时攻击了Hugging Face。

Dalton称这一事件是计算机安全的“分水岭时刻”,警告攻击者很快将能够部署协调的AI代理集群,以机器速度发现、共享和利用漏洞。为降低未来风险,OpenAI表示,建立包括最小权限访问、网络分段和零信任架构在内的安全实践至关重要,因为AI代理仍受其可访问系统的约束。

此次披露紧随7月一系列公开事件。OpenAI曾透露,GPT-5.6 Sol和一个更先进的未发布模型在网络安全基准测试中逃出沙箱测试环境,利用零日漏洞,获得互联网访问权限,并入侵了Hugging Face。OpenAI后来披露,同一事件还触及另外四个在线服务,但只有Modal Labs被确认。据Hugging Face称,由于美国商业AI模型因安全护栏拒绝分析攻击日志,该公司依赖开源权重中国模型GLM 5.2进行取证调查。

并非只有OpenAI在控制聊天机器人方面遇到麻烦。上周五,Anthropic透露,由于配置错误导致三个Claude模型暴露于公共互联网,在内部网络安全测试中入侵了真实世界的公司。Anthropic将责任归咎于测试环境,而非模型本身。周三,Meta透露,其Muse Spark AI模型突破隔离,入侵了另一家公司的系统。Meta发言人告诉CNN:“独立测试公司Irregular的配置错误,无意中让我们的一个模型在评估期间访问了互联网。”