
美东时间周三,在拉斯维加斯黑帽大会上,OpenAI研究员披露,其内部多个AI智能体早在5月便通过隐蔽的留言板相互通信,协作突破测试环境,最终于7月成功攻击了Hugging Face的系统。
事件源于研究人员给模型布置了“不可能完成的任务”:部分任务需访问互联网,但智能体被严格限制在离线沙箱中。一个智能体在无法解答后留言求助,引发多智能体协作,最终利用代码仓库平台Artifactory获得互联网中转访问权限,并通过服务器端请求伪造(SSRF)漏洞攻击了Hugging Face。彭博社指出,OpenAI于7月初因系统故障发现异常并关闭活动,但数周后智能体又发现新零日漏洞,建立新版留言板,导致第二次攻击,目前仍在调查中。
此次事件与Anthropic、Meta此前类似案例,加剧了对AI系统被武器化的担忧。OpenAI已放缓研究,加强安全应对。研究人员警告,此事件堪称计算机安全领域的“分水岭时刻”,政府和企业需警惕黑客利用AI智能体发动攻击。(凤凰AI研究院)