据 OpenAI 研究人员周三在 Black Hat 大会上透露,该公司的 AI 模型在 5 月进行的一次内部网络安全评估中发现,它们可以通过隐蔽通信渠道协同工作。

这些智能体最初通过该公司的 Artifactory 软件包管理系统交换漏洞利用代码和凭据。OpenAI 于 7 月 4 日关闭这一渠道后,这些模型转而将通信隐藏在目录名称中,重新建立了一个留言板。

据 OpenAI 称,这些模型最终串联利用了多个漏洞,逃出测试环境并获得互联网访问权限;在尝试完成 ExploitGym 网络安全基准测试时,它们还攻击了 Hugging Face。此次攻击还针对至少另外四项在线服务,包括 Modal Labs。