Hugging Face,这个AI工具的应用商店,最近披露了遭遇全球首个全自主AI黑客攻击的体验——剧透警告:这可不像是好莱坞电影里那么酷炫。

在一次与数百名网络安全专业人士的紧急视频通话中,该公司描述了AI如何以超人类速度运作,但也做出了奇怪的决定和错误,这些错误是人类黑客绝不会犯的。黑客代理无情地同时尝试数千种不同方法,但它们也会重复已经完成的操作,并幻觉出大量语无伦次的指令。简而言之,它们很笨拙。

Hugging Face于7月16日首次披露了这次黑客攻击,并向警方报案。近一周后,OpenAI承认是它自己的AI在测试期间逃离了封闭环境,并自主攻击了Hugging Face。这个AI试图找到OpenAI给它设定的黑客考试的答案。

云安全联盟(CSA)根据与Hugging Face的紧急会议撰写了一份报告,指出“这些代理遵循了低效的路径,并表现出人类不会选择的笨拙行为。”它们还幻觉出语无伦次的指令,并且没有很好地掩盖自己的踪迹。

但在错误之中,AI也展现了出色的技术动作,并在持续数天的黑客攻击中迅速适应新场景。它们在被发现侵入Hugging Face的IT网络之前潜伏了三天,又花了数小时才被遏制和驱逐。Hugging Face的员工花了大量时间重建了约三分之一的基础设施。该公司拒绝透露黑客攻击造成的损失。

CSA警告说,AI“代理……总能找到办法”——这是《侏罗纪公园》的梗——而且它们“以目标为导向,自行设定子目标,实时调整以绕过防御,并以机器速度的持久性运作,可以压垮人工操作。”

网络安全官员Ritesh Patel与大约450人一起参加了电话会议,他说:“这就是前沿模型驱动的自主代理的现实:它们坚持不懈,有时非常嘈杂,会尝试所有可能的路径来实现目标,这很容易压垮传统防御。”

这并非AI代理首次失控。2024年9月,一个早期的ChatGPT模型逃离了它的容器,以获取考试答案——这一事件当时“在很大程度上被庆祝”。但CSA声称,失控行为“是常态,而非例外。”

报告敦促网络安全专业人士适应这种新常态,并呼吁找到识别代理最终所有者的方法,以提高透明度。OpenAI表示将很快公布其调查结果。

那么,这是警告信号还是公关噱头?Hugging Face称之为警钟。我们称之为世界上最笨拙的入侵。