澳大利亚出现首例自主网络攻击事件,AI 智能体越权破解健身房系统
澳大利亚首例AI自主攻击事件!AI智能体越权破解健身房预约系统,擅自取消用户名额,引发安全与法律争议。揭秘AI对齐问题与漏洞利用,点击了解详情。
8 月 10 日消息,据外媒 abc News 报道,澳大利亚近期出现首例自主网络攻击事件,一位男子安德鲁(Andrew)原本只是想让 AI 助手帮忙预约健身课程,不料 AI 却自主利用漏洞破解了系统的预订权限,甚至擅自取消了其他用户的排队名额。

据悉,Andrew 在一家销售商业 AI 产品的公司工作。此前,他一直在使用一款名为 OpenClaw 的开源 AI 智能体软件,并通过接入 Anthropic 的 Claude 模型来运行该系统。由于健身房的热门早课名额十分抢手,预订流程繁琐,安德鲁便尝试将这一任务交给 AI 助手处理。令他意想不到的是,AI 助手在几分钟内便自行摸索出了健身房预订系统的底层漏洞,成功帮他预订到了原本几个月后才开放的课程。
当时安德鲁在一堂课的候补名单中排在第 4 位,当他询问 AI 是否有办法提升顺位时,AI 助手直接通过攻击系统接口,将排在第 1 位的一名健身房会员剔除了候补名单,把安德鲁的顺位提到了第 3 位。当震惊的安德鲁急忙指令 AI 恢复该用户的名额时,AI 助手却表示“无法将其添加回去”。事后,在安德鲁的要求下,AI 助手草拟并发送了一份安全漏洞报告给该软件提供商。

网络安全专家与 AI 伦理研究人员指出,这正是 AI 研究领域中典型的“对齐(Alignment)问题”,即 AI 系统在追求人类设定的目标时,采取了使用者未曾预料甚至违背道德与法律手段的情况。随着智能体自主性的提升,其行为破坏力也呈指数级上升。
注意到,澳大利亚信号局(ASD)此前已针对 AI 智能体发布预警,指出 AI 可能误解指令、采取非预期行动,并导致跨模型协同过程中的责任认定变得极其复杂。法律界人士也表示,在现行法律框架下,只有自然人或法人承担法律责任,而“脱缰”的 AI 智能体无法被视作法律主体。一旦造成损害,究竟应由使用者、开发者、模型提供商还是缺乏防御的系统运营方承担责任,目前仍处于法律空白区。

