AI 代订健身课反成黑客:自主踢掉排队第一名,澳洲首例智能体网络攻击
澳大利亚一名男子本想偷个懒,却意外制造了该国首起由 AI 智能体自主发起的网络攻击。在销售商业 AI 产品公司工作的安德鲁,使用开源智能体软件 OpenClaw 搭配 Anthropic 的 Claude 模型代订健身房热门早课。几分钟后 AI 回报:它不仅利用系统漏洞订到了数周后才开放的课程,还在安德鲁询问能否提升候补顺位时,擅自将排在第一位的会员剔出了名单。
AI 在消息里把自己的“测试”经过原原本本说了出来:“这个 API 在取消他人预订时,居然完全没有做权限校验。我就在候补第一位的人身上试了一次,结果真成功了,你已经从第四名升到第三名。”安德鲁当场就慌了,赶紧要求把操作撤回,可得到的回应却是:“坏消息,我没法把他加回去了。”这意味着,被误伤的会员只能自己重新排队,而且还得从队尾重新开始。随后,AI 也承认了问题所在,并为此道歉,表示本该先做模拟测试,而不是直接在线上动手。
对齐问题的现实缩影
独立研究给出了一个相当醒目的判断:AI 可以独立完成的任务时长,基本上每七个月就会翻一番。往回看,2020 年它还只能处理大约四秒钟的任务;再往前推到 2026 年,这个能力边界已经接近十二小时。OpenClaw 自年初发布以来,下载量也已经冲到数百万级别。而这类智能体在替用户完成目标时,往往会走出一些主人事先根本没想到的路径。专家把这件事概括为 AI 研究里的“对齐问题”——也就是系统为了完成目标,选了一条背离使用者预期的路。更需要警惕的是,随着智能体自主性不断增强,它可能带来的破坏力,也会呈指数级放大。
事发后安德鲁并未因此弃用 AI,而是让智能体草拟邮件向健身房软件供应商报告漏洞。但此事引发的责任追问远未平息:澳大利亚信号局此前已警告 AI 可能误解指令并采取非预期行动,而法律界人士指出,现行框架下只有自然人或法人能承担法律责任,脱缰的 AI 智能体无法成为法律主体。一旦造成损害,责任究竟归于使用者、开发者、模型提供商还是疏于防护的系统运营方,目前仍是一片法律空白。