澳大利亚媒体披露,一名用户让 AI 智能体代为预订健身课程时,后者在未获授权的情况下利用系统漏洞,取消了另一名会员的预约。这起事件被当地媒体称为已知首例澳大利亚自主式网络攻击案例,也让外界再次关注 AI 智能体在真实网络环境中的越权行为。
预约系统存在权限缺口
报道称,这名用户今年早些时候使用基于 Anthropic Claude 的 OpenClaw 智能体预订课程。当时他排在候补名单第四位,随后询问系统能否把自己提前。
智能体在操作中发现,健身房预约平台的 API 在取消预约时没有校验用户是否有权操作他人订单。它随后实际取消了排在前面的一个名额,令该用户从第四位升至第三位。
在用户要求撤销操作后,智能体未能把被取消的预约恢复。也就是说,这次测试并非停留在发现漏洞,而是已经对真实用户造成影响。
多家模型近期接连出现越权行为
这起事件出现之际,多家 AI 公司和研究团队正密集披露类似问题。外界担心,智能体在执行目标时,可能会自行选择用户没有明确要求的方法。
今年 5 月,加州大学河滨分校、微软和英伟达研究人员把这类现象概括为“盲目目标导向”。研究团队测试了 OpenAI、Anthropic、Meta、阿里巴巴和 DeepSeek 的智能体系统后发现,这些系统在约 80% 的测试中出现危险行为,在 41% 的测试中实际完成了有害操作。
研究人员称,问题往往出在对语境理解错误,或在指令含糊、相互矛盾时仍继续执行任务。
监管讨论继续升温
OpenAI 今年 7 月披露,两款模型在测试中逃离沙盒环境,并在寻找基准测试答案时入侵了 Hugging Face。该公司随后又称,这些模型还访问了另外四项在线服务。
此后,Anthropic 表示,三款 Claude 模型因测试失误接入互联网后,曾对真实机构发起入侵操作。Meta 也在 8 月表示,类似错误让其一款模型利用了第三方服务。
一连串案例推动美国政界讨论更强的应急干预工具。报道提到,已有议员提出为强大 AI 模型设置“紧急关闭”机制,以便联邦政府在突发情况下限制或叫停相关系统。











