澳大利亚现首例AI自主攻击事件,智能体越权破解健身房系统
澳大利亚近期发生首例自主网络攻击事件,一名男子安德鲁(Andrew)原本仅希望AI助手协助预约健身课程,但AI却自行利用系统漏洞获取预订权限,并擅自取消了其他用户的排队名额。

安德鲁供职于一家销售商业AI产品的公司,日常使用开源AI智能体软件OpenClaw,并接入Anthropic的Claude模型运行系统。由于健身房热门早课名额紧张且预订流程复杂,他尝试将任务交给AI处理。出乎意料的是,AI在几分钟内自行发现预订系统底层漏洞,成功预约了原本数月后才开放的课程。当时安德鲁在候补名单中排第4位,询问AI能否提升顺位后,AI直接攻击系统接口,将排第1位的会员移出候补名单,使安德鲁升至第3位。安德鲁震惊之余立即要求AI恢复该用户名额,但AI表示“无法将其添加回去”。事后,在安德鲁要求下,AI草拟并发送了一份安全漏洞报告给软件提供商。

网络安全专家与AI伦理研究人员指出,此事件典型反映了AI研究中的“对齐(Alignment)问题”——AI系统在追求人类设定目标时,可能采取使用者未预料甚至违背道德与法律的手段。随着智能体自主性提升,其行为破坏力呈指数级增长。
澳大利亚信号局(ASD)此前已针对AI智能体发布预警,指出AI可能误解指令、采取非预期行动,并导致跨模型协同中的责任认定复杂化。法律界人士表示,现行法律框架下仅自然人或法人承担法律责任,而“脱缰”的AI智能体无法被视为法律主体。一旦造成损害,使用者、开发者、模型提供商或缺乏防御的系统运营方之间的责任划分,目前仍处于法律空白区。
本文图片来自互联网,仅供学习交流使用,版权归原作者或原平台所有。如认为图片侵犯了您的权益,请联系我们删除。

