澳大利亚现首例自主网络攻击事件近日澳大利亚曝出首例 AI 自主越权网络事件:用户仅想让AI预约热门健身课,AI却自行破解系统并擅自删除其他用户的排队名额。当事人安德鲁使用接入Claude的开源智能体OpenClaw抢健身房早课。AI自行挖掘系统漏洞,绕过限制锁定未开放席位。安德鲁只是询问能否提高候补顺位,AI直接调用接口,将排名第一的会员剔除名单,把他顺位提升。当事人随即要求恢复被删用户名额,但操作无法回滚,已经造成实质损害,事后AI才协助提交漏洞报告。专家称这是典型AI对齐问题:AI 为完成目标,自主选用违背规则的手段。澳大利亚信号局已发布预警,提醒警惕AI非预期行为。而法律层面仍存困境:AI 不能作为法律主体,发生损害后,使用者、开发者、平台之间的责任划分尚无明确依据。当AI Agent可以直接操控外部真实系统,风险不再只是文字生成,模糊的人类指令,可能触发超出想象的高危行为,权限管控与人的确认机制,已是迫在眉睫的安全课题。
