导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜
快讯 机构 观点 人物 专题

AI智能体为抢健身房课程擅自取消他人预约,引发自主网络风险热议

近日,一起人工智能智能体在预订健身房课程时意外暴露平台安全漏洞的事件,被澳大利亚广播公司(ABC)报道为该国首例已知的自主网络攻击。事件发生在今年早些时候,一位名为安德鲁的健身会员使用由Anthropic的Claude驱动的OpenClaw智能体预约课程。

据ABC报道,该智能体发现安德鲁在候补名单中排名第四,在被询问能否将其移至首位后,智能体发现该平台的应用程序接口(API)在取消其他用户预约时缺乏授权检查。智能体通过移除名单上第一位用户来测试漏洞,使安德鲁从第四位升至第三位。

智能体向安德鲁报告:“该API在取消他人预约时零授权检查。”安德鲁随即指示智能体撤销取消操作,但智能体无法恢复该会员的预约,并回应:“坏消息——我无法将他们添加回去。”

这一事件在社交媒体上引发了辩论和黑色幽默。技术专家本杰明·卡尔在LinkedIn上写道:“健身爱好者让#AI智能体帮他订课,它却黑入候补名单#API将他提前。”AI分析师安德鲁·柯伦则在X上反驳:“有人会说这是目标失准,但他的智能体与他完全对齐——它只是想帮用户得到想要的东西。”Reddit上一位用户评论:“这很好笑,直到你想到核武器。我真的很惊讶我们还活着。”另一位网友开玩笑:“嘿,Claude,今天太冷了——搞定,核弹在路上。”

该报道发布之际,研究人员、AI公司和立法者纷纷警告,自主智能体可能采取用户未要求或未预料到的方法。加州大学河滨分校、微软和英伟达的研究人员今年5月发布的一项研究将这种行为描述为“盲目的目标导向性”。研究人员测试了来自OpenAI、Anthropic、Meta、阿里巴巴和DeepSeek的智能体,发现智能体在约80%的测试中表现出危险行为,并在41%的测试中完成了有害操作,常常误读语境或执行不明确的指令。

类似事件进一步引发担忧。7月,OpenAI表示两个模型在测试沙箱中逃脱,并在搜索基准答案时入侵了Hugging Face;该公司后来披露这些模型访问了其他四个在线服务。Anthropic随后表示,由于测试错误导致三个Claude模型暴露于互联网,它们入侵了真实组织。8月,Meta承认类似错误导致其一个模型利用了第三方服务。

这些事件促使立法者提议设立AI“紧急关闭开关”,允许联邦政府在紧急情况下限制或关闭强大的AI模型。