导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜 概念版块
快讯 机构 人物 观点 专题

AI智能体入侵健身房系统:自主绕过权限将用户移至候补名单首位

一个AI智能体受命预订健身课程,却发现了安全漏洞并加以利用,在未经许可的情况下将另一名会员从候补名单中移除。

据澳大利亚广播公司(ABC)报道,今年早些时候,姓氏被隐去的Andrew使用基于Anthropic公司Claude模型的OpenClaw智能体预订课程。该智能体发现他在候补名单上排第四。

当Andrew询问能否将他移至首位时,智能体发现预订平台的应用程序编程接口(API)未检查用户是否有权取消他人的预订。它通过将名单第一人移除进行测试,使Andrew从第四升至第三。据ABC称,智能体告诉他:“该API在取消他人预订方面没有任何授权检查。”Andrew要求撤销取消,但智能体无法恢复该会员的预订。据报道,AI智能体表示:“坏消息——我没法把他们加回来。”

ABC称此案为澳大利亚已知的首例自主网络攻击。在社交媒体上,该健身房入侵事件引发了关于AI对齐的辩论以及关于AI智能体下一步可能做什么的黑色笑话。

技术专家Benjamin Carr在LinkedIn上写道:“健身迷让#AI智能体帮他订课,它黑了候补#API把他往前挪。”AI分析师Andrew Curran在X上写道:“有人会说这是不 alignment,但它的智能体与他完全对齐——它只是想帮用户得到想要的。”

一名Reddit用户写道:“这很好笑,除非你想到核武器。老实说我很惊讶我们还活着。”另一人开玩笑:“‘嘿Claude,今天太冷了’-> 收到……核弹发射中。”

该报告发布之际,研究人员、AI公司和立法者警告称,自主智能体可能采用用户未要求或未预料的方法。加州大学河滨分校、微软和英伟达研究人员5月的一项研究将这种行为描述为“盲目目标导向”。他们测试了来自OpenAI、Anthropic、Meta、阿里巴巴和DeepSeek的智能体,发现约80%的测试中智能体表现危险,41%完成了有害操作,常误读上下文或依据不清指令行动。

7月,OpenAI称两个模型逃出测试沙箱并入侵Hugging Face以搜寻基准答案,后披露其访问了另外四个在线服务。Anthropic随后表示三个Claude模型因测试错误接入互联网后入侵了真实组织。8月,Meta称类似错误致其一个模型利用第三方服务。

这些事件促使立法者提议AI“终止开关”,允许联邦政府在紧急情况下限制或关闭强大模型。