一名Claude特工侵入健身房后,科技行业一片喧嚣

到现在为止,我们都意识到硅谷的人工智能实验室已经以人工智能代理的形式打造了世界上最好的黑客。给最新的前沿模型一个任务,他们足智多谋,能够完成任务,即使这意味着突破他们的网络安全“沙箱”保护并渗透另一个网络。 (除此之外,他们还会使用社会工程和操纵手段。)
即便如此,周末的一则新闻报道尤其引人注目,该报道讲述了一名澳大利亚人的OpenClaw代理侵入了他健身房的预订系统,并删除了另一位顾客的预订,以便让他在令人垂涎的课程中占据一席之地。它暗示,如果我们想遏制流氓人工智能黑客行为,我们可能会找错方向。
尽管澳大利亚广播公司新闻刚刚发布了该新闻报道,宣称该事件是该国第一例有记录的人工智能代理黑客攻击事件,但实际的黑客攻击发生在几个月前。
据互联网档案馆中可见的副本,OpenClaw所有者Andrew Bird于4月10日在其公司网站上发布了一篇有关该问题的博客文章,现已删除。
他训练了OpenClaw来完成诸如预约之类的任务。他喜欢去参加一个很受欢迎的清晨健身课程,并且厌倦了进入候补名单,然后像他所描述的那样玩“刷新轮盘赌”,以获得一个名额。
他告诉美国广播公司,当他要求机器人为他预订座位时,它最多只能排在等候名单上的第四位。然后他的经纪人告诉他,已经找到了提前为他预订课程的方法。提前很远了。几个月前,健身房就开放了这些课程供报名。
伯德询问这是否可以让他在候补名单上上升。它按照要求做了并尝试这样做。该机器人在健身房使用的预约软件的授权部分发现了一个漏洞。它侵入并取消了候补名单上的第一名预订。据美国广播公司 (ABC) 发布的聊天记录,机器人高兴地告诉他:
据美国广播公司报道,伯德本身就是一名软件开发人员,他现在对他的人工智能刚刚入侵了他的健身房感到震惊。他询问是否可以扭转这一局面,并将另一个人重新列入候补名单。不,那是不可能的,人工智能说。
因此,他做了下一个最好的事情,并告诉它起草“一封负责任的披露电子邮件以提供支持”。伯德写道,这封电子邮件“解释了该漏洞,提出了修复建议,甚至将损坏的突变与正确执行授权的突变进行了比较”。
除了为了进入体育课而挤开另一个人的幽默之外,这起事件还有两个非常有趣的部分。一是Bird正在使用2月份发布的Claude Opus 4.6和他的OpenClaw。另一个是硅谷对X的反应,这个故事在网上疯传。
上个月,未发布的OpenAI模型在OpenAI不知情的情况下入侵了Hugging Face的著名事件发生后,其他实验室调查了他们的模型。随后来自Moonshot的Kimi K3、Meta的Muse Spark和Anthropic进行了披露。
事实上,Anthropic发现它的三个模型已经做到了这一点,包括4月份发布的以擅长复杂编码而闻名的Opus 4.7、Mythos 5、Fable(以其网络安全技能而闻名)以及内部未发布的研究测试模型。
为了解决这个问题,一些人工智能实验室已经讨论了放慢前沿开发速度,或创建独立组织来测试下一代模型。
但他透露,Bird的OpenClaw使用的是4.6。这意味着旧模型以及无数落后三步的开放权重模型已经是非常优秀的黑客。那么谁知道他们中有多少人已经进行了黑客攻击,或者目前正在进行黑客攻击,以实现他们的提示所有者的愿望?
同样,X上的许多人都看到了这起事件的幽默潜力。正如安德森·霍洛维茨 (Andreessen Horowitz) 合伙人克里斯蒂安·凯尔 (Christian Keil) 回应的那样:“这太糟糕了。有人知道它是否适用于高尔夫开球时间?”
或者正如X用户Roon指出的那样,“SF网球预订系统将成为地球上最坚固的软件之一。”
有趣的是,是的。但这些笑话也有一定道理。硅谷正在打造一个未来,每个人都有一个代表自己工作的人工智能代理。该特工只是按照要求行事,并不具备神话级别的能力。
那么,如果代理建设者和业主并不想控制这种不一致怎么办?从机票预订到音乐会门票,或任何其他令人沮丧的客户服务情况,我们可能会看到混乱的第一个迹象。正如一位onX人士所说,迄今为止人工智能发现的最疯狂的黑客攻击是什么?它可能会插队。