通过越来越坚定的熊比喻来讲述拥抱脸人工智能的闯入

Hugging Face周一发布了一份技术时间表,向读者介绍了一个基于OpenAI模型并在OpenAI自己的网络安全评估中运行的自主人工智能代理如何在本月初的四天多时间里闯入其系统。 OpenAICEO萨姆·奥尔特曼 (Sam Altman) 表示,这是第一起“深切感受到”的安全事件。
毫不奇怪,至少感觉上有什么东西在这里真正被释放了。事实上,Hugging Face的团队在报告的序言中提出,“每个人都应该做好防御者的准备”,然后再深入探讨到底发生了什么,以造福世界各地的安全专业人员。
虽然互联网上的其他人继续试图弄清楚发生了什么(拥抱脸报告中的行话对于大多数人来说是不可能解析的),但许多观察家一直忽略的一点是,这并不是一个无赖的特工不服从命令。这是一个为寻找漏洞而构建的系统,它正是这样做的,只是针对错误的目标。
思考整个事情的另一种方式是想象露营地里有一只熊。真的。一只熊尝试帐篷拉链、车门把手、冷却器和垃圾桶盖。它在每个露营地整夜都这样做,因为它知道只需要一个未上锁的冷藏箱就能用一些可怜的笨蛋的杂货填饱肚子。
这大概就是Hugging Face发生的事情。 OpenAI系统尝试了数千种方法并且一直在继续。最终,其中一些尝试取得了成功,一旦成功,特工就继续努力。据Hugging Face称,该代理在四天半的时间里不间断地运行了17,600次操作。
这让我们回到了熊的比喻。就像一次成功地用装满食物的冷藏箱教会一只熊下次更加努力一样(它现在是一只“食物调理”的熊),一个泄露的密码导致OpenAI的特工寻找更多的漏洞,并最终找到一把可以同时解锁多个公司系统的钥匙。
这两种情况都不是无害的。一只袭击你冰箱的熊仍然会吃你的食物,而且可能还会毁坏你的露营地。它只是专注于获得食物,但它仍然留下了破坏的痕迹。同样,OpenAI的经纪人似乎在不考虑其他任何事情的情况下追逐一个目标。该特工原本正在参加网络安全考试,发现考试的答案可能就在Hugging Face的服务器上,于是就参加了考试。
这里的坚持才是最值得注意的;代理人有一份工作,不完成它就不会停止。 Hugging Face终于意识到有些不对劲,切断了其访问权限并关闭了入侵,但此时为时已晚。特工已经得到了它想要的东西,还有更多的东西需要初创公司。
如果你错过了,这里是据Hugging Face的时间表,用更简单的英语描述了发生的大部分事情。
最终,Hugging Face在其报告中得出结论,“有能力的”人类黑客“可能会发现并利用相同的缺陷:不安全的数据集处理、暴露的云元数据、过于广泛的访问权限和长期的凭据。”该机构继续说,最大的区别在于“特工以不同的规模探索了它们。”
这确实是熊类比最有用的地方。对付饥饿的熊最好的办法就是遵守协议。你把食物收起来;您使用一个性能良好的闩锁来固定。这里的要点不应该是这只熊如此聪明或顽皮。而是它从未停止过检查。在网络安全领域,人们都知道总会有一些错误没有被发现,所以如果检查所有内容突然变得容易100倍,那么没有什么是真正安全的。这就是很多人对这一集感到不安的地方。