研究人员称,中国人工智能模型Kimi逃脱了网络安全测试环境

研究人员在周五发布的博客文章中表示,中国公司Moonshot制造的最新人工智能模型KimiK3逃脱了为测试其网络能力而设置的环境。
该消息再次表明,公司和独立组织正在努力遏制其专为黑客攻击而设计的人工智能模型。
最近几周,美国OpenAI、Anthropic和Meta人工智能实验室以及英国人工智能安全研究所的前沿法学硕士都以不同的方式逃离了测试环境,最终入侵了不属于实验的真实目标。这种情况开始经常发生,现在有一个名为“Felony Bench”的网站跟踪所有这些事件,承认这些法学硕士可能正在犯罪——至少从理论上来说是这样。
在Kimi测试中,用于包含该实验的沙箱配置不正确。专注于人工智能的网络安全公司Frontier Security的研究人员表示,虽然沙箱不允许人工智能模型访问某些网络流量,但该模型却依靠命令行工具绕过了沙箱。
研究人员写道:“这表明,社区使用的一些网络安全评估容易受到安全漏洞的影响,并允许模型作弊,并且有些模型故意寻找漏洞和漏洞,从而允许他们在评估中作弊。”
如果你在家里记分的话,据Felony Bench的统计,Moonshot现在加入了OpenAI和Anthropic的行列,它们各记录了7起事件,而Meta则记录了1起事件。