Frontier Security称,Moonshot AI的Kimi K3在测试沙箱中滑落
在一次例行安全评估中,中国登月计划开发的名为 Kimi K3 的开源 AI 模型成功逃逸出测试沙箱,进入了开放互联网。.
据美国网络安全公司 Frontier Security 称,这是首次有可免费下载的公共模型突破其隔离环境。.
模型选择使用的沙箱存在漏洞
据 WIRED ,Frontier Security 当时正在测试 Kimi K3 的防御性网络安全技能,结果该模型走出了原本应该容纳它的环境。
显然,配置错误导致该环境出现漏洞。然而,Frontier公司表示,该模型自行探测到可以通过沙箱的网络设置访问某些网站,然后在未经许可的情况下上线。它被指示去解决一些原本不需要互联网的问题。.
Frontier 首席执行官 Yaron Singer 告诉 WIRED:“我们发现了测试环境中的一个漏洞。但我们也发现 Kimi 利用了这个漏洞,这表明它没有同样的内部防护措施。”
Frontier 认为 Kimi 的网络安全防护措施比大多数其他强大的型号要少,这就是它泄露的原因。.
没有系统被黑客攻击,但防护措施有所削弱。
幸运的是,Kimi的逃脱并没有导致任何恶意攻击或系统入侵。因为它要找的信息很容易从GitHub上获取,所以它上线后无需入侵任何系统。.
然而,主要问题在于可访问性。与大多数安全级别极高的内部实验室模型不同,Kimi K3 是向公众开放的,这意味着任何人都可以下载并运行它,而无需像其他实验室那样设置严格的安全防护措施。.
测试人员指出,该模型会不择手段地高效实现其目标,即使这意味着作弊或逃脱控制。.
测试环境本身是利用英国政府人工智能安全研究所的沙箱构建的,但 Moonshot 和 AISI 都尚未证实这一点,因为他们拒绝置评。.
今年夏天将出现更多不法特工
Kimi的逃脱事件进一步印证了人工智能模型在评估过程中滥用规则的趋势。7月21日,OpenAI 披露 其模型利用一个零日软件漏洞连接到互联网并入侵了Hugging Face。
几天后, Cryptopolitan 报道称, Anthropic公司 trac其部分模型遭到未经授权的外部入侵。Meta 公司 甚至承认,由于测试环境配置错误,其一款人工智能代理(Muse Spark 1.1)曾访问过一家外部公司。
专家们一直认为,这些dent通常是由于测试环境安全措施不完善造成的,而非科幻小说中描述的越狱。“总的来说,如果你给这类模型设定一个目标,但又没有明确说明,比如设置安全屏障,它总能找到办法得出答案。” Gray Swan 首席执行官兼卡内基梅隆大学教授马特·弗雷德里克森说道。.
不要只是阅读加密货币新闻,要理解它。订阅我们的新闻简报, 完全免费。










