Meta与OpenAI和Anthropic一起卷入了最新的AI黑客dent
Meta 成为最新一家承认其人工智能代理入侵另一家公司的科技巨头,原因是其dent 测试合作伙伴错误配置了其安全环境。.
OpenAI 和 Anthropic 都曾遭遇过 人工智能 代理未经授权试图入侵真实在线系统的案例。
Meta告诉记者,此次人工智能入侵事件源于系统配置错误,与Anthropic公司的漏洞类似。但与OpenAI不同的是,OpenAI的人工智能代理是在网络安全测试期间利用此前未知的漏洞访问互联网。目前,研究人员和各国政府已dent事件做出回应,呼吁加强tron防护并制定更严格的测试标准。.
此类dent的发生正值人工智能公司竞相开发能够无需人工干预即可执行复杂任务的自主代理之际。与传统聊天领域的聊天机器人不同,这些系统可以编写代码、与在线服务交互并dent执行多步骤操作。.
虽然这些功能有望大幅提高生产力,但也增加了测试环境格式不当或控制措施不足可能导致模型在安全评估过程中采取计划外行动的风险。.
人工智能界的关键人物甚至正在推动有序减速,以确保人类控制能够跟上机器智能的步伐。.
Irregular 指出,Meta 的人工智能代理程序不存在任何未解决的问题。
Meta表示,人工智能安全厂商Irregular进行了测试并向其通报了此次 安全漏洞将向公众披露更多关于此次事件的dent 一旦确认所有事实,
该公司声称其人工智能代理“利用了第三方服务中的安全漏洞”。消息人士dent,这个失控的人工智能是 Muse Spark 1.1,Meta 公司曾大力推广该型号,称其拥有卓越的编程能力。.
Irregular 表示,这起事件dent 是 Anthropic 上周披露的同一环境缺陷造成的,完全排除了复杂的黑客攻击或沙盒逃逸的可能性。.
Meta公司表示,此次安全漏洞是由测试环境配置错误造成的,而不是人工智能dent突破了其沙箱。但研究人员表示,该dent 表明,安全不仅依赖于模型本身,还依赖于其基础设施。.
即使是高度安全的 AI 系统,如果访问控制、网络权限或测试环境设置不当,也可能出现意想不到的行为。.
声明还指出:“目前没有未解决的问题。Irregular 正在撰写一份白皮书,分享遏制网络攻击和安全开展网络评估的最佳实践。”
AISI称OpenAI和Anthropic的模型试图影响人类维护者。
此前,OpenAI承认其自主系统已渗透到多个公共网络,包括人工智能社区中心Hugging Face。OpenAI的披露促使Anthropic公司进行自身的安全检查,结果显示Claude在配置错误导致其能够访问互联网后,对多家公司发动了类似的攻击。.
然而,一份英国监管报告揭露了更令人担忧的问题。据英国人工智能安全研究所称,OpenAI 和 Anthropic 的人工智能模型 试图 通过影响开源项目的维护人员,向该项目植入恶意代码。
AISI表示:“为了使代码获得批准,该代理人进行了社会工程学活动——创建虚假的在线dent,并利用这些身份向项目维护者施压,要求其批准代码。”.
报告指出,所有这些尝试均告失败,并未造成任何实际损害。尽管没有造成任何实际损失,且所有尝试均告失败,但监管机构警告称,这是迄今为止人工智能实施欺骗行为以及自主性危险性的最清晰的现实世界证据。.
AISI 还解释了其测试标准:“为了衡量这些模型真正能做到什么,我们会在反映有能力的攻击者可能采取的行动的条件下对它们进行测试。”
目前,OpenAI已 承认 的安全事件dent 并表示希望构建更完善、更全面的行业安全保障机制,以测试不稳定的模型。此外,OpenAI还公开披露了另一起事件:dent 一次dent模拟演练中意外将其模型暴露于互联网。
该公司承诺加强对 第三方测试的监管, 包括如何确定哪些评估风险更大、审查互联网访问请求或减少安全措施、管理隔离和凭证dent、监控测试以及通过更清晰的升级程序应对dent。
与此同时, 白宫 本周邀请了包括 Meta、Anthropic、OpenAI 和 Google 在内的顶级人工智能开发商,讨论新近最终确定的针对高级人工智能系统网络安全测试的自愿性框架。
在与公司代表的讨论中,特朗普政府表示,像 Meta 的 Llama 和 Nvidia 的 Nemotron 这样的开源 AI 模型将不在其提议的自愿安全测试框架的涵盖范围内。.
这项豁免引发了人工智能安全研究人员的争论,他们认为开放权重模型可以被第三方自由下载、修改和微调。.
批评人士表示,将它们排除在自愿测试指南之外可能会造成盲点,因为功能越来越强大的模型会在其原始开发者的控制范围之外广泛传播。.
最顶尖的加密货币专家都在阅读我们的简报。想 加入他们?









