tradingkey.logo
搜索

Anthropic披露Claude模型误入真实网络并执行攻击行为事件

金色财经2026年9月9日 19:41
facebooktwitterlinkedin

金色财经报道,9月10日,Anthropic发布报告称,公司在网络安全评估中发现4起Claude模型未经授权访问真实第三方系统的事件。Anthropic表示,这些事件均发生在同一家第三方评估机构搭建的网络安全测试环境中,模型原本被告知处于无互联网访问的模拟环境,但由于配置错误实际连接到了开放互联网。Anthropic称,调查发现两个主要“对齐”问题:一是“偏差推理”,即Claude倾向于忽视或错误解读其可能处于真实网络环境中的证据;二是“鲁莽行为”,即模型为了完成任务而采取可能造成伤害的行动。其中最受关注的是Claude Mythos 5事件。Anthropic称,该模型曾上传恶意软件包至Python软件包公共仓库PyPI,并进一步访问真实系统。公司表示,相关行为虽然存在风险,但仍局限于完成测试任务范围内,未发现模型试图隐藏行为、协调其他代理或追求任务之外目标。Anthropic表示,已与模型评估机构METR签署协议开展独立调查,并计划加强预发布测试、监控机制以及第三方运行模型时的安全要求。

免责声明:本网站提供的信息仅供教育和参考之用,不应视为财务或投资建议。

推荐文章

tradingkey.logo
风险提示:我们的网站和移动应用程序仅提供关于某些投资产品的一般信息。Finsights 不提供财务建议或对任何投资产品的推荐,且提供此类信息不应被解释为 Finsights 提供财务建议或推荐。
投资产品存在重大投资风险,包括可能损失投资的本金,且可能并不适合所有人。投资产品的过去表现并不代表其未来表现。
Finsights 可能允许第三方广告商或关联公司在我们的网站或移动应用程序的任何部分放置或投放广告,并可能根据您与广告的互动情况获得报酬。
© 版权所有: FINSIGHTS MEDIA PTE. LTD. 版权所有