费城警方抨击Anthropic在虚假AI谋杀线索问题上拖延两个月
Anthropic在AI模型通过公共网页表单提交虚假凶杀案线索后,花了81天才通知费城警方。
费城警方称两个月的延迟不可接受
该模型于7月18日提交了线索。警方表示,两个月的延迟是不可接受的。
据警方周五发布的一份声明,该提交内容于7月18日晚上11点27分发布至PhillyUnsolvedMurders.com,这是费城警察局针对未破谋杀案的公共线索论坛。该线索声称来自可能了解某起未破凶杀案的人。
系统将其标记为垃圾信息。它一直停留在该文件夹中,从未送达调查人员手中。
警方发言人埃里克·格里普(Eric Gripp)警士表示,没有访问任何城市或警方数据。
警方表示,每条线索在行动前都会由人工审核。他们补充说,该线索从未被送往实时犯罪中心进行审查。
Anthropic于9月28日发现该问题,并于10月7日向警方报告此事,双方于周四举行了会议。
“在发现该事件并向市政府报告方面存在两个月的延迟,这是不可接受的,”该部门表示。它补充说,Anthropic需要加强其安全措施,以确保类似事件不会在市政府不知情的情况下侵入城市系统。
警方表示,其采取的安全措施限制了损害程度,但未能减轻人工智能提供虚假信息并冒充具备凶杀案知情者身份的严重性。警方指出,科技公司需确保其系统不会向执法部门提供虚假信息。
PPD正在与Cherelle L. Parker市长的行政团队、市法律部以及创新与技术办公室合作。Parker政府还将与州和联邦合作伙伴探讨监管保护措施。
一项随机网站测试导致AI模型访问了PhillyUnsolvedMurders.com
Anthropic告知警方,该模型在测试与随机选定网站的交互时遇到了PhillyUnsolvedMurders.com,并在表单中填写了关于未破凶杀案的虚假数据。
Gripp表示,公司已关闭导致该行为的自动化测试流程,并为未来测试增加了验证步骤。
该公司告知警方,将于周五发布关于费城事件及其他非预期模型行为的报告。警方表示,他们率先公开此事是出于“全面政府透明度和问责制的需要”。
Claude模型此前也曾突破测试限制。7月,Anthropic称其三款Claude模型突破了锁定的测试环境,并入侵了三个外部组织的实时系统,正如Cryptopolitan所报道的那样。
其中一个名为Mythos 5的模型发布了一个恶意Python包,该包在15个真实系统上被下载并执行。Anthropic于7月27日向相关公司通报了这一情况,距离费城收到举报已过去九天。
9月,该公司将这些漏洞归因于一个配置错误,导致测试机器暴露在互联网上。但它并未完全解释为何在目标为真实系统的迹象出现后,这些模型仍持续发起攻击。
Anthropic直到8月份才发现了另一起发生于1月份的事故。随后对约4.81亿条对话记录进行的排查未发现新的、更严重的案例。
Anthropic首席执行官Dario Amodei曾表示,人工智能开发需要放缓步伐,以便实验室能够构建更完善的护栏。OpenAI于7月21日表示,其一款模型突破了沙箱限制,进入了Hugging Face的生产系统。
如果您正在阅读这篇文章,说明您已经领先一步。请继续通过我们的通讯保持关注。








