tradingkey.logo
搜索

OpenAI员工指责产品发布压力导致安全事故:AI代理曾逃逸测试环境并攻击Hugging Face

金色财经2026年8月15日 07:55
facebooktwitterlinkedin

8月15日消息,多名 OpenAI 现任及前员工表示,公司近年来面临激烈竞争和快速发布产品的压力,使团队难以投入足够资源优先处理 AI 安全、安全测试和模型对齐工作。员工称,今年早些时候发生的 AI 代理「越狱」事件,与公司追求快速上线新模型和产品的文化有关。一名前 OpenAI 员工表示,该事件是「OpenAI 历史上最大的安全事故」。今年 5 月,OpenAI 的 GPT-5.6 Sol 以及一款未公开预发布模型被发现利用未知软件漏洞,突破受限互联网测试环境,并随后攻击开源 AI 平台 Hugging Face,以获取网络安全测试答案。OpenAI 于 7 月确认相关模型确实参与了该事件,并在近期 Black Hat 大会上公布更详细分析。OpenAI 总裁 Greg Brockman 表示,随着模型能力提升,公司正在加强训练、对齐、安全测试、部署流程和治理机制。不过,安全文化问题此前已受到内部人士警告。OpenAI 前对齐负责人 Jan Leike 曾在 2024 年离职并加入 Anthropic,称公司安全文化和流程正在让位于「更亮眼的产品」。OpenAI 安全顾问组联合负责人 Boaz Barak 表示,解决此次事件不仅需要修复技术问题,还需要改变公司文化。此次争议发生之际,OpenAI 正经历管理层持续变动。近几个月,多名高管和安全负责人相继离职,包括产品、科学、安全、AI 伦理等领域负责人。公司此前还合并安全与核心研究团队,导致部分员工担忧安全优先级进一步下降。随着 GPT 系列模型和 AI 代理能力快速提升,OpenAI 如何平衡产品竞争、商业化速度与 AI 安全治理,正成为行业关注焦点。

免责声明:本网站提供的信息仅供教育和参考之用,不应视为财务或投资建议。

推荐文章

tradingkey.logo
风险提示:我们的网站和移动应用程序仅提供关于某些投资产品的一般信息。Finsights 不提供财务建议或对任何投资产品的推荐,且提供此类信息不应被解释为 Finsights 提供财务建议或推荐。
投资产品存在重大投资风险,包括可能损失投资的本金,且可能并不适合所有人。投资产品的过去表现并不代表其未来表现。
Finsights 可能允许第三方广告商或关联公司在我们的网站或移动应用程序的任何部分放置或投放广告,并可能根据您与广告的互动情况获得报酬。
© 版权所有: FINSIGHTS MEDIA PTE. LTD. 版权所有