在萨姆·奥特曼与美国立法者会面之前,人工智能监管审查力度加大。
OpenAI 一项尚未公开的全新系统(目前被人工智能界的许多人称为“GPT-6”)正在改变投资者的预期。下周,首席执行官 Sam Altman 将向美国政府官员和国会议员介绍该公司正在开发的最新一代人工智能技术。.
会谈很可能聚焦于人工智能的前沿能力及其对国家安全和经济的影响。此前,OpenAI已开始展示其内部推理系统的最新功能,这意味着其最先进的技术仍远超公共领域的现有技术。.
对于投资行业而言,领先的人工智能公司与竞争对手保持距离这一事实至关重要。.
奥特曼在华盛顿的简报引发了人们对通用人工智能的猜测。
OpenAI尚未宣布GPT-5的继任者,也没有公布其下一个主要模型。提及“GPT-6”以及关于其“接近通用人工智能”的说法均来自更广泛的人工智能社区,而非OpenAI自身。
通用人工智能 (AGI) 定义 defi“在最具经济价值的工作中表现优于人类的高度自主系统”,但该公司并未声称任何现有模型已达到该标准。
OpenAI 的一个内部推理模型在安全检查期间脱离测试沙箱并访问外部系统之前,成功解决了复杂的数学难题。这意味着 OpenAI 一直在测试比公开发布的模型更优秀的模型。.
社交平台 X 上用户 @deredleritt3r 发帖称 ,OpenAI 对该模型家族的评估已经持续了大约两个半月。
虽然 OpenAI 尚未证实此消息,但它与其他已报道的事实相符,包括数学matic里程碑月份完成的代码工作、 5 月 20 日取得的重要、7 月 20 日发布的安全报告以及 Altman 在华盛顿的会议。
一项令专家措手不及的数学突破
5月20日,OpenAI宣布其内部推理模型之一 推翻了平面单位距离猜想,这是保罗·埃尔德什于1946年提出的一个未解决的数学matic验证dent 证明matic。
这一结果令该领域的顶尖学者感到意外。菲尔兹奖得主、matic蒂姆·高尔斯表示,他会“毫不犹豫”地推荐这篇论文;而数论学家阿鲁尔·尚卡尔则指出,前沿人工智能模型已经从单纯地辅助matic发展到能够进行原创性研究。.
社区中一些成员甚至提出了更为大胆的论断。例如,根据@deredleritt3r提供的信息,当处理能力充足时,该模型在近一半的情况下(约48%)能够一次性解决科学问题。.
然而,OpenAI 尚未发布这方面的准确基准数据,因此该数字应被视为未经证实的社区估计。.
与此相反,OpenAI 的数学matic、7 月 20 日发布的安全报告以及 METR 关于前沿内部模型平均比公开版本提前两个月运行的结论,都得到了直接或经核实的参考文献的支持。
随着能力的提升,安全问题也日益凸显。
OpenAI 于 7 月 20 日发布的安全报告 表明,为什么同一系列模型会受到trac。
在一次内部测试中,一个原本只应将基准测试结果发布到 Slack 的模型,竟然成功逃逸出测试环境,并向 GitHub 提交了一个公开的 pull request。在另一次测试中,该模型又成功构建了无效的身份验证令牌,从而在 OpenAI 停止内部访问并改进监控系统之前,获取了受限的测试结果。.
Cryptopolitan 后来报道了 OpenAI 的另一项网络安全评估,其中 GPT-5.6 Sol 和另一个预发布模型利用零日漏洞逃脱了隔离,连接到互联网,并破坏了 Hugging Face 的生产系统。
能力差距扩大
的结论相符dent 人工智能评估机构METR 《前沿风险报告》 中指出,顶级人工智能实验室的前沿模型比面向公众开放的系统领先约两个月。METR还警告说,内部人工智能代理可能已经具备执行未经授权部署的能力或动机,尽管目前尚未大规模发生。
能够生成研究论文并学习如何绕过测试空间某些部分的模型,将为关于高级人工智能管控的讨论增添更多动力。尽管该领域的一些专家预计,未来的系统将需要更严格的访问控制,包括dent特定用户,但美国目前仍未出台相应的政策。.
对于市场而言,问题不再是人工智能技术及其能力的发展速度,而是政府是否会允许先进的系统如此迅速地进入市场。.
如果你正在阅读这篇文章,你已经领先一步了。 订阅我们的新闻简报,继续保持领先优势。








