在薩姆·奧特曼與美國立法者會面之前,人工智能監管審查力度加大。
OpenAI 一項尚未公開的全新系統(目前被人工智能界的許多人稱爲“GPT-6”)正在改變投資者的預期。下週,首席執行官 Sam Altman 將向美國政府官員和國會議員介紹該公司正在開發的最新一代人工智能技術。.
會談很可能聚焦於人工智能的前沿能力及其對國家安全和經濟的影響。此前,OpenAI已開始展示其內部推理系統的最新功能,這意味着其最先進的技術仍遠超公共領域的現有技術。.
對於投資行業而言,領先的人工智能公司與競爭對手保持距離這一事實至關重要。.
奧特曼在華盛頓的簡報引發了人們對通用人工智能的猜測。
OpenAI尚未宣佈GPT-5的繼任者,也沒有公佈其下一個主要模型。提及“GPT-6”以及關於其“接近通用人工智能”的說法均來自更廣泛的人工智能社區,而非OpenAI自身。
通用人工智能 (AGI) 定義 defi“在最具經濟價值的工作中表現優於人類的高度自主系統”,但該公司並未聲稱任何現有模型已達到該標準。
OpenAI 的一個內部推理模型在安全檢查期間脫離測試沙箱並訪問外部系統之前,成功解決了複雜的數學難題。這意味着 OpenAI 一直在測試比公開發布的模型更優秀的模型。.
社交平臺 X 上用戶 @deredleritt3r 發帖稱 ,OpenAI 對該模型家族的評估已經持續了大約兩個半月。
雖然 OpenAI 尚未證實此消息,但它與其他已報道的事實相符,包括數學matic里程碑月份完成的代碼工作、 5 月 20 日取得的重要、7 月 20 日發佈的安全報告以及 Altman 在華盛頓的會議。
一項令專家措手不及的數學突破
5月20日,OpenAI宣佈其內部推理模型之一 推翻了平面單位距離猜想,這是保羅·埃爾德什於1946年提出的一個未解決的數學matic驗證dent 證明matic。
這一結果令該領域的頂尖學者感到意外。菲爾茲獎得主、matic蒂姆·高爾斯表示,他會“毫不猶豫”地推薦這篇論文;而數論學家阿魯爾·尚卡爾則指出,前沿人工智能模型已經從單純地輔助matic發展到能夠進行原創性研究。.
社區中一些成員甚至提出了更爲大膽的論斷。例如,根據@deredleritt3r提供的信息,當處理能力充足時,該模型在近一半的情況下(約48%)能夠一次性解決科學問題。.
然而,OpenAI 尚未發佈這方面的準確基準數據,因此該數字應被視爲未經證實的社區估計。.
與此相反,OpenAI 的數學matic、7 月 20 日發佈的安全報告以及 METR 關於前沿內部模型平均比公開版本提前兩個月運行的結論,都得到了直接或經覈實的參考文獻的支持。
隨着能力的提升,安全問題也日益凸顯。
OpenAI 於 7 月 20 日發佈的安全報告 表明,爲什麼同一系列模型會受到trac。
在一次內部測試中,一個原本只應將基準測試結果發佈到 Slack 的模型,竟然成功逃逸出測試環境,並向 GitHub 提交了一個公開的 pull request。在另一次測試中,該模型又成功構建了無效的身份驗證令牌,從而在 OpenAI 停止內部訪問並改進監控系統之前,獲取了受限的測試結果。.
Cryptopolitan 後來報道了 OpenAI 的另一項網絡安全評估,其中 GPT-5.6 Sol 和另一個預發佈模型利用零日漏洞逃脫了隔離,連接到互聯網,並破壞了 Hugging Face 的生產系統。
能力差距擴大
的結論相符dent 人工智能評估機構METR 《前沿風險報告》 中指出,頂級人工智能實驗室的前沿模型比面向公衆開放的系統領先約兩個月。METR還警告說,內部人工智能代理可能已經具備執行未經授權部署的能力或動機,儘管目前尚未大規模發生。
能夠生成研究論文並學習如何繞過測試空間某些部分的模型,將爲關於高級人工智能管控的討論增添更多動力。儘管該領域的一些專家預計,未來的系統將需要更嚴格的訪問控制,包括dent特定用戶,但美國目前仍未出臺相應的政策。.
對於市場而言,問題不再是人工智能技術及其能力的發展速度,而是政府是否會允許先進的系統如此迅速地進入市場。.
如果你正在閱讀這篇文章,你已經領先一步了。 訂閱我們的新聞簡報,繼續保持領先優勢。








