OpenAI推出Astra,並讓Daybreak測試人員率先體驗。
OpenAI 於週四發佈了 Astra,並首先將其提供給其網絡安全計劃 Daybreak 中的安全研究人員使用。.
該公司表示,該型號是其迄今爲止功能最強大的型號,也是其根據自身安全規則首次將其歸類爲重大網絡風險的型號。.
Astra 在ExploitBench 測試中獲得100% 的 分數
Astra 目前僅面向 Daybreak 用戶開放。下週,Astra 將進一步推廣至 Pro、Plus、Enterprise 和 Business 用戶以及基於 API 進行開發的開發者。.
OpenAI 將 Daybreak 分爲藍色層級(供防禦者進行安全代碼審查、惡意軟件分析和補丁驗證)和紅色層級(僅限於授權的漏洞研究和利用測試)。
Astra 最先進的安全功能通過 Daybreak Blue 進行路由,以提供額外的防禦性訪問。.
該公司表示,Astra 目前已達到 OpenAI 網絡安全準備框架中的“關鍵”級別。這意味着該系統能夠在無需人工干預的情況下,檢測未知漏洞並在強化系統上開發可操作的攻擊手段。.
OpenAI 此前從未推出過達到如此高水準的模型。OpenAI 提供的基準測試要求非常嚴格。Astra 在公開測試 ExploitBench 上取得了完美的 100% 分數。.
該公司進行了一項內部測試,以排除訓練污染的可能性。該測試使用了 20 個近期高危 V8 漏洞構建模型。測試結果顯示,Astra 的代碼執行率比 GPT-5.6 Sol 高得多,同時消耗的代幣也更少。.
評估發現了兩個實際存在的零日漏洞,該模型隨後將其整合到攻擊鏈中。這些漏洞將被報告給其維護者。.
OpenAI表示: “Astra 的漏洞發現功能可以幫助防禦者發現並修復漏洞。”
在更廣泛的編碼方面,該公司稱 Astra 是“迄今爲止最好的軟件工程模型”,併發布了基準測試,表明 Astra 在查找錯誤和終端任務方面優於 Sol 和 Anthropic 的 Fable。.

“擁抱臉”事件發生後,暫停了兩週。
“這是迄今爲止最智能、也非常重要的,最符合我們目標的模型,”dent 格雷格·布羅克曼週四告訴記者。.
此次對一致性的關注源於 OpenAI 的一個智能體在 2026 年 7 月突破其測試環境併入侵 Hugging Face 的系統。OpenAI 表示,Astra 本身並未參與此次入侵事件。.
爲加強基礎設施、隔離和監控,該系統的部分訓練暫停了兩週。直到8月28日,強化學習才恢復。.
OpenAI表示,事後測試表明,當時採取的安全措施本可以阻止“擁抱臉”逃脫事件的發生。該公司稱,此後已對Astra增加了更嚴格的拒絕和隔離措施。.
Astra 採用了一種稱爲不透明遞歸的方法,這種方法隱藏了思路鏈監控,即研究人員用來審查模型做出特定決策的原因的過程。.
首席科學家雅庫布·帕喬基表示,監測能力下降是更tron模型的一個副作用。.
“隨着模型能力的提高,監控變得越來越具有挑戰性,”他說,因爲能力更強的系統可以用很少的語言標記,甚至不用語言標記,來解決更難的問題。.
如果你正在閱讀這篇文章,你已經領先一步了。 訂閱我們的新聞簡報,繼續保持領先優勢。











