OpenAI警告稱,未來的AI模型可能會助長網絡攻擊。
ChatGPT 背後的公司週三發出嚴厲警告,稱其下一代人工智能系統可能存在潛在危險,並可能構成嚴重的網絡安全威脅。
OpenAI 表示,其未來的 AI 模型可能能夠創建針對嚴密保護的計算機系統的功能性零日漏洞利用程序。這項技術還可能有助於對企業或工業設施發起旨在造成實際損害的複雜攻擊。
事情發展迅速。OpenAI 在其博客提到,在奪旗安全挑戰賽中,GPT-5 的性能從 2025 年 8 月的 27% 躍升至三個月後的 2025 年 11 月 GPT-5.1-Codex-Max 的 76%。
OpenAI 現在認爲,它構建的每個新模型都能達到其所謂的“高”網絡安全能力水平。這意味着這些系統能夠針對防護嚴密的網絡中此前未知的漏洞創建有效的攻擊手段,或者協助開展針對關鍵基礎設施的複雜入侵活動。
這家微軟支持的公司表示,它正在投資提升其模型在防禦性安全方面的性能。該公司正在開發工具,幫助安全團隊檢查代碼問題並修復安全漏洞。OpenAI 希望爲防禦者提供優勢,因爲他們通常人數較少且資源匱乏。
棘手之處就在這裏。防禦性和攻擊性網絡安全工作使用的基本知識和方法相同。對防禦者有幫助的措施,同樣也可能對攻擊者有所幫助。OpenAI 表示,它不能依賴單一的保護措施,需要多層安全控制協同運作。
該公司採用訪問限制、更tron的基礎設施安全措施、信息流控制和持續監控等手段。此外,該公司還訓練模型來拒絕可能引發網絡攻擊的請求,同時確保這些模型能夠用於合法的安全工作和教育。
檢測系統利用先進模型監控產品中的可疑活動。一旦發現危險情況,系統會屏蔽結果、切換到較低級別的模型,或將其標記爲需要人工審覈。
挑戰極限
OpenAI 與專業的安全測試團隊合作,嘗試突破其所有防禦措施。他們模擬擁有雄厚資源且目標明確的攻擊者可能採取的行動。這有助於在真正的威脅到來之前發現漏洞。
人工智能帶來的網絡安全風險令整個行業人士擔憂。正如Cryptopolitan此前報道,黑客已經開始利用人工智能技術來改進他們的攻擊手段。
該公司計劃推出一項計劃,爲從事網絡安全防禦的合格用戶提供特殊權限,使其能夠使用最新型號的增強功能。OpenAI 仍在研究哪些功能可以廣泛開放,哪些功能需要更嚴格的限制。
此外還有 Aardvark。這款目前處於內部測試階段的安全工具可以幫助開發者和安全團隊大規模地發現並修復漏洞。它會掃描代碼中的弱點並提出修復建議。該系統已經發現了開源軟件中的新漏洞。OpenAI計劃投入大量資源來加強更廣泛的安全生態系統,其中包括爲一些非商業性的開源項目提供免費的安全保障。
OpenAI 將成立前沿風險委員會。該委員會彙集了經驗豐富的網絡安全防禦者和從業人員。委員會最初專注於網絡安全領域,但未來將擴展到其他領域。委員會成員將協助界定實用功能與潛在濫用之間的界限。
安全仍然是一個挑戰
該公司通過前沿模型論壇與其他領先的人工智能公司合作。這個非營利組織致力於增進對威脅和最佳實踐的共識。OpenAI認爲,先進人工智能帶來的安全風險可能來自業內任何主流人工智能系統。
近期研究表明,人工智能代理能夠發現區塊鏈智能trac中價值數百萬美元的零日漏洞。這凸顯了這些先進能力的雙重性。
OpenAI一直致力於加強自身的安全措施,但該公司也面臨着自身的問題。過去,該公司曾多次遭遇安全漏洞。這表明保護人工智能系統和基礎設施是多麼困難。
該公司表示,這項工作仍在進行中。其目標是爲防禦者提供優勢,並加強整個技術生態系統中關鍵基礎設施的安全。
註冊 Bybit並開始交易,即可獲得 30,050 美元的歡迎禮物







