OpenAI提議制定全球AI標準
OpenAI週一發佈一系列關於前沿人工智能開發安全與保障的建議,重點關注AI對齊研究以及“遞歸自我改進”(Recursive Self-Improvement,RSI)。
OpenAI在博客中表示,隨着AI能力不斷提升,對齊研究也需要跟上發展速度,以確保公司及其他開發者打造的AI系統仍與人類價值觀保持一致,並處於人類控制之下。
OpenAI呼籲開展國際合作,制定前沿AI標準,並建議在全球現有AI安全研究機構工作的基礎上進一步推進。
該公司表示,這些技術標準應重點覆蓋前沿AI模型及其開發者,同時關注自動化AI研究人員的收益與風險管理,其中包括遞歸自我改進。
RSI受到AI開發者關注,因爲這項技術有可能讓基礎模型在無需人工參與的情況下自行升級。
但隨着相關研究推進,一些技術人士也開始擔心,如果AI系統變得更加複雜,並進一步進入互聯網各個領域,基礎模型開發商可能會失去對底層技術的控制,或者無法充分考慮AI自主改進帶來的意外後果。
OpenAI表示,目前“完全自主的遞歸自我改進”尚未實現,在能夠確保安全之前,也不應推動這一技術。如果缺乏足夠謹慎的措施,RSI可能導致人類逐漸失去對AI發展的實際控制,甚至無法監督自己已經無法理解的研究過程。
OpenAI還提到了此前發生的Hugging Face智能體遭黑客攻擊事件。該事件並未使用RSI技術,但OpenAI認爲,這可以作爲一種預演,說明如果缺乏完善的安全措施和對齊機制,未來類似風險可能進一步擴大。
Anthropic提出AI安全方案
就在上週,OpenAI的競爭對手Anthropic也提出了有關安全開發前沿AI模型的建議,回應近期業內人士對於AI可能對人類造成威脅的警告。
Anthropic CEO Dario Amodei此前發表文章,呼籲AI公司放慢基礎模型的開發速度,並提出讓第三方評估機構進入AI公司,對相關技術進行審查,以識別和降低潛在風險,例如利用AI加速網絡攻擊或製造生物武器。
OpenAI CEO Sam Altman以及特斯拉和SpaceX CEO埃隆·馬斯克等業內人士也公開支持這一提議。
不過,目前AI評估仍處於早期階段,行業尚未就統一的標準和原則形成共識,因此獨立第三方對前沿AI技術進行深入審查的能力仍然有限。
近期,一批AI評估機構也呼籲基礎模型開發商考慮設立一套“最低條件”,包括提供更深入的技術訪問權限,以及避免評估機構因發佈不利於AI公司的報告而遭到報復,以便更全面地開展安全審查。







