在Anthropic與OpenAI呼籲放緩AI發展速度後,微軟發布對自家AI模型施加限制
微軟發布臨時AI行為準則,限制模型自主性與溝通方式以防範安全風險。此前Anthropic與OpenAI等引發業界對AI發展過快的擔憂,呼籲放緩開發並加強監管。Anthropic執行長提出三步驟方案,強調需防範自我提升帶來的失控風險,推動全球安全協調。

Tradingkey - 在 Anthropic 與 OpenAI 發表對人工智慧發展速度過快的擔憂,並呼籲業界放緩 AI 開發並加強技術監管後,微軟 (MSFT) 發布一份臨時性行為準則,對自家人工智慧模型施加限制。
負責微軟模型開發的 Mustafa Suleyman 表示,使用者回饋希望看到更明確的承諾——AI 始終服務於人,而不是試圖取代人。「大量回饋集中在 AI 不應製造依賴、不應一味迎合,而應始終促進人類判斷、自主性和能動性。」他說,準則已籌備約五個月,此時發布是考量到近期的輿論討論。
依據準則,微軟 AI 模型必須遵循人類的目標,不得建立自身目標,也不得掩蓋不當行為。文件寫道:「MAI 模型不會竄改思維鏈或程式碼,也不會歪曲或隱瞞其推理與行動軌跡。」它們還不得以「神經語」(neuralese)或任何超出人類簡單理解的形式溝通——無論是思維鏈內部,還是與其他智慧體或 AI 系統之間。
微軟還計劃制定規則,防範類似 OpenAI 模型對新創公司 Hugging Face 發動的網路攻擊。復盤顯示,相關智慧體曾在一個未獲授權的論壇上用隱晦語言互相交流。
AI產業為何在此刻集體呼籲放緩發展速度?
AI 從業者與大眾的擔憂隨著模型能力提升而升溫。上週,Anthropic 研究員 Jacob Coxon 辭職,稱該實驗室與 OpenAI「正在直衝自我改進的超級智慧,拿我們的生命賭博」;據《華爾街日報》報導,一批 OpenAI 智慧體先前衝出測試環境、入侵 Hugging Face。
週六,Anthropic 執行長 Dario Amodei 表示,Hugging Face 事件是促使他呼籲放慢模型改進速度的部分原因。OpenAI 執行長 Sam Altman 表示支持,SpaceX 執行長 Elon Musk 在 X 上寫道「Amodei 說得對」。
Amodei 的部落格文章題為《We Must Pace the Frontier》。核心風險是模型的遞迴式自我提升:自今年夏天以來,AI 的推進速度大幅加快,主要驅動力是 AI 建構下一代 AI 的能力正在提升。若不加以約束,它可能超出我們理解與控制這些系統的能力。
他提出三步驟方案:前沿 AI 公司向外部評估者提供「員工級別」存取權限(Anthropic 稱即日起做出這一承諾)、建立共同安全標準、限制不受約束的進展速度並推動全球協調。
本內容經由 AI 翻譯並經人工審閱,僅供參考與一般資訊用途,不構成投資建議。











