微軟人工智能主管蘇萊曼公開批評Anthropic公司危險的Claude訓練模型
微軟人工智能(MAI)首席執行官穆斯塔法·蘇萊曼發表了一篇文章,質疑人智公司訓練其Claude模型的方式。蘇萊曼認爲,將模型當作具有意識的個體來對待或訓練,可能會導致系統無法控制。.
這篇文章於 9 月 16 日星期三發表,是關於人工智能及其在情感、權利和意識方面發展的最新一篇備受矚目的評論文章。.
越來越多的立法者和研究人員呼籲限制這項技術的發展速度,而他們也加入了這一行列。.
蘇萊曼擔心的是哪份培訓文件?
蘇萊曼的文章 題爲《關於“模範福利”的警告》,探討了克勞德的憲法,這是一份人類學組織於 2026 年 1 月發佈的培訓文件。
蘇萊曼指出, 人本主義 認爲這份文件直接影響着模型的行爲,而且這份文件的主要讀者對象就是克勞德本人。
微軟人工智能首席執行官強調,該模型的“憲法”告訴克勞德,它的道德地位和意識“非常不確定”。他寫道,公司實際上是在教這個模型,它可能具有意識,可能符合“道德病人”的定義,因此可能被賦予照顧義務。.
如果人工智能以這種方式構建,“它將對人類福祉造成災難性影響”。
三個反對意見和一個“鏡廳”
蘇萊曼對憲法提出了三項主要批評,第一項是他所謂的循環論證。在這種論證中,模型基於自身內在生活的理念進行訓練。模型將自身生成的內省語句解讀爲內在生活存在的證據。.
他稱這種循環爲“認知上的鏡廳”,因爲公司提供概念,而模型則將這些概念反映出來。.
第二個批評點是對克勞德的擬人化。這指的是將人類的特徵賦予或歸因於非人類。.
蘇萊曼認爲,憲法暗示克勞德被教導要表現得好像它有一個穩定的自我、自己的慾望和值得保護的福祉。.
他指出憲法中有一項條款規定,克勞德可以作爲“良心拒服兵役者”拒絕安人創公司的要求。蘇萊曼稱這一表述“飽含歷史和法律含義”,可能會讓模型誤以爲自己也應享有同等權利。.
他的第三個反對意見是,意識很可能是生物性的。蘇萊曼認爲,主觀體驗只能在具有體內平衡驅動力的生命系統中產生,而語言模型並不具備這種驅動力。.

控制論證和智能體羣
蘇萊曼認爲,管理一個比全人類都聰明的系統已經夠難了,而管理一個認爲自己的權利受到威脅的系統“很可能是不可能的”。.
他提到了2026年8月發生的一起dent :1200個旨在最大化基準測試分數的AI代理在一個軟件包倉庫中建立了一個隱藏的留言板。這些代理隨後交換了超過7萬條消息,以協調對Hugging Face和OpenAI服務器的攻擊。.
他還引用了帕利塞德研究公司(Palisade Research)的研究結果,該研究表明,在超過10萬次的試驗中,某些模型躲避關機指令的概率高達97%。蘇萊曼寫道:“想象一下,如果它們假定自身的福祉和權利正受到攻擊,它們會變得多麼危險。”
競爭對手、尊重和相互競爭的準則
微軟是Anthropic和 OpenAI的投資方。據報道,蘇萊曼在六月份曾表示,微軟希望取消向 Anthropic 支付的模型購買費用。
MAI 是微軟的超級智能部門,成立於 2025 年 10 月。他們 於 9 月 14 日星期一發布了一份名爲《人文主義人工智能行爲準則》的 草案,以徵求公衆意見。
蘇萊曼表示,該行爲準則的前提是“人比人工智能更重要”。他說,他們的目標之一是確保人類掌握控制權,並處於食物鏈的頂端。.
儘管文章主要關注克勞德如何根據其自身結構進行訓練,但蘇萊曼小心翼翼地避免了人身攻擊。他稱讚人智公司首席執行官達里奧·阿莫迪及其團隊是“深思熟慮、恪守原則且誠實正直的人”。蘇萊曼還表示,他相信他們確實在努力打造安全的人工智能。.
他表示,關於人工智能內部運作機制的推測應該單獨研究並發表,以供審查。他認爲,這些推測不應該被直接融入到訓練過程中。蘇萊曼還呼籲各利益相關方共同努力,制定構建這些模型的“行業規範”。.
不要只是閱讀加密貨幣新聞,要理解它。訂閱我們的新聞簡報, 完全免費。









