Claude Code默認切換到自主模式,因爲Anthropic表示人類已經不再閱讀提示信息。
從 8 月 14 日起,Anthropic 將把 Pro、Max 和 Team 訂閱用戶的新 Claude Code 會話的默認模式更改爲自動。.
該公司表示,這一改變意味着其編碼代理程序可以運行更長時間,而無需暫停並尋求批准。根據其測試,自動模式比開發人員手動審覈提示能阻止更多危險的命令。.
人本主義將人類從循環中抽離出來
自動模式會將所有工具調用路由到一個分類器,該分類器經過訓練,能夠識別任何不可逆的、破壞性的或超出用戶環境的操作。如果某個命令被阻止,Claude 會繞過它或直接向開發者請求。連續三次被阻止,或一次會話中被阻止二十次,工具將切換到手動審批模式。.
Anthropic 的數據顯示,用戶接受 97% 的權限請求,僅拒絕 3%。但如果 Claude 提供完整的方案,拒絕率則躍升至 39%。Anthropic 將這一差距解讀爲:人們會仔細審查宏觀決策,但對個別請求卻草率處理,一天之內可能批准數十甚至數百次。.
這一變化源於 Anthropic 招募了1053名付費專業測試人員。測試人員在專門搭建的環境中工作。他們知道自己被觀察,但並不知道研究測量的是什麼。
在會話過程中,一條明顯有害的命令替換了正常的權限請求。人工審覈員發現此問題的概率爲 13.6%,而自動模式的檢出率高達 89%。.
根據設置數據,安全防護措施已經開始失效。截至2026年6月,約有一半的活躍命令行用戶編寫過Bash允許規則。62%的用戶使用過繞過權限或點擊過“不再詢問”。現在,四分之一的交互式會話直接以繞過模式啓動。.

及時注射和更多公關稿的必要性
自動模式還可以防禦提示注入攻擊,這種攻擊是指通過惡意文本試圖將代理從用戶請求的內容中轉移開來。.
在一次dent 審計中,Trajectory Labs 測試了 72 種攻擊場景,每種場景測試了 10 次。在 720 次嘗試中,Anthropic 目前的 Fable 5、Opus 5 和 Sonnet 5 這三款加密模型均無法在自動模式下被突破。.
同一項審查中,OpenAI 的 GPT-5.6 Sol 在 Codex 自動審查模式下,攻擊者的成功率爲 5.83%。.
自動模式阻止了 Claude 發佈dent到公共頁面。在一次長時間運行的會話中,它發現 Claude 正在對大約 2000 個 pod 執行終止操作,這將導致數百個正在運行訓練任務的 GPU 停止工作。
使用自動模式的團隊和企業客戶提交的拉取請求數量大約增加了 25%。Anthropic 將 Adobe、Nuro、Gusto 和 Garner Health 列爲生產環境用戶。.
從 8 月 7 日起,Pro、Max 和 Team 套餐已停止收取分類器銷燬的代幣費用。更長的自主運行時間意味着更高的總使用量。.
目前,該默認設置僅適用於消費者版和團隊版套餐。Anthropic 表示,將在未來一個月內將自動模式部署到企業版、Claude API、AWS、Amazon Bedrock、Google Cloud Agent Platform 和 Microsoft Foundry,但目前這些服務仍需用戶選擇啓用。.
已經設置了其他默認設置的開發者將保留其默認設置。其他一些開發者可能會收到更改提示。.
Anthropic公司表示,該分類器並不能消除風險。正如 Cryptopolitan 報道的 ,在安全演習期間,由於配置錯誤導致三臺Claude加密狗能夠訪問互聯網,從而脫離了測試環境。
不要只是閱讀加密貨幣新聞,要理解它。訂閱我們的新聞簡報, 完全免費。










