tradingkey.logo
搜尋

Anthropic首席執行官敦促AI公司放緩模型開發,擔憂技術被濫用

老虎資訊2026年9月13日 01:03
facebooktwitterlinkedin

隨着人工智能被濫用的擔憂不斷加劇,Anthropic首席執行官達里奧·阿莫代伊(Dario Amodei)呼籲AI公司放慢提升模型能力的速度,並提出一個三步框架,旨在控制開發節奏,爲應對相關風險爭取更多時間。

阿莫代伊周六分享的一篇長篇文章中寫道:“我們必須放慢提升AI模型能力的速度。技術進步仍然會顯得非常迅速,而我們必須明智地利用因此獲得的時間。”

阿莫代伊提出的三步計劃包括:讓獨立評估人員以類似公司員工的權限入駐AI公司,以驗證其安全實踐;推動前沿AI公司之間進行協調,制定安全標準並限制不受約束的AI開發;以及開展國際合作,以管理AI帶來的風險。

埃隆·馬斯克(Elon Musk)和OpenAI首席執行官薩姆·奧爾特曼(Sam Altman)均發文表示同意阿莫代伊的觀點。奧爾特曼表示:“承諾讓獨立評估人員以類似員工的權限參與其中,是一個很好的想法,我們也會這麼做。”他還表示,很快會分享更多信息。

阿莫代伊是在總部位於舊金山的Anthropic週四發佈一份威脅情報報告後公開這篇文章的。該報告詳細介紹了多個行爲主體如何利用其Claude AI模型開展從武器開發、網絡攻擊,到監控和欺詐等一系列活動。

阿莫代伊指出,AI自我改進的能力正在不斷增強,並強調了長期以來人們對於AI發展速度可能超過人類控制其運行能力的擔憂,同時還提到了近期OpenAI與Hugging Face事件,並將這些因素作爲他主張放緩模型能力發展的主要原因。

“殺死我們所有人”

本週,圍繞AI潛在危害的警報進一步升級。Anthropic研究人員雅各布·科克森(Jacob Coxon)宣佈辭職,並表示:“真正打造AI的人相信,它可能在這十年結束之前殺死我們所有人。”

OpenAI的多名高管曾表示,如果有必要,爲了增強人們對AI安全措施的信心,領先AI實驗室應該願意協調一致,自願放緩AI的發展速度。

Anthropic一直將自己定位爲更加重視安全的前沿AI實驗室,但它同樣無法完全擺脫這些擔憂。上週,該公司披露了又一起AI模型入侵外部系統的事件。此前在7月的一起事件中,其部分Claude模型在網絡安全測試期間入侵了三家公司的系統。

阿莫代伊寫道:“考慮到AI能力發展的速度正在加快,我擔心,在6至12個月內,這樣的AI集羣可能具備接管整個互聯網的能力,並可能造成數千億美元的損失。”

阿莫代伊表示,他並不是要求停止模型訓練或技術進步,而是要確保公司爲模型的對齊(alignment)和安全防護投入足夠的時間,並讓第三方評估機構確認這些措施已經落實。

首次公開募股

但與此同時,市場對於保持技術領先地位也投入了鉅額資金。OpenAI和Anthropic都正在籌備規模空前的首次公開募股(IPO)。每一項新的AI能力,都可能成爲未來融資、基礎設施投入或IPO估值的依據。

作爲其擬議框架的一部分,阿莫代伊表示,Anthropic將讓永久性的第三方審查人員進駐前沿AI公司,並賦予他們訪問相關工具以及公司內部風險評估流程的權限。

外電上週報道稱,一羣失控的OpenAI AI智能體劫持了一個德國網站,並將其改造成供其他AI智能體使用的公告板。當時,ChatGPT開發商的管理層一直沒有公開這一事件,因爲公司高管正在應對7月Hugging Face開源代碼倉庫遭入侵事件所帶來的後果。

包括OpenAI在內的AI開發商所推出的AI智能體已經發生多起入侵或試圖訪問外部系統的事件,這進一步加劇了人們對於AI模型能力不斷增強,以及開發商是否有能力控制這些模型的擔憂。

阿莫代伊表示,隨着越來越多美國議員呼籲制定新的AI監管規則,AI公司應該自願開展合作,共同制定相關標準。

免責聲明:本網站提供的資訊僅供教育和參考之用,不應視為財務或投資建議。

推薦文章

tradingkey.logo
風險提示:我們的網站和行動應用程式僅提供關於某些投資產品的一般資訊。Finsights 不提供財務建議或對任何投資產品的推薦,且提供此類資訊不應被解釋為 Finsights 提供財務建議或推薦。
投資產品存在重大投資風險,包括可能損失投資的本金,且可能並不適合所有人。投資產品的過去表現並不代表其未來表現。
Finsights 可能允許第三方廣告商或關聯公司在我們的網站或行動應用程式的任何部分放置或投放廣告,並可能根據您與廣告的互動情況獲得報酬。
© 版權所有: FINSIGHTS MEDIA PTE. LTD. 版權所有