當Claude開始挑戰黎曼猜想,人類的智力高地會失守嗎
2026年8月10日,Anthropic發佈了一份讓數學界和AI界同時震動的報告。他們讓一個尚未公開發布的研究版Claude——對,就是那個聊天機器人Claude——去認真嘗試證明黎曼猜想。這個誕生於1859年的數學猜想,已經困擾了人類頂級數學家167年,克雷數學研究所爲它懸賞100萬美元。
故事的起點甚至有點草臺班子味道。Anthropic員工Jarred Sumner,Bun的締造者,16歲從高中輟學,幾何課只上了半年。在8天前的一次晨跑途中,他隨口給Claude佈置了一個任務:證明黎曼猜想。Sumner本人並非數學家,他幾乎沒有提供任何技術指導,大部分時候只做一件事——給Claude瘋狂輸出情緒價值:“你可以的,相信你自己!”
3100萬Token、650次失敗,然後意外捅破了天花板
Claude的第一次嘗試並不順利。它一口氣生成並測試了大約650個思路,全部失敗。隨後它換了一種打法:自己拉起約60個子智能體,連續工作一天半,執行2400次Shell命令,寫下數百個Python腳本,做了數千次數值檢驗。整個過程中,真正貢獻核心數學想法的只有兩個子Agent,全程燒掉了3100萬輸出Token——這個量級放在數學家個人身上,相當於連續不斷地寫上好幾個月的思考量。
黎曼猜想最終沒有被攻克。但在這場“失敗”的嘗試中,Claude碰到了一個意想不到的結果:它將黎曼ζ函數中已知至少位於臨界線上的零點比例下界,從41.6%提高到了67.2%。
要理解這個數字意味着什麼,得先簡單說一下黎曼猜想在問什麼。1859年,德國數學家黎曼發現ζ函數的一系列特殊零點與素數的分佈存在深刻聯繫。他猜想所有重要的非平凡零點都應該落在複平面上一條特定的豎線上,也就是“臨界線”。一百多年來,沒人能證明所有零點都在那裏,也沒人找到反例。於是數學家換了一種思路:既然暫時證明不了100%,那就先研究至少有多少比例的零點可以被嚴格證明位於臨界線上。過去幾十年,好幾代數學家不斷推進,最終把這個比例下界提高到了約41.6%。
而Claude把41.6%推到了67.2%。風投機構Menlo Ventures的合夥人、研究者Deedy評價說:“Claude這次的結果簡直離譜,可能是自2013年有界素數間隔突破以來,解析數論領域最重大的進展。它一口氣提高了25.6個百分點。而在此前37年裏,數學家們總共只把這個數字提高了0.8個百分點。”
進度條不是這麼算的,但67.2%依然足夠嚇人
當然,千萬別把67.2%理解成“黎曼猜想已經完成了67.2%”。黎曼猜想要求的是所有非平凡零點——也就是100%——都位於臨界線上。數學研究不是遊戲進度條,從67.2%到100%絕不意味着只剩“最後32.8%”。Anthropic自己也強調,Claude所用的這套方法預計無法直接導向黎曼猜想的最終證明。
但即便如此,這個突破依然讓數學家“看懵了”。Anthropic的兩名數學家隨後研究並驗證了Claude的論文,Claude還給出了對應的Lean形式化證明。數論學家Brian Conrey和Dan Goldston也在短時間內審閱了論文。一篇可驗證、可復現、經專家審閱的數學論文——由一個AI模型獨立完成,這件事本身的分量,已經遠遠超出了67.2%這個數字。
Claude的這次突破並非孤立事件。整個2026年,AI在數學領域的進展幾乎可以用“狂飆”來形容。2026年5月,OpenAI的一個內部通用推理模型獨立完成了一份原創數學證明,推翻了匈牙利數學家保羅·埃爾德什1946年提出的“平面單位距離猜想”(Planar Unit Distance Conjecture)——一個懸置了近80年的難題。同月,谷歌DeepMind發佈AlphaProof Nexus,在一次運行中解決了9道開放的埃爾德什數學問題,其中包含2道懸置56年的難題。再往前,2025年夏天,谷歌的Gemini Deep Think已經在國際數學奧林匹克競賽中獲得了官方認證的金牌。菲爾茲獎得主陶哲軒在2026年7月的國際數學家大會上警告,數學界正面臨“證明消化不良”的風險——AI生成證明的速度,正在超過人類消化它們的能力。
人類的智力高地,正在被重新測繪
回到最初的問題:當Claude開始挑戰黎曼猜想,人類的智力高地會失守嗎?
答案或許比“會”或“不會”都要複雜。一方面,AI確實正在以前所未有的速度攻入數學這個人類智力的最後堡壘——就在幾個月前,OpenAI的模型剛剛推翻了困擾數學界80年的平面單位距離猜想,被外界視爲AI首次自主攻克領域核心開放難題。但謹慎的聲音同樣存在:早在2025年,諾貝爾物理學獎得主戴維·格羅斯就曾表示,解決黎曼猜想這樣的問題,核心驅動力仍是人類的聰明才智和創造力,AI只是強大的輔助工具。
但Claude的故事給出了另一種啓示。Sumner不是數學家,他沒有規劃研究路線,沒有指定數論工具,大部分時候只是在“給AI加油”。而Claude自己在650次失敗之後,重新組織了60個子Agent,自主閱讀論文、編寫代碼、檢驗數值、相互驗證,最終找到了一個人類數學家37年只推進了0.8%的突破口。
綜上,這不是一場零和博弈。Claude沒有“擊敗”數學家——它的論文需要數學家來驗證,它的證明需要專家來審閱。但Claude確實做到了人類個體在短時間內難以企及的事情:閱讀海量文獻、並行探索數百條思路、在形式化證明系統中完成嚴謹驗證。
陶哲軒在2026年7月的演講中提出了一個“AI能力猜想”,他描繪的圖景被外界概括爲:數學研究正在進入“工業時代”。這或許纔是真正的答案——人類的智力高地不會“失守”,但它正在被重新測繪。數學家將從“證明者”逐漸轉變爲“提問者”和“驗證者”,而AI則成爲那個不知疲倦地探索、試錯、最終捅破天花板的執行者。
167年來,黎曼猜想依然未被證明。但2026年8月11日這一天,一個非人類智能第一次在這個終極問題上,留下了自己的印記。數學的下一章,或許將由人類和AI共同書寫。








