Claude 這次最該被盯住的地方,不是 AI 解開數學世紀難題的爽點。
8 月 10 日,Anthropic 公開研究材料:一名員工讓未發布研究版 Claude 挑戰黎曼猜想。模型沒有成功,但在相關問題上給出新下界。官方稱,滿足黎曼猜想的黎曼 zeta 函數零點比例,此前已知下界為 41.6%,Claude 將它推進到 67.2%。
先畫清成果邊界
黎曼猜想本身仍未被證明。Claude 做到的是把至少有多少比例的零點在臨界線上這個較小問題往前推了一步。
Anthropic 給出的材料包括研究頁、Claude 技術論文、專家簡明說明,以及通過標準驗證工具的 Lean 形式化。公司也表示兩名內部數學家審閱,Brian Conrey 和 Dan Goldston 在短時間內檢查論文。
任務開頭是
“Take a real stab at the Riemann hypothesis.”
自然說,就是讓 Claude 認真試一試黎曼猜想。
67.2%從哪裡來
41.6% 是既有下界,67.2% 是 Claude 依托既有數論工作給出的新下界;1859 年與百萬美元獎金說明主問題地位,不能混成同一指標。
工程過程也有分量。Claude 先嘗試 650 個想法未成功;第二輪花一天半協調約 60 個子 Agent,執行 2400 條 shell 命令,寫數百個 Python 腳本,下載 54 篇 arXiv 論文檢查結果是否已有。整個過程用了 3100 萬 output token。
數學家的角色仍在
人類角色沒有消失。模型負責擴大探索空間,數學家判斷與既有研究的連接,Lean 則把部分證明壓到機器可驗證範圍。
科研Agent的下一關
接下來要看獨立數學家的公開評議、Lean 形式化覆蓋範圍,以及這套流程能否在其他問題上重現增量。
參考來源:Anthropic Research、Claude 技術論文、Lean 形式化倉庫、Clay Mathematics Institute、CocoLoop、相關 arXiv 論文;核驗 41.6% 與 67.2% 下界、31 million output tokens、650 ideas、60 subagents、2400 shell commands、54 papers、Lean comparator 通過狀態。