2026年菲爾茲獎得主王虹憑藉三維掛谷集猜想的證明獲得數學界最高榮譽。而據OpenAI的說法,其一個未公開的內部模型在約三個月後解決了難度更高的三維掛谷極大函式猜想,並首次證出四維掛谷集的豪斯多夫維數等於4,把人類此前在四維問題上卡住的最佳紀錄3.059維直接推到了理論上限。

OpenAI這次一口氣放出722篇數學手稿,歸併為372個成果族,覆蓋範圍遠不止掛谷問題,還包括準黎曼假設、希爾伯特第十問題、卡塔蘭常數相關問題等數十個經典難題。所有內容出自一個連名稱都沒有公開的內部模型,平均每個問題消耗約3小時的ChatGPT Pro思考算力。手稿釋出到GitHub後,上線不到24小時就收穫1萬顆星星。

要理解這件事的分量,需要先回到掛谷問題本身。1917年日本數學家掛谷宗一提出:一根細針在平面上原地轉一圈,掃過的區域最小能有多小?數學家貝西科維奇後來證明,只要轉法足夠巧妙,掃過面積可以任意小,由此構造出面積為零卻包含所有方向線段的“掛谷集”。面積既然可以為零,問題就轉向了“維數”——這個集合到底更像一條線、一個面,還是接近實心體。數學家猜測,在n維空間裡,包含所有方向單位線段的集合,其豪斯多夫維數必須等於n。二維情形早在1971年就被證明,三維由王虹攻克,四維則一直懸而未決。

OpenAI這次聲稱解決的兩個問題,可以理解為王虹成果的“加強版”:三維掛谷極大函式猜想,以及把結論從三維搬到四維的豪斯多夫維數猜想。維數越高,那些“管子”互相穿插、堆疊的方式就越多,幾何情形越複雜,因此從三維到四維同樣是質變。按OpenAI的說法,整個流程相當樸素——一個提示詞,讓一個Agent去跑,平均每個結果只消耗約3小時算力。評估過程中模型被投入約4000個問題,經過歸併篩選才留下這722篇。

不過,074號成果族明確表示,其論證建立在王虹研究成果的基礎之上,並非憑空得出。這也符合數學研究的常態。早在2025年3月,MIT數學家拉瑞·古斯就曾預言,從二維到三維是最難的一步,王虹的證明很可能被改造後用於更高維問題。如果OpenAI的四維結論成立,某種程度上也是在驗證這一判斷。

但關鍵詞是“如果”。074號手稿目前沒有Lean形式化證明,也沒有經過同行評審。在被驗證之前,它只是一份聲稱解決了更難問題的論文,而不是已經被證明的更難問題。數學史上不乏被宣佈又被撤回的證明。而王虹的菲爾茲獎,是經過數月檢驗和整個學界審讀後,已成為該領域的基石。

真正的難題其實是驗證。2025年2月,王虹把三維掛谷集猜想的證明掛到arXiv上,約127頁。論文先後經歷作者自查、陶哲軒等知名學者的長篇分析,驗證工作從2025年2月持續到2026年7月菲爾茲獎揭曉,前後近一年半,至今很多數學家仍未完全消化其中的新想法。而現在,一次性來了722篇,其中很多是上百頁的長篇論證。全世界能讀懂其中某一篇的專家可能只有幾十人甚至更少,他們各有自己的研究,不可能放下手頭工作來當審稿人。OpenAI的發言人也承認,這些結果裡有不少連OpenAI自己的數學家都還沒有完全理解,其中就包括074號手稿。

數學界的質疑並非始於今日。2026年9月8日,OpenAI宣佈內部模型解決了納維-斯托克斯方程這一千禧年難題,據稱動用約一萬個Agent平行計算,但布朗大學數學家戈麥斯-塞拉諾在哈佛講座中提到,相關的166頁證明“難以理解”。9月11日,25位菲爾茲獎得主(包括陶哲軒等人)聯名發表公開宣告《人工智慧在數學中的嚴重錯位》,批評AI公司把“攻克名題”當作展示模型能力的營銷手段。9月21日,OpenAI宣佈成立由數學家組成的獨立顧問組AGMAI,設在普林斯頓高等研究院;9月29日該顧問組表示,釋出AI生成的數學結果時應同時公開所用模型、具體提示詞和計算時間。但這次722篇手稿只公佈了“平均計算時間”之類的整體數字,沒有公佈提示詞,也沒有公開模型。MIT數學家安德魯·薩瑟蘭表示,除非公佈模型、讓大家能夠復現,否則對“單個Agent一次提示就解決問題”的說法應視為未經證實。10月7日,人文數學協會認為,一次放出七百多份檔案展示的不是學術,而是一種權力,並呼籲數學家停止與OpenAI合作。

也有另一種聲音。多倫多大學的丹尼爾·利特認為,如果人們想知道這些數學問題的答案,沒有理由要求公司把它們藏起來,這對數學是件好事。

由於數學家無法在短時間內驗證這722份手稿,Lean形式化被寄予厚望。Lean是一種證明助手兼程式語言,數學家把證明每一步翻譯成Lean能看懂的嚴格語言,系統逐步檢查,任何一步含糊或跳步都會判不通過。據公開目錄,372個成果族中有235個帶有Lean形式化說明,約佔63%。但數學家吉爾·科萊指出,Lean驗證也可能出問題:翻譯本身若有偏差,機器驗證通過的可能就不是原來那個問題;而且Lean只能確認邏輯上通不通,無法判斷結果有沒有新意和價值。因此,沒有Lean形式化的074號手稿,只能靠數學家人工核查。

如果074號手稿最終被證明是對的,它必然是數學史上一個標誌性事件——掛谷問題推進到三維花了一百多年,而AI只用三個小時就往前走了好幾步。同樣,它也有可能被證明是錯的。歸根結底,一個人類無法在短時間內驗證的“證明”,到底應不應該被稱為證明,這才是這件事真正留給數學界的難題。