OpenAI在10月7日通過程式碼託管平台GitHub一次性發布了722篇數學手稿,全部出自同一個從未公開的內部模型,覆蓋數論、幾何、機率、理論計算機等17個數學分支。OpenAI稱,該模型嘗試了約4000個懸而未決的數學問題,最終在372組問題上給出了結果,平均每個結果耗費的算力約相當於ChatGPT付費高階版思考3個小時。
這批手稿的釋出方式在數學界引發了罕見的分裂反應。一方面,其中一些聲稱的成果分量極重。例如在平面點集染色問題上,模型聲稱將答案範圍從原先已知的5到7種顏色進一步壓縮到6或7;更引人注目的是與黎曼猜想相關的一項聲稱——手稿稱在實部大於7/8的區域不存在零點。美國羅格斯大學的數學家亞歷克斯·孔託羅維奇評價,如果這一結果由人類做出,「立刻拿菲爾茲獎,沒有任何疑問」。
但另一方面,手稿的整體質量令許多數學家感到沮喪。722篇手稿沒有一篇經過同行評審,也沒有人類作者署名。釋出次日,OpenAI就撤回了3篇論文,原因是第一篇中一個符號錯誤——該寫負號的地方寫成了正號,導致關鍵抵消不成立,另外兩篇因建立在同一構造上而一併撤回。同日還有14篇做了修補。
更多的問題出在可讀性上。美國布朗大學的布倫丹·哈塞特翻看自己熟悉領域的手稿後表示不知所云,並稱如果是人寫的,他不會再多花時間,但後面還有721篇。普林斯頓大學研究黑洞數學的米哈利斯·達費莫斯則指出,這些手稿寫得太含糊,夠不上證明的標準,連錯都談不上。
數學界有一個其他學科沒有的便利:證明可以翻譯成Lean這類互動式定理證明器能讀懂的語言,由計算機逐行檢查邏輯嚴密性。截至10月10日,約42%的結果通過了這種機器檢查。但機器檢查也有盲區——程式只能保證它拿到的那句話被證明了,這句話和論文裡的原題是否一致,仍需人工核對程式碼。負責Lean數學庫的約翰·科梅林就懷疑,有些形式化版本證明的其實是更弱的命題。
這一事件觸動了數學界更深層的焦慮。菲爾茲獎得主陶哲軒公開反對並抵制這種「論文轟炸」。他此前描述過數學界的慣例:一個長期難題被攻克後,證明者會到處做報告,同行組織研討班一起啃,新的合作和新問題隨之冒出來,年輕人被吸引進這個領域,證明被一步步簡化,最後寫進教科書。而現在,難題被AI成批解掉,提交結果的人自己也講不清楚,這一連串反應幾乎不再發生。研究者還開始把有前途的方向藏起來,生怕被搶先。陶哲軒把這比作露天開礦,把未解問題一片一片挖光。
釋出第2天,一個由800多名數學家組成的團體「人類數學協會」發表宣告,呼籲同行停止與OpenAI合作,稱一次放出700多個檔案是在秀肌肉,算不上學術。9月,20多位菲爾茲獎得主已聯名發表宣言,批評AI公司把數學難題當成測試模型的考題。他們擔心的是答案背後的東西:數學家攻一道難題,路上會造出新方法,再靠報告、討論和教科書傳給後來的人;AI直接把答案端出來,沒人消化,這些方法就傳不下去。
年輕人已經先吃了虧。博士論文、經費申請、求職材料往往就押在某一個未解問題上。手稿放出來之後,有數學家說,身邊一批朋友和同事的經費申請一夜之間作廢。還有人擔心,下一代要是不再啃難題,幾十年後,這些數學可能就沒人看得懂了。
數學界並沒有達成一致。加拿大多倫多大學的丹尼爾·利特認為這對數學是好事,他轉述一位合作者的感受:「我覺得自己爬了一輩子,現在能飛了。」也有人看到自己研究過的問題被解決,感到的是輕鬆。
興奮也好,憤怒也好,擺在所有人面前的是同一堆稿子。數學家普遍估計,把這722篇弄明白,要花好幾年。OpenAI沒有停下的意思,表示會繼續拿數學問題測試自己的內部模型,數學圈裡也已經在傳下一批手稿。法國國家科學研究中心的數學家斯科特·阿姆斯特朗自認是對AI最樂觀的那批人之一,被問到接下來的打算,他說眼下最要緊的是把手頭的研究做完,「趁OpenAI還沒搶在我們前面」。