3月31日消息,近日,比利時布魯塞爾自由大學(VUB)數據分析實驗室發布重磅研究成果,證實商用大型語言模型已具備獨立生成原創數學證明的能力。
OpenAI旗下ChatGPT-5.2(Thinking)成功破解了一項此前懸而未決的數學猜想,同時催生了名為“vibe-proving”的全新AI推理方法,相關預印本論文已于2026年2月21日發表在arXiv平臺。
此次研究聚焦的核心命題,是數學家Ran與Teng在2024年提出的一項數學猜想。在數學領域,猜想是基于規律與重復驗證被認為成立,但尚未經過嚴謹形式化證明的命題,只有完成完整有效的邏輯論證,猜想才能正式升格為定理。
研究團隊介紹,整個證明過程歷經7輪與ChatGPT的對話交互,形成了4版逐步迭代完善的論證版本。其中,ChatGPT核心承擔了證明路徑探索、核心結構搭建的工作,人類研究人員則全程把控推理的正確性與邏輯完整性。
研究團隊將這種大模型輔助梳理、探索復雜理論構想的模式,命名為“vibe-proving”,并提出這一方法有望復刻AI輔助編程(vibe-coding)的快速發展路徑,從基礎工具快速向近自動化的理論探索演進。
“此前很多人認為,AI系統的創造力本質上只能局限于對訓練數據的重新組合,我們的研究恰好打破了這一誤解。”VUB教授VincentGinis表示。參與研究的博士后研究員BrechtVerbeken也坦言,雖早已預判ChatGPT能助力數學難題證明,但其實際表現出的效率仍遠超預期。
盡管AI在此次證明中發揮了核心作用,研究團隊仍反復強調,人類的參與與最終驗證不可或缺,尤其是補全證明邏輯缺口、完成最終嚴謹校驗的環節。
VUB教授Andres Algaba指出,AI將大幅加快數學猜想候選證明的生成速度,未來行業的核心瓶頸會轉向人類驗證環節,而語言模型同樣有望在這一領域提供助力。
這項成果也標志著,大語言模型的能力邊界已從輔助編程、文本創作,正式拓展至需要深度原創推理的理論數學研究領域。

