OpenAI 宣稱破解數學猜想 24 小時後即遭數學家駁回?

| Simon Chan | 06-08-2026 08:14 |
在Google
追蹤《e-zone》
OpenAI 宣稱破解數學猜想 24 小時後即遭數學家駁回?

OpenAI 早前再度因數學研究成為焦點,旗下具深度推理能力的大模型據報成功「攻破」一項困擾學界多年的數學猜想。消息一出,外界即時視之為 AI 推理能力的新里程碑,但相關說法很快就被學界重新審視,甚至有報道指,部分數學家在 24 小時內就指出證明存在問題,令事件迅速升溫。

今次爭議之所以引起關注,主要因為 OpenAI 今次並非單純展示模型能夠答題,而是聲稱 AI 能夠產生完整數學證明。對於一直被視為最考驗邏輯嚴密度的數學範疇來說,AI 若真能獨立破解難題,無疑會再次改寫外界對人工智能能力的想像。

AI 推理再受考驗

根據相關報道,OpenAI 今次展示的是一項涉及離散幾何的數學問題,模型嘗試透過長篇推理,推導出一套看似完整的證明。不過,數學界對這類結果一向極為嚴格,因為任何一步推導有誤,都足以令整個結論失效。

有數學家在細閱相關論文後指出,AI 的推導雖然表面上條理清晰,但在關鍵步驟中可能出現偷換概念、簡化條件,或者將原本的猜想範圍改寫,最終導致結論與原題不完全對應。換言之,問題未必在於模型「冇做嘢」,而係做出嚟嘅答案未必符合數學要求。

數學家 24 小時內翻盤

今次事件最受討論的地方,是外界原本以為這會是 AI 於數學研究上的重要突破,結果卻在極短時間內被學界挑戰。有學者更直言,AI 生成的文字可以寫得非常完整,但數學證明唔係睇文筆,而係睇每一步是否都能夠被嚴格驗證。

對一般人來說,AI 可能已經能夠幫手整理資料、寫程式同做初步推理,但去到高等數學這種講求絕對邏輯一致性的領域,模型仍然容易出現「睇落合理、其實有漏洞」的情況。今次被駁回,亦再次反映生成式 AI 的推理能力仍然有明顯上限。

AI 幫手可以 但不能代替專家

這宗事件亦令外界再次討論 AI 在科學研究中的角色。現階段,AI 的確可以成為研究員的輔助工具,例如整理文獻、提出推理方向、加快計算流程,但在需要高度專業判斷的研究範疇,人類專家依然是最後把關者。

OpenAI 雖然希望透過此類研究展示模型的推理潛力,但學界今次的快速反應亦說明,AI 即使可以生成看似嚴謹的結果,最終仍要經過人類驗證,先有機會變成真正可用的科學結論。

對 AI 研究有咩啟示?

今次事件對整個 AI 行業來說,最少有兩點啟示。第一,模型能力的確正在提升,尤其在推理、組織同表達方面,已經愈來愈接近研究級應用。第二,越高階的任務,越需要人類介入驗證,否則一旦出現邏輯幻覺,就會令看似突破性的成果變成空談。

對用家而言,這亦是一個提醒:AI 可以幫你快,但唔代表一定準。無論係寫報告、做學術研究,定係處理專業問題,最後都仲係要靠人腦做判斷。

爆料重點

  • OpenAI 旗下推理模型據報曾嘗試破解一項數學猜想。
  • 有數學家在 24 小時內審視後,指相關證明存在問題。
  • 事件再次反映 AI 在高等數學與嚴密推理上仍有局限。
  • AI 可作輔助工具,但最終仍需要人類專家驗證。

Source:量子位 QbitAI

有數學家在審視後指出,AI 推導的證明在關鍵步驟中可能出現偷換概念或簡化條件,導致結論與原題不完全對應,證明存在問題。

AI 可作為研究員的輔助工具,但對於需要高度專業判斷的研究範疇,人類專家仍是最後把關者,AI 生成的結果仍需人類驗證。

相關文章

Page 1 of 9