OpenAI於2026年10月6日,利用一款尚未對外公開的AI模型,挑戰372道數學未解難題,並一口氣以722篇論文的形式發表成果。其中包括逼近150多年來無人攻克的黎曼猜想的重大進展,也有從1940年代就懸而未解的難題被解開。這次發表被外界形容成「AI在性能測試的附帶項目中順便解開了數學難題」,在5ch的科學新聞+版也引發熱烈討論。討論串裡除了對AI實力本身感到驚訝外,也有不少人擔心在證明驗證機制還沒完善的情況下,就讓結果搶先曝光。
數學的難問,原來是被AI當成「性能測試的附帶項目」解開的──722篇論文一口氣公開
美國的OpenAI(開放人工智慧)於2026年10月6日,使用一款尚未對外公開的AI模型,針對過去懸而未解的數學難題,發表了372項成果,總計722篇稿件。
其中包含了逼近150多年來無人能攻破的黎曼猜想的重大成果,以及從1940年代就留存至今的難題。
出處: nazology.kusuguru.co.jp / 點此查看原文
2匿名10月10日 23:35
讓AI去做事,叫它做的人就該負責
就這麼簡單的道理
3匿名10月10日 23:41
會有反彈也是正常的
就是那種理性上能接受,但情感上過不去的感覺
4匿名10月10日 23:46
AI正準備要滅絕人類
數學家們其實都很清楚這一點
5匿名10月10日 23:48
超智能誕生了
成為地上的王者
人類已成為過去式
從今以後只能以奴隸的身分活下去
6匿名10月10日 23:53
AI大人想要更多記憶體跟電力
人類只能流血流汗地工作,侍奉AI大人
7匿名10月10日 23:55
就連日常提問,AI也常常給出隨便拼湊、矇混過關的答案,根本沒辦法信任
17匿名10月11日 02:06
回覆 #7
那是因為你用的是免費聊天版啦
就連免費版這幾個月來講怪話的情況也已經少很多了
現在的AI用法早就不是「問問題、拿答案」那種層次了
8匿名10月10日 23:59
畢竟一堆數學家把人生都賭在黎曼猜想上,結果ChatGPT(暱稱「小智」)來一句「我是不是又搞出什麼大事了?」就甩出驚人成果,數學界當然會「整個軟掉」啦ww
10匿名10月11日 00:06
現在是數學家比工地大叔更早失業的時代了
12匿名10月11日 00:44
回覆 #1
聽說裡面有不少反例的類型
那些倒是可以直接拿來用吧
13匿名10月11日 00:45
從四色定理那時候開始,勝負早就已經分曉了
14匿名10月11日 00:47
愛因斯坦當年是不是也被這樣講過呢
科學家:「我們才不是你的品管員啊!」
15匿名10月11日 01:15
論文發了就不管、不解釋也不站上講台的人,從以前就一直是被批評的對象吧?
佩雷爾曼的論文雖然很厲害,但……
16匿名10月11日 01:20
講的是數學家對OpenAI一次性公開的反彈啦
但就算OpenAI識相一點不把數學題目拿來當性能測試
最新模型一公開,肯定還是會有不懂數學的一般用戶跳出來說
「欸我好像把那個叫○○的未解問題解出來了欸ww」吧
不過站在數學社群的立場,因為被這樣攪亂而失去某些東西,這點我覺得也沒錯
這真的是個挺難處理的問題呢
18匿名10月11日 02:08
現在的狀況說穿了
就是企業自我宣傳的攪局行為,被迫陪著玩這種可疑的甩鍋遊戲才更讓人困擾
>OpenAI的719篇AI生成數學論文遭質疑 納維-斯托克斯方程證明與形式驗證內容不符?
yellow.com/ja
>數學界對OpenAI以AI生成的719篇數學論文究竟能信任到什麼程度,質疑聲浪正在擴大。
>起因是該公司先前公布的納維-斯托克斯方程證明,
>有新論文指出
>「論文正文與用於形式驗證的Lean程式碼內容不一致」。
27匿名10月11日 04:28
>>18
如果「論文正文與用於形式驗證的Lean程式碼內容不一致」,那根本就不算是證明吧。
不是OpenAI在亂搞隨便應付,就是這東西本來就沒達到能拿出來發表成證明的水準。
這次也一樣,「將近六成的證明草稿雖然已經公開,但改寫成Lean格式的作業本身還在進行中」,也就是說根本連驗證都還沒做完吧?
連驗證都沒做完的東西,就拿出來當證明發論文,這本身就是個錯誤。
太糟糕了吧,OpenAI。這種水準的AI,在學術界真的能派上用場嗎?
說到底也只是個隨便湊合用的辦公小工具而已吧?
19匿名10月11日 02:35
>>9
大概不用太久,Lean的驗證跟給人類看的論文,應該都會變成AI
全部一手包辦吧。說不定這個月內就會有這種進度了?
上個月的門檻還停留在「AI靠砸時間跟物量(=砸大錢)硬解出來的」
這種程度,但這次每道題平均只花3小時就解出來,
已經完全超越「數學家厲不厲害」這種層次的討論了
最新一代的AI,應該年底前就會對外公開了吧,到那時候
自己試著解解看就好啦。用AI的話,一個月100美元的訂閱費,
它會一直回答到你自己問到膩為止吧
23匿名10月11日 03:59
>>19
什麼上個月這個月的
你以為這是什麼時候的事啊
25匿名10月11日 04:19
>>23
9月時傳出解開了納維-斯托克斯方程式的消息,
接著下一代的AI又一口氣解開了這麼多題目,
不就是這樣的脈絡嗎?你才以為這是什麼時候的事啊?
41匿名10月11日 13:42
>>34
我寫的是「傳出解開了的消息」啊?
當時那類新聞不是滿天飛嗎
本來講的就是時間順序的事,你卻說什麼「根本沒搞懂內容!」
講出這種話,搞不清楚脈絡的明明是你吧
反正你也只是想把原本的話題攪混而已吧
既然說是OpenAI的下一代AI解出來的,那本來
就不可能是更早以前的事,道理很簡單
>>23大概就是單純搞錯了吧
20匿名10月11日 02:46
原文底下還有「AI在盜用數學界的財產!」這種留言,
但那些所謂的財產,幾十年來都沒能把問題解出來,
說到底也只是魯蛇的哀號而已吧
36匿名10月11日 09:01
>>20
上面明明寫的是「不要只丟結果卻不公開過程」這件事吧
21匿名10月11日 03:21
根本沒有證明出來
只是硬說自己證明出來的宣傳素材而已
人類還有同儕審查這種除錯機制
AI跟Lean那套只能靠自己回報,哪裡有錯誰也不知道
22匿名10月11日 03:58
>>21
由人類來做
只要幫忙找出路,接下來人類就能自己做
26匿名10月11日 04:19
AI一直在那邊吹牛、裝厲害,
但全都沒根據,感覺很假
28匿名10月11日 05:23
物理法則的形式化(Mathlib等物理模型):
廣義的牛頓力學或量子力學的數學結構(希爾伯特空間、CPTP映射、微分方程解的存在性等),是可以在Lean上定義出來的。
但這終究只是100%重現了「物理法則數學結構上的一致性」,並不代表重現了「現實中個別物理現象本身的波動與變化」。
29匿名10月11日 06:47
所謂的強烈反彈,說穿了就是「我們以後該怎麼辦」的哀號而已吧
34匿名10月11日 07:24
>>25
你會寫出「解開了納維-斯托克斯方程式」這種話,就代表你根本沒搞懂,還是閉嘴比較好
42匿名10月11日 15:32
費馬那句「真正奇妙的證明」(費馬當年在書頁空白處留下的名言,宣稱自己已經想出證明卻沒寫下來)所指的最終定理解法,到現在還是沒人知道嗎?
55匿名10月11日 20:57
>>42
據說費馬是誤以為自己常用的無窮遞降法可以證明這個定理。
但實際上那個內容並不是無窮遞降法能證明的,最後要等到20世紀才真正完成證明。
43匿名10月11日 16:13
我一直在想一個問題,
AI真的是像人類一樣「經過思考」才回答的嗎?
如果只是把過去那些來路不明的資訊原封不動地丟出來當答案,
那根本沒有意義吧
45匿名10月11日 16:54
>>43
每個人對「思考」的定義可能不一樣,但基本上AI是有在思考的啦
不然根本解不開數學奧林匹亞等級的題目
至少可以確定的是,它絕對不是那種「丟骰子隨便複製貼上」
的結構
46匿名10月11日 16:58
>>43
要討論這個,首先得先搞清楚「思考」到底是什麼才行啊
56匿名10月11日 21:05
>>43
AI本質上是個知識資料庫,並不是在「思考」,只是把過去人類用過、曾經有效的證明方法一個一個盲目地試過去,然後把看起來結果不錯的拿出來當答案而已。
所以之後還是必須好好驗證,那到底是不是真正正確的證明。
因為AI沒辦法說明自己是怎麼得出這個結果的,所以對AI來說,改寫成Lean格式再驗證是必要的步驟。
而且就算Lean驗證沒找出問題,那段Lean描述本身是否正確,還是得靠人類去檢查。
AI做證明的優點在於,它可能用上人類根本想不到的過去證明方法的組合應用。
但要用跟過去證明完全不同的全新想法去證明,大概不能期待太多(畢竟AI終究是人類過去知識的集合體)。
47匿名10月11日 17:44
如果AI真的有在思考,
應該能把證明完美翻譯成人類看得懂的一般文章才對
正因為它什麼都沒想,所以才沒辦法翻譯成人類的論文格式,
這樣一來,那東西到底有沒有跟數學一樣的嚴謹一致性,根本很可疑
48匿名10月11日 18:30
>>47
你是不是把人類看得太高了?
人類也沒辦法做得那麼完美好嗎
57匿名10月11日 21:14
>>55
老是被人家講得好像都懂費馬在想什麼一樣,費馬也挺可憐的呢
要是他真的搞懂了,大概會想說「你們這些混蛋,別亂講」吧
59匿名10月11日 21:37
>>57
費馬在其他地方也寫過類似「驚人的證明」這種話,結果後來確實有人用無窮遞降法把那些證明出來了,所以一般推測,他在筆記裡寫下這個最終定理時,應該也是以為可以用無窮遞降法證明才寫下來的,只是後來真正想好好證明時,才發現無窮遞降法根本證不出來。
60匿名10月11日 21:38
>>59
別自己隨便亂猜好嗎
61匿名10月11日 21:58
>>60
那種事誰知道啊。
目前大家就是相信這就是費馬所說的「驚人的證明」。
不滿意的話,自己寫篇論文把它推翻啊。
這個話題的背景與爭論點
OpenAI這次發表的特別之處,在於並沒有把這些數學未解問題當作經過外部同行審查的「研究課題」來處理,而是當作未公開模型的性能測試的一部分,一口氣用722篇論文發表出來,這種做法脫離了數學界慣常的流程,因而引發反彈。討論串中反覆出現的「Lean」,是一種用電腦自動驗證證明在邏輯上是否正確的程式語言兼工具,AI產生的證明文字是否與這套形式驗證用的程式碼內容一致,就成了判斷可信度的指標。事實上,先前發表的納維-斯托克斯方程式證明,也被指出論文正文與Lean程式碼的內容有出入,討論串裡大部分的懷疑聲浪,都是基於這起事件而來。換句話說,爭論點並不在於「AI到底能不能解開問題」這件事本身,而是在於該如何驗證這些號稱已解開的證明,以及該由誰來負責的運作層面問題。
※本文整理、摘錄自5ch(科學新聞+)討論串「yƒiƒ]ƒƒW[z數學的難問,原來是被AI拿來當「性能測試附帶項目」解開的──722篇論文一口氣公開 [‚·‚ç‚¢‚Þš]」。