OpenAI 宣稱在解決這道存在數十年的數學難題方面取得了真正的突破

OpenAI 宣稱,其最新的推理模型已生成一份原創的數學證明,推翻了保羅·埃爾德什(Paul Erdős)於 1946 年首次提出的著名未解幾何猜想。
若這聽起來似曾相識,那是因為 OpenAI 過去曾提出過類似的大膽聲明。七個月前,該公司前副總裁凱文·韋爾(Kevin Weil)在 X 平台發文表示:「GPT-5 找到了 10 個(!)先前未解的埃爾德什問題的解法,並在另外 11 個問題上取得了進展。」
事實證明,GPT-5 並未真正解決這些問題;它只是重新發現了現有文獻中早已記載的解法。
這項聲明招致了 Yann LeCun 和 Google DeepMind 執行長 Demis Hassabis 等競爭對手的批評,導致 Weil 迅速刪除了這篇過早發布的貼文。然而,這次 OpenAI 似乎已避免重蹈覆轍。除了這項新聲明外,該公司還發布了數學家 Noga Alon、Melanie Wood 以及 Thomas Bloom 的支持聲明——後者負責維護「埃爾德什問題」網站,並曾將 Weil 的貼文描述為「極其失實的陳述」。
OpenAI 在 X 平台上聲明:「近 80 年來,數學家一直認為最佳解應類似於方格網格。如今,OpenAI 的模型透過發現一組表現更優異的全新構建方法,推翻了這一觀點。」
該公司將此描述為「人工智慧首次自主解決了某個數學領域的核心重大未解問題」。據 OpenAI 表示,該證明源自一個新的通用推理模型,而非專為解決數學問題——甚至不是為解決這個特定問題——而建構的系統。
OpenAI 強調這項成就的重要性,指出它展現了 AI 系統日益增強的能力,能夠維持長而複雜的推理鏈,並以研究人員過去可能未曾考慮過的方式,在不同學科間建立概念連結。這項能力對於生物學、物理學、工程學和醫學等領域可能具有重要影響。
「人工智慧正協助我們更深入地探索這座歷經數世紀所建構的宏偉數學大教堂,」布魯姆在聲明中表示。「還有哪些未被發現的奇蹟正等待著我們去探索呢?」
相關文章
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
相關專題推薦
評論 (0)
0/500

OpenAI 宣稱,其最新的推理模型已生成一份原創的數學證明,推翻了保羅·埃爾德什(Paul Erdős)於 1946 年首次提出的著名未解幾何猜想。
若這聽起來似曾相識,那是因為 OpenAI 過去曾提出過類似的大膽聲明。七個月前,該公司前副總裁凱文·韋爾(Kevin Weil)在 X 平台發文表示:「GPT-5 找到了 10 個(!)先前未解的埃爾德什問題的解法,並在另外 11 個問題上取得了進展。」
事實證明,GPT-5 並未真正解決這些問題;它只是重新發現了現有文獻中早已記載的解法。
這項聲明招致了 Yann LeCun 和 Google DeepMind 執行長 Demis Hassabis 等競爭對手的批評,導致 Weil 迅速刪除了這篇過早發布的貼文。然而,這次 OpenAI 似乎已避免重蹈覆轍。除了這項新聲明外,該公司還發布了數學家 Noga Alon、Melanie Wood 以及 Thomas Bloom 的支持聲明——後者負責維護「埃爾德什問題」網站,並曾將 Weil 的貼文描述為「極其失實的陳述」。
OpenAI 在 X 平台上聲明:「近 80 年來,數學家一直認為最佳解應類似於方格網格。如今,OpenAI 的模型透過發現一組表現更優異的全新構建方法,推翻了這一觀點。」
該公司將此描述為「人工智慧首次自主解決了某個數學領域的核心重大未解問題」。據 OpenAI 表示,該證明源自一個新的通用推理模型,而非專為解決數學問題——甚至不是為解決這個特定問題——而建構的系統。
OpenAI 強調這項成就的重要性,指出它展現了 AI 系統日益增強的能力,能夠維持長而複雜的推理鏈,並以研究人員過去可能未曾考慮過的方式,在不同學科間建立概念連結。這項能力對於生物學、物理學、工程學和醫學等領域可能具有重要影響。
「人工智慧正協助我們更深入地探索這座歷經數世紀所建構的宏偉數學大教堂,」布魯姆在聲明中表示。「還有哪些未被發現的奇蹟正等待著我們去探索呢?」
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。





首頁






