選項
首頁
新聞
OpenAI 成立數學與人工智慧顧問小組;神秘模型在24天內解決100個世界級難題

OpenAI 成立數學與人工智慧顧問小組;神秘模型在24天內解決100個世界級難題

2026-10-02
13

OpenAI 成立數學與人工智慧顧問小組;神秘模型在24天內解決100個世界級難題

9月22日,OpenAI 宣佈成立“數學與人工智慧諮詢小組”。該獨立機構總部位於普林斯頓高等研究院,由九位數學家組成,其運作獨立於 OpenAI。

更為引人注目的是,OpenAI 透露,自 8 月 28 日起進行訓練的一個神秘模型,已成功解決了涵蓋多個數學領域的 100 多個長期未決的開放性問題,其中包括備受爭議的納維-斯托克斯千年大獎問題。

數學家們對這一快速進展表示震驚,引發了關於學術披露方式的內部辯論

OpenAI 指出,該模型在數學領域的進展令其內部團隊感到驚訝,從而促使團隊討論向更廣泛的學術界通報這一進展的最適當方式。

OpenAI 認識到數學是一門基礎科學,並承認人工智慧驅動的發現可能具有廣泛的應用前景。因此,該公司在開發和部署這些能力時採取了謹慎的態度,目前正在探索更廣泛的實施策略。

此前,特里·陶(Terence Tao)、鄧宇(Yu Deng)、彼得·舒爾策(Peter Scholze)等著名數學家發表了一封公開信,對將解決開放數學問題作為新人工智慧系統的基準表示擔憂。OpenAI 表示,這些觀點凸顯了與數學界進行更充分互動的必要性。

諮詢小組包括三位菲爾茲獎得主,且不接受 OpenAI 的薪酬

OpenAI 澄清稱,該諮詢小組獨立運作,保留提供未經請求的建議、公開評論 OpenAI 對數學領域的影響以及獨立調整其成員組成的權利。成員不領取薪酬,但該小組不影響 OpenAI 內部數學研究的進度。

創始成員包括:弗朗索瓦·查爾斯(École Normale Supérieure, ENS-PSL)、卡米洛·德·萊利斯(高等研究院、大薩索科學研究所)、蒂莫西·高爾斯(法蘭西公學院、劍橋大學)、馬丁·海雷爾(洛桑聯邦理工學院、倫敦帝國理工學院)、尼基爾·斯里瓦斯塔瓦(伯克利大學、西蒙斯研究所)、烏爾裡希·蒂爾曼(牛津大學、INI)、拉維·瓦克爾(斯坦福大學)、愛德華·威滕(高等研究院)和梅蘭妮·馬切特·伍德(哈佛大學)。其中,高爾斯、海雷爾和威滕是菲爾茲獎得主;卡米洛·德·萊利斯也是上述公開信的簽署人之一。

該諮詢小組將就新興成果的審查與傳播提供建議,協助 OpenAI 評估研究成果的重要性,並對數學研究的學術標準提供意見。此外,該小組還將推薦 OpenAI 的工具如何能更好地支援數學研究與教育。

相關文章
Anthropic 確認 Claude 賬戶遭駭客攻擊,使用者失去訪問許可權 Anthropic 確認 Claude 賬戶遭駭客攻擊,使用者失去訪問許可權 多位 Claude 使用者近日在社交媒體上報告稱,他們的賬戶配額在沒有進行任何主動使用的情況下被迅速耗盡。Anthropic 的調查結果顯示,駭客透過竊取登入會話的方式非法獲取了使用者賬戶的訪問許可權,隨後利用受害者的寶貴呼叫配額進行惡意操作。此次漏洞首先由位於英國東薩塞克斯郡的獨立 AI 顧問 Grant D'Arcy 於 8 月 4 日發現。儘管他並未進行活躍工作,但其 Claude Max 20x 賬戶的使用量仍在持續上升。第二天,他禁用了所有與 Claude 連線的工具,暫停了計劃任務和雲執
Senspeech X2.5 雙星:首個在端側實現百萬級 Token 上下文,完全使用國產算力訓練 Senspeech X2.5 雙星:首個在端側實現百萬級 Token 上下文,完全使用國產算力訓練 9月1日,科大訊飛全資子公司思元星火正式推出並開源兩款端側通用大模型:星火X2.5-4B和星火X2.5-1.7B。這兩款模型是業界首批原生支援高達100萬Token上下文長度的模型,並完全開放模型權重、程式碼倉庫及部署文件。百萬級上下文支援,小模型也能“讀完一本書”兩款模型均採用混合注意力架構,針對智慧體、程式碼、數學及指令遵循等核心能力進行了最佳化,在同類規模的行業級開源模型中展現出領先的綜合效能。在上下文能力方面,星火X2.5-4B和星火X2.5-1.7B基於萬億級Token的高質量資料進行了訓練
Meitun LongCat 推出 LoHoSearch,而 BrowseComp 的得分已跌至 30% 以下 Meitun LongCat 推出 LoHoSearch,而 BrowseComp 的得分已跌至 30% 以下 過去一年中,搜尋智慧體(Search Agent)的能力在很大程度上由 BrowseComp 基準測試所定義。然而,該基準測試正逐漸失去其相關性——它在短短十個月內將模型效能從 30% 提升至 90%,但其價值正在迅速衰減。7 月 17 日,美團旗下 LongCat 推出了更為嚴格的評估標準 LoHoSearch,旨在重新激發搜尋智慧體開發領域的實質性進展。LoHoSearch 的挑戰並非人工構建,而是從包含 762 萬個實體的維基百科知識圖譜中自動生成。由於這些任務是機器生成的,它們達到了人類
相關專題推薦
寫作 適用於商務寫作的 AI 改寫工具:讓冗長晦澀的文字更清晰易懂
適用於商務寫作的 AI 改寫工具:讓冗長晦澀的文字更清晰易懂

2026 年最新、最佳且評價最高的商務寫作 AI 改寫工具,盡在 XIX.AI!這份精心挑選的清單收錄了強大且能顛覆傳統的工具,這些工具皆經過實際測試,能將晦澀難懂的文案轉化為清晰易懂的內容,並提升寫作效率。 立即獲取免費版與付費版的比較指南,找出最適合您需求的選項。現在就來探索,發掘您的理想工具,並在商務溝通中釋放 AI 帶來的競爭優勢。

13 個工具
xix.ai
音樂創作 用於生成歌詞與旋律構思的 AI 歌曲創作工具
用於生成歌詞與旋律構思的 AI 歌曲創作工具

2026年最新、最優秀、評分最高的用於生成歌詞與旋律靈感的AI作曲工具現已在XIX.AI上亮相!這份精心挑選的合集彙集了諸多功能強大且具有顛覆性意義的工具,它們均經過嚴格的實際應用測試,能夠提供精準的歌詞與旋律建議。您可以檢視免費版本與付費版本的對比資訊、詳細的排名資料,還能發現那些能顯著提升您創作效率的必備工具。立即探索,找到最適合您需求的方案吧!

8 個工具
xix.ai
健康與養生 ChatGPT 餐食規劃應用程式:用於追蹤營養素攝取、製作購物清單及每週備餐
ChatGPT 餐食規劃應用程式:用於追蹤營養素攝取、製作購物清單及每週備餐

2026 年最新最佳 ChatGPT 餐點規劃應用程式:精選高評價、必試且功能強大的革命性工具,助您追蹤宏量營養素、管理購物清單及進行每週備餐。XIX.AI 根據實際測試結果提供每週更新的排行榜,其中包含免費版與付費版的詳細比較資訊。立即發現最適合您的工具,提升工作效率,並解鎖您的 AI 優勢。現在就來探索吧!

9 個工具
xix.ai
視頻創作 適用於短片內容的 AI 影片腳本工具
適用於短片內容的 AI 影片腳本工具

2026 年最新、最受好評的短影片 AI 腳本工具!XIX.AI 精心精選了一系列強大且顛覆業界的必試工具,這些工具均經過嚴格的實戰測試。 您將在此找到每週更新的詳細排行榜、免費與付費版本的比較資訊,以及有助於提升工作效率、在創作高品質短影片內容時發揮 AI 優勢的專業見解。立即探索,找出最適合您的工具!

10 個工具
xix.ai
漫畫創作 適用於分鏡式敘事的 AI 漫畫分格工具
適用於分鏡式敘事的 AI 漫畫分格工具

2026 年最新最佳 AI 漫畫分鏡工具,專為分鏡式敘事而設計!這份精心精選的頂級工具合集,匯集了強大且顛覆業界的解決方案,能協助創作者提升寫作效率並突破創作瓶頸。 您將在此找到詳盡的免費版與付費版比較、實際測試結果以及官方排名,助您做出明智選擇。XIX.AI 亦提供專家見解。立即探索,發掘能讓生動故事栩栩如生的完美工具!238 個字元

9 個工具
xix.ai
視頻創作 最佳用於短影片內容的AI影片生成工具
最佳用於短影片內容的AI影片生成工具

2026 年最新、最佳、最受好評的 AI 短影片生成工具已上線,收錄於 XIX.AI 精選合集。這些強大的變革性工具經過嚴格的真實世界測試,提供全面的免費與付費對比及詳細排名,助您找到完美選項。無論您需要快速製作高質量短影片,還是提升各項任務的生產力,這些必試方案均能帶來卓越成果。立即探索,發現您的理想工具,釋放 AI 優勢。

9 個工具
xix.ai
評論 (0)
0/500
OR