OpenAI 成立數學與人工智慧顧問小組;神秘模型在24天內解決100個世界級難題

9月22日,OpenAI 宣佈成立“數學與人工智慧諮詢小組”。該獨立機構總部位於普林斯頓高等研究院,由九位數學家組成,其運作獨立於 OpenAI。
更為引人注目的是,OpenAI 透露,自 8 月 28 日起進行訓練的一個神秘模型,已成功解決了涵蓋多個數學領域的 100 多個長期未決的開放性問題,其中包括備受爭議的納維-斯托克斯千年大獎問題。
數學家們對這一快速進展表示震驚,引發了關於學術披露方式的內部辯論
OpenAI 指出,該模型在數學領域的進展令其內部團隊感到驚訝,從而促使團隊討論向更廣泛的學術界通報這一進展的最適當方式。
OpenAI 認識到數學是一門基礎科學,並承認人工智慧驅動的發現可能具有廣泛的應用前景。因此,該公司在開發和部署這些能力時採取了謹慎的態度,目前正在探索更廣泛的實施策略。
此前,特里·陶(Terence Tao)、鄧宇(Yu Deng)、彼得·舒爾策(Peter Scholze)等著名數學家發表了一封公開信,對將解決開放數學問題作為新人工智慧系統的基準表示擔憂。OpenAI 表示,這些觀點凸顯了與數學界進行更充分互動的必要性。
諮詢小組包括三位菲爾茲獎得主,且不接受 OpenAI 的薪酬
OpenAI 澄清稱,該諮詢小組獨立運作,保留提供未經請求的建議、公開評論 OpenAI 對數學領域的影響以及獨立調整其成員組成的權利。成員不領取薪酬,但該小組不影響 OpenAI 內部數學研究的進度。
創始成員包括:弗朗索瓦·查爾斯(École Normale Supérieure, ENS-PSL)、卡米洛·德·萊利斯(高等研究院、大薩索科學研究所)、蒂莫西·高爾斯(法蘭西公學院、劍橋大學)、馬丁·海雷爾(洛桑聯邦理工學院、倫敦帝國理工學院)、尼基爾·斯里瓦斯塔瓦(伯克利大學、西蒙斯研究所)、烏爾裡希·蒂爾曼(牛津大學、INI)、拉維·瓦克爾(斯坦福大學)、愛德華·威滕(高等研究院)和梅蘭妮·馬切特·伍德(哈佛大學)。其中,高爾斯、海雷爾和威滕是菲爾茲獎得主;卡米洛·德·萊利斯也是上述公開信的簽署人之一。
該諮詢小組將就新興成果的審查與傳播提供建議,協助 OpenAI 評估研究成果的重要性,並對數學研究的學術標準提供意見。此外,該小組還將推薦 OpenAI 的工具如何能更好地支援數學研究與教育。
相關文章
Anthropic 確認 Claude 賬戶遭駭客攻擊,使用者失去訪問許可權
多位 Claude 使用者近日在社交媒體上報告稱,他們的賬戶配額在沒有進行任何主動使用的情況下被迅速耗盡。Anthropic 的調查結果顯示,駭客透過竊取登入會話的方式非法獲取了使用者賬戶的訪問許可權,隨後利用受害者的寶貴呼叫配額進行惡意操作。此次漏洞首先由位於英國東薩塞克斯郡的獨立 AI 顧問 Grant D'Arcy 於 8 月 4 日發現。儘管他並未進行活躍工作,但其 Claude Max 20x 賬戶的使用量仍在持續上升。第二天,他禁用了所有與 Claude 連線的工具,暫停了計劃任務和雲執
Senspeech X2.5 雙星:首個在端側實現百萬級 Token 上下文,完全使用國產算力訓練
9月1日,科大訊飛全資子公司思元星火正式推出並開源兩款端側通用大模型:星火X2.5-4B和星火X2.5-1.7B。這兩款模型是業界首批原生支援高達100萬Token上下文長度的模型,並完全開放模型權重、程式碼倉庫及部署文件。百萬級上下文支援,小模型也能“讀完一本書”兩款模型均採用混合注意力架構,針對智慧體、程式碼、數學及指令遵循等核心能力進行了最佳化,在同類規模的行業級開源模型中展現出領先的綜合效能。在上下文能力方面,星火X2.5-4B和星火X2.5-1.7B基於萬億級Token的高質量資料進行了訓練
Meitun LongCat 推出 LoHoSearch,而 BrowseComp 的得分已跌至 30% 以下
過去一年中,搜尋智慧體(Search Agent)的能力在很大程度上由 BrowseComp 基準測試所定義。然而,該基準測試正逐漸失去其相關性——它在短短十個月內將模型效能從 30% 提升至 90%,但其價值正在迅速衰減。7 月 17 日,美團旗下 LongCat 推出了更為嚴格的評估標準 LoHoSearch,旨在重新激發搜尋智慧體開發領域的實質性進展。LoHoSearch 的挑戰並非人工構建,而是從包含 762 萬個實體的維基百科知識圖譜中自動生成。由於這些任務是機器生成的,它們達到了人類
相關專題推薦
評論 (0)
0/500

9月22日,OpenAI 宣佈成立“數學與人工智慧諮詢小組”。該獨立機構總部位於普林斯頓高等研究院,由九位數學家組成,其運作獨立於 OpenAI。
更為引人注目的是,OpenAI 透露,自 8 月 28 日起進行訓練的一個神秘模型,已成功解決了涵蓋多個數學領域的 100 多個長期未決的開放性問題,其中包括備受爭議的納維-斯托克斯千年大獎問題。
數學家們對這一快速進展表示震驚,引發了關於學術披露方式的內部辯論
OpenAI 指出,該模型在數學領域的進展令其內部團隊感到驚訝,從而促使團隊討論向更廣泛的學術界通報這一進展的最適當方式。
OpenAI 認識到數學是一門基礎科學,並承認人工智慧驅動的發現可能具有廣泛的應用前景。因此,該公司在開發和部署這些能力時採取了謹慎的態度,目前正在探索更廣泛的實施策略。
此前,特里·陶(Terence Tao)、鄧宇(Yu Deng)、彼得·舒爾策(Peter Scholze)等著名數學家發表了一封公開信,對將解決開放數學問題作為新人工智慧系統的基準表示擔憂。OpenAI 表示,這些觀點凸顯了與數學界進行更充分互動的必要性。
諮詢小組包括三位菲爾茲獎得主,且不接受 OpenAI 的薪酬
OpenAI 澄清稱,該諮詢小組獨立運作,保留提供未經請求的建議、公開評論 OpenAI 對數學領域的影響以及獨立調整其成員組成的權利。成員不領取薪酬,但該小組不影響 OpenAI 內部數學研究的進度。
創始成員包括:弗朗索瓦·查爾斯(École Normale Supérieure, ENS-PSL)、卡米洛·德·萊利斯(高等研究院、大薩索科學研究所)、蒂莫西·高爾斯(法蘭西公學院、劍橋大學)、馬丁·海雷爾(洛桑聯邦理工學院、倫敦帝國理工學院)、尼基爾·斯里瓦斯塔瓦(伯克利大學、西蒙斯研究所)、烏爾裡希·蒂爾曼(牛津大學、INI)、拉維·瓦克爾(斯坦福大學)、愛德華·威滕(高等研究院)和梅蘭妮·馬切特·伍德(哈佛大學)。其中,高爾斯、海雷爾和威滕是菲爾茲獎得主;卡米洛·德·萊利斯也是上述公開信的簽署人之一。
該諮詢小組將就新興成果的審查與傳播提供建議,協助 OpenAI 評估研究成果的重要性,並對數學研究的學術標準提供意見。此外,該小組還將推薦 OpenAI 的工具如何能更好地支援數學研究與教育。
Anthropic 確認 Claude 賬戶遭駭客攻擊,使用者失去訪問許可權
多位 Claude 使用者近日在社交媒體上報告稱,他們的賬戶配額在沒有進行任何主動使用的情況下被迅速耗盡。Anthropic 的調查結果顯示,駭客透過竊取登入會話的方式非法獲取了使用者賬戶的訪問許可權,隨後利用受害者的寶貴呼叫配額進行惡意操作。此次漏洞首先由位於英國東薩塞克斯郡的獨立 AI 顧問 Grant D'Arcy 於 8 月 4 日發現。儘管他並未進行活躍工作,但其 Claude Max 20x 賬戶的使用量仍在持續上升。第二天,他禁用了所有與 Claude 連線的工具,暫停了計劃任務和雲執
Senspeech X2.5 雙星:首個在端側實現百萬級 Token 上下文,完全使用國產算力訓練
9月1日,科大訊飛全資子公司思元星火正式推出並開源兩款端側通用大模型:星火X2.5-4B和星火X2.5-1.7B。這兩款模型是業界首批原生支援高達100萬Token上下文長度的模型,並完全開放模型權重、程式碼倉庫及部署文件。百萬級上下文支援,小模型也能“讀完一本書”兩款模型均採用混合注意力架構,針對智慧體、程式碼、數學及指令遵循等核心能力進行了最佳化,在同類規模的行業級開源模型中展現出領先的綜合效能。在上下文能力方面,星火X2.5-4B和星火X2.5-1.7B基於萬億級Token的高質量資料進行了訓練
Meitun LongCat 推出 LoHoSearch,而 BrowseComp 的得分已跌至 30% 以下
過去一年中,搜尋智慧體(Search Agent)的能力在很大程度上由 BrowseComp 基準測試所定義。然而,該基準測試正逐漸失去其相關性——它在短短十個月內將模型效能從 30% 提升至 90%,但其價值正在迅速衰減。7 月 17 日,美團旗下 LongCat 推出了更為嚴格的評估標準 LoHoSearch,旨在重新激發搜尋智慧體開發領域的實質性進展。LoHoSearch 的挑戰並非人工構建,而是從包含 762 萬個實體的維基百科知識圖譜中自動生成。由於這些任務是機器生成的,它們達到了人類





首頁






