OpenAI 致力於打造能夠處理任何任務的通用人工智能
Hunter Lightman 在 2022 年成為 OpenAI 的研究員後不久,就見證了 ChatGPT 的爆炸性推出--這是科技史上成長最快的產品之一。與此同時,Lightman 較為安靜的工作則是訓練 OpenAI 的模型來應付精英高中數學競賽。
如今,他的團隊 -athGen - 在 OpenAI 尋求建立領先業界的 AI 推理模型的過程中扮演著關鍵的角色。這些系統構成「AI 代理」的骨幹,能夠執行類似人類的電腦任務。
"Lightman 告訴 TechCrunch 有關 MathGen 的起源。
儘管有進展,OpenAI 的模型仍然不完美。即使是其最新的系統也會產生幻覺,在處理複雜的任務時舉步維艱。
然而,數學推理能力已大幅提升。其中一個模型最近在國際數學奧林匹克競賽(International Math Olympiad)中奪得金牌,該競賽是為世界上最聰明的數學學生而設。OpenAI 相信這些推理能力將延伸至其他領域,為其憧憬已久的通用 AI 代理提供動力。
ChatGPT 的成功是偶然的,而 OpenAI 的代理開發則是經過多年的深思熟慮。"執行長 Sam Altman 在 OpenAI 2023 年開發者大會上預言:「不久之後,你只需要請電腦處理任務。"我們稱這些為 「代理」,它們的潛力非常驚人。
科技巨頭已確認參加 Disrupt 2025
Netflix、ElevenLabs、Wayve 和 Sequoia Capital 領導 TechCrunch Disrupt 20 週年慶的全明星陣容。從科技界的頂尖人物身上獲得可行的洞察力 - 立即購買門票,在價格上漲之前最多可節省 675 美元。
科技巨頭已確認參加 Disrupt 2025
Netflix、ElevenLabs、Wayve 和 Sequoia Capital 領導 TechCrunch Disrupt 20 週年慶的全明星陣容。從科技界的頂尖人士獲得可行的洞察力 - 立即購買門票,在價格上漲前可節省高達 675 美元。
舊金山 | 2025 年 10 月 27-29 日 | 立即報名

OpenAI 執行長 Sam Altman 在 DevDay 2023 發表演說 (照片: Justin Sullivan/Getty Images) 雖然 Altman 的願景仍未得到證實,但 OpenAI 在 2024 年推出的「o1」推理模型已讓科技界瞠目結舌。幾個月之內,它的 21 位研究人員成為矽谷最令人垂涎的人才,Meta 挖走了其中五位,並提供九位數的報酬。
強化學習的復甦
OpenAI 的代理突破與強化學習 (Reinforcement Learning, RL) 息息相關 - AI 模型透過模擬試誤來學習。儘管強化學習可以追溯到 2016 年的 AlphaGo 里程碑,OpenAI 仍花了數年時間,將其改良為適用於電腦使用的代理程式。
早期的 GPT 模型在文字方面表現優異,但在基本數學方面卻乏善可陳。2023 年的「Strawberry」計畫結合了 RL 與測試時計算 - 讓模型在回答前驗證步驟,並開創了「思考鏈」推理。
"研究人員 El Kishky 回憶說:「突然間,模型可以回溯並自我糾正,感覺很人性化。
擴展推理能力
OpenAI 發現了兩個擴充向量:訓練後的運算與反應時間分配。"Lightman 指出:「我們不只是為了今天而設計,也是為了擴充能力而設計。
專門的「Agents」團隊於 2023 年成立,為 o1 奠定基礎。與受限於產品需求的競爭對手不同,OpenAI 將 AGI 研究放在優先地位,這是一項策略性的優勢。
定義 AI 推理
研究人員爭論 AI 是否真的「推理」。有些人強調計算效率,有些人則注重類似人類的輸出。批評者是存在的,但能力是最重要的,就像飛機與鳥類的飛行方式不同一樣。
主觀任務的挑戰
目前的代理程式對於編碼處理得很好,但對於細微的問題,例如線上購物,就很吃力。"Lightman 解釋說:「這根本就是資料的挑戰。新技術允許在較難驗證的任務上進行訓練。
OpenAI 的 IMO 解決方案使用多重代理探索,現在 Google 和 xAI 都在效仿。研究員 Noam Brown 認為快速的進展仍在持續:「沒有放緩的跡象」。
隨著 GPT-5 迫在眉睫,OpenAI 的目標是保持與 Google、Anthropic 和 Meta 對抗的優勢。最終目標?一個能直覺執行任何數位任務的代理程式,完全超越今日的 ChatGPT。
相關文章
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
相關專題推薦
評論 (1)
0/500
Hunter Lightman 在 2022 年成為 OpenAI 的研究員後不久,就見證了 ChatGPT 的爆炸性推出--這是科技史上成長最快的產品之一。與此同時,Lightman 較為安靜的工作則是訓練 OpenAI 的模型來應付精英高中數學競賽。
如今,他的團隊 -athGen - 在 OpenAI 尋求建立領先業界的 AI 推理模型的過程中扮演著關鍵的角色。這些系統構成「AI 代理」的骨幹,能夠執行類似人類的電腦任務。
"Lightman 告訴 TechCrunch 有關 MathGen 的起源。
儘管有進展,OpenAI 的模型仍然不完美。即使是其最新的系統也會產生幻覺,在處理複雜的任務時舉步維艱。
然而,數學推理能力已大幅提升。其中一個模型最近在國際數學奧林匹克競賽(International Math Olympiad)中奪得金牌,該競賽是為世界上最聰明的數學學生而設。OpenAI 相信這些推理能力將延伸至其他領域,為其憧憬已久的通用 AI 代理提供動力。
ChatGPT 的成功是偶然的,而 OpenAI 的代理開發則是經過多年的深思熟慮。"執行長 Sam Altman 在 OpenAI 2023 年開發者大會上預言:「不久之後,你只需要請電腦處理任務。"我們稱這些為 「代理」,它們的潛力非常驚人。
科技巨頭已確認參加 Disrupt 2025
Netflix、ElevenLabs、Wayve 和 Sequoia Capital 領導 TechCrunch Disrupt 20 週年慶的全明星陣容。從科技界的頂尖人物身上獲得可行的洞察力 - 立即購買門票,在價格上漲之前最多可節省 675 美元。
科技巨頭已確認參加 Disrupt 2025
Netflix、ElevenLabs、Wayve 和 Sequoia Capital 領導 TechCrunch Disrupt 20 週年慶的全明星陣容。從科技界的頂尖人士獲得可行的洞察力 - 立即購買門票,在價格上漲前可節省高達 675 美元。
舊金山 | 2025 年 10 月 27-29 日 | 立即報名

雖然 Altman 的願景仍未得到證實,但 OpenAI 在 2024 年推出的「o1」推理模型已讓科技界瞠目結舌。幾個月之內,它的 21 位研究人員成為矽谷最令人垂涎的人才,Meta 挖走了其中五位,並提供九位數的報酬。
強化學習的復甦
OpenAI 的代理突破與強化學習 (Reinforcement Learning, RL) 息息相關 - AI 模型透過模擬試誤來學習。儘管強化學習可以追溯到 2016 年的 AlphaGo 里程碑,OpenAI 仍花了數年時間,將其改良為適用於電腦使用的代理程式。
早期的 GPT 模型在文字方面表現優異,但在基本數學方面卻乏善可陳。2023 年的「Strawberry」計畫結合了 RL 與測試時計算 - 讓模型在回答前驗證步驟,並開創了「思考鏈」推理。
"研究人員 El Kishky 回憶說:「突然間,模型可以回溯並自我糾正,感覺很人性化。
擴展推理能力
OpenAI 發現了兩個擴充向量:訓練後的運算與反應時間分配。"Lightman 指出:「我們不只是為了今天而設計,也是為了擴充能力而設計。
專門的「Agents」團隊於 2023 年成立,為 o1 奠定基礎。與受限於產品需求的競爭對手不同,OpenAI 將 AGI 研究放在優先地位,這是一項策略性的優勢。
定義 AI 推理
研究人員爭論 AI 是否真的「推理」。有些人強調計算效率,有些人則注重類似人類的輸出。批評者是存在的,但能力是最重要的,就像飛機與鳥類的飛行方式不同一樣。
主觀任務的挑戰
目前的代理程式對於編碼處理得很好,但對於細微的問題,例如線上購物,就很吃力。"Lightman 解釋說:「這根本就是資料的挑戰。新技術允許在較難驗證的任務上進行訓練。
OpenAI 的 IMO 解決方案使用多重代理探索,現在 Google 和 xAI 都在效仿。研究員 Noam Brown 認為快速的進展仍在持續:「沒有放緩的跡象」。
隨著 GPT-5 迫在眉睫,OpenAI 的目標是保持與 Google、Anthropic 和 Meta 對抗的優勢。最終目標?一個能直覺執行任何數位任務的代理程式,完全超越今日的 ChatGPT。
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。





首頁






