OpenAI 將 ChatGPT Pro 升級至 o3,提升每月 200 美元訂閱的價值
本週,包括 Microsoft、Google 和 Anthropic 在內的科技巨擘都發表了重要的 AI 發展。OpenAI 以自己的突破性更新結束了這一連串的公告 - 除了高調地以 65 億美元收購 Jony Ive 的設計公司,推出代號為「io」的雄心勃勃的硬體計畫之外。
該公司已大幅強化 ChatGPT 內的 Operator 自主網頁導覽系統,從先前的 GPT-4o 架構過渡到先進的 o3 推理模型。這項全球推出的服務自 2025 年 5 月 23 日起開始提供,目前為每月 200 美元等級的 ChatGPT Pro 訂戶提供測試階段的服務。
雖然標示為「研究預覽」(research preview),表示仍在改進中,但此項更新是在競爭壓力加劇時推出的。Google 的優質 AI 套件通常售價約為 250 美元(目前第一季折扣價為 125 美元),可存取 Gemini、Imagen 和 Veo 模型,因此 OpenAI 的產品似乎更具競爭力。
瞭解 OpenAI 的 Operator
Operator 於 2025 年 1 月推出,代表 OpenAI 在半自主式電腦應用程式 (Computer Using Agents,CUAs) 的先鋒事業。這項技術將 ChatGPT 的功能從會話介面擴展到執行實際的網路操作。
該系統可自主處理瀏覽任務,包括導覽、資料輸入和交易流程 - 從確保預訂餐廳到編譯研究資料。為了安全起見,Operator 透過專屬的雲端虛擬瀏覽器 (operator.chatgpt.com) 執行功能,而非存取本機瀏覽器,具有強大的保障措施,包括即時使用者監控和限制存取敏感平台。
企業應用程式已展現 Operator 在商務差旅協調和政府服務導航方面的多功能性,突顯其跨產業的潛力。
o3 模型增強
升級在三個關鍵層面提供了可衡量的改進:

- 在 OSWorld 基準上,任務完成率提高了 13% (42.9 vs 38.1)
- WebArena 效能提升 31%(從 48.1 升至 62.9)
- GAIA 基準達成率激增五倍 (62.2 對比 12.3)
使用者體驗評估顯示,他們非常喜歡 o3 的結構化輸出,相較於前一版本較少組織的輸出,78% 的使用者喜歡其詳細、表格式的餐廳預訂呈現,包括位置分析和品質指標。

安全架構
增強版模型維持嚴格的防護措施:
- 94% 的敏感操作確認率(金融交易為 100%)
- 減少 3% 的提示注入漏洞 (20% vs 23%)
- 維持對高風險平台存取的限制
OpenAI 的系統文件證實模型仍低於生物/化學應用程式的關鍵風險臨界值,且缺乏直接編碼環境存取。

企業應用
各行各業的技術領導者可以利用升級後的 Operator 來達到以下目的:
- ML 工程師:簡化模型驗證流程
- 資料專家:自動化網頁式資料驗證
- 安全團隊:審核的安全行為模擬
- IT 協調:可靠的瀏覽器工作自動化
此解決方案結合了增強的功能與內建的風險減緩功能,為現代數位化作業提供了平衡的工具。目前,Response API 繼續在 GPT-4o 架構上運作,遷移時間表尚未確定。
相關文章
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
相關專題推薦
評論 (1)
0/500
本週,包括 Microsoft、Google 和 Anthropic 在內的科技巨擘都發表了重要的 AI 發展。OpenAI 以自己的突破性更新結束了這一連串的公告 - 除了高調地以 65 億美元收購 Jony Ive 的設計公司,推出代號為「io」的雄心勃勃的硬體計畫之外。
該公司已大幅強化 ChatGPT 內的 Operator 自主網頁導覽系統,從先前的 GPT-4o 架構過渡到先進的 o3 推理模型。這項全球推出的服務自 2025 年 5 月 23 日起開始提供,目前為每月 200 美元等級的 ChatGPT Pro 訂戶提供測試階段的服務。
雖然標示為「研究預覽」(research preview),表示仍在改進中,但此項更新是在競爭壓力加劇時推出的。Google 的優質 AI 套件通常售價約為 250 美元(目前第一季折扣價為 125 美元),可存取 Gemini、Imagen 和 Veo 模型,因此 OpenAI 的產品似乎更具競爭力。
瞭解 OpenAI 的 Operator
Operator 於 2025 年 1 月推出,代表 OpenAI 在半自主式電腦應用程式 (Computer Using Agents,CUAs) 的先鋒事業。這項技術將 ChatGPT 的功能從會話介面擴展到執行實際的網路操作。
該系統可自主處理瀏覽任務,包括導覽、資料輸入和交易流程 - 從確保預訂餐廳到編譯研究資料。為了安全起見,Operator 透過專屬的雲端虛擬瀏覽器 (operator.chatgpt.com) 執行功能,而非存取本機瀏覽器,具有強大的保障措施,包括即時使用者監控和限制存取敏感平台。
企業應用程式已展現 Operator 在商務差旅協調和政府服務導航方面的多功能性,突顯其跨產業的潛力。
o3 模型增強
升級在三個關鍵層面提供了可衡量的改進:

- 在 OSWorld 基準上,任務完成率提高了 13% (42.9 vs 38.1)
- WebArena 效能提升 31%(從 48.1 升至 62.9)
- GAIA 基準達成率激增五倍 (62.2 對比 12.3)
使用者體驗評估顯示,他們非常喜歡 o3 的結構化輸出,相較於前一版本較少組織的輸出,78% 的使用者喜歡其詳細、表格式的餐廳預訂呈現,包括位置分析和品質指標。

安全架構
增強版模型維持嚴格的防護措施:
- 94% 的敏感操作確認率(金融交易為 100%)
- 減少 3% 的提示注入漏洞 (20% vs 23%)
- 維持對高風險平台存取的限制
OpenAI 的系統文件證實模型仍低於生物/化學應用程式的關鍵風險臨界值,且缺乏直接編碼環境存取。

企業應用
各行各業的技術領導者可以利用升級後的 Operator 來達到以下目的:
- ML 工程師:簡化模型驗證流程
- 資料專家:自動化網頁式資料驗證
- 安全團隊:審核的安全行為模擬
- IT 協調:可靠的瀏覽器工作自動化
此解決方案結合了增強的功能與內建的風險減緩功能,為現代數位化作業提供了平衡的工具。目前,Response API 繼續在 GPT-4o 架構上運作,遷移時間表尚未確定。
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。





首頁






