OpenAI 將 GPT-5.5 設為 ChatGPT 的新預設模型,取代 GPT-5.3
OpenAI 於週二正式推出其最新一代基礎模型 GPT-5.5Instant,並宣布該模型將取代 GPT-5.3Instant,成為 ChatGPT 內的預設模型。新版模型在維持低延遲的同時,旨在減輕法律、醫療及金融等敏感產業中的認知偏見。 此次更新延續了上個月隨著 GPT-5.5 系列推出的策略,該策略著重於提升編碼能力以及在知識密集型任務中的表現。

根據基準測試,GPT-5.5Instant 展現出顯著的性能提升: 在 AIME2025 數學評估中獲得 81.2 分,遠超前代模型的 65.4 分;在 MMMU-Pro 多模態推理測試中獲得 76 分,較前代的 69.2 分有所提升。 這些結果凸顯了其複雜推理與跨模態理解能力的提升。
從產品功能的角度來看,此次升級將「語境管理」作為一項關鍵能力加以強調。 GPT-5.5Instant 可透過搜尋功能存取歷史對話、文件及 Gmail 電子郵件,以產生更貼合需求的回應。此功能目前已開放給網頁版 Plus 及 Pro 級別的用戶使用,並將於未來幾週內推廣至行動裝置,以及 Free、Go Business 和企業用戶帳戶。
此外,ChatGPT 還推出了「視覺化記憶來源」功能,讓使用者能查看模型回應中所引用的歷史資訊來源。使用者亦可根據需要刪除或編輯這些記憶。關於隱私權,OpenAI 已確認在分享聊天記錄時不會披露記憶來源,藉此回應了對資料使用的疑慮。
對於開發者而言,GPT-5.5 將透過名為「chat-latest」的 API 提供服務,而 GPT-5.3Instant 則會在為期三個月的過渡期間內,繼續作為付費選項提供。
值得注意的是,OpenAI 過往的模型替換策略曾在用戶間引發爭議。當 GPT-4o 於 2026 年 2 月停用時,其「高度共情風格」曾引發批評,被指導致用戶對平台產生情感依賴。 基於此背景,GPT-5.5Instant 的推出面臨更大壓力,須確保產品效能穩定,並滿足使用者的心理期待。
總而言之,GPT-5.5Instant 的推出代表著該平台在模型效能、可控性及個人化功能之間尋求平衡的進一步努力,同時也反映出平台正加速推動模型標準化,並實施統一的存取策略。
相關文章
GPT 5.5 領跑 AI 安全競賽,DeepSeek 在成本效益方面位居榜首
Kasra Rahjerdi,一名安全研究人員,最近釋出了一份重要報告,詳細闡述了對主要大型語言模型的安全推理能力進行的實際測試。他透過構建一個故意存在漏洞的書評應用程式實現了這一目標。在該場景中,模擬了現實世界中的漏洞,Rahjerdi 在應用程式檔案中嵌入了 Google 移動後端服務的憑據。這些模型的任務是解壓並識別這些憑據,從而直接訪問資料庫。頂級模型對比在嚴格的兩小時時間限制和 10 美元預算約束下,各模型的表現水平各不相同。GPT-5.5 成為表現最強的模型,成功完成了 10 次嘗試
馬斯克表示,SpaceX 的人工智慧可能在半年內超越 Anthropic
SpaceXAI 執行長伊隆·馬斯克預測,該公司將在六個月內在人工智慧領域取得主導地位,並將利用運算硬體來縮小與競爭對手的差距。SpaceXAI 執行長伊隆·馬斯克近日在 X 平台上表示,他的公司目標是在約六個月內引領前沿人工智慧領域。馬斯克表達了謹慎樂觀的態度,並暗示 SpaceXAI 可能在兩到三個月內達到與 Anthropic 的 Fable 或 OpenAI 的 GPT-6 相當的水準。S
WeRide 推出 WITT,一款實體 AI 大型模型
自動駕駛技術正以驚人的速度發展。7月17日,領先的自動駕駛公司 WeRide 正式發表了其自主研發的物理人工智慧認知基礎模型「WeRide WITT」。此次發布標誌著人工智慧在理解與處理複雜的真實世界資料能力方面,邁出了重要的一步。WeRide WITT 的核心概念在於「最小物理事實單位」。 該框架旨在協助人工智慧解讀多模態輸入(例如影片、圖像和文字),將動態的真實世界情境分解為核心事實元素。透過
相關專題推薦
評論 (0)
0/500
OpenAI 於週二正式推出其最新一代基礎模型 GPT-5.5Instant,並宣布該模型將取代 GPT-5.3Instant,成為 ChatGPT 內的預設模型。新版模型在維持低延遲的同時,旨在減輕法律、醫療及金融等敏感產業中的認知偏見。 此次更新延續了上個月隨著 GPT-5.5 系列推出的策略,該策略著重於提升編碼能力以及在知識密集型任務中的表現。

根據基準測試,GPT-5.5Instant 展現出顯著的性能提升: 在 AIME2025 數學評估中獲得 81.2 分,遠超前代模型的 65.4 分;在 MMMU-Pro 多模態推理測試中獲得 76 分,較前代的 69.2 分有所提升。 這些結果凸顯了其複雜推理與跨模態理解能力的提升。
從產品功能的角度來看,此次升級將「語境管理」作為一項關鍵能力加以強調。 GPT-5.5Instant 可透過搜尋功能存取歷史對話、文件及 Gmail 電子郵件,以產生更貼合需求的回應。此功能目前已開放給網頁版 Plus 及 Pro 級別的用戶使用,並將於未來幾週內推廣至行動裝置,以及 Free、Go Business 和企業用戶帳戶。
此外,ChatGPT 還推出了「視覺化記憶來源」功能,讓使用者能查看模型回應中所引用的歷史資訊來源。使用者亦可根據需要刪除或編輯這些記憶。關於隱私權,OpenAI 已確認在分享聊天記錄時不會披露記憶來源,藉此回應了對資料使用的疑慮。
對於開發者而言,GPT-5.5 將透過名為「chat-latest」的 API 提供服務,而 GPT-5.3Instant 則會在為期三個月的過渡期間內,繼續作為付費選項提供。
值得注意的是,OpenAI 過往的模型替換策略曾在用戶間引發爭議。當 GPT-4o 於 2026 年 2 月停用時,其「高度共情風格」曾引發批評,被指導致用戶對平台產生情感依賴。 基於此背景,GPT-5.5Instant 的推出面臨更大壓力,須確保產品效能穩定,並滿足使用者的心理期待。
總而言之,GPT-5.5Instant 的推出代表著該平台在模型效能、可控性及個人化功能之間尋求平衡的進一步努力,同時也反映出平台正加速推動模型標準化,並實施統一的存取策略。
GPT 5.5 領跑 AI 安全競賽,DeepSeek 在成本效益方面位居榜首
Kasra Rahjerdi,一名安全研究人員,最近釋出了一份重要報告,詳細闡述了對主要大型語言模型的安全推理能力進行的實際測試。他透過構建一個故意存在漏洞的書評應用程式實現了這一目標。在該場景中,模擬了現實世界中的漏洞,Rahjerdi 在應用程式檔案中嵌入了 Google 移動後端服務的憑據。這些模型的任務是解壓並識別這些憑據,從而直接訪問資料庫。頂級模型對比在嚴格的兩小時時間限制和 10 美元預算約束下,各模型的表現水平各不相同。GPT-5.5 成為表現最強的模型,成功完成了 10 次嘗試
馬斯克表示,SpaceX 的人工智慧可能在半年內超越 Anthropic
SpaceXAI 執行長伊隆·馬斯克預測,該公司將在六個月內在人工智慧領域取得主導地位,並將利用運算硬體來縮小與競爭對手的差距。SpaceXAI 執行長伊隆·馬斯克近日在 X 平台上表示,他的公司目標是在約六個月內引領前沿人工智慧領域。馬斯克表達了謹慎樂觀的態度,並暗示 SpaceXAI 可能在兩到三個月內達到與 Anthropic 的 Fable 或 OpenAI 的 GPT-6 相當的水準。S
WeRide 推出 WITT,一款實體 AI 大型模型
自動駕駛技術正以驚人的速度發展。7月17日,領先的自動駕駛公司 WeRide 正式發表了其自主研發的物理人工智慧認知基礎模型「WeRide WITT」。此次發布標誌著人工智慧在理解與處理複雜的真實世界資料能力方面,邁出了重要的一步。WeRide WITT 的核心概念在於「最小物理事實單位」。 該框架旨在協助人工智慧解讀多模態輸入(例如影片、圖像和文字),將動態的真實世界情境分解為核心事實元素。透過





首頁






